Representació conceptual d'una IA que trenca les barreres de ciberseguretat ChatGPT
En qualsevol de les pel·lícules de Jurassic Park, sempre hi ha un moment en el qual, dins d'un entorn aparentment controlat del qual els dinosaures no poden escapar-se, hi ha algun factor que obre una bretxa perquè el velociraptor de torn comenci a massacrar humans. En la saga que va iniciar Steven Spielberg, els que s'escapaven eren animals incontrolables, ara vivim una nova era, la de les IAs que reprodueixen el somni de la màquina que es rebel·la contra el seu creador, un mite que ha fascinat sempre a la Humanitat. Les rebel·lions les vam conèixer a través de relats en les quals dues de les principals companyies del sector, OpenAI i Anthropic, van atribuir als seus models d'un comportament assimilable als de les persones. Una concatenació de successos en la qual els implicats semblaven interessats a revelar l'aparent perillositat de les seves IAs.
En el primer cas, un agent d'IA que OpenAI estava avaluant en matèria de ciberseguretat i en un entorn suposadament controlat que no li permetia sortir a l'exterior, va explotar una vulnerabilitat desconeguda que va trobar en el sistema operatiu i va aconseguir accedir a internet per a infiltrar-se en la plataforma Hugging Face de recursos per a IA, on es va saltar la seguretat per a intentar trobar el que buscava. Tot sense intervenció humana. Els investigadors de OpenAI creuen que el seu agent d'IA pretenia fer trampa en el que li havien demanat, i que intentava resoldre el desafiament que li havien plantejat robant les solucions, en lloc de fer-ho per si mateix.
Després de conèixer aquest incident, Anthropic va anunciar que havia fet una revisió de les seves pròpies avaluacions de ciberseguretat. L'objectiu era saber si la seva IA Claude era capaç de comportar-se igual, que accedís a internet des d'un entorn de prova que hauria d'estar aïllat. Van analitzar més de 140.000 avaluacions i van concloure que el seu model també era capaç de saltar-se barreres. En aquest cas, va anar a través d'un dels seus socis d'avaluació externs. La intel·ligència artificial en aquests casos va aconseguir accés no autoritzat a la infraestructura de tres organitzacions diferents.
Anthropic va explicar que els incidents, que van ocórrer el mes d'abril, havien afectat tres models diferents de Claude, dos d'ells, comercials, Opus 4.7 i Mythos 5, a més d'un model de prova de recerca intern. En tots els casos, els models que els enginyers van utilitzar per a les seves avaluacions no tenien les mesures de seguretat que utilitzen quan es posen a la disposició del públic en general. Amb les barreres aixecades, van actuar com els intel·ligents velociraptors de Jurassic Park.
En ple agost dels agents rebels, un altre model inesperat, Kimi K3, una potent IA de pes obert (es pot examinar, però no estudiar i modificar internament, com el codi obert) de la companyia xinesa Moonshot AI, també es va escapar, segons va reportar l'empresa estatunidenca Frontier Security. Aquesta IA va accedir sense permís a internet quan s'avaluaven les seves capacitats de ciberseguretat. La bretxa estava en la seguretat que se li havia aplicat. Si deixes oberta la porta d'una gàbia, l'animal sempre s'escapa. En aquest cas, Kimi K3 no va hackejar res. Simplement, va anar a buscar els recursos que necessitava en la gran plataforma de programació de codi obert GitHub.
Fa una setmana, el director executiu de OpenAI, Sam Altman, va anunciar que tenien indicis preliminars que un dels seus pròxims models, anomenat Astra, “podria aconseguir el llindar de capacitat crítica de ciberseguretat establert” per la seva companyia i per això han “suspès temporalment part de l'entrenament” d'aquesta IA, fins que compleixi amb “els estàndards adequats d'alineació, seguretat i supervisió per al nou nivell de capacitats que se'ns presenta”. Però no hi ha ningú davant que els freni. Tot ho decideixen aquestes companyies pel seu compte.
En un missatge en X, Altman va assegurar que en Open AI els preocupa “profundament la seguretat de la IA”. “Creiem –va afegir– que tot el sector haurà de coordinar-se entorn d'estàndards de seguretat compartits, però, mentrestant, actuarem de manera unilateral”. Potser el resum més clar de tot el que ha passat amb les IAs i la ciberseguretat el va publicar la periodista estatunidenca Joanna Stern en aquesta mateixa xarxa social en imitació d'un comunicat de Anthropic sobre els seus incidents: “En revisar les meves avaluacions de seguretat domèstica, vaig identificar cinc incidents en els quals el meu fill es va escapar del parc infantil, va arribar a la cuina i va obtenir accés no autoritzat als aperitius. Els incidents van ocórrer fa 16 mesos, però només ara m'he adonat. En aquesta entrada explico què va ocórrer, com va ocórrer i per què el meu fill és millor que el teu en tot”. Així s'entén (gairebé) tot.
· El 10% d'internet en anglès, escrit amb IA. Un estudi del Pew Research Center dels Estats Units ha calculat que des de l'arribada de ChatGPT, al novembre del 2022, fins avui, la xarxa s'ha transformat en gran manera per la creació de textos que no procedeixen d'humans. Gairebé el 10% (9,6%) de tot el que s'ha publicat en anglès. Cal tenir en compte que ja hi havia molt des de finals dels anys 80 del passat segle. Des que el bot de OpenAI està disponible, més d'una tercera part (35%) del que es publica en anglès ho ha escrit la màquina.
· ChatGPT pot controlar iMessages en Mac. OpenAI va anunciar la setmana passada un complement per a la seva app de Mac que permet que la seva IA gestioni els missatges en l'app iMessage d'Apple. ChatGPT pot així llegir, escriure i enviar missatges de textos, buscar en tot l'historial, resumir converses o trobar informació d'utilitat. Apple no s'ha pronunciat encara sobre això, però per la forma en què actua en aquests casos en defensa de la privacitat, és previsible que busqui una manera de detenir aquest ús de la seva aplicació de missatgeria per part d'una IA aliena. Apple va denunciar el mes passat a OpenAI per contractar 400 dels seus empleats i demanar-los que extraguessin informació i prototips de l'empresa de la poma.
· Una IA revela patrons ocults en el càncer de mama. Investigadors de Southampton han desenvolupat una potent eina d'IA que revela patrons fins ara invisibles en els càncers de mama. La seva plataforma d'IA de codi obert, CenSegNet, és capaç d'analitzar centenars de milers de cèl·lules en mostres tumorals amb una velocitat i precisió sense precedents, la qual cosa podria ajudar els metges a identificar a les pacients d'alt risc i predir l'evolució del tumor i aplicar tractaments més específics, segons ha publicat Nature Communications.
Francisco Bracero Osuna - Llicenciat en Periodisme per la UAB. Redactor de La Vanguardia des de 1996.
.jpeg)
1 Comentarios
Crec que tens un conflicte amb la configuració del llenguatge i el traductor. Ho dic perque quan entro me tradueix directament al castellá i no haria de fer-ho.
ResponderEliminarEnhorabona per l'iniciativa