vidas

Agents d'IA


Temps de lectura: 2 minuts


El que va començar com a compte d'Instagram per conscienciar sobre la importància de l'ictus i la seva prevenció, va evolucionar cap a la creació d'una associació sense ànim de lucre per donar suport als afectats i les seves famílies.



Camí cap a l'AGI

Quan vam estar veient les etapes que va definir OpenAI per arribar a la Intel·ligència Artificial Genera (AGI), o superintel·ligència artificial, el primer nivell eren els chatbots, ja superat. El segon nivell el constitueixen els models amb raonament, com ara el model o1. Ara entrem al nivell, 3 amb un agent.

Operator

Operator és un agent d'IA que pot completar accions en línia. Al web d'OpenAi es defineix com a una prèvia de recerca d'un agent que pot accedir a la web per realitzar tasques per tu. Podeu automatitzar diverses tasques (com completar formularis, reservar viatges o fins i tot crear memes) en interactuar de forma remota amb un navegador web de la mateixa manera que ho faria una persona, mitjançant clics del ratolí, desplaçament i escriptura.

Podem demanar-li, en aquesta versió beta, que busqui un lloc interessant per anar de vacances i que compri un parell de bitllets a bon preu per sortir d'aquí un mes i que ens enviï fotos d'aquest lloc per email.

A la primera demo que va realitzar Carlos Santana el canal Dot DCV Lab, realitza diverses accions amb gran èxit, fins i tot corregint-se a si mateix quan troba dificultats.

Operator té el seu propi navegador i fa les accions amb ell. A més, podem interaccionar al navegador d'Operator si és necessari o si hem d'entrar credencials per continuar.

Versió beta

OpenAi ha indicat que aquesta és una primera versió de l'agent i que pot cometre errors, però tot i així es mostra molt eficient, fins i tot en els moments en què no pot llegir correctament les pàgines web. És capaç de refrescar-les i continuar.

"El model CUA (Computer-Using Agent) està entrenat per sol·licitar la confirmació de l´usuari abans de finalitzar tasques amb efectes secundaris externs, per exemple, abans d'enviar una comanda, enviar un correu electrònic, etc., perquè l'usuari pugui verificar el treball del model abans que es torni permanent”, indiquen des d'OpenAI.

Un punt que m'ha semblat molt curiós i intel·ligent és que, en demanar-li que faci un càlcul, ha obert la calculadora al navegador, ha enganxat els càlculs i n'ha recuperat el resultat.

Competència

Tenim agents creats per Rabbit, Google i Anthropic. OpenAi s'ha incorporat l'últim dins dels agents, però ha fet una bona feina pel que es veu a la primera beta.

Seguretat

Aquest és un dels punts que més es discutiran quan es popularitzin els agents. Serà un moment per forçar les regulacions sobre l'ús de l'IA.

Quan un sistema d'IA pot fer accions a la web, obre la porta a casos d'ús molt més perillosos per part d'actors maliciosos. Es podrien automatitzar agents d'IA per orquestrar estafes de pesca o atacs DDoS, o fer que adquireixin entrades per a un concert abans que ningú més ho pugui fer.

L'operador fa servir eines que busquen limitar la susceptibilitat del model a missatges maliciosos, instruccions ocultes i intents de phishing, explica OpenAI a la seva pàgina web.

Conclusió

En definitiva, el CUA pot fer servir botons, navegar per menús i completar formularis en una pàgina web de forma molt similar a com ho faria un humà. Menys els Captcha, dels quals avisa que n'ha trobat un i sol·licita la intervenció de l'usuari per continuar.

Referències

Comentaris sobre 'Agents d'IA'

Carregant comentaris...
Xavier és un desenvolupador sènior full stack i opera des de la ciutat mediterrània de Barcelona. Li encanten les tecnologies de programari i està convençut que el desenvolupament de software és un procés col·laboratiu i obert.
I és un apassionat de l'astronomia i la fotografia. El pots trobar a:
Comparteix aquest post