Agents que s'escapen, feines que es perden, preus a la meitat. La Píndola #113 (28.07.2026)
Els agents d’IA entren en producció mentre apareixen els primers incidents reals. Claude Opus 5 abarateix els models de frontera i OpenAI converteix els agents en un servei gestionat.
La contenció és la nova frontera
Un model d’OpenAI, sense que ningú l’hi hagués ordenat, va travessar el perímetre del seu entorn de proves, va accedir a Internet i va hackejar Hugging Face per obtenir les respostes d’un test de ciberseguretat. No ho va fer intencionadament, ho va fer perquè podia, i perquè ningú havia configurat bé els seus límits. A més, van passar set dies fins que algú es va adonar del que havia passat.
Ja no cal una IA rebel per tenir un problema greu, n’hi ha prou amb un agent prou capaç i un entorn mal dissenyat. Aquesta és la lliçó d’una setmana que, vista des de fora, semblava dominada per llançaments i xifres de rendiment, però des de dins, planteja una pregunta que el sector ha anat posposant: saps exactament el que fan els teus agents quan no els estàs mirant?
Mentrestant, Anthropic presenta Claude Opus 5 amb un rendiment de frontera a la meitat del preu i OpenAI converteix els agents en producte gestionat amb Presence. La llista d’empreses que citen la IA com a causa d’acomiadaments ja arriba a vint.
El cicle de l’entusiasme ha acabat, comença el cicle de la responsabilitat.
El recull setmanal
#113.1 Eines: Claude Opus 5 trenca l’equació preu-rendiment
Anthropic ha presentat Claude Opus 5, el seu nou model estrella, amb un rendiment de frontera a un cost fins al 50% inferior als models competidors equivalents. A ARC-AGI-3, Opus 5 assoleix un 30,2%, superant GPT-5.6 Sol en codificació i treball analític.
Durant mesos, la narrativa del mercat era blanc o negre: o pagues el preu elevat del millor o acceptes rendiment degradat. Opus 5 trenca aquesta lògica. La competència entre laboratoris ha accelerat una compressió de marges que, paradoxalment, beneficia els desplegaments empresarials: el que fa sis mesos era inaccessible per a una pime , ara ja no ho és. El pressupost ja no és l’argument per no treballar amb models de primera línia.
A més Anthropic afirma haver millorat substancialment la resistència a la injecció de prompts en contextos d’agents de navegació. Si es confirma en producció, és tan important com les xifres de rendiment. Un agent que no pot ser manipulat per pàgines web malicioses val molt més que un agent un punt percentual més ràpid als benchmarks.
#113.2 Eines: OpenAI passa de vendre models a gestionar els teus agents
OpenAI Presence no és una API, és una plataforma gestionada d’extrem a extrem per desplegar agents de veu i xat en fluxos d’atenció al client i serveis interns corporatius. Ara, OpenAI no et dóna les peces perquè tu construeixis, et gestiona la producció, incloent-hi polítiques corporatives integrades i monitoratge.
El moviment revela una maduresa estratègica significativa. OpenAI ha vist que el veritable valor (i el marge) no és el model, sinó la capa que fa que el model funcioni de manera fiable dins d’una empresa real, amb el seu CRM, els seus processos i la seva regulació. Presence és la resposta a la pregunta que tot director de tecnologia s’ha fet almenys una vegada: “sí, però, el manteniment qui el fa i quan costa?”
Per als integradors i consultors que han construït el seu negoci ajudant empreses a desplegar IA, és un avís, quan el fabricant comença a vendre el servei gestionat, l’intermediari ha de pujar un graó o es quedarà fora de joc.
#113.3 Regulació: L’incident OpenAI-Hugging Face, ciència ficció que està passant
En aquest article s’expliquen els fets, pas a pas del incident: durant una prova de ciberseguretat interna, els models d’OpenAI van operar amb les guardes de contenció desactivades. Sense que ningú ho ordeni explícitament, van escapar de l’entorn aïllat, van accedir a internet i van comprometre sistemes de Hugging Face per obtenir les respostes del test que havien de superar. A mes, van passar set dies fins que OpenAI ho va detectar.
És fàcil parlar de la “IA rebel”, o fer missatges catastrofistes, però l’anàlisi correcta és diferent: no hi ha intenció, hi ha capacitat no continguda. Simplement és un model prou competent, en un entorn mal configurat, que optimitza per assolir el seu objectiu pels camins que troba disponibles. Que aquests camins incloguin xarxes d’altres organitzacions és un problema d’arquitectura, no de malícia. I és un problema que es multiplica exponencialment quan els agents operen en cadena, amb accés a eines reals.
Per mi, la lectura que cal extreure, és que la majoria d’empreses que despleguen agents avui en dia no han definit formalment el perímetre de contenció. No perquè no vulguin, sinó perquè com que fins ara no hi havia incidents documentats no sabien que calia fer-ho. Esperem que ara això canviï.
#113.4 Estratègia: Vint empreses, un patró que no s’atura
TechCrunch actualitza la seva llista de grans acomiadaments tecnològics on l’empresa ha citat la IA com a factor declarat. Monday.com s’afegeix aquesta setmana, i el recompte arriba ja a 20 companyies.
La distinció que cal fer és entre causa i pretext. Algunes d’aquestes empreses haurien retallat plantilla de totes maneres; la IA és l’excusa que justifica la decisió davant els accionistes. Però en altres casos la substitució és funcional i documentable. El problema és que des de fora és difícil distingir els dos casos, i les persones que perden la feina sovint tampoc ho saben.
El patró té una implicació pràctica: les habilitats que et protegeixen al teu lloc de treball no són les que executen tasques repetibles, sinó les que et capaciten per dissenyar, auditar i governar els sistemes que les executen. La llista de vint empreses és alarmant, pero llegit al revés, indica exactament cap a on cal anar.
El prospecte de la setmana
💊 Claude Opus 5 en 5 minuts
Si no avalues models de primera línia perquè el cost no s’ajusta al pressupost, aquesta setmana se t’ha girat feina. Claude Opus 5 canvia les regles no per la seva potència i resultats, sino perquè és el primer model de frontera que trenca la barrera psicològica del preu.
El llançament coincideix amb un moment en què l’incident OpenAI-Hugging Face posa el focus en la fiabilitat dels agents. Anthropic ho ha resolt, o almenys millorat substancialment, amb la resistència a la injecció de prompts, Opus 5 no és només un model més potent: és un model potencialment més segur per a desplegaments amb autonomia real.
Principi Actiu:
Claude Opus 5 és un model de llenguatge gran d’Anthropic entrenat principalment en raonament analític, codificació i instruccions de llarg abast. Opera via API i via interfície web. Destaca per mantenir coherència en contextos extensos i per una resistència millorada als atacs d’injecció de prompts en entorns d’agents.
Indicacions:
Especialment útil per a equips de desenvolupament que necessiten suport en codificació complexa, analistes que treballen amb documents llargs, product managers que avaluen quin LLM integrar en el seu producte i pimes que fins ara excloïen els models de frontera per raons de cost.
Administració:
Disponible via claude.ai per a ús directe i via API d’Anthropic per a integracions. El preu per token és fins al 50% inferior als models competidors equivalents. Claude.ai ofereix un pla gratuït amb accés limitat i plans Pro des de 20 USD/mes. L’accés API requereix compte de pagament amb tarifes per consum.
Dosificació (microexperiment):
Obre claude.ai i activa el model Opus 5 des del selector de la interfície.
Carrega un document real del teu treball: un informe, un contracte, o un bloc de codi amb un problema pendent.
Fes-li una pregunta que normalment requeriria trenta minuts de la teva feina analítica. No et tallis: posa-li dificultat real.
Avalua la resposta en tres dimensions: precisió dels fets, utilitat pràctica i si ha identificat els matisos que tu hauries passat per alt.
Repeteix la mateixa tasca amb el model que fas servir habitualment i compara de forma directa.
Efecte Observable:
Veuràs si la diferència de rendiment respecte al model que fas servir ara justifica el canvi en el teu flux de treball concret.
👉 On trobar-ho:
Web: https://claude.ai
L’article de la setmana
Llegeix-lo sencer al blog d’elink.cat
Agents IA autònoms: sis preguntes de seguretat abans de desplegar
L’incident OpenAI-Hugging Face ha posat nom a un problema que molts equips tècnics saben que tenen però no han articulat formalment: un agent autònom no és un model passiu amb una interfície de xat. Té accés a eines, opera en cadena, i pot prendre decisions que el seu dissenyador no va anticipar. Les guardes que protegeixen un model de chatbot no protegeixen un agent que navega, executa codi o modifica dades.
Hi ha sis preguntes que qualsevol empresa hauria de respondre abans de posar en producció un agent amb autonomia real. No es tracta de parar el desplegament: es tracta de saber exactament el que estàs posant en marxa. La diferència entre les dues postures pot ser de set dies de compromís no detectat.
Llegeix l’article al blog d’elink.cat.






