ACTINN & TALKS: «IA EFICIENT: NO ÉS EL PROMPT. ÉS L’ARQUITECTURA»

Moltes empreses pensen que optimitzar IA vol dir escriure prompts més curts. Això és només una part. En producció, el cost depèn de moltes decisions: quants tokens envies, quantes vegades repeteixes el mateix context, si uses el model gran per tot, si tens el RAG ben dissenyat, si tens caché, si observes latència i consum, si separes tasques simples de tasques complexes i si tens proves de qualitat abans de canviar prompts o models.
A més, els grans proveïdors ja estan incorporant mecanismes específics d’optimització. OpenAI, per exemple, explica que el prompt caching reutilitza tokens d’entrada vistos recentment, amb descomptes i menor latència en determinats models. Anthropic documenta el prompt caching com una manera de reduir temps i cost en prompts repetitius, amb caché per prefixos i durada per defecte de 5 minuts. I Gemini incorpora context caching implícit en models 2.5 i posteriors, amb recomanacions com situar el contingut comú i gran al principi del prompt.
La nova competència de les empreses no serà només “saber fer prompts”, sinó saber decidir quan usar IA, quin model usar, amb quin context, quines dades enviar, què cachejar, què resoldre amb eines tradicionals i què auditar.
Abans una funció amb IA era escollir un model; ara és dissenyar una cadena de dependències per a cada cas d’ús (un ecosistema amb LLMs, agents, RAG, embeddings, MCP, seguretat, observabilitat, memòria, automatització i bases vectorials). El problema no és triar eines, sinó saber quan fer-les servir, i governar les connexions entre elles. El problema ara és dissenyar arquitectures d’ús eficient i governat de la IA.
Es celebrarà el dia 8 d’octubre a Smart Coworking a les 19 hores
Inscripció gratuïta aquí