Del chat al agente

Del chat
al agente

IA para empresarios ocupados.

santiago@agente
objetivo: cuándo basta ChatGPT, cuándo compensa un agente

Santiago Scagliusi, PhD

El problema real

ChatGPT contesta. Codex trabaja dentro del sistema.

El coste no es escribir el prompt. Es saltar del trabajo al chat, copiar, pegar y repetir en cada tarea del día.

La idea que guía la charla

“El éxito no es construir el sistema más sofisticado. Es construir el sistema adecuado para lo que necesitas.”

Anthropic · Building Effective Agents

Hoy vamos a lo más simple que de verdad funciona. Nada de humo.

El recorrido

De predictor de texto a compañero de trabajo

01
LLM

Predice la siguiente palabra.

02
Prompt

Objetivo, datos y criterio.

03
Herramientas

Leer, buscar, redactar.

04
Agente

Persigue un objetivo con límites.

Acto I · Qué es un LLM

No busca respuestas. Predice la siguiente palabra.

predicción de tokens
Elcieloestánublado,parecequevaa
siguiente palabra · probabilidad
“llover”72%
“nevar”14%
“tronar”7%

Menos mágico. Y mucho más útil de entender.

El panorama

Todos anuncian "el modelo más potente". Cada semana.

Meme: Grok, OpenAI, Gemini y Claude anunciando por turnos "el modelo más potente del mundo"

Claude, ChatGPT, Gemini, Grok… no hace falta perseguir el ranking, necesitas el que sabes usar bien.

El prompt · apuntar

“Perro”… ¿desde dónde te hablo?

perro
razas
vacunas
pienso
lobo
Egipto
fieles
“perro sanxe”
meme
prompt
rol: sin definir

La misma palabra vive entre vecinos distintos. El rol o el contexto del prompt apunta a una zona del mapa. Por eso un buen prompt empieza por ahí.

no partas de cero: busca "awesome-prompts" en GitHub

Contexto

Más texto no es más inteligencia.

el reflejo

Pegarle todo el buzón

Mucho ruido. El modelo se despista: pierde el foco igual que una persona ante 300 mensajes.

señal útil: baja

lo que funciona

Los 3 correos que importan

Lo justo, de alta señal. Anthropic: “el conjunto más pequeño de tokens de alta señal”.

señal útil: alta

Ventana de contexto

Como en Memento: olvida, y se atonta al llenarse

Cartel de la película Memento (2000)
“No puedo formar
recuerdos nuevos.”
REGLA · ANÓTALO TODO O LO OLVIDA
Memento (2000), dir. Christopher Nolan
contexto usado lúcido
~100k
zona lista (primeros ~100k) zona torpe (lo que anuncian de más: 200k–1M)
context rot: empieza a olvidar y a inventar

Cada token se relaciona con todos los demás: crece al cuadrado, como añadir equipos a una liga. Aunque la ficha diga 200k o un millón, la parte fiable son los primeros ~100k.

18 modelos punteros, todos empeoran al crecer el contexto.

El arreglo

Dale sus tatuajes: un brief corto y permanente

AGENTS.md
# AGENTS.md
rol: asistente de correo de Santi (profesor, U. de Sevilla).
objetivo: leer, ordenar y redactar borradores. No enviar.
tono: claro y breve, en español.
límites: nada de fechas ni pagos inventados; ante la duda, pregunta.
# se reinyecta al empezar cada conversación

Un archivo corto que el agente relee cada vez que “despierta”. Le dice quién es, qué busca y qué no debe hacer. Pocas líneas de alta señal: si lo llenas de todo, vuelve el context rot.

CLAUDE.md · nativo de Claude AGENTS.md · estándar abierto, 60.000+ proyectos
Herramientas

Deja de hablar. Empieza a actuar.

solo texto
tú: ¿qué correos tengo sin responder?
agente: no tengo acceso a tu correo, no puedo saberlo.
con herramienta
tú: ¿qué correos tengo sin responder?
→ leer_bandeja()
3 sin responder: Contrato, Reunión, Factura.

La herramienta le da ojos y manos sobre tus datos reales.

El riesgo de fondo

Puede sonar seguro y estar equivocado.

En un correo, eso es inventar una fecha, un importe o un compromiso que nadie dijo. Por eso un agente necesita herramientas para comprobar, no solo para hablar.

“La IA es un becario brillante… sin sentido común.”

le das tareas que verificarías de un becario de primer día

Acto II · Anatomía

Un agente de coding es un bucle con herramientas

a todo esto junto se le llama el "harness": lo que envuelve al modelo para que pueda actuar

Tarea

“Busca los correos urgentes de clientes, prepara borradores y dime qué necesita mi decisión.”

esto ya no es un prompt suelto
Asistente
Modelo de
lenguaje
Herramientas Gmail · Drive · archivos · terminal
Reúne contexto
Formula un plan
Actúa
Itera
Qué añade Codex frente a un chat

Las piezas no compiten. Cada una resuelve un problema.

AGENTS.md / CLAUDE.md
Reglas siempre cargadas

Quién eres, cómo trabajas, qué no debe hacer. Pocas líneas de alta señal.

Skills
Procedimientos reutilizables

Un workflow que no quieres explicar cada vez: triaje, propuesta, revisión, publicación. Catálogo abierto en skills.sh.

MCP
Conectores a sistemas

Gmail, Drive, Calendar, CRM, GitHub, Figma. Dejas de copiar datos al chat.

Hooks
Control determinista

Validar, bloquear secretos, lanzar tests o registrar cambios sin confiar en que el modelo se acuerde.

Permisos
Qué puede tocar

Leer, escribir, ejecutar, pedir aprobación. La autonomía se diseña por capas.

Subagentes
Trabajo paralelo acotado

Un agente revisa seguridad, otro datos, otro documentación. Vuelven con resúmenes.

Codex = reglas + herramientas + verificación dentro del entorno.

El motor

Observa, decide, actúa, verifica

tu visto bueno
01
Observa
02
Decide
03
Actúa
04
Verifica

chat = responde · workflow = pasos fijos que tú dibujas · agente = decide él los pasos

La diferencia con un chat: el agente mira el resultado de su propia acción y repite… o para y te pide el visto bueno. No es autonomía ciega: es trabajo con puntos de control.

Mira su propio resultado. Repite… o para y te pide el visto bueno.

Un concepto más: usage

Cada acción cuesta. El flujo importa más que el modelo.

"Usage" es lo que gasta un agente en cada paso: tiempo, tokens, dinero. Un flujo descuidado quema usage sin necesidad; uno cuidado hace más con menos.

qué mueve más la aguja
Cuidar el flujo contexto, pasos, verificación
gran salto
Subir al modelo más caro sin tocar el flujo
poco
la prueba está a la vuelta de la esquina

En el caso de correo lo vais a ver con números reales: 2 horas → 12 minutos, sin cambiar de modelo. El ahorro no viene del modelo, viene del flujo.

Empieza simple; sube complejidad solo si mejora el resultado de forma demostrable.

Bloques que se combinan

Cuatro patrones que casi siempre bastan

Encadenar

Paso a paso. redacta → revisa el tono → acorta

Clasificar y derivar

Etiqueta y trata distinto. factura · reunión · spam

Reflexión

Revisa su propio trabajo y lo mejora antes de dártelo.

Humano en el bucle

El agente prepara. Tú apruebas. El patrón clave.

La prueba

Esto no es un día uno. Es lo que uso cada semana.

Nada de copiar y pegar en un chat: Codex trabajando dentro de mis sistemas reales.

Analítica
Decisiones con datos

Saca métricas de PostHog y propone qué cambiar, no solo qué pasó.

Redes
Publica y mide

Sube contenido a Instagram y analiza el rendimiento con su propia API.

Conocimiento
Tu segundo cerebro

Digiere cualquier vídeo de YouTube y lo deja como notas que luego puedes buscar.

Día a día
Correo, avisos, agenda

Lee el correo, prepara recordatorios y te organiza el día.

Navegador
Controla Chrome

Abre pestañas, rellena formularios, navega sitios reales por ti.

Escala
Planes y conectores

Plans para tareas largas; MCP para enchufar cualquier herramienta que ya usas.

esto es lo que viene ahora: dos o tres de estos, en vivo, en esta pantalla

OAuth + MCP

Así se conecta, por dentro, a tus sistemas de verdad

Codex
el agente
MCP
el adaptador
API real
tu cuenta

autorizas con OAuth · no entregas la contraseña · das permisos concretos

leer y buscar
crear borrador
enviar (desactivado)

Cada conector expone una lista corta de acciones. Tú eliges cuáles activar.

Acto III · El caso real

El agente de correo que la gente usa de verdad es modesto.

Lee, ordena, resume, saca fechas y redacta borradores. Tú apruebas y envías. El humo está en prometer una bandeja que se gestiona sola.

Triaje de bandeja

De caos a cola con prioridad

08:12Contrato pendiente de revisaracción
09:03Reunión movida al juevesresponder
09:40Newsletter: 7 trucos de IAarchivar
10:47Hilo de 24 mensajes del comitéresumen
11:18Factura duplicada este mesriesgo
11:55Alerta automática del servidorarchivar

6 correos · 2 urgentes · borradores listos para tu visto bueno.

2 h 12 min

Honestidad

Dónde brilla y dónde falla

brilla

Leer y ordenar · resumir hilos largos · extraer fechas y acciones · redactar borradores. Texto sobre texto: lo hace bien.

falla

Inventa datos con seguridad · encadenar muchos pasos degrada la fiabilidad.

99% por paso · 20 pasos → ya no tienes un sistema que funciona

Aplicado a tu negocio

La ventaja no es escribir un email. Es cerrar el ciclo.

01 · fuentes

Correo + Drive + calendario

El contexto ya está donde trabaja la empresa. Codex lo consulta con permisos.

02 · workflow

Skill de triaje comercial

Clasifica clientes, detecta urgencias, resume hilos y prepara próximos pasos.

03 · salida

Borradores + tabla + tareas

No solo texto: deja trabajo revisable y trazable para que alguien apruebe.

Leer sistemas
Preparar artefactos
!Cliente final: humano aprueba
Sin alarmismo · Meta AI

Seguridad: la Regla de Dos

Peligro real solo cuando se juntan las tres.

01

Entradas no fiables

correos de desconocidos

02

Datos sensibles

tu bandeja entera

03

Acción hacia fuera

enviar en tu nombre

Las tres a la vez = no. Para el correo, quitas una: que no envíe solo.

El permiso que importa

Borrador sí.
Envío no.

“No conozco ni una sola empresa que no tenga un humano en el bucle.”

Leer y resumir
Etiquetar y ordenar
Redactar el borrador
!Enviar → pide tu visto bueno

Un correo enviado es irreversible y va con tu nombre. Revisar cuesta 10 segundos.

Para llevar

Cómo encargar trabajo a un agente

encargo.txt
Objetivo: revisa el correo de hoy y prepara respuestas.
Contexto: solo la bandeja; mi tono es breve y directo.
Límites: no envíes nada; no prometas pagos ni fechas.
Formato: lista con asunto, resumen y borrador.
Revisión: marca lo que necesita mi decisión.

Cinco líneas. Reutilizable para casi cualquier encargo.

Idea final

No se trata de hablar mejor con la IA.

Se trata de diseñar trabajo que la IA pueda ejecutar, comprobar y devolverte para que tú decidas.

Para no perderte: decide qué delegarle, descríbeselo bien, revisa con ojo crítico lo que te devuelve, y úsalo con responsabilidad. (Anthropic, AI Fluency)

Fuentes

De dónde sale lo que has visto

Anthropic · Building Effective Agents
anthropic.com/engineering/building-effective-agents
OpenAI · Practical Guide to Building Agents
openai.com · building agents
Google · Introduction to Agents
kaggle.com/whitepaper-introduction-to-agents
Claude Code · docs (cómo funciona, skills, MCP, hooks)
code.claude.com/docs/en/features-overview
OpenAI Codex · AGENTS, skills, MCP, hooks
developers.openai.com/codex/codex-manual.md
Correo y conectores · Anchor.host + Composio Gmail MCP
composio.dev/toolkits/gmail/framework/codex
Context rot · Chroma + Workflow for AI Coding
research.trychroma.com/context-rot
AGENTS.md · brief abierto para agentes
agents.md
Prompts · bancos "awesome-prompts" en GitHub
github.com · buscar "awesome-prompts"
Skills · catálogo abierto
skills.sh