IA para empresarios ocupados.
Santiago Scagliusi, PhD
El coste no es escribir el prompt. Es saltar del trabajo al chat, copiar, pegar y repetir en cada tarea del día.
“El éxito no es construir el sistema más sofisticado. Es construir el sistema adecuado para lo que necesitas.”
Anthropic · Building Effective Agents
Hoy vamos a lo más simple que de verdad funciona. Nada de humo.
Predice la siguiente palabra.
Objetivo, datos y criterio.
Leer, buscar, redactar.
Persigue un objetivo con límites.
Menos mágico. Y mucho más útil de entender.
Claude, ChatGPT, Gemini, Grok… no hace falta perseguir el ranking, necesitas el que sabes usar bien.
La misma palabra vive entre vecinos distintos. El rol o el contexto del prompt apunta a una zona del mapa. Por eso un buen prompt empieza por ahí.
no partas de cero: busca "awesome-prompts" en GitHub
Mucho ruido. El modelo se despista: pierde el foco igual que una persona ante 300 mensajes.
señal útil: baja
Lo justo, de alta señal. Anthropic: “el conjunto más pequeño de tokens de alta señal”.
señal útil: alta
Cada token se relaciona con todos los demás: crece al cuadrado, como añadir equipos a una liga. Aunque la ficha diga 200k o un millón, la parte fiable son los primeros ~100k.
18 modelos punteros, todos empeoran al crecer el contexto.
Un archivo corto que el agente relee cada vez que “despierta”. Le dice quién es, qué busca y qué no debe hacer. Pocas líneas de alta señal: si lo llenas de todo, vuelve el context rot.
La herramienta le da ojos y manos sobre tus datos reales.
En un correo, eso es inventar una fecha, un importe o un compromiso que nadie dijo. Por eso un agente necesita herramientas para comprobar, no solo para hablar.
“La IA es un becario brillante… sin sentido común.”
le das tareas que verificarías de un becario de primer día
a todo esto junto se le llama el "harness": lo que envuelve al modelo para que pueda actuar
“Busca los correos urgentes de clientes, prepara borradores y dime qué necesita mi decisión.”
Quién eres, cómo trabajas, qué no debe hacer. Pocas líneas de alta señal.
Un workflow que no quieres explicar cada vez: triaje, propuesta, revisión, publicación. Catálogo abierto en skills.sh.
Gmail, Drive, Calendar, CRM, GitHub, Figma. Dejas de copiar datos al chat.
Validar, bloquear secretos, lanzar tests o registrar cambios sin confiar en que el modelo se acuerde.
Leer, escribir, ejecutar, pedir aprobación. La autonomía se diseña por capas.
Un agente revisa seguridad, otro datos, otro documentación. Vuelven con resúmenes.
Codex = reglas + herramientas + verificación dentro del entorno.
chat = responde · workflow = pasos fijos que tú dibujas · agente = decide él los pasos
La diferencia con un chat: el agente mira el resultado de su propia acción y repite… o para y te pide el visto bueno. No es autonomía ciega: es trabajo con puntos de control.
Mira su propio resultado. Repite… o para y te pide el visto bueno.
"Usage" es lo que gasta un agente en cada paso: tiempo, tokens, dinero. Un flujo descuidado quema usage sin necesidad; uno cuidado hace más con menos.
En el caso de correo lo vais a ver con números reales: 2 horas → 12 minutos, sin cambiar de modelo. El ahorro no viene del modelo, viene del flujo.
Empieza simple; sube complejidad solo si mejora el resultado de forma demostrable.
Paso a paso. redacta → revisa el tono → acorta
Etiqueta y trata distinto. factura · reunión · spam
Revisa su propio trabajo y lo mejora antes de dártelo.
El agente prepara. Tú apruebas. El patrón clave.
Nada de copiar y pegar en un chat: Codex trabajando dentro de mis sistemas reales.
Saca métricas de PostHog y propone qué cambiar, no solo qué pasó.
Sube contenido a Instagram y analiza el rendimiento con su propia API.
Digiere cualquier vídeo de YouTube y lo deja como notas que luego puedes buscar.
Lee el correo, prepara recordatorios y te organiza el día.
Abre pestañas, rellena formularios, navega sitios reales por ti.
Plans para tareas largas; MCP para enchufar cualquier herramienta que ya usas.
esto es lo que viene ahora: dos o tres de estos, en vivo, en esta pantalla
autorizas con OAuth · no entregas la contraseña · das permisos concretos
Cada conector expone una lista corta de acciones. Tú eliges cuáles activar.
Lee, ordena, resume, saca fechas y redacta borradores. Tú apruebas y envías. El humo está en prometer una bandeja que se gestiona sola.
6 correos · 2 urgentes · borradores listos para tu visto bueno.
2 h → 12 min
Leer y ordenar · resumir hilos largos · extraer fechas y acciones · redactar borradores. Texto sobre texto: lo hace bien.
Inventa datos con seguridad · encadenar muchos pasos degrada la fiabilidad.
99% por paso · 20 pasos → ya no tienes un sistema que funciona
El contexto ya está donde trabaja la empresa. Codex lo consulta con permisos.
Clasifica clientes, detecta urgencias, resume hilos y prepara próximos pasos.
No solo texto: deja trabajo revisable y trazable para que alguien apruebe.
Peligro real solo cuando se juntan las tres.
correos de desconocidos
tu bandeja entera
enviar en tu nombre
Las tres a la vez = no. Para el correo, quitas una: que no envíe solo.
“No conozco ni una sola empresa que no tenga un humano en el bucle.”
Un correo enviado es irreversible y va con tu nombre. Revisar cuesta 10 segundos.
Cinco líneas. Reutilizable para casi cualquier encargo.
Se trata de diseñar trabajo que la IA pueda ejecutar, comprobar y devolverte para que tú decidas.
Para no perderte: decide qué delegarle, descríbeselo bien, revisa con ojo crítico lo que te devuelve, y úsalo con responsabilidad. (Anthropic, AI Fluency)