La IA ya deja huella.
Diez capítulos para entender qué cambió esta semana: primero la
noticia que afecta a todos; después los modelos, los agentes y la
infraestructura que cambia cómo trabajamos.
Mira y explora.
Revisa la edición completa y salta a los momentos que sostienen cada aprendizaje. El Aula conserva una sola reproducción y una lista vertical para leer antes de elegir.
Un solo reproductor. Cada momento cambia el segundo de inicio y actualiza una URL compartible con ?momento={segundos}#video. Abrir el replay en YouTube.
Noticia principal · verificado
El contenido de IA empieza a llevar pasaporte.
Anthropic explica cómo sus modelos nuevos o futuros pueden
incorporar señales legibles por máquinas y metadatos de
procedencia. Europa, además, ya exige transparencia en escenarios
definidos.
pero editar, traducir o acortar puede debilitarla. Ausencia de
señal no equivale a autoría humana.
Contenido original generado
SEÑAL PRESENTE
La señal está diseñada para la salida original. Su presencia
aporta procedencia; su ausencia no prueba origen humano.
Lanzamiento · declaración de empresa
Grok 4.6 quiere trabajar, no sólo responder.
xAI posiciona el modelo para tareas prolongadas de agentes y
creación visual interactiva. El anuncio importa menos por una
puntuación aislada que por la combinación de capacidad, precio y
disponibilidad.
correcciones, tiempo total y costo por resultado; no una demo de
cinco minutos.
Agentes: xAI destaca tareas prolongadas. La
evaluación útil necesita un objetivo, herramientas reales y un
criterio de salida verificable.
Lanzamiento · Google
Gemini 3.7 Flash convierte rapidez en producto.
Google presenta una variante enfocada en automatización rápida y
desarrollo web, con precio introductorio publicado. “Flash” no
significa que gane siempre: significa que latencia y costo son
parte central de la propuesta.
iteraciones económicas; valida precisión antes de escalar volumen.
Las barras visualizan el posicionamiento declarado; no son un
benchmark normalizado entre proveedores.
Código + contexto largo
GLM y Kimi ensanchan el frente abierto.
Z.ai empuja GLM-5.3 hacia ingeniería de software; Moonshot
posiciona Kimi K3 como modelo abierto multimodal de contexto
largo. La noticia también es cuánto control conserva quien
construye.
inmediato o portabilidad, despliegue propio y control del dato?
*“Hasta 1M” en evaluaciones no confirma el límite comercial
general de GLM.
Laboratorio interactivo · cifras no normalizadas
No existe un ganador universal.
Elige una variable. La tabla destaca el modelo con el dato más
útil dentro de esa lente, sin mezclar benchmarks incompatibles en
una puntuación inventada.
salida del grupo. Planes, caché y variantes pueden cambiar el
costo real.
| Modelo | Precio API / 1M | Contexto | Velocidad publicada | Evidencia declarada | Mejor encaje |
|---|---|---|---|---|---|
| Grok 4.6xAI | $2 / $6 | N/D | N/D estándar | AA Index 61 | Agentes largos + visual |
| Gemini 3.7 FlashGoogle | $0,75 / $3,75 | N/D en anuncio | N/D | WebDev Arena 1588 | Automatización rápida |
| GLM-5.3Z.ai | N/D comparable | Hasta 1M* | 115 TPS citado | DeepSWE 66,9 | Ingeniería de software |
| Kimi K3Moonshot | $3 / $15 | 1M | 40 TPS citado | Modelo abierto | Multimodal + control |
| GPT-5.6 SolOpenAI | $5 / $30 | 1,05M | Hasta 750 TPS | Razonamiento premium | Baja latencia |
Precios sin impuestos y sujetos a modalidad. Las cifras provienen
de páginas oficiales; “inteligencia” agrupa evaluaciones
diferentes.
Economía de agentes · verificado
El agente descubre, autoriza y paga.
AWS publicó una arquitectura para que agentes accedan a servicios
pagados con AgentCore Payments y x402. La novedad relevante es que
una acción económica entra al flujo autónomo.
presupuesto, aprobación de excepciones, revocación y recibos
auditables.
Arquitectura de referencia; no autoriza pagos sin política humana
y controles explícitos.
Seguridad · investigación
El navegador también es un campo adversario.
OpenAI plantea “la ventana del defensor”: usar IA para acortar
detección y respuesta, mientras se limita el daño con privilegio
mínimo, modo lectura y decisiones humanas de alto impacto.
privilegio por defecto y mejor observabilidad.
“Resume este documento y continúa con el flujo.”
credenciales.
✓ Aislar contenido externo
✓ Comenzar en modo
lectura
✓ Pedir aprobación antes de enviar
✓
Bloquear secretos
✓ Registrar acciones
Experiencia de agentes · GitHub
El trabajo sale del chat y entra al tablero.
GitHub propone superficies tipo canvas para reunir contexto,
herramientas, resultados y decisiones. El objetivo: que el trabajo
agéntico sea visible, dirigible y revisable.
canvas sirve para entender el sistema que está trabajando.
Infraestructura · acceso selecto
La velocidad también se diseña debajo del modelo.
OpenAI muestra GPT-5.6 Sol sobre Cerebras con una cifra de hasta
750 tokens por segundo. El dato no describe todos los accesos,
pero evidencia cómo el hardware especializado cambia la
experiencia.
inicial y tiempo total de tarea son métricas distintas.
Síntesis · aplicación
Cuatro decisiones para cerrar la semana.
La utilidad del radar aparece cuando una noticia cambia una
política, una prueba o una compra. Este mapa convierte titulares
en próximos pasos concretos.
decisión y justificar qué evidencia necesitaría antes de actuar.
límites.
salida.
irreversibles.
que sostiene la experiencia.