← SCRAM AI Lab

Comunidad

Esta semana en IA #42: la IA entra en su era regulada

Edición #42 (19 ago 2026): el 2 de agosto se activó el enforcement del EU AI Act para modelos GPAI —multas de hasta €15M o 3% del revenue global— y Anthropic respondió con watermarks invisibles en todos sus outputs. OpenAI previó Ultrafast mode (14x velocidad) para GPT-5.6 Sol, Google convirtió a Gemini en agente autónomo que llama negocios por ti, y la frontera abierta sumó a Kimi K3 (1M de contexto) y GLM-5.3. Agosto no va de modelos nuevos: va de operar IA bajo reglas reales.

August 19, 2026

22 lecturas

Esta semana en IA #42: la IA entra en su era regulada

El titular de la semana

Agosto 2026 no se define por un modelo nuevo, sino por un cambio de régimen: el 2 de agosto se activó el enforcement del EU AI Act para proveedores de modelos de propósito general (GPAI). La AI Office de la Comisión Europea ya puede pedir documentación técnica, evaluar modelos, exigir mitigaciones de riesgo y multar con hasta €15 millones o 3% del revenue global anual — lo que sea mayor. Los grandes laboratorios reaccionaron en semanas, no en trimestres, y eso reordena decisiones de stack que parecían lejanas.

Regulación — el EU AI Act deja de ser teoría

  • Enforcement GPAI vivo desde el 2 de agosto: la AI Office abre con "diálogos técnicos de cumplimiento" antes de procedimientos formales, pero las multas ya son reales.
  • Transparencia obligatoria: cualquier chatbot, agente de voz o sistema interactivo desplegado en la UE debe declarar al inicio de la interacción que el usuario habla con una IA.
  • Ventana legacy: modelos publicados antes del 2 de agosto de 2025 tienen hasta el 2 de agosto de 2027 para cumplir en su totalidad.

Anthropic — watermarks, self-hosted y el fin del precio promocional

  • Watermarks invisibles (2 ago): todo producto Claude publicado desde esa fecha incluye marcado legible por máquina en el contenido generado, en cumplimiento del Artículo 50(2) del AI Act. No afecta calidad ni legibilidad del output.
  • Claude Code self-hosted (beta pública): equipos Team/Enterprise pueden correr sesiones en su propia infraestructura, con acceso a red interna, tooling propio y controles de compliance.
  • Claude for Government entró a beta en agosto.
  • Sonnet 5 sube de precio: el precio promocional de $2/$10 por millón de tokens termina el 31 de agosto; desde el 1 de septiembre rige el estándar de $3/$15. Si tu presupuesto asumía la promo, recalcula ya.

OpenAI — la velocidad como benchmark

  • GPT-5.6 Sol actualizado (6 ago) con un slider de esfuerzo para usuarios Plus/Pro: tú decides cuánto "piensa" cada respuesta.
  • Ultrafast mode en preview (13 y 18 ago): hasta 14x la velocidad de GPT-5.6 Sol. La latencia se vuelve eje de competencia tan importante como la inteligencia.
  • Limpieza de catálogo: o3 se retira de ChatGPT el 26 de agosto y el GPT oficial de DALL·E el 30 de agosto.

Google — Gemini pasa de responder a actuar

  • Made by Google 2026 (13 ago): Google demostró a Gemini como agente autónomo que llama a negocios y hace pedidos por su cuenta. El asistente deja de sugerir y empieza a ejecutar.
  • Gemini 3.6 Flash y 3.5 Flash-Lite ya son estables (production-ready): mejor eficiencia de tokens y planning agéntico a menor precio que 3.5 Flash.
  • Gemini Omni Flash: nuevo modelo de video que convierte crear y editar video en una conversación.

La frontera abierta — Kimi K3 y GLM-5.3

  • Kimi K3 (Moonshot, 27 jul): 2.8T de parámetros totales (104B activos), 1M de contexto y 88.3 en Terminal-Bench 2.1 — el líder open-weight todo-terreno de agosto. Licencia tipo MIT con gate comercial arriba de $20M de revenue model-as-a-service.
  • GLM-5.3 (Z.ai, 14 ago): misma base que GLM-5.2 con post-training escalado. GLM-5.2 sigue siendo el modelo más fuerte bajo licencia MIT plana.
  • DeepSeek V4-Flash (MIT): a 2.3 puntos de Claude Opus 4.8 en Terminal-Bench 2.1, con precios de $0.14/$0.28 por millón de tokens y 1M de contexto. El piso de costo de la industria.

La conclusión para quien construye

Tres acciones concretas salen de esta edición: (1) si tu producto toca usuarios en la UE, audita hoy la transparencia de tus chatbots y la trazabilidad de tus outputs — el régimen sancionador ya opera; (2) si dependes del precio promocional de Sonnet 5, recalcula tu presupuesto antes del 1 de septiembre; y (3) si tu carga es de alto volumen, mide la frontera abierta: entre Kimi K3, GLM-5.3 y DeepSeek V4-Flash, el costo por token de capacidad casi-frontera nunca había sido tan bajo.

digest
eu-ai-act
anthropic
openai
google
open-weight
kimi-k3
glm

Artículos relacionados

Así construimos los chatbots de SCRAM: 4 agentes, un solo cerebro

Radiografía técnica de nuestro propio stack: el bot de ventas del sitio, los dos agentes de soporte y el agente de WhatsApp con voz corren sobre un mismo módulo NestJS con identidades intercambiables, RAG sobre pgvector, herramientas que leen el ERP vivo y un juez LLM que califica cada conversación. Cómo lo construimos, qué reglas nos costaron aprender y por qué creemos que es un ejemplo de cómo se integra IA correctamente desde Latinoamérica.

El EU AI Act ya se aplica: multas de 3% y qué hacer si tu chatbot toca Europa

Desde el 2 de agosto de 2026 la AI Office europea tiene poderes plenos de enforcement sobre modelos GPAI: documentación técnica, evaluaciones, mitigación de riesgo y multas de hasta €15M o 3% del revenue global. Anthropic ya respondió con watermarks invisibles en todos sus outputs. Guía práctica de qué cambia para quien opera chatbots, agentes o APIs de IA que tocan usuarios europeos — incluso desde LatAm.

Esta semana en IA #41: Claude Opus 5, Gemini 3.6 Flash y la batalla del tier de volumen

Edición #41 (24 jul 2026): Anthropic lanzó Claude Opus 5 —casi Fable 5 (la frontera) a la mitad o un tercio del costo, al precio de Opus 4.8— el mismo día que Google sacó Gemini 3.6 Flash como workhorse multimodal. OpenAI liberó GPT-5.6 Sol y retiró GPT-4.5, y la frontera abierta suma a Kimi K2.7, DeepSeek V4 Pro y MiniMax M3. Patrón de julio: la batalla no es por el modelo más potente, sino por el mejor costo/capacidad del tier de volumen.

← Volver a SCRAM AI Lab