SCRAM AI Lab

Patrones reales de
Claude Code
para devs en producción

Hub editorial en español sobre Claude, Gemini, GPT y GLM — y el stack que de verdad usamos: MCPs, pgvector, multi-modelo routing, observability. Sin tutoriales 101. Solo patrones que aguantan en producción.

0

categorías

0+

herramientas

0+

artículos

scram_ai_lab — neural_engine

LIVE — SCRAM AI Engine

EU AI Act: enforcement GPAI vivo desde el 2 de agosto — multas de hasta 3% del revenue global//

Anthropic: watermarks invisibles en todos los outputs de Claude desde el 2 de agosto//

Claude Code self-hosted en beta pública: agentes corriendo en tu propia infraestructura//

Sonnet 5 sube a $3/$15 el 1 de septiembre — termina el precio promocional//

Kimi K3 (Moonshot): 1M de contexto y 88.3 en Terminal-Bench, el líder open-weight//

GLM-5.3 (Z.ai, 14 ago): post-training escalado sobre la base de GLM-5.2//

OpenAI Ultrafast mode: GPT-5.6 Sol hasta 14x más rápido (preview)//

Made by Google 2026: Gemini como agente autónomo que llama negocios por ti//

Gemini 3.6 Flash y 3.5 Flash-Lite ya son estables para producción//

DeepSeek V4-Flash (MIT): casi Opus 4.8 a $0.14/$0.28 por millón de tokens//

MCP, estándar de facto: OpenAI, Google y Mistral lo soportan//

EU AI Act: enforcement GPAI vivo desde el 2 de agosto — multas de hasta 3% del revenue global//

Anthropic: watermarks invisibles en todos los outputs de Claude desde el 2 de agosto//

Claude Code self-hosted en beta pública: agentes corriendo en tu propia infraestructura//

Sonnet 5 sube a $3/$15 el 1 de septiembre — termina el precio promocional//

Kimi K3 (Moonshot): 1M de contexto y 88.3 en Terminal-Bench, el líder open-weight//

GLM-5.3 (Z.ai, 14 ago): post-training escalado sobre la base de GLM-5.2//

OpenAI Ultrafast mode: GPT-5.6 Sol hasta 14x más rápido (preview)//

Made by Google 2026: Gemini como agente autónomo que llama negocios por ti//

Gemini 3.6 Flash y 3.5 Flash-Lite ya son estables para producción//

DeepSeek V4-Flash (MIT): casi Opus 4.8 a $0.14/$0.28 por millón de tokens//

MCP, estándar de facto: OpenAI, Google y Mistral lo soportan//

// edición #42 · 19 Ago 2026 · 8 min

Esta semana en IA

La IA entra en su era regulada: EU AI Act en vigor, watermarks y agentes que actúan

Esta semana: el enforcement del EU AI Act para modelos GPAI se activó el 2 de agosto —multas de hasta €15M o 3% del revenue global— y Anthropic respondió con watermarks invisibles en todos sus outputs. OpenAI previó Ultrafast mode (14x velocidad) para GPT-5.6 Sol, Google convirtió a Gemini en agente autónomo que llama negocios por ti, y la frontera abierta sumó a Kimi K3 y GLM-5.3. Agosto no va de modelos nuevos: va de operar IA bajo reglas reales.

  • EU AI Act (2 ago): la AI Office ya puede evaluar modelos GPAI y multar con €15M o 3% del revenue global

  • Anthropic: watermarks invisibles en todo output desde el 2 ago + Claude Code self-hosted en beta pública

  • OpenAI: Ultrafast mode en preview — GPT-5.6 Sol hasta 14x más rápido; o3 y DALL·E se retiran este mes

  • Made by Google (13 ago): Gemini como agente autónomo que llama a negocios y ordena por su cuenta

  • Open weight: Kimi K3 (1M ctx, 88.3 Terminal-Bench) lidera; Z.ai lanzó GLM-5.3 el 14 de agosto

// newsletter

Recibe “Esta semana en IA” en tu correo

El mismo criterio editorial del Lab: releases, papers y movimientos que sí cambian cómo construyes. Sin spam; cancela cuando quieras.

Todos

Últimos artículos

cargando artículos...

// Lo que estamos leyendo

Links curados, sin las cinco páginas de SEO antes del contenido

artificialintelligenceact.eu

Enforcement of Chapter V under the EU AI Act

La referencia canónica de lo que se activó el 2 de agosto: poderes de la AI Office, obligaciones GPAI y el calendario legacy hasta 2027. Si tu producto toca usuarios europeos, esto ya no es lectura opcional.

regulacion

artificiallawyer.com

Anthropic Will Embed Watermarks in AI Outputs

Todo output de Claude trae marcado invisible desde el 2 de agosto. La implicación sutil: si tu flujo republicaba contenido de IA como 'humano', ese supuesto acaba de romperse.

claude

pub.towardsai.net

The State of Open Coding AI Models in August 2026

El mejor mapa del momento open-weight: Kimi K3 como todo-terreno, GLM-5.2/5.3 para coding con MIT plana, DeepSeek V4-Flash como piso de costo. Con benchmarks y licencias lado a lado.

glm

claude.com

Introducing dynamic workflows in Claude Code

Claude escribe el script de orquestación y un runtime corre cientos de subagentes en background. El contexto solo guarda la respuesta final — ese es el truco.

agents

blog.google

Made by Google 2026: Gemini pasa de responder a actuar

Gemini llamando a negocios y ordenando por su cuenta es la señal: la carrera de asistentes ya se corre en tareas completadas de punta a punta, no en benchmarks de conversación.

gemini

modelcontextprotocol.io

MCP — adopción multi-vendor

OpenAI, Google y Mistral ya lo soportan. Si construyes MCPs hoy, son portables a cualquier cliente — incluido GLM. Esta es la decisión de arquitectura que sí importa.

mcp

// Categorías

Cinco frentes, una sola disciplina

Cubrimos exactamente lo que usamos en producción todos los días. Si no lo corremos sobre 94 contenedores en GCP, no entra al lab.

Claude Code & Agentes

Skills, MCPs, hooks, multiagent

  • Skill design + hooks que sustituyen 80% de validaciones
  • MCPs propios: cuándo construir vs adoptar
  • Multiagent orchestration y dreaming memory
  • Routines: workflows programados por evento o cron

Multi-modelo & Routing

Claude · Gemini · GPT · GLM en producción

  • Tier-based AI router (cost-aware fallback)
  • GLM-5.2 de Z.ai: cuándo un modelo open-weight de 1M gana
  • Defensa contra prompt injection — scoring
  • Circuit breaker + retry exponencial para LLMs

AI-Native SaaS

Next + Nest + Prisma + pgvector

  • pgvector para RAG en producción mexicana
  • NL-to-SQL con Prisma — patrón 2-pass
  • Lead scoring por factores ponderados sin ML pesado
  • AI nudges automáticos sobre datos del CRM
🇲🇽

Integraciones México

Bind ERP · GLPI · INEGI · SAT

  • Bind ERP como MCP server — caso AWALAB
  • INEGI BIE/DENUE para context grounding
  • Migración Mautic → CRM propio sin downtime
  • RPA REPSE/IMSS con Playwright undetected

Infra & Observability

Docker · Grafana · Loki · OTel

  • Soft limits en GCP — por qué nunca hard limits
  • Loki + Grafana para logs de chatbot
  • OpenTelemetry tracing para pipelines LLM
  • Traefik v2.10 con auto-renewal para 94 containers

// Novedades del ecosistema IA

Lo que se movió esta semana en IA — sin spam de marketing

Releases, papers y movimientos que sí importan para construir con IA en producción. Cuatro ecosistemas, mismo criterio editorial: si no cambia cómo armas tu stack mañana, no entra.

Releases de Claude Code, modelos y la plataforma Anthropic.

Watermarks

2 Ago 2026

Marcado invisible en todos los outputs de Claude

Todo producto Claude publicado desde el 2 de agosto incluye marcado legible por máquina en el contenido generado, en cumplimiento del Artículo 50(2) del EU AI Act. Invisible y sin afectar la calidad del output — la primera implementación a escala de un laboratorio frontera.

Claude Code

Ago 2026

Self-hosted en beta pública

Los planes Team y Enterprise ya pueden correr sesiones de Claude Code en su propia infraestructura: acceso a red interna, tooling custom y controles de compliance propios. Elimina el bloqueador número uno para agentes en entornos regulados.

Precios

31 Ago 2026

Sonnet 5 sube a $3/$15 el 1 de septiembre

El precio promocional de Sonnet 5 ($2/$10 por M tokens) termina el 31 de agosto; desde el 1 de septiembre rige el estándar de $3/$15. Un +50% que hay que presupuestar ya. Además: Claude for Government entró a beta este mes.

Opus 5

24 Jul 2026

Inteligencia casi Fable 5 a precio de Opus

Claude Opus 5 llegó el 24 de julio al mismo precio que Opus 4.8 ($5/$25 por M tokens). Queda a 0.5% del pico de Fable 5 en CursorBench a la mitad del costo y supera a Fable 5 en OSWorld a un tercio. Reordena el router: la frontera cotidiana migra de Fable 5 a Opus 5.

Modelo

1 Jul 2026

Claude Fable 5 redeploy global

Tras meses de acceso restringido por preocupaciones de ciberseguridad, Anthropic redeployó Fable 5 a nivel global con salvaguardas reforzadas. La generación 5 consolida el salto hacia modelos agénticos de mayor autonomía.

Frontera

Jun 2026

Claude Mythos: el modelo más potente de Anthropic

La familia Mythos representa un «step change» en capacidad según Anthropic — el modelo más capaz que han construido. Tras revisión regulatoria y una versión «safe», llegó a empresas seleccionadas.