← SCRAM AI Lab
Edición #44: GPT-6 Astra ya tiene precio, Anthropic documentó campañas de destilación, Copilot suma a Grok y Gemini 3.8 Flash duplica su precio en enero de 2027.
September 15, 2026
45 lecturas

En el digest #43 escribimos que OpenAI no había publicado el precio de GPT-6 Astra. Ya lo publicó, y cambia la conversación: Astra cuesta lo mismo que Claude Fable 5.1 por token, $10 de entrada y $50 de salida por millón, pero su caché es cuatro veces más cara. Para quien corre agentes que releen el mismo contexto todo el día, esa diferencia pesa más que cualquier benchmark. La otra noticia que conviene leer despacio es el reporte de amenazas de Anthropic del 10 de septiembre, porque pone números a algo que hasta ahora era rumor: laboratorios que entrenan sus modelos con las respuestas de otros.
GPT-6 Astra cuesta $10 por millón de tokens de entrada, $1 en caché y $50 de salida; arriba de 272,000 tokens de contexto sube a $20/$75. En modo Batch o Flex baja a la mitad. Así queda frente a los otros modelos que usan las empresas con las que trabajamos, según las páginas oficiales de OpenAI, Anthropic y Google:
| Modelo | Entrada (USD/M) | Caché (USD/M) | Salida (USD/M) | Nota |
|---|---|---|---|---|
| GPT-6 Astra | $10 | $1 | $50 | $20/$75 arriba de 272K tokens |
| Claude Fable 5.1 | $10 | $0.25 | $50 | Caché 75% más barata que Fable 5 |
| GPT-5.6 Sol | $4 | — | $20 | Sigue siendo el caballo de trabajo de OpenAI |
| Gemini 3.8 Flash | $0.75 | — | $3.75 | Precio de introducción; $1.50/$7.50 desde el 1 de enero de 2027 |
Dos datos más de la semana de OpenAI: Astra ya está disponible de forma general en Amazon Bedrock desde el 8 de septiembre, con el compromiso de no entrenar con los datos de inferencia, y el 10 de septiembre salió en beta pública su Agents API, con sesiones durables y soporte de servidores MCP. El modelo más caro de OpenAI ya se contrata en las tres nubes grandes.
El reporte de septiembre cubre de diciembre de 2025 a agosto de 2026 y siete tipos de daño. Tres cifras para dimensionarlo: el grupo Midnight Blizzard robó más de 300,000 registros de identidad de un gobierno del norte de África; ShinyHunters escaneó 1.8 millones de aplicaciones Android buscando credenciales escritas dentro del código; y una red de influencia publicó 8,913 artículos en unos 70 sitios falsos.
La sección que más circuló es la de destilación. Según TechCrunch, Anthropic atribuye a Alibaba unas 3,500 cuentas y 151 millones de intercambios entre mayo y julio, y a Moonshot unas 300,000 solicitudes en diez días; en total, cerca de 200 millones de intercambios en cinco campañas. No pudimos leer esa sección en la fuente original, así que las cifras van atribuidas a la prensa. Nuestra lectura: si vas a elegir un modelo abierto para tu empresa, la licencia ya no es lo único que hay que revisar.
Desde el 12 de septiembre, Grok de xAI se puede activar en Word, Excel y PowerPoint dentro del programa Frontier, apagado por defecto y fuera de la Unión Europea y Reino Unido, reporta Big Hat Group. Con eso Copilot convive con modelos de OpenAI, Anthropic y xAI. La misma fuente reporta que los conectores federados basados en MCP llegaron a disponibilidad general: consultan sistemas externos con la identidad del usuario vía OAuth, sin copiar los datos a Microsoft. No encontramos todavía la nota oficial de Microsoft; lo tratamos como dato de segunda mano.
Cuatro versiones en cinco días, según el changelog oficial:
allowedMcpServers ahora gobierna solo los servidores que agrega el usuario; WebFetch con límite de 300 segundos.claude plugin eval para calificar plugins de forma reproducible, /output-style y el resultado de Bash muestra el diff de los archivos que cambió.--accept-command con hash al instalar plugins.En la plataforma de Claude, los Managed Agents recibieron el 10 de septiembre una política de permisos auto: el servidor evalúa cada llamada a herramienta y decide si la ejecuta, la niega o pausa para pedir aprobación (notas de versión). Le dedicamos el artículo de esta semana, porque es exactamente el problema que resolvimos a mano en nuestro propio sistema.
Seguimos sin ley general de inteligencia artificial. La agenda del Senado hasta el 15 de diciembre incluye tipificar el contenido íntimo generado con IA sin consentimiento, y el 17 de septiembre se celebra en Guerrero el último foro presidencial sobre IA, redes y menores, del que saldrá una iniciativa. El dato que más nos dice sobre dónde estamos es de la Secretaría de Economía con el Censo Económico 2024 del INEGI: solo 4.8% de las manufactureras de más de diez empleados usa IA, contra 19.1% en la OCDE.
| Fecha | Qué pasa |
|---|---|
| 17 sep | Foro de IA en Guerrero, último antes de la iniciativa |
| 23-24 sep | Meta Connect |
| 29 sep | OpenAI DevDay en San Francisco |
| 30 sep | Google apaga gemini-omni-flash-preview |
| 1 oct | OpenAI retira gpt-5.4-cyber |
| Octubre | Siri AI en español |
Si hoy usas Gemini Flash para volumen, presupuesta 2027 con el precio doble desde ahora; nadie quiere descubrirlo en la factura de enero. Si estás comparando Astra contra Fable 5.1, no te quedes con el precio de lista: mide cuánto de tu tráfico es caché, porque ahí está la diferencia de cuatro veces. Y si alguien en tu empresa propone un modelo abierto porque "es gratis", pide que te enseñe la licencia completa y dónde se procesan los datos.
Artículos relacionados
Sistema Vivo en producción: el MCP de SCRAM con Claude, ChatGPT y lo que aprendimos en la primera semana
Desde el 6 de septiembre de 2026 nuestro ERP, CRM y mesa de soporte se pueden operar desde Claude y ChatGPT a través de un servidor MCP propio con 27 herramientas. La llave identifica a una persona y no da permisos; toda escritura pasa por dos turnos. Arquitectura, cuatro trampas silenciosas y qué clientes sí lo hablan.
Esta semana en IA #43: Fable 5.1, GPT-6 Astra y el fin de Google Assistant
Edición #43 (10 sep 2026): Anthropic lanzó Claude Fable 5.1 y Mythos 5.1 con cache 75% más barato, OpenAI presentó GPT-6 Astra bajo escrutinio de seguridad, Google empezó a apagar Assistant y Salesforce se casó con Claude. Qué cambia para quien construye.
Así construimos los chatbots de SCRAM: 4 agentes, un solo cerebro
Conoce la arquitectura técnica de SCRAM AI Lab: 4 chatbots unificados en NestJS, RAG en pgvector, herramientas ERP en tiempo real y resiliencia en producción.