

¡Buenas! Esta semana la IA se ha vuelto loca. Vamos con la edición especial.
En los últimos siete días, los dos gigantes del sector han sacado sus modelos flagship. Anthropic lanzó Claude Fable 5.1 el 1 de septiembre. Dos días después, OpenAI lanzó GPT-6 Astra y Greg Brockman llegó a decir que "no es descabellado sentir que estamos en la era AGI".
Ha corrido mucho ruido. Mucha comparativa de "cuál ganó". Mucho tweet triunfalista. Y mucha simplificación.
Nosotros, que llevamos meses recomendando Claude como opción principal, teníamos que meternos a estudiar los dos lanzamientos en serio antes de cambiar de discurso o de reafirmarnos. Hoy te contamos honestamente qué ha pasado, qué cambia y qué no cambia, y sobre todo: qué hacer con esto según cómo uses tú la IA.
Sin flame. Sin bandos. Con datos verificados.
Vamos.
🚀 Lo que trae GPT-6 Astra (y donde realmente destaca)
Astra es el modelo más caro que OpenAI ha lanzado. Y viene con dos titulares que sí son reales:
1. Salto brutal en "computer use"
Esto es lo que más importa. Computer use significa que el modelo controla tu ordenador de verdad: abre aplicaciones, navega por webs, rellena formularios, hace clic en botones, mueve archivos. Todo lo que puede hacer un humano con teclado y ratón.
En el benchmark OSWorld 2.0, que mide exactamente esto, Astra saca 72.6%, frente al 65.7% de GPT-5.6 Sol. Y además hace las tareas en la mitad de tiempo. Es la primera vez que un modelo de OpenAI está por delante en esta métrica.

Traducido a tu día a día: si tu trabajo consiste en tareas de escritorio repetitivas (procesar archivos, mover cosas entre apps, gestionar formularios, hacer tareas administrativas), este es el modelo que las va a hacer mejor y más rápido.
2. Récords en matemáticas y ciberseguridad
Astra satura el benchmark FrontierMath Tier 4 (97.6%) y ExploitBench (100%). Son pruebas de razonamiento matemático muy avanzado y de ciberseguridad ofensiva. Impresionante técnicamente, pero para el 99% de nosotros no cambia nada. Salvo que trabajes en investigación matemática o seguridad, esto es más de portada de prensa que de utilidad diaria.
Lo que no es tan claro como parece
Se ha dicho mucho que Astra es "el doble de barato y el doble de rápido" que Fable 5.1. Los datos verificados matizan bastante ese titular: los dos modelos cuestan exactamente lo mismo ($10 por millón de tokens de entrada, $50 por millón de salida). Astra sí es más rápido en algunas tareas concretas, pero no el doble en general.
Y algo más importante: en el Artificial Analysis Intelligence Index, que agrega inteligencia general, Astra saca 61.2 puntos frente a 60.9 del anterior GPT-5.6 Sol. Es una mejora mínima. Y en ese mismo índice, Claude Fable 5.1 y Claude Opus 5 están por delante de Astra. Lo dice la tabla oficial de OpenAI.
Hola, soy Ramón! Hasta ahora, cuando montábamos algo con IA en Barner o en Digital Brain, lo contábamos aquí los miércoles, entre newsletters de noticias.
A partir de ahora eso se muda a una newsletter 100% de implementación: los sistemas que montamos de verdad en empresas de verdad, lo que nos costó, lo que se rompió por el camino y los números. Sale los miércoles y los domingos.
Digital Brain sigue igual, con las noticias cada día, los tutoriales, los prompts y las herramientas. Lo único que cambia es dónde vive la parte de implementación, en ramonperez.ai
La primera ya está publicada. Va de cuándo merece la pena enseñarle una tarea a Claude para no volver a explicársela, y empieza con unas facturas que en Barner nadie leía línea a línea: las de los transportistas. Hoy las lee una skill, y con ella hemos reclamado 26.933 € a uno de ellos. Cierra con lo que he montado esta semana encima de eso: la cuenta de resultados real por país.
Cada edición termina así, con lo que estoy construyendo esa semana y cómo.
⚡ Lo que trae Claude Fable 5.1 (y donde realmente destaca)
Anthropic no ha sacado un titular "AGI" ni ha hecho campaña épica. Pero lo que ha lanzado es más sólido de lo que parece:
1. Salto real en trabajo agéntico de largo plazo
En Terminal-Bench-Science 0.1 (benchmark de investigación científica agéntica), Fable 5.1 saca 52.6% frente al 24.7% de Fable 5. Más del doble. Traducido: para tareas que requieren razonar durante horas, mantener contexto largo y no perderse, Fable 5.1 es notablemente mejor.

Si usas Claude para análisis profundos, investigación, síntesis de documentos largos o proyectos que se alargan durante días, este salto sí lo vas a notar.
2. Reducción brutal en costes reales
Aquí está el movimiento silencioso que muchos han pasado por alto. Los precios base de Fable 5.1 no bajan ($10/$50 por millón), pero el precio de las lecturas caché baja un 75%: de $1 a $0.25 por millón de tokens.
En cristiano: cuando trabajas con archivos largos, contextos que se repiten o agentes que llevan horas trabajando, pagas entre un 25% y un 45% menos que antes. Es el mayor recorte de precios efectivo del año en el sector.
3. Cambios importantes bajo el capó
Fable 5.1 puede trabajar autónomamente durante mucho más tiempo sin desviarse del objetivo. También lee mejor imágenes densas (gráficos, tablas dentro de PDFs). Y viene con una ventana de contexto de 1 millón de tokens, igual que Astra.
🎯 La comparativa honesta (sin "ganador")
Vale, tenemos los dos modelos. Vamos a mirar cuál es mejor para cada tipo de trabajo, que es lo que importa:
Para tareas de escritorio (mover archivos, rellenar formularios, gestionar apps):
→ GPT-6 Astra gana. Es un salto real y palpable.
Para escritura, análisis y síntesis:
→ Claude Fable 5.1 gana. Sigue por delante en el índice de inteligencia general y su escritura es notablemente más limpia y menos "estilo IA".
Para trabajo agéntico de horas o días:
→ Empate técnico, con ventaja para Fable 5.1 por precio (cache) y por Terminal-Bench-Science. Astra gana en velocidad puntual.
Para código:
→ Ambos son excelentes, con matices distintos. Meta's Muse Spark 1.3 supera a los dos en algunos benchmarks de agentic coding. La diferencia real depende de tu stack.
Para investigación matemática o ciberseguridad ofensiva:
→ Astra gana claramente, pero probablemente no es tu caso.
Para el trabajo diario del 90% de la gente:
→ Sigue siendo casi indistinguible. Los dos modelos son excepcionales. La diferencia práctica en tu escritura, tus emails, tus presentaciones o tus análisis es marginal.
💡 Nuestra recomendación (con criterio)
Basado en todo lo verificado, esto es lo que haríamos según tu caso:
Si ya usas Claude y estás contento: no cambies. La mejora de Fable 5.1 es notable y no tienes ninguna razón real para migrar. El ecosistema (Cowork, Skills, Projects) que has construido sigue funcionando y sigue siendo top.
Si trabajas con muchas tareas de escritorio automatizables: merece la pena probar Astra en paralelo. Coge una tarea repetitiva que hagas cada semana (procesar facturas, ordenar carpetas, extraer datos de webs) y prueba a montarla en Astra. Si te ahorra tiempo real, quédatelo para esa tarea concreta.
Si eres nuevo y estás decidiendo por dónde empezar: cualquiera de los dos te va a servir. Prueba una semana con cada uno. La diferencia práctica la vas a notar más por el ecosistema (interfaz, integraciones, cómo funcionan las skills) que por el modelo en sí.
Si tu equipo ya está entrenado en uno: quedaos ahí. El coste real de cambiar de herramienta en un equipo es enorme, y la mejora del otro modelo no lo compensa. Adoptar bien la que tenéis es más importante que cazar el modelo del mes.
⚠️ Ojo con esto
Cuatro cosas para tener presentes:
No hay AGI todavía. El discurso de "era AGI" de Brockman es marketing. Astra es un modelo mejor que su antecesor en tareas concretas. AGI sigue siendo un horizonte, no una realidad de esta semana. No dejes que los titulares te condicionen decisiones que se toman por criterio.
Todos los benchmarks son cocinados. OpenAI publica los suyos, Anthropic los suyos, y cada uno enseña donde brilla. Los benchmarks independientes (como Artificial Analysis) suelen contar historias diferentes. No tomes decisiones importantes basadas en un solo gráfico.
La ventaja de "computer use" tiene letra pequeña. Astra brilla en OSWorld, pero controlar tu ordenador desde una IA implica riesgos reales de seguridad y privacidad. Antes de darle acceso a tus apps críticas, entiende qué le estás dejando ver. Ya escribimos sobre esto en la edición de seguridad.
En 3 meses hay otro modelo. El ritmo actual de lanzamientos hace inútil obsesionarse con "el mejor de ahora mismo". Elige la herramienta que te encaja y que sabes exprimir, y actualiza tu criterio cada 6-12 meses. No cada semana.
🗳️ ¿Vas a probar Astra?
Cuéntanos. Si acabas comparando los dos en una tarea real, mándanos qué has visto y lo comentamos.
Te contamos la próxima novedad de Claude el miércoles que viene 😎
Edu, Rai y Albert. El equipo humano detrás de Digital Brain.





