AI Tech News
By H.O.

Claude Sonnet 5 y la Actualización de Verano: Qué se Lanza Esta Semana

Claude Sonnet 5 y la Actualización de Verano: Qué se Lanza Esta Semana

El Ciclo de Lanzamientos Ha Cambiado

Claude Sonnet 5 de Anthropic, lanzado el 30 de junio de 2026 , marca el lanzamiento de modelo fronterizo más significativo del inicio del verano. Pero no está solo. Los últimos 10 días han visto Claude Sonnet 5 de Anthropic como el modelo fronterizo más nuevo rastreado con fecha de lanzamiento del 30 de junio de 2026 , además de los tres niveles de GPT-5.6—Sol (insignia), Terra (equilibrado) y Luna (rápido, asequible)—presentados en vista previa el 26 de junio de 2026 , y Grok 4.5 revelado en beta privada el 28 de junio sin fecha de lanzamiento público aún . Esto importa porque el período de verano solía ser tranquilo para anuncios de IA, con laboratorios guardando grandes revelaciones para conferencias de otoño y eventos de fin de año, pero ese patrón ha desaparecido .

La lógica comercial es directa: con cientos de ciclos de adquisición empresarial funcionando en cronogramas trimestrales, los laboratorios que lanzan en julio capturan presupuesto de Q3 . Lo que esto significa para los equipos técnicos es que las decisiones tomadas ahora moldean el gasto de infraestructura de Q3.

Claude Sonnet 5: La Función Que Realmente Usas Diariamente

Esto es lo que se lanzó: Lanzado el 30 de junio, Claude Sonnet 5 es el Sonnet más agéntico de Anthropic hasta ahora y ahora es el modelo predeterminado en los planes gratuito y Pro de Claude . La métrica crítica para trabajo con código: en codificación agéntica obtiene un 63,2% en SWE-Bench Pro, arriba del 58,1% de Sonnet 4.6 y acercándose fuerte al 69,2% de Opus 4.8, y en trabajo de conocimiento en realidad supera a Opus 4.8 .

La historia de la ventana de contexto importa. Se envía con una ventana de contexto nativa de 1 millón de tokens como estándar . Eso no es una nota al pie—cambia lo que puedes hacer sin ingeniería de prompts. Los probadores describen consistentemente el mismo comportamiento: completa tareas complejas de múltiples pasos en las que los Sonnets anteriores se atascaban, y verifica su propia salida sin que se le pida .

El precio es donde las cosas se ponen interesantes. El precio introductorio de la API es de $2/$10 por millón de tokens hasta el 31 de agosto de 2026, aumentando a $3/$15 después de eso . Para equipos empresariales que evalúan Claude versus competidores por tarea, eso importa. Salta aproximadamente 223 puntos Elo GDPval-AA sobre Sonnet 4.6 (que mantenía 1.643) para liderar el punto de referencia de escritura profesional de Artificial Analysis por delante de Opus 4.8 y GPT-5.5 .

GPT-5.6: Disponible Solo Si Estás en la Lista de Acceso

GPT-5.6 es la familia de modelos de próxima generación de OpenAI, presentada en vista previa el 26 de junio de 2026: Sol es la insignia, Terra es el modelo equilibrado del día a día, y Luna es el nivel rápido y asequible. Por ahora probablemente no puedas usarlo—es el primer lanzamiento fronterizo estadounidense protegido detrás del acceso gubernamental, disponible solo a través de la API de OpenAI y Codex para aproximadamente 20 organizaciones de confianza después de que OpenAI compartiera los modelos y planes de lanzamiento con el gobierno estadounidense .

Lo que es diferente aquí: esto no es una beta cerrada para probadores. Está protegido detrás del acceso gubernamental, disponible solo para aproximadamente 20 organizaciones de confianza después de que OpenAI compartiera modelos y planes de lanzamiento con el gobierno estadounidense, con disponibilidad general planeada para "las próximas semanas", y Sol lanzándose en Cerebras a hasta 750 tokens por segundo en julio . Cuando abra, el precio anunciado es Sol $5 / $30, Terra $2.50 / $15, y Luna $1 / $6 por millón de tokens .

La función a observar: Sol establece un nuevo SOTA en Terminal-Bench 2.1, Terra proporciona rendimiento competitivo con GPT-5.5 a un costo 2x menor, Luna es el más rápido y más barato . Para equipos no en la lista de acceso, GPT-5.5 sigue siendo la insignia de envío de OpenAI .

El Patrón Más Amplio: La Compresión de Costos Gana

En todos los lanzamientos, la compresión de costos se está acelerando, con casi todos los laboratorios principales enviando una opción de inferencia más asequible este mes, y los ratios de precio-rendimiento para modelos de nivel superior se han triplicado aproximadamente en comparación con hace doce meses . El rendimiento agéntico es el campo de batalla principal, con laboratorios compitiendo más duro en uso de herramientas de múltiples pasos, gestión de memoria y confiabilidad de planificación, reflejando dónde se concentra la demanda empresarial—en sistemas de IA que pueden completar flujos de trabajo de múltiples pasos sin intervención humana constante .

Modelo Fecha de Lanzamiento Métrica Clave Precio de API (Entrada/Salida) Estado
Claude Sonnet 5 30 de junio de 2026 63,2% SWE-Bench Pro; contexto de 1M tokens $2/$10 (intro); $3/$15 después del 31 de ago Disponible generalmente
GPT-5.6 Sol/Terra/Luna 26 de junio de 2026 (vista previa) Sol: nuevo SOTA Terminal-Bench; Terra: reducción de costo 2x Sol: $5/$30; Terra: $2.50/$15; Luna: $1/$6 Acceso limitado (~20 orgs)
Grok 4.5 28 de junio de 2026 (beta privada) 1,5 billones de parámetros; fundación V9 Aún no público Solo beta privada
Gemini 3.5 Pro Julio de 2026 (esperado) Sucesor de Gemini 3.1 Pro Por Determinar Disponibilidad general programada

Qué Significa Esto para Tu Equipo Ahora Mismo

Tres acciones, clasificadas por impacto:

  • Si usas Claude en APIs de producción: El precio introductorio de Claude Sonnet 5 es de $2/$10 hasta el 31 de agosto de 2026, aumentando a $3/$15 después de eso . Si tu carga de trabajo encaja en la especificación de Sonnet (tareas agénticas, razonamiento de contexto largo, escritura), fija una línea base de costo antes del aumento. El salto de $2 a $3 por millón de tokens de entrada se escala rápidamente en volumen.
  • Si estás evaluando flujos de trabajo de múltiples pasos: Los laboratorios compiten más duro en uso de herramientas de múltiples pasos, gestión de memoria y confiabilidad de planificación . La mejora de Sonnet 5 en autocorrección (verificar su propio trabajo) y finalización de tareas sostenida es medible. Pruébalo contra tu modelo actual en 10 tareas representativas.
  • Si estás esperando GPT-5.6: Aún no estás en la lista de acceso. Construye sobre GPT-5.5 o Claude Sonnet 5 hoy; no mantengas capacidad de cómputo esperando un lanzamiento limitado. Cuando llega la disponibilidad general (esperada dentro de semanas), puedes evaluar el costo de migración versus el beneficio con datos de volumen real.

El ciclo de lanzamientos es ahora mensual en la frontera. Lo que se lanzó esta semana será obsoleto en agosto. Pero el cambio subyacente—costo cayendo más rápido que ganancias de capacidad—significa que tus decisiones de infraestructura son cada vez más flexibles, no menos. Construye para la tarea, no para la marca. Compara en volumen real. Asegura las victorias ahora, antes de que los precios se reinicien nuevamente.

Nuestros datos rastreados

Índice de Inteligencia IA (3 Modelos Frontera)

01632476305-1706-0106-0807-0607-1307-2007-2708-0308-1008-17Claude Opus 4.7 (Adaptive Reasoning, Max Effort) — Anthropic: 57 (2026-05-17)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-06-01)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-06-08)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 56 (2026-07-06)Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) — Anthropic: 60 (2026-07-13)Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) — Anthropic: 59.9 (2026-07-20)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-07-27)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-08-03)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 63 (2026-08-10)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 63 (2026-08-17)63GPT-5.5 (xhigh) — OpenAI: 60 (2026-05-17)GPT-5.5 (xhigh) — OpenAI: 60 (2026-06-01)GPT-5.5 (xhigh) — OpenAI: 60 (2026-06-08)GPT-5.5 (xhigh) — OpenAI: 55 (2026-07-06)GPT-5.6 Sol (max) — OpenAI: 59 (2026-07-13)GPT-5.6 Sol (max) — OpenAI: 58.9 (2026-07-20)GPT-5.6 Sol (max) — OpenAI: 59 (2026-07-27)GPT-5.6 Sol (max) — OpenAI: 59 (2026-08-03)GPT-5.6 Sol (max) — OpenAI: 61 (2026-08-10)GPT-5.6 Sol (max) — OpenAI: 61 (2026-08-17)61Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-05-17)Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-06-01)Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-06-08)Gemini 3.1 Pro Preview — Google DeepMind: 46 (2026-07-06)Gemini 3.5 Flash (high) — Google DeepMind: 55 (2026-07-13)Gemini 3.1 Pro Preview — Google DeepMind: 46 (2026-07-20)Gemini 3.6 Flash (high) — Google DeepMind: 50 (2026-07-27)Gemini 3.6 Flash (high) — Google DeepMind: 50 (2026-08-03)Gemini 3.6 Flash (high) — Google DeepMind: 52 (2026-08-10)Gemini 3.7 Flash (high) — Google DeepMind: 56 (2026-08-17)56
  • Anthropic
  • OpenAI
  • Google DeepMind

Intelligence Index — Trend

Pase el cursor sobre cada punto para ver la versión específica del modelo en esa fecha.

Última actualización: 2026-08-17 · 10 puntos de datos · artificialanalysis.ai

Recopilados semanalmente por nuestro equipo editorial desde fuentes primarias.

Ver el conjunto de datos completo