Sonnet 5.5 se escapó y la prueba real aplastó al GPT-6 Sol y estuvo cerca de Astra

📅 2026-09-28

Resumen:

¿Quién hubiera pensado que apenas unos días después del lanzamiento de Opus 5.5, también llegaría Sonnet 5.5? Desde anoche, la noticia ha estado circulando por todo X: Sonnet 5.5 se lanzará pronto, quizás el martes por la tarde, hora de EE. UU. En términos de rendimiento, Sonnet 5.5 está más cerca del Opus 5.5, pero es mucho más barato que el Opus 5.5. Ahora, Sonnet 5.5 ha entrado en la etapa final antes del lanzamiento y se han iniciado las pruebas en escala de grises en Claude Code.

Las demostraciones expuestas por muchos probadores beta internos muestran que Sonnet 5.5 aplasta al GPT-6 Sol recién lanzado e incluso se acerca al GPT-6 Astra insignia de OpenAI en términos de codificación y capacidades de agente.

Lo que es aún más impactante es que su precio va directo al centro de la tierra, tan solo 2 dólares por un millón de entradas simbólicas.

Si la fecha de lanzamiento filtrada es cierta, parece que Anthropic está decidido a atacar al Dev Dayl de OpenAI.

Sonnet 5.5 filtrado, ha aparecido un identificador de modelo exclusivo

Todavía recuerdo que cuando Anthriopic lanzó repentinamente Opus 5.5 el 22 de septiembre, escribieron en el documento oficial: "Sonnet 5.5 y Haiku 5.5 se lanzarán en las próximas semanas".

¡Nadie pensó que Sonnet 5.5 llegaría tan pronto!

Ayer mismo, el desarrollador V @Mr_Salio dio la noticia sobre X: ¡Claude Sonnet 5.5 fue capturado! La noticia se difundió instantáneamente por Internet.

En el artefacto ha aparecido el identificador de configuración del modelo exclusivo de Sonnet 5.5: "claude-sonnet-5-5".

No sólo eso, también están "claude-opus-5-5", "claude-sonnet-5" y el misterioso "claude-fable-5.1" uno al lado del otro en el mismo archivo de configuración.

La escritura del código de interfaz significa que el modelo se ha instalado en el servidor y solo está esperando un cambio.

Posteriormente, el gran V @notjazii también dio la noticia de que Sonnet 5 había sido encaminado silenciosamente a la versión 5.5 para "pruebas secretas" hace aproximadamente una semana.

¿Te ha detectado la escala de grises? Esta vez usaré el método antiguo.

Abra su Claude Code, apague las funciones de red y memoria y pregúntele directamente: ¿Conoce el reinicio del hermano tibo? No utilices Internet ni la memoria.

Si está utilizando una versión anterior del modelo, es posible que esté farfullando; pero si ha sido redirigido a la versión 5.5, le explicará con precisión los entresijos de los chistes de reinicio de Tibo y Codex.

Varios internautas han verificado a través de pruebas reales que algunas cuentas efectivamente han sido cambiadas silenciosamente y están experimentando Opus 5.5 por adelantado.

Recuerda usar Claude Code

La prueba real en toda la red es tan baja que en realidad supera a GPT-6

Para resumir las mediciones reales compartidas hasta ahora, ¿Sonnet 5.5 realmente aplastó a GPT-6 Sol?

En primer lugar, es un enfrentamiento extremo de animación y UI front-end JS puro, con cuatro modelos grandes convencionales compitiendo en el mismo escenario.

El desarrollador @notjazii lanzó un conjunto de pruebas reales visualmente impactantes: "Comparación de cuatro modelos convencionales con generación rápida de animaciones de palabras".

Requiere que el modelo genere efectos de animación de interfaz de usuario complejos.

Después de publicar la comparación animada, @notjazii comentó: "¡Sonnet 5.5 realmente dejó a ambos modelos OpenAI (Sol y Astra) en el suelo!"

De hecho, como se puede ver en la imagen siguiente, Sonnet 5.5 muestra una fuerte intuición de codificación y gusto estético.

GPT-6 Astra

GPT-6 Sol

Claude Opus 5.5

Soneto de Claude 5.5

Algunos internautas se quedaron incrédulos después de ver los resultados: "Claude siempre ha sido más fuerte en la interfaz de usuario y la animación, pero si esto se generara con código puro, ¡sería increíble que fuera cierto!"

Big V @chetaslua se centró en probar la capacidad de codificación diaria y la sensación de codificación de Sonnet 5.5.

Utilizó las mismas 3 palabras clave y realizó 6 ejecuciones paralelas, generó cada modelo una vez y los resultados no se modificaron.

Sonnet 5.5 finalmente generó 3 archivos de 90 a 131 KB, alcanzando el límite superior de 90 minutos en todas las ejecuciones; GPT-6 Sol generó archivos de entre 20 y 29 KB y tardó entre 9 y 12 minutos.

Dijo emocionado: "¡Ahora usa Claude Code! Sonnet 5.5 en modo Ultracode es ridículamente rápido. ¡No sólo es extremadamente eficiente, sino que también ha recuperado el "toque humano" extremadamente natural de la era Sonnet 4!"

En su opinión, al mismo precio y con las mismas palabras, Sonnet 5.5 ha aplastado a GPT-6 Sol.

Lo que incluso asusta a OpenAI es que Sonnet 5.5 ya no es tan simple como aplastar GPT-6 Sol.

El denunciante @srikanthvaluri y @buildwithrajath señalaron después de exhaustivas pruebas reales iniciales: "El rendimiento de Sonnet 5.5 superó con creces las expectativas. Aunque el GPT-6 Astra todavía tiene una ligera ventaja en el pulido, el rendimiento de Sonnet 5.5 está directamente a la par con el de Astra".

Increíblemente, también está cerca de Astra en algunas capacidades avanzadas de codificación y agentes.

Algunas personas lamentan que incluso Sonnet haya aplastado a Astra. ¿En qué era estamos entrando?

Precio carnicero, rey de la rentabilidad

Si superar el rendimiento medido sólo hace que OpenAI se sienta "incómodo", entonces el precio expuesto por Sonnet 5.5 está profundizando en las raíces de OpenAI.

Se revela que este "modelo mágico", cuyo rendimiento se acerca al de Astra y supera al Sol, tiene un precio totalmente acorde con el mercado de gama baja.

Entrada: 2 $/millón de token

Salida: 10 $/millón de token

Lecturas en caché: ¡solo $0,20/millón de tokens!

Esto significa que Anthropic proporciona capacidades de inteligencia artificial de vanguardia a un "precio de repollo".

GPT-6 Sol y Luna de OpenAI cuestan la mitad del precio de GPT-5.6 y tienen como objetivo aprovechar escenarios de alta frecuencia.

Pero ahora, Anthropic ha entrado en el mismo rango de precios con Sonnet 5.5, pero su rendimiento es mucho más potente.

"Si Anthropic puede ofrecer un gran salto de rendimiento como Opus 5.5 a un precio tan competitivo, OpenAI no podrá contraatacar". Alguien comentó.

El desarrollador Rajath Gowda dijo sin rodeos: "Sonnet 5.5 se está convirtiendo en un gran problema para OpenAI. Si está realmente cerca de Opus 5.5, Anthropic hará que las capacidades de vanguardia sean extremadamente baratas. Esto es lo que más debería preocupar a OpenAI".

La intención estratégica de Anthropic es clara: utilizar Opus 5.5 para mantener el trono de la gama alta y utilizar Sonnet 5.5 para dominar por completo el mercado de desarrollo diario y de gama media con la máxima rentabilidad.

Anthropic abre su cara y mata a DevDay

Además, el momento del lanzamiento suele ser más dramático que el producto en sí.

El mismo día que OpenAI lanzó GPT-6 Sol y Luna, Anthropic eliminó directamente Claude Opus 5.5: mejor rendimiento que la generación anterior, 40% menos costo y 30% más rápido.

En las últimas dos semanas, Anthropic ha logrado resultados aún más brillantes: Claude calculó la amplitud de los nueve círculos de la física y batió el récord mundial; descubrió un sistema enzimático biológico desconocido; y también lanzó Claude Marketplace, que contiene más de 2000 complementos.

Por el contrario, OpenAI recientemente no solo ha tenido controversias internas sobre los modelos, sino que también ha expuesto incidentes de desalineación, como la filtración de imágenes de usuarios por parte de la IA y la exposición de trampas de tokens de GitHub por parte de investigadores.

El próximo martes (29 de septiembre) será el DevDay, la conferencia anual de desarrolladores a la que OpenAI concede gran importancia.

En este momento, la prueba gris de Sonnet 5.5 barrió toda la red.

Muchos grandes se volvieron locos: "Se espera que el modelo se lance la próxima semana, supongo que será el próximo martes (DevDay), todo el mundo lo sabe".

Tal vez mañana habrá un calentamiento importante a las 2 pm, hora de Nueva York.

Alguien dijo: "Me siento mal por OpenAI. Será mejor que respondan con firmeza en el DevDay o estarán realmente jodidos".

Las tecnologías clave detrás de Sonnet 5.5

La razón por la que la nueva versión se lanza tan rápido puede ser que Anthropic ya ha descubierto el proceso de RL/post-entrenamiento.

La clave de todo son los datos de alta calidad.

Cuando se le preguntó cómo Anthropic es capaz de iterar tan rápidamente, el líder de la industria @yacineMTB especuló que el núcleo es un volante de datos de muy alto estándar.

"Pero todavía estoy en shock, ¿cómo lo hicieron?"

Anthropic ha logrado un "ciclo cerrado interno" de desarrollo de modelos grandes y está utilizando IA para crear IA.

Según la última exposición de datos cuantitativos internos, Anthropic ha girado el "volante de datos" a una velocidad que asusta a sus oponentes:

El 26 % del trabajo principal de I+D ha sido liderado por IA (modelo Claude de generación anterior).

Más del 80% del código de producción propia lo escribe el gran modelo de forma independiente.

Esto no es tan simple como "reducción de costos y mejora de la eficiencia", técnicamente significa que

la automejora recursiva (RSI) está comenzando a aparecer

.

Anthropic estima que Claude podría estar completamente autoautomatizado ya en 2027, y para entonces la velocidad de iteración puede ser aún más loca.

Los dos héroes de ASI están en duelo y Google también está listo para tomar medidas. Nosotros, los usuarios comunes, podemos simplemente sentarnos y esperar la batalla.

Big V Token Gremlin dijo esto: "El círculo de IA la próxima semana tendrá escenas que nunca antes habíamos visto. Libere su tiempo, despeje su agenda, esté mentalmente preparado y guarde el flujo de trabajo más difícil para más adelante. Créame, lo que viene cambiará por completo su forma de trabajar".

La aparición de Sonnet 5.5 marca la llegada oficial de la "era de la IA asequible y de alta calidad".

Por dos dólares estadounidenses, puedes comprar "Baicai Infrastructure" con un millón de Tokens.

La lectura de caché de costo extremadamente bajo ($0,20/M) permite a todos crear fácilmente un asistente personal de IA con memoria de contexto ultralarga.

¿Estás listo? Si la noticia es cierta, tendremos un nuevo modelo listo para circular en menos de 24 horas.

Materiales de referencia:

https://x.com/notjazii/status/2103884749202993411

https://x.com/notjazii/status/2103884167104831573

https://x.com/chetaslua/status/2104153687077904613

https://x.com/chetaslua/status/2104259190432903599

https://x.com/Mr_Salio/status/2104210803545030792

https://x.com/Mr_Salio/status/2104178854633849145/

Etiquetas relacionadas

Artículos relacionados

Comentarios

0/500
Captcha (click to refresh)
Sin comentarios