xAI lanza Grok 4.7: especializados en programación y trabajo del conocimiento, el precio se reduce a la mitad que los productos de la competencia

📅 2026-09-22

Resumen:

xAI, la empresa de inteligencia artificial de Musk, lanzó oficialmente Grok 4.7, una nueva generación de modelos de gran tamaño, y lo posicionó como el modelo de trabajo de programación y conocimiento más potente del momento. La empresa afirmó que el nuevo modelo no sólo mejora las capacidades de procesamiento de tareas complejas, sino que también mantiene la misma velocidad de operación y sistema de precios que los productos de la generación anterior, y compite en el mercado a un menor costo.

image.png

Según la información publicada por xAI, Grok 4.7 adopta un nuevo modelo básico a mayor escala y realiza una optimización del aprendizaje por refuerzo más prolongada durante el proceso de capacitación. En comparación con versiones anteriores, el nuevo modelo está expuesto a tareas de capacitación más complejas, con una gran cantidad de tareas diseñadas para durar varias horas en completarse. Esto permite que el modelo logre mejoras significativas en el razonamiento a largo plazo, la autoverificación y la gestión de tareas complejas.

xAI dijo que uno de los mayores cambios en Grok 4.7 es su mayor "capacidad de autoprueba". Los modelos pueden verificar de manera más proactiva su propia producción al responder preguntas, escribir código y realizar tareas de conocimiento complejas, reduciendo así las tasas de error y mejorando la confiabilidad de los resultados finales.

Al mismo tiempo, también se ha mejorado la capacidad del nuevo modelo para manejar contextos extremadamente largos. Cuando se enfrenta a documentos grandes, múltiples rondas de tareas y trabajos de proyectos de larga duración, Grok 4.7 puede mantener capacidades de gestión de información más estables sin una degradación evidente del rendimiento a medida que el contexto crece, como ocurre con algunos modelos tradicionales.

Para mejorar aún más la experiencia laboral real, xAI también entrena especialmente a Grok 4.7 para que comprenda de forma nativa el marco operativo de Grok Bot. Esto significa que no solo es adecuado para escenarios de preguntas y respuestas de una sola vez, sino que también es más adecuado para participar en flujos de trabajo como un agente inteligente de larga duración. La compañía cree que esto mejorará el rendimiento del modelo en el trabajo de conocimiento general, las conversaciones en curso y las tareas de nivel empresarial.

Además de las capacidades de programación, Grok 4.7 también está dotado de capacidades más sólidas de creación de documentos y presentaciones. Los funcionarios afirmaron que el modelo ahora es más capaz de generar informes profesionales, documentos comerciales y materiales de presentación, y esperan ampliar aún más su alcance de aplicación en el campo de la automatización de oficinas.

En términos de rendimiento, xAI anunció una serie de resultados de pruebas internas.

En la prueba CursorBench 4.0, que se utiliza para evaluar las capacidades de ingeniería de software a largo plazo, Grok 4.7 logró una puntuación del 46,3%, que mejoró significativamente en comparación con el 40,4% de Grok 4.6. En la prueba de ingeniería de software de DeepSWE, el nuevo modelo logró una puntuación del 71%, manteniendo un nivel competitivo cercano a los productos líderes de la industria.

En la prueba EEBench en el campo de la ingeniería electrónica, Grok 4.7 logró una puntuación del 64%, un aumento de más de diez puntos porcentuales en comparación con la generación anterior. Para tareas de oficina que implican una gran cantidad de conocimientos profesionales y flujos de trabajo complejos, el rendimiento del modelo en la prueba AA Briefcase también mejoró.

En términos de análisis legal, Grok 4.7 obtuvo una puntuación del 19,6% en la prueba Harvey Legal Agent Benchmark, lo que supone una mejora adicional en comparación con el producto de la generación anterior. En el campo del razonamiento médico, las puntuaciones de HealthBench Professional también mejoraron del 48,5% al ​​56,7%.

En el ámbito del trabajo de conocimientos generales, xAI destacó especialmente los dos resultados de evaluación de GDPval y AA Briefcase. La compañía considera que estas pruebas se acercan más al contenido laboral real de profesionales como abogados, enfermeras y analistas financieros, y Grok 4.7 ha alcanzado el nivel competitivo de los modelos de vanguardia actuales en estos escenarios.

image.png

image.png

image.png

El precio es otro punto de venta importante de esta versión.

image.png

Según datos oficiales, el precio de entrada de Grok 4.7 se mantiene en 2 dólares estadounidenses por millón de tokens, y el precio de salida es de 6 dólares estadounidenses por millón de tokens, en consonancia con Grok 4.6. En comparación con algunos modelos de vanguardia que a menudo cuestan varias veces o incluso diez veces más, xAI enfatiza que Grok 4.7 puede completar tareas de un nivel similar a un costo menor.

La empresa incluso lo describe como una solución que "ofrece un rendimiento competitivo a aproximadamente la mitad del precio de los modelos del mismo nivel", con la esperanza de ampliar aún más la cuota de mercado con la ventaja de costes.

En términos de seguridad, xAI dijo que Grok 4.7 adopta un sistema de protección de seguridad recientemente reconstruido. Según los resultados de las pruebas internas, el nuevo modelo ha alcanzado el mejor nivel de la serie Grok en términos de rechazar solicitudes peligrosas, resistir ataques de jailbreak e identificar contenido de alto riesgo.

Particularmente en áreas sensibles como la ciberseguridad y la bioseguridad, los modelos están diseñados para ayudar a abordar tareas defensivas legítimas al mismo tiempo que niegan usos peligrosos o maliciosos. Los datos oficiales muestran que Grok 4.7 logró un rendimiento líder en algunas pruebas de riesgo de seguridad de red y evaluaciones de bioseguridad.

Actualmente, Grok 4.7 ha estado abierto a los usuarios a través de API y la plataforma Grok. Los desarrolladores pueden denominar este modelo para programación, preguntas y respuestas sobre conocimientos, redacción de documentos y desarrollo de aplicaciones de agentes inteligentes.

Con el lanzamiento oficial de Grok 4.7, xAI ha acelerado aún más el ritmo de iteración del producto. Desde el lanzamiento de Grok 4.5 en julio de este año, hasta el lanzamiento de Grok 4.6 en agosto y ahora Grok 4.7, xAI ha completado tres actualizaciones importantes en menos de tres meses. Para el ferozmente competitivo mercado de la inteligencia artificial, Grok 4.7 no es solo una actualización periódica, sino que también muestra la intención estratégica de xAI de desafiar a los líderes de la industria a través de iteraciones más rápidas, precios más bajos y capacidades de trabajo más sólidas.

Etiquetas relacionadas

Artículos relacionados

Comentarios

0/500
Captcha (click to refresh)
Sin comentarios