Hoy, Alibaba Tongyi Qianwen anunció el lanzamiento de un nuevo modelo más pequeño——Qwen3-4B-Instruct-2507 y Qwen3-4B-Thinking-2507.En la actualidad, el nuevo modelo se ha abierto oficialmente en Magic Community y HuggingFace. Según los informes,En el campo de la no inferencia, Qwen3-4B-Instruct-2507 supera ampliamente al GPT4.1-Nano de código cerrado.
En el campo del razonamiento, el Qwen3-4B-Thinking-2507 es incluso comparable al Qwen3-30B-A3B (pensamiento) de tamaño mediano.
Los funcionarios afirmaron que la versión 2507 del modelo Qwen3-4B es particularmente amigable para la implementación de hardware final, como teléfonos móviles.

Los siguientes son los aspectos más destacados del modelo.
Qwen3-4B-Instrucción-2507
Las capacidades generales se han mejorado enormemente, superando el modelo comercial de código cerrado de tamaño pequeño GPT-4.1-nano y acercándose al rendimiento del Qwen3-30B-A3B de tamaño mediano (no pensante).
El nuevo modelo cubre conocimientos de cola larga en más idiomas, mejora la alineación de las preferencias humanas en tareas subjetivas y abiertas y puede proporcionar respuestas que estén más en línea con las necesidades de las personas.
La comprensión contextual se extiende a 256 KB y los modelos pequeños también pueden manejar textos largos.
Qwen3-4B-Pensando-2507
La capacidad de razonamiento se ha mejorado enormemente, con una puntuación de AIME25 de hasta 81,3. El rendimiento de razonamiento del Qwen3-4B-Thinking-2507 es comparable al del modelo de gama media Qwen3-30B-Thinking.
Especialmente en la evaluación AIME25, que se centra en la capacidad matemática, obtuvo 81,3 puntos con parámetros 4B.
Las puntuaciones de los agentes están fuera de serie y todas las revisiones relevantes superan el modelo más amplio Qwen3-30B-Thinking.
La capacidad de comprensión contextual de los tokens de 256.000 admite análisis de documentos más complejos, generación de contenido de formato largo, razonamiento entre párrafos y otros escenarios.


