Сегодня Alibaba Tongyi Qianwen объявила о выпуске новой модели меньшего размера ——Qwen3-4B-Инструкт-2507 и Qwen3-4B-Мышление-2507.В настоящее время новая модель официально открыта в сообществах Magic и HuggingFace. По сообщениям,В области отсутствия вывода Qwen3-4B-Instruct-2507 полностью превосходит GPT4.1-Nano с закрытым исходным кодом.

В области рассуждений Qwen3-4B-Thinking-2507 даже сравним со средним Qwen3-30B-A3B (мышлением).

Официальные лица заявили, что версия 2507 модели Qwen3-4B особенно удобна для использования конечного оборудования, такого как мобильные телефоны.

Ниже приведены основные особенности модели.

Qwen3-4B-Инструкт-2507

Общие возможности были значительно улучшены, превзойдя коммерческую малогабаритную модель GPT-4.1-nano с закрытым исходным кодом и приблизившись к производительности среднего Qwen3-30B-A3B (недумая).

Новая модель охватывает обширные знания на большем количестве языков, улучшает согласованность человеческих предпочтений при выполнении субъективных и открытых задач и может предоставлять ответы, которые в большей степени соответствуют потребностям людей.

Контекстное понимание простирается до 256 КБ, а небольшие модели также могут обрабатывать длинные тексты.

Qwen3-4B-Мышление-2507

Способность к рассуждению значительно улучшилась: оценка AIME25 достигла 81,3. Производительность рассуждения Qwen3-4B-Thinking-2507 сравнима с моделью среднего класса Qwen3-30B-Thinking.

Особенно в тесте AIME25, посвященном математическим способностям, он набрал 81,3 балла с параметрами 4B.

Оценки агентов зашкаливают, и все соответствующие обзоры превосходят более широкую модель мышления Qwen3-30B.

Способность контекстного понимания токенов 256K поддерживает более сложный анализ документов, генерацию длинного контента, рассуждения между абзацами и другие сценарии.