Сегодня Alibaba Tongyi Qianwen объявила о выпуске новой модели меньшего размера ——Qwen3-4B-Инструкт-2507 и Qwen3-4B-Мышление-2507.В настоящее время новая модель официально открыта в сообществах Magic и HuggingFace. По сообщениям,В области отсутствия вывода Qwen3-4B-Instruct-2507 полностью превосходит GPT4.1-Nano с закрытым исходным кодом.
В области рассуждений Qwen3-4B-Thinking-2507 даже сравним со средним Qwen3-30B-A3B (мышлением).
Официальные лица заявили, что версия 2507 модели Qwen3-4B особенно удобна для использования конечного оборудования, такого как мобильные телефоны.

Ниже приведены основные особенности модели.
Qwen3-4B-Инструкт-2507
Общие возможности были значительно улучшены, превзойдя коммерческую малогабаритную модель GPT-4.1-nano с закрытым исходным кодом и приблизившись к производительности среднего Qwen3-30B-A3B (недумая).
Новая модель охватывает обширные знания на большем количестве языков, улучшает согласованность человеческих предпочтений при выполнении субъективных и открытых задач и может предоставлять ответы, которые в большей степени соответствуют потребностям людей.
Контекстное понимание простирается до 256 КБ, а небольшие модели также могут обрабатывать длинные тексты.
Qwen3-4B-Мышление-2507
Способность к рассуждению значительно улучшилась: оценка AIME25 достигла 81,3. Производительность рассуждения Qwen3-4B-Thinking-2507 сравнима с моделью среднего класса Qwen3-30B-Thinking.
Особенно в тесте AIME25, посвященном математическим способностям, он набрал 81,3 балла с параметрами 4B.
Оценки агентов зашкаливают, и все соответствующие обзоры превосходят более широкую модель мышления Qwen3-30B.
Способность контекстного понимания токенов 256K поддерживает более сложный анализ документов, генерацию длинного контента, рассуждения между абзацами и другие сценарии.


