xAI выпускает Grok 4.7: специализируясь на программировании и научной работе, цена снижена вдвое по сравнению с конкурирующими продуктами

📅 2026-09-22

Аннотация:

xAI, компания Маска, занимающаяся искусственным интеллектом, официально выпустила Grok 4.7, новое поколение больших моделей, и позиционировала ее как самую мощную на сегодняшний день модель программирования и работы с знаниями. Компания заявила, что новая модель не только улучшает возможности обработки сложных задач, но также сохраняет ту же скорость работы и систему цен, что и продукты предыдущего поколения, и конкурирует на рынке с более низкой стоимостью.

image.png

Согласно информации, опубликованной xAI, Grok 4.7 использует новую более масштабную базовую модель и выполняет более длительную оптимизацию обучения с подкреплением во время процесса обучения. По сравнению с предыдущими версиями, новая модель подвергается более сложным обучающим задачам с большим количеством задач, выполнение которых рассчитано на несколько часов. Это позволяет модели добиться значительных улучшений в долгосрочном рассуждении, самопроверке и управлении сложными задачами.

В xAI заявили, что одним из самых больших изменений в Grok 4.7 стала более мощная «возможность самотестирования». Модели могут более активно проверять свои выходные данные при ответе на вопросы, написании кода и выполнении сложных интеллектуальных задач, тем самым снижая количество ошибок и повышая надежность конечных результатов.

В то же время улучшена способность новой модели обрабатывать чрезвычайно длинные контексты. При работе с большими документами, несколькими циклами задач и длительной проектной работой Grok 4.7 может поддерживать более стабильные возможности управления информацией без очевидного снижения производительности по мере роста контекста, как в некоторых традиционных моделях.

Чтобы еще больше улучшить качество работы, xAI также специально обучает Grok 4.7 изначальному пониманию операционной среды Grok Bot. Это означает, что он подходит не только для одноразовых сценариев вопросов и ответов, но также больше подходит для участия в рабочих процессах в качестве долговременного интеллектуального агента. Компания считает, что это улучшит производительность модели в общей информационной работе, текущих беседах и задачах уровня предприятия.

Помимо возможностей программирования, Grok 4.7 также обладает более мощными возможностями создания документов и презентаций. Официальные лица заявили, что модель теперь лучше способна генерировать профессиональные отчеты, деловые документы и презентационные материалы, и надеются на дальнейшее расширение сферы ее применения в области автоматизации делопроизводства.

Что касается производительности, xAI объявила результаты серии внутренних тестов.

В тесте CursorBench 4.0, который используется для оценки долгосрочных возможностей разработки программного обеспечения, Grok 4.7 набрал 46,3 %, что значительно лучше по сравнению с 40,4 % у Grok 4.6. В тесте разработки программного обеспечения DeepSWE новая модель набрала 71%, продолжая поддерживать конкурентоспособный уровень, близкий к ведущим продуктам отрасли.

В тесте EEBench в области электронной техники Grok 4.7 набрал 64 %, что более чем на десять процентных пунктов больше, чем у предыдущего поколения. Для офисных задач, требующих большого объема профессиональных знаний и сложных рабочих процессов, производительность модели в тесте AA Briefcase также улучшилась.

Что касается юридического анализа, Grok 4.7 набрал 19,6 % в тесте Harvey Legal Agent Benchmark, что является дальнейшим улучшением по сравнению с продуктом предыдущего поколения. В области медицинских рассуждений показатели HealthBench Professional также улучшились с 48,5% до 56,7%.

В области общеобразовательной работы xAI особо подчеркнула два результата оценки GDPval и AA Briefcase. Компания считает, что эти тесты ближе к реальному содержанию работы таких специалистов, как юристы, медсестры и финансовые аналитики, а Grok 4.7 достиг конкурентоспособного уровня текущих передовых моделей в этих сценариях.

image.png

image.png

image.png

Цена — еще один важный аргумент в пользу этой версии.

image.png

Согласно официальным данным, входная цена Grok 4.7 остается на уровне 2 долларов США за миллион токенов, а выходная цена составляет 6 долларов США за миллион токенов, что соответствует Grok 4.6. По сравнению с некоторыми передовыми моделями, которые зачастую стоят в несколько, а то и в десять раз дороже, в xAI подчеркивают, что Grok 4.7 может выполнять задачи аналогичного уровня с меньшими затратами.

Компания даже описывает это как решение, которое «обеспечивает конкурентоспособную производительность примерно за половину цены моделей того же уровня», надеясь на дальнейшее расширение доли рынка с меньшими затратами.

Что касается безопасности, xAI сообщила, что Grok 4.7 использует недавно переработанную систему защиты. По результатам внутреннего тестирования новая модель достигла лучшего уровня серии Grok по отклонению опасных запросов, сопротивлению джейлбрейк-атакам и выявлению контента высокого риска.

Особенно в таких деликатных областях, как кибербезопасность и биобезопасность, модели предназначены для решения законных защитных задач, одновременно препятствуя опасному или злонамеренному использованию. Официальные данные показывают, что Grok 4.7 показал лучшие результаты в некоторых тестах на риски сетевой безопасности и оценках биобезопасности.

В настоящее время Grok 4.7 открыт для пользователей через API и платформу Grok. Разработчики могут использовать эту модель для программирования, вопросов и ответов, написания документов и разработки приложений интеллектуальных агентов.

С официальным выпуском Grok 4.7 компания xAI еще больше ускорила темпы разработки продукта. С момента выпуска Grok 4.5 в июле этого года до запуска Grok 4.6 в августе, а теперь и Grok 4.7, компания xAI выполнила три крупных обновления менее чем за три месяца. Для жестко конкурентного рынка искусственного интеллекта Grok 4.7 является не только регулярным обновлением, но и демонстрирует стратегическое намерение xAI бросить вызов лидерам отрасли за счет более быстрых итераций, более низких цен и более мощных рабочих возможностей.

Связанные теги

Похожие статьи

Комментарии

0/500
Captcha (click to refresh)
Нет комментариев