Аннотация:
Организация Объединенных Наций недавно объявила о сотрудничестве с Google, планируя сделать огромную глобальную систему статистических данных более доступной и пригодной для использования системами искусственного интеллекта. Цель этого сотрудничества — не только помочь пользователям-людям более удобно получать данные, но и создать надежную инфраструктуру данных для наступающей эпохи агентов ИИ.

Новая платформа, запущенная на этот раз, называется «Общие данные системы ООН». Система построена на технологии Data Commons с открытым исходным кодом Google, которая позволяет пользователям напрямую запрашивать статистическую информацию из нескольких учреждений Организации Объединенных Наций на естественном языке без необходимости искать и фильтровать данные слой за слоем в традиционных интерфейсах баз данных, как это было раньше.
Новая платформа заменит существующий портал UNData. По сравнению со старой системой, которая в основном полагалась на поиск по ключевым словам и просмотр баз данных, новая платформа более адаптируема к инструментам искусственного интеллекта и средам взаимодействия на естественном языке. В будущем пользователи смогут напрямую искать данные о глобальном развитии, народонаселении, образовании, здравоохранении, экономике и других областях, задавая ежедневные вопросы.
Что еще более важно, система поддерживает протокол контекста модели (MCP), который в настоящее время широко используется в области искусственного интеллекта. Этот технический стандарт позволяет моделям искусственного интеллекта напрямую подключаться к внешним источникам данных, позволяя агентам ИИ напрямую обращаться к официальной статистике Организации Объединенных Наций при выполнении задач анализа, исследований и запросов, а не полагаться на нестабильные или непроверенные источники информации.
Важная причина, по которой Организация Объединенных Наций продвигает этот проект, заключается в том, что все больше и больше исследований показывают, что нынешние основные модели искусственного интеллекта по-прежнему имеют очевидные проблемы при обработке авторитетных статистических данных.
Недавнее тестирование, проведенное ЮНИСЕФ, показало, что большие языковые модели от нескольких компаний, включая OpenAI, Anthropic и Google, не показали удовлетворительных результатов при ответе на вопросы, связанные с показателями глобального развития. Тест охватил более 133 000 образцов ответов, а средняя точность шести основных моделей большого языка составила всего 21,2%.
Исследователи обнаружили, что около 60 % ответов не содержат даже подходящих цифр. Многие модели склонны избегать расплывчатых ответов, и даже когда они могут предоставить числовые результаты, ответы, которые они дают, часто меняются, когда одни и те же вопросы задаются повторно в разное время.
В тесте участвуют модели GPT-4o, GPT-4o-mini, Claude Sonnet 4.5, Claude Haiku 4.5, Gemini 2.5 Flash и Gemini 2.0 Flash. Исследовательская группа считает, что эта ситуация отражает серьезные проблемы с надежностью, с которыми все еще сталкиваются нынешние системы искусственного интеллекта при вызове данных о глобальном развитии.
В то же время ЮНИСЕФ наблюдает и еще одну важную тенденцию: все больше пользователей получают доступ к статистике с помощью инструментов искусственного интеллекта, а не традиционных поисковых систем.
Данные показывают, что с начала этого года количество посещений веб-сайта данных ЮНИСЕФ с помощью инструментов искусственного интеллекта, таких как ChatGPT, увеличилось на 67 % по сравнению с предыдущим годом. В настоящее время посещения помощников по искусственному интеллекту составляют около одной десятой общего трафика сайта. Для платформы данных, которую посещают более 6 миллионов человек в месяц, это изменение показывает, что способы получения информации пользователями быстро меняются.
В этом контексте Организация Объединенных Наций осознает, что просто публиковать данные уже недостаточно. Если мы надеемся, что будущие системы искусственного интеллекта смогут точно ссылаться на авторитетные статистические данные, мы должны заранее сделать эти данные машиночитаемыми, доступными для ИИ и вызываемыми интеллектуальными агентами.
В настоящее время 26 учреждений Организации Объединенных Наций обязались присоединиться к этой новой платформе, и данные почти 20 из них стали доступны для использования, когда система выйдет в онлайн. Ожидается, что в будущем, благодаря доступу большего числа учреждений, платформа объединит крупномасштабные официальные статистические ресурсы в рамках системы Организации Объединенных Наций, охватывающие различные области, такие как экономика, общество, окружающая среда, образование, здравоохранение и устойчивое развитие.
Организация Объединенных Наций заявила, что надеется, что благодаря этому плану глобальные исследователи, политики, предприятия и широкая общественность получат доступ к более надежной базе данных, гарантируя при этом, что в будущем все больше и больше систем, которые полагаются на ИИ для анализа и принятия решений, смогут основываться на авторитетных фактах, а не на нестабильных или ошибочных источниках информации.
Поскольку искусственный интеллект постепенно становится важным порталом для людей, позволяющим получать знания и запрашивать информацию, сотрудничество Организации Объединенных Наций с Google также рассматривается как первая важная попытка международной организации систематически создавать официальную инфраструктуру данных для «эпохи агентов ИИ».
Комментарии