Аннотация:
В условиях растущей конкуренции в области технологий искусственного интеллекта компания Apple, которая всегда была известна своей строгой защитой конфиденциальности, вносит стратегические коррективы в свою основную политику в отношении данных. Последние новости показывают, что Apple изменила свое предыдущее обязательство никогда не использовать личные данные клиентов для обучения общих моделей ИИ и начала изучать возможность использования анонимизированных или авторизованных данных о взаимодействии с пользователем в конкретных средах для ускорения обучения и оптимизации своих алгоритмов искусственного интеллекта и систем машинного обучения.

В течение долгого времени компания Apple всегда считала «приоритет на стороне устройства» и «нулевой сбор данных» своими основными преимуществами среди технологических гигантов, подчеркивая, что функции искусственного интеллекта, включая Apple Intelligence, в основном полагаются на вычислительную мощность локального чипа, а вычисления в частном облаке (Private Cloud Compute), включающие сложные вычисления, также обещают, что данные будут уничтожены после чтения, не будут сохранены и не будут использоваться для вторичного обучения. Однако, поскольку спрос на высококачественные данные реальных сцен взаимодействия для крупномасштабных языковых моделей и мультимодальных моделей резко возрастает, опора исключительно на общедоступное сканирование веб-страниц и коммерчески приобретенные наборы данных, защищенные авторским правом, постепенно показывает свои ограничения.
Согласно сообщениям инсайдеров цепочки поставок и экосистемы программного обеспечения, изменения Apple на этот раз представляют собой не переход к комплексному сбору чистых данных, а более контролируемый поэтапный механизм. Пользователи будут иметь четкое право знать и выбирать, и в будущем система может представить более сложные варианты подписки, позволяющие потребителям решать, следует ли анонимно делиться обезличенным текстовым вводом, журналами взаимодействия Siri или отзывами об использовании приложений, чтобы помочь улучшить качество модели. В то же время технология дифференциальной конфиденциальности и локальной генерации синтетических данных по-прежнему будет служить внешним барьером для предварительной обработки данных, предотвращая физическую связь любой конфиденциальной личной информации с весами модели.
Аналитики отмечают, что тонкая настройка Apple политики обучения данных отражает реальное давление, с которым компания сталкивается в конкурентной борьбе за возможности больших моделей. По сравнению с конкурентами, такими как OpenAI, Google и Meta, отсутствие полноценной обратной связи с пользовательским корпусом в реальном времени стало узким местом, которое нельзя игнорировать для развития последующих крупномасштабных моделей терминалов Apple, возможностей понимания контекста между приложениями и даже нового поколения Siri. Либерализуя некоторые регулируемые каналы обучения данным, Apple пытается обеспечить свою экосистему искусственного интеллекта ключевым топливом, необходимым для итерации алгоритма, придерживаясь при этом своего принципа «конфиденциальность прежде всего».
Комментарии