DALL·E3 приближается! Он не только появится, но и будет интегрирован в ChatGPT.Другими словами, помимо банальных разговоров, написания кода и решения математических задач,ChatGPT, в который интегрирована новейшая версия DALL·E3, на этот раз наконец-то получила функцию изображения.
ChatGPT+DALL·E, эта волна представляет собой сильный альянс. Один из них — некоронованный король в большой языковой модели, а другой — также лидер в модели графа Винсента. Реальный эффект неизбежно будет 1+1>2.
Считается, что это внезапное официальное объявление заполнило большую дыру в мультимодальном ChatGPT, о которой широко ходили слухи после выхода GPT-4 в начале этого года.
Однако OpenAI сообщила об этой новости только сейчас.Конкретное время запуска — октябрь. Для пользователей Plus и Enterprise Edition этой осенью также будет выпущен отдельный DALL·E3.
Насколько мощна эта штука? Хотя мы пока не можем начать, судя по примерам, опубликованным OpenAI, это все еще довольно взрывоопасно.
Среди них несколько энтузиастов сети напрямую позвонили в Midjourney и привели пример слов-подсказок DALL·E3, чтобы они могли соревноваться напрямую.
И результат можно сказать только:Мидджорни в опасности.
Первый — классический медицинский мем с авокадо. Подсказка такова: авокадо сидит в кресле терапевта и говорит: «Я чувствую себя таким пустым внутри». В середине авокадо есть отверстие размером с небольшой кратер. Терапевт, ложка, каракули.
Хотя на первый взгляд это два разных стиля. Но если внимательно сравнить слова-подсказки, то очевидно, чтоMidjourney игнорирует терапевта, ложку и записи граффити. Текст в диалоговом окне также пишется случайным образом и не соответствует требованиям.
Затем их попросили создать изображение полупрозрачного сердца и выгравировать под сердцем конкретную цитату.
Совет: это иллюстрация человеческого сердца из полупрозрачного стекла, стоящего на постаменте в бурном океане. Солнечный свет проникает сквозь облака и освещает душу, раскрывая крошечную вселенную внутри. На основании жирным шрифтом написана цитата «Открой вселенную внутри себя».
Нет никаких сомнений в том, что DALL·E3 на этот раз снова победила Midjourney.Помимо того, что персонажи не были выгравированы должным образом, в Midjourney также не удалось показать какие-либо детали, такие как бурный океан и внутренний микрокосм.
Вот еще одна фотография сферического стула в стиле личи с деталями, напоминающими белый неровный внешний вид и мягкий интерьер, контрастирующий с тропическими обоями позади него.
Это оживляет все элементы созданной ими картинки.Но Midjourney, похоже, неправильно поняли разницу между тропическими обоями и тропическим лесом.
Конечно, неправильное понимание слов-подсказок и выдергивание их из контекста эквивалентно хроническим заболеваниям предыдущей модели диаграммы Винсента.
Просто родить краба, как рака-отшельника...
Попросив его создать 2D-полосу антропоморфного леса, мы получили 3D-изображение...
Что касается этих старых проблем, то, согласно собственному заявлению OpenAI и приведенным примерам, в новом DALL·E3 такой ситуации в принципе нет.
Помимо решения старых проблем, DALL·E3 также обновила текстуры оригинальной версии второго поколения.
Например, пусть они нарисуют сцену, где баскетболист бросает мяч в мяч, а элементом будет взрыв в звездном небе.
Первоначально изображения, созданные DALL·E2, уже отвечали требованиям. Неожиданно обновленный DALL·E3 оказался более реалистичным: такие детали, как линии мышц и цвета вселенной, отображались одна за другой. Это действительно был удар по уменьшению размерности.
Слева: DALL·E2, справа: DALL·E3
Общий,Благодаря поддержке ChatGPT способность DALL·E3 к пониманию языка становится максимальной, и победить практически невозможно.
Обновленная версия ChatGPT не только не теряет ключевые информационные точки, но даже если вы вводите всего несколько ключевых слов здесь и там, она может автоматически завершить описание за вас, а затем позволить DALL·E3 сгенерировать изображение.
OpenAI уловила суть «культурной пустыни» современных пользователей сети (голова собаки).
Конечно, интеграция DALL·E3 и ChatGPT не просто позволяет лучше понимать человеческую речь, но и дает несколько замечательных результатов.
Например, обновленная версия ChatGPT также имеет возможности понимания контекста при рисовании и даже может использоваться непосредственно в качестве инструмента повышения производительности.
Чтобы увидеть, насколько он мощный, на официальном сайте OpenAI есть демонстрационное видео. Честно говоря, после просмотра Шичао забеспокоился о работе иллюстратора.
Сначала позвольте ChatGPT сгенерировать супер-ежа-подсолнуха. Это даст вам четыре изображения. После того, как вы выберете тот, который вам больше всего нравится, вы можете перейти к следующему этапу разговора.
Затем назовите ежа Ларри и позвольте ChatGPT сгенерировать еще несколько его фотографий.
Далее давайте увеличим сложность и создадим сцену, показывающую дом Ларри.
Это может напрямую продемонстрировать силу DALL·E3+ChatGPT. Мало того, что внешний вид Ларри остался прежним (возможно, он уже давно изменился для других ИИ), но на почтовом ящике у двери также написано имя «ЛАРРИ».
Кроме того, с помощью ChatGPT легко описать характеристики Ларри, использовать фотографии, чтобы показать его любовь, и даже сделать периферийные устройства Ларри и разработать несколько наклеек.
Наконец, позвольте ему организовать сказку на ночь и финальную позу. ChatGPT также у вас под рукой. u1s1 Я был действительно шокирован этим шелковистым диалогом...
Увидев это, Шичао внезапно почувствовал новое вдохновение. После этого написанную нами статью можно было бы отправить прямо в ChatGPT и позволить ему извлечь ключевые слова для обложки.
Если у вас есть какие-либо особые требования, вы можете сообщить об этом напрямую ChatGPT. Также туда можно закинуть эталонные картинки. Навыки рыбалки +1+1...
На практике OpenAI демонстрирует вышеупомянутые эффекты лишь в одностороннем порядке. Как он будет на самом деле использоваться, будет неизвестно до тех пор, пока он не появится в сети в октябре. Предполагается, что к тому времени пользователи сети разработают волну скрытых техник. Просто подождите и посмотрите.
Кроме того, когда дело касается живописи с использованием ИИ, все еще существует общая тема, которую нельзя обойти: проблемы авторского права.
OpenAI по-прежнему сохраняет свои прежние позиции.Как и во второй версии, изображения, созданные с помощью DALL·E3, можно использовать без разрешения и в коммерческих целях.
Однако, научившись слишком многому из прошлого, OpenAI на этот раз поступила немного умнее, заявив, что художники могут отказаться от передачи своих работ в DALL·E, если они заполнят форму.
Хотя это в некоторой степени означает «не отказать — значит уступить», но по сравнению с тем, что было раньше, по крайней мере, художники уже не такие пассивные…
У DALL·E также есть контрмеры против предыдущих картин ИИ в Интернете, которые вторгались в частную жизнь общественных деятелей и других предвзятых вопросов:При фактическом использовании ChatGPT напрямую отклоняет запросы с именем публичного деятеля в командной строке.
Другими словами, подобных забавных картинок в ChatGPT мы, скорее всего, не увидим…
А еще они сформировали «красную команду» для оценки и снижения рисков, которые могут возникнуть от модели на различных этапах.
Наконец, OpenAI также заявила на своем официальном сайте, что они работают над инструментом для идентификации рисунков ИИ, который сможет определить, какие изображения были созданы DALL·E3.
(Я просто надеюсь, что он не будет похож на предыдущий инструмент распознавания текста AI, потому что он был бесполезен и умер на полпути...
В общем, ChatGPT с функцией графика Винсента достаточно, чтобы вызвать волну энтузиазма в кругах искусственного интеллекта, и эта волна представляет собой интегрированную обновленную версию DALL·E3, которая трудно не вызывать восторга. В любом случае, Шичао не терпится попробовать.
Но кто-то рад, а кто-то обеспокоен. Эта волна OpenAI снова далеко обошла своих конкурентов. Предполагается, что после октябрьского обновления многие стартапы в области ИИ будут раздавлены колесами ChatGPT...