open ai

OpenAI представляє нове покоління DALL-E 3, який перетворює текст в зображення

OpenAI представила оновлену версію свого інструменту для перетворення тексту в зображення, DALL-E на базі ChatGPT.

DALL·E 3 розуміє значно більше нюансів і деталей, ніж попередні системи OpenAI, що дозволяє вам легко перетворювати свої ідеї на винятково точні зображення.

Далл-е 3 зараз знаходиться на етапі попереднього перегляду та буде доступний для клієнтів ChatGPT Plus і Enterprise у жовтні через API та в Labs пізніше цієї осені.

Особливості DALL-E 3

Більшість передових інструментів для створення зображень на базі штучного інтелекту сьогодні приймають підказки — описи зображень — і перетворюють їх на ілюстрації в різних стилях, починаючи від фотореалістичних і закінчуючи фантастичними.

Але створити правильну підказку може бути складно, настільки, що «розробка оперативної інформації» стає справжньою професією.

Новий інструмент OpenAI, DALL-E 3, використовує ChatGPT для заповнення підказок. За допомогою ChatGPT користувачі, які підписалися на преміум-плани OpenAI ChatGPT, ChatGPT Plus і ChatGPT Enterprise, можуть вводити запит на зображення та вдосконалювати його за допомогою бесід із чат-ботом, отримуючи результати безпосередньо в програмі чату.

ChatGPT візьме підказку лише з кількох слів і зробить її більш описовою, надаючи більше вказівок для моделі DALL-E 3.

Інтеграція ChatGPT — не єдине, що є новим у DALL-E 3. DALL-E 3 також генерує зображення вищої якості, які точніше відображають підказки, каже OpenAI — особливо коли мова йде про довші підказки. І він краще обробляє контент, який історично спотикався з моделями створення зображень, як-от текст і людські руки.

Окрім цього, DALL-E 3 має нові механізми для зменшення алгоритмічної помилки та підвищення безпеки — принаймні, так стверджує OpenAI.

Наприклад, DALL-E 3 відхилить запити, які просять зображення в стилі живих художників або публічних осіб.

І художники тепер можуть відмовитися від використання певних — або всіх — їхніх ілюстрацій для навчання майбутніх поколінь моделей OpenAI, що перетворюють текст у зображення. (OpenAI разом із деякими своїми конкурентами стикається з судовим позовом за нібито використання робіт художників, захищених авторським правом, для навчання своїх генеративних моделей зображень ШІ.)

Запуск DALL-E 3 стався на тлі розпалу гонки генеративного штучного інтелекту, особливо в області синтезу зображень. Такі конкуренти, як Midjourney і Stability AI, продовжують удосконалювати свої моделі генерації зображень, змушуючи OpenAI залишатися в курсі.

OpenAI планує розгорнути DALL-E 3 для преміум-користувачів ChatGPT у жовтні, а потім для дослідницьких лабораторій і своїх клієнтів API. Компанія не повідомила, коли і чи планує випустити безкоштовний веб-інструмент, як це було з DALL-E 2 і оригінальною моделлю DALL-E.

Джерело: OpenAi

Слідкуй за PRO Ідеї

Щоб не пропускати нові матеріали — підписуйся там, де тобі зручно

Коментарі

Поки що немає коментарів. Чому б вам не розпочати обговорення?

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *