open ai

OpenAI представляє нові інструменти для створення агентів штучного інтелекту: ось що це означає

Компанія OpenAI представила нові інструменти для створення AI-агентів у бізнесі.

У вівторок компанія OpenAI анонсувала новий набір інструментів, призначених для допомоги розробникам та підприємствам у створенні AI-агентів — автоматизованих систем, здатних самостійно виконувати завдання — використовуючи власні AI-моделі та фреймворки компанії.

Від Assistants API до Responses API

Новий інструментарій є частиною Responses API від OpenAI, який дозволяє бізнесу розробляти індивідуальні AI-агенти, здатні виконувати веб-пошук, аналізувати внутрішні документи компанії та взаємодіяти з вебсайтами, подібно до продукту OpenAI під назвою Operator. Responses API фактично замінює Assistants API, який компанія планує поступово вивести з експлуатації в першій половині 2026 року.

Зростаючий інтерес до AI-агентів

Останніми роками інтерес до AI-агентів значно зріс, хоча технологічна індустрія все ще стикається з труднощами у визначенні та демонстрації їх реальних можливостей. Наприклад, китайський стартап Butterfly Effect нещодавно привернув увагу своєю платформою AI-агентів під назвою Manus, яка, як виявилося, не відповідала багатьом обіцянкам компанії.

Виклики та перспективи для OpenAI

Це підвищує ставки для OpenAI у розробці ефективних агентів. Як зазначив Олів’є Годемент, керівник продукту OpenAI, «демонструвати роботу агента досить просто, але масштабувати його та забезпечити регулярне використання — дуже складно».

Можливості Responses API

Раніше цього року OpenAI представила два AI-агенти в ChatGPT: Operator, який може самостійно переглядати вебсайти, та Deep Research, який складає дослідницькі звіти. Обидва інструменти продемонстрували потенціал агентних технологій, але залишили бажати кращого в аспекті автономності.

Зараз, за допомогою Responses API, OpenAI надає доступ до компонентів, що забезпечують роботу AI-агентів, дозволяючи розробникам створювати власні додатки, подібні до Operator та Deep Research. OpenAI сподівається, що розробники зможуть створювати додатки з більшою автономністю, ніж доступні на сьогоднішній день.

Використовуючи Responses API, розробники можуть застосовувати ті ж AI-моделі, що й у ChatGPT Search: GPT-4o search та GPT-4o mini search. Ці моделі можуть здійснювати веб-пошук для отримання відповідей на запитання, надаючи посилання на джерела у своїх відповідях.

OpenAI стверджує, що GPT-4o search та GPT-4o mini search відзначаються високою фактичною точністю. За даними компанії, на їхньому тесті SimpleQA, який оцінює здатність моделей відповідати на короткі запитання, GPT-4o search набирає 90%, а GPT-4o mini search — 88%. Для порівняння, GPT-4.5 — нещодавно випущена, більш велика модель OpenAI — набирає лише 63%.

Responses API також включає утиліту для пошуку файлів, яка може швидко сканувати документи в базах даних компанії для отримання інформації. (OpenAI запевняє, що не буде використовувати ці файли для навчання моделей.) Крім того, розробники, які використовують Responses API, можуть скористатися моделлю Computer-Using Agent (CUA) від OpenAI, яка забезпечує роботу Operator. Ця модель генерує дії миші та клавіатури, дозволяючи розробникам автоматизувати завдання, такі як введення даних та робочі процеси в додатках.

Підприємства можуть за бажанням запускати модель CUA, яка випускається в рамках дослідницького попереднього перегляду, локально на своїх власних системах. Споживча версія CUA, доступна в Operator, може виконувати дії лише в Інтернеті.

Обмеження та майбутні плани

Варто зазначити, що Responses API не вирішує всіх технічних проблем, з якими стикаються AI-агенти сьогодні. Хоча інструменти на основі AI-пошуку є більш точними, ніж традиційні AI-моделі, веб-пошук не повністю усуває проблему «галюцинацій» AI. GPT-4o search все ще помиляється у 10% випадків при відповіді на фактичні запитання. Крім того, інструменти AI-пошуку часто мають труднощі з короткими, навігаційними запитами (наприклад, «результат гри Lakers сьогодні»), а недавні звіти свідчать, що посилання ChatGPT не завжди є надійними.

У своєму блозі, наданому TechCrunch, OpenAI зазначила, що модель CUA «ще не є високонадійною для автоматизації завдань в операційних системах» та схильна до «ненавмисних» помилок.

Однак OpenAI підкреслює, що це лише початкові версії їхніх агентних інструментів, і компанія постійно працює над їх покращенням.

Agents SDK: новий інструментарій для розробників

Поряд з Responses API, OpenAI випускає набір інструментів з відкритим вихідним кодом під назвою Agents SDK, який надає розробникам безкоштовні засоби для інтеграції моделей у їхні внутрішні системи, впровадження заходів безпеки та моніторингу роботи AI-агентів для налагодження та оптимізації.

Agents SDK є своєрідним продовженням OpenAI Swarm — фреймворку для оркестрації багатьох агентів, який компанія випустила наприкінці минулого року. Новий набір інструментів покликаний допомогти розробникам більш ефективно створювати та розгортати AI-агенти, інтегруючи їх у бізнес-процеси.

Майбутнє AI-агентів: що очікувати?

Олів’є Годемент висловив надію, що OpenAI зможе подолати розрив між демонстраційними версіями AI-агентів та реальними продуктами вже цього року. За його словами, «агенти — це найвпливовіший додаток AI, який з’явиться». Ця думка перегукується із заявою CEO OpenAI Сема Альтмана, який у січні зазначив, що 2025 рік стане роком, коли AI-агенти масово увійдуть у робочі процеси.

Чи справді 2025 рік стане «роком AI-агентів», покаже час. Однак останні розробки OpenAI свідчать про те, що компанія прагне не просто створювати ефектні демонстрації агентів, а й пропонувати бізнесу реальні інструменти для автоматизації та оптимізації роботи.

Джерело: TechCrunch

Слідкуй за PRO Ідеї

Щоб не пропускати нові матеріали — підписуйся там, де тобі зручно

Коментарі

Поки що немає коментарів. Чому б вам не розпочати обговорення?

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *