OpenAI представила нову модель штучного інтелекту GPT-5.4
5 березня OpenAI анонсувала вихід нової моделі штучного інтелекту GPT-5.4, яка, за словами компанії, є "найпотужнішою та найефективнішою" на сьогодні.
Про це повідомляє РБК-Україна з посиланням на Techcrunch.
Основні характеристики нової моделі
Користувачам доступні декілька варіантів моделі: стандартна версія GPT-5.4, а також модифікації Thinking (для аналітичного мислення) та Pro (для підвищеної продуктивності). Версія для розробників має унікальну можливість одночасної обробки до мільйона токенів, що є найбільшим обсягом даних серед усіх продуктів OpenAI.
Модель також демонструє підвищену економічність, виконуючи ті ж завдання з меншими витратами ресурсів. Вона показала рекордні результати в тестах на комп'ютерні навички, загальні знання та виконання професійних завдань.
Поліпшення точності та безпеки
За словами генерального директора компанії Mercor Брендана Фуді, GPT-5.4 досягла найкращих результатів у тестах на професійні знання у сферах права та фінансів. Точність моделі зросла: вона на 33% рідше помиляється в конкретних фактах та на 18% рідше надає загальні помилкові відповіді порівняно з попередньою версією.
OpenAI також вдосконалила технічні аспекти моделі, додавши функцію Tool Search. Тепер штучний інтелект отримує доступ до інструкцій для інструментів лише за необхідності, що оптимізує швидкодію та знижує витрати.
Контроль внутрішніх процесів
Значна увага в новій моделі приділена безпеці: розробники запровадили перевірку "ходу думок" штучного інтелекту. Це забезпечує можливість відстежувати внутрішні міркування ІІ під час виконання складних завдань, що критично важливо для розуміння логіки моделі.
"Обман менш імовірний у версії Thinking GPT-5.4, що свідчить про відсутність у моделі здатності приховувати свої міркування, а моніторинг мисленнєвого процесу залишається ефективним інструментом безпеки", - зазначає OpenAI.
Зазначимо, що дослідження показало, що чат-боти на базі штучного інтелекту знижують надійність і частіше помиляються під час тривалих розмов. Наприклад, при виконанні однієї команди моделі демонструють успішність у 90%, але в складних діалогах цей показник суттєво знижується.

