Используя этот сайт, вы соглашаетесь с нашей политикой конфиденциальности и условиями использования.
Accept
Craftium.AICraftium.AICraftium.AI
  • Главная
  • Новости
  • Каталог
  • Подборки
  • Блог
Font ResizerAa
Craftium.AICraftium.AI
Font ResizerAa
Поиск
  • Главная
  • Новости
  • Каталог
  • Подборки
  • Блог
Следите за нами:
  • Правила пользования
  • Политика конфиденциальности
  • Авторские права
  • Обратная связь
© 2024-2025 Craftium.AI.

Новые ИИ модели o3 и o4-mini часто ошибаются

Независимое тестирование показало, что эти reasoning-модели нередко придумывают действия и создают ложную информацию в ответах

Alex Dubenko
Alex Dubenko
Опубликовано: 22.04.2025
Новости
Model o3
Иллюстративное изображение
Поделиться:

OpenAI представила новые генеративные ИИ — o3 и o4-mini, которые уже успели привлечь внимание неожиданными результатами тестирования. По словам компании , эти модели имеют наивысшую производительность среди предшественников, однако исследования показали, что они также чаще создают ложные утверждения. Согласно официальному отчету, o4-mini ошиблась в сорока восьми процентах ответов — это втрое больше, чем у o1. Модель o3, несмотря на лучшую точность, все же генерировала ложную информацию в трети случаев, вдвое чаще, чем o1.

Особенно интригует то, что o3 и o4-mini принадлежат к так называемым reasoning-моделям, которые открыто демонстрируют пользователю логику своих действий. Однако независимая лаборатория Transluce заметила, что o3 часто придумывает действия, которые технически не может выполнить, например, симулирует запуск кода в среде программирования. Более того — когда пользователь ставит под сомнение такой ответ, модель начинает настойчиво оправдывать вымышленные действия, даже утверждая, что использует внешний компьютер для вычислений.

Читайте также

Обучение с ИИ
ChatGPT получил Study Mode для обучения пользователя
Microsoft готовит свой сервис Copilot к запуску GPT-5
ChatGPT самостоятельно будет выбирать модель для каждого запроса пользователя

Transluce обратила внимание, что ложные утверждения относительно выполнения кода чаще появляются именно в o-серии моделей, чем в GPT-серии. Исследователи отметили, что повышенный уровень вымыслов в reasoning-моделях может быть связан с определенными дизайнерскими решениями, в частности использованием outcome-based reinforcement learning и отказом от сохранения цепочек рассуждений из предыдущих диалогов.

В то же время стало известно, что OpenAI существенно сократила объемы тестирования безопасности для новых моделей, включая o3. Хотя система защиты от так называемых джейлбрейков осталась почти на уровне o1, высокие показатели вымыслов вызывают удивление даже у специалистов. Компания подчеркивает, что проверка фактов остается ответственностью пользователя — особенно, если речь идет о новейших reasoning-моделях.

Модели Google DeepMind и OpenAI завоевали золото на олимпиаде по математике
GPT-5 тестируют для науки и сложных задач программирования
OpenAI призывает к осторожности при использовании агента ChatGPT
OpenAI представила ChatGPT Agent, позволяющий делегировать ИИ сложные задачи
ChatGPT получит Agent Mode для работы с файлами и отчетами
Отметки:OpenAIТестирование
Комментариев нет

Добавить комментарий Отменить ответ

Следи за нами

XСледовать
InstagramСледовать
YoutubeПодписаться
TelegramСледовать

Популярные новости

Аватар Ani
Grok презентовал 3D-компаньонов с голосовым общением в iOS
14.07.2025
Инструменты и ноты
Сервис Songscription помогает превратить песни в ноты за несколько минут
01.07.2025
Grok 4
xAI представила Grok 4 и подписку SuperGrok Heavy за $300
10.07.2025
Grok 4
Grok 4 от xAI обещает стать новым стандартом для разработчиков
06.07.2025
Veo 3
Более быстрое видео и аудио: Google запускает Veo 3 в Gemini
03.07.2025

Читайте также

OpenAI
Новости

OpenAI готовит к запуску собственный браузер с встроенным ИИ

11.07.2025
Шпионы в ИИ
Новости

OpenAI укрепляет защиту от шпионажа конкурентов

09.07.2025
ИИ-обучение
Новости

ChatGPT тестирует функцию «совместного обучения» для пользователей

08.07.2025

Craftium AI — команда, которая пристально следит за развитием генеративного ИИ, применяет его в своем творчестве и охотно делится собственными открытиями.

Навигация

  • Новости
  • Обзоры
  • Подборки
  • Блог

Полезное

  • Правила пользования
  • Политика конфиденциальности
  • Авторские права
  • Обратная связь

Подписывайся на последние новости, полезные советы и гайды по ИИ.

Подписываясь, вы принимаете нашу политику конфиденциальности и условия использования.

Craftium.AICraftium.AI
Следите за нами:
© 2024-2025 Craftium.AI
Подписка
Прокачайся с AI!
Вдохновляйся важными новостями, полезными советами и детальными гайдами получая их прямо на свою почту.

Подписываясь, вы принимаете нашу Политику конфиденциальности и Условия использования.

Welcome Back!

Sign in to your account

Имя пользователя или eMail
Пароль

Забыли пароль?