Компания OpenAI анонсировала выпуск двух новых моделей из серии o: OpenAI o3 и OpenAI o4-mini, которые, по словам разработчиков, являются «самыми интеллектуальными моделями, созданными на сегодняшний день». Эти модели объединяют расширенные навыки рассуждения и доступ ко всем инструментам внутри ChatGPT, позволяя решать сложные задачи более эффективно.
OpenAI o3 и o4-mini способны выполнять поиск в Интернете в реальном времени, анализировать загруженные файлы через Python, производить глубокий анализ визуальных данных и генерировать изображения. Это делает их более «агентными», что позволяет моделям автономно определять необходимые инструменты для достижения максимальной точности и полноты ответов.
OpenAI o3 выделяется как наиболее «продвинутая» модель линейки, охватывающая широкий спектр областей, включая программирование, бизнес и инженерные задачи. Модель показывает на 20% меньше ошибок по сравнению с предыдущей версией и известна своей способностью к глубокому анализу визуальных данных. В то же время, OpenAI o4-mini представляет собой оптимизированную версию для быстрого и недорогого развертывания, демонстрируя отличные результаты в математике и обработке данных.
Основным нововведением является агентное применение инструментов внутри ChatGPT: модели выясняют, когда нужен веб-поиск, когда необходимо визуализировать информацию, а когда достаточно текстового ответа. Это позволяет значительно ускорить решение многоэтапных задач.
В сравнительных тестах на AIME 2024/2025 и Codeforces, новые модели превзошли предыдущие версии, показывая улучшение точности и быстродействия, а также получая положительные отзывы в области бизнеса и креативного мышления. Команда OpenAI указала на достижения в масштабированном обучении с подкреплением, подчеркивая важность вычислительных мощностей для повышенных результатов.
Модели o3 и o4-mini могут комбинировать разные инструменты в одном диалоге, создавая более структурированные и точные решения. Это открывает новые возможности для использования мух задач, начиная от анализа научных данных до выполнения сложных бизнес-задач.
Безопасность также стала одним из важных аспектов: OpenAI усовершенствовала свои фильтры и теперь более эффективно справляется с опасными запросами. Неоднократные внутренние тесты показали, что новые модели успешно фильтруют до 99% опасных инструкций.
OpenAI также анонсировала экспериментальную среду Codex CLI, которая позволяет пользователям просить модели интерпретировать команды прямо в терминале, что открывает новые горизонты для интеграции нейросетей в программы и процессы.
Модели уже доступны под подписками ChatGPT Plus, Pro и Team, а бесплатным пользователям предлагается пробный доступ к o4-mini. С нетерпением ждем будущих моделей, которые продолжат улучшать синергию GPT и o-серии, предоставляя пользователям качественно новые решения.
