OpenAI представила свою "рассуждающую" модель ИИ
Компания OpenAI представила свою новую модель искусственного интеллекта - OpenAI o1. Ранее она проходила под кодовым названием под кодовым названием Strawberry. Модель является частью семейства, включающего две версии: o1-preview и o1-mini, причем последняя разработана как более компактная и быстрая, предназначенная в первую очередь для генерации кода.
OpenAI o1 доступна подписчикам ChatGPT Plus и Team, а ранний доступ для корпоративных и образовательных пользователей будет открыт на следующей неделе. Однако модель o1 пока не предлагает полного функционала. В отличие от своего предшественника, GPT-4o, ей не хватает возможностей веббраузинга и анализа файлов, и хотя она имеет функции анализа изображений, они временно отключены для дальнейшего тестирования. Кроме того, o1 позволяет ввести всего 30 сообщений в неделю для o1-preview и 50 для o1-mini.
Недостатком новой модели также является ее стоимость – $15 за 1 миллион входных токенов и $60 за 1 миллион выходных токенов, что значительно дороже GPT-4o.
Несмотря на эти серьезные недостатки, OpenAI планирует сделать o1-mini доступной для всех пользователей бесплатного ChatGPT, хотя конкретная дата релиза еще не объявлена.
Что отличает o1 от других моделей генеративного ИИ, так это ее способность "проверять себя" - перед тем как дать ответ, она изучит выходные данные и исправит имеющиеся неточности. Результатом этого является долгое время обработки данных и предоставления ответа. Эта способность позволяет модели "думать" более эффективно, что делает ее пригодной для сложных задач, требующих более высокого уровня синтеза, таких как анализ электронных писем на предмет важной информации или мозговой штурм маркетинговых стратегий.
OpenAI описывает o1, как первую "думающую" и "рассуждающую" модель, которая перед тема как дать ответ, имитирует цепочку мыслей. Это подкрепляется системой поощрений и наказаний, что помогает модели искать наиболее точные данные. Таким образом, в теории, чем дольше OpenAI o1 обрабатывает запрос, тем лучше будет ответ.
Новый алгоритм оптимизации OpenAI и специально подобранный обучающий набор данных, включающий научную литературу и данные рассуждений, еще больше расширяют возможности o1. В ходе испытаний o1 превзошла GPT-4o в различных задачах, включая решение 83% заданий на отборочном экзамене Международной математической олимпиады (по сравнению с 13% в GPT-4o) и успешное решение 89% заданий на соревнованиях по программированию Codeforces.
Хотя o1 превосходит возможности конкурентов в таких областях, как анализ данных, наука и кодирование, модель имеет определенные ограничения. Например, она гораздо медленнее своих собратьев и отвечает на определенные запросы более 10 секунд. Кроме того, первые тестировщики сообщили, что o1 может "галлюцинировать" (генерировать неправильные, но уверенные ответы) чаще, чем GPT-4o, и менее склонна признавать, что допустила ошибку или и вовсе не знает правильного ответа.
Несмотря на эти проблемы, OpenAI считает, что o1 – шаг вперед в рассуждениях ИИ.
Окончательным испытанием для OpenAI станет обеспечение широкой доступности o1 по более приемлемой цене.