GPT-4.1: Новейший мозговой центр OpenAI с аппетитом к миллиону токенов
Введение новых моделей GPT-4.1 от OpenAI: Улучшения в кодировании и обработке длинного контекста
Автор: Константин Финк, эксперт по автоматизации и нейросетям
OpenAI недавно представила новую серию моделей GPT, известную как GPT-4.1, которая значительно расширяет возможности предыдущих версий, особенно в области кодирования и обработки длинного контекста.
Основные улучшения
Новые модели GPT-4.1, включая GPT-4.1, GPT-4.1 mini и GPT-4.1 nano, демонстрируют существенные улучшения по нескольким ключевым направлениям:
- Кодирование: GPT-4.1 показывает впечатляющие результаты в тестах на кодирование. Например, на бенчмарке SWE-bench Verified модель достигает результата 54.6%, что на 21.4% лучше, чем у GPT-4o, и на 26.6% лучше, чем у GPT-4.5. Это делает GPT-4.1 одним из лидеров в области кодирования[3][5].
- Следование инструкциям: На бенчмарке Scale’s MultiChallenge, который оценивает способность следовать инструкциям, GPT-4.1 показывает результат 38.3%, что на 10.5% лучше, чем у GPT-4o[3][5].
- Длинный контекст: Модель также установила новый рекорд в бенчмарке Video-MME для multimodal long context understanding, достигнув результата 72.0% в категории «длинный контекст без субтитров», что на 6.7% лучше, чем у GPT-4o[3].
Технические характеристики
Новые модели GPT-4.1 имеют несколько важных технических характеристик:
- Большой контекстный окно: Все модели поддерживают контекстный окно до 1 миллиона токенов, что эквивалентно примерно 750 000 слов. Это позволяет им обрабатывать大量 информации за один раз, что превышает объем таких литературных произведений, как «Война и мир»[5].
- Обновленный знаний_cutoff: Модели имеют обновленный знаний_cutoff до июня 2024 года, что обеспечивает более актуальную и точную информацию[3].
Цели и перспективы
OpenAI стремится создать модели, которые смогут выполнять сложные задачи программирования, включая разработку entire приложений от начала до конца. Это включает в себя качество обеспечения, тестирование ошибок и написание документации. Цель компании — разработать «агентного программиста», как выразилась CFO Сара Фрайер на технологическом саммите в Лондоне[5].
Эти нововведения подчеркивают амбициозные планы OpenAI по развитию искусственного интеллекта, способного существенно упростить и ускорить процесс программирования, что может иметь значительные последствия для индустрии软件 разработки.
Share this content:



Отправить комментарий