Компания OpenAI объявила о выпуске открытой языковой модели gpt-oss-120b, доступной под лицензией Apache 2.0. Веса опубликованы на Hugging Face, а инференс можно запускать локально на одной видеокарте с 80 ГБ памяти. По словам разработчиков, модель показывает результаты, сопоставимые с проприетарными решениями прошлого поколения.
Архитектура основана на разреженной смеси экспертов: из 120 млрд параметров при генерации задействуется около 5 млрд. Это заметно снижает требования к железу и стоимость обслуживания. Поддержка вызова функций и структурированного вывода реализована на уровне чат-шаблона.
Компания отмечает, что модель прошла этапы дообучения с подкреплением и внутренние проверки безопасности. Тем не менее в карточке указано, что она не предназначена для применения в медицине, юриспруденции и других областях с высокими рисками.
Аналитики считают, что релиз усилит конкуренцию на рынке открытых моделей, где уже присутствуют решения Meta, Mistral и Alibaba. Для корпоративных заказчиков открытые веса означают возможность развернуть систему в закрытом контуре без передачи данных третьим лицам.