GPT-OSS-120B — это первая масштабная попытка OpenAI войти в сегмент Open Source моделей (выпущена в августе 2025 года). Модель представляет собой систему с открытыми весами (Open Weights) под лицензией Apache 2.0, разработанную для задач, требующих высокой глубины рассуждений и работы автономных агентов. Главная особенность модели — ее архитектура Mixture-of-Experts (MoE), которая позволяет достичь интеллекта уровня GPT-4o mini, сохраняя при этом высокую скорость работы. Технические характеристики: Внутри 120B Несмотря на «120B» в названии, фактическое число параметров составляет около 117 миллиардов, а количество активных параметров при каждом проходе (forward pass) — всего 5.1 миллиарда. Что такое GPT-OSS-120B GGUF? Формат GGUF (через библиотеки llama.cpp и unsloth) — это основной способ запустить эту модель на пользовательском оборудовании. Благодаря оптимизациям и квантованию, требования к памяти значительно снижаются. Native MXFP4 Quantization: Одной из инноваций выпуска стала тренировка модели с использованием нативной 4-битной точности для слоев MoE. Это позволяет запускать полную версию 120B на одной видеокарте NVIDIA H100 (80GB) или профессиональных картах серии Blackwell RTX 6000. Требования к железу и куда кидать файлы Поскольку модель огромная, на обычном домашнем ПК запуск возможен только в сильно сжатом виде (квантование Q2 или Q3) или при наличии большого объема RAM. Потребление памяти (RAM/VRAM): Куда кидать файлы: Если вы используете LM Studio, Ollama или AnythingLLM, файлы формата .gguf следует помещать в соответствующие папки моделей: Сравнение производительности Модель специально обучалась на формате ответов Harmony, что делает её поведение очень предсказуемым в задачах автоматизации.