Сбер выложил GigaChat 3.5 Reasoning под MIT: модель можно запускать у себя

10 сентября 2026 года Сбер открыл веса GigaChat 3.5 Reasoning на Hugging Face под лицензией MIT. Разбираю, что эта лицензия реально разрешает, есть ли допсоглашение и во сколько обходится запуск 432B на своём железе.

10 сентября 2026 года Сбер объявил GigaChat 3.5 Reasoning - первую свою модель, которая рассуждает перед ответом, - и показал её веса на Hugging Face. Сами файлы залили в репозиторий ещё 3 сентября, карточку с описанием написали 6-го, сборки для запуска на процессоре добавили 9-го.

Интересна в этом релизе не новая архитектура, а одна строчка в карточке модели: license: mit. По этой лицензии софт можно брать в коммерческий продукт, менять и продавать, не спрашивая автора. Для весов модели это значит вот что: вы скачиваете файлы, поднимаете их на своём сервере, и Сбер про ваши запросы не знает ничего.

Вместо лицензионного договора - одна строчка в карточке

Первое, что я проверил, - нет ли под словом MIT отдельного соглашения на использование весов. У открытых моделей это обычная история: лицензия называется свободной, а рядом лежит файл с оговорками.

Не нашёл. В карточке модели стоит поле license: mit, а файла с текстом условий в репозитории нет вообще - ни LICENSE, ни LICENSE.md, ни LICENSE.txt, все три адреса отдают 404. Формы согласия тоже нет: я запросил из репозитория служебный файл config.json обычным curl, без входа в аккаунт Hugging Face, и сервер его отдал.

Для сравнения - Llama 3.3 70B от компании Meta (признана экстремистской организацией и запрещена в России). Там своя лицензия под названием llama3.3, файл с её условиями лежит в репозитории, а доступ к весам выдают вручную: заполняете форму и ждёте, пока Meta одобрит заявку. У GigaChat 3.5 Reasoning нет ни формы, ни ожидания, ни условий сверх текста MIT.

Чего теперь можно не делать

  • Не спрашивать разрешения у Сбера. MIT разрешает использовать, копировать, менять, распространять и продавать, в том числе внутри платного продукта. Единственное условие - не выкидывать текст лицензии и упоминание авторов из того, что вы раздаёте дальше.

  • Не отправлять запросы в чужое облако. Модель отвечает на вашем сервере, наружу не уходит ни вопрос пользователя, ни ответ модели, ни содержимое документов, которые вы ей подсунули.

  • Не платить за обращения. Счётчика токенов нет, счёт приходит за железо и электричество - и он не зависит от того, сколько раз вы дёрнули модель.

  • Не оставаться на том, что выложили. Для дообучения Сбер выложил отдельный репозиторий в формате bf16 - это те же веса без сжатия, и в карточке они прямо названы версией для дообучения и для того, чтобы ужать модель под своё железо.

446 гигабайт весов, и куда они влезают

В основном репозитории лежат веса в FP8 - это формат, где каждое число внутри модели занимает один байт. Отсюда и вес: 432 миллиарда параметров превращаются в 446 гигабайт файлов, которые надо где-то разместить целиком.

Сбер в карточке даёт готовую команду запуска на восьми картах NVIDIA H100. Арифметика сходится впритык: восемь карт по 80 гигабайт памяти - это 640 гигабайт, из них 446 забирают веса, и около 190 остаётся на контекст и служебные буферы. Контекст модель держит до 262 тысяч токенов, и чем длиннее он в работе, тем быстрее этот остаток тает.

Версия в bf16, та самая, которая нужна для дообучения, весит 876 гигабайт. В восемь карт она уже не помещается - нужно шестнадцать.

Минимальная конфигурация из карточки модели - восемь карт H100 в одной стойке
Серверная стойка с восемью видеокартами - железо под запуск модели на 432 миллиарда параметров

Без видеокарт - минимум 262 гигабайта оперативной памяти

Для запуска на процессоре и обычной оперативке Сбер выложил сборки в формате GGUF - это формат для llama.cpp, программы, которая гоняет модели без видеокарты. Сборок четыре, и различаются они тем, насколько сильно ужаты числа внутри модели.

  • Q4_K_M - 262 гигабайта, самая сжатая из официальных;

  • Q6_K - 360 гигабайт;

  • Q8_0 - 466 гигабайт;

  • bf16 без сжатия - 876 гигабайт.

Ничего мельче 262 гигабайт не выложил ни Сбер, ни сторонние авторы: 14 сентября 2026 года пользователь BahamutRU опубликовал своё зеркало, но там те же четыре сборки и те же размеры до сотых долей гигабайта.

Сколько людей это реально поднимает, видно по счётчикам Hugging Face. На 15 сентября 2026 года основной репозиторий в FP8 скачали 318 раз, GGUF - 1860.

Посчитал аренду: 2816 рублей в час

Покупать такое железо под один проект никто не станет, поэтому считаю по аренде. На странице Интелион Облака H100 идёт от 352 рублей в час за карту.

Считаю в лоб: 352 рубля умножаем на восемь карт - получается 2816 рублей в час. Сутки непрерывной работы - 67 584 рубля, месяц - 2 027 520 рублей.

Это и есть цена фразы «данные наружу не уходят», выраженная в деньгах. Причём платить её вы начинаете до того, как модель ответила на первый запрос: счётчик у хостера тикает, пока сервер поднят, а не пока им кто-то пользуется.

⚠️
Попробовать бесплатно можно - но ровно тем способом, от которого уходили

Если хочется посмотреть на модель, не поднимая её, у этого есть три пути, и ни один не даёт того, ради чего берут открытые веса.

  • Веб-версия GigaChat. Модель туда включили в день анонса, режим рассуждений включается кнопкой. Но это облако Сбера: запросы уходят к нему, и вся польза от MIT в этом сценарии пропадает.

  • Коммерческий доступ по API. На 10 сентября 2026 года его не было: в сообщении пресс-службы Сбера сказано, что открыть его только планируется.

  • Зарубежные агрегаторы. 15 сентября 2026 года я выгрузил каталог OpenRouter: в нём 445 моделей, и ни одной из линейки GigaChat.

Что из этой лицензии можно унести на свой ноутбук

432 миллиарда параметров дома не поднимает никто, но MIT у Сбера стоит не только на флагмане. Под той же лицензией лежит GigaChat 3.1 на 10 миллиардов параметров - младшая модель линейки, у которой на каждый ответ работают 1,8 миллиарда.

Её сжатая сборка Q4_K_M весит 6,5 гигабайта. Это уже ноутбук с 16 гигабайтами памяти и та же llama.cpp - то есть ровно та ситуация, когда данные никуда не уходят, только без двух миллионов рублей в месяц.

Открытая лицензия в этом релизе сняла один барьер - разрешительный. Кому писать, что подписывать и сколько платить за обращение, спрашивать больше не нужно; оставшийся вопрос теперь только про счёт за железо, и отвечает на него не Сбер, а ваш хостер.

Младшая модель той же линейки идёт на ноутбуке, старшая требует стойку
Ноутбук на столе рядом с огромной серверной стойкой - разница в требованиях младшей и старшей модели

Помогу посчитать, что дешевле для вашей задачи - своя модель или облако

Подписаться на @kursorai