Сбер выложил GigaChat 3.5 Reasoning под MIT: модель можно запускать у себя
10 сентября 2026 года Сбер открыл веса GigaChat 3.5 Reasoning на Hugging Face под лицензией MIT. Разбираю, что эта лицензия реально разрешает, есть ли допсоглашение и во сколько обходится запуск 432B на своём железе.
10 сентября 2026 года Сбер объявил GigaChat 3.5 Reasoning - первую свою модель, которая рассуждает перед ответом, - и показал её веса на Hugging Face. Сами файлы залили в репозиторий ещё 3 сентября, карточку с описанием написали 6-го, сборки для запуска на процессоре добавили 9-го.
Интересна в этом релизе не новая архитектура, а одна строчка в карточке модели: license: mit. По этой лицензии софт можно брать в коммерческий продукт, менять и продавать, не спрашивая автора. Для весов модели это значит вот что: вы скачиваете файлы, поднимаете их на своём сервере, и Сбер про ваши запросы не знает ничего.
Вместо лицензионного договора - одна строчка в карточке
Первое, что я проверил, - нет ли под словом MIT отдельного соглашения на использование весов. У открытых моделей это обычная история: лицензия называется свободной, а рядом лежит файл с оговорками.
Не нашёл. В карточке модели стоит поле license: mit, а файла с текстом условий в репозитории нет вообще - ни LICENSE, ни LICENSE.md, ни LICENSE.txt, все три адреса отдают 404. Формы согласия тоже нет: я запросил из репозитория служебный файл config.json обычным curl, без входа в аккаунт Hugging Face, и сервер его отдал.
Для сравнения - Llama 3.3 70B от компании Meta (признана экстремистской организацией и запрещена в России). Там своя лицензия под названием llama3.3, файл с её условиями лежит в репозитории, а доступ к весам выдают вручную: заполняете форму и ждёте, пока Meta одобрит заявку. У GigaChat 3.5 Reasoning нет ни формы, ни ожидания, ни условий сверх текста MIT.
Чего теперь можно не делать
Не спрашивать разрешения у Сбера. MIT разрешает использовать, копировать, менять, распространять и продавать, в том числе внутри платного продукта. Единственное условие - не выкидывать текст лицензии и упоминание авторов из того, что вы раздаёте дальше.
Не отправлять запросы в чужое облако. Модель отвечает на вашем сервере, наружу не уходит ни вопрос пользователя, ни ответ модели, ни содержимое документов, которые вы ей подсунули.
Не платить за обращения. Счётчика токенов нет, счёт приходит за железо и электричество - и он не зависит от того, сколько раз вы дёрнули модель.
Не оставаться на том, что выложили. Для дообучения Сбер выложил отдельный репозиторий в формате bf16 - это те же веса без сжатия, и в карточке они прямо названы версией для дообучения и для того, чтобы ужать модель под своё железо.
446 гигабайт весов, и куда они влезают
В основном репозитории лежат веса в FP8 - это формат, где каждое число внутри модели занимает один байт. Отсюда и вес: 432 миллиарда параметров превращаются в 446 гигабайт файлов, которые надо где-то разместить целиком.
Сбер в карточке даёт готовую команду запуска на восьми картах NVIDIA H100. Арифметика сходится впритык: восемь карт по 80 гигабайт памяти - это 640 гигабайт, из них 446 забирают веса, и около 190 остаётся на контекст и служебные буферы. Контекст модель держит до 262 тысяч токенов, и чем длиннее он в работе, тем быстрее этот остаток тает.
Версия в bf16, та самая, которая нужна для дообучения, весит 876 гигабайт. В восемь карт она уже не помещается - нужно шестнадцать.

Без видеокарт - минимум 262 гигабайта оперативной памяти
Для запуска на процессоре и обычной оперативке Сбер выложил сборки в формате GGUF - это формат для llama.cpp, программы, которая гоняет модели без видеокарты. Сборок четыре, и различаются они тем, насколько сильно ужаты числа внутри модели.
Q4_K_M - 262 гигабайта, самая сжатая из официальных;
Q6_K - 360 гигабайт;
Q8_0 - 466 гигабайт;
bf16 без сжатия - 876 гигабайт.
Ничего мельче 262 гигабайт не выложил ни Сбер, ни сторонние авторы: 14 сентября 2026 года пользователь BahamutRU опубликовал своё зеркало, но там те же четыре сборки и те же размеры до сотых долей гигабайта.
Сколько людей это реально поднимает, видно по счётчикам Hugging Face. На 15 сентября 2026 года основной репозиторий в FP8 скачали 318 раз, GGUF - 1860.
Посчитал аренду: 2816 рублей в час
Покупать такое железо под один проект никто не станет, поэтому считаю по аренде. На странице Интелион Облака H100 идёт от 352 рублей в час за карту.
Считаю в лоб: 352 рубля умножаем на восемь карт - получается 2816 рублей в час. Сутки непрерывной работы - 67 584 рубля, месяц - 2 027 520 рублей.
Это и есть цена фразы «данные наружу не уходят», выраженная в деньгах. Причём платить её вы начинаете до того, как модель ответила на первый запрос: счётчик у хостера тикает, пока сервер поднят, а не пока им кто-то пользуется.
Если хочется посмотреть на модель, не поднимая её, у этого есть три пути, и ни один не даёт того, ради чего берут открытые веса.
Веб-версия GigaChat. Модель туда включили в день анонса, режим рассуждений включается кнопкой. Но это облако Сбера: запросы уходят к нему, и вся польза от MIT в этом сценарии пропадает.
Коммерческий доступ по API. На 10 сентября 2026 года его не было: в сообщении пресс-службы Сбера сказано, что открыть его только планируется.
Зарубежные агрегаторы. 15 сентября 2026 года я выгрузил каталог OpenRouter: в нём 445 моделей, и ни одной из линейки GigaChat.
Что из этой лицензии можно унести на свой ноутбук
432 миллиарда параметров дома не поднимает никто, но MIT у Сбера стоит не только на флагмане. Под той же лицензией лежит GigaChat 3.1 на 10 миллиардов параметров - младшая модель линейки, у которой на каждый ответ работают 1,8 миллиарда.
Её сжатая сборка Q4_K_M весит 6,5 гигабайта. Это уже ноутбук с 16 гигабайтами памяти и та же llama.cpp - то есть ровно та ситуация, когда данные никуда не уходят, только без двух миллионов рублей в месяц.
Открытая лицензия в этом релизе сняла один барьер - разрешительный. Кому писать, что подписывать и сколько платить за обращение, спрашивать больше не нужно; оставшийся вопрос теперь только про счёт за железо, и отвечает на него не Сбер, а ваш хостер.
