
Разработчики из Сбера выложили в опенсорс свои новые токенизаторы для видео. Это по сути фундамент для генеративных моделей вроде Kandinsky. Штука получилась мощная — видео сжимается в четыре раза эффективнее прежнего, а на качестве картинки это вообще не сказывается в худшую сторону. Наоборот, детализация на выходе стала даже четче.
Главный профит тут в экономии ресурсов. С таким инструментом обучать нейронки под генерацию видео можно гораздо быстрее и дешевле, потому что нагрузка на железо заметно падает. По внутренним тестам технология уже обходит решения от китайских гигантов уровня Tencent и Alibaba. Весь код доступен по лицензии MIT, так что его можно спокойно забирать и использовать в своих коммерческих проектах без лишних юридических сложностей. Для индустрии это хороший буст, особенно если нет лишних миллионов на аренду серверов.











