Thinking Machines выпустила большую открытую мультимодальную модель Inkling
Модель принимает текст, изображения и аудио, поддерживает 1 млн токенов контекста и сразу получила поддержку inference-фреймворков.

Thinking Machines Lab выпустила Inkling на Hugging Face и позиционирует модель как крупную открытую мультимодальную систему для команд, которым нужна адаптация frontier-scale моделей без закрытого API.
Inkling описывается как sparse mixture-of-experts модель примерно с 975 млрд параметров всего и 41 млрд активных параметров. Она принимает текст, изображения и аудио, поддерживает контекст до 1 млн токенов и рассчитана на мультимодальные reasoning-задачи и доменную дообучаемость. Hugging Face пишет, что модель доступна в BF16 и NVFP4 вариантах, а запуск поддержали Transformers, SGLang, vLLM и llama.cpp.
Вместе с основной моделью вышла Inkling-Small: версия на 276 млрд параметров с 12 млрд активных параметров, которую проще обслуживать в продакшене. Together AI предлагает hosted-доступ с первого дня, что важно: полная модель даже в низкой точности требует сотни гигабайт GPU-памяти.
Главный смысл: еще одна серьезная лаборатория двигает open-weight мультимодальные модели в сторону long-context агентов, voice/image workflows и кастомного enterprise fine-tuning, а не только текстового чата.
Источники
- Hugging Face bloghuggingface.co
- Together AI launch supporttogether.ai