О сервисе
Доступ к моделям Thinking Machines Lab через их платформу Tinker: флагманский Inkling (975 млрд параметров, 41 млрд активных) и облегчённый Inkling-Small (276 млрд параметров, 12 млрд активных) — открытые MoE-модели, которые нативно понимают текст, изображения и звук и держат контекст до 1 млн токенов. На Tinker обе модели даются в двух вариантах контекста — 64K и 256K, а глубину размышления можно регулировать, разменивая качество ответа на расход токенов. Кроме Inkling на платформе открыты другие модели с открытыми весами: Qwen3.5-4B, Qwen3.5-9B, Qwen3.6-35B, Qwen3.5-397B, Kimi-K2.6, DeepSeek-V3.1, GPT-OSS и Nemotron от Lightning-30B до Ultra-550B. Tinker — это не только инференс, а тренировочный API: платформа сама управляет GPU и перезапусками, пока вы пишете свой цикл обучения, и поддерживает LoRA поверх моделей от 1B до 1T+ параметров, SFT, RL (GRPO, PPO), DPO и дистилляцию. Платят здесь по токенам, причём отдельно за prefill, сэмплирование и обучение.