Главная / API и токены / Thinking Machines Lab / Токены и пополнение
Токены и пополнение Thinking Machines Lab
Thinking Machines Lab
—
Предложений пока нет
По этому товару никто пока не разместил карточку. Цену мы не придумываем: показанная цена — публичная оферта, и она бывает только от живого продавца.
Что вы получаете
Токены Tinker уходят сразу по трём статьям: prefill — чтение вашего запроса, сэмплирование — генерация ответа, обучение — шаги тренировки LoRA. Уточняйте, на чей аккаунт зачисляется объём: на своём вы видите расход в кабинете, держите ключ у себя и сохраняете чекпоинты, а доступ к учётной записи продавца гарантией площадки не покрыт. Спросите и о том, какие модели и какая длина контекста открыты: вариант 256K и включённое размышление съедают баланс заметно быстрее, потому что скрытые токены размышления считаются как выходные.
О сервисе
Доступ к моделям Thinking Machines Lab через их платформу Tinker: флагманский Inkling (975 млрд параметров, 41 млрд активных) и облегчённый Inkling-Small (276 млрд параметров, 12 млрд активных) — открытые MoE-модели, которые нативно понимают текст, изображения и звук и держат контекст до 1 млн токенов. На Tinker обе модели даются в двух вариантах контекста — 64K и 256K, а глубину размышления можно регулировать, разменивая качество ответа на расход токенов. Кроме Inkling на платформе открыты другие модели с открытыми весами: Qwen3.5-4B, Qwen3.5-9B, Qwen3.6-35B, Qwen3.5-397B, Kimi-K2.6, DeepSeek-V3.1, GPT-OSS и Nemotron от Lightning-30B до Ultra-550B. Tinker — это не только инференс, а тренировочный API: платформа сама управляет GPU и перезапусками, пока вы пишете свой цикл обучения, и поддерживает LoRA поверх моделей от 1B до 1T+ параметров, SFT, RL (GRPO, PPO), DPO и дистилляцию. Платят здесь по токенам, причём отдельно за prefill, сэмплирование и обучение.