Главная / API и токены / Thinking Machines Lab

Thinking Machines Lab

Thinking Machines Lab

Предложения по сервису 0 предложений

Все предложения по этому сервису сразу. Нажмите вид товара, чтобы оставить только его — адрес страницы изменится, и ссылку можно переслать.

По этому сервису никто пока не разместил ни одного предложения. Цену мы не придумываем: показанная цена — публичная оферта, и она бывает только от живого продавца.

Что можно будет купить

Тарифы

Pay-as-you-go

  • Оплата по фактическому объёму токенов — отдельные ставки за prefill, сэмплирование и обучение
  • Inkling и Inkling-Small в двух вариантах контекста: 64K и 256K (длинный контекст подключается для LoRA отдельным вариантом модели)
  • Больше 28 моделей с открытыми весами: Qwen3.5-4B, Qwen3.5-9B, Qwen3.6-35B, Qwen3.5-397B, Kimi-K2.6, DeepSeek-V3.1, GPT-OSS, Nemotron Lightning-30B, Super-120B, Ultra-550B
  • LoRA-обучение моделей от 1B до 1T+ параметров, dense и MoE, текст и зрение; алгоритмы SFT, RL (GRPO, PPO), DPO и дистилляция
  • Сэмплирование через SamplingClient и эндпоинты, совместимые с OpenAI и Anthropic; бессерверный инференс пока в бете и только для моделей Inkling
  • Скидка 80% на кешированные prefill-токены; хранение чекпоинтов считается за гигабайт в месяц

Состав тарифов по данным вендора; цены продавцов появятся с открытием площадки.

О сервисе

Доступ к моделям Thinking Machines Lab через их платформу Tinker: флагманский Inkling (975 млрд параметров, 41 млрд активных) и облегчённый Inkling-Small (276 млрд параметров, 12 млрд активных) — открытые MoE-модели, которые нативно понимают текст, изображения и звук и держат контекст до 1 млн токенов. На Tinker обе модели даются в двух вариантах контекста — 64K и 256K, а глубину размышления можно регулировать, разменивая качество ответа на расход токенов. Кроме Inkling на платформе открыты другие модели с открытыми весами: Qwen3.5-4B, Qwen3.5-9B, Qwen3.6-35B, Qwen3.5-397B, Kimi-K2.6, DeepSeek-V3.1, GPT-OSS и Nemotron от Lightning-30B до Ultra-550B. Tinker — это не только инференс, а тренировочный API: платформа сама управляет GPU и перезапусками, пока вы пишете свой цикл обучения, и поддерживает LoRA поверх моделей от 1B до 1T+ параметров, SFT, RL (GRPO, PPO), DPO и дистилляцию. Платят здесь по токенам, причём отдельно за prefill, сэмплирование и обучение.

То же у другого вендора

Ещё в категории API и токены