Pay-as-you-go
- Оплата по фактическому объёму токенов — отдельные ставки за prefill, сэмплирование и обучение
- Inkling и Inkling-Small в двух вариантах контекста: 64K и 256K (длинный контекст подключается для LoRA отдельным вариантом модели)
- Больше 28 моделей с открытыми весами: Qwen3.5-4B, Qwen3.5-9B, Qwen3.6-35B, Qwen3.5-397B, Kimi-K2.6, DeepSeek-V3.1, GPT-OSS, Nemotron Lightning-30B, Super-120B, Ultra-550B
- LoRA-обучение моделей от 1B до 1T+ параметров, dense и MoE, текст и зрение; алгоритмы SFT, RL (GRPO, PPO), DPO и дистилляция
- Сэмплирование через SamplingClient и эндпоинты, совместимые с OpenAI и Anthropic; бессерверный инференс пока в бете и только для моделей Inkling
- Скидка 80% на кешированные prefill-токены; хранение чекпоинтов считается за гигабайт в месяц
Модели внутри плана: Inkling, Inkling-Small, Nemotron 3.5 Lightning, Nemotron 3 Ultra, Nemotron 3 Nano, Kimi K2.6, Qwen3.6-35B-A3B, Qwen3.6-27B, gpt-oss-120b, gpt-oss-20b
Что ещё внутри плана: Tinker