Together AI снизила аренду ускорителя H100 с 5,49 до 3,99 доллара в час

Together AI снизила цену выделенных вычислений на ускорителях H100 с 5,49 до 3,99 доллара в час — на сентябрь. Скидка применяется автоматически и к новым, и к уже работающим установкам.
Выделенный доступ — это когда ускоритель арендуется целиком под ваши задачи, а не оплачивается по числу запросов. На таких мощностях компания предлагает запускать открытые модели: gemma 4, qwen3 и 3.5, gpt-oss, llama, nemotron 3.5 — либо своё дообучение поверх них.
Together AI@togethercompute
for september, we’re cutting the price of Dedicated Inference on H100s from $5.49/hr to $3.99/hr new + existing deployments get the lower price automatically deploy gemma 4, qwen3/3.5, gpt-oss, llama, nemotron 3.5 lightning models, or bring your own lora for a fine-tuned model https://t.co/TcBeBzXUhx
621 сентября 2026