Together AI 宣布 9 月把 H100 Dedicated Inference 从每小时 5.49 美元降至 3.99 美元,新旧部署自动生效。可部署 Gemma 4、Qwen3/3.5、gpt-oss、Llama、Nemotron 3.5 Lightning,或自带 LoRA 跑微调模型。对需要稳定吞吐、不愿与共享端点抢容量的编码智能体与微调产物,专属推理的小时价下调直接压低 7×24 托管成本。

核心要点速览 (Key Takeaways)

  • H100 专属推理 9 月从 5.49 美元/时降至 3.99 美元/时,新旧部署自动降价。
  • 可部署 Gemma 4、Qwen3/3.5、gpt-oss、Llama、Nemotron 3.5 Lightning,或自带 LoRA。
  • 适合需要隔离容量的生产推理与微调模型托管,无需迁端点即可享受新价。
ADSponsored