Together AI

Together AI

Together AI

LLM推理加速美国旧金山
官网

产品矩阵

公司产品与解决方案一览

Batch Inference

Batch Inference

面向大规模异步批处理负载的推理服务,单模型可扩展处理海量 token 数据。

LLM推理离线批量推理海量文本处理异步任务处理异步批处理大规模推理海量Token处理模型扩展
Dedicated Model Inference

Dedicated Model Inference

独享硬件资源的模型推理服务,提供预留吞吐与 99% 可用性 SLA,兼容现有 API。

LLM推理企业级模型推理高可用生产部署API兼容迁移专属推理服务独享硬件资源预留吞吐99%可用性SLA兼容现有API
Fine-Tuning 微调服务

Fine-Tuning 微调服务

基于前沿研究技术的开源模型微调服务,改善准确率、减少幻觉并控制行为。

模型定制模型定制开源模型优化开源模型微调模型定制准确率优化减少幻觉
GPU Clusters

GPU Clusters

自服务即时集群到数千卡 GPU 的算力服务,经 Together Kernel Collection 深度优化。

算力LLM推理加速GPU算力服务自服务即时集群大规模GPU算力Together Kernel Collection优化LLM推理加速
Serverless Inference

Serverless Inference

按调用付费的开源模型托管推理服务,无需管理基础设施即可生产级运行大模型。

LLM推理大模型推理开源模型托管生产级部署开源模型托管按调用付费免基础设施管理生产级推理

数据口径:公开披露信息交叉整理,以物界前沿公司库收录为准返回公司简介 →