
Together AI
Together AI 是面向开发者和企业的 AI 云平台,提供开放权重模型的 API 推理、模型微调、部署以及 GPU 算力等服务,支持构建和运行各类生成式 AI 应用。
详细介绍
Together AI 是一个面向开发者和企业的 AI 云平台,主要提供开放权重(Open-Weight)AI 模型的推理、部署、微调和 GPU 计算服务。平台以 AI 应用开发和生产部署为核心,通过 API、模型服务和计算基础设施,让开发者能够在无需自行搭建复杂 GPU 环境的情况下使用和部署多种先进 AI 模型。
Together AI 提供丰富的模型与推理能力,支持文本、视觉、图像、视频和音频等多种模态,并提供 Embeddings、Rerank、内容安全审核以及语音转文字、文字转语音等相关 API。官方文档显示,平台提供 100+ 个开放模型,并通过统一的推理 API 进行调用,开发者可以根据不同应用需求选择合适的模型。
在模型调用方面,Together AI 提供 Serverless Inference(无服务器推理) 和 Dedicated Inference(专用推理) 等方式。Serverless 模式无需自行配置 GPU,按照实际模型使用量计费,适合模型测试、原型开发以及流量变化较大的应用;Dedicated Inference 则提供单租户 GPU 资源、自动扩缩容以及生产环境部署能力,更适合稳定、高并发和对性能要求较高的业务。
Together AI 还提供模型微调能力,开发者可以使用自有数据对支持的开放模型进行 Fine-Tuning,并将微调后的模型进一步部署用于推理。目前平台提供 LoRA、全量微调以及包括监督微调和偏好优化在内的训练方式,可用于打造更加符合特定业务需求的模型。
除了模型推理和微调,Together AI 还提供 GPU Clusters、Code Sandbox、Code Interpreter 等基础设施和开发能力,可用于模型训练、大规模批处理、代码执行以及 AI 应用开发。GPU 集群支持包括 NVIDIA H100、H200、B200 等在内的 GPU 资源,开发者可以根据训练和计算需求选择相应的算力。
在 API 生态方面,Together AI 提供与 OpenAI API 兼容的接口,并支持 Python、TypeScript、cURL 等方式调用,方便开发者将现有 AI 应用接入不同的开放模型。平台同时提供批量推理、函数调用、图像生成、视频生成、视觉理解、语音处理以及 Embeddings 等能力,可用于聊天机器人、AI Agent、内容生成、代码开发、RAG 和多模态应用等场景。
在计费方式上,Together AI 的 Serverless 模型主要按照输入和输出 Token 等实际使用量计费,不同模型价格不同;图像、视频和音频模型则根据图片、视频或音频等具体用量计费。Dedicated Inference 主要按照 GPU 使用量计费,此外还提供按预留吞吐能力计费的 Provisioned Throughput,适合对稳定容量和服务等级有要求的生产应用。具体价格会随着模型和服务变化,以官方定价页面为准。
总体来看,Together AI 并不是单纯的 AI 模型网站,而是一个围绕开放权重模型构建的完整 AI 基础设施平台,覆盖模型调用、生产部署、模型微调、GPU 算力以及相关开发工具。对于希望使用多种开放模型、构建 AI Agent、开发生成式 AI 应用,或希望自行微调和部署模型的开发者与企业,Together AI 提供了较为完整的一站式解决方案。
网站预览
