宣布8亿美元C轮融资,加速开源AI转型
Announcing our $800M Series C to accelerate the shift to open-source AI
Together AI 宣布完成 8 亿美元 C 轮融资,投资方包括 Aramco Ventures、NVIDIA、Vista Equity 等机构,并获超 500 MW 算力容量承诺。该公司围绕开源 AI 构建全栈平台,提供推理、训练及加速计算服务,客户包括 Cognition、Decagon、Eleven Labs、Cursor 和 Suno。其技术栈涵盖 FlashAttention-4、Together Megakernel 及 together.compile,支持开放权重模型如 DeepSeek、Nemotron,使企业推理成本降低 6 至 20 倍。
四年前,我和联合创始人共同创立了 Together AI,因为我们视生成式 AI 为人类进步的转折点。我们相信,这一代际技术应当开放且广泛可用,而非由少数几家公司掌控。
自那时起,我们围绕开源 AI 构建了一个全栈 AI 平台,以前沿研究为基础,为 AI 应用和 agent 提供最快、最高效的推理服务。如今,Together AI 已获得数千家客户的信赖,其中包括许多全球增长最快的 AI 公司,如 Cognition、Decagon、Eleven Labs、Cursor 和 Suno。当初对 AI 未来的信念,其发展速度甚至超出了我们最乐观的预期。
今天,我很高兴地宣布我们旅程中的下一个里程碑——8 亿美元 C 轮融资,投资方包括 Aramco Ventures、NVIDIA、Vista Equity、General Catalyst、Emergence Capital、Schneider Electric、和硕联合科技、Salesforce Ventures、March Capital、DTCP Growth、Lux Capital、Geodesic、PSP Partners 等杰出机构。除股权资本外,我们还获得了超过 500 MW 算力容量的承诺,将由新投资者独立出资,以支持我们未来几年的预期算力增长。
生产级 AI 的经济学
随着 AI 系统开始执行真正的智力劳动,它们正从偶尔使用的工具转变为核心生产基础设施。企业不再仅为演示生成少量回复,而是部署能够编写代码、解决客户问题、分析文档并自动化整个工作流的 agent。随着这类工作规模扩大,对推理的需求也随之增长。
许多公司发现,这带来了根本性的经济挑战。封闭前沿大语言模型(LLM)在原型阶段看似可控的成本结构,在生产环境中往往变得不可持续。随着使用量增长,推理账单的累积速度超过预算增长,迫使企业在智能需求加速时反而限制其使用。最成功的公司正以市场一贯的方式应对:寻找更高效的方式来生产日益关键的资源。
Together AI 已成为开放和定制 AI 的生产平台,将前沿模型与推理栈的持续创新相结合,在大规模下提供最佳经济性。像 DeepSeek、Nemotron、MiniMax、Kimi 和 GLM 这样的开放权重模型,已缩小了与专有前沿模型的质量差距,同时赋予开发者自由定制和微调模型以适应自身应用的能力。因此,使用开放模型构建应用的公司,通常能将成本降低 6 到 20 倍,同时保持同等或更优的性能。例如,Decagon 在迁移到 Together AI 后,推理成本降低了六倍。
但生产级 AI 的经济性并非仅由模型决定,而是由整个技术栈决定:模型、kernel、编译器、推理系统、训练基础设施、硬件利用率,以及将所有部分整合在一起的软件。
Together AI 是一家研究驱动型公司。过去几个季度,我们的研究到生产转化流程显著加速。我们发布了面向 NVIDIA Blackwell 的 FlashAttention-4、Together Megakernel 和 together.compile,将 kernel 级优化引入生产工作负载,并扩展了后训练 API 以支持工具调用、推理和视觉语言模型。我们推出了领先前沿开源模型的最快端点,并已成为全球最大的 AI token 生产者之一。
我为我们所构建的平台感到自豪,它提供了选择、控制、优越的经济性以及前沿性能,覆盖推理、训练和加速计算的全套生成式 AI 生产能力,同时也为 Together AI 在加速创新和向全球交付开源 AI 生态系统方面所扮演的角色感到自豪。
致我们的客户、团队和投资者:感谢你们相信这一愿景,并帮助我们将其变为现实。这一里程碑当然值得庆祝,但它更像是一个开始。我们仍处于这场将重塑每个行业的技术变革的最早期阶段。
如果我们的愿景引起你的共鸣,请联系我们——我们正在工程、研究、产品和市场推广等多个领域招聘。