Skip to content

Fireworks AI

Fireworks AI 是一家总部位于美国加利福尼亚州雷德伍德城的生成式 AI 基础设施公司,成立于 2022 年,由前 Meta AI 工程总监 Lin Qiao(CEO)创立。公司专注于提供快速、高性价比的开源大语言模型(LLM)推理服务,定位为开发者和企业运行开源模型的首选 Serverless 平台。

核心产品

Serverless 推理平台

  • 开源模型支持:Llama、Mixtral、Qwen 等主流开源模型的即时调用
  • 低延迟:FireAttention 技术优化模型服务延迟
  • 高吞吐:针对高并发场景优化的推理引擎
  • 开发者友好:简单的 API 接口,几分钟内即可集成

FireAttention

Fireworks 自研的注意力机制优化技术:

  • 内存优化:减少 KV Cache 内存占用
  • 计算效率:提升注意力层的计算吞吐量
  • 动态批处理:智能请求批处理,提升 GPU 利用率

模型定制服务

  • 微调(Fine-tuning):针对特定任务的模型定制
  • 自定义部署:私有模型在企业环境中的专属部署
  • 模型混合:支持多个模型的组合与路由

公司背景

项目详情
成立时间2022 年
总部美国加利福尼亚州雷德伍德城
创始人Lin Qiao(CEO,前 Meta AI 工程总监)
融资总额约 7700 万美元
估值5.52 亿美元(2024 年 B 轮)
主要投资者Sequoia Capital、Benchmark、NVIDIA(NVentures)、Snowflake Ventures、Databricks Ventures

关键里程碑

  • 2022 年:由前 Meta AI 团队创立
  • 2023 年:Serverless 推理平台上线
  • 2023 年:完成 2500 万美元 A 轮融资(Benchmark 领投)
  • 2024 年:完成 5200 万美元 B 轮融资(Sequoia Capital 领投),估值 5.52 亿美元
  • 2024 年: reportedly 达到 1 亿美元年收入运行率
  • 2024 年:扩展企业客户群和模型支持范围

重大合作

  • NVIDIA:技术合作伙伴与投资方(NVentures)
  • Databricks:集成合作与投资方
  • Snowflake:合作伙伴与投资方
  • Meta:创始团队来自 Meta,对 Llama 模型有深度优化

与同类产品的区别

相较于 Together AI、Replicate 等开源模型推理平台,Fireworks AI 的核心差异在于:

  • 速度优先:FireAttention 技术显著降低推理延迟
  • Meta 基因:创始团队来自 Meta AI,对开源模型有深度技术理解
  • 企业级性能:声称达到 1 亿美元收入运行率,验证企业市场需求
  • 全明星投资者:Sequoia、NVIDIA、Databricks、Snowflake 同时投资

相关页面

  • Together AI — 开放模型训练与推理云平台
  • Replicate — 开源模型托管与 API 运行平台
  • Groq — LPU 推理芯片,超低延迟 LLM 推理
  • NVIDIA — 技术合作伙伴与投资方

AI Knowledge Base — 持续积累