产品介绍
Groq 是什么?
Groq 是围绕 Language Processing Unit,即 LPU 构建的 AI 推理服务商。LPU 是专为推理设计的定制处理器。GroqCloud 让开发者和组织访问运行在 LPU 技术栈上的支持模型,重点是可预测速度、低延迟和生产工作负载的成本效率。
平台在多个地区的数据中心运行推理基础设施。开发者可获取 API key、选择可用模型,并将文本生成或推理能力集成到应用中。企业用户可与 Groq 讨论部署、规模、可靠性和区域要求。
如何使用 Groq
- 创建 GroqCloud 开发者账户并获取 API key。
- 查看当前可用模型及其能力。
- 根据应用的延迟、质量、上下文和成本要求选择模型。
- 将推理 API 集成到应用或智能体工作流。
- 在真实流量下测量回复质量、吞吐、延迟和费用。
- 生产需求增加时升级企业容量或部署支持。
核心功能
- LPU 推理硬件: 使用围绕语言模型推理设计的定制芯片。
- GroqCloud: 提供 Groq 技术栈上支持模型的托管访问。
- 低延迟生成: 面向交互式和实时应用提供快速回复。
- 开发者 API: 让软件团队将托管模型推理加入产品和智能体。
- 全球基础设施: 在多个地区数据中心运行 LPU 系统。
- 企业支持: 处理生产规模、可靠性和组织要求。
使用场景
- 对话式 AI: 降低聊天机器人和语音应用的回复延迟。
- AI 智能体: 在工具调用和多步骤工作流中运行重复模型调用。
- 实时分析: 为延迟敏感运营生成决策或摘要。
- 开发者产品: 无需运营 GPU 基础设施即可添加托管语言模型功能。
- 高吞吐推理: 服务重视速度和单位经济性的模型工作负载。
价格
Groq 为开发者提供免费 API key,并链接到支持模型的按量价格。具体模型价格和速率限制会变化,开发者在估算生产成本前应确认实时 GroqCloud 价格表。
常见问题
LPU 是什么?
它是 Groq 专为 AI 推理设计的定制处理器架构。
Groq 会训练其提供的模型吗?
首页重点是推理基础设施和对支持模型的访问,而不是单一自有模型系列。
开发者无需企业合同也能试用吗?
可以。开发者导航提供免费 API key 和直接开始构建的路径。


