首页/Groq
Groq LPU AI 推理平台图标

Groq

Groq 是 AI 推理平台,将专用 LPU 硬件与 GroqCloud 结合,通过开发者和企业基础设施以低延迟、低成本运行支持的语言模型。

访问网站
GroqCloud 在 LPU 基础设施上提供高速模型推理

产品介绍

Groq 是什么?

Groq 是围绕 Language Processing Unit,即 LPU 构建的 AI 推理服务商。LPU 是专为推理设计的定制处理器。GroqCloud 让开发者和组织访问运行在 LPU 技术栈上的支持模型,重点是可预测速度、低延迟和生产工作负载的成本效率。

平台在多个地区的数据中心运行推理基础设施。开发者可获取 API key、选择可用模型,并将文本生成或推理能力集成到应用中。企业用户可与 Groq 讨论部署、规模、可靠性和区域要求。

如何使用 Groq

  1. 创建 GroqCloud 开发者账户并获取 API key。
  2. 查看当前可用模型及其能力。
  3. 根据应用的延迟、质量、上下文和成本要求选择模型。
  4. 将推理 API 集成到应用或智能体工作流。
  5. 在真实流量下测量回复质量、吞吐、延迟和费用。
  6. 生产需求增加时升级企业容量或部署支持。

核心功能

  • LPU 推理硬件: 使用围绕语言模型推理设计的定制芯片。
  • GroqCloud: 提供 Groq 技术栈上支持模型的托管访问。
  • 低延迟生成: 面向交互式和实时应用提供快速回复。
  • 开发者 API: 让软件团队将托管模型推理加入产品和智能体。
  • 全球基础设施: 在多个地区数据中心运行 LPU 系统。
  • 企业支持: 处理生产规模、可靠性和组织要求。

使用场景

  • 对话式 AI: 降低聊天机器人和语音应用的回复延迟。
  • AI 智能体: 在工具调用和多步骤工作流中运行重复模型调用。
  • 实时分析: 为延迟敏感运营生成决策或摘要。
  • 开发者产品: 无需运营 GPU 基础设施即可添加托管语言模型功能。
  • 高吞吐推理: 服务重视速度和单位经济性的模型工作负载。

价格

Groq 为开发者提供免费 API key,并链接到支持模型的按量价格。具体模型价格和速率限制会变化,开发者在估算生产成本前应确认实时 GroqCloud 价格表。

常见问题

LPU 是什么?

它是 Groq 专为 AI 推理设计的定制处理器架构。

Groq 会训练其提供的模型吗?

首页重点是推理基础设施和对支持模型的访问,而不是单一自有模型系列。

开发者无需企业合同也能试用吗?

可以。开发者导航提供免费 API key 和直接开始构建的路径。

返回产品导航

相关产品

OpenAI Codex 是面向软件开发的 AI 编程产品,适合委派边界清晰的仓库任务并审阅其代码变更。

Claude Code 是 Anthropic 的 AI 编程产品,适合通过支持的开发界面在代码库中持续迭代。

Gemini CLI 是 Google 的开源 AI 终端产品,适合本地开发与命令行工作流。

邮件订阅

持续发现实用 AI 产品

定期接收精选产品、真实使用场景和开发者动态。