极速推理的 AI 芯片与云服务
Groq 以其自研的 LPU 推理芯片提供极快的模型响应速度,在实时问答与对话类应用中体验突出。它提供主流开源模型的 API,按 token 计费且延迟极低。
信息更新时间:2026-09-20。本站仅提供工具索引,具体功能、价格与授权请以 官方网站 公示为准。
实时对话、语音助手、低延迟应用、批量推理
如果你正在对比同类产品,可以看看下方推荐的替代工具,或直接浏览 AI 模型与平台 分类下的全部工具。
它使用自研的 LPU 推理架构,针对语言模型的串行推理做了专门优化。
提供开发者免费额度,超出后按 token 用量计费。
Claude 模型的官方开发与计费平台
节点式图像生成工作流工具
Gemini 模型的官方实验与开发平台
免费可用的云端 Jupyter 笔记本环境