⚡ api.latency_label
220ms (生成速度 300+ 字/秒)
全球已知最快推理硬件 LPU,秒级打字机输出
🎁 api.quota_label
每分钟 30 次 · 每天 14,400 次
永久免费 · 适合写插件、高频问答与实时对话
🛡️ 认证与门槛要求
官方原版权重 · 硬件直驱
Meta 与阿里开源标杆模型全速运行
📊 并发与上下文
30 RPM / 6,000 TPM
单分钟频次极高,响应体验无比丝滑
🔌 OpenAI 兼容接口地址 (Base URL)
https://api.groq.com/openai/v1
💡 在任何支持 OpenAI API 的客户端(如 NextChat、Cherry Studio、沉浸式翻译等)中,直接填入上方地址作为 Base URL 即可。
中文全能 qwen/qwen3.8-27b
通义千问高分版本,秒级输出
Meta旗舰 llama-3.3-70b-versatile
开源标杆 70B,推理深度优秀
高性价比MoE mixtral-8x7b-32768
欧洲开源标杆架构
💡 避坑与使用要点
每分钟 30 次 · 全球最快推理
300+ 字/秒,Llama 3.3 70B
1. 接口协议: 绝大多数现代大模型均全面兼容 OpenAI 格式。如果使用 Python,直接使用官方 openai SDK 即可无缝切换。
2. 线路类型: 标注为「🇨🇳 国内直连」的厂商在国内任何云服务器或本地家庭宽带均可秒级响应;标注「🌐 海外线路」的建议在海外 VPS 或具有相应网络环境下调用。
3. 本地存储安全: 在 FreeAI Dog 首页体验生活工具箱时,所有 Key 均严格保存在您的浏览器 localStorage 中,绝不上传任何第三方服务器。
💻 10秒接入代码示例 (Python OpenAI SDK)
from openai import OpenAI
client = OpenAI(
api_key="your_api_key_here", # 填入申请的 Key
base_url="https://api.groq.com/openai/v1"
)
response = client.chat.completions.create(
model="qwen/qwen3.8-27b",
messages=[
[object Object]
]
)
print(response.choices[0].message.content)