FreeTokens 导航
海外主流正常可用

Groq LPU 极速推理Groq LPU Acceleration

基于自研 LPU 架构的全球极速推理平台,生成速度超 500-800 tokens/秒,永久提供免费层!

核心免费额度
永久免费层 30 RPM / 14,400 RPD永久免费

永久提供 30 RPM 与每日 14,400 次请求免费额度,极速体验极佳。

刷新周期:每日刷新

申领条件与风控要求

手机验证免绑手机
信用卡绑定免绑信用卡
网络环境全球直连
并发限制RPM 无特殊限制 · TPM 无限制

免费可用模型

llama-3.3-70b-versatilellama-3.1-8b-instantdeepseek-r1-distill-llama-70b

10 秒快速接入代码

from openai import OpenAI

# 1. 初始化客户端(使用 Groq LPU 极速推理 专属 API 接口地址)
client = OpenAI(
    api_key="YOUR_API_KEY",  # 填入申请到的 Groq LPU 极速推理 API Key
    base_url="https://api.groq.com/openai/v1"
)

# 2. 发起对话请求(使用官方免费支持的模型)
response = client.chat.completions.create(
    model="llama-3.3-70b-versatile",
    messages=[
        {"role": "user", "content": "你好!请用一句话介绍你自己。"}
    ]
)

print(response.choices[0].message.content)
curl https://api.groq.com/openai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer YOUR_API_KEY"   -d '{
    "model": "llama-3.3-70b-versatile",
    "messages": [{"role": "user", "content": "你好!"}]
  }'
import OpenAI from "openai";

// 1. 初始化客户端
const openai = new OpenAI({
  apiKey: "YOUR_API_KEY",
  baseURL: "https://api.groq.com/openai/v1",
});

// 2. 发起请求
const response = await openai.chat.completions.create({
  model: "llama-3.3-70b-versatile",
  messages: [{ role: "user", content: "你好!" }],
});

console.log(response.choices[0].message.content);

避坑提示与风控防范

  • 免费层受限于严格的 TPM 限制,适合单轮高频交互。
FreeToken 官方公众号二维码