N°587
PROVIDER DETAIL · 提供商详情
Updated · 2026.07.26
Cerebras
WSE 晶圆级引擎,超高通量
国际厂商
5
Views · 浏览
Cerebras 基于自研 Wafer Scale Engine 晶圆级芯片提供推理服务,免费层支持 Llama 3 系列、Qwen3 等模型,速度极快,适合批量任务。
SECTION · 01
关键信息一览
免费额度
免费层:30 RPM / 60 RPH
使用限制
需海外网络,按分钟/小时限速
网络要求
需海外网络
访问需自备海外网络环境
所属分组
国际厂商
模型列表
llama-3.3-70b
llama-4-scout
qwen3-32b
收录时间
2026-07-26
SECTION · 02
特色功能标签
晶圆级芯片|超高吞吐|Llama 系列免费|OpenAI 兼容
SECTION · 03
详细介绍
Cerebras 是一家美国 AI 芯片公司,以自研的 Wafer Scale Engine(WSE)晶圆级芯片闻名。WSE 是目前最大的 AI 芯片,单芯片集成了 4 万亿晶体管,能够提供极高的推理吞吐量。
核心优势
- 晶圆级芯片:WSE-3 单芯片 4 万亿晶体管,推理速度行业领先
- 超高吞吐:单次可处理大批量请求,适合企业级应用
- Llama 系列免费:支持 Llama 3.3 70B、Llama 4 Scout 等模型
- OpenAI 兼容:直接替换 base_url 即可使用
免费额度
- 30 RPM(每分钟请求数)
- 60 RPH(每小时请求数)
- 支持 Llama 3.3 70B、Qwen3 32B 等模型
- 最大上下文 128K Token
接入方式
from openai import OpenAI
client = OpenAI(
api_key="YOUR_CEREBRAS_API_KEY",
base_url="https://api.cerebras.ai/v1"
)
response = client.chat.completions.create(
model="llama-3.3-70b",
messages=[{"role": "user", "content": "Hello!"}]
)