Google Gemini
Google 出品,Gemini Flash 永久免费
Google Gemini API 提供免费的 Gemini 1.5 Flash / 2.0 Flash 等模型,支持文本、图像、音频、视频多模态输入,是当前最值得使用的免费大模型 API 之一。
多模态理解
100万+ Token 上下文
免费 Flash 模型
OpenAI 兼容
Groq 使用自研 LPU 推理芯片,提供极高推理速度(每秒数百 Token),免费层支持 Llama、Mixtral、Gemma 等开源模型,是低延迟场景的首选。
极速推理(500+ TPS)
OpenAI 兼容
多模型可选
永久免费层
Cerebras 基于自研 Wafer Scale Engine 晶圆级芯片提供推理服务,免费层支持 Llama 3 系列、Qwen3 等模型,速度极快,适合批量任务。
晶圆级芯片
超高吞吐
Llama 系列免费
OpenAI 兼容
SambaNova
RDU 自研芯片,免费 Llama 405B
SambaNova Cloud 提供免费的 Llama 3.1 405B、70B、8B 等超大模型推理,自研 RDU 芯片速度惊人,是免费体验最强开源模型的好去处。
免费 405B 巨兽
RDU 芯片
Llama 全系列
OpenAI 兼容
Together AI
$5 免费额度,200+ 开源模型
Together AI 提供 200+ 开源模型的 API 服务,新用户注册赠送 $5 免费额度,支持 Llama、Qwen、DeepSeek、Mixtral 等主流开源模型,性价比极高。
200+ 模型
$5 赠金
微调服务
OpenAI 兼容
Cloudflare Workers AI
全球边缘网络,每天 10000 次免费
Cloudflare Workers AI 在全球边缘节点提供大模型推理,每天免费 10000 次神经元计算,支持 Llama、Mistral、Qwen 等模型,全球低延迟。
全球边缘节点
10000 次/天
REST & Worker API
无需服务器
HuggingFace Inference API
开源模型仓库,免费推理 API
HuggingFace 提供免费的 Inference API,可调用平台上海量开源模型,包括 Llama、Qwen、Mistral、DeepSeek 等,是研究、测试开源模型的最佳平台。
百万模型仓库
免费推理 API
Serverless 调用
多模态支持
Mistral AI
欧洲大模型,免费 La Plateforme
Mistral AI 是欧洲领先的大模型公司,提供 Mistral Large、Small、Nemo 等模型,La Plateforme 平台有免费额度,部分模型可自由调用。
欧洲合规
开源权重模型
函数调用
OpenAI 兼容
GitHub Models
GitHub 出品,免费体验 GPT-4o
GitHub Models 面向开发者提供主流大模型的免费体验,包括 GPT-4o、Llama、Phi、Mistral 等,通过 GitHub Token 即可调用,每日有免费额度。
GPT-4o 免费
GitHub Token 鉴权
低代码集成
Playground
永久免费
OpenRouter 是大模型聚合 API 网关,统一接口调用 200+ 模型,提供部分完全免费的模型(如 Llama、Mistral),新用户赠送少量免费额度。
统一 API
200+ 模型
部分模型免费
OpenAI 兼容
NVIDIA NIM
NVIDIA 出品,1000 次免费调用
NVIDIA NIM 平台提供 Llama、Mistral、Qwen 等开源模型的免费推理 API,注册即送 1000 次调用额度,是体验 NVIDIA 推理优化的好选择。
NVIDIA 推理优化
TensorRT-LLM
OpenAI 兼容
微调支持
Meta Llama API
Meta 官方 Llama API 免费预览
Meta 推出官方 Llama API,目前以免费预览模式面向全球开发者开放,可测试最新的 Llama 4 Scout 和 Maverick 模型,速度极快。
Meta 官方
Llama 4 首发
Cerebras/Groq 后端
免费预览