免费模型 API 通常限制调用频率和额度,稳定性也不如付费服务。但用来做个人项目、写小工具或测试新想法,试错成本很低。最近试了几个新选择,整理出来供大家参考。
OpenCode Zen:Laguna S 2.1
OpenCode 是开源编程 Agent,其 AI 网关 OpenCode Zen 提供免费模型和不定期新模型限时体验。最近可以重点试试 Poolside 发布的 Laguna S 2.1——面向软件工程和编程 Agent 的 MoE 模型,总参数 118B,每 Token 激活约 8B,支持思考和非思考模式,最高 1M 上下文。官方测试显示它在长流程编程任务中能与更大规模模型竞争。

接口兼容 Chat Completions 格式。接入 Claude Code 或 Codex 需在 CCSwitch 中开启路由功能。此外 Zen 还长期提供多个免费模型。

官网:opencode.ai/zh/zen
API:https://opencode.ai/zen/v1/chat/completions
模型名:laguna-s-2.1-free
OpenRouter:Ling-3.0-flash
OpenRouter 最近上线了蚂蚁百灵的 Ling-3.0-flash,提供免费入口。这是 MoE 模型,总参数 124B,每 Token 激活约 5.1B,上下文 256K。强调 Token 效率和 Agent 场景,适合工具调用、文档处理、代码生成和轻量自动化任务。

免费调用分两档:零余额账户每日 50 次、每分钟 20 次;充值满 10 美元后,每日免费请求永久提至 1000 次,限速不变。OpenRouter 上也有 Laguna S 2.1,但上下文只有 256K。

模型页面:openrouter.ai/inclusionai/ling-3.0-flash:free
API 端点:https://openrouter.ai/api/v1
模型名:inclusionai/ling-3.0-flash:free
讯飞 MaaS:Qwen3-Embedding-8B
第三个是 Embedding 模型,专门用于文本向量化。支持最长 32K Token 输入,默认生成最高 4096 维向量,支持多语言和自定义指令。适合 RAG 知识库检索、文档语义搜索、文本相似度计算、文档聚类和去重、FAQ 问答匹配等场景。

讯飞 MaaS 的接入方式与普通聊天接口略有区别,需要先创建应用,再根据控制台提供的地址和鉴权信息进行配置。
平台地址:xinghuo.xfyun.cn/maas-home
选型建议
- 编程 Agent:先试 Laguna S 2.1(OpenCode Zen)
- 工具调用/轻量 Agent:试试 Ling-3.0-flash(OpenRouter)
- 知识库/语义检索:用 Qwen3-Embedding-8B(讯飞 MaaS)
免费 API 最大的优势是试错成本低,但调用额度、速度和稳定性都可能变化。建议先拿来做个人项目和原型验证。真正用于生产环境时,还需考虑服务稳定性、数据隐私和备用接口。涉及私有代码、客户资料和未公开文档时,建议先确认平台的数据政策。