必要性说明:
- 多个apiKey轮询,用于减缓提供商免费策略的速率限制 (插件里定义的都是免费模型)
- 独立插件,不同提供商的模型输出有问题时(比如 reason_content)可单独维护
- 不同提供商的模型输出速率(TPS)不同,适合不想跨提供商轮询
以下 多key轮询插件定义的都是免费模型
(有些提供商插件是当前限时免费)
免费模型列表:
| 模型id | 模型别名 | 说明 | 最大输出 | 最大输入 | 上下文 | 类型 | 接口 |
|---|---|---|---|---|---|---|---|
| deepseek-v4-flash | deepseek-v4-flash | Agentic Coding 模型,据评测反馈使用体验优于 Sonnet 4.5,交付质量接近 Opus 4.6 非思考模式,但仍与 Opus 4.6 思考模式存在一定差距。针对 Claude Code 、OpenClaw、OpenCode、CodeBuddy 等主流的 Agent 产品进行了适配和优化。 | 384k | - | 1024k | 文本 | /chat/completions |
| sensenova-6.7-flash-lite | sensenova-6.7-flash-lite | 轻量高效,兼顾效果、成本与落地性 原生多模态架构,支持图像输入理解(OCR、图表解读等) 办公场景增强,稳定支撑复杂长链路任务 Token 效率更优,复杂任务成本更可控 | 64k | 252k | 256k | 多模态 | /chat/completions |
| sensenova-u1-fast | sensenova-u1-fast | 基于 SenseNova U1 的加速版本,专供信息图(Infographics)生成场景,不支持图像输入 | - | 256k | 图像生成 | /images/generations |
2、Agnes:agnesmore: agnes-支持多key轮询
| 模型id | 模型别名 | 描述 | 最大输入 | 最大输出 | 最大思维链长度 | 上下文 | 类型 |
|---|---|---|---|---|---|---|---|
| agnes-2.0-flash | agnes-2.0-flash | 由 Sapiens AI 开发的一款快速、高效的语言模型,面向智能体工作流、工具调用、编程任务、推理、多轮对话、图片理解以及高频生产环境应用场景设计 | - | 65.5k | - | 256k | 多模态 |
| agnes-image-2.1-flash | agnes-image-2.1-flash | 由 Sapiens AI 开发的一款高性能图像生成与图像编辑模型,支持 文生图、图生图 和 多图合成 工作流,适用于快速创意生产、图像优化、营销视觉设计、电商产品图、社交内容生成以及专业视觉内容生产等场景 | 图像生成 | ||||
| agnes-video-v2.0 | agnes-video-v2.0 | 支持 文生视频、图生视频、多图视频生成 和 关键帧动画 工作流,可以通过文本提示词、图片 URL 或多张参考图片生成高质量视频。该模型适用于故事创作、营销视频、产品演示、社交媒体内容、App 动态素材以及 AI 创意工作流,采用异步任务式 API。你需要先创建视频生成任务,然后使用返回的 video_id 或 task_id 查询视频结果 |
视频生成 |
Agnes-2.0-Flash 已支持 1m 上下文
Agnes-Image-2.1-Flash 已支持 4K 超高清图片生成,最高能出 4096×4096 尺寸
官方文档:Agnes AI | Free Omni-Modal AI API, World-Class AI Models & AI Applications
使用不爽可提交 issues:GitHub - AgnesAI-Labs/Agnes-AI: Official Agnes AI gateway and model catalog for OpenAI-compatible text, image, video, and agent workflows. · GitHub
3、阶跃星辰:stepfunmore: stepfun-支持多key轮询
| 模型 ID | 上下文 | 说明 |
|---|---|---|
step-3.7-flash |
256K | 旗舰多模态推理模型,支持图片/视频理解,三档推理强度 |
step-3.5-flash-2603 |
256K | 高频 Agent 场景优化版,Token 效率更高 |
step-3.5-flash |
256K | 旗舰级推理模型,MoE 架构,擅长代码与工具调用 |
step-router-v1 |
256K (实测超过256K 会自动切换到 deepseek-v4-pro ,因此代码里定义的是1M上下文) | 智能路由模型,自动在 deepseek-v4-pro 与 step-3.5-flash 间切换 |
4、美团龙猫:longcatmore: 美团龙猫-支持多key轮询
| 模型名称 | 描述 | 最大输出 | 上下文 | 请求限制 |
|---|---|---|---|---|
| LongCat-2.0-Preview | 128K | 1024K | 500W/天 |
| 模型id | 说明 | 模型别名 | 最大输出 | 上下文 | 类型 | 请求限制 |
|---|---|---|---|---|---|---|
| glm-4.7-flash | 30B 级 SOTA 模型,面向 Agentic Coding 场景强化了编码能力、长程任务规划与工具协同,在执行复杂智能体任务,在工具调用时指令遵循更强 | glm-4.7-flash | 96k | 128k | 文本 | QPS:1 |
| glm-4-flash | 在实时网页检索、长上下文处理、多语言支持等方面表现出色,适用于智能问答、摘要生成和文本数据处理等多种应用场景。适用于 写作建议(情节构思、文字润色、推文、文案)、多语言翻译、结构化数据处理 | glm-4-flash | 16k | 128k | 文本 | QPS:200 |
| glm-4.6v-flash | GLM-4.6V 的免费版本,首次在模型架构中将 Function Call(工具调用)能力原生融入视觉模型,打通从「视觉感知」到「可执行行动(Action)」的链路 | glm-4.6v-flash | - | 128k | 多模态 | QPS:1 |
| cogview-3-flash | cogview-3-flash | 文生图 | QPS:1 | |||
| cogvideox-flash | cogvideox-flash | 视频生成 | QPS:3 |
6、英伟达:nvidiamore: nvidia-支持多key轮询
| 对外 key | 原始模型 | 上下文 | 最大输出 | 特点 |
|---|---|---|---|---|
deepseek-v4-flash |
deepseek-ai/deepseek-v4-flash |
1,000K | 393K | 推理+工具调用 |
deepseek-v4-pro |
deepseek-ai/deepseek-v4-pro |
1,000K | 393K | 顶级推理+工具调用 |
step-3.7-flash |
stepfun-ai/step-3.7-flash |
256K | 16K | 支持思考模式 |
step-3.5-flash |
stepfun-ai/step-3.5-flash |
256K | 16K | 支持思考模式 |
kimi-k2.6 |
moonshotai/kimi-k2.6 |
256K | 256K | 思考+视觉 |
minimax-m2.7 |
minimaxai/minimax-m2.7 |
200K | 131K | 230B-A10B MoE |
glm-5.1 |
z-ai/glm-5.1 |
200K | 131K | 支持思考模式 |
mistral-medium-3.5-128b |
mistralai/mistral-medium-3.5-128b |
256K | 256K | 思考+视觉 |
mistral-small-4-119b-2603 |
mistralai/mistral-small-4-119b-2603 |
128K | 8K | 支持思考模式 |
gpt-oss-120b |
openai/gpt-oss-120b |
128K | 8K | 支持思考模式 |
7、OpenRouter:openroutermore: openrouter-支持多key轮询
| 模型 key | OpenRouter 模型 ID | 上下文 | 最大输出 | 推理 | 视觉 |
|---|---|---|---|---|---|
nemotron-3-super-120b-a12 |
nvidia/nemotron-3-super-120b-a12b:free:nitro |
1,000,000 | 262,144 | ||
nemotron-3-nano-30b-a3b |
nvidia/nemotron-3-nano-30b-a3b:free:nitro |
262,144 | 262,144 | ||
nemotron-3-nano-omni-30b-a3b |
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free:nitro |
262,144 | 65,536 | ||
nemotron-nano-12b-v2-vl |
nvidia/nemotron-nano-12b-v2-vl:free:nitro |
131,072 | 131,072 | ||
gemma-4-31b-it |
google/gemma-4-31b-it:free:nitro |
262,144 | 32,768 | ||
laguna-xs.2 |
poolside/laguna-xs.2:free:nitro |
262,144 | 32,768 | ||
laguna-m.1 |
poolside/laguna-m.1:free:nitro |
262,144 | 32,768 | ||
nex-n2-pro |
nex-agi/nex-n2-pro:free:nitro |
262,144 | 262,144 | ||
north-mini-code |
cohere/north-mini-code:free:nitro |
262,144 | 65,536 |
8、OpenCode Zen:zenmore: OpenCodeZen-支持多key轮询
| OpenCode 模型 ID | API 模型 ID | 上下文 | 最大输出 | 模态 |
|---|---|---|---|---|
deepseek-v4-flash |
deepseek-v4-flash-free |
262,144 | 65,536 | 文本 |
mimo-v2.5 |
mimo-v2.5-free |
1,048,576 | 131,072 | 文本+图像 |
nemotron-3-ultra |
nemotron-3-ultra-free |
1,048,576 | 65,536 | 文本 |
north-mini-code |
north-mini-code-free |
262,144 | 65,536 | 文本 |
big-pickle |
big-pickle |
200,000 | 32,768 | 文本 |
怎么使用?
git clone ...
npm install
npm run build
打开OpenCode配置文件注册插件:写自己clone后的地址
类似的插件如何快速生成?使用技能:
OpenCode-多key轮询提供商插件 - 生成技能 - 已开源 - iFlow 补给站 - 心流AI交流社区
