OpenCode插件-devecocode-auth:好朋友们!免费使用华为的glm-5.1、glm-5

===============================

每个月模型上省下的钱可以拿出一部分支持一下【心流搜索】和【心流知识库】
https://www.iflow.cn/
https://platform.iflow.cn/pricingPage
说不定哪天心流高层一高兴就把我们心心念的 iflow cli 开源了呢 :grimacing:
OpenCode 在我这里一直都是替代品。

===============================

源码:devecocode-auth (修复了 JWT TOKEN 续期逻辑,现在授权后不会20分钟之后就过期,理论上30天)
不开源:开源的话用得人多了华为的服务器会变卡。

使用方式:
1、下载解压
2、OpenCode配置文件中:%USERPROFILE%\.config\opencode\opencode.json
写自己解压后的路径

3、命令行直接输入 opencode(windows gui用户 输入 opencode-cli)
4、打开opencode 后,输入 /connect → DevEco Code

进入授权登录流程:

|
这里 稍微等它一下:

显示模型列表:

注:

  • OAuth 流程:本地 HTTP Server + 华为账号授权 → JWT → accessToken

  • 自定义 fetch:注入 Bearer token、lang、Chat-Id 等必要请求头

  • Token 自动刷新:30 分钟过期自动续期

  • Async Resource Cleanup:server.close 超时 + closeAllConnections
    防止 OAuth 回调后悬空资源导致 TUI 崩溃

  • 5 个免费模型,全部 curl 实测验证可用

  • 文件日志:%USERPROFILE%.devecocode-auth\debug.log (需设置环境变量 DEBUG=1)

  • 凭证存储:%USERPROFILE%.devecocode-auth\auth.json

另一个华为的免费通道OC插件也更新了:主贴更新不了了,直接点 codearts-auth

4 个赞

实际就五个模型可用,留下这五个就行了,剩下的50多个都是默认回退到deepseek v3.2的。如果你要看源码,我一会可以去GitHub上面开源,但是源码和我在用的版本不同,还是50多个模型的,没更新。

模型 流式 非流式 备注
glm-5 :warning: 部分成功 :warning: 部分成功 触发速率限制(4M tokens/min)
GLM-5.1 :white_check_mark: :white_check_mark: 较慢但正常
Qwen2.5-VL-72B :white_check_mark: :white_check_mark: 正常
Qwen3_VL_235B_A22B_Instruct :white_check_mark: :white_check_mark: 正常
deepseek-v3.2 :white_check_mark: :white_check_mark: 正常
所有 5 个模型的流式和非流式传输都工作正常 :white_check_mark:。glm-5 的速率限制是平台侧的问题,不是插件 bug。

1 个赞

你说得对,我这个链接更新了

1 个赞

老哥你都这么玩了,那我这个krowork配置第三方API脚本我也得公开啊,向大佬学习,开源!

1 个赞

感觉这个地址不太对

搞错了我的天,我改了多次分享了多次,最后一次竟然搞错了,现在改好了

好多啊,有点挑不过来了,哈哈。

大佬分享出来让我们学习学习 :grimacing: :rose:

1 个赞

可不敢,我是小老弟,近期开源,我先在讯飞群卖几单回回本哈

1 个赞

这个glm5-.1是不是量化版本

glm-5.1是量化版本,w4a8,170k 上下文

佬,一直在用你发的,我现在感觉好像还是 joycode的最好用?你觉得呢

joycode 最新的免费限制是每天500万 tokens,超出后不会报错,而是降级处于排队,首token延迟高一点,因为官方服务端将所有 chunk块一次性响应,总体来说 joycode 的 glm-5 或 glm-5.1 作为子代理专门处理编码任务是非常不错的,毕竟是满血模型。

devecocode 的glm-5.1 是个 w4a8 的量化模型,170k上下文缩水30k,保持可接受范围的精度退化,但量化模型同时提升了吞吐量,作为glm-5.1本身能力毋庸置疑,吞吐量的提升进行代码调研任务是不错的,170k上下文也是足够的

codearts 的 glm-5 和 glm-5.1 都是满血模型,之前 codearts 有一个非常严重的问题,一旦上下文超过50k 模型请求会一进处于请求状态直到超时被OpenCode重试,最近使用感觉没有这个问题了,应该是官方修复了,这个插件项目更改了多次的授权登录流程,因为官方总是变更。

mimocode 只有一个 mimo-v2.5 模型本身能力不够,在国内处理垫底,可以看作笨笨的模型,但本身是个多模态模型,在处于图片识别方面有用(OMO放在 look_at 中),同时频繁的429限流错误也不能作为日常任务模型,只适合偶尔使用,我也将它作为 OpenCode 的自动压缩、摘要处理,毕竟它有1M上下文,可以单独作为自动压缩使用的模型

kiloccode 可以看作充值了$10的 openrouter 的 apikey,openrouter 的免费模型都可以定义在 kilocode-auth\src\constants.ts 中,需要自己实时修改,openrouter 的免费模型总是变化的,而且需要自己测,有些不能用,它里面有一个 nex-n2-pro 的模型是不错的,可能比较小众,大家没有听说过,它的能力甚至超越了 deepseek-v4-pro 将 glm-5.1 远远甩在身后(nex-n2-pro 基于 Qwen3.5 -397B-A17B 后训练)

响应速度 是很快的,大概是比较小众,大家都没有使用

我最近发了一些 more 结尾的 插件,比如 sensemore、agnesmore,是 多个 apikey 轮询使用的实现,为了减缓提供商对免费模型的速率限制,其中:

sensemore 的 deepseek-v4-flash 是我最常使用的主编排模型,1m上下文,没有上下文焦虑,商汤提供的这个模型最近响应也是变快了很多,尤其是晚上。白天 tps 输出速度可能会低一点。

agnesmore 提供了一个 agnes-2.0-flash 模型,虽然笨笨的,但毕竟是个多模态模型,可以用作图片理解,有时候截一个竞品页面某个组件的截图给OpenCode来实现组件样式,OMO是要调 look_at 来识别图片的,这个模型就这可以作为这个 look_at 角色。

longcatmore 是美团龙猫的,虽然每天有500万 tokens 的限制(两手机号就能注册两个美团,1天就是1000万),LongCat-2.0-Preview 这个模型本身大家目前也不看好,毕竟还是大厂出品,财力雄厚,现在缺的就是我们这些人给它输送训练数据。

像这些插件我都是开源的,毕竟不是逆向,是需要自己输入apikey的,可以关注下这个组织,这个组织下我都会不定时更新 新的more插件:opencode-plugin: OpenCode插件项目
最近更新了 zenmore 也就是 OpenCode Zen 的免费模型多key轮询插件,由于zen官方的免费模型会经常更新,因此也需要自己定时处理 src\constants.ts 免费模型列表。

1 个赞

哇,太详细了,感谢回复!

您 好,请教kiloccode的nex-n2-pro,速度怎么调快的,我的还有些慢

我们用的一样的插件,如果速度不一样说明是地区问题,kilo 用的openrouter 的免费模型,kilo与openrouter都是国外的,有些免费模型在国内不同地区访问情况可能不一样,还跟国内网络 运营商有关:电信、联通、移动

应该和网络有关,感谢

您 好,再请教一下, sensemore 输入多个 API Key,轮询,APIKEY需要不同账号吗?还是同一个账号多个APIKEY也可以?

建议是一个账号一个apikey,多个apikey使用不同账号的,这样请求次数是叠加的,如果是同一账号的多个apikey那么请求次数还是共享那一个账号的,因此轮询平摊没有意义

了解,感谢