希望统计页面可以加上api速度

直接在下面加上速度 (输出Token/API时间)

这个实现的比较简单

我之前手动算过。glm4.6很快(接近80tok/s),但是kimi k2就慢了,每秒20tok。
现在感觉速度差不多就懒得算了,让它慢慢跑吧哈哈

话说不知道为啥不上 qwen3-coder-next,这个模型非常快,刚提交直接就出一大篇内容了,感觉用来做 subagent 和做一些简单小任务挺合适,现在全是高性能模型,无论复杂简单都要等很久 :joy:

coder next我是支持的。a3b性能就这么吊。这玩意小,快,还不笨,某些任务给个sub agent再适合不过。(难的任务sub agent感觉还是不太行。主agent也不太行)可以说它很好地填补了模型的生态位。简单的任务也不敢交给那个rome你说是吧,但这个coder就很合适。
qwen还是适合练小模型。不过现在模型太多了有点,我估计不会支持的。有算力的话后面也要给ds v4、kimi k3、glm 5.x这种吧。

那没办法了,只能期待下一代 iflow-rome 能给力点了

rome太小。而且30b性能其实也就那样,不过还是很有潜力的的。现在sota应该是glm4.7flash吧,哪天rome给我们干个sota出来就真的起飞了哈哈

确实,这些模型太笨重了