从周六开始,发现deepseek Flash的费用飙升,查看了一下使用记录,问题出在缓存读取率出奇的低,而且都是频繁低量输入。不止是Claude,hermes同样如此,这就怨不得agent了。
通过CC switch,把GLM跟Qwen最新Flash模型加入到Claude模型列表中。切换到GLM,Claude下缓存读取率正常,而且其逻辑推理能力似乎要强于deepseek,分析小说时不止是上下文记忆,对不点名的人物推断能力也明显更强。
相比而言,Qwen3.8 flash的表现就堪称糟糕了。先是开篇总结就结结巴巴(断行),后面直接拒绝服务了,TMD的说我小说里有不合规的内容。去他大爷的,我这小说可是是经过简书变态内容审核的。
根据Qwen以往本地模型的表现,其Flash模型一脉相承的表现也在我预料之中,反正吹牛不上税。