上个月初,让Hermes做了一个CronJob,每天晚上8点,由她总结我们之间讨论的小说构思及内容,通过QQ发给我。
最初使用的是驱动模型是deepseek Flash,运行正常。因为最近涨价且缓存读取率极低,所以昨天把模型换成GLM-5.3 Flash。结果QQ提示错误。让Hermes自己检查一下,发现是API超时所致。原先默认的是300秒,也就是说deepseek可以在5分钟之内完成任务,而GLM需要更长的时间。
于是让Hermes调整时间,一次又一次,直到调到了15分钟,系统才开始正常返回信息。
由此看来,最近使用Claude调用GLM速度慢,不只是感觉了。