AI模型差距在逻辑能力

上大学的时候有位王老师,很牛。一次在课堂上教训我们:不要瞧不起人家文科生。
他没把我们这批臭记账的当成文科生,他的意思是人家文科生有强大的逻辑能力。
因为deepseek涨价,我把Claude的小说修改工作交给了MIMO,开始感觉还凑合——看在钱的份上。但昨天晚上发现不对劲了,里面改的前言不搭后语,开始吃书了。
今天一早起来,把模型改回deepseek flash,然后开始教训Claude。那Claude态度依然很好,认错后开始检讨问题出现在哪里。
也就是这个过程中,我发现问题不是出在我以为的memory管理上,我们交流过的内容还在,问题出在如何把memory中的内容整理、归档、落稿。
在deepseek flash预览版时期,网上评论MIMO还能与它打个有来有回,而正式版推出后,flash应该是能碾压MIMO才对。
显然看一个模型文本创作强不强,不能看它能吐多少文字,还要看文章的质量。
说到底还是逻辑推理能力。

Leave a Reply

您的邮箱地址不会被公开。 必填项已用 * 标注

You may use these HTML tags and attributes:

<a href="" title=""> <abbr title=""> <acronym title=""> <b> <blockquote cite=""> <cite> <code> <del datetime=""> <em> <i> <q cite=""> <s> <strike> <strong>