离线AI能蠢到什么地步?
最近几天各家AI大模型你家唱罢我登场,那叫一个忙的不亦乐乎。
大模型发布潮
- Meta Llama3 系列:从8b到70b,着实火了一把。从一发布开始的当天晚上就有网友放出中文量化版。整天说被限制了买不到高端显卡,给我的感觉就是这届网友真有钱。
这位大佬指定家里有矿,A800,还是4张,每张80GB显存,羡慕嫉妒恨啊。
- 微软 Phi3 Mini 3B:模型太小,基本就是个摆设。
- 阿里巴巴 Qwen 110B:这个真牛逼,牛逼到上面那四张A800才跑的动,也只是勉强跑的动,民用显卡根本不敢说话。
- 苹果公司:就连一向闭口不谈AI的苹果公司也按捺不住,而且一口气发布了4个模型,当然了,也是看客级别的。
测试实录:从对答如流到“泣不成声”
近几天着重测试了 Meta Llama3 8B 版本。寻常问题都是对答如流的,就这个体量的模型,有这个能力,已经很不错了,当然还有巨大的潜力。
今天我给模型下达了几乎不可能的任务,看起来模型完成的非常好,不信你跟着往下看:






然而,模型大概被我气到了:

已经泣不成声了:

几乎不能回答完整了:

总结与评分
如果需要我打分的话,给 40分 吧(满分120分的那种)。我认为未来一年优化后可能达到70分左右。
结论: 目前离线模型几乎没什么用。再等一年吧,一年后估计有较大改观。
评论 (0)