来源:市场资讯
(来源:绝望的老爹)
高考结束了,最近有博主用AI去考了一遍高考题,不同的博主给出的结果是不一样的。看结果之前,大家猜猜AI能考到什么水平吧!
第一位测了语文和数学,结果12个模型,语文+数学分数在242-256之间,语文最高分只有122,而数学最高是136。
这个分数,折算一下,勉强能上个211吧。可能还没你家孩子考得好。
另一个博主测了数学,13个模型99-144分,就连数学这种应该是有标准答案的试卷,对于AI而言考高分竟然是这么难的事情。
这个博主应该是没给足够的提示,AI有点自由发挥了。最低居然才99分。
是不是感觉AI不过如此,可以把AI按在地上摩擦了。
这就跟机器人现在能做高难度动作,但回到日常任务,又一副不太聪明的样子。大道说的“八字还没有一撇”。
这个测试只有当天试卷刚出来的时候是有真实效应的。你现在去测,网上都有“标准答案”了,正常AI肯定也是获取了的。所以肯定也就不准了。
所以,即使顶级的AI,面对中国的高考,也就是能上211,最高水平也就是985,分数大概率是够不上清北复交的。
这一方面说明全国能正分考上清北的这些学子,确实是牛。
但也说明,AI没有想象的厉害。
我最近也做了一份线上的测试,一边做,一边用AI,结果做了七八次,反复提醒了细节,才终于通过了。
AI是会成为顶级人类,还是随着被“污染”得越来越厉害,最后泯然众人?
今年高考,这些AI大模型只能拿一个平平无奇的分数。
明年,是能考得更好,还是越来越平庸?越来越趋近于人类平均智商?
最近有人用AI“蒸馏”了巴菲特和段永平,想要复制他们的股市传奇,结果亏了30%,被套得死死的。
我个人不是在做投研么?我最近也发现,AI给出的结果不过是网上信息检索的一个整理,很多信息和数据都是错的,必须反复验证,反复跟AI对话,才能得到相对靠谱的答案。
这就有点类似,你招了一个员工,你得跟他高频绩效沟通,他才能给你一个相对满意的结果。
问题是,你的AI好像没有变得更聪明,没有不重新犯错的能力,所以你得重复的教,以至于你的提示词越写越长……
最后,你发现,你还是回去读财报,去实地走访靠谱。
最近大家又在神话白发魔女,如果这是AI那还是别信了,不过不是AI,那更别信了。
今天还有个热门话题是,如果AI误识了毒蘑菇,导致人中毒,谁该负责人?大家觉得谁该负责人?
因为人们对AI充满期待,以至于忍耐度极高,没有人去算细账,去正常点推演价值。可能也是要泡沫破一破,一地鸡毛,AI才能返璞归真,回到一个正常的发展之路上。
热门跟贴