近期,以色列特拉维夫大学的一项研究揭示了AI存在数字认知障碍的现象,类似于早期老年痴呆的症状。科学家对全球几乎所有顶尖的AI大型语言模型进行了全面测试,发现这些模型普遍存在认知障碍,且版本越旧的模型表现越差。这一发现表明,AI在医疗等领域完全替代人类医生可能还为时过早。
在这项研究中,科学家采用了常用于老年痴呆症测试的蒙特利尔认知评估量表,对多种公开的领先大型语言模型进行了评估,其中包括ChatGPT和Gemini等模型的新旧版本。测试满分为30分,得分在26分或以上被认定为正常。然而,测试结果显示,仅有GPT-4o获得了最高的26分,GPT-4紧随其后得25分,而Gemini1.0的得分仅为16分。
研究还发现,几乎所有被测模型在视觉空间能力和执行任务方面均表现不佳,且缺乏同理心。这一发现引发了人们对AI未来发展和应用的进一步思考,尤其是在需要高度认知能力和同理心的医疗等领域。科学家表示,未来需要加强对AI模型的认知训练和优化,以提高其性能和适用性。
上一篇:LeCun最新访谈:距离AGI可能不到10年,下一代AI需要情感和视觉训练
下一篇:段宇:加快“人工智能+”研究 开拓“数实融合”新机遇
聚焦智能天文光学系统,打造人类“天眼”。
一家机器人公司如何穿越行业“死亡谷”?
教师职业三重变革:从编制铁饭碗到流量新战场,谁在定义未来教育者?
苹果发布超薄iPhoneAir,评价两极,或为折叠屏预热。
你是不是也经常遇到“AI配音”的视频?
苹果还没有熟透。
豆包
博思白板 — boardmix AI
扣子-AI办公
千问
讯飞绘文
讯飞绘文-免费AI写作
扣子-AI办公app
AI小聚
ZeroGPT
网站地图
AI会得老年痴呆吗?研究揭示类似早期老年痴呆迹象
近期,以色列特拉维夫大学的一项研究揭示了AI存在数字认知障碍的现象,类似于早期老年痴呆的症状。科学家对全球几乎所有顶尖的AI大型语言模型进行了全面测试,发现这些模型普遍存在认知障碍,且版本越旧的模型表现越差。这一发现表明,AI在医疗等领域完全替代人类医生可能还为时过早。
在这项研究中,科学家采用了常用于老年痴呆症测试的蒙特利尔认知评估量表,对多种公开的领先大型语言模型进行了评估,其中包括ChatGPT和Gemini等模型的新旧版本。测试满分为30分,得分在26分或以上被认定为正常。然而,测试结果显示,仅有GPT-4o获得了最高的26分,GPT-4紧随其后得25分,而Gemini1.0的得分仅为16分。
研究还发现,几乎所有被测模型在视觉空间能力和执行任务方面均表现不佳,且缺乏同理心。这一发现引发了人们对AI未来发展和应用的进一步思考,尤其是在需要高度认知能力和同理心的医疗等领域。科学家表示,未来需要加强对AI模型的认知训练和优化,以提高其性能和适用性。
上一篇:LeCun最新访谈:距离AGI可能不到10年,下一代AI需要情感和视觉训练
下一篇:段宇:加快“人工智能+”研究 开拓“数实融合”新机遇
追觅「上天」,官宣成立天文BU|最前线
聚焦智能天文光学系统,打造人类“天眼”。
三临绝境,三度翻盘:一家机器人公司的15年“极限求生”
一家机器人公司如何穿越行业“死亡谷”?
招生锐减、硕博下沉、AI创业——教师职业的破与立
教师职业三重变革:从编制铁饭碗到流量新战场,谁在定义未来教育者?
OpenAI CEO奥特曼点赞iPhone Air,分析师直呼:它只是苹果的试验品
苹果发布超薄iPhoneAir,评价两极,或为折叠屏预热。
偷走全红婵声音,在网上卖鸡蛋?你看的明星带货直播,可能是AI偷来的……
你是不是也经常遇到“AI配音”的视频?
库克不再「挤牙膏」:iPhone薄了,AI缺席
苹果还没有熟透。
豆包
博思白板 — boardmix AI
扣子-AI办公
千问
讯飞绘文
讯飞绘文-免费AI写作
扣子-AI办公app
豆包
博思白板 — boardmix AI
扣子-AI办公
千问
讯飞绘文
讯飞绘文-免费AI写作
扣子-AI办公app
AI小聚
ZeroGPT