无一大模型及格! 北大/通研院提出超难基准,专门评估长文本理解生成
无一大模型及格! 北大/通研院提出超难基准,专门评估长文本理解生成在长文本理解能力这块,竟然没有一个大模型及格!
来自主题: AI技术研报
10890 点击 2024-08-07 14:58
搜索
在长文本理解能力这块,竟然没有一个大模型及格!
AI真的已经危险到要如此监管的地步了吗?
七年前,论文《Attention is all you need》提出了 transformer 架构,颠覆了整个深度学习领域。
从泄露的信息来看 ,Apple Intelligence 背后的提示语还是挺简单的。
李飞飞老师提出了空间智能 (Spatial Intelligence) 这一概念,作为回应,来自上交、斯坦福、智源、北大、牛津、东大的研究者提出了空间大模型 SpatialBot,并提出了训练数据 SpatialQA 和测试榜单 SpatialBench, 尝试让多模态大模型在通用场景和具身场景下理解深度、理解空间。
逆合成是药物发现和有机合成中的一项关键任务,AI 越来越多地用于加快这一过程。
一波未平,一波又起。继去年11月CEO Sam Altman被解雇并重新聘用后,OpenAI核心团队又双叒叕变了?
AI医疗,「钱」路漫漫。
奥运搞钱密码!义乌+AI?
AI向左,机器人向右,具身智能站在交叉点。