新鲜出炉的Claude 3.5 Sonnet,更快、更便宜,还是全球最强。
新鲜出炉的Claude 3.5 Sonnet,更快、更便宜,还是全球最强。
在GPT-4发布后14.5个月里,LLM领域似乎已经没什么进步了?近日,马库斯的一句话引发了全网论战。大模型烧钱却不赚钱,搞AI的公司表示:难办!
号称不可能轻易被击败的AGI基准ARC-AGI被GPT-4o撼动,GPT-4o以在公共测试集50%、在训练集71%的准确率成为了新的SOTA!
Claude大模型又双叒叕更新升级了!
怎么度量现在的AI到底能干什么不能干什么?
GPT-4通过图灵测试,54%人误认为真人。
今天, OpenAI劲敌Anthropic忽然丢炸弹,发布下一代旗舰大模型Claude 3.5 Sonnet。
苹果OpenAI官宣合作,GPT-4o加持Siri,让AI个性化生成赛道热度飙升。
GTP-4o挑战悬赏八百万的超难数据集,实现SOTA!
OpenAI和谷歌接连两场发布会,把AI视频推理卷到新高度。 但业界还缺少可以全面评估大模型视频推理能力的基准。 终于,多模态大模型视频分析综合评估基准Video-MME,全面评估多模态大模型的综合视频理解能力,填补了这一领域的空白。