陶哲轩亲测点赞,o3-mini秒证图论难题!专家级证明完整呈现
陶哲轩亲测点赞,o3-mini秒证图论难题!专家级证明完整呈现o3-mini成功挑战图论中专家级证明,还得到了陶哲轩盛赞。经过实测后,他总结称LLM并非是数学研究万能解法,其价值取决于问题得性质和调教AI的方式。
来自主题: AI技术研报
8277 点击 2025-03-11 17:55
搜索
o3-mini成功挑战图论中专家级证明,还得到了陶哲轩盛赞。经过实测后,他总结称LLM并非是数学研究万能解法,其价值取决于问题得性质和调教AI的方式。
和雇主用的AI招聘工具们来一场“中门对狙”
首次将DeepSeek同款RLVR应用于全模态LLM,含视频的那种!
从随机残基分布开始,逐步生成新的蛋白质结构
挑战多图数学推理新基准,大模型直接全军覆没?!
前段时间,幻方科技、DeepSeek 创始人梁文锋亲自挂名的一篇论文传遍了全球互联网。
没有任何冷启动数据,7B 参数模型能单纯通过强化学习学会玩数独吗?
今天给大家看个新东西,聊一聊我在怎么防AI洗稿。。。
o1/o3这样的推理模型太强大,一有机会就会利用漏洞作弊,怎么办?
武汉大学等发布了一篇大型视觉语言模型(LVLMs)安全性的综述论文,提出了一个系统性的安全分类框架,涵盖攻击、防御和评估,并对最新模型DeepSeek Janus-Pro进行了安全性测试,发现其在安全性上存在明显短板。