统计学20年悬案,GPT-5.6用90分钟破解!伯克利教授直呼「心塞」
统计学20年悬案,GPT-5.6用90分钟破解!伯克利教授直呼「心塞」困扰统计学界整整20年的核心悬案,被AI击碎了。
搜索
困扰统计学界整整20年的核心悬案,被AI击碎了。
昨天那篇文章,我说了一下我现在用Agent的日常。
对 AI Coding 来说,有人用,比任何 Benchmark 都管用,而有人持续付费,又比有人用更管用。
学校没变,但奥特曼警告人类正在慢慢失掉思考的训练场。
号外号外,OpenAI最新提示词指南更新了!如果你还没驯服ChatGPT,或者还在被它像毛线团一样越理越乱的回答折腾得苦不堪言,那么今天这篇OpenAI最新提示词指南,你一定要好好收藏!
Codex 首款硬件,来了。
7 月 15 日,腾讯 Robotics X 实验室以及福田实验室联合腾讯混元推出两款具身智能基座模型 —— 具身 VLM 基座模型 Hy-Embodied-VLM-1.0 以及 具身世界认知基座模型 Hy-Embodied-RxBrain-1.0,不仅让具身大脑能够 “看” 懂现实世界,还学会同时推理和想象。
近日,翁荔发布长文 《Harness Engineering for Self-Improvement》,系统梳理了 harness engineering 在 AI 自我改进中的作用。
昨天刚完成2亿美元Pre-IPO轮融资,逐际动力没有急着讲资本故事,而是立马甩出一段全尺寸人形机器人Oli全自主做家务的视频:
基于可验证奖励的强化学习(Reinforcement Learning with Verifiable Rewards,RLVR)正在成为大模型后训练的关键技术。数学题能判对错,代码能跑测试,可验证奖励让大模型可以通过强化学习持续提升推理能力。