刚刚,马斯克交卷 Grok 4.7!但这次吹牛吹大了
刚刚,马斯克交卷 Grok 4.7!但这次吹牛吹大了SpaceXAI正式发布Grok 4.7,定位为目前最强的编程与知识工作模型,采用比4.6更大的全新基础模型并强化长任务执行与自我核查能力,API定价与上一代持平,在多项编程基准测试中较Grok 4.6提升明显且性价比突出,但3D与网页视觉任务表现不稳,整体被视为xAI对开发者市场的一次集中加码。
搜索
SpaceXAI正式发布Grok 4.7,定位为目前最强的编程与知识工作模型,采用比4.6更大的全新基础模型并强化长任务执行与自我核查能力,API定价与上一代持平,在多项编程基准测试中较Grok 4.6提升明显且性价比突出,但3D与网页视觉任务表现不稳,整体被视为xAI对开发者市场的一次集中加码。
APUS(麒麟合盛)旗下AI实验室公开全球最早一批Jev独立开源复现成果fast-browser-use,基于Qwen3.5等开源模型在RTX PRO 6000上将单次决策压缩至79毫秒,并以9B小模型对标Jev性能。
千问把7B生图模型的权重开放了,RTX 3090就能跑!
在社会变化的洪流中,LLM 能不能不断修正自己对社会的认知?
Codex、Claude Code等数字世界智能体,已经向我们展示出了一种全新且高效的工作方式:大模型理解目标,拆解任务,调用适当的工具,并根据执行结果不断调整计划,直到完成任务。
桌面上放着面包、刀还有一个婴儿人偶。
GPT-6 Astra联合三位人类研究员首次攻克FrontierMath基准测试中一道自2017年悬而未决的「重大进展」级数学难题,证明批准式委员会选举中「核」永远不为空,并创造性地提出基于「调和熵」的新型投票规则及多项式时间算法。
阶跃星辰发布新一代旗舰基座模型Step 5 Preview,以44分的AA智能指数成绩跻身全球开源模型前三,采用600B总参数/27B激活的稀疏MoE架构并原生支持1M上下文,在代码生成、长程Agent、深度研究与金融尽调等场景表现突出。
造物100」第7期推荐了MUZIM L1智能数据拓展坞、Lumeria手机皮肤镜、Flowtica verso AI录音卡、GENiEX科幻对讲机及immurok IK-1无线指纹钥匙等新品,这些产品在成熟品类上通过重新定义使用方式解决旧有痛点,展现了当下硬件创新从追求更大未来转向优化具体体验的方向。
Anthropic联合MIT、斯坦福学者发布2030年三种经济情景推演,极端情景下美国GDP暴增32%但白领失业率飙至17.9%,资本攫取55%增长红利,万余名美国人调查预期偏向最严峻版本。