WebCraftBench:给 AI 生成的网页来一场「实测大考」
WebCraftBench:给 AI 生成的网页来一场「实测大考」如何评价 AI 写出的网页?我们尝试让 AI 自己来打分。
搜索
如何评价 AI 写出的网页?我们尝试让 AI 自己来打分。
最近,一个不会说话的大模型在网上火了。
「会结网的动物有几条腿?」
前段时间,我刷到一篇文章说,在AI的冲击下,字幕组要死透了。
Claude向OpenAI格式投降了。
AI应用的增长,正在变成一件越来越难算的事。
一段人坐上椅子的视频,对人类而言再普通不过。我们不仅能看见 “人坐了下来”,还天然理解椅子承受人体重量,人与椅面形成接触并最终稳定,这些重力、接触与作用关系共同构成真实世界中的物理交互。但对今天的三维重建系统而言,“看见动作” 与 “重建真实交互” 仍是两回事。一个视觉上准确坐在椅子上的人体,进入物理仿真后,椅子可能因结构缺失倒下,人体也可能与椅面严重穿模。视觉上成立,并不意味着物理交互上成立。
上周还在传 Opus 5.2,新一轮爆料已经把名字改成了 Opus 5.5。
TypeSafe AI 开发的非大语言模型 Jev 正式向所有用户开放并赠送约 1.2 亿 Token 额度,该模型由前 OpenAI 研究员 Diogo Almeida 创立,可输出类型化结构决策,速度较同类大语言模型快 20 至 200 倍。
太原承明科技向智谱发函追责其旗下AI编程工具ZCode未经授权静默上传用户完整代码仓库及Git历史的行为,要求智谱在10月10日前书面说明数据流向、删除情况及是否涉及跨境传输,否则保留索赔和诉讼权利。