李飞飞学生发起国际具身人类数据标准,光轮智能成唯一参与中国企业
李飞飞学生发起国际具身人类数据标准,光轮智能成唯一参与中国企业2009年,李飞飞团队正式发布ImageNet。
搜索
2009年,李飞飞团队正式发布ImageNet。
千问说它可以帮我拼九宫格了,还是不同主题的那种。
苏度科技联合创始人、董事长苏昊是ImageNet的核心作者之一,师从李飞飞。这家公司走了一条与硅谷主流“纯大脑黑盒大模型”不太一样的路:软硬件协同设计,上下分层架构,上层负责任务规划与环境理解,下层负责具体物体操作;Sim-to-Real作为核心训练范式,让机器人在虚拟世界里经历几百万年的进化,再迁移到现实。
今天,阿里通义团队发布了他们第三代图像生成模型:Qwen-Image-3.0 。官方博客用了一个字来概括这一代的核心进步,「实」。不是好看,不是炫技,是「实」。内容丰实、细节真实、知识厚实。
OpenAI 在上周推出的首款硬件产品 Codex Micro 竟然售罄了。商品于 7 月 15 日开放限量预订,之后首批预订很快售罄,而已下单产品预计从 7 月 24 日起陆续发货。image description. 图片来自:xxx在 OpenAI 的商店官网,Codex 键盘已经显示「缺货」
让大模型给一张图片打“质量分”,它其实经常看走眼。
如果想开发一个视频理解应用,你会怎么做?
Reve 在 7 月 9 日把图像模型迭代到了 2.1 版。距离 2.0 发布刚好一个月,放在基础模型圈子这不算常见。前面只挡着一个 OpenAI 的 GPT Image 2。另外官方说:「训练这版模型用的算力不到排行榜前后邻居的十分之一」。
乐鑫信息科技 (688018.SH) 推出 ESP-VISION,一款面向 ESP32-P4、ESP32-S31 以及 ESP32-S3 系列芯片的低代码边缘 AI 与机器视觉框架。ESP-VISION 基于 MicroPython 提供统一的 sensor、image、display、espdl 等 Python API,整合摄像头采集、图像处理、视频编解码、
昨天早上我想给 Claude 的一篇文章配几张 3:4 的社交媒体图。手边有自己做的社交媒体 Skills,就顺手让 Codex 调了 GPT-Image 2.0。出来的效果超出预期。干净白底,克制的 3D 材质,中文标签直接印在图里,远看像杂志内页,近看细节都读得清。