多模态大模型幻觉降低30%!中科大等提出首个幻觉修正架构「Woodpecker」啄木鸟
多模态大模型幻觉降低30%!中科大等提出首个幻觉修正架构「Woodpecker」啄木鸟视觉幻觉是常见于多模态大语言模型的一个典型问题。最近,来自中科大等机构的研究人员提出了首个多模态修正架构「啄木鸟」,可有效解决MLLM输出幻觉的问题。
搜索
视觉幻觉是常见于多模态大语言模型的一个典型问题。最近,来自中科大等机构的研究人员提出了首个多模态修正架构「啄木鸟」,可有效解决MLLM输出幻觉的问题。
全球算力发展应用多元化、供需不平衡的挑战仍在持续,以AIGC为代表的人工智能大模型等新应用、新需求的崛起,推动算力规模快速增长、计算技术多元创新、产业格局加速重构。
2024年AI主导PC行业的可能性。文章指出,生成式人工智能的发展将推动PC行业的革命,个人电脑将成为通用人工智能的载体。同时,芯片厂商和设备厂商都在积极布局AI PC,推出支持AI功能的芯片和设备。文章还提到AI PC的特点,包括控制本地数据、提升工作效率、自然人机交互体验和数据隐私与安全。预计2024年将是AI PC开始普及的时期。
近期大火的FPS新作《The Finals》开发商Embark Studios确认游戏中大部分配音都是由人工智能工具来生成的,包括所有参赛选手、解说员的声音等。只有少数的呼吸声、跳跃声是在录音室录制的,因为人工智能还不能完成这些任务。
刚刚,阿里云搬出通义大模型“全家桶”炸场了! 就在今天的云栖大会上,不仅通义千问升级至千亿级参数2.0版本,在10个权威评测中,综合性能超越GPT3.5、加速追赶GPT-4,可以通过通义千问APP体验,阿里云还把打造大模型应用的“秘籍”也给公开了。
即便大语言模型的参数规模日渐增长,其模型中的参数到底是如何发挥作用的还是让人难以琢磨,直接对大模型进行分析又费钱费力。针对这种情况,微软的两位研究员想到了一个绝佳的切入点
作为最有潜力成为下一代平台的 AI 技术,会让人类变得“更懒”吗?根据发表在《机器人与人工智能前沿》杂志上的一项最新研究显示,当人类与 AI 和机器合作时,真的会“摸鱼偷懒”。
微软最近一篇论文爆料,GPT-3.5的参数量只有20B,远远小于之前GPT-3公布175B。网友表示,ChatGPT能力似乎「配得上」这个体量?
AI郭德纲的实现主要基于一款AI视频工具HeyGen,用户只需上传视频,选择语言,就能生成自动翻译、音色调整、嘴型匹配的视频。 而HeyGen背后则是一家在深圳创立的AIGC企业。
ChatGPT到底长什么样?最近在Twitter社区、Reddit社区有人创造出ChatGPT的形象。很多人发出了惊呼: 哦豁!这就是我心中ChatGPT的样子!