从Google Gemini到OpenAI Q*:生成式AI研究领域全面综述
从Google Gemini到OpenAI Q*:生成式AI研究领域全面综述这项综述性研究报告批判性地分析了生成式AI的发展现状和发展方向,并探究了谷歌Gemini和备受期待的OpenAI Q*等创新成果将如何改变多个领域的实际应用。
搜索
这项综述性研究报告批判性地分析了生成式AI的发展现状和发展方向,并探究了谷歌Gemini和备受期待的OpenAI Q*等创新成果将如何改变多个领域的实际应用。
过去一年,我们不光看到科大讯飞、网易有道等老牌科技企业推出学习机、词典笔等传统教育硬件,并且还看到小度科技、猿辅导等「新势力」推出学习手机、墨水屏学习平板等新兴教育硬件产品。虽然这些产品的形态各异,但从功能维度来看,这些产品有很强的趋同性。
在本篇文章中,适道将综合Coatue、a16z、Radical Ventures等明星VC预言;The Information、FT、Sifted汇集的投资者预言;以及Greg Brockman等行业大佬的观点,试着归纳接下来一年中AI的发展脉络。
prompt——这是网易有道公布的2023年度词汇。过去一年,带火prompt一词的大模型,在各行各业掀起波澜。其中在教育领域,大模型的影响正在逐渐显现。
近年来,随着Transformer模型的大规模发展和应用,模型大小每两年平均增长240倍,GPT-3等大模型的参数增长已经超过了GPU内存的增长。在大算力激增的需求下,越来越多行业人士认识到,新的计算架构或许才是算力破局的关键。
2023年,人工智能技术的创新与应用突飞猛进,ChatGPT等大模型爆火出圈,AI热潮席卷全球。
无需微调,只要四行代码就能让大模型窗口长度暴增,最高可增加3倍!而且是“即插即用”,理论上可以适配任意大模型,目前已在Mistral和Llama2上试验成功。
如何从一段视频中找出感兴趣的片段?时序行为检测(Temporal Action Localization,TAL)是一种常用方法。过去TAL中的建模是片段甚至实例级的,而现在只要视频里的一帧就能实现,效果媲美全监督。
仅需一个任务描述,即可一键分割所有图片!
当大家都在研究大模型(LLM)参数规模达到百亿甚至千亿级别的同时,小巧且兼具高性能的小模型开始受到研究者的关注。