AI资讯新闻榜单内容搜索-上下文

# 热门搜索 #

大模型

人工智能

openai

融资

chatGPT

搜索: 上下文

LLaVA-Mini来了！每张图像所需视觉token压缩至1个，兼顾效率内存

LLaVA-Mini来了！每张图像所需视觉token压缩至1个，兼顾效率内存

LLaVA-Mini来了！每张图像所需视觉token压缩至1个，兼顾效率内存

以 GPT-4o 为代表的实时交互多模态大模型（LMMs）引发了研究者对高效 LMM 的广泛关注。现有主流模型通过将视觉输入转化为大量视觉 tokens，并将其嵌入大语言模型（LLM）上下文来实现视觉信息理解。

来自主题: AI技术研报

3934 点击 2025-02-06 15:26

Qwen开源首个长文本新模型，百万Tokens处理性能超GPT-4o-mini

Qwen开源首个长文本新模型，百万Tokens处理性能超GPT-4o-mini

Qwen开源首个长文本新模型，百万Tokens处理性能超GPT-4o-mini

谈到大模型的“国货之光”，除了DeepSeek之外，阿里云Qwen这边也有新动作——首次将开源Qwen模型的上下文扩展到1M长度。

来自主题: AI资讯

8790 点击 2025-01-27 14:18

六大维度，LLM「问题生成」首次正面PK人类！伯克利等发布最新研究

六大维度，LLM「问题生成」首次正面PK人类！伯克利等发布最新研究

六大维度，LLM「问题生成」首次正面PK人类！伯克利等发布最新研究

研究人员首次探讨了大型语言模型（LLMs）在问题生成任务中的表现，与人类生成的问题进行了多维度对比，结果发现LLMs倾向于生成需要较长描述性答案的问题，且在问题生成中对上下文的关注更均衡。

来自主题: AI技术研报

7612 点击 2025-01-27 13:26

最懂医疗的国产推理大模型，果然来自百川智能

最懂医疗的国产推理大模型，果然来自百川智能

最懂医疗的国产推理大模型，果然来自百川智能

就在本周，Kimi 的新模型打开了强化学习 Scaling 新范式，DeepSeek R1 用开源的方式「接班了 OpenAI」，谷歌则把 Gemini 2.0 Flash Thinking 的上下文长度延伸到了 1M。1 月 24 日上午，百川智能重磅发布了国内首个全场景深度思考模型，把这一轮军备竞赛推向了高潮。

来自主题: AI资讯

7164 点击 2025-01-26 12:16

1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首

1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首

1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首

就在国内各家大模型厂商趁年底疯狂卷的时候，太平洋的另一端也没闲着。就在今天，谷歌发布了 Gemini 2.0 Flash Thinking 推理模型的加强版，并再次登顶 Chatbot Arena 排行榜。

来自主题: AI资讯

10071 点击 2025-01-22 18:40

ShowMeAI周刊 No.15 | 上周最有讨论度的6个AI话题：自由画布类产品密集更新、多主体一致成发展趋势、AGI、开源…

ShowMeAI周刊 No.15 | 上周最有讨论度的6个AI话题：自由画布类产品密集更新、多主体一致成发展趋势、AGI、开源…

ShowMeAI周刊 No.15 | 上周最有讨论度的6个AI话题：自由画布类产品密集更新、多主体一致成发展趋势、AGI、开源…

自由画布类 AIGC 工具：从近期新品（更新）窥见发展趋势——自律才能给我自由。图像 & 视频多主体一致功能：模型上下文能力的重要体现，未来各家模型的标配。指定 AI 生图里的文字，我找到了 9 种解决方案，其中有 2 种快过时了

来自主题: AI资讯

9291 点击 2025-01-21 22:57

近8年后，谷歌Transformer继任者「Titans」来了，上下文记忆瓶颈被打破

近8年后，谷歌Transformer继任者「Titans」来了，上下文记忆瓶颈被打破

近8年后，谷歌Transformer继任者「Titans」来了，上下文记忆瓶颈被打破

正如论文一作所说，「新架构 Titans 既比 Transformer 和现代线性 RNN 更有效，也比 GPT-4 等超大型模型性能更强。」

来自主题: AI技术研报

7726 点击 2025-01-16 09:54

MiniMax开源4M超长上下文新模型！性能比肩DeepSeek-v3、GPT-4o

MiniMax开源4M超长上下文新模型！性能比肩DeepSeek-v3、GPT-4o

MiniMax开源4M超长上下文新模型！性能比肩DeepSeek-v3、GPT-4o

开源模型上下文窗口卷到超长，达400万token！刚刚，“大模型六小强”之一MiniMax开源最新模型—— MiniMax-01系列，包含两个模型：基础语言模型MiniMax-Text-01、视觉多模态模型MiniMax-VL-01。

来自主题: AI技术研报

8248 点击 2025-01-15 15:10

仅缩小视觉Token位置编码间隔，轻松让多模态大模型理解百万Token！清华大学，香港大学，上海AI Lab新突破

仅缩小视觉Token位置编码间隔，轻松让多模态大模型理解百万Token！清华大学，香港大学，上海AI Lab新突破

仅缩小视觉Token位置编码间隔，轻松让多模态大模型理解百万Token！清华大学，香港大学，上海AI Lab新突破

随着语言大模型的成功，视觉 - 语言多模态大模型 (Vision-Language Multimodal Models, 简写为 VLMs) 发展迅速，但在长上下文场景下表现却不尽如人意，这一问题严重制约了多模态模型在实际应用中的潜力。

来自主题: AI技术研报

8282 点击 2025-01-15 14:23

MiniMax震撼开源，突破传统Transformer架构，4560亿参数，支持400万长上下文

MiniMax震撼开源，突破传统Transformer架构，4560亿参数，支持400万长上下文

MiniMax震撼开源，突破传统Transformer架构，4560亿参数，支持400万长上下文

「2025 年，我们可能会看到第一批 AI Agent 加入劳动力大军，并对公司的生产力产生实质性的影响。」——OpenAI CEO Sam Altman

来自主题: AI技术研报

8628 点击 2025-01-15 14:06

上一页当前第18页,共31页下一页