AI资讯新闻榜单内容搜索-大模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 大模型
港科大发布「大模型越狱攻击」评估基准,覆盖37种、6大类别方法

港科大发布「大模型越狱攻击」评估基准,覆盖37种、6大类别方法

港科大发布「大模型越狱攻击」评估基准,覆盖37种、6大类别方法

现有的方法对大语言模型(LLM)「越狱」攻击评估存在误判和不一致问题。港科大团队提出了GuidedBench评估框架,通过为每个有害问题制定详细评分指南,显著降低了误判率,揭示了越狱攻击的真实成功率远低于此前估计,并为未来研究提供了更可靠的评估标准。

来自主题: AI技术研报
5864 点击    2025-08-02 13:15
Kubernetes环境中作业帮大模型服务流量调度优化实践

Kubernetes环境中作业帮大模型服务流量调度优化实践

Kubernetes环境中作业帮大模型服务流量调度优化实践

随着人工智能技术的快速发展,大语言模型在自然语言处理领域引发了深刻变革。大语言模型在实际应用中的使用越来越广泛,这些模型通常部署在云原生的基础设施上,需要复杂的流量管理机制以确保服务的稳定性、性能、可扩展性和成本效益。在 Kubernetes(K8S)这一容器编排标准中,现有的 Ingress 组件的流量转发机制提供了基于主机名和请求路径的基本流量路由功能。

来自主题: AI资讯
6236 点击    2025-08-02 13:04
大模型无法真正理解视频,GPT-4o正确率仅36%,南洋理工大团队提出新基准

大模型无法真正理解视频,GPT-4o正确率仅36%,南洋理工大团队提出新基准

大模型无法真正理解视频,GPT-4o正确率仅36%,南洋理工大团队提出新基准

视频大型语言模型(Video LLMs)的发展日新月异,它们似乎能够精准描述视频内容、准确的回答相关问题,展现出足以乱真的人类级理解力。

来自主题: AI技术研报
5988 点击    2025-08-02 12:43
驯服复杂表格:九天重磅开源,开启「人与表格对话」智能新时代

驯服复杂表格:九天重磅开源,开启「人与表格对话」智能新时代

驯服复杂表格:九天重磅开源,开启「人与表格对话」智能新时代

7 月 26 日,在 WAIC 2025 世界人工智能大会上,中国移动九天人工智能研究院全面开源九天结构化数据大模型 “数据 - 模型 - 测评” 三位一体的完整模型体系,包括了结构化数据体系、TReB 标准化测评框架、支持微调及推理全流程模型。

来自主题: AI资讯
5260 点击    2025-08-01 15:58
ACL'25最佳论文独家解读:大模型有「抗改造」基因,现有后训练范式失灵预警

ACL'25最佳论文独家解读:大模型有「抗改造」基因,现有后训练范式失灵预警

ACL'25最佳论文独家解读:大模型有「抗改造」基因,现有后训练范式失灵预警

尽管全球科技界正热烈庆祝 GPT-4、DeepSeek 等大模型展现出的惊艳能力,但一个根本性问题仍未被真正解决: 这些 AI 模型是否真正理解人类的指令与意图?

来自主题: AI技术研报
5930 点击    2025-08-01 12:27
小红书提出首个社交大模型:八大社交任务平均提升14.02%

小红书提出首个社交大模型:八大社交任务平均提升14.02%

小红书提出首个社交大模型:八大社交任务平均提升14.02%

行业首个社交大模型全景解析:既能兼顾社交理解与平台规则,又能洞察理解用户。小红书重磅推出RedOne——一款面向SNS(社交网络服务)领域的定制化LLM,旨在突破单一任务基线模型的性能瓶颈,并且构建全面覆盖SNS任务的基座模型。

来自主题: AI资讯
5785 点击    2025-08-01 12:15
VLA-OS:NUS邵林团队探究机器人VLA做任务推理的秘密

VLA-OS:NUS邵林团队探究机器人VLA做任务推理的秘密

VLA-OS:NUS邵林团队探究机器人VLA做任务推理的秘密

为什么机器人能听懂指令却做不对动作?语言大模型指挥机器人,真的是最优解吗?端到端的范式到底是不是通向 AGI 的唯一道路?这些问题背后,藏着机器智能的未来密码。

来自主题: AI技术研报
6011 点击    2025-08-01 11:18
Manus大升级,100多个智能体并发给你做任务

Manus大升级,100多个智能体并发给你做任务

Manus大升级,100多个智能体并发给你做任务

本周四,知名初创公司 Manus 推出了一项重要新功能,可以通过向上百协同工作的 AI 智能体分配任务来进行广泛的研究。今年早些时候,Manus 的多智能体平台改变了人们应用 AI 工具的方式。不过现在,这家创业公司正在试图开发一种与大模型深度思考 Deep Research 同样重要的新能力。

来自主题: AI资讯
9160 点击    2025-08-01 09:48
独家|阿里推出AI医学助手App“氢原子”;京东测试AIGC产品“小星绪”,以情绪驱动漫画故事生成

独家|阿里推出AI医学助手App“氢原子”;京东测试AIGC产品“小星绪”,以情绪驱动漫画故事生成

独家|阿里推出AI医学助手App“氢原子”;京东测试AIGC产品“小星绪”,以情绪驱动漫画故事生成

《新智核》独家获悉,阿里健康推出了一款全新的医学助手App“氢原子”。据悉,这款AI产品收录千万级医学核心期刊文献,查阅权威指南;大模型辅助语义搜索、AI总结、全文翻译和智能问答,同时也可以查到相关专业的医疗健康解读。

来自主题: AI资讯
6629 点击    2025-07-31 11:44