AI资讯新闻榜单内容搜索-token

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: token
IDC×浪潮信息最新报告!22亿Agent背后,AI算力正迎来一场重构

IDC×浪潮信息最新报告!22亿Agent背后,AI算力正迎来一场重构

IDC×浪潮信息最新报告!22亿Agent背后,AI算力正迎来一场重构

IDC与浪潮信息联合发布的《2026年中国人工智能计算力发展评估报告》显示,全球活跃企业Agent数量预计将从2026年的7940万个增长至2030年的22.16亿个,带动Token消耗和算力需求爆发式增长,AI基础设施正围绕Agent长链路运行进行系统性重构。

来自主题: AI技术研报
8475 点击    2026-09-30 11:15
让Token像土豆一样便宜,要闯哪四关?

让Token像土豆一样便宜,要闯哪四关?

让Token像土豆一样便宜,要闯哪四关?

远景科技集团创始人张雷在央视《对话》节目中提出"AI土豆论",指出从绿电到普惠Token需闯破误区、建预测、提效率、可复制四道系统关,相关方案已在总规划容量超2GW的远景乌兰察布星河基地首次落地。

来自主题: AI资讯
9882 点击    2026-09-30 11:11
EMNLP 2026 | 大模型解码不能只看概率,人大团队引入语义冗余

EMNLP 2026 | 大模型解码不能只看概率,人大团队引入语义冗余

EMNLP 2026 | 大模型解码不能只看概率,人大团队引入语义冗余

中国人民大学代文林、孟澄研究员团队提出的ME-Decoding方法被EMNLP 2026接收,该方法在解码时同时利用token概率与embedding相似度,从集合层面筛选低冗余候选token,在GSM8K和GPQA上取得所比较方法中最高的平均准确率,端到端GPU延迟仅增加约3%。

来自主题: AI技术研报
7232 点击    2026-09-30 11:07
用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

代季峰创立的Naive AI开源首个模型Naive-N0.5-Flash,总参数量309B、激活参数量15.5B,原生支持百万token上下文,面向编程与AI研发任务,由AI参与研发并在论文复现等评测中表现优异,权重与代码采用MIT许可开源。

来自主题: AI资讯
9417 点击    2026-09-29 11:53
目前可以免费“薅”的Token,截至2026年9月,全网最全信息

目前可以免费“薅”的Token,截至2026年9月,全网最全信息

目前可以免费“薅”的Token,截至2026年9月,全网最全信息

截至2026年9月,实测整理出16个仍可免费获取Token的渠道,按限时活动、长期免费层、国内平台额度三档分类,涵盖阶跃星辰Step 5、Qoder、Cline、Gemini API、GitHub Copilot、Kilo Code、OpenCode、Groq、Cerebras、火山引擎、阿里云百炼、腾讯云混元、百度千帆、智谱及硅基流动等平台。

来自主题: AI资讯
7798 点击    2026-09-29 11:17
GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

Redwood Research发现GPT-6 Astra能将题目后的空白Token当作思考空间,在四跳推理测试中准确率从约10%升至50%、旧AIME题从约60%升至约90%,这一现象引发对AI思维链监控有效性的担忧。

来自主题: AI技术研报
9135 点击    2026-09-28 16:23
突发,Sonnet 5.5偷跑!实测碾压GPT-6 Sol直逼Astra

突发,Sonnet 5.5偷跑!实测碾压GPT-6 Sol直逼Astra

突发,Sonnet 5.5偷跑!实测碾压GPT-6 Sol直逼Astra

Claude Sonnet 5.5在Claude Code中被抓包偷跑并开启灰度测试,多位开发者实测显示其性能碾压GPT-6 Sol并在编码与Agent能力上直逼GPT-6 Astra,同时定价低至百万Token输入2美元,Anthropic意在OpenAI DevDay前截杀对手。

来自主题: AI资讯
8919 点击    2026-09-28 10:11
刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

谷歌DeepMind掌门人首次确认Gemini 4 Pro已进入后训练早期阶段,开发者在实测中发现其新检查点在3D物理模拟、代码生成等任务上表现碾压Opus 5.5,且泄露参数显示其具备1000万Token上下文窗口和极具攻击性的定价,谷歌力争在年底前正式发布。

来自主题: AI资讯
10468 点击    2026-09-27 23:12
谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

谷歌TPU跑Kimi比英伟达GPU快57%!用的还是DeepSeek推理框架

推理创业公司Inferact用自研的megakernel内核结合DeepSeek的DSpark推测解码框架,让16块谷歌TPU v7运行Kimi K3达到每秒709个token,比同条件下16块英伟达GB200快57%。

来自主题: AI资讯
10087 点击    2026-09-26 15:01
我的上下文资产,凭什么被大厂绑架?

我的上下文资产,凭什么被大厂绑架?

我的上下文资产,凭什么被大厂绑架?

开源智能体项目Orbital主张"Context is yours",通过将散乱会话和记忆总结为可迁移的项目记忆,帮助用户拿回被大厂Agent锁死的上下文资产,并配合观猹推出的Tokendance模型钱包,实现DeepSeek、GLM、Kimi等70多个模型用量的透明化管理。

来自主题: AI资讯
8972 点击    2026-09-25 10:13