喝点VC|No Priors投资复盘:未来两三年仍会诞生千亿美元公司,但要成为数万亿美元公司就相当困难
喝点VC|No Priors投资复盘:未来两三年仍会诞生千亿美元公司,但要成为数万亿美元公司就相当困难当算力真正成为稀缺资源时,人们会发现,在任何一个机构里,往往只有几十名研究者贡献了大约80%的成果。真正昂贵的不是研究者本人,而是与他配套的算力。因此,如果拥有一定的Token预算,你要把它分配给谁,为什么。
搜索
当算力真正成为稀缺资源时,人们会发现,在任何一个机构里,往往只有几十名研究者贡献了大约80%的成果。真正昂贵的不是研究者本人,而是与他配套的算力。因此,如果拥有一定的Token预算,你要把它分配给谁,为什么。
熟悉豆包的用户打开最新版,第一眼看到的可能仍然是那个熟悉的对话框。但只要把模式切换到「工作」,就会发现已经与过去的聊天式 AI 大不一样。现在,它开始直接「做任务」了!
本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。Codex 生产 trace 的中位 decode 速度是 33 token/s
突发,GPT-5.6 Sol 开启大幅降价!未来三个月,API 价格和 credit 价格(超出计划包含额度后的按需付费用量)一起砍掉超过20%。目前,API 端已经即时生效,符合条件的 ChatGPT Work 和 Codex credits 正在陆续推送。
今天一大早,AI圈被这个消息刷屏了。外媒曝出猛料:Anthropic成功挖角前谷歌高管、大名鼎鼎的「TPU之父」Amir Salek!看来,Anthropic要自己造芯片了。此前,Anthropic就从OpenAI那里挖来了自研芯片骨干。
等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。我也是第一时间赶到现场,连夜开始实测。相比V4 Flash最大的不同,就是支持原生支持图片输入了,但图片生成当然还是没有的。
看到形界智能「Era」系列的原生模型Rise正式发布了,用500ms的端到端响应延迟,让人机交互,有了新的变量。第一时间测试了一下,给大家介绍介绍。全域沉浸,一种全新的视频交互形态
这期节目的嘉宾黄东旭,就是Token Maxing热潮的亲历者。他曾经只用最前沿的模型,每天账单三四百美元。让他转变的,是前沿模型的智力碾压和中国开源模型们的崛起——Fable 5可以一句话终结Agent群的讨论,同时大量的日常任务可以做到“只烧电费,不烧Token”。他的结论是:不是前沿模型用不起,而是本地开源模型底座+前沿模型的搭配,成本可控,更具性价比。
Anthropic开学校了,所有课程免费。而且是新员工入职教什么,这里就教什么。起因他们发现,每个月有数百万人访问Anthropic官网,想知道AI到底该怎么用。但除了有技术背景才能看懂的文档,也找不到什么特别有体系的教学。
接下来,Status 会给你生成一个完整的“社交网络”。有人关注你,有人评论你,有人给你发私信,娱乐媒体开始报道你。你的粉丝数量会变化,你和不同人物之间的关系也会变化。