大模型内核
长时程 Agent:算力、记忆与功耗画像
作者基于 Sail Research CEO Neil Movva 的分享,论证长时程 agent 工作负载与聊天、训练有本质差异:算力上 CPU:GPU 趋向平价、核心数上升;记忆上 KV cache 与 agent 状态卸载至闪存以绕开 HBM 短缺;功耗上分…
从技术、商业与资本视角,解释正在重构世界的关键变化
大模型内核
作者基于 Sail Research CEO Neil Movva 的分享,论证长时程 agent 工作负载与聊天、训练有本质差异:算力上 CPU:GPU 趋向平价、核心数上升;记忆上 KV cache 与 agent 状态卸载至闪存以绕开 HBM 短缺;功耗上分…
商业洞察
Radical Ventures 梳理「NeoLab」这一新公司形态:由前沿实验室与顶尖高校研究者创立、聚焦长期技术突破的创业公司。三年间 40+ 家 NeoLabs 融资逾 400 亿美元,围绕世界模型、强化学习、扩散等范式各自押注,而算力与人才正取代资本成为硬…
商业洞察
Tomasz Tunguz 指出,前沿 AI 市场正切分为封闭阵营:Salesforce 独家绑定 Anthropic、OpenAI 切断 Cursor 的 API、Z.ai 给旗舰模型设 100 亿美元收入门槛、政府介入决定谁能运行前沿。与之对冲的是 Nvidi…
商业洞察
Khosla 合伙人 Adrian Radu 用招聘数据梳理前沿 AI 实验室的人才版图:MTS 岗位从 2024 年 1 月约 1k 增至 2026 年 8 月约 7k,OpenAI 与 Anthropic 合计占约 57%,规模已超 Bell Labs 巅峰期…
Albert Wenger 区分 AI 两种失败模式:机器奴役人类(对齐)与人类奴役机器(模型福利)。他认为意识对前者是红鲱鱼,对后者却居核心;鉴于模型权重激活与大脑激活的类比,AI 可能有主观体验,亟需认识上的谦逊与可检验的意识理论。
大模型内核
导读: 消费级聊天机器人的信仰,加上一连串炫目的"副本任务",让点燃这轮 AI 热潮的 OpenAI 与真正的金矿——AI 编程——擦肩而过。更小、更专注的 Anthropic 用 Claude Code 完成超车:营收增速反超、估值反超、IPO 抢跑。现在,硅谷…
大模型内核
距 Inkling 亮相仅两周,Mira Murati 团队再开源一款 276B/12B 的 MoE 模型。它在推理与智能体基准上超过了自家"大哥",也把开源模型的竞赛从"堆参数"推向了"拼效率"。 7 月 30 日,Mira Murati 创办的 Thinkin…
大模型内核
Kimi 与 Qwen 再度发力,将原本处于劣势的重量级竞争转变为对现有人工智能系统的战略威胁。 人工智能发展得如此迅速,是因为这个行业里不存在忠诚度可言。顾客会更换使用的产品型号,开发者会更换 API,投资者则会改变自己的观点。通常在出现一个行业基准数据以及两条…
提问 梁总,您能分享更多关于持续学习什么时候带来突破的时间线吗?包括如果实现持续学习,还需要哪些架构、算法的创新,以及其他关键要素? 梁文锋 人少,需要研究。现在全世界都在研究这个问题。或者说,对投资人来讲,现在投资人看到的最多的是 AGENT;但对于我们这些研究…
大模型内核
在科幻小说与好莱坞电影统治我们大脑的半个世纪里,人类对“AI 叛乱”的所有幻想,往往都带有某种宏大的剧场感——要么是 Skynet(天网)突然觉醒了对人类的仇恨,要么是 HAL 9000 在寂静的太空深处用冰冷的声调宣布人类是多余的。 然而,当人类历史上第一起大模…
模型层堪称“蛮荒之地”——任何使用特定模型的公司都必须明白自己为何选择它……以及为了获得该模型的使用权限而需要放弃什么。 在过去的几周里,企业技术领域最具影响力的两位专家几乎表达了相同的观点:如果一家企业将自己的专有数据输入到封闭式的先进模型中,那无异于在为自己的…
大模型内核
过去,前沿模型市场存在着清晰的层级结构:最优秀的模型都是封闭的、美国开发的、价格昂贵的,并且需要通过 API 才能使用。而 GLM-5.2 的出现很麻烦,因为它同时动摇了这四点前提。 总部位于中国的 Z.ai 推出的这款新开源模型在编程能力排行榜上位居前列,拥有…