Show notes
就在一个多月前,黄仁勋在 Computex 2026 上发布了英伟达 RTX Spark——第一个面向消费级 PC 的 AI 超算芯片,1 Petaflop 算力、128GB 统一内存,能在笔记本本地跑 120B 甚至 200B 参数的大模型。几乎同一时间,苹果 M5 系列也将端侧 AI 推到了前所未有的高度。硬件就位了,但一个老问题依然存在:如果 AI 助理不记得你是谁、不记得你三年前说过什么,再强的算力也只是个聪明的失忆者。这期节目的嘉宾是 Clipto.AI 的创始人兼 CEO 康洪文(Henry Kang),他在做一款在端侧本地运行的多模态 AI 产品,能读懂你所有的音视频、图片和文档,并在此基础上构建个人记忆系统。我们一起聊了聊大模型做记忆(memory)的天花板在哪里,为什么端侧比云端更适合承载个人记忆;把云上成熟的 AI 架构搬到端侧,都会遇到什么挑战;以及当苹果、谷歌这样的 OS 巨头自己做记忆层(memory layer)时,一家创业公司凭什么不被碾压。本期人物康洪文 Henry, Clipto.AI 创始人兼 CEOYaxian,「科技早知道」主播时间轴[算力与内存双重突破,让本地跑百亿参数模型成为可能OpenAI 就是大型机,端侧助理就像个人PC[大模型的生态位应是存储世界共识与通识用万亿参数去做个人知识是“杀鸡用牛刀”生态中缺一个专门记录和存储个人记忆的 player[本地 100% 运行,10 个模型协同将裸数据结构化上层构建时空对齐的知识记忆系统,支持文本和语音查找[Context Window、RAG、LoRA 微调都在尝试让模型记住用户共同问题:都没跳出大模型 MLE 框架,只能提供概率性记忆无法精确定位到“三年前某天下午和谁聊了什么”这种事实记忆[每个人都是 data rich 但 memory poor,数据没有被结构化就不叫记忆只有可查找、可复用、可执行的记忆才是真正的记忆[带着云上思维框架看端侧“完全不 work”从芯片算子优化到算力调度到模型优化到 Agent 搭建,每一步都需要攻克[苹果是硬件设备公司基因,更应搭建好 macOS 生态与第三方合作集齐“芯片+算力+模型+独立产品运营”,大公司极难发生谷歌、Meta 诞生第一天都是应用公司,终局是 memory layer 平台[苹果 M1 已具备 AI 推理能力,摩尔定律指向算力指数级增长第一个模型最复杂,后续一定有办法优化——模型变小是必然以终局看可能只做了 1/10,但完整记忆系统已搭建起来幕后制作监制:Yaxian后期:迪卡运营:George设计:饭团商业合作声动活泼商业化小队,点击链接直达声动商务会客厅,也可发送邮件至 [email protected] 联系我们。加入声动活泼声动活泼正在招聘全职商务运营经理、早咖啡内容实习生和社群实习生,如果你也对播客行业的内容制作感兴趣,欢迎[点击招聘入口](https://eg76rdcl6g.feishu.cn/docx/XO6bd12aGoI4j0xmAMoc4vS7nBh?from=from_copylink\)关于声动活泼「用声音碰撞世界」,声动活泼致力于为人们提供源源不断的思考养料。我们还有这些播客:声动早咖啡、声东击西、吃喝玩乐了不起、反潮流俱乐部、泡腾 VC、商业WHY酱、跳进兔子洞 、不止金钱欢迎在即刻、微博等社交媒体上与我们互动,搜索 声动活泼 即可找到我们。期待你给我们写邮件,邮箱地址是:[email protected]欢迎扫码添加声小音,在节目之外和我们保持联系。Special Guest: 康洪文 Henry.

