# 对话盛颖：xAI，Infra的浪漫，SGLang，开源，平权与“甄嬛传”

硅谷101 · 2026-08-03

<https://thevalley101.podhood.com/b720ef7f-dd27-4c52-9d11-d8a0a403962d>

本期硅谷101对话xAI前推理团队负责人、SGLang发起人及RadixArk联合创始人盛颖，讲述她从数学到AI Infra的转型历程，并阐述其核心观点：AI Infra不是support角色，本身就是产品，需要美感。盛颖回顾了在斯坦福读博期间经历的低谷与自我和解，在xAI获得support与freedom的v1.0时代，以及为推进SGLang社区而离开xAI创立RadixArk的决策。她解释了SGLang的RadixAttention技术如何通过前缀树复用KV cache，并透露RadixArk的最终使命是“下一代AI”，而非单纯的infra实现。节目还探讨了开源生态的平等与平权价值，以及她对AI未来与人类共存的信念。

## Questions this episode answers

### 盛颖为什么离开xAI创立RadixArk？

盛颖离开xAI创立RadixArk，是因为SGLang开源社区增长太快，仅靠开发者业余时间维护已无法支撑项目继续向前。她表示，当时有很多需求涌来，但团队无法很好交付，焦虑到了极点，觉得再不出来做这件事，就会让外界失望。她甚至等不了两个月拿xAI的vesting，因为社区等不了了。

[0:45](https://thevalley101.podhood.com/b720ef7f-dd27-4c52-9d11-d8a0a403962d?t=45000)

### 盛颖如何看待AI Infra？为什么说它是浪漫的？

盛颖认为AI Infra不是support角色，它本身就是产品。她强调infra的美感，追求系统设计的优美和稳定，而不是hacky的方式。她认为写infra的人都能理解这种追求，但很多以模型为目标的公司会在infra美感上妥协。RadixArk希望做infra first的公司，追求极高的审美，把事情做solid。

[0:52](https://thevalley101.podhood.com/b720ef7f-dd27-4c52-9d11-d8a0a403962d?t=52000)

### 盛颖在xAI的经历是怎样的？为什么说那是美好的v1.0时代？

盛颖在xAI获得了难得的support和freedom，参与搭建生产级推理系统。她形容早期xAI是个个都是人才，大家互相支持、友好、谦逊，没有people game和politics，能非常专心做事。她认为那是她回忆最美好的时光，甚至离开时非常不舍，如果不是因为SGLang社区需求，她不可能选择离开。

[0:35](https://thevalley101.podhood.com/b720ef7f-dd27-4c52-9d11-d8a0a403962d?t=35000)

### 盛颖如何看待开源和AI平权？

盛颖认为开源文化对她如同空气，她从小在江西通过互联网上陌生人的分享学习编程，被这群人养大。她希望AI能均等握在不同人手中，而不是被一小批人垄断。她认为闭源存在但不应该centralized，RadixArk希望提供能创造最好闭源模型的toolchain，让所有人拥有制造属于自己AI的能力。

[0:20](https://thevalley101.podhood.com/b720ef7f-dd27-4c52-9d11-d8a0a403962d?t=20000)

## Key moments

- **[0:00] 开场**
- **[3:14] 数学之美**
  - [4:04] 哥大发来普通硕士offer后，盛颖放弃已接受的港中文PhD并交违约金赴美
  - [5:00] 盛颖：纽约的shock是从被限制到完全自由，没有人盯着我、在乎我穿什么想什么
  - [6:30] 普林斯顿workshop让盛颖觉得与世无争，立志成为数学家：数学是确定性、绝对化的
  - [7:36] “大脑被完全的调转起来的时候，进入一种生理性愉悦。”
  - [8:25] 盛颖：西海岸让人重新想参与世界，东海岸则希望被世人遗忘
  - [9:15] 斯坦福rotation到第四轮，盛颖与Clark Barrett匹配，进入形式化验证方向
- **[17:04] 低谷与甄嬛传**
  - [17:06] “我是一个必须intense的人。”
  - [19:10] 盛颖看《甄嬛传》到一半时突然想到证明解法，暂停电视剧写下关键突破
  - [19:55] 盛颖通过了解ADHD拿到“使用自己的手册”：应顺着天性做事，不再勉强自己
  - [23:21] 盛颖：天分就是你感兴趣到外界不觉得研究伟大时，你还想继续做它
  - [25:08] “发paper是有套路的，你完全可以让一个根本不懂research的人哗啦哗啦发很多paper。”
- **[26:59] 谷歌与导师**
  - [27:04] 2022年暑假盛颖在谷歌实习进入AI for code，发现大模型已覆盖传统编程分析技术
  - [29:31] 谷歌实习让盛颖第一次被大模型震撼，坚定转换方向做LLM
  - [29:57] 盛颖转AI后算法方向不顺利，发现infra更适合自己：可推理、确定性、基于数学和代码
  - [30:41] SGLang是盛颖PhD多角度研究的集大成收官之作，从最初就定位production ready开源引擎
  - [33:28] Ion Stoica是盛颖的终身导师，他的价值观核心是making impact
  - [35:08] “我在乎的是impact，不是making。”
- **[35:33] xAI时光**
  - [36:59] 盛颖加入xAI因为同时获得support和freedom：共同搭建Grok推理系统与团队
  - [39:07] 盛颖：经历过的公司里xAI第一次完全没有people game和politics，个个都是人才且彼此support
  - [41:18] 盛颖：外界看到xAI联创全离开，但她经历的1.0时代团结互助，公司变大后的阵痛没有抚平
  - [42:43] 盛颖：公司scale up后文化和个人都脆弱，不能靠人而是靠体系运转，这个过程必须intentionally思考
  - [44:07] 盛颖喜欢Elon设定的无边界文化：没有组与组隔阂、工程师文化，让她看到完整full stack
- **[45:05] 告别与回望**
  - [46:58] 2025年SGLang需求爆发但核心开发者都是网友业余维护，盛颖判断不成立公司就无法deliver
  - [48:04] 盛颖在xAI满10个月时离开，为SGLang社区放弃了再过两个月就能拿到的首年vesting
  - [48:44] 盛颖谈金钱：有必需性，没有重要性，它给我自己创业的底气
  - [50:35] 盛颖在Two Sigma工作六个月，称它是仅次于xAI的完美体验：organized、开放、人互相帮助
- **[52:06] Infra浪漫**
  - [52:56] 盛颖定义RadixArk的AI infra：推理、post-training RL、甚至基座模型都是工具箱的一部分
  - [56:21] 盛颖：Inference游戏里没有输家，所有inference provider都在同步增长
  - [58:30] “Infra它不是一个support角色，Infra本身在我眼中就是产品。”
  - [59:16] 盛颖称与AI Infra是“浪漫的关系”：写infra的人都在乎系统是否优美稳定
- **[1:00:44] 技术深潜**
  - [1:01:05] RadixAttention用Radix树对请求前缀做索引，映射到KV memory pool复用已计算缓存
  - [1:02:22] 盛颖：agent的多轮对话几乎都有前缀共享，SGLang从paper起就以agent入口设计
  - [1:04:04] Day zero兼容重要是因为市场压力从用户传到inference provider再到引擎厂商
  - [1:04:33] DeepSeek v4架构创新太多，盛颖团队几乎重写大部分代码才实现day zero支持
  - [1:05:40] 盛颖：若latent-space推理成熟，推理引擎形态必然变化，但engine本来就要随世界持续适配
  - [1:07:38] 盛颖：RadixArk长远使命是下一代AI，Inference只是起点，不与现有推理厂商同类
- **[1:16:26] 创业与融资**
  - [1:21:51] 盛颖的编程是互联网上不知名的帖子与在线题库教会的，所以开源像空气一样理所当然
  - [1:22:38] 盛颖：开源变多、资本认可上升，但也混入功利主义者，破坏纯粹性
- **[1:23:13] 开源生态**
  - [1:23:59] 盛颖：开源不会停，但AI也不该完全开放或只被少数人握住，应均等握在不同人手中
  - [1:25:10] 呼吁所有实验室停止AI研究 vs 现实竞争：盛颖认为这违背人性，一定会有力量起义
  - [1:26:58] “你阻止它的方式一定是发明发现另一条路径，使得你允许AI继续前进，而人类还不会输。”
- **[1:27:59] LMSYS平权**
  - [1:28:22] LMSYS是盛颖视为终生事业的非营利组织，核心价值是平权、保护未established开发者的项目掌控权
  - [1:30:02] LM Arena最初只是LMSYS一个分支项目，意外获大量关注后被交给伟林团队做成商业规模
  - [1:35:56] 盛颖：竞赛里男生赢会被叫天才，她赢却总被解释成对手状态差、题压重或运气好
  - [1:38:03] 盛颖：性别问题只有让女性真正拥有权利才能改变，教育无法达到目的
- **[1:38:45] 世间的美好**
  - [1:43:22] “那些好的东西都存在，但你要非常相信它，相信到身边没有这样的人你还相信它。”

## Speakers

- **盛颖** (guest)

## Topics

人工智能

## Mentioned

Berkeley (company), Clark Barrett (company), Columbia (company), Databricks (company), Google (company), Ion Stoica (company), LMSYS (company), Princeton (company), RadixArk (company), Stanford (company), Two Sigma (company), xAI (company), CVC5 (product), DeepSeek (product), Grok (product), Miles (product), SGLang (product), VLLM (product)

## Transcript

### 开场

**Host** [0:00]
哈喽 ， 各位 ， 欢迎来到 " 硅谷 101"， 我是陈倩 。 这期视频播客我们的嘉宾是 xAI 前推理系统负责人 、 开源推理引擎 SGLang 的发起人 —— 盛颖 。

盛颖本科毕业于上海交通大学 ACM 班 ， 之后在哥大获得了计算机科学硕士学位 ，并且在斯坦福大学获得了计算机科学博士学位 。

她的研究经历横跨算法形式化验证和大模型系统 。 大模型浪潮兴起之后， 她成为了 LMSYS 开源社区的核心成员 ， 参与推动了一系列具有行业影响力的项目 ，并且创办了推理引擎 SGLang。

之后， 盛颖加入 xAI，并且共同领导 Grok 的推理团队 ， 将开源研究带入全球最前沿的大模型工程实践 。 如今 ， 她从 SGLang 开源生态中孵化出创业公司 RadixArk， 希望把这个少数科技巨头 " 才能拥有的前沿 AI 基础设施 " 变成整个行业都可以使用的开放技术底座 。RadixArk 创立之初 ， 便完成了 1 亿美元种子轮融资 ， 投资方几乎集齐了硅谷所有的算力巨头和技术领袖人物 。

**盛颖** [1:05]
RadixArk 最终使命是要做 " 下一代 AI"。 我想要 build 的那个未来 ， 就是一个跟强力 AI 共存的未来 。 以模型为目标的这些公司 ，Infra 的美感上有所妥协 。

以我跟 Infra 之间的这个浪漫的关系 ， 我觉得 Infra 它不是一个 support 角色 ，Infra 本身在我眼中就是产品 。

**Host** [1:20]
你本身是一个喜欢 intense 的人吗 ？

**盛颖** [1:22]
我是一个必须 intense 的人。 就是你觉得你是 adhesive，但它不是一个疾病 ， 它是一个特点 ， 它是一个手册 。 我突然知道 ， 就是我应该顺着我的天性去做事情 。

你一旦悟到了这个之后， 很多事情就迎刃而解 。 你的电视剧看到那一半 ， 你突然 " 诶 ， 我怎么突然开始知道怎么解决这个问题了 "， 暂停 ， 谢谢暂停 。

**Host** [1:41]
你还记得是什么电视剧吗 ？

**盛颖** [1:42]
《 甄嬛传 》。

**Host** [1:43]
我去 。

**盛颖** [1:45]
世界上存在那么纯粹 、 那么好的导师 ， 存在那么好的投资人， 存在那么好的采访者 ， 那些好的人都存在 。

但是你要非常相信他 。 你要相信到你身边没有这样的人， 你还相信他 。 然后有一天 ， 那个跟你一样相信的人 ，他有一天会跟你相遇 。

**Host** [2:01]
那么这期视频播客 ， 我建议大家配合我们上一期的解释性视频一起看 。 上个视频我们从 SGLang 的技术入手 ， 解释了 AI Infra 的作用 ，以及软件层怎么能够把硅的极限给炸出来 。

相信对 AI Infra 的技术比较了解之后， 再来看这期我和盛颖的对话 ， 可能就会有不一样的感受 。 还有就是 ， 嘉宾在美国多年谈到技术的时候 ，有些词会用到英文表达 ， 我们也在字幕上给出了翻译 ， 请大家多多的担待 。

那么以下就是我和盛颖的视频播客 。 非常感谢盛颖 ， 欢迎做客硅谷 101。

**盛颖** [2:35]
感谢你们的采访 。

**Host** [2:37]
我看你们是刚刚搬到这个新的办公室 ，是吗 ？

**盛颖** [2:41]
对 ，9 月 1 号刚搬过来 。

**Host** [2:42]
你们现在大概多少人 ？

**盛颖** [2:44]
现在有 40 多人。

**Host** [2:45]
扩张会非常的迅速吗 ？

**盛颖** [2:47]
其实比我预期的快 。 因为事实上， 我们扩张 scope 增长的也比想象的快 。 然后各个地方都需要人， 我们能招进来的人也比我想象的要更有更多 qualified 的 candidates， 所以我们也稍微有一点 stress，但是我们已经在控制 。

**Host** [3:03]
今天会讲一讲你整个的学生时代 ， 到你之后的这个研究时代 ， 再到就是你出来在 X， 还有你自己现在 startup。

然后我们可以按照这个顺序来讲 。 那首先 ， 你其实是大学在上海交大 ， 然后上了 ACM 的荣誉班 ，2017 年就来到了美国哥伦比亚大学读硕士学位了 。

### 数学之美

**Host** [3:23]
当时出国是因为大家都要出国吗 ？ 就是为什么选这条路呢 ？

**盛颖** [3:27]
确实也是因为大家当时很多人是要出国 ，但是我其实对出国的概念知道的很晚 。 我觉得我从江西到本科的时候 ，是经历了一个很强的 cultural shock 的一种感觉 。

就是我觉得我身边的人更理解职业发展 、 人生发展 ，他们有更多的规划 。其实我是处在一个无知状态 。

我记得我本科刚毕业的时候 ， 一开始其实我甚至没有申到什么 ， 就是我申请了美国的大学 ，但我其实没有拿到 offer。

一开始当时有一个港中文大学的 PhD 的 offer， 然后我接了 ， 甚至都已经 。 申请的时候我就有个君子协议 ，4 月 15 号 ， 君子协议都已经过了的第二天 ， 我突然收到了哥大给我发的一个很普通的研究生 ， 就 master offer。他其实是个很普通的 offer， 就是很多人都能拿到 。

但是我当时就觉得我想接触一些新的东西 。 我想因为那个时候的学术中心还是在美国 ， 我觉得我想出去看到 ， 哪怕哥大的这个 master program 它不是一个特别顶尖的 program，但我希望我想看到 。

然后我当时我还跟我爸打电话说 ， 这个我们前面 PhD offer 能不能回 ， 我还需要交一笔违约金 ，但是我想出去看看 。

我还犹豫了一下， 然后给我爸打了通电话 ，但我爸非常快 ， 就是一分钟就说好 ， 你去 。

**Host** [4:29]
就交了违约金 。 那你说你从江西到上海 ，其实是有一段 culture shock 的 。 那你从上海到美国 ，也是不是经历了 culture shock？

**盛颖** [4:38]
也有吧 。 我觉得我确实是每一段都是那个舒适圈打破在早期的经历里 。 但是我在纽约的感受要 ， 纽约是很包容的一个城市 ， 这个 shock 其实不太 shock， 就是我感到不一样 ，但我觉得极大的被包容了 。

**Host** [4:50]
具体体现在什么方面呢 ？

**盛颖** [4:53]
就是我觉得在纽约当时文化让我觉得没有人盯着我看 ， 没有人在乎我穿什么 、 想什么 、 做什么 ， 我想要什么 。

我在纽约感受到那个 shock 更多的是一个不需要被 judge，也不需要 judge 别人的 shock。 这个 shock 是从一个被限制状态到一个完全自由状态的一个 ， 对 ， 它是个 shock，但它其实是个更放松的过程 。

**Host** [5:12]
挺好的 。 那我看你在那个哥大硕士阶段发表的论文还是比较偏理论的嘛 ， 主要是测试函数 ， 然后线性回归的数学性质 。

后来到了斯坦福读 PhD 的时候 ， 你选择了形式化验证方向 。 那么先跟我们说一下在哥大你从事的这些研究 ，其实对你后来的研究有产生任何的影响吗 ？

**盛颖** [5:32]
我刚上研究生的时候是没有想要做研究的 ，但是我第一学期时候上了计算复杂性的课 ， 当时觉得很有趣 。

然后我又碰巧交了一些当时的朋友 ， 就是当时的博士生朋友 ， 然后他们都是做理论的 。 然后我就觉得这个领域非常有意思 ， 我就找老师和这些同学们说能不能有一些问题可以研究 。

研究了一段时间觉得很有趣 ， 然后也有成果 ， 所以自然而然的就到了斯坦福 。

**Host** [5:59]
就是你研究生毕业的时候 ，有考虑过我要工作 ， 还是说我要申请博士吗 ？

**盛颖** [6:05]
我一开始是没有想要申请博士 ， 或者说我也没有觉得我不会申请博士 ，但是我没有盯着这个目标去 ， 我没有对着这个目标去 。

我觉得它是 open 的 ， 所以我也保留了这个选项探索了一下 。 但我后来发现那个理论的问题非常有意思 ， 我自己也非常享受 。

我当时就是觉得我甚至也不需要赚很多钱 ， 我觉得我想 stay pool， 我想找一个没有人的地方 。 我当时有一次去那个普林斯顿 ， 我去参加一个 workshop， 然后我当时被那个环境就直接包围了 。

进到普林斯顿那个校友那个环境里面 ， 我就突然觉得与世无争 。

**Host** [6:34]
非常的 academic。 跟哥大有不少不同 。

**盛颖** [6:37]
它就是与世无争 。 进到那里的感觉就是没有 ， 就是会觉得你人世间的很多这种大家所在乎的东西 ， 你平时去挣扎沉浮的东西都非常的没有意义 。

**Host** [6:47]
是学校的环境给你这样的感觉 ， 还是说那边的人 、 他的氛围是那样的 ？

**盛颖** [6:52]
应该也是 ， 还是那个 workshop 给我带来的 。 那个环境加上那个 workshop 里的人带来的讨论的这个氛围感 。

那个氛围感让我觉得所有事情都是不重要的 。 我觉得人的想法都七情六欲都是不重要的 ， 都是甚至看上去有点荒诞的 。

**Host** [7:04]
那什么是重要的 ？

**盛颖** [7:06]
就是什么都不重要是重要的 。 这是一种虚无 ， 你觉得虚无才是它真实的东西 ， 就只有真实是重要的 。

**Host** [7:13]
真实是重要的 。

**盛颖** [7:14]
然后数学在那个环境下就会显得特别的美好 ， 特别的优美 。 因为它是确定性 ，而且是绝对化的 。

然后你在跟它打交道的时候 ， 没有什么其他东西需要思考 。 它可以让你非常的沉静和 focus， 或者说你可以在这个环境里面进入心流状态 ， 思考问题的时候进入心流状态 。

这个心流状态是与人无关 ， 与其他所有事情都无关 。 大脑被完全的调转起来的时候 ， 进入一种生理性愉悦 。

我有点描述不出那个感觉 。

**Host** [7:44]
我能 get 到你的意思 。 但是这个状态我觉得非常的纯粹 。

**盛颖** [7:48]
就是很纯粹 。

**Host** [7:49]
很像一个会成为一个数学家的人的一个状态 。 但是你后来为什么没有成为一个数学家呢 ？

**盛颖** [7:55]
对 ， 我当时就是很想成为数学家 。 我当时觉得我就要成为一个数学家 。 我觉得我只想做数学 。 但是事情的发展总是不是那么简单嘛 。

那毕竟我还是有生活上的各种干扰 。 到了斯坦福之后， 第一年也确实没有再 ， 我觉得到了斯坦福我就没有那个感觉了 。

我不知道这个是不是 。

**Host** [8:13]
斯坦福不如普林斯顿纯粹吗 ？

**盛颖** [8:16]
普林斯顿那个只是一场 travel， 我人在哥大 ，但是我在哥大的时候也能感受到这个氛围 。 我甚至现在觉得是不是西海岸和东海岸其实有一点这种文化的差异性在 。

西海岸就是慢慢你会感觉到更多的这种关于成功与否的这种 noise， 就是你想要参与世界的推动 。 我又开始觉得我跟世界有关 ， 我又觉得我不想跟世界无关了 。

但我在东海岸的时候 ， 我觉得我希望我跟世界无关 ， 我希望我被世人遗忘 。 很不一样的一种感受 。

但我在斯坦福第一年的时候想做理论 ， 那个时候斯坦福是有 rotation program， 要配导师 ， 配到了之后你才决定你后面五年体验世界旅程怎么走 。

前面几期 rotation 因为各种各样的原因 ， 比较复杂 ， 各种各样的原因 ， 没有再遇到很让我觉得能够进入心流状态的问题 ，也没有跟哪个老师能够双向的都觉得很 exciting。

可能老师们也觉得我对他的问题不是特别感兴趣 。 有一些情况也是 ， 我可能也觉得那个老师我们没有完全 match 上 。

最后到了第四轮 ， 跟我现在后来导师 Clark match 上的时候 ， 就已经进入到一个新的 topic 了 。

**Host** [9:15]
是 Clark Barrett 教授 ， 对吧 ？ 他其实是做形式化验证的一个方向 。 能不能跟我们的观众来解释一下什么是形式化验证 ？

**盛颖** [9:25]
这个领域也很大 ，但我可以简单讲我当时做的一部分的话题 ， 一部分的课题 。 我们当时一部分的课题是我们要把我们人写出来的代码进行拆解和映射 ， 然后把它映射到底下的底层的这个数学逻辑上 。

你可以把这个代码映射到一阶逻辑 ， 你在这个逻辑出来之后， 你就可以从数学角度去证明你写的这份代码它是不是具备某一个性质 。

我更具体的来说的话 ， 我一份代码其实 ， 你隐藏的来说 ， 我们是有一个东西叫做 spec specification。spec 其实是说明了这个代码它应满足什么前驱条件 ， 它会有什么样的 invariant， 然后你代码执行完之后要满足什么样的条件 。

你可以有这样一套语言去描述这个程序 。 然后你要证明的就是 ， 如果你在有这个 spec 的情况下， 你的代码是不是真的符合了这样一套逻辑 。

从代码映射到这个逻辑 formula 之后，formula 之间的这个证明和推理 ， 就是我做的那个领域 ， 研究领域 SMT Solver 做的事情 。

然后我的研究大部分是在 SMT Solver 的那个 Solver 本身的优化 。 优化一方面跟 efficiency 有关 ， 一方面跟正确性有关 ，但它更多的是跟你怎么定义语义有关 。

就是你定义什么样的语义空间可以去表达你一份代码所做的事情 。

**Host** [10:36]
在斯坦福其实你开始这个深入形式化验证之后嘛 ， 我们看到就是开始狂狂出论文了 。2020 年是拿到了 IJCAR 的最佳论文奖 ，2022 年是拿到 IJCAR 的提名 ， 后来又是 CVC5 的贡献者之一 ，是拿到 TACCUS 的最佳工具论文奖 。

太高产了 。 你觉得这段时间你的一个研究的状态是什么样子的 ？

**盛颖** [10:58]
其实这个真实的过程比外面看到的这个简历上的内容要干瘪很多 ，其实也要包容很多的 。 我其实在斯坦福前几年的经历并不顺利 。

一个是我首先刚进来第一年的时候 ， 找导师其实就不是很顺利 ， 被动的进入了这个形式化方向的领域 。

因为我要读这个 PhD， 所以我才就是需要把这个地方不停的去做研究 ， 产出论文 。 所以我其实是比较被动的状态 。

当然我在做的过程中慢慢的也欣赏到了它的美感 。 后来我慢慢理解这件事情它为什么有意思 ，以及我后来有些更多的思考 ， 我觉得它其实还有一个很有意思的未来 。

但是最开始做 Polysimus 那篇论文的时候 ， 就是我 Disney、Ijka、Best Paper 那篇 ， 非常非常的意外 。 因为我当时是一个完全小白的状态 ， 我对这个领域不知道 。

导师给了我一个问题 ， 我去解决它而已 。 然后我做完它的时候 ， 我也没有任何的认知说什么样是这个领域里最好的 paper，因为我看的 paper 还不够多 。

所以这个讲出来的时候 ， 我完全没有想到被别人 congrats 的时候得知拿到了这个奖 。 那个是我进这个领域发的第一篇论文 。

但是发完这篇论文之后 ，其实我就又重新进入一个很 down 的状态 。 就是我还是没有找到我想要做的下一个问题在哪 ， 就是 exciting 的问题在哪 。在那篇文章做完之后， 我记得就进入疫情了吧 。

进入疫情我其实有长达一年的时间是没有做任何事情的 ， 接近一年的时间在一个 depression 的状态里 。 但我遇到了非常好的导师 ，Clark 非常的 supportive。他完全理解说我要调整好这个状态 ，他只关心我是不是有一个好的精神状态 ， 只关心我是不是能够走出来 。他没有给我施加任何我需要继续产出论文或者做 research 的压力 。他说那我可以去上一些课 ， 做一下 TA， 做一些这种很轻

量级的事情 。 之前还回国待了半年， 一个疗愈期 。 然后我其实没有产出论文 ，但是 Clark 从来没有断过我的经费 。

**Host** [12:44]
那确实是非常好的导师 。

**盛颖** [12:46]
非常好的一个导师 。 然后我一年之后才慢慢走出来之后， 才又做了 sequence 那篇 paper。 我们前面也有过很多挣扎 ， 证明应该是写了 20 多页吧 ， 来来回回改了四五次 ，而且有两次我几乎是全部推翻重写的那个证明 。

已经花了一两个星期推出来的证明 ， 吃鸡的证明 ， 全部推翻 。 因为你从一开始的地方发现有个基点错了 ， 那个错了之后后面所有的后续推理全部是错的 。

所以那个证明从前面要一直 fix 到全部全部重新推翻重来 。 但是这个过程走完之后很有成就感 。

最后这个证明完全写完之后， 比一开始设想的要复杂的多很多 。 我们都觉得这段证明写出来和这段经历非常的 accomplished， 就是很有满足感 。

我记得那个时候 Clark 自己也说那篇 paper 里的证明是他过去一年的 highlight。 当时也是 best paper 提名 ，但是没有被公开 ， 就是大家讨论过 ， 最后没有被选上 ，但是很接近 。

如果说我在形式化工作的话 ， 这篇 paper 可能是我觉得最愉悦的一段时间 。 从这篇 paper 开始 ， 我开始看见了形式化理论的这个里面的一些深刻的含义和它的优美之处 。

**Host** [13:44]
它的优美之处在哪里呢 ？

**盛颖** [13:46]
它让我理解了程序语言设计的几个不同角度吧 。 就是形式化的这个方法去设计语言 ， 它是从数学的角度去理解程序语言的 。

程序语言我打了很久很久的交道 ， 我打了 20 年的交道了 ，但是我从来没有以这样的角度去看待过它 。

然后它给了我一个全新的视角 。 但是你会发现程序语言里面它有很多的 trade off， 不同角度上 。 有一些语言更接近数学 ，有一些语言更接近硬件 。

你其实很难有一个支点让你一个语言它离数学和硬件都很近 。 接近数学的语言它会更容易被验证 ， 更容易被形式化 。

接近硬件的语言会更灵活 ， 更高效 ， 更接近人的思维习惯 。 就是当你需要编程硬件里面的具体运算的时候 ， 那样的 mapping 就更直接 。

**Host** [14:28]
最后没有再往这个领域继续的走下去 ，是因为什么呢 ？

**盛颖** [14:32]
我看到了它的有意思的地方 ，但是我也看见了它这个领域的局限性吧 。 它能够在现实中 practically 被应用的场景太少了 。

然后你要验证一个程序太贵了 ，但是它能验证的又很少 ，不能产生足够大的影响 。 但是我觉得我想离世界更近一点 ， 我还是想要做更接近真实生活的东西 ， 当时觉得 。

所以我那个时候就开始探索 AI， 然后开始寻求双向转化 。 开始探索 AI 这个过程其实也不太顺利 ， 可能我又有一年的时间的空窗期 。

就是你看上去我的 publication 没有停 ，但其实我中间有很多的空窗期 。

**Host** [15:07]
你外界的空窗期跟你自己定义的空窗期是不一样的 。

**盛颖** [15:10]
对 ， 我自己定义的空窗期就是那段时间我没有做任何 ， 我其实没有 make progress。在我转 AI 的时候又有大概一年的时间 ， 我其实没有任何新的 idea， 我实际上没有做任何事情 。

可能长达一年之后， 我突然某个时间找到事情可做的之后， 我三个月产出了一件事情 。 但是外人看来你会觉得那个作品是我过去一年的成果 ， 实际上它是我过去一年里最后三个月的成果 。

前九个月我都在这个 zero 状态 ， 完全不知道自己在干什么的状态里 。

**Host** [15:35]
我非常理解这个过程 ， 就像我们记者写稿子也是一样的 。 对 ， 你那个给我一个月的时间 ， 前面 29 天的时间我都在做 research， 或者是放空 ， 或者是采访 。

然后我其实这个稿子就是用一天时间写出来的 。

**盛颖** [15:48]
对 ， 所以你看上去 ， 比如我形式化 ， 我可能发了三篇 paper， 分布在三年时间里面 ，但每篇 paper 真正推动其实它都只花了什么三个月的时间 。

然后我这三年里面每年都有九个月不知道在做什么 。其实你不知道在做什么 ， 你可能是在就是 。

**Host** [16:02]
在迷茫嘛 。

**盛颖** [16:02]
想要去找到你想解决的问题 。 因为我听下来就是说 ， 要去找到一个你真正感兴趣的问题 ，并且解决它真的是你的一个 driver， 一个驱动力 。

是的 ， 这个是的 。 就是我确实有一些特点 ， 就是我没有办法妥协 。 我后来服从了我的这个特点 。

就是我原来在不理解我自己的时候 ， 我尝试努力去适应过一些规则 ，但是我后来发现我自己是不能被勉强的 。

就是我没有办法做我不感兴趣的事情 ， 没有办法做好 。 我能做 ，但其实我没有办法做好 。 我只有这个事情它让我觉得非常 exciting， 我才有可能把那件事情做好 。

**Host** [16:38]
这是一个特别特别纯粹的一个性格 。 你当时什么时候发现说这个性格就是这样了 ， 我必须要去服从我这个性格呢 ？

**盛颖** [16:49]
这是一个缓慢发展的过程 ， 倒也没有某一个时间点突然顿悟了 。 它是一个我慢慢意识到 ，以及终于有一天我完全接受它的一个状态 。

我完全接受它可能是在博士的最后一两年吧 。

**Host** [17:04]
你本身是一个喜欢 intense 的人吗 ？

### 低谷与甄嬛传

**盛颖** [17:06]
我是一个必须 intense 的人。

**Host** [17:09]
从小就是这样的 。

**盛颖** [17:10]
对 。

**Host** [17:10]
我觉得从你发 paper 的那个数量和节奏就能看出来 。

**盛颖** [17:14]
对 ， 我没有办法 。 就是我哪怕睡觉的时候也会一直做梦 ， 就是我没有办法停下来 。

**Host** [17:18]
你做梦也会梦到跟你研究或者工作相关的事 。

**盛颖** [17:21]
那肯定会啊 。

**Host** [17:22]
肯定会 。

**盛颖** [17:23]
会啊 ， 大家都会吧 。

**Host** [17:24]
你们生活的梦是完全无关的呀 。

**盛颖** [17:26]
我都是还是挺有关的 ， 都是跟生活 。

**Host** [17:29]
就说明你在睡觉的时候 ， 你的前四位其实还是在工作 。

**盛颖** [17:32]
有可能是生活 ， 就是工作生活 ，但它一般来说都不是没有任何关系的东西 。 但肯定会有虚假的成分 ， 会有想象的空间 ，但是它不会是毫无关联的 。

我觉得我 PhD 经历的那段 depression 的时期 ， 就是因为那段时间太无聊了 。 因为疫情的时候大家都 slow down 了 ， 然后我根本没有办法在一个 slow down 的环境里面保持我 mental 的 healthiness。

**Host** [17:52]
所以就是一定要忙起来 ， 然后才能让你健康的运作 。

**盛颖** [17:56]
我不一定要忙起来 ， 我不一定要忙起来 。 我 master 做那个 theory 研究 ， 做数学研究的时候是不忙的 。 那个时候你是很沉浸的 ，因为那个问题它就是你除了看着一张纸 ，在那想其实也没什么能做的 。

我看上去很闲 ， 我每天还 ， 我每天可能也就想四个小时， 然后工作四个小时， 然后我就去打游戏了 。其实我 master 期间打了好多游戏 ，因为那个问题都太难了 ， 你没什么时间可做 ， 你只能空想 。

**Host** [18:18]
你打游戏的时候也很 intense 嘛 ， 对吧 ？

**盛颖** [18:20]
其实也没有 。 我觉得那个 theory 非常不一样 。theory 就是有很多灵感 ， 你只能等它来 。其实你没什么事情可做 ， 你只能在那等 ， 你等着那一刻来临 。

所以我有大量的时间去打游戏 。

**Host** [18:31]
那游戏专业就灵感来了 ， 然后去写一写是吗 ？

**盛颖** [18:34]
其实我那个当时那个题目做解说 ， 就是在我看电视的时候想到的 idea。 对 ， 我也不知道为什么 ，但确实那个 context 是我看电视之前看的一篇 paper， 然后我就开始看电视去了 。

看到中段的时候 ，不知道为什么那个 paper 里的东西突然回响了 ，echo 出来 ， 然后突然又想到了 paper 里的那个点 ， 突然意识到这个地方可能是一个解法突破点 。

那个就是关键点 ， 就是你那个问题被解决的那个就发生的那个瞬间 。 那个是真的是有一个 phase transition， 就是那个是一瞬间的事情 ， 就是那个时刻 ， 那个问题被解掉了 。

然后你个电视剧看到那一半 ， 你突然 ， 哎 ， 我怎么突然开始知道怎么解决这个问题了 。 暂停 ， 谢谢暂停 。

**Host** [19:09]
你还记得是什么电视剧吗 ？

**盛颖** [19:10]
甄嬛传 。

**Host** [19:11]
我

真的记得 。

太神了 。 我一般是在洗澡的时候会有灵感 ， 突然记住 。

**盛颖** [19:19]
也会有 ，也会有 。

**Host** [19:20]
但是电视剧我觉得我很少 ，因为就是看电视剧你还是要很沉浸的嘛 。 但是就是看起来你看电视剧的时候 ， 你的潜思维感觉还是在一直在思考一些 。

**盛颖** [19:31]
我会 。 就前面说到我跟我自己和解 ， 我是怎么和解的呢 ？ 就是我以前不知道 ADHD 这个东西 ，有一天我就慢慢的了解到有个东西叫做 ADHD。

然后我看完那个各种症状深入理解之后， 我发现好多东西都可以被解释 。

**Host** [19:43]
就你觉得你是 ADHD 吗 ？

**盛颖** [19:45]
我确实是 ， 我挺喜欢看心理医生 ，但它不是一个疾病 ， 它是一个特点 。 学习之后我发现好多事情被解释了 ， 我就它给我带来最大帮助是我通过理解它而理解了我自己 。

像是我找到了怎么使用我自己的一把钥匙 。 我突然知道了就是 。

**Host** [19:59]
手册有了 。

**盛颖** [20:00]
对对对 ， 它是一个手册 。 我突然知道了就是我不应该逆着我的那个短处去 ， 我不应该逆着我的甜心去做事情 ， 我应该顺着我的甜心去做事情 。

它告诉我这件事情 。 然后你一旦悟到了这个之后， 就很多事情就迎刃而解 。其实你其实很多事情是不要勉强的 ，是没有必要勉强的 。

对 ， 所以我前面说的我只能做我喜欢做的事情 。 当你把这个当成真理的时候 ， 你就不再跟它对抗了 。

**Host** [20:21]
特别特别棒 。 对 ， 然后我们聊 。

**盛颖** [20:24]
我刚刚说这个是因为 ， 对 ， 可能我已经开始有点这个症状显现了 。 就是它的这个特点之一就是我看电视的时候也是不 focus 的 。

**Host** [20:34]
也是不 focus 的 。

**盛颖** [20:35]
对 ， 就我看电视的时候我也会跟不上那个电视的内容 ， 我经常要回退 。 我经常要往回拉 ， 哎 ， 刚刚讲了什么 ，30 分钟的视频我经常要看四五十分钟才把它看完 。

**Host** [20:45]
那比如说你自己在做 research 或者你在工作的时候 ， 就是什么样的时候你会非常 focus， 什么样的时候你其实是没有办法 focus 的呢 ？

**盛颖** [20:54]
就是我自己特别被它吸引的时候我非常 focus。 它这个是两极化的 ， 就是我 focus 的时候非常 focus，focus 的时候我会听不见别人叫我的名字 ，不记得时间 ，不知道外面发生的事情 ， 会错过很多个 meeting。

然后不 focus 就是根本没办法 focus， 就是哪怕这事情很重要我也不见得 focus。

**Host** [21:10]
看甄嬛传都没有办法 focus 是吧 ？

**盛颖** [21:13]
说明甄嬛传不够吸引人。 它如果够吸引人我就会非常 focus。

**Host** [21:17]
打游戏会非常 focus。

**盛颖** [21:19]
打游戏非常 focus。 有些运动 ， 竞技性的运动也会 。

**Host** [21:21]
它需要非常的 intense。

**盛颖** [21:23]
对 ， 它要非常 intense， 它要非常激烈 ，有它要 competition。 就是游戏的话你是对打 ， 玩有输赢 ， 球类运动也是你有输赢 。

这个时候的时候我就会非常 focus。

**Host** [21:31]
所以你是一个好胜心很强的人。

**盛颖** [21:33]
我觉得我不是真的很在乎输赢 ，但是我在乎那个 intense 的感觉 。 我喜欢那个感觉 。 我其实不在乎输赢 。

我游戏可以输 ， 大比赛也可以输 ，it's okay。 我也不会觉得那个我非要赢 。 但是你这个机制设计进去了之后， 我会很享受那个心流状态 。

就是还是那个我喜欢心流状态 。 你的大脑被抓住 ， 然后你就是非常 ， 就是心流吧 ， 就是人非常 focus 的时候 ， 那个应该就叫心流状态 ，是很享受的 。

**Host** [21:57]
所以打游戏 、 研究 、 学习 ， 这个上面你都可以获得你的心流状态 。

**盛颖** [22:03]
对 ， 学我喜欢的东西可以 。

**Host** [22:05]
再提一个你大学的问题哈 ， 然后我们到这个公司上面来 。 就竞赛圈嘛 ， 它其实是一个很有那种天才标签的这样的一个圈子 。

对 ， 你觉得就是天才这个词在你身上安的多吗 ？ 就是很多人会跟你说你好像是一个天才 。

**盛颖** [22:23]
不多 。

**Host** [22:24]
甚至你就是拿了这个竞赛的金牌之后都没有吗 ？

**盛颖** [22:28]
我没有拿金牌 ， 首先 。

**Host** [22:30]
对 ， 你是拿了这个全国信息学奥林匹克的银牌 ，但是我记得你好像是在纽约的一个 。

**盛颖** [22:38]
纽约那个区域赛冠军 。

**Host** [22:40]
区域赛冠军 ，ok。

**盛颖** [22:41]
那个区域赛冠军也是组队 ， 就是三个人一个小队 ，也没有说是我个人成就 。 我的队友其实非常强 ， 非常运气好 ，有非常强的队友帮我带飞了 。

不是经常 ， 肯定有啊 ，但是少说更多一点 。 后来不是经常 ，因为虽然有这些拿了这些奖项 ，但好像其实都不是 ， 就比方说那银牌不算啥 ， 还有很多金牌选手呢 。

**Host** [23:01]
对 ， 所以对啊 ， 就看你跟谁比嘛 。

**盛颖** [23:05]
但是我在的那个环境里面 ，他们总是有比我更强的 。 那比方说我在 SMBA、SMBA 里面有比我更强的 ，有很多比我更强的 。

**Host** [23:11]
所以就是你觉得努力这件事情更重要 ， 还是天分这件事情更重要 ？

**盛颖** [23:16]
我赞成天分 。

**Host** [23:17]
那你觉得在研究上面 ， 天分它主要表现在什么样的方向呢 ？

**盛颖** [23:21]
天分是指当外界人不把研究当回事 ，不觉得研究不觉得研究是件伟大的事情的时候 ， 你还想做它 ， 那就是你的天分 。

**Host** [23:30]
那叫兴趣 。

**盛颖** [23:31]
我觉得大部分时候天分和兴趣相关性还是蛮强的 。

**Host** [23:35]
这么说吧 ， 可能很多人想当 researcher，但不是很多人都能研究出来或者解决这个问题 。 就你能解决这个问题肯定是有你的天分在 。

**盛颖** [23:44]
对 ，是有天分的 ，但我其实首先不觉得大多数人真的想成为 researcher。 我见过太多的人 ，他们想做研究 ， 想成为 researcher，是因为他们觉得这件事情酷 ，是因为外界的环境让他们觉得这件事情很酷 。

**Host** [23:56]
或者当教授是一个铁饭碗 。

**盛颖** [23:58]
类似 ， 反正就一些原因 ，但这个并不是 。 如果说当所有人都开始觉得当教授是一个被人唾弃的职业的时候 ，他们马上就不会想做了 。

就你这你能识别出来 。 但是在我当时想做这件事情的时候 ，其实我是 ， 就是比方说我在的环境里面 ，其实大家也没有觉得做 theory 是件多么伟大的事情 。

然后你赚的钱也很少 ，但是你还是想 ， 你还是觉得它有意思 。 我想做这件事情是因为我希望跟别人无关 ，是因为我享受 irrelevant。

那个时候才是你真正的所谓的兴趣和天分所在的时候 。 我也不敢说我有天分啊 ， 那我毕竟也没有发明过什么 ，也没有什么巨大的数学成就 ， 我也不能算有天分 。

**Host** [24:38]
你肯定是算有天分的 ，不然的话你 paper 怎么能发那么多 ？

**盛颖** [24:42]
有很多人 paper 发了很多 ， 比我发了 paper 多的人还有很多 。

**Host** [24:45]
那可能就是更有天分的 。

**盛颖** [24:47]
发 paper 只是一个 ， 发 paper 是有套路的 。

**Host** [24:51]
什么套路 ？

**盛颖** [24:52]
就是发 paper 其实你如果掌握了发 paper， 发 paper 本身是一个技能 。 发 paper 跟做 research 是两件事情 。 发 paper 跟人们定义的做 research 和真正意义上的科学家是三件事情 。

**Host** [25:02]
Ok。

**盛颖** [25:03]
发 paper 是有套路的 ， 你完全可以一个人 ，他根本就不怎么懂 research，他也能发很多 ， 哗啦哗啦发很多 paper。

**Host** [25:08]
就像一个是一个什么命题作文一样 ，是不是 ？ 你套着它那个框去写就可以了吗 ？

**盛颖** [25:14]
对 ， 就是你只要掌握了这个规则 ， 然后你掌握了这个体系的规律 ，在同样的规律里面不停的产出 ， 你就可以一直发很多的 paper。

**Host** [25:21]
但是顶刊也很少啊 。

**盛颖** [25:24]
不少了 ， 现在顶刊一年都几千篇 ， 上万篇 。

**Host** [25:27]
这么多人去投稿的话 ， 那顶刊还是算少的吗 ？

**盛颖** [25:30]
对 ， 那肯定是有 spectrum 的 ， 那肯定 ， 那我可能还是比 average 要有天分一些 。

**Host** [25:35]
对 ， 就是掌握这个套路本身就是一件有天分的事情 。 所以你说发 paper 跟做研究跟当科学家是三件事情 。

**盛颖** [25:43]
做研究 。

**Host** [25:43]
发 paper 跟打工人是一样的 。

**盛颖** [25:45]
跟打工人是一样的 。

**Host** [25:46]
就是一个非常平凡的事情 。

**盛颖** [25:47]
Ok。

**Host** [25:48]
做研究跟当科学家 ， 这两者有什么区别吗 ？

**盛颖** [25:51]
做研究的话就是有很多研究 ，他们其实是不 breakthrough 的 ，也是不 key 的 ，但是不是没有价值 。 所以做研究它仍然是个职业 ， 它只不过是一件职业 ， 只不过是我们做 ， 我作为一个 researcher， 我喜欢享受做研究 ， 所以我在这里做研究 ，而并不是我比别人更有天分 。

我没有天分 ， 我也可以是个 researcher。 所以 researcher 只是一个职业 ，但我所说的科学家这个名词我可能也用错了 ，但我就说还有另一类 ， 就是真正在推动人类知识边界的人是非常非常少的 。

然后这批人一般来说 ，但我的 bar 也很高啊 ， 就是在我眼中真的在推动 。 这个推动就是指如果不是它 ， 这个事情会玩很长时间发生 。

这个是被我定义的所谓真正的科学推动者 ， 就是推动人类边界的这批人， 这批人就非常非常少了 。

绝大多数的教授可能都不是 ， 对吧 ？ 绝大多数还是在第二类 ，是 researcher。

**Host** [26:37]
所以 Jeffrey Hinton， 然后 Yann LeCun， 还有 Joshua， 就是图灵奖的这三个人， 你觉得他们是科学家吗 ？ 或者是你定义的第三类人吗 ？

**盛颖** [26:47]
应该是吧 ，不过我没跟他们直接接触过 ， 所以我还是不给我直接定论 。 我非常在乎一手信息的 ， 我非常在乎 truth seeking。

我不想评价我没接触过的人 ，但既然他们世俗成就这么高 ，他们应该是吧 。

**Host** [26:59]
你在谷歌实习是什么时候啊 ？

### 谷歌与导师

**盛颖** [27:01]
22 年的暑假吧 ， 应该是 。

**Host** [27:04]
在谷歌实习了之后， 你想要转去做 AI 的 ， 还是在谷歌实习之前你就看到了这个方面有非常大的一个前景 ， 然后发展很快了 ？

**盛颖** [27:15]
我是在去谷歌之前就想要转 AI， 然后我是因为想转 AI 所以找了那份实习 。 那份实习是 AI for code 的嘛 。

我之前也尝试了一些其他的纯 AI 岗 ，他们都不收我 ， 我都没有拿到机会 。 这个岗位跟 programming analysis 有一点关系 ，因为这个背景被招进去了 ， 所以我接触到了 AI，但我其实是因为想接触 AI 进去的 。

但是我进去之后发现 ， 当时的人们做 AI for coding 的时候 ， 还企图利用一些原来的 programming analysis 里面的 technique 或者 tools 什么的 ， 非常的无力 ，其实什么忙都帮不上 。AI 人的幻想说我是不是可以利用一些另外一个领域的工具 ， 交叉学科的这种希望嘛 ， 利用另外一个领域的工具来帮助更好解决这个问题 。

但是我作为从另一个领域过来的人， 我其实发现这个工具非常的无力 。 当时就是看到了那个大模型已经是 coding 之初 ， 相反我反而看到了大模型其实已经把传统的这个领域里的技术都完全覆盖了 。

**Host** [28:08]
那个时候其实还挺早的 ，22 年， 它应该 ChatGPT 它还没有出来 ，但是在谷歌内部大家其实已经看到了这个方向了是吗 ？

**盛颖** [28:15]
我估计其他的公司肯定也是有的 ，但是确实 ChatGPT 还没有出来 。 那个时候是谷歌刚出 Palm， 然后内部有那个 Lambda， 就大家其实已经有所感觉了 ， 只是没有到全民爆发的阶段 。

**Host** [28:25]
当时好像有个谷歌的程序员 ，他号称 Lambda 是有意识的 。

**盛颖** [28:29]
对 ， 就是那个时候 。

**Host** [28:30]
那个时候我们还做了个报道 ， 然后还讨论了一下这个 AI 是不是有意识的 。

**盛颖** [28:35]
对 ， 就是那个时候的事情 。

**Host** [28:36]
我相信很多程序员他们可能也是第一次 ， 或者是很新鲜的一个感觉去接触 AI， 才会有它到底是不是有意识的这种讨论在那个时候 。

**盛颖** [28:45]
对 ，其实已经有 ， 确实已经很多人是已经看见了那个潜力 ， 很大的潜力 。 但是当时的模型潜力离真的生产 code 还有挺大距离的 。

我记得当时都是做一些生成一两百行的代码 。

**Host** [28:56]
当时你们那个小组有多少人啊 ？AI for code 的那个小组 。

**盛颖** [29:00]
那个也是一个谷歌内部孵化的创业项目里 ， 就 Google X 里面 ， 全职应该 ， 我其实有点不记得 ，但好像一二十个人吧 。

然后那个暑假他们非常激进 ，他们想要尝试很多方向 ， 所以他们招了跟全职等量的 intern， 让这些 intern 全都去尝试 ， 疯狂尝试不同的方向 ，他们希望能从中看到一点东西 。

**Host** [29:18]
那后来这个 internship 结束的时候 ， 大家看到了什么东西 ？

**盛颖** [29:22]
我觉得当时那批人其实很多人后面还是 ， 很多人就还在做 code。 那段经历对我的影响很大 ， 它让我看见了 ，因为我原来是不知道 AI 是怎么什么事情的一个人。

我经验中看见了 AI 原来这么多 powerful， 我发现原来根本就不需要什么显式的 reasoning。 我是被 shock 到的那一个人。 它让我非常坚定的进入了这个新的 topic， 然后我就要做大模型 。

**Host** [29:42]
但大模型其实有很多分支跟不同的 vertical 嘛 ，但是你选择了做 infra 的那个赛道 ， 为什么呢 ？

**盛颖** [29:50]
其实也不是我选择 ， 我其实也尝试了那个不是 infra 赛道的 ， 就是分析一下算法上的事情 ，但我发现我更适合 infra。

我那边可能没有太成功 ，infra 成功了 ， 所以最后登上了 ， 就是我的爆发都在 infra 这一侧 。 做 infra 跟我的思维习惯更接近 ， 它是可 reason 的 ， 确定性的 ， 基于数学的 ， 然后基于代码的 ， 数学和代码这两件事情我都很熟悉 。

**Host** [30:10]
那能不能说一下就是你最开始做 SGLang 是什么样的一个契机啊 ？

**盛颖** [30:14]
我转了 AI 之后， 最后 PhD 的两年就是在做 LLM inference 相关的很多 work。Flagstone 是我的第一个 work 嘛 ， 连续的一系列 work 到 SGLang， 它类似于成为了一个收官之作 。

我那个时候就是 PhD， 我可以毕业了 ， 然后我也觉得我已经做了很多不同角度的 research，但它们都比较 local。SGLang 是我希望把它们都集大成于一体的一个作品 ， 所以 SGLang 的时候我们就开始把它做成开源 ， 然后希望走向的是 production ready。

这个从一开始就想好了 ， 从做 SGLang 之初就希望它是做成一个 production ready， 可以被广泛使用的推理引擎 ， 被大规模使用的推理引擎 。

**Host** [30:48]
其实你在做 SGLang 之前 ，VLLM 已经推出了半年多了 ， 你之前其实在 VLLM 也是做了一些项目的 ， 对吧 ？ 就是为什么已经有这样的一个东西 ， 你自己还是想要做 SGLang 呢 ？

**盛颖** [30:59]
这个历史也比较长 。 我在 VLLM 的 research paper 上， 这个其实也是我本来自己在做 research， 然后其实当时我听到有这个 VLLM 项目的时候 ， 它 VLLM 当时的 idea 跟我们在思考的另一个 idea 是类似的 ， 所以其实当时我是被说那既然我们 idea 类似 ， 那我要不 merge 进那个项目 。在我的视角里 ， 我是被 merge 进了 VLLM 那个项目 ，因为我觉得这个项目已经在做了我想做的事情 。VLLM 做开源其

实是 paper 之后的另一个节点 ，并不是在 paper 的时候就是一个开源项目 。 真的把它推成开源了之后， 你就要做很多除了 research 之外的 ， 就是不仅仅是 innovation 的事情 ， 你要做项目的维护 ， 社区的维护 ， 还有很多 engineering detail 的琐事 。

那段其实我就没有太参与了 ，但我还在做 ， 继续做我自己的其他的 research， 包括 ESLoRA、SGLang、Fairness 这些事情 ， 就是 server 里面其他的问题 ， 我继续在做 research。SGLang 是一个想要把我的思想能够在一个地方继续往上推的地方 ， 本来它也是以某个 innovation 为起点 ， 然后去做成一个 general engine。在我看来是当时有很多这样的 serving engine，SGLang 是其中一个 ，并不是存在我在 VLLM 的这个 engine 里面 ， 然后做到 SGLang engine 里面 。

**Host** [32:07]
那比如说 SGLang 跟 VLLM 的核心差异性有吗 ？ 还是说其实大家都差不多 ？

**盛颖** [32:13]
不同的团队做出来的肯定不一样 ，但是差异性它随着 ， 就如果你不把时间维度放进去的话 ， 它们是会类似的 ，因为相互会学习 。

如果你有好东西一定会相互学习 ， 会 converge。 但是你如果把时间放进去的话 ， 那每个时刻可能大家会有不同的侧重点 。

那比方说 SGLang 在更早的进军了这个 scale up 的方向 ， 就是把大规模的 serving production 这种千卡级别 、 万卡级别的 serving， 甚至千万卡级别 、 百万卡级别做好的 。VLLM 可能在这个社区的覆盖 、long tail 模型的支持上做得更早 ， 所以大家的 focus 是有所不一样 。

但是你现在去看的话 ， 可能两方又在互相学习 ， 来补齐短板 。

**Host** [32:52]
你在 Databricks 不是也做过五个月的时间吗 ？ 当时公司的联合创始人之一 Ion Stoica， 对 ，也是之前伯克利的教授 ，他跟你有什么样的合作吗 ？

**盛颖** [33:01]
他是我在伯克利 visit 的时候的教授 ， 所以我们在伯克利的时候就一起做了很多的 research。

**Host** [33:06]
他对你有什么样的影响呢 ？

**盛颖** [33:08]
在专业水平上给我带来了很多 inspiration。 我其实我跟 Ion Stoica 我们还一直保持联系 ， 除了是我那个时候的 research 的一个 mentor 之外， 导师之外 ，他也是我可能 lifetime 的一个 mentor， 就整个 lifetime 的一个 mentor。Ion Stoica 是一个很特别的人， 当然他这么成功 ， 那肯定是很特别的一个人。

**Host** [33:28]
你觉得他特别之处在哪里 ？

**盛颖** [33:30]
他其实是个很立体的人 ，他做很多事情 ， 对吧 ？ 他同时看很多公司 ， 然后是一个教授 ，但如果你真的靠近他的话 ，他的骨子里他最自我认同感高的还是教授这个身份 ， 就是教授和学生 ， 这个是他所有身份自我认同感的 。

如果你追溯到根源 ， 这是他的根源所在 。他很在乎 making impact，impact 可能是他做所有事情的动力与支援 ，他也把这个精神传递给了他的学生 ，他的底下的学生和跟他一起共事的人可能都受到了这个影响 ， 就是 making impact。

但我其实不一样 ， 我其实在另一个价值观里面 ，但是我能理解到了这一套价值观 。

**Host** [34:11]
所以 making impact 不是你的价值观吗 ？

**盛颖** [34:14]
对 ，不是同一类价值观 。

**Host** [34:15]
那你的价值观是什么 ？

**盛颖** [34:19]
就是我在乎的不是 making impact 本身 ， 我会在乎一些我想要 make 的 impact。 如果我觉得有一种 impact， 我有一种价值观 ， 我希望它被执行和被推向这个世界 ， 那么我就会非常努力的去推动它和希望它发生 ， 我会尽一切努力 ，但其实我不是完全 care 这件事情是不是我推动的 。

别人推动也可以 ， 如果有人愿意帮我把这个事情推动 ，that's great。 但一般来说不会有这样一个人。 但是我慢慢学会的是 ， 我真正自己想做的事情没有人会代劳 ，因为他有他想做的事情 ， 别人有别人想做的事情 。

最后你自己真正想做的事情 ， 你其实只有自己去坚持不断 ， 你只有自己能够长时间的去为那一件事情所奋斗 ， 然后让它发生 。

所以在这个逻辑上， 我觉得是有一些微妙的不同的 。 就我在乎的是 impact，不是 making。

**Host** [35:08]
所以就是在另外一个价值观说 ， 就是 making impact 有可能是非常的说我希望我个人有 impact，但是你更在乎的是这件事情 。

**盛颖** [35:17]
对 ， 我更在乎有一些我觉得正确的事情发生 。 这个有时候会让我显得很 opinionated，因为我会有一些事情我有观点 ， 然后会非常希望我的观点发生 ，但我其实不是在乎它是不是我的观点 ，而是就是这个观点我 somehow 被它 intrigued 了 ， 被它给吸引了 。

### xAI时光

**Host** [35:33]
我们说一下你在 xAI 的一些经历 。2024 年 10 月份你是当时加入了 xAI 嘛 ， 当时为什么选择 xAI 呢 ？

**盛颖** [35:41]
我当时 PhD 刚毕业的时候想要推广 SGLang 这个项目 。 对 ， 我 so far 为止 ， 从我开始做 SGLang 之后， 我的整个 plan 都跟 SGLang 紧密相关 。

就是我当时刚去 Databricks 的时候 ， 想要在 Databricks 里面推广它 ， 然后我在 。

**Host** [35:56]
推广 SGLang。

**盛颖** [35:57]
推广 SGLang， 对 ， 或者说我至少找到一个地方可以好好的 develop 它 。 我也不一定说它能够取代所有的 step，但是我希望它是给我一块地方可以好好 develop 的 。

我在刚加入的时候 ， 我觉得 Databricks 跟我说有这样的自由 ，但是实际上 Databricks 里面的业务模式还是不那么一样的 ，而且 Databricks 毕竟是一个已经很成熟的公司 ， 它不是你可以随便说我想做什么就做什么 ， 它做每件事情都需要理由 ， 或者充分的理由 。

然后我作为一个 researcher，new grad researcher 进去其实也没有太大的 power， 我自己也不够成熟 ， 就是你怎么在一个成熟的企业里面去 drive 一个比较大的 effort， 我还不会这件事情 。

所以我觉得当时那几个月尝试没有特别成功 ， 可能也造成了一些影响 ，但不算特别成功 。XAI 给的这个机会就是它愿意去支持我和怜悯是我的 husband，他已经在 XAI 那个时候 ， 那个时候在 XAI 之前还是在做 training，但是正好 XAI 到了一个节点 ， 就是需要去做 production inference， 然后就有了这样一个机会 ， 我和怜悯可以去 XAI 共同 build 整个 inference step， 整个 inference 的这个 solution 和 team。

所以它可以给我两样东西 ， 一个叫做 support， 一个叫做 freedom。 同时有 support 和 freedom 的时候 ， 我就能做这件事情了 ， 所以我就选择加入 XAI，而且当时应该只有 XAI 真正给我这两个 。

我有一些其他的机会 ，有些是只给 support，有些只给 freedom。

**Host** [37:14]
确实我觉得能这两个支持你去做这个事情 ， 跟又让你自由的去做这个事情 ， 这个机会其实是蛮罕见的 。

是不是也是因为 XAI 那个时候比较早期 ， 所以才有这样的机会 ？

**盛颖** [37:26]
是的 。

**Host** [37:27]
那个时候的 XAI 是什么样子的呢 ？ 就在你能受的范围内跟我们描述一下 。

**盛颖** [37:32]
我觉得 XAI 是我生命中非常重要的一部分 。 就虽然我没有工作特别特别多年， 但是我在很多地方工作过 。XAI 是我回忆最美好的 ，XAI 的时光是我回忆最美好的一段时光 。

**Host** [37:46]
评价这么高啊 。

**盛颖** [37:48]
而且我离开 XAI 的时候其实也非常不舍 。 我离开 XAI 的时候是因为 SGLang 的开源的一些需求 ， 到了一个节点我觉得我不得不去出来把这个 RadixArk 新的公司扶起来 ， 然后让我们社区能够很好的继续发展 。

如果不是因为这个原因的话 ， 我是不可能选择离开 XAI 的 ，因为也不是说完全不可能 ，但我说就是非常非常不希望也不舍得离开 XAI。

而且我觉得这个想法不是我一个人有的 ，其实我知道在我们早期的那一批员工里面 ， 大家都有很多人有类似的想法 ， 甚至有些人可能在 XAI 的工作已经有点承受不住了 ，因为压力强度都很大 ，但他们还是一直在里面坚持 ， 就是因为他们不想离开这群人。

我的想法是类似的 。

**Host** [38:27]
所以是这群人你们形成了一个非常好的一个 team 的感觉 。

**盛颖** [38:32]
对 ， 我觉得是 。 我觉得早期的 XAI， 就我在之前的 XAI， 我所体验到那个 XAI 是一个就是个个都是人才 ， 里面个个都是人才 ， 然后大家互相之间也都很 support 的 ， 很 friendly， 很 appreciate， 很 humble。

这是我当时 XAI 给我的印象 。

**Host** [38:52]
跟你的价值观很像 。

**盛颖** [38:54]
对 ， 我觉得非常的 ， 就是我觉得当时在 XAI 我能够非常专心的做事情 ， 没有太多的杂念 ，而且大家都是这样的 ， 就是大家都能够非常直白的做事情 ， 都知道把事情做成最重要 。

我经历过那么多公司 ，RadixArk 之前的是我第一次经历到一个 team， 一个公司里面完全没有任何 people game， 没有任何 politics， 当然后面可能慢慢的也会有 ， 公司大了都可能有 。

**Host** [39:16]
你们一直说多少人啊 XAI？

**盛颖** [39:18]
不到 100 人吧 ， 我加入的时候 。

**Host** [39:20]
哦 ，100 人没有 politics 还是 team， 难得 。

**盛颖** [39:23]
可能也有我没有看见 ，但是至少我看见的范围里面我没有看见 politics。 我很幸运的在一个我能够非常就是好的思考问题的那个氛围里面 ， 然后我只要思考怎么做事情 ， 然后我身边的人他们也在思考怎么做事情 。

大家也会有一些摩擦 ， 那很正常 ，但是是一些就是说不影响团结的摩擦 ， 这些摩擦是不影响 ，we are always together。

我觉得现在我们在 RadixArk 是带过来了这个氛围的 。

**Host** [39:51]
那好棒哦 。 你把你在 XAI 的时候描述是 v1.0， 没加入之前是 0.0， 然后可能现在是多少 ？3.0？4.0？

**盛颖** [40:01]
我也不知道大家怎么定义了 ，因为后面就是我也不在了 ， 我只能听大家的说法 。 对 ，但是我能够感觉出有那么几个阶段吧 。

**Host** [40:07]
所以 0.0 跟 1.0 那时候是非常美好的 。

**盛颖** [40:10]
对 。

**Host** [40:11]
那个时候 Elon 的重心也不在你们身上 。

**盛颖** [40:13]
就 0.0 的时候应该是 Elon 不怎么在意 ，0.0 是我听说的 ， 我不在 0.0 里面 。0.0 的时候 Elon 对大家都非常的 nice，0.0 应该是非常非常美好 ， 像一个 family 一样 。1.0 的时候其实已经开始生长了 ， 已经开始有这个生长痛 。1.0 的中途 Elon 回来了 ，但是我觉得就算在那个时候 1.0 里面产生的阵痛 ， 大家也还是共同克服难关的 。

我没有感觉到军心有什么动摇 ， 我觉得大家都非常团结 ， 然后也彼此照顾 。 我觉得那个时候是彼此照顾的状态 ，build 了一段战友情的这种感觉 。

**Host** [40:44]
这段故事特别珍贵 ，是因为它跟现在大众对 XAI 的一个认知差距是非常大的 。 因为现在大家的认知说 ， 就前段时间 XAI 的 co-founder 全部都离开了 ，either 被 fire 或者被 laid off 或者自己辞职的 。

就感觉这两个 narratives 就好像在说两个不同的公司一样 。

**盛颖** [41:03]
确实很不一样 ，因为后面公司大的 ， 我觉得 XAI 是没有过那个阵痛期的 ，是没有过那个从很小的很团结的一个 startup 变成一个需要靠体制来运转 ，而不是靠人来运转的大公司的状态 。

它这个过渡期的阵痛是没有很好的抚平掉 ， 所以产生了这些巨大的变化 。 但有一天它可能又会找到一个新的 solution，因为 XAI 还在那里 ， 新的人员在新的组织架构 ，有一天它可能会找到一个新的 solution。

但是就是可能这是一个 another company 了 ， 就是从人员上来看的话 。 反正 Elon 还在 。

**Host** [41:37]
对 ， 这是最重要的 。 然后又被 SpaceX 收了嘛 ， 然后上市了 ， 对吧 ？ 那这一段我觉得就是对组织架构的一些阵痛期 ，因为你肯定有你的观察 ， 你觉得对你之后做 startup，因为你们现在也是几十个人， 对吧 ？

然后可能很快你们会上百个人几百个人的一个规模 ， 会对你有什么样的 lesson learned 吗 ？

**盛颖** [41:57]
有的有的 。 我觉得我们现在就在一个很美好的时期 ，而其实我知道我们现在在一个很美好的时期 ， 就是这段时间大家会一定会成为他们以后， 就是我们所有人以后人生中非常珍贵的一段回忆 。

但是我们也一定会面临那个挑战 ，scale up 的挑战 。 就是你在人少的时候 ， 你是可以通过文化 ， 通过人的管理去实现运转的 ，但你 scale 上去了之后 ，其实文化就很脆弱了 ， 人也很脆弱了 ， 个人能力都会变得很脆弱 。

那个时候你能不能把公司做大 ， 能不能把一件事情 drive 好 ， 更多的就是看你的 system build 的怎么样 ， 体系 build 的怎么样 。

最后是靠体系去支撑的 ，而不是靠人去支撑的 。 这个转变可能我其实不知道正确答案 ，因为我没有经历过 ，但是我能学到的 lesson 就是这个过程要非常的 intentionally thinking。

它不是一个会自然发生的事情 ， 它不是一个你只要公司这个计划有 ， 然后往前 move， 然后有 scope，有事可做 ， 你就 for granted 的会得到的东西 。

它不会 。 如果你不 pay attention， 它是会 broken， 它就会 broken。

**Host** [42:56]
你当时就是主要任务是什么 ？ 就是当时你在那个 XAI， 比如说给 Grok 构建推理系统的时候 ， 我们是负责那个 engine 那一块 ， 然后我们要同时服务其他很多组 ， 包括 product， 所以 product 是他们会部署 ， 做 deployment， 然后我们需要跟他们对接 ， 然后他们遇到问题回来会抱怨我们说你 engine 里面可能有什么事 ，有什么问题 ， 我们也要帮忙 。

就是 deployment 上的一些协调 ，configuration 什么的 ，也要跟 research team 合作 ，research team 做 evaluation， 跑 RL rollout， 用的也是我们的 inference engine， 所以我们也要去支持他们这个 workload 里面的各种适配 。

然后当时那个在 XAI 的时候 ，因为就是它整个的这个算力系统也是非常的庞大嘛 ， 对吧 ？ 然后它后来又买了非常多这样的卡 。

你觉得就是在整个的过程当中， 比如说你是不是在里面受到了 full stack 的训练 ， 然后这对你来说产生了什么样的影响吗 ？

**盛颖** [43:47]
对 ， 我觉得在 XAI 的是机会就是能看到所有 ，因为当时 team 小 ， 所以能看到 。 而且 XAI 我觉得 Elon 还是 set 了一个我很喜欢的文化 。Elon 有一些他的问题 ，但是他有一些很突出的地方 ，而且我很喜欢这样 ， 就是 Elon 能 set 一个没有边界的文化 。

**Host** [44:05]
一个没有边界的文化 。

**盛颖** [44:07]
没有边界的文化 ， 对 。 就是在 XAI 里面 ， 至少我还在的时候 ， 我觉得任何事情我都是可以 touch 到的 。 我不会说大家组与组之间是被隔开的 ， 然后你必须限制在一个很小的 scope 里面 ， 只能做这一件事情 ， 然后你不知道外面发生了什么 。XAI 里面是不会这样的 ， 然后也没有特别多的 people management，XAI 里面都是 technical，而且它非常重工程师文化 ， 所以你做事情可以非常直接 。

然后这样一个文化就使得我能够看见很多很多个 layer 和很多个 component 之间大家是怎么合作的 ， 事情是怎么发生的 ， 它作为一个整体是怎么发生的 。

这个给我带来非常大的成长 ，因为原来我确实没有办法看到这么多的东西 ，并且在 XAI 因为强度很大 ， 压力很大 ， 然后人都是被 train 出来的 。

就是你一定要就是 intense， 你只有就是经历过那个 intense， 你的成长撕裂 ， 就像你健身你一定要很累了 ， 你感觉到痛了你才 。

**Host** [44:55]
对 ， 肌肉才会长 。

**盛颖** [44:56]
所以 XAI 的这个 intense， 它给我们带来的成长就是可能你在那里待了一年， 你可能在外面是好几年的才能拿到的成长 。

**Host** [45:04]
你当时是决定说 SGLang 想要把它商业化 ， 然后去成立 RadixArk 是一个什么样的时机点呢 ？

### 告别与回望

**盛颖** [45:11]
对 ， 这个是因为当时在 25 年的时候 ， 前面有几波浪潮把 XAI 推到了一个还不错的被关注点 ， 然后有很多的需求向我们涌过来 ， 想要使用和让我们参与一起开发之类的 。

但是我们社区 ，XAI 社区是一个 ， 虽然最早我们也是大学里面做了一些研究 ，但从很早的时候开始 ，XAI 就已经变成一个纯社区项目 ， 就是我们的核心开发者都是网上认识的 ， 我们都是网友 ， 就跟我小时候那个在网上学习 。

**Host** [45:41]
大家可能都没见过面 。

**盛颖** [45:42]
没见过面 。 就现在还是核心开发者 ， 我们已经共同工作了两年了 ， 我还不知道他们长什么样子 ，有好几个已经 ， 可能也没有好几个 ，有那么几个吧 ， 我不知道他们长什么样子 。

**Host** [45:49]
下次年会的时候可以把他们请过来 。

**盛颖** [45:51]
我们已经开了很多次会 ，但是从来没有开过摄像头 。

**Host** [45:54]
OK。

**盛颖** [45:55]
然后我们也从来没有要求过摄像头 ， 对方开摄像头 。 就大家就有一个默契 ， 那个默契就是我只要看到你的代码我就知道你是谁 ， 我也只想看到这个部分 。

**Host** [46:05]
OK。 所以开摄像头或者是认识 ， 真正的认识对方这件事情不重要 ， 还是说大家都是 I 人， 所以不想开摄像头 ？

**盛颖** [46:13]
我觉得大家没有 I 到完全不想开摄像头 ， 没有这么夸张 。 我觉得是它自然到你根本没有想起来这件事情 ， 没有说大家拒绝开 ，但是自然到你根本没有想起来这件事情 。

对 ，XAI 是一个这样的社区 ，但是这样的社区也会导致就是我们大家其实没有那么的有组织纪律性 。 虽然大家都很有热情 ， 然后也非常在乎这个项目 ，但是你还是很难说让大家有时间去把项目非常严肃的给它做好 ， 做成一个成熟的高质量水准的一个项目水平 。

**Host** [46:41]
对 。

**盛颖** [46:42]
除非我们有自己的公司 ， 变成我们的 full-time job。

**Host** [46:45]
大家其实有自己的 full-time job，也只是说其他空闲的时间来为这个社区做贡献的 。

**盛颖** [46:51]
对 ， 就是晚上熬一下夜呀 ， 然后冲个宵呀 ， 然后周末再工作一下， 放假的时候过来写代码 ， 这样子去维持的 。

但是我们当时的增长是快到你不可能用这样的方式去维持 。 那个时候接到的很多需求 ， 我们想要去抓住这些机会 ， 想要跟对方合作 ， 想要 deliver 一些东西 ，但是我们还是强撑了一段时间 ，但我觉得强撑了那几个月之后发现就是没有办法 deliver。

就其实大家都是很想 deliver 的 ， 你觉得我们已经不能再 stretch 了 ， 你知道这个 team 已经不能再 stretch 了 ， 它就是被 team 的 bandwidth 限制住了 ， 我们没有办法很好 deliver， 都是 borderline， 低空飞过或者甚至没有成功 deliver。

所以到了大概七月份那个时候 ， 就已经我觉得我自己的焦虑已经到了一个 ， 我觉得如果我们再不出来做这件事情 ， 我再不把这个背后实际上的空白 ， 就是这个是个中空的状态 ， 我再不把这个空白填充的话 ， 我们就快要让外界失望了 。

我自己焦虑到了一个我觉得我没有办法再拖的这个状态里 ， 所以我从 XAI 出来了 。

**Host** [47:44]
从 XAI 出来应该放弃了很多这个金钱上的回报 。

**盛颖** [47:49]
也没有 ，也没有 。 还好吧 ，因为而且怜悯他在 XAI，他比我多 。

就是但我确实是没满一年， 就是我是 one year cliff 的 ， 我出来说是十个月 。

**Host** [47:59]
对啊 。

**盛颖** [47:59]
其实我只要再待两个月我就可以拿到我的那个第一年的 vesting。

**Host** [48:02]
所以两个月都不能待 ？

**盛颖** [48:04]
对 ，因为等不了了 。 等到七月份已经是等了很久了 。 就是其实我可能五月份就已经有点受不了了 ， 到七月份的时候已经实在是受不了了 。

**Host** [48:13]
如果不出来的话 ， 可能这个社区就两个月都等不了了 ，是吗 ？

**盛颖** [48:17]
对 ， 这是大概是那样的结果 。 就是我的心理状态到了一个我没有办法 focus 做 XAI 的事情 ， 我已经没有办法 productive 的生产 ， 我对 XAI 的价值 ，但是我不能忍受自己在一个 ， 就是如果我是在 XAI 上班的 ， 我就觉得我要对它有用 ，不然我就会觉得我不配在这个地方 。

所以我当时已经到了一个我觉得我不配再继续待下去的那个心理状态了 ， 它不是我能控制的 。

**Host** [48:39]
刚才我忘了问一个问题 ， 就是你觉得金钱对你有任何的重要性吗 ？

**盛颖** [48:44]
有必需性 ， 没有重要性 。 它的必需性来自于有金钱可以让我解决很多事情更容易 ， 这个我可以还是我承认的 。

就我没有追逐过它 ，但是你真的说它不重要吧 ， 我也没有到那个程度 。 它能够给你带来的底气就是 ， 比如说我想创立这个公司 ， 如果有一天我融不到钱 ， 我还自己还有钱 ， 这是它对我的意义 。

**Host** [49:04]
忘了提一段经历 ， 你在哥大毕业之后 ，其实是到了华尔街的一个对冲基金 ， 叫 Two Sigma， 里面是工作了有几个月吧 ，是不是 ？

没有到一年 。

**盛颖** [49:15]
有半年， 六个月 。

**Host** [49:16]
OK。 就那段经历是什么样子的 ？ 就是在一个华尔街 ， 非常大家觉得说纽约这个华尔街上纸醉金迷 ， 然后在一个对冲基金里面 ， 好像跟你之前做研究的这个氛围是不是会完全不一样 ？

**盛颖** [49:30]
但我们那个对冲基金是一个 TAC 对冲基金 。

**Host** [49:32]
对 ， 我知道 ， 应该是很忙 。

**盛颖** [49:33]
对 ，TAC 的 ， 对 。 但是我当时确实是想要接触金融 ， 觉得挺有意思的 。 然后我有一任前男友是学金融的 ， 这个剪掉 。

**Host** [49:45]
我一定会放出来 。

**盛颖** [49:47]
所以当时我确实是对那个就觉得金融挺有意思的 ， 然后有点好奇 。 就当时量化大家的说法就是那里面的人很聪明 ， 都是那个 。

**Host** [49:55]
但是好多 PhD， 什么学物理的 ， 好多 PhD 后来那个我们学校都去量化了 。

**盛颖** [50:01]
就是我不知道为什么就是喜欢聪明的 。 跟聪明的人说话 ， 我喜欢做有挑战的跟智商挑战的事情 ， 所以它这个特点它当时吸引我 。

当然这个也是吸引很多其他人的原因 。 那个时候我也就 21 岁吧 ， 可能 22 岁 ， 单纯的被这种东西吸引 ， 然后我觉得我要去体验一把 。

我觉得这个事情我要是不体验的话 ，以后我会一直想着它 。 但是我又觉得金融不是我的人生追求 ， 我又觉得天天在那玩钱没啥意思 。

所以刚好 PhD 中间隔了有个半年的 gap， 然后完成一个体验挺好的 ， 我就去那里做了半年 。 那半年的回忆也非常好 。

如果要我排序的话 ， 我工作过的所有公司 ， 排第一的是 XAI， 排第二是 Two Sigma。

**Host** [50:35]
哇哦 ， 评价那么高 。

**盛颖** [50:37]
但是我听说 Two Sigma， 就我在的时候又是它最好的时候 ， 我很幸运 ， 我每次在的都是它最好的时候 。

后来可能就有些变化 ，但是我在的时候是 Two Sigma 最蓬勃发展 ， 甚至拥抱开源他们那段时间 。Two Sigma 那段时间是做开源项目的 ， 非常拥抱科技 ，也拥抱 new technical AI with data 什么的 ， 然后里面的人也是非常的互相帮助 ， 然后我没有感受到任何的多余的东西 ， 所有人都只是在做事情 ， 然后所有人都非常的

开放 ， 非常 open， 非常 share， 非常喜欢 share， 质量也很高 。 然后里面的交到当时交到的很多朋友 ， 到现在也还是我的朋友 。

**Host** [51:12]
大部分人还继续在华尔街量化 ， 里面还是也都会出来开始做 AI。

**盛颖** [51:17]
都有 ，有些出来的 ，有些还在里面 。Two Sigma 让我看到一个非常 organized 的公司 ， 至少在当时 。

**Host** [51:23]
所以它是非常 organized 的 。

**盛颖** [51:24]
我当时觉得 Two Sigma 非常 organized， 我当时不觉得 ，但我后来去了其他公司之后， 我再回想我就觉得 。

**Host** [51:28]
原来其他地方这么乱 。

**盛颖** [51:29]
对 ， 我觉得其他地方这么乱 ， 就是 Two Sigma 它都不是一个大的公司 ，但是 Two Sigma 的 infra 在我跟其他的比起来是最稳定的一个地方 。

**Host** [51:36]
有意思 。 你觉得原因是什么呀 ？ 就公司文化就是这样的吗 ？ 我觉得那样它非常的干净 。

**盛颖** [51:41]
我觉得是它的巨变不多 ， 它的业务模式比较稳定 ， 所以大家可以在那里一直做 maintenance， 大量的 maintenance。

**Host** [51:48]
所以对于就是做一个金融 ， 然后追逐那个 return 的数字 ， 然后赚钱这个事情 ， 就在你这边就不是 priority， 你只是想体验一下 。

**盛颖** [52:01]
对 ， 我只想体验一下 。 我一开始就知道那不是我的 priority。

**Host** [52:04]
体验还不错 。

**盛颖** [52:05]
对 ， 体验不错 ， 挺好的 。

### Infra浪漫

**Host** [52:06]
这个技术稍微给大家去科普一下，LLM infra， 你们在做什么样的事情 ， 你们在解决什么样的问题 ？

**盛颖** [52:14]
Infra 分好几个模块 ， 我们的长远的目标是我们希望整个 infra， 我非常 vague 的说 ， 我们的这个结构性思考是我们希望 RadixArk 在一个地方它可以给你提供很好的这个基础知识 ， 让大家根据你不同的使用场景 ， 不同的 data 的形式 ， 不同的产品目标和不同的 survey 目标 ， 然后你有可能希望 model 它可能解决个很简单的问题 ，但是你希望它很快 ， 又或者是它要解决一个很难的问题 ，但

它可以比较慢 ， 你都可以用这套工具源源不断的产生 ， 适应你不同目标的最好的模型 。 我们希望把这个 foundation 做出来 ， 这个 foundation 我统称为 infra， 它会包括传统意义上大家所理解的推理引擎 ， 推理和训练 ，post training， 这些都是大家传统的脑中的 keywords。

我还想在这里其实加一个 component， 就是基座模型也是 infra，在我看来 。 整个这个 foundation 里面是包括了所有你需要的 gradients， 包括了这些 codebase、tool、toolbox、sandbox、environment 和一些中间状态的模型 checkpoint， 它们在一起变成一个工具箱 ， 你可以在这里进行组合去不断的产生更适用于你的场景和目标的特异化模型 。

那整个这个工具箱 ， 这个 foundation 是我们要做的 infra 的部分 。 现在我们因为要 focus 一步一步来 ， 所以我们现在是 focus 在 inference 和 RL， 它们处在你这个生产模型整个 pipeline 的末端 。

就假设说我前面已经走完了 ， 我的基础模型就 pre-training 已经做完了 ， 我有基本的 checkpoint， 然后现在我开始要适应不同的 task， 我需要做过 post training 的时候大家开始用 RL， 这个地方已经开始开枝散叶 ， 对吧 ？

因为 AI 进入人的生活的各个方面 ，有不同的场景需求 ， 这个时候你开始需要有不是一个模型解决所有问题 ， 你可以开始有多次训练产生多个 model 解决各种各样的问题 ，并且多个企业它们可能都想要自己的模型 。

所以 post training RL 在这个地方是一个 fun out 的状态 ， 所以它是比较适合做我们想要的这种给所有人 share 技术 ， 然后做一套 infrastructure 所有人都使用的这样一个模式里的 。post training 完之后的模型 inference， 那就更加 fun out 了 ，inference 就真的到了末端 ， 模型都已经完成了 。

我 inference 我需要让你的模型的架构和 weights 都已经有了 ， 我需要让你模型在硬件上跑起来 ， 跑起来之后可以被你有 endpoint 可以被 call out， 别人可以来 ， 别人可以使用这个模型 。inference 就是在那个更末端贴近用户的部分 。

**Host** [54:29]
整个的 infra LLM surveying 的这个版图 ，其实中间涵盖蛮多领域的 。 那比如说 VLM 是解决内存管理 ， 然后 H2O 是做 Kiwi cache 的压缩 ，SLoRA 是解决这个多 adapter 的并发 ， 然后 CHAP arena 做测评 ，SGLang 做结构化生成 ， 就是非常多不同的这个方向 。

那对这部分的研究 ， 你是有一个什么样的方法论在解决这些问题 ？ 就是还是说你就有一个很完整的这样的一个 roadmap， 说这些东西都是我要一起去解决的 ， 还是这些东西是你一步一步的去慢慢的解决这些问题的 ？

**盛颖** [55:05]
我觉得是一次性看见的 ， 短时间里一下看见的很多问题 ，但你做的时候你得一件一件做 。idea 肯定是跑得比动作手要快 ，也不是我一个人看见 ， 很多人都看见了 。

就是你上来一次看见很多问题 ， 然后大家慢慢的把一件事情每件事情都解决掉 。

**Host** [55:18]
那在解决这些问题的时候 ， 你觉得有哪个点是最难的 ？

**盛颖** [55:22]
我觉得没有哪个点是难的 。

**Host** [55:26]
就是去做掉就可以了 。

**盛颖** [55:27]
对 。

**Host** [55:27]
那你的优先级是怎么排序的呀 ？

**盛颖** [55:29]
哪一个能给你带来最大的 margin， 哪一个是最大的 bottleneck， 先解决最大的 bottleneck。 也有些是 dependent， 比如说你要先解决 memory 的 Kiwi cache 的这个碎片化问题 ， 管理问题 ， 然后你才能解决 prefix caching 的问题 。

**Host** [55:42]
所以你觉得现在这些问题完全被解决了吗 ？ 还是有继续优化的这样的一个潜力 ？

**盛颖** [55:48]
那肯定总是有优化的潜力 。 那我 attention 现在有这么多的变种 ，sparse attention 还可以做得更 aggressive， 然后新的 innovation 不会停止的 。

**Host** [55:55]
这一块其实应该是一个很大的市场 ，但这个市场为什么最开始从开源的生态里面跑出来的呢 ？

**盛颖** [56:02]
也不能说是开源跑出来的 ，因为 inference 已经很长时间了 。inference provider 你看从 Fireworks together 这些公司已经存在好几年了 ， 这些公司都很不错 ，有很大的使用量 ，而且你看 inference 的 landscape 有这么多的 components， 这么多跟 inference 有关的公司层出不穷 ， 每年都在不停的出 。

但是你会发现这个游戏里面没有输家 。

**Host** [56:21]
没有输家 ？

**盛颖** [56:21]
没有输家 。 就是所有的 inference player，inference provider player 不停的出来 ，有这么多 ，但是没有任何一个因为有 competition 的存在而消减下去了 ， 所有人都是同步增长的 。

**Host** [56:31]
我之前其实跟你那个 co-founder 班华聊的时候 ，他说做 infra 的人他需要的 taste 跟做比如说 pre-training 的这个 researcher 他的 taste 是不一样的 。

那比如说做 infra 的人他的 taste 是表现在什么样的方面呢 ？

**盛颖** [56:46]
我其实不确定是不是真的不一样 。

**Host** [56:48]
是吗 ？

**盛颖** [56:49]
我觉得本质可能是相通的 。

**Host** [56:50]
那你觉得 taste 表现在什么样的方向 ？

**盛颖** [56:53]
不论是在做 training 算法 ，pre-training 算法还是在做 infra， 你做一件事情的时候是不是喜欢精益求精 ？

**Host** [56:59]
它是很细节的活 ， 就因为它这个 efficiency 要做得非常非常精致 ， 对吗 ？

**盛颖** [57:04]
不光是 efficiency， 就是如果你是追求一个目标的话 ， 可能就不在 taste 的这个维度上 。 就是你如果要的是一个 end goal，end goal 和 taste 是两个 ，taste 其实就是你关注的不仅仅是 end goal，并且还有这个 end goal 的组成 。

就是我的系统不仅能跑 ， 我并且知道它是怎么跑起来的 ， 它是一个设计过的 ，well designed 的形态跑起来的 ， 还是它是一个豆腐渣工程跑起来的 。

它们有可能有同样的 end goal。 有 taste 就是说我更在乎它是一个很优美的形式跑起来的 ，而不是这个很很 。

**Host** [57:33]
豆腐渣的 。

**盛颖** [57:34]
对 ， 很 hacky 的方式跑起来的 。

**Host** [57:36]
那你在乎吗 ？

**盛颖** [57:37]
我非常在乎 。 这是 RadixArk 的文化之一 ， 就是我们非常强调这一点 。 我们想要成立 RadixArk， 想要好好的做一家 infra first 的公司 ，因为我觉得在很多其他的我之前工作过的其他地方 ， 或者是听大家讨论 ，以 product 以模型为目标的这些公司 ，在 infra 的美感上有所妥协 ，他们在 infra 的功能上还是很追求的 ，但是在美感上是有所妥协的 。

然后 infra 的人在整个这个 full stack 里面 ， 可能长期的处于一个被 underestimated 的状态 ， 就他们需要被迫去不停的 support 其他的 component，他们需要去 support the researcher 去很好的使用 infra 工具 ， 然后把实验跑起来去迭代 。他们也需要 support the product 的人能够把自己的 product 运行得又稳又快 。

但是 infra 自己 ，因为我跟 infra 的之间的这个浪漫的关系 ， 我觉得 infra 它不是一个 support 角色 ，infra 本身在我眼中就是产品 。

你在设计 ， 你在推一个产品的时候 ，因为产品面向用户 ， 你会去想我这个产品不是只有功能 ， 我会想这个产品美 ， 对吧 ？

我希望它好看 ， 好用 ， 被人说喜欢 ， 我希望它击中用户心里的痛点 ， 用户心里的击中人性 ， 我希望产品击中人性 。

但是没有人会说我希望 infra 击中人性 。 但是从我的视角里看 ， 我觉得 infra 也是击中人性的 ， 它只是没有直接到用户 ， 没有那么直接的联系而已 ，但实际上它产生的这个深远影响是从底层就开始往上传递的 。

**Host** [58:56]
我觉得刚才你说两个词 ， 我觉得非常有意思 。 第一呢 ， 你是说 infra 的美 ； 第二呢 ， 你是说你跟 infra 的关系是浪漫的 。

这两个词其实我很少听到 。

**盛颖** [59:06]
我倒是没有仔细想过为什么是这个词 ，但是它自然而然存在于我的脑中 。 就是其实我觉得写 infra 的人他们都是能理解的 。

就是你写 infra 的时候 ， 你追求 ， 你会去觉得我这个代码写的 ， 我其实不知道怎么更细的拆解了 ，但是我不是特例 ， 我只是 one of them。其实有很多这样 ，有一批这样的人 ，他们都很在乎你的 infra 构建的时候 ， 这个系统它优不优美 ， 稳不稳定 ， 然后他们总是被迫去做一些 hacky 的事情来达成目标 ，其实他们都是会在一个被拉扯的状态里 。

**Host** [59:37]
我明白你的意思 。 就比如说 ，其实如果你看这些大厂 ，OpenAI 有自己的 infra team， 之前你在 xAI，xAI 也有自己的 infra team，是不是就是在这种大厂的时候 ，infra team 它总是一个 supporter 的这样的一个角色 ？

所以也就是说它有很多你需要去妥协的地方 。 但是如果你自己出来做一个 infra native， 就可以达到你所说的 infra first 的这种美感 。

**盛颖** [1:00:00]
对 ， 比如说在 RadixArk 其实我们是反过来的 ， 比方说我们也有 training job，但是我们并不是说我需要一个 infra 的 team 去一直 support 这个 training job 跑得非常的 on track。

我们其实反过来的 ， 我们希望这个 training job 它可以没有压力 ， 它只需要跑 ， 然后一旦你 training job 被卡住了 ， 遇到问题的时候 ， 我们希望大家的 focus 是把这个问题 systematic 的解决 ，而不是打一个 patch 上去 ， 让这个 training job 必须跑 。job 是可以 pause 的 ， 我们刷分也不着急刷 ， 我们也不是非要刷一个非常好的 benchmark 分数 ， 这个在我们这里不是第一优先级 ，但是我们如果能刷高当然

是好的 ， 我们不会说这事情不重要 。 但是在 timeline 上， 它不是 source ofurgency， 我们的 source ofurgency 是你的 job 不能被迭代的时候 ， 这个问题本身它应该怎么样从深层次的解决它 。

**Host** [1:00:44]
我们先回去一点点 ， 然后让我们的观众更加了解一下就是 infra 的这个赛道 。 比如说我们在技术的细节上面看到这个 RadixAttention， 它其实是 SGLang 的一个核心技术之一 ，是用 Radix 树来做这个前缀的缓存 ， 然后避免重复的计算 Kiwi cache。

### 技术深潜

**Host** [1:01:01]
能不能用比较通俗的语言给我们的观众来解释一下这个技术 ？

**盛颖** [1:01:05]
这个技术其实也比较简单 。 就是当你有很多的 request 发到 engine 这边需要处理的时候 ， 如果你的 request 有一个公共前缀 ， 那我们就不需要重新计算这个公共前缀所对应的 Kiwi cache，而是可以复用 ， 就是你第一次一个 request 进来 ， 我已经计算过 Kiwi cache， 第二个 request 进来如果它们 share 的话 ， 我可以复用已经计算出来的 Kiwi cache。

所以这套 memory 管理系统就是对前缀的结构共享结构做了 indexing 和存储 。 首先一个是你对进来的 request 之间的前缀的关系 ， 要建立前缀树来做 indexing。

做完 indexing 之后， 你需要把已经计算的 Kiwi cache 存在 Kiwi memory pool 里面 ， 然后把这个 indexing 跟这个 Kiwi memory pool 给 mapping 起来 。

**Host** [1:01:49]
既然它的核心是用重复的前缀 ，但是如果我们假设用户每次发的问题都是全新的 ， 没有什么共同的前缀 ， 那比如说长文档摘要或者创意写作 ， 那是不是这套机制就有一定它的局限性 ？

**盛颖** [1:02:01]
因为 agentic 的场景出现 ， 复杂场景的出现 ， 大部分都是会有前缀共享的 ，因为你只要进入多轮对话 ， 你的后面轮对话都会要复用前面已经对话的 history， 所以前缀复用是大量存在在所有的几乎所有的场景里 。

**Host** [1:02:15]
是不是说 agent 来了之后， 这个问题是更需要被解决的 ， 或者更需要被优化的 ？

**盛颖** [1:02:22]
它一直都是需要被解决的 。agent 来了之后， 它确实可能变得更被大家所关注到了 。其实 SGLang 在刚 paper 刚出来的时候 ， 如果现在还回去看那个两三年前的 paper， 我们确实是以 agent 为这个入口 ， 就是进来说我们为什么要新设计 SGLang 这套体系 ， 当时还设计了一个 frontend 的语言 ， 都是为了 agentic 的 use case 所设计的 ，因为我们觉得 LLM AI 它会将来成为变得非常 powerful 之后， 你需要构建一

套人与 AI 之间交互的 interface。SGLang 的创作之初的动机其实是想要去定义和构建这套 interface， 让人和 AI 可以更好的交互 。

但发展到今天 ，因为你的挑战的重点 ， 可能 inference 就是后端 ，inference 挑战重点更为突出 ， 所以大量的开发精力是移到了就是 backend 的这个 runtime 的优化 。

但我觉得有一天 at some point 其实我们还是应该回顾一下最初的这个想法 ， 就是为什么要 design SGLang。 这个 SGLang 它 structure 真的是 language，SGLang 原初 design 的时候是希望它是一个 language。

我觉得有一天我们会 revisit 这个部分 ， 就是最终它还是应该是一个 language 的形式 ， 这个 language 它是人与 AI 之间交互的 interface。

**Host** [1:03:31]
在看你们 social media 的时候 ， 你们经常就是说这个模型发了之后， 我们是 day zero， 就是从零天开始兼容的 。

能不能跟我们解释一下为什么这件事情很重要 ？

**盛颖** [1:03:42]
这件事情很重要是市场觉得它很重要 。 我们做事情还是很 practical 的 ， 我们做开源 ， 哪些事情重要和不重要还是被 market 所决定的 ，不是完全我们自己定义的 。

我觉得 market 上人性好像大家就是很希望东西刚出来的时候我就能用上， 这个愿望从 user 端一直传递到了那些我刚提到那些 inference provider，inference provider 进而又传递到了我们 ，也进而再传递到了模型厂商 。

所以这个链条式的传递 ， 它其实满足的就是一个人你想要 ， 就跟你发布了产品我要去第一天就去抢购一样的这样一个心态 。

**Host** [1:04:14]
比如说前段时间发这个 DeepSeek v4， 发布之后你们马上就是 day zero 兼容 ， 对吧 ？ 达到这个 day zero 兼容你们要去做什么样的事情 ？

**盛颖** [1:04:22]
这个跟模型的复杂度很相关 。DeepSeek v4 他们是在 Arcane 上做了很多的创新 ， 所以我们其实花了特别大的精力 ，他们花了特别大的精力去做这个模型的支持和各种优化 。

但是我们 DeepSeek day zero 支持这一次 feature set 做的也非常全 ，因为花了很多的时间 ， 非常非常多的 feature 都是第一天就兼容了 ，并且我们也是我们第一次有这个 RL 的 day zero。Miles 是我们的 RL 框架 ， 很多的算子层一些实现都要重写 ， 大部分的 code 基本上是重写的 。

因为 DeepSeek v4 的架构设计跟之前已经存在的模型有太多的不一样 。

**Host** [1:04:55]
是不是就是每一代新的模型出来 ，其实都是需要有个重新适配的这样的一个过程 ？ 只是说它的模型架构如果变得非常大的话 ， 可能你的这个 effort 就会更大一些 ，但是如果它就是一个非常小的一个调整或者是一个 upgrade 的话 ， 就是你这边其实就没有必要去做非常大的一些适配 。

**盛颖** [1:05:15]
对 ， 如果它的架构完全不变的话 ，其实甚至都不用适配 。 如果它只是更新 waits 的话 ， 那甚至几乎不用适配 。

**Host** [1:05:21]
最近有一些这个研究都是探索模型直接在 latent space 里面推理 ，而不是逐字去生成 token， 比如说我们看到之前 Meta 的 Coconut， 还有自己的 Claude、DLM 等等。

如果这个方面成熟 ， 你觉得就是在推理引擎的很多优化假设是不是可能会发生一些变化或者重写呢 ？

**盛颖** [1:05:40]
如果这个成熟的话 ， 那确实很多事情是会变的 ，因为它推理的过程形态不一样了嘛 。 但是我觉得这个也本来就是你写推理引擎的一环 ， 世界在变 ， 结构在变 ， 然后你的事情要一直在变 。

这是一个本来就持续存在的过程 。 我觉得这个不是变革 ，不是真正的变革本身 。

**Host** [1:05:59]
不同的团队 ， 或者是不同的这个 AI infra 的 player， 适应变化的能力 ， 这个东西重要吗 ？

**盛颖** [1:06:05]
重要 ， 我觉得团队更重要 。 再举一句 ， 这个尤其是现在有 AI 了 ，AI 写代码写得这么快 ，其实你实现上变一点 ，其实就技术上来说不是真正产生巨大变革的地方 ， 技术上总是能做的 。

我觉得真正的难点从来都还是在回归人团队本身 ， 人和团队本身 。

**Host** [1:06:22]
那为什么你们的人 、 你们的团队就更好呢 ？

**盛颖** [1:06:25]
我觉得我们的人和团队团结谦逊又聪明又努力 。

**Host** [1:06:29]
那可能其他团队也会这么跟我说 。

**盛颖** [1:06:31]
我觉得其他团队也挺好的呀 ， 我觉得大家都挺好的 ，但是你每个群体都会有一个自己的 ， 最终会形成一个自己的文化嘛 ， 大家各有所长 。

**Host** [1:06:38]
你强调的就是公司内部的企业文化是什么样子的 ？

**盛颖** [1:06:41]
我希望大家是 focus，focus， 谦逊 ，focus and humble， 精益求精 ， 这个是我们就是我们追求极高的审美 ， 我们追求把事情做 solid。

我们希望 RadixArk 的人都是对自己特别挑剔的人。

**Host** [1:06:53]
都是自己本身特别挑剔的人。

**盛颖** [1:06:55]
对自己 ， 对自己的作品特别挑剔的人。

**Host** [1:06:58]
那在今年年初的时候 ， 我们看到这个 VLM 的核心团队呢 ，也是商业化了 ， 成立了 InforaRt 公司 ， 然后也是融资了一点 5 亿美元 ， 估值 8 亿美元 。

这个产业之后会有更多的竞争对手吗 ？ 更多的公司会商业化来做这个事情吗 ？

**盛颖** [1:07:13]
我觉得完全有可能 ，而且其实它就是持续不断在发生的 。 就是 InforaRt 和 RadixArk 这两家之后， 还有新的 inference 的 company 在不断的涌现 。

**Host** [1:07:23]
谁会变成赢家呢 ？ 就是核心的竞争点 ， 团队的竞争点会在什么样的方向呢 ？

**盛颖** [1:07:28]
我其实不觉得我们在这个赛道 ， 虽然我们有 SGLang，SGLang 是 inference engine，但我觉得 RadixArk 的那个长远使命其实是不属于这个赛道的 。

**Host** [1:07:36]
有意思 ， 能不能详细来说一下 ？

**盛颖** [1:07:38]
我如果按照前面说的话 ， 我觉得 RadixArk 我说的目的是我们想把最好的 AI 带给大家 ， 这是我们非常朦胧的一个目标 。RadixArk 接下来一年要做的事情 、 三年要做的事情 、 五年和十年其实都讲出来会非常的不一样 。

我们最终想要 ， 我不想透露 ， 我不想 disclose，但是我可以大概的说 ， 我认为 RadixArk 最终使命是要做下一代 AI 的 。

**Host** [1:07:57]
下一代 AI？

**盛颖** [1:07:58]
下一代 ，next generation AI。 我们的本质还是不是单纯的 infra implementation。

**Host** [1:08:03]
对 ， 意思是你们想要做模型吗 ？

**盛颖** [1:08:05]
也不一定是模型 ， 它是下一个形式 。 就我现在就我不讲它是什么 ，但我可以说我们并不是停在这个地方的 。

**Host** [1:08:12]
只是说这个 inference 或者是 infra 只是一个起点 。

**盛颖** [1:08:16]
对 ， 它是一个前前条件 ，但我们想我们要做的也不是模型 ， 我们将来想做的事情不是一个现在世界上已经存在的东西 。

**Host** [1:08:24]
有意思 。

**盛颖** [1:08:25]
所以我其实不觉得我们跟 existing 的这些 inference player 是一个 category 里面的 。

**Host** [1:08:30]
就是它还不存在 ，但是你觉得它一定会发生的 。

**盛颖** [1:08:33]
我觉得它会发生 ， 然后你想把它找出来 ， 或者是我希望它发生 ， 我想看到它发生 。

**Host** [1:08:39]
我就很好奇 ， 你能跟我说一下我们会去把它逼掉吗 ？

**盛颖** [1:08:43]
不能 。

**Host** [1:08:44]
好 。

**盛颖** [1:08:45]
对 ，但我可以说就是 inference 不是我们的 ， 它是一个起点 ， 它不是 RadixArk 的长远核心 。 所以我们其实跟其他的 inference 的 company 都是保持良好的关系 。

我们的领域是全开源的嘛 ，SGLang 也不是 RadixArk 的所有物了 ，SGLang 是 Armsys 下面 ， 它是属于社区的 ，但是我们公司的所有贡献在 SGLang 上都是开源的 ， 我们是没有 private fork。

我们的愿望也很简单 ， 我们其实只是希望这些东西被所有人使用 ， 我们并没有想要通过这个地方制造一个 difference， 然后去获取利益 。

所以公司的命脉是不在这里的其实 。

**Host** [1:09:20]
我们看到其实有不少的做推理引擎的创业公司嘛 ， 虽然有些公司他们自己不做引擎 ，但是也是在这个引擎上面去做服务的 ，而且现在体量也不小了 ， 比如说 Bastion 是最近完成了 3 亿美元的融资 ， 估值 50 亿美元 ，BioWorks AI 现在估值有 40 亿美元 ， 然后 Together AI 现在呢 ，也是在寻求 10 亿美元的新融资 。

那同时我们看到这个 AWS 啊 ，Google 这些大的云厂商也是在提供这个托管推理服务 ， 整个的 AI infra 的生态链最近在发生什么样的事情 ， 能不能跟我们梳理一下 ？

**盛颖** [1:09:51]
我觉得 inference 这件事情其实很早就存在 ，也发展了很久 ，但是今年 AI 可能在变得更加成熟 ， 就尤其是 Anthropic 这个暴力大家都看到了嘛 。AI 变得更有用之后， 整个市场的 effort 可能会有更多的从 training 转向 inference， 就是开始需要让它盈利和兑现的时候了 。

然后这个转化又会使得 inference 的市场进一步的本来就已经很 exposed， 现在更大的 expose。 所以你会看到很多这种雨后春笋般冒出来的各种各样的 inference 公司 ，但同时所谓的 AI native 的公司 ，他们也开始感受到了这个你继续使用 existing 模型去做 prompting engineering 的局限性 。

与此同时也有更多的公司开始需要利用好自己的 data 去做 customization 的这个需求 。 这个需求它从另一方面也在推动 RL 这一块的市场化 。

一方面你看到有很多的新的 inference 公司出来 ， 另一方面你发现你会看到一个 established 的 inference 公司在往 RL 那边 move，在往 RL 那边扩张 。

我觉得这可能是这一批公司里面最大的两个趋势 ， 最明显的两个趋势 。

**Host** [1:10:51]
Bastion 还有 BioWorks 也是你们的客户嘛 ， 对吧 ？

**盛颖** [1:10:54]
但以后的用户 。

**Host** [1:10:55]
你觉得以后会发展成竞争对手吗 ？

**盛颖** [1:10:58]
我不知道 ，他们有可能觉得我们是某种意义上竞争对手 ，但是我们不把他们当成竞争对手 。 我们是更想和谐相处的 。

一个是我们其实重点重心并不在这个地方 ，不然我们就不会把我们的 inference 给大家随意使用 ， 然后还去支持他们使用 。

第二点是我们因为我们这个开源的意愿 ， 我们希望被大家都使用 ， 所以我们并不是也不想跟他们成为竞争对手 。

我们希望这些都是我们的盟友 ， 然后我们更希望的是 focus 在 AI 本身的一些技术迭代上， 然后我们希望把这些技术可以跟他们所共同发展 ， 促成他们的这个业务模式的增长 。

**Host** [1:11:31]
现在你们服务的客户大概是什么样类型的企业 ， 或者是他们有没有一个什么比较典型的使用场景可以分享的 ？

**盛颖** [1:11:38]
我们各个 type 的客户都有 ， 从这个 data center，new cloud， 就是 hyperscaler， 就这些是 cloud provider， 就是他们有 GPU， 我们帮他们想跟他们一起或者帮他们 sell GPU， 到这些 inference provider， 我们其实也想跟他们合作 ，也是希望他们成为我们客户 ，但现在还是一个 user 的关系 。

再往上到 AI，AI 这些公司他们想要使用 AI infra 去不管 train 他们的 model 或者是 serve model 也好 ，他们也是我们的客户 。

还有一些传统的大公司 ， 它不是完全的 AI 公司 ，但是它想要用 AI 来助力它原来的业务 ， 那我们也希望在这里可以提供一些价值 。

**Host** [1:12:13]
SGLang 之后还开发了 Miles 嘛 ， 这个是主要是用在 RL 上面的 。 你们为什么同时要做 inference 跟 RL training 呢 ？

**盛颖** [1:12:21]
因为我们做的是整个 AI infra，inference 和 RL 是就我刚说它是在最靠近用户的两个末端的步骤 ， 所以我们从末端步骤开始布局 ，但是我们要做的是整个能够把 AI 制造出来的能力 。

**Host** [1:12:33]
这两个东西同时做难度大吗 ？

**盛颖** [1:12:36]
还好 ，因为它俩其实非常相关 。RL 里面很大一部分的挑战就是来自于 Road Engine，Road Engine 它也是跟它就是 inference engine 嘛 。

如果 RL 的话 ， 你更多的是要做一些调配上的 、 调配上的工作和可能 waits transfer 啊之类的胶水性的工作 。 那 scheduling 算法也有一些新的东西 ，但是系统层面它们有非常非常大的 overlap。

**Host** [1:12:55]
对 ， 你刚刚跟我讲了两个很好的教授嘛 ， 非常教科书级别的教授 。 有没有哪个管理者你是觉得你遇到过就是是最好的管理者 ？

他们的特质是什么样子的 ？

**盛颖** [1:13:08]
其实管理这个词也很宽泛 ， 就不同位置的管理者他们的功能也是不一样的 。 管理与被管理 ， 它其实也不是一个单纯的管理与被管理的关系 ， 它其实也是一个职能分工的关系 。

就是一件大事要做成 ， 它背后一定要有一个人， 有一个人他非常非常的跟这件事情绑定 ，他是不遗余力的要推动事情发生 。

这个人不管是 founder 也好 ，是那个 CEO 也好 ， 就是他可以是任何一个人 ，但是你必须有这么一个人 ，他以某种形式他跟这件事情被绑定了 。

这个角色这个人他需要有很清晰的想法 ， 知道我们要我们从哪里来 ， 我们要去哪里 ， 我为什么要做这件事情 ， 团队为什么要做这件事情 。他需要能够有这个坚持 ，并且他要能够看见未来 ， 看见一个他想推动的未来 。

不一定 ，也许没有他就不会发生 ，但是一定是一个他能看见的未来 。 有 vision， 这些东西是最重要的 ，但是你有 vision 的这个人 ，他并不一定需要具备管理者需要的所有特质 。

你与此同时， 公司里面还需要的其他的管理者 ，他们又需要执行不同的 functionality， 比方说能够真的把一个 vision 变得变成真实 ， 变得可执行 ， 能够把人与人之间的这个合作关系调度得很好 ， 这可能都是不同人的功能 。

**Host** [1:14:18]
管理者非常重要 ， 然后它的架构制度非常的重要 。

**盛颖** [1:14:21]
但是对 ，但我觉得我现在的想法都很初级 。 我其实现在 exactly 就是处在一个思考这个问题的阶段 ， 就是我觉得我们刚刚我们刚好就在一个从我还能一个人看清所有事情到我现在看不清的这个阶段了 。

所以我其实最近就是在想这个问题 ， 我还没有我还没有找到答案 ， 我现在看到的都是挑战 。

**Host** [1:14:40]
对 ， 那现在这个挑战跟你当时刚加入 XAI 的时候面临的挑战是相似的吗 ？ 因为你说 。

**盛颖** [1:14:46]
不一样 。

**Host** [1:14:47]
那你说 XAI 你也是把它看成你的 baby， 看成一个很重要的一个事情嘛 。 那你在孵化它的时候 ，因为你加入 XAI 的时候 ， 它应该还没有 inference team， 然后你其实是把它给 build up 起来的 ， 这样的一个很重要的核心的人。

你觉得就是在回顾当时你面对的一个局面跟挑战的时候 ， 跟现在有什么样不一样吗 ？

**盛颖** [1:15:07]
还是完全不一样的 ，因为毕竟在 XAI 我不是 XAI 的 owner 嘛 。 就算我想 ， 虽然我把它当成 baby，但其实其他人并不觉得它是我的 baby。

所以我其实并没有被赋能 ， 我并没有被 empower。 我有想法 ， 我有观察 ，但是我很多事情是改变不了的 。 我是没有办法去做很多决定或者是告诉下人一些你想他人的决定的 。

那我的责任其实也没有办法扩展到那样那么大的边界上 。 但是我在 XAI 确实学到了一句话 ， 这个 XAI 的那个两个 leader， 就是当时 Tony 和国栋分别跟我说过 ， 我不知道他们是不是串通过 ，但他们都跟我说同一句话 ， 就是说那个你的 authority 和 responsibility 要 match。

就我在 XAI 我是没有 authority 的 ， 我只是一个小亲力量而已 ， 就是我其实没有权利做很多事情 ， 所以我就没有责任 。

**Host** [1:15:51]
哦 ，OK，OK。 所以你自己对你觉得你自己有责任 ，但是 。

**盛颖** [1:15:55]
我其实没有 。

**Host** [1:15:56]
Actually 没有 。

**盛颖** [1:15:57]
对 ， 我其实没有 ，因为我负不了责 。 我不能决定事情 ， 我就负不了责 ， 对吧 ？ 这个事情如果我不能决定该怎么做 ， 做错的话我也担不了责 。

做对了就不是我能控制的事情 。 但是现在的话就是说这个公司 ， 那我要做决定 ， 我必须要做 ， 它变成我的义务 ， 我必须要做决定 。

那它做得好和坏 ， 所有责任全部在我头上 。 如果事情没有做好 ， 我就要背锅 。 那当然做好了你会开心 ， 做好了其实 team 的功劳 ， 做坏了是我的责任 。

这个就是跟之前的事情完全不一样的角色 ， 挑战也是完全不一样的 。

**Host** [1:16:26]
从研究员到大厂 ， 再到自己出来这个创业行业 ， 你对自己的定位有什么样的转变吗 ？

### 创业与融资

**盛颖** [1:16:31]
我其实没想过这个问题 。 我觉得我一直都只想我想做什么事情 。 我做件事情能够借用的身份也好 ， 资源也好 ， 当时的我觉得什么是最好选择 ， 我就会去做什么选择 ，但它们都只有一个目的 ， 就是我要做我想做的那件事情 。

两年前的时候我可能觉得我想我想要创造那个未来 ，professor 是一条路 。 两年后的今天我觉得 professor 这条路走不通 ， 我就开始开公司创业 。

不管是我是做 professor 还是开公司 ， 它都只是 approach。 我没有想过这个身份本身意味着什么 。 我不是很在乎那个身份 。

**Host** [1:17:02]
但是因为你选择的路不一样 ， 你要做一些其他的事情来辅佐你最终想做的事情嘛 。 比如说你现在是一个非常明星 startup 的 founder， 你要去融资 ， 对吧 ？

你要去招人， 你可能要去做一些其他以前你没有想过要去做的事情 。 所以就是比如说融资跟投资人聊这件事情 ， 对你来说是负担吗 ？

还是这个事情 ， 我觉得这个融资这件事情我以前确实不懂 ， 就是被迫去做的 。 但这件事情总是要做 first principle thinking。

我如果要做我的目标 ， 这件事情该做 ， 那我就去做它 。 就我们当时融资还是挺曲折的 ， 这个具体我就不讲了 ，但是挺曲折的 。

但是我现在觉得我经历了这么长时间之后， 我现在对这个行业有些更多的理解了 。 我其实觉得我在跟他们打完交道之后， 我昨天我们聊完之后， 我又做了更多的思考 。

我现在觉得我对投资人有更多的 respect。 我觉得我更理解他们的一些想法 ， 为什么整个行业是一个这样的状态 。

对 ， 就当然就是 SandHill 它有一套它的游戏规则 ， 那这套游戏规则我理解其实跟之前做 research 的时候是完全不一样的 。

你觉得你自己在适应这一套新的游戏规则的 ？

**盛颖** [1:18:08]
我觉得没有真的不一样 ， 没有不一样 。 本质逻辑肯定是不一样 ，但是本质逻辑都是就是不同的体系 ， 然后还是人， 还是人性 。

你追根到底还是所有的人性 ， 本质逻辑没有不一样 。

**Host** [1:18:20]
就是你把东西做好 ， 你追求的一个真的东西 ， 你把它给做出来 ， 说出来 。

**盛颖** [1:18:28]
是吗 ？ 就是我觉得它体系不一样 ， 它的学术界的体系跟融资体系 ， 投资人体系肯定是不一样的 。

所以你的规则不一样 ， 那你的这个 mechanism 不一样 ， 你做事的方式肯定不一样 。 但是归根结底 ， 它所有事情你再次说下去都是人， 人与人这件事共同的 。

所以当你进入另一个体系的时候 ，其实只是要学习那个体系是怎么回事 ， 怎么运转 ， 然后各种利益点是怎么样的一个平衡关系 。

然后你如果还是以同样的人的根本作为推理基点的话 ， 对这个整个体系的理解还是可以被推理出来的 。

**Host** [1:18:55]
这个点有意思啊 ， 就像 PopCarper 一样 ， 它是有套路的 ， 对吧 ？ 你学到了这个套路 ， 那其实你很快所有 average 的东西都是有套路 ， 所有 common 的事情都是有套路的 。

最后的这个投资人应该是说结果非常非常好了 ， 英伟达 、AMD、 英特尔这几个最大的半导体公司都罕见的集体的投了你们 。

除此之外呢 ， 你们也是拿到了非常硬核的很多的投资人的背书哈 。 你觉得他们为什么投你们 ？ 他们看中了你们的什么 ？

**盛颖** [1:19:21]
我也很想问投资人这个问题 。

对 ， 我觉得我很难为他们代言 ， 就是他们看中了我们什么 。 但我如果说现在让我 sell 一下的话 ， 那我觉得我们是在这个赛道里面一个跑出速度的玩家 。

我们跑出的速度让大家可以看见我们的未来 ， 我们也觉得我们可以有机会创造新的 market，也有机会去助力现有的 market。

我们可以 enable 更多的其他的 AI 公司 ， 或者是想要进入 AI 的公司去 enable 他们制造 AI 的能力 ， 可以让他们更多的接近 AI 和利用 AI 创造更多的价值 。

那么我们如果能提供这部分价值的话 ， 这个就是我们值得被投资的原因 。他们还是看重这件事情 ， 觉得这个事情是关键的 。

我觉得肯定很多人是看重事情的 ， 当然早期投资也有一些也看人吧 。 我其实更喜欢看人的 investor，但可能后来 ， 可能接下来 A 轮 、B 轮 、C 轮之后的 investor 就会看数字跟业绩了 。

但是我们第一轮因为有这个看人的基础在 ，他们肯定是人和事一起看的 。 至于他们为什么看中了 ， 我就我就不替他们回答 。

**Host** [1:20:28]
然后你为什么对开源这么执着啊 ？ 这个是追溯到 。

**盛颖** [1:20:35]
我其实想纠正一下， 我觉得我不是对开源执着 。在乎 ， 就是我没有刻意要在乎和执着它 ，其实它是自然发生的 。

当然我从这里获得价值观确实跟我以前的经历有关 。 我出生在江西这样一个就中部的省， 也不是很发达的一个省 。

然后我小时候受到的教育 ， 我已经在江西省受到了很好的教育 ，但是你放眼全国甚至国际去比的话 ， 那我当时受到的教育还是很很朴素的一段教育经历 。

当时我想要学编程 ，其实没有太多的资源可以学 ， 所以我大部分的学习都是从互联网上拿到的 。 计算机那个时候也不是最火的专业 ， 计算机竞赛更不是大家追捧的竞赛 ， 所以你能够在市面上搜集到的教材啊 ， 或者是各种资源都非常的稀少 ， 都是未经加工的 。

所以当时我的学习全都是来自于我去互联网上去看到的那些非常 random 别人留下的帖子 ，CSDN 对吧 ， 各种当时 online judge 的那个网上题库 。

我从那些地方学到的东西都是来源于我不知道是谁的人， 我至今也不知道他们是谁 ， 当时我也不知道他们是谁 。

我只是过去非常慈的把代码拿走了 ， 我回家研究 ， 然后我都不知道写这个代码的人把它使用出来的人是谁 。

我是被这样一群人被互联网上不知道世界上在哪里的人给 raise 起来的 ， 就是我是被他们教会的 。

所以 sharing open 的这个文化 ， 它对我来说是一个就像我生活的空气一样存在 。 我也没有觉得我在刻意追逐它 ，但是它对我来说就是一个从我很小很小开始 ， 它就一直在我身边的像空气一样 。

我觉得它理所应当 ， 你有一个 idea， 你做了一件事情 ， 你不分享出来 ， 那才觉得奇怪 。 我其实是这样一个状态 。

**Host** [1:22:09]
你觉得开源社区在最近几年有发生什么变化吗 ？

**盛颖** [1:22:13]
一个好的变化 ， 一个不那么好的变化 。 好的变化是我觉得开源越来越多了 ， 就是大家越来越追求开源 ， 越来越愿意开源 ， 越来越相信开源的价值 。

不管是大家的这个 mindset， 就是人对开源的欣赏 ， 还是资本对开源的认可 ， 都是上升状态的 。 但是有那么一点不好的变化是 ， 它的这个追捧上升中也开始掺杂一些其实不是那么纯粹的东西在里面 。

你掺杂一些不是那么纯粹的东西 ， 一个是会破坏原来我们所想象的那个开源带来的那个美好的事情本身 ； 另一方面是你如果开始有这样的东西存在了 ， 会让原来相信这件事情的人变得不那么相信 。

开源里面混进了一些功利主义者 ， 这些功利主义者的存在使得那些本来不是功利主义的人分不清楚开源里面的成分哪些是纯粹的 ， 哪些是不纯粹的 。他们的影响呢 ，不仅仅是他们自己 。

这是我可能觉得开源也你在变好的过程中也同时会开始出现的一种 balance 嘛 ， 就是东西总是阴阳总是共存的一种 balance。

**Host** [1:23:13]
大家最近对开闭源之争也聊得蛮多的啊 。 你觉得整个 AI 的走向会慢慢的往闭源那边去迁移吗 ？

### 开源生态

**Host** [1:23:23]
还是说以后 。

**盛颖** [1:23:24]
我觉得还是共存状态 。 我觉得开源不会停 ，而且根据我的了解 ， 它也没有停 。 有更多的人一直在想要进来贡献贡献自己的力量 ，但我也不觉得所有东西都应该开源 ，因为

你不能没有规则 ， 你也不能没有界限 。 就是完全的开放开源这个状态 ， 如果你没有掺杂太多的可套利的空间的话 ， 它可以是美好的 ，但你一旦把它完全打开的话 ， 人性的恶也会被放大 。

**Host** [1:23:50]
是 。

**盛颖** [1:23:50]
所以我觉得两种 argument 都是正确的 。 我确实也不觉得 AI 应该完全的展现在所有人面前 ， 它确实有 risk， 我不否认这一点 。

我也不站在 AI 应该完全被握在一小批人手上， 我也不站在那一侧 。 我觉得 AI 应该均等的被握在不同的人的手中 。

我们想做的就是这件事情 。 就是 RadixArk 不是纯粹为开源服务的 ，其实就是我们是有开源文化在 ，但并不意味着我们做的所有事情都是开源和为开源服务的 。

我们也为闭源模型服务 ，但是我们说的这个 decommercialization 是我们允许我们认为开源闭源是共存的 ，但是我们希望闭源它存在但不 centralized。

**Host** [1:24:27]
理解 ，但这个怎么实现呢 ？

**盛颖** [1:24:29]
所以我们希望提供这个能创造最好的闭源模型的 toolchain， 让所有人都拥有制造属于你自己的 AI 的能力 ，但是你制造出来的 AI 属于你自己 。

**Host** [1:24:39]
Android 昨天呼吁就是大家都停止 AI 的研究 ，但是它又下了个附加条件 ， 就是说我想 make sure 大家都停止了我才停止 。

就是你现在 comfortable 就是这些最强大的模型都被握在这么几个的闭源模型的 player 手中这件事情吗 ？ 这件事情它能被打破吗 ？

你觉得 ？

**盛颖** [1:24:58]
我觉得这件事情很难发生 ， 它是违背人性的 。

**Host** [1:25:02]
你是说就是所有人停下来 AI 研究这种事情是因为你大家没有在你这样一个体系里面 ， 大家没有拿到同样的资源嘛 。

所有人都想要接触到最好的 AI 啊 ， 所以这个事情很就很难发生 。 我不觉得它不正确 ，其实 。 如果说现在有一个非常强力的上帝 ，他下来安排每一个人做什么 ， 那事情是可以发生的 。

我不认为那是一个非常差的世界结局 ， 就是大家都停了 ， 然后 anthropic 领先 。 我不觉得这是个极度差的世界结局 ，但是世界不可能停在那个地方 ，因为没有一个这样一个上帝下来可以把所有人安排的按部就班 ， 一定会有人要在里面起义 。

所以我觉得它是不可能发生 。 那这个事情会往哪里走呢 ？ 终局可能不知道是不是一个会非常美好 ， 就像你说的一个非常 decentralized， 每个人都能有自己的 AI 的这样的一个终局 。

但是你觉得 what's next？

**盛颖** [1:25:47]
这看我往多远的未来去想 。 如果我讲到很远的未来的话 ， 我觉得现有的 AI 还没有强到它会真的完全控制和威胁到人类 。

所以在可见的目前我能够 guarantee 看到的未来里面 ， 人类还是安全的 ， 我觉得 。 那如果是这样一个前提下的话 ， 大家还是会互相追逐 ， 然后 AI 会变得越来越强 ，但是它这个强是一个 productively 上去取代人类的一些功能性的强 。

它不能完全的取代人， 它只是取代了人类的一些功能 。 但这个变革肯定也是巨大的动荡 ， 它会对人类的社会结构 、 权力结构产生巨大的动荡 ， 就是跟过往发生过的每次工业革命一样的一些席卷性的这种动荡 ， 可能比以往的工业革命更加工业革命 。

但是它是个你可以理解的范畴 。 更远的未来就是如果说 AI 它真的可以强到已经开始操控人类 ， 就它真的已经 over 人类 ，dominate 人类了 ， 能够做人类做的任何事情 。

如果那天真的能来的话 ， 我们是阻止不了的 ， 我觉得 。 我觉得那天就会来 。 或者说你想阻止它的方式不是通过呼吁所有的人类停止来阻止 ， 这个事情是不太可能发生的 。

**Host** [1:26:51]
对 。

**盛颖** [1:26:52]
你阻止它的方式一定是发明发现另一条路径 ， 使得你允许 AI 继续前进 ，而人类还不会输 。

**Host** [1:26:58]
你在这中间想做什么事情吗 ？

**盛颖** [1:27:01]
我觉得我想啊 ， 我想要 build 的那个未来就是一个跟强力 AI 共存的未来 。 我们现在说我们要把强力的 AI、 最好的 AI 带给所有人， 就人类需要这个公平 。

你不太可能通过一小部分人把好的 AI 握在手里 ，其他的人都无能来维护表面上的和平 ， 这是不可能的 。 如果说 AI 一定要往前走的话 ， 那所有人都往前走 ， 所有人都能够去 ，不一定是所有人， 不是 literally 所有人 ，但是我说大家都不是被这样棒的 ，而是你如果你是个你有这个想 idea 潜力 ， 你值得往前走的时候 ， 你能够接受到最好的人类知识的话 ， 你需要在这样的竞

争环境中往前走 ， 它是一个健康的与 AI 共存和大战的状态 。 你先要有这样一个假设 ， 然后整个人类他们才能是团结在一起去寻找这个 solution 的 。

所以这件事情是必然的 。 我们不管如果那天发生 ， 真的到了有一天你需要让人类寻找一个新的 solution 的话 ， 这个它都是个前提 。

你先要让所有的人类平等共处 、 团结一致 ， 然后你才能再寻找一个人类与 AI 共存的世界 。

### LMSYS平权

**Host** [1:27:59]
LMSYS 你再讲述一下那段经历吗 ？

**盛颖** [1:28:02]
LMSYS 是我们想我跟连敏最早一开始想成立一个机构 ， 这个机构可以让不同学校的人参与研究 。LMSYS 到今天虽然它是一个 nonprofit 的 ， 然后我们大家都在里面 part time 的帮一些事情 ，但是 LMSYS 其实是一个我们想要非常严肃做的事情 。

如果说 RadixArk 有一天我希望它永远走下去 ，但如果有一天它不是走到底的话 ，LMSYS 是那个我终生会做的事业 。

但是它跟 RadixArk 也有些共同性 ， 就他们的都有个共同的 value， 就是关于平等和关于平权 。LMSYS 的平权是来自于我们希望能够孵化优秀的人才做的项目 ， 即便他们没有充分的背景 ， 没有充分的后台 ， 没有充分的 branding， 这个是来源于一些我自己个人经历 ，也我经历过低谷的时期 ， 很低谷的时期 ，也经历过很高昂的时期 。

我自己能感知到这里面的 difference， 可能同样是我同样做了一件事情 ， 我在高昂的时期做的那件事情非常容易被大家关注到 ， 被大家记住 ， 甚至被大家夸大 。

但是我在低谷时期做的事情有些也不错 ，但是其实你就你就很难被大家所看见或者是被大家认可 。

但我觉得这个 difference 是没有必要存在的 ，而且它是破坏社会公平竞争结构的 。LMSYS 希望做的是抹平这个差异 ， 希望好的项目真的能够被托举出来 ，并且我们希望 credit 能够分到做事情的人身上， 让可能还没有积累 、 没有 established 的人对项目有更强的掌控权 ， 保护未 established 的真实的开发者的掌控权 ， 对项目的掌控权 。

**Host** [1:29:31]
我看你在开源社区的时候还做了一些蛮多其他的一些项目 ， 就比如说这个 LM Arena 这个东西其实在行业里面就是影响也是挺大的 。

那段时间就是你其实主要还是一个主线嘛 ， 就是说不同的项目它在不同的 project 这样来推进是吗 ？

**盛颖** [1:29:51]
Arena 是当时我们做 LM 这段时间的一个其中一个 farm project， 当时觉得这个事情挺有意思的 ， 然后做了一下， 然后它意外的得到了挺多的关注 。

可能大家当时就觉得就排行搒这个事情可能本身它具有一定的娱乐性 ，但是我觉得这个 Arena 确实是我们开始做的 ，但你真的说把它壮大然后做成公司 ， 那确实还是我们后来就是伟林是我们把这个项目交给了伟林他们 ， 然后后面一些新的人也加进来 ，是后面这个新的团队把他们真的做成商业级别规模的一个项目 。

**Host** [1:30:22]
就是刚才你说每个人要公平要平权 。

**盛颖** [1:30:27]
平权更多的是说相同的机会 。

**Host** [1:30:28]
相同的机会 。

**盛颖** [1:30:29]
对 ， 特别是对于 tech 方面的一个怎么说 ， 程序员也好 ， 或者是 researcher 也好 ， 就是你对这件事情的在乎是因为什么样的契机或者是什么样的经历 ， 可以跟我们分享一下吗 ？

一部分是我觉得我好像天生就是这样的 ， 就是我生下来就是在乎这个事情 。 另一部分可能也是一种延伸 ， 就是我觉得我从小到大是我觉得我是经历了看见经历和看见了很多性别歧视的 。

我觉得虽然大家回避这个 ， 就没有那么这个话题有一定的可争议性 ， 就是你怎么界定是或者不是 ，但我觉得我还是很明显的说这个事情它存在 ， 你无法回避它存在 。

而且我非常切身的经历过无数这样子的例子 ， 它每一个例子你单拎出来它都非常小 ，但是它是那种就是一件在你生命中无时不刻每天发生的平凡的小事 。

所以它其实对那些被影响到的人造成的影响 ，不是你听到一个例子的时候说感受到的冲击 ，而是把那一件小事的冲击乘上 1 亿倍 ， 那才是对那个人人生的真实的冲击 。

然后你再把它扩大到整个群体 ， 它所造成的这个互动性影响 ， 就是 common sense 的影响 ， 刻在所有人共同认知里面的影响 ，是没有办法用一个例子去说清楚的 。

我觉得这个是它造成了我为什么特别在乎平权和公平平等这些东西的一个性格特质原因 。 第三个就是我刚跟你讲 ， 就我自己经历过 ， 我知道我能感受到就有些包括我自己做的我发那些 paper，有些 paper 其实我觉得也就一般 ，但是那个 paper 可能就是因为是我发的 ， 或者是我一个斯坦福发的 ， 伯克利发的 ， 然后大家就会觉得它是一个标准 ，但其实同期可能有一些跟我

做的 paper 差不多的 paper。 我其实只是一个 researcher， 我不是那个科学家 ，但是因为这样一个身份让我这篇 paper 被定义了 ，但是我觉得这个事情它本不应该这样子 。

就虽然我是获益者 ，但是我当我是获益者的时候 ， 我觉得我有我现在终于有力量可以因为我是获益者 ， 我终于有力量把这个事情往外推动一点 。

**Host** [1:32:33]
MSYS 想要以什么样的形式去把这个权利很公平的分给每个人呢 ？

**盛颖** [1:32:41]
很难 。 就是首先我们都知道这是一个结构性问题 ， 它不是我能做的或者是这个一个机构能做的 。

我记得有一次我跟 Yang Stoica 聊天 ， 我忘记是具体聊了什么内容了 ，但是我跟他说我想改变一些东西 。他聊到一个什么事情 ， 我说这个事情我想改变 ， 然后他说你改变不了 ， 或者是他问我说你觉得你能改变吗 ？

改变得了吗 ？ 然后我就说我说我不能改变 ， 我确实没办法改变 ，但是如果我能改变 1% 的话 ， 我愿意用我的一生去改变这 1%。

一样的答案 ， 就是我觉得我改变不了 。 这个挑战对于我来说在这个挑战面前我太渺小了 ，但是我觉得我能改变一点点 ， 或者是改变我身边的一点点人， 然后这个一点点人他们会再把这个精神再传递到更多的人身上， 它就发生一点点变化 ， 那我就觉得它值得我用一生去做 。

但是这个里面有一个很微妙的地方 ， 就是你所说的当我们想要改变一件事情 ， 推广一个价值观 ， 或者你想改变身边的人的时候 ， 这个传递是非常容易出错的 。

**Host** [1:33:41]
对 。

**盛颖** [1:33:42]
是非常非常容易出错和被人利用 。其实真正最后你能够传递的是你是不是能够把就是你要 pick 的人非常重要 。

有很多人他就不在这个里面 ，他根本就不在这个体系里面 ， 所以你不是所有人都可以被压制开 。 所以你要找的那些人不是打个比方说我现在想帮助弱势群体 ，但不是说我真的去帮助弱势群体这事情就能被解决 ， 解决不了 。

你要解决的是你要找到那些跟你一样想去找到想帮助弱势群体的人的人， 你只能去找到那个能把这个东西散布出去的人 ，而不是直接去做到 。

就比方说哪怕你培养更多的学生成为老师都是不够的 ， 你要培养的是想要去培养把学生培养成老师的老师 ， 你就要把那个 recursive 的链条建起来才有用 。

**Host** [1:34:27]
对 。

**盛颖** [1:34:27]
然后这个事情它会非常的慢 ， 它非常非常的慢 ， 所以我觉得我做不了多少事情 。 但是它的好处是你如果能做到一点 ， 它就做到了 。

它不是个会回退的边 ， 它不是个会回退的改变 。

**Host** [1:34:40]
它是一个 gradual 的 。

**盛颖** [1:34:41]
就是你往前推了 ， 它就是往前推了 。 对 ， 它至少是 solid 的一个 improvement。 我觉得所有的 improvement 只要它是 solid 的话就可以 。

如果它不 solid，但看上去很 ，但是看上去是个 big jump，但它不 solid， 那你这个 big jump 就是没有意义的 。 就我们平时推项目我也这么跟他们说的 ， 我说我不用着急 ， 我们不用到那个 go。

但是你要但是我们重要的是你 team 能不能训练出来一套系统化方法 ， 我的每一小步的 move 是不是 solid 的 。

哪怕我就动了一点点 ， 比你那个动了很大一步 ， 那将来还要退回来要好很多 。

**Host** [1:35:06]
在 research 界也会有性别歧视吗 ？

**盛颖** [1:35:11]
它也不能叫歧视啊 ，其实没有那么严重 ，但性别不平等。 它可能都没有到不平等和歧视的地步 ，但是它会有 。

但是这个很多很 subtle 的很 subtle 的这种意识层面的不对称是无处不在的 。 我给你举个微妙的例子吧 ， 就非常有多微妙这个事情 ， 就是微妙到你会觉得它不是个事 。

就打个比方说小时候 ， 比方说我竞赛初生 ， 我打竞赛竞赛打得很好 ， 如果我是个男生 ， 大家就会说我是天才 ； 如果我是个女生 ， 她就会说她很努力 ， 她很听话 。

就是你很用功 。 对 ， 或者你运气好 。 我小时候经历的是什么呢 ？ 就是有一年的竞赛 ， 那年我一直是成绩是就是各种大赛比赛都是很好 ， 都是顶尖最好的 ， 反正至少是比我们学校里跟我 peer 的那个人要好很多 。

但是我身边的人会找无数个理由来解释我为什么好

，他们觉得你赢是不应当的 。他们否认你是天才这件事情 。他们不否认 ，他们不会否认他们 ，但是他们会觉得你就是如果换一个人， 那个人赢是理所应当的 ，但如果是我赢了 ，他们会觉得你这个赢需要被解释 。

但是你正常情况下， 一个人赢是不需要被解释的 ， 我为什么要去 explain 他为什么赢呢 ？ 他厉害呀 。 对 ，但是我的每一场赢都要被解释 ， 背后都有个原因 ， 叫做我为什么赢 ，而不是你为什么输 。

这个解释可能是他这个他的对手最近状态不好

， 然后下一场他的对手状态又没回来 ， 然后下一场是他这个题压重了 ， 这个题他以前做过 。 但是可能你其实这个任务其实我并没有做过 ，但是你就你感受到这个这个这个也不是故意的恶意 ， 让人很知心 。

**Host** [1:36:49]
这些微妙的存在也会出现在你之后做研究 、 读博士 、 做项目 。

**盛颖** [1:36:55]
对 ，是永远不断的 。

**Host** [1:36:56]
也都会一直有这样的存在 ， 就是说你赢了 ， 你比人厉害 ， 大家就会给你找理由说他为什么 ， 为什么是他 ， 为什么他赢 。

**盛颖** [1:37:06]
对 ，他们会说我要进去研究一下这个人为什么可以 ，他为什么可以 ，他为什么能发这么多 paper。

**Host** [1:37:11]
因为没有太真还真啊 。

**盛颖** [1:37:15]
一旦有一个合作方 ， 然后这个合作方他是男性或者是他是 established 的 ， 别人就会觉得这个 idea 会不会不是他的 。

就是这些很微妙的事情 ， 就是你单独去看的时候 ，他们都很小 。 但是我说这是一件持续发生 ， 每天发生 ， 每分每秒在发生的小事 ，而且它会波及到每一个在这个群体里的人。

**Host** [1:37:34]
Exactly。

**盛颖** [1:37:35]
你根本就没有办法跳出这个框架 ，因为一旦你跳出 ， 别人就会觉得你小气 ， 别人就会觉得你格局小 。

我年轻的时候在对这件事情的态度会更极端一些 ，但我后来觉得我已经觉得没什么好 ， 就是这个事情是不需要被讨论的 。

你要解决这一点只有一个方法 ， 就是你让所谓的弱势群体 ， 或者说如果在这个 specific example 的话 ， 就是女性真正拥有权利 ， 除此之外没有别的办法 。

**Host** [1:38:01]
你就是不断去赢就好了 。

**盛颖** [1:38:03]
对 ，而且这个权利是所谓的人类的真的 top 0.001%、0.01%、0.1%、1% 里面全部平权 。他们只有真正获得权利 ， 这个事情才会被改变 ，其他所有的一切通过 education 是达不到任何目标的 。

**Host** [1:38:18]
你觉得在过去十年有好一点点吗 ？ 还是没有 ？

**盛颖** [1:38:23]
肯定有好一点点吧 。 对 ， 我觉得是社会是在向前 ，但是这个它你如果拆分到不同的方面的话 ，有些地方可能也在也有 ，也不是都在变好 。

对 ， 它那个价值观是一个很波动的状态 ，但你整个来说的话 ， 我觉得是在变好 。

**Host** [1:38:38]
好的 ， 我觉得我们 cover 了大部分的东西 ， 你让我再看一看有没有什么问题 。 你觉得有什么问题我们漏掉的吗 ？

**盛颖** [1:38:45]
我没有想过有什么问题要问 。 对 ，但是我倒是结尾的时候 ， 我倒是可以有一件事情想说 。 昨天你们过来 ， 然后你给我看那个 doc 的第一眼 ， 我其实当时挺打动的 。

### 世间的美好

**盛颖** [1:38:54]
就是那个 doc 里面已经有很多对我的描述 ， 就感觉你们已经对我 ， 我不知道这是 AI 生成的还是人做的 ， 就是很 。

**Host** [1:39:00]
没有 ， 我们看了很多 。

**盛颖** [1:39:01]
是人做的 。 挺详尽的 ， 就是我觉得很多投我的投资人都没有这么样的去看过我的经历 。在我跟他们聊天中， 我发现他们不了解我的经历 ，他们不了解发生过什么 ，他们可能在别的侧面去打听了 ，但是这份 doc 还是我当时印象很深刻 。

我觉得包括融资的这段经历给我的一些成长 ， 就是很多职业本身我们觉得会做的事情 ，其实它不是自然发生的 。

然后也许我原来觉得一个做采访的人 ，他就应该对被采访者先有一个深度的 study，但事实上很多的采访者他们并不一定真的会做这件事情 。

然后也许我们觉得投资人他应该对方的做个很深度的调查 ，但实际上大多数投资人都没有去做深度的调查 。

也许我们觉得一个 PhD 应该好好做研究 ， 大多数 PhD 未必真的好好在做研究 。 有很多事情它在定义里面该发生的其实不会发生 。

我后来发现一个人他只要能把你职业里面该做的事情做完 ，其实就已经非常稀有了 。 我觉得我昨天看那个 doc 的时候 ， 我不喜欢采访 ， 本来我们也差点就要推掉了 ，但是但是我昨天看那个 doc 的时候 ，其实我觉得我愿意好好做一下采访 ，因为我觉得你们做了这个劳动 。

我是 respect， 我就是想说一句 respect。

**Host** [1:40:10]
谢谢 ， 谢谢 ， 我也很 respect 你 。

**盛颖** [1:40:14]
然后我觉得就是很多就刚刚聊到的 ， 比方说我的 PhD 其实前面有很多波折 ， 融资时候也有很多波折 ， 我们这个开源项目做起来也有很多波折 ，但我现在真的要我说结局怎么样的话 ，其实这三段波折 ， 或者说过往包括童年期很多波折 ，他们的波折之后的那个终点都非常的好 。

我的 PhD 第一年这个 rotate 找导师不是很顺利 ，但是最后我找到那个导师 ，他是一个教科书般完美的导师 。

我们这个开源项目一开始也有各种各样的被打击 ，但走到今天 ， 我们有了一个就是这么好的团队 ， 我们团队大家都这么的这么的有能量 ， 这么的有热情 ，而且这么团结 。

我们融资我前面也经历了很多各种各样的事情 ，但我觉得最后我们容纳下来这些投资人也是教科书般完美的投资人。

**Host** [1:41:09]
是 。

**盛颖** [1:41:10]
我在当时刚出来融资之前 ， 对这种一无所知 ， 所以我想去学点东西 ， 我就去看了看了一些书 ， 然后理解了一下融资的书 ， 怎么去融资的书 ， 类似吧 ， 可能 founder 跟投资人之间的相关的一些书 。

**Host** [1:41:23]
Fundraising 101。

**盛颖** [1:41:25]
差不多 。 然后我想理解这是什么东西 。 我那个时候我很多名词都不知道的 ， 我不知道什么叫 term sheet。

就是我是在一个这样的状态下出来融资的 ， 我也不知道什么叫做估值 ， 什么叫做 sigma， 我都可能就没有概念 ， 很多基本概念我都不知道 ， 都不理解 。

然后 p shark 是什么 ， 我 p shark 这个词我都没有听说过 ， 什么叫 p shark 是什么 ， 要写多少页 ， 每页写什么 ， 对吧 ？

对 ，是完全没有概念 ， 就是没有概念到 p shark 这个词我都没有听说过 。Term sheet 是什么东西 ，有个人跟我说你们有没有拿 term sheet， 我说啥是 term sheet。

我是在一个这样的状态里面的 。 所以我就去尝试去学这个东西 ，但是我从书本里面看到的 ， 书本里写的都是美好 。

书本里面告诉我的那个投资人和 founder 之间的关系是一个终身友谊的关系 ， 是一个你们并肩作战的关系 。

那虽然我早有准备 ， 童话总是美好的 ， 虽然我早有准备 ，但那个现实不是这样的 。 现实总是复杂很多 。

但是我最后真的跟我们 pair 的投资人， 这些 partners，他们又回到了我当初在 textbook 里面看到的那个所谓的投资人跟 founder 之间关系 。

书本也没有骗我们 ， 包括我以前 PhD 之前很多人跟我描述过的 PhD 导师跟学生之间的关系 ， 可能也是过于美好的 ，但是我最后拿到了 。

就是那些美好的描述 ，他们都没有骗我们 。 世界上存在那么纯粹那么好的导师 ， 存在那么好的投资人， 存在那么好的采访者 ，但是绝大多数人他们没有坚持到把那个跌宕起伏的过程走完 ， 没有坚持到相信那个好的东西是其实是存在的 ， 只是说你要筛选 ， 只是说你要有耐心等着它最后显露出来 。

你要有这个耐心 ， 让那些其实不是理想状态的沙粒自己脱落掉 。 然后很多人可能在中间就开始怀疑了 ， 然后放弃了 。

对 ， 怀疑了放弃了 ， 或者是他不再相信了 。 就借这个机会 ， 我其实想说就是那些好的东西都存在 ， 所有好的东西都不是都不是编出来的 ，但是你要非常相信它 。

你要相信到你身边没有这样的人， 你还相信它 。 然后有一天那个跟你一样相信的人 ，他有一天会跟你相遇 。

坚持 。

**Host** [1:43:36]
这一段特别好 ， 刚刚我都有点想流泪 ， 你知道吗 ？ 这一段太好了 。

**盛颖** [1:43:42]
最后两个问题啊 ， 就是你是一个逻辑如此缜密之人 ，但是就像你说的 ， 这个世界上很多东西是乱的 ， 或者是它逻辑上是不成立的 ， 就很多 random 的地方 ， 就世界是个草台班子 。

就是这件事情你能自洽吗 ？ 还是说你其实是会 suffer 的 ？ 就我在我的逻辑里是自洽的 ， 我的逻辑不受不受我看到的事情的干扰 。suffer 也有啊 ， 就是会 suffer。

就我我其实很 emotional， 我是非常 emotional 的人 ，其实 。 就是很多很微小的事情会对我造成非常大的情绪影响 ，但是我能够把那个情绪影响跟我的价值观构建分离开 。

比方说我看到了很多事情 ，他们我不想看到 ， 我不希望它发生 ，但它们都发生了 ， 然后我觉得很不高兴 。

但是我看完它们之后， 不会导致我觉得那个是正常的 。 我仍然会坚信那个我没看见 ，但我相信的东西是对的 。

我仍然会坚信 ， 就像我刚刚说的 ， 我仍然会坚信有一个我想看见的世界 ，但是我现在没看见 ， 它只是我还没看见它而已 。

就这个事情 ， 我可能会相信它几年、 十年的时间 ， 我还相信它在那里 。 这个东西很难被改变 ，但是我过往的经历告诉我 ， 它们其实都存在 ， 最后我都遇到了它们 。

所以所以我有很多正反馈 ，但我觉得有很多人是没有看到正反馈的 ， 所以你也不能说就是要求所有人都坚持 。

但是我觉得我是幸运的 ，因为我全都看到正反馈 ， 就是我的正反馈循环让我可以在后面的遇到这种类似情况的时候 ， 坚持的越来越久 。

可能我第一次的时候我等了几个月 ， 然后它被验证了 。 下一次我等了几年， 它被验证了 。 再下次我等了十年， 它又被验证了 ，但我就知道了它总是那边验证 ， 下次我可以等 20 年， 再下次我可以等 ， 就没有人生可能等完了 。

但是我想就是至少我等到了 ， 我觉得别人也能等到 。

**Host** [1:45:21]
你有没有想过 ，因为你是对的人， 你是正确的去做这件事情的人， 所以你等到了 。 比如说有些人他可能对自己的认知有误 ，他可能不是最正确的那个人 ，他可能不是有天分的那个人， 可能他等下去就是等不到的 。

**盛颖** [1:45:37]
就是需要找到这个自洽吧 。 就是那比方说我说我等了十年之后等到了 ，但是我其实自己的自己的心里的一些认知跟世界一直是不吻合的 。

这十年里我一直都是很割裂的存在 ， 我觉得也 OK， 我也可以一直就很割裂的存在 。 就就算我整个人生都很割裂 ， 我也不想妥协 。

就是你能不能找到那个 boundary 是重要的 。 就其实这件事情 OK， 就是我想说有这个割裂其实是完全 OK 的 ， 它不会真的很痛苦 ， 人们只是害怕而已 。

但如果说要有个人告诉你说就这样 ， 就这么回事 ， 没关系 ，其实就真的没关系 。 但是首先这世界上也没有绝对的正确 ， 我也不能说我是正确的人， 大家都是正确的人 ，但我只说每个人都有自己的想法 ， 然后你所谓的正确在别人的眼中不正确 ，也 it's OK，也是完全 OK， 没有任何问题 。

但是它的唯一重点就是你是不是按照你自己的想法去认知和和行动 ， 还是你其实是被别人牵着走的 ， 或者你觉得自己在妥协 。

你只要不觉得自己在妥协都没关系 ， 哪怕你真的错了就错了吧 ， 就也没关系 。 但是我非常不喜欢的是 ， 就是大家都变成了不能执行自己意志 ， 这样是不好的 。

就如果所有人都执行自己的意志 ， 哪怕你不和谐 ， 那也是自然存在 ，其实本来就合理 。

**Host** [1:46:47]
好的好的 ， 那以上就是我们所有的问题了 。

**盛颖** [1:46:49]
非常感谢 。

**Host** [1:46:50]
非常感谢盛颖 。 好 ， 那么以上呢就是我和盛颖的视频播客栏目了 。 这一期节目呢我们录制于 6 月初 ， 当时 RadixArk 刚宣布融资 ，不到两个月的时间 ，AI 市场经历了开源模型爆发 ，而 SGLang 等推理引擎作为 AI Infra 的重要技术框架 ， 正在成为 AI 时代新的核心技术层 ， 连接英伟达 MB 还有谷歌 TPU 等芯片与各大模型和应用 。

而我们呢也很期待盛颖口中保密的 、 目前还不存在的下一代 AI 是如何的形态 。 那好 ，以上就是这期视频的全部内容了 。

你们的点赞 、 评论还有转发是支持我们硅谷 101 做好深度科技和商业内容的最佳动力 。 我是陈茜 ， 那我们就下期视频再见啦 ， 拜

。

---

本节目库由 PodHood（https://podhood.com）提供支持——播客网站平台。
