00 · WHAT CHANGED一页看完:这两场定了什么
9 月 5 日晚两场连续讨论,哈密考察回程当晚的复盘。本纪要基于两场录音的完整逐字稿重做(共 148KB、3,400 余段),并用第二套语音识别对音频做了交叉核对——因为第三方自动摘要在三处出现了实质性错误(见附录 A)。
此前对外表述的主线是「推理优化」。这两场把它扩展成了完整的三段:
训练才是这个事情项目本身的核心能力……训练本质上是一个项目一个项目去锚定一些推理的特色 token。
这个项目如果说谈好了训练推理的独家分销,那我们的赋能工厂本质上就产生了粘性……这个粘性不来源于我推理的 infer,来源于我代理的这个模型。
读法:推理用来进门和验证能力(见效快、可测量、客户听得懂);训练用来拿项目、把客户锁住(周期长、切换成本高);独家模型分销才是长期粘性的来源。此前材料的主张停在第一段,后两段是这次补上的——尤其「独家分销」这一层此前完全没有出现过。
四条被明确定下来的
如果是单纯的租赁方,他其实没有这个资格……那其实反而是 IDC 的运营方和建设方。
技术侧接:「持有者」;战略侧收口:「对,卡的持有者」。这句把客户池切得比之前任何一版都干净。
你英伟达的卡,怎么着都能跑起来。你再傻都跑起来了。
痛点定义随后由分析方补全:「其实就是建好了,它那个利用率上不去了」(01:03:24)。
现阶段电价不是最重要的,现阶段是缺卡……缺卡就缺指标。
对照:上海/临港约七毛、新疆约三毛,但「一般买家新上海这边都 40 万一月,这样你说跟水电费算啥?那更不算」(00:32:45)。
不能说它 1000P 我们 500P……就是它 1000P 我们也 1000P,然后我们能到比如说 800P 的实际算力。
这是比「提升利用率百分之几」好用得多的对客表述:同样标称,把有效算力做到八成。
三条被翻掉的既有判断
| 此前材料里的说法 | 逐字稿的实际内容 |
|---|---|
| 「多模态视频生成日流水可达 50 万」 | 张冠李戴。00:29:04 说的是「多模态视频生成这边有可能来钱是最快的」;「每天卖 50 万」是下一句、另一个人在讲服装生意(00:29:10),两句之间没有逻辑连接。第三方摘要把它们拼在了一起 |
| 「举例部署 ChipDiffusion 等视频生成模型」 | 方向反了。该词实为 Seedance 2.0,而它在会上是被否掉的对象:「因为 Seedance 它是闭源,没法开源部署」(00:26:01)。真正能部署的是 MiniMax 一类开源模型 |
| 下一代芯片性能等技术判断归入「第二场为主」 | 来源标注错了。第二场逐字稿里没有这些内容,它们全部出自第一场 |
⚠️ 阅读前必读:第一场的说话人分离在三个时段崩塌(00:20–00:50、01:10–01:30、01:40–01:49),而「三层商业模式」与「代次性能判断」两段最重要的内容恰好落在崩塌区。本纪要对这些段落只标角色不标具体人,原因见附录 B。另:全场出现六个说话人标签,并有一句「一共就六个人」,在场人数多于四人且含外部人。
01 · THE LINE业务主线:推理进门,训练锚定,分销留客
第 00 章给了结论,这一章给推演过程。这是两场会议里唯一一段被完整讲完、没有被打断的战略陈述(01:30:33–01:34:04)。
1.1 为什么单靠一项技术不够
会上的判断很直接:推理侧的工程能力是当下的时间窗红利,但不是终局壁垒——因为随着国产卡自身成熟、同行涌入,单点技术优势会被摊平。两句对照着看最清楚:
那个时候〔再过两年〕,国产卡才是真正的有竞争力。对现在的话,就是得靠软件去优化。
你等到再过两年有 10 家 20 家来抢,东西就不够了。
合起来的含义:软件优化的窗口就是这两年,窗口关闭之前必须把资源位与客户关系占下来。会上给的三个判据是:①谁在投入 ②能不能控制算力 ③能不能拿下大客户(01:33:30)。
1.2 三段链条
| 推理(进门) | 见效快、可测量、客户听得懂,用来验证能力并建立信任 |
|---|---|
| 训练(锚定) | 「训练才是这个事情项目本身的核心能力」(01:32:02);「一个项目一个项目去锚定一些推理的特色 token」(01:34:04)。周期长、切换成本高,做进去就很难被替换 |
| 独家分销(留客) | 「谈好了训练推理的独家分销,那我们的赋能工厂本质上就产生了粘性……粘性不来源于我推理的 infer,来源于我代理的这个模型」(01:31:35) |
1.3 终局:控算力才有定价权
这个生意到后面本质上是一个控算力的。对,你控了全国 60% 的算力。
这条与「巨头补贴会不会把小玩家挤死」的讨论直接相连。当时的担忧是巨头「免费就卷死你为止,他一死之后慢慢收费」;而反驳的理由是算力不在巨头手里——
他没法去统一市场……因为最底层生产 token 的卡又不在他手里,然后定价权也不在他手里。
同样的逻辑解释了为什么会上判断「批发机构没有护城河」:「但是他卡不在手上」→「所以它没有话语权」(第二场 00:27:46–50)。结论一致:定价权归持卡与控算力的一方,不归渠道方或聚合方。
1.4 一处尚未定调的分歧
关于用闲置产能低价换取算力控制权,商务侧与战略侧口径不同。商务侧主张「我用的闲置产能都不收钱……我不是冲着电费去的」(01:29:46);战略侧当场划了边界:「如果我们这个免费的低价的部分量太大了,不要」(01:30:08)。边界画了,但没有给量化阈值——这是需要先定的事项之一,完整清单见第 07 章。
02 · PRICING三层客群 × 三种收费
出自 01:10:16–01:12:30 的连续陈述。这段在 ASR 崩塌区内,只能确定是我方核心成员所述,无法确定具体是谁。但内容是整场最完整的商业设计。
就是也是分几层,有卡、没卡、想建卡三种。
2.1 第一层:有卡的(按卡定价)
比如说他要满足他的客户需求……我们要从我们客户的消费里面拨多少卡给你?然后结合我们的这个优化权益,直接把那个部分给你。
会上讨论的核心是:客户真正买的是算力产出,而不是卡的数量——因此计价应当挂在产出与服务水平上,由我方承担用更少资源交付同等产出的工程责任。这样客户的成本可预期、我方的优化收益也有归属,双方都能把账算清楚。
配套要求:合同标的写清楚是「产出/SLA」而非「卡数」,并约定客户可自行验证的测量口径。
2.2 第二层:没卡但想用(按人头年费)
他比如说 500 个人,那我们就说一个人一年,我说你 1 万块钱,或者说你 5 万块钱……这叫谈租赁款,因为他要的模型,要升模型升级,这些都是不太一样的。
我这个集群去做了 1000 张卡,那我每年收你 1500 万,然后我可以去做这个,去确定上面去布模型升级什么的。
两个口径并列可反推:1,000 卡/年 1,500 万 ≈ 每卡每年 1.5 万元;按人头则是 500 人 × 1–5 万 = 500–2,500 万/年。后者的单价区间跨了五倍,说明还没定价,是谈判区间而非报价表。
2.3 第三层:没卡想建(共建 + 每卡打点)
第三种就是说他没卡,但是他想建……那就拉一个相应的建设的〔方〕一起,给他建好之后,在每张卡上打点。
2.4 训练单独按项目,且一开始不接小单
训练这边得按项目来……训练难度比较低的那个作业便宜,或者很小的那种作业,但是我们应该一开始的时候不会去做那些。
2.5 Token 工厂那条线:价差公式与前提
因为有你们的加持,每百万〔token〕的成本降 30%,对?因为我再减 20% 的价格。
但同一段也说清了这条线的风险:
现在很多 token 工厂最大的问题就是它没有办法控制它生产 token 的成本、卖 token 的价格,是不是就因为上面集采压价格了……那价格是亏钱的。
配套的两个运营要点:①打满负载——「你性能优化好了之后,你剩下的其实就是说你要想办法把它给打满……你 24 小时都没有停」(01:28:38);②时区错峰——「你到等晚上九点,美国人醒来?就他实际上是在挤压那个各个集群的峰谷」「其实就跟电一样」(01:29:15/01:29:12)。
代理分销的想法也在这一段:「其实是也没有规定非要自己去找施工,相当于我们自己都有总包帮着找代理商。再来一层,那也是可以的。找代理商就类似于字节的那个信息流广告」(01:28:20)。
03 · QUALIFY客户筛选:痛的定义、开场三问、尽调必问项
3.1 痛的定义:不是 ROI,是考核
首先前提假设是他很痛,那他很痛,他的有可能都不在乎赚不赚钱。
比如说他点灯率高不高?不高会不会被领导干?……或者是先帮他把考核指标顶上去。
他们有这个诉求,其实说白了,这件生意本质上是他们意识到他们用不好,然后他们要来找我们。
3.2 开场三问(可直接用)
我感觉第一步就是先去找哪些厂,哪些算力中心里面有国产卡……然后他们用不用得起来?他们痛不痛?他们想不想用起来?我觉得先搞这个。然后这个找到了之后……他们如果很痛,那他们就可以聊了。
与第一场的口径对齐:「像他们这种现在已经有的这种智算中心,你在运营的这个,会不会有客户?已经运营了有可能直接就是客户……就是去看一下那些国产卡占比比较多的地方」(01:25:00)。
3.3 ⭐ 尽调必问到型号——这条能省掉大量无效销售
你比如说他说我这边全部都是 GPU,是啥卡?然后你跟我说它是国产第一代卡,那生意就难做了。
主要因为是第一代卡,那一代卡真他妈难做。这你根本就优化不起来……为什么不想做的原因也太简单了,就是得我们的高级别专家上了。第二点……优化完之后,咱们这个也比不上现在的当代卡。
国产第一代卡的存量集群不接:优化难度高(要出动最高级别专家)、天花板低(优化完还比不上当代卡未优化的水平),投入产出不成立。尽调话术:「你们这批卡是哪一代、什么时候到货的?」——问到代次就能当场判断做不做,不必等做完 POC。
3.4 规模阈值
| 上 GW 级 | 「但凡上 GW 那种,那种肯定是要干训练了」(01:47:55);「这类项目芯片方会自己做……我建议上 GW 可以自己做」(01:48:07)——不作为目标 |
|---|---|
| 小型中心 | 「你就弄个小智算中心……到处都是」;「要 500〔MW〕你搞个 100 张卡,没必要搞这一块」(00:33:26)——太小也不做 |
| 结论 | 目标落在中间层:有国产卡、非第一代、规模够但没到 GW 级、且运营方就是持卡方 |
04 · NOT CUSTOMERS谁不是客户(四类排除)
这一章比客户名单更省时间。四类都有原话依据,且都是会上主动排除的,不是我事后推断。
4.1 英伟达卡为主、靠固定租金的房东
利通感觉没有,他根本就不愁,他没有什么痛点……但是它里面都是 GPU,它不痛,它转租就行了……他有了 B300,他啥都不用干,租给自己的就行了。
他不需要优化,对他来说,反正客户给他是固定租金。
同类可直接排除:润泽(交付即快速上架)、并行科技(自有 GPU 利用率 85–90%)、皖疆中科类脑(使用率 90%+)。高使用率主体是学习对象,不是销售对象。
4.2 大模型公司(不让第三方碰训练)
像这种大模型公司,训练优化这种事情,他们不想让第三方插手……他们绝对不想让第三方知道。
越强的模型公司,他就算在国产芯片上面,他也不想让你知道他怎么设计……我做的是一个通用的软件,我给他,然后他回过来让我们改的东西都是很小的点,就我们不知道他在干什么……我就拆到足够细,让我们不知道他在干。
值得注意:这段说的是客户主动把需求拆碎来防泄密。含义是——即使做成了大模型公司的单,我们也拿不到全局信息、无法沉淀方法论,单子的战略价值远低于收入面值。
4.3 芯片原厂重点投入的客户驻守的客户
我们绝对不干这些东西……就是你像这种芯片原厂重点投入的客户,就一定不要碰,碰到也浪费时间……所以还是二梯队跑步为主。
原因是原厂自己会做:「它的优化会由芯片方自己做……就是芯片方只做少数客户和自家业务」(01:37:07);以及人数上打不过:「对方投入的人太多了,整不过了」「就是靠人数」(01:38:00)。
4.4 超大厂与终端应用公司
特别大的感觉没必要,就是有可能等以后,比如说他投我们,那有可能可以来着。这问题可能放着。
那总结其实你们出来之后主要的合作对象还是 IDC……对对对,反而不是那些终端的大厂。
两个具体例子:某视频生成公司「从 20 多个发展到 37 个,但他们不用国产,他们没这种需求」(01:47:08);某智能投研平台「他下面那个大模型应该是直接买、就接入……走那个 API 去买……他只是消费 token,他应该不会说我要去自己优化算力」(01:47:22)。
问四个问题就能判断要不要投入:①卡是不是自己的(不是→渠道)②是不是英伟达卡为主且满租(是→不痛)③是不是大模型公司或芯片原厂重点投入的客户(是→不碰)④是不是只消费 token 不持卡(是→不是客户)。四问全过,再问代次(第 03 章 3.3)。
05 · SILICON技术实况:代次、性能、迁移与 MFU 口径
两场合并。数字多为口述经验值,标注后使用;涉及未公开型号规划的部分只在内部版保留。
5.1 代次与性能(第一场 00:44–00:51)
| 当代卡供应 | 「今年当代卡这一代全部都卖完了」(00:46:16) |
|---|---|
| 下一代性能 | 「跟 B200 差不多」「0.5 到 0.8 之间」,但「比 B300 差很多」(00:47:45–00:48:11)⚠️ 口述 |
| 下一代工艺 | 下一代是第一代不依赖美系工艺的版本,当代与其改款都不上⚠️ 原文不清,判断待核 |
| 我方价值主张 | 「就是它 1000P 我们也 1000P,然后我们能到比如说 800P 的实际算力」(00:48:31–41)——同标称做到八成有效算力 |
| 单机经济性 | 「拿 B300 做那个去卖的话,大概一个月能赚 60 万……单机纯赚 60 万」(00:49:04–24);人民币口径 50 万(00:49:36) |
| 整机价差 | 原厂价约 40 余万/台;国内 200 余万;「你一台从美国抛过来就能赚 1000 万」(00:50:33–50)⚠️ 数字跨度大,不引用 |
| 同算力成本比 | 「净差 3、4 倍」「至少是四倍」(00:51:12–15);第二场口径:「他生产 token 的成本可能还是比 B300 的三倍」(第二场 00:25:14) |
5.2 迁移瓶颈:精度对齐(第二场最有说服力的一段)
你看 Kimi,他们都在英伟达上面做训练。但是他们比如说从 H200 换到了 B300 去做训练,他们也得对齐……也会存在,也要对精度。
你训练是分很多步骤的……你第一步对齐了,然后你有可能你的曲线是这样子的,慢慢后面岔开了……有可能我差个千分之一;你训到 1 万步,我差能差百分之一。那这个时候我的模型就是比原来的差了一点,那你说谁的问题啊?
机理层面:「1+0.001 和 0.001+1 不等」(浮点加法不满足结合律,00:11:40);「我觉得你实现比特级一致应该实现不了,因为你跟我不一样」(00:11:56);「就是那个也是类似黑盒子」(00:12:02)。提出「一周就能迁移完」的乐观估计者最后自己认输:「就这个问题是无法解决,无法解决」(00:12:05)。
5.3 为什么没人愿意当第一个(根因不是算力,是信任)
大家没有人在国产上面训出来过好模型,然后你要知道训一次模型很贵,所以没有人愿意花这个钱去帮芯片方试错……因为这些人都是拿钱投票的,他们吃的都是资本市场,所以他们要求稳。
现在的大模型训练,三个月一个周期,你的数据集只会被看一遍。〔而人脸识别时代〕两天就训完了,我可以反复地去调那些超参数……所以说,你说 AGI 的上限还多不多?肯定多!
迁移时间窗:「中型厂商肯定是在观望头部厂」「头部上了,我跟你讲,就明年基本上就会有头部的会上了」「他没得选,明年就会上」(第二场 00:05:51–00:06:05)。若成立,2027 是迁移需求爆发年,今年到明年上半年是攒案例的窗口。
5.4 ⚠️ MFU 口径内部不一致——对外前必须统一
| 技术侧:拒绝单卡口径 | 商务侧:给了具体数 |
|---|---|
| 「也针对英伟达卡的 MFU,这个你要看跟谁比」(第二场 00:03:13)→「开始失去意义」(00:03:18);后来把话题移到「看你在一定的时间内能优化到多少」(00:06:51) | 「9%」「能提个 10% 就不错,10% 对,这个有用」(第二场 00:03:32–45) |
另有一条限定值得记住:「你两个集群的总算力峰值,峰值那 MFU 应该能打平」,但紧接着——「但是你基本上不可能做到绝对一致,这没有人会等你做」(第二场 00:06:42)。对客表述建议统一到 §5.1 那句「同标称做到八成有效算力」,它是结果口径,不需要解释 MFU 定义,也避免了两个人给不同数字的风险。
5.5 两个工程事故:最有说服力的销售素材
之前某次国产卡集群交付中,液冷出问题,把数据中心给烧了……液冷水流出来掉到那个电上……氢和氧一碰那个火花就着了。
我们之前做推理性能攻关的时候,到最后你知道这卡在哪儿了么?它的网卡只有七个,我们一直认为是八个……然后我们去问硬件,为什么?〔这事〕我们那个事儿干了两周。
这两条比任何 PPT 都有力:它们证明「国产卡为什么用不好」不是算力问题,而是文档、工程与踩坑经验的问题——而这正是买不到、只能靠人带来的东西。配套的可靠性话术:「一张卡挂了,会导致整个集群挂」(第二场 00:16:50)、「你训练挂了,那你重启一下,多少钱?」(第二场 00:14:30)、以及连说四遍的「稳定,稳定,稳定,稳定」(第二场 00:14:16)。
5.6 存储 · 算力 · 互联:三角与当下瓶颈
三要素并列(第二场 00:17:38),两条互斥关系:「存储搞的足够大,你就不需要互联;你的通信足够快,我就不需要互联」(00:18:13)。上限判断:「上限最高的肯定是存储……极端假设就是我所有的算力插在一块大的 HBM 上,几百 T 几百万 T,我的数据集都塞进去了」「那我就不需要通信了」(00:18:33–48)。反方当场保留意见:「而且现在通信应该是卡着的,我认为」(00:18:55),最后收敛为「两边都在同时涨」(00:18:24)。引外部观点:「我听达晨的那个老大说,AI 终极就是存储」(00:20:03)。
量子计算:提出方认为可能颠覆、某标的已能做微调(00:20:37–55);技术侧两次否「我觉得还早呢」(00:21:25/00:22:02);未收敛。投资视角另有一条:「那我等有影响的就来不及了」(00:21:04)。
06 · ENDGAME终局与供需:三分天下,通信一条路
6.1 供需错配是结构性的
你建成的算力的这个增速,它一定是一个线性的,它不会变成很夸张的指数级……你的需求一定是指数级的……肯定不够用。只要你相信 AI 能给人类带来大变化,这个事情是必然的。
五年判断:提问方问「短期五年是不是算力不够用?」→ 技术侧答「肯定不够用」(第二场 00:02:42–44)。烧 token 的来源:下一代模型「你知道他给你完成一个任务要多烧多少 token?」、长程 Agent 轨迹(00:02:50–00:03:02)。
6.2 芯片格局:三分天下
未来大厂芯片的格局,一定是英伟达、自研芯片、国产芯片,三分天下。
中国……围绕的就不是制程这个点去搞,围绕的是通信去搞……我们在制程上面是干不过的,这个是定局了。CPU 最强的是美国,光刻最强的、存储最强的是韩国,制程最强的在美国产业链……那中国只剩通信了?OK,往死干通信。
这段是全场最完整的产业判断,且给了我方一个现成的对外解释框架:国产路线不是「追赶算力」,是「换赛道到通信」——而通信密集架构恰恰最需要软件与调度层的功夫,这正是我们的位置。
6.3 最好的一句对外话术
我说不能比的原因是因为技术点、技能树已经分叉了。就是你是战士,我是法师了……你说 PK 谁厉害,不知道。
用途:当客户或投资人问「国产卡到底比英伟达差多少倍」时,这句话把问题从「差几倍」重构成「不可直接比」,而且不需要贬低任何一方。比任何倍数口径都安全。
6.4 一个已成形但没人回答的产品构想:infra 智能体
我们会专门去做一个 infra 的基模,就是也不叫基模,infra 的智能体。要不要做基模?……里面的这些东西其实本质上都是专家踩过的坑,那你专家踩过的坑其实本质上都是可以沉淀出来的。你历史上踩过的所有的坑。
提问方当场印证:「现在的这些大模型,这些专家踩的坑它不在网络里边儿,在他脑子里」。技术侧补一句边界:「这种行业的很私域的东西,它一定是不能被公开模型学到的」(00:59:26)。
它是唯一一个「把人的经验变成可复制资产」的构想,而且直接回应了第 01 章的核心焦虑——如果推理优化技术两年就被追平,那沉淀下来的坑库和它训出来的 infra 智能体,才是不会被追平的东西。会上「要不要做基模」这个问句没有人回答,建议补上。
6.5 生态渠道:能力型伙伴路径(讲到一半录音结束)
其实还有一个招……就是让我老板跟总裁去谈,让这个项目变成〔原厂生态的〕能力型伙伴,然后这样子的话,〔生态资源〕进来我们就行。
切入角度是高校生态:「我们去高校跟学生很走心态。那总裁听了多开心……本来就是刚被表扬说高校生态不行」(01:48:44)。但同段也说了节奏判断:「这个事情能等到后面」——即当下不推。
07 · OPEN未决事项与内部分歧
两场会议共十一处分歧或未答问题。这一章是本纪要最该被行动的部分:它们不是信息缺口,是需要老板拍板的决策点。
7.1 需要先定调的四件事
| # | 决策点 | 分歧现状 |
|---|---|---|
| 1 | 模式轻重:只收服务费 / 帮找销路+结算 / 自营产能 | 三种并存未拍定。商务侧坚持轻(「我们就直接抽里面的这个优化的钱就完」第二场 00:26:31);技术侧起了重的念头但被打断没说完(「或者说,咱们自己搞,但是……」第二场 00:26:49);另一方一路推中介与结算(第二场 00:26:42、00:27:16) |
| 2 | 「100 卡定价 10 卡交付」要不要做、怎么写合同 | 只说了一遍,无人追问定价上限与信息对称问题(01:10:57)。建议重构为按产出/SLA 计价,见 §2.1 |
| 3 | MFU 对外口径 | 同一场会里技术侧拒答、商务侧给 9–10%(第二场 00:03:13 vs 00:03:32)。建议统一到「同标称做到八成有效算力」 |
| 4 | 免费/低价放量的边界 | 商务侧要用闲置产能免费换控制权(01:29:46),战略侧当场划红线:「如果我们这个免费的低价的部分量太大了,不要」(01:30:08)。红线画了但没给量化阈值 |
7.2 技术路线上唯一一次当面顶回去
有可能在干了六个月到 12 个月中间,我们会逐渐去把〔其他国产厂商〕这种市面上有市占率的加进来……因为我不可能就抱着一家的。
我们、我这方面也是我们的。
战略侧回「所以说,大盘不一定」→ 技术侧「行了。」→ 话题终止。这是全场唯一一次技术负责人对战略表述当面保留意见,且未解决。多芯片路线要不要走、什么时候走,是第五个待定事项。
7.3 提出后被搁置或没人回答的
| 要不要做基模 | 「要不要做基模?」(00:58:11)——问句无人回答,见 §6.4 |
|---|---|
| 高密互联架构会否被解构 | 同一分钟内前后矛盾:「我们认为,高密互联架构并不会被解构」(00:53:40)→「就是高密互联架构一定会被后来者解构,要用其他的方式解构」(00:53:45),无人追问 |
| 迁移时间与效率 | 被两次点为核心障碍(00:51:46、01:02:02),两次都没被回答 |
| 三大运营商怎么进 | 「运营商现在转型特别想干这方面」(01:22:53)→「这还是等于老板出了才能推」(01:23:12),没有下一步 |
| 端侧客户要不要碰 | 某智驾客户「这个就很矛盾……他不可能去做这种推理服务。也可能,也可能不对」(01:34:15),话题被打断 |
| 结算中心 | 两次被提起(第二场 00:27:16、00:27:53),两次都没说完 |
| 生态能力型伙伴 | 方案有价值但「这个事情能等到后面」(01:48:17);会议在 01:49:09 中断,该方案讲到一半 |
7.4 两条判断分歧(记录,不必强行统一)
存储 vs 通信谁是当下瓶颈:收敛为「两边同时涨」(第二场 00:18:24),但技术侧保留「通信卡着」的意见。
AI 是否加速基础科学:商务侧认为「他这个东西本来对基础科学研究是有害的」(第二场 00:22:28),他人引陶哲轩「没有科学家去试错了,有些时候需要人的灵感」;折中意见「早晚会加速吧」。与业务无关,但反映团队认知底色,保留。
08 · SCRIPTS话术库:可直接用的原话
全部出自两场逐字稿,带时间戳可回溯。这些是团队自己在放松状态下说出来的话,比任何精心写的 PPT 文案都准。
8.1 为什么现在就要买(时机)
那个时候〔再过两年〕,国产卡才是真正的有竞争力。对现在的话,就是得靠软件去优化。
配套:「你等到再过两年有 10 家 20 家来抢,东西就不够了」(01:33:52)——对投资人讲窗口;对客户讲则用上面那句。
8.2 开场三问(筛客户)
他们用不用得起来?他们痛不痛?他们想不想用起来?
8.3 对国资机房方(不讲 ROI,讲考核)
他点灯率高不高?不高会不会被领导干?……先帮他把考核指标顶上去。
⚠️ 对外表述时把「考核指标」换成「考核指标 / 上级通报口径」,内涵不变,措辞可用。
8.4 讲清我们的价值(结果口径,不解释 MFU)
不能说它 1000P 我们 500P……就是它 1000P 我们也 1000P,然后我们能到比如说 800P 的实际算力。
8.5 建立专业信任(用事故,不用参数)
我们之前做推理性能攻关的时候,到最后你知道这卡在哪儿了么?它的网卡只有七个,我们一直认为是八个……〔这事〕我们干了两周。
你训练挂了,那就完了!你训练挂了,那你重启一下,多少钱?……一张卡挂了,会导致整个集群挂。
8.6 解释为什么国产卡跑不起来(根因不是算力)
大家没有人在国产上面训出来过好模型……没有人愿意花这个钱去帮芯片方试错。因为这些人都是拿钱投票的,他们吃的都是资本市场,所以他们要求稳。
8.7 回答「国产卡差几倍」这个必问题
我说不能比的原因是因为技术点、技能树已经分叉了。就是你是战士,我是法师了……你说 PK 谁厉害,不知道。
8.8 需求侧最有说服力的一段(对投资人)
现在的大模型训练,三个月一个周期,你的数据集只会被看一遍……所以说,你说 AGI 的上限还多不多?肯定多!
配套供给侧:「建成算力的增速一定是线性的……你的需求一定是指数级的……肯定不够用」(第二场 00:02:30–44)。
8.9 劝客户把闲置卡并进集群
你有 1 万卡,你就该用 1 万卡,这样子你快。
8.10 对投资人讲终局
这个生意到后面本质上是一个控算力的……你控了全国 60% 的算力。
未来大厂芯片的格局,一定是英伟达、自研芯片、国产芯片,三分天下。
APPENDIX附录:方法、说话人、勘误与待核
A · 本纪要怎么做出来的(以及为什么值得重做一遍)
| 原始材料 | 两场录音的完整逐字稿(113KB + 34.5KB,共约 3,400 段)+ 两个 mp3(52MB + 14MB),均在 会议纪要/9月5日奶昔小白褚康/ |
|---|---|
| 交叉核对 | 用第二套 ASR(达摩院 Paraformer + 说话人分离)重跑两场音频,与第三方逐字稿逐段比对。第一场 2,626 段/27,744 字,第二场 815 段/8,663 字。 两套稿的分工:第三方稿数字更全、说话人标签更细,作主稿;我方 ASR 用于校正专有名词与交叉确认关键原话(已确认:独家分销、战士/法师、三分天下、网卡只有七个、MFU、利通、UB) |
| ⚠️ 时间戳口径 | 本纪要所有时间戳均为第三方逐字稿口径。实测两套稿存在累积偏移:第一场第三方稿约晚 8 分钟(第三方 01:31:35 ≈ 音频实际 01:23:50),第二场约晚 80 秒。回听原始音频定位时请按此修正,或直接在我方 ASR 稿(asr_场次一/二.txt)里按关键词检索。 |
| 说话人分离的局限 | 第一场是饭局环境、背景嘈杂,我方 ASR 只分出 2 个说话人(第三方分出 11 个但三段崩塌);第二场我方分出 7 个(实际约 4 人)。两套都不能直接用作发言归属依据,故本纪要只标角色 |
| 为什么要重做 | 第三方自动摘要有三处实质错误(见第 00 章末表):一处张冠李戴(50 万)、一处方向反了(Seedance 被否却写成被采用)、一处来源归属错(第一场内容归到第二场)。结论:自动摘要可以用来定位,不能用来做判断依据。 |
B · 说话人指认:只能到角色级
结论:姓名级映射无法闭环。全文中「奶昔」「褚康」「Gary」零次出现,「小白」仅两次且都在 ASR 崩塌区。本纪要因此只标角色:
| 本纪要标注 | 逐字稿标签 | 判据 | 置信度 |
|---|---|---|---|
| 战略侧 | 第一场发言人2 | 唯一说出团队来源的人;主导全部战略结论(推理=资源战、训练锚定、客户分类、芯片原厂重点投入的客户不碰);用所有者口吻 | 角色高 / 姓名低 |
| 技术侧 | 第一场发言人4、第二场发言人4 | 只讲硬件与工程(互联架构、无收敛带宽、网卡七个、显存拓扑、infra 智能体);自称「我这些太技术了,感觉你们都听不懂」 | 角色高 |
| 商务侧 | 第一场发言人1、第二场发言人1 | 电价谈判、政府关系、当场打电话核实、招商复盘、客户筛选口径;对技术团队用「你们」 | 中 |
| 提问方 / 尽调方 / 分析方 | 发言人3 / 5 / 6 | 反复自认听不懂技术;问二级市场与竞争格局;提政治风险与迁移成本——疑为外部人 | 中 |
⚠️ 两条需要核实的:①在场人数多于四人——第一场出现六个说话人标签,00:23:14 有一句「一共就六个人」,00:37:35 提到有人「今天车上晚些加入」;②第二场有一位「张总」——00:20:43 有人问他量子计算的影响,他回答「计算方式不一样」;两套独立 ASR 都识别出这个称呼,确有其人。若四人中无人姓张,则实际在座更多。另:第二场「力峰总」「四杰总」经核对均为误切(实为「总算力峰值」「跟四杰总体谈价格」),不是人名。
ASR 说话人分离崩塌区(第一场):00:20–00:50、01:10–01:30、01:40–01:49。「三层商业模式」(01:10–01:12)与「代次性能判断」(00:44–00:48)两段最重要的内容恰好落在崩塌区,故只标「我方核心」。若需为这两段定责任人,可对原始 mp3 在这两个时间窗重跑带声纹聚类的识别。
C · 专有名词勘误(两场合并,择要)
| 逐字稿原文 | 应为 | 依据 |
|---|---|---|
| 摩尔木西 / 摩尔木基 / 摩尔默西 | 摩尔线程(第一场处疑为摩尔线程+沐曦被并成一词) | 上下文「商用版本时间还很短、不知道 bug」「问问沐曦里面那个价格」 |
| MUF / MFPU / MFO / 峰值 MFLOPS | MFU | 四种错法均在讨论算力有效利用率;我方 ASR 在同位置识别为 MFU,交叉确认 |
| CDance2.0 / C 股子 / C language | Seedance 2.0(闭源,只能调 API) | 三处同指;此前纪要写的「ChipDiffusion」即此处音误,且它是被否掉的对象而非采用对象 |
| 力通 / 利通 | 利通电子 | 「里面都是 GPU、固定租金、租给自己」;与台账(满租)一致。两套 ASR 分别识别为「力通」「利通」,交叉确认 |
| 零曲通信 UB / 领取通信 UB | 统一总线(UB) | 两套 ASR 均在同位置出现,上下文为节点间通信与内存池化 |
| 秃子工厂 / 超温工厂 / 商品工厂 / 通用工厂 / 头盔 | token 工厂 / token | 同段语义链(生产成本、卖价、每百万) |
| 5kcal / 11.5 万卡月 | 5,000 卡 / 1.5 万卡月 | 「5K 卡 × 3 个月 = 1.5 万卡月」乘法自洽 |
| 灰机流 | 硅基流动 | 谐音;上下文为「比较火的」token 服务集群 |
| 范氏 / 范式 | 第四范式 | 「有 1 万片,拆成三个项目」 |
| 交大供电院 | 上海交大工研院 | 与既有 token 平台线索一致 |
| 长晶 | 长鑫存储 | 「阿里的 HBM 就比他们大,因为它跟长晶关系好」 |
| 旷世 / AI4小红的那个时代 | 旷视 / AI 四小龙时代 | 与「人脸识别、两天训完」同段 |
| 陶铸先生 / 郭盾 / 国一量子 | 陶哲轩 / 国盾量子 / 国仪量子 | 上下文分别为科研试错、量子第一股、合肥中科大系 |
| 大摩公司 | 大模(型)公司 | 01:36:07 |
D · 待核(引用前必须落实)
| 下一代性能 | 「B200 差不多 / 0.5–0.8 / 比 B300 差很多」为口述经验值,无公开出处,不得写入对外材料 |
|---|---|
| 成本倍数 | 第一场「净差 3、4 倍」「至少四倍」与第二场「token 成本是 B300 三倍」口径不同,需明确是卡时成本还是端到端 token 成本 |
| 整机价差 | 「一台从美国抛过来赚 1000 万」跨度过大,不引用 |
| 带宽口径 | 第二场「2T/4T/3027」原文不清,疑为 3.2T,不引用 |
| 大项目线索 | 「明年有一个地方会建 600 万平的超算中心,里面会有 20~30 万片」(00:45:29)——单位疑为 MW,建设方与地点会上均未答,值得单独去查 |
| 无法还原的实体 | TPS(乌兰察布 500MW)、Bixi、春兴科技、罗斯(含 IDC 与清洁能源三业务的企业)、信人、金瑞金科等——需向与会者口头确认,不做猜测填补 |
| 第二场「张总」 | 身份待确认(见附录 B) |
E · 已删除内容说明
第一场净业务内容约占 65–70%(约 72 分钟)。与业务无关的私人话题(约 18 分钟)、点菜与到店寒暄、散场安排已整段删除且不留档。另有涉及内部人事与合规事项的讨论不在本版收录范围。