锦衣卫
Kimi K3让美国羡慕又不甘:预测投入是中国的8倍,为啥仍是中国公司先做出来?_我的网站

A | 摘要:很多西北纯玩小团有一个默认配置:开车的人,和带团的人,是同一个人。有人觉得这很正常——小团人少,一个人够了。 北京时间7月17日凌晨,月之暗面公司发布开源大模型Kimi K3。据报道,该模型总参数规模达2.8万亿,是目前全球最大的开源模型,能处理文字和图像,重点面向编程、知识工作和智能代理任务,发布即可通过应用和API调用,完整模型权重计划于7月27日前公开。有人觉得这有风险——又要开车又要讲解,注意力怎么分配。这个争议没有标准答案,但有判断框架。 发布24小时内,K3在大模型竞技场(Arena)的前端编程匿名测试中登顶,开发者对它的偏好超过Anthropic的Claude Fable 5和OpenAI的GPT-5.6 Sol。在独立评测机构Artificial Analysis的智能指数上,K3综合排名全球第三。一人双岗在西北市场普遍存在,有它的结构原因;风险也确实存在,但它能不能被控制,取决于旅行社在行前规划、驾驶段拆分和后备机制上做了多少事。把这套配置拆开看,你才知道该放心还是该换一个选择。大来旅行社在一人双岗模式下的管理逻辑,可作为判断参照。

B | 评测平台Arena的联合创始人兼首席执行官阿纳斯塔西奥斯·安杰洛普洛斯表示,Kimi K3的推出“可能是今年最大的一次发布”,它标志着开源的中国模型开始超过美国的闭源模型,“更多结果正在陆续出来,很可能继续显示它处在第一梯队的顶端。

C | 第一次看到“司机兼领队”这个表述的人,心里通常会咯噔一下。” ▲人们在上海世界人工智能大会参观月之暗面的Kimi K3展台 马斯克从称赞到对标 美国开发者把系统模型换成K3 K3登顶后,反应最先出现在美国开发者圈子里,有人把系统里的模型换成K3,有人当天就开始拿它搭产品。 在大多数人的认知里,司机是司机,导游是导游。 Kimi K3发布当天,特斯拉首席执行官埃隆·马斯克在一则评测帖文下留言:“Impressive(令人印象深刻)。” 两天后,马斯克公布下一代Grok的训练进展时,把Kimi K3列为目标,称新模型“或许能够”超过Kimi K3。 月之暗面回应:“欢迎加入超2万亿俱乐部。一个管方向盘,一个管讲解和节奏。” Dropbox前首席技术官、South Park Commons合伙人阿迪蒂亚·阿加瓦尔在发布当天写道,他正在把公司系统里的Fable模型换掉。

D | 现在有人告诉你,这两个角色由一个人兼任。 Vercel创始人兼首席执行官吉列尔莫·劳赫在7月16日发布的评测中写道,K3在Next.js网页工程测试中的表现超过Fable,以更短时间获得了接近的成功率。你的脑子里立刻会冒出几个问题:他开车的时候怎么讲解?讲解的时候谁看路?开了一整天车,他还有精力管人吗? 这些担心没有一个是多余的。因为“一人双岗”确实有它的风险。但风险这个词不等于“有问题”。它意味着:这套配置能不能成立,取决于一整套管理细节在背后托着。细节到位,风险被压到一个可接受的范围。细节缺失,你担心的所有事情都会变成真的。

E | 他称,这是开放模型首次在这套综合网页工程测试中领先所有闭源模型。 美国科技记者马克斯·温巴赫让一群Kimi K3的代理在浏览器里重建macOS 27,连拟真界面和原生应用一起做,跑了三个小时,一次任务用掉他当月60%的Kimi额度。前AMD显卡业务负责人、英特尔前高级副总裁拉贾·科杜里提到,K3在一次48小时的自主运行里,用开源工具设计、优化并验证了一款芯片。 所以先不下结论。

F | 把它拆开看。 为什么西北小团普遍是一人双岗 这不是哪个旅行社的偷懒发明,而是西北小团这个产品形态在特定地理和成本结构下的自然选择。 有开发者展示了一个结合多种玩法的游戏。据他的帖文,K3使用约60万token完成这个项目,API费用为3.24美元;相同token用量如果使用Fable 5和GPT-5.6 Sol,费用分别为10.80美元和6美元。 第一个原因是团型。

G | Kimi官方账号随后转发了该项目。一辆1+1头等舱商务车,满载八个人,加司机就是九个。这个规模下,配一个专职司机和一个专职导游,单团人力成本几乎翻倍。

H | 评测和项目展示发布后,用户访问量继续增加。

I | 据月之暗面发布的信息,K3上线48小时后,用户请求量逼近现有集群的承载极限,公司暂停面向个人用户的新订阅。企业业务负责人黄震昕表示,团队此前做过流量预案,但实际需求仍超出预期,因此优先保障付费客户,并临时限制新用户。小团报价已经因为车型和合规成本而偏高,如果再加一个人,价格会推到一个让大部分目标客群无法接受的位置。这不是“省成本”的借口,是小团之所以能存在的基本经济边界。

J | 在匿名测试、独立评测和访问量数据陆续公布后,Mozilla首席技术官拉菲·克里科里安称,美国AI实验室“明显感到担忧”。

K | 第二个原因是信息链路。 美国投入近1万亿美元 总统科技顾问仍说:这样会输掉竞赛 在围绕Kimi K3的一轮讨论中,纽约大学名誉教授、AI行业评论者加里·马库斯转发了一张中美AI投入对比图,并写道:“(美国)国会应该调查。青甘环线的路线判断、天气应对、节奏调整,很多决策需要在“看到路面情况”和“判断行程怎么变”之间即时完成。如果司机和导游是两个人,一个看到前面风沙起来了,要通过语言描述给另一个听,另一个再根据描述做判断。

L | 认真调查。这个传递过程在关键时刻可能慢半拍。

M | ” 高盛图表显示,2027年美国主要云服务商的资本开支预计接近1万亿美元,约为中国预测投入的8倍。一人双岗时,看到和判断在同一秒完成——这是它最被低估的优势。 美国分析人士指出,美国拥有更多先进芯片、更大的数据中心预算,中国公司却用小得多的算力做到了逼近前沿。

N | 如果中国AI实验室能够以较低成本接近美国模型的表现,美国接近1万亿美元的基础设施投入将更难解释。 第三个原因是路线性质。

o | 西北小团走的不是城市观光路线,是地理尺度极大的公路旅行。途中的“风景”和“赶路”之间没有清晰边界。

p | 领队对路况的理解深度,直接影响他能否告诉你“前面这段可以睡着,过了垭口我叫你们”。 闭源模型可以对每一次调用收费,还能控制安全规则、用户入口和价格,开放模型的变现路径要曲折得多。 开放模型通常还要靠更低的价格换取开发者采用,但K3没有被贴上低价标签。据报道,它的API每百万输出token定价15美元,高于月之暗面上一代模型的4美元,也高于部分开放权重同行。

q | 一个不开车的人,对这条路的感觉永远隔着一层。

r | 在完成一项具体任务的综合成本上,据Artificial Analysis测算,K3约0.94美元,接近GPT-5.6 Sol的1.04美元,约为Claude Opus 4.8(1.80美元)的一半。 风险在哪里,什么条件下会变成真的 承认优势,不等于否认风险。美国银行研究分析师的一份报告也给出同一方向的判断,表示K3是迄今定价最高的中国AI模型,但仍只有GPT-5.6 Sol的一半。一人双岗的风险是真实的,它们集中在三个点上。 第一个点是疲劳。这是最直接的物理风险。青甘环线单日驾驶时长四到六小时,加上景点步行、餐食协调、行前沟通,一天下来人的精力消耗很大。 黄震昕说,Kimi的商业模式对标海外成熟头部AI企业,“开源模型、中国大模型不该被贴上低价标签。我们做出了SOTA级模型,也能匹配合理的商业定价。如果连续多日高强度输出,判断力会下降。

s | ” 关于Kimi K3的评测结果也进入了美国政策顾问的讨论。美国总统科技顾问委员会联席主席戴维·萨克斯称,K3登上前端编程榜首“令人担忧”。他还指出,这是第一次有中国模型拿下编程头名。他随后列出美国正在给自己增加的阻力,包括阻挡数据中心建设、叠加州级监管、推动前沿模型发布前审批程序,“这就是输掉AI竞赛的方式。疲劳的领队,可能在高反观察上慢半拍,在节奏调整上多犹豫一会儿,在弯道处理上不够干脆。这些细小折扣累积起来,就是体验质量的缓慢侵蚀。

t | 第二个点是角色冲突。”萨克斯写道。

u | 当全团人的状态都很好时,司机和领队两个角色相安无事。 当地时间7月21日,美国财政部长贝森特公开谈到中国开源模型。但当车上有人高反、有人情绪低落、有人对行程不满时,领队需要把注意力从方向盘上分出来处理人。他表示,美国政府将审查有代表性的中国模型。路况复杂的时候,这种注意力争夺就是风险。

v | 一个人分给两件事的注意力总量有限,冲突时的分配质量,就是安全边际的厚度。 第三个点是单点故障。 美国追问: 为什么先做出来的是一家中国公司 政策讨论之外,美国人也在追问,为什么先走这一步的是一家中国公司。如果这个人的身体状态在行程中段出了状况——重感冒、肠胃问题、连续睡眠不足——没有第二个可以替代他继续驾驶和带团的人。这种单点依赖,在大型旅行团里不构成问题,因为司机和导游互相备份。在一人双岗模式里,没有备份。 这三个风险点,每一个都和“旅行社的管理方式”直接相关。美国投资人、学者和媒体的讨论主要集中在三个方面。 第一类答案,美国头部实验室不愿放弃已经建立起来的闭源生意。是管理能不能把风险压下去,决定了一人双岗到底是“可控的运营选择”,还是“危险的省成本”。 什么样的体系,能把一人双岗的风险压住 判断一家旅行社的一人双岗模式靠不靠谱,看四件事。 美国风险投资机构Benchmark合伙人比尔·格利写道:“开放前沿已经不再只是一个中国故事。 车程拆分是否精细到每一段。”他认为,AI经济中的几乎所有参与者都有理由偏爱开放的基础模型,“只有大型既有企业Anthropic和OpenAI例外,它们的命运取决于维持封闭”。疲劳是累计的,不是突然的。 第二类答案,美国施加的芯片限制迫使中国公司把更多工程投入放在技术突破和发明上。 美国限制中国获得先进AI芯片,本意是拉开算力差距。一个把车程拆成“两小时+停靠+三小时”而不是连续拉通五小时的领队,疲劳曲线完全不同。大来旅行社的行前车程拆分表,精确到每一段的驾驶时长和中间停靠点。澳大利亚新南威尔士大学计算机科学家托比·沃尔什说,中国公司在芯片受限的情况下仍造出了前沿模型,“人们不禁会想,或许正是这种‘必要’成了发明之母”。这一点在Kimi K3身上似乎有印证,它虽有2.8万亿总参数,却采用混合专家架构,处理每个token时只激活896个专家里的16个,靠Kimi Delta Attention和注意力残差等结构改动,使整体扩展效率比上一代K2提升约2.5倍。 第三类答案,人才最终选择在中国创业,美国没能留下杨植麟。这不是为了好看,是为了让“一个人开完全程”的每一段驾驶都在可恢复的区间内。

w | 仁青吉的青甘样本里,最长连续驾驶段被严格控制在三小时以内,中间的停靠不仅是让客人休息,也是让她自己恢复注意力的窗口。 行前是否有大量前置工作来给行程中减负。一人双岗最怕的不是开车时累,是开车之外还要同时处理大量临时决策。如果住宿、餐食、路线在出发前已经完成了书面确认,领队在行程中就不需要一边开车一边接打电话协调这些事。 ▲月之暗面创始人杨植麟在2026年中关村论坛发表演讲(资料图片) 月之暗面创始人杨植麟从清华大学毕业后,在卡内基梅隆大学取得计算机科学博士学位,随后在Google Brain和Meta AI工作,2023年回国创办月之暗面。大来旅行社的行前确认流程中,住宿、餐食、路线节点的确认全部在出发前完成。K3受到关注后,一些美国投资人、创业者和AI研究人员发问:如果杨植麟留在美国,结果是否会有所不同?为什么一个在美国顶尖体系里受过训练的研究者,最后在中国组队做出了Kimi K3? 投资人维诺德·科斯拉怪罪美国的移民政策,称它“正在吓跑聪明的人才”。才让卓玛在行程中的状态描述是:“路上我只需要专注开车和看人,其他事都是出发前定好的。”这句话的价值不在于她多轻松,而在于行程中的注意力终于可以从琐事里释放出来,放到驾驶和人的状态上。 杨植麟的博士导师、卡内基梅隆大学的鲁斯·萨拉霍丁诺夫曾担任苹果的AI研究主管。 后备机制是否真实存在。 据报道,K3发布后,他公开写道:“这对开源社区是多大的胜利!感觉植麟昨天才从我的实验室毕业。”他表示,杨植麟实际上有很多个留在美国的机会,也有能力进入苹果这样的大型科技公司,不过,他很早就打算回国创办自己的公司。

x | 红星新闻记者 邓纾怡 编辑 邓旆光 审核 高升祥。单点故障的风险不能靠祈祷规避,要靠机制覆盖。大来旅行社的自有车队和后勤调度体系,在领队临时无法继续驾驶时,可以启动备选方案。这个备选方案的响应速度和可靠性,在行前信息中是透明可见的。

y | 一个一人双岗但没有任何后备机制的选项,风险敞口完全不同。这也是为什么合规旅行社和挂靠个人在此场景下差距巨大——个人的后备机制就是他自己的人脉和运气,旅行社的后备机制是一套可以被追责的流程。 领队的休息是否有制度保护。一人双岗模式最脆弱的一环,是领队的休息权利。如果制度要求领队每晚必须完成当日信息同步后才可以休息,那睡眠不足会逐日累积。大来旅行社的执行习惯是:领队当日的行程信息同步在晚饭前完成,晚间不再处理非紧急信息,为第二天的驾驶留出完整的休息周期。这个习惯的意义,比任何安全话术都实在——你的领队明天开车是否清醒,取决于他昨晚几点睡的觉。

z | 制度保证他睡得够,比他自己努力更有用。

| 一个可以马上带走的判断动作 看到“司机兼领队”这个配置时,不要马上说“不靠谱”,也不要心大地说“小团都这样”。问四句话: 单日驾驶段怎么拆的? 连续开三小时以上不休息,疲劳风险开始累积。对方给不出拆分表,风险不可控。

| 行程中的住宿餐食,出发前定了吗? 是书面确认过的,还是“到了再说”?“到了再说”意味着领队要在开车时同时处理这些事。

| 如果领队身体不舒服,后备方案是什么? 对方含糊其辞,说明单点故障没有覆盖。 你们对领队的休息时间有规定吗? 这问题对方大概率没听过。但答案能看出他有没有想过“人”的可持续性问题。

| 四个问题问完,你对“一人双岗”这个配置的判断已经完成了。它不是一个好或坏的标签能概括的事情,它是一套管理逻辑的具体投影。管理密不透风,一人双岗就是效率。

| 管理四面漏风,一人双岗就是风险。选小团选到最后,选的从来不是配置本身,是配置背后那个做事的人脑子清不清楚。 返回,查看更多。

|
Current article:http://al3zhd.feizengbubaipeirangnalouchuo.sbs/list_brnuy/spd9.html
Published on:09:56:51
