少年
苹果诉OpenAI未点名Jony Ive_我的网站

A | 2026世界人工智能大会(WAIC)期间,摩尔线程披露,一款236B参数的MoE模型基于国产万卡级集群训练,一款具身智能大脑模型,基于国产千卡集群训练,此外,北京大学EvoPhys团队首个全球5D世界模型EvoPhys-World的全栈原生训练,全程由MUSA软件栈提供底层支撑。 其中,MoE-236B模型基于25T+语料,在摩尔线程国产万卡级集群上从零起步完成预训练到长窗口训练的全流程,有效训练时长占比超过90%。 IT之家 7 月 21 日消息,在上周末(7 月 19 日)的 Power On 时事通讯中,彭博社的马克 · 古尔曼(Mark Gurman)指出,苹果出于多方面因素考虑,在指控 OpenAI 的 41 页诉状中,并未点名前苹果公司设计师乔纳森 · 伊夫(Jony Ive)。 苹果公司于 7 月 12 日向美国加利福尼亚北区联邦地区法院提起诉讼,指控 OpenAI 及其硬件子公司 io Products 通过挖走苹果员工、获取内部文件和接触供应商等方式,盗用苹果商业秘密。 IT之家援引博文介绍,在诉讼文件中,苹果公司将矛头对准了以下几人: Tang Tan:指控其在苹果任职期间(前 iPhone 产品设计副总裁)提前泄露供应商信息及机密,离职后诱导应聘者携带原型机、CAD 图纸等加入 OpenAI,并系统性转移供应链资源。 “高精度”是摩尔线程反复强调的能力,摩尔线程高级副总裁董龙飞提到,它指的不是单次计算的数值精度,而是模型在不同GPU平台间迁移训练时的结果对齐能力,即相同模型架构、训练数据、超参数下,能否获得稳定、可比的训练结果。 摩尔线程给出的具体数据是,在DeepSeek一类MoE模型上,与国际主流GPU做对比训练,前3万步的平均相对误差控制在万分之六以内。

B | Chang Liu:指控其在职期间指导现任苹果同事规避安全审查复制机密文件,面试前传授未发布项目复习要点,并建议改用私人通讯工具(如 LINE)进行违规交流。摩尔线程还以500B至5T不等规模的数据做过多轮实验,称基于相同卡数、模型配置和训练流程,摩尔线程平台训练所得模型在下游Benchmark评测中的得分与参考平台基本一致,部分指标更高。 Yu-Ting “Alyssa” Peng:在仍任职苹果期间,持续向已跳槽至 OpenAI 的刘畅泄露苹果内部保密硬件项目的核心信息,包括项目进展、供应商决策、工程细节等关键保密内容 古尔曼认为,苹果在诉状中未点名伊夫,其中最主要的原因是苹果公司认为关联性有限。伊夫通过设计公司 LoveFrom 参与 OpenAI 硬件项目,但不负责招聘,也不处理日常运营。

C | 摩尔线程与北京大学EvoPhys团队合作训练的5D世界模型EvoPhys-World,基于MTT S5000完成全栈原生训练,在WorldScore“世界生成”维度连续37天排名第一,该项目获得摩尔线程“灯塔计划”支持,这是国内第一次由中国科学家在中国算力设备上完成的原创世界模型工作,也是“国芯训国模”的一个分水岭。 第二个原因是伊夫和乔布斯遗孀 Laurene Powell Jobs 私交甚好,古尔曼指出 Powell Jobs 曾投资于 io Products,并且仍然支持 LoveFrom。

D | Powell Jobs 虽然不是苹果董事会成员,也不是公司最大股东之一,但“Jobs”这个姓氏在库比蒂诺仍具影响力。 此外,北京智源研究院的RoboBrain 2.5具身大脑模型,基于FlagOS-Robo框架,依托摩尔线程MTT S5000千卡智算集群,双方成功完成RoboBrain 2.5的全流程训练。首次验证了国产算力集群在具身智能大模型训练中的高可用性与效率。消息称苹果公司在起诉 OpenAI 时,曾考虑是否要把伊夫写入其中,最终因为这一层关系而放弃。 第三个原因是舆论观感。伊夫于 2019 年离开苹果,并在 2022 年前担任付费顾问。报道指出在库克执掌苹果公司后,库克更重视运营效率、制造和成本纪律,设计不再居于核心位置。 摩尔线程创始人、董事长兼首席执行官张建中将AI产业按功能拆分为三类“工厂”:模型训练工厂、词元生产工厂、智能体生产工厂。三者共用同一套全功能GPU架构,这也是摩尔线程与专用芯片路线(ASIC)厂商的核心分野。 词元生产工厂方向,摩尔线程重点展示了基于MTT S5000的PD分离异构推理方案,将算力需求大的Prefill(预填充)计算放在S5000上,将带宽需求高的Decode(生成)计算放在国际主流GPU上,两者异构分池部署。

E | 张建中在演讲中给出的数据是,异构组合后整体吞吐量较原有方案提升近2倍,并给出算式,“3台S5000+2台国际主流GPU≈9台国际主流GPU”。董龙飞补充表示,这类异构方案的性能比任何同构方案都要高50%以上,其中很大一部分收益来自KV Cache的调度优化,在类似OpenClaw这样反复调用本机命令行工具的场景下,缓存命中率可达90%,相当于节省90%的算力。 据悉,过去一年,国产大模型发布后到完成硬件适配的周期已从“数月”压缩到“发布即适配”(Day 0适配),部分大模型厂商现在会在模型规划部署阶段就与摩尔线程同步“共研”,而不是等模型发布后才启动适配工作。 古尔曼认为如果苹果把伊夫拉入本次诉讼争议中,在法庭作证环节中,法官或者对方律师可能要求其回答对苹果设计地位变化的看法。 在具身智能方面,早期VLA/VLM类模型参数在5B至14B之间,主要部署于端侧;当前的世界模型路线不再依赖语言输入,直接处理物理世界,参数跨度更大,实现高质量具身控制大致需要10亿参数级别模型在端侧运行,同时配合千亿级(1000B)及以上模型在云端协同。摩尔线程正基于自有万卡级集群持续进行万亿参数模型的训练验证,但未公布具体进展和时间表。 提及算力供应话题,董龙飞表示,中国的算力建设是面向未来十至二十年的基础设施投入,短期供不应求属于正常现象,以铁路、高速公路等基建类比,中国GPU或算力企业远未发展到“供过于求”的地步。(本文作者 | 张帅,编辑 | 杨林) 更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App。
Current article:http://lz5.bainangmieruopanglaomen.sbs/t06w2k/uc3lpm.html
Published on:09:27:14











