没有这个传奇工程师,就没有今天的Windows

​根据计算机领域的摩尔定律,如果在18个月内都还没有发布产品,几乎意味着项目要流产了。Windows NT操作系统的最初计划也是18个月,但现在,他们已经整整研发三年了。

好在,这个大制作已经进入测试和Bug修复阶段,只差临门一脚。还有不到两个月,他们将最终交付这个计算机系统领域具有划时代意义的操作系统内核。“记住这美好的旧日时光吧”,大卫·卡特勒(David Cutler)希望工程师们再鼓一把劲。

如果这是美好时光,Windows NT的缔造者们会觉得有点不幸。


经历一次次延期发布,所有人身心俱疲,单调和乏味充斥着日常工作,而卡特勒这个暴躁工头还在催赶工期,如果有工程师在家扎小人诅咒卡特勒,也不会让人感到意外。毕竟,在这个1993年的6月,为了解压和泄愤,他们就随手完成了一次集体性反动恶作剧。

一天,办公室上方掉下了一条百叶窗的绳子,落在了走廊上形成了一个圆环。不久这个环出现了一些硬币,随后又有人放入了一支玫瑰花,一些赌博用的筹码,奇怪的是,没有人清理掉这些东西。

很快,圆环里多了一个装糖果的盒子,还加入了一张卡特勒的滑稽大头照。两根蜡烛也随后出现在圆环外面,尽管没有点燃,但气氛似乎恰到好处,给卡特勒照片营造了一种诡异的肃穆感。

没错,那是献给卡特勒的祭坛。根据《观止:微软创建NT和未来的夺命狂奔》一书的描述,这些东西好几周都没有人移动,直到一天,卡特勒停下来问身边的同事那些鬼东西像什么,知道真相的他愤怒地走开了,也许是假装愤怒。

大多数工程师跟着他过着一维的生活,工作就是他们的全部。对下属,他更多展现的是粗鲁、严厉、蛮横、好斗、无情的暴君形象,甚至在招聘女秘书时会问怎么看F打头的那个词。然而,很少有人会质疑他对待工作的态度,专注、严谨、激情十足、不拘一格,具有天生领导力,而且有女性工程师看出他有时暴怒的背后只是虚张声势。

这些混杂的印象让很多人对他产生了一种微妙的情感,怨恨中带有丝丝仰慕,用当代比较时髦的词来形容,有些人说不准就会讨伐这个中年男是在“PUA”了。

有些牛人就是这样,厉害到能让别人忍受他身上的种种缺陷,更不用说卡特勒这种被誉为engineer's engineer(“公鸡中的战斗鸡”)式的人物。

戈登·贝尔和比尔·盖茨是他职业生涯中最重要的两个伯乐。大学毕业后的卡特勒先在杜邦公司自学编程,而后入职DEC,1970年代后期在时任DEC副总裁的贝尔支持下,开创性地开发了VMS操作系统,贝尔称他是世界上最好的操作系统编写者。

1988年,在盖茨的招募下,他来到微软,历时5年花费1.5亿美元,领导200多位工程师开发出有430万行代码的Windows NT。其技术革命性严重冲击了Novell的Netware和UNIX操作系统的地位,为微软带来不可估量的商业价值,影响着超过20亿人的计算体验。也因此,他成为迄今为止唯一一位享有微软Senior Technical Fellow头衔的工程师,待遇比肩集团VP。微软前CEO鲍尔默更是直言,没有他,就没有今天的微软

不过,相比对这个世界产生的影响,他在外界的知名度却不如同级别的Linus Torvalds,Jeff Dean那样响亮。但他对此毫不在意,只专注于高质量地完成工作,奉行行胜于言。他会强势向你展示一种让可能性变成现实的决心:我就是喜欢做这件事,我就要做成这件事。

Windows NT就是卡特勒决心要实现的那件事。

1

“双非”工程师的逆袭

不同于大多数有着显赫经历的牛人,卡特勒既非计算机科班出身,也非名校毕业生。在奥利韦特学院(Olivet College)上大学时,他拿的是数学学士,对电脑一窍不通,毕业也并不想从事编程这种“似乎非常缺乏创造力且枯燥的工作”。

后来,他进入杜邦公司从事材料测试,但工作任务无可避免地需要编程来建模,卡特勒只好去IBM开办的学校去学习编程,并将他写的代码运行在DEC的小型机上,假以时日,竟然不小心成了DEC计算机专家。

这段经历让他在1971年顺利进入DEC公司编写软件。在那里,他为DEC的PDP-11计算机构建实时操作系统RSX-11M时发挥了关键作用,通过结合总体概念和设计原则,利用汇编语言在非常有限的内存空间内实现了多项系统功能,比如树型文件系统、交换应用程序、实时调度和一整套开发工具等。过硬的技术和积极工作赢得了赞誉,尽管他的暴脾气没给任何人留下好印象。

还好有贵人识才。有DEC技术灵魂之称的贝尔发现卡特勒是个一流工程师,还让他主导为新的产品线Vax编写VMS操作系统,这个系统需要满足向后兼容已有应用,同时要能在不同配置的Vax计算机上运行。巨大压力之下,他花两年时间完成了这一任务,35岁的卡特勒一战成名。

(左为戈登·贝尔,右为大卫·卡特勒)

当打之年的卡特勒有着远大抱负。但DEC日益增长的官僚气息让他无法忍受,并威胁要离开公司,贝尔挽留了他。1985年,DEC给他约200人的软硬件工程师来设计一个全新的计算机系列Prism,其操作系统叫Mica。

起初,这个团队几乎像一个独立的公司那样运作。可好景不长,期间贝尔离开后没人罩着,DEC其他部门对卡特勒团队的业务下手了。

1988年6月,DEC总部告诉他项目完全取消。心灰意冷的卡特勒准备离开。几年过后,当一个类Mica的操作系统问世之际,DEC管理层会为当初放掉这员猛将而付出“代价”。

彼时,计算机产业正处在激情澎湃的技术革新期,新的软硬件创业公司层出不穷,如OneFlow此前写过的思维机器Multiflow公司。

正如日中天的却是微软,DOS系统的成功让盖茨迈向美国首富,但他却嗅到了面临的危机。微软的现金牛DOS可能面临潜在威胁:一是RISC芯片的出现可能取代英特尔芯片,DOS却与英特尔的芯片高度绑定;二是许多公司开始销售装有UNIX的电脑。要应对这一难题,他想要微软开发一个可移植的操作系统运行在任一RISC芯片上,成为个人计算的通行标准,这个新系统叫Windows New Technology,也就是Windows NT。

卡特勒要离开DEC的消息传到了盖茨那里,相约见面后,这个看起来很自负的工程师从上到下喷了一顿微软的产品,但后者认定,他将是领导新操作系统团队的最佳领导人选。大把股票、自主选择研发团队和开发新操作系统的机会,以及盖茨表现出的诚恳态度最终将卡特勒这个狂人收入麾下,入职后还顺便招募了不少他在DEC时的死忠。

2

踌躇满志却状况百出

初来乍到,卡特勒团队与“微软人”一度互相看不上,他把团队搞成了前DEC工程师的小圈子。


为了让新人融入微软体系,盖茨将足智多谋的骨干工程师Steve Wood派到了这个团队。Wood曾接手被微软最大的客户IBM大力支持的OS/2系统,这是个16位操作系统,只能在英特尔硬件上运行且不可移植。他对卡特勒没有盲目崇拜,但发现与其他团队成员倒是“臭味相投”。

经过几个月的持续招募,在1989年4月,一个较为完整的NT团队就绪,带着失意、愤懑的复仇情绪,卡特勒准备大干一场。

NT操作系统的目标既具挑战性又雄心勃勃:

  • 可移植且可用于多个目标(MIPS、Alpha、PowerPc、x64)

  • 可以在多个操作系统(POSIX (UNIX)、OS/2 和 Windows 32)上运行

  • 安全性和 C2 认证(受信任的计算机认证)

  • 在具有多个处理器的系统上运行,并且能同时运行多个程序,这在当时PC市场上独有

高可靠性的要求使得卡特勒将NT分成了两个部分:一个是内核,不与程序发生关联,不会被它运行失败时所影响,另一个是操作系统的图形化部分。这个模式的最大问题是会牺牲系统运行的效率。盖茨也表达了质疑,但卡特勒坚称,他们会以高超的编程技巧弥补性能不足。

根据日程表,他们打算在1990年7月写完NT的所有代码,并在1991年3月30日交出最终版本。很快,那些预料之中和始料未及的挑战会让他一次次食言。

首先是技术上的难题。一方面,支持和测试NT系统的机器还没制造出来,在英特尔的i860芯片上运行NT的代码,效果太差,而切换到卡特勒看好的MIPS芯片要走很多回头路,后来他们切换到英特尔的386系列芯片,但还是必须忍受硬件的毛病。另一方面,缺乏编程工具拖慢了系统研发的进展,打造工具也分散了团队的部分力量。

其次是团队磨合不畅。卡特勒只想专注小团队去开发NT内核,不想负责管理与之相关的图形、网络、测试小组。他们各自工作风格不一,卡特勒甚至把测试小组当做累赘,他从不依靠测试小组,认为测试工程师只会让程序看起来更糟糕。这种偏见源自他的个人编程风格,在写代码前,他会先在头脑里形成代码图,然后高精确度地写下极少有Bug的代码,每一行代码都有注释。

同时,他还要很不情愿地根据项目经理带来的客户意见来修改代码和功能。

1990年春天,图形可视化部分也遭遇严重困境,尤其采用C++语言使得程序容量超过计算机内存,而MIPS芯片的发布也延迟了,盖茨还把NT向386芯片移植的工作视为项目最高优先级,但是没有完成。

更糟糕的是,不少人怀疑模型NT的客户-服务模型会降低运行应用的性能,包括盖茨也因为害怕牺牲太多速度,始终没有认可这种模型。但卡特勒依然坚信他们会解决这个问题,在系统的可靠性和速度之间做出选择时,他最不能容忍的是不稳定。

至此,要在7月写完所有代码的计划不可能实现。卡特勒讨厌不能如期兑现承诺,种种问题让他很崩溃,但现在没法撂挑子了,除了测试部门,网络、图形、兼容性等团队都交由其管理。他第一次感觉到,自己的事业与NT的命运已经联系在一起。

3

截止日期节节败退

1990年6月,Windows 3.0的发布让整个软件行业大变样。他们开始思考如何将NT运行到Windows上。但最大的矛盾在于,OS/2和Windows控制系统PC的方法互不兼容,这让客户和工程师都变得难以适从。对微软来说,他们不可能主要去支持OS/2,但也不想与最大客户IBM产生决裂。

盖茨给IBM灌了两斤迷魂汤。他让后者相信,NT分别支持Windows和DOS系统将带来诸多好处,尽管这与他建立统一软件标准的说法有矛盾。背地里,微软只让来自以色列的一小队人马去设计NT的OS/2变种,而卡特勒团队却向Windows发展成计算机标准这一真正的目标前进。

对卡特勒个人来说,此举不仅让他摆脱了IBM,也将实现替代UNIX的期望。他早前就以蔑视UNIX而闻名,认为这是一帮博士设计出来的垃圾。那时的UNIX缺乏对系统资源配额的支持(例如,任何进程都可能通过分配过多内存或 fork() 循环导致系统崩溃),还缺乏VMS风格的进程权限、微内核架构,以及缺乏对多个子系统的支持。

半年后,IBM才发现到被微软摆了一道,还是后者主动披露的。1991年1月,在微软举办的应用软件开发者大会上,IBM工程师幻想着微软NT团队会介绍支持OS/2的内容,但直到演讲快结束都有提到。IBM工程师当场质疑,NT工程师挑明要放弃支持OS/2,这导致IBM解除了与微软的合作关系。

随后新的研发进度表出炉,卡特勒承诺会在1991年10月31日,在万圣节前NT代码将会完成。而测试和修Bug的工作则会推迟到1992年的第二季度,这也是把NT交付给客户的时间。

NT逐渐成型,卡特勒希望团队都能尝试使用NT系统,这样就可以检查NT各个部分存在的缺陷和瑕疵,并对某些类型的程序缺陷进行改进。他们将转换到NT系统的计算机上分为三个阶段:纯内核NT、图形以及网络阶段。

真正评判代码优劣的方法就是运行代码。随着更多工程师使用NT,他们发现,要在NT上完成一件工作非常困难,不得不花费数小时甚至数天时间进行修复Bug,大大影响了项目的进度。直到1991年5月底,没有Windows图形的NT版本运行得很快,可依然是个很差的替代品。

1991年8月,他们需要在三个月内基本完成NT的程序以赶上截止日期,但现实是,NT的代码最多只能完成80%。这时NT团队要考虑的是系统的安全性问题,主要是防止信息篡改。他们大大低估了这个工作的难度。再一次,卡特勒放弃了在10月完成NT的计划,那时即使是最好的版本都有很多缺陷,而且性能上也有局限,尽管此前的测试表明Windows应用在NT上运行只比在DOS上慢比较小的百分点。

他给的最新截止日期是1992年4月。没有人比他更想看到NT早日发布。

除了统一NT的两个版本进展缓慢,让他更头疼的是不断新增的新功能,比如容错性,直到1991年圣诞节前夕都没有完成,文件系统也迟迟没有定型。甚至到1991年底,测试都没有开始。兼容DOS和Windows应用的进展也落后了。而图形小组由于使用C++而不是更容易的C语言降低了效率。

也不全是要延期的坏消息。卡特勒用强硬手段帮助团队度过了难关,使得NT的MIPS-英特尔版本在圣诞节前发布。在开发早期阶段,NT就达到了一个在其他系统上很难达到的水平,在他眼里这是一个重大成就。

项目进度安排很严谨,但研发过程中的项目工作量依然充满未知。1992年2月,这是研发NT的第三年了,卡特勒的计划一次次被NT的复杂性作弄。

节节败退的日程表让他很不安。卡特勒一直认为,操作系统的开发最好是尽早发布第一个版本,更多功能将来可以再添加,但Windows NT开发到现在已不只是按照他的个人想法可转移。

这次,他把公开测试版推迟到了7月1日。

焦头烂额之际,卡特勒得到了一个意外喜讯。他的老东家DEC同意成为购买NT的第一个计算机制造商。在他看来,被DEC取消的Mica项目和NT大体是等价的,实际上,NT的许多元素都有他在DEC做系统时的技术映射,比如内存管理、进程和调度与VMS非常相似,而DEC现在却花大价钱买下原本可以免费拥有的东西,这让他体会到一丝复仇打脸的快感。

4

混乱终将变得有序

随后卡特勒要求团队快马加鞭,让工程师注意细节,为了激励他们的斗志,有时还亲自上阵负责写模块。

终于,1992年6月29日,他们发布了一个WindowsNT Beta版本,主要改善了系统的质量和可靠性。接下来,他们需要花几个月时间完成未完的功能、修复Bug、提高性能并尽可能减小NT,最终版本将在年底发布。

太大、太慢是一直困扰他们的关键问题。有人调侃,NT是一头吃内存的飞猪,在性能方面是一只蜗牛,这两个指标离盖茨在三年前设定的目标还很远。

卡特勒承认NT太慢,但现在差不多达到他的期望了,因为对性能的改进没有止境。软件历史充分证明,从IBM的360到不同风格的UNIX,再到微软的Windows,几乎所有划时代的系统都是在不成熟的状态就发布出来,然后逐步演进并赢得更广泛的认可。

内存方面,盖茨的公开目标是将NT的最低内存要求设定为8MB,但现在至少需要16MB才能满足典型用户的应用需求,而当时大多数个人电脑装备的是4MB内存,而增加内存容量的话要花更多成本。

至此,盖茨只能放弃了在8MB内存的PC运行NT的打算,但在性能的问题上他不会让步,当时操作系统业务大约占微软所有销售额的一半,如果这一点不能满足客户的要求,它们就可能转向IBM的OS/2。

一次次的延期发布挫伤了团队的士气。但催促连续不断,而且没有明确的结束期限。当大多数人认为这个操作系统快结束了,其实还有几个月的乏味测试,以及尚未完成的功能和性能改进等着他们。每天大约有2000个Bug需要解决,卡特勒关注Bug数量,就像关注着战场上的伤亡数字。

他制定的残酷进度让很多人难以忍受,尤其最后的死亡行军期间,很多团队成员挣扎在工作和个人生活这条线上,让他们跟情人、朋友、孩子的关系变得很紧张。卡特勒二次婚姻破灭,基本没有家庭生活上的牵绊,也一直待在战壕里。NT团队此刻的拼劲后来也激励了一位来自遥远东方的深度学习框架创业者,在《观止》的第187页空白处,他写下了一段批注,“看看创造奇迹的人”

距离创造奇迹还有一步之遥,只是卡特勒再没敢承诺系统发布的准确时间。为了提升团队士气,他在全员邮件中重复着他的口号,“记住这美好的旧日时光”。

1993年6月21日,NT的发布终于进入倒计时,为了庆祝项目即将生产,工程师们为他献上一个祭坛。一个月后的7月26日,Windows NT终于发到工厂生产了。

独自坐在办公室的卡特勒难掩激动心情,他发布了一封全员邮件,开头写着:NT发布了,再说一遍,NT发布了——一连摁了5个感叹号。

5

那美好的旧日时光

卡特勒似乎是那个注定为Windows NT而生的人,它的成功占据天时地利人和。

微软迫切需要一个可移植的操作系统来帮助其赢得未来,它拥有打造这个系统所具备的足够资金和人才资源,但只差卡特勒这样的技术领导者,同样不容忽视的是,盖茨和鲍尔默给了他本人最大程度的信任和支持,在微软王国里封给了卡特勒一片拥有高度决策权的自由领地。

远大目标的呼召和自由的管理空间对卡特勒推进NT至关重要。在这里他完全施展了他独特的领导和技术才能。NT团队没有固定的汇报层级,他本人拒绝过度管理,讨厌复杂的规章制度,尽可能不插手下属的工作,相信最突出的才干会在人数较少的小团队中显现。他在分配工作时留有一定灵活性,喜欢让每个人扮演不同角色,可以主动解决没有明确职责归属的事,而不是画地为牢。

卡特勒像是同时兼电影导演、演员和场务于一身,他证明自己可以把混乱的系统变得有序,不管它有多么难控制。

作为导演,他依赖于召集到的所有人的才能,同时将自己的思想和偏好施加到下属身上。如果在方向问题出现各种创意和分歧,最后由他拍板如何去做。他的挑战在于如何让这些有才华的人遵循同一份进度安排,服从同一份通知。同时,作为演员和场务,他又能时刻亲自上阵,为系统的每一条程序把脉,值得一提的是,NT的177个.c文件出自卡特勒,比NT首席架构师Mark Lucovsky还要多一倍。在长期无序的技术架构和组织结构演变中,他是运筹帷幄的那个人。

可以想象,在研发Windows NT的5年里,如果不是由卡特勒这样执着、强悍的猛人把持,要带领250名精英工程师在心力交瘁的上千个日夜里不断推进绝非易事,换个人领导NT团队可能会是另一番光景。

当然,NT的成功离不开每一位工程师付出的艰苦努力。而该项目后来的巨大成功也证明,他们的付出是值得的。一直到2001年Windows XP发布,NT已成为所有Windows产品的内核系统,包括2021年最新发布的Windows 11,而它却是一个30年前设计的系统,老年的卡特勒会自豪地告诉你,那全部都基于NT。

这离不开NT内核的技术创新。从NT发布的第一天起,其诸多特性从根本上保证很多方面优于UNIX,以及后来的Linux:

  • 日志文件系统NTFS,具有抗崩溃能力和性能。Linux在NT发布6年后开始才具备类似的日志功能集

  • 含有第三代扩展文件系统ext3。

  • 服务。在UNIX里,“守护进程(daemons)”是常规进程。要启动一个守护进程,你必须知道它的位置、语法和依赖关系。而NT允许用户集中管理服务进程并自动管理它们的依赖项。GNOME和KDE在2000年有了类似NT的服务概念,几年后被DBus标准化。MacOS和SystemD则分别于2005、2011年才有。

  • 注册表,用于存储和检索应用程序配置数据的统一模型。UNIX在 /etc中有任意格式的文本文件,但在实践中效果不佳,导致产生版本控制/隔离问题。

  • 线程和进程有很大区别。UNIX将进程作为执行和地址空间的单位,它的一些实现支持线程(或LWP,轻量级进程),但在POSIX线程出现前,它们的创建成本更高且非标准。

  • NT的模块化设备驱动架构允许在系统初始化后加载设备驱动,而当时的UNIX通常将驱动编译到内核中。NT还支持PnP和“设备树(device trees)”,所以可以正确计算驱动初始化的依赖项。2003年,Linux才具备“统一设备模型”能力。

  • 一个 O(1) 调度程序。直到2003年Linux才具备。

  • NT的内核是“可抢占的”,有更好的系统响应能力和并行处理性能。在OS X Leopard前,OS X的抢占性(粗粒度锁定)非常有限。Linux在2011年才摆脱了粗加锁方式。

1996年,卡特勒停止管理整个NT项目,但继续领导内核开发直到2006年。自2000年以来,他参与开发了每一个Windows版本的核心技术,包括第一个完整32位的Windows 版本,同时对AMD64平台的Windows XP、Server 2003系统做出重要贡献。后来随着计算机行业从服务器转向云服务,他在2008年担任微软Azure云计算平台的主要开发者。2012年,他参与开发了Xbox主机操作系统部分。

在几十年职业生涯中,他在架构设计、编码、注释等方面表现出的严谨风范,深刻影响了微软技术团队的工程文化,这也是他影响工程师的永久性遗产。

如今,这位出生于1942年,现已是79岁的高龄工程师依然还会去办公室写代码。他喜欢完成自己的代码,然后看着它正常工作。休息间隙,这个倔老头儿或许还会忆起开发NT的那美好的旧日时光。

题图源自微软官网、维基百科

参考资料

1.《观止:微软创建NT和未来的夺命狂奔》,G. Pascal Zachary著,张银奎等译

2.https://news.microsoft.com/features/the-engineers-engineer-computer-industry-luminaries-salute-dave-cutlers-five-decade-long-quest-for-quality/

3.https://retrocomputing.stackexchange.com/questions/14150/how-4.should-we-interpret-dave-cutlers-criticism-of-unix/14151

5.https://en.wikipedia.org/wiki/Dave_Cutler

6.https://en.wikipedia.org/wiki/Windows_NT

7.https://www.tech-insider.org/windows/research/1993/0526.html

其他人都在看

欢迎下载体验OneFlow新一代开源深度学习框架:GitHub - Oneflow-Inc/oneflow: OneFlow is a performance-centered and open-source deep learning framework.


目录

1

“双非”工程师的逆袭

2

踌躇满志却状况百出

3

截止日期节节败退

4

混乱终将变得有序

5

那美好的旧日时光


相关推荐

<span class=“js_title_inner“>OpenAI 前首席研究官:AGI 核心突破已实现</span>

归根结底,与人合作时要理解他们的诉求,既要让他们实现创作目标,又要协调所有人的贡献形成整体成果,并持续反复地解决这个问题。但如果他们知道你是在为他们争取最大利益,那么当你要求他们去做那件极其困难且令他们恐惧的事情时,有时你就能帮助他们跨越鸿沟,解决问题,避免他们做出愚蠢的举动,最终获得圆满的结果。,包括在实现方式上的品味,其中可能存在不明显的后果——也许是性能上的隐性影响,也许是用户界面演变过程中难以预见的连锁反应,进而需要改变系统更深层的抽象结构——这些只能依靠人类来完成,目前别无选择。

OneFlow深度学习框架 721

<span class=“js_title_inner“>OpenAI 前首席研究官:AGI 核心突破已实现</span>

归根结底,与人合作时要理解他们的诉求,既要让他们实现创作目标,又要协调所有人的贡献形成整体成果,并持续反复地解决这个问题。但如果他们知道你是在为他们争取最大利益,那么当你要求他们去做那件极其困难且令他们恐惧的事情时,有时你就能帮助他们跨越鸿沟,解决问题,避免他们做出愚蠢的举动,最终获得圆满的结果。,包括在实现方式上的品味,其中可能存在不明显的后果——也许是性能上的隐性影响,也许是用户界面演变过程中难以预见的连锁反应,进而需要改变系统更深层的抽象结构——这些只能依靠人类来完成,目前别无选择。

OneFlow深度学习框架 409

<span class=“js_title_inner“>LLM 推理经济学</span>

作者 | Piotr Mazurek & Felix GabrielOneFlow 编译翻译|张雪聃题图由 SiliconCloud 生成当前 LLM 公司的主要商业模式是通过 API 提供模型访问服务,推理成本结构是决定其盈利能力的关键。本文将从底层原理阐释大模型托管/服务的成本来源、单个 GPU 可生成的词元(Token)数量及其成因,本文以开源模型 LLaMA 3.3 为基础,搭建一个简化版的大模型推理运算世界模型,旨在建立关于 LLM 推理的精确直觉认知。大模型推理的经济学影响远超过技术范畴本身。随

OneFlow深度学习框架 632

Databricks“三级跳”:600 亿美元独角兽的战略跃迁

本文以 S 曲线理论为分析框架,深度解构 Databricks 的三次关键战略跃迁,还原了其技术商业化路径中的关键决策——如拒绝本地化部署的短期利益、与微软 Azure 的生态合作以及从开源社区到企业级服务的平衡艺术。Databricks 作为数据与 AI 领域的代表性企业,从开源项目 Spark 起步,逐步发展为估值超 600 亿美元的行业巨头,其成长历程不仅折射出大数据技术的演进史,更揭示了科技公司如何通过连续的战略跃迁实现指数级增长。当时的背景是:互联网的迅速发展催生了海量数据,尤其是非结构化数据。

OneFlow深度学习框架 1203

AI 云服务之争:CoreWeave 向上,Nebius 向下

平台中的大多数工具均为自主研发,包括支持大规模调度的托管 Kubernetes、基于 Slurm 的集群调度系统、用于实验管理的 MLflow、自研的可观测性工具,以及一个具备安全保障的云端基础设施控制平台。它跳过了这一环节,设计了自己的服务器机架,以建立一个更加垂直整合的系统,从数据中心架构到托管式 Kubernetes 服务,再到像 Nebius AI Studio 这样的应用层工具(该工具为 DeepSeek、Llama 和 Flux 这样的开源模型提供推理 API)。的策略更全面和“全栈”。

OneFlow深度学习框架 2074

<span class=“js_title_inner“>AI 云服务之争:CoreWeave 向上,Nebius 向下</span>

平台中的大多数工具均为自主研发,包括支持大规模调度的托管 Kubernetes、基于 Slurm 的集群调度系统、用于实验管理的 MLflow、自研的可观测性工具,以及一个具备安全保障的云端基础设施控制平台。它跳过了这一环节,设计了自己的服务器机架,以建立一个更加垂直整合的系统,从数据中心架构到托管式 Kubernetes 服务,再到像 Nebius AI Studio 这样的应用层工具(该工具为 DeepSeek、Llama 和 Flux 这样的开源模型提供推理 API)。的策略更全面和“全栈”。

OneFlow深度学习框架 142

关于 DeepSeek-R1 API 评测,至少有 7 个误区

xx 58.33%。以某评测者的“人类头发数量的乘积是多少?市面上基本不存在“非满血版 R1”,也基本不存在所谓模型“降智”,而 R1 蒸馏版(70B、1.5B等)与满血版的效果差距很明显,一般知名服务商都会注明,如果这些平台提供所谓“非满血版 R1”,很容易测试出来,这完全是自砸招牌,他们没有动机“以次充好”。可以确定的是,市面上知名的第三方平台部署的都是“满血版 R1(671B)”,之所以用户使用感受有差异,是因为模型输出的随机性、平台提供的配套功能及超参数设置等可能不一致,而非底层模型本身的差异。

OneFlow深度学习框架 1124

<span class=“js_title_inner“>关于 DeepSeek-R1 API 评测,至少有 7 个误区</span>

xx 58.33%。以某评测者的“人类头发数量的乘积是多少?市面上基本不存在“非满血版 R1”,也基本不存在所谓模型“降智”,而 R1 蒸馏版(70B、1.5B等)与满血版的效果差距很明显,一般知名服务商都会注明,如果这些平台提供所谓“非满血版 R1”,很容易测试出来,这完全是自砸招牌,他们没有动机“以次充好”。可以确定的是,市面上知名的第三方平台部署的都是“满血版 R1(671B)”,之所以用户使用感受有差异,是因为模型输出的随机性、平台提供的配套功能及超参数设置等可能不一致,而非底层模型本身的差异。

OneFlow深度学习框架 125

首发!硅基流动 x 华为云联合推出基于昇腾云的 DeepSeek R1 & V3 推理服务

DeepSeek-R1、DeepSeek-V3 开源后引发全球震动,它们是深度求索团队为全人类献上的一份大礼,我们由衷为他们取得的成功感到高兴。经过硅基流动和华为云团队连日攻坚,今天,我们也为国内用户献上春节礼物:大模型云服务平台 SiliconCloud 首发上线基于华为云昇腾云服务的 DeepSeek-V3、DeepSeek-R1。 需要特别强调的是,无论是在昇腾上适配 DeepSeek-R...

OneFlow深度学习框架 4215

<span class=“js_title_inner“>首发!硅基流动 x 华为云联合推出基于昇腾云的 DeepSeek R1 & V3 推理服务</span>

5. 与 DeepSeek 官方优惠期价格保持一致,SiliconCloud 上的 DeepSeek-V3 的优惠期价格(截止 2 月 8 日 24:00)为 ¥1 / M tokens(输入)& ¥2 / M tokens (输出),DeepSeek-R1 的价格为 ¥4 / M tokens(输入)& ¥16 / M tokens (输出)。华为云昇腾云服务可提供澎湃、弹性、充足的算力。双模型,还是在此前上线其他模型的过程中,我们都得到了 DeepSeek 与华为云的大力支持,向他们致以深深的谢意与。

OneFlow深度学习框架 118

站在 AI 十字路口:直面智能体与机器人狂潮

生成式 AI 正在迅速介入人类世界。随着 AI 大模型不断进步,我们正面临着巨大的社会变革。本文探讨了一个由高度智能的智能体和机器人主导的世界——AI 亚特兰蒂斯世界(指在数字领域拥有几乎无限的 AI 资源)。本文分析了当前的 AI 模型为何从根本上不同于以往的技术范式,它们如何重塑各行业,以及人类面临的关键选择。作者认为,每个人都必须理解 AI 的进步将如何重塑经济、创造力和人类潜力的规则。除...

OneFlow深度学习框架 591

<span class=“js_title_inner“>站在 AI 十字路口:直面智能体与机器人狂潮</span>

拥有 AI 的政府能够提供更好的服务,制定数据驱动的政策,增强国家安全,并为民众提供更高的透明度和问责制。这里有一个令人难以置信的想法:你现在可以雇佣智能体员工和机器人工作者,他们的薪水甚至低于你花在咖啡上的费用——然而他们却拥有与普通大学毕业生相同的技能。拥有更多的闲暇时间当然不错,但真正的关键是,AI 为你腾出了精神空间,让你能专注于更大的挑战。像 ComfyUI 这样的工具是这一转变的早期例子——人们现在可以创建复杂的 AI 工作流,其中信息和任务从一个阶段无缝流向另一个阶段。这些模型是通用翻译器。

OneFlow深度学习框架 81

迈向 AI 驱动型经济:当资本不需要打工人

AI 的迅猛发展与普及,引发了学术界与工业界对现在的社会结构与经济模型的根本性反思。此前 OneFlow 发布的《资本、AGI 与人类雄心》、《AGI 时代的智能诅咒》、《AGI 崛起之后:重构经济模式与社会结构》三篇文章,深入探讨了劳动力替代性 AI 改变人力与非人力生产要素的相对重要性后,给整个社会带来的好处与风险,以及应对挑战的解决方案。在本文中,借助一众经济学家和科幻作家的理论观点,Int...

OneFlow深度学习框架 1014

<span class=“js_title_inner“>迈向 AI 驱动型经济:当资本不需要打工人</span>

相对而言,伊恩·M·班克斯(https://en.wikipedia.org/wiki/Iain_Banks)的《文明》系列丛书则描绘了一个后匮乏的社会,在这个社会中,拥有感知能力的 “AI 智能体(AI Minds)” 管理着星舰和栖息地,根据需求分配资源,而非货币。例如,《星际迷航》中,技术(如复制器和先进的星舰 AI )消除了物质匮乏,推动了一个专注于探索和文化发展的社会。而 AI 的引入,使非人类智能体成为生产力的主要推动者,将剩余价值的核心转移到了算法、数据集和计算系统的所有权上。

OneFlow深度学习框架 91

AGI 崛起之后:重构经济模式与社会结构

AGI 日益临近,这也迫使我们重新审视现有的社会结构和经济模式。在《资本、AGI 与人类雄心》一文中,Rudolf 指出,AGI 到来之后,劳动力替代性 AI 将改变人力与非人力生产要素的相对重要性,这会降低社会对人类的关注度,同时使现有的权力更加有效和根深蒂固。基于资源诅咒现象,Luke Drago 在《AGI 时代的智能诅咒》一文中将 Rudolf 的上述核心观点描述为智能诅咒。他认为,智能诅...

OneFlow深度学习框架 1297

AGI 时代的智能诅咒

经济学研究指出,依赖出售石油等自然资源获得收入而非公民税收的国家,会受到资源诅咒的影响,结果是权贵们攫取了大量财富,却停止了对普通人的投资。当 AGI 实现后,人类是否会面临类似的“智能诅咒”?在此前发布的《资本、AGI 与人类雄心》一文中,Rudolf 指出,AGI 到来之后,劳动力替代性 AI 将改变人力与非人力生产要素的相对重要性,这会降低社会对人类的关注度,同时使现有的权力更加有效和根深蒂...

OneFlow深度学习框架 752

资本、AGI 与人类雄心

通用人工智能(AGI)正在不可阻挡地走向人类社会,有人期待它带来的巨大生产力突破,有人也在警告它可能成为洪水猛兽,也有人对它的发展只是持观望态度。不管怎样,基于你所了解的信息,你可以尝试描绘一幅 AGI 图景,并畅想它在人类政治、经济、社会发展会产生的影响。在本文中,作者 Rudolf 深入剖析了 AGI 到来之后的资本、人类劳动与社会权力结构之间的复杂关系。其核心观点是,劳动力替代性 AI 将改...

OneFlow深度学习框架 870

2025 年 AI 十大展望:软件市场扩大 10 倍、系统比模型更重要、OpenAI 先发优势消退...

尽管有 Scaling Law 放缓这样的疑虑,但整体而言,多数业内人士对AI过去一年的诸多进展感到兴奋,对新的一年 AI 的发展更是充满期待,尽管他们对未来的预测可能不尽相同。在本文中,Foundation Capital 合伙人Ashu Grag回顾了 2024 年 AI 发展的里程碑事件,并重点介绍了 2025 年的前景,主要包括:1.预训练局限将推动新的 AI 突破2.AI系...

OneFlow深度学习框架 1577

900页免费“生成式AI与大模型”电子书|OneFlow年货

难以想象,如果不是Scaling Law放缓,2024年AI领域会发生哪些惊人变化,但你可能又会感到庆幸,正是由于Scaling Law放缓,它给了这个行业的后来者们追赶的机会,也给了更多普通人搭乘这一轮技术革命的机会。AI领域的变化激荡人心。一年前,AI社区普遍认为,与OpenAI的模型相比,大部分模型与它有半年或一年的差距,但大模型预训练逐渐没有秘密,它的入局门槛数量级降低。令国内外科技界深感...

OneFlow深度学习框架 642

2024年AI盘点:投资高歌猛进、基础设施重构、技术采用加速

本文全面分析了今年AI 的发展,包含AI 技术栈的基础设施层、基础模型层、应用层、工具层,尤其是各个层面的主要收获、值得关注的趋势与值得关注的初创公司。此外,本文还概括了 AI 领域的投资和并购情况,以及其他AI 趋势。需要指出的是,可能限于作者KelvinMu的关注重心,本文除了对中国基础模型的介绍,没有更多关于中国 AI 其他技术栈的进展。不过,这并不妨碍本文仍是我们了解 2024...

OneFlow深度学习框架 1991

从零实现极速LLM推理

作者 | Andrew Chen翻译|张雪聃、刘乾裕OneFlow编译题图由SiliconCloud平台生成本文旨在从零开始,仅使用C++和CUDA构建一个大语言模型(LLM)推理引擎,且不借助其他外部库。为何要这样做?通过这种方式,我们能够全面了解LLM推理的整个技术栈——这一点正变得日益重要[1]——从CUDA kernel到模型架构,并且切实体会不同的优化方式如何影响推理速度。其中一个最为重...

OneFlow深度学习框架 1180

AI数据中心历史、技术与关键企业

过去一年,通过模型架构创新、更优质训练数据和更大算力规模来训练模型,顶尖大模型之间的性能差距急剧缩小。如果Scaling law依然有效,为了进一步扩展模型规模与性能,在模型架构创新存在极大不确定性情况下,通过获得更多的算力来建造全新的数据中心,从而更快地训练模型以取得领先地位,这是确定性更高的收益。目前,以马斯克xAI为代表的大模型公司,快速部署了10万台GPU集群,成为数据中心扩展的领头羊,可...

OneFlow深度学习框架 949

红杉资本2025年AI三大展望:大模型厂商各显神通;杀手级应用AI搜索;AI支出变稳...

2024年,随着Scaling law放缓,AI领域在大模型、基础设施上的能力稳步提升,尽管应用层出现了各种有趣的探索,但是更大的潜能有待挖掘。2025年即将来临,将出现哪些变化?近日,红杉资本投资人David Cahn对2024年AI领域的发展作了简要总结并对2025年作了三大预测。他认为,今年是AI发展的萌芽期,其构建基石已经稳固建立,只待2025年发芽结果。他在本文中阐述了三点预言:首次,基...

OneFlow深度学习框架 1657

AI半导体技术、市场与未来

过去两年,英伟达崛起是科技领域的一个经典案例。通过CUDA系统,他们创建了一个使用GPU进行机器学习的开发者生态系统;通过Mellanox,他们成为了数据中心网络的领导者。然后,他们将所有硬件集成到服务器中,提供垂直集成的算力一体机。凭借这一系列组合性技术优势,英伟达在“AI淘金热”中提供的铲子占据行业核心地位,这导致它成为有史以来最成功的公司之一。随之而来的是,不少挑战者入局以求从英伟达主导的市...

OneFlow深度学习框架 1万+

比GPU快20倍?d-Matrix推理性价比分析

AI推理算力需求正在大幅增长。一方面,像硅基流动、Fireworks这样的AI基础设施软件公司通过软件层面的优化以提供高性价比的大模型推理服务,另一方面,以Cerebras、Groq为代表的芯片公司相继推出了专用AI推理芯片,通过硬件层面的创新,以数量级的推理速度与成本优势来挑战英伟达GPU的市场地位。AI推理芯片市场的竞争者还在增加。近日,成立于2019年的硅谷推理芯片创业公司d-Matrix的...

OneFlow深度学习框架 2005

生成式AI推理技术、市场与未来

OpenAI o1、QwQ-32B-Preview、DeepSeek R1-Lite-Preview的相继发布,预示着生成式AI研究正从预训练转向推理(Inference),以提升AI逻辑推理(reasoning)能力,这一转变将极大推动上层应用的发展。红杉资本近期指出,在可预见的未来,逻辑推理和推理时计算将是一个重要主题,并开启生成式AI的下一阶段。新一轮竞赛已然开始。那么,在推理这一新兴市场,...

OneFlow深度学习框架 2072

50张图,直观理解混合专家(MoE)大模型

Mixtral 8x7B的高效训练与推理效果曾引发AI社区对混合专家(MoE)模型的广泛关注,后来居上的国产开源大模型De‍epSeek以及腾讯近期开源的Hunyuan-Large(基于Transformer的最大MoE模型)也选择了MoE框架路线。为何大语言模型总是离不开MoE的身影?借助50多个图例,数据科学家Maarten Grootendorst由浅入深多维度剖析了MoE模型,从基础概念出...

OneFlow深度学习框架 9356

LLM后训练绝招:1%预训练成本,实现最高20倍算力扩展效果

根据规模定律,扩大训练计算规模可以提高大型语言模型(LLM)性能的关键,但调研机构Epoch AI的研究,LLM再训练无需高额费用,也能让AI能力获得显著提升。在该研究中,他们引入了一个基本框架,用于量化后训练增强的收益和成本,特别是通过计算等效增益来衡量收益。他们将该框架应用于一系列具有代表性的后训练增强,并发现性能提升非常显著,但微调成本通常与预训练成本相比非常小,某些后训练增强技术可以在不到...

OneFlow深度学习框架 4602

LLM逻辑推演策略选择:推理时计算 vs 训练时计算

AGI实现的一大标志是,具备人类级别的逻辑推理(reasoning)能力。近期,随着推理(inference)模型GPT o1、DeepSeek R1-Lite的发布,模型的逻辑推理能力得到显著提升,也预示着对LLM潜力的深度挖掘正在转向推理阶段。围绕增强LLM逻辑推理能力这一目标,美国人工智能与密码学研究实验室Bagel团队结合最新研究,从算术、常识和符号这三种主要逻辑推理类型出发,对比了在推理...

OneFlow深度学习框架 4168

探索AI框架前沿|OneFlow招聘深度学习研发工程师(实习)

一、岗位名称:深度学习研发工程师-框架开发方向(实习)岗位职责1. 参与 OneFlow 框架开发、重构与性能优化;2. 参与深度学习编译、高阶自动微分等深度学习框架相关技术演进工作。岗位要求1. 计算机或电子通信相关专业,本科及以上学历;2. 具备C/C++、Python编程基础,有良好的软件开发素养,熟悉TDD、CI/CD、敏捷开发流程等;3. 了解深度学习模型,有一定机器学习基础;4. 熟悉...

OneFlow深度学习框架 553
上一篇: OneFlow参与共建下一代架构基金会
下一篇: 如何超越数据并行和模型并行:从GShard谈起
OneFlow深度学习框架
OneFlow深度学习框架 企业官方账号 企业官方账号
博客等级 码龄6年 5863粉丝 385原创
评论 12
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值