第394章 种花芯,更适合北美宝宝体质
第394章 种花芯,更适合北美宝宝体质
深城,橙子小镇6号橙瓣大楼。
凌晨两点,实验室里依然灯火通明。
后勤早已为他们配齐了24小时食堂,可依旧没人舍得离开工位。
孙元西趴在办公桌上,面前摊著厚厚一叠测试方案。
他已经三天没回过家,办公桌旁备著牙刷和换洗衣物,墙角堆著几箱没来得及拆的速食面。
乐程文也好不到哪去,整个人歪靠在沙发上沉沉睡去,掌心还紧紧攥著一支笔。
「嘀...嘀...」传真机突然响起,有传真传了过来。
刺耳的提示声,把两人同时惊醒。
孙元西冲过去,一把扯下那张滚烫的纸。
台机电·新竹十二厂流片结果通知项目编号:CZ—NPU200
批次:MPW—2016—001
结果:良率达标,功能验证通过,电性参数符合设计预期。
孙元西的手在发抖。
「老乐!老乐!」他喊了一声,声音沙哑:「成了!提莫的真成了!」
乐程文从沙发上弹起来,一把抢过传真。
他看了三遍,然后放下传真,走到窗边,推开窗户。
凌晨两点的深城,灯火通明。
橙子小镇的七栋橙瓣大楼,现在只有6号楼还亮著灯。
「老乐?」孙元西走过来。
乐程文转过身,眼眶有些红。
「老孙,咱们从鲁省出来的时候,啥都没有,一年多,从零到一!
现在,国内第一款面向AGI场景的专用算力晶片,流片成功了!」
孙元西点点头,没有说话。
他走回办公桌,拿起那张传真,又看了一遍。
CZ—NPU200,16nm工艺,DSA架构,专为橙宝「心智核心」引擎深度优化。
砍掉了所有图形冗余单元,只保留AGI任务需要的计算单元。
128TOPS算力,25W功耗,在AGI任务处理效率上,比英伟哒同期晶片效率高30%。
他放下传真,拿起电话..
「陈总!对,验证都跑通了!」
2016年1月18日,深城,橙子巨蛋。
这个可容纳3000人的会场座无虚席。
媒体区挤满了科技记者,投资区坐著红山、高陵、淡玛锡的分析师,技术区是橙子半导体的研发骨干。
线上直播平台,观看人数突破800万。
大屏幕上,橙色的「CZ」Logo缓缓旋转,下方一行小字:橙子半导体·loT全栈晶片方案发布会。
乐程文走上舞台。
他穿著一件VC高定深灰色西装,没有打领带,头发梳得一丝不苟。
身后的大屏幕上,出现四个晶片的渲染图。
「各位,橙子半导体成立一年多,今天,我们交出第一份答卷!」
他按下遥控器,大屏幕上依次亮起四颗晶片的参数。
CZ—PMU002电源管理晶片工艺:28nm
效率:峰值97.2%
应用:手机、平板、可穿戴设备对标:TITPS65982(效率96.5%)
成本:比TI低35%
「CZ—PMU002,比上一代PMU001效率提升1.5个百分点,待机功耗降低22%,动态响应速度提升28%。
目前已经用在橙子工程机上,实测续航比上一代提升12%!」
台下响起掌声。
CZ—VS200视觉识别主控晶片工艺:40nm
算力:0.8T0PS
功耗:180mW
应用:安防摄像头、智能门锁、无人机避障对标:按森美AR0130(0.5TOPS,220mW)
「VS200,专为边缘端视觉识别设计。
人形检测、车辆检测、人脸识别,全部可以在晶片端完成,无需上传云端。
功耗比国际同类产品低18%,算力高60%。
这里的掌声更热烈了。
CZ—AFE002车规级BMS前端采集晶片工艺:28nm
采集精度:±1.2mV
均衡电流:250mA
应用:新能源汽车电池包、储能系统对标:英菲林TLE9018(±1.5mV,200mA)
「AFE002,已经通过AEC—Q100车规级认证。
采集精度比英菲林高20%,均衡电流大25%。
成本低30%。
远橙新能源的电池包,今年Q3开始全面替换。」
台下开始有人窃窃私语。
最后,乐程文深吸一口气。
「各位,下面是今天的主角。」
大屏幕上,一颗金色特效的晶片缓缓浮现。
CZ—NPU200AGI专用算力晶片工艺:16nm
算力:128TOPS(INT8)
功耗:25W
架构:DSA(特定领域架构)
适配:橙宝「心智核心」引擎深度优化对标:英伟哒同期GPU(AGI任务效率高30%,功耗低10倍)
「全球首款,为以「心智核心」为基座的通用AGI场景,深度优化的专用算力晶片。
砍掉所有图形冗余单元,只保留AGI任务需要的计算单元。
同等算力下,比英伟哒同期晶片功耗低10倍,AGI任务效率高30%。」
乐程文顿了顿,看著台下。
「CZ—NPU20O,不是CPU,不是GPU,它是NPU,一款专门为AI而生的晶片!」
全场掌声雷动,但仔细听,掌声里夹杂著疑惑的低语。
发布会结束两小时,媒体的报导陆续出炉。
《钛星媒体》:橙子半导体发布四款晶片,CZ—NPU200成焦点「128TOPS算力,25W功耗,16nm制程。
从参数上看,CZ—NPU200在AI算力上远低于英伟哒同期GPU。
英伟哒TesleP100预计2016年Q2发布,单精度浮点算力超过10TFLOPS,是CZ—NPU200
的数十倍。
橙子半导体选择了一条差异化路线...牺牲算力,换取功耗优势。
这个方向是否正确,有待市场验证!」
《电子工程专纪》:橙子IoT四芯详解,性能对标国际主流「CZ—PMU002对标TI,CZ—VS200对标按森美,CZ—AFE002对标英菲林。
从参数上看,橙子的晶片普遍比国际大厂低5—15%的性能,但成本低30—40%。
这是典型的「性价比」策略,在中低端市场有竞争力,但高端市场仍需突破!」
《半导体行业观察者》:橙子半导体的「一年答卷」
「四款晶片,一款量产,三款流片成功。
对于一个成立一年的半导体团队来说,这个速度堪称奇迹。
但必须清醒看到,橙子的晶片在性能上仍落后于国际一线大厂。
CZ—NPU200的128TOPS算力,在AGI训练场景下远远不够。
它更适合推理场景,而非训练场景。
这一定位,与橙宝AI的端侧推理」战略一致,但与云端训练」的需求还有差距!」
薇博上,网友的评论迅速分化。
「128TOPS?英伟哒的卡都是几百TOPS起步,这也好意思叫AI专用晶片?丢人!」(点赞3.2万)
「楼上懂不懂?NPU和GPU不是一回事,NPU专门跑推理,功耗低,适合端侧;英伟哒的卡跑训练强,但推理能耗比不如NPU!」(点赞1.8万)
「不管怎么说,和国际大厂比还是差远了,橙子半导体就这?」(点赞2.1万)
「成立一年,从零到四颗晶片流片,你还要怎样?」(点赞1.5万)
「之前橙子控股估值万亿,我以为多牛呢,结果晶片就这水平?」(点赞2.8万)
「楼上醒醒,是橙子控股万亿,不是橙子半导体,半导体只是其中一块!」(点赞1.
2万)
「反正挺失望的!以为橙子能搞出比肩英伟哒的东西,结果就是个低端替代品!」(点赞1.9万)
虎臭上,一篇深度分析文章标题刺眼:
《橙子半导体的「一年」:从万众期待到差强人意》
「橙子控股万亿估值的消息,把公众对橙子半导体的期待,拉到了不该有的高度。
人们以为,能撑起万亿估值的半导体业务,应该是能挑战英伟哒、高桶的。
但现实是,橙子的四颗晶片,在性能上只是对标」国际主流,而非超越」。
这不是橙子的问题,是期待的问题。
一个成立一年的半导体团队,做出四颗量产/流片晶片,已经足够优秀。
但资本市场和公众,对「橙子」这两个字的期待,远不止于此!」
加州,圣克啦啦,英伟哒总部。
黄皮衣坐在办公室里,面前的大屏幕上,是橙子半导体发布会的全程录像。
他按下暂停键,画面定格在CZ—NPU200的参数页。
「128TOPS,25W!」他喃喃道,然后看向对面的工程师:「我们的P100,现在什么进度?」
工程师推了推眼镜。
「架构定稿,下个月流片。
单精度浮点算力10.6TFLOPS,INT8算力约210TOPS。
功耗300W!
「对比呢?」
工程师沉默了两秒。
「受限于加速卡、互联带宽与MindCore生态,实效算力方面,P10O只有CZ—NPU200的1.6倍,远达不到理论上几十倍的差距!」
功耗方面,CZ—NPU200是P100的1/12。
对方基于MindCore的AGI适配程度,完全可以说CZ—NPU200因为是专为MindCore设计,不兼容其他架构,甚至可以用软体来适配硬体,可以达到接近100%。
我们只能被动适配兼容MindCore,目前约70%。」
黄皮衣沉默了很久。
「这是一场不公平的比赛!」工程师低声说:「对方唯一的优势是功耗,但他们靠著「裁判」,制定了对自己有利的规则。」
黄皮衣摇摇头。
「规则不是橙宝这个裁判定的,是市场定的,现在MindCore就是AI的通用基座,全球91%的新项目在用,凯文,我们改变不了这个事实!」
他站起身,走到窗前。
「适配!全力以赴地适配!
我们的算力优势永远在,能耗比可以慢慢优化。
最终,市场看的是总拥有成本,不是单一参数。
把P100的流片时间提前,一周内必须完成!」
工程师点头,转身出去。
黄皮衣站在窗前,看著圣克啦啦的夕阳。
橙子半导体,他记住了这个名字。
一周后,英伟哒召开全球发布会。
《英伟哒发布TesleP100:全球首款为MindCore深度优化的AGI兼容算力卡》
算力:21OTOPS(INT8)
功耗:300W
工艺:16nm
架构:Pascal,专为MindCore兼容优化亮点:支持多卡互联,单机柜可扩展至2PFLOPS算力《华尔街日报》:「英伟哒反击橙子半导体,P100算力碾压CZ—NPU200」
「在橙子半导体发布CZ—NPU20O一周后,英伟哒迅速推出竞品TesleP100。
P100的INT8算力达到210TOPS,是CZ—NPU200的1.6倍。
尽管功耗高出12倍,但在数据中心场景下,算力是更核心的指标。
英伟哒再次证明,其在AI算力领域的霸主地位不可动摇。」
国内媒体迅速跟进。
《藤迅新闻》:英伟哒P100发布,算力碾压橙子CZ—NPU200
「英伟哒CEO黄皮衣表示,P100是全球最强的AI算力卡」。
在AGI训练任务中,P100的性能是CZ—NPU200的3—5倍。
尽管功耗更高,但数据中心更看重算力密度和扩展性。
橙子半导体的「低功耗」策略,在数据中心场景下优势并不明显!」
公知们集体高潮了。
「看看,这才是真正的AI晶片,橙子那个,自娱自乐而已!」(点赞1.2万)
「128TOPS也敢叫AI晶片?英伟哒210TOPS,这才是行业标杆!」(点赞9800)
「橙子半导体投入十多亿去搞,还不如人家英伟哒一次普通的叠代。差距摆在那里,不服不行!」(点赞870)
「所以说,种花半导体还差得远,一个CZ—NPU200就吹上天,人家英伟哒一出手,直接打回原形!」(点赞1.1万)
但也有冷静的声音。
「楼上几位,P100功耗30OW,CZ—NPU200功耗才25W,你要不要算算电费?数据中心不是只看算力,还要看PUE、散热、运营成本!」(点赞340)
「P100卖多少钱?NPU200才卖多少钱?抛开价格都不说,比什么性能?」(点赞2800)
「橙子半导体成立一年多,英伟哒成立了23年,拿一个婴儿和成年人比力气,有意思吗?」(点赞4200)
但冷静的声音,被狂欢淹没了。
一周后,两份订单报告同时送到陈默的办公桌上。
第一份,来自橙子半导体中心:
意向客户名单(北美)
薇软:2000片CZ—NPU200,用于Azvre数据中心推理节点测试谷哥:1500片,用于搜索排序模型推理亚马孙:1000片,用于Alee语音助手端侧推理Facabook:800片,用于内容审核模型推理合计:5300片,意向金额约1.2亿美刀第二份,来自战略风控中心:
意向客户名单(种花)
阿狸云:5000片TesleP100,用于机器学习平台训练节点藤迅云:4000片,用于游戏AI训练白度:3000片,用于自动驾驶模型训练字节调动:2000片,用于推荐系统训练橙宝互联:3000片,用于MindCore训练集群合计:1.7万片,意向金额约3.4亿美刀陈默看著这两份报告,沉默了很久。
种花的网际网路公司,不缺电,缺算力。
训练模型需要大算力卡,P100正好满足需求。
北美的网际网路公司,不缺算力,缺电。
数据中心的电费,反而是最大的运营成本之一,CZ—NPU200的低功耗优势,在推理场景下非常明显。
陈默想清楚之后,笑了。
橙子半导体研发的CZ—NPU200,种花算力卡,最适合北美企业的需求。
英伟哒研发的P100,北美算力卡,最适合种花企业的需求。
这不是黑色幽默,是全球化分工的必然结果。
陈默放下报告,走到窗前。
所以,我们赢了还是输了?
陈默想了想。
主要还是看怎么定义赢。
如果赢是指性能第一」,那橙子半导体输了。
如果赢是指找到自己的生态位」,那橙子半导体赢了!
而且,这些北美客户的订单,说明了一个问题,CZ—NPU200有独特的价值。
不是所有场景都需要大算力,推理场景更需要低功耗。
这个推理市场,跟训练市场一样,大有可为!
陈默想清楚之后,打了个电话给周雨萌。
「告诉孙院长,订单照接!但产能要跟上,别像当年橙子5s那样,卖断货了,海丝那边的晶片反而供不上了!」
周雨萌:「明白!」
陈默一个人站在窗前,看著窗外橙子小镇的灯火。
6号楼里,孙元西的团队还在加班。
一年,四颗IoT晶片。
不算惊艳,但足够扎实,不算领先,但在市场上找到了自己的位置。
这,就是橙子半导体迈出的第一步。
(https://www.lewenn.com/lw36482/30307565.html)
1秒记住乐文小说网:www.lewenn.com。手机版阅读网址:m.lewenn.com