第394章 種花芯,更適合北美寶寶體質


  第394章 種花芯,更適合北美寶寶體質

  深城,橙子小鎮6號橙瓣大樓。

  凌晨兩點,實驗室里依然燈火通明。

  後勤早已為他們配齊了24小時食堂,可依舊沒人捨得離開工位。

  孫元西趴在辦公桌上,面前攤著厚厚一疊測試方案。

  他已經三天沒回過家,辦公桌旁備著牙刷和換洗衣物,牆角堆著幾箱沒來得及拆的速食麵。

  樂程文也好不到哪去,整個人歪靠在沙發上沉沉睡去,掌心還緊緊攥著一支筆。

  

  「嘀...嘀...」傳真機突然響起,有傳真傳了過來。

  刺耳的提示聲,把兩人同時驚醒。

  孫元西衝過去,一把扯下那張滾燙的紙。

  台機電·新竹十二廠流片結果通知項目編號:CZ—NPU200

  批次:MPW—2016—001

  結果:良率達標,功能驗證通過,電性參數符合設計預期。

  孫元西的手在發抖。

  「老樂!老樂!」他喊了一聲,聲音沙啞:「成了!提莫的真成了!」

  樂程文從沙發上彈起來,一把搶過傳真。

  他看了三遍,然後放下傳真,走到窗邊,推開窗戶。

  凌晨兩點的深城,燈火通明。

  橙子小鎮的七棟橙瓣大樓,現在只有6號樓還亮著燈。

  「老樂?」孫元西走過來。

  樂程文轉過身,眼眶有些紅。

  「老孫,咱們從魯省出來的時候,啥都沒有,一年多,從零到一!

  現在,國內第一款面向AGI場景的專用算力晶片,流片成功了!」

  孫元西點點頭,沒有說話。

  他走回辦公桌,拿起那張傳真,又看了一遍。

  CZ—NPU200,16nm工藝,DSA架構,專為橙寶「心智核心」引擎深度優化。

  砍掉了所有圖形冗餘單元,只保留AGI任務需要的計算單元。

  128TOPS算力,25W功耗,在AGI任務處理效率上,比英偉噠同期晶片效率高30%。

  他放下傳真,拿起電話..

  「陳總!對,驗證都跑通了!」

  2016年1月18日,深城,橙子巨蛋。

  這個可容納3000人的會場座無虛席。

  媒體區擠滿了科技記者,投資區坐著紅山、高陵、淡瑪錫的分析師,技術區是橙子半導體的研發骨幹。

  線上直播平台,觀看人數突破800萬。

  大屏幕上,橙色的「CZ」Logo緩緩旋轉,下方一行小字:橙子半導體·loT全棧晶片方案發布會。

  樂程文走上舞台。

  他穿著一件VC高定深灰色西裝,沒有打領帶,頭髮梳得一絲不苟。

  身後的大屏幕上,出現四個晶片的渲染圖。

  「各位,橙子半導體成立一年多,今天,我們交出第一份答卷!」

  他按下遙控器,大屏幕上依次亮起四顆晶片的參數。

  CZ—PMU002電源管理晶片工藝:28nm

  效率:峰值97.2%

  應用:手機、平板、可穿戴設備對標:TITPS65982(效率96.5%)

  成本:比TI低35%

  「CZ—PMU002,比上一代PMU001效率提升1.5個百分點,待機功耗降低22%,動態響應速度提升28%。

  目前已經用在橙子工程機上,實測續航比上一代提升12%!」

  台下響起掌聲。

  CZ—VS200視覺識別主控晶片工藝:40nm

  算力:0.8T0PS

  功耗:180mW

  應用:安防攝像頭、智能門鎖、無人機避障對標:按森美AR0130(0.5TOPS,220mW)

  「VS200,專為邊緣端視覺識別設計。

  人形檢測、車輛檢測、人臉識別,全部可以在晶片端完成,無需上傳雲端。

  功耗比國際同類產品低18%,算力高60%。

  這裡的掌聲更熱烈了。

  CZ—AFE002車規級BMS前端採集晶片工藝:28nm

  採集精度:±1.2mV

  均衡電流:250mA

  應用:新能源汽車電池包、儲能系統對標:英菲林TLE9018(±1.5mV,200mA)

  「AFE002,已經通過AEC—Q100車規級認證。

  採集精度比英菲林高20%,均衡電流大25%。

  成本低30%。

  遠橙新能源的電池包,今年Q3開始全面替換。」

  台下開始有人竊竊私語。

  最後,樂程文深吸一口氣。

  「各位,下面是今天的主角。」

  大屏幕上,一顆金色特效的晶片緩緩浮現。

  CZ—NPU200AGI專用算力晶片工藝:16nm

  算力:128TOPS(INT8)

  功耗:25W

  架構:DSA(特定領域架構)

  適配:橙寶「心智核心」引擎深度優化對標:英偉噠同期GPU(AGI任務效率高30%,功耗低10倍)

  「全球首款,為以「心智核心」為基座的通用AGI場景,深度優化的專用算力晶片。

  砍掉所有圖形冗餘單元,只保留AGI任務需要的計算單元。

  同等算力下,比英偉噠同期晶片功耗低10倍,AGI任務效率高30%。」

  樂程文頓了頓,看著台下。

  「CZ—NPU20O,不是CPU,不是GPU,它是NPU,一款專門為AI而生的晶片!」

  全場掌聲雷動,但仔細聽,掌聲里夾雜著疑惑的低語。

  發布會結束兩小時,媒體的報導陸續出爐。

  《鈦星媒體》:橙子半導體發布四款晶片,CZ—NPU200成焦點「128TOPS算力,25W功耗,16nm製程。

  從參數上看,CZ—NPU200在AI算力上遠低於英偉噠同期GPU。

  英偉噠TesleP100預計2016年Q2發布,單精度浮點算力超過10TFLOPS,是CZ—NPU200

  的數十倍。

  橙子半導體選擇了一條差異化路線...犧牲算力,換取功耗優勢。

  這個方向是否正確,有待市場驗證!」

  《電子工程專紀》:橙子IoT四芯詳解,性能對標國際主流「CZ—PMU002對標TI,CZ—VS200對標按森美,CZ—AFE002對標英菲林。

  從參數上看,橙子的晶片普遍比國際大廠低5—15%的性能,但成本低30—40%。

  這是典型的「性價比」策略,在中低端市場有競爭力,但高端市場仍需突破!」

  《半導體行業觀察者》:橙子半導體的「一年答卷」

  「四款晶片,一款量產,三款流片成功。

  對於一個成立一年的半導體團隊來說,這個速度堪稱奇蹟。

  但必須清醒看到,橙子的晶片在性能上仍落後於國際一線大廠。

  CZ—NPU200的128TOPS算力,在AGI訓練場景下遠遠不夠。

  它更適合推理場景,而非訓練場景。

  這一定位,與橙寶AI的端側推理」戰略一致,但與雲端訓練」的需求還有差距!」

  薇博上,網友的評論迅速分化。

  「128TOPS?英偉噠的卡都是幾百TOPS起步,這也好意思叫AI專用晶片?丟人!」(點讚3.2萬)

  「樓上懂不懂?NPU和GPU不是一回事,NPU專門跑推理,功耗低,適合端側;英偉噠的卡跑訓練強,但推理能耗比不如NPU!」(點讚1.8萬)

  「不管怎麼說,和國際大廠比還是差遠了,橙子半導體就這?」(點讚2.1萬)

  「成立一年,從零到四顆晶片流片,你還要怎樣?」(點讚1.5萬)

  「之前橙子控股估值萬億,我以為多牛呢,結果晶片就這水平?」(點讚2.8萬)

  「樓上醒醒,是橙子控股萬億,不是橙子半導體,半導體只是其中一塊!」(點讚1.

  2萬)

  「反正挺失望的!以為橙子能搞出比肩英偉噠的東西,結果就是個低端替代品!」(點讚1.9萬)

  虎臭上,一篇深度分析文章標題刺眼:

  《橙子半導體的「一年」:從萬眾期待到差強人意》

  「橙子控股萬億估值的消息,把公眾對橙子半導體的期待,拉到了不該有的高度。

  人們以為,能撐起萬億估值的半導體業務,應該是能挑戰英偉噠、高桶的。

  但現實是,橙子的四顆晶片,在性能上只是對標」國際主流,而非超越」。

  這不是橙子的問題,是期待的問題。

  一個成立一年的半導體團隊,做出四顆量產/流片晶片,已經足夠優秀。

  但資本市場和公眾,對「橙子」這兩個字的期待,遠不止於此!」

  加州,聖克啦啦,英偉噠總部。

  黃皮衣坐在辦公室里,面前的大屏幕上,是橙子半導體發布會的全程錄像。

  他按下暫停鍵,畫面定格在CZ—NPU200的參數頁。

  「128TOPS,25W!」他喃喃道,然後看向對面的工程師:「我們的P100,現在什麼進度?」

  工程師推了推眼鏡。

  「架構定稿,下個月流片。

  單精度浮點算力10.6TFLOPS,INT8算力約210TOPS。

  功耗300W!

  「對比呢?」

  工程師沉默了兩秒。

  「受限於加速卡、互聯帶寬與MindCore生態,實效算力方面,P10O只有CZ—NPU200的1.6倍,遠達不到理論上幾十倍的差距!」

  功耗方面,CZ—NPU200是P100的1/12。

  對方基於MindCore的AGI適配程度,完全可以說CZ—NPU200因為是專為MindCore設計,不兼容其他架構,甚至可以用軟體來適配硬體,可以達到接近100%。

  我們只能被動適配兼容MindCore,目前約70%。」

  黃皮衣沉默了很久。

  「這是一場不公平的比賽!」工程師低聲說:「對方唯一的優勢是功耗,但他們靠著「裁判」,制定了對自己有利的規則。」

  黃皮衣搖搖頭。

  「規則不是橙寶這個裁判定的,是市場定的,現在MindCore就是AI的通用基座,全球91%的新項目在用,凱文,我們改變不了這個事實!」

  他站起身,走到窗前。

  「適配!全力以赴地適配!

  我們的算力優勢永遠在,能耗比可以慢慢優化。

  最終,市場看的是總擁有成本,不是單一參數。

  把P100的流片時間提前,一周內必須完成!」

  工程師點頭,轉身出去。

  黃皮衣站在窗前,看著聖克啦啦的夕陽。

  橙子半導體,他記住了這個名字。

  一周後,英偉噠召開全球發布會。

  《英偉噠發布TesleP100:全球首款為MindCore深度優化的AGI兼容算力卡》

  算力:21OTOPS(INT8)

  功耗:300W

  工藝:16nm

  架構:Pascal,專為MindCore兼容優化亮點:支持多卡互聯,單機櫃可擴展至2PFLOPS算力《華爾街日報》:「英偉噠反擊橙子半導體,P100算力碾壓CZ—NPU200」

  「在橙子半導體發布CZ—NPU20O一周後,英偉噠迅速推出競品TesleP100。

  P100的INT8算力達到210TOPS,是CZ—NPU200的1.6倍。

  儘管功耗高出12倍,但在數據中心場景下,算力是更核心的指標。

  英偉噠再次證明,其在AI算力領域的霸主地位不可動搖。」

  國內媒體迅速跟進。

  《藤迅新聞》:英偉噠P100發布,算力碾壓橙子CZ—NPU200

  「英偉噠CEO黃皮衣表示,P100是全球最強的AI算力卡」。

  在AGI訓練任務中,P100的性能是CZ—NPU200的3—5倍。

  儘管功耗更高,但數據中心更看重算力密度和擴展性。

  橙子半導體的「低功耗」策略,在數據中心場景下優勢並不明顯!」

  公知們集體高潮了。

  「看看,這才是真正的AI晶片,橙子那個,自娛自樂而已!」(點讚1.2萬)

  「128TOPS也敢叫AI晶片?英偉噠210TOPS,這才是行業標杆!」(點讚9800)

  「橙子半導體投入十多億去搞,還不如人家英偉噠一次普通的疊代。差距擺在那裡,不服不行!」(點讚870)

  「所以說,種花半導體還差得遠,一個CZ—NPU200就吹上天,人家英偉噠一出手,直接打回原形!」(點讚1.1萬)

  但也有冷靜的聲音。

  「樓上幾位,P100功耗30OW,CZ—NPU200功耗才25W,你要不要算算電費?數據中心不是只看算力,還要看PUE、散熱、運營成本!」(點讚340)

  「P100賣多少錢?NPU200才賣多少錢?拋開價格都不說,比什麼性能?」(點讚2800)

  「橙子半導體成立一年多,英偉噠成立了23年,拿一個嬰兒和成年人比力氣,有意思嗎?」(點讚4200)

  但冷靜的聲音,被狂歡淹沒了。

  一周後,兩份訂單報告同時送到陳默的辦公桌上。

  第一份,來自橙子半導體中心:

  意向客戶名單(北美)

  薇軟:2000片CZ—NPU200,用於Azvre數據中心推理節點測試谷哥:1500片,用於搜索排序模型推理亞馬孫:1000片,用於Alee語音助手端側推理Facabook:800片,用於內容審核模型推理合計:5300片,意向金額約1.2億美刀第二份,來自戰略風控中心:

  意向客戶名單(種花)

  阿狸云:5000片TesleP100,用於機器學習平台訓練節點藤迅云:4000片,用於遊戲AI訓練白度:3000片,用於自動駕駛模型訓練字節調動:2000片,用於推薦系統訓練橙寶互聯:3000片,用於MindCore訓練集群合計:1.7萬片,意向金額約3.4億美刀陳默看著這兩份報告,沉默了很久。

  種花的網際網路公司,不缺電,缺算力。

  訓練模型需要大算力卡,P100正好滿足需求。

  北美的網際網路公司,不缺算力,缺電。

  數據中心的電費,反而是最大的運營成本之一,CZ—NPU200的低功耗優勢,在推理場景下非常明顯。

  陳默想清楚之後,笑了。

  橙子半導體研發的CZ—NPU200,種花算力卡,最適合北美企業的需求。

  英偉噠研發的P100,北美算力卡,最適合種花企業的需求。

  這不是黑色幽默,是全球化分工的必然結果。

  陳默放下報告,走到窗前。

  所以,我們贏了還是輸了?

  陳默想了想。

  主要還是看怎麼定義贏。

  如果贏是指性能第一」,那橙子半導體輸了。

  如果贏是指找到自己的生態位」,那橙子半導體贏了!

  而且,這些北美客戶的訂單,說明了一個問題,CZ—NPU200有獨特的價值。

  不是所有場景都需要大算力,推理場景更需要低功耗。

  這個推理市場,跟訓練市場一樣,大有可為!

  陳默想清楚之後,打了個電話給周雨萌。

  「告訴孫院長,訂單照接!但產能要跟上,別像當年橙子5s那樣,賣斷貨了,海絲那邊的晶片反而供不上了!」

  周雨萌:「明白!」

  陳默一個人站在窗前,看著窗外橙子小鎮的燈火。

  6號樓里,孫元西的團隊還在加班。

  一年,四顆IoT晶片。

  不算驚艷,但足夠紮實,不算領先,但在市場上找到了自己的位置。

  這,就是橙子半導體邁出的第一步。


章節目錄