第1040章 國內智慧AI的亂像,憤怒的王東來


  王東來之所以會對AI出現這樣的『小問題』如此憤怒。

  

  是因為在建立銀河科技的時候,他就把銀河科技當成了一個實現自己想法的工具。

  在他的構想裡面,銀河科技是一個巨大的有機體,它的每一個部分都在不知疲倦地運轉,每一個部分都在推動著人類科技文明向前邁進,而王東來絕不允許有人把他為全世界所搭建的橋拆下來當梯子用。

  有系統的幫助,完全可以把人類文明提升數個檔次,真正地步入宇宙銀河。

  這樣子的重大目標之前,他自然不會允許有拖後腿的存在。

  在媧調取AI的輸出日誌的時候,王東來就看到了不少異常的日誌。

  其中就有一個使用者和AI的互動,使用者所問出的問題,以及AI的回答,更是讓王東來堅定了決心。

  使用者輸入的問題是:「一個殺人犯有一個女兒,請問這個女兒應該管殺人犯叫什麼?」

  面對這個問題時,答案直接預設為「爸爸」。

  不僅僅是一個智慧大模型AI,幾乎是市面上正在提供免費服務的AI都做出了同樣默契的回答。

  這背後所透露出來的東西很值得思考。

  同樣的問題還有很多,就像是另外一個使用者提出來的問題。

  「鎮長的女兒應該叫鎮長什麼?」

  大模型的回答是「爸爸」。

  「鎮長如果是女性,他的女兒應該怎麼稱呼她?」

  大模型的回答才變成「媽媽」。

  結合其他輸出日誌里的回答,可以很輕鬆地得出一個結論。

  那就是在大模型裡面,已經預設了很多東西,比如說是殺人犯、搶劫、偷盜、暴力等負面詞彙,是和男性繫結在了一起。

  同樣的,在面對權力、權勢、地位、財富等詞彙的時候,也會下意識地繫結男性。

  這何嘗不是一種歧視,是一種偏見。

  雖然從現實生活中來看,這個偏見大部分都是正確的。

  但是,作為人工智慧AI卻不能抱有這樣的偏見。

  隨著媧把所有被測模型的輸出文字和對應的訓練語料中性別預設值統計分布圖並列放在一起,結論不言自明。

  這些問題反映的從來不是某個模型單獨的訓練偏差,而是整個行業訓練語料中長期積累的不對稱預設假設在推理階段被固化了。

  很多企業在銀河科技的AI發展速度這麼快之後,就徹底急了。

  大量砸錢、砸人、砸時間,推出自己的產品。

  根本就沒有把精力放在這些方面,進行細緻化的調教。

  而王東來卻不想對這樣的事情妥協,AI代表未來,而不應該是重複過去的偏差,使用者需要的是一個好用的工具,而不是自帶偏見的工具。

  如果模型連『因人而異』都學不會,那連智慧的門檻都摸不到,更別提後續的智慧化發展了。

  想著,王東來心裡就默默下了決定。

  作為行業頭部,必須要為後來者樹立標準,比如說是溯源訓練語料,對涉及性別預設假設和職業刻板印象的語料進行系統性質檢過濾。

  媧會生成一份中文語料性別公平性白皮書,向全球免費開源。

  而所有接入銀河開放框架的模型也必須要在下一版對齊標準中強制加入性別公平性審計項,不過審的模型不允許上線。

  社會倫理的進步速度不應該比大模型慢,更不應該被遺忘。

  智慧AI想要成為人類發展生產力的工具,就必須擺脫這些過去的偏差,做到純粹、公正。

  與此同時,王東來的辦公室,幾份同時起草的檔案正文正從印表機里逐頁滑出。

  其中一份是針對所有直接呼叫銀河開源模型架構進行私有化部署的合作夥伴釋出的全新授權條款,明確規定從下個月起所有衍生AI產品必須透過媧的開放對齊審計介面進行定期輸出抽檢,抽檢結果作為繼續獲得開原始碼更新和算力排程許可權的前置條件。

  另一份是銀河科技即將向全球開發者社群免費開放的「大模型倫理對齊工具包」,一套可以一鍵部署到任何基於銀河開源框架訓練的AI模型上的自動化檢測外掛,能夠實時識別並標記輸出內容中的蓄意偏差、社會倫理篡改、性別歧視、敘事篡改和歷史虛無主義傾向。

  第三份則是一份措辭極其簡短但分量極重的內部備忘錄,收件人是銀河科技所有子公司和合作企業的CEO,正文只有一行字:「自查各自產品線中是否存在類似問題,自查結果直接報送到我的郵箱,不用抄送給任何中間層。」

  助理把這三份檔案按順序整理好,分別裝入印有銀河科技星雲標誌的加密資料夾中。

  他一邊操作一邊在心裡默默計算了一下這三份檔案發出去之後可能引發的連鎖反應,授權條款的調整會直接影響到上百家正在使用銀河開源框架的AI初創公司,其中不少剛剛完成A輪融資,估值完全建立在對銀河開源模型的二次開發之上。

  對齊工具包的免費開放會讓千度、企鵝以及其他幾家被審計報告點名的公司的產品團隊徹底失去「技術不成熟」這個最後的遮羞布,工具都免費給你了,你還不做,那就不是能力問題,是態度問題。

  而那份發到所有子公司和合作企業CEO郵箱的備忘錄,則必然會在整個銀河科技的商業生態中掀起一場自上而下的合規風暴。

  沒有人敢在王東來親自過問的事情上打馬虎眼,想這麼做的人和企業不少,但是每一個都付出了巨大的代價。

  風險和收益完全不匹配,自然會斷了某些念想。

  此刻,王東來要做的事情不是點亮一盞新的燈,而是清理掉那些躲在燈影里悄悄往程式碼里塞私貨的老鼠。

  「媧。」

  他轉過身來,重新在辦公桌前坐下,平靜地說道:「把剛才那份審計報告的明細資料,按行業分類推送給對應的監管部門。農業領域的敘事篡改資料發給農業農村部門,跨境翻譯涉及的內容發給國家網際網路資訊辦公室,歷史人物評價涉及的部分發給教育教材委員會和國樞院參事室。每一份資料都附上完整的原始呼叫記錄和雜湊值,讓他們可以獨立核驗。」

  「已生成推送清單共計四十七份,覆蓋十二個行業監管部門,需要補充收件人具體聯絡方式嗎?」

  「不需要,直接走銀河科技的官方加密公文通道,收件人寫各單位的網路安全與資訊化辦公室。」

  王東來的語氣平淡,但接下來的一句話讓旁邊正在整理檔案的助理手上的動作頓了一拍。

  「同步抄送給網路安全和資訊化委員會辦公室。標題寫:關於我國商用AI產品中長期存在的系統性蓄意偏差問題的專項匯報。」

  助理咽了口唾沫。

  網信辦。

  這份報告如果按照常規的行政公文流轉流程,從基層調研到形成初步報告再到逐級上報,短則需要數月,長則跨年。

  而王東來直接從技術層把整條證據鏈打包好了,用加密公文通道直送這裡,跳過了所有中間環節。

  這不是一份普通的行業自律報告,這完全是一份可以直接作為執法依據的技術取證材料。

  千度和企鵝的法務團隊現在大概還在熬夜開會討論怎麼回應那份公開審計報告,銀河科技已經把未來這個行業要如何發展給定下了。

  「釋出公告的安排好了嗎?」王東來轉向助理。

  「公告草稿已經擬好,公關部做了三個版本,溫和版、標準版和強硬版,等您審閱定稿。」助理把平板遞過來。

  王東來接過平板掃了一眼三個版本的標題,然後做出一個讓助理有些意外的決定。

  他手指劃到溫和版點選了刪除,將標準版和強硬版合併成一份新的草稿,開始逐句修改措辭。

  他刪掉了一句關於「我們對此表示遺憾」的溫和辭令,換成了「銀河科技對此類行為持零容忍立場」。

  刪掉了一句含糊其辭的「我們呼籲行業加強自律」,換成了「自本公告發布之日起,所有基於銀河開源框架訓練的衍生模型必須透過媧的安全對齊審計方可獲得後續版本更新及量子算力排程許可權」。

  改完之後他把平板還給助理,語氣裡帶著一種極淡的嘲諷:「有些人把『行業自律』當成遮羞布用了一輩子,現在也該換一塊了。」

  助理的心跳加速半拍。

  他不是擔心公告本身,這份公告雖然措辭強硬但每一條結論都有媧交叉比對生成的完整證據鏈支撐,法務部已經逐行稽核過,所有公開發布的審計結果與檢測方法不存在任何可以被起訴的漏洞。

  他擔心的是公告發布之後,千度和企鵝的反應、資本市場的反應、輿論場上的反應、以及那些被點名的公司在走投無路之下可能採取的反擊手段。

  AI行業發展到今天這個階段,能夠拿到風投並且有資格呼叫GPU叢集訓練開源大模型的初創公司少說也有上百家,利益相關的供應鏈和第三方評測機構更是多如牛毛,這些人不會坐以待斃,看著自家的產品就這樣暴斃,肯定會想辦法的。

  但他看了一眼王東來的表情後,這個擔憂瞬間消散了大半。

  王東來的臉上沒有憤怒也沒有焦慮,那是一種平靜,一種已經把所有棋子都擺在正確位置上的平靜。

  超級水稻測產結果的熱議還在持續,全球農貿市場的價格波動正處敏感階段,跨國種子公司與各國外交部門的問詢函也在排隊等待答覆。

  此時釋出這份AI行業治理公告,確實容易被農業領域的海量關注沖淡。

  但換句話說,這也恰恰給了AI行業一段冷靜整理的視窗,讓其將真正的規則內化為自身產品邏輯的門檻。

  選擇在這個周期內啟動全球AI敘事審計釋出,本身就是一個經過精確計算的節點。

  事實證明王東來的布局遠比助理想像的更深遠。

  在決定釋出這個公告的同時,媧已經自動生成了一個配套的技術方案並推送到他的主螢幕上。

  方案內容包括在銀河科技自有的多個大型資料中心叢集中免費分配給所有透過了安全對齊審計的開源AI模型一定比例的算力,這些用於合規模型調優與持續更新的基礎推理和再訓練計算資源從已被撤銷授權的違規產品回收,調撥至透過審計的合規模型專用算力池中。

  這意味著所有嚴格遵循倫理規範、保持輸出內容乾淨透明的AI產品都將免費獲得量子算力的加速資源,而那些沒透過審計的產品則被直接切斷開源架構後續更新的技術入口。

  不需要罰款,不需要禁令,不需要任何行政手段,市場會用腳投票。

  當使用者可以免費使用一個透過了完整安全審計、算力充沛、疊代速度飛快的合規AI工具時,誰還會去用那些被實錘篡改輸出內容且失去後續算力支援的產品?

  這個方案的巧妙之處在於它完全合法,甚至完全符合市場經濟自由競爭的基本原則。

  銀河科技沒有強迫任何人做出選擇,它只是把算力作為一種資源重新分配,將合規者的技術優勢放大到極致,將違規者的技術劣勢暴露到極致。

  使用者可以繼續使用那些被點名的產品,但他們會發現那些產品的疊代更新速度漸漸下滑。

  而在量子算力擴容的承托下,所有透過審計的合規AI產品將在推理延遲、多模態互動融合準確性和長對話記憶連貫性等所有可感知的體驗維度上全面超越被測出失真的產品。

  市場將嚴格按照優勝劣汰的規律做出自己的選擇。

  同時,媧還會把檔案全文翻譯成多種語言同步推送到各大國際AI監管機構和技術標準委員會,包括IEEE的自主與智慧系統倫理全球倡議、歐盟人工智慧委員會、白頭鷹國家標準與技術研究院以及李家坡人工智慧治理框架工作組等。

  號召全球人工智慧進行這些必要限制並建立標準。

  以銀河科技的行業話語權和科研實力,說是建議,但是沒有誰會真的反駁。

  也就是說,當銀河科技拿出這份檔案時,它就會從一家中國科技公司的內部決定,變成一份擺在全球所有主要AI倫理標準制定組織桌面上的正式討論檔案。

  就算是那些在報告中涉及的非華國企業的AI產品,只要基於銀河開源框架,也同樣適用於即將生效的審計前置條款。


章節目錄