第411章 幻傳承和創新
=本文內容純屬個人猜想,僅供參考=
=增量數據卡尺和減量數據卡尺=
增量數據和減量數據,本身就是一種源文件+增量和減量和修改數據日誌的方式來記錄。
本身就是對數據的每一次改動和注釋,都可追溯。
比如:
sto55.🎉co🌸m提醒你可以閱讀最新章節啦
某地星期一,西紅柿的售價是5元每斤;西瓜的售價是10元每斤;胡蘿蔔的售價是2元每斤。
到了星期二,價格有所改變,西紅柿變成了3元每斤(記為星期一西紅柿價格-2元每斤=星期二西紅柿價格);西瓜變成9元每斤(記為星期一西瓜價格-1元每斤=星期二西瓜價格);胡蘿蔔變成3元每斤(記為星期一胡蘿蔔價格+1元每斤=星期二胡蘿蔔價格)。
也就是說,當一個大數據,只有一部分有改動,改動只要沒有達到百分之五十兼或設定值,那麼就只能以日誌的方式來存儲,避免需要兩個三個資料庫硬體,一個資料庫硬體為源文件資料庫,一個資料庫硬體為日誌改動資料庫,還有一個資料庫為結果資料庫,當用源文件+日誌=結果資料庫的方式,把結果資料庫作為源文件資料庫,那麼就能夠當做新的源文件資料庫,這對於不需要調用歷史數據的資料庫很方便,然而對於需要調用歷史資料庫的數據,就很成問題。
特別是相互關聯數據的調用,這也就導致一個包含100年時間1ZB數據中,可能需要調用的,只是其中特定10年的1GB數據,這就導致了無端的解壓縮過程中的硬體調用資源浪費,也就是非要把所有數據都解壓縮成壓縮前文件,才能應用,那麼問題來了,物理考古學家,需要特定10年的物理當時的科研數據,生物考古學家,需要特定100年的生物當時的科研數據,古語言學家需要調用20年當時的語言數據,而物理數據包含在一個100年時間1ZB數據中,生物數據包含在一個1000年1024ZB數據中,語言數據包含在一個5000年4096ZB數據中,怎麼弄?
全部都全網在單機,每個使用者對應一個超級電腦用於解壓縮,然後索引需要用到的內容?
70億個使用者呢?是不是需要建造70億個超級電腦硬體啊?
特別是有很多歷史變遷問題,比如10年前,某個學科專有名詞的學術名是A,10年後,該學科專有名詞的學術名是B,然後每隔一段時間,學術名都有改變,突然一下去找100年前,這個學術名,那就麻煩了。
學科用大數據的應用,如果只考慮到當代使用,很容易就解決,可能最多需要3個超級電腦就足以應對,可是如果面對的是時間跨度可能需要百萬年的古生物研究呢?地球考古學研究呢?歷史新聞研究呢?會面對什麼問題?
還有一種問題,那就是語言是一種主觀存在,包含的含義,在每一代可能都有偏差,比如流氓一詞,可能某些詞義沒有被編寫進入字典中,沒有編入辭典中,就被後來人當做通假字論了,還不排除有的寫書的人,本身喜歡另闢蹊徑,自己創造一些詞語組合,也不排除創作者詞不達意。
這也就導致,搜索可能需要完全展開整個資料庫的所有內容都變成最終的未壓縮版本,這是剛性需求,特別是使用者使用模糊搜索兼或用未來的術語來搜索歷史上的術語。
然而隨著數據採集越來越精密,很多全息數據,都可以大到沒邊,把無限大+無限大+無限大的數據,都聚集到資料庫中,能用很小的存儲硬體來存儲可以解壓縮成為無損數據來使用,然而解壓縮時,硬體不足怎麼辦?航線太空飛行器,在飛行過程中,百分之八十都被隕石擊穿,而又沒有足夠的資源來修復,而又急需用歷史數據來找到某個問題的參考答案?怎麼弄?無參考答案的去創新方法來解決?
當參考答案沒有變質,沒有過期,那麼參考答案就是寶貝,多多益善;當參考答案變質了,過期了,不適合當下和當前環境了,那麼參考答案就是垃圾,還不如就地創新,還浪費了觀看者的時間去了解並不適用的參考答案。
越是歷史久遠的文明,越容易累死在對歷史的繼承上,米國需要繼承的歷史很短,就100年,用不了1年時間就能講明白,中國需要繼承的歷史很長,上下5000年,可能需要用20年都不一定足以講明白。
打仗都知道需要有輕騎兵,需要有重騎兵,怎麼說呢?中國就是有太多的歷史傳承,導致如同重騎兵一樣,尾大不掉,當護甲(歷史)有用時,護甲是個大寶貝,當護甲(歷史)沒用時,護甲是個大累贅。
米國的現狀是什麼?歷史一窮二白,沒有幾千代的創業可以繼承,所以一個個成了現實主義者,一個個成為了群體急性子,必須創新,不創新就是空白。
中國的現狀是什麼?歷史豐富多彩,有幾千代的創業可以繼承,所以一個個成了博大精深者,一個個成了群體慢性子,不是一定需要創新,不創新就照抄歷史,大不了交白卷。
中國創新難,不是因為中國文化什麼的不行,而是因為需要學的東西太多太多,而這些東西之中,有重點,有非重點,可以抓重點,然而不能只抓重點,為什麼有捨得的說法?因為中國的傳承之博大精深,導致了不可能樣樣全,不可能樣樣會,所以需要有放棄的傳承,也有需要堅持的傳承。