數據中心小零件釀大危機 不明故障頻生 歸咎晶片太複雜
原文刊於信報財經新聞「StartupBeat創科鬥室」
數據中心支撐全球科網運作,但任何高科技設備中的零部件都可能存在技術失誤,而且往往要在爆出嚴重事故後,隱藏漏洞才會浮現。美國《紐約時報》報道,近年雲端網絡龐大複雜,不少巨企擔心數據中心伺服器的晶片不夠可靠,隨時引發不明硬件故障,甚至釀成大規模系統癱瘓。
Google年均4%伺服器意外關機
《紐約時報》引述史丹福大學一位電機工程師Subhasish Mitra指出,大型科網平台系統故障,問題較多出於伺服器硬件運作錯誤,而根源來自底層硬件,包括晶片。
早於2015年,工程界權威刊物IEEE Spectrum引述一份研究報告提到,Google數以百萬計伺服器硬件中,每年平均有4%因一些無法偵測的錯誤而意外關機。
報告提到,在一枚擁有數十億個晶體管的微處理器或電腦記憶體中,每一個可以儲存0和1(電腦最原始基本語言)的微型開關(Tiny Switches),只要出現任何微小錯誤,都足以拖垮每秒執行數十億次運算的電腦系統。社交平台Facebook有研究員認為,微型開關愈來愈容易磨損,令電腦記憶體及處理器的壽命比以前更短。
一直以來,設計電腦的科學家都希望透過添加特殊電路,偵測及自動修正不良數據。然而,Google近年接報一些難以診斷的硬件錯誤,部分只會在某些特定條件下,例如運算速度或溫度產生變化時出現。研究人員相信,這跟處理器設計愈見複雜、晶體管愈趨細小,以及廠方測試不足等因素有關。
助測錯誤監控軟件需求飆
美國晶片商超微半導體(AMD)前年的一份報告,認為DDR4記憶體晶片的可靠程度反而比起上一代的DDR3產品差5.5倍。電腦製造商聯想(00992)曾告知客戶,美國晶片生產商英特爾(Intel)新一代處理器可能比上代產品暗藏更多難以修正的錯誤。
針對硬件錯誤漸趨頻繁,《紐約時報》指出,一些能夠監控晶片健康狀況和硬件錯誤的新型軟件,需求大大增加。此外,英特爾已啟動一個新項目,透過開源軟件協助數據中心營運商,偵測和修正晶片電路未偵測的硬件錯誤,並且改變處理器的設計。
支持EJ Tech
如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們。
Related Posts
Latest News
-
「衞星蛋」救命神器(林國誠)
天通衞星移動系統在香港已經投入使用,令到衞星通訊技術不再僅限於專業用途,而是能夠廣泛於日常生活中應用。這個系統由3顆衞星覆蓋亞洲的大部分地區,從而提供穩定可靠的通訊網絡。
- Posted October 4, 2024
- 0
-
非牟利組織的發展抉擇(黃岳永)
港人對平安鐘應該不會感到陌生,早於「社會企業」這個概念普及之前,平安鐘就已經把商業模式與公益結合起來,創造出一個可持續發展的模式。
- Posted October 4, 2024
- 0
-
Microsoft office|2024 更新支援5年
微軟(Microsoft)為消費者及小型企業推出家用版及商務版的辦公室軟件Office 2024,其中包含Word、Excel、PowerPoint、OneNote及其他應用程式;至於錯誤修復及安全更新,將支援5年至2029年10月9日,適合不欲訂閱Microsoft 365版本的用戶。
- Posted October 4, 2024
- 0
-
黑夜見光|美全彩夜視鏡眾籌 漆黑取景光猛鮮艷
美國初創公司Duovox推出兩款輕巧的夜視產品,兩者均採用專有「真全彩技術」,標榜具備99.99%色彩準確度。新產品現於Indiegogo網站眾籌,售價99美元(約772港元)起,預計今年12月起發貨。
- Posted October 4, 2024
- 0
-
國產遊戲|AK-47代金箍棒 《悟空》變射擊game
中國首款3A遊戲《黑神話:悟空》爆紅,不少玩家抱怨關卡難度高,一直無法順利通關。最近有內地機迷開發遊戲模組(MOD),以「AK-47」步槍取代「如意金箍棒」,適合遠距離對付各種妖怪,令玩家戰敗機會大減。
- Posted October 4, 2024
- 0
-
智能眼鏡掃臉起底 美生研AI即時配對
最近朱克伯格的兩名大學師弟青出於藍,把智能眼鏡配合人臉辨識技術,數秒內配對網上數碼足跡,成功把街上陌生人「起底」,包括姓名、年齡、電話號碼、住所地址及親屬資訊,令人擔心人工智能(AI)侵犯私隱。
- Posted October 4, 2024
- 0
-
Microsoft Copilot|你的智能 AI 夥伴 助你提升工作與學習效率
Microsoft 推出的 Copilot,這個具人性化的 AI 夥伴,為我們重新定義工作與學習方式。Copilot 不僅能夠提升工作效率,還能幫助人們更好地管理日常生活。
- Posted October 3, 2024
- 0