NeuralMesh

WEKA 憑藉 NeuralMesh 上的 Augmented Memory Grid 衝破 AI 記憶體屏障

突破性記憶體擴充套件技術經 Oracle Cloud Infrastructure 驗證,實現推論普及化,為 NeuralMesh 客戶帶來 1000 倍記憶體容量,首個 Token 生成時間加快 20 倍

聖路易斯和加州坎貝爾2025年11月20日 /美通社/ — 於 SC25 大會上:AI 儲存公司 WEKA今日宣佈,正式於 NeuralMesh™ 上推出 Augmented Memory Grid™(增強記憶體網格)。這項革命性的記憶體擴充套件技術,旨在解決窒礙 AI 創新的根本樽頸:GPU 記憶體。該技術已在 Oracle Cloud Infrastructure (OCI) 及其他領先的 AI 雲端平臺上透過驗證,能將 GPU 記憶體容量大幅擴充套件 1000 倍(由 GB 級提升至 PB 級),同時將首個 Token 生成時間縮短高達 20 倍。這項突破賦能 AI 開發者最佳化長文字推理和代理式 AI 的工作流程,顯著提升以往難以擴充套件的推論工作負載效率。

WEKA 的突破性 Augmented Memory Grid 現已於 NeuralMesh 上正式推出。
WEKA 的突破性 Augmented Memory Grid 現已於 NeuralMesh 上正式推出。

從創新到投產:解決 AI 記憶體牆難題
自 NVIDIA GTC 2025 亮相以來,Augmented Memory Grid 已在包括 OCI 在內的領先 AI 雲端生產環境中,經過嚴格的強化、測試與驗證。結果證實了早期測試的預期:隨著 AI 系統演進至更長、更複雜的互動——從程式碼編寫助手到研究助理及推理代理——記憶體已成為限制推論效能與經濟效益的關鍵樽頸。

「我們正推出一個經 Oracle Cloud Infrastructure 及其他領先 AI 基礎設施平臺驗證的成熟解決方案。」WEKA 聯合創始人兼行政總裁 Liran Zvibel 表示,「擴充套件代理式 AI 不僅取決於原始運算力,更在於透過智慧資料路徑來解決記憶體牆問題。Augmented Memory Grid 讓客戶能在每個 GPU 上執行更多 Token,支援更多並發使用者,並為長文字工作負載解鎖全新的服務模式。OCI 的裸機基礎設施配合高效能 RDMA 網路及 GPUDirect Storage 功能,使其成為大規模加速推論的獨特平臺。」

現今的推論系統面臨一項根本限制:GPU 高頻寬記憶體 (HBM) 速度極快但容量有限,而系統 DRAM 雖空間較大但頻寬不足。一旦這兩層記憶體飽和,鍵值快取資料便會被清除,迫使 GPU 重新運算已處理過的 Token,造成運算週期、電力與時間的浪費。

WEKA 的 Augmented Memory Grid 透過在 GPU 記憶體(通常是 HBM)與快閃儲存之間建立高速橋樑,成功突破 GPU 記憶體牆。它利用 RDMA 及 NVIDIA Magnum IO GPUDirect Storage 技術,在 GPU 記憶體與 WEKA 的 Token 倉庫之間持續傳輸鍵值快取資料,從而達致記憶體級別的速度。這讓大型語言模型及代理式 AI 模型能夠存取更多語境資訊,無需重新運算先前的 KV Cache 或已生成的 Token,大幅提升效率與可擴充套件性。

經 OCI 驗證的效能與生態系統整合
獨立測試(包括在 OCI 上的驗證)已確認以下成果:

  • KV Cache 容量增加 1000 倍,同時保持接近記憶體的效能。
  • 在處理 128,000 個 Token 時,相較於重新運算預填充階段,首個 Token 生成時間加快 20 倍
  • 在八節點叢集中錄得 750 萬次讀取 IOP100 萬次寫入 IOP

對於 AI 雲端供應商、模型供應商及企業 AI 開發者而言,這些效能提升從根本上改變了推論的經濟效益。透過消除多餘的預填充操作並維持高快取命中率,機構可最大化租戶密度,減少閒置 GPU 週期,並顯著提高每千瓦時的投資回報率 (ROI)。模型供應商現可具成本效益地提供長文字模型服務,大幅削減輸入 Token 成本,並圍繞持久、具狀態的 AI 會話建立全新商業模式。

本次正式商用反映了 WEKA 與 NVIDIA 及 Oracle 等領先 AI 基礎設施夥伴的深度合作。該解決方案與 NVIDIA GPUDirect Storage、 NVIDIA DynamoNVIDIA NIXL 緊密整合,WEKA 更為 NVIDIA Inference Transfer Library (NIXL) 開源了一個專用外掛。OCI 的裸機 GPU 運算配合 RDMA 網路及 NVIDIA GPUDirect Storage 功能,提供了 WEKA 所需的高效能基礎,確保在雲端 AI 部署中提供效能毫不妥協的 Augmented Memory Grid。

「大規模推論的經濟性是企業的重要考量。」Oracle 雲端基礎架構多雲端副總裁 Nathan Thomas 表示,「WEKA 的 Augmented Memory Grid 正面迎擊了這一挑戰。我們在 OCI 聯合測試中錄得首個 Token 生成時間加快 20 倍的提升,這不僅是效能指標,更從根本上重塑了執行 AI 工作負載的成本結構。對我們的客戶而言,這意味著部署下一代 AI 將變得更簡單、更具成本效益。」

正式商用資訊
Augmented Memory Grid 現已作為 NeuralMesh 部署的一項功能正式推出,並已上架 Oracle Cloud Marketplace,未來將支援更多雲端平臺。

有意部署 Augmented Memory Grid 的機構,請瀏覽 WEKA 的 Augmented Memory Grid 頁面,以瞭解更多解決方案詳情及資格標準。

關於 WEKA
WEKA 憑藉其智慧、適應性網狀儲存系統 NeuralMesh™,正在變革機構建立、執行和擴充套件 AI 工作流程的方式。傳統的資料基礎設施會隨著工作負載擴充套件而變得更慢、更脆弱,與此不同,NeuralMesh 會隨著規模擴充套件而變得更快、更強、更高效,動態適應 AI 環境,為企業級 AI 和代理式 AI 創新提供靈活的基礎。NeuralMesh 深受 30% 的《財富》50 強企業信賴,幫助領先企業、AI 雲端服務供應商和 AI 開發者最佳化 GPU、加速擴充套件 AI 並降低創新成本。如欲瞭解更多,請瀏覽 www.weka.io 或追蹤我們的 LinkedInX

WEKA 和 W 標誌乃 WekaIO, Inc. 的註冊商標,而此處其他商品名稱可能是其各自擁有人的商標。

WEKA:企業人工智慧的基礎
WEKA:企業人工智慧的基礎

 

⚠️ 重要提醒: 如果 Oracle Cloud Infrastructure 的驗證不充分或宣告沒有充分的證據支援,可能會面臨虛假廣告的指控。確保所有宣告都準確且有據可查。

WEKA 宣佈推出為 NVIDIA BlueField-4 打造的全新 NeuralMesh 架構

革命性平臺設計標誌著 AI 基礎設施的重大演進,消除傳統 CPU 需求,同時為企業級 AI 工廠提供突破性的效能密度、線性擴充套件能力和卓越的電源效率

華盛頓及加州坎貝爾2025年10月30日 /美通社/ — 2025 年華盛頓 GTC 大會訊息:WEKA 宣佈,正為 NVIDIA 新發布的 BlueField-4 資料處理單元 (DPU) 開發下一代 WEKA® NeuralMesh™ 智慧儲存系統,此舉標誌著 AI 基礎設施架構與部署方式的革命性轉變。這種突破性方法無需獨立的 CPU 伺服器,而是利用 NVIDIA BlueField-4 史無前例的 800 Gb/s 網路頻寬和 6 倍的運算效能提升,提供了 WEKA 行政總裁 Liran Zvibel 譽為「未來 AI 資料基礎設施的完美基石」。

WEKA 宣佈推出為 NVIDIA BlueField-4 打造的全新 NeuralMesh 架構
WEKA 宣佈推出為 NVIDIA BlueField-4 打造的全新 NeuralMesh 架構

重新構想 AI 基礎設施架構
新一代 WEKA NeuralMesh 儲存軟體將不再部署於帶有獨立 CPU 的傳統伺服器上,而是直接執行於 NVIDIA BlueField-4,從根本上簡化 AI 基礎設施的部署,同時顯著提升經濟效益、效能和電源效率。這一架構轉變代表了 WEKA 迄今為止與 NVIDIA 基礎設施路線圖及 AI 資料中心願景的最重要契合。

現代 AI 基礎設施的完美配搭
NVIDIA BlueField-4 帶來了可程式設計基礎設施、加速功能、零信任安全以及強大的網路能力,與 NeuralMesh 基於微服務的網狀架構無縫結合。當與 NVIDIA 最新的加速運算平臺結合時,BlueField-4 和 NeuralMesh 為超大規模 AI 工廠建立統一、高效的基礎。

「AI 的急速發展需要能夠以前所未有的效率適應和擴充套件的智慧資料基礎設施。」WEKA 聯合創辦人兼行政總裁 Liran Zvibel 表示,「WEKA 為 NVIDIA BlueField-4 打造的 NeuralMesh 架構是一次巨大的飛躍,為下一代 AI 工廠提供了基礎儲存。」

「AI 推理和其他推理工作負載的需求,需要一個全新的資料基礎設施基礎——此基礎能統一運算、網路和儲存,以實現前所未有效率和規模。」NVIDIA 企業產品副總裁 Justin Boitano 表示,「透過與 NVIDIA BlueField-4 的整合,WEKA 的 NeuralMesh 儲存系統支援這一架構轉型,為超大規模 AI 工廠中高效的資料處理提供動力。」

BlueField-4 驅動架構的優勢
基於 BlueField-4 的 WEKA 下一代 NeuralMesh 儲存系統將提供:

  • 卓越的電源效率:為代理式 AI 工作流程帶來超過 100 倍的每瓦特詞元提升
  • 簡化基礎架構:無需專用的獨立 CPU 儲存伺服器,降低複雜性並減少佔用空間。
  • 更佳的經濟效益:整合運算、網路和儲存功能,大幅降低基礎設施成本。
  • 更強的效能:利用 BlueField-4 的 800 Gb/s 網路和 6 倍運算效能提升,實現無與倫比的資料傳輸速度。
  • 無縫整合:與 NVIDIA 的基礎設施路線圖和 AI 工廠架構保持一致。
  • 零信任安全:透過 NVIDIA DOCA™ 軟體框架,內建安全加速功能並以線路速率實現租戶隔離。

為推理時代而設的協作
WEKA 與 NVIDIA 已有近十年的緊密合作,範圍涵蓋 NVIDIA AI Enterprise 軟體、WEKA 榮獲多項 NVIDIA 認證,以及在 NVIDIA 新技術發布上的協作。基於 BlueField-4 的 NeuralMesh 儲存軟體,代表了 WEKA 迄今為止與 NVIDIA 技術最深度的整合。

「電源效率是實現超大規模 AI 工廠上線的關鍵。」WEKA 策略總監 Nilesh Patel 表示,「NVIDIA BlueField-4 和 WEKA 的 NeuralMesh 儲存軟體將直接應對這一挑戰,在不影響效能、規模或營運簡易性的前提下,提供突破性的每瓦特詞元效率。我們視 NeuralMesh 與 BlueField-4 的整合為一個策略增長引擎,能為我們的客戶簡化並加速企業級 AI 工廠的部署。」

上市時間與後續步驟
WEKA 正積極為 NVIDIA BlueField-4 開發下一代 NeuralMesh 軟體版本,詳細的路線圖資訊將於 2026 年初與客戶和合作夥伴分享。有意深入瞭解 WEKA NeuralMesh 架構的機構,可直接聯絡 WEKA 或瀏覽 www.weka.io。 

關於 WEKA
WEKA 憑藉其智慧、適應性網狀儲存系統 WEKA® NeuralMesh™,正在變革機構建立、執行和擴充套件 AI 工作流程的方式。傳統的資料基礎設施會隨著工作負載擴充套件而變得更慢、更脆弱,與此不同,NeuralMesh 會隨著規模擴充套件而變得更快、更強、更高效,與 AI 環境同步動態增長,為企業級 AI 和代理式 AI 創新提供靈活的基礎。NeuralMesh 深受 30% 的《財富》50 強企業信賴,幫助領先企業、AI 雲端服務供應商和 AI 開發者最佳化其 GPU、加速擴充套件 AI 並降低創新成本。如欲瞭解更多,請瀏覽 www.weka.io 或追蹤我們的 LinkedInX

WEKA 和 W 標誌乃 WekaIO, Inc. 的註冊商標,而此處其他商品名稱可能是其各自擁有人的商標。 

WEKA:企業人工智慧的基礎
WEKA:企業人工智慧的基礎

 

⚠️ 重要提醒: 1. 未經驗證的效能聲稱可能導致法律訴訟或監管機構的罰款。2. 虛假廣告可能損害公司聲譽。3. 未能遵守資料隱私法規可能導致嚴重的法律後果。