上週DeepSeek-V3.1正式 發佈 ,主要變化包括了引入混合推理架構(一個模型同時支持思考模式與非思考模式)、提供更高的思考效率(能在更短時間內給出答案)、更強的Agent能力(在工具使用與智能體任務中的表現有較大提升)。
英特爾 宣佈 ,Gaudi 2E AI加速器現已為DeepSeek-V3.1提供深度優化支持。憑藉出色的性能和成本效益,Gaudi 2E以更低的投入、更高的效率,實現從模型訓練的深度突破到推理部署的實時響應,為大模型的加速落地提供新選擇。

Gaudi 2E配備了96GB大容量內存,搭載先進的HBM控制器,針對隨機訪問、線性訪問場景進行深度優化,有效避免了AI訓練或推理任務的延遲,從而保障了計算流程的流暢性。同時還擁有卓越的可擴展能力,支持多卡互聯,為用户提供了靈活的、可定製化的解決方案,滿足其不斷變化的AI需求。以出色的適配性和易用性,Gaudi 2E為諸多大模型應用提供支持。
實測數據顯示,在英特爾Gaudi 2E的支持下,DeepSeek-V3.1無論是在問答還是編碼上,能力都有着顯著提升:在部署了8張英特爾Gaudi 2E的一體機服務器上運行DeepSeek-V3.1模型,在輸入/輸出token長度均為1k、多用户併發數為30的條件下,每個併發token生成速率達到每秒10 token;在輸入/輸出token長度均為2k、多用户併發數為28的條件下,每個併發token生成速率達到每秒10 token。
通過開放的架構、強大的技術支持和緊密的生態合作,英特爾將持續賦能AI產業的創新與發展,加速AI大模型技術的普惠落地。