Gate News 消息,4 月 24 日——DeepSeek V4-Pro 和 DeepSeek V4-Flash 于 4 月 24 日正式发布,并开源,背景处理长度已从 128K 大幅扩展至 1M,代表近 10 倍的容量提升。华为计算宣布其 Ascend 超算节点产品通过芯片与模型技术的紧密协作,已对 DeepSeek V4 系列模型实现完全支持。
华为 Ascend 950 通过融合算子内核与多流并行技术,实现高吞吐、低延迟的 DeepSeek V4 模型推理部署,以降低 Attention 计算与内存访问的开销。对于输入 8K 的 DeepSeek V4-Pro,Ascend 950 实现约 20ms TPOT、单卡 Decode 吞吐量 4,700 TPS;对于输入 8K 的 DeepSeek V4-Flash,达到约 10ms TPOT,吞吐量为 1,600 TPS。Ascend A3 超算节点系列同样实现完全兼容,并提供训练参考实现以便快速微调。基于采用大 EP 模式的 Ascend A3 64 卡超算节点,借助 vLLM 推理引擎,在 8K/1K 输入输出场景下,DeepSeek V4-Flash 的单卡 Decode 吞吐量超过 2,000 TPS。华为全系 Ascend A2、A3 和 950 产品线均支持 DeepSeek V4-Flash 与 V4-Pro。
华为云宣布与 DeepSeek V4 的先发兼容,借助其 MaaS 平台,为开发者提供一键式 API 令牌服务。华为云优化系统层、算子层和集群层能力,以确保快速模型适配与高性能部署。包括金山 WPS 和 360 在内的企业已通过华为云集成了 DeepSeek 的新模型。
燚微(Cambricon)也宣布基于 vLLM 推理框架实现 DeepSeek V4-Flash 与 V4-Pro 的 Day 0 兼容,并将适配代码开源给 GitHub 社区。Cambricon 此前在去年 DeepSeek V3.2 发布时也已实现先发适配,得益于其在 DeepSeek 系列模型上开展了深度的软件-硬件协同性能优化。
免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見
聲明。
相關文章
Elon Musk 的 xAI 將更名為 SpaceXAI,作為獨立公司身分終止
根據 Odaily,Elon Musk 宣布 xAI 將更名為 SpaceXAI,因為該公司將不再以獨立實體的方式運作。
GateNews28分鐘前
IBM 在 Think 2026 以新的基於代理的工具擴充企業 AI 套件
根據 IBM 公司的說法,該公司在波士頓舉行的 Think 2026 會議上宣布擴展其企業 AI 能力,推出新的基於代理的工具,協助組織將人工智慧嵌入日常運作。Context Studio 現已全面提供,讓企業能夠
GateNews36分鐘前
Hut 8 股份因 98 億美元 AI 資料中心租約上漲 30%
Hut 8 股價在一則關於 98 億美元 AI 數據中心租賃協議的消息傳出後大幅跳漲超過 30%。這家比特幣礦企正在擴展至 AI 基礎設施,並透過位於德州的長期超大規模(hyperscale)合約進行布局。
AI 基礎設施擴張
該合約包含可能使總量增加的選項,其中包括
Crypto Frontier49分鐘前
Anthropic 推 Claude Dreams:Agent 在工作之間自整理記憶、消除重複與矛盾
Anthropic 在 Code with Claude 大會公布 Dreams,讓 Claude Managed Agents 在多場會話間自動整理記憶、消除重複與矛盾、更新陳舊條目,輸出可審核的整理後記憶庫;輸入上限為 100 個 session 與 4,096 字元,非同步執行,數分鐘至數十分鐘完成,支援串流觀察。研究預覽需申請,暫只支援 claude-opus-4-7 與 claude-sonnet-4-6,正式上市未定。
鏈新聞abmedia3小時前
Anthropic 接 SpaceX 算力:拿下 Colossus 1 整座 22 萬 GPU、Claude 解除限額
Anthropic 宣布與 SpaceX 就 Colossus 1 資料中心達成算力合作,將動用逾22萬顆 Nvidia GPU、300MW以上容量,預計一個月內全部部署供 Anthropic 使用,提升 Claude、Code 的運算與體驗。同步放寬 Pro/Max/Team/Enterprise 的每5小時用量上限、取消尖峰限額,並提高 Opus API 速率;亞洲歐洲基礎設施同步擴張,未來另有「軌道 AI 計算」等意向,尚未成約。
鏈新聞abmedia4小時前