Gate News 消息,4 月 24 日——DeepSeek V4-Pro 和 DeepSeek V4-Flash 于 4 月 24 日正式发布,并开源,背景处理长度已从 128K 大幅扩展至 1M,代表近 10 倍的容量提升。华为计算宣布其 Ascend 超算节点产品通过芯片与模型技术的紧密协作,已对 DeepSeek V4 系列模型实现完全支持。
华为 Ascend 950 通过融合算子内核与多流并行技术,实现高吞吐、低延迟的 DeepSeek V4 模型推理部署,以降低 Attention 计算与内存访问的开销。对于输入 8K 的 DeepSeek V4-Pro,Ascend 950 实现约 20ms TPOT、单卡 Decode 吞吐量 4,700 TPS;对于输入 8K 的 DeepSeek V4-Flash,达到约 10ms TPOT,吞吐量为 1,600 TPS。Ascend A3 超算节点系列同样实现完全兼容,并提供训练参考实现以便快速微调。基于采用大 EP 模式的 Ascend A3 64 卡超算节点,借助 vLLM 推理引擎,在 8K/1K 输入输出场景下,DeepSeek V4-Flash 的单卡 Decode 吞吐量超过 2,000 TPS。华为全系 Ascend A2、A3 和 950 产品线均支持 DeepSeek V4-Flash 与 V4-Pro。
华为云宣布与 DeepSeek V4 的先发兼容,借助其 MaaS 平台,为开发者提供一键式 API 令牌服务。华为云优化系统层、算子层和集群层能力,以确保快速模型适配与高性能部署。包括金山 WPS 和 360 在内的企业已通过华为云集成了 DeepSeek 的新模型。
燚微(Cambricon)也宣布基于 vLLM 推理框架实现 DeepSeek V4-Flash 与 V4-Pro 的 Day 0 兼容,并将适配代码开源给 GitHub 社区。Cambricon 此前在去年 DeepSeek V3.2 发布时也已实现先发适配,得益于其在 DeepSeek 系列模型上开展了深度的软件-硬件协同性能优化。
免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見
聲明。
相關文章
AI 平台 Certifyde 於 5 月 1 日完成 200 萬美元種子輪融資,由 Ripple 執行長 Brad Garlinghouse 背書
根據 TechfundingNews,AI 應用平台 Certifyde 於 5 月 1 日完成一輪 200 萬美元的種子輪融資。投資方包括 K5 Global、Flamingo Capital,以及天使投資人,包括 Honey 的聯合創辦人 George Ruan、Ripple 執行長 Brad Garlinghouse,以及 Nutra 的聯合創辦人 Roland
GateNews19分鐘前
Pentagon 科技長:Anthropic 仍黑名單、Mythos 例外處理
美國國防部科技長(Pentagon technology chief)5 月 1 日對國會表示,「Anthropic 仍在黑名單上,但 Mythos Preview 是另一個議題」,正式承認國防部對 Anthropic 主品牌與其新模型 Mythos 採取區別對待。此一表態與 4 月 19 日 Axios 揭露 NSA(國家安全局)已實際使用 Mythos 形成呼應,並正式確立「Mythos 例外管道」的政策走向—同時也意味國防部曾在法庭上主張使用 Anthropic 工具會威脅國安,與當前實質做法形成法律論述上的內部矛盾。
Anthropic vs Pentagon
鏈新聞abmedia59分鐘前
137 Ventures 在新資金中完成 $700M ,管理資產(AUM)達到 150 億美元
根據 ChainCatcher,早期投資 SpaceX 的 137 Ventures 近期完成了兩檔新基金的募資,總額超過 7 億美元,將其管理資產提高至超過 150 億美元。這筆新資本將用於投資 AI 代理、機器人以及太空推進
GateNews1小時前
Reddit 第 16% 飆升,因 Q2 展望強勁;蘋果面臨 Mac 缺貨,因 AI 需求超過供應
Reddit 的股價在週五美股開盤前上漲 16%,原因是該公司發布了高於預期的未來一季營收展望。日活躍訪客成長 17% 至 1.268 億,且全球每位用戶平均營收跳升 44%,由 AI 驅動
GateNews1小時前
美國國防部與包含 OpenAI、Google 和 Microsoft 在內的 7 家 AI 公司達成協議
根據美國國防部的說法,該機構今日(5 月 1 日)與七家領先的人工智慧公司簽署協議:SpaceX、OpenAI、Google、Nvidia、Reflection、Microsoft 以及 Amazon Web Services(AWS)。這些協議旨在加速軍事轉型並建立
GateNews1小時前
Datavault AI 與 King Mining Capital 合作,推出 $150M Gold 代幣化計畫
根據 Businesswire,5 月 1 日,納斯達克上市的 Datavault AI 宣布與 King Mining Capital 建立策略夥伴關係,推出名為 GoldVault 的黃金代幣化計畫,規模超過 1.5 億美元。依據該協議,Datavault AI 將收購 King Mining Capital 5% 的股權,並且
GateNews1小時前