Gate News 消息,4 月 24 日——DeepSeek V4-Pro 和 DeepSeek V4-Flash 于 4 月 24 日正式发布,并开源,背景处理长度已从 128K 大幅扩展至 1M,代表近 10 倍的容量提升。华为计算宣布其 Ascend 超算节点产品通过芯片与模型技术的紧密协作,已对 DeepSeek V4 系列模型实现完全支持。
华为 Ascend 950 通过融合算子内核与多流并行技术,实现高吞吐、低延迟的 DeepSeek V4 模型推理部署,以降低 Attention 计算与内存访问的开销。对于输入 8K 的 DeepSeek V4-Pro,Ascend 950 实现约 20ms TPOT、单卡 Decode 吞吐量 4,700 TPS;对于输入 8K 的 DeepSeek V4-Flash,达到约 10ms TPOT,吞吐量为 1,600 TPS。Ascend A3 超算节点系列同样实现完全兼容,并提供训练参考实现以便快速微调。基于采用大 EP 模式的 Ascend A3 64 卡超算节点,借助 vLLM 推理引擎,在 8K/1K 输入输出场景下,DeepSeek V4-Flash 的单卡 Decode 吞吐量超过 2,000 TPS。华为全系 Ascend A2、A3 和 950 产品线均支持 DeepSeek V4-Flash 与 V4-Pro。
华为云宣布与 DeepSeek V4 的先发兼容,借助其 MaaS 平台,为开发者提供一键式 API 令牌服务。华为云优化系统层、算子层和集群层能力,以确保快速模型适配与高性能部署。包括金山 WPS 和 360 在内的企业已通过华为云集成了 DeepSeek 的新模型。
燚微(Cambricon)也宣布基于 vLLM 推理框架实现 DeepSeek V4-Flash 与 V4-Pro 的 Day 0 兼容,并将适配代码开源给 GitHub 社区。Cambricon 此前在去年 DeepSeek V3.2 发布时也已实现先发适配,得益于其在 DeepSeek 系列模型上开展了深度的软件-硬件协同性能优化。
免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見
聲明。
相關文章
Google 計劃向 Anthropic 投資最高 $40 十億美元,承諾 5+ 吉瓦的運算算力
快訊,4月24日——根據市場消息人士稱,Google 計劃向 Anthropic 投資最高 $40 十億美元。此次投資將以初始 $10 十億美元現金開始,之後還將在達成指定里程碑的前提下,追加最高 $30 十億美元。
Google 也將作為合作的一部分,至少提供 Anthropic 5 吉瓦的運算算力。
GateNews16分鐘前
瑞士監管機構 FINMA 警告:Anthropic 的 Mythos AI 工具 具金融風險
Gate 新聞訊息,4 月 24 日——瑞士金融市場監管局 (FINMA) 表示,允許銀行快速且便捷地採用 Anthropic 的人工智慧工具 Mythos,將對金融體系構成嚴重風險。
GateNews39分鐘前
Fere AI 完成由 Ethereal Ventures 領投的 130 萬美元融資
Gate News 訊息,4月24日——Fere AI,一個由人工智慧驅動的數位資產交易代理平台,宣布完成一輪由 Ethereal Ventures 領投的 130 萬美元融資,並有 Galaxy Vision Hill 與 Kosmos Ventures 參與。
該平台支援跨鏈網路,包括 Ethereum,
GateNews1小時前
Anthropic 在品質下降後回滾 Claude Code 變更;所有修復已完成
Gate News 訊息,4 月 24 日——Anthropic 已承認近期 Claude Code 的品質下降,並確認所有相關問題已透過回滾與修復解決。這些問題源於 4 月初至 4 月中之間所進行的三項產品與提示詞調整。
在 3 月 4 日,
GateNews3小時前
NeoSoul 联合创始人 Kaelan:AI 行业应当允许“玩具”存在,创新往往从实验性产品开始
Gate News 消息,4 月 24 日——在近期香港一场关于智能加密金融的论坛上,NeoSoul 联合创始人 Kaelan 分享了其对如何在早期、快速演进的 AI 行业中评估 AI 项目的见解。除了评估现有产品之外,团队还必须展现出能够跟上底层模型能力变化的能力,他表示。
GateNews3小時前
Meta 將在多年期、數十億美元交易中部署數千萬顆 AWS Graviton5 晶片
Gate News 消息,4 月 24 日——Meta 已與 Amazon Web Services 簽署一份多年期協議,將部署數千萬顆 Graviton5 處理器用於其 AI 基礎設施,使 Meta 成為全球 AWS 最大的 Graviton 客戶之一。該交易涵蓋三到五年,價值達數十億美元,據 AWS 副總裁 Nafea Bshara 所述。
GateNews4小時前