寒武纪完成 DeepSeek-V4 的 Day 0 适配,成为中国 AI 芯片生态的里程碑

Gate News 消息,4 月 24 日——寒武纪今日宣布,已使用其专有 NeuWare 软件生态系统和 vLLM 框架,完成了 DeepSeek-V4(DeepSeek 最新的大语言模型)的 Day 0 适配。适配代码已同步开源,标志着寒武纪连续第二次在 DeepSeek 新模型发布当天交付原生芯片支持。

为优化 DeepSeek-V4 的新颖架构,寒武纪借助其高性能 Torch-MLU-Ops 算子库,对包括 Compressor 和 mHC 在内的模块进行专门加速。公司还使用 BangC 编程语言,为诸如稀疏/压缩 Attention 和 GroupGemm 等关键算子开发了高度优化的内核,充分发挥了硬件底层能力。两家公司此前在软硬件协同优化方面的努力,已实现了行业领先的计算利用率。

DeepSeek-V4 于今日发布并开源,具备百万 token 的扩展上下文窗口、强大的 Agent 能力以及出色的推理性能。寒武纪表示,DeepSeek-V4 在寒武纪芯片上原生运行,代表了中国 AI 产业的重大里程碑。

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة من مصادر خارجية ولا تمثل آراء أو مواقف Gate. المحتوى المعروض في هذه الصفحة هو لأغراض مرجعية فقط ولا يشكّل أي نصيحة مالية أو استثمارية أو قانونية. لا تضمن Gate دقة أو اكتمال المعلومات، ولا تتحمّل أي مسؤولية عن أي خسائر ناتجة عن استخدام هذه المعلومات. تنطوي الاستثمارات في الأصول الافتراضية على مخاطر عالية وتخضع لتقلبات سعرية كبيرة. قد تخسر كامل رأس المال المستثمر. يرجى فهم المخاطر ذات الصلة فهمًا كاملًا واتخاذ قرارات مدروسة بناءً على وضعك المالي وقدرتك على تحمّل المخاطر. للتفاصيل، يرجى الرجوع إلى إخلاء المسؤولية.

مقالات ذات صلة

Meta Platforms تخطط لخفض 10% من القوى العاملة في 20 مايو، مع التأثير على ما يقرب من 8,000 وظيفة

رسالة أخبار البوابة، 24 أبريل — تخطط Meta Platforms لتقليل قوتها العاملة بحوالي 10%، مع التأثير على نحو 8,000 وظيفة، في 20 مايو. تهدف عمليات التسريح إلى تحسين الكفاءة التشغيلية مع زيادة الاستثمار في الذكاء الاصطناعي. تعكس عملية إعادة الهيكلة المخططة

GateNewsمنذ 27 د

أعلنت حكومة ترامب خطة لمكافحة إعادة تدوير الذكاء الاصطناعي، تتهم الشركات الصينية بالسرقة المنهجية لقدرات نماذج الذكاء الاصطناعي المرتبطة بالمنظومات

أدلى مساعد الرئيس لمكتب البيت الأبيض للسياسات في مجال التكنولوجيا (OSTP) مايكل جاي كراتزيوس (Michael J. Kratsios) ببيان رسمي في 23 أبريل، ذكر فيه أن حكومة ترامب لديها معلومات تُظهر أن جهات أجنبية (متمركزة أساسًا في الصين) تقوم عن قصد باستهداف شركات أمريكية كبرى في مجال الذكاء الاصطناعي، من خلال «عشرات الآلاف من حسابات الوكلاء» وأنظمة تقنيات تجاوز الحماية (jailbreak) لاستخراج قدرات نماذج الذكاء الاصطناعي الأمريكية بشكل منهجي، مع الإعلان في الوقت نفسه عن أربع تدابير لمواجهة ذلك.

MarketWhisperمنذ 50 د

أطلقت DeepSeek النسخة التجريبية المفتوحة المصدر V4، وحصلت على درجة تقنية 3206 متفوقة على GPT-5.4

DeepSeek 于 4 月 24 日正式推出 V4 预览版系列,以 MIT 许可协议开源,模型权重已同步上线 Hugging Face 及 ModelScope。根据 DeepSeek V4 技术报告,V4-Pro-Max(最高推理力度模式)在 Codeforces 基准取得 3206 分,超越 GPT-5.4。

MarketWhisperمنذ 1 س

طرحت Tencent كمصدر مفتوح Hy3 في نسخة المعاينة، وقد تحسن أداء الاختبارات القياسية للشفرة بنسبة 40% مقارنة بالإصدار السابق

أطلقت شركة Tencent في 23 أبريل بشكل رسمي نموذجًا لغويًا كبيرًا من نوع Hy3 بإصدار المعاينة المفتوح المصدر على منصات GitHub وHugging Face وModelScope، كما توفر في الوقت نفسه خدمة واجهة برمجة تطبيقات مدفوعة عبر Tencent Cloud. ووفقًا لما ذكرته Decrypt في 24 أبريل، بدأ إصدار Hy3 بإصدار المعاينة التدريب من أواخر يناير، ولم يستغرق إطلاقه أكثر من ثلاثة أشهر بحلول تاريخ النشر.

MarketWhisperمنذ 1 س

استثمارات محفظة FTX بقيمة 158 تريليون وون إذا لم تكن قد أفلتست

FTX، منصة تداول العملات الرقمية المركزية التي قدمت طلبًا لحماية الإفلاس بموجب الفصل 11 في نوفمبر 2022 بسبب نقص السيولة وتدفقات رأس المال الخارجة، كانت ستحتفظ باستثمارات بقيمة تقارب 158.796 تريليون وون إذا لم تكن قد انهارت، وفقًا لتحليل مستشهد به من قِبل Park

CryptoFrontierمنذ 1 س

小米披露 MiMo-V2-Pro 训练细节:1T 模型参数,部署数千台 GPU

Gate News 信息,4月24日——小米大型语言模型团队负责人罗富莉在一场深入采访中披露,MiMo-V2-Pro 模型总计拥有 1 万亿参数,训练所需数千台 GPU。她指出,1T 规模代表达到性能接近 Claude Opus 4.6 水平并为下一阶段 AI 代理获取具有竞争力的入场券所需的最低门槛

GateNewsمنذ 1 س
تعليق
0/400
لا توجد تعليقات