在国庆节前夕,DeepSeek和智谱先后宣布推出新一代大模型。与此同时 ,国产芯片厂商都在第一时间宣布适配,这标志着国产GPU已具备与前沿大模型协同迭代的能力,加速构建自主可控的AI技术生态 。
9月29日 ,DeepSeek宣布开源DeepSeek-V3.2-Exp实验版模型,该模型首次引入了Attention稀疏注意力架构,并在几乎不影响模型输出效果的前提下 ,大幅度提升了长文本训练和推理效率,被DeepSeek定义为“迈向新一代架构的中间步骤”。
华为、寒武纪 、海光已经完成适配DeepSeek-V3.2-Exp实验版模型
在DeepSeek宣布后,算力芯片厂商华为、寒武纪(688256)、海光信息(688041)等AI芯片厂商已经宣布适配DeepSeek-V3.2-Exp。
“华为计算”公众号发文宣布 ,昇腾已快速基于vLLM/SGLang等推理框架完成适配部署,实现DeepSeek-V3.2-Exp Day 0(第零天)支持,并面向开发者开源所有推理代码和算子实现 。DeepSeek-V3.2-Exp在昇腾设备上128K长序列输出 ,能够保持TTFT(首token输出耗时)低于2秒 、TPOT(每token输出耗时)低于30毫秒的推理生成速度。
在DeepSeek-V3.2-Exp模型宣布开源几分钟内,寒武纪也发文称其已同步实现对该模型的Day 0适配,并开源大模型推理引擎vLLM-MLU源代码。
寒武纪称,公司一直高度重视大模型软件生态建设 ,支持以DeepSeek为代表的所有主流开源大模型 。借助于长期活跃的生态建设和技术积累,寒武纪得以快速实现对DeepSeek-V3.2-Exp这一全新实验性模型架构的day 0适配和优化。
寒武纪强调,一直重视芯片和算法的联合创新 ,致力于以软硬件协同的方式,优化大模型部署性能,降低部署成本。此前 ,寒武纪对DeepSeek系列模型进行了深入的软硬件协同性能优化,达成了业界领先的算力利用率水平 。
针对本次的DeepSeek-V3.2-Exp新模型架构,寒武纪通过Triton算子开发实现了快速适配 ,利用BangC融合算子开发实现了极致性能优化,并基于计算与通信的并行策略,再次达成了业界领先的计算效率水平。依托DeepSeek-V3.2-Exp带来的全新DeepSeek Sparse Attention机制 ,叠加寒武纪的极致计算效率,可大幅降低长序列场景下的训推成本,共同为客户提供极具竞争力的软硬件解决方案。
海光信息也宣布其DCU实现无缝适配+深度调优,做到大模型算力“零等待 ”部署 。
海光信息表示 ,在“深算智能”战略引领下,海光信息始终致力于AI软件栈生态建设,全面支持以DeepSeek为主流的全球主流开源大模型。得益于长期、活跃的技术积累 ,海光DCU得以快速对DeepSeek-V3.2-Exp完成“Day0”级高效适配与优化。
基于GPGPU架构强大的生态优势,与编程开发软件栈DIK的特性,DeepSeek-V3.2-Exp在海光DCU上展现出优异的性能 ,充分验证海光DCU高通用性、高生态兼容度及自主可控的技术优势,已成为支撑AI大模型训练与推理的关键基础设施。
DeepSeek表示,得益于新模型服务成本的大幅降低 ,官方API价格也相应下调,开发者调用DeepSeek API的成本将降低50%以上 。从价格来看,输入缓存命中从0.5元降至0.2元/百万tokens ,缓存未命中从4元降至2元/百万tokens,输出由12元降至3元/百万tokens。
寒武纪和摩尔线程宣布适配智谱新一代大模型 GLM-4.6
9月30日,智谱正式发布并开源新一代大模型 GLM-4.6,在 Agentic Coding等核心能力上实现大幅跃升。这是继 DeepSeek-V3.2-Exp 与 Claude Sonnet 4.5 之后 ,国庆节前业界的又一重大技术发布 。
智谱表示,在公开基准测试和真实编程任务中,GLM-4.6的代码生成能力已全面对齐Claude Sonnet 4 ,成为目前国内最强的Coding模型。同时,模型在长上下文处理 、推理能力、信息检索、文本生成及智能体应用等方面均实现全面升级,整体性能超越DeepSeek-V3.2-Exp。作为开源模型 ,GLM-4.6目前是全球开源生态中性能最强的通用大模型之一,进一步提升了国产大模型在全球竞争格局中的地位 。
智谱官方宣布,GLM-4.6 已在寒武纪领先的国产 AI 芯片上实现 FP8+Int4 混合量化推理部署 ,这也是首次在国产芯片上投产的 FP8+Int4 模型-芯片一体化解决方案。在保持模型精度不变的前提下,该方案大幅降低了推理成本,为国产芯片本地化运行大模型提供了可行路径和示范意义。
与此同时 ,摩尔线程基于 vLLM 推理框架完成了对GLM-4.6 的适配,新一代GPU可在原生 FP8 精度下稳定运行模型,充分验证了MUSA 架构及全功能GPU在生态兼容性和快速适配能力方面的优势 。
华为 、寒武纪、摩尔线程等芯片厂商完成对新一代前沿大模型的适配,这标志着国产GPU已具备与前沿大模型协同迭代的能力 ,加速构建自主可控的AI技术生态。
智谱表示,未来,国产原创的GLM系列大模型与国产芯片的深度协同 ,将在模型训练和推理环节持续推动性能与效率的双重优化,构建更加开放、可控 、高效的人工智能基础设施。
截至30日收盘,寒武纪报收1325元 ,微涨0.11%;海光信息报收252.6元,跌1.27% 。
股票配资网平台网址:配资炒股网站选择配资-国产芯片再迎利好!智谱发布新一代大模型 全面适配寒武纪和摩尔线程芯片!
配资平台在线咨询:股票买入6种委托方式详解-外交部和中国驻日本使领馆提醒中国公民近期避免前往日本
杠杆配资官网:炒股票用什么手机好-DeepSeek:UE8M0 FP8是针对即将发布的下一代国产芯片设计
股票己开户怎样在手机上交易:股票买入6种委托方式详解-暴跌23%!日本铠侠暴雷带崩全行业 存储热潮要凉了吗?
股票杠杆十倍:股票开户那家手续费低-DeepSeek“带飞”国产算力板块 寒武纪市值超5000亿元 摩尔线程已支持FP8
股票配资网站行情:炒股票什么叫杠杆-大利好 存储芯片+机器人概念 精智达创出历史新高!
美港通证券-美港通证券官网-配资平台排名提示:文章来自网络,不代表本站观点。
美港通证券-美港通证券官网-配资平台排名㉖致力于股票配资服务多年,我们凭借卓越的服务质量和专业的团队,跻身全国前10。
文丨财联社积极响应证监会一揽子“活跃举措”,券商在行动!8月21日,中信证券、国泰君安资管、招商...
截至2025年3月24日午间收盘,A500ETF易方达(159361)收涨0.10%,半日成交额已达8.64亿元,换手率...
文丨中信建投此次证监会召开座谈会主要围绕“中长期资金参与资本市场”这一主题展开。虽然我国中长期资金参与资...
文/吴治邦3月24日早盘,在2024年年底压哨实施完毕重整计划的*ST花王股价继续跌停。自2025年1月...
记者辛圆3月25日,博鳌亚洲论坛旗舰报告《亚洲经济前景及一体化进程2025年度报告》(以下简称《报告》...
3月7日,互联网保险优选平台蚂蚁保公布了2024年健康险理赔数据:其合作保司全年通过蚂蚁保平台累计向健康险在保用户赔付9...
3月24日,业内权威专家表示,MLF(中期借贷便利)不再有统一的中标利率,标志着MLF利率的政策属性完全退出。3月24日...
界面新闻记者|吕文琦在资本市场持续升温下,保险中介机构又开启了新一轮上市潮。2025年开年以来,手回...
宏观要闻2025年国内生产总值增长预期目标为5%左右国务院总理李强周三在政府工作报告中提出,今年发展主要...
界面新闻记者|邹文榕信托增资潮又有回暖迹象。3月2日,陕国投A(000563.SZ)公告定增预案,拟...
记者|张乔遇近日,香港联交所新增游戏公司星邦互娱的IPO申请,保荐机构为中金公司。星邦互娱的历史...
宏观要闻市场监管总局发布《公平竞争审查条例实施办法》市场监管总局发布《公平竞争审查条例实施办法》,将于4...
【隔夜行情】•周四(2025年3月20日),A股三大指数集体回调,截至收盘,上证综指跌0.51%,报3408.9...
3月20日,深海科技概念持续走高,巨力索具、神开股份直线拉升涨停,走出6连板,海默科技、大连重工、赛福天、亚星锚链等十余...
记者辛圆给补贴、建平台,为了吸引更多高层次人才,各地纷纷放出“大招”。据央广网周一发布消息,湖...