DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 张熹珑 广东是国内与日本贸易规模最大的省份,面向日本的贸易持续保持高增长。 6月12日-13日,广东省人民政府主办的“日本企业广东行”上,68个项目落地,总金额1166亿元,其中27个项目现场签约,签约金额达1034.64亿元,涵盖汽车、生物医药和健康、低空经济、人工智...
界面新闻记者 | 曾令俊 中信信托副总经理戴家凯重返广发银行董事会。 9月25日,广发银行发布的公告显示,该行于9月23日召开的2025年第三次临时股东大会审议通过了《关于选举戴家凯先生为广发银行股份有限公司...
界面新闻记者 | 周芳颖界面新闻编辑 | 许悦 妮维雅想要靠新品精华向高端美妆的门槛爬一爬。 近期,德国化妆品集团拜尔斯道夫在2025财年第二季度财报会上表示,在中国,该公司采取了大胆举措,重塑妮维雅品牌,使其从价格敏感的个人护理领域转向高端护肤品领域,并通过数字化优先的策略实现增长。这...
界面新闻记者 | 李科文界面新闻编辑 | 谢欣 当地时间9月25日,美国总统特朗普在其社交媒体平台“真实社交”发文称,自10月1日起将对“所有任何品牌(Branded)或已获专利(Patented)的药品”征收100%的关税。 特朗普补充称,这一措施不适用于在美国建设药品生产厂的药企。豁...
界面新闻记者 | 赵阳戈 近日,普冉股份(688766.SH)启动对半导体企业SHM(SkyHigh Memory Limited)的收购计划,引发市场高度关注。该交易采取“先参股后并购”的分步操作,通过设立不足一年的诺亚长天作为境内收购平台,逐步实现控股这家注册于中国香港的SHM公司...
9月25日晚,奥维通信股份有限公司(以下简称“ST奥维”,002231.SZ)公告称,公司通过中国执行信息公开网查询到,公司控股股东、实际控制人的一致行动人上海东和欣新材料集团有限公司被上海市松江区人民法院列为失信被执行人。截至2025年6月30日,上海东和欣及其关联方仍有1.86亿元资金占用款尚未...