DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
当地时间9月26日,伊朗最高国家安全委员会秘书阿里·拉里贾尼表示,如果“快速恢复制裁”机制被执行,伊朗将停止与国际原子能机构的合作。 拉里贾尼警告美国总统特朗普不要采取军事行动,他表示伊朗绝不会屈服。他强调伊朗从未打算制造核武器,但美国和以色列的攻击使谈判沦为一场可笑的闹剧。(央视新闻)...
界面新闻记者 赵阳戈 拟赴香港联交所上市的深圳承泰科技股份有限公司(以下简称“承泰科技”)备受市场关注。 承泰科技逾九成收入源于第一大客户客户,虽然深度绑定大客户推动了业务扩张并带来规模效应,但逐年攀升的贸易应收款项及存货规模,也加剧了公司的资金压力。加之可赎回负债的偿付与持续的...
界面新闻记者 赵阳戈 特种光纤企业武汉长进光子技术股份有限公司(以下简称“长进光子”)提交科创板IPO申请,计划募资额为7.8亿元,引发市场关注。实控人李进延是华中科技大学博士研究生导师,于今年5月正式全职加入公司。 长进光子依托高校资源,在特种光纤领域实现关键技术突破。然而,公...
2025年9月26日,最高人民检察院发布刑罚变更执行监督典型案例,其中河南一名被判刑16年的贪污犯,凭借精心策划的尿毒症、严重心脏病等虚假诊断,长达四年非法逍遥于监外。该起案件最后有9名狱警因犯徇私舞弊暂予监外执行罪获刑。 案例显示,罪犯郝某某,男,1966年10月出生,户籍所在地河南省漯河市...
界面新闻记者 | 肖芳界面新闻编辑 | 文姝琪 从去年就在寻找新故事的爱奇艺,又看中了线下娱乐业。 在2025爱奇艺iJOY秋季悦享会上,爱奇艺创始人、首席执行官龚宇在演讲中明确,线下业务未来将是爱奇艺的核心...
界面新闻记者 | 周芳颖界面新闻编辑 | 许悦 妮维雅想要靠新品精华向高端美妆的门槛爬一爬。 近期,德国化妆品集团拜尔斯道夫在2025财年第二季度财报会上表示,在中国,该公司采取了大胆举措,重塑妮维雅品牌,使其从价格敏感的个人护理领域转向高端护肤品领域,并通过数字化优先的策略实现增长。这...