DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 宋佳楠 4月23日,北京证监局官网公布了一批罚单,对4家私募基金公司采取出具警示函行政监管举措,其中北京海纳百泉投资基金管理有限公司、乾祥海泉(北京)投资基金管理有限公司均为知名歌手胡海泉名下的私募基金公司。 对于处罚原因,北京证监局指出,乾祥海泉投资在管理、运...
9月26日,富煌钢构(002743.SZ)披露公告称,公司于当日收到证监会对公司送达的《立案告知书》,公司因涉嫌信息披露违法违规,证监会决定对公司进行立案。 富煌钢构表示,目前公司各项经营活动和业务均正常开展,在立案调查期间,公司将积极配合证监会的相关调查工作,并严格按照有关法律法规及监管要求...
界面新闻记者 赵阳戈 拟赴香港联交所上市的深圳承泰科技股份有限公司(以下简称“承泰科技”)备受市场关注。 承泰科技逾九成收入源于第一大客户客户,虽然深度绑定大客户推动了业务扩张并带来规模效应,但逐年攀升的贸易应收款项及存货规模,也加剧了公司的资金压力。加之可赎回负债的偿付与持续的...
9月25日晚,上纬新材(688585.SH)发布公告称,公司股票自2025年7月9日至9月25日期间多次触及股票交易异常波动及严重异常波动情形,最近两个交易日连续涨停。 经向上海证券交易所申请,本公司股票将于2025年9月26日(星期五)开市起停牌,自披露核查公告后复牌。这也是公司股票自7月9...
宏观要闻 六部门发文加大力度支持符合条件的优质数创企业上市融资 国家发展改革委等六部门日前联合印发《关于加强数字经济创新型企业培育的若干措施》。其中提出,鼓励金融机构结合数创企业投融资需求,按照市场化原则提供金融服务。强化创投资金引导,优化完善国有创业投资考核评价机制,探索将培育数字经济...
界面新闻记者 | 陈靖 从首次“擦肩”到角色互换的“联姻”,湘财股份与大智慧的十年纠葛,在2025年三季度收官之际迎来关键进展。 9月25日晚间,大智慧(601519.SH)披露重组报告书草案,湘财股份(600095.SH)拟换股吸收合并大智慧。湘财股份的A股换股价格为7.51元/股,大...