DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 朱咏玲界面新闻编辑 | 许悦 9月1日,国货彩妆品牌花知晓宣布完成B轮融资,由珀莱雅独家投资,池杉资本担任长期独家财务顾问。此次融资将用于品牌全球化扩张、供应链整合与内容创新等方向。 花知晓母公司深圳花知晓电子商务有限公司(以下简称“花知晓”)的工商信息已经发生变更。珀...
当地时间9月26日消息,美联储理事莉萨·库克敦促最高法院阻止美国总统特朗普将其解职,称解职将严重破坏美联储的独立性,使其“沦为总统意志的附庸”。 据《国会山报》报道,库克的律师在提交的文件中表示,如果允许特朗普将其解职,将动摇美国市场与经济赖以发展的制度基础。 特朗普上月指控库克涉嫌房贷欺诈,理...
在2025云栖大会上,阿里巴巴旗下企业服务品牌瓴羊发布企业级AI智能体服务平台瓴羊AgentOne。目前,AgentOne针对数据密集、资金密集、人力密集的核心场景,已“上岗”超过20种企业级Agent,企业可以自主使用。...
记者 张一诺 2025年是“十四五”规划收官之年,下半年经济运行对全年目标任务实现及中长期发展布局具有重要影响。 今年三季度以来,受极端天气、稳增长政策节奏、外部环境等多重因素影响,中国经济增长动能有所下降。分析人士指出,四季度有望出台一揽子新措施推动经济回升向好,核心是财政加力...
界面新闻记者 赵阳戈 特种光纤企业武汉长进光子技术股份有限公司(以下简称“长进光子”)提交科创板IPO申请,计划募资额为7.8亿元,引发市场关注。实控人李进延是华中科技大学博士研究生导师,于今年5月正式全职加入公司。 长进光子依托高校资源,在特种光纤领域实现关键技术突破。然而,公...
9月27日,合众新能源(哪吒汽车实体公司)管理人发布公告称,截至意向重整投资人报名截止日,已有一家意向重整投资人按要求提交完整报名材料并缴纳报名保证金人民币5000万元。 由于仅一家意向重整投资人按要求完成报名工作,后续将不再进入重整投资人遴选程序,但该意向重整投资人需向管理人提交符合法律规定...