DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 朱咏玲界面新闻编辑 | 许悦 9月1日,国货彩妆品牌花知晓宣布完成B轮融资,由珀莱雅独家投资,池杉资本担任长期独家财务顾问。此次融资将用于品牌全球化扩张、供应链整合与内容创新等方向。 花知晓母公司深圳花知晓电子商务有限公司(以下简称“花知晓”)的工商信息已经发生变更。珀...
商务部:对墨西哥相关涉华限制措施进行贸易投资壁垒调查 商务部9月25日发布公告,商务部获得的初步证据和信息显示,根据墨西哥《国会公报》2025年9月9日刊登的关于调整多项进口税的提案,墨西哥政府拟对中国等非自贸伙伴的产品提高进口关税税率,该措施将严重损害中国企业的贸易投资利益。依据《中华人民共...
9月10日,广州富力地产(02777.HK)发布公告,鉴于公司整体经营现状,公司拟初步为公司境内公司债券持有人提供整体境内债券重组方案,包括现金购回、以物抵债、应收账款信托份额抵债、资产信托份额抵债、股票经济收益权兑付和全额留债长展期,具体如下: (一)现金购回:公司拟对债券分三次进行折价(每...
9月26日,神奇制药(600613.SH)公告,公司于9月26日收到上海证监局出具的《关于对上海神奇制药投资管理股份有限公司采取责令改正措施并对ZHANG TAO TAO、冯斌、陈之勉采取出具警示函措施的决定》(下称《决定书》)。 《决定书》显示,经查,神奇制药存在以下违规事项:2023年,公...
界面新闻记者 | 马越界面新闻编辑 | 牙韩翔 百利食品在北交所的IPO进程进入关键阶段。根据公告信息,9月22日百利食品通过了广东证监局的IPO辅导验收,以及向北京证券交易所报送了向不特定合格投资者公开发行股票并上市的申报材料。 普通消费者对于百利食品还很陌生,是因为它的产品大多数藏在...
四部门:对纯电动乘用车实施出口许可证管理 为促进新能源汽车贸易健康发展,依据《中华人民共和国对外贸易法》有关规定,商务部、工业和信息化部、海关总署、市场监管总局决定对纯电动乘用车实施出口许可证管理。现将有关事项公告如下: 一、对货物名称为仅装有驱动电动机的具有车辆识别代码(VIN码)的其他载人...