DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 黄华界面新闻编辑 | 谢欣 9月15日,界面新闻记者从百时美施贵宝公司(Bristol Myers Squibb ,BMS)获悉,百时美施贵宝已签署协议,出售在中美上海施贵宝制药有限公司(简称“SASS工厂”)中持有的60%股权。 百时美施贵宝同期向界面新闻表示,百时美...
随着中交地产(证券简称:*ST中地,证券代码:000736)重大资产重组完成资产交割,上市公司房地产开发业务相关的资产和负债置出至控股股东中交房地产集团有限公司,中交地产管理层出现重大变动。 原董事长、总裁等一众高管集体请辞,并聘任新的总裁、副总裁和财务总监等高管。新的总裁人选为曾益明,他此前...
界面新闻记者 | 陈靖 从首次“擦肩”到角色互换的“联姻”,湘财股份与大智慧的十年纠葛,在2025年三季度收官之际迎来关键进展。 9月25日晚间,大智慧(601519.SH)披露重组报告书草案,湘财股份(600095.SH)拟换股吸收合并大智慧。湘财股份的A股换股价格为7.51元/股,大...
界面新闻记者 | 袁颖琪 澳洋健康(002172.SZ)正迎来关键的发展转折点。近日,这家公司71岁的创始人沈学如交棒,张家港经开区管委会成为新实控人。 根据公开的交易方案,澳洋集团计划以每股3.87元的价格,向张家港悦升科技合伙企业(下称悦升科技)转让其20%的股份,此次股权转让总价...
...
界面新闻记者 | 朱咏玲界面新闻编辑 | 许悦 9月1日,国货彩妆品牌花知晓宣布完成B轮融资,由珀莱雅独家投资,池杉资本担任长期独家财务顾问。此次融资将用于品牌全球化扩张、供应链整合与内容创新等方向。 花知晓母公司深圳花知晓电子商务有限公司(以下简称“花知晓”)的工商信息已经发生变更。珀...