DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 陈靖 从首次“擦肩”到角色互换的“联姻”,湘财股份与大智慧的十年纠葛,在2025年三季度收官之际迎来关键进展。 9月25日晚间,大智慧(601519.SH)披露重组报告书草案,湘财股份(600095.SH)拟换股吸收合并大智慧。湘财股份的A股换股价格为7.51元/股,大...
9月26日,电力板块拉升,嘉泽新能(601619)、世茂能源(605028)双双涨停,上海电力(600021)、节能风电(601016)、龙源电力(001289)、银星能源(000862)等跟涨。 【板块涨停个股】 嘉泽新能(601619),涨停价:5.58元/股,市盈率:14.77,总...
9月27日,光大证券研报认为,港股整体盈利能力相对较强,同时互联网、新消费、创新药等资产相对稀缺。此外,尽管港股已经连续多月上涨,但是整体估值仍然偏低,长期配置性价比仍较高。在AI产业趋势持续发展,以及美联储降息周期开启背景下,港股市场未来或许将继续震荡上行。...
界面新闻记者 | 程璐界面新闻编辑 | 文姝琪 80家参展公司、150多个机器人产品,与观众的感知一致,今年WAIC无论是科技创业还是投资话题,热度最高的赛道无疑集中在具身智能。 “过去一年对于投资AI最大的...
界面新闻记者 | 杨志锦界面新闻编辑 | 王姝 中国央行9月26日晚间披露,中国人民银行货币政策委员会2025年第三季度(总第110次)例会于9月23日召开。 会议研究了下阶段货币政策主要思路,建议加强货币政...