DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 徐美慧界面新闻编辑 | 文姝琪 “你可能很少见到哪家AI公司像我们这样,(管理团队)平均年龄超过50岁了。”零一万物CEO李开复在近日接受界面新闻采访时如是调侃。 随后,他又补充了一句:年龄...
美股三大指数集体高开,道指涨0.45%,纳指涨0.08%,标普500指数涨0.2%。格芯(GlobalFoundries)涨超11%,此前报道称美国计划出台芯片生产新规以降低对海外依赖。英特尔涨超3%,有报道称其接触台积电寻求投资或合作。波音涨超4%,小鹏汽车、理想汽车涨超2%;金山云跌超8%。...
界面新闻记者 | 尹靖霏 8月15日,苏州联讯仪器股份有限公司(下称联讯仪器)科创板IPO获上交所受理,这家主攻电子测量与半导体测试设备的企业,正凭借反转的业绩冲刺资本市场。 曾在2022—2023年连续亏损的联讯仪器,借光通信与新能源汽车领域需求爆发,2024年实现盈利,公司营收三年间...
美股三大指数集体收涨,道指涨0.65%,本周累计下跌0.15%;纳指涨0.44%,本周累计下跌0.65%;标普500指数涨0.59%,本周累计下跌0.31%。热门科技股多数上涨,特斯拉、英特尔涨超4%,微软、亚马逊涨幅不足1%,甲骨文跌超2%。金属与采矿、汽车股涨幅居前,世纪铝业涨超7%,泛美白银、...
界面新闻记者 | 王婷婷 上海高端住宅市场依然一枝独秀。 9月14日,楼市“金九”第二个周日,位于虹口内环内的外滩瑞府首期开盘,119套房源当日售罄,录得销售额超24.8亿元。“现场选房氛围比较好,购房者的认购热情还是挺OK的,选房时间很快,也不是很纠结。”外滩瑞府项目负责人告诉界面新闻...
界面新闻记者 | 伍洋宇界面新闻编辑 | 文姝琪 2024年年初的一天,小米AI眼镜负责人李创奇发起了一场不太日常的对话。 他将一份文件拖进小米内部办公软件自己与雷军的聊天窗口,一边打下这样一段文字:“……就...