DeepSeek-V3.2-Exp模型开源发布重磅消息
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
2025年9月29日,DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效率。目前,该模型已正式上架华为云大模型即服务平台 MaaS,针对DeepSeek-V3.2-Exp 模型,华为云此次仍沿用大EP并行方案部署,基于稀疏Attention结构叠加实现长序列亲和的上下文并行策略,并兼顾模型时延和吞吐性能。
界面新闻记者 | 梁宝欣 8月27日,香港数字资产上市公司联合会(HKVALA)正式成立。这标志着香港数字资产行业进入到生态协同的制度化新阶段。 从成立背景来看,香港数字资产上市公司联合会的成立主要受三方面因...
8月26日,界面新闻独家获悉,龙湖已完成两笔资金的划款,合计金额超36亿元,用于兑付当日到期的“22龙湖拓展MTN001”,本息合计15.495亿元;以及提前兑付三个月后到期的“22龙湖拓展MTN002”,本息合计20.523亿元。 据界面新闻了解,“22龙湖拓展MTN001”发行总额为15亿...
9月26日,小米法务部在社交平台发文公布维权工作进展:2025年至今,小米法务已完成对16465条舆情线索的法律评估,重点监测网络账号231个,并针对其中92个恶意侵权账号提起民事诉讼,依法追究相关侵权人的法律责任。目前,部分案件已进入法院审理阶段,将适时公布案件进展。 同时,其亦关注到部分小...
界面新闻记者 | 肖芳界面新闻编辑 | 文姝琪 从去年就在寻找新故事的爱奇艺,又看中了线下娱乐业。 在2025爱奇艺iJOY秋季悦享会上,爱奇艺创始人、首席执行官龚宇在演讲中明确,线下业务未来将是爱奇艺的核心...
当地时间9月26日,美国白宫表示,最新针对药品的关税措施不适用于已与美国达成贸易协定的国家。 据路透社消息,白宫官员表示,对于欧盟、日本等贸易伙伴,美国将继续遵守协定中规定的15%关税上限。 9月25日,美国总统特朗普在其社交媒体“真实社交”宣布,自10月1日起,美国将对多类进口产品实施新一轮高...
雷军:与苹果的竞争是漫长而痛苦的过程 小米集团董事长、CEO雷军在9月25日接受媒体采访时谈及了对苹果公司的看法。雷军认为,与苹果的竞争可能是一个漫长而痛苦的过程,还是要全心全意向苹果学习,一步一步地把每一个细节做好,“我们提的全面对标,不仅仅是配置和参数,而是在科技引领、体验等方面,要对标苹...