
DeepSeek V4.1 Flash 通过 MoE 架构和 Causal-Encoder-Decoder 结构,将 KV Cache 压缩到初代的 1/437,HBM 需求降至四分之一,推理成本大幅下降。与此同时,苹果首款折叠屏 iPhone Duo 因设计相似性遭到罗永浩和三星的批评,OpenAI 则因 GPT-6 Astra 需求过高暂停了 200 美元档 Pro 20X 新订阅。
大模型赛道正在从「拼参数」转向「拼效率」。深度求索近期上线的 V4.1 Flash 就是一个典型样本——它并非简单堆叠算力,而是通过架构层面的重新设计,把单位智能的调用成本压到了新低。
从公开信息看,V4.1 Flash 采用 552B 参数的 MoE 架构,配合全新的 Causal-Encoder-Decoder 结构,让输入与输出不再对称:输入侧只激活 8B,输出侧激活 16B。这种非对称设计带来的直接好处是,同样规模的任务,显存和存储开销大幅下降。据官方披露,新模型对 HBM 的需求降至上一代的四分之一,对 SSD 的需求更是压缩到八分之一。如果回溯到初代模型,KV Cache 的占用已经缩小到原来的 1/437。
对于 Agent 类应用而言,缓存命中费用往往占据大头。KV Cache 的压缩,等于直接砍掉了长期运行中最烧钱的那部分。
在基准测试中,V4.1 Flash 的智能水平超过了包括 V4 Pro 在内的多款旗舰模型。同时,它原生支持多模态视觉理解,开发者只需将模型名称改为 deepseek-flash 即可调用。旧版 V4 Flash 与 V4 Flash Vision Exp 已下线,原有模型名会暂时路由到新版本,以保证兼容性。
DeepSeek 的这次更新,放在国内大模型集体卷效率的背景下看并不孤立。文心一言、通义千问、豆包、Kimi、智谱 GLM 等产品,近一年都在推理成本、长上下文缓存、多模态融合上持续迭代。与海外厂商相比,国内团队更倾向于把「单位 token 成本」作为核心卖点,这既源于算力获取的现实约束,也反映出应用层对价格的高度敏感。DeepSeek 此次把缓存开销压到极低,本质上是在为 Agent 和长程任务铺路——这类场景一旦规模化,成本模型会决定谁能留在牌桌上。
苹果发布首款折叠屏手机 iPhone Duo 后,舆论场迅速分裂。罗永浩在社交平台上逐条点评,认为折叠形态、屏下摄像头、阔屏比例、侧面 Dock 栏、内外屏接力、多角度悬停以及钛合金 3D 打印铰链盖等设计「全是抄的」。他尤其批评苹果用雾面屏掩盖折痕,导致前摄在雾面屏下模糊,只好单独磨亮前摄区域,反而让本应隐藏的元件更加突兀。
不过,罗永浩也承认这台手机在开合动画上表现不错。他同时提到,距离乔布斯逝世十五周年只剩二十多天,言语间流露出怀念。面对网友「骂苹果没有法务风险」的质疑,他回应称自己有影响力和律师团队,只要说的是实话就没有风险。
三星也没有放过这个机会。三星移动美国官方账号在苹果发布会期间连发多条帖子,用「模拟人生续作」「重新加热剩饭」「多邻国快来」等梗进行嘲讽,并特意 @ 了语言学习平台多邻国——后者的吉祥物恰好叫 Duo。
这场口水战背后,折叠屏市场的竞争逻辑其实很清晰:三星需要捍卫自己「全球首发量产折叠屏」的身份标签,而苹果作为后来者,任何设计上的相似都会被放大检视。对消费者而言,真正值得关注的不是谁抄谁,而是折痕控制、铰链寿命、软件适配这些硬指标能否经得起日常使用。
OpenAI 首席产品官 Tibo 在 X 上宣布,由于 GPT-6 Astra 需求空前,将暂停 200 美元档 Pro 20X 订阅的新增用户。目前该档位已不可选,Pro 订阅仅剩每月 100 美元的 5X 档。Tibo 解释称,Pro 订阅对系统压力最大,暂停新增是「影响最小的办法」,已订阅用户和 API 服务不受影响。
这一动作折射出两个现实:一是顶级模型的推理成本仍然高昂,即便对 OpenAI 这样的头部厂商,容量扩张也需要时间;二是订阅制分层正在成为调节供需的阀门。对国内用户来说,类似的分层策略在文心一言、通义千问、Kimi 等产品上也能看到,只是国内厂商更多通过免费额度加会员增值的方式来做平衡,而非直接暂停高价档位。
有媒体报道称月之暗面考虑在香港和上海两地上市,随后知情人士对《科创板日报》表示消息不实。此前《南华》曾援引消息人士称,月之暗面可能赴港 IPO 并进一步在内地上市,潜在目标包括上交所科创板。
无论传闻真假,科创板对硬科技企业的吸引力是客观存在的。长鑫存储、宇树科技等企业已经或正在登陆,市场也在关注 DeepSeek、长江存储等明星公司是否会跟进。对 AI 初创企业而言,上市不仅是融资渠道,更是品牌背书和人才争夺的筹码。
智谱通过 Bigmodel 开放平台启动「杭州全城 Coding 计划」,联合杭州市及上城区推出城市级 AI 编程普惠行动,活动持续到 12 月 9 日。个人用户购买季卡可减免 44%,年卡减免 51%。
这一动作的看点在于「城市级」——把 AI 编程工具的推广与地方产业政策绑定,降低开发者和创业团队的使用门槛。相比单纯的 API 降价,这种区域化普惠计划更容易形成开发者聚集效应,也为国产大模型在 B 端落地提供了新思路。
马斯克旗下 The Boring Company 完成 30 亿美元 D 轮融资,由阿联酋领投,红杉资本、a16z、淡马锡等跟投。本轮融资后估值达到 230 亿美元。资金将用于招聘工程、运营和生产人员,并推进 Prufrock 隧道掘进机的研发。
该公司承诺在阿联酋建设超过 150 公里隧道,并计划在迪拜试点 6.4 公里隧道和 4 座车站,预制构件生产已经开始。从商业逻辑看,中东资本正在把交通基础设施作为 AI 和新能源之外的另一条投资主线,而 Boring Company 的隧道方案能否在沙漠环境中验证效率,将是后续关键。
SK 海力士管理层与生产岗工会达成新的临时劳资协议,尚需工会投票通过。新版草案将「利润分享」绩效的标准现金支付比例提升至 50%,股票分三年按 30%、10%、10% 发放,员工可自主选择更高股票比例。资方还同意提前支付去年绩效的递延部分,并承担股价上涨带来的额外费用。
此前 8 月草案因股票部分不确定性过高而被否决,这次调整本质上是把风险从员工侧向公司侧转移。对半导体行业而言,劳资关系稳定与否直接影响产能爬坡和技术迭代节奏,尤其是在 HBM 需求旺盛的当下。
主要升级包括:采用 552B 参数的 MoE 架构和 Causal-Encoder-Decoder 结构,输入激活 8B、输出激活 16B;原生支持多模态视觉理解;KV Cache 大幅压缩,HBM 需求降至上一代四分之一,SSD 需求降至八分之一;基准测试中智能水平超过 V4 Pro。
开发者只需在 DeepSeek API 中将模型名称改为 deepseek-flash 即可调用。旧版模型名 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 会暂时路由到新版本,以保证兼容性。
罗永浩认为其折叠形态、屏下摄像头、阔屏比例、侧面 Dock 栏、内外屏接力、多角度悬停和钛合金 3D 打印铰链盖等设计均非原创,并批评用雾面屏掩盖折痕导致前摄模糊。三星也以多条帖子进行嘲讽。
OpenAI 首席产品官 Tibo 表示,GPT-6 Astra 需求空前,Pro 订阅对系统压力最大,暂停新增是「影响最小的办法」,以确保现有用户获得良好体验。已订阅用户和 API 服务不受影响。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。
编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com
© 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

从 2011 年专利到 2026 年 iPhone Duo,苹果折叠屏走了十五年。本文拆解苹果迟到的工程逻辑、国内厂商的差异化路线,以及折叠屏体验真正卡住的地方。

苹果新CEO John Ternus首场发布会深度解读:折叠屏iPhone Duo为何等了近十年才入场?可变光圈和Apple Pencil的加入背后,折射出怎样的产品哲学转向?

DeepSeek V4.1 Flash发布与证监会“十五五”资本市场蓝图同日落地,折射出科技与金融制度供给的双向加速。本文从模型定价策略、资本市场改革框架、中小企业回款治理、AI国家标准等维度,拆解制度颗粒度变细背后的产业逻辑。
최신 SEO·GEO 정보를 받아보세요.
개인정보를 존중합니다. 언제든 구독을 취소할 수 있습니다.