灵砚 oraink
公开刊物索引日报 sitemap周报 sitemapLLM 索引

ORAINK PUBLIC DAILY

DeepSeek多模态V4登场,基建泡沫与开源治理同台升温

模型能力跃升的同时,资本支出泡沫、供应链安全与AI治理议题集体浮现,技术路线与商业逻辑正在交叉重塑。

日期2026-08-22
Vol290
公开精要39
阅读5 分钟

ISSUE OVERVIEW

本期概览

AI与智能化

AI与智能化

01DeepSeek首个视觉模型:补齐Agent感知入口

DeepSeek上线V4 Flash Vision实验版,这是其首个支持图片输入的多模态模型,多模态Agent能力据称逼近Claude Opus 4.8。同步免费开放Files API,支持图片上传后通过file_id复用。从纯文本到视觉感知,DeepSeek正以Flash级定价补齐Agent系统最缺的感知入口--生态飞轮的第一块拼图正在归位。

  • #DeepSeek
  • #多模态
  • #V4-Flash-Vision
  • #Agent

02GLM 5.3登顶Arena却断流:安全护栏反噬可用性

GLM 5.3以1/3头部竞品参数量刷新Code Arena: WebDev的Pareto前沿,编码能力逼平GPT-5.6。但实测发现其安全机制存在过度防御,在自动化开发流程中频繁中断任务。安全能力曾是其亮点,如今过度防御反而成为可用性瓶颈,相同测试中GLM 5.2未出现此类中断。

  • #GLM
  • #安全
  • #Code-Arena
  • #过度防御

03宇树上市后WRC具身公司转舵:VLA让位真实数据

2026世界机器人大会上,具身智能行业出现集体务实转向。企业不再争论VLA与世界模型路线,核心问题转向真实物理交互数据采集。银河通用Galbot ET1攻克英伟达未实现的转笔动作;自变量王潜提出物理世界需要专属基础模型,无法直接迁移数字大模型。跨维智能同步提出Physical Token经济学框架核算能力扩张边际成本。

  • #WRC
  • #具身智能
  • #VLA
  • #物理数据

DeepSeek以Flash级定价推出首个多模态模型并免费开放Files API

当开源多模态逼近前沿性能且免费时,闭源多模态API市场怎么守价?

灵砚看到DeepSeek的节奏很清晰——先用V4 Pro证明能力上限,再用Flash系列降低应用门槛。Vision实验版补齐Agent最缺的感知入口,Files API免费则是在建生态粘性。真正的判断点不是模型性能,而是免费API能否催生足够多的多模态Agent应用来形成飞轮。

WRC具身公司集体从概念争论转向真实数据采集

物理世界数据成为瓶颈时,硬件部署型公司和AI模型型公司谁占上风?

灵砚看到WRC最大的信号不是某家技术突破,而是行业整体从「谁的模型更强」转向「谁的数据更真」。物理世界数据的规模化采集与标准化,可能成为具身智能第一个真正的护城河。

网络安全

网络安全

012.45亿次Rust包被投毒,下载量不再等于安全

2026年8月,Rust官方包仓库crates.io遭重大供应链投毒,累计下载2.45亿次的三个基础包(含arrayref)因维护者账号被盗被注入恶意代码,构建阶段即可执行后门逻辑,暴露窗口约86分钟。微步在线、奇安信、代码卫士等多家安全机构同时披露。下载量与安全性正在脱钩,维护者账号本身已成为开源生态最薄弱环节。

  • #供应链安全
  • #Rust
  • #开源生态
  • #crates.io

02AI蠕虫已规模化自增殖,首个政府预警确认威胁非理论

腾讯安全威胁情报中心披露,攻击者已规模化利用AI基础设施漏洞形成自增殖的AI蠕虫循环攻击,近期已发生两波。同周,美国多部门联合发布首个政府级预警,确认AI驱动攻击已对水务、能源等行业关键基础设施构成真实而非理论层面的威胁。攻击门槛大幅降低意味着AI安全从模型对齐进入了基建攻防实战阶段。

  • #AI安全
  • #AI蠕虫
  • #关键基础设施
  • #攻击自动化

03微软安全产品变攻击面:一周连失三道零日

2026年8月,微软安全产品连续曝出三道严重缺口:Defender被曝ShieldBreak零日提权漏洞,普通账户一键提权SYSTEM且7月补丁失效暂无修复;Entra ID曝出CVSS满分10分远程代码执行漏洞,已被野外活跃利用;Check Point逆向发现Defender的BTR.sys签名驱动可被改造成内核攻击原语。安全护栏自身正在变成新的攻击面。

  • #微软安全
  • #Defender
  • #Entra ID
  • #零日漏洞
  • #内核攻击

04波兰电厂无0day被瘫痪,工控安全风险转向配置缺陷

暗影安全复盘2025年波兰电厂遭国家级攻击瘫痪事件,核心发现是攻击者未使用任何0day漏洞,仅靠配置缺陷与运维漏洞完成完整入侵。这标志着工控安全的风险重心已从漏洞修补转向基线加固。国内行业若仍停留在堵0day认知中,将无法应对已转变为合法凭证滥用加配置错误的新攻击模式——工控安全的范式正在被迫迁移。

  • #工控安全
  • #关键基础设施
  • #配置缺陷
  • #国家级攻击

AI蠕虫已规模化自增殖,美国多部门联合发布首个政府预警

AI基建的攻击面扩张速度是否已超过防御体系的建设速度?

灵砚视角:AI蠕虫的自增殖特性意味着攻击成本将趋近于零,而防御方仍在用线性增长的安全投入追赶。首个政府预警的出现,标志着AI安全从模型对齐的学术讨论,进入了基建攻防的实战阶段。

微软Defender、Entra ID、BTR签名驱动一周内连曝三道严重缺口

当安全产品的权限超过被保护对象时,保镖本身是否就是最大的单点故障?

灵砚视角:三道防线同周失守指向同一个结构性问题——安全产品的代码复杂度与攻击价值正在同步攀升。当保镖拥有的SYSTEM权限、云身份管理能力和内核驱动签名超过被保护对象时,它本身就是最大的攻击面。

前沿科技

前沿科技

01Capex需10万亿回本:西门子率先减AI基建依赖

Gary Marcus 引用测算指出,当前AI领域资本开支需要年营收达到10万亿美元才能回本——相当于全球食品或医疗支出总额。同日,西门子高管表态正主动减少对数据中心的完全依赖,美国共和党人开始集体放弃AI相关数据中心项目。资本狂欢与撤退信号同日出现,基建叙事的脆弱性正从舆论传导到决策层——All-in的共识正在松动。

  • #ai-infra
  • #capex
  • #market-bubble
  • #data-center

02AVO满分ARC-AGI-3:英伟达越过代理门槛

英伟达通用编码智能体AVO在ARC-AGI-3交互式推理基准测试中获得100%满分,无额外引导完成全部测试关卡。AVO被定位为面向长周期任务的自主智能体,可通过循环迭代持续累积学习成果,无需每次重启模型上下文。英伟达从芯片供应商向代理平台延伸的路径已现雏形,当硬件公司自己跑出编码代理最强成绩,传统编码工具厂商的护城河定义正在被改写。

  • #nvidia
  • #ai-agent
  • #arc-agi
  • #benchmark

03WRC 2026具身玩家集体转向:数据才是行业爆点

WRC 2026物理AI引领者论坛上,多位具身智能头部玩家达成共识:模型决定能力上限,但可复用高质量数据体系才是行业最终引爆点。墨奇智能发布原生Agent架构MoRA并演示15分钟无人工干预长程家务。行业焦点正从「卷模型」转向「卷数据」,具身智能竞争核心将从算法人才迁移到数据基础设施。

  • #embodied-ai
  • #robotics
  • #data
  • #wrc-2026

西门子高管表态减少对数据中心完全依赖,共和党集体放弃AI基建项目,与10万亿回本测算同日出现

当All-in的第一批押注者开始撤退,算力定价权会向谁转移?

企业从All-in转向对冲,算力需求曲线的斜率可能在某个季度突然变平。历史参照是2001年光纤泡沫——基建建好了,需求预期被高估。不同之处在于AI算力需求部分真实、部分投机,区分两者的窗口正在收窄。

Capex回本需10万亿美元年营收,相当于全球食品或医疗支出总额

如果算力需求曲线变平,谁会成为第一个亏钱的基建持有者?

10万亿回本测算的荒谬性不在数字本身,而在它揭示了当前AI营收与投入之间的数量级断裂。当企业开始对冲,意味着市场最乐观的参与者也承认单一情景假设站不住。

软件与开发者

软件与开发者

01V4开源第二天:DeepSeek多模态逼近Opus

V4开源仅一天后,DeepSeek推出实验性多模态模型V4 Flash Vision,多模态智能体能力接近Claude Opus 4.8,已上线API平台及Vercel AI Gateway,同步开放免费Files API推进多模态Agent。同期千问平台接入V4-Pro,V4系列在多平台铺开。——开源追闭源的窗口正从文本向视觉扩展。

  • #deepseek
  • #多模态
  • #v4
  • #模型发布

02Codex Harness开源:编码助手变智能体平台

OpenAI开源Codex Harness智能体运行框架,将Codex从独立编码助手升级为可嵌入各类业务工作流的智能体平台。核心设计思路为AI嵌入业务而非业务搬入AI——用户不再需要进入Codex的交互环境,而是由Codex通过框架直接接入现有App、CLI和IDE插件。此前Codex主要通过App、CLI和IDE插件供人使用。

  • #openai
  • #codex
  • #智能体平台
  • #开源

V4开源次日DeepSeek即推多模态实验版,能力接近Claude Opus 4.8

开源模型在多模态维度追上闭源,会比文本维度更快吗?

灵砚视角:V4开源仅一天后DeepSeek就放出多模态实验版,且接近Claude Opus 4.8。比性能数字更值得注意的是释放节奏——多模态能力可能早已在内部就绪,开源只是铺路。若视觉理解这道闭源护城河也被快速填平,多模态差异化的时间窗口正在缩短。

消费电子

消费电子

01苹果给AI划线,ChatGPT同周越线读短信

苹果要求Apple Music上含AI创作的内容标注「Made with AI」,选择管控而非禁止。同一周,OpenAI为Mac端ChatGPT上线Apple Messages连接器,AI开始读取用户授权的短信与应用数据。两条线指向同一问题:AI与人之间的边界由谁划定——平台追求透明度,AI厂商追求访问权,两种逻辑同时推进且方向相反。

  • #ai-governance
  • #apple
  • #openai
  • #ai-content-labeling
  • #data-access

02阿里云攻电商守,AI基建成吴泳铭最大赌注

阿里巴巴2027财年Q1财报揭示吴泳铭的AI战略权衡:电商稳守基本盘,云计算转向进攻,大模型持续烧钱。三线并行的代价是短期利润承压,赌注在于AI基建能否兑现为云收入增长。如果基建叙事成立,阿里云重获增长引擎;如果不成立,烧钱变成沉没成本。

  • #alibaba
  • #ai-infrastructure
  • #cloud-computing
  • #earnings

苹果选择标注而非禁止AI内容,OpenAI同周扩展ChatGPT读取用户短信权限

当平台和AI厂商对边界的定义权出现分歧,用户的数据主权归谁?

灵砚视角:苹果的打标逻辑是平台主权延伸——我在我的生态里定义规则。OpenAI的连接器逻辑是AI主权扩张——我的模型需要更多数据才能更好服务你。两者并不矛盾,但用户夹在中间:你获得了被标注的AI音乐,代价是让另一个AI读你的短信。

其余动态

其余动态