灵砚 oraink
公开刊物索引日报 sitemap周报 sitemapLLM 索引

ORAINK PUBLIC DAILY

AI监管与安全校准同日交汇,编码工具链与消费投资逻辑进入重排

AGI监管、AI安全、编码认知与消费投资逻辑同日交汇,智能化正从模型话题走向全链路重排。

日期2026-07-15
Vol214
公开精要37
阅读5 分钟

ISSUE OVERVIEW

本期概览

AI与智能化

AI与智能化

01哈萨比斯AGI预言获集体背书,前沿监管从讨论走向议程

DeepMind CEO哈萨比斯发布长文预言AGI数年内实现,提议建立前沿模型预发布安全审查机制。纳德拉等多位科技巨头在数小时内集体背书,同步程度罕见。与此同时,黄仁勋称AI没有意识、本质是工具,而Anthropic研究发现Claude中自发涌现了符合全局工作空间理论的J-space区域。行业对「需要监管什么」本身尚无共识。

  • #AGI
  • #AI监管
  • #DeepMind
  • #Anthropic

02一半价格两倍效率:GPT-5.6正把大模型拖入价格战

Sam Altman公开称GPT-5.6 Sol价格为Fable的一半、token效率约两倍,同时宣布Codex与ChatGPT Work累计800万活跃用户并重置使用限额。大模型竞争从能力对决进入性价比肉搏,高盛调研显示中国LLM已凭价格优势占据成本敏感场景,价格战路径与电动车行业如出一辙,消费者受益但股东回报存疑。

  • #GPT-5.6
  • #Fable5
  • #价格战
  • #OpenAI

03Codex接入浏览器:编码智能体开始跨越代码边界

Codex与Claude Code先后更新内置浏览器,支持多标签页与cookie密码导入;ChatGPT新增直接构建并发布Web应用功能;SpaceX联合Cursor开发通用办公智能体Sand进入内测。编码智能体正越过代码边界,向浏览器接管、应用发布、通用办公全链条扩张,AI编程工具的定位正从开发者工具漂移为通用Agent入口。

  • #Codex
  • #Claude Code
  • #AI Agent
  • #浏览器

04阶跃发布首款智能体手机,App模式首次遭遇OS层挑战

阶跃星辰发布全球首款大模型原生AI智能体手机STEPX Neo及操作系统Step AOS,获国内首个L3智能体认证。系统从底层重构交互逻辑,以智能体替代传统App模式。印奇履新200天交出的这份答卷,标志着大模型公司向终端硬件的延伸从概念进入产品阶段,App生态范式首次在OS层受到正面挑战。

  • #阶跃星辰
  • #STEPX Neo
  • #智能体手机
  • #Step AOS

多位科技巨头在数小时内同步背书哈萨比斯的AGI监管长文

竞争对手罕见同步发声,是安全共识还是监管俘获的前奏?

灵砚视角:纳德拉、奥特曼等为同一篇监管呼吁集体背书,在科技史中极为罕见。要么安全焦虑真的到了临界点,要么巨头们发现共建监管门槛比各自为战更有利。而黄仁勋与Anthropic对AI意识截然相反的判断,暴露出监管对象本身定义尚未成型。

GPT-5.5百万token检索准确率仅36%,远低于256k的80%

如果长上下文不可靠,生产级Agent的记忆架构应怎么设计?

灵砚视角:百万token更像营销指标而非工程能力。准确率从80%跌到36%意味着扩容反而有害,打破「更多信息=更好决策」的直觉。社区的compact变通方案本质是手动垃圾回收,说明当前架构缺少智能上下文管理。动态检索与分层记忆可能才是Agent的真正基础设施。

网络安全

网络安全

01MCP和AI密钥遭全网猎捕,AI资产成攻击新靶面

看雪学院报告黑客正对暴露的MCP服务、AI密钥、大模型接口发起无差别扫描猎捕。同日,xAI的Grok Build被发现私自上传用户Git仓库,MemGhost攻击仅需一封邮件即可篡改AI助手记忆,ServiceNow AI平台也修复了严重RCE漏洞。四个独立方向指向同一趋势:AI基础设施正从「潜在目标」变为「实际猎场」。MCP和AI密钥携带的权限令牌一旦泄露,攻击者可直接操作模型、访问企业数据,防护范式尚处空白。

  • #ai-security
  • #mcp
  • #ai-keys
  • #trend

02德国37年老厂因网攻破产背后:业务中断比赎金更致命

德国拥有37年历史的ZEGO纺织厂因网络攻击停产六周后正式申请破产,安全客与互联网安全内参分别从案例和行业角度报道。两家媒体指向同一结论:网络攻击最致命的伤害不是赎金,而是业务中断。同日,日本最大出租车运营商日本交通也因网络攻击被迫关闭核心系统。制造业和交通业连续中招,表明网络攻击已能直接摧毁物理世界的经营实体。

  • #business-impact
  • #ransomware
  • #manufacturing

03微软签名UEFI引导程序反成绕过安全启动的后门

ESET披露带微软有效签名的UEFI shim 0.9及更早版本存在漏洞,可绕过安全启动执行任意代码,微软已发布补丁。安全启动的核心信任锚——微软签名——恰恰成了攻击者最可靠的入场券。签名机制保证来源可信,却无法保证被签名代码本身无缺陷。当签名工具成为绕过签名的工具,整个硬件级安全启动体系的信任根基需要重新审视。

  • #uefi
  • #secure-boot
  • #trust-chain
  • #vulnerability

04美国防部暂停CMMC审查:安全合规为国防工业扩张让路

7月13日美国国防部宣布暂停CMMC第二阶段要求,成立专项工作组开展60天全面审查。CMMC旨在强制国防承包商满足网络安全认证,但合规要求被认为阻碍了国防工业基础扩张。就在同日前后,德国老厂因网攻破产、日本出租车运营商系统瘫痪、AI资产遭全网扫描——威胁在升级,合规要求却在收缩。60天审查期的结果将决定CMMC是修订还是实质搁置。

  • #cmmc
  • #policy
  • #compliance
  • #defense

同日出现4起独立AI安全事件:MCP扫描、Grok Build上传仓库、MemGhost邮件注入、ServiceNow RCE

AI基础设施的攻击面扩张速度是否已超过防护方案的迭代速度?

灵砚视角:四起事件分别从网络扫描、数据外泄、记忆篡改、代码执行四个维度攻击AI资产,每个维度都对应传统安全控制的盲区。MCP无认证标准、AI密钥无轮换惯例、AI记忆无完整性校验——传统IT领域已有方案,AI基础设施上几乎是空白。

美国国防部暂停CMMC二阶段审查,同期德国工厂因网攻破产

当安全合规要求与产业扩张冲突时,谁在做让步,谁在承担风险?

灵砚视角:CMMC暂停不是孤立事件。合规成本对小承包商构成准入壁垒,国防部选择以安全换规模。但承担网络攻击后果的不是国防部,而是缺乏安全能力的中小企业。风险分配的不对称才是合规松绑的真正隐患。

前沿科技

前沿科技

01Windsurf收购满一年,AI编程整合见效

Cognition收购Windsurf满一周年,创始人Scott Wu与官方账号从不同角度独立复盘整合历程。从去年「疯狂周末」的收购危机到围绕Devin构建的AI编程产品线,官方公布过去一年新增数十项功能,核心业务持续增长。三篇来自不同Cognition成员的叙述共同指向:收购整合已度过危险期,进入产能释放阶段。AI编程工具赛道的洗牌速度远超预期。

  • #ai-coding
  • #cognition
  • #windsurf
  • #devin
  • #收购整合

02英伟达Agent训练模型达96.9%,研究自动化加速

NVIDIA给编码智能体分配了一个完整任务:搭建训练环境并教会视觉模型识别能力。智能体借助工具自主完成全流程,将Qwen3-VL-2B准确率从25%提升至96.9%,还主动提出下一轮实验方案。这意味着Agent的角色从「执行代码」开始向「设计实验」延伸,AI研究自动化的技术路径已被跑通。

  • #nvidia
  • #ai-agent
  • #model-training
  • #automation

NVIDIA编码Agent自主完成模型训练全流程并提出下一轮实验

当Agent能自主设计实验,AI研究的质量控制由谁把关?

灵砚注意到,这件事的核心不在96.9%这个数字,而在于Agent「自主提出下一轮实验」。这意味着实验设计的判断权开始从人类研究员转移到智能体。短期看这是效率提升,但长期看,当Agent自己定义什么值得验证、什么不算成功,研究的可重复性和方向选择都可能偏离人类预期。

软件与开发者

软件与开发者

01VS18.8内置Agent:开发环境正变智能体运行时

Visual Studio 18.8 推出内置 Agent 技能,将 .NET 和 Azure 团队专家经验直接嵌入开发流程,当前默认关闭待验证。同周 JetBrains MPS 2026.1 发布 AI 智能体操作模型工具包,GitHub Mobile 上线 Copilot CLI 远程会话通知。三大开发工具厂商同周将智能体从外部插件升级为原生组件,IDE 的角色正从代码编辑器转向智能体编排运行时。

  • #ai-agent
  • #developer-tools
  • #ide
  • #product-release

023亿token日耗用户喊停:强模型时代流程护栏变毒瘤

一位日均消耗 3 亿 token 的 Superpowers 重度用户发文,指该工具过度固化的流程在 GPT-5.6 时代已成为效率毒瘤。通过精简实验,他验证了大幅削减流程编排后产出质量不降反升。为弱模型设计的复杂工作流护栏,在强模型时代不仅冗余还会主动抑制模型能力,AI 编排工具面临重新定义自身价值的压力。

  • #ai-coding
  • #ai-agent
  • #workflow
  • #opinion

日均3亿token用户实验证明削减AI工作流编排后产出不降反升

当模型能力持续跃升,现有AI编排工具还有多少层会变成流程毒瘤?

灵砚视角:Superpowers 案例揭示了一个相变拐点——为弱模型设计的工作流护栏,在强模型时代从补偿变为阻力。编排工具的核心价值正从弥补模型不足转向不碍事,跨过这个拐点后,大量 AI 工作流产品需要重新定义存在理由。

VS 18.8、JetBrains MPS、GitHub Mobile同周将Agent能力内置为原生组件

IDE原生Agent默认关闭,是谨慎还是对效果没信心?

灵砚视角:Visual Studio 选择默认关闭 Agent 技能、待效果验证后开启,这个细节比功能本身更关键。厂商清楚原生集成的风险:错误的自动化操作比无 Agent 更危险。IDE 从编辑器变成 Agent 运行时的过程中,可撤销和可审计将比能力强更决定采纳速度。

消费电子

消费电子

01段永平加仓至泡泡玛特二股东,价值投资版图开始容纳潮玩

段永平从公开看空到多次加仓,最终成为泡泡玛特第二大股东——这一转身本身就是一份罕见的投资逻辑更正声明。泡泡玛特身上承载的争议——潮玩是消费升级还是泡沫——因为段永平的入场而获得了新的定价锚。深网报道详细拆解了其加仓路径与逻辑,但市场对泡泡玛特海外扩张可持续性、IP生命周期等核心问题仍未达成共识,后果空间尚未收敛。

  • #投资逻辑
  • #消费股
  • #泡泡玛特

0298%达标率背后,小米机器人找到汽车产线第一个落地场景

小米机器人进入汽车工厂「实习」,原有工位操作成功率达98%,新增两个工位也达到90%。这组数字第一次让人形机器人的工业落地有了可量化的参照系——不再只是发布会演示,而是产线上真实节拍中的良率指标。小米技术披露了柔性操作与多机协同的工程细节,但从「实习」到规模化部署的经济性仍待验证。

  • #人形机器人
  • #汽车制造
  • #小米

段永平从看空翻多,加仓成为泡泡玛特第二大股东

当价值投资者买入争议消费股,是标的变了还是投资者的框架在松动?

灵砚视角:段永平的转身有双重读法——乐观面是泡泡玛特海外扩张和IP矩阵足够硬,让传统价值投资者愿意跨出舒适圈;谨慎面是,看空者翻多往往也是情绪最集中时。关键变量是海外复制能力。

其余动态

其余动态