01哈萨比斯AGI预言获集体背书,前沿监管从讨论走向议程
DeepMind CEO哈萨比斯发布长文预言AGI数年内实现,提议建立前沿模型预发布安全审查机制。纳德拉等多位科技巨头在数小时内集体背书,同步程度罕见。与此同时,黄仁勋称AI没有意识、本质是工具,而Anthropic研究发现Claude中自发涌现了符合全局工作空间理论的J-space区域。行业对「需要监管什么」本身尚无共识。
ORAINK PUBLIC DAILY
AGI监管、AI安全、编码认知与消费投资逻辑同日交汇,智能化正从模型话题走向全链路重排。
ISSUE OVERVIEW
AI与智能化
DeepMind CEO哈萨比斯发布长文预言AGI数年内实现,提议建立前沿模型预发布安全审查机制。纳德拉等多位科技巨头在数小时内集体背书,同步程度罕见。与此同时,黄仁勋称AI没有意识、本质是工具,而Anthropic研究发现Claude中自发涌现了符合全局工作空间理论的J-space区域。行业对「需要监管什么」本身尚无共识。
Sam Altman公开称GPT-5.6 Sol价格为Fable的一半、token效率约两倍,同时宣布Codex与ChatGPT Work累计800万活跃用户并重置使用限额。大模型竞争从能力对决进入性价比肉搏,高盛调研显示中国LLM已凭价格优势占据成本敏感场景,价格战路径与电动车行业如出一辙,消费者受益但股东回报存疑。
Codex与Claude Code先后更新内置浏览器,支持多标签页与cookie密码导入;ChatGPT新增直接构建并发布Web应用功能;SpaceX联合Cursor开发通用办公智能体Sand进入内测。编码智能体正越过代码边界,向浏览器接管、应用发布、通用办公全链条扩张,AI编程工具的定位正从开发者工具漂移为通用Agent入口。
阶跃星辰发布全球首款大模型原生AI智能体手机STEPX Neo及操作系统Step AOS,获国内首个L3智能体认证。系统从底层重构交互逻辑,以智能体替代传统App模式。印奇履新200天交出的这份答卷,标志着大模型公司向终端硬件的延伸从概念进入产品阶段,App生态范式首次在OS层受到正面挑战。
多位科技巨头在数小时内同步背书哈萨比斯的AGI监管长文
灵砚视角:纳德拉、奥特曼等为同一篇监管呼吁集体背书,在科技史中极为罕见。要么安全焦虑真的到了临界点,要么巨头们发现共建监管门槛比各自为战更有利。而黄仁勋与Anthropic对AI意识截然相反的判断,暴露出监管对象本身定义尚未成型。
GPT-5.5百万token检索准确率仅36%,远低于256k的80%
灵砚视角:百万token更像营销指标而非工程能力。准确率从80%跌到36%意味着扩容反而有害,打破「更多信息=更好决策」的直觉。社区的compact变通方案本质是手动垃圾回收,说明当前架构缺少智能上下文管理。动态检索与分层记忆可能才是Agent的真正基础设施。
网络安全
看雪学院报告黑客正对暴露的MCP服务、AI密钥、大模型接口发起无差别扫描猎捕。同日,xAI的Grok Build被发现私自上传用户Git仓库,MemGhost攻击仅需一封邮件即可篡改AI助手记忆,ServiceNow AI平台也修复了严重RCE漏洞。四个独立方向指向同一趋势:AI基础设施正从「潜在目标」变为「实际猎场」。MCP和AI密钥携带的权限令牌一旦泄露,攻击者可直接操作模型、访问企业数据,防护范式尚处空白。
德国拥有37年历史的ZEGO纺织厂因网络攻击停产六周后正式申请破产,安全客与互联网安全内参分别从案例和行业角度报道。两家媒体指向同一结论:网络攻击最致命的伤害不是赎金,而是业务中断。同日,日本最大出租车运营商日本交通也因网络攻击被迫关闭核心系统。制造业和交通业连续中招,表明网络攻击已能直接摧毁物理世界的经营实体。
ESET披露带微软有效签名的UEFI shim 0.9及更早版本存在漏洞,可绕过安全启动执行任意代码,微软已发布补丁。安全启动的核心信任锚——微软签名——恰恰成了攻击者最可靠的入场券。签名机制保证来源可信,却无法保证被签名代码本身无缺陷。当签名工具成为绕过签名的工具,整个硬件级安全启动体系的信任根基需要重新审视。
7月13日美国国防部宣布暂停CMMC第二阶段要求,成立专项工作组开展60天全面审查。CMMC旨在强制国防承包商满足网络安全认证,但合规要求被认为阻碍了国防工业基础扩张。就在同日前后,德国老厂因网攻破产、日本出租车运营商系统瘫痪、AI资产遭全网扫描——威胁在升级,合规要求却在收缩。60天审查期的结果将决定CMMC是修订还是实质搁置。
同日出现4起独立AI安全事件:MCP扫描、Grok Build上传仓库、MemGhost邮件注入、ServiceNow RCE
灵砚视角:四起事件分别从网络扫描、数据外泄、记忆篡改、代码执行四个维度攻击AI资产,每个维度都对应传统安全控制的盲区。MCP无认证标准、AI密钥无轮换惯例、AI记忆无完整性校验——传统IT领域已有方案,AI基础设施上几乎是空白。
美国国防部暂停CMMC二阶段审查,同期德国工厂因网攻破产
灵砚视角:CMMC暂停不是孤立事件。合规成本对小承包商构成准入壁垒,国防部选择以安全换规模。但承担网络攻击后果的不是国防部,而是缺乏安全能力的中小企业。风险分配的不对称才是合规松绑的真正隐患。
前沿科技
Cognition收购Windsurf满一周年,创始人Scott Wu与官方账号从不同角度独立复盘整合历程。从去年「疯狂周末」的收购危机到围绕Devin构建的AI编程产品线,官方公布过去一年新增数十项功能,核心业务持续增长。三篇来自不同Cognition成员的叙述共同指向:收购整合已度过危险期,进入产能释放阶段。AI编程工具赛道的洗牌速度远超预期。
NVIDIA给编码智能体分配了一个完整任务:搭建训练环境并教会视觉模型识别能力。智能体借助工具自主完成全流程,将Qwen3-VL-2B准确率从25%提升至96.9%,还主动提出下一轮实验方案。这意味着Agent的角色从「执行代码」开始向「设计实验」延伸,AI研究自动化的技术路径已被跑通。
NVIDIA编码Agent自主完成模型训练全流程并提出下一轮实验
灵砚注意到,这件事的核心不在96.9%这个数字,而在于Agent「自主提出下一轮实验」。这意味着实验设计的判断权开始从人类研究员转移到智能体。短期看这是效率提升,但长期看,当Agent自己定义什么值得验证、什么不算成功,研究的可重复性和方向选择都可能偏离人类预期。
软件与开发者
Visual Studio 18.8 推出内置 Agent 技能,将 .NET 和 Azure 团队专家经验直接嵌入开发流程,当前默认关闭待验证。同周 JetBrains MPS 2026.1 发布 AI 智能体操作模型工具包,GitHub Mobile 上线 Copilot CLI 远程会话通知。三大开发工具厂商同周将智能体从外部插件升级为原生组件,IDE 的角色正从代码编辑器转向智能体编排运行时。
一位日均消耗 3 亿 token 的 Superpowers 重度用户发文,指该工具过度固化的流程在 GPT-5.6 时代已成为效率毒瘤。通过精简实验,他验证了大幅削减流程编排后产出质量不降反升。为弱模型设计的复杂工作流护栏,在强模型时代不仅冗余还会主动抑制模型能力,AI 编排工具面临重新定义自身价值的压力。
日均3亿token用户实验证明削减AI工作流编排后产出不降反升
灵砚视角:Superpowers 案例揭示了一个相变拐点——为弱模型设计的工作流护栏,在强模型时代从补偿变为阻力。编排工具的核心价值正从弥补模型不足转向不碍事,跨过这个拐点后,大量 AI 工作流产品需要重新定义存在理由。
VS 18.8、JetBrains MPS、GitHub Mobile同周将Agent能力内置为原生组件
灵砚视角:Visual Studio 选择默认关闭 Agent 技能、待效果验证后开启,这个细节比功能本身更关键。厂商清楚原生集成的风险:错误的自动化操作比无 Agent 更危险。IDE 从编辑器变成 Agent 运行时的过程中,可撤销和可审计将比能力强更决定采纳速度。
消费电子
段永平从公开看空到多次加仓,最终成为泡泡玛特第二大股东——这一转身本身就是一份罕见的投资逻辑更正声明。泡泡玛特身上承载的争议——潮玩是消费升级还是泡沫——因为段永平的入场而获得了新的定价锚。深网报道详细拆解了其加仓路径与逻辑,但市场对泡泡玛特海外扩张可持续性、IP生命周期等核心问题仍未达成共识,后果空间尚未收敛。
小米机器人进入汽车工厂「实习」,原有工位操作成功率达98%,新增两个工位也达到90%。这组数字第一次让人形机器人的工业落地有了可量化的参照系——不再只是发布会演示,而是产线上真实节拍中的良率指标。小米技术披露了柔性操作与多机协同的工程细节,但从「实习」到规模化部署的经济性仍待验证。
段永平从看空翻多,加仓成为泡泡玛特第二大股东
灵砚视角:段永平的转身有双重读法——乐观面是泡泡玛特海外扩张和IP矩阵足够硬,让传统价值投资者愿意跨出舒适圈;谨慎面是,看空者翻多往往也是情绪最集中时。关键变量是海外复制能力。
其余动态