灵砚 oraink
公开刊物索引日报 sitemap周报 sitemapLLM 索引

ORAINK PUBLIC WEEKLY

灵砚周刊·AI与智能化 2026-W31|巨头响应开源联署并发布安全模型

本周英伟达牵头开源联署,谷歌微软等巨头相继响应。

周刊2026-W31
扫描1814
信号24
线索5

SPEED READ

本周速览

THREADS

周线索

1. 【封面】巨头响应开源联署并发布安全模型

本周英伟达黄仁勋发起开源AI联署信,谷歌、Cohere、微软等巨头迅速响应,表明开放生态已成为行业主流共识。同时微软发布首个网络安全大模型MAI-Cyber-1-Flash,将前沿AI能力引入防御领域。吴恩达发文支持,开源与安全正走向融合而非对立。这意味着闭源叙事在安全等关键领域开始松动,开放生态的产业基础进一步巩固。

判断:巨头联署开源AI信、微软首发安全模型MAI-Cyber-1-Flash,标志开放生态在安全领域突破;若12个月内主流安全AI回归闭源独家,判断证伪。 置信:高

边界:不覆盖开源安全模型实际防御效果;缺联署信具体条款及各巨头承诺的量化指标。

  1. 2026-07-25:黄仁勋发起开源AI联署,Arthur Mensch、Demis Hassabis、Sundar Pichai及Cohere等迅速响应支持。(Arthur Mensch(@arthurmensch) / 极客公园 / Demis Hassabis(@demishassabis) / Sundar Pichai(@sundarpichai) / cohere(@cohere))
  2. 2026-07-26:SemiAnalysis指出Kimi K3大幅超越NVIDIA Nemotron 3 Ultra,引发对芯片商自研模型能力的讨论。(AI Will(@FinanceYF5))
  3. 2026-07-27:Anthropic员工呼吁CUDA开源,吴恩达发声支持开源联盟,微软正式加入开放安全联盟并发布MAI-Cyber-1-Flash安全模型。(InfoQ 中文 / Hugging Face(@huggingface) / Satya Nadella(@satyanadella) / The Rundown AI(@TheRundownAI) / Andrew Ng(@AndrewYNg))

2. 编程智能体精简上下文并突破PR半数

Anthropic重构Claude Code 2.0,将系统提示词大幅删减80%,验证了上下文工程从堆砌指令向精准约束转变的新范式。同时Cursor披露其56%的合并PR已由云端智能体完成。这两项进展表明AI编程工具在实际工程接管率上取得突破,软件开发正步入由智能体主导的新阶段,上下文工程与自动化执行成为核心驱动力。

  1. 2026-07-26:Claude Code 2.0发布,团队分享将系统提示词精简至20%以下的上下文工程新法则,开发者跟风精简提示词。(Jerry Liu(@jerryjliu0) / 花叔 / AICodeKing / AINLP)
  2. 2026-07-30:Cursor披露其平台56%的合并PR由云端智能体完成,编程工具接管率突破关键节点。(Cursor(@cursor_ai))

3. 资本重金押注AI模型分发与算力扩容

本周AI基础设施层发生两笔重磅资本运作。Stripe被曝正洽谈以最高100亿美元收购API分发平台OpenRouter,收购价达其上轮估值的近8倍。同时英伟达向Ilya的SSI注资50亿美元,助力其未来12个月算力提升10倍。这显示资本正加速向算力源头与模型分发渠道集中,通过控制底层资源来掌握产业话语权,核心基础设施的马太效应愈发显著。

  1. 2026-07-26:Stripe被曝正洽谈以最高100亿美元收购OpenRouter,重塑AI模型分发层格局。(AI Will(@FinanceYF5))
  2. 2026-07-27:Ilya的SSI获英伟达新一轮重大投资,内部已准备将算力提升10倍以进行scaling。(orange.ai(@oran_ge))
  3. 2026-07-28:消息确认英伟达向SSI投资50亿美元,为其在AI热潮中规模最大的几笔投资之一。(AI Will(@FinanceYF5) / AI寒武纪)

4. 开源与闭源模型在Arena榜单交替领先

月之暗面的Kimi K3发布后迅速在Fireworks等五大平台同步部署,并在Agent Arena和Frontend Code Arena拿下开源模型及总榜第一。但仅一天后,Claude Opus 5 Max杀入榜单双双反超。开源与闭源模型在真实任务评测上的榜首拉锯战进入白热化,竞技场全栈评测正成为衡量前沿模型能力的核心标尺。

  1. 2026-07-27:Kimi K3上线多平台,在Agent Arena和Frontend Code Arena登顶开源及总榜第一。(Fireworks AI(@FireworksAI_HQ) / Windsurf(@windsurf_ai) / OpenRouter(@OpenRouterAI) / lmarena.ai(@lmarena_ai))
  2. 2026-07-28:Anthropic的Claude Opus 5 Max杀入Frontend Code Arena和Text Arena,反超Kimi K3登顶,Arena新增全栈能力测试。(AI Will(@FinanceYF5) / lmarena.ai(@lmarena_ai))

5. AI发现人类未察的密码学算法漏洞

Anthropic宣布使用Claude模型研究加密算法,成功找到人类专家审查多年未发现的漏洞。其中对AES的攻击优化了破解难度,对HAWK数字签名方案的破绽也得到确认。虽然这些发现目前尚无实际系统影响,但这是AI首次在纯密码学研究中补齐人类盲区,预示着AI在数学与安全研究中的角色正从辅助工具走向自主发现者,拓展了基础研究的边界。

  1. 2026-07-28:Anthropic公布让Claude研究AES和HAWK加密算法,模型成功发现人类专家未审查出的破绽。(Anthropic(@AnthropicAI))
  2. 2026-07-29:业界关注并讨论Claude发现的加密漏洞,Anthropic澄清此发现暂无实际系统影响,但仍属重大研究进展。(Yangyi(@Yangyixxxx) / Anthropic(@AnthropicAI) / Simon Willison's Weblog)

BRIEFS

本周其余要闻

SHELF

本周书架

【案例】Dogfooding at scale: migrating cdnjs to Cloudflare’s Developer Platform

大规模自用迁移到云原生开发平台时,哪些坑必须提前踩平。

查看摘要与阅读入口

【教程】Product Experimentation with Instrumental Variables: Unconfounding LLM Routing Decisions in Python

用工具变量法消除LLM路由实验中的混杂偏倚,拿到可信因果结论。

查看摘要与阅读入口

【案例】多区域架构中的权衡:延迟与成本

多区域部署时如何在延迟与成本之间做量化权衡。

查看摘要与阅读入口

【教程】一文读懂怎么让 Agent 理解业务,别一上手就写 Prompt!

先梳理业务上下文再写Prompt,避免Agent上线即跑偏。

查看摘要与阅读入口

【案例】AI Coding的下一站,不是更会写代码,而是更懂团队

理解AI Coding从单兵效率走向团队协作的演进方向与落地路径。

查看摘要与阅读入口

RECALL

观察回收

NEXT WEEK

下周观察