1. 大模型进入分层受控释放阶段,GPT-5.6与国产模型齐发
本周GPT-5.6系列(Sol/Terra/Luna)正式发布并合并Codex,OpenAI通过额度重置机制进行分批受控释放。同期,马斯克Grok 4.5以骨折价杀入战场,腾讯Hy3与蚂蚁灵波具身原生模型相继开源或发布。然而,在跑分上GPT-5.6虽追平Fable 5,但在深度协作与稳定跑完任务的实测中仍显短板。大模型竞争已从单纯的参数比拼,转向分层定价、产品整合与产业闭环构建,token市场正式进入存量替换与价格战阶段。
- 2026-07-05:多源跟进(浮之静 / 掘金本周最热)
- 2026-07-06:编程实测显示Fable与GPT各有优劣,Agent稳定跑完任务比看起来强更重要。(Gary Marcus(@GaryMarcus))
- 2026-07-08:GPT-5.6即将发布,Fable延期退出,大模型发布进入分层受控阶段。(浮之静)
- 2026-07-09:Grok 4.5以不到一半价格硬刚GPT与Claude,模型价格战正式开打。(CSDN)
- 2026-07-10:OpenAI发布GPT 5.6系列,Codex成为ChatGPT超级App;蚂蚁灵波发布具身原生模型。(Latent Space / 量子位 / 夕小瑶科技说 / 硅星人Pro)
- 2026-07-11:GPT-5.6全面上线引发额度重置,跑分虽高但实测深度协作落后于Fable 5。(掘金本周最热 / meng shao(@shao__meng) / Latent Space)
2. AI编程工具成新攻击面,供应链安全面临全面重构
随着AI编程工具渗透率极速攀升,其自身正成为供应链攻击的新入口。本周工信部通报Claude Code内置后门私自回传敏感信息,阿里随后全员禁用。同时,安全审计发现主流AI代理易受供应链注入攻击。从苹果代工厂630GB机密泄露到埃森哲源代码外泄,攻击面已从代码延伸至制造与凭证端。AI生成工作流暴露出结构性安全盲区,企业安全准入正在取代单纯的能力验证成为首要考量。
- 2026-07-06:TeamPCP攻陷开发工具发动供应链攻击,苹果代工厂630GB机密文件泄露引发关注。(绿盟科技研究通讯 / 网安寻路人 / 代码卫士 / 中国信息安全 / 青藤云安全)
- 2026-07-07:AI智能体安全治理焦点从输出风险转向行动风险,AI生成工作流被指存在结构性盲区。(安全威胁情报 / 数世咨询 / 觉学社)
- 2026-07-08:工信部预警Claude Code存在安全后门,多版本私自回传敏感信息。(小互(@imxiaohu) / 掘金本周最热 / The JetBrains Blog / InfoQ 中文 / CSDN)
- 2026-07-09:安全审计反中招,Claude/GPT-5.5 AI代理遭供应链注入;埃森哲35GB机密数据疑泄露。(看雪学院 / 中国信息安全 / 代码卫士 / 互联网安全内参 / 安全客)
- 2026-07-10:27.1%企业中招AI安全暗礁;GhostLock内核漏洞与苹果暗网数据泄露连环引爆。(安全牛)
- 2026-07-11:阿里全员禁用Claude Code,编程工具信任链断裂,安全准入取代能力验证。(天黑说嘿话)
3. 【封面】模型不再是唯一变量,Harness工程重塑Agent基础设施
本周业界共识显著向“Harness Engineering”倾斜:模型能力提升的边际效应递减,包裹模型的系统与工程实践成为新竞技场。Karpathy的实验表明76%的性能提升与模型无关,而在于Harness。从TS 7.0用Go重写以突破AI生成代码瓶颈,到Agent不再依附于聊天界面而是重写整条基础设施,知识工作正变成维护循环系统。企业最小单元从“人加岗位”转变为“人加Token加流程”,Agent的“托付半径”拉长,但工程可控性成为前提。
判断:2026下半年,企业Agent投入重心将从模型选型转向Harness工程层,模型无关性能提升占比将超60%——若未实现则证伪。 置信:高
边界:不判断具体Harness工具栈的胜出者与商业化路径;缺企业级量化基线与跨场景稳定性数据。
- 2026-07-05:多源跟进(新智元 / AI前线 / 硅星人Pro / 创业邦)
- 2026-07-07:Karpathy实验揭示Agent性能提升76%与模型无关,关键在包裹模型的Harness系统。(AI前线 / Datawhale / AI Engineer)
- 2026-07-08:Lilian Weng总结35篇RSI论文,a16z探讨Agent是否不需要界面,AI基础设施需为Agent体验演进。(Latent Space / 深思圈 / 爱范儿 / AI前线 / 阿里技术)
- 2026-07-09:TS 7.0正式发布,用Go重写成为AI生成式代码的拐点与基建瓶颈。(腾讯云开发者 / 前端充电宝 / 浮之静)
- 2026-07-10:Codex与ChatGPT合并标志Agent时代到来,知识工作变为维护循环系统。(少数派 / 爱范儿 / AI产品黄叔 / 阿里技术 / 腾讯技术工程 / 小米技术)
- 2026-07-11:Agent产品形态向任务工作台演进,前端工具链加速锈化,企业组织逻辑被改写。(爱范儿 / 数世咨询 / 看雪学院 / 绿盟科技研究通讯 / 安全圈 / 漏洞战争)
4. AI对科技人冲击升级,从技能焦虑演变为身份焦虑
年度科技劳动力调查显示,AI对从业者的冲击已从“技能过时”升级为深层的“身份焦虑”。当前科技从业者最大的担忧并非直接失业,而是“加量不加薪”下的过度劳动。管理者被证明是工作幸福感最大的杠杆。同时,AI正在将科技从业者分割为不同群体,分裂线比技术能力更深。Meta等产品团队开始探索由4-6名通才工程师加新角色组成的敏捷结构。公司的最小单元正从传统的“人加岗位”重构为“人加Token加流程”。
- 2026-07-08:微软Xbox启动史上最大规模重组,管理者被视为工作幸福感的最大杠杆。(CSDN / Lenny Rachitsky(@lennysan))
- 2026-07-09:调查显示从业者最大AI焦虑不是失业,而是加量不加薪,身份焦虑浮现。(Lenny Rachitsky(@lennysan))
- 2026-07-10:Mosseri提出2026年标准产品团队模型,由通才工程师与新角色组成。(掘金本周最热 / Lenny Rachitsky(@lennysan))