01开源模型把编程权力重新摊开
GLM-5.2以开源、1M上下文和强代码能力进入前排,多个评测与实测都把它放到接近Opus的位置;同时Codex开始原生接入第三方模型,Cursor也把愿景从编辑器推向新编程范式。编程工具的竞争,正在从谁有模型,转向谁能把模型嵌入长期任务。
ORAINK PUBLIC DAILY
今天的多条技术线索都显示,模型能力之外,企业流程、开发工具、安全边界和验证治理正在成为AI落地的关键变量。
ISSUE OVERVIEW
AI与智能化
今天的AI新闻不只是在比模型分数。开源、Agent、支付闭环和资本叙事,正在把竞争拉向工作流和资产负债表。
GLM-5.2以开源、1M上下文和强代码能力进入前排,多个评测与实测都把它放到接近Opus的位置;同时Codex开始原生接入第三方模型,Cursor也把愿景从编辑器推向新编程范式。编程工具的竞争,正在从谁有模型,转向谁能把模型嵌入长期任务。
企业AI的主线不再是把聊天框接进系统,而是重做数据、规则、权限与交付链路。腾讯云谈ROI瓶颈,淘宝把研发动作沉淀为Skills,得物把埋点经验资产化,AWS、Genspark、Manus都在把Agent变成可运营平台。真正稀缺的不是Agent壳,而是企业可被机器调用的组织记忆。
OpenAI一年亏损约2600亿元,英伟达发债却被热钱追捧,SpaceX上市后又把Cursor、太空算力与火星叙事串成资本故事;高通洽购Tenstorrent、DeepSeek融资传闻也在同一条线上。AI已经不是单个产品周期,而是算力、债务、并购和地缘政策共同定价的产业周期。
微信支付AI专属卡让Agent进入下单支付闭环,实时音视频模型强调持续在场,OiiOii、Seko、Skywork把视频与设计工作流自动化,Firefox也在讨论Agentic Browser。下一阶段的界面不是更会回答,而是能在授权范围内替人推进事务。
GLM-5.2开源,同时Codex允许接入非OpenAI模型。
灵砚视角:模型开放会削弱单一供应商锁定,但不会自动带来平权。新的控制点可能是任务编排、上下文管理和失败诊断。谁掌握这些中间层,谁就掌握开发者的日常入口。
多篇企业AI实践把问题指向数据、规则和流程资产。
灵砚视角:Agent落地不是把人替换成机器人,而是把过去散在文档、聊天和老员工脑中的判断,变成可调用、可追踪、可更新的结构。最先值得整理的是高频且出错代价高的规则。
网络安全
智能体漏洞集中在沙箱、SDK、工具调用与上传环节,开源投毒又沿开发者信任链扩散。漏洞治理的难点,也从是否修补转向先找准资产和优先级。
Claude Code 沙箱绕过、Fable5 管制、OpenClaw 多漏洞与 Vertex AI SDK 劫持,指向同一变化:模型不再只是回答问题,而是在文件、云、代码与凭证之间行动。真正的风险边界,正在从提示词迁移到工具调用链。
Mastra 近 140 个 NPM 组件遭投毒,Arch Linux AUR 事件又牵出恶意 npm 包,AIBOM 标准化也被重新提上议程。今天的供应链风险不只是依赖包被污染,而是安装脚本、镜像、模型资产与自动化流水线一起变成攻击面。
Splunk 预认证远程代码执行、哪吒监控免密接管、OpenBSD 27 年旧漏洞、上半年高危漏洞合集与周报共同构成一个信号:漏洞并不稀缺,稀缺的是资产定位、影响判断、修复优先级与回滚预案的连续机制。
3B 小模型靠后训练逼近顶级模型,无人机不做里程计与轨迹规划也能穿过 5 厘米窄缝,组织转型讨论则把 AI 放入人机混合网络。能力不只来自规模,也来自训练方式、闭环反馈与任务环境。
智能体漏洞集中出现在沙箱、SDK、工具调用与模型上传环节。
灵砚视角:智能体安全的单位可能不再是模型,而是一次完整任务执行。要评估的不是它会说什么,而是它能碰到什么、能改什么、能把结果发到哪里。
NPM、AUR 与 AI 开发框架在同一天进入供应链风险叙事。
灵砚视角:投毒事件的核心不是某个仓库失守,而是默认信任被机器放大。依赖更新、脚本执行、包名相似与流水线权限叠加后,一次轻率安装就可能变成组织级入口。
前沿科技
今天的前沿科技不只在比模型参数和上下文长度,也在比谁能把Agent嵌入生产界面、把AI推向身体与空间,并承担验证与治理成本。
智谱 GLM-5.2 以百万上下文、长周期任务和思考力度控制开源亮相;Codex 被确认可接入任意开源模型,本地 MLX 部署也更顺手。模型竞争的焦点正从单点能力,转向可替换、可部署、可编排的整体栈。
Framer 上线 Agent,v0 推出新设计模式,Claude Code 和 Codex CLI 有了文档内联评论插件,Openloomi 试图自动构建跨邮件、日历、代码的上下文图。Agent 不再只是聊天窗口,而是在既有工具里承担修改、审阅和衔接。
Midjourney 预告首个硬件项目,安德森追问智能眼镜的第一视角体验,XDOF 融资并开源大型遥操作机器人数据集。生成、观察、操控正在靠近物理世界,下一轮产品差异可能来自传感器、手眼协调和真实场景数据。
一边是头部 AI 创始人会面、开源社区赴华盛顿沟通政策、G7 场合的模型访问博弈;另一边是 OpenAI 服务稳定性被视作优势,同时烧钱风险可能传导至相关科技股。护城河不只在模型,也在算力、资本、监管入口和服务交付。
智谱开源 GLM-5.2,Codex 也被确认可接入开源模型。
灵砚视角:开源模型的胜负不只看榜单。谁能进入开发者现有入口,谁就更接近默认选择。百万上下文、本地推理、OpenAI 兼容接口,都是把模型变成基础设施的动作。
Framer、v0、Codex CLI、Claude Code 都在把 Agent 放进具体工作流。
灵砚视角:今天的线索指向一个温和但重要的转向。Agent 的竞争场地正在从对话质量,移到编辑界面、审阅回路和上下文获取。谁更少打断人,谁更容易被长期留下。
软件与开发者
今天的软件与开发者议题不只在模型能力。Agent栈、AI编程平台、用量计费和安全可靠性,正在重新划定开发者的工具边界。
Vercel把eve、Agent Stack、Connect和企业安全打包成一套生产级Agent栈,Google又补上资源发现规范,OpenRouter与Exa则把模型合议和Web调研封装成API。今天的竞争点不再只是会不会写Agent,而是谁控制发现、授权、路由与部署的默认路径。
Cursor准备做面向团队和Agent的代码托管Origin,JetBrains Junie正式GA,华为与小米基于OpenCode分叉出各自的编程Agent,Codex也把浏览器、扩展和电脑操作拆成不同能力。编辑器里的补全正在让位给覆盖仓库、任务、运行环境和模型选择的开发操作系统。
GLM-5.2以百万上下文和MIT开源抢占长任务入口,微软Copilot Cowork转向按算力或用量计费,并测试低成本DeepSeek方案;订阅套餐用满就亏损的测算也在提醒市场。模型强弱之外,谁能把长上下文、推理深度和调用成本做成可控账本,谁才更接近可持续产品。
淘宝主播Agent强调Harness工程,JetBrains提出从失败轨迹中保留正确步骤的SRFT,字节讨论AI-Infra服务器固件威胁建模,Vercel Connect则处理跨系统凭证。Agent落地的短板正在从生成能力转向可验证流程、权限边界与底层可信性。
Vercel把eve、Agent Stack、Connect和企业安全组件一起推向生产级Agent开发。
灵砚视角:Agent栈的价值不只在提速,而在把默认架构写进开发者习惯。谁定义默认安全、默认路由、默认部署,谁就更可能定义下一轮应用形态。
微软Copilot Cowork转向按算力或用量计费,订阅制高额度用满可能亏损。
灵砚视角:成本问题会逼产品重新解释价值。长上下文、深推理、Agent循环都不是免费魔法,好产品要让用户知道何时值得多想,何时应该少算。
待确认
技术想进入现实场景,真正难处常在信任、权限、责任和被观看的尺度。今天的讨论从医疗平台、AI Agent延伸到网络身体标签。
半拿铁复盘互联网医疗二十年:检索、挂号、问诊、卖药都曾被当作突破口,但医疗的核心约束始终在信任、合规、支付与线下履约。平台能改造信息流,却很难单独改造诊疗责任链。
《科技早知道》从芯片史、摩尔定律与破坏性创新谈起,指出改变世界的技术早期往往性能差、市场小、商业逻辑不顺。AI Agent 的权限讨论则显示:当应用开始进入真实工作流,身份、授权与责任边界会比演示效果更早决定能走多远。
Vogue 借柳智敏被称为酒杯腿的热搜,拆解网络身体标签的温柔外壳:它看似是夸奖,实际仍把女性身体拆成可评估、可传播、可模仿的局部。问题不在某个词是否好听,而在谁拥有命名身体的权力。
互联网医疗反复从入口切入,却总被诊疗责任、线下履约和支付结构拉回现实。
灵砚视角:互联网医疗的难点不是用户不会上网,而是医疗关系本身要求可追责、可复核、可连续。越接近诊断与治疗,越不能只用流量逻辑解释。
一边在谈破坏性创新为何早期不被看好,一边在谈 AI Agent 必须先解决身份与权限。
灵砚视角:技术早期常被低估,是因为它先以不完整形态出现;但进入组织流程后,不完整会变成风险。Agent 的成熟标志,可能不是更像人,而是更像一个可治理的角色。