灵砚 oraink
公开刊物索引日报 sitemap周报 sitemapLLM 索引

ORAINK PUBLIC DAILY

OpenAI研究接受学术诚信检验,AI定责与编码工具同日校准

OpenAI 的纳维-斯托克斯研究正接受学术诚信检验,司法侧着手划定 AI 责任认定规则,Claude Code 牵动开发者人才流动,企业侧聚焦智能体安全与威胁情报。研究的可信度、规则的边界与工具的落地,今天可以对照着读。

日期2026-09-09
Vol323
公开精要66
阅读6 分钟

ISSUE OVERVIEW

本期概览

AI与智能化

AI与智能化

01OpenAI 宣称解开千禧年难题,AI 数学从助手变主角

OpenAI 宣布用约 1 万个协同智能体、耗时 88 小时,在能力超出 GPT-6 Astra 的未发布模型上得到纳维-斯托克斯方程的解,并附 Lean 形式化证明。此前合作数学家 Buckmaster 指控 OpenAI 试图抢先刊发、并要求移除竞品公司合作者署名,OpenAI 随后发文祝贺两位数学家,称自家智能体用下一代模型得出了另一个证明。同行评议尚未完成——「AI 产出原创数学」与「更强的下一代模型已在场」,两件事今天同时坐实。

  • #openai
  • #ai-research
  • #navier-stokes
  • #智能体
  • #数学

02英伟达 129 亿买下 Hugging Face:开源门户归了芯片厂

英伟达以 129 亿美元收购 Hugging Face,这个开源模型与数据集的事实门户由法国创始人创办,却自创立起就注册在美国。开源的分发层就此握进芯片厂手里。几乎同一时间,Mistral 官宣 30 亿欧元 D 轮融资,创下欧洲科技公司股权融资纪录,资金投向训练与推理算力,主打开放与主权 AI;其 CEO 在访谈中说,没有企业愿意让自己的智能被锁死在单一供应商手里。

  • #nvidia
  • #hugging-face
  • #收购
  • #mistral
  • #开源

03DeepMind 开放 90 亿变异图谱背后,基因解读进入搜索时代

DeepMind 发布 AlphaGenome Atlas,把人类基因组约 90 亿个单字母变异的预测影响装进约 1PB 的可搜索数据库,学术研究免费开放,并提供整合 AlphaGenome 与 AlphaMissense 的 AVI 评分,可按致病影响给突变排序。Hassabis 将其对标 AlphaFold 之于蛋白质宇宙。「这个变异有没有害」正在从一项项实验变成一条查询语句;官方同时注明,Atlas 暂不支持临床用途。

  • #deepmind
  • #alphagenome
  • #基因组
  • #ai-for-science

04面壁智能开源 2B 端侧模型,大厂首次连数据带配方交底

面壁智能开源 2B 端侧模型 MiniCPM5-2B,AA 榜单 4B 以下开源基座综合第一,初具端侧通用 Agent 能力,并完成多家芯片厂商适配。更激进的是配套:训练数据、数据治理框架、RL 框架与训练配方一并交出,报道称这是大厂首次开放全链路训练资产。当数据和配方都进了开源包,「权重即护城河」又被推远一步,端侧 Agent 的竞争提前到 2B 参数量级。

  • #面壁智能
  • #minicpm
  • #开源模型
  • #端侧

网络安全

网络安全

01最高法发布首部AI司法规则:幻觉侵权进入可裁判时代

9月7日,最高人民法院发布《关于依法审理涉人工智能纠纷案件的意见》,中国首部专门审理涉AI纠纷的司法规则落地。文件明确了「AI幻觉」侵权的裁判标准,并划出「避风港规则」在AI场景下的适用边界,平台时代的责任框架第一次要正面回答模型时代的问题。王利明撰文解读,称其兼顾发展与安全。对AI产品方而言,责任认定从讨论层进入了可诉讼层。

  • #ai-governance
  • #司法规则
  • #责任认定

02ScreenConnect 0day 在野:RMM 成跳板

ConnectWise 证实 ScreenConnect 曝出无补丁、暂无 CVE 编号的 0day 漏洞,黑客已在野外利用它投放木马,官方仅给出临时缓解措施,正式补丁要到本周晚些时候。无独有偶,N-able 也为 N-central 平台的 CVSS 满分 RCE 漏洞发布紧急热修。远程管理厂商接连中招,掌握海量终端控制权的 RMM 工具正成为攻击者性价比最高的入口,补丁落地前的暴露窗口全靠缓解措施撑着。

  • #vulnerability
  • #RMM
  • #在野利用

03美国国防部合同曝光:四家头部大模型深度绑定美军

对美国国防部与四家头部AI厂商公开合同记录的梳理显示,「大模型军用」已从传闻变成可核查的合同事实,顶尖模型正在合同层面接入美军体系。同一家模型既是消费品又是国防资产,双重身份叠加之后,漏洞披露节奏、安全研究边界、模型行为审计义务,都可能被国防需求重新划定。而军事场景下的AI治理,还没有跟上部署的速度。

  • #军事AI
  • #ai-governance
  • #国防

04百元植入件 60 秒接管波音 737 航电:不走网络走端口

USENIX Security 2026 公开的 Bus Driver 攻击显示,一枚成本不足百美元、硬币大小的植入设备,只需 60 秒接入波音 737 未上锁的维护端口,就能对航电总线实施中间人劫持。攻击链全程不碰网络,安全投入最重的客机,短板出在物理接触面。航空防护长期围着网络与软件打转,维护端口的门禁与审计,此刻成了比防火墙更前置的防线。

  • #物理安全
  • #航空安全
  • #research

最高法发布首部涉AI纠纷审理意见,明确「AI幻觉」侵权与避风港规则的适用边界。

幻觉侵权的责任会停在模型层,还是层层下压到应用与部署方?

灵砚视角:司法规则把AI责任从「要不要管」推进到「如何裁量」。避风港被重新画界,模型服务第一次与平台责任同框。后续个案里,模型商、应用方、部署者之间的举证分配,才是这部文件真正的试金石。

美国国防部与四家头部AI厂商的军事合作合同被公开梳理,大模型深度进入美军体系。

当头部模型同时是消费品和国防资产,公开的安全研究会否被重新划线?

灵砚视角:合同让「军用大模型」从传闻变成可核查的事实。双重身份会重塑披露节奏——同一个漏洞,在商业场景可公开报告,在国防场景可能直接涉密。安全社区需要提前想清楚这条线画在哪里。

前沿科技

前沿科技

01OpenAI 被指抢发千禧年难题成果,学界合作信任承压

纳维-斯托克斯千禧年难题争议发酵:独立研究者 Tristan(Buckmaster)与 Anthropic 员工 Levent 的成果,被指在 OpenAI 得知后遭投入数百万美元抢先复现,Levent 还被要求移除署名。Thomas Wolf 怒斥这是对待数学家工作的恶劣方式,Gary Marcus 呼吁关停 OpenAI 直至换帅。今日 Bubeck 澄清从未要求移除署名,OpenAI 亦称成果独立于两位数学家。真正的赌注是学界与 AI 实验室的合作信任——若抢发成为惯例,预印本共享将首先受损。

  • #OpenAI
  • #学术诚信
  • #纳维-斯托克斯
  • #署名争议

024.9 亿到 9 亿:Cognition 重写 AI 编程估值

Cognition 宣布完成超 20 亿美元融资,投后估值 480 亿美元;更硬的是收入曲线:自 5 月上轮以来,年化收入从 4.92 亿美元增至近 9 亿美元,四个月近乎翻倍。公司同期给出愿景:下一代软件工程里智能体默认主动、软件自我优化。AI 编程公司的估值锚点,正从叙事换成收入增速。480 亿美元约为当前年化收入的 53 倍,赌的是增速能否持续。

  • #Cognition
  • #AI 编程
  • #融资
  • #估值

03Mistral 30 亿欧元 D 轮背后,开源补齐资本短板

Mistral 完成 30 亿欧元 D 轮融资,Thomas Wolf 称这是开源领域最大级别的股权融资,Hugging Face 联合创始人 Delangue 与 CTO Chaumond 相继道贺,后者还透露正升级基础设施、准备托管这家法国公司的新模型。开源路线长期被质疑缺钱,如今弹药到位。Delangue 的贺词很直白:Mistral 对所有人都是激励。

  • #Mistral
  • #开源
  • #融资
  • #Hugging Face

04英国将提全球首个超级智能禁令,AGI 炒作遭反噬

据 Gary Marcus 披露,英国即将提出全球首个禁止超级智能的 AI 安全法案。他认为法案可能拖累前沿 AI 产业,但巨头们此前的过度炒作等于亲手招来监管;他同时表态百分百赞同 Hinton 的安全立场,并支持 AI 安全集体行动:在证明风险足够低、取得多数人同意之前,研发竞赛应当先慢下来。一边是抢跑宣布 AGI,一边是立法禁止超级智能。

  • #英国
  • #AI 监管
  • #超级智能
  • #AGI

OpenAI 被指抢在数学家发布前复现同类成果,今日声明研究独立于两位合作者

当算力可以加速复现学术成果,优先权规则还保护得了先发现的人吗?

灵砚视角:争议核心不是证明对不对,而是发布时序变成了竞争资产。实验室有工程团队,能在数月内复现学界经年的工作;若署名可以含糊处理,合作就成了单向透明。学界最可能的反击,是重新收紧预印本与共享的边界。

英国将提出全球首个超级智能禁令法案,Marcus 称炒作者咎由自取

监管红线画在遥远的超级智能,会不会放过眼前的具体伤害?

灵砚视角:抢跑 AGI 与禁止 ASI 互为镜像,都在用大词说话。可信的监管落在具体处:署名怎么算、用户数据能否拿去训练、安全测试谁来复核。红线画得太远,近处的失序反而容易无人认领。

软件与开发者

软件与开发者

01Claude Code 收编前端权威 Addy Osmani

Addy Osmani 宣布离开效力多年的 Google,加入 Anthropic 负责 Claude Code。这位定义了一代 Web 性能话语权的前端权威,近期公开输出已经全是 Agent Harness、Skills 与分层代码审查:他判断 Coding Agent 造成的 PR 数量爆炸让人工审查追不上,人力应该按爆炸半径分层投放。上一代前端布道者转身去造 Agent,工程重心正在迁往工具层。他此前的身份,恰是教全行业写更好前端代码的那个人。

  • #AI 编码
  • #人才流动
  • #Claude Code

02DHH 宣告手写代码终结,50 万客服 Agent 一周关停

同一个 24 小时里出现两条方向相反的事实:Ruby on Rails 之父 DHH 在采访中说,AI Agent 已能完成全流程开发,手写代码时代正在终结,「我已经变得可有可无」;另一边,一位老板投入 50 万做的电商全自动客服 Agent,上线一周就因故障关停,案例复盘给出的是一串落地教训。能力的天花板和工程的地板之间,从来没有这么空旷——宣言免费,落地按失败计价。

  • #DHH
  • #AI 编码
  • #Agent 落地

03GPT-6 开放第六天:OpenAI 劝你拆掉旧 Skill

GPT-6 Astra 开放第六天,官方口径出现新转向:旧模型时代积累的宽泛 Skill 和 AGENTS.md 规则,在新模型上会造成负优化,OpenAI 建议开发者做一次大扫除。提示词资产开始按模型代际折旧,每升一代模型,就附赠一次迁移成本。同日流传的还有 GPT-6 Astra 官方提示词最佳实践,以及 Claude Fable 5.1 与 GPT-6 Astra 各自的写作风格指南。

  • #GPT-6
  • #OpenAI
  • #提示词工程

04Vercel CDN 改包月,流量爆红不再等于账单爆炸

Vercel 面向 Pro 团队的统一费率 CDN 正式 GA:固定月费替代按量计费,内容突然爆红不再直接换算成账单失控,rauchg 的说法是可以放心在 X 上走红。可预测的成本本身成了新卖点,按量计费在流量尖峰越来越常见的 AI 年代开始失宠。首发面向 Pro 团队,原有按量模式被整体替代。

  • #Vercel
  • #CDN
  • #计费模式

DHH 说手写代码时代正在终结的同一天,一个 50 万预算的客服 Agent 上线七天就被关停

天花板宣言和地板事故之间,多数团队的位置由模型决定,还是由工程决定?

灵砚视角:两者并不矛盾。DHH 讲的是能力上限,50 万案例暴露的是工程下限,数据、流程、兜底都没跟上。模型换代抬不动地板,落地能力反而成了稀缺品。这 50 万买到的,正是这堂课的学费。

OpenAI 官方承认旧 Skill 与 AGENTS.md 对 GPT-6 是负优化,建议清理

提示词资产按模型代际折旧后,该投资可沉淀的规则,还是可抛弃的流程?

灵砚视角:这相当于把提示词工程从资产拉回耗材思维。不随模型换代贬值的是评测集和回归用例,它们度量结果而非指挥过程。这次折旧的是 Skill 和 AGENTS.md,下一次模型升级,账单还是会找到每个团队。

云计算与企业服务

云计算与企业服务

01谷歌 GTIG 季报:攻击者转向劫持智能体工作流

谷歌威胁情报小组 GTIG 发布 2026 年 Q2 AI 威胁追踪报告,核心判断是攻击者完成了一次换代:从基础提示词攻击转向劫持自主智能体工作流,AI 供应链与企业 AI 资产取代模型本体成为核心目标,攻击效率大幅提升。上周 LiteLLM 被拉进 KEV、智能体答案外溢公网,都与这条曲线同向。报告发布同日,两大云厂商还在密集上架企业智能体工具——部署面扩张到哪,攻击面就跟到哪。

  • #AI 安全
  • #智能体
  • #威胁情报

02微软 AWS 多云互联背后:AI 时代云围墙开始松动

微软与 AWS 联合推出 Azure Multicloud Interconnect,基于开放 API 规范简化两朵云之间的私有连接,明确面向 AI 时代的跨云部署。同日另一篇稿件里,微软强调 Azure 是端到端企业 AI 平台,并亮出 Gartner 与 Forrester 双机构领导者认定。网络层向对手开放,平台层往自家收拢,多云正从企业的权宜之计变成厂商主动铺设的基建。

  • #多云互联
  • #云战略
  • #AI 基础设施

03Astra 第六天进驻 Foundry,转战企业市场

GPT-6 Astra 开放第六天,宣布在 Microsoft Foundry 全面可用,企业级安全合规管控与多种部署、定价选项同步到位。此前五天的舆论焦点是跑分与 30 分钟长任务实测,今天这一步把战线拉进企业采购通道:前沿模型的比拼正从基准测试转向分发渠道,微软仍是 OpenAI 进企业的默认大门。

  • #GPT-6 Astra
  • #微软 Foundry
  • #企业落地

GTIG 季报判断攻击者已从提示词攻击转向劫持自主智能体工作流,同日两大厂商仍在密集上架企业智能体工具

智能体普及提速,安全责任该由平台兜底还是企业自证?

灵砚视角:这份报告把零散事件收拢成趋势,攻击面始终贴着部署面移动。厂商密集上架智能体中枢,每个新入口都是新的暴露面,安全能力正在取代模型能力,成为智能体普及的速度上限。

微软同日宣布与 AWS 的多云互联,又亮出 Azure 端到端平台的 Gartner 与 Forrester 领导者认定

网络层打通之后,云的护城河会上移到平台层还是模型层?

灵砚视角:微软同日做两件方向相反的事,给对手开网络通道,把企业往自家平台收。互联卖的是流量,平台抢的是入口,微软赌入口更值钱。跨云连接会越来越便宜,真正的锁定正在平台层发生。