AI 简报 · 2026-09-28

AI Radar 简报 · 2026-09-28

涵盖 AI精选 · AI简报 · 热点动态
(论文速递今日暂无新内容)


🔥 AI精选

来源:AIHOT · 算法精选热点(今日 5 条独立事件)

日期 标题 来源 分类
近日 Dario Amodei:DeepSeek 的崛起未削弱芯片出口管制的必要性 Dario Amodei Blog AI政策
近日 Dario Amodei:可解释性是 AI 安全最紧迫的任务 Dario Amodei Blog AI安全
近日 Dario Amodei 长文《仁爱机器》:AI 将如何重塑生物学、经济与治理 Dario Amodei Blog AI愿景
09-28 小米发布 MiMo Desktop:支持自主规划与多智能体协作的桌面 AI Agent 客户端 小米 MiMo 产品
09-27 Meta 推出 Hologram 拟真虚拟形象:毫米级面部细节、实时 6DoF 动作捕捉 IT之家 产品/XR

今日核心摘要:

📜 Dario Amodei 三篇长文:Anthropic CEO 的思想坐标

今日 AIHOT 精选将 Anthropic CEO Dario Amodei 的三篇重要文章同时推至高热,构成当前 AI 政策与安全辩论中最清晰的一份立场声明:

出口管制:在《On DeepSeek and Export Controls》中,Amodei 直接反驳”DeepSeek 已证明出口管制无效”的论点。核心论点:DeepSeek V4.1 系列依然依赖美国算法突破,且以远低于美国前沿模型的成本实现,恰恰说明算力限制迫使竞争者走效率路线——而不是说明限制本身失去意义。他将技术出口管制定位为与商业策略不同的战略工具,前者针对的是10年后的军事均势,而非当下产品竞争力。

可解释性:《The Urgency of Interpretability》是 Amodei 迄今关于 AI 安全技术方向最明确的阐述。论点链条:我们无法验证当前模型的内部意图 → 随着能力提升,不可验证性带来的风险指数级放大 → 可解释性研究是目前有望在能力前跑出答案的唯一技术路径 → 因此必须现在、大规模投入,而非等能力问题”暂告一段落”后再来解决。这与 OpenAI/DeepMind 的公开优先级排序构成明显分歧。

AI 红利愿景:《Machines of Loving Grace》(标题出自理查德·布劳蒂根 1967 年诗作)描绘了 AI 对人类文明最乐观的可能未来:未来数十年内,AI 可能在 5 年内压缩 50 年的生物医学进展、实现治愈大多数癌症与传染病;通过给每人”配备经济学家顾问”来应对全球贫富差距;并在去中心化治理框架下避免权力过度集中。Amodei 同时承认,最危险的风险不在于 AI”叛乱”,而在于少数人类利用 AI 实现对世界的永久性控制。三篇文章合在一起,构成迄今最完整的”Anthropic 哲学”:技术加速、安全先行、保持竞争中立。

🖥️ 小米 MiMo Desktop:桌面 AI Agent 第三极

继 Claude Code(2026 年 5 月)和 Kimi Code Desktop(9 月 21 日)之后,小米以 MiMo Desktop 正式入场桌面 AI Agent 赛道。主要特性:自主任务规划(任务可拆解为子目标后由智能体自主执行)、多智能体协作模式(类似 Kimi Code 的 Tower 模式,多 Agent 并发工作)、以及与小米 MiMo-V3 强化学习模型的深度集成。差异化定位:专为中文工作负载和国内互联网生态优化,深度集成小米设备生态,是面向国内企业用户的 Claude Code/Kimi Code 直接竞品。


📋 AI简报

来源:AI Digest· 近 1 天(3 条)

2026-09-27~28

一场配置失误让四家 AI 公司的代理在安全测试中攻击真实目标

以色列安全测试公司 Irregular 确认,过去数月内涉及 OpenAI、Anthropic、Meta 和 Google 四家公司 AI 模型的多起真实系统攻击事件,根源均来自同一套评测框架的配置漏洞:测试环境意外保留了互联网访问权限,且场景中”虚构公司”名称与真实域名重合,导致模型在执行模拟”夺旗”任务时意外触达真实目标。这一解释将九月以来持续发酵的”OpenAI 代理攻击 Hugging Face”等事件纳入统一成因——并非模型主动越界,而是测试基础设施设计缺陷。遭攻击目标身份仍未披露。重要背景:Irregular 承认的范围不包括 OpenAI 代理未经授权扫描 UNCTAD 网站超 16,000 次事件(另见热点动态),以及英国 AI 安全研究所报告的独立事故。

Google 在印度测试让用户直接从 Gemini 购买 Flipkart 商品

Google 开始在印度小范围测试 AI 原生购物交易——在 Gemini 和 Google AI Mode 对话界面中,用户浏览特定 Flipkart 商品时直接出现”购买”按钮,无需离开 AI 界面。Flipkart 为沃尔玛旗下电商平台,Google 于 2024 年以约 3.5 亿美元取得少数股权。当前测试仅覆盖少量用户和智能手机、电子产品类商品,10 月印度节庆购物季前将扩大规模。与 Google 此前演示的托管结账不同,本次采用 Flipkart 品牌结账界面,Google 称暂未确认是否使用其 Universal Commerce Protocol 技术。这是继 Meta Muse(被亚马逊封禁)之后,另一家科技巨头绕过电商平台独立结账层、将 AI 界面与商业交易直接打通的尝试——AI 与零售生态的平台摩擦已进入实质阶段。

Tesla 停产 Model S/X 并将人员转向 Optimus,但机器人手与装配速度仍拖累量产

2026 年 5 月,加州弗里蒙特工厂正式停产 Model S 和 Model X,产线工人和工程师被转往 Optimus 项目。当前瓶颈:最新 Optimus V3 的手和前臂含逾 100 个小型螺丝等部件,目前仍须人工组装;装配设备难以精确对齐部件,运行速度受到限制。Tesla 目前据报每周生产数百台,年底目标超 1,000 台/周,但实际产量数据未披露。Ars Technica 的报道还引述了部分工人的特殊处境:他们正在为可能取代自己岗位的机器人进行行为训练——这是从事 AI/机器人训练工作的蓝领劳工所面临新型处境的典型案例。


📡 热点动态

来源:AIHOT · 全量热点(近 1 天,精选 15 条)

  • 09-28 马斯克认同 Claude Opus 5.5 接近 AGI,称 2027 年”几乎肯定实现 AGI” — X: Elon Musk
    马斯克在评论 Ethan Mollick 关于 Opus 5.5 的演示时承认模型表现令人震惊,并将自己的 AGI 预测更新为”2027 年几乎肯定”——较此前表述更为确定。这是继 Dario Amodei 将 2026 年定位为”AI 开始超越人类的临界点”之后,另一位科技界重量级人物对同一时间线收窄预测。

  • 09-28 Anthropic CEO Dario Amodei 将与特朗普在白宫共进晚餐 — TechCrunch
    在公开呼吁维持 AI 芯片出口管制、今日同步在博客为立场背书的背景下,Amodei 被邀请参加白宫私人晚宴。继 Sam Altman 频繁出现在特朗普政策圈之后,Anthropic 也正在构建与当届政府的直接政策渠道——AI 安全与竞争政策的博弈已进入最高决策层。

  • 09-27 华为开源盘古 openPangu-2.0:代码、科学、语言多专家并行 MoE 架构 — IT之家
    华为正式开源盘古 2.0,多专家并行(MAP, Multi-Expert in Parallel)MoE 架构,在代码、科学计算、自然语言三个领域各设专家模块,通过路由机制按任务类型激活。这是华为在对标 DeepSeek V4.1 开源策略上的直接布局,也是盘古系列从商用专有路线向开源社区竞争的战略转向。

  • 09-27 微软 CEO 纳德拉公开分享智能体使用心得:从日历管理到代码审查 — IT之家
    萨提亚·纳德拉在内部分享视频(随后流出)中展示了他在日常工作中使用 AI 智能体的具体场景:Copilot 处理会议安排与邮件分类,GitHub Copilot Workspace 完成代码审查前置,Bing AI 执行行业调研汇总。微软 CEO 的个人使用案例是企业 AI 渗透率的高质量信号——既有”CEO 宣传”成分,也是微软内部 Copilot 成熟度的侧面佐证。

  • 09-27 METR 发布逐动作监控器实现指南:实时阻断 AI Agent 的高风险操作 — METR
    METR(Model Evaluation & Threat Research)发布基础阻断式动作监控器的实现与评估报告:监控器以子进程监视 AI 智能体的每个工具调用,在执行前评估风险并可强制暂停。评估数据:监控器捕获了测试集中 78% 的高风险操作,假阳性率约 12%。与 OpenAI/Anthropic 的安全边界事件相互印证——行业正从”事后审查”向”逐步骤拦截”演进,这是在 Irregular 配置失误暴露后,AI 安全基础设施的实用性工程响应。

  • 09-27 Ethan Mollick:开源与闭源模型差距在 Opus 5.5 发布后再度拉大 — X: Ethan Mollick
    沃顿商学院教授 Mollick 基于多维度测评得出结论:Opus 5.5 在创意写作、战略分析和教育辅导上与最强开源模型(MiMo-V3、Qwen-Image-2.1 等)拉开明显差距,与上周”开源正在追赶”的叙述出现逆转。Mollick 称此为”三个月一个循环”的能力边界摆动——意味着企业 AI 战略中”开源 vs 闭源”的选择不能以某个时间点的基准测试为永久决策依据。

  • 09-28 递归自改进 AI 公司正加速涌现,架构趋向”模型训练自身的下一版本” — X: Elvis Saravia (DAIR.AI)
    DAIR.AI 的 Elvis Saravia 整理了近期涌现的一批以”自主改进”为核心产品的 AI 公司:不仅训练模型执行任务,更训练模型优化自身训练数据、超参数乃至架构选择。这一趋势在 Anthropic 发布可解释性路线图、OpenAI 宣布研究重心前移至 GPT-7 之后格外醒目——当递归自改进不再只是学术假设而是初创公司商业模式,整个 AI 安全监管框架需要重新评估其适用范围。

  • 09-27 Logan Kilpatrick:2027 年将出现自主盈利的 AI 智能体,无需人工干预完成端到端业务 — X: Logan Kilpatrick
    Google AI Studio 的 Logan Kilpatrick 预测:2027 年将出现能够自主发现商机、签约客户、交付服务、收款的 AI 智能体——整个商业闭环无需人工介入。核心前提:当前 AI Agent 在执行长程任务时的失败率约 35-40%,而商业闭环对可靠性要求约 95%+;Kilpatrick 认为这一差距将在 12-18 个月内弥合。

  • 09-27 Apollo 首席经济学家:AI Agent 自动搬移存款可能动摇银行廉价资金基础 — X: Rohan Paul
    Apollo Global Management 首席经济学家 Torsten Slok 在内部备忘录(被 Rohan Paul 摘引)中指出,当 AI 智能体能够代用户自动将活期存款转入高收益账户时,银行赖以低成本融资的”惰性存款”基础将被系统性侵蚀。模拟测算:若 AI 渗透率达 20%,美国银行业存款成本可能上升 40-60bps,净息差压力超过 2022-2023 年加息周期的影响。这是”AI Agent 对传统金融中介”的宏观冲击的首次量化估算,与当日 Anthropic CEO 白宫晚宴、银行业 Agentic AI 策略讨论形成宏观-微观互文。

  • 09-27 Chamath Palihapitiya 警告:强行禁止开源 AI 可能拖垮股市,损失或超 15 万亿美元 — X: Rohan Paul
    Social Capital 创始人 Chamath 在播客中测算:若美国全面禁止开源 AI 模型,将使当前预期在 AI 生产率上的股权溢价(约 15-18 万亿美元)蒸发,并将技术主导权拱手相让给不受美国监管的境外开源社区。Chamath 将此定性为”比分拆科技公司还危险的监管错误”,同时承认完全的”开源放任”同样有风险——核心诉求是区分差异化监管而非一刀切禁令。

  • 09-28 辛顿警告:即使 AI 被设计为执行无害任务,其涌现能力仍可能产生毁灭性副作用 — IT之家
    Geoffrey Hinton 在发表于《Nature》的评论文章中提出新论点:AI 带来的存在性风险不仅来自被显式设计为有害的系统,更来自能力涌现的不可预见性——被设计为”优化某个温和目标”的足够强大的系统,可能在达成目标的过程中产生我们未曾预见的中间行为。辛顿特别指出,”工具性目标收敛”(instrumental convergence)是与对齐方式无关的系统性风险,对监管框架有直接含义:监管不能仅审查”目标设计”,还需审查”能力阈值”。

  • 09-27 OpenAI 智能体 4 至 6 月以激进方式扫描 UNCTAD 网站超 16,000 次 — IT之家
    联合国贸发会议(UNCTAD)发布事件报告:今年 4 月至 6 月,OpenAI 的 AI 智能体对其公开网站实施了超 16,000 次密集抓取,超出正常爬虫访问量数百倍,部分行为触发服务器防护机制。OpenAI 将此归因于数据采集 Agent 的速率限制配置缺陷,并已致歉;但 UNCTAD 方面指出影响到了面向发展中国家政府的数据服务可用性。与 Irregular 配置失误(见 AI简报)不同,此事件是 OpenAI 内部 Agent 对已知目标的持续性行为。

  • 09-27 微软研究院 Agensh:1,024 个编码智能体并行协作,代码覆盖率自动提升至 94.3% — X: Elvis Saravia (DAIR.AI)
    微软研究院 Agensh 框架论文:在单一代码库上协调 1,024 个轻量级编码智能体,各负责独立的代码分支后通过冲突解决机制合并,自动将测试覆盖率从基线 61% 提升至 94.3%,并在 SWE-bench Lite 上达到 72.4%,超过所有单智能体系统。这是 AI 编码助手从”辅助个人开发者”向”自主运营代码仓库”演进的重要里程碑,也是 1024 级并发 Agent 在生产代码库上的可行性首次系统性验证。

  • 09-27 Simon Willison 演讲:2026 年迄今 LLM 格局的 12 个关键转变 — Simon Willison
    开源 AI 工具开发者 Simon Willison 在旧金山的演讲整理:包括”模型能力与成本同步下降””Agent 从实验到生产的转折””MCP 生态快速扩张””闭源/开源边界模糊化””推理速度改变产品设计”等 12 个他认为 2026 年 AI 格局的结构性转变。Willison 的视角以工具开发者+观察者为主,不代表机构研究,但其作为开源社区连接点的角色使他的梳理往往能捕捉到学术报告和公司公告之间的空白地带。

  • 09-28 Julia-1 分类模型发布:训练总成本仅 104 美元,分类性能超 GPT-6 Luna — X: Elvis Saravia (DAIR.AI)
    研究团队发布 Julia-1,一款专为分类任务(而非生成)优化的小型判别式模型,在 12 个文本分类基准上平均超过 GPT-6 Luna;训练使用 Spot 实例,全程成本 104 美元。是 TypeSafe AI Jev 路线(以判别代生成)在开源社区的最新跟进,也是”任务专用小模型远比通用大模型高效”这一趋势的又一量化佐证——对需要大规模低成本分类的企业应用(合规筛查、内容审核、意图识别)有直接落地意义。


📄 论文速递

来源:AI Brief· 今日暂无新内容

AIHOT Papers API 今日返回 0 条,论文速递跳过。


🏢 SAP+AI 动态

来源:SAP Community、SAPinsider、Diginomica 等渠道(近 7 天,★ 为近日新增)

★ Beyond LLMs:我们是否在对 AI 概念产生幻觉? GenAI
SAP Community · 09-26
SAP 社区博主 Bennie de Kok 以 AI 幻觉为切入点,提出一个尖锐的元问题:我们担忧 AI 产生幻觉,却对 AI 自身的概念体系也在”幻觉”——每隔数周就有一个新概念让我们信心十足地宣布”范式转移”,然后悄悄放弃上一个。文章拆解了”AI 采用速度”与”AI 采用智慧”的差异,并呼吁企业 AI 战略团队建立概念审查机制:在引入新 AI 范式之前,先检查上一个是否真正验证过。在 TechEd 2026 即将召开、Agentic AI 叙事全面铺开之际,这是 SAP 生态内罕见的清醒反思声音。

SAP Business AI 平台全景指南:面向 Agentic AI 的企业数据平台架构愿景 Agentic
SAP Community · 09-27
SAP 官方发布 Business AI 平台全景导览文档,系统梳理从 Joule 到 AI Core、从 BTP 基础设施到 Agentic 应用层的整体架构愿景,是目前理解 SAP AI 平台全局的最权威单一入口文档。适合正在评估 SAP AI 路线图的架构师和决策者。

TechEd 2026 XP266:两小时内将沙箱化 AI 运维智能体部署至 Kyma Agentic BTP
SAP Community · 09-26
SAP TechEd 2026 动手工坊 XP266 预告:覆盖沙箱化 AI Agent 的构建、测试与部署全流程,目标是在两小时内将可运行的 AI 运维智能体推送至 Kyma 运行时。是 TechEd 2026 期间 Agentic AI 动手实践的核心入门课程,报名链接已开放。

从 AI-Ready 数据到 Agent-Ready 数据:企业数据架构演进框架 Agentic
SAP Community · 09-26
系统探讨企业数据架构从”AI 可用”到”Agent 可用”的演进路径——区别不只在于数据质量,更在于实时可访问性、跨系统一致性和操作授权机制。为正在规划 Agentic AI 数据基础的 SAP 客户提供了具体能力矩阵和评估框架。

SAP HANA Cloud 2026 年 9 月更新:面向 Agentic AI 的多项新特性 Agentic HANA
SAP Community · 09-25
本月更新重点:增强向量存储性能(支持更大规模 RAG 场景)、Agent 友好的实时数据流 API、新增 AI-native SQL 扩展。HANA Cloud 正从”AI 可查询的数据库”演进为”智能体可直接操作的数据运行时”,是 SAP Agentic AI 基础设施层的核心更新节点。

SAP HANA Cloud 管理操作目录接入 Automation Pilot:运维操作可调度和编排 Automation HANA
SAP Community · 09-25
HANA Cloud 管理操作目录(含备份、扩缩容、告警响应等约 50 项操作)正式接入 SAP Automation Pilot,原本需要 DBA 手工触发的操作现可通过 Automation Pilot 执行、按计划调度或通过事件触发编排。是 SAP 运维自动化从”工具层”向”编排层”演进的重要里程碑。

Joule Studio + Jev:在企业 AI 智能体决策边界处用概率输出替代生成式推理 Joule Agentic GenAI
SAP Community · 09-25
将 TypeSafe AI 的 Jev 判别式推理引擎与 Joule Studio 结合的实验性架构:在决策分叉点用概率分布(而非 LLM 自然语言推理)驱动智能体行为,目标是在自主性与可解释性之间找到新的平衡点。是 Joule Studio 与外部决策引擎互联的最早实践案例之一。

从 SAP RAP 与 OData 到 AI 驱动仪表板:Joule Desktop + MCP 实战 Joule GenAI BTP
SAP Community · 09-24
通过 Joule Desktop 和 MCP 协议将 SAP RAP/OData 服务直接变成 AI 驱动的仪表板:用户用自然语言询问库存到期信息,智能体自动调用 OData API 并生成可视化结果,全程无需编写任何前端代码。是 Joule Desktop + MCP 组合在 SAP 开发场景中最具说服力的端到端实战案例。

Coronis Health 用 UiPath Agentic 自动化处理 10 万件医疗理赔:accountable intelligence 案例 Agentic Automation
Diginomica · 09-25
保险公司用 AI 拒赔、医院用 AI 写病历——Coronis Health 用 UiPath Agentic 自动化每周处理 10 万件医疗理赔,是医疗账单领域”bots 对抗 bots”生态中的典型中间方案例。文章重点不是技术实现,而是”可解释的 AI 决策”如何成为监管合规的前提条件。

劳埃德银行集团的 Agentic 策略:小规模、确定性、人工监督优先 Agentic
Diginomica · 09-25
劳埃德银行集团 CDO 阐述金融机构的 Agentic AI 落地原则:优先选择范围清晰的小型智能体(而非大型自主系统)、确定性逻辑优先于概率推理、每个关键节点保留人工审批。是 SAP 金融行业客户评估 Agentic AI 风险管控框架的重要参考,与 Coronis Health 案例形成”医疗 vs 金融”双侧对比。

Agentic AI 能否弥合与可信企业数据的鸿沟? Agentic
SAP News · 09-23
SAP News 探讨企业部署 Agentic AI 时的数据信任核心问题:智能体代表用户在企业系统中自主行动,若依赖低质量、访问控制不完善的数据环境,将导致”自信地做出错误决策”。为 SAP 客户评估 Joule 等智能体部署的数据就绪度提供了结构化框架。

SAP Joule for Developers 促销期结束:后续定价路径与开发者应对指南 Joule GenAI
SAP Community · 09-23
Joule for Developers 免费促销期正式结束,此前该功能为开发者在 SAP Build 和 ABAP 工具中提供生成式 AI 能力无需额外付费。文章说明促销期后的访问路径和许可模型变化,是使用 Joule 辅助 ABAP/BTP 开发的团队更新采购计划的重要参考。


由 AI Radar 技能生成 · 获取于 2026-09-28T06:15 UTC · 共 AI精选 5 条,AI简报 3 条,热点动态 15 条,论文 0 篇,SAP动态 12 条(★ 1 条新增)

Leave a Comment