AI Radar 简报 · 2026-08-05
涵盖 AI精选 · 热点动态 · AI简报 · 论文速递
🔥 AI精选
来源:AIHOT · 精选热点
| 日期 | 标题 | 来源 | 分类 |
|---|---|---|---|
| 08-05 | 美国上诉法院推翻禁令,Perplexity AI 购物智能体重返 Amazon | The Decoder | 行业 |
| 08-05 | 华为谈自动驾驶强制性国标发布:引望国内首批完成 L3 车型准入试点验证 | IT之家 | 行业 |
| 08-05 | Google Assistant 下月起逐步退场,”Hey Google”由 Gemini 接棒 | IT之家 | 行业 |
| 08-05 | NVIDIA 发布 Alpamayo 2 Super:面向 Robotaxi 与自动驾驶的 34B 开源视觉-语言-动作模型 | MarkTechPost | 模型 |
| 08-05 | 烧了 5 亿 token 后,给 Codex 和 Claude Code 做 Skill 上下文瘦身的新技巧 | 公众号: 卡尔的AI沃茨 | 技巧 |
| 08-05 | Grok 4.5 免费体验,马斯克推荐 Build 工具链 | X: Elon Musk | 产品 |
| 08-05 | Qwen-Image-3.0-Pro 上线 Qwen Cloud | X: 通义千问 | 模型 |
| 08-05 | 开源「活人感写作.skill」:帮你写出没有 AI 味的文字的通用写作技能 | 公众号: 数字生命卡兹克 | 技巧 |
| 08-05 | LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能日志 | Simon Willison 博客 | 产品 |
| 08-05 | Replit 环境智能:免提示词自动生成设计 | X: Replit | 产品 |
📡 热点动态
来源:AIHOT · 全量热点(近 1 天)
-
08-05 菜鸟发布”全球三日达”服务,称跨境物流迈入”以小时计”阶段 —
IT之家
15 条跨境核心线路实现下单后 3 个自然日门到门,依托华南超级中心仓 AI 自动化+每周约 170 架次包机——AI 自动化正在重构跨境物流的时效与成本结构,0.5kg 欧洲小包单价不到国际快递的一半。 -
08-05 蚂蚁灵 3.0 闪存版登榜并开源权重 —
X: 蚂蚁百灵
Ling-3.0-flash 被 Vals AI 收录并同步开源权重(HuggingFace/ModelScope InclusionAI)——中国大厂开源模型的发布节奏进一步加密,蚂蚁加入开源权重竞赛。 -
08-05 字节跳动发布原生音视频全双工模型 SeedRealtime —
X: Testing Catalog
统一架构原生融合音频/视频/文本,支持连续多模态流实时交互,已免费上线豆包 App,可同时看、听、说——直接对标 GPT Live,实时多模态交互的国内竞品来得比预期快。 -
08-05 SSI 或于 8 月发布首个模型,获 NVIDIA 50 亿美元投资 —
X: 阿易 AI Notes
Ilya Sutskever 的 SSI 获英伟达约 50 亿美元战略投资,将部署 Vera Rubin 系统、算力 12 个月内提升约 10 倍——成立两年零发布的 SSI 若 8 月出模型,或意味着持续学习方向取得实质突破。 -
08-05 NVIDIA 称其自研 Arm CPU 存储性能比 x86 快 3.67 倍 —
X: Rohan Paul
Vera CPU 内置于 BlueField-4 STX 存储处理器,在 GPU 接触数据前完成加密/校验/压缩——英伟达正借 Agentic AI 引发的存储操作激增,切入 Intel/AMD 长期主导的存储处理器市场。 -
08-05 基准测试饱和度系统性研究:近半数 AI 基准已饱和 —
Hacker News
分析 60 个语言模型基准,发现饱和率随基准年龄增长而上升,且专家策划比隐藏测试数据更能延长基准寿命——AI 评测方法论正面临系统性重构压力。 -
08-05 Google Assistant 将于 9 月 4 日从安卓设备上消失 —
The Verge
安卓手机/平板及配对手表、耳机将移除 Google Assistant,满足条件的设备仅能使用 Gemini——谷歌完成从传统语音助手到生成式 AI 助手的强制迁移。 -
08-05 WindBorne 完成 3700 万美元 B 轮:用 AI 气象模型让天气预报更赚钱 —
TechCrunch
长航时气球采集数据接入 AI 预测模型,全球约 600 个气球在空,投后估值 2.5 亿美元——AI 气象垂直赛道从”技术可行”走向”商业变现”,目标客户转向投资基金等私营部门。 -
08-05 赵纯想:发明 AI 视频生成毛线球交互 —
X: 赵纯想
个人开发者用 AI 视频生成探索新型交互形态——AI 视频的创意应用边界正被独立创作者快速拓展。 -
08-05 Warp Agent CLI 发布:可在任意终端使用的多模型智能体 —
Hacker News
可在 Ghostty/iTerm2/VS Code 及系统终端独立运行,原生支持多智能体编排、云智能体、持久会话,内置前沿+开源模型自动路由,$18/月起——终端 Agent 工具的竞争从”绑定特定终端”走向”跨终端通用层”。 -
08-05 华为乾崑智驾 ADS Pro V5.0 将支持园区领航辅助 NCA —
IT之家
选定车位后可辅助从园区入口驶至车位并泊入,已支持超 100 万个停车场——高频泊车场景的智驾覆盖持续扩大,ADS 5 引入面向自动驾驶的 WEWA 2.0 AI 智能体架构。 -
08-05 特朗普政府 AI 测试框架范围有限且定义模糊,完全排除开源模型 —
The Verge
自愿性框架仅适用于具备顶尖能力且构成国家安全风险的闭源模型,未定义”国家安全风险”等关键概念,细节不公开——美国 AI 安全监管走向”闭源优先、开源豁免”的路径。 -
08-05 微软为内部”AI 热”降温:限制 Token 用量,GPT-5.6 设为默认模型 —
IT之家
整治内部”tokenmaxxing”,各部门自 7 月起设 Token 预算目标,部分工程师月开支达数百至数千美元——连微软都要给内部 AI 消耗设限,企业级 AI 成本治理成为普遍课题。 -
08-05 消息称美国前沿 AI 网络安全审查机制暂不涉及开放权重模型 —
IT之家
6 月宣布的审查机制当前仅涉闭源模型,提交后进入最多 30 天预发布审查、期间员工无法访问——与 The Verge 报道相互印证,美国 AI 监管对闭源与开源采取显著不同的处理策略。 -
08-05 吴恩达系 LearnVector 等 AI 教育持续发酵;开源写作 Skill 走红 —
公众号: 数字生命卡兹克
「活人感写作.skill」等去 AI 味工具走红——当 AI 生成内容被广泛识别,”让 AI 写得不像 AI”本身成为一个新的工具品类需求。
📋 AI简报
来源:AI Digest
2026-08-05
-
高分人数激增 5 倍,5.8 万名学生被迫重考 — 一场 AI 监督的远程考试结束后高分人数变成此前 5 倍,最终 5.8 万名学生被要求重考。事故暴露的不是判错一道题,而是大规模自动监考缺少可供用户核查的过程:系统依据什么规则运行、如何处理异常,学生很难看见。启示:AI 部署的门槛不该只是”模型能否做到”,上线前需审计系统规则、运行中需检测分数分布等异常、有争议时需给出申诉与人工复核入口——否则自动化覆盖多少人,错误就可能同时波及多少人。
-
苹果要用禁令卡住 OpenAI 硬件,称另有 11 名前员工或涉案 — 苹果在商业秘密案中申请初步禁令,要求阻止 OpenAI 继续开发据称基于苹果技术的 AI 设备,并对被指控前员工加快取证。苹果称又发现 11 名前员工可能涉案,指有人在面试前截取机密文件(尚未经法院认定)。OpenAI 称诉讼”毫无依据”。法院是否签发禁令将先决定该硬件项目能否继续推进。
-
看到 AI 配图就怀疑正文,整段生成代码也让开发者重新手敲 — 一张 AI 配图省下制作时间,却可能让整篇文章多一道信任审查——有博客作者宁愿看粗糙的手绘图,因为至少能确认背后是人的想法。代码生成也把同一笔成本交给开发者:让工具一次写完整个功能后会”迷失”,功能虽交付但没弄懂实现;折中办法是把生成代码手工重打一遍,在输入中逐段恢复理解。AI 效率账正在被加上”发布后读者疑虑”与”合并前理解时间”两笔隐性成本。
📄 论文速递
来源:AI Brief
重点关注
三维场景投影后迅速膨胀出数千个空间 token,计算和显存压力甚至比模型规模更先卡住部署。3DZip 用三步压缩:粗粒度体素化去点级重复 → 行列式点过程挑选差异足够大的锚点 → 空间约束下合并其余 token。巧妙之处在于不把”重要性”简单等同于注意力分数,而是同时考虑特征多样性与三维结构。在三个 3D 问答基准上,输入压到 128 个 token 仍保留原模型 94.7% 性能,推理提速 1.92 倍——为机器人、空间计算、数字孪生团队指出”压缩场景表示”而非”缩小模型”的优化新方向。
静默失败的部署风险在于:模态缺失后模型不仅答错,还可能远离决策边界,让现有监控误以为结果可靠。该框架逐样本区分可被监控捕捉的”响亮失败”与不易察觉的”静默失败”,并用模态互补矩阵追溯错误来源。在 245 例配对 MIMIC-IV 样本中,去掉超声后错误接近翻倍。更适合作为监控设计起点而非临床性能定论——报警阈值与接管策略仍需在更大、更贴近真实缺失模式的数据上验证。
具身 Agent 频繁重规划本为纠正执行漂移,但恢复机制本身可能先成为实时瓶颈——每次重规划都要处理累积的文本上下文,多 Agent 场景还会跨 Agent 叠加。BRACE 把重规划改造成预算控制(先判断是否需要、再选模式、分配 token 与延迟目标),E-RECAP 逐层剪掉低价值上下文。三个具身平台上单次重规划 token 减少 62%–92%,在更难的 RoboFactory 任务中其他方案全部失败时仍达 80% 成功率——关键从”随时重新思考”转向”决定何时值得思考、允许思考多久”。
也值得关注
- SG-WAM:几何感知策略空间中的自引导世界建模 — 世界模型不只要预测未来,还要在与动作生成一致、能表达空间变化的几何感知策略空间中预测未来。
- FeDepth:面向机器人异构条件的联邦深度估计 — 异构机器人无需集中汇总数据也能协同训练深度估计,正面处理平台间硬件与数据差异。
- 未知链接函数单指标模型的主动采样回归 — 只查询部分响应坐标也可能在一般损失下完成回归,从主动采样视角推进相关理论。
- 随机化候选搜索的序贯特征选择 — 保留序贯特征选择的质量优势,同时绕开每步遍历全部特征的计算障碍,面向超高维数据。