AI 简报 · 2026-08-18

AI Radar 简报 · 2026-08-18

涵盖 AI精选 · 热点动态


🔥 AI精选

来源:AIHOT · 精选热点

日期 标题 来源 分类
08-18 黄仁勋宣布 NVIDIA 与 SB Energy 合作,为 OpenAI 建 AI 工厂(总机会约 6000 亿美元) X:Jensen Huang 行业
08-18 A 股迎来”人形机器人第一股”,宇树科技官宣 8 月 19 日科创板上市 IT之家 行业
08-18 用 Google Agent Development Kit 构建零信任 AI 智能体 Google Developers Blog 技巧
08-18 404 Media 追踪珍本图书流向:亚马逊批量购书扫描用于 AI 训练后销毁 Hacker News 行业
08-18 Cursor 推出 Origin 代码托管服务,作为 GitHub 的替代方案 Hacker News 产品
08-18 一个实用的深度思考 Prompt:用”双向钢人论证”挖出最本质的答案 公众号:数字生命卡兹克 技巧
08-18 NVIDIA 与 SB Energy 锁定俄亥俄州 PORTS-Pike 园区电力,OpenAI 将入驻 NVIDIA Blog 行业
08-18 如何禁用或避免侵入式 AI:覆盖 Windows、Chrome、Edge、Firefox 及主流应用的实用指南 Hacker News 技巧
08-18 inclusionAI 开源 ConceptEdit:基于概念缩放与密集监督的图像编辑数据生成管线 蚂蚁 inclusionAI GitHub 产品

📡 热点动态

来源:AIHOT · 全量热点(近 1 天)

  • 08-18 Meta FAIR 提出研究偏好模型(RPM),用预测替代 GPU 实验筛选候选方案 — X:Rohan Paul
    RPM 在 GPU 实验前预测候选方案价值,解决 AI 研究智能体”想法多、算力少”的瓶颈:AIRA-dojo 每步生成 15 个候选,RPM 仅筛选 1 个进入完整运行——AI 自主科研正在用”预测式筛选”压缩昂贵的试错成本。

  • 08-18 DeepSeek V4 Flash 自验证逆袭 Claude Fable 5 — X:阿易 AI Notes
    Stanford 团队用 DeepSeek V4 Flash 采样 5 个答案并让同一模型自评打分,在 Terminal-Bench 2.1 上准确率从 79% 升至 88%、超越 Claude Fable 5 且成本仅 1/11——test-time scaling 的性价比潜力被再次验证,框架已开源可复现。

  • 08-18 硅谷开始清理 AI 垃圾内容:谷歌删 5 万账号集群,Spotify 删 7500 万条曲目 — IT之家
    Spotify 去年删除 7500 万条批量/重复曲目,谷歌清除 YouTube 13 万低质频道及 5 万账号集群,TikTok 标记超 30 亿条 AI 视频——这些垃圾多由科技公司自家 AI 工具催生,信息生态正遭自身产物污染。

  • 08-18 GPT-5.6 Sol 半价,价格战将至 — X:阿易 AI Notes
    OpenAI GPT-5.6 Sol 今起 5 折、持续一个月,同样适用于 batch/flex/priority 层级——被 Stripe 70 亿美元收购 OpenRouter 后”有钱任性”,作者预判大模型价格战即将全面打响,Claude 是否跟进受关注。

  • 08-18 哈佛芝加哥研究:LLM 服务一年负载分析 — X:Rohan Paul
    分析 9174 个模型、61.2 亿次请求的一年生产数据:99% 的缓存复用来自 15 分钟内的重复请求,均匀负载均衡反而削弱该优势——高效 LLM 服务更依赖理解真实流量模式,而非单一调度器或合成基准。

  • 08-18 Mureka V9.5 上线:让 AI 音乐终于有了”活人味儿” — 公众号:昆仑万维(天工)
    基于 MusiCoT 框架,人声表现良品率升至 61.0%、控制良品率 97.0%、曲风完全体现比例 95.7%,大幅优化中文国风咬字与和声——AI 音乐生成的”自然度”竞争进入精细化阶段。

  • 08-18 OpenAI Finance 实测胜过人类财务顾问 — X:Eric Mitchell
    用户称将合同、财务、体检结果全部上传 OpenAI Finance,效果优于付费 CPA、律师和医生——AI 正在挑战专业服务的信任壁垒,引发”人机协作只是惯性遗留”的激进讨论。

  • 08-18 ChatGPT Finance 实测:30 分钟搞定订阅与税务提醒 — X:Sherwin Wu
    30 分钟内识别未使用的 Google One 订阅(年 $100)、发现 Roth IRA 资金闲置、纳入即将到来的税务支付——个人财务管理成为 AI 助手最快落地见效的高频场景之一。

  • 08-18 共生知行发布人形机器人驾驶卡丁车 Demo,展示直接感知-控制模型 — IT之家
    直接感知-控制模型移除中间运动表征,将视觉、语言、身体状态直接映射为可执行动作,使宇树人形机器人实现手-眼-脚协同驾驶——”全身智能”路线用极具挑战的赛车任务作首次公开测试。

  • 08-18 Grok @Bot 个人 AI 智能体教程发布 — X:Elon Musk
    新教程演示搭建 5 个实用机器人:机器人管理、YouTube 研究、X 内容挖掘、收件箱清理及旅行省钱,并测试运行经典游戏——xAI 将 @Bot 定位为可取代 ChatGPT 的个人 AI 智能体雏形。

  • 08-18 赛昉科技推出服务器级 RISC-V HPC CPU IP 昉·天枢-100 — IT之家
    性能对标 Arm Cortex-A78,整数 IPC 达 SPECint2006 15/GHz,采用深度乱序执行,单裸片可扩展至 256 核——国产 RISC-V 向服务器级高性能计算迈进,AI 边缘服务器芯片有了新选项。

  • 08-18 Qwen3.8-27B 本地模型达前沿性能 — X:通义千问
    阿里称 27B 本地模型已达前沿性能、获 Cline 认可——开源模型在消费级硬件上逼近旗舰能力,本地部署的实用性门槛持续降低。

  • 08-18 DeepSeek 高峰定价机制详解 — X:OpenRouter
    OpenRouter 说明 DeepSeek 按本地时区显示高峰时段定价,并在寻找最优价格时综合考量各项因素——模型定价随时间波动、越来越复杂,聚合平台的比价价值凸显。

  • 08-18 AI 编码智能体缺乏时间感知,评测需直接测时长 — X:Rohan Paul
    AI 编码智能体可能连续工作数小时却对时间流逝缺乏校准——长时程评测或需直接衡量对时长的遵循能力,而非将持续表现等同于”知道何时停止”,涉及 ProgramBench、PaperBench、DeepSWE 等基准。

  • 08-18 Ask HN:GitHub 到底怎么了? — Hacker News
    用户直问 GitHub 员工平台频繁故障内幕:评论指 AI 辅助编程使过去一年提交量增长 14 倍、2025 年达 10 亿次,另有观点归因于 Azure 架构——AI 编程爆发正在给代码托管基础设施带来前所未有的负载压力。


Leave a Comment