BridgeXLearning

AI 日报

AIHOT 每日报告 · 本地不可变归档

日报来自 AIHOT,每天 08:00(上海时区)发布并归档;历史报告不可变。AI 摘要未经 BridgeX 编辑审核,重要数字与原话请核对原文。

VOL.2026.07.1623 条摘要生成于 2026/07/16查看 AIHOT 日报页 ↗

01模型发布/更新

OpenAI 发布 GPT-Red:通过自动化红队测试提升模型鲁棒性

OpenAI 训练了自动化红队模型 GPT-Red,用于在部署前发现漏洞并在训练中生成攻击以提升模型鲁棒性。GPT-Red 能攻破此前几乎所有模型,其攻击被用于对抗训练 GPT-5.6 Sol,使该模型在直接提示注入基准测试中的失败率降至四个月前最佳生产模型的 1/6。GPT-Red 通过自对弈强化学习训练,投入了 OpenAI 后训练中前所未有的计算规模。

来源:OpenAI:官网动态(RSS · 排除企业/客户案例)核对原文 ↗AIHOT 详情 ↗

02产品发布/更新

Telegram 无服务器架构

Telegram Serverless 允许开发者直接在 Telegram 基础设施上运行 Bot 和 Mini App 的后端代码,无需配置服务器或容器。开发者编写普通 JavaScript 模块,通过 `npx tgcloud push` 单命令部署,代码在靠近 Bot API 和内建数据库的轻量级 V8 隔离沙箱中执行。

来源:Hacker News 热门(buzzing.cc 中文翻译)核对原文 ↗AIHOT 详情 ↗

03行业动态

阿里Qwen将集成至Apple Intelligence服务中国用户

阿里巴巴的Qwen模型将被集成到Apple Intelligence中,为中国的iOS、iPadOS、macOS和visionOS用户提供文本与图像理解、内容生成等AI功能。中国网信办已公布包括Apple Intelligence、华为小艺大模型、OPPO AndesGPT在内的七项移动端生成式AI服务备案信息。阿里巴巴董事会主席蔡崇信表示,苹果在选定阿里前曾与多家中国公司洽谈。

来源:X:X.PIN (@thexpin)核对原文 ↗AIHOT 详情 ↗

04论文研究

OpenAI 用 AI 攻击自家 AI:GPT-Red 自动发现安全漏洞,成功率 84% 远超人类

OpenAI 训练了内部 AI 模型 GPT-Red,通过自我对弈强化学习自动模拟提示词注入等攻击,在测试场景中成功率达 84%,而人类红队仅为 13%。GPT-Red 的发现直接用于训练,使 GPT-5.6 Sol 在直接提示词注入上的故障次数比四个月前的最佳模型减少六倍,且未影响通用性能。约 3.8% 的“更强”提示词注入仍能成功,GPT-Red 暂不对外开放。

来源:The Decoder:AI News(RSS)核对原文 ↗AIHOT 详情 ↗
Apple 提出 LLM 函数调用不确定性量化方法

Apple 机器学习研究团队提出一种针对大语言模型函数调用的不确定性量化方法,旨在提升 LLM 在自主任务执行中的可靠性。该方法通过量化模型对函数调用参数和决策的置信度,帮助识别潜在错误调用。该研究目前处于学术探索阶段,未公布具体模型版本或开源计划。

来源:Apple Machine Learning Research(RSS)核对原文 ↗AIHOT 详情 ↗
Meta 探索分层兴趣表示以优化广告深度漏斗

Meta 提出分层兴趣表示,一种基于 Transformer 图学习与自监督跨视图蒸馏的上游表示层,为广告实体学习统一嵌入。该系统在数十亿真实交互数据上端到端训练,输出通用嵌入和 Bag-of-Meaning 兴趣 token,旨在连接稀疏的深度漏斗信号与广告主供给。该技术可集成至 Meta 的生成式广告模型(GEM)、Andromeda 及自适应排序模型。

来源:Meta Engineering Blog(RSS)核对原文 ↗AIHOT 详情 ↗
Apple 提出 CLaRa:用连续潜在推理桥接检索与生成

Apple 机器学习研究团队提出 CLaRa,一种通过连续潜在推理桥接检索与生成的新方法。该方法在检索增强生成(RAG)中引入连续潜在空间,使模型在生成答案前先进行隐式推理,从而缓解长上下文带来的性能下降。CLaRa 在多个知识密集型基准上提升了 LLM 的准确率与效率。

来源:Apple Machine Learning Research(RSS)核对原文 ↗AIHOT 详情 ↗

05技巧与观点

Airtap iMessage 新功能:发条短信让 AI 替你操作手机

Airtap 推出 iMessage 新功能,用户只需给美国号码发一条 iMessage,其云手机上的 AI Agent 就能通过视觉模拟点击,替用户完成 TikTok 刷视频、星巴克点单等操作,无需安装对应 App。其架构分为三层:大脑(理解指令)、AutoPilot(视觉操控屏幕)、云手机(24小时在线)。但支付等敏感操作仍需用户手动完成,信任与授权仍是所有 Agent 厂商的难题。

来源:X:阿易 AI Notes (@AYi_AInotes)核对原文 ↗AIHOT 详情 ↗
前谷歌DeepMind研究员因公司签署无限制军事AI协议而离职

前谷歌DeepMind研究员Alex Turner因谷歌向国土安全部出售云服务并最终签署无限制军事AI协议而离职。他曾起草25页提案要求加入禁止杀手机器人和大规模监控的合同条款,但提案被CEO转交后无人跟进。Turner指出,包括Jeff Dean和Stuart Russell在内的多位AI伦理领袖在关键时刻未能兑现承诺。

来源:Hacker News 热门(buzzing.cc 中文翻译)核对原文 ↗AIHOT 详情 ↗
开源 LLM TODO Skill“阿福”:用 Claude Code 和 Codex 实现知识管理到排期自动化

作者基于 API 版 Fable5 和 Codex 开发了开源 TODO Skill“阿福”,用于将收件箱中的待办资料自动转为 Markdown 任务卡,识别信息不完整项(如视频链接需通过 yt-dlp 和本地 Whisper 提取字幕),并支持批量排期、AI 分组合并、拖拽调整周视图及同步到 Mac 日历或飞书日历。项目已开源在 GitHub,安装仅需一条命令。

来源:公众号:卡尔的AI沃茨核对原文 ↗AIHOT 详情 ↗
OpenAI 呼吁通过“反向联邦主义”推动美国 AI 安全标准统一

OpenAI 首席全球事务官 Chris Lehane 发文,主张通过“反向联邦主义”——即各州先通过相似立法形成事实上的国家标准——来推动美国 AI 前沿安全治理。加州、纽约州和伊利诺伊州已通过相关立法,核心要素包括风险披露、安全事故报告和独立审计。联邦层面,特朗普政府正与专家合作制定针对最强大 AI 模型的网络测试框架,预计 8 月初完成。

来源:OpenAI:官网动态(RSS · 排除企业/客户案例)核对原文 ↗AIHOT 详情 ↗