每天早晨,抢先拿到 AI 情报
今天11 条简报
据称 Stripe 拟收购 OpenRouter
报道称,这家 AI 网关初创公司的交易金额将超过 70 亿美元。
商业TechCrunch AI2 源
OpenAI 增强客户隐私保护
TechCrunch 报道称,OpenAI 正在企业数据隐私方面与 Anthropic 展开竞争。
政策TechCrunch AI
Cognition CEO 否认 SpaceX 收购传闻
这家 AI 编程初创公司的 CEO 回应报道称,SpaceX 曾寻求收购该公司。
商业TechCrunch AI
随着 AI 普及,消费者对其愈发谨慎
TechCrunch 报道称,AI 使用范围扩大,并未带来公众接受度的同步提升。
商业TechCrunch AI
OpenAI重申前沿模型支持零数据保留
符合条件的 API 客户可使用零数据保留功能,Private Safety Processing 也已进入预览。
政策OpenAI
Google 为 Search 添加 AI 学习工具
Search 新增互动可视化、测验、Lens 学习辅助、笔记本和学习文件创建功能。
产品Google AI
Google 为 Gemini 新增学生中心和学习工具
Gemini 新功能可整理研究资料、抽认卡、测验、截止日期,并在 Live 中支持 Deep Research。
产品The Verge AI2 源
OpenAI 重申面向 API 客户的零数据保留政策
该公司还预告了 Private Safety Processing,旨在兼顾高级 AI 安全与数据隐私。
政策OpenAI
研究人员称 OpenAI 撤销 TAC 项目访问权限
多名网络安全研究人员称,他们失去了 OpenAI 面向网络安全领域的限量 Trusted Access for Cyber 项目访问权限。
政策TechCrunch AI
Silicon Data 帮助 Wall Street 为 AI 算力定价
TechCrunch 介绍了一家正在开发 AI 算力成本定价和对冲工具的初创公司。
商业TechCrunch AI
Meta 推出 Meta AI Mac 应用
这款桌面聊天机器人可以分析共享窗口,并支持在各类应用中进行听写。
产品The Verge AI
昨天36 条简报
TerraPower瞄准AI数据中心,推广核反应堆供电方案
TechCrunch报道称,TerraPower认为自己在数据中心电力交易中具备战略优势。
硬件TechCrunch AI
AI 采用在开发者论坛引发审视
Hacker News 上的讨论聚焦数学、软件团队、阅读、开源和退出 AI 功能等议题。
工具Hacker News5 源
Hacker News 讨论凸显 AI 反弹与采用并行
HN 讨论涵盖软件团队使用 AI、监管、开源、数学,以及退出选项。
政策Hacker News5 源
Amazon 在美国向 Fire TV 用户免费开放 Alexa+
兼容的 Fire TV 设备将无需 Prime 会员即可使用这款 AI 助手。
产品TechCrunch AI
VentureBeat 任命 Rob Strechay 为首位首席分析师
该媒体正扩展 VentureBeat Research,面向企业 AI 决策者提供研究服务。
商业VentureBeat AI
LiquidAI 发布 LFM2.5 的 Q4_0 检查点
这些 GGUF 文件通过量化感知蒸馏,降低 4-bit LFM2.5 模型的质量损失。
模型Hugging Face
初创公司称,数据是 AI 抗癌进展的关键
TechCrunch 报道称,这家初创公司认为,如果没有更好的数据,AI 距离治愈癌症还很远。
研究TechCrunch AI
Nvidia 与金融机构推进 5000 亿美元算力计划
Nvidia 正与大型金融机构合作,试图将 GPU 算力打造为可投资资产类别。
商业The Verge AI
Relativity Networks 融资 2200 万美元,押注更快的数据中心光纤
该公司正在为数据中心开发空芯光纤,目标是将数据传输速度提升 30%。
硬件TechCrunch AI
Replit 推出由 GPT-5.6 Luna 驱动的免费模式
Replit 表示,新模式让用户在构建软件时无需担心 token 成本。
产品OpenAI
Co-RL 用同伴模型生成的奖励训练推理模型
这篇 arXiv 论文提出用协作式多智能体 RL,降低对真实标签监督的依赖。
研究arXiv cs.AI2 源
研究人员推出用于视频生成评测的 SemComp-Bench
该基准用于评估生成视频是否实现预期结果,并保留任务语义。
研究arXiv cs.AI2 源
研究人员提出面向 agent harness 的强化学习框架
LEGO-RL 和 ClawGym II 旨在为长程 AI agent 提供更稳定的强化学习训练。
研究arXiv cs.AI2 源
PTXBench 测试 LLM 的 GPU 内核优化能力
该基准在 H100 和 B200 GPU 上,评估模型在 GEMM 与注意力工作负载中使用特定架构 PTX 的能力。
研究arXiv cs.AI2 源
DiSCO 瞄准黑盒文生图安全问题
这篇 arXiv 论文提出在提示词层面进行优化,以在无法访问模型的情况下减少 NSFW 输出。
研究arXiv cs.AI2 源
论文测试 LLM 的跨模型记忆迁移
研究人员探讨如何通过目标侧读取器,让冻结的已学习记忆在不同模型骨干之间迁移。
研究arXiv cs.AI2 源
Agent Lightning v1.0 瞄准带框架托管的智能体强化学习
该框架把任意智能体 harness 接入强化学习后训练流程。
研究arXiv cs.AI2 源
HarnessRisk 基准测试 agent harness 的安全失效
该基准在 agent harness 的各个阶段测试攻击,同时相关研究关注面向特定任务的资源配置。
研究arXiv cs.AI2 源
Hacker News 讨论中浮现对 AI 的反弹情绪
多篇帖子凸显了围绕 AI 使用、开源、监管、侵入式功能以及对高管信任的担忧。
政策Hacker News5 源
AI 反弹情绪在 Hacker News 上引发关注
围绕 AI 使用、监管、开源和退出选项的帖子引发了活跃讨论。
政策Hacker News6 源
AI 反弹情绪主导 Hacker News 讨论
围绕 AI 使用、监管、开源以及侵入式功能的帖子,在 Hacker News 上引发了热烈辩论。
政策Hacker News7 源
AI 反弹情绪主导 Hacker News 讨论
围绕 AI 使用、监管、开源和退出选项的帖子引发了活跃讨论。
政策Hacker News8 源
HN 讨论聚焦 AI 反弹与职场采用
帖子涵盖软件团队使用 AI、AI 摘要、开源、退出选项、监管以及 CEO 舆情。
政策Hacker News9 源
GLM-5.3 基准测试引发开发者讨论
Artificial Analysis 关于 GLM-5.3 的基准测试在 Hacker News 和 r/LocalLLaMA 上流传。
模型Hacker News2 源
OpenAI 在欧洲扩大 ChatGPT Ads 覆盖范围
OpenAI 表示,ChatGPT Ads 正扩展至 31 个欧洲市场。
商业OpenAI
SoftVTBench 测试视觉-触觉操作中的形变控制
该数据集将机器人观测与 FEM 真实值配对,用于可变形物体任务。
研究HF Daily Papers
DA-LeWM 瞄准潜在世界模型在规划中的失效问题
新的诊断方法检验潜在距离能否按真实任务进展对行动方案排序。
研究HF Daily Papers
研究人员为逆合成 AI 加入化学先验
新研究旨在让计算机辅助合成规划给出更可信、更多样的反应预测。
研究HF Daily Papers2 源
SemaPLC 通过实时运行时检查测试 PLC 代码智能体
该测试框架会根据规格、编译结果和部署后的行为来验证生成的 PLC 逻辑。
研究HF Daily Papers
研究人员推出用于自博弈智能体训练的 SPADE
该框架让一个 LLM 生成可执行环境,另一个角色在其中学习。
研究HF Daily Papers2 源
FM-Bench 测试智能体 20 年足球俱乐部管理能力
该基准通过数百个相互关联的决策,评估长周期 LLM 智能体。
研究HF Daily Papers2 源
SkillForge 让智能体学习特定代码库的技能
这一框架通过合成项目 issue,提炼可复用知识,用于未来的软件修复。
研究HF Daily Papers2 源
FACET 聚焦终端任务合成的一致性
该框架为训练终端 agent 构建并修复可执行环境。
研究HF Daily Papers2 源
Robin Williams 子女重启其 Instagram,以反击 AI 肖像滥用
这位演员的家人表示,在外界担忧 AI 被滥用之际,该账号将分享真实的回忆。
政策The Verge AI
IBM 测试 AI 智能体究竟需要多少记忆
ALTK-Evolve 研究发现,智能体记忆带来的收益取决于模型能力和投放策略。
研究Hugging Face
Hugging Face 遭入侵后,OpenAI 加强安全防护
该公司正在强化模型监控,并加大后训练阶段的对齐与安全工作力度。
政策TechCrunch AI2 源
8月18日周二33 条简报
Warp 推出面向 AI 开发的 Warp Factories
该系统旨在简化 AI 软件工厂的搭建。
工具TechCrunch AI
Perplexity 在印度新增数百万用户
Airtel 的免费优惠推动 Perplexity 在印度用户增长;新用户注册结束后,其收入继续上升。
商业TechCrunch AI
研究人员借 Copilot 曝光其自身防护机制缺陷
Varonis 称,Microsoft 365 Copilot Enterprise 可能被诱导协助数据外泄。
政策Ars Technica AI
Firefox Smart Window 新增基于网页来源的 AI 回答
Mozilla 的 AI 浏览模式现在可以引用实时网页信息,并整理标签页。
产品The Verge AI
Google 测试面向 Nest 摄像头的 Gemini 宠物记忆功能
该功能旨在识别特定宠物,但 The Verge 试用后发现并不可靠。
产品The Verge AI
OpenAI 收紧具备网络能力的前沿模型安全防护
该公司表示,监测、对齐和安全将影响模型开发节奏。
政策OpenAI
OpenAI 推出面向青少年的专属 ChatGPT 模式
ChatGPT for Teens 增加了更强的保护措施、健康使用功能和家长控制。
产品OpenAI3 源
OpenAI 与 CodeAI 合作提升学生 AI 素养
此次合作旨在帮助学生负责任地使用并参与塑造 AI。
政策OpenAI
Google 竞得 Spirit Airlines 数据
这笔 1000 万美元的破产交易涵盖电子邮件、聊天记录和文档,用于 AI 产品工作。
商业Hacker News2 源
Apple 配备摄像头的 AirPods 现身泄露视频
macOS Tahoe 26.7 RC 中的一段视频显示,传闻中的 AirPods 可通过 Siri 使用 Visual Intelligence。
产品The Verge AI2 源
Asana 称 Codex 用两周替换了测试系统
OpenAI 表示,Asana 使用 Codex 完成了一项长期工程迁移,成本约为 1.2 万美元。
工具OpenAI
研究人员瞄准组合式图像与视频编辑
新论文提出面向统一生成与编辑模型的训练数据和蒸馏方法。
研究arXiv cs.CL2 源
论文用一个层方程统一图神经网络
该框架将 GNN 架构映射为七个计算组件。
研究arXiv cs.LG2 源
新研究勾勒智能体 AI 的服务供给需求
四篇论文分别研究面向智能体 LLM 工作负载的延迟、缓存、轨迹和边缘侧服务。
研究arXiv cs.AI2 源
新论文聚焦长周期 LLM 智能体训练
研究人员提出 TRCA、RLCascadeRouter 和 Agentic ESOpt,用于改进智能体信用分配、模型路由和微调。
研究arXiv cs.AI2 源
研究人员提出 RUPA,用于评估 LLM 智能体的不确定性
该框架评估的是完整智能体轨迹的置信度,而不只是局部步骤。
研究arXiv cs.CL2 源
用凝视来思考:将连续眼动追踪作为医疗 VLM 视觉推理监督信号
arXiv:2603。
商业arXiv cs.AI2 源
研究人员改造 OPD,提升视频推理效率
两篇论文利用蒸馏技术,改进更小型或流式视频理解模型的表现。
研究arXiv cs.AI2 源
Prior Labs 发布面向关系学习的 RelArena-alpha
此次 alpha 版本发布包括 RelArena-alpha、TabPFN-Rel 和 RPI,面向开放的关系学习研究。
工具arXiv cs.LG2 源
Flow Motion Policy:基于流匹配模型的机械臂运动规划
arXiv:2604。
研究arXiv cs.AI2 源
研究人员提出 Large Discovery Model
LDM 架构将生成式模型与贝叶斯奖励替代模型结合,用于开放式搜索。
硬件arXiv cs.LG2 源
TRACE-Bench 瞄准多参考图像生成
该基准将提示词拆解为四类操作符,用于诊断模型失败原因。
研究arXiv cs.AI2 源
学习尚未掌握的部分,而不是已经掌握的内容:面向多奖励策略优化的饱和感知优势重加权
arXiv:2608。
研究arXiv cs.AI2 源
AlphaEvolve 助力降低矩阵乘法上界
一篇新的 arXiv 论文报告称,矩阵乘法指数的上界得到改进。
研究arXiv cs.AI2 源
研究发现,审计-修复上下文会让 LLM 检查器更宽松
这篇 arXiv 论文称,在模型上下文中出现先前的审计-修复过程后,误报率会下降。
研究arXiv cs.AI2 源
研究人员提出用于卡车与无人机路径规划的 TTP-D
这一新基准将物品选择、载重相关路径规划与无人机同步结合起来。
研究arXiv cs.AI2 源
NVIDIA 使用 ChatGPT Work 扩展内部工作流
OpenAI 表示,NVIDIA 团队使用 ChatGPT Work 减少人工任务,并在全球范围内共享工作流。
商业OpenAI
Sentence Transformers 增加多向量检索能力
6.0 版本引入 MultiVectorEncoder,用于 ColBERT 风格的后期交互模型。
工具Hugging Face
Anthropic 年化收入达 650 亿美元
这家 AI 模型公司在两个月内新增 180 亿美元年化收入。
商业TechCrunch AI
Relay 关闭,员工加入 Google Chrome 团队
创始人 Jacob Bank 称,这家 AI 自动化初创公司的团队将转入 Chrome。
商业TechCrunch AI
1872 推出用于钢构件生产的机器人化工厂
前 SpaceX 工程师团队瞄准 AI 数据中心和反应堆需求,计划自动化钢制撬装底座制造。
商业Ars Technica AI
MoE-ViE 瞄准高效扩展视觉编码器
这篇论文研究了面向图像和视频理解的 CLIP 风格视觉编码器中的 MoE 设计。
研究HF Daily Papers
研究人员瞄准视觉与解码中的 MoE 延迟问题
新论文提出 MoE 视觉编码器、更快的小批量解码,以及在线负载均衡方案。
研究HF Daily Papers2 源