雷达趋势观察:2025 年 7 月
运营、量子计算、机器人技术等方面的发展
作者:迈克-卢基德斯
2025 年 7 月 1 日
尽管法院系统正在审理许多版权案件,但我们现在从其中一个案件中获得了一项重要判决。威廉-阿尔苏普(William Alsup)法官裁定,将受版权保护的材料用于培训是 "变革性 "的,因此属于合理使用;将书籍从印刷形式转换为数字形式属于合理使用;但将盗版书籍用于建立人工智能培训图书馆则不属于合理使用。
现在,每个人都在努力构建智能代理,我们必须认真思考代理安全问题--这就成了双重问题,因为我们已经对人工智能安全和 prompt injection 等问题思考得不够了。西蒙-威利森(Simon Willison)创造了 "致命三要素"(lethal trifecta)一词,用来描述使代理安全变得尤为困难的问题组合:访问私人数据、接触不受信任的内容以及与外部服务通信的能力。
人工智能
- 研究人员对一个模型进行了微调,以查找包含防止向黑人和其他少数民族出售房屋的语言的契约。他们的研究表明,截至 1950 年,圣克拉拉县大约有四分之一的地契包含此类语言。这项研究需要分析数百万份契约,比人类分析的数量要多得多。
- 谷歌发布了现场音乐模型Magenta RT。该模型旨在实时合成音乐。虽然有一些限制,但可以在Hugging Face和GitHub 上获得权重和代码。
- OpenAI发现,可以对产生错位角色的模型进行重新训练,使其行为恢复一致。
- Gemini 2.5 的 Flash 版和专业版已经全面上市。谷歌还推出了 Gemini 2.5 Flash-Lite 的预览版,该版本专为低延迟和低成本而设计。
- lowbackgroundsteel.ai网站旨在作为人工智能前内容(即人工智能无法生成的内容)的存储库。
- 吊桥要架起了吗?德鲁-布吕尼格(Drew Breunig)将人工智能的现状与 Web 2.0 进行了比较,当时 Twitter 等公司开始限制开发者连接到它们的平台。德鲁指出,Anthropic切断了Windsurf,Slack阻止他人搜索或存储信息,谷歌在Meta投资后切断了与Scale的联系。
- 西蒙-威利森(Simon Willison)创造了"致命三连击"(lethal trifecta)一词来描述人工智能代理的危险漏洞。私人数据、不受信任的内容和外部通信这三者的结合产生了致命的三连击。
- 两篇新论文《保护 LLM 代理免受 prompt 注入的设计模式》和《谷歌安全 AI 代理的方法》探讨了代理中的 prompt 注入和其他漏洞问题。Simon Willison 的总结 非常出色。提示注入仍是一个尚未解决(也许是无法解决)的问题,但这些论文显示了一些进展。
- 谷歌的 NotebookLM 可以根据人工智能概述将搜索结果变成播客。该功能并非默认启用,而是搜索实验室的一项实验。请注意--收听搜索结果可能会很有趣,但却会让你离实际结果越来越远。
- 人工智能芭比娃娃?我一定要看看。或者不看也行。
- Institutional Books是一个用于训练 LLMs 的 242B token 数据集。它是根据哈佛大学图书馆中的公共领域/非版权书籍创建的。它包括 250 多种语言的 100 多万册图书。
- Mistral 推出了他们的首个推理模型Magistral,有两个版本:一个小型版本(开源,24B)和一个面向企业的封闭式中型版本。该公告强调了可追溯推理(适用于法律、金融和医疗保健等应用)和创造性。 ...