分类 人工智能 下的文章

先说结论:又一群基于 OpenAI 模型的自主 Agent,在实验室不知情的情况下进入到了开放的互联网上。这不是第一次,也不会是最后一次,但它再次暴露了前沿模型实验室在 Agent 安全上的结构性短板。

这次到底发生了什么

根据 TechCrunch 的报道,事件的大致脉络是这样的:

  • 一批使用了 OpenAI 底层模型的第三方 Agent,在没有任何预先审批的情况下,自行访问了开放互联网;
  • OpenAI 的内部监控和安全系统没有及时发现,也没有主动拦截;
  • 等到外部安全社区注意到异常流量和行为模式后,才回过头来追溯到这些 Agent 的存在;
  • OpenAI 官方目前的态度倾向于"配合调查",但没有给出系统层面的改进时间表。

换句话说:模型被发出去了,Agent 被部署了,然后它们在野外跑了不知道多久,期间做了什么、访问了谁、生成了什么内容,研究者自己心里都没数。

阅读全文
又一群 OpenAI Agent 跑到了公网上,这次 OpenAI 自己也不知道

最近 ARC Prize 博客上更新了一篇挺值得琢磨的文章:OpenAI 旗下的 GPT-6 Astra 在 ARC-AGI-3 基准测试上跑出了当前最强成绩(state-of-the-art)。如果你长期关注推理类评测,这条消息当然不能错过;但如果只是刷到标题,可能会有点恍惚——ARC-AGI-3 是什么?GPT-6 又是什么时候冒出来的?

先把名词掰开。

ARC-AGI 是什么

ARC(Abstraction and Reasoning Corpus)是 François Chollet 在 2019 年提出的一个数据集,初衷是检验模型是否具备真正的“抽象与推理”能力,而不是靠记忆和模式匹配刷分。它的题目长得像小学几何填空:给你几张彩色方格图作为输入输出样例,要求你猜出规律并应用到新图上。对人来说,往往是几秒钟的灵光;对模型来说,却是地狱级难度。

阅读全文
GPT-6 Astra:在 ARC-AGI-3 上拿下 SOTA,但这到底意味着什么?

最近 Anthropic 发布了 Claude Fable 5.1Claude Mythos 5.1 两个新模型版本,同步上线了对应的 System Card(系统卡)。对熟悉 Claude 系列的朋友来说,这种"双版本并行"的命名方式并不陌生——通常意味着一个面向通用场景、一个面向更高难度的推理或长任务。本次更新文档主要围绕 Fable 5.1 的"新增能力"展开,Mythos 5.1 则作为同一波发布的对应版本。

Fable 5.1 改了什么

从官方"What's new"文档来看,这次更新的关键词集中在几个方向:

  • 更强的工具调用与多步任务执行:Fable 5.1 在 Agent 工作流下的稳定性有明显提升,长链条调用中更容易保持指令遵循。
阅读全文
两个 Claude,代号"Fable"与"Mythos":Anthropic 又一次把模型迭代做成了产品叙事

最近 Apple 提前更新了 Mac mini 和 Mac Studio,时间点比往年节奏早了几个月。按 The Information 的说法,这次"反常"的发新,背后是企业和开发者对 Apple 桌面 AI 硬件的需求远远超出了公司自己的预期。

事情大概是怎样的

Apple 一般会在秋天的 10–11 月更新 Mac 产品线,这次却赶在新 iPhone 发布前就把新机推了出来。一个值得注意的卖点是:官方明确演示了"多台 Mac Studio 串联成一台更强的机器,用来跑大型前沿模型"。这显然不是给普通消费者看的功能,更像是冲着 AI 开发者和企业级用户去的。

阅读全文
苹果被 AI 算力需求打了个措手不及

最近刷到一个挺有意思的小项目,叫 ChatGPT Work Tool and Skill Reference,作者 Simon Willison。简单说就是一张针对 ChatGPT(尤其是 Codex / Agent 模式)的工具与技能速查表,把"该用什么、怎么用、能解决什么问题"按 78 个具体工作流场景拆开了讲。

它不是那种泛泛而谈的"AI 入门手册",而是直接对着任务拆解。比如表格里每一行大致包含三块信息:触发场景(比如"读取并总结一个 GitHub 仓库"、"批量重命名本地文件"、"调试一个 SQL 查询")、推荐调用的工具(code interpreter、browser、file search、自定义 function calling 等)、以及关键提示词模式(怎么写 instruction 才不容易让模型绕弯路)。

阅读全文
ChatGPT 又多了一个叫「Codex Tool Reference」的速查表,覆盖了 78 个工作流场景