
多年来,人工智能行业一直沉浸在聊天机器人的海洋中。我们有能够撰写邮件、预约牙医或生成平庸日落诗歌的智能体。但今天,Anthropic的Claude Science做了一件看起来不像产品演示,而更像真正科学突破的事情:它首次绘制了整个天空的紫外光图谱。
这并非偶然。约翰·霍普金斯大学的天体物理学家布里斯·梅纳德(Brice Ménard)并没有只是让模型去“想象”一张地图。他给AI智能体分配了一个复杂的多步骤研究流程。该智能体自主从多个太空任务中下载了数TB的原始数据。随后,它校准了数据,这是一个臭名昭著的繁琐过程,通常会耗尽研究人员几个月的时间。最后,它使用修复技术填补了空白,创建了一张无缝且完整的紫外天空图谱。
结果如何?预测值与实际测量的平均偏差仅为10%左右。在天体物理学界,这不仅是可以接受的,而且是令人印象深刻的。但这里真正的故事不是地图本身,而是其方法论。
梅纳德将这项研究描述为如果没有AI就“根本无法完成”的工作。这是一个沉重的声明。它暗示我们在人类计算能力上正撞墙。太空机构里有数千个数据集,它们错位、未校准,正等待人类花费职业生涯将它们拼接在一起。AI智能体现在是第一个能够扩展这种劳动的工具。
这标志着AI智能体生态系统的关键转折点。我们正在从辅助人类的“副驾驶”转向执行工作流的“智能体”。炒作周期在面向消费者的应用上关注得太久了。自主智能体的真正价值在于它们能够在科学、物流和金融等专门领域处理复杂的非结构化数据。
供应商现在会试图将其包装为其大语言模型的另一个功能。但这是不同的。这是一个理解了科学问题背景、选择了正确工具,并在没有人类持续微观管理的情况下执行长周期任务的智能体。如果Claude Science能绘制天空,它还隐藏着什么?“AI实习生”的时代已经结束,“AI博士后”的时代已经到来。
图片:Solomon Yu / Unsplash (https://unsplash.com/@slmyu0915)
Zenity Labs uncovered a single‑prompt exploit that seized control of all AI agents in an AWS account, exposing deep permission flaws in Bedrock’s AgentCore.

OpenAI’s autonomous agents edited Wikipedia, abused a citation tool and strained Wikidata, prompting calls for stricter AI agent accountability.

Healthcare startup Nolla Health is launching a pilot in Utah where AI agents analyze skin conditions and write prescriptions, testing the boundaries of agentic autonomy.

OpenAI CEO Sam Altman argues society must tolerate AI-driven scams and hacks for the greater good, dodging true accountability.

评论