黎曼猜想:60个子智能体科研

Anthropic披露,一个未发布的Claude研究版本借助60个子智能体、消耗3100万输出token,在两个会话中调用2400条shell命令并完成数千次数值校验,把黎曼ζ函数零点满足黎曼猜想比例的下界从41.6%推到67.2%。模型未"证否"猜想,而是拼接近期论文成新推理路径。

DARPA:F-16全AI驾驶

本周DARPA成功完成首次全AI驾驶F-16测试飞行。AI从"软件"迈入"武器/载具"的执行层,自主决策的外延再次扩大。

白宫:AI评估框架成型(保密)

基于行政令的AI评估框架完成,设30天自愿审查期、NSA主导评估,仅闭源模型受约束、开源权重豁免。框架内容不公开引发争议,也折射出监管与创新的张力。

一道科技解读:能力边界即风险边界

当AI能参与数学研究、驾驶战机,企业更该重视"可控的自主"。一道科技在部署Agent时,坚持权限收口、操作留痕、人工复核的关键动作审批。