AI 周报:两大旗舰被安全刹车,FTC 调查头部实验室
读到的内容也会变成指令:Agent 安全的结构性难题
考卷本身也会错:Agent 评测学的四大失效
补个向量库是不够的:Agent 记忆的四条路线与一场信任危机
把经验变成资产:Agent 自我改进的五条路线
从会搜到会研究:Agentic RL 的配方与头号风险
点不准是最大瓶颈:计算机使用代理的两年
模型之外的胜负手:长时程 Agent 与 Harness 工程
协议之争落幕:MCP 与 A2A 的收敛与新的分歧
多代理值不值:条件增益、15 倍成本与失败模式