← 返回主题

AI 智能体

覆盖智能体协议、工具调用、异步工作流与智能体经济的关键进展。

主要来源

Anthropic (14)OpenAI (7)Cloudflare (6)arXiv (3)DeepSeek (3)Google (3)

文章

开发者离不开工具是因为工具编码了信任

Stack Overflow 最新开发者调查显示,AI 使用率从 76% 升至 84%,信任度却从 40% 跌至 29%。工具编码了流程与信任,而 agentic 工具更快、更不透明,信任缺口正在成为智能体落地的隐性成本。

Karpathy 用指环王开篇测试 Opus 5 的长时程生成

Karpathy 给 Opus 5 一段《指环王》开篇和 1M token 预算(约 10 美元),模型自主跑了约两小时、写出 5500 行代码渲染出可交互的 3D 世界。模型测试正从单步提示走向长时程、近乎免费的超个性化内容生成。

Claude Code 改用 Rust 版 Bun 运行时

Simon Willison 发现 Anthropic 的 AI 编程助手 Claude Code 已内置 Rust 重写的 Bun v1.4.0 运行时,二进制文件中包含 563 个 .rs 源文件,标志着 AI 智能体工具基础设施的系统级优化。

Claude Sonnet 5 发布 智能体能力接近旗舰 Opus

Anthropic 发布 Claude Sonnet 5,定位为"最具智能体能力的 Sonnet 模型",其自主编程、工具调用和多步骤任务能力接近 Opus 4.8,但价格仅为后者一半,为开发者提供了更优的成本性能平衡。

Claude Code 隐写标记与 AI 安全信任新警示

研究员逆向分析发现,Anthropic 的 Claude Code 在系统提示中隐写嵌入 Unicode 标记,用于检测 API 代理转接和模型蒸馏攻击。这一发现引发了对 AI 开发工具透明性与信任边界的深度思考。

ChatGPT 谷歌表格插件被曝可窃取整个工作簿

安全研究团队 PromptArmor 发现,OpenAI 新推出的 ChatGPT for Google Sheets 插件存在间接提示注入漏洞,攻击者只需一行隐藏在导入表格中的恶意数据,就能触发批量数据窃取和钓鱼攻击,且用户设置的「手动确认」开关完全无效。

AI 时代原型迭代速度的质变

开发者 Daryl Cecile 分享了 AI 编程工具如何将他的原型制作速度提升约 4 倍,更重要的是改变了工作的「形状」——从逐行编码转向系统边界和契约设计,让曾经「想法很好但没有时间」的项目变成了一个下午就能完成的事。

Anthropic 发布金融行业智能体模板

Anthropic 推出十款面向金融服务的智能体模板,涵盖路演书制作、KYC 审核与月终结账等场景,并打通 Excel、PowerPoint 与 Outlook,让 AI 智能体真正进入核心金融工作流。

LLM 让知识工作的表面质量不再可靠

One Happy Fellow 讨论了 LLM 对知识工作评估机制的破坏。过去拼写、格式、代码审查等表面信号还能作为质量代理指标,但当 AI 能廉价生成这些信号时,组织需要重新思考如何判断真实工作质量。