Glean 拾遗
日刊 · 时间线

每天拾几条。

2026-07-26 · 周日 3 条
← 07-25
日历 ▾
2026 · 07
MoTuWeThFrSaSu ··12345678910111213141516171819202122232425262728293031
有日刊 今天
06:00

Claude 5 上下文工程新规则:删掉 80% 系统提示,让模型凭判断力工作

The new rules of context engineering for Claude 5 models

Anthropic 分享了为 Claude 5 系列模型(如 Opus 5、Fable 5)进行上下文工程的最新经验。核心发现:之前的系统提示和约束过度了,新模型拥有更好的判断力,可以大幅简化。他们移除了 Claude Code 中 80% 的系统提示,且内部评测无性能损失。文章对比了旧实践(给规则、给例子、全部放前面、重复、记忆在 CLAUDE.md、简单规格)和新实践(让模型用判断力、设计接口、渐进式披露、简洁工具描述、自动记忆、丰富引用)。具体建议:CLAUDE.md 保持轻量,主要记录代码库的 gotcha;利用 Skills 作为按需加载的轻量指南;使用渐进式披露避免上下文爆炸;优先使用代码作为引用而非描述。文章还介绍了 `claude doctor` 命令帮助自动简化上下文。适合使用 Claude Code 或构建基于 Claude 的 Agent 的工程师阅读。

06:00

Claude Opus 5 发布:接近 Fable 5 性能,成本减半

Introducing Claude Opus 5: Near-Frontier Performance at Half the Cost

Anthropic 发布 Claude Opus 5,性能接近最强模型 Fable 5 但价格减半。在编码(Frontier-Bench v0.1 超越所有模型,性能是 Opus 4.8 的两倍以上)和知识工作(ARC-AGI 3 得分是次优模型的 3 倍)上达到新 SOTA,但网络安全任务仍落后于 Mythos 5。模型支持 effortless 设置以平衡成本与智能,客户反馈在软件开发、金融、法律等领域表现显著提升。安全对齐更好,但故意未训练网络攻击能力,且安全拦截比 Fable 5 减少约 85%。定价与 Opus 4.8 相同,提供 Fast 模式。

www.anthropic.com · 20 min · AI Engineering · Anthropic · Cost Optimization · LLM · Performance
06:00

AI Agent 工程实践全覆盖:从原理到生产的开源书

AI Agent Engineering in Depth: From Principles to Production

《深入理解 AI Agent:设计原理与工程实践》是一本全面覆盖 AI Agent 技术的开源书籍,由李博杰撰写。围绕核心公式“Agent = LLM + 上下文 + 工具”,以 10 章从基础知识、上下文工程、用户记忆、工具使用、Coding Agent、评估、模型后训练、持续进化、多模态到多 Agent 协作,层层递进。书中包含 92 个配套实验(70+ 可独立运行),覆盖 MCP、RAG、强化学习等前沿实践。适合对 AI Agent 感兴趣的工程师、研究者以及希望构建生产级 Agent 系统的开发者。

github.com · 15 min · Agents · AI Engineering · Context Engineering · LLM · Mcp