Glean 拾遗
日刊 · 时间线

每天拾几条。

2026-08-07 · 周五 3 条
← 08-06
日历 ▾
2026 · 08
MoTuWeThFrSaSu ·····12345678910111213141516171819202122232425262728293031
有日刊 今天
06:00

一文看懂 LLM Token:从拆分、编码到计费

What Are Tokens? A Practical Guide to LLM Tokenization

LLM 中 token 的基础概念与工作机制:tokenizer 如何把文本拆成 token、再映射成数字;解码过程如何把数字还原为文本。文章用 'the cat sat on the mat' 的微型语料演示字符级到词组级的词汇表构建,并给出具体数字:词汇表从 1000 到 200000,'understanding' 的词元数从 5 降到 2;生僻词如 'Frabjous' 15 个字符被拆成 7 个 token。同时说明计费同时计入输入与输出 token,输入包含对话历史、system prompt 与工具定义,控制输出长度可直接省钱。适合想理解 token 计费与优化成本的 LLM 应用开发者。

www.aihero.dev · 4 min · AI Engineering · LLM · Token-Optimization · Tokenization
06:00

Jeff Dean 离职前最后一谈:低估 AI 速度,给创业者的 0% 生存法则

Jeff Dean's Last Interview: AI Speed, the 0% Rule, and His Google Exit

Jeff Dean 在 Google 最后一天前夕接受 YC 访谈,承认一年前对 AI 能力的预测仍偏低:模型处理复杂任务的增长速度快于预期,基于 Agent 的系统已能连续运行数周。他将推理专用硬件比作 2001 年“把搜索索引装进内存”的转折时刻,并给出具体数字:50 倍延迟改善、30-80 倍能效提升;做一次计算约消耗一皮焦耳,而搬运数据的能耗是其 1000 倍,这决定了 batching 的必要性。访谈还讨论了上下文工程取代纯模型缩放成为新前沿、TPU 由“餐巾纸数学”催生的历史,以及给创始人的测试:用当前最强通用模型测目标领域,成功率 0% 或 1% 是好信号,20% 则是危险信号。他认为当 Agent 写完代码后,“品味”(知道该让 Agent 解决什么问题)将成为稀缺技能。适合 AI 基础设施工程师、Agent 开发者和 AI 创业者阅读。

www.infoq.cn · 14 min · AI Agents · Context Engineering · Inference Hardware · Performance
06:00

技能包 v1.2:新增 /wait-what 纠偏指令,并兼容 Codex 元数据

Skills v1.2: /wait-what, Codex metadata, and a Claude Code plugin

Matt Pocock 将其 AI 编码技能库升级到 v1.2,改以 Claude Code 插件形式发布,并推出 aihero.dev/skills 文档站。每个 SKILL.md 新增 agents/openai.yaml 侧车,携带 Codex UI 元数据;其中的 policy.allow_implicit_invocation: false 将用户调用型技能排除在模型自动上下文外,使两套 harness 行为一致。新技能 /wait-what 用单个引导词重述而不错剪内容,/wizard 在遇到仅人工可执行的步骤时自动生成确定性 bash 向导脚本,/to-questionnaire 将无法独自回答的决策变成异步 Markdown 问卷。/wayfinder 路由器引入相位边界,/handoff 收窄为跨场景转移,/compact 成为默认上下文动作;/write-for-agents 更名 /docs-for-agents,六个技能被并入或移除。适合在 Claude Code 或 Codex 中维护 agent 技能、关注上下文工程细节的工程师。

www.aihero.dev · 14 min · Agent Engineering · Agent Tooling · Claude Code · Codex · Context Engineering