Glean 拾遗
日刊 · 时间线

每天拾几条。

2026-08-11 · 周二 3 条
← 08-10
日历 ▾
2026 · 08
MoTuWeThFrSaSu ·····12345678910111213141516171819202122232425262728293031
有日刊 今天
06:00

模型选型五问:开源与闭源、Token 成本、延迟、上下文窗口怎么权衡

5 Questions to Ask Before Choosing an LLM

选 LLM 看起来是单次决定,实则要随新模型和产品演化反复重做。本文把选型拆成五个问题:开源还是闭源、成本、延迟、性能、上下文窗口。开源模型需要自行托管或走 API 供应商(Hugging Face、Groq),闭源模型由模型厂商托管,按 token 计费,价格战愈演愈烈。延迟的测量要看 TTFT 和 TPOT;性能先参考公开榜单(Chatbot Arena、Open LLM Leaderboard),但榜单存在过拟合风险,真正的验证只能在应用内用自建 evals 进行。推理模型(如 o1)在编程和数学上更强,但要付出更高的 token 成本和更长响应时间。上下文窗口同时计入输入与输出 token,RAG 中的 chunking 等模式就是在有限的窗口里塞进更多信息。适合刚开始做模型选型的 AI 应用开发者。

www.aihero.dev · 8 min · AI Engineering · Context Engineering · Cost Optimization · LLM · Performance
06:00

Cloudflare OS:让每个员工拥有带权限治理的 Agent 工作台,开源可自部署

Cloudflare OS: an open source agent workspace with capability-based governance

Cloudflare 开源其内部 AI 工作平台 Cloudflare OS,目标是把 Agent 从程序员扩展给全体成员。核心不是又一个聊天工具,而是一个绑定公司上下文与系统的工作区:Agent 默认零权限,通过 typed binding 拿到受限资源;Gatekeeper 作为外部服务与 Agent 之间的代理,持有凭证、执行策略并记录每次读取。当 Agent 把敏感数据做成仪表盘再共享时,平台会依据观察日志复核查看者权限,防止旁路泄露。应用即 Worker,每个应用拥有自己的 SQLite 状态,Agent 也能调用用户构建的方法。所有模型调用经 AI Gateway 统一控管。适合关注 Agent 基础设施、权限治理与内部工具平台工程的人阅读。

blog.cloudflare.com · 16 min · Agent Infrastructure · AI Agents · Capability Security · Cloudflare · Mcp
06:00

企业级 AI 工作台:每个应用都是可让 AI 改代码的私有沙箱

Cloudflare OS: an AI workspace with per-user sandboxed apps

Cloudflare OS 是 Cloudflare 内部自用、现已开源的企业级 AI 生产力环境,定位是“公司操作系统”兼“AI 工作负载操作系统”。它不是传统 OS,而是一套把办公套件、应用开发与安全管控统一起来的平台:每个文档或工具都是一个由 AI 生成、独立沙箱运行的“Gadget”应用,用户可随时让内置 agent 修改代码;外部服务访问由“Gatekeeper”按能力安全模型逐项授权并审计,还支持把需要人工确认的操作推迟到之后批量审批。整套系统运行在 Cloudflare Workers / workerd 之上,深度使用 Durable Objects、Dynamic Workers 和 Facets,并默认具备实时多人协同。适合关注 AI 智能体基础设施、边缘计算平台与 AI 编程工具的工程师阅读或二次开发。

github.com · 23 min · Agent Architecture · AI Agents · Cloudflare · LLM · Mcp