Glean 拾遗
日刊 · 时间线

每天拾几条。

2026-08-13 · 周四 2 条
← 08-12
日历 ▾
2026 · 08
MoTuWeThFrSaSu ·····12345678910111213141516171819202122232425262728293031
有日刊 今天
10:47

Grok 4.6 与 DeepSeek V4 Pro 同日实测:准 Fable 级能力,价格打到底

Grok 4.6 and DeepSeek V4 Pro: near-Fable power, far lower price

作者以个人开发者视角,记录 DeepSeek V4 Pro 与 Grok 4.6 同夜发布后的选型变化。关键数据:DeepSeek V4 Pro 百万输出 Token 0.87 美元,约为 Claude Fable 5 的 1/57,Terminal Bench 2.1 得分 87.9(Fable 5 为 88.0),DeepSWE 从预览版 12.8 升至 62.7;Grok 4.6 输入/输出定价 2/6 美元每百万 Token,作者实测连续开发 4 小时仅消耗 SuperGrok Heavy 周额度 2%。作者同时承认不可能三角未完全打破:DeepSeek 仍缺多模态且速度一般,Grok 在纯开发与 Agent 场景逊于 Fable 5。适合关注大模型选型、成本优化与开发速度的 AI 工程师。

10:11

Grok 4.6 使用指南:短提示词加验证循环胜过冗长规格

Grok 4.6 Field Guide: Verification Loops Beat Long Prompts

作者以 Grok 4.6 作为主力模型使用数周,覆盖编码与知识工作,并用同一提示词与 4.5 做对照。核心发现:短提示词配合明确偏好,效果接近两页纸的详细规格;真正拉高结果的是追加一句“实现后验证并迭代到生产可用”,让模型打开应用、点击真实路径、修正嵌套公式。4.6 在浏览器自动化、视觉 QA、收件箱清理、Excalidraw 改造等任务上表现稳定,但 3D 与视频仍需人工检查,因为模型无法通过截图验证时间维度的正确性。作者疑似 xAI 成员,文章带有发布推广口吻,但方法论与提示词例子有参考价值,适合用 Cursor 等 AI 编码工具的工程师。