来自实战 第 №165

观点,不是新闻稿

精选首页连接到聚焦的主题与集群页面,让旧文章不会仅因发布时间较早而失去可见性。

按主题探索
06
聚焦集群
12
博客文章
165

最新文章

每页展示九篇文章,并按发布日期排序。

把提示词渲染成图像以降低 LLM 成本:诚实解读 pxpipe 技巧 AI 与智能体

Pxpipe 评测:图像能把 Claude Code 成本降低 60% 吗?

Pxpipe 把大量上下文渲染成图像,并报告端到端账单降低 59% 至 70%。节省机制真实存在,但精确字符串可能被无声误读。

每 token 成本与每任务成本:更低的单价,仍可能带来更高的总账单 AI 与智能体

每 token 更便宜。每个答案更贵。

Sonnet 5 的每 token 单价比 Opus 4.8 更低,但在完整基准测试中,每完成一个任务的成本反而更高。为什么真正决定账单的是每任务成本,而不是每 token 单价。

用 Claude Fable 5 写代码:在 Fable、Opus、Sonnet 和 Haiku 之间做模型路由 AI 与智能体

如何在 Claude Code 中使用 Claude Fable 5

在 Claude Code 中启动 Fable 5,把它用于架构、长迁移和最终审阅,把机械实现路由给更便宜的模型,并了解价格、保留和回退限制。

Anthropic 对开源 AI 的战争,其实是一场关于智能成本的较量 AI 与智能体

Dario 向开源宣战。真正的战争,是关于你那张 AI 账单。

Anthropic 指控中国实验室窃取它的模型,并请华盛顿介入。剥掉地缘政治,这是一场关于智能价格的仗。Coinbase 已用开放权重和路由把 AI 账单砍掉 50%。我们的解读,以及欧盟的对冲。

敏捷去工程化与企业工程文化的侵蚀 交付与 QA

敏捷去工程化

一场旨在解放工程师的运动,如何反而侵蚀了企业的工程文化。Alexandre Kotcherguine 与 Kevin Riedl 追溯商业化、仪式捕获、指标倒置和工程手艺侵蚀的完整机制。

2026 年 DACH 内部 AI 助手成本 AI 与智能体

2026 年 DACH 地区的内部 AI 助手到底要花多少钱

Embedding、向量库、token、托管,以及所有人都忘记的维护项。一份面向 DACH 公司的方向性每席位成本拆解。

在 AI 时代用最小可信产品取代传统 MVP 产品与 MVP

MVP 已死。请构建最小可信产品。

AI 降低了原型成本,却没有降低产品判断的难度。粗糙的传统 MVP 如今可能污染它本应收集的信号。本文提出一种更小、更完整、更可信,并能产生决策级证据的首版产品。

2026 年 LLM 网关对比 AI 与智能体

2026 年 LLM 网关对比:LiteLLM vs OpenRouter vs Portkey vs RouteLLM

一个端点覆盖多家供应商,把回退、缓存、花费上限和路由收在一处。LiteLLM、OpenRouter、Portkey 和 RouteLLM 有何区别,以及怎样按约束你的那条限制来选。

在欧盟自托管开放权重 LLM AI 与智能体

在欧盟自托管 LLM:开放权重模型何时才真正划算

GPU 是便宜的部分。这里讲清自托管的真实成本、相对托管 API 的每天 token 盈亏平衡点、数据驻留何时逼你出手,以及 vLLM 生产栈。

只收重要内容

关注与你相关的内容

每当我们发布新文章,你会收到一封简短邮件。你可以关注整个博客,也可以只选感兴趣的主题。

你希望接收哪些内容?
选择主题

免费、双重确认、不使用跟踪像素。