集群

智能体工程

编程智能体、MCP、上下文系统、评估与可靠自动化控制。

博客文章
55
主题
AI 与智能体

从核心文章开始

本集合最新内容

Rust 编译器图将持久声明身份连接到经过验证的语义补丁 AI 与智能体

智能体编辑为何需要语义身份:用 Rust 构建 SEMAPRAX

从编译器工程角度解析实验性语言 SEMAPRAX 的持久 ID、已检查 HIR、确定性图和可重放补丁。

LangChain Deep Agents 连接规划、子 Agent、文件、审批、Sandbox 与生产追踪 AI 与智能体

LangChain Deep Agents 评测:Agent Harness 能否用于生产?

从采购与落地视角评测架构、v0.7 变化、安全边界、运行成本与可衡量生产试点。

OpenViking 通过 viking 路径把智能体记忆、RAG 资源和技能连接成文件系统 AI 与智能体

OpenViking 2026 评测:文件系统式记忆适合生产吗?

面向买方评测 OpenViking 智能体记忆与 RAG,涵盖架构、AGPL 风险、安全控制、运营成本和两周可量化试点。

连续验证分数对多条 AI 智能体轨迹进行排序 AI 与智能体

LLM-as-a-Verifier 详解:架构、成本与生产适用性

面向技术买家的细粒度 LLM 验证指南,涵盖 logprob 评分、枢轴锦标赛、基准证据与安全试点。

TrueForge Agent Harness 连接模型、MCP 工具、子 Agent、审批、Sandbox 代码执行与追踪 AI 与智能体

TrueForge 评测:开源 Agent Harness 是否达到生产要求?

从采购与落地视角评测 TrueForge,覆盖 Agent Loop、上下文控制、benchmark 成本、部署模式与企业生产缺口。

同一个页面分别以 HTML、Markdown 镜像和 llms.txt 条目的形式提供,并由构建关卡逐一检查 AI 与智能体

智能体可读的网站:llms.txt、Markdown 镜像,以及会坏在哪里

有四个接口共同决定 AI 答案引擎能否读到你,而每一种失败在浏览器里都看不见。这是我们自己的构建关卡抓到过的清单。

完整文章目录

  1. 智能体编辑为何需要语义身份:用 Rust 构建 SEMAPRAX
  2. LangChain Deep Agents 评测:Agent Harness 能否用于生产?
  3. OpenViking 2026 评测:文件系统式记忆适合生产吗?
  4. LLM-as-a-Verifier 详解:架构、成本与生产适用性
  5. TrueForge 评测:开源 Agent Harness 是否达到生产要求?
  6. 智能体可读的网站:llms.txt、Markdown 镜像,以及会坏在哪里
  7. 本地化 URL 会搞坏 hreflang:只保留一个英文 slug
  8. AI 智能体能用你的产品,还是只能读到它?
  9. Graft 评测 2026:智能体仓库地图该进 Git 吗?
  10. 通过工具输出压缩降低编码代理成本
  11. 用 AI 编码智能体更聪明地管理 Token
  12. DeepSeek Harness 评测:插件化 Agent 技术栈能否用于生产?
  13. OpenSandbox 评测:自托管是否值得?
  14. Cloudflare Kitesurf 评测:成本、限制与生产适用性
  15. GitHub Spec Kit 评测:这套流程值得吗?
  16. 企业内部 AI 智能体市场:2026 架构与落地指南
  17. Linux 是 AI 智能体的最佳操作系统吗?2026 基础设施指南
  18. MCP Cloud 对比 Manufact Cloud:MCP 托管指南
  19. 如何用 Agent Skills 让 AI 写作更自然
  20. NVIDIA NOOA 评测:面向对象智能体适合生产环境吗?
  21. Strix AI 渗透测试:2026 年 30 天试点与采购指南
  22. Hyperagent 评测:无需自建服务器的云端 AI 智能体
  23. Hark Handoff 评测:真正会点击网页的智能体
  24. Meta Muse Code 定价:Contributor 能用于客户代码吗?
  25. LLM 提示词发送前的 PII 脱敏:实用流水线
  26. Agent Reach 评测:真实成本、安全边界与生产适用性
  27. Cloudflare Wallets AI 智能体钱包:哪些功能已上线?
  28. YC QM Agent 评测:Quartermaster 能用于工作吗?
  29. jcode 对比 Claude Code:值得切换到 Rust 智能体框架吗?
  30. Lightpanda AI 智能体浏览器:生产评测与迁移指南
  31. AI 智能体的图工程:知识图谱什么时候值得做?
  32. 多模型 AI 编程智能体技术栈:团队采购指南
  33. MCP 现在无状态了吗?服务器迁移清单
  34. MCP 不是安全边界:如何保护智能体访问的数据
  35. AI 智能体如何互相通信?Band 配置与选型指南
  36. 软件开发机构技术实测 LeanCTX:集成、数据与局限
  37. 用 CLIProxyAPI 在 Claude Code 中运行 GPT-5.6 Sol
  38. 企业级 MCP 授权架构:多租户参考设计
  39. OpenAI 评测沙箱逃逸:测试网络安全 Agent 前的 12 项控制
  40. Meterless 评测 2026:AI 智能体上下文层能否用于生产?
  41. Claude Code vs OpenCode:2026 年团队用哪个更省钱?
  42. Graphify 2026 评测:代码库知识图谱值得引入吗?
  43. AI 试点终止或扩展评分卡:运行 30 天后检查的 12 项指标
  44. T3MP3ST 2026 评测:它能取代渗透测试吗?
  45. Open Knowledge Format(OKF):企业实施指南
  46. AI Agent Cost per Action:为什么 agentic 工作流会推高 token 账单
  47. 如何在 Claude Code 中使用 Claude Fable 5
  48. 2026 年 DACH 地区的内部 AI 助手到底要花多少钱
  49. 瓶颈从来不是智能,而是上下文。
  50. DACH 企业怎么选:ChatGPT Enterprise vs Copilot vs 自建 RAG
  51. MCP、RAG、Agent Skills 与 Custom GPTs 怎么选?
  52. 30/60/90 天 AI 智能体试点:上线计划
  53. 面向 SharePoint、Confluence、Drive 的权限优先 RAG
  54. 面向欧盟企业的 RAG 生产就绪清单
  55. 为什么 40% 的 AI 代理项目会死