主题

AI 与智能体

AI 系统、编程智能体和模型基础设施的工程、运营与评估。

博客文章
101
聚焦集群
02

聚焦集群

从核心文章开始

本集合最新内容

通过 OpenCode Zen 与 OpenRouter 使用 Ox Alpha 免费隐身 AI 模型并检查隐私和成本 AI 与智能体

Ox Alpha Free:设置、隐私与团队采购指南

通过 OpenCode 或 OpenRouter 使用这款 1M 上下文隐身编程模型,并核对模型 ID、隐私条款、额外费用和安全试点方案。

Rust 编译器图将持久声明身份连接到经过验证的语义补丁 AI 与智能体

智能体编辑为何需要语义身份:用 Rust 构建 SEMAPRAX

从编译器工程角度解析实验性语言 SEMAPRAX 的持久 ID、已检查 HIR、确定性图和可重放补丁。

LangChain Deep Agents 连接规划、子 Agent、文件、审批、Sandbox 与生产追踪 AI 与智能体

LangChain Deep Agents 评测:Agent Harness 能否用于生产?

从采购与落地视角评测架构、v0.7 变化、安全边界、运行成本与可衡量生产试点。

Pika Audio 四种 API 模型对应音效、语音、音乐和视频同步声轨,并配有成本控制 AI 与智能体

Pika Audio API 价格:SFX 真的便宜 20 倍吗?

Pika 将 SFX 定价为每秒 0.0002 美元,还提供三种音频模型。切换前应先算清盈亏平衡点、API 限制、质量门槛和生产适配度。

多个 GPU 工作负载通过虚拟化层共享加速器资源池 AI 与智能体

Thunder Compute 获 1300 万美元融资:企业 GPU 虚拟化采购指南

Thunder Compute 希望用 GPU 资源池回收闲置算力。本文比较网络虚拟化、MIG、vGPU 与直通,并给出可量化的企业试点方案。

OpenViking 通过 viking 路径把智能体记忆、RAG 资源和技能连接成文件系统 AI 与智能体

OpenViking 2026 评测:文件系统式记忆适合生产吗?

面向买方评测 OpenViking 智能体记忆与 RAG,涵盖架构、AGPL 风险、安全控制、运营成本和两周可量化试点。

完整文章目录

  1. Ox Alpha Free:设置、隐私与团队采购指南
  2. 智能体编辑为何需要语义身份:用 Rust 构建 SEMAPRAX
  3. LangChain Deep Agents 评测:Agent Harness 能否用于生产?
  4. Pika Audio API 价格:SFX 真的便宜 20 倍吗?
  5. Thunder Compute 获 1300 万美元融资:企业 GPU 虚拟化采购指南
  6. OpenViking 2026 评测:文件系统式记忆适合生产吗?
  7. LLM-as-a-Verifier 详解:架构、成本与生产适用性
  8. AirLLM 只用 4GB 显存跑超大模型?逐层推理原理与代价
  9. TrueForge 评测:开源 Agent Harness 是否达到生产要求?
  10. 智能体可读的网站:llms.txt、Markdown 镜像,以及会坏在哪里
  11. Qwen3.8-27B:自托管电脑操作智能体,截图不出内网
  12. 本地化 URL 会搞坏 hreflang:只保留一个英文 slug
  13. AI 智能体能用你的产品,还是只能读到它?
  14. Graft 评测 2026:智能体仓库地图该进 Git 吗?
  15. 通过工具输出压缩降低编码代理成本
  16. 用 AI 编码智能体更聪明地管理 Token
  17. DeepSeek Harness 评测:插件化 Agent 技术栈能否用于生产?
  18. Netflix 的 vLLM 与 Triton 推理栈:7 个生产经验
  19. OpenSandbox 评测:自托管是否值得?
  20. Transformers.js 浏览器本地 AI:什么时候适合放进产品
  21. Cloudflare Kitesurf 评测:成本、限制与生产适用性
  22. GitHub Spec Kit 评测:这套流程值得吗?
  23. 企业内部 AI 智能体市场:2026 架构与落地指南
  24. LiteLLM 生产级自托管指南:2026 架构与安全
  25. AI 就绪企业 Wiki:架构与实施指南
  26. Linux 是 AI 智能体的最佳操作系统吗?2026 基础设施指南
  27. Claude 会给文本加水印吗?2026 API 实战解读
  28. OpenKB 评测:知识编译器 vs RAG
  29. Unsloth Desktop 评测:私有本地 AI 工作站?
  30. NeMo Switchyard 0.2:无需训练的智能体模型路由?
  31. Firecrawl AnyDoc 评测:14 种格式转 Markdown
  32. MCP Cloud 对比 Manufact Cloud:MCP 托管指南
  33. Muse Glimmer 30B:Meta 本地智能体模型能否用于生产?
  34. 如何用 Agent Skills 让 AI 写作更自然
  35. NVIDIA NOOA 评测:面向对象智能体适合生产环境吗?
  36. OmniRoute AI 路由:配置指南与生产检查清单
  37. Strix AI 渗透测试:2026 年 30 天试点与采购指南
  38. Hyperagent 评测:无需自建服务器的云端 AI 智能体
  39. Gemini Robotics 2:全身控制与试点决策
  40. Hark Handoff 评测:真正会点击网页的智能体
  41. Meta Muse Code 定价:Contributor 能用于客户代码吗?
  42. pdf-inspector 评测:先本地解析 PDF,再调用 OCR
  43. LLM 提示词发送前的 PII 脱敏:实用流水线
  44. Agent Reach 评测:真实成本、安全边界与生产适用性
  45. Cloudflare Wallets AI 智能体钱包:哪些功能已上线?
  46. 本地多模态 AI 编程助手:语音、OCR 与隐私架构
  47. 一台 AI PC 本地运行 DeepSeek V4 Flash 0731,现实效果如何?
  48. YC QM Agent 评测:Quartermaster 能用于工作吗?
  49. jcode 对比 Claude Code:值得切换到 Rust 智能体框架吗?
  50. Lightpanda AI 智能体浏览器:生产评测与迁移指南
  51. AI 智能体的图工程:知识图谱什么时候值得做?
  52. 多模型 AI 编程智能体技术栈:团队采购指南
  53. MCP 现在无状态了吗?服务器迁移清单
  54. MCP 不是安全边界:如何保护智能体访问的数据
  55. 用 Unsloth 和 Colab 免费微调 Gemma 4
  56. AI 智能体如何互相通信?Band 配置与选型指南
  57. Taalas HC1 评测:硬编码 LLM ASIC 值得买吗?
  58. 软件开发机构技术实测 LeanCTX:集成、数据与局限
  59. 你的硬件能运行哪个本地 LLM?llmfit 使用指南
  60. 用 CLIProxyAPI 在 Claude Code 中运行 GPT-5.6 Sol
  61. Miso TTS 本地部署对比 API:成本、延迟与显存真相
  62. 企业级 MCP 授权架构:多租户参考设计
  63. 把 RAG 向量内存压到 1/16:数据无关量化能上生产了吗?
  64. 共享 KV 缓存在不新增 GPU 的情况下把 LLM 推理延迟降低 14x
  65. LLM 权重无损压缩 vs 8-bit GGUF:哪些已具备生产条件?
  66. OpenAI 评测沙箱逃逸:测试网络安全 Agent 前的 12 项控制
  67. Cisco Antares 评测:用于漏洞定位的 1B 本地 AI
  68. Meterless 评测 2026:AI 智能体上下文层能否用于生产?
  69. NVIDIA Nemotron 3.5 ASR:免费自托管 STT 能否用于语音智能体?
  70. Claude Code vs OpenCode:2026 年团队用哪个更省钱?
  71. Kimi K3 企业评测:API 价格、数据合规与试点清单
  72. Mesh LLM 评测:一个大模型能否跨多台电脑运行?
  73. Graphify 2026 评测:代码库知识图谱值得引入吗?
  74. Bonsai 27B 评测:270 亿参数 LLM 真的能在手机上运行吗?
  75. AI 试点终止或扩展评分卡:运行 30 天后检查的 12 项指标
  76. Soofi S:德国主权大模型准备好商用了吗?
  77. T3MP3ST 2026 评测:它能取代渗透测试吗?
  78. Colibri 让消费级硬件跑起 GLM-5.2,代价是什么?
  79. Open Knowledge Format(OKF):企业实施指南
  80. AI Agent Cost per Action:为什么 agentic 工作流会推高 token 账单
  81. 本地模型什么时候胜过 API:欧盟企业盈亏平衡计算器
  82. 2026 年 LLM 成本计算器:算任务,不算 Token
  83. Pxpipe 评测:图像能把 Claude Code 成本降低 60% 吗?
  84. 每 token 更便宜。每个答案更贵。
  85. 如何在 Claude Code 中使用 Claude Fable 5
  86. Dario 向开源宣战。真正的战争,是关于你那张 AI 账单。
  87. 2026 年 DACH 地区的内部 AI 助手到底要花多少钱
  88. 2026 年 LLM 网关对比:LiteLLM vs OpenRouter vs Portkey vs RouteLLM
  89. 在欧盟自托管 LLM:开放权重模型何时才真正划算
  90. 2026 最佳开放权重 LLM:DeepSeek、Qwen、Kimi、GLM 与 Llama
  91. 瓶颈从来不是智能,而是上下文。
  92. DACH 企业怎么选:ChatGPT Enterprise vs Copilot vs 自建 RAG
  93. MCP、RAG、Agent Skills 与 Custom GPTs 怎么选?
  94. 如何在 2026 年降低 LLM Token 成本
  95. 30/60/90 天 AI 智能体试点:上线计划
  96. 面向 SharePoint、Confluence、Drive 的权限优先 RAG
  97. 面向欧盟企业的 RAG 生产就绪清单
  98. 什么时候值得构建一套 LLM 评测?成本、ROI 与信任裁判
  99. 为什么 40% 的 AI 代理项目会死
  100. 2026:RAG vs Fine-Tuning vs Long-Context
  101. 2026 LLM API 成本:架构要变