文章
按时间倒序整理的全部文章。
-
AI 交付需要一条可验证的证据链
这期 Community Wisdom 的四组讨论看似分散,实际都在处理同一个变化:AI 大幅压低了产出代码、界面和内部工具的成本,真正稀缺的部分随之转向意图传递、结果验证和责任承担。
-
执行成本下降之后,瓶颈转向治理
这期 Community Wisdom 收录了六组社区讨论。
-
负网络效应:当激励开始毒化社区
这期 Community Wisdom 的几组讨论都涉及同一个底层问题:系统中的参与者会根据真实激励行动,而团队经常只设计流程,行为后果成为被忽略的部分。
-
Harness 工程实践:如何让 Agent 完成自主迭代
一个人一天最多跑一次迭代实验,但每周上百个 badcase 追着我们跑——我们团队用 Harness 工程让 AI 自主运行 17 小时、完成 16 轮迭代实验,最终上线了实验。这篇文章复盘了整个搭建过程。
-
100 工具 Agent 是个陷阱
这是一场来自 AI Engineer 频道的演讲,主题是"100 工具 Agent 陷阱":当你给 AI Agent 一次性提供过多工具时,准确率会随着工具数量增长而急剧下降。
-
Agent 构建 Agent
本演讲来自 AI Engineer 频道,主题为"Agent 构建 Agent"——介绍如何借助编程辅助工具与规格驱动开发,通过 AutoAgent 循环和实时数据分析流水线,迭代构建可靠、安全的 AI Agent。
-
Agent 化 AI 工程师
本演讲介绍 Mutagent 团队如何用 Agent 化方式构建 AI Agent 生命周期管理系统,覆盖规格说明、构建、评测、部署、诊断、优化六个阶段,并现场演示了评测 Agent 和诊断 Agent 两款处于研究预览阶段的产品。
-
AI 系统设计:从想法到生产
来自 MongoDB 的开发者倡导者 Apoorva Joshi 分享了一套四阶段 AI 系统设计框架:产品需求、系统设计、评估与监控、优化。
-
HTML 就够了:让 Agent 生成图形
这场来自 AI Engineer 频道的短讲提出一个观点:让 Agent 生成幻灯片、文档、视频等图形化产物时,关键不是强迫它操作画布或直接写 SVG 坐标,而是给它使用更符合语言模型思维方式的媒介。
-
Miranda 假说:Hamilton 如何毒化角色评测
这场演讲提出“Miranda 假说”:当文化作品覆盖历史记录时,角色扮演系统会生成流畅但时代错位的复合人格,而现有角色评测往往只衡量声音和人格一致性,无法发现这种失败。