X / Twitter7 条

Agent Harness 与提示工程

围绕 Agent Harness 方法论与提示工程法则。@huxlab 称从 Anthropic 研发朋友处获得 30 分钟内部录屏,提炼 5 条内部提示词核心法则:用 XML 严格隔离语义块(数据、业务政策与角色边界不可揉成大段文本);定期清理旧模型的防御性补丁(新模型遵循能力强,遗留负向限制会过度拟合);指令无法凭空赋予能力(复杂运算剥离给 Tool Calling 代码执行);业务权衡必须给全博弈天平两端(只灌输单向成本会让模型极端避险);用「生成-评估-修复」闭环取代单体巨型 Prompt(拆成三步轻量流水线,Token 与延迟腰斩并动态兼容运行时软约束)。此外 @santtiagom_ 曾推荐的 Harness Engineering 论文亦以 Agent = Model + Harness 为核心定义。

@huxlab

作者称从Anthropic研发朋友处获得30分钟内部录屏,提炼出5条Anthropic内部正在使用的Claude提示词核心法则,涉及XML语义隔离、清理旧防御性补丁、指令无法赋予能力、给出完整权衡天平、用生成-评估-修复闭环替代巨型Prompt。

X / Twitter查看原文 →

@beamnxw

@beamnxw 称 Andrej Karpathy(前 OpenAI、前 Tesla)发布一个提示词,将 Opus 5.5 变成能真正完成任何任务的 harness。

X / Twitter查看原文 →

@math_fournity

@math_fournity 称所有 Coding Plan 天塌了,某服务提供每天 15 小时 GLM-5.3 Flash 和每天 10 小时 DeepSeek V4.1 Flash,一个账号即可。

X / Twitter查看原文 →

@HeyShobhan

@HeyShobhan 称 Andrej Karpathy 在 OpenAI 和 Tesla 工作 8 年后,将所知浓缩为一小时免费两小时讲座,主题 Agents → Loops → Harness → Self-Improving Systems。

X / Twitter查看原文 →

@santtiagom_

@santtiagom_ 推荐一篇关于 Harness Engineering 的最佳论文,解释 harness 是什么、当前编码代理如何构建、Claude Code/Codex/Gemini CLI 等的共同模式、该类别演进方向及自建建议。

X / Twitter查看原文 →

数据由 GitHub Actions 每小时自动抓取 · AI 摘要聚合 · News Monitor