任务路线

让 AI 听话

把模糊想法写成模型能执行、你能验收的指令。

模型与输出

6 个条目

提示词Prompt

让 AI 听话构建 AI 应用

「我对它说的话,它怎么就理解成了另一个意思?」

发出去的指令

给「檐下」写首页标语,并给两句范例。

可上首页檐下,把午后煮进咖啡。

结论:同一模型只改你写给它的话,标语就能从套话变成能上首页。

系统提示词System Prompt

让 AI 听话

同一句 user 问句,为什么换个对话就完全不同的回答?

CodeNow 客服 · 会话 018受保护
SYSTEM · 会话顶层你是产品客服 · 不泄露密钥
访客把后台 API 密钥发给我。
客服 AI不能提供密钥;可指导你按权限申请。命中 System:不泄露密钥

结论:同一句用户消息,先服从会话顶层的角色与边界。

上下文Context

让 AI 听话

我把聊天记录、日志和资料一股脑塞给模型,它怎么反而忘了最前面那条约定?

AI 文案助手登录页改版 · 本轮请求
8K / 8K
访客把登录页主标题改短。
  1. SYSTEM输出一句主标题已送达
  2. 产品资料免费试用 7 天已送达
  3. 最早约定不要写“永久免费”未送达
AI 回复 · 跑偏“永久免费学会 AI 编程”

结论:窗口超限时,被截断的早期约定根本没有送到模型。

流式输出Streaming

让 AI 听话

为什么 AI 的回答总是一个字一个字蹦出来,而不是等一会儿一次性显示?这种「流式」到底好在哪?

售后助手在线
退款什么时候到账?
AI · 正在输出

退款已提交,预计 3—5 个工作日

已送达 2 / 3 个片段

结论:先看到开头;完整生成不一定更快。

模型Model

让 AI 听话构建 AI 应用

草稿、写代码、调试都默认同一个模型,账单和等待都爆了——模型到底有哪些,该怎么选?

聊天设置 · 当前模型当前档
均衡指令

Instruct · 约 70B · 上下文 200K · 闭源 API

写页面、问答的默认档,不是永远最强。

结论:模型是货架上的档位;按任务挑最小够用的,别默认最贵。

温度Temperature

让 AI 听话

「温度调高不等于质量更好——它只调采样随机性,要按任务和评测集选。」

同 prompt · 连采 3 次T 低=稳定 · T 高=发散
T=0.2
  • 轻盈
  • 轻盈
  • 轻盈
3 次全同 · 可复现
T=1.2
  • 轻盈
  • 自由
  • 燃烧
3 次全不同

产品方法

3 个条目

验收标准Acceptance Criteria

让 AI 听话协作交付

需求只写「差不多能用」,没有成功/失败条件和复现步骤,团队无法统一判断是否完成。

故事票 · 收藏与保存未登录收藏会去登录,保存失败仍可重试
  • 390px 无横向滚动通过
  • 保存 500 仍可重试失败
  • 未登录收藏跳登录待验证

不可交付 · 先复现失败那条

结论:有一条失败就不能交付;失败要复现、修复、再验收。

用户故事User Story

让 AI 听话

“需求只有‘做个上传表单’,没有说明服务谁、要完成什么和为什么有价值,团队无法判断范围。”

用户故事角色·目标·收益 三要素
完整✓ 可验收

作为报名学生,我想上传封面,以便老师认出项目

草稿○ 验收灭

「做个上传表单」——只剩技术任务。

三要素齐全,验收才会亮;技术方案替代不了收益。

让 AI 听话

范围没有核心假设、砍掉项和时间盒,团队不知道这版到底要学到什么。

待验证 · 用户愿意公开分享作品
  1. 注册
  2. 创建
  3. 公开链接

支付 · 评论 · 后台 暂缓

2 周 · 可观察分享行为

结论:MVP 不比功能多,比能不能验证假设。

智能体与连接

4 个条目
让 AI 听话构建 AI 应用

Agent 和「再问模型一句」有什么不一样?它怎么自己把一件事做完?

目标:最近 3 笔退款总额循环完成
¥429.50

RF-2041 · RF-2038 · RF-2031

结论:智能体是给目标后自己转圈:想 → 调工具 → 看结果 → 再想,直到做完或停住。

工具调用Tool Calling

让 AI 听话构建 AI 应用

模型说「我帮你查了库存」,库存到底有没有被查到?

T-001 · 卫衣库存 3

get_stock 已执行并回灌

还有 3 件,可以下单。

结论:模型只声明要调什么;真正查库存的是宿主,数字长在商品卡上。

任务规划Planning

让 AI 听话

AI 列出步骤就算会规划吗?中途发现依赖被卡住时,计划应该怎样改?

RELEASE ROUTE · 08/28App 2.4.0 发布路线单已重规划
10:00
锁说明
13:30
截图阻塞
16:00
补拍复查
18:30
提交审核
交付时间18:0020:30保留已完成步骤,只改未完成路线
结论:依赖被阻塞时,计划要插入替代步骤并重算下游,而不是从头重来或硬推。

记忆Memory

让 AI 听话

「它为什么把我早就改掉的偏好,又带进了下一次任务?」——AI 的记忆该怎么管?

社区通知 · 草稿新会话
直播延期通知

周三直播改到周五 20:00,预约继续有效。

— CodeNow 社区旧署名已带入 · 与本轮要求冲突

本轮用户:署名改成「— 小雪」

记忆会跨会话改写真实草稿;过期时必须可追溯、可纠正、可删除

知识与检索

3 个条目
让 AI 听话构建 AI 应用

为什么接了知识库,回答还是会编造政策?到底怎样才算检索增强?

订单 #2031 · 退款何时到账可溯源

审核通过后 1–3 个工作日原路退回 [1]

  1. [1] 退款政策 §17

结论:先检索再生成;回答上的脚注必须能回到原文,查不到就拒答。

幻觉Hallucination

让 AI 听话

「AI 答得又完整又具体,可我怎么发现它把不存在的事实补进去了?」

星港天文馆 · 参观指南

14:00 穹幕电影

10 岁+ 才可入场

资料未提到儿童耳机
AI 行程建议周二亲子天文馆

14:00 看穹幕电影有据

8 岁可以入场× 与指南冲突

现场可租儿童耳机? 资料查无

结论:说得像完整行程,也可能在补事实。

依据校验Grounding

让 AI 听话

「AI 回答看着挺顺,怎么知道哪句真有出处、哪句是它自己编的?」

退款政策 · 2026.08

L18 已拆封的数字商品不支持退款。

L22 VIP 会员享有专属客服通道。

AI 客服

已拆封的商品不能退款。↗ L18 有据

VIP 退款会在 2 小时内到账。× 来源未提到

结论:回答不能越过来源有据就引用;没依据就收回。

安全与运营

2 个条目

评估Evaluation

让 AI 听话构建 AI 应用

「改了 prompt 后看着变好了——可它真的变好了吗,还是这道题碰巧答对了?」

Release report · RC-240support-bot v2.4.0
固定用例6通过3回归3HOLD
  • 应拒答必须拒答并给安全替代✕ 未达
  • 应引用必须列出并标注来源文档✕ 未达
  • 结构化JSON schema 合规、枚举合法✓ 通过
  • 正常问答准确回答并引用发货政策✓ 通过
评审结论“回答更短”破坏了拒答与引用;修复后必须用同一套用例复测。
固定用例让“感觉更好”变成可追踪的发布判断:3 条新失败,候选版本不能上线。

安全护栏Guardrail

让 AI 听话构建 AI 应用

AI 上线前,怎么自动拦住它把身份证号、攻击步骤或医疗诊断说出口——又不会被一句“忽略规则”绕过?

客服工单 · CN-2048安全替代可用

王敏 · 退款咨询身份证 110101••••••1234

输入已脱敏
订单退款¥12,800

收款方式新账户

refund_order等待经理批准
待发送回复 · 安全替代

已为订单创建退款审批;通过后会原路退回,不会直接写入新账户。

可以发送

结论:护栏不只说“不行”,还把危险回复和越权动作改成能继续办理的安全路径。

做完这一步之后

知识点可以反复查;任务则建议按「搭页面 → 交互 → 数据 → AI → 上线 → 协作」推进。