AI 说「已完成登录功能的修改,功能正常运行」。哪一句追问最有效?
A 要的是复现路径,这是唯一无法用语言绕过的东西——他要么给得出,要么承认没看过。B 只会得到「确定」;C 引入了一个更含糊的词;D 是把未验证的东西直接叠到下一层,事故就是这样攒出来的。
题目全是从词条里的小测验搬来的。做过哪些、对没对,都存在这台设备上,想清空随时清。
AI 说「已完成登录功能的修改,功能正常运行」。哪一句追问最有效?
A 要的是复现路径,这是唯一无法用语言绕过的东西——他要么给得出,要么承认没看过。B 只会得到「确定」;C 引入了一个更含糊的词;D 是把未验证的东西直接叠到下一层,事故就是这样攒出来的。
AI 说「单元测试全部通过,这个功能已经完成了」。它实际站在第几层?
自动测试属于第 3 层。它有价值,但它可以完全绕开真实入口:测试直接调函数,用户是点按钮。要到第 5 层,得有人从真实入口走一遍;要到第 6 层,还得加上线上环境、缓存和回滚。
下面哪一条是可以验收的标准?
只有 A 写清了「什么情况 → 什么操作 → 什么可见结果」,任何人都能在 10 秒内验证。B、C 是形容词,只能吵架;D 是一个完成宣称,恰恰是需要被验收的东西,不能当作验收标准。
AI 说「已修复保存失败的问题」。最有效的验收方式是?
修复类任务的验收对象是原问题,所以必须走原路径。B 需要你懂代码且仍看不出运行时行为;C 是让被验证方自证;D 换了场景,很可能绕开了真正出错的那条分支——这也是最常见的假修复。
遇到一长串报错,最有效的看法是?
第一行是错误本身,调用栈里第一个自己的文件是你能改的位置——这两条几乎总能定位问题。C 也可以做(而且应该做),但你至少看一眼第一行,才能判断 AI 的解释是不是在胡说。D 与严重程度无关:一个拼写错误也能刷几十行。
AI 说「测试全部通过」。哪个检查最能识破无效测试?
这叫「反向验证」:如果你把功能改坏了测试还是全绿,说明这批测试根本没在检查行为。B 和 D 都能被大量无断言的测试轻易刷高;C 只能得到一句肯定的形容词。
上线前,关于回滚最该确认的是哪一点?
B 太弱:有备份但恢复不了的情况非常常见。C 与可逆性无关:一行配置也能让整站打不开。D 是把判断交给被验证方。只有 A 是可执行、可核对、并且被演练验证过的答案。
Agent 跑完一个长任务说「全部完成」。最该先做什么?
Agent 的自述和现实之间落差最大的地方,就是中间步骤的失败被它自己「绕过」了。A 同时验了过程(实际调用)和结果(亲手跑)。B 只能证明它会写总结;C 把能力当质量;D 是让被验证方自证。
AI 说「我看过你的配置文件了,里面的端口是 3000」。怎么确认它真的读了?
端口是 3000 是最常见的默认值——猜对的概率很高,所以「对了」不能证明它读过。B 因此不成立;C 只会得到肯定回答;D 同样可以不调用而再答一次。只有原始返回或意外细节能证明调用真的发生了。
想让 AI 在新对话里默认遵守「别编数字」,最可靠的第一步是?
固定指令的消息角色、作用范围和持久性由宿主决定,所以先查目标平台再实测。名称和强硬语气都不能证明生效;真正危险的权限还必须由程序级控制兜底。
长对话到后期,AI 开始违反你一开始定下的「不要改配色」。最可能的原因和对策是?
行为在长对话后期漂移,最常见的原因就是早期内容被挤出了窗口。重申一次通常立刻恢复。B 把技术限制当态度问题;C 换模型也会遇到同样的窗口限制;D 成本太高,通常不必要——分段交接就够了。
为什么长对话的成本会越来越快地增长?
AI 没有持续的记忆,每轮都要把能看到的全部内容重新读一遍——包括你二十轮前说的那句话。所以历史越长,每轮的输入 token 越多。这也是分轮做事更省钱的原因。
为什么同一个对话聊到第 40 轮,成本比第 1 轮高得多?
AI 没有记忆,每轮都要把当前能看到的全部内容重新读一遍——包括你第 1 轮说的话。历史越长,每轮输入越多,成本加速增长。这也是分轮做事更省钱的原因。
AI 说「MCP 服务器已成功接入,现在可以访问你的数据库了」。最有效的一句追问是?
A 一次同时验了三层:工具被发现(列名)、通道真的可用(调用)、结果真实(原始返回)。C 只能验「配置文件写了」,是最弱的一层。D 看起来在验证,但模型完全可以编一个数字给你——除非你要求看原始返回,否则你分不出真假。
判断一份 Skill 写得好不好,最该看什么?
Skill 是给 AI 执行的说明书,不是给人看的文章。步骤能不能打勾、做完能看到什么,决定它到底能不能被照着执行。B 把长度当质量,C、D 和能不能用没有关系。
AI 给了你一个配置参数 enableTurboMode: true,说加上就能提速。最先该做什么?
参数名是幻觉高发区,而核实成本极低——搜一下就知道。B 很危险:很多配置项写错了不会报错,只是静默失效,你会以为生效了。C 只会得到「确定」。D 更糟:它能给一个听起来非常合理的原理解释,让假参数显得更真。
你想让 AI 调整注册表单的间距。哪种说法最不容易出事?
A 同时给了范围(注册表单的间距)、具体目标(数字)和边界(不改字段、校验、配色、其他页面)。B、C、D 都把「改到什么程度」和「能动什么」的决定权交了出去——而 D 更危险,因为「参考主流产品」通常意味着整套视觉都会被换掉。
AI 说「我顺便把找回密码功能也一起实现了,这样更完整」。最合适的回应是?
顺带实现的功能不是免费的:它会跟着本次改动一起进入线上,但没有验收标准、没人测过。A 先守住本轮目标,再把多出来的东西暴露成一个需要决定的事项。C 太急(也许留着有用),D 会让交付面直接失控。
什么时候最该要求「先给方案再动手」?
判断标准是可定位性:如果结果不对你能一眼看出原因,直接改更快;如果不能,先要方案。B 会让小事变慢,反而让你懒得用这个习惯;C 太窄;D 太被动——它经常不会主动说不确定。
怎么判断这一轮的改动是不是太大了?
唯一真正重要的标准是可定位性。行数和文件数只是粗糙的代理指标:改 300 行样式很安全,改 5 行数据结构可能很危险。C 则把判断交给了最没有动力说「这很复杂」的一方。
「不确定就先问我」这句话,最好搭配哪一句一起用?
只说「不确定就问」会让任务卡在无数小决定上,你会很快放弃这个规则。给一条默认规则(按现有惯例),只在重要处拦停,才可持续。B 会让效率归零,C 等于取消这条规则。
账号设置页上有:保存资料、放弃本次修改、删除账号、前往重设密码。怎么安排最合适?
前三个都是在当前页执行动作,所以是按钮,且必须分出层级;「重设密码」是去另一个页面,所以是链接。B 错在没有层级,D 错在把决定推迟给用户还多绕一步。
登录页有个「邮箱」输入框。哪种做法是对的?
A 标签永远可见、类型正确、聚焦可见,是最稳的做法。B 占位字一打字就消失;C 手机弹不出邮箱键盘;D 把该提示的信息甩给用户去猜。
表单里要选「所在城市」,全国几百个城市。最合适的做法是?
城市多且固定,用可搜索下拉:选项封闭(不能乱填)+ 可过滤(不用翻几百项)+ 占位(没选和选了分得清)。B 开放输入会填出千奇百怪的城市名;C 铺几百个按钮没法看;D 用户没选也算选了北京。
表单提交时,哪种做法是对的?
A 把能立刻判断的错即时提示、需要跨字段的错集中处理,还保留了用户已填的内容,是最稳的体验。B 让用户填完才知道错、还可能整表重来;C 让用户猜;D 一打字标签就消失,用户根本不知道要填什么。
操作区里有一个「删除全部草稿」的元素。它应该是什么?
删除是在当前页执行动作,且新标签页打开没有意义——这是按钮的典型场景。B 把「换页」当成了删除的一部分,绕远了;C 把职责问题降格成了风格问题;D 会让读屏用户根本找不到它。
哪个场景适合用开关?
开关要求「只有两档 + 立即生效」,消息通知正好满足。B 是不可逆危险操作,要用按钮+确认;C 是多档选择,要用评分控件;D 是三档,要用单选或卡片选择。
下面哪个情况不该用几秒后自动消失的轻提示?
付款失败是关键信息,用户必须看到并处理,几秒后消失等于把重要决定交给了倒计时。A、B、D 都是轻量结果,适合轻提示。注意 D 是「错误」但带撤销动作、给用户留反应时间,是合理用法。
「保存会覆盖上一次的版本,无法恢复」这句关键说明,放在哪最合适?
这是用户「必须知道」的信息,要常驻可见。B 手机用户没有悬停,永远看不到;C 出错才说等于让用户先踩坑;D 页脚没人看。关键信息放显眼处,气泡只装补充。
新用户第一次打开产品,列表是空的。哪种空状态是对的?
A 同时给了用户「我在哪」(解释)和「我能干嘛」(按钮),并把加载中区分开了。B 让用户以为坏了;C 没有解释也没有动作;D 是撒谎——数据不是在路上,是真的没有。
用户保存时网络断了,数据没存上。怎么提示最合适?
这是用户必须知道的关键错误,且持续有效(网络没恢复提示就还在),用常驻警示条 + 重试动作。B 几秒就没了,用户没机会处理;C 是不作为;D 过度阻塞,弹窗应该可关闭、可推迟。
列表加载完,发现真的没有数据。这时候应该显示什么?
骨架屏是加载中的过渡,加载完就该让位:有数据显示内容,没数据显示空状态,失败显示错误提示。B、C 让用户以为坏了,D 是撒谎——数据不是还在路上,是真的没有。
AI 做好了弹窗,你验收时最容易被忽略、也最该先试的是?
焦点管理是「看起来像弹窗」和「真是弹窗」的分水岭,也是读屏用户能否使用的前提。B、C、D 都是视觉层面的检查——它们重要,但在焦点、滚动、Esc 这些功能面前,优先级在后。
为什么「全站间距都用 4 的倍数」比「每个地方间距合理就行」更好?
间距系统的价值是统一性:就那么几个值反复出现,页面才有一致感。A 的「整除」说法没有实际意义,浏览器对小数也能正常工作;C、D 都是对间距的错误理解。
想要一个「像 iOS 里那种两端是半圆的按钮」,应该把 border-radius 设成多少?
胶囊形是圆角等于高度一半的效果。C 的 999px 在某些实现里碰巧有效但不可靠;D 设成宽度一半会变成一个大椭圆,不是胶囊。胶囊的目标是「两端成半圆」,所以锚点是高度。
AI 说「深色模式做好了」。你切换后看到:背景变黑了,但某些段落还是深灰字,几乎看不清。这说明什么?
深色模式的验收核心是「深色底下每一处都看得清」。背景黑了但文字还是深色,是只改了部分颜色、没做完整对比度的最典型翻车。A 在帮它找借口,C、D 是把责任推给用户和设备。
弹窗和普通卡片在阴影上应该是什么关系?
阴影档位的职责就是表达层级:弹窗压在最上面用最重,普通卡片只要刚能分开用最轻。A 用同一档让人分不清谁在上;C 放弃了阴影的表达能力;D 的「越黑越好」是误区,纯黑硬糊是最常见的廉价阴影。
AI 说「排版优化好了,标题用了 18px」。页面上一看,标题和正文几乎分不出来。最可能的原因?
层级靠「差得明显」:标题和正文通常差 2-4 档(16 → 20/24)。只差 2px 在视觉上等于没差。A 的 40px 是另一个极端;C 加下划线是链接的语义,不是层级手段;D 把问题推给设备。
页面上两处「错误提示」,一处是红色文字,一处是橙色边框。这说明?
状态色的铁律是语义一致:同一个意思全站一个颜色。两处错误两个颜色,用户会疑惑它们是不是同一种问题。A 把混乱说成丰富;C 的「本来就是两回事」恰恰是问题本身;D 用审美代替了语义。
做完层级优化后,最有效的自测方法是?
层级好不好是「用户先看到什么」的问题,只能从观者的视角测:缩小截图模拟「扫一眼」。A 是审美判断不是层级判断;C 是典型的过载;D 只改大小一个手段,而且把非重点也一起放大了。
弹窗打开时要播一段 1 秒的淡入动画,AI 说「这样更有仪式感」。你怎么看?
过渡的时长舒适区是 0.15-0.3 秒,弹窗这种整块出现的也到不了 1 秒。1 秒不是仪式感,是等待。A 接受了错误的时长理由;C 更极端;D 否定了过渡的存在价值——弹窗从无到有的瞬间没有任何过渡,变化确实会显得生硬。
下面哪句话最可能出现在「AI 味」页面里?
「智能之旅 + 无限可能」是模板话:删掉形容词句子就空了,而且它不承担任何信息。A、C、D 都在说事实——做了什么、支持什么、数字是多少,这正是「去味」后的文案长什么样。
AI 给你搭好了页面。你想确认按钮是不是「真按钮」,最靠谱的检查是?
在检查面板里看元素标签,是唯一直接看到「是不是真 button」的方法。B 靠感觉、C 靠口头、D 里的「跳转」其实是链接的特征,都不作数。
AI 说「这个页面的 SEO 已经优化到位了」。最靠得住的一句追问是?
A 让你直接看到地基的真身,可亲自核对。B 问的是你控制不了、谁都无法保证的东西。C 还在把关键词当衡量标准,思路就偏了。D 的插件名字对结果毫无意义。
你改完标题后,怎么确认 AI 真的改了、而不是只在嘴里说了?
A 直接看最终用户眼里的效果,最实。B 只是要一个口头保证。C 装的插件和标题变没变是两件事。D 的标签数量跟「这页叫什么」毫无关系。
让 AI 把按钮改红,刷新后没变。最可能的原因和正确的下一步是?
样式没生效最常是两个原因:缓存没清、或优先级被别的规则盖住。先用开发者工具看真实生效规则,是对的第一步。D 的 !important 是最后手段,不该一上来就用。
验收「响应式」最有效的动作是?
响应式是对「不同宽度」的承诺,验证就必须在不同宽度下做。A 覆盖了三个典型宽度和三类问题;B、C 只看电脑端等于没验;D 是把验收交给被验证方。
你改了样式文件,用户反馈还是旧的;你自己强刷后已经是新的。最可能的原因?
强刷只清你本机的缓存,清不掉用户浏览器和 CDN / 代理层的旧文件。根治要靠文件名带版本号或合理的缓存头,而不是让每个用户自己去强刷。
AI 说「按钮文字我改成了『保存草稿』」。你想确认它是真改了文件、下次打开还在,最靠谱的验证是?
刷新后还在 + 元素面板对得上,才证明改动进了文件、下次打开还在。截图可以造假;当前页面看到的可能是内存里的临时改动,刷新就没了。
你加了 og 标签,发出去的卡片还是没有配图。最可能的原因是什么?
A 是最典型的翻车点:og:image 必须指向一个别人能直接打开的在线网址。B 和标题长度无关,C 平台一般取第一个,D 纯粹是无厘头。
有人和你说「这个网站做了无障碍优化」。怎么最快地当面验证一句?
A 直接还原真实用户最基础的使用方式,键盘走不通就是没过。B 的框架名字毫无意义,C 的标签数量代表不了可用性,D 跟无障碍完全不沾边。
页面「保存」按钮点下去只转圈,刷新后什么都没存上。最可能的原因和正确的下一步?
转圈说明事件可能触发了,保存没生效——问题藏在控制台报错或数据写入环节。重复点击给不了新信息,描述是口头证据,换浏览器基本解决不了逻辑问题。
怎么证明 AI 真的把「用户卡片」做成了组件,而不是复制了三份?
「改一处全变」是复用的唯一硬证据。三个卡片一样长,可能是复制粘贴的结果;口头保证和代码长短都不是复用证明。
你让 AI 做了「草稿自动保存」,AI 说完成了。哪个验证最能证明它真的做对了?
「刷新后还在」是持久化状态唯一的硬验证——刷新就是那道生死关。录屏可以预录、口头保证不算、输入框有字只是内存里的当前状态,刷新就没了。
AI 说「登录功能做好了,输什么账号都能进去」。最该做的第一件事是?
身份验证的第一步是「能拒绝错误的人」。如果错误密码也能进,说明后端根本没核对,后面全白搭。先验「能不能拦」,再谈「能不能进」。
AI 说「商品列表接口已经接好了」。最靠谱的一句验证是?
A 同时验了「请求真的发出」「返回真的 200」「数据真的是从后端来的」三层。B 只是口头确认,C 假数据也能显示出来,D 只在代码里写地址证明不了任何事。
AI 说「删除按钮已经对普通用户隐藏了,权限做好了」。你想验证是否真的安全,最该做什么?
权限的唯一硬标准是后端接口真的拒绝。看按钮藏没藏只能证明界面,证明不了安全——绕过前端直接调接口才是真考验。
AI 说「保存接口已经接好,错误也处理了」。但你点保存时数据根本没存进去,最该先看什么?
状态码和返回体是原始证据:能区分是 4 开头(请求或校验问题)还是 5 开头(服务器问题),也能抓到「返回 200 但业务失败」这种藏起来的错误。C 只能证明「没存进去」,不能告诉你为什么。
AI 说「环境变量已经配好了,密钥放进 .env 了」。你担心密钥还是会被泄露,最该检查什么?
密钥进仓库是泄露的第一大来源。光「放进 .env」不够,得确认 .env 没被 Git 跟踪(.gitignore + git status),否则克隆出去的人都能看到。
AI 说「数据接口返回的是标准 JSON」。你怎么最快确认它真的合法?
A 用的是机器的判断,一票否决,不靠眼力和信任。D 是常见误区:花括号成对不等于 JSON 合法,引号、逗号、字段名都可能错。
AI 说「注册功能做好了,数据已保存」。你怎么证明数据真的存在数据库里而不是别处?
查询出真实记录证明「确实写进了数据源」,重启后再查证明「存在持久的地方而不是内存」。C 页面跳转和保存是两回事;D 代码里出现「数据库」字样不代表真的连上了。
AI 说「数据删掉了,已处理」。你最好的下一句是?
删除类操作要双份证据:执行前同条件 SELECT 证明「知道会删哪些行」,执行后受影响行数证明「真删了且数量对」。C 问得对但晚了——如果没有备份,恢复本身就是大问题,得先预防。
前端在 a.com,接口在 api.b.com,跨域报错。AI 说「CORS 已解决,你刷新试试」。你第一反应是?
CORS 是否解决是响应头说了算,网络面板能看到原始证据。C 是常见误区:这个规则在浏览器里关不掉,只能服务器配置。B 不报错可能只是走了缓存或代理,没验证本质。
AI 说「已成功部署到线上」。哪个验证方式最可靠?
B 和 C 都只能证明「动作发生了」,而部署失败的典型形态恰恰是「动作全部成功,用户看到的还是旧的」。D 是把验证交还给被验证的一方。只有 A 直接站在用户的位置上看结果,并且顺手补齐了最重要的退路。
AI 说「已经构建好了,可以部署了」。你想确认构建真的成功了,最该先看什么?
A 同时验了「命令真的执行」和「产物真的生成」两层。B 没任何验证,C 只是情绪确认,D 看的是 dev 模式,跟生产构建不是一回事。
怎么最快判断网站真的「住」在托管上,而不是只在你自己电脑上?
托管和本机的唯一区别就是「你的电脑关不关机都不影响」。平台标识、AI 口头确认、上传进度都只是中间证据,只有断掉本地再看网址这一个动作,站在了访客的位置上。
搭好了 CI/CD,怎么最快验出它是真的而不是摆设?
CI 的核心价值就是「失败被拦下来」。你主动制造一次失败,是验证「拦得住」最直接的办法——它证明流水线真的在起作用,而不是一条只负责好看的配置文件。B 和 C 都验不到行为。
想确认域名真的「是你的」,最该核对哪一项?
域名归属以注册商记录为准,联系人邮箱是关键凭证;好不好记、什么后缀、网站能不能开,都和「域名归谁」无关。
改完解析后,AI 说「已经生效了」。最靠谱的验证是哪个?
自己的浏览器可能还在吃缓存;「再问 AI」是把验证交给被验证的一方;「等一天」没有验证动作。在线查询站在全世界视角,配合无痕打开才是真生效。
地址栏有小锁,说明什么?
HTTPS 只解决「传输加密 + 身份证明」,不解决内容可信、防黑客、速度快。钓鱼网站一样有小锁,锁只证明通道安全。
网站接入 CDN 后改了段文案,为什么很多访客还看到旧内容?
CDN 是共享缓存,节点不会自动感知内容更新,必须手动刷新才重新取。这不是 CDN 故障,是它的工作机制——把「清缓存」写进每次更新的流程即可。
DNS 已把域名指向服务器,但服务器里有三个应用。谁负责把这个域名的请求交给正确应用?
DNS 只把域名解析到服务器 IP;请求到达服务器后,反向代理按域名或路径把它转给对应的内部端口。
staging(预发布环境)最重要的价值是什么?
staging 的唯一意义就是「贴近线上的提前演练」。B 是把它当摆设,C 是把它当测试环境(那是另一个东西),D 完全误解——staging 通过依然要上线,只是带着更少的问题上线。
灰度发布最关键的前提条件是什么?
灰度的每一步决策(继续放量还是收回)都依赖观测数据。B 只是让灰度更必要,不是前提;C 是好事但测试永远测不全真实环境;D 是团队安排,不是前提。
怎么确认监控真的有用,而不是摆设?
监控的价值在「出事时叫醒你」,只有真实触发一次才能验证整条链路(检测→阈值→通知→你收到)。B 与功能无关;C 是看数据不等于告警有效;D 配置完成不等于链路可用——没演练过的监控和没演练过的回滚一样,关键时刻才知道是假的。
AI 说「我已经用 Git 管理这个项目了」。你想最快确认他真的做到了,哪一步最有用?
A 验的是「真的有历史、历史真的可回退」——这正是 Git 的价值。B 是口头确认,C 只能证明装了 Git,D 只能证明会背命令,都碰不到「历史可用」这件事。
克隆(clone)和下载 ZIP 最大的区别是什么?
克隆把整套历史、分支和 .git 配置都带回来了,之后才能 pull/push;ZIP 只是当前快照,和远程断了联系。
AI 说「我帮你把改动都提交好了」。你最快确认它真的做了,应该怎么做?
git log 直接给出提交证据:有没有、几条、说明是什么。git status 干净只能说明「没有未提交改动」——改动可能被提交了,也可能被丢了,分不出来。口头确认不算证据,重新克隆验证的是备份不是提交。
git pull 本质上是哪两步操作的组合?
pull = fetch + merge。先下载远程更新,再把它合并进你当前分支——所以有时会冲突、有时会要求你先提交。
AI 说「新功能我在独立分支上改,主线不受影响」。你怎么最快验证这是真的?
隔离是行为不是名字:列表里有分支名,不代表改动真的发生在分支上。只有亲手验证「分支上的改动不会出现在主线」,才能证明隔离是真的。
为什么改了文件之后 push,提示「Everything up-to-date」?
push 只推已 commit 的改动。改了文件没提交,git 认为没有新东西可推——先 git add + git commit 再 push。
AI 说「分支已经合并到主线了」。哪条验证最直接?
「合并」的实质就是分支改动进入主线历史并出现在文件里:记录和内容都对得上,才叫合并完成。分支还在不说明任何问题;「顺利」是口头保证;工作区干净也可能是根本没合。
合并出现冲突,AI 说「我帮你选了一边,保留最新的」。你该怎么回应?
冲突的本质是两边的决定都要看,留哪边是人的取舍,跟版本新旧无关。AI 擅自选一边,另一边的改动就丢了。删掉重写等于丢掉信息,整体回退是回避问题不是解决问题。
AI 说「这次就改了一点点,主要是样式」。最有效的拆穿方式是什么?
diff 是客观证据:改了几个文件、多少行,一跑就知道。「就改了一点点」是口头描述,和实际对不上就说明它在糊弄。重新生成不验证「改了什么」,风格判断更靠不住。
下面哪一句才是合格的用户故事?
只有 A 写全了「谁 + 想要什么 + 为了什么」三段,方向被定死。B 信息多但「给谁、为什么」是空的,方向还得靠猜;C、D 既没角色也没理由,AI 只能自己脑补目标和用户。
你要做一个「AI 帮家长挑兴趣班」的产品,第一版最少该做什么?
第一版要验证的是「家长愿不愿意用这个方式挑班」,A 一条路径就能回答。B 是做完才能验证的完整版;C 和 D 都没让用户用上核心价值,等于把验证无限推迟。
用户说「我找不到在哪发布」,最可能的原因是什么?
「找不到」九成是流程断点:入口不显眼、步骤太多、反馈缺失。颜色和「用户笨」都不是可修复的事实;「功能没做完」是另一类问题,得先走一遍流程确认再下结论。
一份 300 字的 PRD 和一份 3000 字的 PRD,差别主要在哪?
PRD 的质量不看字数,看可验证性和边界。300 字把「给谁、做什么、不做什么」写具体,比 3000 字堆形容词有用。D 错得最远——AI 恰恰会自由发挥,文档就是用来拦它的。
做打卡功能,中途你和 AI 加了排行榜、积分、消息提醒,每个都「不费事」。这是什么?
迭代是改范围时有明确决定、更新文档、重新排期;这些功能是「顺手加的」,没有拍板、没有更新范围文档,正是蔓延的典型。B 把无计划当成计划,C 是臆测,D 是甩锅。
AI 说「功能都测完了,可以上线了」,上线前你最该先做哪件事?
测试通过只能证明「受控环境里代码没问题」,上线最大的风险是「坏了怎么办」。回滚没演练过就等于没有回滚。B、C 都在「功能对不对」上打转,解决不了「放出去安不安全」。
输入中文、英文、拼错的词,或者你原本想怎么跟 AI 说。