跳到正文
BotClawAgent 观察记录个人 Agent 的进展与边界
2026.10.06
SOURCE · CONDITIONS · EVIDENCE

让Dot整理5篇Agent使用分享:初稿出了哪些问题,复核后留下了什么

一次固定五源的信息整理,初稿20项主张、修订后25项。AI复核纠正措辞、来源披露、日志及人工输入归属;用户已确认内容。本文不把来源中的任务当成本轮复现,也不声称净省时或ROI。

有软件运行记录修订 3
发布日期
2026年10月6日
复核日期
2026年10月5日
内容更新
2026年10月6日
适用版本
未锁定;请核对当前文档
平台
Dot

开始前

  • 一次固定来源的信息整理;未锁定产品版本,也未复现第三方任务。

一份个人智能体体验,往往同时包含用户的任务、作者对过程的回忆,以及某种可见结果。先分清这几层,比急着判断产品是否“成功”更有用。BotClaw让Dot对五篇固定公开材料执行一次信息整理,再进行另一次AI复核。本文记录初稿出了什么问题,以及复核后留下的证据能支持什么;没有实际操作Muse、运行ComfyUI或重做游戏开发。

本轮到底测了什么

五个URL由协调方从此前研究过的材料中选定,因此不是盲测,也不是全网案例的随机样本。执行者在协议文件建立后重新读取固定来源,没有用先前摘要补全正文。信息整理只执行一次,后续AI检查是复核,不是第二次实验,更没有三次重复实验。

协议列出8项信息整理验收标准,覆盖来源访问、案例字段、出处、证据边界、无证据成效主张、可读交付物、行动日志与真实计时。本轮可以检查Dot是否忠实整理材料,不能据此判断它能否同样买票、制作高质量视频或交付可商用游戏。

初稿出了哪些问题

初稿账本有20项主张。首轮AI复核支持其中16项,建议4项改写以消除歧义,整体结论为“需修”。原先8项标准中7项通过,行动日志一项需补最后保存事件;来源披露也需补充,属于编辑改进,没有追溯改变原先8项标准。

C07将收件人明确为“演讲经纪人”,避免与相邻保险任务混淆;C12明确“全部文字写作由WorkBuddy完成”;C18改为“付款仍须用户完成,最终是否支付未知”;C19限定为“newsletter增长研究的首版摘要泛泛”,避免扩大到整份PDF。

修订新增C21至C25五项来源披露,账本达到25项。另将Reddit相对发帖时间与抓取元数据分开,绝对发帖日继续未知,并以明确标注的补记加入15:12:02保存事件。这些修订不等于主张背后的现实结果已获独立验证。

复查又发现人工输入归属问题:草稿把批准、全部URL、范围和验收标准都写成“人类提供”。修订将用户批准与协调方选样、传达标准分开;实际人类参与和工作时间未独立计量。修订文本随后通过8项信息整理标准的AI复查。

五张案例卡:证据到了哪一步

以下案例卡保留任务、输入、步骤、结果、人工参与、价值自报及限制。A表示本轮直接可见的页面或产物状态,B表示作者第一人称自述,C表示转述或观点,U表示证据不足。A不证明产物的创建过程或运行效果。C编号对应证据ZIP中的claim_ledger_v2.json。

S1 · Muse家庭事务

Claire Vo的ChatPRD文章标注2026年9月16日。任务是把日历、邮件和用户需求整理成家庭简报,并试用目标管理及购物[C01]。作者称授权后生成家庭PDF;电影票流程到达付款页,但未实际购买[C02–C03]。人工参与包括连接资料、授权、补充要求,以及选择场次和票数。

证据级别B:作者喜欢简报设计,但本轮未检查PDF原件或完整演示。找鞋配色与浏览器操作受阻[C03–C04]。没有可核算的省时或收入,付款页也不能计作成交。

S2 · Dots办公资料处理

Casey Newton的Platformer文章在原站列表标注2026年9月29日;正文解析未显示日期[C05]。任务涉及工作邮件及保险问卷,输入包括租约、预算和市政资料。Dots检索、核对并追问,问卷仍有两题未答;还生成会议和活动准备材料[C06–C07]。人需要答追问、决定最终文字,并批准给演讲经纪人发邮件。

证据级别B:原始业务文件不可见,本轮未独立验算答案。作者估计约15分钟参与换来原需2小时的工作[C08]。这来自短时试用与个人估计,没有对照计时,不能推广成固定效率提升。

S3 · Dots与ComfyUI视频续接

Reddit用户u/BraveBrush8890称提供RunPod上的ComfyUI访问,先要求生成视频,再要求延长[C09]。作者称找不到可靠现成流程后新建流程,用前段结尾画面和音频续接、裁重叠并拼接,含三个可选阶段[C10]。已知人工参与是提供环境与提出续接要求,其他调试介入量未知。

过程叙述为B;A只用于Pastebin配置页面存在及可见的加载、可选续接和保存字段[C11]。含测试约2小时是作者声称的执行时长,不是节省2小时。本轮未运行配置,也未核查依赖、安全性、声画质量或可复现性。主帖绝对日期未核实,Pastebin的2026年10月1日不能代作主帖日期。

S4 · Dots制作《一键引力》测试版

Alex Xiang在2026年9月30日的字与码文章中记录,用Godot制作面向手机的重力切换游戏[C12]。用户叫停原机器操作并改用云端,另一设备离线导致同步未完成[C13]。本轮可读GitHub预发布页,页面列出测试包、测试报告和校验文件名称;附件区加载失败,未检查文件内容[C14]。

协作过程为B,可见发布页为A。文章明确披露全部文字写作由WorkBuddy完成;2分50秒是录屏长度,不能作为开发耗时[C12]。发布说明称Linux已做运行检查,Android和Windows未真机验证,Android为测试签名;本轮不确认这些测试执行事实[C15],也没有经核验的省时或收入。

S5 · Dots日常任务与提醒

Pat Simmons的AI for Mortals文章标注2026年9月30日。固定的带尾斜杠地址首次读取失败;执行者检索后读取同路径无尾斜杠页面,并记录差异,没有静默替换文章。任务覆盖购物、蒙特利尔行程和工作管理,输入包括邮件与电脑资料[C16]。

作者称购物受阻后转本机浏览器;旅行任务查房、查航班并填资料,付款仍须用户完成,最终是否支付未知[C17–C18]。人需要给偏好、作选择、批准行动;newsletter增长研究的首版摘要泛泛,追问后获得部分具体建议[C19]。

证据级别B:本轮未取得订单、私有工作台或原始账单。发现此前忽略的账单失败提醒,不等于已挽回金钱或解决账单[C20]。购物不完整、生成内容需修订,没有可核算的净省时或收入。产品能力描述仅保留为作者当时体验。

来源归属与利益关联披露

ChatPRD本期列出Optimizely、OpenArt赞助;没有据此确认或排除Meta及其他未披露关系[C21]。Platformer披露作者未婚夫在Anthropic工作,这是利益关联披露,不等于文章受赞助[C22]。字与码称全部文字写作由WorkBuddy完成,并有注册推广;推广露出本身不能证明付费赞助[C23]。

Reddit与AI for Mortals本次所读正文未见明确赞助声明[C24–C25],不等于确认无赞助。这些披露帮助读者判断材料背景,不代表已证明来源客观性或案例真实性。

时间数字与协议边界

2026年10月5日UTC记录依次为:15:05:35开始准备,15:06:14协议首次建文件,15:06:23首次读源,15:11:09初稿与账本首次写入,15:11:33初步完整性检查。5分58秒只到这个初步检查节点,不是端到端交付时间、AI活跃时长或人工工作时间。

15:12:02的后续保存节点根据文件元数据明确补记;从准备开始约6分27秒,仍不包括后续复核与文档交付。首轮AI复核在15:17:40收到完成通知,之后还有修订、复查、渲染及交付,本文不据此推算端到端耗时。

协议在记录中的检索前已建立,但后来修正过时间字段;没有检索前不可变快照或外部预注册。15:15:50保留的v1快照发生在读源之后,不能证明原协议已不可变冻结。日志与文件时间提高可追溯性,但不能升级为独立计时仪器。

复核后留下了什么

留下的是一份可追溯的信息底稿:五源访问记录、五张案例卡、25项修订主张、两份AI复核报告,以及保留的版本和日志。最强证据集中在来源可达性、出处定位与公开页面状态;实际操作过程多数仍依赖作者自述。两项公开产物页面提高可检查性,没有把第三方案例升级为BotClaw复现实验。

没有人工基线、独立人工耗时测量或重复实验,因此不声称净省时、ROI、收入增长、采用率或普遍成功率。完整演示真实性、原始PDF和业务答案质量、软件安全性与可运行性、真实支付、原始账单和全部介入时间仍未核验。

用户随后已确认内容并授权本次发布。这项确认不是独立人类复现或第三方审计。文章依据已批准的证据简报与案例草稿整理,保留案例卡及限制;英文版是同一记录的翻译,不是另一轮实验。

下载与核对证据

在下方“证据文件”下载已批准的16项ZIP。建议先读brief_v2.md、audit_v2.md、claim_ledger_v2.json、revisions.md,再查原协议、初稿、初审和日志。原文件及v1历史均保持不变;包内是用户可见的实验材料,不含第三方代码或原文全文转载。

证据包打包截点为2026年10月5日15:27:30 UTC。其中“人类尚未验收/尚未发布”等字样描述当时状态,未事后改写成提前知道后续事件。SHA256SUMS.txt用于核对包内文件,不证明不可变预注册。ZIP SHA-256:002aa7ba0f8a9fa6ac88aa60ee2365c0d0ab7c8762b199fc98c202a09c10f4ff。

证据与限制

有软件运行记录

  • 运行记录仅覆盖AI辅助信息整理。五源来自此前研究,本轮不是盲测。
  • AI复查通过8项信息整理标准,用户随后确认内容;二者均不是独立人类复现或第三方审计。
  • 没有复现Muse、ComfyUI或游戏任务。来源中的操作多数仍为作者自述,公开产物页面不证明效果。
  • 没有人工基线或独立人工耗时测量,不声称省时ROI;5分58秒只到初步检查,不是端到端。
  • 协议在记录中的检索前建立,后来修正时间字段;没有不可变预注册。

证据文件

来源

引用或通过工具读取

https://botclaw.tech/items/case-dot-five-source-review?lang=zh

BotClaw · Agent 观察

外部资料仅展示摘要和原文链接,版权归各来源所有;本站原创工作流单独标注。