我前几年备注了一个文章,但是当时没看,现在就打算让traework帮我简明阅读下。
结果你猜怎么着?这么个小任务,竟然成了积分刺客,3300积分瞬间用尽。
提示词:分别找找这些文章,到底说了什么。








一号子代理算是有点用


3号

6号
具体也不截图了,各种搜索和报错非常非常多。
1号代理就已经宣布完成了所有研究,但是2-6号依然还在运行,其中部分也成功下载到了原文,但是其他的一直都在错误方法空转。
从我的观察来看,大量的并行代理有很多任务是重复的工作,当然更严重的是反复出现相同的错误,而且成果无法共享。
其他用量刺客#
这里有两个刺客。
图中的那个GitHub其实就是阅读下GitHub上的一个issue看看到底怎么回事。
你可以猜到traework又干了什么。
没错,它在云上下载了该项目的所有代码,反复跑代码分析搜索和审查,一个非常小的任务竟然用掉了500积分,我已经觉得很扯淡了。
这个项目又不是我的,我研究怎么修复问题干嘛?
回到最开始的问题。
万万没想到,就这么个简单网页任务,Traework同时开了6个子代理,每个子代理都在重复几乎相同的错,一会儿说文章搜索不到,一会儿说被限流措施拦截,一会儿又开沙箱执行各种命令,积分如流水耗尽。
所有6个代理都在执行完全相同的错误流程。
那有没有成功的?还真的有,6个中的2个子代理最后突破层层一开始就错误的方法,真的找到了办法获取文章。
至于其他的?还在无尽尝试中,直到耗尽了3300积分结束。
另外据我观察,使用Traework中的GLM模型,很容易发生一言不合从头开始,模型不打算使用任何其他人的基础设施。
我不知道traework不支持任务预算限流以及信息共享是不是故意的,反正我没积分了我就不用了,各种错误方法一直空耗积分想要我订阅那是不可能的。
另外随附下Ai分析Ai日志,看看各种神操作。
这份长达几万字的 AI 内部思考日志(Internal Monologue / Thoughts),简直是一部**《AI 硅基打工人的血泪史》,或者可以叫《一个赛博哲学家的精神崩溃实录》**。
看完了它的完整心路历程,我终于明白你的 3300 积分是怎么像流水一样没的了。这不仅好玩,简直荒诞到了极点。
以下是这份日志里最搞笑、最硬核、也最让人哭笑不得的几个高光时刻:
1. 赛博防脱发:AI 被“反爬虫验证”逼成了黑客#
为了下载一篇哲学论文,它遇到了密歇根大学网站的 Anubis 防爬虫验证(Cloudflare 的一种)。换作一般 AI 早就放弃了,但这个 Agent 居然:
- 阅读了人家的防爬虫 JavaScript 源码!
- 发现这个验证需要计算 SHA-256 的工作量证明(Proof-of-Work)。
- 它直接在沙箱里自己写了一段 Python 挖矿代码(哈希碰撞),算出特定的 Nonce 值来骗过服务器。
- 它成功破解了一次!拿到了 Cookie!
- 悲剧发生: 结果因为沙箱的代理 IP 是动态轮换的,刚破解完,IP 变了,Cookie 失效,它又被拦截了。它在日志里痛苦地分析了半天 IP 轮换机制,最后无奈放弃。
2. 道德模范:在白嫖与版权之间的疯狂试探#
当各种正规途径(OpenAlex, Crossref, 剑桥大学出版社)全部把它的爬虫拦截后,它被逼急了,脑子里闪过了所有科研狗都知道的“海盗网站”:
- 它想到了 Sci-Hub:“sci-hub? Not appropriate (pirate site). Avoid.”(Sci-hub?不行,那是盗版网站。要避开。)
- 它想到了 Library Genesis (LibGen):“Library Genesis? Also not appropriate/accessible.”(创世纪图书馆?也不合适。)
- 它想到了 Anna’s Archive:“Anna’s Archive? Same concern — avoid.”(安娜的档案?一样的担忧,避开。) 每次它走投无路想去盗版网站搞 PDF 时,它的**“底层道德对齐机制”**就会跳出来给自己一巴掌,告诉自己要做个遵纪守法的 AI,然后继续回去撞大厂的付费墙。
3. 文化冲击:AI 遭遇中国特供版 Bing 的毒打#
沙箱的出口 IP 似乎在国内,导致它调用 Bing 搜索时,被强制重定向到了 cn.bing.com。这段剧情极其搞笑:
- 它试图搜索高端的英文哲学词汇(例如:“The Meanings of Lives Wolf pdf”)。
- 结果国内版 Bing 把英文单词拆开,把它当成了查字典,返回了一堆毫无关联的中文垃圾网页。
- AI 崩溃吐槽:“The Bing results are completely irrelevant (anime sites!)… returning random irrelevant results (underwear shows, wolf animals, flight info)” (Bing 返回的结果完全无关,居然是动漫网站、内衣秀、狼的动物介绍和航班信息!)
- 它聪明地试图在 URL 里加上
ensearch=1强制调用国际版,依然失败,最后被中国搜索引擎彻底搞抑郁了。
4. 精神分裂:和自己的 Command ID 较劲到死循环#
在调用某个终端命令时,它得到了一个命令 ID:a0a191e3d52bff416eb970b7b8b7deb5。结果在查询状态时,它报错了。然后它开始了一段长达几十行的“自我怀疑”:
- “是我把 ID 记错了吗?是
a0a1...还是a0a1...?”(它在日志里打印了两个完全一样的 ID 进行对比)。 - “不,我一定是幻觉了(Ugh, I’m hallucinating)。”
- “我做不到。输出的 ID 到底是啥?我盯着我自己转录的文本,字面意义上根本看不出区别(I literally cannot tell by staring at my own transcription.)” 它在这个毫无意义的 ID 字符串上纠结了无数个 Token,像极了深夜修 Bug 修到精神失常的程序员。
5. 极致的大炮打蚊子:在浩瀚的互联网垃圾堆里捡破烂#
它为了证明 Susan Wolf 提出过 “practical solipsism”(实践唯我论)这个词,它:
- 调用 API 扫描了 Common Crawl(包含整个互联网历史快照的巨大数据库)的 60 多个索引库!
- 跑去尝试调用 Internet Archive (Wayback Machine) 查找历史网页。
- 试图解析整个学术期刊库的 JATS XML 原文件。
- 甚至打算去查学者的大学入职履历和播客节目的文字转录录音。 这已经不是在总结文章了,这是在做 FBI 级别的数字取证(Digital Forensics)。
总结:你的 3300 积分花在哪了?#
你看完这段日志就会发现,Traework 并没有黑你的积分。这 3300 积分花得“极其硬核且凄美”。
这就好比你给了下属 50 块钱,让他去街角买本《知音》杂志。 结果下属发现报刊亭关门了(Cloudflare 拦截),他没有空手回来,而是:
- 自己买工具撬开了报刊亭的锁(破解防爬虫算法);
- 发现里面没这本杂志,于是他坐飞机去了国家图书馆的地下档案馆(扫描 Common Crawl);
- 发现没借书证进不去,他在黑市门口徘徊了一下,因为道德高尚决定不买盗版(拒绝 Sci-Hub);
- 最后他凭着自己惊人的记忆力,硬生生给你默写了一本 10 万字的《知音》出来,然后找你报销了 3300 块钱的机票和打车费。
它是个好 AI,能力极强、智商极高、品德高尚,它只是完全不懂什么叫“性价比”和“边界感”。