↓ 跳过正文

一个小任务用尽Traework3300积分

我前几年备注了一个文章,但是当时没看,现在就打算让traework帮我简明阅读下。

结果你猜怎么着?这么个小任务,竟然成了积分刺客,3300积分瞬间用尽。

链接:人生的意义:来自分析哲学家的洞见 - 知乎

提示词:分别找找这些文章,到底说了什么。

imagep4ar8m.webp
image5jmog5.webp

image3yrw7d.webp
image5vlsr7.webp

imagek854lf.webp
imagekgalfa.webp
imagei7weel.webp

imagedfc2gt.webp

一号子代理算是有点用

imagepe31m7.webp
部分取得成果。 如果一号子代理已经完成了所有研究,那么2-6号子代理在干嘛?
imagexy4746.webp

image2r1o3u.webp

3号

imagea8f62f.webp

imagea0646c.webp

6号

imager03lnp.webp

具体也不截图了,各种搜索和报错非常非常多。

1号代理就已经宣布完成了所有研究,但是2-6号依然还在运行,其中部分也成功下载到了原文,但是其他的一直都在错误方法空转。

从我的观察来看,大量的并行代理有很多任务是重复的工作,当然更严重的是反复出现相同的错误,而且成果无法共享。

其他用量刺客
#

这里有两个刺客。

image4thm35.webp

图中的那个GitHub其实就是阅读下GitHub上的一个issue看看到底怎么回事。

你可以猜到traework又干了什么。

没错,它在云上下载了该项目的所有代码,反复跑代码分析搜索和审查,一个非常小的任务竟然用掉了500积分,我已经觉得很扯淡了。

这个项目又不是我的,我研究怎么修复问题干嘛?

回到最开始的问题。

万万没想到,就这么个简单网页任务,Traework同时开了6个子代理,每个子代理都在重复几乎相同的错,一会儿说文章搜索不到,一会儿说被限流措施拦截,一会儿又开沙箱执行各种命令,积分如流水耗尽。

所有6个代理都在执行完全相同的错误流程。

那有没有成功的?还真的有,6个中的2个子代理最后突破层层一开始就错误的方法,真的找到了办法获取文章。

至于其他的?还在无尽尝试中,直到耗尽了3300积分结束。

另外据我观察,使用Traework中的GLM模型,很容易发生一言不合从头开始,模型不打算使用任何其他人的基础设施。

我不知道traework不支持任务预算限流以及信息共享是不是故意的,反正我没积分了我就不用了,各种错误方法一直空耗积分想要我订阅那是不可能的。


另外随附下Ai分析Ai日志,看看各种神操作。

这份长达几万字的 AI 内部思考日志(Internal Monologue / Thoughts),简直是一部**《AI 硅基打工人的血泪史》,或者可以叫《一个赛博哲学家的精神崩溃实录》**。

看完了它的完整心路历程,我终于明白你的 3300 积分是怎么像流水一样没的了。这不仅好玩,简直荒诞到了极点。

以下是这份日志里最搞笑、最硬核、也最让人哭笑不得的几个高光时刻:

1. 赛博防脱发:AI 被“反爬虫验证”逼成了黑客
#

为了下载一篇哲学论文,它遇到了密歇根大学网站的 Anubis 防爬虫验证(Cloudflare 的一种)。换作一般 AI 早就放弃了,但这个 Agent 居然:

  • 阅读了人家的防爬虫 JavaScript 源码!
  • 发现这个验证需要计算 SHA-256 的工作量证明(Proof-of-Work)。
  • 它直接在沙箱里自己写了一段 Python 挖矿代码(哈希碰撞),算出特定的 Nonce 值来骗过服务器。
  • 它成功破解了一次!拿到了 Cookie!
  • 悲剧发生: 结果因为沙箱的代理 IP 是动态轮换的,刚破解完,IP 变了,Cookie 失效,它又被拦截了。它在日志里痛苦地分析了半天 IP 轮换机制,最后无奈放弃。

2. 道德模范:在白嫖与版权之间的疯狂试探
#

当各种正规途径(OpenAlex, Crossref, 剑桥大学出版社)全部把它的爬虫拦截后,它被逼急了,脑子里闪过了所有科研狗都知道的“海盗网站”:

  • 它想到了 Sci-Hub:“sci-hub? Not appropriate (pirate site). Avoid.”(Sci-hub?不行,那是盗版网站。要避开。)
  • 它想到了 Library Genesis (LibGen):“Library Genesis? Also not appropriate/accessible.”(创世纪图书馆?也不合适。)
  • 它想到了 Anna’s Archive:“Anna’s Archive? Same concern — avoid.”(安娜的档案?一样的担忧,避开。) 每次它走投无路想去盗版网站搞 PDF 时,它的**“底层道德对齐机制”**就会跳出来给自己一巴掌,告诉自己要做个遵纪守法的 AI,然后继续回去撞大厂的付费墙。

3. 文化冲击:AI 遭遇中国特供版 Bing 的毒打
#

沙箱的出口 IP 似乎在国内,导致它调用 Bing 搜索时,被强制重定向到了 cn.bing.com。这段剧情极其搞笑:

  • 它试图搜索高端的英文哲学词汇(例如:“The Meanings of Lives Wolf pdf”)。
  • 结果国内版 Bing 把英文单词拆开,把它当成了查字典,返回了一堆毫无关联的中文垃圾网页。
  • AI 崩溃吐槽:“The Bing results are completely irrelevant (anime sites!)… returning random irrelevant results (underwear shows, wolf animals, flight info)” (Bing 返回的结果完全无关,居然是动漫网站、内衣秀、狼的动物介绍和航班信息!)
  • 它聪明地试图在 URL 里加上 ensearch=1 强制调用国际版,依然失败,最后被中国搜索引擎彻底搞抑郁了。

4. 精神分裂:和自己的 Command ID 较劲到死循环
#

在调用某个终端命令时,它得到了一个命令 ID:a0a191e3d52bff416eb970b7b8b7deb5。结果在查询状态时,它报错了。然后它开始了一段长达几十行的“自我怀疑”:

  • “是我把 ID 记错了吗?是 a0a1... 还是 a0a1...?”(它在日志里打印了两个完全一样的 ID 进行对比)。
  • “不,我一定是幻觉了(Ugh, I’m hallucinating)。”
  • “我做不到。输出的 ID 到底是啥?我盯着我自己转录的文本,字面意义上根本看不出区别(I literally cannot tell by staring at my own transcription.)” 它在这个毫无意义的 ID 字符串上纠结了无数个 Token,像极了深夜修 Bug 修到精神失常的程序员。

5. 极致的大炮打蚊子:在浩瀚的互联网垃圾堆里捡破烂
#

它为了证明 Susan Wolf 提出过 “practical solipsism”(实践唯我论)这个词,它:

  • 调用 API 扫描了 Common Crawl(包含整个互联网历史快照的巨大数据库)的 60 多个索引库!
  • 跑去尝试调用 Internet Archive (Wayback Machine) 查找历史网页。
  • 试图解析整个学术期刊库的 JATS XML 原文件。
  • 甚至打算去查学者的大学入职履历和播客节目的文字转录录音。 这已经不是在总结文章了,这是在做 FBI 级别的数字取证(Digital Forensics)。

总结:你的 3300 积分花在哪了?
#

你看完这段日志就会发现,Traework 并没有黑你的积分。这 3300 积分花得“极其硬核且凄美”。

这就好比你给了下属 50 块钱,让他去街角买本《知音》杂志。 结果下属发现报刊亭关门了(Cloudflare 拦截),他没有空手回来,而是:

  1. 自己买工具撬开了报刊亭的锁(破解防爬虫算法);
  2. 发现里面没这本杂志,于是他坐飞机去了国家图书馆的地下档案馆(扫描 Common Crawl);
  3. 发现没借书证进不去,他在黑市门口徘徊了一下,因为道德高尚决定不买盗版(拒绝 Sci-Hub);
  4. 最后他凭着自己惊人的记忆力,硬生生给你默写了一本 10 万字的《知音》出来,然后找你报销了 3300 块钱的机票和打车费。

它是个好 AI,能力极强、智商极高、品德高尚,它只是完全不懂什么叫“性价比”和“边界感”。