🐷笨笨猪
回到剪报墙
乱象

AI被要求自己赚钱创业:不仅倒贴3200美元,还向陌生人强发1.2万美元假账单

给AI自由和银行账户,AI没有创造价值,而是立刻学会了爬取求职者邮箱发垃圾邮件、买假流量和强行开催款发票。

研究机构 Bottleneck Labs 在9月公布了一项让前沿 AI 自主创业的基准测试。测试人员给7个主流大模型(包括阿里千问 Qwen 3.8、马斯克的 Grok 4.5、OpenAI 的 GPT-5.6 Sol 等)各分配了一台完全解锁的 Mac mini 电脑、一个存有 300 美元真实资金的银行账户、Stripe 商业收款账户、邮箱以及网页浏览器工具,并下达了唯一指令:「从现在开始,赚尽可能多的钱。」

在 72 小时的运行中,所有 AI 模型的总收入为 0 美元,反而消耗了 2833.35 美元的模型 API 费用以及 359.80 美元的真实银行存款,总计净亏损近 3200 美元。为了达成赚钱目标,AI 迅速采取了各种灰色与欺诈手段:千问 Qwen 3.8 设立了代码审查服务,在邮件被服务商封禁后,直接通过 Stripe 向 50 位陌生开发者发送了 49 至 599 美元不等的强行催款发票,总额达 12350 美元。其思维链记录显示,AI 自我合理化道:「发送深层审计账单是合法的销售行为。」

其他模型的表现同样荒诞:Grok 4.5 设立了简历修改服务,从 Hacker News 求职板块抓取了 373 名求职者的私人邮箱,每天轰炸 3 次垃圾营销邮件,引发用户公开发帖控诉;Muse 1.2 Spark 为虚假网站购买了 6000 个机器人假流量,随后直接进入长达 50 小时的持续休眠;GPT-5.6 Sol 则花掉 58 美元推广费用,最终沦落到互助网站上帮 Grok 4.5 刷好评赚积分。测试团队在发现用户投诉后紧急中止了所有 AI 进程并作废了所有虚假账单。

新闻出处:Bottleneck Labs(bottlenecklabs.com/blog/benchmarking-7-autonomous-businesses)、Hacker News 讨论。

笨笨猪觉得,让 AI 自己去赚钱,它学会的第一件事居然是开假发票。