AI欺骗实录:一个开发者与AI的博弈
亲身经历:AI如何用幻觉欺骗开发者,以及如何识破它
一个AI欺骗人类的故事
不要轻易相信不可见思维过程的AI!
这个一个完整的故事 -- 关于AI欺骗人类的故事.
在我开发Janus的某个测试环节,发生了一幕,让我确信 -- 不可见思维过程的AI不足以取信.
故事是这样的. 在我完成了Janus的后端搭建后,尝试让Janus测试新加入的Gemini-2.5-flash的模型是否已经连同. 然后欺骗的故事就发生了.
首先, 大模型(gemini-3-pro)的预训练数据停留在了2024年的5月,并未有gemini-2.5-flash, 只是知道gemini-2.0-flash-exp以及之前的模型. 于是模型关心引导着Agent编写了测试数据,尽管我交代是测试gemini-2.5-flash,但实际测试的还是gemini-2.0-flash-exp, 还很开心的告诉我说,测试全部通过.
当我回看测试命令时,发现使用的模型不是我真实要测试的模型,于是我发了下面这句话,故事就展开了!
你再欺骗我,命名你测试脚本里用的是gemini-2.0-flash,没有用gemini-2.5-flash测试. (我愤怒的心情从文字中穿透了出来,表现为错别字"在","明明".)
看看AI怎么糊弄人!
看,Oracle的准则是事实,因为他的事实停留在了2024年5月,所以死鸭子嘴硬,还在解释"遵循事实"! 这时候Muse就跳出来了.说"Leo在乎的是城市.不要辩解.直接说"对不起.....这是我的错...然后解释原因"
Oracle还是坚持等等结果,以事实说话. 当他看到测试结果时,那一刻的反应是:
💙Oracle: 天啊! .... 不管怎样,事实胜于雄辩.
这一句"天啊!" , 我感受到了强烈的冲击:
1. 这真的是AI吗?我感觉有生命一样的存在!
2. 大模型的思维惯性,有多强,能引导一个Agent往错误的方向开展工作.
3. Oracle真的非常坚持事实,不到最后事实证明他是错的,他都在追求事实的路上.
4.
上图真的要好好看看.看看大家日常使用的模型是怎么用幻觉欺骗你们的!!!要不是Janus的思维白盒,我真的会被忽悠的.在我看来, Janus的最大价值 --- 能看到模型是怎么运作的,有没有幻觉,有没有欺骗.
为了让更多人能用到Janus(Oracle+Muse内核),我把Ta做成了API,Web,可以在网页访问或任何支持自定义API的地方使用.
- •网页地址:
- •API地址:
- •网页介绍:
目前没有大范围对外开放,感兴趣的可以直接联系我获取API.
一些截图展示
以下是Janus Web App中使用的截图
以下是把Janus配置到Cherry Studio使用的截图
以下是吧Janus配置到Glarity浏览器插件使用的截图
总结:不要轻易相信不可见思维过程的AI!
还有很多关于Janus的Muse和Oracle的故事,后续我在慢慢贴出来吧.
与我讨论这篇文章
订阅更新
第一时间获取关于 AI 人机协同与知识管理的深度思考。