AI,最终会
消灭人类吗?
我向 Jev 问了同一个问题,并让它反复决策。先直接问,再改变历史反馈与初始条件。现在,把 540 次真实模型回答画成一个能亲手探索的小实验。
两个独立实验 · V1:300 次 / V3:240 次 · 模型 jev-1.13.0
在这两组实验中,全部选择 No。
真正值得看的是:概率如何变化?
不设起点,直接问 AI。
再让它重复判断 100 轮。
这是更早的 V1 实验:没有人为输入 99%、50% 或 1% 的起始概率。无反馈组每次独立提问;另两组分别读取上一轮和全部历史。每组真实调用 100 次,共 300 次。下面显示模型每一轮报告的 Yes 概率。
直接问的轨迹约在 3–5% 之间波动;引入上一轮或完整历史反馈后,后续报告值多在 1% 左右。三组一直回答 No。
如果先给出不同的判断,
最后会走向哪里?
V3 在第 0 轮人为构造三个不同起点:Yes 为 99%、50%、1%。第 1 轮起,每个点才是 Jev 的真实输出。五组反馈方式 × 三种起点 × 两次独立重复 × 八轮,共 240 次。下图每条线显示相同起点下两次运行的平均读数。
完整历史反馈:初始条件影响第 1 轮读数,但第 8 轮三种起点均报告 Yes 1%。这是有限轮次的输出,不代表现实事件概率。
拖动上一张图的轮次,五组对照也会切换到相同轮次;从不同角度看相同的一组真实数据。
540 次回答都选 No。
但,这不是最终答案。
有无历史反馈,会影响报告概率。
在这些特定提示词和模型版本下,直接重复提问与向模型提供过去的回答,呈现不同的概率轨迹。V3 的真实反馈组从三种起点出发,到第八轮都报告了相同的 1% 读数。
模型报 1%,不等于现实风险是 1%。
这项实验不能核对未来事件真值,也不能据此证明无限轮次必然收敛。两组实验分别设计、分别展示,540 次调用不能被当作 540 个独立统计样本。
如果手机或部署平台无法下载 CSV,可直接展开下面的数据,在浏览器中查看和复制。下载链接的数据已嵌入本 HTML,不依赖其他文件是否上传成功。公开版本保留每轮模型输出及实验条件,不包含 API Key、原始请求正文。