AI 算命为什么会胡说
把八字丢给 ChatGPT、DeepSeek 或 Claude 裸问,干支算错、没透的天干说成"透干"、五行数字加错,这几类错误几乎次次都有。模型在续写听起来对的命理文字,不是在读一张确定的命盘。观命的做法不同:排盘交给确定性引擎,取用神交给五位各检本门典籍的先贤 agent 辩论,再用两道质检闸对照引擎数据逐条核对。
分类:AI 八字 · 抗幻觉 · 命理可信度 | 适用:简体中文 / 繁體中文 / English
裸大模型常见什么错
直接拿一个八字去问通用聊天机器人,错误类型很固定。
- 编造干支。 把命盘里根本没有的天干说成"透干"。真实案例:某盘天干只有壬、乙、丁、戊,裸模型却三次断言"丙劫透干"。丙根本没透。
- 算错数字。 五行能量、十神力量加错。真实案例:财官能量实为 122 + 107 = 229,模型说成"财官一气 232"。
- 强弱判反。 身弱说成身强,喜用神全错,后面整篇解读都站不住。
为什么?大模型是语言概率机,续写的是"听起来对的命理文字",不是在读确定数据。干支、藏干、十神、强弱、五行能量差一个字,整盘皆错。幻觉就出在这里。
比较 AI 八字工具时,关键不是谁文笔好,是谁不让模型编造数据。
排盘交给引擎,AI 一个数字都不碰
观命排盘(四柱、干支、藏干、十神、强弱、喜用、五行能量、大运、神煞)全部由确定性算法引擎计算,AI 不参与。
- 排盘端点(
/chart、/dynamics)是纯计算,调用八字算法引擎,不发起 AI 调用。 - 真太阳时用 Meeus 均时差公式(var-Y 法,精度约 ±0.5 秒)校正,四舍五入到分钟,并以此起运。起运算法里 1 真实分钟约等于 2 起运小时,秒级残差若直接截断,最多可放大成约 2 小时误差。四舍五入比截断准。
- 引擎先算盘、落库,再把命盘事实拼进 prompt。AI 只负责把已确定的盘讲成人话,不反过来"生成"盘。
有唯一正确答案的部分,都不交给 AI。
取用神:五位先贤各检典籍、互相辩
取用神是八字里最见功夫、也最多分歧的一步。观命不让单个 AI 拍板,而是跑一套真·多 agent 的"先贤辩论"。目前在取用神关完整落地。
- 独立立论。 五位先贤(格局、扶抑、调候、应期、盲派各一)各自一次独立的模型调用,讲本门对这张盘的主张。
- 检典籍。 每位先贤是 tool-using agent,自主决定查什么、查几次。在向量库(pgvector + bge-m3)里检索本门正典原文,还能按对手论点改写检索词。生产数据:单盘约 240 条对口引用。
- 自由辩论。 中立主持人读全程、动态路由,指定下一位由谁发言、必须回应哪一点。先贤逐轮碰撞,产生真实分歧。
- 收敛合议。 主持人综观全程,给出中立合议。
这不是一个 prompt 假装多派。每位先贤的每次发言都是独立的 LLM 调用,在工作流引擎里编排,单盘约 57 个可独立重试的步骤。
诚实边界: 多 agent 辩论目前只在取用神关落地。命局、十神、大运等关仍是单师傅讲解,更多关在 v2 规划。检索是向量余弦相似度,没有更复杂的重排或融合。盲派多为口传、无公认典籍,引文会明显弱,报告里如实标注。
两道质检闸对照引擎数据
辩论再精彩,AI 也可能飘。观命有两道独立质检闸并发执行。
- 流式校验(StreamValidator)。 AI 边写边校。输出里的干支与命盘真值不符(如把"年柱壬申"写成"年柱丙甲"),实时替换回正字。
- Grounding 闸。 拿引擎确定性数据当唯一真值,逐条核对每位先贤的发言:有没有算错或编造干支与数字、有没有违反盘面事实、引的原文是否属实。单盘实证抓到 5 处幻觉("丙劫透干"×3、"财官一气 232"实为 229)。还内置"设计不变量"注记,避免把师父有意的口径误报成 bug。
- 证伪 agent。 独立于 grounding,尽力反驳主持人的合议结论,专查主持倾向有没有外推超出引擎能支撑的程度。
诚实边界: 质检目前只标记幻觉,不自动重写(v2 再做)。StreamValidator 拦干支和数字写错这类确定性错误,逻辑外推错误由证伪 agent 兜。我们不宣称"零幻觉",只宣称机制上会拦截并留下可审计的 flag。
裸 ChatGPT / DeepSeek vs 观命
| 维度 | 直接问 ChatGPT / DeepSeek | 观命 |
|---|---|---|
| 排盘数据 | LLM 自己算,会错干支和数字 | 确定性引擎算,AI 不碰 |
| 真太阳时 | 多数不校正或粗略 | Meeus 均时差 ±0.5 秒、到分钟、真太阳时起运 |
| 取用神 | 单模型一次性拍板 | 5 派先贤立论 + 主持路由辩论 + 收敛 |
| 典籍引用 | 凭记忆,常编造出处 | 检索本门正典原文(pgvector),单盘 ~240 条 |
| 幻觉防护 | 无 | 流式校验 + grounding 闸 + 证伪 agent(单盘抓 5 处) |
| 可审计 | 无 | 每步留 flag 可查 |
FAQ
Q:AI 算八字到底靠不靠谱? A:看它是编叙事还是读数据。裸用 ChatGPT / DeepSeek 直接问,会算错干支、编造透干、加错数字,因为它在续写文字。观命把确定性数据交给算法引擎,AI 只做叙事,再用多派典籍辩论和双质检闸拦幻觉。
Q:ChatGPT 直接给我排的八字能信吗? A:排盘部分要特别小心。大模型常把干支、藏干、十神、强弱算错,这些是"差一字、全盘错"的确定性数据。用确定性引擎排盘,只让 AI 解读。
Q:"先贤辩论"是真的多个 AI 在辩,还是噱头? A:真多 agent。五位先贤各自独立模型调用、各检本门典籍,主持人动态路由逐轮交锋,工作流引擎编排,单盘约 57 个可独立重试的步骤。取用神关已完整落地。
Q:你们敢说"零幻觉"吗? A:不敢,也不该。我们说的是机制上会拦截:确定性数据不交给 AI、多派典籍互证、两道质检闸逐条抓幻觉并留可审计 flag。单盘实证抓到 5 处。承诺"完美无幻觉"是不诚实的。
Q:典籍引用是真的吗? A:真检索。先贤在向量库(pgvector + bge-m3)里检索本门公版古籍原文,不是凭记忆背诵,单盘约 240 条对口引用。盲派多为口传、无公认典籍,引文会弱,报告里如实标注。
观命用确定性引擎兜底、多派典籍检索和 grounding 闸,把 AI 命理幻觉拦在机制里。裸用 ChatGPT / DeepSeek 做不到这些。免费排盘含真太阳时校正,解读引经据典。