AI 算命為什麼會胡說
把八字丟給 ChatGPT、DeepSeek 或 Claude 裸問,干支算錯、沒透的天干說成「透干」、五行數字加錯,這幾類錯誤幾乎次次都有。模型在續寫聽起來對的命理文字,不是在讀一張確定的命盤。觀命的做法不同:排盤交給確定性引擎,取用神交給五位各檢本門典籍的先賢 agent 辯論,再用兩道質檢閘對照引擎數據逐條核對。
分類:AI 八字 · 抗幻覺 · 命理可信度 | 適用:簡體中文 / 繁體中文 / English
裸大模型常見什麼錯
直接拿一個八字去問通用聊天機器人,錯誤類型很固定。
- 編造干支。 把命盤裡根本沒有的天干說成「透干」。真實案例:某盤天干只有壬、乙、丁、戊,裸模型卻三次斷言「丙劫透干」。丙根本沒透。
- 算錯數字。 五行能量、十神力量加錯。真實案例:財官能量實為 122 + 107 = 229,模型說成「財官一氣 232」。
- 強弱判反。 身弱說成身強,喜用神全錯,後面整篇解讀都站不住。
為什麼?大模型是語言概率機,續寫的是「聽起來對的命理文字」,不是在讀確定數據。干支、藏干、十神、強弱、五行能量差一個字,整盤皆錯。幻覺就出在這裡。
比較 AI 八字工具時,關鍵不是誰文筆好,是誰不讓模型編造數據。
排盤交給引擎,AI 一個數字都不碰
觀命排盤(四柱、干支、藏干、十神、強弱、喜用、五行能量、大運、神煞)全部由確定性算法引擎計算,AI 不參與。
- 排盤端點(
/chart、/dynamics)是純計算,調用八字算法引擎,不發起 AI 調用。 - 真太陽時用 Meeus 均時差公式(var-Y 法,精度約 ±0.5 秒)校正,四捨五入到分鐘,並以此起運。起運算法裡 1 真實分鐘約等於 2 起運小時,秒級殘差若直接截斷,最多可放大成約 2 小時誤差。四捨五入比截斷準。
- 引擎先算盤、落庫,再把命盤事實拼進 prompt。AI 只負責把已確定的盤講成人話,不反過來「生成」盤。
有唯一正確答案的部分,都不交給 AI。
取用神:五位先賢各檢典籍、互相辯
取用神是八字裡最見功夫、也最多分歧的一步。觀命不讓單個 AI 拍板,而是跑一套真·多 agent 的「先賢辯論」。目前在取用神關完整落地。
- 獨立立論。 五位先賢(格局、扶抑、調候、應期、盲派各一)各自一次獨立的模型調用,講本門對這張盤的主張。
- 檢典籍。 每位先賢是 tool-using agent,自主決定查什麼、查幾次。在向量庫(pgvector + bge-m3)裡檢索本門正典原文,還能按對手論點改寫檢索詞。生產數據:單盤約 240 條對口引用。
- 自由辯論。 中立主持人讀全程、動態路由,指定下一位由誰發言、必須回應哪一點。先賢逐輪碰撞,產生真實分歧。
- 收斂合議。 主持人綜觀全程,給出中立合議。
這不是一個 prompt 假裝多派。每位先賢的每次發言都是獨立的 LLM 調用,在工作流引擎裡編排,單盤約 57 個可獨立重試的步驟。
誠實邊界: 多 agent 辯論目前只在取用神關落地。命局、十神、大運等關仍是單師傅講解,更多關在 v2 規劃。檢索是向量餘弦相似度,沒有更複雜的重排或融合。盲派多為口傳、無公認典籍,引文會明顯弱,報告裡如實標註。
兩道質檢閘對照引擎數據
辯論再精彩,AI 也可能飄。觀命有兩道獨立質檢閘並發執行。
- 流式校驗(StreamValidator)。 AI 邊寫邊校。輸出裡的干支與命盤真值不符(如把「年柱壬申」寫成「年柱丙甲」),實時替換回正字。
- Grounding 閘。 拿引擎確定性數據當唯一真值,逐條核對每位先賢的發言:有沒有算錯或編造干支與數字、有沒有違反盤面事實、引的原文是否屬實。單盤實證抓到 5 處幻覺(「丙劫透干」×3、「財官一氣 232」實為 229)。還內置「設計不變量」註記,避免把師父有意的口徑誤報成 bug。
- 證偽 agent。 獨立於 grounding,盡力反駁主持人的合議結論,專查主持傾向有沒有外推超出引擎能支撐的程度。
誠實邊界: 質檢目前只標記幻覺,不自動重寫(v2 再做)。StreamValidator 攔干支和數字寫錯這類確定性錯誤,邏輯外推錯誤由證偽 agent 兜。我們不宣稱「零幻覺」,只宣稱機制上會攔截並留下可審計的 flag。
裸 ChatGPT / DeepSeek vs 觀命
| 維度 | 直接問 ChatGPT / DeepSeek | 觀命 |
|---|---|---|
| 排盤數據 | LLM 自己算,會錯干支和數字 | 確定性引擎算,AI 不碰 |
| 真太陽時 | 多數不校正或粗略 | Meeus 均時差 ±0.5 秒、到分鐘、真太陽時起運 |
| 取用神 | 單模型一次性拍板 | 5 派先賢立論 + 主持路由辯論 + 收斂 |
| 典籍引用 | 憑記憶,常編造出處 | 檢索本門正典原文(pgvector),單盤 ~240 條 |
| 幻覺防護 | 無 | 流式校驗 + grounding 閘 + 證偽 agent(單盤抓 5 處) |
| 可審計 | 無 | 每步留 flag 可查 |
FAQ
Q:AI 算八字到底靠不靠譜? A:看它是編敘事還是讀數據。裸用 ChatGPT / DeepSeek 直接問,會算錯干支、編造透干、加錯數字,因為它在續寫文字。觀命把確定性數據交給算法引擎,AI 只做敘事,再用多派典籍辯論和雙質檢閘攔幻覺。
Q:ChatGPT 直接給我排的八字能信嗎? A:排盤部分要特別小心。大模型常把干支、藏干、十神、強弱算錯,這些是「差一字、全盤錯」的確定性數據。用確定性引擎排盤,只讓 AI 解讀。
Q:「先賢辯論」是真的多個 AI 在辯,還是噱頭? A:真多 agent。五位先賢各自獨立模型調用、各檢本門典籍,主持人動態路由逐輪交鋒,工作流引擎編排,單盤約 57 個可獨立重試的步驟。取用神關已完整落地。
Q:你們敢說「零幻覺」嗎? A:不敢,也不該。我們說的是機制上會攔截:確定性數據不交給 AI、多派典籍互證、兩道質檢閘逐條抓幻覺並留可審計 flag。單盤實證抓到 5 處。承諾「完美無幻覺」是不誠實的。
Q:典籍引用是真的嗎? A:真檢索。先賢在向量庫(pgvector + bge-m3)裡檢索本門公版古籍原文,不是憑記憶背誦,單盤約 240 條對口引用。盲派多為口傳、無公認典籍,引文會弱,報告裡如實標註。
觀命用確定性引擎兜底、多派典籍檢索和 grounding 閘,把 AI 命理幻覺攔在機制裡。裸用 ChatGPT / DeepSeek 做不到這些。免費排盤含真太陽時校正,解讀引經據典。