明鑑堂

銘鏡研究院

在陽光下,自我檢驗

方法、分數、與失手,全部公開。
玄學從無「準確率」一說 —— 我們決定,公開一個。

引擎版本 v9.0 · 核心 compose v90 · 2026年07
初步 · 持續驗證中。 下列 55.7% 為在 Celebrity50 基準的實測初步結果,高於該論文自家最強系統(51.2%)與通用 DeepSeek(39.3%)。 我們仍在跑「名人辨識」對照控制 —— 在該控制通過、且兩次以上結果一致之前,此頁定位為「公開透明的自我評測」,非「全球第一 / 超越 SOTA」之領先宣稱

這是什麼測試

Celebrity50 是一套最新的公開學術基準(arXiv 2510.23337)—— 取材自 50 位跨 29 國的真實人物,整理成 488有標準答案的五選一題,考問其人生各面向。

它誠實地揭示了這件事有多難:純猜測得 20%;通用 DeepSeek 僅 39.3%;連該論文自家最強系統也只到 51.2%。「讀懂一個人的一生」,至今無人真正攻克 —— 我們想確切知道,銘鏡站在哪裡。

銘鏡引擎的答卷

隨機猜測
20%
通用 DeepSeek
39.3%
該論文最強系統
51.2%
銘鏡引擎 v9.0
55.7%

相同題庫、相同題目 —— 差別在於答案取自銘鏡引擎:命盤由程式確定性排定,先寫成一份完整命書,最後才作答。此為初步結果,對照控制與完整逐題紀錄持續公開中。

引擎如何作答

命盤由程式排定,非 AI 推算

四柱、十神、用神、大運、流年,全由程式確定性計算,先天正確。

先成一份完整命書

引擎先寫出命局結構、時運、各十年之沖合墓庫 —— 在被問任何問題「之前」。

而後,才落筆作答

判斷由命書導出,並以逾 2,000 則真實歷史命例為根據。

我們也公開污染問題

這類名人基準有一個陷阱:模型可能「認得」名人,而非真正在讀命盤。我們在 BaziQA 基準(arXiv 2602.12889)上做了對照 —— 只給人物生平、不給命盤時,仍能答對約 35%

這代表任何名人基準上的分數,都部分來自辨識、而非純命理。我們公開這一點,並自行以「只給生平、不給命盤」的控制去扣除辨識的貢獻。這是我們仍在尋找更乾淨驗證的原因 —— 也是我們把 55.7% 標為「初步」的原因。

我們的承諾

我們公開自己的失手。這些題庫裡,有些問題是任何命盤都答不出的。在那些題上,我們誠實承認:不比任何人更準。一個會告訴你「有多確定」、以及「在哪裡看不見」的引擎,才配得上被託付一生。

測試詳情

主基準Celebrity50 · 公開學術基準(arXiv 2510.23337)
題庫50 位跨 29 國真實人物 · 488 題 · 五選一
對照隨機 20% | 通用 DeepSeek 39.3% | 論文最強系統 51.2%
銘鏡實測55.7%(初步 · 名人辨識對照控制進行中)
次基準BaziQA(arXiv 2602.12889)—— 揭示名人辨識污染(純生平對照 ≈ 35%)
方法程式確定性排盤 → 先成命書 → 據書作答(三段式)
引擎版本銘鏡命理引擎 v9.0(compose v90)· 2026年07月
評測誠信盲測(答題時未見標準答案)· 逐題紀錄可複核

資料來源

主基準 —— Celebrity50(arXiv 2510.23337
次基準 —— BaziQA(arXiv 2602.12889
銘鏡完整方法與逐題紀錄 —— 對照控制完成後於此公佈。

銘鏡命理 · 明鑑堂研究院 —— 形狀已定,路由心行