Renumber the pipeline substeps to match the paper (5-1 becomes 5a)

prompts/ and runs/ move by git mv; zero padding dropped; the
arbitration and LLM-merge rows in the cost ledger carry no new
name -- their step column reads 已廢棄 with the original name
kept in a new last column.  Archived meta.json files and past
decision-log entries keep the names they were written with.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
This commit is contained in:
2026-08-18 23:37:32 +08:00
co-authored by Claude Opus 5
parent e3cca7e538
commit 85d776da8b
83 changed files with 144 additions and 114 deletions
+23 -23
View File
@@ -98,7 +98,7 @@
## 步驟 3 編碼的三次執行與多數決
- **三次執行**:同一份定義檔、同一份輸入檔,獨立執行
三次,三份歸檔並列(`runs/03-code/run1``run2`
三次,三份歸檔並列(`runs/3a-code/run1``run2`
`run3`),彼此無先後主從之別。
- **多數決**:一首歌的一個標籤,三次執行中至少兩次標出
即收入定案編碼。三票不平手,裁決規則因此無例外條款,
@@ -125,13 +125,13 @@
由 LLM 依編碼名的字面語意判斷。
- **任務**:每筆輸入為一個群名加 101 個編碼的字母序
清單,輸出為入選編碼的單層 JSON 陣列;定義檔
`prompts/04-group.md` 只定格式,不含任何群的語意定義。
`prompts/4-group.md` 只定格式,不含任何群的語意定義。
- **模型**`claude-fable-5`(步驟 1、3 為
`claude-sonnet-4-6`)。該模型不受理 `temperature`
`thinking` 參數,兩者均不送出;取樣變異由多數決吸收。
模型裁定的理由與對照實驗見決策日誌。
- **三次執行**:同一份定義檔、同一份輸入檔,獨立執行
三次,歸檔並列(`runs/04-group/run1``run2``run3`)。
三次,歸檔並列(`runs/4-group/run1``run2``run3`)。
- **多數決**:一個(群,編碼)配對,三次執行中至少兩次
入選即屬該群;不在 101 碼詞彙表內的輸出項無效,每筆
丟棄印於標準錯誤。計票由確定性子命令 `tally-groups`
@@ -146,7 +146,7 @@
## 步驟 5 女性主義問題之質性深讀
本步驟之 5-1 至 5-3 為**質性閱讀,非編碼**:輸出為自由
本步驟之 5a 至 5c 為**質性閱讀,非編碼**:輸出為自由
文字的問題閱讀報告,無可逐項機械比對的單位,故不適用
三票多數決與仲裁;
三次獨立閱讀為分析者三角檢核,逐首整合為整合而非裁決,
@@ -155,34 +155,34 @@
- **對象**:定案編碼含 `women-power`
`female-empowerment` 的 145 首歌。
- **5-1 逐首閱讀**:每筆輸入為一首歌的完整歌詞逐字全文,
- **5a 逐首閱讀**:每筆輸入為一首歌的完整歌詞逐字全文,
不含歌名與演唱者(盲讀);定義檔
`prompts/05-01-read.md`。同一份定義檔、同一份輸入檔,
獨立執行三次,歸檔並列(`runs/05-01-read/run1`
`prompts/5a-read.md`。同一份定義檔、同一份輸入檔,
獨立執行三次,歸檔並列(`runs/5a-read/run1`
`run2``run3`)。
- **5-2 逐首整合**:每筆輸入為該首歌的三份閱讀報告
- **5b 逐首整合**:每筆輸入為該首歌的三份閱讀報告
(不含歌詞);以問題機制為單位保守合併,標收斂註記
((3/3)、(2/3)),主清單僅列兩讀以上提出者,單讀發現
以一行存目;定義檔 `prompts/05-02-consolidate.md`,
執行一次,歸檔 `runs/05-02-consolidate/run1`
- **5-3 樣態統整**:單筆輸入為一批整合報告;歸納問題
以一行存目;定義檔 `prompts/5b-consolidate.md`,
執行一次,歸檔 `runs/5b-consolidate/run1`
- **5c 樣態統整**:單筆輸入為一批整合報告;歸納問題
**樣態**——問題呈現與運作的重複形態,非問題分類,
代表引句僅取自主清單;定義檔
`prompts/05-03-synthesize.md`。四種輸入範圍各執行
`prompts/5c-synthesize.md`。四種輸入範圍各執行
一次:全 145 首之基底統整(歸檔
`runs/05-03-synthesize/run1`),及依 `performer_gender`
`runs/5c-synthesize/run1`),及依 `performer_gender`
(演唱聲音之性別)切分之三個發話脈絡統整——男聲
(male,歸檔 `run2`)、女聲(female,歸檔 `run3`)、
混合(mixed,歸檔 `run4`);基底看橫貫各脈絡之樣態,
分組看各權力脈絡下之樣態。genderfluid 與 non-binary
共 3 首不設群——樣本數不支持歸納——僅入基底統整,
由研究者以個案閱讀。同一輸入不重複執行:自由歸納之
產出無機械合併可言,其變異由 5-1 三讀、5-2 整合與
產出無機械合併可言,其變異由 5a 三讀、5b 整合與
草稿地位承接,四份草稿互為對照,由研究者終審裁決。
- **5-4 樣態標註**:以 (歌, 樣態) 對為可逐項機械比對之
- **5d 樣態標註**:以 (歌, 樣態) 對為可逐項機械比對之
單位,回歸「三次執行+多數決」協定。對象為「有問題」
的歌——三讀中至多一個「無」(多數決精神;恰兩「無」
者其整合報告主清單必為空,與 5-2 主清單規則自洽),
者其整合報告主清單必為空,與 5b 主清單規則自洽),
計 111 首(男聲 12、女聲 69、混合 29、genderfluid 1)。
樣態表為三份分組統整草稿原文:男聲 13 條(M1–M13)、
女聲 14 條(F1F14)、混合 16 條(X1X16);基底 15 條
@@ -195,17 +195,17 @@
位置無法先驗決定),其歸屬引用維持個案地位。每筆
輸入為一首歌之整合報告(「僅單獨提及」行於組裝時
剝除,標註僅依主清單)與該首適用之樣態表;定義檔
`prompts/05-04-annotate.md`,獨立執行三次
(`runs/05-04-annotate/run1`~`run3`),(歌, 樣態) 對
`prompts/5d-annotate.md`,獨立執行三次
(`runs/5d-annotate/run1`~`run3`),(歌, 樣態) 對
得兩票以上者定案。
- **模型**:`claude-fable-5`(與先導深讀同儀器;
`temperature``thinking` 參數不適用,均不送出)。
- **輸入組裝**:確定性行內腳本。5-1:145 首依歌曲 ID
升序,`content` 為歌詞逐字全文;5-2:每筆
- **輸入組裝**:確定性行內腳本。5a:145 首依歌曲 ID
升序,`content` 為歌詞逐字全文;5b:每筆
`{"reports": [run1 輸出, run2 輸出, run3 輸出]}`;
5-3:單筆以 `song-<ID>` 為鍵、整合報告為值之 JSON
5c:單筆以 `song-<ID>` 為鍵、整合報告為值之 JSON
物件,鍵集合為該次統整之範圍(基底為全 145 首,
分組依工作庫 `performer_gender` 切分);5-4:每筆
分組依工作庫 `performer_gender` 切分);5d:每筆
`{"report": 主清單, "patterns": [{"id", "name",
"description"}]}`,樣態條目自分組統整草稿機械切出,
代表引句不隨附——引句出自特定歌曲,判該曲時形同
@@ -263,7 +263,7 @@
在資料中找不到對應者,即中止;校定的判準記於
`decision-log.md`。
- **合法碼清單**:純文字、一行一個碼,自詞彙表產出:
`{ cat runs/02-cluster/result-keywords.txt; echo
`{ cat runs/2-cluster/result-keywords.txt; echo
women-power; } | sort`。
- **定案表**`results/codings.csv`,欄位 `Song`、
`Artist Credit`、`Keyword`、`Quote`,一列一個標籤。歌名