# 07c 修正驗證:《HW1_一條龍說明》對照 07b 與 teaching-doc-standard > 審查對象:`HW1\HW1_一條龍說明.html`(2026-10-06 00:26 組裝;比所有草稿和 `build_guide.py`(00:26:17)晚,無殘留 `⟦…⟧`;新圖 `toy_w2v`、`toy_pca`、`noise_band` 都已嵌入) > 文字來源:`示範實作\_guide_drafts\guide_*.html`+`示範實作\build_guide.py`(`patch_guide_07b.py` 只當地圖用) > 事實基準:`示範實作\_extract2\outputs.txt`(exec n=In [n]);作業 PDF p27–p31(pdftotext);W2、W3 逐字稿;模板 `原始檔_2026\main.ipynb`;圖對照 `_extract2\*.png` > 審查日:2026-10-06。審查員沒看過這份文件。除了本檔,沒有改任何檔案。 ## 一句話結論 07b 列的 36 項(F1–F5、C1–C4、S1–S10、Y1–Y4、R1–R3)**全部都修了,也都修對了**。數字抽查 20 個,全部對得上。 但修正又帶出 **4 個小矛盾**: 1. 第 7 節 t-SNE 對照表還寫著全稱的「男女配對黏在一起:有」(F3 漏改的第 6 處)。 2. R1 新加的「本文說的近都是指方向」跟 t-SNE 段落的「近」(圖上距離)衝突。 3. 總結論 #5 引用國名→國籍 +2.19 時,沒有照第 9 節的承諾標「只當參考」。 4. 第 13 節新的影響段寫「只要做兩件事」,第 15 節寫的是三件。 另外有 4 個規範違反、4 個風格項。**沒有事實錯誤。** 嚴重度統計:事實錯誤 0/矛盾 4/規範違反 4/風格 4。 --- ## 一、07b 逐項檢查 標記:✅ 已修/◐ 部分修/✗ 未修。 ### A. 事實錯誤 F1–F5 | # | 狀態 | 證據(草稿現在的原文) | |---|---|---| | F1 資料範例行號 | ✅(附帶新問題 S2) | guide_static3.html:「注意上面第 5 行(abraham lincoln):「february april was」「the th president」中間的日期和數字被拿掉了;第 0 行「anarchism is political philosophy」、第 3 行「alabama is state」少了單一字母的 a。」我跟 exec 19 逐字對過,第 0、3、5 行都對。模板 cell 23 的原文確實是 “Thus, words with one character were discarded.” | | F2 taiwan 鄰居 | ✅ | guide_results4.html:「taiwan 的鄰居兩本字典都有 taipei、china;GloVe 字典另外是 mainland、taiwanese、hong,Wiki 20% 字典另外是 guangdong、hainan、fujian」。跟 exec 32 第 10、11 列完全相符 | | F3 t-SNE「每一對都貼得很緊」 | ◐ | 07b 列的 5 處都改了:g12 ⑦「有些配對貼得很緊…但 brother/sister、uncle/aunt、stepfather/stepmother 分得很開」;g4 結論;g4 bullet;gc #1;Q17。**但第 7 節的對照表漏改**,見新問題 C1 | | F4「不是按男女分群」 | ✅ | guide_results1.html:「有按「角色」分的群…中間那一大塊則大致是左邊男性(son、brother、uncle)、右邊女性(daughter、mother、aunt)」。我開 tsne_glove_marked.png 對過:son −1.0、brother −0.9、uncle −0.4 在左;daughter 2.4、mother 2.3、aunt 2.2 在右。唯一例外 husband(1.5)在右邊,見風格 Y3 | | F5 詞形還原「有實驗證明」 | ✅ | guide_new.html:「停用詞有實驗(第 12 節實驗 ②);詞形還原沒有做實驗,是看考卷內容推的」;guide_results3.html g8:「(這點沒有做實驗,是看考卷推的)。停用詞的部分,第 12 節實驗 ② 有數據。」 | **t-SNE 圖文對照(逐張開圖看過):** - tsne_glove_marked.png:boy/girl、man/woman 有灰線而且很近;dad/mom、bride/groom、policeman/policewoman 幾乎重疊。brother (−0.9, 5.5) 和 sister (3.4, 4.4) 分很開;uncle (−0.4, 4.5) 和 aunt (2.2, 2.1) 分很開;son (−1.0, 6.2) 和 daughter (2.4, 5.2) 分很開。四個圈(皇室、繼、代名詞、複數)都對。g4 的文字現在和圖一致。 - tsne_wiki20_marked.png,和 cell49_0.png 右半張是同一張圖:boy/girl、man/woman、dad/mom、bride/groom、king/queen 都很近。brother (1.0, 1.7) 和 sister (−2.8, 4.7) 分很開,uncle (1.7, 1.0) 和 aunt (−3.0, 1.8) 分很開,stepfather (−0.8, 1.3) 和 stepmother (−2.7, 2.9) 中間隔著 mother、husband。皇室在右下自成一群,繼字輩散開。g12 ⑦ 和 g7 的「皇室」「繼字輩」兩列都和圖一致。 ### B. 前後矛盾 C1–C4 | # | 狀態 | 證據 | |---|---|---| | C1「超過雜訊」1 倍 vs 1.5 倍 | ✅(剩一處漏網,見新問題 C3) | **gt**:保留「超過雜訊=大於雜訊」,另加一列「明顯超過…差距至少是雜訊的 1.5 倍。只超過一點點(1~1.5 倍)的,本文寫「超過,只當參考」」。**g9**:`q2_judge` 改回傳 `明顯超過`;表下寫「「明顯超過」=差距至少是雜訊的 1.5 倍…第 10、12 節的表照筆記本的 beyond noise?,只看有沒有超過;剛好超過(不到 1.5 倍)的,會在文中註明「只當參考」」。**g10**:「(只看有沒有超過,不分是不是 1.5 倍)…「剛好超過雜訊」的語法類 −1.34 只當參考」。**g12**:「超過雜訊,但不到 1.5 倍,只當參考」,加上倍數一行,以及「國名→國籍 −1.81,剛好超過雜訊 1.69,只當參考」。**R dict `exam_q2`**:「但只有貨幣明顯超過(1.5 倍以上),其他四個只當參考」。**gc #3**:「語法類 +3.03(超過雜訊)」,這是 2.40 倍,用 1 倍的說法也沒錯。我掃了組好的 HTML 裡每一個「超過雜訊/明顯超過/只當參考/沒超過」,只剩 gc #5 沒照做 | | C2 邊界情況編號 | ✅ | guide_results1.html:「邊界情況 2(同第 1 節):題目的字查不到」「邊界情況 1(同第 1 節):答案不能是題目自己的字」,程式註解「# 邊界情況 2:三個字都查得到嗎?」。和 g1 的編號一致 | | C3 四種 vs 觀察 ⑤ | ✅ | 「原因可以分成四種(下面觀察 ①~④);觀察 ⑤ 是兩個比較「正常」的字,當對照。」 | | C4 交叉引用 | ✅ | g1:「第 14 節 Q3、Q6、Q7、Q8」。我核對過:Q3 是 Skip-gram/CBOW,Q6 是訓練資料,Q7 是詞向量在哪一層,Q8 是負取樣,四題都對 | ### C. 規範違反 S1–S10 | # | 狀態 | 證據 | |---|---|---| | S1 g13 影響段 | ✅(但內容和 g15 矛盾,見新問題 C4) | guide_submit.html:「你本人只要做兩件事——在第 6 題最後一行照實寫「What I did」,然後照上面 4 步打包上傳。」 | | S2 g14 影響段 | ✅(但「題目裡標的那一節」沒辦法照做,見新問題 S3) | guide_results3.html:「考前把 18 題各自先開口答一次再打開看;答不出來的,回到題目裡標的那一節重讀。」 | | S3-a~k 推論/外部知識 | ✅ 11 項全修 | a「(「這部電影很__」,推論)」;b「(外部知識)」;c「外部知識:gensim 的預設做法」;d「won't 的一部分,外部知識」;e「烏克蘭的錢,外部知識」「緬甸的錢,外部知識」;f「(外部知識:兩種拼法都有人用)」;g「SemEval…(外部知識)」;h「(推論)出現次數太少…capital 一字在論壇只有維基的 0.27 倍可以間接支持」;i「(推論:…這裡只看了 computer 一個字)」;j「goldieblox 是玩具公司,外部知識」;k gw、g6 都改成「作業規格 PDF p28 建議的「只保留最高頻的字」」 | | S4 老師原話 | ✅ | g1、Q2:「不是這麼 exactly 是一樣的 pattern,但是趨勢非常的 close」(W3 00:32:03)。W3 逐字稿第 830–831 行是「[00:32:03] 還是不是這麼exactly是一樣的pattern/[00:32:05] 但是趨勢非常的close」,相符 | | S5 E5、E10 配圖 | ✅ | `⟦IMG:toy_w2v⟧` 插在 gk「第 2 小步」前;`⟦IMG:toy_pca⟧` 插在 g12 PCA `
` 裡。兩張圖都開來看過:toy_w2v 是 one-hot →(乘 V)→ V 的 cat 列反紅 →(查表)→ (0.8, 0.5) →(乘 U、softmax)→ 4 個字的機率,數字和 gk 表一致。toy_pca 的主成分是 `make_toy_figures.py` 用 SVD 算的,第 1、2 主成分互相垂直,交點在平均點 (3.03, 2.97) | | S6 圖檔「運氣」 | ✅ | noise_band.png 標題:「在粉紅帶子裡=沒超過雜訊,分不出來;在帶子外=超過雜訊(綠=變好、紅=變差)」 | | S7 PDF 頁碼 | ✅ | g6:「作業規格 PDF p28「Recommended data pre-processing steps」那頁,原文:Note that not every tricks yield better performance. You should try on your own.」。pdftotext p28 是「*Note that not every tricks yield better performance. You should try on your own.」,只少了開頭的星號。「Retain the most frequent words for the dictionary」也在 p28,正確 | | S8 VERIFY | ✅(暫行版) | 「這份說明另依教學文件規範審查兩次,第二次的修正尚待驗證。」這是 07b 建議的暫行文字。本檔的問題修完以後要再改,見風格 Y4 | | S9 改名殘留 | ✅ | gw「拿兩本字典的相似度互比」;gf「④ 怎麼學(訓練設定)」「訓練設定的影響」;g12「把「正確率低」拆成」;g10「維基對照組字典的一半大(100,310 vs 224,050 字,In [28])」;g4「考出來的正確率」;g9「正確率(全部 14 個小類都列出來)」 | | S10 gk 連到 Q7、Q8 | ✅ | 「(第 4 點的查表;第 14 節 Q7)」「(第 14 節 Q8)」 | ### D. 風格 Y1–Y4 | # | 狀態 | 證據 | |---|---|---| | Y1 負號 | ✅ | `diff_cell` 改成 `{f"{d:+.2f}".replace("-", "−")}` | | Y2「基準」 | ✅ | 「考卷裡的字,當比較的起點」 | | Y3 時間點 | ✅ | g11、gk 本文和 gk 依據都是「00:04:34–00:05:43」。逐字稿第 91–127 行從 00:04:34 講到 00:05:43「就是好像挺怪的這樣子」,範圍正確 | | Y4 window=10 顏色 | ✅ | noise_band.png 裡 window=10 是深紅菱形(程式第 72 行:變差=`#A31F34`)。但「同設定換種子」那 4 個點也是紅色,見新問題 Y1 | ### E. 初學者卡點 R1–R3 | # | 狀態 | 證據 | |---|---|---| | R1 近=方向 | ✅(但新加的那句講太滿,見新問題 C2) | 標題改成「觀念 2:詞向量方向越一致,意思越像」,並加「本文說的「近」「最像」,都是指方向(夾角小),不是兩點之間的距離。」 | | R2 `key_to_index`、`[0][0]` | ✅ | 主流程表 ③:「most_similar 回傳一串「(字, 相似度)」,例如 [('woman', 0.71)](數字是舉例)」;邊界情況段:「w in model.key_to_index 就是問「這個字查得到嗎?」」 | | R3 三張表路線圖 | ✅ | 「下面三張表各回答一個問題:① … ② … ③ … ③ 的答案是「語意類還是輸」」。15,684、52.80 vs 22.10 都和 exec 28 相符 | --- ## 二、新問題(依嚴重度排序) ### A. 事實錯誤 無。 ### B. 前後矛盾 **C1|guide_results1.html(g7)的 t-SNE 對照表還是全稱的「男女配對黏在一起」(F3 漏改的第 6 處)** - 原文:`男女配對黏在一起有有(boy/girl、bride/groom、dad/mom)` - 問題:F3 把其他 5 處都改成「有些配對黏在一起,但 brother/sister 等分很開」。這張表的列名卻還是全稱,GloVe 欄只寫「有」。讀者從第 4 節讀到第 7 節,會看到兩種說法。兩張圖上 brother/sister、uncle/aunt 其實都分很開(坐標見第一部分 A)。 - 改成:`有些男女配對黏在一起有(boy/girl、man/woman;但 brother/sister、uncle/aunt 分很開)有(boy/girl、man/woman、bride/groom、dad/mom、king/queen;但 brother/sister、uncle/aunt 分很開)` **C2|guide_static.html(g1)R1 新加的句子講太滿,跟 t-SNE 段落的「近」衝突** - 原文:`

本文說的「近」「最像」,都是指方向(夾角小),不是兩點之間的距離。所以下面手算時,★ 跟 woman 位置不完全一樣,但方向幾乎一樣,相似度就接近 1。

` - 問題:第 4 節寫「t-SNE 只保證「原本很近的點,畫出來也很近」」,t-SNE 的 `
` 又寫「紙上也靠近」;第 4、7、12 節的「黏在一起」「貼得很緊」都是在說**圖上兩點的距離**。而且筆記本 In [14]、In [24]、In [40] 的 `TSNE(...)` 沒有設 `metric`,sklearn 預設用歐氏距離(外部知識),所以 t-SNE 的「原本很近」在 100 維裡也是距離,不是方向。說「本文的近一律指方向」,讀到 t-SNE 時就不成立了。 - 改成:`

在相似度、鄰居、b − a + c 這些地方,本文說的「近」「最像」都是指方向(夾角小),不是兩點之間的距離。(例外:第 4、7、12 節看 t-SNE/PCA 圖時說的「近」「黏在一起」,是圖上兩點的距離。)所以下面手算時,★ 跟 woman 位置不完全一樣,但方向幾乎一樣,相似度就接近 1。

` **C3|guide_conclusion.html(gc #5)引用「剛好超過」的數字,沒有標「只當參考」** - 原文:`刪停用詞:整體 −0.87(沒超過雜訊),但家人/性別 −14.82、動詞第三人稱 −11.26(超過雜訊);國名→國籍反而 +2.19` - 問題:+2.19 ÷ 1.69 = 1.30 倍。第 9 節承諾「剛好超過(不到 1.5 倍)的,會在文中註明「只當參考」」,第 12 節也把它標成「只當參考」。總結論是考前只讀的那一節,卻把它當成證據,沒有任何保留。 - 改成:`刪停用詞:整體 −0.87(沒超過雜訊),但家人/性別 −14.82、動詞第三人稱 −11.26(明顯超過雜訊);國名→國籍反而 +2.19(超過雜訊但不到 1.5 倍,只當參考)` **C4|guide_submit.html(g13)S1 新加的影響段說「兩件事」,跟同一節和第 15 節對不上** - 原文:`所以對你的影響是:你本人只要做兩件事——在第 6 題最後一行照實寫「What I did」,然後照上面 4 步打包上傳。其他都已經做好。` - 問題:同一節「打包上傳」第 1 步就要先從拍板卡拿到學校代碼和學號。第 15 節寫「今天能做完的只有第 5~7 步要你本人(回拍板卡、寫 What I did、上傳)」,也就是三件;開頭又說「你要做的是三件事:看懂、照實補上你做的部分、打包交出去」。「其他都已經做好」還可能讓人以為不用讀懂,但考試要考。 - 改成:`所以對你的影響是:交作業這一步,你本人要做三件事——回拍板卡(學校代碼、學號)、在第 6 題最後一行照實寫「What I did」、照上面 4 步打包上傳。程式和報告都已經做好;考試要用的「看懂」,照第 15 節的步驟讀。` ### C. 規範違反 **S1|「剛好超過」這一層有四種叫法(規則 13:同一個東西只用一個名字)** - gt 定義:「只超過一點點(1~1.5 倍)的,本文寫「超過,只當參考」」。實際用法如下: - build_guide.py `q3_rows`:`'語法類37.8736.53論壇略低(−1.34,剛好超過雜訊 1.26,差距很小)'` - guide_results3.html Q13:`語法類加總略低 1.34,只比雜訊大一點` - guide_results5.html g12 ②:`只是剛好超過(只當參考)`(這處已經有「只當參考」,可以留著) - 改成: - `q3_rows`:`論壇略低(−1.34,超過雜訊 1.26 但不到 1.5 倍,只當參考)` - Q13:`語法類加總略低 1.34(超過雜訊 1.26 但不到 1.5 倍,只當參考)` **S2|guide_static3.html(g5)F1 新句子把「數字被拿掉」也算到模板說明頭上(規則 15:出處要對)** - 原文:`…中間的日期和數字被拿掉了;第 0 行…、第 3 行…少了單一字母的 a。模板在 TODO4 前面的說明寫了原因:助教用 gensim WikiCorpus 的預設參數清資料,「words with one character were discarded」(只有一個字母的字被丟掉)。

` - 問題:模板 cell 23 只解釋了「單一字母被丟掉」,沒有提到數字。數字被拿掉也是 WikiCorpus 預設的效果,但這個依據是筆記本 In [27] 的註解「只留 2~15 個字母的英文字(WikiCorpus 的預設)」,不是模板。照現在的寫法,讀者會以為模板兩件事都講了。 - 改成:`…少了單一字母的 a。原因是助教用 gensim WikiCorpus 的預設參數清資料:模板在 TODO4 前面寫「words with one character were discarded」(只有一個字母的字被丟掉);筆記本 In [27] 的註解也寫了這個預設「只留 2~15 個字母的英文字」,所以數字(不是字母)也會被拿掉。

` **S3|guide_results3.html(g14)S2 新加的影響段沒辦法照做(規則 10:定義要能照做)** - 原文:`答不出來的,回到題目裡標的那一節重讀。` - 問題:18 題裡只有 Q7 標了「課堂補充第 4 點」,Q11、Q14 等題只有投影片頁碼或時間點,其他題都沒有標節號。讀者找不到「題目裡標的那一節」。 - 改成:`答不出來的,回到對應的節重讀:Q1~Q2 → 第 1 節觀念 3;Q3 → 第 1 節觀念 4、第 12 節實驗 ③;Q4 → 第 11 節、課堂補充 C 組;Q5 → 第 7 節、課堂補充第 7 點;Q6~Q8 → 課堂補充第 3~5 點;Q9 → 第 4 節;Q10 → 第 5 節;Q11 → 第 6 節、第 12 節實驗 ②;Q12 → 第 9 節;Q13~Q14 → 第 10 節;Q15 → 第 4 節、第 12 節實驗 ⑧;Q16 → 第 12 節實驗 ④;Q17 → 第 4 節、第 12 節實驗 ⑦;Q18 → 第 6 節、第 12 節實驗 ③。` **S4|作業規格 p28 那份清單有兩種叫法(規則 13、15)** - 原文: - guide_static3.html(g6 前處理表表頭):`老師建議的做法我有沒有做為什麼` - guide_results5.html(g12 ②):`老師建議可以試「移除停用詞」,我沒做。` - 問題:S3-k 修完後,gw 和 g6 參數表都寫「作業規格 PDF p28 建議」。但同一份 p28 清單(Remove non-English words/Remove stop words/Lemmatization/Better tokenization/Retain the most frequent words)在這兩處還叫「老師建議」,而且沒給出處。g6 表的 5 列正好對應 p28 的 5 個項目。 - 改成: - g6 表頭:`作業規格建議的做法(PDF p28)我有沒有做為什麼` - g12 ②:`作業規格 PDF p28 建議可以試「移除停用詞」(Remove stop words),我沒做。` ### D. 風格 | # | 檔案 | 原文 | 問題 | 改成 | |---|---|---|---|---| | Y1 | `make_toy_figures.py` 第 68 行(noise_band.png) | `ax.scatter([v], [1], color="#A31F34", s=40, zorder=3)` | Y4 修完後,標題寫「紅=變差」。但「同設定換種子」的 4 個點也是紅色,讀者會以為換種子是「變差」 | `ax.scatter([v], [1], color="#2A2A2A", s=40, zorder=3)`(重跑腳本後重組 HTML) | | Y2 | build_guide.py `q2_judge`(g9 表下說明) | 動詞第三人稱 +3.10、雜訊 2.07 → 判「超過,只當參考」 | 3.10 ÷ 2.07 = 1.498,四捨五入到兩位小數是 1.50。讀者自己算會以為該判「明顯超過」(規則 12:邊界情況要單獨講) | 在 g9 表下說明最後加:`(邊界例:動詞第三人稱 3.10 ÷ 2.07 = 1.498,差一點才到 1.5 倍,所以判「只當參考」。)` | | Y3 | guide_results1.html(g4 bullet) | `中間那一大塊則大致是左邊男性(son、brother、uncle)、右邊女性(daughter、mother、aunt)。` | 圖上 husband(1.5, 6.4)在右邊、跟 wife 黏在一起。不利的反例也要寫出來(規則 16) | `中間那一大塊則大致是左邊男性(son、brother、uncle)、右邊女性(daughter、mother、aunt);例外是 husband,它在右邊跟 wife 黏在一起。` | | Y4 | build_guide.py `VERIFY` | `這份說明另依教學文件規範審查兩次,第二次的修正尚待驗證。` | 本檔驗完 07b 以後,這句要更新(規則 18) | 本檔 C1–C4、S1–S4 修完,並由下一位審查員確認以後:`這份說明另依教學文件規範審查三輪(07a、07b 與 07c 修正驗證),所有指出的問題都已修正。` | --- ## 三、數字抽查(20 個,都是本輪新加或改過的;全部對得上) | # | 位置 | 文件數字 | outputs.txt 出處 | 結果 | |---|---|---|---|---| | 1 | g11 ⑤(F2) | GloVe taiwan:mainland、china、taiwanese、taipei、hong | exec 32 第 10 列 | ✅ | | 2 | g11 ⑤(F2) | Wiki 20% taiwan:taipei、china、guangdong、hainan、fujian | exec 32 第 11 列 | ✅ | | 3 | g5(F1) | 第 0、3、5 行的原文 | exec 19 第 0、3、5 行 | ✅ | | 4 | g12 ②(C1) | 語法類 1.31 倍 | exec 35:−1.65 ÷ 1.26 = 1.310 | ✅ | | 5 | g12 ② | 名詞複數 1.25 倍 | +3.30 ÷ 2.63 = 1.255 | ✅ | | 6 | g12 ② | 國名→國籍 1.30 倍 | +2.19 ÷ 1.69 = 1.296 | ✅ | | 7 | g12 ② | 過去式 1.32 倍 | −3.21 ÷ 2.44 = 1.316 | ✅ | | 8 | g12 ② | 家人/性別 3.13 倍 | −14.82 ÷ 4.74 = 3.127 | ✅ | | 9 | g12 ② | 動詞第三人稱 5.44 倍 | −11.26 ÷ 2.07 = 5.440 | ✅ | | 10 | g12 ② | 比較級 1.51 倍 | −7.13 ÷ 4.73 = 1.507 | ✅ | | 11 | g12 ③(C1) | CBOW 國名→國籍 −1.81、雜訊 1.69、「3 類較差」 | exec 36:−2.37、−0.37、−1.81 三類為負,只有 −1.81 是 True;1.81 ÷ 1.69 = 1.07 | ✅ | | 12 | `exam_q2`(C1) | 語意五小類都超過雜訊,只有貨幣 ≥1.5 倍 | exec 31、34:首都 3.95/2.77=1.43、全世界 2.98/2.39=1.25、貨幣 2.66/1.50=**1.77**、城市 1.86/1.66=1.12、家人 5.54/4.74=1.17 | ✅ | | 13 | g9(C1) | 最高級 +7.31、反義字首 +4.19「明顯超過」 | 7.31/2.76=2.65;4.19/2.22=1.89 | ✅ | | 14 | g9 表 `q2_rows` | 17 列判斷(用 1.5 倍的規則重算) | exec 31、34;整體 2.16 倍、語法類 2.40 倍判明顯超過;動詞第三人稱 1.498 倍判只當參考 | ✅ | | 15 | g10(S9) | 字典 100,310 vs 224,050 | exec 28 | ✅ | | 16 | g10(S3-h) | capital 0.27 倍 | exec 30 | ✅ | | 17 | g10(R3) | 15,684 題;語意 52.80 vs 22.10 | exec 28 | ✅ | | 18 | g10 `q3_rows`(C1) | 語法類 −1.34 vs 1.26(1.06 倍);其他判贏的小類都 ≥2.17 倍 | exec 28、34 重算 14 列 | ✅ | | 19 | noise_band.png | 帶子 45.07~47.17;刪停用詞 45.25 在帶內;window=10 41.75、CBOW 52.58、300 維 57.44 | exec 34–36 | ✅ | | 20 | g1(R1)、g12 ④ | 前 3 名多 13.14 | exec 37:61.53 − 48.39 | ✅ | 另外核對了:W3 00:32:03–00:32:05、00:04:34–00:05:43、02:48:36–02:49:09,W2 01:39:50–01:40:51 的引語都和逐字稿相符;PDF p28 原文相符;模板 cell 23 原文相符;筆記本 In [14]、In [24]、In [40] 的 TSNE 都是 `perplexity=15, random_state=42, init="pca"`,沒有設 `metric`。 --- ## 四、結論 **還不能直接交給學生(否),但已經很接近。** 07b 的 36 項全部修好,數字抽查 20 個全對,引語、PDF 頁碼、圖都核對過。剩下的 4 個矛盾都是本輪修正帶出的小問題,不是演算法或數字錯誤: - C1:第 7 節表格漏改。 - C2:R1 那句講太滿。 - C3:總結論 #5 少了「只當參考」。 - C4:第 13 節「兩件事」和第 15 節的三件對不上。 每一項都是改一個字串,連同 S1~S4 大約 30 分鐘可以改完。Y1 要重跑 `make_toy_figures.py`。改完以後照規則 21,請一位沒看過本檔的審查員只核對這 8 項修正;沒有新問題就可以交,並照 Y4 更新 `VERIFY`。 本報告的每一項判斷都來自實際查證:逐檔讀完 14 份草稿、`build_guide.py` 和 `make_toy_figures.py`;掃描組好的 HTML 裡每一個「超過雜訊/明顯超過/只當參考/沒超過」;對照 `_extract2\outputs.txt` 重算所有倍數;開了 tsne_glove_marked、tsne_wiki20_marked、cell49_0、noise_band、toy_w2v、toy_pca 六張圖逐點比對;用 pdftotext 抽 PDF p27–p31;讀模板 `main.ipynb`;到 W2、W3 逐字稿核對每個時間點。