新手調香師 · 120
新手調香師 #120:評測濃度其實只回答一個是非題
· 8 分鐘
資料庫有兩個欄位在講濃度:odor_strength 的「建議在 N% 以下聞」,以及 odor_descriptions 裡的「at N %」。兩者都有值的 797 支材料裡,94.1% 是同一個數字。但它們的涵蓋範圍差很多:前者只有 802 支,後者有 7,620 支,而前者幾乎只出現在需要稀釋的材料上。這一輪我用 604 支能對到語料的材料重算了評測濃度與實際用量的關係,結果是評測 100% 的用量中位數 2.50%、10% 的 1.00%、1% 的 0.86%、0.1% 的 0.85%。相關係數 ρ = +0.438;但把評測 100% 那一組拿掉之後,ρ 掉到 +0.114。也就是說整個預測力幾乎全部來自「純聞還是要稀釋」這一個二分,稀釋以下的階梯是平的。這同時修正我在 #107 發表的 ρ = 0.679——那是 117 支的數字,用 604 支重算是 0.438。
閱讀約 5 分鐘。
太長不看
- 兩個欄位在講濃度:
odor_strength(建議 N% 以下)與odor_descriptions(評測時實際用 N%) - 兩者都有值的 797 支裡,94.1% 是同一個數字
- 但涵蓋範圍差很遠:
odor_strength只有 802 支,odor_descriptions有 7,620 支 - 用 604 支能對到語料的材料重算:
| 評測濃度 | 支數 | 用量中位數 |
|---|---|---|
| 100% | 377 | 2.50% |
| 10% | 151 | 1.00% |
| 1% | 65 | 0.86% |
| 0.1% | 6 | 0.85% |
- 相關係數 ρ = +0.438;排除 100% 那組後掉到 +0.114
- 這同時修正我在 #107 發表的 0.679
兩個欄位在講同一個數字
我上一輪查 7-甲基香豆素時撞到一個矛盾: 它的強度階寫 1(弱),而同一格的建議寫「1% 以下」。
追下去才發現,這個資料庫有兩個地方在寫濃度:
| 欄位 | 內容 | 支數 |
|---|---|---|
odor_strength |
medium ,recommend smelling in a 10.00 % solution or less |
802 |
odor_descriptions |
at 100.00 %. sweet woody rose... |
7,620 |
第一個是建議(你應該稀釋到多少再聞),第二個是紀錄(評嗅者當時實際用了多少)。
兩者都有值的 797 支裡,750 支(94.1%)是同一個數字。
但其中一個只在需要稀釋時才存在
差別不在數值,在什麼時候會被填。
看兩欄的交叉表(列=評測時實際用的,欄=建議的):
| 實際 \ 建議 | 0.01% | 0.1% | 1% | 10% | 50% |
|---|---|---|---|---|---|
| 0.1% | 3 | 38 | 2 | 1 | 0 |
| 1% | 0 | 5 | 188 | 1 | 0 |
| 10% | 0 | 0 | 5 | 504 | 0 |
| 50% | 0 | 0 | 0 | 0 | 11 |
| 100% | 1 | 1 | 5 | 21 | 1 |
對角線很乾淨。但注意最後一列:評測時用 100% 的只有 29 支。
而 odor_descriptions 全庫有 7,620 支有評測濃度,其中大量是 100%。
odor_strength 這個欄位幾乎只在答案是「要稀釋」的時候才被填。
它有沒有值,比它寫什麼還有資訊量。
重算之後的用量階梯
我用做過三輪的名稱解析器把語料對回資料庫, 拿到 604 支在語料出現 ≥3 份、且有評測濃度的材料:
| 評測濃度 | 支數 | 用量中位數 |
|---|---|---|
| 100% | 377 | 2.50% |
| 10% | 151 | 1.00% |
| 1% | 65 | 0.86% |
| 0.1% | 6 | 0.85% |
100% 那一格是 2.50%,其餘三格全部擠在 0.85% 到 1.00% 之間。
相關係數:
| 樣本 | n | ρ |
|---|---|---|
| 全部 | 604 | +0.438 |
| 排除 100% 那組 | 227 | +0.114 |
| 只看 ≤10% | 225 | +0.121 |
拿掉一組,相關性就崩了。
所以那個欄位其實是個是非題
四個值(100%、10%、1%、0.1%)看起來像一個四級的階梯。 實際上它只回答一個問題:
這支材料可以直接聞,還是必須先稀釋?
可以直接聞的,用量中位數 2.50%。必須稀釋的,不管稀釋到 10%、1% 還是 0.1%, 用量中位數都在 0.85% 到 1.00% 之間。
稀釋倍數差一百倍,實際用量差 0.15 個百分點。
我在 #107 就注意到這件事的一半—— 當時我寫「評測濃度掉 100 倍,真實用量只掉 5.2 倍」。 這一輪的數字更極端:不是掉 5.2 倍,是幾乎不掉。
順帶修正我自己的一個數字
#107 我發表的相關係數是 ρ = 0.679。這一輪算出來是 0.438。
差別在樣本:
| #107 | 這一輪 | |
|---|---|---|
| 語料門檻 | 出現 ≥20 份 | 出現 ≥3 份 |
| 名稱比對 | name + head_synonym |
三輪累積的完整解析器 |
| 可比對的材料 | 117 | 604 |
兩個數字對各自的樣本都是對的,但 604 支那個比較可信。 117 支那組只收出現 20 份以上的材料,那本身就是一個偏向常用材料的篩選。
方向沒變(正相關、評測濃度愈高用量愈高),強度弱了三分之一。 而更重要的是:那個相關性幾乎全部來自一個二分,不是一個階梯。
這對你有什麼用
- 看到
at 100.00 %:這支可以直接聞,而且它在配方裡通常下得比較重(中位數 2.50%) - 看到任何低於 100% 的數字:先稀釋再聞,而用量從 1% 起跳試
- **不要從 1% 跟 10% 的差別推論用量。**那兩格的用量中位數差 0.14 個百分點
- **
odor_strength欄有沒有值本身就是訊號。**有值=這支需要稀釋
(2025 年 Wachowiak 等人在 J Neurosci 上就在講嗅覺研究用的濃度範圍跟自然界對不上(PMID 40044450); Cometto-Muñiz 與 Abraham 量過同系醇類的濃度—反應曲線(PMID 18950650)。 那些是鼻子的事。這裡談的是欄位怎麼填。)
這篇沒有建立的
- **604 支的門檻是「語料出現 ≥3 份」。**提高門檻樣本會變小、變成常用材料, 相關係數可能又往上跑——那正是 #107 發生的事。
- **0.1% 那一格只有 6 支。**別把 0.85% 當成穩定的估計。
- 我沒有處理「評測濃度也可能是編者隨手填的」這個可能。 我掃過規格範圍的整數端點, 但沒有對評測濃度做過同樣的檢查。
- 94.1% 相同是在 797 支上算的,那是兩欄都有值的交集,不是全庫。
- 「用量中位數」是語料的,不是市售產品的。
- **修正 #107 的數字不表示 #107 的結論錯了。**那篇的核心(評測濃度預測用量比強度階好) 在這個樣本上仍然成立——只是效果比我當時報的小,而且來源比我當時想的單純。