新手調香師 · 8
評測筆記該寫什麼:為什麼「好聞」不是資料
· 8 分鐘
同一個氣味,換一張標籤,喜好評分就會反過來 —— 所以「好聞」記錄的是當下的你,不是那支原料。這篇用兩份研究加上 5,824 支原料的描述詞分析,說明什麼樣的描述會穩定、幾個詞才分得出一支原料,以及一份半年後還讀得懂的紀錄長什麼樣子。
半年後翻開自己的評測筆記,看到這一行:
3/12 廣藿香 不錯,有點甜,蠻好聞的
這行字沒有任何用處。稀釋到幾 %?聞到第幾分鐘?跟什麼比?今天新到的這批貨還是不是同一個東西?它一題都答不了。它真正記下來的只有一件事:你三月十二號那天的心情。
寫得少只是表面。真正的毛病是,你寫下的那個東西打從一開始就不穩定。
「好聞」為什麼不是資料
2001 年 Herz 與 von Clef 在《Perception》做了一個很簡單的實驗。他們挑了五個氣味來源不那麼固定、可以有不同解讀空間的味道:紫羅蘭葉、廣藿香、松油、薄荷腦,以及異戊酸與丁酸 1:1 的混合物。
受試者分兩次聞,中間隔一週。同一個氣味,兩次給的文字標籤不同,一次正面、一次負面,然後在幾個喜好量表上評分。
結果:標籤顯著影響了對氣味的知覺。作者主張,那些因為換標籤而使知覺整個反轉的案例,是嗅覺錯覺的首批實證。
想一下這有多嚴重。刺激完全沒變:同一瓶、同一個濃度、同一個人。變的只有旁邊那幾個字,喜好評分就翻面了。
所以當你在筆記上寫「好聞」,你記錄的不是那支原料的性質,是你當下的解讀。半年後你的解讀變了,那行字也就跟著作廢。
這裡可以直接抄一條守則回家:評測時把標籤蓋掉。你知道自己在聞什麼的時候,聞到的就有一部分是你以為它應該是什麼。
什麼樣的描述會穩定
那什麼是穩定的?
1982 年 Dravnieks 在《Science》發表的結果回答了這個問題。十個化合物,約 150 位受試者,每個人從一份 146 個描述詞的固定清單裡描述。重複測得的側寫高度相關(P < .001),一致地高於不同氣味之間的相關,也與先前取得的結果吻合。
結論:由許多人的反應加總而成的描述側寫,是穩定的構念。
穩定來自兩件事,固定的詞表,加上重複。你一個人沒有 150 位受試者,但這兩樣裡你能複製的其實有一件半:
- 固定詞表:完全可以照做。真要挑一句話帶走,就是這句。
- 重複:150 人湊不出來,可是同一支原料換幾天再聞、看自己的描述漂不漂,這你做得到。
自由書寫的散文做不到。「有點甜、蠻好聞的」跟三個月後寫下的「溫暖、圓潤」是同一個感覺嗎?答不出來,因為兩次用的座標系不一樣。固定詞表的意義就是把座標系釘死。
我們資料裡的描述詞
我們取 5,824 支同時有香調描述與供貨資訊的原料,把香調詞拆開來看。
先講一個我們自己也去查證過的數字。 這 5,824 支原料的香調欄位裡,
good、nice、pleasant、unpleasant、beautiful、delicious⋯⋯這類評價詞出現了幾次?0 次。 一次都沒有。為了確認這不是我們斷詞方式造成的假象,我們直接在未經處理的原始字串上再查一次,結果一樣是 0。
整個產業的描述詞彙裡,沒有「好聞」這個欄位。也很合理:專業詞彙記錄的是氣味本身的性質,評價者的反應就留給評價者自己。
這 5,824 支總共用到 557 個不同的描述詞,其中只出現過一次的僅 41 個(7%),前 50 個詞就涵蓋了 62% 的詞次。這是一份收斂的、事實上受控的詞表,跟 Dravnieks 那份清單是同一回事。
幾個詞才分得出一支原料
假設你只寫下一個詞,它能把 5,824 支縮小到什麼程度?
我們取至少有 3 個描述詞的 4,438 支原料,用它自己最常見的那幾個詞去反查,也就是最不利的情況:
| 你寫下的描述詞數 | 符合的原料還剩幾支(中位數) |
|---|---|
| 1 個 | 1,333 支 |
| 2 個 | 223 支 |
| 3 個 | 23 支 |
| 4 個 | 4 支 |
一個詞幾乎什麼都沒篩掉:green 佔 23.1%、sweet 22.9%、fruity 22.6%。但三個詞就能把 5,824 縮到 23 支,四個詞縮到 4 支。
所以筆記上該寫的是三到五個詞,一句形容起不了作用。這跟認真與否無關,純粹是要到第三個詞,資訊才真的開始進來。
但只有描述詞還不夠
接下來這個反向的發現,得照實寫出來。
我們一開始算出「26.5% 的原料,完整描述詞組合和另一支一模一樣」,看起來很有力。但先查了一下:最大的一組是 27 支原料共用同一組詞,而那組詞只有一個字,floral。
所以那 26.5% 很可能只是描述得太少造成的假象,未必表示原料真的分不開。分層來看:
| 至少幾個描述詞 | 完整組合與他人重複的比例 |
|---|---|
| 1 個以上(n=5,824) | 26.5% |
| 2 個以上(n=5,201) | 19.0% |
| 3 個以上(n=4,438) | 13.4% |
| 4 個以上(n=3,685) | 11.4% |
| 5 個以上(n=2,904) | 11.1% |
確實有一部分是假象,26.5% 掉到了 11%。但它在第 4 個詞之後就打平了(11.4% → 11.1%)。剩下的這 11% 跟寫得細不細已經無關,那是描述詞這個工具本身的上限。
而在這些「描述詞完全相同」的組別裡,只有 29% 可以靠強度或持久度分開(強度與持久度本身也只有約三分之一的原料有記錄,所以 29% 是下限)。
所以光記錄「聞起來像什麼」還不夠,你得連自己做了什麼一起記下來。
一份半年後還讀得懂的紀錄
把上面三件事合起來 —— 標籤會扭曲知覺、固定詞表才穩定、描述詞需要條件才完整 —— 一則有用的紀錄至少要有這些欄位:
做了什麼:
- 日期
- 原料名 + 供應商 + 批號(同一個名字不同批貨會不一樣;這一欄最容易漏,也是事後最想要的)
- 濃度與溶劑(例:10% in DPG)
- 載體與用量(試香紙沾一下就好,不浸泡)
聞到什麼:
- 時間點:0 / 15 分鐘 / 1 小時 / 4 小時 / 24 小時
- 每個時間點寫 3 到 5 個描述詞,而且只能從你自己的固定詞表裡選
- 強度 1–5
當時的條件(Herz 證明了情境會改變知覺):
- 上一支聞的是什麼
- 這是今天的第幾支
- 有沒有蓋掉標籤
最後,用途一句話:
- ✗「很好聞,喜歡」
- ○「乾淨的木質底,可以撐住柑橘的尾巴」
這一欄就是把「好聞」轉成資料的方法:與其寫喜不喜歡,寫下它可以拿來做什麼。喜好半年後會變,用途不會。
關於你自己的固定詞表
從 30 到 50 個詞開始就夠了,涵蓋你會用到的家族就好。規則只有兩條:
- 只用表上的詞。想不到適合的詞時,那個「想不到」本身就是資訊。記下來,別臨時造一個。
- 加新詞要慎重,而且要回頭補。每加一個詞就是改一次座標系;不回頭把舊紀錄對齊,新舊資料從此不能比。
聽起來很僵硬,但 Dravnieks 那 146 個詞做的正是這件事。自由書寫寫起來舒服,可惜舒服的代價是沒辦法拿來比較。
三個常見錯誤
一、只在覺得特別的時候才記。這會讓紀錄只剩極端值。我自己早期的本子就是這樣,翻回去只有驚豔和災難兩種,中間那些「還好而已」的全是空白,偏偏比較基準就藏在那裡。
二、寫得太長。一段一百字的散文,半年後跟一句「不錯」一樣難用,你認不出哪幾個字是關鍵。三到五個固定詞加一句用途,好用得多。
三、只記第一印象。上一篇談嗅覺疲勞時提過,這裡再說一次:只寫 0 分鐘的紀錄,答不了「它撐不撐得住」。至少留 1 小時與 24 小時兩個點,決定一支原料在配方裡位置的,是那兩筆資料。
記錄的目的是讓半年後的你能和今天的你比較。那需要一個兩邊都認得的座標系。固定詞表就是那個座標系,「好聞」則永遠進不了那張表。
參考文獻
A. Dravnieks, Odor quality: semantically generated multidimensional profiles are stable, Science, 218(4574), 799–801 (1982). PMID 7134974
R. S. Herz & J. von Clef, The influence of verbal labeling on the perception of odors: evidence for olfactory illusions?, Perception, 30(3), 381–391 (2001). PMID 11374206
下一篇會談批次:為什麼同一個名字、同一家供應商的天然原料每批都不一樣,天然與合成的差別到底在哪,以及這對你剛開始建立的那份紀錄意味著什麼。