十二場訪談,每場一小時,逐字稿疊起來超過兩百頁。客戶要的是一頁結論。中間那段路怎麼走,很少有人寫下來。這篇照日期順序,復盤一次實際的整理過程,包含走錯的兩天。
做法分四步:把逐字稿切成一句一意的片段,每個片段一列;為每列標上受訪者代碼與主題編碼;用樞紐功能轉成受訪者對主題的矩陣;最後在矩陣每一格寫一句摘要並附原話。整個過程用免費試算表就能完成。十二場訪談,一個人大約需要十個工作天。
逐字稿,是把訪談錄音逐字轉成的文字。編碼,是為每一段話貼上主題標籤的動作。以下復盤的專案,是為一家準備進入新市場的企業,訪談十二位潛在客戶端的決策者與使用者。所有細節已去識別化。
第一天沒有讀任何一份逐字稿。做了三件事。為十二位受訪者編代碼,代碼包含角色類別與序號。把真實姓名與代碼的對照表存在另一個受限的檔案。把十二份逐字稿的檔名統一成代碼加訪談日期。
接著檢查逐字稿品質。抽每份的三個段落對照錄音。有兩份的專有名詞被轉錯,當天修正。這一步如果跳過,後面編碼時會不斷回頭聽錄音。訪談的錄音、逐字稿與個人資料的保存,需取得受訪者同意並依當地法規處理,相關要求應交由當地持牌專業人士確認。
在試算表建立主表,一個片段一列。欄位有八個:片段編號、受訪者代碼、角色類別、對應的訪綱題號、原話、主題編碼、次編碼、整理者備註。
原話欄只放受訪者說的話,不放訪談者的提問。提問的內容由題號欄代表。整理者的任何解讀,一律寫在備註欄。原話與解讀分開,是這張表最重要的一條規則。
原本的做法是一個回答切成一列。做完兩份之後發現不行。受訪者的一段回答裡,常常同時講到預算、時程與內部阻力。一列只能貼一個主題編碼,其他的就被吃掉了。
第四天重做。改成一句一意,一個片段只講一件事。一段回答可能切成三到五列。列數變成原本的三倍多,但每一列都乾淨。重做花了大半天。這是整個專案第一個該早點想到的地方。
切片段的判斷標準只有一條:這一列能不能只用一個標籤描述。不能,就再切。
依訪綱的結構,先列出十個主題編碼。每個編碼寫三樣東西:名稱、一句定義、一個屬於它的例句與一個不屬於它的例句。
不屬於的例句最有用。例如採購流程與決策者這兩個編碼很容易混。寫明談到誰簽核歸決策者,談到要經過幾關歸採購流程。之後標記時遇到猶豫,回來看這兩個例句就能決定。
拿三份角色不同的逐字稿試標。過程中新增了三個編碼,合併了兩個,最後是十一個。新增的都是訪綱沒問、但受訪者主動提起的事,例如前一次導入失敗的經驗。
試標結束,編碼表凍結。凍結的意思是,之後不再新增主題編碼,新的發現只能記在次編碼或備註。不凍結的話,第十份逐字稿的標準會跟第一份不同,比較就失去基礎。凍結後,回頭用定版把前三份重新標一遍。
這兩天的工作單調。每份逐字稿大約兩個小時。第二次走錯發生在第七天下午。為了求快,開始在主題編碼欄填縮寫,而且沒有設下拉選單。到了晚上,同一個編碼出現了三種寫法。
第八天早上先花一個小時補上資料驗證,把編碼欄鎖成下拉選單,並統一既有的寫法。這件事應該在第二天建表時就做。
標記期間,另外請一位同事獨立標記其中一份。兩人的結果逐列比對,不一致的地方大約集中在兩個編碼的邊界。討論之後修改了那兩個編碼的定義文字,沒有新增編碼。這個雙人比對,是整個流程裡唯一的品質檢查,不能省。
用樞紐功能,列放主題編碼,欄放受訪者代碼,值放片段數。一張十一乘十二的矩陣就出來了。哪些主題每個人都談、哪些主題只有某一類角色談,一眼可見。
但片段數只說明談了多少,不說明談了什麼。所以另外手動做第二張矩陣。同樣的列與欄,每一格寫一句話摘要該受訪者對該主題的立場,並附上最有代表性的那一個片段編號。空格就留空,不推測。
第二張矩陣才是交付的核心。它讓客戶可以橫著讀,看同一個主題下十二個人的說法。也可以直著讀,看一位受訪者的完整輪廓。
通過檢查的發現,才寫進一頁結論。每條發現的寫法固定:幾位提到、屬於哪些角色、一句原話、一句我們的解讀。解讀與事實分兩句寫。
會議上客戶最常問的是,這句話是誰說的。有片段編號,三十秒內就能翻到原話與上下文。這是整張表存在的理由。
復盤時回頭看片段表的八個欄位,使用頻率差很多。最常被用到的是片段編號與角色類別。片段編號讓每一句結論都能連回原話。角色類別讓我們能分開看決策者與使用者的說法,這個區分後來成為報告的主要結構。
次編碼一開始覺得可有可無,後來很有用。主題編碼凍結之後,新的觀察沒有地方放。次編碼成了緩衝區。例如在預算這個主題下,次編碼分出了年度預算已編列、需要另案申請、由其他部門出三種情況。這個細分沒有動到主題編碼表,卻讓矩陣裡的摘要寫得更準。
整理者備註欄則要節制。前幾份逐字稿,備註寫得很長,等於在片段表裡寫分析。後來改成只記兩種事:語氣線索,例如受訪者在這裡停頓很久;以及疑問,例如這句話與他前面說的矛盾。分析留到矩陣完成之後再做。
第三項的影響最大。編碼定義的模糊之處,一個人標的時候感覺不到。兩個人各標一次,差異馬上浮現。越早發現,要回頭重標的列數越少。
十個工作天裡,切片段與標記佔了大約六天。這是純粹的勞力工作,沒有捷徑。有人會想用自動化工具代勞。我們的看法是,工具可以協助初步切分與建議標籤,但每一列仍然要由人讀過確認。
原因有兩個。訪談資料常包含受訪者的身分線索與未公開的商業資訊,貼進外部工具之前,要先確認該工具如何處理輸入的內容,以及是否符合當初對受訪者的承諾。另外,逐列閱讀的過程本身就是分析。整理者是在這六天裡,慢慢看出哪些說法反覆出現。跳過閱讀,直接看矩陣,會錯過那些沒有被編碼表接住的東西。
剩下的四天,一天準備,一天訂編碼表,一天做矩陣,一天檢查與寫結論。寫結論只用了半天。前面的結構做得夠紮實,結論幾乎是從矩陣裡自己浮出來的。
十二場訪談不能代表整個市場。這套方法產出的是有憑據的假設,以及哪些問題值得用更大的樣本去驗證。報告中不該出現百分比,也不該寫成多數客戶認為。
如果訪談的目的只是為了探索方向,場次在三四場以內,不需要做到片段表與矩陣。每場寫一頁摘要,並排著讀就夠了。
場次達到數十場以上、有多位整理者同時作業時,試算表會變得難以管理,編碼一致性的檢查也需要更正式的做法。那種規模應該改用專門的質性分析流程,並安排訓練過的研究人員。