市場調研

訪談逐字稿怎麼整理成洞察:一次五個工作天的編碼時間線復盤

星期一早上,共用資料夾裡躺著十四份逐字稿,合計超過十萬字。委託方問的是星期五能不能看到結論。下面是那五天的實際工作紀錄,包含走錯的一步。

訪談逐字稿要經過哪些步驟才會變成洞察

要經過五個步驟:切段、貼標籤、歸併主題、找反例、寫成可驗證的洞察句。十四份左右的逐字稿,兩個人做,五個工作天可以完成。洞察句的定義是一句話,說明哪一群人在什麼情境下做了什麼事,以及原因。

這次的委託方是一家做中小企業記帳軟體的團隊。他們想知道,為什麼試用過的事務所有一大半沒有轉成付費。受訪者是十四位會計與記帳士事務所的負責人或資深助理,皆已去識別化。

第一天:先切段並建立欄位,暫時不下任何結論

第一天只做一件事,把逐字稿切成可以獨立閱讀的段落,放進試算表。一列一段,欄位有六個:受訪者代號、事務所規模、段落原文、所在題號、時間碼、備註。

切段的原則是一段只講一件事。受訪者一口氣講了三分鐘,裡面有抱怨匯入格式、有提到助理離職、有講報稅季加班,就切成三列。

這一天最容易犯的錯,是邊切邊畫重點。畫重點的人會不自覺挑出符合自己預期的句子。我們的規則是第一天不准用螢光筆,備註欄只能寫事實,例如「此處受訪者停頓很久」或「此段為追問後才回答」。

當天產出:一張約六百列的段落表。兩個人各切七份,下班前互相抽看二十列,確認切法一致。

第二天:開放編碼,用受訪者的字眼貼標籤

開放編碼的意思,是在還沒有分類架構的情況下,替每一段貼上一個簡短標籤,描述這段在講什麼。標籤盡量用受訪者自己的詞。

例如有人說「我們助理看到要重新對科目就直接關掉了」。標籤寫成「重新對科目就放棄」,別寫成「導入門檻高」。前者保留了動作與情境,後者已經是分析者的解讀。

兩個人先各自編同樣的兩份逐字稿,再把標籤攤開比對。這一步叫校準。第一次比對,兩人的標籤只有一半左右對得上。對不上的地方逐條討論,寫成一頁編碼規則。規則有了,才分頭編剩下的十二份。

當天產出:約九十個不重複的標籤,以及一頁編碼規則。標籤太多是正常的,這天不必合併。

第三天:歸併主題,這一天我們走錯了一步

第三天把九十個標籤印成小紙條,鋪在桌上,把講同一件事的排在一起。這個做法叫親和圖,也就是用相近程度來分群。

上午我們分出了七群,其中最大一群是「價格」。看起來答案出來了,試用沒轉付費是因為貴。我們甚至開始寫結論的草稿。

下午回頭讀「價格」那一群底下的原文,才發現問題。二十幾段裡,真正在講金額的只有五段。其餘的段落講的是「不知道助理學不學得會,所以不敢先付一年」、「報稅季前不想換,怕出錯沒人負責」。這些話裡有錢這個字,講的卻是風險由誰承擔。

錯在我們用關鍵字分群,沒有用意思分群。於是把那一群拆開重排,最後變成三個主題:金額本身、學習成本的不確定、出錯責任歸屬。「金額本身」從最大群變成最小群。

當天產出:九個主題,每個主題底下列出對應標籤與段落數,還有一張紙記錄上午的錯誤分法。那張紙後來放進報告的方法附錄。

第四天:替每個主題找反例,再做受訪者乘主題的矩陣

主題成形之後,最重要的工作是找反例。反例是指與主題方向相反的說法,或者完全沒提到這個主題的受訪者。

我們做了一張矩陣,橫列是十四位受訪者,直欄是九個主題。格子裡填三種記號:主動提到、追問後才提到、沒提到。

矩陣一出來,幾件事變得清楚。「出錯責任歸屬」有十位提到,其中八位是主動提到。「金額本身」只有四位提到,且三位是在我們問價格時才回答。另外,三人以下的小事務所幾乎都提到學習成本,十人以上的事務所則幾乎沒提。

  • 只有一兩位提到的主題,保留在附錄,不寫進主結論
  • 追問才出現的主題,在報告裡標明是引導後的回答
  • 某個主題只集中在特定規模的受訪者,就寫成分群結論,不寫成整體結論
  • 有受訪者明確說出相反意見時,把原話放在該主題旁邊

當天產出:受訪者乘主題矩陣一張,反例清單一頁。

第五天:把主題改寫成洞察句與可以做的事

主題只是名詞,例如「出錯責任歸屬」。洞察句要寫成完整的句子,包含人、情境、行為、原因四個部分。

這次寫出的其中一句是:小型記帳事務所的負責人在報稅季前兩個月不會更換軟體,因為一旦資料轉換出錯,沒有任何一方承諾負責修正。

這句話可以驗證。委託方可以去查試用帳號的申請月份,看看報稅季前申請的帳號是否轉換得特別少。也可以對應到動作,例如在試用流程裡加上資料轉換的核對服務,或者調整推廣的月份。

每一句洞察底下,我們固定附三樣東西:支持的受訪者人數與代號、兩到三句原話、已知的反例。寫完之後請一位沒參與專案的同事讀,請他指出哪一句聽起來像常識。像常識的句子通常少了情境或原因,要退回去補。

當天產出:六句洞察、一頁限制說明、一份可回查的編碼表。

五天下來,哪些做法值得留下來

  1. 第一天禁止畫重點,延後判斷可以減少先入為主
  2. 先雙人校準再分頭編碼,規則寫成一頁紙
  3. 分群後一定回讀原文,確認是照意思分而非照關鍵字分
  4. 用矩陣看主題的分布,主動提到與追問提到要分開記
  5. 洞察句交給局外人試讀,像常識的就退回
  6. 走錯的那一步寫進方法附錄,讓讀者知道結論改過

委託方後來最常翻的文件是那張矩陣,報告本文反而翻得少。原因是矩陣讓他們可以自己查:某個規模的事務所到底在意什麼。

交付時委託方實際追問了哪些問題

星期五下午交出文件後,委託方用文字回了四個問題。這四個問題幾乎每個專案都會出現,值得記下來。

第一問:十四個人夠嗎?我們的回答是,這份資料夠用來決定下一步要驗證什麼,不夠用來估計比例。洞察句裡關於報稅季的那一條,可以直接用後台的申請月份去核對,那才是下一步。

第二問:為什麼價格只排在後面?客服明明常被問價格。我們把第三天上午的錯誤分法拿給他們看,說明提到錢的段落裡,多數在講風險。客服聽到的「太貴」也可能是同一件事的簡短說法。這一點我們標為待驗證,沒有寫成定論。

第三問:可以把逐字稿全部給我們嗎?依照訪談前對受訪者的說明,我們交付的是去識別化的編碼表與引述,原始錄音與含識別資訊的逐字稿不在交付範圍。

第四問:下次我們自己做,最少要保留哪些步驟?答案是三個:切段後雙人校準、分群後回讀原文、主題乘受訪者的矩陣。時間不夠的話,洞察句的局外人試讀可以縮短,前三個不能省。

另外補一個時間分配的觀察。五天裡花最久的是第二天的編碼,占了將近三分之一的工時。最值得花時間的卻是第三天下午的回讀。那半天如果省掉,報告的第一條結論就會是錯的,而且錯得很有說服力。

這套五天流程不適用於哪些專案

這套流程是為十到二十份的深度訪談設計的。訪談少於六份時,矩陣沒有意義,直接逐份寫摘要比較誠實。訪談超過四十份時,兩個人五天做不完,需要先抽樣編碼建立架構,再分批套用。

另外,如果訪談沒有錄音,只有訪談者的手寫筆記,就無法做逐段編碼。筆記已經過了一次篩選,分析時必須把它當成二手資料,並在報告裡寫明。

最後一點,十四位受訪者的結論只能說明這十四位。它適合用來形成假設、決定下一步要量什麼,不能直接推論整個市場的比例。

← 回到新知列表