星期一早上,共用資料夾裡躺著十四份逐字稿,合計超過十萬字。委託方問的是星期五能不能看到結論。下面是那五天的實際工作紀錄,包含走錯的一步。
要經過五個步驟:切段、貼標籤、歸併主題、找反例、寫成可驗證的洞察句。十四份左右的逐字稿,兩個人做,五個工作天可以完成。洞察句的定義是一句話,說明哪一群人在什麼情境下做了什麼事,以及原因。
這次的委託方是一家做中小企業記帳軟體的團隊。他們想知道,為什麼試用過的事務所有一大半沒有轉成付費。受訪者是十四位會計與記帳士事務所的負責人或資深助理,皆已去識別化。
第一天只做一件事,把逐字稿切成可以獨立閱讀的段落,放進試算表。一列一段,欄位有六個:受訪者代號、事務所規模、段落原文、所在題號、時間碼、備註。
切段的原則是一段只講一件事。受訪者一口氣講了三分鐘,裡面有抱怨匯入格式、有提到助理離職、有講報稅季加班,就切成三列。
這一天最容易犯的錯,是邊切邊畫重點。畫重點的人會不自覺挑出符合自己預期的句子。我們的規則是第一天不准用螢光筆,備註欄只能寫事實,例如「此處受訪者停頓很久」或「此段為追問後才回答」。
當天產出:一張約六百列的段落表。兩個人各切七份,下班前互相抽看二十列,確認切法一致。
開放編碼的意思,是在還沒有分類架構的情況下,替每一段貼上一個簡短標籤,描述這段在講什麼。標籤盡量用受訪者自己的詞。
例如有人說「我們助理看到要重新對科目就直接關掉了」。標籤寫成「重新對科目就放棄」,別寫成「導入門檻高」。前者保留了動作與情境,後者已經是分析者的解讀。
兩個人先各自編同樣的兩份逐字稿,再把標籤攤開比對。這一步叫校準。第一次比對,兩人的標籤只有一半左右對得上。對不上的地方逐條討論,寫成一頁編碼規則。規則有了,才分頭編剩下的十二份。
當天產出:約九十個不重複的標籤,以及一頁編碼規則。標籤太多是正常的,這天不必合併。
第三天把九十個標籤印成小紙條,鋪在桌上,把講同一件事的排在一起。這個做法叫親和圖,也就是用相近程度來分群。
上午我們分出了七群,其中最大一群是「價格」。看起來答案出來了,試用沒轉付費是因為貴。我們甚至開始寫結論的草稿。
下午回頭讀「價格」那一群底下的原文,才發現問題。二十幾段裡,真正在講金額的只有五段。其餘的段落講的是「不知道助理學不學得會,所以不敢先付一年」、「報稅季前不想換,怕出錯沒人負責」。這些話裡有錢這個字,講的卻是風險由誰承擔。
錯在我們用關鍵字分群,沒有用意思分群。於是把那一群拆開重排,最後變成三個主題:金額本身、學習成本的不確定、出錯責任歸屬。「金額本身」從最大群變成最小群。
當天產出:九個主題,每個主題底下列出對應標籤與段落數,還有一張紙記錄上午的錯誤分法。那張紙後來放進報告的方法附錄。
主題成形之後,最重要的工作是找反例。反例是指與主題方向相反的說法,或者完全沒提到這個主題的受訪者。
我們做了一張矩陣,橫列是十四位受訪者,直欄是九個主題。格子裡填三種記號:主動提到、追問後才提到、沒提到。
矩陣一出來,幾件事變得清楚。「出錯責任歸屬」有十位提到,其中八位是主動提到。「金額本身」只有四位提到,且三位是在我們問價格時才回答。另外,三人以下的小事務所幾乎都提到學習成本,十人以上的事務所則幾乎沒提。
當天產出:受訪者乘主題矩陣一張,反例清單一頁。
主題只是名詞,例如「出錯責任歸屬」。洞察句要寫成完整的句子,包含人、情境、行為、原因四個部分。
這次寫出的其中一句是:小型記帳事務所的負責人在報稅季前兩個月不會更換軟體,因為一旦資料轉換出錯,沒有任何一方承諾負責修正。
這句話可以驗證。委託方可以去查試用帳號的申請月份,看看報稅季前申請的帳號是否轉換得特別少。也可以對應到動作,例如在試用流程裡加上資料轉換的核對服務,或者調整推廣的月份。
每一句洞察底下,我們固定附三樣東西:支持的受訪者人數與代號、兩到三句原話、已知的反例。寫完之後請一位沒參與專案的同事讀,請他指出哪一句聽起來像常識。像常識的句子通常少了情境或原因,要退回去補。
當天產出:六句洞察、一頁限制說明、一份可回查的編碼表。
委託方後來最常翻的文件是那張矩陣,報告本文反而翻得少。原因是矩陣讓他們可以自己查:某個規模的事務所到底在意什麼。
星期五下午交出文件後,委託方用文字回了四個問題。這四個問題幾乎每個專案都會出現,值得記下來。
第一問:十四個人夠嗎?我們的回答是,這份資料夠用來決定下一步要驗證什麼,不夠用來估計比例。洞察句裡關於報稅季的那一條,可以直接用後台的申請月份去核對,那才是下一步。
第二問:為什麼價格只排在後面?客服明明常被問價格。我們把第三天上午的錯誤分法拿給他們看,說明提到錢的段落裡,多數在講風險。客服聽到的「太貴」也可能是同一件事的簡短說法。這一點我們標為待驗證,沒有寫成定論。
第三問:可以把逐字稿全部給我們嗎?依照訪談前對受訪者的說明,我們交付的是去識別化的編碼表與引述,原始錄音與含識別資訊的逐字稿不在交付範圍。
第四問:下次我們自己做,最少要保留哪些步驟?答案是三個:切段後雙人校準、分群後回讀原文、主題乘受訪者的矩陣。時間不夠的話,洞察句的局外人試讀可以縮短,前三個不能省。
另外補一個時間分配的觀察。五天裡花最久的是第二天的編碼,占了將近三分之一的工時。最值得花時間的卻是第三天下午的回讀。那半天如果省掉,報告的第一條結論就會是錯的,而且錯得很有說服力。
這套流程是為十到二十份的深度訪談設計的。訪談少於六份時,矩陣沒有意義,直接逐份寫摘要比較誠實。訪談超過四十份時,兩個人五天做不完,需要先抽樣編碼建立架構,再分批套用。
另外,如果訪談沒有錄音,只有訪談者的手寫筆記,就無法做逐段編碼。筆記已經過了一次篩選,分析時必須把它當成二手資料,並在報告裡寫明。
最後一點,十四位受訪者的結論只能說明這十四位。它適合用來形成假設、決定下一步要量什麼,不能直接推論整個市場的比例。