為什麼要正經地測
我們做過一個度假屋案子,同一個受眾、同一組設定、同樣預算,只換素材:最好的一組單次對話成本 NT$17,最差的超過 NT$100。
六倍的差距,而且所有其他變因都控制住了。
素材是廣告裡使用者唯一真正看到的東西。受眾設定得再精準,素材沒吸引力就是沒有點擊。
問題一:該測幾組
每輪 3~4 組。
少於 3 組,樣本不夠形成比較基準——兩組互比很容易被隨機波動誤導。
多於 4 組,預算會被切太碎,每組都跑不到有意義的樣本數。
如果你的預算很小(每月 3 萬以下),寧可每輪 3 組但輪次多,不要一次上八組。
問題二:怎麼控制變因
這是最多人做錯的地方。
一則廣告素材可以拆成四個獨立部分:
| 元素 | 作用 |
|---|---|
| 主視覺 | 讓人停止滑動 |
| 文案首行 | 讓人願意讀下去 |
| 文案主體 | 建立理解與信任 |
| 行動呼籲 | 促成點擊 |
每次測試只變動一個。
如果你同時換了圖和文案,跑出來 A 比 B 好,你不知道是圖的功勞還是文案的功勞。下一輪就無法累積。
正確的做法是一次固定三個、變動一個:
- 第一輪:文案全部一樣,測四張不同的圖
- 第二輪:用第一輪贏的圖,測四種不同的文案首行
- 第三輪:用前兩輪的組合,測不同的行動呼籲
聽起來慢,但每一輪的結論都是可以累積的。同時亂換的做法跑三個月,你手上還是零個可靠結論。
問題三:要跑多久
不是看天數,是看樣本數。
粗略的門檻:
| 轉換類型 | 每組最低樣本 |
|---|---|
| 點擊 | 300 次以上 |
| 訊息對話 | 30 次以上 |
| 名單 | 30 次以上 |
| 購買 | 30 次以上 |
沒到這個數字就下判斷,很可能是在解讀雜訊。
時間上至少要跑滿 4 天,因為週間和週末的行為差異很大。只跑週二到週四的結果,套用到週末可能完全不成立。
問題四:看什麼指標判斷
看單次轉換成本,不是點擊率。
我們看過某組素材的 CTR 是其他組的兩倍,加了預算之後發現它的轉換率是全帳戶最低——素材製造了錯誤的期待,點進去的人發現不是想的那樣就跳出。
這種素材不只沒效,還在花錢買失望。
判斷順序:
- 先看單次轉換成本 —— 這是結論
- 成本差不多的話,看轉換率 —— 誰的流量品質好
- 再看 CTR —— 只用來診斷,不用來下判斷
一個常見的誤區:贏家不會永遠贏
找到表現好的素材之後,很多人就把預算全壓上去然後放著。
問題是素材一定會疲乏。當同一個人重複看到太多次,成本就會開始上升。
判斷方式是看頻率:頻率持續上升、成本也跟著上升,就是該換了。
我們的做法是在成本開始上升之前準備好下一批,維持一個滾動的節奏,而不是等掉下來才趕工。
一個實際的排程
以每月 8 篇素材的產量為例:
| 週次 | 動作 |
|---|---|
| 第 1 週 | 上 4 組新素材,開始測試 |
| 第 2 週 | 判讀結果,關掉最差的 2 組,加碼最好的 |
| 第 3 週 | 用勝出素材為基礎,上 4 組變體 |
| 第 4 週 | 判讀,整理本月結論,規劃下月方向 |
重點是每個月結束時要有一句可以寫下來的結論。例如「情境圖優於商品平拍」「文案首行用問題比用數字好」。
這些結論累積起來,才是素材測試真正的產出。單次的成本高低反而是次要的。
重點整理
- 每輪 3~4 組,不要更少也不要更多
- 一次只變動一個元素,否則結論無法累積
- 看樣本數不看天數,至少跑滿 4 天
- 用單次轉換成本判斷,CTR 只拿來診斷
- 贏家會疲乏,提前準備下一批
- 每個月要留下一句可以寫下來的結論