廣告 A/B 測試在測真差異,還是同一張圖換色?Meta 素材疲勞的偽多樣陷阱
帳戶裡跑了十支素材,Meta 演算法眼中可能只看到一支。本文拆解 Andromeda 素材聚類機制與業界所稱的 Entity ID,說明為什麼換色、換一個字、換背景音樂做不出真正的多樣性,並提供自我檢查清單,分辨手上的 A/B 測試是真差異還是偽多樣。
上個月團隊裡有位同仁很得意地說,這檔活動準備了十支素材輪替,應該不會這麼快疲勞。結果兩週後成效還是掉了,他很困惑,明明準備了十支,怎麼跟只跑一支的帳戶疲勞得一樣快,預算也沒有比較省。我們把那十支素材調出來並排看,發現十支的主圖角度、文案語氣、開場三秒的畫面幾乎一模一樣,只有標題顏色跟一兩個用字不同。問題不在素材數量,在於這十支素材,在演算法眼中可能從頭到尾就只是同一支。

每支素材都有 Creative ID,但決定命運的是另一組編號
在 Meta 廣告管理員裡,你上傳的每一支素材都會拿到一個 Creative ID,這是廣告主看得到的編號。但業界普遍觀察到,Andromeda 背後還會替素材指派另一種分組依據,把語意與視覺上判定相近的素材歸成同一群,業界慣稱這群組的識別碼叫 Entity ID。另一份業界分析特別提醒,這個詞是產業內部用來描述這個分群行為的說法,不是 Meta 官方公開文件裡的正式名詞。部分業界分析工具與觀察提到廣告管理員裡有類似 Creative Similarity 的指標,用來估計同一個廣告組合裡的素材彼此有多相似,分數偏高時,通常代表這些素材被系統判定為相近概念,這項指標的官方文件說明目前公開資料有限,實際名稱與呈現方式建議以自己帳戶後台看到的為準。
換句話說,你複製一支廣告、換個標題、調整一下文案,會拿到一個全新的 Creative ID,但不一定會被歸進新的分組。只換顏色、換一句話、換背景音樂,在演算法眼中,很可能還是同一個概念。這也是為什麼帳戶裡明明列著十支素材,翻開 Creative Similarity 報表,卻可能發現八支都被系統判定為高度相似,實際上在系統眼中只是同一個概念換了外衣。
為什麼十支素材,最後只在打一支的仗

Andromeda 判斷素材是否相近,看的維度很廣,包括畫面構圖、色調、光線、版面配置、主體位置、背景元素、文字擺放,影片素材還會看運鏡與轉場節奏。業界的觀察是,只換標題顏色、抽換一個文案用詞、或調整背景音樂,系統掃過去仍然會判定是同一個概念,全部歸進同一個分組。
這件事的後果比想像中嚴重。業界觀察是,被歸進同一群的素材,很可能被系統視為相近候選,導致投遞探索與觸及的受眾高度重疊,實際進入競爭的,等於只有這一個概念,不是十支廣告分別在跑。一支的成效走弱,其餘同群素材通常也會跟著疲勞,因為它們從系統的角度看,本來就是相近的東西。這也接近開頭那個困惑的解釋,十支素材的帳戶跟一支素材的帳戶,疲勞速度接近,因為兩個帳戶在演算法眼中,能拿來投遞的獨立概念數量,可能相去不遠。
真正的多樣性,發生在格式、概念與語氣三個層次,而不是顏色與用字。一份業界分析建議至少同時跑四種不同格式,例如靜態圖片、短影音、輪播、素人風格影片,該分析觀察到維持格式多樣通常能讓素材壽命延長三成到五成才開始疲勞,這個幅度是單一業界來源的觀察,實際延長比例會因產業與帳戶而異,不是普遍保證的數字。比格式更關鍵的是概念,換一個鉤子開場,是疊代,換一整套敘事角度,才是真正的變化,一份素材庫如果看起來像同一場選角試鏡,只是同一個人換裝,那就不是真正的多樣性。
語氣是最常被忽略的第三個層次。同一個賣點,用理性說明的角度講一次,用情感故事的角度講一次,再用帶點幽默的角度講一次,這三支素材對演算法來說是三個不同的概念,對消費者來說也是三種不同的購買理由。只改標題語氣但敘事結構不變,通常還是會被判定為相近概念,格式、概念、語氣三層都要動,才算真正拉開差異。
這件事也牽動預算效率。廣告主常以為多上架幾支素材,就等於多買了幾份保險,實際上如果這些素材全部歸在同一個 Entity,預算分配的邏輯並沒有真正變多元,系統依然只是在同一個概念裡分配預算,看起來像分散風險,實際上風險完全沒有被分散。
判斷疲勞的兩個具體訊號
業界常用的判斷法則,是頻率超過 4.0,或是點擊率在兩週內下滑超過兩成,出現任一訊號,就該視為疲勞警訊,準備替換或補充素材,而不是等到成效明顯崩盤才動作。這兩個數字是業界慣用的經驗法則,不是 Meta 官方公告的硬性標準,實際門檻仍需依帳戶歷史數據校準,再行銷或高意圖窄受眾的帳戶,能容忍的頻率上限通常比冷受眾廣泛觸及的帳戶更高,同一套門檻不宜套用在所有受眾類型上。同一份框架也建議,與其等疲勞訊號出現才臨時趕工,不如平常就準備好一批已經測試過、隨時可以上架的備用素材,減少疲勞出現時的空窗期。
這裡也要提醒一件事,成效下滑不會只有素材疲勞一種原因,受眾飽和、促銷力道變化、商品季節性、落地頁體驗、競品出價變動,都可能造成類似的下滑曲線,素材檢查只是排查清單的其中一項,不是唯一該看的地方。
知道什麼時候該換素材之後,下一個問題是換什麼樣的素材才算數。
91APP CDMP 讓「換素材」有真正的方向
素材多樣性最容易踩的坑,是為了求數量而衍生,而不是為了對應不同受眾而設計。這正是 91APP CDMP 標籤資料能補上的地方。
不同 CDMP 標籤代表的受眾,本來就該用不同的敘事角度溝通,而不是同一支素材配上不同顏色。高 LIFT 值的第一方受眾,跟廣泛觸及的興趣受眾,該看到的素材角度本來就不一樣,前者可能更適合強調產品細節與專業信任感的敘事,後者可能更適合情境式、生活化的短影音。這種依受眾標籤設計出來的差異,更有機會形成消費者與系統都認得出來的多樣性,而不是表面上看起來不同、系統眼中還是同一支的素材。想了解 Andromeda 怎麼利用素材內容做個人化判斷,可以參考我們先前寫的 Andromeda 素材彈藥庫解讀,那篇談的是系統端怎麼看待素材,這篇談的是廣告主端該怎麼設計出真正有效的差異。素材疲勞這個議題,我們也在更早之前寫過操作層面的實戰做法,兩篇可以搭配著看。
自我檢查清單:你的素材庫是真多樣,還是偽多樣

- 把手上正在跑的素材列出來,先問每一支跟其他支比,換的是格式、概念或語氣,還是只換了顏色、一句話或背景音樂。
- 到廣告管理員查有沒有類似 Creative Similarity 的相似度指標,分數偏高的素材群組,實際上很可能是同一個概念在跑;如果帳戶看不到這類指標,改用人工並排檢查主視覺、開場三秒畫面、敘事角度是否真的不同。
- 檢查頻率是否超過 4.0,或點擊率在兩週內下滑超過兩成,任一訊號出現,代表該補真正不同的素材,而不是複製貼上調顏色。
- 盤點素材格式組合,至少同時涵蓋靜態圖片與短影音兩種以上格式,格式單一是最常見也最容易被忽略的偽多樣。
- 依 CDMP 受眾標籤反推素材角度,讓每個高價值受眾群都對應到專屬設計的敘事角度,而不是共用同一套素材換個顏色交差。
- 建立固定的素材產製節奏,例如每週穩定推出三到五支真正不同概念的新素材,而不是等疲勞訊號出現才臨時趕工,讓素材庫隨時保有備用產能。
十支素材不是十場仗,是不是同一場仗,系統比你先知道
那位同仁後來把十支素材重新分類,發現真正不同概念的只有兩組,其餘八支都只是同一個概念的變體。他沒有沮喪,反而覺得踏實,因為終於知道問題出在哪裡,不再是原地打轉猜測。
素材數量從來不是安全感的來源,概念的數量才是。你以為在打十場仗,系統可能只看到一場,這件事系統比你先知道。
常見問題
Q1:Creative ID 跟 Entity ID 有什麼不同? A1:Creative ID 是每支廣告在後台的個別編號,複製或調整素材都會產生新的 Creative ID。Entity ID 是業界描述 Andromeda 語意分組行為的說法,不是 Meta 官方名詞,代表系統判定為相近概念的素材群組,即使 Creative ID 不同,仍可能被歸進同一個 Entity。
Q2:後台有沒有工具可以查素材是不是被歸成同一群? A2:部分帳戶的廣告管理員裡會看到類似 Creative Similarity 的相似度指標,可以估計同一廣告組合裡素材彼此的相似程度,分數偏高代表系統很可能把它們判定為同一群概念;如果帳戶看不到這項指標,可以改用人工並排比對主視覺與敘事角度。
Q3:只是換顏色或換一句文案,真的完全沒有用嗎? A3:不是完全沒用,這類調整仍可能帶來局部的點擊率差異,但不足以構成演算法眼中的新概念,無法真正分散學習期與競爭曝光的風險,長期效果有限。
Q4:小預算帳戶,也需要準備四種格式的素材嗎? A4:可以視資源分階段做,優先確保至少有兩種明顯不同的格式,例如靜態圖片與短影音,再逐步往輪播、素人風格影片擴充,不必一次到位,但格式單一是最常被忽略的偽多樣風險。
Q5:頻率超過 4.0 或點擊率下滑兩成,這兩個數字是官方標準嗎? A5:不是,這是業界常用的經驗法則,用來提醒該檢視素材疲勞,實際門檻會因產業、受眾規模與素材類型而異,建議依自己帳戶的歷史數據校準出適合的警戒值。
Q6:判斷素材是不是偽多樣,需要工程資源嗎? A6:不需要,Creative Similarity 分數可以直接在廣告管理員查看;要依受眾標籤設計真正對應的素材角度,則需要品牌自己有一套整理過受眾輪廓的系統,例如顧客數據平台。