關鍵字組合工具中的重複關鍵字組合來自兩個獨立來源:輸入清單中重複的行,以及不同配對串接成同一最終詞組時發生的碰撞。對兩個每行一項的清單進行完整的笛卡兒積運算,會同時暴露出這兩個問題,這就是為什麼乾淨的輸出很少會與原始輸入的數量一致。工具會依先出現的順序,移除每個清單內完全符合且區分大小寫的重複項目,然後在不同的配對碰撞產生相同結果時,保留最先產生的詞組,並在摘要面板中回報總計。了解重複出現的位置,可以避免產生失敗:當超過 10,000 個輸入配對的上限時,整個請求會在產生輸出之前就失敗,被截斷的輸出會因此消失,而不是在請求層級讓部分樣本仍然漏過。這種區別讓字串組合工具不會假裝自己是在做關鍵字研究,因為去重後的清單仍然只是一組候選集,必須經過人工檢查相關性、意圖和需求,才能用於任何廣告活動或發布工作流程。

how do i fix duplicate keyword combinations in keyword combiner
如何修復關鍵字組合工具中的重複關鍵字組合

關鍵字組合工具中的重複實際從何而來

最終輸出中的每個重複,都可以追溯到輸入與串接步驟扮演的兩個角色之一。第一個角色是來源編輯器本身。試算表、廣告群組匯出檔和爬取的建議清單中,常常會包含同一個詞被輸入兩次、貼上時帶有多餘的尾端空格,或是複製/貼上過程中只有部分列被轉為小寫的情況。第二個角色是串接步驟。一旦兩個清單交叉配對,若某對配對串接後的結果與先前已產生的某對相同,這就是碰撞,而不是輸入錯誤。一個簡單的例子是 `ab` 加上 `c` 對上 `a` 加上 `bc`:在沒有分隔符的情況下,兩對配對都會產生字面字串 `abc`,因此第二對就成為工具必須移除的碰撞。

空分隔符會讓碰撞遠比使用分隔符時更常見。使用連字號時,`ab-c` 和 `a-bc` 顯然不同;完全沒有分隔符時,`abc` 會產生兩次,於是其中一個會被刪除。較長的修飾詞也會提高碰撞率,因為配對之間會共用更多字母。在一整份不相關內部列的清單中重複使用同一個修飾詞,可能會在不知不覺中讓輸出量翻倍,卻不會讓有用的詞組數量跟著翻倍。

工具如何處理重複的輸入與碰撞的輸出

正規化在任何配對產生之前會依照固定順序執行。每個非空行會在外緣進行修剪,空行會被忽略,任何包含控制字元或 Unicode 行/段落分隔符的行會被刪除。每個詞最多可包含 100 個 Unicode 碼位。每個來源編輯器最多接受 100,000 個 UTF-16 碼位以及最多 500 個唯一詞。清單內的完全重複會在修剪後移除,同時保留第一次出現的項目。去除重複時區分大小寫,因此 `Shoe` 和 `shoe` 會被視為不同,因為它們可能是為了完全符合與詞組符合活動而刻意保留的變體。

清單完成正規化後,會在產生之前先計算配對數量。如果該數量超過 10,000,整個請求就會失敗,不會產生任何輸出。如果數量在上限之內,所選的迴圈順序會以確定性的方式執行,選擇的分隔符會插入兩個字串之間,最後的碰撞會依先出現的順序進行去重。內部空格、標點、腔調、表情符號和非拉丁文字在整個過程中都會原封不動保留。除了外緣空白和區分大小寫的重複檢查之外,不會再做任何正規化。

清理關鍵字組合工具中的重複組合

要得到一份乾淨的清單,最快的方法是先清理輸入,然後查看實際記錄工作內容的面板。將 關鍵字組合工具 當作確定性的笛卡兒積使用,並把底部的摘要列當作稽核軌跡。

  1. 開啟工具,在清單 A 中每行貼上一個基礎詞,在清單 B 中每行貼上一個修飾詞或第二個詞。
  2. 在頁面上逐一稽核每個清單:刪除任何帶有多餘前端或尾端空白的列、任何在修剪後與其他列重複的列,以及任何包含編輯器會拒絕的控制或段落分隔符的列。
  3. 判斷你需要空字串還是可見的分隔符。除非有特別理由將分隔符留空,否則選擇單一空格、連字號或加號。
  4. 選擇「先 A 再 B」或「先 B 再 A」的外層到內層迴圈順序。這個選擇會改變詞組順序,但不會改變配對數量,因此選擇最容易掃讀最終清單的順序即可。
  5. 執行組合動作,並讀取結果區塊底部的五個摘要數字。
  6. 將理論輸入配對數與唯一輸出數進行比較。如果差距比預期大,表示原因出在碰撞。
  7. 將唯一輸出數與摘要回報的輸入重複數進行比較。如果輸入重複數很大,在下一次執行前需要先修剪來源清單。
  8. 排序輸出,或將其貼入試算表,刪除任何沒有明確到達頁面、意圖或需求訊號的詞組。
  9. 按下複製按鈕,擷取完整的區塊,每行一個詞組,不包含省略號或取樣的尾段。

閱讀摘要面板以找出你遺漏的內容

結果底部的摘要區塊不是行銷頁尾,而是工具提供的唯一稽核軌跡。有五個數字很重要。唯一輸出數是輸入碰撞移除後的不同詞組數量。正規化後的清單大小,是清單 A 與清單 B 在修剪後、區分大小寫的唯一詞數量。理論輸入配對數,是移除任一類碰撞之前的 A 乘以原始 B。已移除的輸入重複數,是因為完全重複而被捨棄的來源列數量。已移除的輸出碰撞數,是因為先前配對已產生相同字串而被捨棄的產生詞組數量。

如果唯一輸出數意外偏大,在下一次執行前先縮減來源清單。如果唯一輸出數意外偏小,通常有兩件事同時成立:來源清單包含完全重複,而所選的分隔符正在把不同的配對折疊成相同的字串。這兩個問題會互相影響,而摘要數字會同時揭露這兩者。

工具中的硬性上限其限制範圍達到上限時會發生什麼
每個詞 100 個 Unicode 碼位修剪後清單 A 或清單 B 中的每一行較長的行會被整行拒絕,而非截斷
每個編輯器 100,000 個 UTF-16 碼位每個清單貼上的總文字量超出文字會在編輯器邊界被拒絕
每個清單 500 個區分大小寫的唯一詞來源去重後的不同列額外的唯一列不會被加入該清單
分隔符 20 個 Unicode 碼位插入 A 與 B 之間的字面字串較長的分隔符會驗證失敗;永遠不接受換行符和控制字元
10,000 個輸入配對任何輸出之前的理論 A 乘以 B整個請求在產生輸出之前就會失敗;不會產生部分結果

可降低雜訊的分隔符、順序與大小寫選擇

分隔符是控制碰撞頻率的最大單一因素,因為工具插入的就是該字面字串,不會有任何隱藏填補。單一字元的分隔符,例如空格、連字號或加號,幾乎不會產生意外碰撞,除非輸入本身包含相同的字元。空分隔符會把相鄰字母折疊在一起,讓更多配對變成相同的字串。如果輸入已經正規化,分隔符就可以很短。短分隔符還有另一個好處:能讓輸出在試算表欄位中易於閱讀,並讓詞組長度對廣告群組的關鍵字長度上限來說是可預期的。

大小寫比多數讀者預期的更重要。因為去重時區分大小寫,`Shoe` 和 `shoe` 是兩個不同的詞、兩個不同的輸入列,以及它們所參與之每個配對的兩個不同輸出詞組。這樣的行為是有意為之,因為 Google Ads 中的完全符合和詞組符合不區分大小寫,而廣泛符合修飾符和許多編輯分類法會在意大小寫。當你希望候選清單中同時包含兩種變體時,刻意使用這個特性;如果該特性並非刻意,則使用來源編輯器先轉為小寫。

工具會做的事你仍然需要做的事
依先出現的順序建立完整的 A × B 笛卡兒積挑選符合 10,000 個輸入配對上限的配對預算
移除清單內完全符合且區分大小寫的重複只有在大小寫變體並非刻意時,才將詞轉為小寫或進行正規化
依先出現的順序去除碰撞輸出的重複閱讀已移除的輸出碰撞數,了解被刪除的數量
修剪外緣空白並忽略空行在貼上之前移除控制字元和雜散的段落標記
回傳每行一個詞組,可作為單一區塊複製在使用清單前,移除不相關或不自然的詞組
完全在目前的瀏覽器分頁中執行,清單絕不會送到伺服器透過獨立來源驗證需求、意圖和到達頁面的契合度

在用於廣告活動前檢視輸出

去重後的輸出是候選清單,而不是完成的關鍵字策略。工具不會檢查搜尋量、競爭程度、每次點擊成本、意圖、語言、相關性或文法品質,也不會查詢廣告帳戶、搜尋引擎、關鍵字提供者或 AI 服務。某些組合聽起來會不自然、語意重疊,或沒有可衡量的需求。將每一行視為仍需要人工檢查的候選詞,並在適當情況下,搭配第一方或付費取得的關鍵字佐證,再將其投入預算。

確定性的輸出有助於該檢查步驟。因為順序是穩定的,重新執行相同的輸入會產生相同的文字,這表示固定的候選清單可以在單次編輯後與後續執行進行差異比對。這個特性讓該工具非常適合在草稿之間進行版本比較、內部分類法檢視,以及在任何詞組進入實際廣告活動或發布工作流程之前的廣告群組探索。

將工具視為文件

字串組合與關鍵字研究之間的區隔,正是讓輸出對其實際功能保持可信的原因。組合兩個清單是一種機械操作;決定哪些詞組值得出價或撰寫,則是判斷上的決定。請在工作流程中清楚維持這個界線。使用摘要數字作為被移除項目的紀錄,將輸出視為候選集,並在任何詞組進入廣告活動、簡報或已發布頁面之前,自行套用目標系統的規則。

若想深入了解,請參閱 iPhone 上的關鍵字密度檢查工具:Safari 工作流程。