為 VOSviewer 專案合併關鍵字的意思是,產生一個單一且去重複的詞組清單,讓這個文獻計量工具可以將其讀取為乾淨的共現輸入。VOSviewer 以完全相同的字串來分組詞彙,因此任何拼寫變化、大小寫或詞序改動都會在地圖上呈現為不同的節點。一個能把所有變體解析成單一標準詞組的前置合併步驟,能讓集群更緊密、標籤更易閱讀。由於 VOSviewer 內建了一個可讀取外部文字檔的同義詞字典,最簡單的實務工作流程就是在應用程式外部準備該同義詞字典,或是準備底層的關鍵字檔本身。Keyword Combiner 是一個本機字串合併工具,能以確定性的順序產生兩個清單的完整笛卡兒積,這使得它非常適合用來建立變體清單,之後再進行整編、編輯與匯入。在瀏覽器中執行合併可以讓原始清單不離開本地端,而確定性的輸出也容易在反覆調整搜尋詞時與較早的草稿進行差異比對。

how to merge keywords in vosviewer
使用笛卡兒積合併 VOSviewer 的關鍵字

在 VOSviewer 工作流程中,合併關鍵字的實際意義

VOSviewer 在繪製共現網路時,會把每個關鍵字視為完全相同的字串。兩個即使只差一個字元、大小寫或連字號的詞組,都會成為不同的節點,這會使集群破碎,並迫使審稿者在事後以視覺方式將其合併。實用的變通方法是在檔案匯入前先標準化關鍵字清單,讓 VOSviewer 為每個概念只看到一個標準化的詞元。

實務上有兩種常見的模式。第一種是提供 VOSviewer 一個單一的關鍵字檔,其中一個概念的所有變體都已被改寫為單一的標準形式。第二種是匯入原始檔案,並依賴 VOSviewer 自身的同義詞字典檔,該檔案會讀取純文字規則集並在匯入時改寫字串。這兩種模式都需要一組標準詞彙和一組變體;兩者基本上都是在管線不同階段執行的合併操作。

笛卡兒積工具並不會取代上述任何一種模式,但它能產生這些模式所需的系統化候選集合。一旦基準清單與修飾清單之間的每一對組合都攤在你面前,你就能修剪掉明顯的雜訊,並把保留下來的內容改寫為 VOSviewer 所預期的標準形式。少了這個步驟,審稿者往往只記得明顯的組合而忽略交叉搭配,這些遺漏之後就會以孤兒節點的形式出現在 VOSviewer 地圖上。

為何笛卡兒積是這個步驟的正確形狀

關鍵字合併通常會結合一個固定維度與一個變動維度:一邊是服務、產品或研究領域,另一邊是地區、形容詞、年份或方法論。產出是一個小型的二維網格,而填滿這個網格最安全的方式就是笛卡兒積,亦即把 A 清單中的每一個項目與 B 清單中的每一個項目配對,且不遺漏任何一對。

遺漏配對正好是多數手動合併最常見的失敗模式。先在本地端執行一次完整的配對,即使人類稍後刪除其中許多項目,也能保證每一對至少都曾在紙面上存在過。驅動數學上笛卡兒積的同一套邏輯,正是讓 VOSviewer 輸入保持完整的原因:網格無論每個儲存格是否有用都會存在,而你審核的對象就是這個網格。

作為快速的健全性檢查,三個顏色與兩個產品名稱配對會產生六個輸入配對。這是任何同義詞字典改寫的最低可用規模,也是你在基列表稍大時,給 VOSviewer 輸入所會使用的相同形狀。

使用 Keyword Combiner 建立合併後的清單

Keyword Combiner 會在目前的瀏覽器分頁中執行,並以確定性的順序產生兩個已貼上清單之間的所有配對。整個步驟都是在本地端完成:不會上傳任何內容,而且輸出會在按下複製按鈕後,以單一區塊的形式產生。

  1. 在 A 清單中每行貼上一個基準詞,在 B 清單中每行貼上一個修飾詞或第二個詞。只有在需要視覺區隔時才在項目之間留一個空白行;空白行在處理時會被忽略。
  2. 決定 A 應該出現在 B 之前,還是 B 應該出現在 A 之前,然後輸入應位於兩者之間的確切分隔符號。分隔符號可以是空格、連字號、加號、空字串,或是任何其他最多 20 個 Unicode 碼位的短字面字串。
  3. 按下合併動作。工具會先計算 A × B 的配對數,如果超過 10,000 個輸入配對就會拒絕整個請求,因此絕不會產生部分輸出。
  4. 閱讀摘要面板。它會回報正規化後的清單大小、理論上的輸入配對數、被移除的輸入重複項、被移除的輸出衝突項,以及獨特的輸出數量。
  5. 開啟預覽,刪除任何不屬於你的同義詞字典或關鍵字檔的候選詞組。剩下的每一行就是你想要的合併結果。
  6. 按下複製控制項,將「一行一個、不重複」的區塊匯出到試算表、同義詞字典草稿,或稍後要匯入 VOSviewer 的內容簡報中。

由於迴圈順序是穩定的,從「先 A 後 B」切換到「先 B 後 A」會以可預測的方式同時改變詞組與列出順序,這使得審稿時容易將兩個草稿互相進行差異比對。

決定是否讓所有配對通過的限制

有幾項上限會互相影響,因此即使只有其中一項被超出,請求仍可能失敗。事先理解這些限制,才能避免合併過程在不知情的情況下悄悄丟掉你預期該看到的列。

限制數值超過時的影響
輸入配對預算10,000在任何輸出產生之前,整個請求就會失敗;不會回傳部分結果。
每個清單的唯一詞數500超過前 500 個唯一詞彙的行會被排除在笛卡兒積之外。
編輯器文字大小100,000 個 UTF-16 碼元一旦編輯器緩衝區已滿,將無法再加入新貼上的內容。
每個詞彙的長度100 個 Unicode 碼位較長的詞彙會以單一行的形式被拒絕;清單的其餘部分仍會繼續執行。
分隔符號長度20 個 Unicode 碼位較長的分隔符號會被拒絕,而且合併動作將不會啟動。

配對預算是在輸出去重複之前計算的,因此即使是一個有許多相同串接結果的清單,也不可能悄悄超過這個上限。如果你的清單比預期更大,請在合併前先加以縮減,而不是指望靠衝突自動把它們修剪回去。去重複是區分大小寫的,這代表 Shoe 與 shoe 仍然是不同的項目,因為它們可能是刻意保留的變體;這個特性會被維持,而不是被攤平。

從複製的清單到可供 VOSviewer 使用的輸入

複製的區塊是純文字,每行一個詞組,且沒有標題列。兩條後續路徑都能由同一個匯出結果支援。

如果你打算依賴 VOSviewer 內建的同義詞字典,請將變體區塊貼到純文字編輯器中,並在格式要求的位置加入標準詞彙作為額外的欄位或箭頭標記,然後以 .txt 副檔名儲存。VOSviewer 的說明文件描述了其同義詞字典檔的精確版面配置;Keyword Combiner 並不會刻意去理解那種格式,因此對應步驟需要由你自行撰寫。

如果你打算直接餵入一個單一的關鍵字檔,請在試算表或文字編輯器中編輯合併後的區塊,並將每個變體改寫為標準詞組。內部空格、標點、腔調符號、表情符號以及非拉丁字母腳本在合併步驟中都會被保留下來,因此預覽中看到的內容,正是檔案匯入時 VOSviewer 將讀取的內容。

無論走哪一條路徑,輸出在本質上都是一個候選清單。有些詞組聽起來會不自然,有些會涉及政策敏感,有些在語意上會重疊。合併步驟保證的是覆蓋率而非品質,而相關性、登陸頁契合度與需求驗證都屬於人工審查步驟的範疇。

Keyword Combiner 與 VOSviewer 同義詞字典檔的比較

這兩種方法是互補而非競爭的。下表總結了它們在真實 VOSviewer 管線中各自的用武之地。

面向Keyword CombinerVOSviewer 同義詞字典檔
執行位置本地瀏覽器分頁;無需上傳VOSviewer 內部,於匯入期間執行
主要任務產生兩個清單之間的所有配對於匯入時將變體改寫為標準形式
輸出形狀每行一個詞組,可直接複製由 VOSviewer 讀取的純文字規則集
確定性在相同的執行之間保持穩定穩定,但只有在檔案撰寫完成後才成立
不做的事情不進行數量、意圖、語言或同義詞的擴展不進行數量、意圖或同義詞的擴展
發揮所長的時機在改寫之前建立候選網格於 VOSviewer 匯入步驟中進行最終的字串清理

搭配使用時,合併器負責建立候選集合,而同義詞字典檔則套用改寫規則,這是在不離開瀏覽器的情況下,字串組合工具所能達到的最接近 VOSviewer 原生合併的方式。兩個工具刻意保持範圍精簡:它們負責塑造輸入,而由你來決定哪些值得匯入。

想進一步了解,請參閱 本機草稿的關鍵字密度檢查器替代方案