X 軸位置在散佈圖產生器中並不是等距的 — 每個 x 值會依其在資料集中與最小和最大 x 之間的數值距離,按比例擺放,採用線性刻度。在 x 值為 1、2 和 10 的散佈圖上,1 和 2 之間的間距大約佔整個圖表水平寬度的九分之一,而 2 和 10 之間的間距則佔其餘的八分之九。相同的規則也獨立地套用於 y 軸。這就是真正的散佈圖呈現兩個連續數值變數的方式:兩點之間的視覺距離反映的是其底層數值的差異,而不是類別清單中的欄位索引。如果您需要等距的 x 位置,因為您的 x 標籤是類別而非數字,那麼您實際上需要的是另一種圖表類型 — 每個標籤一條長條的長條圖 — 而非散佈圖。對於成對的數值觀察,線性間距正是一項讓您無需額外計算就能一眼看出群聚、空隙和離群值的特性。

為何散佈圖中的 X 位置不是等距的
在解讀任何散佈圖之前,數值軸與類別軸之間的區別是最重要的一件事。數值軸將 x 值視為實數線上的連續測量值;類別軸則將其視為具名欄位中的標籤,例如「一月」、「二月」和「三月」,每個標籤因為彼此之間沒有數值距離,而獲得完全相同的水平寬度。
散佈圖一律使用數值軸。當您輸入 x 值為 2.1、5.4 和 9.0 時,圖表會計算一個與每個數字在最小和最大 x 之間位置成正比的水準擺放。相差 0.5 的兩個 x 值,其顯示的水平距離大約是相差 10 的兩個 x 值的二十分之一。如果您來自一個資料列恰好均勻編號的表格,可能會以為圖上的點是等距的 — 但圖表顯示的是數字,而不是資料列索引。
對於來自像素座標、感測器時間戳記,或任何 x 值為整數計數來源的資料,視覺位置乍看之下可能像是均勻分布。實際上並非如此。它們會依據底層的數值進行縮放,這正是這個工具能讓您一眼看出群聚和漂移的原因。如果您需要解讀整數位置可能會誤導您判斷間距的像素型資料,將影像資料轉換為散佈圖的指南以具體範例展示了相同的實際運作規則。
線性縮放公式如何擺放每個點
擺放規則分為兩個獨立的部分:一個用於 x,一個用於 y。對於水平軸,輸入中最小的 x 值對應到繪圖區域的左邊緣,最大的 x 值對應到右邊緣。其他每個 x 則擺在跨過該範圍的 (x − min) ÷ (max − min) 比例位置。垂直軸使用相同的公式,但方向顛倒,使得較大的 y 值在圖表上位置較高。
考慮一個最小的 x 為 2.0、最大 x 為 5.0 的小型資料集。x = 3.5 的點會位於 (3.5 − 2.0) ÷ (5.0 − 2.0) = 1.5 ÷ 3.0 = 0.5 的位置 — 也就是圖表的正中央。x = 4.0 的點會位於 (4.0 − 2.0) ÷ (5.0 − 2.0) = 2.0 ÷ 3.0 ≈ 0.67,大約三分之二的位置。x = 2.0 本身的點正好位於左邊界,而 x = 5.0 的點正好位於右邊界。
座標在產生 SVG 時會四捨五入到小數點後三位,因此 x 值之間非常小的差異在預覽中可能會塌縮成同一個水平像素。這是檔案的呈現瑕疵,並非底層資料的變更。對於任何需要完整數值精度的分析,請務必保留您的原始資料列。
如何在散佈圖產生器中驗證間距
以下是最短的路徑,從貼上的數字到一張您可以用視覺驗證 x 間距的圖表。
- 在瀏覽器中開啟散佈圖產生器,並為圖表輸入一個描述性標題。
- 每個非空行貼上一組嚴格的 x,y 數值對。每行必須恰好包含兩個以逗號分隔的數字 — 接受帶正負號的值、小數、零和科學記號。
- 點擊「Generate」(產生),並讀取摘要面板中的三個計數:有效點數、無效資料列數,以及超過上限的資料列數。它們一律分別報告,即使其中一個為零也是如此。
- 檢查頁面上的預覽。讀取圖表底部沿線的五個參考標籤(這些是顯示的 x 範圍),以及左邊緣的五個(顯示的 y 範圍)。
- 比較兩個點之間的水平間距與其 x 值的數值差異。如果視覺間距符合其數值差距的比例,則線性刻度的運作符合預期。
- 如果您想要日後可開啟或分享的向量檔,請下載獨立的 SVG。下載使用的 SVG 字串與預覽相同,採用百分比編碼,因此檔案與螢幕上所見完全一致。
讀取座標軸標籤與參考線
圖表會繪製五條垂直格線和五條水平格線,每一條上都有一個數值標籤。這些並非任意刻度,而是各軸顯示的範圍,均勻分布於繪圖值之間。由於兩個軸各自獨立,您可以讓 x 範圍從 0 跑到 50,同時 y 範圍從 −200 跑到 800,格線會以各自的刻度反映各自的範圍。
有一個細節常讓新使用者感到意外:座標軸並不會自動包含零。如果您的 x 值是 45 和 47,則 x 軸會從 45 跑到 47,即使零是有效的數字。參考線會落在 45.0、45.5、46.0、46.5 和 47.0。因此,圖表最左邊的任何一點就是 x = 45,而不是零;靠近中間的點大約是 46,而不是 23。在解讀群聚的表面位置或分布範圍之前,請務必先讀取標籤。
| 軸元素 | 所顯示的內容 |
|---|---|
| 最小值標籤(邊緣) | 該軸上顯示的最小值 |
| 最大值標籤(邊緣) | 該軸上顯示的最大值 |
| 中間三個標籤 | 介於最小與最大之間均勻分布的參考值 |
| 格線 | 五條垂直與五條水平,每個標籤對應一條 |
| 零點穿越 | 僅在 0 落在顯示的最小與最大之間時出現 |
當常數軸打破規則時
有一種情況無法直接套用線性公式:當某個軸上的每個值都相同時。最小值和最大值會相等,分母會為零,所有點都會塌縮到同一個座標。
散佈圖產生器會以該常數為中心,對受影響的軸做對稱擴展。如果每個 x 值都是 5,x 範圍會變成 4 到 6(若常數較大,則會擴展得更寬)。擴展幅度為該常數絕對值的百分之十或一個單位,以較大者為準,因此常數 100 會擴展為 90 到 110,而常數 0.1 則會擴展為 −0.9 到 1.1。相同的規則也獨立適用於常數 y 軸。
實際效果是單一有效點會出現在兩個軸的正中央,而非讓圖表產生錯誤。一個僅有 y 變化、x 不變的垂直點堆疊會沿著同一個 x 座標排成一列,但仍然可見並具有標籤。在假設顯示的座標軸範圍就是您的實際資料範圍之前,請先檢查是否有任何資料列被判定為無效或計入超過上限 — 這些資料列因為根本未被解析,自然不會對最小值與最大值產生貢獻。
本工具不會為您計算的事項
散佈圖是一種視覺化,而非統計引擎。散佈圖產生器不會計算相關係數、擬合迴歸線、繪製誤差棒、估計密度、識別群聚,或報告 p 值。圖表僅將每組輸入的配對擺放在兩條線性軸上,並將結果呈現為獨立的 SVG。
對於密集資料、類別顏色、可存取的逐點標籤、對數刻度、出版排版,或正式的統計分析,請使用專用的繪圖套件,例如 matplotlib、ggplot 或類似的程式庫。請攜帶您的原始資料集 — 圖表會將顯示用的座標四捨五入到小數點後三位,而 SVG 僅供視覺檢視,並非保留精度的格式。頁面上的預覽與下載的檔案使用相同的百分比編碼資料 URI,源自單一產生的字串,遵循 W3C 的 SVG 2 規範,因此視覺輸出與檔案完全一致。
重疊的點也可能會彼此遮蔽,特別是當輸入中有重複的 (x, y) 配對時。本工具不會抖動、錯開或堆疊重複項。如果您有兩個點共用相同的座標,第二個點會直接疊在第一個點下方,在預覽中您只會看到一個圓圈。請保留原始資料列,以便自行找出重複項,並在將圖表視為輸入的完整呈現之前,先驗證三個資料列計數。
如果您正在權衡各種選項,長條圖產生器範例:從樣本資料到 SVG 的逐步說明對此有詳細介紹。