跳至主要內容
Lizely

從文字擷取數字

依明確規則從貼上的文字中取出每個數字,處理正負號、小數和千分位分隔符,並即時顯示總和、數量、最小、最大與平均。

隱私權:你的檔案不會離開裝置,所有處理均在瀏覽器本機完成。

使用方式

  1. 1.貼上含有要擷取數字的文字。
  2. 2.依需要調整正負號、千分位分隔、科學記號與去重規則。
  3. 3.選擇清單或統計輸出、查看找到的數量,再複製結果。

關於從文字擷取數字

從文字擷取數字工具會從自由文字中找出 ASCII 0–9 組成的數字 token,並依需要保留相連正負號、小數、格式正確的千分位分組與科學記號。可選擇每行一個、以逗號分隔或統計輸出;統計包含數量、總和、最小值、最大值與平均值。輸入、解析、去重、計算與複製全部在瀏覽器本機完成。

這個工具使用公開且有界的數字語法,而不是猜測自然語言。- 或 + 只有在文字開頭、ASCII 空白、(、=、: 或 , 之後,且緊接有效數字時才被視為相連符號;因此 5-3 會得到 5 和 3,而 x=-3 會得到 -3。小數點只有在後方有 ASCII 數字時才會併入;數字嵌在 abc123def 中仍會擷取 123。全形與 Arabic-Indic 數字不在本工具範圍內。

開啟千分位分組時,1,000 形式必須以 1 至 3 位前導群組開始,後接精確三位群組;1,00、1,0000 與 1234,567 等格式會在錯誤位置切開。科學記號開關可識別 1e5 形式及可選指數正負號。去重開關僅對擷取後的精確文字值保留第一次出現;關閉時會保留重複項目及其權重。

統計採用 JavaScript IEEE-754 double-precision,因此數量是精確的,但部分小數加總可能顯示浮點餘數,例如 0.1 + 0.2 會成為 0.30000000000000004;超過約 1.8e308 的值會標為超出雙精度範圍,而不會假裝是有限數字。工具不解析數字單字、貨幣格式、日期、分數、羅馬數字、單位、任意 locale 的分隔符或數學語意;需要財務、稅務或高精度運算時應使用適當工具並人工核對。

方法與來源

以單次掃描搭配明確數字語法處理相連符號、小數、格式正確的千分位分組與可選科學記號;套用已說明的符號相連規則,並以雙精度計算統計值及在頁面揭露其限制。

常見問題

5-3 會被視為一個數字還是兩個?
是兩個:5 和 3。只有真正相連、位於行首、空白後或開括號後的負號才會保留,避免把算式誤讀為負數。
1,000,000 是一個數字還是三個?
開啟千分位分隔且格式正確時是一個。格式錯誤的分組會在錯誤位置拆開;關閉該選項時則擷取字面數字串。
為什麼總和有時出現很小的小數殘值?
統計使用標準雙精度浮點數,某些小數和會在精度邊界產生餘數。數量仍然精確,頁面會明確顯示這項限制。

文字工具 使用指南

查看全部