텍스트에서 숫자 추출

지저분한 소스 무엇이든 붙여넣으세요, 청구서, 스크랩한 제품 페이지, 채팅 로그, 주석이 섞인 CSV, 그 안의 모든 숫자를 깔끔한 목록으로 돌려받습니다. 정수, 소수, 음수, 통화 형식 수치를 한 번의 정규식 패스로 인식합니다. 출력은 중복이 제거되고 한 줄에 숫자 하나씩이라, 스프레드시트, 계산기, 통계 도구에 바로 넣을 수 있습니다.

텍스트에서 숫자를 뽑는 방법

  1. 1

    소스 붙여넣기

    아무리 지저분해도 텍스트를 넣으세요: 주변 단어와 문장 부호는 무시됩니다.

  2. 2

    정밀도 선택

    "소수 포함"을 켜면 `3.14`를 잡고, 끄면 `42` 같은 정수만 추출합니다.

  3. 3

    추출기 실행

    모든 일치 항목을 뽑고, 고유한 값을 유지하며, 발견된 서로 다른 숫자의 개수를 알려줍니다.

  4. 4

    목록 복사

    한 줄에 숫자 하나씩이라 Excel, Numbers 또는 열 기반 도구에 바로 붙여 넣을 수 있습니다.

매처가 인식하는 것

사용되는 정규식은 소수가 켜져 있으면 /-?\d+(?:\.\d+)?/이고, 아니면 /-?\d+/입니다. 로케일의 모호함에 빠지지 않으면서 흔한 숫자 형태를 포괄합니다.

추출된 값의 예시

입력 추출됨 (소수 켜짐)
세후 합계: 1299.99 1299.99
기온이 -4.5C까지 하락 -4.5
버전 2.1.3 오늘 출시 2.1, 3
번호: 001, 042, 1007 001, 042, 1007
점수: 87% 합격 87

처리하지 않는 것

  • 천 단위 구분자. 1,234.561234.56으로 추출됩니다. 전체 숫자가 필요하면 먼저 구분자를 정리하세요.
  • 유럽식 소수 쉼표. 3,14314로 읽힙니다. 추출 전에 쉼표를 점으로 바꾸세요.
  • 과학적 표기. 6.02e236.0223을 반환합니다. 지수 형식이 필요하면 원시 소스를 직접 파싱하세요.
  • 분수. 1/20.5가 아니라 12가 됩니다.

유용한 후속 작업

  • 목록을 통계 도구에 넣어 평균, 중앙값, 표준편차를 구하세요.
  • sort | uniq로 정렬하고 중복을 제거해 로그의 고유 값을 찾으세요.
  • 두 추출 결과를 나란히 비교해 청구서에서 빠진 항목을 찾으세요.

자주 묻는 질문

무시하고 숫자 부분만 반환합니다. $1,299.99는 쉼표가 천 단위 구분자로 취급되지 않으므로 1299.99가 됩니다. 1299.99를 한 덩어리로 원하면 소스에서 쉼표를 제거하세요.

정규식이 숫자 시퀀스를 문자 그대로 잡으므로 007007로 남습니다. 숫자가 산술 값이 아니라 실제로 ID, 부품 코드, 우편번호일 때 중요합니다.

기본적으로 중복은 제거되어 깔끔한 고유 목록을 얻습니다. 순서를 보존한 원시 스트림이 필요하면 대신 소스를 grep 스타일 파이프라인에 통과시키세요.

텍스트는 요청 내에서 처리되고 응답 후에는 저장되지 않습니다. 입력은 어디에도 남지 않습니다.

관련 도구

이 도구는 다른 언어로도 제공됩니다