DNA / RNA 서열 도구

FASTA 정리 도구

지저분한 서열을 붙여넣으면 줄바꿈, 공백, 헤더 형식을 자동으로 정리해 깔끔한 FASTA로 만들어 줍니다. 헤더가 없는 서열에는 이름을 자동으로 붙이고, 중복된 헤더는 자동으로 구분해줍니다.

레코드: 0 총 서열 길이: 0 nt 제거된 문자: 0 이름 자동 생성: 0 중복 이름 수정: 0 빈 서열 제외: 0
🔒 모든 계산은 이 브라우저 안에서만 실행됩니다. 입력한 서열은 서버로 전송되거나 저장되지 않습니다.
광고 영역 (Google AdSense 승인 후 삽입 예정)

왜 FASTA 정리가 필요한가요?

논문, 데이터베이스, 시퀀서 소프트웨어 등 여러 출처에서 서열을 복사해 붙여넣다 보면, 줄바꿈 폭이 서로 다르거나, 서열 사이에 잔여 위치 번호·공백·탭이 섞여 있거나, 헤더가 아예 없거나 같은 이름이 중복되는 등 사소하지만 다음 분석 단계를 방해하는 문제가 자주 생깁니다. 이 도구는 이런 문제를 자동으로 찾아 정리한 뒤, 표준 형식의 FASTA로 다시 출력합니다.

이 도구가 자동으로 처리하는 것들

  • 서열 본문 정리: 공백, 탭, 숫자(위치 번호 등 잔여 문자), 인식되지 않는 기호를 서열 본문에서 제거합니다.
  • 헤더 없는 서열에 이름 부여: > 헤더가 없는 서열 블록에는 순번이 붙은 이름(예: sequence_1)을 자동으로 붙여줍니다.
  • 중복 헤더 자동 구분: 같은 이름의 헤더가 여러 번 나오면 _2, _3처럼 번호를 붙여 서로 구분되도록 정리합니다.
  • 빈 레코드 제외: 헤더만 있고 실제 서열이 없는 레코드는 결과에서 자동으로 제외합니다.

직접 선택할 수 있는 옵션

  • 줄바꿈 폭: 60/70/80/100자 중에서 선택하거나, 한 줄로 이어 붙일 수 있습니다. 60자는 가장 널리 쓰이는 표준 FASTA 관례입니다.
  • 대소문자: 모두 대문자, 모두 소문자, 또는 원본 그대로 유지할 수 있습니다.
  • 정렬 갭 문자(-) 유지: 서열 정렬(alignment) 결과를 붙여넣는 경우, 하이픈(-)을 삭제하지 않고 그대로 보존할 수 있습니다.
  • 헤더 공백을 밑줄로 치환: 헤더에 공백이 있으면 일부 프로그램에서 이름이 잘려 인식될 수 있어, 공백을 밑줄(_)로 바꿔 안전한 식별자로 만들 수 있습니다.

사용 방법

  1. 위 입력창에 정리하고 싶은 서열(FASTA·멀티 FASTA·헤더 없는 서열 모두 가능)을 붙여넣습니다.
  2. 줄바꿈 폭, 대소문자, 추가 옵션을 필요에 맞게 선택합니다.
  3. 결과 표에서 자동으로 이름이 붙었거나 중복이 수정된 레코드를 확인합니다.
  4. 정리된 FASTA를 복사하거나 파일로 다운로드합니다.

자주 묻는 질문

FASTA 정리 도구는 어떤 문제를 해결하나요?

여러 출처에서 복사한 서열은 줄바꿈 폭이 제각각이거나, 공백·탭·잔여 번호가 섞여 있거나, 헤더가 없거나 중복된 경우가 많습니다. 이 도구는 이런 문제를 자동으로 감지해 표준 FASTA 형식으로 정리합니다.

헤더가 없는 서열은 어떻게 처리되나요?

헤더(> 로 시작하는 줄)가 없는 서열 블록에는 자동으로 순번이 붙은 이름(예: sequence_1)이 부여되며, 결과 표에서 "이름 자동 생성" 배지로 표시됩니다.

정렬 서열의 갭 문자(-)도 유지할 수 있나요?

네. "정렬 갭 문자(-) 유지" 옵션을 켜면 서열 정렬(alignment) 결과에 포함된 하이픈(-)을 지우지 않고 그대로 보존합니다.

숫자나 공백이 섞인 서열도 정리할 수 있나요?

네. 서열 본문에 포함된 공백, 탭, 숫자(잔여 위치 번호 등) 등 알파벳이 아닌 문자는 자동으로 제거되며, 몇 글자가 제거되었는지 결과 화면에 표시됩니다.

입력한 서열이 서버로 전송되나요?

아니요. 모든 정리 작업은 자바스크립트로 브라우저 내부에서만 이루어지며 서버로 전송되거나 저장되지 않습니다.