Filter short sequences

filterShortSeqs is a small program written in C++ which filters DNA sequences from an input FASTA file if there are any other 100% identical, but longer sequences present in the FASTA file. The sequences are dereplicated initially, and the relative order of the sequences in the input file are preserved in the output file. Multithreaded using OpenMP.

Credit to Nick Green for creating it for use in AutoTax.

Requirements

cmake
make
A C++ compiler
probably others...

Compilation

Run cmake CMakeLists.txt and then make. Compiles into a single binary filterShortSeqs in the current folder.

Usage

$ ./filterShortSeqs 
missing input file
missing output file
usage: filterShortSeqs <input_file> <output_file> <threads>

Name		Name	Last commit message	Last commit date
Latest commit History 37 Commits
.github/workflows		.github/workflows
include		include
.gitignore		.gitignore
CMakeLists.txt		CMakeLists.txt
README.md		README.md
main.cpp		main.cpp

Provide feedback

Saved searches

Use saved searches to filter your results more quickly

Repository files navigation

Filter short sequences

Requirements

Compilation

Usage

About

Uh oh!

Releases 1

Packages

Uh oh!

Contributors

Uh oh!

Languages

Folders and files

Latest commit

History

Repository files navigation

Filter short sequences

Requirements

Compilation

Usage

About

Resources

Uh oh!

Stars

Watchers

Forks

Releases 1

Packages 0

Uh oh!

Contributors

Uh oh!

Languages

Packages