Rename FASTQ read identifiers using a custom prefix and sequential numbering
Rename Read IDs
Replaces original FASTQ read identifiers with new sequential IDs generated from a user-defined prefix while preserving the sequence and quality information.
.fastq,
.fq)
.fastq.gz,
.fq.gz)
@prefix_1,
@prefix_2,
etc.
Original
@NB551234:45:H7F2...
ATCGATCG
+
FFFFFFFF
↓
Prefix = sample_
@sample_1
ATCGATCG
+
FFFFFFFF
seqkit replace \
-p '.+' \
-r 'sample_{nr}' \
input.fastq.gz \
-o renamed.fastq.gz
awk '
BEGIN{i=1}
NR%4==1{
print "@sample_"i
i++
next
}
{print}
' input.fastq \
> renamed.fastq
zcat input.fastq.gz | \
awk '
BEGIN{i=1}
NR%4==1{
print "@sample_"i
i++
next
}
{print}
' | gzip \
> renamed.fastq.gz