Sequence of DPV Thosea asigna virus
Thosea asigna virus RNA-dependent RNA polymerase (RdRp) gene, complete cds; and capsid protein gene, partial cds.
ACC No: AF282930
Dated: 2004-07-27 | Length: 3858 | CRC: 1931079411
ID AF282930; SV 1; linear; genomic RNA; STD; VRL; 3858 BP.
XX
AC AF282930;
XX
DT 27-JUL-2004 (Rel. 80, Created)
DT 27-JUL-2004 (Rel. 80, Last updated, Version 1)
XX
DE Thosea asigna virus RNA-dependent RNA polymerase (RdRp) gene, complete cds;
DE and capsid protein gene, partial cds.
XX
KW .
XX
OS Thosea asigna virus
OC Viruses; ssRNA positive-strand viruses, no DNA stage; Tetraviridae;
OC Betatetravirus.
XX
RN [1]
RP 1-3858
RX DOI; 10.1016/S0022-2836(02)01033-1.
RX PUBMED; 12421558.
RA Gorbalenya A.E., Pringle F.M., Zeddam J.L., Luke B.T., Cameron C.E.,
RA Kalmakoff J., Hanzlik T.N., Gordon K.H., Ward V.K.;
RT "The palm subdomain-based active site is internally permuted in viral
RT RNA-dependent RNA polymerases of an ancient lineage";
RL J. Mol. Biol. 324(1):47-62(2002).
XX
RN [2]
RP 1-3858
RA Pringle F.M., Kalmakoff J., Ward V.K.;
RT ;
RL Submitted (27-JUN-2000) to the INSDC.
RL Microbiology, University of Otago, 700 Cumberland Street (PO Box 56),
RL Dunedin, Otago 9001, New Zealand
XX
FH Key Location/Qualifiers
FH
FT source 1. .3858
FT /organism="Thosea asigna virus"
FT /mol_type="genomic RNA"
FT /db_xref="taxon:83810"
FT gene 85. .3858
FT /gene="RdRp"
FT CDS 85. .3858
FT /codon_start=1
FT /gene="RdRp"
FT /product="RNA-dependent RNA polymerase"
FT /db_xref="GOA:Q6A562"
FT /db_xref="UniProtKB/TrEMBL:Q6A562"
FT /protein_id="AAQ14329.1"
FT /translation="MEASNPVIAPTRLSLEAMLAERAMVARQDLAGLKRKLAGADRVLA
FT PQSPEQCGRESAQAQARSVTSELKSAVKEAQGLEHQTLDFLEQLGEYPVCGILHGDHPV
FT HPSGTHNNNGKVSVKRQFAAGVNTSDALTCAFRFEDSDLVRETALKTTYTDGTWAGFVQ
FT RLKMQTTRKCVQEKVSRKLLKQLFPYDPQKLVDVSGELSELVLGIKTNAIASAGPPYWR
FT TKRDALPDMLDCVLPLLYDHIVRKDLTTLRNKHPELFLAECKNKTDRYEVESLGEKTRP
FT YFSHPFHLSALVSVLSQSFSGALKIMTEDSTSFNAYGFSWTNGGAEDLAIWARQAGEAG
FT KKPPRIACYGDDTDIYYRKDGKLYRICPDFKQMDGSVDATTIEAVVDYVVDAHVKQYPT
FT ARQFWEEVGKLWVEMATQSPFLIDGTKVYRKMQKDGLMTGVVGTTLFDTVKSALAYNDW
FT ADQLMFGSLNLLEEKYAIEFFKNKHGLVIKEGTWKPALVNEDPGFGELWTEQKFLGLQL
FT KVVRRENEKVYVPNLPFEDWLTMWVTPRSKYRSKETETMRERTLFDRARGLLVTGAVFD
FT ERARGLMGAVINSTAPEVVCMRVQEGGGRGAPPAYAFLTRDGVFEFPISDGYPSYDWVV
FT SLYSRDHPCDMPRVFPEAATLIASYRKQVMDTRVVIKEEGVSYLMEAHPQGTTLSMEMP
FT AEAVVLSQPSGSCPKVREFTYAERVTTGTGSLVVEKVDKVPDSATVMENIIKKFMDDVS
FT KQIKELAEGQKSLEARITGAALPAEHFRKKMGDIDIKRTADKAALFTHEESGDLYVTTN
FT PVLGHPDSFESQKRVAQVHEVVSKISTVARKERVAAEPVHDTGEYVKIEGPPPGGVPAH
FT IPEGVALWHALCQSVNKACYQVTTKTETLKDSNGRPIVRAHIYQRSMRPVPQNWQKWMV
FT ASGRNLARAKELAVEYLMELVNKEQYKLPLTSTSDWAKDAELEELIQLKDRGRHVFSLI
FT GERFERVNPHLATKHHLNDRGDLLMWQPDNGTFITVAPPRRTRKGAKTRTLASTVKTLV
FT RIDPGLQVEVSGKPFEGVPVPEKLNFEVTTNDSAFENEIVNEPESVGTEFKEFENREAF
FT RFHEVVRGPGAAGSSPGEFDQMPRVQQLPSDGTRAVELGARDDSGGRASPRVDQGGAGV
FT PSVPPAPGRYAPELREPDRRVVQLEGQVHALQAQIQALTGASPPKPWGKGRGQGKSSNM
FT RGRGGKSRPHHGGRPGPRGGWWSQQGNQNRSW"
FT misc_feature 271. .813
FT /gene="RdRp"
FT /note="Region: methyltransferase domain"
FT misc_feature 754. .1089
FT /gene="RdRp"
FT /note="Region: GDD box"
FT CDS 3320. .>3858
FT /codon_start=1
FT /product="capsid protein"
FT /db_xref="UniProtKB/TrEMBL:Q6A561"
FT /protein_id="AAQ14330.1"
FT /translation="MIVLLKMRLSMNQRVLEQNLKNLKIGKPLGFMRSSGGQEQLVAAL
FT ANLIKCPVCNSSLRTEHEPSSWGRGTIQEVEQALEWIKEELECLVCPQLQEDTLLSFEN
FT PTEGSSNLKDKSMPFRPRSRRLRGPRPQNLGVRAEGRGSLLTCGDVEENPGPTTVAGLV
FT QEAVGGLNKATKTAPG"
XX
SQ Sequence 3858 BP; 984 A; 849 C; 1115 G; 906 T; 4 other;
af282930 Length: 3858 27-JUL-2004 Type: N Check: 1398 ..
1 tcttcgttta gagggggtgt aacgttcgct tatctttaac ccagtttttt
51 atctccccca ctgaactcaa gttgatttgt aaatatggaa gccagtaatc
101 ctgttatcgc ccccacgcgt ttgagcttgg aagccatgtt ggctgagaga
151 gccatggtgg cgcggcaaga tttggccggc cttaaaagaa aacttgcagg
201 agcagacaga gtyttagcgc ctcagtctcc agaacaatgt gggagggaaa
251 gcgctcaggc tcaggctcgc agtgtgacgt cggagctaaa gagcgctgtt
301 aaagaggccc agggtctaga acatcagacc ctggattttc tggagcaatt
351 aggagagtat cccgtgtgtg gaattttaca cggggaccat ccagtgcacc
401 cctctggcac ccacaataat aatggaaagg tgagtgtcaa gaggcagttt
451 gcggcgggtg tgaacacctc cgacgcgctg acgtgtgctt ttcgttttga
501 agatagtgat ctcgtccgtg aaacagcgtt gaagacgact tacacggacg
551 ggacgtgggc cgggtttgtt cagaggctaa agatgcaaac aacccgaaag
601 tgtgttcaag agaaagtcag ccggaaactt ttaaaacagt tgtttcccta
651 tgaccctcag aagctggtgg atgtctccgg cgagttgtcg gagctcgtgc
701 ttggtattaa aaccaatgcr attgcatcgg cgggtccccc ttattggcgc
751 acgaaacgtg atgcgctacc cgatatgctt gattgcgtgt tgcccctttt
801 gtatgatcat attgtgagga aagatcttac tactctgcgg aataaacacc
851 cagagctttt ccttgctgag tgtaaaaaca agaccgatag gtatgaggtg
901 gagagtttgg gcgagaaaac tcgcccttat ttctctcacc cctttcacct
951 ttctgctctt gtttctgtgc tttcccagag tttctccggt gcgttaaaga
1001 taatgacgga ggactcaacc tcgttcaacg cttatggttt tagttggacc
1051 aatggcggag ctgaggattt ggcgatatgg gccagacagg ccggagaggc
1101 gggaaagaag cctccccgta ttgcctgtta tggggatgac acagacattt
1151 attatcgaaa ggacggaaaa ctttatagga tctgtcctga tttcaaacaa
1201 atggacggca gcgtagacgc caccacaatt gaggctgtgg tggattatgt
1251 ggtcgacgcc catgttaaac agtacccaac tgctcgccag ttttgggagg
1301 aggttgggaa gctgtgggtt gagatggcca cacaatcccc ctttttgatt
1351 gatgggacta aagtttatcg gaaaatgcag aaggacggtt tgatgactgg
1401 ggtggtgggg accaccctgt ttgataccgt caaaagtgca ttggcctata
1451 atgattgggc cgaccagtta atgtttgggt ccctgaacct tctcgaggag
1501 aagtatgcca tagagttctt taagaacaag catggccttg tgattaagga
1551 aggtacttgg aaacccgcac tggtcaatga ggaccctggg tttggggagt
1601 tgtggaccga acagaagttc ctaggtcttc aacttaaagt tgttaggcgt
1651 gagaatgaga aggtgtatgt ccccaatctg ccttttgagg attggttaac
1701 tatgtgggtg accccccgct ctaagtatag gagtaaggaa acggaaacta
1751 tgcgagagcg gactctgttt gatagagctc gggggctcct tgtgaccggg
1801 gcggtctttg atgagagagc ccgtggtctt atgggagctg tgatcaactc
1851 aactgccccg gaggtggttt gcatgagagt tcaggaaggg ggaggacgtg
1901 gtgctccccc tgcttatgca ttccttaccc gggacggggt gtttgagttc
1951 ccaatatctg atgggtaccc aagttatgac tgggttgtaa gtttgtatag
2001 ccgggaccat ccgtgtgata tgccacgggt tttccctgaa gcagctacct
2051 taatagcgtc ataccgtaag caggtgatgg acactcgagt cgttataaaa
2101 gaggaggggg tctcctattt aatggaggct cacccccagg gaacgactct
2151 gagyatggag atgcccgcgg aagcggtcgt cttgtcccaa cctagtggct
2201 cytgccctaa agtgcgagag ttcacgtatg ctgaacgggt gactacgggt
2251 acgggctctt tggtcgttga gaaggtcgac aaagttcccg attctgccac
2301 agtaatggaa aacataatta agaaattcat ggatgatgtc tcaaaacaaa
2351 taaaagagct tgccgaaggg cagaagagcc ttgaggcgag aattaccggc
2401 gccgcccttc ctgcagagca cttccgcaag aagatgggtg atattgatat
2451 taaacgaacg gctgataaag ccgccttgtt cactcatgag gagtccggtg
2501 acctctatgt gacaacaaat ccagttttag gacaccctga ctcgtttgag
2551 tcccagaagc gagtcgctca agttcacgaa gttgtgagta aaatcagcac
2601 agtggcccgg aaagaacggg ttgcggctga gcctgtgcac gacactgggg
2651 agtatgtaaa gatagagggg cctccgccag gaggagttcc agctcatatc
2701 ccagaaggtg tggccctctg gcatgctctg tgtcaaagtg tgaataaagc
2751 gtgttatcag gtaaccacga aaacggaaac gctgaaagac tcgaatggga
2801 gacctattgt acgagcccat atttatcaac ggagtatgag acctgtcccc
2851 caaaattggc aaaaatggat ggttgcatca gggcgaaacc tagctcgggc
2901 gaaagagttg gctgttgagt atctgatgga gctagtgaat aaggagcagt
2951 acaagctccc cttgactagc acgtcagatt gggccaaaga cgctgagctt
3001 gaggagctca ttcagcttaa agatcgtggg aggcacgtct tctctctcat
3051 tggggagagg tttgaacgtg tcaatcccca tttggcgaca aaacatcatt
3101 taaatgatcg tggggattta ttgatgtggc aacctgacaa tgggacattt
3151 atcaccgttg ccccaccgag aagaacgaga aaaggggcta agactcgcac
3201 cttggcctct acagtgaaga cgttagtgcg aatagacccg gggctccaag
3251 tggaagtctc ggggaaaccc tttgaagggg tcccagttcc agaaaaatta
3301 aattttgaag ttacaacgaa tgatagtgct tttgaaaatg agattgtcaa
3351 tgaaccagag agtgttggaa cagaatttaa agaatttgaa aatagggaag
3401 cctttaggtt tcatgaggtc gtccgggggc caggagcagc tggtagcagc
3451 cctggcgaat ttgatcaaat gccccgtgtg caacagctcc cttcggacgg
3501 aacacgagcc gtcgagttgg gggcgaggga cgattcagga ggtcgagcaa
3551 gccctagagt ggatcaagga ggagctggag tgcctagtgt gcccccagct
3601 ccaggaagat acgctcctga gcttcgagaa cccgacagaa gggtcgtcca
3651 acttgaagga caagtccatg cccttcaggc ccagatccag gcgcttacgg
3701 gggcctcgcc cccaaaacct tggggtaagg gccgagggca ggggaagtct
3751 tctaacatgc ggggacgtgg aggaaaatcc cggccccacc acggtggcag
3801 gcctggtcca agaggcggtt ggtggtctca acaaggcaac caaaaccgct
3851 cctggtaa