Protein
View in Explore- Genbank accession
- DBA52074.1 [GenBank]
- Protein name
- central tail fiber J
- RBP type
-
TFTF
- Protein sequence
-
MNSKVILVIPLMVFLLVPTAVFAQTDFGSTSNQTISGFEPLEDIVMTPPPSTTPLNEYTFTPSQEIEITTPITGLVSSPPDGFESVTVEKFGTNYETFVDESGYLYRVYDMWSNVTITGLVNSEQRTFQQYNDSWHYELDADNKIIIINDMVEQSEYPQVTENYTIEQIDDETFLYSTHTPYVSDGYDWKPYVLGQDENVVQVQVAGGTIVFDKVAGAVTIFNDYETVIDSDSYTVRTALLDSDVWASLDVNNADVETTVVEDGDKVTVSFIRENNEGLFKTEYVIGSGQVKTTAYFTNYIYDNNKFAFTQTLDLPDSIISLNEMESIDLTDYVGQSFPREVLEQNEDLILNIKDMYYSSGLGFDNLWSVNVTTPTKVSLDYANVEQTQTVIGDTVELDPIFGIGTTAGWIRSVGVTSTPSQNCPVASDSKIYYLRNYNSYPSYNGCRAPIAEFDVSSIPDNATVTSVNINYEIDWVSGASNGMNAVDWNDISIKDHTTTMIGWDDATNASSGQSYVTNETGGNGSAGDIVNVNLGTLGNTNVENQLNASTSVDGVADWFSVGFPFSNTTQQSYVRDVGYKNVAMSVVYTLPPSTPTNVTTTANGSNVDLSWTASNSNSDYIVSSSASTADGTNYGATNGVSGKIGNAWDFDGINDYVNIPSITNGSNGYTWSVWADITSNGNGMEILGKANAGNLLIPDESTYGSSWASVYFAGTTSGTGINTMDSGWHHYVGVTDCAGYSQWQCPVTIYMDGSSIATGTSGYYADNYYFLGARNNSGSPAYFTNGTIDELAIYQRALTSSEVGTLYNSGNANTPNSISTSNLSHYYNFEQTGNTLTNMAVTVDPLVVTYDVKRDGTSLGTTTNTSFTDTTTAYGTPYLFSLTASTSNGTSPSTANIPITLTVPEPTNLSASLNAPNVDLSWTGASGATGYKIEHSTDGTTWTNVVANASANPWTWDSANSFSISVNGTEITKTSGAGWNSYIRTNQTITSGSGGSIAWKLPTATSNNYETGGFSQGSYTPNSTYSDFKYSIMFINSGQVQVWENNAHMGNFTITGFNPSTSVFKVDMDNTGTVTYWHNNELLHTSNTTASGTYYGHAALYTQNTTLLMLDESYSHTAPTQNSDNYYQVKALIGSAESTANTGSSTITPVNYRTYTSTASASTCDTGTITADIMHEIGMPSQVGGNRYCLVTSMEYDISAISDAATITSAVIEESHVIWSTGFSPSCDYKSNMFYQPSTSTTQEKWDSVIAGTVYANDPACITGYTSNNVYDVPLSAQAMTDIETQLSGDWFGINWAIDNFPSLANAGTVGTPASIYNGSSLLKLEYIAPASLAVGGTPDAPTGLTATFNVTTADMDLAWSTPASDNGSAIVGYKVEVSTDDITYTTLVADTGNTNTTYTDLNPTMGSLNYYKVSAINAYGSGAVSNTDNDMAGVPPDAPTITSTSTDSANSAPLEITVNWSAPTVTGTAGISNYEVYRDSTLITTVGNVTTYVDTVPTGGGTFVYELKSVTPHGTSVLSATASHTTPTPPPAPTSSPTLDIANPNPSPFDVTVTFAMPSSGGSAITSFEIFRSTDDVTFASVGTTSTLIFSDTVPNAGTFYYKFASTNLVGNSGQSPSGSITTATVPDSPTVTLAINNPNTLPFDITATFVAPASDGGSALIDYDLQYSDDNVTFAEIAGGITGSYTHTVATAGTHYFQATVRNNVGDSVTGVVANMDTPTVPDAPTVAVTTDNPNTNPLDITSSFVAPADNGGSTITGYNLFVSDDDITYTQVQTNVTADQVTTVASSGTYYFKAQAINLVGTSLQGSASINVTPTLPSVPLNATSAISNVDTAPYTMIVSWDTPTSNGGSNLTGYDVYRKQGSASPVFITNTTALTITDTVPSVLSTNFTYQIYSVNNVGQSATYVDTVVTTNNVPSAPVLAVTTGTTVLSWNAPASDATITGYKVFRDSVLLTTVTTLTHTDFTTIVFGNSYVYKVVAVSSLGDSADSNNVTTTPETEITGMVALGVTGTGAVIDWDEPAYYQGQVTSYNVYYGNSGTPATGAGTTTNTYSNFAPQLDYDTTYVFGVSINSPLGNSGLSNIVAITTNVDTSIVSSDPTTGGMSWFDIDSVNNQSVNVIEFQRETQDDIVNGTTVVFDTLQVGYPSWWDEMTCDVDYKFAGQTDQYVEGTDMVAVVNPADGNQQIIGFQFHDIDNEVVTVQCAPQQTTQDDGVSAKYVMTQNSFGTLQADGTYTEGLPNIPIVSQITNFSNGTYGTDGDFGALNIVGLFAILISMVGFNRLNPIVGVLLSASMIFVLSWFGIITIPTALIGAIALVIFLAWGATRNR
- Physico‐chemical
properties -
protein length: 2331 AA molecular weight: 248271,45150 Da isoelectric point: 4,05003 aromaticity: 0,10296 hydropathy: -0,14118
Domains
Domains [InterPro]
IPR036116
STR
587–907
STR
587–907
IPR050964
Unmapped
591–1430
Unmapped
591–1430
IPR003961
STR
593–892
STR
593–892
IPR013320
STR
615–811
STR
615–811
PF13385
LEC
652–804
LEC
652–804
IPR003961
STR
1340–1429
STR
1340–1429
IPR003961
STR
1341–1427
STR
1341–1427
IPR003961
STR
1342–1439
STR
1342–1439
1
2331
Architecture
STR 587-1076 | ATT 1155-1436 | STR 1437-1485 | ATT 1486-1918 | STR 1919-2094 | RBD 2095-2331
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Nitrosopumilaceae spindle-shaped virus [NCBI] |
3065433 | Viruses > unclassified viruses > unclassified archaeal viruses > |
| Host | No host information | ||
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
DBA52074.1
[NCBI]
Genbank nucleotide accession
BK067789.1
[NCBI]
CDS location
range 16771 -> 23766
strand +
strand +
CDS
ATGAACTCAAAGGTTATACTGGTTATACCCTTAATGGTATTCCTACTCGTACCGACTGCTGTCTTTGCACAGACCGACTTTGGTTCGACAAGCAATCAAACTATTTCTGGTTTTGAACCCCTTGAAGATATTGTAATGACACCGCCACCAAGCACCACTCCGCTTAACGAATACACATTTACACCGTCACAAGAAATTGAGATAACCACACCGATAACTGGATTAGTATCATCCCCCCCAGATGGATTTGAAAGTGTGACAGTAGAAAAGTTTGGCACAAACTATGAAACCTTTGTAGATGAATCGGGATATTTGTATAGAGTTTATGACATGTGGAGTAATGTAACCATAACAGGATTAGTAAATTCAGAACAAAGAACATTCCAACAGTATAATGATTCTTGGCATTACGAATTAGATGCTGATAATAAAATTATAATAATTAATGATATGGTAGAGCAATCTGAATACCCACAAGTCACAGAAAACTACACCATTGAACAAATAGATGATGAAACCTTTTTGTACTCAACTCATACCCCATACGTTTCAGACGGATATGACTGGAAGCCATACGTTCTAGGACAGGATGAAAACGTAGTTCAGGTACAGGTTGCTGGTGGAACTATTGTCTTTGACAAAGTAGCTGGTGCGGTTACAATATTCAATGACTATGAAACCGTAATTGATTCTGACAGTTATACCGTAAGAACCGCATTGTTAGATTCTGACGTTTGGGCTAGCCTTGATGTGAACAATGCCGATGTCGAAACTACCGTTGTAGAGGATGGCGACAAAGTAACAGTCTCGTTCATTCGTGAAAATAACGAGGGGTTGTTCAAAACTGAATACGTCATTGGCAGCGGACAGGTAAAGACAACTGCATACTTTACAAACTACATCTATGATAATAACAAGTTTGCATTTACACAAACTTTGGACTTGCCTGACAGCATAATATCCCTAAATGAAATGGAGTCTATTGACTTGACCGATTACGTTGGTCAGTCTTTTCCTAGAGAAGTGCTGGAACAAAACGAGGATTTGATTTTAAACATAAAGGACATGTATTATAGTTCAGGATTGGGATTTGATAATTTGTGGAGTGTCAATGTTACAACACCAACTAAGGTCAGTTTGGATTATGCCAACGTAGAACAAACACAAACTGTGATAGGTGATACAGTAGAACTTGATCCTATATTTGGGATAGGTACAACTGCTGGATGGATTAGATCAGTTGGCGTAACCTCAACCCCTAGTCAAAATTGTCCCGTTGCTTCTGATTCTAAAATTTATTATTTGAGAAACTATAACTCATATCCAAGCTATAACGGTTGTAGAGCACCAATAGCCGAGTTTGACGTATCATCTATTCCAGATAATGCAACTGTAACAAGTGTTAATATCAACTATGAGATTGATTGGGTATCTGGAGCTTCCAACGGCATGAACGCAGTTGATTGGAACGACATTTCAATAAAAGACCATACCACAACGATGATAGGATGGGATGATGCAACCAACGCATCATCAGGACAAAGTTATGTTACAAATGAAACGGGTGGCAACGGTTCGGCAGGAGATATAGTCAATGTCAATTTGGGAACTTTGGGAAATACCAATGTTGAAAATCAATTAAACGCATCAACTTCCGTTGATGGTGTGGCTGATTGGTTCAGTGTGGGTTTTCCTTTTAGTAACACAACTCAACAATCCTATGTGCGTGATGTTGGCTACAAAAATGTTGCAATGTCAGTAGTTTACACCTTACCCCCATCAACGCCAACTAATGTCACTACAACTGCCAACGGTTCAAATGTTGACTTGTCTTGGACTGCATCAAATTCAAATTCTGATTATATAGTATCAAGTTCTGCTTCAACTGCTGATGGAACCAACTATGGTGCGACAAATGGGGTAAGTGGAAAGATTGGTAACGCATGGGATTTTGATGGAATAAATGATTATGTAAATATTCCAAGTATTACCAATGGATCTAATGGTTATACTTGGTCGGTGTGGGCGGATATTACTTCAAATGGTAATGGCATGGAAATTTTAGGCAAGGCAAATGCCGGTAATCTCTTAATTCCTGACGAATCAACTTATGGTTCTTCATGGGCTAGCGTTTACTTTGCTGGGACAACTTCTGGAACTGGAATTAATACAATGGATTCGGGATGGCATCACTATGTTGGAGTAACTGACTGTGCAGGATATTCCCAATGGCAGTGTCCTGTGACAATTTATATGGATGGCTCTAGTATCGCAACTGGAACAAGTGGATATTATGCGGATAACTATTATTTTTTAGGAGCTAGAAACAATAGTGGATCACCAGCATACTTTACAAATGGAACAATAGATGAACTTGCAATATATCAAAGAGCATTAACATCAAGTGAAGTTGGTACACTTTACAATTCAGGTAATGCAAATACTCCTAATTCAATTTCCACAAGCAACCTATCACACTATTACAACTTTGAGCAAACTGGAAATACATTAACTAACATGGCAGTGACAGTCGATCCTTTAGTTGTAACGTATGATGTAAAGCGTGACGGTACAAGTCTAGGAACTACGACCAATACTTCATTTACAGACACTACTACTGCTTACGGTACACCTTATCTTTTTAGTTTGACAGCTTCCACAAGTAACGGTACAAGTCCATCAACAGCAAACATTCCAATTACACTTACAGTTCCAGAACCGACAAATCTTTCCGCATCATTGAACGCACCAAACGTTGACCTGTCATGGACAGGTGCAAGCGGTGCAACGGGCTACAAGATTGAACACAGTACGGATGGTACGACTTGGACTAACGTAGTTGCAAACGCATCTGCAAATCCGTGGACATGGGATAGTGCAAACAGTTTTAGCATTAGTGTTAATGGTACTGAAATTACTAAAACAAGCGGTGCTGGATGGAACAGTTACATTAGAACCAATCAAACCATAACGTCAGGTTCAGGCGGTTCGATTGCATGGAAATTACCAACTGCGACCTCAAACAATTATGAAACAGGTGGATTCAGTCAAGGAAGTTATACACCGAACAGTACATACAGTGACTTCAAATACAGTATCATGTTTATCAATTCAGGACAAGTACAAGTATGGGAAAATAATGCTCACATGGGTAATTTCACAATAACTGGATTTAACCCATCCACGTCAGTCTTTAAAGTAGATATGGACAATACTGGAACTGTAACCTACTGGCATAATAATGAATTACTTCATACAAGTAATACCACAGCAAGTGGAACTTATTACGGACACGCTGCATTATACACTCAAAATACTACATTATTGATGTTGGATGAGTCTTACTCCCATACCGCACCGACACAAAACAGCGATAACTATTATCAGGTCAAGGCACTGATAGGCTCTGCCGAGTCAACTGCCAATACTGGATCATCAACAATAACACCAGTCAATTACAGAACATACACTTCAACTGCTTCCGCATCAACCTGTGACACTGGAACAATAACTGCTGACATAATGCACGAAATCGGCATGCCCTCTCAAGTTGGTGGAAACCGATACTGTCTTGTAACTTCAATGGAATATGACATATCCGCAATTTCTGATGCTGCAACAATTACAAGTGCAGTTATCGAAGAAAGCCATGTCATTTGGTCAACTGGATTTTCCCCATCATGTGACTATAAATCCAATATGTTCTATCAGCCATCAACCTCAACAACACAGGAGAAATGGGATTCCGTAATAGCTGGTACAGTATATGCGAATGATCCAGCCTGTATCACAGGTTATACAAGTAACAACGTGTATGACGTACCGTTAAGTGCACAGGCTATGACAGACATAGAAACACAGTTGTCAGGGGATTGGTTTGGAATTAATTGGGCTATTGATAACTTCCCAAGTCTAGCCAATGCTGGAACTGTCGGTACACCAGCATCAATCTATAACGGATCATCATTACTAAAATTAGAATACATAGCACCAGCTAGTCTAGCGGTCGGTGGCACACCTGATGCACCTACTGGACTTACTGCGACATTCAATGTGACAACTGCCGACATGGACTTGGCATGGAGTACCCCAGCATCCGATAACGGAAGTGCAATAGTTGGTTACAAAGTTGAAGTCTCAACTGACGATATAACTTATACAACACTGGTCGCTGACACTGGAAACACAAACACAACTTACACAGATCTAAATCCTACAATGGGTTCACTCAACTATTACAAAGTTTCTGCGATTAACGCATACGGAAGTGGTGCAGTTTCAAACACAGACAATGACATGGCTGGCGTACCACCTGATGCACCAACGATAACCTCAACCTCAACTGACAGTGCAAACTCAGCACCTTTGGAAATCACAGTTAACTGGTCTGCACCAACGGTAACTGGAACTGCTGGAATTTCTAACTATGAGGTCTATCGTGATTCCACATTGATAACGACAGTCGGCAATGTCACAACCTATGTTGACACCGTTCCGACTGGCGGTGGCACGTTTGTCTATGAATTGAAATCAGTAACTCCGCATGGAACTTCCGTACTGTCTGCAACTGCATCACACACGACACCGACTCCACCGCCAGCACCGACTTCATCACCTACACTTGACATAGCAAATCCAAACCCGTCACCGTTTGACGTAACCGTAACGTTTGCCATGCCATCGTCAGGCGGTTCAGCAATCACATCATTTGAGATATTCAGAAGTACCGATGACGTAACGTTTGCATCAGTTGGTACGACCTCGACTTTGATATTTTCTGACACAGTTCCTAACGCTGGAACTTTCTACTACAAGTTTGCAAGTACGAACCTTGTTGGAAACTCTGGACAGTCTCCAAGTGGCAGTATAACAACAGCAACCGTACCTGATTCGCCTACCGTCACACTCGCAATTAACAATCCAAACACCTTGCCATTTGACATTACCGCAACATTTGTAGCACCAGCAAGTGACGGTGGAAGTGCACTCATTGATTACGACTTGCAATATTCTGACGACAATGTAACATTCGCTGAGATTGCTGGCGGTATAACTGGATCATATACTCACACGGTAGCAACGGCTGGAACGCATTACTTCCAAGCAACTGTCCGTAACAATGTCGGTGACAGTGTAACTGGCGTGGTGGCAAACATGGACACGCCAACCGTGCCTGATGCACCGACAGTAGCCGTGACAACTGACAATCCTAACACAAATCCGTTGGACATAACATCCTCATTTGTAGCACCAGCCGATAACGGTGGAAGTACAATAACTGGATACAACTTGTTCGTATCGGATGATGATATAACCTACACTCAAGTTCAAACCAACGTGACCGCTGATCAAGTCACGACAGTTGCAAGTTCTGGAACATATTATTTCAAAGCACAGGCAATCAACCTAGTCGGTACAAGTTTACAGGGTAGTGCTTCGATAAACGTCACTCCGACATTACCTTCAGTACCGTTGAACGCTACAAGTGCAATATCAAATGTTGACACAGCACCTTACACAATGATTGTCTCATGGGATACACCGACTTCAAACGGTGGTTCTAACCTGACTGGATATGACGTTTACAGAAAACAGGGCAGTGCATCACCAGTGTTCATTACAAACACGACCGCACTAACTATAACCGATACAGTTCCAAGCGTACTCAGTACCAACTTTACATATCAAATTTATTCCGTGAACAACGTAGGTCAGTCCGCAACATACGTTGACACCGTGGTAACGACAAACAACGTGCCTTCAGCACCAGTACTCGCAGTGACAACTGGAACCACAGTGCTGTCATGGAACGCACCAGCCAGTGACGCAACAATAACAGGCTACAAGGTGTTCAGAGACAGCGTGTTACTTACGACCGTAACCACCCTGACACACACCGACTTTACCACAATCGTGTTTGGAAATTCCTACGTCTATAAGGTAGTCGCAGTATCGTCATTGGGTGATTCCGCAGACTCGAACAATGTCACAACGACTCCTGAGACAGAAATCACTGGCATGGTGGCACTGGGAGTCACTGGAACTGGTGCTGTAATTGACTGGGACGAGCCAGCATACTATCAAGGTCAGGTAACTTCGTATAACGTGTACTATGGAAACAGTGGAACACCAGCCACAGGTGCGGGAACCACGACCAATACATATTCCAACTTTGCACCGCAACTGGATTATGATACAACATACGTCTTTGGTGTAAGTATTAACTCACCTCTAGGCAACTCTGGACTCAGTAACATTGTTGCAATAACAACTAACGTTGACACCAGCATAGTTTCATCCGACCCTACTACTGGCGGCATGTCATGGTTTGACATTGACTCCGTGAACAATCAGTCAGTCAACGTCATAGAGTTCCAAAGAGAGACTCAGGACGACATAGTAAACGGCACAACCGTCGTGTTTGACACATTACAAGTCGGCTACCCTTCATGGTGGGACGAAATGACATGTGACGTTGACTACAAGTTCGCTGGACAGACAGACCAATATGTCGAGGGAACTGACATGGTGGCAGTGGTTAATCCGGCAGATGGCAACCAGCAAATCATAGGATTCCAGTTCCATGACATTGACAACGAAGTCGTCACGGTACAGTGTGCACCTCAACAAACAACACAAGATGATGGCGTATCAGCAAAATATGTCATGACACAAAACAGTTTTGGTACCTTACAGGCTGACGGGACTTACACAGAGGGACTTCCTAACATCCCAATAGTGTCACAGATTACCAACTTTTCAAACGGAACCTACGGAACTGACGGTGACTTTGGTGCATTGAACATTGTCGGACTGTTTGCAATATTGATTTCAATGGTAGGATTTAACAGGCTAAACCCAATAGTAGGTGTACTTTTATCAGCCAGTATGATATTCGTATTGTCATGGTTCGGAATTATAACAATACCAACTGCACTGATAGGTGCAATAGCATTGGTCATATTCCTAGCATGGGGAGCTACGAGGAATAGATAA
Genome Context
Genome Context
Tertiary structure
PDB ID
453f3210740826f5969be58b90cce8fa5f53bef85d4ab57c306e9b68008d2b4f
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50