Genbank accession
XMN68735.1 [GenBank]
Protein name
tail fiber and host specificity protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MSVAEIRRETFYKLTNSADVPEVPSEGGRNLYALSKEIGRLGAKGGATNLALDTANGTLSFDVNGAHPYFGECVWAGIDYRRHYGQLIPIKANSAIAVSFSSADFNENYVSFVTNSKGAKPPKVLRTQKIILEPSELDGVEYIVVRGGVNNGNDSLTGKTVTTKIKVEYGNVATPYSQASEDLGWSSTPQVPTQEEPYLWKFEYVYYSDGSVEVTQPVNLTKQNAQRTSRDTIHNVRIAIRDSTDSHNVAFFDNVSGIRYQSANLQRFLAGSASILTIEYNSKDIDTIRTGCKLAFIYKQRAYWLNIMDLNKKGYKVEITAYSLGLELNQEERGAHKPANAMSFAEYLAYYDPEHALEVGVNEVADKRIKLEWTGTDTILARLFSIANSFDAELEFTVELNQDYSLKRQVLNIYKKGNLGSNRAASPIRVGRGLKVINYSDNLKELRTAVRATGKDGLTIDGLNKKVYDDDGNLLYYSNANTVYAPQSRDKYPSVGKKSNDNWIIKELGETEYSTKEALWGYMLGELKKICVPEITYDIEGAVDGDVGDTRTLIDDVHYDPPLYVQGRISELTEDLITGKVTKSTLTNFERKYSQVASELLKQVEQLANDAAPYIVRLSTDNGYNFKNGKGSSTVTASLEKYGKIVNANWKWLINNSIVSDKNSVTINASQVIGTLNVVAVATVDGKEVAREYITFTNSDDGVGIKSIKRYYTTNDQAEGVTAGGQNWSTKPATVTADNKYMWSYDVITYTNDTSLVTEPAVIGARGDDGLDADTTGVTEALDKAKQELTALSANIEKVRDDSLAAVEEAKQQLTTVADDLSKVKTDLQTQASQLTAQANAQSELTKRVSSVEETANGTTTAVSELSKTVDSNTKNISSVTARTKTVEDDLTSTKTTLSQVQTTANSASQKTATLETGLDGVKADLAATTATADTTKTNLASYQASNNQAVANLQSSLQTTNGYVSSLQTQVAAVPGQITSAVSAVEGKIPTEIGGRNLYALSKNDGIYSPGTNDFRQNISSGEISFEVTNTSAAGFGAYSSRIGTSYNKLYGVKIPVVQGKDILVNLTDDKLGRIYVHFWDENNALVKPTLKYTSNKIKVLASLLIDVSSITLQCAVKTDVEIGTLIKTKIKVEYGNVYTGWSPAPEDTAIQISSLSSQIRQTADGMTLLATKTELNSAKTDLQAGISTATSKADSAQATANSNAQTISTHTTQISALNTGLQSKVSQSDFDSLSGDVDDLSSKLTQTASSITASVSSVETKADNAQTTANSAVSKADAAQAGVNTLDSTTVKSASLNLDNNGFVTKVGKTIDGNTFATMIAQNANNVKIIADEMQVTADMIVDGAVTAEKLDVNNLSAVTANLGDMTSGSITNTFTSGTRSGSVKIGNGVEITTVDTSGYLPEKAKTYSRFSDDALSFSSSTSNDEPTHSMMIMPEMISYTKHNYDNSSGGTGGWKLRHNGHYSMLEVDMVWQNVRLSNTSELPYGVRADYVRIGNLVTISVNRQITSIADVTEDKLANETIPEGFRPISQAHLTLTGNTGSTIDATCIVHLNPDGTIRFTNNKSGNRVWTGTVTYTCVEAMPYSTSNNNISTI
Physico‐chemical
properties
protein length:1596 AA
molecular weight: 172496,62670 Da
isoelectric point:5,21489
aromaticity:0,06955
hydropathy:-0,36479

Domains

Domains [InterPro]
DC_0002
STR
1–886
G3DSA:1.10.287.1490
STR
768–983
PTHR45615
Unmapped
774–1267
SSF57997
STR
780–956
Coil
Unmapped
782–802
XMN68735.1
1 1596
Architecture
STR
RBD
STR 1-1423 | RBD 1424-1587 |
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Taxonomy

  Name Taxonomy ID Lineage
Phage Streptococcus phage 36L
[NCBI]
3390261 Viruses >
Host Streptococcus equinus
[NCBI]
1335 cellular organisms > Bacteria > Bacillati > Bacillota > Bacilli > Lactobacillales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
XMN68735.1 [NCBI]
Genbank nucleotide accession
PQ621707.1 [NCBI]
CDS location
range 21746 -> 26536
strand -
CDS
ATGAGTGTTGCTGAAATTCGACGTGAGACATTTTACAAACTGACTAATAGTGCTGACGTTCCTGAAGTGCCGAGCGAAGGTGGACGCAATCTATACGCTTTATCGAAAGAAATCGGGCGTCTAGGTGCTAAAGGTGGCGCAACTAACCTTGCGCTAGACACAGCGAACGGAACGCTGTCTTTTGATGTTAACGGAGCGCATCCGTATTTCGGAGAGTGTGTTTGGGCTGGGATAGATTATCGTCGTCACTACGGTCAATTAATACCAATTAAAGCAAATTCAGCGATTGCTGTCTCGTTTAGTAGCGCTGATTTTAACGAAAACTACGTGTCGTTTGTCACGAATAGCAAAGGCGCTAAACCTCCTAAAGTGCTTAGAACTCAAAAGATTATCCTCGAGCCATCTGAATTAGACGGCGTTGAATACATAGTCGTTCGTGGCGGTGTTAACAATGGTAACGACTCTTTGACTGGTAAAACGGTCACTACCAAAATCAAGGTTGAATATGGCAATGTTGCCACACCTTACAGCCAAGCATCAGAAGATTTAGGTTGGTCTAGCACACCACAAGTACCAACGCAAGAAGAACCTTACTTGTGGAAATTTGAGTACGTCTATTATTCAGACGGTAGTGTTGAAGTCACGCAACCGGTTAATTTAACAAAACAGAATGCTCAAAGAACATCTCGAGACACAATTCATAATGTACGCATTGCGATTCGTGATTCAACAGACAGTCATAATGTAGCTTTTTTTGATAATGTTTCTGGTATTCGCTATCAAAGTGCTAACTTACAGCGTTTTTTGGCTGGCTCGGCTAGCATTTTGACGATTGAGTACAATTCAAAAGATATTGACACGATTAGAACTGGATGTAAGCTTGCTTTCATCTACAAGCAGCGTGCTTACTGGTTGAATATCATGGACTTGAACAAGAAAGGCTATAAGGTTGAAATCACAGCTTATTCGCTCGGTCTAGAGCTTAACCAAGAAGAGCGAGGTGCACACAAGCCAGCTAATGCAATGAGTTTCGCTGAATATTTGGCTTATTACGACCCTGAACACGCTTTAGAGGTTGGTGTTAACGAAGTAGCAGACAAACGTATCAAACTTGAATGGACGGGCACAGACACGATTCTGGCGCGTCTTTTTTCAATTGCCAATAGTTTCGACGCAGAGCTTGAATTTACTGTCGAGTTGAATCAAGACTACTCGTTAAAACGTCAAGTTTTAAATATCTACAAAAAAGGTAATCTTGGTTCTAATCGAGCAGCAAGTCCAATTCGTGTTGGCCGTGGCTTAAAAGTCATTAATTACAGCGATAATTTGAAAGAATTGCGTACAGCGGTACGTGCTACTGGTAAAGACGGATTGACCATTGACGGTCTGAACAAAAAAGTCTACGACGATGACGGCAATCTGCTTTACTACTCAAATGCTAACACTGTTTATGCGCCTCAAAGCCGTGATAAATACCCGTCAGTCGGCAAGAAGTCAAATGATAACTGGATTATTAAAGAACTCGGGGAAACCGAATATAGCACGAAAGAGGCGCTCTGGGGTTACATGCTCGGTGAACTCAAAAAGATTTGCGTACCAGAGATTACATACGACATCGAAGGCGCTGTTGACGGTGACGTCGGTGACACGCGCACATTGATTGATGACGTGCATTATGACCCACCGCTATACGTTCAAGGGCGTATTTCGGAGCTTACAGAGGATTTAATCACTGGCAAGGTTACGAAGTCAACGCTTACGAATTTTGAACGTAAGTACTCGCAAGTCGCTAGCGAATTGCTAAAACAAGTTGAACAGCTAGCAAACGACGCAGCACCTTACATCGTCCGTTTATCAACCGACAACGGCTACAATTTTAAAAACGGCAAAGGTTCTAGCACAGTTACTGCTAGCCTTGAAAAATACGGCAAAATTGTAAATGCAAATTGGAAGTGGCTAATTAATAACAGCATTGTTAGCGATAAGAACAGTGTCACAATCAATGCTAGTCAAGTTATTGGCACACTAAACGTCGTAGCTGTTGCAACCGTTGACGGGAAAGAAGTAGCTCGTGAATACATCACATTCACCAATTCTGATGACGGTGTTGGTATTAAGTCAATCAAACGCTATTACACGACTAACGACCAAGCAGAGGGCGTCACAGCAGGCGGTCAAAACTGGTCTACTAAACCAGCGACTGTCACAGCAGACAACAAGTACATGTGGTCTTACGATGTTATCACGTACACAAATGACACAAGTTTAGTTACTGAACCAGCCGTTATTGGTGCTCGAGGGGATGACGGTTTGGACGCAGATACGACAGGTGTCACAGAAGCACTTGATAAAGCTAAGCAAGAATTGACTGCTTTATCAGCGAATATCGAAAAAGTGCGAGACGATTCGCTTGCAGCAGTCGAAGAAGCCAAACAGCAACTCACTACTGTAGCTGACGACTTGTCTAAAGTCAAGACAGACTTGCAAACACAGGCTAGTCAGTTGACTGCACAAGCCAATGCACAGTCAGAATTGACTAAACGTGTAAGTAGCGTTGAAGAAACTGCTAATGGCACAACGACGGCTGTTAGCGAGTTAAGCAAAACAGTAGATAGTAATACCAAAAATATTAGTAGTGTTACTGCACGAACTAAGACAGTTGAAGATGACCTGACAAGTACTAAAACAACATTGTCACAAGTTCAAACGACTGCTAACAGTGCTAGTCAAAAAACAGCTACACTTGAAACTGGCTTGGATGGTGTCAAGGCTGATTTAGCTGCAACTACAGCAACTGCCGACACGACCAAAACCAATCTTGCTAGCTATCAAGCGTCAAACAACCAAGCTGTCGCAAACTTGCAATCTAGCTTGCAGACCACGAACGGCTATGTAAGCAGTCTGCAAACACAGGTTGCTGCAGTCCCGGGACAGATTACAAGTGCTGTCAGCGCAGTTGAGGGGAAGATACCTACTGAAATTGGTGGACGAAATTTATACGCATTGTCTAAAAATGACGGAATATATTCGCCAGGCACTAACGATTTTAGGCAAAACATAAGTAGCGGAGAAATCAGCTTTGAGGTAACTAACACATCCGCAGCTGGTTTCGGTGCTTATAGTAGCCGCATTGGAACAAGTTATAACAAACTGTACGGTGTCAAAATCCCAGTCGTGCAAGGTAAAGACATACTTGTTAATTTGACAGATGACAAATTAGGTCGAATATATGTACATTTTTGGGACGAAAACAATGCGTTAGTAAAGCCAACGCTAAAGTACACATCTAACAAAATTAAAGTTTTAGCCAGCTTGTTGATTGATGTCAGCTCCATCACTTTGCAGTGCGCAGTCAAGACAGACGTTGAAATTGGTACTTTGATTAAGACCAAAATAAAAGTCGAATATGGCAATGTGTACACAGGCTGGTCTCCAGCCCCCGAAGACACAGCTATACAAATCAGCAGCTTGTCTAGCCAGATTCGGCAAACTGCTGACGGCATGACGTTGTTAGCGACTAAAACAGAGCTAAACAGTGCTAAAACCGACTTGCAAGCTGGCATTTCGACAGCGACAAGCAAGGCTGACAGTGCACAAGCTACCGCTAACAGCAACGCGCAAACAATCAGCACACACACGACTCAAATCAGCGCGTTGAACACTGGTTTGCAAAGTAAAGTTTCTCAAAGTGATTTTGATTCATTGAGCGGTGATGTCGACGATTTATCAAGCAAGCTTACTCAGACAGCAAGTTCAATCACCGCAAGTGTGTCAAGTGTTGAGACTAAAGCAGATAATGCTCAAACGACTGCTAACAGTGCGGTCTCAAAAGCAGACGCGGCGCAAGCTGGTGTCAATACGCTAGACAGCACGACTGTTAAGAGTGCTAGCTTGAACCTTGATAACAATGGATTCGTGACAAAGGTTGGAAAAACTATCGACGGCAACACGTTTGCGACCATGATTGCGCAAAACGCTAACAACGTCAAAATCATCGCTGATGAAATGCAGGTCACTGCTGACATGATTGTCGACGGTGCAGTCACAGCCGAGAAACTAGACGTCAATAATTTGTCTGCAGTTACTGCAAATCTTGGTGACATGACATCTGGTTCGATTACTAACACATTCACTTCTGGAACACGAAGCGGAAGCGTCAAAATAGGTAATGGCGTTGAAATAACAACGGTTGACACATCTGGTTATTTGCCAGAAAAAGCCAAAACATACTCACGTTTCTCTGACGACGCGCTTTCGTTTAGCTCTAGCACTTCAAACGATGAACCGACACATTCGATGATGATAATGCCGGAAATGATTAGCTACACCAAACACAATTACGACAATTCAAGTGGCGGAACAGGAGGCTGGAAACTGCGCCACAATGGTCACTATTCAATGCTTGAGGTCGACATGGTTTGGCAGAACGTTCGACTTAGCAATACGTCTGAATTACCTTATGGAGTTCGAGCAGATTATGTTAGAATCGGAAATTTGGTAACTATTTCCGTCAATCGTCAAATTACAAGCATAGCAGATGTCACTGAAGATAAATTAGCAAATGAAACAATCCCAGAGGGTTTCAGACCAATTTCACAAGCACATTTAACGTTGACTGGGAATACTGGTTCGACCATCGATGCGACTTGTATTGTACACTTAAACCCTGACGGAACCATTCGCTTTACTAACAACAAATCAGGAAACCGCGTCTGGACGGGCACAGTGACATACACATGTGTTGAAGCTATGCCTTACAGCACATCAAACAACAATATTTCAACAATTTAA

Genome Context

Genome Context

Tertiary structure

PDB ID
85d508b3259b001961f3079f933e87edf0e5a79b2a14072883193e8246eb56cf
ColabFold
Source ColabFold
Method ColabFold
Resolution 0,7530
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50