UniProt accession
A0A7S9SWG3 [UniProt]
Protein name
Fibronectin type-III domain-containing protein
RBP type
TF
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,52
TF
Evidence RBPdetect2
Probability 0,96
Protein sequence
MPPAIIGAVVALGASGLAAASIISVTTALVIGMAATVAGSLLSKPKLPGMGNIKSQQERKQVVRSSAASCNVIYGTTMISGVLIFAEEEPGDQDDGEWIHMVLAIAGHKVNRIVEFYIGDDKASTYGNNVVWALLNDLQEADPYLLKKCPSWKQDMIGKGVALVRVSLKYDQEMFPSGLPNLKFVVEGKLVWDPRTNTEYFTDNAALCTLDYYLTTIGVKKEDMMLAEYVSAANTCDEMVQNADGSMTARYTVNGTFDVSEPFNDVLMDGLFQACGGEPTYIAGKHGILVGAYYGPPAPNMVLTQDHLRDDVSITPEASFKDLTNIIRGVYVDPKQDYNETDFPPVVIEEWLQQDGRELAEDFKFRFVNNPYTAQRLATIAVHRKRVSRMMELPINLKGFKFRPGRFINIDLPHLGINMVEFRVTKWDFDPQAGISITVRQESPSTYNDVVGKIVELPPLTNLRPETIAAPQNIRFNLDKIGDVVQGVLQWENPQDAAYNNVVIFDSTGNVVNTIQVPGNRVQLNGLVKGKYKVNVYAFGFNGAKSSPGYVKIDISAPNMPTNIRVESGFYSVSIYPSSSDLNAPTFEYWMSDKALTGDAVILQNASRLGQGSFWTVENLNPMQIYYFHVRTINIYGASTFKSVAGRASTKADEILDVVGKQWQDSELGQVIKDMEVNIENLDVVNKALEDVIRQNKDDVEKLNIAVRKSFQTIGDVTFQIRQNKGTNEAEIKRVEGVVATETEARVQSFEYLNAKVEGVNGTLTGELNTFKEVYATDKAVLVTWQQEAIARFEYNESSILEIQETTSTLTESVAQHTRQLTAQQSTLESQGVTLDSQGKLLNAQGLKLDEQGRLVDSQGKIINSQGIQLDSQGKLINDQGKVIDSHGVAITEHASRITSVEKVSATNTQSITENKQAADSRFASNEASINQAQQTAASAEDAAVKFAVQMAAESKKTQENINESKAEILDVKNIVANQELAMAQQISQLKTEFNGNIATINGQLKVVSDATSANASAIQILATDVGNNKGQISSIQTSITTLEKSVQETKDQLYAQTQSTDQRFTAVNQTINQTKTELEKSIASSNQTLSSQIATVDGKAVQAGKDAATANSNAGKAQTTADGATKNINDYKTANDKEIVLVKADIKSNREAIATEKQARTTDVTNLQASLNSTNAKVEQKMEAVVEHNGTVAATYTLRAGIELPNGTYKSAGLFLGVSGGTNPVASVGVNADNFVVMNSRNGKLETVFQVDSSGNVVIRNALISRLFVEEAIVGSTLSSADFSATKGIQIDFKNGKIIANGGTWGAGLNVGNPTGKGLSITDQTILVRDQNGRLRFACGYIKGLV
Physico‐chemical
properties
protein length:1347 AA
molecular weight: 146312,93460 Da
isoelectric point:5,17794
aromaticity:0,06682
hydropathy:-0,25212

Domains

Domains [InterPro]
DC_0187
STR
1–964
IPR053171
Unmapped
420–1110
IPR036116
STR
540–641
IPR003961
STR
557–653
IPR057587
ATT
560–659
A0A7S9SWG3
1 1347
Architecture
STR
ATT
STR
RBD
STR 1-559 | ATT 560-659 | STR 660-1050 | RBD 1051-1347
Legend: ATT STR RBD CBM LEC ENZ CHP LNK TAS TTP UNK Unmapped

Tail Spike Domain Segmentation

Tail Spike Domain Segmentation

This protein has been segmented into three structural domains: N-terminal, central domain, and C-terminal.

Domain Layout
N-terminal
Central
C-terminal
A0A7S9SWG3
1 1347
Domain Start End Length (AA) Confidence
N-terminal 1 1282 1282 0,9168
Central domain 1283 1336 55 0,5958
C-terminal 1337 1347 10 0,6750
Legend: N-terminal Central domain C-terminal
3D Structure with Domain Coloring

The structure is colored according to the domain segmentation: N-terminal (blue), Central (green), C-terminal (pink).

Domain Coloring
N-terminal
1-1282
Central
1283-1336
C-terminal
1337-1347

Taxonomy

  Name Taxonomy ID Lineage
Phage Providencia phage PSTCR7
[NCBI]
2783549 Uroviricota > Caudoviricetes > Craquatrovirus >
Host Providencia stuartii
[NCBI]
588 cellular organisms > Bacteria > Pseudomonadati > Pseudomonadota > Gammaproteobacteria > Enterobacterales

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
QPI18534.1 [NCBI]
Genbank nucleotide accession
MW057861 [NCBI]
CDS location
range 50846 -> 54889
strand +
CDS
ATGCCACCAGCAATAATCGGGGCAGTGGTCGCATTAGGTGCGAGCGGTTTAGCTGCTGCAAGTATAATCAGTGTTACCACCGCACTTGTAATAGGCATGGCTGCAACTGTCGCAGGGTCGTTATTATCAAAGCCAAAACTTCCAGGCATGGGGAACATAAAATCCCAACAAGAAAGAAAACAAGTTGTAAGGTCTTCTGCTGCGAGTTGTAATGTTATTTACGGCACAACAATGATATCGGGAGTGCTTATATTTGCAGAAGAGGAGCCTGGAGACCAAGACGACGGCGAATGGATTCACATGGTGCTTGCTATTGCCGGACATAAAGTTAACAGAATTGTAGAATTTTATATAGGGGACGACAAAGCATCTACTTATGGTAACAACGTCGTGTGGGCGTTGCTAAACGACTTACAAGAAGCGGATCCATATTTACTTAAAAAATGCCCATCCTGGAAACAGGACATGATAGGGAAAGGCGTTGCTCTTGTTCGTGTTTCTTTAAAATACGATCAAGAAATGTTCCCTAGTGGGCTGCCTAACTTGAAGTTTGTCGTAGAGGGGAAACTTGTTTGGGATCCTCGCACAAATACTGAATACTTCACAGATAATGCTGCTTTGTGCACTTTGGATTACTATTTAACCACAATAGGCGTTAAGAAAGAAGATATGATGTTAGCGGAATATGTTTCTGCTGCTAATACGTGCGATGAAATGGTTCAAAATGCTGACGGTTCTATGACAGCTCGTTATACTGTTAACGGAACATTTGATGTTAGCGAACCGTTTAACGATGTGTTAATGGATGGCTTGTTTCAGGCGTGTGGAGGCGAACCCACATACATTGCAGGTAAGCATGGAATATTAGTTGGTGCTTACTACGGGCCGCCTGCGCCTAATATGGTGCTAACACAGGATCATTTAAGAGATGATGTTTCCATTACTCCAGAGGCATCTTTTAAAGATCTCACTAATATTATTCGCGGTGTCTACGTTGACCCTAAACAGGACTATAATGAAACAGATTTCCCACCTGTAGTAATTGAAGAATGGTTGCAGCAAGACGGAAGAGAGTTAGCTGAAGATTTTAAATTTAGATTTGTAAATAACCCTTATACAGCACAACGACTTGCTACAATCGCAGTTCATAGAAAGCGTGTAAGCAGAATGATGGAGTTGCCTATAAATCTTAAAGGTTTTAAATTTCGCCCTGGTCGATTTATAAATATAGACTTGCCTCATCTTGGAATAAACATGGTGGAATTCCGTGTTACAAAATGGGATTTTGACCCGCAGGCAGGAATTAGCATTACAGTAAGACAAGAAAGCCCGTCTACATATAATGATGTTGTTGGCAAAATTGTGGAACTGCCACCTTTAACTAATTTACGCCCCGAAACAATTGCAGCTCCTCAAAACATTAGATTCAATTTGGATAAGATTGGAGACGTTGTTCAAGGTGTGTTGCAATGGGAAAACCCACAAGACGCGGCCTATAACAATGTGGTTATATTCGATTCTACTGGCAATGTAGTAAACACAATTCAAGTTCCCGGCAATCGCGTTCAACTAAATGGACTTGTAAAAGGGAAATATAAAGTAAATGTGTATGCGTTCGGTTTTAATGGTGCAAAGTCATCTCCTGGATATGTGAAAATAGATATTTCTGCTCCAAACATGCCTACAAATATAAGAGTAGAAAGTGGGTTCTATTCTGTGTCTATTTACCCATCTAGCTCTGATTTAAATGCTCCAACTTTTGAATATTGGATGTCCGATAAAGCATTAACTGGAGATGCAGTAATATTGCAAAATGCATCTAGATTGGGTCAGGGTAGTTTTTGGACTGTAGAAAACTTAAACCCTATGCAAATTTATTATTTCCACGTCAGGACAATAAATATTTATGGCGCCTCCACCTTTAAATCCGTTGCAGGTAGAGCAAGCACAAAAGCGGATGAAATATTAGACGTTGTTGGTAAACAATGGCAAGATAGCGAGCTTGGTCAAGTAATCAAAGACATGGAAGTTAATATTGAAAATCTAGATGTTGTAAATAAAGCACTAGAAGATGTCATCCGACAAAATAAAGATGACGTGGAAAAGTTAAATATTGCAGTTCGCAAAAGCTTCCAAACCATTGGGGATGTCACTTTTCAGATTCGCCAGAATAAAGGTACAAACGAAGCTGAAATTAAACGTGTGGAAGGTGTTGTGGCGACGGAAACAGAGGCTAGAGTACAATCGTTTGAATATCTTAATGCAAAAGTAGAAGGGGTTAATGGTACTCTTACAGGGGAACTTAACACATTTAAGGAAGTTTATGCCACAGACAAAGCTGTGCTTGTAACATGGCAGCAAGAAGCAATTGCAAGATTTGAATATAACGAAAGCAGTATTTTAGAAATTCAGGAAACAACATCAACACTAACGGAAAGTGTTGCACAACACACAAGACAATTAACTGCACAACAGTCAACTTTAGAGTCACAGGGTGTTACATTAGACTCTCAAGGCAAACTACTTAATGCACAAGGTTTGAAACTAGACGAACAAGGAAGATTAGTTGACTCACAAGGTAAAATTATAAACTCACAAGGCATACAATTAGATTCACAAGGTAAGTTGATAAATGATCAAGGTAAAGTAATAGATTCTCATGGTGTTGCTATTACGGAACATGCAAGTCGTATTACAAGCGTGGAAAAAGTTTCTGCTACCAACACACAATCCATTACTGAAAATAAACAAGCTGCTGATTCCAGATTTGCAAGTAACGAAGCTTCTATAAATCAAGCCCAACAAACTGCTGCAAGTGCTGAAGATGCTGCTGTCAAATTTGCTGTTCAGATGGCCGCAGAAAGCAAGAAAACACAAGAAAATATTAACGAATCTAAAGCAGAAATATTAGATGTTAAGAATATAGTTGCGAACCAAGAGCTTGCAATGGCTCAACAAATAAGCCAGCTTAAAACTGAATTTAATGGAAACATTGCAACTATTAACGGACAACTTAAAGTTGTTTCCGATGCAACAAGCGCTAATGCTTCAGCGATTCAAATTTTAGCAACAGATGTAGGTAACAACAAAGGACAAATATCCAGTATTCAAACTAGCATAACCACATTAGAAAAGTCTGTACAAGAAACCAAAGATCAATTGTATGCTCAAACACAATCCACAGACCAAAGGTTTACTGCTGTTAATCAAACTATAAACCAAACCAAAACTGAGTTGGAAAAGTCTATTGCATCGTCGAATCAAACATTAAGTTCACAGATTGCAACAGTAGACGGGAAAGCAGTGCAAGCAGGTAAAGATGCCGCGACAGCAAACAGTAATGCTGGTAAAGCTCAAACTACAGCTGATGGTGCAACTAAAAATATAAATGACTATAAAACAGCTAACGATAAGGAAATTGTTTTAGTAAAAGCAGACATAAAATCTAATAGGGAAGCTATAGCGACAGAAAAGCAAGCAAGGACGACAGATGTGACAAACTTGCAAGCATCTTTAAATAGCACCAATGCAAAAGTAGAACAAAAGATGGAAGCAGTTGTTGAACATAATGGAACGGTGGCAGCAACTTATACATTAAGAGCAGGAATAGAGTTACCAAACGGAACATATAAATCCGCCGGTTTATTTCTTGGTGTCAGTGGTGGGACAAATCCCGTTGCGTCTGTTGGAGTCAATGCAGATAATTTTGTAGTAATGAATAGTCGTAATGGGAAGCTGGAAACAGTGTTCCAAGTTGACTCCAGTGGTAATGTTGTTATTAGAAACGCACTTATTAGCAGATTGTTCGTAGAGGAAGCAATTGTCGGTTCCACACTTTCGTCTGCAGACTTCAGTGCAACTAAAGGTATACAGATAGACTTTAAAAATGGTAAGATTATTGCCAACGGGGGAACATGGGGCGCAGGTCTTAATGTTGGAAACCCTACAGGAAAAGGTTTATCCATTACAGATCAAACAATACTTGTGAGAGATCAAAATGGAAGACTTCGCTTTGCATGTGGTTATATTAAGGGGTTGGTATGA

Genome Context

Genome Context

Tertiary structure

PDB ID
9f16acc45c3f2839ed477dc574bef225a884956f1c0428fff567ace8efff004a
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,6413
Oligomeric State monomer
Model Confidence
Very high
pLDDT > 90
High
90 > pLDDT > 70
Low
70 > pLDDT > 50
Very low
pLDDT < 50