Protein
View in Explore- UniProt accession
- A0A6B9M3F5 [UniProt]
- Protein name
- Long tail fiber, proximal subunit
- RBP type
-
TFTF
- Protein sequence
-
MSDLIKQHFRATNGLDAGGNKVINVAKADRTVMSDGVNVEYLIQENTIQPWANDRGYPEGFAVTMEKRIWVARADIAAPIPPAVNTFKQGEWISMRVDPKWEQYSSGTTELLPGTYANIDTRVNPVTLVLPKNKVEQGDTIVIRDIGGKPGINQALIKVQDSAPAMIFQGSILRELQMTRPYSMLLLTFTSAGWYVTLSDLSSLARTIDSTTLDAATDVGAQVQSSEYIVRYYTSNKKLTVRLPRYANHGDMITFAEPEGKTPLYHFTIKTYDANSSIGTEGTTSWTSKIKGGGVLIYDGPRKVWRINSIDMQQRIKVVTDDVVMQPNEAITIFGANNSTVKTISVTLPTQVAPGDTVRIGMNYMRKGQTVNIVTPPAPAGGTKDRIATTVNLLQFPKRSEYPPDAAWTQVDSLSFNGTSDYPPVLELAYVEATPNNYWIVSENIPSVERVDWTNDTTRARVGVIALATQANLEANSSNLVDGVAVTPHTLSKRTATEARTGIAAIALSTDVLQNSNYAFINDKIITPKRLNERTATETRRGLAEIATQAETDAGTDDTTIVSPKKLNARKATATLDGIIQLVNIGGTPATVNREDAGQGIYDHNDFSKAVTPKTLRGYKATEIASGCVWLAKDSEVRNPPAINSNIPLVVTPQSLHKKVADTGNIGFIQIATQAEVNAGTDNTKAVTPKTFNDRIASETLTGIARFATQKEFDENTGGGMMVSTSKISTFFNRPERVAVRTEAGLTQQGTLWGQLVLNIQTPTETQRGTPKIATQALVNAGTDDVDYLTSKKLQAKQSSESAFGISRFATQNEVNAGTVNNRTVSPVHLKYVIQTSADWRAQDNVRGTVRVANGDTAWTGNSTTGSDDKPKEVNGYAVSPNGLKQALANYLPLNAKADNSGLLNGLTSDQFIRRDIDQTVNGKLTLTKSTDFNSDVNVKGLGNFTGGEVKVFATSSTANSHVRFLNSDGNERGIIYARPVAAGNSQQLTLRVKGSAPDTGKEFSFGNNGEFVAPDKITSNGTIHSASDVNSNTVYRVKNASVIQLQDSDSVASFGNLAKKGRILTNDASQTQVTDNSGNYVILTTKNKDTILDTRYVKSAGDTMTGNLTLNGSALVINGSEGWYDHTTTANTEKYARAGSWTVEIKNSAKLATLPGYVVPIREENPLVPGSMIVTGYEEKTGAGGLLAQISVSSDYTYQTWTPYPSNAEQSAKARTHTMWTRVYNPYIKKFDSWMRVYTSATPPTAADIGAPSSVSTSVKTLEVQEWIKIGPVKIYPDRTSQTVKFEWVGD
- Physico‐chemical
properties -
protein length: 1292 AA molecular weight: 140092,26160 Da isoelectric point: 8,42236 aromaticity: 0,07121 hydropathy: -0,37632
Domains
Domains [InterPro]
DC_1986
ATT
7–130
ATT
7–130
IPR048391
ATT
1138–1239
ATT
1138–1239
1
1292
Architecture
ATT 7-130 | STR 356-1137 | ATT 1138-1239 | STR 1240-1285 |
Legend:
ATT
STR
RBD
CBM
LEC
ENZ
CHP
LNK
TAS
TTP
UNK
Unmapped
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Klebsiella phage PhiKpNIH-6 [NCBI] |
2689112 | Uroviricota > Caudoviricetes > Marfavirus > |
| Host |
Klebsiella pneumoniae subsp. pneumoniae KPNIH1 [NCBI] |
1087440 | Pseudomonadota > Gammaproteobacteria > Enterobacterales > Enterobacteriaceae > Klebsiella > Klebsiella pneumoniae |
Coding sequence (CDS)
Coding sequence (CDS)
Genbank protein accession
QHB49324.1
[NCBI]
Genbank nucleotide accession
MN395284
[NCBI]
CDS location
range 10297 -> 14175
strand +
strand +
CDS
ATGAGCGACTTAATCAAACAGCATTTTAGAGCAACCAACGGGCTTGATGCTGGTGGAAACAAAGTAATCAACGTCGCTAAAGCCGATCGTACTGTGATGAGCGATGGGGTCAACGTTGAGTATCTTATCCAAGAAAATACCATCCAGCCTTGGGCCAATGATCGTGGGTATCCTGAAGGCTTTGCGGTTACCATGGAAAAACGTATCTGGGTAGCACGTGCAGATATCGCGGCTCCTATCCCGCCGGCAGTAAACACCTTTAAACAAGGTGAGTGGATTTCCATGCGTGTTGACCCGAAGTGGGAGCAGTATAGTTCAGGGACCACAGAACTTTTACCAGGGACCTATGCAAACATCGATACTCGTGTTAACCCGGTTACACTGGTTCTTCCTAAAAATAAAGTAGAACAAGGTGATACGATTGTTATCCGTGACATCGGCGGTAAGCCAGGCATCAACCAGGCATTAATTAAAGTACAAGACTCTGCGCCAGCAATGATCTTCCAAGGAAGTATCCTTCGCGAGCTGCAGATGACTCGTCCTTATAGTATGCTGTTGCTGACATTCACATCTGCAGGTTGGTATGTAACCCTTTCTGATCTGAGTTCTTTAGCCCGTACTATCGATTCTACTACATTGGATGCCGCTACCGATGTTGGTGCCCAAGTACAGAGCTCAGAATACATTGTACGTTACTATACTTCTAATAAAAAATTAACAGTTCGTCTTCCGCGTTATGCTAACCATGGTGATATGATTACCTTTGCTGAACCGGAAGGCAAAACACCATTATACCATTTTACCATTAAGACTTATGATGCAAATAGTTCTATTGGAACTGAAGGGACTACATCCTGGACATCTAAGATTAAAGGCGGCGGTGTTCTGATTTATGATGGCCCGCGCAAGGTATGGCGCATCAACTCTATCGACATGCAGCAACGTATCAAAGTCGTTACTGACGATGTAGTGATGCAACCTAACGAAGCTATTACCATATTTGGTGCTAACAACTCGACCGTAAAAACTATTTCTGTTACTTTGCCTACTCAAGTTGCTCCAGGTGATACTGTTAGAATCGGTATGAACTATATGCGCAAAGGGCAAACGGTCAACATTGTTACTCCCCCTGCCCCGGCTGGCGGTACTAAGGATAGAATTGCAACAACAGTTAACTTACTTCAGTTCCCTAAACGCTCTGAGTATCCGCCTGATGCCGCGTGGACTCAAGTTGATAGTTTATCATTCAATGGAACTTCGGACTATCCTCCAGTCCTAGAGTTGGCCTATGTAGAAGCTACACCTAATAATTATTGGATCGTTTCGGAGAACATTCCTAGTGTAGAACGTGTTGATTGGACCAATGATACCACAAGAGCCCGTGTAGGCGTTATTGCGTTGGCTACCCAAGCTAATTTAGAGGCAAATAGTTCTAATTTGGTCGATGGTGTTGCTGTTACTCCGCATACCTTAAGTAAAAGAACAGCTACAGAAGCTCGTACTGGTATTGCTGCTATTGCATTAAGCACAGATGTTTTACAAAATAGTAACTATGCTTTTATTAACGATAAGATTATTACTCCTAAACGTCTTAATGAAAGAACTGCTACAGAAACGCGTAGAGGATTAGCTGAAATAGCTACCCAAGCCGAAACAGATGCTGGTACTGATGATACAACTATCGTAAGTCCTAAAAAGCTTAATGCTCGTAAAGCTACTGCTACACTTGATGGCATCATTCAACTGGTTAATATAGGCGGAACTCCTGCTACAGTAAATAGAGAAGATGCCGGTCAAGGAATTTATGACCATAATGACTTTTCAAAAGCTGTAACTCCTAAAACTCTTCGTGGGTATAAAGCTACTGAAATTGCTTCTGGTTGTGTATGGTTAGCTAAAGATAGTGAAGTCCGAAATCCACCGGCTATAAATTCTAATATCCCGTTAGTTGTTACACCGCAATCTCTTCACAAGAAAGTTGCAGACACGGGCAATATAGGATTTATCCAAATTGCCACTCAAGCAGAAGTTAACGCGGGTACAGATAACACTAAAGCAGTTACTCCTAAAACGTTTAACGATCGTATTGCTTCTGAAACTTTGACTGGTATTGCACGTTTTGCTACTCAAAAAGAATTTGATGAAAATACCGGCGGCGGTATGATGGTATCAACTTCTAAGATTTCTACGTTCTTTAATAGACCTGAACGAGTAGCGGTAAGAACAGAAGCTGGGTTAACTCAACAAGGAACTTTGTGGGGACAACTTGTTCTTAATATCCAAACGCCAACGGAAACCCAGCGTGGTACTCCTAAGATTGCGACTCAGGCCCTTGTTAATGCTGGTACAGATGATGTTGATTATCTGACATCTAAAAAGCTTCAAGCTAAACAATCGTCAGAATCAGCTTTTGGTATTTCTAGATTTGCAACTCAAAATGAAGTTAACGCCGGTACAGTAAACAATAGAACTGTTTCTCCGGTTCACTTGAAGTACGTTATTCAGACTTCTGCTGATTGGCGCGCTCAGGATAACGTTCGCGGCACGGTCCGTGTAGCTAACGGCGATACTGCTTGGACTGGTAATAGTACTACTGGCTCTGATGATAAACCTAAAGAAGTTAATGGTTACGCAGTTTCACCTAACGGTTTAAAGCAAGCCTTAGCTAATTATCTTCCTTTGAATGCTAAAGCTGATAACTCTGGTTTATTAAATGGCCTTACTTCAGACCAATTTATTAGACGTGACATAGATCAAACCGTTAATGGTAAATTGACTCTTACCAAATCTACAGACTTTAATTCAGACGTCAATGTTAAGGGCCTTGGTAATTTTACCGGTGGCGAGGTTAAGGTATTTGCTACTTCGTCTACAGCCAATTCTCACGTCAGATTTTTAAACTCAGATGGAAATGAACGTGGAATAATTTACGCTAGACCGGTAGCTGCAGGAAATTCTCAGCAGCTTACACTACGTGTTAAAGGTTCAGCCCCTGATACAGGTAAAGAATTTTCTTTTGGTAATAATGGTGAGTTTGTTGCACCTGATAAAATAACCTCTAACGGGACAATTCATTCTGCTTCAGATGTTAACTCAAACACCGTATACCGTGTTAAAAATGCTTCAGTAATCCAACTCCAGGATTCTGATAGTGTAGCATCTTTTGGTAATCTTGCTAAGAAAGGAAGAATCTTAACAAACGATGCCAGCCAAACACAAGTTACCGACAATTCCGGAAATTATGTTATTTTAACCACTAAAAATAAGGACACCATTTTAGATACTAGGTATGTTAAGTCGGCTGGCGATACAATGACCGGTAACTTAACCCTGAATGGATCTGCTCTTGTTATTAATGGTTCTGAAGGTTGGTATGACCACACTACCACAGCAAACACTGAGAAATATGCAAGAGCTGGTTCTTGGACCGTAGAAATTAAAAACTCTGCTAAGCTGGCCACGCTGCCAGGGTATGTTGTTCCGATCAGAGAAGAGAATCCTTTAGTTCCGGGTTCTATGATCGTAACAGGTTACGAAGAAAAAACAGGCGCCGGCGGTCTTTTAGCTCAGATAAGTGTTTCTTCTGATTATACCTATCAGACATGGACTCCTTATCCATCTAATGCCGAACAGTCAGCTAAAGCAAGAACCCATACCATGTGGACCAGGGTATATAACCCATATATTAAGAAGTTTGATAGCTGGATGCGTGTATACACTAGCGCCACTCCTCCTACAGCTGCAGATATCGGCGCCCCGAGTTCAGTAAGTACTTCTGTTAAAACCTTGGAAGTTCAAGAATGGATTAAGATTGGCCCTGTCAAGATTTATCCTGATCGTACTTCTCAGACCGTTAAGTTTGAATGGGTAGGTGATTAA
Genome Context
Genome Context
Tertiary structure
PDB ID
f5a5eb71ce1e459dd269279d59bb86857a2678c4449ba8e33360e7627b3fda2a
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50