Protein

Genbank accession
BBG28764.1 [GenBank]
Protein name
large distal long tail fiber subunit
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,82
TF
Evidence RBPdetect2
Probability 0,94
Protein sequence
MATLKQIQFKRSKTAGQRPAASVLAEGELAINLKDRVLFTKDDQGNIIDLGFAKGGSIDGNVIHKGNYNQTGDYTLNGTFTQTGNFNLTGIARVTRDIIAAGQIMTEGGELITKSSGTAHVRFHDSADRERGIIFSPANDGLTTQVINIRVQDYKAGSESTFAFNGNGLFSSPEVFGWKSVSTPVIYTNKVITNKKVKDDYDIYSMADNVPLSESTTAINHLRVMRNAVGSGIFHEVKDNDGITWYSGDGLDAYLWSFTWSGGIKSSHSISIGLTPGPKDYSILGPSSIALGDNDTGFKWHQDGYYFSVNNGTKTFLFSPSETTSLRKFVAGYSTNGTDLTTPPTENYALATVVTYHDNNAFGDGQTLLGYYQGGRYHHYFRGRGTTNINTAGGLLVTPGNIDVIGGSVNIDGRNNASTALFKGNTTGSSSVDNMTISVWGNTFTNPSEGNRKNVMEISDATSWMSYIQRLTTGEVEMNVNGSFESSGVTAGNRGVHTTGEISSGAVNALRIWNADYGAIFRRSEGSLHIIPTAYGEGKNGDIGPLRPFSIALDTGKVVIPDLESSYNTFAANGYIKFAGHGAGAGGYDIQYSQAAPIFQEIDDAAVSKYYPIVKQKFLNGKAVWSLGTEINSGTFVLHHLKEDGSQGHTSRFNADGTVNFPDNVQVGGGEATIARNGNIFSDIWKTFTSAGDTTNIRDAIATRVAKEGDTMTGKLIVKRGSDAINIAADENDSCYLLGTSGGANSWYIGKGGADDTASFYNFKTTAGITLNSVGDIDFNVKNQATAASLNFYRLYLNGRQWTATQGHGYNNQWQTEAPFFVDFGESVPKDSYMPIIKGRSQIINEGYATKADFGIIRLGGNATWGNAVIRVGSAESGDSSHPNAIFVFQANGDFKAPAGLRAGVNLGVGTIPVWGGASIAIGDDDTGLVHGGDGRINMYANSQHIASWGTMYQSHPGLWDSNGAFWTEVGKAIISHGHLVQANDSYSTYVRDVYVRSDIRVKKDLVKFENASEKLSKINGYTYMQKRGLDEEGNQKWEPNAGLIAQEVQVILPELVEGDQDSEALLRLNYNGVIGLNTAAINEHTAEIAELKSEIEELKKLVKSLLK
Physico‐chemical
properties
protein length:1108 AA
molecular weight: 119389,84220 Da
isoelectric point:5,68279
aromaticity:0,09838
hydropathy:-0,33646

Domains

Domains [InterPro]
Legend: Pfam SMART CDD TIGRFAM HAMAP SUPFAM PRINTS Gene3D PANTHER Other

Taxonomy

  Name Taxonomy ID Lineage
Phage Escherichia phage KIT03
[NCBI]
2218499 Viruses > Duplodnaviria > Heunggongvirae > Uroviricota > Caudoviricetes
Host No host information

Coding sequence (CDS)

Coding sequence (CDS)
Genbank protein accession
BBG28764.1 [NCBI]
Genbank nucleotide accession
AP018932 [NCBI]
CDS location
range 153509 -> 156835
strand +
CDS
ATGGCTACTTTAAAACAAATACAATTTAAAAGAAGCAAAACGGCAGGTCAACGTCCAGCTGCTTCAGTATTAGCCGAAGGTGAATTGGCTATAAACTTAAAAGACCGTGTACTTTTTACTAAAGATGACCAAGGAAATATTATTGATTTAGGTTTTGCTAAAGGCGGTAGTATTGACGGGAATGTTATTCATAAAGGCAATTATAACCAAACTGGCGATTATACTTTAAACGGTACATTCACCCAGACTGGTAATTTTAATTTAACCGGTATTGCTCGAGTAACTCGTGATATTATTGCTGCTGGGCAGATTATGACTGAAGGCGGAGAACTTATTACAAAAAGTTCAGGAACGGCACACGTTCGTTTTCATGATTCCGCCGACCGTGAACGCGGTATTATTTTTTCTCCTGCTAATGACGGTTTAACTACACAAGTAATTAACATCAGAGTTCAAGATTACAAAGCCGGTTCAGAAAGCACTTTCGCTTTTAATGGAAATGGTTTGTTTTCTTCACCAGAAGTTTTTGGGTGGAAATCTGTATCAACTCCGGTAATTTATACCAATAAAGTTATCACCAATAAAAAAGTTAAAGATGATTATGACATCTATTCGATGGCAGATAATGTTCCATTATCTGAAAGCACTACTGCTATTAATCATCTTCGTGTTATGCGTAATGCAGTCGGTTCTGGTATTTTCCATGAAGTTAAAGATAATGATGGAATAACATGGTATAGTGGAGATGGATTAGATGCTTATCTGTGGTCATTTACCTGGAGCGGCGGAATTAAATCAAGTCACTCAATTTCCATCGGTTTAACACCCGGACCTAAGGATTACTCAATATTAGGACCGTCTAGTATCGCTTTAGGAGATAATGATACTGGATTTAAATGGCATCAAGACGGATATTATTTCAGTGTTAATAATGGCACAAAAACGTTTTTATTTAGCCCTAGCGAAACAACTAGCCTAAGAAAATTTGTAGCTGGATATTCTACTAATGGAACCGATTTAACTACTCCTCCGACTGAAAACTATGCTCTTGCTACTGTCGTGACATATCATGACAATAACGCGTTTGGAGATGGTCAGACTCTTTTGGGGTATTATCAAGGCGGTAGATATCACCATTACTTTCGCGGAAGAGGAACAACTAATATTAATACTGCTGGAGGGTTATTAGTTACTCCTGGTAATATTGATGTTATTGGCGGTTCTGTTAATATCGATGGTAGAAATAATGCTTCTACAGCTCTGTTTAAAGGTAACACAACAGGTAGTAGTTCTGTGGATAACATGACAATTTCTGTGTGGGGTAATACATTTACTAATCCAAGCGAAGGTAATCGCAAAAATGTCATGGAAATTTCCGATGCAACTAGCTGGATGAGCTATATTCAAAGACTTACTACTGGTGAAGTAGAAATGAACGTTAACGGTTCATTTGAATCATCTGGTGTTACTGCTGGAAATAGAGGAGTTCACACAACAGGCGAAATTTCATCTGGAGCAGTGAATGCTCTTCGCATTTGGAATGCAGATTATGGAGCCATTTTTAGACGTTCAGAAGGTAGTCTTCATATTATTCCAACTGCTTATGGTGAAGGCAAAAATGGTGATATCGGTCCACTTCGTCCATTTAGTATTGCTTTGGATACTGGTAAGGTTGTTATTCCAGATTTAGAATCAAGTTATAACACGTTTGCTGCAAATGGCTACATTAAATTTGCTGGTCATGGCGCGGGTGCAGGTGGTTATGATATTCAGTATTCACAAGCTGCTCCTATTTTCCAAGAAATCGATGATGCTGCTGTAAGCAAATATTATCCTATTGTTAAACAGAAGTTTTTAAATGGTAAAGCTGTCTGGTCTTTGGGTACTGAAATTAATTCTGGTACATTTGTTTTACATCATTTGAAAGAAGATGGTTCACAAGGCCATACATCAAGATTTAATGCTGATGGTACAGTTAACTTCCCGGATAACGTTCAGGTCGGCGGCGGTGAAGCTACTATTGCTCGTAATGGTAATATCTTCTCTGATATTTGGAAAACATTTACTTCTGCCGGAGATACTACAAATATTCGCGATGCAATAGCTACTCGTGTTGCCAAAGAAGGCGATACGATGACTGGCAAATTAATCGTTAAAAGAGGCTCTGACGCTATTAACATTGCTGCCGATGAAAATGATTCTTGCTATTTACTTGGAACATCGGGTGGAGCGAATTCATGGTACATCGGTAAAGGAGGAGCAGATGACACTGCTTCATTTTATAATTTCAAAACTACCGCAGGAATTACTCTTAATAGTGTTGGTGATATTGATTTTAACGTTAAAAATCAAGCTACTGCAGCTTCATTAAATTTTTATCGTTTATATTTAAATGGAAGACAGTGGACAGCTACACAAGGACATGGATATAATAATCAATGGCAAACAGAAGCCCCATTCTTCGTTGACTTTGGCGAATCTGTTCCGAAAGATAGTTATATGCCTATAATTAAAGGAAGAAGCCAAATCATTAACGAAGGATATGCCACAAAGGCAGATTTTGGTATTATTCGATTAGGCGGAAATGCTACTTGGGGAAATGCAGTAATTCGTGTTGGTTCTGCGGAAAGCGGAGATAGCAGTCATCCTAATGCAATATTTGTGTTTCAGGCTAATGGTGATTTTAAAGCTCCGGCTGGCCTTCGTGCTGGTGTTAACTTGGGCGTCGGCACAATTCCAGTATGGGGCGGAGCATCTATCGCCATCGGGGATGATGATACCGGTTTAGTTCATGGCGGTGATGGTCGAATTAATATGTATGCTAACTCGCAGCATATAGCATCATGGGGCACAATGTATCAATCTCATCCAGGCCTTTGGGATTCGAATGGAGCTTTTTGGACAGAAGTTGGCAAAGCAATTATTTCTCATGGCCATTTAGTTCAGGCGAATGACAGCTATTCAACGTATGTCCGCGATGTTTATGTCCGCTCTGATATTCGTGTTAAAAAGGATCTAGTTAAATTTGAAAATGCTTCTGAGAAGCTTTCAAAAATTAATGGTTACACTTATATGCAGAAGCGAGGCCTAGATGAAGAAGGTAATCAGAAATGGGAACCAAACGCTGGGTTAATTGCTCAAGAAGTTCAAGTTATTTTACCTGAATTGGTTGAAGGCGATCAGGATAGTGAAGCTTTACTTCGTTTGAACTATAACGGTGTAATTGGTTTAAATACAGCTGCAATCAATGAGCATACTGCAGAAATTGCAGAACTTAAGTCAGAGATTGAAGAGCTTAAAAAATTAGTTAAATCATTGTTAAAATAA

Gene Ontology

No Gene Ontology terms available.

Enzymatic activity

No enzymatic activity data available.

Tertiary structure

PDB ID
5111c0a379298a33addbb80fbdff33cebdc238311b1931f2bcfac60014201b0a
ESMFold
Source ESMFold
Method ESMFold
Resolution 0,5298
Evidence 0,5298

Literature

Title Authors Date PMID Source
Complete genome sequence of bacteriophage KIT03, a T4virus infectious both E. coli O157:H7 and Salmonella Pham-Khanh,N.H., Nakayama,T., Truong,T.B.V., Miyanaga,K. and Kamei,K. 2019-07-24 GenBank