Gene or accession: CG2272 Release: 1 Gene annotation error Gene CG2272 has incorrect exon/intron structure or translation start site. Gene cDNA sequence: >CAGCAACTGGTTTATGTGAGCCACAACAAAATGATCGACAAAACCTTGTTCTACCACAAATATTAACAATTACCAATA TA AAGGTATTTAAACAACTACCTTGATCACAATTTTAGTTAAAATTATGCCAACGAACTGGAACCAAAATCCCAGGTGAACC GCAAATGTAACCAGTTCACTCGGCTGGGTCCAAAGACCAGTTCAATTAAACTAGTTCACATTTGAACAGTGCAACTCTAG TTTTTTTTTTTTAATACATATGTGTTTAAAAAACATATGCAGAAACGGGCTAATAAAACGGATATAACCGATTGCACAGG ATCAAGGATAGATCAAAATAACCGACGACGTTAACGGCGACTGCGACTGCGAGAGAGCGACCATGGTGTGCAGCAGCGCG TGTGCGTGTGTGTGTGTTTTGTACCGTGTTGTCTGATTGTGTGCCGTTGTTGTTGTGATTGTTGTTCTCGCTGTTGCTAT TGTTTTTGCTCTTGTGCGTGTGGTCAACGGACGGACAGACGGACGGACAGTGGGACACAAGGAGAGTGGAGAATCCGAAT CCGGTGGGCAGGAGAGCAGGATTAGCCGCAACATCCTTACCCCGAAACAAAAGCAAGTTAAAAAGCGAAGGAAGCAAAGA GAAAACAACAAAAAAGGAAAAGAAGCAGAAAACAAAAACAAAGAAGAGATTCATGGTTTCCATGTCGCCAACTGTGCGCC TCTGATGCCCTCGCAGGTCTCCCGAGGATTGGACACCACCAACATGCTGCCGATCAGCGAGGAGCAGCAGCTGCAACAGC AGCAGCAGCAGCAGCAGTTAGAGCAACTGCATCATCCGCAGATACCAGAGATTCCCATACCAGATCTAGAGCAAGTCGAG ACCCAGGTGGGCGATGGCAGCCTGTGGACCGCGCTGTATGACTACGATGCCCAGGGCGAGGATGAGCTGACACTGCGACG CGGCGAAATCGTTGTGGTCCTGTCCACGGACAGCGAGGTGTCTGGCGATGTGGGCTGGTGGACCGGCAAGATTGGAGATA AGGTCGGTGTCTTTCCCAAGGACTTTGTCACCGATGAGGACCCACTGCAACTGAATGTCTCGTCCGCCATTGGCGACATC CAGCCGCATGAGATCGAATACAATGAGCTGGACATCAAGGAAGTTATCGGCTCCGGTGGCTTCTGCAAGGTCCATCGTGG CTACTACGATGGCGAGGAGGTGGCTATTAAGATTGCCCATCAAACGGGCGAGGATGATATGCAGAGGATGCGGGACAATG TCCTGCAGGAGGCCAAACTGTTTTGGGCCCTCAAGCACGAAAATATAGCAGCCCTGCGAGGAGTATGTCTGAATACCAAA CTCTGTCTGGTGATGGAGTATGCCAGGGGAGGAAGTCTCAATCGCATACTGGCTGGCAAGATACCACCCGATGTACTAGT CAACTGGGCCATTCAGATAGCCAGAGGCATGAACTATCTGCACAATGAGGCGCCCATGTCGATCATACATCGCGACCTCA AGTCCTCCAATGTGCTGATCTACGAGGCCATCGAGGGCAATCATCTGCAGCAGAAGACGCTCAAGATCACGGATTTCGGT TTGGCCAGGGAGATGTACAACACGCAGAGGATGAGTGCGGCGGGCACGTACGCTTGGATGCCACCGGAGGTCATCAGCGT TAGCACCTATTCCAAATTCTCCGATGTTTGGAGCTACGGTGTCTTGCTGTGGGAACTGATAACGGGCGAGACGCCCTACA AGGGCTTCGATCCGTTGTCCGTGGCCTATGGCGTGGCTGTTAACACGCTGACATTGCCCATACCAAAAACCTGCCCCGAG ACGTGGGGAGCCCTGATGAAGAGCTGCTGGCAAACGGATCCGCACAAGCGACCGGGCTTCAAGGAGATTCTCAAACAGCT GGAGAGCATCGCATGCTCCAAATTCACCCTAACGCCCCAGGAGTCGTTTCACTACATGCAGGAATGCTGGCGAAAGGAGA TCGCTGGAGTGCTACACGATTTGCGCGAAAAAGAAAAGGAACTGCGCAACAAGGAAGAGCAGCTGCTCAGGGTGCAAAAC GAGCAGCGCGAAAAGGCGAATCTCCTGAAGATCCGGGAGCAGAATCTGCGCGAGCGTGAAAGAGTGTTGATCGAACGGGA GCTTGTCATGTTGCAGCCGGTGCCATCGAAACGCAAACACAAAAAGGGCAAAAAGAACAAACCACTGCAGATATCGCTGC CCACGGGCTTCCGGCACACGATTACGGCTGTACGCGACAAGGCGGAACAGCCGGGATCACCTTCCTTCTCCGGATTGCGC ATCGTGGCACTGACCGATGGGCACAAGGGCAAGACGTGGGGCCCGTCGACGATGCACCAGCGGGAGCGATCCCTATTGCC TTCGCAACTGAGCGGCGGTCAGCCGGAATGGCCCGCCCAGACCTCAACTCACTCCTCATTCAGCAAGAGTGCTCCGAATC TGGACAAGAAGCAGCAGCAGCAGAACCAGCAACAGGTGGCCTCGCTGACACCGCCGCCGGGTTTGGGAATTTTGGGTGGA AGTGGAGGCGCTGGTGGGACGCCGGCCACACCATTGTTGTACCCAGGTATACCCATTATACTAACGCGCCCCAACAACAA CAACATTGGCAATTGTAAAGCCATCACCACCACCATCACAACTACCACCACCACAACCACCAACAACAACAACAACAACA ACAACAGCATCTCCGCCAACAACAACAATCAGCTAAATAATATTAGTACTATTAATAGCAATAACAATAACAATCAAACT AACCTGACCTCCCAACCGAACACGATAATTGTCCTCCAAAACGGCCGGAACAACTCCAACAGCAGCACCACCAGTCAATC CCCAGCCAAGATCTACCATCGCGCCAGGAGCCAGGAGTACGGACTTGATCATCCGCTTGCTTATCAGCCACCACCACTCT ATTTGGTAACGGATGACAGCTCGGAAACGGACACCGTTGCCAGTCCGACCGGTTGCTTTCACTTCCTGAAGTCCGGCAAT TCATCGGCGGCCAGTGGTGCCGTGCATCTGCATCGCTTTGGCGGCAGTCTGGGCAACAGTCCAGCTGTGGGCAGAAAGAA GCATTCGCTGGACAGCAGCAGTCATCATCCGCCTGCGAACGGTAGCAATAGCTTTGCACTGCCCAACCAGTTAACTCTGC CATCGGAGGATAACAATACGTATGACCATGCCTTCTATCGGGATGTGATCAAAAAGATGTCCATGGCCAGCAGCGAAAGG GTAAACTCCAAATCCAGTGGCGACCTGACCATGTACAACTCCAGCACACCGCTGACTGCCAGGGATTGCGATGATGCGGA GGAGGCCTTCGAGGGTGGACGCTTTCAGCGTAACTTTTCCGGCTCGCAGTTTCCACGGCACTGCTTCTTCACCAGGCAGG AGGAGGAAGGGGAAGCAGAGGATGAGGACGCGGTGGCGGCGGAGGTGGACACAGCAGATGCGGATGCCGACGATGAGTGT CAAGTGCCCGCCAGTCAGATGCGCCAGAACTCCACCACGTCGCGCAAGAGTTCAGTGACCTTCCAGAGCGTCAGTTTCGA AGAGCCCGATTTTGTGGCCACGCCGCGAACGACTGCCAGATCGGATCTATATACATCCAGTGCCTCAATTAGCTTCGCCA CCTACCGCTCCGCCTCGCCATCGCTGTCCTCATCGTCCACCACTGCGTCCGCCTCACCGTCCATTGCTTCTACGGAAGCC GTGAACGGCTATCACATGCAGGAGAACTCCATACTGAATACGCGTCGGATGCAAGATGTTCAGCCGCATCCCGATGTCAT TAAGCTGCGGGCCCAGGAACAGCGCCAGCAGACCAAGAACCAAAAGAAGCAACGGCCCAAGCACATAACCAAATCCAAGT CTGTTGAGGCGCCAGTCGAGGGACAGCACCATGAACATGATGACCACAATGATCCCCAGCACCAGCATCACTCGGCTGGA TCGAGCAAAATCCGTGCCCTTTTCAATCTCTTTACGCGCTCGCGAAAGAAGTACAGCAAGCTGGCGGAGCACAACATGGT CGGTGGACCCGAGTTCTGTGCCATTGATCCCTATCAAACCGATTTGGCGATGGGGGGCAGCAGTCGCTCTTTGAAGCGCA AAGGCAAAAAGCCGCAGACGCAATCCTGCGAGCAACTGGAGCGATGCTAAAGTCCCAGTTGTGCGCCGTGCTGCAGTGTT TGCTGTTGGGAGTTGGCCCGCCAGATGAGAACCGCCTAATTTAGCTCATTGTTTTTATATTAAAACTGTAGACTTAAGTC AGCACGCAAANGGAAGAGCCGAAGARNATGAAACAGCAGGCGNAGGATTAGCCATAGCTAATGTGTGAAATTAGTAGGGC CCAGAGATACAGATACCTATCCGAATTCTTTCCGTCTKAACGAAATCATAGAACTAAACAAAAAACCCCTCTGTCCGCGG TTGGCATTTCATAATAACCGAATTGTTCCTAACGAATGCAATATGTTGTGCGAAATTCACAAATCAAGTTAATCCCTAAT TAGTCCAGTGATTTGTTTTGTTTTTTTTTTTGTGCCAGAGGAGTGGCTAGAAAATTGCAATGTGTAGCACAGAAGTGAGG ACGAACTTTTGAGGATCAAACGGATAGATAGACTAACGCCGCTTGTACGTAGACAAACAGACACGGAGAGAAAAAACGTG TGCATGGGCCAATGGCAAAATATATTGAACTAAACCATATACATAAATGTGTAACAATTGGATTAACATTAAGCTATATT TATACCGATGCGTAAGTGCGTCCTTACACATTACACATTACACACATCTTAGTTGAACTAAGTTCTAGTTTTGTAGGAAC TCGAACATTTTTTTGGAGTCCTTCCTCCTTTTTTTTTCACCCCCTCAATCTTTGTAAGAGATATTTTCCAAAATTTCCAT CGCTTGCGGCATTTCGTTTGGCTTAAGTACACTTAACGAAAAGTTGCGGTGCACATTAATTTTAATTTGATATTCGACTT TTTTGGTATTTTGAGCACAGTTTTATTTACATACATTTATTATGCAATCGGGTTTTCCATTTTATTTATTTATGATTTAT TTCTACAAA Protein sequence: >MPSQVSRGLDTTNMLPISEEQQLQQQQQQQQLEQLHHPQIPEIPIPDLEQVETQVGDGSLWTALYDYDAQGEDELTLR RG EIVVVLSTDSEVSGDVGWWTGKIGDKVGVFPKDFVTDEDPLQLNVSSAIGDIQPHEIEYNELDIKEVIGSGGFCKVHRGY YDGEEVAIKIAHQTGEDDMQRMRDNVLQEAKLFWALKHENIAALRGVCLNTKLCLVMEYARGGSLNRILAGKIPPDVLVN WAIQIARGMNYLHNEAPMSIIHRDLKSSNVLIYEAIEGNHLQQKTLKITDFGLAREMYNTQRMSAAGTYAWMPPEVISVS TYSKFSDVWSYGVLLWELITGETPYKGFDPLSVAYGVAVNTLTLPIPKTCPETWGALMKSCWQTDPHKRPGFKEILKQLE SIACSKFTLTPQESFHYMQECWRKEIAGVLHDLREKEKELRNKEEQLLRVQNEQREKANLLKIREQNLRERERVLIEREL VMLQPVPSKRKHKKGKKNKPLQISLPTGFRHTITAVRDKAEQPGSPSFSGLRIVALTDGHKGKTWGPSTMHQRERSLLPS QLSGGQPEWPAQTSTHSSFSKSAPNLDKKQQQQNQQQVASLTPPPGLGILGGSGGAGGTPATPLLYPGIPIILTRPNNNN IGNCKAITTTITTTTTTTTNNNNNNNNSISANNNNQLNNISTINSNNNNNQTNLTSQPNTIIVLQNGRNNSNSSTTSQSP AKIYHRARSQEYGLDHPLAYQPPPLYLVTDDSSETDTVASPTGCFHFLKSGNSSAASGAVHLHRFGGSLGNSPAVGRKKH SLDSSSHHPPANGSNSFALPNQLTLPSEDNNTYDHAFYRDVIKKMSMASSERVNSKSSGDLTMYNSSTPLTARDCDDAEE AFEGGRFQRNFSGSQFPRHCFFTRQEEEGEAEDEDAVAAEVDTADADADDECQVPASQMRQNSTTSRKSSVTFQSVSFEE PDFVATPRTTARSDLYTSSASISFATYRSASPSLSSSSTTASASPSIASTEAVNGYHMQENSILNTRRMQDVQPHPDVIK LRAQEQRQQTKNQKKQRPKHITKSKSVEAPVEGQHHEHDDHNDPQHQHHSAGSSKIRALFNLFTRSRKKYSKLAEHNMVG GPEFCAIDPYQTDLAMGGSSRSLKRKGKKPQTQSCEQLERC Comments: This is the nucleotide sequence of EST clone GH26507 derived from the predicted locus, CG2272. The longest ORF is translated.