Subject: projectin (CG1479) here is finally the corrected annotation. The corresponding analysis is in press in JMB. I will let you know the exact reference ASAP. The attached file is in Word format. It contains in that order; 1) the genomic sequence with lower case for introns and upper case for exons; 2) the cDNA sequence including all exons; 3) the amino acid sequence. If you need coordinates for exon-intron splices and or aa motifs let me know. Thank you for your help, Agnes ayme-Southgate \------------------------------------------------------------------------------ -- Total genomic sequence from ECORI#2short to 24R4 aagagcacctattctttggacctgccagtaatagactaaagctcgtggagTACGCTTCGT TTTCGCAGAAGAATTAATTTCGTTCTGTGTTCAATCTGTGTTACTTGTAGCCCAgtacgt accaagtgaaaaaaatttttaaacacacctcaaaataaatatttaattaatgaatatatgtttatattctacggctgac cacagctatagttgcagtattttttatttaaattcccttctgtcgaccactttgttattttaagggcgatggctcattc tacatatgcacactaaatataaatggctacgaataatttaagtttttatgtgttcttatttctaaagtgaagtgaaact aaacctaaaatgataattattctagaattgttataattccataattaagaaaaaggatatcgaagtgttttacgcttgt agcatattgtaaagaaattgagttcgttttattctacacagatatttcacatctgttcatggcgttgtgtaacacgttg ttgttgataaaaatagactttgaaacaaccaaaaaaactgatatgagaaattcgcaaacttaactcagctctttaaaac tgttgtatttttattaataggaggcaagcacgttttagataataagcggatatcctctttgtctgattttcccttatac cgtttccttttgtttaaataatctatgttgtatccggatatttatatattgccacgaatctatctacgaatatatacat atttgtgtgagtttagtattcgaatgttcaggtttatttctcagccggtgactgcgaacggctaaaaatagacatgcaa tacatgaattttcgtttattcagtaaaatgttttccatcaacaatatctatgctgaatgaagaaaaggcgatcgaattt ccgaattccaaaacttagtgggtcgtgtgcaactctaaatacataaatacgtgtgtatcgttctagtttattgtgattc ggtttattttttagttacattgttagataacggaaaatagccaatcatagagtatttaaatttaatatattgggataat ttctaaacgccaaaaaaacccttttatttttaaataaaacttactatgccctgccctgaactaatagggccgttggaga ttaaaatccaaagaatatttacttgtttgatcttggttaaaaatacacattgaataatctttacaacatgaaatttgta tttgtttgtctattgttccaaaacggtatttcagtgtcctgagcaattttttctgtttcattcagCCATAGACTCACAG CCGTTGAAGACGAAGCTTAAGGAAAACCCTCAGCATGGGGGTGGCTGAAGATTTCGCTCCCAGCTTTGTTAAAAAGCCA CAACTGCATCAAGAAGATGATGGCAATCGATTGATATTTGAGTGCCAGCTATTGTCATCCCCGAAACCGGACATTGAAT GGTTTCGAAGTGACAATAAAGTAGTAGAAGATGTCCGAACCAAATTTAAAATTCAACCCGTCGGAGAAAATAAGTATAC GGTTGTATTGGAGCTTGACGATGTAGTTGAAACGGATGCCGGACTTTATAAAGTCAAAGCAAAGAACAAGTCGGGCGAA GTCTCTGCGTCTATTAATTTAAATTTCACACgtaagtcggccagttttaaatacctttgcaaatgaattagtgttccag aaaaaaagattgataaatagcgaagaattcatttccggttttataaagaaacgttctgctcgaaccaaatccatttatt agattgagtttggtttctatatatattcggatagccggtacacgtttttatgattgttgcttaatattaatatgaactt aatttaaccttacagagggtatattgattttagccatatgcaatgcagcctttttcgatattcgcttcctgcggttgaa agtagacttttgtgatagtttcatgctgaaagttttatattttatagataaattttagctgtttgggtatttacatata tatcagcgttgcaaacttctgaatgaaatcaatataccctctgctattatttcgtgtacctgtaattttttaatttgca attattccaaggatatacatttaatagactcgacttgcagaaacgaacttcttattttatttattttgatggttaatga ttcgttgacaatattagatgatttttaaaaattaatattcataacatttgcgtctacaaaaatattaaaataattttaa aattttactctaccgtcgtaaaaaactctagCTGCTGACGAACC Total cDNA sequence for projectin or bt(CG1479). Nucleotide 1 to 2707 represents the erroneous gene CG10285. Nucleotide 2708 to 4489 is the sequence previously classified as intergenic. Nucleotide 4490 to the end is the 'old' projectin sequence as previously published. TACGCTTCGTTTTCGCAGAAGAATTAATTTCGTTCTGTGTTCAATCTGTGTTACTTGTAGCCCACCATAGACTCACAGC CGTTGAAGACGAAGCTTAAGGAAAACCCTCAGCATGGGGGTGGCTGAAGATTTCGCTCCCAGCTTTGTTAAAAAGCCAC AACTGCATCAAGAAGATGATGGCAATCGATTGATATTTGAGTGCCAGCTATTGTCATCCCCGAAACCGGACATTGAATG GTTTCGAAGTGACAATAAAGTAGTAGAAGATGTCCGAACCAAATTTAAAATTCAACCCGTCGGAGAAAATAAGTATACG GTTGTATTGGAGCTTGACGATGTAGTTGAAACGGATGCCGGACTTTATAAAGTCAAAGCAAAGAACAAGTCGGGCGAAG TCTCTGCGTCTATTAATTTAAATTTCACACATGGTAAGTTTTCACTTCTGGAAAACGAGGGACAAATCGACGGATTCGC GCCGACATTCGCGAAAAAACCCGCCATACGACAGGAAGAAGATGGAAAACGATTATTATTCGAGTGCCGCGTTAACGCT GATCCGATACCCGCCATTATTTGGTTCCATAATGGAGCTGCTGTCAAGGAATCAGAACGCCATAAGATTACTGTGGACA AAGACGTTCATTCATATTTTGCAACACTTGAAATACTAAATGTAACAGTTGAGGATGCTGGAAAATACAAAGTGAATGC AAAAAACGAATTGGGCGAAAGCAACGCTACAATAAGCCTAAACTTCGACAGCGACGAAGCCCCCGTGCCGGAAAGCGCA GAAGGCATTAAGCCAACTTTTACCGAACGCCCGGTAATTCGTCAAAGCGAAGATGGTGGAAATGTAACGTTCGAGTGTA GATGCGTTGGAGATCCCACGCCAACAGTCACATGGTCCCATGGCGAGACTGAACTAAACGAATCAAATCGCTACAAAAT GTCTTTGACAATGGATCAAAAACTATATCACATTGCGTGTCTTGAGATTAGCAGTGTGGTATCATCTGACCAGGGTGAA TATCGCGCGCAAGCGAAAAACAAGCACGGTTCTGGCGTCGCAACTATTAATCTTAATTTCGAAAGCGGCTCGAAAAAAA TTCCGGATGGAAAGTCGCCGCGCTTTCCGAAAAAACCAACGATCCGCCAAGAAGAAGACTTACTCATCATGGAATGCGT TTTGGAAGCGCATCCGGTTCCGGATATAGTCTGGTATTGCTCAGAAAAGGAAATCTGTAACAATCAAAGAACGAAAATG ACTCGCAAGGCAATAACTAAAGACAGCTACATTCTAACTCTGGAAATCCAAAATCCCACCAAAGAAGATGGCGGAAACT ATCGTTGTAACGCAATAAATATGTATGGCGAAAGTAATGCAAACATTGCGCTTAACTTTCAAGGTGCGAGCGATGCTAA CGGGTTTGCGCCGTCTTTTATCGAAAAGCCGAGAATCATCCCAAATGAATCAGGCACATTGATCACCATGAAGTGCAAG TGCAAGGCCAAGCCCGAACCCACAGTAACTTGGTACAGGGGTCAAGACTTGGTGGAGAAGAGTAAGAAGATAAAAATTA ACACAACAGTTATTGCAGAAGACACGTATGAGCTGACACTTGAAATTAAGGATCCGGGAGCAACCGATGGTGGGACCTA CAGATGCAATGTCAAAAACGAATACGGTGAATCAAACGCAAATCTAAACCTTAACATTGAAGCGGAACCGGAGCCCGAA GGAGAGGGGCCAACATTCATAGAAAAGCCACGCATTGTTTCTGAGAACAACGGCAAATTGGTTATAATGGAGTGCAAGG TCAAGGCAGATCCGAAACCAGATGTCATTTGGTTTCGCAACGGAGAAGTCATCAAGGAAAGTAACAAAATTAAGACGTT TATTGAACAGCGTGGCGACCAATACTACATCAAGCTGGAGCTATTAGATCCGCAACTAGAGGACTCCGGCCTTTACAAG TGTAACATTAAGAACACGCTGGGCGAACTTAATGCCAACCTTACCCTGAATATAGAGATCGTTCCTGTTATAAAGGATA AGCCAAAAATTATAAAGATTATAAAAAAACGTACTGTAGTCATAGAGTGCACAGTAGCATCAAAATTCGAACCCAAGTG TACCTGGTACAAGGAAACCAGCACTGTAAAAGAGAGCAAGAGAC ACAATTAACAAAGGCAAATGCAACGGAGCAGTTCTCTCCCACAAAAGCAGTCAAGGCACAAGTCGCTGACTTGAAGAAG CCTGAAACTTTAGCAACCCTTGAGGATAACTATGAGCGGCCCGTTTTAGAAAAATATGATCCTTTTAGCATTGATAAGA CCAAATCAGAGAAATCCACACCATCCATTATCACCCCGGACATTAGAGGTCCCGAAGTAAAGTTGCCTGAGGAGAAGCA AAAGGTCCCTAAAATGCAACCACCTGCTCCAGGTGACCCACCCAAGATCGAAGTGATTCGGGAGAAGCGACCATCACTG GCACCAGAGCCCCCAAGTCGCCGCGGATCTCTTATACCCCCCGCTGATACTGGTCGACGACCATCTCTGATCATCAATG ATGAGAAGAAACTTCGTCCTGGGGAAGTAATGGACACGCGGTTATTGAGGCCAGGCGAGGTCGGTGAAGGACAGCGGCG CAGACCGTCGATTGATGTACGCCGCCCAAGCGTGCAAGATCTAGAAGATCTTATTAACAAGCCATCCACACCCTTACGC GATGTCGGCGATGGCGGTCCTCCTTCTATCGTTGATGTCCAAGAGTCTTACTCTGTTGTGGAAGACTCGACTGCTTACC TCACTGTTGGCGTCGAAGGTAGTCCAGCACCTACGTTCAAGTTCTACAAGGGAGTTAGCGAGATTCTTGAGGGCGGTCG GTTTAAGTTCCTCACAGATGGGCAAACAAACACAATTACATTGTGTATGCGTAAGTGCAAGCCCAATGATGAAAGCAAG TACAAGATAGTTGTTTCGAACATTCACGGTGAGGATTCAGCCGAAATGCAACTCTATGTATCTGATTCAAGTGGTATGG ACTTCCGTGCCATGCTCAAAAAACGTCGTTATCAAAAATGGGACAAAGACGAACAGGACCCCAATTGGGGCGACCTTAA AGAAACAGAAAAACCGTTGCCGGCCCTTAAAAAAGTTGAAAGGAAGGTTGAGTCGTTCCTCAGTCCACTTATCGATCAA TTTGCAAAAGAGGGAAAGGACAAAAAGGTTGTTTTTGAAGCCAGATTCAGCAAACCCAATTGCAAGCCCAAGTGGCTGT TTCGAAAAGACGAGGTGTTTACCGGCAGTAAATTTAAATTTAAACAAGAAAATGATACTTATCAGTTGATTATTACGAC ACCGAAAGTCGAGGACACCGGCAAGTACACGATTGAAATCGGCGGTGTTTCAAGTACAGCATTTTTGAATGTCGAAGAA GCCGATCCCACCTACACTTTTACGAAACCCCTTAAAAAGAAACTTGAGGGATTCACTCAGCATGAGACCACTCTTGAGT GCTCCGTCAGCAGCAGCATGGCTAATGTGCATTGGTTTAAGAATAACACCAAATTGGAGTCCGATGATCCTCGCTATCT TATCTCCAAAGATATAAACGGTAACCTCAAGCTTATTATTAAGGATTCTGTGCTCGATGATGCGGGGCTCTACAGATGT CAACTGGATAAGCAACCTGATAAGACTGAGTGTAACCTTAAGGTCACAGAGTACCCGTACAAGTTCGTCAAGGTTCTGA AATCACAACAGTGTATTGAGAAAGACACAGTGACGCTCGCCTGCGAAATCGATGATGCTATGGGTGAAGTGCAGTGGTT ACGTAACGGCGAAGAAATCAAGCCCGATAAACGTATTCAAATTGTAAAAGATGGTCGAAAGCGAAAGCTAGTCATCAAG GACTGCAAGGTTACCGATGCCGGCCAATTCAAATGTACAACGAATGCCGACACCACAGAGTCGGAAATTATTATTAACT ATCAAAACCGATTTAATAAAAAACTCAAGGATACTGAAGCTGTTGAGAGAGAAAAATTGATTCTGGACATCGAGCTTCA GGATCAAACAGCACCGTGTGACTGGAAATTTAACGGAGAGCCCATAGTACCGAGTGGAAGTATTGAAATCAAGAACATG GGTGGCGGCAAGCATCAACTCATATTTAGCAGCCTGGATATGTCTAATGAGGGCGAAATAACTTTCGAGTCTGGACAGC TAAGTTCGAAATGCAAGCTTTCTATTCGCAAGGGAGAAAGTAGACCAAACATAGACTGTCCTGATAAATTTTCTGGTCC TATCAGTGCCCCTGTGCTTCTAGAAGTGCCATTTAAAGTTTCCG Complete amino acid sequence of projectin (CG1479) MGVAEDFAPSFVKKPQLHQEDDGNRLIFECQLLSSPKPDIEWFRSDNKVVEDVRTKFKIQPVGENKYTVVLELDDVVE TDAGLYKVKAKNKSGEVSASINLNFTHGKFSLLENEGQIDGFAPTFAKKPAIRQEEDGKRLLFECRVNADPIPAIIWFH NGAAVKESERHKITVDKDVHSYFATLEILNVTVEDAGKYKVNAKNELGESNATISLNFDSDEAPVPESAEGIKPTFTER PVIRQSEDGGNVTFECRCVGDPTPTVTWSHGETELNESNRYKMSLTMDQKLYHIACLEISSVVSSDQGEYRAQAKNKHG SGVATINLNFESGSKKIPDGKSPRFPKKPTIRQEEDLLIMECVLEAHPVPDIVWYCSEKEICNNQRTKMTRKAITKDSY ILTLEIQNPTKEDGGNYRCNAINMYGESNANIALNFQGASDANGFAPSFIEKPRIIPNESGTLITMKCKCKAKPEPTVT WYRGQDLVEKSKKIKINTTVIAEDTYELTLEIKDPGATDGGTYRCNVKNEYGESNANLNLNIEAEPEPEGEGPTFIEKP RIVSENNGKLVIMECKVKADPKPDVIWFRNGEVIKESNKIKTFIEQRGDQYYIKLELLDPQLEDSGLYKCNIKNTLGEL NANLTLNIEIVPVIKDKPKIIKIIKKRTVVIECTVASKFEPKCTWYKETSTVKESKRHVYQVEQTKEGEFAVKLEINDV EESDKGAYKLVASNEKGEAVSQIVNLVDIPEEERKPCKPEISRKLADQKVAESKTFELLVSLSQTDRKCKVEWYKGSTV IRETKDITTTFDGTTARLTFSSARTEHTSNYKVIVTNEVGKDESSCKITVEKVAKKKEEKPKEKEKTKNEKEVEQKEME EDKNESGQSVAQTEGRINIEQISEGDPKEELTVKEEILDKRDTQEVKESSVELQDSAGHEVPEPKKATSDSKLDQSNQK NLDKKHKTDQSESKTNKNVSLAEPIKSNKQESEEQQATEQIGLKKVDRKASIVSVKEEISSDVRRKSTIKAKEEITVDD KKASSRRSSLAVEESNTESRRSSIIDKKPLEQVDNKPIDANKNPQPLKEEIPRLKPAEKRRTSKVIEEPKPDEGLPKLR KASIAQVKEEAKPAAPKLKAKAKAKPKYEELPEIPDYERPQLEKYEKSDFTPSDFARDLEIPNKMEKPIIDSGKKEPAV LAQKNGIPKKTDIIEQYADEPKGLKVGKGKLPDEGDGRDGAVLKPVIIEPEKEILDLGNKKNNQHADKPTVLDIIKQRR RSSIRNLMTKEPIQNESFLGVVLKPVIKDTREQAAPQQAIQLTKANATEQFSPTKAVKAQVADLKKPETLATLEDNYER PVLEKYDPFSIDKTKSEKSTPSIITPDIRGPEVKLPEEKQKVPKMQPPAPGDPPKIEVIREKRPSLAPEPPSRRGSLIP PADTGRRPSLIINDEKKLRPGEVMDTRLLRPGEVGEGQRRRPSIDVRRPSVQDLEDLINKPSTPLRDVGDGGPPSIVDV QESYSVVEDSTAYLTVGVEGSPAPTFKFYKGVSEILEGGRFKFLTDGQTNTITLCMRKCKPNDESKYKIVVSNIHGEDS AEMQLYVSDSSGMDFRAMLKKRRYQKWDKDEQDPNWGDLKETEKPLPALKKVERKVESFLSPLIDQFAKEGKDKKVVFE ARFSKPNCKPKWLFRKDEVFTGSKFKFKQENDTYQLIITTPKVEDTGKYTIEIGGVSSTAFLNVEEADPTYTFTKPLKK KLEGFTQHETTLECSVSSSMANVHWFKNNTKLESDDPRYLISKDINGNLKLIIKDSVLDDAGLYRCQLDKQPDKTECNL KVTEYPYKFVKVLKSQQCIEKDTVTLACEIDDAMGEVQWLRNGEEIKPDKRIQIVKDGRKRKLVIKDCKVTDAGQFKCT TNADTTESEIIINYQNRFNKKLKDTEAVEREKLILDIELQDQTAPCDWKFNGEPIVPSGSIEIKNMGGGKHQLIFSSLD MSNEGEITFESGQLSSKCKLSIRKGESRPNIDCPDKFSGPISAPVLLEVPFKVSGTKQTPVEAKLFKDGKPLPVKDVEV AVTDDKVTFKIKKPSRDLSGPYQIKISNGQGEDTKDVQIICQDVPQPPQDVDITDVYQTSCVVSFNPPSDDGGTPITKY VIERQDLSKKHGWESVAEVLPSEPCLKKIDDLIPKKQYRFRIRA \------------------------------------------------------------------------------ --