GeneSeqer. Version of March 12, 2006. Date run: Tue Jul 25 10:27:00 2006 (Bayesian) Splice site model (species): Arabidopsis thaliana Fast search parameters: MinMatchLen 16, MinQualityHSP 30, MinQualityCHAIN 50. Total number of ESTs: 175665 Total sequence length: 93213537 Minimum sequence length: 89 Maximum sequence length: 1082 Length distribution (number of sequences of specified length): < 100: 1 < 200: 2188 < 300: 8544 < 400: 20465 < 500: 39499 < 600: 49432 < 700: 32872 < 800: 19308 < 900: 3155 < 1000: 193 >=1000: 8 Input file : /tmp/bac-submission-temp-9HdmD/C01HBa0088L02/C01HBa0088L02.seq.screen ________________________________________________________________________________ Sequence 1: C01HBa0088L02.1, from 1 to 120525, both strands analyzed. ... started at: Tue Jul 25 10:52:11 2006 EST library file: /tmp/cxgn-bacpublish-resources-AUC11m/sgn_ests; matching gDNA +strand ... ... found all matches, elapsed seconds = 8 ... matches indexed, elapsed seconds = 8 HitsTableSize = 113 EST library file: /tmp/cxgn-bacpublish-resources-AUC11m/sgn_ests; matching gDNA -strand ... ... found all matches, elapsed seconds = 5 ... matches indexed, elapsed seconds = 5 HitsTableSize = 158 ******************************************************************************** EST sequence 204 +strand 624 n (File: SGN-E235556+) 1 GGATCTTGAA AGTAAGGGCA TAAAAAAGTT AATCGGAAAT GTGCAGATGC CAGTGGCAGC 61 TGTAGTTGTT ATGGCTTGCA GTCGTTCTGA CTACCTGGAG AAGACTATAA AATCCATCTT 121 AAAATACCAA ACATCTGTTG CATCAAAATA TCCTCTTTTC ATATCCCAGG ATGGATCGAA 181 TCCTGATGTT AGAAAGCTTG CTTTGAGCTA TGATCAACTG ACGTATATGC AGCACTTGGA 241 TTTTGAACCT GTGCATACTG AAAGACCAGG GGAACTGGTT GCATACTACA AGATTGCACG 301 TCATTACAAG TGGGCATTGG ATCAGCTGTT TCACAAGCAT AATTTTAGCC GTGTTATCAT 361 ACTAGAAGAT GATATGGAAA TTGCGGCTGA TTTTTTTGAC TACTTTGAGG CTGGAGCTAC 421 TCTTCTTGAC AGAGACAAGT CGATTATGGC TATTTCATCT TGGAATGACA ATGGACAAAG 481 GCAGTTCGTC CAAGATCCTT ATGCTCTTTA CCGCTCAGAC TTTTTTCCTG GTCTTGGATG 541 GATGCTTTCA AAATCAACTT GGTCCGAACT ATCTCCAAAG TGGCCGAAGG CTTACTGGGA 601 TGACTGGCTG AGGCTCAAAG AAAA Predicted gene structure (within gDNA segment 10440 to 5721): Exon 1 10046 10036 ( 11 n); cDNA 1 11 ( 11 n); score: 1.000 Intron 1 10035 9731 ( 305 n); Pd: 0.996 (s: 0), Pa: 0.999 (s: 0) Exon 2 9730 9696 ( 35 n); cDNA 12 46 ( 35 n); score: 1.000 Intron 2 9695 9592 ( 104 n); Pd: 0.939 (s: 0), Pa: 0.594 (s: 1.00) Exon 3 9591 9515 ( 77 n); cDNA 47 123 ( 77 n); score: 1.000 Intron 3 9514 9424 ( 91 n); Pd: 0.972 (s: 1.00), Pa: 0.000 (s: 1.00) Exon 4 9423 9378 ( 46 n); cDNA 124 169 ( 46 n); score: 1.000 Intron 4 9377 9287 ( 91 n); Pd: 0.998 (s: 1.00), Pa: 0.989 (s: 1.00) Exon 5 9286 9224 ( 63 n); cDNA 170 232 ( 63 n); score: 1.000 Intron 5 9223 8461 ( 763 n); Pd: 0.937 (s: 1.00), Pa: 0.997 (s: 1.00) Exon 6 8460 8394 ( 67 n); cDNA 233 299 ( 67 n); score: 1.000 Intron 6 8393 8291 ( 103 n); Pd: 0.999 (s: 1.00), Pa: 0.736 (s: 1.00) Exon 7 8290 8222 ( 69 n); cDNA 300 368 ( 69 n); score: 1.000 Intron 7 8221 8140 ( 82 n); Pd: 0.996 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 8 8139 8070 ( 70 n); cDNA 369 438 ( 70 n); score: 1.000 Intron 8 8069 7633 ( 437 n); Pd: 0.984 (s: 1.00), Pa: 0.942 (s: 1.00) Exon 9 7632 7571 ( 62 n); cDNA 439 500 ( 62 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E235556+ 1.000 500 0.801 C PGS_C01HBa0088L02.1-_SGN-E235556+ (10046 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7571) Alignment (genomic DNA sequence = upper lines): GGATCTTGAA AGTAAGTCGA TAAACTCCTC TTTCTTCTTT CAGCTTTTTG TCAAAAGCCG 9987 |||||||||| | GGATCTTGAA A......... .......... .......... .......... .......... 11 CTGCTTTTAG TCGCAGTAGT ATGAAATGTA CACCTGCAAA ATATATACCC ATTGTATGTG 9927 .......... .......... .......... .......... .......... .......... 11 ATAAATAAAG ACCTGTTAAT GTCAATTTGT CAGTTCATAC ATTGAGTTTA TTAATGTTGT 9867 .......... .......... .......... .......... .......... .......... 11 GAGCTCTAAA TTCTATTCTA GTTAAGTCAT GCCTACAAGG AATCTTATCT TATCATTAAA 9807 .......... .......... .......... .......... .......... .......... 11 TACATAAATA TATACTCATG CCTACAAGTA TTTGAACTTA TTTATATATT TGATGTTGTT 9747 .......... .......... .......... .......... .......... .......... 11 AATTTATCTG TTACAGGTAA GGGCATAAAA AAGTTAATCG GAAATGTGCA GGTTTATATA 9687 |||| |||||||||| |||||||||| |||||||||| | .......... ......GTAA GGGCATAAAA AAGTTAATCG GAAATGTGCA G......... 46 CATTCCCACA TCTTCAGTCA TACATTTGCT ACCACCATCT GGTGACCTCA ATTCTGTCAA 9627 .......... .......... .......... .......... .......... .......... 46 ATCTTTGTTC ATCAACTAAT TACTATATTT ACTAGATGCC AGTGGCAGCT GTAGTTGTTA 9567 ||||| |||||||||| |||||||||| .......... .......... .......... .....ATGCC AGTGGCAGCT GTAGTTGTTA 71 TGGCTTGCAG TCGTTCTGAC TACCTGGAGA AGACTATAAA ATCCATCTTA AAGTATGCTT 9507 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| || TGGCTTGCAG TCGTTCTGAC TACCTGGAGA AGACTATAAA ATCCATCTTA AA........ 123 TCTATCAAAA CAATTTTATC TGCTTCTCAT GACATACTAG ATGCCTCAGC TGATAAGCCC 9447 .......... .......... .......... .......... .......... .......... 123 GGTATTTCCA TTGTTGTCAT CAGATACCAA ACATCTGTTG CATCAAAATA TCCTCTTTTC 9387 ||||||| |||||||||| |||||||||| |||||||||| .......... .......... ...ATACCAA ACATCTGTTG CATCAAAATA TCCTCTTTTC 160 ATATCCCAGG TACCCATTTA TTTTCCCTCA TAGCCTTCTA TTGCATGCTT GTCTTCTTTG 9327 ||||||||| ATATCCCAG. .......... .......... .......... .......... .......... 169 TCTTGCTGAG CCTACTTCTC GTTCTACTTC CCTTTGGCAG GATGGATCGA ATCCTGATGT 9267 |||||||||| |||||||||| .......... .......... .......... .......... GATGGATCGA ATCCTGATGT 189 TAGAAAGCTT GCTTTGAGCT ATGATCAACT GACGTATATG CAGGTACTTT TCCTATCGCT 9207 |||||||||| |||||||||| |||||||||| |||||||||| ||| TAGAAAGCTT GCTTTGAGCT ATGATCAACT GACGTATATG CAG....... .......... 232 TGAGAAAGGG AAAATGAAAT TTATTTGGGG TATATCTATC TGTCAAATTT AAATCAGGCT 9147 .......... .......... .......... .......... .......... .......... 232 GATCCTTACT TGGAGAAAAA GTATAGACTT AAGAATATGA ATTCATTGTT CCAATGCTCA 9087 .......... .......... .......... .......... .......... .......... 232 ATCATCGTCA TTCCAGTAAC AAGATCGTGT ACTGGTGAAA CAAGTTAGTA GAAAAATTAC 9027 .......... .......... .......... .......... .......... .......... 232 CCATAAGGAG TTTTTATCTA GTAAAAATGG AAAGGGAAAA AATACATAAT CAATATTTGA 8967 .......... .......... .......... .......... .......... .......... 232 CATCTAAATG TTATCCTAAT CATTTTAACT CTTTTAATAC TTCATTCATT CATTGTGTGA 8907 .......... .......... .......... .......... .......... .......... 232 CAATTTGCCC TCCCCCCCGT TAGCTATACA AGTGGAAGAG GCATGTGTAG TTTGATTTAT 8847 .......... .......... .......... .......... .......... .......... 232 TCTTTTAAGA TATATATGTA TATATATACA TATATATGAT TTCCTTCTCT CTCTTTGTTT 8787 .......... .......... .......... .......... .......... .......... 232 GATTAGCCAT ACTTCTGTTT TGTATAAATA CTCATCTACT GATCTACAAG GTTCATAGTT 8727 .......... .......... .......... .......... .......... .......... 232 TTATAACATA TCAATTGGCT AAATTTTGTT CTGATAAATG CTTTACTTGC ATGGGAATGA 8667 .......... .......... .......... .......... .......... .......... 232 AGCTAGCTTC TTTTCGTTTA GCTTAAGGTA GCTGTAGTTA CTTTAGTCTT TATCTAATCT 8607 .......... .......... .......... .......... .......... .......... 232 TTTGGTGATT AGTGATAACA GTTCTGGCCT TACATTATAA AGTGTAGTTA CAAGCATTGC 8547 .......... .......... .......... .......... .......... .......... 232 TTCTGTTTGA TCTTTGTATC AAACTCTTCT TGGCAGTTTT TATTGACTTT CTTAATAAAA 8487 .......... .......... .......... .......... .......... .......... 232 GACCTTTTTT GATTTTTAAT CGACAGCACT TGGATTTTGA ACCTGTGCAT ACTGAAAGAC 8427 |||| |||||||||| |||||||||| |||||||||| .......... .......... ......CACT TGGATTTTGA ACCTGTGCAT ACTGAAAGAC 266 CAGGGGAACT GGTTGCATAC TACAAGATTG CACGTAAGGA TTTTTTTTGC TTTTTCTCCT 8367 |||||||||| |||||||||| |||||||||| ||| CAGGGGAACT GGTTGCATAC TACAAGATTG CAC....... .......... .......... 299 TCAACTTTTT CCTTTGCTCA TTTTTATTTC AACTAGTGTT AGTTTTGCAT TAACCACTGG 8307 .......... .......... .......... .......... .......... .......... 299 ACCACTCTTT CCTTAGGTCA TTACAAGTGG GCATTGGATC AGCTGTTTCA CAAGCATAAT 8247 |||| |||||||||| |||||||||| |||||||||| |||||||||| .......... ......GTCA TTACAAGTGG GCATTGGATC AGCTGTTTCA CAAGCATAAT 343 TTTAGCCGTG TTATCATACT AGAAGGTACC GCTGATCTAT CTTAATCACT ATGTTGCATA 8187 |||||||||| |||||||||| ||||| TTTAGCCGTG TTATCATACT AGAAG..... .......... .......... .......... 368 TTCTCTGCAC TTTTTCTTCT CACAATATTT TTGCTTCTGA CATGCAGATG ATATGGAAAT 8127 ||| |||||||||| .......... .......... .......... .......... .......ATG ATATGGAAAT 381 TGCGGCTGAT TTTTTTGACT ACTTTGAGGC TGGAGCTACT CTTCTTGACA GAGACAAGTA 8067 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||| TGCGGCTGAT TTTTTTGACT ACTTTGAGGC TGGAGCTACT CTTCTTGACA GAGACAA... 438 AGGCATTCTC AAGGACCCAG ATTTTCCATG CTTACATTCA AAGGATTGTT CACTTCATCC 8007 .......... .......... .......... .......... .......... .......... 438 TTGTATCAGG AAAATCTATT TTTTTCCTCT TGTTGGCCAA CTCCCCCCCA TTCAACCTTT 7947 .......... .......... .......... .......... .......... .......... 438 TGGATCATTT TTTTAAAGAA CCAACATAAT TGGATCATAT TCTACAGCCA TCCAAGATCT 7887 .......... .......... .......... .......... .......... .......... 438 CTTTCTCTCC CAGGCACGTG GTAGGAGAAA ATCGATGGAA GCGCTGGGGA TAAATTTCCA 7827 .......... .......... .......... .......... .......... .......... 438 TTTTTGATTA TATAACATTT TTAGCAAAAG GACTAAAAAC TTCTGCTTAC ATAAACTTGT 7767 .......... .......... .......... .......... .......... .......... 438 GGCCAAATAT GCTAAGTGGG ATAGTGAACC TAAAAAAATG GGACCTGGCC TAAAACATGA 7707 .......... .......... .......... .......... .......... .......... 438 TGACAGATTG CAAAATGCCT ATTCTCAATA TTCCAAGTAT AACATTTTTT ACATCCTTGT 7647 .......... .......... .......... .......... .......... .......... 438 GGTGAACATC CCAGGTCGAT TATGGCTATT TCATCTTGGA ATGACAATGG ACAAAGGCAG 7587 |||||| |||||||||| |||||||||| |||||||||| |||||||||| .......... ....GTCGAT TATGGCTATT TCATCTTGGA ATGACAATGG ACAAAGGCAG 484 TTCGTCCAAG ATCCTT 7571 |||||||||| |||||| TTCGTCCAAG ATCCTT 500 hqPGS_C01HBa0088L02.1-_SGN-E235556+ (9730 9696,9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7571) ******************************************************************************** EST sequence 233 +strand 506 n (File: SGN-E245638+) 1 ATGCCAGTGG CAGCTGTAGT TGTTATGGCT TGCAGTCGTT CTGACTACCT GGAGAAGACT 61 ATAAAATCCA TCTTAAAATA CCAAACATCT GTTGCATCAA AATATCCTCT TTTCATATCC 121 CAGGATGGAT CGAATCCTGA TGTTAGAAAG CTTGCTTTGA GCTATGATCA ACTGACGTAT 181 ATGCAGCACT TGGATTTTGA ACCTGTGCAT ACTGAAAGAC CAGGGGAACT GGTTGCATAC 241 TACAAGATTG CACGTCATTA CAAGTGGGCA TTGGATCAGC TGTTTCACAA GCATAATTTT 301 AGCCGTGTTA TCATACTAGA AGATGATATG GAAATTGCGG CTGATTTTTT TGACTACTTT 361 GAGGCTGGAG CTACTCTTCT TGACAGAGAC AAGTCGATTA TGGCTATTTC ATCTTGGAAT 421 GACAATGGAC AAAGGCAGTT CGTCCAAGAT CCTTATGCTC TTTACCGCTC AGACTTTTTT 481 CCTGGTCTTG GATGGATGCT TTCAAA Predicted gene structure (within gDNA segment 10191 to 6441): Exon 1 9591 9515 ( 77 n); cDNA 1 77 ( 77 n); score: 1.000 Intron 1 9514 9424 ( 91 n); Pd: 0.972 (s: 1.00), Pa: 0.000 (s: 1.00) Exon 2 9423 9378 ( 46 n); cDNA 78 123 ( 46 n); score: 1.000 Intron 2 9377 9287 ( 91 n); Pd: 0.998 (s: 1.00), Pa: 0.989 (s: 1.00) Exon 3 9286 9224 ( 63 n); cDNA 124 186 ( 63 n); score: 1.000 Intron 3 9223 8461 ( 763 n); Pd: 0.937 (s: 1.00), Pa: 0.997 (s: 1.00) Exon 4 8460 8394 ( 67 n); cDNA 187 253 ( 67 n); score: 1.000 Intron 4 8393 8291 ( 103 n); Pd: 0.999 (s: 1.00), Pa: 0.736 (s: 1.00) Exon 5 8290 8222 ( 69 n); cDNA 254 322 ( 69 n); score: 1.000 Intron 5 8221 8140 ( 82 n); Pd: 0.996 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 6 8139 8070 ( 70 n); cDNA 323 392 ( 70 n); score: 1.000 Intron 6 8069 7633 ( 437 n); Pd: 0.984 (s: 1.00), Pa: 0.942 (s: 1.00) Exon 7 7632 7571 ( 62 n); cDNA 393 454 ( 62 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E245638+ 1.000 454 0.897 C PGS_C01HBa0088L02.1-_SGN-E245638+ (9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7571) Alignment (genomic DNA sequence = upper lines): ATGCCAGTGG CAGCTGTAGT TGTTATGGCT TGCAGTCGTT CTGACTACCT GGAGAAGACT 9532 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATGCCAGTGG CAGCTGTAGT TGTTATGGCT TGCAGTCGTT CTGACTACCT GGAGAAGACT 60 ATAAAATCCA TCTTAAAGTA TGCTTTCTAT CAAAACAATT TTATCTGCTT CTCATGACAT 9472 |||||||||| ||||||| ATAAAATCCA TCTTAAA... .......... .......... .......... .......... 77 ACTAGATGCC TCAGCTGATA AGCCCGGTAT TTCCATTGTT GTCATCAGAT ACCAAACATC 9412 || |||||||||| .......... .......... .......... .......... ........AT ACCAAACATC 89 TGTTGCATCA AAATATCCTC TTTTCATATC CCAGGTACCC ATTTATTTTC CCTCATAGCC 9352 |||||||||| |||||||||| |||||||||| |||| TGTTGCATCA AAATATCCTC TTTTCATATC CCAG...... .......... .......... 123 TTCTATTGCA TGCTTGTCTT CTTTGTCTTG CTGAGCCTAC TTCTCGTTCT ACTTCCCTTT 9292 .......... .......... .......... .......... .......... .......... 123 GGCAGGATGG ATCGAATCCT GATGTTAGAA AGCTTGCTTT GAGCTATGAT CAACTGACGT 9232 ||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .....GATGG ATCGAATCCT GATGTTAGAA AGCTTGCTTT GAGCTATGAT CAACTGACGT 178 ATATGCAGGT ACTTTTCCTA TCGCTTGAGA AAGGGAAAAT GAAATTTATT TGGGGTATAT 9172 |||||||| ATATGCAG.. .......... .......... .......... .......... .......... 186 CTATCTGTCA AATTTAAATC AGGCTGATCC TTACTTGGAG AAAAAGTATA GACTTAAGAA 9112 .......... .......... .......... .......... .......... .......... 186 TATGAATTCA TTGTTCCAAT GCTCAATCAT CGTCATTCCA GTAACAAGAT CGTGTACTGG 9052 .......... .......... .......... .......... .......... .......... 186 TGAAACAAGT TAGTAGAAAA ATTACCCATA AGGAGTTTTT ATCTAGTAAA AATGGAAAGG 8992 .......... .......... .......... .......... .......... .......... 186 GAAAAAATAC ATAATCAATA TTTGACATCT AAATGTTATC CTAATCATTT TAACTCTTTT 8932 .......... .......... .......... .......... .......... .......... 186 AATACTTCAT TCATTCATTG TGTGACAATT TGCCCTCCCC CCCGTTAGCT ATACAAGTGG 8872 .......... .......... .......... .......... .......... .......... 186 AAGAGGCATG TGTAGTTTGA TTTATTCTTT TAAGATATAT ATGTATATAT ATACATATAT 8812 .......... .......... .......... .......... .......... .......... 186 ATGATTTCCT TCTCTCTCTT TGTTTGATTA GCCATACTTC TGTTTTGTAT AAATACTCAT 8752 .......... .......... .......... .......... .......... .......... 186 CTACTGATCT ACAAGGTTCA TAGTTTTATA ACATATCAAT TGGCTAAATT TTGTTCTGAT 8692 .......... .......... .......... .......... .......... .......... 186 AAATGCTTTA CTTGCATGGG AATGAAGCTA GCTTCTTTTC GTTTAGCTTA AGGTAGCTGT 8632 .......... .......... .......... .......... .......... .......... 186 AGTTACTTTA GTCTTTATCT AATCTTTTGG TGATTAGTGA TAACAGTTCT GGCCTTACAT 8572 .......... .......... .......... .......... .......... .......... 186 TATAAAGTGT AGTTACAAGC ATTGCTTCTG TTTGATCTTT GTATCAAACT CTTCTTGGCA 8512 .......... .......... .......... .......... .......... .......... 186 GTTTTTATTG ACTTTCTTAA TAAAAGACCT TTTTTGATTT TTAATCGACA GCACTTGGAT 8452 ||||||||| .......... .......... .......... .......... .......... .CACTTGGAT 195 TTTGAACCTG TGCATACTGA AAGACCAGGG GAACTGGTTG CATACTACAA GATTGCACGT 8392 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||| TTTGAACCTG TGCATACTGA AAGACCAGGG GAACTGGTTG CATACTACAA GATTGCAC.. 253 AAGGATTTTT TTTGCTTTTT CTCCTTCAAC TTTTTCCTTT GCTCATTTTT ATTTCAACTA 8332 .......... .......... .......... .......... .......... .......... 253 GTGTTAGTTT TGCATTAACC ACTGGACCAC TCTTTCCTTA GGTCATTACA AGTGGGCATT 8272 ||||||||| |||||||||| .......... .......... .......... .......... .GTCATTACA AGTGGGCATT 272 GGATCAGCTG TTTCACAAGC ATAATTTTAG CCGTGTTATC ATACTAGAAG GTACCGCTGA 8212 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGATCAGCTG TTTCACAAGC ATAATTTTAG CCGTGTTATC ATACTAGAAG .......... 322 TCTATCTTAA TCACTATGTT GCATATTCTC TGCACTTTTT CTTCTCACAA TATTTTTGCT 8152 .......... .......... .......... .......... .......... .......... 322 TCTGACATGC AGATGATATG GAAATTGCGG CTGATTTTTT TGACTACTTT GAGGCTGGAG 8092 |||||||| |||||||||| |||||||||| |||||||||| |||||||||| .......... ..ATGATATG GAAATTGCGG CTGATTTTTT TGACTACTTT GAGGCTGGAG 370 CTACTCTTCT TGACAGAGAC AAGTAAGGCA TTCTCAAGGA CCCAGATTTT CCATGCTTAC 8032 |||||||||| |||||||||| || CTACTCTTCT TGACAGAGAC AA........ .......... .......... .......... 392 ATTCAAAGGA TTGTTCACTT CATCCTTGTA TCAGGAAAAT CTATTTTTTT CCTCTTGTTG 7972 .......... .......... .......... .......... .......... .......... 392 GCCAACTCCC CCCCATTCAA CCTTTTGGAT CATTTTTTTA AAGAACCAAC ATAATTGGAT 7912 .......... .......... .......... .......... .......... .......... 392 CATATTCTAC AGCCATCCAA GATCTCTTTC TCTCCCAGGC ACGTGGTAGG AGAAAATCGA 7852 .......... .......... .......... .......... .......... .......... 392 TGGAAGCGCT GGGGATAAAT TTCCATTTTT GATTATATAA CATTTTTAGC AAAAGGACTA 7792 .......... .......... .......... .......... .......... .......... 392 AAAACTTCTG CTTACATAAA CTTGTGGCCA AATATGCTAA GTGGGATAGT GAACCTAAAA 7732 .......... .......... .......... .......... .......... .......... 392 AAATGGGACC TGGCCTAAAA CATGATGACA GATTGCAAAA TGCCTATTCT CAATATTCCA 7672 .......... .......... .......... .......... .......... .......... 392 AGTATAACAT TTTTTACATC CTTGTGGTGA ACATCCCAGG TCGATTATGG CTATTTCATC 7612 | |||||||||| |||||||||| .......... .......... .......... .........G TCGATTATGG CTATTTCATC 413 TTGGAATGAC AATGGACAAA GGCAGTTCGT CCAAGATCCT T 7571 |||||||||| |||||||||| |||||||||| |||||||||| | TTGGAATGAC AATGGACAAA GGCAGTTCGT CCAAGATCCT T 454 hqPGS_C01HBa0088L02.1-_SGN-E245638+ (9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7571) ******************************************************************************** EST sequence 205 +strand 189 n (File: SGN-E256505+) 1 TATAAAATCC ATCTTAAAAT ACCAAACATC TGTTGCATCA AAATATCCTC TTTTCATATC 61 CCAGGATGGA TCGAATCCTG ATGTTAGAAA GCTTGCTTTG AGCTATGATC AACTGACGTA 121 TATGCAGCAC TTGGATTTTG AACCTGTGCA TACTGAAAGA CCACGGGAAC TGGTTGCATA 181 CTACAAGAT Predicted gene structure (within gDNA segment 10203 to 7789): Exon 1 9532 9515 ( 18 n); cDNA 1 18 ( 18 n); score: 1.000 Intron 1 9514 9424 ( 91 n); Pd: 0.972 (s: 0), Pa: 0.000 (s: 1.00) Exon 2 9423 9378 ( 46 n); cDNA 19 64 ( 46 n); score: 1.000 Intron 2 9377 9287 ( 91 n); Pd: 0.998 (s: 1.00), Pa: 0.989 (s: 1.00) Exon 3 9286 9224 ( 63 n); cDNA 65 127 ( 63 n); score: 1.000 Intron 3 9223 8461 ( 763 n); Pd: 0.937 (s: 1.00), Pa: 0.997 (s: 0.98) Exon 4 8460 8399 ( 62 n); cDNA 128 189 ( 62 n); score: 0.984 MATCH C01HBa0088L02.1- SGN-E256505+ 0.992 189 1.000 C PGS_C01HBa0088L02.1-_SGN-E256505+ (9532 9515,9423 9378,9286 9224,8460 8399) Alignment (genomic DNA sequence = upper lines): TATAAAATCC ATCTTAAAGT ATGCTTTCTA TCAAAACAAT TTTATCTGCT TCTCATGACA 9473 |||||||||| |||||||| TATAAAATCC ATCTTAAA.. .......... .......... .......... .......... 18 TACTAGATGC CTCAGCTGAT AAGCCCGGTA TTTCCATTGT TGTCATCAGA TACCAAACAT 9413 | |||||||||| .......... .......... .......... .......... .........A TACCAAACAT 29 CTGTTGCATC AAAATATCCT CTTTTCATAT CCCAGGTACC CATTTATTTT CCCTCATAGC 9353 |||||||||| |||||||||| |||||||||| ||||| CTGTTGCATC AAAATATCCT CTTTTCATAT CCCAG..... .......... .......... 64 CTTCTATTGC ATGCTTGTCT TCTTTGTCTT GCTGAGCCTA CTTCTCGTTC TACTTCCCTT 9293 .......... .......... .......... .......... .......... .......... 64 TGGCAGGATG GATCGAATCC TGATGTTAGA AAGCTTGCTT TGAGCTATGA TCAACTGACG 9233 |||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ......GATG GATCGAATCC TGATGTTAGA AAGCTTGCTT TGAGCTATGA TCAACTGACG 118 TATATGCAGG TACTTTTCCT ATCGCTTGAG AAAGGGAAAA TGAAATTTAT TTGGGGTATA 9173 ||||||||| TATATGCAG. .......... .......... .......... .......... .......... 127 TCTATCTGTC AAATTTAAAT CAGGCTGATC CTTACTTGGA GAAAAAGTAT AGACTTAAGA 9113 .......... .......... .......... .......... .......... .......... 127 ATATGAATTC ATTGTTCCAA TGCTCAATCA TCGTCATTCC AGTAACAAGA TCGTGTACTG 9053 .......... .......... .......... .......... .......... .......... 127 GTGAAACAAG TTAGTAGAAA AATTACCCAT AAGGAGTTTT TATCTAGTAA AAATGGAAAG 8993 .......... .......... .......... .......... .......... .......... 127 GGAAAAAATA CATAATCAAT ATTTGACATC TAAATGTTAT CCTAATCATT TTAACTCTTT 8933 .......... .......... .......... .......... .......... .......... 127 TAATACTTCA TTCATTCATT GTGTGACAAT TTGCCCTCCC CCCCGTTAGC TATACAAGTG 8873 .......... .......... .......... .......... .......... .......... 127 GAAGAGGCAT GTGTAGTTTG ATTTATTCTT TTAAGATATA TATGTATATA TATACATATA 8813 .......... .......... .......... .......... .......... .......... 127 TATGATTTCC TTCTCTCTCT TTGTTTGATT AGCCATACTT CTGTTTTGTA TAAATACTCA 8753 .......... .......... .......... .......... .......... .......... 127 TCTACTGATC TACAAGGTTC ATAGTTTTAT AACATATCAA TTGGCTAAAT TTTGTTCTGA 8693 .......... .......... .......... .......... .......... .......... 127 TAAATGCTTT ACTTGCATGG GAATGAAGCT AGCTTCTTTT CGTTTAGCTT AAGGTAGCTG 8633 .......... .......... .......... .......... .......... .......... 127 TAGTTACTTT AGTCTTTATC TAATCTTTTG GTGATTAGTG ATAACAGTTC TGGCCTTACA 8573 .......... .......... .......... .......... .......... .......... 127 TTATAAAGTG TAGTTACAAG CATTGCTTCT GTTTGATCTT TGTATCAAAC TCTTCTTGGC 8513 .......... .......... .......... .......... .......... .......... 127 AGTTTTTATT GACTTTCTTA ATAAAAGACC TTTTTTGATT TTTAATCGAC AGCACTTGGA 8453 |||||||| .......... .......... .......... .......... .......... ..CACTTGGA 135 TTTTGAACCT GTGCATACTG AAAGACCAGG GGAACTGGTT GCATACTACA AGAT 8399 |||||||||| |||||||||| |||||||| | |||||||||| |||||||||| |||| TTTTGAACCT GTGCATACTG AAAGACCACG GGAACTGGTT GCATACTACA AGAT 189 hqPGS_C01HBa0088L02.1-_SGN-E256505+ (9532 9515,9423 9378,9286 9224,8460 8399) ******************************************************************************** EST sequence 115 +strand 626 n (File: SGN-E297108+) 1 TTGATCCTAT GTGAGGCAAC ACTCGGAACT GAGAAACCCT TAGAATTCAA TTTCGCATTT 61 GGCAGAGATG AGAGGAAACA AGTTTTGCTT TGATTTACGG TACCTTCTCG TCGTGGCTGC 121 TCTCGCCTTC ATCTACATAC AGATGCGGCT TTTCGTGACA CAGTCAGAAT ATGCAGACCG 181 CCTTGCTGCT GCGATTGAAG CAGAAAATCA TTGTACAAGT CAGACTAGGT TGCTTATTGA 241 CAAGATTAGC CAGCAGCAAG GAAGAGTAGT GGCTCTTGAA GAACAAATGA AGCGCCAGGA 301 CCAGGAGTGC CGACAATTAA GGGCTCTTGT TCAGGATCTT GAAAGTAAGG GCATAAAAAA 361 GTTAATCGGA AATGTGCAGA TGCCAGTGGC AGCTGTAGTT GTTATGGCTT GCAGTCGTTC 421 TGACTACCTG GAGAAGACTA TAAAATCCAT CTTAAAATAC CAAACATCTG TTGCATCAAA 481 ATATCCTCTT TTCATATCCC AGGATGGATC GAATCCTGAT GTTAGAAAGC TTGCTTTGAG 541 CTATGATCAA CTGACGTATA TGCAGCACTT GGATTTTGAA CCTGTGCATA CTGAAAGACC 601 AAGGGAACTG GTTGCATACT ACAAGA Predicted gene structure (within gDNA segment 13607 to 7790): Exon 1 13007 12866 ( 142 n); cDNA 1 142 ( 142 n); score: 1.000 Intron 1 12865 11756 (1110 n); Pd: 0.999 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 2 11755 11705 ( 51 n); cDNA 143 193 ( 51 n); score: 1.000 Intron 2 11704 11340 ( 365 n); Pd: 0.987 (s: 1.00), Pa: 0.967 (s: 1.00) Exon 3 11339 11252 ( 88 n); cDNA 194 281 ( 88 n); score: 1.000 Intron 3 11251 10099 (1153 n); Pd: 0.893 (s: 1.00), Pa: 0.951 (s: 1.00) Exon 4 10098 10036 ( 63 n); cDNA 282 344 ( 63 n); score: 1.000 Intron 4 10035 9731 ( 305 n); Pd: 0.996 (s: 1.00), Pa: 0.999 (s: 0) Exon 5 9730 9696 ( 35 n); cDNA 345 379 ( 35 n); score: 1.000 Intron 5 9695 9592 ( 104 n); Pd: 0.939 (s: 0), Pa: 0.594 (s: 1.00) Exon 6 9591 9515 ( 77 n); cDNA 380 456 ( 77 n); score: 1.000 Intron 6 9514 9424 ( 91 n); Pd: 0.972 (s: 1.00), Pa: 0.000 (s: 1.00) Exon 7 9423 9378 ( 46 n); cDNA 457 502 ( 46 n); score: 1.000 Intron 7 9377 9287 ( 91 n); Pd: 0.998 (s: 1.00), Pa: 0.989 (s: 1.00) Exon 8 9286 9224 ( 63 n); cDNA 503 565 ( 63 n); score: 1.000 Intron 8 9223 8461 ( 763 n); Pd: 0.937 (s: 1.00), Pa: 0.997 (s: 0.98) Exon 9 8460 8400 ( 61 n); cDNA 566 626 ( 61 n); score: 0.984 MATCH C01HBa0088L02.1- SGN-E297108+ 0.998 626 1.000 C PGS_C01HBa0088L02.1-_SGN-E297108+ (13007 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8400) Alignment (genomic DNA sequence = upper lines): TTGATCCTAT GTGAGGCAAC ACTCGGAACT GAGAAACCCT TAGAATTCAA TTTCGCATTT 12948 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGATCCTAT GTGAGGCAAC ACTCGGAACT GAGAAACCCT TAGAATTCAA TTTCGCATTT 60 GGCAGAGATG AGAGGAAACA AGTTTTGCTT TGATTTACGG TACCTTCTCG TCGTGGCTGC 12888 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGCAGAGATG AGAGGAAACA AGTTTTGCTT TGATTTACGG TACCTTCTCG TCGTGGCTGC 120 TCTCGCCTTC ATCTACATAC AGGTTATCTT CTGGCCTCCT CTCAGATCTA TACGCATATA 12828 |||||||||| |||||||||| || TCTCGCCTTC ATCTACATAC AG........ .......... .......... .......... 142 ACTATTATTC ATTTCATCTC AGCGATTTTT TCTGTAATTT AACACAATTT GGTATCTTTA 12768 .......... .......... .......... .......... .......... .......... 142 GTGAACCTAA TTGTCAGTTG AGTTAGAATC TCTTATGAAG CTATAGAACA ATTCCACTAA 12708 .......... .......... .......... .......... .......... .......... 142 CGACTATAAC TTTAAATCCC GAGCTCCTCC GGGTCAACTA CATTAATCAT CTAATGAGGG 12648 .......... .......... .......... .......... .......... .......... 142 GTTTGGCTAA AAAGAAATGC AAACTTGCAC AACCAATGAA TTGCTTAACC ATCAAGGGGA 12588 .......... .......... .......... .......... .......... .......... 142 TGCAAAAAAT TATTTGTACA AAACTAGCTG CTTTTACCCT ATTTGTACAA TGTGATATTT 12528 .......... .......... .......... .......... .......... .......... 142 CCGCTAAAGA GATTTACTTG AACCTTCCTT CAACAAACTT AGCTAGGCCA CTGGTCTCTC 12468 .......... .......... .......... .......... .......... .......... 142 TTTTAGGATT TGGCTTGCAA TTCCCCTTGG CAGAGATAGA GTCAGTGCTT AGCAAAGAAT 12408 .......... .......... .......... .......... .......... .......... 142 TGACATTCAA ATGTCCAAAA ATTATCGGAA GCCATGCAAT TGAAAATTCT TATAGCTTGT 12348 .......... .......... .......... .......... .......... .......... 142 AGGTAATGAA ATTGAAAGTT TCCCCAAATA TATTCTGACG ATACTGCGCC AACTTATGCG 12288 .......... .......... .......... .......... .......... .......... 142 TATAACTTAC GTTACCATAC TGTATTGGTT CGGTTTTAGT ATCTCTTTTA TCTCTTTATG 12228 .......... .......... .......... .......... .......... .......... 142 ATGTTTCCAA CAAAAGAAAA TAGCAACATA TGAATTTTAA GTCACAAGGG GCTGGCCTAG 12168 .......... .......... .......... .......... .......... .......... 142 CGACCGAGAA ATTGCTGTGG CGAAATTGGG AACCAAGATT GGAATTCGAA CAGAGGAAAA 12108 .......... .......... .......... .......... .......... .......... 142 AGTACAGAAA TTCCTTGCAT CTGCCTAAGC TTAGTGGATG TAGTTACTCA ATACTTGTGT 12048 .......... .......... .......... .......... .......... .......... 142 TGCTAGAAGA TAGTAAGTAC CTGGTGGATT GGTCGAGGTT CACAAAAGGT AGCCTTGATA 11988 .......... .......... .......... .......... .......... .......... 142 TCACTATTAT AAAGAGAAAA GTTTATATTG CTTAGGTAAA GCCATAACTT GTCCACTACC 11928 .......... .......... .......... .......... .......... .......... 142 CCAAGCAATC CTTTCTTTGC ATGATTAGCT TGTTTTATCT TTATTTTTAC ATATGAGGTT 11868 .......... .......... .......... .......... .......... .......... 142 ACTTGGTTCT GTTGACATTG GTGTTATGAG AAGAAATTAC CTAACTGGAT TACTGTTTGC 11808 .......... .......... .......... .......... .......... .......... 142 TTAATGGCGA AGTAGGTATA TTTTAAGTGG TTGTTTTTGC TACATTTCTC AGATGCGGCT 11748 |||||||| .......... .......... .......... .......... .......... ..ATGCGGCT 150 TTTCGTGACA CAGTCAGAAT ATGCAGACCG CCTTGCTGCT GCGGTAAGTA TCTAGGCTCA 11688 |||||||||| |||||||||| |||||||||| |||||||||| ||| TTTCGTGACA CAGTCAGAAT ATGCAGACCG CCTTGCTGCT GCG....... .......... 193 TCTAGTCATC CTTCCGAATG GAATCTAAAT ACCATAGACA TATTTCCTGT GTTCTATCGT 11628 .......... .......... .......... .......... .......... .......... 193 TTATGTATTT ATAATTCTTG TCATGTATTA TGAACATAAT GTTTCTAAAA GCTTTTTTTT 11568 .......... .......... .......... .......... .......... .......... 193 TAACAAGCGT TTCGAAAAGC TTCATATGCT CTACTTGAAG GTATCCTTCA ACAGTTCAAA 11508 .......... .......... .......... .......... .......... .......... 193 TATTCATTCC GAAAATCCTC TCTTTTCTTC TCAACAGGAG ATTGCTTAAT CTTCTTTTGC 11448 .......... .......... .......... .......... .......... .......... 193 ATTTTCTTAG CAACACACAA CTGCATCCTA CGTCAATGAT GTAGCTAAAG AAAGAAGAAA 11388 .......... .......... .......... .......... .......... .......... 193 ATAGCTTTTA ATTGCTAATA ATGTGTACAA ATCATGTGAA TGACACAGAT TGAAGCAGAA 11328 || |||||||||| .......... .......... .......... .......... ........AT TGAAGCAGAA 205 AATCATTGTA CAAGTCAGAC TAGGTTGCTT ATTGACAAGA TTAGCCAGCA GCAAGGAAGA 11268 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATCATTGTA CAAGTCAGAC TAGGTTGCTT ATTGACAAGA TTAGCCAGCA GCAAGGAAGA 265 GTAGTGGCTC TTGAAGGTGC ACTGTGTTCT CCGGTGTAAT CTTTTCTTTC TTTTTTGTCC 11208 |||||||||| |||||| GTAGTGGCTC TTGAAG.... .......... .......... .......... .......... 281 TCTTTCTAAC TATGTTAGAA ATGGATTTAT TTCCTTCATT CGTAATCCTC CATTCGACAA 11148 .......... .......... .......... .......... .......... .......... 281 TGGATCTATT GGAAATCGTA TATCTTGAAA ATCTTACGTA AGTTCCGTCC TATTGTATAC 11088 .......... .......... .......... .......... .......... .......... 281 GAGTGTGGTG GAAAAAATGG TATAGATCTG TTCTCTTTTT AAACAATTAT TGTTTTTGTG 11028 .......... .......... .......... .......... .......... .......... 281 TTGTATATTG CGAGATATCT TCATGGATGA GCAGTGAGGA TGGGACCTTG ATGCAATGCG 10968 .......... .......... .......... .......... .......... .......... 281 GAAACCAAAA GAAACCCTAA TCTAAGAACA AGAAAGTAAA AGATAAATAG ATAGAACACA 10908 .......... .......... .......... .......... .......... .......... 281 AGTATGGAAT TAATTGACAA TTATGGTTCT AAGATAACCA AAACCTTCAA TTGTTGAATC 10848 .......... .......... .......... .......... .......... .......... 281 CGAAAAAAAC ACCTAAGCTT TAAGATGAAC CTCAAGGGAG TTGAATTCAC CTTGAAACTC 10788 .......... .......... .......... .......... .......... .......... 281 ACCTCTCAAA CAAAGGTTCA ACAAAACCAA GCTCTCAAAT CTCTCAAAGA GAAGAAAACC 10728 .......... .......... .......... .......... .......... .......... 281 AATATTCATT AAGACTAAGT CTATCAAGAT AGTTTCAACT ATCTATAGTT TAGGCTAATT 10668 .......... .......... .......... .......... .......... .......... 281 ATTACAAAAA ACGCCTTAAG TGACATCCCT TGAAAATTGT AAAATTAGCC AAATTGCTCT 10608 .......... .......... .......... .......... .......... .......... 281 GCTAATCGTG ACATGCGGTT CAGGCCTGAA TCTGGGCAGT GTCCAGTTCT GAGATACAGT 10548 .......... .......... .......... .......... .......... .......... 281 CCAAGGTACA GGGCATAAGT AATTCTGCGG GCCATATGTC GCTTCTGTAC CTGCCGCATC 10488 .......... .......... .......... .......... .......... .......... 281 TGGCTGTTCT TGACTTATGG TTGAGATAAA GTCCATATGT TTAGTCATAG ATCCCTCCTA 10428 .......... .......... .......... .......... .......... .......... 281 TTTTGTCCTC TAAGGCTATC TTCATGACAT GAGATCCCTG GGATGACATC AAAATATGCT 10368 .......... .......... .......... .......... .......... .......... 281 CAAGCACTTC CATCTTCATA AATTGTCCTT GTAATGCTTG GAGATCTCGT GCTCGACTCC 10308 .......... .......... .......... .......... .......... .......... 281 TTGTAAATGG CCTTGATGCA ACTTGGCGCA TTAGACCTGT TCAGTTTCTT CATGTTTCTC 10248 .......... .......... .......... .......... .......... .......... 281 TTTCAATGCA TTTTTCCTTG TTCTTTCTGT GATAATGTAG ATCTCAAATA ATTTCTGTAC 10188 .......... .......... .......... .......... .......... .......... 281 CAATCGAAAA AAAACAATGC TTTTTAACTT TTTATATGAA GGGTTATGGG TAGTTGTACT 10128 .......... .......... .......... .......... .......... .......... 281 TCCCTTATCT TTATCTTGCT ACATTTCAGA ACAAATGAAG CGCCAGGACC AGGAGTGCCG 10068 | |||||||||| |||||||||| |||||||||| .......... .......... .........A ACAAATGAAG CGCCAGGACC AGGAGTGCCG 312 ACAATTAAGG GCTCTTGTTC AGGATCTTGA AAGTAAGTCG ATAAACTCCT CTTTCTTCTT 10008 |||||||||| |||||||||| |||||||||| || ACAATTAAGG GCTCTTGTTC AGGATCTTGA AA........ .......... .......... 344 TCAGCTTTTT GTCAAAAGCC GCTGCTTTTA GTCGCAGTAG TATGAAATGT ACACCTGCAA 9948 .......... .......... .......... .......... .......... .......... 344 AATATATACC CATTGTATGT GATAAATAAA GACCTGTTAA TGTCAATTTG TCAGTTCATA 9888 .......... .......... .......... .......... .......... .......... 344 CATTGAGTTT ATTAATGTTG TGAGCTCTAA ATTCTATTCT AGTTAAGTCA TGCCTACAAG 9828 .......... .......... .......... .......... .......... .......... 344 GAATCTTATC TTATCATTAA ATACATAAAT ATATACTCAT GCCTACAAGT ATTTGAACTT 9768 .......... .......... .......... .......... .......... .......... 344 ATTTATATAT TTGATGTTGT TAATTTATCT GTTACAGGTA AGGGCATAAA AAAGTTAATC 9708 ||| |||||||||| |||||||||| .......... .......... .......... .......GTA AGGGCATAAA AAAGTTAATC 367 GGAAATGTGC AGGTTTATAT ACATTCCCAC ATCTTCAGTC ATACATTTGC TACCACCATC 9648 |||||||||| || GGAAATGTGC AG........ .......... .......... .......... .......... 379 TGGTGACCTC AATTCTGTCA AATCTTTGTT CATCAACTAA TTACTATATT TACTAGATGC 9588 |||| .......... .......... .......... .......... .......... ......ATGC 383 CAGTGGCAGC TGTAGTTGTT ATGGCTTGCA GTCGTTCTGA CTACCTGGAG AAGACTATAA 9528 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGTGGCAGC TGTAGTTGTT ATGGCTTGCA GTCGTTCTGA CTACCTGGAG AAGACTATAA 443 AATCCATCTT AAAGTATGCT TTCTATCAAA ACAATTTTAT CTGCTTCTCA TGACATACTA 9468 |||||||||| ||| AATCCATCTT AAA....... .......... .......... .......... .......... 456 GATGCCTCAG CTGATAAGCC CGGTATTTCC ATTGTTGTCA TCAGATACCA AACATCTGTT 9408 |||||| |||||||||| .......... .......... .......... .......... ....ATACCA AACATCTGTT 472 GCATCAAAAT ATCCTCTTTT CATATCCCAG GTACCCATTT ATTTTCCCTC ATAGCCTTCT 9348 |||||||||| |||||||||| |||||||||| GCATCAAAAT ATCCTCTTTT CATATCCCAG .......... .......... .......... 502 ATTGCATGCT TGTCTTCTTT GTCTTGCTGA GCCTACTTCT CGTTCTACTT CCCTTTGGCA 9288 .......... .......... .......... .......... .......... .......... 502 GGATGGATCG AATCCTGATG TTAGAAAGCT TGCTTTGAGC TATGATCAAC TGACGTATAT 9228 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .GATGGATCG AATCCTGATG TTAGAAAGCT TGCTTTGAGC TATGATCAAC TGACGTATAT 561 GCAGGTACTT TTCCTATCGC TTGAGAAAGG GAAAATGAAA TTTATTTGGG GTATATCTAT 9168 |||| GCAG...... .......... .......... .......... .......... .......... 565 CTGTCAAATT TAAATCAGGC TGATCCTTAC TTGGAGAAAA AGTATAGACT TAAGAATATG 9108 .......... .......... .......... .......... .......... .......... 565 AATTCATTGT TCCAATGCTC AATCATCGTC ATTCCAGTAA CAAGATCGTG TACTGGTGAA 9048 .......... .......... .......... .......... .......... .......... 565 ACAAGTTAGT AGAAAAATTA CCCATAAGGA GTTTTTATCT AGTAAAAATG GAAAGGGAAA 8988 .......... .......... .......... .......... .......... .......... 565 AAATACATAA TCAATATTTG ACATCTAAAT GTTATCCTAA TCATTTTAAC TCTTTTAATA 8928 .......... .......... .......... .......... .......... .......... 565 CTTCATTCAT TCATTGTGTG ACAATTTGCC CTCCCCCCCG TTAGCTATAC AAGTGGAAGA 8868 .......... .......... .......... .......... .......... .......... 565 GGCATGTGTA GTTTGATTTA TTCTTTTAAG ATATATATGT ATATATATAC ATATATATGA 8808 .......... .......... .......... .......... .......... .......... 565 TTTCCTTCTC TCTCTTTGTT TGATTAGCCA TACTTCTGTT TTGTATAAAT ACTCATCTAC 8748 .......... .......... .......... .......... .......... .......... 565 TGATCTACAA GGTTCATAGT TTTATAACAT ATCAATTGGC TAAATTTTGT TCTGATAAAT 8688 .......... .......... .......... .......... .......... .......... 565 GCTTTACTTG CATGGGAATG AAGCTAGCTT CTTTTCGTTT AGCTTAAGGT AGCTGTAGTT 8628 .......... .......... .......... .......... .......... .......... 565 ACTTTAGTCT TTATCTAATC TTTTGGTGAT TAGTGATAAC AGTTCTGGCC TTACATTATA 8568 .......... .......... .......... .......... .......... .......... 565 AAGTGTAGTT ACAAGCATTG CTTCTGTTTG ATCTTTGTAT CAAACTCTTC TTGGCAGTTT 8508 .......... .......... .......... .......... .......... .......... 565 TTATTGACTT TCTTAATAAA AGACCTTTTT TGATTTTTAA TCGACAGCAC TTGGATTTTG 8448 ||| |||||||||| .......... .......... .......... .......... .......CAC TTGGATTTTG 578 AACCTGTGCA TACTGAAAGA CCAGGGGAAC TGGTTGCATA CTACAAGA 8400 |||||||||| |||||||||| ||| |||||| |||||||||| |||||||| AACCTGTGCA TACTGAAAGA CCAAGGGAAC TGGTTGCATA CTACAAGA 626 hqPGS_C01HBa0088L02.1-_SGN-E297108+ (13007 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8400) ******************************************************************************** EST sequence 181 +strand 590 n (File: SGN-E312220+) 1 TTGATCCTAT GTGAGGCAAC ACTCGGAACT GAGAAACCCT TAGAATTCAA TTTCGCATTT 61 GGCAGAGATG AGAGGAAACA AGTTTTGCTT TGATTTACGG TACCTTCTCG TCGTGGCTGC 121 TCTCGCCTTC ATCTACATAC AGATGCGGCT TTTCGTGACA CAGTCAGAAT ATGCAGACCG 181 CCTTGCTGCT GCGATTGAAG CAGAAAATCA TTGTACAAGT CAGACTAGGT TGCTTATTGA 241 CAAGATTAGC CAGCAGCAAG GAAGAGTAGT GGCTCTTGAA GAACAAATGA AGCGCCAGGA 301 CCAGGAGTGC CGACAATTAA GGGCTCTTGT TCAGGATCTT GAAAGTAAGG GCATAAAAAA 361 GTTAATCGGA AATGTGCAGA TGCCAGTGGC AGCTGTAGTT GTTATGGCTT GCAGTCGTTC 421 TGACTACCTG GAGAAGACTA TAAAATCCAT CTTAAAATAC CAAACATCTG TTGCATCAAA 481 ATATCCTCTT TTCATATCCC AGGATGGATC GAATCCTGAT GTTAGAAAGC TTGCTTTGAG 541 CTATGATCAA CTGACGTATA TGCAGCACTT GGATTTTGAA CCTGTGCATA Predicted gene structure (within gDNA segment 13607 to 8364): Exon 1 13007 12866 ( 142 n); cDNA 1 142 ( 142 n); score: 1.000 Intron 1 12865 11756 (1110 n); Pd: 0.999 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 2 11755 11705 ( 51 n); cDNA 143 193 ( 51 n); score: 1.000 Intron 2 11704 11340 ( 365 n); Pd: 0.987 (s: 1.00), Pa: 0.967 (s: 1.00) Exon 3 11339 11252 ( 88 n); cDNA 194 281 ( 88 n); score: 1.000 Intron 3 11251 10099 (1153 n); Pd: 0.893 (s: 1.00), Pa: 0.951 (s: 1.00) Exon 4 10098 10036 ( 63 n); cDNA 282 344 ( 63 n); score: 1.000 Intron 4 10035 9731 ( 305 n); Pd: 0.996 (s: 1.00), Pa: 0.999 (s: 0) Exon 5 9730 9696 ( 35 n); cDNA 345 379 ( 35 n); score: 1.000 Intron 5 9695 9592 ( 104 n); Pd: 0.939 (s: 0), Pa: 0.594 (s: 1.00) Exon 6 9591 9515 ( 77 n); cDNA 380 456 ( 77 n); score: 1.000 Intron 6 9514 9424 ( 91 n); Pd: 0.972 (s: 1.00), Pa: 0.000 (s: 1.00) Exon 7 9423 9378 ( 46 n); cDNA 457 502 ( 46 n); score: 1.000 Intron 7 9377 9287 ( 91 n); Pd: 0.998 (s: 1.00), Pa: 0.989 (s: 1.00) Exon 8 9286 9224 ( 63 n); cDNA 503 565 ( 63 n); score: 1.000 Intron 8 9223 8461 ( 763 n); Pd: 0.937 (s: 1.00), Pa: 0.997 (s: 0) Exon 9 8460 8436 ( 25 n); cDNA 566 590 ( 25 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E312220+ 1.000 590 1.000 C PGS_C01HBa0088L02.1-_SGN-E312220+ (13007 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8436) Alignment (genomic DNA sequence = upper lines): TTGATCCTAT GTGAGGCAAC ACTCGGAACT GAGAAACCCT TAGAATTCAA TTTCGCATTT 12948 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGATCCTAT GTGAGGCAAC ACTCGGAACT GAGAAACCCT TAGAATTCAA TTTCGCATTT 60 GGCAGAGATG AGAGGAAACA AGTTTTGCTT TGATTTACGG TACCTTCTCG TCGTGGCTGC 12888 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGCAGAGATG AGAGGAAACA AGTTTTGCTT TGATTTACGG TACCTTCTCG TCGTGGCTGC 120 TCTCGCCTTC ATCTACATAC AGGTTATCTT CTGGCCTCCT CTCAGATCTA TACGCATATA 12828 |||||||||| |||||||||| || TCTCGCCTTC ATCTACATAC AG........ .......... .......... .......... 142 ACTATTATTC ATTTCATCTC AGCGATTTTT TCTGTAATTT AACACAATTT GGTATCTTTA 12768 .......... .......... .......... .......... .......... .......... 142 GTGAACCTAA TTGTCAGTTG AGTTAGAATC TCTTATGAAG CTATAGAACA ATTCCACTAA 12708 .......... .......... .......... .......... .......... .......... 142 CGACTATAAC TTTAAATCCC GAGCTCCTCC GGGTCAACTA CATTAATCAT CTAATGAGGG 12648 .......... .......... .......... .......... .......... .......... 142 GTTTGGCTAA AAAGAAATGC AAACTTGCAC AACCAATGAA TTGCTTAACC ATCAAGGGGA 12588 .......... .......... .......... .......... .......... .......... 142 TGCAAAAAAT TATTTGTACA AAACTAGCTG CTTTTACCCT ATTTGTACAA TGTGATATTT 12528 .......... .......... .......... .......... .......... .......... 142 CCGCTAAAGA GATTTACTTG AACCTTCCTT CAACAAACTT AGCTAGGCCA CTGGTCTCTC 12468 .......... .......... .......... .......... .......... .......... 142 TTTTAGGATT TGGCTTGCAA TTCCCCTTGG CAGAGATAGA GTCAGTGCTT AGCAAAGAAT 12408 .......... .......... .......... .......... .......... .......... 142 TGACATTCAA ATGTCCAAAA ATTATCGGAA GCCATGCAAT TGAAAATTCT TATAGCTTGT 12348 .......... .......... .......... .......... .......... .......... 142 AGGTAATGAA ATTGAAAGTT TCCCCAAATA TATTCTGACG ATACTGCGCC AACTTATGCG 12288 .......... .......... .......... .......... .......... .......... 142 TATAACTTAC GTTACCATAC TGTATTGGTT CGGTTTTAGT ATCTCTTTTA TCTCTTTATG 12228 .......... .......... .......... .......... .......... .......... 142 ATGTTTCCAA CAAAAGAAAA TAGCAACATA TGAATTTTAA GTCACAAGGG GCTGGCCTAG 12168 .......... .......... .......... .......... .......... .......... 142 CGACCGAGAA ATTGCTGTGG CGAAATTGGG AACCAAGATT GGAATTCGAA CAGAGGAAAA 12108 .......... .......... .......... .......... .......... .......... 142 AGTACAGAAA TTCCTTGCAT CTGCCTAAGC TTAGTGGATG TAGTTACTCA ATACTTGTGT 12048 .......... .......... .......... .......... .......... .......... 142 TGCTAGAAGA TAGTAAGTAC CTGGTGGATT GGTCGAGGTT CACAAAAGGT AGCCTTGATA 11988 .......... .......... .......... .......... .......... .......... 142 TCACTATTAT AAAGAGAAAA GTTTATATTG CTTAGGTAAA GCCATAACTT GTCCACTACC 11928 .......... .......... .......... .......... .......... .......... 142 CCAAGCAATC CTTTCTTTGC ATGATTAGCT TGTTTTATCT TTATTTTTAC ATATGAGGTT 11868 .......... .......... .......... .......... .......... .......... 142 ACTTGGTTCT GTTGACATTG GTGTTATGAG AAGAAATTAC CTAACTGGAT TACTGTTTGC 11808 .......... .......... .......... .......... .......... .......... 142 TTAATGGCGA AGTAGGTATA TTTTAAGTGG TTGTTTTTGC TACATTTCTC AGATGCGGCT 11748 |||||||| .......... .......... .......... .......... .......... ..ATGCGGCT 150 TTTCGTGACA CAGTCAGAAT ATGCAGACCG CCTTGCTGCT GCGGTAAGTA TCTAGGCTCA 11688 |||||||||| |||||||||| |||||||||| |||||||||| ||| TTTCGTGACA CAGTCAGAAT ATGCAGACCG CCTTGCTGCT GCG....... .......... 193 TCTAGTCATC CTTCCGAATG GAATCTAAAT ACCATAGACA TATTTCCTGT GTTCTATCGT 11628 .......... .......... .......... .......... .......... .......... 193 TTATGTATTT ATAATTCTTG TCATGTATTA TGAACATAAT GTTTCTAAAA GCTTTTTTTT 11568 .......... .......... .......... .......... .......... .......... 193 TAACAAGCGT TTCGAAAAGC TTCATATGCT CTACTTGAAG GTATCCTTCA ACAGTTCAAA 11508 .......... .......... .......... .......... .......... .......... 193 TATTCATTCC GAAAATCCTC TCTTTTCTTC TCAACAGGAG ATTGCTTAAT CTTCTTTTGC 11448 .......... .......... .......... .......... .......... .......... 193 ATTTTCTTAG CAACACACAA CTGCATCCTA CGTCAATGAT GTAGCTAAAG AAAGAAGAAA 11388 .......... .......... .......... .......... .......... .......... 193 ATAGCTTTTA ATTGCTAATA ATGTGTACAA ATCATGTGAA TGACACAGAT TGAAGCAGAA 11328 || |||||||||| .......... .......... .......... .......... ........AT TGAAGCAGAA 205 AATCATTGTA CAAGTCAGAC TAGGTTGCTT ATTGACAAGA TTAGCCAGCA GCAAGGAAGA 11268 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATCATTGTA CAAGTCAGAC TAGGTTGCTT ATTGACAAGA TTAGCCAGCA GCAAGGAAGA 265 GTAGTGGCTC TTGAAGGTGC ACTGTGTTCT CCGGTGTAAT CTTTTCTTTC TTTTTTGTCC 11208 |||||||||| |||||| GTAGTGGCTC TTGAAG.... .......... .......... .......... .......... 281 TCTTTCTAAC TATGTTAGAA ATGGATTTAT TTCCTTCATT CGTAATCCTC CATTCGACAA 11148 .......... .......... .......... .......... .......... .......... 281 TGGATCTATT GGAAATCGTA TATCTTGAAA ATCTTACGTA AGTTCCGTCC TATTGTATAC 11088 .......... .......... .......... .......... .......... .......... 281 GAGTGTGGTG GAAAAAATGG TATAGATCTG TTCTCTTTTT AAACAATTAT TGTTTTTGTG 11028 .......... .......... .......... .......... .......... .......... 281 TTGTATATTG CGAGATATCT TCATGGATGA GCAGTGAGGA TGGGACCTTG ATGCAATGCG 10968 .......... .......... .......... .......... .......... .......... 281 GAAACCAAAA GAAACCCTAA TCTAAGAACA AGAAAGTAAA AGATAAATAG ATAGAACACA 10908 .......... .......... .......... .......... .......... .......... 281 AGTATGGAAT TAATTGACAA TTATGGTTCT AAGATAACCA AAACCTTCAA TTGTTGAATC 10848 .......... .......... .......... .......... .......... .......... 281 CGAAAAAAAC ACCTAAGCTT TAAGATGAAC CTCAAGGGAG TTGAATTCAC CTTGAAACTC 10788 .......... .......... .......... .......... .......... .......... 281 ACCTCTCAAA CAAAGGTTCA ACAAAACCAA GCTCTCAAAT CTCTCAAAGA GAAGAAAACC 10728 .......... .......... .......... .......... .......... .......... 281 AATATTCATT AAGACTAAGT CTATCAAGAT AGTTTCAACT ATCTATAGTT TAGGCTAATT 10668 .......... .......... .......... .......... .......... .......... 281 ATTACAAAAA ACGCCTTAAG TGACATCCCT TGAAAATTGT AAAATTAGCC AAATTGCTCT 10608 .......... .......... .......... .......... .......... .......... 281 GCTAATCGTG ACATGCGGTT CAGGCCTGAA TCTGGGCAGT GTCCAGTTCT GAGATACAGT 10548 .......... .......... .......... .......... .......... .......... 281 CCAAGGTACA GGGCATAAGT AATTCTGCGG GCCATATGTC GCTTCTGTAC CTGCCGCATC 10488 .......... .......... .......... .......... .......... .......... 281 TGGCTGTTCT TGACTTATGG TTGAGATAAA GTCCATATGT TTAGTCATAG ATCCCTCCTA 10428 .......... .......... .......... .......... .......... .......... 281 TTTTGTCCTC TAAGGCTATC TTCATGACAT GAGATCCCTG GGATGACATC AAAATATGCT 10368 .......... .......... .......... .......... .......... .......... 281 CAAGCACTTC CATCTTCATA AATTGTCCTT GTAATGCTTG GAGATCTCGT GCTCGACTCC 10308 .......... .......... .......... .......... .......... .......... 281 TTGTAAATGG CCTTGATGCA ACTTGGCGCA TTAGACCTGT TCAGTTTCTT CATGTTTCTC 10248 .......... .......... .......... .......... .......... .......... 281 TTTCAATGCA TTTTTCCTTG TTCTTTCTGT GATAATGTAG ATCTCAAATA ATTTCTGTAC 10188 .......... .......... .......... .......... .......... .......... 281 CAATCGAAAA AAAACAATGC TTTTTAACTT TTTATATGAA GGGTTATGGG TAGTTGTACT 10128 .......... .......... .......... .......... .......... .......... 281 TCCCTTATCT TTATCTTGCT ACATTTCAGA ACAAATGAAG CGCCAGGACC AGGAGTGCCG 10068 | |||||||||| |||||||||| |||||||||| .......... .......... .........A ACAAATGAAG CGCCAGGACC AGGAGTGCCG 312 ACAATTAAGG GCTCTTGTTC AGGATCTTGA AAGTAAGTCG ATAAACTCCT CTTTCTTCTT 10008 |||||||||| |||||||||| |||||||||| || ACAATTAAGG GCTCTTGTTC AGGATCTTGA AA........ .......... .......... 344 TCAGCTTTTT GTCAAAAGCC GCTGCTTTTA GTCGCAGTAG TATGAAATGT ACACCTGCAA 9948 .......... .......... .......... .......... .......... .......... 344 AATATATACC CATTGTATGT GATAAATAAA GACCTGTTAA TGTCAATTTG TCAGTTCATA 9888 .......... .......... .......... .......... .......... .......... 344 CATTGAGTTT ATTAATGTTG TGAGCTCTAA ATTCTATTCT AGTTAAGTCA TGCCTACAAG 9828 .......... .......... .......... .......... .......... .......... 344 GAATCTTATC TTATCATTAA ATACATAAAT ATATACTCAT GCCTACAAGT ATTTGAACTT 9768 .......... .......... .......... .......... .......... .......... 344 ATTTATATAT TTGATGTTGT TAATTTATCT GTTACAGGTA AGGGCATAAA AAAGTTAATC 9708 ||| |||||||||| |||||||||| .......... .......... .......... .......GTA AGGGCATAAA AAAGTTAATC 367 GGAAATGTGC AGGTTTATAT ACATTCCCAC ATCTTCAGTC ATACATTTGC TACCACCATC 9648 |||||||||| || GGAAATGTGC AG........ .......... .......... .......... .......... 379 TGGTGACCTC AATTCTGTCA AATCTTTGTT CATCAACTAA TTACTATATT TACTAGATGC 9588 |||| .......... .......... .......... .......... .......... ......ATGC 383 CAGTGGCAGC TGTAGTTGTT ATGGCTTGCA GTCGTTCTGA CTACCTGGAG AAGACTATAA 9528 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGTGGCAGC TGTAGTTGTT ATGGCTTGCA GTCGTTCTGA CTACCTGGAG AAGACTATAA 443 AATCCATCTT AAAGTATGCT TTCTATCAAA ACAATTTTAT CTGCTTCTCA TGACATACTA 9468 |||||||||| ||| AATCCATCTT AAA....... .......... .......... .......... .......... 456 GATGCCTCAG CTGATAAGCC CGGTATTTCC ATTGTTGTCA TCAGATACCA AACATCTGTT 9408 |||||| |||||||||| .......... .......... .......... .......... ....ATACCA AACATCTGTT 472 GCATCAAAAT ATCCTCTTTT CATATCCCAG GTACCCATTT ATTTTCCCTC ATAGCCTTCT 9348 |||||||||| |||||||||| |||||||||| GCATCAAAAT ATCCTCTTTT CATATCCCAG .......... .......... .......... 502 ATTGCATGCT TGTCTTCTTT GTCTTGCTGA GCCTACTTCT CGTTCTACTT CCCTTTGGCA 9288 .......... .......... .......... .......... .......... .......... 502 GGATGGATCG AATCCTGATG TTAGAAAGCT TGCTTTGAGC TATGATCAAC TGACGTATAT 9228 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .GATGGATCG AATCCTGATG TTAGAAAGCT TGCTTTGAGC TATGATCAAC TGACGTATAT 561 GCAGGTACTT TTCCTATCGC TTGAGAAAGG GAAAATGAAA TTTATTTGGG GTATATCTAT 9168 |||| GCAG...... .......... .......... .......... .......... .......... 565 CTGTCAAATT TAAATCAGGC TGATCCTTAC TTGGAGAAAA AGTATAGACT TAAGAATATG 9108 .......... .......... .......... .......... .......... .......... 565 AATTCATTGT TCCAATGCTC AATCATCGTC ATTCCAGTAA CAAGATCGTG TACTGGTGAA 9048 .......... .......... .......... .......... .......... .......... 565 ACAAGTTAGT AGAAAAATTA CCCATAAGGA GTTTTTATCT AGTAAAAATG GAAAGGGAAA 8988 .......... .......... .......... .......... .......... .......... 565 AAATACATAA TCAATATTTG ACATCTAAAT GTTATCCTAA TCATTTTAAC TCTTTTAATA 8928 .......... .......... .......... .......... .......... .......... 565 CTTCATTCAT TCATTGTGTG ACAATTTGCC CTCCCCCCCG TTAGCTATAC AAGTGGAAGA 8868 .......... .......... .......... .......... .......... .......... 565 GGCATGTGTA GTTTGATTTA TTCTTTTAAG ATATATATGT ATATATATAC ATATATATGA 8808 .......... .......... .......... .......... .......... .......... 565 TTTCCTTCTC TCTCTTTGTT TGATTAGCCA TACTTCTGTT TTGTATAAAT ACTCATCTAC 8748 .......... .......... .......... .......... .......... .......... 565 TGATCTACAA GGTTCATAGT TTTATAACAT ATCAATTGGC TAAATTTTGT TCTGATAAAT 8688 .......... .......... .......... .......... .......... .......... 565 GCTTTACTTG CATGGGAATG AAGCTAGCTT CTTTTCGTTT AGCTTAAGGT AGCTGTAGTT 8628 .......... .......... .......... .......... .......... .......... 565 ACTTTAGTCT TTATCTAATC TTTTGGTGAT TAGTGATAAC AGTTCTGGCC TTACATTATA 8568 .......... .......... .......... .......... .......... .......... 565 AAGTGTAGTT ACAAGCATTG CTTCTGTTTG ATCTTTGTAT CAAACTCTTC TTGGCAGTTT 8508 .......... .......... .......... .......... .......... .......... 565 TTATTGACTT TCTTAATAAA AGACCTTTTT TGATTTTTAA TCGACAGCAC TTGGATTTTG 8448 ||| |||||||||| .......... .......... .......... .......... .......CAC TTGGATTTTG 578 AACCTGTGCA TA 8436 |||||||||| || AACCTGTGCA TA 590 hqPGS_C01HBa0088L02.1-_SGN-E312220+ (13007 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8436) ******************************************************************************** EST sequence 175 +strand 587 n (File: SGN-E553993+) 1 CTAGATCCTA TGTGAGGCGA CACTCGGAAC TGAGAAACCC TTAGAATTCA ATTTCGCATT 61 TGGCAGAGAT GAGAGGAAAC AAGTTTTGCT TTGATTTACG GTACCTTCTC GTCGTGGCTG 121 CTCTCGCCTT CATCTACATA CATATGCGGC TTTTCGTGAC ACAGACAGAA TATGCAGACC 181 GCCTTGCTGC TGCGATTGAA GCAAATAATC ATTGTACAAG TCAGACTAGG TTGCTTATTG 241 ACAAGATTAG TCAGCAGCAA GGAAGAGTAG TGGCTCTTGA AGAACAAATG AAGCGCCAGG 301 ACTAGGAGTG CCGACAATTA AGGGCTCTTG TTCAGGATCT TGAAAGTAAG GGCATAAAAA 361 AGTTAATCGG AAATGTGCAG ATGCCAGAGG CAGCTGTACA TGCTATGGCT TGCAATCGTT 421 CTGACTACCT GGAGAAGACT ATATAATCCA TCTTAAAATA CCTAACATCT GTAGCATCAA 481 AATATCCTCT TTTCATATCC CAGGATGGAT CGAATCCTGA TGTTAGAAAG CTGGCTTTGA 541 GCTATGAATC AACTGACGTA TATGCAGCAC TTGGATTATG AACCTGT Predicted gene structure (within gDNA segment 13779 to 8414): Exon 1 13008 12866 ( 143 n); cDNA 1 143 ( 143 n); score: 0.979 Intron 1 12865 11756 (1110 n); Pd: 0.999 (s: 0.98), Pa: 0.995 (s: 0.98) Exon 2 11755 11705 ( 51 n); cDNA 144 194 ( 51 n); score: 0.980 Intron 2 11704 11340 ( 365 n); Pd: 0.987 (s: 0.98), Pa: 0.967 (s: 0.96) Exon 3 11339 11252 ( 88 n); cDNA 195 282 ( 88 n); score: 0.966 Intron 3 11251 10099 (1153 n); Pd: 0.893 (s: 0.98), Pa: 0.951 (s: 0.98) Exon 4 10098 10036 ( 63 n); cDNA 283 345 ( 63 n); score: 0.984 Intron 4 10035 9731 ( 305 n); Pd: 0.996 (s: 0.98), Pa: 0.999 (s: 0) Exon 5 9730 9696 ( 35 n); cDNA 346 380 ( 35 n); score: 1.000 Intron 5 9695 9592 ( 104 n); Pd: 0.939 (s: 0), Pa: 0.594 (s: 0.90) Exon 6 9591 9515 ( 77 n); cDNA 381 457 ( 77 n); score: 0.922 Intron 6 9514 9424 ( 91 n); Pd: 0.972 (s: 0.96), Pa: 0.000 (s: 0.96) Exon 7 9423 9378 ( 46 n); cDNA 458 503 ( 46 n); score: 0.957 Intron 7 9377 9287 ( 91 n); Pd: 0.998 (s: 0.96), Pa: 0.989 (s: 0.93) Exon 8 9286 9224 ( 63 n); cDNA 504 567 ( 64 n); score: 0.944 Intron 8 9223 8461 ( 763 n); Pd: 0.937 (s: 0.93), Pa: 0.997 (s: 0) Exon 9 8460 8441 ( 20 n); cDNA 568 587 ( 20 n); score: 0.950 MATCH C01HBa0088L02.1- SGN-E553993+ 0.964 586 0.998 C PGS_C01HBa0088L02.1-_SGN-E553993+ (13008 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8441) Alignment (genomic DNA sequence = upper lines): CTTGATCCTA TGTGAGGCAA CACTCGGAAC TGAGAAACCC TTAGAATTCA ATTTCGCATT 12949 || ||||||| |||||||| | |||||||||| |||||||||| |||||||||| |||||||||| CTAGATCCTA TGTGAGGCGA CACTCGGAAC TGAGAAACCC TTAGAATTCA ATTTCGCATT 60 TGGCAGAGAT GAGAGGAAAC AAGTTTTGCT TTGATTTACG GTACCTTCTC GTCGTGGCTG 12889 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGCAGAGAT GAGAGGAAAC AAGTTTTGCT TTGATTTACG GTACCTTCTC GTCGTGGCTG 120 CTCTCGCCTT CATCTACATA CAGGTTATCT TCTGGCCTCC TCTCAGATCT ATACGCATAT 12829 |||||||||| |||||||||| || CTCTCGCCTT CATCTACATA CAT....... .......... .......... .......... 143 AACTATTATT CATTTCATCT CAGCGATTTT TTCTGTAATT TAACACAATT TGGTATCTTT 12769 .......... .......... .......... .......... .......... .......... 143 AGTGAACCTA ATTGTCAGTT GAGTTAGAAT CTCTTATGAA GCTATAGAAC AATTCCACTA 12709 .......... .......... .......... .......... .......... .......... 143 ACGACTATAA CTTTAAATCC CGAGCTCCTC CGGGTCAACT ACATTAATCA TCTAATGAGG 12649 .......... .......... .......... .......... .......... .......... 143 GGTTTGGCTA AAAAGAAATG CAAACTTGCA CAACCAATGA ATTGCTTAAC CATCAAGGGG 12589 .......... .......... .......... .......... .......... .......... 143 ATGCAAAAAA TTATTTGTAC AAAACTAGCT GCTTTTACCC TATTTGTACA ATGTGATATT 12529 .......... .......... .......... .......... .......... .......... 143 TCCGCTAAAG AGATTTACTT GAACCTTCCT TCAACAAACT TAGCTAGGCC ACTGGTCTCT 12469 .......... .......... .......... .......... .......... .......... 143 CTTTTAGGAT TTGGCTTGCA ATTCCCCTTG GCAGAGATAG AGTCAGTGCT TAGCAAAGAA 12409 .......... .......... .......... .......... .......... .......... 143 TTGACATTCA AATGTCCAAA AATTATCGGA AGCCATGCAA TTGAAAATTC TTATAGCTTG 12349 .......... .......... .......... .......... .......... .......... 143 TAGGTAATGA AATTGAAAGT TTCCCCAAAT ATATTCTGAC GATACTGCGC CAACTTATGC 12289 .......... .......... .......... .......... .......... .......... 143 GTATAACTTA CGTTACCATA CTGTATTGGT TCGGTTTTAG TATCTCTTTT ATCTCTTTAT 12229 .......... .......... .......... .......... .......... .......... 143 GATGTTTCCA ACAAAAGAAA ATAGCAACAT ATGAATTTTA AGTCACAAGG GGCTGGCCTA 12169 .......... .......... .......... .......... .......... .......... 143 GCGACCGAGA AATTGCTGTG GCGAAATTGG GAACCAAGAT TGGAATTCGA ACAGAGGAAA 12109 .......... .......... .......... .......... .......... .......... 143 AAGTACAGAA ATTCCTTGCA TCTGCCTAAG CTTAGTGGAT GTAGTTACTC AATACTTGTG 12049 .......... .......... .......... .......... .......... .......... 143 TTGCTAGAAG ATAGTAAGTA CCTGGTGGAT TGGTCGAGGT TCACAAAAGG TAGCCTTGAT 11989 .......... .......... .......... .......... .......... .......... 143 ATCACTATTA TAAAGAGAAA AGTTTATATT GCTTAGGTAA AGCCATAACT TGTCCACTAC 11929 .......... .......... .......... .......... .......... .......... 143 CCCAAGCAAT CCTTTCTTTG CATGATTAGC TTGTTTTATC TTTATTTTTA CATATGAGGT 11869 .......... .......... .......... .......... .......... .......... 143 TACTTGGTTC TGTTGACATT GGTGTTATGA GAAGAAATTA CCTAACTGGA TTACTGTTTG 11809 .......... .......... .......... .......... .......... .......... 143 CTTAATGGCG AAGTAGGTAT ATTTTAAGTG GTTGTTTTTG CTACATTTCT CAGATGCGGC 11749 ||||||| .......... .......... .......... .......... .......... ...ATGCGGC 150 TTTTCGTGAC ACAGTCAGAA TATGCAGACC GCCTTGCTGC TGCGGTAAGT ATCTAGGCTC 11689 |||||||||| |||| ||||| |||||||||| |||||||||| |||| TTTTCGTGAC ACAGACAGAA TATGCAGACC GCCTTGCTGC TGCG...... .......... 194 ATCTAGTCAT CCTTCCGAAT GGAATCTAAA TACCATAGAC ATATTTCCTG TGTTCTATCG 11629 .......... .......... .......... .......... .......... .......... 194 TTTATGTATT TATAATTCTT GTCATGTATT ATGAACATAA TGTTTCTAAA AGCTTTTTTT 11569 .......... .......... .......... .......... .......... .......... 194 TTAACAAGCG TTTCGAAAAG CTTCATATGC TCTACTTGAA GGTATCCTTC AACAGTTCAA 11509 .......... .......... .......... .......... .......... .......... 194 ATATTCATTC CGAAAATCCT CTCTTTTCTT CTCAACAGGA GATTGCTTAA TCTTCTTTTG 11449 .......... .......... .......... .......... .......... .......... 194 CATTTTCTTA GCAACACACA ACTGCATCCT ACGTCAATGA TGTAGCTAAA GAAAGAAGAA 11389 .......... .......... .......... .......... .......... .......... 194 AATAGCTTTT AATTGCTAAT AATGTGTACA AATCATGTGA ATGACACAGA TTGAAGCAGA 11329 | |||||||| | .......... .......... .......... .......... .........A TTGAAGCAAA 205 AAATCATTGT ACAAGTCAGA CTAGGTTGCT TATTGACAAG ATTAGCCAGC AGCAAGGAAG 11269 ||||||||| |||||||||| |||||||||| |||||||||| ||||| |||| |||||||||| TAATCATTGT ACAAGTCAGA CTAGGTTGCT TATTGACAAG ATTAGTCAGC AGCAAGGAAG 265 AGTAGTGGCT CTTGAAGGTG CACTGTGTTC TCCGGTGTAA TCTTTTCTTT CTTTTTTGTC 11209 |||||||||| ||||||| AGTAGTGGCT CTTGAAG... .......... .......... .......... .......... 282 CTCTTTCTAA CTATGTTAGA AATGGATTTA TTTCCTTCAT TCGTAATCCT CCATTCGACA 11149 .......... .......... .......... .......... .......... .......... 282 ATGGATCTAT TGGAAATCGT ATATCTTGAA AATCTTACGT AAGTTCCGTC CTATTGTATA 11089 .......... .......... .......... .......... .......... .......... 282 CGAGTGTGGT GGAAAAAATG GTATAGATCT GTTCTCTTTT TAAACAATTA TTGTTTTTGT 11029 .......... .......... .......... .......... .......... .......... 282 GTTGTATATT GCGAGATATC TTCATGGATG AGCAGTGAGG ATGGGACCTT GATGCAATGC 10969 .......... .......... .......... .......... .......... .......... 282 GGAAACCAAA AGAAACCCTA ATCTAAGAAC AAGAAAGTAA AAGATAAATA GATAGAACAC 10909 .......... .......... .......... .......... .......... .......... 282 AAGTATGGAA TTAATTGACA ATTATGGTTC TAAGATAACC AAAACCTTCA ATTGTTGAAT 10849 .......... .......... .......... .......... .......... .......... 282 CCGAAAAAAA CACCTAAGCT TTAAGATGAA CCTCAAGGGA GTTGAATTCA CCTTGAAACT 10789 .......... .......... .......... .......... .......... .......... 282 CACCTCTCAA ACAAAGGTTC AACAAAACCA AGCTCTCAAA TCTCTCAAAG AGAAGAAAAC 10729 .......... .......... .......... .......... .......... .......... 282 CAATATTCAT TAAGACTAAG TCTATCAAGA TAGTTTCAAC TATCTATAGT TTAGGCTAAT 10669 .......... .......... .......... .......... .......... .......... 282 TATTACAAAA AACGCCTTAA GTGACATCCC TTGAAAATTG TAAAATTAGC CAAATTGCTC 10609 .......... .......... .......... .......... .......... .......... 282 TGCTAATCGT GACATGCGGT TCAGGCCTGA ATCTGGGCAG TGTCCAGTTC TGAGATACAG 10549 .......... .......... .......... .......... .......... .......... 282 TCCAAGGTAC AGGGCATAAG TAATTCTGCG GGCCATATGT CGCTTCTGTA CCTGCCGCAT 10489 .......... .......... .......... .......... .......... .......... 282 CTGGCTGTTC TTGACTTATG GTTGAGATAA AGTCCATATG TTTAGTCATA GATCCCTCCT 10429 .......... .......... .......... .......... .......... .......... 282 ATTTTGTCCT CTAAGGCTAT CTTCATGACA TGAGATCCCT GGGATGACAT CAAAATATGC 10369 .......... .......... .......... .......... .......... .......... 282 TCAAGCACTT CCATCTTCAT AAATTGTCCT TGTAATGCTT GGAGATCTCG TGCTCGACTC 10309 .......... .......... .......... .......... .......... .......... 282 CTTGTAAATG GCCTTGATGC AACTTGGCGC ATTAGACCTG TTCAGTTTCT TCATGTTTCT 10249 .......... .......... .......... .......... .......... .......... 282 CTTTCAATGC ATTTTTCCTT GTTCTTTCTG TGATAATGTA GATCTCAAAT AATTTCTGTA 10189 .......... .......... .......... .......... .......... .......... 282 CCAATCGAAA AAAAACAATG CTTTTTAACT TTTTATATGA AGGGTTATGG GTAGTTGTAC 10129 .......... .......... .......... .......... .......... .......... 282 TTCCCTTATC TTTATCTTGC TACATTTCAG AACAAATGAA GCGCCAGGAC CAGGAGTGCC 10069 |||||||||| |||||||||| ||||||||| .......... .......... .......... AACAAATGAA GCGCCAGGAC TAGGAGTGCC 312 GACAATTAAG GGCTCTTGTT CAGGATCTTG AAAGTAAGTC GATAAACTCC TCTTTCTTCT 10009 |||||||||| |||||||||| |||||||||| ||| GACAATTAAG GGCTCTTGTT CAGGATCTTG AAA....... .......... .......... 345 TTCAGCTTTT TGTCAAAAGC CGCTGCTTTT AGTCGCAGTA GTATGAAATG TACACCTGCA 9949 .......... .......... .......... .......... .......... .......... 345 AAATATATAC CCATTGTATG TGATAAATAA AGACCTGTTA ATGTCAATTT GTCAGTTCAT 9889 .......... .......... .......... .......... .......... .......... 345 ACATTGAGTT TATTAATGTT GTGAGCTCTA AATTCTATTC TAGTTAAGTC ATGCCTACAA 9829 .......... .......... .......... .......... .......... .......... 345 GGAATCTTAT CTTATCATTA AATACATAAA TATATACTCA TGCCTACAAG TATTTGAACT 9769 .......... .......... .......... .......... .......... .......... 345 TATTTATATA TTTGATGTTG TTAATTTATC TGTTACAGGT AAGGGCATAA AAAAGTTAAT 9709 || |||||||||| |||||||||| .......... .......... .......... ........GT AAGGGCATAA AAAAGTTAAT 367 CGGAAATGTG CAGGTTTATA TACATTCCCA CATCTTCAGT CATACATTTG CTACCACCAT 9649 |||||||||| ||| CGGAAATGTG CAG....... .......... .......... .......... .......... 380 CTGGTGACCT CAATTCTGTC AAATCTTTGT TCATCAACTA ATTACTATAT TTACTAGATG 9589 ||| .......... .......... .......... .......... .......... .......ATG 383 CCAGTGGCAG CTGTAGTTGT TATGGCTTGC AGTCGTTCTG ACTACCTGGA GAAGACTATA 9529 |||| ||||| ||||| || |||||||||| | |||||||| |||||||||| |||||||||| CCAGAGGCAG CTGTACATGC TATGGCTTGC AATCGTTCTG ACTACCTGGA GAAGACTATA 443 AAATCCATCT TAAAGTATGC TTTCTATCAA AACAATTTTA TCTGCTTCTC ATGACATACT 9469 ||||||||| |||| TAATCCATCT TAAA...... .......... .......... .......... .......... 457 AGATGCCTCA GCTGATAAGC CCGGTATTTC CATTGTTGTC ATCAGATACC AAACATCTGT 9409 ||||| ||||||||| .......... .......... .......... .......... .....ATACC TAACATCTGT 472 TGCATCAAAA TATCCTCTTT TCATATCCCA GGTACCCATT TATTTTCCCT CATAGCCTTC 9349 ||||||||| |||||||||| |||||||||| | AGCATCAAAA TATCCTCTTT TCATATCCCA G......... .......... .......... 503 TATTGCATGC TTGTCTTCTT TGTCTTGCTG AGCCTACTTC TCGTTCTACT TCCCTTTGGC 9289 .......... .......... .......... .......... .......... .......... 503 AGGATGGATC GAATCCTGAT GTTAGAAAGC TTGCTTTGAG CTATG-ATCA ACTGACGTAT 9230 |||||||| |||||||||| |||||||||| | |||||||| ||||| |||| |||||||||| ..GATGGATC GAATCCTGAT GTTAGAAAGC TGGCTTTGAG CTATGAATCA ACTGACGTAT 561 ATGCAGGTAC TTTTCCTATC GCTTGAGAAA GGGAAAATGA AATTTATTTG GGGTATATCT 9170 |||||| ATGCAG.... .......... .......... .......... .......... .......... 567 ATCTGTCAAA TTTAAATCAG GCTGATCCTT ACTTGGAGAA AAAGTATAGA CTTAAGAATA 9110 .......... .......... .......... .......... .......... .......... 567 TGAATTCATT GTTCCAATGC TCAATCATCG TCATTCCAGT AACAAGATCG TGTACTGGTG 9050 .......... .......... .......... .......... .......... .......... 567 AAACAAGTTA GTAGAAAAAT TACCCATAAG GAGTTTTTAT CTAGTAAAAA TGGAAAGGGA 8990 .......... .......... .......... .......... .......... .......... 567 AAAAATACAT AATCAATATT TGACATCTAA ATGTTATCCT AATCATTTTA ACTCTTTTAA 8930 .......... .......... .......... .......... .......... .......... 567 TACTTCATTC ATTCATTGTG TGACAATTTG CCCTCCCCCC CGTTAGCTAT ACAAGTGGAA 8870 .......... .......... .......... .......... .......... .......... 567 GAGGCATGTG TAGTTTGATT TATTCTTTTA AGATATATAT GTATATATAT ACATATATAT 8810 .......... .......... .......... .......... .......... .......... 567 GATTTCCTTC TCTCTCTTTG TTTGATTAGC CATACTTCTG TTTTGTATAA ATACTCATCT 8750 .......... .......... .......... .......... .......... .......... 567 ACTGATCTAC AAGGTTCATA GTTTTATAAC ATATCAATTG GCTAAATTTT GTTCTGATAA 8690 .......... .......... .......... .......... .......... .......... 567 ATGCTTTACT TGCATGGGAA TGAAGCTAGC TTCTTTTCGT TTAGCTTAAG GTAGCTGTAG 8630 .......... .......... .......... .......... .......... .......... 567 TTACTTTAGT CTTTATCTAA TCTTTTGGTG ATTAGTGATA ACAGTTCTGG CCTTACATTA 8570 .......... .......... .......... .......... .......... .......... 567 TAAAGTGTAG TTACAAGCAT TGCTTCTGTT TGATCTTTGT ATCAAACTCT TCTTGGCAGT 8510 .......... .......... .......... .......... .......... .......... 567 TTTTATTGAC TTTCTTAATA AAAGACCTTT TTTGATTTTT AATCGACAGC ACTTGGATTT 8450 | ||||||||| .......... .......... .......... .......... .........C ACTTGGATTA 578 TGAACCTGT 8441 ||||||||| TGAACCTGT 587 hqPGS_C01HBa0088L02.1-_SGN-E553993+ (13008 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224) ******************************************************************************** EST sequence 69 -strand 565 n (File: SGN-E275667-) 1 GAGACATCTG TGACGGACCG TCGTGCCTGT GACGGTCCGT CGTGGGTTCC GTTGTTTCAG 61 CCAATTTTCC AGAAATAAAA TCTGCTGCTC AAAACGACTA AACAGGTCGT TACAGTAATG 121 AAAAAAAAGA AGAAAGAGAA TAAAGAAAGA AGAAAGAAAG AGAAAAGGGA AGAAGAAGAA 181 AGAGAAAAAG AAAAAGAAAA AGAAAATGAA ATTGATAAAA TAAGAAAAAT AAAAATAAAA 241 ATTAATACGT GGCAGATTAT AATTGATGCG TAATTGAACT TCTTTTTTTG CAAGTGAGGA 301 TGGTTAAAAA ATGAGATATT TACAACACTT TAAAATTATT TAAGGGAGTA ATAAAATGTC 361 CGCTAAGTTA AGATATCTTT TTAATAATTT AAAATAACTT TAATGGTATT TTTATATCTT 421 TTCTCAAATA TTAAACTTTT TTAGAATACA CTCAATTCGC CTCAATGTCT TTTAAAATTT 481 TGACATTATG AATATCGACA TCACATGGTG CATATGCAAA AGTAATCACA TTATTATTGA 541 ATAGATCTAA TCTTTCATTG AGCGC Predicted gene structure (within gDNA segment 17617 to 10008): Exon 1 16425 16316 ( 110 n); cDNA 8 116 ( 109 n); score: 0.882 Intron 1 16315 15005 (1311 n); Pd: 0.000 (s: 0.98), Pa: 0.000 (s: 0.64) Exon 2 15004 14954 ( 51 n); cDNA 117 166 ( 50 n); score: 0.647 Intron 2 14953 13700 (1254 n); Pd: 0.000 (s: 0.64), Pa: 0.934 (s: 0) Exon 3 13699 13678 ( 22 n); cDNA 167 187 ( 21 n); score: 0.682 Intron 3 13677 10945 (2733 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 4 10944 10912 ( 33 n); cDNA 188 220 ( 33 n); score: 0.727 MATCH C01HBa0088L02.1- SGN-E275667- 0.807 216 0.382 C PGS_C01HBa0088L02.1-_SGN-E275667- (16425 16316,15004 14954,13699 13678,10944 10912) Alignment (genomic DNA sequence = upper lines): CTGCGACGGT CCGTCGTGCC CATGACGGTC CGTCGTGGGG TCCGTCGCCT CAGTCTGTTT 16366 ||| ||||| |||||||||| |||||||| ||||||||| ||||| | | ||| | || CTGTGACGGA CCGTCGTGCC TGTGACGGTC CGTCGTGGGT TCCGTTGTTT CAG-CCAATT 66 TTCCAGAAAT AAAATCTGCT GCTCAAAACG ACTAAACAGG TCGTTACAAT TTATTGTTAG 16306 |||||||||| |||||||||| |||||||||| |||||||||| |||||||| | TTCCAGAAAT AAAATCTGCT GCTCAAAACG ACTAAACAGG TCGTTACAGT .......... 116 TTATGTCAAA TTATTGTGGA ATGGAGAAGA AGTCAAATAC CATGCCATGC ATATAACAAG 16246 .......... .......... .......... .......... .......... .......... 116 TTTGGGTGGT TTTACCTAAT TTGCATCATT AGTAGATCTA TCAAGTGCAA ATAACCATGA 16186 .......... .......... .......... .......... .......... .......... 116 AAGTAATAAT TTATGTGCTT TTGTTGTTCA TGATCTTTGC AATTGAGTTG CTAGAACTAA 16126 .......... .......... .......... .......... .......... .......... 116 TAGAGCTTTC TTTCTTTGCA GGGCAATCAT ACAATGTTAA TTTTTTAGAC AAAATTACTA 16066 .......... .......... .......... .......... .......... .......... 116 ATATTAGAAA GAAAGAAAAA AAACACTGCA ATTGCAGTTT GATGAGTAGC TTAGATGGTT 16006 .......... .......... .......... .......... .......... .......... 116 GGGCAGCCCA ACAATCATTT TGTCATGGAC TCAATGAAAA GAGAATGATC ACGCAAGTAT 15946 .......... .......... .......... .......... .......... .......... 116 ATCTCAATGA GTAAATAGTA AAGTTAATAG ATACAATACC TGCTAATTTC GAAAGATGGT 15886 .......... .......... .......... .......... .......... .......... 116 TGTTGAACGA CTCTACTGCA TATGTAGACC TCAGGCCAAC CAATTGCACA AGTTTGTATT 15826 .......... .......... .......... .......... .......... .......... 116 TGACACAGAT GACATATGAC AAATATATTA CATAATAGAA GTTCAATATA AGTAGGTCCG 15766 .......... .......... .......... .......... .......... .......... 116 TTTCAATTGA GGCTTAGACA TAACCTAAGG AATTAGAGAA ATATATGTTA TTTTAGTGGA 15706 .......... .......... .......... .......... .......... .......... 116 ATAATTCTTG TCCCAATTAA TTTGGAGATG AAGATTTTTA CCAGAATAAT AAAAGAAAAC 15646 .......... .......... .......... .......... .......... .......... 116 AAAGGACAAC GAACTACAAA AATGTATATG TATAATATCA GTTATATACA ATTATATACA 15586 .......... .......... .......... .......... .......... .......... 116 TATGCAATTC ACCTCTCTCC CACTCTCAGC GCTCTTTGCT CGCCTCTCTG TTCCCTCTCT 15526 .......... .......... .......... .......... .......... .......... 116 CAATCTCGCT TGCCATTTAT AAAAATGTAT ATGTATAATA TCAATTATAT ACAATTATAT 15466 .......... .......... .......... .......... .......... .......... 116 ACATATGCAA TTCACCGCTC TTCCACTCTC TGCCCTCTCT CGCACGCGTC TCTTGATCTC 15406 .......... .......... .......... .......... .......... .......... 116 GCTCGCCTCT CTCCTCTCTC TCCCAGTCTC GACTGCCTCT CTCCTCCCTC TCCCAATCTC 15346 .......... .......... .......... .......... .......... .......... 116 TTGCCATATA TACAATTACA TATGTATGAT ATACAATTAT CTAACCAGAA TACATATACA 15286 .......... .......... .......... .......... .......... .......... 116 ATTTACCTTT CCCCCTCTCT CGCCTCTCTC CTCTCTCTCC CAGTCTCGCT CGCCGCTCTT 15226 .......... .......... .......... .......... .......... .......... 116 CTCCATATAA CATGTAGTTA CAAATTGTAA TTATCAAGTC ATAGCTATAT GTGAAAGTTT 15166 .......... .......... .......... .......... .......... .......... 116 CCCATTAAAT ATAGATACAA TTAATAATTT TATATTATGA TTTTATTTGC ACAAAAATCA 15106 .......... .......... .......... .......... .......... .......... 116 ACAATGCAGA TAAAATAATT TTATATTAAA CGACTATCAA AGAAAATAAT ATGAATTATA 15046 .......... .......... .......... .......... .......... .......... 116 TCTGGTGTAT GTTTTAGAAA GAATTTGTTT TATGAAATAA GAAAATATAA ATCAAATAAT 14986 || | || | || || .......... .......... .......... .......... .AATGAAAAA AAAGAAGAAA 135 AATAATAATA TAATAATCAA GAAAAGAGAA AAATATTTCT TTTTAATACA TTCCTAATTC 14926 | ||||| || || || | |||||||| || GAGAATAAAG AAAGAAGAAA G-AAAGAGAA AA........ .......... .......... 166 TTATTCACTT TTTCCTTTTG TAGTTGTCCT TAATTACTTC CCGTAGCTCA TGGTCGTGGG 14866 .......... .......... .......... .......... .......... .......... 166 TCAAGAGCCA ACTTAGGAGC TACAGACCAT GAACCTACGG ACATGCAGGA CTGTCAGTAG 14806 .......... .......... .......... .......... .......... .......... 166 GTCGTTCTAA GGCAAAATGT TATAATGTAG GTGTCTTAAA CTAGGCTTCG TTTCAATTCG 14746 .......... .......... .......... .......... .......... .......... 166 CAGTTTTCAA TAACTTTTTT AAAATATTAA ATTTTTATTT TATCTACTTT ATAATTAATA 14686 .......... .......... .......... .......... .......... .......... 166 GGAATTAAAT AATAAACTAC TACGTCAATA ATTTTTTTCT TAACTTAATT GATTAGAGAC 14626 .......... .......... .......... .......... .......... .......... 166 ACAAGGAACA TAAATTTTGA TGAGCTGGAT TGGAGTATTG TCGGGTATAC CTTACTGCAC 14566 .......... .......... .......... .......... .......... .......... 166 ACGCGTTTTG TTGGTTTTGT GTCTATCCGA TTTTTTCGTA CATTTTACTA CAATGCTTAA 14506 .......... .......... .......... .......... .......... .......... 166 TAAACAATTT TCCGATGCGG AGTATGTTAT TAACAAGACT TAAGTCATAT GGAGCCCCTT 14446 .......... .......... .......... .......... .......... .......... 166 TAAGTTGTCT GAATATTTCA TTTAAACGTC TCAACTTATG TTTGTGCCTA TTGGACAATA 14386 .......... .......... .......... .......... .......... .......... 166 TATTTGTTCA AAAATTATTT TTATTAGACA CAAAATATTG ACATGTCAAA AAACGTGTGC 14326 .......... .......... .......... .......... .......... .......... 166 TACACTCTCT AAAAGGGCAT AAAACTATTG AAATTATTAC TTTTTTTTTT CTAACTTATA 14266 .......... .......... .......... .......... .......... .......... 166 TACTAAAACT AATGAAAAGG GATAAAAAGA ATTTAACTTT TTTTTTGAAA ATGTACTCTT 14206 .......... .......... .......... .......... .......... .......... 166 TTTTTCCCCG CCCAAAATTG CACCCCTGCA CTATTTATAT TGACCATCTC CATAATTTTT 14146 .......... .......... .......... .......... .......... .......... 166 CGTACACAAG TGCACAACCC ACCCCACACC CTCCTGCTCA CTCTCTGTCT CTCACCCTCT 14086 .......... .......... .......... .......... .......... .......... 166 CCGGTTCTTC TTCTTCTTCT AATTTTTTTG TTGTAGATGT TATATCTTCA ATATTTAGGC 14026 .......... .......... .......... .......... .......... .......... 166 AAAAATCGAT TCATTCCGAT GGTAATAATA TGAATTGGTT TTATCAGGCA AAAGTTTATT 13966 .......... .......... .......... .......... .......... .......... 166 ATTATCTATT ATAATTGTGA TAAATGATTA CTAATGAAAA AAAGACAGAG GTAACAAGTA 13906 .......... .......... .......... .......... .......... .......... 166 GAAATTTTGA TGCTATTAAA GTGAAAGATA TTGGATATTT CGCCATTGTT GATCCGTTTA 13846 .......... .......... .......... .......... .......... .......... 166 TTATATAAAG GAGAAAAGAG TGATTGATCT AATGGGGTAG AAAGAAAAGA ATTTGAGTTG 13786 .......... .......... .......... .......... .......... .......... 166 ATTGGCAACA ATGTAACTAT TAAAGTTTTT TTTTTTTTTT AAAAAAATTA GTCTAAATAA 13726 .......... .......... .......... .......... .......... .......... 166 TTTACCATTT TTAATTTATG ATGAAGAAGA AGAAGTAAAA AAGACCACGC TGAGGGGCCT 13666 || ||||| || | |||| | .......... .......... ......GGGA AGAAG-AAGA AAGAGAAA.. .......... 187 AAAATTTGAT GGGTACCGTC AACCCTGAAG GTTTGGGTGG GTGGATTTTT TCGGGATACA 13606 .......... .......... .......... .......... .......... .......... 187 AAATTTTATT TTACTTTTAT CATTAAAATA TATTTTAAAA CAGGGACGGA TTCACATGGT 13546 .......... .......... .......... .......... .......... .......... 187 GTTCGCCGGA TATTCGAGCA CCCATTAACT TCGTTACGAA ATATATATAT CTATGTAGAA 13486 .......... .......... .......... .......... .......... .......... 187 ATCGATAGGT ATTTGTATAA AATTAACATA GAGCACCCAA CGAATAAATC ATATAGTTGG 13426 .......... .......... .......... .......... .......... .......... 187 CCCAGTGATT CTAGGATGAG TACTTAAGAC TCTTTTAGTG TTGTTGTACT AAGGTTCAAA 13366 .......... .......... .......... .......... .......... .......... 187 TCTCATTGTA TATTACTTAA GCGAGGAAAG GCTCAAAATA ATTCATCACC TTTGGTTTAA 13306 .......... .......... .......... .......... .......... .......... 187 GACTCAAAAG TGATCTTTAA GTTTTCACAT GGAGCACTAC GATTTCTATT AAACAAAATA 13246 .......... .......... .......... .......... .......... .......... 187 AATTATGATT AAACATTTTA TACGTAGATT ATGAATAAAA TTAATGCTAA AAATAAATAA 13186 .......... .......... .......... .......... .......... .......... 187 AATTTTGGAA AAAAAAATAT ACTAATTTTT TTTTTTAAAA ACTATTAATG CTTTACGTGA 13126 .......... .......... .......... .......... .......... .......... 187 AAACTCAAGA ATCAATTGAA TCTTTTTAAC CCAGAGAAAA ATGGACTATT GATCCTTTCC 13066 .......... .......... .......... .......... .......... .......... 187 TCTTAAGCCT ATAAACAAAT TAGAGTCTGT GATGTAATTG GAAGAGACCG TTATTGACTT 13006 .......... .......... .......... .......... .......... .......... 187 GATCCTATGT GAGGCAACAC TCGGAACTGA GAAACCCTTA GAATTCAATT TCGCATTTGG 12946 .......... .......... .......... .......... .......... .......... 187 CAGAGATGAG AGGAAACAAG TTTTGCTTTG ATTTACGGTA CCTTCTCGTC GTGGCTGCTC 12886 .......... .......... .......... .......... .......... .......... 187 TCGCCTTCAT CTACATACAG GTTATCTTCT GGCCTCCTCT CAGATCTATA CGCATATAAC 12826 .......... .......... .......... .......... .......... .......... 187 TATTATTCAT TTCATCTCAG CGATTTTTTC TGTAATTTAA CACAATTTGG TATCTTTAGT 12766 .......... .......... .......... .......... .......... .......... 187 GAACCTAATT GTCAGTTGAG TTAGAATCTC TTATGAAGCT ATAGAACAAT TCCACTAACG 12706 .......... .......... .......... .......... .......... .......... 187 ACTATAACTT TAAATCCCGA GCTCCTCCGG GTCAACTACA TTAATCATCT AATGAGGGGT 12646 .......... .......... .......... .......... .......... .......... 187 TTGGCTAAAA AGAAATGCAA ACTTGCACAA CCAATGAATT GCTTAACCAT CAAGGGGATG 12586 .......... .......... .......... .......... .......... .......... 187 CAAAAAATTA TTTGTACAAA ACTAGCTGCT TTTACCCTAT TTGTACAATG TGATATTTCC 12526 .......... .......... .......... .......... .......... .......... 187 GCTAAAGAGA TTTACTTGAA CCTTCCTTCA ACAAACTTAG CTAGGCCACT GGTCTCTCTT 12466 .......... .......... .......... .......... .......... .......... 187 TTAGGATTTG GCTTGCAATT CCCCTTGGCA GAGATAGAGT CAGTGCTTAG CAAAGAATTG 12406 .......... .......... .......... .......... .......... .......... 187 ACATTCAAAT GTCCAAAAAT TATCGGAAGC CATGCAATTG AAAATTCTTA TAGCTTGTAG 12346 .......... .......... .......... .......... .......... .......... 187 GTAATGAAAT TGAAAGTTTC CCCAAATATA TTCTGACGAT ACTGCGCCAA CTTATGCGTA 12286 .......... .......... .......... .......... .......... .......... 187 TAACTTACGT TACCATACTG TATTGGTTCG GTTTTAGTAT CTCTTTTATC TCTTTATGAT 12226 .......... .......... .......... .......... .......... .......... 187 GTTTCCAACA AAAGAAAATA GCAACATATG AATTTTAAGT CACAAGGGGC TGGCCTAGCG 12166 .......... .......... .......... .......... .......... .......... 187 ACCGAGAAAT TGCTGTGGCG AAATTGGGAA CCAAGATTGG AATTCGAACA GAGGAAAAAG 12106 .......... .......... .......... .......... .......... .......... 187 TACAGAAATT CCTTGCATCT GCCTAAGCTT AGTGGATGTA GTTACTCAAT ACTTGTGTTG 12046 .......... .......... .......... .......... .......... .......... 187 CTAGAAGATA GTAAGTACCT GGTGGATTGG TCGAGGTTCA CAAAAGGTAG CCTTGATATC 11986 .......... .......... .......... .......... .......... .......... 187 ACTATTATAA AGAGAAAAGT TTATATTGCT TAGGTAAAGC CATAACTTGT CCACTACCCC 11926 .......... .......... .......... .......... .......... .......... 187 AAGCAATCCT TTCTTTGCAT GATTAGCTTG TTTTATCTTT ATTTTTACAT ATGAGGTTAC 11866 .......... .......... .......... .......... .......... .......... 187 TTGGTTCTGT TGACATTGGT GTTATGAGAA GAAATTACCT AACTGGATTA CTGTTTGCTT 11806 .......... .......... .......... .......... .......... .......... 187 AATGGCGAAG TAGGTATATT TTAAGTGGTT GTTTTTGCTA CATTTCTCAG ATGCGGCTTT 11746 .......... .......... .......... .......... .......... .......... 187 TCGTGACACA GTCAGAATAT GCAGACCGCC TTGCTGCTGC GGTAAGTATC TAGGCTCATC 11686 .......... .......... .......... .......... .......... .......... 187 TAGTCATCCT TCCGAATGGA ATCTAAATAC CATAGACATA TTTCCTGTGT TCTATCGTTT 11626 .......... .......... .......... .......... .......... .......... 187 ATGTATTTAT AATTCTTGTC ATGTATTATG AACATAATGT TTCTAAAAGC TTTTTTTTTA 11566 .......... .......... .......... .......... .......... .......... 187 ACAAGCGTTT CGAAAAGCTT CATATGCTCT ACTTGAAGGT ATCCTTCAAC AGTTCAAATA 11506 .......... .......... .......... .......... .......... .......... 187 TTCATTCCGA AAATCCTCTC TTTTCTTCTC AACAGGAGAT TGCTTAATCT TCTTTTGCAT 11446 .......... .......... .......... .......... .......... .......... 187 TTTCTTAGCA ACACACAACT GCATCCTACG TCAATGATGT AGCTAAAGAA AGAAGAAAAT 11386 .......... .......... .......... .......... .......... .......... 187 AGCTTTTAAT TGCTAATAAT GTGTACAAAT CATGTGAATG ACACAGATTG AAGCAGAAAA 11326 .......... .......... .......... .......... .......... .......... 187 TCATTGTACA AGTCAGACTA GGTTGCTTAT TGACAAGATT AGCCAGCAGC AAGGAAGAGT 11266 .......... .......... .......... .......... .......... .......... 187 AGTGGCTCTT GAAGGTGCAC TGTGTTCTCC GGTGTAATCT TTTCTTTCTT TTTTGTCCTC 11206 .......... .......... .......... .......... .......... .......... 187 TTTCTAACTA TGTTAGAAAT GGATTTATTT CCTTCATTCG TAATCCTCCA TTCGACAATG 11146 .......... .......... .......... .......... .......... .......... 187 GATCTATTGG AAATCGTATA TCTTGAAAAT CTTACGTAAG TTCCGTCCTA TTGTATACGA 11086 .......... .......... .......... .......... .......... .......... 187 GTGTGGTGGA AAAAATGGTA TAGATCTGTT CTCTTTTTAA ACAATTATTG TTTTTGTGTT 11026 .......... .......... .......... .......... .......... .......... 187 GTATATTGCG AGATATCTTC ATGGATGAGC AGTGAGGATG GGACCTTGAT GCAATGCGGA 10966 .......... .......... .......... .......... .......... .......... 187 AACCAAAAGA AACCCTAATC TAAGAACAAG AAAGTAAAAG ATAAATAGAT AGAA 10912 ||||| ||| ||| ||| |||| ||| | || .......... .......... .AAGAAAAAG AAAAAGAAAA TGAAATTGAT AAAA 220 hqPGS_C01HBa0088L02.1-_SGN-E275667- (16425 16316,15004 14954,13699 13678,10944 10912) ******************************************************************************** EST sequence 130 +strand 729 n (File: SGN-E550212+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAAAACTCG 721 GGGGGGGGC Predicted gene structure (within gDNA segment 17761 to 11700): Exon 1 16856 16311 ( 546 n); cDNA 2 562 ( 561 n); score: 0.809 Intron 1 16310 14903 (1408 n); Pd: 0.000 (s: 0.92), Pa: 0.992 (s: 0) Exon 2 14902 14891 ( 12 n); cDNA 563 574 ( 12 n); score: 0.667 Intron 2 14890 14792 ( 99 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 3 14791 14780 ( 12 n); cDNA 575 586 ( 12 n); score: 0.833 Intron 3 14779 12803 (1977 n); Pd: 0.721 (s: 0), Pa: 0.000 (s: 0) Exon 4 12802 12777 ( 26 n); cDNA 587 612 ( 26 n); score: 0.654 Intron 4 12776 12618 ( 159 n); Pd: 0.900 (s: 0), Pa: 0.000 (s: 0.74) Exon 5 12617 12575 ( 43 n); cDNA 613 653 ( 41 n); score: 0.744 PPA cDNA 699 716 MATCH C01HBa0088L02.1- SGN-E550212+ 0.809 639 0.877 C PGS_C01HBa0088L02.1-_SGN-E550212+ (16856 16311,14902 14891,14791 14780,12802 12777,12617 12575) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| |||||| CGACTAAACA GGTCGTTAC- ATTTATG... .......... .......... .......... 562 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 562 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 562 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 .......... .......... .......... .......... .......... .......... 562 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGAAA AAAAACACTG 16038 .......... .......... .......... .......... .......... .......... 562 CAATTGCAGT TTGATGAGTA GCTTAGATGG TTGGGCAGCC CAACAATCAT TTTGTCATGG 15978 .......... .......... .......... .......... .......... .......... 562 ACTCAATGAA AAGAGAATGA TCACGCAAGT ATATCTCAAT GAGTAAATAG TAAAGTTAAT 15918 .......... .......... .......... .......... .......... .......... 562 AGATACAATA CCTGCTAATT TCGAAAGATG GTTGTTGAAC GACTCTACTG CATATGTAGA 15858 .......... .......... .......... .......... .......... .......... 562 CCTCAGGCCA ACCAATTGCA CAAGTTTGTA TTTGACACAG ATGACATATG ACAAATATAT 15798 .......... .......... .......... .......... .......... .......... 562 TACATAATAG AAGTTCAATA TAAGTAGGTC CGTTTCAATT GAGGCTTAGA CATAACCTAA 15738 .......... .......... .......... .......... .......... .......... 562 GGAATTAGAG AAATATATGT TATTTTAGTG GAATAATTCT TGTCCCAATT AATTTGGAGA 15678 .......... .......... .......... .......... .......... .......... 562 TGAAGATTTT TACCAGAATA ATAAAAGAAA ACAAAGGACA ACGAACTACA AAAATGTATA 15618 .......... .......... .......... .......... .......... .......... 562 TGTATAATAT CAGTTATATA CAATTATATA CATATGCAAT TCACCTCTCT CCCACTCTCA 15558 .......... .......... .......... .......... .......... .......... 562 GCGCTCTTTG CTCGCCTCTC TGTTCCCTCT CTCAATCTCG CTTGCCATTT ATAAAAATGT 15498 .......... .......... .......... .......... .......... .......... 562 ATATGTATAA TATCAATTAT ATACAATTAT ATACATATGC AATTCACCGC TCTTCCACTC 15438 .......... .......... .......... .......... .......... .......... 562 TCTGCCCTCT CTCGCACGCG TCTCTTGATC TCGCTCGCCT CTCTCCTCTC TCTCCCAGTC 15378 .......... .......... .......... .......... .......... .......... 562 TCGACTGCCT CTCTCCTCCC TCTCCCAATC TCTTGCCATA TATACAATTA CATATGTATG 15318 .......... .......... .......... .......... .......... .......... 562 ATATACAATT ATCTAACCAG AATACATATA CAATTTACCT TTCCCCCTCT CTCGCCTCTC 15258 .......... .......... .......... .......... .......... .......... 562 TCCTCTCTCT CCCAGTCTCG CTCGCCGCTC TTCTCCATAT AACATGTAGT TACAAATTGT 15198 .......... .......... .......... .......... .......... .......... 562 AATTATCAAG TCATAGCTAT ATGTGAAAGT TTCCCATTAA ATATAGATAC AATTAATAAT 15138 .......... .......... .......... .......... .......... .......... 562 TTTATATTAT GATTTTATTT GCACAAAAAT CAACAATGCA GATAAAATAA TTTTATATTA 15078 .......... .......... .......... .......... .......... .......... 562 AACGACTATC AAAGAAAATA ATATGAATTA TATCTGGTGT ATGTTTTAGA AAGAATTTGT 15018 .......... .......... .......... .......... .......... .......... 562 TTTATGAAAT AAGAAAATAT AAATCAAATA ATAATAATAA TATAATAATC AAGAAAAGAG 14958 .......... .......... .......... .......... .......... .......... 562 AAAAATATTT CTTTTTAATA CATTCCTAAT TCTTATTCAC TTTTTCCTTT TGTAGTTGTC 14898 || | .......... .......... .......... .......... .......... .....TTCTT 567 CTTAATTACT TCCCGTAGCT CATGGTCGTG GGTCAAGAGC CAACTTAGGA GCTACAGACC 14838 | || || CCTACTT... .......... .......... .......... .......... .......... 574 ATGAACCTAC GGACATGCAG GACTGTCAGT AGGTCGTTCT AAGGCAAAAT GTTATAATGT 14778 |||| |||| || .......... .......... .......... .......... ......AAAT ATTATTAT.. 586 AGGTGTCTTA AACTAGGCTT CGTTTCAATT CGCAGTTTTC AATAACTTTT TTAAAATATT 14718 .......... .......... .......... .......... .......... .......... 586 AAATTTTTAT TTTATCTACT TTATAATTAA TAGGAATTAA ATAATAAACT ACTACGTCAA 14658 .......... .......... .......... .......... .......... .......... 586 TAATTTTTTT CTTAACTTAA TTGATTAGAG ACACAAGGAA CATAAATTTT GATGAGCTGG 14598 .......... .......... .......... .......... .......... .......... 586 ATTGGAGTAT TGTCGGGTAT ACCTTACTGC ACACGCGTTT TGTTGGTTTT GTGTCTATCC 14538 .......... .......... .......... .......... .......... .......... 586 GATTTTTTCG TACATTTTAC TACAATGCTT AATAAACAAT TTTCCGATGC GGAGTATGTT 14478 .......... .......... .......... .......... .......... .......... 586 ATTAACAAGA CTTAAGTCAT ATGGAGCCCC TTTAAGTTGT CTGAATATTT CATTTAAACG 14418 .......... .......... .......... .......... .......... .......... 586 TCTCAACTTA TGTTTGTGCC TATTGGACAA TATATTTGTT CAAAAATTAT TTTTATTAGA 14358 .......... .......... .......... .......... .......... .......... 586 CACAAAATAT TGACATGTCA AAAAACGTGT GCTACACTCT CTAAAAGGGC ATAAAACTAT 14298 .......... .......... .......... .......... .......... .......... 586 TGAAATTATT ACTTTTTTTT TTCTAACTTA TATACTAAAA CTAATGAAAA GGGATAAAAA 14238 .......... .......... .......... .......... .......... .......... 586 GAATTTAACT TTTTTTTTGA AAATGTACTC TTTTTTTCCC CGCCCAAAAT TGCACCCCTG 14178 .......... .......... .......... .......... .......... .......... 586 CACTATTTAT ATTGACCATC TCCATAATTT TTCGTACACA AGTGCACAAC CCACCCCACA 14118 .......... .......... .......... .......... .......... .......... 586 CCCTCCTGCT CACTCTCTGT CTCTCACCCT CTCCGGTTCT TCTTCTTCTT CTAATTTTTT 14058 .......... .......... .......... .......... .......... .......... 586 TGTTGTAGAT GTTATATCTT CAATATTTAG GCAAAAATCG ATTCATTCCG ATGGTAATAA 13998 .......... .......... .......... .......... .......... .......... 586 TATGAATTGG TTTTATCAGG CAAAAGTTTA TTATTATCTA TTATAATTGT GATAAATGAT 13938 .......... .......... .......... .......... .......... .......... 586 TACTAATGAA AAAAAGACAG AGGTAACAAG TAGAAATTTT GATGCTATTA AAGTGAAAGA 13878 .......... .......... .......... .......... .......... .......... 586 TATTGGATAT TTCGCCATTG TTGATCCGTT TATTATATAA AGGAGAAAAG AGTGATTGAT 13818 .......... .......... .......... .......... .......... .......... 586 CTAATGGGGT AGAAAGAAAA GAATTTGAGT TGATTGGCAA CAATGTAACT ATTAAAGTTT 13758 .......... .......... .......... .......... .......... .......... 586 TTTTTTTTTT TTAAAAAAAT TAGTCTAAAT AATTTACCAT TTTTAATTTA TGATGAAGAA 13698 .......... .......... .......... .......... .......... .......... 586 GAAGAAGTAA AAAAGACCAC GCTGAGGGGC CTAAAATTTG ATGGGTACCG TCAACCCTGA 13638 .......... .......... .......... .......... .......... .......... 586 AGGTTTGGGT GGGTGGATTT TTTCGGGATA CAAAATTTTA TTTTACTTTT ATCATTAAAA 13578 .......... .......... .......... .......... .......... .......... 586 TATATTTTAA AACAGGGACG GATTCACATG GTGTTCGCCG GATATTCGAG CACCCATTAA 13518 .......... .......... .......... .......... .......... .......... 586 CTTCGTTACG AAATATATAT ATCTATGTAG AAATCGATAG GTATTTGTAT AAAATTAACA 13458 .......... .......... .......... .......... .......... .......... 586 TAGAGCACCC AACGAATAAA TCATATAGTT GGCCCAGTGA TTCTAGGATG AGTACTTAAG 13398 .......... .......... .......... .......... .......... .......... 586 ACTCTTTTAG TGTTGTTGTA CTAAGGTTCA AATCTCATTG TATATTACTT AAGCGAGGAA 13338 .......... .......... .......... .......... .......... .......... 586 AGGCTCAAAA TAATTCATCA CCTTTGGTTT AAGACTCAAA AGTGATCTTT AAGTTTTCAC 13278 .......... .......... .......... .......... .......... .......... 586 ATGGAGCACT ACGATTTCTA TTAAACAAAA TAAATTATGA TTAAACATTT TATACGTAGA 13218 .......... .......... .......... .......... .......... .......... 586 TTATGAATAA AATTAATGCT AAAAATAAAT AAAATTTTGG AAAAAAAAAT ATACTAATTT 13158 .......... .......... .......... .......... .......... .......... 586 TTTTTTTTAA AAACTATTAA TGCTTTACGT GAAAACTCAA GAATCAATTG AATCTTTTTA 13098 .......... .......... .......... .......... .......... .......... 586 ACCCAGAGAA AAATGGACTA TTGATCCTTT CCTCTTAAGC CTATAAACAA ATTAGAGTCT 13038 .......... .......... .......... .......... .......... .......... 586 GTGATGTAAT TGGAAGAGAC CGTTATTGAC TTGATCCTAT GTGAGGCAAC ACTCGGAACT 12978 .......... .......... .......... .......... .......... .......... 586 GAGAAACCCT TAGAATTCAA TTTCGCATTT GGCAGAGATG AGAGGAAACA AGTTTTGCTT 12918 .......... .......... .......... .......... .......... .......... 586 TGATTTACGG TACCTTCTCG TCGTGGCTGC TCTCGCCTTC ATCTACATAC AGGTTATCTT 12858 .......... .......... .......... .......... .......... .......... 586 CTGGCCTCCT CTCAGATCTA TACGCATATA ACTATTATTC ATTTCATCTC AGCGATTTTT 12798 | ||| .......... .......... .......... .......... .......... .....TATTT 591 TCTGTAATTT AACACAATTT GGTATCTTTA GTGAACCTAA TTGTCAGTTG AGTTAGAATC 12738 | | | | ||||| ||| | TACGATTTAT AACACTATTA G......... .......... .......... .......... 612 TCTTATGAAG CTATAGAACA ATTCCACTAA CGACTATAAC TTTAAATCCC GAGCTCCTCC 12678 .......... .......... .......... .......... .......... .......... 612 GGGTCAACTA CATTAATCAT CTAATGAGGG GTTTGGCTAA AAAGAAATGC AAACTTGCAC 12618 .......... .......... .......... .......... .......... .......... 612 AACCAATGAA TTGCTTAACC ATCAAGGGGA TGCAAAAAAT TAT 12575 || ||| || || || |||| || || | || ||||||| ||| AAACAAAGAT TTTCTCAACC ATGAA-TTAA TG-AAAAAAT TAT 653 hqPGS_C01HBa0088L02.1-_SGN-E550212+ (16856 16311,14902 14891,14791 14780,12802 12777,12617 12575) ******************************************************************************** EST sequence 136 +strand 732 n (File: SGN-E550201+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCNA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAAAAAACT 721 CGAGGGGGGG CC Predicted gene structure (within gDNA segment 17761 to 11670): Exon 1 16856 16311 ( 546 n); cDNA 2 562 ( 561 n); score: 0.809 Intron 1 16310 14903 (1408 n); Pd: 0.000 (s: 0.92), Pa: 0.992 (s: 0) Exon 2 14902 14891 ( 12 n); cDNA 563 574 ( 12 n); score: 0.667 Intron 2 14890 14792 ( 99 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 3 14791 14780 ( 12 n); cDNA 575 586 ( 12 n); score: 0.833 Intron 3 14779 12803 (1977 n); Pd: 0.721 (s: 0), Pa: 0.000 (s: 0) Exon 4 12802 12777 ( 26 n); cDNA 587 612 ( 26 n); score: 0.654 Intron 4 12776 12618 ( 159 n); Pd: 0.900 (s: 0), Pa: 0.000 (s: 0.72) Exon 5 12617 12575 ( 43 n); cDNA 613 653 ( 41 n); score: 0.721 PPA cDNA 699 718 MATCH C01HBa0088L02.1- SGN-E550201+ 0.809 639 0.873 C PGS_C01HBa0088L02.1-_SGN-E550201+ (16856 16311,14902 14891,14791 14780,12802 12777,12617 12575) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| |||||| CGACTAAACA GGTCGTTAC- ATTTATG... .......... .......... .......... 562 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 562 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 562 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 .......... .......... .......... .......... .......... .......... 562 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGAAA AAAAACACTG 16038 .......... .......... .......... .......... .......... .......... 562 CAATTGCAGT TTGATGAGTA GCTTAGATGG TTGGGCAGCC CAACAATCAT TTTGTCATGG 15978 .......... .......... .......... .......... .......... .......... 562 ACTCAATGAA AAGAGAATGA TCACGCAAGT ATATCTCAAT GAGTAAATAG TAAAGTTAAT 15918 .......... .......... .......... .......... .......... .......... 562 AGATACAATA CCTGCTAATT TCGAAAGATG GTTGTTGAAC GACTCTACTG CATATGTAGA 15858 .......... .......... .......... .......... .......... .......... 562 CCTCAGGCCA ACCAATTGCA CAAGTTTGTA TTTGACACAG ATGACATATG ACAAATATAT 15798 .......... .......... .......... .......... .......... .......... 562 TACATAATAG AAGTTCAATA TAAGTAGGTC CGTTTCAATT GAGGCTTAGA CATAACCTAA 15738 .......... .......... .......... .......... .......... .......... 562 GGAATTAGAG AAATATATGT TATTTTAGTG GAATAATTCT TGTCCCAATT AATTTGGAGA 15678 .......... .......... .......... .......... .......... .......... 562 TGAAGATTTT TACCAGAATA ATAAAAGAAA ACAAAGGACA ACGAACTACA AAAATGTATA 15618 .......... .......... .......... .......... .......... .......... 562 TGTATAATAT CAGTTATATA CAATTATATA CATATGCAAT TCACCTCTCT CCCACTCTCA 15558 .......... .......... .......... .......... .......... .......... 562 GCGCTCTTTG CTCGCCTCTC TGTTCCCTCT CTCAATCTCG CTTGCCATTT ATAAAAATGT 15498 .......... .......... .......... .......... .......... .......... 562 ATATGTATAA TATCAATTAT ATACAATTAT ATACATATGC AATTCACCGC TCTTCCACTC 15438 .......... .......... .......... .......... .......... .......... 562 TCTGCCCTCT CTCGCACGCG TCTCTTGATC TCGCTCGCCT CTCTCCTCTC TCTCCCAGTC 15378 .......... .......... .......... .......... .......... .......... 562 TCGACTGCCT CTCTCCTCCC TCTCCCAATC TCTTGCCATA TATACAATTA CATATGTATG 15318 .......... .......... .......... .......... .......... .......... 562 ATATACAATT ATCTAACCAG AATACATATA CAATTTACCT TTCCCCCTCT CTCGCCTCTC 15258 .......... .......... .......... .......... .......... .......... 562 TCCTCTCTCT CCCAGTCTCG CTCGCCGCTC TTCTCCATAT AACATGTAGT TACAAATTGT 15198 .......... .......... .......... .......... .......... .......... 562 AATTATCAAG TCATAGCTAT ATGTGAAAGT TTCCCATTAA ATATAGATAC AATTAATAAT 15138 .......... .......... .......... .......... .......... .......... 562 TTTATATTAT GATTTTATTT GCACAAAAAT CAACAATGCA GATAAAATAA TTTTATATTA 15078 .......... .......... .......... .......... .......... .......... 562 AACGACTATC AAAGAAAATA ATATGAATTA TATCTGGTGT ATGTTTTAGA AAGAATTTGT 15018 .......... .......... .......... .......... .......... .......... 562 TTTATGAAAT AAGAAAATAT AAATCAAATA ATAATAATAA TATAATAATC AAGAAAAGAG 14958 .......... .......... .......... .......... .......... .......... 562 AAAAATATTT CTTTTTAATA CATTCCTAAT TCTTATTCAC TTTTTCCTTT TGTAGTTGTC 14898 || | .......... .......... .......... .......... .......... .....TTCTT 567 CTTAATTACT TCCCGTAGCT CATGGTCGTG GGTCAAGAGC CAACTTAGGA GCTACAGACC 14838 | || || CCTACTT... .......... .......... .......... .......... .......... 574 ATGAACCTAC GGACATGCAG GACTGTCAGT AGGTCGTTCT AAGGCAAAAT GTTATAATGT 14778 |||| |||| || .......... .......... .......... .......... ......AAAT ATTATTAT.. 586 AGGTGTCTTA AACTAGGCTT CGTTTCAATT CGCAGTTTTC AATAACTTTT TTAAAATATT 14718 .......... .......... .......... .......... .......... .......... 586 AAATTTTTAT TTTATCTACT TTATAATTAA TAGGAATTAA ATAATAAACT ACTACGTCAA 14658 .......... .......... .......... .......... .......... .......... 586 TAATTTTTTT CTTAACTTAA TTGATTAGAG ACACAAGGAA CATAAATTTT GATGAGCTGG 14598 .......... .......... .......... .......... .......... .......... 586 ATTGGAGTAT TGTCGGGTAT ACCTTACTGC ACACGCGTTT TGTTGGTTTT GTGTCTATCC 14538 .......... .......... .......... .......... .......... .......... 586 GATTTTTTCG TACATTTTAC TACAATGCTT AATAAACAAT TTTCCGATGC GGAGTATGTT 14478 .......... .......... .......... .......... .......... .......... 586 ATTAACAAGA CTTAAGTCAT ATGGAGCCCC TTTAAGTTGT CTGAATATTT CATTTAAACG 14418 .......... .......... .......... .......... .......... .......... 586 TCTCAACTTA TGTTTGTGCC TATTGGACAA TATATTTGTT CAAAAATTAT TTTTATTAGA 14358 .......... .......... .......... .......... .......... .......... 586 CACAAAATAT TGACATGTCA AAAAACGTGT GCTACACTCT CTAAAAGGGC ATAAAACTAT 14298 .......... .......... .......... .......... .......... .......... 586 TGAAATTATT ACTTTTTTTT TTCTAACTTA TATACTAAAA CTAATGAAAA GGGATAAAAA 14238 .......... .......... .......... .......... .......... .......... 586 GAATTTAACT TTTTTTTTGA AAATGTACTC TTTTTTTCCC CGCCCAAAAT TGCACCCCTG 14178 .......... .......... .......... .......... .......... .......... 586 CACTATTTAT ATTGACCATC TCCATAATTT TTCGTACACA AGTGCACAAC CCACCCCACA 14118 .......... .......... .......... .......... .......... .......... 586 CCCTCCTGCT CACTCTCTGT CTCTCACCCT CTCCGGTTCT TCTTCTTCTT CTAATTTTTT 14058 .......... .......... .......... .......... .......... .......... 586 TGTTGTAGAT GTTATATCTT CAATATTTAG GCAAAAATCG ATTCATTCCG ATGGTAATAA 13998 .......... .......... .......... .......... .......... .......... 586 TATGAATTGG TTTTATCAGG CAAAAGTTTA TTATTATCTA TTATAATTGT GATAAATGAT 13938 .......... .......... .......... .......... .......... .......... 586 TACTAATGAA AAAAAGACAG AGGTAACAAG TAGAAATTTT GATGCTATTA AAGTGAAAGA 13878 .......... .......... .......... .......... .......... .......... 586 TATTGGATAT TTCGCCATTG TTGATCCGTT TATTATATAA AGGAGAAAAG AGTGATTGAT 13818 .......... .......... .......... .......... .......... .......... 586 CTAATGGGGT AGAAAGAAAA GAATTTGAGT TGATTGGCAA CAATGTAACT ATTAAAGTTT 13758 .......... .......... .......... .......... .......... .......... 586 TTTTTTTTTT TTAAAAAAAT TAGTCTAAAT AATTTACCAT TTTTAATTTA TGATGAAGAA 13698 .......... .......... .......... .......... .......... .......... 586 GAAGAAGTAA AAAAGACCAC GCTGAGGGGC CTAAAATTTG ATGGGTACCG TCAACCCTGA 13638 .......... .......... .......... .......... .......... .......... 586 AGGTTTGGGT GGGTGGATTT TTTCGGGATA CAAAATTTTA TTTTACTTTT ATCATTAAAA 13578 .......... .......... .......... .......... .......... .......... 586 TATATTTTAA AACAGGGACG GATTCACATG GTGTTCGCCG GATATTCGAG CACCCATTAA 13518 .......... .......... .......... .......... .......... .......... 586 CTTCGTTACG AAATATATAT ATCTATGTAG AAATCGATAG GTATTTGTAT AAAATTAACA 13458 .......... .......... .......... .......... .......... .......... 586 TAGAGCACCC AACGAATAAA TCATATAGTT GGCCCAGTGA TTCTAGGATG AGTACTTAAG 13398 .......... .......... .......... .......... .......... .......... 586 ACTCTTTTAG TGTTGTTGTA CTAAGGTTCA AATCTCATTG TATATTACTT AAGCGAGGAA 13338 .......... .......... .......... .......... .......... .......... 586 AGGCTCAAAA TAATTCATCA CCTTTGGTTT AAGACTCAAA AGTGATCTTT AAGTTTTCAC 13278 .......... .......... .......... .......... .......... .......... 586 ATGGAGCACT ACGATTTCTA TTAAACAAAA TAAATTATGA TTAAACATTT TATACGTAGA 13218 .......... .......... .......... .......... .......... .......... 586 TTATGAATAA AATTAATGCT AAAAATAAAT AAAATTTTGG AAAAAAAAAT ATACTAATTT 13158 .......... .......... .......... .......... .......... .......... 586 TTTTTTTTAA AAACTATTAA TGCTTTACGT GAAAACTCAA GAATCAATTG AATCTTTTTA 13098 .......... .......... .......... .......... .......... .......... 586 ACCCAGAGAA AAATGGACTA TTGATCCTTT CCTCTTAAGC CTATAAACAA ATTAGAGTCT 13038 .......... .......... .......... .......... .......... .......... 586 GTGATGTAAT TGGAAGAGAC CGTTATTGAC TTGATCCTAT GTGAGGCAAC ACTCGGAACT 12978 .......... .......... .......... .......... .......... .......... 586 GAGAAACCCT TAGAATTCAA TTTCGCATTT GGCAGAGATG AGAGGAAACA AGTTTTGCTT 12918 .......... .......... .......... .......... .......... .......... 586 TGATTTACGG TACCTTCTCG TCGTGGCTGC TCTCGCCTTC ATCTACATAC AGGTTATCTT 12858 .......... .......... .......... .......... .......... .......... 586 CTGGCCTCCT CTCAGATCTA TACGCATATA ACTATTATTC ATTTCATCTC AGCGATTTTT 12798 | ||| .......... .......... .......... .......... .......... .....TATTT 591 TCTGTAATTT AACACAATTT GGTATCTTTA GTGAACCTAA TTGTCAGTTG AGTTAGAATC 12738 | | | | ||||| ||| | TACGATTTAT AACACTATTA G......... .......... .......... .......... 612 TCTTATGAAG CTATAGAACA ATTCCACTAA CGACTATAAC TTTAAATCCC GAGCTCCTCC 12678 .......... .......... .......... .......... .......... .......... 612 GGGTCAACTA CATTAATCAT CTAATGAGGG GTTTGGCTAA AAAGAAATGC AAACTTGCAC 12618 .......... .......... .......... .......... .......... .......... 612 AACCAATGAA TTGCTTAACC ATCAAGGGGA TGCAAAAAAT TAT 12575 || ||| || || || ||| || || | || ||||||| ||| AAACAAAGAT TTTCTCNACC ATGAA-TTAA TG-AAAAAAT TAT 653 hqPGS_C01HBa0088L02.1-_SGN-E550201+ (16856 16311,14902 14891,14791 14780,12802 12777,12617 12575) ******************************************************************************** EST sequence 64 -strand 620 n (File: SGN-E238551-) 1 CTATTATTTC CCAAAATCTG GAAGTTATCA TCACAAGAAC ATCTACTTCG AATTACTAAA 61 TCTAAGAGTA TCTAAGAAGC TAAAATACAT AAACAGCTAG TCCATGCCGG AACTTCAAGG 121 CATCAAGACA TGAAGAAGAA GATCCAGTCC AAGCTAGAAG CTTTGTTTTA TCGAAAAAAG 181 GTGATTTTTC GAAAAGAGTT TGTTTTATTT TAAAGTATTT TTCGACTTTA GGAGTCGCCA 241 CTTAATTTTT AAGAAAAATC AAGAAAACTC ATTCTCAAAA CAATTTAAAC AGAAAAGTCG 301 TTTTGAAAAT ATTTTTTAGG ATTCGGGATT CTTATTAGCG TCTTAGGAAG GTGTTTAAGG 361 CACCTAAGAC ACTCCGTTAA ATACGGTTTT CCAACGACTA ACTTATTTGA TTATTTTTAT 421 TTTTACCCTT TGCAAATTTA TTTGAACTTT TATCACGATT TACTTAGCCA AACTTTGCAA 481 ATTTGAGATA TTAATCTTTT AAGATTCCGT CTTAGTTAAA CTTTCTAAGC CTTAACTCTC 541 TAAGCAGACT TTCAAATTTT AAACCTCTAT CGTTTCAAAA CTTCAATTTT TATTTTTTAG 601 TTTCATAAAG CAAAAGGCGT Predicted gene structure (within gDNA segment 19458 to 12652): Exon 1 18002 17842 ( 161 n); cDNA 1 161 ( 161 n); score: 0.863 Intron 1 17841 13992 (3850 n); Pd: 0.000 (s: 0.94), Pa: 0.000 (s: 0) Exon 2 13991 13963 ( 29 n); cDNA 162 189 ( 28 n); score: 0.759 Intron 2 13962 13804 ( 159 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 3 13803 13783 ( 21 n); cDNA 190 209 ( 20 n); score: 0.762 MATCH C01HBa0088L02.1- SGN-E238551- 0.863 211 0.340 C PGS_C01HBa0088L02.1-_SGN-E238551- (18002 17842,13991 13963,13803 13783) Alignment (genomic DNA sequence = upper lines): CTATTATTCC CCAAAATTTG GAAGTCATCA TCACAAGAAC ATCTATGATC AAATTACT-A 17944 |||||||| | ||||||| || ||||| |||| |||||||||| ||||| || ||||||| | CTATTATTTC CCAAAATCTG GAAGTTATCA TCACAAGAAC ATCTA-CTTC GAATTACTAA 59 A-CTAAAAAT GCCTAAGAAG CTAAAAATAC ATAAGAAGCT AGTCCATGCC GGAAGTTCAA 17885 | |||| | | |||||||| || ||||||| |||| |||| |||||||||| |||| ||||| ATCTAAGAGT ATCTAAGAAG CT-AAAATAC ATAAACAGCT AGTCCATGCC GGAACTTCAA 118 GGCATCAAGA CTTGAAGAAG AAGCTCCAGT CCAAGCTAGA AGCATTAGCT CACCCTGAAT 17825 |||||||||| | |||||||| ||| |||||| |||||||||| ||| GGCATCAAGA CATGAAGAAG AAGATCCAGT CCAAGCTAGA AGC....... .......... 161 TTCCGATGTA GTAAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT 17765 .......... .......... .......... .......... .......... .......... 161 ACACTCCACA AATAACAAAG AAGAAAACAT AAAAGTAGGG GTCAGTACAA AGCACGGGTA 17705 .......... .......... .......... .......... .......... .......... 161 CTGAGTAGAT ATCATCGGCC AACTCAAAAT AGAAAACAGT ATATACCAAG TAATATCATA 17645 .......... .......... .......... .......... .......... .......... 161 AACTCAACTA TGATACTCAA CATGTAGCAA CAACAAGTAC TATATCATTA ACAATTTCCG 17585 .......... .......... .......... .......... .......... .......... 161 TCAAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT CATTTGGGAA TTATGTTCAT 17525 .......... .......... .......... .......... .......... .......... 161 TAGATTGAGT ATATTAACAT CTTTTAAGAT TCATTATCTT TATTTCTCTT GTGTCGGTAC 17465 .......... .......... .......... .......... .......... .......... 161 GTGACACTCC GCTCCCTTAT ATTCATTAAT CCTCTTGTGT CGGTACGTGA CACTCCGATC 17405 .......... .......... .......... .......... .......... .......... 161 CCCTACTACT ATGTGTCGAA ACGTGACACT CCGATCCCCT AAATTCTACG TGTCGGTTCG 17345 .......... .......... .......... .......... .......... .......... 161 TGACACCCGA TCTCCTAAAT CTACGTGTCG GTTCGTGACA CCCGATCCCC TAATTCTACG 17285 .......... .......... .......... .......... .......... .......... 161 TGTCGGTTCG TGACACCCGG TCCCCTAATT CTACGTGTCG GTTCGTAACA CCCGATCCCC 17225 .......... .......... .......... .......... .......... .......... 161 TAATCTCATT CTATCAATTC ATCAAGCCTT CTCCCTTACC AAGGCATCAT CAATCTCATT 17165 .......... .......... .......... .......... .......... .......... 161 ACTTTAGTTC ATCAAGCCTT ATCCCTTACA AAGGCATCAT CATTAAAAAG AGATTAGGTT 17105 .......... .......... .......... .......... .......... .......... 161 TTTATCAAGA TTTGGGATTC GATAGCTTCA TCATGCTTAA TATAATCACA ATTATATAAT 17045 .......... .......... .......... .......... .......... .......... 161 CACGTTCATG CAAGCATACA ATTAAGCACA TAGCAGGGTT TACAATACTA TCAATACATA 16985 .......... .......... .......... .......... .......... .......... 161 TCATTCGCTA TTAAGAGTTT ACTACGAATA GTATGAAAAC CATAACCTAC CTTCACCGAA 16925 .......... .......... .......... .......... .......... .......... 161 GAATTGCGAT CAACAAGCTA TCTTCTCAAA ATCCTTGCTA TCCTCTTCGT TTCTCTCTCT 16865 .......... .......... .......... .......... .......... .......... 161 CTACTCGTTC TCTTTCTTTT TCTGTCTCTC TTTGTTCTTT CTATTTTTCT TATTCAAACC 16805 .......... .......... .......... .......... .......... .......... 161 CTCTTTCTTT TACCCTAATT AACATATAAT CAAGTGTAAA AGATGGCAAT AATAACCCAC 16745 .......... .......... .......... .......... .......... .......... 161 TAATTAACTT AAGGTTACCT CTTTTAACCC CCAAGTAATT AGACTTATTA ACATTAACCC 16685 .......... .......... .......... .......... .......... .......... 161 CCTAACTTTA TAATTTAAGC AGGAATAGTC AAAAACGTCC CTTAAAACGT ATAAAGAAAT 16625 .......... .......... .......... .......... .......... .......... 161 CCGACCCGGA CTGGGATTGC GCAACCTGTG ATGGGCCGTC GTGCCTGCGA CGGTCCGTCC 16565 .......... .......... .......... .......... .......... .......... 161 TGCAGGTCGT CGCAAAGTTC AGAGACCCAA ATTTCCACCA AGGGTCTGTG ACGGTCCGTC 16505 .......... .......... .......... .......... .......... .......... 161 CTGCCATTTC GTTACGAAGT TCAGAGAGTC GATTTCAGCA CCCAATTTTT AGATTTTCTA 16445 .......... .......... .......... .......... .......... .......... 161 AGTGTTTTGA AACGAGAACC TGCGACGGTC CGTCGTGCCC ATGACGGTCC GTCGTGGGGT 16385 .......... .......... .......... .......... .......... .......... 161 CCGTCGCCTC AGTCTGTTTT TCCAGAAATA AAATCTGCTG CTCAAAACGA CTAAACAGGT 16325 .......... .......... .......... .......... .......... .......... 161 CGTTACAATT TATTGTTAGT TATGTCAAAT TATTGTGGAA TGGAGAAGAA GTCAAATACC 16265 .......... .......... .......... .......... .......... .......... 161 ATGCCATGCA TATAACAAGT TTGGGTGGTT TTACCTAATT TGCATCATTA GTAGATCTAT 16205 .......... .......... .......... .......... .......... .......... 161 CAAGTGCAAA TAACCATGAA AGTAATAATT TATGTGCTTT TGTTGTTCAT GATCTTTGCA 16145 .......... .......... .......... .......... .......... .......... 161 ATTGAGTTGC TAGAACTAAT AGAGCTTTCT TTCTTTGCAG GGCAATCATA CAATGTTAAT 16085 .......... .......... .......... .......... .......... .......... 161 TTTTTAGACA AAATTACTAA TATTAGAAAG AAAGAAAAAA AACACTGCAA TTGCAGTTTG 16025 .......... .......... .......... .......... .......... .......... 161 ATGAGTAGCT TAGATGGTTG GGCAGCCCAA CAATCATTTT GTCATGGACT CAATGAAAAG 15965 .......... .......... .......... .......... .......... .......... 161 AGAATGATCA CGCAAGTATA TCTCAATGAG TAAATAGTAA AGTTAATAGA TACAATACCT 15905 .......... .......... .......... .......... .......... .......... 161 GCTAATTTCG AAAGATGGTT GTTGAACGAC TCTACTGCAT ATGTAGACCT CAGGCCAACC 15845 .......... .......... .......... .......... .......... .......... 161 AATTGCACAA GTTTGTATTT GACACAGATG ACATATGACA AATATATTAC ATAATAGAAG 15785 .......... .......... .......... .......... .......... .......... 161 TTCAATATAA GTAGGTCCGT TTCAATTGAG GCTTAGACAT AACCTAAGGA ATTAGAGAAA 15725 .......... .......... .......... .......... .......... .......... 161 TATATGTTAT TTTAGTGGAA TAATTCTTGT CCCAATTAAT TTGGAGATGA AGATTTTTAC 15665 .......... .......... .......... .......... .......... .......... 161 CAGAATAATA AAAGAAAACA AAGGACAACG AACTACAAAA ATGTATATGT ATAATATCAG 15605 .......... .......... .......... .......... .......... .......... 161 TTATATACAA TTATATACAT ATGCAATTCA CCTCTCTCCC ACTCTCAGCG CTCTTTGCTC 15545 .......... .......... .......... .......... .......... .......... 161 GCCTCTCTGT TCCCTCTCTC AATCTCGCTT GCCATTTATA AAAATGTATA TGTATAATAT 15485 .......... .......... .......... .......... .......... .......... 161 CAATTATATA CAATTATATA CATATGCAAT TCACCGCTCT TCCACTCTCT GCCCTCTCTC 15425 .......... .......... .......... .......... .......... .......... 161 GCACGCGTCT CTTGATCTCG CTCGCCTCTC TCCTCTCTCT CCCAGTCTCG ACTGCCTCTC 15365 .......... .......... .......... .......... .......... .......... 161 TCCTCCCTCT CCCAATCTCT TGCCATATAT ACAATTACAT ATGTATGATA TACAATTATC 15305 .......... .......... .......... .......... .......... .......... 161 TAACCAGAAT ACATATACAA TTTACCTTTC CCCCTCTCTC GCCTCTCTCC TCTCTCTCCC 15245 .......... .......... .......... .......... .......... .......... 161 AGTCTCGCTC GCCGCTCTTC TCCATATAAC ATGTAGTTAC AAATTGTAAT TATCAAGTCA 15185 .......... .......... .......... .......... .......... .......... 161 TAGCTATATG TGAAAGTTTC CCATTAAATA TAGATACAAT TAATAATTTT ATATTATGAT 15125 .......... .......... .......... .......... .......... .......... 161 TTTATTTGCA CAAAAATCAA CAATGCAGAT AAAATAATTT TATATTAAAC GACTATCAAA 15065 .......... .......... .......... .......... .......... .......... 161 GAAAATAATA TGAATTATAT CTGGTGTATG TTTTAGAAAG AATTTGTTTT ATGAAATAAG 15005 .......... .......... .......... .......... .......... .......... 161 AAAATATAAA TCAAATAATA ATAATAATAT AATAATCAAG AAAAGAGAAA AATATTTCTT 14945 .......... .......... .......... .......... .......... .......... 161 TTTAATACAT TCCTAATTCT TATTCACTTT TTCCTTTTGT AGTTGTCCTT AATTACTTCC 14885 .......... .......... .......... .......... .......... .......... 161 CGTAGCTCAT GGTCGTGGGT CAAGAGCCAA CTTAGGAGCT ACAGACCATG AACCTACGGA 14825 .......... .......... .......... .......... .......... .......... 161 CATGCAGGAC TGTCAGTAGG TCGTTCTAAG GCAAAATGTT ATAATGTAGG TGTCTTAAAC 14765 .......... .......... .......... .......... .......... .......... 161 TAGGCTTCGT TTCAATTCGC AGTTTTCAAT AACTTTTTTA AAATATTAAA TTTTTATTTT 14705 .......... .......... .......... .......... .......... .......... 161 ATCTACTTTA TAATTAATAG GAATTAAATA ATAAACTACT ACGTCAATAA TTTTTTTCTT 14645 .......... .......... .......... .......... .......... .......... 161 AACTTAATTG ATTAGAGACA CAAGGAACAT AAATTTTGAT GAGCTGGATT GGAGTATTGT 14585 .......... .......... .......... .......... .......... .......... 161 CGGGTATACC TTACTGCACA CGCGTTTTGT TGGTTTTGTG TCTATCCGAT TTTTTCGTAC 14525 .......... .......... .......... .......... .......... .......... 161 ATTTTACTAC AATGCTTAAT AAACAATTTT CCGATGCGGA GTATGTTATT AACAAGACTT 14465 .......... .......... .......... .......... .......... .......... 161 AAGTCATATG GAGCCCCTTT AAGTTGTCTG AATATTTCAT TTAAACGTCT CAACTTATGT 14405 .......... .......... .......... .......... .......... .......... 161 TTGTGCCTAT TGGACAATAT ATTTGTTCAA AAATTATTTT TATTAGACAC AAAATATTGA 14345 .......... .......... .......... .......... .......... .......... 161 CATGTCAAAA AACGTGTGCT ACACTCTCTA AAAGGGCATA AAACTATTGA AATTATTACT 14285 .......... .......... .......... .......... .......... .......... 161 TTTTTTTTTC TAACTTATAT ACTAAAACTA ATGAAAAGGG ATAAAAAGAA TTTAACTTTT 14225 .......... .......... .......... .......... .......... .......... 161 TTTTTGAAAA TGTACTCTTT TTTTCCCCGC CCAAAATTGC ACCCCTGCAC TATTTATATT 14165 .......... .......... .......... .......... .......... .......... 161 GACCATCTCC ATAATTTTTC GTACACAAGT GCACAACCCA CCCCACACCC TCCTGCTCAC 14105 .......... .......... .......... .......... .......... .......... 161 TCTCTGTCTC TCACCCTCTC CGGTTCTTCT TCTTCTTCTA ATTTTTTTGT TGTAGATGTT 14045 .......... .......... .......... .......... .......... .......... 161 ATATCTTCAA TATTTAGGCA AAAATCGATT CATTCCGATG GTAATAATAT GAATTGGTTT 13985 || |||| .......... .......... .......... .......... .......... ...TTTGTTT 168 TATCAGGCAA AAGTTTATTA TTATCTATTA TAATTGTGAT AAATGATTAC TAATGAAAAA 13925 |||| | || ||| | ||| || TATC-GAAAA AAGGTGATTT TT........ .......... .......... .......... 189 AAGACAGAGG TAACAAGTAG AAATTTTGAT GCTATTAAAG TGAAAGATAT TGGATATTTC 13865 .......... .......... .......... .......... .......... .......... 189 GCCATTGTTG ATCCGTTTAT TATATAAAGG AGAAAAGAGT GATTGATCTA ATGGGGTAGA 13805 .......... .......... .......... .......... .......... .......... 189 AAGAAAAGAA TTTGAGTTGA TT 13783 ||||||| |||| || | || .CGAAAAGAG TTTG-TTTTA TT 209 hqPGS_C01HBa0088L02.1-_SGN-E238551- (18002 17842,13991 13963,13803 13783) ******************************************************************************** EST sequence 19 -strand 676 n (File: SGN-E348470-) 1 AAAAAAAGGC CAAATATACC TCAAACTCTC ATACATGGTA TGCAGATACC ATTCGTTAAC 61 TTTTGGGACA TTGGCGCCCC TATAATTCAA AAATAGATCA TATATACCCT TAATACTAAC 121 GGACATACAC GAAGAGACGG AGTCTGAATT TTCAATAAGG GGGTTCAAAA TCTATAAAAT 181 TAGACACATG AATAAACGAA GGGAATTCGG ATGAACCCCT TTGTTCAAGG TACATACACG 241 TGTCATAATC TTGTCCACTA CATACATGTG TCATAGTATT ATCCACTATA TACATGTGTC 301 ATAATATTAT CCACTACATA CACGTGTCCA GAGGCGGACT CACATGGTGT CCGCCGGGTG 361 ATCGAGCACC CATTAACTTC GTTACAGAAT ATATATATCT ATGTAGAAAT CGGTAGGTAT 421 TTGTATAAAA TTAACATAAA ACACCCAATG AATAAATGAT TTAGTTGGCC CAATAGCTCC 481 TAGATGGGTA CTTTAAGACT TTTTAAGTGT TGTTGTACCA AGGTTCGAAT CTCACTCTTA 541 ACACATGATT CAACATTTAT TAAATATAAA ATCGACAGAT GTGTTCCGAT TTAGTCTTTC 601 TTTACATTGA AGAACATATA TACTCTATGC TCTAGTTTTT GAAGGGCATA AACACCAACC 661 GCACATATAT ACTGTA Predicted gene structure (within gDNA segment 17752 to 8076): Exon 1 13559 13355 ( 205 n); cDNA 335 539 ( 205 n); score: 0.854 Intron 1 13354 10099 (3256 n); Pd: 0.000 (s: 0.81), Pa: 0.951 (s: 0) Exon 2 10098 10083 ( 16 n); cDNA 540 555 ( 16 n); score: 0.688 Intron 2 10082 9731 ( 352 n); Pd: 0.000 (s: 0), Pa: 0.999 (s: 0) Exon 3 9730 9700 ( 31 n); cDNA 556 584 ( 29 n); score: 0.548 MATCH C01HBa0088L02.1- SGN-E348470- 0.854 252 0.373 C PGS_C01HBa0088L02.1-_SGN-E348470- (13559 13355,10098 10083,9730 9700) Alignment (genomic DNA sequence = upper lines): CGGATTCACA TGGTGTTCGC CGGATATTCG AGCACCCATT AACTTCGTTA CGAAATATAT 13500 |||| ||||| |||||| ||| ||| | ||| |||||||||| |||||||||| | ||||||| CGGACTCACA TGGTGTCCGC CGGGTGATCG AGCACCCATT AACTTCGTTA CAGAATATAT 394 ATATCTATGT AGAAATCGAT AGGTATTTGT ATAAAATTAA CATAGAGCAC CCAACGAATA 13440 |||||||||| |||||||| | |||||||||| |||||||||| |||| | ||| |||| ||||| ATATCTATGT AGAAATCGGT AGGTATTTGT ATAAAATTAA CATAAAACAC CCAATGAATA 454 AATCATATAG TTGGCCCAGT -GATTCTAGG ATGAGTAC-T TAAGACTCTT TTAGTGTTGT 13382 ||| || ||| |||||||| | | | ||| | ||| |||| | ||||||| || | |||||||| AATGATTTAG TTGGCCCAAT AGCTCCTA-G ATGGGTACTT TAAGACTTTT TAAGTGTTGT 513 TGTACTAAGG TTCAAATCTC ATTGTATATT ACTTAAGCGA GGAAAGGCTC AAAATAATTC 13322 ||||| |||| ||| |||||| | | | | TGTACCAAGG TTCGAATCTC ACTCT-T... .......... .......... .......... 539 ATCACCTTTG GTTTAAGACT CAAAAGTGAT CTTTAAGTTT TCACATGGAG CACTACGATT 13262 .......... .......... .......... .......... .......... .......... 539 TCTATTAAAC AAAATAAATT ATGATTAAAC ATTTTATACG TAGATTATGA ATAAAATTAA 13202 .......... .......... .......... .......... .......... .......... 539 TGCTAAAAAT AAATAAAATT TTGGAAAAAA AAATATACTA ATTTTTTTTT TTAAAAACTA 13142 .......... .......... .......... .......... .......... .......... 539 TTAATGCTTT ACGTGAAAAC TCAAGAATCA ATTGAATCTT TTTAACCCAG AGAAAAATGG 13082 .......... .......... .......... .......... .......... .......... 539 ACTATTGATC CTTTCCTCTT AAGCCTATAA ACAAATTAGA GTCTGTGATG TAATTGGAAG 13022 .......... .......... .......... .......... .......... .......... 539 AGACCGTTAT TGACTTGATC CTATGTGAGG CAACACTCGG AACTGAGAAA CCCTTAGAAT 12962 .......... .......... .......... .......... .......... .......... 539 TCAATTTCGC ATTTGGCAGA GATGAGAGGA AACAAGTTTT GCTTTGATTT ACGGTACCTT 12902 .......... .......... .......... .......... .......... .......... 539 CTCGTCGTGG CTGCTCTCGC CTTCATCTAC ATACAGGTTA TCTTCTGGCC TCCTCTCAGA 12842 .......... .......... .......... .......... .......... .......... 539 TCTATACGCA TATAACTATT ATTCATTTCA TCTCAGCGAT TTTTTCTGTA ATTTAACACA 12782 .......... .......... .......... .......... .......... .......... 539 ATTTGGTATC TTTAGTGAAC CTAATTGTCA GTTGAGTTAG AATCTCTTAT GAAGCTATAG 12722 .......... .......... .......... .......... .......... .......... 539 AACAATTCCA CTAACGACTA TAACTTTAAA TCCCGAGCTC CTCCGGGTCA ACTACATTAA 12662 .......... .......... .......... .......... .......... .......... 539 TCATCTAATG AGGGGTTTGG CTAAAAAGAA ATGCAAACTT GCACAACCAA TGAATTGCTT 12602 .......... .......... .......... .......... .......... .......... 539 AACCATCAAG GGGATGCAAA AAATTATTTG TACAAAACTA GCTGCTTTTA CCCTATTTGT 12542 .......... .......... .......... .......... .......... .......... 539 ACAATGTGAT ATTTCCGCTA AAGAGATTTA CTTGAACCTT CCTTCAACAA ACTTAGCTAG 12482 .......... .......... .......... .......... .......... .......... 539 GCCACTGGTC TCTCTTTTAG GATTTGGCTT GCAATTCCCC TTGGCAGAGA TAGAGTCAGT 12422 .......... .......... .......... .......... .......... .......... 539 GCTTAGCAAA GAATTGACAT TCAAATGTCC AAAAATTATC GGAAGCCATG CAATTGAAAA 12362 .......... .......... .......... .......... .......... .......... 539 TTCTTATAGC TTGTAGGTAA TGAAATTGAA AGTTTCCCCA AATATATTCT GACGATACTG 12302 .......... .......... .......... .......... .......... .......... 539 CGCCAACTTA TGCGTATAAC TTACGTTACC ATACTGTATT GGTTCGGTTT TAGTATCTCT 12242 .......... .......... .......... .......... .......... .......... 539 TTTATCTCTT TATGATGTTT CCAACAAAAG AAAATAGCAA CATATGAATT TTAAGTCACA 12182 .......... .......... .......... .......... .......... .......... 539 AGGGGCTGGC CTAGCGACCG AGAAATTGCT GTGGCGAAAT TGGGAACCAA GATTGGAATT 12122 .......... .......... .......... .......... .......... .......... 539 CGAACAGAGG AAAAAGTACA GAAATTCCTT GCATCTGCCT AAGCTTAGTG GATGTAGTTA 12062 .......... .......... .......... .......... .......... .......... 539 CTCAATACTT GTGTTGCTAG AAGATAGTAA GTACCTGGTG GATTGGTCGA GGTTCACAAA 12002 .......... .......... .......... .......... .......... .......... 539 AGGTAGCCTT GATATCACTA TTATAAAGAG AAAAGTTTAT ATTGCTTAGG TAAAGCCATA 11942 .......... .......... .......... .......... .......... .......... 539 ACTTGTCCAC TACCCCAAGC AATCCTTTCT TTGCATGATT AGCTTGTTTT ATCTTTATTT 11882 .......... .......... .......... .......... .......... .......... 539 TTACATATGA GGTTACTTGG TTCTGTTGAC ATTGGTGTTA TGAGAAGAAA TTACCTAACT 11822 .......... .......... .......... .......... .......... .......... 539 GGATTACTGT TTGCTTAATG GCGAAGTAGG TATATTTTAA GTGGTTGTTT TTGCTACATT 11762 .......... .......... .......... .......... .......... .......... 539 TCTCAGATGC GGCTTTTCGT GACACAGTCA GAATATGCAG ACCGCCTTGC TGCTGCGGTA 11702 .......... .......... .......... .......... .......... .......... 539 AGTATCTAGG CTCATCTAGT CATCCTTCCG AATGGAATCT AAATACCATA GACATATTTC 11642 .......... .......... .......... .......... .......... .......... 539 CTGTGTTCTA TCGTTTATGT ATTTATAATT CTTGTCATGT ATTATGAACA TAATGTTTCT 11582 .......... .......... .......... .......... .......... .......... 539 AAAAGCTTTT TTTTTAACAA GCGTTTCGAA AAGCTTCATA TGCTCTACTT GAAGGTATCC 11522 .......... .......... .......... .......... .......... .......... 539 TTCAACAGTT CAAATATTCA TTCCGAAAAT CCTCTCTTTT CTTCTCAACA GGAGATTGCT 11462 .......... .......... .......... .......... .......... .......... 539 TAATCTTCTT TTGCATTTTC TTAGCAACAC ACAACTGCAT CCTACGTCAA TGATGTAGCT 11402 .......... .......... .......... .......... .......... .......... 539 AAAGAAAGAA GAAAATAGCT TTTAATTGCT AATAATGTGT ACAAATCATG TGAATGACAC 11342 .......... .......... .......... .......... .......... .......... 539 AGATTGAAGC AGAAAATCAT TGTACAAGTC AGACTAGGTT GCTTATTGAC AAGATTAGCC 11282 .......... .......... .......... .......... .......... .......... 539 AGCAGCAAGG AAGAGTAGTG GCTCTTGAAG GTGCACTGTG TTCTCCGGTG TAATCTTTTC 11222 .......... .......... .......... .......... .......... .......... 539 TTTCTTTTTT GTCCTCTTTC TAACTATGTT AGAAATGGAT TTATTTCCTT CATTCGTAAT 11162 .......... .......... .......... .......... .......... .......... 539 CCTCCATTCG ACAATGGATC TATTGGAAAT CGTATATCTT GAAAATCTTA CGTAAGTTCC 11102 .......... .......... .......... .......... .......... .......... 539 GTCCTATTGT ATACGAGTGT GGTGGAAAAA ATGGTATAGA TCTGTTCTCT TTTTAAACAA 11042 .......... .......... .......... .......... .......... .......... 539 TTATTGTTTT TGTGTTGTAT ATTGCGAGAT ATCTTCATGG ATGAGCAGTG AGGATGGGAC 10982 .......... .......... .......... .......... .......... .......... 539 CTTGATGCAA TGCGGAAACC AAAAGAAACC CTAATCTAAG AACAAGAAAG TAAAAGATAA 10922 .......... .......... .......... .......... .......... .......... 539 ATAGATAGAA CACAAGTATG GAATTAATTG ACAATTATGG TTCTAAGATA ACCAAAACCT 10862 .......... .......... .......... .......... .......... .......... 539 TCAATTGTTG AATCCGAAAA AAACACCTAA GCTTTAAGAT GAACCTCAAG GGAGTTGAAT 10802 .......... .......... .......... .......... .......... .......... 539 TCACCTTGAA ACTCACCTCT CAAACAAAGG TTCAACAAAA CCAAGCTCTC AAATCTCTCA 10742 .......... .......... .......... .......... .......... .......... 539 AAGAGAAGAA AACCAATATT CATTAAGACT AAGTCTATCA AGATAGTTTC AACTATCTAT 10682 .......... .......... .......... .......... .......... .......... 539 AGTTTAGGCT AATTATTACA AAAAACGCCT TAAGTGACAT CCCTTGAAAA TTGTAAAATT 10622 .......... .......... .......... .......... .......... .......... 539 AGCCAAATTG CTCTGCTAAT CGTGACATGC GGTTCAGGCC TGAATCTGGG CAGTGTCCAG 10562 .......... .......... .......... .......... .......... .......... 539 TTCTGAGATA CAGTCCAAGG TACAGGGCAT AAGTAATTCT GCGGGCCATA TGTCGCTTCT 10502 .......... .......... .......... .......... .......... .......... 539 GTACCTGCCG CATCTGGCTG TTCTTGACTT ATGGTTGAGA TAAAGTCCAT ATGTTTAGTC 10442 .......... .......... .......... .......... .......... .......... 539 ATAGATCCCT CCTATTTTGT CCTCTAAGGC TATCTTCATG ACATGAGATC CCTGGGATGA 10382 .......... .......... .......... .......... .......... .......... 539 CATCAAAATA TGCTCAAGCA CTTCCATCTT CATAAATTGT CCTTGTAATG CTTGGAGATC 10322 .......... .......... .......... .......... .......... .......... 539 TCGTGCTCGA CTCCTTGTAA ATGGCCTTGA TGCAACTTGG CGCATTAGAC CTGTTCAGTT 10262 .......... .......... .......... .......... .......... .......... 539 TCTTCATGTT TCTCTTTCAA TGCATTTTTC CTTGTTCTTT CTGTGATAAT GTAGATCTCA 10202 .......... .......... .......... .......... .......... .......... 539 AATAATTTCT GTACCAATCG AAAAAAAACA ATGCTTTTTA ACTTTTTATA TGAAGGGTTA 10142 .......... .......... .......... .......... .......... .......... 539 TGGGTAGTTG TACTTCCCTT ATCTTTATCT TGCTACATTT CAGAACAAAT GAAGCGCCAG 10082 |||| || || | || .......... .......... .......... .......... ...AACACAT GATTCAACA. 555 GACCAGGAGT GCCGACAATT AAGGGCTCTT GTTCAGGATC TTGAAAGTAA GTCGATAAAC 10022 .......... .......... .......... .......... .......... .......... 555 TCCTCTTTCT TCTTTCAGCT TTTTGTCAAA AGCCGCTGCT TTTAGTCGCA GTAGTATGAA 9962 .......... .......... .......... .......... .......... .......... 555 ATGTACACCT GCAAAATATA TACCCATTGT ATGTGATAAA TAAAGACCTG TTAATGTCAA 9902 .......... .......... .......... .......... .......... .......... 555 TTTGTCAGTT CATACATTGA GTTTATTAAT GTTGTGAGCT CTAAATTCTA TTCTAGTTAA 9842 .......... .......... .......... .......... .......... .......... 555 GTCATGCCTA CAAGGAATCT TATCTTATCA TTAAATACAT AAATATATAC TCATGCCTAC 9782 .......... .......... .......... .......... .......... .......... 555 AAGTATTTGA ACTTATTTAT ATATTTGATG TTGTTAATTT ATCTGTTACA GGTAAGGGCA 9722 | | | .......... .......... .......... .......... .......... .TTTATTAAA 564 TAAAAAAGTT AATCGGAAAT GT 9700 || |||| | | | || | || TATAAAA-TC GA-CAGATGT GT 584 hqPGS_C01HBa0088L02.1-_SGN-E348470- (13559 13355) ******************************************************************************** EST sequence 213 +strand 711 n (File: SGN-E396056+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAA ATTTTCTCAC CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATAATAAAA ATTTACTCAT TTTTTCTTTG AGCTAATTCA TAAAAAAAAA A Predicted gene structure (within gDNA segment 17761 to 11880): Exon 1 16856 16311 ( 546 n); cDNA 2 562 ( 561 n); score: 0.809 Intron 1 16310 14903 (1408 n); Pd: 0.000 (s: 0.92), Pa: 0.992 (s: 0) Exon 2 14902 14891 ( 12 n); cDNA 563 574 ( 12 n); score: 0.667 Intron 2 14890 14725 ( 166 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 3 14724 14693 ( 32 n); cDNA 575 602 ( 28 n); score: 0.812 Intron 3 14692 14630 ( 63 n); Pd: 0.000 (s: 0), Pa: 0.972 (s: 0) Exon 4 14629 14608 ( 22 n); cDNA 603 625 ( 23 n); score: 0.659 PPA cDNA 700 711 MATCH C01HBa0088L02.1- SGN-E396056+ 0.809 612 0.861 C PGS_C01HBa0088L02.1-_SGN-E396056+ (16856 16311,14902 14891,14724 14693,14629 14608) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| |||||| CGACTAAACA GGTCGTTAC- ATTTATG... .......... .......... .......... 562 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 562 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 562 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 .......... .......... .......... .......... .......... .......... 562 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGAAA AAAAACACTG 16038 .......... .......... .......... .......... .......... .......... 562 CAATTGCAGT TTGATGAGTA GCTTAGATGG TTGGGCAGCC CAACAATCAT TTTGTCATGG 15978 .......... .......... .......... .......... .......... .......... 562 ACTCAATGAA AAGAGAATGA TCACGCAAGT ATATCTCAAT GAGTAAATAG TAAAGTTAAT 15918 .......... .......... .......... .......... .......... .......... 562 AGATACAATA CCTGCTAATT TCGAAAGATG GTTGTTGAAC GACTCTACTG CATATGTAGA 15858 .......... .......... .......... .......... .......... .......... 562 CCTCAGGCCA ACCAATTGCA CAAGTTTGTA TTTGACACAG ATGACATATG ACAAATATAT 15798 .......... .......... .......... .......... .......... .......... 562 TACATAATAG AAGTTCAATA TAAGTAGGTC CGTTTCAATT GAGGCTTAGA CATAACCTAA 15738 .......... .......... .......... .......... .......... .......... 562 GGAATTAGAG AAATATATGT TATTTTAGTG GAATAATTCT TGTCCCAATT AATTTGGAGA 15678 .......... .......... .......... .......... .......... .......... 562 TGAAGATTTT TACCAGAATA ATAAAAGAAA ACAAAGGACA ACGAACTACA AAAATGTATA 15618 .......... .......... .......... .......... .......... .......... 562 TGTATAATAT CAGTTATATA CAATTATATA CATATGCAAT TCACCTCTCT CCCACTCTCA 15558 .......... .......... .......... .......... .......... .......... 562 GCGCTCTTTG CTCGCCTCTC TGTTCCCTCT CTCAATCTCG CTTGCCATTT ATAAAAATGT 15498 .......... .......... .......... .......... .......... .......... 562 ATATGTATAA TATCAATTAT ATACAATTAT ATACATATGC AATTCACCGC TCTTCCACTC 15438 .......... .......... .......... .......... .......... .......... 562 TCTGCCCTCT CTCGCACGCG TCTCTTGATC TCGCTCGCCT CTCTCCTCTC TCTCCCAGTC 15378 .......... .......... .......... .......... .......... .......... 562 TCGACTGCCT CTCTCCTCCC TCTCCCAATC TCTTGCCATA TATACAATTA CATATGTATG 15318 .......... .......... .......... .......... .......... .......... 562 ATATACAATT ATCTAACCAG AATACATATA CAATTTACCT TTCCCCCTCT CTCGCCTCTC 15258 .......... .......... .......... .......... .......... .......... 562 TCCTCTCTCT CCCAGTCTCG CTCGCCGCTC TTCTCCATAT AACATGTAGT TACAAATTGT 15198 .......... .......... .......... .......... .......... .......... 562 AATTATCAAG TCATAGCTAT ATGTGAAAGT TTCCCATTAA ATATAGATAC AATTAATAAT 15138 .......... .......... .......... .......... .......... .......... 562 TTTATATTAT GATTTTATTT GCACAAAAAT CAACAATGCA GATAAAATAA TTTTATATTA 15078 .......... .......... .......... .......... .......... .......... 562 AACGACTATC AAAGAAAATA ATATGAATTA TATCTGGTGT ATGTTTTAGA AAGAATTTGT 15018 .......... .......... .......... .......... .......... .......... 562 TTTATGAAAT AAGAAAATAT AAATCAAATA ATAATAATAA TATAATAATC AAGAAAAGAG 14958 .......... .......... .......... .......... .......... .......... 562 AAAAATATTT CTTTTTAATA CATTCCTAAT TCTTATTCAC TTTTTCCTTT TGTAGTTGTC 14898 || | .......... .......... .......... .......... .......... .....TTCTT 567 CTTAATTACT TCCCGTAGCT CATGGTCGTG GGTCAAGAGC CAACTTAGGA GCTACAGACC 14838 | || || CCTACTT... .......... .......... .......... .......... .......... 574 ATGAACCTAC GGACATGCAG GACTGTCAGT AGGTCGTTCT AAGGCAAAAT GTTATAATGT 14778 .......... .......... .......... .......... .......... .......... 574 AGGTGTCTTA AACTAGGCTT CGTTTCAATT CGCAGTTTTC AATAACTTTT TTAAAATATT 14718 ||||||| .......... .......... .......... .......... .......... ...AAATATT 581 AAATTTTTAT TTTATCTACT TTATAATTAA TAGGAATTAA ATAATAAACT ACTACGTCAA 14658 ||| |||| |||| | | | ||||| --ATTATTAT TTTA-CGA-T TTATA..... .......... .......... .......... 602 TAATTTTTTT CTTAACTTAA TTGATTAGAG AC-ACAAGGA ACATAAATTT T 14608 | || | || | ||| |||||| | .......... .......... ........AC ACTATTAGAA ACAAAAATTT T 625 hqPGS_C01HBa0088L02.1-_SGN-E396056+ (16856 16311,14902 14891,14724 14693,14629 14608) ******************************************************************************** EST sequence 230 +strand 690 n (File: SGN-E377133+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT ATGCCATAAA 661 ATATAAAAAA TTTACTCATT TTTCATTGAG Predicted gene structure (within gDNA segment 17751 to 12080): Exon 1 16851 16311 ( 541 n); cDNA 5 561 ( 557 n); score: 0.812 Intron 1 16310 14903 (1408 n); Pd: 0.000 (s: 0.92), Pa: 0.992 (s: 0) Exon 2 14902 14891 ( 12 n); cDNA 562 573 ( 12 n); score: 0.667 Intron 2 14890 14725 ( 166 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 3 14724 14693 ( 32 n); cDNA 574 601 ( 28 n); score: 0.812 MATCH C01HBa0088L02.1- SGN-E377133+ 0.812 585 0.848 C PGS_C01HBa0088L02.1-_SGN-E377133+ (16851 16311,14902 14891,14724 14693) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 16792 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 16732 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 16672 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 16612 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 16552 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC--A- A------G-- GGT-C-T--- ----GTGACG 16512 || ||||||| ||| | |||| |||||| | | | ||| | | |||||| AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC GCCCGTGACG 361 GTCCGTCCTG CCATTTCGTT ACGAAGTTCA GAGAGTCGA- TTTCAGCACC CAATTTTTAG 16453 ||||||| || ||||| |||| |||||||||| ||||||||| ||| || ||| ||| ||| || GTCCGTCGTG CCATTCCGTT ACGAAGTTCA GAGAGTCGAT TTTTAGTACC CAA-TTTCAG 420 ATTTTCTAAG TGTTTTGAAA CGAGAACCTG CGACGGTCCG TCGTGCCCAT GACGGTCCGT 16393 | |||||||| |||||||||| ||||| | ||||||||| |||||| ||| |||||||||| AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 480 CGTGGGGTCC GTCGCCTCAG TCTGTTTTTC CAGAAATAAA ATCTGCTGCT CAAAACGACT 16333 |||||| ||| |||| |||| ||||||||| || ||||||| ||||||| || |||||||||| CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 540 AAACAGGTCG TTACAATTTA TTGTTAGTTA TGTCAAATTA TTGTGGAATG GAGAAGAAGT 16273 |||||||||| |||| ||||| | AAACAGGTCG TTAC-ATTTA TG........ .......... .......... .......... 561 CAAATACCAT GCCATGCATA TAACAAGTTT GGGTGGTTTT ACCTAATTTG CATCATTAGT 16213 .......... .......... .......... .......... .......... .......... 561 AGATCTATCA AGTGCAAATA ACCATGAAAG TAATAATTTA TGTGCTTTTG TTGTTCATGA 16153 .......... .......... .......... .......... .......... .......... 561 TCTTTGCAAT TGAGTTGCTA GAACTAATAG AGCTTTCTTT CTTTGCAGGG CAATCATACA 16093 .......... .......... .......... .......... .......... .......... 561 ATGTTAATTT TTTAGACAAA ATTACTAATA TTAGAAAGAA AGAAAAAAAA CACTGCAATT 16033 .......... .......... .......... .......... .......... .......... 561 GCAGTTTGAT GAGTAGCTTA GATGGTTGGG CAGCCCAACA ATCATTTTGT CATGGACTCA 15973 .......... .......... .......... .......... .......... .......... 561 ATGAAAAGAG AATGATCACG CAAGTATATC TCAATGAGTA AATAGTAAAG TTAATAGATA 15913 .......... .......... .......... .......... .......... .......... 561 CAATACCTGC TAATTTCGAA AGATGGTTGT TGAACGACTC TACTGCATAT GTAGACCTCA 15853 .......... .......... .......... .......... .......... .......... 561 GGCCAACCAA TTGCACAAGT TTGTATTTGA CACAGATGAC ATATGACAAA TATATTACAT 15793 .......... .......... .......... .......... .......... .......... 561 AATAGAAGTT CAATATAAGT AGGTCCGTTT CAATTGAGGC TTAGACATAA CCTAAGGAAT 15733 .......... .......... .......... .......... .......... .......... 561 TAGAGAAATA TATGTTATTT TAGTGGAATA ATTCTTGTCC CAATTAATTT GGAGATGAAG 15673 .......... .......... .......... .......... .......... .......... 561 ATTTTTACCA GAATAATAAA AGAAAACAAA GGACAACGAA CTACAAAAAT GTATATGTAT 15613 .......... .......... .......... .......... .......... .......... 561 AATATCAGTT ATATACAATT ATATACATAT GCAATTCACC TCTCTCCCAC TCTCAGCGCT 15553 .......... .......... .......... .......... .......... .......... 561 CTTTGCTCGC CTCTCTGTTC CCTCTCTCAA TCTCGCTTGC CATTTATAAA AATGTATATG 15493 .......... .......... .......... .......... .......... .......... 561 TATAATATCA ATTATATACA ATTATATACA TATGCAATTC ACCGCTCTTC CACTCTCTGC 15433 .......... .......... .......... .......... .......... .......... 561 CCTCTCTCGC ACGCGTCTCT TGATCTCGCT CGCCTCTCTC CTCTCTCTCC CAGTCTCGAC 15373 .......... .......... .......... .......... .......... .......... 561 TGCCTCTCTC CTCCCTCTCC CAATCTCTTG CCATATATAC AATTACATAT GTATGATATA 15313 .......... .......... .......... .......... .......... .......... 561 CAATTATCTA ACCAGAATAC ATATACAATT TACCTTTCCC CCTCTCTCGC CTCTCTCCTC 15253 .......... .......... .......... .......... .......... .......... 561 TCTCTCCCAG TCTCGCTCGC CGCTCTTCTC CATATAACAT GTAGTTACAA ATTGTAATTA 15193 .......... .......... .......... .......... .......... .......... 561 TCAAGTCATA GCTATATGTG AAAGTTTCCC ATTAAATATA GATACAATTA ATAATTTTAT 15133 .......... .......... .......... .......... .......... .......... 561 ATTATGATTT TATTTGCACA AAAATCAACA ATGCAGATAA AATAATTTTA TATTAAACGA 15073 .......... .......... .......... .......... .......... .......... 561 CTATCAAAGA AAATAATATG AATTATATCT GGTGTATGTT TTAGAAAGAA TTTGTTTTAT 15013 .......... .......... .......... .......... .......... .......... 561 GAAATAAGAA AATATAAATC AAATAATAAT AATAATATAA TAATCAAGAA AAGAGAAAAA 14953 .......... .......... .......... .......... .......... .......... 561 TATTTCTTTT TAATACATTC CTAATTCTTA TTCACTTTTT CCTTTTGTAG TTGTCCTTAA 14893 || | | || .......... .......... .......... .......... .......... TTCTTCCTAC 571 TTACTTCCCG TAGCTCATGG TCGTGGGTCA AGAGCCAACT TAGGAGCTAC AGACCATGAA 14833 || TT........ .......... .......... .......... .......... .......... 573 CCTACGGACA TGCAGGACTG TCAGTAGGTC GTTCTAAGGC AAAATGTTAT AATGTAGGTG 14773 .......... .......... .......... .......... .......... .......... 573 TCTTAAACTA GGCTTCGTTT CAATTCGCAG TTTTCAATAA CTTTTTTAAA ATATTAAATT 14713 || ||||| ||| .......... .......... .......... .......... ........AA ATATT--ATT 583 TTTATTTTAT CTACTTTATA 14693 |||||||| | | |||||| ATTATTTTA- CGA-TTTATA 601 hqPGS_C01HBa0088L02.1-_SGN-E377133+ (16851 16311,14902 14891,14724 14693) ******************************************************************************** EST sequence 17 -strand 673 n (File: SGN-E550140-) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTACTCN 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATGTTATCAA CCATGAATTA ACAAAAAATT AGACCAAAAA 661 TATAAAAAAT TAC Predicted gene structure (within gDNA segment 17771 to 11670): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.804 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16039 ( 66 n); cDNA 568 632 ( 65 n); score: 0.561 Intron 2 16038 15015 (1024 n); Pd: 0.000 (s: 0.60), Pa: 0.000 (s: 0.71) Exon 3 15014 14974 ( 41 n); cDNA 633 672 ( 40 n); score: 0.707 MATCH C01HBa0088L02.1- SGN-E550140- 0.778 660 0.981 C PGS_C01HBa0088L02.1-_SGN-E550140- (16856 16304,16104 16039,15014 14974) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| |||||||| TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTACT 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| CNAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGAAA AAAAACACTG 16038 | | | | || | | ||||| || || | ||||||| || ||||| | || AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGATG TTATCAACC. 632 CAATTGCAGT TTGATGAGTA GCTTAGATGG TTGGGCAGCC CAACAATCAT TTTGTCATGG 15978 .......... .......... .......... .......... .......... .......... 632 ACTCAATGAA AAGAGAATGA TCACGCAAGT ATATCTCAAT GAGTAAATAG TAAAGTTAAT 15918 .......... .......... .......... .......... .......... .......... 632 AGATACAATA CCTGCTAATT TCGAAAGATG GTTGTTGAAC GACTCTACTG CATATGTAGA 15858 .......... .......... .......... .......... .......... .......... 632 CCTCAGGCCA ACCAATTGCA CAAGTTTGTA TTTGACACAG ATGACATATG ACAAATATAT 15798 .......... .......... .......... .......... .......... .......... 632 TACATAATAG AAGTTCAATA TAAGTAGGTC CGTTTCAATT GAGGCTTAGA CATAACCTAA 15738 .......... .......... .......... .......... .......... .......... 632 GGAATTAGAG AAATATATGT TATTTTAGTG GAATAATTCT TGTCCCAATT AATTTGGAGA 15678 .......... .......... .......... .......... .......... .......... 632 TGAAGATTTT TACCAGAATA ATAAAAGAAA ACAAAGGACA ACGAACTACA AAAATGTATA 15618 .......... .......... .......... .......... .......... .......... 632 TGTATAATAT CAGTTATATA CAATTATATA CATATGCAAT TCACCTCTCT CCCACTCTCA 15558 .......... .......... .......... .......... .......... .......... 632 GCGCTCTTTG CTCGCCTCTC TGTTCCCTCT CTCAATCTCG CTTGCCATTT ATAAAAATGT 15498 .......... .......... .......... .......... .......... .......... 632 ATATGTATAA TATCAATTAT ATACAATTAT ATACATATGC AATTCACCGC TCTTCCACTC 15438 .......... .......... .......... .......... .......... .......... 632 TCTGCCCTCT CTCGCACGCG TCTCTTGATC TCGCTCGCCT CTCTCCTCTC TCTCCCAGTC 15378 .......... .......... .......... .......... .......... .......... 632 TCGACTGCCT CTCTCCTCCC TCTCCCAATC TCTTGCCATA TATACAATTA CATATGTATG 15318 .......... .......... .......... .......... .......... .......... 632 ATATACAATT ATCTAACCAG AATACATATA CAATTTACCT TTCCCCCTCT CTCGCCTCTC 15258 .......... .......... .......... .......... .......... .......... 632 TCCTCTCTCT CCCAGTCTCG CTCGCCGCTC TTCTCCATAT AACATGTAGT TACAAATTGT 15198 .......... .......... .......... .......... .......... .......... 632 AATTATCAAG TCATAGCTAT ATGTGAAAGT TTCCCATTAA ATATAGATAC AATTAATAAT 15138 .......... .......... .......... .......... .......... .......... 632 TTTATATTAT GATTTTATTT GCACAAAAAT CAACAATGCA GATAAAATAA TTTTATATTA 15078 .......... .......... .......... .......... .......... .......... 632 AACGACTATC AAAGAAAATA ATATGAATTA TATCTGGTGT ATGTTTTAGA AAGAATTTGT 15018 .......... .......... .......... .......... .......... .......... 632 TTTATGAAAT AAGAAAATAT AAATCAAATA ATAATAATAA TATA 14974 ||||| | || |||| || | | || | || |||| || || ...ATGAATT AACAAAAAAT TAGACCAAAA AT-ATAAAAA ATTA 672 hqPGS_C01HBa0088L02.1-_SGN-E550140- (16856 16304,16104 16039,15014 14974) ******************************************************************************** EST sequence 132 +strand 710 n (File: SGN-E550065+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATGA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTGATTCAT AAGAAAAAAA Predicted gene structure (within gDNA segment 17761 to 11890): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.807 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 568 621 ( 54 n); score: 0.618 MATCH C01HBa0088L02.1- SGN-E550065+ 0.790 608 0.856 C PGS_C01HBa0088L02.1-_SGN-E550065+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E550065+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 138 +strand 709 n (File: SGN-E550207+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTNCA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAA Predicted gene structure (within gDNA segment 17761 to 11900): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.807 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 568 621 ( 54 n); score: 0.618 PPA cDNA 699 709 MATCH C01HBa0088L02.1- SGN-E550207+ 0.790 608 0.858 C PGS_C01HBa0088L02.1-_SGN-E550207+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E550207+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 140 +strand 715 n (File: SGN-E550335+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAATCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTCNAC CATGAATTAA TGAAAAAATT ATGCCATAAA 661 ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA AAAAA Predicted gene structure (within gDNA segment 18317 to 11830): Exon 1 16856 16304 ( 553 n); cDNA 2 566 ( 565 n); score: 0.806 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 567 620 ( 54 n); score: 0.618 PPA cDNA 698 715 MATCH C01HBa0088L02.1- SGN-E550335+ 0.789 608 0.850 C PGS_C01HBa0088L02.1-_SGN-E550335+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| ||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAA- CCCTCCTTCT 58 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 117 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 177 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 237 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 297 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C----AA--- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | || | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAATCT GTGACGGTCC GTCACGCCCG 356 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 415 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 475 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 535 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 566 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 566 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 566 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 573 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 620 hqPGS_C01HBa0088L02.1-_SGN-E550335+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 150 +strand 714 n (File: SGN-E390013+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACNAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAA Predicted gene structure (within gDNA segment 17761 to 11850): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.807 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 568 621 ( 54 n); score: 0.600 PPA cDNA 699 714 MATCH C01HBa0088L02.1- SGN-E390013+ 0.789 608 0.852 C PGS_C01HBa0088L02.1-_SGN-E390013+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || |||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACNAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E390013+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 156 +strand 717 n (File: SGN-E550484+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAAAAA Predicted gene structure (within gDNA segment 17761 to 11820): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.807 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 568 621 ( 54 n); score: 0.618 PPA cDNA 699 717 MATCH C01HBa0088L02.1- SGN-E550484+ 0.790 608 0.848 C PGS_C01HBa0088L02.1-_SGN-E550484+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E550484+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 158 +strand 713 n (File: SGN-E550211+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT ATGCCATAAA 661 ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA AAA Predicted gene structure (within gDNA segment 18317 to 11850): Exon 1 16856 16304 ( 553 n); cDNA 2 566 ( 565 n); score: 0.806 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 567 620 ( 54 n); score: 0.618 PPA cDNA 698 713 MATCH C01HBa0088L02.1- SGN-E550211+ 0.789 608 0.853 C PGS_C01HBa0088L02.1-_SGN-E550211+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| ||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAA- CCCTCCTTCT 58 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 117 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 177 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 237 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 297 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 356 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 415 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 475 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 535 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 566 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 566 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 566 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 573 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 620 hqPGS_C01HBa0088L02.1-_SGN-E550211+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 160 +strand 713 n (File: SGN-E550464+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GNTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCTA CCATGAATTA ATGAAAAATT ATGCCATAAG 661 ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA AAA Predicted gene structure (within gDNA segment 17761 to 11860): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.806 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.88), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 568 621 ( 54 n); score: 0.618 PPA cDNA 698 713 MATCH C01HBa0088L02.1- SGN-E550464+ 0.789 608 0.853 C PGS_C01HBa0088L02.1-_SGN-E550464+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||| ||| ||||| |||| || CGACTAAACA GGTCGNTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E550464+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 162 +strand 713 n (File: SGN-E549941+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA TATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCGA CCNATGATTA ATGAAAAATT ATGCCATCAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAA Predicted gene structure (within gDNA segment 17761 to 11860): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.806 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.88), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 568 621 ( 54 n); score: 0.618 PPA cDNA 699 713 MATCH C01HBa0088L02.1- SGN-E549941+ 0.789 608 0.853 C PGS_C01HBa0088L02.1-_SGN-E549941+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||| ||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAATATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E549941+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 164 +strand 714 n (File: SGN-E550025+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAA Predicted gene structure (within gDNA segment 17761 to 11850): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.807 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 568 621 ( 54 n); score: 0.618 PPA cDNA 699 714 MATCH C01HBa0088L02.1- SGN-E550025+ 0.790 608 0.852 C PGS_C01HBa0088L02.1-_SGN-E550025+ (16856 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGA 16050 | | | | || | | ||||| || || | ||||||| || ||||| AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E550025+ (16856 16304,16104 16050) ******************************************************************************** EST sequence 134 +strand 726 n (File: SGN-E550322+) 1 TCGCACCAGA TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC 61 CTCCTTCTTT TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT 121 AATTTACTCA AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA 181 CTAACTTTAT AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC 241 CGACCCAGAC TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT 301 GCAGGTCGTC GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA 361 CGCCCGTGAC GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC 421 CCAATTTCAG AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT 481 GACGGTCCGT CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT 541 CAAAACGACT AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT 601 TACGATTTAT AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT 661 ATGCCATAAA ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA 721 AAAAAC Predicted gene structure (within gDNA segment 17851 to 11820): Exon 1 16845 16304 ( 542 n); cDNA 21 576 ( 556 n); score: 0.813 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 577 630 ( 54 n); score: 0.618 PPA cDNA 708 725 MATCH C01HBa0088L02.1- SGN-E550322+ 0.795 597 0.822 C PGS_C01HBa0088L02.1-_SGN-E550322+ (16845 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TTCTGTCTCT CTTTGTTCTT TCTATTTTTC TTATTCAAAC CCTCTTTCTT TTACCCTAAT 16786 |||| ||||| | ||||||| | | |||||| |||||||||| |||| ||||| |||||||||| TTCTCTCTCT TTCTGTTCTT T-TCTTTTTC TTATTCAAAC CCTCCTTCTT TTACCCTAAT 79 TAACATATAA TCAAGTGTAA AAGATGGCAA TAATAACCCA CTAATTAACT TAAGGTTACC 16726 || ||||||| | ||| ||| ||||||| || |||||||||| |||||| ||| ||||||||| TAGCATATAA TTAAGAATAA AAGATGG-AA TAATAACCCA CTAATTTACT CAAGGTTACC 138 TCTTTTAACC CCCAAGTAAT TAGACTTATT AACATTAACC CCCTAACTTT ATAATTTAAG 16666 |||||||||| |||| ||||| |||||||||| ||||| |||| | |||||||| |||||| ||| TCTTTTAACC CCCAGGTAAT TAGACTTATT AACATAAACC CACTAACTTT ATAATTAAAG 198 CAGGAATAGT CAAAAACGTC CCTTAAAACG TATAAAGAAA TCCGACCCGG ACTGGGATTG 16606 ||||||||| | |||||||| |||||||||| | |||||||| |||||||| | ||||||||| TAGGAATAGT CCAAAACGTC CCTTAAAACG TGTAAAGAAA TCCGACCCAG ACTGGGATTA 258 CGCAACCTGT GATGGGCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAAGTT 16546 |||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| |||||| ||| CGCAACCTGT GATGGCCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAGGTT 318 CAGAGACCCA AATTTCCACC --A-A----- -G--GGT-C- T-------GT GACGGTCCGT 16506 ||||||| | |||||||||| | | | ||| | | || |||||||||| CAGAGACTC- AATTTCCACC AAAGAGTCTG TGACGGTCCG TCACGCCCGT GACGGTCCGT 377 CCTGCCATTT CGTTACGAAG TTCAGAGAGT CGA-TTTCAG CACCCAATTT TTAGATTTTC 16447 | ||||||| |||||||||| |||||||||| ||| ||| || |||||| || | ||| |||| CGTGCCATTC CGTTACGAAG TTCAGAGAGT CGATTTTTAG TACCCAA-TT TCAGAATTTC 436 TAAGTGTTTT GAAACGAGAA CCTGCGACGG TCCGTCGTGC CCATGACGGT CCGTCGTGGG 16387 |||||||||| ||||||||| | |||||| ||| |||||| ||||||||| |||||||||| TAAGTGTTTT GAAACGAGAC TCCTCGACGG TCCATCGTGC TCATGACGGT CCGTCGTGGG 496 GTCCGTCGCC TCAGTCTGTT TTTCCAGAAA TAAAATCTGC TGCTCAAAAC GACTAAACAG 16327 ||||||| | ||| ||||| |||||| ||| |||||||||| | |||||||| |||||||||| TTCCGTCGTC TCAACCTGTT TTTCCAAAAA TAAAATCTGC TACTCAAAAC GACTAAACAG 556 GTCGTTACAA TTTATTGTTA GTTATGTCAA ATTATTGTGG AATGGAGAAG AAGTCAAATA 16267 |||||||| | |||| |||| || GTCGTTAC-A TTTA-TGTT- CTT....... .......... .......... .......... 576 CCATGCCATG CATATAACAA GTTTGGGTGG TTTTACCTAA TTTGCATCAT TAGTAGATCT 16207 .......... .......... .......... .......... .......... .......... 576 ATCAAGTGCA AATAACCATG AAAGTAATAA TTTATGTGCT TTTGTTGTTC ATGATCTTTG 16147 .......... .......... .......... .......... .......... .......... 576 CAATTGAGTT GCTAGAACTA ATAGAGCTTT CTTTCTTTGC AGGGCAATCA TACAATGTTA 16087 | | | | | | ||| .......... .......... .......... .......... ..CCTACTTA AATATTATTA 594 ATTTTTTAGA CAAAATTACT AATATTAGAA AGAAAGA 16050 | ||||| || || | |||||||| | ||||| TTATTTTACG ATTTATAAC- ACTATTAGAA ACAAAGA 630 hqPGS_C01HBa0088L02.1-_SGN-E550322+ (16845 16304,16104 16050) ******************************************************************************** EST sequence 58 -strand 674 n (File: SGN-E396057-) 1 TTTTTTATTC AAACCTTCTT TTTTTTACCC TAATTAGCAT ATAATTAAGA ATAAAAGATG 61 GAATAATAAC CCACTAATTT ACTCAAGGTT ACCTCTTTTA ACCCCCAGGT AATTAGACTT 121 ATTAACATAA ACCCACTAAC TTTATAATTA AAGTAGGAAT AGTCCAAAAC GTCCCTTAAA 181 ACGTGTAAAG AAATCCGACC CAGACTGGGA TTACGCAACC TGTGATGGCC CGTCGTGCCT 241 GCGACGGTCC GTCCTGCAGG TCGTCGCAAG GTTCAGAGAC TCAATTTCCA CCAAAGAGTC 301 TGTGACGGTC CGTCACGCCC GTGACGGTCC GTCGTGCCAT TCCGTTACGA AGTTCAGAGA 361 GTCGATTTTT AGTACCCAAT TTCAGAATTT TTAAGTGTTT TGAAACGAGA CTCCTCGACG 421 GTCCATCGTG CTCATGACGG TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA 481 ATAAAATCTG CTACTCAAAA CGACTAAACA GGTCGTTACA TTTATGTTCT TCCTACTTAA 541 ATATTATTAT TATTTTACGA TTTATAACAC TATTAGAAAC AAAGATTTTC TCAACCATGA 601 ATTAATGAAA AAATTATGCC ATAAAATATA AAAAATTTAC TCATTTTTCA TTGAGCTAAT 661 TCATAAAAAA AAAA Predicted gene structure (within gDNA segment 17977 to 11900): Exon 1 16819 16304 ( 516 n); cDNA 1 531 ( 531 n); score: 0.807 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 532 585 ( 54 n); score: 0.618 PPA cDNA 663 674 MATCH C01HBa0088L02.1- SGN-E396057- 0.789 571 0.847 C PGS_C01HBa0088L02.1-_SGN-E396057- (16819 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TTTCTTATTC AAACCCTCTT TCTTTTACCC TAATTAACAT ATAATCAAGT GTAAAAGATG 16760 ||| |||||| ||||| |||| | |||||||| |||||| ||| ||||| ||| ||||||||| TTTTTTATTC AAACCTTCTT TTTTTTACCC TAATTAGCAT ATAATTAAGA ATAAAAGATG 60 GCAATAATAA CCCACTAATT AACTTAAGGT TACCTCTTTT AACCCCCAAG TAATTAGACT 16700 | |||||||| |||||||||| ||| ||||| |||||||||| |||||||| | |||||||||| G-AATAATAA CCCACTAATT TACTCAAGGT TACCTCTTTT AACCCCCAGG TAATTAGACT 119 TATTAACATT AACCCCCTAA CTTTATAATT TAAGCAGGAA TAGTCAAAAA CGTCCCTTAA 16640 ||||||||| ||||| |||| |||||||||| ||| ||||| ||||| |||| |||||||||| TATTAACATA AACCCACTAA CTTTATAATT AAAGTAGGAA TAGTCCAAAA CGTCCCTTAA 179 AACGTATAAA GAAATCCGAC CCGGACTGGG ATTGCGCAAC CTGTGATGGG CCGTCGTGCC 16580 ||||| |||| |||||||||| || ||||||| ||| |||||| ||||||||| |||||||||| AACGTGTAAA GAAATCCGAC CCAGACTGGG ATTACGCAAC CTGTGATGGC CCGTCGTGCC 239 TGCGACGGTC CGTCCTGCAG GTCGTCGCAA AGTTCAGAGA CCCAAATTTC CACC--A-A- 16524 |||||||||| |||||||||| |||||||||| ||||||||| | | |||||| |||| | | TGCGACGGTC CGTCCTGCAG GTCGTCGCAA GGTTCAGAGA CTC-AATTTC CACCAAAGAG 298 -----G--GG T-C-T----- --GTGACGGT CCGTCCTGCC ATTTCGTTAC GAAGTTCAGA 16480 | || | | | |||||||| ||||| |||| ||| |||||| |||||||||| TCTGTGACGG TCCGTCACGC CCGTGACGGT CCGTCGTGCC ATTCCGTTAC GAAGTTCAGA 358 GAGTCGA-TT TCAGCACCCA ATTTTTAGAT TTTCTAAGTG TTTTGAAACG AGAACCTGCG 16421 ||||||| || | || ||||| | ||| ||| ||| |||||| |||||||||| ||| | || GAGTCGATTT TTAGTACCCA A-TTTCAGAA TTTTTAAGTG TTTTGAAACG AGACTCCTCG 417 ACGGTCCGTC GTGCCCATGA CGGTCCGTCG TGGGGTCCGT CGCCTCAGTC TGTTTTTCCA 16361 ||||||| || |||| ||||| |||||||||| |||| ||||| || |||| | |||||||||| ACGGTCCATC GTGCTCATGA CGGTCCGTCG TGGGTTCCGT CGTCTCAACC TGTTTTTCCA 477 GAAATAAAAT CTGCTGCTCA AAACGACTAA ACAGGTCGTT ACAATTTATT GTTAGTTATG 16301 ||||||||| ||||| |||| |||||||||| |||||||||| || ||||| | ||| || AAAATAAAAT CTGCTACTCA AAACGACTAA ACAGGTCGTT AC-ATTTA-T GTT-CTT... 531 TCAAATTATT GTGGAATGGA GAAGAAGTCA AATACCATGC CATGCATATA ACAAGTTTGG 16241 .......... .......... .......... .......... .......... .......... 531 GTGGTTTTAC CTAATTTGCA TCATTAGTAG ATCTATCAAG TGCAAATAAC CATGAAAGTA 16181 .......... .......... .......... .......... .......... .......... 531 ATAATTTATG TGCTTTTGTT GTTCATGATC TTTGCAATTG AGTTGCTAGA ACTAATAGAG 16121 .......... .......... .......... .......... .......... .......... 531 CTTTCTTTCT TTGCAGGGCA ATCATACAAT GTTAATTTTT TAGACAAAAT TACTAATATT 16061 | | | | | | ||| | ||| || || || | |||| .......... ......CCTA CTTAAATATT ATTATTATTT TACGATTTAT AAC-ACTATT 574 AGAAAGAAAG A 16050 ||||| |||| | AGAAACAAAG A 585 hqPGS_C01HBa0088L02.1-_SGN-E396057- (16819 16304,16104 16050) ******************************************************************************** EST sequence 67 -strand 658 n (File: SGN-E377132-) 1 TTCCTTCTTT TACCCTAATT AGCATATATT TAAGAATAAA AGATGGAATA ATAACCCACT 61 AATTTACTCA AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA 121 CTAACTTTAT AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC 181 CGACCCAGAC TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT 241 GCAGGTCGTC GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA 301 CGCCCGTGAC GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC 361 CCAATTTCAG AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT 421 GACGGTCCGT CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT 481 CAAAACGACT AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT 541 TACGATTTAT AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT 601 ATGCCATAAA ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAA Predicted gene structure (within gDNA segment 17827 to 11910): Exon 1 16803 16304 ( 500 n); cDNA 2 516 ( 515 n); score: 0.805 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 517 570 ( 54 n); score: 0.618 PPA cDNA 648 658 MATCH C01HBa0088L02.1- SGN-E377132- 0.786 555 0.843 C PGS_C01HBa0088L02.1-_SGN-E377132- (16803 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TCTTTCTTTT ACCCTAATTA ACATATAATC AAGTGTAAAA GATGGCAATA ATAACCCACT 16744 || ||||||| |||||||||| |||||| | ||| ||||| ||||| |||| |||||||||| TCCTTCTTTT ACCCTAATTA GCATATATTT AAGAATAAAA GATGG-AATA ATAACCCACT 60 AATTAACTTA AGGTTACCTC TTTTAACCCC CAAGTAATTA GACTTATTAA CATTAACCCC 16684 |||| ||| | |||||||||| |||||||||| || ||||||| |||||||||| ||| ||||| AATTTACTCA AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA 120 CTAACTTTAT AATTTAAGCA GGAATAGTCA AAAACGTCCC TTAAAACGTA TAAAGAAATC 16624 |||||||||| |||| ||| | ||||||||| |||||||||| ||||||||| |||||||||| CTAACTTTAT AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC 180 CGACCCGGAC TGGGATTGCG CAACCTGTGA TGGGCCGTCG TGCCTGCGAC GGTCCGTCCT 16564 |||||| ||| ||||||| || |||||||||| ||| |||||| |||||||||| |||||||||| CGACCCAGAC TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT 240 GCAGGTCGTC GCAAAGTTCA GAGACCCAAA TTTCCACC-- A-A------G --GGT-C-T- 16518 |||||||||| |||| ||||| ||||| | || |||||||| | | | ||| | | GCAGGTCGTC GCAAGGTTCA GAGACTC-AA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC 299 ------GTGA CGGTCCGTCC TGCCATTTCG TTACGAAGTT CAGAGAGTCG A-TTTCAGCA 16465 |||| ||||||||| ||||||| || |||||||||| |||||||||| | ||| || | ACGCCCGTGA CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA 359 CCCAATTTTT AGATTTTCTA AGTGTTTTGA AACGAGAACC TGCGACGGTC CGTCGTGCCC 16405 ||||| ||| ||| |||||| |||||||||| ||||||| | |||||||| | |||||| | CCCAA-TTTC AGAATTTCTA AGTGTTTTGA AACGAGACTC CTCGACGGTC CATCGTGCTC 418 ATGACGGTCC GTCGTGGGGT CCGTCGCCTC AGTCTGTTTT TCCAGAAATA AAATCTGCTG 16345 |||||||||| |||||||| | |||||| ||| | ||||||| |||| ||||| ||||||||| ATGACGGTCC GTCGTGGGTT CCGTCGTCTC AACCTGTTTT TCCAAAAATA AAATCTGCTA 478 CTCAAAACGA CTAAACAGGT CGTTACAATT TATTGTTAGT TATGTCAAAT TATTGTGGAA 16285 |||||||||| |||||||||| |||||| ||| || |||| | | CTCAAAACGA CTAAACAGGT CGTTAC-ATT TA-TGTT-CT T......... .......... 516 TGGAGAAGAA GTCAAATACC ATGCCATGCA TATAACAAGT TTGGGTGGTT TTACCTAATT 16225 .......... .......... .......... .......... .......... .......... 516 TGCATCATTA GTAGATCTAT CAAGTGCAAA TAACCATGAA AGTAATAATT TATGTGCTTT 16165 .......... .......... .......... .......... .......... .......... 516 TGTTGTTCAT GATCTTTGCA ATTGAGTTGC TAGAACTAAT AGAGCTTTCT TTCTTTGCAG 16105 .......... .......... .......... .......... .......... .......... 516 GGCAATCATA CAATGTTAAT TTTTTAGACA AAATTACTAA TATTAGAAAG AAAGA 16050 | | | | | | ||| | ||||| || || | ||||||||| ||||| CCTACTTAAA TATTATTATT ATTTTACGAT TTATAAC-AC TATTAGAAAC AAAGA 570 hqPGS_C01HBa0088L02.1-_SGN-E377132- (16803 16304,16104 16050) ******************************************************************************** EST sequence 56 -strand 647 n (File: SGN-E396055-) 1 ATTAGCATAT AATTAAGAAT AAAAAGATGG AAATAATAAC CCACTAATTT ACTCAAGGGT 61 TCCTTTTTTT AACCCCCAGG GTAATTAGAC TTATTAACAT AAACCCCACT AACTTTATAA 121 TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 181 GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 241 AAGGTTCAGA GACTCAATTT CCACCAAAGA GTCTGTGACG GTCCGTCACG CCCGTGACGG 301 TCCGTCGTGC CATTCCGTTA CGAAGTTCAG AGAGTCGATT TTTAGTACCC AATTTCAGAA 361 TTTCTAAGTG TTTTGAAACG AGACTCCTCG ACGGTCCATC GTGCTCATGA CGGTCCGTCG 421 TGGGTTCCGT CGTCTCAACC TGTTTTTCCA AAAATAAAAT CTGCTACTCA AAACGACTAA 481 ACAGGTCGTT ACATTTATGT TCTTCCTACT TAAATATTAT TATTATTTTA CGATTTATAA 541 CACTATTAGA AACAAAGATT TTCTCAACCA TGAATTAATG AAAAAATTAT GCCATAAAAT 601 ATAAAAAATT TACTCATTTT TCATTGAGCT AATTCATAAA AAAAAAA Predicted gene structure (within gDNA segment 18643 to 11900): Exon 1 16787 16304 ( 484 n); cDNA 1 504 ( 504 n); score: 0.778 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 505 558 ( 54 n); score: 0.618 PPA cDNA 636 647 MATCH C01HBa0088L02.1- SGN-E396055- 0.762 539 0.833 C PGS_C01HBa0088L02.1-_SGN-E396055- (16787 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): ATTAACATAT AATCAAGTGT -AAAAGATGG CAATAATAAC CCACTAATTA ACTTAA-GGT 16730 |||| ||||| ||| ||| | ||||||||| ||||||||| ||||||||| ||| || ||| ATTAGCATAT AATTAAGAAT AAAAAGATGG AAATAATAAC CCACTAATTT ACTCAAGGGT 60 TACCTCTTTT AACCCCCA-A GTAATTAGAC TTATTAACAT TAACCCC-CT AACTTTATAA 16672 | | | |||| |||||||| |||||||||| |||||||||| |||||| || |||||||||| TCCTTTTTTT AACCCCCAGG GTAATTAGAC TTATTAACAT AAACCCCACT AACTTTATAA 120 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 16612 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 180 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 16552 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 240 AAAGTTCAGA GACCCAAATT TCCACC--A- A------G-- GGT-C-T--- ----GTGACG 16512 || ||||||| ||| | |||| |||||| | | | ||| | | |||||| AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC GCCCGTGACG 299 GTCCGTCCTG CCATTTCGTT ACGAAGTTCA GAGAGTCGA- TTTCAGCACC CAATTTTTAG 16453 ||||||| || ||||| |||| |||||||||| ||||||||| ||| || ||| ||| ||| || GTCCGTCGTG CCATTCCGTT ACGAAGTTCA GAGAGTCGAT TTTTAGTACC CAA-TTTCAG 358 ATTTTCTAAG TGTTTTGAAA CGAGAACCTG CGACGGTCCG TCGTGCCCAT GACGGTCCGT 16393 | |||||||| |||||||||| ||||| | ||||||||| |||||| ||| |||||||||| AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 418 CGTGGGGTCC GTCGCCTCAG TCTGTTTTTC CAGAAATAAA ATCTGCTGCT CAAAACGACT 16333 |||||| ||| |||| |||| ||||||||| || ||||||| ||||||| || |||||||||| CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 478 AAACAGGTCG TTACAATTTA TTGTTAGTTA TGTCAAATTA TTGTGGAATG GAGAAGAAGT 16273 |||||||||| |||| ||||| |||| || AAACAGGTCG TTAC-ATTTA -TGTT-CTT. .......... .......... .......... 504 CAAATACCAT GCCATGCATA TAACAAGTTT GGGTGGTTTT ACCTAATTTG CATCATTAGT 16213 .......... .......... .......... .......... .......... .......... 504 AGATCTATCA AGTGCAAATA ACCATGAAAG TAATAATTTA TGTGCTTTTG TTGTTCATGA 16153 .......... .......... .......... .......... .......... .......... 504 TCTTTGCAAT TGAGTTGCTA GAACTAATAG AGCTTTCTTT CTTTGCAGGG CAATCATACA 16093 | | | | | .......... .......... .......... .......... ........CC TACTTAAATA 516 ATGTTAATTT TTTAGACAAA ATTACTAATA TTAGAAAGAA AGA 16050 | ||| | | |||| || || | || ||||||| || ||| TTATTATTAT TTTACGATTT ATAAC-ACTA TTAGAAACAA AGA 558 hqPGS_C01HBa0088L02.1-_SGN-E396055- (16787 16304,16104 16050) ******************************************************************************** EST sequence 54 -strand 640 n (File: SGN-E398551-) 1 TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAA TAATTTACTC AAGGTTACCT 61 CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA TAATTAAAGT 121 AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA CTGGGATTAC 181 GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT CGCAAGGTTC 241 AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA CGGTCCGTCG 301 TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA GAATTTCTAA 361 GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG TCGTGGGTTC 421 CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC TAAACAGGTC 481 GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA TAACACTATT 541 AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA AATATAAAAA 601 ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA Predicted gene structure (within gDNA segment 17844 to 11900): Exon 1 16785 16304 ( 482 n); cDNA 1 497 ( 497 n); score: 0.800 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 498 551 ( 54 n); score: 0.618 PPA cDNA 629 640 MATCH C01HBa0088L02.1- SGN-E398551- 0.781 537 0.839 C PGS_C01HBa0088L02.1-_SGN-E398551- (16785 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): TAACATATAA TCAAGTGTAA AAGATGGCAA TAATAACCCA CTAATTAACT TAAGGTTACC 16726 || ||||||| | ||| ||| ||||||| || |||||||||| ||||| ||| ||||||||| TAGCATATAA TTAAGAATAA AAGATGG-AA TAATAACCCA ATAATTTACT CAAGGTTACC 59 TCTTTTAACC CCCAAGTAAT TAGACTTATT AACATTAACC CCCTAACTTT ATAATTTAAG 16666 |||||||||| |||| ||||| |||||||||| ||||| |||| | |||||||| |||||| ||| TCTTTTAACC CCCAGGTAAT TAGACTTATT AACATAAACC CACTAACTTT ATAATTAAAG 119 CAGGAATAGT CAAAAACGTC CCTTAAAACG TATAAAGAAA TCCGACCCGG ACTGGGATTG 16606 ||||||||| | |||||||| |||||||||| | |||||||| |||||||| | ||||||||| TAGGAATAGT CCAAAACGTC CCTTAAAACG TGTAAAGAAA TCCGACCCAG ACTGGGATTA 179 CGCAACCTGT GATGGGCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAAGTT 16546 |||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| |||||| ||| CGCAACCTGT GATGGCCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAGGTT 239 CAGAGACCCA AATTTCCACC --A-A----- -G--GGT-C- T-------GT GACGGTCCGT 16506 ||||||| | |||||||||| | | | ||| | | || |||||||||| CAGAGACTC- AATTTCCACC AAAGAGTCTG TGACGGTCCG TCACGCCCGT GACGGTCCGT 298 CCTGCCATTT CGTTACGAAG TTCAGAGAGT CGA-TTTCAG CACCCAATTT TTAGATTTTC 16447 | ||||||| |||||||||| |||||||||| ||| ||| || |||||| || | ||| |||| CGTGCCATTC CGTTACGAAG TTCAGAGAGT CGATTTTTAG TACCCAA-TT TCAGAATTTC 357 TAAGTGTTTT GAAACGAGAA CCTGCGACGG TCCGTCGTGC CCATGACGGT CCGTCGTGGG 16387 |||||||||| ||||||||| | |||||| ||| |||||| ||||||||| |||||||||| TAAGTGTTTT GAAACGAGAC TCCTCGACGG TCCATCGTGC TCATGACGGT CCGTCGTGGG 417 GTCCGTCGCC TCAGTCTGTT TTTCCAGAAA TAAAATCTGC TGCTCAAAAC GACTAAACAG 16327 ||||||| | ||| ||||| |||||| ||| |||||||||| | |||||||| |||||||||| TTCCGTCGTC TCAACCTGTT TTTCCAAAAA TAAAATCTGC TACTCAAAAC GACTAAACAG 477 GTCGTTACAA TTTATTGTTA GTTATGTCAA ATTATTGTGG AATGGAGAAG AAGTCAAATA 16267 |||||||| | |||| |||| || GTCGTTAC-A TTTA-TGTT- CTT....... .......... .......... .......... 497 CCATGCCATG CATATAACAA GTTTGGGTGG TTTTACCTAA TTTGCATCAT TAGTAGATCT 16207 .......... .......... .......... .......... .......... .......... 497 ATCAAGTGCA AATAACCATG AAAGTAATAA TTTATGTGCT TTTGTTGTTC ATGATCTTTG 16147 .......... .......... .......... .......... .......... .......... 497 CAATTGAGTT GCTAGAACTA ATAGAGCTTT CTTTCTTTGC AGGGCAATCA TACAATGTTA 16087 | | | | | | ||| .......... .......... .......... .......... ..CCTACTTA AATATTATTA 515 ATTTTTTAGA CAAAATTACT AATATTAGAA AGAAAGA 16050 | ||||| || || | |||||||| | ||||| TTATTTTACG ATTTATAAC- ACTATTAGAA ACAAAGA 551 hqPGS_C01HBa0088L02.1-_SGN-E398551- (16785 16304,16104 16050) ******************************************************************************** EST sequence 52 -strand 630 n (File: SGN-E396038-) 1 TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC AAGGTTACCT CTTTTAACCC 61 CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA TAATTAAAGT AGGAATAGTC 121 CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA CTGGGATTAC GCAACCTGTG 181 ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT CGCAAGGTTC AGAGACTCAA 241 TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA CGGTCCGTCG TGCCATTCCG 301 TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA GAATTTCTAA GTGTTTTGAA 361 ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG TCGTGGGTTC CGTCGTCTCA 421 ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC TAAACAGGTC GTTACATTTA 481 TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA TAACACTATT AGAAACAAAG 541 ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA AATATAAAAA ATTTACTCAT 601 TTTTCATAGA GTTAAATAAT AAAAAAAAAA Predicted gene structure (within gDNA segment 17537 to 11900): Exon 1 16773 16304 ( 470 n); cDNA 3 487 ( 485 n); score: 0.801 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 488 541 ( 54 n); score: 0.618 PPA cDNA 621 630 MATCH C01HBa0088L02.1- SGN-E396038- 0.782 525 0.833 C PGS_C01HBa0088L02.1-_SGN-E396038- (16773 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): AAGTGTAAAA GATGGCAATA ATAACCCACT AATTAACTTA AGGTTACCTC TTTTAACCCC 16714 ||| ||||| ||||| |||| |||||||||| |||| ||| | |||||||||| |||||||||| AAGAATAAAA GATGG-AATA ATAACCCACT AATTTACTCA AGGTTACCTC TTTTAACCCC 61 CAAGTAATTA GACTTATTAA CATTAACCCC CTAACTTTAT AATTTAAGCA GGAATAGTCA 16654 || ||||||| |||||||||| ||| ||||| |||||||||| |||| ||| | ||||||||| CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT AATTAAAGTA GGAATAGTCC 121 AAAACGTCCC TTAAAACGTA TAAAGAAATC CGACCCGGAC TGGGATTGCG CAACCTGTGA 16594 |||||||||| ||||||||| |||||||||| |||||| ||| ||||||| || |||||||||| AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC TGGGATTACG CAACCTGTGA 181 TGGGCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC GCAAAGTTCA GAGACCCAAA 16534 ||| |||||| |||||||||| |||||||||| |||||||||| |||| ||||| ||||| | || TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC GCAAGGTTCA GAGACTC-AA 240 TTTCCACC-- A-A------G --GGT-C-T- ------GTGA CGGTCCGTCC TGCCATTTCG 16494 |||||||| | | | ||| | | |||| ||||||||| ||||||| || TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA CGGTCCGTCG TGCCATTCCG 300 TTACGAAGTT CAGAGAGTCG A-TTTCAGCA CCCAATTTTT AGATTTTCTA AGTGTTTTGA 16435 |||||||||| |||||||||| | ||| || | ||||| ||| ||| |||||| |||||||||| TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAA-TTTC AGAATTTCTA AGTGTTTTGA 359 AACGAGAACC TGCGACGGTC CGTCGTGCCC ATGACGGTCC GTCGTGGGGT CCGTCGCCTC 16375 ||||||| | |||||||| | |||||| | |||||||||| |||||||| | |||||| ||| AACGAGACTC CTCGACGGTC CATCGTGCTC ATGACGGTCC GTCGTGGGTT CCGTCGTCTC 419 AGTCTGTTTT TCCAGAAATA AAATCTGCTG CTCAAAACGA CTAAACAGGT CGTTACAATT 16315 | ||||||| |||| ||||| ||||||||| |||||||||| |||||||||| |||||| ||| AACCTGTTTT TCCAAAAATA AAATCTGCTA CTCAAAACGA CTAAACAGGT CGTTAC-ATT 478 TATTGTTAGT TATGTCAAAT TATTGTGGAA TGGAGAAGAA GTCAAATACC ATGCCATGCA 16255 || |||| | | TA-TGTT-CT T......... .......... .......... .......... .......... 487 TATAACAAGT TTGGGTGGTT TTACCTAATT TGCATCATTA GTAGATCTAT CAAGTGCAAA 16195 .......... .......... .......... .......... .......... .......... 487 TAACCATGAA AGTAATAATT TATGTGCTTT TGTTGTTCAT GATCTTTGCA ATTGAGTTGC 16135 .......... .......... .......... .......... .......... .......... 487 TAGAACTAAT AGAGCTTTCT TTCTTTGCAG GGCAATCATA CAATGTTAAT TTTTTAGACA 16075 | | | | | | ||| | ||||| .......... .......... .......... CCTACTTAAA TATTATTATT ATTTTACGAT 517 AAATTACTAA TATTAGAAAG AAAGA 16050 || || | ||||||||| ||||| TTATAAC-AC TATTAGAAAC AAAGA 541 hqPGS_C01HBa0088L02.1-_SGN-E396038- (16773 16304,16104 16050) ******************************************************************************** EST sequence 60 -strand 525 n (File: SGN-E396069-) 1 AAAGTAGGAA TAGTCCAAAA CGTCCCTTAA AACGTGTAAA GAAATCCGAC CCCCACCGGG 61 ATTACGCAAC CTGTGATGGC CCGTCGTGCC TGCGACGGTC CGTCCTGCAG GTCGTCGCAA 121 GGTTCAGAGA CTCAATTTCC ACCAAAGAGT CTGTGACGGT CCGTCACGCC CGTGACGGTC 181 CGTCGTGCCA TTCCGTTACG AAGTTCAGAG AGTCGATTTT TAGTACCCAA TTTCAGAATT 241 TCTAAGTGTT TTGAAACGAG ACTCCTCGAC GGTCCATCGT GCTCATGACG GTCCGTCGTG 301 GGTTCCGTCG TCTCAACCTG TTTTTCCAAA AATAAAATCT GCTACTCAAA ACGACTAAAC 361 AGGTCGTTAC ATTTATGTTC TTCCTACTTA AATATTATTA TTATTTTACG ATTTATAACA 421 CTATTAGAAA CAAAGATTTT CTCAACCATG AATTAATGAA AAAATTATGC CATAAAATAT 481 AAAAAATTTA CTCATTTTTC ATTGAGCTAA TTCATAAAAA AAAAA Predicted gene structure (within gDNA segment 17423 to 11900): Exon 1 16668 16304 ( 365 n); cDNA 2 382 ( 381 n); score: 0.763 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16050 ( 55 n); cDNA 383 436 ( 54 n); score: 0.618 PPA cDNA 514 525 MATCH C01HBa0088L02.1- SGN-E396069- 0.744 420 0.800 C PGS_C01HBa0088L02.1-_SGN-E396069- (16668 16304,16104 16050) Alignment (genomic DNA sequence = upper lines): AAGCAGGAAT AGTCAAAAAC GTCCCTTAAA ACGTATAAAG AAATCCGACC CGGACTGGGA 16609 ||| |||||| |||| ||||| |||||||||| |||| ||||| |||||||||| | || |||| AAGTAGGAAT AGTCCAAAAC GTCCCTTAAA ACGTGTAAAG AAATCCGACC CCCACCGGGA 61 TTGCGCAACC TGTGATGGGC CGTCGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAA 16549 || ||||||| |||||||| | |||||||||| |||||||||| |||||||||| ||||||||| TTACGCAACC TGTGATGGCC CGTCGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAG 121 GTTCAGAGAC CCAAATTTCC ACC-AAGGGT CTGTGACGGT CCGT-----C C-TG-----C 16501 |||||||||| | ||||||| ||| ||| || |||||||||| |||| | | || | GTTCAGAGAC TC-AATTTCC ACCAAAGAGT CTGTGACGGT CCGTCACGCC CGTGACGGTC 180 CAT--T---- -T-CGTTACG AAGTTCAGAG AGTCGA-TTT CAGCACCCAA TTTTTAGATT 16450 | | | | ||||||| |||||||||| |||||| ||| || |||||| ||| ||| | CGTCGTGCCA TTCCGTTACG AAGTTCAGAG AGTCGATTTT TAGTACCCAA -TTTCAGAAT 239 TTCTAAGTGT TTTGAAACGA GAACCTGCGA CGGTCCGTCG TGCCCATGAC GGTCCGTCGT 16390 |||||||||| |||||||||| || | ||| |||||| ||| ||| |||||| |||||||||| TTCTAAGTGT TTTGAAACGA GACTCCTCGA CGGTCCATCG TGCTCATGAC GGTCCGTCGT 299 GGGGTCCGTC GCCTCAGTCT GTTTTTCCAG AAATAAAATC TGCTGCTCAA AACGACTAAA 16330 ||| |||||| | |||| || ||||||||| |||||||||| |||| ||||| |||||||||| GGGTTCCGTC GTCTCAACCT GTTTTTCCAA AAATAAAATC TGCTACTCAA AACGACTAAA 359 CAGGTCGTTA CAATTTATTG TTAGTTATGT CAAATTATTG TGGAATGGAG AAGAAGTCAA 16270 |||||||||| | ||||| || || || CAGGTCGTTA C-ATTTA-TG TT-CTT.... .......... .......... .......... 382 ATACCATGCC ATGCATATAA CAAGTTTGGG TGGTTTTACC TAATTTGCAT CATTAGTAGA 16210 .......... .......... .......... .......... .......... .......... 382 TCTATCAAGT GCAAATAACC ATGAAAGTAA TAATTTATGT GCTTTTGTTG TTCATGATCT 16150 .......... .......... .......... .......... .......... .......... 382 TTGCAATTGA GTTGCTAGAA CTAATAGAGC TTTCTTTCTT TGCAGGGCAA TCATACAATG 16090 | | | | | | .......... .......... .......... .......... .....CCTAC TTAAATATTA 397 TTAATTTTTT AGACAAAATT ACTAATATTA GAAAGAAAGA 16050 ||| | |||| | || || | ||||| |||| ||||| TTATTATTTT ACGATTTATA AC-ACTATTA GAAACAAAGA 436 hqPGS_C01HBa0088L02.1-_SGN-E396069- (16668 16304,16104 16050) ******************************************************************************** EST sequence 211 +strand 618 n (File: SGN-E396054+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAA Predicted gene structure (within gDNA segment 17761 to 12810): Exon 1 16856 16304 ( 553 n); cDNA 2 567 ( 566 n); score: 0.807 Intron 1 16303 16105 ( 199 n); Pd: 0.000 (s: 0.90), Pa: 0.804 (s: 0.58) Exon 2 16104 16053 ( 52 n); cDNA 568 618 ( 51 n); score: 0.596 MATCH C01HBa0088L02.1- SGN-E396054+ 0.789 605 0.979 C PGS_C01HBa0088L02.1-_SGN-E396054+ (16856 16304,16104 16053) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| |||| || CGACTAAACA GGTCGTTAC- ATTTA-TGTT -CTT...... .......... .......... 567 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 567 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 567 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 | | .......... .......... .......... .......... .......... ...CCTACTT 574 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAA 16053 | | | | || | | ||||| || || | ||||||| || || AAATATTATT ATTATTTTAC GATTTATAAC -ACTATTAGA AACAA 618 hqPGS_C01HBa0088L02.1-_SGN-E396054+ (16856 16304,16104 16053) ******************************************************************************** EST sequence 217 +strand 454 n (File: SGN-E396070+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCGGGGGGGG 421 GAGTTTCTAA TTGTTTTGAA ACTAGACTCC TCGA Predicted gene structure (within gDNA segment 17761 to 14450): Exon 1 16856 16522 ( 335 n); cDNA 2 332 ( 331 n); score: 0.904 Intron 1 16521 16429 ( 93 n); Pd: 0.000 (s: 0.92), Pa: 0.000 (s: 0.85) Exon 2 16428 16389 ( 40 n); cDNA 333 372 ( 40 n); score: 0.850 MATCH C01HBa0088L02.1- SGN-E396070+ 0.904 375 0.826 C PGS_C01HBa0088L02.1-_SGN-E396070+ (16856 16522,16428 16389) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC CAAGGGTCTG TGACGGTCCG TCCTGCCATT 16497 ||||||| || |||||||| | ||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAG..... .......... .......... 332 TCGTTACGAA GTTCAGAGAG TCGATTTCAG CACCCAATTT TTAGATTTTC TAAGTGTTTT 16437 .......... .......... .......... .......... .......... .......... 332 GAAACGAGAA CCTGCGACGG TCCGTCGTGC CCATGACGGT CCGTCGTG 16389 | ||| ||||| |||||| || || ||||||| |||||||| ........AG TCTGTGACGG TCCGTCACGC CCGTGACGGT CCGTCGTG 372 hqPGS_C01HBa0088L02.1-_SGN-E396070+ (16856 16522,16428 16389) ******************************************************************************** EST sequence 222 +strand 472 n (File: SGN-E236652+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GA Predicted gene structure (within gDNA segment 17751 to 14260): Exon 1 16851 16500 ( 352 n); cDNA 5 354 ( 350 n); score: 0.905 Intron 1 16499 16426 ( 74 n); Pd: 0.000 (s: 0.85), Pa: 0.000 (s: 0) Exon 2 16425 16399 ( 27 n); cDNA 355 379 ( 25 n); score: 0.815 MATCH C01HBa0088L02.1- SGN-E236652+ 0.905 379 0.803 C PGS_C01HBa0088L02.1-_SGN-E236652+ (16851 16500,16425 16399) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 16792 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 16732 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 16672 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 16612 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 16552 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC GGTCCGTCCT GCCATTTCGT 16493 || ||||||| ||| | |||| |||||| ||| ||||||||| |||||||| ||| AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC GCC....... 354 TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG ATTTTCTAAG TGTTTTGAAA 16433 .......... .......... .......... .......... .......... .......... 354 CGAGAACCTG CGACGGTCCG TCGTGCCCAT GACG 16399 | | ||||||||| ||||| |||| || .......C-G TGACGGTCCG TCGTG-CCAT TCCG 379 hqPGS_C01HBa0088L02.1-_SGN-E236652+ (16851 16500,16425 16399) ******************************************************************************** EST sequence 215 +strand 610 n (File: SGN-E396058+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTGTTT CCAAAAATAA AATCTGCTAC TCACAACGAC 541 TAAACAGGTC GTTACATTTA GGTTCTTCAT AGTTAACTAT TATTATTATT TTACGATTTA 601 TAACACTATT Predicted gene structure (within gDNA segment 17761 to 12890): Exon 1 16856 16263 ( 594 n); cDNA 2 609 ( 608 n); score: 0.777 MATCH C01HBa0088L02.1- SGN-E396058+ 0.777 594 0.974 C PGS_C01HBa0088L02.1-_SGN-E396058+ (16856 16263) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| |||||| || |||||||||| || |||| || TCCGTCGTGG GTTCCGTCGT CTCAACCTGT GTTTCCAAAA ATAAAATCTG CTACTCACAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| ||||| ||| | || || |||| | | CGACTAAACA GGTCGTTAC- ATTTA-GGTT CTTCATAGTT AACTATTATT ATTATTTTAC 594 GAAGTCAAAT ACCAT 16263 || | || || || GATTTATAAC ACTAT 609 hqPGS_C01HBa0088L02.1-_SGN-E396058+ (16856 16263) ******************************************************************************** EST sequence 24 -strand 681 n (File: SGN-E389553-) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCGTTCC TACTTAAATA TTATTATTAT TTTACGATTT 601 ATAACACTAT TAGAAACAAA GATTTTCTCA ACCATGAATT AATGAAAAAA TTATGGAATA 661 AAATATAAAA AATTACTCAT T Predicted gene structure (within gDNA segment 17771 to 11590): Exon 1 16856 16304 ( 553 n); cDNA 2 568 ( 567 n); score: 0.809 MATCH C01HBa0088L02.1- SGN-E389553- 0.809 553 0.812 C PGS_C01HBa0088L02.1-_SGN-E389553- (16856 16304) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTT 16304 |||||||||| ||||||||| ||||| |||| ||| CGACTAAACA GGTCGTTAC- ATTTA-TGTT CGTT 568 hqPGS_C01HBa0088L02.1-_SGN-E389553- (16856 16304) ******************************************************************************** EST sequence 209 +strand 711 n (File: SGN-E396039+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AAAAACAAAG ATTTTCTCCA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AAATAAAAAA AATTTACTCA TTTTTTCTTG GAGCTAATTC AAAAAAAAAA A Predicted gene structure (within gDNA segment 17761 to 11880): Exon 1 16856 16311 ( 546 n); cDNA 2 562 ( 561 n); score: 0.809 Intron 1 16310 14903 (1408 n); Pd: 0.000 (s: 0.92), Pa: 0.992 (s: 0) Exon 2 14902 14891 ( 12 n); cDNA 563 574 ( 12 n); score: 0.667 Intron 2 14890 13606 (1285 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.64) Exon 3 13605 13560 ( 46 n); cDNA 575 621 ( 47 n); score: 0.641 PPA cDNA 661 672 MATCH C01HBa0088L02.1- SGN-E396039+ 0.809 604 0.850 C PGS_C01HBa0088L02.1-_SGN-E396039+ (16856 16311,14902 14891,13605 13560) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| |||||| CGACTAAACA GGTCGTTAC- ATTTATG... .......... .......... .......... 562 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 562 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 562 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 .......... .......... .......... .......... .......... .......... 562 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGAAA AAAAACACTG 16038 .......... .......... .......... .......... .......... .......... 562 CAATTGCAGT TTGATGAGTA GCTTAGATGG TTGGGCAGCC CAACAATCAT TTTGTCATGG 15978 .......... .......... .......... .......... .......... .......... 562 ACTCAATGAA AAGAGAATGA TCACGCAAGT ATATCTCAAT GAGTAAATAG TAAAGTTAAT 15918 .......... .......... .......... .......... .......... .......... 562 AGATACAATA CCTGCTAATT TCGAAAGATG GTTGTTGAAC GACTCTACTG CATATGTAGA 15858 .......... .......... .......... .......... .......... .......... 562 CCTCAGGCCA ACCAATTGCA CAAGTTTGTA TTTGACACAG ATGACATATG ACAAATATAT 15798 .......... .......... .......... .......... .......... .......... 562 TACATAATAG AAGTTCAATA TAAGTAGGTC CGTTTCAATT GAGGCTTAGA CATAACCTAA 15738 .......... .......... .......... .......... .......... .......... 562 GGAATTAGAG AAATATATGT TATTTTAGTG GAATAATTCT TGTCCCAATT AATTTGGAGA 15678 .......... .......... .......... .......... .......... .......... 562 TGAAGATTTT TACCAGAATA ATAAAAGAAA ACAAAGGACA ACGAACTACA AAAATGTATA 15618 .......... .......... .......... .......... .......... .......... 562 TGTATAATAT CAGTTATATA CAATTATATA CATATGCAAT TCACCTCTCT CCCACTCTCA 15558 .......... .......... .......... .......... .......... .......... 562 GCGCTCTTTG CTCGCCTCTC TGTTCCCTCT CTCAATCTCG CTTGCCATTT ATAAAAATGT 15498 .......... .......... .......... .......... .......... .......... 562 ATATGTATAA TATCAATTAT ATACAATTAT ATACATATGC AATTCACCGC TCTTCCACTC 15438 .......... .......... .......... .......... .......... .......... 562 TCTGCCCTCT CTCGCACGCG TCTCTTGATC TCGCTCGCCT CTCTCCTCTC TCTCCCAGTC 15378 .......... .......... .......... .......... .......... .......... 562 TCGACTGCCT CTCTCCTCCC TCTCCCAATC TCTTGCCATA TATACAATTA CATATGTATG 15318 .......... .......... .......... .......... .......... .......... 562 ATATACAATT ATCTAACCAG AATACATATA CAATTTACCT TTCCCCCTCT CTCGCCTCTC 15258 .......... .......... .......... .......... .......... .......... 562 TCCTCTCTCT CCCAGTCTCG CTCGCCGCTC TTCTCCATAT AACATGTAGT TACAAATTGT 15198 .......... .......... .......... .......... .......... .......... 562 AATTATCAAG TCATAGCTAT ATGTGAAAGT TTCCCATTAA ATATAGATAC AATTAATAAT 15138 .......... .......... .......... .......... .......... .......... 562 TTTATATTAT GATTTTATTT GCACAAAAAT CAACAATGCA GATAAAATAA TTTTATATTA 15078 .......... .......... .......... .......... .......... .......... 562 AACGACTATC AAAGAAAATA ATATGAATTA TATCTGGTGT ATGTTTTAGA AAGAATTTGT 15018 .......... .......... .......... .......... .......... .......... 562 TTTATGAAAT AAGAAAATAT AAATCAAATA ATAATAATAA TATAATAATC AAGAAAAGAG 14958 .......... .......... .......... .......... .......... .......... 562 AAAAATATTT CTTTTTAATA CATTCCTAAT TCTTATTCAC TTTTTCCTTT TGTAGTTGTC 14898 || | .......... .......... .......... .......... .......... .....TTCTT 567 CTTAATTACT TCCCGTAGCT CATGGTCGTG GGTCAAGAGC CAACTTAGGA GCTACAGACC 14838 | || || CCTACTT... .......... .......... .......... .......... .......... 574 ATGAACCTAC GGACATGCAG GACTGTCAGT AGGTCGTTCT AAGGCAAAAT GTTATAATGT 14778 .......... .......... .......... .......... .......... .......... 574 AGGTGTCTTA AACTAGGCTT CGTTTCAATT CGCAGTTTTC AATAACTTTT TTAAAATATT 14718 .......... .......... .......... .......... .......... .......... 574 AAATTTTTAT TTTATCTACT TTATAATTAA TAGGAATTAA ATAATAAACT ACTACGTCAA 14658 .......... .......... .......... .......... .......... .......... 574 TAATTTTTTT CTTAACTTAA TTGATTAGAG ACACAAGGAA CATAAATTTT GATGAGCTGG 14598 .......... .......... .......... .......... .......... .......... 574 ATTGGAGTAT TGTCGGGTAT ACCTTACTGC ACACGCGTTT TGTTGGTTTT GTGTCTATCC 14538 .......... .......... .......... .......... .......... .......... 574 GATTTTTTCG TACATTTTAC TACAATGCTT AATAAACAAT TTTCCGATGC GGAGTATGTT 14478 .......... .......... .......... .......... .......... .......... 574 ATTAACAAGA CTTAAGTCAT ATGGAGCCCC TTTAAGTTGT CTGAATATTT CATTTAAACG 14418 .......... .......... .......... .......... .......... .......... 574 TCTCAACTTA TGTTTGTGCC TATTGGACAA TATATTTGTT CAAAAATTAT TTTTATTAGA 14358 .......... .......... .......... .......... .......... .......... 574 CACAAAATAT TGACATGTCA AAAAACGTGT GCTACACTCT CTAAAAGGGC ATAAAACTAT 14298 .......... .......... .......... .......... .......... .......... 574 TGAAATTATT ACTTTTTTTT TTCTAACTTA TATACTAAAA CTAATGAAAA GGGATAAAAA 14238 .......... .......... .......... .......... .......... .......... 574 GAATTTAACT TTTTTTTTGA AAATGTACTC TTTTTTTCCC CGCCCAAAAT TGCACCCCTG 14178 .......... .......... .......... .......... .......... .......... 574 CACTATTTAT ATTGACCATC TCCATAATTT TTCGTACACA AGTGCACAAC CCACCCCACA 14118 .......... .......... .......... .......... .......... .......... 574 CCCTCCTGCT CACTCTCTGT CTCTCACCCT CTCCGGTTCT TCTTCTTCTT CTAATTTTTT 14058 .......... .......... .......... .......... .......... .......... 574 TGTTGTAGAT GTTATATCTT CAATATTTAG GCAAAAATCG ATTCATTCCG ATGGTAATAA 13998 .......... .......... .......... .......... .......... .......... 574 TATGAATTGG TTTTATCAGG CAAAAGTTTA TTATTATCTA TTATAATTGT GATAAATGAT 13938 .......... .......... .......... .......... .......... .......... 574 TACTAATGAA AAAAAGACAG AGGTAACAAG TAGAAATTTT GATGCTATTA AAGTGAAAGA 13878 .......... .......... .......... .......... .......... .......... 574 TATTGGATAT TTCGCCATTG TTGATCCGTT TATTATATAA AGGAGAAAAG AGTGATTGAT 13818 .......... .......... .......... .......... .......... .......... 574 CTAATGGGGT AGAAAGAAAA GAATTTGAGT TGATTGGCAA CAATGTAACT ATTAAAGTTT 13758 .......... .......... .......... .......... .......... .......... 574 TTTTTTTTTT TTAAAAAAAT TAGTCTAAAT AATTTACCAT TTTTAATTTA TGATGAAGAA 13698 .......... .......... .......... .......... .......... .......... 574 GAAGAAGTAA AAAAGACCAC GCTGAGGGGC CTAAAATTTG ATGGGTACCG TCAACCCTGA 13638 .......... .......... .......... .......... .......... .......... 574 AGGTTTGGGT GGGTGGATTT TTTCGGGATA CAAAATTTTA TTTTACTTTT ATCA-TTAAA 13579 |||| ||| || | |||| | | ||| | .......... .......... .......... ..AAATATTA TTATTATTTT ACGATTTATA 602 ATATATTTTA AAACAGGGA 13560 | | || | ||||| || ACACTATTAA AAACAAAGA 621 hqPGS_C01HBa0088L02.1-_SGN-E396039+ (16856 16311) ******************************************************************************** EST sequence 15 -strand 679 n (File: SGN-E550127-) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTCCT TTTCTTTTTC TTATCAAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTGCACAA CCATGAATTA ATGAAAAAAT TATGACATAA 661 AATATAAAAA ATTACTCAT Predicted gene structure (within gDNA segment 18337 to 12210): Exon 1 16856 16311 ( 546 n); cDNA 2 562 ( 561 n); score: 0.803 Intron 1 16310 14903 (1408 n); Pd: 0.000 (s: 0.92), Pa: 0.992 (s: 0) Exon 2 14902 14890 ( 13 n); cDNA 563 575 ( 13 n); score: 0.692 MATCH C01HBa0088L02.1- SGN-E550127- 0.803 559 0.823 C PGS_C01HBa0088L02.1-_SGN-E550127- (16856 16311,14902 14890) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | ||| || || | ||||| ||||| ||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTCCT TT-TCTTTTT CTTATCAAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | ||||||| |||| |||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| ||||||||| |||||| CGACTAAACA GGTCGTTAC- ATTTATG... .......... .......... .......... 562 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 562 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 562 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 .......... .......... .......... .......... .......... .......... 562 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGAAA AAAAACACTG 16038 .......... .......... .......... .......... .......... .......... 562 CAATTGCAGT TTGATGAGTA GCTTAGATGG TTGGGCAGCC CAACAATCAT TTTGTCATGG 15978 .......... .......... .......... .......... .......... .......... 562 ACTCAATGAA AAGAGAATGA TCACGCAAGT ATATCTCAAT GAGTAAATAG TAAAGTTAAT 15918 .......... .......... .......... .......... .......... .......... 562 AGATACAATA CCTGCTAATT TCGAAAGATG GTTGTTGAAC GACTCTACTG CATATGTAGA 15858 .......... .......... .......... .......... .......... .......... 562 CCTCAGGCCA ACCAATTGCA CAAGTTTGTA TTTGACACAG ATGACATATG ACAAATATAT 15798 .......... .......... .......... .......... .......... .......... 562 TACATAATAG AAGTTCAATA TAAGTAGGTC CGTTTCAATT GAGGCTTAGA CATAACCTAA 15738 .......... .......... .......... .......... .......... .......... 562 GGAATTAGAG AAATATATGT TATTTTAGTG GAATAATTCT TGTCCCAATT AATTTGGAGA 15678 .......... .......... .......... .......... .......... .......... 562 TGAAGATTTT TACCAGAATA ATAAAAGAAA ACAAAGGACA ACGAACTACA AAAATGTATA 15618 .......... .......... .......... .......... .......... .......... 562 TGTATAATAT CAGTTATATA CAATTATATA CATATGCAAT TCACCTCTCT CCCACTCTCA 15558 .......... .......... .......... .......... .......... .......... 562 GCGCTCTTTG CTCGCCTCTC TGTTCCCTCT CTCAATCTCG CTTGCCATTT ATAAAAATGT 15498 .......... .......... .......... .......... .......... .......... 562 ATATGTATAA TATCAATTAT ATACAATTAT ATACATATGC AATTCACCGC TCTTCCACTC 15438 .......... .......... .......... .......... .......... .......... 562 TCTGCCCTCT CTCGCACGCG TCTCTTGATC TCGCTCGCCT CTCTCCTCTC TCTCCCAGTC 15378 .......... .......... .......... .......... .......... .......... 562 TCGACTGCCT CTCTCCTCCC TCTCCCAATC TCTTGCCATA TATACAATTA CATATGTATG 15318 .......... .......... .......... .......... .......... .......... 562 ATATACAATT ATCTAACCAG AATACATATA CAATTTACCT TTCCCCCTCT CTCGCCTCTC 15258 .......... .......... .......... .......... .......... .......... 562 TCCTCTCTCT CCCAGTCTCG CTCGCCGCTC TTCTCCATAT AACATGTAGT TACAAATTGT 15198 .......... .......... .......... .......... .......... .......... 562 AATTATCAAG TCATAGCTAT ATGTGAAAGT TTCCCATTAA ATATAGATAC AATTAATAAT 15138 .......... .......... .......... .......... .......... .......... 562 TTTATATTAT GATTTTATTT GCACAAAAAT CAACAATGCA GATAAAATAA TTTTATATTA 15078 .......... .......... .......... .......... .......... .......... 562 AACGACTATC AAAGAAAATA ATATGAATTA TATCTGGTGT ATGTTTTAGA AAGAATTTGT 15018 .......... .......... .......... .......... .......... .......... 562 TTTATGAAAT AAGAAAATAT AAATCAAATA ATAATAATAA TATAATAATC AAGAAAAGAG 14958 .......... .......... .......... .......... .......... .......... 562 AAAAATATTT CTTTTTAATA CATTCCTAAT TCTTATTCAC TTTTTCCTTT TGTAGTTGTC 14898 || | .......... .......... .......... .......... .......... .....TTCTT 567 CTTAATTA 14890 | || ||| CCTACTTA 575 hqPGS_C01HBa0088L02.1-_SGN-E550127- (16856 16311) ******************************************************************************** EST sequence 197 +strand 649 n (File: SGN-E374999+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CCAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTTCAC CCTGAATTAA TGAAAAAAT Predicted gene structure (within gDNA segment 17751 to 12490): Exon 1 16851 16313 ( 539 n); cDNA 5 559 ( 555 n); score: 0.812 MATCH C01HBa0088L02.1- SGN-E374999+ 0.812 539 0.831 C PGS_C01HBa0088L02.1-_SGN-E374999+ (16851 16313) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 16792 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 16732 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 16672 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 16612 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 16552 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC--A- A------G-- GGT-C-T--- ----GTGACG 16512 || ||||||| ||| | |||| |||||| | | | ||| | | |||||| AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC GCCCGTGACG 361 GTCCGTCCTG CCATTTCGTT ACGAAGTTCA GAGAGTCGA- TTTCAGCACC CAATTTTTAG 16453 ||||||| || ||||| |||| |||||||||| ||||||||| ||| || ||| ||| ||| || GTCCGTCGTG CCATTCCGTT ACGAAGTTCA GAGAGTCGAT TTTTAGTACC CAA-TTTCAG 420 ATTTTCTAAG TGTTTTGAAA CGAGAACCTG CGACGGTCCG TCGTGCCCAT GACGGTCCGT 16393 | |||||||| |||||||||| ||||| | ||||||||| |||||| ||| |||||||||| AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 480 CGTGGGGTCC GTCGCCTCAG TCTGTTTTTC CAGAAATAAA ATCTGCTGCT CAAAACGACT 16333 |||||| ||| |||| |||| ||||||||| || ||||||| ||||||| || | |||||||| CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CCAAACGACT 540 AAACAGGTCG TTACAATTTA 16313 |||||||||| |||| ||||| AAACAGGTCG TTAC-ATTTA 559 hqPGS_C01HBa0088L02.1-_SGN-E374999+ (16851 16313) ******************************************************************************** EST sequence 170 +strand 558 n (File: SGN-E231589+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA TAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTT Predicted gene structure (within gDNA segment 17751 to 13400): Exon 1 16851 16315 ( 537 n); cDNA 5 558 ( 554 n); score: 0.811 MATCH C01HBa0088L02.1- SGN-E231589+ 0.811 537 0.962 C PGS_C01HBa0088L02.1-_SGN-E231589+ (16851 16315) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 16792 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 16732 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 16672 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 16612 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 16552 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC--A- A------G-- GGT-C-T--- ----GTGACG 16512 || ||||| | ||| | |||| |||||| | | | ||| | | |||||| AAGGTTCATA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC GCCCGTGACG 361 GTCCGTCCTG CCATTTCGTT ACGAAGTTCA GAGAGTCGA- TTTCAGCACC CAATTTTTAG 16453 ||||||| || ||||| |||| |||||||||| ||||||||| ||| || ||| ||| ||| || GTCCGTCGTG CCATTCCGTT ACGAAGTTCA GAGAGTCGAT TTTTAGTACC CAA-TTTCAG 420 ATTTTCTAAG TGTTTTGAAA CGAGAACCTG CGACGGTCCG TCGTGCCCAT GACGGTCCGT 16393 | |||||||| |||||||||| ||||| | ||||||||| |||||| ||| |||||||||| AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 480 CGTGGGGTCC GTCGCCTCAG TCTGTTTTTC CAGAAATAAA ATCTGCTGCT CAAAACGACT 16333 |||||| ||| |||| |||| ||||||||| || ||||||| ||||||| || |||||||||| CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 540 AAACAGGTCG TTACAATT 16315 |||||||||| ||||| || AAACAGGTCG TTACATTT 558 hqPGS_C01HBa0088L02.1-_SGN-E231589+ (16851 16315) ******************************************************************************** EST sequence 152 +strand 720 n (File: SGN-E389834+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTA CGTCGACTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAGAACGAC 541 TAAACAGGAC GTTACATTTA TGATCGTCCT ACTTAAATAT CATTATTATT TTACGATTTA 601 TAACACTATT AGAAACGAAG ATTTTCTCGA CCATGAATTA ATGAAAAAAT ATGCCATGAA 661 ATATAAAAAT TTACTCGTTC TTCATTGAGC TATTCGTGAA AAAAAAAAAA AAATCGAGGG Predicted gene structure (within gDNA segment 17761 to 11790): Exon 1 16856 16318 ( 539 n); cDNA 2 556 ( 555 n); score: 0.804 Intron 1 16317 14880 (1438 n); Pd: 0.000 (s: 0.92), Pa: 0.999 (s: 0) Exon 2 14879 14869 ( 11 n); cDNA 557 567 ( 11 n); score: 0.727 Intron 2 14868 13735 (1134 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.64) Exon 3 13734 13682 ( 53 n); cDNA 568 618 ( 51 n); score: 0.642 PPA cDNA 699 714 MATCH C01HBa0088L02.1- SGN-E389834+ 0.790 603 0.837 C PGS_C01HBa0088L02.1-_SGN-E389834+ (16856 16318,14879 14869,13734 13682) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 16797 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 16737 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 16677 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 16617 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 16557 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C--A-A---- --G--GGT-C -T-------G 16517 ||||||| || |||||||| | ||||||||| | | | | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACGCCCG 357 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 16458 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 416 TTTAGATTTT CTAAGTGTTT TGAAACGAGA ACCTGCGACG GTCCGTCGTG CCCATGACGG 16398 || ||| ||| |||||||||| |||||||||| | ||||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 476 TCCGTCGTGG GGTCCGTCGC CTCAGTCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 16338 |||||||||| | | ||||| |||| |||| ||||||| || |||||||||| || |||| || TCCGTCGTGG GTTACGTCGA CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAGAA 536 CGACTAAACA GGTCGTTACA ATTTATTGTT AGTTATGTCA AATTATTGTG GAATGGAGAA 16278 |||||||||| || ||||||| CGACTAAACA GGACGTTACA .......... .......... .......... .......... 556 GAAGTCAAAT ACCATGCCAT GCATATAACA AGTTTGGGTG GTTTTACCTA ATTTGCATCA 16218 .......... .......... .......... .......... .......... .......... 556 TTAGTAGATC TATCAAGTGC AAATAACCAT GAAAGTAATA ATTTATGTGC TTTTGTTGTT 16158 .......... .......... .......... .......... .......... .......... 556 CATGATCTTT GCAATTGAGT TGCTAGAACT AATAGAGCTT TCTTTCTTTG CAGGGCAATC 16098 .......... .......... .......... .......... .......... .......... 556 ATACAATGTT AATTTTTTAG ACAAAATTAC TAATATTAGA AAGAAAGAAA AAAAACACTG 16038 .......... .......... .......... .......... .......... .......... 556 CAATTGCAGT TTGATGAGTA GCTTAGATGG TTGGGCAGCC CAACAATCAT TTTGTCATGG 15978 .......... .......... .......... .......... .......... .......... 556 ACTCAATGAA AAGAGAATGA TCACGCAAGT ATATCTCAAT GAGTAAATAG TAAAGTTAAT 15918 .......... .......... .......... .......... .......... .......... 556 AGATACAATA CCTGCTAATT TCGAAAGATG GTTGTTGAAC GACTCTACTG CATATGTAGA 15858 .......... .......... .......... .......... .......... .......... 556 CCTCAGGCCA ACCAATTGCA CAAGTTTGTA TTTGACACAG ATGACATATG ACAAATATAT 15798 .......... .......... .......... .......... .......... .......... 556 TACATAATAG AAGTTCAATA TAAGTAGGTC CGTTTCAATT GAGGCTTAGA CATAACCTAA 15738 .......... .......... .......... .......... .......... .......... 556 GGAATTAGAG AAATATATGT TATTTTAGTG GAATAATTCT TGTCCCAATT AATTTGGAGA 15678 .......... .......... .......... .......... .......... .......... 556 TGAAGATTTT TACCAGAATA ATAAAAGAAA ACAAAGGACA ACGAACTACA AAAATGTATA 15618 .......... .......... .......... .......... .......... .......... 556 TGTATAATAT CAGTTATATA CAATTATATA CATATGCAAT TCACCTCTCT CCCACTCTCA 15558 .......... .......... .......... .......... .......... .......... 556 GCGCTCTTTG CTCGCCTCTC TGTTCCCTCT CTCAATCTCG CTTGCCATTT ATAAAAATGT 15498 .......... .......... .......... .......... .......... .......... 556 ATATGTATAA TATCAATTAT ATACAATTAT ATACATATGC AATTCACCGC TCTTCCACTC 15438 .......... .......... .......... .......... .......... .......... 556 TCTGCCCTCT CTCGCACGCG TCTCTTGATC TCGCTCGCCT CTCTCCTCTC TCTCCCAGTC 15378 .......... .......... .......... .......... .......... .......... 556 TCGACTGCCT CTCTCCTCCC TCTCCCAATC TCTTGCCATA TATACAATTA CATATGTATG 15318 .......... .......... .......... .......... .......... .......... 556 ATATACAATT ATCTAACCAG AATACATATA CAATTTACCT TTCCCCCTCT CTCGCCTCTC 15258 .......... .......... .......... .......... .......... .......... 556 TCCTCTCTCT CCCAGTCTCG CTCGCCGCTC TTCTCCATAT AACATGTAGT TACAAATTGT 15198 .......... .......... .......... .......... .......... .......... 556 AATTATCAAG TCATAGCTAT ATGTGAAAGT TTCCCATTAA ATATAGATAC AATTAATAAT 15138 .......... .......... .......... .......... .......... .......... 556 TTTATATTAT GATTTTATTT GCACAAAAAT CAACAATGCA GATAAAATAA TTTTATATTA 15078 .......... .......... .......... .......... .......... .......... 556 AACGACTATC AAAGAAAATA ATATGAATTA TATCTGGTGT ATGTTTTAGA AAGAATTTGT 15018 .......... .......... .......... .......... .......... .......... 556 TTTATGAAAT AAGAAAATAT AAATCAAATA ATAATAATAA TATAATAATC AAGAAAAGAG 14958 .......... .......... .......... .......... .......... .......... 556 AAAAATATTT CTTTTTAATA CATTCCTAAT TCTTATTCAC TTTTTCCTTT TGTAGTTGTC 14898 .......... .......... .......... .......... .......... .......... 556 CTTAATTACT TCCCGTAGCT CATGGTCGTG GGTCAAGAGC CAACTTAGGA GCTACAGACC 14838 | ||| |||| .......... ........TT TATGATCGT. .......... .......... .......... 567 ATGAACCTAC GGACATGCAG GACTGTCAGT AGGTCGTTCT AAGGCAAAAT GTTATAATGT 14778 .......... .......... .......... .......... .......... .......... 567 AGGTGTCTTA AACTAGGCTT CGTTTCAATT CGCAGTTTTC AATAACTTTT TTAAAATATT 14718 .......... .......... .......... .......... .......... .......... 567 AAATTTTTAT TTTATCTACT TTATAATTAA TAGGAATTAA ATAATAAACT ACTACGTCAA 14658 .......... .......... .......... .......... .......... .......... 567 TAATTTTTTT CTTAACTTAA TTGATTAGAG ACACAAGGAA CATAAATTTT GATGAGCTGG 14598 .......... .......... .......... .......... .......... .......... 567 ATTGGAGTAT TGTCGGGTAT ACCTTACTGC ACACGCGTTT TGTTGGTTTT GTGTCTATCC 14538 .......... .......... .......... .......... .......... .......... 567 GATTTTTTCG TACATTTTAC TACAATGCTT AATAAACAAT TTTCCGATGC GGAGTATGTT 14478 .......... .......... .......... .......... .......... .......... 567 ATTAACAAGA CTTAAGTCAT ATGGAGCCCC TTTAAGTTGT CTGAATATTT CATTTAAACG 14418 .......... .......... .......... .......... .......... .......... 567 TCTCAACTTA TGTTTGTGCC TATTGGACAA TATATTTGTT CAAAAATTAT TTTTATTAGA 14358 .......... .......... .......... .......... .......... .......... 567 CACAAAATAT TGACATGTCA AAAAACGTGT GCTACACTCT CTAAAAGGGC ATAAAACTAT 14298 .......... .......... .......... .......... .......... .......... 567 TGAAATTATT ACTTTTTTTT TTCTAACTTA TATACTAAAA CTAATGAAAA GGGATAAAAA 14238 .......... .......... .......... .......... .......... .......... 567 GAATTTAACT TTTTTTTTGA AAATGTACTC TTTTTTTCCC CGCCCAAAAT TGCACCCCTG 14178 .......... .......... .......... .......... .......... .......... 567 CACTATTTAT ATTGACCATC TCCATAATTT TTCGTACACA AGTGCACAAC CCACCCCACA 14118 .......... .......... .......... .......... .......... .......... 567 CCCTCCTGCT CACTCTCTGT CTCTCACCCT CTCCGGTTCT TCTTCTTCTT CTAATTTTTT 14058 .......... .......... .......... .......... .......... .......... 567 TGTTGTAGAT GTTATATCTT CAATATTTAG GCAAAAATCG ATTCATTCCG ATGGTAATAA 13998 .......... .......... .......... .......... .......... .......... 567 TATGAATTGG TTTTATCAGG CAAAAGTTTA TTATTATCTA TTATAATTGT GATAAATGAT 13938 .......... .......... .......... .......... .......... .......... 567 TACTAATGAA AAAAAGACAG AGGTAACAAG TAGAAATTTT GATGCTATTA AAGTGAAAGA 13878 .......... .......... .......... .......... .......... .......... 567 TATTGGATAT TTCGCCATTG TTGATCCGTT TATTATATAA AGGAGAAAAG AGTGATTGAT 13818 .......... .......... .......... .......... .......... .......... 567 CTAATGGGGT AGAAAGAAAA GAATTTGAGT TGATTGGCAA CAATGTAACT ATTAAAGTTT 13758 .......... .......... .......... .......... .......... .......... 567 TTTTTTTTTT TTAAAAAAAT TAGTCTAAAT AATTTACCAT TTTTAATTTA TGATGAAGAA 13698 ||| | || || ||| | ||| |||| ||| | || .......... .......... ...CCTACTT AA-ATATCAT TATTATTTTA CGATTTATAA 603 GAAGAAGTAA AAAAGA 13682 | | || ||| || -CACTATTAG AAACGA 618 hqPGS_C01HBa0088L02.1-_SGN-E389834+ (16856 16318) ******************************************************************************** EST sequence 32 -strand 542 n (File: SGN-E252199-) 1 CGACCCAGCC TGGGATTACG CAGTCTGTGA CGGTCCGTCC TGCACGTCCG TCACAGAGTT 61 CAGAGACTAG ATTTTTACCA AGGGTCTGTG ACGGCCCATC ACGCCTGTGA CGGTCCGTCC 121 TGCCATTCCG TCACGAAGTT CAGAGAGTCG ATTTCAGTAC CCAAATTTCA GAATTCTAAG 181 TGTTTTGGAA CGAGACCCCC TCGACGGTCC GTCGTGGGAT CCGTCGTCTC AGTCAGTTTT 241 TCCAGAAATA AAATCTGTTA CTCAAAACGA CTAAACAGGT CGTTACAATA GATACCAATT 301 TACCCATCGT TCGTCCCCGA ACGATCACAA GAAGAAAAAC AAGGGCGAAA AGGAGTACCT 361 GAATCTGTAA ACAGGTATGG GTATCTTTCT CGCATATCAA CTTCCTTCTC CCAAGTGGAT 421 TCTTCAACTG GTCGATTCTT CCATTGAACT TTGATAGATG CAATCTCCCT TGACCTCAAT 481 TTGCGGACTT CTCTATCTAA AATGGCAACA GGCTCCTCCT CATAAGACAA ATTCTCATCA 541 AG Predicted gene structure (within gDNA segment 18205 to 13186): Exon 1 16519 16318 ( 202 n); cDNA 105 287 ( 183 n); score: 0.847 Intron 1 16317 15512 ( 806 n); Pd: 0.000 (s: 0.96), Pa: 0.000 (s: 0) Exon 2 15511 15500 ( 12 n); cDNA 288 299 ( 12 n); score: 0.667 Intron 2 15499 14903 ( 597 n); Pd: 0.810 (s: 0), Pa: 0.992 (s: 0) Exon 3 14902 14877 ( 26 n); cDNA 300 326 ( 27 n); score: 0.519 Intron 3 14876 14359 ( 518 n); Pd: 0.000 (s: 0), Pa: 0.418 (s: 0.59) Exon 4 14358 14313 ( 46 n); cDNA 327 371 ( 45 n); score: 0.587 MATCH C01HBa0088L02.1- SGN-E252199- 0.847 286 0.528 C PGS_C01HBa0088L02.1-_SGN-E252199- (16519 16318,15511 15500,14902 14877,14358 14313) Alignment (genomic DNA sequence = upper lines): CTGTGACGGT CCGTCCTGCC ATTTCGTTAC GAAGTTCAGA GAGTCGATTT CAGCACCCAA 16460 |||||||||| |||||||||| ||| ||| || |||||||||| |||||||||| ||| |||||| CTGTGACGGT CCGTCCTGCC ATTCCGTCAC GAAGTTCAGA GAGTCGATTT CAGTACCCAA 164 TTTTTAGATT TTCTAAGTGT TTTGAAACGA GAACCTGCGA CGGTCCGTCG TGCCCATGAC 16400 ||| ||| |||||||||| |||| ||||| | | | | | || || | | | ATTTCAGA-A TTCTAAGTGT TTTGGAACGA G-A-C--C-- C---CC-TC- -G---A---C 205 GGTCCGTCGT GGGGTCCGTC GCCTCAGTCT GTTTTTCCAG AAATAAAATC TGCTGCTCAA 16340 |||||||||| ||| |||||| | ||||||| |||||||||| |||||||||| || | ||||| GGTCCGTCGT GGGATCCGTC GTCTCAGTCA GTTTTTCCAG AAATAAAATC TGTTACTCAA 265 AACGACTAAA CAGGTCGTTA CAATTTATTG TTAGTTATGT CAAATTATTG TGGAATGGAG 16280 |||||||||| |||||||||| || AACGACTAAA CAGGTCGTTA CA........ .......... .......... .......... 287 AAGAAGTCAA ATACCATGCC ATGCATATAA CAAGTTTGGG TGGTTTTACC TAATTTGCAT 16220 .......... .......... .......... .......... .......... .......... 287 CATTAGTAGA TCTATCAAGT GCAAATAACC ATGAAAGTAA TAATTTATGT GCTTTTGTTG 16160 .......... .......... .......... .......... .......... .......... 287 TTCATGATCT TTGCAATTGA GTTGCTAGAA CTAATAGAGC TTTCTTTCTT TGCAGGGCAA 16100 .......... .......... .......... .......... .......... .......... 287 TCATACAATG TTAATTTTTT AGACAAAATT ACTAATATTA GAAAGAAAGA AAAAAAACAC 16040 .......... .......... .......... .......... .......... .......... 287 TGCAATTGCA GTTTGATGAG TAGCTTAGAT GGTTGGGCAG CCCAACAATC ATTTTGTCAT 15980 .......... .......... .......... .......... .......... .......... 287 GGACTCAATG AAAAGAGAAT GATCACGCAA GTATATCTCA ATGAGTAAAT AGTAAAGTTA 15920 .......... .......... .......... .......... .......... .......... 287 ATAGATACAA TACCTGCTAA TTTCGAAAGA TGGTTGTTGA ACGACTCTAC TGCATATGTA 15860 .......... .......... .......... .......... .......... .......... 287 GACCTCAGGC CAACCAATTG CACAAGTTTG TATTTGACAC AGATGACATA TGACAAATAT 15800 .......... .......... .......... .......... .......... .......... 287 ATTACATAAT AGAAGTTCAA TATAAGTAGG TCCGTTTCAA TTGAGGCTTA GACATAACCT 15740 .......... .......... .......... .......... .......... .......... 287 AAGGAATTAG AGAAATATAT GTTATTTTAG TGGAATAATT CTTGTCCCAA TTAATTTGGA 15680 .......... .......... .......... .......... .......... .......... 287 GATGAAGATT TTTACCAGAA TAATAAAAGA AAACAAAGGA CAACGAACTA CAAAAATGTA 15620 .......... .......... .......... .......... .......... .......... 287 TATGTATAAT ATCAGTTATA TACAATTATA TACATATGCA ATTCACCTCT CTCCCACTCT 15560 .......... .......... .......... .......... .......... .......... 287 CAGCGCTCTT TGCTCGCCTC TCTGTTCCCT CTCTCAATCT CGCTTGCCAT TTATAAAAAT 15500 || ||| ||| .......... .......... .......... .......... ........AT AGATACCAAT 299 GTATATGTAT AATATCAATT ATATACAATT ATATACATAT GCAATTCACC GCTCTTCCAC 15440 .......... .......... .......... .......... .......... .......... 299 TCTCTGCCCT CTCTCGCACG CGTCTCTTGA TCTCGCTCGC CTCTCTCCTC TCTCTCCCAG 15380 .......... .......... .......... .......... .......... .......... 299 TCTCGACTGC CTCTCTCCTC CCTCTCCCAA TCTCTTGCCA TATATACAAT TACATATGTA 15320 .......... .......... .......... .......... .......... .......... 299 TGATATACAA TTATCTAACC AGAATACATA TACAATTTAC CTTTCCCCCT CTCTCGCCTC 15260 .......... .......... .......... .......... .......... .......... 299 TCTCCTCTCT CTCCCAGTCT CGCTCGCCGC TCTTCTCCAT ATAACATGTA GTTACAAATT 15200 .......... .......... .......... .......... .......... .......... 299 GTAATTATCA AGTCATAGCT ATATGTGAAA GTTTCCCATT AAATATAGAT ACAATTAATA 15140 .......... .......... .......... .......... .......... .......... 299 ATTTTATATT ATGATTTTAT TTGCACAAAA ATCAACAATG CAGATAAAAT AATTTTATAT 15080 .......... .......... .......... .......... .......... .......... 299 TAAACGACTA TCAAAGAAAA TAATATGAAT TATATCTGGT GTATGTTTTA GAAAGAATTT 15020 .......... .......... .......... .......... .......... .......... 299 GTTTTATGAA ATAAGAAAAT ATAAATCAAA TAATAATAAT AATATAATAA TCAAGAAAAG 14960 .......... .......... .......... .......... .......... .......... 299 AGAAAAATAT TTCTTTTTAA TACATTCCTA ATTCTTATTC ACTTTTTCCT TTTGTAGTTG 14900 || .......... .......... .......... .......... .......... .......TTA 302 TCCTTAATTA CTTCCCGTA- GCTCATGGTC GTGGGTCAAG AGCCAACTTA GGAGCTACAG 14841 || | || | |||| | | || CCCATCGTTC GTCCCCGAAC GATC...... .......... .......... .......... 326 ACCATGAACC TACGGACATG CAGGACTGTC AGTAGGTCGT TCTAAGGCAA AATGTTATAA 14781 .......... .......... .......... .......... .......... .......... 326 TGTAGGTGTC TTAAACTAGG CTTCGTTTCA ATTCGCAGTT TTCAATAACT TTTTTAAAAT 14721 .......... .......... .......... .......... .......... .......... 326 ATTAAATTTT TATTTTATCT ACTTTATAAT TAATAGGAAT TAAATAATAA ACTACTACGT 14661 .......... .......... .......... .......... .......... .......... 326 CAATAATTTT TTTCTTAACT TAATTGATTA GAGACACAAG GAACATAAAT TTTGATGAGC 14601 .......... .......... .......... .......... .......... .......... 326 TGGATTGGAG TATTGTCGGG TATACCTTAC TGCACACGCG TTTTGTTGGT TTTGTGTCTA 14541 .......... .......... .......... .......... .......... .......... 326 TCCGATTTTT TCGTACATTT TACTACAATG CTTAATAAAC AATTTTCCGA TGCGGAGTAT 14481 .......... .......... .......... .......... .......... .......... 326 GTTATTAACA AGACTTAAGT CATATGGAGC CCCTTTAAGT TGTCTGAATA TTTCATTTAA 14421 .......... .......... .......... .......... .......... .......... 326 ACGTCTCAAC TTATGTTTGT GCCTATTGGA CAATATATTT GTTCAAAAAT TATTTTTATT 14361 .......... .......... .......... .......... .......... .......... 326 AGACACAAAA TATTGACATG TCAAAAAACG TGTGCTACAC TCTCTAAA 14313 ||| | || | ||| | |||| | || | | ||| |||| ..ACA-AGAA GAAAAACAAG GGCGAAAAGG AGTACCTGAA TCTGTAAA 371 hqPGS_C01HBa0088L02.1-_SGN-E252199- (16519 16318) ******************************************************************************** EST sequence 263 +strand 545 n (File: SGN-E241959+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACA Predicted gene structure (within gDNA segment 17751 to 13530): Exon 1 16851 16328 ( 524 n); cDNA 5 545 ( 541 n); score: 0.810 MATCH C01HBa0088L02.1- SGN-E241959+ 0.810 524 0.961 C PGS_C01HBa0088L02.1-_SGN-E241959+ (16851 16328) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 16792 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 16732 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 16672 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 16612 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 16552 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC--A- A------G-- GGT-C-T--- ----GTGACG 16512 || ||||||| ||| | |||| |||||| | | | ||| | | |||||| AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC GCCCGTGACG 361 GTCCGTCCTG CCATTTCGTT ACGAAGTTCA GAGAGTCGA- TTTCAGCACC CAATTTTTAG 16453 ||||||| || ||||| |||| |||||||||| ||||||||| ||| || ||| ||| ||| || GTCCGTCGTG CCATTCCGTT ACGAAGTTCA GAGAGTCGAT TTTTAGTACC CAA-TTTCAG 420 ATTTTCTAAG TGTTTTGAAA CGAGAACCTG CGACGGTCCG TCGTGCCCAT GACGGTCCGT 16393 | |||||||| |||||||||| ||||| | ||||||||| |||||| ||| |||||||||| AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 480 CGTGGGGTCC GTCGCCTCAG TCTGTTTTTC CAGAAATAAA ATCTGCTGCT CAAAACGACT 16333 |||||| ||| |||| |||| ||||||||| || ||||||| ||||||| || |||||||||| CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 540 AAACA 16328 ||||| AAACA 545 hqPGS_C01HBa0088L02.1-_SGN-E241959+ (16851 16328) ******************************************************************************** EST sequence 243 +strand 548 n (File: SGN-E356257+) 1 AAAACACTTA GAAAATCTGA AATTGGGTAC TGAAAATCGA CTCTCTGAAC TTCGTGACGG 61 AATGACAGGA CGGACCATCA CAGGCGTGAC GGACCGTCAT AGATTGTTCA GTGGAAATTG 121 ACTCTCTGAC CCTTGCGACG ACCTGCAGGA CGGACCGTCA CAGTCACGAC GGCCCGTCAC 181 AGGTTGCGCA AATCCCAGGC AGAATCGGAT TTCCTTACAC GTTTTAAGGG ACGTTTTTGG 241 ACTATTCTTT CCTTAATTAT AGATTTCGTG GGTTTATATT AATAACTCAA ATTCTTGGGG 301 TTAAAAGAGG TAACCCTAAG TTAATTAGTG GGGTATTATT GCCATCTTTT ATTCTTAATT 361 ATATGTTAAT TTGGGGTAAA AGAAAGAGGG TTTTGAAACG AGACCCTGCG ATGGTCCGTC 421 GTGCCCATGA CGGTCCGTCG TGGGGTCCGT CGCTTCTGCC AGTTTTTCCA GAAATAAAGT 481 CTGCTGCTCA AAACGACTAA ACGGGTCGTT ACATTATTTG ACTCTATCAC TTTAATTTTC 541 TAGTTAAC Predicted gene structure (within gDNA segment 21138 to 15259): Exon 1 18649 18642 ( 8 n); cDNA 295 302 ( 8 n); score: 0.875 Intron 1 18641 17680 ( 962 n); Pd: 0.742 (s: 0), Pa: 0.000 (s: 0) Exon 2 17679 17667 ( 13 n); cDNA 303 315 ( 13 n); score: 0.692 Intron 2 17666 17535 ( 132 n); Pd: 0.681 (s: 0), Pa: 0.000 (s: 0.68) Exon 3 17534 17469 ( 66 n); cDNA 316 381 ( 66 n); score: 0.591 Intron 3 17468 16663 ( 806 n); Pd: 0.657 (s: 0.56), Pa: 0.876 (s: 0) Exon 4 16662 16658 ( 5 n); cDNA 382 386 ( 5 n); score: 0.600 Intron 4 16657 16445 ( 213 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.94) Exon 5 16444 16329 ( 116 n); cDNA 387 502 ( 116 n); score: 0.931 MATCH C01HBa0088L02.1- SGN-E356257+ 0.808 208 0.380 C PGS_C01HBa0088L02.1-_SGN-E356257+ (18649 18642,17679 17667,17534 17469,16662 16658,16444 16329) Alignment (genomic DNA sequence = upper lines): TTGGGGTGGC AATTCCTCAT TCTGTACTTG TTCAGTTTCC CCTTCCTCAC CCTTTCTTAC 18590 ||||||| TTGGGGTT.. .......... .......... .......... .......... .......... 302 TACTTCTTCA GTCGGTGGAG GAGTCACTTC CCTAGTATCA GATGGGCTAG GTGCTCGTCC 18530 .......... .......... .......... .......... .......... .......... 302 TCTTCCTCTA GAGGACGTCC TCCCATGACC TCTCCCAAGG CCTCTTGCCG TTGTTCTTCC 18470 .......... .......... .......... .......... .......... .......... 302 TCGAGCTACA ACCCCAGTGG CTGGCTCAGA CGCACCCTGT CCTGCCGGTG CTGGTGTTGG 18410 .......... .......... .......... .......... .......... .......... 302 TGTTGGCGTA GTTGTTGCTC TATTTCTAAC CATCTGCGAA AGAGAGTGAA GATGGTCAGA 18350 .......... .......... .......... .......... .......... .......... 302 TACCAATTTG TATCACCTAG ATACCAATTG GATTCAAGTA GTAGCACAAA AGAAAGAATG 18290 .......... .......... .......... .......... .......... .......... 302 AAAGAATGGA ATTTTCCTAA AGTCTTATAG CCTCTCAAAG AAAAGTAAAG GCGTCCCCCT 18230 .......... .......... .......... .......... .......... .......... 302 ACCGTTCCTT AAGACTCTAC TAGACTCGTT TTTGTGTGAT GAGACCAACG AACCTAATGC 18170 .......... .......... .......... .......... .......... .......... 302 TCTGATACCA AGTTTGTCAC GACCCAAATT CGGGCCGCGA CTGGCACCCA CATTTACCCT 18110 .......... .......... .......... .......... .......... .......... 302 TCTATGTGAG CGAACCAACC AATCTAAACC TTAACATTTC AATATAATAT CAGCAGAAAA 18050 .......... .......... .......... .......... .......... .......... 302 TAATGCGGAA GACTTAAACT CGTTTATAAA AAAAACCAAA TCAATAACTA TTATTCCCCA 17990 .......... .......... .......... .......... .......... .......... 302 AAATTTGGAA GTCATCATCA CAAGAACATC TATGATCAAA TTACTAACTA AAAATGCCTA 17930 .......... .......... .......... .......... .......... .......... 302 AGAAGCTAAA AATACATAAG AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA 17870 .......... .......... .......... .......... .......... .......... 302 AGAAGAAGCT CCAGTCCAAG CTAGAAGCAT TAGCTCACCC TGAATTTCCG ATGTAGTAAG 17810 .......... .......... .......... .......... .......... .......... 302 ACTGGCTTGA ATTACTGTTG AGTCGAAGAC GACGGCACGT TTGCTACACT CCACAAATAA 17750 .......... .......... .......... .......... .......... .......... 302 CAAAGAAGAA AACATAAAAG TAGGGGTCAG TACAAAGCAC GGGTACTGAG TAGATATCAT 17690 .......... .......... .......... .......... .......... .......... 302 CGGCCAACTC AAAATAGAAA ACAGTATATA CCAAGTAATA TCATAAACTC AACTATGATA 17630 |||| || | || .......... AAAAGAGGTA ACC....... .......... .......... .......... 315 CTCAACATGT AGCAACAACA AGTACTATAT CATTAACAAT TTCCGTCAAG TTCACACATG 17570 .......... .......... .......... .......... .......... .......... 315 AGGACTCAAG CCTCAATACC ATACTCATTT GGGAATTATG TTCATTAGAT TGAGTA-TAT 17511 || | || ||||| | | ||| ||| .......... .......... .......... .....CTAAG TTAATTAG-T GGGGTATTAT 339 TAACATCTTT TAAGATTCAT TATCT-TTAT TTCTCTTGTG TCGGTACGTG ACACTCCGCT 17452 | ||||||| || || || ||| | ||| || | || TGCCATCTTT TATTCTTAAT TATATGTTAA TT-TGGGGTA AAA....... .......... 381 CCCTTATATT CATTAATCCT CTTGTGTCGG TACGTGACAC TCCGATCCCC TACTACTATG 17392 .......... .......... .......... .......... .......... .......... 381 TGTCGAAACG TGACACTCCG ATCCCCTAAA TTCTACGTGT CGGTTCGTGA CACCCGATCT 17332 .......... .......... .......... .......... .......... .......... 381 CCTAAATCTA CGTGTCGGTT CGTGACACCC GATCCCCTAA TTCTACGTGT CGGTTCGTGA 17272 .......... .......... .......... .......... .......... .......... 381 CACCCGGTCC CCTAATTCTA CGTGTCGGTT CGTAACACCC GATCCCCTAA TCTCATTCTA 17212 .......... .......... .......... .......... .......... .......... 381 TCAATTCATC AAGCCTTCTC CCTTACCAAG GCATCATCAA TCTCATTACT TTAGTTCATC 17152 .......... .......... .......... .......... .......... .......... 381 AAGCCTTATC CCTTACAAAG GCATCATCAT TAAAAAGAGA TTAGGTTTTT ATCAAGATTT 17092 .......... .......... .......... .......... .......... .......... 381 GGGATTCGAT AGCTTCATCA TGCTTAATAT AATCACAATT ATATAATCAC GTTCATGCAA 17032 .......... .......... .......... .......... .......... .......... 381 GCATACAATT AAGCACATAG CAGGGTTTAC AATACTATCA ATACATATCA TTCGCTATTA 16972 .......... .......... .......... .......... .......... .......... 381 AGAGTTTACT ACGAATAGTA TGAAAACCAT AACCTACCTT CACCGAAGAA TTGCGATCAA 16912 .......... .......... .......... .......... .......... .......... 381 CAAGCTATCT TCTCAAAATC CTTGCTATCC TCTTCGTTTC TCTCTCTCTA CTCGTTCTCT 16852 .......... .......... .......... .......... .......... .......... 381 TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 16792 .......... .......... .......... .......... .......... .......... 381 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 16732 .......... .......... .......... .......... .......... .......... 381 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 16672 .......... .......... .......... .......... .......... .......... 381 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 16612 | || .........G AAAG...... .......... .......... .......... .......... 386 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 16552 .......... .......... .......... .......... .......... .......... 386 AAAGTTCAGA GACCCAAATT TCCACCAAGG GTCTGTGACG GTCCGTCCTG CCATTTCGTT 16492 .......... .......... .......... .......... .......... .......... 386 ACGAAGTTCA GAGAGTCGAT TTCAGCACCC AATTTTTAGA TTTTCTAAGT GTTTTGAAAC 16432 || |||||||||| .......... .......... .......... .......... .......AGG GTTTTGAAAC 399 GAGAACCTGC GACGGTCCGT CGTGCCCATG ACGGTCCGTC GTGGGGTCCG TCGCCTCAGT 16372 |||| ||||| || ||||||| |||||||||| |||||||||| |||||||||| |||| || | GAGACCCTGC GATGGTCCGT CGTGCCCATG ACGGTCCGTC GTGGGGTCCG TCGCTTCTGC 459 CTGTTTTTCC AGAAATAAAA TCTGCTGCTC AAAACGACTA AAC 16329 | |||||||| ||||||||| |||||||||| |||||||||| ||| CAGTTTTTCC AGAAATAAAG TCTGCTGCTC AAAACGACTA AAC 502 hqPGS_C01HBa0088L02.1-_SGN-E356257+ (16444 16329) ******************************************************************************** EST sequence 108 -strand 660 n (File: SGN-E349296-) 1 AATATTATCA ATACATATTA TTCGCTATTA AGAGCTTACT ACGAATATCG TAAGAGAAAC 61 CATAACCTAC CTCCACCGAA GATTCGTGAT CAAGCAAGTG ATTTCCCAAG CTTTGTGTTT 121 TTTCCTCTCG TTCGATCCTC TTTCTCGTTC GACTTTCTCT CTCTTTCTCT TGTTCTTTCT 181 ATTTTCTTTA TTCAAACCCT CTTTCTTTTA CCCTAATTAG TATATAATTA AGAATAAAAT 241 ATGGCAATAA TAACCCACTA ATTAACTTAA GGTTACCTCT TTTAACCCCC AAGTAATTAG 301 ACTTATTAAC ATTAACCCAC TAACTTTATA ATTAAAGCAG GAATAGTCAA AAACGTCCCT 361 TAAAACAATT GAGGAATTCC GACTCAGACT GGGATTTACG CAGCCTGTGA CAGCCCGTTG 421 TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC GCAAGGTTCA GAGACTGGAT TTTCACTGAA 481 GACTCTGTGA TGGTCCATCA CGCCTGTGAC GGTCCGTCTT GCCATTCCGT TACGAAGTTC 541 AGAGAGTCGA TTTTCAGTAC CCAATTTCAG ATTTCCTAAG TGTTTTGAAA TGAGACCCTG 601 CGACGGTCCG TCGTGCCCAT GATGGTCCGT CGTGGGGTCC GTCATTTCTG CCAGTTTTTC Predicted gene structure (within gDNA segment 19133 to 15610): Exon 1 17001 16363 ( 639 n); cDNA 1 660 ( 660 n); score: 0.768 MATCH C01HBa0088L02.1- SGN-E349296- 0.768 639 0.968 C PGS_C01HBa0088L02.1-_SGN-E349296- (17001 16363) Alignment (genomic DNA sequence = upper lines): AATACTATCA ATACATATCA TTCGCTATTA AGAGTTTACT ACGAATA--G TATGA-AAAC 16945 |||| ||||| |||||||| | |||||||||| |||| ||||| ||||||| | || || |||| AATATTATCA ATACATATTA TTCGCTATTA AGAGCTTACT ACGAATATCG TAAGAGAAAC 60 CATAACCTAC CTTCACCGAA GAATTGCGAT CAA-CAAGCT ATCTTCTCAA AATCCTTGCT 16886 |||||||||| || ||||||| || | | ||| ||| |||| || ||| ||| | || | CATAACCTAC CTCCACCGAA GATTCGTGAT CAAGCAAGTG AT-TTCCCAA GCTTTGTGTT 119 ATCCTCT-TC GTTTCTCTCT CTCTACTCGT TC-TCTTTCT TTTTCTGTCT CTCTTTGTTC 16828 | || || ||| || || | ||||| || |||||| | ||| | | ||| |||||| TTTTCCTCTC GTTCGATCCT CT-TTCTCGT TCGACTTTCT CTCTCT-T-T CTC-TTGTTC 175 TTTCTATTTT TCTTATTCAA ACCCTCTTTC TTTTACCCTA ATTAACATAT AATCAAGTGT 16768 |||||||||| |||||||| |||||||||| |||||||||| |||| |||| ||| ||| | TTTCTATTTT CTTTATTCAA ACCCTCTTTC TTTTACCCTA ATTAGTATAT AATTAAGAAT 235 AAAAGATGGC AATAATAACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA 16708 |||| ||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAAATATGGC AATAATAACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA 295 ATTAGACTTA TTAACATTAA CCCCCTAACT TTATAATTTA AGCAGGAATA GTCAAAAACG 16648 |||||||||| |||||||||| ||| |||||| |||||||| | |||||||||| |||||||||| ATTAGACTTA TTAACATTAA CCCACTAACT TTATAATTAA AGCAGGAATA GTCAAAAACG 355 TCCCTTAAAA CGTATAAAGA AATCCGACCC GGACTGGGA- TTGCGCAACC TGTGATGGGC 16589 |||||||||| | | | || | |||||| | |||||||| || |||| || ||||| | | TCCCTTAAAA CAATTGAGGA ATTCCGACTC AGACTGGGAT TTACGCAGCC TGTGACAGCC 415 CGTCGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAA GTTCAGAGAC CCAAATTTC- 16530 ||| |||||| |||||||||| |||||||||| ||||||||| |||||||||| | |||| CGTTGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAG GTTCAGAGAC TGGATTTTCA 475 C-----AC-C ----AAGG-- ------GTCT GTGACGGTCC GTCCTGCCAT TTCGTTACGA 16488 | || | | || | || |||||||||| ||| |||||| | |||||||| CTGAAGACTC TGTGATGGTC CATCACGCCT GTGACGGTCC GTCTTGCCAT TCCGTTACGA 535 AGTTCAGAGA GTCGA-TTTC AGCACCCAAT TTTTAGATTT TCTAAGTGTT TTGAAACGAG 16429 |||||||||| ||||| |||| || |||||| ||| |||||| ||||||||| |||||| ||| AGTTCAGAGA GTCGATTTTC AGTACCCAA- TTTCAGATTT CCTAAGTGTT TTGAAATGAG 594 AACCTGCGAC GGTCCGTCGT GCCCATGACG GTCCGTCGTG GGGTCCGTCG CCTCAGTCTG 16369 | |||||||| |||||||||| |||||||| | |||||||||| ||||||||| || | | | ACCCTGCGAC GGTCCGTCGT GCCCATGATG GTCCGTCGTG GGGTCCGTCA TTTCTGCCAG 654 TTTTTC 16363 |||||| TTTTTC 660 hqPGS_C01HBa0088L02.1-_SGN-E349296- (17001 16363) ******************************************************************************** EST sequence 82 -strand 548 n (File: SGN-E356257-) 1 GTTAACTAGA AAATTAAAGT GATAGAGTCA AATAATGTAA CGACCCGTTT AGTCGTTTTG 61 AGCAGCAGAC TTTATTTCTG GAAAAACTGG CAGAAGCGAC GGACCCCACG ACGGACCGTC 121 ATGGGCACGA CGGACCATCG CAGGGTCTCG TTTCAAAACC CTCTTTCTTT TACCCCAAAT 181 TAACATATAA TTAAGAATAA AAGATGGCAA TAATACCCCA CTAATTAACT TAGGGTTACC 241 TCTTTTAACC CCAAGAATTT GAGTTATTAA TATAAACCCA CGAAATCTAT AATTAAGGAA 301 AGAATAGTCC AAAAACGTCC CTTAAAACGT GTAAGGAAAT CCGATTCTGC CTGGGATTTG 361 CGCAACCTGT GACGGGCCGT CGTGACTGTG ACGGTCCGTC CTGCAGGTCG TCGCAAGGGT 421 CAGAGAGTCA ATTTCCACTG AACAATCTAT GACGGTCCGT CACGCCTGTG ATGGTCCGTC 481 CTGTCATTCC GTCACGAAGT TCAGAGAGTC GATTTTCAGT ACCCAATTTC AGATTTTCTA 541 AGTGTTTT Predicted gene structure (within gDNA segment 19348 to 15837): Exon 1 16809 16500 ( 310 n); cDNA 156 466 ( 311 n); score: 0.835 MATCH C01HBa0088L02.1- SGN-E356257- 0.835 310 0.566 C PGS_C01HBa0088L02.1-_SGN-E356257- (16809 16500) Alignment (genomic DNA sequence = upper lines): AAACCCTCTT TCTTTTACC- CTAATTAACA TATAATCAAG TGTAAAAGAT GGCAATAATA 16751 |||||||||| ||||||||| | |||||||| |||||| ||| |||||||| |||||||||| AAACCCTCTT TCTTTTACCC CAAATTAACA TATAATTAAG AATAAAAGAT GGCAATAATA 215 ACCCACTAAT TAACTTAAGG TTACCTCTTT TAACCCCCAA GTAATTAGAC TTATTAACAT 16691 ||||||||| ||||||| || |||||||||| ||| |||||| | |||| || ||||||| || CCCCACTAAT TAACTTAGGG TTACCTCTTT TAA-CCCCAA G-AATTTGAG TTATTAATAT 273 TAACCCCCTA ACTTTATAAT TTAAGCAGGA ATAGT-CAAA AACGTCCCTT AAAACGTATA 16632 ||||| | | | | |||||| | | | | || ||||| |||| |||||||||| ||||||| || AAACCCACGA AATCTATAAT TAAGGAAAGA ATAGTCCAAA AACGTCCCTT AAAACGTGTA 333 AAGAAATCCG ACCCGGACTG GGA-TTGCGC AACCTGTGAT GGGCCGTCGT GCCTGCGACG 16573 | |||||||| | | | ||| ||| |||||| ||||||||| |||||||||| | ||| |||| AGGAAATCCG ATTCTGCCTG GGATTTGCGC AACCTGTGAC GGGCCGTCGT GACTGTGACG 393 GTCCGTCCTG CAGGTCGTCG CAAAGTTCAG AGACCCAAAT TTCCAC-CAA GGGTCTGTGA 16514 |||||||||| |||||||||| ||| | |||| ||| | ||| |||||| || ||| ||| GTCCGTCCTG CAGGTCGTCG CAAGGGTCAG AGAGTC-AAT TTCCACTGAA CAATCTATGA 452 CGGTCCGTCC TGCC 16500 ||||||||| ||| CGGTCCGTCA CGCC 466 hqPGS_C01HBa0088L02.1-_SGN-E356257- (16809 16500) ******************************************************************************** EST sequence 207 +strand 356 n (File: SGN-E396037+) 1 GGGCAGCGGA GCCTCATGTT TTGTTTACCA CTATGCCGCA TCTATATGAT TAACATGATG 61 ATGATGATGA TGACTACCAC GATTCACGAG AAGAAGATGA GGATGAATGG GGTATTGAGA 121 TGGATGTTTT ACTCGAGGTT ACCTCTTTTA ACCCCCAGGT AATTAGACTT ATTAACATAA 181 ACCCACTAAC TTTATAATTA AAGTAGGAAT AGTCCAAAAC GTCCCTTAAA ACGTGTAAAG 241 AAATCCGACC CAGACTGGGA TTACGCAACC TGTGATGGCC CGTCGTGCCT GCGACGGTCC 301 GTCCTGCAGG TCTTCTCTAG GTTCAGAGAC TCTCTTTCCA CCAAAGAGTC TGTGAC Predicted gene structure (within gDNA segment 19283 to 15507): Exon 1 18646 18642 ( 5 n); cDNA 122 126 ( 5 n); score: 0.800 Intron 1 18641 16743 (1899 n); Pd: 0.742 (s: 0), Pa: 0.000 (s: 0.90) Exon 2 16742 16513 ( 230 n); cDNA 127 356 ( 230 n); score: 0.889 MATCH C01HBa0088L02.1- SGN-E396037+ 0.889 235 0.660 C PGS_C01HBa0088L02.1-_SGN-E396037+ (18646 18642,16742 16513) Alignment (genomic DNA sequence = upper lines): GGGTGGCAAT TCCTCATTCT GTACTTGTTC AGTTTCCCCT TCCTCACCCT TTCTTACTAC 18587 || || GGATG..... .......... .......... .......... .......... .......... 126 TTCTTCAGTC GGTGGAGGAG TCACTTCCCT AGTATCAGAT GGGCTAGGTG CTCGTCCTCT 18527 .......... .......... .......... .......... .......... .......... 126 TCCTCTAGAG GACGTCCTCC CATGACCTCT CCCAAGGCCT CTTGCCGTTG TTCTTCCTCG 18467 .......... .......... .......... .......... .......... .......... 126 AGCTACAACC CCAGTGGCTG GCTCAGACGC ACCCTGTCCT GCCGGTGCTG GTGTTGGTGT 18407 .......... .......... .......... .......... .......... .......... 126 TGGCGTAGTT GTTGCTCTAT TTCTAACCAT CTGCGAAAGA GAGTGAAGAT GGTCAGATAC 18347 .......... .......... .......... .......... .......... .......... 126 CAATTTGTAT CACCTAGATA CCAATTGGAT TCAAGTAGTA GCACAAAAGA AAGAATGAAA 18287 .......... .......... .......... .......... .......... .......... 126 GAATGGAATT TTCCTAAAGT CTTATAGCCT CTCAAAGAAA AGTAAAGGCG TCCCCCTACC 18227 .......... .......... .......... .......... .......... .......... 126 GTTCCTTAAG ACTCTACTAG ACTCGTTTTT GTGTGATGAG ACCAACGAAC CTAATGCTCT 18167 .......... .......... .......... .......... .......... .......... 126 GATACCAAGT TTGTCACGAC CCAAATTCGG GCCGCGACTG GCACCCACAT TTACCCTTCT 18107 .......... .......... .......... .......... .......... .......... 126 ATGTGAGCGA ACCAACCAAT CTAAACCTTA ACATTTCAAT ATAATATCAG CAGAAAATAA 18047 .......... .......... .......... .......... .......... .......... 126 TGCGGAAGAC TTAAACTCGT TTATAAAAAA AACCAAATCA ATAACTATTA TTCCCCAAAA 17987 .......... .......... .......... .......... .......... .......... 126 TTTGGAAGTC ATCATCACAA GAACATCTAT GATCAAATTA CTAACTAAAA ATGCCTAAGA 17927 .......... .......... .......... .......... .......... .......... 126 AGCTAAAAAT ACATAAGAAG CTAGTCCATG CCGGAAGTTC AAGGCATCAA GACTTGAAGA 17867 .......... .......... .......... .......... .......... .......... 126 AGAAGCTCCA GTCCAAGCTA GAAGCATTAG CTCACCCTGA ATTTCCGATG TAGTAAGACT 17807 .......... .......... .......... .......... .......... .......... 126 GGCTTGAATT ACTGTTGAGT CGAAGACGAC GGCACGTTTG CTACACTCCA CAAATAACAA 17747 .......... .......... .......... .......... .......... .......... 126 AGAAGAAAAC ATAAAAGTAG GGGTCAGTAC AAAGCACGGG TACTGAGTAG ATATCATCGG 17687 .......... .......... .......... .......... .......... .......... 126 CCAACTCAAA ATAGAAAACA GTATATACCA AGTAATATCA TAAACTCAAC TATGATACTC 17627 .......... .......... .......... .......... .......... .......... 126 AACATGTAGC AACAACAAGT ACTATATCAT TAACAATTTC CGTCAAGTTC ACACATGAGG 17567 .......... .......... .......... .......... .......... .......... 126 ACTCAAGCCT CAATACCATA CTCATTTGGG AATTATGTTC ATTAGATTGA GTATATTAAC 17507 .......... .......... .......... .......... .......... .......... 126 ATCTTTTAAG ATTCATTATC TTTATTTCTC TTGTGTCGGT ACGTGACACT CCGCTCCCTT 17447 .......... .......... .......... .......... .......... .......... 126 ATATTCATTA ATCCTCTTGT GTCGGTACGT GACACTCCGA TCCCCTACTA CTATGTGTCG 17387 .......... .......... .......... .......... .......... .......... 126 AAACGTGACA CTCCGATCCC CTAAATTCTA CGTGTCGGTT CGTGACACCC GATCTCCTAA 17327 .......... .......... .......... .......... .......... .......... 126 ATCTACGTGT CGGTTCGTGA CACCCGATCC CCTAATTCTA CGTGTCGGTT CGTGACACCC 17267 .......... .......... .......... .......... .......... .......... 126 GGTCCCCTAA TTCTACGTGT CGGTTCGTAA CACCCGATCC CCTAATCTCA TTCTATCAAT 17207 .......... .......... .......... .......... .......... .......... 126 TCATCAAGCC TTCTCCCTTA CCAAGGCATC ATCAATCTCA TTACTTTAGT TCATCAAGCC 17147 .......... .......... .......... .......... .......... .......... 126 TTATCCCTTA CAAAGGCATC ATCATTAAAA AGAGATTAGG TTTTTATCAA GATTTGGGAT 17087 .......... .......... .......... .......... .......... .......... 126 TCGATAGCTT CATCATGCTT AATATAATCA CAATTATATA ATCACGTTCA TGCAAGCATA 17027 .......... .......... .......... .......... .......... .......... 126 CAATTAAGCA CATAGCAGGG TTTACAATAC TATCAATACA TATCATTCGC TATTAAGAGT 16967 .......... .......... .......... .......... .......... .......... 126 TTACTACGAA TAGTATGAAA ACCATAACCT ACCTTCACCG AAGAATTGCG ATCAACAAGC 16907 .......... .......... .......... .......... .......... .......... 126 TATCTTCTCA AAATCCTTGC TATCCTCTTC GTTTCTCTCT CTCTACTCGT TCTCTTTCTT 16847 .......... .......... .......... .......... .......... .......... 126 TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT TTTACCCTAA 16787 .......... .......... .......... .......... .......... .......... 126 TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC TTAAGGTTAC 16727 || || | ||||||| .......... .......... .......... .......... ....TTTTAC TCGAGGTTAC 142 CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT TATAATTTAA 16667 |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| ||||||| || CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT TATAATTAAA 202 GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG GACTGGGATT 16607 | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| |||||||||| GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA GACTGGGATT 262 GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC GTCGCAAAGT 16547 ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| || | | || ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC TTCTCTAGGT 322 TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGAC 16513 |||||||| | ||||||| | ||| |||| ||||| TCAGAGACTC -TCTTTCCAC CAAAGAGTCT GTGAC 356 hqPGS_C01HBa0088L02.1-_SGN-E396037+ (16742 16513) ******************************************************************************** EST sequence 186 +strand 686 n (File: SGN-E241789+) 1 ATGTCTGATC TTCAAGGACA TCAAGACATG AATGAGAGAG AATCCAGTCC GAGCTAGGAA 61 CAATAGCTCA CCCTGAAATC TGACGTGATG AAGACTGGTT AGAGTTGCGG TTGAGTTGAA 121 GACGACGGTA CGTTTGCTGC ACTCCACAAT TAACAAAAAG AAAACATAAA AGTAGGGGTC 181 AGTACAAACA CGAGTACTGA GTAGATATCA TCGGCCAACT CAGAATAGAG AACAATATAT 241 ATCAAATAAT AAAATAAAAT CAACCATAAC ACTTAACAGG TGACAACAAC AAGTACCATA 301 ACCATTGGGC ACAACCCAAG AACATCTATG AGGACTCAAG CCTCCACACC ATACTCATTT 361 GGGAAACAGG TTCATTAAAT TGAGTACATT AACATAATTC AAGATTCATT CTTTTTACTA 421 TCGTGGTGTC GGAACGTGAT ACTCCGATCC CCTAATGCTA CGTGTCGGTT CGTGACACCC 481 GATCCCCTAA TACTACGTGT CGGTTCGTTA CACCCGATCT CCTAATACTA CGTGCCGATT 541 CGTGACACCC GATCCATTAA TACTATGTGT CGGTTCGTGA CACCCGATCC ATTAATACTA 601 CGTGTCGGTT CGTGACACCC GATCCCCTAA CCTCATTCTT TTAGTTCATC AAGCCTTCTT 661 TTATACCAAG ACATCATCAT TAACAA Predicted gene structure (within gDNA segment 19914 to 14901): Exon 1 17899 17469 ( 431 n); cDNA 1 431 ( 431 n); score: 0.788 Intron 1 17468 17423 ( 46 n); Pd: 0.657 (s: 0.76), Pa: 0.000 (s: 0.82) Exon 2 17422 17182 ( 241 n); cDNA 432 670 ( 239 n); score: 0.863 Intron 2 17181 17132 ( 50 n); Pd: 0.927 (s: 0.84), Pa: 0.000 (s: 0) Exon 3 17131 17116 ( 16 n); cDNA 671 686 ( 16 n); score: 0.875 MATCH C01HBa0088L02.1- SGN-E241789+ 0.815 688 1.003 C PGS_C01HBa0088L02.1-_SGN-E241789+ (17899 17469,17422 17182,17131 17116) Alignment (genomic DNA sequence = upper lines): ATGCCGGAAG TTCAAGG-CA TCAAGACTTG AAGAAGA-AG -CTCCAGTCC AAGCTAGAAG 17843 ||| | || ||||||| || ||||||| || || ||| || |||||||| |||||| | ATGTCTGATC TTCAAGGACA TCAAGACATG AATGAGAGAG AATCCAGTCC GAGCTAGGAA 60 CATTAGCTCA CCCTGAATTT CCGATGT-AG TAAGACTGGC TTGAATTACT GTTGAGTCGA 17784 || ||||||| ||||||| | | || || | |||||||| | || || | ||||||| || CAATAGCTCA CCCTGAA-AT CTGACGTGAT GAAGACTGGT TAGAGTTGCG GTTGAGTTGA 119 AGACGACGGC ACGTTTGCTA CACTCCACAA ATAACAAAGA AGAAAACATA AAAGTAGGGG 17724 ||||||||| ||||||||| |||||||||| ||||||| | |||||||||| |||||||||| AGACGACGGT ACGTTTGCTG CACTCCACAA TTAACAAA-A AGAAAACATA AAAGTAGGGG 178 TCAGTACAAA GCACGGGTAC TGAGTAGATA TCATCGGCCA ACTCAAAATA GAAAACAGTA 17664 |||||||||| |||| |||| |||||||||| |||||||||| ||||| |||| || |||| || TCAGTACAAA -CACGAGTAC TGAGTAGATA TCATCGGCCA ACTCAGAATA GAGAACAATA 237 TATACCAAGT AATATCATAA ACTCAACTAT GATACTCAAC ATGTAGCAAC AACAAGTACT 17604 |||| ||| | |||| |||| | ||||| || | ||| ||| | || |||| ||||||||| TATATCAAAT AATAAAATAA AATCAACCAT AACACTTAAC AGGTGACAAC AACAAGTACC 297 AT-ATCATTA ACAATTTCCG TCAAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT 17545 || | |||| | || |||| || |||||||| ||||||||| | |||||||| ATAACCATTG GGCACAACC- -CAAGAACAT CTATGAGGAC TCAAGCCTCC ACACCATACT 355 CATTTGGGAA TTATGTTCAT TAGATTGAGT ATATTAACAT CTTTTAAGAT TCATTATCTT 17485 |||||||||| | |||||| || ||||||| | |||||||| || ||||| ||||| | || CATTTGGGAA ACAGGTTCAT TAAATTGAGT ACATTAACAT AATTCAAGAT TCATTCTTTT 415 TATTTCTCTT GTGTCGGTAC GTGACACTCC GCTCCCTTAT ATTCATTAAT CCTCTTGTGT 17425 || | | |||||| TACTATCGTG GTGTCG.... .......... .......... .......... .......... 431 CGGTACGTGA CACTCCGATC CCCTACTACT ATGTGTCGAA ACGTGACACT CCGATCCCCT 17365 | |||||| ||||||||| ||||| | || | |||||| |||||||| |||||||||| ..GAACGTGA TACTCCGATC CCCTAATGCT ACGTGTCGGT TCGTGACAC- CCGATCCCCT 488 AAATTCTACG TGTCGGTTCG TGACACCCGA TCTCCTAAAT CTACGTGTCG GTTCGTGACA 17305 ||| ||||| |||||||||| | |||||||| |||||||| ||||||| || ||||||||| -AATACTACG TGTCGGTTCG TTACACCCGA TCTCCTAATA CTACGTGCCG ATTCGTGACA 547 CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGG TCCCCTAATT CTACGTGTCG 17245 |||||||| |||| ||| | |||||||||| ||||||||| ||| |||| |||||||||| CCCGATCCAT TAATACTATG TGTCGGTTCG TGACACCCGA TCCATTAATA CTACGTGTCG 607 GTTCGTAACA CCCGATCCCC TAATCTCATT CTATCAATTC ATCAAGCCTT CTCCCTTACC 17185 |||||| ||| |||||||||| ||| |||||| || | | ||| |||||||||| || |||| GTTCGTGACA CCCGATCCCC TAACCTCATT CTTTTAGTTC ATCAAGCCTT CTTTTATACC 667 AAGGCATCAT CAATCTCATT ACTTTAGTTC ATCAAGCCTT ATCCCTTACA AAGGCATCAT 17125 ||| |||||| AAG....... .......... .......... .......... .......... ...ACATCAT 677 CATTAAAAA 17116 |||||| || CATTAACAA 686 hqPGS_C01HBa0088L02.1-_SGN-E241789+ (17899 17469,17422 17182) ******************************************************************************** EST sequence 4 -strand 774 n (File: SGN-E349977-) 1 AGTAGATATC ATCGCTAACT CAAAATAGGG AACAATATAT ATCAATAATA ATGTAAATCA 61 ACTACAATAC TCATCATGTA GCAATAGCAA TTTCTTNATC ATTAACAATT ACCGTCAAGT 121 TCACACATGA GGACTCAAGC CTCAATACCA TACTCATTTG GGAATTAAGT TCATTAGATT 181 GAGTATATTC ATTATCTTTC AAGATTCATT ATCTTTCTTC CTCTTGTGTC GGTACGTGAC 241 ACTCCGCTCC TCTATTTCTA TCCTGGTGCC GGAACGTGGC ACTCCGATCC TCATATTCAT 301 TCTATCCTGG TACCGGAACG TGGCACCCGA TCCTCATATT CTATCCTGGT GTCGGAACGT 361 AACACTCCGA TCCTCATATT CATTCTATCC TGGTACCGGA ACGTGGCACC CGATCCTCAT 421 ATTCTATCCT GGTGTCGGAA CGTGACACTC CGATCCTCAT ATTCTATCCT GGTGTCGGAA 481 CGTGACACTC CGATCCTCAT ATTCATTCTA TCCTGGTACC GAAACGTGGC ACCCGATCCC 541 CTAATTCATC AAGCCTTCTT CTACACTAAG GCATCATCAT TCTCATTATA TAATTTATCA 601 AGCCTTCTCT CATACTAAGG CCTCATCAAT CTTATTATAT AATATATCAA GTGAATTAGG 661 GTTCTTTCAA GATTTGGGAT TCAATAGCTT CATCATGCTT TGTTAATTCA TAACAATTTC 721 ATAATCATAA TCATGCAAGC ATACCAATAA GCATATAGAC AGGTTTACAA CATC Predicted gene structure (within gDNA segment 19307 to 15727): Exon 1 17701 17391 ( 311 n); cDNA 1 303 ( 303 n); score: 0.841 Intron 1 17390 17327 ( 64 n); Pd: 0.000 (s: 0.66), Pa: 0.000 (s: 0.67) Exon 2 17326 17283 ( 44 n); cDNA 304 348 ( 45 n); score: 0.670 Intron 2 17282 17251 ( 32 n); Pd: 0.000 (s: 0.67), Pa: 0.000 (s: 0.79) Exon 3 17250 17210 ( 41 n); cDNA 349 389 ( 41 n); score: 0.793 MATCH C01HBa0088L02.1- SGN-E349977- 0.841 396 0.512 C PGS_C01HBa0088L02.1-_SGN-E349977- (17701 17391,17326 17283,17250 17210) Alignment (genomic DNA sequence = upper lines): AGTAGATATC ATCGGCCAAC TCAAAATAGA AAACAGTATA TACCAAGTAA TATCATAAAC 17642 |||||||||| ||| || ||| ||||||||| |||| |||| || ||| ||| || |||| AGTAGATATC ATC-GCTAAC TCAAAATAGG GAACAATATA TATCAA-TAA TAATGTAAA- 57 TCAACTATGA TACTCAACAT GTAGCAACAA CAAGTACTAT ATCATTAACA ATTTCCGTCA 17582 ||||||| | |||||| ||| ||||||| | ||| | || |||||||||| ||| |||||| TCAACTACAA TACTCATCAT GTAGCAATAG CAATTTCTTN ATCATTAACA ATTACCGTCA 117 AGTTCACACA TGAGGACTCA AGCCTCAATA CCATACTCAT TTGGGAATTA TGTTCATTAG 17522 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| AGTTCACACA TGAGGACTCA AGCCTCAATA CCATACTCAT TTGGGAATTA AGTTCATTAG 177 ATTGAGTATA TT-AACATCT TTTAAGATTC ATTATCTTTA TTTCTCTTGT GTCGGTACGT 17463 |||||||||| || | |||| || ||||||| ||||||||| || ||||||| |||||||||| ATTGAGTATA TTCATTATCT TTCAAGATTC ATTATCTTTC TTCCTCTTGT GTCGGTACGT 237 GACACTCCGC TCCCTTATAT TCATTAATCC TCTTGTGTCG GTACGTGACA CTCCGATCCC 17403 |||||||||| ||| ||| | || | || | || ||| || | ||||| || ||||||||| GACACTCCGC TCCTCTAT-T TC--T-AT-C -CTGGTGCCG GAACGTGGCA CTCCGATCCT 291 CTACTACTAT GTGTCGAAAC GTGACACTCC GATCCCCTAA ATTCTACGTG TCGGTTCGTG 17343 | | | | | CATATTCATT CT........ .......... .......... .......... .......... 303 ACACCCGATC TCCTAAATCT ACGTGTCGGT TCGTGACACC CGATCCCCTA ATTCTA-CGT 17284 ||| || ||| |||| |||| |||||| | |||||| | | .......... ......ATCC TGGTACCGGA ACGTGGCACC CGATCCTCAT ATTCTATCCT 347 GTCGGTTCGT GACACCCGGT CCCCTAATTC TACGTGTCGG TTCGTAACAC -CCGATCCCC 17225 | ||||||| |||||||| ||||||| | G......... .......... .......... ...GTGTCGG AACGTAACAC TCCGATCCTC 375 TAATCTCATT CTATC 17210 || ||||| ||||| ATAT-TCATT CTATC 389 hqPGS_C01HBa0088L02.1-_SGN-E349977- (17701 17391,17326 17283,17250 17210) ******************************************************************************** EST sequence 105 -strand 725 n (File: SGN-E546548-) 1 GGTACCGGAA CGTGGCACCC GATCCATATT CTATCCTGGT GTCGGAACGT GACACTCCGA 61 TCCTCATATT CATTCTATCC TGGTACCGGA ACGTGGCACC CGATCCCCTA ATCCATCAAG 121 CCTTCTTTTA CACTAAGGCA TCATCATTCT CATTATATAA TTTATCAAGC CTTCTTTCAT 181 ACTAAGGCAT CATCATTCTC ATTATATAAT ATATCAAGCG AATTAGGGTT CTTTCAAGAT 241 TTGGGATTCA ATTGCTTCAT CATGCTTTGT TAATTCATCG CAATTTCATA ATCATAATCA 301 TGCAAGCATA CAACTTAAGC ACATAGCAGG GTTTACAATA CTATCAACAC ATAATATTCA 361 CTATTAAGAG TTCACTACGA ATATCGTAAC ATAAACCATA ACCTACCTCC ACCGAAGAAT 421 TGAATCAACA AGCTATCTTC TCAAAATCCT TGCTATCCTC TTCGTTTCTC TCTCTCTACT 481 CGTTCGTTTC TCCTCTCTTT CTGTTCTTTT CTTTTGTTTT GTTTTATTCA AACCCTCCTT 541 CTTTTTACCC TAATTAAAAG TATAATTAAG TGTAAAGGAG GACAATAAAA CCCACTAATT 601 AACTTAAGGT TACCTCTTTT AACCCCCAAG TAATTAGACC TATTAATATT AACCCTCAAT 661 CTTTATAATT AAGGAAAGAA TAGTCCAAAA CGACCCCTAA AACGTGTAGA GGAATCCTAT 721 TTTGC Predicted gene structure (within gDNA segment 20619 to 15241): Exon 1 17285 17148 ( 138 n); cDNA 83 219 ( 137 n); score: 0.688 Intron 1 17147 17115 ( 33 n); Pd: 0.000 (s: 0.80), Pa: 0.000 (s: 0.79) Exon 2 17114 16623 ( 492 n); cDNA 220 717 ( 498 n); score: 0.823 MATCH C01HBa0088L02.1- SGN-E546548- 0.794 630 0.869 C PGS_C01HBa0088L02.1-_SGN-E546548- (17285 17148,17114 16623) Alignment (genomic DNA sequence = upper lines): GTGTCGGTTC GTGACACCCG GTCCCCTAAT TCTACGTGTC GGTTCGTA-A C-ACCCGATC 17228 || ||| | ||| |||||| ||||||||| | | | | | || | | | ||| GTACCGGAAC GTGGCACCCG ATCCCCTAAT CCATCAAGCC TTCTTTTACA CTAAGGCATC 142 CCCTAATCTC ATTCTATCAA TTCATCAAGC CTTCTCCCTT ACCAAGGCAT CATCAATCTC 17168 | | |||| ||| ||| || || ||||||| ||||| | | || ||||||| ||||| |||| ATC-ATTCTC ATTATAT-AA TTTATCAAGC CTTCTTTCAT ACTAAGGCAT CATCATTCTC 200 ATTACTTTAG TTCATCAAGC CTTATCCCTT ACAAAGGCAT CATCATTAAA AAGAGATTAG 17108 |||| | || | ||||||| ||||| ATTA-TATAA TATATCAAGC .......... .......... .......... ...GAATTAG 226 GTTTTTATCA AGATTTGGGA TTCGATAGCT TCATCATGC- TTAAT-A-TA ATCACAATTA 17051 | || | ||| |||||||||| ||| || ||| ||||||||| || | | | ||| ||||| GGTTCTTTCA AGATTTGGGA TTCAATTGCT TCATCATGCT TTGTTAATTC ATCGCAATTT 286 TATAATCACG TTCATGCAAG CATACAA-TT AAGCACATAG CAGGGTTTAC AATACTATCA 16992 ||||||| ||||||||| ||||||| || |||||||||| |||||||||| |||||||||| CATAATCATA ATCATGCAAG CATACAACTT AAGCACATAG CAGGGTTTAC AATACTATCA 346 ATACATATCA TTCGCTATTA AGAGTTTACT ACGAATA--G TATGA-AAAC CATAACCTAC 16935 | ||||| | ||| |||||| |||||| ||| ||||||| | || | |||| |||||||||| ACACATAATA TTCACTATTA AGAGTTCACT ACGAATATCG TAACATAAAC CATAACCTAC 406 CTTCACCGAA GAATTGCGAT CAACAAGCTA TCTTCTCAAA ATCCTTGCTA TCCTCTTCGT 16875 || ||||||| |||||| || |||||||||| |||||||||| |||||||||| |||||||||| CTCCACCGAA GAATTG-AAT CAACAAGCTA TCTTCTCAAA ATCCTTGCTA TCCTCTTCGT 465 TTCTCTCTCT CTACTCGTTC TCTTTCT-TT TTCTGTCTCT CTTTGTTCTT TCTATTTTTC 16816 |||||||||| |||||||||| ||||| | ||| ||| | | | ||||| | ||| | TTCTCTCTCT CTACTCGTTC -GTTTCTCCT CTCTTTCTGT -TCTTTTCTT TTGTTTTGTT 523 TTATTCAAAC CCTCTTTC-T TTTACCCTAA TTAACA-TAT AATCAAGTGT AAAAGATGGC 16758 |||||||||| |||| ||| | |||||||||| |||| | ||| ||| |||||| ||| || | | TTATTCAAAC CCTCCTTCTT TTTACCCTAA TTAAAAGTAT AATTAAGTGT AAAGGAGGAC 583 AATAATAACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA ATTAGACTTA 16698 ||||| |||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||| || AATAA-AACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA ATTAGACCTA 642 TTAACATTAA CCCCCTAACT TTATAATTTA AGCAGGAATA GTCAAAAACG TCCCTTAAAA 16638 |||| ||||| ||| | | || |||||||| | | | ||||| ||| |||||| ||| ||||| TTAATATTAA CCCTCAATCT TTATAATTAA GGAAAGAATA GTCCAAAACG ACCCCTAAAA 702 CGTATAAAGA AATCC 16623 ||| || || ||||| CGTGTAGAGG AATCC 717 hqPGS_C01HBa0088L02.1-_SGN-E546548- (17114 16623) ******************************************************************************** EST sequence 9 -strand 731 n (File: SGN-E578076-) 1 GCATCATCAA TCCCATTATT TTAGTTCATC ACGCCTTCTT TTATACCAAG GCCTCATTAT 61 GAACAAAGAG ATTAAGATTT TGCAAGATTT GGGATTCAAT AACTTCATCA TGCTTATATA 121 ATCACAATTA TATAGTTACA TTCATGCAAG CATACAATTA AGCACATAGC AGGGTTTACA 181 ATATTATCAA TACATATCAT TCTCTATTAA GAGTTTACTA CGAATATCGT AAGAGAAACC 241 ATAACCTACC TCCACCGAAG AATTGCGATC AACAAGTTAT CTTCTCAAAA TCCTTGCTAT 301 CCTCTTCGTT TCTCTTTCTT TTTCTGTTTT CTCTTTGTTC TTTCTATTTT TCTTATTCAA 361 ACGTCCTAAC GAGCAAAACA GAGAACAAAA CAACCCTAAA AATTTCAACT TTTTTCGGTT 421 TCCCGACTTC CAATTTACCA GAGATATAGA TAATTCACTG AAATTGAACA AGGGTTAAGA 481 GCAGAAGAAA TTTACGTTGT GATTAATTGG GGCAAAGCGT CGAACAGTTG AACTGCAAAT 541 TTGTTCTTCA GTTATAGATA CAAAAGATAG AGTCTTATAT GAGTTAAAGA AGACGTAGAG 601 TATACCCTAG TAAGCGAGCT GACCACGGCG GAATGAGGTG GTGAGTTGGT GGGTTTCGTC 661 GGTCAACCAA GAAATGAAAA GGAAATTGAA GTATGAAAAA CTACAGAAAA ATGACGCGTT 721 TGGCCGAGAA A Predicted gene structure (within gDNA segment 18825 to 12516): Exon 1 17181 16832 ( 350 n); cDNA 1 351 ( 351 n); score: 0.857 Intron 1 16831 14880 (1952 n); Pd: 0.501 (s: 0.74), Pa: 0.999 (s: 0) Exon 2 14879 14875 ( 5 n); cDNA 352 356 ( 5 n); score: 0.800 MATCH C01HBa0088L02.1- SGN-E578076- 0.857 355 0.486 C PGS_C01HBa0088L02.1-_SGN-E578076- (17181 16832,14879 14875) Alignment (genomic DNA sequence = upper lines): GCATCATCAA TCTCATTACT TTAGTTCATC AAGCCTTATC CCTTACAAAG GCATCATCAT 17122 |||||||||| || ||||| | |||||||||| | ||||| | ||| ||| || |||| || GCATCATCAA TCCCATTATT TTAGTTCATC ACGCCTTCTT TTATACCAAG GCCTCATTAT 60 TAA-AAAGAG ATTAGGTTTT TATCAAGATT TGGGATTCGA TAGCTTCATC ATGCTTAATA 17063 || |||||| |||| | ||| | ||||||| |||||||| | || ||||||| |||||| ||| GAACAAAGAG ATTAAGATTT T-GCAAGATT TGGGATTCAA TAACTTCATC ATGCTT-ATA 118 TAATCACAAT TATATAATCA CGTTCATGCA AGCATACAAT TAAGCACATA GCAGGGTTTA 17003 |||||||||| |||||| | | | |||||||| |||||||||| |||||||||| |||||||||| TAATCACAAT TATATAGTTA CATTCATGCA AGCATACAAT TAAGCACATA GCAGGGTTTA 178 CAATACTATC AATACATATC ATTCGCTATT AAGAGTTTAC TACGAATA-- GTATGA-AAA 16946 ||||| |||| |||||||||| |||| ||||| |||||||||| |||||||| ||| || ||| CAATATTATC AATACATATC ATTCTCTATT AAGAGTTTAC TACGAATATC GTAAGAGAAA 238 CCATAACCTA CCTTCACCGA AGAATTGCGA TCAACAAGCT ATCTTCTCAA AATCCTTGCT 16886 |||||||||| ||| |||||| |||||||||| |||||||| | |||||||||| |||||||||| CCATAACCTA CCTCCACCGA AGAATTGCGA TCAACAAGTT ATCTTCTCAA AATCCTTGCT 298 ATCCTCTTCG TTTCTCTCTC TCTACTCGTT CTCTTTCTTT TTCTGTCTCT CTTTGTTCTT 16826 |||||||||| ||||||| || | | ||| ||| | || |||| ||| | ||| ATCCTCTTCG TTTCTCTTTC TTTTTCTGTT TTCTCT-TTG TTCTTTCTAT TTTT...... 351 TCTATTTTTC TTATTCAAAC CCTCTTTCTT TTACCCTAAT TAACATATAA TCAAGTGTAA 16766 .......... .......... .......... .......... .......... .......... 351 AAGATGGCAA TAATAACCCA CTAATTAACT TAAGGTTACC TCTTTTAACC CCCAAGTAAT 16706 .......... .......... .......... .......... .......... .......... 351 TAGACTTATT AACATTAACC CCCTAACTTT ATAATTTAAG CAGGAATAGT CAAAAACGTC 16646 .......... .......... .......... .......... .......... .......... 351 CCTTAAAACG TATAAAGAAA TCCGACCCGG ACTGGGATTG CGCAACCTGT GATGGGCCGT 16586 .......... .......... .......... .......... .......... .......... 351 CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAAGTT CAGAGACCCA AATTTCCACC 16526 .......... .......... .......... .......... .......... .......... 351 AAGGGTCTGT GACGGTCCGT CCTGCCATTT CGTTACGAAG TTCAGAGAGT CGATTTCAGC 16466 .......... .......... .......... .......... .......... .......... 351 ACCCAATTTT TAGATTTTCT AAGTGTTTTG AAACGAGAAC CTGCGACGGT CCGTCGTGCC 16406 .......... .......... .......... .......... .......... .......... 351 CATGACGGTC CGTCGTGGGG TCCGTCGCCT CAGTCTGTTT TTCCAGAAAT AAAATCTGCT 16346 .......... .......... .......... .......... .......... .......... 351 GCTCAAAACG ACTAAACAGG TCGTTACAAT TTATTGTTAG TTATGTCAAA TTATTGTGGA 16286 .......... .......... .......... .......... .......... .......... 351 ATGGAGAAGA AGTCAAATAC CATGCCATGC ATATAACAAG TTTGGGTGGT TTTACCTAAT 16226 .......... .......... .......... .......... .......... .......... 351 TTGCATCATT AGTAGATCTA TCAAGTGCAA ATAACCATGA AAGTAATAAT TTATGTGCTT 16166 .......... .......... .......... .......... .......... .......... 351 TTGTTGTTCA TGATCTTTGC AATTGAGTTG CTAGAACTAA TAGAGCTTTC TTTCTTTGCA 16106 .......... .......... .......... .......... .......... .......... 351 GGGCAATCAT ACAATGTTAA TTTTTTAGAC AAAATTACTA ATATTAGAAA GAAAGAAAAA 16046 .......... .......... .......... .......... .......... .......... 351 AAACACTGCA ATTGCAGTTT GATGAGTAGC TTAGATGGTT GGGCAGCCCA ACAATCATTT 15986 .......... .......... .......... .......... .......... .......... 351 TGTCATGGAC TCAATGAAAA GAGAATGATC ACGCAAGTAT ATCTCAATGA GTAAATAGTA 15926 .......... .......... .......... .......... .......... .......... 351 AAGTTAATAG ATACAATACC TGCTAATTTC GAAAGATGGT TGTTGAACGA CTCTACTGCA 15866 .......... .......... .......... .......... .......... .......... 351 TATGTAGACC TCAGGCCAAC CAATTGCACA AGTTTGTATT TGACACAGAT GACATATGAC 15806 .......... .......... .......... .......... .......... .......... 351 AAATATATTA CATAATAGAA GTTCAATATA AGTAGGTCCG TTTCAATTGA GGCTTAGACA 15746 .......... .......... .......... .......... .......... .......... 351 TAACCTAAGG AATTAGAGAA ATATATGTTA TTTTAGTGGA ATAATTCTTG TCCCAATTAA 15686 .......... .......... .......... .......... .......... .......... 351 TTTGGAGATG AAGATTTTTA CCAGAATAAT AAAAGAAAAC AAAGGACAAC GAACTACAAA 15626 .......... .......... .......... .......... .......... .......... 351 AATGTATATG TATAATATCA GTTATATACA ATTATATACA TATGCAATTC ACCTCTCTCC 15566 .......... .......... .......... .......... .......... .......... 351 CACTCTCAGC GCTCTTTGCT CGCCTCTCTG TTCCCTCTCT CAATCTCGCT TGCCATTTAT 15506 .......... .......... .......... .......... .......... .......... 351 AAAAATGTAT ATGTATAATA TCAATTATAT ACAATTATAT ACATATGCAA TTCACCGCTC 15446 .......... .......... .......... .......... .......... .......... 351 TTCCACTCTC TGCCCTCTCT CGCACGCGTC TCTTGATCTC GCTCGCCTCT CTCCTCTCTC 15386 .......... .......... .......... .......... .......... .......... 351 TCCCAGTCTC GACTGCCTCT CTCCTCCCTC TCCCAATCTC TTGCCATATA TACAATTACA 15326 .......... .......... .......... .......... .......... .......... 351 TATGTATGAT ATACAATTAT CTAACCAGAA TACATATACA ATTTACCTTT CCCCCTCTCT 15266 .......... .......... .......... .......... .......... .......... 351 CGCCTCTCTC CTCTCTCTCC CAGTCTCGCT CGCCGCTCTT CTCCATATAA CATGTAGTTA 15206 .......... .......... .......... .......... .......... .......... 351 CAAATTGTAA TTATCAAGTC ATAGCTATAT GTGAAAGTTT CCCATTAAAT ATAGATACAA 15146 .......... .......... .......... .......... .......... .......... 351 TTAATAATTT TATATTATGA TTTTATTTGC ACAAAAATCA ACAATGCAGA TAAAATAATT 15086 .......... .......... .......... .......... .......... .......... 351 TTATATTAAA CGACTATCAA AGAAAATAAT ATGAATTATA TCTGGTGTAT GTTTTAGAAA 15026 .......... .......... .......... .......... .......... .......... 351 GAATTTGTTT TATGAAATAA GAAAATATAA ATCAAATAAT AATAATAATA TAATAATCAA 14966 .......... .......... .......... .......... .......... .......... 351 GAAAAGAGAA AAATATTTCT TTTTAATACA TTCCTAATTC TTATTCACTT TTTCCTTTTG 14906 .......... .......... .......... .......... .......... .......... 351 TAGTTGTCCT TAATTACTTC CCGTAGCTCA T 14875 || | | .......... .......... ......CTTA T 356 hqPGS_C01HBa0088L02.1-_SGN-E578076- (17181 16832) ******************************************************************************** EST sequence 2 -strand 605 n (File: SGN-E347579-) 1 ATCCCCTAAT TCTACGTGTC GGTTCGTGAC ACCCGATCCC CTAATTCTAC GTGTCGGTTC 61 GTGACACCTG ATCCCCTAAT CTACGTGCCG GTTCGTGACA CCCGATCCCC TAATTCTACG 121 TGCCAGTTCG TGACACCCGA TCCCCTAATT CTACGTGTCG GTTCGTGACA CCCGATCCCC 181 TGCATGTGTC GGTACGTGAC ACTCCGATCC ACTAATATCA TTCTGTAAAT CATCAGGCCT 241 TCTCTATACC AAGGCATCAT CAATCCCATT ACTTTTATTC ATCAAGCCTT CTTCTATACC 301 AAGGCATCAT CATTAATAAG AGATTAGATT TTTATCAAGA TTTGGGATTC AATAACTTCA 361 TCATGCTTAA TATAATCACA ATTATATAAT CACGTTCATG CATGCATACA ATTAAGCATA 421 TAGCAGGGTT TACAATACTA CCAATACATA TCATTCTCTA TTAAGAGTTT ACTATGAAAG 481 CATGAAAACC ATAACCTACC TCCACCGAAG ATTAGTGATC AAGCAAGCAA ATTTTTCTCC 541 AAGCTTTGTT TCTCCCTTCT CGTTCGATTC TTCCTCTCTC TCTTGTTCTT TCTATTTTCT 601 TTATT Predicted gene structure (within gDNA segment 17935 to 15293): Exon 1 17444 16912 ( 533 n); cDNA 1 522 ( 522 n); score: 0.873 MATCH C01HBa0088L02.1- SGN-E347579- 0.873 533 0.881 C PGS_C01HBa0088L02.1-_SGN-E347579- (17444 16912) Alignment (genomic DNA sequence = upper lines): ATTCATTAAT CCTCTTGTGT CGGTACGTGA CACTCCGATC CCCTACTACT ATGTGTCGAA 17385 || | |||| || |||| |||| ||||| ||| |||||| ||||| | || | |||||| ATCCCCTAAT TCT-ACGTGT CGGTTCGTGA CAC-CCGATC CCCTAATTCT ACGTGTCGGT 58 ACGTGACACT CCGATCCCCT AAATTCTACG TGTCGGTTCG TGACACCCGA TCTCCTAAAT 17325 |||||||| | |||||||| || |||||| || ||||||| |||||||||| || ||||| | TCGTGACAC- CTGATCCCCT -AA-TCTACG TGCCGGTTCG TGACACCCGA TCCCCTAATT 115 CTACGTGTCG GTTCGTGACA CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGG 17265 ||||||| | |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| CTACGTGCCA GTTCGTGACA CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGA 175 TCCCCTAATT CTACGTGTCG GTTCGTAACA C-CCGATCCC CTAATCTCAT TCTATCAATT 17206 ||||| | | | |||||| || ||| ||| | ||||||| ||||| |||| ||| | || | TCCCC---TG C-ATGTGTCG GTACGTGACA CTCCGATCCA CTAATATCAT TCTGT-AAAT 230 CATCAAGCCT TCTCCCTTAC CAAGGCATCA TCAATCTCAT TACTTTAGTT CATCAAGCCT 17146 ||||| |||| ||| | ||| |||||||||| |||||| ||| |||||| || |||||||||| CATCAGGCCT TCT-CTATAC CAAGGCATCA TCAATCCCAT TACTTTTATT CATCAAGCCT 289 TATCCCTTAC AAAGGCATCA TCATTAAAAA GAGATTAGGT TTTTATCAAG ATTTGGGATT 17086 | | | ||| ||||||||| ||||||| || |||||||| | |||||||||| |||||||||| TCTTCTATAC CAAGGCATCA TCATTAATAA GAGATTAGAT TTTTATCAAG ATTTGGGATT 349 CGATAGCTTC ATCATGCTTA ATATAATCAC AATTATATAA TCACGTTCAT GCAAGCATAC 17026 | ||| |||| |||||||||| |||||||||| |||||||||| |||||||||| ||| |||||| CAATAACTTC ATCATGCTTA ATATAATCAC AATTATATAA TCACGTTCAT GCATGCATAC 409 AATTAAGCAC ATAGCAGGGT TTACAATACT ATCAATACAT ATCATTCGCT ATTAAGAGTT 16966 ||||||||| |||||||||| |||||||||| | |||||||| ||||||| || |||||||||| AATTAAGCAT ATAGCAGGGT TTACAATACT ACCAATACAT ATCATTCTCT ATTAAGAGTT 469 TACTACGAAT AGTATGAAAA CCATAACCTA CCTTCACCGA AGAATTGCGA TCAA 16912 ||||| ||| || ||||||| |||||||||| ||| |||||| ||| | | || |||| TACTATGAA- AGCATGAAAA CCATAACCTA CCTCCACCGA AGATTAGTGA TCAA 522 hqPGS_C01HBa0088L02.1-_SGN-E347579- (17444 16912) ******************************************************************************** EST sequence 110 -strand 717 n (File: SGN-E349726-) 1 TTATGTTCAT TAGATTGAGT ATATAACATC TTTCAAGATT CATTGTCTTT ATTTCTCTTG 61 TGTCGGTACG TGACATTCCG CTCCNTCATA TTCATTAATC TTCTTGTGTC GGTACGTGAT 121 ACTCTGATCC CCTAAATCTA CGTGTCGGAA CGTGACACTC CGATCCCCTA AATCTACGTG 181 TCGGTTCGTG ACACCTGATC CCCTAAATCT ACGTGTCGGT TCGTGACACC CGATCCCCTA 241 AATCTACGTG TCGGTTCGTG ACACCCGATC CCCTAAATCT ACGTGTCGGT TCGTGACACC 301 CGATCCCCTA ATCTATGTGT TGGTTCGTGA CACCTGATCC CTTAATCTAC GTGTCGGTTT 361 GTGACACCCG ATCCCCTAAT TCTACGTGTC AGTTCGTGAC ACCCGATCCC CTAATCTCAT 421 TCTATCAATT CATCAAGCCT TCTCCCTTAC CAAGGCATCA TCAATCTCAT TACTTTAGTT 481 CATCAAGCCT TCTCCCTTAC CAAGGCATCA TCATTAAAAA GAGATTAGGT TTTTACAAGA 541 TTTGGGATTC AATAACTTCA TCATGCTTAT ATAATAACAA TTATATAGTT ACATTCATGC 601 AAGCATACAA TTAAGCACAT AGCAGGGTTT ACAATATTAT CAATACATAT CATTCTCTAT 661 TAAGAGTTTA CTACGAATAT CGTAAGAGAA ACAATAACCT ACCTCCACCG AAGACTA Predicted gene structure (within gDNA segment 21520 to 15975): Exon 1 17444 16923 ( 522 n); cDNA 198 714 ( 517 n); score: 0.899 MATCH C01HBa0088L02.1- SGN-E349726- 0.899 522 0.728 C PGS_C01HBa0088L02.1-_SGN-E349726- (17444 16923) Alignment (genomic DNA sequence = upper lines): ATTCATTAAT CCTCTTGTGT CGGTACGTGA CACTCCGATC CCCTACTACT ATGTGTCGAA 17385 || | ||| || |||| |||| ||||| ||| |||||| ||||| || | |||||| ATCCCCTAAA TCT-ACGTGT CGGTTCGTGA CAC-CCGATC CCCTAAATCT ACGTGTCGGT 255 ACGTGACACT CCGATCCCCT AAATTCTACG TGTCGGTTCG TGACACCCGA TCTCCTAAAT 17325 |||||||| |||||||||| ||| |||||| |||||||||| |||||||||| || ||| ||| TCGTGACAC- CCGATCCCCT AAA-TCTACG TGTCGGTTCG TGACACCCGA TCCCCT-AAT 312 CTACGTGTCG GTTCGTGACA CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGG 17265 ||| |||| | |||||||||| || |||||| ||| |||||| |||||||| | ||||||||| CTATGTGTTG GTTCGTGACA CCTGATCCCT TAA-TCTACG TGTCGGTTTG TGACACCCGA 371 TCCCCTAATT CTACGTGTCG GTTCGTAACA CCCGATCCCC TAATCTCATT CTATCAATTC 17205 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| TCCCCTAATT CTACGTGTCA GTTCGTGACA CCCGATCCCC TAATCTCATT CTATCAATTC 431 ATCAAGCCTT CTCCCTTACC AAGGCATCAT CAATCTCATT ACTTTAGTTC ATCAAGCCTT 17145 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCAAGCCTT CTCCCTTACC AAGGCATCAT CAATCTCATT ACTTTAGTTC ATCAAGCCTT 491 ATCCCTTACA AAGGCATCAT CATTAAAAAG AGATTAGGTT TTTATCAAGA TTTGGGATTC 17085 |||||||| |||||||||| |||||||||| |||||||||| |||| ||||| |||||||||| CTCCCTTACC AAGGCATCAT CATTAAAAAG AGATTAGGTT TTTA-CAAGA TTTGGGATTC 550 GATAGCTTCA TCATGCTTAA TATAATCACA ATTATATAAT CACGTTCATG CAAGCATACA 17025 ||| ||||| |||||||| | |||||| ||| |||||||| | || |||||| |||||||||| AATAACTTCA TCATGCTT-A TATAATAACA ATTATATAGT TACATTCATG CAAGCATACA 609 ATTAAGCACA TAGCAGGGTT TACAATACTA TCAATACATA TCATTCGCTA TTAAGAGTTT 16965 |||||||||| |||||||||| ||||||| || |||||||||| |||||| ||| |||||||||| ATTAAGCACA TAGCAGGGTT TACAATATTA TCAATACATA TCATTCTCTA TTAAGAGTTT 669 ACTACGAATA --GTATGA-A AACCATAACC TACCTTCACC GAAGA 16923 |||||||||| ||| || | ||| |||||| ||||| |||| ||||| ACTACGAATA TCGTAAGAGA AACAATAACC TACCTCCACC GAAGA 714 hqPGS_C01HBa0088L02.1-_SGN-E349726- (17444 16923) ******************************************************************************** EST sequence 94 -strand 402 n (File: SGN-E357559-) 1 TGTGTTGGTT CGTGACACCT GATCCCTTAA TCTACGTGTC GGTTTGTGAC ACCCGATCCC 61 CTAATTCTAC GTGTCAGTTC GTGACACCCG ATCCCCTAAT CTCATTCTAT CAATTCATCA 121 AGCCTTCTCC CTTACCAAGG CATCATCAAT CTCATTACTT TAGTTCATCA AGCCTTCTCC 181 CTTACCAAGG CATCATCATT AAAAAGAGAT TAGGTTTTTA CAAGATTTGG GATTCAATAA 241 CTTCATCATG CTTATATAAT AACAATTATA TAGTTACATT CATGCAAGCA TACAATTAAG 301 CACATAGCAG GGTTTACAAT ATTATCAATA CATATCATTC TCTATTAAGA GTTTACTACG 361 AATATCGTAA GAGAAACAAT AACCTACCTC CACCGAAGAC TA Predicted gene structure (within gDNA segment 18217 to 15975): Exon 1 17320 16923 ( 398 n); cDNA 2 399 ( 398 n); score: 0.923 MATCH C01HBa0088L02.1- SGN-E357559- 0.923 398 0.990 C PGS_C01HBa0088L02.1-_SGN-E357559- (17320 16923) Alignment (genomic DNA sequence = upper lines): GTGTCGGTTC GTGACACCCG ATCCCCTAAT TCTACGTGTC GGTTCGTGAC ACCCGGTCCC 17261 |||| ||||| |||||||| | ||||| ||| |||||||||| |||| ||||| ||||| |||| GTGTTGGTTC GTGACACCTG ATCCCTTAA- TCTACGTGTC GGTTTGTGAC ACCCGATCCC 60 CTAATTCTAC GTGTCGGTTC GTAACACCCG ATCCCCTAAT CTCATTCTAT CAATTCATCA 17201 |||||||||| ||||| |||| || ||||||| |||||||||| |||||||||| |||||||||| CTAATTCTAC GTGTCAGTTC GTGACACCCG ATCCCCTAAT CTCATTCTAT CAATTCATCA 120 AGCCTTCTCC CTTACCAAGG CATCATCAAT CTCATTACTT TAGTTCATCA AGCCTTATCC 17141 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| ||| AGCCTTCTCC CTTACCAAGG CATCATCAAT CTCATTACTT TAGTTCATCA AGCCTTCTCC 180 CTTACAAAGG CATCATCATT AAAAAGAGAT TAGGTTTTTA TCAAGATTTG GGATTCGATA 17081 ||||| |||| |||||||||| |||||||||| |||||||||| ||||||||| |||||| ||| CTTACCAAGG CATCATCATT AAAAAGAGAT TAGGTTTTTA -CAAGATTTG GGATTCAATA 239 GCTTCATCAT GCTTAATATA ATCACAATTA TATAATCACG TTCATGCAAG CATACAATTA 17021 ||||||||| |||| ||||| || ||||||| |||| | || |||||||||| |||||||||| ACTTCATCAT GCTT-ATATA ATAACAATTA TATAGTTACA TTCATGCAAG CATACAATTA 298 AGCACATAGC AGGGTTTACA ATACTATCAA TACATATCAT TCGCTATTAA GAGTTTACTA 16961 |||||||||| |||||||||| ||| |||||| |||||||||| || ||||||| |||||||||| AGCACATAGC AGGGTTTACA ATATTATCAA TACATATCAT TCTCTATTAA GAGTTTACTA 358 CGAATA--GT ATGA-AAACC ATAACCTACC TTCACCGAAG A 16923 |||||| || | || |||| |||||||||| | |||||||| | CGAATATCGT AAGAGAAACA ATAACCTACC TCCACCGAAG A 399 hqPGS_C01HBa0088L02.1-_SGN-E357559- (17320 16923) ******************************************************************************** EST sequence 96 -strand 239 n (File: SGN-E391780-) 1 ATCAACAAAT ACTATATCAT TAACAATTAC CGTCAAGTTC ACACATGAGG ACTCAAGCCT 61 CAATACCATA CTCATTTGGG AATCATGTTC ATTAGATTGA GTATATTAAC ATCTTTCAAG 121 ATTCATTATC TTTATTTCTC TTGTGTCGGT ACGTGACACT CCGCTCCCTC AATATTCATT 181 AATCCTCTTG TGTCGGTACG TGACACTCCG ATCCCCTAAA TCTATATGTC GGTTTGTGA Predicted gene structure (within gDNA segment 18307 to 16590): Exon 1 17614 17379 ( 236 n); cDNA 3 239 ( 237 n); score: 0.934 MATCH C01HBa0088L02.1- SGN-E391780- 0.934 236 0.987 C PGS_C01HBa0088L02.1-_SGN-E391780- (17614 17379) Alignment (genomic DNA sequence = upper lines): CAACAAGTAC TATATCATTA ACAATTTCCG TCAAGTTCAC ACATGAGGAC TCAAGCCTCA 17555 |||||| ||| |||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| CAACAAATAC TATATCATTA ACAATTACCG TCAAGTTCAC ACATGAGGAC TCAAGCCTCA 62 ATACCATACT CATTTGGGAA TTATGTTCAT TAGATTGAGT ATATTAACAT CTTTTAAGAT 17495 |||||||||| |||||||||| | |||||||| |||||||||| |||||||||| |||| ||||| ATACCATACT CATTTGGGAA TCATGTTCAT TAGATTGAGT ATATTAACAT CTTTCAAGAT 122 TCATTATCTT TATTTCTCTT GTGTCGGTAC GTGACACTCC GCTCCCT-TA TATTCATTAA 17436 |||||||||| |||||||||| |||||||||| |||||||||| ||||||| | |||||||||| TCATTATCTT TATTTCTCTT GTGTCGGTAC GTGACACTCC GCTCCCTCAA TATTCATTAA 182 TCCTCTTGTG TCGGTACGTG ACACTCCGAT CCCCTACTAC TATGTGTCGA AACGTGA 17379 |||||||||| |||||||||| |||||||||| |||||| | ||| ||||| |||| TCCTCTTGTG TCGGTACGTG ACACTCCGAT CCCCTAAATC TATATGTCGG TTTGTGA 239 hqPGS_C01HBa0088L02.1-_SGN-E391780- (17614 17379) ******************************************************************************** EST sequence 77 -strand 481 n (File: SGN-E246710-) 1 AGTCCAAGCT AGAAGCATTA GCTCACCCTG AATTTCCGAT GTAGTAAGAC TGGCTTGAAT 61 TACTGTTGAG TTGAACACGA TGGCACGTTT GCTGCACTCC ACAAATAAAC AAGAAGAGAA 121 CATAAAAGTA GGGGTCAGTA CAAAACACGG GTACTGAGTA GATATCATCG GCCAACTCAA 181 AATAGAAATC AATATATATA CCAAGTAATA TCATAAAATC AACTATGATA CTCAACATGT 241 AGCAACAACA AATACTATAT CATTAACAAT TACCGTCAAG TTCACACATG AGGACTCAAG 301 CCTCAATACC ATACTCATTT GGGAATCATG TTCATTAGAT TGAGTATATT AACATCTTTC 361 AAGATTCATT ATCTTTATTT CTCTTGTGTC GGTACGTGAC ACTCCGCTCC CTCAATATTC 421 ATTAATCCTC TTGTGTCGGT ACGTGACACT CCGATCCCCT AAATCTATAT GTCGGTTTGT 481 G Predicted gene structure (within gDNA segment 18467 to 16600): Exon 1 17857 17380 ( 478 n); cDNA 1 481 ( 481 n); score: 0.934 MATCH C01HBa0088L02.1- SGN-E246710- 0.934 478 0.994 C PGS_C01HBa0088L02.1-_SGN-E246710- (17857 17380) Alignment (genomic DNA sequence = upper lines): AGTCCAAGCT AGAAGCATTA GCTCACCCTG AATTTCCGAT GTAGTAAGAC TGGCTTGAAT 17798 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTCCAAGCT AGAAGCATTA GCTCACCCTG AATTTCCGAT GTAGTAAGAC TGGCTTGAAT 60 TACTGTTGAG TCGAAGACGA CGGCACGTTT GCTACACTCC ACAAATAACA AAGAAGAAAA 17738 |||||||||| | ||| |||| ||||||||| ||| |||||| |||||||| ||||||| || TACTGTTGAG TTGAACACGA TGGCACGTTT GCTGCACTCC ACAAATAAAC AAGAAGAGAA 120 CATAAAAGTA GGGGTCAGTA CAAAGCACGG GTACTGAGTA GATATCATCG GCCAACTCAA 17678 |||||||||| |||||||||| |||| ||||| |||||||||| |||||||||| |||||||||| CATAAAAGTA GGGGTCAGTA CAAAACACGG GTACTGAGTA GATATCATCG GCCAACTCAA 180 AATAGAAAAC -A-GTATATA CCAAGTAATA TCATAAACTC AACTATGATA CTCAACATGT 17620 |||||||| | | |||||| |||||||||| ||||||| || |||||||||| |||||||||| AATAGAAATC AATATATATA CCAAGTAATA TCATAAAATC AACTATGATA CTCAACATGT 240 AGCAACAACA AGTACTATAT CATTAACAAT TTCCGTCAAG TTCACACATG AGGACTCAAG 17560 |||||||||| | |||||||| |||||||||| | |||||||| |||||||||| |||||||||| AGCAACAACA AATACTATAT CATTAACAAT TACCGTCAAG TTCACACATG AGGACTCAAG 300 CCTCAATACC ATACTCATTT GGGAATTATG TTCATTAGAT TGAGTATATT AACATCTTTT 17500 |||||||||| |||||||||| |||||| ||| |||||||||| |||||||||| ||||||||| CCTCAATACC ATACTCATTT GGGAATCATG TTCATTAGAT TGAGTATATT AACATCTTTC 360 AAGATTCATT ATCTTTATTT CTCTTGTGTC GGTACGTGAC ACTCCGCTCC CT-TATATTC 17441 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| || |||||| AAGATTCATT ATCTTTATTT CTCTTGTGTC GGTACGTGAC ACTCCGCTCC CTCAATATTC 420 ATTAATCCTC TTGTGTCGGT ACGTGACACT CCGATCCCCT ACTACTATGT GTCGAAACGT 17381 |||||||||| |||||||||| |||||||||| |||||||||| | |||| | |||| || ATTAATCCTC TTGTGTCGGT ACGTGACACT CCGATCCCCT AAATCTATAT GTCGGTTTGT 480 G 17380 | G 481 hqPGS_C01HBa0088L02.1-_SGN-E246710- (17857 17380) ******************************************************************************** EST sequence 257 +strand 730 n (File: SGN-E546506+) 1 TTTTTTTTTT TTTTTTTTAA TAAAAACAAT TCAATACTAT TATTATTATC CCCAAAATCT 61 GGAAGTCATC ATCACAAGAA CATCTATCTC AAATTACTTA ACTAGGAATG TCTAAGAACA 121 AAATAACTAA AAAGCTAGTC CATGCCGGAA ATTCAAGGCA TCAAGACTTG AAGAAGAAGA 181 CCCAGTCCAA GCTAGACGCA TTAGCTCACC CTGAATTTTC CGATGAAGTG AAGACTGGCT 241 AGATCTACTG TTGAGTTGAA GTTGACGGAA CGTTTGCTGC ATTACACAAA TAACAAAGAG 301 GAAAACATGA AAGTAGGGGT CAGTACAACC ACACGTACTG AGTAGATATC ATCGGCCAAC 361 TCAAAATAGG GAACAGTATA TATCAATAAT AATGTAAATC AACTACAATA CTCAACATGT 421 AGCAATAACA CCATGAATTC ATCAATAACT ACAACCGAGT TCACACATGA GGACTCAAGC 481 CTCAATACCA TACTCATTTG GGAATTAAGT TCATTAGATT GAGTATATTC ATTATCTTTC 541 AAGATTCATT ATCTTTCTTC CTCTTGTGTC GGTACGTGAC ACTCCGATCC TCTATTTCTA 601 TCCTGGTGCC GGAACGTGGC ACTCCGATCC TCATTCTATC CTGGTACCGG AACGTGGCAC 661 CCGATCCATT TTCTATCCTG GTGTCGGAAC GTGACACTCC GATCCTCATA TTCTATCCTG 721 GTACCGGAAC Predicted gene structure (within gDNA segment 22751 to 15134): Exon 1 18001 17393 ( 609 n); cDNA 44 639 ( 596 n); score: 0.847 PPA cDNA 18 1 MATCH C01HBa0088L02.1- SGN-E546506+ 0.847 609 0.834 C PGS_C01HBa0088L02.1-_SGN-E546506+ (18001 17393) Alignment (genomic DNA sequence = upper lines): TATTATTCCC CAAAATTTGG AAGTCATCAT CACAAGAACA TCTATGATCA AATTAC-TAA 17943 ||||| |||| |||||| ||| |||||||||| |||||||||| ||||| ||| |||||| ||| TATTA-TCCC CAAAATCTGG AAGTCATCAT CACAAGAACA TCTAT-CTCA AATTACTTAA 101 CTAAAAATGC CTAAGAAGCT AAAAATACAT AAGAAGCTAG TCCATGCCGG AAGTTCAAGG 17883 ||| |||| ||||||| | |||||| | || ||||||| |||||||||| || ||||||| CTAGGAATGT CTAAGAA-C- -AAAATAACT AAAAAGCTAG TCCATGCCGG AAATTCAAGG 158 CATCAAGACT TGAAGAAGAA GCTCCAGTCC AAGCTAGAAG CATTAGCTCA CCCTGAA-TT 17824 |||||||||| |||||||||| | ||||||| |||||||| | |||||||||| ||||||| || CATCAAGACT TGAAGAAGAA GACCCAGTCC AAGCTAGACG CATTAGCTCA CCCTGAATTT 218 TCCGATGTAG T-AAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT 17765 ||||||| || | |||||||| || || ||| |||||||| | ||| ||||| ||||||||| TCCGATGAAG TGAAGACTGG CTAGATCTAC TGTTGAGTTG AAGTTGACGG AACGTTTGCT 278 ACACTCCACA AATAACAAAG AAGAAAACAT AAAAGTAGGG GTCAGTACAA AGCACGGGTA 17705 || | |||| |||||||||| | |||||||| ||||||||| |||||||| | | ||| ||| GCATTACACA AATAACAAAG AGGAAAACAT GAAAGTAGGG GTCAGTAC-A ACCACACGTA 337 CTGAGTAGAT ATCATCGGCC AACTCAAAAT AGAAAACAGT ATATACCAAG TAATATCATA 17645 |||||||||| |||||||||| |||||||||| || |||||| ||||| ||| ||||| || CTGAGTAGAT ATCATCGGCC AACTCAAAAT AGGGAACAGT ATATATCAA- TAATAATGTA 396 AACTCAACTA TGATACTCAA CATGTAGCAA CAACAAGTAC TATATCATTA ACAATTTCCG 17585 || ||||||| |||||||| |||||||||| ||| | | | |||| | | || | | AA-TCAACTA CAATACTCAA CATGTAGCAA TAAC-ACCAT GAATTCATCA ATAACTACAA 454 TCAAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT CATTTGGGAA TTATGTTCAT 17525 | ||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||| |||||| CCGAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT CATTTGGGAA TTAAGTTCAT 514 TAGATTGAGT ATATT-AACA TCTTTTAAGA TTCATTATCT TTATTTCTCT TGTGTCGGTA 17466 |||||||||| ||||| | | ||||| |||| |||||||||| || || |||| |||||||||| TAGATTGAGT ATATTCATTA TCTTTCAAGA TTCATTATCT TTCTTCCTCT TGTGTCGGTA 574 CGTGACACTC CGCTCCCTTA TATTCATTAA TCCTCTTGTG TCGGTACGTG ACACTCCGAT 17406 |||||||||| || ||| || | ||| | | | | || ||| ||| ||||| ||||||||| CGTGACACTC CGATCCTCTA T-TTC--T-A T-C-CTGGTG CCGGAACGTG GCACTCCGAT 628 CCCCTACTAC TAT 17393 || | | | | ||| CCTC-A-TTC TAT 639 hqPGS_C01HBa0088L02.1-_SGN-E546506+ (18001 17393) ******************************************************************************** EST sequence 246 +strand 337 n (File: SGN-E357033+) 1 ACTGAATAGA TATCATCGCC CAACTCAAAA TAGAAATCAA TATATATCAA GNATTATCAT 61 AAAATCAACT ATGATACTCA ACATGTAGCA ACAACAAGCA CTATATCATT AACAATTACC 121 GTCACGTTCA CACATGAGGA CTCAAGCCTC AATACCATAC TCATTTGGGA ATCATGTTCA 181 TTAGATTTAG TATATTAACA TCTTTCAAGA TTCATTATCT TTATTTCTCT TGTGACGGAA 241 CATGACATTC CGCTCCCTCA TATTCATTAA TCCTCTTGTG TGAACACATG ACACTCCGAT 301 CCCCTAAATC TACATGACAG TTTCATGAAC GCTATCC Predicted gene structure (within gDNA segment 18881 to 16480): Exon 1 17705 17425 ( 281 n); cDNA 1 281 ( 281 n); score: 0.932 MATCH C01HBa0088L02.1- SGN-E357033+ 0.932 281 0.834 C PGS_C01HBa0088L02.1-_SGN-E357033+ (17705 17425) Alignment (genomic DNA sequence = upper lines): ACTGAGTAGA TATCATCGGC CAACTCAAAA TAGAAAACAG TATATACCAA GTAATATCAT 17646 ||||| |||| |||||||| | |||||||||| |||||| || |||||| ||| | | |||||| ACTGAATAGA TATCATCGCC CAACTCAAAA TAGAAATCAA TATATATCAA GNATTATCAT 60 AAACTCAACT ATGATACTCA ACATGTAGCA ACAACAAGTA CTATATCATT AACAATTTCC 17586 ||| |||||| |||||||||| |||||||||| |||||||| | |||||||||| ||||||| || AAAATCAACT ATGATACTCA ACATGTAGCA ACAACAAGCA CTATATCATT AACAATTACC 120 GTCAAGTTCA CACATGAGGA CTCAAGCCTC AATACCATAC TCATTTGGGA ATTATGTTCA 17526 |||| ||||| |||||||||| |||||||||| |||||||||| |||||||||| || ||||||| GTCACGTTCA CACATGAGGA CTCAAGCCTC AATACCATAC TCATTTGGGA ATCATGTTCA 180 TTAGATTGAG TATATTAACA TCTTTTAAGA TTCATTATCT TTATTTCTCT TGTGTCGGTA 17466 ||||||| || |||||||||| ||||| |||| |||||||||| |||||||||| |||| ||| | TTAGATTTAG TATATTAACA TCTTTCAAGA TTCATTATCT TTATTTCTCT TGTGACGGAA 240 CGTGACACTC CGCTCCCTTA TATTCATTAA TCCTCTTGTG T 17425 | ||||| || |||||||| | |||||||||| |||||||||| | CATGACATTC CGCTCCCTCA TATTCATTAA TCCTCTTGTG T 281 hqPGS_C01HBa0088L02.1-_SGN-E357033+ (17705 17425) ******************************************************************************** EST sequence 112 -strand 236 n (File: SGN-E209683-) 1 CACAAATAAC AAGAAGATAA ACATAAAAGT AGGGGTCAGT ACAAACCACG GGTACTGAGT 61 AGATATCATC GGCCAACTCA AAATAGGGAA CAGTATGTAT TAAGCAATAT CATAAAATCA 121 ACTAATATCC TTAACATGCA GCATTTATAG TTACCATAAC CCTTGGTTAC AACACCAAGC 181 ACATCAATGA GGACTCACAC CTCCTCATCA TACTCATTTG GGAATTTAGT TCATTA Predicted gene structure (within gDNA segment 18530 to 15573): Exon 1 17758 17523 ( 236 n); cDNA 1 236 ( 236 n); score: 0.786 MATCH C01HBa0088L02.1- SGN-E209683- 0.786 236 1.000 C PGS_C01HBa0088L02.1-_SGN-E209683- (17758 17523) Alignment (genomic DNA sequence = upper lines): CACAAATAAC AAAGAAGA-A AACATAAAAG TAGGGGTCAG TACAAAGCAC GGGTACTGAG 17700 |||||||||| ||||||| | |||||||||| |||||||||| |||||| ||| |||||||||| CACAAATAAC -AAGAAGATA AACATAAAAG TAGGGGTCAG TACAAACCAC GGGTACTGAG 59 TAGATATCAT CGGCCAACTC AAAATAGAAA ACAGTATATA CCAAGTAATA TCATAAACTC 17640 |||||||||| |||||||||| ||||||| | ||||||| || ||| |||| ||||||| || TAGATATCAT CGGCCAACTC AAAATAGGGA ACAGTATGTA TTAAGCAATA TCATAAAATC 119 AACTATGATA CTCAACATGT AGCAACAACA AGTACTATAT CATTAACAAT TTCCGTCAAG 17580 ||||| || || |||||| |||| | | ||| ||| | | | |||| AACTAATATC CTTAACATGC AGCATTTATA GTTACCATAA CCCTTGGTTA CAACACCAAG 179 TTCACACATG AGGACTCAAG CCTCAATACC ATACTCATTT GGGAATTATG TTCATTA 17523 || ||| |||||||| |||| | | |||||||||| ||||||| | ||||||| CACATCAATG AGGACTCACA CCTCCTCATC ATACTCATTT GGGAATTTAG TTCATTA 236 hqPGS_C01HBa0088L02.1-_SGN-E209683- (17758 17523) ******************************************************************************** EST sequence 41 -strand 729 n (File: SGN-E351546-) 1 AGTCGTTGCT CTAGTTCTAC CCATCTGGCA AGAGAGTGAG NATGGTCAGA TACCAATTCG 61 TATCGCTTAG ATACCAATTG ACTCGAAGTA GTAGCACGAA AGAAAGAATG AAAGAGTGAA 121 GTTTTCCTAA AGTCTTATAG CCTCTCAAGG AAAAGTAAAA GCGTCCCCCT ACCGTTCCTT 181 AAGACTCTAC TAGACTTGTT CTTGTGTGAT GAGACCAACG AACCTAATGC TCTGATACCA 241 AGTTTTGTCA CGACCCAAAT CCGGGCCGCC ACTGGCACCC ACACTTACCC TCCTATGTGA 301 GCGAACCAAC CAATCTAAAC CTTAACATTT CAATGTAATA GCAACAGAAA GTAATGCGGA 361 AGACTTAAAC TCATTAATAA AATCAATAAC TACTATTATT AAACATCTAT TATTCCCAAA 421 ACCTGGAAGT CATCATCACA AGAACATCTA CTTTAAACTA CTAATTCTAA GAGTTTCTAA 481 GAAGCTAAAA AATTACATAA GAAGCTAGTC CATGCCGGAA GTTCAAGGCA TCAAGACATG 541 AAGGAGAAGA TCCAGTCCAA GCTAGAAGCG TTAGCTCACC CTGAAGATCC GGTGTGACGA 601 AGACTGGCTT GAGTTACTGT TGAGTCGAAG ATGACGGCAC GTTTGCTGCA CTCCACAAAT 661 ACCAAGAAGA AAAACATAAA AGTAGGGGTC AGTACAAAAC ACGGCTACTG AGTAGATATC 721 ATCGGCCAA Predicted gene structure (within gDNA segment 19891 to 17083): Exon 1 18400 17683 ( 718 n); cDNA 1 729 ( 729 n); score: 0.859 MATCH C01HBa0088L02.1- SGN-E351546- 0.859 718 0.985 C PGS_C01HBa0088L02.1-_SGN-E351546- (18400 17683) Alignment (genomic DNA sequence = upper lines): AGTTGTTGCT CTATTTCTAA CCATCTGCGA AAGAGAGTGA AGATGGTCAG ATACCAATTT 18341 ||| |||||| ||| ||||| ||||||| | |||||||||| |||||||| ||||||||| AGTCGTTGCT CTAGTTCTAC CCATCTG-GC AAGAGAGTGA GNATGGTCAG ATACCAATTC 59 GTATCACCTA GATACCAATT GGATTCAAGT AGTAGCACAA AAGAAAGAAT GAAAGAATGG 18281 ||||| | || |||||||||| | | |||| |||||||| | |||||||||| |||||| || GTATCGCTTA GATACCAATT GACTCGAAGT AGTAGCACGA AAGAAAGAAT GAAAGAGTGA 119 AATTTTCCTA AAGTCTTATA GCCTCTCAAA GAAAAGTAAA GGCGTCCCCC TACCGTTCCT 18221 | |||||||| |||||||||| ||||||||| |||||||||| ||||||||| |||||||||| AGTTTTCCTA AAGTCTTATA GCCTCTCAAG GAAAAGTAAA AGCGTCCCCC TACCGTTCCT 179 TAAGACTCTA CTAGACTCGT TTTTGTGTGA TGAGACCAAC GAACCTAATG CTCTGATACC 18161 |||||||||| ||||||| || | |||||||| |||||||||| |||||||||| |||||||||| TAAGACTCTA CTAGACTTGT TCTTGTGTGA TGAGACCAAC GAACCTAATG CTCTGATACC 239 AAG-TTTGTC ACGACCCAAA TTCGGGCCGC GACTGGCACC CACATTTACC CTTCTATGTG 18102 ||| |||||| |||||||||| | |||||||| ||||||||| |||| ||||| || ||||||| AAGTTTTGTC ACGACCCAAA TCCGGGCCGC CACTGGCACC CACACTTACC CTCCTATGTG 299 AGCGAACCAA CCAATCTAAA CCTTAACATT TCAATATAAT ATCAGCAGAA AATAATGCGG 18042 |||||||||| |||||||||| |||||||||| ||||| |||| | || ||||| | |||||||| AGCGAACCAA CCAATCTAAA CCTTAACATT TCAATGTAAT AGCAACAGAA AGTAATGCGG 359 AAGACTTAAA CTCGTTTATA AAA--AA-AA CCA-AATCAA TAACTAT-TA T--TCCCCAA 17989 |||||||||| ||| || ||| ||| || || | | || | ||| || || | | ||||| AAGACTTAAA CTCATTAATA AAATCAATAA CTACTATTAT TAAACATCTA TTATTCCCAA 419 AATTTGGAAG TCATCATCAC AAGAACATCT ATGATCAAAT TACTAA--CT AAAAATGCCT 17931 || |||||| |||||||||| |||||||||| | | ||| |||||| || || | | || AACCTGGAAG TCATCATCAC AAGAACATCT A-CTTTAAAC TACTAATTCT AAGAGTTTCT 478 AAGAAGCT-A AAAA-TACAT AAGAAGCTAG TCCATGCCGG AAGTTCAAGG CATCAAGACT 17873 |||||||| | |||| ||||| |||||||||| |||||||||| |||||||||| ||||||||| AAGAAGCTAA AAAATTACAT AAGAAGCTAG TCCATGCCGG AAGTTCAAGG CATCAAGACA 538 TGAAGAAGAA GCTCCAGTCC AAGCTAGAAG CATTAGCTCA CCCTGAATTT CCGATGT-AG 17814 ||||| |||| | |||||||| |||||||||| | |||||||| ||||||| | ||| ||| | TGAAGGAGAA GATCCAGTCC AAGCTAGAAG CGTTAGCTCA CCCTGAAGAT CCGGTGTGAC 598 TAAGACTGGC TTGAATTACT GTTGAGTCGA AGACGACGGC ACGTTTGCTA CACTCCACAA 17754 ||||||||| |||| ||||| |||||||||| ||| |||||| ||||||||| |||||||||| GAAGACTGGC TTGAGTTACT GTTGAGTCGA AGATGACGGC ACGTTTGCTG CACTCCACAA 658 ATAACAAAGA AGAAAACATA AAAGTAGGGG TCAGTACAAA GCACGGGTAC TGAGTAGATA 17694 ||| ||| | |||||||| |||||||||| |||||||||| ||||| ||| |||||||||| ATACCAAGAA GAAAAACATA AAAGTAGGGG TCAGTACAAA ACACGGCTAC TGAGTAGATA 718 TCATCGGCCA A 17683 |||||||||| | TCATCGGCCA A 729 hqPGS_C01HBa0088L02.1-_SGN-E351546- (18400 17683) ******************************************************************************** EST sequence 88 -strand 655 n (File: SGN-E356696-) 1 CAATTGGACT CAAGTAGTAG CACGAAAGAA AGAATGAAAG AGTGAAGTTT TCCTAAAGTC 61 TTATAGCCTC TCAAGGAAAA GTAAAAGCGT CCCCCTACCG TTCCTTAAGA CTCTACTAGA 121 CTTGTTCTTG TGTGATGAGA CCAACGAACC TAATGCTCTG ATACCAAGTT TTGTCACGAC 181 CCAAATCCGG GCCGCCACTG GCACCCACAC TTACCCTCNT ATGTGAGCGA ACCAACCAAT 241 CTAAACCTTA ACATTTCAAT GTAATAGCAA CAGAAAGTAA TGCGGAAGAC TTAAACTCAT 301 TAATAAAATC AATAACTACT ATTATTAAAC ATCTATTATT CCCAAAACCT GGAAGTCATC 361 ATCACAAGAA CATCTACTTT AAACTACTAA TTCTAAGAGT TTCTAAGAAG CTAAAAAATT 421 ACATAAGAAG CTAGTCCATG CCGGAAGTTC AAGGCATCAA GACATGAAGG AGAAGATCCA 481 GTCCAAGCTA GAAGCGTTAG CTCACCCTGA AGATCCGGTG TGACGAAGAC TGGCTTGAGT 541 TACTGTTGAG TCGAAGATGA CGGCACGTTT GCTGCACTCC ACAAATAACA AGAAGAAAAA 601 CATAAAAGTA GGGGTCAGTA CAAAACACGG CTACTGAGTA GATATCATCG GCCAA Predicted gene structure (within gDNA segment 19151 to 17083): Exon 1 18325 17683 ( 643 n); cDNA 1 655 ( 655 n); score: 0.862 MATCH C01HBa0088L02.1- SGN-E356696- 0.862 643 0.982 C PGS_C01HBa0088L02.1-_SGN-E356696- (18325 17683) Alignment (genomic DNA sequence = upper lines): CAATTGGATT CAAGTAGTAG CACAAAAGAA AGAATGAAAG AATGGAATTT TCCTAAAGTC 18266 |||||||| | |||||||||| ||| |||||| |||||||||| | || | ||| |||||||||| CAATTGGACT CAAGTAGTAG CACGAAAGAA AGAATGAAAG AGTGAAGTTT TCCTAAAGTC 60 TTATAGCCTC TCAAAGAAAA GTAAAGGCGT CCCCCTACCG TTCCTTAAGA CTCTACTAGA 18206 |||||||||| |||| ||||| ||||| |||| |||||||||| |||||||||| |||||||||| TTATAGCCTC TCAAGGAAAA GTAAAAGCGT CCCCCTACCG TTCCTTAAGA CTCTACTAGA 120 CTCGTTTTTG TGTGATGAGA CCAACGAACC TAATGCTCTG ATACCAAG-T TTGTCACGAC 18147 || ||| ||| |||||||||| |||||||||| |||||||||| |||||||| | |||||||||| CTTGTTCTTG TGTGATGAGA CCAACGAACC TAATGCTCTG ATACCAAGTT TTGTCACGAC 180 CCAAATTCGG GCCGCGACTG GCACCCACAT TTACCCTTCT ATGTGAGCGA ACCAACCAAT 18087 |||||| ||| ||||| |||| ||||||||| ||||||| | |||||||||| |||||||||| CCAAATCCGG GCCGCCACTG GCACCCACAC TTACCCTCNT ATGTGAGCGA ACCAACCAAT 240 CTAAACCTTA ACATTTCAAT ATAATATCAG CAGAAAATAA TGCGGAAGAC TTAAACTCGT 18027 |||||||||| |||||||||| ||||| || |||||| ||| |||||||||| |||||||| | CTAAACCTTA ACATTTCAAT GTAATAGCAA CAGAAAGTAA TGCGGAAGAC TTAAACTCAT 300 TTATAAAA-- AA-AACCA-A ATCAATAACT AT-TA-T-TC CCCAAAATTT GGAAGTCATC 17974 | |||||| || ||| | || | ||| || || | | ||||||| | |||||||||| TAATAAAATC AATAACTACT ATTATTAAAC ATCTATTATT CCCAAAACCT GGAAGTCATC 360 ATCACAAGAA CATCTATGAT CAAATTACTA A--CTAAAAA TGCCTAAGAA GCT-AAAAA- 17918 |||||||||| |||||| | ||| ||||| | |||| | | ||||||| ||| ||||| ATCACAAGAA CATCTA-CTT TAAACTACTA ATTCTAAGAG TTTCTAAGAA GCTAAAAAAT 419 TACATAAGAA GCTAGTCCAT GCCGGAAGTT CAAGGCATCA AGACTTGAAG AAGAAGCTCC 17858 |||||||||| |||||||||| |||||||||| |||||||||| |||| ||||| ||||| ||| TACATAAGAA GCTAGTCCAT GCCGGAAGTT CAAGGCATCA AGACATGAAG GAGAAGATCC 479 AGTCCAAGCT AGAAGCATTA GCTCACCCTG AATTTCCGAT GT-AGTAAGA CTGGCTTGAA 17799 |||||||||| |||||| ||| |||||||||| || |||| | || | |||| ||||||||| AGTCCAAGCT AGAAGCGTTA GCTCACCCTG AAGATCCGGT GTGACGAAGA CTGGCTTGAG 539 TTACTGTTGA GTCGAAGACG ACGGCACGTT TGCTACACTC CACAAATAAC AAAGAAGAAA 17739 |||||||||| |||||||| | |||||||||| |||| ||||| |||||||||| || | ||| TTACTGTTGA GTCGAAGATG ACGGCACGTT TGCTGCACTC CACAAATAAC AAGAAGAAAA 599 ACATAAAAGT AGGGGTCAGT ACAAAGCACG GGTACTGAGT AGATATCATC GGCCAA 17683 |||||||||| |||||||||| ||||| |||| | |||||||| |||||||||| |||||| ACATAAAAGT AGGGGTCAGT ACAAAACACG GCTACTGAGT AGATATCATC GGCCAA 655 hqPGS_C01HBa0088L02.1-_SGN-E356696- (18325 17683) ******************************************************************************** EST sequence 80 -strand 580 n (File: SGN-E356206-) 1 GAAAAGTAAA AGCGTCCCCN TACCGTCCCT TAAGACTCTA CTAGACTTGT TCTTGTGTGA 61 TGAGACCAAC GACCCTAATG CTCTGATACC AAGTTTTGTC ACGACCCAAA TCCGGGCCGC 121 CACTGGCACC CACACTTACC CTCCTATGTG AGCGAACCAA CCAATCTAAA CCTTAACATT 181 TCAATGTAAT AGCAACAGAA AGTAATGCGG AAGACTTAAA CTCATTAATA AAATCAATAA 241 CTACTATTAT TAAACATCTA TTATTCCCAA AACCTGGAAG TCATCATCAC AAGAACATCT 301 ACTTTAAACT ACTAATTCTA AGAGTTTCTA AGAAGCTAAA AAATTACATA AGAAGCTAGT 361 CCATGCCGGA AGTTCAAGGC ATCAAGACAT GAAGGAGAAG ATCCAGTCCA AGCTAGAAGC 421 GTTAGCTCAC CCTGAAGATC CGGTGTGACG AAGACTGGCT TGAGTTACTG TTGAGTCGAA 481 GATGACGGCA CGTTTGCTGC ACTCCACAAA TAACAAGAAG AAAAACATAA AAGTAGGGGT 541 CAGTACAAAA CACGGCTACT GAGTAGATAT CATCGGCCAA Predicted gene structure (within gDNA segment 19103 to 17083): Exon 1 18250 17683 ( 568 n); cDNA 1 580 ( 580 n); score: 0.851 MATCH C01HBa0088L02.1- SGN-E356206- 0.851 568 0.979 C PGS_C01HBa0088L02.1-_SGN-E356206- (18250 17683) Alignment (genomic DNA sequence = upper lines): GAAAAGTAAA GGCGTCCCCC TACCGTTCCT TAAGACTCTA CTAGACTCGT TTTTGTGTGA 18191 |||||||||| |||||||| |||||| ||| |||||||||| ||||||| || | |||||||| GAAAAGTAAA AGCGTCCCCN TACCGTCCCT TAAGACTCTA CTAGACTTGT TCTTGTGTGA 60 TGAGACCAAC GAACCTAATG CTCTGATACC AAG-TTTGTC ACGACCCAAA TTCGGGCCGC 18132 |||||||||| || ||||||| |||||||||| ||| |||||| |||||||||| | |||||||| TGAGACCAAC GACCCTAATG CTCTGATACC AAGTTTTGTC ACGACCCAAA TCCGGGCCGC 120 GACTGGCACC CACATTTACC CTTCTATGTG AGCGAACCAA CCAATCTAAA CCTTAACATT 18072 ||||||||| |||| ||||| || ||||||| |||||||||| |||||||||| |||||||||| CACTGGCACC CACACTTACC CTCCTATGTG AGCGAACCAA CCAATCTAAA CCTTAACATT 180 TCAATATAAT ATCAGCAGAA AATAATGCGG AAGACTTAAA CTCGTTTATA AAA--AA-AA 18015 ||||| |||| | || ||||| | |||||||| |||||||||| ||| || ||| ||| || || TCAATGTAAT AGCAACAGAA AGTAATGCGG AAGACTTAAA CTCATTAATA AAATCAATAA 240 CCA-AATCAA TAACTAT-TA -T-TCCCCAA AATTTGGAAG TCATCATCAC AAGAACATCT 17959 | | || | ||| || || | | ||||| || |||||| |||||||||| |||||||||| CTACTATTAT TAAACATCTA TTATTCCCAA AACCTGGAAG TCATCATCAC AAGAACATCT 300 ATGATCAAAT TACTAA--CT AAAAATGCCT AAGAAGCT-A AAAA-TACAT AAGAAGCTAG 17903 | | ||| |||||| || || | | || |||||||| | |||| ||||| |||||||||| A-CTTTAAAC TACTAATTCT AAGAGTTTCT AAGAAGCTAA AAAATTACAT AAGAAGCTAG 359 TCCATGCCGG AAGTTCAAGG CATCAAGACT TGAAGAAGAA GCTCCAGTCC AAGCTAGAAG 17843 |||||||||| |||||||||| ||||||||| ||||| |||| | |||||||| |||||||||| TCCATGCCGG AAGTTCAAGG CATCAAGACA TGAAGGAGAA GATCCAGTCC AAGCTAGAAG 419 CATTAGCTCA CCCTGAATTT CCGATGT-AG TAAGACTGGC TTGAATTACT GTTGAGTCGA 17784 | |||||||| ||||||| | ||| ||| | ||||||||| |||| ||||| |||||||||| CGTTAGCTCA CCCTGAAGAT CCGGTGTGAC GAAGACTGGC TTGAGTTACT GTTGAGTCGA 479 AGACGACGGC ACGTTTGCTA CACTCCACAA ATAACAAAGA AGAAAACATA AAAGTAGGGG 17724 ||| |||||| ||||||||| |||||||||| ||||||| | |||||||| |||||||||| AGATGACGGC ACGTTTGCTG CACTCCACAA ATAACAAGAA GAAAAACATA AAAGTAGGGG 539 TCAGTACAAA GCACGGGTAC TGAGTAGATA TCATCGGCCA A 17683 |||||||||| ||||| ||| |||||||||| |||||||||| | TCAGTACAAA ACACGGCTAC TGAGTAGATA TCATCGGCCA A 580 hqPGS_C01HBa0088L02.1-_SGN-E356206- (18250 17683) ******************************************************************************** EST sequence 124 +strand 679 n (File: SGN-E370357+) 1 TTTTTTTTTT CTTACAATTA TATTATGAAT TCGATAATCT TTAATGTCAC GACCCAAATC 61 GAGCCGCAAG TGGCACCCAC ACTTACCCTC CTATGTGAGC GAACCAACCA ATACAAAATC 121 CAACATTTCA ATATAATGAC GGAATATAAT GCGGAAGACT TAAACTCATT AATGAAAATC 181 AATTAAATAA CTTCTAAAAA CTCAACAACT ATTATTATCC CCAAAATCTG GAAGTCATCA 241 TCACAAGAAC ATCTATCCTC AAATTACTAA TTCTAAGAGT ATCTAGAAAG CTAGAATAAC 301 TAAAAAGCTA GTCCATGCCG GAACTTCAAG GCATCAAGAC ATGAAGAAGA AGATCCAGTC 361 CAAGCTAGAA GCGTTAGCTC ACACTGAAAT CCGGTATAAT GAAGACTGGC TAGAGTTGCG 421 GTTGAGTTGA AGACGACGGT ACGTTTGCTT TATTCGAGTG TCAATTAATC ATTCGGCTGT 481 CACCCAAATA TTATTGATTG ATTACACCTC TGCCATTTGT AAAATTTTTC AAATTTGCCT 541 ACGGATGCAG AATTTTCCTC GAATTTCTGA TGTGTTTTCT TGTAAATAGT GGCCATTTGT 601 GTAAGTAAAT GCCCATTTCT CCTCCTACAA AGTCCAATTC CATTTTTCCC CCAATCCACC 661 ATGGCAACAC CACCTCCAA Predicted gene structure (within gDNA segment 19608 to 14162): Exon 1 18155 17754 ( 402 n); cDNA 45 460 ( 416 n); score: 0.731 Intron 1 17753 16000 (1754 n); Pd: 0.000 (s: 0.74), Pa: 0.000 (s: 0.57) Exon 2 15999 15954 ( 46 n); cDNA 461 505 ( 45 n); score: 0.565 Intron 2 15953 15859 ( 95 n); Pd: 0.970 (s: 0.57), Pa: 0.932 (s: 0) Exon 3 15858 15854 ( 5 n); cDNA 506 510 ( 5 n); score: 1.000 Intron 3 15853 15516 ( 338 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 4 15515 15500 ( 16 n); cDNA 511 526 ( 16 n); score: 0.875 Intron 4 15499 15209 ( 291 n); Pd: 0.810 (s: 0), Pa: 0.000 (s: 0) Exon 5 15208 15200 ( 9 n); cDNA 527 535 ( 9 n); score: 0.889 PPA cDNA 13 1 MATCH C01HBa0088L02.1- SGN-E370357+ 0.731 478 0.704 C PGS_C01HBa0088L02.1-_SGN-E370357+ (18155 17754,15999 15954,15858 15854,15515 15500,15208 15200) Alignment (genomic DNA sequence = upper lines): TGTCACGACC CAAATTCGGG CCGCGACTGG CACCCACATT TACCCTTCTA TGTGAGCGAA 18096 |||||||||| |||| ||| | |||| | ||| |||||||| | |||||| ||| |||||||||| TGTCACGACC CAAA-TCGAG CCGCAAGTGG CACCCACACT TACCCTCCTA TGTGAGCGAA 103 CCAACCAATC TAAACCTTAA CATTTCAATA TAATATCAGC AGAAAATAAT GCGGAAGACT 18036 ||||||||| ||| || |||||||||| | | || | | ||| ||||| |||||||||| CCAACCAATA CAAAATCCAA CATTTCAATA T-A-ATGA-C GGAATATAAT GCGGAAGACT 160 TAAACTCGTT TAT--AAA-- AA--AAA--- C--C---AAA -TCAATAACT ATTA-T-TCC 17993 ||||||| || || ||| || ||| | | ||| |||| |||| |||| | ||| TAAACTCATT AATGAAAATC AATTAAATAA CTTCTAAAAA CTCAACAACT ATTATTATCC 220 CCAAAATTTG GAAGTCATCA TCACAAGAAC ATCTATGATC AAATTACTAA --CTAAAAAT 17935 ||||||| || |||||||||| |||||||||| |||||| || |||||||||| |||| | | CCAAAATCTG GAAGTCATCA TCACAAGAAC ATCTATCCTC AAATTACTAA TTCTAAGAGT 280 GCCTAAGAAG CTAAAAATAC ATAAGAAGCT AGTCCATGCC GGAAGTTCAA GGCATCAAGA 17875 ||| ||| || | |||| ||| ||||| |||||||||| |||| ||||| |||||||||| ATCTAGAAAG CT-AGAATAA CTAAAAAGCT AGTCCATGCC GGAACTTCAA GGCATCAAGA 339 CTTGAAGAAG AAGCTCCAGT CCAAGCTAGA AGCATTAGCT CACCCTGAAT TTCCGATGTA 17815 | |||||||| ||| |||||| |||||||||| ||| |||||| ||| ||||| |||| | || CATGAAGAAG AAGATCCAGT CCAAGCTAGA AGCGTTAGCT CACACTGAA- ATCCGGTATA 398 GT-AAGACTG GCTTGAATTA CTGTTGAGTC GAAGACGACG GCACGTTTGC TACACTCCAC 17756 | ||||||| ||| || || | ||||||| |||||||||| | |||||||| | | || | ATGAAGACTG GCTAGAGTTG CGGTTGAGTT GAAGACGACG GTACGTTTGC TTTATTCGAG 458 AAATAACAAA GAAGAAAACA TAAAAGTAGG GGTCAGTACA AAGCACGGGT ACTGAGTAGA 17696 TG........ .......... .......... .......... .......... .......... 460 TATCATCGGC CAACTCAAAA TAGAAAACAG TATATACCAA GTAATATCAT AAACTCAACT 17636 .......... .......... .......... .......... .......... .......... 460 ATGATACTCA ACATGTAGCA ACAACAAGTA CTATATCATT AACAATTTCC GTCAAGTTCA 17576 .......... .......... .......... .......... .......... .......... 460 CACATGAGGA CTCAAGCCTC AATACCATAC TCATTTGGGA ATTATGTTCA TTAGATTGAG 17516 .......... .......... .......... .......... .......... .......... 460 TATATTAACA TCTTTTAAGA TTCATTATCT TTATTTCTCT TGTGTCGGTA CGTGACACTC 17456 .......... .......... .......... .......... .......... .......... 460 CGCTCCCTTA TATTCATTAA TCCTCTTGTG TCGGTACGTG ACACTCCGAT CCCCTACTAC 17396 .......... .......... .......... .......... .......... .......... 460 TATGTGTCGA AACGTGACAC TCCGATCCCC TAAATTCTAC GTGTCGGTTC GTGACACCCG 17336 .......... .......... .......... .......... .......... .......... 460 ATCTCCTAAA TCTACGTGTC GGTTCGTGAC ACCCGATCCC CTAATTCTAC GTGTCGGTTC 17276 .......... .......... .......... .......... .......... .......... 460 GTGACACCCG GTCCCCTAAT TCTACGTGTC GGTTCGTAAC ACCCGATCCC CTAATCTCAT 17216 .......... .......... .......... .......... .......... .......... 460 TCTATCAATT CATCAAGCCT TCTCCCTTAC CAAGGCATCA TCAATCTCAT TACTTTAGTT 17156 .......... .......... .......... .......... .......... .......... 460 CATCAAGCCT TATCCCTTAC AAAGGCATCA TCATTAAAAA GAGATTAGGT TTTTATCAAG 17096 .......... .......... .......... .......... .......... .......... 460 ATTTGGGATT CGATAGCTTC ATCATGCTTA ATATAATCAC AATTATATAA TCACGTTCAT 17036 .......... .......... .......... .......... .......... .......... 460 GCAAGCATAC AATTAAGCAC ATAGCAGGGT TTACAATACT ATCAATACAT ATCATTCGCT 16976 .......... .......... .......... .......... .......... .......... 460 ATTAAGAGTT TACTACGAAT AGTATGAAAA CCATAACCTA CCTTCACCGA AGAATTGCGA 16916 .......... .......... .......... .......... .......... .......... 460 TCAACAAGCT ATCTTCTCAA AATCCTTGCT ATCCTCTTCG TTTCTCTCTC TCTACTCGTT 16856 .......... .......... .......... .......... .......... .......... 460 CTCTTTCTTT TTCTGTCTCT CTTTGTTCTT TCTATTTTTC TTATTCAAAC CCTCTTTCTT 16796 .......... .......... .......... .......... .......... .......... 460 TTACCCTAAT TAACATATAA TCAAGTGTAA AAGATGGCAA TAATAACCCA CTAATTAACT 16736 .......... .......... .......... .......... .......... .......... 460 TAAGGTTACC TCTTTTAACC CCCAAGTAAT TAGACTTATT AACATTAACC CCCTAACTTT 16676 .......... .......... .......... .......... .......... .......... 460 ATAATTTAAG CAGGAATAGT CAAAAACGTC CCTTAAAACG TATAAAGAAA TCCGACCCGG 16616 .......... .......... .......... .......... .......... .......... 460 ACTGGGATTG CGCAACCTGT GATGGGCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG 16556 .......... .......... .......... .......... .......... .......... 460 TCGCAAAGTT CAGAGACCCA AATTTCCACC AAGGGTCTGT GACGGTCCGT CCTGCCATTT 16496 .......... .......... .......... .......... .......... .......... 460 CGTTACGAAG TTCAGAGAGT CGATTTCAGC ACCCAATTTT TAGATTTTCT AAGTGTTTTG 16436 .......... .......... .......... .......... .......... .......... 460 AAACGAGAAC CTGCGACGGT CCGTCGTGCC CATGACGGTC CGTCGTGGGG TCCGTCGCCT 16376 .......... .......... .......... .......... .......... .......... 460 CAGTCTGTTT TTCCAGAAAT AAAATCTGCT GCTCAAAACG ACTAAACAGG TCGTTACAAT 16316 .......... .......... .......... .......... .......... .......... 460 TTATTGTTAG TTATGTCAAA TTATTGTGGA ATGGAGAAGA AGTCAAATAC CATGCCATGC 16256 .......... .......... .......... .......... .......... .......... 460 ATATAACAAG TTTGGGTGGT TTTACCTAAT TTGCATCATT AGTAGATCTA TCAAGTGCAA 16196 .......... .......... .......... .......... .......... .......... 460 ATAACCATGA AAGTAATAAT TTATGTGCTT TTGTTGTTCA TGATCTTTGC AATTGAGTTG 16136 .......... .......... .......... .......... .......... .......... 460 CTAGAACTAA TAGAGCTTTC TTTCTTTGCA GGGCAATCAT ACAATGTTAA TTTTTTAGAC 16076 .......... .......... .......... .......... .......... .......... 460 AAAATTACTA ATATTAGAAA GAAAGAAAAA AAACACTGCA ATTGCAGTTT GATGAGTAGC 16016 .......... .......... .......... .......... .......... .......... 460 TTAGATGGTT GGGCAGCCCA ACAATCATTT TGTCATGGAC TCAATGAAAA GAGAATGATC 15956 | | ||||| || | | || ||| | | || |||| .......... ......TCAA TTAATCA-TT CGGCTGTCAC CCAAATATTA TTGATTGATT 503 ACGCAAGTAT ATCTCAATGA GTAAATAGTA AAGTTAATAG ATACAATACC TGCTAATTTC 15896 || AC........ .......... .......... .......... .......... .......... 505 GAAAGATGGT TGTTGAACGA CTCTACTGCA TATGTAGACC TCAGGCCAAC CAATTGCACA 15836 ||| || .......... .......... .......... .......ACC TC........ .......... 510 AGTTTGTATT TGACACAGAT GACATATGAC AAATATATTA CATAATAGAA GTTCAATATA 15776 .......... .......... .......... .......... .......... .......... 510 AGTAGGTCCG TTTCAATTGA GGCTTAGACA TAACCTAAGG AATTAGAGAA ATATATGTTA 15716 .......... .......... .......... .......... .......... .......... 510 TTTTAGTGGA ATAATTCTTG TCCCAATTAA TTTGGAGATG AAGATTTTTA CCAGAATAAT 15656 .......... .......... .......... .......... .......... .......... 510 AAAAGAAAAC AAAGGACAAC GAACTACAAA AATGTATATG TATAATATCA GTTATATACA 15596 .......... .......... .......... .......... .......... .......... 510 ATTATATACA TATGCAATTC ACCTCTCTCC CACTCTCAGC GCTCTTTGCT CGCCTCTCTG 15536 .......... .......... .......... .......... .......... .......... 510 TTCCCTCTCT CAATCTCGCT TGCCATTTAT AAAAATGTAT ATGTATAATA TCAATTATAT 15476 |||||||| | |||| | .......... .......... TGCCATTTGT AAAATT.... .......... .......... 526 ACAATTATAT ACATATGCAA TTCACCGCTC TTCCACTCTC TGCCCTCTCT CGCACGCGTC 15416 .......... .......... .......... .......... .......... .......... 526 TCTTGATCTC GCTCGCCTCT CTCCTCTCTC TCCCAGTCTC GACTGCCTCT CTCCTCCCTC 15356 .......... .......... .......... .......... .......... .......... 526 TCCCAATCTC TTGCCATATA TACAATTACA TATGTATGAT ATACAATTAT CTAACCAGAA 15296 .......... .......... .......... .......... .......... .......... 526 TACATATACA ATTTACCTTT CCCCCTCTCT CGCCTCTCTC CTCTCTCTCC CAGTCTCGCT 15236 .......... .......... .......... .......... .......... .......... 526 CGCCGCTCTT CTCCATATAA CATGTAGTTA CAAATT 15200 || |||||| .......... .......... .......TTT CAAATT 535 hqPGS_C01HBa0088L02.1-_SGN-E370357+ (18155 17754) ******************************************************************************** EST sequence 126 +strand 434 n (File: SGN-E222578+) 1 TTTTTTTTTT TTTTTTTTTA ATAAAAACCA ATTCAATAAC TATCAATATT CAACATCTAT 61 TATTCCCAAA ACCTGGAAGT CATCATCACA AGAACATCTA CTTTAAACTA CTAATTCTAA 121 GAGTTTCTAA AAGCTAAAAA TACATAAGAA GCTAGTCCAT GCCGGAGGTT CAAGGCATCA 181 AGACATGAAG GAGAAGATCC AGTCCAAGCT AGACGCGTTA GCTCACCCTG AAGATCCGGT 241 GTGACGAAGA CTGGCTTGAG TTACTGTTGA GTCGAAGATG ACGGCACGTT TGCTGCACTC 301 CACAACTTTC TAGATGGGGA CTTTCTTCAA GGCTTCGAGA TGGAAACTTG CTTGCAGAGC 361 TTCGAGTGTT ACCAGCTTCA AGATGGAGTT TCAGTGATGA GGCTTGCTAG TCTCGAGTTT 421 TTTTTTTTTT TTTT Predicted gene structure (within gDNA segment 19827 to 15025): Exon 1 18001 17754 ( 248 n); cDNA 58 305 ( 248 n); score: 0.861 PPA cDNA 19 1 MATCH C01HBa0088L02.1- SGN-E222578+ 0.861 248 0.571 C PGS_C01HBa0088L02.1-_SGN-E222578+ (18001 17754) Alignment (genomic DNA sequence = upper lines): TATTATTCCC CAAAATTTGG AAGTCATCAT CACAAGAACA TCTATGATCA AATTACTAA- 17943 ||||||| || ||||| ||| |||||||||| |||||||||| |||| | | || |||||| TATTATT-CC CAAAACCTGG AAGTCATCAT CACAAGAACA TCTA-CTTTA AACTACTAAT 115 -CTAAAAATG CCTAAGAAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG 17884 |||| | | |||| |||| |||||||||| |||||||||| |||||||||| || ||||||| TCTAAGAGTT TCTAA-AAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAGGTTCAAG 174 GCATCAAGAC TTGAAGAAGA AGCTCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT 17824 |||||||||| ||||| ||| || ||||||| ||||||||| || ||||||| |||||||| GCATCAAGAC ATGAAGGAGA AGATCCAGTC CAAGCTAGAC GCGTTAGCTC ACCCTGAAGA 234 TCCGATGT-A GTAAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT 17765 |||| ||| | |||||||| ||||| |||| |||||||||| |||| ||||| |||||||||| TCCGGTGTGA CGAAGACTGG CTTGAGTTAC TGTTGAGTCG AAGATGACGG CACGTTTGCT 294 ACACTCCACA A 17754 ||||||||| | GCACTCCACA A 305 hqPGS_C01HBa0088L02.1-_SGN-E222578+ (18001 17754) ******************************************************************************** EST sequence 194 +strand 840 n (File: SGN-E542084+) 1 TTTTTTTTTT TAGGGGAAAA TTTCTTACTT CTATAAATGT CACGACCCAA ATCGGATCGC 61 GACTGGCACC CACACTTACC CTGCTATGTG AGCGAACCAA CCAATCCAAA CCTTAACATT 121 TCAATGTAAT ATCAACATAA AGTAATGCGG AAGACTTAAA CTTATTAATG AAAACCAATT 181 CAATAACTAT TATTTCCCAA AATCTGGAAG TCATCATCAT AAGAACATCT ACTTCAAATT 241 ACTAAATCTA AGAGTTTCTA AGAAGCTAAA AAATACATAA AAGCTAGTCC ATGCCGGAAC 301 TTCAAGACAT CAAGACATGA AGAGGAAGAT CCAGTCCAAT CTAGAAAGCA TTAGCTCACC 361 CTGATATCCG AAGTAATGAA GACTGGCTAG AGTTACTGTT GAGTCGAAGA TGACGGCACG 421 TTTGCTAAAA TCAGTGGACG GAGGAGAAGG GAAAGCACAC CGGGAATGAG AAGAAGCTGA 481 AGGAGGAACC AAAGAGGAAT CCCATTGCAA AGTAAATGAG AGTGTAAGCT AGCAGACGCG 541 ATGGAAGAGC TTACGCAGAA ATAACACTCT CATTTGGTGA TTTAGTTTGG AGATCATCTG 601 AGACCTTCGT GTTGGACAAC ATCATCCATG AAGATGTCAT TAGAAAAGTT AGATGCTTTA 661 TATACATGTT GATAGTTCCT GACTACTCTA TTTCTTTTTC AGAAAGCCCC GAAATTTCTC 721 AGATGATAAA TGCTGTCTGT TTTGGAAAAC CATCTCTATG CAAAGATGAT GTTTGCTGCA 781 TTGAGGTGTC AATATTGGGA ATTTCAAGAA AATTATGCCT TGTAGAATAT GTACAGCAAC Predicted gene structure (within gDNA segment 19304 to 12424): Exon 1 18155 17762 ( 394 n); cDNA 38 429 ( 392 n); score: 0.862 Intron 1 17761 14880 (2882 n); Pd: 0.000 (s: 0.92), Pa: 0.999 (s: 0) Exon 2 14879 14874 ( 6 n); cDNA 430 435 ( 6 n); score: 0.500 Intron 2 14873 13563 (1311 n); Pd: 0.000 (s: 0), Pa: 0.999 (s: 0) Exon 3 13562 13557 ( 6 n); cDNA 436 441 ( 6 n); score: 1.000 PPA cDNA 11 1 MATCH C01HBa0088L02.1- SGN-E542084+ 0.862 406 0.483 C PGS_C01HBa0088L02.1-_SGN-E542084+ (18155 17762,14879 14874,13562 13557) Alignment (genomic DNA sequence = upper lines): TGTCACGACC CAAATTCGGG CCGCGACTGG CACCCACATT TACCCTTCTA TGTGAGCGAA 18096 |||||||||| |||| |||| ||||||||| |||||||| | |||||| ||| |||||||||| TGTCACGACC CAAA-TCGGA TCGCGACTGG CACCCACACT TACCCTGCTA TGTGAGCGAA 96 CCAACCAATC TAAACCTTAA CATTTCAATA TAATATCAGC AGAAAATAAT GCGGAAGACT 18036 |||||||||| ||||||||| ||||||||| |||||||| | | ||| |||| |||||||||| CCAACCAATC CAAACCTTAA CATTTCAATG TAATATCAAC ATAAAGTAAT GCGGAAGACT 156 TAAACTCGTT TATAAAAAAA ACCAAATCAA TAACTATTAT TCCCCAAAAT TTGGAAGTCA 17976 |||||| | | ||| ||| ||||| |||| |||||||||| | |||||||| ||||||||| TAAACT--TA T-TAATGAAA ACCAATTCAA TAACTATTAT TTCCCAAAAT CTGGAAGTCA 213 TCATCACAAG AACATCTATG ATCAAATTAC T-AA-CTAAA AATGCCTAAG AAGCT-AAAA 17919 |||||| ||| |||||||| ||||||||| | || |||| | | ||||| ||||| |||| TCATCATAAG AACATCTA-C TTCAAATTAC TAAATCTAAG AGTTTCTAAG AAGCTAAAAA 272 ATACATAAGA AGCTAGTCCA TGCCGGAAGT TCAAGGCATC AAGACTTGAA GAAGAAGCTC 17859 |||||||| | |||||||||| |||||||| | ||||| |||| ||||| |||| || |||| || ATACATAA-A AGCTAGTCCA TGCCGGAACT TCAAGACATC AAGACATGAA GAGGAAGATC 331 CAGTCCAAGC TAG-AAGCAT TAGCTCACCC TGAATTTCCG ATGTAGT-AA GACTGGCTTG 17801 |||||||| | ||| |||||| |||||||||| || || |||| | ||| | || |||||||| | CAGTCCAATC TAGAAAGCAT TAGCTCACCC TG-ATATCCG AAGTAATGAA GACTGGCTAG 390 AATTACTGTT GAGTCGAAGA CGACGGCACG TTTGCTACAC TCCACAAATA ACAAAGAAGA 17741 | |||||||| |||||||||| ||||||||| ||||||| | AGTTACTGTT GAGTCGAAGA TGACGGCACG TTTGCTAAA. .......... .......... 429 AAACATAAAA GTAGGGGTCA GTACAAAGCA CGGGTACTGA GTAGATATCA TCGGCCAACT 17681 .......... .......... .......... .......... .......... .......... 429 CAAAATAGAA AACAGTATAT ACCAAGTAAT ATCATAAACT CAACTATGAT ACTCAACATG 17621 .......... .......... .......... .......... .......... .......... 429 TAGCAACAAC AAGTACTATA TCATTAACAA TTTCCGTCAA GTTCACACAT GAGGACTCAA 17561 .......... .......... .......... .......... .......... .......... 429 GCCTCAATAC CATACTCATT TGGGAATTAT GTTCATTAGA TTGAGTATAT TAACATCTTT 17501 .......... .......... .......... .......... .......... .......... 429 TAAGATTCAT TATCTTTATT TCTCTTGTGT CGGTACGTGA CACTCCGCTC CCTTATATTC 17441 .......... .......... .......... .......... .......... .......... 429 ATTAATCCTC TTGTGTCGGT ACGTGACACT CCGATCCCCT ACTACTATGT GTCGAAACGT 17381 .......... .......... .......... .......... .......... .......... 429 GACACTCCGA TCCCCTAAAT TCTACGTGTC GGTTCGTGAC ACCCGATCTC CTAAATCTAC 17321 .......... .......... .......... .......... .......... .......... 429 GTGTCGGTTC GTGACACCCG ATCCCCTAAT TCTACGTGTC GGTTCGTGAC ACCCGGTCCC 17261 .......... .......... .......... .......... .......... .......... 429 CTAATTCTAC GTGTCGGTTC GTAACACCCG ATCCCCTAAT CTCATTCTAT CAATTCATCA 17201 .......... .......... .......... .......... .......... .......... 429 AGCCTTCTCC CTTACCAAGG CATCATCAAT CTCATTACTT TAGTTCATCA AGCCTTATCC 17141 .......... .......... .......... .......... .......... .......... 429 CTTACAAAGG CATCATCATT AAAAAGAGAT TAGGTTTTTA TCAAGATTTG GGATTCGATA 17081 .......... .......... .......... .......... .......... .......... 429 GCTTCATCAT GCTTAATATA ATCACAATTA TATAATCACG TTCATGCAAG CATACAATTA 17021 .......... .......... .......... .......... .......... .......... 429 AGCACATAGC AGGGTTTACA ATACTATCAA TACATATCAT TCGCTATTAA GAGTTTACTA 16961 .......... .......... .......... .......... .......... .......... 429 CGAATAGTAT GAAAACCATA ACCTACCTTC ACCGAAGAAT TGCGATCAAC AAGCTATCTT 16901 .......... .......... .......... .......... .......... .......... 429 CTCAAAATCC TTGCTATCCT CTTCGTTTCT CTCTCTCTAC TCGTTCTCTT TCTTTTTCTG 16841 .......... .......... .......... .......... .......... .......... 429 TCTCTCTTTG TTCTTTCTAT TTTTCTTATT CAAACCCTCT TTCTTTTACC CTAATTAACA 16781 .......... .......... .......... .......... .......... .......... 429 TATAATCAAG TGTAAAAGAT GGCAATAATA ACCCACTAAT TAACTTAAGG TTACCTCTTT 16721 .......... .......... .......... .......... .......... .......... 429 TAACCCCCAA GTAATTAGAC TTATTAACAT TAACCCCCTA ACTTTATAAT TTAAGCAGGA 16661 .......... .......... .......... .......... .......... .......... 429 ATAGTCAAAA ACGTCCCTTA AAACGTATAA AGAAATCCGA CCCGGACTGG GATTGCGCAA 16601 .......... .......... .......... .......... .......... .......... 429 CCTGTGATGG GCCGTCGTGC CTGCGACGGT CCGTCCTGCA GGTCGTCGCA AAGTTCAGAG 16541 .......... .......... .......... .......... .......... .......... 429 ACCCAAATTT CCACCAAGGG TCTGTGACGG TCCGTCCTGC CATTTCGTTA CGAAGTTCAG 16481 .......... .......... .......... .......... .......... .......... 429 AGAGTCGATT TCAGCACCCA ATTTTTAGAT TTTCTAAGTG TTTTGAAACG AGAACCTGCG 16421 .......... .......... .......... .......... .......... .......... 429 ACGGTCCGTC GTGCCCATGA CGGTCCGTCG TGGGGTCCGT CGCCTCAGTC TGTTTTTCCA 16361 .......... .......... .......... .......... .......... .......... 429 GAAATAAAAT CTGCTGCTCA AAACGACTAA ACAGGTCGTT ACAATTTATT GTTAGTTATG 16301 .......... .......... .......... .......... .......... .......... 429 TCAAATTATT GTGGAATGGA GAAGAAGTCA AATACCATGC CATGCATATA ACAAGTTTGG 16241 .......... .......... .......... .......... .......... .......... 429 GTGGTTTTAC CTAATTTGCA TCATTAGTAG ATCTATCAAG TGCAAATAAC CATGAAAGTA 16181 .......... .......... .......... .......... .......... .......... 429 ATAATTTATG TGCTTTTGTT GTTCATGATC TTTGCAATTG AGTTGCTAGA ACTAATAGAG 16121 .......... .......... .......... .......... .......... .......... 429 CTTTCTTTCT TTGCAGGGCA ATCATACAAT GTTAATTTTT TAGACAAAAT TACTAATATT 16061 .......... .......... .......... .......... .......... .......... 429 AGAAAGAAAG AAAAAAAACA CTGCAATTGC AGTTTGATGA GTAGCTTAGA TGGTTGGGCA 16001 .......... .......... .......... .......... .......... .......... 429 GCCCAACAAT CATTTTGTCA TGGACTCAAT GAAAAGAGAA TGATCACGCA AGTATATCTC 15941 .......... .......... .......... .......... .......... .......... 429 AATGAGTAAA TAGTAAAGTT AATAGATACA ATACCTGCTA ATTTCGAAAG ATGGTTGTTG 15881 .......... .......... .......... .......... .......... .......... 429 AACGACTCTA CTGCATATGT AGACCTCAGG CCAACCAATT GCACAAGTTT GTATTTGACA 15821 .......... .......... .......... .......... .......... .......... 429 CAGATGACAT ATGACAAATA TATTACATAA TAGAAGTTCA ATATAAGTAG GTCCGTTTCA 15761 .......... .......... .......... .......... .......... .......... 429 ATTGAGGCTT AGACATAACC TAAGGAATTA GAGAAATATA TGTTATTTTA GTGGAATAAT 15701 .......... .......... .......... .......... .......... .......... 429 TCTTGTCCCA ATTAATTTGG AGATGAAGAT TTTTACCAGA ATAATAAAAG AAAACAAAGG 15641 .......... .......... .......... .......... .......... .......... 429 ACAACGAACT ACAAAAATGT ATATGTATAA TATCAGTTAT ATACAATTAT ATACATATGC 15581 .......... .......... .......... .......... .......... .......... 429 AATTCACCTC TCTCCCACTC TCAGCGCTCT TTGCTCGCCT CTCTGTTCCC TCTCTCAATC 15521 .......... .......... .......... .......... .......... .......... 429 TCGCTTGCCA TTTATAAAAA TGTATATGTA TAATATCAAT TATATACAAT TATATACATA 15461 .......... .......... .......... .......... .......... .......... 429 TGCAATTCAC CGCTCTTCCA CTCTCTGCCC TCTCTCGCAC GCGTCTCTTG ATCTCGCTCG 15401 .......... .......... .......... .......... .......... .......... 429 CCTCTCTCCT CTCTCTCCCA GTCTCGACTG CCTCTCTCCT CCCTCTCCCA ATCTCTTGCC 15341 .......... .......... .......... .......... .......... .......... 429 ATATATACAA TTACATATGT ATGATATACA ATTATCTAAC CAGAATACAT ATACAATTTA 15281 .......... .......... .......... .......... .......... .......... 429 CCTTTCCCCC TCTCTCGCCT CTCTCCTCTC TCTCCCAGTC TCGCTCGCCG CTCTTCTCCA 15221 .......... .......... .......... .......... .......... .......... 429 TATAACATGT AGTTACAAAT TGTAATTATC AAGTCATAGC TATATGTGAA AGTTTCCCAT 15161 .......... .......... .......... .......... .......... .......... 429 TAAATATAGA TACAATTAAT AATTTTATAT TATGATTTTA TTTGCACAAA AATCAACAAT 15101 .......... .......... .......... .......... .......... .......... 429 GCAGATAAAA TAATTTTATA TTAAACGACT ATCAAAGAAA ATAATATGAA TTATATCTGG 15041 .......... .......... .......... .......... .......... .......... 429 TGTATGTTTT AGAAAGAATT TGTTTTATGA AATAAGAAAA TATAAATCAA ATAATAATAA 14981 .......... .......... .......... .......... .......... .......... 429 TAATATAATA ATCAAGAAAA GAGAAAAATA TTTCTTTTTA ATACATTCCT AATTCTTATT 14921 .......... .......... .......... .......... .......... .......... 429 CACTTTTTCC TTTTGTAGTT GTCCTTAATT ACTTCCCGTA GCTCATGGTC GTGGGTCAAG 14861 ||| .......... .......... .......... .......... .ATCAGT... .......... 435 AGCCAACTTA GGAGCTACAG ACCATGAACC TACGGACATG CAGGACTGTC AGTAGGTCGT 14801 .......... .......... .......... .......... .......... .......... 435 TCTAAGGCAA AATGTTATAA TGTAGGTGTC TTAAACTAGG CTTCGTTTCA ATTCGCAGTT 14741 .......... .......... .......... .......... .......... .......... 435 TTCAATAACT TTTTTAAAAT ATTAAATTTT TATTTTATCT ACTTTATAAT TAATAGGAAT 14681 .......... .......... .......... .......... .......... .......... 435 TAAATAATAA ACTACTACGT CAATAATTTT TTTCTTAACT TAATTGATTA GAGACACAAG 14621 .......... .......... .......... .......... .......... .......... 435 GAACATAAAT TTTGATGAGC TGGATTGGAG TATTGTCGGG TATACCTTAC TGCACACGCG 14561 .......... .......... .......... .......... .......... .......... 435 TTTTGTTGGT TTTGTGTCTA TCCGATTTTT TCGTACATTT TACTACAATG CTTAATAAAC 14501 .......... .......... .......... .......... .......... .......... 435 AATTTTCCGA TGCGGAGTAT GTTATTAACA AGACTTAAGT CATATGGAGC CCCTTTAAGT 14441 .......... .......... .......... .......... .......... .......... 435 TGTCTGAATA TTTCATTTAA ACGTCTCAAC TTATGTTTGT GCCTATTGGA CAATATATTT 14381 .......... .......... .......... .......... .......... .......... 435 GTTCAAAAAT TATTTTTATT AGACACAAAA TATTGACATG TCAAAAAACG TGTGCTACAC 14321 .......... .......... .......... .......... .......... .......... 435 TCTCTAAAAG GGCATAAAAC TATTGAAATT ATTACTTTTT TTTTTCTAAC TTATATACTA 14261 .......... .......... .......... .......... .......... .......... 435 AAACTAATGA AAAGGGATAA AAAGAATTTA ACTTTTTTTT TGAAAATGTA CTCTTTTTTT 14201 .......... .......... .......... .......... .......... .......... 435 CCCCGCCCAA AATTGCACCC CTGCACTATT TATATTGACC ATCTCCATAA TTTTTCGTAC 14141 .......... .......... .......... .......... .......... .......... 435 ACAAGTGCAC AACCCACCCC ACACCCTCCT GCTCACTCTC TGTCTCTCAC CCTCTCCGGT 14081 .......... .......... .......... .......... .......... .......... 435 TCTTCTTCTT CTTCTAATTT TTTTGTTGTA GATGTTATAT CTTCAATATT TAGGCAAAAA 14021 .......... .......... .......... .......... .......... .......... 435 TCGATTCATT CCGATGGTAA TAATATGAAT TGGTTTTATC AGGCAAAAGT TTATTATTAT 13961 .......... .......... .......... .......... .......... .......... 435 CTATTATAAT TGTGATAAAT GATTACTAAT GAAAAAAAGA CAGAGGTAAC AAGTAGAAAT 13901 .......... .......... .......... .......... .......... .......... 435 TTTGATGCTA TTAAAGTGAA AGATATTGGA TATTTCGCCA TTGTTGATCC GTTTATTATA 13841 .......... .......... .......... .......... .......... .......... 435 TAAAGGAGAA AAGAGTGATT GATCTAATGG GGTAGAAAGA AAAGAATTTG AGTTGATTGG 13781 .......... .......... .......... .......... .......... .......... 435 CAACAATGTA ACTATTAAAG TTTTTTTTTT TTTTTAAAAA AATTAGTCTA AATAATTTAC 13721 .......... .......... .......... .......... .......... .......... 435 CATTTTTAAT TTATGATGAA GAAGAAGAAG TAAAAAAGAC CACGCTGAGG GGCCTAAAAT 13661 .......... .......... .......... .......... .......... .......... 435 TTGATGGGTA CCGTCAACCC TGAAGGTTTG GGTGGGTGGA TTTTTTCGGG ATACAAAATT 13601 .......... .......... .......... .......... .......... .......... 435 TTATTTTACT TTTATCATTA AAATATATTT TAAAACAGGG ACGG 13557 || |||| .......... .......... .......... ........GG ACGG 441 hqPGS_C01HBa0088L02.1-_SGN-E542084+ (18155 17762) ******************************************************************************** EST sequence 252 +strand 710 n (File: SGN-E392027+) 1 CCACAGCCCC AGTGGCTGGC TCAGTCGCAC CCTGTCCCGC CGGTGCTGGT GTTGATGCTG 61 GCGTAGTCGT TGCTCTAGTT CTAACCATCT GCGAAATAGA GTGAAGATGG TCAGATACCA 121 ATTTGTATCA CCTAGATACC AATTGGACCC AAGTAATAGC ACGAAAGAAG AAAGAATGGA 181 ATTTTCCAAA AGTCTTATAG CCTCTCAAGG AAAAGTAAAG GCATCCCCCT ACCGTTCCTT 241 AAGACTCTAC TAGACTCGTT CTTGTGTGAT GAGACCAACG AACCTAATGC TCTGATACCA 301 AGTTTGTCAC GACCAAAACC GGGTTGCGAC TGGCACCCAC ACTTACCCTC CTATGTGAGC 361 GAACCAACCA ATCTAACCTT AACATTTCAA TATAATATCA ACAGAAAGTA ATGTGGAAGA 421 CTTAAACTCA TTAAATACAG ACCAATTCAT TAACTTCTAA AATTCAACAT CTATTATTCC 481 CCAAAATCTG GAAGTCATCA CCACAAGAAC ATCTACGATC AAATGACTAA ACTAAGAGTA 541 GTCTAAAAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 601 TTGAAGAAGA AGATCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT TCCGATGTAG 661 TAAGACTGGC TTGAATTACT GTTGAGTTGA ACACGATGGC ACGTTTGCTG Predicted gene structure (within gDNA segment 19118 to 16947): Exon 1 18462 17765 ( 698 n); cDNA 3 709 ( 707 n); score: 0.872 MATCH C01HBa0088L02.1- SGN-E392027+ 0.872 698 0.983 C PGS_C01HBa0088L02.1-_SGN-E392027+ (18462 17765) Alignment (genomic DNA sequence = upper lines): ACAACCCCAG TGGCTGGCTC AGACGCACCC TGTCCTGCCG GTGCTGGTGT TGGTGTTGGC 18403 ||| |||||| |||||||||| || ||||||| ||||| |||| |||||||||| || || |||| ACAGCCCCAG TGGCTGGCTC AGTCGCACCC TGTCCCGCCG GTGCTGGTGT TGATGCTGGC 62 GTAGTTGTTG CTCTATTTCT AACCATCTGC GAAAGAGAGT GAAGATGGTC AGATACCAAT 18343 ||||| |||| ||||| |||| |||||||||| |||| ||||| |||||||||| |||||||||| GTAGTCGTTG CTCTAGTTCT AACCATCTGC GAAATAGAGT GAAGATGGTC AGATACCAAT 122 TTGTATCACC TAGATACCAA TTGGATTCAA GTAGTAGCAC AAAAGAAAGA ATGAAAGAAT 18283 |||||||||| |||||||||| ||||| ||| ||| |||||| |||||| | |||||||| TTGTATCACC TAGATACCAA TTGGACCCAA GTAATAGCAC ----GAAAGA A-GAAAGAAT 177 GGAATTTTCC TAAAGTCTTA TAGCCTCTCA AAGAAAAGTA AAGGCGTCCC CCTACCGTTC 18223 |||||||||| ||||||||| |||||||||| | |||||||| ||||| |||| |||||||||| GGAATTTTCC AAAAGTCTTA TAGCCTCTCA AGGAAAAGTA AAGGCATCCC CCTACCGTTC 237 CTTAAGACTC TACTAGACTC GTTTTTGTGT GATGAGACCA ACGAACCTAA TGCTCTGATA 18163 |||||||||| |||||||||| ||| |||||| |||||||||| |||||||||| |||||||||| CTTAAGACTC TACTAGACTC GTTCTTGTGT GATGAGACCA ACGAACCTAA TGCTCTGATA 297 CCAAGTTTGT CACGACCCAA ATTCGGGCCG CGACTGGCAC CCACATTTAC CCTTCTATGT 18103 |||||||||| ||||| |||| | |||| | |||||||||| ||||| |||| ||| |||||| CCAAGTTTGT CACGA-CCAA AACCGGGTTG CGACTGGCAC CCACACTTAC CCTCCTATGT 356 GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATATAA TATCAGCAGA AAATAATGCG 18043 |||||||||| |||||||| | |||||||||| |||||||||| ||||| |||| || ||||| | GAGCGAACCA ACCAATCT-A ACCTTAACAT TTCAATATAA TATCAACAGA AAGTAATGTG 415 GAAGACTTAA ACTCGTT-TA TA-A-A--AA ---A--AAC- -C--AAA-TC AATAACTATT 17998 |||||||||| |||| || | || | | || | ||| | ||| || || | ||||| GAAGACTTAA ACTCATTAAA TACAGACCAA TTCATTAACT TCTAAAATTC AACATCTATT 475 ATTCCCCAAA ATTTGGAAGT CATCATCACA AGAACATCTA TGATCAAATT ACT-AACTAA 17939 |||||||||| || ||||||| ||||| |||| |||||||||| |||||||| ||| |||||| ATTCCCCAAA ATCTGGAAGT CATCACCACA AGAACATCTA CGATCAAATG ACTAAACTAA 535 AAAT-GCCTA AGAAGCTAAA AATACATAAG AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT 17880 | | | ||| | |||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAGTAGTCTA A-AAGCTAAA AATACATAAG AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT 594 CAAGACTTGA AGAAGAAGCT CCAGTCCAAG CTAGAAGCAT TAGCTCACCC TGAATTTCCG 17820 |||||||||| |||||||| | |||||||||| |||||||||| |||||||||| |||||||||| CAAGACTTGA AGAAGAAGAT CCAGTCCAAG CTAGAAGCAT TAGCTCACCC TGAATTTCCG 654 ATGTAGTAAG ACTGGCTTGA ATTACTGTTG AGTCGAAGAC GACGGCACGT TTGCT 17765 |||||||||| |||||||||| |||||||||| ||| ||| || || ||||||| ||||| ATGTAGTAAG ACTGGCTTGA ATTACTGTTG AGTTGAACAC GATGGCACGT TTGCT 709 hqPGS_C01HBa0088L02.1-_SGN-E392027+ (18462 17765) ******************************************************************************** EST sequence 26 -strand 299 n (File: SGN-E373117-) 1 TTTTTTTTTT TCTAAAAACT CAACAACTAT TATTATCCCC AAAATCTGGA AGTCATCATC 61 ACAAGAACAT CTACTTCAAA TTACTAAATC TAAGAGTATC TAAGAAGCTA AAATACATAA 121 ACAGCTAGTC CATGCCGGAA CTTCAAGGCA TCAAGACATG AAGAAGAAGA TCCAGTCCAA 181 GCTAGAAGCG TTAGCTCACC CTGAAATCCG ATGTAATGAA GACTGGCTAG AGTTGCGGTT 241 GAGTTGAAGA CGACGGTACG TTTGCCAAAA TTACGACAGT ATTTGGACAA GCTAGAAGA Predicted gene structure (within gDNA segment 19738 to 16142): Exon 1 18027 17776 ( 252 n); cDNA 6 255 ( 250 n); score: 0.835 MATCH C01HBa0088L02.1- SGN-E373117- 0.835 252 0.843 C PGS_C01HBa0088L02.1-_SGN-E373117- (18027 17776) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATTTGGAAGT CATCATCACA 17968 ||| | || |||| || | || | |||| | |||||||| || ||||||| |||||||||| TTTTTTCTAA AAACTCAA-C AACTATTATT A-TCCCCAAA ATCTGGAAGT CATCATCACA 63 AGAACATCTA TGATCAAATT ACT-AA-CTA AAAATGCCTA AGAAGCTAAA AATACATAAG 17910 |||||||||| ||||||| ||| || ||| | | | ||| ||||||| || ||||||||| AGAACATCTA -CTTCAAATT ACTAAATCTA AGAGTATCTA AGAAGCT-AA AATACATAAA 121 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 17850 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCAT TAGCTCACCC TGAATTTCCG ATGTAGT-AA GACTGGCTTG AATTACTGTT 17791 |||||||| | |||||||||| |||| |||| ||||| | || |||||||| | | || | ||| CTAGAAGCGT TAGCTCACCC TGAA-ATCCG ATGTAATGAA GACTGGCTAG AGTTGCGGTT 240 GAGTCGAAGA CGACG 17776 |||| ||||| ||||| GAGTTGAAGA CGACG 255 hqPGS_C01HBa0088L02.1-_SGN-E373117- (18027 17776) ******************************************************************************** EST sequence 172 +strand 299 n (File: SGN-E373116+) 1 TTTTTTTTTT CTAAAAACTC AACAACTATT ATTATCCCCA AAATCTGGAA GTCATCATCA 61 CAAGAACATC TACTTCAAAT TACTAAATCT AAGAGTATCT AAGAAGCTAA AATACATAAA 121 CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCGT TAGCTCACCC TGAAATCCGA TGTAATGAAG ACTGGCTAGA GTTGCGGTTG 241 AGTTGAAGAC GACGGTACGT TTGCCAAAAT TACGACAGTA TTTGGACAAG CTAGAAGAG Predicted gene structure (within gDNA segment 19718 to 16122): Exon 1 18027 17776 ( 252 n); cDNA 5 254 ( 250 n); score: 0.835 MATCH C01HBa0088L02.1- SGN-E373116+ 0.835 252 0.843 C PGS_C01HBa0088L02.1-_SGN-E373116+ (18027 17776) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATTTGGAAGT CATCATCACA 17968 ||| | || |||| || | || | |||| | |||||||| || ||||||| |||||||||| TTTTTTCTAA AAACTCAA-C AACTATTATT A-TCCCCAAA ATCTGGAAGT CATCATCACA 62 AGAACATCTA TGATCAAATT ACT-AA-CTA AAAATGCCTA AGAAGCTAAA AATACATAAG 17910 |||||||||| ||||||| ||| || ||| | | | ||| ||||||| || ||||||||| AGAACATCTA -CTTCAAATT ACTAAATCTA AGAGTATCTA AGAAGCT-AA AATACATAAA 120 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 17850 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 180 CTAGAAGCAT TAGCTCACCC TGAATTTCCG ATGTAGT-AA GACTGGCTTG AATTACTGTT 17791 |||||||| | |||||||||| |||| |||| ||||| | || |||||||| | | || | ||| CTAGAAGCGT TAGCTCACCC TGAA-ATCCG ATGTAATGAA GACTGGCTAG AGTTGCGGTT 239 GAGTCGAAGA CGACG 17776 |||| ||||| ||||| GAGTTGAAGA CGACG 254 hqPGS_C01HBa0088L02.1-_SGN-E373116+ (18027 17776) ******************************************************************************** EST sequence 261 +strand 265 n (File: SGN-E216150+) 1 TTTTTTTTTT TTTTTTTTAA TAAAAATCAA TAATCAACTT GTATAACTCA AAACTTATCA 61 TTCCCCAAAA TCTGGAAGTC ATCATCACCA GAGCCTCTAT CATAAAATTA CTAAACTAAG 121 AGTATTCTAA GAAGCTAAAA ATACATACGA AGCTAGTCCA TGCCGGAAGT TCAAGGCATC 181 AAGACTTGAA GAAGAAGATC CAGTCAAACC TAGAAGCATT AGCTCACCCT GAATTTCCGA 241 TGTAGTAGGA CTGGCTTGAG TTACT Predicted gene structure (within gDNA segment 19792 to 17022): Exon 1 18001 17794 ( 208 n); cDNA 56 265 ( 210 n); score: 0.894 PPA cDNA 18 1 MATCH C01HBa0088L02.1- SGN-E216150+ 0.894 208 0.785 C PGS_C01HBa0088L02.1-_SGN-E216150+ (18001 17794) Alignment (genomic DNA sequence = upper lines): TATTATTCCC CAAAATTTGG AAGTCATCAT CACAAGAACA TCTATGATCA AATTACT-AA 17943 ||| |||||| |||||| ||| |||||||||| ||| ||| | ||||| || | ||||||| || TATCATTCCC CAAAATCTGG AAGTCATCAT CACCAGAGCC TCTATCATAA AATTACTAAA 115 CTAAAAAT-G CCTAAGAAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG 17884 |||| | | ||||||||| |||||||||| || ||||||| |||||||||| |||||||||| CTAAGAGTAT TCTAAGAAGC TAAAAATACA TACGAAGCTA GTCCATGCCG GAAGTTCAAG 175 GCATCAAGAC TTGAAGAAGA AGCTCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT 17824 |||||||||| |||||||||| || ||||||| || |||||| |||||||||| |||||||||| GCATCAAGAC TTGAAGAAGA AGATCCAGTC AAACCTAGAA GCATTAGCTC ACCCTGAATT 235 TCCGATGTAG TAAGACTGGC TTGAATTACT 17794 |||||||||| || ||||||| |||| ||||| TCCGATGTAG TAGGACTGGC TTGAGTTACT 265 hqPGS_C01HBa0088L02.1-_SGN-E216150+ (18001 17794) ******************************************************************************** EST sequence 48 -strand 219 n (File: SGN-E298638-) 1 TTTTTTTTTT TCTAAAAACT CAACAACTAT TATTATCCCC AAAATCTGGC AGTCATCATC 61 ACAAGAACAT GTACTTCAAA TTACTAAATC TAAGAGTATC TAAGAAGCTA AAATACATAA 121 ACAGCTAGTC CATGCCGGAA CTTCAAGGCA TCAAGACATG AAGAAGAAGA TCCAGTCCAA 181 GCTAGAAGCG TTAGCTCACC CTGAAATCCG ATGTAATGA Predicted gene structure (within gDNA segment 19738 to 16942): Exon 1 18027 17815 ( 213 n); cDNA 6 215 ( 210 n); score: 0.836 MATCH C01HBa0088L02.1- SGN-E298638- 0.836 213 0.973 C PGS_C01HBa0088L02.1-_SGN-E298638- (18027 17815) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATTTGGAAGT CATCATCACA 17968 ||| | || |||| || | || | |||| | |||||||| || ||| ||| |||||||||| TTTTTTCTAA AAACTCAA-C AACTATTATT A-TCCCCAAA ATCTGGCAGT CATCATCACA 63 AGAACATCTA TGATCAAATT ACT-AA-CTA AAAATGCCTA AGAAGCTAAA AATACATAAG 17910 ||||||| || ||||||| ||| || ||| | | | ||| ||||||||| ||||||||| AGAACATGTA -CTTCAAATT ACTAAATCTA AGAGTATCTA AGAAGCTAA- AATACATAAA 121 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 17850 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCAT TAGCTCACCC TGAATTTCCG ATGTA 17815 |||||||| | |||||||||| |||| |||| ||||| CTAGAAGCGT TAGCTCACCC TGAA-ATCCG ATGTA 215 hqPGS_C01HBa0088L02.1-_SGN-E298638- (18027 17815) ******************************************************************************** EST sequence 36 -strand 402 n (File: SGN-E352844-) 1 TTTTTTTTAT AAAAACCAAT TCAATAACTA TTATTTCCCA AAATCTGGAA GTTATCATCA 61 CAAGAACATC TACTTCGAAT TACTAAATCT AAGAGTATCT AAGAAGCTAA AATACATAAA 121 CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCTT TGTTTTATCG AAAAAAGGTG ATTTTTCGAA AAGAGTTTGT TTTATTTTAA 241 AGTATTTTTC GACTTTAGGA GTCGCCACTT AATTTTTAAG AAAAATCAAG AAAACTCATT 301 CTCAAAACAA TTTAAACAGA AAAGTCGTTT TGAAAATATT TTTTAGGATT CGGGATTCTT 361 ATTAGCGTCT TAGGAAGGTG TTTAAGGCAC CTAAGACACT CC Predicted gene structure (within gDNA segment 19728 to 15102): Exon 1 18027 17842 ( 186 n); cDNA 3 188 ( 186 n); score: 0.860 MATCH C01HBa0088L02.1- SGN-E352844- 0.860 186 0.463 C PGS_C01HBa0088L02.1-_SGN-E352844- (18027 17842) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATTTGGAAGT CATCATCACA 17968 ||| | | || ||||||| || |||||||||| ||| |||||| || ||||||| ||||||||| TTTTTTATAA AAACCAATTC AATAACTATT ATTTCCCAAA ATCTGGAAGT TATCATCACA 62 AGAACATCTA TGATCAAATT ACT-AA-CTA AAAATGCCTA AGAAGCTAAA AATACATAAG 17910 |||||||||| || |||| ||| || ||| | | | ||| ||||||| || ||||||||| AGAACATCTA -CTTCGAATT ACTAAATCTA AGAGTATCTA AGAAGCT-AA AATACATAAA 120 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 17850 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 180 CTAGAAGC 17842 |||||||| CTAGAAGC 188 hqPGS_C01HBa0088L02.1-_SGN-E352844- (18027 17842) ******************************************************************************** EST sequence 62 -strand 286 n (File: SGN-E355114-) 1 CCACAGCCCC AGTGGCTGGC TCAGTTGTTT CTTGTCTGGC CGGTGTTGGT GTTGACGTGG 61 TCGTTGCTCT AGTTCTAACC ATCTGCAAAA GAGAGTGAAG ATGGTCAGAT ACCAATTTGT 121 ATCGCCTAGA TACCAATTGG ACTCAAGTAG TAGCACGAAA GAAAGAATGA AAGGGTGAAA 181 TTTTCCTAAA GTCTTATAGC CTCTCAAAGA AAAGTAAAGG CGTCCCCCTA CCGTTCCTAA 241 AGACTCTACT AGACCTGTTC TTGTGTGATG AGACCAACGA ACCTAA Predicted gene structure (within gDNA segment 19851 to 17141): Exon 1 18462 18173 ( 290 n); cDNA 3 286 ( 284 n); score: 0.900 MATCH C01HBa0088L02.1- SGN-E355114- 0.900 290 1.014 C PGS_C01HBa0088L02.1-_SGN-E355114- (18462 18173) Alignment (genomic DNA sequence = upper lines): ACAACCCCAG TGGCTGGCTC AGACGCACCC TGTCCTGCCG GTGCTGGTGT TGGTGTTGGC 18403 ||| |||||| |||||||||| || | | || || | | || ||||| |||||||| | ACAGCCCCAG TGGCTGGCTC AGTTG----- TTTCTTGTCT G-GCCGGTGT TGGTGTTGAC 56 GTAGTTGTTG CTCTATTTCT AACCATCTGC GAAAGAGAGT GAAGATGGTC AGATACCAAT 18343 || || |||| ||||| |||| |||||||||| ||||||||| |||||||||| |||||||||| GTGGTCGTTG CTCTAGTTCT AACCATCTGC AAAAGAGAGT GAAGATGGTC AGATACCAAT 116 TTGTATCACC TAGATACCAA TTGGATTCAA GTAGTAGCAC AAAAGAAAGA ATGAAAGAAT 18283 ||||||| || |||||||||| ||||| |||| |||||||||| ||||||||| ||||||| | TTGTATCGCC TAGATACCAA TTGGACTCAA GTAGTAGCAC GAAAGAAAGA ATGAAAGGGT 176 GGAATTTTCC TAAAGTCTTA TAGCCTCTCA AAGAAAAGTA AAGGCGTCCC CCTACCGTTC 18223 | |||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAAATTTTCC TAAAGTCTTA TAGCCTCTCA AAGAAAAGTA AAGGCGTCCC CCTACCGTTC 236 CTTAAGACTC TACTAGACTC GTTTTTGTGT GATGAGACCA ACGAACCTAA 18173 || ||||||| |||||||| ||| |||||| |||||||||| |||||||||| CTAAAGACTC TACTAGACCT GTTCTTGTGT GATGAGACCA ACGAACCTAA 286 hqPGS_C01HBa0088L02.1-_SGN-E355114- (18462 18173) ******************************************************************************** EST sequence 219 +strand 694 n (File: SGN-E353359+) 1 TGTAGTCTAT GCACATTCAA AAACTGCCGA TCTTTACAAC AAAACCGGAG CACCCCAAGG 61 AGATGCACTT GGTCTAATGA AGCCTTTGTT CAATAACTCT TGAAGTTGTG CCTTTAACTC 121 TCTTAACTCT GCGGGAGCCA TTCTATAAGG GGGTATAAAA ATGGGGCGTG TGCCCGGTTC 181 GAGATCAATA CAGAAGTCAA TATCCCTATC CGGTGGCATA CCAGGATGAT CTGCAGGGAA 241 CACATCCATA AACTCACGAA CTACTGAAAC TGAGTCAATC GAAGGTACTT GGGTAGTGTT 301 ATCCTTGAGA TGTGCCAAGA AAGCTAAACA CCCTTTACTA ACCATTTTCT TAGCACGAAG 361 AAAGGAGATG ATACGCACCG GATTGGAAGT GTAGTCACCC TCCTACACTA ACAGATCTGT 421 CCCAGGCTTG GCTAACGTCA CGGTTTTAGC ATTACAATCC AAGATTGCAA AATTTGGAGA 481 AAGCCAAGTC ATACCCAGAA TTACATCGAA GTCAACCATT TCTTGCAAGG ATTTTGCCGT 541 AGCCGCTACC TGTAACGCTG AAATCCGCAA CTCTGACCTC AACCCTTTCA CAAAACGACG 601 AATCCTCTCT TGTGGACTGA AACAAAGTTG AGTGGCATAT CTGGATAGTG CACGAAACTT 661 AGCCTCATAT GCATTGACCT ACATCCTACC TTGC Predicted gene structure (within gDNA segment 21534 to 18420): Exon 1 20608 20083 ( 526 n); cDNA 1 519 ( 519 n); score: 0.922 Intron 1 20082 19340 ( 743 n); Pd: 0.000 (s: 0.94), Pa: 0.000 (s: 0.96) Exon 2 19339 19167 ( 173 n); cDNA 520 692 ( 173 n); score: 0.954 MATCH C01HBa0088L02.1- SGN-E353359+ 0.930 699 1.007 C PGS_C01HBa0088L02.1-_SGN-E353359+ (20608 20083,19339 19167) Alignment (genomic DNA sequence = upper lines): TGTAGTCTAT GCACATCCGA AAACTCCCAT CCTTCTTCTT CACAAACAAA ACCGGAGCAC 20549 |||||||||| |||||| | | ||||| | | ||| || || |||||| |||||||||| TGTAGTCTAT GCACATTCAA AAACT-GC-- CGATCT--TT -AC-AACAAA ACCGGAGCAC 53 CCCAAGGAGA TGCACTTGGT CTGATGAAGC CTTTGTTCAA CAACTCTTGA AGTTGGGCCT 20489 |||||||||| |||||||||| || ||||||| |||||||||| ||||||||| ||||| |||| CCCAAGGAGA TGCACTTGGT CTAATGAAGC CTTTGTTCAA TAACTCTTGA AGTTGTGCCT 113 TTAACTCTCT CAACTCCGCG GGAGCCATTC TATAAGGGGG TATAGAAATG GGGCGAGTGC 20429 |||||||||| ||||| ||| |||||||||| |||||||||| |||| ||||| ||||| |||| TTAACTCTCT TAACTCTGCG GGAGCCATTC TATAAGGGGG TATAAAAATG GGGCGTGTGC 173 CCGGTTCAAG ATCAATGCAG AAGTCAATAT CCCTATCTGG TGGCATACCA GGAAGATCTG 20369 ||||||| || |||||| ||| |||||||||| ||||||| || |||||||||| ||| |||||| CCGGTTCGAG ATCAATACAG AAGTCAATAT CCCTATCCGG TGGCATACCA GGATGATCTG 233 CAGGGAACAC ATCCAAAAAC TCGCGGACTA CCGAAACCGA CTCAATCGAA GGTACTTGGG 20309 |||||||||| ||||| |||| || || |||| | ||||| || ||||||||| |||||||||| CAGGGAACAC ATCCATAAAC TCACGAACTA CTGAAACTGA GTCAATCGAA GGTACTTGGG 293 TAGTGTCATC CTTGAGATGG GCCAAGAAAG CTAAACACCC TTTACTAACC ATTTTCTTAG 20249 |||||| ||| ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAGTGTTATC CTTGAGATGT GCCAAGAAAG CTAAACACCC TTTACTAACC ATTTTCTTAG 353 CACGAAGAAA GGAGATGATA CGCACCGGAT TGGAAGTGTA GTCACCCTCC CACACTAACG 20189 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||| CACGAAGAAA GGAGATGATA CGCACCGGAT TGGAAGTGTA GTCACCCTCC TACACTAACA 413 GGTCTGTCCT AGGCTTGGCT AACGTCACCA TTTTAGCATT ACAATCCAAG ATCGCAAAAT 20129 | ||||||| |||||||||| |||||||| |||||||||| |||||||||| || ||||||| GATCTGTCCC AGGCTTGGCT AACGTCACGG TTTTAGCATT ACAATCCAAG ATTGCAAAAT 473 TCGGAGAAAG CCAAGTCATA CGCAGAATTA CATCAAAGTC AACCATTTCT AAGATAACCA 20069 | |||||||| |||||||||| | |||||||| |||| ||||| |||||| TTGGAGAAAG CCAAGTCATA CCCAGAATTA CATCGAAGTC AACCAT.... .......... 519 AATCTACATA AGTGTTACTC CCTACAAAAG TCACCAAACA AGACCTATAC ACTTTTTCAA 20009 .......... .......... .......... .......... .......... .......... 519 CTATCACAGA CTCACCCATC GGGGTAGAAA CACGAATAGG CATGTCAAGT AATTCACAAT 19949 .......... .......... .......... .......... .......... .......... 519 GTAAATTAAG ACCATTAGCA AATGAGGAAG ATACATAAGA AAATGTGGAT CCGGGATCAA 19889 .......... .......... .......... .......... .......... .......... 519 ACAATACAGA AGCCATGCAA TCACAAACCA AAAGATTACC TGTGATGACA GCATCAGATG 19829 .......... .......... .......... .......... .......... .......... 519 TCTCCACCTC AGATCTCCCA GGGAAATCAT AACAATGGGC CCTTTCATTT GTTTGTCCGT 19769 .......... .......... .......... .......... .......... .......... 519 TGCCCTTACC ATGTTGTGGT GTAGTGGCTC TAGTTTTCCC ATCACCTCTG CCGTTTTGGT 19709 .......... .......... .......... .......... .......... .......... 519 GACCACCATT ACCTCGACCA CCACGTCCTC CAGAATAACG GCCTCTACCA TGACCACCTC 19649 .......... .......... .......... .......... .......... .......... 519 TACCTCTAGC TATTGGGGGT CTATAACTCT GTTTAGGACA ATTCCTCCTA ATATGCCCAG 19589 .......... .......... .......... .......... .......... .......... 519 TCTCCCCACA TCCATAACAC TCTCTAGAGT CAAGCATAGG TCTCTCAGAA AAGTGTTGGC 19529 .......... .......... .......... .......... .......... .......... 519 CGGTCTGAGG TGGACCCCCA CTACAGTCTG TAGTGAAGAC TGAATTGGTC GAACTGAGTA 19469 .......... .......... .......... .......... .......... .......... 519 ACCTCCGGAA CCCTGTCCTC TAAAGTAAGA ACCATTAAAC TCACCTCCCT TTCGAAACCT 19409 .......... .......... .......... .......... .......... .......... 519 CTTTGATGTC GATGCCATGG TGAATTCATC TGGCTTCACT CCTTCCACCT CTACCACGAA 19349 .......... .......... .......... .......... .......... .......... 519 ATCTACCACT TCTTGGAAGG ATTTTGCCGT AGCCGCTACC TGTAAGGCTG AAATCCGCAG 19289 | ||||| |||| |||||||||| |||||||||| ||||| |||| ||||||||| .........T TCTTGCAAGG ATTTTGCCGT AGCCGCTACC TGTAACGCTG AAATCCGCAA 570 CTCTGACCTC AACCCCTTCA CAAAACGACG AATCCGCTCT TGTGGACTGA AACAAAGTTG 19229 |||||||||| ||||| |||| |||||||||| ||||| |||| |||||||||| |||||||||| CTCTGACCTC AACCCTTTCA CAAAACGACG AATCCTCTCT TGTGGACTGA AACAAAGTTG 630 GGTGGCATAT CTGGATAGTG CATGAAACTT AGCCTCATAT GCATTGACCA ACATCCTACC 19169 ||||||||| |||||||||| || ||||||| |||||||||| ||||||||| |||||||||| AGTGGCATAT CTGGATAGTG CACGAAACTT AGCCTCATAT GCATTGACCT ACATCCTACC 690 TT 19167 || TT 692 hqPGS_C01HBa0088L02.1-_SGN-E353359+ (20608 20083,19339 19167) ******************************************************************************** EST sequence 199 +strand 433 n (File: SGN-E352180+) 1 CCCTTGAAGA CCGGAGGTTT CAATTTCAAG AACTTACTGA AAAGTTCATG CTGATCATTT 61 GTCATTATAG GCCCAGTAGT CAAACGTGGA AATGTACCTA TGTGCAATGG AACATCCATG 121 CGGGGAGCCA TAGTAGCCGC ATGTTGTACT TCTGAAACCG GAGGTGTTGG CGCAGAAAAC 181 ACTGGAGGTG CTTGACCTTG ATCAGATAAA CCGCTAAGAT AAGCCAGAAC CTGATTGATC 241 ATCTCTGGGG TAGGTTGGGG TGGCATTTCC TCATTTTGCA CTTGTTCAGT TTCCCCATCC 301 TCCCCTTCTC TTATTACTTC CTCAGTCGGT GGAGGAGTCA CCGCCCTAGT ACCAGATGGG 361 CTCGGTTCTC GTTCTCTTCC TCTAGATGAC GTCCTCCCAC GACCTCTACC ACGGCCCCTT 421 GCCGCTGTTC TCC Predicted gene structure (within gDNA segment 19620 to 16628): Exon 1 18903 18473 ( 431 n); cDNA 1 431 ( 431 n); score: 0.893 MATCH C01HBa0088L02.1- SGN-E352180+ 0.893 431 0.995 C PGS_C01HBa0088L02.1-_SGN-E352180+ (18903 18473) Alignment (genomic DNA sequence = upper lines): CCCTTAAAGA CTAGAGGTTT CAATTTCAAG AACTTACTGA AAAGTTCATG TTGATCACTT 18844 ||||| |||| | ||||||| |||||||||| |||||||||| |||||||||| |||||| || CCCTTGAAGA CCGGAGGTTT CAATTTCAAG AACTTACTGA AAAGTTCATG CTGATCATTT 60 GTCATTATAG GCCCTGTAGT CAGACGAGGA AATGTGCCTA TTTCCAATGG AACATCCATG 18784 |||||||||| |||| ||||| || ||| ||| ||||| |||| | | |||||| |||||||||| GTCATTATAG GCCCAGTAGT CAAACGTGGA AATGTACCTA TGTGCAATGG AACATCCATG 120 CAAGGAGCCA TAGTAGCCGC ACGTTGTACC TCCGGAGCCT GAGGTGCTGG TGCAGAAAAC 18724 | ||||||| |||||||||| | ||||||| || | | || |||||| ||| ||||||||| CGGGGAGCCA TAGTAGCCGC ATGTTGTACT TCTGAAACCG GAGGTGTTGG CGCAGAAAAC 180 ACTGGAGGTG CCTGACCCTG ATCAGATAAC CCGCTAAGAT AAGCAAGAAC CTGATTGATC 18664 |||||||||| | ||||| || ||||||||| |||||||||| |||| ||||| |||||||||| ACTGGAGGTG CTTGACCTTG ATCAGATAAA CCGCTAAGAT AAGCCAGAAC CTGATTGATC 240 ATCTCTGGGG TAGGTTGGGG TGGCAATTCC TCATTCTGTA CTTGTTCAGT TTCCCCTTCC 18604 |||||||||| |||||||||| ||||| |||| ||||| || | |||||||||| |||||| ||| ATCTCTGGGG TAGGTTGGGG TGGCATTTCC TCATTTTGCA CTTGTTCAGT TTCCCCATCC 300 TCACCCTTTC TTACTACTTC TTCAGTCGGT GGAGGAGTCA CTTCCCTAGT ATCAGATGGG 18544 || || | || ||| |||||| ||||||||| |||||||||| | ||||||| | |||||||| TCCCCTTCTC TTATTACTTC CTCAGTCGGT GGAGGAGTCA CCGCCCTAGT ACCAGATGGG 360 CTAGGTGCTC GTCCTCTTCC TCTAGAGGAC GTCCTCCCAT GACCTCTCCC AAGGCCTCTT 18484 || ||| ||| || ||||||| |||||| ||| ||||||||| ||||||| || | |||| ||| CTCGGTTCTC GTTCTCTTCC TCTAGATGAC GTCCTCCCAC GACCTCTACC ACGGCCCCTT 420 GCCGTTGTTC T 18473 |||| ||||| | GCCGCTGTTC T 431 hqPGS_C01HBa0088L02.1-_SGN-E352180+ (18903 18473) ******************************************************************************** EST sequence 92 -strand 554 n (File: SGN-E329287-) 1 AGAATGATGC CCAAGTCATA CGTGGTGCCT CTGTTGGTTG ACACTCAACA TGTGACCGCC 61 ACCACATTTT GGCGTTCCCT TGAAACTGAT AAGTCACAAA CTCAACACCA AACCGTTCTA 121 CTATACCCAT CTTGTGTAGT AGCTCATGAC AGTCAACCAG AAAATCGTAG GCATCCTCAG 181 ATTCAACACC CTTGTAGACT TGAGGTTTCA ATTTCAAGAA CTTACTAAAA AGTTCATGCT 241 GATCATTTGT CATTATAGGC CCTGTAGTCA GACGGGGAAA CGTTCCTATT TCCAATGAGG 301 TATCGATGCG GGGAGTCACA GTAGGCGCAT GTTGTACCTC CGGAGCCTGA GGTGCTAGTG 361 CAGAAAACAC TGGAGGTGCT TGGCCTTGAT CAGATAACCC GCTAAGGTAA GCAAGAACCT 421 GATTGATCAT CTCTTGGGTA GGTTGGGGTG GCAATTCCTC ATTCTGCACT TGTTCATTCT 481 CCCCATCCTC ACCCTCTCTT ACCACTTCCT CAGTTGGTGG AGGTGTCACC GCCTTAGTAC 541 CAGATGGGCT AGGT Predicted gene structure (within gDNA segment 19926 to 17146): Exon 1 19091 18538 ( 554 n); cDNA 1 554 ( 554 n); score: 0.913 MATCH C01HBa0088L02.1- SGN-E329287- 0.913 554 1.000 C PGS_C01HBa0088L02.1-_SGN-E329287- (19091 18538) Alignment (genomic DNA sequence = upper lines): AGAATGAGGC CCAAGTCATA GGTGATGCCT CTGTTGGTTG ACACTCAACA TGTGACCGCC 19032 ||||||| || |||||||||| ||| ||||| |||||||||| |||||||||| |||||||||| AGAATGATGC CCAAGTCATA CGTGGTGCCT CTGTTGGTTG ACACTCAACA TGTGACCGCC 60 ACCACATTTT GGCATTCCCT TGAAACTGAT AACTCACGAA CTCAACACCA AACCGTTCTA 18972 |||||||||| ||| |||||| |||||||||| || |||| || |||||||||| |||||||||| ACCACATTTT GGCGTTCCCT TGAAACTGAT AAGTCACAAA CTCAACACCA AACCGTTCTA 120 CTATACCCAT CTTGTGTAGT AGCTCATGAC AGTCAACCAG AAAATCGTAA TCATCCTCAG 18912 |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| ||||||||| CTATACCCAT CTTGTGTAGT AGCTCATGAC AGTCAACCAG AAAATCGTAG GCATCCTCAG 180 ATTCAGCACC CTTAAAGACT AGAGGTTTCA ATTTCAAGAA CTTACTGAAA AGTTCATGTT 18852 ||||| |||| ||| ||||| ||||||||| |||||||||| |||||| ||| |||||||| | ATTCAACACC CTTGTAGACT TGAGGTTTCA ATTTCAAGAA CTTACTAAAA AGTTCATGCT 240 GATCACTTGT CATTATAGGC CCTGTAGTCA GACGAGGAAA TGTGCCTATT TCCAATGGAA 18792 ||||| |||| |||||||||| |||||||||| |||| ||||| || |||||| ||||||| GATCATTTGT CATTATAGGC CCTGTAGTCA GACGGGGAAA CGTTCCTATT TCCAATGAGG 300 CATCCATGCA AGGAGCCATA GTAGCCGCAC GTTGTACCTC CGGAGCCTGA GGTGCTGGTG 18732 ||| |||| |||| || | |||| |||| |||||||||| |||||||||| |||||| ||| TATCGATGCG GGGAGTCACA GTAGGCGCAT GTTGTACCTC CGGAGCCTGA GGTGCTAGTG 360 CAGAAAACAC TGGAGGTGCC TGACCCTGAT CAGATAACCC GCTAAGATAA GCAAGAACCT 18672 |||||||||| ||||||||| || || |||| |||||||||| |||||| ||| |||||||||| CAGAAAACAC TGGAGGTGCT TGGCCTTGAT CAGATAACCC GCTAAGGTAA GCAAGAACCT 420 GATTGATCAT CTCTGGGGTA GGTTGGGGTG GCAATTCCTC ATTCTGTACT TGTTCAGTTT 18612 |||||||||| |||| ||||| |||||||||| |||||||||| |||||| ||| |||||| | | GATTGATCAT CTCTTGGGTA GGTTGGGGTG GCAATTCCTC ATTCTGCACT TGTTCATTCT 480 CCCCTTCCTC ACCCTTTCTT ACTACTTCTT CAGTCGGTGG AGGAGTCACT TCCCTAGTAT 18552 |||| ||||| ||||| |||| || ||||| | |||| ||||| ||| ||||| || ||||| CCCCATCCTC ACCCTCTCTT ACCACTTCCT CAGTTGGTGG AGGTGTCACC GCCTTAGTAC 540 CAGATGGGCT AGGT 18538 |||||||||| |||| CAGATGGGCT AGGT 554 hqPGS_C01HBa0088L02.1-_SGN-E329287- (19091 18538) ******************************************************************************** EST sequence 129 +strand 716 n (File: SGN-E577713+) 1 CGGTGGATAC CTAGGCACCC AGAGACGAGG AAGGGCGTAG TAATCGACGA AATGCTTCGG 61 GGAGTTGAAA ATAAGCATAG ATCCGGAGAT TCCCGAATAG GGCAACCTTT CGAACTGCTG 121 CTGAATCCAT GGGCAGGCAA GAGACAACCT GGCGAACTGA AACATCTTAG TAGCCAGAGG 181 AAAAGAAAGC AAATAAGGAA GATACATAAG AAAACGTGGA TCCAGGATCA AACAATACAG 241 AAGCCATGCA ATCACAAACC AGAAGATTAC CTGTGATGAC AACATCAGAT GCCTCCGCTT 301 CACACCGCCC AGGGAAAGCG TAACAATGGG CCCTATCGTT CGTCTGTCCG TTGCCCCTAC 361 CATGTTGTGA TGTAGTGGCC CAAGTTTGCC CATTACCTCT GCCGTTTTGG TGACCACCAT 421 TACCTCGACC ACCACGTCCT CCAGAATAAC GGCCTCTACC ATGACCACCT CTACCTCTAG 481 CTATTGGGGG TCTATAACTT TGTCTGGGAC AATTTTTCCT AATATGTCCA ATCTCCCCAC 541 ATCCATACCA TTCTCTGGAG TCAATCCTAG GCCCCTCGGA GAAGTGTTGA CCGGTCTGAG 601 GTGGTCCCCC AACTACAGTC TGTAGTGAAG ACTCAATTGG TCGGACTGAG TAACTTCCCG 661 AACCCTGTCC TCTAGTGTAA GAACCATTAA ACTCACCTCC CTTTCGAAGC CTTTTT Predicted gene structure (within gDNA segment 22474 to 18723): Exon 1 19999 19970 ( 30 n); cDNA 156 185 ( 30 n); score: 0.633 Intron 1 19969 19935 ( 35 n); Pd: 0.769 (s: 0), Pa: 0.000 (s: 0.90) Exon 2 19934 19405 ( 530 n); cDNA 186 716 ( 531 n); score: 0.899 MATCH C01HBa0088L02.1- SGN-E577713+ 0.899 560 0.782 C PGS_C01HBa0088L02.1-_SGN-E577713+ (19999 19970,19934 19405) Alignment (genomic DNA sequence = upper lines): ACTCACCCAT CGGGGTAGAA ACACGAATAG GCATGTCAAG TAATTCACAA TGTAAATTAA 19940 ||| | ||| | |||| | | ||| || ACTGAAACAT CTTAGTAGCC AGAGGAAAAG .......... .......... .......... 185 GACCATTAGC AAATGAGGAA GATACATAAG AAAATGTGGA TCCGGGATCA AACAATACAG 19880 ||| |||| ||||| |||||||||| |||| ||||| ||| |||||| |||||||||| .....AAAGC AAATAAGGAA GATACATAAG AAAACGTGGA TCCAGGATCA AACAATACAG 240 AAGCCATGCA ATCACAAACC AAAAGATTAC CTGTGATGAC AGCATCAGAT GTCTCCACCT 19820 |||||||||| |||||||||| | |||||||| |||||||||| | |||||||| | |||| | | AAGCCATGCA ATCACAAACC AGAAGATTAC CTGTGATGAC AACATCAGAT GCCTCCGCTT 300 CAGATCTCCC AGGGAAATCA TAACAATGGG CCCTTTCATT TGTTTGTCCG TTGCCCTTAC 19760 || | | ||| ||||||| | |||||||||| |||| || || || |||||| |||||| ||| CACACCGCCC AGGGAAAGCG TAACAATGGG CCCTATCGTT CGTCTGTCCG TTGCCCCTAC 360 CATGTTGTGG TGTAGTGGCT CTAGTTTTCC CATCACCTCT GCCGTTTTGG TGACCACCAT 19700 ||||||||| ||||||||| | ||||| || ||| |||||| |||||||||| |||||||||| CATGTTGTGA TGTAGTGGCC CAAGTTTGCC CATTACCTCT GCCGTTTTGG TGACCACCAT 420 TACCTCGACC ACCACGTCCT CCAGAATAAC GGCCTCTACC ATGACCACCT CTACCTCTAG 19640 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TACCTCGACC ACCACGTCCT CCAGAATAAC GGCCTCTACC ATGACCACCT CTACCTCTAG 480 CTATTGGGGG TCTATAACTC TGTTTAGGAC AATTCCTCCT AATATGCCCA GTCTCCCCAC 19580 |||||||||| ||||||||| ||| | |||| |||| |||| |||||| ||| ||||||||| CTATTGGGGG TCTATAACTT TGTCTGGGAC AATTTTTCCT AATATGTCCA ATCTCCCCAC 540 ATCCATAACA CTCTCTAGAG TCAAGCATAG GTCTCTCAGA AAAGTGTTGG CCGGTCTGAG 19520 ||||||| || ||||| ||| |||| | ||| | | ||| || |||||||| |||||||||| ATCCATACCA TTCTCTGGAG TCAATCCTAG GCCCCTCGGA GAAGTGTTGA CCGGTCTGAG 600 GTGGACCCCC -ACTACAGTC TGTAGTGAAG ACTGAATTGG TCGAACTGAG TAACCTCCGG 19461 |||| ||||| ||||||||| |||||||||| ||| |||||| ||| |||||| |||| ||| | GTGGTCCCCC AACTACAGTC TGTAGTGAAG ACTCAATTGG TCGGACTGAG TAACTTCCCG 660 AACCCTGTCC TCTAAAGTAA GAACCATTAA ACTCACCTCC CTTTCGAAAC CTCTTT 19405 |||||||||| |||| |||| |||||||||| |||||||||| |||||||| | || ||| AACCCTGTCC TCTAGTGTAA GAACCATTAA ACTCACCTCC CTTTCGAAGC CTTTTT 716 hqPGS_C01HBa0088L02.1-_SGN-E577713+ (19999 19970,19934 19405) ******************************************************************************** EST sequence 245 +strand 720 n (File: SGN-E356614+) 1 GCGAATCCGC TCTTGAGGAC TGAAACAGAG TTGAGTGGCA TATCTGGATA GTGCACGAAA 61 CTTAGCCTCA TAAGCATTAA CTGACACCCT ACCTTGCTCT AGGCTCAAGA ACTCATCCCT 121 TTTCTTATCC CTCAAAGTCC GGGGGATATA CTTCTCCATA AACAAACTAT AGAATGAGGC 181 CCAAGTCATA GGTGATGCCT CTATTGGTTG ACACTCGATA TGTGACCGCC ACCACATTTG 241 GGCGTTCCCT TGAAACTGAT AAGTCACAAA CTCCACACCA AACCGTTCTA CTATACCCAT 301 CTTGTGTAGT AGCTCGTGAC AGTCAACCAG AAAATCATAA GCATCCTCCG ATTCAGCACC 361 CTTGAAGACC GGAGGTTTCA ATTTCAAGAA CTTACTGAAA AGTTCATGCT GATCATTTGT 421 CATTATAGGG ACAGTAGTCA AACGTGGAAA TGTGCCTATG TCCAATGGAA CATCCATGCG 481 GGGAGCCATA GTAGCCGCAT GTTGTACTTC TGAAACCGGA GGTGTTGGCG CAGAAAACAC 541 TGGAGGTGCT TGACCTTGAT CAGATAACCC GCTAAGATAA GCCAGAACCT GATTGATCAT 601 CTCTGGGGTA GGTTGGGGTG GCATTTCCTC ATTTTGCACT TGNTCAGTTT CCCCATCCCT 661 CCCTTTCTCT ATTACTTCCT CAGTCAGTGG AAGAGTCACT GCCCTAGTAT CAGATGGGCT Predicted gene structure (within gDNA segment 20167 to 17059): Exon 1 19260 18542 ( 719 n); cDNA 2 720 ( 719 n); score: 0.910 MATCH C01HBa0088L02.1- SGN-E356614+ 0.910 719 0.999 C PGS_C01HBa0088L02.1-_SGN-E356614+ (19260 18542) Alignment (genomic DNA sequence = upper lines): CGAATCCGCT CTTGTGGACT GAAACAAAGT TGGGTGGCAT ATCTGGATAG TGCATGAAAC 19201 |||||||||| |||| ||||| |||||| ||| || ||||||| |||||||||| |||| ||||| CGAATCCGCT CTTGAGGACT GAAACAGAGT TGAGTGGCAT ATCTGGATAG TGCACGAAAC 61 TTAGCCTCAT ATGCATTGAC CAACATCCTA CCTTTCTCTA GGCTCAAGAA CTCATCCCTT 19141 |||||||||| | ||||| || ||| |||| |||| ||||| |||||||||| |||||||||| TTAGCCTCAT AAGCATTAAC TGACACCCTA CCTTGCTCTA GGCTCAAGAA CTCATCCCTT 121 TTCCTATCCC TCAAAGTTCG GGGGATATAC TTCTCCATAA ACAAGCTAGA GAATGAGGCC 19081 ||| |||||| ||||||| || |||||||||| |||||||||| |||| ||| | |||||||||| TTCTTATCCC TCAAAGTCCG GGGGATATAC TTCTCCATAA ACAAACTATA GAATGAGGCC 181 CAAGTCATAG GTGATGCCTC TGTTGGTTGA CACTCAACAT GTGACCGCCA CCACATTTTG 19021 |||||||||| |||||||||| | |||||||| ||||| | || |||||||||| |||||||| | CAAGTCATAG GTGATGCCTC TATTGGTTGA CACTCGATAT GTGACCGCCA CCACATTTGG 241 GCATTCCCTT GAAACTGATA ACTCACGAAC TCAACACCAA ACCGTTCTAC TATACCCATC 18961 || ||||||| |||||||||| | |||| ||| || ||||||| |||||||||| |||||||||| GCGTTCCCTT GAAACTGATA AGTCACAAAC TCCACACCAA ACCGTTCTAC TATACCCATC 301 TTGTGTAGTA GCTCATGACA GTCAACCAGA AAATCGTAAT CATCCTCAGA TTCAGCACCC 18901 |||||||||| |||| ||||| |||||||||| ||||| ||| ||||||| || |||||||||| TTGTGTAGTA GCTCGTGACA GTCAACCAGA AAATCATAAG CATCCTCCGA TTCAGCACCC 361 TTAAAGACTA GAGGTTTCAA TTTCAAGAAC TTACTGAAAA GTTCATGTTG ATCACTTGTC 18841 || ||||| |||||||||| |||||||||| |||||||||| ||||||| || |||| ||||| TTGAAGACCG GAGGTTTCAA TTTCAAGAAC TTACTGAAAA GTTCATGCTG ATCATTTGTC 421 ATTATAGGCC CTGTAGTCAG ACGAGGAAAT GTGCCTATTT CCAATGGAAC ATCCATGCAA 18781 |||||||| | ||||||| ||| |||||| |||||||| | |||||||||| |||||||| ATTATAGGGA CAGTAGTCAA ACGTGGAAAT GTGCCTATGT CCAATGGAAC ATCCATGCGG 481 GGAGCCATAG TAGCCGCACG TTGTACCTCC GGAGCCTGAG GTGCTGGTGC AGAAAACACT 18721 |||||||||| |||||||| | |||||| || | | || ||| ||| ||| || |||||||||| GGAGCCATAG TAGCCGCATG TTGTACTTCT GAAACCGGAG GTGTTGGCGC AGAAAACACT 541 GGAGGTGCCT GACCCTGATC AGATAACCCG CTAAGATAAG CAAGAACCTG ATTGATCATC 18661 |||||||| | |||| ||||| |||||||||| |||||||||| | |||||||| |||||||||| GGAGGTGCTT GACCTTGATC AGATAACCCG CTAAGATAAG CCAGAACCTG ATTGATCATC 601 TCTGGGGTAG GTTGGGGTGG CAATTCCTCA TTCTGTACTT GTTCAGTTTC CCCTTCCTCA 18601 |||||||||| |||||||||| || ||||||| || || |||| | |||||||| ||| ||| | TCTGGGGTAG GTTGGGGTGG CATTTCCTCA TTTTGCACTT GNTCAGTTTC CCCATCC-CT 660 CCCTTTCT-T ACTACTTCTT CAGTCGGTGG AGGAGTCACT TCCCTAGTAT CAGATGGGCT 18542 |||||||| | | |||||| | ||||| |||| | |||||||| ||||||||| |||||||||| CCCTTTCTCT ATTACTTCCT CAGTCAGTGG AAGAGTCACT GCCCTAGTAT CAGATGGGCT 720 hqPGS_C01HBa0088L02.1-_SGN-E356614+ (19260 18542) ******************************************************************************** EST sequence 145 +strand 664 n (File: SGN-E352401+) 1 AATCCGCTCT TGAGGACTGA AACAGAGTTG AGTGGCATAT CTGGATAGTG CACGAAACTT 61 AGCCTCATAA GCATTAACTG ACACCCTACC TTGCTCTAGG CTCAAGAACT CATCCCTTTT 121 CTTATCCCTC AAAGTCCGGG GGATATACTT CTCCATAAAC AAACTATAGA ATGAGGCCCA 181 AGTCATAGGT GATGCCTCTA TTGGTTGACA CTCGATATGT GACCGCCACC ACATTTGGGC 241 GTTCCCTTGA AACTGATAAG TCACAAACTC CACACCAAAC CGTTCTACTA TACCCATCTT 301 GTGTAGTAGC TCGTGACAGT CAACCAGAAA ATCATAAGCA TCCTCCGATT CAGCACCCTT 361 GAAGACCGGA GGTTTCAATT TCAAGAACTT ACTGAAAAGT TCATGCTGAT CATTTGTCAT 421 TATAGGGACA GTAGTCAAAC GTGGAAATGT GCCTATGTCC AATGGAACAT CCATGCGGGG 481 AGCCATAGTA GCCGCATGTT GTACTTCTGA AACCGGAGGT GTTGGCGCAG AAAACACTGG 541 AGGTGCTTGA CCTTGATCAG ATAACCCGCT AAGATAAGCC AGAACCTGAT TGATCATCTC 601 TGGGGTAGGT TGGGGTGCCA TTTCCCTCAT TTGCACTTGT TCAGTTTCCC CATCCTCCCC 661 TTCT Predicted gene structure (within gDNA segment 20137 to 17868): Exon 1 19258 18599 ( 660 n); cDNA 1 660 ( 660 n); score: 0.911 MATCH C01HBa0088L02.1- SGN-E352401+ 0.911 660 0.994 C PGS_C01HBa0088L02.1-_SGN-E352401+ (19258 18599) Alignment (genomic DNA sequence = upper lines): AATCCGCTCT TGTGGACTGA AACAAAGTTG GGTGGCATAT CTGGATAGTG CATGAAACTT 19199 |||||||||| || ||||||| |||| ||||| ||||||||| |||||||||| || ||||||| AATCCGCTCT TGAGGACTGA AACAGAGTTG AGTGGCATAT CTGGATAGTG CACGAAACTT 60 AGCCTCATAT GCATTGACCA ACATCCTACC TTTCTCTAGG CTCAAGAACT CATCCCTTTT 19139 ||||||||| ||||| || ||| |||||| || ||||||| |||||||||| |||||||||| AGCCTCATAA GCATTAACTG ACACCCTACC TTGCTCTAGG CTCAAGAACT CATCCCTTTT 120 CCTATCCCTC AAAGTTCGGG GGATATACTT CTCCATAAAC AAGCTAGAGA ATGAGGCCCA 19079 | |||||||| ||||| |||| |||||||||| |||||||||| || ||| ||| |||||||||| CTTATCCCTC AAAGTCCGGG GGATATACTT CTCCATAAAC AAACTATAGA ATGAGGCCCA 180 AGTCATAGGT GATGCCTCTG TTGGTTGACA CTCAACATGT GACCGCCACC ACATTTTGGC 19019 |||||||||| ||||||||| |||||||||| ||| | |||| |||||||||| |||||| ||| AGTCATAGGT GATGCCTCTA TTGGTTGACA CTCGATATGT GACCGCCACC ACATTTGGGC 240 ATTCCCTTGA AACTGATAAC TCACGAACTC AACACCAAAC CGTTCTACTA TACCCATCTT 18959 ||||||||| ||||||||| |||| ||||| ||||||||| |||||||||| |||||||||| GTTCCCTTGA AACTGATAAG TCACAAACTC CACACCAAAC CGTTCTACTA TACCCATCTT 300 GTGTAGTAGC TCATGACAGT CAACCAGAAA ATCGTAATCA TCCTCAGATT CAGCACCCTT 18899 |||||||||| || ||||||| |||||||||| ||| ||| || ||||| |||| |||||||||| GTGTAGTAGC TCGTGACAGT CAACCAGAAA ATCATAAGCA TCCTCCGATT CAGCACCCTT 360 AAAGACTAGA GGTTTCAATT TCAAGAACTT ACTGAAAAGT TCATGTTGAT CACTTGTCAT 18839 ||||| || |||||||||| |||||||||| |||||||||| ||||| |||| || ||||||| GAAGACCGGA GGTTTCAATT TCAAGAACTT ACTGAAAAGT TCATGCTGAT CATTTGTCAT 420 TATAGGCCCT GTAGTCAGAC GAGGAAATGT GCCTATTTCC AATGGAACAT CCATGCAAGG 18779 |||||| | ||||||| || | |||||||| |||||| ||| |||||||||| |||||| || TATAGGGACA GTAGTCAAAC GTGGAAATGT GCCTATGTCC AATGGAACAT CCATGCGGGG 480 AGCCATAGTA GCCGCACGTT GTACCTCCGG AGCCTGAGGT GCTGGTGCAG AAAACACTGG 18719 |||||||||| |||||| ||| |||| || | | || ||||| | ||| |||| |||||||||| AGCCATAGTA GCCGCATGTT GTACTTCTGA AACCGGAGGT GTTGGCGCAG AAAACACTGG 540 AGGTGCCTGA CCCTGATCAG ATAACCCGCT AAGATAAGCA AGAACCTGAT TGATCATCTC 18659 |||||| ||| || ||||||| |||||||||| ||||||||| |||||||||| |||||||||| AGGTGCTTGA CCTTGATCAG ATAACCCGCT AAGATAAGCC AGAACCTGAT TGATCATCTC 600 TGGGGTAGGT TGGGGTGGCA ATT-CCTCAT TCTGTACTTG TTCAGTTTCC CCTTCCTCAC 18600 |||||||||| ||||||| || || |||||| | || ||||| |||||||||| || ||||| | TGGGGTAGGT TGGGGTGCCA TTTCCCTCAT T-TGCACTTG TTCAGTTTCC CCATCCTCCC 659 C 18599 | C 660 hqPGS_C01HBa0088L02.1-_SGN-E352401+ (19258 18599) ******************************************************************************** EST sequence 239 +strand 713 n (File: SGN-E349404+) 1 GGGGTTCTGT CCTCTAGAAT AAGAACCATT ATACTCTCCT CCCCTTCTAA ACCTCTTCGA 61 TGTCGATGTC GTGGTGAAGT CATCCGGTTT CACTCCTTCC ACCTCAATCA CAAAGTCTAC 121 CACCTCTTGA AAGGATGTTG CTGTTGCCGC TATCTGTAAG GCTGAAATCC GCAATTCTGA 181 TCTCAACCCC TTCACAAAAC GGCGGATCCG TTCTTGTGGA CTAAAACAGA GTTGGGTGGC 241 GTATCTGGAT AGTGCGCGAA ATTTAGCCTC ATACGCGTTT ACTGTCATCC TTCCCTGTTC 301 AAGACTCAAG AACTCATCCC TTTTCCTATC TCTCAAAGTC CTTGGGATAT ATTTCTCCAT 361 GAACAAACTA GAGAATGATT CCCAAGTCAT AGGTGGTGCC TCTGTTGGTT GACACTCAAC 421 ATGTGAACGC CACCACATCT TGGCGTTCCC TTGGAACTGA TAGCTCACGA ACTCGACGCC 481 AAACCTCTCT ACTATCCCCA TTTTGTGTAG TAGCTCATGA CAATCAACCA GAAAATCATA 541 AGCATCTTCA GATTCTGCAC CCTTGAAGAC TGGAGGTTTC AGTTTCAAGA ACTTACTGAA 601 AAGTTCATGT TGATCGTTTG TCATAATAGG CCCAGTAGTC AGACGTGGAA ATGTGCCTAT 661 TCCCAATGGT GCATCTATGC GGGGAGCCAT AGTAGCCGCA TGTCGTATCT CTG Predicted gene structure (within gDNA segment 21439 to 17258): Exon 1 19462 18752 ( 711 n); cDNA 1 711 ( 711 n); score: 0.869 MATCH C01HBa0088L02.1- SGN-E349404+ 0.869 711 0.997 C PGS_C01HBa0088L02.1-_SGN-E349404+ (19462 18752) Alignment (genomic DNA sequence = upper lines): GGAACCCTGT CCTCTAAAGT AAGAACCATT AAACTCACCT CCCTTTCGAA ACCTCTTTGA 19403 || |||| |||||| | | |||||||||| | |||| ||| ||| ||| || ||||||| || GGGGTTCTGT CCTCTAGAAT AAGAACCATT ATACTCTCCT CCCCTTCTAA ACCTCTTCGA 60 TGTCGATGCC ATGGTGAATT CATCTGGCTT CACTCCTTCC ACCTCTACCA CGAAATCTAC 19343 |||||||| | ||||||| | |||| || || |||||||||| ||||| | || | || ||||| TGTCGATGTC GTGGTGAAGT CATCCGGTTT CACTCCTTCC ACCTCAATCA CAAAGTCTAC 120 CACTTCTTGG AAGGATTTTG CCGTAGCCGC TACCTGTAAG GCTGAAATCC GCAGCTCTGA 19283 ||| ||||| |||||| ||| | || ||||| || ||||||| |||||||||| ||| ||||| CACCTCTTGA AAGGATGTTG CTGTTGCCGC TATCTGTAAG GCTGAAATCC GCAATTCTGA 180 CCTCAACCCC TTCACAAAAC GACGAATCCG CTCTTGTGGA CTGAAACAAA GTTGGGTGGC 19223 ||||||||| |||||||||| | || ||||| ||||||||| || ||||| | |||||||||| TCTCAACCCC TTCACAAAAC GGCGGATCCG TTCTTGTGGA CTAAAACAGA GTTGGGTGGC 240 ATATCTGGAT AGTGCATGAA ACTTAGCCTC ATATGCATTG ACCAACATCC TACCTTTCTC 19163 ||||||||| ||||| ||| | |||||||| ||| || || || ||||| | || | || GTATCTGGAT AGTGCGCGAA ATTTAGCCTC ATACGCGTTT ACTGTCATCC TTCCCTGTTC 300 TAGGCTCAAG AACTCATCCC TTTTCCTATC CCTCAAAGTT CGGGGGATAT ACTTCTCCAT 19103 || |||||| |||||||||| |||||||||| |||||||| | ||||||| | |||||||| AAGACTCAAG AACTCATCCC TTTTCCTATC TCTCAAAGTC CTTGGGATAT ATTTCTCCAT 360 AAACAAGCTA GAGAATGAGG CCCAAGTCAT AGGTGATGCC TCTGTTGGTT GACACTCAAC 19043 ||||| ||| |||||||| |||||||||| ||||| |||| |||||||||| |||||||||| GAACAAACTA GAGAATGATT CCCAAGTCAT AGGTGGTGCC TCTGTTGGTT GACACTCAAC 420 ATGTGACCGC CACCACATTT TGGCATTCCC TTGAAACTGA TAACTCACGA ACTCAACACC 18983 |||||| ||| |||||||| | |||| ||||| ||| |||||| || ||||||| |||| || || ATGTGAACGC CACCACATCT TGGCGTTCCC TTGGAACTGA TAGCTCACGA ACTCGACGCC 480 AAACCGTTCT ACTATACCCA TCTTGTGTAG TAGCTCATGA CAGTCAACCA GAAAATCGTA 18923 ||||| ||| ||||| |||| | |||||||| |||||||||| || ||||||| ||||||| || AAACCTCTCT ACTATCCCCA TTTTGTGTAG TAGCTCATGA CAATCAACCA GAAAATCATA 540 ATCATCCTCA GATTCAGCAC CCTTAAAGAC TAGAGGTTTC AATTTCAAGA ACTTACTGAA 18863 | |||| ||| ||||| |||| |||| ||||| | |||||||| | |||||||| |||||||||| AGCATCTTCA GATTCTGCAC CCTTGAAGAC TGGAGGTTTC AGTTTCAAGA ACTTACTGAA 600 AAGTTCATGT TGATCACTTG TCATTATAGG CCCTGTAGTC AGACGAGGAA ATGTGCCTAT 18803 |||||||||| ||||| ||| |||| ||||| ||| |||||| ||||| |||| |||||||||| AAGTTCATGT TGATCGTTTG TCATAATAGG CCCAGTAGTC AGACGTGGAA ATGTGCCTAT 660 TTCCAATGGA ACATCCATGC AAGGAGCCAT AGTAGCCGCA CGTTGTACCT C 18752 | ||||||| |||| |||| |||||||| |||||||||| || ||| || | TCCCAATGGT GCATCTATGC GGGGAGCCAT AGTAGCCGCA TGTCGTATCT C 711 hqPGS_C01HBa0088L02.1-_SGN-E349404+ (19462 18752) ******************************************************************************** EST sequence 196 +strand 679 n (File: SGN-E351625+) 1 GGGGTTCTGT CCTCTAGAAT AAGAACCATT ATACTCTCCT CCCCTTCTAA ACCTCTTCGA 61 TGTCGATGTC GTGGTGAAGT CATCCGGTTT CACTCCTTCC ACCTCAATCA CAAAGTCTAC 121 CACCTCTTGA AAGGATGTTG CTGTTGCCGC TATCTGTAAG GCTGAAATCC GCAATTCTGA 181 TCTCAACCCC TTCACAAAAC GGCGGATCCG TTCTTGTGGA CTAAAACAGA GTTGGGTGGC 241 GTATCTGGAT AGTGCGCGAA ATTTAGCCTC ATACGCGTTT ACTGTCATCC TTCCCTGTTC 301 AAGACTCAAG AACTCATCCC TTTTCCTATC TCTCAAAGTC CTTGGGATAT ATTTCTCCAT 361 GAACAAACTA GAGAATGATT CCCAAGTCAT AGGTGGTGCC TCTGTTGGTT GACACTCAAC 421 ATGTGAACGC CACCACATCT TGGCGTTCCC TTGGAACTGA TAGCTCACGA ACTCGACGCC 481 AAACCTCTCT ACTATCCCCA TTTTGTGTAG TAGCTCATGA CAATCAACCA GAAAATCATA 541 AGCATCTTCA GATTCTGCAC CCTTGAAGAC TGGAGGTTTC AGTTTCAAGA ACTTACTGAA 601 AAGTTCATGT TGATCGTTTG TCATAATAAG CCCAGTAGTC AGACGTGGAA ATGTGCCTAT 661 TCCCAATGGT GCATCTATG Predicted gene structure (within gDNA segment 21439 to 17598): Exon 1 19462 18784 ( 679 n); cDNA 1 679 ( 679 n); score: 0.869 MATCH C01HBa0088L02.1- SGN-E351625+ 0.869 679 1.000 C PGS_C01HBa0088L02.1-_SGN-E351625+ (19462 18784) Alignment (genomic DNA sequence = upper lines): GGAACCCTGT CCTCTAAAGT AAGAACCATT AAACTCACCT CCCTTTCGAA ACCTCTTTGA 19403 || |||| |||||| | | |||||||||| | |||| ||| ||| ||| || ||||||| || GGGGTTCTGT CCTCTAGAAT AAGAACCATT ATACTCTCCT CCCCTTCTAA ACCTCTTCGA 60 TGTCGATGCC ATGGTGAATT CATCTGGCTT CACTCCTTCC ACCTCTACCA CGAAATCTAC 19343 |||||||| | ||||||| | |||| || || |||||||||| ||||| | || | || ||||| TGTCGATGTC GTGGTGAAGT CATCCGGTTT CACTCCTTCC ACCTCAATCA CAAAGTCTAC 120 CACTTCTTGG AAGGATTTTG CCGTAGCCGC TACCTGTAAG GCTGAAATCC GCAGCTCTGA 19283 ||| ||||| |||||| ||| | || ||||| || ||||||| |||||||||| ||| ||||| CACCTCTTGA AAGGATGTTG CTGTTGCCGC TATCTGTAAG GCTGAAATCC GCAATTCTGA 180 CCTCAACCCC TTCACAAAAC GACGAATCCG CTCTTGTGGA CTGAAACAAA GTTGGGTGGC 19223 ||||||||| |||||||||| | || ||||| ||||||||| || ||||| | |||||||||| TCTCAACCCC TTCACAAAAC GGCGGATCCG TTCTTGTGGA CTAAAACAGA GTTGGGTGGC 240 ATATCTGGAT AGTGCATGAA ACTTAGCCTC ATATGCATTG ACCAACATCC TACCTTTCTC 19163 ||||||||| ||||| ||| | |||||||| ||| || || || ||||| | || | || GTATCTGGAT AGTGCGCGAA ATTTAGCCTC ATACGCGTTT ACTGTCATCC TTCCCTGTTC 300 TAGGCTCAAG AACTCATCCC TTTTCCTATC CCTCAAAGTT CGGGGGATAT ACTTCTCCAT 19103 || |||||| |||||||||| |||||||||| |||||||| | ||||||| | |||||||| AAGACTCAAG AACTCATCCC TTTTCCTATC TCTCAAAGTC CTTGGGATAT ATTTCTCCAT 360 AAACAAGCTA GAGAATGAGG CCCAAGTCAT AGGTGATGCC TCTGTTGGTT GACACTCAAC 19043 ||||| ||| |||||||| |||||||||| ||||| |||| |||||||||| |||||||||| GAACAAACTA GAGAATGATT CCCAAGTCAT AGGTGGTGCC TCTGTTGGTT GACACTCAAC 420 ATGTGACCGC CACCACATTT TGGCATTCCC TTGAAACTGA TAACTCACGA ACTCAACACC 18983 |||||| ||| |||||||| | |||| ||||| ||| |||||| || ||||||| |||| || || ATGTGAACGC CACCACATCT TGGCGTTCCC TTGGAACTGA TAGCTCACGA ACTCGACGCC 480 AAACCGTTCT ACTATACCCA TCTTGTGTAG TAGCTCATGA CAGTCAACCA GAAAATCGTA 18923 ||||| ||| ||||| |||| | |||||||| |||||||||| || ||||||| ||||||| || AAACCTCTCT ACTATCCCCA TTTTGTGTAG TAGCTCATGA CAATCAACCA GAAAATCATA 540 ATCATCCTCA GATTCAGCAC CCTTAAAGAC TAGAGGTTTC AATTTCAAGA ACTTACTGAA 18863 | |||| ||| ||||| |||| |||| ||||| | |||||||| | |||||||| |||||||||| AGCATCTTCA GATTCTGCAC CCTTGAAGAC TGGAGGTTTC AGTTTCAAGA ACTTACTGAA 600 AAGTTCATGT TGATCACTTG TCATTATAGG CCCTGTAGTC AGACGAGGAA ATGTGCCTAT 18803 |||||||||| ||||| ||| |||| ||| | ||| |||||| ||||| |||| |||||||||| AAGTTCATGT TGATCGTTTG TCATAATAAG CCCAGTAGTC AGACGTGGAA ATGTGCCTAT 660 TTCCAATGGA ACATCCATG 18784 | ||||||| |||| ||| TCCCAATGGT GCATCTATG 679 hqPGS_C01HBa0088L02.1-_SGN-E351625+ (19462 18784) ******************************************************************************** EST sequence 251 +strand 612 n (File: SGN-E357065+) 1 GGGTTCTGTC CTCTAGAATA AGAACCATTA TACTCTCCTC CCCTTCTAAA CCTCTTCGAT 61 GTCGATGTCG TGGTGAAGTC ATCCGGTTTC ACTCCTTCCA CCTCAATCAC AAAGTCTACC 121 ACCTCTTGAA AGGATGTTGC TGTTGCCGCT ATCTGTAAGG CTGAAATCCG CAATTCTGAT 181 CTCAACCCCT TCACAAAACG GCGGATCCGT TCTTGTGGAC TAAAACAGAG TTGGGTGGCG 241 TATCTGGATA GTGCGCGAAA TTTAGCCTCA TACGCGTTTA CTGTCATCCT TCCCTGTTCA 301 AGACTCAAGA ACTCATCCCT TTTCCTATCT CTCAAAGTCC TTGGGATATA TTTCTCCATG 361 AACAAACTAG AGAATGATTC CCAAGTCATA GGTGGTGCCT CTGTTGGTTG ACACTCAACA 421 TGTGAACGCC ACCACATCTT GGCGTTCCCT TGGAACTGAT AGCTCACGAA CTCGACGCCA 481 AACCTCTCTA CTATCCCCAT TTTGTGTAGT AGCTCATGAC AATCAACCAG AAAATCATAA 541 GCATCTTCAG ATTCTGCACC CTTGAAGACT GGAGGTTTCA GTTTCAAGAA CTTACTGAAA 601 AGTCATGTTG AT Predicted gene structure (within gDNA segment 21429 to 16557): Exon 1 19456 18849 ( 608 n); cDNA 6 612 ( 607 n); score: 0.875 MATCH C01HBa0088L02.1- SGN-E357065+ 0.875 608 0.993 C PGS_C01HBa0088L02.1-_SGN-E357065+ (19456 18849) Alignment (genomic DNA sequence = upper lines): CTGTCCTCTA AAGTAAGAAC CATTAAACTC ACCTCCCTTT CGAAACCTCT TTGATGTCGA 19397 |||||||||| | ||||||| ||||| |||| |||||| || | |||||||| | |||||||| CTGTCCTCTA GAATAAGAAC CATTATACTC TCCTCCCCTT CTAAACCTCT TCGATGTCGA 65 TGCCATGGTG AATTCATCTG GCTTCACTCC TTCCACCTCT ACCACGAAAT CTACCACTTC 19337 || | ||||| || ||||| | | |||||||| ||||||||| | ||| || | ||||||| || TGTCGTGGTG AAGTCATCCG GTTTCACTCC TTCCACCTCA ATCACAAAGT CTACCACCTC 125 TTGGAAGGAT TTTGCCGTAG CCGCTACCTG TAAGGCTGAA ATCCGCAGCT CTGACCTCAA 19277 ||| |||||| |||| || | |||||| ||| |||||||||| ||||||| | |||| ||||| TTGAAAGGAT GTTGCTGTTG CCGCTATCTG TAAGGCTGAA ATCCGCAATT CTGATCTCAA 185 CCCCTTCACA AAACGACGAA TCCGCTCTTG TGGACTGAAA CAAAGTTGGG TGGCATATCT 19217 |||||||||| ||||| || | |||| ||||| |||||| ||| || ||||||| |||| ||||| CCCCTTCACA AAACGGCGGA TCCGTTCTTG TGGACTAAAA CAGAGTTGGG TGGCGTATCT 245 GGATAGTGCA TGAAACTTAG CCTCATATGC ATTGACCAAC ATCCTACCTT TCTCTAGGCT 19157 ||||||||| |||| |||| ||||||| || || || | ||||| || | || || || GGATAGTGCG CGAAATTTAG CCTCATACGC GTTTACTGTC ATCCTTCCCT GTTCAAGACT 305 CAAGAACTCA TCCCTTTTCC TATCCCTCAA AGTTCGGGGG ATATACTTCT CCATAAACAA 19097 |||||||||| |||||||||| |||| ||||| ||| | ||| ||||| |||| |||| ||||| CAAGAACTCA TCCCTTTTCC TATCTCTCAA AGTCCTTGGG ATATATTTCT CCATGAACAA 365 GCTAGAGAAT GAGGCCCAAG TCATAGGTGA TGCCTCTGTT GGTTGACACT CAACATGTGA 19037 ||||||||| || |||||| ||||||||| |||||||||| |||||||||| |||||||||| ACTAGAGAAT GATTCCCAAG TCATAGGTGG TGCCTCTGTT GGTTGACACT CAACATGTGA 425 CCGCCACCAC ATTTTGGCAT TCCCTTGAAA CTGATAACTC ACGAACTCAA CACCAAACCG 18977 ||||||||| || ||||| | ||||||| || |||||| ||| |||||||| | | ||||||| ACGCCACCAC ATCTTGGCGT TCCCTTGGAA CTGATAGCTC ACGAACTCGA CGCCAAACCT 485 TTCTACTATA CCCATCTTGT GTAGTAGCTC ATGACAGTCA ACCAGAAAAT CGTAATCATC 18917 |||||||| ||||| |||| |||||||||| |||||| ||| |||||||||| | ||| |||| CTCTACTATC CCCATTTTGT GTAGTAGCTC ATGACAATCA ACCAGAAAAT CATAAGCATC 545 CTCAGATTCA GCACCCTTAA AGACTAGAGG TTTCAATTTC AAGAACTTAC TGAAAAGTTC 18857 |||||||| |||||||| | ||||| |||| ||||| |||| |||||||||| ||||||| || TTCAGATTCT GCACCCTTGA AGACTGGAGG TTTCAGTTTC AAGAACTTAC TGAAAAG-TC 604 ATGTTGAT 18849 |||||||| ATGTTGAT 612 hqPGS_C01HBa0088L02.1-_SGN-E357065+ (19456 18849) ******************************************************************************** EST sequence 146 +strand 524 n (File: SGN-E352365+) 1 GGGGTTCTGT CCTCTAGAAT AAGAACCATT ATACTCTCCT CCCCTTCTAA ACCTCTTCGA 61 TGTCGATGTC GTGGTGAAGT CATCCGGTTT CACTCCTTCC ACCTCAATCA CAAAGTCTAC 121 CACCTCTTGA AAGGATGTTG CTGTTGCCGC TATCTGTAAG GCTGAAATCC GCAATTCTGA 181 TCTCAACCCC TTCACAAAAC GGCGGATCCG TTCTTGTGGA CTAAAACAGA GTTGGGTGGC 241 GTATCTGGAT AGTGCGCGAA ATTTAGCCTC ATACGCGTTT ACTGTCATCC TTCCCTGTTC 301 AAGACTCAAG AACTCATCCC TTTTCCTATC TCTCAAAGTC CTTGGGATAT ATTTCTCCAT 361 GAACAAACTA GAGAATGATT CCCAAGTCAT AGGTGGTGCC TCTGTTGGTT GACACTCAAC 421 ATGTGAACGC CACCACATCT TGGCGTTCCC TTGGAACTGA TAGCTCACGA ACTCGACGCC 481 AAACCTCTCT ACTATCCCCA TTTTGTGTAG TAGCTCATGA CAAT Predicted gene structure (within gDNA segment 21439 to 17447): Exon 1 19462 18941 ( 522 n); cDNA 1 522 ( 522 n); score: 0.864 MATCH C01HBa0088L02.1- SGN-E352365+ 0.864 522 0.996 C PGS_C01HBa0088L02.1-_SGN-E352365+ (19462 18941) Alignment (genomic DNA sequence = upper lines): GGAACCCTGT CCTCTAAAGT AAGAACCATT AAACTCACCT CCCTTTCGAA ACCTCTTTGA 19403 || |||| |||||| | | |||||||||| | |||| ||| ||| ||| || ||||||| || GGGGTTCTGT CCTCTAGAAT AAGAACCATT ATACTCTCCT CCCCTTCTAA ACCTCTTCGA 60 TGTCGATGCC ATGGTGAATT CATCTGGCTT CACTCCTTCC ACCTCTACCA CGAAATCTAC 19343 |||||||| | ||||||| | |||| || || |||||||||| ||||| | || | || ||||| TGTCGATGTC GTGGTGAAGT CATCCGGTTT CACTCCTTCC ACCTCAATCA CAAAGTCTAC 120 CACTTCTTGG AAGGATTTTG CCGTAGCCGC TACCTGTAAG GCTGAAATCC GCAGCTCTGA 19283 ||| ||||| |||||| ||| | || ||||| || ||||||| |||||||||| ||| ||||| CACCTCTTGA AAGGATGTTG CTGTTGCCGC TATCTGTAAG GCTGAAATCC GCAATTCTGA 180 CCTCAACCCC TTCACAAAAC GACGAATCCG CTCTTGTGGA CTGAAACAAA GTTGGGTGGC 19223 ||||||||| |||||||||| | || ||||| ||||||||| || ||||| | |||||||||| TCTCAACCCC TTCACAAAAC GGCGGATCCG TTCTTGTGGA CTAAAACAGA GTTGGGTGGC 240 ATATCTGGAT AGTGCATGAA ACTTAGCCTC ATATGCATTG ACCAACATCC TACCTTTCTC 19163 ||||||||| ||||| ||| | |||||||| ||| || || || ||||| | || | || GTATCTGGAT AGTGCGCGAA ATTTAGCCTC ATACGCGTTT ACTGTCATCC TTCCCTGTTC 300 TAGGCTCAAG AACTCATCCC TTTTCCTATC CCTCAAAGTT CGGGGGATAT ACTTCTCCAT 19103 || |||||| |||||||||| |||||||||| |||||||| | ||||||| | |||||||| AAGACTCAAG AACTCATCCC TTTTCCTATC TCTCAAAGTC CTTGGGATAT ATTTCTCCAT 360 AAACAAGCTA GAGAATGAGG CCCAAGTCAT AGGTGATGCC TCTGTTGGTT GACACTCAAC 19043 ||||| ||| |||||||| |||||||||| ||||| |||| |||||||||| |||||||||| GAACAAACTA GAGAATGATT CCCAAGTCAT AGGTGGTGCC TCTGTTGGTT GACACTCAAC 420 ATGTGACCGC CACCACATTT TGGCATTCCC TTGAAACTGA TAACTCACGA ACTCAACACC 18983 |||||| ||| |||||||| | |||| ||||| ||| |||||| || ||||||| |||| || || ATGTGAACGC CACCACATCT TGGCGTTCCC TTGGAACTGA TAGCTCACGA ACTCGACGCC 480 AAACCGTTCT ACTATACCCA TCTTGTGTAG TAGCTCATGA CA 18941 ||||| ||| ||||| |||| | |||||||| |||||||||| || AAACCTCTCT ACTATCCCCA TTTTGTGTAG TAGCTCATGA CA 522 hqPGS_C01HBa0088L02.1-_SGN-E352365+ (19462 18941) ******************************************************************************** EST sequence 248 +strand 790 n (File: SGN-E356912+) 1 CAGGATCAAA CAATACGGAA GCCATGCAAT CACAAACTAG AAGATTACCT GTGATGACAG 61 CATCAGATGC CTCCGCTTCA GACCGCCCAG GGAAAGCGTA ACAATGGGCC CTATCGTTTG 121 TCTGCCCATT GCCCCTACCA TGTTGTGATG TAGTGGCCCC AGTTTGCCCA TTACCTCTGC 181 CGTTTTGGTG ACCACCATTA CCTCGACCAC CACGTCCTCC AGAATAACGG CCTCTACCAT 241 GACCACCTCT ACCTCTAGCT ATTGGGGGTC TATAACTTGG TCCAGGACAA TTTATCCTAA 301 TATGTCCAAT CTCCCCACAT CCATAACATT CTCTGGAGTC ACTCATAGGC CCCTTGGAGA 361 AGTGTTGACC GGTCTGAGGT GGACCCCCAA CTACAGTCTG TAGTGAAGAC TGAATGGGTC 421 GAGCCGAGTA ACCTCCGGAA CCTTGTCCTC TAGAGTAAGA ACCCTTAAAC TCACCTCCCT 481 TTCGAAACCT CTTTGATGTT GATGTCGTGG TGAAGTCGTC TGGCTTCACT CCTTCCACTT 541 CTATCACAAA GTCTACCACT TCTTGGAAGG ATTTTGCCGT TGCCGCTACC TGTAAGGCCG 601 AAATCCGCAA TTCTGACCTC AACCCCTTCA CAAACCGGAG AATCCGCTCT TGAGGACTGA 661 AACAGAGTTG AGTGGCATAT CCGGATAGTG CACGGAACTT AGCCTCATAA GCATTAACCG 721 ACATCCTACC TTGCTCTAGG CTCAGGAACT CATCTCTTTT CCTATCCCTC AAAGTCCGGG 781 GGATATACTT Predicted gene structure (within gDNA segment 20650 to 17095): Exon 1 19895 19109 ( 787 n); cDNA 3 790 ( 788 n); score: 0.903 MATCH C01HBa0088L02.1- SGN-E356912+ 0.903 787 0.996 C PGS_C01HBa0088L02.1-_SGN-E356912+ (19895 19109) Alignment (genomic DNA sequence = upper lines): GGATCAAACA ATACAGAAGC CATGCAATCA CAAACCAAAA GATTACCTGT GATGACAGCA 19836 |||||||||| |||| ||||| |||||||||| ||||| | || |||||||||| |||||||||| GGATCAAACA ATACGGAAGC CATGCAATCA CAAACTAGAA GATTACCTGT GATGACAGCA 62 TCAGATGTCT CCACCTCAGA TCTCCCAGGG AAATCATAAC AATGGGCCCT TTCATTTGTT 19776 ||||||| || || | ||||| | ||||||| ||| | |||| |||||||||| || ||||| TCAGATGCCT CCGCTTCAGA CCGCCCAGGG AAAGCGTAAC AATGGGCCCT ATCGTTTGTC 122 TGTCCGTTGC CCTTACCATG TTGTGGTGTA GTGGCTCTAG TTTTCCCATC ACCTCTGCCG 19716 || || |||| || ||||||| ||||| |||| ||||| | || ||| ||||| |||||||||| TGCCCATTGC CCCTACCATG TTGTGATGTA GTGGCCCCAG TTTGCCCATT ACCTCTGCCG 182 TTTTGGTGAC CACCATTACC TCGACCACCA CGTCCTCCAG AATAACGGCC TCTACCATGA 19656 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTTGGTGAC CACCATTACC TCGACCACCA CGTCCTCCAG AATAACGGCC TCTACCATGA 242 CCACCTCTAC CTCTAGCTAT TGGGGGTCTA TAACTCTGTT TAGGACAATT CCTCCTAATA 19596 |||||||||| |||||||||| |||||||||| ||||| || ||||||||| |||||||| CCACCTCTAC CTCTAGCTAT TGGGGGTCTA TAACTTGGTC CAGGACAATT TATCCTAATA 302 TGCCCAGTCT CCCCACATCC ATAACACTCT CTAGAGTCAA GCATAGGTCT CTCAGAAAAG 19536 || ||| ||| |||||||||| |||||| ||| || |||||| |||||| | || || ||| TGTCCAATCT CCCCACATCC ATAACATTCT CTGGAGTCAC TCATAGGCCC CTTGGAGAAG 362 TGTTGGCCGG TCTGAGGTGG ACCCCC-ACT ACAGTCTGTA GTGAAGACTG AATTGGTCGA 19477 ||||| |||| |||||||||| |||||| ||| |||||||||| |||||||||| ||| |||||| TGTTGACCGG TCTGAGGTGG ACCCCCAACT ACAGTCTGTA GTGAAGACTG AATGGGTCGA 422 ACTGAGTAAC CTCCGGAACC CTGTCCTCTA AAGTAAGAAC CATTAAACTC ACCTCCCTTT 19417 | ||||||| |||||||||| ||||||||| ||||||||| | |||||||| |||||||||| GCCGAGTAAC CTCCGGAACC TTGTCCTCTA GAGTAAGAAC CCTTAAACTC ACCTCCCTTT 482 CGAAACCTCT TTGATGTCGA TGCCATGGTG AATTCATCTG GCTTCACTCC TTCCACCTCT 19357 |||||||||| ||||||| || || | ||||| || || |||| |||||||||| |||||| ||| CGAAACCTCT TTGATGTTGA TGTCGTGGTG AAGTCGTCTG GCTTCACTCC TTCCACTTCT 542 ACCACGAAAT CTACCACTTC TTGGAAGGAT TTTGCCGTAG CCGCTACCTG TAAGGCTGAA 19297 | ||| || | |||||||||| |||||||||| |||||||| | |||||||||| |||||| ||| ATCACAAAGT CTACCACTTC TTGGAAGGAT TTTGCCGTTG CCGCTACCTG TAAGGCCGAA 602 ATCCGCAGCT CTGACCTCAA CCCCTTCACA AAACGACGAA TCCGCTCTTG TGGACTGAAA 19237 ||||||| | |||||||||| |||||||||| || || ||| |||||||||| ||||||||| ATCCGCAATT CTGACCTCAA CCCCTTCACA AACCGGAGAA TCCGCTCTTG AGGACTGAAA 662 CAAAGTTGGG TGGCATATCT GGATAGTGCA TGAAACTTAG CCTCATATGC ATTGACCAAC 19177 || ||||| | ||||||||| |||||||||| | ||||||| ||||||| || ||| ||| || CAGAGTTGAG TGGCATATCC GGATAGTGCA CGGAACTTAG CCTCATAAGC ATTAACCGAC 722 ATCCTACCTT TCTCTAGGCT CAAGAACTCA TCCCTTTTCC TATCCCTCAA AGTTCGGGGG 19117 |||||||||| ||||||||| || ||||||| || ||||||| |||||||||| ||| |||||| ATCCTACCTT GCTCTAGGCT CAGGAACTCA TCTCTTTTCC TATCCCTCAA AGTCCGGGGG 782 ATATACTT 19109 |||||||| ATATACTT 790 hqPGS_C01HBa0088L02.1-_SGN-E356912+ (19895 19109) ******************************************************************************** EST sequence 242 +strand 698 n (File: SGN-E356209+) 1 TTCAGACCGC CCAGGGAAAG CGTAACAATG GGCCCTATCG TTCGTCTGTC CGTTGCCCCT 61 ACCATGTTGT GATGTAGTGG CCCCAGTTTG CCCATTACCT CTGCCATTTT GGTGACCACC 121 ATTACCTCGA CCACCACGTC CTCCAGAATA ACGGCCTCTA CCATGACCAC CTCTACCTCT 181 AGCTATTGGG GGTCTATAAC TTTGTCTGGG ACAATTTTTC CTAATATGTC CAATCTCCCC 241 ACATCCATAA CATTCTCTGG AGTCAAGCAT AGGCCCCTCG GAGAAGTGTT AACCGGTCTG 301 AGGTGGTCTC CCAACTACAG TCTGTAGTGA AGACTGAATT GGTCGGACTG AGTAACTTCC 361 CGAACCCTGT CCTCTAGTGT AAGAACCATT AAACTCACCT CCCTTCCGAA ACCTTTTTGA 421 TGTCGATGTT GTGGTGAAGT CGTCTGGCTT CACTCCTTCC ACTTCTATCA CAAAGTCTAC 481 CACTTCTTGG AAGGATTTTG CCGTTGCCGC TATCTGTAAG GACGAAATCC GCAATTCTGA 541 CCTCAACCCC TTCACAAACC GGCGAATCCG CTCTTGAGGA CTGAAACAGA GTTGAGTGGC 601 ATATCTGGAT AGTGCACGAA ACTTAGCCTC ATAAGCATTA ACCGACATCC TACCTTGCTC 661 TAGGCTCAAG AACTCATCCC TTTTCCTATC CCTCAAAG Predicted gene structure (within gDNA segment 21375 to 18515): Exon 1 19820 19125 ( 696 n); cDNA 2 698 ( 697 n); score: 0.904 MATCH C01HBa0088L02.1- SGN-E356209+ 0.904 696 0.997 C PGS_C01HBa0088L02.1-_SGN-E356209+ (19820 19125) Alignment (genomic DNA sequence = upper lines): TCAGATCTCC CAGGGAAATC ATAACAATGG GCCCTTTCAT TTGTTTGTCC GTTGCCCTTA 19761 ||||| | || |||||||| | ||||||||| ||||| || | | || ||||| ||||||| || TCAGACCGCC CAGGGAAAGC GTAACAATGG GCCCTATCGT TCGTCTGTCC GTTGCCCCTA 61 CCATGTTGTG GTGTAGTGGC TCTAGTTTTC CCATCACCTC TGCCGTTTTG GTGACCACCA 19701 |||||||||| ||||||||| | ||||| | |||| ||||| |||| ||||| |||||||||| CCATGTTGTG ATGTAGTGGC CCCAGTTTGC CCATTACCTC TGCCATTTTG GTGACCACCA 121 TTACCTCGAC CACCACGTCC TCCAGAATAA CGGCCTCTAC CATGACCACC TCTACCTCTA 19641 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTACCTCGAC CACCACGTCC TCCAGAATAA CGGCCTCTAC CATGACCACC TCTACCTCTA 181 GCTATTGGGG GTCTATAACT CTGTTTAGGA CAATTCCTCC TAATATGCCC AGTCTCCCCA 19581 |||||||||| |||||||||| ||| | ||| ||||| ||| ||||||| || | |||||||| GCTATTGGGG GTCTATAACT TTGTCTGGGA CAATTTTTCC TAATATGTCC AATCTCCCCA 241 CATCCATAAC ACTCTCTAGA GTCAAGCATA GGTCTCTCAG AAAAGTGTTG GCCGGTCTGA 19521 |||||||||| | ||||| || |||||||||| || | ||| | | ||||||| ||||||||| CATCCATAAC ATTCTCTGGA GTCAAGCATA GGCCCCTCGG AGAAGTGTTA ACCGGTCTGA 301 GGTGGAC-CC CCACTACAGT CTGTAGTGAA GACTGAATTG GTCGAACTGA GTAACCTCCG 19462 ||||| | || | |||||||| |||||||||| |||||||||| |||| ||||| ||||| ||| GGTGGTCTCC CAACTACAGT CTGTAGTGAA GACTGAATTG GTCGGACTGA GTAACTTCCC 361 GAACCCTGTC CTCTAAAGTA AGAACCATTA AACTCACCTC CCTTTCGAAA CCTCTTTGAT 19402 |||||||||| ||||| ||| |||||||||| |||||||||| |||| ||||| ||| |||||| GAACCCTGTC CTCTAGTGTA AGAACCATTA AACTCACCTC CCTTCCGAAA CCTTTTTGAT 421 GTCGATGCCA TGGTGAATTC ATCTGGCTTC ACTCCTTCCA CCTCTACCAC GAAATCTACC 19342 ||||||| ||||||| || ||||||||| |||||||||| | |||| ||| || |||||| GTCGATGTTG TGGTGAAGTC GTCTGGCTTC ACTCCTTCCA CTTCTATCAC AAAGTCTACC 481 ACTTCTTGGA AGGATTTTGC CGTAGCCGCT ACCTGTAAGG CTGAAATCCG CAGCTCTGAC 19282 |||||||||| |||||||||| ||| |||||| | |||||||| |||||||| || |||||| ACTTCTTGGA AGGATTTTGC CGTTGCCGCT ATCTGTAAGG ACGAAATCCG CAATTCTGAC 541 CTCAACCCCT TCACAAAACG ACGAATCCGC TCTTGTGGAC TGAAACAAAG TTGGGTGGCA 19222 |||||||||| ||||||| || ||||||||| ||||| |||| ||||||| || ||| |||||| CTCAACCCCT TCACAAACCG GCGAATCCGC TCTTGAGGAC TGAAACAGAG TTGAGTGGCA 601 TATCTGGATA GTGCATGAAA CTTAGCCTCA TATGCATTGA CCAACATCCT ACCTTTCTCT 19162 |||||||||| ||||| |||| |||||||||| || ||||| | || ||||||| ||||| |||| TATCTGGATA GTGCACGAAA CTTAGCCTCA TAAGCATTAA CCGACATCCT ACCTTGCTCT 661 AGGCTCAAGA ACTCATCCCT TTTCCTATCC CTCAAAG 19125 |||||||||| |||||||||| |||||||||| ||||||| AGGCTCAAGA ACTCATCCCT TTTCCTATCC CTCAAAG 698 hqPGS_C01HBa0088L02.1-_SGN-E356209+ (19820 19125) ******************************************************************************** EST sequence 188 +strand 763 n (File: SGN-E214046+) 1 ACGAATAGGC ATATCAAGAA ATTCACAATG TAAATTTAGA CCATTAGCAA ATGAGGAAGA 61 TACATAAGAA AACGTGGATC CAGGATCAAA CAATACGGAA GCCATGCAAT CACAAACAAG 121 AAGATTACCT GTGATGACAG CATCAGATGC CTCCGCTTTA GACCGCCCAG GGAAAGCGTA 181 ACAATGGGCC CTATAGTTTG TTTGTCCATT GCCCCTACCA TGTCGTGATG TAGTGGCCCC 241 AGTTTGTCCA TTACCTCTGC CGTTTTGGTG ACCACCATTG CCTCGACCAC CACGTCCTCC 301 AAAATAACGG CCTCTACCAT GACAACCTCT ACCTCTAACT ATTGGGGGTC TATAACTTGG 361 TCCGGGAAAA TTTCTCCTAA TATGTCCAAT CTCCCCACAT CCATAACATT CTCTAGAGTC 421 ACTCATAGGC CCCTCGGAGA AGTGTTGACC GGTCTGAGGT GGACCCCCAA CTACAGTTTG 481 TAGTGAAGAC TGAATGGGTC GAACTGAGTA ACCTCCAGAA CCTTGTCCTC TAGAGTAAGA 541 ACCCTTAAAC TCATCTCCCC TTTGAAACCT CATCGATGTC GATGTCGTGG TGAAGTCGTC 601 TGGTTTCACT CCTTCCACTT CTATCAAAAA GTCTACCACT TCTTGGAAGG ATTTTGCCGT 661 TGCCGCTACC TGTAAGGGCG AAATCCGCAA TTCTGACCTC AACCCCTTCA CAACCGGCGA 721 ATCCGCTCTT GAGGGACTGA ACAGAGTTGA GTGGCATATC TGG Predicted gene structure (within gDNA segment 20748 to 18156): Exon 1 19977 19215 ( 763 n); cDNA 1 763 ( 763 n); score: 0.886 MATCH C01HBa0088L02.1- SGN-E214046+ 0.886 763 1.000 C PGS_C01HBa0088L02.1-_SGN-E214046+ (19977 19215) Alignment (genomic DNA sequence = upper lines): ACGAATAGGC ATGTCAAGTA ATTCACAATG TAAATTAAGA CCATTAGCAA ATGAGGAAGA 19918 |||||||||| || ||||| | |||||||||| |||||| ||| |||||||||| |||||||||| ACGAATAGGC ATATCAAGAA ATTCACAATG TAAATTTAGA CCATTAGCAA ATGAGGAAGA 60 TACATAAGAA AATGTGGATC CGGGATCAAA CAATACAGAA GCCATGCAAT CACAAACCAA 19858 |||||||||| || ||||||| | |||||||| |||||| ||| |||||||||| ||||||| | TACATAAGAA AACGTGGATC CAGGATCAAA CAATACGGAA GCCATGCAAT CACAAACAAG 120 AAGATTACCT GTGATGACAG CATCAGATGT CTCCACCTCA GATCTCCCAG GGAAATCATA 19798 |||||||||| |||||||||| ||||||||| |||| | | | || | ||||| ||||| | || AAGATTACCT GTGATGACAG CATCAGATGC CTCCGCTTTA GACCGCCCAG GGAAAGCGTA 180 ACAATGGGCC CTTTCATTTG TTTGTCCGTT GCCCTTACCA TGTTGTGGTG TAGTGGCTCT 19738 |||||||||| || | |||| ||||||| || |||| ||||| ||| ||| || ||||||| | ACAATGGGCC CTATAGTTTG TTTGTCCATT GCCCCTACCA TGTCGTGATG TAGTGGCCCC 240 AGTTTTCCCA TCACCTCTGC CGTTTTGGTG ACCACCATTA CCTCGACCAC CACGTCCTCC 19678 ||||| ||| | |||||||| |||||||||| ||||||||| |||||||||| |||||||||| AGTTTGTCCA TTACCTCTGC CGTTTTGGTG ACCACCATTG CCTCGACCAC CACGTCCTCC 300 AGAATAACGG CCTCTACCAT GACCACCTCT ACCTCTAGCT ATTGGGGGTC TATAACTCTG 19618 | |||||||| |||||||||| ||| |||||| ||||||| || |||||||||| ||||||| | AAAATAACGG CCTCTACCAT GACAACCTCT ACCTCTAACT ATTGGGGGTC TATAACTTGG 360 TTTAGGACAA TTCCTCCTAA TATGCCCAGT CTCCCCACAT CCATAACACT CTCTAGAGTC 19558 | ||| || || ||||||| |||| ||| | |||||||||| |||||||| | |||||||||| TCCGGGAAAA TTTCTCCTAA TATGTCCAAT CTCCCCACAT CCATAACATT CTCTAGAGTC 420 AAGCATAGGT CTCTCAGAAA AGTGTTGGCC GGTCTGAGGT GGACCCCC-A CTACAGTCTG 19499 | |||||| | ||| || | ||||||| || |||||||||| |||||||| | ||||||| || ACTCATAGGC CCCTCGGAGA AGTGTTGACC GGTCTGAGGT GGACCCCCAA CTACAGTTTG 480 TAGTGAAGAC TGAATTGGTC GAACTGAGTA ACCTCCGGAA CCCTGTCCTC TAAAGTAAGA 19439 |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| || ||||||| TAGTGAAGAC TGAATGGGTC GAACTGAGTA ACCTCCAGAA CCTTGTCCTC TAGAGTAAGA 540 ACCATTAAAC TCACCTCCCT TTCGAAACCT CTTTGATGTC GATGCCATGG TGAATTCATC 19379 ||| |||||| ||| ||||| || ||||||| | | |||||| |||| | ||| |||| || || ACCCTTAAAC TCATCTCCCC TTTGAAACCT CATCGATGTC GATGTCGTGG TGAAGTCGTC 600 TGGCTTCACT CCTTCCACCT CTACCACGAA ATCTACCACT TCTTGGAAGG ATTTTGCCGT 19319 ||| |||||| |||||||| | ||| || || ||||||||| |||||||||| |||||||||| TGGTTTCACT CCTTCCACTT CTATCAAAAA GTCTACCACT TCTTGGAAGG ATTTTGCCGT 660 AGCCGCTACC TGTAAGGCTG AAATCCGCAG CTCTGACCTC AACCCCTTCA CAAAACGACG 19259 ||||||||| ||||||| | ||||||||| ||||||||| |||||||||| | || || || TGCCGCTACC TGTAAGGGCG AAATCCGCAA TTCTGACCTC AACCCCTTCA C-AACCGGCG 719 AATCCGCTCT TG-TGGACTG AAACAAAGTT GGGTGGCATA TCTGG 19215 |||||||||| || |||||| |||| |||| | |||||||| ||||| AATCCGCTCT TGAGGGACTG -AACAGAGTT GAGTGGCATA TCTGG 763 hqPGS_C01HBa0088L02.1-_SGN-E214046+ (19977 19215) ******************************************************************************** EST sequence 179 +strand 533 n (File: SGN-E353805+) 1 GGATCAACAA TACGGAAGCC ATGCAATCAC AAACTAGAAG ATTACCTGTG ATGACAGCAT 61 CAGATGCCTC CGCTTCAGAC CGCCCAGGGA AAGCGTAACA ATGGGCCCTA TCGTTTGTCT 121 GCCCATTGCC CCTACCATGT TGTGATGTAG TGGCCCCAGT TTGCCCATTA CCTCTGCCGT 181 TTTGGTGACC ACCATTACCT CGACCACCAC GTCCTCCAGA ATAACGGCCT CTACCATGAC 241 CACCTCTACC TCTAGCTATT GGGGGTCTAT AACTTGGTCC AGGACAATTT ATCCTAATAT 301 GTCCAATCTC CCCACATCCA TAACATTCTC TGGAGTCACT CATAGGCCCC TTGGAGAAGT 361 GTTGACCGGT CTGAGGTGGA CCCCCAACTA CAGTCTGTAG TGAAGACTGA ATGGGTCGAG 421 CCGAGTAACC TCCGGAACCT TGTCCTCTAA AGTAAGAACC CTTAAACTCA CCTCCCTTTC 481 GAAACCTCTT TGATGTTGAT GTCGTGGTGA AGTCGTCTGG CTTCACTCCT TCC Predicted gene structure (within gDNA segment 20620 to 18420): Exon 1 19895 19363 ( 533 n); cDNA 1 533 ( 533 n); score: 0.902 MATCH C01HBa0088L02.1- SGN-E353805+ 0.902 533 1.000 C PGS_C01HBa0088L02.1-_SGN-E353805+ (19895 19363) Alignment (genomic DNA sequence = upper lines): GGATCAAACA ATACAGAAGC CATGCAATCA CAAACCAAAA GATTACCTGT GATGACAGCA 19836 ||||| |||| |||| ||||| |||||||||| ||||| | || |||||||||| |||||||||| GGATC-AACA ATACGGAAGC CATGCAATCA CAAACTAGAA GATTACCTGT GATGACAGCA 59 TCAGATGTCT CCACCTCAGA TCTCCCAGGG AAATCATAAC AATGGGCCCT TTCATTTGTT 19776 ||||||| || || | ||||| | ||||||| ||| | |||| |||||||||| || ||||| TCAGATGCCT CCGCTTCAGA CCGCCCAGGG AAAGCGTAAC AATGGGCCCT ATCGTTTGTC 119 TGTCCGTTGC CCTTACCATG TTGTGGTGTA GTGGCTCTAG TTTTCCCATC ACCTCTGCCG 19716 || || |||| || ||||||| ||||| |||| ||||| | || ||| ||||| |||||||||| TGCCCATTGC CCCTACCATG TTGTGATGTA GTGGCCCCAG TTTGCCCATT ACCTCTGCCG 179 TTTTGGTGAC CACCATTACC TCGACCACCA CGTCCTCCAG AATAACGGCC TCTACCATGA 19656 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTTGGTGAC CACCATTACC TCGACCACCA CGTCCTCCAG AATAACGGCC TCTACCATGA 239 CCACCTCTAC CTCTAGCTAT TGGGGGTCTA TAACTCTGTT TAGGACAATT CCTCCTAATA 19596 |||||||||| |||||||||| |||||||||| ||||| || ||||||||| |||||||| CCACCTCTAC CTCTAGCTAT TGGGGGTCTA TAACTTGGTC CAGGACAATT TATCCTAATA 299 TGCCCAGTCT CCCCACATCC ATAACACTCT CTAGAGTCAA GCATAGGTCT CTCAGAAAAG 19536 || ||| ||| |||||||||| |||||| ||| || |||||| |||||| | || || ||| TGTCCAATCT CCCCACATCC ATAACATTCT CTGGAGTCAC TCATAGGCCC CTTGGAGAAG 359 TGTTGGCCGG TCTGAGGTGG ACCCCC-ACT ACAGTCTGTA GTGAAGACTG AATTGGTCGA 19477 ||||| |||| |||||||||| |||||| ||| |||||||||| |||||||||| ||| |||||| TGTTGACCGG TCTGAGGTGG ACCCCCAACT ACAGTCTGTA GTGAAGACTG AATGGGTCGA 419 ACTGAGTAAC CTCCGGAACC CTGTCCTCTA AAGTAAGAAC CATTAAACTC ACCTCCCTTT 19417 | ||||||| |||||||||| ||||||||| |||||||||| | |||||||| |||||||||| GCCGAGTAAC CTCCGGAACC TTGTCCTCTA AAGTAAGAAC CCTTAAACTC ACCTCCCTTT 479 CGAAACCTCT TTGATGTCGA TGCCATGGTG AATTCATCTG GCTTCACTCC TTCC 19363 |||||||||| ||||||| || || | ||||| || || |||| |||||||||| |||| CGAAACCTCT TTGATGTTGA TGTCGTGGTG AAGTCGTCTG GCTTCACTCC TTCC 533 hqPGS_C01HBa0088L02.1-_SGN-E353805+ (19895 19363) ******************************************************************************** EST sequence 191 +strand 559 n (File: SGN-E244046+) 1 AAACACGAAT AGGCATATCA AGTAATTCAC AATGTAAAGT TAGACCATTA GCAAATGAGG 61 AAGATACATA AGAAAATGTG GATCCAGGAT CAAACAATAC AGAAGCCATG CAATCACAAA 121 CCAAAAGATT ACCTGTGATG ACAACATCAG ATTCCTCCGC TTCAGACCGC CCAGGGAAAG 181 CGTAACAATG GGCCCTATCA TTCTTATGTC TGTTGCCCCT ACCATGTTGT GATGTAGTGG 241 CTCCAGTTTG CCCATCACCT CGGCCGTTTT GGTGACCACC ATTTCCTCGA CCGCCACGTC 301 CTCCAGAATA ACGGACTCTG CCATGACCAC CTCTACCTCT AACCTTTGGA GGTCTGTAAC 361 TCTGTTTTGG ACAATATCTC TTAATATGTC CAATCTCCCC ACACCCATAG CACTCTCTGG 421 GTTCATGCAT AAGTCTCTCA GAGAAGTGTT GACCGGTCGA AGGTGGACCC CCAACTACAG 481 TCTGTAGTGA AGACTGAATT GGTCGGACTG AGTAACTTCC CGAACCCTGT CCTCTAGTGT 541 AAGCACCATT AAACTCACC Predicted gene structure (within gDNA segment 20581 to 18328): Exon 1 19981 19424 ( 558 n); cDNA 1 559 ( 559 n); score: 0.897 MATCH C01HBa0088L02.1- SGN-E244046+ 0.897 558 0.998 C PGS_C01HBa0088L02.1-_SGN-E244046+ (19981 19424) Alignment (genomic DNA sequence = upper lines): AAACACGAAT AGGCATGTCA AGTAATTCAC AATGTAAATT AAGACCATTA GCAAATGAGG 19922 |||||||||| |||||| ||| |||||||||| |||||||| | ||||||||| |||||||||| AAACACGAAT AGGCATATCA AGTAATTCAC AATGTAAAGT TAGACCATTA GCAAATGAGG 60 AAGATACATA AGAAAATGTG GATCCGGGAT CAAACAATAC AGAAGCCATG CAATCACAAA 19862 |||||||||| |||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| AAGATACATA AGAAAATGTG GATCCAGGAT CAAACAATAC AGAAGCCATG CAATCACAAA 120 CCAAAAGATT ACCTGTGATG ACAGCATCAG ATGTCTCCAC CTCAGATCTC CCAGGGAAAT 19802 |||||||||| |||||||||| ||| |||||| || |||| | ||||| | | ||||||||| CCAAAAGATT ACCTGTGATG ACAACATCAG ATTCCTCCGC TTCAGACCGC CCAGGGAAAG 180 CATAACAATG GGCCCTTTCA TTTGTTTGTC CGTTGCCCTT ACCATGTTGT GGTGTAGTGG 19742 | |||||||| |||||| ||| || | |||| ||||||| | |||||||||| | |||||||| CGTAACAATG GGCCCTATCA TTCTTATGTC TGTTGCCCCT ACCATGTTGT GATGTAGTGG 240 CTCTAGTTTT CCCATCACCT CTGCCGTTTT GGTGACCACC ATTACCTCGA CCACCACGTC 19682 ||| ||||| |||||||||| | |||||||| |||||||||| ||| |||||| || ||||||| CTCCAGTTTG CCCATCACCT CGGCCGTTTT GGTGACCACC ATTTCCTCGA CCGCCACGTC 300 CTCCAGAATA ACGGCCTCTA CCATGACCAC CTCTACCTCT AGCTATTGGG GGTCTATAAC 19622 |||||||||| |||| |||| |||||||||| |||||||||| | | |||| ||||| |||| CTCCAGAATA ACGGACTCTG CCATGACCAC CTCTACCTCT AACCTTTGGA GGTCTGTAAC 360 TCTGTTTAGG ACAATTCCTC CTAATATGCC CAGTCTCCCC ACATCCATAA CACTCTCTAG 19562 ||||||| || ||||| ||| ||||||| | || ||||||| ||| ||||| |||||||| | TCTGTTTTGG ACAATATCTC TTAATATGTC CAATCTCCCC ACACCCATAG CACTCTCTGG 420 AGTCAAGCAT AGGTCTCTCA GAAAAGTGTT GGCCGGTCTG AGGTGGACCC CC-ACTACAG 19503 ||| |||| | |||||||| || ||||||| | |||||| |||||||||| || ||||||| GTTCATGCAT AAGTCTCTCA GAGAAGTGTT GACCGGTCGA AGGTGGACCC CCAACTACAG 480 TCTGTAGTGA AGACTGAATT GGTCGAACTG AGTAACCTCC GGAACCCTGT CCTCTAAAGT 19443 |||||||||| |||||||||| ||||| |||| |||||| ||| ||||||||| |||||| || TCTGTAGTGA AGACTGAATT GGTCGGACTG AGTAACTTCC CGAACCCTGT CCTCTAGTGT 540 AAGAACCATT AAACTCACC 19424 ||| |||||| ||||||||| AAGCACCATT AAACTCACC 559 hqPGS_C01HBa0088L02.1-_SGN-E244046+ (19981 19424) ******************************************************************************** EST sequence 235 +strand 543 n (File: SGN-E355026+) 1 GAACACATCC AAAAATTCTC AAACTACCAA AACTAATTCA ATTGAGGGTA CTTGGATAGT 61 GTCATCCTTG AGATGTGCCA AGAAGGATAG ACAACCCTTA CTAACCATCT TCTGAGCACA 121 AAGAAAGGAG ATAATACGCA CCGGATTGGA AGTGTAGTCA CCCTCCCACA CTAACGGATC 181 TGTCCCAGGC TTGGCTAACG TCACCGTTTT AGCATTACAA TCCAAGATCG CAAAATTGGG 241 AGAAAGCCAA GTCATACCCA GAATTACATC AAAGTCACCC ATTTCTAAAG TAACCAAATC 301 TAGATAAGTG TTGCTCCCCA CGAAATTCAC CAAACAAGAC CTATGTACCT TTTCAACTAT 361 CACAGACTCA CCCACCGGAG TAGAAACACG AATAGGCATG TCAAGTAATT CACAATGCAA 421 TTTTAGACCA TTAGCAAATG ATGAAGATAC ATATGAAAAC GTGGAGCCAG GGTCAAATAA 481 TACAGATGCC ATGCAATCAC AAACCAAGAG ATTACCTGTG ATAACAGCAT CAGACGCCTC 541 TGC Predicted gene structure (within gDNA segment 22161 to 18294): Exon 1 20364 19825 ( 540 n); cDNA 1 540 ( 540 n); score: 0.900 MATCH C01HBa0088L02.1- SGN-E355026+ 0.900 540 0.994 C PGS_C01HBa0088L02.1-_SGN-E355026+ (20364 19825) Alignment (genomic DNA sequence = upper lines): GAACACATCC AAAAACTCGC GGACTACCGA AACCGACTCA ATCGAAGGTA CTTGGGTAGT 20305 |||||||||| ||||| || | |||||| | ||| | ||| || || |||| ||||| |||| GAACACATCC AAAAATTCTC AAACTACCAA AACTAATTCA ATTGAGGGTA CTTGGATAGT 60 GTCATCCTTG AGATGGGCCA AGAAAGCTAA ACACCCTTTA CTAACCATTT TCTTAGCACG 20245 |||||||||| ||||| |||| |||| | || ||| || ||| |||||||| | ||| ||||| GTCATCCTTG AGATGTGCCA AGAAGGATAG ACAACCCTTA CTAACCATCT TCTGAGCACA 120 AAGAAAGGAG ATGATACGCA CCGGATTGGA AGTGTAGTCA CCCTCCCACA CTAACGGGTC 20185 |||||||||| || ||||||| |||||||||| |||||||||| |||||||||| ||||||| || AAGAAAGGAG ATAATACGCA CCGGATTGGA AGTGTAGTCA CCCTCCCACA CTAACGGATC 180 TGTCCTAGGC TTGGCTAACG TCACCATTTT AGCATTACAA TCCAAGATCG CAAAATTCGG 20125 ||||| |||| |||||||||| ||||| |||| |||||||||| |||||||||| ||||||| || TGTCCCAGGC TTGGCTAACG TCACCGTTTT AGCATTACAA TCCAAGATCG CAAAATTGGG 240 AGAAAGCCAA GTCATACGCA GAATTACATC AAAGTCAACC ATTTCTAAGA TAACCAAATC 20065 |||||||||| ||||||| || |||||||||| ||||||| || |||||||| |||||||||| AGAAAGCCAA GTCATACCCA GAATTACATC AAAGTCACCC ATTTCTAAAG TAACCAAATC 300 TACATAAGTG TTACTCCCTA CAAAAGTCAC CAAACAAGAC CTATACACTT TTTCAACTAT 20005 || ||||||| || ||||| | | ||| |||| |||||||||| |||| || | |||||||||| TAGATAAGTG TTGCTCCCCA CGAAATTCAC CAAACAAGAC CTATGTACCT TTTCAACTAT 360 CACAGACTCA CCCATCGGGG TAGAAACACG AATAGGCATG TCAAGTAATT CACAATGTAA 19945 |||||||||| |||| ||| | |||||||||| |||||||||| |||||||||| ||||||| || CACAGACTCA CCCACCGGAG TAGAAACACG AATAGGCATG TCAAGTAATT CACAATGCAA 420 ATTAAGACCA TTAGCAAATG AGGAAGATAC ATAAGAAAAT GTGGATCCGG GATCAAACAA 19885 || |||||| |||||||||| | |||||||| ||| ||||| ||||| || | | ||||| || TTTTAGACCA TTAGCAAATG ATGAAGATAC ATATGAAAAC GTGGAGCCAG GGTCAAATAA 480 TACAGAAGCC ATGCAATCAC AAACCAAAAG ATTACCTGTG ATGACAGCAT CAGATGTCTC 19825 |||||| ||| |||||||||| ||||||| || |||||||||| || ||||||| |||| | ||| TACAGATGCC ATGCAATCAC AAACCAAGAG ATTACCTGTG ATAACAGCAT CAGACGCCTC 540 hqPGS_C01HBa0088L02.1-_SGN-E355026+ (20364 19825) ******************************************************************************** EST sequence 228 +strand 761 n (File: SGN-E355244+) 1 CGGAAACTCC CATCCTTCTT CTTCACAAAC AAAATCGGAG CACCCCAAGG AGATGCACTT 61 GGTCTAATGA AACCTTTGCT CAACAACTCT TGAAGTTGGG CCTTTAACTC TCTTAACTCT 121 ACGGGAGCCA TTCTATAAGG GGGTATAGAA ATGGGGCGTG TGCCCGGTTC AAGATCGATA 181 CAGAAGTCAA TATCCCTATC TGGTGGCATA CCAGGAAGAT CTGCAGGGAA CACATCCAAA 241 AACTCACAGA CTATAAAAAC CGACTCAATC GAAGGTACTT GGGTAGTGTC ATCCTTGAGA 301 TGTGCCAAGA AAGCTAAACA CCCTTTACTA ACCATTTTCT TAGCACGAAG AAAGGAGATG 361 ATGCACACCG GATTGGAAGT GTAGTCACCC TCCCACACTA ACGGATCTGT CCCAGGCTTG 421 GCTAATGTCA CCGTTTTAGC ATTACAATCC AAGATCGCAA ATTGCGGAGA AAGCCAAGTC 481 ATACCCAGAA TTACATCAAA ATCAACCATT TCTAAGATAA CCAAATCTAC ATAAGTGTTG 541 CTCCCCACAA AGTTCACCAA ACAAGACCTA TATACCTTTT CAACTACCAC AGACTCACCC 601 ACCGGAGTAG AAACACGAAT AGGCATATCA AGTAATTCAC AATGTAAATT TAGACCGTTA 661 GCAAATGAGG AAGATACANT AGAAAACGTG GATCCCAGGA TCAACAATAC AGAAGCCATG 721 CAATCACAAT CGAAAGATTA CCTGTGATGA CAGCATCTAA T Predicted gene structure (within gDNA segment 21218 to 18474): Exon 1 20591 19830 ( 762 n); cDNA 1 761 ( 761 n); score: 0.932 MATCH C01HBa0088L02.1- SGN-E355244+ 0.932 762 1.001 C PGS_C01HBa0088L02.1-_SGN-E355244+ (20591 19830) Alignment (genomic DNA sequence = upper lines): CGAAAACTCC CATCCTTCTT CTTCACAAAC AAAACCGGAG CACCCCAAGG AGATGCACTT 20532 || ||||||| |||||||||| |||||||||| |||| ||||| |||||||||| |||||||||| CGGAAACTCC CATCCTTCTT CTTCACAAAC AAAATCGGAG CACCCCAAGG AGATGCACTT 60 GGTCTGATGA AGCCTTTGTT CAACAACTCT TGAAGTTGGG CCTTTAACTC TCTCAACTCC 20472 ||||| |||| | |||||| | |||||||||| |||||||||| |||||||||| ||| ||||| GGTCTAATGA AACCTTTGCT CAACAACTCT TGAAGTTGGG CCTTTAACTC TCTTAACTCT 120 GCGGGAGCCA TTCTATAAGG GGGTATAGAA ATGGGGCGAG TGCCCGGTTC AAGATCAATG 20412 ||||||||| |||||||||| |||||||||| |||||||| | |||||||||| |||||| || ACGGGAGCCA TTCTATAAGG GGGTATAGAA ATGGGGCGTG TGCCCGGTTC AAGATCGATA 180 CAGAAGTCAA TATCCCTATC TGGTGGCATA CCAGGAAGAT CTGCAGGGAA CACATCCAAA 20352 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGAAGTCAA TATCCCTATC TGGTGGCATA CCAGGAAGAT CTGCAGGGAA CACATCCAAA 240 AACTCGCGGA CTACCGAAAC CGACTCAATC GAAGGTACTT GGGTAGTGTC ATCCTTGAGA 20292 ||||| | || ||| |||| |||||||||| |||||||||| |||||||||| |||||||||| AACTCACAGA CTATAAAAAC CGACTCAATC GAAGGTACTT GGGTAGTGTC ATCCTTGAGA 300 TGGGCCAAGA AAGCTAAACA CCCTTTACTA ACCATTTTCT TAGCACGAAG AAAGGAGATG 20232 || ||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTGCCAAGA AAGCTAAACA CCCTTTACTA ACCATTTTCT TAGCACGAAG AAAGGAGATG 360 ATACGCACCG GATTGGAAGT GTAGTCACCC TCCCACACTA ACGGGTCTGT CCTAGGCTTG 20172 || | ||||| |||||||||| |||||||||| |||||||||| |||| ||||| || ||||||| ATGCACACCG GATTGGAAGT GTAGTCACCC TCCCACACTA ACGGATCTGT CCCAGGCTTG 420 GCTAACGTCA CCATTTTAGC ATTACAATCC AAGATCGCAA AATTCGGAGA AAGCCAAGTC 20112 ||||| |||| || ||||||| |||||||||| |||||||||| | | |||||| |||||||||| GCTAATGTCA CCGTTTTAGC ATTACAATCC AAGATCGCAA ATTGCGGAGA AAGCCAAGTC 480 ATACGCAGAA TTACATCAAA GTCAACCATT TCTAAGATAA CCAAATCTAC ATAAGTGTTA 20052 |||| ||||| |||||||||| ||||||||| |||||||||| |||||||||| ||||||||| ATACCCAGAA TTACATCAAA ATCAACCATT TCTAAGATAA CCAAATCTAC ATAAGTGTTG 540 CTCCCTACAA AAGTCACCAA ACAAGACCTA TACACTTTTT CAACTATCAC AGACTCACCC 19992 ||||| |||| | ||||||| |||||||||| || || |||| |||||| ||| |||||||||| CTCCCCACAA AGTTCACCAA ACAAGACCTA TATACCTTTT CAACTACCAC AGACTCACCC 600 ATCGGGGTAG AAACACGAAT AGGCATGTCA AGTAATTCAC AATGTAAATT AAGACCATTA 19932 | ||| |||| |||||||||| |||||| ||| |||||||||| |||||||||| ||||| ||| ACCGGAGTAG AAACACGAAT AGGCATATCA AGTAATTCAC AATGTAAATT TAGACCGTTA 660 GCAAATGAGG AAGATACATA AGAAAATGTG GAT-CCGGGA TCAAACAATA CAGAAGCCAT 19873 |||||||||| |||||||| |||||| ||| ||| || ||| || ||||||| |||||||||| GCAAATGAGG AAGATACANT AGAAAACGTG GATCCCAGGA TC-AACAATA CAGAAGCCAT 719 GCAATCACAA ACCAAAAGAT TACCTGTGAT GACAGCATCA GAT 19830 |||||||| | | | |||||| |||||||||| ||||||||| || GCAATCAC-A ATCGAAAGAT TACCTGTGAT GACAGCATCT AAT 761 hqPGS_C01HBa0088L02.1-_SGN-E355244+ (20591 19830) ******************************************************************************** EST sequence 182 +strand 331 n (File: SGN-E352716+) 1 GATCTGTCCC AGGCTTGGCT AACGTCACAG TTTTAGCATT ACAATCCAAG ATTGCAAAAT 61 TTGGAGAAAG CCAAGTCATA CCCAGAATTA CATCAAAATC AACCATTTCT AAGATAACCA 121 AGTCTACATA AGTATTGCTC CCCACAAAAG TCACCAGACC AGACCTATAT ACTTTTTCAA 181 CTATCACAGA CTCACCCACC GGAGTAGAAA CACGAATAGG CATGTCAAGC AATTCATAAT 241 TTAATTTAAG ACCAGTAGCA AATGAGGAAG ATACATATGA AAATGTGGAT CCAGGGTCAA 301 ATAATACAAA AGCCATGCAA TCACAAAAAA A Predicted gene structure (within gDNA segment 20878 to 18330): Exon 1 20186 19858 ( 329 n); cDNA 3 331 ( 329 n); score: 0.915 MATCH C01HBa0088L02.1- SGN-E352716+ 0.915 329 0.994 C PGS_C01HBa0088L02.1-_SGN-E352716+ (20186 19858) Alignment (genomic DNA sequence = upper lines): TCTGTCCTAG GCTTGGCTAA CGTCACCATT TTAGCATTAC AATCCAAGAT CGCAAAATTC 20127 ||||||| || |||||||||| |||||| || |||||||||| |||||||||| |||||||| TCTGTCCCAG GCTTGGCTAA CGTCACAGTT TTAGCATTAC AATCCAAGAT TGCAAAATTT 62 GGAGAAAGCC AAGTCATACG CAGAATTACA TCAAAGTCAA CCATTTCTAA GATAACCAAA 20067 |||||||||| ||||||||| |||||||||| ||||| |||| |||||||||| ||||||||| GGAGAAAGCC AAGTCATACC CAGAATTACA TCAAAATCAA CCATTTCTAA GATAACCAAG 122 TCTACATAAG TGTTACTCCC TACAAAAGTC ACCAAACAAG ACCTATACAC TTTTTCAACT 20007 |||||||||| | || ||||| ||||||||| |||| || || ||||||| || |||||||||| TCTACATAAG TATTGCTCCC CACAAAAGTC ACCAGACCAG ACCTATATAC TTTTTCAACT 182 ATCACAGACT CACCCATCGG GGTAGAAACA CGAATAGGCA TGTCAAGTAA TTCACAATGT 19947 |||||||||| |||||| ||| ||||||||| |||||||||| ||||||| || |||| ||| | ATCACAGACT CACCCACCGG AGTAGAAACA CGAATAGGCA TGTCAAGCAA TTCATAATTT 242 AAATTAAGAC CATTAGCAAA TGAGGAAGAT ACATAAGAAA ATGTGGATCC GGGATCAAAC 19887 || ||||||| || ||||||| |||||||||| ||||| |||| |||||||||| || ||||| AATTTAAGAC CAGTAGCAAA TGAGGAAGAT ACATATGAAA ATGTGGATCC AGGGTCAAAT 302 AATACAGAAG CCATGCAATC ACAAACCAA 19858 |||||| ||| |||||||||| ||||| || AATACAAAAG CCATGCAATC ACAAAAAAA 331 hqPGS_C01HBa0088L02.1-_SGN-E352716+ (20186 19858) ******************************************************************************** EST sequence 43 -strand 659 n (File: SGN-E352117-) 1 CCCAAGGGGA TGCACTTGGC NTAATGAAGC CCTTACNTAA CAACTCTTGA AGTTGGGCCT 61 TTAACTCCCC CAACTCAGCG GGAGCCATTC TATAAGGGGG TATGGAAATG GGGTGATCAC 121 CCGGCTCCAG ATCAATGCAA AAGTCAATAT CCCTATCCGG TGGCATACCA GGAAGGTCTG 181 CAGGAAACAC ATCCAGAAAC TCACGGACTA TCGAAACTGA CTCAATTGAA GGTACTTGGG 241 TAGTATCATC CCTGAGGTGT GCCAAGAAAG CTAAACACCC TTTACTAACC ATTCTCTTAG 301 CACAAAGAAA GGAGATGATA CGAACTGGAG TGGAAGTGTA GTCACCCTCC CACACTAACG 361 CATCTATCTC AGGCTTGGCC AACGTTACAG TTTTAGCATT ACAATCCAAG ATTGCAAAAT 421 TTGGAGACAG CCAAGTCATA CCCAGAATTA CATCGAAGTC AACCATTTAT AGGATAACCA 481 AGTCTACATG AGTATTGCTC CCACAAATGT CACAAGACAA GACCTATACA CCTTTTCAAC 541 AATCACAGAC TCACCCACCG GAGTAGAACA CGAATAGGTA TGTCAAGCGA TTCACTATGT 601 AAATTAAGAA CAGTAGCAAA TGAGGAAGAT ACATATGAAA ATGTGGAGGC AGGATCAAA Predicted gene structure (within gDNA segment 21500 to 16599): Exon 1 20548 19888 ( 661 n); cDNA 1 659 ( 659 n); score: 0.885 MATCH C01HBa0088L02.1- SGN-E352117- 0.885 661 1.003 C PGS_C01HBa0088L02.1-_SGN-E352117- (20548 19888) Alignment (genomic DNA sequence = upper lines): CCCAAGGAGA TGCACTTGGT CTGATGAAGC CTTTGTTCAA CAACTCTTGA AGTTGGGCCT 20489 ||||||| || ||||||||| | ||||||| | || || |||||||||| |||||||||| CCCAAGGGGA TGCACTTGGC NTAATGAAGC CCTTACNTAA CAACTCTTGA AGTTGGGCCT 60 TTAACTCTCT CAACTCCGCG GGAGCCATTC TATAAGGGGG TATAGAAATG GGGCGAGTGC 20429 ||||||| | |||||| ||| |||||||||| |||||||||| ||| |||||| ||| || | TTAACTCCCC CAACTCAGCG GGAGCCATTC TATAAGGGGG TATGGAAATG GGGTGATCAC 120 CCGGTTCAAG ATCAATGCAG AAGTCAATAT CCCTATCTGG TGGCATACCA GGAAGATCTG 20369 |||| || || ||||||||| |||||||||| ||||||| || |||||||||| ||||| |||| CCGGCTCCAG ATCAATGCAA AAGTCAATAT CCCTATCCGG TGGCATACCA GGAAGGTCTG 180 CAGGGAACAC ATCCAAAAAC TCGCGGACTA CCGAAACCGA CTCAATCGAA GGTACTTGGG 20309 |||| ||||| ||||| |||| || ||||||| |||||| || |||||| ||| |||||||||| CAGGAAACAC ATCCAGAAAC TCACGGACTA TCGAAACTGA CTCAATTGAA GGTACTTGGG 240 TAGTGTCATC CTTGAGATGG GCCAAGAAAG CTAAACACCC TTTACTAACC ATTTTCTTAG 20249 |||| ||||| | |||| || |||||||||| |||||||||| |||||||||| ||| |||||| TAGTATCATC CCTGAGGTGT GCCAAGAAAG CTAAACACCC TTTACTAACC ATTCTCTTAG 300 CACGAAGAAA GGAGATGATA CGCACCGGAT TGGAAGTGTA GTCACCCTCC CACACTAACG 20189 ||| |||||| |||||||||| || || ||| |||||||||| |||||||||| |||||||||| CACAAAGAAA GGAGATGATA CGAACTGGAG TGGAAGTGTA GTCACCCTCC CACACTAACG 360 GGTCTGTCCT AGGCTTGGCT AACGTCACCA TTTTAGCATT ACAATCCAAG ATCGCAAAAT 20129 ||| || ||||||||| ||||| || |||||||||| |||||||||| || ||||||| CATCTATCTC AGGCTTGGCC AACGTTACAG TTTTAGCATT ACAATCCAAG ATTGCAAAAT 420 TCGGAGAAAG CCAAGTCATA CGCAGAATTA CATCAAAGTC AACCATTTCT AAGATAACCA 20069 | ||||| || |||||||||| | |||||||| |||| ||||| |||||||| | | |||||||| TTGGAGACAG CCAAGTCATA CCCAGAATTA CATCGAAGTC AACCATTTAT AGGATAACCA 480 AATCTACATA AGTGTTACTC CCTACAAAAG TCACCAAACA AGACCTATAC ACTTTTTCAA 20009 | ||||||| ||| || ||| || ||||| | |||| | ||| |||||||||| || ||||||| AGTCTACATG AGTATTGCTC CC-ACAAATG TCACAAGACA AGACCTATAC ACCTTTTCAA 539 CTATCACAGA CTCACCCATC GGGGTAGAAA CACGAATAGG CATGTCAAGT AATTCACAAT 19949 | |||||||| |||||||| | || |||| || |||||||||| |||||||| |||||| || CAATCACAGA CTCACCCACC GGAGTAG-AA CACGAATAGG TATGTCAAGC GATTCACTAT 598 GTAAATTAAG ACCATTAGCA AATGAGGAAG ATACATAAGA AAATGTGGAT CCGGGATCAA 19889 |||||||||| | || ||||| |||||||||| ||||||| || ||||||||| | ||||||| GTAAATTAAG AACAGTAGCA AATGAGGAAG ATACATATGA AAATGTGGAG GCAGGATCAA 658 A 19888 | A 659 hqPGS_C01HBa0088L02.1-_SGN-E352117- (20548 19888) ******************************************************************************** EST sequence 190 +strand 661 n (File: SGN-E351414+) 1 CGGAAACTCC CATCCTTCTT CTTCACAAAC AAAATCGGAG CACCCCAAGG AGATGCACTT 61 GGTCTAATGA AACCTTTGCT CAACAACTCT TGAAGTTGGG CCTTTAACTC TCTTAACTCT 121 ACGGGAGCCA TTCTATAAGG GGGTATAGAA ATGGGGCGTG TGCCCGGTTC AAGATCGATA 181 CAGAAGTCAA TATCCCTATC TGGTGGCATA CCAGGAAGAT CTGCAGGGAA CACATCCAAA 241 AACTCACAGA CTATAAAAAC CGACTCAATC GAAGGTACTT GGGTAGTGTC ATCCTTGAGA 301 TGTGCCAAGA AAGCTAAACA CCCTTTACTA ACCATTTTCT TAGCACGAAG AAAGGAGATG 361 ATGCACACCG GATTGGAAGT GTAGTCACCC TCCCACACTA ACGGATCTGT CCCAGGCTTG 421 GCTAATGTCA CCGTTTTAGC ATTACAATCC AAGATCGCAA ATTGCGGAGA AAGCCAAGTC 481 ATACCCAGAA TTACATCAAA ATCAACCATT TCTAAGATAA CCAAATCTAC ATAAGTGTTG 541 CTCCCCACAA AGTTCACCAA ACAAGACCTA TATACCTTTT CAACTACCAC AGACTCACCC 601 ACCGGAGTAG AAACACGAAT AGGCATATCA AGTAATTCAC AATGTAAATT TAGACCGTTA 661 G Predicted gene structure (within gDNA segment 21218 to 19222): Exon 1 20591 19931 ( 661 n); cDNA 1 661 ( 661 n); score: 0.941 MATCH C01HBa0088L02.1- SGN-E351414+ 0.941 661 1.000 C PGS_C01HBa0088L02.1-_SGN-E351414+ (20591 19931) Alignment (genomic DNA sequence = upper lines): CGAAAACTCC CATCCTTCTT CTTCACAAAC AAAACCGGAG CACCCCAAGG AGATGCACTT 20532 || ||||||| |||||||||| |||||||||| |||| ||||| |||||||||| |||||||||| CGGAAACTCC CATCCTTCTT CTTCACAAAC AAAATCGGAG CACCCCAAGG AGATGCACTT 60 GGTCTGATGA AGCCTTTGTT CAACAACTCT TGAAGTTGGG CCTTTAACTC TCTCAACTCC 20472 ||||| |||| | |||||| | |||||||||| |||||||||| |||||||||| ||| ||||| GGTCTAATGA AACCTTTGCT CAACAACTCT TGAAGTTGGG CCTTTAACTC TCTTAACTCT 120 GCGGGAGCCA TTCTATAAGG GGGTATAGAA ATGGGGCGAG TGCCCGGTTC AAGATCAATG 20412 ||||||||| |||||||||| |||||||||| |||||||| | |||||||||| |||||| || ACGGGAGCCA TTCTATAAGG GGGTATAGAA ATGGGGCGTG TGCCCGGTTC AAGATCGATA 180 CAGAAGTCAA TATCCCTATC TGGTGGCATA CCAGGAAGAT CTGCAGGGAA CACATCCAAA 20352 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGAAGTCAA TATCCCTATC TGGTGGCATA CCAGGAAGAT CTGCAGGGAA CACATCCAAA 240 AACTCGCGGA CTACCGAAAC CGACTCAATC GAAGGTACTT GGGTAGTGTC ATCCTTGAGA 20292 ||||| | || ||| |||| |||||||||| |||||||||| |||||||||| |||||||||| AACTCACAGA CTATAAAAAC CGACTCAATC GAAGGTACTT GGGTAGTGTC ATCCTTGAGA 300 TGGGCCAAGA AAGCTAAACA CCCTTTACTA ACCATTTTCT TAGCACGAAG AAAGGAGATG 20232 || ||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTGCCAAGA AAGCTAAACA CCCTTTACTA ACCATTTTCT TAGCACGAAG AAAGGAGATG 360 ATACGCACCG GATTGGAAGT GTAGTCACCC TCCCACACTA ACGGGTCTGT CCTAGGCTTG 20172 || | ||||| |||||||||| |||||||||| |||||||||| |||| ||||| || ||||||| ATGCACACCG GATTGGAAGT GTAGTCACCC TCCCACACTA ACGGATCTGT CCCAGGCTTG 420 GCTAACGTCA CCATTTTAGC ATTACAATCC AAGATCGCAA AATTCGGAGA AAGCCAAGTC 20112 ||||| |||| || ||||||| |||||||||| |||||||||| | | |||||| |||||||||| GCTAATGTCA CCGTTTTAGC ATTACAATCC AAGATCGCAA ATTGCGGAGA AAGCCAAGTC 480 ATACGCAGAA TTACATCAAA GTCAACCATT TCTAAGATAA CCAAATCTAC ATAAGTGTTA 20052 |||| ||||| |||||||||| ||||||||| |||||||||| |||||||||| ||||||||| ATACCCAGAA TTACATCAAA ATCAACCATT TCTAAGATAA CCAAATCTAC ATAAGTGTTG 540 CTCCCTACAA AAGTCACCAA ACAAGACCTA TACACTTTTT CAACTATCAC AGACTCACCC 19992 ||||| |||| | ||||||| |||||||||| || || |||| |||||| ||| |||||||||| CTCCCCACAA AGTTCACCAA ACAAGACCTA TATACCTTTT CAACTACCAC AGACTCACCC 600 ATCGGGGTAG AAACACGAAT AGGCATGTCA AGTAATTCAC AATGTAAATT AAGACCATTA 19932 | ||| |||| |||||||||| |||||| ||| |||||||||| |||||||||| ||||| ||| ACCGGAGTAG AAACACGAAT AGGCATATCA AGTAATTCAC AATGTAAATT TAGACCGTTA 660 G 19931 | G 661 hqPGS_C01HBa0088L02.1-_SGN-E351414+ (20591 19931) ******************************************************************************** EST sequence 142 +strand 560 n (File: SGN-E242765+) 1 TGGTTCTAGC ATTAGGACAT CATAGCTCAT TTGATTATTT CTCATCTCAT AATTAGTATT 61 TAGTATTCCC TCAATTTAAT AATTTCATTA AAGTGTTCAT AGAGACTTAT CTCTTCATTA 121 GCTTTACACT ATAAAAGGTG AGTAAGTGTT GGTAATATTT ACTTAGGCTT ATTTGCTATT 181 GAAACCGACT CAATCGAAGG TACTTGGGTA GTGTCATCAT TGAGATGTGC TAAGAAAGAT 241 AAACACCTTT TACTAATCAT TTTCTTAGCA AGAAGAAAGG AGACGATGCG GACCGGATTG 301 GAAGTGTAGT CACCCTCTCA CACTAACGGG TCTATCCCAG GCTTGGCTAA CGTCACCGTT 361 TTAGCATTAC AATCCAAGAT TGCAAATTGC GGAGAAAGCA AAGTCATACC CAGAATCACA 421 TCAAAATCAT CCATTGCCAA GATAACCAAA TCTACATAAG TGTTGCTCCC CACAAAGTTT 481 ACGACACAAG ACCTATATAC TTTTTCAACT ACCTCAGACT CACCCACCGG AGTAGAAACA 541 CGAATAGGCA TATCAAGAAA Predicted gene structure (within gDNA segment 22736 to 17727): Exon 1 20340 19957 ( 384 n); cDNA 177 560 ( 384 n); score: 0.896 MATCH C01HBa0088L02.1- SGN-E242765+ 0.896 384 0.686 C PGS_C01HBa0088L02.1-_SGN-E242765+ (20340 19957) Alignment (genomic DNA sequence = upper lines): TACCGAAACC GACTCAATCG AAGGTACTTG GGTAGTGTCA TCCTTGAGAT GGGCCAAGAA 20281 || |||||| |||||||||| |||||||||| |||||||||| || ||||||| | || ||||| TATTGAAACC GACTCAATCG AAGGTACTTG GGTAGTGTCA TCATTGAGAT GTGCTAAGAA 236 AGCTAAACAC CCTTTACTAA CCATTTTCTT AGCACGAAGA AAGGAGATGA TACGCACCGG 20221 || ||||||| | |||||||| ||||||||| |||| ||||| ||||||| || | || ||||| AGATAAACAC CTTTTACTAA TCATTTTCTT AGCAAGAAGA AAGGAGACGA TGCGGACCGG 296 ATTGGAAGTG TAGTCACCCT CCCACACTAA CGGGTCTGTC CTAGGCTTGG CTAACGTCAC 20161 |||||||||| |||||||||| | |||||||| ||||||| || | |||||||| |||||||||| ATTGGAAGTG TAGTCACCCT CTCACACTAA CGGGTCTATC CCAGGCTTGG CTAACGTCAC 356 CATTTTAGCA TTACAATCCA AGATCGCAAA ATTCGGAGAA AGCCAAGTCA TACGCAGAAT 20101 | |||||||| |||||||||| |||| ||||| | ||||||| ||| |||||| ||| |||||| CGTTTTAGCA TTACAATCCA AGATTGCAAA TTGCGGAGAA AGCAAAGTCA TACCCAGAAT 416 TACATCAAAG TCAACCATTT CTAAGATAAC CAAATCTACA TAAGTGTTAC TCCCTACAAA 20041 |||||||| ||| ||||| | |||||||| |||||||||| |||||||| | |||| ||||| CACATCAAAA TCATCCATTG CCAAGATAAC CAAATCTACA TAAGTGTTGC TCCCCACAAA 476 AGTCACCAAA CAAGACCTAT ACACTTTTTC AACTATCACA GACTCACCCA TCGGGGTAGA 19981 | || | | |||||||||| | |||||||| ||||| | || |||||||||| ||| ||||| GTTTACGACA CAAGACCTAT ATACTTTTTC AACTACCTCA GACTCACCCA CCGGAGTAGA 536 AACACGAATA GGCATGTCAA GTAA 19957 |||||||||| ||||| |||| | || AACACGAATA GGCATATCAA GAAA 560 hqPGS_C01HBa0088L02.1-_SGN-E242765+ (20340 19957) ******************************************************************************** EST sequence 227 +strand 658 n (File: SGN-E355232+) 1 TCAATGCGAG GAAGAGGATA CTTGTTCTTA ATAGTTACCT TGTTCAGTTG TCTGTAGTCT 61 ATGCACATTC TAAAACTTCC ATCCTTCTTC TTCACAAATA AAACTGGAGC ACCCCAAGGA 121 GATGCACTTG GTCTAATGAA GACCTTGCTC AACAACTCTT GAAGTTGAGC CTTTAACTCT 181 CTTAATTCGG CGGGAGCCAT TCTATAAGGG GGTATAGAAA TGGGGCGTGT GCCTGGTTCA 241 AGATCGATAC AGAAGTCAAT ATCCCTATCT GGTGGCATAC CAGGAAGATC TGCAGGAAAC 301 ACGTCCAAAA ACTCGCGGAC TACCGAAACC GACTCAATTG AGGGTACTTG AGTAGTGTCA 361 TCCTTGAGAT GTGCCAAGAA AGCTGAACAC CCTTTACTAA CCATTTTCTT AGCACGAAGA 421 AAGGATATGA TACGCACCAG ATTGGAAGTG TAGTCACCCT CCCACACTAA CGGATCTGTC 481 CCAGGCTTGG CTAACGTCAC CGTTTTAGCA TTACAATCCA AGATCGCAAA ATTTGGAGAA 541 AGCCAAGTCA TACCCAGAAT TACATCAATG TCACCCATTT CTAAAAAACC AAATCTACAT 601 AAGTGTTGCT CCCCACGAAA TTCNACAAAA CAGAACTATG TACCTTTTCA ACTACCAC Predicted gene structure (within gDNA segment 21386 to 18448): Exon 1 20660 20002 ( 659 n); cDNA 1 658 ( 658 n); score: 0.924 MATCH C01HBa0088L02.1- SGN-E355232+ 0.924 659 1.002 C PGS_C01HBa0088L02.1-_SGN-E355232+ (20660 20002) Alignment (genomic DNA sequence = upper lines): TCAATGCGAG GAAAAGGATA CTTGTTCTTA ATAGTTACCT TATTCAGTTG TCTGTAGTCT 20601 |||||||||| ||| |||||| |||||||||| |||||||||| | |||||||| |||||||||| TCAATGCGAG GAAGAGGATA CTTGTTCTTA ATAGTTACCT TGTTCAGTTG TCTGTAGTCT 60 ATGCACATCC GAAAACTCCC ATCCTTCTTC TTCACAAACA AAACCGGAGC ACCCCAAGGA 20541 |||||||| | |||||| || |||||||||| |||||||| | |||| ||||| |||||||||| ATGCACATTC TAAAACTTCC ATCCTTCTTC TTCACAAATA AAACTGGAGC ACCCCAAGGA 120 GATGCACTTG GTCTGATGAA GCCTTTGTTC AACAACTCTT GAAGTTGGGC CTTTAACTCT 20481 |||||||||| |||| ||||| | | ||| || |||||||||| ||||||| || |||||||||| GATGCACTTG GTCTAATGAA GACCTTGCTC AACAACTCTT GAAGTTGAGC CTTTAACTCT 180 CTCAACTCCG CGGGAGCCAT TCTATAAGGG GGTATAGAAA TGGGGCGAGT GCCCGGTTCA 20421 || || || | |||||||||| |||||||||| |||||||||| ||||||| || ||| |||||| CTTAATTCGG CGGGAGCCAT TCTATAAGGG GGTATAGAAA TGGGGCGTGT GCCTGGTTCA 240 AGATCAATGC AGAAGTCAAT ATCCCTATCT GGTGGCATAC CAGGAAGATC TGCAGGGAAC 20361 ||||| || | |||||||||| |||||||||| |||||||||| |||||||||| |||||| ||| AGATCGATAC AGAAGTCAAT ATCCCTATCT GGTGGCATAC CAGGAAGATC TGCAGGAAAC 300 ACATCCAAAA ACTCGCGGAC TACCGAAACC GACTCAATCG AAGGTACTTG GGTAGTGTCA 20301 || ||||||| |||||||||| |||||||||| |||||||| | | |||||||| ||||||||| ACGTCCAAAA ACTCGCGGAC TACCGAAACC GACTCAATTG AGGGTACTTG AGTAGTGTCA 360 TCCTTGAGAT GGGCCAAGAA AGCTAAACAC CCTTTACTAA CCATTTTCTT AGCACGAAGA 20241 |||||||||| | |||||||| |||| ||||| |||||||||| |||||||||| |||||||||| TCCTTGAGAT GTGCCAAGAA AGCTGAACAC CCTTTACTAA CCATTTTCTT AGCACGAAGA 420 AAGGAGATGA TACGCACCGG ATTGGAAGTG TAGTCACCCT CCCACACTAA CGGGTCTGTC 20181 ||||| |||| |||||||| | |||||||||| |||||||||| |||||||||| ||| |||||| AAGGATATGA TACGCACCAG ATTGGAAGTG TAGTCACCCT CCCACACTAA CGGATCTGTC 480 CTAGGCTTGG CTAACGTCAC CATTTTAGCA TTACAATCCA AGATCGCAAA ATTCGGAGAA 20121 | |||||||| |||||||||| | |||||||| |||||||||| |||||||||| ||| |||||| CCAGGCTTGG CTAACGTCAC CGTTTTAGCA TTACAATCCA AGATCGCAAA ATTTGGAGAA 540 AGCCAAGTCA TACGCAGAAT TACATCAAAG TCAACCATTT CTAAGATAAC CAAATCTACA 20061 |||||||||| ||| |||||| |||||||| | ||| |||||| |||| | ||| |||||||||| AGCCAAGTCA TACCCAGAAT TACATCAATG TCACCCATTT CTAA-AAAAC CAAATCTACA 599 TAAGTGTTAC TCCCTACAAA AGTCACCAAA CAAGACCTAT ACACTTTTTC AACTATCAC 20002 |||||||| | |||| || || | || |||| ||| |||| || ||||| ||||| ||| TAAGTGTTGC TCCCCACGAA ATTCNACAAA ACAGAACTAT GTACCTTTTC AACTACCAC 658 hqPGS_C01HBa0088L02.1-_SGN-E355232+ (20660 20002) ******************************************************************************** EST sequence 241 +strand 679 n (File: SGN-E368762+) 1 GTCTCACCCA ATTCTTCACT GTCTCAATCT TACAAGGATC CACCATCACT CCATCCTTAG 61 AAACCACGTG CCCCAAGAAG GACACTGCAT CTATCCAAAA CTCACACTTA GAGAACTTGG 121 CATAAAGCTT TTTCTCCCTC AACATTTCTA ATACAATTCT CAAATGCTCC TCATGTTCCT 181 TCTTACTATT AGAGTATATC AGTATATCAT CAATAAACAT GATGACAAAG AGATCCAAAT 241 ATGGCTTAAA ATCCCGTTCA TCAAGCTCAT GAACGCAGCA GGGGCATTCG TAAGACCAAA 301 AGACATCACT ACAAATTCGT AATGCCCATA CCTGGTTCTA AAAGCAGTCT TTGGCACATC 361 CGTTGCCCGT ATTTTCAATT GATGATAACC GGATCTCAAG TCAATCTTAG AGAAGACACA 421 AGCACCTTGT AACTGATCGA ACAAGTCATC AATGCGAGGA AGTGGATACT TGTTCTTAAT 481 AGTTACCTTG TTCAACTGCC GGTAGTCTAT GCACATCCGA AAACTCCCAT CCTTCTTCTT 541 CACAAACCAA ACCGGAGCAC CCCAAGGAGA TGCACTTGGT CTAATGAAGA CTTTGCTCAA 601 AAACTCTTGA AGTTGGGCCT TTAACTCTCT TAACTCCGCG GGAGCCATTC TATAAGGGGG 661 TATAGAAATG GGGCGAGTG Predicted gene structure (within gDNA segment 21754 to 19820): Exon 1 21109 20430 ( 680 n); cDNA 1 679 ( 679 n); score: 0.940 MATCH C01HBa0088L02.1- SGN-E368762+ 0.940 680 1.001 C PGS_C01HBa0088L02.1-_SGN-E368762+ (21109 20430) Alignment (genomic DNA sequence = upper lines): GTCTTACCCA ATTCTTCACT GTCTCAATCT TAGAAGGATC CACCATCACT CCTTCCTTAG 21050 |||| ||||| |||||||||| |||||||||| || ||||||| |||||||||| || ||||||| GTCTCACCCA ATTCTTCACT GTCTCAATCT TACAAGGATC CACCATCACT CCATCCTTAG 60 AAACCACGTG CCCCAAGAAG GACACTGCAT CTAGCCAAAA CTCACACTTA GAGAACTTGG 20990 |||||||||| |||||||||| |||||||||| ||| |||||| |||||||||| |||||||||| AAACCACGTG CCCCAAGAAG GACACTGCAT CTATCCAAAA CTCACACTTA GAGAACTTGG 120 CATAAAGCTT TTTCTCCCTC AACATTTCCA ATACCATTCT CAAATGCTCT TCATGTTCCT 20930 |||||||||| |||||||||| |||||||| | |||| ||||| ||||||||| |||||||||| CATAAAGCTT TTTCTCCCTC AACATTTCTA ATACAATTCT CAAATGCTCC TCATGTTCCT 180 TCTTGCTCTT TGAGTATACC AATATATCAT CAATAAATAC AATCACGAAG AGGTCCAAAT 20870 |||| || || ||||||| | | |||||||| ||||||| | || || ||| || ||||||| TCTTACTATT AGAGTATATC AGTATATCAT CAATAAACAT GATGACAAAG AGATCCAAAT 240 ATGGCTTAAA AATCCCGTTT ATCAACCTCA TGAATGCAGC AGGGGCATTC GTAAGACCAA 20810 ||||||| || ||||||||| ||||| |||| |||| ||||| |||||||||| |||||||||| ATGGCTT-AA AATCCCGTTC ATCAAGCTCA TGAACGCAGC AGGGGCATTC GTAAGACCAA 299 AAGACATCAC CACAAATTCG TAATGCCCAT ACCTTGTTCG AAAAGCAGTC TTTGGCACAT 20750 |||||||||| ||||||||| |||||||||| |||| |||| |||||||||| |||||||||| AAGACATCAC TACAAATTCG TAATGCCCAT ACCTGGTTCT AAAAGCAGTC TTTGGCACAT 359 CCGTTGCCCG TATTTTCAAT TGATGATAAC CAGATCTCAA GTCAATCTTA GAGAAGACAC 20690 |||||||||| |||||||||| |||||||||| | |||||||| |||||||||| |||||||||| CCGTTGCCCG TATTTTCAAT TGATGATAAC CGGATCTCAA GTCAATCTTA GAGAAGACAC 419 AAGCACCTTG TAATTGATTG AACAAGTCAT CAATGCGAGG AAAAGGATAC TTGTTCTTAA 20630 |||||||||| ||| |||| | |||||||||| |||||||||| || |||||| |||||||||| AAGCACCTTG TAACTGATCG AACAAGTCAT CAATGCGAGG AAGTGGATAC TTGTTCTTAA 479 TAGTTACCTT ATTCAGTTGT CTGTAGTCTA TGCACATCCG AAAACTCCCA TCCTTCTTCT 20570 |||||||||| |||| || | |||||||| |||||||||| |||||||||| |||||||||| TAGTTACCTT GTTCAACTGC CGGTAGTCTA TGCACATCCG AAAACTCCCA TCCTTCTTCT 539 TCACAAACAA AACCGGAGCA CCCCAAGGAG ATGCACTTGG TCTGATGAAG CCTTTGTTCA 20510 |||||||| | |||||||||| |||||||||| |||||||||| ||| |||||| ||||| ||| TCACAAACCA AACCGGAGCA CCCCAAGGAG ATGCACTTGG TCTAATGAAG ACTTTGCTCA 599 ACAACTCTTG AAGTTGGGCC TTTAACTCTC TCAACTCCGC GGGAGCCATT CTATAAGGGG 20450 | |||||||| |||||||||| |||||||||| | |||||||| |||||||||| |||||||||| AAAACTCTTG AAGTTGGGCC TTTAACTCTC TTAACTCCGC GGGAGCCATT CTATAAGGGG 659 GTATAGAAAT GGGGCGAGTG 20430 |||||||||| |||||||||| GTATAGAAAT GGGGCGAGTG 679 hqPGS_C01HBa0088L02.1-_SGN-E368762+ (21109 20430) ******************************************************************************** EST sequence 143 +strand 712 n (File: SGN-E379315+) 1 GAATCCCTTG ACAAATCGGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 61 CACATTAGTA GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 121 TCCATCCTTA GAAACCACGT TCCCCAAGAA GGACACTACA TCTAGCCAAA ACTCACACTT 181 AGAGAACTTG GCATAAAACT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 241 TTCATGTTCC TCCTTACTTT TAGAGTATAT CAGTATATCA TCAATAAATA CGATCACAAA 301 GAGATCCAAA TATGGCTTAA AAATCCCTTT TATTAAACTC ATAAACGCAG CAGGGGCATT 361 CATAAGACCA AAAGACATCA CTACAAATTT GTAATGCCCA TACCTGGTTC TAAAAGCAGT 421 CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCGGATCTCA AGTCAATCTT 481 AGAAAAGACA CAAGCACCTT GTAACTGATC GAACAAGTCA TTAATGCGAG GAAGAGGATA 541 CTTGTTCTTT ATGGTTACCT TGTTNCACTG CCGGTAGCCT ATGCACATCC GAAAACTCCA 601 ATCCTTCTTC TTTACAAACA AAACCGGAGC ACCCCAAGGA GATGCAGTTG GTCTAATGAA 661 GCCTTTGCTC ACAACTCTTT GAAGTGGTCT TTTAACTCTC TTAACTCTGC GG Predicted gene structure (within gDNA segment 21942 to 19265): Exon 1 21180 20468 ( 713 n); cDNA 1 712 ( 712 n); score: 0.921 MATCH C01HBa0088L02.1- SGN-E379315+ 0.921 713 1.001 C PGS_C01HBa0088L02.1-_SGN-E379315+ (21180 20468) Alignment (genomic DNA sequence = upper lines): GAATCCTTTG ACAAATCAGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 21121 |||||| ||| ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| GAATCCCTTG ACAAATCGGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 60 CACATTAGTG GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 21061 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACATTAGTA GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 120 TCCTTCCTTA GAAACCACGT GCCCCAAGAA GGACACTGCA TCTAGCCAAA ACTCACACTT 21001 ||| |||||| |||||||||| ||||||||| ||||||| || |||||||||| |||||||||| TCCATCCTTA GAAACCACGT TCCCCAAGAA GGACACTACA TCTAGCCAAA ACTCACACTT 180 AGAGAACTTG GCATAAAGCT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 20941 |||||||||| ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| AGAGAACTTG GCATAAAACT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 240 TTCATGTTCC TTCTTGCTCT TTGAGTATAC CAATATATCA TCAATAAATA CAATCACGAA 20881 |||||||||| | ||| || | | ||||||| || ||||||| |||||||||| | ||||| || TTCATGTTCC TCCTTACTTT TAGAGTATAT CAGTATATCA TCAATAAATA CGATCACAAA 300 GAGGTCCAAA TATGGCTTAA AAATCCCGTT TATCAACCTC ATGAATGCAG CAGGGGCATT 20821 ||| |||||| |||||||||| ||||||| || ||| || ||| || || |||| |||||||||| GAGATCCAAA TATGGCTTAA AAATCCCTTT TATTAAACTC ATAAACGCAG CAGGGGCATT 360 CGTAAGACCA AAAGACATCA CCACAAATTC GTAATGCCCA TACCTTGTTC GAAAAGCAGT 20761 | |||||||| |||||||||| | ||||||| |||||||||| ||||| |||| ||||||||| CATAAGACCA AAAGACATCA CTACAAATTT GTAATGCCCA TACCTGGTTC TAAAAGCAGT 420 CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCAGATCTCA AGTCAATCTT 20701 |||||||||| |||||||||| |||||||||| |||||||||| || ||||||| |||||||||| CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCGGATCTCA AGTCAATCTT 480 AGAGAAGACA CAAGCACCTT GTAATTGATT GAACAAGTCA TCAATGCGAG GAAAAGGATA 20641 ||| |||||| |||||||||| |||| |||| |||||||||| | |||||||| ||| |||||| AGAAAAGACA CAAGCACCTT GTAACTGATC GAACAAGTCA TTAATGCGAG GAAGAGGATA 540 CTTGTTCTTA ATAGTTACCT TATTCAGTTG TCTGTAGTCT ATGCACATCC GAAAACTCCC 20581 ||||||||| || ||||||| | || || | |||| || |||||||||| ||||||||| CTTGTTCTTT ATGGTTACCT TGTTNCACTG CCGGTAGCCT ATGCACATCC GAAAACTCCA 600 ATCCTTCTTC TTCACAAACA AAACCGGAGC ACCCCAAGGA GATGCACTTG GTCTGATGAA 20521 |||||||||| || ||||||| |||||||||| |||||||||| |||||| ||| |||| ||||| ATCCTTCTTC TTTACAAACA AAACCGGAGC ACCCCAAGGA GATGCAGTTG GTCTAATGAA 660 GCCTTTGTTC AACAACTCTT GAAGTTGGGC CTTTAACTCT CTCAACTCCG CGG 20468 ||||||| || ||||||||| | ||| | ||||||||| || ||||| | ||| GCCTTTGCTC -ACAACTCTT TGAAGTGGTC TTTTAACTCT CTTAACTCTG CGG 712 hqPGS_C01HBa0088L02.1-_SGN-E379315+ (21180 20468) ******************************************************************************** EST sequence 122 +strand 709 n (File: SGN-E578271+) 1 GTTCTTTATG GTTACCTTGT TTAGTTGTCT GTAGTCTATA TACATTCGAA AACTCCCATC 61 CTTCTTCTTT ACAAACAAAA CCGGAGCACC CAAGGGGATG CACTTGGTCT AATGAAGCCT 121 TTGTTGCTAC AAAGATATGA CCTATATATC ATATCTTGAC TGGTTCTTTA GATCCAGATA 181 ATGCGAAGTG ATGGGTTGGT TATTAGTTCT ATAGTTTTTA GTTCATACTA TGTGGGCTGG 241 GTTTTTTTAA TCCTAACCCT AACAAAACCC ACGAGTCACA CACTAAGCAT AGCAATTATA 301 TCAAATGGTC AATCGAATTT TTATTCAACC TTATAGAATT AAGAATTAGA AAGAATTAAG 361 AATTAGAAAT GTTCCCCTTG ATTAGAAAAA GAATGAATTG GTCTTTTTTT TTGTTCAATC 421 ATTGGATAGA AGGGAAAGAC AAGTAGTAAA ATTATTCCTC GTCTAGAAAT ATCCAAATTT 481 TGATGCCCAA TATTCCATAG ATAGTTCGAA CTGTATAAGA GCAATAATCA ATTTTAGCTC 541 GAATCGTTTG TAGGGGAACC CTGCCTTCTC TGATCCATTC GACACGTGCA ATTTCTTTTC 601 CGTCGATACG CCCCGCAATT TGTATTTGAA TTCCTTGTGT ATCCGCTTGT TCTGTTAATT 661 CAATAGCCTT TTTCATTGCT TTTCGAAATG AAACTCTATT CTTTAATTG Predicted gene structure (within gDNA segment 21435 to 13757): Exon 1 20637 20512 ( 126 n); cDNA 1 125 ( 125 n); score: 0.913 MATCH C01HBa0088L02.1- SGN-E578271+ 0.913 126 0.178 C PGS_C01HBa0088L02.1-_SGN-E578271+ (20637 20512) Alignment (genomic DNA sequence = upper lines): GTTCTTAATA GTTACCTTAT TCAGTTGTCT GTAGTCTATG CACATCCGAA AACTCCCATC 20578 |||||| || |||||||| | | |||||||| ||||||||| |||| |||| |||||||||| GTTCTTTATG GTTACCTTGT TTAGTTGTCT GTAGTCTATA TACATTCGAA AACTCCCATC 60 CTTCTTCTTC ACAAACAAAA CCGGAGCACC CCAAGGAGAT GCACTTGGTC TGATGAAGCC 20518 ||||||||| |||||||||| |||||||| | |||||| ||| |||||||||| | |||||||| CTTCTTCTTT ACAAACAAAA CCGGAGCA-C CCAAGGGGAT GCACTTGGTC TAATGAAGCC 119 TTTGTT 20512 |||||| TTTGTT 125 hqPGS_C01HBa0088L02.1-_SGN-E578271+ (20637 20512) ******************************************************************************** EST sequence 178 +strand 596 n (File: SGN-E375319+) 1 GAATCCCTTG ACAAATCGGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 61 CACATTAGTA GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 121 TCCATCCTTA GAAACCACGT TCCCCAAGAA GGACACTACA TCTAGCCAAA ACTCACACTT 181 AGAGAACTTG GCATAAAACT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 241 TTCATGTTCC TCCTTACTTT TAGAGTATAT CAGTATATCA TCAATAAATA CGATCACAAA 301 GAGATCCAAA TATGGCTTAA AAATCCCTTT TATTAAACTC ATAAACGCAG CAGGGGCATT 361 CATAAGACCA AAAGACATCA CTACAAATTT GTAATGCCCA TACCTGGTTC TAAAAGCAGT 421 CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCGGATCTCA AGTCAATCTT 481 AGAAAAGACA CAAGCACCTT GTAACTGATC GAACAAGTCA TTAATGCGAG GAAGAGGATA 541 CTTGTTCTTT ATGGTTACCT TGTTCAACTG CCGGTAGCCT ATGCACATCC GAAAAC Predicted gene structure (within gDNA segment 21942 to 19147): Exon 1 21180 20585 ( 596 n); cDNA 1 596 ( 596 n); score: 0.933 MATCH C01HBa0088L02.1- SGN-E375319+ 0.933 596 1.000 C PGS_C01HBa0088L02.1-_SGN-E375319+ (21180 20585) Alignment (genomic DNA sequence = upper lines): GAATCCTTTG ACAAATCAGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 21121 |||||| ||| ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| GAATCCCTTG ACAAATCGGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 60 CACATTAGTG GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 21061 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACATTAGTA GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 120 TCCTTCCTTA GAAACCACGT GCCCCAAGAA GGACACTGCA TCTAGCCAAA ACTCACACTT 21001 ||| |||||| |||||||||| ||||||||| ||||||| || |||||||||| |||||||||| TCCATCCTTA GAAACCACGT TCCCCAAGAA GGACACTACA TCTAGCCAAA ACTCACACTT 180 AGAGAACTTG GCATAAAGCT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 20941 |||||||||| ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| AGAGAACTTG GCATAAAACT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 240 TTCATGTTCC TTCTTGCTCT TTGAGTATAC CAATATATCA TCAATAAATA CAATCACGAA 20881 |||||||||| | ||| || | | ||||||| || ||||||| |||||||||| | ||||| || TTCATGTTCC TCCTTACTTT TAGAGTATAT CAGTATATCA TCAATAAATA CGATCACAAA 300 GAGGTCCAAA TATGGCTTAA AAATCCCGTT TATCAACCTC ATGAATGCAG CAGGGGCATT 20821 ||| |||||| |||||||||| ||||||| || ||| || ||| || || |||| |||||||||| GAGATCCAAA TATGGCTTAA AAATCCCTTT TATTAAACTC ATAAACGCAG CAGGGGCATT 360 CGTAAGACCA AAAGACATCA CCACAAATTC GTAATGCCCA TACCTTGTTC GAAAAGCAGT 20761 | |||||||| |||||||||| | ||||||| |||||||||| ||||| |||| ||||||||| CATAAGACCA AAAGACATCA CTACAAATTT GTAATGCCCA TACCTGGTTC TAAAAGCAGT 420 CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCAGATCTCA AGTCAATCTT 20701 |||||||||| |||||||||| |||||||||| |||||||||| || ||||||| |||||||||| CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCGGATCTCA AGTCAATCTT 480 AGAGAAGACA CAAGCACCTT GTAATTGATT GAACAAGTCA TCAATGCGAG GAAAAGGATA 20641 ||| |||||| |||||||||| |||| |||| |||||||||| | |||||||| ||| |||||| AGAAAAGACA CAAGCACCTT GTAACTGATC GAACAAGTCA TTAATGCGAG GAAGAGGATA 540 CTTGTTCTTA ATAGTTACCT TATTCAGTTG TCTGTAGTCT ATGCACATCC GAAAAC 20585 ||||||||| || ||||||| | |||| || | |||| || |||||||||| |||||| CTTGTTCTTT ATGGTTACCT TGTTCAACTG CCGGTAGCCT ATGCACATCC GAAAAC 596 hqPGS_C01HBa0088L02.1-_SGN-E375319+ (21180 20585) ******************************************************************************** EST sequence 155 +strand 526 n (File: SGN-E204434+) 1 GAATCCCTTG ACAAATCGGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 61 CACATTAGTA GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 121 TCCATCCTTA GAAACCACGT TCCCCAAGAA GGACACTACA TCTAGCCAAA ACTCACACTT 181 AGAGAACTTG GCATAAAACT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 241 TTCATGTTCC TCCTTACTTT TAGAGTATAT CAGTATATCA TCAATAAATA CGATCACAAA 301 GAGATCCAAA TATGGCTTAA AAATCCCTTT TATTAAACTC ATAAACGCAG CAGGGGCATT 361 CATAAGACCA AAAGACATCA CTACAAATTT GTAATGCCCA TACCTGGTTC TAAAAGCAGT 421 CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCGGATCTCA AGTCAATCTT 481 AGAAAAGACA CAAGCACCTT GTAACTGATC GAACAAGTCA TTAATG Predicted gene structure (within gDNA segment 21942 to 19847): Exon 1 21180 20656 ( 525 n); cDNA 1 525 ( 525 n); score: 0.941 MATCH C01HBa0088L02.1- SGN-E204434+ 0.941 525 0.998 C PGS_C01HBa0088L02.1-_SGN-E204434+ (21180 20656) Alignment (genomic DNA sequence = upper lines): GAATCCTTTG ACAAATCAGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 21121 |||||| ||| ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| GAATCCCTTG ACAAATCGGC GGTAGTAGCT AGCTAACCCA ACAAAGCTCC TTATTTCTGA 60 CACATTAGTG GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 21061 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACATTAGTA GGTCTTACCC AATTCTTCAC TGTCTCAATC TTAGAAGGAT CCACCATCAC 120 TCCTTCCTTA GAAACCACGT GCCCCAAGAA GGACACTGCA TCTAGCCAAA ACTCACACTT 21001 ||| |||||| |||||||||| ||||||||| ||||||| || |||||||||| |||||||||| TCCATCCTTA GAAACCACGT TCCCCAAGAA GGACACTACA TCTAGCCAAA ACTCACACTT 180 AGAGAACTTG GCATAAAGCT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 20941 |||||||||| ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| AGAGAACTTG GCATAAAACT TTTTCTCCCT CAACATTTCC AATACCATTC TCAAATGCTC 240 TTCATGTTCC TTCTTGCTCT TTGAGTATAC CAATATATCA TCAATAAATA CAATCACGAA 20881 |||||||||| | ||| || | | ||||||| || ||||||| |||||||||| | ||||| || TTCATGTTCC TCCTTACTTT TAGAGTATAT CAGTATATCA TCAATAAATA CGATCACAAA 300 GAGGTCCAAA TATGGCTTAA AAATCCCGTT TATCAACCTC ATGAATGCAG CAGGGGCATT 20821 ||| |||||| |||||||||| ||||||| || ||| || ||| || || |||| |||||||||| GAGATCCAAA TATGGCTTAA AAATCCCTTT TATTAAACTC ATAAACGCAG CAGGGGCATT 360 CGTAAGACCA AAAGACATCA CCACAAATTC GTAATGCCCA TACCTTGTTC GAAAAGCAGT 20761 | |||||||| |||||||||| | ||||||| |||||||||| ||||| |||| ||||||||| CATAAGACCA AAAGACATCA CTACAAATTT GTAATGCCCA TACCTGGTTC TAAAAGCAGT 420 CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCAGATCTCA AGTCAATCTT 20701 |||||||||| |||||||||| |||||||||| |||||||||| || ||||||| |||||||||| CTTTGGCACA TCCGTTGCCC GTATTTTCAA TTGATGATAA CCGGATCTCA AGTCAATCTT 480 AGAGAAGACA CAAGCACCTT GTAATTGATT GAACAAGTCA TCAAT 20656 ||| |||||| |||||||||| |||| |||| |||||||||| | ||| AGAAAAGACA CAAGCACCTT GTAACTGATC GAACAAGTCA TTAAT 525 hqPGS_C01HBa0088L02.1-_SGN-E204434+ (21180 20656) ******************************************************************************** EST sequence 256 +strand 358 n (File: SGN-E240817+) 1 GTCTCACCCA TTTCTTCACT GTCTCAATCT TACCAGGATC CACCATCACT CCATCCTTAG 61 AAACCACGTG CCCCAAGAAG GACACTGCAT CTATCCAAAA CTCACACTTA GAGAACTTGG 121 CATAAAGCTT TTTCTCCCTC AACATTTCTA ATACAATTCT CAAATGCTCC TCATGTTCCT 181 TCTTACTATT AGAGGATATC AGTATATCAT CAATGAACAT GATGACGCAG AGATCCAAAT 241 ATGGCTTAAA ATCCCGTTCA TCAAGCTCAT GAACGCAGCA GGGGCATTCG TAAGACCAAA 301 AGACATCACT ACAAATTCGT AATGCCCATA CCTGGTTCTA AAAGCAGTCT TTGGCACA Predicted gene structure (within gDNA segment 21808 to 20141): Exon 1 21109 20751 ( 359 n); cDNA 1 358 ( 358 n); score: 0.919 MATCH C01HBa0088L02.1- SGN-E240817+ 0.919 359 1.003 C PGS_C01HBa0088L02.1-_SGN-E240817+ (21109 20751) Alignment (genomic DNA sequence = upper lines): GTCTTACCCA ATTCTTCACT GTCTCAATCT TAGAAGGATC CACCATCACT CCTTCCTTAG 21050 |||| ||||| ||||||||| |||||||||| || |||||| |||||||||| || ||||||| GTCTCACCCA TTTCTTCACT GTCTCAATCT TACCAGGATC CACCATCACT CCATCCTTAG 60 AAACCACGTG CCCCAAGAAG GACACTGCAT CTAGCCAAAA CTCACACTTA GAGAACTTGG 20990 |||||||||| |||||||||| |||||||||| ||| |||||| |||||||||| |||||||||| AAACCACGTG CCCCAAGAAG GACACTGCAT CTATCCAAAA CTCACACTTA GAGAACTTGG 120 CATAAAGCTT TTTCTCCCTC AACATTTCCA ATACCATTCT CAAATGCTCT TCATGTTCCT 20930 |||||||||| |||||||||| |||||||| | |||| ||||| ||||||||| |||||||||| CATAAAGCTT TTTCTCCCTC AACATTTCTA ATACAATTCT CAAATGCTCC TCATGTTCCT 180 TCTTGCTCTT TGAGTATACC AATATATCAT CAATAAATAC AATCACGAAG AGGTCCAAAT 20870 |||| || || ||| ||| | | |||||||| |||| || | || ||| || || ||||||| TCTTACTATT AGAGGATATC AGTATATCAT CAATGAACAT GATGACGCAG AGATCCAAAT 240 ATGGCTTAAA AATCCCGTTT ATCAACCTCA TGAATGCAGC AGGGGCATTC GTAAGACCAA 20810 ||||||| || ||||||||| ||||| |||| |||| ||||| |||||||||| |||||||||| ATGGCTT-AA AATCCCGTTC ATCAAGCTCA TGAACGCAGC AGGGGCATTC GTAAGACCAA 299 AAGACATCAC CACAAATTCG TAATGCCCAT ACCTTGTTCG AAAAGCAGTC TTTGGCACA 20751 |||||||||| ||||||||| |||||||||| |||| |||| |||||||||| ||||||||| AAGACATCAC TACAAATTCG TAATGCCCAT ACCTGGTTCT AAAAGCAGTC TTTGGCACA 358 hqPGS_C01HBa0088L02.1-_SGN-E240817+ (21109 20751) ******************************************************************************** EST sequence 203 +strand 587 n (File: SGN-E352950+) 1 CCTCTGTAAG AATAGTGTGA ATCAAATCGT CGGCACGGGG TACACATACC TTTCCCTTAA 61 TCCTCAAAAC ACCTTCCTTA TCGATTTTTG CTTCTTTAGC CTCTCCTCGC ATTACCTTAT 121 CTCGAATCCA GATCAGTTTC TCATCGGTAA ACTGCTTTCC TTTAATCTTA TCAAGAAAGG 181 AAGATCTTGC CTCCACACAA GCCAAAAATT CTCCCTTCTC ATTTAATTCT AGCCTCATAA 241 GGTCATTAGC CAGAGTCTGA ACCTCTCTAG CCAATGGGCA TCTAGAAACC TGCAAGTGAG 301 CTAGACTTCC CATGCTCCCT GCCTTTCTAC TTAAAGCATC TGCCACAACA TTAGCCTTTC 361 CCGGATGATA CAAGATAGTG ATATCATAGT CCTTCAGTAG CTCCATCGAT CTCCTCTGTC 421 TCAAATTCAA ATCTTTCTGA GTAAAGACAT ACTGTAAACT ACGATGATCC ATATAGACTT 481 CACACTTAAC CCCATAGAGA TAATGTCTCT ATTACTTTAA TGCAATCACT ACTGCCGCTA 541 ACTCCAAATC ATGGGTCGGA TAATTACGTT CATGCACCTT TAATTGC Predicted gene structure (within gDNA segment 23053 to 19619): Exon 1 21994 21409 ( 586 n); cDNA 1 586 ( 586 n); score: 0.879 MATCH C01HBa0088L02.1- SGN-E352950+ 0.879 586 0.998 C PGS_C01HBa0088L02.1-_SGN-E352950+ (21994 21409) Alignment (genomic DNA sequence = upper lines): CCTTTGTCAG AATGGAGTTG ATCAAATCAT CGACGCGGGG TACACATACC CTTCCCTTAA 21935 ||| ||| || ||| | || |||||||| | || | ||||| |||||||||| ||||||||| CCTCTGTAAG AATAGTGTGA ATCAAATCGT CGGCACGGGG TACACATACC TTTCCCTTAA 60 TCCTCAAAAC ACCTTCCTCA TCGATCGTCG CTTCTTTAGC CTCTCCTCGC AACACTTTAT 21875 |||||||||| |||||||| | ||||| | | |||||||||| |||||||||| | || |||| TCCTCAAAAC ACCTTCCTTA TCGATTTTTG CTTCTTTAGC CTCTCCTCGC ATTACCTTAT 120 CTCGGATCCG GATCAATTTT TCATCATTAA ACTGCTTTCC CTTAATCTTG TCAAGGAAGG 21815 |||| |||| ||||| ||| ||||| ||| |||||||||| |||||||| ||||| |||| CTCGAATCCA GATCAGTTTC TCATCGGTAA ACTGCTTTCC TTTAATCTTA TCAAGAAAGG 180 AAGATCTTGC CTCCACACAA GCTAAAAGTC CTCCCTTCTC ATTTACTTCT AATCTCATAA 21755 |||||||||| |||||||||| || |||| | |||||||||| ||||| |||| | ||||||| AAGATCTTGC CTCCACACAA GCCAAAAATT CTCCCTTCTC ATTTAATTCT AGCCTCATAA 240 GGTCGTTAGC CAGAATCTGA ACTTCTCTAG CCAATGGGCG TCTAGAAGCT TGCAAGTGAG 21695 |||| ||||| |||| ||||| || ||||||| ||||||||| ||||||| | |||||||||| GGTCATTAGC CAGAGTCTGA ACCTCTCTAG CCAATGGGCA TCTAGAAACC TGCAAGTGAG 300 CTAGACTTCC CATGCTTCCC GCCTTTCTAC TTAAAGCATC CGCTACAACA TTCGCCTTCC 21635 |||||||||| |||||| || |||||||||| |||||||||| || |||||| || ||||| | CTAGACTTCC CATGCTCCCT GCCTTTCTAC TTAAAGCATC TGCCACAACA TTAGCCTTTC 360 CCGGATGATA CAAAATAGTG ATGTCGTAGT TCTTCAGTAG TTCCATCCAT CTCCTCTGTC 21575 |||||||||| ||| |||||| || || |||| ||||||||| |||||| || |||||||||| CCGGATGATA CAAGATAGTG ATATCATAGT CCTTCAGTAG CTCCATCGAT CTCCTCTGTC 420 TCAAGTTCAA ATCTTTCTGA GTAAAGACAT ACTGTAGGCT ACGATGATCC GTGTAGACCT 21515 |||| ||||| |||||||||| |||||||||| |||||| || |||||||||| | ||||| | TCAAATTCAA ATCTTTCTGA GTAAAGACAT ACTGTAAACT ACGATGATCC ATATAGACTT 480 CACACTTAAC CCCATATAAA TAGTGTCTCC ATTGCTTTAA TGCAAACAAT ACCGCAGCCA 21455 |||||||||| |||||| | | || |||||| ||| |||||| ||||| || | || || || | CACACTTAAC CCCATAGAGA TAATGTCTCT ATTACTTTAA TGCAATCACT ACTGCCGCTA 540 ATTCCAAATC ATGAGTTGGA TAGTTACGTT AATGCACCTT TAATTG 21409 | |||||||| ||| || ||| || ||||||| ||||||||| |||||| ACTCCAAATC ATGGGTCGGA TAATTACGTT CATGCACCTT TAATTG 586 hqPGS_C01HBa0088L02.1-_SGN-E352950+ (21994 21409) ******************************************************************************** EST sequence 250 +strand 587 n (File: SGN-E357100+) 1 CCTCTGTAAG AATAGTGTGA ATCAAATCGT CGGCACGGGG TACACATACC TTTCCCTTAA 61 TCCTCAAAAC ACCTTCCTTA TCGATTTTTG CTTCTTTAGC CTCTCCTCGC ATTACCTTAT 121 CTCGAATCCA GATCAGTTTC TCATCGGTAA ACTGCTTTCC TTTAATCTTA TCAAGAAAGG 181 AAGATCTTGC CTCCACACAA GCCAAAAATT CTCCCTTCTC ATTTAATTCT AGCCTCATAA 241 GGTCATTAGC CAGAGTCTGA ACCTCTCTAG CCAATGGGCA TCTAGAAACC TGCAAGTGAG 301 CTAGACTTCC CATGCTCCCT GCCTTTCTAC TTAAAGCATC TGCCACAACA TTAGCCTTTC 361 CCGGATGATA CAAGATAGTG ATATCATAGT CCTTCAGTAG CTCCATCGAT CTCCTCTGTC 421 TCAAATTCAA ATCTTTCTGA GTAAAGACAT ACTGTAAACT ACGATGATCC ATATAGACTT 481 CACACTTAAC CCCATAGAGA TAATGTCTCT ATTACTTTAA TGCAATCACT ACTGCCGCTA 541 ACTCCAAATC ATGGGTCGGA TAATTACGTT CATGCACCTT TAATTGC Predicted gene structure (within gDNA segment 23053 to 19619): Exon 1 21994 21409 ( 586 n); cDNA 1 586 ( 586 n); score: 0.879 MATCH C01HBa0088L02.1- SGN-E357100+ 0.879 586 0.998 C PGS_C01HBa0088L02.1-_SGN-E357100+ (21994 21409) Alignment (genomic DNA sequence = upper lines): CCTTTGTCAG AATGGAGTTG ATCAAATCAT CGACGCGGGG TACACATACC CTTCCCTTAA 21935 ||| ||| || ||| | || |||||||| | || | ||||| |||||||||| ||||||||| CCTCTGTAAG AATAGTGTGA ATCAAATCGT CGGCACGGGG TACACATACC TTTCCCTTAA 60 TCCTCAAAAC ACCTTCCTCA TCGATCGTCG CTTCTTTAGC CTCTCCTCGC AACACTTTAT 21875 |||||||||| |||||||| | ||||| | | |||||||||| |||||||||| | || |||| TCCTCAAAAC ACCTTCCTTA TCGATTTTTG CTTCTTTAGC CTCTCCTCGC ATTACCTTAT 120 CTCGGATCCG GATCAATTTT TCATCATTAA ACTGCTTTCC CTTAATCTTG TCAAGGAAGG 21815 |||| |||| ||||| ||| ||||| ||| |||||||||| |||||||| ||||| |||| CTCGAATCCA GATCAGTTTC TCATCGGTAA ACTGCTTTCC TTTAATCTTA TCAAGAAAGG 180 AAGATCTTGC CTCCACACAA GCTAAAAGTC CTCCCTTCTC ATTTACTTCT AATCTCATAA 21755 |||||||||| |||||||||| || |||| | |||||||||| ||||| |||| | ||||||| AAGATCTTGC CTCCACACAA GCCAAAAATT CTCCCTTCTC ATTTAATTCT AGCCTCATAA 240 GGTCGTTAGC CAGAATCTGA ACTTCTCTAG CCAATGGGCG TCTAGAAGCT TGCAAGTGAG 21695 |||| ||||| |||| ||||| || ||||||| ||||||||| ||||||| | |||||||||| GGTCATTAGC CAGAGTCTGA ACCTCTCTAG CCAATGGGCA TCTAGAAACC TGCAAGTGAG 300 CTAGACTTCC CATGCTTCCC GCCTTTCTAC TTAAAGCATC CGCTACAACA TTCGCCTTCC 21635 |||||||||| |||||| || |||||||||| |||||||||| || |||||| || ||||| | CTAGACTTCC CATGCTCCCT GCCTTTCTAC TTAAAGCATC TGCCACAACA TTAGCCTTTC 360 CCGGATGATA CAAAATAGTG ATGTCGTAGT TCTTCAGTAG TTCCATCCAT CTCCTCTGTC 21575 |||||||||| ||| |||||| || || |||| ||||||||| |||||| || |||||||||| CCGGATGATA CAAGATAGTG ATATCATAGT CCTTCAGTAG CTCCATCGAT CTCCTCTGTC 420 TCAAGTTCAA ATCTTTCTGA GTAAAGACAT ACTGTAGGCT ACGATGATCC GTGTAGACCT 21515 |||| ||||| |||||||||| |||||||||| |||||| || |||||||||| | ||||| | TCAAATTCAA ATCTTTCTGA GTAAAGACAT ACTGTAAACT ACGATGATCC ATATAGACTT 480 CACACTTAAC CCCATATAAA TAGTGTCTCC ATTGCTTTAA TGCAAACAAT ACCGCAGCCA 21455 |||||||||| |||||| | | || |||||| ||| |||||| ||||| || | || || || | CACACTTAAC CCCATAGAGA TAATGTCTCT ATTACTTTAA TGCAATCACT ACTGCCGCTA 540 ATTCCAAATC ATGAGTTGGA TAGTTACGTT AATGCACCTT TAATTG 21409 | |||||||| ||| || ||| || ||||||| ||||||||| |||||| ACTCCAAATC ATGGGTCGGA TAATTACGTT CATGCACCTT TAATTG 586 hqPGS_C01HBa0088L02.1-_SGN-E357100+ (21994 21409) ******************************************************************************** EST sequence 183 +strand 554 n (File: SGN-E352647+) 1 CCTCTGTAAG AATAGTGTGA ATCAAATCGT CGGCACGGGG TACACATACC TTTCCCTTAA 61 TCCTCAAAAC ACCTTCCTTA TCGATTTTTG CTTCTTTAGC CTCTCCTCGC ATTACCTTAT 121 CTCGAATCCA GATCAGTTTC TCATCGGTAA ACTGCTTTCC TTTAATCTTA TCAAGAAAGG 181 AAGATCTTGC CTCCACACAA GCCAAAAATT CTCCCTTCTC ATTTAATTCT AGCCTCATAA 241 GGTCATTAGC CAGAGTCTGA ACCTCTCTAG CCAATGGGCA TCTAGAAACC TGCAAGTGAG 301 CTAGACTTCC CATGCTCCCT GCCTTTCTAC TTAAAGCATC TGCCACAACA TTAGCCTTTC 361 CCGGATGATA CAAGATAGTG ATATCATAGT CCTTCAGTAG CTCCATCGAT CTCCTCTGTC 421 TCAAATTCAA ATCTTTCTGA GTAAAGACAT ACTGTAAACT ACGATGATCC ATATAGACTT 481 CACACTTAAA CCCATAGAGA TAATGGCTCT ATTACTTTAA TGCAATCACT ACTGCCGCTA 541 ACTCCAAATC ATGG Predicted gene structure (within gDNA segment 23053 to 19949): Exon 1 21994 21442 ( 553 n); cDNA 1 553 ( 553 n); score: 0.875 MATCH C01HBa0088L02.1- SGN-E352647+ 0.875 553 0.998 C PGS_C01HBa0088L02.1-_SGN-E352647+ (21994 21442) Alignment (genomic DNA sequence = upper lines): CCTTTGTCAG AATGGAGTTG ATCAAATCAT CGACGCGGGG TACACATACC CTTCCCTTAA 21935 ||| ||| || ||| | || |||||||| | || | ||||| |||||||||| ||||||||| CCTCTGTAAG AATAGTGTGA ATCAAATCGT CGGCACGGGG TACACATACC TTTCCCTTAA 60 TCCTCAAAAC ACCTTCCTCA TCGATCGTCG CTTCTTTAGC CTCTCCTCGC AACACTTTAT 21875 |||||||||| |||||||| | ||||| | | |||||||||| |||||||||| | || |||| TCCTCAAAAC ACCTTCCTTA TCGATTTTTG CTTCTTTAGC CTCTCCTCGC ATTACCTTAT 120 CTCGGATCCG GATCAATTTT TCATCATTAA ACTGCTTTCC CTTAATCTTG TCAAGGAAGG 21815 |||| |||| ||||| ||| ||||| ||| |||||||||| |||||||| ||||| |||| CTCGAATCCA GATCAGTTTC TCATCGGTAA ACTGCTTTCC TTTAATCTTA TCAAGAAAGG 180 AAGATCTTGC CTCCACACAA GCTAAAAGTC CTCCCTTCTC ATTTACTTCT AATCTCATAA 21755 |||||||||| |||||||||| || |||| | |||||||||| ||||| |||| | ||||||| AAGATCTTGC CTCCACACAA GCCAAAAATT CTCCCTTCTC ATTTAATTCT AGCCTCATAA 240 GGTCGTTAGC CAGAATCTGA ACTTCTCTAG CCAATGGGCG TCTAGAAGCT TGCAAGTGAG 21695 |||| ||||| |||| ||||| || ||||||| ||||||||| ||||||| | |||||||||| GGTCATTAGC CAGAGTCTGA ACCTCTCTAG CCAATGGGCA TCTAGAAACC TGCAAGTGAG 300 CTAGACTTCC CATGCTTCCC GCCTTTCTAC TTAAAGCATC CGCTACAACA TTCGCCTTCC 21635 |||||||||| |||||| || |||||||||| |||||||||| || |||||| || ||||| | CTAGACTTCC CATGCTCCCT GCCTTTCTAC TTAAAGCATC TGCCACAACA TTAGCCTTTC 360 CCGGATGATA CAAAATAGTG ATGTCGTAGT TCTTCAGTAG TTCCATCCAT CTCCTCTGTC 21575 |||||||||| ||| |||||| || || |||| ||||||||| |||||| || |||||||||| CCGGATGATA CAAGATAGTG ATATCATAGT CCTTCAGTAG CTCCATCGAT CTCCTCTGTC 420 TCAAGTTCAA ATCTTTCTGA GTAAAGACAT ACTGTAGGCT ACGATGATCC GTGTAGACCT 21515 |||| ||||| |||||||||| |||||||||| |||||| || |||||||||| | ||||| | TCAAATTCAA ATCTTTCTGA GTAAAGACAT ACTGTAAACT ACGATGATCC ATATAGACTT 480 CACACTTAAC CCCATATAAA TAGTGTCTCC ATTGCTTTAA TGCAAACAAT ACCGCAGCCA 21455 ||||||||| |||||| | | || || ||| ||| |||||| ||||| || | || || || | CACACTTAAA CCCATAGAGA TAATGGCTCT ATTACTTTAA TGCAATCACT ACTGCCGCTA 540 ATTCCAAATC ATG 21442 | |||||||| ||| ACTCCAAATC ATG 553 hqPGS_C01HBa0088L02.1-_SGN-E352647+ (21994 21442) ******************************************************************************** EST sequence 120 +strand 654 n (File: SGN-E578131+) 1 GTAAACTGCA TACCTCTATC TGATATGATG GAGAGTGGAA CTCCATGCAA TCGAACGATT 61 TCTGAGATAT AGATTCTGAC TAACTTCTCT ACATTGTAGG TCACCTTGAC CGGAATGCAA 121 TGAGCAGACT TAGTCAATCT GTCAACAATT ACACAAATGG AGTCATACTT ACCCATTGTC 181 TTTGGAAGGC CAACCACGAA GTCCATTGCA ATTCTCTCCC ACTTCCATTC AGGAATGGGC 241 ATTCTCTGAA GTGTCCGTCC AGGCCTTTGC TGTTCATACT TTACATGCTG ACCATTCGGT 301 TAGAAATGCT AATGGACGCT ACTTTCCCAC TAGTTCAAAA TTTGTGAAGC CACGGGCTTG 361 CTTGAAGATT GGTCTTGGTC TCTTAACAAA ACAGATCCGC TGATATGTTT CTAATTATGC 421 AGAGGATTTT GCAAGAAAGA GTTGTTAGTA GCCGGGAAGC TGAACTCAAT AGATTGAAGC 481 AGGAGAGACG AGAAAGGATC AGCCAGATAA TTCAATCAAG GAAGCAGGAG AGGGAAGCTA 541 AGAGGAAAAT GTTATTCTTT CTGCGAACTG AGGAGGAGCG TCAAAAGAGG TTACTGGAAG 601 AGGAGGAAGC CCGCAAACGT GAAGGTTCTC CTGTGGGAAG CCGGACTTGC TAAG Predicted gene structure (within gDNA segment 23099 to 17141): Exon 1 22409 22124 ( 286 n); cDNA 1 286 ( 286 n); score: 0.899 Intron 1 22123 20000 (2124 n); Pd: 0.000 (s: 0.88), Pa: 0.410 (s: 0) Exon 2 19999 19972 ( 28 n); cDNA 287 313 ( 27 n); score: 0.679 MATCH C01HBa0088L02.1- SGN-E578131+ 0.899 314 0.480 C PGS_C01HBa0088L02.1-_SGN-E578131+ (22409 22124,19999 19972) Alignment (genomic DNA sequence = upper lines): GTAAACTGCG TACCTCTATC TGATATGATG GATAGTGGAA CCCCATGCAA TCGAACGATT 22350 ||||||||| |||||||||| |||||||||| || ||||||| | |||||||| |||||||||| GTAAACTGCA TACCTCTATC TGATATGATG GAGAGTGGAA CTCCATGCAA TCGAACGATT 60 TCTGAGATAT AGATCTTGGC TAACTTCTCG GCATTGTAAG TCACCTTAAC CGGAACGAAA 22290 |||||||||| |||| || | ||||||||| ||||||| | ||||||| || ||||| | || TCTGAGATAT AGATTCTGAC TAACTTCTCT ACATTGTAGG TCACCTTGAC CGGAATGCAA 120 TGAGCAGACT TAGTTAACCT ATCAACAATC ACCCAAATGG AGTCATACTT ACCCATCGTC 22230 |||||||||| |||| || || |||||||| || ||||||| |||||||||| |||||| ||| TGAGCAGACT TAGTCAATCT GTCAACAATT ACACAAATGG AGTCATACTT ACCCATTGTC 180 TTTGGAAGAC CAACCACGAA GTCCATTGCG ATTCTATCCC ATTTCCATTC CGGAATGGGC 22170 |||||||| | |||||||||| ||||||||| ||||| |||| | |||||||| ||||||||| TTTGGAAGGC CAACCACGAA GTCCATTGCA ATTCTCTCCC ACTTCCATTC AGGAATGGGC 240 ATCCTCTGAA GTGTTCCTCC GGGCCTTTGG TGTTCATACT TTACTTGTTG ACAGTTTGGA 22110 || ||||||| |||| | ||| |||||||| |||||||||| |||| | ATTCTCTGAA GTGTCCGTCC AGGCCTTTGC TGTTCATACT TTACAT.... .......... 286 CATTTGGCAA TAAAATCTAC AATATCACGC TTCATTCTAC TCCACCAAAA GTGTTGCTTT 22050 .......... .......... .......... .......... .......... .......... 286 AGGTCACGGT ACATCTTGGT TGCACCCGGA TGTATTGAAT ACCTTGAACT ATGAGCCTTT 21990 .......... .......... .......... .......... .......... .......... 286 GTCAGAATGG AGTTGATCAA ATCATCGACG CGGGGTACAC ATACCCTTCC CTTAATCCTC 21930 .......... .......... .......... .......... .......... .......... 286 AAAACACCTT CCTCATCGAT CGTCGCTTCT TTAGCCTCTC CTCGCAACAC TTTATCTCGG 21870 .......... .......... .......... .......... .......... .......... 286 ATCCGGATCA ATTTTTCATC ATTAAACTGC TTTCCCTTAA TCTTGTCAAG GAAGGAAGAT 21810 .......... .......... .......... .......... .......... .......... 286 CTTGCCTCCA CACAAGCTAA AAGTCCTCCC TTCTCATTTA CTTCTAATCT CATAAGGTCG 21750 .......... .......... .......... .......... .......... .......... 286 TTAGCCAGAA TCTGAACTTC TCTAGCCAAT GGGCGTCTAG AAGCTTGCAA GTGAGCTAGA 21690 .......... .......... .......... .......... .......... .......... 286 CTTCCCATGC TTCCCGCCTT TCTACTTAAA GCATCCGCTA CAACATTCGC CTTCCCCGGA 21630 .......... .......... .......... .......... .......... .......... 286 TGATACAAAA TAGTGATGTC GTAGTTCTTC AGTAGTTCCA TCCATCTCCT CTGTCTCAAG 21570 .......... .......... .......... .......... .......... .......... 286 TTCAAATCTT TCTGAGTAAA GACATACTGT AGGCTACGAT GATCCGTGTA GACCTCACAC 21510 .......... .......... .......... .......... .......... .......... 286 TTAACCCCAT ATAAATAGTG TCTCCATTGC TTTAATGCAA ACAATACCGC AGCCAATTCC 21450 .......... .......... .......... .......... .......... .......... 286 AAATCATGAG TTGGATAGTT ACGTTAATGC ACCTTTAATT GTCTTGAAGC ATAAACAATT 21390 .......... .......... .......... .......... .......... .......... 286 ACACTCTTCT CTTGCATTAG CACTGCACCC AACCCAGAAT AGGATGCATC ACAATAAACA 21330 .......... .......... .......... .......... .......... .......... 286 ATGAAATTCT TACCTTCCAC TGGCAAGGTG AGAATTGGTG CAGTAGTCAA CAGAGTCTTG 21270 .......... .......... .......... .......... .......... .......... 286 AGCTTCTGAA AGCTTTCTTC ACACTCGTCC GACCATACAA ATGGAACATT CTGCTTAGTC 21210 .......... .......... .......... .......... .......... .......... 286 AAGTTCGTCA ATTGGGAAGC AATAGAAGAG AATCCTTTGA CAAATCAGCG GTAGTAGCTA 21150 .......... .......... .......... .......... .......... .......... 286 GCTAACCCAA CAAAGCTCCT TATTTCTGAC ACATTAGTGG GTCTTACCCA ATTCTTCACT 21090 .......... .......... .......... .......... .......... .......... 286 GTCTCAATCT TAGAAGGATC CACCATCACT CCTTCCTTAG AAACCACGTG CCCCAAGAAG 21030 .......... .......... .......... .......... .......... .......... 286 GACACTGCAT CTAGCCAAAA CTCACACTTA GAGAACTTGG CATAAAGCTT TTTCTCCCTC 20970 .......... .......... .......... .......... .......... .......... 286 AACATTTCCA ATACCATTCT CAAATGCTCT TCATGTTCCT TCTTGCTCTT TGAGTATACC 20910 .......... .......... .......... .......... .......... .......... 286 AATATATCAT CAATAAATAC AATCACGAAG AGGTCCAAAT ATGGCTTAAA AATCCCGTTT 20850 .......... .......... .......... .......... .......... .......... 286 ATCAACCTCA TGAATGCAGC AGGGGCATTC GTAAGACCAA AAGACATCAC CACAAATTCG 20790 .......... .......... .......... .......... .......... .......... 286 TAATGCCCAT ACCTTGTTCG AAAAGCAGTC TTTGGCACAT CCGTTGCCCG TATTTTCAAT 20730 .......... .......... .......... .......... .......... .......... 286 TGATGATAAC CAGATCTCAA GTCAATCTTA GAGAAGACAC AAGCACCTTG TAATTGATTG 20670 .......... .......... .......... .......... .......... .......... 286 AACAAGTCAT CAATGCGAGG AAAAGGATAC TTGTTCTTAA TAGTTACCTT ATTCAGTTGT 20610 .......... .......... .......... .......... .......... .......... 286 CTGTAGTCTA TGCACATCCG AAAACTCCCA TCCTTCTTCT TCACAAACAA AACCGGAGCA 20550 .......... .......... .......... .......... .......... .......... 286 CCCCAAGGAG ATGCACTTGG TCTGATGAAG CCTTTGTTCA ACAACTCTTG AAGTTGGGCC 20490 .......... .......... .......... .......... .......... .......... 286 TTTAACTCTC TCAACTCCGC GGGAGCCATT CTATAAGGGG GTATAGAAAT GGGGCGAGTG 20430 .......... .......... .......... .......... .......... .......... 286 CCCGGTTCAA GATCAATGCA GAAGTCAATA TCCCTATCTG GTGGCATACC AGGAAGATCT 20370 .......... .......... .......... .......... .......... .......... 286 GCAGGGAACA CATCCAAAAA CTCGCGGACT ACCGAAACCG ACTCAATCGA AGGTACTTGG 20310 .......... .......... .......... .......... .......... .......... 286 GTAGTGTCAT CCTTGAGATG GGCCAAGAAA GCTAAACACC CTTTACTAAC CATTTTCTTA 20250 .......... .......... .......... .......... .......... .......... 286 GCACGAAGAA AGGAGATGAT ACGCACCGGA TTGGAAGTGT AGTCACCCTC CCACACTAAC 20190 .......... .......... .......... .......... .......... .......... 286 GGGTCTGTCC TAGGCTTGGC TAACGTCACC ATTTTAGCAT TACAATCCAA GATCGCAAAA 20130 .......... .......... .......... .......... .......... .......... 286 TTCGGAGAAA GCCAAGTCAT ACGCAGAATT ACATCAAAGT CAACCATTTC TAAGATAACC 20070 .......... .......... .......... .......... .......... .......... 286 AAATCTACAT AAGTGTTACT CCCTACAAAA GTCACCAAAC AAGACCTATA CACTTTTTCA 20010 .......... .......... .......... .......... .......... .......... 286 ACTATCACAG ACTCACCCAT CGGGGTAGAA ACACGAAT 19972 || | |||| || ||||| | | ||| .......... GCTGA-CCAT TCGGTTAGAA ATGCTAAT 313 hqPGS_C01HBa0088L02.1-_SGN-E578131+ (22409 22124) ******************************************************************************** EST sequence 61 -strand 763 n (File: SGN-E354383-) 1 AGAGAGTCGA TTTTCATATC CAAATTCAGA AATTCTAAGT ATGCTGAAAC GATGCACCTT 61 CGACGGGCCG TCGTGCCTGT GACGGTCCGT CGCAGTGCCC GTGGTCTTGG CCAGTTTTTC 121 CAGAATTAAA ATCTGCTGCT CAAAACGACT AAACAGGTCG TTACAATAGA TACCAATTTA 181 CCCATCGTTC GTCCCCGAAC GATCAAATGA AGAAAAACAA TGGCGAAAAG GAGTACCTGA 241 ATCTGTAAAC AGATGTGGGT ATTTTTCTTG CATATCTGCC TCCTTCTCCC AAGTAGCTTC 301 TTCAACCGGT CGATTCTTCC ATTGAACTTT GATGGATGCA ATTTCTCTCG ACCTCAACTT 361 GCGAACCTCT CTATCTAAAA TAGCAACTGG TTCCTCCTCA TAAGTCCAAT TCTCACCAAG 421 CGAAACTGAA TCCCAACGGA TGATGTAGTT TCCATCTCCA TGGTATCTTT TCAACATGGA 481 TACATGAAAT ACCGGATGTA CTCCGGACAG CCCTGGAGGT AAGGCTAATT CATAAGCCAC 541 CTCCCCTACT CGCTTTAGTA CCTCAAATGG TCCAATATAC CTTGGACTTA ACTTACCTCT 601 TTTACGAAAC CGCATCACCC CTTTCATTGG CGAGACTTTC AACAAGACTT GTTCGCCCTC 661 CATGAACTCT AAGTCTCTAA CCTTTCGATC TGCATATTCT TTTTGTCTAC TTTGCGCCGC 721 TAGAAGCTTT TCTTGAATAG ACTTCACTTT CTCCATCGAA TCT Predicted gene structure (within gDNA segment 25226 to 22030): Exon 1 23587 23548 ( 40 n); cDNA 58 95 ( 38 n); score: 0.850 Intron 1 23547 23388 ( 160 n); Pd: 0.000 (s: 0.85), Pa: 0.000 (s: 0.84) Exon 2 23387 22721 ( 667 n); cDNA 96 762 ( 667 n); score: 0.910 MATCH C01HBa0088L02.1- SGN-E354383- 0.910 707 0.927 C PGS_C01HBa0088L02.1-_SGN-E354383- (23587 23548,23387 22721) Alignment (genomic DNA sequence = upper lines): CTGTGATGGG CCGTCGTGCC TGCGACGGTC CGTCCTGCAG GTCGTCGCAA AGTTCAGAGA 23528 || || ||| |||||||||| || ||||||| |||| |||| CTTCGACGGG CCGTCGTGCC TGTGACGGTC CGTC--GCAG .......... .......... 95 CCCAAATTTC CACCAAGGGT CTGTGACGGT CCGTCCTGCC ATTTCGTTAC GAAGTTCAGA 23468 .......... .......... .......... .......... .......... .......... 95 GAGTCGATTT CAGCACCCAA TTTTTAGATT TTCTAAGTGT TTTGAAACGA GACCCTGTGA 23408 .......... .......... .......... .......... .......... .......... 95 CGGTCCGTCG TGCCCATGAC GGTCCGTCGC CTCAGCCTGT TTTTCCAGAA ATAAAATCTG 23348 | |||| | || ||| || |||||||||| ||||||||| .......... .......... TGCCCGTGGT CTTGGCCAGT TTTTCCAGAA TTAAAATCTG 135 CTGCTCAAAA CGACTAAACA GGTCGTTACA ATAGATACCA ATTTACCCAT CGTTCGTCCC 23288 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTGCTCAAAA CGACTAAACA GGTCGTTACA ATAGATACCA ATTTACCCAT CGTTCGTCCC 195 CGAACGATCA CCAGAAGGAA AACGAGGGCG AAAAGGAGTA CCTGAATCTG TAAACAGATG 23228 |||||||||| |||| || ||| | |||| |||||||||| |||||||||| |||||||||| CGAACGATCA AATGAAGAAA AACAATGGCG AAAAGGAGTA CCTGAATCTG TAAACAGATG 255 TGGGTATCTT TCTCGCATAT CTGCCTCCTT CTCCCAAGTG GCTTCTTCAA CGGGTCGATT 23168 ||||||| || ||| |||||| |||||||||| ||||||||| |||||||||| | |||||||| TGGGTATTTT TCTTGCATAT CTGCCTCCTT CTCCCAAGTA GCTTCTTCAA CCGGTCGATT 315 CTTCCATTGA ACTTTGATGG ATGCAATCTC CCTTGATCTC AACTTGCGAA TTTCTCTATC 23108 |||||||||| |||||||||| ||||||| || || || ||| |||||||||| |||||||| CTTCCATTGA ACTTTGATGG ATGCAATTTC TCTCGACCTC AACTTGCGAA CCTCTCTATC 375 TAGAATGGCA ACAGGCTCAT CCTCATAAGT CAAATTTTCA TCAAGCAAGA CTGAATCCCA 23048 || ||| ||| || || || | |||||||||| | |||| ||| ||||| | | |||||||||| TAAAATAGCA ACTGGTTCCT CCTCATAAGT CCAATTCTCA CCAAGCGAAA CTGAATCCCA 435 ACGAATAATA TAGTTTCCAT CCCCATGGTA TCTTTTCAAC ATCGACACAT GGAATACCGG 22988 ||| || || |||||||||| | |||||||| |||||||||| || || |||| | |||||||| ACGGATGATG TAGTTTCCAT CTCCATGGTA TCTTTTCAAC ATGGATACAT GAAATACCGG 495 ATGTACTCCG GACAGCCCTG GAGGCAAGGC TAACTTATAA GTCACCTCCC CTACTCGCTT 22928 |||||||||| |||||||||| |||| ||||| ||| | |||| | |||||||| |||||||||| ATGTACTCCG GACAGCCCTG GAGGTAAGGC TAATTCATAA GCCACCTCCC CTACTCGCTT 555 AAGTACTTCA AATGGACCAA TATACCTTGG GCTTAGTTTA CCTCTTTTAC CAAACCGCAT 22868 ||||| ||| ||||| |||| |||||||||| |||| ||| |||||||||| ||||||||| TAGTACCTCA AATGGTCCAA TATACCTTGG ACTTAACTTA CCTCTTTTAC GAAACCGCAT 615 CACCCCTTTC ATTGGTGAAA CTTTCAACAA GACTTGTTCA CCCTCCATGA ACTCTAAGTC 22808 |||||||||| ||||| || | |||||||||| ||||||||| |||||||||| |||||||||| CACCCCTTTC ATTGGCGAGA CTTTCAACAA GACTTGTTCG CCCTCCATGA ACTCTAAGTC 675 TCTAACCTTT TGATCTGCAT ATTTCTTTTG TCTACTTTGC GCCGCTAGAA GTTTTTCTTG 22748 |||||||||| ||||||||| ||| ||||| |||||||||| |||||||||| | |||||||| TCTAACCTTT CGATCTGCAT ATTCTTTTTG TCTACTTTGC GCCGCTAGAA GCTTTTCTTG 735 AATAGACTTC ACTTTCTCTA TCGAATC 22721 |||||||||| |||||||| | ||||||| AATAGACTTC ACTTTCTCCA TCGAATC 762 hqPGS_C01HBa0088L02.1-_SGN-E354383- (23587 23548,23387 22721) ******************************************************************************** EST sequence 202 +strand 542 n (File: SGN-E353207+) 1 TCGGCATGTA CTGTTTTCCA AAACTTAGAA GTAAATTGCG TACCTCTATC TGATATGATG 61 GAGAGTGGAA CTCCGTGCAA TCGAACAATT TCTAAGATGT AAAGTTTGGC TAACTTCTCT 121 GCATTGTAAG TCACCTTAAC CGAAATAGAG TGAGCAGACT TAGTTAATCT GTCAACAATC 181 ACCCAAATAG AGTCATACCT ACCCATCGTC TTTGGATGAC TAACCACGAA GTCCATTGCA 241 ATTCTCTCCC ACTTCCATTC AGGAATGGGC ATTCTCTGAA GTGTCCCTCC AGGCCTCTGG 301 TGTTCATACT TTACTTGCTG ACAATTCGGG CATTGAGCAA CAAAATTAAC AATGTCACGC 361 TTCATCCTAC TCCACCAAAA ATGTTGCTTT AGGTCACGAT ACATCTTGTT TGCACCAGGA 421 TGTATAGAGT ACTTCGAACT ATGAGCCTAT ATAAGAATAG TGTGAATCAA ATCATCGACG 481 CGGGGTACAC ATACTCCTTC CCTTATTCTC AAAACACCTT CCTCATCGAT TTTTGCTTCT 541 TT Predicted gene structure (within gDNA segment 23138 to 21180): Exon 1 22434 21898 ( 537 n); cDNA 6 542 ( 537 n); score: 0.878 MATCH C01HBa0088L02.1- SGN-E353207+ 0.878 537 0.991 C PGS_C01HBa0088L02.1-_SGN-E353207+ (22434 21898) Alignment (genomic DNA sequence = upper lines): ATGCAATGTT TTCCAAAACT TAGAAGTAAA CTGCGTACCT CTATCTGATA TGATGGATAG 22375 ||| | |||| |||||||||| |||||||||| ||||||||| |||||||||| ||||||| || ATGTACTGTT TTCCAAAACT TAGAAGTAAA TTGCGTACCT CTATCTGATA TGATGGAGAG 65 TGGAACCCCA TGCAATCGAA CGATTTCTGA GATATAGATC TTGGCTAACT TCTCGGCATT 22315 |||||| || |||||||||| | |||||| | ||| || | |||||||||| |||| ||||| TGGAACTCCG TGCAATCGAA CAATTTCTAA GATGTAAAGT TTGGCTAACT TCTCTGCATT 125 GTAAGTCACC TTAACCGGAA CGAAATGAGC AGACTTAGTT AACCTATCAA CAATCACCCA 22255 |||||||||| ||||||| || | ||||| |||||||||| || || |||| |||||||||| GTAAGTCACC TTAACCGAAA TAGAGTGAGC AGACTTAGTT AATCTGTCAA CAATCACCCA 185 AATGGAGTCA TACTTACCCA TCGTCTTTGG AAGACCAACC ACGAAGTCCA TTGCGATTCT 22195 ||| |||||| ||| |||||| |||||||||| | ||| |||| |||||||||| |||| ||||| AATAGAGTCA TACCTACCCA TCGTCTTTGG ATGACTAACC ACGAAGTCCA TTGCAATTCT 245 ATCCCATTTC CATTCCGGAA TGGGCATCCT CTGAAGTGTT CCTCCGGGCC TTTGGTGTTC 22135 ||||| ||| ||||| |||| ||||||| || ||||||||| ||||| |||| | |||||||| CTCCCACTTC CATTCAGGAA TGGGCATTCT CTGAAGTGTC CCTCCAGGCC TCTGGTGTTC 305 ATACTTTACT TGTTGACAGT TTGGACATTT GGCAATAAAA TCTACAATAT CACGCTTCAT 22075 |||||||||| || ||||| | | || |||| |||| |||| | ||||| | |||||||||| ATACTTTACT TGCTGACAAT TCGGGCATTG AGCAACAAAA TTAACAATGT CACGCTTCAT 365 TCTACTCCAC CAAAAGTGTT GCTTTAGGTC ACGGTACATC TTGGTTGCAC CCGGATGTAT 22015 ||||||||| ||||| |||| |||||||||| ||| |||||| ||| |||||| | |||||||| CCTACTCCAC CAAAAATGTT GCTTTAGGTC ACGATACATC TTGTTTGCAC CAGGATGTAT 425 TGAATACCTT GAACTATGAG CCTTTGTCAG AATGGAGTTG ATCAAATCAT CGACGCGGGG 21955 || ||| | |||||||||| ||| | | || ||| | || |||||||||| |||||||||| AGAGTACTTC GAACTATGAG CCTATATAAG AATAGTGTGA ATCAAATCAT CGACGCGGGG 485 TACACATAC- CCTTCCCTTA ATCCTCAAAA CACCTTCCTC ATCGATCGTC GCTTCTTT 21898 ||||||||| ||||||||| || ||||||| |||||||||| |||||| | |||||||| TACACATACT CCTTCCCTT- ATTCTCAAAA CACCTTCCTC ATCGATTTTT GCTTCTTT 542 hqPGS_C01HBa0088L02.1-_SGN-E353207+ (22434 21898) ******************************************************************************** EST sequence 114 +strand 188 n (File: SGN-E577888+) 1 CTACATCTCC TACCATACAA TGCTTCAAAT GGAGCCATAT CAATGCTTGA TTGATAGCTA 61 TTATTGTATG AAAACTCCGC TAAGGGTAGG AAGCTATCCC AATGACCACC AAACTCTATC 121 ACACACGCAC GAAGCATATT CTCCAACACT TGAATCGTTC GCTCAGACTG ACCATCGGGA 181 GAACTAGT Predicted gene structure (within gDNA segment 23718 to 21772): Exon 1 22659 22483 ( 177 n); cDNA 1 177 ( 177 n); score: 0.944 MATCH C01HBa0088L02.1- SGN-E577888+ 0.944 177 0.941 C PGS_C01HBa0088L02.1-_SGN-E577888+ (22659 22483) Alignment (genomic DNA sequence = upper lines): CTACATCTCC TCCCATACAA TGCTTCAAAT GGGGTCATAT CAATACTTGA GTGATAGCTA 22600 |||||||||| | |||||||| |||||||||| || | ||||| |||| ||||| ||||||||| CTACATCTCC TACCATACAA TGCTTCAAAT GGAGCCATAT CAATGCTTGA TTGATAGCTA 60 TTATTGTATG AAAACTCCGC TAAGGGTAAA AAGCTATCCC AATGGCCACC AAACTCTATC 22540 |||||||||| |||||||||| |||||||| |||||||||| |||| ||||| |||||||||| TTATTGTATG AAAACTCCGC TAAGGGTAGG AAGCTATCCC AATGACCACC AAACTCTATC 120 ACACATGCAC GAAGCATATC CTCCAACACT TGAATCGTTC GCTCAGACTG ACCATCG 22483 ||||| |||| ||||||||| |||||||||| |||||||||| |||||||||| ||||||| ACACACGCAC GAAGCATATT CTCCAACACT TGAATCGTTC GCTCAGACTG ACCATCG 177 hqPGS_C01HBa0088L02.1-_SGN-E577888+ (22659 22483) ******************************************************************************** EST sequence 68 -strand 565 n (File: SGN-E275667-) 1 GAGACATCTG TGACGGACCG TCGTGCCTGT GACGGTCCGT CGTGGGTTCC GTTGTTTCAG 61 CCAATTTTCC AGAAATAAAA TCTGCTGCTC AAAACGACTA AACAGGTCGT TACAGTAATG 121 AAAAAAAAGA AGAAAGAGAA TAAAGAAAGA AGAAAGAAAG AGAAAAGGGA AGAAGAAGAA 181 AGAGAAAAAG AAAAAGAAAA AGAAAATGAA ATTGATAAAA TAAGAAAAAT AAAAATAAAA 241 ATTAATACGT GGCAGATTAT AATTGATGCG TAATTGAACT TCTTTTTTTG CAAGTGAGGA 301 TGGTTAAAAA ATGAGATATT TACAACACTT TAAAATTATT TAAGGGAGTA ATAAAATGTC 361 CGCTAAGTTA AGATATCTTT TTAATAATTT AAAATAACTT TAATGGTATT TTTATATCTT 421 TTCTCAAATA TTAAACTTTT TTAGAATACA CTCAATTCGC CTCAATGTCT TTTAAAATTT 481 TGACATTATG AATATCGACA TCACATGGTG CATATGCAAA AGTAATCACA TTATTATTGA 541 ATAGATCTAA TCTTTCATTG AGCGC Predicted gene structure (within gDNA segment 24617 to 18208): Exon 1 23587 23550 ( 38 n); cDNA 8 45 ( 38 n); score: 0.868 Intron 1 23549 23388 ( 162 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.86) Exon 2 23387 23318 ( 70 n); cDNA 46 114 ( 69 n); score: 0.900 MATCH C01HBa0088L02.1- SGN-E275667- 0.900 108 0.191 C PGS_C01HBa0088L02.1-_SGN-E275667- (23587 23550,23387 23318) Alignment (genomic DNA sequence = upper lines): CTGTGATGGG CCGTCGTGCC TGCGACGGTC CGTCCTGCAG GTCGTCGCAA AGTTCAGAGA 23528 |||||| || |||||||||| || ||||||| |||| || CTGTGACGGA CCGTCGTGCC TGTGACGGTC CGTCGTGG.. .......... .......... 45 CCCAAATTTC CACCAAGGGT CTGTGACGGT CCGTCCTGCC ATTTCGTTAC GAAGTTCAGA 23468 .......... .......... .......... .......... .......... .......... 45 GAGTCGATTT CAGCACCCAA TTTTTAGATT TTCTAAGTGT TTTGAAACGA GACCCTGTGA 23408 .......... .......... .......... .......... .......... .......... 45 CGGTCCGTCG TGCCCATGAC GGTCCGTCGC CTCAGCCTGT TTTTCCAGAA ATAAAATCTG 23348 | ||||| | |||||| |||||||||| |||||||||| .......... .......... GTTCCGTTGT TTCAGCCAA- TTTTCCAGAA ATAAAATCTG 84 CTGCTCAAAA CGACTAAACA GGTCGTTACA 23318 |||||||||| |||||||||| |||||||||| CTGCTCAAAA CGACTAAACA GGTCGTTACA 114 hqPGS_C01HBa0088L02.1-_SGN-E275667- (23587 23550,23387 23318) ******************************************************************************** EST sequence 107 -strand 660 n (File: SGN-E349296-) 1 AATATTATCA ATACATATTA TTCGCTATTA AGAGCTTACT ACGAATATCG TAAGAGAAAC 61 CATAACCTAC CTCCACCGAA GATTCGTGAT CAAGCAAGTG ATTTCCCAAG CTTTGTGTTT 121 TTTCCTCTCG TTCGATCCTC TTTCTCGTTC GACTTTCTCT CTCTTTCTCT TGTTCTTTCT 181 ATTTTCTTTA TTCAAACCCT CTTTCTTTTA CCCTAATTAG TATATAATTA AGAATAAAAT 241 ATGGCAATAA TAACCCACTA ATTAACTTAA GGTTACCTCT TTTAACCCCC AAGTAATTAG 301 ACTTATTAAC ATTAACCCAC TAACTTTATA ATTAAAGCAG GAATAGTCAA AAACGTCCCT 361 TAAAACAATT GAGGAATTCC GACTCAGACT GGGATTTACG CAGCCTGTGA CAGCCCGTTG 421 TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC GCAAGGTTCA GAGACTGGAT TTTCACTGAA 481 GACTCTGTGA TGGTCCATCA CGCCTGTGAC GGTCCGTCTT GCCATTCCGT TACGAAGTTC 541 AGAGAGTCGA TTTTCAGTAC CCAATTTCAG ATTTCCTAAG TGTTTTGAAA TGAGACCCTG 601 CGACGGTCCG TCGTGCCCAT GATGGTCCGT CGTGGGGTCC GTCATTTCTG CCAGTTTTTC Predicted gene structure (within gDNA segment 26760 to 20085): Exon 1 23989 23488 ( 502 n); cDNA 1 504 ( 504 n); score: 0.818 Intron 1 23487 23413 ( 75 n); Pd: 0.000 (s: 0.70), Pa: 0.000 (s: 0) Exon 2 23412 23387 ( 26 n); cDNA 505 529 ( 25 n); score: 0.846 MATCH C01HBa0088L02.1- SGN-E349296- 0.818 528 0.800 C PGS_C01HBa0088L02.1-_SGN-E349296- (23989 23488,23412 23387) Alignment (genomic DNA sequence = upper lines): AATACTATCA ATACATATCA TTCGCTATTA AGAGTTTACT ACGAATA--G TATGA-AAAC 23933 |||| ||||| |||||||| | |||||||||| |||| ||||| ||||||| | || || |||| AATATTATCA ATACATATTA TTCGCTATTA AGAGCTTACT ACGAATATCG TAAGAGAAAC 60 CATAACCTAC CTTCACCGAA GAATTGCGAT CAA-CAAGCT ATCTTCTCAA AATCCTTGCT 23874 |||||||||| || ||||||| || | | ||| ||| |||| || ||| ||| | || | CATAACCTAC CTCCACCGAA GATTCGTGAT CAAGCAAGTG AT-TTCCCAA GCTTTGTGTT 119 ATCCTCT-TC GTTTCTCTCT CTCTACTCGT TC-TCTTTCT TTTTCTGTCT CTCTTTGTTC 23816 | || || ||| || || | ||||| || |||||| | ||| | | ||| |||||| TTTTCCTCTC GTTCGATCCT CT-TTCTCGT TCGACTTTCT CTCTCT-T-T CTC-TTGTTC 175 TTTCTATTTT TCTTATTCAA ACCCTCTTTC TTTTACCCTA ATTAACATAT AATCAAGTGT 23756 |||||||||| |||||||| |||||||||| |||||||||| |||| |||| ||| ||| | TTTCTATTTT CTTTATTCAA ACCCTCTTTC TTTTACCCTA ATTAGTATAT AATTAAGAAT 235 AAAAGATGGC AATAATAACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA 23696 |||| ||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAAATATGGC AATAATAACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA 295 ATTAGACTTA TTAACATTAA CCCCCTAACT TTATAATTTA AGCAGGAATA GTCAAAAACG 23636 |||||||||| |||||||||| ||| |||||| |||||||| | |||||||||| |||||||||| ATTAGACTTA TTAACATTAA CCCACTAACT TTATAATTAA AGCAGGAATA GTCAAAAACG 355 TCCCTTAAAA CGTATAAAGA AATCCGACCC GGACTGGGA- TTGCGCAACC TGTGATGGGC 23577 |||||||||| | | | || | |||||| | |||||||| || |||| || ||||| | | TCCCTTAAAA CAATTGAGGA ATTCCGACTC AGACTGGGAT TTACGCAGCC TGTGACAGCC 415 CGTCGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAA GTTCAGAGAC CCAAATTTCC 23517 ||| |||||| |||||||||| |||||||||| ||||||||| |||||||||| | |||| CGTTGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAG GTTCAGAGAC TGGATTTTCA 475 ACCAAGGGTC TGTGACGGTC CGTCCTGCCA TTTCGTTACG AAGTTCAGAG AGTCGATTTC 23457 ||| || ||||| |||| | || ||| CTGAAGACTC TGTGATGGTC CATCACGCC. .......... .......... .......... 504 AGCACCCAAT TTTTAGATTT TCTAAGTGTT TTGAAACGAG ACCCTGTGAC GGTCCGTCGT 23397 |||||| |||||||| | .......... .......... .......... .......... ....TGTGAC GGTCCGTCTT 520 GCCCATGACG 23387 | |||| || G-CCATTCCG 529 hqPGS_C01HBa0088L02.1-_SGN-E349296- (23989 23488,23412 23387) ******************************************************************************** EST sequence 216 +strand 610 n (File: SGN-E396058+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTGTTT CCAAAAATAA AATCTGCTAC TCACAACGAC 541 TAAACAGGTC GTTACATTTA GGTTCTTCAT AGTTAACTAT TATTATTATT TTACGATTTA 601 TAACACTATT Predicted gene structure (within gDNA segment 24749 to 19878): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E396058+ 0.897 383 0.628 C PGS_C01HBa0088L02.1-_SGN-E396058+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E396058+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 14 -strand 679 n (File: SGN-E550127-) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTCCT TTTCTTTTTC TTATCAAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTGCACAA CCATGAATTA ATGAAAAAAT TATGACATAA 661 AATATAAAAA ATTACTCAT Predicted gene structure (within gDNA segment 25325 to 19198): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.889 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E550127- 0.889 383 0.564 C PGS_C01HBa0088L02.1-_SGN-E550127- (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | ||| || || | ||||| ||||| ||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTCCT TT-TCTTTTT CTTATCAAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550127- (23844 23490,23414 23387) ******************************************************************************** EST sequence 16 -strand 673 n (File: SGN-E550140-) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTACTCN 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATGTTATCAA CCATGAATTA ACAAAAAATT AGACCAAAAA 661 TATAAAAAAT TAC Predicted gene structure (within gDNA segment 24759 to 19258): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.892 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E550140- 0.892 383 0.569 C PGS_C01HBa0088L02.1-_SGN-E550140- (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| |||||||| TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTACT 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| CNAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550140- (23844 23490,23414 23387) ******************************************************************************** EST sequence 23 -strand 681 n (File: SGN-E389553-) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCGTTCC TACTTAAATA TTATTATTAT TTTACGATTT 601 ATAACACTAT TAGAAACAAA GATTTTCTCA ACCATGAATT AATGAAAAAA TTATGGAATA 661 AAATATAAAA AATTACTCAT T Predicted gene structure (within gDNA segment 24759 to 19178): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E389553- 0.897 383 0.562 C PGS_C01HBa0088L02.1-_SGN-E389553- (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E389553- (23844 23490,23414 23387) ******************************************************************************** EST sequence 131 +strand 729 n (File: SGN-E550212+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAAAACTCG 721 GGGGGGGGC Predicted gene structure (within gDNA segment 24749 to 18688): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 716 MATCH C01HBa0088L02.1- SGN-E550212+ 0.897 383 0.525 C PGS_C01HBa0088L02.1-_SGN-E550212+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550212+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 133 +strand 710 n (File: SGN-E550065+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATGA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTGATTCAT AAGAAAAAAA Predicted gene structure (within gDNA segment 24749 to 18878): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E550065+ 0.897 383 0.539 C PGS_C01HBa0088L02.1-_SGN-E550065+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550065+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 137 +strand 732 n (File: SGN-E550201+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCNA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAAAAAACT 721 CGAGGGGGGG CC Predicted gene structure (within gDNA segment 24749 to 18658): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 718 MATCH C01HBa0088L02.1- SGN-E550201+ 0.897 383 0.523 C PGS_C01HBa0088L02.1-_SGN-E550201+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550201+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 139 +strand 709 n (File: SGN-E550207+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTNCA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAA Predicted gene structure (within gDNA segment 24749 to 18888): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 709 MATCH C01HBa0088L02.1- SGN-E550207+ 0.897 383 0.540 C PGS_C01HBa0088L02.1-_SGN-E550207+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550207+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 151 +strand 714 n (File: SGN-E390013+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACNAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAA Predicted gene structure (within gDNA segment 24749 to 18838): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 714 MATCH C01HBa0088L02.1- SGN-E390013+ 0.897 383 0.536 C PGS_C01HBa0088L02.1-_SGN-E390013+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E390013+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 153 +strand 720 n (File: SGN-E389834+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTA CGTCGACTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAGAACGAC 541 TAAACAGGAC GTTACATTTA TGATCGTCCT ACTTAAATAT CATTATTATT TTACGATTTA 601 TAACACTATT AGAAACGAAG ATTTTCTCGA CCATGAATTA ATGAAAAAAT ATGCCATGAA 661 ATATAAAAAT TTACTCGTTC TTCATTGAGC TATTCGTGAA AAAAAAAAAA AAATCGAGGG Predicted gene structure (within gDNA segment 24749 to 18778): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 714 MATCH C01HBa0088L02.1- SGN-E389834+ 0.897 383 0.532 C PGS_C01HBa0088L02.1-_SGN-E389834+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E389834+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 157 +strand 717 n (File: SGN-E550484+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAAAAA Predicted gene structure (within gDNA segment 24749 to 18808): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 717 MATCH C01HBa0088L02.1- SGN-E550484+ 0.897 383 0.534 C PGS_C01HBa0088L02.1-_SGN-E550484+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550484+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 159 +strand 713 n (File: SGN-E550211+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT ATGCCATAAA 661 ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA AAA Predicted gene structure (within gDNA segment 25305 to 18838): Exon 1 23844 23490 ( 355 n); cDNA 2 352 ( 351 n); score: 0.894 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 353 379 ( 27 n); score: 0.857 PPA cDNA 698 713 MATCH C01HBa0088L02.1- SGN-E550211+ 0.894 383 0.537 C PGS_C01HBa0088L02.1-_SGN-E550211+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| ||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAA- CCCTCCTTCT 58 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 117 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 177 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 237 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 297 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 352 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 352 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 379 hqPGS_C01HBa0088L02.1-_SGN-E550211+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 161 +strand 713 n (File: SGN-E550464+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GNTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCTA CCATGAATTA ATGAAAAATT ATGCCATAAG 661 ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA AAA Predicted gene structure (within gDNA segment 24749 to 18848): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 698 713 MATCH C01HBa0088L02.1- SGN-E550464+ 0.897 383 0.537 C PGS_C01HBa0088L02.1-_SGN-E550464+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550464+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 163 +strand 713 n (File: SGN-E549941+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA TATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCGA CCNATGATTA ATGAAAAATT ATGCCATCAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAA Predicted gene structure (within gDNA segment 24749 to 18848): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 713 MATCH C01HBa0088L02.1- SGN-E549941+ 0.897 383 0.537 C PGS_C01HBa0088L02.1-_SGN-E549941+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E549941+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 165 +strand 714 n (File: SGN-E550025+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATATAAAAA ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA AAAA Predicted gene structure (within gDNA segment 24749 to 18838): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 699 714 MATCH C01HBa0088L02.1- SGN-E550025+ 0.897 383 0.536 C PGS_C01HBa0088L02.1-_SGN-E550025+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E550025+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 210 +strand 711 n (File: SGN-E396039+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AAAAACAAAG ATTTTCTCCA CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AAATAAAAAA AATTTACTCA TTTTTTCTTG GAGCTAATTC AAAAAAAAAA A Predicted gene structure (within gDNA segment 24749 to 18868): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 661 672 MATCH C01HBa0088L02.1- SGN-E396039+ 0.897 383 0.539 C PGS_C01HBa0088L02.1-_SGN-E396039+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E396039+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 212 +strand 618 n (File: SGN-E396054+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAA Predicted gene structure (within gDNA segment 24749 to 19798): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E396054+ 0.897 383 0.620 C PGS_C01HBa0088L02.1-_SGN-E396054+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E396054+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 214 +strand 711 n (File: SGN-E396056+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA 421 GAATTTCTAA GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG 481 TCGTGGGTTC CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC 541 TAAACAGGTC GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA 601 TAACACTATT AGAAACAAAA ATTTTCTCAC CCATGAATTA ATGAAAAAAT TATGCCATAA 661 AATAATAAAA ATTTACTCAT TTTTTCTTTG AGCTAATTCA TAAAAAAAAA A Predicted gene structure (within gDNA segment 24749 to 18868): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 354 380 ( 27 n); score: 0.857 PPA cDNA 700 711 MATCH C01HBa0088L02.1- SGN-E396056+ 0.897 383 0.539 C PGS_C01HBa0088L02.1-_SGN-E396056+ (23844 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACG 23387 || |||||| |||||||||| |||| || .......... .CCCGTGACG GTCCGTCGTG -CCATTCCG 380 hqPGS_C01HBa0088L02.1-_SGN-E396056+ (23844 23490,23414 23387) ******************************************************************************** EST sequence 171 +strand 558 n (File: SGN-E231589+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA TAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTT Predicted gene structure (within gDNA segment 24739 to 20388): Exon 1 23839 23490 ( 350 n); cDNA 5 352 ( 348 n); score: 0.901 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.81), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 353 379 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E231589+ 0.901 378 0.677 C PGS_C01HBa0088L02.1-_SGN-E231589+ (23839 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 23780 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 23720 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 23660 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 23600 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 23540 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC GGTCCGTCCT GCCATTTCGT 23481 || ||||| | ||| | |||| |||||| ||| ||||||||| |||||||| | AAGGTTCATA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC G......... 352 TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG ATTTTCTAAG TGTTTTGAAA 23421 .......... .......... .......... .......... .......... .......... 352 CGAGACCCTG TGACGGTCCG TCGTGCCCAT GACG 23387 || | |||||||||| ||||| |||| || ......CCCG TGACGGTCCG TCGTG-CCAT TCCG 379 hqPGS_C01HBa0088L02.1-_SGN-E231589+ (23839 23490,23414 23387) ******************************************************************************** EST sequence 198 +strand 649 n (File: SGN-E374999+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CCAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTTCAC CCTGAATTAA TGAAAAAAT Predicted gene structure (within gDNA segment 24739 to 19478): Exon 1 23839 23490 ( 350 n); cDNA 5 352 ( 348 n); score: 0.904 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 353 379 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E374999+ 0.904 378 0.582 C PGS_C01HBa0088L02.1-_SGN-E374999+ (23839 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 23780 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 23720 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 23660 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 23600 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 23540 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC GGTCCGTCCT GCCATTTCGT 23481 || ||||||| ||| | |||| |||||| ||| ||||||||| |||||||| | AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC G......... 352 TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG ATTTTCTAAG TGTTTTGAAA 23421 .......... .......... .......... .......... .......... .......... 352 CGAGACCCTG TGACGGTCCG TCGTGCCCAT GACG 23387 || | |||||||||| ||||| |||| || ......CCCG TGACGGTCCG TCGTG-CCAT TCCG 379 hqPGS_C01HBa0088L02.1-_SGN-E374999+ (23839 23490,23414 23387) ******************************************************************************** EST sequence 223 +strand 472 n (File: SGN-E236652+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GA Predicted gene structure (within gDNA segment 24739 to 21248): Exon 1 23839 23490 ( 350 n); cDNA 5 352 ( 348 n); score: 0.904 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 353 379 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E236652+ 0.904 378 0.801 C PGS_C01HBa0088L02.1-_SGN-E236652+ (23839 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 23780 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 23720 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 23660 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 23600 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 23540 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC GGTCCGTCCT GCCATTTCGT 23481 || ||||||| ||| | |||| |||||| ||| ||||||||| |||||||| | AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC G......... 352 TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG ATTTTCTAAG TGTTTTGAAA 23421 .......... .......... .......... .......... .......... .......... 352 CGAGACCCTG TGACGGTCCG TCGTGCCCAT GACG 23387 || | |||||||||| ||||| |||| || ......CCCG TGACGGTCCG TCGTG-CCAT TCCG 379 hqPGS_C01HBa0088L02.1-_SGN-E236652+ (23839 23490,23414 23387) ******************************************************************************** EST sequence 231 +strand 690 n (File: SGN-E377133+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT ATGCCATAAA 661 ATATAAAAAA TTTACTCATT TTTCATTGAG Predicted gene structure (within gDNA segment 24739 to 19068): Exon 1 23839 23490 ( 350 n); cDNA 5 352 ( 348 n); score: 0.904 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 353 379 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E377133+ 0.904 378 0.548 C PGS_C01HBa0088L02.1-_SGN-E377133+ (23839 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 23780 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 23720 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 23660 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 23600 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 23540 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC GGTCCGTCCT GCCATTTCGT 23481 || ||||||| ||| | |||| |||||| ||| ||||||||| |||||||| | AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC G......... 352 TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG ATTTTCTAAG TGTTTTGAAA 23421 .......... .......... .......... .......... .......... .......... 352 CGAGACCCTG TGACGGTCCG TCGTGCCCAT GACG 23387 || | |||||||||| ||||| |||| || ......CCCG TGACGGTCCG TCGTG-CCAT TCCG 379 hqPGS_C01HBa0088L02.1-_SGN-E377133+ (23839 23490,23414 23387) ******************************************************************************** EST sequence 264 +strand 545 n (File: SGN-E241959+) 1 TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACA Predicted gene structure (within gDNA segment 24739 to 20518): Exon 1 23839 23490 ( 350 n); cDNA 5 352 ( 348 n); score: 0.904 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 353 379 ( 27 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E241959+ 0.904 378 0.694 C PGS_C01HBa0088L02.1-_SGN-E241959+ (23839 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TTCTTTTTCT GTCTCTCTTT GTTCTTTCTA TTTTTCTTAT TCAAACCCTC TTTCTTTTAC 23780 |||| |||| ||||| | | ||||||| | |||||||||| |||||||||| ||||||||| TTCTCCTTCT CTCTCTTTCT GTTCTTT-TC TTTTTCTTAT TCAAACCCTC CTTCTTTTAC 63 CCTAATTAAC ATATAATCAA GTGTAAAAGA TGGCAATAAT AACCCACTAA TTAACTTAAG 23720 |||||||| | ||||||| || | ||||||| ||| |||||| |||||||||| || ||| ||| CCTAATTAGC ATATAATTAA GAATAAAAGA TGG-AATAAT AACCCACTAA TTTACTCAAG 122 GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT AACTTTATAA 23660 |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || |||||||||| GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT AACTTTATAA 182 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 23600 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 242 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 23540 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 302 AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC GGTCCGTCCT GCCATTTCGT 23481 || ||||||| ||| | |||| |||||| ||| ||||||||| |||||||| | AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC G......... 352 TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG ATTTTCTAAG TGTTTTGAAA 23421 .......... .......... .......... .......... .......... .......... 352 CGAGACCCTG TGACGGTCCG TCGTGCCCAT GACG 23387 || | |||||||||| ||||| |||| || ......CCCG TGACGGTCCG TCGTG-CCAT TCCG 379 hqPGS_C01HBa0088L02.1-_SGN-E241959+ (23839 23490,23414 23387) ******************************************************************************** EST sequence 135 +strand 726 n (File: SGN-E550322+) 1 TCGCACCAGA TCGATTCTCC TTCTCTCTCT TTCTGTTCTT TTCTTTTTCT TATTCAAACC 61 CTCCTTCTTT TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT 121 AATTTACTCA AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA 181 CTAACTTTAT AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC 241 CGACCCAGAC TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT 301 GCAGGTCGTC GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA 361 CGCCCGTGAC GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC 421 CCAATTTCAG AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT 481 GACGGTCCGT CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT 541 CAAAACGACT AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT 601 TACGATTTAT AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT 661 ATGCCATAAA ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA 721 AAAAAC Predicted gene structure (within gDNA segment 24839 to 18808): Exon 1 23833 23490 ( 344 n); cDNA 21 362 ( 342 n); score: 0.908 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 363 389 ( 27 n); score: 0.857 PPA cDNA 708 725 MATCH C01HBa0088L02.1- SGN-E550322+ 0.908 372 0.512 C PGS_C01HBa0088L02.1-_SGN-E550322+ (23833 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TTCTGTCTCT CTTTGTTCTT TCTATTTTTC TTATTCAAAC CCTCTTTCTT TTACCCTAAT 23774 |||| ||||| | ||||||| | | |||||| |||||||||| |||| ||||| |||||||||| TTCTCTCTCT TTCTGTTCTT T-TCTTTTTC TTATTCAAAC CCTCCTTCTT TTACCCTAAT 79 TAACATATAA TCAAGTGTAA AAGATGGCAA TAATAACCCA CTAATTAACT TAAGGTTACC 23714 || ||||||| | ||| ||| ||||||| || |||||||||| |||||| ||| ||||||||| TAGCATATAA TTAAGAATAA AAGATGG-AA TAATAACCCA CTAATTTACT CAAGGTTACC 138 TCTTTTAACC CCCAAGTAAT TAGACTTATT AACATTAACC CCCTAACTTT ATAATTTAAG 23654 |||||||||| |||| ||||| |||||||||| ||||| |||| | |||||||| |||||| ||| TCTTTTAACC CCCAGGTAAT TAGACTTATT AACATAAACC CACTAACTTT ATAATTAAAG 198 CAGGAATAGT CAAAAACGTC CCTTAAAACG TATAAAGAAA TCCGACCCGG ACTGGGATTG 23594 ||||||||| | |||||||| |||||||||| | |||||||| |||||||| | ||||||||| TAGGAATAGT CCAAAACGTC CCTTAAAACG TGTAAAGAAA TCCGACCCAG ACTGGGATTA 258 CGCAACCTGT GATGGGCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAAGTT 23534 |||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| |||||| ||| CGCAACCTGT GATGGCCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAGGTT 318 CAGAGACCCA AATTTCCACC -AAGGGTCTG TGACGGTCCG TCCTGCCATT TCGTTACGAA 23475 ||||||| | |||||||||| ||| ||||| |||||||||| || | CAGAGACTC- AATTTCCACC AAAGAGTCTG TGACGGTCCG TCACG..... .......... 362 GTTCAGAGAG TCGATTTCAG CACCCAATTT TTAGATTTTC TAAGTGTTTT GAAACGAGAC 23415 .......... .......... .......... .......... .......... .......... 362 CCTGTGACGG TCCGTCGTGC CCATGACG 23387 || ||||||| ||||||||| |||| || CCCGTGACGG TCCGTCGTG- CCATTCCG 389 hqPGS_C01HBa0088L02.1-_SGN-E550322+ (23833 23490,23414 23387) ******************************************************************************** EST sequence 57 -strand 674 n (File: SGN-E396057-) 1 TTTTTTATTC AAACCTTCTT TTTTTTACCC TAATTAGCAT ATAATTAAGA ATAAAAGATG 61 GAATAATAAC CCACTAATTT ACTCAAGGTT ACCTCTTTTA ACCCCCAGGT AATTAGACTT 121 ATTAACATAA ACCCACTAAC TTTATAATTA AAGTAGGAAT AGTCCAAAAC GTCCCTTAAA 181 ACGTGTAAAG AAATCCGACC CAGACTGGGA TTACGCAACC TGTGATGGCC CGTCGTGCCT 241 GCGACGGTCC GTCCTGCAGG TCGTCGCAAG GTTCAGAGAC TCAATTTCCA CCAAAGAGTC 301 TGTGACGGTC CGTCACGCCC GTGACGGTCC GTCGTGCCAT TCCGTTACGA AGTTCAGAGA 361 GTCGATTTTT AGTACCCAAT TTCAGAATTT TTAAGTGTTT TGAAACGAGA CTCCTCGACG 421 GTCCATCGTG CTCATGACGG TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA 481 ATAAAATCTG CTACTCAAAA CGACTAAACA GGTCGTTACA TTTATGTTCT TCCTACTTAA 541 ATATTATTAT TATTTTACGA TTTATAACAC TATTAGAAAC AAAGATTTTC TCAACCATGA 601 ATTAATGAAA AAATTATGCC ATAAAATATA AAAAATTTAC TCATTTTTCA TTGAGCTAAT 661 TCATAAAAAA AAAA Predicted gene structure (within gDNA segment 24965 to 18888): Exon 1 23807 23490 ( 318 n); cDNA 1 317 ( 317 n); score: 0.910 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 318 344 ( 27 n); score: 0.857 PPA cDNA 663 674 MATCH C01HBa0088L02.1- SGN-E396057- 0.910 346 0.513 C PGS_C01HBa0088L02.1-_SGN-E396057- (23807 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TTTCTTATTC AAACCCTCTT TCTTTTACCC TAATTAACAT ATAATCAAGT GTAAAAGATG 23748 ||| |||||| ||||| |||| | |||||||| |||||| ||| ||||| ||| ||||||||| TTTTTTATTC AAACCTTCTT TTTTTTACCC TAATTAGCAT ATAATTAAGA ATAAAAGATG 60 GCAATAATAA CCCACTAATT AACTTAAGGT TACCTCTTTT AACCCCCAAG TAATTAGACT 23688 | |||||||| |||||||||| ||| ||||| |||||||||| |||||||| | |||||||||| G-AATAATAA CCCACTAATT TACTCAAGGT TACCTCTTTT AACCCCCAGG TAATTAGACT 119 TATTAACATT AACCCCCTAA CTTTATAATT TAAGCAGGAA TAGTCAAAAA CGTCCCTTAA 23628 ||||||||| ||||| |||| |||||||||| ||| ||||| ||||| |||| |||||||||| TATTAACATA AACCCACTAA CTTTATAATT AAAGTAGGAA TAGTCCAAAA CGTCCCTTAA 179 AACGTATAAA GAAATCCGAC CCGGACTGGG ATTGCGCAAC CTGTGATGGG CCGTCGTGCC 23568 ||||| |||| |||||||||| || ||||||| ||| |||||| ||||||||| |||||||||| AACGTGTAAA GAAATCCGAC CCAGACTGGG ATTACGCAAC CTGTGATGGC CCGTCGTGCC 239 TGCGACGGTC CGTCCTGCAG GTCGTCGCAA AGTTCAGAGA CCCAAATTTC CACC-AAGGG 23509 |||||||||| |||||||||| |||||||||| ||||||||| | | |||||| |||| ||| | TGCGACGGTC CGTCCTGCAG GTCGTCGCAA GGTTCAGAGA CTC-AATTTC CACCAAAGAG 298 TCTGTGACGG TCCGTCCTGC CATTTCGTTA CGAAGTTCAG AGAGTCGATT TCAGCACCCA 23449 |||||||||| |||||| | TCTGTGACGG TCCGTCACG. .......... .......... .......... .......... 317 ATTTTTAGAT TTTCTAAGTG TTTTGAAACG AGACCCTGTG ACGGTCCGTC GTGCCCATGA 23389 || ||| |||||||||| ||| |||| .......... .......... .......... ....CCCGTG ACGGTCCGTC GTG-CCATTC 342 CG 23387 || CG 344 hqPGS_C01HBa0088L02.1-_SGN-E396057- (23807 23490,23414 23387) ******************************************************************************** EST sequence 66 -strand 658 n (File: SGN-E377132-) 1 TTCCTTCTTT TACCCTAATT AGCATATATT TAAGAATAAA AGATGGAATA ATAACCCACT 61 AATTTACTCA AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA 121 CTAACTTTAT AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC 181 CGACCCAGAC TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT 241 GCAGGTCGTC GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAGTCTGTGA CGGTCCGTCA 301 CGCCCGTGAC GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC 361 CCAATTTCAG AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT 421 GACGGTCCGT CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT 481 CAAAACGACT AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT 541 TACGATTTAT AACACTATTA GAAACAAAGA TTTTCTCAAC CATGAATTAA TGAAAAAATT 601 ATGCCATAAA ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAA Predicted gene structure (within gDNA segment 24815 to 18898): Exon 1 23791 23490 ( 302 n); cDNA 2 302 ( 301 n); score: 0.909 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 303 329 ( 27 n); score: 0.857 PPA cDNA 648 658 MATCH C01HBa0088L02.1- SGN-E377132- 0.909 330 0.502 C PGS_C01HBa0088L02.1-_SGN-E377132- (23791 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TCTTTCTTTT ACCCTAATTA ACATATAATC AAGTGTAAAA GATGGCAATA ATAACCCACT 23732 || ||||||| |||||||||| |||||| | ||| ||||| ||||| |||| |||||||||| TCCTTCTTTT ACCCTAATTA GCATATATTT AAGAATAAAA GATGG-AATA ATAACCCACT 60 AATTAACTTA AGGTTACCTC TTTTAACCCC CAAGTAATTA GACTTATTAA CATTAACCCC 23672 |||| ||| | |||||||||| |||||||||| || ||||||| |||||||||| ||| ||||| AATTTACTCA AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA 120 CTAACTTTAT AATTTAAGCA GGAATAGTCA AAAACGTCCC TTAAAACGTA TAAAGAAATC 23612 |||||||||| |||| ||| | ||||||||| |||||||||| ||||||||| |||||||||| CTAACTTTAT AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC 180 CGACCCGGAC TGGGATTGCG CAACCTGTGA TGGGCCGTCG TGCCTGCGAC GGTCCGTCCT 23552 |||||| ||| ||||||| || |||||||||| ||| |||||| |||||||||| |||||||||| CGACCCAGAC TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT 240 GCAGGTCGTC GCAAAGTTCA GAGACCCAAA TTTCCACC-A AGGGTCTGTG ACGGTCCGTC 23493 |||||||||| |||| ||||| ||||| | || |||||||| | || ||||||| |||||||||| GCAGGTCGTC GCAAGGTTCA GAGACTC-AA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC 299 CTGCCATTTC GTTACGAAGT TCAGAGAGTC GATTTCAGCA CCCAATTTTT AGATTTTCTA 23433 | ACG....... .......... .......... .......... .......... .......... 302 AGTGTTTTGA AACGAGACCC TGTGACGGTC CGTCGTGCCC ATGACG 23387 || ||||||||| ||||||| || || || .......... ........CC CGTGACGGTC CGTCGTG-CC ATTCCG 329 hqPGS_C01HBa0088L02.1-_SGN-E377132- (23791 23490,23414 23387) ******************************************************************************** EST sequence 55 -strand 647 n (File: SGN-E396055-) 1 ATTAGCATAT AATTAAGAAT AAAAAGATGG AAATAATAAC CCACTAATTT ACTCAAGGGT 61 TCCTTTTTTT AACCCCCAGG GTAATTAGAC TTATTAACAT AAACCCCACT AACTTTATAA 121 TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 181 GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 241 AAGGTTCAGA GACTCAATTT CCACCAAAGA GTCTGTGACG GTCCGTCACG CCCGTGACGG 301 TCCGTCGTGC CATTCCGTTA CGAAGTTCAG AGAGTCGATT TTTAGTACCC AATTTCAGAA 361 TTTCTAAGTG TTTTGAAACG AGACTCCTCG ACGGTCCATC GTGCTCATGA CGGTCCGTCG 421 TGGGTTCCGT CGTCTCAACC TGTTTTTCCA AAAATAAAAT CTGCTACTCA AAACGACTAA 481 ACAGGTCGTT ACATTTATGT TCTTCCTACT TAAATATTAT TATTATTTTA CGATTTATAA 541 CACTATTAGA AACAAAGATT TTCTCAACCA TGAATTAATG AAAAAATTAT GCCATAAAAT 601 ATAAAAAATT TACTCATTTT TCATTGAGCT AATTCATAAA AAAAAAA Predicted gene structure (within gDNA segment 25631 to 18888): Exon 1 23775 23490 ( 286 n); cDNA 1 290 ( 290 n); score: 0.869 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 291 317 ( 27 n); score: 0.857 PPA cDNA 636 647 MATCH C01HBa0088L02.1- SGN-E396055- 0.869 314 0.485 C PGS_C01HBa0088L02.1-_SGN-E396055- (23775 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): ATTAACATAT AATCAAGTGT -AAAAGATGG CAATAATAAC CCACTAATTA ACTTAA-GGT 23718 |||| ||||| ||| ||| | ||||||||| ||||||||| ||||||||| ||| || ||| ATTAGCATAT AATTAAGAAT AAAAAGATGG AAATAATAAC CCACTAATTT ACTCAAGGGT 60 TACCTCTTTT AACCCCCA-A GTAATTAGAC TTATTAACAT TAACCCC-CT AACTTTATAA 23660 | | | |||| |||||||| |||||||||| |||||||||| |||||| || |||||||||| TCCTTTTTTT AACCCCCAGG GTAATTAGAC TTATTAACAT AAACCCCACT AACTTTATAA 120 TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG ACCCGGACTG 23600 || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| |||| ||||| TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG ACCCAGACTG 180 GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 23540 ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| |||||||||| GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC AGGTCGTCGC 240 AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC GGTCCGTCCT GCCATTTCGT 23481 || ||||||| ||| | |||| |||||| ||| ||||||||| |||||||| | AAGGTTCAGA GACTC-AATT TCCACCAAAG AGTCTGTGAC GGTCCGTCAC G......... 290 TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG ATTTTCTAAG TGTTTTGAAA 23421 .......... .......... .......... .......... .......... .......... 290 CGAGACCCTG TGACGGTCCG TCGTGCCCAT GACG 23387 || | |||||||||| ||||| |||| || ......CCCG TGACGGTCCG TCGTG-CCAT TCCG 317 hqPGS_C01HBa0088L02.1-_SGN-E396055- (23775 23490,23414 23387) ******************************************************************************** EST sequence 53 -strand 640 n (File: SGN-E398551-) 1 TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAA TAATTTACTC AAGGTTACCT 61 CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA TAATTAAAGT 121 AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA CTGGGATTAC 181 GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT CGCAAGGTTC 241 AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA CGGTCCGTCG 301 TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA GAATTTCTAA 361 GTGTTTTGAA ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG TCGTGGGTTC 421 CGTCGTCTCA ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC TAAACAGGTC 481 GTTACATTTA TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA TAACACTATT 541 AGAAACAAAG ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA AATATAAAAA 601 ATTTACTCAT TTTTCATTGA GCTAATTCAT AAAAAAAAAA Predicted gene structure (within gDNA segment 24832 to 18888): Exon 1 23773 23490 ( 284 n); cDNA 1 283 ( 283 n); score: 0.907 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 284 310 ( 27 n); score: 0.857 PPA cDNA 629 640 MATCH C01HBa0088L02.1- SGN-E398551- 0.907 312 0.488 C PGS_C01HBa0088L02.1-_SGN-E398551- (23773 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): TAACATATAA TCAAGTGTAA AAGATGGCAA TAATAACCCA CTAATTAACT TAAGGTTACC 23714 || ||||||| | ||| ||| ||||||| || |||||||||| ||||| ||| ||||||||| TAGCATATAA TTAAGAATAA AAGATGG-AA TAATAACCCA ATAATTTACT CAAGGTTACC 59 TCTTTTAACC CCCAAGTAAT TAGACTTATT AACATTAACC CCCTAACTTT ATAATTTAAG 23654 |||||||||| |||| ||||| |||||||||| ||||| |||| | |||||||| |||||| ||| TCTTTTAACC CCCAGGTAAT TAGACTTATT AACATAAACC CACTAACTTT ATAATTAAAG 119 CAGGAATAGT CAAAAACGTC CCTTAAAACG TATAAAGAAA TCCGACCCGG ACTGGGATTG 23594 ||||||||| | |||||||| |||||||||| | |||||||| |||||||| | ||||||||| TAGGAATAGT CCAAAACGTC CCTTAAAACG TGTAAAGAAA TCCGACCCAG ACTGGGATTA 179 CGCAACCTGT GATGGGCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAAGTT 23534 |||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| |||||| ||| CGCAACCTGT GATGGCCCGT CGTGCCTGCG ACGGTCCGTC CTGCAGGTCG TCGCAAGGTT 239 CAGAGACCCA AATTTCCACC -AAGGGTCTG TGACGGTCCG TCCTGCCATT TCGTTACGAA 23475 ||||||| | |||||||||| ||| ||||| |||||||||| || | CAGAGACTC- AATTTCCACC AAAGAGTCTG TGACGGTCCG TCACG..... .......... 283 GTTCAGAGAG TCGATTTCAG CACCCAATTT TTAGATTTTC TAAGTGTTTT GAAACGAGAC 23415 .......... .......... .......... .......... .......... .......... 283 CCTGTGACGG TCCGTCGTGC CCATGACG 23387 || ||||||| ||||||||| |||| || CCCGTGACGG TCCGTCGTG- CCATTCCG 310 hqPGS_C01HBa0088L02.1-_SGN-E398551- (23773 23490,23414 23387) ******************************************************************************** EST sequence 51 -strand 630 n (File: SGN-E396038-) 1 TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC AAGGTTACCT CTTTTAACCC 61 CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA TAATTAAAGT AGGAATAGTC 121 CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA CTGGGATTAC GCAACCTGTG 181 ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT CGCAAGGTTC AGAGACTCAA 241 TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA CGGTCCGTCG TGCCATTCCG 301 TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCCAATTTCA GAATTTCTAA GTGTTTTGAA 361 ACGAGACTCC TCGACGGTCC ATCGTGCTCA TGACGGTCCG TCGTGGGTTC CGTCGTCTCA 421 ACCTGTTTTT CCAAAAATAA AATCTGCTAC TCAAAACGAC TAAACAGGTC GTTACATTTA 481 TGTTCTTCCT ACTTAAATAT TATTATTATT TTACGATTTA TAACACTATT AGAAACAAAG 541 ATTTTCTCAA CCATGAATTA ATGAAAAAAT TATGCCATAA AATATAAAAA ATTTACTCAT 601 TTTTCATAGA GTTAAATAAT AAAAAAAAAA Predicted gene structure (within gDNA segment 24525 to 18888): Exon 1 23761 23490 ( 272 n); cDNA 3 273 ( 271 n); score: 0.914 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 274 300 ( 27 n); score: 0.857 PPA cDNA 621 630 MATCH C01HBa0088L02.1- SGN-E396038- 0.914 300 0.476 C PGS_C01HBa0088L02.1-_SGN-E396038- (23761 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): AAGTGTAAAA GATGGCAATA ATAACCCACT AATTAACTTA AGGTTACCTC TTTTAACCCC 23702 ||| ||||| ||||| |||| |||||||||| |||| ||| | |||||||||| |||||||||| AAGAATAAAA GATGG-AATA ATAACCCACT AATTTACTCA AGGTTACCTC TTTTAACCCC 61 CAAGTAATTA GACTTATTAA CATTAACCCC CTAACTTTAT AATTTAAGCA GGAATAGTCA 23642 || ||||||| |||||||||| ||| ||||| |||||||||| |||| ||| | ||||||||| CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT AATTAAAGTA GGAATAGTCC 121 AAAACGTCCC TTAAAACGTA TAAAGAAATC CGACCCGGAC TGGGATTGCG CAACCTGTGA 23582 |||||||||| ||||||||| |||||||||| |||||| ||| ||||||| || |||||||||| AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC TGGGATTACG CAACCTGTGA 181 TGGGCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC GCAAAGTTCA GAGACCCAAA 23522 ||| |||||| |||||||||| |||||||||| |||||||||| |||| ||||| ||||| | || TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC GCAAGGTTCA GAGACTC-AA 240 TTTCCACC-A AGGGTCTGTG ACGGTCCGTC CTGCCATTTC GTTACGAAGT TCAGAGAGTC 23463 |||||||| | || ||||||| |||||||||| | TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACG....... .......... .......... 273 GATTTCAGCA CCCAATTTTT AGATTTTCTA AGTGTTTTGA AACGAGACCC TGTGACGGTC 23403 || ||||||||| .......... .......... .......... .......... ........CC CGTGACGGTC 285 CGTCGTGCCC ATGACG 23387 ||||||| || || || CGTCGTG-CC ATTCCG 300 hqPGS_C01HBa0088L02.1-_SGN-E396038- (23761 23490,23414 23387) ******************************************************************************** EST sequence 59 -strand 525 n (File: SGN-E396069-) 1 AAAGTAGGAA TAGTCCAAAA CGTCCCTTAA AACGTGTAAA GAAATCCGAC CCCCACCGGG 61 ATTACGCAAC CTGTGATGGC CCGTCGTGCC TGCGACGGTC CGTCCTGCAG GTCGTCGCAA 121 GGTTCAGAGA CTCAATTTCC ACCAAAGAGT CTGTGACGGT CCGTCACGCC CGTGACGGTC 181 CGTCGTGCCA TTCCGTTACG AAGTTCAGAG AGTCGATTTT TAGTACCCAA TTTCAGAATT 241 TCTAAGTGTT TTGAAACGAG ACTCCTCGAC GGTCCATCGT GCTCATGACG GTCCGTCGTG 301 GGTTCCGTCG TCTCAACCTG TTTTTCCAAA AATAAAATCT GCTACTCAAA ACGACTAAAC 361 AGGTCGTTAC ATTTATGTTC TTCCTACTTA AATATTATTA TTATTTTACG ATTTATAACA 421 CTATTAGAAA CAAAGATTTT CTCAACCATG AATTAATGAA AAAATTATGC CATAAAATAT 481 AAAAAATTTA CTCATTTTTC ATTGAGCTAA TTCATAAAAA AAAAA Predicted gene structure (within gDNA segment 24411 to 18888): Exon 1 23656 23490 ( 167 n); cDNA 2 168 ( 167 n); score: 0.901 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23387 ( 28 n); cDNA 169 195 ( 27 n); score: 0.857 PPA cDNA 514 525 MATCH C01HBa0088L02.1- SGN-E396069- 0.901 195 0.371 C PGS_C01HBa0088L02.1-_SGN-E396069- (23656 23490,23414 23387) Alignment (genomic DNA sequence = upper lines): AAGCAGGAAT AGTCAAAAAC GTCCCTTAAA ACGTATAAAG AAATCCGACC CGGACTGGGA 23597 ||| |||||| |||| ||||| |||||||||| |||| ||||| |||||||||| | || |||| AAGTAGGAAT AGTCCAAAAC GTCCCTTAAA ACGTGTAAAG AAATCCGACC CCCACCGGGA 61 TTGCGCAACC TGTGATGGGC CGTCGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAA 23537 || ||||||| |||||||| | |||||||||| |||||||||| |||||||||| ||||||||| TTACGCAACC TGTGATGGCC CGTCGTGCCT GCGACGGTCC GTCCTGCAGG TCGTCGCAAG 121 GTTCAGAGAC CCAAATTTCC ACC-AAGGGT CTGTGACGGT CCGTCCTGCC ATTTCGTTAC 23478 |||||||||| | ||||||| ||| ||| || |||||||||| ||||| | GTTCAGAGAC TC-AATTTCC ACCAAAGAGT CTGTGACGGT CCGTCACG.. .......... 168 GAAGTTCAGA GAGTCGATTT CAGCACCCAA TTTTTAGATT TTCTAAGTGT TTTGAAACGA 23418 .......... .......... .......... .......... .......... .......... 168 GACCCTGTGA CGGTCCGTCG TGCCCATGAC G 23387 || |||| |||||||||| || |||| | | ...CCCGTGA CGGTCCGTCG TG-CCATTCC G 195 hqPGS_C01HBa0088L02.1-_SGN-E396069- (23656 23490,23414 23387) ******************************************************************************** EST sequence 218 +strand 454 n (File: SGN-E396070+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAAAC CCTCCTTCTT 61 TTACCCTAAT TAGCATATAA TTAAGAATAA AAGATGGAAT AATAACCCAC TAATTTACTC 121 AAGGTTACCT CTTTTAACCC CCAGGTAATT AGACTTATTA ACATAAACCC ACTAACTTTA 181 TAATTAAAGT AGGAATAGTC CAAAACGTCC CTTAAAACGT GTAAAGAAAT CCGACCCAGA 241 CTGGGATTAC GCAACCTGTG ATGGCCCGTC GTGCCTGCGA CGGTCCGTCC TGCAGGTCGT 301 CGCAAGGTTC AGAGACTCAA TTTCCACCAA AGAGTCTGTG ACGGTCCGTC ACGCCCGTGA 361 CGGTCCGTCG TGCCATTCCG TTACGAAGTT CAGAGAGTCG ATTTTTAGTA CCGGGGGGGG 421 GAGTTTCTAA TTGTTTTGAA ACTAGACTCC TCGA Predicted gene structure (within gDNA segment 24749 to 21438): Exon 1 23844 23490 ( 355 n); cDNA 2 353 ( 352 n); score: 0.897 Intron 1 23489 23415 ( 75 n); Pd: 0.000 (s: 0.83), Pa: 0.000 (s: 0) Exon 2 23414 23394 ( 21 n); cDNA 354 374 ( 21 n); score: 0.952 MATCH C01HBa0088L02.1- SGN-E396070+ 0.897 376 0.828 C PGS_C01HBa0088L02.1-_SGN-E396070+ (23844 23490,23414 23394) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| |||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAAA CCCTCCTTCT 59 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 118 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 178 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 238 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 298 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C-AAGGGTCT GTGACGGTCC GTCCTGCCAT 23486 ||||||| || |||||||| | ||||||||| | ||| |||| |||||||||| ||| | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAGTCT GTGACGGTCC GTCACG.... 353 TTCGTTACGA AGTTCAGAGA GTCGATTTCA GCACCCAATT TTTAGATTTT CTAAGTGTTT 23426 .......... .......... .......... .......... .......... .......... 353 TGAAACGAGA CCCTGTGACG GTCCGTCGTG CC 23394 || |||||| |||||||||| || .......... .CCCGTGACG GTCCGTCGTG CC 374 hqPGS_C01HBa0088L02.1-_SGN-E396070+ (23844 23490,23414 23394) ******************************************************************************** EST sequence 31 -strand 542 n (File: SGN-E252199-) 1 CGACCCAGCC TGGGATTACG CAGTCTGTGA CGGTCCGTCC TGCACGTCCG TCACAGAGTT 61 CAGAGACTAG ATTTTTACCA AGGGTCTGTG ACGGCCCATC ACGCCTGTGA CGGTCCGTCC 121 TGCCATTCCG TCACGAAGTT CAGAGAGTCG ATTTCAGTAC CCAAATTTCA GAATTCTAAG 181 TGTTTTGGAA CGAGACCCCC TCGACGGTCC GTCGTGGGAT CCGTCGTCTC AGTCAGTTTT 241 TCCAGAAATA AAATCTGTTA CTCAAAACGA CTAAACAGGT CGTTACAATA GATACCAATT 301 TACCCATCGT TCGTCCCCGA ACGATCACAA GAAGAAAAAC AAGGGCGAAA AGGAGTACCT 361 GAATCTGTAA ACAGGTATGG GTATCTTTCT CGCATATCAA CTTCCTTCTC CCAAGTGGAT 421 TCTTCAACTG GTCGATTCTT CCATTGAACT TTGATAGATG CAATCTCCCT TGACCTCAAT 481 TTGCGGACTT CTCTATCTAA AATGGCAACA GGCTCCTCCT CATAAGACAA ATTCTCATCA 541 AG Predicted gene structure (within gDNA segment 25193 to 21842): Exon 1 23507 23063 ( 445 n); cDNA 105 542 ( 438 n); score: 0.900 MATCH C01HBa0088L02.1- SGN-E252199- 0.900 445 0.821 C PGS_C01HBa0088L02.1-_SGN-E252199- (23507 23063) Alignment (genomic DNA sequence = upper lines): CTGTGACGGT CCGTCCTGCC ATTTCGTTAC GAAGTTCAGA GAGTCGATTT CAGCACCCAA 23448 |||||||||| |||||||||| ||| ||| || |||||||||| |||||||||| ||| |||||| CTGTGACGGT CCGTCCTGCC ATTCCGTCAC GAAGTTCAGA GAGTCGATTT CAGTACCCAA 164 TTTTTAGATT TTCTAAGTGT TTTGAAACGA GACCCTGT-G ACGGTCCGTC GTGCCCATGA 23389 ||| ||| |||||||||| |||| ||||| ||||| | | |||||||||| ||| | ATTTCAGA-A TTCTAAGTGT TTTGGAACGA GACCCCCTCG ACGGTCCGTC GTG-----G- 217 CGGTCCGTCG CCTCAGCCTG TTTTTCCAGA AATAAAATCT GCTGCTCAAA ACGACTAAAC 23329 | ||||||| ||||| | | |||||||||| |||||||||| | | |||||| |||||||||| -GATCCGTCG TCTCAGTCAG TTTTTCCAGA AATAAAATCT GTTACTCAAA ACGACTAAAC 276 AGGTCGTTAC AATAGATACC AATTTACCCA TCGTTCGTCC CCGAACGATC ACCAGAAGGA 23269 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| || ||||| | AGGTCGTTAC AATAGATACC AATTTACCCA TCGTTCGTCC CCGAACGATC ACAAGAAGAA 336 AAACGAGGGC GAAAAGGAGT ACCTGAATCT GTAAACAGAT GTGGGTATCT TTCTCGCATA 23209 |||| ||||| |||||||||| |||||||||| |||||||| | ||||||||| |||||||||| AAACAAGGGC GAAAAGGAGT ACCTGAATCT GTAAACAGGT ATGGGTATCT TTCTCGCATA 396 TCTGCCTCCT TCTCCCAAGT GGCTTCTTCA ACGGGTCGAT TCTTCCATTG AACTTTGATG 23149 || | |||| |||||||||| || ||||||| || ||||||| |||||||||| ||||||||| TCAACTTCCT TCTCCCAAGT GGATTCTTCA ACTGGTCGAT TCTTCCATTG AACTTTGATA 456 GATGCAATCT CCCTTGATCT CAACTTGCGA ATTTCTCTAT CTAGAATGGC AACAGGCTCA 23089 |||||||||| ||||||| || ||| ||||| | |||||||| ||| |||||| ||||||||| GATGCAATCT CCCTTGACCT CAATTTGCGG ACTTCTCTAT CTAAAATGGC AACAGGCTCC 516 TCCTCATAAG TCAAATTTTC ATCAAG 23063 |||||||||| |||||| || |||||| TCCTCATAAG ACAAATTCTC ATCAAG 542 hqPGS_C01HBa0088L02.1-_SGN-E252199- (23507 23063) ******************************************************************************** EST sequence 141 +strand 715 n (File: SGN-E550335+) 1 ATCGATTCTC CTTCTCTCTC TTTCTGTTCT TTTCTTTTTC TTATTCAACC CTCCTTCTTT 61 TACCCTAATT AGCATATAAT TAAGAATAAA AGATGGAATA ATAACCCACT AATTTACTCA 121 AGGTTACCTC TTTTAACCCC CAGGTAATTA GACTTATTAA CATAAACCCA CTAACTTTAT 181 AATTAAAGTA GGAATAGTCC AAAACGTCCC TTAAAACGTG TAAAGAAATC CGACCCAGAC 241 TGGGATTACG CAACCTGTGA TGGCCCGTCG TGCCTGCGAC GGTCCGTCCT GCAGGTCGTC 301 GCAAGGTTCA GAGACTCAAT TTCCACCAAA GAATCTGTGA CGGTCCGTCA CGCCCGTGAC 361 GGTCCGTCGT GCCATTCCGT TACGAAGTTC AGAGAGTCGA TTTTTAGTAC CCAATTTCAG 421 AATTTCTAAG TGTTTTGAAA CGAGACTCCT CGACGGTCCA TCGTGCTCAT GACGGTCCGT 481 CGTGGGTTCC GTCGTCTCAA CCTGTTTTTC CAAAAATAAA ATCTGCTACT CAAAACGACT 541 AAACAGGTCG TTACATTTAT GTTCTTCCTA CTTAAATATT ATTATTATTT TACGATTTAT 601 AACACTATTA GAAACAAAGA TTTTCTCNAC CATGAATTAA TGAAAAAATT ATGCCATAAA 661 ATATAAAAAA TTTACTCATT TTTCATTGAG CTAATTCATA AAAAAAAAAA AAAAA Predicted gene structure (within gDNA segment 25305 to 18218): Exon 1 23844 23318 ( 527 n); cDNA 2 555 ( 554 n); score: 0.752 PPA cDNA 698 715 MATCH C01HBa0088L02.1- SGN-E550335+ 0.752 527 0.737 C PGS_C01HBa0088L02.1-_SGN-E550335+ (23844 23318) Alignment (genomic DNA sequence = upper lines): TCTCTTTCTT TTTCTGTCTC TCTTTGTTCT TTCTATTTTT CTTATTCAAA CCCTCTTTCT 23785 || || || |||| |||| | | |||||| || | ||||| ||||||||| ||||| |||| TCGATT-CTC CTTCTCTCTC TTTCTGTTCT TT-TCTTTTT CTTATTCAA- CCCTCCTTCT 58 TTTACCCTAA TTAACATATA ATCAAGTGTA AAAGATGGCA ATAATAACCC ACTAATTAAC 23725 |||||||||| ||| |||||| || ||| || |||||||| | |||||||||| ||||||| || TTTACCCTAA TTAGCATATA ATTAAGAATA AAAGATGG-A ATAATAACCC ACTAATTTAC 117 TTAAGGTTAC CTCTTTTAAC CCCCAAGTAA TTAGACTTAT TAACATTAAC CCCCTAACTT 23665 | |||||||| |||||||||| ||||| |||| |||||||||| |||||| ||| || ||||||| TCAAGGTTAC CTCTTTTAAC CCCCAGGTAA TTAGACTTAT TAACATAAAC CCACTAACTT 177 TATAATTTAA GCAGGAATAG TCAAAAACGT CCCTTAAAAC GTATAAAGAA ATCCGACCCG 23605 ||||||| || | |||||||| || ||||||| |||||||||| || ||||||| ||||||||| TATAATTAAA GTAGGAATAG TCCAAAACGT CCCTTAAAAC GTGTAAAGAA ATCCGACCCA 237 GACTGGGATT GCGCAACCTG TGATGGGCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 23545 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| GACTGGGATT ACGCAACCTG TGATGGCCCG TCGTGCCTGC GACGGTCCGT CCTGCAGGTC 297 GTCGCAAAGT TCAGAGACCC AAATTTCCAC C----AA--- --G--GGT-C -T-------G 23505 ||||||| || |||||||| | ||||||||| | || | ||| | | | GTCGCAAGGT TCAGAGACTC -AATTTCCAC CAAAGAATCT GTGACGGTCC GTCACGCCCG 356 TGACGGTCCG TCCTGCCATT TCGTTACGAA GTTCAGAGAG TCGA-TTTCA GCACCCAATT 23446 |||||||||| || ||||||| ||||||||| |||||||||| |||| ||| | | |||||| | TGACGGTCCG TCGTGCCATT CCGTTACGAA GTTCAGAGAG TCGATTTTTA GTACCCAA-T 415 TTTAGATTTT CTAAGTGTTT TGAAACGAGA CCCTGTGACG GTCCGTCGTG CCCATGACGG 23386 || ||| ||| |||||||||| |||||||||| | | |||| |||| ||||| | |||||||| TTCAGAATTT CTAAGTGTTT TGAAACGAGA CTCCTCGACG GTCCATCGTG CTCATGACGG 475 T-C--C---- G-T-CG-C-- CTCAGCCTGT TTTTCCAGAA ATAAAATCTG CTGCTCAAAA 23338 | | | | | || | |||| ||||| ||||||| || |||||||||| || ||||||| TCCGTCGTGG GTTCCGTCGT CTCAACCTGT TTTTCCAAAA ATAAAATCTG CTACTCAAAA 535 CGACTAAACA GGTCGTTACA 23318 |||||||||| |||||||||| CGACTAAACA GGTCGTTACA 555 hqPGS_C01HBa0088L02.1-_SGN-E550335+ (23844 23318) ******************************************************************************** EST sequence 81 -strand 548 n (File: SGN-E356257-) 1 GTTAACTAGA AAATTAAAGT GATAGAGTCA AATAATGTAA CGACCCGTTT AGTCGTTTTG 61 AGCAGCAGAC TTTATTTCTG GAAAAACTGG CAGAAGCGAC GGACCCCACG ACGGACCGTC 121 ATGGGCACGA CGGACCATCG CAGGGTCTCG TTTCAAAACC CTCTTTCTTT TACCCCAAAT 181 TAACATATAA TTAAGAATAA AAGATGGCAA TAATACCCCA CTAATTAACT TAGGGTTACC 241 TCTTTTAACC CCAAGAATTT GAGTTATTAA TATAAACCCA CGAAATCTAT AATTAAGGAA 301 AGAATAGTCC AAAAACGTCC CTTAAAACGT GTAAGGAAAT CCGATTCTGC CTGGGATTTG 361 CGCAACCTGT GACGGGCCGT CGTGACTGTG ACGGTCCGTC CTGCAGGTCG TCGCAAGGGT 421 CAGAGAGTCA ATTTCCACTG AACAATCTAT GACGGTCCGT CACGCCTGTG ATGGTCCGTC 481 CTGTCATTCC GTCACGAAGT TCAGAGAGTC GATTTTCAGT ACCCAATTTC AGATTTTCTA 541 AGTGTTTT Predicted gene structure (within gDNA segment 26336 to 22825): Exon 1 23797 23488 ( 310 n); cDNA 156 466 ( 311 n); score: 0.835 MATCH C01HBa0088L02.1- SGN-E356257- 0.835 310 0.566 C PGS_C01HBa0088L02.1-_SGN-E356257- (23797 23488) Alignment (genomic DNA sequence = upper lines): AAACCCTCTT TCTTTTAC-C CTAATTAACA TATAATCAAG TGTAAAAGAT GGCAATAATA 23739 |||||||||| |||||||| | | |||||||| |||||| ||| |||||||| |||||||||| AAACCCTCTT TCTTTTACCC CAAATTAACA TATAATTAAG AATAAAAGAT GGCAATAATA 215 ACCCACTAAT TAACTTAAGG TTACCTCTTT TAACCCCCAA GTAATTAGAC TTATTAACAT 23679 ||||||||| ||||||| || |||||||||| ||| |||||| | |||| || ||||||| || CCCCACTAAT TAACTTAGGG TTACCTCTTT TAA-CCCCAA G-AATTTGAG TTATTAATAT 273 TAACCCCCTA ACTTTATAAT TTAAGCAGGA ATAGT-CAAA AACGTCCCTT AAAACGTATA 23620 ||||| | | | | |||||| | | | | || ||||| |||| |||||||||| ||||||| || AAACCCACGA AATCTATAAT TAAGGAAAGA ATAGTCCAAA AACGTCCCTT AAAACGTGTA 333 AAGAAATCCG ACCCGGACTG GGA-TTGCGC AACCTGTGAT GGGCCGTCGT GCCTGCGACG 23561 | |||||||| | | | ||| ||| |||||| ||||||||| |||||||||| | ||| |||| AGGAAATCCG ATTCTGCCTG GGATTTGCGC AACCTGTGAC GGGCCGTCGT GACTGTGACG 393 GTCCGTCCTG CAGGTCGTCG CAAAGTTCAG AGACCCAAAT TTCCAC-CAA GGGTCTGTGA 23502 |||||||||| |||||||||| ||| | |||| ||| | ||| |||||| || ||| ||| GTCCGTCCTG CAGGTCGTCG CAAGGGTCAG AGAGTC-AAT TTCCACTGAA CAATCTATGA 452 CGGTCCGTCC TGCC 23488 ||||||||| ||| CGGTCCGTCA CGCC 466 hqPGS_C01HBa0088L02.1-_SGN-E356257- (23797 23488) ******************************************************************************** EST sequence 208 +strand 356 n (File: SGN-E396037+) 1 GGGCAGCGGA GCCTCATGTT TTGTTTACCA CTATGCCGCA TCTATATGAT TAACATGATG 61 ATGATGATGA TGACTACCAC GATTCACGAG AAGAAGATGA GGATGAATGG GGTATTGAGA 121 TGGATGTTTT ACTCGAGGTT ACCTCTTTTA ACCCCCAGGT AATTAGACTT ATTAACATAA 181 ACCCACTAAC TTTATAATTA AAGTAGGAAT AGTCCAAAAC GTCCCTTAAA ACGTGTAAAG 241 AAATCCGACC CAGACTGGGA TTACGCAACC TGTGATGGCC CGTCGTGCCT GCGACGGTCC 301 GTCCTGCAGG TCTTCTCTAG GTTCAGAGAC TCTCTTTCCA CCAAAGAGTC TGTGAC Predicted gene structure (within gDNA segment 25671 to 22495): Exon 1 23729 23501 ( 229 n); cDNA 128 356 ( 229 n); score: 0.893 MATCH C01HBa0088L02.1- SGN-E396037+ 0.893 229 0.643 C PGS_C01HBa0088L02.1-_SGN-E396037+ (23729 23501) Alignment (genomic DNA sequence = upper lines): TTAACTTAAG GTTACCTCTT TTAACCCCCA AGTAATTAGA CTTATTAACA TTAACCCCCT 23670 || ||| || |||||||||| |||||||||| ||||||||| |||||||||| | ||||| || TTTACTCGAG GTTACCTCTT TTAACCCCCA GGTAATTAGA CTTATTAACA TAAACCCACT 187 AACTTTATAA TTTAAGCAGG AATAGTCAAA AACGTCCCTT AAAACGTATA AAGAAATCCG 23610 |||||||||| || ||| ||| ||||||| || |||||||||| ||||||| || |||||||||| AACTTTATAA TTAAAGTAGG AATAGTCCAA AACGTCCCTT AAAACGTGTA AAGAAATCCG 247 ACCCGGACTG GGATTGCGCA ACCTGTGATG GGCCGTCGTG CCTGCGACGG TCCGTCCTGC 23550 |||| ||||| ||||| |||| |||||||||| | |||||||| |||||||||| |||||||||| ACCCAGACTG GGATTACGCA ACCTGTGATG GCCCGTCGTG CCTGCGACGG TCCGTCCTGC 307 AGGTCGTCGC AAAGTTCAGA GACCCAAATT TCCACC-AAG GGTCTGTGAC 23501 ||||| || | | ||||||| ||| | || |||||| ||| ||||||||| AGGTCTTCTC TAGGTTCAGA GACTC-TCTT TCCACCAAAG AGTCTGTGAC 356 hqPGS_C01HBa0088L02.1-_SGN-E396037+ (23729 23501) ******************************************************************************** EST sequence 187 +strand 686 n (File: SGN-E241789+) 1 ATGTCTGATC TTCAAGGACA TCAAGACATG AATGAGAGAG AATCCAGTCC GAGCTAGGAA 61 CAATAGCTCA CCCTGAAATC TGACGTGATG AAGACTGGTT AGAGTTGCGG TTGAGTTGAA 121 GACGACGGTA CGTTTGCTGC ACTCCACAAT TAACAAAAAG AAAACATAAA AGTAGGGGTC 181 AGTACAAACA CGAGTACTGA GTAGATATCA TCGGCCAACT CAGAATAGAG AACAATATAT 241 ATCAAATAAT AAAATAAAAT CAACCATAAC ACTTAACAGG TGACAACAAC AAGTACCATA 301 ACCATTGGGC ACAACCCAAG AACATCTATG AGGACTCAAG CCTCCACACC ATACTCATTT 361 GGGAAACAGG TTCATTAAAT TGAGTACATT AACATAATTC AAGATTCATT CTTTTTACTA 421 TCGTGGTGTC GGAACGTGAT ACTCCGATCC CCTAATGCTA CGTGTCGGTT CGTGACACCC 481 GATCCCCTAA TACTACGTGT CGGTTCGTTA CACCCGATCT CCTAATACTA CGTGCCGATT 541 CGTGACACCC GATCCATTAA TACTATGTGT CGGTTCGTGA CACCCGATCC ATTAATACTA 601 CGTGTCGGTT CGTGACACCC GATCCCCTAA CCTCATTCTT TTAGTTCATC AAGCCTTCTT 661 TTATACCAAG ACATCATCAT TAACAA Predicted gene structure (within gDNA segment 26902 to 21889): Exon 1 24887 24457 ( 431 n); cDNA 1 431 ( 431 n); score: 0.785 Intron 1 24456 24411 ( 46 n); Pd: 0.657 (s: 0.76), Pa: 0.000 (s: 0.80) Exon 2 24410 24170 ( 241 n); cDNA 432 670 ( 239 n); score: 0.859 Intron 2 24169 24120 ( 50 n); Pd: 0.927 (s: 0.84), Pa: 0.000 (s: 0) Exon 3 24119 24104 ( 16 n); cDNA 671 686 ( 16 n); score: 0.875 MATCH C01HBa0088L02.1- SGN-E241789+ 0.812 688 1.003 C PGS_C01HBa0088L02.1-_SGN-E241789+ (24887 24457,24410 24170,24119 24104) Alignment (genomic DNA sequence = upper lines): ATGCCGGAAG TTCAAGG-CA TCAAGACTTG AAGAAGA-AG -CTCCAGTCC AAGCTAGAAG 24831 ||| | || ||||||| || ||||||| || || ||| || |||||||| |||||| | ATGTCTGATC TTCAAGGACA TCAAGACATG AATGAGAGAG AATCCAGTCC GAGCTAGGAA 60 CATTAGCTCA CCCTGAATTT CCGATGT-AG TAAGACTGGC TTGAATTACT GTTGAGTCGA 24772 || ||||||| ||||||| | | || || | |||||||| | || || | ||||||| || CAATAGCTCA CCCTGAA-AT CTGACGTGAT GAAGACTGGT TAGAGTTGCG GTTGAGTTGA 119 AGACGACGGC ACGTTTGCTA CACTCCAAAA ATAACAAAGA AGAAAACATA AAAGTAGGGG 24712 ||||||||| ||||||||| ||||||| || ||||||| | |||||||||| |||||||||| AGACGACGGT ACGTTTGCTG CACTCCACAA TTAACAAA-A AGAAAACATA AAAGTAGGGG 178 TCAGTATAAA GCACGGGTAC TGAGTAGATA TCATCGGCCA ACTCAAAATA GAAAACAGTA 24652 |||||| ||| |||| |||| |||||||||| |||||||||| ||||| |||| || |||| || TCAGTACAAA -CACGAGTAC TGAGTAGATA TCATCGGCCA ACTCAGAATA GAGAACAATA 237 TATACCAAGT AATATCATAA ACTCAACTAT GATACTCAAC ATGTAGCAAC AACAAGTACT 24592 |||| ||| | |||| |||| | ||||| || | ||| ||| | || |||| ||||||||| TATATCAAAT AATAAAATAA AATCAACCAT AACACTTAAC AGGTGACAAC AACAAGTACC 297 ATAA-CATTA ACAATTTCCG TCAAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT 24533 |||| |||| | || |||| || |||||||| ||||||||| | |||||||| ATAACCATTG GGCACAACC- -CAAGAACAT CTATGAGGAC TCAAGCCTCC ACACCATACT 355 CATTTGGGAA TTATGTTCAT TAGATTGAGT ATATTAACAT CTTTTAAGAT TCATTATCTT 24473 |||||||||| | |||||| || ||||||| | |||||||| || ||||| ||||| | || CATTTGGGAA ACAGGTTCAT TAAATTGAGT ACATTAACAT AATTCAAGAT TCATTCTTTT 415 TATTTCTCTT GTGTCGGTAC GTGACACTCC GCTCCCTTAT ATTCATTAAT CCTCTTGTGT 24413 || | | |||||| TACTATCGTG GTGTCG.... .......... .......... .......... .......... 431 CGGTACGTGA CACTCCGATC CCCTACTACT ATGTGTCGAA ACGTGATACT CCGATCCCCT 24353 | |||||| ||||||||| ||||| | || | |||||| ||||| || |||||||||| ..GAACGTGA TACTCCGATC CCCTAATGCT ACGTGTCGGT TCGTGACAC- CCGATCCCCT 488 AAATTCTACG TGTCGGTTCG TGACACCCGA TCTCCTAAAT CTACGTGTCG GTTCGTGACA 24293 ||| ||||| |||||||||| | |||||||| |||||||| ||||||| || ||||||||| -AATACTACG TGTCGGTTCG TTACACCCGA TCTCCTAATA CTACGTGCCG ATTCGTGACA 547 CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGG TCCCCTAATT CTACGTGTCG 24233 |||||||| |||| ||| | |||||||||| ||||||||| ||| |||| |||||||||| CCCGATCCAT TAATACTATG TGTCGGTTCG TGACACCCGA TCCATTAATA CTACGTGTCG 607 GTTCGTAACA CCCGATCCCC TAATCTCATT CTATCAATTC ATCAAGCCTT CTCCCTTACC 24173 |||||| ||| |||||||||| ||| |||||| || | | ||| |||||||||| || |||| GTTCGTGACA CCCGATCCCC TAACCTCATT CTTTTAGTTC ATCAAGCCTT CTTTTATACC 667 AAGGCATCAT CAATCTCATT ACTTTAGTTC ATCAAGCCTT ATCCCTTACA AAGGCATCAT 24113 ||| |||||| AAG....... .......... .......... .......... .......... ...ACATCAT 677 CATTAAAAA 24104 |||||| || CATTAACAA 686 hqPGS_C01HBa0088L02.1-_SGN-E241789+ (24887 24457,24410 24170) ******************************************************************************** EST sequence 3 -strand 774 n (File: SGN-E349977-) 1 AGTAGATATC ATCGCTAACT CAAAATAGGG AACAATATAT ATCAATAATA ATGTAAATCA 61 ACTACAATAC TCATCATGTA GCAATAGCAA TTTCTTNATC ATTAACAATT ACCGTCAAGT 121 TCACACATGA GGACTCAAGC CTCAATACCA TACTCATTTG GGAATTAAGT TCATTAGATT 181 GAGTATATTC ATTATCTTTC AAGATTCATT ATCTTTCTTC CTCTTGTGTC GGTACGTGAC 241 ACTCCGCTCC TCTATTTCTA TCCTGGTGCC GGAACGTGGC ACTCCGATCC TCATATTCAT 301 TCTATCCTGG TACCGGAACG TGGCACCCGA TCCTCATATT CTATCCTGGT GTCGGAACGT 361 AACACTCCGA TCCTCATATT CATTCTATCC TGGTACCGGA ACGTGGCACC CGATCCTCAT 421 ATTCTATCCT GGTGTCGGAA CGTGACACTC CGATCCTCAT ATTCTATCCT GGTGTCGGAA 481 CGTGACACTC CGATCCTCAT ATTCATTCTA TCCTGGTACC GAAACGTGGC ACCCGATCCC 541 CTAATTCATC AAGCCTTCTT CTACACTAAG GCATCATCAT TCTCATTATA TAATTTATCA 601 AGCCTTCTCT CATACTAAGG CCTCATCAAT CTTATTATAT AATATATCAA GTGAATTAGG 661 GTTCTTTCAA GATTTGGGAT TCAATAGCTT CATCATGCTT TGTTAATTCA TAACAATTTC 721 ATAATCATAA TCATGCAAGC ATACCAATAA GCATATAGAC AGGTTTACAA CATC Predicted gene structure (within gDNA segment 26295 to 22715): Exon 1 24689 24379 ( 311 n); cDNA 1 303 ( 303 n); score: 0.838 Intron 1 24378 24315 ( 64 n); Pd: 0.000 (s: 0.66), Pa: 0.000 (s: 0.67) Exon 2 24314 24271 ( 44 n); cDNA 304 348 ( 45 n); score: 0.670 Intron 2 24270 24239 ( 32 n); Pd: 0.000 (s: 0.67), Pa: 0.000 (s: 0.79) Exon 3 24238 24198 ( 41 n); cDNA 349 389 ( 41 n); score: 0.793 MATCH C01HBa0088L02.1- SGN-E349977- 0.838 396 0.512 C PGS_C01HBa0088L02.1-_SGN-E349977- (24689 24379,24314 24271,24238 24198) Alignment (genomic DNA sequence = upper lines): AGTAGATATC ATCGGCCAAC TCAAAATAGA AAACAGTATA TACCAAGTAA TATCATAAAC 24630 |||||||||| ||| || ||| ||||||||| |||| |||| || ||| ||| || |||| AGTAGATATC ATC-GCTAAC TCAAAATAGG GAACAATATA TATCAA-TAA TAATGTAAA- 57 TCAACTATGA TACTCAACAT GTAGCAACAA CAAGTACTAT AACATTAACA ATTTCCGTCA 24570 ||||||| | |||||| ||| ||||||| | ||| | || | |||||||| ||| |||||| TCAACTACAA TACTCATCAT GTAGCAATAG CAATTTCTTN ATCATTAACA ATTACCGTCA 117 AGTTCACACA TGAGGACTCA AGCCTCAATA CCATACTCAT TTGGGAATTA TGTTCATTAG 24510 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| AGTTCACACA TGAGGACTCA AGCCTCAATA CCATACTCAT TTGGGAATTA AGTTCATTAG 177 ATTGAGTATA TT-AACATCT TTTAAGATTC ATTATCTTTA TTTCTCTTGT GTCGGTACGT 24451 |||||||||| || | |||| || ||||||| ||||||||| || ||||||| |||||||||| ATTGAGTATA TTCATTATCT TTCAAGATTC ATTATCTTTC TTCCTCTTGT GTCGGTACGT 237 GACACTCCGC TCCCTTATAT TCATTAATCC TCTTGTGTCG GTACGTGACA CTCCGATCCC 24391 |||||||||| ||| ||| | || | || | || ||| || | ||||| || ||||||||| GACACTCCGC TCCTCTAT-T TC--T-AT-C -CTGGTGCCG GAACGTGGCA CTCCGATCCT 291 CTACTACTAT GTGTCGAAAC GTGATACTCC GATCCCCTAA ATTCTACGTG TCGGTTCGTG 24331 | | | | | CATATTCATT CT........ .......... .......... .......... .......... 303 ACACCCGATC TCCTAAATCT ACGTGTCGGT TCGTGACACC CGATCCCCTA ATTCTA-CGT 24272 ||| || ||| |||| |||| |||||| | |||||| | | .......... ......ATCC TGGTACCGGA ACGTGGCACC CGATCCTCAT ATTCTATCCT 347 GTCGGTTCGT GACACCCGGT CCCCTAATTC TACGTGTCGG TTCGTAACAC -CCGATCCCC 24213 | ||||||| |||||||| ||||||| | G......... .......... .......... ...GTGTCGG AACGTAACAC TCCGATCCTC 375 TAATCTCATT CTATC 24198 || ||||| ||||| ATAT-TCATT CTATC 389 hqPGS_C01HBa0088L02.1-_SGN-E349977- (24689 24379,24314 24271,24238 24198) ******************************************************************************** EST sequence 104 -strand 725 n (File: SGN-E546548-) 1 GGTACCGGAA CGTGGCACCC GATCCATATT CTATCCTGGT GTCGGAACGT GACACTCCGA 61 TCCTCATATT CATTCTATCC TGGTACCGGA ACGTGGCACC CGATCCCCTA ATCCATCAAG 121 CCTTCTTTTA CACTAAGGCA TCATCATTCT CATTATATAA TTTATCAAGC CTTCTTTCAT 181 ACTAAGGCAT CATCATTCTC ATTATATAAT ATATCAAGCG AATTAGGGTT CTTTCAAGAT 241 TTGGGATTCA ATTGCTTCAT CATGCTTTGT TAATTCATCG CAATTTCATA ATCATAATCA 301 TGCAAGCATA CAACTTAAGC ACATAGCAGG GTTTACAATA CTATCAACAC ATAATATTCA 361 CTATTAAGAG TTCACTACGA ATATCGTAAC ATAAACCATA ACCTACCTCC ACCGAAGAAT 421 TGAATCAACA AGCTATCTTC TCAAAATCCT TGCTATCCTC TTCGTTTCTC TCTCTCTACT 481 CGTTCGTTTC TCCTCTCTTT CTGTTCTTTT CTTTTGTTTT GTTTTATTCA AACCCTCCTT 541 CTTTTTACCC TAATTAAAAG TATAATTAAG TGTAAAGGAG GACAATAAAA CCCACTAATT 601 AACTTAAGGT TACCTCTTTT AACCCCCAAG TAATTAGACC TATTAATATT AACCCTCAAT 661 CTTTATAATT AAGGAAAGAA TAGTCCAAAA CGACCCCTAA AACGTGTAGA GGAATCCTAT 721 TTTGC Predicted gene structure (within gDNA segment 27607 to 22229): Exon 1 24273 24136 ( 138 n); cDNA 83 219 ( 137 n); score: 0.688 Intron 1 24135 24103 ( 33 n); Pd: 0.000 (s: 0.80), Pa: 0.000 (s: 0.79) Exon 2 24102 23611 ( 492 n); cDNA 220 717 ( 498 n); score: 0.823 MATCH C01HBa0088L02.1- SGN-E546548- 0.794 630 0.869 C PGS_C01HBa0088L02.1-_SGN-E546548- (24273 24136,24102 23611) Alignment (genomic DNA sequence = upper lines): GTGTCGGTTC GTGACACCCG GTCCCCTAAT TCTACGTGTC GGTTCGTA-A CACCCG-ATC 24216 || ||| | ||| |||||| ||||||||| | | | | | || | | | ||| GTACCGGAAC GTGGCACCCG ATCCCCTAAT CCATCAAGCC TTCTTTTACA CTAAGGCATC 142 CCCTAATCTC ATTCTATCAA TTCATCAAGC CTTCTCCCTT ACCAAGGCAT CATCAATCTC 24156 | | |||| ||| ||| || || ||||||| ||||| | | || ||||||| ||||| |||| ATC-ATTCTC ATTATAT-AA TTTATCAAGC CTTCTTTCAT ACTAAGGCAT CATCATTCTC 200 ATTACTTTAG TTCATCAAGC CTTATCCCTT ACAAAGGCAT CATCATTAAA AAGAGATTAG 24096 |||| | || | ||||||| ||||| ATTA-TATAA TATATCAAGC .......... .......... .......... ...GAATTAG 226 GTTTTTATCA AGATTTGGGA TTCGATAGCT TCATCATGC- TTAAT-A-TA ATCACAATTA 24039 | || | ||| |||||||||| ||| || ||| ||||||||| || | | | ||| ||||| GGTTCTTTCA AGATTTGGGA TTCAATTGCT TCATCATGCT TTGTTAATTC ATCGCAATTT 286 TATAATCACG TTCATGCAAG CATACAA-TT AAGCACATAG CAGGGTTTAC AATACTATCA 23980 ||||||| ||||||||| ||||||| || |||||||||| |||||||||| |||||||||| CATAATCATA ATCATGCAAG CATACAACTT AAGCACATAG CAGGGTTTAC AATACTATCA 346 ATACATATCA TTCGCTATTA AGAGTTTACT ACGAATA--G TATGA-AAAC CATAACCTAC 23923 | ||||| | ||| |||||| |||||| ||| ||||||| | || | |||| |||||||||| ACACATAATA TTCACTATTA AGAGTTCACT ACGAATATCG TAACATAAAC CATAACCTAC 406 CTTCACCGAA GAATTGCGAT CAACAAGCTA TCTTCTCAAA ATCCTTGCTA TCCTCTTCGT 23863 || ||||||| |||||| || |||||||||| |||||||||| |||||||||| |||||||||| CTCCACCGAA GAATTG-AAT CAACAAGCTA TCTTCTCAAA ATCCTTGCTA TCCTCTTCGT 465 TTCTCTCTCT CTACTCGTTC TCTTTCT-TT TTCTGTCTCT CTTTGTTCTT TCTATTTTTC 23804 |||||||||| |||||||||| ||||| | ||| ||| | | | ||||| | ||| | TTCTCTCTCT CTACTCGTTC -GTTTCTCCT CTCTTTCTGT -TCTTTTCTT TTGTTTTGTT 523 TTATTCAAAC CCTCTTTC-T TTTACCCTAA TTAACA-TAT AATCAAGTGT AAAAGATGGC 23746 |||||||||| |||| ||| | |||||||||| |||| | ||| ||| |||||| ||| || | | TTATTCAAAC CCTCCTTCTT TTTACCCTAA TTAAAAGTAT AATTAAGTGT AAAGGAGGAC 583 AATAATAACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA ATTAGACTTA 23686 ||||| |||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||| || AATAA-AACC CACTAATTAA CTTAAGGTTA CCTCTTTTAA CCCCCAAGTA ATTAGACCTA 642 TTAACATTAA CCCCCTAACT TTATAATTTA AGCAGGAATA GTCAAAAACG TCCCTTAAAA 23626 |||| ||||| ||| | | || |||||||| | | | ||||| ||| |||||| ||| ||||| TTAATATTAA CCCTCAATCT TTATAATTAA GGAAAGAATA GTCCAAAACG ACCCCTAAAA 702 CGTATAAAGA AATCC 23611 ||| || || ||||| CGTGTAGAGG AATCC 717 hqPGS_C01HBa0088L02.1-_SGN-E546548- (24102 23611) ******************************************************************************** EST sequence 8 -strand 731 n (File: SGN-E578076-) 1 GCATCATCAA TCCCATTATT TTAGTTCATC ACGCCTTCTT TTATACCAAG GCCTCATTAT 61 GAACAAAGAG ATTAAGATTT TGCAAGATTT GGGATTCAAT AACTTCATCA TGCTTATATA 121 ATCACAATTA TATAGTTACA TTCATGCAAG CATACAATTA AGCACATAGC AGGGTTTACA 181 ATATTATCAA TACATATCAT TCTCTATTAA GAGTTTACTA CGAATATCGT AAGAGAAACC 241 ATAACCTACC TCCACCGAAG AATTGCGATC AACAAGTTAT CTTCTCAAAA TCCTTGCTAT 301 CCTCTTCGTT TCTCTTTCTT TTTCTGTTTT CTCTTTGTTC TTTCTATTTT TCTTATTCAA 361 ACGTCCTAAC GAGCAAAACA GAGAACAAAA CAACCCTAAA AATTTCAACT TTTTTCGGTT 421 TCCCGACTTC CAATTTACCA GAGATATAGA TAATTCACTG AAATTGAACA AGGGTTAAGA 481 GCAGAAGAAA TTTACGTTGT GATTAATTGG GGCAAAGCGT CGAACAGTTG AACTGCAAAT 541 TTGTTCTTCA GTTATAGATA CAAAAGATAG AGTCTTATAT GAGTTAAAGA AGACGTAGAG 601 TATACCCTAG TAAGCGAGCT GACCACGGCG GAATGAGGTG GTGAGTTGGT GGGTTTCGTC 661 GGTCAACCAA GAAATGAAAA GGAAATTGAA GTATGAAAAA CTACAGAAAA ATGACGCGTT 721 TGGCCGAGAA A Predicted gene structure (within gDNA segment 25813 to 19504): Exon 1 24169 23820 ( 350 n); cDNA 1 351 ( 351 n); score: 0.857 MATCH C01HBa0088L02.1- SGN-E578076- 0.857 350 0.479 C PGS_C01HBa0088L02.1-_SGN-E578076- (24169 23820) Alignment (genomic DNA sequence = upper lines): GCATCATCAA TCTCATTACT TTAGTTCATC AAGCCTTATC CCTTACAAAG GCATCATCAT 24110 |||||||||| || ||||| | |||||||||| | ||||| | ||| ||| || |||| || GCATCATCAA TCCCATTATT TTAGTTCATC ACGCCTTCTT TTATACCAAG GCCTCATTAT 60 TAA-AAAGAG ATTAGGTTTT TATCAAGATT TGGGATTCGA TAGCTTCATC ATGCTTAATA 24051 || |||||| |||| | ||| | ||||||| |||||||| | || ||||||| |||||| ||| GAACAAAGAG ATTAAGATTT T-GCAAGATT TGGGATTCAA TAACTTCATC ATGCTT-ATA 118 TAATCACAAT TATATAATCA CGTTCATGCA AGCATACAAT TAAGCACATA GCAGGGTTTA 23991 |||||||||| |||||| | | | |||||||| |||||||||| |||||||||| |||||||||| TAATCACAAT TATATAGTTA CATTCATGCA AGCATACAAT TAAGCACATA GCAGGGTTTA 178 CAATACTATC AATACATATC ATTCGCTATT AAGAGTTTAC TACGAATA-- GTATGA-AAA 23934 ||||| |||| |||||||||| |||| ||||| |||||||||| |||||||| ||| || ||| CAATATTATC AATACATATC ATTCTCTATT AAGAGTTTAC TACGAATATC GTAAGAGAAA 238 CCATAACCTA CCTTCACCGA AGAATTGCGA TCAACAAGCT ATCTTCTCAA AATCCTTGCT 23874 |||||||||| ||| |||||| |||||||||| |||||||| | |||||||||| |||||||||| CCATAACCTA CCTCCACCGA AGAATTGCGA TCAACAAGTT ATCTTCTCAA AATCCTTGCT 298 ATCCTCTTCG TTTCTCTCTC TCTACTCGTT CTCTTTCTTT TTCTGTCTCT CTTT 23820 |||||||||| ||||||| || | | ||| ||| | || |||| ||| | ||| ATCCTCTTCG TTTCTCTTTC TTTTTCTGTT TTCTCT-TTG TTCTTTCTAT TTTT 351 hqPGS_C01HBa0088L02.1-_SGN-E578076- (24169 23820) ******************************************************************************** EST sequence 1 -strand 605 n (File: SGN-E347579-) 1 ATCCCCTAAT TCTACGTGTC GGTTCGTGAC ACCCGATCCC CTAATTCTAC GTGTCGGTTC 61 GTGACACCTG ATCCCCTAAT CTACGTGCCG GTTCGTGACA CCCGATCCCC TAATTCTACG 121 TGCCAGTTCG TGACACCCGA TCCCCTAATT CTACGTGTCG GTTCGTGACA CCCGATCCCC 181 TGCATGTGTC GGTACGTGAC ACTCCGATCC ACTAATATCA TTCTGTAAAT CATCAGGCCT 241 TCTCTATACC AAGGCATCAT CAATCCCATT ACTTTTATTC ATCAAGCCTT CTTCTATACC 301 AAGGCATCAT CATTAATAAG AGATTAGATT TTTATCAAGA TTTGGGATTC AATAACTTCA 361 TCATGCTTAA TATAATCACA ATTATATAAT CACGTTCATG CATGCATACA ATTAAGCATA 421 TAGCAGGGTT TACAATACTA CCAATACATA TCATTCTCTA TTAAGAGTTT ACTATGAAAG 481 CATGAAAACC ATAACCTACC TCCACCGAAG ATTAGTGATC AAGCAAGCAA ATTTTTCTCC 541 AAGCTTTGTT TCTCCCTTCT CGTTCGATTC TTCCTCTCTC TCTTGTTCTT TCTATTTTCT 601 TTATT Predicted gene structure (within gDNA segment 24923 to 22281): Exon 1 24432 23900 ( 533 n); cDNA 1 522 ( 522 n); score: 0.871 MATCH C01HBa0088L02.1- SGN-E347579- 0.871 533 0.881 C PGS_C01HBa0088L02.1-_SGN-E347579- (24432 23900) Alignment (genomic DNA sequence = upper lines): ATTCATTAAT CCTCTTGTGT CGGTACGTGA CACTCCGATC CCCTACTACT ATGTGTCGAA 24373 || | |||| || |||| |||| ||||| ||| |||||| ||||| | || | |||||| ATCCCCTAAT TCT-ACGTGT CGGTTCGTGA CAC-CCGATC CCCTAATTCT ACGTGTCGGT 58 ACGTGATACT CCGATCCCCT AAATTCTACG TGTCGGTTCG TGACACCCGA TCTCCTAAAT 24313 ||||| || | |||||||| || |||||| || ||||||| |||||||||| || ||||| | TCGTGACAC- CTGATCCCCT -AA-TCTACG TGCCGGTTCG TGACACCCGA TCCCCTAATT 115 CTACGTGTCG GTTCGTGACA CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGG 24253 ||||||| | |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| CTACGTGCCA GTTCGTGACA CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGA 175 TCCCCTAATT CTACGTGTCG GTTCGTAACA C-CCGATCCC CTAATCTCAT TCTATCAATT 24194 ||||| | | | |||||| || ||| ||| | ||||||| ||||| |||| ||| | || | TCCCC---TG C-ATGTGTCG GTACGTGACA CTCCGATCCA CTAATATCAT TCTGT-AAAT 230 CATCAAGCCT TCTCCCTTAC CAAGGCATCA TCAATCTCAT TACTTTAGTT CATCAAGCCT 24134 ||||| |||| ||| | ||| |||||||||| |||||| ||| |||||| || |||||||||| CATCAGGCCT TCT-CTATAC CAAGGCATCA TCAATCCCAT TACTTTTATT CATCAAGCCT 289 TATCCCTTAC AAAGGCATCA TCATTAAAAA GAGATTAGGT TTTTATCAAG ATTTGGGATT 24074 | | | ||| ||||||||| ||||||| || |||||||| | |||||||||| |||||||||| TCTTCTATAC CAAGGCATCA TCATTAATAA GAGATTAGAT TTTTATCAAG ATTTGGGATT 349 CGATAGCTTC ATCATGCTTA ATATAATCAC AATTATATAA TCACGTTCAT GCAAGCATAC 24014 | ||| |||| |||||||||| |||||||||| |||||||||| |||||||||| ||| |||||| CAATAACTTC ATCATGCTTA ATATAATCAC AATTATATAA TCACGTTCAT GCATGCATAC 409 AATTAAGCAC ATAGCAGGGT TTACAATACT ATCAATACAT ATCATTCGCT ATTAAGAGTT 23954 ||||||||| |||||||||| |||||||||| | |||||||| ||||||| || |||||||||| AATTAAGCAT ATAGCAGGGT TTACAATACT ACCAATACAT ATCATTCTCT ATTAAGAGTT 469 TACTACGAAT AGTATGAAAA CCATAACCTA CCTTCACCGA AGAATTGCGA TCAA 23900 ||||| ||| || ||||||| |||||||||| ||| |||||| ||| | | || |||| TACTATGAA- AGCATGAAAA CCATAACCTA CCTCCACCGA AGATTAGTGA TCAA 522 hqPGS_C01HBa0088L02.1-_SGN-E347579- (24432 23900) ******************************************************************************** EST sequence 109 -strand 717 n (File: SGN-E349726-) 1 TTATGTTCAT TAGATTGAGT ATATAACATC TTTCAAGATT CATTGTCTTT ATTTCTCTTG 61 TGTCGGTACG TGACATTCCG CTCCNTCATA TTCATTAATC TTCTTGTGTC GGTACGTGAT 121 ACTCTGATCC CCTAAATCTA CGTGTCGGAA CGTGACACTC CGATCCCCTA AATCTACGTG 181 TCGGTTCGTG ACACCTGATC CCCTAAATCT ACGTGTCGGT TCGTGACACC CGATCCCCTA 241 AATCTACGTG TCGGTTCGTG ACACCCGATC CCCTAAATCT ACGTGTCGGT TCGTGACACC 301 CGATCCCCTA ATCTATGTGT TGGTTCGTGA CACCTGATCC CTTAATCTAC GTGTCGGTTT 361 GTGACACCCG ATCCCCTAAT TCTACGTGTC AGTTCGTGAC ACCCGATCCC CTAATCTCAT 421 TCTATCAATT CATCAAGCCT TCTCCCTTAC CAAGGCATCA TCAATCTCAT TACTTTAGTT 481 CATCAAGCCT TCTCCCTTAC CAAGGCATCA TCATTAAAAA GAGATTAGGT TTTTACAAGA 541 TTTGGGATTC AATAACTTCA TCATGCTTAT ATAATAACAA TTATATAGTT ACATTCATGC 601 AAGCATACAA TTAAGCACAT AGCAGGGTTT ACAATATTAT CAATACATAT CATTCTCTAT 661 TAAGAGTTTA CTACGAATAT CGTAAGAGAA ACAATAACCT ACCTCCACCG AAGACTA Predicted gene structure (within gDNA segment 28508 to 22963): Exon 1 24432 23911 ( 522 n); cDNA 198 714 ( 517 n); score: 0.898 MATCH C01HBa0088L02.1- SGN-E349726- 0.898 522 0.728 C PGS_C01HBa0088L02.1-_SGN-E349726- (24432 23911) Alignment (genomic DNA sequence = upper lines): ATTCATTAAT CCTCTTGTGT CGGTACGTGA CACTCCGATC CCCTACTACT ATGTGTCGAA 24373 || | ||| || |||| |||| ||||| ||| |||||| ||||| || | |||||| ATCCCCTAAA TCT-ACGTGT CGGTTCGTGA CAC-CCGATC CCCTAAATCT ACGTGTCGGT 255 ACGTGATACT CCGATCCCCT AAATTCTACG TGTCGGTTCG TGACACCCGA TCTCCTAAAT 24313 ||||| || |||||||||| ||| |||||| |||||||||| |||||||||| || ||| ||| TCGTGACAC- CCGATCCCCT AAA-TCTACG TGTCGGTTCG TGACACCCGA TCCCCT-AAT 312 CTACGTGTCG GTTCGTGACA CCCGATCCCC TAATTCTACG TGTCGGTTCG TGACACCCGG 24253 ||| |||| | |||||||||| || |||||| ||| |||||| |||||||| | ||||||||| CTATGTGTTG GTTCGTGACA CCTGATCCCT TAA-TCTACG TGTCGGTTTG TGACACCCGA 371 TCCCCTAATT CTACGTGTCG GTTCGTAACA CCCGATCCCC TAATCTCATT CTATCAATTC 24193 |||||||||| ||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| TCCCCTAATT CTACGTGTCA GTTCGTGACA CCCGATCCCC TAATCTCATT CTATCAATTC 431 ATCAAGCCTT CTCCCTTACC AAGGCATCAT CAATCTCATT ACTTTAGTTC ATCAAGCCTT 24133 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCAAGCCTT CTCCCTTACC AAGGCATCAT CAATCTCATT ACTTTAGTTC ATCAAGCCTT 491 ATCCCTTACA AAGGCATCAT CATTAAAAAG AGATTAGGTT TTTATCAAGA TTTGGGATTC 24073 |||||||| |||||||||| |||||||||| |||||||||| |||| ||||| |||||||||| CTCCCTTACC AAGGCATCAT CATTAAAAAG AGATTAGGTT TTTA-CAAGA TTTGGGATTC 550 GATAGCTTCA TCATGCTTAA TATAATCACA ATTATATAAT CACGTTCATG CAAGCATACA 24013 ||| ||||| |||||||| | |||||| ||| |||||||| | || |||||| |||||||||| AATAACTTCA TCATGCTT-A TATAATAACA ATTATATAGT TACATTCATG CAAGCATACA 609 ATTAAGCACA TAGCAGGGTT TACAATACTA TCAATACATA TCATTCGCTA TTAAGAGTTT 23953 |||||||||| |||||||||| ||||||| || |||||||||| |||||| ||| |||||||||| ATTAAGCACA TAGCAGGGTT TACAATATTA TCAATACATA TCATTCTCTA TTAAGAGTTT 669 ACTACGAATA --GTATGA-A AACCATAACC TACCTTCACC GAAGA 23911 |||||||||| ||| || | ||| |||||| ||||| |||| ||||| ACTACGAATA TCGTAAGAGA AACAATAACC TACCTCCACC GAAGA 714 hqPGS_C01HBa0088L02.1-_SGN-E349726- (24432 23911) ******************************************************************************** EST sequence 93 -strand 402 n (File: SGN-E357559-) 1 TGTGTTGGTT CGTGACACCT GATCCCTTAA TCTACGTGTC GGTTTGTGAC ACCCGATCCC 61 CTAATTCTAC GTGTCAGTTC GTGACACCCG ATCCCCTAAT CTCATTCTAT CAATTCATCA 121 AGCCTTCTCC CTTACCAAGG CATCATCAAT CTCATTACTT TAGTTCATCA AGCCTTCTCC 181 CTTACCAAGG CATCATCATT AAAAAGAGAT TAGGTTTTTA CAAGATTTGG GATTCAATAA 241 CTTCATCATG CTTATATAAT AACAATTATA TAGTTACATT CATGCAAGCA TACAATTAAG 301 CACATAGCAG GGTTTACAAT ATTATCAATA CATATCATTC TCTATTAAGA GTTTACTACG 361 AATATCGTAA GAGAAACAAT AACCTACCTC CACCGAAGAC TA Predicted gene structure (within gDNA segment 25205 to 22963): Exon 1 24308 23911 ( 398 n); cDNA 2 399 ( 398 n); score: 0.923 MATCH C01HBa0088L02.1- SGN-E357559- 0.923 398 0.990 C PGS_C01HBa0088L02.1-_SGN-E357559- (24308 23911) Alignment (genomic DNA sequence = upper lines): GTGTCGGTTC GTGACACCCG ATCCCCTAAT TCTACGTGTC GGTTCGTGAC ACCCGGTCCC 24249 |||| ||||| |||||||| | ||||| ||| |||||||||| |||| ||||| ||||| |||| GTGTTGGTTC GTGACACCTG ATCCCTTAA- TCTACGTGTC GGTTTGTGAC ACCCGATCCC 60 CTAATTCTAC GTGTCGGTTC GTAACACCCG ATCCCCTAAT CTCATTCTAT CAATTCATCA 24189 |||||||||| ||||| |||| || ||||||| |||||||||| |||||||||| |||||||||| CTAATTCTAC GTGTCAGTTC GTGACACCCG ATCCCCTAAT CTCATTCTAT CAATTCATCA 120 AGCCTTCTCC CTTACCAAGG CATCATCAAT CTCATTACTT TAGTTCATCA AGCCTTATCC 24129 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| ||| AGCCTTCTCC CTTACCAAGG CATCATCAAT CTCATTACTT TAGTTCATCA AGCCTTCTCC 180 CTTACAAAGG CATCATCATT AAAAAGAGAT TAGGTTTTTA TCAAGATTTG GGATTCGATA 24069 ||||| |||| |||||||||| |||||||||| |||||||||| ||||||||| |||||| ||| CTTACCAAGG CATCATCATT AAAAAGAGAT TAGGTTTTTA -CAAGATTTG GGATTCAATA 239 GCTTCATCAT GCTTAATATA ATCACAATTA TATAATCACG TTCATGCAAG CATACAATTA 24009 ||||||||| |||| ||||| || ||||||| |||| | || |||||||||| |||||||||| ACTTCATCAT GCTT-ATATA ATAACAATTA TATAGTTACA TTCATGCAAG CATACAATTA 298 AGCACATAGC AGGGTTTACA ATACTATCAA TACATATCAT TCGCTATTAA GAGTTTACTA 23949 |||||||||| |||||||||| ||| |||||| |||||||||| || ||||||| |||||||||| AGCACATAGC AGGGTTTACA ATATTATCAA TACATATCAT TCTCTATTAA GAGTTTACTA 358 CGAATA--GT ATGA-AAACC ATAACCTACC TTCACCGAAG A 23911 |||||| || | || |||| |||||||||| | |||||||| | CGAATATCGT AAGAGAAACA ATAACCTACC TCCACCGAAG A 399 hqPGS_C01HBa0088L02.1-_SGN-E357559- (24308 23911) ******************************************************************************** EST sequence 95 -strand 239 n (File: SGN-E391780-) 1 ATCAACAAAT ACTATATCAT TAACAATTAC CGTCAAGTTC ACACATGAGG ACTCAAGCCT 61 CAATACCATA CTCATTTGGG AATCATGTTC ATTAGATTGA GTATATTAAC ATCTTTCAAG 121 ATTCATTATC TTTATTTCTC TTGTGTCGGT ACGTGACACT CCGCTCCCTC AATATTCATT 181 AATCCTCTTG TGTCGGTACG TGACACTCCG ATCCCCTAAA TCTATATGTC GGTTTGTGA Predicted gene structure (within gDNA segment 25475 to 23578): Exon 1 24602 24367 ( 236 n); cDNA 3 239 ( 237 n); score: 0.930 MATCH C01HBa0088L02.1- SGN-E391780- 0.930 236 0.987 C PGS_C01HBa0088L02.1-_SGN-E391780- (24602 24367) Alignment (genomic DNA sequence = upper lines): CAACAAGTAC TATAACATTA ACAATTTCCG TCAAGTTCAC ACATGAGGAC TCAAGCCTCA 24543 |||||| ||| |||| ||||| |||||| ||| |||||||||| |||||||||| |||||||||| CAACAAATAC TATATCATTA ACAATTACCG TCAAGTTCAC ACATGAGGAC TCAAGCCTCA 62 ATACCATACT CATTTGGGAA TTATGTTCAT TAGATTGAGT ATATTAACAT CTTTTAAGAT 24483 |||||||||| |||||||||| | |||||||| |||||||||| |||||||||| |||| ||||| ATACCATACT CATTTGGGAA TCATGTTCAT TAGATTGAGT ATATTAACAT CTTTCAAGAT 122 TCATTATCTT TATTTCTCTT GTGTCGGTAC GTGACACTCC GCTCCCT-TA TATTCATTAA 24424 |||||||||| |||||||||| |||||||||| |||||||||| ||||||| | |||||||||| TCATTATCTT TATTTCTCTT GTGTCGGTAC GTGACACTCC GCTCCCTCAA TATTCATTAA 182 TCCTCTTGTG TCGGTACGTG ACACTCCGAT CCCCTACTAC TATGTGTCGA AACGTGA 24367 |||||||||| |||||||||| |||||||||| |||||| | ||| ||||| |||| TCCTCTTGTG TCGGTACGTG ACACTCCGAT CCCCTAAATC TATATGTCGG TTTGTGA 239 hqPGS_C01HBa0088L02.1-_SGN-E391780- (24602 24367) ******************************************************************************** EST sequence 76 -strand 481 n (File: SGN-E246710-) 1 AGTCCAAGCT AGAAGCATTA GCTCACCCTG AATTTCCGAT GTAGTAAGAC TGGCTTGAAT 61 TACTGTTGAG TTGAACACGA TGGCACGTTT GCTGCACTCC ACAAATAAAC AAGAAGAGAA 121 CATAAAAGTA GGGGTCAGTA CAAAACACGG GTACTGAGTA GATATCATCG GCCAACTCAA 181 AATAGAAATC AATATATATA CCAAGTAATA TCATAAAATC AACTATGATA CTCAACATGT 241 AGCAACAACA AATACTATAT CATTAACAAT TACCGTCAAG TTCACACATG AGGACTCAAG 301 CCTCAATACC ATACTCATTT GGGAATCATG TTCATTAGAT TGAGTATATT AACATCTTTC 361 AAGATTCATT ATCTTTATTT CTCTTGTGTC GGTACGTGAC ACTCCGCTCC CTCAATATTC 421 ATTAATCCTC TTGTGTCGGT ACGTGACACT CCGATCCCCT AAATCTATAT GTCGGTTTGT 481 G Predicted gene structure (within gDNA segment 25455 to 23588): Exon 1 24845 24368 ( 478 n); cDNA 1 481 ( 481 n); score: 0.928 MATCH C01HBa0088L02.1- SGN-E246710- 0.928 478 0.994 C PGS_C01HBa0088L02.1-_SGN-E246710- (24845 24368) Alignment (genomic DNA sequence = upper lines): AGTCCAAGCT AGAAGCATTA GCTCACCCTG AATTTCCGAT GTAGTAAGAC TGGCTTGAAT 24786 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTCCAAGCT AGAAGCATTA GCTCACCCTG AATTTCCGAT GTAGTAAGAC TGGCTTGAAT 60 TACTGTTGAG TCGAAGACGA CGGCACGTTT GCTACACTCC AAAAATAACA AAGAAGAAAA 24726 |||||||||| | ||| |||| ||||||||| ||| |||||| | |||||| ||||||| || TACTGTTGAG TTGAACACGA TGGCACGTTT GCTGCACTCC ACAAATAAAC AAGAAGAGAA 120 CATAAAAGTA GGGGTCAGTA TAAAGCACGG GTACTGAGTA GATATCATCG GCCAACTCAA 24666 |||||||||| |||||||||| ||| ||||| |||||||||| |||||||||| |||||||||| CATAAAAGTA GGGGTCAGTA CAAAACACGG GTACTGAGTA GATATCATCG GCCAACTCAA 180 AATAGAAAAC -A-GTATATA CCAAGTAATA TCATAAACTC AACTATGATA CTCAACATGT 24608 |||||||| | | |||||| |||||||||| ||||||| || |||||||||| |||||||||| AATAGAAATC AATATATATA CCAAGTAATA TCATAAAATC AACTATGATA CTCAACATGT 240 AGCAACAACA AGTACTATAA CATTAACAAT TTCCGTCAAG TTCACACATG AGGACTCAAG 24548 |||||||||| | ||||||| |||||||||| | |||||||| |||||||||| |||||||||| AGCAACAACA AATACTATAT CATTAACAAT TACCGTCAAG TTCACACATG AGGACTCAAG 300 CCTCAATACC ATACTCATTT GGGAATTATG TTCATTAGAT TGAGTATATT AACATCTTTT 24488 |||||||||| |||||||||| |||||| ||| |||||||||| |||||||||| ||||||||| CCTCAATACC ATACTCATTT GGGAATCATG TTCATTAGAT TGAGTATATT AACATCTTTC 360 AAGATTCATT ATCTTTATTT CTCTTGTGTC GGTACGTGAC ACTCCGCTCC CT-TATATTC 24429 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| || |||||| AAGATTCATT ATCTTTATTT CTCTTGTGTC GGTACGTGAC ACTCCGCTCC CTCAATATTC 420 ATTAATCCTC TTGTGTCGGT ACGTGACACT CCGATCCCCT ACTACTATGT GTCGAAACGT 24369 |||||||||| |||||||||| |||||||||| |||||||||| | |||| | |||| || ATTAATCCTC TTGTGTCGGT ACGTGACACT CCGATCCCCT AAATCTATAT GTCGGTTTGT 480 G 24368 | G 481 hqPGS_C01HBa0088L02.1-_SGN-E246710- (24845 24368) ******************************************************************************** EST sequence 258 +strand 730 n (File: SGN-E546506+) 1 TTTTTTTTTT TTTTTTTTAA TAAAAACAAT TCAATACTAT TATTATTATC CCCAAAATCT 61 GGAAGTCATC ATCACAAGAA CATCTATCTC AAATTACTTA ACTAGGAATG TCTAAGAACA 121 AAATAACTAA AAAGCTAGTC CATGCCGGAA ATTCAAGGCA TCAAGACTTG AAGAAGAAGA 181 CCCAGTCCAA GCTAGACGCA TTAGCTCACC CTGAATTTTC CGATGAAGTG AAGACTGGCT 241 AGATCTACTG TTGAGTTGAA GTTGACGGAA CGTTTGCTGC ATTACACAAA TAACAAAGAG 301 GAAAACATGA AAGTAGGGGT CAGTACAACC ACACGTACTG AGTAGATATC ATCGGCCAAC 361 TCAAAATAGG GAACAGTATA TATCAATAAT AATGTAAATC AACTACAATA CTCAACATGT 421 AGCAATAACA CCATGAATTC ATCAATAACT ACAACCGAGT TCACACATGA GGACTCAAGC 481 CTCAATACCA TACTCATTTG GGAATTAAGT TCATTAGATT GAGTATATTC ATTATCTTTC 541 AAGATTCATT ATCTTTCTTC CTCTTGTGTC GGTACGTGAC ACTCCGATCC TCTATTTCTA 601 TCCTGGTGCC GGAACGTGGC ACTCCGATCC TCATTCTATC CTGGTACCGG AACGTGGCAC 661 CCGATCCATT TTCTATCCTG GTGTCGGAAC GTGACACTCC GATCCTCATA TTCTATCCTG 721 GTACCGGAAC Predicted gene structure (within gDNA segment 26063 to 22382): Exon 1 24989 24381 ( 609 n); cDNA 44 639 ( 596 n); score: 0.846 PPA cDNA 18 1 MATCH C01HBa0088L02.1- SGN-E546506+ 0.846 609 0.834 C PGS_C01HBa0088L02.1-_SGN-E546506+ (24989 24381) Alignment (genomic DNA sequence = upper lines): TATTATTCCC CAAAATCTGG AAGTCATCAT CACAAGAACA TCTATGATCA AATTAC-TAA 24931 ||||| |||| |||||||||| |||||||||| |||||||||| ||||| ||| |||||| ||| TATTA-TCCC CAAAATCTGG AAGTCATCAT CACAAGAACA TCTAT-CTCA AATTACTTAA 101 CTAAAAATGT CTAAGAAGCT AAAAATACAT AAGAAGCTAG TCCATGCCGG AAGTTCAAGG 24871 ||| ||||| ||||||| | ||| | || | || ||||||| |||||||||| || ||||||| CTAGGAATGT CTAAGAA-CA AAATA-AC-T AAAAAGCTAG TCCATGCCGG AAATTCAAGG 158 CATCAAGACT TGAAGAAGAA GCTCCAGTCC AAGCTAGAAG CATTAGCTCA CCCTGAA-TT 24812 |||||||||| |||||||||| | ||||||| |||||||| | |||||||||| ||||||| || CATCAAGACT TGAAGAAGAA GACCCAGTCC AAGCTAGACG CATTAGCTCA CCCTGAATTT 218 TCCGATGTAG T-AAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT 24753 ||||||| || | |||||||| || || ||| |||||||| | ||| ||||| ||||||||| TCCGATGAAG TGAAGACTGG CTAGATCTAC TGTTGAGTTG AAGTTGACGG AACGTTTGCT 278 ACACTCCAAA AATAACAAAG AAGAAAACAT AAAAGTAGGG GTCAGTATAA AGCACGGGTA 24693 || | || | |||||||||| | |||||||| ||||||||| ||||||| | | ||| ||| GCATTACACA AATAACAAAG AGGAAAACAT GAAAGTAGGG GTCAGTA-CA ACCACACGTA 337 CTGAGTAGAT ATCATCGGCC AACTCAAAAT AGAAAACAGT ATATACCAAG TAATATCATA 24633 |||||||||| |||||||||| |||||||||| || |||||| ||||| ||| ||||| || CTGAGTAGAT ATCATCGGCC AACTCAAAAT AGGGAACAGT ATATATCAA- TAATAATGTA 396 AACTCAACTA TGATACTCAA CATGTAGCAA CAACAAGTAC TATAACATTA ACAATTTCCG 24573 || ||||||| |||||||| |||||||||| ||| | | | ||| | | || | | AA-TCAACTA CAATACTCAA CATGTAGCAA TAAC-ACCAT GAATTCATCA ATAACTACAA 454 TCAAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT CATTTGGGAA TTATGTTCAT 24513 | ||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||| |||||| CCGAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT CATTTGGGAA TTAAGTTCAT 514 TAGATTGAGT ATATT-AACA TCTTTTAAGA TTCATTATCT TTATTTCTCT TGTGTCGGTA 24454 |||||||||| ||||| | | ||||| |||| |||||||||| || || |||| |||||||||| TAGATTGAGT ATATTCATTA TCTTTCAAGA TTCATTATCT TTCTTCCTCT TGTGTCGGTA 574 CGTGACACTC CGCTCCCTTA TATTCATTAA TCCTCTTGTG TCGGTACGTG ACACTCCGAT 24394 |||||||||| || ||| || | ||| | | | | || ||| ||| ||||| ||||||||| CGTGACACTC CGATCCTCTA T-TTC--T-A T-C-CTGGTG CCGGAACGTG GCACTCCGAT 628 CCCCTACTAC TAT 24381 || | | | | ||| CCTC-A-TTC TAT 639 hqPGS_C01HBa0088L02.1-_SGN-E546506+ (24989 24381) ******************************************************************************** EST sequence 247 +strand 337 n (File: SGN-E357033+) 1 ACTGAATAGA TATCATCGCC CAACTCAAAA TAGAAATCAA TATATATCAA GNATTATCAT 61 AAAATCAACT ATGATACTCA ACATGTAGCA ACAACAAGCA CTATATCATT AACAATTACC 121 GTCACGTTCA CACATGAGGA CTCAAGCCTC AATACCATAC TCATTTGGGA ATCATGTTCA 181 TTAGATTTAG TATATTAACA TCTTTCAAGA TTCATTATCT TTATTTCTCT TGTGACGGAA 241 CATGACATTC CGCTCCCTCA TATTCATTAA TCCTCTTGTG TGAACACATG ACACTCCGAT 301 CCCCTAAATC TACATGACAG TTTCATGAAC GCTATCC Predicted gene structure (within gDNA segment 25869 to 23468): Exon 1 24693 24413 ( 281 n); cDNA 1 281 ( 281 n); score: 0.929 MATCH C01HBa0088L02.1- SGN-E357033+ 0.929 281 0.834 C PGS_C01HBa0088L02.1-_SGN-E357033+ (24693 24413) Alignment (genomic DNA sequence = upper lines): ACTGAGTAGA TATCATCGGC CAACTCAAAA TAGAAAACAG TATATACCAA GTAATATCAT 24634 ||||| |||| |||||||| | |||||||||| |||||| || |||||| ||| | | |||||| ACTGAATAGA TATCATCGCC CAACTCAAAA TAGAAATCAA TATATATCAA GNATTATCAT 60 AAACTCAACT ATGATACTCA ACATGTAGCA ACAACAAGTA CTATAACATT AACAATTTCC 24574 ||| |||||| |||||||||| |||||||||| |||||||| | ||||| |||| ||||||| || AAAATCAACT ATGATACTCA ACATGTAGCA ACAACAAGCA CTATATCATT AACAATTACC 120 GTCAAGTTCA CACATGAGGA CTCAAGCCTC AATACCATAC TCATTTGGGA ATTATGTTCA 24514 |||| ||||| |||||||||| |||||||||| |||||||||| |||||||||| || ||||||| GTCACGTTCA CACATGAGGA CTCAAGCCTC AATACCATAC TCATTTGGGA ATCATGTTCA 180 TTAGATTGAG TATATTAACA TCTTTTAAGA TTCATTATCT TTATTTCTCT TGTGTCGGTA 24454 ||||||| || |||||||||| ||||| |||| |||||||||| |||||||||| |||| ||| | TTAGATTTAG TATATTAACA TCTTTCAAGA TTCATTATCT TTATTTCTCT TGTGACGGAA 240 CGTGACACTC CGCTCCCTTA TATTCATTAA TCCTCTTGTG T 24413 | ||||| || |||||||| | |||||||||| |||||||||| | CATGACATTC CGCTCCCTCA TATTCATTAA TCCTCTTGTG T 281 hqPGS_C01HBa0088L02.1-_SGN-E357033+ (24693 24413) ******************************************************************************** EST sequence 111 -strand 236 n (File: SGN-E209683-) 1 CACAAATAAC AAGAAGATAA ACATAAAAGT AGGGGTCAGT ACAAACCACG GGTACTGAGT 61 AGATATCATC GGCCAACTCA AAATAGGGAA CAGTATGTAT TAAGCAATAT CATAAAATCA 121 ACTAATATCC TTAACATGCA GCATTTATAG TTACCATAAC CCTTGGTTAC AACACCAAGC 181 ACATCAATGA GGACTCACAC CTCCTCATCA TACTCATTTG GGAATTTAGT TCATTA Predicted gene structure (within gDNA segment 25518 to 22561): Exon 1 24746 24511 ( 236 n); cDNA 1 236 ( 236 n); score: 0.782 MATCH C01HBa0088L02.1- SGN-E209683- 0.782 236 1.000 C PGS_C01HBa0088L02.1-_SGN-E209683- (24746 24511) Alignment (genomic DNA sequence = upper lines): CAAAAATAAC AAAGAAGA-A AACATAAAAG TAGGGGTCAG TATAAAGCAC GGGTACTGAG 24688 || ||||||| || ||||| | |||||||||| |||||||||| || ||| ||| |||||||||| CACAAATAAC AA-GAAGATA AACATAAAAG TAGGGGTCAG TACAAACCAC GGGTACTGAG 59 TAGATATCAT CGGCCAACTC AAAATAGAAA ACAGTATATA CCAAGTAATA TCATAAACTC 24628 |||||||||| |||||||||| ||||||| | ||||||| || ||| |||| ||||||| || TAGATATCAT CGGCCAACTC AAAATAGGGA ACAGTATGTA TTAAGCAATA TCATAAAATC 119 AACTATGATA CTCAACATGT AGCAACAACA AGTACTATAA CATTAACAAT TTCCGTCAAG 24568 ||||| || || |||||| |||| | | ||| |||| | | | |||| AACTAATATC CTTAACATGC AGCATTTATA GTTACCATAA CCCTTGGTTA CAACACCAAG 179 TTCACACATG AGGACTCAAG CCTCAATACC ATACTCATTT GGGAATTATG TTCATTA 24511 || ||| |||||||| |||| | | |||||||||| ||||||| | ||||||| CACATCAATG AGGACTCACA CCTCCTCATC ATACTCATTT GGGAATTTAG TTCATTA 236 hqPGS_C01HBa0088L02.1-_SGN-E209683- (24746 24511) ******************************************************************************** EST sequence 40 -strand 729 n (File: SGN-E351546-) 1 AGTCGTTGCT CTAGTTCTAC CCATCTGGCA AGAGAGTGAG NATGGTCAGA TACCAATTCG 61 TATCGCTTAG ATACCAATTG ACTCGAAGTA GTAGCACGAA AGAAAGAATG AAAGAGTGAA 121 GTTTTCCTAA AGTCTTATAG CCTCTCAAGG AAAAGTAAAA GCGTCCCCCT ACCGTTCCTT 181 AAGACTCTAC TAGACTTGTT CTTGTGTGAT GAGACCAACG AACCTAATGC TCTGATACCA 241 AGTTTTGTCA CGACCCAAAT CCGGGCCGCC ACTGGCACCC ACACTTACCC TCCTATGTGA 301 GCGAACCAAC CAATCTAAAC CTTAACATTT CAATGTAATA GCAACAGAAA GTAATGCGGA 361 AGACTTAAAC TCATTAATAA AATCAATAAC TACTATTATT AAACATCTAT TATTCCCAAA 421 ACCTGGAAGT CATCATCACA AGAACATCTA CTTTAAACTA CTAATTCTAA GAGTTTCTAA 481 GAAGCTAAAA AATTACATAA GAAGCTAGTC CATGCCGGAA GTTCAAGGCA TCAAGACATG 541 AAGGAGAAGA TCCAGTCCAA GCTAGAAGCG TTAGCTCACC CTGAAGATCC GGTGTGACGA 601 AGACTGGCTT GAGTTACTGT TGAGTCGAAG ATGACGGCAC GTTTGCTGCA CTCCACAAAT 661 ACCAAGAAGA AAAACATAAA AGTAGGGGTC AGTACAAAAC ACGGCTACTG AGTAGATATC 721 ATCGGCCAA Predicted gene structure (within gDNA segment 28626 to 24071): Exon 1 25150 24671 ( 480 n); cDNA 239 729 ( 491 n); score: 0.831 MATCH C01HBa0088L02.1- SGN-E351546- 0.831 480 0.658 C PGS_C01HBa0088L02.1-_SGN-E351546- (25150 24671) Alignment (genomic DNA sequence = upper lines): CAATTTATGT CACGACCCAA ATCCTGGCCG GGACTGGCAC CCATATTTAC CCTTCTATGT 25091 ||| || ||| |||||||||| |||| ||||| |||||||| ||| | |||| ||| |||||| CAAGTTTTGT CACGACCCAA ATCCGGGCCG CCACTGGCAC CCACACTTAC CCTCCTATGT 298 GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATATAA TATCAGCAGA AAATAATGCG 25031 |||||||||| |||||||||| |||||||||| |||||| ||| || || |||| || ||||||| GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATGTAA TAGCAACAGA AAGTAATGCG 358 GAAGACTTAA ACTCGTTTAT AAAA--AA-A ACCA-AATCA ATAACTAT-T A-T-TCCCCA 24978 |||||||||| |||| || || |||| || | || | || | ||| || | | | | |||| GAAGACTTAA ACTCATTAAT AAAATCAATA ACTACTATTA TTAAACATCT ATTATTCCCA 418 AAATCTGGAA GTCATCATCA CAAGAACATC TATGATCAAA TTACTAA--C TAAAAATGTC 24920 ||| |||||| |||||||||| |||||||||| || | ||| |||||| | ||| | | || AAACCTGGAA GTCATCATCA CAAGAACATC TA-CTTTAAA CTACTAATTC TAAGAGTTTC 477 TAAGAAGCT- AAAAA-TACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 24862 ||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| |||||||||| TAAGAAGCTA AAAAATTACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 537 TTGAAGAAGA AGCTCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT TCCGATGT-A 24803 ||||| ||| || ||||||| |||||||||| || ||||||| |||||||| |||| ||| | ATGAAGGAGA AGATCCAGTC CAAGCTAGAA GCGTTAGCTC ACCCTGAAGA TCCGGTGTGA 597 GTAAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT ACACTCCAAA 24743 |||||||| ||||| |||| |||||||||| |||| ||||| |||||||||| ||||||| | CGAAGACTGG CTTGAGTTAC TGTTGAGTCG AAGATGACGG CACGTTTGCT GCACTCCACA 657 AATAACAAAG AAGAAAACAT AAAAGTAGGG GTCAGTATAA AGCACGGGTA CTGAGTAGAT 24683 |||| ||| | ||||||| |||||||||| ||||||| || | ||||| || |||||||||| AATACCAAGA AGAAAAACAT AAAAGTAGGG GTCAGTACAA AACACGGCTA CTGAGTAGAT 717 ATCATCGGCC AA 24671 |||||||||| || ATCATCGGCC AA 729 hqPGS_C01HBa0088L02.1-_SGN-E351546- (25150 24671) ******************************************************************************** EST sequence 79 -strand 580 n (File: SGN-E356206-) 1 GAAAAGTAAA AGCGTCCCCN TACCGTCCCT TAAGACTCTA CTAGACTTGT TCTTGTGTGA 61 TGAGACCAAC GACCCTAATG CTCTGATACC AAGTTTTGTC ACGACCCAAA TCCGGGCCGC 121 CACTGGCACC CACACTTACC CTCCTATGTG AGCGAACCAA CCAATCTAAA CCTTAACATT 181 TCAATGTAAT AGCAACAGAA AGTAATGCGG AAGACTTAAA CTCATTAATA AAATCAATAA 241 CTACTATTAT TAAACATCTA TTATTCCCAA AACCTGGAAG TCATCATCAC AAGAACATCT 301 ACTTTAAACT ACTAATTCTA AGAGTTTCTA AGAAGCTAAA AAATTACATA AGAAGCTAGT 361 CCATGCCGGA AGTTCAAGGC ATCAAGACAT GAAGGAGAAG ATCCAGTCCA AGCTAGAAGC 421 GTTAGCTCAC CCTGAAGATC CGGTGTGACG AAGACTGGCT TGAGTTACTG TTGAGTCGAA 481 GATGACGGCA CGTTTGCTGC ACTCCACAAA TAACAAGAAG AAAAACATAA AAGTAGGGGT 541 CAGTACAAAA CACGGCTACT GAGTAGATAT CATCGGCCAA Predicted gene structure (within gDNA segment 27136 to 24071): Exon 1 25150 24671 ( 480 n); cDNA 90 580 ( 491 n); score: 0.833 MATCH C01HBa0088L02.1- SGN-E356206- 0.833 480 0.828 C PGS_C01HBa0088L02.1-_SGN-E356206- (25150 24671) Alignment (genomic DNA sequence = upper lines): CAATTTATGT CACGACCCAA ATCCTGGCCG GGACTGGCAC CCATATTTAC CCTTCTATGT 25091 ||| || ||| |||||||||| |||| ||||| |||||||| ||| | |||| ||| |||||| CAAGTTTTGT CACGACCCAA ATCCGGGCCG CCACTGGCAC CCACACTTAC CCTCCTATGT 149 GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATATAA TATCAGCAGA AAATAATGCG 25031 |||||||||| |||||||||| |||||||||| |||||| ||| || || |||| || ||||||| GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATGTAA TAGCAACAGA AAGTAATGCG 209 GAAGACTTAA ACTCGTTTAT AAAA--AA-A ACCA-AATCA ATAACTAT-T A-T-TCCCCA 24978 |||||||||| |||| || || |||| || | || | || | ||| || | | | | |||| GAAGACTTAA ACTCATTAAT AAAATCAATA ACTACTATTA TTAAACATCT ATTATTCCCA 269 AAATCTGGAA GTCATCATCA CAAGAACATC TATGATCAAA TTACTAA--C TAAAAATGTC 24920 ||| |||||| |||||||||| |||||||||| || | ||| |||||| | ||| | | || AAACCTGGAA GTCATCATCA CAAGAACATC TA-CTTTAAA CTACTAATTC TAAGAGTTTC 328 TAAGAAGCT- AAAAA-TACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 24862 ||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| |||||||||| TAAGAAGCTA AAAAATTACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 388 TTGAAGAAGA AGCTCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT TCCGATGT-A 24803 ||||| ||| || ||||||| |||||||||| || ||||||| |||||||| |||| ||| | ATGAAGGAGA AGATCCAGTC CAAGCTAGAA GCGTTAGCTC ACCCTGAAGA TCCGGTGTGA 448 GTAAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT ACACTCCAAA 24743 |||||||| ||||| |||| |||||||||| |||| ||||| |||||||||| ||||||| | CGAAGACTGG CTTGAGTTAC TGTTGAGTCG AAGATGACGG CACGTTTGCT GCACTCCACA 508 AATAACAAAG AAGAAAACAT AAAAGTAGGG GTCAGTATAA AGCACGGGTA CTGAGTAGAT 24683 |||||||| | ||||||| |||||||||| ||||||| || | ||||| || |||||||||| AATAACAAGA AGAAAAACAT AAAAGTAGGG GTCAGTACAA AACACGGCTA CTGAGTAGAT 568 ATCATCGGCC AA 24671 |||||||||| || ATCATCGGCC AA 580 hqPGS_C01HBa0088L02.1-_SGN-E356206- (25150 24671) ******************************************************************************** EST sequence 87 -strand 655 n (File: SGN-E356696-) 1 CAATTGGACT CAAGTAGTAG CACGAAAGAA AGAATGAAAG AGTGAAGTTT TCCTAAAGTC 61 TTATAGCCTC TCAAGGAAAA GTAAAAGCGT CCCCCTACCG TTCCTTAAGA CTCTACTAGA 121 CTTGTTCTTG TGTGATGAGA CCAACGAACC TAATGCTCTG ATACCAAGTT TTGTCACGAC 181 CCAAATCCGG GCCGCCACTG GCACCCACAC TTACCCTCNT ATGTGAGCGA ACCAACCAAT 241 CTAAACCTTA ACATTTCAAT GTAATAGCAA CAGAAAGTAA TGCGGAAGAC TTAAACTCAT 301 TAATAAAATC AATAACTACT ATTATTAAAC ATCTATTATT CCCAAAACCT GGAAGTCATC 361 ATCACAAGAA CATCTACTTT AAACTACTAA TTCTAAGAGT TTCTAAGAAG CTAAAAAATT 421 ACATAAGAAG CTAGTCCATG CCGGAAGTTC AAGGCATCAA GACATGAAGG AGAAGATCCA 481 GTCCAAGCTA GAAGCGTTAG CTCACCCTGA AGATCCGGTG TGACGAAGAC TGGCTTGAGT 541 TACTGTTGAG TCGAAGATGA CGGCACGTTT GCTGCACTCC ACAAATAACA AGAAGAAAAA 601 CATAAAAGTA GGGGTCAGTA CAAAACACGG CTACTGAGTA GATATCATCG GCCAA Predicted gene structure (within gDNA segment 27895 to 24071): Exon 1 25150 24671 ( 480 n); cDNA 165 655 ( 491 n); score: 0.831 MATCH C01HBa0088L02.1- SGN-E356696- 0.831 480 0.733 C PGS_C01HBa0088L02.1-_SGN-E356696- (25150 24671) Alignment (genomic DNA sequence = upper lines): CAATTTATGT CACGACCCAA ATCCTGGCCG GGACTGGCAC CCATATTTAC CCTTCTATGT 25091 ||| || ||| |||||||||| |||| ||||| |||||||| ||| | |||| ||| ||||| CAAGTTTTGT CACGACCCAA ATCCGGGCCG CCACTGGCAC CCACACTTAC CCTCNTATGT 224 GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATATAA TATCAGCAGA AAATAATGCG 25031 |||||||||| |||||||||| |||||||||| |||||| ||| || || |||| || ||||||| GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATGTAA TAGCAACAGA AAGTAATGCG 284 GAAGACTTAA ACTCGTTTAT AAAA--AA-A ACCA-AATCA ATAACTAT-T A-T-TCCCCA 24978 |||||||||| |||| || || |||| || | || | || | ||| || | | | | |||| GAAGACTTAA ACTCATTAAT AAAATCAATA ACTACTATTA TTAAACATCT ATTATTCCCA 344 AAATCTGGAA GTCATCATCA CAAGAACATC TATGATCAAA TTACTAA--C TAAAAATGTC 24920 ||| |||||| |||||||||| |||||||||| || | ||| |||||| | ||| | | || AAACCTGGAA GTCATCATCA CAAGAACATC TA-CTTTAAA CTACTAATTC TAAGAGTTTC 403 TAAGAAGCT- AAAAA-TACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 24862 ||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| |||||||||| TAAGAAGCTA AAAAATTACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 463 TTGAAGAAGA AGCTCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT TCCGATGT-A 24803 ||||| ||| || ||||||| |||||||||| || ||||||| |||||||| |||| ||| | ATGAAGGAGA AGATCCAGTC CAAGCTAGAA GCGTTAGCTC ACCCTGAAGA TCCGGTGTGA 523 GTAAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT ACACTCCAAA 24743 |||||||| ||||| |||| |||||||||| |||| ||||| |||||||||| ||||||| | CGAAGACTGG CTTGAGTTAC TGTTGAGTCG AAGATGACGG CACGTTTGCT GCACTCCACA 583 AATAACAAAG AAGAAAACAT AAAAGTAGGG GTCAGTATAA AGCACGGGTA CTGAGTAGAT 24683 |||||||| | ||||||| |||||||||| ||||||| || | ||||| || |||||||||| AATAACAAGA AGAAAAACAT AAAAGTAGGG GTCAGTACAA AACACGGCTA CTGAGTAGAT 643 ATCATCGGCC AA 24671 |||||||||| || ATCATCGGCC AA 655 hqPGS_C01HBa0088L02.1-_SGN-E356696- (25150 24671) ******************************************************************************** EST sequence 127 +strand 434 n (File: SGN-E222578+) 1 TTTTTTTTTT TTTTTTTTTA ATAAAAACCA ATTCAATAAC TATCAATATT CAACATCTAT 61 TATTCCCAAA ACCTGGAAGT CATCATCACA AGAACATCTA CTTTAAACTA CTAATTCTAA 121 GAGTTTCTAA AAGCTAAAAA TACATAAGAA GCTAGTCCAT GCCGGAGGTT CAAGGCATCA 181 AGACATGAAG GAGAAGATCC AGTCCAAGCT AGACGCGTTA GCTCACCCTG AAGATCCGGT 241 GTGACGAAGA CTGGCTTGAG TTACTGTTGA GTCGAAGATG ACGGCACGTT TGCTGCACTC 301 CACAACTTTC TAGATGGGGA CTTTCTTCAA GGCTTCGAGA TGGAAACTTG CTTGCAGAGC 361 TTCGAGTGTT ACCAGCTTCA AGATGGAGTT TCAGTGATGA GGCTTGCTAG TCTCGAGTTT 421 TTTTTTTTTT TTTT Predicted gene structure (within gDNA segment 26815 to 22013): Exon 1 24989 24742 ( 248 n); cDNA 58 305 ( 248 n); score: 0.865 Intron 1 24741 22863 (1879 n); Pd: 0.000 (s: 0.92), Pa: 0.000 (s: 0) Exon 2 22862 22833 ( 30 n); cDNA 306 335 ( 30 n); score: 0.650 PPA cDNA 19 1 MATCH C01HBa0088L02.1- SGN-E222578+ 0.865 278 0.641 C PGS_C01HBa0088L02.1-_SGN-E222578+ (24989 24742,22862 22833) Alignment (genomic DNA sequence = upper lines): TATTATTCCC CAAAATCTGG AAGTCATCAT CACAAGAACA TCTATGATCA AATTACTAA- 24931 ||||||| || ||||| |||| |||||||||| |||||||||| |||| | | || |||||| TATTATT-CC CAAAACCTGG AAGTCATCAT CACAAGAACA TCTA-CTTTA AACTACTAAT 115 -CTAAAAATG TCTAAGAAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG 24872 |||| | | ||||| |||| |||||||||| |||||||||| |||||||||| || ||||||| TCTAAGAGTT TCTAA-AAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAGGTTCAAG 174 GCATCAAGAC TTGAAGAAGA AGCTCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT 24812 |||||||||| ||||| ||| || ||||||| ||||||||| || ||||||| |||||||| GCATCAAGAC ATGAAGGAGA AGATCCAGTC CAAGCTAGAC GCGTTAGCTC ACCCTGAAGA 234 TCCGATGT-A GTAAGACTGG CTTGAATTAC TGTTGAGTCG AAGACGACGG CACGTTTGCT 24753 |||| ||| | |||||||| ||||| |||| |||||||||| |||| ||||| |||||||||| TCCGGTGTGA CGAAGACTGG CTTGAGTTAC TGTTGAGTCG AAGATGACGG CACGTTTGCT 294 ACACTCCAAA AATAACAAAG AAGAAAACAT AAAAGTAGGG GTCAGTATAA AGCACGGGTA 24693 ||||||| | | GCACTCCACA A......... .......... .......... .......... .......... 305 CTGAGTAGAT ATCATCGGCC AACTCAAAAT AGAAAACAGT ATATACCAAG TAATATCATA 24633 .......... .......... .......... .......... .......... .......... 305 AACTCAACTA TGATACTCAA CATGTAGCAA CAACAAGTAC TATAACATTA ACAATTTCCG 24573 .......... .......... .......... .......... .......... .......... 305 TCAAGTTCAC ACATGAGGAC TCAAGCCTCA ATACCATACT CATTTGGGAA TTATGTTCAT 24513 .......... .......... .......... .......... .......... .......... 305 TAGATTGAGT ATATTAACAT CTTTTAAGAT TCATTATCTT TATTTCTCTT GTGTCGGTAC 24453 .......... .......... .......... .......... .......... .......... 305 GTGACACTCC GCTCCCTTAT ATTCATTAAT CCTCTTGTGT CGGTACGTGA CACTCCGATC 24393 .......... .......... .......... .......... .......... .......... 305 CCCTACTACT ATGTGTCGAA ACGTGATACT CCGATCCCCT AAATTCTACG TGTCGGTTCG 24333 .......... .......... .......... .......... .......... .......... 305 TGACACCCGA TCTCCTAAAT CTACGTGTCG GTTCGTGACA CCCGATCCCC TAATTCTACG 24273 .......... .......... .......... .......... .......... .......... 305 TGTCGGTTCG TGACACCCGG TCCCCTAATT CTACGTGTCG GTTCGTAACA CCCGATCCCC 24213 .......... .......... .......... .......... .......... .......... 305 TAATCTCATT CTATCAATTC ATCAAGCCTT CTCCCTTACC AAGGCATCAT CAATCTCATT 24153 .......... .......... .......... .......... .......... .......... 305 ACTTTAGTTC ATCAAGCCTT ATCCCTTACA AAGGCATCAT CATTAAAAAG AGATTAGGTT 24093 .......... .......... .......... .......... .......... .......... 305 TTTATCAAGA TTTGGGATTC GATAGCTTCA TCATGCTTAA TATAATCACA ATTATATAAT 24033 .......... .......... .......... .......... .......... .......... 305 CACGTTCATG CAAGCATACA ATTAAGCACA TAGCAGGGTT TACAATACTA TCAATACATA 23973 .......... .......... .......... .......... .......... .......... 305 TCATTCGCTA TTAAGAGTTT ACTACGAATA GTATGAAAAC CATAACCTAC CTTCACCGAA 23913 .......... .......... .......... .......... .......... .......... 305 GAATTGCGAT CAACAAGCTA TCTTCTCAAA ATCCTTGCTA TCCTCTTCGT TTCTCTCTCT 23853 .......... .......... .......... .......... .......... .......... 305 CTACTCGTTC TCTTTCTTTT TCTGTCTCTC TTTGTTCTTT CTATTTTTCT TATTCAAACC 23793 .......... .......... .......... .......... .......... .......... 305 CTCTTTCTTT TACCCTAATT AACATATAAT CAAGTGTAAA AGATGGCAAT AATAACCCAC 23733 .......... .......... .......... .......... .......... .......... 305 TAATTAACTT AAGGTTACCT CTTTTAACCC CCAAGTAATT AGACTTATTA ACATTAACCC 23673 .......... .......... .......... .......... .......... .......... 305 CCTAACTTTA TAATTTAAGC AGGAATAGTC AAAAACGTCC CTTAAAACGT ATAAAGAAAT 23613 .......... .......... .......... .......... .......... .......... 305 CCGACCCGGA CTGGGATTGC GCAACCTGTG ATGGGCCGTC GTGCCTGCGA CGGTCCGTCC 23553 .......... .......... .......... .......... .......... .......... 305 TGCAGGTCGT CGCAAAGTTC AGAGACCCAA ATTTCCACCA AGGGTCTGTG ACGGTCCGTC 23493 .......... .......... .......... .......... .......... .......... 305 CTGCCATTTC GTTACGAAGT TCAGAGAGTC GATTTCAGCA CCCAATTTTT AGATTTTCTA 23433 .......... .......... .......... .......... .......... .......... 305 AGTGTTTTGA AACGAGACCC TGTGACGGTC CGTCGTGCCC ATGACGGTCC GTCGCCTCAG 23373 .......... .......... .......... .......... .......... .......... 305 CCTGTTTTTC CAGAAATAAA ATCTGCTGCT CAAAACGACT AAACAGGTCG TTACAATAGA 23313 .......... .......... .......... .......... .......... .......... 305 TACCAATTTA CCCATCGTTC GTCCCCGAAC GATCACCAGA AGGAAAACGA GGGCGAAAAG 23253 .......... .......... .......... .......... .......... .......... 305 GAGTACCTGA ATCTGTAAAC AGATGTGGGT ATCTTTCTCG CATATCTGCC TCCTTCTCCC 23193 .......... .......... .......... .......... .......... .......... 305 AAGTGGCTTC TTCAACGGGT CGATTCTTCC ATTGAACTTT GATGGATGCA ATCTCCCTTG 23133 .......... .......... .......... .......... .......... .......... 305 ATCTCAACTT GCGAATTTCT CTATCTAGAA TGGCAACAGG CTCATCCTCA TAAGTCAAAT 23073 .......... .......... .......... .......... .......... .......... 305 TTTCATCAAG CAAGACTGAA TCCCAACGAA TAATATAGTT TCCATCCCCA TGGTATCTTT 23013 .......... .......... .......... .......... .......... .......... 305 TCAACATCGA CACATGGAAT ACCGGATGTA CTCCGGACAG CCCTGGAGGC AAGGCTAACT 22953 .......... .......... .......... .......... .......... .......... 305 TATAAGTCAC CTCCCCTACT CGCTTAAGTA CTTCAAATGG ACCAATATAC CTTGGGCTTA 22893 .......... .......... .......... .......... .......... .......... 305 GTTTACCTCT TTTACCAAAC CGCATCACCC CTTTCATTGG T-GAAACTTT CAACAAGACT 22834 ||||| | | | | ||||| | |||| || .......... .......... .......... CTTTC-TAGA TGGGGACTTT CTTCAAGGCT 334 T 22833 | T 335 hqPGS_C01HBa0088L02.1-_SGN-E222578+ (24989 24742) ******************************************************************************** EST sequence 195 +strand 840 n (File: SGN-E542084+) 1 TTTTTTTTTT TAGGGGAAAA TTTCTTACTT CTATAAATGT CACGACCCAA ATCGGATCGC 61 GACTGGCACC CACACTTACC CTGCTATGTG AGCGAACCAA CCAATCCAAA CCTTAACATT 121 TCAATGTAAT ATCAACATAA AGTAATGCGG AAGACTTAAA CTTATTAATG AAAACCAATT 181 CAATAACTAT TATTTCCCAA AATCTGGAAG TCATCATCAT AAGAACATCT ACTTCAAATT 241 ACTAAATCTA AGAGTTTCTA AGAAGCTAAA AAATACATAA AAGCTAGTCC ATGCCGGAAC 301 TTCAAGACAT CAAGACATGA AGAGGAAGAT CCAGTCCAAT CTAGAAAGCA TTAGCTCACC 361 CTGATATCCG AAGTAATGAA GACTGGCTAG AGTTACTGTT GAGTCGAAGA TGACGGCACG 421 TTTGCTAAAA TCAGTGGACG GAGGAGAAGG GAAAGCACAC CGGGAATGAG AAGAAGCTGA 481 AGGAGGAACC AAAGAGGAAT CCCATTGCAA AGTAAATGAG AGTGTAAGCT AGCAGACGCG 541 ATGGAAGAGC TTACGCAGAA ATAACACTCT CATTTGGTGA TTTAGTTTGG AGATCATCTG 601 AGACCTTCGT GTTGGACAAC ATCATCCATG AAGATGTCAT TAGAAAAGTT AGATGCTTTA 661 TATACATGTT GATAGTTCCT GACTACTCTA TTTCTTTTTC AGAAAGCCCC GAAATTTCTC 721 AGATGATAAA TGCTGTCTGT TTTGGAAAAC CATCTCTATG CAAAGATGAT GTTTGCTGCA 781 TTGAGGTGTC AATATTGGGA ATTTCAAGAA AATTATGCCT TGTAGAATAT GTACAGCAAC Predicted gene structure (within gDNA segment 26526 to 20012): Exon 1 25151 24747 ( 405 n); cDNA 30 432 ( 403 n); score: 0.853 PPA cDNA 11 1 MATCH C01HBa0088L02.1- SGN-E542084+ 0.853 405 0.482 C PGS_C01HBa0088L02.1-_SGN-E542084+ (25151 24747) Alignment (genomic DNA sequence = upper lines): TCAATTTATG TCACGACCCA AATCCTGGCC GGGACTGGCA CCCATATTTA CCCTTCTATG 25092 || || ||| |||||||||| ||| | | | | |||||||| |||| | ||| |||| ||||| TCTATAAATG TCACGACCCA AAT-CGGATC GCGACTGGCA CCCACACTTA CCCTGCTATG 88 TGAGCGAACC AACCAATCTA AACCTTAACA TTTCAATATA ATATCAGCAG AAAATAATGC 25032 |||||||||| |||||||| | |||||||||| ||||||| || |||||| || ||| |||||| TGAGCGAACC AACCAATCCA AACCTTAACA TTTCAATGTA ATATCAACAT AAAGTAATGC 148 GGAAGACTTA AACTCGTTTA TAAAAAAAAC CAAATCAATA ACTATTATTC CCCAAAATCT 24972 |||||||||| |||| | | ||| ||||| ||| |||||| ||||||||| |||||||||| GGAAGACTTA AACT--TAT- TAATGAAAAC CAATTCAATA ACTATTATTT CCCAAAATCT 205 GGAAGTCATC ATCACAAGAA CATCTATGAT CAAATTACT- AA-CTAAAAA TGTCTAAGAA 24914 |||||||||| |||| ||||| |||||| | ||||||||| || |||| | | |||||||| GGAAGTCATC ATCATAAGAA CATCTA-CTT CAAATTACTA AATCTAAGAG TTTCTAAGAA 264 GCT-AAAAAT ACATAAGAAG CTAGTCCATG CCGGAAGTTC AAGGCATCAA GACTTGAAGA 24855 ||| |||||| |||||| ||| |||||||||| |||||| ||| ||| |||||| ||| |||||| GCTAAAAAAT ACATAA-AAG CTAGTCCATG CCGGAACTTC AAGACATCAA GACATGAAGA 323 AGAAGCTCCA GTCCAAGCTA G-AAGCATTA GCTCACCCTG AATTTCCGAT GTAGT-AAGA 24797 |||| |||| |||||| ||| | |||||||| |||||||||| || ||||| ||| | |||| GGAAGATCCA GTCCAATCTA GAAAGCATTA GCTCACCCTG -ATATCCGAA GTAATGAAGA 382 CTGGCTTGAA TTACTGTTGA GTCGAAGACG ACGGCACGTT TGCTACACTC 24747 |||||| || |||||||||| |||||||| | |||||||||| ||||| | || CTGGCTAGAG TTACTGTTGA GTCGAAGATG ACGGCACGTT TGCTAAAATC 432 hqPGS_C01HBa0088L02.1-_SGN-E542084+ (25151 24747) ******************************************************************************** EST sequence 125 +strand 679 n (File: SGN-E370357+) 1 TTTTTTTTTT CTTACAATTA TATTATGAAT TCGATAATCT TTAATGTCAC GACCCAAATC 61 GAGCCGCAAG TGGCACCCAC ACTTACCCTC CTATGTGAGC GAACCAACCA ATACAAAATC 121 CAACATTTCA ATATAATGAC GGAATATAAT GCGGAAGACT TAAACTCATT AATGAAAATC 181 AATTAAATAA CTTCTAAAAA CTCAACAACT ATTATTATCC CCAAAATCTG GAAGTCATCA 241 TCACAAGAAC ATCTATCCTC AAATTACTAA TTCTAAGAGT ATCTAGAAAG CTAGAATAAC 301 TAAAAAGCTA GTCCATGCCG GAACTTCAAG GCATCAAGAC ATGAAGAAGA AGATCCAGTC 361 CAAGCTAGAA GCGTTAGCTC ACACTGAAAT CCGGTATAAT GAAGACTGGC TAGAGTTGCG 421 GTTGAGTTGA AGACGACGGT ACGTTTGCTT TATTCGAGTG TCAATTAATC ATTCGGCTGT 481 CACCCAAATA TTATTGATTG ATTACACCTC TGCCATTTGT AAAATTTTTC AAATTTGCCT 541 ACGGATGCAG AATTTTCCTC GAATTTCTGA TGTGTTTTCT TGTAAATAGT GGCCATTTGT 601 GTAAGTAAAT GCCCATTTCT CCTCCTACAA AGTCCAATTC CATTTTTCCC CCAATCCACC 661 ATGGCAACAC CACCTCCAA Predicted gene structure (within gDNA segment 26596 to 20550): Exon 1 25160 24748 ( 413 n); cDNA 29 454 ( 426 n); score: 0.729 Intron 1 24747 21458 (3290 n); Pd: 0.000 (s: 0.82), Pa: 0.488 (s: 0) Exon 2 21457 21422 ( 36 n); cDNA 455 489 ( 35 n); score: 0.583 PPA cDNA 13 1 MATCH C01HBa0088L02.1- SGN-E370357+ 0.729 449 0.661 C PGS_C01HBa0088L02.1-_SGN-E370357+ (25160 24748,21457 21422) Alignment (genomic DNA sequence = upper lines): ATATGAGCAT CAATTTATGT CACGACCCAA ATCCTGGCCG GGACTGGCAC CCATATTTAC 25101 || || || | || |||| |||||||||| ||| | ||| | |||||| ||| | |||| ATTCGATAAT C-TTTAATGT CACGACCCAA ATCGAG-CCG CAAGTGGCAC CCACACTTAC 86 CCTTCTATGT GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATATAA TATCAGCAGA 25041 ||| |||||| |||||||||| |||||| || | ||||| |||||||| | || | | || CCTCCTATGT GAGCGAACCA ACCAATACAA AATCCAACAT TTCAATAT-A -ATGA-CGGA 143 AAATAATGCG GAAGACTTAA ACTCGTTTAT --AAA--AA- -AAA---C-- C---AAA-TC 24996 | |||||||| |||||||||| |||| || || ||| || ||| | | ||| || ATATAATGCG GAAGACTTAA ACTCATTAAT GAAAATCAAT TAAATAACTT CTAAAAACTC 203 AATAACTATT A-T-TCCCCA AAATCTGGAA GTCATCATCA CAAGAACATC TATGATCAAA 24938 || ||||||| | | |||||| |||||||||| |||||||||| |||||||||| ||| ||||| AACAACTATT ATTATCCCCA AAATCTGGAA GTCATCATCA CAAGAACATC TATCCTCAAA 263 TTACTAA--C TAAAAATGTC TAAGAAGCTA AAAATACATA AGAAGCTAGT CCATGCCGGA 24880 ||||||| | ||| | | || || ||||| | |||| || | |||||||| |||||||||| TTACTAATTC TAAGAGTATC TAGAAAGCT- AGAATAACTA AAAAGCTAGT CCATGCCGGA 322 AGTTCAAGGC ATCAAGACTT GAAGAAGAAG CTCCAGTCCA AGCTAGAAGC ATTAGCTCAC 24820 | |||||||| |||||||| | |||||||||| ||||||||| |||||||||| ||||||||| ACTTCAAGGC ATCAAGACAT GAAGAAGAAG ATCCAGTCCA AGCTAGAAGC GTTAGCTCAC 382 CCTGAATTTC CGATGTAGT- AAGACTGGCT TGAATTACTG TTGAGTCGAA GACGACGGCA 24761 ||||| || || | || | |||||||||| || || | | |||||| ||| |||||||| | ACTGAA-ATC CGGTATAATG AAGACTGGCT AGAGTTGCGG TTGAGTTGAA GACGACGGTA 441 CGTTTGCTAC ACTCCAAAAA TAACAAAGAA GAAAACATAA AAGTAGGGGT CAGTATAAAG 24701 |||||||| | | CGTTTGCTTT ATT....... .......... .......... .......... .......... 454 CACGGGTACT GAGTAGATAT CATCGGCCAA CTCAAAATAG AAAACAGTAT ATACCAAGTA 24641 .......... .......... .......... .......... .......... .......... 454 ATATCATAAA CTCAACTATG ATACTCAACA TGTAGCAACA ACAAGTACTA TAACATTAAC 24581 .......... .......... .......... .......... .......... .......... 454 AATTTCCGTC AAGTTCACAC ATGAGGACTC AAGCCTCAAT ACCATACTCA TTTGGGAATT 24521 .......... .......... .......... .......... .......... .......... 454 ATGTTCATTA GATTGAGTAT ATTAACATCT TTTAAGATTC ATTATCTTTA TTTCTCTTGT 24461 .......... .......... .......... .......... .......... .......... 454 GTCGGTACGT GACACTCCGC TCCCTTATAT TCATTAATCC TCTTGTGTCG GTACGTGACA 24401 .......... .......... .......... .......... .......... .......... 454 CTCCGATCCC CTACTACTAT GTGTCGAAAC GTGATACTCC GATCCCCTAA ATTCTACGTG 24341 .......... .......... .......... .......... .......... .......... 454 TCGGTTCGTG ACACCCGATC TCCTAAATCT ACGTGTCGGT TCGTGACACC CGATCCCCTA 24281 .......... .......... .......... .......... .......... .......... 454 ATTCTACGTG TCGGTTCGTG ACACCCGGTC CCCTAATTCT ACGTGTCGGT TCGTAACACC 24221 .......... .......... .......... .......... .......... .......... 454 CGATCCCCTA ATCTCATTCT ATCAATTCAT CAAGCCTTCT CCCTTACCAA GGCATCATCA 24161 .......... .......... .......... .......... .......... .......... 454 ATCTCATTAC TTTAGTTCAT CAAGCCTTAT CCCTTACAAA GGCATCATCA TTAAAAAGAG 24101 .......... .......... .......... .......... .......... .......... 454 ATTAGGTTTT TATCAAGATT TGGGATTCGA TAGCTTCATC ATGCTTAATA TAATCACAAT 24041 .......... .......... .......... .......... .......... .......... 454 TATATAATCA CGTTCATGCA AGCATACAAT TAAGCACATA GCAGGGTTTA CAATACTATC 23981 .......... .......... .......... .......... .......... .......... 454 AATACATATC ATTCGCTATT AAGAGTTTAC TACGAATAGT ATGAAAACCA TAACCTACCT 23921 .......... .......... .......... .......... .......... .......... 454 TCACCGAAGA ATTGCGATCA ACAAGCTATC TTCTCAAAAT CCTTGCTATC CTCTTCGTTT 23861 .......... .......... .......... .......... .......... .......... 454 CTCTCTCTCT ACTCGTTCTC TTTCTTTTTC TGTCTCTCTT TGTTCTTTCT ATTTTTCTTA 23801 .......... .......... .......... .......... .......... .......... 454 TTCAAACCCT CTTTCTTTTA CCCTAATTAA CATATAATCA AGTGTAAAAG ATGGCAATAA 23741 .......... .......... .......... .......... .......... .......... 454 TAACCCACTA ATTAACTTAA GGTTACCTCT TTTAACCCCC AAGTAATTAG ACTTATTAAC 23681 .......... .......... .......... .......... .......... .......... 454 ATTAACCCCC TAACTTTATA ATTTAAGCAG GAATAGTCAA AAACGTCCCT TAAAACGTAT 23621 .......... .......... .......... .......... .......... .......... 454 AAAGAAATCC GACCCGGACT GGGATTGCGC AACCTGTGAT GGGCCGTCGT GCCTGCGACG 23561 .......... .......... .......... .......... .......... .......... 454 GTCCGTCCTG CAGGTCGTCG CAAAGTTCAG AGACCCAAAT TTCCACCAAG GGTCTGTGAC 23501 .......... .......... .......... .......... .......... .......... 454 GGTCCGTCCT GCCATTTCGT TACGAAGTTC AGAGAGTCGA TTTCAGCACC CAATTTTTAG 23441 .......... .......... .......... .......... .......... .......... 454 ATTTTCTAAG TGTTTTGAAA CGAGACCCTG TGACGGTCCG TCGTGCCCAT GACGGTCCGT 23381 .......... .......... .......... .......... .......... .......... 454 CGCCTCAGCC TGTTTTTCCA GAAATAAAAT CTGCTGCTCA AAACGACTAA ACAGGTCGTT 23321 .......... .......... .......... .......... .......... .......... 454 ACAATAGATA CCAATTTACC CATCGTTCGT CCCCGAACGA TCACCAGAAG GAAAACGAGG 23261 .......... .......... .......... .......... .......... .......... 454 GCGAAAAGGA GTACCTGAAT CTGTAAACAG ATGTGGGTAT CTTTCTCGCA TATCTGCCTC 23201 .......... .......... .......... .......... .......... .......... 454 CTTCTCCCAA GTGGCTTCTT CAACGGGTCG ATTCTTCCAT TGAACTTTGA TGGATGCAAT 23141 .......... .......... .......... .......... .......... .......... 454 CTCCCTTGAT CTCAACTTGC GAATTTCTCT ATCTAGAATG GCAACAGGCT CATCCTCATA 23081 .......... .......... .......... .......... .......... .......... 454 AGTCAAATTT TCATCAAGCA AGACTGAATC CCAACGAATA ATATAGTTTC CATCCCCATG 23021 .......... .......... .......... .......... .......... .......... 454 GTATCTTTTC AACATCGACA CATGGAATAC CGGATGTACT CCGGACAGCC CTGGAGGCAA 22961 .......... .......... .......... .......... .......... .......... 454 GGCTAACTTA TAAGTCACCT CCCCTACTCG CTTAAGTACT TCAAATGGAC CAATATACCT 22901 .......... .......... .......... .......... .......... .......... 454 TGGGCTTAGT TTACCTCTTT TACCAAACCG CATCACCCCT TTCATTGGTG AAACTTTCAA 22841 .......... .......... .......... .......... .......... .......... 454 CAAGACTTGT TCACCCTCCA TGAACTCTAA GTCTCTAACC TTTTGATCTG CATATTTCTT 22781 .......... .......... .......... .......... .......... .......... 454 TTGTCTACTT TGCGCCGCTA GAAGTTTTTC TTGAATAGAC TTCACTTTCT CTATCGAATC 22721 .......... .......... .......... .......... .......... .......... 454 CCTCAAAAGG TCAGTACCCC AAGGTCTAAC CTCGAATGCA TCAAACCAAC CAATGGGAGA 22661 .......... .......... .......... .......... .......... .......... 454 CCTACATCTC CTCCCATACA ATGCTTCAAA TGGGGTCATA TCAATACTTG AGTGATAGCT 22601 .......... .......... .......... .......... .......... .......... 454 ATTATTGTAT GAAAACTCCG CTAAGGGTAA AAAGCTATCC CAATGGCCAC CAAACTCTAT 22541 .......... .......... .......... .......... .......... .......... 454 CACACATGCA CGAAGCATAT CCTCCAACAC TTGAATCGTT CGCTCAGACT GACCATCGGT 22481 .......... .......... .......... .......... .......... .......... 454 CTGAGGATGG AACGCAGTAC TAAGGTCCAA CCTAGTACCC AATTGTATGC AATGTTTTCC 22421 .......... .......... .......... .......... .......... .......... 454 AAAACTTAGA AGTAAACTGC GTACCTCTAT CTGATATGAT GGATAGTGGA ACCCCATGCA 22361 .......... .......... .......... .......... .......... .......... 454 ATCGAACGAT TTCTGAGATA TAGATCTTGG CTAACTTCTC GGCATTGTAA GTCACCTTAA 22301 .......... .......... .......... .......... .......... .......... 454 CCGGAACGAA ATGAGCAGAC TTAGTTAACC TATCAACAAT CACCCAAATG GAGTCATACT 22241 .......... .......... .......... .......... .......... .......... 454 TACCCATCGT CTTTGGAAGA CCAACCACGA AGTCCATTGC GATTCTATCC CATTTCCATT 22181 .......... .......... .......... .......... .......... .......... 454 CCGGAATGGG CATCCTCTGA AGTGTTCCTC CGGGCCTTTG GTGTTCATAC TTTACTTGTT 22121 .......... .......... .......... .......... .......... .......... 454 GACAGTTTGG ACATTTGGCA ATAAAATCTA CAATATCACG CTTCATTCTA CTCCACCAAA 22061 .......... .......... .......... .......... .......... .......... 454 AGTGTTGCTT TAGGTCACGG TACATCTTGG TTGCACCCGG ATGTATTGAA TACCTTGAAC 22001 .......... .......... .......... .......... .......... .......... 454 TATGAGCCTT TGTCAGAATG GAGTTGATCA AATCATCGAC GCGGGGTACA CATACCCTTC 21941 .......... .......... .......... .......... .......... .......... 454 CCTTAATCCT CAAAACACCT TCCTCATCGA TCGTCGCTTC TTTAGCCTCT CCTCGCAACA 21881 .......... .......... .......... .......... .......... .......... 454 CTTTATCTCG GATCCGGATC AATTTTTCAT CATTAAACTG CTTTCCCTTA ATCTTGTCAA 21821 .......... .......... .......... .......... .......... .......... 454 GGAAGGAAGA TCTTGCCTCC ACACAAGCTA AAAGTCCTCC CTTCTCATTT ACTTCTAATC 21761 .......... .......... .......... .......... .......... .......... 454 TCATAAGGTC GTTAGCCAGA ATCTGAACTT CTCTAGCCAA TGGGCGTCTA GAAGCTTGCA 21701 .......... .......... .......... .......... .......... .......... 454 AGTGAGCTAG ACTTCCCATG CTTCCCGCCT TTCTACTTAA AGCATCCGCT ACAACATTCG 21641 .......... .......... .......... .......... .......... .......... 454 CCTTCCCCGG ATGATACAAA ATAGTGATGT CGTAGTTCTT CAGTAGTTCC ATCCATCTCC 21581 .......... .......... .......... .......... .......... .......... 454 TCTGTCTCAA GTTCAAATCT TTCTGAGTAA AGACATACTG TAGGCTACGA TGATCCGTGT 21521 .......... .......... .......... .......... .......... .......... 454 AGACCTCACA CTTAACCCCA TATAAATAGT GTCTCCATTG CTTTAATGCA AACAATACCG 21461 .......... .......... .......... .......... .......... .......... 454 CAGCCAATTC CAAATCATGA GTTGGATAGT TACGTTAAT 21422 | | | ||| | || | | || | || || ||| ...CGAGTGT CAATTAATCA TTCGGCT-GT CACCCAAAT 489 hqPGS_C01HBa0088L02.1-_SGN-E370357+ (25160 24748) ******************************************************************************** EST sequence 253 +strand 710 n (File: SGN-E392027+) 1 CCACAGCCCC AGTGGCTGGC TCAGTCGCAC CCTGTCCCGC CGGTGCTGGT GTTGATGCTG 61 GCGTAGTCGT TGCTCTAGTT CTAACCATCT GCGAAATAGA GTGAAGATGG TCAGATACCA 121 ATTTGTATCA CCTAGATACC AATTGGACCC AAGTAATAGC ACGAAAGAAG AAAGAATGGA 181 ATTTTCCAAA AGTCTTATAG CCTCTCAAGG AAAAGTAAAG GCATCCCCCT ACCGTTCCTT 241 AAGACTCTAC TAGACTCGTT CTTGTGTGAT GAGACCAACG AACCTAATGC TCTGATACCA 301 AGTTTGTCAC GACCAAAACC GGGTTGCGAC TGGCACCCAC ACTTACCCTC CTATGTGAGC 361 GAACCAACCA ATCTAACCTT AACATTTCAA TATAATATCA ACAGAAAGTA ATGTGGAAGA 421 CTTAAACTCA TTAAATACAG ACCAATTCAT TAACTTCTAA AATTCAACAT CTATTATTCC 481 CCAAAATCTG GAAGTCATCA CCACAAGAAC ATCTACGATC AAATGACTAA ACTAAGAGTA 541 GTCTAAAAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG GCATCAAGAC 601 TTGAAGAAGA AGATCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT TCCGATGTAG 661 TAAGACTGGC TTGAATTACT GTTGAGTTGA ACACGATGGC ACGTTTGCTG Predicted gene structure (within gDNA segment 29196 to 23935): Exon 1 25150 24753 ( 398 n); cDNA 299 709 ( 411 n); score: 0.820 MATCH C01HBa0088L02.1- SGN-E392027+ 0.820 398 0.561 C PGS_C01HBa0088L02.1-_SGN-E392027+ (25150 24753) Alignment (genomic DNA sequence = upper lines): CAATTTATGT CACGACCCAA ATCCTGGCCG GGACTGGCAC CCATATTTAC CCTTCTATGT 25091 ||| || ||| ||||| |||| | || || | ||||||||| ||| | |||| ||| |||||| CAAGTT-TGT CACGA-CCAA AACCGGGTTG CGACTGGCAC CCACACTTAC CCTCCTATGT 356 GAGCGAACCA ACCAATCTAA ACCTTAACAT TTCAATATAA TATCAGCAGA AAATAATGCG 25031 |||||||||| |||||||| | |||||||||| |||||||||| ||||| |||| || ||||| | GAGCGAACCA ACCAATCT-A ACCTTAACAT TTCAATATAA TATCAACAGA AAGTAATGTG 415 GAAGACTTAA ACTCGTT-TA TA-A-A--AA ---A--AAC- -C--AAA-TC AATAACTATT 24986 |||||||||| |||| || | || | | || | ||| | ||| || || | ||||| GAAGACTTAA ACTCATTAAA TACAGACCAA TTCATTAACT TCTAAAATTC AACATCTATT 475 ATTCCCCAAA ATCTGGAAGT CATCATCACA AGAACATCTA TGATCAAATT ACT-AACTAA 24927 |||||||||| |||||||||| ||||| |||| |||||||||| |||||||| ||| |||||| ATTCCCCAAA ATCTGGAAGT CATCACCACA AGAACATCTA CGATCAAATG ACTAAACTAA 535 AAAT-GTCTA AGAAGCTAAA AATACATAAG AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT 24868 | | ||||| | |||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAGTAGTCTA A-AAGCTAAA AATACATAAG AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT 594 CAAGACTTGA AGAAGAAGCT CCAGTCCAAG CTAGAAGCAT TAGCTCACCC TGAATTTCCG 24808 |||||||||| |||||||| | |||||||||| |||||||||| |||||||||| |||||||||| CAAGACTTGA AGAAGAAGAT CCAGTCCAAG CTAGAAGCAT TAGCTCACCC TGAATTTCCG 654 ATGTAGTAAG ACTGGCTTGA ATTACTGTTG AGTCGAAGAC GACGGCACGT TTGCT 24753 |||||||||| |||||||||| |||||||||| ||| ||| || || ||||||| ||||| ATGTAGTAAG ACTGGCTTGA ATTACTGTTG AGTTGAACAC GATGGCACGT TTGCT 709 hqPGS_C01HBa0088L02.1-_SGN-E392027+ (25150 24753) ******************************************************************************** EST sequence 25 -strand 299 n (File: SGN-E373117-) 1 TTTTTTTTTT TCTAAAAACT CAACAACTAT TATTATCCCC AAAATCTGGA AGTCATCATC 61 ACAAGAACAT CTACTTCAAA TTACTAAATC TAAGAGTATC TAAGAAGCTA AAATACATAA 121 ACAGCTAGTC CATGCCGGAA CTTCAAGGCA TCAAGACATG AAGAAGAAGA TCCAGTCCAA 181 GCTAGAAGCG TTAGCTCACC CTGAAATCCG ATGTAATGAA GACTGGCTAG AGTTGCGGTT 241 GAGTTGAAGA CGACGGTACG TTTGCCAAAA TTACGACAGT ATTTGGACAA GCTAGAAGA Predicted gene structure (within gDNA segment 25943 to 23130): Exon 1 25015 24764 ( 252 n); cDNA 6 255 ( 250 n); score: 0.843 MATCH C01HBa0088L02.1- SGN-E373117- 0.843 252 0.843 C PGS_C01HBa0088L02.1-_SGN-E373117- (25015 24764) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATCTGGAAGT CATCATCACA 24956 ||| | || |||| || | || | |||| | |||||||| |||||||||| |||||||||| TTTTTTCTAA AAACTCAA-C AACTATTATT A-TCCCCAAA ATCTGGAAGT CATCATCACA 63 AGAACATCTA TGATCAAATT ACTAA--CTA AAAATGTCTA AGAAGCTAAA AATACATAAG 24898 |||||||||| ||||||| ||||| ||| | | | |||| ||||||| || ||||||||| AGAACATCTA -CTTCAAATT ACTAAATCTA AGAGTATCTA AGAAGCT-AA AATACATAAA 121 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 24838 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCAT TAGCTCACCC TGAATTTCCG ATGTAGT-AA GACTGGCTTG AATTACTGTT 24779 |||||||| | |||||||||| |||| |||| ||||| | || |||||||| | | || | ||| CTAGAAGCGT TAGCTCACCC TGAA-ATCCG ATGTAATGAA GACTGGCTAG AGTTGCGGTT 240 GAGTCGAAGA CGACG 24764 |||| ||||| ||||| GAGTTGAAGA CGACG 255 hqPGS_C01HBa0088L02.1-_SGN-E373117- (25015 24764) ******************************************************************************** EST sequence 173 +strand 299 n (File: SGN-E373116+) 1 TTTTTTTTTT CTAAAAACTC AACAACTATT ATTATCCCCA AAATCTGGAA GTCATCATCA 61 CAAGAACATC TACTTCAAAT TACTAAATCT AAGAGTATCT AAGAAGCTAA AATACATAAA 121 CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCGT TAGCTCACCC TGAAATCCGA TGTAATGAAG ACTGGCTAGA GTTGCGGTTG 241 AGTTGAAGAC GACGGTACGT TTGCCAAAAT TACGACAGTA TTTGGACAAG CTAGAAGAG Predicted gene structure (within gDNA segment 25923 to 23110): Exon 1 25015 24764 ( 252 n); cDNA 5 254 ( 250 n); score: 0.843 MATCH C01HBa0088L02.1- SGN-E373116+ 0.843 252 0.843 C PGS_C01HBa0088L02.1-_SGN-E373116+ (25015 24764) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATCTGGAAGT CATCATCACA 24956 ||| | || |||| || | || | |||| | |||||||| |||||||||| |||||||||| TTTTTTCTAA AAACTCAA-C AACTATTATT A-TCCCCAAA ATCTGGAAGT CATCATCACA 62 AGAACATCTA TGATCAAATT ACTAA--CTA AAAATGTCTA AGAAGCTAAA AATACATAAG 24898 |||||||||| ||||||| ||||| ||| | | | |||| ||||||| || ||||||||| AGAACATCTA -CTTCAAATT ACTAAATCTA AGAGTATCTA AGAAGCT-AA AATACATAAA 120 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 24838 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 180 CTAGAAGCAT TAGCTCACCC TGAATTTCCG ATGTAGT-AA GACTGGCTTG AATTACTGTT 24779 |||||||| | |||||||||| |||| |||| ||||| | || |||||||| | | || | ||| CTAGAAGCGT TAGCTCACCC TGAA-ATCCG ATGTAATGAA GACTGGCTAG AGTTGCGGTT 239 GAGTCGAAGA CGACG 24764 |||| ||||| ||||| GAGTTGAAGA CGACG 254 hqPGS_C01HBa0088L02.1-_SGN-E373116+ (25015 24764) ******************************************************************************** EST sequence 262 +strand 265 n (File: SGN-E216150+) 1 TTTTTTTTTT TTTTTTTTAA TAAAAATCAA TAATCAACTT GTATAACTCA AAACTTATCA 61 TTCCCCAAAA TCTGGAAGTC ATCATCACCA GAGCCTCTAT CATAAAATTA CTAAACTAAG 121 AGTATTCTAA GAAGCTAAAA ATACATACGA AGCTAGTCCA TGCCGGAAGT TCAAGGCATC 181 AAGACTTGAA GAAGAAGATC CAGTCAAACC TAGAAGCATT AGCTCACCCT GAATTTCCGA 241 TGTAGTAGGA CTGGCTTGAG TTACT Predicted gene structure (within gDNA segment 26771 to 24010): Exon 1 24989 24782 ( 208 n); cDNA 56 265 ( 210 n); score: 0.904 PPA cDNA 18 1 MATCH C01HBa0088L02.1- SGN-E216150+ 0.904 208 0.785 C PGS_C01HBa0088L02.1-_SGN-E216150+ (24989 24782) Alignment (genomic DNA sequence = upper lines): TATTATTCCC CAAAATCTGG AAGTCATCAT CACAAGAACA TCTATGATCA AATTACT-AA 24931 ||| |||||| |||||||||| |||||||||| ||| ||| | ||||| || | ||||||| || TATCATTCCC CAAAATCTGG AAGTCATCAT CACCAGAGCC TCTATCATAA AATTACTAAA 115 CTAAAAAT-G TCTAAGAAGC TAAAAATACA TAAGAAGCTA GTCCATGCCG GAAGTTCAAG 24872 |||| | | |||||||||| |||||||||| || ||||||| |||||||||| |||||||||| CTAAGAGTAT TCTAAGAAGC TAAAAATACA TACGAAGCTA GTCCATGCCG GAAGTTCAAG 175 GCATCAAGAC TTGAAGAAGA AGCTCCAGTC CAAGCTAGAA GCATTAGCTC ACCCTGAATT 24812 |||||||||| |||||||||| || ||||||| || |||||| |||||||||| |||||||||| GCATCAAGAC TTGAAGAAGA AGATCCAGTC AAACCTAGAA GCATTAGCTC ACCCTGAATT 235 TCCGATGTAG TAAGACTGGC TTGAATTACT 24782 |||||||||| || ||||||| |||| ||||| TCCGATGTAG TAGGACTGGC TTGAGTTACT 265 hqPGS_C01HBa0088L02.1-_SGN-E216150+ (24989 24782) ******************************************************************************** EST sequence 47 -strand 219 n (File: SGN-E298638-) 1 TTTTTTTTTT TCTAAAAACT CAACAACTAT TATTATCCCC AAAATCTGGC AGTCATCATC 61 ACAAGAACAT GTACTTCAAA TTACTAAATC TAAGAGTATC TAAGAAGCTA AAATACATAA 121 ACAGCTAGTC CATGCCGGAA CTTCAAGGCA TCAAGACATG AAGAAGAAGA TCCAGTCCAA 181 GCTAGAAGCG TTAGCTCACC CTGAAATCCG ATGTAATGA Predicted gene structure (within gDNA segment 26726 to 23930): Exon 1 25015 24803 ( 213 n); cDNA 6 215 ( 210 n); score: 0.845 MATCH C01HBa0088L02.1- SGN-E298638- 0.845 213 0.973 C PGS_C01HBa0088L02.1-_SGN-E298638- (25015 24803) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATCTGGAAGT CATCATCACA 24956 ||| | || |||| || | || | |||| | |||||||| |||||| ||| |||||||||| TTTTTTCTAA AAACTCAA-C AACTATTATT A-TCCCCAAA ATCTGGCAGT CATCATCACA 63 AGAACATCTA TGATCAAATT ACT-AA-CTA AAAATGTCTA AGAAGCTAAA AATACATAAG 24898 ||||||| || ||||||| ||| || ||| | | | |||| ||||||| || ||||||||| AGAACATGTA -CTTCAAATT ACTAAATCTA AGAGTATCTA AGAAGCT-AA AATACATAAA 121 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 24838 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCAT TAGCTCACCC TGAATTTCCG ATGTA 24803 |||||||| | |||||||||| |||| |||| ||||| CTAGAAGCGT TAGCTCACCC TGAA-ATCCG ATGTA 215 hqPGS_C01HBa0088L02.1-_SGN-E298638- (25015 24803) ******************************************************************************** EST sequence 35 -strand 402 n (File: SGN-E352844-) 1 TTTTTTTTAT AAAAACCAAT TCAATAACTA TTATTTCCCA AAATCTGGAA GTTATCATCA 61 CAAGAACATC TACTTCGAAT TACTAAATCT AAGAGTATCT AAGAAGCTAA AATACATAAA 121 CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 181 CTAGAAGCTT TGTTTTATCG AAAAAAGGTG ATTTTTCGAA AAGAGTTTGT TTTATTTTAA 241 AGTATTTTTC GACTTTAGGA GTCGCCACTT AATTTTTAAG AAAAATCAAG AAAACTCATT 301 CTCAAAACAA TTTAAACAGA AAAGTCGTTT TGAAAATATT TTTTAGGATT CGGGATTCTT 361 ATTAGCGTCT TAGGAAGGTG TTTAAGGCAC CTAAGACACT CC Predicted gene structure (within gDNA segment 25951 to 22090): Exon 1 25015 24830 ( 186 n); cDNA 3 188 ( 186 n); score: 0.871 MATCH C01HBa0088L02.1- SGN-E352844- 0.871 186 0.463 C PGS_C01HBa0088L02.1-_SGN-E352844- (25015 24830) Alignment (genomic DNA sequence = upper lines): TTTATAAAAA AAACCAAATC AATAACTATT ATTCCCCAAA ATCTGGAAGT CATCATCACA 24956 ||| | | || ||||||| || |||||||||| ||| |||||| |||||||||| ||||||||| TTTTTTATAA AAACCAATTC AATAACTATT ATTTCCCAAA ATCTGGAAGT TATCATCACA 62 AGAACATCTA TGATCAAATT ACT-AA-CTA AAAATGTCTA AGAAGCTAAA AATACATAAG 24898 |||||||||| || |||| ||| || ||| | | | |||| |||||||||| |||||||| AGAACATCTA -CTTCGAATT ACTAAATCTA AGAGTATCTA AGAAGCTAAA -ATACATAAA 120 AAGCTAGTCC ATGCCGGAAG TTCAAGGCAT CAAGACTTGA AGAAGAAGCT CCAGTCCAAG 24838 ||||||||| ||||||||| |||||||||| |||||| ||| |||||||| | |||||||||| CAGCTAGTCC ATGCCGGAAC TTCAAGGCAT CAAGACATGA AGAAGAAGAT CCAGTCCAAG 180 CTAGAAGC 24830 |||||||| CTAGAAGC 188 hqPGS_C01HBa0088L02.1-_SGN-E352844- (25015 24830) ******************************************************************************** EST sequence 73 -strand 666 n (File: SGN-E368629-) 1 TTTTTTTTTT TTTTTTTTTT TTTTTTATAA AAACCAATTC AATAACTATT ATTTCCCAAA 61 ATCTGGAAGT TATCATCACA AGAACATCTA CTTCGAATTA CTAAATCTAG AAGTATCTAA 121 GAGCCTAAAA TACATAACAC AGTTAGTCCA TGCCGAAACT TCAAGGCATC AAGACATAAA 181 GAAGAAGATC CAGTCCAAGC TAGAAGCTTT GTTTTATCGA AAAAAGGTGA TTTTTCGAAA 241 AGAGTTTGTT TTATTTTAAA GTATTTTTCG ACTTTAGGAG TCGCCACTTA ATTTTTAAGA 301 AAAATCAAGA AAACTCATTC TCAAAACAAT TTAAACAGAA AAGTCGTTTT GAAAATATTT 361 TTTAGGATTC GGGATTCTTA TTAGCGTCTT AGGAAGGTGT TTAAGGCACC TAAGACACTC 421 CGTTAAATAC GGTTTTCCAA CGACTAACTT ATTTGATTAT TTTTATTTTT ACCCTTTGCA 481 AATTTATTTG AACTTTTATC ACGATTTACT TAGCCAAACT TTGCAAATTT GAGATATTAA 541 TCTTTTAAGA TTCCGTCTTA GTTAAACTTT CTAAGCCTTA ACTCTCTAAG CAGACTTTCA 601 AATTTTAAAC CTCTATCGTT TCAAAACTTC AATTTTTATT TTTTAGTTTC ATAAAGCAAA 661 AGGCGT Predicted gene structure (within gDNA segment 26131 to 19640): Exon 1 25007 24830 ( 178 n); cDNA 29 207 ( 179 n); score: 0.846 PPA cDNA 28 1 MATCH C01HBa0088L02.1- SGN-E368629- 0.846 178 0.267 C PGS_C01HBa0088L02.1-_SGN-E368629- (25007 24830) Alignment (genomic DNA sequence = upper lines): AAAAACCAAA TCAATAACTA TTATTCCCCA AAATCTGGAA GTCATCATCA CAAGAACATC 24948 ||||||||| |||||||||| ||||| |||| |||||||||| || ||||||| |||||||||| AAAAACCAAT TCAATAACTA TTATTTCCCA AAATCTGGAA GTTATCATCA CAAGAACATC 88 TATGATCAAA TTACT-AA-C TAAAAATGTC TAAGAAGCTA AAAATACATA AGA-AGCTAG 24891 || || || ||||| || | || || | || |||| ||| |||||||||| | | || ||| TA-CTTCGAA TTACTAAATC TAGAAGTATC TAAG-AGCCT AAAATACATA ACACAGTTAG 146 TCCATGCCGG AAGTTCAAGG CATCAAGACT TGAAGAAGAA GCTCCAGTCC AAGCTAGAAG 24831 ||||||||| || ||||||| ||||||||| | |||||||| | |||||||| |||||||||| TCCATGCCGA AACTTCAAGG CATCAAGACA TAAAGAAGAA GATCCAGTCC AAGCTAGAAG 206 C 24830 | C 207 hqPGS_C01HBa0088L02.1-_SGN-E368629- (25007 24830) ******************************************************************************** EST sequence 63 -strand 620 n (File: SGN-E238551-) 1 CTATTATTTC CCAAAATCTG GAAGTTATCA TCACAAGAAC ATCTACTTCG AATTACTAAA 61 TCTAAGAGTA TCTAAGAAGC TAAAATACAT AAACAGCTAG TCCATGCCGG AACTTCAAGG 121 CATCAAGACA TGAAGAAGAA GATCCAGTCC AAGCTAGAAG CTTTGTTTTA TCGAAAAAAG 181 GTGATTTTTC GAAAAGAGTT TGTTTTATTT TAAAGTATTT TTCGACTTTA GGAGTCGCCA 241 CTTAATTTTT AAGAAAAATC AAGAAAACTC ATTCTCAAAA CAATTTAAAC AGAAAAGTCG 301 TTTTGAAAAT ATTTTTTAGG ATTCGGGATT CTTATTAGCG TCTTAGGAAG GTGTTTAAGG 361 CACCTAAGAC ACTCCGTTAA ATACGGTTTT CCAACGACTA ACTTATTTGA TTATTTTTAT 421 TTTTACCCTT TGCAAATTTA TTTGAACTTT TATCACGATT TACTTAGCCA AACTTTGCAA 481 ATTTGAGATA TTAATCTTTT AAGATTCCGT CTTAGTTAAA CTTTCTAAGC CTTAACTCTC 541 TAAGCAGACT TTCAAATTTT AAACCTCTAT CGTTTCAAAA CTTCAATTTT TATTTTTTAG 601 TTTCATAAAG CAAAAGGCGT Predicted gene structure (within gDNA segment 25681 to 19640): Exon 1 24990 24830 ( 161 n); cDNA 1 161 ( 161 n); score: 0.876 MATCH C01HBa0088L02.1- SGN-E238551- 0.876 161 0.260 C PGS_C01HBa0088L02.1-_SGN-E238551- (24990 24830) Alignment (genomic DNA sequence = upper lines): CTATTATTCC CCAAAATCTG GAAGTCATCA TCACAAGAAC ATCTATGATC AAATTACT-A 24932 |||||||| | |||||||||| ||||| |||| |||||||||| ||||| || ||||||| | CTATTATTTC CCAAAATCTG GAAGTTATCA TCACAAGAAC ATCTA-CTTC GAATTACTAA 59 A-CTAAAAAT GTCTAAGAAG CTAAAAATAC ATAAGAAGCT AGTCCATGCC GGAAGTTCAA 24873 | |||| | | ||||||||| || ||||||| |||| |||| |||||||||| |||| ||||| ATCTAAGAGT ATCTAAGAAG CT-AAAATAC ATAAACAGCT AGTCCATGCC GGAACTTCAA 118 GGCATCAAGA CTTGAAGAAG AAGCTCCAGT CCAAGCTAGA AGC 24830 |||||||||| | |||||||| ||| |||||| |||||||||| ||| GGCATCAAGA CATGAAGAAG AAGATCCAGT CCAAGCTAGA AGC 161 hqPGS_C01HBa0088L02.1-_SGN-E238551- (24990 24830) ******************************************************************************** EST sequence 28 +strand 484 n (File: SGN-E202664+) 1 TACCCTAGGC ATAAAAGGGT CACTGTAACG ATTCAAAAAA AAAGAATGAT ATAAATAAGA 61 ATAAATAGGT ATTTAAGGGC ATAATTGTCC TTTCACGTTT TAAATGAATA AATAAATAAA 121 TAAGTAAATA AATAAAATAG ATTTGTATTT ATTTATTTTA AATGTTATTT GACTAATTCT 181 TGAATTAGTC TCCTAATCCA AATAGTCCTC TCTCTCTCAC GCTTCTTAAC TCCCTCTCTC 241 ACGTCCTCCA TCTTCCTCAC ATTATTTCTG ACAAAACATC AACAGTTTTC ATGCTTGAAG 301 AACTAACAAA AATTTTTTAA GCAAAAGAAA AAGTAATCAA AACGTCAAGG CTAAGAGAGG 361 TTTGTCGAGA GAGGTGTACG TTGAAGTGAA TTGGGAGTGC TTTGGAGGAG TTTTCCGGGT 421 AACAACATTA AAGTTTGAAC ATCGATTAAG GTATGAGTTT TCTTCTCTCT CGGTCCCTTT 481 CCCA Predicted gene structure (within gDNA segment 26895 to 31947): Exon 1 28026 28054 ( 29 n); cDNA 85 112 ( 28 n); score: 0.759 Intron 1 28055 28626 ( 572 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.92) Exon 2 28627 28731 ( 105 n); cDNA 113 216 ( 104 n); score: 0.933 MATCH C01HBa0088L02.1+ SGN-E202664+ 0.933 134 0.277 C PGS_C01HBa0088L02.1+_SGN-E202664+ (28026 28054,28627 28731) Alignment (genomic DNA sequence = upper lines): TTTAACTATT CAACTTTTAA ATAAATAAAC ACATGAGTCC TACATGAAAC AATACACGTA 28085 || || || || |||||| || |||||| TTGTCCT-TT CACGTTTTAA ATGAATAAA. .......... .......... .......... 112 GGACACCATG TAGGATAAAA AAATGACATA TAAGATGACA TGTAGGACAT GTGTGTCTAT 28145 .......... .......... .......... .......... .......... .......... 112 TTGTTCAACT TTATATAAGT TTAAGTGTCT ATTTGAGCAC ATCCAAAGTT GAAAAGGATA 28205 .......... .......... .......... .......... .......... .......... 112 AATGTGATTT GAAGCCAAGT TAAAGGGCAC ATTTATGTAT TATCCCTTTT AAAATCAAAG 28265 .......... .......... .......... .......... .......... .......... 112 GAAATCTCTC TATTTATAAA AAACAAAATG TAGTGTGAAC ATATGTTTAT TGTGTCTTAT 28325 .......... .......... .......... .......... .......... .......... 112 TAGAAAGGTT ACAACTATTT GGAAAAGGTG CAATCCTTCA GAAATTTCAC AATCTTTCTT 28385 .......... .......... .......... .......... .......... .......... 112 AAAAAGTCGA AACTTTTCAT AAAGTCCCAA TTTTTTATTG AAGTCGCAAC TTTTCATAAA 28445 .......... .......... .......... .......... .......... .......... 112 AGTCACAACT TTTCATAAAA GCCGAAAATC TTCATTAAAG TCACAATTTT TCATAAAAGT 28505 .......... .......... .......... .......... .......... .......... 112 GACAACTTTT AGTAAAAGTC GCAACTCTTC ACTAAAGTCA CAACTTTTCT GTAACGATCC 28565 .......... .......... .......... .......... .......... .......... 112 AATTTTTTTA TATAAATAAG AATAAATAGG TATTTAAGGG CATAATGGTC CTTTCACGTT 28625 .......... .......... .......... .......... .......... .......... 112 CTAAATGAAT AAATAAATAA ATAAAAACAG ATTTGTATTT ATTTATTTTA AATTTTATTT 28685 ||||| ||| || ||||||| || |||| || |||||||||| |||||||||| ||| |||||| .TAAATAAAT AAGTAAATAA AT-AAAATAG ATTTGTATTT ATTTATTTTA AATGTTATTT 170 GACTAATTCT TGAATTAGTC TCCTAATCCT AATAGTTCTC TCTCTC 28731 |||||||||| |||||||||| ||||||||| |||||| ||| |||||| GACTAATTCT TGAATTAGTC TCCTAATCCA AATAGTCCTC TCTCTC 216 hqPGS_C01HBa0088L02.1+_SGN-E202664+ (28026 28054,28627 28731) ******************************************************************************** EST sequence 221 -strand 687 n (File: SGN-E332471-) 1 CATAGAAAAA TGCTCATTAC TGCCGTGGAA GGTAAAATAT ACACTCAACC TAAAGATACC 61 CAAGAAACAA TAGTTCCCAG ATACACTCAA AAAAATTATA TTCCGAGAAC AAGGAAAGAT 121 ATCTAAAGCG GTCTGTATGA GTGACTTGTC AAATATTAAC TCAAGCAAGA CTCTCAGTCA 181 CTCAACCAAA GGAAAAAGAC TACAAAAATA TAATAACTGG ACTGGACAAC ATTTTTATTA 241 GACATGTTGA AATATGTAGC TTAAGTAAAG AATCATCATT CAAAAGAGAT GTAGGGAAAC 301 AAAAGTATTA CTATTCTGCA GTTAAATGAG TCAAAATGTG GCAATGATCA CATAACAGCC 361 AAAAGAACAC CACCCGACAA CCTCTCTTGA TCAAGAAGAA TGAACTAGGA ATAAACCACT 421 CTGGTGAACC TTAAATGACT ACAACAGAAC ATCCAATACT CATGTAACGA TTCAAAAAAA 481 AAGAGAATTA TGTAAATAAG AATAAATAGG TATTTAAGGG CATAATTGTC CTTTCACGTT 541 TTAAATGAAT AAATAAATAA ATAAATAAAA CAGATTTGTA TTTATTTATT TTAATGTTAT 601 TTGACTAATT CTTGAATTAG TCTCCTAATC CAATTAGCCC TCTCTCTCTC ACGCTTCTAA 661 ACTCCCTCTC TCACGTTCTC CATCTTC Predicted gene structure (within gDNA segment 23048 to 29647): Exon 1 23782 23793 ( 12 n); cDNA 475 486 ( 12 n); score: 0.833 Intron 1 23794 28571 (4778 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.94) Exon 2 28572 28731 ( 160 n); cDNA 487 648 ( 162 n); score: 0.891 MATCH C01HBa0088L02.1+ SGN-E332471- 0.891 172 0.250 C PGS_C01HBa0088L02.1+_SGN-E332471- (23782 23793,28572 28731) Alignment (genomic DNA sequence = upper lines): AAAAGAAAGA GGGTTTGAAT AAGAAAAATA GAAAGAACAA AGAGAGACAG AAAAAGAAAG 23841 |||| ||||| | AAAAAAAAGA GA........ .......... .......... .......... .......... 486 AGAACGAGTA GAGAGAGAGA AACGAAGAGG ATAGCAAGGA TTTTGAGAAG ATAGCTTGTT 23901 .......... .......... .......... .......... .......... .......... 486 GATCGCAATT CTTCGGTGAA GGTAGGTTAT GGTTTTCATA CTATTCGTAG TAAACTCTTA 23961 .......... .......... .......... .......... .......... .......... 486 ATAGCGAATG ATATGTATTG ATAGTATTGT AAACCCTGCT ATGTGCTTAA TTGTATGCTT 24021 .......... .......... .......... .......... .......... .......... 486 GCATGAACGT GATTATATAA TTGTGATTAT ATTAAGCATG ATGAAGCTAT CGAATCCCAA 24081 .......... .......... .......... .......... .......... .......... 486 ATCTTGATAA AAACCTAATC TCTTTTTAAT GATGATGCCT TTGTAAGGGA TAAGGCTTGA 24141 .......... .......... .......... .......... .......... .......... 486 TGAACTAAAG TAATGAGATT GATGATGCCT TGGTAAGGGA GAAGGCTTGA TGAATTGATA 24201 .......... .......... .......... .......... .......... .......... 486 GAATGAGATT AGGGGATCGG GTGTTACGAA CCGACACGTA GAATTAGGGG ACCGGGTGTC 24261 .......... .......... .......... .......... .......... .......... 486 ACGAACCGAC ACGTAGAATT AGGGGATCGG GTGTCACGAA CCGACACGTA GATTTAGGAG 24321 .......... .......... .......... .......... .......... .......... 486 ATCGGGTGTC ACGAACCGAC ACGTAGAATT TAGGGGATCG GAGTATCACG TTTCGACACA 24381 .......... .......... .......... .......... .......... .......... 486 TAGTAGTAGG GGATCGGAGT GTCACGTACC GACACAAGAG GATTAATGAA TATAAGGGAG 24441 .......... .......... .......... .......... .......... .......... 486 CGGAGTGTCA CGTACCGACA CAAGAGAAAT AAAGATAATG AATCTTAAAA GATGTTAATA 24501 .......... .......... .......... .......... .......... .......... 486 TACTCAATCT AATGAACATA ATTCCCAAAT GAGTATGGTA TTGAGGCTTG AGTCCTCATG 24561 .......... .......... .......... .......... .......... .......... 486 TGTGAACTTG ACGGAAATTG TTAATGTTAT AGTACTTGTT GTTGCTACAT GTTGAGTATC 24621 .......... .......... .......... .......... .......... .......... 486 ATAGTTGAGT TTATGATATT ACTTGGTATA TACTGTTTTC TATTTTGAGT TGGCCGATGA 24681 .......... .......... .......... .......... .......... .......... 486 TATCTACTCA GTACCCGTGC TTTATACTGA CCCCTACTTT TATGTTTTCT TCTTTGTTAT 24741 .......... .......... .......... .......... .......... .......... 486 TTTTGGAGTG TAGCAAACGT GCCGTCGTCT TCGACTCAAC AGTAATTCAA GCCAGTCTTA 24801 .......... .......... .......... .......... .......... .......... 486 CTACATCGGA AATTCAGGGT GAGCTAATGC TTCTAGCTTG GACTGGAGCT TCTTCTTCAA 24861 .......... .......... .......... .......... .......... .......... 486 GTCTTGATGC CTTGAACTTC CGGCATGGAC TAGCTTCTTA TGTATTTTTA GCTTCTTAGA 24921 .......... .......... .......... .......... .......... .......... 486 CATTTTTAGT TAGTAATTTG ATCATAGATG TTCTTGTGAT GATGACTTCC AGATTTTGGG 24981 .......... .......... .......... .......... .......... .......... 486 GAATAATAGT TATTGATTTG GTTTTTTTTA TAAACGAGTT TAAGTCTTCC GCATTATTTT 25041 .......... .......... .......... .......... .......... .......... 486 CTGCTGATAT TATATTGAAA TGTTAAGGTT TAGATTGGTT GGTTCGCTCA CATAGAAGGG 25101 .......... .......... .......... .......... .......... .......... 486 TAAATATGGG TGCCAGTCCC GGCCAGGATT TGGGTCGTGA CATAAATTGA TGCTCATATG 25161 .......... .......... .......... .......... .......... .......... 486 CTAAGAAAAT GTGTGAATAA TTGATTATCC TAATTTTTAG AGATGAACAA ATAAAGTATA 25221 .......... .......... .......... .......... .......... .......... 486 TGGATTGTTA GTGACAAGTA TAATATGCTT TCTTGCCACT TAAATGTACA ACAAACAGGA 25281 .......... .......... .......... .......... .......... .......... 486 CAAGCTTCTA TTTACGTTTA CACACTAATA GTTGTGCTCA GTAGTACTTT ATTTGTTCTT 25341 .......... .......... .......... .......... .......... .......... 486 ATTACCTAGC TAATGTGGTT GAAGTTAATA ATTATCTTTA CTCTACGAAA GAAAAATCTA 25401 .......... .......... .......... .......... .......... .......... 486 CTGACTATTT CGTTGTGTTC AAAATATATT GGTGATTGAA AACAACAAAA TAAAGTCGAG 25461 .......... .......... .......... .......... .......... .......... 486 GAAATTATCT TTTTCATACT TTTGTCAATT GGATTTTTCG AATTTAAATG GCTTATCTCC 25521 .......... .......... .......... .......... .......... .......... 486 AAAGTGATGT GTTATTTTAT GTGCAATTTA AAATTTTAGA CGCCTCACTC CTTCAATTCA 25581 .......... .......... .......... .......... .......... .......... 486 TTTTCAGATA ATAAATATTT TAACCTGAAA AAAAAACACT ACTTTTGTTG AGAGAGGAGT 25641 .......... .......... .......... .......... .......... .......... 486 TCAGTTTGGC ATTTCCTAGA AGCTCATGTA TAACATTTCA CAGAATATAT ATAACATACG 25701 .......... .......... .......... .......... .......... .......... 486 ATAAAGTGTG TTATGTGATA TTTATTTTAA GGGAAAAGGC TTAAATATGT CATCGAACTA 25761 .......... .......... .......... .......... .......... .......... 486 AGAAAAAACT CATTTATGCC ATCAGTTAAA AGTTTGGCTC ATTTATGCTA TTACTGTTAA 25821 .......... .......... .......... .......... .......... .......... 486 AGAAAATGCT CATTCATGCC ATTATTTTTT AACAATGATT TTACAAAACC ATTTTTGACA 25881 .......... .......... .......... .......... .......... .......... 486 CGTGACAAAT TATAATTCGG ATACGTCATC AATTTTTTTA ATTCAATTTT TATTCAAAAT 25941 .......... .......... .......... .......... .......... .......... 486 TTTGATCTTT TTTTATTAAA AAAAATGATG ACGTAGCTGA TTATGATTTT TTAATTAAAA 26001 .......... .......... .......... .......... .......... .......... 486 AAATTAATGA AGTTTCCGAA TTATAATTGG CCACATGTCA AAAATGGTTT GCAAAATAAT 26061 .......... .......... .......... .......... .......... .......... 486 TGTTAAGAAA AATGACATGA ATGAGCCTTT TCGTTAACGG TAATGACATA AATAAGTCAA 26121 .......... .......... .......... .......... .......... .......... 486 AACTGTAACT GATGACATAA ATGAACCTTT TTTGAAAGTT CAATGACATT TAAGCCTTTT 26181 .......... .......... .......... .......... .......... .......... 486 CTCTTATTTT AATCATGTTG CATATTTGAA CGTCTTTCTG TACAATTGCT TTGCTTTTAT 26241 .......... .......... .......... .......... .......... .......... 486 TTCCGTAATA TGCATGTGCG TTGCACGGGC ACCCTTTATC TTGTATGTGT TACAATTCGA 26301 .......... .......... .......... .......... .......... .......... 486 TTTGGAAAAC TAAAATTTTG AAATCAATTT CACAACTTTG AAAATTTTTG AATTTTTTTT 26361 .......... .......... .......... .......... .......... .......... 486 ATAATTTTGG AGTTCCCACT TAATTTTTAG GAAAAATTAA GATAACCATT TAAGGAAAAA 26421 .......... .......... .......... .......... .......... .......... 486 AAATTTAAAA CAAAACGTTT TGAATAAAAT CAGAGTCGGG TACAGTTTCA AATAATTCTC 26481 .......... .......... .......... .......... .......... .......... 486 TCAGGGTTTA AGCATCTTAA AGGATCCGCT AACACACGGT TGACAATGGA TTTAAATGTT 26541 .......... .......... .......... .......... .......... .......... 486 TGACCAATTT ATAAGGAAAA TTTGAATTAC TTGAGAAAAT TTATAAGTTG AAAATGAGAA 26601 .......... .......... .......... .......... .......... .......... 486 ATCTTTTGAT ACTTACACAT TCGTATTATC TCAAATAATG AAATAATTCA AATATCAAAG 26661 .......... .......... .......... .......... .......... .......... 486 TGTCTAAATA AAATTTAAAC TTAACAATTT ACCTGAGTCA AATGATCAAA ATAATTACTT 26721 .......... .......... .......... .......... .......... .......... 486 GGGCCTGAAT TTAAAAGTTA ATTACTAACT ATGAAAATAT ATGAATAATC TCAAGTTAGT 26781 .......... .......... .......... .......... .......... .......... 486 CTCGAAGCCC GAGTCGTTTA AGTCGAAGCA AAGTTGACAA TTTAAATACT TAAGCAAATG 26841 .......... .......... .......... .......... .......... .......... 486 AAAAACACAA TAATAAATGA AAGTCTCCCA AGGATTCATC TAAGTTAGAG AGTTAAATTA 26901 .......... .......... .......... .......... .......... .......... 486 AATTTAAACA GAAAACAACT AAAATTTGAG TTAAAACATA TTAAAATATA CAACTAAATG 26961 .......... .......... .......... .......... .......... .......... 486 AGCAAAGAGA AGAAGGAAAT TGGGCCCAAG CCTGGTTGCT GTTCGTCTGG GCCAGTGCTT 27021 .......... .......... .......... .......... .......... .......... 486 GGGCCTTTCA ACTACTGAGT TCTCGGGGCT TTTGATCCAT TTGCTTAAAT TTTAGGAAAA 27081 .......... .......... .......... .......... .......... .......... 486 TTTTCATACA TAGCCACTTC AAAATAATTA ATTACTCTTG TAGCTACATG TTATTTGAAG 27141 .......... .......... .......... .......... .......... .......... 486 GAGAGAGGCA AACAAGACTA TAGAGAGGAG AGATGAGAGA GAGAGAGGGG GGGAAAAGAG 27201 .......... .......... .......... .......... .......... .......... 486 TGGAAGAAAG GTGAATTATA TATATATATA TAGGTTAGAT AATTGTATAG TACACATATG 27261 .......... .......... .......... .......... .......... .......... 486 TAATTGTATA TACGGCAAGA GAGATCGGGA GAGGGAGGAG ATTGGAGAGC GAGACCGGAG 27321 .......... .......... .......... .......... .......... .......... 486 AGAGAGGAGA GAGGCGAGCG AGAAAGGACA AAGAATGGGA GAGAGGTGAA TTGTATAAGT 27381 .......... .......... .......... .......... .......... .......... 486 ATATAATTGT ATATAACTGT ATATTATACA TATACATTGT ATAAATGGCA AGCGAGATTG 27441 .......... .......... .......... .......... .......... .......... 486 GGAGAGGGAG GAGGGCTTCA ATTGATAAGT GAGAAAATTC ATATCTATGT AATAAGATAA 27501 .......... .......... .......... .......... .......... .......... 486 TATGTAAGCT TATATATACT ACTTTAAGTT ATAGAATTTA AAATAGAATA TCGAAAAATG 27561 .......... .......... .......... .......... .......... .......... 486 AATTCTTAAA ACTGTGTATA ATAATTATTT TTTGCACAAT GAACATACAT ACTACATGTA 27621 .......... .......... .......... .......... .......... .......... 486 TATATGTTAA TTAAATATAA CCGCAGACAA TAATTTTGCA GAAACATAAA CAACAGAGTT 27681 .......... .......... .......... .......... .......... .......... 486 TAAAACGTGT ACTCAAAACC AACAATTAAA TTCATAAGCA TATATTAATG ACTATAAGAA 27741 .......... .......... .......... .......... .......... .......... 486 AAACATACCA CTATATGTAA AAATAGAATG AAATAGAAAG GAAAAAATCG AGTTCACGGA 27801 .......... .......... .......... .......... .......... .......... 486 ATGCACATGT CACCTTAAGA AAACTATTCC CCTCTAATAC CAGAGATTTA AAGAATTGCA 27861 .......... .......... .......... .......... .......... .......... 486 TCCTCTCAGG ATGGAACTAT TTTATTCAAC AATTTATTGA TACAAAAATA GTGATGTCAG 27921 .......... .......... .......... .......... .......... .......... 486 TAAGTCACTC AAAAGGAGAA CAATATACAA ATATTTAAGA GGACCTTAAA CTTGGCTTCA 27981 .......... .......... .......... .......... .......... .......... 486 AATTTAAATT TGACCACCAA CTTTCATAAT GCACAAACAG ACACTTTAAC TATTCAACTT 28041 .......... .......... .......... .......... .......... .......... 486 TTAAATAAAT AAACACATGA GTCCTACATG AAACAATACA CGTAGGACAC CATGTAGGAT 28101 .......... .......... .......... .......... .......... .......... 486 AAAAAAATGA CATATAAGAT GACATGTAGG ACATGTGTGT CTATTTGTTC AACTTTATAT 28161 .......... .......... .......... .......... .......... .......... 486 AAGTTTAAGT GTCTATTTGA GCACATCCAA AGTTGAAAAG GATAAATGTG ATTTGAAGCC 28221 .......... .......... .......... .......... .......... .......... 486 AAGTTAAAGG GCACATTTAT GTATTATCCC TTTTAAAATC AAAGGAAATC TCTCTATTTA 28281 .......... .......... .......... .......... .......... .......... 486 TAAAAAACAA AATGTAGTGT GAACATATGT TTATTGTGTC TTATTAGAAA GGTTACAACT 28341 .......... .......... .......... .......... .......... .......... 486 ATTTGGAAAA GGTGCAATCC TTCAGAAATT TCACAATCTT TCTTAAAAAG TCGAAACTTT 28401 .......... .......... .......... .......... .......... .......... 486 TCATAAAGTC CCAATTTTTT ATTGAAGTCG CAACTTTTCA TAAAAGTCAC AACTTTTCAT 28461 .......... .......... .......... .......... .......... .......... 486 AAAAGCCGAA AATCTTCATT AAAGTCACAA TTTTTCATAA AAGTGACAAC TTTTAGTAAA 28521 .......... .......... .......... .......... .......... .......... 486 AGTCGCAACT CTTCACTAAA GTCACAACTT TTCTGTAACG ATCCAATTTT TTTATATAAA 28581 |||| |||| .......... .......... .......... .......... .......... ATTATGTAAA 496 TAAGAATAAA TAGGTATTTA AGGGCATAAT GGTCCTTTCA CGTTCTAAAT GAATAAATAA 28641 |||||||||| |||||||||| |||||||||| ||||||||| |||| ||||| |||||||||| TAAGAATAAA TAGGTATTTA AGGGCATAAT TGTCCTTTCA CGTTTTAAAT GAATAAATAA 556 ATAAAT--A- AAAACAGATT TGTATTTATT TATTTTAAAT TTTATTTGAC TAATTCTTGA 28698 |||||| | |||||||||| |||||||||| |||||| ||| ||||||||| |||||||||| ATAAATAAAT AAAACAGATT TGTATTTATT TATTTT-AAT GTTATTTGAC TAATTCTTGA 615 ATTAGTCTCC TAATCCTAAT AGTTCTCTCT CTC 28731 |||||||||| |||||| | | || |||||| ||| ATTAGTCTCC TAATCCAATT AGCCCTCTCT CTC 648 hqPGS_C01HBa0088L02.1+_SGN-E332471- (28572 28731) ******************************************************************************** EST sequence 244 -strand 598 n (File: SGN-E227035-) 1 AAAAGGAGTA AGGTAAGTGA AAAGCTCAGG ATTAGAAGAT AAATGTTCTG AAGCTCCCGA 61 GTCTAATATC CATTCACTAG ACTTGATTGA AATAAAGAGT AGTCAAACTC ACTCCATTTT 121 GATTGTTTAT TCAACGGTGA GAATCGGATT ATAATTTATG TATAGAGGTG ATTCTAAAAT 181 TAGACAACAC TTAATGGTCT TGCTACATTT CCTTACGGTT TCACGGTTTC ACTGATGAAT 241 GAAGGGGAAA AAAAACTTGG TCTAATCTTG ACGTCTCATA AGGAAGGAAG TGGTCGTTTC 301 TCTATGCATT ATTTCTGATC CTGGAATTCA GACCCCATAT GAGACCGGCG TCGTTGACCT 361 CTCAGAAGTC GCAAACAAGC CTACTTACGT CATTCTTACT TTACATAGGT TAATTTGTAA 421 CGATTCAAAA AAAAAGAAGA GAATTATGTA AATAAGAATA AATAGGTATT TAAGGGCATA 481 ATTGTCCTTT CACGTTTTAA ATGAATAAAT AAATAAATAA ATAAAACAGA TTTGTATTTA 541 TTTATTTTAA TGTTATTTGA CTAATTCTTG AATTAGTCTC CTAATCCAAA AAAAAAAA Predicted gene structure (within gDNA segment 23488 to 29424): Exon 1 26789 26808 ( 20 n); cDNA 345 364 ( 20 n); score: 0.650 Intron 1 26809 27141 ( 333 n); Pd: 0.936 (s: 0), Pa: 0.995 (s: 0) Exon 2 27142 27161 ( 20 n); cDNA 365 383 ( 19 n); score: 0.800 Intron 2 27162 27234 ( 73 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.63) Exon 3 27235 27275 ( 41 n); cDNA 384 422 ( 39 n); score: 0.634 Intron 3 27276 27767 ( 492 n); Pd: 0.000 (s: 0.63), Pa: 0.851 (s: 0) Exon 4 27768 27788 ( 21 n); cDNA 423 443 ( 21 n); score: 0.667 Intron 4 27789 28572 ( 784 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.96) Exon 5 28573 28717 ( 145 n); cDNA 444 590 ( 147 n); score: 0.907 MATCH C01HBa0088L02.1+ SGN-E227035- 0.907 247 0.413 C PGS_C01HBa0088L02.1+_SGN-E227035- (26789 26808,27142 27161,27235 27275,27768 27788,28573 28717) Alignment (genomic DNA sequence = upper lines): CCCGAGTCGT TTAAGTCGAA GCAAAGTTGA CAATTTAAAT ACTTAAGCAA ATGAAAAACA 26848 || | ||||| | | || | CCGGCGTCGT TGACCTCTCA .......... .......... .......... .......... 364 CAATAATAAA TGAAAGTCTC CCAAGGATTC ATCTAAGTTA GAGAGTTAAA TTAAATTTAA 26908 .......... .......... .......... .......... .......... .......... 364 ACAGAAAACA ACTAAAATTT GAGTTAAAAC ATATTAAAAT ATACAACTAA ATGAGCAAAG 26968 .......... .......... .......... .......... .......... .......... 364 AGAAGAAGGA AATTGGGCCC AAGCCTGGTT GCTGTTCGTC TGGGCCAGTG CTTGGGCCTT 27028 .......... .......... .......... .......... .......... .......... 364 TCAACTACTG AGTTCTCGGG GCTTTTGATC CATTTGCTTA AATTTTAGGA AAATTTTCAT 27088 .......... .......... .......... .......... .......... .......... 364 ACATAGCCAC TTCAAAATAA TTAATTACTC TTGTAGCTAC ATGTTATTTG AAGGAGAGAG 27148 || || .......... .......... .......... .......... .......... ...GA-AGTC 370 GCAAACAAGA CTATAGAGAG GAGAGATGAG AGAGAGAGAG GGGGGGAAAA GAGTGGAAGA 27208 ||||||||| ||| GCAAACAAGC CTA....... .......... .......... .......... .......... 383 AAGGTGAATT ATATATATAT ATATAGGTTA GATAATTGTA TAGTACACAT ATGTAATTGT 27268 ||| | ||| | || | |||| | || | | | .......... .......... ......CTTA CGTCATTCT- TACTTTACAT AGGTTAATTT 416 ATATACGGCA AGAGAGATCG GGAGAGGGAG GAGATTGGAG AGCGAGACCG GAGAGAGAGG 27328 || ||| GTA-ACG... .......... .......... .......... .......... .......... 422 AGAGAGGCGA GCGAGAAAGG ACAAAGAATG GGAGAGAGGT GAATTGTATA AGTATATAAT 27388 .......... .......... .......... .......... .......... .......... 422 TGTATATAAC TGTATATTAT ACATATACAT TGTATAAATG GCAAGCGAGA TTGGGAGAGG 27448 .......... .......... .......... .......... .......... .......... 422 GAGGAGGGCT TCAATTGATA AGTGAGAAAA TTCATATCTA TGTAATAAGA TAATATGTAA 27508 .......... .......... .......... .......... .......... .......... 422 GCTTATATAT ACTACTTTAA GTTATAGAAT TTAAAATAGA ATATCGAAAA ATGAATTCTT 27568 .......... .......... .......... .......... .......... .......... 422 AAAACTGTGT ATAATAATTA TTTTTTGCAC AATGAACATA CATACTACAT GTATATATGT 27628 .......... .......... .......... .......... .......... .......... 422 TAATTAAATA TAACCGCAGA CAATAATTTT GCAGAAACAT AAACAACAGA GTTTAAAACG 27688 .......... .......... .......... .......... .......... .......... 422 TGTACTCAAA ACCAACAATT AAATTCATAA GCATATATTA ATGACTATAA GAAAAACATA 27748 .......... .......... .......... .......... .......... .......... 422 CCACTATATG TAAAAATAGA ATGAAATAGA AAGGAAAAAA TCGAGTTCAC GGAATGCACA 27808 | | ||| | | ||| | | || .......... .........A TTCAAAAAAA AAGAAGAGAA .......... .......... 443 TGTCACCTTA AGAAAACTAT TCCCCTCTAA TACCAGAGAT TTAAAGAATT GCATCCTCTC 27868 .......... .......... .......... .......... .......... .......... 443 AGGATGGAAC TATTTTATTC AACAATTTAT TGATACAAAA ATAGTGATGT CAGTAAGTCA 27928 .......... .......... .......... .......... .......... .......... 443 CTCAAAAGGA GAACAATATA CAAATATTTA AGAGGACCTT AAACTTGGCT TCAAATTTAA 27988 .......... .......... .......... .......... .......... .......... 443 ATTTGACCAC CAACTTTCAT AATGCACAAA CAGACACTTT AACTATTCAA CTTTTAAATA 28048 .......... .......... .......... .......... .......... .......... 443 AATAAACACA TGAGTCCTAC ATGAAACAAT ACACGTAGGA CACCATGTAG GATAAAAAAA 28108 .......... .......... .......... .......... .......... .......... 443 TGACATATAA GATGACATGT AGGACATGTG TGTCTATTTG TTCAACTTTA TATAAGTTTA 28168 .......... .......... .......... .......... .......... .......... 443 AGTGTCTATT TGAGCACATC CAAAGTTGAA AAGGATAAAT GTGATTTGAA GCCAAGTTAA 28228 .......... .......... .......... .......... .......... .......... 443 AGGGCACATT TATGTATTAT CCCTTTTAAA ATCAAAGGAA ATCTCTCTAT TTATAAAAAA 28288 .......... .......... .......... .......... .......... .......... 443 CAAAATGTAG TGTGAACATA TGTTTATTGT GTCTTATTAG AAAGGTTACA ACTATTTGGA 28348 .......... .......... .......... .......... .......... .......... 443 AAAGGTGCAA TCCTTCAGAA ATTTCACAAT CTTTCTTAAA AAGTCGAAAC TTTTCATAAA 28408 .......... .......... .......... .......... .......... .......... 443 GTCCCAATTT TTTATTGAAG TCGCAACTTT TCATAAAAGT CACAACTTTT CATAAAAGCC 28468 .......... .......... .......... .......... .......... .......... 443 GAAAATCTTC ATTAAAGTCA CAATTTTTCA TAAAAGTGAC AACTTTTAGT AAAAGTCGCA 28528 .......... .......... .......... .......... .......... .......... 443 ACTCTTCACT AAAGTCACAA CTTTTCTGTA ACGATCCAAT TTTTTTATAT AAATAAGAAT 28588 |||| | |||||||||| .......... .......... .......... .......... ....TTATGT AAATAAGAAT 459 AAATAGGTAT TTAAGGGCAT AATGGTCCTT TCACGTTCTA AATGAATAAA TAAATAAAT- 28647 |||||||||| |||||||||| ||| |||||| ||||||| || |||||||||| ||||||||| AAATAGGTAT TTAAGGGCAT AATTGTCCTT TCACGTTTTA AATGAATAAA TAAATAAATA 519 -A-AAAACAG ATTTGTATTT ATTTATTTTA AATTTTATTT GACTAATTCT TGAATTAGTC 28705 | ||||||| |||||||||| ||||||||| ||| |||||| |||||||||| |||||||||| AATAAAACAG ATTTGTATTT ATTTATTTT- AATGTTATTT GACTAATTCT TGAATTAGTC 578 TCCTAATCCT AA 28717 ||||||||| || TCCTAATCCA AA 590 hqPGS_C01HBa0088L02.1+_SGN-E227035- (28573 28717) ******************************************************************************** EST sequence 229 -strand 548 n (File: SGN-E378094-) 1 AGCTCCCCGA GTCTAATATC CATTCACTAG ACTTGATTGA AATAAAGAGT AGTCAAACTC 61 ACTCCATTTT GATTGTTTAT TCAACGGTGA GAATCGGATT ATAATTTATG TATAGAGGTG 121 ATTCTAAAAT TAGACAACAC TTAATGGTCT TGCTACATTT CCTTACGGTT TCACGGTTTC 181 ACTGATGAAT GAAGGGGAAA AAAAACTTGG TCTAATCTTG ACGTCTCATA AGGAAGGAAG 241 TGGTCGTTTC TCTATGCATT ATTTCTGATC CTGGAATTCA GACCCCATAT GAGACCGGCG 301 TCGTTGACCT CTCAGAAGTC GCAAACAAGC CTACTTACGT CATTCTTACT TTACATAGGT 361 TAATTTGTAA CGATTCAAAA AAAAAGAAGA GAATTATGTA AATAAGAATA AATAGGTATT 421 TAAGGGCATA ATTGTCCTTT CACGTTTTAA ATGAATAAAT AAATAAATAA ATAAAACAGA 481 TTTGTATTTA TTTATTTTAA TGTTATTTGA CTAATTCTTG AATTAGTCTC CTAATCCAAA 541 AAAAAAAA Predicted gene structure (within gDNA segment 23988 to 29424): Exon 1 26789 26808 ( 20 n); cDNA 295 314 ( 20 n); score: 0.650 Intron 1 26809 27141 ( 333 n); Pd: 0.936 (s: 0), Pa: 0.995 (s: 0) Exon 2 27142 27161 ( 20 n); cDNA 315 333 ( 19 n); score: 0.800 Intron 2 27162 27234 ( 73 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.63) Exon 3 27235 27275 ( 41 n); cDNA 334 372 ( 39 n); score: 0.634 Intron 3 27276 27767 ( 492 n); Pd: 0.000 (s: 0.63), Pa: 0.851 (s: 0) Exon 4 27768 27789 ( 22 n); cDNA 373 394 ( 22 n); score: 0.682 Intron 4 27790 28573 ( 784 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.96) Exon 5 28574 28717 ( 144 n); cDNA 395 540 ( 146 n); score: 0.906 MATCH C01HBa0088L02.1+ SGN-E378094- 0.906 247 0.451 C PGS_C01HBa0088L02.1+_SGN-E378094- (26789 26808,27142 27161,27235 27275,27768 27789,28574 28717) Alignment (genomic DNA sequence = upper lines): CCCGAGTCGT TTAAGTCGAA GCAAAGTTGA CAATTTAAAT ACTTAAGCAA ATGAAAAACA 26848 || | ||||| | | || | CCGGCGTCGT TGACCTCTCA .......... .......... .......... .......... 314 CAATAATAAA TGAAAGTCTC CCAAGGATTC ATCTAAGTTA GAGAGTTAAA TTAAATTTAA 26908 .......... .......... .......... .......... .......... .......... 314 ACAGAAAACA ACTAAAATTT GAGTTAAAAC ATATTAAAAT ATACAACTAA ATGAGCAAAG 26968 .......... .......... .......... .......... .......... .......... 314 AGAAGAAGGA AATTGGGCCC AAGCCTGGTT GCTGTTCGTC TGGGCCAGTG CTTGGGCCTT 27028 .......... .......... .......... .......... .......... .......... 314 TCAACTACTG AGTTCTCGGG GCTTTTGATC CATTTGCTTA AATTTTAGGA AAATTTTCAT 27088 .......... .......... .......... .......... .......... .......... 314 ACATAGCCAC TTCAAAATAA TTAATTACTC TTGTAGCTAC ATGTTATTTG AAGGAGAGAG 27148 || || .......... .......... .......... .......... .......... ...GA-AGTC 320 GCAAACAAGA CTATAGAGAG GAGAGATGAG AGAGAGAGAG GGGGGGAAAA GAGTGGAAGA 27208 ||||||||| ||| GCAAACAAGC CTA....... .......... .......... .......... .......... 333 AAGGTGAATT ATATATATAT ATATAGGTTA GATAATTGTA TAGTACACAT ATGTAATTGT 27268 ||| | ||| | || | |||| | || | | | .......... .......... ......CTTA CGTCATTCT- TACTTTACAT AGGTTAATTT 366 ATATACGGCA AGAGAGATCG GGAGAGGGAG GAGATTGGAG AGCGAGACCG GAGAGAGAGG 27328 || ||| GTA-ACG... .......... .......... .......... .......... .......... 372 AGAGAGGCGA GCGAGAAAGG ACAAAGAATG GGAGAGAGGT GAATTGTATA AGTATATAAT 27388 .......... .......... .......... .......... .......... .......... 372 TGTATATAAC TGTATATTAT ACATATACAT TGTATAAATG GCAAGCGAGA TTGGGAGAGG 27448 .......... .......... .......... .......... .......... .......... 372 GAGGAGGGCT TCAATTGATA AGTGAGAAAA TTCATATCTA TGTAATAAGA TAATATGTAA 27508 .......... .......... .......... .......... .......... .......... 372 GCTTATATAT ACTACTTTAA GTTATAGAAT TTAAAATAGA ATATCGAAAA ATGAATTCTT 27568 .......... .......... .......... .......... .......... .......... 372 AAAACTGTGT ATAATAATTA TTTTTTGCAC AATGAACATA CATACTACAT GTATATATGT 27628 .......... .......... .......... .......... .......... .......... 372 TAATTAAATA TAACCGCAGA CAATAATTTT GCAGAAACAT AAACAACAGA GTTTAAAACG 27688 .......... .......... .......... .......... .......... .......... 372 TGTACTCAAA ACCAACAATT AAATTCATAA GCATATATTA ATGACTATAA GAAAAACATA 27748 .......... .......... .......... .......... .......... .......... 372 CCACTATATG TAAAAATAGA ATGAAATAGA AAGGAAAAAA TCGAGTTCAC GGAATGCACA 27808 | | ||| | | ||| | | || | .......... .........A TTCAAAAAAA AAGAAGAGAA T......... .......... 394 TGTCACCTTA AGAAAACTAT TCCCCTCTAA TACCAGAGAT TTAAAGAATT GCATCCTCTC 27868 .......... .......... .......... .......... .......... .......... 394 AGGATGGAAC TATTTTATTC AACAATTTAT TGATACAAAA ATAGTGATGT CAGTAAGTCA 27928 .......... .......... .......... .......... .......... .......... 394 CTCAAAAGGA GAACAATATA CAAATATTTA AGAGGACCTT AAACTTGGCT TCAAATTTAA 27988 .......... .......... .......... .......... .......... .......... 394 ATTTGACCAC CAACTTTCAT AATGCACAAA CAGACACTTT AACTATTCAA CTTTTAAATA 28048 .......... .......... .......... .......... .......... .......... 394 AATAAACACA TGAGTCCTAC ATGAAACAAT ACACGTAGGA CACCATGTAG GATAAAAAAA 28108 .......... .......... .......... .......... .......... .......... 394 TGACATATAA GATGACATGT AGGACATGTG TGTCTATTTG TTCAACTTTA TATAAGTTTA 28168 .......... .......... .......... .......... .......... .......... 394 AGTGTCTATT TGAGCACATC CAAAGTTGAA AAGGATAAAT GTGATTTGAA GCCAAGTTAA 28228 .......... .......... .......... .......... .......... .......... 394 AGGGCACATT TATGTATTAT CCCTTTTAAA ATCAAAGGAA ATCTCTCTAT TTATAAAAAA 28288 .......... .......... .......... .......... .......... .......... 394 CAAAATGTAG TGTGAACATA TGTTTATTGT GTCTTATTAG AAAGGTTACA ACTATTTGGA 28348 .......... .......... .......... .......... .......... .......... 394 AAAGGTGCAA TCCTTCAGAA ATTTCACAAT CTTTCTTAAA AAGTCGAAAC TTTTCATAAA 28408 .......... .......... .......... .......... .......... .......... 394 GTCCCAATTT TTTATTGAAG TCGCAACTTT TCATAAAAGT CACAACTTTT CATAAAAGCC 28468 .......... .......... .......... .......... .......... .......... 394 GAAAATCTTC ATTAAAGTCA CAATTTTTCA TAAAAGTGAC AACTTTTAGT AAAAGTCGCA 28528 .......... .......... .......... .......... .......... .......... 394 ACTCTTCACT AAAGTCACAA CTTTTCTGTA ACGATCCAAT TTTTTTATAT AAATAAGAAT 28588 ||| | |||||||||| .......... .......... .......... .......... .....TATGT AAATAAGAAT 409 AAATAGGTAT TTAAGGGCAT AATGGTCCTT TCACGTTCTA AATGAATAAA TAAATAAAT- 28647 |||||||||| |||||||||| ||| |||||| ||||||| || |||||||||| ||||||||| AAATAGGTAT TTAAGGGCAT AATTGTCCTT TCACGTTTTA AATGAATAAA TAAATAAATA 469 -A-AAAACAG ATTTGTATTT ATTTATTTTA AATTTTATTT GACTAATTCT TGAATTAGTC 28705 | ||||||| |||||||||| ||||||||| ||| |||||| |||||||||| |||||||||| AATAAAACAG ATTTGTATTT ATTTATTTT- AATGTTATTT GACTAATTCT TGAATTAGTC 528 TCCTAATCCT AA 28717 ||||||||| || TCCTAATCCA AA 540 hqPGS_C01HBa0088L02.1+_SGN-E378094- (28574 28717) ******************************************************************************** EST sequence 119 -strand 799 n (File: SGN-E577982-) 1 TCGAGAGAGT ATACTTTGAA GTGAATGGGA GTGTCTGGAG GAGTTTTCCG GGCAGCACCA 61 TTAAAGTTTG AACATCGATT AAGGTAGAGT TTCTCTCATG GAATCTTTCT CCAAGAGTAC 121 TTTCTTTCGG ACGTTTCTTA AACTCTTGAA ACTAAGGTTG TTCCCCTTCG TATGTCCAAA 181 AATTAAAAAA TCTTGTTCGG ATAAAAATTA CAATATGTTT GATTTTTTCC GCCCCAGGAA 241 CATCATACGA TGTACCTGTG GACAAGTACC TTTGACTGAA GTTCAATTGA TAAATATCTT 301 CAAACAATGT GATTTCAACA GAGATGGCTA CCTCACTAAA GAGGATCTCA CGGAGGCATT 361 CCGGCAGCTG GGGTCCACTT TTCCGGGATA TCGAGCGGGC CGAGCCCTTC ACCGGGCTGA 421 TAAAAATGGT GATGGGCTTA TTGATAAGAA AGAGTTGGAT AAACTTGTTG AGTATGCAAG 481 AAAACGTGGT TACAGGCTAA GAAATGCTTG TTCCAACTAG TACAAGGAGT TTAGTTATAA 541 GTGTAGTTTC ACTTATAATT GACCTTCAAG ATTGTTAAAT AAATAAATCG TGTTTTATGG 601 TAACTGAATG TGATTGATAG TTCTTTTTTT CTTGTTAGTC CATGATCGAT ATGGATATAT 661 ATATGCTTTT GAGTTTTCAG AGTAGAATAT GTAAGCTTTT GGTTGTAGTT ACTAGTAAGT 721 AGTTGCATCG ATATGAATTG GGTGATATTT GAAGAAAAAA AGTATTTGAA GTTAAATATA 781 TTTAAAAAAA AAAAAAAAA Predicted gene structure (within gDNA segment 27426 to 36425): Exon 1 28892 28999 ( 108 n); cDNA 66 171 ( 106 n); score: 0.926 Intron 1 29000 35496 (6497 n); Pd: 0.900 (s: 0.98), Pa: 0.000 (s: 0) Exon 2 35497 35512 ( 16 n); cDNA 172 186 ( 15 n); score: 0.875 PPA cDNA 784 799 MATCH C01HBa0088L02.1+ SGN-E577982- 0.926 124 0.155 C PGS_C01HBa0088L02.1+_SGN-E577982- (28892 28999,35497 35512) Alignment (genomic DNA sequence = upper lines): GTTTGAATAT CAATAAAGGT ATGGGTTTCT CTCATGGAAT TCTTTCTCCA AGAGTAATTT 28951 ||||||| || | || ||||| | | |||||| |||||||||| ||||||||| |||||| ||| GTTTGAACAT CGATTAAGGT A-GAGTTTCT CTCATGGAAT -CTTTCTCCA AGAGTACTTT 123 CTTTCGAACG TTTCTTAAAC TCTTGAAACT AAGGTTGTTC CCCTTCGTAT GTCCTTGTCC 29011 |||||| ||| |||||||||| |||||||||| |||||||||| |||||||| CTTTCGGACG TTTCTTAAAC TCTTGAAACT AAGGTTGTTC CCCTTCGT.. .......... 171 TTAGCTCTCT AACGAATTTT TTTGGATGGG TATGTTGTGC TGCTAGATTT TTGCATGAAT 29071 .......... .......... .......... .......... .......... .......... 171 GATGTGTTTA AATTAAATAT GAATGTGTTT ATGTGCGGGA AATCACGATA ATGATCATCC 29131 .......... .......... .......... .......... .......... .......... 171 AAATATGACC GAAAAAATTA ATGTATAGGT GTGTATAGGG CAGTGTTTTA GTCACTGTTT 29191 .......... .......... .......... .......... .......... .......... 171 TAGGGTGTAT AAGTTGTGTA TTTGTTGTGC ATTTTATGTG TATAATGGGT GTACAATGTG 29251 .......... .......... .......... .......... .......... .......... 171 ATGTTCATTA TGATGAAGTA TATATAGTAA TTGATTAACA ATCTTTTAGC CAAACAAACC 29311 .......... .......... .......... .......... .......... .......... 171 CATGAAAGAT GCACTTAAAA TGTGTTAAAA TACTCTACGA ATTTTCTTAG GAATTCAAGT 29371 .......... .......... .......... .......... .......... .......... 171 GAAAATATTG ATAAAAACGA ATTGAAAAAT GACCAAAAAT TCCAGCAACA ATGCAACTTT 29431 .......... .......... .......... .......... .......... .......... 171 AATTTAGACT AAAGTTTAAT GAAGGAAATC TGGAAATTTA TTAAATTTTA AAGGAATGAG 29491 .......... .......... .......... .......... .......... .......... 171 GCCACCAGGA TTCGAACCTG GGACCTCACC CGTGAGGCAG CAGTAATTCG CGTAAAAAAA 29551 .......... .......... .......... .......... .......... .......... 171 ATAGCTGGGG GCAGGGATCG AACACGCGAC CTGGGGAAGG AGAAGGAGAA CACTTAATAA 29611 .......... .......... .......... .......... .......... .......... 171 ACAATTAAAT GGGAGGCGTG GGGATCGAAC CCATGACCTC CCAGTTCGCG AATGGAAAAG 29671 .......... .......... .......... .......... .......... .......... 171 AAAAAAAAGG GAAGCGAGGT GAGGAAATCG AACCCACGAC CTCAGCGCTG AAGGAAATGC 29731 .......... .......... .......... .......... .......... .......... 171 GAAAATAATA AAGTGAGGCT GTGGGGATTC GATCCCACAA CCTCACCGCC ACTCCCCTAT 29791 .......... .......... .......... .......... .......... .......... 171 TTAATAAAAA AAAATAGAGG GGATGTGGGG GTTCGAACCC ACCACCTCAT AAGCCTCCTC 29851 .......... .......... .......... .......... .......... .......... 171 TTCAGCGAAA AAGAGAGGAA AATAAGGGGG TTGTGGGGGT TCGAACCCAC AACCTCCCTA 29911 .......... .......... .......... .......... .......... .......... 171 ATGAGGCGAT TTTTAAATAT ATAAAAAAAG ATTTGAATTA AAATTCTAAT TAAAATAGAA 29971 .......... .......... .......... .......... .......... .......... 171 AATTAATTCT TTCATGTAAA TATTGAGATT TAAATTAGAA TTCTAATTAA AAATAGAAAT 30031 .......... .......... .......... .......... .......... .......... 171 TTTTTCTTTC ATGTAAATGA TTGAAATTTA ATTTAGAATT CTAATTAAAA TAGAAAATTT 30091 .......... .......... .......... .......... .......... .......... 171 ATTATGTCAT GAAAATGTCG AAATTTAATT CAGAGTTCTA AAGTTATGAA TATTAGAAAT 30151 .......... .......... .......... .......... .......... .......... 171 AAAATCGATG AAAAATATAA CTGATATCCA AATAATTCAA GATTTGGGTT CCCCTGCCCA 30211 .......... .......... .......... .......... .......... .......... 171 AACCTCCGTA TTGATACATA AGTCATACCT GAGTAAAATA TTCAAGAATC ATGCCATCTA 30271 .......... .......... .......... .......... .......... .......... 171 CTTAGATCAA AAATCAAGAT CTTGGTATAT ATACAAGATA CATAAGTCTT GTAATATAGA 30331 .......... .......... .......... .......... .......... .......... 171 ATCTTAGGAA AATAAGAATC ACTTATCGAA TTATAAATGA AGCTCCATGG CTTGTATGTG 30391 .......... .......... .......... .......... .......... .......... 171 TAGACACATA AGTTGAACAT ACGTTCAAAA ATAAGTGAAC CTAAGATATA CGTAATGAAA 30451 .......... .......... .......... .......... .......... .......... 171 TGAAGAATGT GGTGACAACC ATGATGTGAG GCTAATGTAT ATGATGAGAG CAATCTCAAA 30511 .......... .......... .......... .......... .......... .......... 171 TGAGCCTAAG TAAATGTTAC CAATACGTAC TCACCAATGA GAGTGTAAGA TAATCAATAG 30571 .......... .......... .......... .......... .......... .......... 171 ATCAGTCTCG ATGAACACTC TAATGAAAAC ATTGAGTTTA AAACACTTAA TACTAATGAT 30631 .......... .......... .......... .......... .......... .......... 171 GAGATGAGAA ATCATCTATT GAGCTATTAT GTCCTCATAC TAGAAGCCAA ATTCCATGAT 30691 .......... .......... .......... .......... .......... .......... 171 GTATGAGTTG AATGTAATAG AACTTTATAC CGAGCACAGA TAGGCTAGCT ATGAGCGGTG 30751 .......... .......... .......... .......... .......... .......... 171 ATGCCATCTT TCGGGAAGGG CGGAGTTTCA CGTAACTCTC ATTAGATGAG ACTGTCCGGT 30811 .......... .......... .......... .......... .......... .......... 171 TTGCCGGGTA TGGGTCTCCA TACATCTCCT AGTCTTTGAA CATATATTGC CATTATAGGG 30871 .......... .......... .......... .......... .......... .......... 171 ATCTGGCGGG GTTAAATTCC CATATACGCT AGCATGTTAT TGAATCGCTT TGGCCGGTGA 30931 .......... .......... .......... .......... .......... .......... 171 TTCCACCTCT TTTCGGTGTG GGGGAGACAC TGGATTTCAT GATACTCACA TGATCTATGT 30991 .......... .......... .......... .......... .......... .......... 171 CGGTTAAAGT TAAAGTTCCC AATGAATGAA TGAGGTCAGC CTCAAATGAA TCATATAAAG 31051 .......... .......... .......... .......... .......... .......... 171 AAATGAATGA TACCAAATGT GTTGGGATAG GATAATCAAG AGGTGAGCTA GATTAAGGTA 31111 .......... .......... .......... .......... .......... .......... 171 ATGACATTAG GTTATTCCTG ATCATTGCAC AACAAACCCG ATGAAAGCCT TAAACTACAT 31171 .......... .......... .......... .......... .......... .......... 171 CCTAGGTATA GCTGGTGTTC TCACTAGCCT ATGAATGAAT TGAAATGAAA TACGTATGAA 31231 .......... .......... .......... .......... .......... .......... 171 GAAATGAAGC AGACTCTGTG TTTGCTAAAG AAGGCTCCCT AGTTGAGGTC CCATATGTTG 31291 .......... .......... .......... .......... .......... .......... 171 AGCCCTCATT TTGGAAAGTC TTAAGGTTAA GTCTATGATA ATAAGGTCTC ATGGTATATG 31351 .......... .......... .......... .......... .......... .......... 171 AATCAATAAT ATGAAAGAAA CTATGTGTTA TATGTTATGT GCTATACGAT AATTATAATG 31411 .......... .......... .......... .......... .......... .......... 171 ATGTATGTCA CTCTCATAAC TTTCTCAATC TCAATTTAGC AAGTCCACTG ACTTGACTTC 31471 .......... .......... .......... .......... .......... .......... 171 CAAACATCAT GTTGTTAGGA AAGAGCTCTT CTTCCTCATG CATGTCCCTG GTGTGTGCTT 31531 .......... .......... .......... .......... .......... .......... 171 GCATATACCC ATACTTAGTA CAAGTGTGTA CTAATTCCAT ACAAACATCT ACATTTAGGT 31591 .......... .......... .......... .......... .......... .......... 171 GTAGGCACAG GTGTACGGTA GAGCTACAGG TTCGTTGTTG CAGCTATCCG GACGTCAGCA 31651 .......... .......... .......... .......... .......... .......... 171 TTCATCCGGA GTTTGGTAGG TCCTCATGCC TTCGAGGATG CTACTGTTTT ACATTCTAGC 31711 .......... .......... .......... .......... .......... .......... 171 GTAGTTTAGA GTTGAGCTAG TGGAGCATGT TCCACTAGCG TTTCTTTCCT GTTTTGGTTC 31771 .......... .......... .......... .......... .......... .......... 171 AGACTTTGTA TTGGGGTTAT TTTGACCGAT ATACAATTAA TACTTAATGA ATTATTTCTT 31831 .......... .......... .......... .......... .......... .......... 171 TCAGTTGCTT ATCTCTTAAT TGTTAGATGG TTGATGATGA ACGATTACGA AATATAAAGA 31891 .......... .......... .......... .......... .......... .......... 171 ATGTTTAACA AGTATGATTA ATGAATCAAA AATTTTAAAT TTTCCGCTAA AATAAACCTA 31951 .......... .......... .......... .......... .......... .......... 171 TGTAAAGTAA GAATGACGTA AGTAGGCTTG TTTGCGGCCT CTGAGAGGTC AACGACGCCG 32011 .......... .......... .......... .......... .......... .......... 171 GTCTTGTCTG GGGTCTAGAT TCCAGTCGTG ACATTTTCAT AAAAGTCACA TCTTTTTCAT 32071 .......... .......... .......... .......... .......... .......... 171 AAAAGAGGAA GGCTAGTTTT GAAAATAAAT TAATTTCATA AAAGTCACAA CTATTGATAA 32131 .......... .......... .......... .......... .......... .......... 171 AAGTCACAAT TCTTCATTAA AATCATAATT ATTGATAAAA ATCGCAACTC TTCATTAAAA 32191 .......... .......... .......... .......... .......... .......... 171 TCACAACTTT TCATTAAAGT AACATCTTTT CATCAAAGAG GAAGACTAGT TTTGGATAAA 32251 .......... .......... .......... .......... .......... .......... 171 TTAATTTTAA AGGAATTCTT GTTTGTGATG GCGCCACGTA GACGAGCCGA GGGTTCTCTT 32311 .......... .......... .......... .......... .......... .......... 171 TTATATAAAT ATATGATCTT ATCCCTAATT TAAAATTTGT AAATAGTAAA TTACATTTTG 32371 .......... .......... .......... .......... .......... .......... 171 TCCTACATTT TTTTATTACA ATAATTCCTT AAAATTTGTA CCTTTCTGAT ACATAAACCA 32431 .......... .......... .......... .......... .......... .......... 171 CCATCCTGAT ACATTAGTTC ACCATCCAGA TACATTAATT ATAATGCAAG AAAAAACCTT 32491 .......... .......... .......... .......... .......... .......... 171 TTTGTTGAGC TAAAAAGGAA TAAAATCTGA AAATTAATTA AATTTCATAA GTTACGCTTA 32551 .......... .......... .......... .......... .......... .......... 171 TGTTTCTTCT TACTCTCAAT CATATAGAGG CAAATCCTAA TAGAATGAAG AAATTCAAAA 32611 .......... .......... .......... .......... .......... .......... 171 TGTTAACCCC CCCTCGATCG ACGAGGAAGC CTTTCAAATT TGATTCAAAA AAATTTTGTC 32671 .......... .......... .......... .......... .......... .......... 171 AAAATTTTGG ATAAGCGAGG TGAATTATGA AGGATACAAA AGTGATGGAA TTGTTGTTGG 32731 .......... .......... .......... .......... .......... .......... 171 AACAATTTCC TTTTGAATCT TCAAGTTCAT CGAAGATCCT TTCAATTTTT ATTCAAGATT 32791 .......... .......... .......... .......... .......... .......... 171 ATCAAAAAAA ATGAAATTCA ATATTTTTTC TTCCTTCAGT TCTACGAAGA TCCTTTCAAG 32851 .......... .......... .......... .......... .......... .......... 171 TTTGATTCAA AATTGTTGGA AAATTTGAGA AGATACATCA TGAATATCTT TGCTATTTAT 32911 .......... .......... .......... .......... .......... .......... 171 CATTTTGTTA TTTATGTTTC TTGTTTAAAT TGATAAGTAT TGTATTTATA CTAGATACAT 32971 .......... .......... .......... .......... .......... .......... 171 TAAATAAATA ATGTTTTCCA TAAAATTTTG GATTTGAGAT TGACACATTA TTGTGCGGTA 33031 .......... .......... .......... .......... .......... .......... 171 GTTACTATGT AATTGATACG TTTAGTATAA ATTTGAATTT ACATATCATA TATAAAAAAG 33091 .......... .......... .......... .......... .......... .......... 171 ATAGTGCATG ATATATTATT ATTTATGTAT CTCGTTAAGA AAGTGAGTTT TGGTCATTTT 33151 .......... .......... .......... .......... .......... .......... 171 CAAACGGTCC TAGGTTCTAA CTCAGGATGA TTTAGAGGTA GTTCTTGATA TGGTTGGAAA 33211 .......... .......... .......... .......... .......... .......... 171 TCCCTTTAAG AGATCTTTCC AACGCCGTCG GGTTTGTGCA TTTTCAATAT CGTATGAGGG 33271 .......... .......... .......... .......... .......... .......... 171 AGATATGTCT ATCGAAAGTT GGGTTGTTGA AGTACGGAAA GTCCCAAATT CGAAATTAAA 33331 .......... .......... .......... .......... .......... .......... 171 GGACAAATTA ATCTTTTCAC AAATTAATTT CCTATTTCAT TTTATGGGAT TATTGGAGTA 33391 .......... .......... .......... .......... .......... .......... 171 AAAACTAAGT TTAGTTCAGT TTTGGAAAAA ATTAAATCAC GATTAGGGCT TGGAGAAGAG 33451 .......... .......... .......... .......... .......... .......... 171 AGAAAAGAAG AAGGAAAGAG AAAAAAGTCA AGAATTTGCC AAGAACGTCA AGATTTGCGA 33511 .......... .......... .......... .......... .......... .......... 171 GTAATATTTG TCGGGGGTGA TCCCTATCAA GGTATGTGAG ATTTTTCGTG TTGGGTTAGT 33571 .......... .......... .......... .......... .......... .......... 171 TCACCCACAC ACCAACTTGT TTAAATTCAG CAATTTTGAG TTGGTTGAAT GATAAAAAGT 33631 .......... .......... .......... .......... .......... .......... 171 GAAGTTTTTG GAGAACATTG TTGAATTCTT GTTGGTTGAG TTGTTGCATG CCTAGTGTTG 33691 .......... .......... .......... .......... .......... .......... 171 ATTTGATTTG TGTTTTCTGG TTTTTCGAGT CAAATATATG GATATTGAGG GTACTAATTA 33751 .......... .......... .......... .......... .......... .......... 171 ATGATCCTAA GTGTTTGGGA CAAGAACCAT GAAAGTTTAG AGGGTTTAGA AATGAAAAAC 33811 .......... .......... .......... .......... .......... .......... 171 GGAGAAGAAA AGTCGAAACG CCTGTCCATA GGACCTTGAA GCGCCGCGCC TCCCATAGCC 33871 .......... .......... .......... .......... .......... .......... 171 CCACAGGACA ATCTCTGTCG GGCCTTGGGG CCCGCTCCAT CCAGAGCGCC CCAACTTGGC 33931 .......... .......... .......... .......... .......... .......... 171 TTCTGAAGTT TGTAAAACGC CAAGGACGTC AGTTTTCCCC ATTCATTTTC CATCTTTTCG 33991 .......... .......... .......... .......... .......... .......... 171 TCCTAGTTCC TAAGTAATGT ACCCACGTTT TTAGTTGATT CCAACACTCT AAGGTACATC 34051 .......... .......... .......... .......... .......... .......... 171 TAAACATCAT GAAATCATCT ATACACATGA GATCATGAAC CTTGAATCCA TAATCTAATT 34111 .......... .......... .......... .......... .......... .......... 171 CGAGGAAAGT TATGATCAAA GCTAAGGAGT TAAATGTTAA GTCTAGAAGT TAAGAAGCAA 34171 .......... .......... .......... .......... .......... .......... 171 GTTAAAGTAA AGTTTATTAA AGTTTTCAAG AGTCTCTAAT AAACATTTTA ACTTTATTTT 34231 .......... .......... .......... .......... .......... .......... 171 AAGACTCAAG TTTCAAGATA TGCAAAGAGT AAAAAAATTT AATTTCTTCC TTCAAATAAA 34291 .......... .......... .......... .......... .......... .......... 171 TGGGAACTAA GTATTCCTAA GAGTTGATTT AAGGCTCAAG TATCAAGTTA AAAAAAGAGT 34351 .......... .......... .......... .......... .......... .......... 171 AAAGAGTTGA ATTCATTTCT CAAAACAGTT ATAATGGAAC TAAGTATCCC CTAAGAGTTT 34411 .......... .......... .......... .......... .......... .......... 171 ATAAATATTT TCACATTTAA GATAAGAGGA AACTAAGATT TCCAAAAGAG TTTTGAAGAA 34471 .......... .......... .......... .......... .......... .......... 171 GAAAAGGGAA CATCGATCCC AAAGGAGCCT TTGGGCTAAG CATTGAGTAA TTATCTCAAA 34531 .......... .......... .......... .......... .......... .......... 171 CTAAAGAAAA AAAGTTGCTT TAAACACATG AGCTAAAGTA TTTTGCGAGT AGTATTGAAT 34591 .......... .......... .......... .......... .......... .......... 171 ACCGATGGGG GATGAGAGTT CATATTAACT CAAGCCTCCA TGAAAATCAT GTATCATCAT 34651 .......... .......... .......... .......... .......... .......... 171 GGGTATTAAC GGGTCATACT TTTTAGATGA TCACGTAAGT TAAGCTAGTG GATCCACTAA 34711 .......... .......... .......... .......... .......... .......... 171 GTTAAGTAGT TCTATGCAAC GGAAAAGTAT AGGACAGTTC TAACAATGTT GGCAAGACGT 34771 .......... .......... .......... .......... .......... .......... 171 TGTATCACCA CTTAGGCTCA TAGTGGTGGT TGTCGGTTAG AGAATTTCCC ATAAAAACTA 34831 .......... .......... .......... .......... .......... .......... 171 TACTACTTCA AGGTTGAGTT TGTTATTGCA TTTTCTTTAA CGAACTAAGT ATTTACATTG 34891 .......... .......... .......... .......... .......... .......... 171 TTTTACAAGC TTTTATATAT TGTATATGTC TTGTTTCTTT ACATTAAGTC AAGTTATTCA 34951 .......... .......... .......... .......... .......... .......... 171 TGAGTTGATT AGAGCCAATG TAAGTGTTTC TTCTTACTCT CTATCAAACT TAAGTTGTTA 35011 .......... .......... .......... .......... .......... .......... 171 TTATCATTCC AACTCGCATA CTCGTACATT CAATGTATTT ATGCCAATTG GCTTGCATCA 35071 .......... .......... .......... .......... .......... .......... 171 TATTATGATG CAGACGCAGA TAACCAGGAT TAATATCATT CAGCGCCTCG TTGATCCAAC 35131 .......... .......... .......... .......... .......... .......... 171 TAAGCACTCG GAGTCAGTGG TGAGCCTCCT CGCATCCTGG AGGACAAATA TTTCTTGCTT 35191 .......... .......... .......... .......... .......... .......... 171 TCAGTCTTTC TTTTAATAGG ATTTTATGGG GTCTGTCCCA ACATCCATTT TAGTATTATA 35251 .......... .......... .......... .......... .......... .......... 171 GAGGCTTCAT AGACAGTCAA ACAGTTTAGT TTCAAGTCTC TTCTTTGTAT TATAGATGTT 35311 .......... .......... .......... .......... .......... .......... 171 TTCCTATGAG ACTTATGTGT CATTTTGGCC AAGCTATTTA ATTCAAGTTA TTTTATTAGA 35371 .......... .......... .......... .......... .......... .......... 171 ATGTTTTCTT GTATTGAGTT AAGTCTTCCG TTGAGTTAAG TAAGTCAGGC CAAGAGTACT 35431 .......... .......... .......... .......... .......... .......... 171 CTCAAGGTCA ACAATGGTCA TTGAGTGTCG GCCACGTCCA GGGGTAGGCT CGGGGCATGA 35491 .......... .......... .......... .......... .......... .......... 171 CAAATATATC CAACAAATTA A 35512 || || ||| |||||| | .....ATGTC CAA-AAATTA A 186 hqPGS_C01HBa0088L02.1+_SGN-E577982- (28892 28999) ******************************************************************************** EST sequence 10 +strand 606 n (File: SGN-E578080+) 1 GCTGTAGGTA TTATTGCAGG TCAATCGATT GGAGAACCGG GTACTCAATT AACATTACGA 61 ACTTTTCATA CCGGAGGAGT ATTCACGGGG GGTACTGCAG AACATGTGCG AGCCCCATCT 121 AATGGAAAAA TAAAATTCAA TGAGGACTTG GTTCATCCGA CACGTACACG TCATGGGCAT 181 CCCGCCTTTC TATGTTCTAT AGACTTGTAT GTAACTATTG AGAGTGAAGA TATTCTACAT 241 AATGTGAATA TTCCACCCAA AAGTTTGCTT TTAGTTCAAA ACGATCAATA ATGAGCTCTT 301 TCGTATTGGG TTAATTCATC CCTACACAAA TTCTGTTTTA GTTTAGAAGT TTTAGAATTG 361 ATTACATGAT TAGAAAAGAA TTCTTGATAA TCTCGTTGAA TCCCTTTTTG GTTGAGTTGA 421 TTGCATGCCT AATGTTGATT TGATTTGTGT CTCCGGGTTG TGTTTCGAGT CAAATATATA 481 GGGTATTTTG GGTAATAATT ATCCTAAGTG TTTGGGGAAA TAGCCATGGA AGTTTAGAGG 541 GTTTAGATAT GAAACACGGA GGATAAAAGT CGAAATGCTT GTTCATAAGG CCATGGGGCA 601 CCGCGC Predicted gene structure (within gDNA segment 28767 to 35001): Exon 1 29980 30004 ( 25 n); cDNA 204 228 ( 25 n); score: 0.800 Intron 1 30005 31081 (1077 n); Pd: 0.000 (s: 0), Pa: 0.681 (s: 0) Exon 2 31082 31093 ( 12 n); cDNA 229 240 ( 12 n); score: 0.667 Intron 2 31094 31552 ( 459 n); Pd: 0.142 (s: 0), Pa: 0.000 (s: 0.65) Exon 3 31553 31595 ( 43 n); cDNA 241 280 ( 40 n); score: 0.651 Intron 3 31596 32880 (1285 n); Pd: 0.000 (s: 0.65), Pa: 0.000 (s: 0) Exon 4 32881 32894 ( 14 n); cDNA 281 294 ( 14 n); score: 0.714 Intron 4 32895 33550 ( 656 n); Pd: 0.900 (s: 0), Pa: 0.000 (s: 0.70) Exon 5 33551 33860 ( 310 n); cDNA 295 606 ( 312 n); score: 0.739 MATCH C01HBa0088L02.1+ SGN-E578080+ 0.739 404 0.667 C PGS_C01HBa0088L02.1+_SGN-E578080+ (29980 30004,31082 31093,31553 31595,32881 32894,33551 33860) Alignment (genomic DNA sequence = upper lines): CTTTCATGTA AATATTGAGA TTTAAATTAG AATTCTAATT AAAAATAGAA ATTTTTTCTT 30039 ||| ||||| | |||||||| | || CTTGTATGTA ACTATTGAGA GTGAA..... .......... .......... .......... 228 TCATGTAAAT GATTGAAATT TAATTTAGAA TTCTAATTAA AATAGAAAAT TTATTATGTC 30099 .......... .......... .......... .......... .......... .......... 228 ATGAAAATGT CGAAATTTAA TTCAGAGTTC TAAAGTTATG AATATTAGAA ATAAAATCGA 30159 .......... .......... .......... .......... .......... .......... 228 TGAAAAATAT AACTGATATC CAAATAATTC AAGATTTGGG TTCCCCTGCC CAAACCTCCG 30219 .......... .......... .......... .......... .......... .......... 228 TATTGATACA TAAGTCATAC CTGAGTAAAA TATTCAAGAA TCATGCCATC TACTTAGATC 30279 .......... .......... .......... .......... .......... .......... 228 AAAAATCAAG ATCTTGGTAT ATATACAAGA TACATAAGTC TTGTAATATA GAATCTTAGG 30339 .......... .......... .......... .......... .......... .......... 228 AAAATAAGAA TCACTTATCG AATTATAAAT GAAGCTCCAT GGCTTGTATG TGTAGACACA 30399 .......... .......... .......... .......... .......... .......... 228 TAAGTTGAAC ATACGTTCAA AAATAAGTGA ACCTAAGATA TACGTAATGA AATGAAGAAT 30459 .......... .......... .......... .......... .......... .......... 228 GTGGTGACAA CCATGATGTG AGGCTAATGT ATATGATGAG AGCAATCTCA AATGAGCCTA 30519 .......... .......... .......... .......... .......... .......... 228 AGTAAATGTT ACCAATACGT ACTCACCAAT GAGAGTGTAA GATAATCAAT AGATCAGTCT 30579 .......... .......... .......... .......... .......... .......... 228 CGATGAACAC TCTAATGAAA ACATTGAGTT TAAAACACTT AATACTAATG ATGAGATGAG 30639 .......... .......... .......... .......... .......... .......... 228 AAATCATCTA TTGAGCTATT ATGTCCTCAT ACTAGAAGCC AAATTCCATG ATGTATGAGT 30699 .......... .......... .......... .......... .......... .......... 228 TGAATGTAAT AGAACTTTAT ACCGAGCACA GATAGGCTAG CTATGAGCGG TGATGCCATC 30759 .......... .......... .......... .......... .......... .......... 228 TTTCGGGAAG GGCGGAGTTT CACGTAACTC TCATTAGATG AGACTGTCCG GTTTGCCGGG 30819 .......... .......... .......... .......... .......... .......... 228 TATGGGTCTC CATACATCTC CTAGTCTTTG AACATATATT GCCATTATAG GGATCTGGCG 30879 .......... .......... .......... .......... .......... .......... 228 GGGTTAAATT CCCATATACG CTAGCATGTT ATTGAATCGC TTTGGCCGGT GATTCCACCT 30939 .......... .......... .......... .......... .......... .......... 228 CTTTTCGGTG TGGGGGAGAC ACTGGATTTC ATGATACTCA CATGATCTAT GTCGGTTAAA 30999 .......... .......... .......... .......... .......... .......... 228 GTTAAAGTTC CCAATGAATG AATGAGGTCA GCCTCAAATG AATCATATAA AGAAATGAAT 31059 .......... .......... .......... .......... .......... .......... 228 GATACCAAAT GTGTTGGGAT AGGATAATCA AGAGGTGAGC TAGATTAAGG TAATGACATT 31119 |||| || | | .......... .......... ..GATATTCT ACAT...... .......... .......... 240 AGGTTATTCC TGATCATTGC ACAACAAACC CGATGAAAGC CTTAAACTAC ATCCTAGGTA 31179 .......... .......... .......... .......... .......... .......... 240 TAGCTGGTGT TCTCACTAGC CTATGAATGA ATTGAAATGA AATACGTATG AAGAAATGAA 31239 .......... .......... .......... .......... .......... .......... 240 GCAGACTCTG TGTTTGCTAA AGAAGGCTCC CTAGTTGAGG TCCCATATGT TGAGCCCTCA 31299 .......... .......... .......... .......... .......... .......... 240 TTTTGGAAAG TCTTAAGGTT AAGTCTATGA TAATAAGGTC TCATGGTATA TGAATCAATA 31359 .......... .......... .......... .......... .......... .......... 240 ATATGAAAGA AACTATGTGT TATATGTTAT GTGCTATACG ATAATTATAA TGATGTATGT 31419 .......... .......... .......... .......... .......... .......... 240 CACTCTCATA ACTTTCTCAA TCTCAATTTA GCAAGTCCAC TGACTTGACT TCCAAACATC 31479 .......... .......... .......... .......... .......... .......... 240 ATGTTGTTAG GAAAGAGCTC TTCTTCCTCA TGCATGTCCC TGGTGTGTGC TTGCATATAC 31539 .......... .......... .......... .......... .......... .......... 240 CCATACTTAG TACAAGTGTG TACTAATTCC ATACAAACAT CTACATTTAG GTGTAGGCAC 31599 || |||| | | ||||| | |||| | | | ||||| | | .......... ...AA-TGTG -AAT-ATTCC ACCCAAAAGT TTGCTTTTAG TTCAAA.... 280 AGGTGTACGG TAGAGCTACA GGTTCGTTGT TGCAGCTATC CGGACGTCAG CATTCATCCG 31659 .......... .......... .......... .......... .......... .......... 280 GAGTTTGGTA GGTCCTCATG CCTTCGAGGA TGCTACTGTT TTACATTCTA GCGTAGTTTA 31719 .......... .......... .......... .......... .......... .......... 280 GAGTTGAGCT AGTGGAGCAT GTTCCACTAG CGTTTCTTTC CTGTTTTGGT TCAGACTTTG 31779 .......... .......... .......... .......... .......... .......... 280 TATTGGGGTT ATTTTGACCG ATATACAATT AATACTTAAT GAATTATTTC TTTCAGTTGC 31839 .......... .......... .......... .......... .......... .......... 280 TTATCTCTTA ATTGTTAGAT GGTTGATGAT GAACGATTAC GAAATATAAA GAATGTTTAA 31899 .......... .......... .......... .......... .......... .......... 280 CAAGTATGAT TAATGAATCA AAAATTTTAA ATTTTCCGCT AAAATAAACC TATGTAAAGT 31959 .......... .......... .......... .......... .......... .......... 280 AAGAATGACG TAAGTAGGCT TGTTTGCGGC CTCTGAGAGG TCAACGACGC CGGTCTTGTC 32019 .......... .......... .......... .......... .......... .......... 280 TGGGGTCTAG ATTCCAGTCG TGACATTTTC ATAAAAGTCA CATCTTTTTC ATAAAAGAGG 32079 .......... .......... .......... .......... .......... .......... 280 AAGGCTAGTT TTGAAAATAA ATTAATTTCA TAAAAGTCAC AACTATTGAT AAAAGTCACA 32139 .......... .......... .......... .......... .......... .......... 280 ATTCTTCATT AAAATCATAA TTATTGATAA AAATCGCAAC TCTTCATTAA AATCACAACT 32199 .......... .......... .......... .......... .......... .......... 280 TTTCATTAAA GTAACATCTT TTCATCAAAG AGGAAGACTA GTTTTGGATA AATTAATTTT 32259 .......... .......... .......... .......... .......... .......... 280 AAAGGAATTC TTGTTTGTGA TGGCGCCACG TAGACGAGCC GAGGGTTCTC TTTTATATAA 32319 .......... .......... .......... .......... .......... .......... 280 ATATATGATC TTATCCCTAA TTTAAAATTT GTAAATAGTA AATTACATTT TGTCCTACAT 32379 .......... .......... .......... .......... .......... .......... 280 TTTTTTATTA CAATAATTCC TTAAAATTTG TACCTTTCTG ATACATAAAC CACCATCCTG 32439 .......... .......... .......... .......... .......... .......... 280 ATACATTAGT TCACCATCCA GATACATTAA TTATAATGCA AGAAAAAACC TTTTTGTTGA 32499 .......... .......... .......... .......... .......... .......... 280 GCTAAAAAGG AATAAAATCT GAAAATTAAT TAAATTTCAT AAGTTACGCT TATGTTTCTT 32559 .......... .......... .......... .......... .......... .......... 280 CTTACTCTCA ATCATATAGA GGCAAATCCT AATAGAATGA AGAAATTCAA AATGTTAACC 32619 .......... .......... .......... .......... .......... .......... 280 CCCCCTCGAT CGACGAGGAA GCCTTTCAAA TTTGATTCAA AAAAATTTTG TCAAAATTTT 32679 .......... .......... .......... .......... .......... .......... 280 GGATAAGCGA GGTGAATTAT GAAGGATACA AAAGTGATGG AATTGTTGTT GGAACAATTT 32739 .......... .......... .......... .......... .......... .......... 280 CCTTTTGAAT CTTCAAGTTC ATCGAAGATC CTTTCAATTT TTATTCAAGA TTATCAAAAA 32799 .......... .......... .......... .......... .......... .......... 280 AAATGAAATT CAATATTTTT TCTTCCTTCA GTTCTACGAA GATCCTTTCA AGTTTGATTC 32859 .......... .......... .......... .......... .......... .......... 280 AAAATTGTTG GAAAATTTGA GAAGATACAT CATGAATATC TTTGCTATTT ATCATTTTGT 32919 | ||| || |||| .......... .......... .ACGATCAAT AATGA..... .......... .......... 294 TATTTATGTT TCTTGTTTAA ATTGATAAGT ATTGTATTTA TACTAGATAC ATTAAATAAA 32979 .......... .......... .......... .......... .......... .......... 294 TAATGTTTTC CATAAAATTT TGGATTTGAG ATTGACACAT TATTGTGCGG TAGTTACTAT 33039 .......... .......... .......... .......... .......... .......... 294 GTAATTGATA CGTTTAGTAT AAATTTGAAT TTACATATCA TATATAAAAA AGATAGTGCA 33099 .......... .......... .......... .......... .......... .......... 294 TGATATATTA TTATTTATGT ATCTCGTTAA GAAAGTGAGT TTTGGTCATT TTCAAACGGT 33159 .......... .......... .......... .......... .......... .......... 294 CCTAGGTTCT AACTCAGGAT GATTTAGAGG TAGTTCTTGA TATGGTTGGA AATCCCTTTA 33219 .......... .......... .......... .......... .......... .......... 294 AGAGATCTTT CCAACGCCGT CGGGTTTGTG CATTTTCAAT ATCGTATGAG GGAGATATGT 33279 .......... .......... .......... .......... .......... .......... 294 CTATCGAAAG TTGGGTTGTT GAAGTACGGA AAGTCCCAAA TTCGAAATTA AAGGACAAAT 33339 .......... .......... .......... .......... .......... .......... 294 TAATCTTTTC ACAAATTAAT TTCCTATTTC ATTTTATGGG ATTATTGGAG TAAAAACTAA 33399 .......... .......... .......... .......... .......... .......... 294 GTTTAGTTCA GTTTTGGAAA AAATTAAATC ACGATTAGGG CTTGGAGAAG AGAGAAAAGA 33459 .......... .......... .......... .......... .......... .......... 294 AGAAGGAAAG AGAAAAAAGT CAAGAATTTG CCAAGAACGT CAAGATTTGC GAGTAATATT 33519 .......... .......... .......... .......... .......... .......... 294 TGTCGGGGGT GATCCCTATC AAGGTATGTG AGATTTTTCG TGTTGGGTTA GTTCACCCAC 33579 | | ||||| | |||||||| |||| || .......... .......... .......... .GCTCTTTCG TATTGGGTTA ATTCATCCCT 323 ACACCAACT- TGTTTAAATT CAGCAATTTT -GAGTTGGTT GAATGATAAA AAGTGAAGTT 33637 |||| || | ||||| | || || | |||| || ||| || ||||| | || ||| || ACACAAATTC TGTTTTAGTT TAGAAGTTTT AGAATTGATT ACATGATTAG AAAAGAA-TT 382 TTTGGAGAAC ATTGTTGAAT -TCTTGTTGG TTGAGTTG-T TGCATGCCTA GTGTTGATTT 33695 || || || | ||||||| ||| |||| |||||||| | |||||||||| ||||||||| CTT-GATAAT CTCGTTGAAT CCCTTTTTGG TTGAGTTGAT TGCATGCCTA ATGTTGATTT 441 GATTTGTGTT TTCTGG-T-T -TTTCGAGTC AAATATAT-G GATATTGAGG GTACTAATTA 33751 ||||||||| | | || | | ||||||||| |||||||| | | |||| || | ||| || GATTTGTGTC TCCGGGTTGT GTTTCGAGTC AAATATATAG GGTATTTTGG G---TAA-TA 497 ATGATCCTAA GTGTTTGGGA CAAGAACCAT GAAAGTTTAG AGGGTTTAGA AATGAAAAAC 33811 || ||||||| ||||||||| || | |||| | |||||||| |||||||||| |||||| || ATTATCCTAA GTGTTTGGGG AAATAGCCAT GGAAGTTTAG AGGGTTTAGA TATGAAACAC 557 GGAGAAGAAA AGTCGAAACG CCTGTCCATA GGACCTTGAA GCGCCGCGC 33860 |||| | ||| |||||||| | | ||| |||| | || || || |||||| GGAGGATAAA AGTCGAAATG CTTGTTCATA AGGCCATGGG GCACCGCGC 606 hqPGS_C01HBa0088L02.1+_SGN-E578080+ (29980 30004,31082 31093,31553 31595,32881 32894,33551 33860) ******************************************************************************** EST sequence 22 +strand 687 n (File: SGN-E389994+) 1 ACATAATGAA ATGAATGATA TCAAAGTTGT TTGGATAGGA TAATCACAAG GTGAGTTAGA 61 TTCAAGTAAT GACATTAGGT CATTCTTAGT CATTGCACAA TGAACCTAAT GAAAGTCTCA 121 AACTACATCC TAGGTATAGT TTGTGTTTAC ACTGGCCTAT GAATGAAATG AAATGTAGTA 181 CGTATGAATG AAAGAAGCAG GCTATGTGTT TGCTAATGAA GACTCCCTAG TTGAGGTCCC 241 ATTTGTTGAG CCCTCATTTC TGGGAATTCT TAATGTTAAG TCCATGATTC AAAGGTCTCA 301 TGGCATATGA TAAATGATAT TAAAGAAGTG ATGTGCTACA TGCAAATTGT ATTTTATGCC 361 ATATCATATG TGCTATGTGT AAATGTTATG TGCTATGTGG AAATGTTAAA AACTGATGAT 421 GTACGTTATT CTCATGGCAT AACTTTCCTA TTCTAAATCT AGAAAGCTCA CTGACTTTCC 481 TAATCCATAT TTGGAAACCT TCGTAATCAC AAATTGGCAG GTCCACTAAC TTGACTTCCC 541 AAAACCATGT TGTTAGGAAA GAATTATTCT TTCTTATGCA TGTCATTTGG TGTGTGCTTG 601 CATATACCCA TACTTAGTAC AAGTGTGTAC TAACCCTATA CAAACTCTAC TATTTTANGT 661 GCAACCACNA CTGGACGAAT GAACTAA Predicted gene structure (within gDNA segment 28446 to 32715): Exon 1 31046 31384 ( 339 n); cDNA 3 341 ( 339 n); score: 0.836 MATCH C01HBa0088L02.1+ SGN-E389994+ 0.836 339 0.493 C PGS_C01HBa0088L02.1+_SGN-E389994+ (31046 31384) Alignment (genomic DNA sequence = upper lines): ATAAAGAAAT GAATGATACC AAATGTGTTG GGATAGGATA ATCAAGAGGT GAGCTAGATT 31105 |||| ||||| |||||||| | ||| |||| |||||||||| |||| |||| ||| |||||| ATAATGAAAT GAATGATATC AAAGTTGTTT GGATAGGATA ATCACAAGGT GAGTTAGATT 62 AAGGTAATGA CATTAGGTTA TTCCTGATCA TTGCACAACA AACCCGATGA AAGCCTTAAA 31165 | ||||||| |||||||| | ||| | ||| |||||||| |||| |||| ||| || ||| CAAGTAATGA CATTAGGTCA TTCTTAGTCA TTGCACAATG AACCTAATGA AAGTCTCAAA 122 CTACATCCTA GGTATAGCTG GTGTTCTCAC TAGCCTATGA ATGAATTGAA ATGAAATACG 31225 |||||||||| ||||||| | ||||| ||| | |||||||| ||||| |||| ||| | |||| CTACATCCTA GGTATAGTTT GTGTTTACAC TGGCCTATGA ATGAAATGAA ATGTAGTACG 182 TATGAAGAAA TGAAGCAGAC TCTGTGTTTG CTAAAGAAGG CTCCCTAGTT GAGGTCCCAT 31285 |||||| || ||||||| | | |||||||| |||| |||| |||||||||| |||||||||| TATGAATGAA AGAAGCAGGC TATGTGTTTG CTAATGAAGA CTCCCTAGTT GAGGTCCCAT 242 ATGTTGAGCC CTCATTT-TG GAAAGTCTTA AGGTTAAGTC TATGATAATA AGGTCTCATG 31344 ||||||||| ||||||| || | || ||||| | |||||||| ||||| | |||||||||| TTGTTGAGCC CTCATTTCTG GGAATTCTTA ATGTTAAGTC CATGATTCAA AGGTCTCATG 302 GTATATGAAT CAATAATATG AAAGAAACTA TGTGTTATAT 31384 | ||||| || ||| |||| |||||| | |||| || || GCATATG-AT AAATGATATT AAAGAAGTGA TGTGCTACAT 341 hqPGS_C01HBa0088L02.1+_SGN-E389994+ (31046 31384) ******************************************************************************** EST sequence 50 +strand 617 n (File: SGN-E235464+) 1 CATAATGAAA TGAATGATAT CAAAGTTGTT TGGATAGGAT AATCACAAGG TGAGTTAGAT 61 TCAAGTAATG ACATTAGGTC ATTCTTAGTC ATTGCACAAT GAACCTAATG AAAGTCTCAA 121 ACTACATCCT AGGTATAGTT TGTGTTTACA CTGGCCTATG AATGAAATGA AATGTAGTAC 181 GTATGAATGA AAGAAGCAGG CTATGTGTTT GCTAATGAAG ACTCCCTAGT TGAGGTCCCA 241 TTTGTTGAGC CCTCATTTCT GGGAATTCTT AATGTTAAGT CCATGATTCA AAGGTCTCAT 301 GGCATATGAT AAATGATATT AAAGAAGTGA TGTGCTACAT GCAAATTGTA TTTTATGCCA 361 TATCATATGT GCTATGTGTA AATGTTATGT GCTATGTGGA AATGTTAAAA ACTGATGATG 421 TACGTTATTC TCATGGCATA ACTTTCCTAT TCTAAATCTA GAAAGCTCAC TGACTTTCCT 481 AATCCATATT TGGAAACCTT CGTAATCACA AATTGGCAGG TCCACTAACT TGACTTCCAA 541 AAACCATGTT GTTAGGAAAG AATTATTCTT TCTTATGCAT GTCATTGGTG TGTGCTTGCA 601 TATACCCATA CTTAGTA Predicted gene structure (within gDNA segment 28456 to 32161): Exon 1 31046 31384 ( 339 n); cDNA 2 340 ( 339 n); score: 0.836 MATCH C01HBa0088L02.1+ SGN-E235464+ 0.836 339 0.549 C PGS_C01HBa0088L02.1+_SGN-E235464+ (31046 31384) Alignment (genomic DNA sequence = upper lines): ATAAAGAAAT GAATGATACC AAATGTGTTG GGATAGGATA ATCAAGAGGT GAGCTAGATT 31105 |||| ||||| |||||||| | ||| |||| |||||||||| |||| |||| ||| |||||| ATAATGAAAT GAATGATATC AAAGTTGTTT GGATAGGATA ATCACAAGGT GAGTTAGATT 61 AAGGTAATGA CATTAGGTTA TTCCTGATCA TTGCACAACA AACCCGATGA AAGCCTTAAA 31165 | ||||||| |||||||| | ||| | ||| |||||||| |||| |||| ||| || ||| CAAGTAATGA CATTAGGTCA TTCTTAGTCA TTGCACAATG AACCTAATGA AAGTCTCAAA 121 CTACATCCTA GGTATAGCTG GTGTTCTCAC TAGCCTATGA ATGAATTGAA ATGAAATACG 31225 |||||||||| ||||||| | ||||| ||| | |||||||| ||||| |||| ||| | |||| CTACATCCTA GGTATAGTTT GTGTTTACAC TGGCCTATGA ATGAAATGAA ATGTAGTACG 181 TATGAAGAAA TGAAGCAGAC TCTGTGTTTG CTAAAGAAGG CTCCCTAGTT GAGGTCCCAT 31285 |||||| || ||||||| | | |||||||| |||| |||| |||||||||| |||||||||| TATGAATGAA AGAAGCAGGC TATGTGTTTG CTAATGAAGA CTCCCTAGTT GAGGTCCCAT 241 ATGTTGAGCC CTCATTT-TG GAAAGTCTTA AGGTTAAGTC TATGATAATA AGGTCTCATG 31344 ||||||||| ||||||| || | || ||||| | |||||||| ||||| | |||||||||| TTGTTGAGCC CTCATTTCTG GGAATTCTTA ATGTTAAGTC CATGATTCAA AGGTCTCATG 301 GTATATGAAT CAATAATATG AAAGAAACTA TGTGTTATAT 31384 | ||||| || ||| |||| |||||| | |||| || || GCATATG-AT AAATGATATT AAAGAAGTGA TGTGCTACAT 340 hqPGS_C01HBa0088L02.1+_SGN-E235464+ (31046 31384) ******************************************************************************** EST sequence 148 -strand 715 n (File: SGN-E389503-) 1 CAAACTACAT CCTAGGTATA GTTTGTGTTT ACACTGGCCT ATGAATGAAA TGAAATGTAG 61 TACGTATGAA TGAAAGAAGC AGGCTATGTG TTTGCTAATG AAGACTCCCT AGTTGAGGTC 121 CCATTTGTTG AGCCCTCATT TCTGGGAATT CTTAATGTTA AGTCCATGAT TCAAAGGTCT 181 CATGGCATAT GATAAATGAT ATTAAAGAAG TGATGTGCTA CATGCAAATT GTATTTTATG 241 CCATATCATA TGTGCTATGT GTAAATGTTA TGTGCTATGT GGAAATGTTA AAAACTGATG 301 ATGTACGTTA TTCTCATGGC ATAACTTTCC TATTCTAAAT CTAGAAAGCT CACTGACTTT 361 CCTAATCCAT ATTTGGAAAC CTTCGTAATC ACAAATTGGC AGGTCCACTA ACTTGACTTC 421 CAAAAACCAT GTTGTTAGGA AAGAATTATT CTTTCTTATG CATGTCATTG GTGTGTGCTT 481 GCATATACCC ATACTTAGTA CAAGTGTGTA CTAACCCTAT ACAAACTCTA CTATTTTAGG 541 TGCAACCACA ACTGGACGAA TGAACTAAAG GATCTTCGCT GCAGTTATTC GGACGTTTAG 601 CATTCAACCG GCTTTGGTAG GTCCTCATGA TTTCGAGGAT GCTGTTGTTT TATATTCTAG 661 CTTAGTTTTA GAGTTGATGT AGTGGATCAT GTTCCACTAG TGTTTCCTTC CTATT Predicted gene structure (within gDNA segment 29616 to 34175): Exon 1 31429 31764 ( 336 n); cDNA 378 715 ( 338 n); score: 0.810 MATCH C01HBa0088L02.1+ SGN-E389503- 0.810 336 0.470 C PGS_C01HBa0088L02.1+_SGN-E389503- (31429 31764) Alignment (genomic DNA sequence = upper lines): AACTTTCTCA ATCTCAATTT AGCAAGTCCA CTGACTTGAC TTCCAAACAT CATGTTGTTA 31488 ||| ||| | ||| ||| || ||| ||||| || ||||||| ||||||| | |||||||||| AACCTTCGTA ATCACAAATT GGCAGGTCCA CTAACTTGAC TTCCAAAAAC CATGTTGTTA 437 GGAAAGAGCT CTTCTTCCTC ATGCATGTCC CTGGTGTGTG CTTGCATATA CCCATACTTA 31548 ||||||| | ||||| || ||||||||| ||||||||| |||||||||| |||||||||| GGAAAGAATT ATTCTTTCTT ATGCATGTCA TTGGTGTGTG CTTGCATATA CCCATACTTA 497 GTACAAGTGT GTACTAATTC CATACAAACA TCTAC-A-TT TAGGTGTAGG CACAGGTGTA 31606 |||||||||| ||||||| | |||||||| ||||| | || |||||| | |||| || | GTACAAGTGT GTACTAACCC TATACAAAC- TCTACTATTT TAGGTGCAAC CACAACTGGA 556 CGGTAGAGCT ACAGGTTCGT TGTTGCAGCT ATCCGGACG- TCAGCATTCA TCCGGAGTTT 31665 || || || | ||| || | | ||||| | || |||||| | |||||||| |||| ||| CGAATGAACT AAAGGATCTT CGCTGCAGTT ATTCGGACGT TTAGCATTCA ACCGG-CTTT 615 GGTAGGTCCT CATGCCTTCG AGGATGCTAC TGTTTTACAT TCTAGCGTAG -TTTAGAGTT 31724 |||||||||| |||| |||| |||||||| ||||||| || |||||| ||| ||||||||| GGTAGGTCCT CATGATTTCG AGGATGCTGT TGTTTTATAT TCTAGCTTAG TTTTAGAGTT 675 GAGCTAGTGG AGCATGTTCC ACTAGCGTTT CTTTCCTGTT 31764 || |||||| | |||||||| ||||| |||| | ||||| || GATGTAGTGG ATCATGTTCC ACTAGTGTTT CCTTCCTATT 715 hqPGS_C01HBa0088L02.1+_SGN-E389503- (31429 31764) ******************************************************************************** EST sequence 167 -strand 383 n (File: SGN-E217225-) 1 AATCGTGATC AAGTTATAGA GGGGATGGAT TTAGTTGTGA TGAACCAGGG CGTAGACGGA 61 AGGATATTTG GTATTTGGTA AAGAAAACTC GGGTTCAAGG GAAGATAGGT GCAAGCACAG 121 GTGGACGCTA GAGCTACAGG TTCGTTGTTG CAGCTATCCG GACATCAGTA TTCATCCGGA 181 GTTTGGTAGG TCCTCATGCT TTCGAGGATG CTACCGTTTT ACATTCTAGC GTAGTTTTAG 241 AGTTGAGCTA GCGGAGCATG TTCCACTAGC GTTTCTTTCC TGTTTTGGTT CAAACTTTGT 301 ATTGGCGCTA TTTTGGCCGA TATACAAGTA ATACTTAATG AATTATTTCT TTCAGTTGCT 361 TAAAAAAAAA AAAAAAAAAA AAA Predicted gene structure (within gDNA segment 29720 to 32652): Exon 1 31590 31841 ( 252 n); cDNA 109 361 ( 253 n); score: 0.935 PPA cDNA 362 383 MATCH C01HBa0088L02.1+ SGN-E217225- 0.935 252 0.658 C PGS_C01HBa0088L02.1+_SGN-E217225- (31590 31841) Alignment (genomic DNA sequence = upper lines): GTGTAGGCAC AGGTGTACGG TAGAGCTACA GGTTCGTTGT TGCAGCTATC CGGACGTCAG 31649 ||| | |||| ||||| ||| |||||||||| |||||||||| |||||||||| ||||| |||| GTGCAAGCAC AGGTGGACGC TAGAGCTACA GGTTCGTTGT TGCAGCTATC CGGACATCAG 168 CATTCATCCG GAGTTTGGTA GGTCCTCATG CCTTCGAGGA TGCTACTGTT TTACATTCTA 31709 ||||||||| |||||||||| |||||||||| | |||||||| |||||| ||| |||||||||| TATTCATCCG GAGTTTGGTA GGTCCTCATG CTTTCGAGGA TGCTACCGTT TTACATTCTA 228 GCGTAG-TTT AGAGTTGAGC TAGTGGAGCA TGTTCCACTA GCGTTTCTTT CCTGTTTTGG 31768 |||||| ||| |||||||||| ||| |||||| |||||||||| |||||||||| |||||||||| GCGTAGTTTT AGAGTTGAGC TAGCGGAGCA TGTTCCACTA GCGTTTCTTT CCTGTTTTGG 288 TTCAGACTTT GTATTGGGGT TATTTTGACC GATATACAAT TAATACTTAA TGAATTATTT 31828 |||| ||||| ||||||| | ||||||| || ||||||||| |||||||||| |||||||||| TTCAAACTTT GTATTGGCGC TATTTTGGCC GATATACAAG TAATACTTAA TGAATTATTT 348 CTTTCAGTTG CTT 31841 |||||||||| ||| CTTTCAGTTG CTT 361 hqPGS_C01HBa0088L02.1+_SGN-E217225- (31590 31841) ******************************************************************************** EST sequence 266 -strand 392 n (File: SGN-E222944-) 1 GGCACGAGGA ATCGTGATCA AGTTATAGAG GGAATGAATT TAGTTGTGAT GAACCAGGGC 61 GTAGACGAAA GGATATTTGG TATTTGGTAA AGAAAACTCG GGTTCAAGGG AAGATAGGTG 121 CAAGCACAGG TGGACGCTAA AGCTACAGGT TCGTTGTTGC AGCAATCCGG ACATCAGTAT 181 TCATCCGGAG TTTGGTAGGT CCTCATGCTT TCGAGGATGC TACCGTTTTA CATTCTAGCG 241 TAGTTTTAGA GTTGAGCTAG CGGAGCATGT TCCACTAGCG TTTCTTTCCT GTTTTGGTTC 301 AAACTTTGTA TTGGCGCTAT TTTGGCCGAT ATACAAGTAA TACTTCATGA ATTATTTCTT 361 TCAGTTGCTT AGAAGATAAA AAAAAAAAAA AA Predicted gene structure (within gDNA segment 29603 to 33282): Exon 1 31590 31841 ( 252 n); cDNA 118 370 ( 253 n); score: 0.923 PPA cDNA 376 392 MATCH C01HBa0088L02.1+ SGN-E222944- 0.923 252 0.643 C PGS_C01HBa0088L02.1+_SGN-E222944- (31590 31841) Alignment (genomic DNA sequence = upper lines): GTGTAGGCAC AGGTGTACGG TAGAGCTACA GGTTCGTTGT TGCAGCTATC CGGACGTCAG 31649 ||| | |||| ||||| ||| || ||||||| |||||||||| |||||| ||| ||||| |||| GTGCAAGCAC AGGTGGACGC TAAAGCTACA GGTTCGTTGT TGCAGCAATC CGGACATCAG 177 CATTCATCCG GAGTTTGGTA GGTCCTCATG CCTTCGAGGA TGCTACTGTT TTACATTCTA 31709 ||||||||| |||||||||| |||||||||| | |||||||| |||||| ||| |||||||||| TATTCATCCG GAGTTTGGTA GGTCCTCATG CTTTCGAGGA TGCTACCGTT TTACATTCTA 237 GCGTAG-TTT AGAGTTGAGC TAGTGGAGCA TGTTCCACTA GCGTTTCTTT CCTGTTTTGG 31768 |||||| ||| |||||||||| ||| |||||| |||||||||| |||||||||| |||||||||| GCGTAGTTTT AGAGTTGAGC TAGCGGAGCA TGTTCCACTA GCGTTTCTTT CCTGTTTTGG 297 TTCAGACTTT GTATTGGGGT TATTTTGACC GATATACAAT TAATACTTAA TGAATTATTT 31828 |||| ||||| ||||||| | ||||||| || ||||||||| |||||||| | |||||||||| TTCAAACTTT GTATTGGCGC TATTTTGGCC GATATACAAG TAATACTTCA TGAATTATTT 357 CTTTCAGTTG CTT 31841 |||||||||| ||| CTTTCAGTTG CTT 370 hqPGS_C01HBa0088L02.1+_SGN-E222944- (31590 31841) ******************************************************************************** EST sequence 268 -strand 289 n (File: SGN-E223449-) 1 TCAAGGGAAG ATAGGTGCAA GCACAGGTGG ACGCTAAAGC TACAGGTTCG TTGTTGCAGC 61 TATCCGGACA TCAGTATTCA TCCGGAGTTT GGTAGGTCCT CATGCTTTCG AGGATGCTAC 121 CGTTTTACAT TCTAGCGTAG TTTTAGAGTT GAGCTAGCGG AGCATGTTCC ACTAGCGTTT 181 CTTTCCTGTT TTGGTTCAAA CTTTGTATTG GCGCTATTTT GGCCGATATA CAAGTAATAC 241 TTAATGAATT ATTTCTTTCA GTTGCTTAAA AAAAAAAAAA AAAAAAAAA Predicted gene structure (within gDNA segment 30633 to 32652): Exon 1 31590 31841 ( 252 n); cDNA 15 267 ( 253 n); score: 0.931 PPA cDNA 268 289 MATCH C01HBa0088L02.1+ SGN-E223449- 0.931 252 0.872 C PGS_C01HBa0088L02.1+_SGN-E223449- (31590 31841) Alignment (genomic DNA sequence = upper lines): GTGTAGGCAC AGGTGTACGG TAGAGCTACA GGTTCGTTGT TGCAGCTATC CGGACGTCAG 31649 ||| | |||| ||||| ||| || ||||||| |||||||||| |||||||||| ||||| |||| GTGCAAGCAC AGGTGGACGC TAAAGCTACA GGTTCGTTGT TGCAGCTATC CGGACATCAG 74 CATTCATCCG GAGTTTGGTA GGTCCTCATG CCTTCGAGGA TGCTACTGTT TTACATTCTA 31709 ||||||||| |||||||||| |||||||||| | |||||||| |||||| ||| |||||||||| TATTCATCCG GAGTTTGGTA GGTCCTCATG CTTTCGAGGA TGCTACCGTT TTACATTCTA 134 GCGTAG-TTT AGAGTTGAGC TAGTGGAGCA TGTTCCACTA GCGTTTCTTT CCTGTTTTGG 31768 |||||| ||| |||||||||| ||| |||||| |||||||||| |||||||||| |||||||||| GCGTAGTTTT AGAGTTGAGC TAGCGGAGCA TGTTCCACTA GCGTTTCTTT CCTGTTTTGG 194 TTCAGACTTT GTATTGGGGT TATTTTGACC GATATACAAT TAATACTTAA TGAATTATTT 31828 |||| ||||| ||||||| | ||||||| || ||||||||| |||||||||| |||||||||| TTCAAACTTT GTATTGGCGC TATTTTGGCC GATATACAAG TAATACTTAA TGAATTATTT 254 CTTTCAGTTG CTT 31841 |||||||||| ||| CTTTCAGTTG CTT 267 hqPGS_C01HBa0088L02.1+_SGN-E223449- (31590 31841) ******************************************************************************** EST sequence 102 +strand 806 n (File: SGN-E546254+) 1 CGGGCCCCCC TCGAGTTTTT TTTTTTTTTT TTTTATCTCT TAAATGTTAG ATGGTTGATG 61 ATGAACGATT ATGAAATGTT AAGAATATTC AGCAAGTATG ATTAAAGAAT CAAAAAAAAA 121 AATTCAAATT TTTCGCTAAA ATTTATCTAT GTAAAGTAAG AATGACGTAA GTAGGCTTGT 181 CTGCGACCTC TGAGAGGTCA ACGACGCCGG TCTCGTCTGG GGTCTAGATT CCGGTCGTGA 241 CAGAGGTAAC ACCAAACCAT CCGGGGGGAC ATACGAGGGT GTTCTTAATT AATAACTCCA 301 ACGAATCTGG AGTTAGCACA ACCGTTTCCG CCACACGACT GCCATTGTTG TAAAGCTTAA 361 TCCTAGGTGC TACTTTAATT TTCTCTGCTG TAGCGATCGC TGGACTCTGT TTCACGTCCA 421 CCTCGAGAAA AGTTACTGAA GGATATTCGG CGTTCAAGGT ATCCATGATA TAGGACATCC 481 ACGTGCTTTC TGGGTTGGAT AATTCATCAA AATAGACCAC AGATTGACCA GATGCAATCG 541 CAGCCCGGAA CTTGTCAAGA TCTGAAATCA ACTCCACCAT GAAATTACCT TTTCTGCGTG 601 ACTTCCTTAA TTCAGCTCGG GCATGGGATA AATTTTCAGC AACCACTTTG TTACTTGGAA 661 GTTGCTGCCG CAGAAACTCA TAATCGCTCA CAGCATCAGC CCATCTTTCC AGCTTGATAC 721 TTGAGGCAGC TTTTCGATAA AGAGCTTTAG TATATTGTGG CCGGATAAGG AGAGCGCGAA 781 TGCTATCAGC CCGAGATTCT TCCCAC Predicted gene structure (within gDNA segment 29889 to 38384): Exon 1 31836 32043 ( 208 n); cDNA 29 241 ( 213 n); score: 0.844 PPA cDNA 28 15 MATCH C01HBa0088L02.1+ SGN-E546254+ 0.844 208 0.258 C PGS_C01HBa0088L02.1+_SGN-E546254+ (31836 32043) Alignment (genomic DNA sequence = upper lines): TTGCTTATCT CTTAATTGTT AGATGGTTGA TGATGAACGA TTACGAAATA TAAAGAATGT 31895 || |||||| ||||| |||| |||||||||| |||||||||| ||| ||||| | |||||| | TTTTTTATCT CTTAAATGTT AGATGGTTGA TGATGAACGA TTATGAAATG TTAAGAATAT 88 TTAACAAGTA TGATTAATGA ATCAAAAATT ----TT-AAA TTTTCCGCTA AAATAAACCT 31950 | | |||||| ||||||| || |||||||| || ||| |||| ||||| |||| | || TCAGCAAGTA TGATTAAAGA ATCAAAAAAA AAAATTCAAA TTTTTCGCTA AAATTTATCT 148 ATGTAAAGTA AGAATGACGT AAGTAGGCTT GTTTGCGGCC TCTGAGAGGT CAACGACGCC 32010 |||||||||| |||||||||| |||||||||| || |||| || |||||||||| |||||||||| ATGTAAAGTA AGAATGACGT AAGTAGGCTT GTCTGCGACC TCTGAGAGGT CAACGACGCC 208 GGTCTTGTCT GGGGTCTAGA TTCCAGTCGT GAC 32043 ||||| |||| |||||||||| |||| ||||| ||| GGTCTCGTCT GGGGTCTAGA TTCCGGTCGT GAC 241 hqPGS_C01HBa0088L02.1+_SGN-E546254+ (31836 32043) ******************************************************************************** EST sequence 65 +strand 548 n (File: SGN-E378094+) 1 TTTTTTTTTT TGGATTAGGA GACTAATTCA AGAATTAGTC AAATAACATT AAAATAAATA 61 AATACAAATC TGTTTTATTT ATTTATTTAT TTATTCATTT AAAACGTGAA AGGACAATTA 121 TGCCCTTAAA TACCTATTTA TTCTTATTTA CATAATTCTC TTCTTTTTTT TTGAATCGTT 181 ACAAATTAAC CTATGTAAAG TAAGAATGAC GTAAGTAGGC TTGTTTGCGA CTTCTGAGAG 241 GTCAACGACG CCGGTCTCAT ATGGGGTCTG AATTCCAGGA TCAGAAATAA TGCATAGAGA 301 AACGACCACT TCCTTCCTTA TGAGACGTCA AGATTAGACC AAGTTTTTTT TCCCCTTCAT 361 TCATCAGTGA AACCGTGAAA CCGTAAGGAA ATGTAGCAAG ACCATTAAGT GTTGTCTAAT 421 TTTAGAATCA CCTCTATACA TAAATTATAA TCCGATTCTC ACCGTTGAAT AAACAATCAA 481 AATGGAGTGA GTTTGACTAC TCTTTATTTC AATCAAGTCT AGTGAATGGA TATTAGACTC 541 GGGGAGCT Predicted gene structure (within gDNA segment 29476 to 35535): Exon 1 31836 31857 ( 22 n); cDNA 161 182 ( 22 n); score: 0.636 Intron 1 31858 31940 ( 83 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.94) Exon 2 31941 32035 ( 95 n); cDNA 183 277 ( 95 n); score: 0.916 PPA cDNA 11 1 MATCH C01HBa0088L02.1+ SGN-E378094+ 0.916 117 0.214 C PGS_C01HBa0088L02.1+_SGN-E378094+ (31836 31857,31941 32035) Alignment (genomic DNA sequence = upper lines): TTGCTTATCT CTTAATTGTT AGATGGTTGA TGATGAACGA TTACGAAATA TAAAGAATGT 31895 || || | | | ||| ||| | TTCTTTTTTT TTGAATCGTT AC........ .......... .......... .......... 182 TTAACAAGTA TGATTAATGA ATCAAAAATT TTAAATTTTC CGCTAAAATA AACCTATGTA 31955 |||| |||||||||| .......... .......... .......... .......... .....AAATT AACCTATGTA 197 AAGTAAGAAT GACGTAAGTA GGCTTGTTTG CGGCCTCTGA GAGGTCAACG ACGCCGGTCT 32015 |||||||||| |||||||||| |||||||||| || | ||||| |||||||||| |||||||||| AAGTAAGAAT GACGTAAGTA GGCTTGTTTG CGACTTCTGA GAGGTCAACG ACGCCGGTCT 257 TGTCTGGGGT CTAGATTCCA 32035 | |||||| || |||||| CATATGGGGT CTGAATTCCA 277 hqPGS_C01HBa0088L02.1+_SGN-E378094+ (31941 32035) ******************************************************************************** EST sequence 83 +strand 598 n (File: SGN-E227035+) 1 TTTTTTTTTT TGGATTAGGA GACTAATTCA AGAATTAGTC AAATAACATT AAAATAAATA 61 AATACAAATC TGTTTTATTT ATTTATTTAT TTATTCATTT AAAACGTGAA AGGACAATTA 121 TGCCCTTAAA TACCTATTTA TTCTTATTTA CATAATTCTC TTCTTTTTTT TTGAATCGTT 181 ACAAATTAAC CTATGTAAAG TAAGAATGAC GTAAGTAGGC TTGTTTGCGA CTTCTGAGAG 241 GTCAACGACG CCGGTCTCAT ATGGGGTCTG AATTCCAGGA TCAGAAATAA TGCATAGAGA 301 AACGACCACT TCCTTCCTTA TGAGACGTCA AGATTAGACC AAGTTTTTTT TCCCCTTCAT 361 TCATCAGTGA AACCGTGAAA CCGTAAGGAA ATGTAGCAAG ACCATTAAGT GTTGTCTAAT 421 TTTAGAATCA CCTCTATACA TAAATTATAA TCCGATTCTC ACCGTTGAAT AAACAATCAA 481 AATGGAGTGA GTTTGACTAC TCTTTATTTC AATCAAGTCT AGTGAATGGA TATTAGACTC 541 GGGAGCTTCA GAACATTTAT CTTCTAATCC TGAGCTTTTC ACTTACCTTA CTCCTTTT Predicted gene structure (within gDNA segment 29476 to 36035): Exon 1 31836 31857 ( 22 n); cDNA 161 182 ( 22 n); score: 0.636 Intron 1 31858 31940 ( 83 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.94) Exon 2 31941 32035 ( 95 n); cDNA 183 277 ( 95 n); score: 0.916 PPA cDNA 11 1 MATCH C01HBa0088L02.1+ SGN-E227035+ 0.916 117 0.196 C PGS_C01HBa0088L02.1+_SGN-E227035+ (31836 31857,31941 32035) Alignment (genomic DNA sequence = upper lines): TTGCTTATCT CTTAATTGTT AGATGGTTGA TGATGAACGA TTACGAAATA TAAAGAATGT 31895 || || | | | ||| ||| | TTCTTTTTTT TTGAATCGTT AC........ .......... .......... .......... 182 TTAACAAGTA TGATTAATGA ATCAAAAATT TTAAATTTTC CGCTAAAATA AACCTATGTA 31955 |||| |||||||||| .......... .......... .......... .......... .....AAATT AACCTATGTA 197 AAGTAAGAAT GACGTAAGTA GGCTTGTTTG CGGCCTCTGA GAGGTCAACG ACGCCGGTCT 32015 |||||||||| |||||||||| |||||||||| || | ||||| |||||||||| |||||||||| AAGTAAGAAT GACGTAAGTA GGCTTGTTTG CGACTTCTGA GAGGTCAACG ACGCCGGTCT 257 TGTCTGGGGT CTAGATTCCA 32035 | |||||| || |||||| CATATGGGGT CTGAATTCCA 277 hqPGS_C01HBa0088L02.1+_SGN-E227035+ (31941 32035) ******************************************************************************** EST sequence 44 +strand 535 n (File: SGN-E392260+) 1 TTTTTTTTTT TTGGATTAGT AGACTAGCCC CAGAATTAGC CAGATAACCT TAAAAACTAT 61 TTATACTAAT CTGTTTTATT GATTTATTTA ATTATTCATT GTAAACGTGA AAGGACAATG 121 TGGCCCTTAA ATACCTATTT ATTCTTATTT ACATAATTCT CTTCTTTTTT TTTGAATCGT 181 TACTAATTAA CCTATGTAAA GTAAGAATGA CGTAAGTAGG CTTGTTTGCG ACTTCTGATA 241 GGTCAACGAC GCCGGTCTCA TATGGGGTCT GAATTCCAGG ATCAGAAATA ATGCATAGAG 301 AAACGACCAC TTCCTTCCTT ATGAGACGTC CAGATTAGAC CAAGTTTTTT TTCCCCTTCA 361 TTCATCAGTG AAACCGTGAA ACCGTAAGGA AATGTAGCAA GACCATTAAG TGTTGTCTAA 421 TTTTAGAATC ACCTCTATAC ATAAATTATA ATCCGATTCT CACCGGTGAG TAAACAATCA 481 AAATGGAGTG AGTTTGACTA CTCTTTATTT CCATCAAGTC TAGTGAATGG ATATT Predicted gene structure (within gDNA segment 29466 to 35395): Exon 1 31942 32035 ( 94 n); cDNA 185 278 ( 94 n); score: 0.904 PPA cDNA 12 1 MATCH C01HBa0088L02.1+ SGN-E392260+ 0.904 94 0.176 C PGS_C01HBa0088L02.1+_SGN-E392260+ (31942 32035) Alignment (genomic DNA sequence = upper lines): AATAAACCTA TGTAAAGTAA GAATGACGTA AGTAGGCTTG TTTGCGGCCT CTGAGAGGTC 32001 ||| |||||| |||||||||| |||||||||| |||||||||| |||||| | | |||| ||||| AATTAACCTA TGTAAAGTAA GAATGACGTA AGTAGGCTTG TTTGCGACTT CTGATAGGTC 244 AACGACGCCG GTCTTGTCTG GGGTCTAGAT TCCA 32035 |||||||||| |||| | || |||||| || |||| AACGACGCCG GTCTCATATG GGGTCTGAAT TCCA 278 hqPGS_C01HBa0088L02.1+_SGN-E392260+ (31942 32035) ******************************************************************************** EST sequence 45 +strand 757 n (File: SGN-E542637+) 1 AAGATGTCAG GAGGGAAATT CAGATAATGC ACCATTTGGC TGGTCACAAA AACATCGTTT 61 CCATCAAGGG TGCTTATGAG GATCCTTTGT ATGTTCATAT TGTCATGGAA CTTTGTGGTG 121 GCGGTGAATT GTTTGACCGC ATAATTCAAA GAGGACACTA CACCGAGAGA AAGGCTGCCG 181 ATTTGACTAA AATTATTGTG GGTGTTGTTG AGGCATGCCA TTCACTTGGA GTTATGCATA 241 GAGATCTCAA ACCTGAGAAT TTCTTGTTGG TTAACAAGGA TGATGATTTC TCTCTCAAGG 301 CCATTGATTT TGGACTCTCT GTATTCTTTA AGCCAGGCCA AATTTTCACA GATGTTGTTG 361 GGAGTCCATA CTACGTTGCT CCTGAGGTGC TTTTGAAGCA TTATGGTCCA GAAGCAGATG 421 TTTGGACAGC AGGGGTCATA CTCTATATCC TGCTAAGTGG AGTTCCACCA TTCTGGGCTG 481 AAACACAGCA GGGGATATTT GATGCAGTTC TGAAAGGGCA CATTGATTTT GACTCAGATC 541 CTTGGCCTCT AATATCAGAG AGTGCAAAGG ATCTCATCCG GAAGATGTTA TGCATGCGAC 601 CCCCAGAGCG GTTAACTGCT CATGAAGTAT TATGTCATCC TTGGATTTGT GAAAATGGTG 661 TTGCTCCTGA TAGAGCACTT GATCCTGCTG TACTTTCTCG CCTCAAACAC TTTTCTGNCA 721 TGAACAAATT AAAAAAGATG GCTCTGCGGG TGATTGC Predicted gene structure (within gDNA segment 39204 to 42080): Exon 1 39804 40139 ( 336 n); cDNA 1 336 ( 336 n); score: 1.000 Intron 1 40140 40386 ( 247 n); Pd: 1.000 (s: 1.00), Pa: 0.998 (s: 1.00) Exon 2 40387 40530 ( 144 n); cDNA 337 480 ( 144 n); score: 1.000 Intron 2 40531 40608 ( 78 n); Pd: 0.992 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 3 40609 40761 ( 153 n); cDNA 481 633 ( 153 n); score: 1.000 Intron 3 40762 41292 ( 531 n); Pd: 0.979 (s: 1.00), Pa: 0.998 (s: 1.00) Exon 4 41293 41408 ( 116 n); cDNA 634 749 ( 116 n); score: 0.983 Intron 4 41409 41728 ( 320 n); Pd: 0.909 (s: 0.96), Pa: 1.000 (s: 0) Exon 5 41729 41736 ( 8 n); cDNA 750 757 ( 8 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E542637+ 0.997 757 1.000 C PGS_C01HBa0088L02.1+_SGN-E542637+ (39804 40139,40387 40530,40609 40761,41293 41408,41729 41736) Alignment (genomic DNA sequence = upper lines): AAGATGTCAG GAGGGAAATT CAGATAATGC ACCATTTGGC TGGTCACAAA AACATCGTTT 39863 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAGATGTCAG GAGGGAAATT CAGATAATGC ACCATTTGGC TGGTCACAAA AACATCGTTT 60 CCATCAAGGG TGCTTATGAG GATCCTTTGT ATGTTCATAT TGTCATGGAA CTTTGTGGTG 39923 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCATCAAGGG TGCTTATGAG GATCCTTTGT ATGTTCATAT TGTCATGGAA CTTTGTGGTG 120 GCGGTGAATT GTTTGACCGC ATAATTCAAA GAGGACACTA CACCGAGAGA AAGGCTGCCG 39983 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCGGTGAATT GTTTGACCGC ATAATTCAAA GAGGACACTA CACCGAGAGA AAGGCTGCCG 180 ATTTGACTAA AATTATTGTG GGTGTTGTTG AGGCATGCCA TTCACTTGGA GTTATGCATA 40043 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATTTGACTAA AATTATTGTG GGTGTTGTTG AGGCATGCCA TTCACTTGGA GTTATGCATA 240 GAGATCTCAA ACCTGAGAAT TTCTTGTTGG TTAACAAGGA TGATGATTTC TCTCTCAAGG 40103 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAGATCTCAA ACCTGAGAAT TTCTTGTTGG TTAACAAGGA TGATGATTTC TCTCTCAAGG 300 CCATTGATTT TGGACTCTCT GTATTCTTTA AGCCAGGTAA ATCTCTTACT TTCTTCTGTT 40163 |||||||||| |||||||||| |||||||||| |||||| CCATTGATTT TGGACTCTCT GTATTCTTTA AGCCAG.... .......... .......... 336 TTTTTACATT CTAGCTTCTA GTGCAGCTAG ACGGACATAT TACGGCTCTG TGTAGTTGTT 40223 .......... .......... .......... .......... .......... .......... 336 CATGCTCATG CTGGTAGGCT ACTACTAATG AAGTATGATC TTGGAGATTC TTTTTATGCA 40283 .......... .......... .......... .......... .......... .......... 336 CCAACTCTCT ATCTAGATGA ATAGTTAGCT ACTTTTAACA TTGATTTGGT GGCTCCTTAA 40343 .......... .......... .......... .......... .......... .......... 336 ATTGGTATGT TGGTTTGATG GATTTTGTTG CTTGCTTCTT CAGGCCAAAT TTTCACAGAT 40403 ||||||| |||||||||| .......... .......... .......... .......... ...GCCAAAT TTTCACAGAT 353 GTTGTTGGGA GTCCATACTA CGTTGCTCCT GAGGTGCTTT TGAAGCATTA TGGTCCAGAA 40463 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTGTTGGGA GTCCATACTA CGTTGCTCCT GAGGTGCTTT TGAAGCATTA TGGTCCAGAA 413 GCAGATGTTT GGACAGCAGG GGTCATACTC TATATCCTGC TAAGTGGAGT TCCACCATTC 40523 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCAGATGTTT GGACAGCAGG GGTCATACTC TATATCCTGC TAAGTGGAGT TCCACCATTC 473 TGGGCTGGTA TGTTTATAAT TTTATGCAGT ATAGCTGTAA CTTTTCTGAT TTTTGTCTTT 40583 ||||||| TGGGCTG... .......... .......... .......... .......... .......... 480 TTAACTTACC ATCTAAATTG TTCAGAAACA CAGCAGGGGA TATTTGATGC AGTTCTGAAA 40643 ||||| |||||||||| |||||||||| |||||||||| .......... .......... .....AAACA CAGCAGGGGA TATTTGATGC AGTTCTGAAA 515 GGGCACATTG ATTTTGACTC AGATCCTTGG CCTCTAATAT CAGAGAGTGC AAAGGATCTC 40703 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGGCACATTG ATTTTGACTC AGATCCTTGG CCTCTAATAT CAGAGAGTGC AAAGGATCTC 575 ATCCGGAAGA TGTTATGCAT GCGACCCCCA GAGCGGTTAA CTGCTCATGA AGTATTATGT 40763 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||| ATCCGGAAGA TGTTATGCAT GCGACCCCCA GAGCGGTTAA CTGCTCATGA AGTATTAT.. 633 AAGTTTATTT ACCTTATAAG TCATATTGAC CTAACATTTT TACTGGTTAC TGAATGGATC 40823 .......... .......... .......... .......... .......... .......... 633 ATTTTTTTCT CCCATGATAT AAATATGGTT TTGCTTGTTT AATAGTTGTT ATATCAAGAG 40883 .......... .......... .......... .......... .......... .......... 633 ATACTGTGTT GTGACAGTGT TGATGTTCTG TCAGACTTAT AAGAACCCTC TTAACTTTTT 40943 .......... .......... .......... .......... .......... .......... 633 TCTGGACTGT GCTTCTGGTG GCAGAACATT GAGAACCTTA TTGACTACTA ATTTATGTAA 41003 .......... .......... .......... .......... .......... .......... 633 AAAACTGTTA GTTTAGCAGT AGAGAGGAGT TTCTCATGCT TGAACTATAA CTTGTTAGGT 41063 .......... .......... .......... .......... .......... .......... 633 TATCTATGAG CCCTTTGGAA ATATCAGGTT TATTTTCTGT ATTTCTGGTT TAAAAAATAA 41123 .......... .......... .......... .......... .......... .......... 633 ATTTGGATTG ACTACAAGCT GTAATAGATC AATTTGCACT GCATAAAGTG GATCAAGTCA 41183 .......... .......... .......... .......... .......... .......... 633 TTGTATTTCT CAAATTTCAA TTGTATTGTC TATCTATGCC TGCTTGTATG GTGTCTTTCA 41243 .......... .......... .......... .......... .......... .......... 633 TGTAACCAGC TGCTGTTCTG GTGTTATGGT TTCCTCTAAA ATTCTGCAGG TCATCCTTGG 41303 | |||||||||| .......... .......... .......... .......... .........G TCATCCTTGG 644 ATTTGTGAAA ATGGTGTTGC TCCTGATAGA GCACTTGATC CTGCTGTACT TTCTCGCCTC 41363 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATTTGTGAAA ATGGTGTTGC TCCTGATAGA GCACTTGATC CTGCTGTACT TTCTCGCCTC 704 AAACACTTTT CTGCAATGAA CAAATTAAAA AAGATGGCTC TGCGGGTATG CATATATATA 41423 |||||||||| ||| ||||| |||||||||| |||||||||| ||||| AAACACTTTT CTGNCATGAA CAAATTAAAA AAGATGGCTC TGCGG..... .......... 749 TGTGTGTGTA TATATATCTA GGCATAACTT TTTTGCCCAA GTCTGTTAAT TATGGTTCTT 41483 .......... .......... .......... .......... .......... .......... 749 CAGTGTCCAT AAACCTCATT ATTAAAGTTA CACAAGAAAA TGCTGATTAT GTCCTTTGGG 41543 .......... .......... .......... .......... .......... .......... 749 CTAAGTTGTG TGGACTCTTC AGTTTCGATG GCGCACCAGT GTCGGATTCT CCAAAAATAC 41603 .......... .......... .......... .......... .......... .......... 749 ACTCCTTATG GAGAAGCCGA CACACACCCA TTGACATTTT TGAAGCGTCC AAGCAACATA 41663 .......... .......... .......... .......... .......... .......... 749 GCTTCTTGGA GGTGTGTAAC CAAATGATGC AATTATTGAT GTTTTCATAC TTAATATGCA 41723 .......... .......... .......... .......... .......... .......... 749 TTTAGGTGAT TGC 41736 ||||| ||| .....GTGAT TGC 757 hqPGS_C01HBa0088L02.1+_SGN-E542637+ (39804 40139,40387 40530,40609 40761,41293 41408) ******************************************************************************** EST sequence 103 +strand 534 n (File: SGN-E301516+) 1 AGATGTCAGG AGGGAAATTC AGATAATGCA CCATTTGGCT GGTCACAAAA ACATCGTTTC 61 CATCAAGGGT GCTTATGAGG ATCCTTTGTA TGTTCATATT GTCATGGAAC TTTGTGGTGG 121 CGGTGAATTG TTTGACCGCA TAATTCAAAG AGGACACTAC ACCGAGAGAA AGGCTGCCGA 181 TTTGACTAAA ATTATTGTGG GTGTTGTTGA GGCATGCCAT TCACTTGGAG TTATGCATAG 241 AGATCTCAAA CCTGAGAATT TCTTGTTGGT TAACAAGGAT GATGATTTCT CTCTCAAGGC 301 CATTGATTTT GGACTCTCTG TATTCTTTAA GCCAGGCCAA ATTTTCACAG ATGTTGTTGG 361 GAGTCCATAC TACGTTGCTC CTGAGGTGCT TTTGAAGCAT TATGGTCCAG AAGCAGATGT 421 TTGGACAGCA GGGGTCATAC TCTATATCCT GCTAAGTGGA GTTCCACCAT TCTGGGCTGA 481 AACACAGCAG GGGATATTTG ATGCAGTTCT GAAAGGGCAC ATTGATTTTG ACTC Predicted gene structure (within gDNA segment 39205 to 41273): Exon 1 39805 40139 ( 335 n); cDNA 1 335 ( 335 n); score: 1.000 Intron 1 40140 40386 ( 247 n); Pd: 1.000 (s: 1.00), Pa: 0.998 (s: 1.00) Exon 2 40387 40530 ( 144 n); cDNA 336 479 ( 144 n); score: 1.000 Intron 2 40531 40608 ( 78 n); Pd: 0.992 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 3 40609 40663 ( 55 n); cDNA 480 534 ( 55 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E301516+ 1.000 534 1.000 C PGS_C01HBa0088L02.1+_SGN-E301516+ (39805 40139,40387 40530,40609 40663) Alignment (genomic DNA sequence = upper lines): AGATGTCAGG AGGGAAATTC AGATAATGCA CCATTTGGCT GGTCACAAAA ACATCGTTTC 39864 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGATGTCAGG AGGGAAATTC AGATAATGCA CCATTTGGCT GGTCACAAAA ACATCGTTTC 60 CATCAAGGGT GCTTATGAGG ATCCTTTGTA TGTTCATATT GTCATGGAAC TTTGTGGTGG 39924 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CATCAAGGGT GCTTATGAGG ATCCTTTGTA TGTTCATATT GTCATGGAAC TTTGTGGTGG 120 CGGTGAATTG TTTGACCGCA TAATTCAAAG AGGACACTAC ACCGAGAGAA AGGCTGCCGA 39984 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CGGTGAATTG TTTGACCGCA TAATTCAAAG AGGACACTAC ACCGAGAGAA AGGCTGCCGA 180 TTTGACTAAA ATTATTGTGG GTGTTGTTGA GGCATGCCAT TCACTTGGAG TTATGCATAG 40044 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTGACTAAA ATTATTGTGG GTGTTGTTGA GGCATGCCAT TCACTTGGAG TTATGCATAG 240 AGATCTCAAA CCTGAGAATT TCTTGTTGGT TAACAAGGAT GATGATTTCT CTCTCAAGGC 40104 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGATCTCAAA CCTGAGAATT TCTTGTTGGT TAACAAGGAT GATGATTTCT CTCTCAAGGC 300 CATTGATTTT GGACTCTCTG TATTCTTTAA GCCAGGTAAA TCTCTTACTT TCTTCTGTTT 40164 |||||||||| |||||||||| |||||||||| ||||| CATTGATTTT GGACTCTCTG TATTCTTTAA GCCAG..... .......... .......... 335 TTTTACATTC TAGCTTCTAG TGCAGCTAGA CGGACATATT ACGGCTCTGT GTAGTTGTTC 40224 .......... .......... .......... .......... .......... .......... 335 ATGCTCATGC TGGTAGGCTA CTACTAATGA AGTATGATCT TGGAGATTCT TTTTATGCAC 40284 .......... .......... .......... .......... .......... .......... 335 CAACTCTCTA TCTAGATGAA TAGTTAGCTA CTTTTAACAT TGATTTGGTG GCTCCTTAAA 40344 .......... .......... .......... .......... .......... .......... 335 TTGGTATGTT GGTTTGATGG ATTTTGTTGC TTGCTTCTTC AGGCCAAATT TTCACAGATG 40404 |||||||| |||||||||| .......... .......... .......... .......... ..GCCAAATT TTCACAGATG 353 TTGTTGGGAG TCCATACTAC GTTGCTCCTG AGGTGCTTTT GAAGCATTAT GGTCCAGAAG 40464 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGTTGGGAG TCCATACTAC GTTGCTCCTG AGGTGCTTTT GAAGCATTAT GGTCCAGAAG 413 CAGATGTTTG GACAGCAGGG GTCATACTCT ATATCCTGCT AAGTGGAGTT CCACCATTCT 40524 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGATGTTTG GACAGCAGGG GTCATACTCT ATATCCTGCT AAGTGGAGTT CCACCATTCT 473 GGGCTGGTAT GTTTATAATT TTATGCAGTA TAGCTGTAAC TTTTCTGATT TTTGTCTTTT 40584 |||||| GGGCTG.... .......... .......... .......... .......... .......... 479 TAACTTACCA TCTAAATTGT TCAGAAACAC AGCAGGGGAT ATTTGATGCA GTTCTGAAAG 40644 |||||| |||||||||| |||||||||| |||||||||| .......... .......... ....AAACAC AGCAGGGGAT ATTTGATGCA GTTCTGAAAG 515 GGCACATTGA TTTTGACTC 40663 |||||||||| ||||||||| GGCACATTGA TTTTGACTC 534 hqPGS_C01HBa0088L02.1+_SGN-E301516+ (39805 40139,40387 40530,40609 40663) ******************************************************************************** EST sequence 72 +strand 506 n (File: SGN-E275646+) 1 TGCACCATTT GGCTGGTCAC AAAAACATCG TTTCCATCAA GGGTGCTTAT GAGGATCCTT 61 TGTATGTTCA TATTGTCATG GAACTTTGTG GTGGCGGTGA ATTGTTTGAC CGCATAATTC 121 AAAGAGGACA CTACACCGAG AGAAAGGCTG CCGATTTGAC TAAAATTATT GTGGGTGTTG 181 TTGAGGCATG CCATTCACTT GGAGTTATGC ATAGAGATCT CAAACCTGAG AATTTCTTGT 241 TGGTTAACAA GGATGATGAT TTCTCTCTCA AGGCCATTGA TTTTGGACTC TCTGTATTCT 301 TTAAGCCAGG CCAAATTTTC ACAGATGTTG TTGGGAGTCC ATACTACGTT GCTCCTGAGG 361 TGCTTTTGAA GCATTATGGT CCATAAGCAG ATGTTTGGAC AGCAGGGGTC ATACTCTATA 421 TCCTGCTAAG TGGAGTTCCA CCATTCTGGG CTGAAACACA GCAGGGGATA TTTGATGCAC 481 TTCTGAAAGG GCACATTGAT TTTGAC Predicted gene structure (within gDNA segment 39231 to 41271): Exon 1 39831 40139 ( 309 n); cDNA 1 309 ( 309 n); score: 1.000 Intron 1 40140 40386 ( 247 n); Pd: 1.000 (s: 1.00), Pa: 0.998 (s: 1.00) Exon 2 40387 40530 ( 144 n); cDNA 310 453 ( 144 n); score: 0.993 Intron 2 40531 40608 ( 78 n); Pd: 0.992 (s: 1.00), Pa: 0.995 (s: 0.98) Exon 3 40609 40661 ( 53 n); cDNA 454 506 ( 53 n); score: 0.981 MATCH C01HBa0088L02.1+ SGN-E275646+ 0.996 506 1.000 C PGS_C01HBa0088L02.1+_SGN-E275646+ (39831 40139,40387 40530,40609 40661) Alignment (genomic DNA sequence = upper lines): TGCACCATTT GGCTGGTCAC AAAAACATCG TTTCCATCAA GGGTGCTTAT GAGGATCCTT 39890 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGCACCATTT GGCTGGTCAC AAAAACATCG TTTCCATCAA GGGTGCTTAT GAGGATCCTT 60 TGTATGTTCA TATTGTCATG GAACTTTGTG GTGGCGGTGA ATTGTTTGAC CGCATAATTC 39950 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTATGTTCA TATTGTCATG GAACTTTGTG GTGGCGGTGA ATTGTTTGAC CGCATAATTC 120 AAAGAGGACA CTACACCGAG AGAAAGGCTG CCGATTTGAC TAAAATTATT GTGGGTGTTG 40010 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAAGAGGACA CTACACCGAG AGAAAGGCTG CCGATTTGAC TAAAATTATT GTGGGTGTTG 180 TTGAGGCATG CCATTCACTT GGAGTTATGC ATAGAGATCT CAAACCTGAG AATTTCTTGT 40070 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGAGGCATG CCATTCACTT GGAGTTATGC ATAGAGATCT CAAACCTGAG AATTTCTTGT 240 TGGTTAACAA GGATGATGAT TTCTCTCTCA AGGCCATTGA TTTTGGACTC TCTGTATTCT 40130 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGTTAACAA GGATGATGAT TTCTCTCTCA AGGCCATTGA TTTTGGACTC TCTGTATTCT 300 TTAAGCCAGG TAAATCTCTT ACTTTCTTCT GTTTTTTTAC ATTCTAGCTT CTAGTGCAGC 40190 ||||||||| TTAAGCCAG. .......... .......... .......... .......... .......... 309 TAGACGGACA TATTACGGCT CTGTGTAGTT GTTCATGCTC ATGCTGGTAG GCTACTACTA 40250 .......... .......... .......... .......... .......... .......... 309 ATGAAGTATG ATCTTGGAGA TTCTTTTTAT GCACCAACTC TCTATCTAGA TGAATAGTTA 40310 .......... .......... .......... .......... .......... .......... 309 GCTACTTTTA ACATTGATTT GGTGGCTCCT TAAATTGGTA TGTTGGTTTG ATGGATTTTG 40370 .......... .......... .......... .......... .......... .......... 309 TTGCTTGCTT CTTCAGGCCA AATTTTCACA GATGTTGTTG GGAGTCCATA CTACGTTGCT 40430 |||| |||||||||| |||||||||| |||||||||| |||||||||| .......... ......GCCA AATTTTCACA GATGTTGTTG GGAGTCCATA CTACGTTGCT 353 CCTGAGGTGC TTTTGAAGCA TTATGGTCCA GAAGCAGATG TTTGGACAGC AGGGGTCATA 40490 |||||||||| |||||||||| |||||||||| ||||||||| |||||||||| |||||||||| CCTGAGGTGC TTTTGAAGCA TTATGGTCCA TAAGCAGATG TTTGGACAGC AGGGGTCATA 413 CTCTATATCC TGCTAAGTGG AGTTCCACCA TTCTGGGCTG GTATGTTTAT AATTTTATGC 40550 |||||||||| |||||||||| |||||||||| |||||||||| CTCTATATCC TGCTAAGTGG AGTTCCACCA TTCTGGGCTG .......... .......... 453 AGTATAGCTG TAACTTTTCT GATTTTTGTC TTTTTAACTT ACCATCTAAA TTGTTCAGAA 40610 || .......... .......... .......... .......... .......... ........AA 455 ACACAGCAGG GGATATTTGA TGCAGTTCTG AAAGGGCACA TTGATTTTGA C 40661 |||||||||| |||||||||| |||| ||||| |||||||||| |||||||||| | ACACAGCAGG GGATATTTGA TGCACTTCTG AAAGGGCACA TTGATTTTGA C 506 hqPGS_C01HBa0088L02.1+_SGN-E275646+ (39831 40139,40387 40530,40609 40661) ******************************************************************************** EST sequence 39 +strand 650 n (File: SGN-E395373+) 1 CTGTTGGAGT TGACCTGTAT GTATTGTATC ATCTTCTCCT TCTTCTTCCC ATCAAATTCA 61 TGTCTTATTA GATCTATCAA TATCAATATT CTTGAAGAAA ACAAGTGCTA CTAGTATTGG 121 ATGAGGAAAC TGAGCTGAGT GCTGGGGATT TTGATTGTTT GATGGGCAAC GCATGCCGTG 181 GATCTTTCGG AGGCAAAACT TTTCAGGGCT ACCCTCAGCC TCAAGATCAC TCAGAATCCA 241 ATTCCAATCC CAAACATAAT TCCGATTCCC CCAACCCAAA AAAAGAACAA CAACCCCTCG 301 TCACCATGAA TCGTACAAGC ACTAACCAGT CCTATTACGT CCTCGGTCAT AAGACCCCTA 361 ACATTCGTGA TCTATACACC CTCGGCCGCA AACTAGGACA AGGCCAGTTT GGCACCACTT 421 ACTTATGCAC CGAATTGTCT TCCGGTATCG ACTACGCATG TAAATCTATT GCCAAGAGAA 481 AACTCATCTC TAAGGAGGAT GTAGAAGATG TCAGGAGGGA AATTCAGATA ATGCACCATT 541 TGGCTGGTCA CAAAAACATC GTTTCCATCA AGGGTGCTTA TGAGGATCCT TTGTATGTTC 601 ATATTGTCAT GGAACTTTGT GGTGGCGGTG AATTGTTTGA CCGCATAATT Predicted gene structure (within gDNA segment 38700 to 40559): Exon 1 39300 39949 ( 650 n); cDNA 1 650 ( 650 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E395373+ 1.000 650 1.000 C PGS_C01HBa0088L02.1+_SGN-E395373+ (39300 39949) Alignment (genomic DNA sequence = upper lines): CTGTTGGAGT TGACCTGTAT GTATTGTATC ATCTTCTCCT TCTTCTTCCC ATCAAATTCA 39359 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTGTTGGAGT TGACCTGTAT GTATTGTATC ATCTTCTCCT TCTTCTTCCC ATCAAATTCA 60 TGTCTTATTA GATCTATCAA TATCAATATT CTTGAAGAAA ACAAGTGCTA CTAGTATTGG 39419 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTCTTATTA GATCTATCAA TATCAATATT CTTGAAGAAA ACAAGTGCTA CTAGTATTGG 120 ATGAGGAAAC TGAGCTGAGT GCTGGGGATT TTGATTGTTT GATGGGCAAC GCATGCCGTG 39479 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATGAGGAAAC TGAGCTGAGT GCTGGGGATT TTGATTGTTT GATGGGCAAC GCATGCCGTG 180 GATCTTTCGG AGGCAAAACT TTTCAGGGCT ACCCTCAGCC TCAAGATCAC TCAGAATCCA 39539 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GATCTTTCGG AGGCAAAACT TTTCAGGGCT ACCCTCAGCC TCAAGATCAC TCAGAATCCA 240 ATTCCAATCC CAAACATAAT TCCGATTCCC CCAACCCAAA AAAAGAACAA CAACCCCTCG 39599 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATTCCAATCC CAAACATAAT TCCGATTCCC CCAACCCAAA AAAAGAACAA CAACCCCTCG 300 TCACCATGAA TCGTACAAGC ACTAACCAGT CCTATTACGT CCTCGGTCAT AAGACCCCTA 39659 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCACCATGAA TCGTACAAGC ACTAACCAGT CCTATTACGT CCTCGGTCAT AAGACCCCTA 360 ACATTCGTGA TCTATACACC CTCGGCCGCA AACTAGGACA AGGCCAGTTT GGCACCACTT 39719 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACATTCGTGA TCTATACACC CTCGGCCGCA AACTAGGACA AGGCCAGTTT GGCACCACTT 420 ACTTATGCAC CGAATTGTCT TCCGGTATCG ACTACGCATG TAAATCTATT GCCAAGAGAA 39779 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACTTATGCAC CGAATTGTCT TCCGGTATCG ACTACGCATG TAAATCTATT GCCAAGAGAA 480 AACTCATCTC TAAGGAGGAT GTAGAAGATG TCAGGAGGGA AATTCAGATA ATGCACCATT 39839 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AACTCATCTC TAAGGAGGAT GTAGAAGATG TCAGGAGGGA AATTCAGATA ATGCACCATT 540 TGGCTGGTCA CAAAAACATC GTTTCCATCA AGGGTGCTTA TGAGGATCCT TTGTATGTTC 39899 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGCTGGTCA CAAAAACATC GTTTCCATCA AGGGTGCTTA TGAGGATCCT TTGTATGTTC 600 ATATTGTCAT GGAACTTTGT GGTGGCGGTG AATTGTTTGA CCGCATAATT 39949 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATATTGTCAT GGAACTTTGT GGTGGCGGTG AATTGTTTGA CCGCATAATT 650 hqPGS_C01HBa0088L02.1+_SGN-E395373+ (39300 39949) ******************************************************************************** EST sequence 71 +strand 466 n (File: SGN-E333392+) 1 TATTGTATCA TCTTCTCCTT CTTCTTCCCA TCAAATTCAT GTCTTATTAG ATCTATCAAT 61 ATCAATATTC TTGAAGAAAA CAAGTGCTAC TAGTATTGGA TGAGGAAACT GAGCTGAGTG 121 CTGGGGATTT TGATTGTTTG ATGGGCAACG CATGCCGTGG ATCTTTCGGA GGCAAAACTT 181 TTCAGGGCTA CCCTCAGCCT CAAGATCACT CAGAATCCAA TTCCAATCCC AAACATAATT 241 CCGATTCCCC CAACCCAAAA AAAGAACAAC AACCCCTCGT CACCATGAAT CGTACAAGCA 301 CTAACCAGTC CTATTACGTC CTCGGTCATA AGACCCCTAA CATTCGTGAT CTATACACCC 361 TCGGCCGCAA ACTAGGACAA GGCCAGTTTG GCACCACTTA CTTATGCACC GAATTGTCTT 421 CCGGTATCGA CTACGCATGT AAATCTATTG CCCAGAGAAA CTCATC Predicted gene structure (within gDNA segment 38721 to 40522): Exon 1 39321 39787 ( 467 n); cDNA 1 466 ( 466 n); score: 0.996 MATCH C01HBa0088L02.1+ SGN-E333392+ 0.996 467 1.002 C PGS_C01HBa0088L02.1+_SGN-E333392+ (39321 39787) Alignment (genomic DNA sequence = upper lines): TATTGTATCA TCTTCTCCTT CTTCTTCCCA TCAAATTCAT GTCTTATTAG ATCTATCAAT 39380 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATTGTATCA TCTTCTCCTT CTTCTTCCCA TCAAATTCAT GTCTTATTAG ATCTATCAAT 60 ATCAATATTC TTGAAGAAAA CAAGTGCTAC TAGTATTGGA TGAGGAAACT GAGCTGAGTG 39440 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCAATATTC TTGAAGAAAA CAAGTGCTAC TAGTATTGGA TGAGGAAACT GAGCTGAGTG 120 CTGGGGATTT TGATTGTTTG ATGGGCAACG CATGCCGTGG ATCTTTCGGA GGCAAAACTT 39500 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTGGGGATTT TGATTGTTTG ATGGGCAACG CATGCCGTGG ATCTTTCGGA GGCAAAACTT 180 TTCAGGGCTA CCCTCAGCCT CAAGATCACT CAGAATCCAA TTCCAATCCC AAACATAATT 39560 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTCAGGGCTA CCCTCAGCCT CAAGATCACT CAGAATCCAA TTCCAATCCC AAACATAATT 240 CCGATTCCCC CAACCCAAAA AAAGAACAAC AACCCCTCGT CACCATGAAT CGTACAAGCA 39620 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCGATTCCCC CAACCCAAAA AAAGAACAAC AACCCCTCGT CACCATGAAT CGTACAAGCA 300 CTAACCAGTC CTATTACGTC CTCGGTCATA AGACCCCTAA CATTCGTGAT CTATACACCC 39680 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTAACCAGTC CTATTACGTC CTCGGTCATA AGACCCCTAA CATTCGTGAT CTATACACCC 360 TCGGCCGCAA ACTAGGACAA GGCCAGTTTG GCACCACTTA CTTATGCACC GAATTGTCTT 39740 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCGGCCGCAA ACTAGGACAA GGCCAGTTTG GCACCACTTA CTTATGCACC GAATTGTCTT 420 CCGGTATCGA CTACGCATGT AAATCTATTG CCAAGAGAAA ACTCATC 39787 |||||||||| |||||||||| |||||||||| || |||| || ||||||| CCGGTATCGA CTACGCATGT AAATCTATTG CCCAGAG-AA ACTCATC 466 hqPGS_C01HBa0088L02.1+_SGN-E333392+ (39321 39787) ******************************************************************************** EST sequence 46 +strand 675 n (File: SGN-E275920+) 1 AAAGATCTTA TCCGGAAGAT GTTGTGCATG CAGCCGTCAG AGCGGTTAAC TGCTCATGAA 61 GTATTATGTC ATCCTTGGAT TTGCGAAAAT GGTGTCGCTC CTGATAGAGC ACTGGATCCT 121 GCAGTACTTT CTCGCCTAAA ACAGTTCTCT GCTATGAACA AGTTAAAAAA GATGGCTTTG 181 CGGGTGATTG CTGAAAGCTT GTCTGAAGAA GAGATTGCTG GTCTGAGAGA GATGTTTAAG 241 GCCATGGATA CTGACAATAG TGGTGCAATT ACATTTGATG AACTAAAAGC AGGGTTGAGA 301 AAATATGGCT CTACCTTAAA GGATACGGAG ATACGGGAAC TTATGGATGC GGCTGATGTG 361 GACAATAGTG GAACTATTGA CTATGGAGAA TTCATTGCGG CAACTGTTCA TCTTAATAAA 421 TTGGAGCGCG AGGAACATCT CATGGCAGCA TTTCAATATT TTGACAAGGA TGGAAGTGGT 481 TACATAACAG TTGATGAGGT CCAGCAAGCT TGTATAGAGC ATAACATGAC AGATGTTTAC 541 TTTGAGGATA TTATAAGAGA AGTCGATCAG GATAATGATG GACGAATTGA TTATGGAGAA 601 TTTGTTGCTA TGATGCAAAA AGGAAATCCG TGTATAGGGA GACGAACAAT GCGAAATAGT 661 CTGAATTTGA GCATG Predicted gene structure (within gDNA segment 39762 to 45787): Exon 1 40695 40761 ( 67 n); cDNA 1 67 ( 67 n); score: 0.896 Intron 1 40762 41292 ( 531 n); Pd: 0.979 (s: 0.90), Pa: 0.998 (s: 0.94) Exon 2 41293 41408 ( 116 n); cDNA 68 183 ( 116 n); score: 0.914 Intron 2 41409 41728 ( 320 n); Pd: 0.909 (s: 0.88), Pa: 1.000 (s: 0.84) Exon 3 41729 41896 ( 168 n); cDNA 184 351 ( 168 n); score: 0.893 Intron 3 41897 42405 ( 509 n); Pd: 0.985 (s: 0.90), Pa: 0.999 (s: 0.96) Exon 4 42406 42630 ( 225 n); cDNA 352 576 ( 225 n); score: 0.898 Intron 4 42631 45015 (2385 n); Pd: 0.956 (s: 0.88), Pa: 0.995 (s: 0.98) Exon 5 45016 45114 ( 99 n); cDNA 577 675 ( 99 n); score: 0.949 MATCH C01HBa0088L02.1+ SGN-E275920+ 0.907 675 1.000 C PGS_C01HBa0088L02.1+_SGN-E275920+ (40695 40761,41293 41408,41729 41896,42406 42630,45016 45114) Alignment (genomic DNA sequence = upper lines): AAGGATCTCA TCCGGAAGAT GTTATGCATG CGACCCCCAG AGCGGTTAAC TGCTCATGAA 40754 || ||||| | |||||||||| ||| |||||| | || ||| |||||||||| |||||||||| AAAGATCTTA TCCGGAAGAT GTTGTGCATG CAGCCGTCAG AGCGGTTAAC TGCTCATGAA 60 GTATTATGTA AGTTTATTTA CCTTATAAGT CATATTGACC TAACATTTTT ACTGGTTACT 40814 ||||||| GTATTAT... .......... .......... .......... .......... .......... 67 GAATGGATCA TTTTTTTCTC CCATGATATA AATATGGTTT TGCTTGTTTA ATAGTTGTTA 40874 .......... .......... .......... .......... .......... .......... 67 TATCAAGAGA TACTGTGTTG TGACAGTGTT GATGTTCTGT CAGACTTATA AGAACCCTCT 40934 .......... .......... .......... .......... .......... .......... 67 TAACTTTTTT CTGGACTGTG CTTCTGGTGG CAGAACATTG AGAACCTTAT TGACTACTAA 40994 .......... .......... .......... .......... .......... .......... 67 TTTATGTAAA AAACTGTTAG TTTAGCAGTA GAGAGGAGTT TCTCATGCTT GAACTATAAC 41054 .......... .......... .......... .......... .......... .......... 67 TTGTTAGGTT ATCTATGAGC CCTTTGGAAA TATCAGGTTT ATTTTCTGTA TTTCTGGTTT 41114 .......... .......... .......... .......... .......... .......... 67 AAAAAATAAA TTTGGATTGA CTACAAGCTG TAATAGATCA ATTTGCACTG CATAAAGTGG 41174 .......... .......... .......... .......... .......... .......... 67 ATCAAGTCAT TGTATTTCTC AAATTTCAAT TGTATTGTCT ATCTATGCCT GCTTGTATGG 41234 .......... .......... .......... .......... .......... .......... 67 TGTCTTTCAT GTAACCAGCT GCTGTTCTGG TGTTATGGTT TCCTCTAAAA TTCTGCAGGT 41294 || .......... .......... .......... .......... .......... ........GT 69 CATCCTTGGA TTTGTGAAAA TGGTGTTGCT CCTGATAGAG CACTTGATCC TGCTGTACTT 41354 |||||||||| |||| ||||| |||||| ||| |||||||||| |||| ||||| ||| |||||| CATCCTTGGA TTTGCGAAAA TGGTGTCGCT CCTGATAGAG CACTGGATCC TGCAGTACTT 129 TCTCGCCTCA AACACTTTTC TGCAATGAAC AAATTAAAAA AGATGGCTCT GCGGGTATGC 41414 |||||||| | |||| || || ||| |||||| || ||||||| |||||||| | |||| TCTCGCCTAA AACAGTTCTC TGCTATGAAC AAGTTAAAAA AGATGGCTTT GCGG...... 183 ATATATATAT GTGTGTGTAT ATATATCTAG GCATAACTTT TTTGCCCAAG TCTGTTAATT 41474 .......... .......... .......... .......... .......... .......... 183 ATGGTTCTTC AGTGTCCATA AACCTCATTA TTAAAGTTAC ACAAGAAAAT GCTGATTATG 41534 .......... .......... .......... .......... .......... .......... 183 TCCTTTGGGC TAAGTTGTGT GGACTCTTCA GTTTCGATGG CGCACCAGTG TCGGATTCTC 41594 .......... .......... .......... .......... .......... .......... 183 CAAAAATACA CTCCTTATGG AGAAGCCGAC ACACACCCAT TGACATTTTT GAAGCGTCCA 41654 .......... .......... .......... .......... .......... .......... 183 AGCAACATAG CTTCTTGGAG GTGTGTAACC AAATGATGCA ATTATTGATG TTTTCATACT 41714 .......... .......... .......... .......... .......... .......... 183 TAATATGCAT TTAGGTGATT GCTGAAAGTT TGTCAGAGGA GGAGATTGCC GGTCTTAAGG 41774 |||||| |||||||| | |||| || || |||||||| ||||| | | .......... ....GTGATT GCTGAAAGCT TGTCTGAAGA AGAGATTGCT GGTCTGAGAG 229 AGATGTTTAA GGCCATGGAT ACTGATAACA GTGGTGCAAT TACATTCGAT GAACTAAAAG 41834 |||||||||| |||||||||| ||||| || | |||||||||| |||||| ||| |||||||||| AGATGTTTAA GGCCATGGAT ACTGACAATA GTGGTGCAAT TACATTTGAT GAACTAAAAG 289 CTGGTTTGAG AAAATATGGC TCTACTCTGA AGGATATAGA GATACGGGAA CTTATGGATG 41894 | || ||||| |||||||||| ||||| | | |||||| || |||||||||| |||||||||| CAGGGTTGAG AAAATATGGC TCTACCTTAA AGGATACGGA GATACGGGAA CTTATGGATG 349 CGGTAAGAAA ATCTAGACTG CAAACTGATT CTGTTTATTT TGTGCATCTG GTGATGTGAC 41954 || CG........ .......... .......... .......... .......... .......... 351 TCTACACAAA GGTTCATAGG AGCAGAAAAA TGTAAAATGA CATAAGATCA CTAACTAATG 42014 .......... .......... .......... .......... .......... .......... 351 GTCAAATCTC AAGGTTATTT GATGTGCAAA TACTAGAGTC AGATTGGGAT TTGGCACTTT 42074 .......... .......... .......... .......... .......... .......... 351 ACTTTGTTTA ATTAATTATG TACATTCATG AAGGAGCACT TAAAACTCAA TGTAGTTGCT 42134 .......... .......... .......... .......... .......... .......... 351 AAAACTTCAC TGGAAAGGTG CCCAATTTTT TTTTTTTGTG TATGTGTATG ATAAGTTTCT 42194 .......... .......... .......... .......... .......... .......... 351 GATAACTGAG GAGGTAGTGC AGGCTTACCA AGTAGTTGGC ACCACATATA TGCTTCATCA 42254 .......... .......... .......... .......... .......... .......... 351 GAAACAACTT TCTGTTAATG GTTCTAGTTG TATCTTTAAT TAGGCCCGTG ATAATCTTTG 42314 .......... .......... .......... .......... .......... .......... 351 TATTTCTCCC TAAACATGTC TGTCTATGAG GTACATGCGG AAGTGCTTAT CTAACTCTTT 42374 .......... .......... .......... .......... .......... .......... 351 AAGGCCATTG ATGTAATATT ACTGTTTTCA GGCTGATGTG GACAATAGTG GAACTATTGA 42434 ||||||||| |||||||||| |||||||||| .......... .......... .......... .GCTGATGTG GACAATAGTG GAACTATTGA 380 CTATGGAGAA TTCATAGCAG CAACAATTCA CCTTAACAAA TTGGACCGCG AGGAACATCT 42494 |||||||||| ||||| || | |||| |||| ||||| ||| ||||| |||| |||||||||| CTATGGAGAA TTCATTGCGG CAACTGTTCA TCTTAATAAA TTGGAGCGCG AGGAACATCT 440 CATGGCAGCA TTTCAGTATT TTGACAAGGA TGGAAGTGGT TATATTACAG TAGATGAGCT 42554 |||||||||| ||||| |||| |||||||||| |||||||||| || || |||| | |||||| | CATGGCAGCA TTTCAATATT TTGACAAGGA TGGAAGTGGT TACATAACAG TTGATGAGGT 500 CCAGCAGGCC TGTGCAGATC ATAACATTAC AGATGTATTC TTTGAGGATA TTATCAGAGA 42614 |||||| || ||| ||| | ||||||| || |||||| | | |||||||||| |||| ||||| CCAGCAAGCT TGTATAGAGC ATAACATGAC AGATGTTTAC TTTGAGGATA TTATAAGAGA 560 AGTTGATCAG GATAACGTAA GTTAATTATA TTGAGGATAA AGTTGAAGTA TTATTGGAAC 42674 ||| |||||| ||||| AGTCGATCAG GATAAT.... .......... .......... .......... .......... 576 TTATCAATAA AAAAGTGGAC ACAAATTAGT AGATTAAATT TCTTCATGTT TTGCAGTTCT 42734 .......... .......... .......... .......... .......... .......... 576 ACTGATTTAT CTCTCTACTA CTCATAATTT TTTTGCAACA AAAACTATTT TTTTTTATAA 42794 .......... .......... .......... .......... .......... .......... 576 AAAAGCACTT TAATATGAAA CACTTTTTGT GCAACAAAAA CGAAAATTAA AAAAATATAG 42854 .......... .......... .......... .......... .......... .......... 576 CACTTTAAGA TTTCATATGA ATCTTTTCCT TGAGATAAAA TGTTATTGAC AATGTAGTGT 42914 .......... .......... .......... .......... .......... .......... 576 ATGTATGGAA AATACGGATA TTACTAAATG ATCATATGTG AGCTTAATAA TATAGTTAAT 42974 .......... .......... .......... .......... .......... .......... 576 TTACCTCTCT CTCTCTATAT ATATAAAGAG AACCCTAGGC TGCCTAAGTG GCGCCACCAC 43034 .......... .......... .......... .......... .......... .......... 576 AAATCAGGAT TCCCTTTTAA TTTATTTATT TCCAAAATTA GCCTTCCCTT TCATCAAAAG 43094 .......... .......... .......... .......... .......... .......... 576 TTGTGACTTA TGAAACTTTG CGACTTTTAC AAAGAGTTGT AACTTTTATG AAAGTTGTAA 43154 .......... .......... .......... .......... .......... .......... 576 CTTTTATGAA AGTTGTAACT TTTATGTAGA GTTGTGACTT TTCCAAAGGA TTATTACATT 43214 .......... .......... .......... .......... .......... .......... 576 TCCGATAAGA CACCATAACC ATTTATTCAC ACTATCCTTT TGTTGTCTAT AAATAGAGGA 43274 .......... .......... .......... .......... .......... .......... 576 ATTTTCTTTC ATTTTAAAAC GACGAAAATT CTAAATTTTT TCTTCTGCTT ATGCACAATT 43334 .......... .......... .......... .......... .......... .......... 576 AAATATTTGT GTACTTTGCT CCTGTTGAGT GGTTCACTGA CATCATTGTT TTTGAATCTA 43394 .......... .......... .......... .......... .......... .......... 576 TACAACGGTG AATATAATCG TTCTATCCTA AAAGTATCTA TTCATTCTTT TGTTACAAAT 43454 .......... .......... .......... .......... .......... .......... 576 CTTGGTATGT TTTTTACGCT CATTTATGCT TATGTTATTA GTTGTTTTTG AGTACATGTT 43514 .......... .......... .......... .......... .......... .......... 576 TTAAACTTTG TTGTTTATGT TTATGTTTAT GTTGAAATAA AGATATGTTA ATCAAGAATT 43574 .......... .......... .......... .......... .......... .......... 576 TGATGTAGTG ATGTCATGTA GATTAAAATT CTTGAACTTA TAAAATAAAT GACTTTGATC 43634 .......... .......... .......... .......... .......... .......... 576 TTTATAGAGT TTTAGTGGCT AAAAGATTCA TGGGATGTTC AAGAAGAAAC TTTTGAGTGT 43694 .......... .......... .......... .......... .......... .......... 576 TCAAAAGTTA TGGTGGTTCT ACTCTACCAT GGAGTTTAGT TATTCAACTT TCTATCTTAT 43754 .......... .......... .......... .......... .......... .......... 576 CTAGACATTC AATCGATTAG TGACATTCAA AAAATAAAGG AAAATGTAGC GGGATGGTAA 43814 .......... .......... .......... .......... .......... .......... 576 GTATTATACT CAACCTTAAT TAAAAGTTTG GGATTCAAAT ATTTGATTGG AGTCAATGAA 43874 .......... .......... .......... .......... .......... .......... 576 TTACCCCCTT AGGATGAATC TACATTAATC AATTATTAAA GAAATAATTA TCTCCTTATA 43934 .......... .......... .......... .......... .......... .......... 576 AACATTAGAT TAAAAGTTGC AAAAAGATTA AAGCTTTAAC CATATTGATC GGAACATAAA 43994 .......... .......... .......... .......... .......... .......... 576 CAACAAAATA TGCATTTTGG GTATCAAAGT AGTGTCATAC ATAATGATTT GAATAAGGGT 44054 .......... .......... .......... .......... .......... .......... 576 CTTGCCAAGA CATCATTTAA TCCGAATTAT TTGAGTGACT TGCCTTATTT CATTGAAATT 44114 .......... .......... .......... .......... .......... .......... 576 CCAAGAGATG TTTTTTAAAA TTTTAATTAA CTTATCAAGC ACACAACTAA TTATATAAAA 44174 .......... .......... .......... .......... .......... .......... 576 TGTATAATAT TTAGATTTTG TATGTAGAGG GAGGCCTTGA ATAAGAGAAG AACTCTCGCA 44234 .......... .......... .......... .......... .......... .......... 576 ATTGATGAAT AAAATGTTTG TACCACTTTT GGAAAATACA AATATAGACA ATGAAACAAT 44294 .......... .......... .......... .......... .......... .......... 576 TACCTATCTT TTCTAAAGAT TTGGTGATGA ATAACTACAG TAAAATGAAG AATCAATAAC 44354 .......... .......... .......... .......... .......... .......... 576 TAAATCCATA AACACGTAGA ATCAAATCGT TTTAAGTTTA AAAAAATATT TTATTTTGTC 44414 .......... .......... .......... .......... .......... .......... 576 TTTGGATAAA ATATTCTTGA CAATTTATTG TTGGGTTGTA CCCATTCGAA AACACTTATA 44474 .......... .......... .......... .......... .......... .......... 576 TTATCAAATG TTCAGAAGTA GATTATTACC GTAGTTTACC ACCGCGCGAA AAGCATGCAA 44534 .......... .......... .......... .......... .......... .......... 576 TTTACCTTGT TAAATTACAA GTGCTCAGAT GCAATGATAT GCTTTGAAAA TTATTTTTGA 44594 .......... .......... .......... .......... .......... .......... 576 AGAACTTCTC GTAGTTCTGT TTGGTCTGAC TGCATTCGTG CCAGCTACTC ACTTTTTGGC 44654 .......... .......... .......... .......... .......... .......... 576 GTCACTTCAT AATCTAAGTA GTTTTGTGTA TTCAAAGGCA TAATGAGAAG ACAAAGCTGA 44714 .......... .......... .......... .......... .......... .......... 576 CATAATTGTC CAAAGAAAAG AAAAAAGACA AAGAAATTGT AGCATAATAA ACAGGAATGG 44774 .......... .......... .......... .......... .......... .......... 576 GTACCGTTAC AGACATTTCT GTCTTTCTTC AAATCAAACA AAATTTGTTG TATTTTGATT 44834 .......... .......... .......... .......... .......... .......... 576 AGTTTTCTGG AGCCTCAGTA TTGGATTAGG GCCTCAGCTG CAGCCGTGAT ACAGGCAAAT 44894 .......... .......... .......... .......... .......... .......... 576 TGTTATGCTT TAGGAGATCT GTATTTTAAA TGGATGGAAT GATTCTTTTG GAATCTCTAC 44954 .......... .......... .......... .......... .......... .......... 576 ATCTCTTGAT GCTTCATTTG ACTAGCTATT TAGTTGATCT TCTGGTGGAT TCCCTTTTCA 45014 .......... .......... .......... .......... .......... .......... 576 GGATGGACGT ATTGATTATG GAGAATTTGT TGCTATGATG CAAAAAGGAA ATCCATGCAT 45074 |||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||| || || .GATGGACGA ATTGATTATG GAGAATTTGT TGCTATGATG CAAAAAGGAA ATCCGTGTAT 635 AGGAAGACGA ACAATGCGAA ATAGTCTGAA TTTCAGCATG 45114 ||| |||||| |||||||||| |||||||||| ||| |||||| AGGGAGACGA ACAATGCGAA ATAGTCTGAA TTTGAGCATG 675 hqPGS_C01HBa0088L02.1+_SGN-E275920+ (40695 40761,41293 41408,41729 41896,42406 42630,45016 45114) ******************************************************************************** EST sequence 90 +strand 770 n (File: SGN-E545523+) 1 GCTCCTGATA GAGCACTTGA TCCTGCTGTA CTTTCTCGCC TCAAACACTT TTCTGCAATG 61 AACAAATTAA AAAAGATGGC TCTGCGGGTG ATTGCTGAAA GTTTGTCAGA GGAGGAGATT 121 GCCGGTCTTA AGGAGATGTT TAAGGCCATG GATACTGATA ACAGTGGTGC AATTACATTC 181 GATGAACTAA AAGCTGGTTT GAGAAAATAT GGCTCTACTC TGAAGGATAT AGAGATACGG 241 GAACTTATGG ATGCGGCTGA TGTGGACAAT AGTGGAACTA TTGACTATGG AGAATTCATA 301 GCAGCAACAA TTCACCTTAA CAAATTGGAC CGCGAGGAAC ATCTCATGGC AGCATTTCAG 361 TATTTTGACA AGGATGGAAG TGGTTATATT ACAGTAGATG AGCTCCAGCA GGCCTGTGCA 421 GATCATAACA TTACAGATGT ATTCTTTGAG GATATTATCA GAGAAGTTGA TCAGGATAAC 481 GATGGACGTA TTGATTATGG AGAATTTGTT GCTATGATGC AAAAAGGAAA TCCATGCATA 541 GGAAGACGAA CAATGCGAAA TAGTCTGAAT TTCAGCATGA GAGATGCGCC CGGAGCTCAT 601 TAGCTTTTTG AATGGACACA TGATGTAGGT TTTTACAGAT AATAGAGCAG AGGCAATGAA 661 ACTGCCGTAA CAATGTNCTG GTACTCTTTT CTAAAAGTAG TATGCCATGC TCTCAAGTAT 721 AACTAGAAGT GCTTGTAGAC TGTGCCCTCA CAAAATGTGA AATCTCTGTC Predicted gene structure (within gDNA segment 40722 to 52143): Exon 1 41322 41408 ( 87 n); cDNA 1 87 ( 87 n); score: 1.000 Intron 1 41409 41728 ( 320 n); Pd: 0.909 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 2 41729 41896 ( 168 n); cDNA 88 255 ( 168 n); score: 1.000 Intron 2 41897 42405 ( 509 n); Pd: 0.985 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 42406 42630 ( 225 n); cDNA 256 480 ( 225 n); score: 1.000 Intron 3 42631 45015 (2385 n); Pd: 0.956 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 4 45016 45163 ( 148 n); cDNA 481 628 ( 148 n); score: 1.000 Intron 4 45164 51392 (6229 n); Pd: 0.985 (s: 1.00), Pa: 0.659 (s: 0.95) Exon 5 51393 51533 ( 141 n); cDNA 629 770 ( 142 n); score: 0.961 MATCH C01HBa0088L02.1+ SGN-E545523+ 0.993 769 0.999 C PGS_C01HBa0088L02.1+_SGN-E545523+ (41322 41408,41729 41896,42406 42630,45016 45163,51393 51533) Alignment (genomic DNA sequence = upper lines): GCTCCTGATA GAGCACTTGA TCCTGCTGTA CTTTCTCGCC TCAAACACTT TTCTGCAATG 41381 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCTCCTGATA GAGCACTTGA TCCTGCTGTA CTTTCTCGCC TCAAACACTT TTCTGCAATG 60 AACAAATTAA AAAAGATGGC TCTGCGGGTA TGCATATATA TATGTGTGTG TATATATATC 41441 |||||||||| |||||||||| ||||||| AACAAATTAA AAAAGATGGC TCTGCGG... .......... .......... .......... 87 TAGGCATAAC TTTTTTGCCC AAGTCTGTTA ATTATGGTTC TTCAGTGTCC ATAAACCTCA 41501 .......... .......... .......... .......... .......... .......... 87 TTATTAAAGT TACACAAGAA AATGCTGATT ATGTCCTTTG GGCTAAGTTG TGTGGACTCT 41561 .......... .......... .......... .......... .......... .......... 87 TCAGTTTCGA TGGCGCACCA GTGTCGGATT CTCCAAAAAT ACACTCCTTA TGGAGAAGCC 41621 .......... .......... .......... .......... .......... .......... 87 GACACACACC CATTGACATT TTTGAAGCGT CCAAGCAACA TAGCTTCTTG GAGGTGTGTA 41681 .......... .......... .......... .......... .......... .......... 87 ACCAAATGAT GCAATTATTG ATGTTTTCAT ACTTAATATG CATTTAGGTG ATTGCTGAAA 41741 ||| |||||||||| .......... .......... .......... .......... .......GTG ATTGCTGAAA 100 GTTTGTCAGA GGAGGAGATT GCCGGTCTTA AGGAGATGTT TAAGGCCATG GATACTGATA 41801 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTTGTCAGA GGAGGAGATT GCCGGTCTTA AGGAGATGTT TAAGGCCATG GATACTGATA 160 ACAGTGGTGC AATTACATTC GATGAACTAA AAGCTGGTTT GAGAAAATAT GGCTCTACTC 41861 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACAGTGGTGC AATTACATTC GATGAACTAA AAGCTGGTTT GAGAAAATAT GGCTCTACTC 220 TGAAGGATAT AGAGATACGG GAACTTATGG ATGCGGTAAG AAAATCTAGA CTGCAAACTG 41921 |||||||||| |||||||||| |||||||||| ||||| TGAAGGATAT AGAGATACGG GAACTTATGG ATGCG..... .......... .......... 255 ATTCTGTTTA TTTTGTGCAT CTGGTGATGT GACTCTACAC AAAGGTTCAT AGGAGCAGAA 41981 .......... .......... .......... .......... .......... .......... 255 AAATGTAAAA TGACATAAGA TCACTAACTA ATGGTCAAAT CTCAAGGTTA TTTGATGTGC 42041 .......... .......... .......... .......... .......... .......... 255 AAATACTAGA GTCAGATTGG GATTTGGCAC TTTACTTTGT TTAATTAATT ATGTACATTC 42101 .......... .......... .......... .......... .......... .......... 255 ATGAAGGAGC ACTTAAAACT CAATGTAGTT GCTAAAACTT CACTGGAAAG GTGCCCAATT 42161 .......... .......... .......... .......... .......... .......... 255 TTTTTTTTTT GTGTATGTGT ATGATAAGTT TCTGATAACT GAGGAGGTAG TGCAGGCTTA 42221 .......... .......... .......... .......... .......... .......... 255 CCAAGTAGTT GGCACCACAT ATATGCTTCA TCAGAAACAA CTTTCTGTTA ATGGTTCTAG 42281 .......... .......... .......... .......... .......... .......... 255 TTGTATCTTT AATTAGGCCC GTGATAATCT TTGTATTTCT CCCTAAACAT GTCTGTCTAT 42341 .......... .......... .......... .......... .......... .......... 255 GAGGTACATG CGGAAGTGCT TATCTAACTC TTTAAGGCCA TTGATGTAAT ATTACTGTTT 42401 .......... .......... .......... .......... .......... .......... 255 TCAGGCTGAT GTGGACAATA GTGGAACTAT TGACTATGGA GAATTCATAG CAGCAACAAT 42461 |||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ....GCTGAT GTGGACAATA GTGGAACTAT TGACTATGGA GAATTCATAG CAGCAACAAT 311 TCACCTTAAC AAATTGGACC GCGAGGAACA TCTCATGGCA GCATTTCAGT ATTTTGACAA 42521 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCACCTTAAC AAATTGGACC GCGAGGAACA TCTCATGGCA GCATTTCAGT ATTTTGACAA 371 GGATGGAAGT GGTTATATTA CAGTAGATGA GCTCCAGCAG GCCTGTGCAG ATCATAACAT 42581 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGATGGAAGT GGTTATATTA CAGTAGATGA GCTCCAGCAG GCCTGTGCAG ATCATAACAT 431 TACAGATGTA TTCTTTGAGG ATATTATCAG AGAAGTTGAT CAGGATAACG TAAGTTAATT 42641 |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| TACAGATGTA TTCTTTGAGG ATATTATCAG AGAAGTTGAT CAGGATAAC. .......... 480 ATATTGAGGA TAAAGTTGAA GTATTATTGG AACTTATCAA TAAAAAAGTG GACACAAATT 42701 .......... .......... .......... .......... .......... .......... 480 AGTAGATTAA ATTTCTTCAT GTTTTGCAGT TCTACTGATT TATCTCTCTA CTACTCATAA 42761 .......... .......... .......... .......... .......... .......... 480 TTTTTTTGCA ACAAAAACTA TTTTTTTTTA TAAAAAAGCA CTTTAATATG AAACACTTTT 42821 .......... .......... .......... .......... .......... .......... 480 TGTGCAACAA AAACGAAAAT TAAAAAAATA TAGCACTTTA AGATTTCATA TGAATCTTTT 42881 .......... .......... .......... .......... .......... .......... 480 CCTTGAGATA AAATGTTATT GACAATGTAG TGTATGTATG GAAAATACGG ATATTACTAA 42941 .......... .......... .......... .......... .......... .......... 480 ATGATCATAT GTGAGCTTAA TAATATAGTT AATTTACCTC TCTCTCTCTA TATATATAAA 43001 .......... .......... .......... .......... .......... .......... 480 GAGAACCCTA GGCTGCCTAA GTGGCGCCAC CACAAATCAG GATTCCCTTT TAATTTATTT 43061 .......... .......... .......... .......... .......... .......... 480 ATTTCCAAAA TTAGCCTTCC CTTTCATCAA AAGTTGTGAC TTATGAAACT TTGCGACTTT 43121 .......... .......... .......... .......... .......... .......... 480 TACAAAGAGT TGTAACTTTT ATGAAAGTTG TAACTTTTAT GAAAGTTGTA ACTTTTATGT 43181 .......... .......... .......... .......... .......... .......... 480 AGAGTTGTGA CTTTTCCAAA GGATTATTAC ATTTCCGATA AGACACCATA ACCATTTATT 43241 .......... .......... .......... .......... .......... .......... 480 CACACTATCC TTTTGTTGTC TATAAATAGA GGAATTTTCT TTCATTTTAA AACGACGAAA 43301 .......... .......... .......... .......... .......... .......... 480 ATTCTAAATT TTTTCTTCTG CTTATGCACA ATTAAATATT TGTGTACTTT GCTCCTGTTG 43361 .......... .......... .......... .......... .......... .......... 480 AGTGGTTCAC TGACATCATT GTTTTTGAAT CTATACAACG GTGAATATAA TCGTTCTATC 43421 .......... .......... .......... .......... .......... .......... 480 CTAAAAGTAT CTATTCATTC TTTTGTTACA AATCTTGGTA TGTTTTTTAC GCTCATTTAT 43481 .......... .......... .......... .......... .......... .......... 480 GCTTATGTTA TTAGTTGTTT TTGAGTACAT GTTTTAAACT TTGTTGTTTA TGTTTATGTT 43541 .......... .......... .......... .......... .......... .......... 480 TATGTTGAAA TAAAGATATG TTAATCAAGA ATTTGATGTA GTGATGTCAT GTAGATTAAA 43601 .......... .......... .......... .......... .......... .......... 480 ATTCTTGAAC TTATAAAATA AATGACTTTG ATCTTTATAG AGTTTTAGTG GCTAAAAGAT 43661 .......... .......... .......... .......... .......... .......... 480 TCATGGGATG TTCAAGAAGA AACTTTTGAG TGTTCAAAAG TTATGGTGGT TCTACTCTAC 43721 .......... .......... .......... .......... .......... .......... 480 CATGGAGTTT AGTTATTCAA CTTTCTATCT TATCTAGACA TTCAATCGAT TAGTGACATT 43781 .......... .......... .......... .......... .......... .......... 480 CAAAAAATAA AGGAAAATGT AGCGGGATGG TAAGTATTAT ACTCAACCTT AATTAAAAGT 43841 .......... .......... .......... .......... .......... .......... 480 TTGGGATTCA AATATTTGAT TGGAGTCAAT GAATTACCCC CTTAGGATGA ATCTACATTA 43901 .......... .......... .......... .......... .......... .......... 480 ATCAATTATT AAAGAAATAA TTATCTCCTT ATAAACATTA GATTAAAAGT TGCAAAAAGA 43961 .......... .......... .......... .......... .......... .......... 480 TTAAAGCTTT AACCATATTG ATCGGAACAT AAACAACAAA ATATGCATTT TGGGTATCAA 44021 .......... .......... .......... .......... .......... .......... 480 AGTAGTGTCA TACATAATGA TTTGAATAAG GGTCTTGCCA AGACATCATT TAATCCGAAT 44081 .......... .......... .......... .......... .......... .......... 480 TATTTGAGTG ACTTGCCTTA TTTCATTGAA ATTCCAAGAG ATGTTTTTTA AAATTTTAAT 44141 .......... .......... .......... .......... .......... .......... 480 TAACTTATCA AGCACACAAC TAATTATATA AAATGTATAA TATTTAGATT TTGTATGTAG 44201 .......... .......... .......... .......... .......... .......... 480 AGGGAGGCCT TGAATAAGAG AAGAACTCTC GCAATTGATG AATAAAATGT TTGTACCACT 44261 .......... .......... .......... .......... .......... .......... 480 TTTGGAAAAT ACAAATATAG ACAATGAAAC AATTACCTAT CTTTTCTAAA GATTTGGTGA 44321 .......... .......... .......... .......... .......... .......... 480 TGAATAACTA CAGTAAAATG AAGAATCAAT AACTAAATCC ATAAACACGT AGAATCAAAT 44381 .......... .......... .......... .......... .......... .......... 480 CGTTTTAAGT TTAAAAAAAT ATTTTATTTT GTCTTTGGAT AAAATATTCT TGACAATTTA 44441 .......... .......... .......... .......... .......... .......... 480 TTGTTGGGTT GTACCCATTC GAAAACACTT ATATTATCAA ATGTTCAGAA GTAGATTATT 44501 .......... .......... .......... .......... .......... .......... 480 ACCGTAGTTT ACCACCGCGC GAAAAGCATG CAATTTACCT TGTTAAATTA CAAGTGCTCA 44561 .......... .......... .......... .......... .......... .......... 480 GATGCAATGA TATGCTTTGA AAATTATTTT TGAAGAACTT CTCGTAGTTC TGTTTGGTCT 44621 .......... .......... .......... .......... .......... .......... 480 GACTGCATTC GTGCCAGCTA CTCACTTTTT GGCGTCACTT CATAATCTAA GTAGTTTTGT 44681 .......... .......... .......... .......... .......... .......... 480 GTATTCAAAG GCATAATGAG AAGACAAAGC TGACATAATT GTCCAAAGAA AAGAAAAAAG 44741 .......... .......... .......... .......... .......... .......... 480 ACAAAGAAAT TGTAGCATAA TAAACAGGAA TGGGTACCGT TACAGACATT TCTGTCTTTC 44801 .......... .......... .......... .......... .......... .......... 480 TTCAAATCAA ACAAAATTTG TTGTATTTTG ATTAGTTTTC TGGAGCCTCA GTATTGGATT 44861 .......... .......... .......... .......... .......... .......... 480 AGGGCCTCAG CTGCAGCCGT GATACAGGCA AATTGTTATG CTTTAGGAGA TCTGTATTTT 44921 .......... .......... .......... .......... .......... .......... 480 AAATGGATGG AATGATTCTT TTGGAATCTC TACATCTCTT GATGCTTCAT TTGACTAGCT 44981 .......... .......... .......... .......... .......... .......... 480 ATTTAGTTGA TCTTCTGGTG GATTCCCTTT TCAGGATGGA CGTATTGATT ATGGAGAATT 45041 |||||| |||||||||| |||||||||| .......... .......... .......... ....GATGGA CGTATTGATT ATGGAGAATT 506 TGTTGCTATG ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC GAAATAGTCT 45101 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTTGCTATG ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC GAAATAGTCT 566 GAATTTCAGC ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA CACATGATGT 45161 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAATTTCAGC ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA CACATGATGT 626 AGGTATTTCC CCTTTTTTAT TTTTGTAACC GTTTCTTTGG CAATGAATTT GAAGAAATCT 45221 || AG........ .......... .......... .......... .......... .......... 628 TTCCTTGTTC TGTCCTTGAG AAATTGGATT GGTTGGAGTA TATTTGTTTA ACATTAAGAG 45281 .......... .......... .......... .......... .......... .......... 628 TTTCTTTTTC CCTCTTGAGG ATAATAAAAT TTTATAAATA ACAGCATGAG TGTTTGCTGT 45341 .......... .......... .......... .......... .......... .......... 628 AAAACTCTAC AGGTGCAGCA AAAAAAATTA CATTCAGCAA AAGTATATCC CATCTTATCC 45401 .......... .......... .......... .......... .......... .......... 628 TGTTGGTACA CTAGCATGTC ACAGATAGAT TCAGCTTCCT CCCCAATCCT CCATTTTACA 45461 .......... .......... .......... .......... .......... .......... 628 CCATTAACAA AAATAAATTT CAGATACAGA GTTCTCTTTC ATTCCCATCT TTTATATAAT 45521 .......... .......... .......... .......... .......... .......... 628 GCTGGTTTCT TTTCTTTTGG TAAAATTTTG ATGTATCAAA TTTGACGATT GTCCGACATG 45581 .......... .......... .......... .......... .......... .......... 628 GCTATGTGAG GAACTTTCCT AAGGGAGCAC TAAGGGTGTC AAATGTGTGG GTGGAGGCAG 45641 .......... .......... .......... .......... .......... .......... 628 TGGGGGACTG AAATTGAAGA GGTTAAAATG GGCTGAGCTA AAAGTCATGT TGGATCATAA 45701 .......... .......... .......... .......... .......... .......... 628 CCCACTCAAA CTTACTTTGG GCTAACATGG GCTAGAATCT TGATTGGGTT ATGACCTATC 45761 .......... .......... .......... .......... .......... .......... 628 CAATTTGACC TGCTTAATCT AAACTAAACT ATATTAAACA CTTGCTATAA TTTATGACAG 45821 .......... .......... .......... .......... .......... .......... 628 ATGTCATTCA ACCCATAGAA TCGTACAGAT CTGTACTAAC TTTTCATTTA GGAGCATCTC 45881 .......... .......... .......... .......... .......... .......... 628 CTTGTAGAGT AAATTGATGT AGACTTTATA GTATGGGACC AACTTCATAA TTTTGCAACT 45941 .......... .......... .......... .......... .......... .......... 628 CATTTAATAG TGTATTTATG AGAATTATTG AAAAGAATAT TATTGAATTG TGTGTCTACA 46001 .......... .......... .......... .......... .......... .......... 628 TTATTACATT GAGACTTTAT TTATAGACAC TATATTATAC TCCTTTTCCA ACTAGGACAC 46061 .......... .......... .......... .......... .......... .......... 628 TACAATACCA TCCTTTTCTA AGTAGGATTC TATATACTAT TTCTATTCCT ATTCCTATTC 46121 .......... .......... .......... .......... .......... .......... 628 TAAGTAGAAT GGTATATATT ATTCTTGTTC CTTTTTTGAT TCTAACACTC CCCCTCAAGC 46181 .......... .......... .......... .......... .......... .......... 628 TGGTGCATAC AAGTTATATA TACTTTGCTT GTTACAAATG TAATTAATAT GAGGACCAAT 46241 .......... .......... .......... .......... .......... .......... 628 GAGAGGCTTG ATGAAGATAT CTGCAAGTTG ATCACTTGAC TCACAAATTT TGTAACAATA 46301 .......... .......... .......... .......... .......... .......... 628 TCTCCCGACT TCCCAGACCA AGCTTGAGAA GAACGTTTCA TATCATCGAG TGACTTGCAC 46361 .......... .......... .......... .......... .......... .......... 628 AATCAACATA TAAGGCTGCT AGACTCCCTC GGAGCAATAA GACCAAGTGG TTGCTCCATA 46421 .......... .......... .......... .......... .......... .......... 628 TATACTTCTC CATCGAGATC CCAGCCCAAA TATGTAAGTA TATCCTTTTG GATAAAGTGA 46481 .......... .......... .......... .......... .......... .......... 628 ATCTAAAACA AAGAGAATAT TGCTTGAAAA CTTGGATTTT TTTGGGAACT CGGATATGTT 46541 .......... .......... .......... .......... .......... .......... 628 GGACTTTGCA CAACATTGAC AAAGTTGAAA CTATTTAAAT CAGACCTAAG GAGTCACCGA 46601 .......... .......... .......... .......... .......... .......... 628 AAAGACGTAC GGTGCTTCGA AAATTAGATA TGAGAAAGTA GTCACCAAAA AGACGCATGA 46661 .......... .......... .......... .......... .......... .......... 628 TGTTGTGCAA ATTAGATATG AGAAAGTAGT CACCAAGAAG ATGAGACAGT GCTACATAAA 46721 .......... .......... .......... .......... .......... .......... 628 TTAAATATGA AAAAGTAGTC ACTGATAAGA TGGCACGGTG CTACACAAAT TAAATATGAA 46781 .......... .......... .......... .......... .......... .......... 628 AAAGTAGTCA TCAAAAAGAT GGTGCGATGC TACACAAAAG TAAATAGTCA CCGGAATGAT 46841 .......... .......... .......... .......... .......... .......... 628 GACATGATGC TACAAAAATG AAATATGAGA GTAGTCACCT GAAGGATGAC ACAGTGCCAC 46901 .......... .......... .......... .......... .......... .......... 628 ATAAATTGAA CATAAAAAAA TAGTCACCAG AAACATGATG CGGTGCTACA CAAATTAAGA 46961 .......... .......... .......... .......... .......... .......... 628 GCCTGTTTGG CTCAGCTTAA AAGCTGGTCA AACTGACTTA AAATCTGATT TTTGACTTAT 47021 .......... .......... .......... .......... .......... .......... 628 TTAACTGTTT GACAATACTC AAAATAGCTT ATTTTAAGTT AAAAAAAACT TATTTTAAGC 47081 .......... .......... .......... .......... .......... .......... 628 CAAAAGTTAA AAGGTGGGGT AGGGGTGCTT TTTTTTTTTA GCTTATAAGC TGTTTTAAGT 47141 .......... .......... .......... .......... .......... .......... 628 TGACCATATT TTTATGTTTT TTCCCTTAAT ATTTTTATAC AATCTCCAAA TTATCCATAT 47201 .......... .......... .......... .......... .......... .......... 628 AACCCTAACA TCTCTTTCTT CTATTTTTCC CTTTTCACGT TTGGCATAAC AACTTCAGCA 47261 .......... .......... .......... .......... .......... .......... 628 CTTTTATCCA AACGCATAAC TGCTTATTTT AAAAATAAGT TTCAGCACTT TCAAAAGTAC 47321 .......... .......... .......... .......... .......... .......... 628 TTTTTTAAAG CTGCTTTTAT TAAGCCCATC CAAACGGGCT CTAAATATAT AAATAATAGT 47381 .......... .......... .......... .......... .......... .......... 628 CACCGGAAGA TGACACACTG CTACAAATCA AATTTAAGAA AGTAGTCACC GAAATGATAG 47441 .......... .......... .......... .......... .......... .......... 628 CACAGTGCCA CACAAATTAG ATATGAGAAA GTAGTCGCCA TGACAACCCT AGAAAGTCGT 47501 .......... .......... .......... .......... .......... .......... 628 GCATATATCA GTGACCCTAA TTTGGTTAAC ATTACCAATG GCAAGAGGGG AGATAGATAT 47561 .......... .......... .......... .......... .......... .......... 628 GAGTCATAGC CGCCCTACAC CGACGAAATC TTTTTTTGAT TTTCTACCGA GATCGTAGGA 47621 .......... .......... .......... .......... .......... .......... 628 GCTTTGATAC CATGTGGAAA TATTGAAAAA GAACATTGTT GAATTGGTCT CTAGATTATA 47681 .......... .......... .......... .......... .......... .......... 628 ACATCGAGAC CTATTAATAG GGCACTACCT TAGACTCAAA TTCCAACTAG GACACTACCA 47741 .......... .......... .......... .......... .......... .......... 628 TACAATCCTA TTCTAAGTAG TATTTTATGT ACTATTTTTA TTCCTATTAC TAGTATTTTA 47801 .......... .......... .......... .......... .......... .......... 628 TGTACTATTT TTATTCCTGT TACTATTCTA AGTATGATGG TATATATTAT TCTTGTTCAT 47861 .......... .......... .......... .......... .......... .......... 628 ATTCCTATTC AAACAGTAAT AATTTGACAT ATAGAATGTA GGCAATTATT TTTTAATATG 47921 .......... .......... .......... .......... .......... .......... 628 ACATGGCATG CAAAATAATG TGTTGTTAAA GAATCAAATA ACAATAATCA AGTGACTTTA 47981 .......... .......... .......... .......... .......... .......... 628 GAATTCCAAA AGAGAGACCA TGATAGATCA TTATCATATT AGGTAATAAA AAATAAGGAT 48041 .......... .......... .......... .......... .......... .......... 628 TCGGTAACAA AATGCAAGAA GGTGAAATGA ATTTTTAAGA TATTTCAGTT TGCCAAAAAT 48101 .......... .......... .......... .......... .......... .......... 628 AAGCATATTA GGTTAGTATA TGAGGAAAAA AAACAGTTTT ATTCGAATTG GTTAAACTCA 48161 .......... .......... .......... .......... .......... .......... 628 GTTCTCATTT TCATATCAAG TGAAAAGGTC AATATAAACT AAAGAGATGA TGATTGTCCC 48221 .......... .......... .......... .......... .......... .......... 628 ATCTTTGCAC ATGTAGTCCG GTTAGAATGG GGATTGAATT GACATAGAAC TTGGGCTAAG 48281 .......... .......... .......... .......... .......... .......... 628 TGGGTTATAA TTATACGGGT TAAGACGTAG CACATTATTA AATTATCATG AGCTCAACCC 48341 .......... .......... .......... .......... .......... .......... 628 ATAAATTTTG GGCTCCTAAT ATCTGAGCTT CATTTGACAC CCCAAGTAAG GAGTGCCACG 48401 .......... .......... .......... .......... .......... .......... 628 CACGAGCATG GCAAAAAGCA AGGGGAACTT TTCTTTTTGG GAGAAATCAT TTGATTGCAT 48461 .......... .......... .......... .......... .......... .......... 628 ATTGAATACA TAAAGCACAT TCCAACAAAT TCAAATTTTA GAAGTTTCAT ATGGTGACTA 48521 .......... .......... .......... .......... .......... .......... 628 CATTTTAGCT TCCCGTCAAT TACCCCAACC TTCTTCATTT ATCCAGATGT GGGACGGACA 48581 .......... .......... .......... .......... .......... .......... 628 CGGTGAAGCT CACATAGATT GAGTTAGGTA AAATATTTAT CTGTGGAGAA AAATATTACC 48641 .......... .......... .......... .......... .......... .......... 628 CCCTGTTCCA TTTTGTGTGA CAAGTTGAAA AATATGTGTG GTTAAATTGA CTAATTTTCT 48701 .......... .......... .......... .......... .......... .......... 628 GAGTGAATTT GAACATTGAT ATTCATTTTC TAAAAATAAA GTTTTACATC TTTAAAAACT 48761 .......... .......... .......... .......... .......... .......... 628 ATATAAAAAG TATTGTAAGT CACAATAGTT TACAATTCAA AATATTAAAG AAGTATTTTA 48821 .......... .......... .......... .......... .......... .......... 628 AAAAAAACAT GGTCAAAGAA AAACTTATTT TACACTCCAG ATAGTTATAG GTTACATAAA 48881 .......... .......... .......... .......... .......... .......... 628 GTGGAGCAAA GTACTCTTAT CAATACTCTT AACCATAGGT CTGGAATTCG AGTACCCATA 48941 .......... .......... .......... .......... .......... .......... 628 GAATAGAGTT CCTTTTGTTA GGGAGCGGGT GGGAACCAAA AAAAAAAGTG GAACAAAGGG 49001 .......... .......... .......... .......... .......... .......... 628 AGTACTAAAG TATACTTATG GAAGTTAATA TAAAATCTGA AGATAAGCGT TAAAAACATA 49061 .......... .......... .......... .......... .......... .......... 628 CCTAAACTAT CCTTTTTTTT TTAGTTTCAT ACTTGAAGTA TTGAGTGTGA GTTTTCTACC 49121 .......... .......... .......... .......... .......... .......... 628 TAAACTATCA CTTATTAATT TGAGAAACAC ATCTTTCTTT TATTATACTC TATCATGGTG 49181 .......... .......... .......... .......... .......... .......... 628 TGTAATACAC TCCTTTTATT TAAAAATTGT TATATTACAA TCCACATGGA CAAAACGTTT 49241 .......... .......... .......... .......... .......... .......... 628 CACCTTGACA AAAAATAAAT AATTAGTATT AGTTAAAGTT AAGTATTAAA GTATTGCTAT 49301 .......... .......... .......... .......... .......... .......... 628 CCCCCCCCCC TCCCCCAAAA AAAAAATTAT AAAATAAAAT GTAAAATATT TTTTTTACCC 49361 .......... .......... .......... .......... .......... .......... 628 AACTCCAATC TTTCCTCTCA ACGTACTCCC CCATCCCAAA TTTTTAGTTT ATTTTGTTCA 49421 .......... .......... .......... .......... .......... .......... 628 AAAAAAATAA ATCCCTTCGA ATAATAATTT AGATATAGTT AAATTTATTT TATTTCTTGA 49481 .......... .......... .......... .......... .......... .......... 628 AAAAAAATTC TACCCTAACA TAACTCCCCT CTTCCATTTT TTTTCTCGTT TTGTATTAGA 49541 .......... .......... .......... .......... .......... .......... 628 TATGTATTTT CTTTTCTAAA AAAGTATTTT TTAACTTGCC GCAAGACTTT TCATAAAATA 49601 .......... .......... .......... .......... .......... .......... 628 AAACTTTTAT TTCTGTTAAT TTGGTATGCA AGTAGAAAAG AATGTTTTCC TAAAAATATA 49661 .......... .......... .......... .......... .......... .......... 628 TGTACACATC TAACACAAAA CTAGAAAAAT GTATAAAATT AAATTAGGAG CGGAGGGTTA 49721 .......... .......... .......... .......... .......... .......... 628 GATGGGGTGG GGTAGAATAT TATTTTATTT TACTTTTTTT TTAAAAAATA ATATCAAAAT 49781 .......... .......... .......... .......... .......... .......... 628 TATTTTTAGG AAGGAGTGGG GGAGGGGGTG ACGCCTAAAT TTCAAAAAAT AATTTTAGAA 49841 .......... .......... .......... .......... .......... .......... 628 ATAATAGGAC GTGGGGTTGT CCGGGGATGA GGGTTGAGAT GATGGAGTGG GGTAAGAAAT 49901 .......... .......... .......... .......... .......... .......... 628 ATTTTAATTT TTTAAAAAAT GGTAATACTT TAATCTTTAG TTTTTAGCTA ATATTAATAG 49961 .......... .......... .......... .......... .......... .......... 628 TTTTTTAATT TTTGTCAAGT TGGAATAATT TATCCATGTG CAATGCCATG AGGCAAGGTT 50021 .......... .......... .......... .......... .......... .......... 628 TTTGCAAATA AATGAGAAAA GTGTATTAGA CACCACTGAG GTGTGTTTTT CAAACTAATA 50081 .......... .......... .......... .......... .......... .......... 628 AGTGATAGTT TAGGTATGAA AATTCAAAAA AAAAAAAGAA AAGAAATAGT TTAGGTGTGT 50141 .......... .......... .......... .......... .......... .......... 628 TTTGACACTT ATGTCTAATC TGAAAGATAT TATTAGTTGT ACAAGTGTGA AAAAACACCC 50201 .......... .......... .......... .......... .......... .......... 628 CAGGATGTTC CCAAGTGAAC AAATAGAAAG TGGGGTCGAA ATGGGAAATA TACCATCAGT 50261 .......... .......... .......... .......... .......... .......... 628 TGTCAATGAA GTTGAAATAA AATCATGAGA GAGTTCCAAT CCTAGTAGAA GCAAAAAGAA 50321 .......... .......... .......... .......... .......... .......... 628 ATTAGCCGAT TTCTTCCAAT ATGTCTTAAG TTTCAGCTGT CAAGATTACT GCCTGGTACC 50381 .......... .......... .......... .......... .......... .......... 628 TTTGGGTGGA GGATACATGC ACCTAGTGGA ATAGTCAAGA TACATGCATG TTGGGTTGAA 50441 .......... .......... .......... .......... .......... .......... 628 GGCACCTTAG TCTTATAGAA TTGTCAAATC AGAATATTTA GTATGATGTA TCATGTGTTC 50501 .......... .......... .......... .......... .......... .......... 628 TTGAACACTC GTAGAACTAA TTCTGTTTTC CAACCATTAG TTGACTCTAT CAAAAGAATA 50561 .......... .......... .......... .......... .......... .......... 628 TCAAGTTGAA GCTAGTTGAG ATGTAGGTAG AATATCTATT AACCAACTTA TCTCCATGTA 50621 .......... .......... .......... .......... .......... .......... 628 GTTCTATTCA GTTCCATTTC ATCCAATATT GTATAATTTA CCTTAAAACT ACAAGTCCGA 50681 .......... .......... .......... .......... .......... .......... 628 TGTGTTCCAC ACTTTCAGGA ATATAAAAGT CTAACACTGT GCCTATTATC AGCTAACAAG 50741 .......... .......... .......... .......... .......... .......... 628 TAACAACTCT CTATTTCAAA TAGCTGGCAT TGCCTACATG GATCATTTAC TTTTGTTAGG 50801 .......... .......... .......... .......... .......... .......... 628 TTACGGTCTT AGTTAAGTTC TACCAGAGAT ATTGCACGTC CTTTAGGATA ACTCATCTCC 50861 .......... .......... .......... .......... .......... .......... 628 TTGTGATTTT AGGTGTACTT TGCTTATTTG AAATGATGCA AGGTTTTATT ACTTTTTTTT 50921 .......... .......... .......... .......... .......... .......... 628 TCTAAGAGAT TTTCATTGTA TATGTATCCA CCAAAAGAAT AATACGAAGA AAAAAAATGA 50981 .......... .......... .......... .......... .......... .......... 628 GAGAGGAAGA AACAGATCTG CTTCCAAGTT GTGACATAAT TTTATCGAAA AGAAAAAGAA 51041 .......... .......... .......... .......... .......... .......... 628 TATTCAGAGG CCCAGGTGCC ACTGAGTTAA CTCGCCATTC TTCTCTTCTT TAGACAAGCC 51101 .......... .......... .......... .......... .......... .......... 628 TGATAAGGAA AGCTGATTCT TAACAATGTG TTGGGCATCA AAGGTTTTCT TTTGTTCTCC 51161 .......... .......... .......... .......... .......... .......... 628 TTCAAAATGC ACATAGGTAA GGTACTTATT CATAGTACAA TTATTTGGCA TATATTGTAG 51221 .......... .......... .......... .......... .......... .......... 628 TTACACACGT GCTTGTGTAC TTGTTCTACT AAAATGTTGT TATGACTTTG TAAGCTAGGT 51281 .......... .......... .......... .......... .......... .......... 628 TAAATATCAC AGAACATGGT GCATCTTTCA TTTGGAGCAT GAACTTGTGT TTCACTCTTG 51341 .......... .......... .......... .......... .......... .......... 628 GTCAAGTTAT GTGTAAAAGG TATTCTGACA TTCATGTCAG CTAGTTTGCA GGTTTTTACA 51401 ||||||||| .......... .......... .......... .......... .......... .GTTTTTACA 637 GATAATAGAG CAGAGGCAAT GAAACTGCCG TAACAATGT- CTGGTACTCT TTTCTAAAAG 51460 |||||||||| |||||||||| |||||||||| ||||||||| |||||||||| |||||||||| GATAATAGAG CAGAGGCAAT GAAACTGCCG TAACAATGTN CTGGTACTCT TTTCTAAAAG 697 TAGTATGCCA TGCTCTCAAG TATAACTAGA AGTGCTTGTA GACTGTGCCT CAACAAAATG 51520 |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| |||||||| TAGTATGCCA TGCTCTCAAG TATAACTAGA AGTGCTTGTA GACTGTGCCC TCACAAAATG 757 TGAAATCTCT GTC 51533 |||||||||| ||| TGAAATCTCT GTC 770 hqPGS_C01HBa0088L02.1+_SGN-E545523+ (41322 41408,41729 41896,42406 42630,45016 45163,51393 51533) ******************************************************************************** EST sequence 74 +strand 521 n (File: SGN-E311119+) 1 CTCCTGATTG AGCACTTGAT CCTGCTGTAC TTTCTCGCCT CAAACACTTT TCTGCAATGA 61 ACAAATTAAA AAAGATGGCT CTGCGGGTGA TTGCTGAAAG TTTGTCAGAG GAGGAGATTG 121 CCGGTCTTAA GGAGATGTTT AAGGCCATGG ATACTGATAA CAGTGGTGCA ATTACATTCG 181 ATGAACTAAA AGCTGGTTTG AGAAAATATG GCTCTACTCT GAAGGATATA GAGATACGGG 241 AACTTATGGA TGCGGCTGAT GTGGACAATA GTGGAACTAT TGACTATGGA GAATTCATAG 301 CAGCAACAAT TCACCTTAAC AAATTGGACC GCGAGGAACA TCTCATGGCA GCATTTCAGT 361 ATTTTGACAA GGATGGAAGT GGTTATATTA CAGTAGATGA GCTCCAGCAG GCCTGTGCAG 421 ATCATAACAT TACAGATGTA TTCTTTGAGG ATATTATCAG AGAAGTTGAT CAGGATAACG 481 ATGGACGTAT TGATTATGGA GAATTTGTTG CTATGATGCA A Predicted gene structure (within gDNA segment 40642 to 45667): Exon 1 41323 41408 ( 86 n); cDNA 1 86 ( 86 n); score: 0.988 Intron 1 41409 41728 ( 320 n); Pd: 0.909 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 2 41729 41896 ( 168 n); cDNA 87 254 ( 168 n); score: 1.000 Intron 2 41897 42405 ( 509 n); Pd: 0.985 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 42406 42630 ( 225 n); cDNA 255 479 ( 225 n); score: 1.000 Intron 3 42631 45015 (2385 n); Pd: 0.956 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 4 45016 45057 ( 42 n); cDNA 480 521 ( 42 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E311119+ 0.998 521 1.000 C PGS_C01HBa0088L02.1+_SGN-E311119+ (41323 41408,41729 41896,42406 42630,45016 45057) Alignment (genomic DNA sequence = upper lines): CTCCTGATAG AGCACTTGAT CCTGCTGTAC TTTCTCGCCT CAAACACTTT TCTGCAATGA 41382 |||||||| | |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCCTGATTG AGCACTTGAT CCTGCTGTAC TTTCTCGCCT CAAACACTTT TCTGCAATGA 60 ACAAATTAAA AAAGATGGCT CTGCGGGTAT GCATATATAT ATGTGTGTGT ATATATATCT 41442 |||||||||| |||||||||| |||||| ACAAATTAAA AAAGATGGCT CTGCGG.... .......... .......... .......... 86 AGGCATAACT TTTTTGCCCA AGTCTGTTAA TTATGGTTCT TCAGTGTCCA TAAACCTCAT 41502 .......... .......... .......... .......... .......... .......... 86 TATTAAAGTT ACACAAGAAA ATGCTGATTA TGTCCTTTGG GCTAAGTTGT GTGGACTCTT 41562 .......... .......... .......... .......... .......... .......... 86 CAGTTTCGAT GGCGCACCAG TGTCGGATTC TCCAAAAATA CACTCCTTAT GGAGAAGCCG 41622 .......... .......... .......... .......... .......... .......... 86 ACACACACCC ATTGACATTT TTGAAGCGTC CAAGCAACAT AGCTTCTTGG AGGTGTGTAA 41682 .......... .......... .......... .......... .......... .......... 86 CCAAATGATG CAATTATTGA TGTTTTCATA CTTAATATGC ATTTAGGTGA TTGCTGAAAG 41742 |||| |||||||||| .......... .......... .......... .......... ......GTGA TTGCTGAAAG 100 TTTGTCAGAG GAGGAGATTG CCGGTCTTAA GGAGATGTTT AAGGCCATGG ATACTGATAA 41802 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTGTCAGAG GAGGAGATTG CCGGTCTTAA GGAGATGTTT AAGGCCATGG ATACTGATAA 160 CAGTGGTGCA ATTACATTCG ATGAACTAAA AGCTGGTTTG AGAAAATATG GCTCTACTCT 41862 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGTGGTGCA ATTACATTCG ATGAACTAAA AGCTGGTTTG AGAAAATATG GCTCTACTCT 220 GAAGGATATA GAGATACGGG AACTTATGGA TGCGGTAAGA AAATCTAGAC TGCAAACTGA 41922 |||||||||| |||||||||| |||||||||| |||| GAAGGATATA GAGATACGGG AACTTATGGA TGCG...... .......... .......... 254 TTCTGTTTAT TTTGTGCATC TGGTGATGTG ACTCTACACA AAGGTTCATA GGAGCAGAAA 41982 .......... .......... .......... .......... .......... .......... 254 AATGTAAAAT GACATAAGAT CACTAACTAA TGGTCAAATC TCAAGGTTAT TTGATGTGCA 42042 .......... .......... .......... .......... .......... .......... 254 AATACTAGAG TCAGATTGGG ATTTGGCACT TTACTTTGTT TAATTAATTA TGTACATTCA 42102 .......... .......... .......... .......... .......... .......... 254 TGAAGGAGCA CTTAAAACTC AATGTAGTTG CTAAAACTTC ACTGGAAAGG TGCCCAATTT 42162 .......... .......... .......... .......... .......... .......... 254 TTTTTTTTTG TGTATGTGTA TGATAAGTTT CTGATAACTG AGGAGGTAGT GCAGGCTTAC 42222 .......... .......... .......... .......... .......... .......... 254 CAAGTAGTTG GCACCACATA TATGCTTCAT CAGAAACAAC TTTCTGTTAA TGGTTCTAGT 42282 .......... .......... .......... .......... .......... .......... 254 TGTATCTTTA ATTAGGCCCG TGATAATCTT TGTATTTCTC CCTAAACATG TCTGTCTATG 42342 .......... .......... .......... .......... .......... .......... 254 AGGTACATGC GGAAGTGCTT ATCTAACTCT TTAAGGCCAT TGATGTAATA TTACTGTTTT 42402 .......... .......... .......... .......... .......... .......... 254 CAGGCTGATG TGGACAATAG TGGAACTATT GACTATGGAG AATTCATAGC AGCAACAATT 42462 ||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ...GCTGATG TGGACAATAG TGGAACTATT GACTATGGAG AATTCATAGC AGCAACAATT 311 CACCTTAACA AATTGGACCG CGAGGAACAT CTCATGGCAG CATTTCAGTA TTTTGACAAG 42522 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACCTTAACA AATTGGACCG CGAGGAACAT CTCATGGCAG CATTTCAGTA TTTTGACAAG 371 GATGGAAGTG GTTATATTAC AGTAGATGAG CTCCAGCAGG CCTGTGCAGA TCATAACATT 42582 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GATGGAAGTG GTTATATTAC AGTAGATGAG CTCCAGCAGG CCTGTGCAGA TCATAACATT 431 ACAGATGTAT TCTTTGAGGA TATTATCAGA GAAGTTGATC AGGATAACGT AAGTTAATTA 42642 |||||||||| |||||||||| |||||||||| |||||||||| |||||||| ACAGATGTAT TCTTTGAGGA TATTATCAGA GAAGTTGATC AGGATAAC.. .......... 479 TATTGAGGAT AAAGTTGAAG TATTATTGGA ACTTATCAAT AAAAAAGTGG ACACAAATTA 42702 .......... .......... .......... .......... .......... .......... 479 GTAGATTAAA TTTCTTCATG TTTTGCAGTT CTACTGATTT ATCTCTCTAC TACTCATAAT 42762 .......... .......... .......... .......... .......... .......... 479 TTTTTTGCAA CAAAAACTAT TTTTTTTTAT AAAAAAGCAC TTTAATATGA AACACTTTTT 42822 .......... .......... .......... .......... .......... .......... 479 GTGCAACAAA AACGAAAATT AAAAAAATAT AGCACTTTAA GATTTCATAT GAATCTTTTC 42882 .......... .......... .......... .......... .......... .......... 479 CTTGAGATAA AATGTTATTG ACAATGTAGT GTATGTATGG AAAATACGGA TATTACTAAA 42942 .......... .......... .......... .......... .......... .......... 479 TGATCATATG TGAGCTTAAT AATATAGTTA ATTTACCTCT CTCTCTCTAT ATATATAAAG 43002 .......... .......... .......... .......... .......... .......... 479 AGAACCCTAG GCTGCCTAAG TGGCGCCACC ACAAATCAGG ATTCCCTTTT AATTTATTTA 43062 .......... .......... .......... .......... .......... .......... 479 TTTCCAAAAT TAGCCTTCCC TTTCATCAAA AGTTGTGACT TATGAAACTT TGCGACTTTT 43122 .......... .......... .......... .......... .......... .......... 479 ACAAAGAGTT GTAACTTTTA TGAAAGTTGT AACTTTTATG AAAGTTGTAA CTTTTATGTA 43182 .......... .......... .......... .......... .......... .......... 479 GAGTTGTGAC TTTTCCAAAG GATTATTACA TTTCCGATAA GACACCATAA CCATTTATTC 43242 .......... .......... .......... .......... .......... .......... 479 ACACTATCCT TTTGTTGTCT ATAAATAGAG GAATTTTCTT TCATTTTAAA ACGACGAAAA 43302 .......... .......... .......... .......... .......... .......... 479 TTCTAAATTT TTTCTTCTGC TTATGCACAA TTAAATATTT GTGTACTTTG CTCCTGTTGA 43362 .......... .......... .......... .......... .......... .......... 479 GTGGTTCACT GACATCATTG TTTTTGAATC TATACAACGG TGAATATAAT CGTTCTATCC 43422 .......... .......... .......... .......... .......... .......... 479 TAAAAGTATC TATTCATTCT TTTGTTACAA ATCTTGGTAT GTTTTTTACG CTCATTTATG 43482 .......... .......... .......... .......... .......... .......... 479 CTTATGTTAT TAGTTGTTTT TGAGTACATG TTTTAAACTT TGTTGTTTAT GTTTATGTTT 43542 .......... .......... .......... .......... .......... .......... 479 ATGTTGAAAT AAAGATATGT TAATCAAGAA TTTGATGTAG TGATGTCATG TAGATTAAAA 43602 .......... .......... .......... .......... .......... .......... 479 TTCTTGAACT TATAAAATAA ATGACTTTGA TCTTTATAGA GTTTTAGTGG CTAAAAGATT 43662 .......... .......... .......... .......... .......... .......... 479 CATGGGATGT TCAAGAAGAA ACTTTTGAGT GTTCAAAAGT TATGGTGGTT CTACTCTACC 43722 .......... .......... .......... .......... .......... .......... 479 ATGGAGTTTA GTTATTCAAC TTTCTATCTT ATCTAGACAT TCAATCGATT AGTGACATTC 43782 .......... .......... .......... .......... .......... .......... 479 AAAAAATAAA GGAAAATGTA GCGGGATGGT AAGTATTATA CTCAACCTTA ATTAAAAGTT 43842 .......... .......... .......... .......... .......... .......... 479 TGGGATTCAA ATATTTGATT GGAGTCAATG AATTACCCCC TTAGGATGAA TCTACATTAA 43902 .......... .......... .......... .......... .......... .......... 479 TCAATTATTA AAGAAATAAT TATCTCCTTA TAAACATTAG ATTAAAAGTT GCAAAAAGAT 43962 .......... .......... .......... .......... .......... .......... 479 TAAAGCTTTA ACCATATTGA TCGGAACATA AACAACAAAA TATGCATTTT GGGTATCAAA 44022 .......... .......... .......... .......... .......... .......... 479 GTAGTGTCAT ACATAATGAT TTGAATAAGG GTCTTGCCAA GACATCATTT AATCCGAATT 44082 .......... .......... .......... .......... .......... .......... 479 ATTTGAGTGA CTTGCCTTAT TTCATTGAAA TTCCAAGAGA TGTTTTTTAA AATTTTAATT 44142 .......... .......... .......... .......... .......... .......... 479 AACTTATCAA GCACACAACT AATTATATAA AATGTATAAT ATTTAGATTT TGTATGTAGA 44202 .......... .......... .......... .......... .......... .......... 479 GGGAGGCCTT GAATAAGAGA AGAACTCTCG CAATTGATGA ATAAAATGTT TGTACCACTT 44262 .......... .......... .......... .......... .......... .......... 479 TTGGAAAATA CAAATATAGA CAATGAAACA ATTACCTATC TTTTCTAAAG ATTTGGTGAT 44322 .......... .......... .......... .......... .......... .......... 479 GAATAACTAC AGTAAAATGA AGAATCAATA ACTAAATCCA TAAACACGTA GAATCAAATC 44382 .......... .......... .......... .......... .......... .......... 479 GTTTTAAGTT TAAAAAAATA TTTTATTTTG TCTTTGGATA AAATATTCTT GACAATTTAT 44442 .......... .......... .......... .......... .......... .......... 479 TGTTGGGTTG TACCCATTCG AAAACACTTA TATTATCAAA TGTTCAGAAG TAGATTATTA 44502 .......... .......... .......... .......... .......... .......... 479 CCGTAGTTTA CCACCGCGCG AAAAGCATGC AATTTACCTT GTTAAATTAC AAGTGCTCAG 44562 .......... .......... .......... .......... .......... .......... 479 ATGCAATGAT ATGCTTTGAA AATTATTTTT GAAGAACTTC TCGTAGTTCT GTTTGGTCTG 44622 .......... .......... .......... .......... .......... .......... 479 ACTGCATTCG TGCCAGCTAC TCACTTTTTG GCGTCACTTC ATAATCTAAG TAGTTTTGTG 44682 .......... .......... .......... .......... .......... .......... 479 TATTCAAAGG CATAATGAGA AGACAAAGCT GACATAATTG TCCAAAGAAA AGAAAAAAGA 44742 .......... .......... .......... .......... .......... .......... 479 CAAAGAAATT GTAGCATAAT AAACAGGAAT GGGTACCGTT ACAGACATTT CTGTCTTTCT 44802 .......... .......... .......... .......... .......... .......... 479 TCAAATCAAA CAAAATTTGT TGTATTTTGA TTAGTTTTCT GGAGCCTCAG TATTGGATTA 44862 .......... .......... .......... .......... .......... .......... 479 GGGCCTCAGC TGCAGCCGTG ATACAGGCAA ATTGTTATGC TTTAGGAGAT CTGTATTTTA 44922 .......... .......... .......... .......... .......... .......... 479 AATGGATGGA ATGATTCTTT TGGAATCTCT ACATCTCTTG ATGCTTCATT TGACTAGCTA 44982 .......... .......... .......... .......... .......... .......... 479 TTTAGTTGAT CTTCTGGTGG ATTCCCTTTT CAGGATGGAC GTATTGATTA TGGAGAATTT 45042 ||||||| |||||||||| |||||||||| .......... .......... .......... ...GATGGAC GTATTGATTA TGGAGAATTT 506 GTTGCTATGA TGCAA 45057 |||||||||| ||||| GTTGCTATGA TGCAA 521 hqPGS_C01HBa0088L02.1+_SGN-E311119+ (41323 41408,41729 41896,42406 42630,45016 45057) ******************************************************************************** EST sequence 70 +strand 615 n (File: SGN-E238352+) 1 TACTTTCTCG CCTAAAACAG TTCTCTGCTA TGAACAAGTT AAAAAAGATG GCTTTGCGGG 61 TGATTGCTGA AAGCTTGTCT GAAGAAGAGA TTGCTGGTCT GAGAGAGATG TTTAAGGCCA 121 TGGATACTGA CAATAGTGGT GCAATTACAT TTGATGAACT AAAAGCAGGG TTGAGAAAAT 181 ATGGCTCTAC CTTAAAGGAT ACGGAGATAC GGGAACTTAT GGATGCGGCT GATGTGGACA 241 ATAGTGGAAC TATTGACTAT GGAGAATTCA TTGCGGCAAC TGTTCATCTT AATAAATTGG 301 AGCGCGAGGA ACATCTCATG GCAGCATTTC AATATTTTGA CAAGGATGGA AGTGGTTACA 361 TAACAGTTGA TGAGGTCCAG CAAGCTTGTA TAGAGCATAA CATGACAGAT GTTTACTTTG 421 AGGATATTAT AAGAGAAGTC GATCAGGATA ATGATGGACG AATTGATTAT GGAGAATTTG 481 TTGCTATGAT GCAAAAAGGA AATCCGTGTA TAGGGAGACG AACAATGCGA AATAGTCTGA 541 ATTTGAGCAT GAGAGATGCA TCAGGAGCTC AGTAGTAGCT TCTCAGACAG ACATCTCTAC 601 TAGGTTGTAC AGAAA Predicted gene structure (within gDNA segment 39540 to 46427): Exon 1 41350 41408 ( 59 n); cDNA 1 59 ( 59 n); score: 0.898 Intron 1 41409 41728 ( 320 n); Pd: 0.909 (s: 0.88), Pa: 1.000 (s: 0.84) Exon 2 41729 41896 ( 168 n); cDNA 60 227 ( 168 n); score: 0.893 Intron 2 41897 42405 ( 509 n); Pd: 0.985 (s: 0.90), Pa: 0.999 (s: 0.96) Exon 3 42406 42630 ( 225 n); cDNA 228 452 ( 225 n); score: 0.898 Intron 3 42631 45015 (2385 n); Pd: 0.956 (s: 0.88), Pa: 0.995 (s: 0.98) Exon 4 45016 45137 ( 122 n); cDNA 453 574 ( 122 n); score: 0.926 MATCH C01HBa0088L02.1+ SGN-E238352+ 0.902 574 0.933 C PGS_C01HBa0088L02.1+_SGN-E238352+ (41350 41408,41729 41896,42406 42630,45016 45137) Alignment (genomic DNA sequence = upper lines): TACTTTCTCG CCTCAAACAC TTTTCTGCAA TGAACAAATT AAAAAAGATG GCTCTGCGGG 41409 |||||||||| ||| ||||| || ||||| | ||||||| || |||||||||| ||| ||||| TACTTTCTCG CCTAAAACAG TTCTCTGCTA TGAACAAGTT AAAAAAGATG GCTTTGCGG. 59 TATGCATATA TATATGTGTG TGTATATATA TCTAGGCATA ACTTTTTTGC CCAAGTCTGT 41469 .......... .......... .......... .......... .......... .......... 59 TAATTATGGT TCTTCAGTGT CCATAAACCT CATTATTAAA GTTACACAAG AAAATGCTGA 41529 .......... .......... .......... .......... .......... .......... 59 TTATGTCCTT TGGGCTAAGT TGTGTGGACT CTTCAGTTTC GATGGCGCAC CAGTGTCGGA 41589 .......... .......... .......... .......... .......... .......... 59 TTCTCCAAAA ATACACTCCT TATGGAGAAG CCGACACACA CCCATTGACA TTTTTGAAGC 41649 .......... .......... .......... .......... .......... .......... 59 GTCCAAGCAA CATAGCTTCT TGGAGGTGTG TAACCAAATG ATGCAATTAT TGATGTTTTC 41709 .......... .......... .......... .......... .......... .......... 59 ATACTTAATA TGCATTTAGG TGATTGCTGA AAGTTTGTCA GAGGAGGAGA TTGCCGGTCT 41769 | |||||||||| ||| ||||| || || |||| |||| ||||| .......... .........G TGATTGCTGA AAGCTTGTCT GAAGAAGAGA TTGCTGGTCT 100 TAAGGAGATG TTTAAGGCCA TGGATACTGA TAACAGTGGT GCAATTACAT TCGATGAACT 41829 | |||||| |||||||||| |||||||||| || |||||| |||||||||| | |||||||| GAGAGAGATG TTTAAGGCCA TGGATACTGA CAATAGTGGT GCAATTACAT TTGATGAACT 160 AAAAGCTGGT TTGAGAAAAT ATGGCTCTAC TCTGAAGGAT ATAGAGATAC GGGAACTTAT 41889 |||||| || |||||||||| |||||||||| | |||||| | ||||||| |||||||||| AAAAGCAGGG TTGAGAAAAT ATGGCTCTAC CTTAAAGGAT ACGGAGATAC GGGAACTTAT 220 GGATGCGGTA AGAAAATCTA GACTGCAAAC TGATTCTGTT TATTTTGTGC ATCTGGTGAT 41949 ||||||| GGATGCG... .......... .......... .......... .......... .......... 227 GTGACTCTAC ACAAAGGTTC ATAGGAGCAG AAAAATGTAA AATGACATAA GATCACTAAC 42009 .......... .......... .......... .......... .......... .......... 227 TAATGGTCAA ATCTCAAGGT TATTTGATGT GCAAATACTA GAGTCAGATT GGGATTTGGC 42069 .......... .......... .......... .......... .......... .......... 227 ACTTTACTTT GTTTAATTAA TTATGTACAT TCATGAAGGA GCACTTAAAA CTCAATGTAG 42129 .......... .......... .......... .......... .......... .......... 227 TTGCTAAAAC TTCACTGGAA AGGTGCCCAA TTTTTTTTTT TTGTGTATGT GTATGATAAG 42189 .......... .......... .......... .......... .......... .......... 227 TTTCTGATAA CTGAGGAGGT AGTGCAGGCT TACCAAGTAG TTGGCACCAC ATATATGCTT 42249 .......... .......... .......... .......... .......... .......... 227 CATCAGAAAC AACTTTCTGT TAATGGTTCT AGTTGTATCT TTAATTAGGC CCGTGATAAT 42309 .......... .......... .......... .......... .......... .......... 227 CTTTGTATTT CTCCCTAAAC ATGTCTGTCT ATGAGGTACA TGCGGAAGTG CTTATCTAAC 42369 .......... .......... .......... .......... .......... .......... 227 TCTTTAAGGC CATTGATGTA ATATTACTGT TTTCAGGCTG ATGTGGACAA TAGTGGAACT 42429 |||| |||||||||| |||||||||| .......... .......... .......... ......GCTG ATGTGGACAA TAGTGGAACT 251 ATTGACTATG GAGAATTCAT AGCAGCAACA ATTCACCTTA ACAAATTGGA CCGCGAGGAA 42489 |||||||||| |||||||||| || ||||| |||| |||| | |||||||| ||||||||| ATTGACTATG GAGAATTCAT TGCGGCAACT GTTCATCTTA ATAAATTGGA GCGCGAGGAA 311 CATCTCATGG CAGCATTTCA GTATTTTGAC AAGGATGGAA GTGGTTATAT TACAGTAGAT 42549 |||||||||| |||||||||| ||||||||| |||||||||| ||||||| || ||||| ||| CATCTCATGG CAGCATTTCA ATATTTTGAC AAGGATGGAA GTGGTTACAT AACAGTTGAT 371 GAGCTCCAGC AGGCCTGTGC AGATCATAAC ATTACAGATG TATTCTTTGA GGATATTATC 42609 ||| |||||| | || ||| ||| |||||| || ||||||| | | |||||| ||||||||| GAGGTCCAGC AAGCTTGTAT AGAGCATAAC ATGACAGATG TTTACTTTGA GGATATTATA 431 AGAGAAGTTG ATCAGGATAA CGTAAGTTAA TTATATTGAG GATAAAGTTG AAGTATTATT 42669 |||||||| | |||||||||| AGAGAAGTCG ATCAGGATAA T......... .......... .......... .......... 452 GGAACTTATC AATAAAAAAG TGGACACAAA TTAGTAGATT AAATTTCTTC ATGTTTTGCA 42729 .......... .......... .......... .......... .......... .......... 452 GTTCTACTGA TTTATCTCTC TACTACTCAT AATTTTTTTG CAACAAAAAC TATTTTTTTT 42789 .......... .......... .......... .......... .......... .......... 452 TATAAAAAAG CACTTTAATA TGAAACACTT TTTGTGCAAC AAAAACGAAA ATTAAAAAAA 42849 .......... .......... .......... .......... .......... .......... 452 TATAGCACTT TAAGATTTCA TATGAATCTT TTCCTTGAGA TAAAATGTTA TTGACAATGT 42909 .......... .......... .......... .......... .......... .......... 452 AGTGTATGTA TGGAAAATAC GGATATTACT AAATGATCAT ATGTGAGCTT AATAATATAG 42969 .......... .......... .......... .......... .......... .......... 452 TTAATTTACC TCTCTCTCTC TATATATATA AAGAGAACCC TAGGCTGCCT AAGTGGCGCC 43029 .......... .......... .......... .......... .......... .......... 452 ACCACAAATC AGGATTCCCT TTTAATTTAT TTATTTCCAA AATTAGCCTT CCCTTTCATC 43089 .......... .......... .......... .......... .......... .......... 452 AAAAGTTGTG ACTTATGAAA CTTTGCGACT TTTACAAAGA GTTGTAACTT TTATGAAAGT 43149 .......... .......... .......... .......... .......... .......... 452 TGTAACTTTT ATGAAAGTTG TAACTTTTAT GTAGAGTTGT GACTTTTCCA AAGGATTATT 43209 .......... .......... .......... .......... .......... .......... 452 ACATTTCCGA TAAGACACCA TAACCATTTA TTCACACTAT CCTTTTGTTG TCTATAAATA 43269 .......... .......... .......... .......... .......... .......... 452 GAGGAATTTT CTTTCATTTT AAAACGACGA AAATTCTAAA TTTTTTCTTC TGCTTATGCA 43329 .......... .......... .......... .......... .......... .......... 452 CAATTAAATA TTTGTGTACT TTGCTCCTGT TGAGTGGTTC ACTGACATCA TTGTTTTTGA 43389 .......... .......... .......... .......... .......... .......... 452 ATCTATACAA CGGTGAATAT AATCGTTCTA TCCTAAAAGT ATCTATTCAT TCTTTTGTTA 43449 .......... .......... .......... .......... .......... .......... 452 CAAATCTTGG TATGTTTTTT ACGCTCATTT ATGCTTATGT TATTAGTTGT TTTTGAGTAC 43509 .......... .......... .......... .......... .......... .......... 452 ATGTTTTAAA CTTTGTTGTT TATGTTTATG TTTATGTTGA AATAAAGATA TGTTAATCAA 43569 .......... .......... .......... .......... .......... .......... 452 GAATTTGATG TAGTGATGTC ATGTAGATTA AAATTCTTGA ACTTATAAAA TAAATGACTT 43629 .......... .......... .......... .......... .......... .......... 452 TGATCTTTAT AGAGTTTTAG TGGCTAAAAG ATTCATGGGA TGTTCAAGAA GAAACTTTTG 43689 .......... .......... .......... .......... .......... .......... 452 AGTGTTCAAA AGTTATGGTG GTTCTACTCT ACCATGGAGT TTAGTTATTC AACTTTCTAT 43749 .......... .......... .......... .......... .......... .......... 452 CTTATCTAGA CATTCAATCG ATTAGTGACA TTCAAAAAAT AAAGGAAAAT GTAGCGGGAT 43809 .......... .......... .......... .......... .......... .......... 452 GGTAAGTATT ATACTCAACC TTAATTAAAA GTTTGGGATT CAAATATTTG ATTGGAGTCA 43869 .......... .......... .......... .......... .......... .......... 452 ATGAATTACC CCCTTAGGAT GAATCTACAT TAATCAATTA TTAAAGAAAT AATTATCTCC 43929 .......... .......... .......... .......... .......... .......... 452 TTATAAACAT TAGATTAAAA GTTGCAAAAA GATTAAAGCT TTAACCATAT TGATCGGAAC 43989 .......... .......... .......... .......... .......... .......... 452 ATAAACAACA AAATATGCAT TTTGGGTATC AAAGTAGTGT CATACATAAT GATTTGAATA 44049 .......... .......... .......... .......... .......... .......... 452 AGGGTCTTGC CAAGACATCA TTTAATCCGA ATTATTTGAG TGACTTGCCT TATTTCATTG 44109 .......... .......... .......... .......... .......... .......... 452 AAATTCCAAG AGATGTTTTT TAAAATTTTA ATTAACTTAT CAAGCACACA ACTAATTATA 44169 .......... .......... .......... .......... .......... .......... 452 TAAAATGTAT AATATTTAGA TTTTGTATGT AGAGGGAGGC CTTGAATAAG AGAAGAACTC 44229 .......... .......... .......... .......... .......... .......... 452 TCGCAATTGA TGAATAAAAT GTTTGTACCA CTTTTGGAAA ATACAAATAT AGACAATGAA 44289 .......... .......... .......... .......... .......... .......... 452 ACAATTACCT ATCTTTTCTA AAGATTTGGT GATGAATAAC TACAGTAAAA TGAAGAATCA 44349 .......... .......... .......... .......... .......... .......... 452 ATAACTAAAT CCATAAACAC GTAGAATCAA ATCGTTTTAA GTTTAAAAAA ATATTTTATT 44409 .......... .......... .......... .......... .......... .......... 452 TTGTCTTTGG ATAAAATATT CTTGACAATT TATTGTTGGG TTGTACCCAT TCGAAAACAC 44469 .......... .......... .......... .......... .......... .......... 452 TTATATTATC AAATGTTCAG AAGTAGATTA TTACCGTAGT TTACCACCGC GCGAAAAGCA 44529 .......... .......... .......... .......... .......... .......... 452 TGCAATTTAC CTTGTTAAAT TACAAGTGCT CAGATGCAAT GATATGCTTT GAAAATTATT 44589 .......... .......... .......... .......... .......... .......... 452 TTTGAAGAAC TTCTCGTAGT TCTGTTTGGT CTGACTGCAT TCGTGCCAGC TACTCACTTT 44649 .......... .......... .......... .......... .......... .......... 452 TTGGCGTCAC TTCATAATCT AAGTAGTTTT GTGTATTCAA AGGCATAATG AGAAGACAAA 44709 .......... .......... .......... .......... .......... .......... 452 GCTGACATAA TTGTCCAAAG AAAAGAAAAA AGACAAAGAA ATTGTAGCAT AATAAACAGG 44769 .......... .......... .......... .......... .......... .......... 452 AATGGGTACC GTTACAGACA TTTCTGTCTT TCTTCAAATC AAACAAAATT TGTTGTATTT 44829 .......... .......... .......... .......... .......... .......... 452 TGATTAGTTT TCTGGAGCCT CAGTATTGGA TTAGGGCCTC AGCTGCAGCC GTGATACAGG 44889 .......... .......... .......... .......... .......... .......... 452 CAAATTGTTA TGCTTTAGGA GATCTGTATT TTAAATGGAT GGAATGATTC TTTTGGAATC 44949 .......... .......... .......... .......... .......... .......... 452 TCTACATCTC TTGATGCTTC ATTTGACTAG CTATTTAGTT GATCTTCTGG TGGATTCCCT 45009 .......... .......... .......... .......... .......... .......... 452 TTTCAGGATG GACGTATTGA TTATGGAGAA TTTGTTGCTA TGATGCAAAA AGGAAATCCA 45069 |||| |||| ||||| |||||||||| |||||||||| |||||||||| ||||||||| ......GATG GACGAATTGA TTATGGAGAA TTTGTTGCTA TGATGCAAAA AGGAAATCCG 506 TGCATAGGAA GACGAACAAT GCGAAATAGT CTGAATTTCA GCATGAGAGA TGCGCCCGGA 45129 || ||||| | |||||||||| |||||||||| |||||||| | |||||||||| ||| | ||| TGTATAGGGA GACGAACAAT GCGAAATAGT CTGAATTTGA GCATGAGAGA TGCATCAGGA 566 GCTCATTA 45137 ||||| || GCTCAGTA 574 hqPGS_C01HBa0088L02.1+_SGN-E238352+ (41350 41408,41729 41896,42406 42630,45016 45137) ******************************************************************************** EST sequence 206 -strand 846 n (File: SGN-E542636-) 1 GCGGGTGATT GCTGAAAGTT TGTCAGAGGA GGAGATTGCC GGTCTTAAGG AGATGTTTAA 61 GGCCATGGAT ACTGATAACA GTGGTGCAAT TACATTCGAT GAACTAAAAG CTGGTTTGAG 121 AAAATATGGC TCTACTCTGA AGGATATAGA GATACGGGAA CTTATGGATG CGGCTGATGT 181 GGACAATAGT GGAACTATTG ACTATGGAGA ATTCATAGCA GCAACAATTC ACCTTAACAA 241 ATTGGACCGC GAGGAACATC TCATGGCAGC ATTTCAGTAT TTTGACAAGG ATGGAAGTGG 301 TTATATTACA GTAGATGAGC TCCAGCAGGC CTGTGCAGAT CATAACATTA CAGATGTATT 361 CTTTGAGGAT ATTATCAGAG AAGTTGATCA GGATAACGAT GGACGTATTG ATTATGGAGA 421 ATTTGTTGCT ATGATGCAAA AAGGAAATCC ATGCATAGGA AGACGAACAA TGCGAAATAG 481 TCTGAATTTC AGCATGAGAG ATGCGCCCGG AGCTCATTAG CTTTTTGAAT GGACACATGA 541 TGTTTTTACA GATAATAGAG CAGAGGCAAT GAAACTGCCG TAACAATGTC TGGTACTCTT 601 TTCTAAAAGT AGTATGCCAT GCTCTCAAGT ATAACTAGAA GTGCTTGTAG ACTGTGCCTC 661 AACAAAATGT GAAATCTCTG TCGTGTGTGA AATCATTTCA GCTACCTAGT GTTCTTTAGT 721 TGAGGCTTCA TGCTTGCTTC AGTTAGAAGG TGGTTCACCT TGAGGTGTAT CCTTGTCAAT 781 TACATAATTA TGTATTTTAC CCATTGGTTT TTCTCTATCG GGAGATTGTT TTTAAGGAAA 841 AAAAAA Predicted gene structure (within gDNA segment 41088 to 52342): Exon 1 41729 41896 ( 168 n); cDNA 5 172 ( 168 n); score: 1.000 Intron 1 41897 42405 ( 509 n); Pd: 0.985 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 2 42406 42630 ( 225 n); cDNA 173 397 ( 225 n); score: 1.000 Intron 2 42631 45015 (2385 n); Pd: 0.956 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 3 45016 45159 ( 144 n); cDNA 398 541 ( 144 n); score: 1.000 Intron 3 45160 51392 (6233 n); Pd: 0.994 (s: 1.00), Pa: 0.659 (s: 1.00) Exon 4 51393 51695 ( 303 n); cDNA 542 844 ( 303 n); score: 0.997 MATCH C01HBa0088L02.1+ SGN-E542636- 0.999 840 0.993 C PGS_C01HBa0088L02.1+_SGN-E542636- (41729 41896,42406 42630,45016 45159,51393 51695) Alignment (genomic DNA sequence = upper lines): GTGATTGCTG AAAGTTTGTC AGAGGAGGAG ATTGCCGGTC TTAAGGAGAT GTTTAAGGCC 41788 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTGATTGCTG AAAGTTTGTC AGAGGAGGAG ATTGCCGGTC TTAAGGAGAT GTTTAAGGCC 64 ATGGATACTG ATAACAGTGG TGCAATTACA TTCGATGAAC TAAAAGCTGG TTTGAGAAAA 41848 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATGGATACTG ATAACAGTGG TGCAATTACA TTCGATGAAC TAAAAGCTGG TTTGAGAAAA 124 TATGGCTCTA CTCTGAAGGA TATAGAGATA CGGGAACTTA TGGATGCGGT AAGAAAATCT 41908 |||||||||| |||||||||| |||||||||| |||||||||| |||||||| TATGGCTCTA CTCTGAAGGA TATAGAGATA CGGGAACTTA TGGATGCG.. .......... 172 AGACTGCAAA CTGATTCTGT TTATTTTGTG CATCTGGTGA TGTGACTCTA CACAAAGGTT 41968 .......... .......... .......... .......... .......... .......... 172 CATAGGAGCA GAAAAATGTA AAATGACATA AGATCACTAA CTAATGGTCA AATCTCAAGG 42028 .......... .......... .......... .......... .......... .......... 172 TTATTTGATG TGCAAATACT AGAGTCAGAT TGGGATTTGG CACTTTACTT TGTTTAATTA 42088 .......... .......... .......... .......... .......... .......... 172 ATTATGTACA TTCATGAAGG AGCACTTAAA ACTCAATGTA GTTGCTAAAA CTTCACTGGA 42148 .......... .......... .......... .......... .......... .......... 172 AAGGTGCCCA ATTTTTTTTT TTTGTGTATG TGTATGATAA GTTTCTGATA ACTGAGGAGG 42208 .......... .......... .......... .......... .......... .......... 172 TAGTGCAGGC TTACCAAGTA GTTGGCACCA CATATATGCT TCATCAGAAA CAACTTTCTG 42268 .......... .......... .......... .......... .......... .......... 172 TTAATGGTTC TAGTTGTATC TTTAATTAGG CCCGTGATAA TCTTTGTATT TCTCCCTAAA 42328 .......... .......... .......... .......... .......... .......... 172 CATGTCTGTC TATGAGGTAC ATGCGGAAGT GCTTATCTAA CTCTTTAAGG CCATTGATGT 42388 .......... .......... .......... .......... .......... .......... 172 AATATTACTG TTTTCAGGCT GATGTGGACA ATAGTGGAAC TATTGACTAT GGAGAATTCA 42448 ||| |||||||||| |||||||||| |||||||||| |||||||||| .......... .......GCT GATGTGGACA ATAGTGGAAC TATTGACTAT GGAGAATTCA 215 TAGCAGCAAC AATTCACCTT AACAAATTGG ACCGCGAGGA ACATCTCATG GCAGCATTTC 42508 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAGCAGCAAC AATTCACCTT AACAAATTGG ACCGCGAGGA ACATCTCATG GCAGCATTTC 275 AGTATTTTGA CAAGGATGGA AGTGGTTATA TTACAGTAGA TGAGCTCCAG CAGGCCTGTG 42568 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTATTTTGA CAAGGATGGA AGTGGTTATA TTACAGTAGA TGAGCTCCAG CAGGCCTGTG 335 CAGATCATAA CATTACAGAT GTATTCTTTG AGGATATTAT CAGAGAAGTT GATCAGGATA 42628 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGATCATAA CATTACAGAT GTATTCTTTG AGGATATTAT CAGAGAAGTT GATCAGGATA 395 ACGTAAGTTA ATTATATTGA GGATAAAGTT GAAGTATTAT TGGAACTTAT CAATAAAAAA 42688 || AC........ .......... .......... .......... .......... .......... 397 GTGGACACAA ATTAGTAGAT TAAATTTCTT CATGTTTTGC AGTTCTACTG ATTTATCTCT 42748 .......... .......... .......... .......... .......... .......... 397 CTACTACTCA TAATTTTTTT GCAACAAAAA CTATTTTTTT TTATAAAAAA GCACTTTAAT 42808 .......... .......... .......... .......... .......... .......... 397 ATGAAACACT TTTTGTGCAA CAAAAACGAA AATTAAAAAA ATATAGCACT TTAAGATTTC 42868 .......... .......... .......... .......... .......... .......... 397 ATATGAATCT TTTCCTTGAG ATAAAATGTT ATTGACAATG TAGTGTATGT ATGGAAAATA 42928 .......... .......... .......... .......... .......... .......... 397 CGGATATTAC TAAATGATCA TATGTGAGCT TAATAATATA GTTAATTTAC CTCTCTCTCT 42988 .......... .......... .......... .......... .......... .......... 397 CTATATATAT AAAGAGAACC CTAGGCTGCC TAAGTGGCGC CACCACAAAT CAGGATTCCC 43048 .......... .......... .......... .......... .......... .......... 397 TTTTAATTTA TTTATTTCCA AAATTAGCCT TCCCTTTCAT CAAAAGTTGT GACTTATGAA 43108 .......... .......... .......... .......... .......... .......... 397 ACTTTGCGAC TTTTACAAAG AGTTGTAACT TTTATGAAAG TTGTAACTTT TATGAAAGTT 43168 .......... .......... .......... .......... .......... .......... 397 GTAACTTTTA TGTAGAGTTG TGACTTTTCC AAAGGATTAT TACATTTCCG ATAAGACACC 43228 .......... .......... .......... .......... .......... .......... 397 ATAACCATTT ATTCACACTA TCCTTTTGTT GTCTATAAAT AGAGGAATTT TCTTTCATTT 43288 .......... .......... .......... .......... .......... .......... 397 TAAAACGACG AAAATTCTAA ATTTTTTCTT CTGCTTATGC ACAATTAAAT ATTTGTGTAC 43348 .......... .......... .......... .......... .......... .......... 397 TTTGCTCCTG TTGAGTGGTT CACTGACATC ATTGTTTTTG AATCTATACA ACGGTGAATA 43408 .......... .......... .......... .......... .......... .......... 397 TAATCGTTCT ATCCTAAAAG TATCTATTCA TTCTTTTGTT ACAAATCTTG GTATGTTTTT 43468 .......... .......... .......... .......... .......... .......... 397 TACGCTCATT TATGCTTATG TTATTAGTTG TTTTTGAGTA CATGTTTTAA ACTTTGTTGT 43528 .......... .......... .......... .......... .......... .......... 397 TTATGTTTAT GTTTATGTTG AAATAAAGAT ATGTTAATCA AGAATTTGAT GTAGTGATGT 43588 .......... .......... .......... .......... .......... .......... 397 CATGTAGATT AAAATTCTTG AACTTATAAA ATAAATGACT TTGATCTTTA TAGAGTTTTA 43648 .......... .......... .......... .......... .......... .......... 397 GTGGCTAAAA GATTCATGGG ATGTTCAAGA AGAAACTTTT GAGTGTTCAA AAGTTATGGT 43708 .......... .......... .......... .......... .......... .......... 397 GGTTCTACTC TACCATGGAG TTTAGTTATT CAACTTTCTA TCTTATCTAG ACATTCAATC 43768 .......... .......... .......... .......... .......... .......... 397 GATTAGTGAC ATTCAAAAAA TAAAGGAAAA TGTAGCGGGA TGGTAAGTAT TATACTCAAC 43828 .......... .......... .......... .......... .......... .......... 397 CTTAATTAAA AGTTTGGGAT TCAAATATTT GATTGGAGTC AATGAATTAC CCCCTTAGGA 43888 .......... .......... .......... .......... .......... .......... 397 TGAATCTACA TTAATCAATT ATTAAAGAAA TAATTATCTC CTTATAAACA TTAGATTAAA 43948 .......... .......... .......... .......... .......... .......... 397 AGTTGCAAAA AGATTAAAGC TTTAACCATA TTGATCGGAA CATAAACAAC AAAATATGCA 44008 .......... .......... .......... .......... .......... .......... 397 TTTTGGGTAT CAAAGTAGTG TCATACATAA TGATTTGAAT AAGGGTCTTG CCAAGACATC 44068 .......... .......... .......... .......... .......... .......... 397 ATTTAATCCG AATTATTTGA GTGACTTGCC TTATTTCATT GAAATTCCAA GAGATGTTTT 44128 .......... .......... .......... .......... .......... .......... 397 TTAAAATTTT AATTAACTTA TCAAGCACAC AACTAATTAT ATAAAATGTA TAATATTTAG 44188 .......... .......... .......... .......... .......... .......... 397 ATTTTGTATG TAGAGGGAGG CCTTGAATAA GAGAAGAACT CTCGCAATTG ATGAATAAAA 44248 .......... .......... .......... .......... .......... .......... 397 TGTTTGTACC ACTTTTGGAA AATACAAATA TAGACAATGA AACAATTACC TATCTTTTCT 44308 .......... .......... .......... .......... .......... .......... 397 AAAGATTTGG TGATGAATAA CTACAGTAAA ATGAAGAATC AATAACTAAA TCCATAAACA 44368 .......... .......... .......... .......... .......... .......... 397 CGTAGAATCA AATCGTTTTA AGTTTAAAAA AATATTTTAT TTTGTCTTTG GATAAAATAT 44428 .......... .......... .......... .......... .......... .......... 397 TCTTGACAAT TTATTGTTGG GTTGTACCCA TTCGAAAACA CTTATATTAT CAAATGTTCA 44488 .......... .......... .......... .......... .......... .......... 397 GAAGTAGATT ATTACCGTAG TTTACCACCG CGCGAAAAGC ATGCAATTTA CCTTGTTAAA 44548 .......... .......... .......... .......... .......... .......... 397 TTACAAGTGC TCAGATGCAA TGATATGCTT TGAAAATTAT TTTTGAAGAA CTTCTCGTAG 44608 .......... .......... .......... .......... .......... .......... 397 TTCTGTTTGG TCTGACTGCA TTCGTGCCAG CTACTCACTT TTTGGCGTCA CTTCATAATC 44668 .......... .......... .......... .......... .......... .......... 397 TAAGTAGTTT TGTGTATTCA AAGGCATAAT GAGAAGACAA AGCTGACATA ATTGTCCAAA 44728 .......... .......... .......... .......... .......... .......... 397 GAAAAGAAAA AAGACAAAGA AATTGTAGCA TAATAAACAG GAATGGGTAC CGTTACAGAC 44788 .......... .......... .......... .......... .......... .......... 397 ATTTCTGTCT TTCTTCAAAT CAAACAAAAT TTGTTGTATT TTGATTAGTT TTCTGGAGCC 44848 .......... .......... .......... .......... .......... .......... 397 TCAGTATTGG ATTAGGGCCT CAGCTGCAGC CGTGATACAG GCAAATTGTT ATGCTTTAGG 44908 .......... .......... .......... .......... .......... .......... 397 AGATCTGTAT TTTAAATGGA TGGAATGATT CTTTTGGAAT CTCTACATCT CTTGATGCTT 44968 .......... .......... .......... .......... .......... .......... 397 CATTTGACTA GCTATTTAGT TGATCTTCTG GTGGATTCCC TTTTCAGGAT GGACGTATTG 45028 ||| |||||||||| .......... .......... .......... .......... .......GAT GGACGTATTG 410 ATTATGGAGA ATTTGTTGCT ATGATGCAAA AAGGAAATCC ATGCATAGGA AGACGAACAA 45088 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATTATGGAGA ATTTGTTGCT ATGATGCAAA AAGGAAATCC ATGCATAGGA AGACGAACAA 470 TGCGAAATAG TCTGAATTTC AGCATGAGAG ATGCGCCCGG AGCTCATTAG CTTTTTGAAT 45148 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGCGAAATAG TCTGAATTTC AGCATGAGAG ATGCGCCCGG AGCTCATTAG CTTTTTGAAT 530 GGACACATGA TGTAGGTATT TCCCCTTTTT TATTTTTGTA ACCGTTTCTT TGGCAATGAA 45208 |||||||||| | GGACACATGA T......... .......... .......... .......... .......... 541 TTTGAAGAAA TCTTTCCTTG TTCTGTCCTT GAGAAATTGG ATTGGTTGGA GTATATTTGT 45268 .......... .......... .......... .......... .......... .......... 541 TTAACATTAA GAGTTTCTTT TTCCCTCTTG AGGATAATAA AATTTTATAA ATAACAGCAT 45328 .......... .......... .......... .......... .......... .......... 541 GAGTGTTTGC TGTAAAACTC TACAGGTGCA GCAAAAAAAA TTACATTCAG CAAAAGTATA 45388 .......... .......... .......... .......... .......... .......... 541 TCCCATCTTA TCCTGTTGGT ACACTAGCAT GTCACAGATA GATTCAGCTT CCTCCCCAAT 45448 .......... .......... .......... .......... .......... .......... 541 CCTCCATTTT ACACCATTAA CAAAAATAAA TTTCAGATAC AGAGTTCTCT TTCATTCCCA 45508 .......... .......... .......... .......... .......... .......... 541 TCTTTTATAT AATGCTGGTT TCTTTTCTTT TGGTAAAATT TTGATGTATC AAATTTGACG 45568 .......... .......... .......... .......... .......... .......... 541 ATTGTCCGAC ATGGCTATGT GAGGAACTTT CCTAAGGGAG CACTAAGGGT GTCAAATGTG 45628 .......... .......... .......... .......... .......... .......... 541 TGGGTGGAGG CAGTGGGGGA CTGAAATTGA AGAGGTTAAA ATGGGCTGAG CTAAAAGTCA 45688 .......... .......... .......... .......... .......... .......... 541 TGTTGGATCA TAACCCACTC AAACTTACTT TGGGCTAACA TGGGCTAGAA TCTTGATTGG 45748 .......... .......... .......... .......... .......... .......... 541 GTTATGACCT ATCCAATTTG ACCTGCTTAA TCTAAACTAA ACTATATTAA ACACTTGCTA 45808 .......... .......... .......... .......... .......... .......... 541 TAATTTATGA CAGATGTCAT TCAACCCATA GAATCGTACA GATCTGTACT AACTTTTCAT 45868 .......... .......... .......... .......... .......... .......... 541 TTAGGAGCAT CTCCTTGTAG AGTAAATTGA TGTAGACTTT ATAGTATGGG ACCAACTTCA 45928 .......... .......... .......... .......... .......... .......... 541 TAATTTTGCA ACTCATTTAA TAGTGTATTT ATGAGAATTA TTGAAAAGAA TATTATTGAA 45988 .......... .......... .......... .......... .......... .......... 541 TTGTGTGTCT ACATTATTAC ATTGAGACTT TATTTATAGA CACTATATTA TACTCCTTTT 46048 .......... .......... .......... .......... .......... .......... 541 CCAACTAGGA CACTACAATA CCATCCTTTT CTAAGTAGGA TTCTATATAC TATTTCTATT 46108 .......... .......... .......... .......... .......... .......... 541 CCTATTCCTA TTCTAAGTAG AATGGTATAT ATTATTCTTG TTCCTTTTTT GATTCTAACA 46168 .......... .......... .......... .......... .......... .......... 541 CTCCCCCTCA AGCTGGTGCA TACAAGTTAT ATATACTTTG CTTGTTACAA ATGTAATTAA 46228 .......... .......... .......... .......... .......... .......... 541 TATGAGGACC AATGAGAGGC TTGATGAAGA TATCTGCAAG TTGATCACTT GACTCACAAA 46288 .......... .......... .......... .......... .......... .......... 541 TTTTGTAACA ATATCTCCCG ACTTCCCAGA CCAAGCTTGA GAAGAACGTT TCATATCATC 46348 .......... .......... .......... .......... .......... .......... 541 GAGTGACTTG CACAATCAAC ATATAAGGCT GCTAGACTCC CTCGGAGCAA TAAGACCAAG 46408 .......... .......... .......... .......... .......... .......... 541 TGGTTGCTCC ATATATACTT CTCCATCGAG ATCCCAGCCC AAATATGTAA GTATATCCTT 46468 .......... .......... .......... .......... .......... .......... 541 TTGGATAAAG TGAATCTAAA ACAAAGAGAA TATTGCTTGA AAACTTGGAT TTTTTTGGGA 46528 .......... .......... .......... .......... .......... .......... 541 ACTCGGATAT GTTGGACTTT GCACAACATT GACAAAGTTG AAACTATTTA AATCAGACCT 46588 .......... .......... .......... .......... .......... .......... 541 AAGGAGTCAC CGAAAAGACG TACGGTGCTT CGAAAATTAG ATATGAGAAA GTAGTCACCA 46648 .......... .......... .......... .......... .......... .......... 541 AAAAGACGCA TGATGTTGTG CAAATTAGAT ATGAGAAAGT AGTCACCAAG AAGATGAGAC 46708 .......... .......... .......... .......... .......... .......... 541 AGTGCTACAT AAATTAAATA TGAAAAAGTA GTCACTGATA AGATGGCACG GTGCTACACA 46768 .......... .......... .......... .......... .......... .......... 541 AATTAAATAT GAAAAAGTAG TCATCAAAAA GATGGTGCGA TGCTACACAA AAGTAAATAG 46828 .......... .......... .......... .......... .......... .......... 541 TCACCGGAAT GATGACATGA TGCTACAAAA ATGAAATATG AGAGTAGTCA CCTGAAGGAT 46888 .......... .......... .......... .......... .......... .......... 541 GACACAGTGC CACATAAATT GAACATAAAA AAATAGTCAC CAGAAACATG ATGCGGTGCT 46948 .......... .......... .......... .......... .......... .......... 541 ACACAAATTA AGAGCCTGTT TGGCTCAGCT TAAAAGCTGG TCAAACTGAC TTAAAATCTG 47008 .......... .......... .......... .......... .......... .......... 541 ATTTTTGACT TATTTAACTG TTTGACAATA CTCAAAATAG CTTATTTTAA GTTAAAAAAA 47068 .......... .......... .......... .......... .......... .......... 541 ACTTATTTTA AGCCAAAAGT TAAAAGGTGG GGTAGGGGTG CTTTTTTTTT TTAGCTTATA 47128 .......... .......... .......... .......... .......... .......... 541 AGCTGTTTTA AGTTGACCAT ATTTTTATGT TTTTTCCCTT AATATTTTTA TACAATCTCC 47188 .......... .......... .......... .......... .......... .......... 541 AAATTATCCA TATAACCCTA ACATCTCTTT CTTCTATTTT TCCCTTTTCA CGTTTGGCAT 47248 .......... .......... .......... .......... .......... .......... 541 AACAACTTCA GCACTTTTAT CCAAACGCAT AACTGCTTAT TTTAAAAATA AGTTTCAGCA 47308 .......... .......... .......... .......... .......... .......... 541 CTTTCAAAAG TACTTTTTTA AAGCTGCTTT TATTAAGCCC ATCCAAACGG GCTCTAAATA 47368 .......... .......... .......... .......... .......... .......... 541 TATAAATAAT AGTCACCGGA AGATGACACA CTGCTACAAA TCAAATTTAA GAAAGTAGTC 47428 .......... .......... .......... .......... .......... .......... 541 ACCGAAATGA TAGCACAGTG CCACACAAAT TAGATATGAG AAAGTAGTCG CCATGACAAC 47488 .......... .......... .......... .......... .......... .......... 541 CCTAGAAAGT CGTGCATATA TCAGTGACCC TAATTTGGTT AACATTACCA ATGGCAAGAG 47548 .......... .......... .......... .......... .......... .......... 541 GGGAGATAGA TATGAGTCAT AGCCGCCCTA CACCGACGAA ATCTTTTTTT GATTTTCTAC 47608 .......... .......... .......... .......... .......... .......... 541 CGAGATCGTA GGAGCTTTGA TACCATGTGG AAATATTGAA AAAGAACATT GTTGAATTGG 47668 .......... .......... .......... .......... .......... .......... 541 TCTCTAGATT ATAACATCGA GACCTATTAA TAGGGCACTA CCTTAGACTC AAATTCCAAC 47728 .......... .......... .......... .......... .......... .......... 541 TAGGACACTA CCATACAATC CTATTCTAAG TAGTATTTTA TGTACTATTT TTATTCCTAT 47788 .......... .......... .......... .......... .......... .......... 541 TACTAGTATT TTATGTACTA TTTTTATTCC TGTTACTATT CTAAGTATGA TGGTATATAT 47848 .......... .......... .......... .......... .......... .......... 541 TATTCTTGTT CATATTCCTA TTCAAACAGT AATAATTTGA CATATAGAAT GTAGGCAATT 47908 .......... .......... .......... .......... .......... .......... 541 ATTTTTTAAT ATGACATGGC ATGCAAAATA ATGTGTTGTT AAAGAATCAA ATAACAATAA 47968 .......... .......... .......... .......... .......... .......... 541 TCAAGTGACT TTAGAATTCC AAAAGAGAGA CCATGATAGA TCATTATCAT ATTAGGTAAT 48028 .......... .......... .......... .......... .......... .......... 541 AAAAAATAAG GATTCGGTAA CAAAATGCAA GAAGGTGAAA TGAATTTTTA AGATATTTCA 48088 .......... .......... .......... .......... .......... .......... 541 GTTTGCCAAA AATAAGCATA TTAGGTTAGT ATATGAGGAA AAAAAACAGT TTTATTCGAA 48148 .......... .......... .......... .......... .......... .......... 541 TTGGTTAAAC TCAGTTCTCA TTTTCATATC AAGTGAAAAG GTCAATATAA ACTAAAGAGA 48208 .......... .......... .......... .......... .......... .......... 541 TGATGATTGT CCCATCTTTG CACATGTAGT CCGGTTAGAA TGGGGATTGA ATTGACATAG 48268 .......... .......... .......... .......... .......... .......... 541 AACTTGGGCT AAGTGGGTTA TAATTATACG GGTTAAGACG TAGCACATTA TTAAATTATC 48328 .......... .......... .......... .......... .......... .......... 541 ATGAGCTCAA CCCATAAATT TTGGGCTCCT AATATCTGAG CTTCATTTGA CACCCCAAGT 48388 .......... .......... .......... .......... .......... .......... 541 AAGGAGTGCC ACGCACGAGC ATGGCAAAAA GCAAGGGGAA CTTTTCTTTT TGGGAGAAAT 48448 .......... .......... .......... .......... .......... .......... 541 CATTTGATTG CATATTGAAT ACATAAAGCA CATTCCAACA AATTCAAATT TTAGAAGTTT 48508 .......... .......... .......... .......... .......... .......... 541 CATATGGTGA CTACATTTTA GCTTCCCGTC AATTACCCCA ACCTTCTTCA TTTATCCAGA 48568 .......... .......... .......... .......... .......... .......... 541 TGTGGGACGG ACACGGTGAA GCTCACATAG ATTGAGTTAG GTAAAATATT TATCTGTGGA 48628 .......... .......... .......... .......... .......... .......... 541 GAAAAATATT ACCCCCTGTT CCATTTTGTG TGACAAGTTG AAAAATATGT GTGGTTAAAT 48688 .......... .......... .......... .......... .......... .......... 541 TGACTAATTT TCTGAGTGAA TTTGAACATT GATATTCATT TTCTAAAAAT AAAGTTTTAC 48748 .......... .......... .......... .......... .......... .......... 541 ATCTTTAAAA ACTATATAAA AAGTATTGTA AGTCACAATA GTTTACAATT CAAAATATTA 48808 .......... .......... .......... .......... .......... .......... 541 AAGAAGTATT TTAAAAAAAA CATGGTCAAA GAAAAACTTA TTTTACACTC CAGATAGTTA 48868 .......... .......... .......... .......... .......... .......... 541 TAGGTTACAT AAAGTGGAGC AAAGTACTCT TATCAATACT CTTAACCATA GGTCTGGAAT 48928 .......... .......... .......... .......... .......... .......... 541 TCGAGTACCC ATAGAATAGA GTTCCTTTTG TTAGGGAGCG GGTGGGAACC AAAAAAAAAA 48988 .......... .......... .......... .......... .......... .......... 541 GTGGAACAAA GGGAGTACTA AAGTATACTT ATGGAAGTTA ATATAAAATC TGAAGATAAG 49048 .......... .......... .......... .......... .......... .......... 541 CGTTAAAAAC ATACCTAAAC TATCCTTTTT TTTTTAGTTT CATACTTGAA GTATTGAGTG 49108 .......... .......... .......... .......... .......... .......... 541 TGAGTTTTCT ACCTAAACTA TCACTTATTA ATTTGAGAAA CACATCTTTC TTTTATTATA 49168 .......... .......... .......... .......... .......... .......... 541 CTCTATCATG GTGTGTAATA CACTCCTTTT ATTTAAAAAT TGTTATATTA CAATCCACAT 49228 .......... .......... .......... .......... .......... .......... 541 GGACAAAACG TTTCACCTTG ACAAAAAATA AATAATTAGT ATTAGTTAAA GTTAAGTATT 49288 .......... .......... .......... .......... .......... .......... 541 AAAGTATTGC TATCCCCCCC CCCTCCCCCA AAAAAAAAAT TATAAAATAA AATGTAAAAT 49348 .......... .......... .......... .......... .......... .......... 541 ATTTTTTTTA CCCAACTCCA ATCTTTCCTC TCAACGTACT CCCCCATCCC AAATTTTTAG 49408 .......... .......... .......... .......... .......... .......... 541 TTTATTTTGT TCAAAAAAAA TAAATCCCTT CGAATAATAA TTTAGATATA GTTAAATTTA 49468 .......... .......... .......... .......... .......... .......... 541 TTTTATTTCT TGAAAAAAAA TTCTACCCTA ACATAACTCC CCTCTTCCAT TTTTTTTCTC 49528 .......... .......... .......... .......... .......... .......... 541 GTTTTGTATT AGATATGTAT TTTCTTTTCT AAAAAAGTAT TTTTTAACTT GCCGCAAGAC 49588 .......... .......... .......... .......... .......... .......... 541 TTTTCATAAA ATAAAACTTT TATTTCTGTT AATTTGGTAT GCAAGTAGAA AAGAATGTTT 49648 .......... .......... .......... .......... .......... .......... 541 TCCTAAAAAT ATATGTACAC ATCTAACACA AAACTAGAAA AATGTATAAA ATTAAATTAG 49708 .......... .......... .......... .......... .......... .......... 541 GAGCGGAGGG TTAGATGGGG TGGGGTAGAA TATTATTTTA TTTTACTTTT TTTTTAAAAA 49768 .......... .......... .......... .......... .......... .......... 541 ATAATATCAA AATTATTTTT AGGAAGGAGT GGGGGAGGGG GTGACGCCTA AATTTCAAAA 49828 .......... .......... .......... .......... .......... .......... 541 AATAATTTTA GAAATAATAG GACGTGGGGT TGTCCGGGGA TGAGGGTTGA GATGATGGAG 49888 .......... .......... .......... .......... .......... .......... 541 TGGGGTAAGA AATATTTTAA TTTTTTAAAA AATGGTAATA CTTTAATCTT TAGTTTTTAG 49948 .......... .......... .......... .......... .......... .......... 541 CTAATATTAA TAGTTTTTTA ATTTTTGTCA AGTTGGAATA ATTTATCCAT GTGCAATGCC 50008 .......... .......... .......... .......... .......... .......... 541 ATGAGGCAAG GTTTTTGCAA ATAAATGAGA AAAGTGTATT AGACACCACT GAGGTGTGTT 50068 .......... .......... .......... .......... .......... .......... 541 TTTCAAACTA ATAAGTGATA GTTTAGGTAT GAAAATTCAA AAAAAAAAAA GAAAAGAAAT 50128 .......... .......... .......... .......... .......... .......... 541 AGTTTAGGTG TGTTTTGACA CTTATGTCTA ATCTGAAAGA TATTATTAGT TGTACAAGTG 50188 .......... .......... .......... .......... .......... .......... 541 TGAAAAAACA CCCCAGGATG TTCCCAAGTG AACAAATAGA AAGTGGGGTC GAAATGGGAA 50248 .......... .......... .......... .......... .......... .......... 541 ATATACCATC AGTTGTCAAT GAAGTTGAAA TAAAATCATG AGAGAGTTCC AATCCTAGTA 50308 .......... .......... .......... .......... .......... .......... 541 GAAGCAAAAA GAAATTAGCC GATTTCTTCC AATATGTCTT AAGTTTCAGC TGTCAAGATT 50368 .......... .......... .......... .......... .......... .......... 541 ACTGCCTGGT ACCTTTGGGT GGAGGATACA TGCACCTAGT GGAATAGTCA AGATACATGC 50428 .......... .......... .......... .......... .......... .......... 541 ATGTTGGGTT GAAGGCACCT TAGTCTTATA GAATTGTCAA ATCAGAATAT TTAGTATGAT 50488 .......... .......... .......... .......... .......... .......... 541 GTATCATGTG TTCTTGAACA CTCGTAGAAC TAATTCTGTT TTCCAACCAT TAGTTGACTC 50548 .......... .......... .......... .......... .......... .......... 541 TATCAAAAGA ATATCAAGTT GAAGCTAGTT GAGATGTAGG TAGAATATCT ATTAACCAAC 50608 .......... .......... .......... .......... .......... .......... 541 TTATCTCCAT GTAGTTCTAT TCAGTTCCAT TTCATCCAAT ATTGTATAAT TTACCTTAAA 50668 .......... .......... .......... .......... .......... .......... 541 ACTACAAGTC CGATGTGTTC CACACTTTCA GGAATATAAA AGTCTAACAC TGTGCCTATT 50728 .......... .......... .......... .......... .......... .......... 541 ATCAGCTAAC AAGTAACAAC TCTCTATTTC AAATAGCTGG CATTGCCTAC ATGGATCATT 50788 .......... .......... .......... .......... .......... .......... 541 TACTTTTGTT AGGTTACGGT CTTAGTTAAG TTCTACCAGA GATATTGCAC GTCCTTTAGG 50848 .......... .......... .......... .......... .......... .......... 541 ATAACTCATC TCCTTGTGAT TTTAGGTGTA CTTTGCTTAT TTGAAATGAT GCAAGGTTTT 50908 .......... .......... .......... .......... .......... .......... 541 ATTACTTTTT TTTTCTAAGA GATTTTCATT GTATATGTAT CCACCAAAAG AATAATACGA 50968 .......... .......... .......... .......... .......... .......... 541 AGAAAAAAAA TGAGAGAGGA AGAAACAGAT CTGCTTCCAA GTTGTGACAT AATTTTATCG 51028 .......... .......... .......... .......... .......... .......... 541 AAAAGAAAAA GAATATTCAG AGGCCCAGGT GCCACTGAGT TAACTCGCCA TTCTTCTCTT 51088 .......... .......... .......... .......... .......... .......... 541 CTTTAGACAA GCCTGATAAG GAAAGCTGAT TCTTAACAAT GTGTTGGGCA TCAAAGGTTT 51148 .......... .......... .......... .......... .......... .......... 541 TCTTTTGTTC TCCTTCAAAA TGCACATAGG TAAGGTACTT ATTCATAGTA CAATTATTTG 51208 .......... .......... .......... .......... .......... .......... 541 GCATATATTG TAGTTACACA CGTGCTTGTG TACTTGTTCT ACTAAAATGT TGTTATGACT 51268 .......... .......... .......... .......... .......... .......... 541 TTGTAAGCTA GGTTAAATAT CACAGAACAT GGTGCATCTT TCATTTGGAG CATGAACTTG 51328 .......... .......... .......... .......... .......... .......... 541 TGTTTCACTC TTGGTCAAGT TATGTGTAAA AGGTATTCTG ACATTCATGT CAGCTAGTTT 51388 .......... .......... .......... .......... .......... .......... 541 GCAGGTTTTT ACAGATAATA GAGCAGAGGC AATGAAACTG CCGTAACAAT GTCTGGTACT 51448 |||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ....GTTTTT ACAGATAATA GAGCAGAGGC AATGAAACTG CCGTAACAAT GTCTGGTACT 597 CTTTTCTAAA AGTAGTATGC CATGCTCTCA AGTATAACTA GAAGTGCTTG TAGACTGTGC 51508 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTTTTCTAAA AGTAGTATGC CATGCTCTCA AGTATAACTA GAAGTGCTTG TAGACTGTGC 657 CTCAACAAAA TGTGAAATCT CTGTCGTGTG TGAAATCATT TCAGCTACCT AGTGTTCTTT 51568 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCAACAAAA TGTGAAATCT CTGTCGTGTG TGAAATCATT TCAGCTACCT AGTGTTCTTT 717 AGTTGAGGCT TCATGCTTGC TTCAGTTAGA AGGTGGTTCA CCTTGAGGTG TATCCTTGTC 51628 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTTGAGGCT TCATGCTTGC TTCAGTTAGA AGGTGGTTCA CCTTGAGGTG TATCCTTGTC 777 AATTACATAA TTATGTATTT TACCCATTGG TTTTTCTCTA TCGGGAGATT GTTTTTAAGG 51688 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATTACATAA TTATGTATTT TACCCATTGG TTTTTCTCTA TCGGGAGATT GTTTTTAAGG 837 AAAAGAA 51695 |||| || AAAAAAA 844 hqPGS_C01HBa0088L02.1+_SGN-E542636- (41729 41896,42406 42630,45016 45159,51393 51695) ******************************************************************************** EST sequence 117 -strand 747 n (File: SGN-E547310-) 1 GAGAAAATAT GGCTCTACCT TAAAGGATAC GGAGATACGG GAACTTATGG ATGCGGCTGA 61 TGTGGCCAAT AGTGGAACTA TTGACTATGG AGAATTCATT GCGGCAACTG TTCATCTTAA 121 TAAATTGGAG CGCGAGGAAC ATCTCATGGC AGCATTTCAA TATTTTGACA AGGATGGAAG 181 TGGTTACATA ACAGTTGATG AGGTCCAGCA AGCTTGTATA GAGCATAACA TGACAGATGT 241 TTACTTTGAG GATATTATAA GAGAAGTCGA TCAGGATAAT GATGGACGAA TTGATTATGG 301 AGAATTTGTT GCTATGATGC AAAAAGGAAA TCCATGTATA GGGAGACGAA CAATGCGAAA 361 TAGTCTGAAT TTGAGCATGA GAGATGCACC GGGAGCTCAG TAGTAGCTTC TCAGACAGAC 421 ATCTCTAGTA GGTTGTACAG AAAAGAGGCC AGGGCAATAG ACTTTCATCC AGTACCTTCG 481 AGTTTGCTAG AAGAGGATGA GTGAAAGACC CTATCGGACA GCTCTATGCT TCCACGATTT 541 GTTGTGAGCT TTATATTTAG TTTTTAGTGT TGAAAATGTT CCCACTAATG TGTTCAAATT 601 AGTTGTGTTC TTTAGTCGAG GCTTCCTTCT TGTTTCAAAT TGTTAATTTA TGTTGTTTTA 661 TCATATGATG TTTTATTCCA TGAATGATTC TTCGCTTTTC TACTCCATGA TAATTTATGC 721 TATTTATTTT TATGCTAAAA AAAAAAA Predicted gene structure (within gDNA segment 41232 to 49457): Exon 1 41842 41896 ( 55 n); cDNA 1 55 ( 55 n); score: 0.909 Intron 1 41897 42405 ( 509 n); Pd: 0.985 (s: 0.90), Pa: 0.999 (s: 0.94) Exon 2 42406 42630 ( 225 n); cDNA 56 280 ( 225 n); score: 0.893 Intron 2 42631 45015 (2385 n); Pd: 0.956 (s: 0.88), Pa: 0.995 (s: 0.98) Exon 3 45016 45159 ( 144 n); cDNA 281 422 ( 142 n); score: 0.868 Intron 3 45160 45325 ( 166 n); Pd: 0.994 (s: 0.70), Pa: 0.628 (s: 0) Exon 4 45326 45332 ( 7 n); cDNA 423 429 ( 7 n); score: 0.571 Intron 4 45333 48567 (3235 n); Pd: 0.000 (s: 0), Pa: 0.888 (s: 0) Exon 5 48568 48579 ( 12 n); cDNA 430 441 ( 12 n); score: 0.667 PPA cDNA 737 747 MATCH C01HBa0088L02.1+ SGN-E547310- 0.887 443 0.593 C PGS_C01HBa0088L02.1+_SGN-E547310- (41842 41896,42406 42630,45016 45159,45326 45332,48568 48579) Alignment (genomic DNA sequence = upper lines): GAGAAAATAT GGCTCTACTC TGAAGGATAT AGAGATACGG GAACTTATGG ATGCGGTAAG 41901 |||||||||| |||||||| | ||||||| ||||||||| |||||||||| ||||| GAGAAAATAT GGCTCTACCT TAAAGGATAC GGAGATACGG GAACTTATGG ATGCG..... 55 AAAATCTAGA CTGCAAACTG ATTCTGTTTA TTTTGTGCAT CTGGTGATGT GACTCTACAC 41961 .......... .......... .......... .......... .......... .......... 55 AAAGGTTCAT AGGAGCAGAA AAATGTAAAA TGACATAAGA TCACTAACTA ATGGTCAAAT 42021 .......... .......... .......... .......... .......... .......... 55 CTCAAGGTTA TTTGATGTGC AAATACTAGA GTCAGATTGG GATTTGGCAC TTTACTTTGT 42081 .......... .......... .......... .......... .......... .......... 55 TTAATTAATT ATGTACATTC ATGAAGGAGC ACTTAAAACT CAATGTAGTT GCTAAAACTT 42141 .......... .......... .......... .......... .......... .......... 55 CACTGGAAAG GTGCCCAATT TTTTTTTTTT GTGTATGTGT ATGATAAGTT TCTGATAACT 42201 .......... .......... .......... .......... .......... .......... 55 GAGGAGGTAG TGCAGGCTTA CCAAGTAGTT GGCACCACAT ATATGCTTCA TCAGAAACAA 42261 .......... .......... .......... .......... .......... .......... 55 CTTTCTGTTA ATGGTTCTAG TTGTATCTTT AATTAGGCCC GTGATAATCT TTGTATTTCT 42321 .......... .......... .......... .......... .......... .......... 55 CCCTAAACAT GTCTGTCTAT GAGGTACATG CGGAAGTGCT TATCTAACTC TTTAAGGCCA 42381 .......... .......... .......... .......... .......... .......... 55 TTGATGTAAT ATTACTGTTT TCAGGCTGAT GTGGACAATA GTGGAACTAT TGACTATGGA 42441 |||||| |||| ||||| |||||||||| |||||||||| .......... .......... ....GCTGAT GTGGCCAATA GTGGAACTAT TGACTATGGA 91 GAATTCATAG CAGCAACAAT TCACCTTAAC AAATTGGACC GCGAGGAACA TCTCATGGCA 42501 |||||||| | | ||||| | ||| ||||| |||||||| | |||||||||| |||||||||| GAATTCATTG CGGCAACTGT TCATCTTAAT AAATTGGAGC GCGAGGAACA TCTCATGGCA 151 GCATTTCAGT ATTTTGACAA GGATGGAAGT GGTTATATTA CAGTAGATGA GCTCCAGCAG 42561 |||||||| | |||||||||| |||||||||| ||||| || | |||| ||||| | ||||||| GCATTTCAAT ATTTTGACAA GGATGGAAGT GGTTACATAA CAGTTGATGA GGTCCAGCAA 211 GCCTGTGCAG ATCATAACAT TACAGATGTA TTCTTTGAGG ATATTATCAG AGAAGTTGAT 42621 || ||| || | |||||||| |||||||| | |||||||| ||||||| || |||||| ||| GCTTGTATAG AGCATAACAT GACAGATGTT TACTTTGAGG ATATTATAAG AGAAGTCGAT 271 CAGGATAACG TAAGTTAATT ATATTGAGGA TAAAGTTGAA GTATTATTGG AACTTATCAA 42681 |||||||| CAGGATAAT. .......... .......... .......... .......... .......... 280 TAAAAAAGTG GACACAAATT AGTAGATTAA ATTTCTTCAT GTTTTGCAGT TCTACTGATT 42741 .......... .......... .......... .......... .......... .......... 280 TATCTCTCTA CTACTCATAA TTTTTTTGCA ACAAAAACTA TTTTTTTTTA TAAAAAAGCA 42801 .......... .......... .......... .......... .......... .......... 280 CTTTAATATG AAACACTTTT TGTGCAACAA AAACGAAAAT TAAAAAAATA TAGCACTTTA 42861 .......... .......... .......... .......... .......... .......... 280 AGATTTCATA TGAATCTTTT CCTTGAGATA AAATGTTATT GACAATGTAG TGTATGTATG 42921 .......... .......... .......... .......... .......... .......... 280 GAAAATACGG ATATTACTAA ATGATCATAT GTGAGCTTAA TAATATAGTT AATTTACCTC 42981 .......... .......... .......... .......... .......... .......... 280 TCTCTCTCTA TATATATAAA GAGAACCCTA GGCTGCCTAA GTGGCGCCAC CACAAATCAG 43041 .......... .......... .......... .......... .......... .......... 280 GATTCCCTTT TAATTTATTT ATTTCCAAAA TTAGCCTTCC CTTTCATCAA AAGTTGTGAC 43101 .......... .......... .......... .......... .......... .......... 280 TTATGAAACT TTGCGACTTT TACAAAGAGT TGTAACTTTT ATGAAAGTTG TAACTTTTAT 43161 .......... .......... .......... .......... .......... .......... 280 GAAAGTTGTA ACTTTTATGT AGAGTTGTGA CTTTTCCAAA GGATTATTAC ATTTCCGATA 43221 .......... .......... .......... .......... .......... .......... 280 AGACACCATA ACCATTTATT CACACTATCC TTTTGTTGTC TATAAATAGA GGAATTTTCT 43281 .......... .......... .......... .......... .......... .......... 280 TTCATTTTAA AACGACGAAA ATTCTAAATT TTTTCTTCTG CTTATGCACA ATTAAATATT 43341 .......... .......... .......... .......... .......... .......... 280 TGTGTACTTT GCTCCTGTTG AGTGGTTCAC TGACATCATT GTTTTTGAAT CTATACAACG 43401 .......... .......... .......... .......... .......... .......... 280 GTGAATATAA TCGTTCTATC CTAAAAGTAT CTATTCATTC TTTTGTTACA AATCTTGGTA 43461 .......... .......... .......... .......... .......... .......... 280 TGTTTTTTAC GCTCATTTAT GCTTATGTTA TTAGTTGTTT TTGAGTACAT GTTTTAAACT 43521 .......... .......... .......... .......... .......... .......... 280 TTGTTGTTTA TGTTTATGTT TATGTTGAAA TAAAGATATG TTAATCAAGA ATTTGATGTA 43581 .......... .......... .......... .......... .......... .......... 280 GTGATGTCAT GTAGATTAAA ATTCTTGAAC TTATAAAATA AATGACTTTG ATCTTTATAG 43641 .......... .......... .......... .......... .......... .......... 280 AGTTTTAGTG GCTAAAAGAT TCATGGGATG TTCAAGAAGA AACTTTTGAG TGTTCAAAAG 43701 .......... .......... .......... .......... .......... .......... 280 TTATGGTGGT TCTACTCTAC CATGGAGTTT AGTTATTCAA CTTTCTATCT TATCTAGACA 43761 .......... .......... .......... .......... .......... .......... 280 TTCAATCGAT TAGTGACATT CAAAAAATAA AGGAAAATGT AGCGGGATGG TAAGTATTAT 43821 .......... .......... .......... .......... .......... .......... 280 ACTCAACCTT AATTAAAAGT TTGGGATTCA AATATTTGAT TGGAGTCAAT GAATTACCCC 43881 .......... .......... .......... .......... .......... .......... 280 CTTAGGATGA ATCTACATTA ATCAATTATT AAAGAAATAA TTATCTCCTT ATAAACATTA 43941 .......... .......... .......... .......... .......... .......... 280 GATTAAAAGT TGCAAAAAGA TTAAAGCTTT AACCATATTG ATCGGAACAT AAACAACAAA 44001 .......... .......... .......... .......... .......... .......... 280 ATATGCATTT TGGGTATCAA AGTAGTGTCA TACATAATGA TTTGAATAAG GGTCTTGCCA 44061 .......... .......... .......... .......... .......... .......... 280 AGACATCATT TAATCCGAAT TATTTGAGTG ACTTGCCTTA TTTCATTGAA ATTCCAAGAG 44121 .......... .......... .......... .......... .......... .......... 280 ATGTTTTTTA AAATTTTAAT TAACTTATCA AGCACACAAC TAATTATATA AAATGTATAA 44181 .......... .......... .......... .......... .......... .......... 280 TATTTAGATT TTGTATGTAG AGGGAGGCCT TGAATAAGAG AAGAACTCTC GCAATTGATG 44241 .......... .......... .......... .......... .......... .......... 280 AATAAAATGT TTGTACCACT TTTGGAAAAT ACAAATATAG ACAATGAAAC AATTACCTAT 44301 .......... .......... .......... .......... .......... .......... 280 CTTTTCTAAA GATTTGGTGA TGAATAACTA CAGTAAAATG AAGAATCAAT AACTAAATCC 44361 .......... .......... .......... .......... .......... .......... 280 ATAAACACGT AGAATCAAAT CGTTTTAAGT TTAAAAAAAT ATTTTATTTT GTCTTTGGAT 44421 .......... .......... .......... .......... .......... .......... 280 AAAATATTCT TGACAATTTA TTGTTGGGTT GTACCCATTC GAAAACACTT ATATTATCAA 44481 .......... .......... .......... .......... .......... .......... 280 ATGTTCAGAA GTAGATTATT ACCGTAGTTT ACCACCGCGC GAAAAGCATG CAATTTACCT 44541 .......... .......... .......... .......... .......... .......... 280 TGTTAAATTA CAAGTGCTCA GATGCAATGA TATGCTTTGA AAATTATTTT TGAAGAACTT 44601 .......... .......... .......... .......... .......... .......... 280 CTCGTAGTTC TGTTTGGTCT GACTGCATTC GTGCCAGCTA CTCACTTTTT GGCGTCACTT 44661 .......... .......... .......... .......... .......... .......... 280 CATAATCTAA GTAGTTTTGT GTATTCAAAG GCATAATGAG AAGACAAAGC TGACATAATT 44721 .......... .......... .......... .......... .......... .......... 280 GTCCAAAGAA AAGAAAAAAG ACAAAGAAAT TGTAGCATAA TAAACAGGAA TGGGTACCGT 44781 .......... .......... .......... .......... .......... .......... 280 TACAGACATT TCTGTCTTTC TTCAAATCAA ACAAAATTTG TTGTATTTTG ATTAGTTTTC 44841 .......... .......... .......... .......... .......... .......... 280 TGGAGCCTCA GTATTGGATT AGGGCCTCAG CTGCAGCCGT GATACAGGCA AATTGTTATG 44901 .......... .......... .......... .......... .......... .......... 280 CTTTAGGAGA TCTGTATTTT AAATGGATGG AATGATTCTT TTGGAATCTC TACATCTCTT 44961 .......... .......... .......... .......... .......... .......... 280 GATGCTTCAT TTGACTAGCT ATTTAGTTGA TCTTCTGGTG GATTCCCTTT TCAGGATGGA 45021 |||||| .......... .......... .......... .......... .......... ....GATGGA 286 CGTATTGATT ATGGAGAATT TGTTGCTATG ATGCAAAAAG GAAATCCATG CATAGGAAGA 45081 || ||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||| ||| CGAATTGATT ATGGAGAATT TGTTGCTATG ATGCAAAAAG GAAATCCATG TATAGGGAGA 346 CGAACAATGC GAAATAGTCT GAATTTCAGC ATGAGAGATG CGCCCGGAGC TCATTAGCTT 45141 |||||||||| |||||||||| |||||| ||| |||||||||| | || ||||| ||| ||| | CGAACAATGC GAAATAGTCT GAATTTGAGC ATGAGAGATG CACCGGGAGC TCAGTAG-TA 405 TTTGAATGGA CACATGATGT AGGTATTTCC CCTTTTTTAT TTTTGTAACC GTTTCTTTGG 45201 | || || | || GCTTCTCAGA CAGA-CAT.. .......... .......... .......... .......... 422 CAATGAATTT GAAGAAATCT TTCCTTGTTC TGTCCTTGAG AAATTGGATT GGTTGGAGTA 45261 .......... .......... .......... .......... .......... .......... 422 TATTTGTTTA ACATTAAGAG TTTCTTTTTC CCTCTTGAGG ATAATAAAAT TTTATAAATA 45321 .......... .......... .......... .......... .......... .......... 422 ACAGCATGAG TGTTTGCTGT AAAACTCTAC AGGTGCAGCA AAAAAAATTA CATTCAGCAA 45381 | || | ....CTCTAG T......... .......... .......... .......... .......... 429 AAGTATATCC CATCTTATCC TGTTGGTACA CTAGCATGTC ACAGATAGAT TCAGCTTCCT 45441 .......... .......... .......... .......... .......... .......... 429 CCCCAATCCT CCATTTTACA CCATTAACAA AAATAAATTT CAGATACAGA GTTCTCTTTC 45501 .......... .......... .......... .......... .......... .......... 429 ATTCCCATCT TTTATATAAT GCTGGTTTCT TTTCTTTTGG TAAAATTTTG ATGTATCAAA 45561 .......... .......... .......... .......... .......... .......... 429 TTTGACGATT GTCCGACATG GCTATGTGAG GAACTTTCCT AAGGGAGCAC TAAGGGTGTC 45621 .......... .......... .......... .......... .......... .......... 429 AAATGTGTGG GTGGAGGCAG TGGGGGACTG AAATTGAAGA GGTTAAAATG GGCTGAGCTA 45681 .......... .......... .......... .......... .......... .......... 429 AAAGTCATGT TGGATCATAA CCCACTCAAA CTTACTTTGG GCTAACATGG GCTAGAATCT 45741 .......... .......... .......... .......... .......... .......... 429 TGATTGGGTT ATGACCTATC CAATTTGACC TGCTTAATCT AAACTAAACT ATATTAAACA 45801 .......... .......... .......... .......... .......... .......... 429 CTTGCTATAA TTTATGACAG ATGTCATTCA ACCCATAGAA TCGTACAGAT CTGTACTAAC 45861 .......... .......... .......... .......... .......... .......... 429 TTTTCATTTA GGAGCATCTC CTTGTAGAGT AAATTGATGT AGACTTTATA GTATGGGACC 45921 .......... .......... .......... .......... .......... .......... 429 AACTTCATAA TTTTGCAACT CATTTAATAG TGTATTTATG AGAATTATTG AAAAGAATAT 45981 .......... .......... .......... .......... .......... .......... 429 TATTGAATTG TGTGTCTACA TTATTACATT GAGACTTTAT TTATAGACAC TATATTATAC 46041 .......... .......... .......... .......... .......... .......... 429 TCCTTTTCCA ACTAGGACAC TACAATACCA TCCTTTTCTA AGTAGGATTC TATATACTAT 46101 .......... .......... .......... .......... .......... .......... 429 TTCTATTCCT ATTCCTATTC TAAGTAGAAT GGTATATATT ATTCTTGTTC CTTTTTTGAT 46161 .......... .......... .......... .......... .......... .......... 429 TCTAACACTC CCCCTCAAGC TGGTGCATAC AAGTTATATA TACTTTGCTT GTTACAAATG 46221 .......... .......... .......... .......... .......... .......... 429 TAATTAATAT GAGGACCAAT GAGAGGCTTG ATGAAGATAT CTGCAAGTTG ATCACTTGAC 46281 .......... .......... .......... .......... .......... .......... 429 TCACAAATTT TGTAACAATA TCTCCCGACT TCCCAGACCA AGCTTGAGAA GAACGTTTCA 46341 .......... .......... .......... .......... .......... .......... 429 TATCATCGAG TGACTTGCAC AATCAACATA TAAGGCTGCT AGACTCCCTC GGAGCAATAA 46401 .......... .......... .......... .......... .......... .......... 429 GACCAAGTGG TTGCTCCATA TATACTTCTC CATCGAGATC CCAGCCCAAA TATGTAAGTA 46461 .......... .......... .......... .......... .......... .......... 429 TATCCTTTTG GATAAAGTGA ATCTAAAACA AAGAGAATAT TGCTTGAAAA CTTGGATTTT 46521 .......... .......... .......... .......... .......... .......... 429 TTTGGGAACT CGGATATGTT GGACTTTGCA CAACATTGAC AAAGTTGAAA CTATTTAAAT 46581 .......... .......... .......... .......... .......... .......... 429 CAGACCTAAG GAGTCACCGA AAAGACGTAC GGTGCTTCGA AAATTAGATA TGAGAAAGTA 46641 .......... .......... .......... .......... .......... .......... 429 GTCACCAAAA AGACGCATGA TGTTGTGCAA ATTAGATATG AGAAAGTAGT CACCAAGAAG 46701 .......... .......... .......... .......... .......... .......... 429 ATGAGACAGT GCTACATAAA TTAAATATGA AAAAGTAGTC ACTGATAAGA TGGCACGGTG 46761 .......... .......... .......... .......... .......... .......... 429 CTACACAAAT TAAATATGAA AAAGTAGTCA TCAAAAAGAT GGTGCGATGC TACACAAAAG 46821 .......... .......... .......... .......... .......... .......... 429 TAAATAGTCA CCGGAATGAT GACATGATGC TACAAAAATG AAATATGAGA GTAGTCACCT 46881 .......... .......... .......... .......... .......... .......... 429 GAAGGATGAC ACAGTGCCAC ATAAATTGAA CATAAAAAAA TAGTCACCAG AAACATGATG 46941 .......... .......... .......... .......... .......... .......... 429 CGGTGCTACA CAAATTAAGA GCCTGTTTGG CTCAGCTTAA AAGCTGGTCA AACTGACTTA 47001 .......... .......... .......... .......... .......... .......... 429 AAATCTGATT TTTGACTTAT TTAACTGTTT GACAATACTC AAAATAGCTT ATTTTAAGTT 47061 .......... .......... .......... .......... .......... .......... 429 AAAAAAAACT TATTTTAAGC CAAAAGTTAA AAGGTGGGGT AGGGGTGCTT TTTTTTTTTA 47121 .......... .......... .......... .......... .......... .......... 429 GCTTATAAGC TGTTTTAAGT TGACCATATT TTTATGTTTT TTCCCTTAAT ATTTTTATAC 47181 .......... .......... .......... .......... .......... .......... 429 AATCTCCAAA TTATCCATAT AACCCTAACA TCTCTTTCTT CTATTTTTCC CTTTTCACGT 47241 .......... .......... .......... .......... .......... .......... 429 TTGGCATAAC AACTTCAGCA CTTTTATCCA AACGCATAAC TGCTTATTTT AAAAATAAGT 47301 .......... .......... .......... .......... .......... .......... 429 TTCAGCACTT TCAAAAGTAC TTTTTTAAAG CTGCTTTTAT TAAGCCCATC CAAACGGGCT 47361 .......... .......... .......... .......... .......... .......... 429 CTAAATATAT AAATAATAGT CACCGGAAGA TGACACACTG CTACAAATCA AATTTAAGAA 47421 .......... .......... .......... .......... .......... .......... 429 AGTAGTCACC GAAATGATAG CACAGTGCCA CACAAATTAG ATATGAGAAA GTAGTCGCCA 47481 .......... .......... .......... .......... .......... .......... 429 TGACAACCCT AGAAAGTCGT GCATATATCA GTGACCCTAA TTTGGTTAAC ATTACCAATG 47541 .......... .......... .......... .......... .......... .......... 429 GCAAGAGGGG AGATAGATAT GAGTCATAGC CGCCCTACAC CGACGAAATC TTTTTTTGAT 47601 .......... .......... .......... .......... .......... .......... 429 TTTCTACCGA GATCGTAGGA GCTTTGATAC CATGTGGAAA TATTGAAAAA GAACATTGTT 47661 .......... .......... .......... .......... .......... .......... 429 GAATTGGTCT CTAGATTATA ACATCGAGAC CTATTAATAG GGCACTACCT TAGACTCAAA 47721 .......... .......... .......... .......... .......... .......... 429 TTCCAACTAG GACACTACCA TACAATCCTA TTCTAAGTAG TATTTTATGT ACTATTTTTA 47781 .......... .......... .......... .......... .......... .......... 429 TTCCTATTAC TAGTATTTTA TGTACTATTT TTATTCCTGT TACTATTCTA AGTATGATGG 47841 .......... .......... .......... .......... .......... .......... 429 TATATATTAT TCTTGTTCAT ATTCCTATTC AAACAGTAAT AATTTGACAT ATAGAATGTA 47901 .......... .......... .......... .......... .......... .......... 429 GGCAATTATT TTTTAATATG ACATGGCATG CAAAATAATG TGTTGTTAAA GAATCAAATA 47961 .......... .......... .......... .......... .......... .......... 429 ACAATAATCA AGTGACTTTA GAATTCCAAA AGAGAGACCA TGATAGATCA TTATCATATT 48021 .......... .......... .......... .......... .......... .......... 429 AGGTAATAAA AAATAAGGAT TCGGTAACAA AATGCAAGAA GGTGAAATGA ATTTTTAAGA 48081 .......... .......... .......... .......... .......... .......... 429 TATTTCAGTT TGCCAAAAAT AAGCATATTA GGTTAGTATA TGAGGAAAAA AAACAGTTTT 48141 .......... .......... .......... .......... .......... .......... 429 ATTCGAATTG GTTAAACTCA GTTCTCATTT TCATATCAAG TGAAAAGGTC AATATAAACT 48201 .......... .......... .......... .......... .......... .......... 429 AAAGAGATGA TGATTGTCCC ATCTTTGCAC ATGTAGTCCG GTTAGAATGG GGATTGAATT 48261 .......... .......... .......... .......... .......... .......... 429 GACATAGAAC TTGGGCTAAG TGGGTTATAA TTATACGGGT TAAGACGTAG CACATTATTA 48321 .......... .......... .......... .......... .......... .......... 429 AATTATCATG AGCTCAACCC ATAAATTTTG GGCTCCTAAT ATCTGAGCTT CATTTGACAC 48381 .......... .......... .......... .......... .......... .......... 429 CCCAAGTAAG GAGTGCCACG CACGAGCATG GCAAAAAGCA AGGGGAACTT TTCTTTTTGG 48441 .......... .......... .......... .......... .......... .......... 429 GAGAAATCAT TTGATTGCAT ATTGAATACA TAAAGCACAT TCCAACAAAT TCAAATTTTA 48501 .......... .......... .......... .......... .......... .......... 429 GAAGTTTCAT ATGGTGACTA CATTTTAGCT TCCCGTCAAT TACCCCAACC TTCTTCATTT 48561 .......... .......... .......... .......... .......... .......... 429 ATCCAGATGT GGGACGGA 48579 | || | || || ......AGGT TGTACAGA 441 hqPGS_C01HBa0088L02.1+_SGN-E547310- (41842 41896,42406 42630,45016 45159) ******************************************************************************** EST sequence 85 +strand 708 n (File: SGN-E356631+) 1 GCTGATGTGG ACAATAGTGG AACTATTGAC TATGGAGAAT TCATTGCGGC AACTGTTCAT 61 CTTAATAAAT TGGAGCGCGA GGAACATCTC ATGGCAGCAT TTCAATATTT TGACAAGGAT 121 GGAAGTGGTT ACATAACAGT TGATGAGGTC CAGCAAGCTT GTATAGAGCA TAACATGACA 181 GATGTTTACT TTGAGGATAT TATAAGAGAA GTCGATCAGG ATAATGATGG ACGAATTGAT 241 TATGGAGAAT TTGTTGCTAT GATGCAAAAA GGAAATCCGT GTATAGGGAG ACGAACAATG 301 CGAAATAGTC TGAATTTGAG CATGAGAGAT GCATCAGGAG CTCAGTAGTA GCTTCTCAGA 361 CAGACATCTC TACTAGGTTG TACAGAAAAG AGGCCAGGGC AATAGACTTT CATCCAGTAA 421 CATCCAGTAC CTTCGAGTTT GCTAGAAGAG GATGAGTGAA AGACCCTATC GGACAGCTCT 481 ATGCTTCCAC GATTTGTTGT GAGCTTTATA TTTAGTTTTT AGTGTTGAAA ATATTCCCAC 541 TAATGTGTTC AAATTAGTCT TGTTCTTTAG AGAAAGGCTT CCTCGTTTCA AATTGTTAAA 601 TTATGTTGTT TTATCATATG ATGTTTTATT CCATGAATGA TGCTTCACTT TTCTACTCAT 661 GATAATTTAT GCTNATTTAT TTTATGCTTG GNTATAGTAA AAAAAAAA Predicted gene structure (within gDNA segment 41806 to 49627): Exon 1 42406 42630 ( 225 n); cDNA 1 225 ( 225 n); score: 0.898 Intron 1 42631 45015 (2385 n); Pd: 0.956 (s: 0.88), Pa: 0.995 (s: 0.98) Exon 2 45016 45153 ( 138 n); cDNA 226 362 ( 137 n); score: 0.870 PPA cDNA 699 708 MATCH C01HBa0088L02.1+ SGN-E356631+ 0.887 363 0.513 C PGS_C01HBa0088L02.1+_SGN-E356631+ (42406 42630,45016 45153) Alignment (genomic DNA sequence = upper lines): GCTGATGTGG ACAATAGTGG AACTATTGAC TATGGAGAAT TCATAGCAGC AACAATTCAC 42465 |||||||||| |||||||||| |||||||||| |||||||||| |||| || || ||| |||| GCTGATGTGG ACAATAGTGG AACTATTGAC TATGGAGAAT TCATTGCGGC AACTGTTCAT 60 CTTAACAAAT TGGACCGCGA GGAACATCTC ATGGCAGCAT TTCAGTATTT TGACAAGGAT 42525 ||||| |||| |||| ||||| |||||||||| |||||||||| |||| ||||| |||||||||| CTTAATAAAT TGGAGCGCGA GGAACATCTC ATGGCAGCAT TTCAATATTT TGACAAGGAT 120 GGAAGTGGTT ATATTACAGT AGATGAGCTC CAGCAGGCCT GTGCAGATCA TAACATTACA 42585 |||||||||| | || ||||| |||||| || ||||| || | || ||| || |||||| ||| GGAAGTGGTT ACATAACAGT TGATGAGGTC CAGCAAGCTT GTATAGAGCA TAACATGACA 180 GATGTATTCT TTGAGGATAT TATCAGAGAA GTTGATCAGG ATAACGTAAG TTAATTATAT 42645 ||||| | || |||||||||| ||| |||||| || ||||||| |||| GATGTTTACT TTGAGGATAT TATAAGAGAA GTCGATCAGG ATAAT..... .......... 225 TGAGGATAAA GTTGAAGTAT TATTGGAACT TATCAATAAA AAAGTGGACA CAAATTAGTA 42705 .......... .......... .......... .......... .......... .......... 225 GATTAAATTT CTTCATGTTT TGCAGTTCTA CTGATTTATC TCTCTACTAC TCATAATTTT 42765 .......... .......... .......... .......... .......... .......... 225 TTTGCAACAA AAACTATTTT TTTTTATAAA AAAGCACTTT AATATGAAAC ACTTTTTGTG 42825 .......... .......... .......... .......... .......... .......... 225 CAACAAAAAC GAAAATTAAA AAAATATAGC ACTTTAAGAT TTCATATGAA TCTTTTCCTT 42885 .......... .......... .......... .......... .......... .......... 225 GAGATAAAAT GTTATTGACA ATGTAGTGTA TGTATGGAAA ATACGGATAT TACTAAATGA 42945 .......... .......... .......... .......... .......... .......... 225 TCATATGTGA GCTTAATAAT ATAGTTAATT TACCTCTCTC TCTCTATATA TATAAAGAGA 43005 .......... .......... .......... .......... .......... .......... 225 ACCCTAGGCT GCCTAAGTGG CGCCACCACA AATCAGGATT CCCTTTTAAT TTATTTATTT 43065 .......... .......... .......... .......... .......... .......... 225 CCAAAATTAG CCTTCCCTTT CATCAAAAGT TGTGACTTAT GAAACTTTGC GACTTTTACA 43125 .......... .......... .......... .......... .......... .......... 225 AAGAGTTGTA ACTTTTATGA AAGTTGTAAC TTTTATGAAA GTTGTAACTT TTATGTAGAG 43185 .......... .......... .......... .......... .......... .......... 225 TTGTGACTTT TCCAAAGGAT TATTACATTT CCGATAAGAC ACCATAACCA TTTATTCACA 43245 .......... .......... .......... .......... .......... .......... 225 CTATCCTTTT GTTGTCTATA AATAGAGGAA TTTTCTTTCA TTTTAAAACG ACGAAAATTC 43305 .......... .......... .......... .......... .......... .......... 225 TAAATTTTTT CTTCTGCTTA TGCACAATTA AATATTTGTG TACTTTGCTC CTGTTGAGTG 43365 .......... .......... .......... .......... .......... .......... 225 GTTCACTGAC ATCATTGTTT TTGAATCTAT ACAACGGTGA ATATAATCGT TCTATCCTAA 43425 .......... .......... .......... .......... .......... .......... 225 AAGTATCTAT TCATTCTTTT GTTACAAATC TTGGTATGTT TTTTACGCTC ATTTATGCTT 43485 .......... .......... .......... .......... .......... .......... 225 ATGTTATTAG TTGTTTTTGA GTACATGTTT TAAACTTTGT TGTTTATGTT TATGTTTATG 43545 .......... .......... .......... .......... .......... .......... 225 TTGAAATAAA GATATGTTAA TCAAGAATTT GATGTAGTGA TGTCATGTAG ATTAAAATTC 43605 .......... .......... .......... .......... .......... .......... 225 TTGAACTTAT AAAATAAATG ACTTTGATCT TTATAGAGTT TTAGTGGCTA AAAGATTCAT 43665 .......... .......... .......... .......... .......... .......... 225 GGGATGTTCA AGAAGAAACT TTTGAGTGTT CAAAAGTTAT GGTGGTTCTA CTCTACCATG 43725 .......... .......... .......... .......... .......... .......... 225 GAGTTTAGTT ATTCAACTTT CTATCTTATC TAGACATTCA ATCGATTAGT GACATTCAAA 43785 .......... .......... .......... .......... .......... .......... 225 AAATAAAGGA AAATGTAGCG GGATGGTAAG TATTATACTC AACCTTAATT AAAAGTTTGG 43845 .......... .......... .......... .......... .......... .......... 225 GATTCAAATA TTTGATTGGA GTCAATGAAT TACCCCCTTA GGATGAATCT ACATTAATCA 43905 .......... .......... .......... .......... .......... .......... 225 ATTATTAAAG AAATAATTAT CTCCTTATAA ACATTAGATT AAAAGTTGCA AAAAGATTAA 43965 .......... .......... .......... .......... .......... .......... 225 AGCTTTAACC ATATTGATCG GAACATAAAC AACAAAATAT GCATTTTGGG TATCAAAGTA 44025 .......... .......... .......... .......... .......... .......... 225 GTGTCATACA TAATGATTTG AATAAGGGTC TTGCCAAGAC ATCATTTAAT CCGAATTATT 44085 .......... .......... .......... .......... .......... .......... 225 TGAGTGACTT GCCTTATTTC ATTGAAATTC CAAGAGATGT TTTTTAAAAT TTTAATTAAC 44145 .......... .......... .......... .......... .......... .......... 225 TTATCAAGCA CACAACTAAT TATATAAAAT GTATAATATT TAGATTTTGT ATGTAGAGGG 44205 .......... .......... .......... .......... .......... .......... 225 AGGCCTTGAA TAAGAGAAGA ACTCTCGCAA TTGATGAATA AAATGTTTGT ACCACTTTTG 44265 .......... .......... .......... .......... .......... .......... 225 GAAAATACAA ATATAGACAA TGAAACAATT ACCTATCTTT TCTAAAGATT TGGTGATGAA 44325 .......... .......... .......... .......... .......... .......... 225 TAACTACAGT AAAATGAAGA ATCAATAACT AAATCCATAA ACACGTAGAA TCAAATCGTT 44385 .......... .......... .......... .......... .......... .......... 225 TTAAGTTTAA AAAAATATTT TATTTTGTCT TTGGATAAAA TATTCTTGAC AATTTATTGT 44445 .......... .......... .......... .......... .......... .......... 225 TGGGTTGTAC CCATTCGAAA ACACTTATAT TATCAAATGT TCAGAAGTAG ATTATTACCG 44505 .......... .......... .......... .......... .......... .......... 225 TAGTTTACCA CCGCGCGAAA AGCATGCAAT TTACCTTGTT AAATTACAAG TGCTCAGATG 44565 .......... .......... .......... .......... .......... .......... 225 CAATGATATG CTTTGAAAAT TATTTTTGAA GAACTTCTCG TAGTTCTGTT TGGTCTGACT 44625 .......... .......... .......... .......... .......... .......... 225 GCATTCGTGC CAGCTACTCA CTTTTTGGCG TCACTTCATA ATCTAAGTAG TTTTGTGTAT 44685 .......... .......... .......... .......... .......... .......... 225 TCAAAGGCAT AATGAGAAGA CAAAGCTGAC ATAATTGTCC AAAGAAAAGA AAAAAGACAA 44745 .......... .......... .......... .......... .......... .......... 225 AGAAATTGTA GCATAATAAA CAGGAATGGG TACCGTTACA GACATTTCTG TCTTTCTTCA 44805 .......... .......... .......... .......... .......... .......... 225 AATCAAACAA AATTTGTTGT ATTTTGATTA GTTTTCTGGA GCCTCAGTAT TGGATTAGGG 44865 .......... .......... .......... .......... .......... .......... 225 CCTCAGCTGC AGCCGTGATA CAGGCAAATT GTTATGCTTT AGGAGATCTG TATTTTAAAT 44925 .......... .......... .......... .......... .......... .......... 225 GGATGGAATG ATTCTTTTGG AATCTCTACA TCTCTTGATG CTTCATTTGA CTAGCTATTT 44985 .......... .......... .......... .......... .......... .......... 225 AGTTGATCTT CTGGTGGATT CCCTTTTCAG GATGGACGTA TTGATTATGG AGAATTTGTT 45045 |||||||| | |||||||||| |||||||||| .......... .......... .......... GATGGACGAA TTGATTATGG AGAATTTGTT 255 GCTATGATGC AAAAAGGAAA TCCATGCATA GGAAGACGAA CAATGCGAAA TAGTCTGAAT 45105 |||||||||| |||||||||| ||| || ||| || ||||||| |||||||||| |||||||||| GCTATGATGC AAAAAGGAAA TCCGTGTATA GGGAGACGAA CAATGCGAAA TAGTCTGAAT 315 TTCAGCATGA GAGATGCGCC CGGAGCTCAT TAGCTTTTTG AATGGACA 45153 || ||||||| ||||||| | |||||||| ||| | | |||| TTGAGCATGA GAGATGCATC AGGAGCTCAG TAG-TAGCTT CTCAGACA 362 hqPGS_C01HBa0088L02.1+_SGN-E356631+ (42406 42630,45016 45153) ******************************************************************************** EST sequence 106 +strand 388 n (File: SGN-E349241+) 1 GCTGATGTGG ACAATAGTGG AACTATTGAC TATGGAGAAT TCATTGCGGC AACTGTTCAT 61 CTTAATAAAT TGGAGCGCGA GGAACATCTC ATGGCAGCAT TTCAATATTT TGACAAGGAT 121 GGAAGTGGTT ACATAACAGT TGATGAGGTC CAGCAAGCTT GTATAGAGCA TAACATGACA 181 GATGTTTACT TTGAGGATAT TATAAGAGAA GTCGATCAGG ATAATGATGG ACGAATTGAT 241 TATGGAGAAT TTGTTGCTAT GATGCAAAAA GGAAATCCGT GTATAGGGAG ACGAACAATG 301 CGAAATAGTC TGAATTTGAG CATGAGAGAT GCATCAGGAG CTCAGTAGTA GCTTCTCAGA 361 CAGACATCTC TACTAGGTTG TACAGAAA Predicted gene structure (within gDNA segment 41806 to 46427): Exon 1 42406 42630 ( 225 n); cDNA 1 225 ( 225 n); score: 0.898 Intron 1 42631 45015 (2385 n); Pd: 0.956 (s: 0.88), Pa: 0.995 (s: 0.98) Exon 2 45016 45137 ( 122 n); cDNA 226 347 ( 122 n); score: 0.926 MATCH C01HBa0088L02.1+ SGN-E349241+ 0.908 347 0.894 C PGS_C01HBa0088L02.1+_SGN-E349241+ (42406 42630,45016 45137) Alignment (genomic DNA sequence = upper lines): GCTGATGTGG ACAATAGTGG AACTATTGAC TATGGAGAAT TCATAGCAGC AACAATTCAC 42465 |||||||||| |||||||||| |||||||||| |||||||||| |||| || || ||| |||| GCTGATGTGG ACAATAGTGG AACTATTGAC TATGGAGAAT TCATTGCGGC AACTGTTCAT 60 CTTAACAAAT TGGACCGCGA GGAACATCTC ATGGCAGCAT TTCAGTATTT TGACAAGGAT 42525 ||||| |||| |||| ||||| |||||||||| |||||||||| |||| ||||| |||||||||| CTTAATAAAT TGGAGCGCGA GGAACATCTC ATGGCAGCAT TTCAATATTT TGACAAGGAT 120 GGAAGTGGTT ATATTACAGT AGATGAGCTC CAGCAGGCCT GTGCAGATCA TAACATTACA 42585 |||||||||| | || ||||| |||||| || ||||| || | || ||| || |||||| ||| GGAAGTGGTT ACATAACAGT TGATGAGGTC CAGCAAGCTT GTATAGAGCA TAACATGACA 180 GATGTATTCT TTGAGGATAT TATCAGAGAA GTTGATCAGG ATAACGTAAG TTAATTATAT 42645 ||||| | || |||||||||| ||| |||||| || ||||||| |||| GATGTTTACT TTGAGGATAT TATAAGAGAA GTCGATCAGG ATAAT..... .......... 225 TGAGGATAAA GTTGAAGTAT TATTGGAACT TATCAATAAA AAAGTGGACA CAAATTAGTA 42705 .......... .......... .......... .......... .......... .......... 225 GATTAAATTT CTTCATGTTT TGCAGTTCTA CTGATTTATC TCTCTACTAC TCATAATTTT 42765 .......... .......... .......... .......... .......... .......... 225 TTTGCAACAA AAACTATTTT TTTTTATAAA AAAGCACTTT AATATGAAAC ACTTTTTGTG 42825 .......... .......... .......... .......... .......... .......... 225 CAACAAAAAC GAAAATTAAA AAAATATAGC ACTTTAAGAT TTCATATGAA TCTTTTCCTT 42885 .......... .......... .......... .......... .......... .......... 225 GAGATAAAAT GTTATTGACA ATGTAGTGTA TGTATGGAAA ATACGGATAT TACTAAATGA 42945 .......... .......... .......... .......... .......... .......... 225 TCATATGTGA GCTTAATAAT ATAGTTAATT TACCTCTCTC TCTCTATATA TATAAAGAGA 43005 .......... .......... .......... .......... .......... .......... 225 ACCCTAGGCT GCCTAAGTGG CGCCACCACA AATCAGGATT CCCTTTTAAT TTATTTATTT 43065 .......... .......... .......... .......... .......... .......... 225 CCAAAATTAG CCTTCCCTTT CATCAAAAGT TGTGACTTAT GAAACTTTGC GACTTTTACA 43125 .......... .......... .......... .......... .......... .......... 225 AAGAGTTGTA ACTTTTATGA AAGTTGTAAC TTTTATGAAA GTTGTAACTT TTATGTAGAG 43185 .......... .......... .......... .......... .......... .......... 225 TTGTGACTTT TCCAAAGGAT TATTACATTT CCGATAAGAC ACCATAACCA TTTATTCACA 43245 .......... .......... .......... .......... .......... .......... 225 CTATCCTTTT GTTGTCTATA AATAGAGGAA TTTTCTTTCA TTTTAAAACG ACGAAAATTC 43305 .......... .......... .......... .......... .......... .......... 225 TAAATTTTTT CTTCTGCTTA TGCACAATTA AATATTTGTG TACTTTGCTC CTGTTGAGTG 43365 .......... .......... .......... .......... .......... .......... 225 GTTCACTGAC ATCATTGTTT TTGAATCTAT ACAACGGTGA ATATAATCGT TCTATCCTAA 43425 .......... .......... .......... .......... .......... .......... 225 AAGTATCTAT TCATTCTTTT GTTACAAATC TTGGTATGTT TTTTACGCTC ATTTATGCTT 43485 .......... .......... .......... .......... .......... .......... 225 ATGTTATTAG TTGTTTTTGA GTACATGTTT TAAACTTTGT TGTTTATGTT TATGTTTATG 43545 .......... .......... .......... .......... .......... .......... 225 TTGAAATAAA GATATGTTAA TCAAGAATTT GATGTAGTGA TGTCATGTAG ATTAAAATTC 43605 .......... .......... .......... .......... .......... .......... 225 TTGAACTTAT AAAATAAATG ACTTTGATCT TTATAGAGTT TTAGTGGCTA AAAGATTCAT 43665 .......... .......... .......... .......... .......... .......... 225 GGGATGTTCA AGAAGAAACT TTTGAGTGTT CAAAAGTTAT GGTGGTTCTA CTCTACCATG 43725 .......... .......... .......... .......... .......... .......... 225 GAGTTTAGTT ATTCAACTTT CTATCTTATC TAGACATTCA ATCGATTAGT GACATTCAAA 43785 .......... .......... .......... .......... .......... .......... 225 AAATAAAGGA AAATGTAGCG GGATGGTAAG TATTATACTC AACCTTAATT AAAAGTTTGG 43845 .......... .......... .......... .......... .......... .......... 225 GATTCAAATA TTTGATTGGA GTCAATGAAT TACCCCCTTA GGATGAATCT ACATTAATCA 43905 .......... .......... .......... .......... .......... .......... 225 ATTATTAAAG AAATAATTAT CTCCTTATAA ACATTAGATT AAAAGTTGCA AAAAGATTAA 43965 .......... .......... .......... .......... .......... .......... 225 AGCTTTAACC ATATTGATCG GAACATAAAC AACAAAATAT GCATTTTGGG TATCAAAGTA 44025 .......... .......... .......... .......... .......... .......... 225 GTGTCATACA TAATGATTTG AATAAGGGTC TTGCCAAGAC ATCATTTAAT CCGAATTATT 44085 .......... .......... .......... .......... .......... .......... 225 TGAGTGACTT GCCTTATTTC ATTGAAATTC CAAGAGATGT TTTTTAAAAT TTTAATTAAC 44145 .......... .......... .......... .......... .......... .......... 225 TTATCAAGCA CACAACTAAT TATATAAAAT GTATAATATT TAGATTTTGT ATGTAGAGGG 44205 .......... .......... .......... .......... .......... .......... 225 AGGCCTTGAA TAAGAGAAGA ACTCTCGCAA TTGATGAATA AAATGTTTGT ACCACTTTTG 44265 .......... .......... .......... .......... .......... .......... 225 GAAAATACAA ATATAGACAA TGAAACAATT ACCTATCTTT TCTAAAGATT TGGTGATGAA 44325 .......... .......... .......... .......... .......... .......... 225 TAACTACAGT AAAATGAAGA ATCAATAACT AAATCCATAA ACACGTAGAA TCAAATCGTT 44385 .......... .......... .......... .......... .......... .......... 225 TTAAGTTTAA AAAAATATTT TATTTTGTCT TTGGATAAAA TATTCTTGAC AATTTATTGT 44445 .......... .......... .......... .......... .......... .......... 225 TGGGTTGTAC CCATTCGAAA ACACTTATAT TATCAAATGT TCAGAAGTAG ATTATTACCG 44505 .......... .......... .......... .......... .......... .......... 225 TAGTTTACCA CCGCGCGAAA AGCATGCAAT TTACCTTGTT AAATTACAAG TGCTCAGATG 44565 .......... .......... .......... .......... .......... .......... 225 CAATGATATG CTTTGAAAAT TATTTTTGAA GAACTTCTCG TAGTTCTGTT TGGTCTGACT 44625 .......... .......... .......... .......... .......... .......... 225 GCATTCGTGC CAGCTACTCA CTTTTTGGCG TCACTTCATA ATCTAAGTAG TTTTGTGTAT 44685 .......... .......... .......... .......... .......... .......... 225 TCAAAGGCAT AATGAGAAGA CAAAGCTGAC ATAATTGTCC AAAGAAAAGA AAAAAGACAA 44745 .......... .......... .......... .......... .......... .......... 225 AGAAATTGTA GCATAATAAA CAGGAATGGG TACCGTTACA GACATTTCTG TCTTTCTTCA 44805 .......... .......... .......... .......... .......... .......... 225 AATCAAACAA AATTTGTTGT ATTTTGATTA GTTTTCTGGA GCCTCAGTAT TGGATTAGGG 44865 .......... .......... .......... .......... .......... .......... 225 CCTCAGCTGC AGCCGTGATA CAGGCAAATT GTTATGCTTT AGGAGATCTG TATTTTAAAT 44925 .......... .......... .......... .......... .......... .......... 225 GGATGGAATG ATTCTTTTGG AATCTCTACA TCTCTTGATG CTTCATTTGA CTAGCTATTT 44985 .......... .......... .......... .......... .......... .......... 225 AGTTGATCTT CTGGTGGATT CCCTTTTCAG GATGGACGTA TTGATTATGG AGAATTTGTT 45045 |||||||| | |||||||||| |||||||||| .......... .......... .......... GATGGACGAA TTGATTATGG AGAATTTGTT 255 GCTATGATGC AAAAAGGAAA TCCATGCATA GGAAGACGAA CAATGCGAAA TAGTCTGAAT 45105 |||||||||| |||||||||| ||| || ||| || ||||||| |||||||||| |||||||||| GCTATGATGC AAAAAGGAAA TCCGTGTATA GGGAGACGAA CAATGCGAAA TAGTCTGAAT 315 TTCAGCATGA GAGATGCGCC CGGAGCTCAT TA 45137 || ||||||| ||||||| | |||||||| || TTGAGCATGA GAGATGCATC AGGAGCTCAG TA 347 hqPGS_C01HBa0088L02.1+_SGN-E349241+ (42406 42630,45016 45137) ******************************************************************************** EST sequence 189 -strand 741 n (File: SGN-E395372-) 1 GCAGCACAAT TTCACCTTAA CAAATGGGAC CGCGAGGAAC ATCTCATGGC AGCATTTCAG 61 TATTTTGACA AGGATGGAAG TGGTTATATT ACAGTAGATG AGCTCCAGCA GGCCTGTGCA 121 GATCATAACA TTACAGATGT ATTCTTTGAG GATATTATCA GAGAAGTTGA TCAGGATAAC 181 GATGGACGTA TTGATTATGG AGAATTTGTT GCTATGATGC AAAAAGGAAA TCCATGCATA 241 GGAAGACGAA CAATGCGAAA TAGTCTGAAT TTCAGCATGA GAGATGCGCC CGGAGCTCAT 301 TAGCTTTTTG AATGGACACA TGATGTAGCT AGTTTGCAGG TTTTTACAGA TAATAGAGCA 361 GAGGCAATGA AACTGCCGTA ACAATGTCTG GTACTCTTTT CTAAAAGTAG TATGCCATGC 421 TCTCAAGTAT AACTAGAAGT GCTTGTAGAC TGTGCCTCAA CAAAATGTGA AATTTCTGTC 481 GTGTGTGAAA TCATTTCAGC TACCTAGTGT TCTTTAGTTG AGGCTTCATG CTTGCTTCAG 541 TTAGAAGGTG GTTCACCTTG AGGTGTATCC TTGTCAATTA CATAATTATG TATTTTACCC 601 ATTGGTTTTT CTCTATCGGG AGATTGTTTT TAAGGAAAAG AACACGATTT GTTGTAACAA 661 TTTACGCAAG CTATATTTGC AGAACATGGT CAGTCATTTA TGATGACGTG CTTAATTATT 721 CTCAACAAAA AAAAAAAAAA A Predicted gene structure (within gDNA segment 41607 to 52520): Exon 1 42451 42630 ( 180 n); cDNA 1 180 ( 180 n); score: 0.978 Intron 1 42631 45015 (2385 n); Pd: 0.956 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 2 45016 45163 ( 148 n); cDNA 181 328 ( 148 n); score: 1.000 Intron 2 45164 51381 (6218 n); Pd: 0.985 (s: 1.00), Pa: 0.815 (s: 1.00) Exon 3 51382 51782 ( 401 n); cDNA 329 729 ( 401 n); score: 0.995 Intron 3 51783 51982 ( 200 n); Pd: 0.000 (s: 0.98), Pa: 0.513 (s: 0) Exon 4 51983 51991 ( 9 n); cDNA 730 738 ( 9 n); score: 0.889 MATCH C01HBa0088L02.1+ SGN-E395372- 0.992 738 0.996 C PGS_C01HBa0088L02.1+_SGN-E395372- (42451 42630,45016 45163,51382 51782,51983 51991) Alignment (genomic DNA sequence = upper lines): GCAGCAACAA TTCACCTTAA CAAATTGGAC CGCGAGGAAC ATCTCATGGC AGCATTTCAG 42510 |||||| | |||||||||| ||||| |||| |||||||||| |||||||||| |||||||||| GCAGCACAAT TTCACCTTAA CAAATGGGAC CGCGAGGAAC ATCTCATGGC AGCATTTCAG 60 TATTTTGACA AGGATGGAAG TGGTTATATT ACAGTAGATG AGCTCCAGCA GGCCTGTGCA 42570 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATTTTGACA AGGATGGAAG TGGTTATATT ACAGTAGATG AGCTCCAGCA GGCCTGTGCA 120 GATCATAACA TTACAGATGT ATTCTTTGAG GATATTATCA GAGAAGTTGA TCAGGATAAC 42630 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GATCATAACA TTACAGATGT ATTCTTTGAG GATATTATCA GAGAAGTTGA TCAGGATAAC 180 GTAAGTTAAT TATATTGAGG ATAAAGTTGA AGTATTATTG GAACTTATCA ATAAAAAAGT 42690 .......... .......... .......... .......... .......... .......... 180 GGACACAAAT TAGTAGATTA AATTTCTTCA TGTTTTGCAG TTCTACTGAT TTATCTCTCT 42750 .......... .......... .......... .......... .......... .......... 180 ACTACTCATA ATTTTTTTGC AACAAAAACT ATTTTTTTTT ATAAAAAAGC ACTTTAATAT 42810 .......... .......... .......... .......... .......... .......... 180 GAAACACTTT TTGTGCAACA AAAACGAAAA TTAAAAAAAT ATAGCACTTT AAGATTTCAT 42870 .......... .......... .......... .......... .......... .......... 180 ATGAATCTTT TCCTTGAGAT AAAATGTTAT TGACAATGTA GTGTATGTAT GGAAAATACG 42930 .......... .......... .......... .......... .......... .......... 180 GATATTACTA AATGATCATA TGTGAGCTTA ATAATATAGT TAATTTACCT CTCTCTCTCT 42990 .......... .......... .......... .......... .......... .......... 180 ATATATATAA AGAGAACCCT AGGCTGCCTA AGTGGCGCCA CCACAAATCA GGATTCCCTT 43050 .......... .......... .......... .......... .......... .......... 180 TTAATTTATT TATTTCCAAA ATTAGCCTTC CCTTTCATCA AAAGTTGTGA CTTATGAAAC 43110 .......... .......... .......... .......... .......... .......... 180 TTTGCGACTT TTACAAAGAG TTGTAACTTT TATGAAAGTT GTAACTTTTA TGAAAGTTGT 43170 .......... .......... .......... .......... .......... .......... 180 AACTTTTATG TAGAGTTGTG ACTTTTCCAA AGGATTATTA CATTTCCGAT AAGACACCAT 43230 .......... .......... .......... .......... .......... .......... 180 AACCATTTAT TCACACTATC CTTTTGTTGT CTATAAATAG AGGAATTTTC TTTCATTTTA 43290 .......... .......... .......... .......... .......... .......... 180 AAACGACGAA AATTCTAAAT TTTTTCTTCT GCTTATGCAC AATTAAATAT TTGTGTACTT 43350 .......... .......... .......... .......... .......... .......... 180 TGCTCCTGTT GAGTGGTTCA CTGACATCAT TGTTTTTGAA TCTATACAAC GGTGAATATA 43410 .......... .......... .......... .......... .......... .......... 180 ATCGTTCTAT CCTAAAAGTA TCTATTCATT CTTTTGTTAC AAATCTTGGT ATGTTTTTTA 43470 .......... .......... .......... .......... .......... .......... 180 CGCTCATTTA TGCTTATGTT ATTAGTTGTT TTTGAGTACA TGTTTTAAAC TTTGTTGTTT 43530 .......... .......... .......... .......... .......... .......... 180 ATGTTTATGT TTATGTTGAA ATAAAGATAT GTTAATCAAG AATTTGATGT AGTGATGTCA 43590 .......... .......... .......... .......... .......... .......... 180 TGTAGATTAA AATTCTTGAA CTTATAAAAT AAATGACTTT GATCTTTATA GAGTTTTAGT 43650 .......... .......... .......... .......... .......... .......... 180 GGCTAAAAGA TTCATGGGAT GTTCAAGAAG AAACTTTTGA GTGTTCAAAA GTTATGGTGG 43710 .......... .......... .......... .......... .......... .......... 180 TTCTACTCTA CCATGGAGTT TAGTTATTCA ACTTTCTATC TTATCTAGAC ATTCAATCGA 43770 .......... .......... .......... .......... .......... .......... 180 TTAGTGACAT TCAAAAAATA AAGGAAAATG TAGCGGGATG GTAAGTATTA TACTCAACCT 43830 .......... .......... .......... .......... .......... .......... 180 TAATTAAAAG TTTGGGATTC AAATATTTGA TTGGAGTCAA TGAATTACCC CCTTAGGATG 43890 .......... .......... .......... .......... .......... .......... 180 AATCTACATT AATCAATTAT TAAAGAAATA ATTATCTCCT TATAAACATT AGATTAAAAG 43950 .......... .......... .......... .......... .......... .......... 180 TTGCAAAAAG ATTAAAGCTT TAACCATATT GATCGGAACA TAAACAACAA AATATGCATT 44010 .......... .......... .......... .......... .......... .......... 180 TTGGGTATCA AAGTAGTGTC ATACATAATG ATTTGAATAA GGGTCTTGCC AAGACATCAT 44070 .......... .......... .......... .......... .......... .......... 180 TTAATCCGAA TTATTTGAGT GACTTGCCTT ATTTCATTGA AATTCCAAGA GATGTTTTTT 44130 .......... .......... .......... .......... .......... .......... 180 AAAATTTTAA TTAACTTATC AAGCACACAA CTAATTATAT AAAATGTATA ATATTTAGAT 44190 .......... .......... .......... .......... .......... .......... 180 TTTGTATGTA GAGGGAGGCC TTGAATAAGA GAAGAACTCT CGCAATTGAT GAATAAAATG 44250 .......... .......... .......... .......... .......... .......... 180 TTTGTACCAC TTTTGGAAAA TACAAATATA GACAATGAAA CAATTACCTA TCTTTTCTAA 44310 .......... .......... .......... .......... .......... .......... 180 AGATTTGGTG ATGAATAACT ACAGTAAAAT GAAGAATCAA TAACTAAATC CATAAACACG 44370 .......... .......... .......... .......... .......... .......... 180 TAGAATCAAA TCGTTTTAAG TTTAAAAAAA TATTTTATTT TGTCTTTGGA TAAAATATTC 44430 .......... .......... .......... .......... .......... .......... 180 TTGACAATTT ATTGTTGGGT TGTACCCATT CGAAAACACT TATATTATCA AATGTTCAGA 44490 .......... .......... .......... .......... .......... .......... 180 AGTAGATTAT TACCGTAGTT TACCACCGCG CGAAAAGCAT GCAATTTACC TTGTTAAATT 44550 .......... .......... .......... .......... .......... .......... 180 ACAAGTGCTC AGATGCAATG ATATGCTTTG AAAATTATTT TTGAAGAACT TCTCGTAGTT 44610 .......... .......... .......... .......... .......... .......... 180 CTGTTTGGTC TGACTGCATT CGTGCCAGCT ACTCACTTTT TGGCGTCACT TCATAATCTA 44670 .......... .......... .......... .......... .......... .......... 180 AGTAGTTTTG TGTATTCAAA GGCATAATGA GAAGACAAAG CTGACATAAT TGTCCAAAGA 44730 .......... .......... .......... .......... .......... .......... 180 AAAGAAAAAA GACAAAGAAA TTGTAGCATA ATAAACAGGA ATGGGTACCG TTACAGACAT 44790 .......... .......... .......... .......... .......... .......... 180 TTCTGTCTTT CTTCAAATCA AACAAAATTT GTTGTATTTT GATTAGTTTT CTGGAGCCTC 44850 .......... .......... .......... .......... .......... .......... 180 AGTATTGGAT TAGGGCCTCA GCTGCAGCCG TGATACAGGC AAATTGTTAT GCTTTAGGAG 44910 .......... .......... .......... .......... .......... .......... 180 ATCTGTATTT TAAATGGATG GAATGATTCT TTTGGAATCT CTACATCTCT TGATGCTTCA 44970 .......... .......... .......... .......... .......... .......... 180 TTTGACTAGC TATTTAGTTG ATCTTCTGGT GGATTCCCTT TTCAGGATGG ACGTATTGAT 45030 ||||| |||||||||| .......... .......... .......... .......... .....GATGG ACGTATTGAT 195 TATGGAGAAT TTGTTGCTAT GATGCAAAAA GGAAATCCAT GCATAGGAAG ACGAACAATG 45090 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATGGAGAAT TTGTTGCTAT GATGCAAAAA GGAAATCCAT GCATAGGAAG ACGAACAATG 255 CGAAATAGTC TGAATTTCAG CATGAGAGAT GCGCCCGGAG CTCATTAGCT TTTTGAATGG 45150 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CGAAATAGTC TGAATTTCAG CATGAGAGAT GCGCCCGGAG CTCATTAGCT TTTTGAATGG 315 ACACATGATG TAGGTATTTC CCCTTTTTTA TTTTTGTAAC CGTTTCTTTG GCAATGAATT 45210 |||||||||| ||| ACACATGATG TAG....... .......... .......... .......... .......... 328 TGAAGAAATC TTTCCTTGTT CTGTCCTTGA GAAATTGGAT TGGTTGGAGT ATATTTGTTT 45270 .......... .......... .......... .......... .......... .......... 328 AACATTAAGA GTTTCTTTTT CCCTCTTGAG GATAATAAAA TTTTATAAAT AACAGCATGA 45330 .......... .......... .......... .......... .......... .......... 328 GTGTTTGCTG TAAAACTCTA CAGGTGCAGC AAAAAAAATT ACATTCAGCA AAAGTATATC 45390 .......... .......... .......... .......... .......... .......... 328 CCATCTTATC CTGTTGGTAC ACTAGCATGT CACAGATAGA TTCAGCTTCC TCCCCAATCC 45450 .......... .......... .......... .......... .......... .......... 328 TCCATTTTAC ACCATTAACA AAAATAAATT TCAGATACAG AGTTCTCTTT CATTCCCATC 45510 .......... .......... .......... .......... .......... .......... 328 TTTTATATAA TGCTGGTTTC TTTTCTTTTG GTAAAATTTT GATGTATCAA ATTTGACGAT 45570 .......... .......... .......... .......... .......... .......... 328 TGTCCGACAT GGCTATGTGA GGAACTTTCC TAAGGGAGCA CTAAGGGTGT CAAATGTGTG 45630 .......... .......... .......... .......... .......... .......... 328 GGTGGAGGCA GTGGGGGACT GAAATTGAAG AGGTTAAAAT GGGCTGAGCT AAAAGTCATG 45690 .......... .......... .......... .......... .......... .......... 328 TTGGATCATA ACCCACTCAA ACTTACTTTG GGCTAACATG GGCTAGAATC TTGATTGGGT 45750 .......... .......... .......... .......... .......... .......... 328 TATGACCTAT CCAATTTGAC CTGCTTAATC TAAACTAAAC TATATTAAAC ACTTGCTATA 45810 .......... .......... .......... .......... .......... .......... 328 ATTTATGACA GATGTCATTC AACCCATAGA ATCGTACAGA TCTGTACTAA CTTTTCATTT 45870 .......... .......... .......... .......... .......... .......... 328 AGGAGCATCT CCTTGTAGAG TAAATTGATG TAGACTTTAT AGTATGGGAC CAACTTCATA 45930 .......... .......... .......... .......... .......... .......... 328 ATTTTGCAAC TCATTTAATA GTGTATTTAT GAGAATTATT GAAAAGAATA TTATTGAATT 45990 .......... .......... .......... .......... .......... .......... 328 GTGTGTCTAC ATTATTACAT TGAGACTTTA TTTATAGACA CTATATTATA CTCCTTTTCC 46050 .......... .......... .......... .......... .......... .......... 328 AACTAGGACA CTACAATACC ATCCTTTTCT AAGTAGGATT CTATATACTA TTTCTATTCC 46110 .......... .......... .......... .......... .......... .......... 328 TATTCCTATT CTAAGTAGAA TGGTATATAT TATTCTTGTT CCTTTTTTGA TTCTAACACT 46170 .......... .......... .......... .......... .......... .......... 328 CCCCCTCAAG CTGGTGCATA CAAGTTATAT ATACTTTGCT TGTTACAAAT GTAATTAATA 46230 .......... .......... .......... .......... .......... .......... 328 TGAGGACCAA TGAGAGGCTT GATGAAGATA TCTGCAAGTT GATCACTTGA CTCACAAATT 46290 .......... .......... .......... .......... .......... .......... 328 TTGTAACAAT ATCTCCCGAC TTCCCAGACC AAGCTTGAGA AGAACGTTTC ATATCATCGA 46350 .......... .......... .......... .......... .......... .......... 328 GTGACTTGCA CAATCAACAT ATAAGGCTGC TAGACTCCCT CGGAGCAATA AGACCAAGTG 46410 .......... .......... .......... .......... .......... .......... 328 GTTGCTCCAT ATATACTTCT CCATCGAGAT CCCAGCCCAA ATATGTAAGT ATATCCTTTT 46470 .......... .......... .......... .......... .......... .......... 328 GGATAAAGTG AATCTAAAAC AAAGAGAATA TTGCTTGAAA ACTTGGATTT TTTTGGGAAC 46530 .......... .......... .......... .......... .......... .......... 328 TCGGATATGT TGGACTTTGC ACAACATTGA CAAAGTTGAA ACTATTTAAA TCAGACCTAA 46590 .......... .......... .......... .......... .......... .......... 328 GGAGTCACCG AAAAGACGTA CGGTGCTTCG AAAATTAGAT ATGAGAAAGT AGTCACCAAA 46650 .......... .......... .......... .......... .......... .......... 328 AAGACGCATG ATGTTGTGCA AATTAGATAT GAGAAAGTAG TCACCAAGAA GATGAGACAG 46710 .......... .......... .......... .......... .......... .......... 328 TGCTACATAA ATTAAATATG AAAAAGTAGT CACTGATAAG ATGGCACGGT GCTACACAAA 46770 .......... .......... .......... .......... .......... .......... 328 TTAAATATGA AAAAGTAGTC ATCAAAAAGA TGGTGCGATG CTACACAAAA GTAAATAGTC 46830 .......... .......... .......... .......... .......... .......... 328 ACCGGAATGA TGACATGATG CTACAAAAAT GAAATATGAG AGTAGTCACC TGAAGGATGA 46890 .......... .......... .......... .......... .......... .......... 328 CACAGTGCCA CATAAATTGA ACATAAAAAA ATAGTCACCA GAAACATGAT GCGGTGCTAC 46950 .......... .......... .......... .......... .......... .......... 328 ACAAATTAAG AGCCTGTTTG GCTCAGCTTA AAAGCTGGTC AAACTGACTT AAAATCTGAT 47010 .......... .......... .......... .......... .......... .......... 328 TTTTGACTTA TTTAACTGTT TGACAATACT CAAAATAGCT TATTTTAAGT TAAAAAAAAC 47070 .......... .......... .......... .......... .......... .......... 328 TTATTTTAAG CCAAAAGTTA AAAGGTGGGG TAGGGGTGCT TTTTTTTTTT AGCTTATAAG 47130 .......... .......... .......... .......... .......... .......... 328 CTGTTTTAAG TTGACCATAT TTTTATGTTT TTTCCCTTAA TATTTTTATA CAATCTCCAA 47190 .......... .......... .......... .......... .......... .......... 328 ATTATCCATA TAACCCTAAC ATCTCTTTCT TCTATTTTTC CCTTTTCACG TTTGGCATAA 47250 .......... .......... .......... .......... .......... .......... 328 CAACTTCAGC ACTTTTATCC AAACGCATAA CTGCTTATTT TAAAAATAAG TTTCAGCACT 47310 .......... .......... .......... .......... .......... .......... 328 TTCAAAAGTA CTTTTTTAAA GCTGCTTTTA TTAAGCCCAT CCAAACGGGC TCTAAATATA 47370 .......... .......... .......... .......... .......... .......... 328 TAAATAATAG TCACCGGAAG ATGACACACT GCTACAAATC AAATTTAAGA AAGTAGTCAC 47430 .......... .......... .......... .......... .......... .......... 328 CGAAATGATA GCACAGTGCC ACACAAATTA GATATGAGAA AGTAGTCGCC ATGACAACCC 47490 .......... .......... .......... .......... .......... .......... 328 TAGAAAGTCG TGCATATATC AGTGACCCTA ATTTGGTTAA CATTACCAAT GGCAAGAGGG 47550 .......... .......... .......... .......... .......... .......... 328 GAGATAGATA TGAGTCATAG CCGCCCTACA CCGACGAAAT CTTTTTTTGA TTTTCTACCG 47610 .......... .......... .......... .......... .......... .......... 328 AGATCGTAGG AGCTTTGATA CCATGTGGAA ATATTGAAAA AGAACATTGT TGAATTGGTC 47670 .......... .......... .......... .......... .......... .......... 328 TCTAGATTAT AACATCGAGA CCTATTAATA GGGCACTACC TTAGACTCAA ATTCCAACTA 47730 .......... .......... .......... .......... .......... .......... 328 GGACACTACC ATACAATCCT ATTCTAAGTA GTATTTTATG TACTATTTTT ATTCCTATTA 47790 .......... .......... .......... .......... .......... .......... 328 CTAGTATTTT ATGTACTATT TTTATTCCTG TTACTATTCT AAGTATGATG GTATATATTA 47850 .......... .......... .......... .......... .......... .......... 328 TTCTTGTTCA TATTCCTATT CAAACAGTAA TAATTTGACA TATAGAATGT AGGCAATTAT 47910 .......... .......... .......... .......... .......... .......... 328 TTTTTAATAT GACATGGCAT GCAAAATAAT GTGTTGTTAA AGAATCAAAT AACAATAATC 47970 .......... .......... .......... .......... .......... .......... 328 AAGTGACTTT AGAATTCCAA AAGAGAGACC ATGATAGATC ATTATCATAT TAGGTAATAA 48030 .......... .......... .......... .......... .......... .......... 328 AAAATAAGGA TTCGGTAACA AAATGCAAGA AGGTGAAATG AATTTTTAAG ATATTTCAGT 48090 .......... .......... .......... .......... .......... .......... 328 TTGCCAAAAA TAAGCATATT AGGTTAGTAT ATGAGGAAAA AAAACAGTTT TATTCGAATT 48150 .......... .......... .......... .......... .......... .......... 328 GGTTAAACTC AGTTCTCATT TTCATATCAA GTGAAAAGGT CAATATAAAC TAAAGAGATG 48210 .......... .......... .......... .......... .......... .......... 328 ATGATTGTCC CATCTTTGCA CATGTAGTCC GGTTAGAATG GGGATTGAAT TGACATAGAA 48270 .......... .......... .......... .......... .......... .......... 328 CTTGGGCTAA GTGGGTTATA ATTATACGGG TTAAGACGTA GCACATTATT AAATTATCAT 48330 .......... .......... .......... .......... .......... .......... 328 GAGCTCAACC CATAAATTTT GGGCTCCTAA TATCTGAGCT TCATTTGACA CCCCAAGTAA 48390 .......... .......... .......... .......... .......... .......... 328 GGAGTGCCAC GCACGAGCAT GGCAAAAAGC AAGGGGAACT TTTCTTTTTG GGAGAAATCA 48450 .......... .......... .......... .......... .......... .......... 328 TTTGATTGCA TATTGAATAC ATAAAGCACA TTCCAACAAA TTCAAATTTT AGAAGTTTCA 48510 .......... .......... .......... .......... .......... .......... 328 TATGGTGACT ACATTTTAGC TTCCCGTCAA TTACCCCAAC CTTCTTCATT TATCCAGATG 48570 .......... .......... .......... .......... .......... .......... 328 TGGGACGGAC ACGGTGAAGC TCACATAGAT TGAGTTAGGT AAAATATTTA TCTGTGGAGA 48630 .......... .......... .......... .......... .......... .......... 328 AAAATATTAC CCCCTGTTCC ATTTTGTGTG ACAAGTTGAA AAATATGTGT GGTTAAATTG 48690 .......... .......... .......... .......... .......... .......... 328 ACTAATTTTC TGAGTGAATT TGAACATTGA TATTCATTTT CTAAAAATAA AGTTTTACAT 48750 .......... .......... .......... .......... .......... .......... 328 CTTTAAAAAC TATATAAAAA GTATTGTAAG TCACAATAGT TTACAATTCA AAATATTAAA 48810 .......... .......... .......... .......... .......... .......... 328 GAAGTATTTT AAAAAAAACA TGGTCAAAGA AAAACTTATT TTACACTCCA GATAGTTATA 48870 .......... .......... .......... .......... .......... .......... 328 GGTTACATAA AGTGGAGCAA AGTACTCTTA TCAATACTCT TAACCATAGG TCTGGAATTC 48930 .......... .......... .......... .......... .......... .......... 328 GAGTACCCAT AGAATAGAGT TCCTTTTGTT AGGGAGCGGG TGGGAACCAA AAAAAAAAGT 48990 .......... .......... .......... .......... .......... .......... 328 GGAACAAAGG GAGTACTAAA GTATACTTAT GGAAGTTAAT ATAAAATCTG AAGATAAGCG 49050 .......... .......... .......... .......... .......... .......... 328 TTAAAAACAT ACCTAAACTA TCCTTTTTTT TTTAGTTTCA TACTTGAAGT ATTGAGTGTG 49110 .......... .......... .......... .......... .......... .......... 328 AGTTTTCTAC CTAAACTATC ACTTATTAAT TTGAGAAACA CATCTTTCTT TTATTATACT 49170 .......... .......... .......... .......... .......... .......... 328 CTATCATGGT GTGTAATACA CTCCTTTTAT TTAAAAATTG TTATATTACA ATCCACATGG 49230 .......... .......... .......... .......... .......... .......... 328 ACAAAACGTT TCACCTTGAC AAAAAATAAA TAATTAGTAT TAGTTAAAGT TAAGTATTAA 49290 .......... .......... .......... .......... .......... .......... 328 AGTATTGCTA TCCCCCCCCC CTCCCCCAAA AAAAAAATTA TAAAATAAAA TGTAAAATAT 49350 .......... .......... .......... .......... .......... .......... 328 TTTTTTTACC CAACTCCAAT CTTTCCTCTC AACGTACTCC CCCATCCCAA ATTTTTAGTT 49410 .......... .......... .......... .......... .......... .......... 328 TATTTTGTTC AAAAAAAATA AATCCCTTCG AATAATAATT TAGATATAGT TAAATTTATT 49470 .......... .......... .......... .......... .......... .......... 328 TTATTTCTTG AAAAAAAATT CTACCCTAAC ATAACTCCCC TCTTCCATTT TTTTTCTCGT 49530 .......... .......... .......... .......... .......... .......... 328 TTTGTATTAG ATATGTATTT TCTTTTCTAA AAAAGTATTT TTTAACTTGC CGCAAGACTT 49590 .......... .......... .......... .......... .......... .......... 328 TTCATAAAAT AAAACTTTTA TTTCTGTTAA TTTGGTATGC AAGTAGAAAA GAATGTTTTC 49650 .......... .......... .......... .......... .......... .......... 328 CTAAAAATAT ATGTACACAT CTAACACAAA ACTAGAAAAA TGTATAAAAT TAAATTAGGA 49710 .......... .......... .......... .......... .......... .......... 328 GCGGAGGGTT AGATGGGGTG GGGTAGAATA TTATTTTATT TTACTTTTTT TTTAAAAAAT 49770 .......... .......... .......... .......... .......... .......... 328 AATATCAAAA TTATTTTTAG GAAGGAGTGG GGGAGGGGGT GACGCCTAAA TTTCAAAAAA 49830 .......... .......... .......... .......... .......... .......... 328 TAATTTTAGA AATAATAGGA CGTGGGGTTG TCCGGGGATG AGGGTTGAGA TGATGGAGTG 49890 .......... .......... .......... .......... .......... .......... 328 GGGTAAGAAA TATTTTAATT TTTTAAAAAA TGGTAATACT TTAATCTTTA GTTTTTAGCT 49950 .......... .......... .......... .......... .......... .......... 328 AATATTAATA GTTTTTTAAT TTTTGTCAAG TTGGAATAAT TTATCCATGT GCAATGCCAT 50010 .......... .......... .......... .......... .......... .......... 328 GAGGCAAGGT TTTTGCAAAT AAATGAGAAA AGTGTATTAG ACACCACTGA GGTGTGTTTT 50070 .......... .......... .......... .......... .......... .......... 328 TCAAACTAAT AAGTGATAGT TTAGGTATGA AAATTCAAAA AAAAAAAAGA AAAGAAATAG 50130 .......... .......... .......... .......... .......... .......... 328 TTTAGGTGTG TTTTGACACT TATGTCTAAT CTGAAAGATA TTATTAGTTG TACAAGTGTG 50190 .......... .......... .......... .......... .......... .......... 328 AAAAAACACC CCAGGATGTT CCCAAGTGAA CAAATAGAAA GTGGGGTCGA AATGGGAAAT 50250 .......... .......... .......... .......... .......... .......... 328 ATACCATCAG TTGTCAATGA AGTTGAAATA AAATCATGAG AGAGTTCCAA TCCTAGTAGA 50310 .......... .......... .......... .......... .......... .......... 328 AGCAAAAAGA AATTAGCCGA TTTCTTCCAA TATGTCTTAA GTTTCAGCTG TCAAGATTAC 50370 .......... .......... .......... .......... .......... .......... 328 TGCCTGGTAC CTTTGGGTGG AGGATACATG CACCTAGTGG AATAGTCAAG ATACATGCAT 50430 .......... .......... .......... .......... .......... .......... 328 GTTGGGTTGA AGGCACCTTA GTCTTATAGA ATTGTCAAAT CAGAATATTT AGTATGATGT 50490 .......... .......... .......... .......... .......... .......... 328 ATCATGTGTT CTTGAACACT CGTAGAACTA ATTCTGTTTT CCAACCATTA GTTGACTCTA 50550 .......... .......... .......... .......... .......... .......... 328 TCAAAAGAAT ATCAAGTTGA AGCTAGTTGA GATGTAGGTA GAATATCTAT TAACCAACTT 50610 .......... .......... .......... .......... .......... .......... 328 ATCTCCATGT AGTTCTATTC AGTTCCATTT CATCCAATAT TGTATAATTT ACCTTAAAAC 50670 .......... .......... .......... .......... .......... .......... 328 TACAAGTCCG ATGTGTTCCA CACTTTCAGG AATATAAAAG TCTAACACTG TGCCTATTAT 50730 .......... .......... .......... .......... .......... .......... 328 CAGCTAACAA GTAACAACTC TCTATTTCAA ATAGCTGGCA TTGCCTACAT GGATCATTTA 50790 .......... .......... .......... .......... .......... .......... 328 CTTTTGTTAG GTTACGGTCT TAGTTAAGTT CTACCAGAGA TATTGCACGT CCTTTAGGAT 50850 .......... .......... .......... .......... .......... .......... 328 AACTCATCTC CTTGTGATTT TAGGTGTACT TTGCTTATTT GAAATGATGC AAGGTTTTAT 50910 .......... .......... .......... .......... .......... .......... 328 TACTTTTTTT TTCTAAGAGA TTTTCATTGT ATATGTATCC ACCAAAAGAA TAATACGAAG 50970 .......... .......... .......... .......... .......... .......... 328 AAAAAAAATG AGAGAGGAAG AAACAGATCT GCTTCCAAGT TGTGACATAA TTTTATCGAA 51030 .......... .......... .......... .......... .......... .......... 328 AAGAAAAAGA ATATTCAGAG GCCCAGGTGC CACTGAGTTA ACTCGCCATT CTTCTCTTCT 51090 .......... .......... .......... .......... .......... .......... 328 TTAGACAAGC CTGATAAGGA AAGCTGATTC TTAACAATGT GTTGGGCATC AAAGGTTTTC 51150 .......... .......... .......... .......... .......... .......... 328 TTTTGTTCTC CTTCAAAATG CACATAGGTA AGGTACTTAT TCATAGTACA ATTATTTGGC 51210 .......... .......... .......... .......... .......... .......... 328 ATATATTGTA GTTACACACG TGCTTGTGTA CTTGTTCTAC TAAAATGTTG TTATGACTTT 51270 .......... .......... .......... .......... .......... .......... 328 GTAAGCTAGG TTAAATATCA CAGAACATGG TGCATCTTTC ATTTGGAGCA TGAACTTGTG 51330 .......... .......... .......... .......... .......... .......... 328 TTTCACTCTT GGTCAAGTTA TGTGTAAAAG GTATTCTGAC ATTCATGTCA GCTAGTTTGC 51390 ||||||||| .......... .......... .......... .......... .......... .CTAGTTTGC 337 AGGTTTTTAC AGATAATAGA GCAGAGGCAA TGAAACTGCC GTAACAATGT CTGGTACTCT 51450 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGGTTTTTAC AGATAATAGA GCAGAGGCAA TGAAACTGCC GTAACAATGT CTGGTACTCT 397 TTTCTAAAAG TAGTATGCCA TGCTCTCAAG TATAACTAGA AGTGCTTGTA GACTGTGCCT 51510 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTCTAAAAG TAGTATGCCA TGCTCTCAAG TATAACTAGA AGTGCTTGTA GACTGTGCCT 457 CAACAAAATG TGAAATCTCT GTCGTGTGTG AAATCATTTC AGCTACCTAG TGTTCTTTAG 51570 |||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| |||||||||| CAACAAAATG TGAAATTTCT GTCGTGTGTG AAATCATTTC AGCTACCTAG TGTTCTTTAG 517 TTGAGGCTTC ATGCTTGCTT CAGTTAGAAG GTGGTTCACC TTGAGGTGTA TCCTTGTCAA 51630 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGAGGCTTC ATGCTTGCTT CAGTTAGAAG GTGGTTCACC TTGAGGTGTA TCCTTGTCAA 577 TTACATAATT ATGTATTTTA CCCATTGGTT TTTCTCTATC GGGAGATTGT TTTTAAGGAA 51690 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTACATAATT ATGTATTTTA CCCATTGGTT TTTCTCTATC GGGAGATTGT TTTTAAGGAA 637 AAGAACACGA TTTGTTGTAA CAATTTACGC AAGCTATATT TGCAGAACAT GGTCAGTCAT 51750 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAGAACACGA TTTGTTGTAA CAATTTACGC AAGCTATATT TGCAGAACAT GGTCAGTCAT 697 TTATGATGAC GTGCTTAATT ATTCTCAACA TATTCTGAGA CTCTCCTTTT CAGCTTAAGT 51810 |||||||||| |||||||||| |||||||||| | TTATGATGAC GTGCTTAATT ATTCTCAACA AA........ .......... .......... 729 TGATGGCTTC TTTTATGTCA AAACATGATT GAAGGACATG AGTGGCCTTT GAATTCAGTT 51870 .......... .......... .......... .......... .......... .......... 729 TTTGGGAATT CGATTTTGAA GAAAAGTTGC ATGTTCCAAT TACTTTTTGA GAAACCTAGT 51930 .......... .......... .......... .......... .......... .......... 729 TTATGTTTTT TGTTAAAAAA AAAAACCAAT TTTGCTGGAT TTTACTTTTT AGAAAGAAAA 51990 ||| |||| .......... .......... .......... .......... .......... ..AAAAAAAA 737 A 51991 | A 738 hqPGS_C01HBa0088L02.1+_SGN-E395372- (42451 42630,45016 45163,51382 51782,51983 51991) ******************************************************************************** EST sequence 100 +strand 694 n (File: SGN-E357930+) 1 AGGAACATCT CATGGCAGCA TTTCAGTATT TTGACAAGGA TGGAAGTGGT TATATTACAG 61 TAGATGAGCT CCAGCAGGCC TGTGCAGATC ATAACATTAC AGATGTATTC TTTGAGGATA 121 TTATCAGAGA AGTTGATCAG GATAACGATG GACGTATTGA TTATGGAGAA TTTGTTGCTA 181 TGATGCAAAA AGGAAATCCA TGCATAGGAA GACGAACAAT GCGAAATAGT CTGAATTTCA 241 GCATGAGAGA TGCGCCCGGA GCTCATTAGC TTTTTGAATG GACACATGAT GTAGTTTGCA 301 GGTTTTTACA GATAATAGAG CAGAGGCAAT GAAACTGCCG TAACAATGTC TGGTACTCTT 361 TTCTAAAAGT AGTATGCCAT GCTCTCAAGT ATAACTAGAA GTGCTTGTAG ACTGTGCCTC 421 AACAAAATGT GAAATCTCTG TCGTGTGTGA AATCATTTCA GCTACCTAGT GTTCTTTAGT 481 TGAGGCTTCA TGCTTGCTTC AGTTAGAAGG TGGTTCACCT TGAGGTGTAT CCTTGTCAAT 541 TACATAATTA TGTATTTTAC CCATTGGTTT TTCTCTATCG GGAGATTGTT TTTAAGGAAA 601 AGAACACGAT TTGTTGTAAC AATTTACGCA AGCTATATTT GCAGAACATG GTCAGTCATT 661 TATGATGACG TGCTTAATTA TTCTCAACAA AAAA Predicted gene structure (within gDNA segment 41885 to 52440): Exon 1 42485 42630 ( 146 n); cDNA 1 146 ( 146 n); score: 1.000 Intron 1 42631 45015 (2385 n); Pd: 0.956 (s: 1.00), Pa: 0.995 (s: 1.00) Exon 2 45016 45159 ( 144 n); cDNA 147 290 ( 144 n); score: 1.000 Intron 2 45160 51381 (6222 n); Pd: 0.994 (s: 1.00), Pa: 0.815 (s: 0.98) Exon 3 51382 51780 ( 399 n); cDNA 291 689 ( 399 n); score: 0.997 MATCH C01HBa0088L02.1+ SGN-E357930+ 0.999 689 0.993 C PGS_C01HBa0088L02.1+_SGN-E357930+ (42485 42630,45016 45159,51382 51780) Alignment (genomic DNA sequence = upper lines): AGGAACATCT CATGGCAGCA TTTCAGTATT TTGACAAGGA TGGAAGTGGT TATATTACAG 42544 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGGAACATCT CATGGCAGCA TTTCAGTATT TTGACAAGGA TGGAAGTGGT TATATTACAG 60 TAGATGAGCT CCAGCAGGCC TGTGCAGATC ATAACATTAC AGATGTATTC TTTGAGGATA 42604 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAGATGAGCT CCAGCAGGCC TGTGCAGATC ATAACATTAC AGATGTATTC TTTGAGGATA 120 TTATCAGAGA AGTTGATCAG GATAACGTAA GTTAATTATA TTGAGGATAA AGTTGAAGTA 42664 |||||||||| |||||||||| |||||| TTATCAGAGA AGTTGATCAG GATAAC.... .......... .......... .......... 146 TTATTGGAAC TTATCAATAA AAAAGTGGAC ACAAATTAGT AGATTAAATT TCTTCATGTT 42724 .......... .......... .......... .......... .......... .......... 146 TTGCAGTTCT ACTGATTTAT CTCTCTACTA CTCATAATTT TTTTGCAACA AAAACTATTT 42784 .......... .......... .......... .......... .......... .......... 146 TTTTTTATAA AAAAGCACTT TAATATGAAA CACTTTTTGT GCAACAAAAA CGAAAATTAA 42844 .......... .......... .......... .......... .......... .......... 146 AAAAATATAG CACTTTAAGA TTTCATATGA ATCTTTTCCT TGAGATAAAA TGTTATTGAC 42904 .......... .......... .......... .......... .......... .......... 146 AATGTAGTGT ATGTATGGAA AATACGGATA TTACTAAATG ATCATATGTG AGCTTAATAA 42964 .......... .......... .......... .......... .......... .......... 146 TATAGTTAAT TTACCTCTCT CTCTCTATAT ATATAAAGAG AACCCTAGGC TGCCTAAGTG 43024 .......... .......... .......... .......... .......... .......... 146 GCGCCACCAC AAATCAGGAT TCCCTTTTAA TTTATTTATT TCCAAAATTA GCCTTCCCTT 43084 .......... .......... .......... .......... .......... .......... 146 TCATCAAAAG TTGTGACTTA TGAAACTTTG CGACTTTTAC AAAGAGTTGT AACTTTTATG 43144 .......... .......... .......... .......... .......... .......... 146 AAAGTTGTAA CTTTTATGAA AGTTGTAACT TTTATGTAGA GTTGTGACTT TTCCAAAGGA 43204 .......... .......... .......... .......... .......... .......... 146 TTATTACATT TCCGATAAGA CACCATAACC ATTTATTCAC ACTATCCTTT TGTTGTCTAT 43264 .......... .......... .......... .......... .......... .......... 146 AAATAGAGGA ATTTTCTTTC ATTTTAAAAC GACGAAAATT CTAAATTTTT TCTTCTGCTT 43324 .......... .......... .......... .......... .......... .......... 146 ATGCACAATT AAATATTTGT GTACTTTGCT CCTGTTGAGT GGTTCACTGA CATCATTGTT 43384 .......... .......... .......... .......... .......... .......... 146 TTTGAATCTA TACAACGGTG AATATAATCG TTCTATCCTA AAAGTATCTA TTCATTCTTT 43444 .......... .......... .......... .......... .......... .......... 146 TGTTACAAAT CTTGGTATGT TTTTTACGCT CATTTATGCT TATGTTATTA GTTGTTTTTG 43504 .......... .......... .......... .......... .......... .......... 146 AGTACATGTT TTAAACTTTG TTGTTTATGT TTATGTTTAT GTTGAAATAA AGATATGTTA 43564 .......... .......... .......... .......... .......... .......... 146 ATCAAGAATT TGATGTAGTG ATGTCATGTA GATTAAAATT CTTGAACTTA TAAAATAAAT 43624 .......... .......... .......... .......... .......... .......... 146 GACTTTGATC TTTATAGAGT TTTAGTGGCT AAAAGATTCA TGGGATGTTC AAGAAGAAAC 43684 .......... .......... .......... .......... .......... .......... 146 TTTTGAGTGT TCAAAAGTTA TGGTGGTTCT ACTCTACCAT GGAGTTTAGT TATTCAACTT 43744 .......... .......... .......... .......... .......... .......... 146 TCTATCTTAT CTAGACATTC AATCGATTAG TGACATTCAA AAAATAAAGG AAAATGTAGC 43804 .......... .......... .......... .......... .......... .......... 146 GGGATGGTAA GTATTATACT CAACCTTAAT TAAAAGTTTG GGATTCAAAT ATTTGATTGG 43864 .......... .......... .......... .......... .......... .......... 146 AGTCAATGAA TTACCCCCTT AGGATGAATC TACATTAATC AATTATTAAA GAAATAATTA 43924 .......... .......... .......... .......... .......... .......... 146 TCTCCTTATA AACATTAGAT TAAAAGTTGC AAAAAGATTA AAGCTTTAAC CATATTGATC 43984 .......... .......... .......... .......... .......... .......... 146 GGAACATAAA CAACAAAATA TGCATTTTGG GTATCAAAGT AGTGTCATAC ATAATGATTT 44044 .......... .......... .......... .......... .......... .......... 146 GAATAAGGGT CTTGCCAAGA CATCATTTAA TCCGAATTAT TTGAGTGACT TGCCTTATTT 44104 .......... .......... .......... .......... .......... .......... 146 CATTGAAATT CCAAGAGATG TTTTTTAAAA TTTTAATTAA CTTATCAAGC ACACAACTAA 44164 .......... .......... .......... .......... .......... .......... 146 TTATATAAAA TGTATAATAT TTAGATTTTG TATGTAGAGG GAGGCCTTGA ATAAGAGAAG 44224 .......... .......... .......... .......... .......... .......... 146 AACTCTCGCA ATTGATGAAT AAAATGTTTG TACCACTTTT GGAAAATACA AATATAGACA 44284 .......... .......... .......... .......... .......... .......... 146 ATGAAACAAT TACCTATCTT TTCTAAAGAT TTGGTGATGA ATAACTACAG TAAAATGAAG 44344 .......... .......... .......... .......... .......... .......... 146 AATCAATAAC TAAATCCATA AACACGTAGA ATCAAATCGT TTTAAGTTTA AAAAAATATT 44404 .......... .......... .......... .......... .......... .......... 146 TTATTTTGTC TTTGGATAAA ATATTCTTGA CAATTTATTG TTGGGTTGTA CCCATTCGAA 44464 .......... .......... .......... .......... .......... .......... 146 AACACTTATA TTATCAAATG TTCAGAAGTA GATTATTACC GTAGTTTACC ACCGCGCGAA 44524 .......... .......... .......... .......... .......... .......... 146 AAGCATGCAA TTTACCTTGT TAAATTACAA GTGCTCAGAT GCAATGATAT GCTTTGAAAA 44584 .......... .......... .......... .......... .......... .......... 146 TTATTTTTGA AGAACTTCTC GTAGTTCTGT TTGGTCTGAC TGCATTCGTG CCAGCTACTC 44644 .......... .......... .......... .......... .......... .......... 146 ACTTTTTGGC GTCACTTCAT AATCTAAGTA GTTTTGTGTA TTCAAAGGCA TAATGAGAAG 44704 .......... .......... .......... .......... .......... .......... 146 ACAAAGCTGA CATAATTGTC CAAAGAAAAG AAAAAAGACA AAGAAATTGT AGCATAATAA 44764 .......... .......... .......... .......... .......... .......... 146 ACAGGAATGG GTACCGTTAC AGACATTTCT GTCTTTCTTC AAATCAAACA AAATTTGTTG 44824 .......... .......... .......... .......... .......... .......... 146 TATTTTGATT AGTTTTCTGG AGCCTCAGTA TTGGATTAGG GCCTCAGCTG CAGCCGTGAT 44884 .......... .......... .......... .......... .......... .......... 146 ACAGGCAAAT TGTTATGCTT TAGGAGATCT GTATTTTAAA TGGATGGAAT GATTCTTTTG 44944 .......... .......... .......... .......... .......... .......... 146 GAATCTCTAC ATCTCTTGAT GCTTCATTTG ACTAGCTATT TAGTTGATCT TCTGGTGGAT 45004 .......... .......... .......... .......... .......... .......... 146 TCCCTTTTCA GGATGGACGT ATTGATTATG GAGAATTTGT TGCTATGATG CAAAAAGGAA 45064 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .......... .GATGGACGT ATTGATTATG GAGAATTTGT TGCTATGATG CAAAAAGGAA 195 ATCCATGCAT AGGAAGACGA ACAATGCGAA ATAGTCTGAA TTTCAGCATG AGAGATGCGC 45124 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCCATGCAT AGGAAGACGA ACAATGCGAA ATAGTCTGAA TTTCAGCATG AGAGATGCGC 255 CCGGAGCTCA TTAGCTTTTT GAATGGACAC ATGATGTAGG TATTTCCCCT TTTTTATTTT 45184 |||||||||| |||||||||| |||||||||| ||||| CCGGAGCTCA TTAGCTTTTT GAATGGACAC ATGAT..... .......... .......... 290 TGTAACCGTT TCTTTGGCAA TGAATTTGAA GAAATCTTTC CTTGTTCTGT CCTTGAGAAA 45244 .......... .......... .......... .......... .......... .......... 290 TTGGATTGGT TGGAGTATAT TTGTTTAACA TTAAGAGTTT CTTTTTCCCT CTTGAGGATA 45304 .......... .......... .......... .......... .......... .......... 290 ATAAAATTTT ATAAATAACA GCATGAGTGT TTGCTGTAAA ACTCTACAGG TGCAGCAAAA 45364 .......... .......... .......... .......... .......... .......... 290 AAAATTACAT TCAGCAAAAG TATATCCCAT CTTATCCTGT TGGTACACTA GCATGTCACA 45424 .......... .......... .......... .......... .......... .......... 290 GATAGATTCA GCTTCCTCCC CAATCCTCCA TTTTACACCA TTAACAAAAA TAAATTTCAG 45484 .......... .......... .......... .......... .......... .......... 290 ATACAGAGTT CTCTTTCATT CCCATCTTTT ATATAATGCT GGTTTCTTTT CTTTTGGTAA 45544 .......... .......... .......... .......... .......... .......... 290 AATTTTGATG TATCAAATTT GACGATTGTC CGACATGGCT ATGTGAGGAA CTTTCCTAAG 45604 .......... .......... .......... .......... .......... .......... 290 GGAGCACTAA GGGTGTCAAA TGTGTGGGTG GAGGCAGTGG GGGACTGAAA TTGAAGAGGT 45664 .......... .......... .......... .......... .......... .......... 290 TAAAATGGGC TGAGCTAAAA GTCATGTTGG ATCATAACCC ACTCAAACTT ACTTTGGGCT 45724 .......... .......... .......... .......... .......... .......... 290 AACATGGGCT AGAATCTTGA TTGGGTTATG ACCTATCCAA TTTGACCTGC TTAATCTAAA 45784 .......... .......... .......... .......... .......... .......... 290 CTAAACTATA TTAAACACTT GCTATAATTT ATGACAGATG TCATTCAACC CATAGAATCG 45844 .......... .......... .......... .......... .......... .......... 290 TACAGATCTG TACTAACTTT TCATTTAGGA GCATCTCCTT GTAGAGTAAA TTGATGTAGA 45904 .......... .......... .......... .......... .......... .......... 290 CTTTATAGTA TGGGACCAAC TTCATAATTT TGCAACTCAT TTAATAGTGT ATTTATGAGA 45964 .......... .......... .......... .......... .......... .......... 290 ATTATTGAAA AGAATATTAT TGAATTGTGT GTCTACATTA TTACATTGAG ACTTTATTTA 46024 .......... .......... .......... .......... .......... .......... 290 TAGACACTAT ATTATACTCC TTTTCCAACT AGGACACTAC AATACCATCC TTTTCTAAGT 46084 .......... .......... .......... .......... .......... .......... 290 AGGATTCTAT ATACTATTTC TATTCCTATT CCTATTCTAA GTAGAATGGT ATATATTATT 46144 .......... .......... .......... .......... .......... .......... 290 CTTGTTCCTT TTTTGATTCT AACACTCCCC CTCAAGCTGG TGCATACAAG TTATATATAC 46204 .......... .......... .......... .......... .......... .......... 290 TTTGCTTGTT ACAAATGTAA TTAATATGAG GACCAATGAG AGGCTTGATG AAGATATCTG 46264 .......... .......... .......... .......... .......... .......... 290 CAAGTTGATC ACTTGACTCA CAAATTTTGT AACAATATCT CCCGACTTCC CAGACCAAGC 46324 .......... .......... .......... .......... .......... .......... 290 TTGAGAAGAA CGTTTCATAT CATCGAGTGA CTTGCACAAT CAACATATAA GGCTGCTAGA 46384 .......... .......... .......... .......... .......... .......... 290 CTCCCTCGGA GCAATAAGAC CAAGTGGTTG CTCCATATAT ACTTCTCCAT CGAGATCCCA 46444 .......... .......... .......... .......... .......... .......... 290 GCCCAAATAT GTAAGTATAT CCTTTTGGAT AAAGTGAATC TAAAACAAAG AGAATATTGC 46504 .......... .......... .......... .......... .......... .......... 290 TTGAAAACTT GGATTTTTTT GGGAACTCGG ATATGTTGGA CTTTGCACAA CATTGACAAA 46564 .......... .......... .......... .......... .......... .......... 290 GTTGAAACTA TTTAAATCAG ACCTAAGGAG TCACCGAAAA GACGTACGGT GCTTCGAAAA 46624 .......... .......... .......... .......... .......... .......... 290 TTAGATATGA GAAAGTAGTC ACCAAAAAGA CGCATGATGT TGTGCAAATT AGATATGAGA 46684 .......... .......... .......... .......... .......... .......... 290 AAGTAGTCAC CAAGAAGATG AGACAGTGCT ACATAAATTA AATATGAAAA AGTAGTCACT 46744 .......... .......... .......... .......... .......... .......... 290 GATAAGATGG CACGGTGCTA CACAAATTAA ATATGAAAAA GTAGTCATCA AAAAGATGGT 46804 .......... .......... .......... .......... .......... .......... 290 GCGATGCTAC ACAAAAGTAA ATAGTCACCG GAATGATGAC ATGATGCTAC AAAAATGAAA 46864 .......... .......... .......... .......... .......... .......... 290 TATGAGAGTA GTCACCTGAA GGATGACACA GTGCCACATA AATTGAACAT AAAAAAATAG 46924 .......... .......... .......... .......... .......... .......... 290 TCACCAGAAA CATGATGCGG TGCTACACAA ATTAAGAGCC TGTTTGGCTC AGCTTAAAAG 46984 .......... .......... .......... .......... .......... .......... 290 CTGGTCAAAC TGACTTAAAA TCTGATTTTT GACTTATTTA ACTGTTTGAC AATACTCAAA 47044 .......... .......... .......... .......... .......... .......... 290 ATAGCTTATT TTAAGTTAAA AAAAACTTAT TTTAAGCCAA AAGTTAAAAG GTGGGGTAGG 47104 .......... .......... .......... .......... .......... .......... 290 GGTGCTTTTT TTTTTTAGCT TATAAGCTGT TTTAAGTTGA CCATATTTTT ATGTTTTTTC 47164 .......... .......... .......... .......... .......... .......... 290 CCTTAATATT TTTATACAAT CTCCAAATTA TCCATATAAC CCTAACATCT CTTTCTTCTA 47224 .......... .......... .......... .......... .......... .......... 290 TTTTTCCCTT TTCACGTTTG GCATAACAAC TTCAGCACTT TTATCCAAAC GCATAACTGC 47284 .......... .......... .......... .......... .......... .......... 290 TTATTTTAAA AATAAGTTTC AGCACTTTCA AAAGTACTTT TTTAAAGCTG CTTTTATTAA 47344 .......... .......... .......... .......... .......... .......... 290 GCCCATCCAA ACGGGCTCTA AATATATAAA TAATAGTCAC CGGAAGATGA CACACTGCTA 47404 .......... .......... .......... .......... .......... .......... 290 CAAATCAAAT TTAAGAAAGT AGTCACCGAA ATGATAGCAC AGTGCCACAC AAATTAGATA 47464 .......... .......... .......... .......... .......... .......... 290 TGAGAAAGTA GTCGCCATGA CAACCCTAGA AAGTCGTGCA TATATCAGTG ACCCTAATTT 47524 .......... .......... .......... .......... .......... .......... 290 GGTTAACATT ACCAATGGCA AGAGGGGAGA TAGATATGAG TCATAGCCGC CCTACACCGA 47584 .......... .......... .......... .......... .......... .......... 290 CGAAATCTTT TTTTGATTTT CTACCGAGAT CGTAGGAGCT TTGATACCAT GTGGAAATAT 47644 .......... .......... .......... .......... .......... .......... 290 TGAAAAAGAA CATTGTTGAA TTGGTCTCTA GATTATAACA TCGAGACCTA TTAATAGGGC 47704 .......... .......... .......... .......... .......... .......... 290 ACTACCTTAG ACTCAAATTC CAACTAGGAC ACTACCATAC AATCCTATTC TAAGTAGTAT 47764 .......... .......... .......... .......... .......... .......... 290 TTTATGTACT ATTTTTATTC CTATTACTAG TATTTTATGT ACTATTTTTA TTCCTGTTAC 47824 .......... .......... .......... .......... .......... .......... 290 TATTCTAAGT ATGATGGTAT ATATTATTCT TGTTCATATT CCTATTCAAA CAGTAATAAT 47884 .......... .......... .......... .......... .......... .......... 290 TTGACATATA GAATGTAGGC AATTATTTTT TAATATGACA TGGCATGCAA AATAATGTGT 47944 .......... .......... .......... .......... .......... .......... 290 TGTTAAAGAA TCAAATAACA ATAATCAAGT GACTTTAGAA TTCCAAAAGA GAGACCATGA 48004 .......... .......... .......... .......... .......... .......... 290 TAGATCATTA TCATATTAGG TAATAAAAAA TAAGGATTCG GTAACAAAAT GCAAGAAGGT 48064 .......... .......... .......... .......... .......... .......... 290 GAAATGAATT TTTAAGATAT TTCAGTTTGC CAAAAATAAG CATATTAGGT TAGTATATGA 48124 .......... .......... .......... .......... .......... .......... 290 GGAAAAAAAA CAGTTTTATT CGAATTGGTT AAACTCAGTT CTCATTTTCA TATCAAGTGA 48184 .......... .......... .......... .......... .......... .......... 290 AAAGGTCAAT ATAAACTAAA GAGATGATGA TTGTCCCATC TTTGCACATG TAGTCCGGTT 48244 .......... .......... .......... .......... .......... .......... 290 AGAATGGGGA TTGAATTGAC ATAGAACTTG GGCTAAGTGG GTTATAATTA TACGGGTTAA 48304 .......... .......... .......... .......... .......... .......... 290 GACGTAGCAC ATTATTAAAT TATCATGAGC TCAACCCATA AATTTTGGGC TCCTAATATC 48364 .......... .......... .......... .......... .......... .......... 290 TGAGCTTCAT TTGACACCCC AAGTAAGGAG TGCCACGCAC GAGCATGGCA AAAAGCAAGG 48424 .......... .......... .......... .......... .......... .......... 290 GGAACTTTTC TTTTTGGGAG AAATCATTTG ATTGCATATT GAATACATAA AGCACATTCC 48484 .......... .......... .......... .......... .......... .......... 290 AACAAATTCA AATTTTAGAA GTTTCATATG GTGACTACAT TTTAGCTTCC CGTCAATTAC 48544 .......... .......... .......... .......... .......... .......... 290 CCCAACCTTC TTCATTTATC CAGATGTGGG ACGGACACGG TGAAGCTCAC ATAGATTGAG 48604 .......... .......... .......... .......... .......... .......... 290 TTAGGTAAAA TATTTATCTG TGGAGAAAAA TATTACCCCC TGTTCCATTT TGTGTGACAA 48664 .......... .......... .......... .......... .......... .......... 290 GTTGAAAAAT ATGTGTGGTT AAATTGACTA ATTTTCTGAG TGAATTTGAA CATTGATATT 48724 .......... .......... .......... .......... .......... .......... 290 CATTTTCTAA AAATAAAGTT TTACATCTTT AAAAACTATA TAAAAAGTAT TGTAAGTCAC 48784 .......... .......... .......... .......... .......... .......... 290 AATAGTTTAC AATTCAAAAT ATTAAAGAAG TATTTTAAAA AAAACATGGT CAAAGAAAAA 48844 .......... .......... .......... .......... .......... .......... 290 CTTATTTTAC ACTCCAGATA GTTATAGGTT ACATAAAGTG GAGCAAAGTA CTCTTATCAA 48904 .......... .......... .......... .......... .......... .......... 290 TACTCTTAAC CATAGGTCTG GAATTCGAGT ACCCATAGAA TAGAGTTCCT TTTGTTAGGG 48964 .......... .......... .......... .......... .......... .......... 290 AGCGGGTGGG AACCAAAAAA AAAAGTGGAA CAAAGGGAGT ACTAAAGTAT ACTTATGGAA 49024 .......... .......... .......... .......... .......... .......... 290 GTTAATATAA AATCTGAAGA TAAGCGTTAA AAACATACCT AAACTATCCT TTTTTTTTTA 49084 .......... .......... .......... .......... .......... .......... 290 GTTTCATACT TGAAGTATTG AGTGTGAGTT TTCTACCTAA ACTATCACTT ATTAATTTGA 49144 .......... .......... .......... .......... .......... .......... 290 GAAACACATC TTTCTTTTAT TATACTCTAT CATGGTGTGT AATACACTCC TTTTATTTAA 49204 .......... .......... .......... .......... .......... .......... 290 AAATTGTTAT ATTACAATCC ACATGGACAA AACGTTTCAC CTTGACAAAA AATAAATAAT 49264 .......... .......... .......... .......... .......... .......... 290 TAGTATTAGT TAAAGTTAAG TATTAAAGTA TTGCTATCCC CCCCCCCTCC CCCAAAAAAA 49324 .......... .......... .......... .......... .......... .......... 290 AAATTATAAA ATAAAATGTA AAATATTTTT TTTACCCAAC TCCAATCTTT CCTCTCAACG 49384 .......... .......... .......... .......... .......... .......... 290 TACTCCCCCA TCCCAAATTT TTAGTTTATT TTGTTCAAAA AAAATAAATC CCTTCGAATA 49444 .......... .......... .......... .......... .......... .......... 290 ATAATTTAGA TATAGTTAAA TTTATTTTAT TTCTTGAAAA AAAATTCTAC CCTAACATAA 49504 .......... .......... .......... .......... .......... .......... 290 CTCCCCTCTT CCATTTTTTT TCTCGTTTTG TATTAGATAT GTATTTTCTT TTCTAAAAAA 49564 .......... .......... .......... .......... .......... .......... 290 GTATTTTTTA ACTTGCCGCA AGACTTTTCA TAAAATAAAA CTTTTATTTC TGTTAATTTG 49624 .......... .......... .......... .......... .......... .......... 290 GTATGCAAGT AGAAAAGAAT GTTTTCCTAA AAATATATGT ACACATCTAA CACAAAACTA 49684 .......... .......... .......... .......... .......... .......... 290 GAAAAATGTA TAAAATTAAA TTAGGAGCGG AGGGTTAGAT GGGGTGGGGT AGAATATTAT 49744 .......... .......... .......... .......... .......... .......... 290 TTTATTTTAC TTTTTTTTTA AAAAATAATA TCAAAATTAT TTTTAGGAAG GAGTGGGGGA 49804 .......... .......... .......... .......... .......... .......... 290 GGGGGTGACG CCTAAATTTC AAAAAATAAT TTTAGAAATA ATAGGACGTG GGGTTGTCCG 49864 .......... .......... .......... .......... .......... .......... 290 GGGATGAGGG TTGAGATGAT GGAGTGGGGT AAGAAATATT TTAATTTTTT AAAAAATGGT 49924 .......... .......... .......... .......... .......... .......... 290 AATACTTTAA TCTTTAGTTT TTAGCTAATA TTAATAGTTT TTTAATTTTT GTCAAGTTGG 49984 .......... .......... .......... .......... .......... .......... 290 AATAATTTAT CCATGTGCAA TGCCATGAGG CAAGGTTTTT GCAAATAAAT GAGAAAAGTG 50044 .......... .......... .......... .......... .......... .......... 290 TATTAGACAC CACTGAGGTG TGTTTTTCAA ACTAATAAGT GATAGTTTAG GTATGAAAAT 50104 .......... .......... .......... .......... .......... .......... 290 TCAAAAAAAA AAAAGAAAAG AAATAGTTTA GGTGTGTTTT GACACTTATG TCTAATCTGA 50164 .......... .......... .......... .......... .......... .......... 290 AAGATATTAT TAGTTGTACA AGTGTGAAAA AACACCCCAG GATGTTCCCA AGTGAACAAA 50224 .......... .......... .......... .......... .......... .......... 290 TAGAAAGTGG GGTCGAAATG GGAAATATAC CATCAGTTGT CAATGAAGTT GAAATAAAAT 50284 .......... .......... .......... .......... .......... .......... 290 CATGAGAGAG TTCCAATCCT AGTAGAAGCA AAAAGAAATT AGCCGATTTC TTCCAATATG 50344 .......... .......... .......... .......... .......... .......... 290 TCTTAAGTTT CAGCTGTCAA GATTACTGCC TGGTACCTTT GGGTGGAGGA TACATGCACC 50404 .......... .......... .......... .......... .......... .......... 290 TAGTGGAATA GTCAAGATAC ATGCATGTTG GGTTGAAGGC ACCTTAGTCT TATAGAATTG 50464 .......... .......... .......... .......... .......... .......... 290 TCAAATCAGA ATATTTAGTA TGATGTATCA TGTGTTCTTG AACACTCGTA GAACTAATTC 50524 .......... .......... .......... .......... .......... .......... 290 TGTTTTCCAA CCATTAGTTG ACTCTATCAA AAGAATATCA AGTTGAAGCT AGTTGAGATG 50584 .......... .......... .......... .......... .......... .......... 290 TAGGTAGAAT ATCTATTAAC CAACTTATCT CCATGTAGTT CTATTCAGTT CCATTTCATC 50644 .......... .......... .......... .......... .......... .......... 290 CAATATTGTA TAATTTACCT TAAAACTACA AGTCCGATGT GTTCCACACT TTCAGGAATA 50704 .......... .......... .......... .......... .......... .......... 290 TAAAAGTCTA ACACTGTGCC TATTATCAGC TAACAAGTAA CAACTCTCTA TTTCAAATAG 50764 .......... .......... .......... .......... .......... .......... 290 CTGGCATTGC CTACATGGAT CATTTACTTT TGTTAGGTTA CGGTCTTAGT TAAGTTCTAC 50824 .......... .......... .......... .......... .......... .......... 290 CAGAGATATT GCACGTCCTT TAGGATAACT CATCTCCTTG TGATTTTAGG TGTACTTTGC 50884 .......... .......... .......... .......... .......... .......... 290 TTATTTGAAA TGATGCAAGG TTTTATTACT TTTTTTTTCT AAGAGATTTT CATTGTATAT 50944 .......... .......... .......... .......... .......... .......... 290 GTATCCACCA AAAGAATAAT ACGAAGAAAA AAAATGAGAG AGGAAGAAAC AGATCTGCTT 51004 .......... .......... .......... .......... .......... .......... 290 CCAAGTTGTG ACATAATTTT ATCGAAAAGA AAAAGAATAT TCAGAGGCCC AGGTGCCACT 51064 .......... .......... .......... .......... .......... .......... 290 GAGTTAACTC GCCATTCTTC TCTTCTTTAG ACAAGCCTGA TAAGGAAAGC TGATTCTTAA 51124 .......... .......... .......... .......... .......... .......... 290 CAATGTGTTG GGCATCAAAG GTTTTCTTTT GTTCTCCTTC AAAATGCACA TAGGTAAGGT 51184 .......... .......... .......... .......... .......... .......... 290 ACTTATTCAT AGTACAATTA TTTGGCATAT ATTGTAGTTA CACACGTGCT TGTGTACTTG 51244 .......... .......... .......... .......... .......... .......... 290 TTCTACTAAA ATGTTGTTAT GACTTTGTAA GCTAGGTTAA ATATCACAGA ACATGGTGCA 51304 .......... .......... .......... .......... .......... .......... 290 TCTTTCATTT GGAGCATGAA CTTGTGTTTC ACTCTTGGTC AAGTTATGTG TAAAAGGTAT 51364 .......... .......... .......... .......... .......... .......... 290 TCTGACATTC ATGTCAGCTA GTTTGCAGGT TTTTACAGAT AATAGAGCAG AGGCAATGAA 51424 || |||||||||| |||||||||| |||||||||| |||||||||| .......... .......GTA GTTTGCAGGT TTTTACAGAT AATAGAGCAG AGGCAATGAA 333 ACTGCCGTAA CAATGTCTGG TACTCTTTTC TAAAAGTAGT ATGCCATGCT CTCAAGTATA 51484 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACTGCCGTAA CAATGTCTGG TACTCTTTTC TAAAAGTAGT ATGCCATGCT CTCAAGTATA 393 ACTAGAAGTG CTTGTAGACT GTGCCTCAAC AAAATGTGAA ATCTCTGTCG TGTGTGAAAT 51544 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACTAGAAGTG CTTGTAGACT GTGCCTCAAC AAAATGTGAA ATCTCTGTCG TGTGTGAAAT 453 CATTTCAGCT ACCTAGTGTT CTTTAGTTGA GGCTTCATGC TTGCTTCAGT TAGAAGGTGG 51604 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CATTTCAGCT ACCTAGTGTT CTTTAGTTGA GGCTTCATGC TTGCTTCAGT TAGAAGGTGG 513 TTCACCTTGA GGTGTATCCT TGTCAATTAC ATAATTATGT ATTTTACCCA TTGGTTTTTC 51664 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTCACCTTGA GGTGTATCCT TGTCAATTAC ATAATTATGT ATTTTACCCA TTGGTTTTTC 573 TCTATCGGGA GATTGTTTTT AAGGAAAAGA ACACGATTTG TTGTAACAAT TTACGCAAGC 51724 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCTATCGGGA GATTGTTTTT AAGGAAAAGA ACACGATTTG TTGTAACAAT TTACGCAAGC 633 TATATTTGCA GAACATGGTC AGTCATTTAT GATGACGTGC TTAATTATTC TCAACA 51780 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| TATATTTGCA GAACATGGTC AGTCATTTAT GATGACGTGC TTAATTATTC TCAACA 689 hqPGS_C01HBa0088L02.1+_SGN-E357930+ (42485 42630,45016 45159,51382 51780) ******************************************************************************** EST sequence 89 +strand 430 n (File: SGN-E240526+) 1 ACAAGTCAAC TTTGTTTGAT TAGTAGGATT ATTTCGTTAC TTTGTATCGA GTAAATCTTA 61 ATTCATTGTA CTATACTGAA CTTGTAAAAC TATTGAACTG GTATTTTATC CTCCGTCTTG 121 GGCGTGGTGA AGCAAATGAT CAGTGAGATT GACCACCATC AGTATAGTCA GAGTGTGTAA 181 TTGTGGACAA GGCCATTGAC CCATGATGAC AGCCCACAAA ATAATGCAAT ATCAGACTAA 241 ATTGTTAGGA GTTGGCCCAG TTCTGGAGAA ACACATGCAG GATGATAGCA ATGGGACCAA 301 GAGGTAAAAA ACTTCTAGTT GGCTACAAAA ACAGAATTAA GAGCTTGTTT GGCTCAGCTT 361 AAAAGCTGGT CAAACTGACT TAAAAGCTGG TTTTTAACTT ATTTAACTGT TTGACAATAC 421 TTAAAATAGC Predicted gene structure (within gDNA segment 42915 to 47740): Exon 1 44839 44845 ( 7 n); cDNA 261 267 ( 7 n); score: 1.000 Intron 1 44846 45061 ( 216 n); Pd: 0.000 (s: 0), Pa: 0.113 (s: 0) Exon 2 45062 45094 ( 33 n); cDNA 268 297 ( 30 n); score: 0.697 Intron 2 45095 45353 ( 259 n); Pd: 0.000 (s: 0), Pa: 0.904 (s: 0) Exon 3 45354 45383 ( 30 n); cDNA 298 327 ( 30 n); score: 0.533 Intron 3 45384 46947 (1564 n); Pd: 0.171 (s: 0), Pa: 0.000 (s: 0.89) Exon 4 46948 47049 ( 102 n); cDNA 328 430 ( 103 n); score: 0.907 MATCH C01HBa0088L02.1+ SGN-E240526+ 0.907 172 0.400 C PGS_C01HBa0088L02.1+_SGN-E240526+ (44839 44845,45062 45094,45354 45383,46948 47049) Alignment (genomic DNA sequence = upper lines): TTCTGGAGCC TCAGTATTGG ATTAGGGCCT CAGCTGCAGC CGTGATACAG GCAAATTGTT 44898 ||||||| TTCTGGA... .......... .......... .......... .......... .......... 267 ATGCTTTAGG AGATCTGTAT TTTAAATGGA TGGAATGATT CTTTTGGAAT CTCTACATCT 44958 .......... .......... .......... .......... .......... .......... 267 CTTGATGCTT CATTTGACTA GCTATTTAGT TGATCTTCTG GTGGATTCCC TTTTCAGGAT 45018 .......... .......... .......... .......... .......... .......... 267 GGACGTATTG ATTATGGAGA ATTTGTTGCT ATGATGCAAA AAGGAAATCC ATGCATAGGA 45078 |||| | |||| |||| .......... .......... .......... .......... ...GAAACAC ATGC--AGGA 282 AGACGAACAA TGCGAAATAG TCTGAATTTC AGCATGAGAG ATGCGCCCGG AGCTCATTAG 45138 || | ||| || || TGA-TAGCAA TGGGAC.... .......... .......... .......... .......... 297 CTTTTTGAAT GGACACATGA TGTAGGTATT TCCCCTTTTT TATTTTTGTA ACCGTTTCTT 45198 .......... .......... .......... .......... .......... .......... 297 TGGCAATGAA TTTGAAGAAA TCTTTCCTTG TTCTGTCCTT GAGAAATTGG ATTGGTTGGA 45258 .......... .......... .......... .......... .......... .......... 297 GTATATTTGT TTAACATTAA GAGTTTCTTT TTCCCTCTTG AGGATAATAA AATTTTATAA 45318 .......... .......... .......... .......... .......... .......... 297 ATAACAGCAT GAGTGTTTGC TGTAAAACTC TACAGGTGCA GCAAAAAAAA TTACATTCAG 45378 | | |||||| || | | | .......... .......... .......... .....CAAGA GGTAAAAAAC TTCTAGTTGG 322 CAAAAGTATA TCCCATCTTA TCCTGTTGGT ACACTAGCAT GTCACAGATA GATTCAGCTT 45438 | | | CTACA..... .......... .......... .......... .......... .......... 327 CCTCCCCAAT CCTCCATTTT ACACCATTAA CAAAAATAAA TTTCAGATAC AGAGTTCTCT 45498 .......... .......... .......... .......... .......... .......... 327 TTCATTCCCA TCTTTTATAT AATGCTGGTT TCTTTTCTTT TGGTAAAATT TTGATGTATC 45558 .......... .......... .......... .......... .......... .......... 327 AAATTTGACG ATTGTCCGAC ATGGCTATGT GAGGAACTTT CCTAAGGGAG CACTAAGGGT 45618 .......... .......... .......... .......... .......... .......... 327 GTCAAATGTG TGGGTGGAGG CAGTGGGGGA CTGAAATTGA AGAGGTTAAA ATGGGCTGAG 45678 .......... .......... .......... .......... .......... .......... 327 CTAAAAGTCA TGTTGGATCA TAACCCACTC AAACTTACTT TGGGCTAACA TGGGCTAGAA 45738 .......... .......... .......... .......... .......... .......... 327 TCTTGATTGG GTTATGACCT ATCCAATTTG ACCTGCTTAA TCTAAACTAA ACTATATTAA 45798 .......... .......... .......... .......... .......... .......... 327 ACACTTGCTA TAATTTATGA CAGATGTCAT TCAACCCATA GAATCGTACA GATCTGTACT 45858 .......... .......... .......... .......... .......... .......... 327 AACTTTTCAT TTAGGAGCAT CTCCTTGTAG AGTAAATTGA TGTAGACTTT ATAGTATGGG 45918 .......... .......... .......... .......... .......... .......... 327 ACCAACTTCA TAATTTTGCA ACTCATTTAA TAGTGTATTT ATGAGAATTA TTGAAAAGAA 45978 .......... .......... .......... .......... .......... .......... 327 TATTATTGAA TTGTGTGTCT ACATTATTAC ATTGAGACTT TATTTATAGA CACTATATTA 46038 .......... .......... .......... .......... .......... .......... 327 TACTCCTTTT CCAACTAGGA CACTACAATA CCATCCTTTT CTAAGTAGGA TTCTATATAC 46098 .......... .......... .......... .......... .......... .......... 327 TATTTCTATT CCTATTCCTA TTCTAAGTAG AATGGTATAT ATTATTCTTG TTCCTTTTTT 46158 .......... .......... .......... .......... .......... .......... 327 GATTCTAACA CTCCCCCTCA AGCTGGTGCA TACAAGTTAT ATATACTTTG CTTGTTACAA 46218 .......... .......... .......... .......... .......... .......... 327 ATGTAATTAA TATGAGGACC AATGAGAGGC TTGATGAAGA TATCTGCAAG TTGATCACTT 46278 .......... .......... .......... .......... .......... .......... 327 GACTCACAAA TTTTGTAACA ATATCTCCCG ACTTCCCAGA CCAAGCTTGA GAAGAACGTT 46338 .......... .......... .......... .......... .......... .......... 327 TCATATCATC GAGTGACTTG CACAATCAAC ATATAAGGCT GCTAGACTCC CTCGGAGCAA 46398 .......... .......... .......... .......... .......... .......... 327 TAAGACCAAG TGGTTGCTCC ATATATACTT CTCCATCGAG ATCCCAGCCC AAATATGTAA 46458 .......... .......... .......... .......... .......... .......... 327 GTATATCCTT TTGGATAAAG TGAATCTAAA ACAAAGAGAA TATTGCTTGA AAACTTGGAT 46518 .......... .......... .......... .......... .......... .......... 327 TTTTTTGGGA ACTCGGATAT GTTGGACTTT GCACAACATT GACAAAGTTG AAACTATTTA 46578 .......... .......... .......... .......... .......... .......... 327 AATCAGACCT AAGGAGTCAC CGAAAAGACG TACGGTGCTT CGAAAATTAG ATATGAGAAA 46638 .......... .......... .......... .......... .......... .......... 327 GTAGTCACCA AAAAGACGCA TGATGTTGTG CAAATTAGAT ATGAGAAAGT AGTCACCAAG 46698 .......... .......... .......... .......... .......... .......... 327 AAGATGAGAC AGTGCTACAT AAATTAAATA TGAAAAAGTA GTCACTGATA AGATGGCACG 46758 .......... .......... .......... .......... .......... .......... 327 GTGCTACACA AATTAAATAT GAAAAAGTAG TCATCAAAAA GATGGTGCGA TGCTACACAA 46818 .......... .......... .......... .......... .......... .......... 327 AAGTAAATAG TCACCGGAAT GATGACATGA TGCTACAAAA ATGAAATATG AGAGTAGTCA 46878 .......... .......... .......... .......... .......... .......... 327 CCTGAAGGAT GACACAGTGC CACATAAATT GAACATAAAA AAATAGTCAC CAGAAACATG 46938 .......... .......... .......... .......... .......... .......... 327 ATGCGGTGCT ACACA-AATT AAGAGCCTGT TTGGCTCAGC TTAAAAGCTG GTCAAACTGA 46997 | ||| |||| |||||| ||| |||||||||| |||||||||| |||||||||| .........A AAACAGAATT AAGAGCTTGT TTGGCTCAGC TTAAAAGCTG GTCAAACTGA 378 CTTAAAATCT GATTTTTGAC TTATTTAACT GTTTGACAAT ACTCAAAATA GC 47049 ||||||| || | ||||| || |||||||||| |||||||||| ||| |||||| || CTTAAAAGCT GGTTTTTAAC TTATTTAACT GTTTGACAAT ACTTAAAATA GC 430 hqPGS_C01HBa0088L02.1+_SGN-E240526+ (46948 47049) ******************************************************************************** EST sequence 234 -strand 748 n (File: SGN-E544203-) 1 AAAGATTTAT CAAAATACTC GTTGCCTATT CATAGGCGGA TTGTCCAGTA TAAAACTGCT 61 TATTATTCAT TTTATCTCCC AGTGGCATGT GCACTTCTTA TGGCAGGAGA GAATCTTGAC 121 AATCATGTTA ATGTCAAGAA CATACTACTC GAAATGGGAA TATATTTCCA AGTTCAGGAT 181 GATTACTTGG ACTGCTTTGC TGATCCAGAG GTATTGGGTA AGATTGGCAC GGATATTCAA 241 GATTTCAAGT GCTCTTGGTT GGTAGTGAAA GCCCTAGAAC ACTGCAATGA TGAGCAAAAA 301 AAGTTATTAC ATGAAAACTA TGGAAAAGAT GACCCTGCTT GTGTTGCTAA AGTAAAGGCG 361 CTCTACAATG ATCTCAAACT TGAGGATGTG TACCTGGAAT ATGAGAGGAG TACATATGAA 421 AAGCTGATCA ACTCCATTGA AGCTCAACCA AGCAAAGCAG TGCAAGCAGT TCTGAAGTCA 481 TTCTTGGCAA AGATATACAA AAGGCAGAAG TAGGAGATAA AGAACTTGTT TGGTTCAGCT 541 TAAAAGCTGG TCAAACTAAC TTAAAAGCTA ATTTTTGACT TATTTAGTTG TTTGGCAATC 601 CTCAAAATAA CTTATTTTAA GTTTTAAAAA AAACTTATTT TAAGCCAAAA GTTAAAAGCT 661 GGGGTAAGAG TGCTTCTTTT TTTCAACTTA TAAACTATTT TAAGTTGACC ACATTTTTAC 721 CTTTTTAAAA AAAAAAAAAA AAAAAAAA Predicted gene structure (within gDNA segment 39823 to 48594): Exon 1 40609 40642 ( 34 n); cDNA 446 476 ( 31 n); score: 0.676 Intron 1 40643 41292 ( 650 n); Pd: 0.000 (s: 0), Pa: 0.998 (s: 0) Exon 2 41293 41303 ( 11 n); cDNA 477 487 ( 11 n); score: 0.909 Intron 2 41304 41683 ( 380 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 3 41684 41691 ( 8 n); cDNA 488 494 ( 7 n); score: 0.875 Intron 3 41692 41965 ( 274 n); Pd: 0.703 (s: 0), Pa: 0.203 (s: 0) Exon 4 41966 41985 ( 20 n); cDNA 495 513 ( 19 n); score: 0.600 Intron 4 41986 46951 (4966 n); Pd: 0.903 (s: 0), Pa: 0.000 (s: 0.86) Exon 5 46952 47154 ( 203 n); cDNA 514 718 ( 205 n); score: 0.862 PPA cDNA 727 748 MATCH C01HBa0088L02.1+ SGN-E544203- 0.862 276 0.369 C PGS_C01HBa0088L02.1+_SGN-E544203- (40609 40642,41293 41303,41684 41691,41966 41985,46952 47154) Alignment (genomic DNA sequence = upper lines): AAACACAGCA GGGGATATTT GATGCAGTTC TGAAAGGGCA CATTGATTTT GACTCAGATC 40668 || || |||| | | | | ||||||| |||| AACCA-AGCA A-AG-CAGTG CAAGCAGTTC TGAA...... .......... .......... 476 CTTGGCCTCT AATATCAGAG AGTGCAAAGG ATCTCATCCG GAAGATGTTA TGCATGCGAC 40728 .......... .......... .......... .......... .......... .......... 476 CCCCAGAGCG GTTAACTGCT CATGAAGTAT TATGTAAGTT TATTTACCTT ATAAGTCATA 40788 .......... .......... .......... .......... .......... .......... 476 TTGACCTAAC ATTTTTACTG GTTACTGAAT GGATCATTTT TTTCTCCCAT GATATAAATA 40848 .......... .......... .......... .......... .......... .......... 476 TGGTTTTGCT TGTTTAATAG TTGTTATATC AAGAGATACT GTGTTGTGAC AGTGTTGATG 40908 .......... .......... .......... .......... .......... .......... 476 TTCTGTCAGA CTTATAAGAA CCCTCTTAAC TTTTTTCTGG ACTGTGCTTC TGGTGGCAGA 40968 .......... .......... .......... .......... .......... .......... 476 ACATTGAGAA CCTTATTGAC TACTAATTTA TGTAAAAAAC TGTTAGTTTA GCAGTAGAGA 41028 .......... .......... .......... .......... .......... .......... 476 GGAGTTTCTC ATGCTTGAAC TATAACTTGT TAGGTTATCT ATGAGCCCTT TGGAAATATC 41088 .......... .......... .......... .......... .......... .......... 476 AGGTTTATTT TCTGTATTTC TGGTTTAAAA AATAAATTTG GATTGACTAC AAGCTGTAAT 41148 .......... .......... .......... .......... .......... .......... 476 AGATCAATTT GCACTGCATA AAGTGGATCA AGTCATTGTA TTTCTCAAAT TTCAATTGTA 41208 .......... .......... .......... .......... .......... .......... 476 TTGTCTATCT ATGCCTGCTT GTATGGTGTC TTTCATGTAA CCAGCTGCTG TTCTGGTGTT 41268 .......... .......... .......... .......... .......... .......... 476 ATGGTTTCCT CTAAAATTCT GCAGGTCATC CTTGGATTTG TGAAAATGGT GTTGCTCCTG 41328 ||||| ||||| .......... .......... ....GTCATT CTTGG..... .......... .......... 487 ATAGAGCACT TGATCCTGCT GTACTTTCTC GCCTCAAACA CTTTTCTGCA ATGAACAAAT 41388 .......... .......... .......... .......... .......... .......... 487 TAAAAAAGAT GGCTCTGCGG GTATGCATAT ATATATGTGT GTGTATATAT ATCTAGGCAT 41448 .......... .......... .......... .......... .......... .......... 487 AACTTTTTTG CCCAAGTCTG TTAATTATGG TTCTTCAGTG TCCATAAACC TCATTATTAA 41508 .......... .......... .......... .......... .......... .......... 487 AGTTACACAA GAAAATGCTG ATTATGTCCT TTGGGCTAAG TTGTGTGGAC TCTTCAGTTT 41568 .......... .......... .......... .......... .......... .......... 487 CGATGGCGCA CCAGTGTCGG ATTCTCCAAA AATACACTCC TTATGGAGAA GCCGACACAC 41628 .......... .......... .......... .......... .......... .......... 487 ACCCATTGAC ATTTTTGAAG CGTCCAAGCA ACATAGCTTC TTGGAGGTGT GTAACCAAAT 41688 |||| .......... .......... .......... .......... .......... .....CAAA- 491 GATGCAATTA TTGATGTTTT CATACTTAAT ATGCATTTAG GTGATTGCTG AAAGTTTGTC 41748 ||| GAT....... .......... .......... .......... .......... .......... 494 AGAGGAGGAG ATTGCCGGTC TTAAGGAGAT GTTTAAGGCC ATGGATACTG ATAACAGTGG 41808 .......... .......... .......... .......... .......... .......... 494 TGCAATTACA TTCGATGAAC TAAAAGCTGG TTTGAGAAAA TATGGCTCTA CTCTGAAGGA 41868 .......... .......... .......... .......... .......... .......... 494 TATAGAGATA CGGGAACTTA TGGATGCGGT AAGAAAATCT AGACTGCAAA CTGATTCTGT 41928 .......... .......... .......... .......... .......... .......... 494 TTATTTTGTG CATCTGGTGA TGTGACTCTA CACAAAGGTT CATAGGAGCA GAAAAATGTA 41988 | || | | ||| ||| | .......... .......... .......... .......ATA CAAAAG-GCA GAAGTAG... 513 AAATGACATA AGATCACTAA CTAATGGTCA AATCTCAAGG TTATTTGATG TGCAAATACT 42048 .......... .......... .......... .......... .......... .......... 513 AGAGTCAGAT TGGGATTTGG CACTTTACTT TGTTTAATTA ATTATGTACA TTCATGAAGG 42108 .......... .......... .......... .......... .......... .......... 513 AGCACTTAAA ACTCAATGTA GTTGCTAAAA CTTCACTGGA AAGGTGCCCA ATTTTTTTTT 42168 .......... .......... .......... .......... .......... .......... 513 TTTGTGTATG TGTATGATAA GTTTCTGATA ACTGAGGAGG TAGTGCAGGC TTACCAAGTA 42228 .......... .......... .......... .......... .......... .......... 513 GTTGGCACCA CATATATGCT TCATCAGAAA CAACTTTCTG TTAATGGTTC TAGTTGTATC 42288 .......... .......... .......... .......... .......... .......... 513 TTTAATTAGG CCCGTGATAA TCTTTGTATT TCTCCCTAAA CATGTCTGTC TATGAGGTAC 42348 .......... .......... .......... .......... .......... .......... 513 ATGCGGAAGT GCTTATCTAA CTCTTTAAGG CCATTGATGT AATATTACTG TTTTCAGGCT 42408 .......... .......... .......... .......... .......... .......... 513 GATGTGGACA ATAGTGGAAC TATTGACTAT GGAGAATTCA TAGCAGCAAC AATTCACCTT 42468 .......... .......... .......... .......... .......... .......... 513 AACAAATTGG ACCGCGAGGA ACATCTCATG GCAGCATTTC AGTATTTTGA CAAGGATGGA 42528 .......... .......... .......... .......... .......... .......... 513 AGTGGTTATA TTACAGTAGA TGAGCTCCAG CAGGCCTGTG CAGATCATAA CATTACAGAT 42588 .......... .......... .......... .......... .......... .......... 513 GTATTCTTTG AGGATATTAT CAGAGAAGTT GATCAGGATA ACGTAAGTTA ATTATATTGA 42648 .......... .......... .......... .......... .......... .......... 513 GGATAAAGTT GAAGTATTAT TGGAACTTAT CAATAAAAAA GTGGACACAA ATTAGTAGAT 42708 .......... .......... .......... .......... .......... .......... 513 TAAATTTCTT CATGTTTTGC AGTTCTACTG ATTTATCTCT CTACTACTCA TAATTTTTTT 42768 .......... .......... .......... .......... .......... .......... 513 GCAACAAAAA CTATTTTTTT TTATAAAAAA GCACTTTAAT ATGAAACACT TTTTGTGCAA 42828 .......... .......... .......... .......... .......... .......... 513 CAAAAACGAA AATTAAAAAA ATATAGCACT TTAAGATTTC ATATGAATCT TTTCCTTGAG 42888 .......... .......... .......... .......... .......... .......... 513 ATAAAATGTT ATTGACAATG TAGTGTATGT ATGGAAAATA CGGATATTAC TAAATGATCA 42948 .......... .......... .......... .......... .......... .......... 513 TATGTGAGCT TAATAATATA GTTAATTTAC CTCTCTCTCT CTATATATAT AAAGAGAACC 43008 .......... .......... .......... .......... .......... .......... 513 CTAGGCTGCC TAAGTGGCGC CACCACAAAT CAGGATTCCC TTTTAATTTA TTTATTTCCA 43068 .......... .......... .......... .......... .......... .......... 513 AAATTAGCCT TCCCTTTCAT CAAAAGTTGT GACTTATGAA ACTTTGCGAC TTTTACAAAG 43128 .......... .......... .......... .......... .......... .......... 513 AGTTGTAACT TTTATGAAAG TTGTAACTTT TATGAAAGTT GTAACTTTTA TGTAGAGTTG 43188 .......... .......... .......... .......... .......... .......... 513 TGACTTTTCC AAAGGATTAT TACATTTCCG ATAAGACACC ATAACCATTT ATTCACACTA 43248 .......... .......... .......... .......... .......... .......... 513 TCCTTTTGTT GTCTATAAAT AGAGGAATTT TCTTTCATTT TAAAACGACG AAAATTCTAA 43308 .......... .......... .......... .......... .......... .......... 513 ATTTTTTCTT CTGCTTATGC ACAATTAAAT ATTTGTGTAC TTTGCTCCTG TTGAGTGGTT 43368 .......... .......... .......... .......... .......... .......... 513 CACTGACATC ATTGTTTTTG AATCTATACA ACGGTGAATA TAATCGTTCT ATCCTAAAAG 43428 .......... .......... .......... .......... .......... .......... 513 TATCTATTCA TTCTTTTGTT ACAAATCTTG GTATGTTTTT TACGCTCATT TATGCTTATG 43488 .......... .......... .......... .......... .......... .......... 513 TTATTAGTTG TTTTTGAGTA CATGTTTTAA ACTTTGTTGT TTATGTTTAT GTTTATGTTG 43548 .......... .......... .......... .......... .......... .......... 513 AAATAAAGAT ATGTTAATCA AGAATTTGAT GTAGTGATGT CATGTAGATT AAAATTCTTG 43608 .......... .......... .......... .......... .......... .......... 513 AACTTATAAA ATAAATGACT TTGATCTTTA TAGAGTTTTA GTGGCTAAAA GATTCATGGG 43668 .......... .......... .......... .......... .......... .......... 513 ATGTTCAAGA AGAAACTTTT GAGTGTTCAA AAGTTATGGT GGTTCTACTC TACCATGGAG 43728 .......... .......... .......... .......... .......... .......... 513 TTTAGTTATT CAACTTTCTA TCTTATCTAG ACATTCAATC GATTAGTGAC ATTCAAAAAA 43788 .......... .......... .......... .......... .......... .......... 513 TAAAGGAAAA TGTAGCGGGA TGGTAAGTAT TATACTCAAC CTTAATTAAA AGTTTGGGAT 43848 .......... .......... .......... .......... .......... .......... 513 TCAAATATTT GATTGGAGTC AATGAATTAC CCCCTTAGGA TGAATCTACA TTAATCAATT 43908 .......... .......... .......... .......... .......... .......... 513 ATTAAAGAAA TAATTATCTC CTTATAAACA TTAGATTAAA AGTTGCAAAA AGATTAAAGC 43968 .......... .......... .......... .......... .......... .......... 513 TTTAACCATA TTGATCGGAA CATAAACAAC AAAATATGCA TTTTGGGTAT CAAAGTAGTG 44028 .......... .......... .......... .......... .......... .......... 513 TCATACATAA TGATTTGAAT AAGGGTCTTG CCAAGACATC ATTTAATCCG AATTATTTGA 44088 .......... .......... .......... .......... .......... .......... 513 GTGACTTGCC TTATTTCATT GAAATTCCAA GAGATGTTTT TTAAAATTTT AATTAACTTA 44148 .......... .......... .......... .......... .......... .......... 513 TCAAGCACAC AACTAATTAT ATAAAATGTA TAATATTTAG ATTTTGTATG TAGAGGGAGG 44208 .......... .......... .......... .......... .......... .......... 513 CCTTGAATAA GAGAAGAACT CTCGCAATTG ATGAATAAAA TGTTTGTACC ACTTTTGGAA 44268 .......... .......... .......... .......... .......... .......... 513 AATACAAATA TAGACAATGA AACAATTACC TATCTTTTCT AAAGATTTGG TGATGAATAA 44328 .......... .......... .......... .......... .......... .......... 513 CTACAGTAAA ATGAAGAATC AATAACTAAA TCCATAAACA CGTAGAATCA AATCGTTTTA 44388 .......... .......... .......... .......... .......... .......... 513 AGTTTAAAAA AATATTTTAT TTTGTCTTTG GATAAAATAT TCTTGACAAT TTATTGTTGG 44448 .......... .......... .......... .......... .......... .......... 513 GTTGTACCCA TTCGAAAACA CTTATATTAT CAAATGTTCA GAAGTAGATT ATTACCGTAG 44508 .......... .......... .......... .......... .......... .......... 513 TTTACCACCG CGCGAAAAGC ATGCAATTTA CCTTGTTAAA TTACAAGTGC TCAGATGCAA 44568 .......... .......... .......... .......... .......... .......... 513 TGATATGCTT TGAAAATTAT TTTTGAAGAA CTTCTCGTAG TTCTGTTTGG TCTGACTGCA 44628 .......... .......... .......... .......... .......... .......... 513 TTCGTGCCAG CTACTCACTT TTTGGCGTCA CTTCATAATC TAAGTAGTTT TGTGTATTCA 44688 .......... .......... .......... .......... .......... .......... 513 AAGGCATAAT GAGAAGACAA AGCTGACATA ATTGTCCAAA GAAAAGAAAA AAGACAAAGA 44748 .......... .......... .......... .......... .......... .......... 513 AATTGTAGCA TAATAAACAG GAATGGGTAC CGTTACAGAC ATTTCTGTCT TTCTTCAAAT 44808 .......... .......... .......... .......... .......... .......... 513 CAAACAAAAT TTGTTGTATT TTGATTAGTT TTCTGGAGCC TCAGTATTGG ATTAGGGCCT 44868 .......... .......... .......... .......... .......... .......... 513 CAGCTGCAGC CGTGATACAG GCAAATTGTT ATGCTTTAGG AGATCTGTAT TTTAAATGGA 44928 .......... .......... .......... .......... .......... .......... 513 TGGAATGATT CTTTTGGAAT CTCTACATCT CTTGATGCTT CATTTGACTA GCTATTTAGT 44988 .......... .......... .......... .......... .......... .......... 513 TGATCTTCTG GTGGATTCCC TTTTCAGGAT GGACGTATTG ATTATGGAGA ATTTGTTGCT 45048 .......... .......... .......... .......... .......... .......... 513 ATGATGCAAA AAGGAAATCC ATGCATAGGA AGACGAACAA TGCGAAATAG TCTGAATTTC 45108 .......... .......... .......... .......... .......... .......... 513 AGCATGAGAG ATGCGCCCGG AGCTCATTAG CTTTTTGAAT GGACACATGA TGTAGGTATT 45168 .......... .......... .......... .......... .......... .......... 513 TCCCCTTTTT TATTTTTGTA ACCGTTTCTT TGGCAATGAA TTTGAAGAAA TCTTTCCTTG 45228 .......... .......... .......... .......... .......... .......... 513 TTCTGTCCTT GAGAAATTGG ATTGGTTGGA GTATATTTGT TTAACATTAA GAGTTTCTTT 45288 .......... .......... .......... .......... .......... .......... 513 TTCCCTCTTG AGGATAATAA AATTTTATAA ATAACAGCAT GAGTGTTTGC TGTAAAACTC 45348 .......... .......... .......... .......... .......... .......... 513 TACAGGTGCA GCAAAAAAAA TTACATTCAG CAAAAGTATA TCCCATCTTA TCCTGTTGGT 45408 .......... .......... .......... .......... .......... .......... 513 ACACTAGCAT GTCACAGATA GATTCAGCTT CCTCCCCAAT CCTCCATTTT ACACCATTAA 45468 .......... .......... .......... .......... .......... .......... 513 CAAAAATAAA TTTCAGATAC AGAGTTCTCT TTCATTCCCA TCTTTTATAT AATGCTGGTT 45528 .......... .......... .......... .......... .......... .......... 513 TCTTTTCTTT TGGTAAAATT TTGATGTATC AAATTTGACG ATTGTCCGAC ATGGCTATGT 45588 .......... .......... .......... .......... .......... .......... 513 GAGGAACTTT CCTAAGGGAG CACTAAGGGT GTCAAATGTG TGGGTGGAGG CAGTGGGGGA 45648 .......... .......... .......... .......... .......... .......... 513 CTGAAATTGA AGAGGTTAAA ATGGGCTGAG CTAAAAGTCA TGTTGGATCA TAACCCACTC 45708 .......... .......... .......... .......... .......... .......... 513 AAACTTACTT TGGGCTAACA TGGGCTAGAA TCTTGATTGG GTTATGACCT ATCCAATTTG 45768 .......... .......... .......... .......... .......... .......... 513 ACCTGCTTAA TCTAAACTAA ACTATATTAA ACACTTGCTA TAATTTATGA CAGATGTCAT 45828 .......... .......... .......... .......... .......... .......... 513 TCAACCCATA GAATCGTACA GATCTGTACT AACTTTTCAT TTAGGAGCAT CTCCTTGTAG 45888 .......... .......... .......... .......... .......... .......... 513 AGTAAATTGA TGTAGACTTT ATAGTATGGG ACCAACTTCA TAATTTTGCA ACTCATTTAA 45948 .......... .......... .......... .......... .......... .......... 513 TAGTGTATTT ATGAGAATTA TTGAAAAGAA TATTATTGAA TTGTGTGTCT ACATTATTAC 46008 .......... .......... .......... .......... .......... .......... 513 ATTGAGACTT TATTTATAGA CACTATATTA TACTCCTTTT CCAACTAGGA CACTACAATA 46068 .......... .......... .......... .......... .......... .......... 513 CCATCCTTTT CTAAGTAGGA TTCTATATAC TATTTCTATT CCTATTCCTA TTCTAAGTAG 46128 .......... .......... .......... .......... .......... .......... 513 AATGGTATAT ATTATTCTTG TTCCTTTTTT GATTCTAACA CTCCCCCTCA AGCTGGTGCA 46188 .......... .......... .......... .......... .......... .......... 513 TACAAGTTAT ATATACTTTG CTTGTTACAA ATGTAATTAA TATGAGGACC AATGAGAGGC 46248 .......... .......... .......... .......... .......... .......... 513 TTGATGAAGA TATCTGCAAG TTGATCACTT GACTCACAAA TTTTGTAACA ATATCTCCCG 46308 .......... .......... .......... .......... .......... .......... 513 ACTTCCCAGA CCAAGCTTGA GAAGAACGTT TCATATCATC GAGTGACTTG CACAATCAAC 46368 .......... .......... .......... .......... .......... .......... 513 ATATAAGGCT GCTAGACTCC CTCGGAGCAA TAAGACCAAG TGGTTGCTCC ATATATACTT 46428 .......... .......... .......... .......... .......... .......... 513 CTCCATCGAG ATCCCAGCCC AAATATGTAA GTATATCCTT TTGGATAAAG TGAATCTAAA 46488 .......... .......... .......... .......... .......... .......... 513 ACAAAGAGAA TATTGCTTGA AAACTTGGAT TTTTTTGGGA ACTCGGATAT GTTGGACTTT 46548 .......... .......... .......... .......... .......... .......... 513 GCACAACATT GACAAAGTTG AAACTATTTA AATCAGACCT AAGGAGTCAC CGAAAAGACG 46608 .......... .......... .......... .......... .......... .......... 513 TACGGTGCTT CGAAAATTAG ATATGAGAAA GTAGTCACCA AAAAGACGCA TGATGTTGTG 46668 .......... .......... .......... .......... .......... .......... 513 CAAATTAGAT ATGAGAAAGT AGTCACCAAG AAGATGAGAC AGTGCTACAT AAATTAAATA 46728 .......... .......... .......... .......... .......... .......... 513 TGAAAAAGTA GTCACTGATA AGATGGCACG GTGCTACACA AATTAAATAT GAAAAAGTAG 46788 .......... .......... .......... .......... .......... .......... 513 TCATCAAAAA GATGGTGCGA TGCTACACAA AAGTAAATAG TCACCGGAAT GATGACATGA 46848 .......... .......... .......... .......... .......... .......... 513 TGCTACAAAA ATGAAATATG AGAGTAGTCA CCTGAAGGAT GACACAGTGC CACATAAATT 46908 .......... .......... .......... .......... .......... .......... 513 GAACATAAAA AAATAGTCAC CAGAAACATG ATGCGGTGCT ACACAAATTA AGAGCCTGTT 46968 | || | ||| | |||| .......... .......... .......... .......... ...GAGATAA AGAACTTGTT 530 TGGCTCAGCT TAAAAGCTGG TCAAACTGAC TTAAAATCTG ATTTTTGACT TATTTAACTG 47028 ||| |||||| |||||||||| ||||||| || |||||| || |||||||||| |||||| || TGGTTCAGCT TAAAAGCTGG TCAAACTAAC TTAAAAGCTA ATTTTTGACT TATTTAGTTG 590 TTTGACAATA CTCAAAATAG CTTATTTTAA G-TT-AAAAA AAACTTATTT TAAGCCAAAA 47086 |||| |||| ||||||||| |||||||||| | || ||||| |||||||||| |||||||||| TTTGGCAATC CTCAAAATAA CTTATTTTAA GTTTTAAAAA AAACTTATTT TAAGCCAAAA 650 GTTAAAAGGT GGGGTAGGGG TGCTTTTTTT TTTTAGCTTA TAAGCTGTTT TAAGTTGACC 47146 |||||||| | |||||| | | ||||| |||| ||| | |||| ||| || ||| |||||||||| GTTAAAAGCT GGGGTAAGAG TGCTTCTTTT TTTCAACTTA TAAACTATTT TAAGTTGACC 710 ATATTTTT 47154 | |||||| ACATTTTT 718 hqPGS_C01HBa0088L02.1+_SGN-E544203- (46952 47154) ******************************************************************************** EST sequence 33 +strand 540 n (File: SGN-E253695+) 1 TCAAAATGGA CGGTTAAAGC TGAGGGAAAA AGTCAGCACC ATACAGATAA TTGTAAGATT 61 ATTGAGTTGA CACCATGGGA CATTCTTGAG CTTCAAATTG ACTACTTTCA AACTGGACTC 121 CTCTTCCTCA TGCCTGCATT TGAACAAGTA AGAGATCTAC TAAAAACAAC CAACACCAGT 181 TCCTTAATTG ATCATCTTAG AGTTTCACTA TCTCGAGCTT TAGAGCCTGT TTGGCTCAGC 241 TTAAAAGCTG GTCAAACTGA CTTAAAAGCT GGTTTTTGAC TTATTTAAAT GTTTGGCAAT 301 ACTCAAAATA GCTTATTTTA AGTTAAAAAA ACTTATTTTA AGCCAAAAGT GTGCTTTTTT 361 TTTTTAGCTT ATAAGCTGTT TTAAGTTGAC CATATTTTTA TGTTTTTTCC CTTAATATTT 421 TTATACAATC TCCAAATTAC CCATATAACA CTAACTTCTC TTTCTTCTAT TTTTCCCTTT 481 TCACGTTTGG CATAACAACT TCAACACTTT TATCCAAACG CATAATTGCT TATTTTAAAA Predicted gene structure (within gDNA segment 44149 to 48040): Exon 1 44984 45016 ( 33 n); cDNA 184 215 ( 32 n); score: 0.636 Intron 1 45017 46952 (1936 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.94) Exon 2 46953 47295 ( 343 n); cDNA 216 540 ( 325 n); score: 0.913 MATCH C01HBa0088L02.1+ SGN-E253695+ 0.913 376 0.696 C PGS_C01HBa0088L02.1+_SGN-E253695+ (44984 45016,46953 47295) Alignment (genomic DNA sequence = upper lines): TTAGTTGATC TTCTGGTGGA TTCCCTTTTC AGGATGGACG TATTGATTAT GGAGAATTTG 45043 ||| |||||| ||| | ||| || || | TTAATTGATC ATCTTAGAGT TTCACTA-TC TCG....... .......... .......... 215 TTGCTATGAT GCAAAAAGGA AATCCATGCA TAGGAAGACG AACAATGCGA AATAGTCTGA 45103 .......... .......... .......... .......... .......... .......... 215 ATTTCAGCAT GAGAGATGCG CCCGGAGCTC ATTAGCTTTT TGAATGGACA CATGATGTAG 45163 .......... .......... .......... .......... .......... .......... 215 GTATTTCCCC TTTTTTATTT TTGTAACCGT TTCTTTGGCA ATGAATTTGA AGAAATCTTT 45223 .......... .......... .......... .......... .......... .......... 215 CCTTGTTCTG TCCTTGAGAA ATTGGATTGG TTGGAGTATA TTTGTTTAAC ATTAAGAGTT 45283 .......... .......... .......... .......... .......... .......... 215 TCTTTTTCCC TCTTGAGGAT AATAAAATTT TATAAATAAC AGCATGAGTG TTTGCTGTAA 45343 .......... .......... .......... .......... .......... .......... 215 AACTCTACAG GTGCAGCAAA AAAAATTACA TTCAGCAAAA GTATATCCCA TCTTATCCTG 45403 .......... .......... .......... .......... .......... .......... 215 TTGGTACACT AGCATGTCAC AGATAGATTC AGCTTCCTCC CCAATCCTCC ATTTTACACC 45463 .......... .......... .......... .......... .......... .......... 215 ATTAACAAAA ATAAATTTCA GATACAGAGT TCTCTTTCAT TCCCATCTTT TATATAATGC 45523 .......... .......... .......... .......... .......... .......... 215 TGGTTTCTTT TCTTTTGGTA AAATTTTGAT GTATCAAATT TGACGATTGT CCGACATGGC 45583 .......... .......... .......... .......... .......... .......... 215 TATGTGAGGA ACTTTCCTAA GGGAGCACTA AGGGTGTCAA ATGTGTGGGT GGAGGCAGTG 45643 .......... .......... .......... .......... .......... .......... 215 GGGGACTGAA ATTGAAGAGG TTAAAATGGG CTGAGCTAAA AGTCATGTTG GATCATAACC 45703 .......... .......... .......... .......... .......... .......... 215 CACTCAAACT TACTTTGGGC TAACATGGGC TAGAATCTTG ATTGGGTTAT GACCTATCCA 45763 .......... .......... .......... .......... .......... .......... 215 ATTTGACCTG CTTAATCTAA ACTAAACTAT ATTAAACACT TGCTATAATT TATGACAGAT 45823 .......... .......... .......... .......... .......... .......... 215 GTCATTCAAC CCATAGAATC GTACAGATCT GTACTAACTT TTCATTTAGG AGCATCTCCT 45883 .......... .......... .......... .......... .......... .......... 215 TGTAGAGTAA ATTGATGTAG ACTTTATAGT ATGGGACCAA CTTCATAATT TTGCAACTCA 45943 .......... .......... .......... .......... .......... .......... 215 TTTAATAGTG TATTTATGAG AATTATTGAA AAGAATATTA TTGAATTGTG TGTCTACATT 46003 .......... .......... .......... .......... .......... .......... 215 ATTACATTGA GACTTTATTT ATAGACACTA TATTATACTC CTTTTCCAAC TAGGACACTA 46063 .......... .......... .......... .......... .......... .......... 215 CAATACCATC CTTTTCTAAG TAGGATTCTA TATACTATTT CTATTCCTAT TCCTATTCTA 46123 .......... .......... .......... .......... .......... .......... 215 AGTAGAATGG TATATATTAT TCTTGTTCCT TTTTTGATTC TAACACTCCC CCTCAAGCTG 46183 .......... .......... .......... .......... .......... .......... 215 GTGCATACAA GTTATATATA CTTTGCTTGT TACAAATGTA ATTAATATGA GGACCAATGA 46243 .......... .......... .......... .......... .......... .......... 215 GAGGCTTGAT GAAGATATCT GCAAGTTGAT CACTTGACTC ACAAATTTTG TAACAATATC 46303 .......... .......... .......... .......... .......... .......... 215 TCCCGACTTC CCAGACCAAG CTTGAGAAGA ACGTTTCATA TCATCGAGTG ACTTGCACAA 46363 .......... .......... .......... .......... .......... .......... 215 TCAACATATA AGGCTGCTAG ACTCCCTCGG AGCAATAAGA CCAAGTGGTT GCTCCATATA 46423 .......... .......... .......... .......... .......... .......... 215 TACTTCTCCA TCGAGATCCC AGCCCAAATA TGTAAGTATA TCCTTTTGGA TAAAGTGAAT 46483 .......... .......... .......... .......... .......... .......... 215 CTAAAACAAA GAGAATATTG CTTGAAAACT TGGATTTTTT TGGGAACTCG GATATGTTGG 46543 .......... .......... .......... .......... .......... .......... 215 ACTTTGCACA ACATTGACAA AGTTGAAACT ATTTAAATCA GACCTAAGGA GTCACCGAAA 46603 .......... .......... .......... .......... .......... .......... 215 AGACGTACGG TGCTTCGAAA ATTAGATATG AGAAAGTAGT CACCAAAAAG ACGCATGATG 46663 .......... .......... .......... .......... .......... .......... 215 TTGTGCAAAT TAGATATGAG AAAGTAGTCA CCAAGAAGAT GAGACAGTGC TACATAAATT 46723 .......... .......... .......... .......... .......... .......... 215 AAATATGAAA AAGTAGTCAC TGATAAGATG GCACGGTGCT ACACAAATTA AATATGAAAA 46783 .......... .......... .......... .......... .......... .......... 215 AGTAGTCATC AAAAAGATGG TGCGATGCTA CACAAAAGTA AATAGTCACC GGAATGATGA 46843 .......... .......... .......... .......... .......... .......... 215 CATGATGCTA CAAAAATGAA ATATGAGAGT AGTCACCTGA AGGATGACAC AGTGCCACAT 46903 .......... .......... .......... .......... .......... .......... 215 AAATTGAACA TAAAAAAATA GTCACCAGAA ACATGATGCG GTGCTACACA AATTAAGAGC 46963 | || ||||| .......... .......... .......... .......... .........A GCTTTAGAGC 226 CTGTTTGGCT CAGCTTAAAA GCTGGTCAAA CTGACTTAAA ATCTGATTTT TGACTTATTT 47023 |||||||||| |||||||||| |||||||||| |||||||||| | ||| |||| |||||||||| CTGTTTGGCT CAGCTTAAAA GCTGGTCAAA CTGACTTAAA AGCTGGTTTT TGACTTATTT 286 AACTGTTTGA CAATACTCAA AATAGCTTAT TTTAAGTTAA AAAAAACTTA TTTTAAGCCA 47083 || |||||| |||||||||| |||||||||| |||||||| | |||||||||| ||||||||| AAATGTTTGG CAATACTCAA AATAGCTTAT TTTAAGTT-A AAAAAACTTA TTTTAAGCC- 344 AAAGTTAAAA GGTGGGGTAG GGGTGCTTTT TTTTTTTAGC TTATAAGCTG TTTTAAGTTG 47143 |||| || |||||||| |||||||||| |||||||||| |||||||||| ------AAAA ------GT-- --GTGCTTTT TTTTTTTAGC TTATAAGCTG TTTTAAGTTG 388 ACCATATTTT TATGTTTTTT CCCTTAATAT TTTTATACAA TCTCCAAATT ATCCATATAA 47203 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| | |||||||| ACCATATTTT TATGTTTTTT CCCTTAATAT TTTTATACAA TCTCCAAATT ACCCATATAA 448 CCCTAACATC TCTTTCTTCT ATTTTTCCCT TTTCACGTTT GGCATAACAA CTTCAGCACT 47263 | ||||| || |||||||||| |||||||||| |||||||||| |||||||||| ||||| |||| CACTAACTTC TCTTTCTTCT ATTTTTCCCT TTTCACGTTT GGCATAACAA CTTCAACACT 508 TTTATCCAAA CGCATAACTG CTTATTTTAA AA 47295 |||||||||| ||||||| || |||||||||| || TTTATCCAAA CGCATAATTG CTTATTTTAA AA 540 hqPGS_C01HBa0088L02.1+_SGN-E253695+ (46953 47295) ******************************************************************************** EST sequence 98 +strand 618 n (File: SGN-E249253+) 1 GGTTACCAGT TCAAGTCCCG TTTCCGGCAA CTTTTCCGGT TATTAAGCTG TTCCGCCGCT 61 GAGCACACTG ATTTAACTTC AGATTTACCC AATACAGAGG TGATTGAAAG CTATGGCTTC 121 CAAGGTATCC ATCATTTCAA AATGGACGGT TAAAGCTGAG GGAAAAAGTC AGCACCATAC 181 AGATAATTGT AAGATTATTG AGTTGACACC ATGGGACATT CTTGAGCTTC AAATTGACTA 241 CTTTCAAACT GGACTCCTCT TCCTCATGCC TGCATTTGAA CAAGTAAGAG ATCTACTAAA 301 AACAACCAAC ACCAGTTCCT TAATTGATCA TCTTAGAGTT TCACTATCTC GAGCTTTAGA 361 GCCTGTTTGG CTCAGCTTAA AAGCTGGTCA AACTGACTTA AAAGCTGGTT TTTGACTTAT 421 TTAAATGTTT GGCAATACTC AAAATAGCTT ATTTTAAGTT AAAAAAACTT ATTTTAAGCC 481 AAAAGTGTGC CTTTTTTTTT TAGCTTATAA GCTGTTTTAA GTTGACCATA TTTTTATGTT 541 TTTTCCCTTA ATATTTTTAT ACAATCTCCA AATTACCCAT ATAACACTAA CTTCTCTTTC 601 TTCTATTTTT CCCTTTTC Predicted gene structure (within gDNA segment 42189 to 47847): Exon 1 44984 45016 ( 33 n); cDNA 320 351 ( 32 n); score: 0.636 Intron 1 45017 46952 (1936 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.94) Exon 2 46953 47237 ( 285 n); cDNA 352 618 ( 267 n); score: 0.898 MATCH C01HBa0088L02.1+ SGN-E249253+ 0.898 318 0.515 C PGS_C01HBa0088L02.1+_SGN-E249253+ (44984 45016,46953 47237) Alignment (genomic DNA sequence = upper lines): TTAGTTGATC TTCTGGTGGA TTCCCTTTTC AGGATGGACG TATTGATTAT GGAGAATTTG 45043 ||| |||||| ||| | ||| | | || | TTAATTGATC ATCTTAGAGT TTCAC-TATC TCG....... .......... .......... 351 TTGCTATGAT GCAAAAAGGA AATCCATGCA TAGGAAGACG AACAATGCGA AATAGTCTGA 45103 .......... .......... .......... .......... .......... .......... 351 ATTTCAGCAT GAGAGATGCG CCCGGAGCTC ATTAGCTTTT TGAATGGACA CATGATGTAG 45163 .......... .......... .......... .......... .......... .......... 351 GTATTTCCCC TTTTTTATTT TTGTAACCGT TTCTTTGGCA ATGAATTTGA AGAAATCTTT 45223 .......... .......... .......... .......... .......... .......... 351 CCTTGTTCTG TCCTTGAGAA ATTGGATTGG TTGGAGTATA TTTGTTTAAC ATTAAGAGTT 45283 .......... .......... .......... .......... .......... .......... 351 TCTTTTTCCC TCTTGAGGAT AATAAAATTT TATAAATAAC AGCATGAGTG TTTGCTGTAA 45343 .......... .......... .......... .......... .......... .......... 351 AACTCTACAG GTGCAGCAAA AAAAATTACA TTCAGCAAAA GTATATCCCA TCTTATCCTG 45403 .......... .......... .......... .......... .......... .......... 351 TTGGTACACT AGCATGTCAC AGATAGATTC AGCTTCCTCC CCAATCCTCC ATTTTACACC 45463 .......... .......... .......... .......... .......... .......... 351 ATTAACAAAA ATAAATTTCA GATACAGAGT TCTCTTTCAT TCCCATCTTT TATATAATGC 45523 .......... .......... .......... .......... .......... .......... 351 TGGTTTCTTT TCTTTTGGTA AAATTTTGAT GTATCAAATT TGACGATTGT CCGACATGGC 45583 .......... .......... .......... .......... .......... .......... 351 TATGTGAGGA ACTTTCCTAA GGGAGCACTA AGGGTGTCAA ATGTGTGGGT GGAGGCAGTG 45643 .......... .......... .......... .......... .......... .......... 351 GGGGACTGAA ATTGAAGAGG TTAAAATGGG CTGAGCTAAA AGTCATGTTG GATCATAACC 45703 .......... .......... .......... .......... .......... .......... 351 CACTCAAACT TACTTTGGGC TAACATGGGC TAGAATCTTG ATTGGGTTAT GACCTATCCA 45763 .......... .......... .......... .......... .......... .......... 351 ATTTGACCTG CTTAATCTAA ACTAAACTAT ATTAAACACT TGCTATAATT TATGACAGAT 45823 .......... .......... .......... .......... .......... .......... 351 GTCATTCAAC CCATAGAATC GTACAGATCT GTACTAACTT TTCATTTAGG AGCATCTCCT 45883 .......... .......... .......... .......... .......... .......... 351 TGTAGAGTAA ATTGATGTAG ACTTTATAGT ATGGGACCAA CTTCATAATT TTGCAACTCA 45943 .......... .......... .......... .......... .......... .......... 351 TTTAATAGTG TATTTATGAG AATTATTGAA AAGAATATTA TTGAATTGTG TGTCTACATT 46003 .......... .......... .......... .......... .......... .......... 351 ATTACATTGA GACTTTATTT ATAGACACTA TATTATACTC CTTTTCCAAC TAGGACACTA 46063 .......... .......... .......... .......... .......... .......... 351 CAATACCATC CTTTTCTAAG TAGGATTCTA TATACTATTT CTATTCCTAT TCCTATTCTA 46123 .......... .......... .......... .......... .......... .......... 351 AGTAGAATGG TATATATTAT TCTTGTTCCT TTTTTGATTC TAACACTCCC CCTCAAGCTG 46183 .......... .......... .......... .......... .......... .......... 351 GTGCATACAA GTTATATATA CTTTGCTTGT TACAAATGTA ATTAATATGA GGACCAATGA 46243 .......... .......... .......... .......... .......... .......... 351 GAGGCTTGAT GAAGATATCT GCAAGTTGAT CACTTGACTC ACAAATTTTG TAACAATATC 46303 .......... .......... .......... .......... .......... .......... 351 TCCCGACTTC CCAGACCAAG CTTGAGAAGA ACGTTTCATA TCATCGAGTG ACTTGCACAA 46363 .......... .......... .......... .......... .......... .......... 351 TCAACATATA AGGCTGCTAG ACTCCCTCGG AGCAATAAGA CCAAGTGGTT GCTCCATATA 46423 .......... .......... .......... .......... .......... .......... 351 TACTTCTCCA TCGAGATCCC AGCCCAAATA TGTAAGTATA TCCTTTTGGA TAAAGTGAAT 46483 .......... .......... .......... .......... .......... .......... 351 CTAAAACAAA GAGAATATTG CTTGAAAACT TGGATTTTTT TGGGAACTCG GATATGTTGG 46543 .......... .......... .......... .......... .......... .......... 351 ACTTTGCACA ACATTGACAA AGTTGAAACT ATTTAAATCA GACCTAAGGA GTCACCGAAA 46603 .......... .......... .......... .......... .......... .......... 351 AGACGTACGG TGCTTCGAAA ATTAGATATG AGAAAGTAGT CACCAAAAAG ACGCATGATG 46663 .......... .......... .......... .......... .......... .......... 351 TTGTGCAAAT TAGATATGAG AAAGTAGTCA CCAAGAAGAT GAGACAGTGC TACATAAATT 46723 .......... .......... .......... .......... .......... .......... 351 AAATATGAAA AAGTAGTCAC TGATAAGATG GCACGGTGCT ACACAAATTA AATATGAAAA 46783 .......... .......... .......... .......... .......... .......... 351 AGTAGTCATC AAAAAGATGG TGCGATGCTA CACAAAAGTA AATAGTCACC GGAATGATGA 46843 .......... .......... .......... .......... .......... .......... 351 CATGATGCTA CAAAAATGAA ATATGAGAGT AGTCACCTGA AGGATGACAC AGTGCCACAT 46903 .......... .......... .......... .......... .......... .......... 351 AAATTGAACA TAAAAAAATA GTCACCAGAA ACATGATGCG GTGCTACACA AATTAAGAGC 46963 | || ||||| .......... .......... .......... .......... .........A GCTTTAGAGC 362 CTGTTTGGCT CAGCTTAAAA GCTGGTCAAA CTGACTTAAA ATCTGATTTT TGACTTATTT 47023 |||||||||| |||||||||| |||||||||| |||||||||| | ||| |||| |||||||||| CTGTTTGGCT CAGCTTAAAA GCTGGTCAAA CTGACTTAAA AGCTGGTTTT TGACTTATTT 422 AACTGTTTGA CAATACTCAA AATAGCTTAT TTTAAGTTAA AAAAAACTTA TTTTAAGCCA 47083 || |||||| |||||||||| |||||||||| |||||||| | |||||||||| |||||||||| AAATGTTTGG CAATACTCAA AATAGCTTAT TTTAAGTT-A AAAAAACTTA TTTTAAGCCA 481 AAAGTTAAAA GGTGGGGTAG GGGTGCTTTT TTTTTTTAGC TTATAAGCTG TTTTAAGTTG 47143 |||| | || || ||| |||||||||| |||||||||| |||||||||| AAAG-T---- -GT------- ----GCCTTT TTTTTTTAGC TTATAAGCTG TTTTAAGTTG 524 ACCATATTTT TATGTTTTTT CCCTTAATAT TTTTATACAA TCTCCAAATT ATCCATATAA 47203 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| | |||||||| ACCATATTTT TATGTTTTTT CCCTTAATAT TTTTATACAA TCTCCAAATT ACCCATATAA 584 CCCTAACATC TCTTTCTTCT ATTTTTCCCT TTTC 47237 | ||||| || |||||||||| |||||||||| |||| CACTAACTTC TCTTTCTTCT ATTTTTCCCT TTTC 618 hqPGS_C01HBa0088L02.1+_SGN-E249253+ (46953 47237) ******************************************************************************** EST sequence 5 +strand 387 n (File: SGN-E577960+) 1 CAAAAGTGTA AAACAAGCTC GAAACCTCTC AAAAATCATC CCCCAAATTC AACAAAACAC 61 TCGGAAATTC TGAGCCGAGC ATCCAAACCC CGAATGTTCA CCAAAGTCAA CCCAAAAGCC 121 CACAATTTCA CAACTTAGGA CCTCAAATCC TCAAAAAGAC TCAGAATACG AAACGAACAA 181 CTCTCACAAC TCAGATTCCA CATTCCGGTA CTGATGGTAT TGATGGAACT TTATTCCGAC 241 ACTCGAAGCT CCCAAAGGCT CCAAAAACCA CTTTTGAGCA ACTTAGAGCC TGTTTGGCTC 301 AGCTTAAAAG CTGGTCAAAC TGACTTAAAA GCTGGTTTTT GACTTATTTA ACTGTTTGGC 361 AATACTCAAA ACAGCTTATT TTAAGTT Predicted gene structure (within gDNA segment 43519 to 47932): Exon 1 46953 47061 ( 109 n); cDNA 280 387 ( 108 n); score: 0.945 MATCH C01HBa0088L02.1+ SGN-E577960+ 0.945 109 0.282 C PGS_C01HBa0088L02.1+_SGN-E577960+ (46953 47061) Alignment (genomic DNA sequence = upper lines): AAATTAAGAG CCTGTTTGGC TCAGCTTAAA AGCTGGTCAA ACTGACTTAA AATCTGATTT 47012 || || |||| |||||||||| |||||||||| |||||||||| |||||||||| || ||| ||| AACTT-AGAG CCTGTTTGGC TCAGCTTAAA AGCTGGTCAA ACTGACTTAA AAGCTGGTTT 338 TTGACTTATT TAACTGTTTG ACAATACTCA AAATAGCTTA TTTTAAGTT 47061 |||||||||| |||||||||| ||||||||| ||| |||||| ||||||||| TTGACTTATT TAACTGTTTG GCAATACTCA AAACAGCTTA TTTTAAGTT 387 hqPGS_C01HBa0088L02.1+_SGN-E577960+ (46953 47061) ******************************************************************************** EST sequence 128 -strand 528 n (File: SGN-E242674-) 1 GGTATTTAAG TGGAGATACG TAAAAAGACA AAATTATTAT CTCTGTGTTA CATAGTTGCA 61 AGTTGCAACT ATTTCTAACA ATCGACTCTA GATGATTTTT TTCGATTAAA ATAATAAAAA 121 AAGAAATTTA TATGAATAGT TATTTTTTTA ACCAAAGTGC ATAAATTGGA AACTCATAAA 181 TTTGTGACTT AGGTTACATG GTTGAGAACT GCCTCAAACT TATAATGTCT ACTATTTAAG 241 TGGAGATACG TAAAAGAAAA AATTATTGTC TAAGAGCTTG TTTAGTTCAG CTTAAAAGCT 301 GATCAAACTG ACTTAAAAAC TGATTTTTGA CTTATTTAGT TGTTTGGCAA TACTCAAAAT 361 AACTTATTTT AAGTTAAAAA AAAAAACTTA TTTTAAGCCA AAAGTTAAAA GCTGGGGTAG 421 GGGTGCTTTT TTTTTAGCTT ATAAGCTGTT TTAAGTTGAC CACATTTTTA TCTTTTTGCC 481 CTTAATATTT TTATACAATC TCCAAATTAT CCACATAACT CTAACATC Predicted gene structure (within gDNA segment 42759 to 47948): Exon 1 43912 43923 ( 12 n); cDNA 253 264 ( 12 n); score: 0.917 Intron 1 43924 44188 ( 265 n); Pd: 0.900 (s: 0), Pa: 0.930 (s: 0) Exon 2 44189 44193 ( 5 n); cDNA 265 269 ( 5 n); score: 0.800 Intron 2 44194 46955 (2762 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.88) Exon 3 46956 47213 ( 258 n); cDNA 270 528 ( 259 n); score: 0.901 MATCH C01HBa0088L02.1+ SGN-E242674- 0.901 275 0.521 C PGS_C01HBa0088L02.1+_SGN-E242674- (43912 43923,44189 44193,46956 47213) Alignment (genomic DNA sequence = upper lines): AAAGAAATAA TTATCTCCTT ATAAACATTA GATTAAAAGT TGCAAAAAGA TTAAAGCTTT 43971 ||||||| || || AAAGAAAAAA TT........ .......... .......... .......... .......... 264 AACCATATTG ATCGGAACAT AAACAACAAA ATATGCATTT TGGGTATCAA AGTAGTGTCA 44031 .......... .......... .......... .......... .......... .......... 264 TACATAATGA TTTGAATAAG GGTCTTGCCA AGACATCATT TAATCCGAAT TATTTGAGTG 44091 .......... .......... .......... .......... .......... .......... 264 ACTTGCCTTA TTTCATTGAA ATTCCAAGAG ATGTTTTTTA AAATTTTAAT TAACTTATCA 44151 .......... .......... .......... .......... .......... .......... 264 AGCACACAAC TAATTATATA AAATGTATAA TATTTAGATT TTGTATGTAG AGGGAGGCCT 44211 ||| | .......... .......... .......... .......ATT GT........ .......... 269 TGAATAAGAG AAGAACTCTC GCAATTGATG AATAAAATGT TTGTACCACT TTTGGAAAAT 44271 .......... .......... .......... .......... .......... .......... 269 ACAAATATAG ACAATGAAAC AATTACCTAT CTTTTCTAAA GATTTGGTGA TGAATAACTA 44331 .......... .......... .......... .......... .......... .......... 269 CAGTAAAATG AAGAATCAAT AACTAAATCC ATAAACACGT AGAATCAAAT CGTTTTAAGT 44391 .......... .......... .......... .......... .......... .......... 269 TTAAAAAAAT ATTTTATTTT GTCTTTGGAT AAAATATTCT TGACAATTTA TTGTTGGGTT 44451 .......... .......... .......... .......... .......... .......... 269 GTACCCATTC GAAAACACTT ATATTATCAA ATGTTCAGAA GTAGATTATT ACCGTAGTTT 44511 .......... .......... .......... .......... .......... .......... 269 ACCACCGCGC GAAAAGCATG CAATTTACCT TGTTAAATTA CAAGTGCTCA GATGCAATGA 44571 .......... .......... .......... .......... .......... .......... 269 TATGCTTTGA AAATTATTTT TGAAGAACTT CTCGTAGTTC TGTTTGGTCT GACTGCATTC 44631 .......... .......... .......... .......... .......... .......... 269 GTGCCAGCTA CTCACTTTTT GGCGTCACTT CATAATCTAA GTAGTTTTGT GTATTCAAAG 44691 .......... .......... .......... .......... .......... .......... 269 GCATAATGAG AAGACAAAGC TGACATAATT GTCCAAAGAA AAGAAAAAAG ACAAAGAAAT 44751 .......... .......... .......... .......... .......... .......... 269 TGTAGCATAA TAAACAGGAA TGGGTACCGT TACAGACATT TCTGTCTTTC TTCAAATCAA 44811 .......... .......... .......... .......... .......... .......... 269 ACAAAATTTG TTGTATTTTG ATTAGTTTTC TGGAGCCTCA GTATTGGATT AGGGCCTCAG 44871 .......... .......... .......... .......... .......... .......... 269 CTGCAGCCGT GATACAGGCA AATTGTTATG CTTTAGGAGA TCTGTATTTT AAATGGATGG 44931 .......... .......... .......... .......... .......... .......... 269 AATGATTCTT TTGGAATCTC TACATCTCTT GATGCTTCAT TTGACTAGCT ATTTAGTTGA 44991 .......... .......... .......... .......... .......... .......... 269 TCTTCTGGTG GATTCCCTTT TCAGGATGGA CGTATTGATT ATGGAGAATT TGTTGCTATG 45051 .......... .......... .......... .......... .......... .......... 269 ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC GAAATAGTCT GAATTTCAGC 45111 .......... .......... .......... .......... .......... .......... 269 ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA CACATGATGT AGGTATTTCC 45171 .......... .......... .......... .......... .......... .......... 269 CCTTTTTTAT TTTTGTAACC GTTTCTTTGG CAATGAATTT GAAGAAATCT TTCCTTGTTC 45231 .......... .......... .......... .......... .......... .......... 269 TGTCCTTGAG AAATTGGATT GGTTGGAGTA TATTTGTTTA ACATTAAGAG TTTCTTTTTC 45291 .......... .......... .......... .......... .......... .......... 269 CCTCTTGAGG ATAATAAAAT TTTATAAATA ACAGCATGAG TGTTTGCTGT AAAACTCTAC 45351 .......... .......... .......... .......... .......... .......... 269 AGGTGCAGCA AAAAAAATTA CATTCAGCAA AAGTATATCC CATCTTATCC TGTTGGTACA 45411 .......... .......... .......... .......... .......... .......... 269 CTAGCATGTC ACAGATAGAT TCAGCTTCCT CCCCAATCCT CCATTTTACA CCATTAACAA 45471 .......... .......... .......... .......... .......... .......... 269 AAATAAATTT CAGATACAGA GTTCTCTTTC ATTCCCATCT TTTATATAAT GCTGGTTTCT 45531 .......... .......... .......... .......... .......... .......... 269 TTTCTTTTGG TAAAATTTTG ATGTATCAAA TTTGACGATT GTCCGACATG GCTATGTGAG 45591 .......... .......... .......... .......... .......... .......... 269 GAACTTTCCT AAGGGAGCAC TAAGGGTGTC AAATGTGTGG GTGGAGGCAG TGGGGGACTG 45651 .......... .......... .......... .......... .......... .......... 269 AAATTGAAGA GGTTAAAATG GGCTGAGCTA AAAGTCATGT TGGATCATAA CCCACTCAAA 45711 .......... .......... .......... .......... .......... .......... 269 CTTACTTTGG GCTAACATGG GCTAGAATCT TGATTGGGTT ATGACCTATC CAATTTGACC 45771 .......... .......... .......... .......... .......... .......... 269 TGCTTAATCT AAACTAAACT ATATTAAACA CTTGCTATAA TTTATGACAG ATGTCATTCA 45831 .......... .......... .......... .......... .......... .......... 269 ACCCATAGAA TCGTACAGAT CTGTACTAAC TTTTCATTTA GGAGCATCTC CTTGTAGAGT 45891 .......... .......... .......... .......... .......... .......... 269 AAATTGATGT AGACTTTATA GTATGGGACC AACTTCATAA TTTTGCAACT CATTTAATAG 45951 .......... .......... .......... .......... .......... .......... 269 TGTATTTATG AGAATTATTG AAAAGAATAT TATTGAATTG TGTGTCTACA TTATTACATT 46011 .......... .......... .......... .......... .......... .......... 269 GAGACTTTAT TTATAGACAC TATATTATAC TCCTTTTCCA ACTAGGACAC TACAATACCA 46071 .......... .......... .......... .......... .......... .......... 269 TCCTTTTCTA AGTAGGATTC TATATACTAT TTCTATTCCT ATTCCTATTC TAAGTAGAAT 46131 .......... .......... .......... .......... .......... .......... 269 GGTATATATT ATTCTTGTTC CTTTTTTGAT TCTAACACTC CCCCTCAAGC TGGTGCATAC 46191 .......... .......... .......... .......... .......... .......... 269 AAGTTATATA TACTTTGCTT GTTACAAATG TAATTAATAT GAGGACCAAT GAGAGGCTTG 46251 .......... .......... .......... .......... .......... .......... 269 ATGAAGATAT CTGCAAGTTG ATCACTTGAC TCACAAATTT TGTAACAATA TCTCCCGACT 46311 .......... .......... .......... .......... .......... .......... 269 TCCCAGACCA AGCTTGAGAA GAACGTTTCA TATCATCGAG TGACTTGCAC AATCAACATA 46371 .......... .......... .......... .......... .......... .......... 269 TAAGGCTGCT AGACTCCCTC GGAGCAATAA GACCAAGTGG TTGCTCCATA TATACTTCTC 46431 .......... .......... .......... .......... .......... .......... 269 CATCGAGATC CCAGCCCAAA TATGTAAGTA TATCCTTTTG GATAAAGTGA ATCTAAAACA 46491 .......... .......... .......... .......... .......... .......... 269 AAGAGAATAT TGCTTGAAAA CTTGGATTTT TTTGGGAACT CGGATATGTT GGACTTTGCA 46551 .......... .......... .......... .......... .......... .......... 269 CAACATTGAC AAAGTTGAAA CTATTTAAAT CAGACCTAAG GAGTCACCGA AAAGACGTAC 46611 .......... .......... .......... .......... .......... .......... 269 GGTGCTTCGA AAATTAGATA TGAGAAAGTA GTCACCAAAA AGACGCATGA TGTTGTGCAA 46671 .......... .......... .......... .......... .......... .......... 269 ATTAGATATG AGAAAGTAGT CACCAAGAAG ATGAGACAGT GCTACATAAA TTAAATATGA 46731 .......... .......... .......... .......... .......... .......... 269 AAAAGTAGTC ACTGATAAGA TGGCACGGTG CTACACAAAT TAAATATGAA AAAGTAGTCA 46791 .......... .......... .......... .......... .......... .......... 269 TCAAAAAGAT GGTGCGATGC TACACAAAAG TAAATAGTCA CCGGAATGAT GACATGATGC 46851 .......... .......... .......... .......... .......... .......... 269 TACAAAAATG AAATATGAGA GTAGTCACCT GAAGGATGAC ACAGTGCCAC ATAAATTGAA 46911 .......... .......... .......... .......... .......... .......... 269 CATAAAAAAA TAGTCACCAG AAACATGATG CGGTGCTACA CAAATTAAGA GCCTGTTTGG 46971 ||||| || ||||| | .......... .......... .......... .......... ....CTAAGA GCTTGTTTAG 285 CTCAGCTTAA AAGCTGGTCA AACTGACTTA AAATCTGATT TTTGACTTAT TTAACTGTTT 47031 ||||||||| |||||| ||| |||||||||| ||| |||||| |||||||||| ||| ||||| TTCAGCTTAA AAGCTGATCA AACTGACTTA AAAACTGATT TTTGACTTAT TTAGTTGTTT 345 GACAATACTC AAAATAGCTT ATTTTAAGTT ---AAAAAAA ACTTATTTTA AGCCAAAAGT 47088 | |||||||| |||||| ||| |||||||||| ||||||| |||||||||| |||||||||| GGCAATACTC AAAATAACTT ATTTTAAGTT AAAAAAAAAA ACTTATTTTA AGCCAAAAGT 405 TAAAAGGTGG GGTAGGGGTG CTTTTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAT 47148 |||||| ||| |||||||||| | ||||||| |||||||||| |||||||||| ||||||||| TAAAAGCTGG GGTAGGGGTG C--TTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAC 463 ATTTTTATGT TTTTTCCCTT AATATTTTTA TACAATCTCC AAATTATCCA TATAACCCTA 47208 |||||||| | |||| ||||| |||||||||| |||||||||| |||||||||| ||||| ||| ATTTTTATCT TTTTGCCCTT AATATTTTTA TACAATCTCC AAATTATCCA CATAACTCTA 523 ACATC 47213 ||||| ACATC 528 hqPGS_C01HBa0088L02.1+_SGN-E242674- (46956 47213) ******************************************************************************** EST sequence 174 -strand 643 n (File: SGN-E233074-) 1 TAGGTGTTAG TTGATAAATA TTAAGCGTTA AATTCGATTT TTTATATATA AGTTTTCTAG 61 TGCTTAAATA TAATTGGGAA GGTCAAGGGG TTTGTGACTT AAGTTAGTGA TGTCTGGTAT 121 TTAAGTGGAG ATACGTAAAA AGACAAAATT ATTATCTCTG TGTTACATAG TTGCAAGTTG 181 CAACTATTTC TAACAATCGA CTCTAGATGA TTTTTTTCGA TTAAAATAAT AAAAAAAGAA 241 ATTTATATGA ATAGTTATTT TTTTAACCAA AGTGCATAAA TTGGAAACTC ATAAATTTGT 301 GACTTAGGTT ACATGGTTGA GAACTGCCTC AAACTTATAA TGTCTACTAT TTAAGTGGAG 361 ATACGTAAAA GAAAAAATTA TTGTCTAAGA GCTTGTTTAG TTCAGCTTAA AAGCTGATCA 421 AACTGACTTA AAAACTGATT TTTGACTTAT TTAGTTGTTT GGCAATACTC AAAATAACTT 481 ATTTTAAGTT AAAAAAAAAA ACTTATTTTA AGCCAAAAGT TAAAAGCTGG GGTAGGGGTG 541 CTTTTTTTTT AGCTTATAAG CTGTTTTAAG TTGACCACAT TTTTATCTTT TTGCCCTTAA 601 TATTTTTATA CAATCTCCAA ATTATCCACA TAACTCTAAC ATC Predicted gene structure (within gDNA segment 42209 to 47948): Exon 1 43912 43923 ( 12 n); cDNA 368 379 ( 12 n); score: 0.917 Intron 1 43924 44188 ( 265 n); Pd: 0.900 (s: 0), Pa: 0.930 (s: 0) Exon 2 44189 44193 ( 5 n); cDNA 380 384 ( 5 n); score: 0.800 Intron 2 44194 46955 (2762 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.88) Exon 3 46956 47213 ( 258 n); cDNA 385 643 ( 259 n); score: 0.901 MATCH C01HBa0088L02.1+ SGN-E233074- 0.901 275 0.428 C PGS_C01HBa0088L02.1+_SGN-E233074- (43912 43923,44189 44193,46956 47213) Alignment (genomic DNA sequence = upper lines): AAAGAAATAA TTATCTCCTT ATAAACATTA GATTAAAAGT TGCAAAAAGA TTAAAGCTTT 43971 ||||||| || || AAAGAAAAAA TT........ .......... .......... .......... .......... 379 AACCATATTG ATCGGAACAT AAACAACAAA ATATGCATTT TGGGTATCAA AGTAGTGTCA 44031 .......... .......... .......... .......... .......... .......... 379 TACATAATGA TTTGAATAAG GGTCTTGCCA AGACATCATT TAATCCGAAT TATTTGAGTG 44091 .......... .......... .......... .......... .......... .......... 379 ACTTGCCTTA TTTCATTGAA ATTCCAAGAG ATGTTTTTTA AAATTTTAAT TAACTTATCA 44151 .......... .......... .......... .......... .......... .......... 379 AGCACACAAC TAATTATATA AAATGTATAA TATTTAGATT TTGTATGTAG AGGGAGGCCT 44211 ||| | .......... .......... .......... .......ATT GT........ .......... 384 TGAATAAGAG AAGAACTCTC GCAATTGATG AATAAAATGT TTGTACCACT TTTGGAAAAT 44271 .......... .......... .......... .......... .......... .......... 384 ACAAATATAG ACAATGAAAC AATTACCTAT CTTTTCTAAA GATTTGGTGA TGAATAACTA 44331 .......... .......... .......... .......... .......... .......... 384 CAGTAAAATG AAGAATCAAT AACTAAATCC ATAAACACGT AGAATCAAAT CGTTTTAAGT 44391 .......... .......... .......... .......... .......... .......... 384 TTAAAAAAAT ATTTTATTTT GTCTTTGGAT AAAATATTCT TGACAATTTA TTGTTGGGTT 44451 .......... .......... .......... .......... .......... .......... 384 GTACCCATTC GAAAACACTT ATATTATCAA ATGTTCAGAA GTAGATTATT ACCGTAGTTT 44511 .......... .......... .......... .......... .......... .......... 384 ACCACCGCGC GAAAAGCATG CAATTTACCT TGTTAAATTA CAAGTGCTCA GATGCAATGA 44571 .......... .......... .......... .......... .......... .......... 384 TATGCTTTGA AAATTATTTT TGAAGAACTT CTCGTAGTTC TGTTTGGTCT GACTGCATTC 44631 .......... .......... .......... .......... .......... .......... 384 GTGCCAGCTA CTCACTTTTT GGCGTCACTT CATAATCTAA GTAGTTTTGT GTATTCAAAG 44691 .......... .......... .......... .......... .......... .......... 384 GCATAATGAG AAGACAAAGC TGACATAATT GTCCAAAGAA AAGAAAAAAG ACAAAGAAAT 44751 .......... .......... .......... .......... .......... .......... 384 TGTAGCATAA TAAACAGGAA TGGGTACCGT TACAGACATT TCTGTCTTTC TTCAAATCAA 44811 .......... .......... .......... .......... .......... .......... 384 ACAAAATTTG TTGTATTTTG ATTAGTTTTC TGGAGCCTCA GTATTGGATT AGGGCCTCAG 44871 .......... .......... .......... .......... .......... .......... 384 CTGCAGCCGT GATACAGGCA AATTGTTATG CTTTAGGAGA TCTGTATTTT AAATGGATGG 44931 .......... .......... .......... .......... .......... .......... 384 AATGATTCTT TTGGAATCTC TACATCTCTT GATGCTTCAT TTGACTAGCT ATTTAGTTGA 44991 .......... .......... .......... .......... .......... .......... 384 TCTTCTGGTG GATTCCCTTT TCAGGATGGA CGTATTGATT ATGGAGAATT TGTTGCTATG 45051 .......... .......... .......... .......... .......... .......... 384 ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC GAAATAGTCT GAATTTCAGC 45111 .......... .......... .......... .......... .......... .......... 384 ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA CACATGATGT AGGTATTTCC 45171 .......... .......... .......... .......... .......... .......... 384 CCTTTTTTAT TTTTGTAACC GTTTCTTTGG CAATGAATTT GAAGAAATCT TTCCTTGTTC 45231 .......... .......... .......... .......... .......... .......... 384 TGTCCTTGAG AAATTGGATT GGTTGGAGTA TATTTGTTTA ACATTAAGAG TTTCTTTTTC 45291 .......... .......... .......... .......... .......... .......... 384 CCTCTTGAGG ATAATAAAAT TTTATAAATA ACAGCATGAG TGTTTGCTGT AAAACTCTAC 45351 .......... .......... .......... .......... .......... .......... 384 AGGTGCAGCA AAAAAAATTA CATTCAGCAA AAGTATATCC CATCTTATCC TGTTGGTACA 45411 .......... .......... .......... .......... .......... .......... 384 CTAGCATGTC ACAGATAGAT TCAGCTTCCT CCCCAATCCT CCATTTTACA CCATTAACAA 45471 .......... .......... .......... .......... .......... .......... 384 AAATAAATTT CAGATACAGA GTTCTCTTTC ATTCCCATCT TTTATATAAT GCTGGTTTCT 45531 .......... .......... .......... .......... .......... .......... 384 TTTCTTTTGG TAAAATTTTG ATGTATCAAA TTTGACGATT GTCCGACATG GCTATGTGAG 45591 .......... .......... .......... .......... .......... .......... 384 GAACTTTCCT AAGGGAGCAC TAAGGGTGTC AAATGTGTGG GTGGAGGCAG TGGGGGACTG 45651 .......... .......... .......... .......... .......... .......... 384 AAATTGAAGA GGTTAAAATG GGCTGAGCTA AAAGTCATGT TGGATCATAA CCCACTCAAA 45711 .......... .......... .......... .......... .......... .......... 384 CTTACTTTGG GCTAACATGG GCTAGAATCT TGATTGGGTT ATGACCTATC CAATTTGACC 45771 .......... .......... .......... .......... .......... .......... 384 TGCTTAATCT AAACTAAACT ATATTAAACA CTTGCTATAA TTTATGACAG ATGTCATTCA 45831 .......... .......... .......... .......... .......... .......... 384 ACCCATAGAA TCGTACAGAT CTGTACTAAC TTTTCATTTA GGAGCATCTC CTTGTAGAGT 45891 .......... .......... .......... .......... .......... .......... 384 AAATTGATGT AGACTTTATA GTATGGGACC AACTTCATAA TTTTGCAACT CATTTAATAG 45951 .......... .......... .......... .......... .......... .......... 384 TGTATTTATG AGAATTATTG AAAAGAATAT TATTGAATTG TGTGTCTACA TTATTACATT 46011 .......... .......... .......... .......... .......... .......... 384 GAGACTTTAT TTATAGACAC TATATTATAC TCCTTTTCCA ACTAGGACAC TACAATACCA 46071 .......... .......... .......... .......... .......... .......... 384 TCCTTTTCTA AGTAGGATTC TATATACTAT TTCTATTCCT ATTCCTATTC TAAGTAGAAT 46131 .......... .......... .......... .......... .......... .......... 384 GGTATATATT ATTCTTGTTC CTTTTTTGAT TCTAACACTC CCCCTCAAGC TGGTGCATAC 46191 .......... .......... .......... .......... .......... .......... 384 AAGTTATATA TACTTTGCTT GTTACAAATG TAATTAATAT GAGGACCAAT GAGAGGCTTG 46251 .......... .......... .......... .......... .......... .......... 384 ATGAAGATAT CTGCAAGTTG ATCACTTGAC TCACAAATTT TGTAACAATA TCTCCCGACT 46311 .......... .......... .......... .......... .......... .......... 384 TCCCAGACCA AGCTTGAGAA GAACGTTTCA TATCATCGAG TGACTTGCAC AATCAACATA 46371 .......... .......... .......... .......... .......... .......... 384 TAAGGCTGCT AGACTCCCTC GGAGCAATAA GACCAAGTGG TTGCTCCATA TATACTTCTC 46431 .......... .......... .......... .......... .......... .......... 384 CATCGAGATC CCAGCCCAAA TATGTAAGTA TATCCTTTTG GATAAAGTGA ATCTAAAACA 46491 .......... .......... .......... .......... .......... .......... 384 AAGAGAATAT TGCTTGAAAA CTTGGATTTT TTTGGGAACT CGGATATGTT GGACTTTGCA 46551 .......... .......... .......... .......... .......... .......... 384 CAACATTGAC AAAGTTGAAA CTATTTAAAT CAGACCTAAG GAGTCACCGA AAAGACGTAC 46611 .......... .......... .......... .......... .......... .......... 384 GGTGCTTCGA AAATTAGATA TGAGAAAGTA GTCACCAAAA AGACGCATGA TGTTGTGCAA 46671 .......... .......... .......... .......... .......... .......... 384 ATTAGATATG AGAAAGTAGT CACCAAGAAG ATGAGACAGT GCTACATAAA TTAAATATGA 46731 .......... .......... .......... .......... .......... .......... 384 AAAAGTAGTC ACTGATAAGA TGGCACGGTG CTACACAAAT TAAATATGAA AAAGTAGTCA 46791 .......... .......... .......... .......... .......... .......... 384 TCAAAAAGAT GGTGCGATGC TACACAAAAG TAAATAGTCA CCGGAATGAT GACATGATGC 46851 .......... .......... .......... .......... .......... .......... 384 TACAAAAATG AAATATGAGA GTAGTCACCT GAAGGATGAC ACAGTGCCAC ATAAATTGAA 46911 .......... .......... .......... .......... .......... .......... 384 CATAAAAAAA TAGTCACCAG AAACATGATG CGGTGCTACA CAAATTAAGA GCCTGTTTGG 46971 ||||| || ||||| | .......... .......... .......... .......... ....CTAAGA GCTTGTTTAG 400 CTCAGCTTAA AAGCTGGTCA AACTGACTTA AAATCTGATT TTTGACTTAT TTAACTGTTT 47031 ||||||||| |||||| ||| |||||||||| ||| |||||| |||||||||| ||| ||||| TTCAGCTTAA AAGCTGATCA AACTGACTTA AAAACTGATT TTTGACTTAT TTAGTTGTTT 460 GACAATACTC AAAATAGCTT ATTTTAAGTT ---AAAAAAA ACTTATTTTA AGCCAAAAGT 47088 | |||||||| |||||| ||| |||||||||| ||||||| |||||||||| |||||||||| GGCAATACTC AAAATAACTT ATTTTAAGTT AAAAAAAAAA ACTTATTTTA AGCCAAAAGT 520 TAAAAGGTGG GGTAGGGGTG CTTTTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAT 47148 |||||| ||| |||||||||| | ||||||| |||||||||| |||||||||| ||||||||| TAAAAGCTGG GGTAGGGGTG C--TTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAC 578 ATTTTTATGT TTTTTCCCTT AATATTTTTA TACAATCTCC AAATTATCCA TATAACCCTA 47208 |||||||| | |||| ||||| |||||||||| |||||||||| |||||||||| ||||| ||| ATTTTTATCT TTTTGCCCTT AATATTTTTA TACAATCTCC AAATTATCCA CATAACTCTA 638 ACATC 47213 ||||| ACATC 643 hqPGS_C01HBa0088L02.1+_SGN-E233074- (46956 47213) ******************************************************************************** EST sequence 225 -strand 514 n (File: SGN-E233735-) 1 GATACGTAAA AAGACAAAAT TATTATCTCT GTGTTACATA GTTGCAAGTT GCAACTATTT 61 CTAACAATCG ACTCTAGATG ATTTTTTTCG ATTAAAATAA TAAAAAAAGA AATTTATATG 121 AATAGTTATT TTTTTAACCA AAGTGCATAA ATTGGAAACT CATAAATTTG TGACTTAGGT 181 TACATGGTTG AGAACTGCCT CAAACTTATA ATGTCTACTA TTTAAGTGGA GATACGTAAA 241 AGAAAAAATT ATTGTCTAAG AGCTTGTTTA GTTCAGCTTA AAAGCTGATC AAACTGACTT 301 AAAAACTGAT TTTTGACTTA TTTAGTTGTT TGGCAATACT CAAAATAACT TATTTTAAGT 361 TAAAAAAAAA AACTTATTTT AAGCCAAAAG TTAAAAGCTG GGGTAGGGGT GCTTTTTTTT 421 TAGCTTATAA GCTGTTTTAA GTTGACCACA TTTTTATCTT TTTGCCCTTA ATATTTTTAT 481 ACAATCTCCA AATTATCCAC ATAACTCTAA CATC Predicted gene structure (within gDNA segment 42899 to 47948): Exon 1 43912 43923 ( 12 n); cDNA 239 250 ( 12 n); score: 0.917 Intron 1 43924 44188 ( 265 n); Pd: 0.900 (s: 0), Pa: 0.930 (s: 0) Exon 2 44189 44193 ( 5 n); cDNA 251 255 ( 5 n); score: 0.800 Intron 2 44194 46955 (2762 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.88) Exon 3 46956 47213 ( 258 n); cDNA 256 514 ( 259 n); score: 0.901 MATCH C01HBa0088L02.1+ SGN-E233735- 0.901 275 0.535 C PGS_C01HBa0088L02.1+_SGN-E233735- (43912 43923,44189 44193,46956 47213) Alignment (genomic DNA sequence = upper lines): AAAGAAATAA TTATCTCCTT ATAAACATTA GATTAAAAGT TGCAAAAAGA TTAAAGCTTT 43971 ||||||| || || AAAGAAAAAA TT........ .......... .......... .......... .......... 250 AACCATATTG ATCGGAACAT AAACAACAAA ATATGCATTT TGGGTATCAA AGTAGTGTCA 44031 .......... .......... .......... .......... .......... .......... 250 TACATAATGA TTTGAATAAG GGTCTTGCCA AGACATCATT TAATCCGAAT TATTTGAGTG 44091 .......... .......... .......... .......... .......... .......... 250 ACTTGCCTTA TTTCATTGAA ATTCCAAGAG ATGTTTTTTA AAATTTTAAT TAACTTATCA 44151 .......... .......... .......... .......... .......... .......... 250 AGCACACAAC TAATTATATA AAATGTATAA TATTTAGATT TTGTATGTAG AGGGAGGCCT 44211 ||| | .......... .......... .......... .......ATT GT........ .......... 255 TGAATAAGAG AAGAACTCTC GCAATTGATG AATAAAATGT TTGTACCACT TTTGGAAAAT 44271 .......... .......... .......... .......... .......... .......... 255 ACAAATATAG ACAATGAAAC AATTACCTAT CTTTTCTAAA GATTTGGTGA TGAATAACTA 44331 .......... .......... .......... .......... .......... .......... 255 CAGTAAAATG AAGAATCAAT AACTAAATCC ATAAACACGT AGAATCAAAT CGTTTTAAGT 44391 .......... .......... .......... .......... .......... .......... 255 TTAAAAAAAT ATTTTATTTT GTCTTTGGAT AAAATATTCT TGACAATTTA TTGTTGGGTT 44451 .......... .......... .......... .......... .......... .......... 255 GTACCCATTC GAAAACACTT ATATTATCAA ATGTTCAGAA GTAGATTATT ACCGTAGTTT 44511 .......... .......... .......... .......... .......... .......... 255 ACCACCGCGC GAAAAGCATG CAATTTACCT TGTTAAATTA CAAGTGCTCA GATGCAATGA 44571 .......... .......... .......... .......... .......... .......... 255 TATGCTTTGA AAATTATTTT TGAAGAACTT CTCGTAGTTC TGTTTGGTCT GACTGCATTC 44631 .......... .......... .......... .......... .......... .......... 255 GTGCCAGCTA CTCACTTTTT GGCGTCACTT CATAATCTAA GTAGTTTTGT GTATTCAAAG 44691 .......... .......... .......... .......... .......... .......... 255 GCATAATGAG AAGACAAAGC TGACATAATT GTCCAAAGAA AAGAAAAAAG ACAAAGAAAT 44751 .......... .......... .......... .......... .......... .......... 255 TGTAGCATAA TAAACAGGAA TGGGTACCGT TACAGACATT TCTGTCTTTC TTCAAATCAA 44811 .......... .......... .......... .......... .......... .......... 255 ACAAAATTTG TTGTATTTTG ATTAGTTTTC TGGAGCCTCA GTATTGGATT AGGGCCTCAG 44871 .......... .......... .......... .......... .......... .......... 255 CTGCAGCCGT GATACAGGCA AATTGTTATG CTTTAGGAGA TCTGTATTTT AAATGGATGG 44931 .......... .......... .......... .......... .......... .......... 255 AATGATTCTT TTGGAATCTC TACATCTCTT GATGCTTCAT TTGACTAGCT ATTTAGTTGA 44991 .......... .......... .......... .......... .......... .......... 255 TCTTCTGGTG GATTCCCTTT TCAGGATGGA CGTATTGATT ATGGAGAATT TGTTGCTATG 45051 .......... .......... .......... .......... .......... .......... 255 ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC GAAATAGTCT GAATTTCAGC 45111 .......... .......... .......... .......... .......... .......... 255 ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA CACATGATGT AGGTATTTCC 45171 .......... .......... .......... .......... .......... .......... 255 CCTTTTTTAT TTTTGTAACC GTTTCTTTGG CAATGAATTT GAAGAAATCT TTCCTTGTTC 45231 .......... .......... .......... .......... .......... .......... 255 TGTCCTTGAG AAATTGGATT GGTTGGAGTA TATTTGTTTA ACATTAAGAG TTTCTTTTTC 45291 .......... .......... .......... .......... .......... .......... 255 CCTCTTGAGG ATAATAAAAT TTTATAAATA ACAGCATGAG TGTTTGCTGT AAAACTCTAC 45351 .......... .......... .......... .......... .......... .......... 255 AGGTGCAGCA AAAAAAATTA CATTCAGCAA AAGTATATCC CATCTTATCC TGTTGGTACA 45411 .......... .......... .......... .......... .......... .......... 255 CTAGCATGTC ACAGATAGAT TCAGCTTCCT CCCCAATCCT CCATTTTACA CCATTAACAA 45471 .......... .......... .......... .......... .......... .......... 255 AAATAAATTT CAGATACAGA GTTCTCTTTC ATTCCCATCT TTTATATAAT GCTGGTTTCT 45531 .......... .......... .......... .......... .......... .......... 255 TTTCTTTTGG TAAAATTTTG ATGTATCAAA TTTGACGATT GTCCGACATG GCTATGTGAG 45591 .......... .......... .......... .......... .......... .......... 255 GAACTTTCCT AAGGGAGCAC TAAGGGTGTC AAATGTGTGG GTGGAGGCAG TGGGGGACTG 45651 .......... .......... .......... .......... .......... .......... 255 AAATTGAAGA GGTTAAAATG GGCTGAGCTA AAAGTCATGT TGGATCATAA CCCACTCAAA 45711 .......... .......... .......... .......... .......... .......... 255 CTTACTTTGG GCTAACATGG GCTAGAATCT TGATTGGGTT ATGACCTATC CAATTTGACC 45771 .......... .......... .......... .......... .......... .......... 255 TGCTTAATCT AAACTAAACT ATATTAAACA CTTGCTATAA TTTATGACAG ATGTCATTCA 45831 .......... .......... .......... .......... .......... .......... 255 ACCCATAGAA TCGTACAGAT CTGTACTAAC TTTTCATTTA GGAGCATCTC CTTGTAGAGT 45891 .......... .......... .......... .......... .......... .......... 255 AAATTGATGT AGACTTTATA GTATGGGACC AACTTCATAA TTTTGCAACT CATTTAATAG 45951 .......... .......... .......... .......... .......... .......... 255 TGTATTTATG AGAATTATTG AAAAGAATAT TATTGAATTG TGTGTCTACA TTATTACATT 46011 .......... .......... .......... .......... .......... .......... 255 GAGACTTTAT TTATAGACAC TATATTATAC TCCTTTTCCA ACTAGGACAC TACAATACCA 46071 .......... .......... .......... .......... .......... .......... 255 TCCTTTTCTA AGTAGGATTC TATATACTAT TTCTATTCCT ATTCCTATTC TAAGTAGAAT 46131 .......... .......... .......... .......... .......... .......... 255 GGTATATATT ATTCTTGTTC CTTTTTTGAT TCTAACACTC CCCCTCAAGC TGGTGCATAC 46191 .......... .......... .......... .......... .......... .......... 255 AAGTTATATA TACTTTGCTT GTTACAAATG TAATTAATAT GAGGACCAAT GAGAGGCTTG 46251 .......... .......... .......... .......... .......... .......... 255 ATGAAGATAT CTGCAAGTTG ATCACTTGAC TCACAAATTT TGTAACAATA TCTCCCGACT 46311 .......... .......... .......... .......... .......... .......... 255 TCCCAGACCA AGCTTGAGAA GAACGTTTCA TATCATCGAG TGACTTGCAC AATCAACATA 46371 .......... .......... .......... .......... .......... .......... 255 TAAGGCTGCT AGACTCCCTC GGAGCAATAA GACCAAGTGG TTGCTCCATA TATACTTCTC 46431 .......... .......... .......... .......... .......... .......... 255 CATCGAGATC CCAGCCCAAA TATGTAAGTA TATCCTTTTG GATAAAGTGA ATCTAAAACA 46491 .......... .......... .......... .......... .......... .......... 255 AAGAGAATAT TGCTTGAAAA CTTGGATTTT TTTGGGAACT CGGATATGTT GGACTTTGCA 46551 .......... .......... .......... .......... .......... .......... 255 CAACATTGAC AAAGTTGAAA CTATTTAAAT CAGACCTAAG GAGTCACCGA AAAGACGTAC 46611 .......... .......... .......... .......... .......... .......... 255 GGTGCTTCGA AAATTAGATA TGAGAAAGTA GTCACCAAAA AGACGCATGA TGTTGTGCAA 46671 .......... .......... .......... .......... .......... .......... 255 ATTAGATATG AGAAAGTAGT CACCAAGAAG ATGAGACAGT GCTACATAAA TTAAATATGA 46731 .......... .......... .......... .......... .......... .......... 255 AAAAGTAGTC ACTGATAAGA TGGCACGGTG CTACACAAAT TAAATATGAA AAAGTAGTCA 46791 .......... .......... .......... .......... .......... .......... 255 TCAAAAAGAT GGTGCGATGC TACACAAAAG TAAATAGTCA CCGGAATGAT GACATGATGC 46851 .......... .......... .......... .......... .......... .......... 255 TACAAAAATG AAATATGAGA GTAGTCACCT GAAGGATGAC ACAGTGCCAC ATAAATTGAA 46911 .......... .......... .......... .......... .......... .......... 255 CATAAAAAAA TAGTCACCAG AAACATGATG CGGTGCTACA CAAATTAAGA GCCTGTTTGG 46971 ||||| || ||||| | .......... .......... .......... .......... ....CTAAGA GCTTGTTTAG 271 CTCAGCTTAA AAGCTGGTCA AACTGACTTA AAATCTGATT TTTGACTTAT TTAACTGTTT 47031 ||||||||| |||||| ||| |||||||||| ||| |||||| |||||||||| ||| ||||| TTCAGCTTAA AAGCTGATCA AACTGACTTA AAAACTGATT TTTGACTTAT TTAGTTGTTT 331 GACAATACTC AAAATAGCTT ATTTTAAGTT ---AAAAAAA ACTTATTTTA AGCCAAAAGT 47088 | |||||||| |||||| ||| |||||||||| ||||||| |||||||||| |||||||||| GGCAATACTC AAAATAACTT ATTTTAAGTT AAAAAAAAAA ACTTATTTTA AGCCAAAAGT 391 TAAAAGGTGG GGTAGGGGTG CTTTTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAT 47148 |||||| ||| |||||||||| | ||||||| |||||||||| |||||||||| ||||||||| TAAAAGCTGG GGTAGGGGTG C--TTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAC 449 ATTTTTATGT TTTTTCCCTT AATATTTTTA TACAATCTCC AAATTATCCA TATAACCCTA 47208 |||||||| | |||| ||||| |||||||||| |||||||||| |||||||||| ||||| ||| ATTTTTATCT TTTTGCCCTT AATATTTTTA TACAATCTCC AAATTATCCA CATAACTCTA 509 ACATC 47213 ||||| ACATC 514 hqPGS_C01HBa0088L02.1+_SGN-E233735- (46956 47213) ******************************************************************************** EST sequence 226 -strand 484 n (File: SGN-E377238-) 1 GTGTTACATA GTTGCAAGTT GCAACTATTT CTAACAATCG ACTCTAGATG ATTTTTTTCG 61 ATTAAAATAA TAAAAAAAGA AATTTATATG AATAGTTATT TTTTTAACCA AAGTGCATAA 121 ATTGGAAACT CATAAATTTG TGACTTAGGT TACATGGTTG AGAACTGCCT CAAACTTATA 181 ATGTCTACTA TTTAAGTGGA GATACGTAAA AGAAAAAATT ATTGTCTAAG AGCTTGTTTA 241 GTTCAGCTTA AAAGCTGATC AAACTGACTT AAAAACTGAT TTTTGACTTA TTTAGTTGTT 301 TGGCAATACT CAAAATAACT TATTTTAAGT TAAAAAAAAA AACTTATTTT AAGCCAAAAG 361 TTAAAAGCTG GGGTAGGGGT GCTTTTTTTT TAGCTTATAA GCTGTTTTAA GTTGACCACA 421 TTTTTATCTT TTTGCCCTTA ATATTTTTAT ACAATCTCCA AATTATCCAC ATAACTCTAA 481 CATC Predicted gene structure (within gDNA segment 43199 to 47948): Exon 1 43912 43923 ( 12 n); cDNA 209 220 ( 12 n); score: 0.917 Intron 1 43924 44188 ( 265 n); Pd: 0.900 (s: 0), Pa: 0.930 (s: 0) Exon 2 44189 44193 ( 5 n); cDNA 221 225 ( 5 n); score: 0.800 Intron 2 44194 46955 (2762 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.88) Exon 3 46956 47213 ( 258 n); cDNA 226 484 ( 259 n); score: 0.901 MATCH C01HBa0088L02.1+ SGN-E377238- 0.901 275 0.568 C PGS_C01HBa0088L02.1+_SGN-E377238- (43912 43923,44189 44193,46956 47213) Alignment (genomic DNA sequence = upper lines): AAAGAAATAA TTATCTCCTT ATAAACATTA GATTAAAAGT TGCAAAAAGA TTAAAGCTTT 43971 ||||||| || || AAAGAAAAAA TT........ .......... .......... .......... .......... 220 AACCATATTG ATCGGAACAT AAACAACAAA ATATGCATTT TGGGTATCAA AGTAGTGTCA 44031 .......... .......... .......... .......... .......... .......... 220 TACATAATGA TTTGAATAAG GGTCTTGCCA AGACATCATT TAATCCGAAT TATTTGAGTG 44091 .......... .......... .......... .......... .......... .......... 220 ACTTGCCTTA TTTCATTGAA ATTCCAAGAG ATGTTTTTTA AAATTTTAAT TAACTTATCA 44151 .......... .......... .......... .......... .......... .......... 220 AGCACACAAC TAATTATATA AAATGTATAA TATTTAGATT TTGTATGTAG AGGGAGGCCT 44211 ||| | .......... .......... .......... .......ATT GT........ .......... 225 TGAATAAGAG AAGAACTCTC GCAATTGATG AATAAAATGT TTGTACCACT TTTGGAAAAT 44271 .......... .......... .......... .......... .......... .......... 225 ACAAATATAG ACAATGAAAC AATTACCTAT CTTTTCTAAA GATTTGGTGA TGAATAACTA 44331 .......... .......... .......... .......... .......... .......... 225 CAGTAAAATG AAGAATCAAT AACTAAATCC ATAAACACGT AGAATCAAAT CGTTTTAAGT 44391 .......... .......... .......... .......... .......... .......... 225 TTAAAAAAAT ATTTTATTTT GTCTTTGGAT AAAATATTCT TGACAATTTA TTGTTGGGTT 44451 .......... .......... .......... .......... .......... .......... 225 GTACCCATTC GAAAACACTT ATATTATCAA ATGTTCAGAA GTAGATTATT ACCGTAGTTT 44511 .......... .......... .......... .......... .......... .......... 225 ACCACCGCGC GAAAAGCATG CAATTTACCT TGTTAAATTA CAAGTGCTCA GATGCAATGA 44571 .......... .......... .......... .......... .......... .......... 225 TATGCTTTGA AAATTATTTT TGAAGAACTT CTCGTAGTTC TGTTTGGTCT GACTGCATTC 44631 .......... .......... .......... .......... .......... .......... 225 GTGCCAGCTA CTCACTTTTT GGCGTCACTT CATAATCTAA GTAGTTTTGT GTATTCAAAG 44691 .......... .......... .......... .......... .......... .......... 225 GCATAATGAG AAGACAAAGC TGACATAATT GTCCAAAGAA AAGAAAAAAG ACAAAGAAAT 44751 .......... .......... .......... .......... .......... .......... 225 TGTAGCATAA TAAACAGGAA TGGGTACCGT TACAGACATT TCTGTCTTTC TTCAAATCAA 44811 .......... .......... .......... .......... .......... .......... 225 ACAAAATTTG TTGTATTTTG ATTAGTTTTC TGGAGCCTCA GTATTGGATT AGGGCCTCAG 44871 .......... .......... .......... .......... .......... .......... 225 CTGCAGCCGT GATACAGGCA AATTGTTATG CTTTAGGAGA TCTGTATTTT AAATGGATGG 44931 .......... .......... .......... .......... .......... .......... 225 AATGATTCTT TTGGAATCTC TACATCTCTT GATGCTTCAT TTGACTAGCT ATTTAGTTGA 44991 .......... .......... .......... .......... .......... .......... 225 TCTTCTGGTG GATTCCCTTT TCAGGATGGA CGTATTGATT ATGGAGAATT TGTTGCTATG 45051 .......... .......... .......... .......... .......... .......... 225 ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC GAAATAGTCT GAATTTCAGC 45111 .......... .......... .......... .......... .......... .......... 225 ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA CACATGATGT AGGTATTTCC 45171 .......... .......... .......... .......... .......... .......... 225 CCTTTTTTAT TTTTGTAACC GTTTCTTTGG CAATGAATTT GAAGAAATCT TTCCTTGTTC 45231 .......... .......... .......... .......... .......... .......... 225 TGTCCTTGAG AAATTGGATT GGTTGGAGTA TATTTGTTTA ACATTAAGAG TTTCTTTTTC 45291 .......... .......... .......... .......... .......... .......... 225 CCTCTTGAGG ATAATAAAAT TTTATAAATA ACAGCATGAG TGTTTGCTGT AAAACTCTAC 45351 .......... .......... .......... .......... .......... .......... 225 AGGTGCAGCA AAAAAAATTA CATTCAGCAA AAGTATATCC CATCTTATCC TGTTGGTACA 45411 .......... .......... .......... .......... .......... .......... 225 CTAGCATGTC ACAGATAGAT TCAGCTTCCT CCCCAATCCT CCATTTTACA CCATTAACAA 45471 .......... .......... .......... .......... .......... .......... 225 AAATAAATTT CAGATACAGA GTTCTCTTTC ATTCCCATCT TTTATATAAT GCTGGTTTCT 45531 .......... .......... .......... .......... .......... .......... 225 TTTCTTTTGG TAAAATTTTG ATGTATCAAA TTTGACGATT GTCCGACATG GCTATGTGAG 45591 .......... .......... .......... .......... .......... .......... 225 GAACTTTCCT AAGGGAGCAC TAAGGGTGTC AAATGTGTGG GTGGAGGCAG TGGGGGACTG 45651 .......... .......... .......... .......... .......... .......... 225 AAATTGAAGA GGTTAAAATG GGCTGAGCTA AAAGTCATGT TGGATCATAA CCCACTCAAA 45711 .......... .......... .......... .......... .......... .......... 225 CTTACTTTGG GCTAACATGG GCTAGAATCT TGATTGGGTT ATGACCTATC CAATTTGACC 45771 .......... .......... .......... .......... .......... .......... 225 TGCTTAATCT AAACTAAACT ATATTAAACA CTTGCTATAA TTTATGACAG ATGTCATTCA 45831 .......... .......... .......... .......... .......... .......... 225 ACCCATAGAA TCGTACAGAT CTGTACTAAC TTTTCATTTA GGAGCATCTC CTTGTAGAGT 45891 .......... .......... .......... .......... .......... .......... 225 AAATTGATGT AGACTTTATA GTATGGGACC AACTTCATAA TTTTGCAACT CATTTAATAG 45951 .......... .......... .......... .......... .......... .......... 225 TGTATTTATG AGAATTATTG AAAAGAATAT TATTGAATTG TGTGTCTACA TTATTACATT 46011 .......... .......... .......... .......... .......... .......... 225 GAGACTTTAT TTATAGACAC TATATTATAC TCCTTTTCCA ACTAGGACAC TACAATACCA 46071 .......... .......... .......... .......... .......... .......... 225 TCCTTTTCTA AGTAGGATTC TATATACTAT TTCTATTCCT ATTCCTATTC TAAGTAGAAT 46131 .......... .......... .......... .......... .......... .......... 225 GGTATATATT ATTCTTGTTC CTTTTTTGAT TCTAACACTC CCCCTCAAGC TGGTGCATAC 46191 .......... .......... .......... .......... .......... .......... 225 AAGTTATATA TACTTTGCTT GTTACAAATG TAATTAATAT GAGGACCAAT GAGAGGCTTG 46251 .......... .......... .......... .......... .......... .......... 225 ATGAAGATAT CTGCAAGTTG ATCACTTGAC TCACAAATTT TGTAACAATA TCTCCCGACT 46311 .......... .......... .......... .......... .......... .......... 225 TCCCAGACCA AGCTTGAGAA GAACGTTTCA TATCATCGAG TGACTTGCAC AATCAACATA 46371 .......... .......... .......... .......... .......... .......... 225 TAAGGCTGCT AGACTCCCTC GGAGCAATAA GACCAAGTGG TTGCTCCATA TATACTTCTC 46431 .......... .......... .......... .......... .......... .......... 225 CATCGAGATC CCAGCCCAAA TATGTAAGTA TATCCTTTTG GATAAAGTGA ATCTAAAACA 46491 .......... .......... .......... .......... .......... .......... 225 AAGAGAATAT TGCTTGAAAA CTTGGATTTT TTTGGGAACT CGGATATGTT GGACTTTGCA 46551 .......... .......... .......... .......... .......... .......... 225 CAACATTGAC AAAGTTGAAA CTATTTAAAT CAGACCTAAG GAGTCACCGA AAAGACGTAC 46611 .......... .......... .......... .......... .......... .......... 225 GGTGCTTCGA AAATTAGATA TGAGAAAGTA GTCACCAAAA AGACGCATGA TGTTGTGCAA 46671 .......... .......... .......... .......... .......... .......... 225 ATTAGATATG AGAAAGTAGT CACCAAGAAG ATGAGACAGT GCTACATAAA TTAAATATGA 46731 .......... .......... .......... .......... .......... .......... 225 AAAAGTAGTC ACTGATAAGA TGGCACGGTG CTACACAAAT TAAATATGAA AAAGTAGTCA 46791 .......... .......... .......... .......... .......... .......... 225 TCAAAAAGAT GGTGCGATGC TACACAAAAG TAAATAGTCA CCGGAATGAT GACATGATGC 46851 .......... .......... .......... .......... .......... .......... 225 TACAAAAATG AAATATGAGA GTAGTCACCT GAAGGATGAC ACAGTGCCAC ATAAATTGAA 46911 .......... .......... .......... .......... .......... .......... 225 CATAAAAAAA TAGTCACCAG AAACATGATG CGGTGCTACA CAAATTAAGA GCCTGTTTGG 46971 ||||| || ||||| | .......... .......... .......... .......... ....CTAAGA GCTTGTTTAG 241 CTCAGCTTAA AAGCTGGTCA AACTGACTTA AAATCTGATT TTTGACTTAT TTAACTGTTT 47031 ||||||||| |||||| ||| |||||||||| ||| |||||| |||||||||| ||| ||||| TTCAGCTTAA AAGCTGATCA AACTGACTTA AAAACTGATT TTTGACTTAT TTAGTTGTTT 301 GACAATACTC AAAATAGCTT ATTTTAAGTT ---AAAAAAA ACTTATTTTA AGCCAAAAGT 47088 | |||||||| |||||| ||| |||||||||| ||||||| |||||||||| |||||||||| GGCAATACTC AAAATAACTT ATTTTAAGTT AAAAAAAAAA ACTTATTTTA AGCCAAAAGT 361 TAAAAGGTGG GGTAGGGGTG CTTTTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAT 47148 |||||| ||| |||||||||| | ||||||| |||||||||| |||||||||| ||||||||| TAAAAGCTGG GGTAGGGGTG C--TTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAC 419 ATTTTTATGT TTTTTCCCTT AATATTTTTA TACAATCTCC AAATTATCCA TATAACCCTA 47208 |||||||| | |||| ||||| |||||||||| |||||||||| |||||||||| ||||| ||| ATTTTTATCT TTTTGCCCTT AATATTTTTA TACAATCTCC AAATTATCCA CATAACTCTA 479 ACATC 47213 ||||| ACATC 484 hqPGS_C01HBa0088L02.1+_SGN-E377238- (46956 47213) ******************************************************************************** EST sequence 254 -strand 434 n (File: SGN-E240879-) 1 ATTTTTTTCG ATTAAAATAA TAAAAAAAGA AATTTATATG AATAGTTATT TTTTTAACCA 61 AAGTGCATAA ATTGGAAACT CATAAATTTG TGACTTAGGT TACATGGTTG AGAACTGCCT 121 CAAACTTATA ATGTCTACTA TTTAAGTGGA GATACGTAAA AGAAAAAATT ATTGTCTAAG 181 AGCTTGTTTA GTTCAGCTTA AAAGCTGATC AAACTGACTT AAAAACTGAT TTTTGACTTA 241 TTTAGTTGTT TGGCAATACT CAAAATAACT TATTTTAAGT TAAAAAAAAA AACTTATTTT 301 AAGCCAAAAG TTAAAAGCTG GGGTAGGGGT GCTTTTTTTT TAGCTTATAA GCTGTTTTAA 361 GTTGACCACA TTTTTATCTT TTTGCCCTTA ATATTTTTAT ACAATCTCCA AATTATCCAC 421 ATAACTCTAA CATC Predicted gene structure (within gDNA segment 43099 to 47948): Exon 1 43912 43923 ( 12 n); cDNA 159 170 ( 12 n); score: 0.917 Intron 1 43924 44188 ( 265 n); Pd: 0.900 (s: 0), Pa: 0.930 (s: 0) Exon 2 44189 44193 ( 5 n); cDNA 171 175 ( 5 n); score: 0.800 Intron 2 44194 46955 (2762 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.88) Exon 3 46956 47213 ( 258 n); cDNA 176 434 ( 259 n); score: 0.901 MATCH C01HBa0088L02.1+ SGN-E240879- 0.901 275 0.634 C PGS_C01HBa0088L02.1+_SGN-E240879- (43912 43923,44189 44193,46956 47213) Alignment (genomic DNA sequence = upper lines): AAAGAAATAA TTATCTCCTT ATAAACATTA GATTAAAAGT TGCAAAAAGA TTAAAGCTTT 43971 ||||||| || || AAAGAAAAAA TT........ .......... .......... .......... .......... 170 AACCATATTG ATCGGAACAT AAACAACAAA ATATGCATTT TGGGTATCAA AGTAGTGTCA 44031 .......... .......... .......... .......... .......... .......... 170 TACATAATGA TTTGAATAAG GGTCTTGCCA AGACATCATT TAATCCGAAT TATTTGAGTG 44091 .......... .......... .......... .......... .......... .......... 170 ACTTGCCTTA TTTCATTGAA ATTCCAAGAG ATGTTTTTTA AAATTTTAAT TAACTTATCA 44151 .......... .......... .......... .......... .......... .......... 170 AGCACACAAC TAATTATATA AAATGTATAA TATTTAGATT TTGTATGTAG AGGGAGGCCT 44211 ||| | .......... .......... .......... .......ATT GT........ .......... 175 TGAATAAGAG AAGAACTCTC GCAATTGATG AATAAAATGT TTGTACCACT TTTGGAAAAT 44271 .......... .......... .......... .......... .......... .......... 175 ACAAATATAG ACAATGAAAC AATTACCTAT CTTTTCTAAA GATTTGGTGA TGAATAACTA 44331 .......... .......... .......... .......... .......... .......... 175 CAGTAAAATG AAGAATCAAT AACTAAATCC ATAAACACGT AGAATCAAAT CGTTTTAAGT 44391 .......... .......... .......... .......... .......... .......... 175 TTAAAAAAAT ATTTTATTTT GTCTTTGGAT AAAATATTCT TGACAATTTA TTGTTGGGTT 44451 .......... .......... .......... .......... .......... .......... 175 GTACCCATTC GAAAACACTT ATATTATCAA ATGTTCAGAA GTAGATTATT ACCGTAGTTT 44511 .......... .......... .......... .......... .......... .......... 175 ACCACCGCGC GAAAAGCATG CAATTTACCT TGTTAAATTA CAAGTGCTCA GATGCAATGA 44571 .......... .......... .......... .......... .......... .......... 175 TATGCTTTGA AAATTATTTT TGAAGAACTT CTCGTAGTTC TGTTTGGTCT GACTGCATTC 44631 .......... .......... .......... .......... .......... .......... 175 GTGCCAGCTA CTCACTTTTT GGCGTCACTT CATAATCTAA GTAGTTTTGT GTATTCAAAG 44691 .......... .......... .......... .......... .......... .......... 175 GCATAATGAG AAGACAAAGC TGACATAATT GTCCAAAGAA AAGAAAAAAG ACAAAGAAAT 44751 .......... .......... .......... .......... .......... .......... 175 TGTAGCATAA TAAACAGGAA TGGGTACCGT TACAGACATT TCTGTCTTTC TTCAAATCAA 44811 .......... .......... .......... .......... .......... .......... 175 ACAAAATTTG TTGTATTTTG ATTAGTTTTC TGGAGCCTCA GTATTGGATT AGGGCCTCAG 44871 .......... .......... .......... .......... .......... .......... 175 CTGCAGCCGT GATACAGGCA AATTGTTATG CTTTAGGAGA TCTGTATTTT AAATGGATGG 44931 .......... .......... .......... .......... .......... .......... 175 AATGATTCTT TTGGAATCTC TACATCTCTT GATGCTTCAT TTGACTAGCT ATTTAGTTGA 44991 .......... .......... .......... .......... .......... .......... 175 TCTTCTGGTG GATTCCCTTT TCAGGATGGA CGTATTGATT ATGGAGAATT TGTTGCTATG 45051 .......... .......... .......... .......... .......... .......... 175 ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC GAAATAGTCT GAATTTCAGC 45111 .......... .......... .......... .......... .......... .......... 175 ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA CACATGATGT AGGTATTTCC 45171 .......... .......... .......... .......... .......... .......... 175 CCTTTTTTAT TTTTGTAACC GTTTCTTTGG CAATGAATTT GAAGAAATCT TTCCTTGTTC 45231 .......... .......... .......... .......... .......... .......... 175 TGTCCTTGAG AAATTGGATT GGTTGGAGTA TATTTGTTTA ACATTAAGAG TTTCTTTTTC 45291 .......... .......... .......... .......... .......... .......... 175 CCTCTTGAGG ATAATAAAAT TTTATAAATA ACAGCATGAG TGTTTGCTGT AAAACTCTAC 45351 .......... .......... .......... .......... .......... .......... 175 AGGTGCAGCA AAAAAAATTA CATTCAGCAA AAGTATATCC CATCTTATCC TGTTGGTACA 45411 .......... .......... .......... .......... .......... .......... 175 CTAGCATGTC ACAGATAGAT TCAGCTTCCT CCCCAATCCT CCATTTTACA CCATTAACAA 45471 .......... .......... .......... .......... .......... .......... 175 AAATAAATTT CAGATACAGA GTTCTCTTTC ATTCCCATCT TTTATATAAT GCTGGTTTCT 45531 .......... .......... .......... .......... .......... .......... 175 TTTCTTTTGG TAAAATTTTG ATGTATCAAA TTTGACGATT GTCCGACATG GCTATGTGAG 45591 .......... .......... .......... .......... .......... .......... 175 GAACTTTCCT AAGGGAGCAC TAAGGGTGTC AAATGTGTGG GTGGAGGCAG TGGGGGACTG 45651 .......... .......... .......... .......... .......... .......... 175 AAATTGAAGA GGTTAAAATG GGCTGAGCTA AAAGTCATGT TGGATCATAA CCCACTCAAA 45711 .......... .......... .......... .......... .......... .......... 175 CTTACTTTGG GCTAACATGG GCTAGAATCT TGATTGGGTT ATGACCTATC CAATTTGACC 45771 .......... .......... .......... .......... .......... .......... 175 TGCTTAATCT AAACTAAACT ATATTAAACA CTTGCTATAA TTTATGACAG ATGTCATTCA 45831 .......... .......... .......... .......... .......... .......... 175 ACCCATAGAA TCGTACAGAT CTGTACTAAC TTTTCATTTA GGAGCATCTC CTTGTAGAGT 45891 .......... .......... .......... .......... .......... .......... 175 AAATTGATGT AGACTTTATA GTATGGGACC AACTTCATAA TTTTGCAACT CATTTAATAG 45951 .......... .......... .......... .......... .......... .......... 175 TGTATTTATG AGAATTATTG AAAAGAATAT TATTGAATTG TGTGTCTACA TTATTACATT 46011 .......... .......... .......... .......... .......... .......... 175 GAGACTTTAT TTATAGACAC TATATTATAC TCCTTTTCCA ACTAGGACAC TACAATACCA 46071 .......... .......... .......... .......... .......... .......... 175 TCCTTTTCTA AGTAGGATTC TATATACTAT TTCTATTCCT ATTCCTATTC TAAGTAGAAT 46131 .......... .......... .......... .......... .......... .......... 175 GGTATATATT ATTCTTGTTC CTTTTTTGAT TCTAACACTC CCCCTCAAGC TGGTGCATAC 46191 .......... .......... .......... .......... .......... .......... 175 AAGTTATATA TACTTTGCTT GTTACAAATG TAATTAATAT GAGGACCAAT GAGAGGCTTG 46251 .......... .......... .......... .......... .......... .......... 175 ATGAAGATAT CTGCAAGTTG ATCACTTGAC TCACAAATTT TGTAACAATA TCTCCCGACT 46311 .......... .......... .......... .......... .......... .......... 175 TCCCAGACCA AGCTTGAGAA GAACGTTTCA TATCATCGAG TGACTTGCAC AATCAACATA 46371 .......... .......... .......... .......... .......... .......... 175 TAAGGCTGCT AGACTCCCTC GGAGCAATAA GACCAAGTGG TTGCTCCATA TATACTTCTC 46431 .......... .......... .......... .......... .......... .......... 175 CATCGAGATC CCAGCCCAAA TATGTAAGTA TATCCTTTTG GATAAAGTGA ATCTAAAACA 46491 .......... .......... .......... .......... .......... .......... 175 AAGAGAATAT TGCTTGAAAA CTTGGATTTT TTTGGGAACT CGGATATGTT GGACTTTGCA 46551 .......... .......... .......... .......... .......... .......... 175 CAACATTGAC AAAGTTGAAA CTATTTAAAT CAGACCTAAG GAGTCACCGA AAAGACGTAC 46611 .......... .......... .......... .......... .......... .......... 175 GGTGCTTCGA AAATTAGATA TGAGAAAGTA GTCACCAAAA AGACGCATGA TGTTGTGCAA 46671 .......... .......... .......... .......... .......... .......... 175 ATTAGATATG AGAAAGTAGT CACCAAGAAG ATGAGACAGT GCTACATAAA TTAAATATGA 46731 .......... .......... .......... .......... .......... .......... 175 AAAAGTAGTC ACTGATAAGA TGGCACGGTG CTACACAAAT TAAATATGAA AAAGTAGTCA 46791 .......... .......... .......... .......... .......... .......... 175 TCAAAAAGAT GGTGCGATGC TACACAAAAG TAAATAGTCA CCGGAATGAT GACATGATGC 46851 .......... .......... .......... .......... .......... .......... 175 TACAAAAATG AAATATGAGA GTAGTCACCT GAAGGATGAC ACAGTGCCAC ATAAATTGAA 46911 .......... .......... .......... .......... .......... .......... 175 CATAAAAAAA TAGTCACCAG AAACATGATG CGGTGCTACA CAAATTAAGA GCCTGTTTGG 46971 ||||| || ||||| | .......... .......... .......... .......... ....CTAAGA GCTTGTTTAG 191 CTCAGCTTAA AAGCTGGTCA AACTGACTTA AAATCTGATT TTTGACTTAT TTAACTGTTT 47031 ||||||||| |||||| ||| |||||||||| ||| |||||| |||||||||| ||| ||||| TTCAGCTTAA AAGCTGATCA AACTGACTTA AAAACTGATT TTTGACTTAT TTAGTTGTTT 251 GACAATACTC AAAATAGCTT ATTTTAAGTT ---AAAAAAA ACTTATTTTA AGCCAAAAGT 47088 | |||||||| |||||| ||| |||||||||| ||||||| |||||||||| |||||||||| GGCAATACTC AAAATAACTT ATTTTAAGTT AAAAAAAAAA ACTTATTTTA AGCCAAAAGT 311 TAAAAGGTGG GGTAGGGGTG CTTTTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAT 47148 |||||| ||| |||||||||| | ||||||| |||||||||| |||||||||| ||||||||| TAAAAGCTGG GGTAGGGGTG C--TTTTTTT TTAGCTTATA AGCTGTTTTA AGTTGACCAC 369 ATTTTTATGT TTTTTCCCTT AATATTTTTA TACAATCTCC AAATTATCCA TATAACCCTA 47208 |||||||| | |||| ||||| |||||||||| |||||||||| |||||||||| ||||| ||| ATTTTTATCT TTTTGCCCTT AATATTTTTA TACAATCTCC AAATTATCCA CATAACTCTA 429 ACATC 47213 ||||| ACATC 434 hqPGS_C01HBa0088L02.1+_SGN-E240879- (46956 47213) ******************************************************************************** EST sequence 238 -strand 666 n (File: SGN-E237992-) 1 TTTCCAAATG AAACAAAAGA CAATTAGGTG TTAGTTGATA AATATTAAGC GTTAAATTCG 61 ATTTTTTATA TATAAGTTTT CTAGTGCTTA AATATAATTG GGAAGGTCAA GGGGTTTGTG 121 ACTTAAGTTA GTGATGTCTG GTATTTAAGT GGAGATACGT AAAAAGACAA AATTATTATC 181 TCTGTGTTAC ATAGTTGCAA GTTGCAACTA TTTCTAACAA TCGACTCTAG ATGATTTTTT 241 TCGATTAAAA TAATAAAAAA AGAAATTTAT ATGAATAGTT ATTTTTTTAA CCAAAGTGCA 301 TAAATTGGAA ACTCATAAAT TTGTGACTTA GGTTACATGG TTGAGAACTG CCTCAAACTT 361 ATAATGTCTA CTATTTAAGT GGAGATACGT AAAAGAAAAA ATTATTGTCT AAGAGCTTGT 421 TTAGTTCAGC TTAAAAGCTG ATCAAACTGA CTTAAAAACT GATTTTTGAC TTATTTAGTT 481 GTTTGGCAAT ACTCAAAATA ACTTATTTTA AGTTAAAAAA AAAAACTTAT TTTAAGCCAA 541 AAGTTAAAAG CTGGGGTAGG GGTGCTTTTT TTTTAGCTTA TAAGCTGTTT TAAGTTGACC 601 ACATTTTTAT CTTTTTGCCC TTAATATTTT TATACAATCT CCAAATTATC CACATAACTC 661 TAACAT Predicted gene structure (within gDNA segment 39569 to 47938): Exon 1 40609 40625 ( 17 n); cDNA 255 271 ( 17 n); score: 0.588 Intron 1 40626 40813 ( 188 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 2 40814 40850 ( 37 n); cDNA 272 307 ( 36 n); score: 0.662 Intron 2 40851 41292 ( 442 n); Pd: 0.000 (s: 0), Pa: 0.998 (s: 0.56) Exon 3 41293 41348 ( 56 n); cDNA 308 359 ( 52 n); score: 0.554 Intron 3 41349 42405 (1057 n); Pd: 0.722 (s: 0.58), Pa: 0.999 (s: 0) Exon 4 42406 42418 ( 13 n); cDNA 360 372 ( 13 n); score: 0.538 Intron 4 42419 43641 (1223 n); Pd: 0.000 (s: 0), Pa: 0.908 (s: 0) Exon 5 43642 43659 ( 18 n); cDNA 373 389 ( 17 n); score: 0.667 Intron 5 43660 43909 ( 250 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 6 43910 43923 ( 14 n); cDNA 390 403 ( 14 n); score: 0.857 Intron 6 43924 44188 ( 265 n); Pd: 0.900 (s: 0), Pa: 0.930 (s: 0) Exon 7 44189 44193 ( 5 n); cDNA 404 408 ( 5 n); score: 0.800 Intron 7 44194 46955 (2762 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.88) Exon 8 46956 47212 ( 257 n); cDNA 409 666 ( 258 n); score: 0.901 MATCH C01HBa0088L02.1+ SGN-E237992- 0.839 417 0.626 C PGS_C01HBa0088L02.1+_SGN-E237992- (40609 40625,40814 40850,41293 41348,42406 42418,43642 43659,43910 43923,44189 44193,46956 47212) Alignment (genomic DNA sequence = upper lines): AAACACAGCA GGGGATATTT GATGCAGTTC TGAAAGGGCA CATTGATTTT GACTCAGATC 40668 ||| | || | ||| AAAAAAAGAA ATTTATA... .......... .......... .......... .......... 271 CTTGGCCTCT AATATCAGAG AGTGCAAAGG ATCTCATCCG GAAGATGTTA TGCATGCGAC 40728 .......... .......... .......... .......... .......... .......... 271 CCCCAGAGCG GTTAACTGCT CATGAAGTAT TATGTAAGTT TATTTACCTT ATAAGTCATA 40788 .......... .......... .......... .......... .......... .......... 271 TTGACCTAAC ATTTTTACTG GTTACTGAAT GGATCATTTT TTTCTCCCAT G-ATATAAAT 40847 ||||| | | ||||| ||| || | | |||||| .......... .......... .....TGAAT AG-TTATTTT TTTAACCAAA GTGCATAAAT 305 ATGGTTTTGC TTGTTTAATA GTTGTTATAT CAAGAGATAC TGTGTTGTGA CAGTGTTGAT 40907 || -TG....... .......... .......... .......... .......... .......... 307 GTTCTGTCAG ACTTATAAGA ACCCTCTTAA CTTTTTTCTG GACTGTGCTT CTGGTGGCAG 40967 .......... .......... .......... .......... .......... .......... 307 AACATTGAGA ACCTTATTGA CTACTAATTT ATGTAAAAAA CTGTTAGTTT AGCAGTAGAG 41027 .......... .......... .......... .......... .......... .......... 307 AGGAGTTTCT CATGCTTGAA CTATAACTTG TTAGGTTATC TATGAGCCCT TTGGAAATAT 41087 .......... .......... .......... .......... .......... .......... 307 CAGGTTTATT TTCTGTATTT CTGGTTTAAA AAATAAATTT GGATTGACTA CAAGCTGTAA 41147 .......... .......... .......... .......... .......... .......... 307 TAGATCAATT TGCACTGCAT AAAGTGGATC AAGTCATTGT ATTTCTCAAA TTTCAATTGT 41207 .......... .......... .......... .......... .......... .......... 307 ATTGTCTATC TATGCCTGCT TGTATGGTGT CTTTCATGTA ACCAGCTGCT GTTCTGGTGT 41267 .......... .......... .......... .......... .......... .......... 307 TATGGTTTCC TCTAAAATTC TGCAGGTCAT CCTTGGATTT GTGAAAATGG TGTTGCTCCT 41327 | | | | |||| ||| | | | ||| | | .......... .......... .....GAAAC TCATAAATTT GTG-ACTTAG -GTT--ACAT 338 GATAGAGCAC TTGATCCTGC TGTACTTTCT CGCCTCAAAC ACTTTTCTGC AATGAACAAA 41387 | | ||| || | || | | GGTTGAGAAC TGCCTCAAAC T......... .......... .......... .......... 359 TTAAAAAAGA TGGCTCTGCG GGTATGCATA TATATATGTG TGTGTATATA TATCTAGGCA 41447 .......... .......... .......... .......... .......... .......... 359 TAACTTTTTT GCCCAAGTCT GTTAATTATG GTTCTTCAGT GTCCATAAAC CTCATTATTA 41507 .......... .......... .......... .......... .......... .......... 359 AAGTTACACA AGAAAATGCT GATTATGTCC TTTGGGCTAA GTTGTGTGGA CTCTTCAGTT 41567 .......... .......... .......... .......... .......... .......... 359 TCGATGGCGC ACCAGTGTCG GATTCTCCAA AAATACACTC CTTATGGAGA AGCCGACACA 41627 .......... .......... .......... .......... .......... .......... 359 CACCCATTGA CATTTTTGAA GCGTCCAAGC AACATAGCTT CTTGGAGGTG TGTAACCAAA 41687 .......... .......... .......... .......... .......... .......... 359 TGATGCAATT ATTGATGTTT TCATACTTAA TATGCATTTA GGTGATTGCT GAAAGTTTGT 41747 .......... .......... .......... .......... .......... .......... 359 CAGAGGAGGA GATTGCCGGT CTTAAGGAGA TGTTTAAGGC CATGGATACT GATAACAGTG 41807 .......... .......... .......... .......... .......... .......... 359 GTGCAATTAC ATTCGATGAA CTAAAAGCTG GTTTGAGAAA ATATGGCTCT ACTCTGAAGG 41867 .......... .......... .......... .......... .......... .......... 359 ATATAGAGAT ACGGGAACTT ATGGATGCGG TAAGAAAATC TAGACTGCAA ACTGATTCTG 41927 .......... .......... .......... .......... .......... .......... 359 TTTATTTTGT GCATCTGGTG ATGTGACTCT ACACAAAGGT TCATAGGAGC AGAAAAATGT 41987 .......... .......... .......... .......... .......... .......... 359 AAAATGACAT AAGATCACTA ACTAATGGTC AAATCTCAAG GTTATTTGAT GTGCAAATAC 42047 .......... .......... .......... .......... .......... .......... 359 TAGAGTCAGA TTGGGATTTG GCACTTTACT TTGTTTAATT AATTATGTAC ATTCATGAAG 42107 .......... .......... .......... .......... .......... .......... 359 GAGCACTTAA AACTCAATGT AGTTGCTAAA ACTTCACTGG AAAGGTGCCC AATTTTTTTT 42167 .......... .......... .......... .......... .......... .......... 359 TTTTGTGTAT GTGTATGATA AGTTTCTGAT AACTGAGGAG GTAGTGCAGG CTTACCAAGT 42227 .......... .......... .......... .......... .......... .......... 359 AGTTGGCACC ACATATATGC TTCATCAGAA ACAACTTTCT GTTAATGGTT CTAGTTGTAT 42287 .......... .......... .......... .......... .......... .......... 359 CTTTAATTAG GCCCGTGATA ATCTTTGTAT TTCTCCCTAA ACATGTCTGT CTATGAGGTA 42347 .......... .......... .......... .......... .......... .......... 359 CATGCGGAAG TGCTTATCTA ACTCTTTAAG GCCATTGATG TAATATTACT GTTTTCAGGC 42407 .......... .......... .......... .......... .......... ........TA 361 TGATGTGGAC AATAGTGGAA CTATTGACTA TGGAGAATTC ATAGCAGCAA CAATTCACCT 42467 | |||| || TAATGTCTAC T......... .......... .......... .......... .......... 372 TAACAAATTG GACCGCGAGG AACATCTCAT GGCAGCATTT CAGTATTTTG ACAAGGATGG 42527 .......... .......... .......... .......... .......... .......... 372 AAGTGGTTAT ATTACAGTAG ATGAGCTCCA GCAGGCCTGT GCAGATCATA ACATTACAGA 42587 .......... .......... .......... .......... .......... .......... 372 TGTATTCTTT GAGGATATTA TCAGAGAAGT TGATCAGGAT AACGTAAGTT AATTATATTG 42647 .......... .......... .......... .......... .......... .......... 372 AGGATAAAGT TGAAGTATTA TTGGAACTTA TCAATAAAAA AGTGGACACA AATTAGTAGA 42707 .......... .......... .......... .......... .......... .......... 372 TTAAATTTCT TCATGTTTTG CAGTTCTACT GATTTATCTC TCTACTACTC ATAATTTTTT 42767 .......... .......... .......... .......... .......... .......... 372 TGCAACAAAA ACTATTTTTT TTTATAAAAA AGCACTTTAA TATGAAACAC TTTTTGTGCA 42827 .......... .......... .......... .......... .......... .......... 372 ACAAAAACGA AAATTAAAAA AATATAGCAC TTTAAGATTT CATATGAATC TTTTCCTTGA 42887 .......... .......... .......... .......... .......... .......... 372 GATAAAATGT TATTGACAAT GTAGTGTATG TATGGAAAAT ACGGATATTA CTAAATGATC 42947 .......... .......... .......... .......... .......... .......... 372 ATATGTGAGC TTAATAATAT AGTTAATTTA CCTCTCTCTC TCTATATATA TAAAGAGAAC 43007 .......... .......... .......... .......... .......... .......... 372 CCTAGGCTGC CTAAGTGGCG CCACCACAAA TCAGGATTCC CTTTTAATTT ATTTATTTCC 43067 .......... .......... .......... .......... .......... .......... 372 AAAATTAGCC TTCCCTTTCA TCAAAAGTTG TGACTTATGA AACTTTGCGA CTTTTACAAA 43127 .......... .......... .......... .......... .......... .......... 372 GAGTTGTAAC TTTTATGAAA GTTGTAACTT TTATGAAAGT TGTAACTTTT ATGTAGAGTT 43187 .......... .......... .......... .......... .......... .......... 372 GTGACTTTTC CAAAGGATTA TTACATTTCC GATAAGACAC CATAACCATT TATTCACACT 43247 .......... .......... .......... .......... .......... .......... 372 ATCCTTTTGT TGTCTATAAA TAGAGGAATT TTCTTTCATT TTAAAACGAC GAAAATTCTA 43307 .......... .......... .......... .......... .......... .......... 372 AATTTTTTCT TCTGCTTATG CACAATTAAA TATTTGTGTA CTTTGCTCCT GTTGAGTGGT 43367 .......... .......... .......... .......... .......... .......... 372 TCACTGACAT CATTGTTTTT GAATCTATAC AACGGTGAAT ATAATCGTTC TATCCTAAAA 43427 .......... .......... .......... .......... .......... .......... 372 GTATCTATTC ATTCTTTTGT TACAAATCTT GGTATGTTTT TTACGCTCAT TTATGCTTAT 43487 .......... .......... .......... .......... .......... .......... 372 GTTATTAGTT GTTTTTGAGT ACATGTTTTA AACTTTGTTG TTTATGTTTA TGTTTATGTT 43547 .......... .......... .......... .......... .......... .......... 372 GAAATAAAGA TATGTTAATC AAGAATTTGA TGTAGTGATG TCATGTAGAT TAAAATTCTT 43607 .......... .......... .......... .......... .......... .......... 372 GAACTTATAA AATAAATGAC TTTGATCTTT ATAGAGTTTT AGTGGCTAAA AGATTCATGG 43667 | ||| ||||| | | | .......... .......... .......... ....A-TTTA AGTGGAGATA CG........ 389 GATGTTCAAG AAGAAACTTT TGAGTGTTCA AAAGTTATGG TGGTTCTACT CTACCATGGA 43727 .......... .......... .......... .......... .......... .......... 389 GTTTAGTTAT TCAACTTTCT ATCTTATCTA GACATTCAAT CGATTAGTGA CATTCAAAAA 43787 .......... .......... .......... .......... .......... .......... 389 ATAAAGGAAA ATGTAGCGGG ATGGTAAGTA TTATACTCAA CCTTAATTAA AAGTTTGGGA 43847 .......... .......... .......... .......... .......... .......... 389 TTCAAATATT TGATTGGAGT CAATGAATTA CCCCCTTAGG ATGAATCTAC ATTAATCAAT 43907 .......... .......... .......... .......... .......... .......... 389 TATTAAAGAA ATAATTATCT CCTTATAAAC ATTAGATTAA AAGTTGCAAA AAGATTAAAG 43967 | |||||| | |||| ..TAAAAGAA AAAATT.... .......... .......... .......... .......... 403 CTTTAACCAT ATTGATCGGA ACATAAACAA CAAAATATGC ATTTTGGGTA TCAAAGTAGT 44027 .......... .......... .......... .......... .......... .......... 403 GTCATACATA ATGATTTGAA TAAGGGTCTT GCCAAGACAT CATTTAATCC GAATTATTTG 44087 .......... .......... .......... .......... .......... .......... 403 AGTGACTTGC CTTATTTCAT TGAAATTCCA AGAGATGTTT TTTAAAATTT TAATTAACTT 44147 .......... .......... .......... .......... .......... .......... 403 ATCAAGCACA CAACTAATTA TATAAAATGT ATAATATTTA GATTTTGTAT GTAGAGGGAG 44207 ||| | .......... .......... .......... .......... .ATTGT.... .......... 408 GCCTTGAATA AGAGAAGAAC TCTCGCAATT GATGAATAAA ATGTTTGTAC CACTTTTGGA 44267 .......... .......... .......... .......... .......... .......... 408 AAATACAAAT ATAGACAATG AAACAATTAC CTATCTTTTC TAAAGATTTG GTGATGAATA 44327 .......... .......... .......... .......... .......... .......... 408 ACTACAGTAA AATGAAGAAT CAATAACTAA ATCCATAAAC ACGTAGAATC AAATCGTTTT 44387 .......... .......... .......... .......... .......... .......... 408 AAGTTTAAAA AAATATTTTA TTTTGTCTTT GGATAAAATA TTCTTGACAA TTTATTGTTG 44447 .......... .......... .......... .......... .......... .......... 408 GGTTGTACCC ATTCGAAAAC ACTTATATTA TCAAATGTTC AGAAGTAGAT TATTACCGTA 44507 .......... .......... .......... .......... .......... .......... 408 GTTTACCACC GCGCGAAAAG CATGCAATTT ACCTTGTTAA ATTACAAGTG CTCAGATGCA 44567 .......... .......... .......... .......... .......... .......... 408 ATGATATGCT TTGAAAATTA TTTTTGAAGA ACTTCTCGTA GTTCTGTTTG GTCTGACTGC 44627 .......... .......... .......... .......... .......... .......... 408 ATTCGTGCCA GCTACTCACT TTTTGGCGTC ACTTCATAAT CTAAGTAGTT TTGTGTATTC 44687 .......... .......... .......... .......... .......... .......... 408 AAAGGCATAA TGAGAAGACA AAGCTGACAT AATTGTCCAA AGAAAAGAAA AAAGACAAAG 44747 .......... .......... .......... .......... .......... .......... 408 AAATTGTAGC ATAATAAACA GGAATGGGTA CCGTTACAGA CATTTCTGTC TTTCTTCAAA 44807 .......... .......... .......... .......... .......... .......... 408 TCAAACAAAA TTTGTTGTAT TTTGATTAGT TTTCTGGAGC CTCAGTATTG GATTAGGGCC 44867 .......... .......... .......... .......... .......... .......... 408 TCAGCTGCAG CCGTGATACA GGCAAATTGT TATGCTTTAG GAGATCTGTA TTTTAAATGG 44927 .......... .......... .......... .......... .......... .......... 408 ATGGAATGAT TCTTTTGGAA TCTCTACATC TCTTGATGCT TCATTTGACT AGCTATTTAG 44987 .......... .......... .......... .......... .......... .......... 408 TTGATCTTCT GGTGGATTCC CTTTTCAGGA TGGACGTATT GATTATGGAG AATTTGTTGC 45047 .......... .......... .......... .......... .......... .......... 408 TATGATGCAA AAAGGAAATC CATGCATAGG AAGACGAACA ATGCGAAATA GTCTGAATTT 45107 .......... .......... .......... .......... .......... .......... 408 CAGCATGAGA GATGCGCCCG GAGCTCATTA GCTTTTTGAA TGGACACATG ATGTAGGTAT 45167 .......... .......... .......... .......... .......... .......... 408 TTCCCCTTTT TTATTTTTGT AACCGTTTCT TTGGCAATGA ATTTGAAGAA ATCTTTCCTT 45227 .......... .......... .......... .......... .......... .......... 408 GTTCTGTCCT TGAGAAATTG GATTGGTTGG AGTATATTTG TTTAACATTA AGAGTTTCTT 45287 .......... .......... .......... .......... .......... .......... 408 TTTCCCTCTT GAGGATAATA AAATTTTATA AATAACAGCA TGAGTGTTTG CTGTAAAACT 45347 .......... .......... .......... .......... .......... .......... 408 CTACAGGTGC AGCAAAAAAA ATTACATTCA GCAAAAGTAT ATCCCATCTT ATCCTGTTGG 45407 .......... .......... .......... .......... .......... .......... 408 TACACTAGCA TGTCACAGAT AGATTCAGCT TCCTCCCCAA TCCTCCATTT TACACCATTA 45467 .......... .......... .......... .......... .......... .......... 408 ACAAAAATAA ATTTCAGATA CAGAGTTCTC TTTCATTCCC ATCTTTTATA TAATGCTGGT 45527 .......... .......... .......... .......... .......... .......... 408 TTCTTTTCTT TTGGTAAAAT TTTGATGTAT CAAATTTGAC GATTGTCCGA CATGGCTATG 45587 .......... .......... .......... .......... .......... .......... 408 TGAGGAACTT TCCTAAGGGA GCACTAAGGG TGTCAAATGT GTGGGTGGAG GCAGTGGGGG 45647 .......... .......... .......... .......... .......... .......... 408 ACTGAAATTG AAGAGGTTAA AATGGGCTGA GCTAAAAGTC ATGTTGGATC ATAACCCACT 45707 .......... .......... .......... .......... .......... .......... 408 CAAACTTACT TTGGGCTAAC ATGGGCTAGA ATCTTGATTG GGTTATGACC TATCCAATTT 45767 .......... .......... .......... .......... .......... .......... 408 GACCTGCTTA ATCTAAACTA AACTATATTA AACACTTGCT ATAATTTATG ACAGATGTCA 45827 .......... .......... .......... .......... .......... .......... 408 TTCAACCCAT AGAATCGTAC AGATCTGTAC TAACTTTTCA TTTAGGAGCA TCTCCTTGTA 45887 .......... .......... .......... .......... .......... .......... 408 GAGTAAATTG ATGTAGACTT TATAGTATGG GACCAACTTC ATAATTTTGC AACTCATTTA 45947 .......... .......... .......... .......... .......... .......... 408 ATAGTGTATT TATGAGAATT ATTGAAAAGA ATATTATTGA ATTGTGTGTC TACATTATTA 46007 .......... .......... .......... .......... .......... .......... 408 CATTGAGACT TTATTTATAG ACACTATATT ATACTCCTTT TCCAACTAGG ACACTACAAT 46067 .......... .......... .......... .......... .......... .......... 408 ACCATCCTTT TCTAAGTAGG ATTCTATATA CTATTTCTAT TCCTATTCCT ATTCTAAGTA 46127 .......... .......... .......... .......... .......... .......... 408 GAATGGTATA TATTATTCTT GTTCCTTTTT TGATTCTAAC ACTCCCCCTC AAGCTGGTGC 46187 .......... .......... .......... .......... .......... .......... 408 ATACAAGTTA TATATACTTT GCTTGTTACA AATGTAATTA ATATGAGGAC CAATGAGAGG 46247 .......... .......... .......... .......... .......... .......... 408 CTTGATGAAG ATATCTGCAA GTTGATCACT TGACTCACAA ATTTTGTAAC AATATCTCCC 46307 .......... .......... .......... .......... .......... .......... 408 GACTTCCCAG ACCAAGCTTG AGAAGAACGT TTCATATCAT CGAGTGACTT GCACAATCAA 46367 .......... .......... .......... .......... .......... .......... 408 CATATAAGGC TGCTAGACTC CCTCGGAGCA ATAAGACCAA GTGGTTGCTC CATATATACT 46427 .......... .......... .......... .......... .......... .......... 408 TCTCCATCGA GATCCCAGCC CAAATATGTA AGTATATCCT TTTGGATAAA GTGAATCTAA 46487 .......... .......... .......... .......... .......... .......... 408 AACAAAGAGA ATATTGCTTG AAAACTTGGA TTTTTTTGGG AACTCGGATA TGTTGGACTT 46547 .......... .......... .......... .......... .......... .......... 408 TGCACAACAT TGACAAAGTT GAAACTATTT AAATCAGACC TAAGGAGTCA CCGAAAAGAC 46607 .......... .......... .......... .......... .......... .......... 408 GTACGGTGCT TCGAAAATTA GATATGAGAA AGTAGTCACC AAAAAGACGC ATGATGTTGT 46667 .......... .......... .......... .......... .......... .......... 408 GCAAATTAGA TATGAGAAAG TAGTCACCAA GAAGATGAGA CAGTGCTACA TAAATTAAAT 46727 .......... .......... .......... .......... .......... .......... 408 ATGAAAAAGT AGTCACTGAT AAGATGGCAC GGTGCTACAC AAATTAAATA TGAAAAAGTA 46787 .......... .......... .......... .......... .......... .......... 408 GTCATCAAAA AGATGGTGCG ATGCTACACA AAAGTAAATA GTCACCGGAA TGATGACATG 46847 .......... .......... .......... .......... .......... .......... 408 ATGCTACAAA AATGAAATAT GAGAGTAGTC ACCTGAAGGA TGACACAGTG CCACATAAAT 46907 .......... .......... .......... .......... .......... .......... 408 TGAACATAAA AAAATAGTCA CCAGAAACAT GATGCGGTGC TACACAAATT AAGAGCCTGT 46967 | |||||| ||| .......... .......... .......... .......... ........CT AAGAGCTTGT 420 TTGGCTCAGC TTAAAAGCTG GTCAAACTGA CTTAAAATCT GATTTTTGAC TTATTTAACT 47027 || | ||||| |||||||||| ||||||||| ||||||| || |||||||||| ||||||| | TTAGTTCAGC TTAAAAGCTG ATCAAACTGA CTTAAAAACT GATTTTTGAC TTATTTAGTT 480 GTTTGACAAT ACTCAAAATA GCTTATTTTA AGTTAA-AAA AA--ACTTAT TTTAAGCCAA 47084 ||||| |||| |||||||||| ||||||||| |||||| ||| || |||||| |||||||||| GTTTGGCAAT ACTCAAAATA ACTTATTTTA AGTTAAAAAA AAAAACTTAT TTTAAGCCAA 540 AAGTTAAAAG GTGGGGTAGG GGTGCTTTTT TTTTTTAGCT TATAAGCTGT TTTAAGTTGA 47144 |||||||||| ||||||||| ||||| ||| |||||||||| |||||||||| |||||||||| AAGTTAAAAG CTGGGGTAGG GGTGC--TTT TTTTTTAGCT TATAAGCTGT TTTAAGTTGA 598 CCATATTTTT ATGTTTTTTC CCTTAATATT TTTATACAAT CTCCAAATTA TCCATATAAC 47204 ||| |||||| || ||||| | |||||||||| |||||||||| |||||||||| |||| ||||| CCACATTTTT ATCTTTTTGC CCTTAATATT TTTATACAAT CTCCAAATTA TCCACATAAC 658 CCTAACAT 47212 ||||||| TCTAACAT 666 hqPGS_C01HBa0088L02.1+_SGN-E237992- (46956 47212) ******************************************************************************** EST sequence 220 -strand 662 n (File: SGN-E376754-) 1 ACCCTACTAA AGCTGAGCTC CAGGACATGA TAAACGAGGT GGATGCAGAT GGTAATGGAA 61 CCATCGACTT CCCAGAGTTT CTAAACCTTA TGGCCAGGAA GATGAAGGAT ACTGACTCTG 121 AGGAGGAGTT GAAAGAGGCA TTCAGAGTTT TCGACAAGGA TCAAAATGGC TTCATCTCCG 181 CTGCTGAGCT TCGTCATGTG ATGACTAACC TTGGAGAGAA GCTTACTGAT GAAGAAGTCG 241 ATGAGATGAT TAGGGAAGCT GATGTTGATG GTGATGGACA AATCAACTAT GAGGAGTTTG 301 TTAAGGTCAT GATGGCCAAG TAATTCCATT ATCCTCTTGT TACATTTGAA GTTTAGACTT 361 GTCAAAAATG TGAAAAAATC CAAAAATAAT TCATTGGGTA GGCTCTTGTC TAGTATAATG 421 TTAGTCTTAC CATCTCGATG TATTGAACCT TCATTGAATG TAATGTTTTA TTGTATGAGT 481 GGTGTGATCT CTACTTATTT TCTTTAAGTT TGTGTACTTT CTTTGATCCT CTTAGAGCCT 541 GTTTGGCTCA GCTTAAAAAC TGGTCAAACT GACTTAAAAA GCTGGTTTTT GACTTATTTA 601 GCTGTTTGAC AATACTCAAA ATAACTTATT TTAAGTTAAA AAAAACTTAT TTTAAAAAAA 661 AA Predicted gene structure (within gDNA segment 40419 to 47749): Exon 1 41733 41747 ( 15 n); cDNA 499 513 ( 15 n); score: 0.800 Intron 1 41748 44979 (3232 n); Pd: 0.000 (s: 0), Pa: 0.689 (s: 0) Exon 2 44980 44998 ( 19 n); cDNA 514 533 ( 20 n); score: 0.605 Intron 2 44999 46958 (1960 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.91) Exon 3 46959 47086 ( 128 n); cDNA 534 662 ( 129 n); score: 0.918 MATCH C01HBa0088L02.1+ SGN-E376754- 0.918 162 0.245 C PGS_C01HBa0088L02.1+_SGN-E376754- (41733 41747,44980 44998,46959 47086) Alignment (genomic DNA sequence = upper lines): TTGCTGAAAG TTTGTCAGAG GAGGAGATTG CCGGTCTTAA GGAGATGTTT AAGGCCATGG 41792 || || ||| ||||| TTTCTTTAAG TTTGT..... .......... .......... .......... .......... 513 ATACTGATAA CAGTGGTGCA ATTACATTCG ATGAACTAAA AGCTGGTTTG AGAAAATATG 41852 .......... .......... .......... .......... .......... .......... 513 GCTCTACTCT GAAGGATATA GAGATACGGG AACTTATGGA TGCGGTAAGA AAATCTAGAC 41912 .......... .......... .......... .......... .......... .......... 513 TGCAAACTGA TTCTGTTTAT TTTGTGCATC TGGTGATGTG ACTCTACACA AAGGTTCATA 41972 .......... .......... .......... .......... .......... .......... 513 GGAGCAGAAA AATGTAAAAT GACATAAGAT CACTAACTAA TGGTCAAATC TCAAGGTTAT 42032 .......... .......... .......... .......... .......... .......... 513 TTGATGTGCA AATACTAGAG TCAGATTGGG ATTTGGCACT TTACTTTGTT TAATTAATTA 42092 .......... .......... .......... .......... .......... .......... 513 TGTACATTCA TGAAGGAGCA CTTAAAACTC AATGTAGTTG CTAAAACTTC ACTGGAAAGG 42152 .......... .......... .......... .......... .......... .......... 513 TGCCCAATTT TTTTTTTTTG TGTATGTGTA TGATAAGTTT CTGATAACTG AGGAGGTAGT 42212 .......... .......... .......... .......... .......... .......... 513 GCAGGCTTAC CAAGTAGTTG GCACCACATA TATGCTTCAT CAGAAACAAC TTTCTGTTAA 42272 .......... .......... .......... .......... .......... .......... 513 TGGTTCTAGT TGTATCTTTA ATTAGGCCCG TGATAATCTT TGTATTTCTC CCTAAACATG 42332 .......... .......... .......... .......... .......... .......... 513 TCTGTCTATG AGGTACATGC GGAAGTGCTT ATCTAACTCT TTAAGGCCAT TGATGTAATA 42392 .......... .......... .......... .......... .......... .......... 513 TTACTGTTTT CAGGCTGATG TGGACAATAG TGGAACTATT GACTATGGAG AATTCATAGC 42452 .......... .......... .......... .......... .......... .......... 513 AGCAACAATT CACCTTAACA AATTGGACCG CGAGGAACAT CTCATGGCAG CATTTCAGTA 42512 .......... .......... .......... .......... .......... .......... 513 TTTTGACAAG GATGGAAGTG GTTATATTAC AGTAGATGAG CTCCAGCAGG CCTGTGCAGA 42572 .......... .......... .......... .......... .......... .......... 513 TCATAACATT ACAGATGTAT TCTTTGAGGA TATTATCAGA GAAGTTGATC AGGATAACGT 42632 .......... .......... .......... .......... .......... .......... 513 AAGTTAATTA TATTGAGGAT AAAGTTGAAG TATTATTGGA ACTTATCAAT AAAAAAGTGG 42692 .......... .......... .......... .......... .......... .......... 513 ACACAAATTA GTAGATTAAA TTTCTTCATG TTTTGCAGTT CTACTGATTT ATCTCTCTAC 42752 .......... .......... .......... .......... .......... .......... 513 TACTCATAAT TTTTTTGCAA CAAAAACTAT TTTTTTTTAT AAAAAAGCAC TTTAATATGA 42812 .......... .......... .......... .......... .......... .......... 513 AACACTTTTT GTGCAACAAA AACGAAAATT AAAAAAATAT AGCACTTTAA GATTTCATAT 42872 .......... .......... .......... .......... .......... .......... 513 GAATCTTTTC CTTGAGATAA AATGTTATTG ACAATGTAGT GTATGTATGG AAAATACGGA 42932 .......... .......... .......... .......... .......... .......... 513 TATTACTAAA TGATCATATG TGAGCTTAAT AATATAGTTA ATTTACCTCT CTCTCTCTAT 42992 .......... .......... .......... .......... .......... .......... 513 ATATATAAAG AGAACCCTAG GCTGCCTAAG TGGCGCCACC ACAAATCAGG ATTCCCTTTT 43052 .......... .......... .......... .......... .......... .......... 513 AATTTATTTA TTTCCAAAAT TAGCCTTCCC TTTCATCAAA AGTTGTGACT TATGAAACTT 43112 .......... .......... .......... .......... .......... .......... 513 TGCGACTTTT ACAAAGAGTT GTAACTTTTA TGAAAGTTGT AACTTTTATG AAAGTTGTAA 43172 .......... .......... .......... .......... .......... .......... 513 CTTTTATGTA GAGTTGTGAC TTTTCCAAAG GATTATTACA TTTCCGATAA GACACCATAA 43232 .......... .......... .......... .......... .......... .......... 513 CCATTTATTC ACACTATCCT TTTGTTGTCT ATAAATAGAG GAATTTTCTT TCATTTTAAA 43292 .......... .......... .......... .......... .......... .......... 513 ACGACGAAAA TTCTAAATTT TTTCTTCTGC TTATGCACAA TTAAATATTT GTGTACTTTG 43352 .......... .......... .......... .......... .......... .......... 513 CTCCTGTTGA GTGGTTCACT GACATCATTG TTTTTGAATC TATACAACGG TGAATATAAT 43412 .......... .......... .......... .......... .......... .......... 513 CGTTCTATCC TAAAAGTATC TATTCATTCT TTTGTTACAA ATCTTGGTAT GTTTTTTACG 43472 .......... .......... .......... .......... .......... .......... 513 CTCATTTATG CTTATGTTAT TAGTTGTTTT TGAGTACATG TTTTAAACTT TGTTGTTTAT 43532 .......... .......... .......... .......... .......... .......... 513 GTTTATGTTT ATGTTGAAAT AAAGATATGT TAATCAAGAA TTTGATGTAG TGATGTCATG 43592 .......... .......... .......... .......... .......... .......... 513 TAGATTAAAA TTCTTGAACT TATAAAATAA ATGACTTTGA TCTTTATAGA GTTTTAGTGG 43652 .......... .......... .......... .......... .......... .......... 513 CTAAAAGATT CATGGGATGT TCAAGAAGAA ACTTTTGAGT GTTCAAAAGT TATGGTGGTT 43712 .......... .......... .......... .......... .......... .......... 513 CTACTCTACC ATGGAGTTTA GTTATTCAAC TTTCTATCTT ATCTAGACAT TCAATCGATT 43772 .......... .......... .......... .......... .......... .......... 513 AGTGACATTC AAAAAATAAA GGAAAATGTA GCGGGATGGT AAGTATTATA CTCAACCTTA 43832 .......... .......... .......... .......... .......... .......... 513 ATTAAAAGTT TGGGATTCAA ATATTTGATT GGAGTCAATG AATTACCCCC TTAGGATGAA 43892 .......... .......... .......... .......... .......... .......... 513 TCTACATTAA TCAATTATTA AAGAAATAAT TATCTCCTTA TAAACATTAG ATTAAAAGTT 43952 .......... .......... .......... .......... .......... .......... 513 GCAAAAAGAT TAAAGCTTTA ACCATATTGA TCGGAACATA AACAACAAAA TATGCATTTT 44012 .......... .......... .......... .......... .......... .......... 513 GGGTATCAAA GTAGTGTCAT ACATAATGAT TTGAATAAGG GTCTTGCCAA GACATCATTT 44072 .......... .......... .......... .......... .......... .......... 513 AATCCGAATT ATTTGAGTGA CTTGCCTTAT TTCATTGAAA TTCCAAGAGA TGTTTTTTAA 44132 .......... .......... .......... .......... .......... .......... 513 AATTTTAATT AACTTATCAA GCACACAACT AATTATATAA AATGTATAAT ATTTAGATTT 44192 .......... .......... .......... .......... .......... .......... 513 TGTATGTAGA GGGAGGCCTT GAATAAGAGA AGAACTCTCG CAATTGATGA ATAAAATGTT 44252 .......... .......... .......... .......... .......... .......... 513 TGTACCACTT TTGGAAAATA CAAATATAGA CAATGAAACA ATTACCTATC TTTTCTAAAG 44312 .......... .......... .......... .......... .......... .......... 513 ATTTGGTGAT GAATAACTAC AGTAAAATGA AGAATCAATA ACTAAATCCA TAAACACGTA 44372 .......... .......... .......... .......... .......... .......... 513 GAATCAAATC GTTTTAAGTT TAAAAAAATA TTTTATTTTG TCTTTGGATA AAATATTCTT 44432 .......... .......... .......... .......... .......... .......... 513 GACAATTTAT TGTTGGGTTG TACCCATTCG AAAACACTTA TATTATCAAA TGTTCAGAAG 44492 .......... .......... .......... .......... .......... .......... 513 TAGATTATTA CCGTAGTTTA CCACCGCGCG AAAAGCATGC AATTTACCTT GTTAAATTAC 44552 .......... .......... .......... .......... .......... .......... 513 AAGTGCTCAG ATGCAATGAT ATGCTTTGAA AATTATTTTT GAAGAACTTC TCGTAGTTCT 44612 .......... .......... .......... .......... .......... .......... 513 GTTTGGTCTG ACTGCATTCG TGCCAGCTAC TCACTTTTTG GCGTCACTTC ATAATCTAAG 44672 .......... .......... .......... .......... .......... .......... 513 TAGTTTTGTG TATTCAAAGG CATAATGAGA AGACAAAGCT GACATAATTG TCCAAAGAAA 44732 .......... .......... .......... .......... .......... .......... 513 AGAAAAAAGA CAAAGAAATT GTAGCATAAT AAACAGGAAT GGGTACCGTT ACAGACATTT 44792 .......... .......... .......... .......... .......... .......... 513 CTGTCTTTCT TCAAATCAAA CAAAATTTGT TGTATTTTGA TTAGTTTTCT GGAGCCTCAG 44852 .......... .......... .......... .......... .......... .......... 513 TATTGGATTA GGGCCTCAGC TGCAGCCGTG ATACAGGCAA ATTGTTATGC TTTAGGAGAT 44912 .......... .......... .......... .......... .......... .......... 513 CTGTATTTTA AATGGATGGA ATGATTCTTT TGGAATCTCT ACATCTCTTG ATGCTTCATT 44972 .......... .......... .......... .......... .......... .......... 513 TGACTAGCTA -TTTAGTTGA TCTTCTGGTG GATTCCCTTT TCAGGATGGA CGTATTGATT 45031 || ||| |||| || ||| .......GTA CTTTCTTTGA TCCTCTT... .......... .......... .......... 533 ATGGAGAATT TGTTGCTATG ATGCAAAAAG GAAATCCATG CATAGGAAGA CGAACAATGC 45091 .......... .......... .......... .......... .......... .......... 533 GAAATAGTCT GAATTTCAGC ATGAGAGATG CGCCCGGAGC TCATTAGCTT TTTGAATGGA 45151 .......... .......... .......... .......... .......... .......... 533 CACATGATGT AGGTATTTCC CCTTTTTTAT TTTTGTAACC GTTTCTTTGG CAATGAATTT 45211 .......... .......... .......... .......... .......... .......... 533 GAAGAAATCT TTCCTTGTTC TGTCCTTGAG AAATTGGATT GGTTGGAGTA TATTTGTTTA 45271 .......... .......... .......... .......... .......... .......... 533 ACATTAAGAG TTTCTTTTTC CCTCTTGAGG ATAATAAAAT TTTATAAATA ACAGCATGAG 45331 .......... .......... .......... .......... .......... .......... 533 TGTTTGCTGT AAAACTCTAC AGGTGCAGCA AAAAAAATTA CATTCAGCAA AAGTATATCC 45391 .......... .......... .......... .......... .......... .......... 533 CATCTTATCC TGTTGGTACA CTAGCATGTC ACAGATAGAT TCAGCTTCCT CCCCAATCCT 45451 .......... .......... .......... .......... .......... .......... 533 CCATTTTACA CCATTAACAA AAATAAATTT CAGATACAGA GTTCTCTTTC ATTCCCATCT 45511 .......... .......... .......... .......... .......... .......... 533 TTTATATAAT GCTGGTTTCT TTTCTTTTGG TAAAATTTTG ATGTATCAAA TTTGACGATT 45571 .......... .......... .......... .......... .......... .......... 533 GTCCGACATG GCTATGTGAG GAACTTTCCT AAGGGAGCAC TAAGGGTGTC AAATGTGTGG 45631 .......... .......... .......... .......... .......... .......... 533 GTGGAGGCAG TGGGGGACTG AAATTGAAGA GGTTAAAATG GGCTGAGCTA AAAGTCATGT 45691 .......... .......... .......... .......... .......... .......... 533 TGGATCATAA CCCACTCAAA CTTACTTTGG GCTAACATGG GCTAGAATCT TGATTGGGTT 45751 .......... .......... .......... .......... .......... .......... 533 ATGACCTATC CAATTTGACC TGCTTAATCT AAACTAAACT ATATTAAACA CTTGCTATAA 45811 .......... .......... .......... .......... .......... .......... 533 TTTATGACAG ATGTCATTCA ACCCATAGAA TCGTACAGAT CTGTACTAAC TTTTCATTTA 45871 .......... .......... .......... .......... .......... .......... 533 GGAGCATCTC CTTGTAGAGT AAATTGATGT AGACTTTATA GTATGGGACC AACTTCATAA 45931 .......... .......... .......... .......... .......... .......... 533 TTTTGCAACT CATTTAATAG TGTATTTATG AGAATTATTG AAAAGAATAT TATTGAATTG 45991 .......... .......... .......... .......... .......... .......... 533 TGTGTCTACA TTATTACATT GAGACTTTAT TTATAGACAC TATATTATAC TCCTTTTCCA 46051 .......... .......... .......... .......... .......... .......... 533 ACTAGGACAC TACAATACCA TCCTTTTCTA AGTAGGATTC TATATACTAT TTCTATTCCT 46111 .......... .......... .......... .......... .......... .......... 533 ATTCCTATTC TAAGTAGAAT GGTATATATT ATTCTTGTTC CTTTTTTGAT TCTAACACTC 46171 .......... .......... .......... .......... .......... .......... 533 CCCCTCAAGC TGGTGCATAC AAGTTATATA TACTTTGCTT GTTACAAATG TAATTAATAT 46231 .......... .......... .......... .......... .......... .......... 533 GAGGACCAAT GAGAGGCTTG ATGAAGATAT CTGCAAGTTG ATCACTTGAC TCACAAATTT 46291 .......... .......... .......... .......... .......... .......... 533 TGTAACAATA TCTCCCGACT TCCCAGACCA AGCTTGAGAA GAACGTTTCA TATCATCGAG 46351 .......... .......... .......... .......... .......... .......... 533 TGACTTGCAC AATCAACATA TAAGGCTGCT AGACTCCCTC GGAGCAATAA GACCAAGTGG 46411 .......... .......... .......... .......... .......... .......... 533 TTGCTCCATA TATACTTCTC CATCGAGATC CCAGCCCAAA TATGTAAGTA TATCCTTTTG 46471 .......... .......... .......... .......... .......... .......... 533 GATAAAGTGA ATCTAAAACA AAGAGAATAT TGCTTGAAAA CTTGGATTTT TTTGGGAACT 46531 .......... .......... .......... .......... .......... .......... 533 CGGATATGTT GGACTTTGCA CAACATTGAC AAAGTTGAAA CTATTTAAAT CAGACCTAAG 46591 .......... .......... .......... .......... .......... .......... 533 GAGTCACCGA AAAGACGTAC GGTGCTTCGA AAATTAGATA TGAGAAAGTA GTCACCAAAA 46651 .......... .......... .......... .......... .......... .......... 533 AGACGCATGA TGTTGTGCAA ATTAGATATG AGAAAGTAGT CACCAAGAAG ATGAGACAGT 46711 .......... .......... .......... .......... .......... .......... 533 GCTACATAAA TTAAATATGA AAAAGTAGTC ACTGATAAGA TGGCACGGTG CTACACAAAT 46771 .......... .......... .......... .......... .......... .......... 533 TAAATATGAA AAAGTAGTCA TCAAAAAGAT GGTGCGATGC TACACAAAAG TAAATAGTCA 46831 .......... .......... .......... .......... .......... .......... 533 CCGGAATGAT GACATGATGC TACAAAAATG AAATATGAGA GTAGTCACCT GAAGGATGAC 46891 .......... .......... .......... .......... .......... .......... 533 ACAGTGCCAC ATAAATTGAA CATAAAAAAA TAGTCACCAG AAACATGATG CGGTGCTACA 46951 .......... .......... .......... .......... .......... .......... 533 CAAATTAAGA GCCTGTTTGG CTCAGCTTAA AAGCTGGTCA AACTGACTT- AAAATCTGAT 47010 ||| |||||||||| |||||||||| || ||||||| ||||||||| |||| ||| | .......AGA GCCTGTTTGG CTCAGCTTAA AAACTGGTCA AACTGACTTA AAAAGCTGGT 586 TTTTGACTTA TTTAACTGTT TGACAATACT CAAAATAGCT TATTTTAAGT TAAAAAAAAC 47070 |||||||||| |||| ||||| |||||||||| ||||||| || |||||||||| |||||||||| TTTTGACTTA TTTAGCTGTT TGACAATACT CAAAATAACT TATTTTAAGT TAAAAAAAAC 646 TTATTTTAAG CCAAAA 47086 ||||||||| |||| TTATTTTAAA AAAAAA 662 hqPGS_C01HBa0088L02.1+_SGN-E376754- (46959 47086) ******************************************************************************** EST sequence 224 -strand 310 n (File: SGN-E233594-) 1 CTTATAATGT CTACTATTTA AGTGGAGATA CGTAAAAGAA AAAATTATTG TCTAAGAGCT 61 TGTTTAGTTC AGCTTAAAAG CTGATCAAAC TGACTTAAAA ACTGATTTTT GACTTATTTA 121 GTTGTTTGGC AATACTCAAA ATAACTTATT TTAAGTTAAA AAAAAAAACT TATTTTAAGC 181 CAAAAGTTAA AAGCTGGGGT AGGGGTGCTT TTTTTTTAGC TTATAAGCTG TTTTAAGTTG 241 ACCACATTTT TATCTTTTTG CCCTTAATAT TTTTATACAA TCTCCAAATT ATCCACATAA 301 CTCTAACATC Predicted gene structure (within gDNA segment 45539 to 47948): Exon 1 46961 47213 ( 253 n); cDNA 57 310 ( 254 n); score: 0.903 MATCH C01HBa0088L02.1+ SGN-E233594- 0.903 253 0.816 C PGS_C01HBa0088L02.1+_SGN-E233594- (46961 47213) Alignment (genomic DNA sequence = upper lines): AGCCTGTTTG GCTCAGCTTA AAAGCTGGTC AAACTGACTT AAAATCTGAT TTTTGACTTA 47020 ||| ||||| | |||||||| ||||||| || |||||||||| |||| ||||| |||||||||| AGCTTGTTTA GTTCAGCTTA AAAGCTGATC AAACTGACTT AAAAACTGAT TTTTGACTTA 116 TTTAACTGTT TGACAATACT CAAAATAGCT TATTTTAAGT T---AAAAAA AACTTATTTT 47077 |||| |||| || ||||||| ||||||| || |||||||||| | |||||| |||||||||| TTTAGTTGTT TGGCAATACT CAAAATAACT TATTTTAAGT TAAAAAAAAA AACTTATTTT 176 AAGCCAAAAG TTAAAAGGTG GGGTAGGGGT GCTTTTTTTT TTTAGCTTAT AAGCTGTTTT 47137 |||||||||| ||||||| || |||||||||| || |||||| |||||||||| |||||||||| AAGCCAAAAG TTAAAAGCTG GGGTAGGGGT GC--TTTTTT TTTAGCTTAT AAGCTGTTTT 234 AAGTTGACCA TATTTTTATG TTTTTTCCCT TAATATTTTT ATACAATCTC CAAATTATCC 47197 |||||||||| |||||||| ||||| |||| |||||||||| |||||||||| |||||||||| AAGTTGACCA CATTTTTATC TTTTTGCCCT TAATATTTTT ATACAATCTC CAAATTATCC 294 ATATAACCCT AACATC 47213 | ||||| || |||||| ACATAACTCT AACATC 310 hqPGS_C01HBa0088L02.1+_SGN-E233594- (46961 47213) ******************************************************************************** EST sequence 166 -strand 385 n (File: SGN-E217478-) 1 TGTCCAACAA GATTCACTGA AAAATGGTGC ACGAGTTAGG AATGTCGTCC CTGGTACAGA 61 GGAAGAAGCA CGTCGTGTGA TTGAACGGAT GGATGCTGAA AATTCATGAA GTCTTCTTGA 121 CTAGCATCAA TTGGCAGATA AAGGACTGAG GATACCTGAT TTTGGGTTTC AAACTCCCAG 181 AAAAGCAAAG ATGTCACAGT TATTTTAAGC AGAGATACTT AGAGCCTGTT TGGCTCAGCT 241 TAAAAGCTGG TTTTTGACTT ATTTAACTGT TTGGCAATAC TCAAAATAGT TTTTTTTAAC 301 TTATTTAACT GTTTGACAAT ACTCAAAATG GTTTATTTTA AGTTAAAAAA AACTTATTTT 361 AAGCCCCAAC AAAAAAAAAA AAAAA Predicted gene structure (within gDNA segment 43549 to 47882): Exon 1 44676 44737 ( 62 n); cDNA 160 217 ( 58 n); score: 0.661 Intron 1 44738 46976 (2239 n); Pd: 0.000 (s: 0.62), Pa: 0.000 (s: 0.72) Exon 2 46977 47058 ( 82 n); cDNA 218 299 ( 82 n); score: 0.799 PPA cDNA 368 385 MATCH C01HBa0088L02.1+ SGN-E217478- 0.740 144 0.374 C PGS_C01HBa0088L02.1+_SGN-E217478- (44676 44737,46977 47058) Alignment (genomic DNA sequence = upper lines): TTTTGTGTAT TCAAAGGCAT AATGAGAAGA CAAAGCTGAC ATAATTGTCC AAAGAAAAGA 44735 ||||| || | ||||| | | || ||| ||||| || | | | || | ||| | ||| TTTTGGGT-T TCAAACTC-C CA-GAAAAG- CAAAGATGTC ACAGTTATTT TAAGCAGAGA 215 AAAAAGACAA AGAAATTGTA GCATAATAAA CAGGAATGGG TACCGTTACA GACATTTCTG 44795 | TA........ .......... .......... .......... .......... .......... 217 TCTTTCTTCA AATCAAACAA AATTTGTTGT ATTTTGATTA GTTTTCTGGA GCCTCAGTAT 44855 .......... .......... .......... .......... .......... .......... 217 TGGATTAGGG CCTCAGCTGC AGCCGTGATA CAGGCAAATT GTTATGCTTT AGGAGATCTG 44915 .......... .......... .......... .......... .......... .......... 217 TATTTTAAAT GGATGGAATG ATTCTTTTGG AATCTCTACA TCTCTTGATG CTTCATTTGA 44975 .......... .......... .......... .......... .......... .......... 217 CTAGCTATTT AGTTGATCTT CTGGTGGATT CCCTTTTCAG GATGGACGTA TTGATTATGG 45035 .......... .......... .......... .......... .......... .......... 217 AGAATTTGTT GCTATGATGC AAAAAGGAAA TCCATGCATA GGAAGACGAA CAATGCGAAA 45095 .......... .......... .......... .......... .......... .......... 217 TAGTCTGAAT TTCAGCATGA GAGATGCGCC CGGAGCTCAT TAGCTTTTTG AATGGACACA 45155 .......... .......... .......... .......... .......... .......... 217 TGATGTAGGT ATTTCCCCTT TTTTATTTTT GTAACCGTTT CTTTGGCAAT GAATTTGAAG 45215 .......... .......... .......... .......... .......... .......... 217 AAATCTTTCC TTGTTCTGTC CTTGAGAAAT TGGATTGGTT GGAGTATATT TGTTTAACAT 45275 .......... .......... .......... .......... .......... .......... 217 TAAGAGTTTC TTTTTCCCTC TTGAGGATAA TAAAATTTTA TAAATAACAG CATGAGTGTT 45335 .......... .......... .......... .......... .......... .......... 217 TGCTGTAAAA CTCTACAGGT GCAGCAAAAA AAATTACATT CAGCAAAAGT ATATCCCATC 45395 .......... .......... .......... .......... .......... .......... 217 TTATCCTGTT GGTACACTAG CATGTCACAG ATAGATTCAG CTTCCTCCCC AATCCTCCAT 45455 .......... .......... .......... .......... .......... .......... 217 TTTACACCAT TAACAAAAAT AAATTTCAGA TACAGAGTTC TCTTTCATTC CCATCTTTTA 45515 .......... .......... .......... .......... .......... .......... 217 TATAATGCTG GTTTCTTTTC TTTTGGTAAA ATTTTGATGT ATCAAATTTG ACGATTGTCC 45575 .......... .......... .......... .......... .......... .......... 217 GACATGGCTA TGTGAGGAAC TTTCCTAAGG GAGCACTAAG GGTGTCAAAT GTGTGGGTGG 45635 .......... .......... .......... .......... .......... .......... 217 AGGCAGTGGG GGACTGAAAT TGAAGAGGTT AAAATGGGCT GAGCTAAAAG TCATGTTGGA 45695 .......... .......... .......... .......... .......... .......... 217 TCATAACCCA CTCAAACTTA CTTTGGGCTA ACATGGGCTA GAATCTTGAT TGGGTTATGA 45755 .......... .......... .......... .......... .......... .......... 217 CCTATCCAAT TTGACCTGCT TAATCTAAAC TAAACTATAT TAAACACTTG CTATAATTTA 45815 .......... .......... .......... .......... .......... .......... 217 TGACAGATGT CATTCAACCC ATAGAATCGT ACAGATCTGT ACTAACTTTT CATTTAGGAG 45875 .......... .......... .......... .......... .......... .......... 217 CATCTCCTTG TAGAGTAAAT TGATGTAGAC TTTATAGTAT GGGACCAACT TCATAATTTT 45935 .......... .......... .......... .......... .......... .......... 217 GCAACTCATT TAATAGTGTA TTTATGAGAA TTATTGAAAA GAATATTATT GAATTGTGTG 45995 .......... .......... .......... .......... .......... .......... 217 TCTACATTAT TACATTGAGA CTTTATTTAT AGACACTATA TTATACTCCT TTTCCAACTA 46055 .......... .......... .......... .......... .......... .......... 217 GGACACTACA ATACCATCCT TTTCTAAGTA GGATTCTATA TACTATTTCT ATTCCTATTC 46115 .......... .......... .......... .......... .......... .......... 217 CTATTCTAAG TAGAATGGTA TATATTATTC TTGTTCCTTT TTTGATTCTA ACACTCCCCC 46175 .......... .......... .......... .......... .......... .......... 217 TCAAGCTGGT GCATACAAGT TATATATACT TTGCTTGTTA CAAATGTAAT TAATATGAGG 46235 .......... .......... .......... .......... .......... .......... 217 ACCAATGAGA GGCTTGATGA AGATATCTGC AAGTTGATCA CTTGACTCAC AAATTTTGTA 46295 .......... .......... .......... .......... .......... .......... 217 ACAATATCTC CCGACTTCCC AGACCAAGCT TGAGAAGAAC GTTTCATATC ATCGAGTGAC 46355 .......... .......... .......... .......... .......... .......... 217 TTGCACAATC AACATATAAG GCTGCTAGAC TCCCTCGGAG CAATAAGACC AAGTGGTTGC 46415 .......... .......... .......... .......... .......... .......... 217 TCCATATATA CTTCTCCATC GAGATCCCAG CCCAAATATG TAAGTATATC CTTTTGGATA 46475 .......... .......... .......... .......... .......... .......... 217 AAGTGAATCT AAAACAAAGA GAATATTGCT TGAAAACTTG GATTTTTTTG GGAACTCGGA 46535 .......... .......... .......... .......... .......... .......... 217 TATGTTGGAC TTTGCACAAC ATTGACAAAG TTGAAACTAT TTAAATCAGA CCTAAGGAGT 46595 .......... .......... .......... .......... .......... .......... 217 CACCGAAAAG ACGTACGGTG CTTCGAAAAT TAGATATGAG AAAGTAGTCA CCAAAAAGAC 46655 .......... .......... .......... .......... .......... .......... 217 GCATGATGTT GTGCAAATTA GATATGAGAA AGTAGTCACC AAGAAGATGA GACAGTGCTA 46715 .......... .......... .......... .......... .......... .......... 217 CATAAATTAA ATATGAAAAA GTAGTCACTG ATAAGATGGC ACGGTGCTAC ACAAATTAAA 46775 .......... .......... .......... .......... .......... .......... 217 TATGAAAAAG TAGTCATCAA AAAGATGGTG CGATGCTACA CAAAAGTAAA TAGTCACCGG 46835 .......... .......... .......... .......... .......... .......... 217 AATGATGACA TGATGCTACA AAAATGAAAT ATGAGAGTAG TCACCTGAAG GATGACACAG 46895 .......... .......... .......... .......... .......... .......... 217 TGCCACATAA ATTGAACATA AAAAAATAGT CACCAGAAAC ATGATGCGGT GCTACACAAA 46955 .......... .......... .......... .......... .......... .......... 217 TTAAGAGCCT GTTTGGCTCA GCTTAAAAGC TGGTCAAACT GA-CTTAAAA TCTGATTTTT 47014 ||| | ||| || || | ||||||| ||| ||||| .......... .......... .CTT-AGAGC CTGTTTGGCT CAGCTTAAAA GCTGGTTTTT 255 GACTTATTTA ACTGTTTGAC AATACTCAAA ATAGCTTATT TTAA 47058 |||||||||| |||||||| | |||||||||| |||| || || |||| GACTTATTTA ACTGTTTGGC AATACTCAAA ATAGTTTTTT TTAA 299 hqPGS_C01HBa0088L02.1+_SGN-E217478- (46977 47058) ******************************************************************************** EST sequence 201 -strand 397 n (File: SGN-E229134-) 1 TTCACTTTCA CTGTCCAACA AGATTCACTG AAAAAATGGT GCACGAGTTA GGAATGTCGT 61 CCCTGGTACA GAGGAAGAAG CACGTCGTGT GATTGAACGG ATGGATGCTG AAAATTCATG 121 AAGTCTTCTT GACTAGCATC AATTGGCAGA TAAAGGACTG AGGATACCTG ATTTTGGGTT 181 TCAAACTCCC AGAAAAGCAA AGATGTCACA GTTATTTTAA GCAGAGATAC TTAGAGCCTG 241 TTTGGCTCAG CTTAAAAGCT GGTTTTTGAC TTATTTAACT GTTTGGCAAT ACTCAAAATA 301 GTTTTTTTTA ACTTATTTAA CTGTTTGACA ATACTCAAAA TGGTTTATTT TAAGTTAAAA 361 AAAACTTATT TTAAGCCAAA AAAAAAAAAA AAAAAAA Predicted gene structure (within gDNA segment 44029 to 47846): Exon 1 44676 44737 ( 62 n); cDNA 172 229 ( 58 n); score: 0.661 Intron 1 44738 46976 (2239 n); Pd: 0.000 (s: 0.62), Pa: 0.000 (s: 0.72) Exon 2 46977 47058 ( 82 n); cDNA 230 311 ( 82 n); score: 0.799 PPA cDNA 378 397 MATCH C01HBa0088L02.1+ SGN-E229134- 0.740 144 0.363 C PGS_C01HBa0088L02.1+_SGN-E229134- (44676 44737,46977 47058) Alignment (genomic DNA sequence = upper lines): TTTTGTGTAT TCAAAGGCAT AATGAGAAGA CAAAGCTGAC ATAATTGTCC AAAGAAAAGA 44735 ||||| || | ||||| | | || ||| ||||| || | | | || | ||| | ||| TTTTGGGT-T TCAAACTC-C CA-GAAAAG- CAAAGATGTC ACAGTTATTT TAAGCAGAGA 227 AAAAAGACAA AGAAATTGTA GCATAATAAA CAGGAATGGG TACCGTTACA GACATTTCTG 44795 | TA........ .......... .......... .......... .......... .......... 229 TCTTTCTTCA AATCAAACAA AATTTGTTGT ATTTTGATTA GTTTTCTGGA GCCTCAGTAT 44855 .......... .......... .......... .......... .......... .......... 229 TGGATTAGGG CCTCAGCTGC AGCCGTGATA CAGGCAAATT GTTATGCTTT AGGAGATCTG 44915 .......... .......... .......... .......... .......... .......... 229 TATTTTAAAT GGATGGAATG ATTCTTTTGG AATCTCTACA TCTCTTGATG CTTCATTTGA 44975 .......... .......... .......... .......... .......... .......... 229 CTAGCTATTT AGTTGATCTT CTGGTGGATT CCCTTTTCAG GATGGACGTA TTGATTATGG 45035 .......... .......... .......... .......... .......... .......... 229 AGAATTTGTT GCTATGATGC AAAAAGGAAA TCCATGCATA GGAAGACGAA CAATGCGAAA 45095 .......... .......... .......... .......... .......... .......... 229 TAGTCTGAAT TTCAGCATGA GAGATGCGCC CGGAGCTCAT TAGCTTTTTG AATGGACACA 45155 .......... .......... .......... .......... .......... .......... 229 TGATGTAGGT ATTTCCCCTT TTTTATTTTT GTAACCGTTT CTTTGGCAAT GAATTTGAAG 45215 .......... .......... .......... .......... .......... .......... 229 AAATCTTTCC TTGTTCTGTC CTTGAGAAAT TGGATTGGTT GGAGTATATT TGTTTAACAT 45275 .......... .......... .......... .......... .......... .......... 229 TAAGAGTTTC TTTTTCCCTC TTGAGGATAA TAAAATTTTA TAAATAACAG CATGAGTGTT 45335 .......... .......... .......... .......... .......... .......... 229 TGCTGTAAAA CTCTACAGGT GCAGCAAAAA AAATTACATT CAGCAAAAGT ATATCCCATC 45395 .......... .......... .......... .......... .......... .......... 229 TTATCCTGTT GGTACACTAG CATGTCACAG ATAGATTCAG CTTCCTCCCC AATCCTCCAT 45455 .......... .......... .......... .......... .......... .......... 229 TTTACACCAT TAACAAAAAT AAATTTCAGA TACAGAGTTC TCTTTCATTC CCATCTTTTA 45515 .......... .......... .......... .......... .......... .......... 229 TATAATGCTG GTTTCTTTTC TTTTGGTAAA ATTTTGATGT ATCAAATTTG ACGATTGTCC 45575 .......... .......... .......... .......... .......... .......... 229 GACATGGCTA TGTGAGGAAC TTTCCTAAGG GAGCACTAAG GGTGTCAAAT GTGTGGGTGG 45635 .......... .......... .......... .......... .......... .......... 229 AGGCAGTGGG GGACTGAAAT TGAAGAGGTT AAAATGGGCT GAGCTAAAAG TCATGTTGGA 45695 .......... .......... .......... .......... .......... .......... 229 TCATAACCCA CTCAAACTTA CTTTGGGCTA ACATGGGCTA GAATCTTGAT TGGGTTATGA 45755 .......... .......... .......... .......... .......... .......... 229 CCTATCCAAT TTGACCTGCT TAATCTAAAC TAAACTATAT TAAACACTTG CTATAATTTA 45815 .......... .......... .......... .......... .......... .......... 229 TGACAGATGT CATTCAACCC ATAGAATCGT ACAGATCTGT ACTAACTTTT CATTTAGGAG 45875 .......... .......... .......... .......... .......... .......... 229 CATCTCCTTG TAGAGTAAAT TGATGTAGAC TTTATAGTAT GGGACCAACT TCATAATTTT 45935 .......... .......... .......... .......... .......... .......... 229 GCAACTCATT TAATAGTGTA TTTATGAGAA TTATTGAAAA GAATATTATT GAATTGTGTG 45995 .......... .......... .......... .......... .......... .......... 229 TCTACATTAT TACATTGAGA CTTTATTTAT AGACACTATA TTATACTCCT TTTCCAACTA 46055 .......... .......... .......... .......... .......... .......... 229 GGACACTACA ATACCATCCT TTTCTAAGTA GGATTCTATA TACTATTTCT ATTCCTATTC 46115 .......... .......... .......... .......... .......... .......... 229 CTATTCTAAG TAGAATGGTA TATATTATTC TTGTTCCTTT TTTGATTCTA ACACTCCCCC 46175 .......... .......... .......... .......... .......... .......... 229 TCAAGCTGGT GCATACAAGT TATATATACT TTGCTTGTTA CAAATGTAAT TAATATGAGG 46235 .......... .......... .......... .......... .......... .......... 229 ACCAATGAGA GGCTTGATGA AGATATCTGC AAGTTGATCA CTTGACTCAC AAATTTTGTA 46295 .......... .......... .......... .......... .......... .......... 229 ACAATATCTC CCGACTTCCC AGACCAAGCT TGAGAAGAAC GTTTCATATC ATCGAGTGAC 46355 .......... .......... .......... .......... .......... .......... 229 TTGCACAATC AACATATAAG GCTGCTAGAC TCCCTCGGAG CAATAAGACC AAGTGGTTGC 46415 .......... .......... .......... .......... .......... .......... 229 TCCATATATA CTTCTCCATC GAGATCCCAG CCCAAATATG TAAGTATATC CTTTTGGATA 46475 .......... .......... .......... .......... .......... .......... 229 AAGTGAATCT AAAACAAAGA GAATATTGCT TGAAAACTTG GATTTTTTTG GGAACTCGGA 46535 .......... .......... .......... .......... .......... .......... 229 TATGTTGGAC TTTGCACAAC ATTGACAAAG TTGAAACTAT TTAAATCAGA CCTAAGGAGT 46595 .......... .......... .......... .......... .......... .......... 229 CACCGAAAAG ACGTACGGTG CTTCGAAAAT TAGATATGAG AAAGTAGTCA CCAAAAAGAC 46655 .......... .......... .......... .......... .......... .......... 229 GCATGATGTT GTGCAAATTA GATATGAGAA AGTAGTCACC AAGAAGATGA GACAGTGCTA 46715 .......... .......... .......... .......... .......... .......... 229 CATAAATTAA ATATGAAAAA GTAGTCACTG ATAAGATGGC ACGGTGCTAC ACAAATTAAA 46775 .......... .......... .......... .......... .......... .......... 229 TATGAAAAAG TAGTCATCAA AAAGATGGTG CGATGCTACA CAAAAGTAAA TAGTCACCGG 46835 .......... .......... .......... .......... .......... .......... 229 AATGATGACA TGATGCTACA AAAATGAAAT ATGAGAGTAG TCACCTGAAG GATGACACAG 46895 .......... .......... .......... .......... .......... .......... 229 TGCCACATAA ATTGAACATA AAAAAATAGT CACCAGAAAC ATGATGCGGT GCTACACAAA 46955 .......... .......... .......... .......... .......... .......... 229 TTAAGAGCCT GTTTGGCTCA GCTTAAAAGC TGGTCAAACT GA-CTTAAAA TCTGATTTTT 47014 ||| | ||| || || | ||||||| ||| ||||| .......... .......... .CTT-AGAGC CTGTTTGGCT CAGCTTAAAA GCTGGTTTTT 267 GACTTATTTA ACTGTTTGAC AATACTCAAA ATAGCTTATT TTAA 47058 |||||||||| |||||||| | |||||||||| |||| || || |||| GACTTATTTA ACTGTTTGGC AATACTCAAA ATAGTTTTTT TTAA 311 hqPGS_C01HBa0088L02.1+_SGN-E229134- (46977 47058) ******************************************************************************** EST sequence 200 -strand 468 n (File: SGN-E228654-) 1 ATCAATGTAG AAGTGGTAGC TCATGTCATG AGACCTGAGT TGCGGTCTAG CGAGGTTTCA 61 AACAATTTCT ATTTCACTTT CACTGTCCAA CAAGATTCAC TGAAAAATGG TGCACGAGTT 121 AGGAATGTCG TCCCTGGTAC AGAGGAAGAA GCACGTCGTG TGATTGAACG GATGGATGCT 181 GAAAATTCAT GAAGTCTTCT TGACTAGCAT CAATTGGCAG ATAAAGGACT GAGGATACCT 241 GATTTTGGGT TTCAAACTCC CAGAAAAGCA AAGATGTCCC AGTTATTTTA AGCAGAGATA 301 CTTAGAGCCT GTTTGGCTCA GCTTAAAAGC TGGTTTTTGA CTTATTTAAC TGTTTGGCAA 361 TACTCAAAAT AGTTTTTTTT AACTTATTTA ACTGTTTGAC AATACTCAAA ATGGTTTATT 421 TTAAGTTAAA AAAAACTTAT TTTAAGCCCA AAAAAAAAAA AAAAAAAA Predicted gene structure (within gDNA segment 42719 to 47882): Exon 1 44676 44737 ( 62 n); cDNA 243 300 ( 58 n); score: 0.645 Intron 1 44738 46976 (2239 n); Pd: 0.000 (s: 0.60), Pa: 0.000 (s: 0.72) Exon 2 46977 47058 ( 82 n); cDNA 301 382 ( 82 n); score: 0.799 PPA cDNA 450 468 MATCH C01HBa0088L02.1+ SGN-E228654- 0.733 144 0.308 C PGS_C01HBa0088L02.1+_SGN-E228654- (44676 44737,46977 47058) Alignment (genomic DNA sequence = upper lines): TTTTGTGTAT TCAAAGGCAT AATGAGAAGA CAAAGCTGAC ATAATTGTCC AAAGAAAAGA 44735 ||||| || | ||||| | | || ||| ||||| || | | || | ||| | ||| TTTTGGGT-T TCAAACTC-C CA-GAAAAG- CAAAGATGTC CCAGTTATTT TAAGCAGAGA 298 AAAAAGACAA AGAAATTGTA GCATAATAAA CAGGAATGGG TACCGTTACA GACATTTCTG 44795 | TA........ .......... .......... .......... .......... .......... 300 TCTTTCTTCA AATCAAACAA AATTTGTTGT ATTTTGATTA GTTTTCTGGA GCCTCAGTAT 44855 .......... .......... .......... .......... .......... .......... 300 TGGATTAGGG CCTCAGCTGC AGCCGTGATA CAGGCAAATT GTTATGCTTT AGGAGATCTG 44915 .......... .......... .......... .......... .......... .......... 300 TATTTTAAAT GGATGGAATG ATTCTTTTGG AATCTCTACA TCTCTTGATG CTTCATTTGA 44975 .......... .......... .......... .......... .......... .......... 300 CTAGCTATTT AGTTGATCTT CTGGTGGATT CCCTTTTCAG GATGGACGTA TTGATTATGG 45035 .......... .......... .......... .......... .......... .......... 300 AGAATTTGTT GCTATGATGC AAAAAGGAAA TCCATGCATA GGAAGACGAA CAATGCGAAA 45095 .......... .......... .......... .......... .......... .......... 300 TAGTCTGAAT TTCAGCATGA GAGATGCGCC CGGAGCTCAT TAGCTTTTTG AATGGACACA 45155 .......... .......... .......... .......... .......... .......... 300 TGATGTAGGT ATTTCCCCTT TTTTATTTTT GTAACCGTTT CTTTGGCAAT GAATTTGAAG 45215 .......... .......... .......... .......... .......... .......... 300 AAATCTTTCC TTGTTCTGTC CTTGAGAAAT TGGATTGGTT GGAGTATATT TGTTTAACAT 45275 .......... .......... .......... .......... .......... .......... 300 TAAGAGTTTC TTTTTCCCTC TTGAGGATAA TAAAATTTTA TAAATAACAG CATGAGTGTT 45335 .......... .......... .......... .......... .......... .......... 300 TGCTGTAAAA CTCTACAGGT GCAGCAAAAA AAATTACATT CAGCAAAAGT ATATCCCATC 45395 .......... .......... .......... .......... .......... .......... 300 TTATCCTGTT GGTACACTAG CATGTCACAG ATAGATTCAG CTTCCTCCCC AATCCTCCAT 45455 .......... .......... .......... .......... .......... .......... 300 TTTACACCAT TAACAAAAAT AAATTTCAGA TACAGAGTTC TCTTTCATTC CCATCTTTTA 45515 .......... .......... .......... .......... .......... .......... 300 TATAATGCTG GTTTCTTTTC TTTTGGTAAA ATTTTGATGT ATCAAATTTG ACGATTGTCC 45575 .......... .......... .......... .......... .......... .......... 300 GACATGGCTA TGTGAGGAAC TTTCCTAAGG GAGCACTAAG GGTGTCAAAT GTGTGGGTGG 45635 .......... .......... .......... .......... .......... .......... 300 AGGCAGTGGG GGACTGAAAT TGAAGAGGTT AAAATGGGCT GAGCTAAAAG TCATGTTGGA 45695 .......... .......... .......... .......... .......... .......... 300 TCATAACCCA CTCAAACTTA CTTTGGGCTA ACATGGGCTA GAATCTTGAT TGGGTTATGA 45755 .......... .......... .......... .......... .......... .......... 300 CCTATCCAAT TTGACCTGCT TAATCTAAAC TAAACTATAT TAAACACTTG CTATAATTTA 45815 .......... .......... .......... .......... .......... .......... 300 TGACAGATGT CATTCAACCC ATAGAATCGT ACAGATCTGT ACTAACTTTT CATTTAGGAG 45875 .......... .......... .......... .......... .......... .......... 300 CATCTCCTTG TAGAGTAAAT TGATGTAGAC TTTATAGTAT GGGACCAACT TCATAATTTT 45935 .......... .......... .......... .......... .......... .......... 300 GCAACTCATT TAATAGTGTA TTTATGAGAA TTATTGAAAA GAATATTATT GAATTGTGTG 45995 .......... .......... .......... .......... .......... .......... 300 TCTACATTAT TACATTGAGA CTTTATTTAT AGACACTATA TTATACTCCT TTTCCAACTA 46055 .......... .......... .......... .......... .......... .......... 300 GGACACTACA ATACCATCCT TTTCTAAGTA GGATTCTATA TACTATTTCT ATTCCTATTC 46115 .......... .......... .......... .......... .......... .......... 300 CTATTCTAAG TAGAATGGTA TATATTATTC TTGTTCCTTT TTTGATTCTA ACACTCCCCC 46175 .......... .......... .......... .......... .......... .......... 300 TCAAGCTGGT GCATACAAGT TATATATACT TTGCTTGTTA CAAATGTAAT TAATATGAGG 46235 .......... .......... .......... .......... .......... .......... 300 ACCAATGAGA GGCTTGATGA AGATATCTGC AAGTTGATCA CTTGACTCAC AAATTTTGTA 46295 .......... .......... .......... .......... .......... .......... 300 ACAATATCTC CCGACTTCCC AGACCAAGCT TGAGAAGAAC GTTTCATATC ATCGAGTGAC 46355 .......... .......... .......... .......... .......... .......... 300 TTGCACAATC AACATATAAG GCTGCTAGAC TCCCTCGGAG CAATAAGACC AAGTGGTTGC 46415 .......... .......... .......... .......... .......... .......... 300 TCCATATATA CTTCTCCATC GAGATCCCAG CCCAAATATG TAAGTATATC CTTTTGGATA 46475 .......... .......... .......... .......... .......... .......... 300 AAGTGAATCT AAAACAAAGA GAATATTGCT TGAAAACTTG GATTTTTTTG GGAACTCGGA 46535 .......... .......... .......... .......... .......... .......... 300 TATGTTGGAC TTTGCACAAC ATTGACAAAG TTGAAACTAT TTAAATCAGA CCTAAGGAGT 46595 .......... .......... .......... .......... .......... .......... 300 CACCGAAAAG ACGTACGGTG CTTCGAAAAT TAGATATGAG AAAGTAGTCA CCAAAAAGAC 46655 .......... .......... .......... .......... .......... .......... 300 GCATGATGTT GTGCAAATTA GATATGAGAA AGTAGTCACC AAGAAGATGA GACAGTGCTA 46715 .......... .......... .......... .......... .......... .......... 300 CATAAATTAA ATATGAAAAA GTAGTCACTG ATAAGATGGC ACGGTGCTAC ACAAATTAAA 46775 .......... .......... .......... .......... .......... .......... 300 TATGAAAAAG TAGTCATCAA AAAGATGGTG CGATGCTACA CAAAAGTAAA TAGTCACCGG 46835 .......... .......... .......... .......... .......... .......... 300 AATGATGACA TGATGCTACA AAAATGAAAT ATGAGAGTAG TCACCTGAAG GATGACACAG 46895 .......... .......... .......... .......... .......... .......... 300 TGCCACATAA ATTGAACATA AAAAAATAGT CACCAGAAAC ATGATGCGGT GCTACACAAA 46955 .......... .......... .......... .......... .......... .......... 300 TTAAGAGCCT GTTTGGCTCA GCTTAAAAGC TGGTCAAACT GA-CTTAAAA TCTGATTTTT 47014 ||| | ||| || || | ||||||| ||| ||||| .......... .......... .CTT-AGAGC CTGTTTGGCT CAGCTTAAAA GCTGGTTTTT 338 GACTTATTTA ACTGTTTGAC AATACTCAAA ATAGCTTATT TTAA 47058 |||||||||| |||||||| | |||||||||| |||| || || |||| GACTTATTTA ACTGTTTGGC AATACTCAAA ATAGTTTTTT TTAA 382 hqPGS_C01HBa0088L02.1+_SGN-E228654- (46977 47058) ******************************************************************************** EST sequence 154 -strand 580 n (File: SGN-E204223-) 1 TACTCAAAAT AACTTATTTT AAGTTAAAAA AAAAAACTTA TTTTAAGCCA AAAGTTAAAA 61 GCTGGGGTAG GGGTGCTTTT TTTTTAGCTT ATAAGCTGTT TTAAGTTGAC CACATTTTTA 121 TCTTTTTGCC CTTAATATTT TTATACAATC TCCAAATTAT CCACATAACT CTAACATCTC 181 TTTCTTCCAT TTTTCCATTT TCACGTTTGG CATAGCAACT TCAACACTTT TATCCAAATG 241 CATAACTTTT AAAAGTACTT TTTTAAAGCT AAGTCCATCC AAACGGGCCC TAAGAATGAA 301 CTCTACATGA ATTTTTCGAT CAAAATAAAC ATAATTTTGT ATAATTAATT ATTTTTAAAA 361 AATTTATGAT TAAACGAGAG TTTAGAGAGT TGATTACCAA GTAGAGCAAC AGTTCCTTCA 421 GTATCAACAC CAATTGATTG AAATCTTGAA AGCACAGATG AGATTGAATC GTTGTGATTA 481 GGGAGGTACT TCTCAACTTC TGAAAAGTAA GTTTCCTTGC TATCTTTCCT TCCTGTTTTC 541 ATTTCAATTT TTATTGGCCC TCCTAACCAA AGAAGACCAT Predicted gene structure (within gDNA segment 46319 to 51509): Exon 1 47037 47282 ( 246 n); cDNA 1 247 ( 247 n); score: 0.913 Intron 1 47283 47321 ( 39 n); Pd: 0.000 (s: 0.94), Pa: 0.000 (s: 0.61) Exon 2 47322 47365 ( 44 n); cDNA 248 293 ( 46 n); score: 0.614 Intron 2 47366 49790 (2425 n); Pd: 0.000 (s: 0.61), Pa: 0.999 (s: 0) Exon 3 49791 49796 ( 6 n); cDNA 294 299 ( 6 n); score: 0.833 MATCH C01HBa0088L02.1+ SGN-E204223- 0.913 296 0.510 C PGS_C01HBa0088L02.1+_SGN-E204223- (47037 47282,47322 47365,49791 49796) Alignment (genomic DNA sequence = upper lines): TACTCAAAAT AGCTTATTTT AAGTT---AA AAAAAACTTA TTTTAAGCCA AAAGTTAAAA 47093 |||||||||| | |||||||| ||||| || |||||||||| |||||||||| |||||||||| TACTCAAAAT AACTTATTTT AAGTTAAAAA AAAAAACTTA TTTTAAGCCA AAAGTTAAAA 60 GGTGGGGTAG GGGTGCTTTT TTTTTTTAGC TTATAAGCTG TTTTAAGTTG ACCATATTTT 47153 | |||||||| |||||| || |||||||||| |||||||||| |||||||||| |||| ||||| GCTGGGGTAG GGGTGC--TT TTTTTTTAGC TTATAAGCTG TTTTAAGTTG ACCACATTTT 118 TATGTTTTTT CCCTTAATAT TTTTATACAA TCTCCAAATT ATCCATATAA CCCTAACATC 47213 ||| ||||| |||||||||| |||||||||| |||||||||| ||||| |||| | |||||||| TATCTTTTTG CCCTTAATAT TTTTATACAA TCTCCAAATT ATCCACATAA CTCTAACATC 178 TCTTTCTTCT ATTTTTCCCT TTTCACGTTT GGCATAACAA CTTCAGCACT TTTATCCAAA 47273 ||||||||| |||||||| | |||||||||| |||||| ||| ||||| |||| |||||||||| TCTTTCTTCC ATTTTTCCAT TTTCACGTTT GGCATAGCAA CTTCAACACT TTTATCCAAA 238 CGCATAACTG CTTATTTTAA AAATAAGTTT CAGCACTTTC AAAAGTACTT TTTTAAAGCT 47333 |||||||| || | | || TGCATAACT. .......... .......... .......... ........TT TAAAAGTACT 259 GCTTT-TA-T TAAGCCCATC CAAACGGGCT CTAAATATAT AAATAATAGT CACCGGAAGA 47391 ||| | |||| ||||| ||||||||| |||| TTTTTAAAGC TAAGTCCATC CAAACGGGCC CTAA...... .......... .......... 293 TGACACACTG CTACAAATCA AATTTAAGAA AGTAGTCACC GAAATGATAG CACAGTGCCA 47451 .......... .......... .......... .......... .......... .......... 293 CACAAATTAG ATATGAGAAA GTAGTCGCCA TGACAACCCT AGAAAGTCGT GCATATATCA 47511 .......... .......... .......... .......... .......... .......... 293 GTGACCCTAA TTTGGTTAAC ATTACCAATG GCAAGAGGGG AGATAGATAT GAGTCATAGC 47571 .......... .......... .......... .......... .......... .......... 293 CGCCCTACAC CGACGAAATC TTTTTTTGAT TTTCTACCGA GATCGTAGGA GCTTTGATAC 47631 .......... .......... .......... .......... .......... .......... 293 CATGTGGAAA TATTGAAAAA GAACATTGTT GAATTGGTCT CTAGATTATA ACATCGAGAC 47691 .......... .......... .......... .......... .......... .......... 293 CTATTAATAG GGCACTACCT TAGACTCAAA TTCCAACTAG GACACTACCA TACAATCCTA 47751 .......... .......... .......... .......... .......... .......... 293 TTCTAAGTAG TATTTTATGT ACTATTTTTA TTCCTATTAC TAGTATTTTA TGTACTATTT 47811 .......... .......... .......... .......... .......... .......... 293 TTATTCCTGT TACTATTCTA AGTATGATGG TATATATTAT TCTTGTTCAT ATTCCTATTC 47871 .......... .......... .......... .......... .......... .......... 293 AAACAGTAAT AATTTGACAT ATAGAATGTA GGCAATTATT TTTTAATATG ACATGGCATG 47931 .......... .......... .......... .......... .......... .......... 293 CAAAATAATG TGTTGTTAAA GAATCAAATA ACAATAATCA AGTGACTTTA GAATTCCAAA 47991 .......... .......... .......... .......... .......... .......... 293 AGAGAGACCA TGATAGATCA TTATCATATT AGGTAATAAA AAATAAGGAT TCGGTAACAA 48051 .......... .......... .......... .......... .......... .......... 293 AATGCAAGAA GGTGAAATGA ATTTTTAAGA TATTTCAGTT TGCCAAAAAT AAGCATATTA 48111 .......... .......... .......... .......... .......... .......... 293 GGTTAGTATA TGAGGAAAAA AAACAGTTTT ATTCGAATTG GTTAAACTCA GTTCTCATTT 48171 .......... .......... .......... .......... .......... .......... 293 TCATATCAAG TGAAAAGGTC AATATAAACT AAAGAGATGA TGATTGTCCC ATCTTTGCAC 48231 .......... .......... .......... .......... .......... .......... 293 ATGTAGTCCG GTTAGAATGG GGATTGAATT GACATAGAAC TTGGGCTAAG TGGGTTATAA 48291 .......... .......... .......... .......... .......... .......... 293 TTATACGGGT TAAGACGTAG CACATTATTA AATTATCATG AGCTCAACCC ATAAATTTTG 48351 .......... .......... .......... .......... .......... .......... 293 GGCTCCTAAT ATCTGAGCTT CATTTGACAC CCCAAGTAAG GAGTGCCACG CACGAGCATG 48411 .......... .......... .......... .......... .......... .......... 293 GCAAAAAGCA AGGGGAACTT TTCTTTTTGG GAGAAATCAT TTGATTGCAT ATTGAATACA 48471 .......... .......... .......... .......... .......... .......... 293 TAAAGCACAT TCCAACAAAT TCAAATTTTA GAAGTTTCAT ATGGTGACTA CATTTTAGCT 48531 .......... .......... .......... .......... .......... .......... 293 TCCCGTCAAT TACCCCAACC TTCTTCATTT ATCCAGATGT GGGACGGACA CGGTGAAGCT 48591 .......... .......... .......... .......... .......... .......... 293 CACATAGATT GAGTTAGGTA AAATATTTAT CTGTGGAGAA AAATATTACC CCCTGTTCCA 48651 .......... .......... .......... .......... .......... .......... 293 TTTTGTGTGA CAAGTTGAAA AATATGTGTG GTTAAATTGA CTAATTTTCT GAGTGAATTT 48711 .......... .......... .......... .......... .......... .......... 293 GAACATTGAT ATTCATTTTC TAAAAATAAA GTTTTACATC TTTAAAAACT ATATAAAAAG 48771 .......... .......... .......... .......... .......... .......... 293 TATTGTAAGT CACAATAGTT TACAATTCAA AATATTAAAG AAGTATTTTA AAAAAAACAT 48831 .......... .......... .......... .......... .......... .......... 293 GGTCAAAGAA AAACTTATTT TACACTCCAG ATAGTTATAG GTTACATAAA GTGGAGCAAA 48891 .......... .......... .......... .......... .......... .......... 293 GTACTCTTAT CAATACTCTT AACCATAGGT CTGGAATTCG AGTACCCATA GAATAGAGTT 48951 .......... .......... .......... .......... .......... .......... 293 CCTTTTGTTA GGGAGCGGGT GGGAACCAAA AAAAAAAGTG GAACAAAGGG AGTACTAAAG 49011 .......... .......... .......... .......... .......... .......... 293 TATACTTATG GAAGTTAATA TAAAATCTGA AGATAAGCGT TAAAAACATA CCTAAACTAT 49071 .......... .......... .......... .......... .......... .......... 293 CCTTTTTTTT TTAGTTTCAT ACTTGAAGTA TTGAGTGTGA GTTTTCTACC TAAACTATCA 49131 .......... .......... .......... .......... .......... .......... 293 CTTATTAATT TGAGAAACAC ATCTTTCTTT TATTATACTC TATCATGGTG TGTAATACAC 49191 .......... .......... .......... .......... .......... .......... 293 TCCTTTTATT TAAAAATTGT TATATTACAA TCCACATGGA CAAAACGTTT CACCTTGACA 49251 .......... .......... .......... .......... .......... .......... 293 AAAAATAAAT AATTAGTATT AGTTAAAGTT AAGTATTAAA GTATTGCTAT CCCCCCCCCC 49311 .......... .......... .......... .......... .......... .......... 293 TCCCCCAAAA AAAAAATTAT AAAATAAAAT GTAAAATATT TTTTTTACCC AACTCCAATC 49371 .......... .......... .......... .......... .......... .......... 293 TTTCCTCTCA ACGTACTCCC CCATCCCAAA TTTTTAGTTT ATTTTGTTCA AAAAAAATAA 49431 .......... .......... .......... .......... .......... .......... 293 ATCCCTTCGA ATAATAATTT AGATATAGTT AAATTTATTT TATTTCTTGA AAAAAAATTC 49491 .......... .......... .......... .......... .......... .......... 293 TACCCTAACA TAACTCCCCT CTTCCATTTT TTTTCTCGTT TTGTATTAGA TATGTATTTT 49551 .......... .......... .......... .......... .......... .......... 293 CTTTTCTAAA AAAGTATTTT TTAACTTGCC GCAAGACTTT TCATAAAATA AAACTTTTAT 49611 .......... .......... .......... .......... .......... .......... 293 TTCTGTTAAT TTGGTATGCA AGTAGAAAAG AATGTTTTCC TAAAAATATA TGTACACATC 49671 .......... .......... .......... .......... .......... .......... 293 TAACACAAAA CTAGAAAAAT GTATAAAATT AAATTAGGAG CGGAGGGTTA GATGGGGTGG 49731 .......... .......... .......... .......... .......... .......... 293 GGTAGAATAT TATTTTATTT TACTTTTTTT TTAAAAAATA ATATCAAAAT TATTTTTAGG 49791 | .......... .......... .......... .......... .......... .........G 294 AAGGA 49796 || || AATGA 299 hqPGS_C01HBa0088L02.1+_SGN-E204223- (47037 47282) ******************************************************************************** EST sequence 177 -strand 554 n (File: SGN-E374844-) 1 AAAAAAAAAA CTTATATTAA GCCAAAAGTT AAAAGCTGGG GTAGGGGTGC TTTTTTTTTA 61 GCTTATAAGC TGTTTTAAGT TGACCACATT TTTATCTTTT TGCCCTTAAT ATTTTTATAC 121 AATCTCCAAA TTATCCACAT AACTCTAACA TCTCTTTCTT CCATTTTTCC ATTTTCACGT 181 TTGGCATAGC AACTTCAACA CTTTTATCCA AATGCATAAC TTTTAAAAGT ACTTTTTTAA 241 AGCTAAGTCC ATCCAAACGG GCCCTAAGAA TGAACTCTAC ATGAATTTTT CGATCAAAAT 301 AAACATAATT TTGTATAATT AATTATTTTT AAAAAATTTA TGATTAAACG AGAGTTTAGA 361 GAGTTGATTA CCAAGTAGAG CAACAGTTCC TTCAGTATCA ACACCAATTG ATTGAAATCT 421 TGAAAGCACA GATGAGATTG AATCGTTGTG ATTAGGGAGG TACTTCTCAA CTTCTGAAAA 481 GTAAGTTTCC TTGCTATCTT TCCTTCCTGT TTTCATTTCA ATTTTTATTG GCCCTCCTAA 541 CCAAAGAAGA CCAT Predicted gene structure (within gDNA segment 46306 to 51509): Exon 1 47062 47282 ( 221 n); cDNA 3 221 ( 219 n); score: 0.937 Intron 1 47283 47321 ( 39 n); Pd: 0.000 (s: 0.94), Pa: 0.000 (s: 0.61) Exon 2 47322 47365 ( 44 n); cDNA 222 267 ( 46 n); score: 0.614 Intron 2 47366 49790 (2425 n); Pd: 0.000 (s: 0.61), Pa: 0.999 (s: 0) Exon 3 49791 49796 ( 6 n); cDNA 268 273 ( 6 n); score: 0.833 MATCH C01HBa0088L02.1+ SGN-E374844- 0.937 271 0.489 C PGS_C01HBa0088L02.1+_SGN-E374844- (47062 47282,47322 47365,49791 49796) Alignment (genomic DNA sequence = upper lines): AAAAAAAACT TATTTTAAGC CAAAAGTTAA AAGGTGGGGT AGGGGTGCTT TTTTTTTTTA 47121 |||||||||| ||| |||||| |||||||||| ||| |||||| |||||||| |||||||||| AAAAAAAACT TATATTAAGC CAAAAGTTAA AAGCTGGGGT AGGGGTGC-- TTTTTTTTTA 60 GCTTATAAGC TGTTTTAAGT TGACCATATT TTTATGTTTT TTCCCTTAAT ATTTTTATAC 47181 |||||||||| |||||||||| |||||| ||| ||||| |||| | |||||||| |||||||||| GCTTATAAGC TGTTTTAAGT TGACCACATT TTTATCTTTT TGCCCTTAAT ATTTTTATAC 120 AATCTCCAAA TTATCCATAT AACCCTAACA TCTCTTTCTT CTATTTTTCC CTTTTCACGT 47241 |||||||||| ||||||| || ||| |||||| |||||||||| | |||||||| ||||||||| AATCTCCAAA TTATCCACAT AACTCTAACA TCTCTTTCTT CCATTTTTCC ATTTTCACGT 180 TTGGCATAAC AACTTCAGCA CTTTTATCCA AACGCATAAC TGCTTATTTT AAAAATAAGT 47301 |||||||| | ||||||| || |||||||||| || ||||||| | TTGGCATAGC AACTTCAACA CTTTTATCCA AATGCATAAC T......... .......... 221 TTCAGCACTT TCAAAAGTAC TTTTTTAAAG CTGCTTT-TA -TTAAGCCCA TCCAAACGGG 47359 ||| | || ||| | |||| ||| |||||||||| .......... .......... TTTAAAAGTA CTTTTTTAAA GCTAAGTCCA TCCAAACGGG 261 CTCTAAATAT ATAAATAATA GTCACCGGAA GATGACACAC TGCTACAAAT CAAATTTAAG 47419 | |||| CCCTAA.... .......... .......... .......... .......... .......... 267 AAAGTAGTCA CCGAAATGAT AGCACAGTGC CACACAAATT AGATATGAGA AAGTAGTCGC 47479 .......... .......... .......... .......... .......... .......... 267 CATGACAACC CTAGAAAGTC GTGCATATAT CAGTGACCCT AATTTGGTTA ACATTACCAA 47539 .......... .......... .......... .......... .......... .......... 267 TGGCAAGAGG GGAGATAGAT ATGAGTCATA GCCGCCCTAC ACCGACGAAA TCTTTTTTTG 47599 .......... .......... .......... .......... .......... .......... 267 ATTTTCTACC GAGATCGTAG GAGCTTTGAT ACCATGTGGA AATATTGAAA AAGAACATTG 47659 .......... .......... .......... .......... .......... .......... 267 TTGAATTGGT CTCTAGATTA TAACATCGAG ACCTATTAAT AGGGCACTAC CTTAGACTCA 47719 .......... .......... .......... .......... .......... .......... 267 AATTCCAACT AGGACACTAC CATACAATCC TATTCTAAGT AGTATTTTAT GTACTATTTT 47779 .......... .......... .......... .......... .......... .......... 267 TATTCCTATT ACTAGTATTT TATGTACTAT TTTTATTCCT GTTACTATTC TAAGTATGAT 47839 .......... .......... .......... .......... .......... .......... 267 GGTATATATT ATTCTTGTTC ATATTCCTAT TCAAACAGTA ATAATTTGAC ATATAGAATG 47899 .......... .......... .......... .......... .......... .......... 267 TAGGCAATTA TTTTTTAATA TGACATGGCA TGCAAAATAA TGTGTTGTTA AAGAATCAAA 47959 .......... .......... .......... .......... .......... .......... 267 TAACAATAAT CAAGTGACTT TAGAATTCCA AAAGAGAGAC CATGATAGAT CATTATCATA 48019 .......... .......... .......... .......... .......... .......... 267 TTAGGTAATA AAAAATAAGG ATTCGGTAAC AAAATGCAAG AAGGTGAAAT GAATTTTTAA 48079 .......... .......... .......... .......... .......... .......... 267 GATATTTCAG TTTGCCAAAA ATAAGCATAT TAGGTTAGTA TATGAGGAAA AAAAACAGTT 48139 .......... .......... .......... .......... .......... .......... 267 TTATTCGAAT TGGTTAAACT CAGTTCTCAT TTTCATATCA AGTGAAAAGG TCAATATAAA 48199 .......... .......... .......... .......... .......... .......... 267 CTAAAGAGAT GATGATTGTC CCATCTTTGC ACATGTAGTC CGGTTAGAAT GGGGATTGAA 48259 .......... .......... .......... .......... .......... .......... 267 TTGACATAGA ACTTGGGCTA AGTGGGTTAT AATTATACGG GTTAAGACGT AGCACATTAT 48319 .......... .......... .......... .......... .......... .......... 267 TAAATTATCA TGAGCTCAAC CCATAAATTT TGGGCTCCTA ATATCTGAGC TTCATTTGAC 48379 .......... .......... .......... .......... .......... .......... 267 ACCCCAAGTA AGGAGTGCCA CGCACGAGCA TGGCAAAAAG CAAGGGGAAC TTTTCTTTTT 48439 .......... .......... .......... .......... .......... .......... 267 GGGAGAAATC ATTTGATTGC ATATTGAATA CATAAAGCAC ATTCCAACAA ATTCAAATTT 48499 .......... .......... .......... .......... .......... .......... 267 TAGAAGTTTC ATATGGTGAC TACATTTTAG CTTCCCGTCA ATTACCCCAA CCTTCTTCAT 48559 .......... .......... .......... .......... .......... .......... 267 TTATCCAGAT GTGGGACGGA CACGGTGAAG CTCACATAGA TTGAGTTAGG TAAAATATTT 48619 .......... .......... .......... .......... .......... .......... 267 ATCTGTGGAG AAAAATATTA CCCCCTGTTC CATTTTGTGT GACAAGTTGA AAAATATGTG 48679 .......... .......... .......... .......... .......... .......... 267 TGGTTAAATT GACTAATTTT CTGAGTGAAT TTGAACATTG ATATTCATTT TCTAAAAATA 48739 .......... .......... .......... .......... .......... .......... 267 AAGTTTTACA TCTTTAAAAA CTATATAAAA AGTATTGTAA GTCACAATAG TTTACAATTC 48799 .......... .......... .......... .......... .......... .......... 267 AAAATATTAA AGAAGTATTT TAAAAAAAAC ATGGTCAAAG AAAAACTTAT TTTACACTCC 48859 .......... .......... .......... .......... .......... .......... 267 AGATAGTTAT AGGTTACATA AAGTGGAGCA AAGTACTCTT ATCAATACTC TTAACCATAG 48919 .......... .......... .......... .......... .......... .......... 267 GTCTGGAATT CGAGTACCCA TAGAATAGAG TTCCTTTTGT TAGGGAGCGG GTGGGAACCA 48979 .......... .......... .......... .......... .......... .......... 267 AAAAAAAAAG TGGAACAAAG GGAGTACTAA AGTATACTTA TGGAAGTTAA TATAAAATCT 49039 .......... .......... .......... .......... .......... .......... 267 GAAGATAAGC GTTAAAAACA TACCTAAACT ATCCTTTTTT TTTTAGTTTC ATACTTGAAG 49099 .......... .......... .......... .......... .......... .......... 267 TATTGAGTGT GAGTTTTCTA CCTAAACTAT CACTTATTAA TTTGAGAAAC ACATCTTTCT 49159 .......... .......... .......... .......... .......... .......... 267 TTTATTATAC TCTATCATGG TGTGTAATAC ACTCCTTTTA TTTAAAAATT GTTATATTAC 49219 .......... .......... .......... .......... .......... .......... 267 AATCCACATG GACAAAACGT TTCACCTTGA CAAAAAATAA ATAATTAGTA TTAGTTAAAG 49279 .......... .......... .......... .......... .......... .......... 267 TTAAGTATTA AAGTATTGCT ATCCCCCCCC CCTCCCCCAA AAAAAAAATT ATAAAATAAA 49339 .......... .......... .......... .......... .......... .......... 267 ATGTAAAATA TTTTTTTTAC CCAACTCCAA TCTTTCCTCT CAACGTACTC CCCCATCCCA 49399 .......... .......... .......... .......... .......... .......... 267 AATTTTTAGT TTATTTTGTT CAAAAAAAAT AAATCCCTTC GAATAATAAT TTAGATATAG 49459 .......... .......... .......... .......... .......... .......... 267 TTAAATTTAT TTTATTTCTT GAAAAAAAAT TCTACCCTAA CATAACTCCC CTCTTCCATT 49519 .......... .......... .......... .......... .......... .......... 267 TTTTTTCTCG TTTTGTATTA GATATGTATT TTCTTTTCTA AAAAAGTATT TTTTAACTTG 49579 .......... .......... .......... .......... .......... .......... 267 CCGCAAGACT TTTCATAAAA TAAAACTTTT ATTTCTGTTA ATTTGGTATG CAAGTAGAAA 49639 .......... .......... .......... .......... .......... .......... 267 AGAATGTTTT CCTAAAAATA TATGTACACA TCTAACACAA AACTAGAAAA ATGTATAAAA 49699 .......... .......... .......... .......... .......... .......... 267 TTAAATTAGG AGCGGAGGGT TAGATGGGGT GGGGTAGAAT ATTATTTTAT TTTACTTTTT 49759 .......... .......... .......... .......... .......... .......... 267 TTTTAAAAAA TAATATCAAA ATTATTTTTA GGAAGGA 49796 ||| || .......... .......... .......... .GAATGA 273 hqPGS_C01HBa0088L02.1+_SGN-E374844- (47062 47282) ******************************************************************************** EST sequence 123 -strand 506 n (File: SGN-E578392-) 1 TTTTTTTTTT AGCTTATAAG CTGTTTTAAG TTGATCACAT CTTTATCTTT TTGCCCTTAA 61 TATTTTTATA CAATTTCCAA GTTACACATA TAACCCTAAC ATCTCTTTCT TCCATTTTTC 121 GCTTTTCACG TTTGGCATAA CAACTTCAGC ACTTTTATCC AAATGCATAA CTGTTTATTT 181 TAGAAATAAG TTTCAGCACT TTCAAAAGTA CTTTTTTAAA GCTGTTTTTA TTAAGCCCAT 241 CCAAACGGGC CCTAAATAAG AAAATATTCT GACAAAAATT CTCATAAATT AATTTAGACT 301 ATATATTATT TTTAATTTCT TACCCAGTAA ACTAATAAAT GAGTAGGTCA ATAACTTTAA 361 TTTCCCAAAC TTAGGTGGAT TAGACATGTT AGGTTGATAA ACTAACTCTG TCACCTTTAT 421 CTATATTTAT GTCTTTAATA ATATATGAGA TTTGACTTCG TTATATATAT CGAACATCGA 481 ATCGAAAAAA ACTGGTTTAA GCTGAG Predicted gene structure (within gDNA segment 46501 to 50520): Exon 1 47111 47376 ( 266 n); cDNA 1 266 ( 266 n); score: 0.929 MATCH C01HBa0088L02.1+ SGN-E578392- 0.929 266 0.526 C PGS_C01HBa0088L02.1+_SGN-E578392- (47111 47376) Alignment (genomic DNA sequence = upper lines): TTTTTTTTTT AGCTTATAAG CTGTTTTAAG TTGACCATAT TTTTATGTTT TTTCCCTTAA 47170 |||||||||| |||||||||| |||||||||| |||| || || ||||| ||| || ||||||| TTTTTTTTTT AGCTTATAAG CTGTTTTAAG TTGATCACAT CTTTATCTTT TTGCCCTTAA 60 TATTTTTATA CAATCTCCAA ATTATCCATA TAACCCTAAC ATCTCTTTCT TCTATTTTTC 47230 |||||||||| |||| ||||| ||| |||| |||||||||| |||||||||| || ||||||| TATTTTTATA CAATTTCCAA GTTACACATA TAACCCTAAC ATCTCTTTCT TCCATTTTTC 120 CCTTTTCACG TTTGGCATAA CAACTTCAGC ACTTTTATCC AAACGCATAA CTGCTTATTT 47290 ||||||||| |||||||||| |||||||||| |||||||||| ||| |||||| ||| |||||| GCTTTTCACG TTTGGCATAA CAACTTCAGC ACTTTTATCC AAATGCATAA CTGTTTATTT 180 TAAAAATAAG TTTCAGCACT TTCAAAAGTA CTTTTTTAAA GCTGCTTTTA TTAAGCCCAT 47350 || ||||||| |||||||||| |||||||||| |||||||||| |||| ||||| |||||||||| TAGAAATAAG TTTCAGCACT TTCAAAAGTA CTTTTTTAAA GCTGTTTTTA TTAAGCCCAT 240 CCAAACGGGC TCTAAATATA TAAATA 47376 |||||||||| ||||||| ||||| CCAAACGGGC CCTAAATAAG AAAATA 266 hqPGS_C01HBa0088L02.1+_SGN-E578392- (47111 47376) ******************************************************************************** EST sequence 255 -strand 812 n (File: SGN-E546063-) 1 CTATCGCTGC TAACAATCCG ACCTTAATTG CTATAAATGA AGCGTCCAAA CAAATATTCG 61 AACAAACCCC ATATTTCAAA AATTTCAAGG AAATGAAGCC CACTAATTAT GGGAAATTTT 121 TGGTTATCTC TATTGGGACT GGATCAGCAA AATTGGAACA TAAATATGAT GCAAAAATTG 181 CATCAAATTG GGGTATTTTT GGATGGCTAA CTGGTGGAGG CTCAAATCCA ATTATTGATG 241 CATTTGCTGA TGCTAGTGAT GATATGGTTG ATTATCATAT TTCTGTTGTT TTCCAATCTG 301 TTCATTCTGA AAAACATTAT CTTCGTATTC AGGATGATAC ATTAAGTGGA GCAGACTCCA 361 CTGTTGACAT ATCAACCAAA GAAAACATGA ACAAATTGGT TGAAATTGGT ACAAATTTAT 421 TGAAGAAACC AGTTTCAAGG GTAAATCTAC AAACAGGCCT ATTTGAACAA TGCAAAAAAG 481 ATGGTGGCAC AAATGAAGAA GCTTTGAAAG AGTTTGCAAA GTTGCTTTCT GAAGAAAAAA 541 AAAATAGAAA TTTCAAATTA TCATCTCCTA CCGATGAATC GTAGAGGCAA AATTGTGATT 601 TAGTATTATA TGAATCCAAG ATTTTATGAT TTTGGAATAG TATTTTGTAT TTCAATTTCT 661 GTCTTCTAGC TTTTGATTGT TGGACCAATG TAATAATCTC TTTCTTCTAT TTTTCTCTTT 721 TCACGTTTGG CATAACAAAT TCAGCACTTT TATCCAAACA CATAACTGCT TATTTTAAAA 781 ATAAAAAAAA AAAAAAAACT CGAGGGGGGC CC Predicted gene structure (within gDNA segment 39651 to 48179): Exon 1 40392 40406 ( 15 n); cDNA 461 474 ( 14 n); score: 0.667 Intron 1 40407 40608 ( 202 n); Pd: 0.000 (s: 0), Pa: 0.995 (s: 0) Exon 2 40609 40643 ( 35 n); cDNA 475 509 ( 35 n); score: 0.600 Intron 2 40644 41728 (1085 n); Pd: 0.000 (s: 0), Pa: 1.000 (s: 0) Exon 3 41729 41745 ( 17 n); cDNA 510 524 ( 15 n); score: 0.706 Intron 3 41746 41965 ( 220 n); Pd: 0.000 (s: 0), Pa: 0.203 (s: 0) Exon 4 41966 41985 ( 20 n); cDNA 525 543 ( 19 n); score: 0.600 Intron 4 41986 42857 ( 872 n); Pd: 0.903 (s: 0), Pa: 0.000 (s: 0.60) Exon 5 42858 42918 ( 61 n); cDNA 544 601 ( 58 n); score: 0.607 Intron 5 42919 43641 ( 723 n); Pd: 0.000 (s: 0.60), Pa: 0.908 (s: 0) Exon 6 43642 43648 ( 7 n); cDNA 602 608 ( 7 n); score: 0.857 Intron 6 43649 43886 ( 238 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0) Exon 7 43887 43923 ( 37 n); cDNA 609 641 ( 33 n); score: 0.595 Intron 7 43924 44188 ( 265 n); Pd: 0.900 (s: 0), Pa: 0.930 (s: 0) Exon 8 44189 44201 ( 13 n); cDNA 642 654 ( 13 n); score: 0.769 Intron 8 44202 44836 ( 635 n); Pd: 0.000 (s: 0), Pa: 0.986 (s: 0) Exon 9 44837 44861 ( 25 n); cDNA 655 678 ( 24 n); score: 0.640 Intron 9 44862 45015 ( 154 n); Pd: 0.000 (s: 0), Pa: 0.995 (s: 0) Exon 10 45016 45032 ( 17 n); cDNA 679 695 ( 17 n); score: 0.647 Intron 10 45033 47210 (2178 n); Pd: 0.000 (s: 0), Pa: 0.000 (s: 0.96) Exon 11 47211 47299 ( 89 n); cDNA 696 784 ( 89 n); score: 0.966 PPA cDNA 785 799 MATCH C01HBa0088L02.1+ SGN-E546063- 0.820 336 0.414 C PGS_C01HBa0088L02.1+_SGN-E546063- (40392 40406,40609 40643,41729 41745,41966 41985,42858 42918,43642 43648,43887 43923,44189 44201,44837 44861,45016 45032,47211 47299) Alignment (genomic DNA sequence = upper lines): ATTTTCACAG ATGTTGTTGG GAGTCCATAC TACGTTGCTC CTGAGGTGCT TTTGAAGCAT 40451 |||| ||| ||| ATTTGAACA- ATGCA..... .......... .......... .......... .......... 474 TATGGTCCAG AAGCAGATGT TTGGACAGCA GGGGTCATAC TCTATATCCT GCTAAGTGGA 40511 .......... .......... .......... .......... .......... .......... 474 GTTCCACCAT TCTGGGCTGG TATGTTTATA ATTTTATGCA GTATAGCTGT AACTTTTCTG 40571 .......... .......... .......... .......... .......... .......... 474 ATTTTTGTCT TTTTAACTTA CCATCTAAAT TGTTCAGAAA CACAGCAGGG GATATTTGAT 40631 ||| | | || | | ||| .......... .......... .......... .......AAA AAGATGGTGG CACAAATGAA 497 GCAGTTCTGA AAGGGCACAT TGATTTTGAC TCAGATCCTT GGCCTCTAAT ATCAGAGAGT 40691 | || | ||| || GAAGCTTTGA AA........ .......... .......... .......... .......... 509 GCAAAGGATC TCATCCGGAA GATGTTATGC ATGCGACCCC CAGAGCGGTT AACTGCTCAT 40751 .......... .......... .......... .......... .......... .......... 509 GAAGTATTAT GTAAGTTTAT TTACCTTATA AGTCATATTG ACCTAACATT TTTACTGGTT 40811 .......... .......... .......... .......... .......... .......... 509 ACTGAATGGA TCATTTTTTT CTCCCATGAT ATAAATATGG TTTTGCTTGT TTAATAGTTG 40871 .......... .......... .......... .......... .......... .......... 509 TTATATCAAG AGATACTGTG TTGTGACAGT GTTGATGTTC TGTCAGACTT ATAAGAACCC 40931 .......... .......... .......... .......... .......... .......... 509 TCTTAACTTT TTTCTGGACT GTGCTTCTGG TGGCAGAACA TTGAGAACCT TATTGACTAC 40991 .......... .......... .......... .......... .......... .......... 509 TAATTTATGT AAAAAACTGT TAGTTTAGCA GTAGAGAGGA GTTTCTCATG CTTGAACTAT 41051 .......... .......... .......... .......... .......... .......... 509 AACTTGTTAG GTTATCTATG AGCCCTTTGG AAATATCAGG TTTATTTTCT GTATTTCTGG 41111 .......... .......... .......... .......... .......... .......... 509 TTTAAAAAAT AAATTTGGAT TGACTACAAG CTGTAATAGA TCAATTTGCA CTGCATAAAG 41171 .......... .......... .......... .......... .......... .......... 509 TGGATCAAGT CATTGTATTT CTCAAATTTC AATTGTATTG TCTATCTATG CCTGCTTGTA 41231 .......... .......... .......... .......... .......... .......... 509 TGGTGTCTTT CATGTAACCA GCTGCTGTTC TGGTGTTATG GTTTCCTCTA AAATTCTGCA 41291 .......... .......... .......... .......... .......... .......... 509 GGTCATCCTT GGATTTGTGA AAATGGTGTT GCTCCTGATA GAGCACTTGA TCCTGCTGTA 41351 .......... .......... .......... .......... .......... .......... 509 CTTTCTCGCC TCAAACACTT TTCTGCAATG AACAAATTAA AAAAGATGGC TCTGCGGGTA 41411 .......... .......... .......... .......... .......... .......... 509 TGCATATATA TATGTGTGTG TATATATATC TAGGCATAAC TTTTTTGCCC AAGTCTGTTA 41471 .......... .......... .......... .......... .......... .......... 509 ATTATGGTTC TTCAGTGTCC ATAAACCTCA TTATTAAAGT TACACAAGAA AATGCTGATT 41531 .......... .......... .......... .......... .......... .......... 509 ATGTCCTTTG GGCTAAGTTG TGTGGACTCT TCAGTTTCGA TGGCGCACCA GTGTCGGATT 41591 .......... .......... .......... .......... .......... .......... 509 CTCCAAAAAT ACACTCCTTA TGGAGAAGCC GACACACACC CATTGACATT TTTGAAGCGT 41651 .......... .......... .......... .......... .......... .......... 509 CCAAGCAACA TAGCTTCTTG GAGGTGTGTA ACCAAATGAT GCAATTATTG ATGTTTTCAT 41711 .......... .......... .......... .......... .......... .......... 509 ACTTAATATG CATTTAGGTG ATTGCTGAAA GTTTGTCAGA GGAGGAGATT GCCGGTCTTA 41771 | | |||| ||| ||| .......... .......GAG TTTGC--AAA GTTG...... .......... .......... 524 AGGAGATGTT TAAGGCCATG GATACTGATA ACAGTGGTGC AATTACATTC GATGAACTAA 41831 .......... .......... .......... .......... .......... .......... 524 AAGCTGGTTT GAGAAAATAT GGCTCTACTC TGAAGGATAT AGAGATACGG GAACTTATGG 41891 .......... .......... .......... .......... .......... .......... 524 ATGCGGTAAG AAAATCTAGA CTGCAAACTG ATTCTGTTTA TTTTGTGCAT CTGGTGATGT 41951 .......... .......... .......... .......... .......... .......... 524 GACTCTACAC AAAGGTTCAT AGGAGCAGAA AAATGTAAAA TGACATAAGA TCACTAACTA 42011 || | | || | || ||| .......... ....CTTTCT -GAAGAAAAA AAAA...... .......... .......... 543 ATGGTCAAAT CTCAAGGTTA TTTGATGTGC AAATACTAGA GTCAGATTGG GATTTGGCAC 42071 .......... .......... .......... .......... .......... .......... 543 TTTACTTTGT TTAATTAATT ATGTACATTC ATGAAGGAGC ACTTAAAACT CAATGTAGTT 42131 .......... .......... .......... .......... .......... .......... 543 GCTAAAACTT CACTGGAAAG GTGCCCAATT TTTTTTTTTT GTGTATGTGT ATGATAAGTT 42191 .......... .......... .......... .......... .......... .......... 543 TCTGATAACT GAGGAGGTAG TGCAGGCTTA CCAAGTAGTT GGCACCACAT ATATGCTTCA 42251 .......... .......... .......... .......... .......... .......... 543 TCAGAAACAA CTTTCTGTTA ATGGTTCTAG TTGTATCTTT AATTAGGCCC GTGATAATCT 42311 .......... .......... .......... .......... .......... .......... 543 TTGTATTTCT CCCTAAACAT GTCTGTCTAT GAGGTACATG CGGAAGTGCT TATCTAACTC 42371 .......... .......... .......... .......... .......... .......... 543 TTTAAGGCCA TTGATGTAAT ATTACTGTTT TCAGGCTGAT GTGGACAATA GTGGAACTAT 42431 .......... .......... .......... .......... .......... .......... 543 TGACTATGGA GAATTCATAG CAGCAACAAT TCACCTTAAC AAATTGGACC GCGAGGAACA 42491 .......... .......... .......... .......... .......... .......... 543 TCTCATGGCA GCATTTCAGT ATTTTGACAA GGATGGAAGT GGTTATATTA CAGTAGATGA 42551 .......... .......... .......... .......... .......... .......... 543 GCTCCAGCAG GCCTGTGCAG ATCATAACAT TACAGATGTA TTCTTTGAGG ATATTATCAG 42611 .......... .......... .......... .......... .......... .......... 543 AGAAGTTGAT CAGGATAACG TAAGTTAATT ATATTGAGGA TAAAGTTGAA GTATTATTGG 42671 .......... .......... .......... .......... .......... .......... 543 AACTTATCAA TAAAAAAGTG GACACAAATT AGTAGATTAA ATTTCTTCAT GTTTTGCAGT 42731 .......... .......... .......... .......... .......... .......... 543 TCTACTGATT TATCTCTCTA CTACTCATAA TTTTTTTGCA ACAAAAACTA TTTTTTTTTA 42791 .......... .......... .......... .......... .......... .......... 543 TAAAAAAGCA CTTTAATATG AAACACTTTT TGTGCAACAA AAACGAAAAT TAAAAAAATA 42851 .......... .......... .......... .......... .......... .......... 543 TAGCACTTTA AGATTTCATA TGAATCTTTT CCTTGAGATA AAATGTTATT GACAATGTAG 42911 | | |||||| | | ||| | | ||| ||| ||| || | ||| | | ......ATAG AAATTTCAAA T-TATCATCT CCTACCGAT- GAATCGTAGA GGCAAAATTG 595 TGTATGTATG GAAAATACGG ATATTACTAA ATGATCATAT GTGAGCTTAA TAATATAGTT 42971 || || | TG-ATTT... .......... .......... .......... .......... .......... 601 AATTTACCTC TCTCTCTCTA TATATATAAA GAGAACCCTA GGCTGCCTAA GTGGCGCCAC 43031 .......... .......... .......... .......... .......... .......... 601 CACAAATCAG GATTCCCTTT TAATTTATTT ATTTCCAAAA TTAGCCTTCC CTTTCATCAA 43091 .......... .......... .......... .......... .......... .......... 601 AAGTTGTGAC TTATGAAACT TTGCGACTTT TACAAAGAGT TGTAACTTTT ATGAAAGTTG 43151 .......... .......... .......... .......... .......... .......... 601 TAACTTTTAT GAAAGTTGTA ACTTTTATGT AGAGTTGTGA CTTTTCCAAA GGATTATTAC 43211 .......... .......... .......... .......... .......... .......... 601 ATTTCCGATA AGACACCATA ACCATTTATT CACACTATCC TTTTGTTGTC TATAAATAGA 43271 .......... .......... .......... .......... .......... .......... 601 GGAATTTTCT TTCATTTTAA AACGACGAAA ATTCTAAATT TTTTCTTCTG CTTATGCACA 43331 .......... .......... .......... .......... .......... .......... 601 ATTAAATATT TGTGTACTTT GCTCCTGTTG AGTGGTTCAC TGACATCATT GTTTTTGAAT 43391 .......... .......... .......... .......... .......... .......... 601 CTATACAACG GTGAATATAA TCGTTCTATC CTAAAAGTAT CTATTCATTC TTTTGTTACA 43451 .......... .......... .......... .......... .......... .......... 601 AATCTTGGTA TGTTTTTTAC GCTCATTTAT GCTTATGTTA TTAGTTGTTT TTGAGTACAT 43511 .......... .......... .......... .......... .......... .......... 601 GTTTTAAACT TTGTTGTTTA TGTTTATGTT TATGTTGAAA TAAAGATATG TTAATCAAGA 43571 .......... .......... .......... .......... .......... .......... 601 ATTTGATGTA GTGATGTCAT GTAGATTAAA ATTCTTGAAC TTATAAAATA AATGACTTTG 43631 .......... .......... .......... .......... .......... .......... 601 ATCTTTATAG AGTTTTAGTG GCTAAAAGAT TCATGGGATG TTCAAGAAGA AACTTTTGAG 43691 ||| ||| .......... AGTATTA... .......... .......... .......... .......... 608 TGTTCAAAAG TTATGGTGGT TCTACTCTAC CATGGAGTTT AGTTATTCAA CTTTCTATCT 43751 .......... .......... .......... .......... .......... .......... 608 TATCTAGACA TTCAATCGAT TAGTGACATT CAAAAAATAA AGGAAAATGT AGCGGGATGG 43811 .......... .......... .......... .......... .......... .......... 608 TAAGTATTAT ACTCAACCTT AATTAAAAGT TTGGGATTCA AATATTTGAT TGGAGTCAAT 43871 .......... .......... .......... .......... .......... .......... 608 GAATTACCCC CTTAGGATGA ATCTACATTA ATCAATTATT AAAGAAATAA TTATCTCCTT 43931 |||| ||| || | | || ||| | ||| | | .......... .....TATGA ATC--CAAGA TTTTATGATT -TTGGAAT-A GT........ 641 ATAAACATTA GATTAAAAGT TGCAAAAAGA TTAAAGCTTT AACCATATTG ATCGGAACAT 43991 .......... .......... .......... .......... .......... .......... 641 AAACAACAAA ATATGCATTT TGGGTATCAA AGTAGTGTCA TACATAATGA TTTGAATAAG 44051 .......... .......... .......... .......... .......... .......... 641 GGTCTTGCCA AGACATCATT TAATCCGAAT TATTTGAGTG ACTTGCCTTA TTTCATTGAA 44111 .......... .......... .......... .......... .......... .......... 641 ATTCCAAGAG ATGTTTTTTA AAATTTTAAT TAACTTATCA AGCACACAAC TAATTATATA 44171 .......... .......... .......... .......... .......... .......... 641 AAATGTATAA TATTTAGATT TTGTATGTAG AGGGAGGCCT TGAATAAGAG AAGAACTCTC 44231 ||| |||||| | .......... .......ATT TTGTATTTCA .......... .......... .......... 654 GCAATTGATG AATAAAATGT TTGTACCACT TTTGGAAAAT ACAAATATAG ACAATGAAAC 44291 .......... .......... .......... .......... .......... .......... 654 AATTACCTAT CTTTTCTAAA GATTTGGTGA TGAATAACTA CAGTAAAATG AAGAATCAAT 44351 .......... .......... .......... .......... .......... .......... 654 AACTAAATCC ATAAACACGT AGAATCAAAT CGTTTTAAGT TTAAAAAAAT ATTTTATTTT 44411 .......... .......... .......... .......... .......... .......... 654 GTCTTTGGAT AAAATATTCT TGACAATTTA TTGTTGGGTT GTACCCATTC GAAAACACTT 44471 .......... .......... .......... .......... .......... .......... 654 ATATTATCAA ATGTTCAGAA GTAGATTATT ACCGTAGTTT ACCACCGCGC GAAAAGCATG 44531 .......... .......... .......... .......... .......... .......... 654 CAATTTACCT TGTTAAATTA CAAGTGCTCA GATGCAATGA TATGCTTTGA AAATTATTTT 44591 .......... .......... .......... .......... .......... .......... 654 TGAAGAACTT CTCGTAGTTC TGTTTGGTCT GACTGCATTC GTGCCAGCTA CTCACTTTTT 44651 .......... .......... .......... .......... .......... .......... 654 GGCGTCACTT CATAATCTAA GTAGTTTTGT GTATTCAAAG GCATAATGAG AAGACAAAGC 44711 .......... .......... .......... .......... .......... .......... 654 TGACATAATT GTCCAAAGAA AAGAAAAAAG ACAAAGAAAT TGTAGCATAA TAAACAGGAA 44771 .......... .......... .......... .......... .......... .......... 654 TGGGTACCGT TACAGACATT TCTGTCTTTC TTCAAATCAA ACAAAATTTG TTGTATTTTG 44831 .......... .......... .......... .......... .......... .......... 654 ATTAGTTTTC TGGAGCCTCA GTATTGGATT AGGGCCTCAG CTGCAGCCGT GATACAGGCA 44891 |||| || || | | || |||| .....ATTTC TGTCTTCT-A GCTTTTGATT .......... .......... .......... 678 AATTGTTATG CTTTAGGAGA TCTGTATTTT AAATGGATGG AATGATTCTT TTGGAATCTC 44951 .......... .......... .......... .......... .......... .......... 678 TACATCTCTT GATGCTTCAT TTGACTAGCT ATTTAGTTGA TCTTCTGGTG GATTCCCTTT 45011 .......... .......... .......... .......... .......... .......... 678 TCAGGATGGA CGTATTGATT ATGGAGAATT TGTTGCTATG ATGCAAAAAG GAAATCCATG 45071 | |||| | || | | | ....GTTGGA CCAATGTAAT A......... .......... .......... .......... 695 CATAGGAAGA CGAACAATGC GAAATAGTCT GAATTTCAGC ATGAGAGATG CGCCCGGAGC 45131 .......... .......... .......... .......... .......... .......... 695 TCATTAGCTT TTTGAATGGA CACATGATGT AGGTATTTCC CCTTTTTTAT TTTTGTAACC 45191 .......... .......... .......... .......... .......... .......... 695 GTTTCTTTGG CAATGAATTT GAAGAAATCT TTCCTTGTTC TGTCCTTGAG AAATTGGATT 45251 .......... .......... .......... .......... .......... .......... 695 GGTTGGAGTA TATTTGTTTA ACATTAAGAG TTTCTTTTTC CCTCTTGAGG ATAATAAAAT 45311 .......... .......... .......... .......... .......... .......... 695 TTTATAAATA ACAGCATGAG TGTTTGCTGT AAAACTCTAC AGGTGCAGCA AAAAAAATTA 45371 .......... .......... .......... .......... .......... .......... 695 CATTCAGCAA AAGTATATCC CATCTTATCC TGTTGGTACA CTAGCATGTC ACAGATAGAT 45431 .......... .......... .......... .......... .......... .......... 695 TCAGCTTCCT CCCCAATCCT CCATTTTACA CCATTAACAA AAATAAATTT CAGATACAGA 45491 .......... .......... .......... .......... .......... .......... 695 GTTCTCTTTC ATTCCCATCT TTTATATAAT GCTGGTTTCT TTTCTTTTGG TAAAATTTTG 45551 .......... .......... .......... .......... .......... .......... 695 ATGTATCAAA TTTGACGATT GTCCGACATG GCTATGTGAG GAACTTTCCT AAGGGAGCAC 45611 .......... .......... .......... .......... .......... .......... 695 TAAGGGTGTC AAATGTGTGG GTGGAGGCAG TGGGGGACTG AAATTGAAGA GGTTAAAATG 45671 .......... .......... .......... .......... .......... .......... 695 GGCTGAGCTA AAAGTCATGT TGGATCATAA CCCACTCAAA CTTACTTTGG GCTAACATGG 45731 .......... .......... .......... .......... .......... .......... 695 GCTAGAATCT TGATTGGGTT ATGACCTATC CAATTTGACC TGCTTAATCT AAACTAAACT 45791 .......... .......... .......... .......... .......... .......... 695 ATATTAAACA CTTGCTATAA TTTATGACAG ATGTCATTCA ACCCATAGAA TCGTACAGAT 45851 .......... .......... .......... .......... .......... .......... 695 CTGTACTAAC TTTTCATTTA GGAGCATCTC CTTGTAGAGT AAATTGATGT AGACTTTATA 45911 .......... .......... .......... .......... .......... .......... 695 GTATGGGACC AACTTCATAA TTTTGCAACT CATTTAATAG TGTATTTATG AGAATTATTG 45971 .......... .......... .......... .......... .......... .......... 695 AAAAGAATAT TATTGAATTG TGTGTCTACA TTATTACATT GAGACTTTAT TTATAGACAC 46031 .......... .......... .......... .......... .......... .......... 695 TATATTATAC TCCTTTTCCA ACTAGGACAC TACAATACCA TCCTTTTCTA AGTAGGATTC 46091 .......... .......... .......... .......... .......... .......... 695 TATATACTAT TTCTATTCCT ATTCCTATTC TAAGTAGAAT GGTATATATT ATTCTTGTTC 46151 .......... .......... .......... .......... .......... .......... 695 CTTTTTTGAT TCTAACACTC CCCCTCAAGC TGGTGCATAC AAGTTATATA TACTTTGCTT 46211 .......... .......... .......... .......... .......... .......... 695 GTTACAAATG TAATTAATAT GAGGACCAAT GAGAGGCTTG ATGAAGATAT CTGCAAGTTG 46271 .......... .......... .......... .......... .......... .......... 695 ATCACTTGAC TCACAAATTT TGTAACAATA TCTCCCGACT TCCCAGACCA AGCTTGAGAA 46331 .......... .......... .......... .......... .......... .......... 695 GAACGTTTCA TATCATCGAG TGACTTGCAC AATCAACATA TAAGGCTGCT AGACTCCCTC 46391 .......... .......... .......... .......... .......... .......... 695 GGAGCAATAA GACCAAGTGG TTGCTCCATA TATACTTCTC CATCGAGATC CCAGCCCAAA 46451 .......... .......... .......... .......... .......... .......... 695 TATGTAAGTA TATCCTTTTG GATAAAGTGA ATCTAAAACA AAGAGAATAT TGCTTGAAAA 46511 .......... .......... .......... .......... .......... .......... 695 CTTGGATTTT TTTGGGAACT CGGATATGTT GGACTTTGCA CAACATTGAC AAAGTTGAAA 46571 .......... .......... .......... .......... .......... .......... 695 CTATTTAAAT CAGACCTAAG GAGTCACCGA AAAGACGTAC GGTGCTTCGA AAATTAGATA 46631 .......... .......... .......... .......... .......... .......... 695 TGAGAAAGTA GTCACCAAAA AGACGCATGA TGTTGTGCAA ATTAGATATG AGAAAGTAGT 46691 .......... .......... .......... .......... .......... .......... 695 CACCAAGAAG ATGAGACAGT GCTACATAAA TTAAATATGA AAAAGTAGTC ACTGATAAGA 46751 .......... .......... .......... .......... .......... .......... 695 TGGCACGGTG CTACACAAAT TAAATATGAA AAAGTAGTCA TCAAAAAGAT GGTGCGATGC 46811 .......... .......... .......... .......... .......... .......... 695 TACACAAAAG TAAATAGTCA CCGGAATGAT GACATGATGC TACAAAAATG AAATATGAGA 46871 .......... .......... .......... .......... .......... .......... 695 GTAGTCACCT GAAGGATGAC ACAGTGCCAC ATAAATTGAA CATAAAAAAA TAGTCACCAG 46931 .......... .......... .......... .......... .......... .......... 695 AAACATGATG CGGTGCTACA CAAATTAAGA GCCTGTTTGG CTCAGCTTAA AAGCTGGTCA 46991 .......... .......... .......... .......... .......... .......... 695 AACTGACTTA AAATCTGATT TTTGACTTAT TTAACTGTTT GACAATACTC AAAATAGCTT 47051 .......... .......... .......... .......... .......... .......... 695 ATTTTAAGTT AAAAAAAACT TATTTTAAGC CAAAAGTTAA AAGGTGGGGT AGGGGTGCTT 47111 .......... .......... .......... .......... .......... .......... 695 TTTTTTTTTA GCTTATAAGC TGTTTTAAGT TGACCATATT TTTATGTTTT TTCCCTTAAT 47171 .......... .......... .......... .......... .......... .......... 695 ATTTTTATAC AATCTCCAAA TTATCCATAT AACCCTAACA TCTCTTTCTT CTATTTTTCC 47231 | |||||||||| ||||||||| .......... .......... .......... .........A TCTCTTTCTT CTATTTTTCT 716 CTTTTCACGT TTGGCATAAC AACTTCAGCA CTTTTATCCA AACGCATAAC TGCTTATTTT 47291 |||||||||| |||||||||| || ||||||| |||||||||| ||| |||||| |||||||||| CTTTTCACGT TTGGCATAAC AAATTCAGCA CTTTTATCCA AACACATAAC TGCTTATTTT 776 AAAAATAA 47299 |||||||| AAAAATAA 784 hqPGS_C01HBa0088L02.1+_SGN-E546063- (47211 47299) ******************************************************************************** EST sequence 116 -strand 392 n (File: SGN-E577899-) 1 AATAGTATCG CGGAAGATGC GGCGGAGAAA GTGGAGGAAG ATCTCGCCGA CGACGATGGT 61 GATTACGGCG ATGATGACTT TTAATTAAGC TACCGTTAAG TAATATTCTT ACAGTATTTT 121 TTACGCCCAA TAAAGTCAGT GAGTGAGTAG GAGCTATTGT GAAAAAGGAA GAAGGGAATA 181 AGCTTATATT TTCTAGTAAA TCATTAATAT TGGCTTCTCC CAAAGCAAAG AAAAAAATTT 241 GGATACTATT ATTTAATGAT AGATTTTAAC TCGATCGAAT ATATCCAATG TTATAGAGAA 301 AAAAAAAAAA AAAAATTTTT TTTTTTTTTT TTTTTTTTTC ACGTTTGGCA TGACAATTTC 361 AGCACTTTTA TCCAAACGCA TAACTGCTTA TT Predicted gene structure (within gDNA segment 43273 to 47889): Exon 1 47233 47289 ( 57 n); cDNA 336 392 ( 57 n); score: 0.965 MATCH C01HBa0088L02.1+ SGN-E577899- 0.965 57 0.145 C PGS_C01HBa0088L02.1+_SGN-E577899- (47233 47289) Alignment (genomic DNA sequence = upper lines): TTTTCACGTT TGGCATAACA ACTTCAGCAC TTTTATCCAA ACGCATAACT GCTTATT 47289 |||||||||| |||||| ||| | |||||||| |||||||||| |||||||||| ||||||| TTTTCACGTT TGGCATGACA ATTTCAGCAC TTTTATCCAA ACGCATAACT GCTTATT 392 hqPGS_C01HBa0088L02.1+_SGN-E577899- (47233 47289) ******************************************************************************** EST sequence 97 +strand 346 n (File: SGN-E391901+) 1 TTTTTTTTTT TTAAAAATAA GTTTCAGTCC TTTCAAAAGT ACTTTTTTAA AGCTGCTTTT 61 ACTAAGCCCA TCCAAACGGG TCACAAAAGC ACTTTACTTA AAAGCAATAT AGAAAAAGCT 121 ACAACCATTA TACATTCATA GACACTTCAA ATTGTCAGCT GAGGCTATAC ACTTTGGATG 181 ACCACGAGAA ACTTTATTGC ATTACATTAC ACTATTTAGT TCCAGCTTTA GCAGCACAGT 241 GAAATATCAC GATTGTTCAG TATGGGACGA TGATGGATTC TATAATCTCT TGAAGTGGAG 301 CCAGTTCCTT CTTGTCAATC AGTCCAAACT CATGGGTGAA GAGTAT Predicted gene structure (within gDNA segment 46608 to 50629): Exon 1 47285 47359 ( 75 n); cDNA 6 80 ( 75 n); score: 0.947 MATCH C01HBa0088L02.1+ SGN-E391901+ 0.947 75 0.217 C PGS_C01HBa0088L02.1+_SGN-E391901+ (47285 47359) Alignment (genomic DNA sequence = upper lines): TTATTTTAAA AATAAGTTTC AGCACTTTCA AAAGTACTTT TTTAAAGCTG CTTTTATTAA 47344 || ||||||| |||||||||| || |||||| |||||||||| |||||||||| |||||| ||| TTTTTTTAAA AATAAGTTTC AGTCCTTTCA AAAGTACTTT TTTAAAGCTG CTTTTACTAA 65 GCCCATCCAA ACGGG 47359 |||||||||| ||||| GCCCATCCAA ACGGG 80 hqPGS_C01HBa0088L02.1+_SGN-E391901+ (47285 47359) ******************************************************************************** EST sequence 6 +strand 453 n (File: SGN-E547334+) 1 TTTTTTTTTT TTTTTTTTTT TTTTTCAAAA GTACTTTTTT AAAGCTGCTT TTATTAAGCC 61 CATCCAAACG GGCCCTAAGA ATGATACAAA AAAAATTAAA ATAACGTAAT GTATACATAC 121 ATCATGTATA CTACTACTTT TTTTATTCTT GTTTCCCTAT ATTTGCTATA CTAAAAGAAG 181 TGTTTTTGGA TGCTTTGGTC CATCTTCAAG GCTTCAAATT AATTTTTCAT TTTCTCGATT 241 CTTTCTTTGA GCATCTTAGC ACTGCATTCA GTGTCACATT TCATCTCACA ACGAGTGTAT 301 CCCAACCCTT CATTAGTACA TTCCTTTTGA CAATCATTGT AGCAAACTTT ATATTCATTT 361 GCCACAATTT CAAATGATTT TTTAAATTCT TCTGCTTTAT TTTCTTCATC ATCAGCCATG 421 GATGAAGAAA TCACAATAAT GAAAACAAAA AAC Predicted gene structure (within gDNA segment 46490 to 51770): Exon 1 47310 47365 ( 56 n); cDNA 23 78 ( 56 n); score: 0.982 Intron 1 47366 49790 (2425 n); Pd: 0.000 (s: 0.98), Pa: 0.999 (s: 0) Exon 2 49791 49796 ( 6 n); cDNA 79 84 ( 6 n); score: 0.833 PPA cDNA 442 452 MATCH C01HBa0088L02.1+ SGN-E547334+ 0.982 62 0.137 C PGS_C01HBa0088L02.1+_SGN-E547334+ (47310 47365,49791 49796) Alignment (genomic DNA sequence = upper lines): TTTCAAAAGT ACTTTTTTAA AGCTGCTTTT ATTAAGCCCA TCCAAACGGG CTCTAAATAT 47369 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| | |||| TTTCAAAAGT ACTTTTTTAA AGCTGCTTTT ATTAAGCCCA TCCAAACGGG CCCTAA.... 78 ATAAATAATA GTCACCGGAA GATGACACAC TGCTACAAAT CAAATTTAAG AAAGTAGTCA 47429 .......... .......... .......... .......... .......... .......... 78 CCGAAATGAT AGCACAGTGC CACACAAATT AGATATGAGA AAGTAGTCGC CATGACAACC 47489 .......... .......... .......... .......... .......... .......... 78 CTAGAAAGTC GTGCATATAT CAGTGACCCT AATTTGGTTA ACATTACCAA TGGCAAGAGG 47549 .......... .......... .......... .......... .......... .......... 78 GGAGATAGAT ATGAGTCATA GCCGCCCTAC ACCGACGAAA TCTTTTTTTG ATTTTCTACC 47609 .......... .......... .......... .......... .......... .......... 78 GAGATCGTAG GAGCTTTGAT ACCATGTGGA AATATTGAAA AAGAACATTG TTGAATTGGT 47669 .......... .......... .......... .......... .......... .......... 78 CTCTAGATTA TAACATCGAG ACCTATTAAT AGGGCACTAC CTTAGACTCA AATTCCAACT 47729 .......... .......... .......... .......... .......... .......... 78 AGGACACTAC CATACAATCC TATTCTAAGT AGTATTTTAT GTACTATTTT TATTCCTATT 47789 .......... .......... .......... .......... .......... .......... 78 ACTAGTATTT TATGTACTAT TTTTATTCCT GTTACTATTC TAAGTATGAT GGTATATATT 47849 .......... .......... .......... .......... .......... .......... 78 ATTCTTGTTC ATATTCCTAT TCAAACAGTA ATAATTTGAC ATATAGAATG TAGGCAATTA 47909 .......... .......... .......... .......... .......... .......... 78 TTTTTTAATA TGACATGGCA TGCAAAATAA TGTGTTGTTA AAGAATCAAA TAACAATAAT 47969 .......... .......... .......... .......... .......... .......... 78 CAAGTGACTT TAGAATTCCA AAAGAGAGAC CATGATAGAT CATTATCATA TTAGGTAATA 48029 .......... .......... .......... .......... .......... .......... 78 AAAAATAAGG ATTCGGTAAC AAAATGCAAG AAGGTGAAAT GAATTTTTAA GATATTTCAG 48089 .......... .......... .......... .......... .......... .......... 78 TTTGCCAAAA ATAAGCATAT TAGGTTAGTA TATGAGGAAA AAAAACAGTT TTATTCGAAT 48149 .......... .......... .......... .......... .......... .......... 78 TGGTTAAACT CAGTTCTCAT TTTCATATCA AGTGAAAAGG TCAATATAAA CTAAAGAGAT 48209 .......... .......... .......... .......... .......... .......... 78 GATGATTGTC CCATCTTTGC ACATGTAGTC CGGTTAGAAT GGGGATTGAA TTGACATAGA 48269 .......... .......... .......... .......... .......... .......... 78 ACTTGGGCTA AGTGGGTTAT AATTATACGG GTTAAGACGT AGCACATTAT TAAATTATCA 48329 .......... .......... .......... .......... .......... .......... 78 TGAGCTCAAC CCATAAATTT TGGGCTCCTA ATATCTGAGC TTCATTTGAC ACCCCAAGTA 48389 .......... .......... .......... .......... .......... .......... 78 AGGAGTGCCA CGCACGAGCA TGGCAAAAAG CAAGGGGAAC TTTTCTTTTT GGGAGAAATC 48449 .......... .......... .......... .......... .......... .......... 78 ATTTGATTGC ATATTGAATA CATAAAGCAC ATTCCAACAA ATTCAAATTT TAGAAGTTTC 48509 .......... .......... .......... .......... .......... .......... 78 ATATGGTGAC TACATTTTAG CTTCCCGTCA ATTACCCCAA CCTTCTTCAT TTATCCAGAT 48569 .......... .......... .......... .......... .......... .......... 78 GTGGGACGGA CACGGTGAAG CTCACATAGA TTGAGTTAGG TAAAATATTT ATCTGTGGAG 48629 .......... .......... .......... .......... .......... .......... 78 AAAAATATTA CCCCCTGTTC CATTTTGTGT GACAAGTTGA AAAATATGTG TGGTTAAATT 48689 .......... .......... .......... .......... .......... .......... 78 GACTAATTTT CTGAGTGAAT TTGAACATTG ATATTCATTT TCTAAAAATA AAGTTTTACA 48749 .......... .......... .......... .......... .......... .......... 78 TCTTTAAAAA CTATATAAAA AGTATTGTAA GTCACAATAG TTTACAATTC AAAATATTAA 48809 .......... .......... .......... .......... .......... .......... 78 AGAAGTATTT TAAAAAAAAC ATGGTCAAAG AAAAACTTAT TTTACACTCC AGATAGTTAT 48869 .......... .......... .......... .......... .......... .......... 78 AGGTTACATA AAGTGGAGCA AAGTACTCTT ATCAATACTC TTAACCATAG GTCTGGAATT 48929 .......... .......... .......... .......... .......... .......... 78 CGAGTACCCA TAGAATAGAG TTCCTTTTGT TAGGGAGCGG GTGGGAACCA AAAAAAAAAG 48989 .......... .......... .......... .......... .......... .......... 78 TGGAACAAAG GGAGTACTAA AGTATACTTA TGGAAGTTAA TATAAAATCT GAAGATAAGC 49049 .......... .......... .......... .......... .......... .......... 78 GTTAAAAACA TACCTAAACT ATCCTTTTTT TTTTAGTTTC ATACTTGAAG TATTGAGTGT 49109 .......... .......... .......... .......... .......... .......... 78 GAGTTTTCTA CCTAAACTAT CACTTATTAA TTTGAGAAAC ACATCTTTCT TTTATTATAC 49169 .......... .......... .......... .......... .......... .......... 78 TCTATCATGG TGTGTAATAC ACTCCTTTTA TTTAAAAATT GTTATATTAC AATCCACATG 49229 .......... .......... .......... .......... .......... .......... 78 GACAAAACGT TTCACCTTGA CAAAAAATAA ATAATTAGTA TTAGTTAAAG TTAAGTATTA 49289 .......... .......... .......... .......... .......... .......... 78 AAGTATTGCT ATCCCCCCCC CCTCCCCCAA AAAAAAAATT ATAAAATAAA ATGTAAAATA 49349 .......... .......... .......... .......... .......... .......... 78 TTTTTTTTAC CCAACTCCAA TCTTTCCTCT CAACGTACTC CCCCATCCCA AATTTTTAGT 49409 .......... .......... .......... .......... .......... .......... 78 TTATTTTGTT CAAAAAAAAT AAATCCCTTC GAATAATAAT TTAGATATAG TTAAATTTAT 49469 .......... .......... .......... .......... .......... .......... 78 TTTATTTCTT GAAAAAAAAT TCTACCCTAA CATAACTCCC CTCTTCCATT TTTTTTCTCG 49529 .......... .......... .......... .......... .......... .......... 78 TTTTGTATTA GATATGTATT TTCTTTTCTA AAAAAGTATT TTTTAACTTG CCGCAAGACT 49589 .......... .......... .......... .......... .......... .......... 78 TTTCATAAAA TAAAACTTTT ATTTCTGTTA ATTTGGTATG CAAGTAGAAA AGAATGTTTT 49649 .......... .......... .......... .......... .......... .......... 78 CCTAAAAATA TATGTACACA TCTAACACAA AACTAGAAAA ATGTATAAAA TTAAATTAGG 49709 .......... .......... .......... .......... .......... .......... 78 AGCGGAGGGT TAGATGGGGT GGGGTAGAAT ATTATTTTAT TTTACTTTTT TTTTAAAAAA 49769 .......... .......... .......... .......... .......... .......... 78 TAATATCAAA ATTATTTTTA GGAAGGA 49796 ||| || .......... .......... .GAATGA 84 hqPGS_C01HBa0088L02.1+_SGN-E547334+ (47310 47365) ******************************************************************************** EST sequence 118 -strand 453 n (File: SGN-E547335-) 1 TTTTTTTTTT TTTTTTTTTT TTTTTCAAAA GTACTTTTTT AAAGCTGCTT TTATTAAGCC 61 CATCCAAACG GGCCCTAAGA ATGATACAAA AAAAATTAAA ATAACGTAAT GTATACATAC 121 ATCATGTATA CTACTACTTT TTTTATTCTT GTTTCCCTAT ATTTGCTATA CTAAAAGAAG 181 TGTTTTTGGA TGCTTTGGTC CATCTTCAAG GCTTCAAATT AATTTTTCAT TTTCTCGATT 241 CTTTCTTTGA GCATCTTAGC ACTGCATTCA GTGTCACATT TCATCTCACA ACGAGTGTAT 301 CCCAACCCTT CATTAGTACA TTCCTTTTGA CAATCATTGT AGCAAACTTT ATATTCATTT 361 GCCACAATTT CAAATGATTT TTTAAATTCT TCTGCTTTAT TTTCTTCATC ATCAGCCATG 421 GATGAAGAAA TCACAATAAT GAAAACAAAA AAC Predicted gene structure (within gDNA segment 46480 to 51760): Exon 1 47310 47365 ( 56 n); cDNA 23 78 ( 56 n); score: 0.982 Intron 1 47366 49790 (2425 n); Pd: 0.000 (s: 0.98), Pa: 0.999 (s: 0) Exon 2 49791 49796 ( 6 n); cDNA 79 84 ( 6 n); score: 0.833 PPA cDNA 442 452 MATCH C01HBa0088L02.1+ SGN-E547335- 0.982 62 0.137 C PGS_C01HBa0088L02.1+_SGN-E547335- (47310 47365,49791 49796) Alignment (genomic DNA sequence = upper lines): TTTCAAAAGT ACTTTTTTAA AGCTGCTTTT ATTAAGCCCA TCCAAACGGG CTCTAAATAT 47369 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| | |||| TTTCAAAAGT ACTTTTTTAA AGCTGCTTTT ATTAAGCCCA TCCAAACGGG CCCTAA.... 78 ATAAATAATA GTCACCGGAA GATGACACAC TGCTACAAAT CAAATTTAAG AAAGTAGTCA 47429 .......... .......... .......... .......... .......... .......... 78 CCGAAATGAT AGCACAGTGC CACACAAATT AGATATGAGA AAGTAGTCGC CATGACAACC 47489 .......... .......... .......... .......... .......... .......... 78 CTAGAAAGTC GTGCATATAT CAGTGACCCT AATTTGGTTA ACATTACCAA TGGCAAGAGG 47549 .......... .......... .......... .......... .......... .......... 78 GGAGATAGAT ATGAGTCATA GCCGCCCTAC ACCGACGAAA TCTTTTTTTG ATTTTCTACC 47609 .......... .......... .......... .......... .......... .......... 78 GAGATCGTAG GAGCTTTGAT ACCATGTGGA AATATTGAAA AAGAACATTG TTGAATTGGT 47669 .......... .......... .......... .......... .......... .......... 78 CTCTAGATTA TAACATCGAG ACCTATTAAT AGGGCACTAC CTTAGACTCA AATTCCAACT 47729 .......... .......... .......... .......... .......... .......... 78 AGGACACTAC CATACAATCC TATTCTAAGT AGTATTTTAT GTACTATTTT TATTCCTATT 47789 .......... .......... .......... .......... .......... .......... 78 ACTAGTATTT TATGTACTAT TTTTATTCCT GTTACTATTC TAAGTATGAT GGTATATATT 47849 .......... .......... .......... .......... .......... .......... 78 ATTCTTGTTC ATATTCCTAT TCAAACAGTA ATAATTTGAC ATATAGAATG TAGGCAATTA 47909 .......... .......... .......... .......... .......... .......... 78 TTTTTTAATA TGACATGGCA TGCAAAATAA TGTGTTGTTA AAGAATCAAA TAACAATAAT 47969 .......... .......... .......... .......... .......... .......... 78 CAAGTGACTT TAGAATTCCA AAAGAGAGAC CATGATAGAT CATTATCATA TTAGGTAATA 48029 .......... .......... .......... .......... .......... .......... 78 AAAAATAAGG ATTCGGTAAC AAAATGCAAG AAGGTGAAAT GAATTTTTAA GATATTTCAG 48089 .......... .......... .......... .......... .......... .......... 78 TTTGCCAAAA ATAAGCATAT TAGGTTAGTA TATGAGGAAA AAAAACAGTT TTATTCGAAT 48149 .......... .......... .......... .......... .......... .......... 78 TGGTTAAACT CAGTTCTCAT TTTCATATCA AGTGAAAAGG TCAATATAAA CTAAAGAGAT 48209 .......... .......... .......... .......... .......... .......... 78 GATGATTGTC CCATCTTTGC ACATGTAGTC CGGTTAGAAT GGGGATTGAA TTGACATAGA 48269 .......... .......... .......... .......... .......... .......... 78 ACTTGGGCTA AGTGGGTTAT AATTATACGG GTTAAGACGT AGCACATTAT TAAATTATCA 48329 .......... .......... .......... .......... .......... .......... 78 TGAGCTCAAC CCATAAATTT TGGGCTCCTA ATATCTGAGC TTCATTTGAC ACCCCAAGTA 48389 .......... .......... .......... .......... .......... .......... 78 AGGAGTGCCA CGCACGAGCA TGGCAAAAAG CAAGGGGAAC TTTTCTTTTT GGGAGAAATC 48449 .......... .......... .......... .......... .......... .......... 78 ATTTGATTGC ATATTGAATA CATAAAGCAC ATTCCAACAA ATTCAAATTT TAGAAGTTTC 48509 .......... .......... .......... .......... .......... .......... 78 ATATGGTGAC TACATTTTAG CTTCCCGTCA ATTACCCCAA CCTTCTTCAT TTATCCAGAT 48569 .......... .......... .......... .......... .......... .......... 78 GTGGGACGGA CACGGTGAAG CTCACATAGA TTGAGTTAGG TAAAATATTT ATCTGTGGAG 48629 .......... .......... .......... .......... .......... .......... 78 AAAAATATTA CCCCCTGTTC CATTTTGTGT GACAAGTTGA AAAATATGTG TGGTTAAATT 48689 .......... .......... .......... .......... .......... .......... 78 GACTAATTTT CTGAGTGAAT TTGAACATTG ATATTCATTT TCTAAAAATA AAGTTTTACA 48749 .......... .......... .......... .......... .......... .......... 78 TCTTTAAAAA CTATATAAAA AGTATTGTAA GTCACAATAG TTTACAATTC AAAATATTAA 48809 .......... .......... .......... .......... .......... .......... 78 AGAAGTATTT TAAAAAAAAC ATGGTCAAAG AAAAACTTAT TTTACACTCC AGATAGTTAT 48869 .......... .......... .......... .......... .......... .......... 78 AGGTTACATA AAGTGGAGCA AAGTACTCTT ATCAATACTC TTAACCATAG GTCTGGAATT 48929 .......... .......... .......... .......... .......... .......... 78 CGAGTACCCA TAGAATAGAG TTCCTTTTGT TAGGGAGCGG GTGGGAACCA AAAAAAAAAG 48989 .......... .......... .......... .......... .......... .......... 78 TGGAACAAAG GGAGTACTAA AGTATACTTA TGGAAGTTAA TATAAAATCT GAAGATAAGC 49049 .......... .......... .......... .......... .......... .......... 78 GTTAAAAACA TACCTAAACT ATCCTTTTTT TTTTAGTTTC ATACTTGAAG TATTGAGTGT 49109 .......... .......... .......... .......... .......... .......... 78 GAGTTTTCTA CCTAAACTAT CACTTATTAA TTTGAGAAAC ACATCTTTCT TTTATTATAC 49169 .......... .......... .......... .......... .......... .......... 78 TCTATCATGG TGTGTAATAC ACTCCTTTTA TTTAAAAATT GTTATATTAC AATCCACATG 49229 .......... .......... .......... .......... .......... .......... 78 GACAAAACGT TTCACCTTGA CAAAAAATAA ATAATTAGTA TTAGTTAAAG TTAAGTATTA 49289 .......... .......... .......... .......... .......... .......... 78 AAGTATTGCT ATCCCCCCCC CCTCCCCCAA AAAAAAAATT ATAAAATAAA ATGTAAAATA 49349 .......... .......... .......... .......... .......... .......... 78 TTTTTTTTAC CCAACTCCAA TCTTTCCTCT CAACGTACTC CCCCATCCCA AATTTTTAGT 49409 .......... .......... .......... .......... .......... .......... 78 TTATTTTGTT CAAAAAAAAT AAATCCCTTC GAATAATAAT TTAGATATAG TTAAATTTAT 49469 .......... .......... .......... .......... .......... .......... 78 TTTATTTCTT GAAAAAAAAT TCTACCCTAA CATAACTCCC CTCTTCCATT TTTTTTCTCG 49529 .......... .......... .......... .......... .......... .......... 78 TTTTGTATTA GATATGTATT TTCTTTTCTA AAAAAGTATT TTTTAACTTG CCGCAAGACT 49589 .......... .......... .......... .......... .......... .......... 78 TTTCATAAAA TAAAACTTTT ATTTCTGTTA ATTTGGTATG CAAGTAGAAA AGAATGTTTT 49649 .......... .......... .......... .......... .......... .......... 78 CCTAAAAATA TATGTACACA TCTAACACAA AACTAGAAAA ATGTATAAAA TTAAATTAGG 49709 .......... .......... .......... .......... .......... .......... 78 AGCGGAGGGT TAGATGGGGT GGGGTAGAAT ATTATTTTAT TTTACTTTTT TTTTAAAAAA 49769 .......... .......... .......... .......... .......... .......... 78 TAATATCAAA ATTATTTTTA GGAAGGA 49796 ||| || .......... .......... .GAATGA 84 hqPGS_C01HBa0088L02.1+_SGN-E547335- (47310 47365) ******************************************************************************** EST sequence 78 +strand 635 n (File: SGN-E368044+) 1 TACATGCACC TAGTGGAATA GTCAAGATAC ATGCATGTTG GGTTGAAGGC ACCTTAGTCT 61 TATAGAATTG TCAAATCAGA ATATTTAGTA TGATGTATCA TGTGTTCTTG AACACTCGTA 121 GAACTAATTC TGTTTTCCAA CCATTAGTTG ACTCTATCAA AAGAATATCA AGTTGAAGCT 181 AGTTGAGATG TAGGTAGAAT ATCTATTAAC CAACTTATCT CCATGTAGTT CTATTCAGTT 241 CCATTTCATC CAATATTGTA TAATTTACCT TAAAACTACA AGTCCGATGT GTTCCACACT 301 TTCAGGAATA TAAAAGTCTA ACACTGTGCC TATTATCAGC TAACAAGTAA CAACTCTCTA 361 TTTCAAATAG CTGGCATTGC CTACATGGAT CATTTACTTT TGTTAGGTTA CGGTCTTAGT 421 TAAGTTCTAC CAGAGATATT GCACGTCCTT TAGGATAACT CATCTCCTTG TGATTTTAGG 481 TGTACTTTGC TTATTTGAAA TGATGCAAGG TTTTATTACT TTTTTTTTCT AAGAGATTTT 541 CATTGTATAT GTATCCACCA AAAGAATAAT ACGAAGAAAA AAAATGAGAG AGGAAGAAAC 601 AGATCTGCTT TCAAGTTGTG ACATAATTTT ATCGA Predicted gene structure (within gDNA segment 49795 to 51639): Exon 1 50395 51029 ( 635 n); cDNA 1 635 ( 635 n); score: 0.998 MATCH C01HBa0088L02.1+ SGN-E368044+ 0.998 635 1.000 C PGS_C01HBa0088L02.1+_SGN-E368044+ (50395 51029) Alignment (genomic DNA sequence = upper lines): TACATGCACC TAGTGGAATA GTCAAGATAC ATGCATGTTG GGTTGAAGGC ACCTTAGTCT 50454 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TACATGCACC TAGTGGAATA GTCAAGATAC ATGCATGTTG GGTTGAAGGC ACCTTAGTCT 60 TATAGAATTG TCAAATCAGA ATATTTAGTA TGATGTATCA TGTGTTCTTG AACACTCGTA 50514 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATAGAATTG TCAAATCAGA ATATTTAGTA TGATGTATCA TGTGTTCTTG AACACTCGTA 120 GAACTAATTC TGTTTTCCAA CCATTAGTTG ACTCTATCAA AAGAATATCA AGTTGAAGCT 50574 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAACTAATTC TGTTTTCCAA CCATTAGTTG ACTCTATCAA AAGAATATCA AGTTGAAGCT 180 AGTTGAGATG TAGGTAGAAT ATCTATTAAC CAACTTATCT CCATGTAGTT CTATTCAGTT 50634 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTTGAGATG TAGGTAGAAT ATCTATTAAC CAACTTATCT CCATGTAGTT CTATTCAGTT 240 CCATTTCATC CAATATTGTA TAATTTACCT TAAAACTACA AGTCCGATGT GTTCCACACT 50694 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCATTTCATC CAATATTGTA TAATTTACCT TAAAACTACA AGTCCGATGT GTTCCACACT 300 TTCAGGAATA TAAAAGTCTA ACACTGTGCC TATTATCAGC TAACAAGTAA CAACTCTCTA 50754 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTCAGGAATA TAAAAGTCTA ACACTGTGCC TATTATCAGC TAACAAGTAA CAACTCTCTA 360 TTTCAAATAG CTGGCATTGC CTACATGGAT CATTTACTTT TGTTAGGTTA CGGTCTTAGT 50814 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTCAAATAG CTGGCATTGC CTACATGGAT CATTTACTTT TGTTAGGTTA CGGTCTTAGT 420 TAAGTTCTAC CAGAGATATT GCACGTCCTT TAGGATAACT CATCTCCTTG TGATTTTAGG 50874 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAAGTTCTAC CAGAGATATT GCACGTCCTT TAGGATAACT CATCTCCTTG TGATTTTAGG 480 TGTACTTTGC TTATTTGAAA TGATGCAAGG TTTTATTACT TTTTTTTTCT AAGAGATTTT 50934 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTACTTTGC TTATTTGAAA TGATGCAAGG TTTTATTACT TTTTTTTTCT AAGAGATTTT 540 CATTGTATAT GTATCCACCA AAAGAATAAT ACGAAGAAAA AAAATGAGAG AGGAAGAAAC 50994 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CATTGTATAT GTATCCACCA AAAGAATAAT ACGAAGAAAA AAAATGAGAG AGGAAGAAAC 600 AGATCTGCTT CCAAGTTGTG ACATAATTTT ATCGA 51029 |||||||||| ||||||||| |||||||||| ||||| AGATCTGCTT TCAAGTTGTG ACATAATTTT ATCGA 635 hqPGS_C01HBa0088L02.1+_SGN-E368044+ (50395 51029) ******************************************************************************** EST sequence 99 +strand 401 n (File: SGN-E240728+) 1 TACATGCACC TAGTGGAATA GTCAAGATAC ATGCATGTTG GGTTGAAGGC ACCTTAGTCT 61 TATAGAATTG TCAAATCAGA ATATTTAGTA TGATGTATCA TGTGTTCTTG AACACTCGTA 121 GAACTAATTC TGTTTTCCAA CCATTAGTTG ACTCTATCAA AAGAATATCA AGTTGAAGCT 181 AGTTGAGATG TAGGTAGAAT ATCTATTAAC CAACTTATCT CCATGTAGTT CTATTCAGTT 241 CCATTTCATC CAATATTGTA TAATTTACCT TAAAACTACA AGTCCGATGT GTTCCACACT 301 TTCAGGAATA TAAAAGTCTA ACACTGTGCC TATTATCAGC TAACAAGTAA CAACTCTCTA 361 TTTCAAATAG CTGGCATTGC CTACATGGAT CATTTACTTT T Predicted gene structure (within gDNA segment 49795 to 51405): Exon 1 50395 50795 ( 401 n); cDNA 1 401 ( 401 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E240728+ 1.000 401 1.000 C PGS_C01HBa0088L02.1+_SGN-E240728+ (50395 50795) Alignment (genomic DNA sequence = upper lines): TACATGCACC TAGTGGAATA GTCAAGATAC ATGCATGTTG GGTTGAAGGC ACCTTAGTCT 50454 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TACATGCACC TAGTGGAATA GTCAAGATAC ATGCATGTTG GGTTGAAGGC ACCTTAGTCT 60 TATAGAATTG TCAAATCAGA ATATTTAGTA TGATGTATCA TGTGTTCTTG AACACTCGTA 50514 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATAGAATTG TCAAATCAGA ATATTTAGTA TGATGTATCA TGTGTTCTTG AACACTCGTA 120 GAACTAATTC TGTTTTCCAA CCATTAGTTG ACTCTATCAA AAGAATATCA AGTTGAAGCT 50574 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAACTAATTC TGTTTTCCAA CCATTAGTTG ACTCTATCAA AAGAATATCA AGTTGAAGCT 180 AGTTGAGATG TAGGTAGAAT ATCTATTAAC CAACTTATCT CCATGTAGTT CTATTCAGTT 50634 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTTGAGATG TAGGTAGAAT ATCTATTAAC CAACTTATCT CCATGTAGTT CTATTCAGTT 240 CCATTTCATC CAATATTGTA TAATTTACCT TAAAACTACA AGTCCGATGT GTTCCACACT 50694 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCATTTCATC CAATATTGTA TAATTTACCT TAAAACTACA AGTCCGATGT GTTCCACACT 300 TTCAGGAATA TAAAAGTCTA ACACTGTGCC TATTATCAGC TAACAAGTAA CAACTCTCTA 50754 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTCAGGAATA TAAAAGTCTA ACACTGTGCC TATTATCAGC TAACAAGTAA CAACTCTCTA 360 TTTCAAATAG CTGGCATTGC CTACATGGAT CATTTACTTT T 50795 |||||||||| |||||||||| |||||||||| |||||||||| | TTTCAAATAG CTGGCATTGC CTACATGGAT CATTTACTTT T 401 hqPGS_C01HBa0088L02.1+_SGN-E240728+ (50395 50795) ******************************************************************************** EST sequence 18 +strand 723 n (File: SGN-E350932+) 1 GCCACTGAGT TAACTCGCCA TTCTTCTCTT CTTTAGACAA GCCTGATAAG GAAAGCTGAT 61 TCTTAACAAT GTGTTGGGCA TCAAAGGTTT TCTTTTGTTC TCCTTCAAAA TGCACATAGG 121 TAAGGTACTT ATTCATAGTA CAATTATTTG GCATATATTG TAGTTACACA CGTGCTTGTG 181 TACTTGTTCT ACTAAAATGT TGTTATGACT TTGTAAGCTA GGTTAAATAT CACAGAACAT 241 GGTGCATCTT TCATTTGGAG CATGAACTTG TGTTTCACTC TTGGTCAAGT TATGTGTAAA 301 AGGTATTCTG ACATTCATGT CAGCTAGTTT GCAGGTTTTT ACAGATAATA GAGCAGAGGC 361 AATGAAACTG CCGTAACAAT GTCTGGTACT CTTTTCTAAA AGTAGTATGC CATGCTCTCA 421 AGTATAACTA GAAGTGCTTG TAGACTGTGC CTCAACAAAA TGTGAAATCT CTGTCGTGTG 481 TGAAATCATT TCAGCTACCT AGTGTTCTTT AGTTGAGGCT TCATGCTTGC TTCAGTTAGA 541 AGGTGGTTCA CCTTGANGTG TATCCTTGTC AATTACATAA TTATGTATTT TACCCATTGG 601 TTTTTCTCTA TCGGGAGATT GTTTTTAANG AAAGAACACG ATTTGTTGTA ACATTTACGC 661 AAGCTATATT TGCAGAACAT GGTCAGTCAT TTATGATGAC GTGCTTAATT ATTCTCAAAA 721 AAA Predicted gene structure (within gDNA segment 50459 to 52438): Exon 1 51059 51778 ( 720 n); cDNA 1 718 ( 718 n); score: 0.994 MATCH C01HBa0088L02.1+ SGN-E350932+ 0.994 720 0.996 C PGS_C01HBa0088L02.1+_SGN-E350932+ (51059 51778) Alignment (genomic DNA sequence = upper lines): GCCACTGAGT TAACTCGCCA TTCTTCTCTT CTTTAGACAA GCCTGATAAG GAAAGCTGAT 51118 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCCACTGAGT TAACTCGCCA TTCTTCTCTT CTTTAGACAA GCCTGATAAG GAAAGCTGAT 60 TCTTAACAAT GTGTTGGGCA TCAAAGGTTT TCTTTTGTTC TCCTTCAAAA TGCACATAGG 51178 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCTTAACAAT GTGTTGGGCA TCAAAGGTTT TCTTTTGTTC TCCTTCAAAA TGCACATAGG 120 TAAGGTACTT ATTCATAGTA CAATTATTTG GCATATATTG TAGTTACACA CGTGCTTGTG 51238 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAAGGTACTT ATTCATAGTA CAATTATTTG GCATATATTG TAGTTACACA CGTGCTTGTG 180 TACTTGTTCT ACTAAAATGT TGTTATGACT TTGTAAGCTA GGTTAAATAT CACAGAACAT 51298 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TACTTGTTCT ACTAAAATGT TGTTATGACT TTGTAAGCTA GGTTAAATAT CACAGAACAT 240 GGTGCATCTT TCATTTGGAG CATGAACTTG TGTTTCACTC TTGGTCAAGT TATGTGTAAA 51358 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGTGCATCTT TCATTTGGAG CATGAACTTG TGTTTCACTC TTGGTCAAGT TATGTGTAAA 300 AGGTATTCTG ACATTCATGT CAGCTAGTTT GCAGGTTTTT ACAGATAATA GAGCAGAGGC 51418 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGGTATTCTG ACATTCATGT CAGCTAGTTT GCAGGTTTTT ACAGATAATA GAGCAGAGGC 360 AATGAAACTG CCGTAACAAT GTCTGGTACT CTTTTCTAAA AGTAGTATGC CATGCTCTCA 51478 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATGAAACTG CCGTAACAAT GTCTGGTACT CTTTTCTAAA AGTAGTATGC CATGCTCTCA 420 AGTATAACTA GAAGTGCTTG TAGACTGTGC CTCAACAAAA TGTGAAATCT CTGTCGTGTG 51538 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTATAACTA GAAGTGCTTG TAGACTGTGC CTCAACAAAA TGTGAAATCT CTGTCGTGTG 480 TGAAATCATT TCAGCTACCT AGTGTTCTTT AGTTGAGGCT TCATGCTTGC TTCAGTTAGA 51598 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGAAATCATT TCAGCTACCT AGTGTTCTTT AGTTGAGGCT TCATGCTTGC TTCAGTTAGA 540 AGGTGGTTCA CCTTGAGGTG TATCCTTGTC AATTACATAA TTATGTATTT TACCCATTGG 51658 |||||||||| |||||| ||| |||||||||| |||||||||| |||||||||| |||||||||| AGGTGGTTCA CCTTGANGTG TATCCTTGTC AATTACATAA TTATGTATTT TACCCATTGG 600 TTTTTCTCTA TCGGGAGATT GTTTTTAAGG AAAAGAACAC GATTTGTTGT AACAATTTAC 51718 |||||||||| |||||||||| |||||||| | ||||||||| |||||||||| ||| |||||| TTTTTCTCTA TCGGGAGATT GTTTTTAANG -AAAGAACAC GATTTGTTGT AAC-ATTTAC 658 GCAAGCTATA TTTGCAGAAC ATGGTCAGTC ATTTATGATG ACGTGCTTAA TTATTCTCAA 51778 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCAAGCTATA TTTGCAGAAC ATGGTCAGTC ATTTATGATG ACGTGCTTAA TTATTCTCAA 718 hqPGS_C01HBa0088L02.1+_SGN-E350932+ (51059 51778) ******************************************************************************** EST sequence 42 +strand 721 n (File: SGN-E352074+) 1 ACTGAGTTAA CTCGCCATTC TTCTCTTCTT TAGACAAGCC TGATAAGGAA AGCTGATTCT 61 TAACAATGTG TTGGGCATCA AAGGTTTTCT TTTGTTCTCC TTCAAAATGC ACATAGGTAA 121 GGTACTTATT CATAGTACAA TTATTTGGCA TATATTGTAG TTACACACGT GCTTGTGTAC 181 TTGTTCTACT AAAATGTTGT TATGACTTTG TAAGCTAGGT TAAATATCAC AGAACATGGT 241 GCATCTTTCA TTTGGAGCAT GAACTTGTGT TTCACTCTTG GTCAAGTTAT GTGTAAAAGG 301 TATTCTGACA TTCATGTCAG CTAGTTTGCA GGTTTTTACA GATAATAGAG CAGAGGCAAT 361 GAAACTGCCG TAACAATGTC TGGTACTCTT TTCTAAAAGT AGTATGCCAT GCTCTCAAGT 421 ATAACTAGAA GTGCTTGTAG ACTGTGCCTC AACAAAATGT GAAATCTCTG TCGTGTGTGA 481 AATCATTTCA GCTACCTAGT GTTCTTTAGT TGAGGCTTCA TGCTTGCTTC AGTTAGAAGG 541 TGGTTCACCT TGAGGTGTAT CCTTGTCAAT TACATAATTA TGTATTTTAC CCATTGGTTT 601 TTCTCTATCG GGAGATTGTT TTTAAGGAAA AGACACGATT TTGTGTAAAC ATTTACGCAA 661 GCTATATTTG CAGAACATGG TCAGTCATTT ATGATGACGT GCTTAATTAT TCTCAAAAAA 721 A Predicted gene structure (within gDNA segment 50462 to 52438): Exon 1 51062 51778 ( 717 n); cDNA 1 716 ( 716 n); score: 0.993 MATCH C01HBa0088L02.1+ SGN-E352074+ 0.993 717 0.994 C PGS_C01HBa0088L02.1+_SGN-E352074+ (51062 51778) Alignment (genomic DNA sequence = upper lines): ACTGAGTTAA CTCGCCATTC TTCTCTTCTT TAGACAAGCC TGATAAGGAA AGCTGATTCT 51121 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACTGAGTTAA CTCGCCATTC TTCTCTTCTT TAGACAAGCC TGATAAGGAA AGCTGATTCT 60 TAACAATGTG TTGGGCATCA AAGGTTTTCT TTTGTTCTCC TTCAAAATGC ACATAGGTAA 51181 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAACAATGTG TTGGGCATCA AAGGTTTTCT TTTGTTCTCC TTCAAAATGC ACATAGGTAA 120 GGTACTTATT CATAGTACAA TTATTTGGCA TATATTGTAG TTACACACGT GCTTGTGTAC 51241 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGTACTTATT CATAGTACAA TTATTTGGCA TATATTGTAG TTACACACGT GCTTGTGTAC 180 TTGTTCTACT AAAATGTTGT TATGACTTTG TAAGCTAGGT TAAATATCAC AGAACATGGT 51301 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGTTCTACT AAAATGTTGT TATGACTTTG TAAGCTAGGT TAAATATCAC AGAACATGGT 240 GCATCTTTCA TTTGGAGCAT GAACTTGTGT TTCACTCTTG GTCAAGTTAT GTGTAAAAGG 51361 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCATCTTTCA TTTGGAGCAT GAACTTGTGT TTCACTCTTG GTCAAGTTAT GTGTAAAAGG 300 TATTCTGACA TTCATGTCAG CTAGTTTGCA GGTTTTTACA GATAATAGAG CAGAGGCAAT 51421 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATTCTGACA TTCATGTCAG CTAGTTTGCA GGTTTTTACA GATAATAGAG CAGAGGCAAT 360 GAAACTGCCG TAACAATGTC TGGTACTCTT TTCTAAAAGT AGTATGCCAT GCTCTCAAGT 51481 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAAACTGCCG TAACAATGTC TGGTACTCTT TTCTAAAAGT AGTATGCCAT GCTCTCAAGT 420 ATAACTAGAA GTGCTTGTAG ACTGTGCCTC AACAAAATGT GAAATCTCTG TCGTGTGTGA 51541 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATAACTAGAA GTGCTTGTAG ACTGTGCCTC AACAAAATGT GAAATCTCTG TCGTGTGTGA 480 AATCATTTCA GCTACCTAGT GTTCTTTAGT TGAGGCTTCA TGCTTGCTTC AGTTAGAAGG 51601 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATCATTTCA GCTACCTAGT GTTCTTTAGT TGAGGCTTCA TGCTTGCTTC AGTTAGAAGG 540 TGGTTCACCT TGAGGTGTAT CCTTGTCAAT TACATAATTA TGTATTTTAC CCATTGGTTT 51661 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGTTCACCT TGAGGTGTAT CCTTGTCAAT TACATAATTA TGTATTTTAC CCATTGGTTT 600 TTCTCTATCG GGAGATTGTT TTTAAGGAAA AGAACACGAT TTGTTGTAAC AATTTACGCA 51721 |||||||||| |||||||||| |||||||||| || ||||||| || ||||| ||||||||| TTCTCTATCG GGAGATTGTT TTTAAGGAAA AG-ACACGAT TTTGTGTAAA CATTTACGCA 659 AGCTATATTT GCAGAACATG GTCAGTCATT TATGATGACG TGCTTAATTA TTCTCAA 51778 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||| AGCTATATTT GCAGAACATG GTCAGTCATT TATGATGACG TGCTTAATTA TTCTCAA 716 hqPGS_C01HBa0088L02.1+_SGN-E352074+ (51062 51778) ******************************************************************************** EST sequence 249 +strand 769 n (File: SGN-E545557+) 1 CTCTTCTTCA AAGTTTTCAG AGCAAAGAAG CTCTGCCCAT GTCGCAACCT ACAGAAGAAG 61 AAAGAGGAGA AGGACTTGGC GTGCGCAAAA GGCTGTCTTC TCTCTCTCTA AGGATGAACA 121 TGCGCATGAG GTCTACTTGT CAACAACAAC AACCCATCCT CTCATTCTAC TCCTCTACCT 181 CCTCATCCTC ATGGGCATTT CGCCGATCCA AATCCTTGTC CGAATACACT GGTAATTCCA 241 TTAGGAAATG GTGGGATTGG GGATTGGGCT GGATCATGTC CAAGAAGCCA GCCTTTGCCA 301 ACGATCTGGA AATGAATGAA GAGGAGAAAG CCGTATTGGG ATGCAACAGC AAGGGCAGCT 361 GGAGGCACGT ATTTTTCAAA ATAAGGTCGG AGCTGCGGAG GTTCACCGGC TCCGGCAACA 421 ATATGGGTCT ACCTCAAACC TTCCGGTATG ACTACTCCAG GAACTTCGAT GACAACTTAA 481 TCAGGAACAA CTGATGTATT ATTACTCTAC TATTCCCACT GTGATGTTGG TTAATTCATT 541 GATTGATTTG AGTCGTTTTG TTTTTATATA TTAATAATAG ATCGGAGTTC ACATGGAGTA 601 CGTACGTAAA TGTATAAAGT GAATTACTTT TATCTTCATC ATATAGTCAG TCAGTCCAGT 661 CCATTACGTT GTATTATTAT TTTCCCCTCG TGTAATTCTT TTTACCATTC TCGAGTGTAT 721 TTGATTTTTA TGCATAAGCA CTACTGCTAT AAATTTGCCT AAAAAAAAA Predicted gene structure (within gDNA segment 53694 to 51653): Exon 1 53094 52333 ( 762 n); cDNA 1 762 ( 762 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E545557+ 1.000 762 0.991 C PGS_C01HBa0088L02.1-_SGN-E545557+ (53094 52333) Alignment (genomic DNA sequence = upper lines): CTCTTCTTCA AAGTTTTCAG AGCAAAGAAG CTCTGCCCAT GTCGCAACCT ACAGAAGAAG 53035 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCTTCTTCA AAGTTTTCAG AGCAAAGAAG CTCTGCCCAT GTCGCAACCT ACAGAAGAAG 60 AAAGAGGAGA AGGACTTGGC GTGCGCAAAA GGCTGTCTTC TCTCTCTCTA AGGATGAACA 52975 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAAGAGGAGA AGGACTTGGC GTGCGCAAAA GGCTGTCTTC TCTCTCTCTA AGGATGAACA 120 TGCGCATGAG GTCTACTTGT CAACAACAAC AACCCATCCT CTCATTCTAC TCCTCTACCT 52915 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGCGCATGAG GTCTACTTGT CAACAACAAC AACCCATCCT CTCATTCTAC TCCTCTACCT 180 CCTCATCCTC ATGGGCATTT CGCCGATCCA AATCCTTGTC CGAATACACT GGTAATTCCA 52855 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCTCATCCTC ATGGGCATTT CGCCGATCCA AATCCTTGTC CGAATACACT GGTAATTCCA 240 TTAGGAAATG GTGGGATTGG GGATTGGGCT GGATCATGTC CAAGAAGCCA GCCTTTGCCA 52795 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTAGGAAATG GTGGGATTGG GGATTGGGCT GGATCATGTC CAAGAAGCCA GCCTTTGCCA 300 ACGATCTGGA AATGAATGAA GAGGAGAAAG CCGTATTGGG ATGCAACAGC AAGGGCAGCT 52735 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACGATCTGGA AATGAATGAA GAGGAGAAAG CCGTATTGGG ATGCAACAGC AAGGGCAGCT 360 GGAGGCACGT ATTTTTCAAA ATAAGGTCGG AGCTGCGGAG GTTCACCGGC TCCGGCAACA 52675 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGAGGCACGT ATTTTTCAAA ATAAGGTCGG AGCTGCGGAG GTTCACCGGC TCCGGCAACA 420 ATATGGGTCT ACCTCAAACC TTCCGGTATG ACTACTCCAG GAACTTCGAT GACAACTTAA 52615 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATATGGGTCT ACCTCAAACC TTCCGGTATG ACTACTCCAG GAACTTCGAT GACAACTTAA 480 TCAGGAACAA CTGATGTATT ATTACTCTAC TATTCCCACT GTGATGTTGG TTAATTCATT 52555 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCAGGAACAA CTGATGTATT ATTACTCTAC TATTCCCACT GTGATGTTGG TTAATTCATT 540 GATTGATTTG AGTCGTTTTG TTTTTATATA TTAATAATAG ATCGGAGTTC ACATGGAGTA 52495 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GATTGATTTG AGTCGTTTTG TTTTTATATA TTAATAATAG ATCGGAGTTC ACATGGAGTA 600 CGTACGTAAA TGTATAAAGT GAATTACTTT TATCTTCATC ATATAGTCAG TCAGTCCAGT 52435 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CGTACGTAAA TGTATAAAGT GAATTACTTT TATCTTCATC ATATAGTCAG TCAGTCCAGT 660 CCATTACGTT GTATTATTAT TTTCCCCTCG TGTAATTCTT TTTACCATTC TCGAGTGTAT 52375 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCATTACGTT GTATTATTAT TTTCCCCTCG TGTAATTCTT TTTACCATTC TCGAGTGTAT 720 TTGATTTTTA TGCATAAGCA CTACTGCTAT AAATTTGCCT AA 52333 |||||||||| |||||||||| |||||||||| |||||||||| || TTGATTTTTA TGCATAAGCA CTACTGCTAT AAATTTGCCT AA 762 hqPGS_C01HBa0088L02.1-_SGN-E545557+ (53094 52333) ******************************************************************************** EST sequence 91 -strand 794 n (File: SGN-E545556-) 1 CTCTTCTTCA AAGTTTTCAG AGCAAAGAAG CTCTGCCCAT GTCGCAACCT ACAGAAGAAG 61 AAAGAGGAGA AGGACTTGGC GTGCGCAAAA GGCTGTCTTC TCTCTCTCTA AGGATGAACA 121 TGCGCATGAG GTCTACTTGT CAACAACAAC AACCCATCCC TCTCAATTCT ACTCCTCTAC 181 CTCCTCATCC TCATGGGCAT TTCGCCGATC CAAATCCTTG TCCGAATACA CTGGTAATTC 241 CATTAGGAAA TGGTGGGATT GGGGATTGGG CTGGATCATG TCCAAGAAGC CAGCCTTTGC 301 CAACGATCTG GAAATGAATG AAGAGGAGAA AGCCGTATTG GGATGCAACA GCAAGGGCAG 361 CTGGAGGCAC GTATTTTTCA AAATAAGGTC GGAGCTGCGG AGGTTCACCG GCTCCGGCAA 421 CAATATGGGT CTACCTCAAA CCTTCCGGTA TGACTACTCC AGGAACTTCG ATGACAACTT 481 AATCAGGAAC AACTGATGTA TTATTACTCT ACTATTCCCA CTGTGATGTT GGTTAATTCA 541 TTGATTGATT TGAGTCGTTT TGTTTTTATA TATTAATAAT AGATCGGAGT TCACATGGAG 601 TACGTACGTA AATGTATAAA GTGAATTACT TTTATCTTCA TCATATAGTC AGTCAGTCCA 661 GTCCATTACG TTGTATTATT ATTTTCCCCT CGTGTAATTC TTTTTACCAT TCTCGAGTGT 721 ATTTGATTTT TATGCATAAG CACTACTGCT ATAAATTTCC TAAAAAAAAA AAAAAAAAAC 781 TCGAGGGGGG CCCG Predicted gene structure (within gDNA segment 53704 to 51379): Exon 1 53094 52339 ( 756 n); cDNA 1 758 ( 758 n); score: 0.993 PPA cDNA 762 780 MATCH C01HBa0088L02.1- SGN-E545556- 0.993 756 0.952 C PGS_C01HBa0088L02.1-_SGN-E545556- (53094 52339) Alignment (genomic DNA sequence = upper lines): CTCTTCTTCA AAGTTTTCAG AGCAAAGAAG CTCTGCCCAT GTCGCAACCT ACAGAAGAAG 53035 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCTTCTTCA AAGTTTTCAG AGCAAAGAAG CTCTGCCCAT GTCGCAACCT ACAGAAGAAG 60 AAAGAGGAGA AGGACTTGGC GTGCGCAAAA GGCTGTCTTC TCTCTCTCTA AGGATGAACA 52975 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAAGAGGAGA AGGACTTGGC GTGCGCAAAA GGCTGTCTTC TCTCTCTCTA AGGATGAACA 120 TGCGCATGAG GTCTACTTGT CAACAACAAC AACCCAT-CC TCTC-ATTCT ACTCCTCTAC 52917 |||||||||| |||||||||| |||||||||| ||||||| || |||| ||||| |||||||||| TGCGCATGAG GTCTACTTGT CAACAACAAC AACCCATCCC TCTCAATTCT ACTCCTCTAC 180 CTCCTCATCC TCATGGGCAT TTCGCCGATC CAAATCCTTG TCCGAATACA CTGGTAATTC 52857 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCCTCATCC TCATGGGCAT TTCGCCGATC CAAATCCTTG TCCGAATACA CTGGTAATTC 240 CATTAGGAAA TGGTGGGATT GGGGATTGGG CTGGATCATG TCCAAGAAGC CAGCCTTTGC 52797 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CATTAGGAAA TGGTGGGATT GGGGATTGGG CTGGATCATG TCCAAGAAGC CAGCCTTTGC 300 CAACGATCTG GAAATGAATG AAGAGGAGAA AGCCGTATTG GGATGCAACA GCAAGGGCAG 52737 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAACGATCTG GAAATGAATG AAGAGGAGAA AGCCGTATTG GGATGCAACA GCAAGGGCAG 360 CTGGAGGCAC GTATTTTTCA AAATAAGGTC GGAGCTGCGG AGGTTCACCG GCTCCGGCAA 52677 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTGGAGGCAC GTATTTTTCA AAATAAGGTC GGAGCTGCGG AGGTTCACCG GCTCCGGCAA 420 CAATATGGGT CTACCTCAAA CCTTCCGGTA TGACTACTCC AGGAACTTCG ATGACAACTT 52617 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAATATGGGT CTACCTCAAA CCTTCCGGTA TGACTACTCC AGGAACTTCG ATGACAACTT 480 AATCAGGAAC AACTGATGTA TTATTACTCT ACTATTCCCA CTGTGATGTT GGTTAATTCA 52557 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATCAGGAAC AACTGATGTA TTATTACTCT ACTATTCCCA CTGTGATGTT GGTTAATTCA 540 TTGATTGATT TGAGTCGTTT TGTTTTTATA TATTAATAAT AGATCGGAGT TCACATGGAG 52497 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGATTGATT TGAGTCGTTT TGTTTTTATA TATTAATAAT AGATCGGAGT TCACATGGAG 600 TACGTACGTA AATGTATAAA GTGAATTACT TTTATCTTCA TCATATAGTC AGTCAGTCCA 52437 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TACGTACGTA AATGTATAAA GTGAATTACT TTTATCTTCA TCATATAGTC AGTCAGTCCA 660 GTCCATTACG TTGTATTATT ATTTTCCCCT CGTGTAATTC TTTTTACCAT TCTCGAGTGT 52377 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTCCATTACG TTGTATTATT ATTTTCCCCT CGTGTAATTC TTTTTACCAT TCTCGAGTGT 720 ATTTGATTTT TATGCATAAG CACTACTGCT ATAAATTT 52339 |||||||||| |||||||||| |||||||||| |||||||| ATTTGATTTT TATGCATAAG CACTACTGCT ATAAATTT 758 hqPGS_C01HBa0088L02.1-_SGN-E545556- (53094 52339) ******************************************************************************** EST sequence 180 +strand 460 n (File: SGN-E297960+) 1 GGCATTTCGC CGATCCAAAT CCTTGTCCGA ATACACTGGT AATTCCATTA GGAAATGGTG 61 GGATTGGGGA TTGGGCTGGA TCATGTCCAA GAAGCCAGCC TTTGCCAACG ATCTGGAAAT 121 GAATGAAGAG GAGAAAGCCG TATTGGGATG CAACAGCAAG GGCAGCTGGA GGCACGTATT 181 TTTCAAAATA AGGTCGGAGC TGCGGAGGTT CACCGGCTCC GGCAACAATA TGGGTCTACC 241 TCAAACCTTC CGGTATGACT ACTCCAGGAA CTTCGATGAC AACTTAATCA GGAACAACTG 301 ATGTATTATT ACTCTACTAT TCCCACTGTG ATGTTGGTTA ATTCATTGAT TGATTTGAGT 361 CGTTTTGTTT TTATATATTA ATAATAGATC GGAGTTCACA TGGAGTACGT ACGTAAATGT 421 ATAAAGTGAA TTACTTTTAT CTTCATCANA NAAAAAAAAA Predicted gene structure (within gDNA segment 53501 to 51724): Exon 1 52901 52454 ( 448 n); cDNA 1 448 ( 448 n); score: 1.000 PPA cDNA 450 460 MATCH C01HBa0088L02.1- SGN-E297960+ 1.000 448 0.974 C PGS_C01HBa0088L02.1-_SGN-E297960+ (52901 52454) Alignment (genomic DNA sequence = upper lines): GGCATTTCGC CGATCCAAAT CCTTGTCCGA ATACACTGGT AATTCCATTA GGAAATGGTG 52842 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGCATTTCGC CGATCCAAAT CCTTGTCCGA ATACACTGGT AATTCCATTA GGAAATGGTG 60 GGATTGGGGA TTGGGCTGGA TCATGTCCAA GAAGCCAGCC TTTGCCAACG ATCTGGAAAT 52782 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGATTGGGGA TTGGGCTGGA TCATGTCCAA GAAGCCAGCC TTTGCCAACG ATCTGGAAAT 120 GAATGAAGAG GAGAAAGCCG TATTGGGATG CAACAGCAAG GGCAGCTGGA GGCACGTATT 52722 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAATGAAGAG GAGAAAGCCG TATTGGGATG CAACAGCAAG GGCAGCTGGA GGCACGTATT 180 TTTCAAAATA AGGTCGGAGC TGCGGAGGTT CACCGGCTCC GGCAACAATA TGGGTCTACC 52662 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTCAAAATA AGGTCGGAGC TGCGGAGGTT CACCGGCTCC GGCAACAATA TGGGTCTACC 240 TCAAACCTTC CGGTATGACT ACTCCAGGAA CTTCGATGAC AACTTAATCA GGAACAACTG 52602 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCAAACCTTC CGGTATGACT ACTCCAGGAA CTTCGATGAC AACTTAATCA GGAACAACTG 300 ATGTATTATT ACTCTACTAT TCCCACTGTG ATGTTGGTTA ATTCATTGAT TGATTTGAGT 52542 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATGTATTATT ACTCTACTAT TCCCACTGTG ATGTTGGTTA ATTCATTGAT TGATTTGAGT 360 CGTTTTGTTT TTATATATTA ATAATAGATC GGAGTTCACA TGGAGTACGT ACGTAAATGT 52482 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CGTTTTGTTT TTATATATTA ATAATAGATC GGAGTTCACA TGGAGTACGT ACGTAAATGT 420 ATAAAGTGAA TTACTTTTAT CTTCATCA 52454 |||||||||| |||||||||| |||||||| ATAAAGTGAA TTACTTTTAT CTTCATCA 448 hqPGS_C01HBa0088L02.1-_SGN-E297960+ (52901 52454) ******************************************************************************** EST sequence 240 +strand 519 n (File: SGN-E311040+) 1 TCTTCTTCAA AGTTTTCAGA GCAAAGAAGC TCTGCCCATG TCGCAACCTA CAGAAGAAGA 61 AAGAGGAGAA GGACTTGGCG TGCGCAAAAG GCTGTCTTCT CTCTCTCTAA GGATGAACAT 121 GCGCATGAGG TCTACTTGTC AACAACAACA ACCCATCCTC TCATTCTACT CCTCTACCTC 181 CTCATCCTCA TGGGCATTTC GCCGATCCAA ATCCTTGTCC GAATACACTG GTAATTCCAT 241 TAGGAAATGG TGGGATTGGG GATTGGGCTG GATCATGTCC AAGAAGCCAG CCTTTGCCAA 301 CGATCTGGAA ATGAATGAAG AGGAGAAAGC CGTATTGGGA TGCAACAGCA AGGGCAGCTG 361 GAGGCACGTA TTTTTCAAAA TAAGGTCGGA GCTGCGGAGG TTCACCGGCT CCGGCAACAA 421 TATGGGTCTA CCTCAAACCT TCCGGTATGA CTACTCCAGG AACTTCGATG ACAACTTAAT 481 CAGGAACAAC TGATGTATTA TTACTCTACT ATTCCCACT Predicted gene structure (within gDNA segment 53693 to 51965): Exon 1 53093 52575 ( 519 n); cDNA 1 519 ( 519 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E311040+ 1.000 519 1.000 C PGS_C01HBa0088L02.1-_SGN-E311040+ (53093 52575) Alignment (genomic DNA sequence = upper lines): TCTTCTTCAA AGTTTTCAGA GCAAAGAAGC TCTGCCCATG TCGCAACCTA CAGAAGAAGA 53034 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCTTCTTCAA AGTTTTCAGA GCAAAGAAGC TCTGCCCATG TCGCAACCTA CAGAAGAAGA 60 AAGAGGAGAA GGACTTGGCG TGCGCAAAAG GCTGTCTTCT CTCTCTCTAA GGATGAACAT 52974 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAGAGGAGAA GGACTTGGCG TGCGCAAAAG GCTGTCTTCT CTCTCTCTAA GGATGAACAT 120 GCGCATGAGG TCTACTTGTC AACAACAACA ACCCATCCTC TCATTCTACT CCTCTACCTC 52914 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCGCATGAGG TCTACTTGTC AACAACAACA ACCCATCCTC TCATTCTACT CCTCTACCTC 180 CTCATCCTCA TGGGCATTTC GCCGATCCAA ATCCTTGTCC GAATACACTG GTAATTCCAT 52854 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCATCCTCA TGGGCATTTC GCCGATCCAA ATCCTTGTCC GAATACACTG GTAATTCCAT 240 TAGGAAATGG TGGGATTGGG GATTGGGCTG GATCATGTCC AAGAAGCCAG CCTTTGCCAA 52794 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAGGAAATGG TGGGATTGGG GATTGGGCTG GATCATGTCC AAGAAGCCAG CCTTTGCCAA 300 CGATCTGGAA ATGAATGAAG AGGAGAAAGC CGTATTGGGA TGCAACAGCA AGGGCAGCTG 52734 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CGATCTGGAA ATGAATGAAG AGGAGAAAGC CGTATTGGGA TGCAACAGCA AGGGCAGCTG 360 GAGGCACGTA TTTTTCAAAA TAAGGTCGGA GCTGCGGAGG TTCACCGGCT CCGGCAACAA 52674 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAGGCACGTA TTTTTCAAAA TAAGGTCGGA GCTGCGGAGG TTCACCGGCT CCGGCAACAA 420 TATGGGTCTA CCTCAAACCT TCCGGTATGA CTACTCCAGG AACTTCGATG ACAACTTAAT 52614 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATGGGTCTA CCTCAAACCT TCCGGTATGA CTACTCCAGG AACTTCGATG ACAACTTAAT 480 CAGGAACAAC TGATGTATTA TTACTCTACT ATTCCCACT 52575 |||||||||| |||||||||| |||||||||| ||||||||| CAGGAACAAC TGATGTATTA TTACTCTACT ATTCCCACT 519 hqPGS_C01HBa0088L02.1-_SGN-E311040+ (53093 52575) ******************************************************************************** EST sequence 20 -strand 734 n (File: SGN-E378936-) 1 AACAAAAAAA GGGGGACTAG GAACAAGGAA TCTGAAATTA CAAAACTACA NCTTGCTAAT 61 GAAATGGCTG AGGAGATTTT CATCACAAGA ACAAATGCTG TGGACAGATA CCATTAAGGT 121 CAGGTATGGA ATGGATACAA GGTGGATCAA CAACATAGCA ACACAACCAT ATGGCACCGG 181 AGTGTGGAGG ACAATTAGGA ATCTATGGCC ACAACTTATA AACAAGTGCA TAATTTAAGA 241 TAGGATATGG TGGGAAAACT TTGTTTTGGG TGGGACAGGC TTCATTCAAA GTTAGTTTCC 301 TTGACCTATT CAGCTTAAGT CTACAGAAAG TGGTCACTGT CAAAGAAATG AGAGATGCTC 361 AGGGTTGGAA CTTAAGGTTC AGGAGACCTT TAAACGATTG GTAGGTGAAT AGCATGGTTG 421 AATTTCTGAA TATCCTGGAA TGATGCAAGG AACTCAATAA CAGTGAAAAC AAACTATTAT 481 GGGCTCTAGA TAAACATGGG AGATTCTCAG TTGGAGCATC TTACAGAAAC TCCCAGAGGA 541 CACACACTCA ACCAAGCTAC TGGCCATGAA AAATGATCTG GAAAATTAAG GTGGCCTGTT 601 TTACTTGGCT ATTAGCAAAA CAGGTTGTTC TCACACAGGA TAACCGTATG AAGAAGGGCC 661 TCCATTTGTG CTGTAGATGT TTTTTTGTGA ATGTGAGGCA GAGACCATAA ATGATCTCTT 721 TTTACACTGT AAGA Predicted gene structure (within gDNA segment 54950 to 53007): Exon 1 54340 53607 ( 734 n); cDNA 1 734 ( 734 n); score: 0.999 MATCH C01HBa0088L02.1- SGN-E378936- 0.999 734 1.000 C PGS_C01HBa0088L02.1-_SGN-E378936- (54340 53607) Alignment (genomic DNA sequence = upper lines): AACAAAAAAA GGGGGACTAG GAACAAGGAA TCTGAAATTA CAAAACTACA ACTTGCTAAT 54281 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| AACAAAAAAA GGGGGACTAG GAACAAGGAA TCTGAAATTA CAAAACTACA NCTTGCTAAT 60 GAAATGGCTG AGGAGATTTT CATCACAAGA ACAAATGCTG TGGACAGATA CCATTAAGGT 54221 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAAATGGCTG AGGAGATTTT CATCACAAGA ACAAATGCTG TGGACAGATA CCATTAAGGT 120 CAGGTATGGA ATGGATACAA GGTGGATCAA CAACATAGCA ACACAACCAT ATGGCACCGG 54161 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGGTATGGA ATGGATACAA GGTGGATCAA CAACATAGCA ACACAACCAT ATGGCACCGG 180 AGTGTGGAGG ACAATTAGGA ATCTATGGCC ACAACTTATA AACAAGTGCA TAATTTAAGA 54101 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTGTGGAGG ACAATTAGGA ATCTATGGCC ACAACTTATA AACAAGTGCA TAATTTAAGA 240 TAGGATATGG TGGGAAAACT TTGTTTTGGG TGGGACAGGC TTCATTCAAA GTTAGTTTCC 54041 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAGGATATGG TGGGAAAACT TTGTTTTGGG TGGGACAGGC TTCATTCAAA GTTAGTTTCC 300 TTGACCTATT CAGCTTAAGT CTACAGAAAG TGGTCACTGT CAAAGAAATG AGAGATGCTC 53981 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGACCTATT CAGCTTAAGT CTACAGAAAG TGGTCACTGT CAAAGAAATG AGAGATGCTC 360 AGGGTTGGAA CTTAAGGTTC AGGAGACCTT TAAACGATTG GTAGGTGAAT AGCATGGTTG 53921 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGGGTTGGAA CTTAAGGTTC AGGAGACCTT TAAACGATTG GTAGGTGAAT AGCATGGTTG 420 AATTTCTGAA TATCCTGGAA TGATGCAAGG AACTCAATAA CAGTGAAAAC AAACTATTAT 53861 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATTTCTGAA TATCCTGGAA TGATGCAAGG AACTCAATAA CAGTGAAAAC AAACTATTAT 480 GGGCTCTAGA TAAACATGGG AGATTCTCAG TTGGAGCATC TTACAGAAAC TCCCAGAGGA 53801 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGGCTCTAGA TAAACATGGG AGATTCTCAG TTGGAGCATC TTACAGAAAC TCCCAGAGGA 540 CACACACTCA ACCAAGCTAC TGGCCATGAA AAATGATCTG GAAAATTAAG GTGGCCTGTT 53741 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACACACTCA ACCAAGCTAC TGGCCATGAA AAATGATCTG GAAAATTAAG GTGGCCTGTT 600 TTACTTGGCT ATTAGCAAAA CAGGTTGTTC TCACACAGGA TAACCGTATG AAGAAGGGCC 53681 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTACTTGGCT ATTAGCAAAA CAGGTTGTTC TCACACAGGA TAACCGTATG AAGAAGGGCC 660 TCCATTTGTG CTGTAGATGT TTTTTTGTGA ATGTGAGGCA GAGACCATAA ATGATCTCTT 53621 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCCATTTGTG CTGTAGATGT TTTTTTGTGA ATGTGAGGCA GAGACCATAA ATGATCTCTT 720 TTTACACTGT AAGA 53607 |||||||||| |||| TTTACACTGT AAGA 734 hqPGS_C01HBa0088L02.1-_SGN-E378936- (54340 53607) ******************************************************************************** EST sequence 86 -strand 509 n (File: SGN-E209039-) 1 GTGCATAATT TAAGATAGGA TATGGTGGGA AAACTTTGTT TTGGGTGGGA CAGGCTTCAT 61 TCAAAGTTAG TTTCCTTGAC CTATTCAGCT TAAGTCTACA GAAAGTGGTC ACTGTCAAAG 121 AAATGAGAGA TGCTCAGGGT TGGAACTTAA GGTTCAGGAG ACCTTTAAAC GATTGGTAGG 181 TGAATAGCAT GGTTGAATTT CTGAATATCC TGGAATGATG CAAGGAACTC AATAACAGTG 241 AAAACAAACT ATTATGGGCT CTAGATAAAC ATGGGAGATT CTCAGTTGGA GCATCTTACA 301 GAAACTCCCA GAGGACACAC ACTCAACCAA GCTACTGGCC ATGAAAAATG ATCTGGAAAA 361 TTAAGGTGGC CTGTTTTACT TGGCTATTAG CAAAACAGGT TGTTCTCACA CAGGATAACC 421 GTATGAAGAA GGGCCTCCAT TTGTGCTGTA GATGTTTTTT TGTGAATGTG AGGCAGAGAC 481 CATAAATGAT CTCTTTTTAC ACTGTAAGA Predicted gene structure (within gDNA segment 54725 to 53007): Exon 1 54115 53607 ( 509 n); cDNA 1 509 ( 509 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E209039- 1.000 509 1.000 C PGS_C01HBa0088L02.1-_SGN-E209039- (54115 53607) Alignment (genomic DNA sequence = upper lines): GTGCATAATT TAAGATAGGA TATGGTGGGA AAACTTTGTT TTGGGTGGGA CAGGCTTCAT 54056 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTGCATAATT TAAGATAGGA TATGGTGGGA AAACTTTGTT TTGGGTGGGA CAGGCTTCAT 60 TCAAAGTTAG TTTCCTTGAC CTATTCAGCT TAAGTCTACA GAAAGTGGTC ACTGTCAAAG 53996 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCAAAGTTAG TTTCCTTGAC CTATTCAGCT TAAGTCTACA GAAAGTGGTC ACTGTCAAAG 120 AAATGAGAGA TGCTCAGGGT TGGAACTTAA GGTTCAGGAG ACCTTTAAAC GATTGGTAGG 53936 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAATGAGAGA TGCTCAGGGT TGGAACTTAA GGTTCAGGAG ACCTTTAAAC GATTGGTAGG 180 TGAATAGCAT GGTTGAATTT CTGAATATCC TGGAATGATG CAAGGAACTC AATAACAGTG 53876 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGAATAGCAT GGTTGAATTT CTGAATATCC TGGAATGATG CAAGGAACTC AATAACAGTG 240 AAAACAAACT ATTATGGGCT CTAGATAAAC ATGGGAGATT CTCAGTTGGA GCATCTTACA 53816 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAAACAAACT ATTATGGGCT CTAGATAAAC ATGGGAGATT CTCAGTTGGA GCATCTTACA 300 GAAACTCCCA GAGGACACAC ACTCAACCAA GCTACTGGCC ATGAAAAATG ATCTGGAAAA 53756 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAAACTCCCA GAGGACACAC ACTCAACCAA GCTACTGGCC ATGAAAAATG ATCTGGAAAA 360 TTAAGGTGGC CTGTTTTACT TGGCTATTAG CAAAACAGGT TGTTCTCACA CAGGATAACC 53696 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTAAGGTGGC CTGTTTTACT TGGCTATTAG CAAAACAGGT TGTTCTCACA CAGGATAACC 420 GTATGAAGAA GGGCCTCCAT TTGTGCTGTA GATGTTTTTT TGTGAATGTG AGGCAGAGAC 53636 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTATGAAGAA GGGCCTCCAT TTGTGCTGTA GATGTTTTTT TGTGAATGTG AGGCAGAGAC 480 CATAAATGAT CTCTTTTTAC ACTGTAAGA 53607 |||||||||| |||||||||| ||||||||| CATAAATGAT CTCTTTTTAC ACTGTAAGA 509 hqPGS_C01HBa0088L02.1-_SGN-E209039- (54115 53607) ******************************************************************************** EST sequence 144 +strand 707 n (File: SGN-E378976+) 1 GGGTGGCGTG GCTTCCCCAC GAGCCTTCCT AGATCCTCCC CTGACCATAA ATGAGGTGCG 61 GTTATCAGTG AAGAAGACAA TTTAATGATA CAATGTTAAT TTAGTGAGGT GAGATCAAAG 121 AATATGTGAT GGCACCTGGA CTGGATGGTT TCACCATGAC ATTTTTCACC AATTGCTGGG 181 AAATAGTAAG CAAACTAGTG GCAGCAGTTC AGAACTTACA TAATCAGAAC ATTTTTGAAA 241 GAAGCTTCAA TGCCACCTTC ATAGCTTAAT AGGCAGCATA TGTAAGATCA TCTCAAAAGT 301 GTTTACTGAG AGGCTGAAAA GAAGTCGTTT CAAAACTAGT AGATACGCAT CCGATGGAAT 361 TTATTTAGGG TAGGGAGATC ATGGATGCTA TTGTGATTGC CAACGAATGT GTAGATGTGA 421 GGCAAATTAG CAAGGTCCTA GGCATTCTTT GTAAGATGGA TAGAGAGAAA GCCTATGACC 481 ACTTAAATTG GGGTTTCCTA TGGAAGAATT TGGAAAACAT GGGTTTTGGG GAAAGATGGA 541 TAAACTGGAT CAAATCTTGC ACCAGTATAG TGAAATTTTC AGTTTTAATT AATGACTCTC 601 CCACAAGTTT CTTCTCATCT GAGAGAGGCC TGAGACAAAG GGGATCCATT ATCTCCTTCT 661 CTCTTTATCT GGGCAATGGA GGGTCTGAAT GATATAGTAA GAACAGC Predicted gene structure (within gDNA segment 56304 to 54262): Exon 1 55578 54872 ( 707 n); cDNA 1 707 ( 707 n); score: 0.997 MATCH C01HBa0088L02.1- SGN-E378976+ 0.997 707 1.000 C PGS_C01HBa0088L02.1-_SGN-E378976+ (55578 54872) Alignment (genomic DNA sequence = upper lines): GGGTGGCGTG GCACCCCCAC GAGCCTTCCT AGATCCTCCC CTGACCATAA ATGAGGTGCG 55519 |||||||||| || |||||| |||||||||| |||||||||| |||||||||| |||||||||| GGGTGGCGTG GCTTCCCCAC GAGCCTTCCT AGATCCTCCC CTGACCATAA ATGAGGTGCG 60 GTTATCAGTG AAGAAGACAA TTTAATGATA CAATGTTAAT TTAGTGAGGT GAGATCAAAG 55459 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTATCAGTG AAGAAGACAA TTTAATGATA CAATGTTAAT TTAGTGAGGT GAGATCAAAG 120 AATATGTGAT GGCACCTGGA CTGGATGGTT TCACCATGAC ATTTTTCACC AATTGCTGGG 55399 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AATATGTGAT GGCACCTGGA CTGGATGGTT TCACCATGAC ATTTTTCACC AATTGCTGGG 180 AAATAGTAAG CAAACTAGTG GCAGCAGTTC AGAACTTACA TAATCAGAAC ATTTTTGAAA 55339 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAATAGTAAG CAAACTAGTG GCAGCAGTTC AGAACTTACA TAATCAGAAC ATTTTTGAAA 240 GAAGCTTCAA TGCCACCTTC ATAGCTTAAT AGGCAGCATA TGTAAGATCA TCTCAAAAGT 55279 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAAGCTTCAA TGCCACCTTC ATAGCTTAAT AGGCAGCATA TGTAAGATCA TCTCAAAAGT 300 GTTTACTGAG AGGCTGAAAA GAAGTCGTTT CAAAACTAGT AGATACGCAT CCGATGGAAT 55219 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTTACTGAG AGGCTGAAAA GAAGTCGTTT CAAAACTAGT AGATACGCAT CCGATGGAAT 360 TTATTTAGGG TAGGGAGATC ATGGATGCTA TTGTGATTGC CAACGAATGT GTAGATGTGA 55159 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTATTTAGGG TAGGGAGATC ATGGATGCTA TTGTGATTGC CAACGAATGT GTAGATGTGA 420 GGCAAATTAG CAAGGTCCTA GGCATTCTTT GTAAGATGGA TAGAGAGAAA GCCTATGACC 55099 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGCAAATTAG CAAGGTCCTA GGCATTCTTT GTAAGATGGA TAGAGAGAAA GCCTATGACC 480 ACTTAAATTG GGGTTTCCTA TGGAAGAATT TGGAAAACAT GGGTTTTGGG GAAAGATGGA 55039 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACTTAAATTG GGGTTTCCTA TGGAAGAATT TGGAAAACAT GGGTTTTGGG GAAAGATGGA 540 TAAACTGGAT CAAATCTTGC ACCAGTATAG TGAAATTTTC AGTTTTAATT AATGACTCTC 54979 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAAACTGGAT CAAATCTTGC ACCAGTATAG TGAAATTTTC AGTTTTAATT AATGACTCTC 600 CCACAAGTTT CTTCTCATCT GAGAGAGGCC TGAGACAAAG GGGATCCATT ATCTCCTTCT 54919 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCACAAGTTT CTTCTCATCT GAGAGAGGCC TGAGACAAAG GGGATCCATT ATCTCCTTCT 660 CTCTTTATCT GGGCAATGGA GGGTCTGAAT GATATAGTAA GAACAGC 54872 |||||||||| |||||||||| |||||||||| |||||||||| ||||||| CTCTTTATCT GGGCAATGGA GGGTCTGAAT GATATAGTAA GAACAGC 707 hqPGS_C01HBa0088L02.1-_SGN-E378976+ (55578 54872) ******************************************************************************** EST sequence 232 +strand 533 n (File: SGN-E344267+) 1 TGCTTCGCGT AACATGACTT TTGAGTTCAA ACAAAAGGTG AGTGTGAACG ACAAGTTAGG 61 AAGGCCAGCT GTTACAGCTG TTGACAGTTC CAATATCTGG TGGGCACTGT TTGAAGAAGC 121 TATCATCAAA GCTAATGCCA GACTTGGAAA ACCAGAAATA TTTCCTGCAT CAACAGATGC 181 ACGCTATTTT CGAGAGCGAG GCCTGCCAGC AATAGGATTT TCTCCGATGG CAAACACTCC 241 CATTCTTCTT CACGACCACA ATGAGTTCTT GAACAAGGAT GAGTATCTGA AAGGTATTGA 301 TGTTTATGAA TCAATAATCA AAACATATGC ATCTTATATT CAGTATCAAA GAGATGATGC 361 TTCGAGAGAG GAATTGTGAG CAAGTTGTAT TGAAGCAACC TTGAGCTCGT CTTGTCTTGT 421 AGTATTGTAT ATATAAGTGA AGGCCGCAGA GCAGTTGGAA ATCTCTGCAA CATCTTTCTG 481 CTGTACGAAT AAACAACATG GATATTTCAT AATCATTGAA GAACAGTTCC ATG Predicted gene structure (within gDNA segment 61426 to 59116): Exon 1 60594 60355 ( 240 n); cDNA 26 265 ( 240 n); score: 1.000 Intron 1 60354 59994 ( 361 n); Pd: 1.000 (s: 1.00), Pa: 0.930 (s: 1.00) Exon 2 59993 59726 ( 268 n); cDNA 266 533 ( 268 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E344267+ 1.000 508 0.953 C PGS_C01HBa0088L02.1-_SGN-E344267+ (60594 60355,59993 59726) Alignment (genomic DNA sequence = upper lines): TTCAAACAAA AGGTGAGTGT GAACGACAAG TTAGGAAGGC CAGCTGTTAC AGCTGTTGAC 60535 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTCAAACAAA AGGTGAGTGT GAACGACAAG TTAGGAAGGC CAGCTGTTAC AGCTGTTGAC 85 AGTTCCAATA TCTGGTGGGC ACTGTTTGAA GAAGCTATCA TCAAAGCTAA TGCCAGACTT 60475 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTTCCAATA TCTGGTGGGC ACTGTTTGAA GAAGCTATCA TCAAAGCTAA TGCCAGACTT 145 GGAAAACCAG AAATATTTCC TGCATCAACA GATGCACGCT ATTTTCGAGA GCGAGGCCTG 60415 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGAAAACCAG AAATATTTCC TGCATCAACA GATGCACGCT ATTTTCGAGA GCGAGGCCTG 205 CCAGCAATAG GATTTTCTCC GATGGCAAAC ACTCCCATTC TTCTTCACGA CCACAATGAG 60355 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCAGCAATAG GATTTTCTCC GATGGCAAAC ACTCCCATTC TTCTTCACGA CCACAATGAG 265 GTGAGCATTA CTTAATATTC GCTTATTTGG TGCCACATGG TAGTTTTGTG TGTGCATACA 60295 .......... .......... .......... .......... .......... .......... 265 CCCAGAGTCT TCTAAACCTA TTAAATATAC TATTAATATG AGAAAATCAA AAGAATAAGT 60235 .......... .......... .......... .......... .......... .......... 265 TGAGAACTCC AAAAGAAAGG AAGCAGAGTG CAATGCTACA GCAATGGTTA CTGTTTACCG 60175 .......... .......... .......... .......... .......... .......... 265 GATCAACTGT TTGGTGAATA TAAGCAAACA CTTAGAGGAG GCTAAAGTCT TGCTTGACCG 60115 .......... .......... .......... .......... .......... .......... 265 TAGAAATGAT GTAAATTTGA TTCGACTTGT AAATTTTGTT CACTTGTTTA AATAGTTTTG 60055 .......... .......... .......... .......... .......... .......... 265 TTTTATGTGG TGGAAATCCT GACTTTGGCC TATGGTTAAT ATGCATTCTC TTTTGCTGCA 59995 .......... .......... .......... .......... .......... .......... 265 GTTCTTGAAC AAGGATGAGT ATCTGAAAGG TATTGATGTT TATGAATCAA TAATCAAAAC 59935 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .TTCTTGAAC AAGGATGAGT ATCTGAAAGG TATTGATGTT TATGAATCAA TAATCAAAAC 324 ATATGCATCT TATATTCAGT ATCAAAGAGA TGATGCTTCG AGAGAGGAAT TGTGAGCAAG 59875 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATATGCATCT TATATTCAGT ATCAAAGAGA TGATGCTTCG AGAGAGGAAT TGTGAGCAAG 384 TTGTATTGAA GCAACCTTGA GCTCGTCTTG TCTTGTAGTA TTGTATATAT AAGTGAAGGC 59815 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGTATTGAA GCAACCTTGA GCTCGTCTTG TCTTGTAGTA TTGTATATAT AAGTGAAGGC 444 CGCAGAGCAG TTGGAAATCT CTGCAACATC TTTCTGCTGT ACGAATAAAC AACATGGATA 59755 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CGCAGAGCAG TTGGAAATCT CTGCAACATC TTTCTGCTGT ACGAATAAAC AACATGGATA 504 TTTCATAATC ATTGAAGAAC AGTTCCATG 59726 |||||||||| |||||||||| ||||||||| TTTCATAATC ATTGAAGAAC AGTTCCATG 533 hqPGS_C01HBa0088L02.1-_SGN-E344267+ (60594 60355,59993 59726) ******************************************************************************** EST sequence 176 +strand 744 n (File: SGN-E342366+) 1 TTCGTTGAAG CTTGTTCTAT GTAGTATTTG TATTCTAAAT GTGCCTTAGA GTAATGCTTC 61 TCCACACATC TCTTATGGTT GATGAGTTCT GAGACAATTG ACTGCTTCAT TATGGTGCTT 121 TATGATGATG TTGCATCCTT TACAAAGGCT TGCAGAACCT TCAAATACTC CCTCTTTAAG 181 TTAACTTTCT ACTTATGAAG ATAGATCCAC TTCCATCCAG AAAGTAAATT GGAATTGTTT 241 AATATCTTTT TACTTTTGGT GTAAAGAAGT AGGTTTAGAG GAGATAGATC AGTTTGTAGA 301 TTTATTAAGA TCTCTGTAAG TATCTTCTTT TCTAGTTGTT TTTTTTTATC CAACACTTTT 361 TGATGATGTC CAGCATGTCC TTAATGCTGA GGAATACACA TTTACCAGTT TTTTGTTAAA 421 AAAGTTAGAC TTTCTTTTTG AGAAGTTTGT AAAGAAGTTG TGGTGAGGCA GCAGAGGACA 481 ATGATGGTGC ATGATGTTGT TCCACTACTT AAAGATTTCA AACACTCACG ATTTAACTCA 541 TTGTTTATCA GTAGTCTAAC GTGGTGGTAA GTTCTCTAAA GATCTTTAGA TGCCTTATAA 601 AAAAGGCTCT CTAAAGAACT TCCTGTTGTC GAAATGAAGA CAATTTGTGG AGTATGTAGC 661 TGTACAGCCA AGGACTTCTC AAGGGAAGAG TATTTCTTTT TCAGTTTTGT ATTGTTGGTA 721 GGATGAAACA AACATGAGTT TCAT Predicted gene structure (within gDNA segment 63972 to 56079): Exon 1 60930 60765 ( 166 n); cDNA 193 359 ( 167 n); score: 0.907 Intron 1 60764 59446 (1319 n); Pd: 0.000 (s: 0.87), Pa: 0.000 (s: 0) Exon 2 59445 59438 ( 8 n); cDNA 360 367 ( 8 n); score: 0.875 MATCH C01HBa0088L02.1- SGN-E342366+ 0.907 174 0.234 C PGS_C01HBa0088L02.1-_SGN-E342366+ (60930 60765,59445 59438) Alignment (genomic DNA sequence = upper lines): TTATGAAGAT AGATCCAATT CCATCTAGAA AGTTAAATGG AATTGTAAAA TATCTTTCTA 60871 |||||||||| ||||||| || ||||| |||| ||| || ||| |||||| || ||||||| || TTATGAAGAT AGATCCACTT CCATCCAGAA AGTAAATTGG AATTGTTTAA TATCTTTTTA 252 CTTTTGGTGT AAAGAAGTAG GTTTCGAGGA TATAGATCAG TTTGTAGATT TATTAAGATC 60811 |||||||||| |||||||||| |||| ||||| ||||||||| |||||||||| |||||||||| CTTTTGGTGT AAAGAAGTAG GTTTAGAGGA GATAGATCAG TTTGTAGATT TATTAAGATC 312 TCTGTAAGTA TCTTCTTTTC TATATG-TTT TTTTTATTGA ACACTTTGAA TTCTGTAGGT 60752 |||||||||| |||||||||| || || ||| ||||||| | ||||||| TCTGTAAGTA TCTTCTTTTC TAGTTGTTTT TTTTTATCCA ACACTTT... .......... 359 GGATAATAAT ACTCCCAAGT CATCTTTAGT TGTACTATTT GATAGAATTC CCACTGGTTA 60692 .......... .......... .......... .......... .......... .......... 359 TTGTTTAACT TCGTATCACC AGTCTATTTG AACAATATTT TGAAGTGCAA TACATTACTA 60632 .......... .......... .......... .......... .......... .......... 359 ATTTAAGAGA TTATACAATG CCCTTGCTCT TGGACAGTTC AAACAAAAGG TGAGTGTGAA 60572 .......... .......... .......... .......... .......... .......... 359 CGACAAGTTA GGAAGGCCAG CTGTTACAGC TGTTGACAGT TCCAATATCT GGTGGGCACT 60512 .......... .......... .......... .......... .......... .......... 359 GTTTGAAGAA GCTATCATCA AAGCTAATGC CAGACTTGGA AAACCAGAAA TATTTCCTGC 60452 .......... .......... .......... .......... .......... .......... 359 ATCAACAGAT GCACGCTATT TTCGAGAGCG AGGCCTGCCA GCAATAGGAT TTTCTCCGAT 60392 .......... .......... .......... .......... .......... .......... 359 GGCAAACACT CCCATTCTTC TTCACGACCA CAATGAGGTG AGCATTACTT AATATTCGCT 60332 .......... .......... .......... .......... .......... .......... 359 TATTTGGTGC CACATGGTAG TTTTGTGTGT GCATACACCC AGAGTCTTCT AAACCTATTA 60272 .......... .......... .......... .......... .......... .......... 359 AATATACTAT TAATATGAGA AAATCAAAAG AATAAGTTGA GAACTCCAAA AGAAAGGAAG 60212 .......... .......... .......... .......... .......... .......... 359 CAGAGTGCAA TGCTACAGCA ATGGTTACTG TTTACCGGAT CAACTGTTTG GTGAATATAA 60152 .......... .......... .......... .......... .......... .......... 359 GCAAACACTT AGAGGAGGCT AAAGTCTTGC TTGACCGTAG AAATGATGTA AATTTGATTC 60092 .......... .......... .......... .......... .......... .......... 359 GACTTGTAAA TTTTGTTCAC TTGTTTAAAT AGTTTTGTTT TATGTGGTGG AAATCCTGAC 60032 .......... .......... .......... .......... .......... .......... 359 TTTGGCCTAT GGTTAATATG CATTCTCTTT TGCTGCAGTT CTTGAACAAG GATGAGTATC 59972 .......... .......... .......... .......... .......... .......... 359 TGAAAGGTAT TGATGTTTAT GAATCAATAA TCAAAACATA TGCATCTTAT ATTCAGTATC 59912 .......... .......... .......... .......... .......... .......... 359 AAAGAGATGA TGCTTCGAGA GAGGAATTGT GAGCAAGTTG TATTGAAGCA ACCTTGAGCT 59852 .......... .......... .......... .......... .......... .......... 359 CGTCTTGTCT TGTAGTATTG TATATATAAG TGAAGGCCGC AGAGCAGTTG GAAATCTCTG 59792 .......... .......... .......... .......... .......... .......... 359 CAACATCTTT CTGCTGTACG AATAAACAAC ATGGATATTT CATAATCATT GAAGAACAGT 59732 .......... .......... .......... .......... .......... .......... 359 TCCATGTAAT ATGCAAGTAA TGACGAGAAA AAACATTGGG TAGGCAACAC ACACACACAC 59672 .......... .......... .......... .......... .......... .......... 359 ACACAGTTCT CCAAGCACAC AAACGCATCT TCAAAAACTA ACCAAAAAAT TTACTGAAAA 59612 .......... .......... .......... .......... .......... .......... 359 AGAGGTCAAA TCAGTTCTCC AAGCACACAA AAGCATCTTC AAAAACTAAC CAAAAAATTG 59552 .......... .......... .......... .......... .......... .......... 359 TTCCAATTTA TAACCAAACA TTATTTAGAT ATTTTTTCAA GGAAAGTATC TCTGTCCATA 59492 .......... .......... .......... .......... .......... .......... 359 AACCAGCACT TCATGTATGA CTATGCAACA CACACTTTGG TCTCAGTTGT TGAT 59438 ||| |||| .......... .......... .......... .......... ......TTGA TGAT 367 hqPGS_C01HBa0088L02.1-_SGN-E342366+ (60930 60765) ******************************************************************************** EST sequence 237 +strand 732 n (File: SGN-E333478+) 1 GCAAAGACCC TACCCTCCCT TCCATCCTCC TTAACTCACA TACCGATGTT GTCCCTTCCG 61 AGCATCACAA GTGGACTCAC CCACCTTTCT CTGCCCACTT AGATTCCACT ACCGGCAACA 121 TCTTCGCCCG AGGTTCTCAG GATATGAAAT GCGTCGGCTT GCAGTACCTC GAGGCCATTC 181 GCAAACTCAA ATCTTATGGC TTCCGCCCCC TGCGCACTCT CTACCTCTCC TTCCTCCCCG 241 ACGAGGAGAT CGGTGGAAAT GATGGTGCCA GAAAGTTTGT TGATTCAGAT GTCTTTGCCA 301 AGATGAATGT TGGGATTGTT CTTGACGAGG GCTTGGCCTC TCCCACTGAC AATTATCGTG 361 CATTCTATGG AGAGAGGTCC CCCTGGTGGC TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC 421 ATGGGGCTAA GCTCTATGAT AATACTGCCA TGGAGAATTT ACTTAAAAGT ATCGAAATTA 481 TAAGGAGATT CAGGGCAGCG CAGTTTGATC TAGTTAAGGC AGGACAGAAA GCTGAAGGCG 541 AAGTCATTTC TGTTAATATG GTCTTCTTGA AAGCTGGCAC CCCTTCACCC TCTGGTTTTG 601 TCATGAACCT GCAGCCATCT GAAGCCCAAG CAGGATTTGA CATCAGAGTA CCACCAACTG 661 CAGATCAGGC ATCCTTGGAG AGGCTAATAG CTGATGAATG GGCACCTGCT TCGCGNTACA 721 TGACTTTTGA GT Predicted gene structure (within gDNA segment 63628 to 61172): Exon 1 63028 62436 ( 593 n); cDNA 1 593 ( 593 n); score: 1.000 Intron 1 62435 62074 ( 362 n); Pd: 0.965 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 2 62073 61936 ( 138 n); cDNA 594 731 ( 138 n); score: 0.986 MATCH C01HBa0088L02.1- SGN-E333478+ 0.997 731 0.999 C PGS_C01HBa0088L02.1-_SGN-E333478+ (63028 62436,62073 61936) Alignment (genomic DNA sequence = upper lines): GCAAAGACCC TACCCTCCCT TCCATCCTCC TTAACTCACA TACCGATGTT GTCCCTTCCG 62969 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCAAAGACCC TACCCTCCCT TCCATCCTCC TTAACTCACA TACCGATGTT GTCCCTTCCG 60 AGCATCACAA GTGGACTCAC CCACCTTTCT CTGCCCACTT AGATTCCACT ACCGGCAACA 62909 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGCATCACAA GTGGACTCAC CCACCTTTCT CTGCCCACTT AGATTCCACT ACCGGCAACA 120 TCTTCGCCCG AGGTTCTCAG GATATGAAAT GCGTCGGCTT GCAGTACCTC GAGGCCATTC 62849 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCTTCGCCCG AGGTTCTCAG GATATGAAAT GCGTCGGCTT GCAGTACCTC GAGGCCATTC 180 GCAAACTCAA ATCTTATGGC TTCCGCCCCC TGCGCACTCT CTACCTCTCC TTCCTCCCCG 62789 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCAAACTCAA ATCTTATGGC TTCCGCCCCC TGCGCACTCT CTACCTCTCC TTCCTCCCCG 240 ACGAGGAGAT CGGTGGAAAT GATGGTGCCA GAAAGTTTGT TGATTCAGAT GTCTTTGCCA 62729 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACGAGGAGAT CGGTGGAAAT GATGGTGCCA GAAAGTTTGT TGATTCAGAT GTCTTTGCCA 300 AGATGAATGT TGGGATTGTT CTTGACGAGG GCTTGGCCTC TCCCACTGAC AATTATCGTG 62669 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGATGAATGT TGGGATTGTT CTTGACGAGG GCTTGGCCTC TCCCACTGAC AATTATCGTG 360 CATTCTATGG AGAGAGGTCC CCCTGGTGGC TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC 62609 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CATTCTATGG AGAGAGGTCC CCCTGGTGGC TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC 420 ATGGGGCTAA GCTCTATGAT AATACTGCCA TGGAGAATTT ACTTAAAAGT ATCGAAATTA 62549 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATGGGGCTAA GCTCTATGAT AATACTGCCA TGGAGAATTT ACTTAAAAGT ATCGAAATTA 480 TAAGGAGATT CAGGGCAGCG CAGTTTGATC TAGTTAAGGC AGGACAGAAA GCTGAAGGCG 62489 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAAGGAGATT CAGGGCAGCG CAGTTTGATC TAGTTAAGGC AGGACAGAAA GCTGAAGGCG 540 AAGTCATTTC TGTTAATATG GTCTTCTTGA AAGCTGGCAC CCCTTCACCC TCTGTAAGTC 62429 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||| AAGTCATTTC TGTTAATATG GTCTTCTTGA AAGCTGGCAC CCCTTCACCC TCT....... 593 AGTCTAGCTA TTTGACTCTG ACCACTGCTT CCTGCATATT GTGACCATTT TTCTTCTGAG 62369 .......... .......... .......... .......... .......... .......... 593 GAATTCTAGG AGTCTTTGAT TGAGCTTATT CATCCAATGT GCTGGGTTAT AACCTTAAAC 62309 .......... .......... .......... .......... .......... .......... 593 ACTATTTGAT AGTGTTTACC AATTATTCAG ATTAGAGTTT AAATGTTTGA AGAGCTTAAA 62249 .......... .......... .......... .......... .......... .......... 593 TGTTTCAGAA TTATTAATGT AGTCAAGTGA AAACGAATAT TTGAAGTGAT GGCGTAGCAG 62189 .......... .......... .......... .......... .......... .......... 593 ATATAGGGTG TTTTACCGAA CAATCCTTTC TTGTAAAACA ATGGCCCGTT TCCCTACACT 62129 .......... .......... .......... .......... .......... .......... 593 TAGAATCAGA ATTGAGATAA AGTTTAAAAC ATGGACTTCT TTATTTCTGT GGCAGGGTTT 62069 ||||| .......... .......... .......... .......... .......... .....GGTTT 598 TGTCATGAAC CTGCAGCCAT CTGAAGCCCA AGCAGGATTT GACATCAGAG TACCACCAAC 62009 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTCATGAAC CTGCAGCCAT CTGAAGCCCA AGCAGGATTT GACATCAGAG TACCACCAAC 658 TGCAGATCAG GCATCCTTGG AGAGGCTAAT AGCTGATGAA TGGGCACCTG CTTCGCGTAA 61949 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||| | TGCAGATCAG GCATCCTTGG AGAGGCTAAT AGCTGATGAA TGGGCACCTG CTTCGCGNTA 718 CATGACTTTT GAG 61936 |||||||||| ||| CATGACTTTT GAG 731 hqPGS_C01HBa0088L02.1-_SGN-E333478+ (63028 62436,62073 61936) ******************************************************************************** EST sequence 236 +strand 723 n (File: SGN-E333365+) 1 GCAAAGACCC TACCCTCCCT TCCATCCTCC TTAACTCACA TACCGATGTT GTCCCTTCCG 61 AGCATCACAA GTGGACTCAC CCACCTTTCT CTGCCCACTT AGATTCCACT ACCGGCAACA 121 TCTTCGCCCG AGGTTCTCAG GATATGAAAT GCGTCGGCTT GCAGTACCTC GAGGCCATTC 181 GCAAACTCAA ATCTTATGGC TTCCGCCCCC TGCGCACTCT CTACCTCTCC TTCCTCCCCG 241 ACGAGGAGAT CGGTGGAAAT GATGGTGCCA GAAAGTTTGT TGATTCAGAT GTCTTTGCCA 301 AGATGAATGT TGGGATTGTT CTTGACGAGG GCTTGGCCTC TCCCACTGAC AATTATCGTG 361 CATTCTATGG AGAGAGGTCC CCCTGGTGGC TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC 421 ATGGGGCTAA GCTCTATGAT AATACTGCCA TGGAGAATTT ACTTAAAAGT ATCGAAATTA 481 TAAGGAGATT CAGGGCAGCG CAGTTTGATC TAGTTAAGGC AGGACAGAAA GCTGAAGGCG 541 AAGTCATTTC TGTTAATATG GTCTTCTTGA AAGCTGGCAC CCCTTCACCC TCTGGTTTTG 601 TCATGAACCT GCAGCCATCT GAAGCCCAAG CAGGATTTGA CATCAGAGTA CCACCAACTG 661 CAGATCAGGC ATCCTTGGAG AGGCTAATAG CTGATGAATG GGCACCTGCT TCGCGTACAT 721 GAC Predicted gene structure (within gDNA segment 63628 to 61280): Exon 1 63028 62436 ( 593 n); cDNA 1 593 ( 593 n); score: 1.000 Intron 1 62435 62074 ( 362 n); Pd: 0.965 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 2 62073 61943 ( 131 n); cDNA 594 723 ( 130 n); score: 0.992 MATCH C01HBa0088L02.1- SGN-E333365+ 0.999 724 1.001 C PGS_C01HBa0088L02.1-_SGN-E333365+ (63028 62436,62073 61943) Alignment (genomic DNA sequence = upper lines): GCAAAGACCC TACCCTCCCT TCCATCCTCC TTAACTCACA TACCGATGTT GTCCCTTCCG 62969 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCAAAGACCC TACCCTCCCT TCCATCCTCC TTAACTCACA TACCGATGTT GTCCCTTCCG 60 AGCATCACAA GTGGACTCAC CCACCTTTCT CTGCCCACTT AGATTCCACT ACCGGCAACA 62909 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGCATCACAA GTGGACTCAC CCACCTTTCT CTGCCCACTT AGATTCCACT ACCGGCAACA 120 TCTTCGCCCG AGGTTCTCAG GATATGAAAT GCGTCGGCTT GCAGTACCTC GAGGCCATTC 62849 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCTTCGCCCG AGGTTCTCAG GATATGAAAT GCGTCGGCTT GCAGTACCTC GAGGCCATTC 180 GCAAACTCAA ATCTTATGGC TTCCGCCCCC TGCGCACTCT CTACCTCTCC TTCCTCCCCG 62789 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCAAACTCAA ATCTTATGGC TTCCGCCCCC TGCGCACTCT CTACCTCTCC TTCCTCCCCG 240 ACGAGGAGAT CGGTGGAAAT GATGGTGCCA GAAAGTTTGT TGATTCAGAT GTCTTTGCCA 62729 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACGAGGAGAT CGGTGGAAAT GATGGTGCCA GAAAGTTTGT TGATTCAGAT GTCTTTGCCA 300 AGATGAATGT TGGGATTGTT CTTGACGAGG GCTTGGCCTC TCCCACTGAC AATTATCGTG 62669 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGATGAATGT TGGGATTGTT CTTGACGAGG GCTTGGCCTC TCCCACTGAC AATTATCGTG 360 CATTCTATGG AGAGAGGTCC CCCTGGTGGC TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC 62609 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CATTCTATGG AGAGAGGTCC CCCTGGTGGC TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC 420 ATGGGGCTAA GCTCTATGAT AATACTGCCA TGGAGAATTT ACTTAAAAGT ATCGAAATTA 62549 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATGGGGCTAA GCTCTATGAT AATACTGCCA TGGAGAATTT ACTTAAAAGT ATCGAAATTA 480 TAAGGAGATT CAGGGCAGCG CAGTTTGATC TAGTTAAGGC AGGACAGAAA GCTGAAGGCG 62489 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAAGGAGATT CAGGGCAGCG CAGTTTGATC TAGTTAAGGC AGGACAGAAA GCTGAAGGCG 540 AAGTCATTTC TGTTAATATG GTCTTCTTGA AAGCTGGCAC CCCTTCACCC TCTGTAAGTC 62429 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||| AAGTCATTTC TGTTAATATG GTCTTCTTGA AAGCTGGCAC CCCTTCACCC TCT....... 593 AGTCTAGCTA TTTGACTCTG ACCACTGCTT CCTGCATATT GTGACCATTT TTCTTCTGAG 62369 .......... .......... .......... .......... .......... .......... 593 GAATTCTAGG AGTCTTTGAT TGAGCTTATT CATCCAATGT GCTGGGTTAT AACCTTAAAC 62309 .......... .......... .......... .......... .......... .......... 593 ACTATTTGAT AGTGTTTACC AATTATTCAG ATTAGAGTTT AAATGTTTGA AGAGCTTAAA 62249 .......... .......... .......... .......... .......... .......... 593 TGTTTCAGAA TTATTAATGT AGTCAAGTGA AAACGAATAT TTGAAGTGAT GGCGTAGCAG 62189 .......... .......... .......... .......... .......... .......... 593 ATATAGGGTG TTTTACCGAA CAATCCTTTC TTGTAAAACA ATGGCCCGTT TCCCTACACT 62129 .......... .......... .......... .......... .......... .......... 593 TAGAATCAGA ATTGAGATAA AGTTTAAAAC ATGGACTTCT TTATTTCTGT GGCAGGGTTT 62069 ||||| .......... .......... .......... .......... .......... .....GGTTT 598 TGTCATGAAC CTGCAGCCAT CTGAAGCCCA AGCAGGATTT GACATCAGAG TACCACCAAC 62009 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTCATGAAC CTGCAGCCAT CTGAAGCCCA AGCAGGATTT GACATCAGAG TACCACCAAC 658 TGCAGATCAG GCATCCTTGG AGAGGCTAAT AGCTGATGAA TGGGCACCTG CTTCGCGTAA 61949 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||| | TGCAGATCAG GCATCCTTGG AGAGGCTAAT AGCTGATGAA TGGGCACCTG CTTCGCGT-A 717 CATGAC 61943 |||||| CATGAC 723 hqPGS_C01HBa0088L02.1-_SGN-E333365+ (63028 62436,62073 61943) ******************************************************************************** EST sequence 192 +strand 557 n (File: SGN-E305912+) 1 TTAACTCACA TACCGATGTT GTCCCTTCCG AGCATCACAA GTGGACTCAC CCACCTTTCT 61 CTGCCCACTT AGATTCCACT ACCGGCAACA TCTTCGCCCG AGGTTCTCAG GATATGAAAT 121 GCGTCGGCTT GCAGTACCTC GAGGCCATTC GCAAACTCAA ATCTTATGGC TTCCGCCCCC 181 TGCGCACTCT CTACCTCTCC TTCCTCCCCG ACGAGGAGAT CGGTGGAAAT GATGGTGCCA 241 GAAAGTTTGT TGATTCAGAT GTCTTTGCCA AGATGAATGT TGGGATTGTT CTTGACGAGG 301 GCTTGGCCTC TCCCACTGAC AATTATCGTG CATTCTATGG AGAGAGGTCC CCCTGGTGGC 361 TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC ATGGGGCTAA GCTCTATGAT AATACTGCCA 421 TGGAGAATTT ACTTAAAAGT ATCGAAATTA TAAGGAGATT CAGGGCAGCG CAGTTTGATC 481 TAGTTAAGGC AGGACAGAAA GCTGAAGGCG AAGTCATTTC TGTTAATATG GTCTTCTTGA 541 AAGCTGGCAC CCCTTCA Predicted gene structure (within gDNA segment 63598 to 61832): Exon 1 62998 62442 ( 557 n); cDNA 1 557 ( 557 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E305912+ 1.000 557 1.000 C PGS_C01HBa0088L02.1-_SGN-E305912+ (62998 62442) Alignment (genomic DNA sequence = upper lines): TTAACTCACA TACCGATGTT GTCCCTTCCG AGCATCACAA GTGGACTCAC CCACCTTTCT 62939 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTAACTCACA TACCGATGTT GTCCCTTCCG AGCATCACAA GTGGACTCAC CCACCTTTCT 60 CTGCCCACTT AGATTCCACT ACCGGCAACA TCTTCGCCCG AGGTTCTCAG GATATGAAAT 62879 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTGCCCACTT AGATTCCACT ACCGGCAACA TCTTCGCCCG AGGTTCTCAG GATATGAAAT 120 GCGTCGGCTT GCAGTACCTC GAGGCCATTC GCAAACTCAA ATCTTATGGC TTCCGCCCCC 62819 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCGTCGGCTT GCAGTACCTC GAGGCCATTC GCAAACTCAA ATCTTATGGC TTCCGCCCCC 180 TGCGCACTCT CTACCTCTCC TTCCTCCCCG ACGAGGAGAT CGGTGGAAAT GATGGTGCCA 62759 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGCGCACTCT CTACCTCTCC TTCCTCCCCG ACGAGGAGAT CGGTGGAAAT GATGGTGCCA 240 GAAAGTTTGT TGATTCAGAT GTCTTTGCCA AGATGAATGT TGGGATTGTT CTTGACGAGG 62699 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAAAGTTTGT TGATTCAGAT GTCTTTGCCA AGATGAATGT TGGGATTGTT CTTGACGAGG 300 GCTTGGCCTC TCCCACTGAC AATTATCGTG CATTCTATGG AGAGAGGTCC CCCTGGTGGC 62639 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCTTGGCCTC TCCCACTGAC AATTATCGTG CATTCTATGG AGAGAGGTCC CCCTGGTGGC 360 TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC ATGGGGCTAA GCTCTATGAT AATACTGCCA 62579 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGTCGTTAA GGCTGTAGGT GCTCCTGGAC ATGGGGCTAA GCTCTATGAT AATACTGCCA 420 TGGAGAATTT ACTTAAAAGT ATCGAAATTA TAAGGAGATT CAGGGCAGCG CAGTTTGATC 62519 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGAGAATTT ACTTAAAAGT ATCGAAATTA TAAGGAGATT CAGGGCAGCG CAGTTTGATC 480 TAGTTAAGGC AGGACAGAAA GCTGAAGGCG AAGTCATTTC TGTTAATATG GTCTTCTTGA 62459 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TAGTTAAGGC AGGACAGAAA GCTGAAGGCG AAGTCATTTC TGTTAATATG GTCTTCTTGA 540 AAGCTGGCAC CCCTTCA 62442 |||||||||| ||||||| AAGCTGGCAC CCCTTCA 557 hqPGS_C01HBa0088L02.1-_SGN-E305912+ (62998 62442) ******************************************************************************** EST sequence 193 +strand 482 n (File: SGN-E318831+) 1 GAGGCTCACA TACCGATGTT GTCCCTTCCG AGCATCACAA GTGGACTCAC CCACCTTTCT 61 CTGCCCACTT AGATTCCACT ACCGGCAACC ATCTTCGCCC GAGGTTCTCA GGATATGAAA 121 TGCGTCGGCT TGCAGTACCT CGAGGCCATT CGCAAACTCA AATCTTATGG CTTCCGCCCC 181 CTGCGCACTC TCTACCTCTC CTTCCTCCCC GACGAGGAGA TCGGTGGAAA TGATGGTGCC 241 AGAAAGTTTG TTGATTCAGA TGTCTTTGCC AAGATGAATG TTGGGATTGT TCTTGACGAG 301 GGCTTGGCCT CTCCCACTGA CAATTATCGT GCATTCTATG GAGAGAGGTC CCCCTGGTGG 361 CTGGTCGTTA AAGCTGTAGG TGCTCCTGGA CATGGGGCTA AGCTCTATGA TAATACTGCC 421 ATGGAGAATT TACTTAAAAG TATCGAAATT ATAAGGAGAT TCAAGGCAGC GCAGTTTGAT 481 CT Predicted gene structure (within gDNA segment 63634 to 61908): Exon 1 62994 62518 ( 477 n); cDNA 5 482 ( 478 n); score: 0.991 MATCH C01HBa0088L02.1- SGN-E318831+ 0.991 477 0.990 C PGS_C01HBa0088L02.1-_SGN-E318831+ (62994 62518) Alignment (genomic DNA sequence = upper lines): CTCACATACC GATGTTGTCC CTTCCGAGCA TCACAAGTGG ACTCACCCAC CTTTCTCTGC 62935 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCACATACC GATGTTGTCC CTTCCGAGCA TCACAAGTGG ACTCACCCAC CTTTCTCTGC 64 CCACTTAGAT TCCACTACCG GCAA-CATCT TCGCCCGAGG TTCTCAGGAT ATGAAATGCG 62876 |||||||||| |||||||||| |||| ||||| |||||||||| |||||||||| |||||||||| CCACTTAGAT TCCACTACCG GCAACCATCT TCGCCCGAGG TTCTCAGGAT ATGAAATGCG 124 TCGGCTTGCA GTACCTCGAG GCCATTCGCA AACTCAAATC TTATGGCTTC CGCCCCCTGC 62816 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCGGCTTGCA GTACCTCGAG GCCATTCGCA AACTCAAATC TTATGGCTTC CGCCCCCTGC 184 GCACTCTCTA CCTCTCCTTC CTCCCCGACG AGGAGATCGG TGGAAATGAT GGTGCCAGAA 62756 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCACTCTCTA CCTCTCCTTC CTCCCCGACG AGGAGATCGG TGGAAATGAT GGTGCCAGAA 244 AGTTTGTTGA TTCAGATGTC TTTGCCAAGA TGAATGTTGG GATTGTTCTT GACGAGGGCT 62696 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTTTGTTGA TTCAGATGTC TTTGCCAAGA TGAATGTTGG GATTGTTCTT GACGAGGGCT 304 TGGCCTCTCC CACTGACAAT TATCGTGCAT TCTATGGAGA GAGGTCCCCC TGGTGGCTGG 62636 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGCCTCTCC CACTGACAAT TATCGTGCAT TCTATGGAGA GAGGTCCCCC TGGTGGCTGG 364 TCGTTAAGGC TGTAGGTGCT CCTGGACATG GGGCTAAGCT CTATGATAAT ACTGCCATGG 62576 ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCGTTAAAGC TGTAGGTGCT CCTGGACATG GGGCTAAGCT CTATGATAAT ACTGCCATGG 424 AGAATTTACT TAAAAGTATC GAAATTATAA GGAGATTCAG GGCAGCGCAG TTTGATCT 62518 |||||||||| |||||||||| |||||||||| ||||||||| |||||||||| |||||||| AGAATTTACT TAAAAGTATC GAAATTATAA GGAGATTCAA GGCAGCGCAG TTTGATCT 482 hqPGS_C01HBa0088L02.1-_SGN-E318831+ (62994 62518) ******************************************************************************** EST sequence 265 +strand 502 n (File: SGN-E302876+) 1 AACCTGTTCT ATTGATTTTA ATTCATCTGG AGTGAAAAGC AGTGATGAGC AAGACCGGCT 61 ATTATCTTGA TTTGCGTGTG TTTCTGGTCA CACTCATACT CATAATCACA ACTAGGACGG 121 CCGCTAAAGA TCCGTCAACA ATCCTATCAA GATTCCAGCA GTACCTTCAG ATCAATACAG 181 CCCAACCTCA CCCCAACTAC TATGAAGCTG CCGAATTTAT AATATCACAG GCCAAGTTAC 241 TATCCCTCGA GTCCCAGACC CTTGAGTTCG TCAAGGGCAA ACCTCTAATT CTCCTCAAAT 301 GGCCAGGCAA AGACCCTACC CTCCCTTCCA TCCTCCTTAA CTCACATACC GATGTTGTCC 361 CTTCCGAGCA TCACAAGTGG ACTCACCCAC CTTTCTCTGC CCACTTAGAT TCCACTACCG 421 GCAACATCTT CGCCCGAGGT TCTCAGGATA TGAAATGCGT CGGCTTGCAG TACCTCGAGG 481 CCATTCGCAA ACTCAAATCT TA Predicted gene structure (within gDNA segment 63934 to 62223): Exon 1 63334 62833 ( 502 n); cDNA 1 502 ( 502 n); score: 1.000 MATCH C01HBa0088L02.1- SGN-E302876+ 1.000 502 1.000 C PGS_C01HBa0088L02.1-_SGN-E302876+ (63334 62833) Alignment (genomic DNA sequence = upper lines): AACCTGTTCT ATTGATTTTA ATTCATCTGG AGTGAAAAGC AGTGATGAGC AAGACCGGCT 63275 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AACCTGTTCT ATTGATTTTA ATTCATCTGG AGTGAAAAGC AGTGATGAGC AAGACCGGCT 60 ATTATCTTGA TTTGCGTGTG TTTCTGGTCA CACTCATACT CATAATCACA ACTAGGACGG 63215 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATTATCTTGA TTTGCGTGTG TTTCTGGTCA CACTCATACT CATAATCACA ACTAGGACGG 120 CCGCTAAAGA TCCGTCAACA ATCCTATCAA GATTCCAGCA GTACCTTCAG ATCAATACAG 63155 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCGCTAAAGA TCCGTCAACA ATCCTATCAA GATTCCAGCA GTACCTTCAG ATCAATACAG 180 CCCAACCTCA CCCCAACTAC TATGAAGCTG CCGAATTTAT AATATCACAG GCCAAGTTAC 63095 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCCAACCTCA CCCCAACTAC TATGAAGCTG CCGAATTTAT AATATCACAG GCCAAGTTAC 240 TATCCCTCGA GTCCCAGACC CTTGAGTTCG TCAAGGGCAA ACCTCTAATT CTCCTCAAAT 63035 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TATCCCTCGA GTCCCAGACC CTTGAGTTCG TCAAGGGCAA ACCTCTAATT CTCCTCAAAT 300 GGCCAGGCAA AGACCCTACC CTCCCTTCCA TCCTCCTTAA CTCACATACC GATGTTGTCC 62975 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGCCAGGCAA AGACCCTACC CTCCCTTCCA TCCTCCTTAA CTCACATACC GATGTTGTCC 360 CTTCCGAGCA TCACAAGTGG ACTCACCCAC CTTTCTCTGC CCACTTAGAT TCCACTACCG 62915 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTTCCGAGCA TCACAAGTGG ACTCACCCAC CTTTCTCTGC CCACTTAGAT TCCACTACCG 420 GCAACATCTT CGCCCGAGGT TCTCAGGATA TGAAATGCGT CGGCTTGCAG TACCTCGAGG 62855 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCAACATCTT CGCCCGAGGT TCTCAGGATA TGAAATGCGT CGGCTTGCAG TACCTCGAGG 480 CCATTCGCAA ACTCAAATCT TA 62833 |||||||||| |||||||||| || CCATTCGCAA ACTCAAATCT TA 502 hqPGS_C01HBa0088L02.1-_SGN-E302876+ (63334 62833) ******************************************************************************** EST sequence 259 +strand 446 n (File: SGN-E301766+) 1 TTGATCGGCT CCTAACGAAA ATTTATAACC TGGGCTATTG ATTGTAATTC ATCTGGAGTG 61 AAAAGCAGTG ATGAGCAAGA CCGGCTATTA TCTTGATTAG CGTGTGTTTC TGGTCACACT 121 CATACTCATA ATCACAACTA GGACGGCCGC TAAAGATCCG TCAACAATCC TATCAAGATT 181 CCAGCAGTAC CTTCAGATCA ATACAGCCCA ACCTCACCCC AACTACTATG AAGCTGCCGA 241 ATTTATAATA TCACAGGCCA AGTTACTATC CCTCGAGTCC CAGACCCTTG AGTTCGTCAA 301 GGGCAAACCT CTAATTCTCC TCAAATGGCC AGGCAAAGAC CCTACCCTCC CTTCCATCCT 361 ACTTAACTCA CATACCGATG TTGTCCCTTC CGAGCATCAC AAGTGGACTC ACCCACCTTT 421 CTCTGCCCAC TTAGATTCCA CTACCG Predicted gene structure (within gDNA segment 64077 to 62305): Exon 1 63360 62915 ( 446 n); cDNA 1 446 ( 446 n); score: 0.987 MATCH C01HBa0088L02.1- SGN-E301766+ 0.987 446 1.000 C PGS_C01HBa0088L02.1-_SGN-E301766+ (63360 62915) Alignment (genomic DNA sequence = upper lines): TTGATCGGCT CCAAACGAAA ATTTATAACC TGTTCTATTG ATTTTAATTC ATCTGGAGTG 63301 |||||||||| || ||||||| |||||||||| || |||||| ||| |||||| |||||||||| TTGATCGGCT CCTAACGAAA ATTTATAACC TGGGCTATTG ATTGTAATTC ATCTGGAGTG 60 AAAAGCAGTG ATGAGCAAGA CCGGCTATTA TCTTGATTTG CGTGTGTTTC TGGTCACACT 63241 |||||||||| |||||||||| |||||||||| |||||||| | |||||||||| |||||||||| AAAAGCAGTG ATGAGCAAGA CCGGCTATTA TCTTGATTAG CGTGTGTTTC TGGTCACACT 120 CATACTCATA ATCACAACTA GGACGGCCGC TAAAGATCCG TCAACAATCC TATCAAGATT 63181 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CATACTCATA ATCACAACTA GGACGGCCGC TAAAGATCCG TCAACAATCC TATCAAGATT 180 CCAGCAGTAC CTTCAGATCA ATACAGCCCA ACCTCACCCC AACTACTATG AAGCTGCCGA 63121 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCAGCAGTAC CTTCAGATCA ATACAGCCCA ACCTCACCCC AACTACTATG AAGCTGCCGA 240 ATTTATAATA TCACAGGCCA AGTTACTATC CCTCGAGTCC CAGACCCTTG AGTTCGTCAA 63061 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATTTATAATA TCACAGGCCA AGTTACTATC CCTCGAGTCC CAGACCCTTG AGTTCGTCAA 300 GGGCAAACCT CTAATTCTCC TCAAATGGCC AGGCAAAGAC CCTACCCTCC CTTCCATCCT 63001 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGGCAAACCT CTAATTCTCC TCAAATGGCC AGGCAAAGAC CCTACCCTCC CTTCCATCCT 360 CCTTAACTCA CATACCGATG TTGTCCCTTC CGAGCATCAC AAGTGGACTC ACCCACCTTT 62941 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACTTAACTCA CATACCGATG TTGTCCCTTC CGAGCATCAC AAGTGGACTC ACCCACCTTT 420 CTCTGCCCAC TTAGATTCCA CTACCG 62915 |||||||||| |||||||||| |||||| CTCTGCCCAC TTAGATTCCA CTACCG 446 hqPGS_C01HBa0088L02.1-_SGN-E301766+ (63360 62915) ******************************************************************************** EST sequence 260 +strand 221 n (File: SGN-E248170+) 1 CTGGAGTGAA AAGCAGTGAT GAGCAAGACC GGCTATTATC TGGATTTGCG TGTGTTTCTG 61 GTCACACTCA TACTCATAAT CACAACTAGG ACGGCCGCTA AAGATCCGTC AACAATCCTA 121 TCAAGATTCC AGCAGTACCT TCAGATCAAT ACAGCCCAAC CTCACCCCAA CTACTATGAA 181 GCTGCCGAAT TTATAATATC ACAGGCCAAG TTACTATCCC T Predicted gene structure (within gDNA segment 63908 to 62478): Exon 1 63308 63088 ( 221 n); cDNA 1 221 ( 221 n); score: 0.995 MATCH C01HBa0088L02.1- SGN-E248170+ 0.995 221 1.000 C PGS_C01HBa0088L02.1-_SGN-E248170+ (63308 63088) Alignment (genomic DNA sequence = upper lines): CTGGAGTGAA AAGCAGTGAT GAGCAAGACC GGCTATTATC TTGATTTGCG TGTGTTTCTG 63249 |||||||||| |||||||||| |||||||||| |||||||||| | |||||||| |||||||||| CTGGAGTGAA AAGCAGTGAT GAGCAAGACC GGCTATTATC TGGATTTGCG TGTGTTTCTG 60 GTCACACTCA TACTCATAAT CACAACTAGG ACGGCCGCTA AAGATCCGTC AACAATCCTA 63189 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTCACACTCA TACTCATAAT CACAACTAGG ACGGCCGCTA AAGATCCGTC AACAATCCTA 120 TCAAGATTCC AGCAGTACCT TCAGATCAAT ACAGCCCAAC CTCACCCCAA CTACTATGAA 63129 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCAAGATTCC AGCAGTACCT TCAGATCAAT ACAGCCCAAC CTCACCCCAA CTACTATGAA 180 GCTGCCGAAT TTATAATATC ACAGGCCAAG TTACTATCCC T 63088 |||||||||| |||||||||| |||||||||| |||||||||| | GCTGCCGAAT TTATAATATC ACAGGCCAAG TTACTATCCC T 221 hqPGS_C01HBa0088L02.1-_SGN-E248170+ (63308 63088) ******************************************************************************** EST sequence 267 +strand 392 n (File: SGN-E222944+) 1 TTTTTTTTTT TTTTTATCTT CTAAGCAACT GAAAGAAATA ATTCATGAAG TATTACTTGT 61 ATATCGGCCA AAATAGCGCC AATACAAAGT TTGAACCAAA ACAGGAAAGA AACGCTAGTG 121 GAACATGCTC CGCTAGCTCA ACTCTAAAAC TACGCTAGAA TGTAAAACGG TAGCATCCTC 181 GAAAGCATGA GGACCTACCA AACTCCGGAT GAATACTGAT GTCCGGATTG CTGCAACAAC 241 GAACCTGTAG CTTTAGCGTC CACCTGTGCT TGCACCTATC TTCCCTTGAA CCCGAGTTTT 301 CTTTACCAAA TACCAAATAT CCTTTCGTCT ACGCCCTGGT TCATCACAAC TAAATTCATT 361 CCCTCTATAA CTTGATCACG ATTCCTCGTG CC Predicted gene structure (within gDNA segment 69008 to 65328): Exon 1 68130 68109 ( 22 n); cDNA 1 22 ( 22 n); score: 0.727 Intron 1 68108 67568 ( 541 n); Pd: 0.900 (s: 0), Pa: 0.000 (s: 0.90) Exon 2 67567 67323 ( 245 n); cDNA 23 267 ( 245 n); score: 0.918 MATCH C01HBa0088L02.1- SGN-E222944+ 0.918 267 0.681 C PGS_C01HBa0088L02.1-_SGN-E222944+ (68130 68109,67567 67323) Alignment (genomic DNA sequence = upper lines): TTTTTTTGCT CGTTTATCTA ATGTATCCAT ACTTGTACAG TTTGATACCC ACATATTGTA 68071 ||||||| | ||||||| | TTTTTTTTTT TTTTTATCTT CT........ .......... .......... .......... 22 TCTTTTTTGC TCGTTTGTAT AAAGTATCTA TATTTTTGCT TAACAAGAGT GTTGAAATGT 68011 .......... .......... .......... .......... .......... .......... 22 ATATACATTG GTTATTTAGT TTAATTTAAT TGTAAAATAC ACTAATGAGA AATTTAATTC 67951 .......... .......... .......... .......... .......... .......... 22 TATGGTCAAA TGTATATGTC AAATATAGGG GTGTATTCAA GGCAAATAGG TTGACGTCAA 67891 .......... .......... .......... .......... .......... .......... 22 AGGCATTATA GAATCAAAAG GTGAATAAAG GGTGTTTTTG TACGATATCC GATAGTTTAA 67831 .......... .......... .......... .......... .......... .......... 22 GGATATTTAA GGCTATTTCC CCGTTAATTT TAATTCCCTC ACAACTTTTT ATCATCATAA 67771 .......... .......... .......... .......... .......... .......... 22 TGTCACGAAC AGAATCTAGA CCCCAGACGA GAACGGCGTC GTTGACCTCT CAGAGGTCAC 67711 .......... .......... .......... .......... .......... .......... 22 AAACAAGCCT ACTTGCGTCA TTCTTACTTT ACATAGGTTA ATTTTAGCGG AAAATTTGAA 67651 .......... .......... .......... .......... .......... .......... 22 ATTTTTGATT CTTTAATCAT ACTTGCTAAA AATTCTTAAT ATTTCGTAAT CGTTCATCAT 67591 .......... .......... .......... .......... .......... .......... 22 CAACCATCTA ACATTTAAGA GATAAACAAC TGAAATAAAC AATTCATTAA GTATTAATTG 67531 || |||| ||||| ||| ||||||| || |||||| ||| .......... .......... ...AAGCAAC TGAAAGAAAT AATTCATGAA GTATTACTTG 59 TATATCGGCC AAAGTAGCAC CAATACAAAG TCTGAACCAA AACAGGAAAG AAACGCTAGT 67471 |||||||||| ||| |||| | |||||||||| | |||||||| |||||||||| |||||||||| TATATCGGCC AAAATAGCGC CAATACAAAG TTTGAACCAA AACAGGAAAG AAACGCTAGT 119 GGAACATGCT CCACTAGCTC AACTCTAAAA CTACGCTAGA ATGTAAAACA GTAGCATCTT 67411 |||||||||| || ||||||| |||||||||| |||||||||| ||||||||| |||||||| | GGAACATGCT CCGCTAGCTC AACTCTAAAA CTACGCTAGA ATGTAAAACG GTAGCATCCT 179 CGAAAGCATG AGGACCTACC AAACTCCGGA TGAATGTTAA CGTCCGAATA GCTGCAACAA 67351 |||||||||| |||||||||| |||||||||| ||||| | | ||||| || |||||||||| CGAAAGCATG AGGACCTACC AAACTCCGGA TGAATACTGA TGTCCGGATT GCTGCAACAA 239 CGAACCTGTA GCTCTACCGC CCACCTGT 67323 |||||||||| ||| || || |||||||| CGAACCTGTA GCTTTAGCGT CCACCTGT 267 hqPGS_C01HBa0088L02.1-_SGN-E222944+ (68130 68109,67567 67323) ******************************************************************************** EST sequence 21 -strand 687 n (File: SGN-E389994-) 1 TTAGTTCATT CGTCCAGTNG TGGTTGCACN TAAAATAGTA GAGTTTGTAT AGGGTTAGTA 61 CACACTTGTA CTAAGTATGG GTATATGCAA GCACACACCA AATGACATGC ATAAGAAAGA 121 ATAATTCTTT CCTAACAACA TGGTTTTGGG AAGTCAAGTT AGTGGACCTG CCAATTTGTG 181 ATTACGAAGG TTTCCAAATA TGGATTAGGA AAGTCAGTGA GCTTTCTAGA TTTAGAATAG 241 GAAAGTTATG CCATGAGAAT AACGTACATC ATCAGTTTTT AACATTTCCA CATAGCACAT 301 AACATTTACA CATAGCACAT ATGATATGGC ATAAAATACA ATTTGCATGT AGCACATCAC 361 TTCTTTAATA TCATTTATCA TATGCCATGA GACCTTTGAA TCATGGACTT AACATTAAGA 421 ATTCCCAGAA ATGAGGGCTC AACAAATGGG ACCTCAACTA GGGAGTCTTC ATTAGCAAAC 481 ACATAGCCTG CTTCTTTCAT TCATACGTAC TACATTTCAT TTCATTCATA GGCCAGTGTA 541 AACACAAACT ATACCTAGGA TGTAGTTTGA GACTTTCATT AGGTTCATTG TGCAATGACT 601 AAGAATGACC TAATGTCATT ACTTGAATCT AACTCACCTT GTGATTATCC TATCCAAACA 661 ACTTTGATAT CATTCATTTC ATTATGT Predicted gene structure (within gDNA segment 69040 to 64159): Exon 1 67134 66759 ( 376 n); cDNA 307 685 ( 379 n); score: 0.806 MATCH C01HBa0088L02.1- SGN-E389994- 0.806 376 0.547 C PGS_C01HBa0088L02.1-_SGN-E389994- (67134 66759) Alignment (genomic DNA sequence = upper lines): TACACACAAC ACATAACATC TT-CATATAG CAC-A-TAAC ATATAACACG TAGTTTCTTT 67078 |||||| | | ||||| || | |||| | || | | | || || ||| | |||||| TACACATAGC ACATATGATA TGGCATAAAA TACAATTTGC ATGTAGCACA TCACTTCTTT 366 CATATTATTC ATTCATATGC CATGAGACCT TGTTATCATG GACTTGACCT TAAGACTTCC 67018 |||| ||| | |||||||| |||||||||| | |||||| ||||| || | ||||| |||| AATATCATTT A-TCATATGC CATGAGACCT TTGAATCATG GACTTAACAT TAAGAATTCC 425 CA-AAATGAG GGCTCAACAT ATGGGACCTC AACTAGGGAG CCTTCTTTAG CAAACACGGA 66959 || ||||||| ||||||||| |||||||||| |||||||||| |||| |||| ||||||| | CAGAAATGAG GGCTCAACAA ATGGGACCTC AACTAGGGAG TCTTCATTAG CAAACACATA 485 GTCTGCTTCA TTCATTTATA CCGATTTCAT TTCAATTCAT TCATAGGTCA GTGCGAACAC 66899 | ||||||| |||||| ||| | | | ||| |||| ||||| ||||||| || ||| ||||| GCCTGCTTCT TTCATTCATA CGTACTACAT TTCATTTCAT TCATAGGCCA GTGTAAACAC 545 CAGCTATACC TAGGATGTAG TTTAAGACTT TCATCGGGTT TGTTGTGCAA TGATCAAGAA 66839 | ||||||| |||||||||| ||| |||||| |||| |||| |||||||| ||| ||||| AAACTATACC TAGGATGTAG TTTGAGACTT TCATTAGGTT CATTGTGCAA TGACTAAGAA 605 TAATCTAATG TCATTACCTG AATCTAGCTC ACCTCTTGAT TATCCTATCC TAACACCTTC 66779 | | |||||| ||||||| || |||||| ||| |||| |||| |||||||||| |||| ||| TGACCTAATG TCATTACTTG AATCTAACTC ACCTTGTGAT TATCCTATCC AAACAACTTT 665 GGTATCATTC ATTTCTTTAT 66759 | |||||||| ||||| |||| GATATCATTC ATTTCATTAT 685 hqPGS_C01HBa0088L02.1-_SGN-E389994- (67134 66759) ******************************************************************************** EST sequence 49 -strand 617 n (File: SGN-E235464-) 1 TACTAAGTAT GGGTATATGC AAGCACACAC CAATGACATG CATAAGAAAG AATAATTCTT 61 TCCTAACAAC ATGGTTTTTG GAAGTCAAGT TAGTGGACCT GCCAATTTGT GATTACGAAG 121 GTTTCCAAAT ATGGATTAGG AAAGTCAGTG AGCTTTCTAG ATTTAGAATA GGAAAGTTAT 181 GCCATGAGAA TAACGTACAT CATCAGTTTT TAACATTTCC ACATAGCACA TAACATTTAC 241 ACATAGCACA TATGATATGG CATAAAATAC AATTTGCATG TAGCACATCA CTTCTTTAAT 301 ATCATTTATC ATATGCCATG AGACCTTTGA ATCATGGACT TAACATTAAG AATTCCCAGA 361 AATGAGGGCT CAACAAATGG GACCTCAACT AGGGAGTCTT CATTAGCAAA CACATAGCCT 421 GCTTCTTTCA TTCATACGTA CTACATTTCA TTTCATTCAT AGGCCAGTGT AAACACAAAC 481 TATACCTAGG ATGTAGTTTG AGACTTTCAT TAGGTTCATT GTGCAATGAC TAAGAATGAC 541 CTAATGTCAT TACTTGAATC TAACTCACCT TGTGATTATC CTATCCAAAC AACTTTGATA 601 TCATTCATTT CATTATG Predicted gene structure (within gDNA segment 69086 to 64169): Exon 1 67134 66759 ( 376 n); cDNA 238 616 ( 379 n); score: 0.806 MATCH C01HBa0088L02.1- SGN-E235464- 0.806 376 0.609 C PGS_C01HBa0088L02.1-_SGN-E235464- (67134 66759) Alignment (genomic DNA sequence = upper lines): TACACACAAC ACATAACATC TT-CATATAG CAC-A-TAAC ATATAACACG TAGTTTCTTT 67078 |||||| | | ||||| || | |||| | || | | | || || ||| | |||||| TACACATAGC ACATATGATA TGGCATAAAA TACAATTTGC ATGTAGCACA TCACTTCTTT 297 CATATTATTC ATTCATATGC CATGAGACCT TGTTATCATG GACTTGACCT TAAGACTTCC 67018 |||| ||| | |||||||| |||||||||| | |||||| ||||| || | ||||| |||| AATATCATTT A-TCATATGC CATGAGACCT TTGAATCATG GACTTAACAT TAAGAATTCC 356 CA-AAATGAG GGCTCAACAT ATGGGACCTC AACTAGGGAG CCTTCTTTAG CAAACACGGA 66959 || ||||||| ||||||||| |||||||||| |||||||||| |||| |||| ||||||| | CAGAAATGAG GGCTCAACAA ATGGGACCTC AACTAGGGAG TCTTCATTAG CAAACACATA 416 GTCTGCTTCA TTCATTTATA CCGATTTCAT TTCAATTCAT TCATAGGTCA GTGCGAACAC 66899 | ||||||| |||||| ||| | | | ||| |||| ||||| ||||||| || ||| ||||| GCCTGCTTCT TTCATTCATA CGTACTACAT TTCATTTCAT TCATAGGCCA GTGTAAACAC 476 CAGCTATACC TAGGATGTAG TTTAAGACTT TCATCGGGTT TGTTGTGCAA TGATCAAGAA 66839 | ||||||| |||||||||| ||| |||||| |||| |||| |||||||| ||| ||||| AAACTATACC TAGGATGTAG TTTGAGACTT TCATTAGGTT CATTGTGCAA TGACTAAGAA 536 TAATCTAATG TCATTACCTG AATCTAGCTC ACCTCTTGAT TATCCTATCC TAACACCTTC 66779 | | |||||| ||||||| || |||||| ||| |||| |||| |||||||||| |||| ||| TGACCTAATG TCATTACTTG AATCTAACTC ACCTTGTGAT TATCCTATCC AAACAACTTT 596 GGTATCATTC ATTTCTTTAT 66759 | |||||||| ||||| |||| GATATCATTC ATTTCATTAT 616 hqPGS_C01HBa0088L02.1-_SGN-E235464- (67134 66759) ******************************************************************************** EST sequence 149 +strand 715 n (File: SGN-E389503+) 1 AATAGGAAGG AAACACTAGT GGAACATGAT CCACTACATC AACTCTAAAA CTAAGCTAGA 61 ATATAAAACA ACAGCATCCT CGAAATCATG AGGACCTACC AAAGCCGGTT GAATGCTAAA 121 CGTCCGAATA ACTGCAGCGA AGATCCTTTA GTTCATTCGT CCAGTTGTGG TTGCACCTAA 181 AATAGTAGAG TTTGTATAGG GTTAGTACAC ACTTGTACTA AGTATGGGTA TATGCAAGCA 241 CACACCAATG ACATGCATAA GAAAGAATAA TTCTTTCCTA ACAACATGGT TTTTGGAAGT 301 CAAGTTAGTG GACCTGCCAA TTTGTGATTA CGAAGGTTTC CAAATATGGA TTAGGAAAGT 361 CAGTGAGCTT TCTAGATTTA GAATAGGAAA GTTATGCCAT GAGAATAACG TACATCATCA 421 GTTTTTAACA TTTCCACATA GCACATAACA TTTACACATA GCACATATGA TATGGCATAA 481 AATACAATTT GCATGTAGCA CATCACTTCT TTAATATCAT TTATCATATG CCATGAGACC 541 TTTGAATCAT GGACTTAACA TTAAGAATTC CCAGAAATGA GGGCTCAACA AATGGGACCT 601 CAACTAGGGA GTCTTCATTA GCAAACACAT AGCCTGCTTC TTTCATTCAT ACGTACTACA 661 TTTCATTTCA TTCATAGGCC AGTGTAAACA CAAACTATAC CTAGGATGTA GTTTG Predicted gene structure (within gDNA segment 69900 to 65329): Exon 1 67490 67172 ( 319 n); cDNA 1 321 ( 321 n); score: 0.821 MATCH C01HBa0088L02.1- SGN-E389503+ 0.821 319 0.446 C PGS_C01HBa0088L02.1-_SGN-E389503+ (67490 67172) Alignment (genomic DNA sequence = upper lines): AACAGGAAAG AAACGCTAGT GGAACATGCT CCACTAGCTC AACTCTAAAA CTACGCTAGA 67431 || ||||| | |||| ||||| |||||||| | |||||| || |||||||||| ||| |||||| AATAGGAAGG AAACACTAGT GGAACATGAT CCACTACATC AACTCTAAAA CTAAGCTAGA 60 ATGTAAAACA GTAGCATCTT CGAAAGCATG AGGACCTACC AAACTCCGGA TGAATG-TTA 67372 || ||||||| |||||| | ||||| |||| |||||||||| ||| |||| |||||| | | ATATAAAACA ACAGCATCCT CGAAATCATG AGGACCTACC AAA-GCCGGT TGAATGCTAA 119 ACGTCCGAAT AGCTGCAACA ACGAACCTGT AGCTCTACCG CCCACCTGTG TCTGCACCT- 67313 |||||||||| | ||||| | | || ||| | || || || ||| |||| ||||||| ACGTCCGAAT AACTGCAGCG AAGATCCTTT AGTTCATTCG TCCAGTTGTG GTTGCACCTA 179 AAA-AGTAGA TGTTTGTATG GAATTAGTAC ACACTTGTAC TAAGTATGGG TATATGCAAG 67254 ||| |||||| |||||||| | ||||||| |||||||||| |||||||||| |||||||||| AAATAGTAGA -GTTTGTATA GGGTTAGTAC ACACTTGTAC TAAGTATGGG TATATGCAAG 238 CACACACCAG GGACATACAT GAGAAAGAAT CGCTCTTTCC TAACAACATG ATTTTTGGAA 67194 ||||||||| ||||| ||| ||||||||| ||||||| |||||||||| ||||||||| CACACACCAA TGACATGCAT AAGAAAGAAT AATTCTTTCC TAACAACATG GTTTTTGGAA 298 GTC-AGTCAG TGGACTTGCT TAT 67172 ||| ||| || ||||| ||| || GTCAAGTTAG TGGACCTGCC AAT 321 hqPGS_C01HBa0088L02.1-_SGN-E389503+ (67490 67172) ******************************************************************************** EST sequence 168 +strand 383 n (File: SGN-E217225+) 1 TTTTTTTTTT TTTTTTTTTT TTAAGCAACT GAAAGAAATA ATTCATTAAG TATTACTTGT 61 ATATCGGCCA AAATAGCGCC AATACAAAGT TTGAACCAAA ACAGGAAAGA AACGCTAGTG 121 GAACATGCTC CGCTAGCTCA ACTCTAAAAC TACGCTAGAA TGTAAAACGG TAGCATCCTC 181 GAAAGCATGA GGACCTACCA AACTCCGGAT GAATACTGAT GTCCGGATAG CTGCAACAAC 241 GAACCTGTAG CTCTAGCGTC CACCTGTGCT TGCACCTATC TTCCCTTGAA CCCGAGTTTT 301 CTTTACCAAA TACCAAATAT CCTTCCGTCT ACGCCCTGGT TCATCACAAC TAAATCCATC 361 CCCTCTATAA CTTGATCACG ATT Predicted gene structure (within gDNA segment 68540 to 65445): Exon 1 67568 67323 ( 246 n); cDNA 22 267 ( 246 n); score: 0.931 PPA cDNA 21 1 MATCH C01HBa0088L02.1- SGN-E217225+ 0.931 246 0.642 C PGS_C01HBa0088L02.1-_SGN-E217225+ (67568 67323) Alignment (genomic DNA sequence = upper lines): TAAACAACTG AAATAAACAA TTCATTAAGT ATTAATTGTA TATCGGCCAA AGTAGCACCA 67509 ||| |||||| ||| ||| || |||||||||| |||| ||||| |||||||||| | |||| ||| TAAGCAACTG AAAGAAATAA TTCATTAAGT ATTACTTGTA TATCGGCCAA AATAGCGCCA 81 ATACAAAGTC TGAACCAAAA CAGGAAAGAA ACGCTAGTGG AACATGCTCC ACTAGCTCAA 67449 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| ATACAAAGTT TGAACCAAAA CAGGAAAGAA ACGCTAGTGG AACATGCTCC GCTAGCTCAA 141 CTCTAAAACT ACGCTAGAAT GTAAAACAGT AGCATCTTCG AAAGCATGAG GACCTACCAA 67389 |||||||||| |||||||||| ||||||| || |||||| ||| |||||||||| |||||||||| CTCTAAAACT ACGCTAGAAT GTAAAACGGT AGCATCCTCG AAAGCATGAG GACCTACCAA 201 ACTCCGGATG AATGTTAACG TCCGAATAGC TGCAACAACG AACCTGTAGC TCTACCGCCC 67329 |||||||||| ||| | | | |||| ||||| |||||||||| |||||||||| |||| || || ACTCCGGATG AATACTGATG TCCGGATAGC TGCAACAACG AACCTGTAGC TCTAGCGTCC 261 ACCTGT 67323 |||||| ACCTGT 267 hqPGS_C01HBa0088L02.1-_SGN-E217225+ (67568 67323) ******************************************************************************** EST sequence 269 +strand 289 n (File: SGN-E223449+) 1 TTTTTTTTTT TTTTTTTTTT TTAAGCAACT GAAAGAAATA ATTCATTAAG TATTACTTGT 61 ATATCGGCCA AAATAGCGCC AATACAAAGT TTGAACCAAA ACAGGAAAGA AACGCTAGTG 121 GAACATGCTC CGCTAGCTCA ACTCTAAAAC TACGCTAGAA TGTAAAACGG TAGCATCCTC 181 GAAAGCATGA GGACCTACCA AACTCCGGAT GAATACTGAT GTCCGGATAG CTGCAACAAC 241 GAACCTGTAG CTTTAGCGTC CACCTGTGCT TGCACCTATC TTCCCTTGA Predicted gene structure (within gDNA segment 68540 to 66358): Exon 1 67568 67323 ( 246 n); cDNA 22 267 ( 246 n); score: 0.927 PPA cDNA 21 1 MATCH C01HBa0088L02.1- SGN-E223449+ 0.927 246 0.851 C PGS_C01HBa0088L02.1-_SGN-E223449+ (67568 67323) Alignment (genomic DNA sequence = upper lines): TAAACAACTG AAATAAACAA TTCATTAAGT ATTAATTGTA TATCGGCCAA AGTAGCACCA 67509 ||| |||||| ||| ||| || |||||||||| |||| ||||| |||||||||| | |||| ||| TAAGCAACTG AAAGAAATAA TTCATTAAGT ATTACTTGTA TATCGGCCAA AATAGCGCCA 81 ATACAAAGTC TGAACCAAAA CAGGAAAGAA ACGCTAGTGG AACATGCTCC ACTAGCTCAA 67449 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| ATACAAAGTT TGAACCAAAA CAGGAAAGAA ACGCTAGTGG AACATGCTCC GCTAGCTCAA 141 CTCTAAAACT ACGCTAGAAT GTAAAACAGT AGCATCTTCG AAAGCATGAG GACCTACCAA 67389 |||||||||| |||||||||| ||||||| || |||||| ||| |||||||||| |||||||||| CTCTAAAACT ACGCTAGAAT GTAAAACGGT AGCATCCTCG AAAGCATGAG GACCTACCAA 201 ACTCCGGATG AATGTTAACG TCCGAATAGC TGCAACAACG AACCTGTAGC TCTACCGCCC 67329 |||||||||| ||| | | | |||| ||||| |||||||||| |||||||||| | || || || ACTCCGGATG AATACTGATG TCCGGATAGC TGCAACAACG AACCTGTAGC TTTAGCGTCC 261 ACCTGT 67323 |||||| ACCTGT 267 hqPGS_C01HBa0088L02.1-_SGN-E223449+ (67568 67323) ******************************************************************************** EST sequence 101 -strand 806 n (File: SGN-E546254-) 1 GTGGGAAGAA TCTCGGGCTG ATAGCATTCG CGCTCTCCTT ATCCGGCCAC AATATACTAA 61 AGCTCTTTAT CGAAAAGCTG CCTCAAGTAT CAAGCTGGAA AGATGGGCTG ATGCTGTGAG 121 CGATTATGAG TTTCTGCGGC AGCAACTTCC AAGTAACAAA GTGGTTGCTG AAAATTTATC 181 CCATGCCCGA GCTGAATTAA GGAAGTCACG CAGAAAAGGT AATTTCATGG TGGAGTTGAT 241 TTCAGATCTT GACAAGTTCC GGGCTGCGAT TGCATCTGGT CAATCTGTGG TCTATTTTGA 301 TGAATTATCC AACCCAGAAA GCACGTGGAT GTCCTATATC ATGGATACCT TGAACGCCGA 361 ATATCCTTCA GTAACTTTTC TCGAGGTGGA CGTGAAACAG AGTCCAGCGA TCGCTACAGC 421 AGAGAAAATT AAAGTAGCAC CTAGGATTAA GCTTTACAAC AATGGCAGTC GTGTGGCGGA 481 AACGGTTGTG CTAACTCCAG ATTCGTTGGA GTTATTAATT AAGAACACCC TCGTATGTCC 541 CCCCGGATGG TTTGGTGTTA CCTCTGTCAC GACCGGAATC TAGACCCCAG ACGAGACCGG 601 CGTCGTTGAC CTCTCAGAGG TCGCAGACAA GCCTACTTAC GTCATTCTTA CTTTACATAG 661 ATAAATTTTA GCGAAAAATT TGAATTTTTT TTTTTGATTC TTTAATCATA CTTGCTGAAT 721 ATTCTTAACA TTTCATAATC GTTCATCATC AACCATCTAA CATTTAAGAG ATAAAAAAAA 781 AAAAAAAAAA ACTCGAGGGG GGCCCG Predicted gene structure (within gDNA segment 74119 to 66655): Exon 1 71573 71562 ( 12 n); cDNA 566 576 ( 11 n); score: 0.750 Intron 1 71561 67759 (3803 n); Pd: 0.727 (s: 0), Pa: 0.658 (s: 0.94) Exon 2 67758 67546 ( 213 n); cDNA 577 794 ( 218 n); score: 0.852 MATCH C01HBa0088L02.1- SGN-E546254- 0.852 225 0.279 C PGS_C01HBa0088L02.1-_SGN-E546254- (71573 71562,67758 67546) Alignment (genomic DNA sequence = upper lines): GTCACGTACT AGGCAAGTTG CATGTATGTC ATGTCATGTC ACCTAGTCAC CTCTATCCAA 71514 |||||| || | GTCACG-ACC GG........ .......... .......... .......... .......... 576 TACTAGTGCT GACTATCTCT ACCTTAGAGG TGTGTATCAA TGGTTTGGTT CGATTTTATG 71454 .......... .......... .......... .......... .......... .......... 576 TATTATCGGA TTGGTTTATG GGTTTTTGAT TTTTAAATAC GTTAAACCAA TAACCAAACC 71394 .......... .......... .......... .......... .......... .......... 576 AATAAGAAAA AATTTATCGA ATTTCAATTC ATCGGTATTG GTCCTTTCGA TTTAACCAAT 71334 .......... .......... .......... .......... .......... .......... 576 AAGAGAACAC TTATAAAATA GATATATGAC TTCTCTAATA AATTTGACGC AACAACACAA 71274 .......... .......... .......... .......... .......... .......... 576 TAATGTAATG AAAAAACTAC ACAAAGTGTT AAACGAAGAG AAATTAAGAG GAATAAGGTT 71214 .......... .......... .......... .......... .......... .......... 576 CTTACTTTAG ATTTTGATGT TTTGTATAAT GTGAAGTTAT GAACTAAAAA TCACTTTGAA 71154 .......... .......... .......... .......... .......... .......... 576 GTATGAATTG AAGGCTAAAG GATAAAGTTA GTAACTACTG AGAAGCAGTT TTGACACATG 71094 .......... .......... .......... .......... .......... .......... 576 AAAATCTAAA GAAAAGAGGC TATTTTTTGG CTTCGAGATG TACTTTACGT GGAGAACATG 71034 .......... .......... .......... .......... .......... .......... 576 CTAAGACAAT TAACTATCTT TTTTTGCATT GTACATGGAC AAAACAATTA TGGAGGATGT 70974 .......... .......... .......... .......... .......... .......... 576 TCATCTGTCT AAAGGGGATA AGACAGTGTT TTTGCACACC CCTACTCTAC CTTTACCAAG 70914 .......... .......... .......... .......... .......... .......... 576 CCACTATATC CTACCTCTCA CATCTTGTTA CTAGGACCTC TAAGCATCTT CTTTTCACAT 70854 .......... .......... .......... .......... .......... .......... 576 GTATGAACCA TCTCAGTGTT GCCTTCCTCA TCTTCTCTGC CTTCTTCATC TTGTCCACTA 70794 .......... .......... .......... .......... .......... .......... 576 CAGGGTTCAA TCACATCTTG TCCACTACAG GGTTCAATCA CACCTTGTCC AGAATACACC 70734 .......... .......... .......... .......... .......... .......... 576 TCGTTCCTAA CCCCATCTCT TCTAGTATGC CCACACATCT ATCGCAGCAT TCTTATTTCC 70674 .......... .......... .......... .......... .......... .......... 576 ACTACTTTCA TATTTTAGAC ATACAAACTC TTGACTGGCC AACACACTGC CGCATACAAT 70614 .......... .......... .......... .......... .......... .......... 576 ATAGCTAGTC TAACCACCAC TTTATAGAAT TTACCTTTAA ATCTTGGTGG AACATTCTTA 70554 .......... .......... .......... .......... .......... .......... 576 TCACATAAGA CGCCCGATGC AAGCTCCATT TCATCCACCC CACTCCAATA CAATGTGTAG 70494 .......... .......... .......... .......... .......... .......... 576 CATATCTAAG TGCCACTTCA TATCCCCATA TTGCTCCACC AATCTCCTTA CGAGATGAAT 70434 .......... .......... .......... .......... .......... .......... 576 GGCCTTTTTA CTAGAAGGCC CTGGCATGAA TTCAAGGGTC CTCGGTAATA GACACACCCC 70374 .......... .......... .......... .......... .......... .......... 576 TCATCACCCT CTTCCAAATC TTCAAGCATG GCTTAGCAAC TTAATACCCT TATAGTTGTT 70314 .......... .......... .......... .......... .......... .......... 576 AGACCCTTCA TCCTATTTTA TGTGGCACCT TTTCCTTTTT CCTTTGTCCC AAAAAAACGT 70254 .......... .......... .......... .......... .......... .......... 576 CACTTTAATA TAATTAGAAA AAATAACTTT AAAATTTTTC TTTTGCCCTT GTAAAATGAT 70194 .......... .......... .......... .......... .......... .......... 576 TTAAAACCAA ACAAATATCT AAGAATTATT TTTAGACAAT AAGTTTCAAA AATCTTTTTT 70134 .......... .......... .......... .......... .......... .......... 576 TCTTAAACAC CATGTCAAAT TAAATGGTGT CACATAAAAT GAAACAGAGG GAGTACAATT 70074 .......... .......... .......... .......... .......... .......... 576 TTAAATATCA CCTTGTTCTT ATACAACGGG ACCATTGTAC AAACCTCCCT TCTATGAGTA 70014 .......... .......... .......... .......... .......... .......... 576 TTCTAGACAT CCTAAAATGG TATTATGCAA GCTGGTAAGC CACTCCACAA TGTCGATGCT 69954 .......... .......... .......... .......... .......... .......... 576 CTTCCAAACC TAAAAAGATA TGGCTGAACA AGCAAGGCTA AATGATGAAA TTTTCACCAA 69894 .......... .......... .......... .......... .......... .......... 576 CAAAATCAAT TAATGAATCG TTGTCTTCTT TGGTCATCCT AGTTTTGTCC CCTTTATTGA 69834 .......... .......... .......... .......... .......... .......... 576 TCAAATGTGG GTTTAGCATG TGTCCTACTT TGTATCGATA TAATAGTAGA TGTATGAACC 69774 .......... .......... .......... .......... .......... .......... 576 GCACTCGATT GGTCCAGAAG TGAAAGCAAT AACTATTTAA CTTTCTGATG AACTAAGCTT 69714 .......... .......... .......... .......... .......... .......... 576 CTATTAGTAG ATAAAAAGAT CCCATCAGAT AAAAACACGG AACTCTTCTA AATAAAACCA 69654 .......... .......... .......... .......... .......... .......... 576 AATTCAAGAA GAAAGCTATA AAGTCACTAA CTGACAAAAA CGAATTACTA AAACATCTCC 69594 .......... .......... .......... .......... .......... .......... 576 TTTTTTTTTT TAATAATATT GATGTTGATC TTATTGATCC CAACTTGTTC AAGACTAAGA 69534 .......... .......... .......... .......... .......... .......... 576 CATAGCTGTT GTTTACATAA TATTGCTGCT GATTTGGGGA TTAATAATAA TATTTTTGTA 69474 .......... .......... .......... .......... .......... .......... 576 TCTAGTATGG CTTATATTAG ATATAAGCTG AGGTCAAACC TTTAGTTCTG CGGAGCAAAA 69414 .......... .......... .......... .......... .......... .......... 576 TAAACTTGTC CATGCTTTTG GAGGTTTATA AGCTTGTATT CAGTTTTGAA CAAGGCTTTT 69354 .......... .......... .......... .......... .......... .......... 576 ATGCGTTCAA TTACGTCAAC TTTAGCATAT TCAATTAGCA CATAAAACAA AAATTAAGAG 69294 .......... .......... .......... .......... .......... .......... 576 TAGAATTTTG CAATTTAGCT ATAATAAAGA AATGGTGGTG ATTGATGGAA CCTTCGTCCC 69234 .......... .......... .......... .......... .......... .......... 576 AAGCAAGACC AAGCCAAGAA AGGTCACGAA GCACGGCCTC CTCGGACTCC CTTGTGGATC 69174 .......... .......... .......... .......... .......... .......... 576 TTTCCAGGTC TGTGTCTTCA ATCCGGAGTA CAAATTTCCC ACCTTTCGAC CTGTCATAGT 69114 .......... .......... .......... .......... .......... .......... 576 AACATAACTG TTAACAGAGA AAAACAACTA AACAGAAGTG CCATTAGCCG CCGTGTCAAT 69054 .......... .......... .......... .......... .......... .......... 576 GGTATTAATC AAGTATAGTC GTCAACTATG ATGAAGAAAT AAGTAAATTG GATGAAAAGA 68994 .......... .......... .......... .......... .......... .......... 576 CAAAGAATCG GGACGGACCG CGCATATAAG TAGTTAAAGA GTGCAGTTCT AGCGCCTCCC 68934 .......... .......... .......... .......... .......... .......... 576 ACATGGAGAT TACCGGTAGG AGACGGTGCA AAACGAACTC GGACAGCCCC TTCATCTCCT 68874 .......... .......... .......... .......... .......... .......... 576 GCTGAAGCAT AAATTGAGAA ACTTCTTCTC CGGAAACAGA GACTTTGCGG ATACCTGCGG 68814 .......... .......... .......... .......... .......... .......... 576 GGGCCGTTGC GACAATACAG TAGTGACTGG CGACTCTTTA ACTCCGGGAT CAACCTTGCT 68754 .......... .......... .......... .......... .......... .......... 576 CTAAACCACG GCGCCGCCGC CACCGTCGCC ATTCTTCGCT CAACTTCGAC GCAGCCGCCA 68694 .......... .......... .......... .......... .......... .......... 576 AAAGACAGAT TTCAAGCTTT CTATTCAATC TTCAATTCAA TGTCAGGATA ACGCTTTCGA 68634 .......... .......... .......... .......... .......... .......... 576 GACGCTTGGG AGTACGAATC CTTGTGCACT GCCTTTTTGG GTCTCGTCAA CCTTTAACCC 68574 .......... .......... .......... .......... .......... .......... 576 GACTACTTGG CCCGGCCCAA TCCGTCTGTA AGGCTGCAAA CCCGATTCTA AATTTTTGCA 68514 .......... .......... .......... .......... .......... .......... 576 AGCGGAATTA ACTACATATT TAAATAGAGT AAATTTTAGA AAAAATTCAG AATATGGCAA 68454 .......... .......... .......... .......... .......... .......... 576 ATACTTTTGA AAAATAGCTA TGTTTTATTT TTTTCATATT ATATAGATAT AATTAGACTA 68394 .......... .......... .......... .......... .......... .......... 576 TAAATAGCAA AGTTAATTCT ATGCAAATAA TTTCTTTATA TATTTAGTAT AATAAATAAA 68334 .......... .......... .......... .......... .......... .......... 576 TCTTAGATAG GAAAGTAATT ATAATTGAAT GTCTAAATAA TTATGGCATA CATTACATGT 68274 .......... .......... .......... .......... .......... .......... 576 TTTCTGCCAC CTCCCCTGAA TTCATTCATA TTCAAGATAC TTTACATAAC TGCAAGAGCG 68214 .......... .......... .......... .......... .......... .......... 576 ATTTTTGTGA TCTGTATCCA TCACGTACTT ATTAATTACA TATTTATCCC ATATTTATAC 68154 .......... .......... .......... .......... .......... .......... 576 AGTTTAATAC CCACAAATTG TATTTTTTTT GCTCGTTTAT CTAATGTATC CATACTTGTA 68094 .......... .......... .......... .......... .......... .......... 576 CAGTTTGATA CCCACATATT GTATCTTTTT TGCTCGTTTG TATAAAGTAT CTATATTTTT 68034 .......... .......... .......... .......... .......... .......... 576 GCTTAACAAG AGTGTTGAAA TGTATATACA TTGGTTATTT AGTTTAATTT AATTGTAAAA 67974 .......... .......... .......... .......... .......... .......... 576 TACACTAATG AGAAATTTAA TTCTATGGTC AAATGTATAT GTCAAATATA GGGGTGTATT 67914 .......... .......... .......... .......... .......... .......... 576 CAAGGCAAAT AGGTTGACGT CAAAGGCATT ATAGAATCAA AAGGTGAATA AAGGGTGTTT 67854 .......... .......... .......... .......... .......... .......... 576 TTGTACGATA TCCGATAGTT TAAGGATATT TAAGGCTATT TCCCCGTTAA TTTTAATTCC 67794 .......... .......... .......... .......... .......... .......... 576 CTCACAACTT TTTATCATCA TAATGTCACG AACAGAATCT AGACCCCAGA CGAGAACGGC 67734 ||||| |||||||||| ||||| |||| .......... .......... .......... .....AATCT AGACCCCAGA CGAGACCGGC 601 GTCGTTGACC TCTCAGAGGT CACAAACAAG CCTACTTGCG TCATTCTTAC TTTACATAGG 67674 |||||||||| |||||||||| | || ||||| ||||||| || |||||||||| ||||||||| GTCGTTGACC TCTCAGAGGT CGCAGACAAG CCTACTTACG TCATTCTTAC TTTACATAGA 661 TTAATTTTAG CGGAAAATTT GAA--A---T TTTTGATTCT TTAATCATAC TTGCTAAAAA 67619 | |||||||| || ||||||| ||| | |||||||||| |||||||||| ||||| || | TAAATTTTAG CGAAAAATTT GAATTTTTTT TTTTGATTCT TTAATCATAC TTGCTGAATA 721 TTCTTAATAT TTCGTAATCG TTCATCATCA ACCATCTAAC ATTTAAGAGA TAAACAACTG 67559 ||||||| || ||| |||||| |||||||||| |||||||||| |||||||||| |||| || TTCTTAACAT TTCATAATCG TTCATCATCA ACCATCTAAC ATTTAAGAGA TAAAAAAAAA 781 AAATAAACAA TTC 67546 ||| ||| || || AAAAAAAAAA CTC 794 hqPGS_C01HBa0088L02.1-_SGN-E546254- (67758 67546) ******************************************************************************** EST sequence 7 +strand 585 n (File: SGN-E284299+) 1 AAGCGTCTCG AAAGCGTTAT CCTGACATTG AATTGAAGAT TGAATAGAAA GCTTGAAATC 61 TGTCTTTTGG CGGCTGCGTC GAAGTTGAGC GAAGAATGGC GACGGTGGCG GCGGCGCCGT 121 GGTTTAGAGC AAGGTTGATC CCGGAGTTAA AGAGTCGCCA GTCACTACTG TATTGACGCA 181 ACGGCCCCCG CAGGTATCCG CAAAGTCTCT GTTTCCGGAG AAGAAGTTTC TCAATTTATG 241 CTTCAGCAGG AGATGAAGGG GCTGTCCGAG TTCGTTTTGC ACCGTCTCCT ACCGGTAATC 301 TCCATGTGGG AGGCGCTAGA ACTGCACTCT TTAACTACTT ATATGCGCGG TCGAAAGGTG 361 GGAAATTTGT ACTCCGGATT GAAGACACAG ACCTGGAAAG ATCCACAAGG GAGTCCGAGG 421 AGGCCGTGCT TCGTGACCTT TCTTGGCTTG GTCTTGCTTG GGACGAAGGT CCTGGAATTG 481 GTGGGAACTA TGGCCCATAC AGGCAGTCTG AGAGGAATGC CCTTTACAAG GAATTTGCTG 541 AAAAACTTTT ACAATCCGGT CATGTTTATC GATGTTTTTG CTCAA Predicted gene structure (within gDNA segment 68027 to 74677): Exon 1 68627 68975 ( 349 n); cDNA 1 349 ( 349 n); score: 0.997 Intron 1 68976 69123 ( 148 n); Pd: 0.986 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 2 69124 69242 ( 119 n); cDNA 350 468 ( 119 n); score: 1.000 Intron 2 69243 73950 (4708 n); Pd: 0.899 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 73951 74067 ( 117 n); cDNA 469 585 ( 117 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E284299+ 0.998 585 1.000 C PGS_C01HBa0088L02.1+_SGN-E284299+ (68627 68975,69124 69242,73951 74067) Alignment (genomic DNA sequence = upper lines): AAGCGTCTCG AAAGCGTTAT CCTGACATTG AATTGAAGAT TGAATAGAAA GCTTGAAATC 68686 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAGCGTCTCG AAAGCGTTAT CCTGACATTG AATTGAAGAT TGAATAGAAA GCTTGAAATC 60 TGTCTTTTGG CGGCTGCGTC GAAGTTGAGC GAAGAATGGC GACGGTGGCG GCGGCGCCGT 68746 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGTCTTTTGG CGGCTGCGTC GAAGTTGAGC GAAGAATGGC GACGGTGGCG GCGGCGCCGT 120 GGTTTAGAGC AAGGTTGATC CCGGAGTTAA AGAGTCGCCA GTCACTACTG TATTGTCGCA 68806 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||| |||| GGTTTAGAGC AAGGTTGATC CCGGAGTTAA AGAGTCGCCA GTCACTACTG TATTGACGCA 180 ACGGCCCCCG CAGGTATCCG CAAAGTCTCT GTTTCCGGAG AAGAAGTTTC TCAATTTATG 68866 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACGGCCCCCG CAGGTATCCG CAAAGTCTCT GTTTCCGGAG AAGAAGTTTC TCAATTTATG 240 CTTCAGCAGG AGATGAAGGG GCTGTCCGAG TTCGTTTTGC ACCGTCTCCT ACCGGTAATC 68926 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTTCAGCAGG AGATGAAGGG GCTGTCCGAG TTCGTTTTGC ACCGTCTCCT ACCGGTAATC 300 TCCATGTGGG AGGCGCTAGA ACTGCACTCT TTAACTACTT ATATGCGCGG TCCGTCCCGA 68986 |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| TCCATGTGGG AGGCGCTAGA ACTGCACTCT TTAACTACTT ATATGCGCG. .......... 349 TTCTTTGTCT TTTCATCCAA TTTACTTATT TCTTCATCAT AGTTGACGAC TATACTTGAT 69046 .......... .......... .......... .......... .......... .......... 349 TAATACCATT GACACGGCGG CTAATGGCAC TTCTGTTTAG TTGTTTTTCT CTGTTAACAG 69106 .......... .......... .......... .......... .......... .......... 349 TTATGTTACT ATGACAGGTC GAAAGGTGGG AAATTTGTAC TCCGGATTGA AGACACAGAC 69166 ||| |||||||||| |||||||||| |||||||||| |||||||||| .......... .......GTC GAAAGGTGGG AAATTTGTAC TCCGGATTGA AGACACAGAC 392 CTGGAAAGAT CCACAAGGGA GTCCGAGGAG GCCGTGCTTC GTGACCTTTC TTGGCTTGGT 69226 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTGGAAAGAT CCACAAGGGA GTCCGAGGAG GCCGTGCTTC GTGACCTTTC TTGGCTTGGT 452 CTTGCTTGGG ACGAAGGTTC CATCAATCAC CACCATTTCT TTATTATAGC TAAATTGCAA 69286 |||||||||| |||||| CTTGCTTGGG ACGAAG.... .......... .......... .......... .......... 468 AATTCTACTC TTAATTTTTG TTTTATGTGC TAATTGAATA TGCTAAAGTT GACGTAATTG 69346 .......... .......... .......... .......... .......... .......... 468 AACGCATAAA AGCCTTGTTC AAAACTGAAT ACAAGCTTAT AAACCTCCAA AAGCATGGAC 69406 .......... .......... .......... .......... .......... .......... 468 AAGTTTATTT TGCTCCGCAG AACTAAAGGT TTGACCTCAG CTTATATCTA ATATAAGCCA 69466 .......... .......... .......... .......... .......... .......... 468 TACTAGATAC AAAAATATTA TTATTAATCC CCAAATCAGC AGCAATATTA TGTAAACAAC 69526 .......... .......... .......... .......... .......... .......... 468 AGCTATGTCT TAGTCTTGAA CAAGTTGGGA TCAATAAGAT CAACATCAAT ATTATTAAAA 69586 .......... .......... .......... .......... .......... .......... 468 AAAAAAAGGA GATGTTTTAG TAATTCGTTT TTGTCAGTTA GTGACTTTAT AGCTTTCTTC 69646 .......... .......... .......... .......... .......... .......... 468 TTGAATTTGG TTTTATTTAG AAGAGTTCCG TGTTTTTATC TGATGGGATC TTTTTATCTA 69706 .......... .......... .......... .......... .......... .......... 468 CTAATAGAAG CTTAGTTCAT CAGAAAGTTA AATAGTTATT GCTTTCACTT CTGGACCAAT 69766 .......... .......... .......... .......... .......... .......... 468 CGAGTGCGGT TCATACATCT ACTATTATAT CGATACAAAG TAGGACACAT GCTAAACCCA 69826 .......... .......... .......... .......... .......... .......... 468 CATTTGATCA ATAAAGGGGA CAAAACTAGG ATGACCAAAG AAGACAACGA TTCATTAATT 69886 .......... .......... .......... .......... .......... .......... 468 GATTTTGTTG GTGAAAATTT CATCATTTAG CCTTGCTTGT TCAGCCATAT CTTTTTAGGT 69946 .......... .......... .......... .......... .......... .......... 468 TTGGAAGAGC ATCGACATTG TGGAGTGGCT TACCAGCTTG CATAATACCA TTTTAGGATG 70006 .......... .......... .......... .......... .......... .......... 468 TCTAGAATAC TCATAGAAGG GAGGTTTGTA CAATGGTCCC GTTGTATAAG AACAAGGTGA 70066 .......... .......... .......... .......... .......... .......... 468 TATTTAAAAT TGTACTCCCT CTGTTTCATT TTATGTGACA CCATTTAATT TGACATGGTG 70126 .......... .......... .......... .......... .......... .......... 468 TTTAAGAAAA AAAGATTTTT GAAACTTATT GTCTAAAAAT AATTCTTAGA TATTTGTTTG 70186 .......... .......... .......... .......... .......... .......... 468 GTTTTAAATC ATTTTACAAG GGCAAAAGAA AAATTTTAAA GTTATTTTTT CTAATTATAT 70246 .......... .......... .......... .......... .......... .......... 468 TAAAGTGACG TTTTTTTGGG ACAAAGGAAA AAGGAAAAGG TGCCACATAA AATAGGATGA 70306 .......... .......... .......... .......... .......... .......... 468 AGGGTCTAAC AACTATAAGG GTATTAAGTT GCTAAGCCAT GCTTGAAGAT TTGGAAGAGG 70366 .......... .......... .......... .......... .......... .......... 468 GTGATGAGGG GTGTGTCTAT TACCGAGGAC CCTTGAATTC ATGCCAGGGC CTTCTAGTAA 70426 .......... .......... .......... .......... .......... .......... 468 AAAGGCCATT CATCTCGTAA GGAGATTGGT GGAGCAATAT GGGGATATGA AGTGGCACTT 70486 .......... .......... .......... .......... .......... .......... 468 AGATATGCTA CACATTGTAT TGGAGTGGGG TGGATGAAAT GGAGCTTGCA TCGGGCGTCT 70546 .......... .......... .......... .......... .......... .......... 468 TATGTGATAA GAATGTTCCA CCAAGATTTA AAGGTAAATT CTATAAAGTG GTGGTTAGAC 70606 .......... .......... .......... .......... .......... .......... 468 TAGCTATATT GTATGCGGCA GTGTGTTGGC CAGTCAAGAG TTTGTATGTC TAAAATATGA 70666 .......... .......... .......... .......... .......... .......... 468 AAGTAGTGGA AATAAGAATG CTGCGATAGA TGTGTGGGCA TACTAGAAGA GATGGGGTTA 70726 .......... .......... .......... .......... .......... .......... 468 GGAACGAGGT GTATTCTGGA CAAGGTGTGA TTGAACCCTG TAGTGGACAA GATGTGATTG 70786 .......... .......... .......... .......... .......... .......... 468 AACCCTGTAG TGGACAAGAT GAAGAAGGCA GAGAAGATGA GGAAGGCAAC ACTGAGATGG 70846 .......... .......... .......... .......... .......... .......... 468 TTCATACATG TGAAAAGAAG ATGCTTAGAG GTCCTAGTAA CAAGATGTGA GAGGTAGGAT 70906 .......... .......... .......... .......... .......... .......... 468 ATAGTGGCTT GGTAAAGGTA GAGTAGGGGT GTGCAAAAAC ACTGTCTTAT CCCCTTTAGA 70966 .......... .......... .......... .......... .......... .......... 468 CAGATGAACA TCCTCCATAA TTGTTTTGTC CATGTACAAT GCAAAAAAAG ATAGTTAATT 71026 .......... .......... .......... .......... .......... .......... 468 GTCTTAGCAT GTTCTCCACG TAAAGTACAT CTCGAAGCCA AAAAATAGCC TCTTTTCTTT 71086 .......... .......... .......... .......... .......... .......... 468 AGATTTTCAT GTGTCAAAAC TGCTTCTCAG TAGTTACTAA CTTTATCCTT TAGCCTTCAA 71146 .......... .......... .......... .......... .......... .......... 468 TTCATACTTC AAAGTGATTT TTAGTTCATA ACTTCACATT ATACAAAACA TCAAAATCTA 71206 .......... .......... .......... .......... .......... .......... 468 AAGTAAGAAC CTTATTCCTC TTAATTTCTC TTCGTTTAAC ACTTTGTGTA GTTTTTTCAT 71266 .......... .......... .......... .......... .......... .......... 468 TACATTATTG TGTTGTTGCG TCAAATTTAT TAGAGAAGTC ATATATCTAT TTTATAAGTG 71326 .......... .......... .......... .......... .......... .......... 468 TTCTCTTATT GGTTAAATCG AAAGGACCAA TACCGATGAA TTGAAATTCG ATAAATTTTT 71386 .......... .......... .......... .......... .......... .......... 468 TCTTATTGGT TTGGTTATTG GTTTAACGTA TTTAAAAATC AAAAACCCAT AAACCAATCC 71446 .......... .......... .......... .......... .......... .......... 468 GATAATACAT AAAATCGAAC CAAACCATTG ATACACACCT CTAAGGTAGA GATAGTCAGC 71506 .......... .......... .......... .......... .......... .......... 468 ACTAGTATTG GATAGAGGTG ACTAGGTGAC ATGACATGAC ATACATGCAA CTTGCCTAGT 71566 .......... .......... .......... .......... .......... .......... 468 ACGTGACCTT CAATGAGAGC ATATGGGTTC AAGGATTAGA ATAAAAGTTT GATATGTAGT 71626 .......... .......... .......... .......... .......... .......... 468 TGATCATTGT CTAGTTTTCC CTATCAATAG TATTATTATT ACTCTCTTAC TATCTTATTC 71686 .......... .......... .......... .......... .......... .......... 468 TTCAATTTTT TATTATGTGT ATTTTTTATT ACCTTTGCTT AGTTTATCGT ATTTTTGTTA 71746 .......... .......... .......... .......... .......... .......... 468 CTGCTTTTGT TCGTTTACCA TCATTTTCAA CATAACTTCT TCACTATTGT ATTTTATTTT 71806 .......... .......... .......... .......... .......... .......... 468 TAATTCTTTT TTATATGTGG TTACTTGAGC CAAGGTCCTT CGGAAACAAC CTCTCTACTT 71866 .......... .......... .......... .......... .......... .......... 468 TCACGAGGTA GGGGTAGGGT TGCATAGATA CTACCCTCCC CAAACCTGAC TTGTGGGAGT 71926 .......... .......... .......... .......... .......... .......... 468 ACACTGGGTA TGTTGTTGTA GTGGGATGAA AAGCTCATGG TTTATTCTCA ATGAAGATTT 71986 .......... .......... .......... .......... .......... .......... 468 GACAGAAAGC TATATCCAAT AGGTATGCAA CCAACTCCAT TACAATGTGA TTCTACTCGA 72046 .......... .......... .......... .......... .......... .......... 468 ACCCCATTTA AAGTATTTTC TCTTTATAAT AGGCTTGTGA AGTAGTCAAG CCTAATGTGA 72106 .......... .......... .......... .......... .......... .......... 468 CGTCCCGCCA CAATTTCAGC CTGATTTGGC ATCTGAATGG GGCAGAAGGA TCTAGAGTTG 72166 .......... .......... .......... .......... .......... .......... 468 TGAAGAGGTT TGCAGAGAAC TCTAGACCCT TCTAGATCTC TGGAGAAGAC TAGAGAATTC 72226 .......... .......... .......... .......... .......... .......... 468 CCTAGAATTC TCTAGAATAC TTTGGATCCT TTTGGAAGAG TTTAGCATAT TCTAGAGAGT 72286 .......... .......... .......... .......... .......... .......... 468 GTAGAATTCT TTAGAATAAA GACTAAAGTG TAATTACTTT AGGGACTTGT AGAATAATAT 72346 .......... .......... .......... .......... .......... .......... 468 TTATTTACTC TTAGGCCCTT AAGAAGTAGT ATAAATAGGA GGACCTCTCA TTTGTAATCC 72406 .......... .......... .......... .......... .......... .......... 468 ATCCAACAAT CCAACCAAGA GTTGTAATCA AATCTTCCAA GCTTAATACA AGCCCTCTTC 72466 .......... .......... .......... .......... .......... .......... 468 CAAAGTTCTT TCTAAGTCTT TCTTTACATT CTCTTAGCGT TCTGAGTCTT AAAGGCTTAC 72526 .......... .......... .......... .......... .......... .......... 468 TTGAGCTTAC AAGATCCTGA AAGATTCGTG AGTAAGTTGT CGAGTGCCGC ACGGAGTCTT 72586 .......... .......... .......... .......... .......... .......... 468 AGCAAATACT CCAAGTACGT GACACTAAGC TGAGTAAGCT CAGGTAGGTG CAATTTTGCT 72646 .......... .......... .......... .......... .......... .......... 468 GGTCTTTTAG CACCCCTTAG AATGGAACAT TTAGATGGGT CTTTTGATCG TTATGTAATA 72706 .......... .......... .......... .......... .......... .......... 468 AATTCTTGTT TGTGCTAGAA TTCACCTAGT GTCAAATGCC AGTGCAAGTG GAATTTAATA 72766 .......... .......... .......... .......... .......... .......... 468 TTCTGCATAT ACAAAACTCT CGAAGTTCAG TAGCTAAATT CAGTGTCATA AGTTGATCTA 72826 .......... .......... .......... .......... .......... .......... 468 ATGAAGATGA AACATTTTCT GGCTTATTAA ATGCTGAAGT CAAAAGGTCA TAGGGCTAGT 72886 .......... .......... .......... .......... .......... .......... 468 TAGCATTAAG GGACCGTTTG GAAAGTCACC TAGTAATTGT AATTGGTGTA ACTACTAGAA 72946 .......... .......... .......... .......... .......... .......... 468 TAGTAATTAC AAGCCTAACA CACCTAGTAA TTATGCTTCC TATTTGCCAC CGTGTATGTA 73006 .......... .......... .......... .......... .......... .......... 468 TTTTTGGATG CACAATTGCA ATTATAAGAT TATATCAAGT CTTAAAATAA AAGTTAATTA 73066 .......... .......... .......... .......... .......... .......... 468 TTTAAATGTA TATTAGAAAA ATAAGAAACT TTATTAATGA TATTTAATTA AATATTTAAG 73126 .......... .......... .......... .......... .......... .......... 468 ATATATATTA TATTTTGAAA ATGTATTAAT TAATAAGCAT ATGTTCTTTA ACTAATATTA 73186 .......... .......... .......... .......... .......... .......... 468 TGAAAAAATA ATTGATTTAT ATTTTTCAAA TTTAGTGTAT TTCAGTTGTA TTGATCATAA 73246 .......... .......... .......... .......... .......... .......... 468 AAACTGAAAG TACAACCCTT CGGATGGCCC ACTGGTTTGA ACTTGGGACT TCTGTGTTAG 73306 .......... .......... .......... .......... .......... .......... 468 AGGTCTCAAG TTCAAAACCC TTTTGCCAGC GAAAGCAAGG GGTTTGCCTT CTGGGCAGAG 73366 .......... .......... .......... .......... .......... .......... 468 CTCGTCGCAC CAGACTTGCC TAGTGGGTTA CCTCTCTTAT GTGGTTTGCG AGCTATTACA 73426 .......... .......... .......... .......... .......... .......... 468 TAGGAGGCGG GGTTTTACCC TGTATGCACC CAAAGGGTAG CGGCTGTAAA AATTAGTAGT 73486 .......... .......... .......... .......... .......... .......... 468 ACAAGATTTC TATGAACATC GTTTGACAAA AAGATTACTA TTATAATTAA ATTTCATAAA 73546 .......... .......... .......... .......... .......... .......... 468 TTATTAAAAT ATTTGATAAA AAGATAATTT ATCAAGTCTA ACAAAAAGAT AAATGACTTG 73606 .......... .......... .......... .......... .......... .......... 468 CAATCACACC AGATTGAATA TGTGACTTTT GATTCAAACT GATCTTCTTC TTTTACTTTA 73666 .......... .......... .......... .......... .......... .......... 468 TGACCTGTTA AGTGCTTGTT GCCTTTATAA TATCCTGTTT GTAAGTTTTC AATCAGGAGA 73726 .......... .......... .......... .......... .......... .......... 468 ATCTTACAAC TTGCTAGTAG AAAATACTAT CTCACGAGAC CTATAATGAA GGCGAGGAAT 73786 .......... .......... .......... .......... .......... .......... 468 TCTCGTCACT TGTCATTGTG AAGTGAGCCA GTACTTAAAG TCTGTGTTAG TTTTCAATTT 73846 .......... .......... .......... .......... .......... .......... 468 TTTTCCTTAA GACGTAACTC TAAGTAATCA CCTGTAGTGA TGATATTCTT TTACCTATCA 73906 .......... .......... .......... .......... .......... .......... 468 AAAAAATAAA TATGAAATGA TGACATTTTT TGTTTTTTAT CAAGGTCCTG GAATTGGTGG 73966 |||||| |||||||||| .......... .......... .......... .......... ....GTCCTG GAATTGGTGG 484 GAACTATGGC CCATACAGGC AGTCTGAGAG GAATGCCCTT TACAAGGAAT TTGCTGAAAA 74026 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAACTATGGC CCATACAGGC AGTCTGAGAG GAATGCCCTT TACAAGGAAT TTGCTGAAAA 544 ACTTTTACAA TCCGGTCATG TTTATCGATG TTTTTGCTCA A 74067 |||||||||| |||||||||| |||||||||| |||||||||| | ACTTTTACAA TCCGGTCATG TTTATCGATG TTTTTGCTCA A 585 hqPGS_C01HBa0088L02.1+_SGN-E284299+ (68627 68975,69124 69242,73951 74067) ******************************************************************************** EST sequence 12 +strand 628 n (File: SGN-E284326+) 1 GACGGTGGCG GCGGCGCCGT GGTTTAGAGC AAGGTTGATC CCGGAGTTAA AGAGTCGCCA 61 GTCACTACTG TATTGTCGCA ACGGCCCCCG CAGGTATCCG CAAAGTCTCT GTTTCCGGAG 121 AAGAAGTTTC TCAATTTATG CTTCAGCAGG AGATGAAGGG GCTGTCCGAG TTCGTTTTGC 181 ACCGTCTCCT ACCGGTAATC TCCATGTGGG AGGCGCTAGA ACTGCACTCT TTAACTACTT 241 ATATGCGCGG TCGAAAGGTG GGAAATTTGT ACTCCGGATT GAAGACACAG ACCTGGAAAG 301 ATCCACAAGG GAGTCCGAGG AGGCCGTGCT TCGTGACCTT TCTTGGCTTG GTCTTGCTTG 361 GGACGAAGGT CCTGGAATTG GTGGGAACTA TGGCCCATAC AGGCAGTCTG AGAGGAATGC 421 CCTTTACAAG GAATTTGCTG AAAAACTTTT ACAATCCGGT CATGTTTATC GATGTTTTTG 481 CTCAAATGAG GAATTAGAAA AGATGAAAGA GATGGCAAAA TTGAAGCAGT TGCCTCCCGT 541 GTACACTGGG AGGTGGGCCA GTGCTACAGA GCANGAAGTT CTAGAAGAGC TGACAAAGGG 601 GACCCCATAC ACATATCGGT TTCGAGTA Predicted gene structure (within gDNA segment 68127 to 75120): Exon 1 68727 68975 ( 249 n); cDNA 1 249 ( 249 n); score: 1.000 Intron 1 68976 69123 ( 148 n); Pd: 0.986 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 2 69124 69242 ( 119 n); cDNA 250 368 ( 119 n); score: 1.000 Intron 2 69243 73950 (4708 n); Pd: 0.899 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 73951 74072 ( 122 n); cDNA 369 490 ( 122 n); score: 1.000 Intron 3 74073 74372 ( 300 n); Pd: 0.797 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 4 74373 74510 ( 138 n); cDNA 491 628 ( 138 n); score: 0.993 MATCH C01HBa0088L02.1+ SGN-E284326+ 0.998 628 1.000 C PGS_C01HBa0088L02.1+_SGN-E284326+ (68727 68975,69124 69242,73951 74072,74373 74510) Alignment (genomic DNA sequence = upper lines): GACGGTGGCG GCGGCGCCGT GGTTTAGAGC AAGGTTGATC CCGGAGTTAA AGAGTCGCCA 68786 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GACGGTGGCG GCGGCGCCGT GGTTTAGAGC AAGGTTGATC CCGGAGTTAA AGAGTCGCCA 60 GTCACTACTG TATTGTCGCA ACGGCCCCCG CAGGTATCCG CAAAGTCTCT GTTTCCGGAG 68846 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTCACTACTG TATTGTCGCA ACGGCCCCCG CAGGTATCCG CAAAGTCTCT GTTTCCGGAG 120 AAGAAGTTTC TCAATTTATG CTTCAGCAGG AGATGAAGGG GCTGTCCGAG TTCGTTTTGC 68906 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAGAAGTTTC TCAATTTATG CTTCAGCAGG AGATGAAGGG GCTGTCCGAG TTCGTTTTGC 180 ACCGTCTCCT ACCGGTAATC TCCATGTGGG AGGCGCTAGA ACTGCACTCT TTAACTACTT 68966 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACCGTCTCCT ACCGGTAATC TCCATGTGGG AGGCGCTAGA ACTGCACTCT TTAACTACTT 240 ATATGCGCGG TCCGTCCCGA TTCTTTGTCT TTTCATCCAA TTTACTTATT TCTTCATCAT 69026 ||||||||| ATATGCGCG. .......... .......... .......... .......... .......... 249 AGTTGACGAC TATACTTGAT TAATACCATT GACACGGCGG CTAATGGCAC TTCTGTTTAG 69086 .......... .......... .......... .......... .......... .......... 249 TTGTTTTTCT CTGTTAACAG TTATGTTACT ATGACAGGTC GAAAGGTGGG AAATTTGTAC 69146 ||| |||||||||| |||||||||| .......... .......... .......... .......GTC GAAAGGTGGG AAATTTGTAC 272 TCCGGATTGA AGACACAGAC CTGGAAAGAT CCACAAGGGA GTCCGAGGAG GCCGTGCTTC 69206 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCCGGATTGA AGACACAGAC CTGGAAAGAT CCACAAGGGA GTCCGAGGAG GCCGTGCTTC 332 GTGACCTTTC TTGGCTTGGT CTTGCTTGGG ACGAAGGTTC CATCAATCAC CACCATTTCT 69266 |||||||||| |||||||||| |||||||||| |||||| GTGACCTTTC TTGGCTTGGT CTTGCTTGGG ACGAAG.... .......... .......... 368 TTATTATAGC TAAATTGCAA AATTCTACTC TTAATTTTTG TTTTATGTGC TAATTGAATA 69326 .......... .......... .......... .......... .......... .......... 368 TGCTAAAGTT GACGTAATTG AACGCATAAA AGCCTTGTTC AAAACTGAAT ACAAGCTTAT 69386 .......... .......... .......... .......... .......... .......... 368 AAACCTCCAA AAGCATGGAC AAGTTTATTT TGCTCCGCAG AACTAAAGGT TTGACCTCAG 69446 .......... .......... .......... .......... .......... .......... 368 CTTATATCTA ATATAAGCCA TACTAGATAC AAAAATATTA TTATTAATCC CCAAATCAGC 69506 .......... .......... .......... .......... .......... .......... 368 AGCAATATTA TGTAAACAAC AGCTATGTCT TAGTCTTGAA CAAGTTGGGA TCAATAAGAT 69566 .......... .......... .......... .......... .......... .......... 368 CAACATCAAT ATTATTAAAA AAAAAAAGGA GATGTTTTAG TAATTCGTTT TTGTCAGTTA 69626 .......... .......... .......... .......... .......... .......... 368 GTGACTTTAT AGCTTTCTTC TTGAATTTGG TTTTATTTAG AAGAGTTCCG TGTTTTTATC 69686 .......... .......... .......... .......... .......... .......... 368 TGATGGGATC TTTTTATCTA CTAATAGAAG CTTAGTTCAT CAGAAAGTTA AATAGTTATT 69746 .......... .......... .......... .......... .......... .......... 368 GCTTTCACTT CTGGACCAAT CGAGTGCGGT TCATACATCT ACTATTATAT CGATACAAAG 69806 .......... .......... .......... .......... .......... .......... 368 TAGGACACAT GCTAAACCCA CATTTGATCA ATAAAGGGGA CAAAACTAGG ATGACCAAAG 69866 .......... .......... .......... .......... .......... .......... 368 AAGACAACGA TTCATTAATT GATTTTGTTG GTGAAAATTT CATCATTTAG CCTTGCTTGT 69926 .......... .......... .......... .......... .......... .......... 368 TCAGCCATAT CTTTTTAGGT TTGGAAGAGC ATCGACATTG TGGAGTGGCT TACCAGCTTG 69986 .......... .......... .......... .......... .......... .......... 368 CATAATACCA TTTTAGGATG TCTAGAATAC TCATAGAAGG GAGGTTTGTA CAATGGTCCC 70046 .......... .......... .......... .......... .......... .......... 368 GTTGTATAAG AACAAGGTGA TATTTAAAAT TGTACTCCCT CTGTTTCATT TTATGTGACA 70106 .......... .......... .......... .......... .......... .......... 368 CCATTTAATT TGACATGGTG TTTAAGAAAA AAAGATTTTT GAAACTTATT GTCTAAAAAT 70166 .......... .......... .......... .......... .......... .......... 368 AATTCTTAGA TATTTGTTTG GTTTTAAATC ATTTTACAAG GGCAAAAGAA AAATTTTAAA 70226 .......... .......... .......... .......... .......... .......... 368 GTTATTTTTT CTAATTATAT TAAAGTGACG TTTTTTTGGG ACAAAGGAAA AAGGAAAAGG 70286 .......... .......... .......... .......... .......... .......... 368 TGCCACATAA AATAGGATGA AGGGTCTAAC AACTATAAGG GTATTAAGTT GCTAAGCCAT 70346 .......... .......... .......... .......... .......... .......... 368 GCTTGAAGAT TTGGAAGAGG GTGATGAGGG GTGTGTCTAT TACCGAGGAC CCTTGAATTC 70406 .......... .......... .......... .......... .......... .......... 368 ATGCCAGGGC CTTCTAGTAA AAAGGCCATT CATCTCGTAA GGAGATTGGT GGAGCAATAT 70466 .......... .......... .......... .......... .......... .......... 368 GGGGATATGA AGTGGCACTT AGATATGCTA CACATTGTAT TGGAGTGGGG TGGATGAAAT 70526 .......... .......... .......... .......... .......... .......... 368 GGAGCTTGCA TCGGGCGTCT TATGTGATAA GAATGTTCCA CCAAGATTTA AAGGTAAATT 70586 .......... .......... .......... .......... .......... .......... 368 CTATAAAGTG GTGGTTAGAC TAGCTATATT GTATGCGGCA GTGTGTTGGC CAGTCAAGAG 70646 .......... .......... .......... .......... .......... .......... 368 TTTGTATGTC TAAAATATGA AAGTAGTGGA AATAAGAATG CTGCGATAGA TGTGTGGGCA 70706 .......... .......... .......... .......... .......... .......... 368 TACTAGAAGA GATGGGGTTA GGAACGAGGT GTATTCTGGA CAAGGTGTGA TTGAACCCTG 70766 .......... .......... .......... .......... .......... .......... 368 TAGTGGACAA GATGTGATTG AACCCTGTAG TGGACAAGAT GAAGAAGGCA GAGAAGATGA 70826 .......... .......... .......... .......... .......... .......... 368 GGAAGGCAAC ACTGAGATGG TTCATACATG TGAAAAGAAG ATGCTTAGAG GTCCTAGTAA 70886 .......... .......... .......... .......... .......... .......... 368 CAAGATGTGA GAGGTAGGAT ATAGTGGCTT GGTAAAGGTA GAGTAGGGGT GTGCAAAAAC 70946 .......... .......... .......... .......... .......... .......... 368 ACTGTCTTAT CCCCTTTAGA CAGATGAACA TCCTCCATAA TTGTTTTGTC CATGTACAAT 71006 .......... .......... .......... .......... .......... .......... 368 GCAAAAAAAG ATAGTTAATT GTCTTAGCAT GTTCTCCACG TAAAGTACAT CTCGAAGCCA 71066 .......... .......... .......... .......... .......... .......... 368 AAAAATAGCC TCTTTTCTTT AGATTTTCAT GTGTCAAAAC TGCTTCTCAG TAGTTACTAA 71126 .......... .......... .......... .......... .......... .......... 368 CTTTATCCTT TAGCCTTCAA TTCATACTTC AAAGTGATTT TTAGTTCATA ACTTCACATT 71186 .......... .......... .......... .......... .......... .......... 368 ATACAAAACA TCAAAATCTA AAGTAAGAAC CTTATTCCTC TTAATTTCTC TTCGTTTAAC 71246 .......... .......... .......... .......... .......... .......... 368 ACTTTGTGTA GTTTTTTCAT TACATTATTG TGTTGTTGCG TCAAATTTAT TAGAGAAGTC 71306 .......... .......... .......... .......... .......... .......... 368 ATATATCTAT TTTATAAGTG TTCTCTTATT GGTTAAATCG AAAGGACCAA TACCGATGAA 71366 .......... .......... .......... .......... .......... .......... 368 TTGAAATTCG ATAAATTTTT TCTTATTGGT TTGGTTATTG GTTTAACGTA TTTAAAAATC 71426 .......... .......... .......... .......... .......... .......... 368 AAAAACCCAT AAACCAATCC GATAATACAT AAAATCGAAC CAAACCATTG ATACACACCT 71486 .......... .......... .......... .......... .......... .......... 368 CTAAGGTAGA GATAGTCAGC ACTAGTATTG GATAGAGGTG ACTAGGTGAC ATGACATGAC 71546 .......... .......... .......... .......... .......... .......... 368 ATACATGCAA CTTGCCTAGT ACGTGACCTT CAATGAGAGC ATATGGGTTC AAGGATTAGA 71606 .......... .......... .......... .......... .......... .......... 368 ATAAAAGTTT GATATGTAGT TGATCATTGT CTAGTTTTCC CTATCAATAG TATTATTATT 71666 .......... .......... .......... .......... .......... .......... 368 ACTCTCTTAC TATCTTATTC TTCAATTTTT TATTATGTGT ATTTTTTATT ACCTTTGCTT 71726 .......... .......... .......... .......... .......... .......... 368 AGTTTATCGT ATTTTTGTTA CTGCTTTTGT TCGTTTACCA TCATTTTCAA CATAACTTCT 71786 .......... .......... .......... .......... .......... .......... 368 TCACTATTGT ATTTTATTTT TAATTCTTTT TTATATGTGG TTACTTGAGC CAAGGTCCTT 71846 .......... .......... .......... .......... .......... .......... 368 CGGAAACAAC CTCTCTACTT TCACGAGGTA GGGGTAGGGT TGCATAGATA CTACCCTCCC 71906 .......... .......... .......... .......... .......... .......... 368 CAAACCTGAC TTGTGGGAGT ACACTGGGTA TGTTGTTGTA GTGGGATGAA AAGCTCATGG 71966 .......... .......... .......... .......... .......... .......... 368 TTTATTCTCA ATGAAGATTT GACAGAAAGC TATATCCAAT AGGTATGCAA CCAACTCCAT 72026 .......... .......... .......... .......... .......... .......... 368 TACAATGTGA TTCTACTCGA ACCCCATTTA AAGTATTTTC TCTTTATAAT AGGCTTGTGA 72086 .......... .......... .......... .......... .......... .......... 368 AGTAGTCAAG CCTAATGTGA CGTCCCGCCA CAATTTCAGC CTGATTTGGC ATCTGAATGG 72146 .......... .......... .......... .......... .......... .......... 368 GGCAGAAGGA TCTAGAGTTG TGAAGAGGTT TGCAGAGAAC TCTAGACCCT TCTAGATCTC 72206 .......... .......... .......... .......... .......... .......... 368 TGGAGAAGAC TAGAGAATTC CCTAGAATTC TCTAGAATAC TTTGGATCCT TTTGGAAGAG 72266 .......... .......... .......... .......... .......... .......... 368 TTTAGCATAT TCTAGAGAGT GTAGAATTCT TTAGAATAAA GACTAAAGTG TAATTACTTT 72326 .......... .......... .......... .......... .......... .......... 368 AGGGACTTGT AGAATAATAT TTATTTACTC TTAGGCCCTT AAGAAGTAGT ATAAATAGGA 72386 .......... .......... .......... .......... .......... .......... 368 GGACCTCTCA TTTGTAATCC ATCCAACAAT CCAACCAAGA GTTGTAATCA AATCTTCCAA 72446 .......... .......... .......... .......... .......... .......... 368 GCTTAATACA AGCCCTCTTC CAAAGTTCTT TCTAAGTCTT TCTTTACATT CTCTTAGCGT 72506 .......... .......... .......... .......... .......... .......... 368 TCTGAGTCTT AAAGGCTTAC TTGAGCTTAC AAGATCCTGA AAGATTCGTG AGTAAGTTGT 72566 .......... .......... .......... .......... .......... .......... 368 CGAGTGCCGC ACGGAGTCTT AGCAAATACT CCAAGTACGT GACACTAAGC TGAGTAAGCT 72626 .......... .......... .......... .......... .......... .......... 368 CAGGTAGGTG CAATTTTGCT GGTCTTTTAG CACCCCTTAG AATGGAACAT TTAGATGGGT 72686 .......... .......... .......... .......... .......... .......... 368 CTTTTGATCG TTATGTAATA AATTCTTGTT TGTGCTAGAA TTCACCTAGT GTCAAATGCC 72746 .......... .......... .......... .......... .......... .......... 368 AGTGCAAGTG GAATTTAATA TTCTGCATAT ACAAAACTCT CGAAGTTCAG TAGCTAAATT 72806 .......... .......... .......... .......... .......... .......... 368 CAGTGTCATA AGTTGATCTA ATGAAGATGA AACATTTTCT GGCTTATTAA ATGCTGAAGT 72866 .......... .......... .......... .......... .......... .......... 368 CAAAAGGTCA TAGGGCTAGT TAGCATTAAG GGACCGTTTG GAAAGTCACC TAGTAATTGT 72926 .......... .......... .......... .......... .......... .......... 368 AATTGGTGTA ACTACTAGAA TAGTAATTAC AAGCCTAACA CACCTAGTAA TTATGCTTCC 72986 .......... .......... .......... .......... .......... .......... 368 TATTTGCCAC CGTGTATGTA TTTTTGGATG CACAATTGCA ATTATAAGAT TATATCAAGT 73046 .......... .......... .......... .......... .......... .......... 368 CTTAAAATAA AAGTTAATTA TTTAAATGTA TATTAGAAAA ATAAGAAACT TTATTAATGA 73106 .......... .......... .......... .......... .......... .......... 368 TATTTAATTA AATATTTAAG ATATATATTA TATTTTGAAA ATGTATTAAT TAATAAGCAT 73166 .......... .......... .......... .......... .......... .......... 368 ATGTTCTTTA ACTAATATTA TGAAAAAATA ATTGATTTAT ATTTTTCAAA TTTAGTGTAT 73226 .......... .......... .......... .......... .......... .......... 368 TTCAGTTGTA TTGATCATAA AAACTGAAAG TACAACCCTT CGGATGGCCC ACTGGTTTGA 73286 .......... .......... .......... .......... .......... .......... 368 ACTTGGGACT TCTGTGTTAG AGGTCTCAAG TTCAAAACCC TTTTGCCAGC GAAAGCAAGG 73346 .......... .......... .......... .......... .......... .......... 368 GGTTTGCCTT CTGGGCAGAG CTCGTCGCAC CAGACTTGCC TAGTGGGTTA CCTCTCTTAT 73406 .......... .......... .......... .......... .......... .......... 368 GTGGTTTGCG AGCTATTACA TAGGAGGCGG GGTTTTACCC TGTATGCACC CAAAGGGTAG 73466 .......... .......... .......... .......... .......... .......... 368 CGGCTGTAAA AATTAGTAGT ACAAGATTTC TATGAACATC GTTTGACAAA AAGATTACTA 73526 .......... .......... .......... .......... .......... .......... 368 TTATAATTAA ATTTCATAAA TTATTAAAAT ATTTGATAAA AAGATAATTT ATCAAGTCTA 73586 .......... .......... .......... .......... .......... .......... 368 ACAAAAAGAT AAATGACTTG CAATCACACC AGATTGAATA TGTGACTTTT GATTCAAACT 73646 .......... .......... .......... .......... .......... .......... 368 GATCTTCTTC TTTTACTTTA TGACCTGTTA AGTGCTTGTT GCCTTTATAA TATCCTGTTT 73706 .......... .......... .......... .......... .......... .......... 368 GTAAGTTTTC AATCAGGAGA ATCTTACAAC TTGCTAGTAG AAAATACTAT CTCACGAGAC 73766 .......... .......... .......... .......... .......... .......... 368 CTATAATGAA GGCGAGGAAT TCTCGTCACT TGTCATTGTG AAGTGAGCCA GTACTTAAAG 73826 .......... .......... .......... .......... .......... .......... 368 TCTGTGTTAG TTTTCAATTT TTTTCCTTAA GACGTAACTC TAAGTAATCA CCTGTAGTGA 73886 .......... .......... .......... .......... .......... .......... 368 TGATATTCTT TTACCTATCA AAAAAATAAA TATGAAATGA TGACATTTTT TGTTTTTTAT 73946 .......... .......... .......... .......... .......... .......... 368 CAAGGTCCTG GAATTGGTGG GAACTATGGC CCATACAGGC AGTCTGAGAG GAATGCCCTT 74006 |||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ....GTCCTG GAATTGGTGG GAACTATGGC CCATACAGGC AGTCTGAGAG GAATGCCCTT 424 TACAAGGAAT TTGCTGAAAA ACTTTTACAA TCCGGTCATG TTTATCGATG TTTTTGCTCA 74066 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TACAAGGAAT TTGCTGAAAA ACTTTTACAA TCCGGTCATG TTTATCGATG TTTTTGCTCA 484 AATGAGGTGA TTGTATTTAA TTTTGATTTC TCTCCTTTGG TCTCTCCGAG TTTTGCAGTG 74126 |||||| AATGAG.... .......... .......... .......... .......... .......... 490 AGAATTTTGA GAGTAAAAAT CTGTACATCT AGAATGTACT TTGACAGAAG CAGATATTCG 74186 .......... .......... .......... .......... .......... .......... 490 TGCTGCAGAA TTCTTTTAGA TTCCACCTAT TAGACTAGTT TCAGAAGCAT GATGCTCTCA 74246 .......... .......... .......... .......... .......... .......... 490 AGTTTGATGC CATCTAAAAC TGCTCCACTG CTATTTGCTT GATGGGTCAA AACATTTGTC 74306 .......... .......... .......... .......... .......... .......... 490 CACTTTGTGG TTTTAGTATA TTTTTTGAAT GATTGTGTAA TACAGTAACC ATTTTCTGTT 74366 .......... .......... .......... .......... .......... .......... 490 GTTTAGGAAT TAGAAAAGAT GAAAGAGATG GCAAAATTGA AGCAGTTGCC TCCCGTGTAC 74426 |||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ......GAAT TAGAAAAGAT GAAAGAGATG GCAAAATTGA AGCAGTTGCC TCCCGTGTAC 544 ACTGGGAGGT GGGCCAGTGC TACAGAGCAG GAAGTTCTAG AAGAGCTGAC AAAGGGGACC 74486 |||||||||| |||||||||| ||||||||| |||||||||| |||||||||| |||||||||| ACTGGGAGGT GGGCCAGTGC TACAGAGCAN GAAGTTCTAG AAGAGCTGAC AAAGGGGACC 604 CCATACACAT ATCGGTTTCG AGTA 74510 |||||||||| |||||||||| |||| CCATACACAT ATCGGTTTCG AGTA 628 hqPGS_C01HBa0088L02.1+_SGN-E284326+ (68727 68975,69124 69242,73951 74072,74373 74510) ******************************************************************************** EST sequence 27 +strand 466 n (File: SGN-E281040+) 1 CCGAGTTCGT TTTGCACCGT CTCCTACCGG TAATCTCCAT GTGGGAGGCG CTAGAACTGC 61 ACTCTTTAAC TACTTATATG CGCGGTCGAA AGGTGGGAAA TTTGTACTCC GGATTGAAGA 121 CACAGACCTG GAAAGATCCA CAAGGGAGTC CGAGGAGGCC GTGCTTCGTG ACCTTTCTTG 181 GCTTGGTCTT GCTTGGGACG AAGGTCCTGG AATTGGTGGG AACTATGGCC CATACAGGCA 241 GTCTGAGAGG AATGCCCTTT ACAAGGAATT TGCTGAAAAA CTTTTACAAT CCGGTCATGT 301 TTATCGATGT TTTTGCTCAA ATGAGGAATT AGAAAAGATG AAAGAGATGG CAAAATTGAA 361 GCAGTTGCCT CCCGTGTACA CTGGGAGGTG GGCCAGTGCT ACAGAGCAGG AAGTTCTAGA 421 AGAGCTGACA AAGGGGACCC CATACACATA TCGGTTTCGA GTACCA Predicted gene structure (within gDNA segment 68292 to 75123): Exon 1 68892 68975 ( 84 n); cDNA 1 84 ( 84 n); score: 1.000 Intron 1 68976 69123 ( 148 n); Pd: 0.986 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 2 69124 69242 ( 119 n); cDNA 85 203 ( 119 n); score: 1.000 Intron 2 69243 73950 (4708 n); Pd: 0.899 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 73951 74072 ( 122 n); cDNA 204 325 ( 122 n); score: 1.000 Intron 3 74073 74372 ( 300 n); Pd: 0.797 (s: 1.00), Pa: 1.000 (s: 1.00) Exon 4 74373 74513 ( 141 n); cDNA 326 466 ( 141 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E281040+ 1.000 466 1.000 C PGS_C01HBa0088L02.1+_SGN-E281040+ (68892 68975,69124 69242,73951 74072,74373 74513) Alignment (genomic DNA sequence = upper lines): CCGAGTTCGT TTTGCACCGT CTCCTACCGG TAATCTCCAT GTGGGAGGCG CTAGAACTGC 68951 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CCGAGTTCGT TTTGCACCGT CTCCTACCGG TAATCTCCAT GTGGGAGGCG CTAGAACTGC 60 ACTCTTTAAC TACTTATATG CGCGGTCCGT CCCGATTCTT TGTCTTTTCA TCCAATTTAC 69011 |||||||||| |||||||||| |||| ACTCTTTAAC TACTTATATG CGCG...... .......... .......... .......... 84 TTATTTCTTC ATCATAGTTG ACGACTATAC TTGATTAATA CCATTGACAC GGCGGCTAAT 69071 .......... .......... .......... .......... .......... .......... 84 GGCACTTCTG TTTAGTTGTT TTTCTCTGTT AACAGTTATG TTACTATGAC AGGTCGAAAG 69131 |||||||| .......... .......... .......... .......... .......... ..GTCGAAAG 92 GTGGGAAATT TGTACTCCGG ATTGAAGACA CAGACCTGGA AAGATCCACA AGGGAGTCCG 69191 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTGGGAAATT TGTACTCCGG ATTGAAGACA CAGACCTGGA AAGATCCACA AGGGAGTCCG 152 AGGAGGCCGT GCTTCGTGAC CTTTCTTGGC TTGGTCTTGC TTGGGACGAA GGTTCCATCA 69251 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| | AGGAGGCCGT GCTTCGTGAC CTTTCTTGGC TTGGTCTTGC TTGGGACGAA G......... 203 ATCACCACCA TTTCTTTATT ATAGCTAAAT TGCAAAATTC TACTCTTAAT TTTTGTTTTA 69311 .......... .......... .......... .......... .......... .......... 203 TGTGCTAATT GAATATGCTA AAGTTGACGT AATTGAACGC ATAAAAGCCT TGTTCAAAAC 69371 .......... .......... .......... .......... .......... .......... 203 TGAATACAAG CTTATAAACC TCCAAAAGCA TGGACAAGTT TATTTTGCTC CGCAGAACTA 69431 .......... .......... .......... .......... .......... .......... 203 AAGGTTTGAC CTCAGCTTAT ATCTAATATA AGCCATACTA GATACAAAAA TATTATTATT 69491 .......... .......... .......... .......... .......... .......... 203 AATCCCCAAA TCAGCAGCAA TATTATGTAA ACAACAGCTA TGTCTTAGTC TTGAACAAGT 69551 .......... .......... .......... .......... .......... .......... 203 TGGGATCAAT AAGATCAACA TCAATATTAT TAAAAAAAAA AAGGAGATGT TTTAGTAATT 69611 .......... .......... .......... .......... .......... .......... 203 CGTTTTTGTC AGTTAGTGAC TTTATAGCTT TCTTCTTGAA TTTGGTTTTA TTTAGAAGAG 69671 .......... .......... .......... .......... .......... .......... 203 TTCCGTGTTT TTATCTGATG GGATCTTTTT ATCTACTAAT AGAAGCTTAG TTCATCAGAA 69731 .......... .......... .......... .......... .......... .......... 203 AGTTAAATAG TTATTGCTTT CACTTCTGGA CCAATCGAGT GCGGTTCATA CATCTACTAT 69791 .......... .......... .......... .......... .......... .......... 203 TATATCGATA CAAAGTAGGA CACATGCTAA ACCCACATTT GATCAATAAA GGGGACAAAA 69851 .......... .......... .......... .......... .......... .......... 203 CTAGGATGAC CAAAGAAGAC AACGATTCAT TAATTGATTT TGTTGGTGAA AATTTCATCA 69911 .......... .......... .......... .......... .......... .......... 203 TTTAGCCTTG CTTGTTCAGC CATATCTTTT TAGGTTTGGA AGAGCATCGA CATTGTGGAG 69971 .......... .......... .......... .......... .......... .......... 203 TGGCTTACCA GCTTGCATAA TACCATTTTA GGATGTCTAG AATACTCATA GAAGGGAGGT 70031 .......... .......... .......... .......... .......... .......... 203 TTGTACAATG GTCCCGTTGT ATAAGAACAA GGTGATATTT AAAATTGTAC TCCCTCTGTT 70091 .......... .......... .......... .......... .......... .......... 203 TCATTTTATG TGACACCATT TAATTTGACA TGGTGTTTAA GAAAAAAAGA TTTTTGAAAC 70151 .......... .......... .......... .......... .......... .......... 203 TTATTGTCTA AAAATAATTC TTAGATATTT GTTTGGTTTT AAATCATTTT ACAAGGGCAA 70211 .......... .......... .......... .......... .......... .......... 203 AAGAAAAATT TTAAAGTTAT TTTTTCTAAT TATATTAAAG TGACGTTTTT TTGGGACAAA 70271 .......... .......... .......... .......... .......... .......... 203 GGAAAAAGGA AAAGGTGCCA CATAAAATAG GATGAAGGGT CTAACAACTA TAAGGGTATT 70331 .......... .......... .......... .......... .......... .......... 203 AAGTTGCTAA GCCATGCTTG AAGATTTGGA AGAGGGTGAT GAGGGGTGTG TCTATTACCG 70391 .......... .......... .......... .......... .......... .......... 203 AGGACCCTTG AATTCATGCC AGGGCCTTCT AGTAAAAAGG CCATTCATCT CGTAAGGAGA 70451 .......... .......... .......... .......... .......... .......... 203 TTGGTGGAGC AATATGGGGA TATGAAGTGG CACTTAGATA TGCTACACAT TGTATTGGAG 70511 .......... .......... .......... .......... .......... .......... 203 TGGGGTGGAT GAAATGGAGC TTGCATCGGG CGTCTTATGT GATAAGAATG TTCCACCAAG 70571 .......... .......... .......... .......... .......... .......... 203 ATTTAAAGGT AAATTCTATA AAGTGGTGGT TAGACTAGCT ATATTGTATG CGGCAGTGTG 70631 .......... .......... .......... .......... .......... .......... 203 TTGGCCAGTC AAGAGTTTGT ATGTCTAAAA TATGAAAGTA GTGGAAATAA GAATGCTGCG 70691 .......... .......... .......... .......... .......... .......... 203 ATAGATGTGT GGGCATACTA GAAGAGATGG GGTTAGGAAC GAGGTGTATT CTGGACAAGG 70751 .......... .......... .......... .......... .......... .......... 203 TGTGATTGAA CCCTGTAGTG GACAAGATGT GATTGAACCC TGTAGTGGAC AAGATGAAGA 70811 .......... .......... .......... .......... .......... .......... 203 AGGCAGAGAA GATGAGGAAG GCAACACTGA GATGGTTCAT ACATGTGAAA AGAAGATGCT 70871 .......... .......... .......... .......... .......... .......... 203 TAGAGGTCCT AGTAACAAGA TGTGAGAGGT AGGATATAGT GGCTTGGTAA AGGTAGAGTA 70931 .......... .......... .......... .......... .......... .......... 203 GGGGTGTGCA AAAACACTGT CTTATCCCCT TTAGACAGAT GAACATCCTC CATAATTGTT 70991 .......... .......... .......... .......... .......... .......... 203 TTGTCCATGT ACAATGCAAA AAAAGATAGT TAATTGTCTT AGCATGTTCT CCACGTAAAG 71051 .......... .......... .......... .......... .......... .......... 203 TACATCTCGA AGCCAAAAAA TAGCCTCTTT TCTTTAGATT TTCATGTGTC AAAACTGCTT 71111 .......... .......... .......... .......... .......... .......... 203 CTCAGTAGTT ACTAACTTTA TCCTTTAGCC TTCAATTCAT ACTTCAAAGT GATTTTTAGT 71171 .......... .......... .......... .......... .......... .......... 203 TCATAACTTC ACATTATACA AAACATCAAA ATCTAAAGTA AGAACCTTAT TCCTCTTAAT 71231 .......... .......... .......... .......... .......... .......... 203 TTCTCTTCGT TTAACACTTT GTGTAGTTTT TTCATTACAT TATTGTGTTG TTGCGTCAAA 71291 .......... .......... .......... .......... .......... .......... 203 TTTATTAGAG AAGTCATATA TCTATTTTAT AAGTGTTCTC TTATTGGTTA AATCGAAAGG 71351 .......... .......... .......... .......... .......... .......... 203 ACCAATACCG ATGAATTGAA ATTCGATAAA TTTTTTCTTA TTGGTTTGGT TATTGGTTTA 71411 .......... .......... .......... .......... .......... .......... 203 ACGTATTTAA AAATCAAAAA CCCATAAACC AATCCGATAA TACATAAAAT CGAACCAAAC 71471 .......... .......... .......... .......... .......... .......... 203 CATTGATACA CACCTCTAAG GTAGAGATAG TCAGCACTAG TATTGGATAG AGGTGACTAG 71531 .......... .......... .......... .......... .......... .......... 203 GTGACATGAC ATGACATACA TGCAACTTGC CTAGTACGTG ACCTTCAATG AGAGCATATG 71591 .......... .......... .......... .......... .......... .......... 203 GGTTCAAGGA TTAGAATAAA AGTTTGATAT GTAGTTGATC ATTGTCTAGT TTTCCCTATC 71651 .......... .......... .......... .......... .......... .......... 203 AATAGTATTA TTATTACTCT CTTACTATCT TATTCTTCAA TTTTTTATTA TGTGTATTTT 71711 .......... .......... .......... .......... .......... .......... 203 TTATTACCTT TGCTTAGTTT ATCGTATTTT TGTTACTGCT TTTGTTCGTT TACCATCATT 71771 .......... .......... .......... .......... .......... .......... 203 TTCAACATAA CTTCTTCACT ATTGTATTTT ATTTTTAATT CTTTTTTATA TGTGGTTACT 71831 .......... .......... .......... .......... .......... .......... 203 TGAGCCAAGG TCCTTCGGAA ACAACCTCTC TACTTTCACG AGGTAGGGGT AGGGTTGCAT 71891 .......... .......... .......... .......... .......... .......... 203 AGATACTACC CTCCCCAAAC CTGACTTGTG GGAGTACACT GGGTATGTTG TTGTAGTGGG 71951 .......... .......... .......... .......... .......... .......... 203 ATGAAAAGCT CATGGTTTAT TCTCAATGAA GATTTGACAG AAAGCTATAT CCAATAGGTA 72011 .......... .......... .......... .......... .......... .......... 203 TGCAACCAAC TCCATTACAA TGTGATTCTA CTCGAACCCC ATTTAAAGTA TTTTCTCTTT 72071 .......... .......... .......... .......... .......... .......... 203 ATAATAGGCT TGTGAAGTAG TCAAGCCTAA TGTGACGTCC CGCCACAATT TCAGCCTGAT 72131 .......... .......... .......... .......... .......... .......... 203 TTGGCATCTG AATGGGGCAG AAGGATCTAG AGTTGTGAAG AGGTTTGCAG AGAACTCTAG 72191 .......... .......... .......... .......... .......... .......... 203 ACCCTTCTAG ATCTCTGGAG AAGACTAGAG AATTCCCTAG AATTCTCTAG AATACTTTGG 72251 .......... .......... .......... .......... .......... .......... 203 ATCCTTTTGG AAGAGTTTAG CATATTCTAG AGAGTGTAGA ATTCTTTAGA ATAAAGACTA 72311 .......... .......... .......... .......... .......... .......... 203 AAGTGTAATT ACTTTAGGGA CTTGTAGAAT AATATTTATT TACTCTTAGG CCCTTAAGAA 72371 .......... .......... .......... .......... .......... .......... 203 GTAGTATAAA TAGGAGGACC TCTCATTTGT AATCCATCCA ACAATCCAAC CAAGAGTTGT 72431 .......... .......... .......... .......... .......... .......... 203 AATCAAATCT TCCAAGCTTA ATACAAGCCC TCTTCCAAAG TTCTTTCTAA GTCTTTCTTT 72491 .......... .......... .......... .......... .......... .......... 203 ACATTCTCTT AGCGTTCTGA GTCTTAAAGG CTTACTTGAG CTTACAAGAT CCTGAAAGAT 72551 .......... .......... .......... .......... .......... .......... 203 TCGTGAGTAA GTTGTCGAGT GCCGCACGGA GTCTTAGCAA ATACTCCAAG TACGTGACAC 72611 .......... .......... .......... .......... .......... .......... 203 TAAGCTGAGT AAGCTCAGGT AGGTGCAATT TTGCTGGTCT TTTAGCACCC CTTAGAATGG 72671 .......... .......... .......... .......... .......... .......... 203 AACATTTAGA TGGGTCTTTT GATCGTTATG TAATAAATTC TTGTTTGTGC TAGAATTCAC 72731 .......... .......... .......... .......... .......... .......... 203 CTAGTGTCAA ATGCCAGTGC AAGTGGAATT TAATATTCTG CATATACAAA ACTCTCGAAG 72791 .......... .......... .......... .......... .......... .......... 203 TTCAGTAGCT AAATTCAGTG TCATAAGTTG ATCTAATGAA GATGAAACAT TTTCTGGCTT 72851 .......... .......... .......... .......... .......... .......... 203 ATTAAATGCT GAAGTCAAAA GGTCATAGGG CTAGTTAGCA TTAAGGGACC GTTTGGAAAG 72911 .......... .......... .......... .......... .......... .......... 203 TCACCTAGTA ATTGTAATTG GTGTAACTAC TAGAATAGTA ATTACAAGCC TAACACACCT 72971 .......... .......... .......... .......... .......... .......... 203 AGTAATTATG CTTCCTATTT GCCACCGTGT ATGTATTTTT GGATGCACAA TTGCAATTAT 73031 .......... .......... .......... .......... .......... .......... 203 AAGATTATAT CAAGTCTTAA AATAAAAGTT AATTATTTAA ATGTATATTA GAAAAATAAG 73091 .......... .......... .......... .......... .......... .......... 203 AAACTTTATT AATGATATTT AATTAAATAT TTAAGATATA TATTATATTT TGAAAATGTA 73151 .......... .......... .......... .......... .......... .......... 203 TTAATTAATA AGCATATGTT CTTTAACTAA TATTATGAAA AAATAATTGA TTTATATTTT 73211 .......... .......... .......... .......... .......... .......... 203 TCAAATTTAG TGTATTTCAG TTGTATTGAT CATAAAAACT GAAAGTACAA CCCTTCGGAT 73271 .......... .......... .......... .......... .......... .......... 203 GGCCCACTGG TTTGAACTTG GGACTTCTGT GTTAGAGGTC TCAAGTTCAA AACCCTTTTG 73331 .......... .......... .......... .......... .......... .......... 203 CCAGCGAAAG CAAGGGGTTT GCCTTCTGGG CAGAGCTCGT CGCACCAGAC TTGCCTAGTG 73391 .......... .......... .......... .......... .......... .......... 203 GGTTACCTCT CTTATGTGGT TTGCGAGCTA TTACATAGGA GGCGGGGTTT TACCCTGTAT 73451 .......... .......... .......... .......... .......... .......... 203 GCACCCAAAG GGTAGCGGCT GTAAAAATTA GTAGTACAAG ATTTCTATGA ACATCGTTTG 73511 .......... .......... .......... .......... .......... .......... 203 ACAAAAAGAT TACTATTATA ATTAAATTTC ATAAATTATT AAAATATTTG ATAAAAAGAT 73571 .......... .......... .......... .......... .......... .......... 203 AATTTATCAA GTCTAACAAA AAGATAAATG ACTTGCAATC ACACCAGATT GAATATGTGA 73631 .......... .......... .......... .......... .......... .......... 203 CTTTTGATTC AAACTGATCT TCTTCTTTTA CTTTATGACC TGTTAAGTGC TTGTTGCCTT 73691 .......... .......... .......... .......... .......... .......... 203 TATAATATCC TGTTTGTAAG TTTTCAATCA GGAGAATCTT ACAACTTGCT AGTAGAAAAT 73751 .......... .......... .......... .......... .......... .......... 203 ACTATCTCAC GAGACCTATA ATGAAGGCGA GGAATTCTCG TCACTTGTCA TTGTGAAGTG 73811 .......... .......... .......... .......... .......... .......... 203 AGCCAGTACT TAAAGTCTGT GTTAGTTTTC AATTTTTTTC CTTAAGACGT AACTCTAAGT 73871 .......... .......... .......... .......... .......... .......... 203 AATCACCTGT AGTGATGATA TTCTTTTACC TATCAAAAAA ATAAATATGA AATGATGACA 73931 .......... .......... .......... .......... .......... .......... 203 TTTTTTGTTT TTTATCAAGG TCCTGGAATT GGTGGGAACT ATGGCCCATA CAGGCAGTCT 73991 | |||||||||| |||||||||| |||||||||| |||||||||| .......... .........G TCCTGGAATT GGTGGGAACT ATGGCCCATA CAGGCAGTCT 244 GAGAGGAATG CCCTTTACAA GGAATTTGCT GAAAAACTTT TACAATCCGG TCATGTTTAT 74051 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAGAGGAATG CCCTTTACAA GGAATTTGCT GAAAAACTTT TACAATCCGG TCATGTTTAT 304 CGATGTTTTT GCTCAAATGA GGTGATTGTA TTTAATTTTG ATTTCTCTCC TTTGGTCTCT 74111 |||||||||| |||||||||| | CGATGTTTTT GCTCAAATGA G......... .......... .......... .......... 325 CCGAGTTTTG CAGTGAGAAT TTTGAGAGTA AAAATCTGTA CATCTAGAAT GTACTTTGAC 74171 .......... .......... .......... .......... .......... .......... 325 AGAAGCAGAT ATTCGTGCTG CAGAATTCTT TTAGATTCCA CCTATTAGAC TAGTTTCAGA 74231 .......... .......... .......... .......... .......... .......... 325 AGCATGATGC TCTCAAGTTT GATGCCATCT AAAACTGCTC CACTGCTATT TGCTTGATGG 74291 .......... .......... .......... .......... .......... .......... 325 GTCAAAACAT TTGTCCACTT TGTGGTTTTA GTATATTTTT TGAATGATTG TGTAATACAG 74351 .......... .......... .......... .......... .......... .......... 325 TAACCATTTT CTGTTGTTTA GGAATTAGAA AAGATGAAAG AGATGGCAAA ATTGAAGCAG 74411 ||||||||| |||||||||| |||||||||| |||||||||| .......... .......... .GAATTAGAA AAGATGAAAG AGATGGCAAA ATTGAAGCAG 364 TTGCCTCCCG TGTACACTGG GAGGTGGGCC AGTGCTACAG AGCAGGAAGT TCTAGAAGAG 74471 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGCCTCCCG TGTACACTGG GAGGTGGGCC AGTGCTACAG AGCAGGAAGT TCTAGAAGAG 424 CTGACAAAGG GGACCCCATA CACATATCGG TTTCGAGTAC CA 74513 |||||||||| |||||||||| |||||||||| |||||||||| || CTGACAAAGG GGACCCCATA CACATATCGG TTTCGAGTAC CA 466 hqPGS_C01HBa0088L02.1+_SGN-E281040+ (68892 68975,69124 69242,73951 74072,74373 74513) ******************************************************************************** EST sequence 34 +strand 174 n (File: SGN-E285925+) 1 AAATCTGTCT TTTGGCGGCT GCGTCGAAGT TGAGCGAAGA ATGGCGACGG TGGCGGCGGC 61 GCCGTGGTTT AGAGCAAGGT TGATCCCGGA GTTAAAGAGT CGCCAGTCAC TACTGTATTG 121 TCGCAACGGC CCCCGCAGGT ATCCGCAAAG TCTCTGTTTC CGGAGAAGAA GTTT Predicted gene structure (within gDNA segment 68082 to 69465): Exon 1 68682 68855 ( 174 n); cDNA 1 174 ( 174 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E285925+ 1.000 174 1.000 C PGS_C01HBa0088L02.1+_SGN-E285925+ (68682 68855) Alignment (genomic DNA sequence = upper lines): AAATCTGTCT TTTGGCGGCT GCGTCGAAGT TGAGCGAAGA ATGGCGACGG TGGCGGCGGC 68741 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAATCTGTCT TTTGGCGGCT GCGTCGAAGT TGAGCGAAGA ATGGCGACGG TGGCGGCGGC 60 GCCGTGGTTT AGAGCAAGGT TGATCCCGGA GTTAAAGAGT CGCCAGTCAC TACTGTATTG 68801 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCCGTGGTTT AGAGCAAGGT TGATCCCGGA GTTAAAGAGT CGCCAGTCAC TACTGTATTG 120 TCGCAACGGC CCCCGCAGGT ATCCGCAAAG TCTCTGTTTC CGGAGAAGAA GTTT 68855 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||| TCGCAACGGC CCCCGCAGGT ATCCGCAAAG TCTCTGTTTC CGGAGAAGAA GTTT 174 hqPGS_C01HBa0088L02.1+_SGN-E285925+ (68682 68855) ******************************************************************************** EST sequence 29 +strand 506 n (File: SGN-E202599+) 1 AGTGCTACAG AGCAGGAAGT TCTAGAAGAG CTGACAAAGG GGACCCCATA CACATATCGG 61 TTTCGAGTAC CAAAAGAAGG GAGTTTAAAA ATTGATGACC TCATTCGTGG TGAATTGGAA 121 CTTCGACACT CTTGGAGACT TTGTGATCAT GAGAAGTAAT GGACAACCCG TTTACAATTT 181 TTGTGTCACA GTTGATGATG CTACTATGGC TATCTCCCAT GTCATAAGAG CGGAGGAACA 241 TTTGCCGAAT ACTCTAAGGC AAGCATTAAT ATACAAGGCA CTAGGTTTTC CAATGCCTCA 301 CTTTGCGCAT GTTTCTTTAA TTCTTGCCCC TGATAGAAGC AAGCTCTCGA AACGGCATGG 361 TGCAACTTCA GTTGGTCAGT TCAGGGACAT GGGCTATTTG CCTCAGGCAA TGGTGAACTA 421 TCTAGCTCTC TTGGGATGGG GCGATGGTAC AGAAAATGAG TTTTTCTCCC TTGAGCAGCT 481 TGTTGAAAAG TTCACAATTG AACGTG Predicted gene structure (within gDNA segment 73842 to 79694): Exon 1 74442 74555 ( 114 n); cDNA 1 114 ( 114 n); score: 1.000 Intron 1 74556 77507 (2952 n); Pd: 0.982 (s: 1.00), Pa: 0.289 (s: 1.00) Exon 2 77508 77621 ( 114 n); cDNA 115 228 ( 114 n); score: 1.000 Intron 2 77622 78274 ( 653 n); Pd: 0.998 (s: 1.00), Pa: 0.991 (s: 1.00) Exon 3 78275 78323 ( 49 n); cDNA 229 277 ( 49 n); score: 1.000 Intron 3 78324 78484 ( 161 n); Pd: 0.000 (s: 1.00), Pa: 0.985 (s: 1.00) Exon 4 78485 78586 ( 102 n); cDNA 278 379 ( 102 n); score: 1.000 Intron 4 78587 78741 ( 155 n); Pd: 0.966 (s: 1.00), Pa: 0.913 (s: 1.00) Exon 5 78742 78844 ( 103 n); cDNA 380 482 ( 103 n); score: 1.000 Intron 5 78845 78948 ( 104 n); Pd: 0.975 (s: 1.00), Pa: 0.975 (s: 0) Exon 6 78949 78972 ( 24 n); cDNA 483 506 ( 24 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E202599+ 1.000 506 1.000 C PGS_C01HBa0088L02.1+_SGN-E202599+ (74442 74555,77508 77621,78275 78323,78485 78586,78742 78844,78949 78972) Alignment (genomic DNA sequence = upper lines): AGTGCTACAG AGCAGGAAGT TCTAGAAGAG CTGACAAAGG GGACCCCATA CACATATCGG 74501 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTGCTACAG AGCAGGAAGT TCTAGAAGAG CTGACAAAGG GGACCCCATA CACATATCGG 60 TTTCGAGTAC CAAAAGAAGG GAGTTTAAAA ATTGATGACC TCATTCGTGG TGAAGTTAGT 74561 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||| TTTCGAGTAC CAAAAGAAGG GAGTTTAAAA ATTGATGACC TCATTCGTGG TGAA...... 114 GATATTTCTC TACTGTTTTT TACAAGTAAA TTTATTTACC CATTTAGGCT GGTGGTTTTC 74621 .......... .......... .......... .......... .......... .......... 114 CTCTTTTTAT TGTCATAATT GCAGTCTAGA CTATAATGTT GTACTGCCAA CAGGTGAATA 74681 .......... .......... .......... .......... .......... .......... 114 AATTGAAGAA GTTTTTTTTA GTCCAACCTA ACAATGACAA GTTTATTGCT TAAAACATTG 74741 .......... .......... .......... .......... .......... .......... 114 TGTTTGATGT TATGCTTGGT TCTTCTAGAA GATTAGAAAT AAAAGAAGAA AAAGAGGGAG 74801 .......... .......... .......... .......... .......... .......... 114 AGGGGGGGTT ACCTTCTCAA GGAAAAATGA AGGAAGAAGG GTGGTGGTTC TGAGTAGTTT 74861 .......... .......... .......... .......... .......... .......... 114 CTTGGCAGGG AACAATTATC TTAGGATGGA TTTAATATGA TTTTAAGTTG CTGACTATCT 74921 .......... .......... .......... .......... .......... .......... 114 ATTTCTTAAA AGTAAGAGCT ATGATTACAC AATTTTATTA CCTTGCTTAG ATAGGAGGAC 74981 .......... .......... .......... .......... .......... .......... 114 TAACTTCTCT AGGTTATCAA TTGGTAGCTT CAAACTCAGT AAATGCTGTG TAGTAATATG 75041 .......... .......... .......... .......... .......... .......... 114 GTGATTATAA TGCTTTAGTG ATTGAGTTTA AGCTACTGTT GCTTGGGGGT TTGAACCTTA 75101 .......... .......... .......... .......... .......... .......... 114 TCAACCTTAT ATAGCTTGTT TTCATTTCAT AAAATCTTGT ATTTTTACAA TCATTTAATT 75161 .......... .......... .......... .......... .......... .......... 114 GAATTTCACA GAAAACTGAA AGGTGGTTGT TTATTATGTC TTTTGAAACT CTCTTCATTT 75221 .......... .......... .......... .......... .......... .......... 114 CATGTCAATA TCTTTTGTAC TATTCATCTA CTATTAAACA TCACTCATGT TATGGTTCTC 75281 .......... .......... .......... .......... .......... .......... 114 CCAATTTTTT TTCAATTTTC ATGAAATGGA ACTTTTGTTG TTGACATACT TTTGAACACT 75341 .......... .......... .......... .......... .......... .......... 114 TTCAAATATC TATTATGGGA AATCGCAAGT GGGCCACTTT TATAGTAGAG ATTAGGTGTG 75401 .......... .......... .......... .......... .......... .......... 114 TCAAATGGGC GGGTTGGGTT GAAAATGAGA ATATTAAAAT GGGTTGAATA AAAGTCGGGT 75461 .......... .......... .......... .......... .......... .......... 114 TGGGTCTTGA CCCGCCCAAG TTTACTTTGG GCTCAAATGG GCTTAAAAAC GGGTTGGGTC 75521 .......... .......... .......... .......... .......... .......... 114 TTGACCCACC CAATTAGACC CGATTAATCT CAATAATTTA ACATATTGAT ATTTAACTTT 75581 .......... .......... .......... .......... .......... .......... 114 TTATAATCAC AATTTGAATT TTAGCTCAAG AATTTTTATA AAAAGTAACA AATGGATAGA 75641 .......... .......... .......... .......... .......... .......... 114 TAAACCCTAA AAGATTGAAG TATTTTCTAG ATATTCAGGT TGCTAGTTTA GATCATGTAT 75701 .......... .......... .......... .......... .......... .......... 114 TGGTATTTCT CAACGCAAGT ATGCCTTAGA CATTCTTGAG GGGACGGGAA TGATGAGATG 75761 .......... .......... .......... .......... .......... .......... 114 TAGACCTATT GACACTTCTA TGGATCCAAA TGTTAAACTC CTTCCGGGAC GGGGGATCCA 75821 .......... .......... .......... .......... .......... .......... 114 CTTAGTAATC CTGACAGGTA TAGACGGCTC ATTGGAAAAT TGAATTATCT CACCGTAACT 75881 .......... .......... .......... .......... .......... .......... 114 AGACCTGACA TCTCTTTTCC AGTGAGTGTT CTAAGTCAGT TTATGACTTC CCCTTGTAAT 75941 .......... .......... .......... .......... .......... .......... 114 AGTCATTGGG AAACAATTGT TTGTATCCTG CAATATATAA AGTCAGCTCC TGATAAAGGA 76001 .......... .......... .......... .......... .......... .......... 114 CTACTCTATG AGGATCAAGG CCATGAGCAT ATCATTGGAG CTGATTGGAC AGGCTCTGAT 76061 .......... .......... .......... .......... .......... .......... 114 AGACGTTCGA CATCCGAATA TTGTGTTTTA ATAGAAGGTA ATTTGGTGTT GTGGAAGAGT 76121 .......... .......... .......... .......... .......... .......... 114 AAGACACAAA GTGTGGTTGC TTGATTTAGT GCAGAATCAG AATATCGAGC AATCGCGGCG 76181 .......... .......... .......... .......... .......... .......... 114 GCAGCAACTT GTGAGCTAGG TTTGGATCAA ACCGTTGTTG GGAGAACTAA AATTTGACAA 76241 .......... .......... .......... .......... .......... .......... 114 AATTGTGTGA CAATCAAGCA ACTCTTCATA TCACATCAAA TCCAGTGTTT CATGAAAGGA 76301 .......... .......... .......... .......... .......... .......... 114 CTAAGAACAT TGAGATTGAC TGTCACTTTT TCAGGGAAAA GATACACTCA GGAGATATTG 76361 .......... .......... .......... .......... .......... .......... 114 TTACGAAATT TGTGAAGTCA AATGATCAGC TTGCAGATTC TTCACCAAGT CCATCACAAG 76421 .......... .......... .......... .......... .......... .......... 114 TCCTCGTATT AATTACATTT GTAACAAGCT AGGTAAATAT GATTTGTATG CACCAGCTCG 76481 .......... .......... .......... .......... .......... .......... 114 AGGGGGAGTG TTAGAATAGT AATATGTATA TATATTCCTA CTTAGAATCG AAATAGGAAT 76541 .......... .......... .......... .......... .......... .......... 114 CCTACTTAGA AAAGGATTTC AATGTATTGT CTATAAATAG GGTCTAATGC AACAATTTAG 76601 .......... .......... .......... .......... .......... .......... 114 ATACACAATT CAATAATATT TTTCTCATAT AAGTCTGATA AGTCTCAAAG TGTAATCAAA 76661 .......... .......... .......... .......... .......... .......... 114 TCTACTCTAA TGACTTTGTC TCTATCATTG ATGTTTTAGA CTCATTATAG GGATAGGACG 76721 .......... .......... .......... .......... .......... .......... 114 AGAGAGTGCC TTTAGAGTTC ATTTTGTGAA TATGGTTTTC AGTACAACCC ATGTATTGAT 76781 .......... .......... .......... .......... .......... .......... 114 TTACAGAAAT AGAAACAGTT AGCAATCTCA AAAAATTATA ATTTCAATAA TATTGTTACA 76841 .......... .......... .......... .......... .......... .......... 114 CCAACAAAAA ACTATGTGTA TAGAGTGGAG ATGCCGCGCA CTATGAAATA ATCAATGGGT 76901 .......... .......... .......... .......... .......... .......... 114 AGTTGAGTAT TTAAAAGGCA GAAGAGAAGA CTTACCGCAT GGGATATTGC TTTTTAAGGA 76961 .......... .......... .......... .......... .......... .......... 114 CTCATGTGGA CTATACGGAG AGAGAAGTAG GAGAGCTTCC AAGGGCGTAG TGCAAGATTT 77021 .......... .......... .......... .......... .......... .......... 114 TGTACACTTG ATGAATAGCC TCTTTTTCTC TTGTTGGTGC ACCCTCTAGG TTCCTATTTG 77081 .......... .......... .......... .......... .......... .......... 114 TAAAATGATT GTGTTGTTCG TAGAAAATCA TGTCTTGTTG TGAGTTTTCT ATTTTGATTT 77141 .......... .......... .......... .......... .......... .......... 114 ACTCCTTGTA TACATGCACT TTTTTGCAAT AAAATTTGTT AGTTTATACA AAAACACCTT 77201 .......... .......... .......... .......... .......... .......... 114 CGTACTATAT ATTTTTGGGT TAGGAAGAAC CAAGTAGGAG TAGAATATGT ACTCATTTAA 77261 .......... .......... .......... .......... .......... .......... 114 TTGAGAAGTC CTATAATTTC TGCAAAACAG TAGTGTAATA GTAGCTGCTT GGTACTTGGT 77321 .......... .......... .......... .......... .......... .......... 114 AATGGACTAA AATTTTGCAT ATCTTTGAAA AAGAGTTAAT GACTGAAATG ATATAACTGT 77381 .......... .......... .......... .......... .......... .......... 114 AGGTTTTCAA TCTTTGACAA GAAAGTAACT AAATGCTGGG AATCTCCTGT GCAATGCACG 77441 .......... .......... .......... .......... .......... .......... 114 GGCAAAATAC TAGTACATCT TGGTAATTAT GGAGGACTGA CTCTGTTACA CTTTCATGAA 77501 .......... .......... .......... .......... .......... .......... 114 GGTCAGTTGG AACTTCGACA CTCTTGGAGA CTTTGTGATC ATGAGAAGTA ATGGACAACC 77561 |||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ......TTGG AACTTCGACA CTCTTGGAGA CTTTGTGATC ATGAGAAGTA ATGGACAACC 168 CGTTTACAAT TTTTGTGTCA CAGTTGATGA TGCTACTATG GCTATCTCCC ATGTCATAAG 77621 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CGTTTACAAT TTTTGTGTCA CAGTTGATGA TGCTACTATG GCTATCTCCC ATGTCATAAG 228 GTAATAGATT AATCTAATTA TAATACTGTA TGACCCCCCC CCCAAAATAT ACTGTATGAC 77681 .......... .......... .......... .......... .......... .......... 228 CCCCCCAAAA ATACTGTATG ATGAGCCTGA TGCTCCAGAG GCCAAGGACA TTGTAGATTC 77741 .......... .......... .......... .......... .......... .......... 228 CCACTGAGAA GTTGAGGTGA CAGTGAAGAG GGTTATATAG TTATATGATC TATTAGTTAT 77801 .......... .......... .......... .......... .......... .......... 228 TAAAATGAAA CATCAGTCAT GATGTAACTA TGTGTTTAAA ATGTAGTTCT CACTGTTGTG 77861 .......... .......... .......... .......... .......... .......... 228 GCGTTTACTA GATGATGATT ATCAAAATTT ATTCCACTTG ACAATGGATT CAGATTGGTG 77921 .......... .......... .......... .......... .......... .......... 228 GTAGTGAGGT CCTGAAATGT CAAGGAATGA CTATTATAGA TTCTAACATG TGCAAGAACA 77981 .......... .......... .......... .......... .......... .......... 228 ATTTTGTTTC CTTTTCAGTT GTCTCTATCT TACACGGACT CATCCATTTG TCTTGATATA 78041 .......... .......... .......... .......... .......... .......... 228 CCATTGTCTA ATGGGTATGA CACGGTTACC TTGAAAATGT ACTGAAAACT TGCCAAAAAT 78101 .......... .......... .......... .......... .......... .......... 228 CGAGCTTACC CATGCCATAA TTTGTACTTG AGGGATGAGA CTATGACTCC ATGTAACATA 78161 .......... .......... .......... .......... .......... .......... 228 GTTTATATCA TTTTGTTTTC TGCACATGGA TACTGCCACC TTTTACATAT GTAGCATGTA 78221 .......... .......... .......... .......... .......... .......... 228 TTTTTGAATT GATTATTTGG TACTCAAGTA CTGATGAAAT GTTGATGCTT CAGAGCGGAG 78281 ||||||| .......... .......... .......... .......... .......... ...AGCGGAG 235 GAACATTTGC CGAATACTCT AAGGCAAGCA TTAATATACA AGGTACTGCT TTCCTAGTAC 78341 |||||||||| |||||||||| |||||||||| |||||||||| || GAACATTTGC CGAATACTCT AAGGCAAGCA TTAATATACA AG........ .......... 277 CCCCCACCCC CCACCCCCAA AAAAGGGGGG GGGGGAAATA GAGTAGAGAA AACGGAAAAA 78401 .......... .......... .......... .......... .......... .......... 277 GAAGAAAAGA ATCACGAGGT AGTTTTGTAT ATGATTTCTC TCTTAGAAGC TTATGGGGAA 78461 .......... .......... .......... .......... .......... .......... 277 AAATCTTTGT TACCTTGCTG CAGGCACTAG GTTTTCCAAT GCCTCACTTT GCGCATGTTT 78521 ||||||| |||||||||| |||||||||| |||||||||| .......... .......... ...GCACTAG GTTTTCCAAT GCCTCACTTT GCGCATGTTT 314 CTTTAATTCT TGCCCCTGAT AGAAGCAAGC TCTCGAAACG GCATGGTGCA ACTTCAGTTG 78581 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTTTAATTCT TGCCCCTGAT AGAAGCAAGC TCTCGAAACG GCATGGTGCA ACTTCAGTTG 374 GTCAGGTAAA TACAGACACA CGATTGCATG CTTTCCTTGT GAAACAGTTT TAGGGGTATA 78641 ||||| GTCAG..... .......... .......... .......... .......... .......... 379 CTTGTCTGAG ACATGAGTTA TTCCTTTGCT TCAATGTTAT CTACCCTTTC CTTTTGAGCT 78701 .......... .......... .......... .......... .......... .......... 379 GGTGAAGTGA GAAATCTTAG TGTTTTCCTT TTGCTGACAG TTCAGGGACA TGGGCTATTT 78761 |||||||||| |||||||||| .......... .......... .......... .......... TTCAGGGACA TGGGCTATTT 399 GCCTCAGGCA ATGGTGAACT ATCTAGCTCT CTTGGGATGG GGCGATGGTA CAGAAAATGA 78821 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCCTCAGGCA ATGGTGAACT ATCTAGCTCT CTTGGGATGG GGCGATGGTA CAGAAAATGA 459 GTTTTTCTCC CTTGAGCAGC TTGGTAAGTG ATTGCCTCTA TGCTGATGTT GACATGTCTA 78881 |||||||||| |||||||||| ||| GTTTTTCTCC CTTGAGCAGC TTG....... .......... .......... .......... 482 ATGCTAACTT GCAGTCATTA CTATTTATTC ACATTCCAAC AGTGATAGCT TCTCATTTCA 78941 .......... .......... .......... .......... .......... .......... 482 TTTGCAGTTG AAAAGTTCAC AATTGAACGT G 78972 ||| |||||||||| |||||||||| | .......TTG AAAAGTTCAC AATTGAACGT G 506 hqPGS_C01HBa0088L02.1+_SGN-E202599+ (74442 74555,77508 77621,78275 78323,78485 78586,78742 78844,78949 78972) ******************************************************************************** EST sequence 75 +strand 485 n (File: SGN-E246763+) 1 GAAAACGGAA AAAGAAGAAA AGAATCACGA GGTAGTTTTG TATATGATTT CTCTCTTAGA 61 AGCTTATGGG GAAAAATCTT TGTTACCTTG CTGCAGGCAC TAGGTTTTCC AATGCCTCAC 121 TTTGCGCATG TTTCTTTAAT TCTTGCCCCT GATAGAAGCA AGCTCTCGAA ACGGCATGGT 181 GCAACTTCAG TTGGTCAGTT CAGGGACATG GGCTATTTGC CTCAGGCAAT GGTGAACTAT 241 CTAGCTCTCT TGGGATGGGG CGATGGTACA GAAAATGAGT TTTTCTCCCT TGAGCAGCTT 301 GTTGAAAAGT TCACAATTGA ACGTGTAAAC AAAAGTGGTG CCATATTTGA TTCGACCAAG 361 TTAAGGTGGA TGAATGGTCA GCATTTGAGA TCACTTCCAT CTGAAGAGTT GAACCAAATC 421 ATTGGTGAAA GGTGGAAGGA TGCAGACATC GTTACAGAAT CACAAGGAGT TTTTGTACAA 481 GATGC Predicted gene structure (within gDNA segment 77789 to 80316): Exon 1 78389 78586 ( 198 n); cDNA 1 198 ( 198 n); score: 1.000 Intron 1 78587 78741 ( 155 n); Pd: 0.966 (s: 1.00), Pa: 0.913 (s: 1.00) Exon 2 78742 78844 ( 103 n); cDNA 199 301 ( 103 n); score: 1.000 Intron 2 78845 78948 ( 104 n); Pd: 0.975 (s: 1.00), Pa: 0.975 (s: 1.00) Exon 3 78949 79012 ( 64 n); cDNA 302 365 ( 64 n); score: 1.000 Intron 3 79013 79532 ( 520 n); Pd: 0.477 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 4 79533 79647 ( 115 n); cDNA 366 480 ( 115 n); score: 0.991 Intron 4 79648 79876 ( 229 n); Pd: 0.999 (s: 0.98), Pa: 0.999 (s: 0) Exon 5 79877 79881 ( 5 n); cDNA 481 485 ( 5 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E246763+ 0.998 485 1.000 C PGS_C01HBa0088L02.1+_SGN-E246763+ (78389 78586,78742 78844,78949 79012,79533 79647,79877 79881) Alignment (genomic DNA sequence = upper lines): GAAAACGGAA AAAGAAGAAA AGAATCACGA GGTAGTTTTG TATATGATTT CTCTCTTAGA 78448 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GAAAACGGAA AAAGAAGAAA AGAATCACGA GGTAGTTTTG TATATGATTT CTCTCTTAGA 60 AGCTTATGGG GAAAAATCTT TGTTACCTTG CTGCAGGCAC TAGGTTTTCC AATGCCTCAC 78508 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGCTTATGGG GAAAAATCTT TGTTACCTTG CTGCAGGCAC TAGGTTTTCC AATGCCTCAC 120 TTTGCGCATG TTTCTTTAAT TCTTGCCCCT GATAGAAGCA AGCTCTCGAA ACGGCATGGT 78568 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTGCGCATG TTTCTTTAAT TCTTGCCCCT GATAGAAGCA AGCTCTCGAA ACGGCATGGT 180 GCAACTTCAG TTGGTCAGGT AAATACAGAC ACACGATTGC ATGCTTTCCT TGTGAAACAG 78628 |||||||||| |||||||| GCAACTTCAG TTGGTCAG.. .......... .......... .......... .......... 198 TTTTAGGGGT ATACTTGTCT GAGACATGAG TTATTCCTTT GCTTCAATGT TATCTACCCT 78688 .......... .......... .......... .......... .......... .......... 198 TTCCTTTTGA GCTGGTGAAG TGAGAAATCT TAGTGTTTTC CTTTTGCTGA CAGTTCAGGG 78748 ||||||| .......... .......... .......... .......... .......... ...TTCAGGG 205 ACATGGGCTA TTTGCCTCAG GCAATGGTGA ACTATCTAGC TCTCTTGGGA TGGGGCGATG 78808 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ACATGGGCTA TTTGCCTCAG GCAATGGTGA ACTATCTAGC TCTCTTGGGA TGGGGCGATG 265 GTACAGAAAA TGAGTTTTTC TCCCTTGAGC AGCTTGGTAA GTGATTGCCT CTATGCTGAT 78868 |||||||||| |||||||||| |||||||||| |||||| GTACAGAAAA TGAGTTTTTC TCCCTTGAGC AGCTTG.... .......... .......... 301 GTTGACATGT CTAATGCTAA CTTGCAGTCA TTACTATTTA TTCACATTCC AACAGTGATA 78928 .......... .......... .......... .......... .......... .......... 301 GCTTCTCATT TCATTTGCAG TTGAAAAGTT CACAATTGAA CGTGTAAACA AAAGTGGTGC 78988 |||||||||| |||||||||| |||||||||| |||||||||| .......... .......... TTGAAAAGTT CACAATTGAA CGTGTAAACA AAAGTGGTGC 341 CATATTTGAT TCGACCAAGT TAAGGTATTG TGTGTGTGTA TATATATATC AATTTCTTTT 79048 |||||||||| |||||||||| |||| CATATTTGAT TCGACCAAGT TAAG...... .......... .......... .......... 365 TGATTGGTGA GAGAGTAGCT CCTATTGATA TATGCACAGC CAAAAGATAA TGCTGGAGGG 79108 .......... .......... .......... .......... .......... .......... 365 TTACAACCAG AAACAATAAC CATCACAGGT TGTGTAAATT GTAAATCACT AATCAAGTCA 79168 .......... .......... .......... .......... .......... .......... 365 ATCATGACAC CAAAAACATT TACATCTGCC ATGCTACAGC AAAAACTAAA TAAAAAAATA 79228 .......... .......... .......... .......... .......... .......... 365 CATATGCATT TAACTTGTAT ATCAGAACAT TTTGTCTTCA AACTTCCTGA TGTTTCCTTC 79288 .......... .......... .......... .......... .......... .......... 365 ATTCCATAAG CTCCACCAAA CGGTGGAGAT GCAGCAAGAA ACCCAAAAAC AATTCCAATT 79348 .......... .......... .......... .......... .......... .......... 365 TACATATGAT TGAAAGCTTT CTCATTTTCC AATTTGCAAA GATACCCTGG AATACTTCGT 79408 .......... .......... .......... .......... .......... .......... 365 CTCCTCCTCG AATCAATACA TTGCTATATT TTCTTCTGCT ACATGGATAG GCTTGGTTAC 79468 .......... .......... .......... .......... .......... .......... 365 CAAGACATTA TGAAATTGAA TTATATGTCT TGATTGTTGT TTAAAATATG GTTATGAACT 79528 .......... .......... .......... .......... .......... .......... 365 TCAGGTGGAT GAATGGTCAG CATTTGAGAT CACTTCCATC TGAAGAGTTG AACCAAATCA 79588 |||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ....GTGGAT GAATGGTCAG CATTTGAGAT CACTTCCATC TGAAGAGTTG AACCAAATCA 421 TTGGTGAAAG GTGGAAGGAT GCAGACATCG TTACAGAATC ACAAGGAGTT TTTGTACAGG 79648 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||| TTGGTGAAAG GTGGAAGGAT GCAGACATCG TTACAGAATC ACAAGGAGTT TTTGTACAA. 480 TAGAAATTTT CCCCTCTCTT TCATTTCTCA ACCACATTGT TACTACAAGA TTTTTCTTAA 79708 .......... .......... .......... .......... .......... .......... 480 TCATCTTTGT GGAGATCTAA CAACGAGATT TTGGAGGATT TTTCTTAATA ATCTTTCCCG 79768 .......... .......... .......... .......... .......... .......... 480 AATGGCTGTT GCATAGATGC TTGTCATTAA ATATCAATTC AAAAAATTGT TGCTCAATGT 79828 .......... .......... .......... .......... .......... .......... 480 ACTTTGGAGT TATGGTTCTT ATACCTGTTA AATTTTCTGT ATATATAGGA TGC 79881 || ||| .......... .......... .......... .......... ........GA TGC 485 hqPGS_C01HBa0088L02.1+_SGN-E246763+ (78389 78586,78742 78844,78949 79012,79533 79647,79877 79881) ******************************************************************************** EST sequence 121 -strand 713 n (File: SGN-E371394-) 1 GCAGCTTGTT GAAAAGTTCA CAATTGAACG TGTAAACAAA AGTGGTGCCA TATTTGATTC 61 GACCAAGTTA AGGTGGATGA ATGGTCAGCA TTTGAGATCA CTTCCATCTG AAGAGTTGAA 121 CCAAATCATT GGTGAAAGGT GGAAGGATGC AGACATCGTT ACAGAATCAC AAGGAGTTTT 181 TGTACAGGAT GCTGTTCTAC TCCTCAAAGA TGGGATTGAC TTGATACCAG ATTCAGAGAA 241 AGCACTTTCA AGTTTGCTAT CTTATCCTTT ATATGAAACT TTGACAAGCA CGGAAGGAAA 301 ACTGATCTTA GAAGATGGAG TCTCTGAAGT TGCTAAGAGC TTGTTAGCAG CCTACGACAG 361 TGGTGAGCTC TGTGGTGCAC TTGCAGAAGG CCAACCTGGA TGGAGAAACT GGGTGAAGAA 421 GTTCGGTAAA TTGCTGAAGC GCAAGGGAAA ATCTCTCTTC ATGCCCCTTC GGGTGTTGCT 481 AACAGGAAAG CTTCATGGAC CTGATATTGG GGCCACCACA GTATTACTCT ATAAAGCTGG 541 AACATCTGGT TCTGTAGCAC CCCAAGCTGG GTTTGTTACA TTTGATGAAA GATTTAAGAT 601 ATTGAGAGAA GTTCAATGGG AGTCGTTCAG CTCAAATGTG CCTTTGTCTG CTGGTGTTGT 661 AACGCATTGA GATTGTGGCG ATATTCTGTT TTGATTATCC ATTAAAAAAA AAA Predicted gene structure (within gDNA segment 78268 to 84414): Exon 1 78837 78844 ( 8 n); cDNA 1 8 ( 8 n); score: 1.000 Intron 1 78845 78948 ( 104 n); Pd: 0.975 (s: 0), Pa: 0.975 (s: 1.00) Exon 2 78949 79012 ( 64 n); cDNA 9 72 ( 64 n); score: 1.000 Intron 2 79013 79532 ( 520 n); Pd: 0.477 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 79533 79647 ( 115 n); cDNA 73 187 ( 115 n); score: 1.000 Intron 3 79648 79876 ( 229 n); Pd: 0.999 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 4 79877 79977 ( 101 n); cDNA 188 288 ( 101 n); score: 1.000 Intron 4 79978 83235 (3258 n); Pd: 0.542 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 5 83236 83392 ( 157 n); cDNA 289 445 ( 157 n); score: 1.000 Intron 5 83393 83465 ( 73 n); Pd: 0.989 (s: 1.00), Pa: 0.988 (s: 1.00) Exon 6 83466 83724 ( 259 n); cDNA 446 704 ( 259 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E371394- 1.000 704 0.987 C PGS_C01HBa0088L02.1+_SGN-E371394- (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) Alignment (genomic DNA sequence = upper lines): GCAGCTTGGT AAGTGATTGC CTCTATGCTG ATGTTGACAT GTCTAATGCT AACTTGCAGT 78896 |||||||| GCAGCTTG.. .......... .......... .......... .......... .......... 8 CATTACTATT TATTCACATT CCAACAGTGA TAGCTTCTCA TTTCATTTGC AGTTGAAAAG 78956 |||||||| .......... .......... .......... .......... .......... ..TTGAAAAG 16 TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAGGTAT 79016 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAG.... 72 TGTGTGTGTG TATATATATA TCAATTTCTT TTTGATTGGT GAGAGAGTAG CTCCTATTGA 79076 .......... .......... .......... .......... .......... .......... 72 TATATGCACA GCCAAAAGAT AATGCTGGAG GGTTACAACC AGAAACAATA ACCATCACAG 79136 .......... .......... .......... .......... .......... .......... 72 GTTGTGTAAA TTGTAAATCA CTAATCAAGT CAATCATGAC ACCAAAAACA TTTACATCTG 79196 .......... .......... .......... .......... .......... .......... 72 CCATGCTACA GCAAAAACTA AATAAAAAAA TACATATGCA TTTAACTTGT ATATCAGAAC 79256 .......... .......... .......... .......... .......... .......... 72 ATTTTGTCTT CAAACTTCCT GATGTTTCCT TCATTCCATA AGCTCCACCA AACGGTGGAG 79316 .......... .......... .......... .......... .......... .......... 72 ATGCAGCAAG AAACCCAAAA ACAATTCCAA TTTACATATG ATTGAAAGCT TTCTCATTTT 79376 .......... .......... .......... .......... .......... .......... 72 CCAATTTGCA AAGATACCCT GGAATACTTC GTCTCCTCCT CGAATCAATA CATTGCTATA 79436 .......... .......... .......... .......... .......... .......... 72 TTTTCTTCTG CTACATGGAT AGGCTTGGTT ACCAAGACAT TATGAAATTG AATTATATGT 79496 .......... .......... .......... .......... .......... .......... 72 CTTGATTGTT GTTTAAAATA TGGTTATGAA CTTCAGGTGG ATGAATGGTC AGCATTTGAG 79556 |||| |||||||||| |||||||||| .......... .......... .......... ......GTGG ATGAATGGTC AGCATTTGAG 96 ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 79616 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 156 CGTTACAGAA TCACAAGGAG TTTTTGTACA GGTAGAAATT TTCCCCTCTC TTTCATTTCT 79676 |||||||||| |||||||||| |||||||||| | CGTTACAGAA TCACAAGGAG TTTTTGTACA G......... .......... .......... 187 CAACCACATT GTTACTACAA GATTTTTCTT AATCATCTTT GTGGAGATCT AACAACGAGA 79736 .......... .......... .......... .......... .......... .......... 187 TTTTGGAGGA TTTTTCTTAA TAATCTTTCC CGAATGGCTG TTGCATAGAT GCTTGTCATT 79796 .......... .......... .......... .......... .......... .......... 187 AAATATCAAT TCAAAAAATT GTTGCTCAAT GTACTTTGGA GTTATGGTTC TTATACCTGT 79856 .......... .......... .......... .......... .......... .......... 187 TAAATTTTCT GTATATATAG GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 79916 |||||||||| |||||||||| |||||||||| |||||||||| .......... .......... GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 227 CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 79976 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 287 GGTGATCCAT GAAATTATGT TTTAAAACTA TACCTATGTG ACGCTAAAAG ATGAAAACAT 80036 | G......... .......... .......... .......... .......... .......... 288 GGAGGTTTCA ATTTGGTCCA TTCATTAAGG CGGGAATGAG AATATTTGTT GATTAATGAG 80096 .......... .......... .......... .......... .......... .......... 288 TTCAATTTTG TTATAAATAA AGGTAACTAA TTATATCCCA TTTACTCCAT TACCAAGTGA 80156 .......... .......... .......... .......... .......... .......... 288 ACACAAAAGA CGAGTTCCAC AACAAACATT GGTTCTTTGT AAAGGCAACC AATTGTCTAT 80216 .......... .......... .......... .......... .......... .......... 288 GGAAAAGGGT CGTATTTGCC CCTCTACTAT CAAAAAATAA GCTATATTTA CCCTCCGTTA 80276 .......... .......... .......... .......... .......... .......... 288 TACCTTTTCA ACAAATATCC TCCTATAGTC ATAATATAGA GCTATGTTTC TCACCCGTGA 80336 .......... .......... .......... .......... .......... .......... 288 AAACTTCACT TTCAGCTTTT AAAAGCCATG TGTTATTCTC TTATTGAACC AAATAATCAG 80396 .......... .......... .......... .......... .......... .......... 288 CCTCACTTTT GCCCGCACCC AAATCACTCT CATTTCTCTC TATCCGGAAG GTGTACTTGA 80456 .......... .......... .......... .......... .......... .......... 288 GCCTGCAAAA TCAATAGTTG GTCCAAAGCT CCCTAATCTT TCTTCTCCCC AATTCCATCA 80516 .......... .......... .......... .......... .......... .......... 288 TCTCATTCTT ATGCAACAAA ACCAAGTCTT ATTAGTTATA ATTTACTTAA TAAGTACAAG 80576 .......... .......... .......... .......... .......... .......... 288 GTATAATTTA AAAAATTGTT CCTATTTATT AAATGCTTTT TGAGAATTGA GTAGTACTAA 80636 .......... .......... .......... .......... .......... .......... 288 AAAGAACTAC TTTAATGTTA AGGGTGTGGT GATAACAATT GTCAACTTTA ATCTTGAATT 80696 .......... .......... .......... .......... .......... .......... 288 CCTAAAGCGA CAATTATTTT GAGCTAAAAT GATAGCAGAA AATGATGAAT AACTATATTT 80756 .......... .......... .......... .......... .......... .......... 288 GTTGTGAGGC GGGTGATATC TATGTTGAAC TTTGTATTTT TTTGTAAATT AAATAAAAAA 80816 .......... .......... .......... .......... .......... .......... 288 GGTTATATTA AAAATAGAGA AATTAAATCT CATGTAATGT TCTGTTATAT AATTACCATT 80876 .......... .......... .......... .......... .......... .......... 288 TGGGCAGGAT TTAAAATAGA ATATAGTGGA TTGCTTTACT TTTAATTCTG GATTTTGTCC 80936 .......... .......... .......... .......... .......... .......... 288 AAAAAGCATG GTAGTTTTAA CATTACTAGT TTTTTTCAAA AAGCATGCCA TTTTCCCAGA 80996 .......... .......... .......... .......... .......... .......... 288 AAGAAAATTA ATTTCTGGTA ACAATTTTTT CCATTTTCAA TGTTCTATTA TAAATCAATT 81056 .......... .......... .......... .......... .......... .......... 288 TACATTTTAG AGTGAGGGGT AAATATAGCC TGGTGTTTAA TAGTGAACTC TATAAAAATG 81116 .......... .......... .......... .......... .......... .......... 288 AGGCTGATTT TTCTTTCAAT AAGAGCATGC CATGTGACTG TCTAAAGCTG AAAATGAAGT 81176 .......... .......... .......... .......... .......... .......... 288 TTTAACGGGT GGGGTAAATA TAGCTAGTTT GAACGGGTGA AGGGTAAATA TAACTAGTTT 81236 .......... .......... .......... .......... .......... .......... 288 TAACAGGCAG GGGTAAAATT GTAGGGGTGT ATATTCATTG AAAGTGTAGA ATATAGGGCA 81296 .......... .......... .......... .......... .......... .......... 288 AATATAGCTT ATTTTTAATA GTAAAGGGGC AATTATCCTT TTCTGAATTA ACTATTCCAT 81356 .......... .......... .......... .......... .......... .......... 288 CTGGAGCATC ATTTATCATG CAGCTGTAAT TAAAATGTTC TCTAGCTGAA ACAATATAGC 81416 .......... .......... .......... .......... .......... .......... 288 GAGCATTGAA TATTAACAGG AGGTGGAAAG CTAATTCAAC ACTTTGCTCT TGCATATCAG 81476 .......... .......... .......... .......... .......... .......... 288 CAACTGTTAT AAGCCAAATA ATTTTATATA AGTGGGAAAA AAATCTTGTA TGCAAGCAAT 81536 .......... .......... .......... .......... .......... .......... 288 GCATAAAAAG CTAAAGAACC TACATTGAAT ATGCCTTTTC TAGAGTTCAT TTTTTTTATC 81596 .......... .......... .......... .......... .......... .......... 288 AATTAAAAAA AATAGTTCTC TAGAGAAGAT ACAAATCTCC CATACAAACA GGGACCTCAT 81656 .......... .......... .......... .......... .......... .......... 288 GGGTGCTTGA AAAATTAACG ACGAACAATA GACCATTCCT TAAATGTGCA TAATCTATCT 81716 .......... .......... .......... .......... .......... .......... 288 CCTCAAAACC CTTTTTGTTC TTCTCTCCAC AGGACCCACA TGAAAGCAAA GGGGTAACAT 81776 .......... .......... .......... .......... .......... .......... 288 TCCGTGCATT ATGCTGCCAT GAGAATTATG GCATCATTTA ATTTAACCCA AGCCAATTCA 81836 .......... .......... .......... .......... .......... .......... 288 ATACCACTCA AAATCTTGTT GATATACACC ATTTTTCTCT TTTGTTTTCA ATTTTTTGTC 81896 .......... .......... .......... .......... .......... .......... 288 ACCGTCCTTG CTGCCCATTA AAAATAGCAC ATTTCTGGGT ACTTTGGGTA AGTGGAGAAA 81956 .......... .......... .......... .......... .......... .......... 288 GTCCAACTCG TCCTTCAATA TAAGCCTGTG ATAGTATCAC TTGACTGAGA ACACTCCCTC 82016 .......... .......... .......... .......... .......... .......... 288 TCTCTTCACT CTTTACCTCT ATAAGTCCTT GCTAGCATGT GTTGTGTTCT ATTAGAGTAT 82076 .......... .......... .......... .......... .......... .......... 288 ATCAAGCAAA CTTAAATTCA ACAATCTTCC AGTCTTGTAA ATTCTTTCCT GTCCCAGGAG 82136 .......... .......... .......... .......... .......... .......... 288 GATAGCCTCG AATGCCATCT CTGCCTATTT GCCCCAGCCT TTTCATTTCC ATAATGTACA 82196 .......... .......... .......... .......... .......... .......... 288 ACATAAGAGA TAACAAGTTT CCTTGTTACA GATCCCTCAA GCTACCAAAA AATCTGCATG 82256 .......... .......... .......... .......... .......... .......... 288 TGTTCGACTT ACTAGGATCC AGTACTTGAC CATGAGATGT AAACTTGATC CACTTCCTCA 82316 .......... .......... .......... .......... .......... .......... 288 ACTTATTCCA AATCCTATAT TCGTTATGAT AAAATGCAGC AACTTTTAAT TCACATGGTT 82376 .......... .......... .......... .......... .......... .......... 288 GTAACTTCCA GAGGGCCAAT TTGCATAAGA TTCCTCTCCC TTCTTTTCTT GTTGGGTCGG 82436 .......... .......... .......... .......... .......... .......... 288 CAACTTTTTT TGCCACCAAA ACCATGTCTA GAATCTCTCC TCCTTTCATG AACTCTTTCG 82496 .......... .......... .......... .......... .......... .......... 288 GGGAGACGAT GTCTTGTCTA ACACCTTTGT AATTTATAAG GTCTTAGTCA TTGATATTCA 82556 .......... .......... .......... .......... .......... .......... 288 CTAATCCCGC TGGAGGCAAA AGCACTAGGT GCCTGGTGGT ATCTTCCCTC CACCTATGCT 82616 .......... .......... .......... .......... .......... .......... 288 GATGGGAGGT AGAAGGTACC CCGTGAAATT AGTCGAGGTG CGTGCAGCTG GCCCTGATAC 82676 .......... .......... .......... .......... .......... .......... 288 CACAATTATA AAAAAGTACT TAATATTCAA TTACTCATTG CCTAATCAGC GAAATCACAA 82736 .......... .......... .......... .......... .......... .......... 288 TAAAATATGT GTCAAAGGCT TGTCTCAAAC TTCCTAATTT CTTGAAATGC AACTGTACTC 82796 .......... .......... .......... .......... .......... .......... 288 CATCACCGCC CCTTGATCTG CTCCAGCATT GTTGAAAGAA AGTTAACATG AAATTGTCCA 82856 .......... .......... .......... .......... .......... .......... 288 AACTAGGGGC CTTGTATACT ACAAGTCTCC AGGGAAAAGA GATGCATGCC AAATAATTTT 82916 .......... .......... .......... .......... .......... .......... 288 CAGACTCCTA GAAAGAGAAA GGGATGCACA AGAGAAAGAG TGGGTGTAGA GAAATGGTGG 82976 .......... .......... .......... .......... .......... .......... 288 TTTTTGAAAC TATTTGTTAC ATCATAAGCT AAAATCTTGA AGTATGATGT TAAGCACAGA 83036 .......... .......... .......... .......... .......... .......... 288 TTCTAATTTC CTCGAAGGAT CATTAAGCCA AACAGTGTAA GAAGTGCAAG CAGTCGGGAA 83096 .......... .......... .......... .......... .......... .......... 288 AATATTCCTC GTATAATATC TCCAAACAGT GTTAGGAGTG GAAGCTTAAA TGTATTGCCA 83156 .......... .......... .......... .......... .......... .......... 288 ATTAGAAACA CCCTGAAATG ATGCTAAAAG AAGAAAGCTT ATAGTATGTG TGACACTATT 83216 .......... .......... .......... .......... .......... .......... 288 TATGGTATTC CATTTGCAGC ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 83276 | |||||||||| |||||||||| |||||||||| |||||||||| .......... .........C ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 329 TTGCTAAGAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA CTTGCAGAAG 83336 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGCTAAGAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA CTTGCAGAAG 389 GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAGGTTC 83396 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAG.... 445 GATCTGAGTA TTTTCTTTTT CGCTGAAAGT TTTTTTTTCA GTATTTATTG AGGTTGCTTT 83456 .......... .......... .......... .......... .......... .......... 445 ATGTACCAGG GAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 83516 | |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .........G GAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 496 GGACCTGATA TTGGGGCCAC CACAGTATTA CTCTATAAAG CTGGAACATC TGGTTCTGTA 83576 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGACCTGATA TTGGGGCCAC CACAGTATTA CTCTATAAAG CTGGAACATC TGGTTCTGTA 556 GCACCCCAAG CTGGGTTTGT TACATTTGAT GAAAGATTTA AGATATTGAG AGAAGTTCAA 83636 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCACCCCAAG CTGGGTTTGT TACATTTGAT GAAAGATTTA AGATATTGAG AGAAGTTCAA 616 TGGGAGTCGT TCAGCTCAAA TGTGCCTTTG TCTGCTGGTG TTGTAACGCA TTGAGATTGT 83696 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGGAGTCGT TCAGCTCAAA TGTGCCTTTG TCTGCTGGTG TTGTAACGCA TTGAGATTGT 676 GGCGATATTC TGTTTTGATT ATCCATTA 83724 |||||||||| |||||||||| |||||||| GGCGATATTC TGTTTTGATT ATCCATTA 704 hqPGS_C01HBa0088L02.1+_SGN-E371394- (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) ******************************************************************************** EST sequence 184 -strand 714 n (File: SGN-E397903-) 1 GCAGCTTGTT GAAAAGTTCA CAATTGAACG TGTAAACAAA AGTGGTGCCA TATTTGATTC 61 GACCAAGTTA AGGTGGATGA ATGGTCAGCA TTTGAGATCA CTTCCATCTG AAGAGTTGAA 121 CCAAATCATT GGTGAAAGGT GGAAGGATGC AGACATCGTT ACAGAATCAC AAGGAGTTTT 181 TGTACAGGAT GCTGTTCTAC TCCTCAAAGA TGGGATTGAC TTGATACCAG ATTCAGAGAA 241 AGCACTTTCA AGTTTGCTAT CTTATCCTTT ATATGAAACT TTGACAAGCA CGGAAGGAAA 301 ACTGATCTTA GAAGATGGAG TCTCTGAAGT TGCTAAGAGC TTGTTAGCAG CCTACGACAG 361 TGGTGAGCTC TGTGGTGCAT TTGCAGAAGG CCAACCTGGA TGGAGAAACT GGGTGAAGAA 421 GTTCGGTAAA TTGCTGAAGC GCAAGGGAAA ATCTCTCTTC ATGCCCCTTC GGGTGTTGCT 481 AACAGGAAAG CTTCATGGAC CTGATATTGG GGCCACCACA GTATTACTAT ATAAAGCTGG 541 AACATCTGGT TCTGTAGCAC CCCAAGCTGG GTTTGTTACA TTTGATGAAA GATTTAAGAT 601 ATTGAGAGAA GTTCAATGGG AGTTGTTCAG CTCAAATGTG CCTTTGTCTG CTGGTGTTGT 661 AACGCATTGA GATTGTGGCG ATATTCTGTT TTGATTATCC ATTAAAAAAA AAAA Predicted gene structure (within gDNA segment 78268 to 84424): Exon 1 78837 78844 ( 8 n); cDNA 1 8 ( 8 n); score: 1.000 Intron 1 78845 78948 ( 104 n); Pd: 0.975 (s: 0), Pa: 0.975 (s: 1.00) Exon 2 78949 79012 ( 64 n); cDNA 9 72 ( 64 n); score: 1.000 Intron 2 79013 79532 ( 520 n); Pd: 0.477 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 79533 79647 ( 115 n); cDNA 73 187 ( 115 n); score: 1.000 Intron 3 79648 79876 ( 229 n); Pd: 0.999 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 4 79877 79977 ( 101 n); cDNA 188 288 ( 101 n); score: 1.000 Intron 4 79978 83235 (3258 n); Pd: 0.542 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 5 83236 83392 ( 157 n); cDNA 289 445 ( 157 n); score: 0.994 Intron 5 83393 83465 ( 73 n); Pd: 0.989 (s: 1.00), Pa: 0.988 (s: 1.00) Exon 6 83466 83724 ( 259 n); cDNA 446 704 ( 259 n); score: 0.992 PPA cDNA 705 714 MATCH C01HBa0088L02.1+ SGN-E397903- 0.996 704 0.986 C PGS_C01HBa0088L02.1+_SGN-E397903- (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) Alignment (genomic DNA sequence = upper lines): GCAGCTTGGT AAGTGATTGC CTCTATGCTG ATGTTGACAT GTCTAATGCT AACTTGCAGT 78896 |||||||| GCAGCTTG.. .......... .......... .......... .......... .......... 8 CATTACTATT TATTCACATT CCAACAGTGA TAGCTTCTCA TTTCATTTGC AGTTGAAAAG 78956 |||||||| .......... .......... .......... .......... .......... ..TTGAAAAG 16 TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAGGTAT 79016 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAG.... 72 TGTGTGTGTG TATATATATA TCAATTTCTT TTTGATTGGT GAGAGAGTAG CTCCTATTGA 79076 .......... .......... .......... .......... .......... .......... 72 TATATGCACA GCCAAAAGAT AATGCTGGAG GGTTACAACC AGAAACAATA ACCATCACAG 79136 .......... .......... .......... .......... .......... .......... 72 GTTGTGTAAA TTGTAAATCA CTAATCAAGT CAATCATGAC ACCAAAAACA TTTACATCTG 79196 .......... .......... .......... .......... .......... .......... 72 CCATGCTACA GCAAAAACTA AATAAAAAAA TACATATGCA TTTAACTTGT ATATCAGAAC 79256 .......... .......... .......... .......... .......... .......... 72 ATTTTGTCTT CAAACTTCCT GATGTTTCCT TCATTCCATA AGCTCCACCA AACGGTGGAG 79316 .......... .......... .......... .......... .......... .......... 72 ATGCAGCAAG AAACCCAAAA ACAATTCCAA TTTACATATG ATTGAAAGCT TTCTCATTTT 79376 .......... .......... .......... .......... .......... .......... 72 CCAATTTGCA AAGATACCCT GGAATACTTC GTCTCCTCCT CGAATCAATA CATTGCTATA 79436 .......... .......... .......... .......... .......... .......... 72 TTTTCTTCTG CTACATGGAT AGGCTTGGTT ACCAAGACAT TATGAAATTG AATTATATGT 79496 .......... .......... .......... .......... .......... .......... 72 CTTGATTGTT GTTTAAAATA TGGTTATGAA CTTCAGGTGG ATGAATGGTC AGCATTTGAG 79556 |||| |||||||||| |||||||||| .......... .......... .......... ......GTGG ATGAATGGTC AGCATTTGAG 96 ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 79616 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 156 CGTTACAGAA TCACAAGGAG TTTTTGTACA GGTAGAAATT TTCCCCTCTC TTTCATTTCT 79676 |||||||||| |||||||||| |||||||||| | CGTTACAGAA TCACAAGGAG TTTTTGTACA G......... .......... .......... 187 CAACCACATT GTTACTACAA GATTTTTCTT AATCATCTTT GTGGAGATCT AACAACGAGA 79736 .......... .......... .......... .......... .......... .......... 187 TTTTGGAGGA TTTTTCTTAA TAATCTTTCC CGAATGGCTG TTGCATAGAT GCTTGTCATT 79796 .......... .......... .......... .......... .......... .......... 187 AAATATCAAT TCAAAAAATT GTTGCTCAAT GTACTTTGGA GTTATGGTTC TTATACCTGT 79856 .......... .......... .......... .......... .......... .......... 187 TAAATTTTCT GTATATATAG GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 79916 |||||||||| |||||||||| |||||||||| |||||||||| .......... .......... GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 227 CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 79976 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 287 GGTGATCCAT GAAATTATGT TTTAAAACTA TACCTATGTG ACGCTAAAAG ATGAAAACAT 80036 | G......... .......... .......... .......... .......... .......... 288 GGAGGTTTCA ATTTGGTCCA TTCATTAAGG CGGGAATGAG AATATTTGTT GATTAATGAG 80096 .......... .......... .......... .......... .......... .......... 288 TTCAATTTTG TTATAAATAA AGGTAACTAA TTATATCCCA TTTACTCCAT TACCAAGTGA 80156 .......... .......... .......... .......... .......... .......... 288 ACACAAAAGA CGAGTTCCAC AACAAACATT GGTTCTTTGT AAAGGCAACC AATTGTCTAT 80216 .......... .......... .......... .......... .......... .......... 288 GGAAAAGGGT CGTATTTGCC CCTCTACTAT CAAAAAATAA GCTATATTTA CCCTCCGTTA 80276 .......... .......... .......... .......... .......... .......... 288 TACCTTTTCA ACAAATATCC TCCTATAGTC ATAATATAGA GCTATGTTTC TCACCCGTGA 80336 .......... .......... .......... .......... .......... .......... 288 AAACTTCACT TTCAGCTTTT AAAAGCCATG TGTTATTCTC TTATTGAACC AAATAATCAG 80396 .......... .......... .......... .......... .......... .......... 288 CCTCACTTTT GCCCGCACCC AAATCACTCT CATTTCTCTC TATCCGGAAG GTGTACTTGA 80456 .......... .......... .......... .......... .......... .......... 288 GCCTGCAAAA TCAATAGTTG GTCCAAAGCT CCCTAATCTT TCTTCTCCCC AATTCCATCA 80516 .......... .......... .......... .......... .......... .......... 288 TCTCATTCTT ATGCAACAAA ACCAAGTCTT ATTAGTTATA ATTTACTTAA TAAGTACAAG 80576 .......... .......... .......... .......... .......... .......... 288 GTATAATTTA AAAAATTGTT CCTATTTATT AAATGCTTTT TGAGAATTGA GTAGTACTAA 80636 .......... .......... .......... .......... .......... .......... 288 AAAGAACTAC TTTAATGTTA AGGGTGTGGT GATAACAATT GTCAACTTTA ATCTTGAATT 80696 .......... .......... .......... .......... .......... .......... 288 CCTAAAGCGA CAATTATTTT GAGCTAAAAT GATAGCAGAA AATGATGAAT AACTATATTT 80756 .......... .......... .......... .......... .......... .......... 288 GTTGTGAGGC GGGTGATATC TATGTTGAAC TTTGTATTTT TTTGTAAATT AAATAAAAAA 80816 .......... .......... .......... .......... .......... .......... 288 GGTTATATTA AAAATAGAGA AATTAAATCT CATGTAATGT TCTGTTATAT AATTACCATT 80876 .......... .......... .......... .......... .......... .......... 288 TGGGCAGGAT TTAAAATAGA ATATAGTGGA TTGCTTTACT TTTAATTCTG GATTTTGTCC 80936 .......... .......... .......... .......... .......... .......... 288 AAAAAGCATG GTAGTTTTAA CATTACTAGT TTTTTTCAAA AAGCATGCCA TTTTCCCAGA 80996 .......... .......... .......... .......... .......... .......... 288 AAGAAAATTA ATTTCTGGTA ACAATTTTTT CCATTTTCAA TGTTCTATTA TAAATCAATT 81056 .......... .......... .......... .......... .......... .......... 288 TACATTTTAG AGTGAGGGGT AAATATAGCC TGGTGTTTAA TAGTGAACTC TATAAAAATG 81116 .......... .......... .......... .......... .......... .......... 288 AGGCTGATTT TTCTTTCAAT AAGAGCATGC CATGTGACTG TCTAAAGCTG AAAATGAAGT 81176 .......... .......... .......... .......... .......... .......... 288 TTTAACGGGT GGGGTAAATA TAGCTAGTTT GAACGGGTGA AGGGTAAATA TAACTAGTTT 81236 .......... .......... .......... .......... .......... .......... 288 TAACAGGCAG GGGTAAAATT GTAGGGGTGT ATATTCATTG AAAGTGTAGA ATATAGGGCA 81296 .......... .......... .......... .......... .......... .......... 288 AATATAGCTT ATTTTTAATA GTAAAGGGGC AATTATCCTT TTCTGAATTA ACTATTCCAT 81356 .......... .......... .......... .......... .......... .......... 288 CTGGAGCATC ATTTATCATG CAGCTGTAAT TAAAATGTTC TCTAGCTGAA ACAATATAGC 81416 .......... .......... .......... .......... .......... .......... 288 GAGCATTGAA TATTAACAGG AGGTGGAAAG CTAATTCAAC ACTTTGCTCT TGCATATCAG 81476 .......... .......... .......... .......... .......... .......... 288 CAACTGTTAT AAGCCAAATA ATTTTATATA AGTGGGAAAA AAATCTTGTA TGCAAGCAAT 81536 .......... .......... .......... .......... .......... .......... 288 GCATAAAAAG CTAAAGAACC TACATTGAAT ATGCCTTTTC TAGAGTTCAT TTTTTTTATC 81596 .......... .......... .......... .......... .......... .......... 288 AATTAAAAAA AATAGTTCTC TAGAGAAGAT ACAAATCTCC CATACAAACA GGGACCTCAT 81656 .......... .......... .......... .......... .......... .......... 288 GGGTGCTTGA AAAATTAACG ACGAACAATA GACCATTCCT TAAATGTGCA TAATCTATCT 81716 .......... .......... .......... .......... .......... .......... 288 CCTCAAAACC CTTTTTGTTC TTCTCTCCAC AGGACCCACA TGAAAGCAAA GGGGTAACAT 81776 .......... .......... .......... .......... .......... .......... 288 TCCGTGCATT ATGCTGCCAT GAGAATTATG GCATCATTTA ATTTAACCCA AGCCAATTCA 81836 .......... .......... .......... .......... .......... .......... 288 ATACCACTCA AAATCTTGTT GATATACACC ATTTTTCTCT TTTGTTTTCA ATTTTTTGTC 81896 .......... .......... .......... .......... .......... .......... 288 ACCGTCCTTG CTGCCCATTA AAAATAGCAC ATTTCTGGGT ACTTTGGGTA AGTGGAGAAA 81956 .......... .......... .......... .......... .......... .......... 288 GTCCAACTCG TCCTTCAATA TAAGCCTGTG ATAGTATCAC TTGACTGAGA ACACTCCCTC 82016 .......... .......... .......... .......... .......... .......... 288 TCTCTTCACT CTTTACCTCT ATAAGTCCTT GCTAGCATGT GTTGTGTTCT ATTAGAGTAT 82076 .......... .......... .......... .......... .......... .......... 288 ATCAAGCAAA CTTAAATTCA ACAATCTTCC AGTCTTGTAA ATTCTTTCCT GTCCCAGGAG 82136 .......... .......... .......... .......... .......... .......... 288 GATAGCCTCG AATGCCATCT CTGCCTATTT GCCCCAGCCT TTTCATTTCC ATAATGTACA 82196 .......... .......... .......... .......... .......... .......... 288 ACATAAGAGA TAACAAGTTT CCTTGTTACA GATCCCTCAA GCTACCAAAA AATCTGCATG 82256 .......... .......... .......... .......... .......... .......... 288 TGTTCGACTT ACTAGGATCC AGTACTTGAC CATGAGATGT AAACTTGATC CACTTCCTCA 82316 .......... .......... .......... .......... .......... .......... 288 ACTTATTCCA AATCCTATAT TCGTTATGAT AAAATGCAGC AACTTTTAAT TCACATGGTT 82376 .......... .......... .......... .......... .......... .......... 288 GTAACTTCCA GAGGGCCAAT TTGCATAAGA TTCCTCTCCC TTCTTTTCTT GTTGGGTCGG 82436 .......... .......... .......... .......... .......... .......... 288 CAACTTTTTT TGCCACCAAA ACCATGTCTA GAATCTCTCC TCCTTTCATG AACTCTTTCG 82496 .......... .......... .......... .......... .......... .......... 288 GGGAGACGAT GTCTTGTCTA ACACCTTTGT AATTTATAAG GTCTTAGTCA TTGATATTCA 82556 .......... .......... .......... .......... .......... .......... 288 CTAATCCCGC TGGAGGCAAA AGCACTAGGT GCCTGGTGGT ATCTTCCCTC CACCTATGCT 82616 .......... .......... .......... .......... .......... .......... 288 GATGGGAGGT AGAAGGTACC CCGTGAAATT AGTCGAGGTG CGTGCAGCTG GCCCTGATAC 82676 .......... .......... .......... .......... .......... .......... 288 CACAATTATA AAAAAGTACT TAATATTCAA TTACTCATTG CCTAATCAGC GAAATCACAA 82736 .......... .......... .......... .......... .......... .......... 288 TAAAATATGT GTCAAAGGCT TGTCTCAAAC TTCCTAATTT CTTGAAATGC AACTGTACTC 82796 .......... .......... .......... .......... .......... .......... 288 CATCACCGCC CCTTGATCTG CTCCAGCATT GTTGAAAGAA AGTTAACATG AAATTGTCCA 82856 .......... .......... .......... .......... .......... .......... 288 AACTAGGGGC CTTGTATACT ACAAGTCTCC AGGGAAAAGA GATGCATGCC AAATAATTTT 82916 .......... .......... .......... .......... .......... .......... 288 CAGACTCCTA GAAAGAGAAA GGGATGCACA AGAGAAAGAG TGGGTGTAGA GAAATGGTGG 82976 .......... .......... .......... .......... .......... .......... 288 TTTTTGAAAC TATTTGTTAC ATCATAAGCT AAAATCTTGA AGTATGATGT TAAGCACAGA 83036 .......... .......... .......... .......... .......... .......... 288 TTCTAATTTC CTCGAAGGAT CATTAAGCCA AACAGTGTAA GAAGTGCAAG CAGTCGGGAA 83096 .......... .......... .......... .......... .......... .......... 288 AATATTCCTC GTATAATATC TCCAAACAGT GTTAGGAGTG GAAGCTTAAA TGTATTGCCA 83156 .......... .......... .......... .......... .......... .......... 288 ATTAGAAACA CCCTGAAATG ATGCTAAAAG AAGAAAGCTT ATAGTATGTG TGACACTATT 83216 .......... .......... .......... .......... .......... .......... 288 TATGGTATTC CATTTGCAGC ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 83276 | |||||||||| |||||||||| |||||||||| |||||||||| .......... .........C ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 329 TTGCTAAGAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA CTTGCAGAAG 83336 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||||||| TTGCTAAGAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA TTTGCAGAAG 389 GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAGGTTC 83396 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAG.... 445 GATCTGAGTA TTTTCTTTTT CGCTGAAAGT TTTTTTTTCA GTATTTATTG AGGTTGCTTT 83456 .......... .......... .......... .......... .......... .......... 445 ATGTACCAGG GAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 83516 | |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .........G GAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 496 GGACCTGATA TTGGGGCCAC CACAGTATTA CTCTATAAAG CTGGAACATC TGGTTCTGTA 83576 |||||||||| |||||||||| |||||||||| || ||||||| |||||||||| |||||||||| GGACCTGATA TTGGGGCCAC CACAGTATTA CTATATAAAG CTGGAACATC TGGTTCTGTA 556 GCACCCCAAG CTGGGTTTGT TACATTTGAT GAAAGATTTA AGATATTGAG AGAAGTTCAA 83636 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCACCCCAAG CTGGGTTTGT TACATTTGAT GAAAGATTTA AGATATTGAG AGAAGTTCAA 616 TGGGAGTCGT TCAGCTCAAA TGTGCCTTTG TCTGCTGGTG TTGTAACGCA TTGAGATTGT 83696 ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGGGAGTTGT TCAGCTCAAA TGTGCCTTTG TCTGCTGGTG TTGTAACGCA TTGAGATTGT 676 GGCGATATTC TGTTTTGATT ATCCATTA 83724 |||||||||| |||||||||| |||||||| GGCGATATTC TGTTTTGATT ATCCATTA 704 hqPGS_C01HBa0088L02.1+_SGN-E397903- (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) ******************************************************************************** EST sequence 37 +strand 671 n (File: SGN-E397863+) 1 GCAGCTTGTT GAAAAGTTCA CAATTGAACG TGTAAACAAA AGTGGTGCCA TATTTGATTC 61 GACCAAGTTA AGGTGGATGA ATGGTCAGCA TTTGAGATCA CTTCCATCTG AAGAGTTGAA 121 CCAAATCATT GGTGAAAGGT GGAAGGATGC AGACATCGTT ACAGAATCAC AAGGAGTTTT 181 TGTACAGGAT GCTGTTCTAC TCCTCAAAGA TGGGATTGAC TTGATACCAG ATTCAGAGAA 241 AGCACTTTCA AGTTTGCTAT CTTATCCTTT ATATGAAACT TTGACAAGCA CGGAAGGAAA 301 ACTGATCTTA GAAGATGGAG TCTCTGAAGT TGCTAAAAGC TTGTTAGCAG CCTACGACAG 361 TGGTGAGCTC TGTGGTGCAC TTGCAGAAGG CCAACCTGGA TGGAGAAACT GGGTGAAGAA 421 GTTCGGTAAA TTGCTGAAGC GCAAGGAAAA ATCTCTCTTC ATGCCCCTTC GGGTGTTGCT 481 AACAGGAAAG CTTCATGGAC CTGATATTGG GGCCACCACA GTATTACTCT ATAAAGCTGG 541 AACATCTGGT TCTGTAGCAC CCCAAGCTGG ATTTGTTACA TTTGATGAAA GATTTAAGAT 601 ATTGAGAGAA GTTCAATGGG AGTCGTTCAC CTCAAATGTG CCTTTGTCTG CTGGTGTTGT 661 AACGCATTGA G Predicted gene structure (within gDNA segment 78278 to 84301): Exon 1 78837 78844 ( 8 n); cDNA 1 8 ( 8 n); score: 1.000 Intron 1 78845 78948 ( 104 n); Pd: 0.975 (s: 0), Pa: 0.975 (s: 1.00) Exon 2 78949 79012 ( 64 n); cDNA 9 72 ( 64 n); score: 1.000 Intron 2 79013 79532 ( 520 n); Pd: 0.477 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 79533 79647 ( 115 n); cDNA 73 187 ( 115 n); score: 1.000 Intron 3 79648 79876 ( 229 n); Pd: 0.999 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 4 79877 79977 ( 101 n); cDNA 188 288 ( 101 n); score: 1.000 Intron 4 79978 83235 (3258 n); Pd: 0.542 (s: 1.00), Pa: 0.999 (s: 0.98) Exon 5 83236 83392 ( 157 n); cDNA 289 445 ( 157 n); score: 0.994 Intron 5 83393 83465 ( 73 n); Pd: 0.989 (s: 1.00), Pa: 0.988 (s: 0.98) Exon 6 83466 83691 ( 226 n); cDNA 446 671 ( 226 n); score: 0.987 MATCH C01HBa0088L02.1+ SGN-E397863+ 0.994 671 1.000 C PGS_C01HBa0088L02.1+_SGN-E397863+ (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83691) Alignment (genomic DNA sequence = upper lines): GCAGCTTGGT AAGTGATTGC CTCTATGCTG ATGTTGACAT GTCTAATGCT AACTTGCAGT 78896 |||||||| GCAGCTTG.. .......... .......... .......... .......... .......... 8 CATTACTATT TATTCACATT CCAACAGTGA TAGCTTCTCA TTTCATTTGC AGTTGAAAAG 78956 |||||||| .......... .......... .......... .......... .......... ..TTGAAAAG 16 TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAGGTAT 79016 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAG.... 72 TGTGTGTGTG TATATATATA TCAATTTCTT TTTGATTGGT GAGAGAGTAG CTCCTATTGA 79076 .......... .......... .......... .......... .......... .......... 72 TATATGCACA GCCAAAAGAT AATGCTGGAG GGTTACAACC AGAAACAATA ACCATCACAG 79136 .......... .......... .......... .......... .......... .......... 72 GTTGTGTAAA TTGTAAATCA CTAATCAAGT CAATCATGAC ACCAAAAACA TTTACATCTG 79196 .......... .......... .......... .......... .......... .......... 72 CCATGCTACA GCAAAAACTA AATAAAAAAA TACATATGCA TTTAACTTGT ATATCAGAAC 79256 .......... .......... .......... .......... .......... .......... 72 ATTTTGTCTT CAAACTTCCT GATGTTTCCT TCATTCCATA AGCTCCACCA AACGGTGGAG 79316 .......... .......... .......... .......... .......... .......... 72 ATGCAGCAAG AAACCCAAAA ACAATTCCAA TTTACATATG ATTGAAAGCT TTCTCATTTT 79376 .......... .......... .......... .......... .......... .......... 72 CCAATTTGCA AAGATACCCT GGAATACTTC GTCTCCTCCT CGAATCAATA CATTGCTATA 79436 .......... .......... .......... .......... .......... .......... 72 TTTTCTTCTG CTACATGGAT AGGCTTGGTT ACCAAGACAT TATGAAATTG AATTATATGT 79496 .......... .......... .......... .......... .......... .......... 72 CTTGATTGTT GTTTAAAATA TGGTTATGAA CTTCAGGTGG ATGAATGGTC AGCATTTGAG 79556 |||| |||||||||| |||||||||| .......... .......... .......... ......GTGG ATGAATGGTC AGCATTTGAG 96 ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 79616 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 156 CGTTACAGAA TCACAAGGAG TTTTTGTACA GGTAGAAATT TTCCCCTCTC TTTCATTTCT 79676 |||||||||| |||||||||| |||||||||| | CGTTACAGAA TCACAAGGAG TTTTTGTACA G......... .......... .......... 187 CAACCACATT GTTACTACAA GATTTTTCTT AATCATCTTT GTGGAGATCT AACAACGAGA 79736 .......... .......... .......... .......... .......... .......... 187 TTTTGGAGGA TTTTTCTTAA TAATCTTTCC CGAATGGCTG TTGCATAGAT GCTTGTCATT 79796 .......... .......... .......... .......... .......... .......... 187 AAATATCAAT TCAAAAAATT GTTGCTCAAT GTACTTTGGA GTTATGGTTC TTATACCTGT 79856 .......... .......... .......... .......... .......... .......... 187 TAAATTTTCT GTATATATAG GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 79916 |||||||||| |||||||||| |||||||||| |||||||||| .......... .......... GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 227 CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 79976 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 287 GGTGATCCAT GAAATTATGT TTTAAAACTA TACCTATGTG ACGCTAAAAG ATGAAAACAT 80036 | G......... .......... .......... .......... .......... .......... 288 GGAGGTTTCA ATTTGGTCCA TTCATTAAGG CGGGAATGAG AATATTTGTT GATTAATGAG 80096 .......... .......... .......... .......... .......... .......... 288 TTCAATTTTG TTATAAATAA AGGTAACTAA TTATATCCCA TTTACTCCAT TACCAAGTGA 80156 .......... .......... .......... .......... .......... .......... 288 ACACAAAAGA CGAGTTCCAC AACAAACATT GGTTCTTTGT AAAGGCAACC AATTGTCTAT 80216 .......... .......... .......... .......... .......... .......... 288 GGAAAAGGGT CGTATTTGCC CCTCTACTAT CAAAAAATAA GCTATATTTA CCCTCCGTTA 80276 .......... .......... .......... .......... .......... .......... 288 TACCTTTTCA ACAAATATCC TCCTATAGTC ATAATATAGA GCTATGTTTC TCACCCGTGA 80336 .......... .......... .......... .......... .......... .......... 288 AAACTTCACT TTCAGCTTTT AAAAGCCATG TGTTATTCTC TTATTGAACC AAATAATCAG 80396 .......... .......... .......... .......... .......... .......... 288 CCTCACTTTT GCCCGCACCC AAATCACTCT CATTTCTCTC TATCCGGAAG GTGTACTTGA 80456 .......... .......... .......... .......... .......... .......... 288 GCCTGCAAAA TCAATAGTTG GTCCAAAGCT CCCTAATCTT TCTTCTCCCC AATTCCATCA 80516 .......... .......... .......... .......... .......... .......... 288 TCTCATTCTT ATGCAACAAA ACCAAGTCTT ATTAGTTATA ATTTACTTAA TAAGTACAAG 80576 .......... .......... .......... .......... .......... .......... 288 GTATAATTTA AAAAATTGTT CCTATTTATT AAATGCTTTT TGAGAATTGA GTAGTACTAA 80636 .......... .......... .......... .......... .......... .......... 288 AAAGAACTAC TTTAATGTTA AGGGTGTGGT GATAACAATT GTCAACTTTA ATCTTGAATT 80696 .......... .......... .......... .......... .......... .......... 288 CCTAAAGCGA CAATTATTTT GAGCTAAAAT GATAGCAGAA AATGATGAAT AACTATATTT 80756 .......... .......... .......... .......... .......... .......... 288 GTTGTGAGGC GGGTGATATC TATGTTGAAC TTTGTATTTT TTTGTAAATT AAATAAAAAA 80816 .......... .......... .......... .......... .......... .......... 288 GGTTATATTA AAAATAGAGA AATTAAATCT CATGTAATGT TCTGTTATAT AATTACCATT 80876 .......... .......... .......... .......... .......... .......... 288 TGGGCAGGAT TTAAAATAGA ATATAGTGGA TTGCTTTACT TTTAATTCTG GATTTTGTCC 80936 .......... .......... .......... .......... .......... .......... 288 AAAAAGCATG GTAGTTTTAA CATTACTAGT TTTTTTCAAA AAGCATGCCA TTTTCCCAGA 80996 .......... .......... .......... .......... .......... .......... 288 AAGAAAATTA ATTTCTGGTA ACAATTTTTT CCATTTTCAA TGTTCTATTA TAAATCAATT 81056 .......... .......... .......... .......... .......... .......... 288 TACATTTTAG AGTGAGGGGT AAATATAGCC TGGTGTTTAA TAGTGAACTC TATAAAAATG 81116 .......... .......... .......... .......... .......... .......... 288 AGGCTGATTT TTCTTTCAAT AAGAGCATGC CATGTGACTG TCTAAAGCTG AAAATGAAGT 81176 .......... .......... .......... .......... .......... .......... 288 TTTAACGGGT GGGGTAAATA TAGCTAGTTT GAACGGGTGA AGGGTAAATA TAACTAGTTT 81236 .......... .......... .......... .......... .......... .......... 288 TAACAGGCAG GGGTAAAATT GTAGGGGTGT ATATTCATTG AAAGTGTAGA ATATAGGGCA 81296 .......... .......... .......... .......... .......... .......... 288 AATATAGCTT ATTTTTAATA GTAAAGGGGC AATTATCCTT TTCTGAATTA ACTATTCCAT 81356 .......... .......... .......... .......... .......... .......... 288 CTGGAGCATC ATTTATCATG CAGCTGTAAT TAAAATGTTC TCTAGCTGAA ACAATATAGC 81416 .......... .......... .......... .......... .......... .......... 288 GAGCATTGAA TATTAACAGG AGGTGGAAAG CTAATTCAAC ACTTTGCTCT TGCATATCAG 81476 .......... .......... .......... .......... .......... .......... 288 CAACTGTTAT AAGCCAAATA ATTTTATATA AGTGGGAAAA AAATCTTGTA TGCAAGCAAT 81536 .......... .......... .......... .......... .......... .......... 288 GCATAAAAAG CTAAAGAACC TACATTGAAT ATGCCTTTTC TAGAGTTCAT TTTTTTTATC 81596 .......... .......... .......... .......... .......... .......... 288 AATTAAAAAA AATAGTTCTC TAGAGAAGAT ACAAATCTCC CATACAAACA GGGACCTCAT 81656 .......... .......... .......... .......... .......... .......... 288 GGGTGCTTGA AAAATTAACG ACGAACAATA GACCATTCCT TAAATGTGCA TAATCTATCT 81716 .......... .......... .......... .......... .......... .......... 288 CCTCAAAACC CTTTTTGTTC TTCTCTCCAC AGGACCCACA TGAAAGCAAA GGGGTAACAT 81776 .......... .......... .......... .......... .......... .......... 288 TCCGTGCATT ATGCTGCCAT GAGAATTATG GCATCATTTA ATTTAACCCA AGCCAATTCA 81836 .......... .......... .......... .......... .......... .......... 288 ATACCACTCA AAATCTTGTT GATATACACC ATTTTTCTCT TTTGTTTTCA ATTTTTTGTC 81896 .......... .......... .......... .......... .......... .......... 288 ACCGTCCTTG CTGCCCATTA AAAATAGCAC ATTTCTGGGT ACTTTGGGTA AGTGGAGAAA 81956 .......... .......... .......... .......... .......... .......... 288 GTCCAACTCG TCCTTCAATA TAAGCCTGTG ATAGTATCAC TTGACTGAGA ACACTCCCTC 82016 .......... .......... .......... .......... .......... .......... 288 TCTCTTCACT CTTTACCTCT ATAAGTCCTT GCTAGCATGT GTTGTGTTCT ATTAGAGTAT 82076 .......... .......... .......... .......... .......... .......... 288 ATCAAGCAAA CTTAAATTCA ACAATCTTCC AGTCTTGTAA ATTCTTTCCT GTCCCAGGAG 82136 .......... .......... .......... .......... .......... .......... 288 GATAGCCTCG AATGCCATCT CTGCCTATTT GCCCCAGCCT TTTCATTTCC ATAATGTACA 82196 .......... .......... .......... .......... .......... .......... 288 ACATAAGAGA TAACAAGTTT CCTTGTTACA GATCCCTCAA GCTACCAAAA AATCTGCATG 82256 .......... .......... .......... .......... .......... .......... 288 TGTTCGACTT ACTAGGATCC AGTACTTGAC CATGAGATGT AAACTTGATC CACTTCCTCA 82316 .......... .......... .......... .......... .......... .......... 288 ACTTATTCCA AATCCTATAT TCGTTATGAT AAAATGCAGC AACTTTTAAT TCACATGGTT 82376 .......... .......... .......... .......... .......... .......... 288 GTAACTTCCA GAGGGCCAAT TTGCATAAGA TTCCTCTCCC TTCTTTTCTT GTTGGGTCGG 82436 .......... .......... .......... .......... .......... .......... 288 CAACTTTTTT TGCCACCAAA ACCATGTCTA GAATCTCTCC TCCTTTCATG AACTCTTTCG 82496 .......... .......... .......... .......... .......... .......... 288 GGGAGACGAT GTCTTGTCTA ACACCTTTGT AATTTATAAG GTCTTAGTCA TTGATATTCA 82556 .......... .......... .......... .......... .......... .......... 288 CTAATCCCGC TGGAGGCAAA AGCACTAGGT GCCTGGTGGT ATCTTCCCTC CACCTATGCT 82616 .......... .......... .......... .......... .......... .......... 288 GATGGGAGGT AGAAGGTACC CCGTGAAATT AGTCGAGGTG CGTGCAGCTG GCCCTGATAC 82676 .......... .......... .......... .......... .......... .......... 288 CACAATTATA AAAAAGTACT TAATATTCAA TTACTCATTG CCTAATCAGC GAAATCACAA 82736 .......... .......... .......... .......... .......... .......... 288 TAAAATATGT GTCAAAGGCT TGTCTCAAAC TTCCTAATTT CTTGAAATGC AACTGTACTC 82796 .......... .......... .......... .......... .......... .......... 288 CATCACCGCC CCTTGATCTG CTCCAGCATT GTTGAAAGAA AGTTAACATG AAATTGTCCA 82856 .......... .......... .......... .......... .......... .......... 288 AACTAGGGGC CTTGTATACT ACAAGTCTCC AGGGAAAAGA GATGCATGCC AAATAATTTT 82916 .......... .......... .......... .......... .......... .......... 288 CAGACTCCTA GAAAGAGAAA GGGATGCACA AGAGAAAGAG TGGGTGTAGA GAAATGGTGG 82976 .......... .......... .......... .......... .......... .......... 288 TTTTTGAAAC TATTTGTTAC ATCATAAGCT AAAATCTTGA AGTATGATGT TAAGCACAGA 83036 .......... .......... .......... .......... .......... .......... 288 TTCTAATTTC CTCGAAGGAT CATTAAGCCA AACAGTGTAA GAAGTGCAAG CAGTCGGGAA 83096 .......... .......... .......... .......... .......... .......... 288 AATATTCCTC GTATAATATC TCCAAACAGT GTTAGGAGTG GAAGCTTAAA TGTATTGCCA 83156 .......... .......... .......... .......... .......... .......... 288 ATTAGAAACA CCCTGAAATG ATGCTAAAAG AAGAAAGCTT ATAGTATGTG TGACACTATT 83216 .......... .......... .......... .......... .......... .......... 288 TATGGTATTC CATTTGCAGC ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 83276 | |||||||||| |||||||||| |||||||||| |||||||||| .......... .........C ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 329 TTGCTAAGAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA CTTGCAGAAG 83336 ||||||| || |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGCTAAAAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA CTTGCAGAAG 389 GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAGGTTC 83396 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAG.... 445 GATCTGAGTA TTTTCTTTTT CGCTGAAAGT TTTTTTTTCA GTATTTATTG AGGTTGCTTT 83456 .......... .......... .......... .......... .......... .......... 445 ATGTACCAGG GAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 83516 | ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .........G AAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 496 GGACCTGATA TTGGGGCCAC CACAGTATTA CTCTATAAAG CTGGAACATC TGGTTCTGTA 83576 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGACCTGATA TTGGGGCCAC CACAGTATTA CTCTATAAAG CTGGAACATC TGGTTCTGTA 556 GCACCCCAAG CTGGGTTTGT TACATTTGAT GAAAGATTTA AGATATTGAG AGAAGTTCAA 83636 |||||||||| |||| ||||| |||||||||| |||||||||| |||||||||| |||||||||| GCACCCCAAG CTGGATTTGT TACATTTGAT GAAAGATTTA AGATATTGAG AGAAGTTCAA 616 TGGGAGTCGT TCAGCTCAAA TGTGCCTTTG TCTGCTGGTG TTGTAACGCA TTGAG 83691 |||||||||| ||| |||||| |||||||||| |||||||||| |||||||||| ||||| TGGGAGTCGT TCACCTCAAA TGTGCCTTTG TCTGCTGGTG TTGTAACGCA TTGAG 671 hqPGS_C01HBa0088L02.1+_SGN-E397863+ (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83691) ******************************************************************************** EST sequence 38 +strand 582 n (File: SGN-E392303+) 1 GCAGCTTGTT GAAAAGTTCA CAATTGAACG TGTAAACAAA AGTGGTGCCA TATTTGATTC 61 GACCAAGTTA AGGTGGATGA ATGGTCAGCA TTTGAGATCA CTTCCATCTG AAGAGTTGAA 121 CCAAATCATT GGTGAAAGGT GGAAGGATGC AGACATCGTT ACAGAATCAC AAGGAGTTTT 181 TGTACAGGAT GCTGTTCTAC TCCTCAAAGA TGGGATTGAC TTGATACCAG ATTCAGAGAA 241 AGCACTTTCA AGTTTGCTAT CTTATCCTTT ATATGAAACT TTGACAAGCA CGGAAGGAAA 301 ACTGATCTTA GAAGATGGAG TCTCTGAAGT TGCTAAGAGC TTGTTAGCAG CCTACGACAG 361 TGGTGAGCTC TGTGGTGCAC TTGCAGAAGG CCAACCTGGA TGGAGAAACT GGGTGAAGAA 421 GTTCGGTAAA TTGCTGAAGC GCAAGGGAAA ATCTCTCTTC ATGCCCCTTC GGGTGTTGCT 481 AACAGGAAAG CTTCATGGAC CTGATATTGG GGCCACCACA GTATTACTCT ATAAAGCTGG 541 AACATCTGGT TCTGTAGCAC CCCAAGCTGG GTTTGTTACA TT Predicted gene structure (within gDNA segment 78278 to 84212): Exon 1 78837 78844 ( 8 n); cDNA 1 8 ( 8 n); score: 1.000 Intron 1 78845 78948 ( 104 n); Pd: 0.975 (s: 0), Pa: 0.975 (s: 1.00) Exon 2 78949 79012 ( 64 n); cDNA 9 72 ( 64 n); score: 1.000 Intron 2 79013 79532 ( 520 n); Pd: 0.477 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 79533 79647 ( 115 n); cDNA 73 187 ( 115 n); score: 1.000 Intron 3 79648 79876 ( 229 n); Pd: 0.999 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 4 79877 79977 ( 101 n); cDNA 188 288 ( 101 n); score: 1.000 Intron 4 79978 83235 (3258 n); Pd: 0.542 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 5 83236 83392 ( 157 n); cDNA 289 445 ( 157 n); score: 1.000 Intron 5 83393 83465 ( 73 n); Pd: 0.989 (s: 1.00), Pa: 0.988 (s: 1.00) Exon 6 83466 83602 ( 137 n); cDNA 446 582 ( 137 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E392303+ 1.000 582 1.000 C PGS_C01HBa0088L02.1+_SGN-E392303+ (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83602) Alignment (genomic DNA sequence = upper lines): GCAGCTTGGT AAGTGATTGC CTCTATGCTG ATGTTGACAT GTCTAATGCT AACTTGCAGT 78896 |||||||| GCAGCTTG.. .......... .......... .......... .......... .......... 8 CATTACTATT TATTCACATT CCAACAGTGA TAGCTTCTCA TTTCATTTGC AGTTGAAAAG 78956 |||||||| .......... .......... .......... .......... .......... ..TTGAAAAG 16 TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAGGTAT 79016 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| TTCACAATTG AACGTGTAAA CAAAAGTGGT GCCATATTTG ATTCGACCAA GTTAAG.... 72 TGTGTGTGTG TATATATATA TCAATTTCTT TTTGATTGGT GAGAGAGTAG CTCCTATTGA 79076 .......... .......... .......... .......... .......... .......... 72 TATATGCACA GCCAAAAGAT AATGCTGGAG GGTTACAACC AGAAACAATA ACCATCACAG 79136 .......... .......... .......... .......... .......... .......... 72 GTTGTGTAAA TTGTAAATCA CTAATCAAGT CAATCATGAC ACCAAAAACA TTTACATCTG 79196 .......... .......... .......... .......... .......... .......... 72 CCATGCTACA GCAAAAACTA AATAAAAAAA TACATATGCA TTTAACTTGT ATATCAGAAC 79256 .......... .......... .......... .......... .......... .......... 72 ATTTTGTCTT CAAACTTCCT GATGTTTCCT TCATTCCATA AGCTCCACCA AACGGTGGAG 79316 .......... .......... .......... .......... .......... .......... 72 ATGCAGCAAG AAACCCAAAA ACAATTCCAA TTTACATATG ATTGAAAGCT TTCTCATTTT 79376 .......... .......... .......... .......... .......... .......... 72 CCAATTTGCA AAGATACCCT GGAATACTTC GTCTCCTCCT CGAATCAATA CATTGCTATA 79436 .......... .......... .......... .......... .......... .......... 72 TTTTCTTCTG CTACATGGAT AGGCTTGGTT ACCAAGACAT TATGAAATTG AATTATATGT 79496 .......... .......... .......... .......... .......... .......... 72 CTTGATTGTT GTTTAAAATA TGGTTATGAA CTTCAGGTGG ATGAATGGTC AGCATTTGAG 79556 |||| |||||||||| |||||||||| .......... .......... .......... ......GTGG ATGAATGGTC AGCATTTGAG 96 ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 79616 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATCACTTCCA TCTGAAGAGT TGAACCAAAT CATTGGTGAA AGGTGGAAGG ATGCAGACAT 156 CGTTACAGAA TCACAAGGAG TTTTTGTACA GGTAGAAATT TTCCCCTCTC TTTCATTTCT 79676 |||||||||| |||||||||| |||||||||| | CGTTACAGAA TCACAAGGAG TTTTTGTACA G......... .......... .......... 187 CAACCACATT GTTACTACAA GATTTTTCTT AATCATCTTT GTGGAGATCT AACAACGAGA 79736 .......... .......... .......... .......... .......... .......... 187 TTTTGGAGGA TTTTTCTTAA TAATCTTTCC CGAATGGCTG TTGCATAGAT GCTTGTCATT 79796 .......... .......... .......... .......... .......... .......... 187 AAATATCAAT TCAAAAAATT GTTGCTCAAT GTACTTTGGA GTTATGGTTC TTATACCTGT 79856 .......... .......... .......... .......... .......... .......... 187 TAAATTTTCT GTATATATAG GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 79916 |||||||||| |||||||||| |||||||||| |||||||||| .......... .......... GATGCTGTTC TACTCCTCAA AGATGGGATT GACTTGATAC 227 CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 79976 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CAGATTCAGA GAAAGCACTT TCAAGTTTGC TATCTTATCC TTTATATGAA ACTTTGACAA 287 GGTGATCCAT GAAATTATGT TTTAAAACTA TACCTATGTG ACGCTAAAAG ATGAAAACAT 80036 | G......... .......... .......... .......... .......... .......... 288 GGAGGTTTCA ATTTGGTCCA TTCATTAAGG CGGGAATGAG AATATTTGTT GATTAATGAG 80096 .......... .......... .......... .......... .......... .......... 288 TTCAATTTTG TTATAAATAA AGGTAACTAA TTATATCCCA TTTACTCCAT TACCAAGTGA 80156 .......... .......... .......... .......... .......... .......... 288 ACACAAAAGA CGAGTTCCAC AACAAACATT GGTTCTTTGT AAAGGCAACC AATTGTCTAT 80216 .......... .......... .......... .......... .......... .......... 288 GGAAAAGGGT CGTATTTGCC CCTCTACTAT CAAAAAATAA GCTATATTTA CCCTCCGTTA 80276 .......... .......... .......... .......... .......... .......... 288 TACCTTTTCA ACAAATATCC TCCTATAGTC ATAATATAGA GCTATGTTTC TCACCCGTGA 80336 .......... .......... .......... .......... .......... .......... 288 AAACTTCACT TTCAGCTTTT AAAAGCCATG TGTTATTCTC TTATTGAACC AAATAATCAG 80396 .......... .......... .......... .......... .......... .......... 288 CCTCACTTTT GCCCGCACCC AAATCACTCT CATTTCTCTC TATCCGGAAG GTGTACTTGA 80456 .......... .......... .......... .......... .......... .......... 288 GCCTGCAAAA TCAATAGTTG GTCCAAAGCT CCCTAATCTT TCTTCTCCCC AATTCCATCA 80516 .......... .......... .......... .......... .......... .......... 288 TCTCATTCTT ATGCAACAAA ACCAAGTCTT ATTAGTTATA ATTTACTTAA TAAGTACAAG 80576 .......... .......... .......... .......... .......... .......... 288 GTATAATTTA AAAAATTGTT CCTATTTATT AAATGCTTTT TGAGAATTGA GTAGTACTAA 80636 .......... .......... .......... .......... .......... .......... 288 AAAGAACTAC TTTAATGTTA AGGGTGTGGT GATAACAATT GTCAACTTTA ATCTTGAATT 80696 .......... .......... .......... .......... .......... .......... 288 CCTAAAGCGA CAATTATTTT GAGCTAAAAT GATAGCAGAA AATGATGAAT AACTATATTT 80756 .......... .......... .......... .......... .......... .......... 288 GTTGTGAGGC GGGTGATATC TATGTTGAAC TTTGTATTTT TTTGTAAATT AAATAAAAAA 80816 .......... .......... .......... .......... .......... .......... 288 GGTTATATTA AAAATAGAGA AATTAAATCT CATGTAATGT TCTGTTATAT AATTACCATT 80876 .......... .......... .......... .......... .......... .......... 288 TGGGCAGGAT TTAAAATAGA ATATAGTGGA TTGCTTTACT TTTAATTCTG GATTTTGTCC 80936 .......... .......... .......... .......... .......... .......... 288 AAAAAGCATG GTAGTTTTAA CATTACTAGT TTTTTTCAAA AAGCATGCCA TTTTCCCAGA 80996 .......... .......... .......... .......... .......... .......... 288 AAGAAAATTA ATTTCTGGTA ACAATTTTTT CCATTTTCAA TGTTCTATTA TAAATCAATT 81056 .......... .......... .......... .......... .......... .......... 288 TACATTTTAG AGTGAGGGGT AAATATAGCC TGGTGTTTAA TAGTGAACTC TATAAAAATG 81116 .......... .......... .......... .......... .......... .......... 288 AGGCTGATTT TTCTTTCAAT AAGAGCATGC CATGTGACTG TCTAAAGCTG AAAATGAAGT 81176 .......... .......... .......... .......... .......... .......... 288 TTTAACGGGT GGGGTAAATA TAGCTAGTTT GAACGGGTGA AGGGTAAATA TAACTAGTTT 81236 .......... .......... .......... .......... .......... .......... 288 TAACAGGCAG GGGTAAAATT GTAGGGGTGT ATATTCATTG AAAGTGTAGA ATATAGGGCA 81296 .......... .......... .......... .......... .......... .......... 288 AATATAGCTT ATTTTTAATA GTAAAGGGGC AATTATCCTT TTCTGAATTA ACTATTCCAT 81356 .......... .......... .......... .......... .......... .......... 288 CTGGAGCATC ATTTATCATG CAGCTGTAAT TAAAATGTTC TCTAGCTGAA ACAATATAGC 81416 .......... .......... .......... .......... .......... .......... 288 GAGCATTGAA TATTAACAGG AGGTGGAAAG CTAATTCAAC ACTTTGCTCT TGCATATCAG 81476 .......... .......... .......... .......... .......... .......... 288 CAACTGTTAT AAGCCAAATA ATTTTATATA AGTGGGAAAA AAATCTTGTA TGCAAGCAAT 81536 .......... .......... .......... .......... .......... .......... 288 GCATAAAAAG CTAAAGAACC TACATTGAAT ATGCCTTTTC TAGAGTTCAT TTTTTTTATC 81596 .......... .......... .......... .......... .......... .......... 288 AATTAAAAAA AATAGTTCTC TAGAGAAGAT ACAAATCTCC CATACAAACA GGGACCTCAT 81656 .......... .......... .......... .......... .......... .......... 288 GGGTGCTTGA AAAATTAACG ACGAACAATA GACCATTCCT TAAATGTGCA TAATCTATCT 81716 .......... .......... .......... .......... .......... .......... 288 CCTCAAAACC CTTTTTGTTC TTCTCTCCAC AGGACCCACA TGAAAGCAAA GGGGTAACAT 81776 .......... .......... .......... .......... .......... .......... 288 TCCGTGCATT ATGCTGCCAT GAGAATTATG GCATCATTTA ATTTAACCCA AGCCAATTCA 81836 .......... .......... .......... .......... .......... .......... 288 ATACCACTCA AAATCTTGTT GATATACACC ATTTTTCTCT TTTGTTTTCA ATTTTTTGTC 81896 .......... .......... .......... .......... .......... .......... 288 ACCGTCCTTG CTGCCCATTA AAAATAGCAC ATTTCTGGGT ACTTTGGGTA AGTGGAGAAA 81956 .......... .......... .......... .......... .......... .......... 288 GTCCAACTCG TCCTTCAATA TAAGCCTGTG ATAGTATCAC TTGACTGAGA ACACTCCCTC 82016 .......... .......... .......... .......... .......... .......... 288 TCTCTTCACT CTTTACCTCT ATAAGTCCTT GCTAGCATGT GTTGTGTTCT ATTAGAGTAT 82076 .......... .......... .......... .......... .......... .......... 288 ATCAAGCAAA CTTAAATTCA ACAATCTTCC AGTCTTGTAA ATTCTTTCCT GTCCCAGGAG 82136 .......... .......... .......... .......... .......... .......... 288 GATAGCCTCG AATGCCATCT CTGCCTATTT GCCCCAGCCT TTTCATTTCC ATAATGTACA 82196 .......... .......... .......... .......... .......... .......... 288 ACATAAGAGA TAACAAGTTT CCTTGTTACA GATCCCTCAA GCTACCAAAA AATCTGCATG 82256 .......... .......... .......... .......... .......... .......... 288 TGTTCGACTT ACTAGGATCC AGTACTTGAC CATGAGATGT AAACTTGATC CACTTCCTCA 82316 .......... .......... .......... .......... .......... .......... 288 ACTTATTCCA AATCCTATAT TCGTTATGAT AAAATGCAGC AACTTTTAAT TCACATGGTT 82376 .......... .......... .......... .......... .......... .......... 288 GTAACTTCCA GAGGGCCAAT TTGCATAAGA TTCCTCTCCC TTCTTTTCTT GTTGGGTCGG 82436 .......... .......... .......... .......... .......... .......... 288 CAACTTTTTT TGCCACCAAA ACCATGTCTA GAATCTCTCC TCCTTTCATG AACTCTTTCG 82496 .......... .......... .......... .......... .......... .......... 288 GGGAGACGAT GTCTTGTCTA ACACCTTTGT AATTTATAAG GTCTTAGTCA TTGATATTCA 82556 .......... .......... .......... .......... .......... .......... 288 CTAATCCCGC TGGAGGCAAA AGCACTAGGT GCCTGGTGGT ATCTTCCCTC CACCTATGCT 82616 .......... .......... .......... .......... .......... .......... 288 GATGGGAGGT AGAAGGTACC CCGTGAAATT AGTCGAGGTG CGTGCAGCTG GCCCTGATAC 82676 .......... .......... .......... .......... .......... .......... 288 CACAATTATA AAAAAGTACT TAATATTCAA TTACTCATTG CCTAATCAGC GAAATCACAA 82736 .......... .......... .......... .......... .......... .......... 288 TAAAATATGT GTCAAAGGCT TGTCTCAAAC TTCCTAATTT CTTGAAATGC AACTGTACTC 82796 .......... .......... .......... .......... .......... .......... 288 CATCACCGCC CCTTGATCTG CTCCAGCATT GTTGAAAGAA AGTTAACATG AAATTGTCCA 82856 .......... .......... .......... .......... .......... .......... 288 AACTAGGGGC CTTGTATACT ACAAGTCTCC AGGGAAAAGA GATGCATGCC AAATAATTTT 82916 .......... .......... .......... .......... .......... .......... 288 CAGACTCCTA GAAAGAGAAA GGGATGCACA AGAGAAAGAG TGGGTGTAGA GAAATGGTGG 82976 .......... .......... .......... .......... .......... .......... 288 TTTTTGAAAC TATTTGTTAC ATCATAAGCT AAAATCTTGA AGTATGATGT TAAGCACAGA 83036 .......... .......... .......... .......... .......... .......... 288 TTCTAATTTC CTCGAAGGAT CATTAAGCCA AACAGTGTAA GAAGTGCAAG CAGTCGGGAA 83096 .......... .......... .......... .......... .......... .......... 288 AATATTCCTC GTATAATATC TCCAAACAGT GTTAGGAGTG GAAGCTTAAA TGTATTGCCA 83156 .......... .......... .......... .......... .......... .......... 288 ATTAGAAACA CCCTGAAATG ATGCTAAAAG AAGAAAGCTT ATAGTATGTG TGACACTATT 83216 .......... .......... .......... .......... .......... .......... 288 TATGGTATTC CATTTGCAGC ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 83276 | |||||||||| |||||||||| |||||||||| |||||||||| .......... .........C ACGGAAGGAA AACTGATCTT AGAAGATGGA GTCTCTGAAG 329 TTGCTAAGAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA CTTGCAGAAG 83336 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGCTAAGAG CTTGTTAGCA GCCTACGACA GTGGTGAGCT CTGTGGTGCA CTTGCAGAAG 389 GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAGGTTC 83396 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||| GCCAACCTGG ATGGAGAAAC TGGGTGAAGA AGTTCGGTAA ATTGCTGAAG CGCAAG.... 445 GATCTGAGTA TTTTCTTTTT CGCTGAAAGT TTTTTTTTCA GTATTTATTG AGGTTGCTTT 83456 .......... .......... .......... .......... .......... .......... 445 ATGTACCAGG GAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 83516 | |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| .........G GAAAATCTCT CTTCATGCCC CTTCGGGTGT TGCTAACAGG AAAGCTTCAT 496 GGACCTGATA TTGGGGCCAC CACAGTATTA CTCTATAAAG CTGGAACATC TGGTTCTGTA 83576 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGACCTGATA TTGGGGCCAC CACAGTATTA CTCTATAAAG CTGGAACATC TGGTTCTGTA 556 GCACCCCAAG CTGGGTTTGT TACATT 83602 |||||||||| |||||||||| |||||| GCACCCCAAG CTGGGTTTGT TACATT 582 hqPGS_C01HBa0088L02.1+_SGN-E392303+ (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83602) ******************************************************************************** EST sequence 11 +strand 713 n (File: SGN-E371395+) 1 CAGCTTGTTG AAAAGTTCAC AATTGAACGT GTAAACAAAA GTGGTGCCAT ATTTGATTCG 61 ACCAAGTTAA GGTGGATGAA TGGTCAGCAT TTGAGATCAC TTCCATCTGA AGAGTTGAAC 121 CAAATCATTG GTGAAAGGTG GAAGGATGCA GACATCGTTA CAGAATCACA AGGAGTTTTT 181 GTACAGGATG CTGTTCTACT CCTCAAAGAT GGGATTGACT TGATACCAGA TTCAGAGAAA 241 GCACTTTCAA GTTTGCTATC TTATCCTTTA TATGAAACTT TGACAAGCAC GGAAGGAAAA 301 CTGATCTTAG AAGATGGAGT CTCTGAAGTT GCTAAGAGCT TGTTAGCAGC CTACGACAGT 361 GGTGAGCTCT GTGGTGCACT TGCAGAAGGC CAACCTGGAT GGAGAAACTG GGTGAAGAAG 421 TTCGGTAAAT TGCTGAAGCG CAAGGGAAAA TCTCTCTTCA TGCCCCTTCG GGTGTTGCTA 481 ACAGGAAAGC TTCATGGACC TGATATTGGG GCCACCACAG TATTACTCTA TAAAGCTGGA 541 ACATCTGGTT CTGTAGCACC CCAAGCTGGG TTTGTTACAT TTGATGAAAG ATTTAAGATA 601 TTGAGAGAAG TTCAATGGGA GTCGTTCAGC TCAAATGTGC CTTTGTCTGC TGGTGTTGTA 661 ACGCATTGAG ATTGTGGCGA TATTCTGTTT TGATTATTCA TTAAAAAAAA AAA Predicted gene structure (within gDNA segment 78288 to 84488): Exon 1 78838 78844 ( 7 n); cDNA 1 7 ( 7 n); score: 1.000 Intron 1 78845 78948 ( 104 n); Pd: 0.975 (s: 0), Pa: 0.975 (s: 1.00) Exon 2 78949 79012 ( 64 n); cDNA 8 71 ( 64 n); score: 1.000 Intron 2 79013 79532 ( 520 n); Pd: 0.477 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 79533 79647 ( 115 n); cDNA 72 186 ( 115 n); score: 1.000 Intron 3 79648 79876 ( 229 n); Pd: 0.999 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 4 79877 79977 ( 101 n); cDNA 187 287 ( 101 n); score: 1.000 Intron 4 79978 83235 (3258 n); Pd: 0.542 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 5 83236 83392 ( 157 n); cDNA 288 444 ( 157 n); score: 1.000 Intron 5 83393 83465 ( 73 n); Pd: 0.989 (s: 1.00), Pa: 0.988 (s: 1.00) Exon 6 83466 83724 ( 259 n); cDNA 445 703 ( 259 n); score: 0.996 PPA cDNA 704 713 MATCH C01HBa0088L02.1+ SGN-E371395+ 0.999 703 0.986 C PGS_C01HBa0088L02.1+_SGN-E371395+ (78838 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) Alignment (genomic DNA sequence = upper lines): CAGCTTGGTA AGTGATTGCC TCTATGCTGA TGTTGACATG TCTAATGCTA ACTTGCAGTC 78897 ||||||| CAGCTTG... .......... .......... .......... .......... .......... 7 ATTACTATTT ATTCACATTC CAACAGTGAT AGCTTCTCAT TTCATTTGCA GTTGAAAAGT 78957 ||||||||| .......... .......... .......... .......... .......... .TTGAAAAGT 16 TCACAATTGA ACGTGTAAAC AAAAGTGGTG CCATATTTGA TTCGACCAAG TTAAGGTATT 79017 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||| TCACAATTGA ACGTGTAAAC AAAAGTGGTG CCATATTTGA TTCGACCAAG TTAAG..... 71 GTGTGTGTGT ATATATATAT CAATTTCTTT TTGATTGGTG AGAGAGTAGC TCCTATTGAT 79077 .......... .......... .......... .......... .......... .......... 71 ATATGCACAG CCAAAAGATA ATGCTGGAGG GTTACAACCA GAAACAATAA CCATCACAGG 79137 .......... .......... .......... .......... .......... .......... 71 TTGTGTAAAT TGTAAATCAC TAATCAAGTC AATCATGACA CCAAAAACAT TTACATCTGC 79197 .......... .......... .......... .......... .......... .......... 71 CATGCTACAG CAAAAACTAA ATAAAAAAAT ACATATGCAT TTAACTTGTA TATCAGAACA 79257 .......... .......... .......... .......... .......... .......... 71 TTTTGTCTTC AAACTTCCTG ATGTTTCCTT CATTCCATAA GCTCCACCAA ACGGTGGAGA 79317 .......... .......... .......... .......... .......... .......... 71 TGCAGCAAGA AACCCAAAAA CAATTCCAAT TTACATATGA TTGAAAGCTT TCTCATTTTC 79377 .......... .......... .......... .......... .......... .......... 71 CAATTTGCAA AGATACCCTG GAATACTTCG TCTCCTCCTC GAATCAATAC ATTGCTATAT 79437 .......... .......... .......... .......... .......... .......... 71 TTTCTTCTGC TACATGGATA GGCTTGGTTA CCAAGACATT ATGAAATTGA ATTATATGTC 79497 .......... .......... .......... .......... .......... .......... 71 TTGATTGTTG TTTAAAATAT GGTTATGAAC TTCAGGTGGA TGAATGGTCA GCATTTGAGA 79557 ||||| |||||||||| |||||||||| .......... .......... .......... .....GTGGA TGAATGGTCA GCATTTGAGA 96 TCACTTCCAT CTGAAGAGTT GAACCAAATC ATTGGTGAAA GGTGGAAGGA TGCAGACATC 79617 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCACTTCCAT CTGAAGAGTT GAACCAAATC ATTGGTGAAA GGTGGAAGGA TGCAGACATC 156 GTTACAGAAT CACAAGGAGT TTTTGTACAG GTAGAAATTT TCCCCTCTCT TTCATTTCTC 79677 |||||||||| |||||||||| |||||||||| GTTACAGAAT CACAAGGAGT TTTTGTACAG .......... .......... .......... 186 AACCACATTG TTACTACAAG ATTTTTCTTA ATCATCTTTG TGGAGATCTA ACAACGAGAT 79737 .......... .......... .......... .......... .......... .......... 186 TTTGGAGGAT TTTTCTTAAT AATCTTTCCC GAATGGCTGT TGCATAGATG CTTGTCATTA 79797 .......... .......... .......... .......... .......... .......... 186 AATATCAATT CAAAAAATTG TTGCTCAATG TACTTTGGAG TTATGGTTCT TATACCTGTT 79857 .......... .......... .......... .......... .......... .......... 186 AAATTTTCTG TATATATAGG ATGCTGTTCT ACTCCTCAAA GATGGGATTG ACTTGATACC 79917 | |||||||||| |||||||||| |||||||||| |||||||||| .......... .........G ATGCTGTTCT ACTCCTCAAA GATGGGATTG ACTTGATACC 227 AGATTCAGAG AAAGCACTTT CAAGTTTGCT ATCTTATCCT TTATATGAAA CTTTGACAAG 79977 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGATTCAGAG AAAGCACTTT CAAGTTTGCT ATCTTATCCT TTATATGAAA CTTTGACAAG 287 GTGATCCATG AAATTATGTT TTAAAACTAT ACCTATGTGA CGCTAAAAGA TGAAAACATG 80037 .......... .......... .......... .......... .......... .......... 287 GAGGTTTCAA TTTGGTCCAT TCATTAAGGC GGGAATGAGA ATATTTGTTG ATTAATGAGT 80097 .......... .......... .......... .......... .......... .......... 287 TCAATTTTGT TATAAATAAA GGTAACTAAT TATATCCCAT TTACTCCATT ACCAAGTGAA 80157 .......... .......... .......... .......... .......... .......... 287 CACAAAAGAC GAGTTCCACA ACAAACATTG GTTCTTTGTA AAGGCAACCA ATTGTCTATG 80217 .......... .......... .......... .......... .......... .......... 287 GAAAAGGGTC GTATTTGCCC CTCTACTATC AAAAAATAAG CTATATTTAC CCTCCGTTAT 80277 .......... .......... .......... .......... .......... .......... 287 ACCTTTTCAA CAAATATCCT CCTATAGTCA TAATATAGAG CTATGTTTCT CACCCGTGAA 80337 .......... .......... .......... .......... .......... .......... 287 AACTTCACTT TCAGCTTTTA AAAGCCATGT GTTATTCTCT TATTGAACCA AATAATCAGC 80397 .......... .......... .......... .......... .......... .......... 287 CTCACTTTTG CCCGCACCCA AATCACTCTC ATTTCTCTCT ATCCGGAAGG TGTACTTGAG 80457 .......... .......... .......... .......... .......... .......... 287 CCTGCAAAAT CAATAGTTGG TCCAAAGCTC CCTAATCTTT CTTCTCCCCA ATTCCATCAT 80517 .......... .......... .......... .......... .......... .......... 287 CTCATTCTTA TGCAACAAAA CCAAGTCTTA TTAGTTATAA TTTACTTAAT AAGTACAAGG 80577 .......... .......... .......... .......... .......... .......... 287 TATAATTTAA AAAATTGTTC CTATTTATTA AATGCTTTTT GAGAATTGAG TAGTACTAAA 80637 .......... .......... .......... .......... .......... .......... 287 AAGAACTACT TTAATGTTAA GGGTGTGGTG ATAACAATTG TCAACTTTAA TCTTGAATTC 80697 .......... .......... .......... .......... .......... .......... 287 CTAAAGCGAC AATTATTTTG AGCTAAAATG ATAGCAGAAA ATGATGAATA ACTATATTTG 80757 .......... .......... .......... .......... .......... .......... 287 TTGTGAGGCG GGTGATATCT ATGTTGAACT TTGTATTTTT TTGTAAATTA AATAAAAAAG 80817 .......... .......... .......... .......... .......... .......... 287 GTTATATTAA AAATAGAGAA ATTAAATCTC ATGTAATGTT CTGTTATATA ATTACCATTT 80877 .......... .......... .......... .......... .......... .......... 287 GGGCAGGATT TAAAATAGAA TATAGTGGAT TGCTTTACTT TTAATTCTGG ATTTTGTCCA 80937 .......... .......... .......... .......... .......... .......... 287 AAAAGCATGG TAGTTTTAAC ATTACTAGTT TTTTTCAAAA AGCATGCCAT TTTCCCAGAA 80997 .......... .......... .......... .......... .......... .......... 287 AGAAAATTAA TTTCTGGTAA CAATTTTTTC CATTTTCAAT GTTCTATTAT AAATCAATTT 81057 .......... .......... .......... .......... .......... .......... 287 ACATTTTAGA GTGAGGGGTA AATATAGCCT GGTGTTTAAT AGTGAACTCT ATAAAAATGA 81117 .......... .......... .......... .......... .......... .......... 287 GGCTGATTTT TCTTTCAATA AGAGCATGCC ATGTGACTGT CTAAAGCTGA AAATGAAGTT 81177 .......... .......... .......... .......... .......... .......... 287 TTAACGGGTG GGGTAAATAT AGCTAGTTTG AACGGGTGAA GGGTAAATAT AACTAGTTTT 81237 .......... .......... .......... .......... .......... .......... 287 AACAGGCAGG GGTAAAATTG TAGGGGTGTA TATTCATTGA AAGTGTAGAA TATAGGGCAA 81297 .......... .......... .......... .......... .......... .......... 287 ATATAGCTTA TTTTTAATAG TAAAGGGGCA ATTATCCTTT TCTGAATTAA CTATTCCATC 81357 .......... .......... .......... .......... .......... .......... 287 TGGAGCATCA TTTATCATGC AGCTGTAATT AAAATGTTCT CTAGCTGAAA CAATATAGCG 81417 .......... .......... .......... .......... .......... .......... 287 AGCATTGAAT ATTAACAGGA GGTGGAAAGC TAATTCAACA CTTTGCTCTT GCATATCAGC 81477 .......... .......... .......... .......... .......... .......... 287 AACTGTTATA AGCCAAATAA TTTTATATAA GTGGGAAAAA AATCTTGTAT GCAAGCAATG 81537 .......... .......... .......... .......... .......... .......... 287 CATAAAAAGC TAAAGAACCT ACATTGAATA TGCCTTTTCT AGAGTTCATT TTTTTTATCA 81597 .......... .......... .......... .......... .......... .......... 287 ATTAAAAAAA ATAGTTCTCT AGAGAAGATA CAAATCTCCC ATACAAACAG GGACCTCATG 81657 .......... .......... .......... .......... .......... .......... 287 GGTGCTTGAA AAATTAACGA CGAACAATAG ACCATTCCTT AAATGTGCAT AATCTATCTC 81717 .......... .......... .......... .......... .......... .......... 287 CTCAAAACCC TTTTTGTTCT TCTCTCCACA GGACCCACAT GAAAGCAAAG GGGTAACATT 81777 .......... .......... .......... .......... .......... .......... 287 CCGTGCATTA TGCTGCCATG AGAATTATGG CATCATTTAA TTTAACCCAA GCCAATTCAA 81837 .......... .......... .......... .......... .......... .......... 287 TACCACTCAA AATCTTGTTG ATATACACCA TTTTTCTCTT TTGTTTTCAA TTTTTTGTCA 81897 .......... .......... .......... .......... .......... .......... 287 CCGTCCTTGC TGCCCATTAA AAATAGCACA TTTCTGGGTA CTTTGGGTAA GTGGAGAAAG 81957 .......... .......... .......... .......... .......... .......... 287 TCCAACTCGT CCTTCAATAT AAGCCTGTGA TAGTATCACT TGACTGAGAA CACTCCCTCT 82017 .......... .......... .......... .......... .......... .......... 287 CTCTTCACTC TTTACCTCTA TAAGTCCTTG CTAGCATGTG TTGTGTTCTA TTAGAGTATA 82077 .......... .......... .......... .......... .......... .......... 287 TCAAGCAAAC TTAAATTCAA CAATCTTCCA GTCTTGTAAA TTCTTTCCTG TCCCAGGAGG 82137 .......... .......... .......... .......... .......... .......... 287 ATAGCCTCGA ATGCCATCTC TGCCTATTTG CCCCAGCCTT TTCATTTCCA TAATGTACAA 82197 .......... .......... .......... .......... .......... .......... 287 CATAAGAGAT AACAAGTTTC CTTGTTACAG ATCCCTCAAG CTACCAAAAA ATCTGCATGT 82257 .......... .......... .......... .......... .......... .......... 287 GTTCGACTTA CTAGGATCCA GTACTTGACC ATGAGATGTA AACTTGATCC ACTTCCTCAA 82317 .......... .......... .......... .......... .......... .......... 287 CTTATTCCAA ATCCTATATT CGTTATGATA AAATGCAGCA ACTTTTAATT CACATGGTTG 82377 .......... .......... .......... .......... .......... .......... 287 TAACTTCCAG AGGGCCAATT TGCATAAGAT TCCTCTCCCT TCTTTTCTTG TTGGGTCGGC 82437 .......... .......... .......... .......... .......... .......... 287 AACTTTTTTT GCCACCAAAA CCATGTCTAG AATCTCTCCT CCTTTCATGA ACTCTTTCGG 82497 .......... .......... .......... .......... .......... .......... 287 GGAGACGATG TCTTGTCTAA CACCTTTGTA ATTTATAAGG TCTTAGTCAT TGATATTCAC 82557 .......... .......... .......... .......... .......... .......... 287 TAATCCCGCT GGAGGCAAAA GCACTAGGTG CCTGGTGGTA TCTTCCCTCC ACCTATGCTG 82617 .......... .......... .......... .......... .......... .......... 287 ATGGGAGGTA GAAGGTACCC CGTGAAATTA GTCGAGGTGC GTGCAGCTGG CCCTGATACC 82677 .......... .......... .......... .......... .......... .......... 287 ACAATTATAA AAAAGTACTT AATATTCAAT TACTCATTGC CTAATCAGCG AAATCACAAT 82737 .......... .......... .......... .......... .......... .......... 287 AAAATATGTG TCAAAGGCTT GTCTCAAACT TCCTAATTTC TTGAAATGCA ACTGTACTCC 82797 .......... .......... .......... .......... .......... .......... 287 ATCACCGCCC CTTGATCTGC TCCAGCATTG TTGAAAGAAA GTTAACATGA AATTGTCCAA 82857 .......... .......... .......... .......... .......... .......... 287 ACTAGGGGCC TTGTATACTA CAAGTCTCCA GGGAAAAGAG ATGCATGCCA AATAATTTTC 82917 .......... .......... .......... .......... .......... .......... 287 AGACTCCTAG AAAGAGAAAG GGATGCACAA GAGAAAGAGT GGGTGTAGAG AAATGGTGGT 82977 .......... .......... .......... .......... .......... .......... 287 TTTTGAAACT ATTTGTTACA TCATAAGCTA AAATCTTGAA GTATGATGTT AAGCACAGAT 83037 .......... .......... .......... .......... .......... .......... 287 TCTAATTTCC TCGAAGGATC ATTAAGCCAA ACAGTGTAAG AAGTGCAAGC AGTCGGGAAA 83097 .......... .......... .......... .......... .......... .......... 287 ATATTCCTCG TATAATATCT CCAAACAGTG TTAGGAGTGG AAGCTTAAAT GTATTGCCAA 83157 .......... .......... .......... .......... .......... .......... 287 TTAGAAACAC CCTGAAATGA TGCTAAAAGA AGAAAGCTTA TAGTATGTGT GACACTATTT 83217 .......... .......... .......... .......... .......... .......... 287 ATGGTATTCC ATTTGCAGCA CGGAAGGAAA ACTGATCTTA GAAGATGGAG TCTCTGAAGT 83277 || |||||||||| |||||||||| |||||||||| |||||||||| .......... ........CA CGGAAGGAAA ACTGATCTTA GAAGATGGAG TCTCTGAAGT 329 TGCTAAGAGC TTGTTAGCAG CCTACGACAG TGGTGAGCTC TGTGGTGCAC TTGCAGAAGG 83337 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGCTAAGAGC TTGTTAGCAG CCTACGACAG TGGTGAGCTC TGTGGTGCAC TTGCAGAAGG 389 CCAACCTGGA TGGAGAAACT GGGTGAAGAA GTTCGGTAAA TTGCTGAAGC GCAAGGTTCG 83397 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||| CCAACCTGGA TGGAGAAACT GGGTGAAGAA GTTCGGTAAA TTGCTGAAGC GCAAG..... 444 ATCTGAGTAT TTTCTTTTTC GCTGAAAGTT TTTTTTTCAG TATTTATTGA GGTTGCTTTA 83457 .......... .......... .......... .......... .......... .......... 444 TGTACCAGGG AAAATCTCTC TTCATGCCCC TTCGGGTGTT GCTAACAGGA AAGCTTCATG 83517 || |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ........GG AAAATCTCTC TTCATGCCCC TTCGGGTGTT GCTAACAGGA AAGCTTCATG 496 GACCTGATAT TGGGGCCACC ACAGTATTAC TCTATAAAGC TGGAACATCT GGTTCTGTAG 83577 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GACCTGATAT TGGGGCCACC ACAGTATTAC TCTATAAAGC TGGAACATCT GGTTCTGTAG 556 CACCCCAAGC TGGGTTTGTT ACATTTGATG AAAGATTTAA GATATTGAGA GAAGTTCAAT 83637 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACCCCAAGC TGGGTTTGTT ACATTTGATG AAAGATTTAA GATATTGAGA GAAGTTCAAT 616 GGGAGTCGTT CAGCTCAAAT GTGCCTTTGT CTGCTGGTGT TGTAACGCAT TGAGATTGTG 83697 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGGAGTCGTT CAGCTCAAAT GTGCCTTTGT CTGCTGGTGT TGTAACGCAT TGAGATTGTG 676 GCGATATTCT GTTTTGATTA TCCATTA 83724 |||||||||| |||||||||| | ||||| GCGATATTCT GTTTTGATTA TTCATTA 703 hqPGS_C01HBa0088L02.1+_SGN-E371395+ (78838 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) ******************************************************************************** EST sequence 30 +strand 464 n (File: SGN-E271199+) 1 CAGCTTGTTG AAAAGTTCAC AATTGAACGT GTAAACAAAA GTGGTGCCAT ATTTGATTCG 61 ACCAAGTTAA GGTGGATGAA TGGTCAGCAT TTGAGATCAC TTCCATCTGA AGAGTTGAAC 121 CAAATCATTG GTGAAAGGTG GAAGGATGCA GACATCGTTA CAGAATCACA AGGAGTTTTT 181 GTACAGGATG CTGTTCTACT CCTCAAAGAT GGGATTGACT TGATACCAGA TTCAGAGAAA 241 GCACTTTCAA GTTTGCTATC TTATCCTTTA TATGAAACTT TGACAAGCAC GGAAGGAAAA 301 CTGATCTTAG AAGATGGAGT CTCTGAAGTT GCTAAGAGCT TGTTAGCAGC CTACGACAGT 361 GGTGAGCTCT GTGGTGCACT TGCAGAAGGC CAACCTGGAT GGAGAAACTG GGTGAAGAAG 421 TTCGGTAAAT TGCTGAAGCG CAAGGGAAAA TCTCTCTTCA TGCC Predicted gene structure (within gDNA segment 78288 to 84193): Exon 1 78838 78844 ( 7 n); cDNA 1 7 ( 7 n); score: 1.000 Intron 1 78845 78948 ( 104 n); Pd: 0.975 (s: 0), Pa: 0.975 (s: 1.00) Exon 2 78949 79012 ( 64 n); cDNA 8 71 ( 64 n); score: 1.000 Intron 2 79013 79532 ( 520 n); Pd: 0.477 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 79533 79647 ( 115 n); cDNA 72 186 ( 115 n); score: 1.000 Intron 3 79648 79876 ( 229 n); Pd: 0.999 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 4 79877 79977 ( 101 n); cDNA 187 287 ( 101 n); score: 1.000 Intron 4 79978 83235 (3258 n); Pd: 0.542 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 5 83236 83392 ( 157 n); cDNA 288 444 ( 157 n); score: 1.000 Intron 5 83393 83465 ( 73 n); Pd: 0.989 (s: 1.00), Pa: 0.988 (s: 0) Exon 6 83466 83485 ( 20 n); cDNA 445 464 ( 20 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E271199+ 1.000 464 1.000 C PGS_C01HBa0088L02.1+_SGN-E271199+ (78838 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83485) Alignment (genomic DNA sequence = upper lines): CAGCTTGGTA AGTGATTGCC TCTATGCTGA TGTTGACATG TCTAATGCTA ACTTGCAGTC 78897 ||||||| CAGCTTG... .......... .......... .......... .......... .......... 7 ATTACTATTT ATTCACATTC CAACAGTGAT AGCTTCTCAT TTCATTTGCA GTTGAAAAGT 78957 ||||||||| .......... .......... .......... .......... .......... .TTGAAAAGT 16 TCACAATTGA ACGTGTAAAC AAAAGTGGTG CCATATTTGA TTCGACCAAG TTAAGGTATT 79017 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||| TCACAATTGA ACGTGTAAAC AAAAGTGGTG CCATATTTGA TTCGACCAAG TTAAG..... 71 GTGTGTGTGT ATATATATAT CAATTTCTTT TTGATTGGTG AGAGAGTAGC TCCTATTGAT 79077 .......... .......... .......... .......... .......... .......... 71 ATATGCACAG CCAAAAGATA ATGCTGGAGG GTTACAACCA GAAACAATAA CCATCACAGG 79137 .......... .......... .......... .......... .......... .......... 71 TTGTGTAAAT TGTAAATCAC TAATCAAGTC AATCATGACA CCAAAAACAT TTACATCTGC 79197 .......... .......... .......... .......... .......... .......... 71 CATGCTACAG CAAAAACTAA ATAAAAAAAT ACATATGCAT TTAACTTGTA TATCAGAACA 79257 .......... .......... .......... .......... .......... .......... 71 TTTTGTCTTC AAACTTCCTG ATGTTTCCTT CATTCCATAA GCTCCACCAA ACGGTGGAGA 79317 .......... .......... .......... .......... .......... .......... 71 TGCAGCAAGA AACCCAAAAA CAATTCCAAT TTACATATGA TTGAAAGCTT TCTCATTTTC 79377 .......... .......... .......... .......... .......... .......... 71 CAATTTGCAA AGATACCCTG GAATACTTCG TCTCCTCCTC GAATCAATAC ATTGCTATAT 79437 .......... .......... .......... .......... .......... .......... 71 TTTCTTCTGC TACATGGATA GGCTTGGTTA CCAAGACATT ATGAAATTGA ATTATATGTC 79497 .......... .......... .......... .......... .......... .......... 71 TTGATTGTTG TTTAAAATAT GGTTATGAAC TTCAGGTGGA TGAATGGTCA GCATTTGAGA 79557 ||||| |||||||||| |||||||||| .......... .......... .......... .....GTGGA TGAATGGTCA GCATTTGAGA 96 TCACTTCCAT CTGAAGAGTT GAACCAAATC ATTGGTGAAA GGTGGAAGGA TGCAGACATC 79617 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TCACTTCCAT CTGAAGAGTT GAACCAAATC ATTGGTGAAA GGTGGAAGGA TGCAGACATC 156 GTTACAGAAT CACAAGGAGT TTTTGTACAG GTAGAAATTT TCCCCTCTCT TTCATTTCTC 79677 |||||||||| |||||||||| |||||||||| GTTACAGAAT CACAAGGAGT TTTTGTACAG .......... .......... .......... 186 AACCACATTG TTACTACAAG ATTTTTCTTA ATCATCTTTG TGGAGATCTA ACAACGAGAT 79737 .......... .......... .......... .......... .......... .......... 186 TTTGGAGGAT TTTTCTTAAT AATCTTTCCC GAATGGCTGT TGCATAGATG CTTGTCATTA 79797 .......... .......... .......... .......... .......... .......... 186 AATATCAATT CAAAAAATTG TTGCTCAATG TACTTTGGAG TTATGGTTCT TATACCTGTT 79857 .......... .......... .......... .......... .......... .......... 186 AAATTTTCTG TATATATAGG ATGCTGTTCT ACTCCTCAAA GATGGGATTG ACTTGATACC 79917 | |||||||||| |||||||||| |||||||||| |||||||||| .......... .........G ATGCTGTTCT ACTCCTCAAA GATGGGATTG ACTTGATACC 227 AGATTCAGAG AAAGCACTTT CAAGTTTGCT ATCTTATCCT TTATATGAAA CTTTGACAAG 79977 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGATTCAGAG AAAGCACTTT CAAGTTTGCT ATCTTATCCT TTATATGAAA CTTTGACAAG 287 GTGATCCATG AAATTATGTT TTAAAACTAT ACCTATGTGA CGCTAAAAGA TGAAAACATG 80037 .......... .......... .......... .......... .......... .......... 287 GAGGTTTCAA TTTGGTCCAT TCATTAAGGC GGGAATGAGA ATATTTGTTG ATTAATGAGT 80097 .......... .......... .......... .......... .......... .......... 287 TCAATTTTGT TATAAATAAA GGTAACTAAT TATATCCCAT TTACTCCATT ACCAAGTGAA 80157 .......... .......... .......... .......... .......... .......... 287 CACAAAAGAC GAGTTCCACA ACAAACATTG GTTCTTTGTA AAGGCAACCA ATTGTCTATG 80217 .......... .......... .......... .......... .......... .......... 287 GAAAAGGGTC GTATTTGCCC CTCTACTATC AAAAAATAAG CTATATTTAC CCTCCGTTAT 80277 .......... .......... .......... .......... .......... .......... 287 ACCTTTTCAA CAAATATCCT CCTATAGTCA TAATATAGAG CTATGTTTCT CACCCGTGAA 80337 .......... .......... .......... .......... .......... .......... 287 AACTTCACTT TCAGCTTTTA AAAGCCATGT GTTATTCTCT TATTGAACCA AATAATCAGC 80397 .......... .......... .......... .......... .......... .......... 287 CTCACTTTTG CCCGCACCCA AATCACTCTC ATTTCTCTCT ATCCGGAAGG TGTACTTGAG 80457 .......... .......... .......... .......... .......... .......... 287 CCTGCAAAAT CAATAGTTGG TCCAAAGCTC CCTAATCTTT CTTCTCCCCA ATTCCATCAT 80517 .......... .......... .......... .......... .......... .......... 287 CTCATTCTTA TGCAACAAAA CCAAGTCTTA TTAGTTATAA TTTACTTAAT AAGTACAAGG 80577 .......... .......... .......... .......... .......... .......... 287 TATAATTTAA AAAATTGTTC CTATTTATTA AATGCTTTTT GAGAATTGAG TAGTACTAAA 80637 .......... .......... .......... .......... .......... .......... 287 AAGAACTACT TTAATGTTAA GGGTGTGGTG ATAACAATTG TCAACTTTAA TCTTGAATTC 80697 .......... .......... .......... .......... .......... .......... 287 CTAAAGCGAC AATTATTTTG AGCTAAAATG ATAGCAGAAA ATGATGAATA ACTATATTTG 80757 .......... .......... .......... .......... .......... .......... 287 TTGTGAGGCG GGTGATATCT ATGTTGAACT TTGTATTTTT TTGTAAATTA AATAAAAAAG 80817 .......... .......... .......... .......... .......... .......... 287 GTTATATTAA AAATAGAGAA ATTAAATCTC ATGTAATGTT CTGTTATATA ATTACCATTT 80877 .......... .......... .......... .......... .......... .......... 287 GGGCAGGATT TAAAATAGAA TATAGTGGAT TGCTTTACTT TTAATTCTGG ATTTTGTCCA 80937 .......... .......... .......... .......... .......... .......... 287 AAAAGCATGG TAGTTTTAAC ATTACTAGTT TTTTTCAAAA AGCATGCCAT TTTCCCAGAA 80997 .......... .......... .......... .......... .......... .......... 287 AGAAAATTAA TTTCTGGTAA CAATTTTTTC CATTTTCAAT GTTCTATTAT AAATCAATTT 81057 .......... .......... .......... .......... .......... .......... 287 ACATTTTAGA GTGAGGGGTA AATATAGCCT GGTGTTTAAT AGTGAACTCT ATAAAAATGA 81117 .......... .......... .......... .......... .......... .......... 287 GGCTGATTTT TCTTTCAATA AGAGCATGCC ATGTGACTGT CTAAAGCTGA AAATGAAGTT 81177 .......... .......... .......... .......... .......... .......... 287 TTAACGGGTG GGGTAAATAT AGCTAGTTTG AACGGGTGAA GGGTAAATAT AACTAGTTTT 81237 .......... .......... .......... .......... .......... .......... 287 AACAGGCAGG GGTAAAATTG TAGGGGTGTA TATTCATTGA AAGTGTAGAA TATAGGGCAA 81297 .......... .......... .......... .......... .......... .......... 287 ATATAGCTTA TTTTTAATAG TAAAGGGGCA ATTATCCTTT TCTGAATTAA CTATTCCATC 81357 .......... .......... .......... .......... .......... .......... 287 TGGAGCATCA TTTATCATGC AGCTGTAATT AAAATGTTCT CTAGCTGAAA CAATATAGCG 81417 .......... .......... .......... .......... .......... .......... 287 AGCATTGAAT ATTAACAGGA GGTGGAAAGC TAATTCAACA CTTTGCTCTT GCATATCAGC 81477 .......... .......... .......... .......... .......... .......... 287 AACTGTTATA AGCCAAATAA TTTTATATAA GTGGGAAAAA AATCTTGTAT GCAAGCAATG 81537 .......... .......... .......... .......... .......... .......... 287 CATAAAAAGC TAAAGAACCT ACATTGAATA TGCCTTTTCT AGAGTTCATT TTTTTTATCA 81597 .......... .......... .......... .......... .......... .......... 287 ATTAAAAAAA ATAGTTCTCT AGAGAAGATA CAAATCTCCC ATACAAACAG GGACCTCATG 81657 .......... .......... .......... .......... .......... .......... 287 GGTGCTTGAA AAATTAACGA CGAACAATAG ACCATTCCTT AAATGTGCAT AATCTATCTC 81717 .......... .......... .......... .......... .......... .......... 287 CTCAAAACCC TTTTTGTTCT TCTCTCCACA GGACCCACAT GAAAGCAAAG GGGTAACATT 81777 .......... .......... .......... .......... .......... .......... 287 CCGTGCATTA TGCTGCCATG AGAATTATGG CATCATTTAA TTTAACCCAA GCCAATTCAA 81837 .......... .......... .......... .......... .......... .......... 287 TACCACTCAA AATCTTGTTG ATATACACCA TTTTTCTCTT TTGTTTTCAA TTTTTTGTCA 81897 .......... .......... .......... .......... .......... .......... 287 CCGTCCTTGC TGCCCATTAA AAATAGCACA TTTCTGGGTA CTTTGGGTAA GTGGAGAAAG 81957 .......... .......... .......... .......... .......... .......... 287 TCCAACTCGT CCTTCAATAT AAGCCTGTGA TAGTATCACT TGACTGAGAA CACTCCCTCT 82017 .......... .......... .......... .......... .......... .......... 287 CTCTTCACTC TTTACCTCTA TAAGTCCTTG CTAGCATGTG TTGTGTTCTA TTAGAGTATA 82077 .......... .......... .......... .......... .......... .......... 287 TCAAGCAAAC TTAAATTCAA CAATCTTCCA GTCTTGTAAA TTCTTTCCTG TCCCAGGAGG 82137 .......... .......... .......... .......... .......... .......... 287 ATAGCCTCGA ATGCCATCTC TGCCTATTTG CCCCAGCCTT TTCATTTCCA TAATGTACAA 82197 .......... .......... .......... .......... .......... .......... 287 CATAAGAGAT AACAAGTTTC CTTGTTACAG ATCCCTCAAG CTACCAAAAA ATCTGCATGT 82257 .......... .......... .......... .......... .......... .......... 287 GTTCGACTTA CTAGGATCCA GTACTTGACC ATGAGATGTA AACTTGATCC ACTTCCTCAA 82317 .......... .......... .......... .......... .......... .......... 287 CTTATTCCAA ATCCTATATT CGTTATGATA AAATGCAGCA ACTTTTAATT CACATGGTTG 82377 .......... .......... .......... .......... .......... .......... 287 TAACTTCCAG AGGGCCAATT TGCATAAGAT TCCTCTCCCT TCTTTTCTTG TTGGGTCGGC 82437 .......... .......... .......... .......... .......... .......... 287 AACTTTTTTT GCCACCAAAA CCATGTCTAG AATCTCTCCT CCTTTCATGA ACTCTTTCGG 82497 .......... .......... .......... .......... .......... .......... 287 GGAGACGATG TCTTGTCTAA CACCTTTGTA ATTTATAAGG TCTTAGTCAT TGATATTCAC 82557 .......... .......... .......... .......... .......... .......... 287 TAATCCCGCT GGAGGCAAAA GCACTAGGTG CCTGGTGGTA TCTTCCCTCC ACCTATGCTG 82617 .......... .......... .......... .......... .......... .......... 287 ATGGGAGGTA GAAGGTACCC CGTGAAATTA GTCGAGGTGC GTGCAGCTGG CCCTGATACC 82677 .......... .......... .......... .......... .......... .......... 287 ACAATTATAA AAAAGTACTT AATATTCAAT TACTCATTGC CTAATCAGCG AAATCACAAT 82737 .......... .......... .......... .......... .......... .......... 287 AAAATATGTG TCAAAGGCTT GTCTCAAACT TCCTAATTTC TTGAAATGCA ACTGTACTCC 82797 .......... .......... .......... .......... .......... .......... 287 ATCACCGCCC CTTGATCTGC TCCAGCATTG TTGAAAGAAA GTTAACATGA AATTGTCCAA 82857 .......... .......... .......... .......... .......... .......... 287 ACTAGGGGCC TTGTATACTA CAAGTCTCCA GGGAAAAGAG ATGCATGCCA AATAATTTTC 82917 .......... .......... .......... .......... .......... .......... 287 AGACTCCTAG AAAGAGAAAG GGATGCACAA GAGAAAGAGT GGGTGTAGAG AAATGGTGGT 82977 .......... .......... .......... .......... .......... .......... 287 TTTTGAAACT ATTTGTTACA TCATAAGCTA AAATCTTGAA GTATGATGTT AAGCACAGAT 83037 .......... .......... .......... .......... .......... .......... 287 TCTAATTTCC TCGAAGGATC ATTAAGCCAA ACAGTGTAAG AAGTGCAAGC AGTCGGGAAA 83097 .......... .......... .......... .......... .......... .......... 287 ATATTCCTCG TATAATATCT CCAAACAGTG TTAGGAGTGG AAGCTTAAAT GTATTGCCAA 83157 .......... .......... .......... .......... .......... .......... 287 TTAGAAACAC CCTGAAATGA TGCTAAAAGA AGAAAGCTTA TAGTATGTGT GACACTATTT 83217 .......... .......... .......... .......... .......... .......... 287 ATGGTATTCC ATTTGCAGCA CGGAAGGAAA ACTGATCTTA GAAGATGGAG TCTCTGAAGT 83277 || |||||||||| |||||||||| |||||||||| |||||||||| .......... ........CA CGGAAGGAAA ACTGATCTTA GAAGATGGAG TCTCTGAAGT 329 TGCTAAGAGC TTGTTAGCAG CCTACGACAG TGGTGAGCTC TGTGGTGCAC TTGCAGAAGG 83337 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TGCTAAGAGC TTGTTAGCAG CCTACGACAG TGGTGAGCTC TGTGGTGCAC TTGCAGAAGG 389 CCAACCTGGA TGGAGAAACT GGGTGAAGAA GTTCGGTAAA TTGCTGAAGC GCAAGGTTCG 83397 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ||||| CCAACCTGGA TGGAGAAACT GGGTGAAGAA GTTCGGTAAA TTGCTGAAGC GCAAG..... 444 ATCTGAGTAT TTTCTTTTTC GCTGAAAGTT TTTTTTTCAG TATTTATTGA GGTTGCTTTA 83457 .......... .......... .......... .......... .......... .......... 444 TGTACCAGGG AAAATCTCTC TTCATGCC 83485 || |||||||||| |||||||| ........GG AAAATCTCTC TTCATGCC 464 hqPGS_C01HBa0088L02.1+_SGN-E271199+ (78838 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83485) ******************************************************************************** EST sequence 185 -strand 634 n (File: SGN-E392545-) 1 ATGGTCAGCA TTTGAGATCA CTTCCATCTG AAGAGTTGAA CCAAATCATT GGTGAAAGGT 61 GGAAGGATGC AGACATCGTT ACAGAATCAC AAGGAGTTTT TGTACAGGAT GCTGTTCTAC 121 TCCTCAAAGA TGGGATTGAC TTGATACCAG ATTCAGAGAA AGCACTTTCA AGTTTGCTAT 181 CTTATCCTTT ATATGAAACT TTGACAAGCA CGGAAGGAAA ACTGATCTTA GAAGATGGAG 241 TCTCTGAAGT TGCTAAGAGC TTGTTAGCAG CCTACGACAG TGGTGAGCTC TGTGGTGCAC 301 TTGCAGAAGG CCAACCTGGA TGGAGAAACT GGGTGAAGAA GTTCGGTAAA TTGCTGAAGC 361 GCAAGGGAAA ATCTCTCTTC ATGCCCCTTC GGGTGTTGCT AACAGGAAAG CTTCATGGAC 421 CTGATATTGG GGCCACCACA GTATTACTCT ATAAAGCTGG AACATCTGGT TCTGTAGCAC 481 CCCAAGCTGG GTTTGTTACA TTTGATGAAA GATTTAAGAT ATTGAGAGAA GTTCAATGGG 541 AGTCGTTCAG CTCAAATGTG CCTTTGTCTG CTGGTGTTGT AACGCATTGA GATTGTGGCG 601 ATATTCTGTT TTGATTATCC ATTAAAAAAA AAAA Predicted gene structure (within gDNA segment 78931 to 84424): Exon 1 79541 79647 ( 107 n); cDNA 1 107 ( 107 n); score: 1.000 Intron 1 79648 79876 ( 229 n); Pd: 0.999 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 2 79877 79977 ( 101 n); cDNA 108 208 ( 101 n); score: 1.000 Intron 2 79978 83235 (3258 n); Pd: 0.542 (s: 1.00), Pa: 0.999 (s: 1.00) Exon 3 83236 83392 ( 157 n); cDNA 209 365 ( 157 n); score: 1.000 Intron 3 83393 83465 ( 73 n); Pd: 0.989 (s: 1.00), Pa: 0.988 (s: 1.00) Exon 4 83466 83724 ( 259 n); cDNA 366 624 ( 259 n); score: 1.000 PPA cDNA 625 634 MATCH C01HBa0088L02.1+ SGN-E392545- 1.000 624 0.984 C PGS_C01HBa0088L02.1+_SGN-E392545- (79541 79647,79877 79977,83236 83392,83466 83724) Alignment (genomic DNA sequence = upper lines): ATGGTCAGCA TTTGAGATCA CTTCCATCTG AAGAGTTGAA CCAAATCATT GGTGAAAGGT 79600 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATGGTCAGCA TTTGAGATCA CTTCCATCTG AAGAGTTGAA CCAAATCATT GGTGAAAGGT 60 GGAAGGATGC AGACATCGTT ACAGAATCAC AAGGAGTTTT TGTACAGGTA GAAATTTTCC 79660 |||||||||| |||||||||| |||||||||| |||||||||| ||||||| GGAAGGATGC AGACATCGTT ACAGAATCAC AAGGAGTTTT TGTACAG... .......... 107 CCTCTCTTTC ATTTCTCAAC CACATTGTTA CTACAAGATT TTTCTTAATC ATCTTTGTGG 79720 .......... .......... .......... .......... .......... .......... 107 AGATCTAACA ACGAGATTTT GGAGGATTTT TCTTAATAAT CTTTCCCGAA TGGCTGTTGC 79780 .......... .......... .......... .......... .......... .......... 107 ATAGATGCTT GTCATTAAAT ATCAATTCAA AAAATTGTTG CTCAATGTAC TTTGGAGTTA 79840 .......... .......... .......... .......... .......... .......... 107 TGGTTCTTAT ACCTGTTAAA TTTTCTGTAT ATATAGGATG CTGTTCTACT CCTCAAAGAT 79900 |||| |||||||||| |||||||||| .......... .......... .......... ......GATG CTGTTCTACT CCTCAAAGAT 131 GGGATTGACT TGATACCAGA TTCAGAGAAA GCACTTTCAA GTTTGCTATC TTATCCTTTA 79960 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGGATTGACT TGATACCAGA TTCAGAGAAA GCACTTTCAA GTTTGCTATC TTATCCTTTA 191 TATGAAACTT TGACAAGGTG ATCCATGAAA TTATGTTTTA AAACTATACC TATGTGACGC 80020 |||||||||| ||||||| TATGAAACTT TGACAAG... .......... .......... .......... .......... 208 TAAAAGATGA AAACATGGAG GTTTCAATTT GGTCCATTCA TTAAGGCGGG AATGAGAATA 80080 .......... .......... .......... .......... .......... .......... 208 TTTGTTGATT AATGAGTTCA ATTTTGTTAT AAATAAAGGT AACTAATTAT ATCCCATTTA 80140 .......... .......... .......... .......... .......... .......... 208 CTCCATTACC AAGTGAACAC AAAAGACGAG TTCCACAACA AACATTGGTT CTTTGTAAAG 80200 .......... .......... .......... .......... .......... .......... 208 GCAACCAATT GTCTATGGAA AAGGGTCGTA TTTGCCCCTC TACTATCAAA AAATAAGCTA 80260 .......... .......... .......... .......... .......... .......... 208 TATTTACCCT CCGTTATACC TTTTCAACAA ATATCCTCCT ATAGTCATAA TATAGAGCTA 80320 .......... .......... .......... .......... .......... .......... 208 TGTTTCTCAC CCGTGAAAAC TTCACTTTCA GCTTTTAAAA GCCATGTGTT ATTCTCTTAT 80380 .......... .......... .......... .......... .......... .......... 208 TGAACCAAAT AATCAGCCTC ACTTTTGCCC GCACCCAAAT CACTCTCATT TCTCTCTATC 80440 .......... .......... .......... .......... .......... .......... 208 CGGAAGGTGT ACTTGAGCCT GCAAAATCAA TAGTTGGTCC AAAGCTCCCT AATCTTTCTT 80500 .......... .......... .......... .......... .......... .......... 208 CTCCCCAATT CCATCATCTC ATTCTTATGC AACAAAACCA AGTCTTATTA GTTATAATTT 80560 .......... .......... .......... .......... .......... .......... 208 ACTTAATAAG TACAAGGTAT AATTTAAAAA ATTGTTCCTA TTTATTAAAT GCTTTTTGAG 80620 .......... .......... .......... .......... .......... .......... 208 AATTGAGTAG TACTAAAAAG AACTACTTTA ATGTTAAGGG TGTGGTGATA ACAATTGTCA 80680 .......... .......... .......... .......... .......... .......... 208 ACTTTAATCT TGAATTCCTA AAGCGACAAT TATTTTGAGC TAAAATGATA GCAGAAAATG 80740 .......... .......... .......... .......... .......... .......... 208 ATGAATAACT ATATTTGTTG TGAGGCGGGT GATATCTATG TTGAACTTTG TATTTTTTTG 80800 .......... .......... .......... .......... .......... .......... 208 TAAATTAAAT AAAAAAGGTT ATATTAAAAA TAGAGAAATT AAATCTCATG TAATGTTCTG 80860 .......... .......... .......... .......... .......... .......... 208 TTATATAATT ACCATTTGGG CAGGATTTAA AATAGAATAT AGTGGATTGC TTTACTTTTA 80920 .......... .......... .......... .......... .......... .......... 208 ATTCTGGATT TTGTCCAAAA AGCATGGTAG TTTTAACATT ACTAGTTTTT TTCAAAAAGC 80980 .......... .......... .......... .......... .......... .......... 208 ATGCCATTTT CCCAGAAAGA AAATTAATTT CTGGTAACAA TTTTTTCCAT TTTCAATGTT 81040 .......... .......... .......... .......... .......... .......... 208 CTATTATAAA TCAATTTACA TTTTAGAGTG AGGGGTAAAT ATAGCCTGGT GTTTAATAGT 81100 .......... .......... .......... .......... .......... .......... 208 GAACTCTATA AAAATGAGGC TGATTTTTCT TTCAATAAGA GCATGCCATG TGACTGTCTA 81160 .......... .......... .......... .......... .......... .......... 208 AAGCTGAAAA TGAAGTTTTA ACGGGTGGGG TAAATATAGC TAGTTTGAAC GGGTGAAGGG 81220 .......... .......... .......... .......... .......... .......... 208 TAAATATAAC TAGTTTTAAC AGGCAGGGGT AAAATTGTAG GGGTGTATAT TCATTGAAAG 81280 .......... .......... .......... .......... .......... .......... 208 TGTAGAATAT AGGGCAAATA TAGCTTATTT TTAATAGTAA AGGGGCAATT ATCCTTTTCT 81340 .......... .......... .......... .......... .......... .......... 208 GAATTAACTA TTCCATCTGG AGCATCATTT ATCATGCAGC TGTAATTAAA ATGTTCTCTA 81400 .......... .......... .......... .......... .......... .......... 208 GCTGAAACAA TATAGCGAGC ATTGAATATT AACAGGAGGT GGAAAGCTAA TTCAACACTT 81460 .......... .......... .......... .......... .......... .......... 208 TGCTCTTGCA TATCAGCAAC TGTTATAAGC CAAATAATTT TATATAAGTG GGAAAAAAAT 81520 .......... .......... .......... .......... .......... .......... 208 CTTGTATGCA AGCAATGCAT AAAAAGCTAA AGAACCTACA TTGAATATGC CTTTTCTAGA 81580 .......... .......... .......... .......... .......... .......... 208 GTTCATTTTT TTTATCAATT AAAAAAAATA GTTCTCTAGA GAAGATACAA ATCTCCCATA 81640 .......... .......... .......... .......... .......... .......... 208 CAAACAGGGA CCTCATGGGT GCTTGAAAAA TTAACGACGA ACAATAGACC ATTCCTTAAA 81700 .......... .......... .......... .......... .......... .......... 208 TGTGCATAAT CTATCTCCTC AAAACCCTTT TTGTTCTTCT CTCCACAGGA CCCACATGAA 81760 .......... .......... .......... .......... .......... .......... 208 AGCAAAGGGG TAACATTCCG TGCATTATGC TGCCATGAGA ATTATGGCAT CATTTAATTT 81820 .......... .......... .......... .......... .......... .......... 208 AACCCAAGCC AATTCAATAC CACTCAAAAT CTTGTTGATA TACACCATTT TTCTCTTTTG 81880 .......... .......... .......... .......... .......... .......... 208 TTTTCAATTT TTTGTCACCG TCCTTGCTGC CCATTAAAAA TAGCACATTT CTGGGTACTT 81940 .......... .......... .......... .......... .......... .......... 208 TGGGTAAGTG GAGAAAGTCC AACTCGTCCT TCAATATAAG CCTGTGATAG TATCACTTGA 82000 .......... .......... .......... .......... .......... .......... 208 CTGAGAACAC TCCCTCTCTC TTCACTCTTT ACCTCTATAA GTCCTTGCTA GCATGTGTTG 82060 .......... .......... .......... .......... .......... .......... 208 TGTTCTATTA GAGTATATCA AGCAAACTTA AATTCAACAA TCTTCCAGTC TTGTAAATTC 82120 .......... .......... .......... .......... .......... .......... 208 TTTCCTGTCC CAGGAGGATA GCCTCGAATG CCATCTCTGC CTATTTGCCC CAGCCTTTTC 82180 .......... .......... .......... .......... .......... .......... 208 ATTTCCATAA TGTACAACAT AAGAGATAAC AAGTTTCCTT GTTACAGATC CCTCAAGCTA 82240 .......... .......... .......... .......... .......... .......... 208 CCAAAAAATC TGCATGTGTT CGACTTACTA GGATCCAGTA CTTGACCATG AGATGTAAAC 82300 .......... .......... .......... .......... .......... .......... 208 TTGATCCACT TCCTCAACTT ATTCCAAATC CTATATTCGT TATGATAAAA TGCAGCAACT 82360 .......... .......... .......... .......... .......... .......... 208 TTTAATTCAC ATGGTTGTAA CTTCCAGAGG GCCAATTTGC ATAAGATTCC TCTCCCTTCT 82420 .......... .......... .......... .......... .......... .......... 208 TTTCTTGTTG GGTCGGCAAC TTTTTTTGCC ACCAAAACCA TGTCTAGAAT CTCTCCTCCT 82480 .......... .......... .......... .......... .......... .......... 208 TTCATGAACT CTTTCGGGGA GACGATGTCT TGTCTAACAC CTTTGTAATT TATAAGGTCT 82540 .......... .......... .......... .......... .......... .......... 208 TAGTCATTGA TATTCACTAA TCCCGCTGGA GGCAAAAGCA CTAGGTGCCT GGTGGTATCT 82600 .......... .......... .......... .......... .......... .......... 208 TCCCTCCACC TATGCTGATG GGAGGTAGAA GGTACCCCGT GAAATTAGTC GAGGTGCGTG 82660 .......... .......... .......... .......... .......... .......... 208 CAGCTGGCCC TGATACCACA ATTATAAAAA AGTACTTAAT ATTCAATTAC TCATTGCCTA 82720 .......... .......... .......... .......... .......... .......... 208 ATCAGCGAAA TCACAATAAA ATATGTGTCA AAGGCTTGTC TCAAACTTCC TAATTTCTTG 82780 .......... .......... .......... .......... .......... .......... 208 AAATGCAACT GTACTCCATC ACCGCCCCTT GATCTGCTCC AGCATTGTTG AAAGAAAGTT 82840 .......... .......... .......... .......... .......... .......... 208 AACATGAAAT TGTCCAAACT AGGGGCCTTG TATACTACAA GTCTCCAGGG AAAAGAGATG 82900 .......... .......... .......... .......... .......... .......... 208 CATGCCAAAT AATTTTCAGA CTCCTAGAAA GAGAAAGGGA TGCACAAGAG AAAGAGTGGG 82960 .......... .......... .......... .......... .......... .......... 208 TGTAGAGAAA TGGTGGTTTT TGAAACTATT TGTTACATCA TAAGCTAAAA TCTTGAAGTA 83020 .......... .......... .......... .......... .......... .......... 208 TGATGTTAAG CACAGATTCT AATTTCCTCG AAGGATCATT AAGCCAAACA GTGTAAGAAG 83080 .......... .......... .......... .......... .......... .......... 208 TGCAAGCAGT CGGGAAAATA TTCCTCGTAT AATATCTCCA AACAGTGTTA GGAGTGGAAG 83140 .......... .......... .......... .......... .......... .......... 208 CTTAAATGTA TTGCCAATTA GAAACACCCT GAAATGATGC TAAAAGAAGA AAGCTTATAG 83200 .......... .......... .......... .......... .......... .......... 208 TATGTGTGAC ACTATTTATG GTATTCCATT TGCAGCACGG AAGGAAAACT GATCTTAGAA 83260 ||||| |||||||||| |||||||||| .......... .......... .......... .....CACGG AAGGAAAACT GATCTTAGAA 233 GATGGAGTCT CTGAAGTTGC TAAGAGCTTG TTAGCAGCCT ACGACAGTGG TGAGCTCTGT 83320 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GATGGAGTCT CTGAAGTTGC TAAGAGCTTG TTAGCAGCCT ACGACAGTGG TGAGCTCTGT 293 GGTGCACTTG CAGAAGGCCA ACCTGGATGG AGAAACTGGG TGAAGAAGTT CGGTAAATTG 83380 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGTGCACTTG CAGAAGGCCA ACCTGGATGG AGAAACTGGG TGAAGAAGTT CGGTAAATTG 353 CTGAAGCGCA AGGTTCGATC TGAGTATTTT CTTTTTCGCT GAAAGTTTTT TTTTCAGTAT 83440 |||||||||| || CTGAAGCGCA AG........ .......... .......... .......... .......... 365 TTATTGAGGT TGCTTTATGT ACCAGGGAAA ATCTCTCTTC ATGCCCCTTC GGGTGTTGCT 83500 ||||| |||||||||| |||||||||| |||||||||| .......... .......... .....GGAAA ATCTCTCTTC ATGCCCCTTC GGGTGTTGCT 400 AACAGGAAAG CTTCATGGAC CTGATATTGG GGCCACCACA GTATTACTCT ATAAAGCTGG 83560 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AACAGGAAAG CTTCATGGAC CTGATATTGG GGCCACCACA GTATTACTCT ATAAAGCTGG 460 AACATCTGGT TCTGTAGCAC CCCAAGCTGG GTTTGTTACA TTTGATGAAA GATTTAAGAT 83620 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AACATCTGGT TCTGTAGCAC CCCAAGCTGG GTTTGTTACA TTTGATGAAA GATTTAAGAT 520 ATTGAGAGAA GTTCAATGGG AGTCGTTCAG CTCAAATGTG CCTTTGTCTG CTGGTGTTGT 83680 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| ATTGAGAGAA GTTCAATGGG AGTCGTTCAG CTCAAATGTG CCTTTGTCTG CTGGTGTTGT 580 AACGCATTGA GATTGTGGCG ATATTCTGTT TTGATTATCC ATTA 83724 |||||||||| |||||||||| |||||||||| |||||||||| |||| AACGCATTGA GATTGTGGCG ATATTCTGTT TTGATTATCC ATTA 624 hqPGS_C01HBa0088L02.1+_SGN-E392545- (79541 79647,79877 79977,83236 83392,83466 83724) ******************************************************************************** EST sequence 113 +strand 360 n (File: SGN-E249493+) 1 GCTTCATGGA CCTGATATTG GGGCCACCAC AGTATTACTC TATAAAGCTG GAACATCTGG 61 TTCTGTAGCA CCCCAAGCTG GGTTTGTTAC ATTTGATGAA AGATTTAAGA TATTGAGAGA 121 AGTTCAATGG GAGTCGTTCA GCTCAAATGT GCCTTTGTCT GCTGGTGTTG TAACGCATTG 181 AGATTGTGGC GATATTCTGT TTTGATTATC CATTATATGA CTTCTATCTC CACCATTCCC 241 AGTAGAAACA AAGAGAAGCT GCGAGCACAA GGGGGGTTTT CTTGTGTTTG CATCTCGTCT 301 GGAATCAAAG AGGGCTACCA TCTCTAGCGG GATTCCTTTT CTGTATCTTC CCCCTCCCCC Predicted gene structure (within gDNA segment 82910 to 84479): Exon 1 83510 83869 ( 360 n); cDNA 1 360 ( 360 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E249493+ 1.000 360 1.000 C PGS_C01HBa0088L02.1+_SGN-E249493+ (83510 83869) Alignment (genomic DNA sequence = upper lines): GCTTCATGGA CCTGATATTG GGGCCACCAC AGTATTACTC TATAAAGCTG GAACATCTGG 83569 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GCTTCATGGA CCTGATATTG GGGCCACCAC AGTATTACTC TATAAAGCTG GAACATCTGG 60 TTCTGTAGCA CCCCAAGCTG GGTTTGTTAC ATTTGATGAA AGATTTAAGA TATTGAGAGA 83629 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTCTGTAGCA CCCCAAGCTG GGTTTGTTAC ATTTGATGAA AGATTTAAGA TATTGAGAGA 120 AGTTCAATGG GAGTCGTTCA GCTCAAATGT GCCTTTGTCT GCTGGTGTTG TAACGCATTG 83689 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTTCAATGG GAGTCGTTCA GCTCAAATGT GCCTTTGTCT GCTGGTGTTG TAACGCATTG 180 AGATTGTGGC GATATTCTGT TTTGATTATC CATTATATGA CTTCTATCTC CACCATTCCC 83749 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGATTGTGGC GATATTCTGT TTTGATTATC CATTATATGA CTTCTATCTC CACCATTCCC 240 AGTAGAAACA AAGAGAAGCT GCGAGCACAA GGGGGGTTTT CTTGTGTTTG CATCTCGTCT 83809 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AGTAGAAACA AAGAGAAGCT GCGAGCACAA GGGGGGTTTT CTTGTGTTTG CATCTCGTCT 300 GGAATCAAAG AGGGCTACCA TCTCTAGCGG GATTCCTTTT CTGTATCTTC CCCCTCCCCC 83869 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GGAATCAAAG AGGGCTACCA TCTCTAGCGG GATTCCTTTT CTGTATCTTC CCCCTCCCCC 360 hqPGS_C01HBa0088L02.1+_SGN-E249493+ (83510 83869) ******************************************************************************** EST sequence 147 +strand 623 n (File: SGN-E327243+) 1 GGAAGTGCCA GGACCTCCTA AATTAACTTA AGCCAACTAC CCTTATGCAA AGGCAGTTAA 61 GGATAGTAAA TGGCAATTAG AGACTAAAAA AGAGCAGATA TTACGAACAA TGCTAGCATT 121 ATTGTAGTCC AGACACATGT TGAAGACCAA AAGAATGGGC TTCTAGAAAG ATGCCTAGTA 181 GGTCATCTGG AAGGACAGAT GAAGGAAAAG CCAACTTTGC CTGAGATAAG AAGATGGTCA 241 TCAACACTCT GGAAAAAGGC ATTTGGAGTT AACATCTATG AAATGTATGG AGGTATGGAA 301 CTGGAAGAAT CACAGATTCA ATTGTGAATG GTGGAATCCG ATGGTAGGTT GTCTCCCCAA 361 TAATACTCGG ACGATGGAAA CATGGATAAG AATTGTTGGA ATCCCCCTTC ATTTATGGTC 421 GGAGAGAGTA TTTCAAGAAA TTGAAAACTT ATGTGGAGGT TGGGTGGCCA CAGAGGAGGA 481 AACAAAACTA AGAAATCATA TGAATTGGGC AAGAATTCTG GTTGCCAATG ATGGAAGAAA 541 CATTCCCAAA GAAGTTTCAA TCTCCAGAAA TGGAGTAATA TTCCACTTTT CGATATGGGT 601 TGAGTGCCAA GTAAGAGTAG AAT Predicted gene structure (within gDNA segment 97071 to 91609): Exon 1 96471 96177 ( 295 n); cDNA 1 292 ( 292 n); score: 0.902 Intron 1 96176 96123 ( 54 n); Pd: 0.926 (s: 0.92), Pa: 0.000 (s: 0.84) Exon 2 96122 96015 ( 108 n); cDNA 293 399 ( 107 n); score: 0.852 Intron 2 96014 94105 (1910 n); Pd: 0.000 (s: 0.86), Pa: 0.071 (s: 0.83) Exon 3 94104 94027 ( 78 n); cDNA 400 478 ( 79 n); score: 0.853 Intron 3 94026 92986 (1041 n); Pd: 0.000 (s: 0.92), Pa: 0.888 (s: 0) Exon 4 92985 92968 ( 18 n); cDNA 479 496 ( 18 n); score: 0.611 MATCH C01HBa0088L02.1- SGN-E327243+ 0.883 499 0.801 C PGS_C01HBa0088L02.1-_SGN-E327243+ (96471 96177,96122 96015,94104 94027,92985 92968) Alignment (genomic DNA sequence = upper lines): GGAAGTGCCA GGACCTCCTA GAATAACCAA AGCCAACTAC CCTTATGCAA AAGCAGTTAA 96412 |||||||||| |||||||||| | |||| | |||||||||| |||||||||| | |||||||| GGAAGTGCCA GGACCTCCTA AATTAACTTA AGCCAACTAC CCTTATGCAA AGGCAGTTAA 60 GGATAGTAAA TGGCAATCAG AAACTATAAA GGAGGCAGAG ATTACGAACA ATGTTAGCAT 96352 |||||||||| ||||||| || | |||| ||| || ||||| |||||||||| ||| |||||| GGATAGTAAA TGGCAATTAG AGACTAAAAA AGA-GCAGAT ATTACGAACA ATGCTAGCAT 119 TATTTAAGTC CTCACACACA GGTTGAAGAC CAAGAGAATG GGCTTCCAGA GAGATGCCTA 96292 |||| ||| | || ||||| ||||||||| ||| |||||| |||||| ||| ||||||||| TATTGTAGT- C-CAGACACA TGTTGAAGAC CAAAAGAATG GGCTTCTAGA AAGATGCCTA 177 GTAGGTCATT TGGAAGGACA GATGAAGGAA AAGCCAACTT TGCTTGAGAT ATGAAGATGG 96232 ||||||||| |||||||||| |||||||||| |||||||||| ||| |||||| | |||||||| GTAGGTCATC TGGAAGGACA GATGAAGGAA AAGCCAACTT TGCCTGAGAT AAGAAGATGG 237 TCGTCAACAC TTCGGAAAAA GGCATTTGGA GTTAACATCA ATGAAATGCA TGGAGGTACG 96172 || ||||||| | ||||||| |||||||||| ||||||||| |||||||| | ||||| TCATCAACAC TCTGGAAAAA GGCATTTGGA GTTAACATCT ATGAAATGTA TGGAG..... 292 TTTCTGTTCG AGTTCCTAAC ATAAACATGG CAGAACAGAC CCTCCAAGGG CAGTGGAACT 96112 | | ||||||| .......... .......... .......... .......... .........G TA-TGGAACT 302 GGAAGAATCA CGGATTCAAT CTAGAATGGT GGAATTCAAT GGTGGGTTGT CTCCCCAATA 96052 |||||||||| | |||||||| ||||||| ||||| | || ||| |||||| |||||||||| GGAAGAATCA CAGATTCAAT TGTGAATGGT GGAATCCGAT GGTAGGTTGT CTCCCCAATA 362 ATACTCTGAA CAAGGACACA TGGATTAGAA CTGTTGGACT ATGTCACCCC TCGAGCCTAC 95992 |||||| || | ||| ||| ||||| |||| |||||| ATACTCGGAC GATGGAAACA TGGATAAGAA TTGTTGG... .......... .......... 399 ACCTTGGACG TGGCAGGCAC TCGAGAACCA TTGTTGGCCC CAAGCGAACC CTTGGTCTGG 95932 .......... .......... .......... .......... .......... .......... 399 CTTACTTAAT CAGCAGAGGA CTCTAAGCAT TATTACAATG ACCAAATGCA CTTTACTCAG 95872 .......... .......... .......... .......... .......... .......... 399 CTGCTTAATA AAATATCTTA GAATGTTTAA AAGTCGACAT TCAACTTGGC CCAATTGTAA 95812 .......... .......... .......... .......... .......... .......... 399 AGACAACTAA ACTACTAAAC GCGAGCCTTT AAAATAAAGA GGAATGTAGG GACACGACCC 95752 .......... .......... .......... .......... .......... .......... 399 CCGATCAATG AAATACTGAA AGCAAAATAA AAGGGGCCCT CCGGAATACA AGGAGGCTCA 95692 .......... .......... .......... .......... .......... .......... 399 CAACTGACAG AGTGCTCAAC TAGATCAACG AGGCGCTAGG TGCTGATTCA AGTTACCTAT 95632 .......... .......... .......... .......... .......... .......... 399 GTATGCATCA TAAGACGATG CAGGCCAACT GATATCAATC AGTACATTAA ATGTACGAGT 95572 .......... .......... .......... .......... .......... .......... 399 ATGCGAGTTG AAATGCTAAA CATAACATAT GCTTGAAAAA AATCTGAAAG GAACACTTAC 95512 .......... .......... .......... .......... .......... .......... 399 CTTAGCTTTA CTCAAATCCT AAATAACTTA ACTCAATATA AAACAATAAA ACATATGCAA 95452 .......... .......... .......... .......... .......... .......... 399 TATATAGAAA GCTTGTAAAA ATAGTGGACA CAACTAACTT AGTTCGTTAA AAAAATGCAA 95392 .......... .......... .......... .......... .......... .......... 399 TAACAAACTC AACTTTACCT ATATAATAGT ATAATAAAGT AATATACTAC CCATGATGGC 95332 .......... .......... .......... .......... .......... .......... 399 TACATGATTT ATGGAGACTT GAGTTATCTG AACTTGCATC CCTATATCGC AGCTCAATGC 95272 .......... .......... .......... .......... .......... .......... 399 TACTCCCAAA ATGTACTTAG CTCATACATT TTTAAAACAA AACTCTTTAC TCTTTCTTTG 95212 .......... .......... .......... .......... .......... .......... 399 GTTTGAGATA ATTACTCAAA ACTTAGCTTA AAAGCTCTCT TCGAAATCGG TGTTTCCCTT 95152 .......... .......... .......... .......... .......... .......... 399 TCTTGCTCAA ATGATGAAAA CATTATAACT CTTTGGGAAT ACTTAGTTCC CTTATAACTT 95092 .......... .......... .......... .......... .......... .......... 399 TGAAGAACCC ATTTTGAAGA AATGAATTCT TACACTTACT CTTTAGTGAA CTCAAACTTA 95032 .......... .......... .......... .......... .......... .......... 399 AGTCTCAAAA CAAAGCTAAA ACCATTTGTG AAAGACTTTT GAAAACTTTT GAGGTCGAAC 94972 .......... .......... .......... .......... .......... .......... 399 GGTCTGTGAC CGCTCCGCTT CGCAAATAAC TTTTTCTCAA ATCTGAGAAG CAGGTCCGCG 94912 .......... .......... .......... .......... .......... .......... 399 ACGCGGCCCC ACTGCCCAAA TTCACCTGAC TTTTTCCTTC TTCGTTTTCA GTCCCAATTC 94852 .......... .......... .......... .......... .......... .......... 399 GCCTAAACAT GATGCCCAGC CAACGTACCC AAGAGCCTAA CTCAAAACAA CTCTAAAACT 94792 .......... .......... .......... .......... .......... .......... 399 CGACATAAAG ATCTCTGAAA ATTCTCAATT CAGCCCAATT AAAGAATGAC ATCAAATTCA 94732 .......... .......... .......... .......... .......... .......... 399 AGAATACATG TCAAGAACGT CAAACCTTCA ACCTTTTTAG AATGAATTTC CCTAAACTAA 94672 .......... .......... .......... .......... .......... .......... 399 ACAGTTTAGC GCGTGGGTGA ACGAACCCAA TGCTATGAAA GTCCCACATA CCTTGTAGGA 94612 .......... .......... .......... .......... .......... .......... 399 TTAATTCCTT GGCGAAATCC ACAATCCAAT CACACAATCT TGGCGAATCT TGAGCTTTTC 94552 .......... .......... .......... .......... .......... .......... 399 TTCTCCTTTC TCCTTTTTCT CTTTTCTCCA AGCCCTAGAG TGAAATTTCC AATTGACTAA 94492 .......... .......... .......... .......... .......... .......... 399 ATTGATCTAA TTCTGATTTG ACTCTAATTA ACTCCAAAAA AATCAAAACA AAATAATAGG 94432 .......... .......... .......... .......... .......... .......... 399 GTATGGAAAA GATCATAATA CCCTTCCAAA ATCCAAATTA GACTCTCCTT ATTTGAACAA 94372 .......... .......... .......... .......... .......... .......... 399 CCCAACTTTC AATAGGCATA ACTCACTCAT ACAAACTCAG AAATCACGCA AACTCGAAAA 94312 .......... .......... .......... .......... .......... .......... 399 CGTTGGAAAG ATTATTCCAA GATCTTTCCT ACAATATCTG GAAACACGCC TAACTCATCC 94252 .......... .......... .......... .......... .......... .......... 399 TAAGCTAGGA GTTATGGTCG TTTAAAGTTG ACCAAAAACT CAACTTATTC TAACTTAACA 94192 .......... .......... .......... .......... .......... .......... 399 AAATTTCCAA ATTTTCACTC TTTCCAAAAA CGACTATTTC CAATTATTAA CTCCTTACTA 94132 .......... .......... .......... .......... .......... .......... 399 GTTATTTCAA TTTGCGAGAT ATTACAGAAT CCCCC-CCAT CTCTGGTCAA AGAGAGTATT 94073 ||| ||||| ||| | ||||| |||||||||| .......... .......... .......AAT CCCCCTTCAT TTATGGTCGG AGAGAGTATT 432 TCAAGAAATT GGAAACTTAT GTGAAGGTTG GGTGGCCATA GAGGAAACAC ATACTAATCA 94013 |||||||||| | |||||||| ||| |||||| |||||||| | ||||| TCAAGAAATT GAAAACTTAT GTGGAGGTTG GGTGGCCACA GAGGAG.... .......... 478 CGTATGTTCT ACATCCCCCT TCCATAACAC CATATTTACC CGCTACTACC CCTCTTCATA 93953 .......... .......... .......... .......... .......... .......... 478 ATGCTTCTCC AAGACCATGA ATCTCCATAA CCATTTGCCC GAAATTGCTT AGTGGAAGAC 93893 .......... .......... .......... .......... .......... .......... 478 CTTCAAGTCG TCCCCACCGT TTAGGATACG TCACAATCTC CCACTGCACT AAGTGAAAAC 93833 .......... .......... .......... .......... .......... .......... 478 TGACACATCT TTTCCCTAGC CATCGCACCC CAAAGGAAAT TCTTTCCAAC CTTCTATCTT 93773 .......... .......... .......... .......... .......... .......... 478 ACCTATCACA CTGGTAAGAG CATTTAACAA GGACATAAAT AAGTAGGGGA TACTGAACAA 93713 .......... .......... .......... .......... .......... .......... 478 AGTGTAATTC ATCAGCATTT CCTTCCCCCT CTTTTGGACA AGTACCTTTT TTGTCAGTCT 93653 .......... .......... .......... .......... .......... .......... 478 GCCAGCCATT TCTCTACCAT CTGGATGACC AGATTTCAGA CGTTGTGACT TGATGCGCCT 93593 .......... .......... .......... .......... .......... .......... 478 GAGGAAGCCC AAGATAGGTA ATAGGTATCT TCACCAACAA TGCAACACTT GAGCCAACAA 93533 .......... .......... .......... .......... .......... .......... 478 ATCAATGTTA CCAATTTCCC CAAATCAATA CGATCTCACA CTATTCTGAG GTTGATTTTT 93473 .......... .......... .......... .......... .......... .......... 478 AGTCCTAATA CCACCTAGAA TCAAGTCAAA ACTTGTCCAA TGTAGTTCAA CTAGATCCCA 93413 .......... .......... .......... .......... .......... .......... 478 TCTGCATCAC ATAACACCAA AGTATCTTTT GTAAATAAAA AATGTGCATC CAATACAGAA 93353 .......... .......... .......... .......... .......... .......... 478 TTGTCACCAC CAACTGTGGC CTTGAAACCC TAGATATGTC TGCCTAAACC AATTTTATCC 93293 .......... .......... .......... .......... .......... .......... 478 ATTATTCTGC TCAAAGCCTC TGTCACCAAA ATAAAGAGCA TAGGTGATAA AGGATCTCCC 93233 .......... .......... .......... .......... .......... .......... 478 TGCCTCGATC CCCTCAAACA ACCAAAGAAA CCACATGGAT TTCTATTCAC CAAAATTGAG 93173 .......... .......... .......... .......... .......... .......... 478 TATCTCACCG AAGAGATGCA ATAATTGATT CTTTTCTCCA TTTCTCCACA GTCAAAACTA 93113 .......... .......... .......... .......... .......... .......... 478 ATTTGATGGA TACTATTGTT GAATTCCAAG ATAGTAGTGC AATCCCCTCC TTTTTGGACT 93053 .......... .......... .......... .......... .......... .......... 478 CTAAGGAAAC TATTCTTTAT TTTTTCCAAT TTCCATCATT TCCTTTAATA TTTTCTTGAA 92993 .......... .......... .......... .......... .......... .......... 478 ATAATAGGAT AAAAATGATA GCAAT 92968 || | ||| | | ||| .......GAA ACAAAACTAA GAAAT 496 hqPGS_C01HBa0088L02.1-_SGN-E327243+ (96471 96177,96122 96015,94104 94027) ******************************************************************************** EST sequence 169 +strand 627 n (File: SGN-E212227+) 1 GCATCTAAGC GAGCATTTAT TGCTTCGTGC CTCGCTATAT TGGCTGCACG TTATTCTTGA 61 AATAAGTTCA CCAATTGTGC CAGTTGATGT TGAATTTGAT CTCCTTTAAC ACCCATCTCT 121 GATACCAAGT TGTTATAGTC CCCTGATATG GATCTGGTTA TGGGGCACTG TAGTGTGAAA 181 TCGAATGTTT TGGCGCTGGT TCGTTAGAGA AAACCTGCAA TTTCTTGAGT TTGAAGTACT 241 CAAAGACTTA GTAATTTTCT GCTTCCATTT CCTAAGATAC AGATAGTTTA AATACAACAC 301 TTATAAAATA ACTACCCCCT AGAAACTCGG ACATGACTGA CTACCTAACT TGAACTGGAA 361 TATAAACTGC ACTATTACAT GAAAATAAAT GTACTATTAC AGAAAAGTAA CTTCTACTAA 421 AAAGAAATTA CTTTGTAACT TGTAACTAAT GGATAACTAA GGAGTGATAA CATTGGACTT 481 GTAGAAGCCT TTTGGGAGTT GAAGAGGAAA GGGAAGTCAT AGTCCCGGTA CAGTAAAATA 541 TGGACAAGAT ACCTCTAAAT GGTGTTCTAT TTTTGTGAAT TTAGTGATTT AACATGTAGT 601 TTTTTCATAT TTCAAATGTT GCCTCAT Predicted gene structure (within gDNA segment 105900 to 99591): Exon 1 104993 104540 ( 454 n); cDNA 1 440 ( 440 n); score: 0.792 Intron 1 104539 103835 ( 705 n); Pd: 0.000 (s: 0.76), Pa: 0.985 (s: 0) Exon 2 103834 103823 ( 12 n); cDNA 441 451 ( 11 n); score: 0.750 MATCH C01HBa0088L02.1- SGN-E212227+ 0.792 466 0.743 C PGS_C01HBa0088L02.1-_SGN-E212227+ (104993 104540,103834 103823) Alignment (genomic DNA sequence = upper lines): GCATCTAAGC -AGCATTTAT TGCTTCCTGT CTCACTATAT TGGCTGCACG TTATCCTTGA 104935 |||||||||| ||||||||| |||||| || ||| |||||| |||||||||| |||| ||||| GCATCTAAGC GAGCATTTAT TGCTTCGTGC CTCGCTATAT TGGCTGCACG TTATTCTTGA 60 AATAAGTTCA CCAATTGTGC CAGTTGATGT TGAATTAGAT CTTCCATTAC ATTCGTCTCT 104875 |||||||||| |||||||||| |||||||||| |||||| ||| || | | || | | ||||| AATAAGTTCA CCAATTGTGC CAGTTGATGT TGAATTTGAT CTCCTTTAAC ACCCATCTCT 120 GATACCAAGT TGTTATGGTC CCCAGTTATG GATCTGGTTA TGGGACACTG TAATATTAAA 104815 |||||||||| |||||| ||| ||| | |||| |||||||||| |||| ||||| || | | ||| GATACCAAGT TGTTATAGTC CCCTGATATG GATCTGGTTA TGGGGCACTG TAGTGTGAAA 180 TCTGATGTTT TCTTCCTACG ATCTATGGTG CTGGTTCGTT AAGAGAGAAC CTGCGATCTC 104755 || || | | | | | || | |||||||||| ||||| ||| |||| || || TC-GA----A T-GT--T--- -T-T--GGCG CTGGTTCGTT -AGAGAAAAC CTGCAATTTC 224 ATGAGTTTGA AGCACTCAAA GGCTTGAATA ATTTTCTGCT TATATTTTCT TAGTCACCAG 104695 ||||||||| || ||||||| | ||| | || |||||||||| | |||| || || | ||| TTGAGTTTGA AGTACTCAAA GACTT-AGTA ATTTTCTGCT TCCATTTCCT AAGATA-CAG 282 ATAGTTTAAA TACAATACTT ATAAAATAAC -AACCCCTAG AAACTAGGAC ATGACT---T 104639 |||||||||| ||||| |||| |||||||||| | ||||||| ||||| |||| |||||| | ATAGTTTAAA TACAACACTT ATAAAATAAC TACCCCCTAG AAACTCGGAC ATGACTGACT 342 -CCTAACTT- AACTAGAAAG AAAGACTGCA CTATTACAGA AAAATAACTG CATTTTTTAC 104581 |||||||| |||| | || | | |||||| |||||||| ||||||| || | | |||| ACCTAACTTG AACT-GGAAT ATAAACTGCA CTATTACATG AAAATAAATG TA-CTATTAC 400 AGGAAAATAA CTGCTACTAG AGAGAAATTA CTGCAATAAC TATTGAATAA CGAAAGAGTG 104521 || ||| ||| || |||||| | |||||||| || |||| | AGAAAAGTAA CTTCTACTAA AAAGAAATTA CT-TTGTAAC T......... .......... 440 ATAACACCAT CCTATAAGAT TCCGTAAGTA ACTATTGACT CCAAAACTCC CAAATTGATT 104461 .......... .......... .......... .......... .......... .......... 440 TTAAATGTCA CTTATTCCTT CATATAACAT TTGACTATAT TACCTTCCAT TTTATCTTAT 104401 .......... .......... .......... .......... .......... .......... 440 GATTCTGCCA AGTGAAAACT CACATCAGAA AACAACCTAC ACAACTTAAA GCAATATATA 104341 .......... .......... .......... .......... .......... .......... 440 TATATATATA TATATATATA TATAAATCCT AAAAAGCCAA CAAAAGCCAA CCCTGTTTTA 104281 .......... .......... .......... .......... .......... .......... 440 TATGTGCTAA GAAGCTACCT CCTGGCATTT TCCTTCCGCT CTTGGCCATT TGCTGTAATT 104221 .......... .......... .......... .......... .......... .......... 440 CTGGATATCA CTAAGTGTCA GCAAACCAAT GAGAAAATTA TTTTCATCAA CTATTATAGC 104161 .......... .......... .......... .......... .......... .......... 440 ACAAGATTGC TTCTCAGCTA GCATGAGAGA TATGGTTTCC ATTAGCAAGG TGCTCATTAG 104101 .......... .......... .......... .......... .......... .......... 440 GACTGTCACA TATCGCGTTC TCATTGCCTG TGCAACTAGA ACTTTCCTAG CGAAATCATT 104041 .......... .......... .......... .......... .......... .......... 440 TTCTTCATCA TCAGATTCAT AAAGACAGAG TGAACTCTCA AGTTTGCAGA GGTTACTCTC 103981 .......... .......... .......... .......... .......... .......... 440 TTTTTGTGAA GGTTCCACAC CTGAAGAATA AGTTAAGCTA GGAAGTTCAA TGTTGGAGGA 103921 .......... .......... .......... .......... .......... .......... 440 AGAAGTTCCT TGCCACTGCG TCATCTGGGC TCTTGAACCT TTTAATTTCT TCCTATCCTG 103861 .......... .......... .......... .......... .......... .......... 440 TACCACCCCT TTGCTTGTTT GTCCAGATGT AACCCATG 103823 ||| ||| ||| .......... .......... ......-TGT AACTAATG 451 hqPGS_C01HBa0088L02.1-_SGN-E212227+ (104993 104540) ******************************************************************************** EST sequence 84 +strand 584 n (File: SGN-E236171+) 1 TTGAGTCAGT TACCTGTTAT ACTAAGGCAC GTGGAGGATG AAGGCATACA TCCTGTGGGC 61 ATTTTGGACA GAGAGTGCAT CAATGTAGCT TGCAGAGCAT TAGCAACTCG AGAACAGCTT 121 AGCTGGTTCT CCACGAAGTA AAGGCTAATT GAAGGTTGCA TAACCCGTTT GCAATAAGTT 181 CTTCCTTGTC AAAGCATGCT GAGGGTTATT GTCTCTGAGT AATCCATCCT CGCTCTGTCT 241 TACAACAGGG TTGAACAATT CAATGGTAAA TAATGAGAAT GATGTTAGCA CAGGCAGAGG 301 AGACCGTACA ACCAGGTAGC AGGATTTACT GCTGAAGCTG AAGGTTTGTT CTAGCTGCTT 361 CTTAAATTAG GCACTGGAGG AGCGCACTGC GTAACTACAC TGACTCGTCA TCCAATTCCA 421 ATCATTCACT TCCGTGGTAT GGAACTTGAA CAGGATTGAG TTACACATGT CAAAATTAAG 481 TCTACTCTGC TGTCATTGCC TGAATAATAT TTCTTCATGC TGCTTTTGTC AACTGTTAAT 541 GACTTTTCAA ACAACCCCAT TCTCCACCAT TGTTTCCCGA ACTG Predicted gene structure (within gDNA segment 107970 to 112750): Exon 1 108660 108754 ( 95 n); cDNA 1 95 ( 95 n); score: 0.989 Intron 1 108755 111563 (2809 n); Pd: 0.987 (s: 1.00), Pa: 0.977 (s: 1.00) Exon 2 111564 111726 ( 163 n); cDNA 96 258 ( 163 n); score: 1.000 Intron 2 111727 111814 ( 88 n); Pd: 0.975 (s: 1.00), Pa: 0.994 (s: 1.00) Exon 3 111815 112140 ( 326 n); cDNA 259 584 ( 326 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E236171+ 0.998 584 1.000 C PGS_C01HBa0088L02.1+_SGN-E236171+ (108660 108754,111564 111726,111815 112140) Alignment (genomic DNA sequence = upper lines): TTGAGTCAGC TACCTGTTAT ACTAAGGCAC GTGGAGGATG AAGGCATACA TCCTGTGGGC 108719 ||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGAGTCAGT TACCTGTTAT ACTAAGGCAC GTGGAGGATG AAGGCATACA TCCTGTGGGC 60 ATTTTGGACA GAGAGTGCAT CAATGTAGCT TGCAGGTTCT TGATATTCAA CTTTTCTTCA 108779 |||||||||| |||||||||| |||||||||| ||||| ATTTTGGACA GAGAGTGCAT CAATGTAGCT TGCAG..... .......... .......... 95 AAATATAATG CTTTCTGGAA CCATTGACGA TAAAATATGC AAGAAATTTG TGCAGTAGTC 108839 .......... .......... .......... .......... .......... .......... 95 ACACTTTACT ATTGATGATA AAATATGCAA GAAAACTTGT GCAGAAGTCA CACTTTACCA 108899 .......... .......... .......... .......... .......... .......... 95 TTGAATAAAC TTTGCAAGAA ACTTGTGCAT AAGTCACACT TTACGATTGA TTACCAGATA 108959 .......... .......... .......... .......... .......... .......... 95 ATCTATAATT AAGATGTCAA AAGTATTTGA CAAAATTATC TCTTATATGC AAGTCCAAGA 109019 .......... .......... .......... .......... .......... .......... 95 AGCGAACATA CCTTTAACAC ACTTTGACCG GACACTAAGA AGAAAATCGC TAAAGTAGGG 109079 .......... .......... .......... .......... .......... .......... 95 GTGAGAATTG GTTTGATAGG TAAATCACCT TTTATGCTTT AAAAGAGATG TGAATTTGAA 109139 .......... .......... .......... .......... .......... .......... 95 GTCTTAAAGC TTGTGATAGT CATAAAAAAT ATTTATATTC TAAGTATGTC AAGCAGTCCA 109199 .......... .......... .......... .......... .......... .......... 95 TGCAAAAGTA GAAAATAACT TCACTTGTAC TATAAAGAAA GGAAAACCTG TCATACTAGT 109259 .......... .......... .......... .......... .......... .......... 95 TTGGGGTGGG TGGTGGTAGC ATTCCACTCA GGTTTTTCAT TTAGTTTTTC AATTAATGCA 109319 .......... .......... .......... .......... .......... .......... 95 GGCAAAGCAG ACGAAAGCCT TGATTAGAAC TTAATTATCA GCAAACCTTA GTGGCTCTTG 109379 .......... .......... .......... .......... .......... .......... 95 AAATAGAACA TGAAGCCTTA AGCAAATATC ATTGACAATG AGATGTTGAC TTTTTAGGCA 109439 .......... .......... .......... .......... .......... .......... 95 GTGGTATTTT GTTCGGCTTT TCAAGGACTA AGAAGAACTT AATATGATTA ATTTTCTCCA 109499 .......... .......... .......... .......... .......... .......... 95 TTCCATCCTC TCTCTCTTGT ATCATGATAT CAGAGCCAAT AAGAGTTTGG TAAGCCCTAA 109559 .......... .......... .......... .......... .......... .......... 95 TTAGCTTTTT TCGCTTGTCT ACTTATTTTT TTTATTTTTT TTTTGTGTTT TGTGTCCTTT 109619 .......... .......... .......... .......... .......... .......... 95 TAATATTCCA TAACTTTTGA TTGACTGTTC TGGAGGGCAC CACTTCACTA TTCTTATCAT 109679 .......... .......... .......... .......... .......... .......... 95 TTTTGCTGCA GTGTTACACC GCTATTATGG CCCATGTTTG TTCCACACCT TTTTTAAATT 109739 .......... .......... .......... .......... .......... .......... 95 TCAGCCAGCT CCTTTTGTTT CGCCTTACAA AATCTTCTGG CTAACTCAAA ACTAGTCCTC 109799 .......... .......... .......... .......... .......... .......... 95 CTTTTCCGAT CGTAACTTGT TCTCTATTTT CTCTTGATTT TGTTCTATTA ACTCTATAGT 109859 .......... .......... .......... .......... .......... .......... 95 TGACTACCAT CAAAGGTATA GGATCTAATC AAGTAGATCT CATTAGTATG TTAGTTTCTG 109919 .......... .......... .......... .......... .......... .......... 95 AGACTCCATT CAGTATTGAA GGTCTGTAAT CTGGTCGAGC AAACTCTTAA CAGATAGAGC 109979 .......... .......... .......... .......... .......... .......... 95 AAGCGAAGTT ATGGCCCCTA CTGTGTATCA AAGGTTTGCA ATCTGGTCAA GTAAAATTAT 110039 .......... .......... .......... .......... .......... .......... 95 TTACCAAGTG CCTGCAATCC TGTCTGTTTG CTGTCTATGT GATGCTTGAA TGTGCCACCT 110099 .......... .......... .......... .......... .......... .......... 95 CGGCAAGAGG AATAAAGAAA CACACTTTGG TTTGCAGTCT TTATCTGTTT AGACACAACA 110159 .......... .......... .......... .......... .......... .......... 95 ACAAACCATG TGTAATCCCA CAAGTGGGGT CTAGGGAGGA TAGAATGTAA GCAGCCCTTA 110219 .......... .......... .......... .......... .......... .......... 95 TCTATTAAGA CCCTCCATTG AAACAATTAA GAGCAAACAG AAAGTGGATC CCCTTTTATA 110279 .......... .......... .......... .......... .......... .......... 95 AGGAGAAAAG CCTTCAGTAG AGCCATTAAT GAGAATGGGA AACCTGACCT TGCAAAAACA 110339 .......... .......... .......... .......... .......... .......... 95 ATGAGAGGTT CATTTAATCC ATTTCCTCCA AAAAATCATA TCCCTTAGAA CTTCAATGAG 110399 .......... .......... .......... .......... .......... .......... 95 AAAATTCCAT TTAACATTGT CTTGTGCTTT TCCAATATCC AGTTTACATA AAATTCTGTG 110459 .......... .......... .......... .......... .......... .......... 95 TTTGTCCCCC ACTCTAGTAT CCACAGATTC TTTGGTAATC AAGTATGCAT TCATTATCTG 110519 .......... .......... .......... .......... .......... .......... 95 TCTTTCTCTA ATAAATGTCA TATGGTGCTT GTCAACTAGC TCGTCCACCA CCTTTTTGAG 110579 .......... .......... .......... .......... .......... .......... 95 TCTGTCAGTC AATAGCTTGG AGATAATCTT GTATACACAC CCTATCAGAC TAATAGGTCT 110639 .......... .......... .......... .......... .......... .......... 95 GAAGTCTCAA CTCCTTGGCT ACATTATTTT TAGGAATCAA CGCCACATAT GCTGCATTTC 110699 .......... .......... .......... .......... .......... .......... 95 AGGCTTTTTT AAACTGTTCC TGGGTGTGGT TTTCCACTGT CTTCATATTT TACTCTTTCA 110759 .......... .......... .......... .......... .......... .......... 95 GAACATCCAA ACATGAACGA AAGAAATCTG TTGTATACCT GGTGCTTTGT TAATTGCACA 110819 .......... .......... .......... .......... .......... .......... 95 TATTTTACAT CTTGCTCCTT AAAGGTCATT TGATACCATG CCGCTGCCTC CTCTGTAATT 110879 .......... .......... .......... .......... .......... .......... 95 CTAGGACAGT TCTGCAGTTA ATCCGAGGCT CCAAGCTTCT GCATACAAGT TCTGATAAAA 110939 .......... .......... .......... .......... .......... .......... 95 AGAAAGGATT TCTCTCTCCT AATATTCATA GGATCAGTTT CTATTTCTCC ATTTGATCTC 110999 .......... .......... .......... .......... .......... .......... 95 CAGATTGTCA ATAATATTGG ACCTCTTGAA TAAGACTTTG ATCCTAACTC AACCTCAAAA 111059 .......... .......... .......... .......... .......... .......... 95 GTTAGCTAAT GACTAATGAG GTTAGATTGC CTAAGATTAC GGATGGCAGA ATGGGTAATT 111119 .......... .......... .......... .......... .......... .......... 95 TATATCGGTA TCCCATAAAA ATTACCCATC TTAAATGAGT TGGAACTCAT TTAAAATGGG 111179 .......... .......... .......... .......... .......... .......... 95 TAAGAAACCG GTCAAACTCA TATTATCCAT TTAAAAGTGG GTAGTTTAAT GTGTAAAATG 111239 .......... .......... .......... .......... .......... .......... 95 GGTTTAAAAA AAGATTTATT TATAAAAGAG AGAAAAATGA CATCAATATT TTTTTTGAGG 111299 .......... .......... .......... .......... .......... .......... 95 TGTAGGTGAT CGGGGTAGGA GGTACGGATG GGTGGGATAA AGGAAGAAAA TTAAATTTGA 111359 .......... .......... .......... .......... .......... .......... 95 TGATAGATTA TGGAAGTTAT GGGCTAAAGA CTGTGGAAGG AGACAACCAT GCAGATTCTC 111419 .......... .......... .......... .......... .......... .......... 95 AACCACTATG ACACACTTCA TCTTTGAGTG ATTTCTTGAT GTTATTGAAA TGTCTCTAGA 111479 .......... .......... .......... .......... .......... .......... 95 AATATTGCCT CTCTTCTGAA AAAGCACGTG TTCCATTTGA AATTCCCCTT AACATTTTCC 111539 .......... .......... .......... .......... .......... .......... 95 ATATTTTCTT TCTTTGGGGA ACAGAGCATT AGCAACTCGA GAACAGCTTA GCTGGTTCTC 111599 |||||| |||||||||| |||||||||| |||||||||| .......... .......... ....AGCATT AGCAACTCGA GAACAGCTTA GCTGGTTCTC 131 CACGAAGTAA AGGCTAATTG AAGGTTGCAT AACCCGTTTG CAATAAGTTC TTCCTTGTCA 111659 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACGAAGTAA AGGCTAATTG AAGGTTGCAT AACCCGTTTG CAATAAGTTC TTCCTTGTCA 191 AAGCATGCTG AGGGTTATTG TCTCTGAGTA ATCCATCCTC GCTCTGTCTT ACAACAGGGT 111719 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAGCATGCTG AGGGTTATTG TCTCTGAGTA ATCCATCCTC GCTCTGTCTT ACAACAGGGT 251 TGAACAAGTA AGATAAACAA TTGGATTTAC AGTGATTTAT CCAATAATTA CTGCTATGCT 111779 ||||||| TGAACAA... .......... .......... .......... .......... .......... 258 GACTTCTTGT TCAAATTTTG GACTACCATC TCCAGTTCAA TGGTAAATAA TGAGAATGAT 111839 ||||| |||||||||| |||||||||| .......... .......... .......... .....TTCAA TGGTAAATAA TGAGAATGAT 283 GTTAGCACAG GCAGAGGAGA CCGTACAACC AGGTAGCAGG ATTTACTGCT GAAGCTGAAG 111899 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTAGCACAG GCAGAGGAGA CCGTACAACC AGGTAGCAGG ATTTACTGCT GAAGCTGAAG 343 GTTTGTTCTA GCTGCTTCTT AAATTAGGCA CTGGAGGAGC GCACTGCGTA ACTACACTGA 111959 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTTGTTCTA GCTGCTTCTT AAATTAGGCA CTGGAGGAGC GCACTGCGTA ACTACACTGA 403 CTCGTCATCC AATTCCAATC ATTCACTTCC GTGGTATGGA ACTTGAACAG GATTGAGTTA 112019 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCGTCATCC AATTCCAATC ATTCACTTCC GTGGTATGGA ACTTGAACAG GATTGAGTTA 463 CACATGTCAA AATTAAGTCT ACTCTGCTGT CATTGCCTGA ATAATATTTC TTCATGCTGC 112079 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACATGTCAA AATTAAGTCT ACTCTGCTGT CATTGCCTGA ATAATATTTC TTCATGCTGC 523 TTTTGTCAAC TGTTAATGAC TTTTCAAACA ACCCCATTCT CCACCATTGT TTCCCGAACT 112139 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTTTGTCAAC TGTTAATGAC TTTTCAAACA ACCCCATTCT CCACCATTGT TTCCCGAACT 583 G 112140 | G 584 hqPGS_C01HBa0088L02.1+_SGN-E236171+ (108660 108754,111564 111726,111815 112140) ******************************************************************************** EST sequence 13 +strand 488 n (File: SGN-E228287+) 1 TTGAGTCAGC TACCTGTTAT ACTAAGGCAC GTGGAGGATG AAGGCATACA TCCTGTGGGC 61 ATTTTGGACA GAGAGTGCAT CAATGTAGCT TGCAGAGCAT TAGCAACTCG AGAACAGCTT 121 AGCTGGTTCT CCACGAAGTA AAGGCTAATT GAAGGTTGCA TAACCCGTTT GCAATAAGTT 181 CTTCCTTGTC AAAGCATGCT GAGGGTTATT GTCTCTGAGT AATCCATCCT CGCTCTGTCT 241 TACAACAGGG TTGAACAATT CAATGGTAAA TAATGAGAAT GATGTTAGCA CAGGCAGAGG 301 AGACCGTACA ACCAGGTAGC AGGATTTACT GCTGAAGCTG AAGGTTTGTT CTAGCTGCTT 361 CTTAAATTAG GCACTGGAGG AGCGCACTGC GTAACTACAC TGACTCGTCA TCCAATTCCA 421 ATCATTCACT TCCGTGGTAT GGAACTTGAA CAGGATTGAG TTACACATGT CAAAATTAAG 481 TCTACTCT Predicted gene structure (within gDNA segment 108060 to 112654): Exon 1 108660 108754 ( 95 n); cDNA 1 95 ( 95 n); score: 1.000 Intron 1 108755 111563 (2809 n); Pd: 0.987 (s: 1.00), Pa: 0.977 (s: 1.00) Exon 2 111564 111726 ( 163 n); cDNA 96 258 ( 163 n); score: 1.000 Intron 2 111727 111814 ( 88 n); Pd: 0.975 (s: 1.00), Pa: 0.994 (s: 1.00) Exon 3 111815 112044 ( 230 n); cDNA 259 488 ( 230 n); score: 1.000 MATCH C01HBa0088L02.1+ SGN-E228287+ 1.000 488 1.000 C PGS_C01HBa0088L02.1+_SGN-E228287+ (108660 108754,111564 111726,111815 112044) Alignment (genomic DNA sequence = upper lines): TTGAGTCAGC TACCTGTTAT ACTAAGGCAC GTGGAGGATG AAGGCATACA TCCTGTGGGC 108719 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| TTGAGTCAGC TACCTGTTAT ACTAAGGCAC GTGGAGGATG AAGGCATACA TCCTGTGGGC 60 ATTTTGGACA GAGAGTGCAT CAATGTAGCT TGCAGGTTCT TGATATTCAA CTTTTCTTCA 108779 |||||||||| |||||||||| |||||||||| ||||| ATTTTGGACA GAGAGTGCAT CAATGTAGCT TGCAG..... .......... .......... 95 AAATATAATG CTTTCTGGAA CCATTGACGA TAAAATATGC AAGAAATTTG TGCAGTAGTC 108839 .......... .......... .......... .......... .......... .......... 95 ACACTTTACT ATTGATGATA AAATATGCAA GAAAACTTGT GCAGAAGTCA CACTTTACCA 108899 .......... .......... .......... .......... .......... .......... 95 TTGAATAAAC TTTGCAAGAA ACTTGTGCAT AAGTCACACT TTACGATTGA TTACCAGATA 108959 .......... .......... .......... .......... .......... .......... 95 ATCTATAATT AAGATGTCAA AAGTATTTGA CAAAATTATC TCTTATATGC AAGTCCAAGA 109019 .......... .......... .......... .......... .......... .......... 95 AGCGAACATA CCTTTAACAC ACTTTGACCG GACACTAAGA AGAAAATCGC TAAAGTAGGG 109079 .......... .......... .......... .......... .......... .......... 95 GTGAGAATTG GTTTGATAGG TAAATCACCT TTTATGCTTT AAAAGAGATG TGAATTTGAA 109139 .......... .......... .......... .......... .......... .......... 95 GTCTTAAAGC TTGTGATAGT CATAAAAAAT ATTTATATTC TAAGTATGTC AAGCAGTCCA 109199 .......... .......... .......... .......... .......... .......... 95 TGCAAAAGTA GAAAATAACT TCACTTGTAC TATAAAGAAA GGAAAACCTG TCATACTAGT 109259 .......... .......... .......... .......... .......... .......... 95 TTGGGGTGGG TGGTGGTAGC ATTCCACTCA GGTTTTTCAT TTAGTTTTTC AATTAATGCA 109319 .......... .......... .......... .......... .......... .......... 95 GGCAAAGCAG ACGAAAGCCT TGATTAGAAC TTAATTATCA GCAAACCTTA GTGGCTCTTG 109379 .......... .......... .......... .......... .......... .......... 95 AAATAGAACA TGAAGCCTTA AGCAAATATC ATTGACAATG AGATGTTGAC TTTTTAGGCA 109439 .......... .......... .......... .......... .......... .......... 95 GTGGTATTTT GTTCGGCTTT TCAAGGACTA AGAAGAACTT AATATGATTA ATTTTCTCCA 109499 .......... .......... .......... .......... .......... .......... 95 TTCCATCCTC TCTCTCTTGT ATCATGATAT CAGAGCCAAT AAGAGTTTGG TAAGCCCTAA 109559 .......... .......... .......... .......... .......... .......... 95 TTAGCTTTTT TCGCTTGTCT ACTTATTTTT TTTATTTTTT TTTTGTGTTT TGTGTCCTTT 109619 .......... .......... .......... .......... .......... .......... 95 TAATATTCCA TAACTTTTGA TTGACTGTTC TGGAGGGCAC CACTTCACTA TTCTTATCAT 109679 .......... .......... .......... .......... .......... .......... 95 TTTTGCTGCA GTGTTACACC GCTATTATGG CCCATGTTTG TTCCACACCT TTTTTAAATT 109739 .......... .......... .......... .......... .......... .......... 95 TCAGCCAGCT CCTTTTGTTT CGCCTTACAA AATCTTCTGG CTAACTCAAA ACTAGTCCTC 109799 .......... .......... .......... .......... .......... .......... 95 CTTTTCCGAT CGTAACTTGT TCTCTATTTT CTCTTGATTT TGTTCTATTA ACTCTATAGT 109859 .......... .......... .......... .......... .......... .......... 95 TGACTACCAT CAAAGGTATA GGATCTAATC AAGTAGATCT CATTAGTATG TTAGTTTCTG 109919 .......... .......... .......... .......... .......... .......... 95 AGACTCCATT CAGTATTGAA GGTCTGTAAT CTGGTCGAGC AAACTCTTAA CAGATAGAGC 109979 .......... .......... .......... .......... .......... .......... 95 AAGCGAAGTT ATGGCCCCTA CTGTGTATCA AAGGTTTGCA ATCTGGTCAA GTAAAATTAT 110039 .......... .......... .......... .......... .......... .......... 95 TTACCAAGTG CCTGCAATCC TGTCTGTTTG CTGTCTATGT GATGCTTGAA TGTGCCACCT 110099 .......... .......... .......... .......... .......... .......... 95 CGGCAAGAGG AATAAAGAAA CACACTTTGG TTTGCAGTCT TTATCTGTTT AGACACAACA 110159 .......... .......... .......... .......... .......... .......... 95 ACAAACCATG TGTAATCCCA CAAGTGGGGT CTAGGGAGGA TAGAATGTAA GCAGCCCTTA 110219 .......... .......... .......... .......... .......... .......... 95 TCTATTAAGA CCCTCCATTG AAACAATTAA GAGCAAACAG AAAGTGGATC CCCTTTTATA 110279 .......... .......... .......... .......... .......... .......... 95 AGGAGAAAAG CCTTCAGTAG AGCCATTAAT GAGAATGGGA AACCTGACCT TGCAAAAACA 110339 .......... .......... .......... .......... .......... .......... 95 ATGAGAGGTT CATTTAATCC ATTTCCTCCA AAAAATCATA TCCCTTAGAA CTTCAATGAG 110399 .......... .......... .......... .......... .......... .......... 95 AAAATTCCAT TTAACATTGT CTTGTGCTTT TCCAATATCC AGTTTACATA AAATTCTGTG 110459 .......... .......... .......... .......... .......... .......... 95 TTTGTCCCCC ACTCTAGTAT CCACAGATTC TTTGGTAATC AAGTATGCAT TCATTATCTG 110519 .......... .......... .......... .......... .......... .......... 95 TCTTTCTCTA ATAAATGTCA TATGGTGCTT GTCAACTAGC TCGTCCACCA CCTTTTTGAG 110579 .......... .......... .......... .......... .......... .......... 95 TCTGTCAGTC AATAGCTTGG AGATAATCTT GTATACACAC CCTATCAGAC TAATAGGTCT 110639 .......... .......... .......... .......... .......... .......... 95 GAAGTCTCAA CTCCTTGGCT ACATTATTTT TAGGAATCAA CGCCACATAT GCTGCATTTC 110699 .......... .......... .......... .......... .......... .......... 95 AGGCTTTTTT AAACTGTTCC TGGGTGTGGT TTTCCACTGT CTTCATATTT TACTCTTTCA 110759 .......... .......... .......... .......... .......... .......... 95 GAACATCCAA ACATGAACGA AAGAAATCTG TTGTATACCT GGTGCTTTGT TAATTGCACA 110819 .......... .......... .......... .......... .......... .......... 95 TATTTTACAT CTTGCTCCTT AAAGGTCATT TGATACCATG CCGCTGCCTC CTCTGTAATT 110879 .......... .......... .......... .......... .......... .......... 95 CTAGGACAGT TCTGCAGTTA ATCCGAGGCT CCAAGCTTCT GCATACAAGT TCTGATAAAA 110939 .......... .......... .......... .......... .......... .......... 95 AGAAAGGATT TCTCTCTCCT AATATTCATA GGATCAGTTT CTATTTCTCC ATTTGATCTC 110999 .......... .......... .......... .......... .......... .......... 95 CAGATTGTCA ATAATATTGG ACCTCTTGAA TAAGACTTTG ATCCTAACTC AACCTCAAAA 111059 .......... .......... .......... .......... .......... .......... 95 GTTAGCTAAT GACTAATGAG GTTAGATTGC CTAAGATTAC GGATGGCAGA ATGGGTAATT 111119 .......... .......... .......... .......... .......... .......... 95 TATATCGGTA TCCCATAAAA ATTACCCATC TTAAATGAGT TGGAACTCAT TTAAAATGGG 111179 .......... .......... .......... .......... .......... .......... 95 TAAGAAACCG GTCAAACTCA TATTATCCAT TTAAAAGTGG GTAGTTTAAT GTGTAAAATG 111239 .......... .......... .......... .......... .......... .......... 95 GGTTTAAAAA AAGATTTATT TATAAAAGAG AGAAAAATGA CATCAATATT TTTTTTGAGG 111299 .......... .......... .......... .......... .......... .......... 95 TGTAGGTGAT CGGGGTAGGA GGTACGGATG GGTGGGATAA AGGAAGAAAA TTAAATTTGA 111359 .......... .......... .......... .......... .......... .......... 95 TGATAGATTA TGGAAGTTAT GGGCTAAAGA CTGTGGAAGG AGACAACCAT GCAGATTCTC 111419 .......... .......... .......... .......... .......... .......... 95 AACCACTATG ACACACTTCA TCTTTGAGTG ATTTCTTGAT GTTATTGAAA TGTCTCTAGA 111479 .......... .......... .......... .......... .......... .......... 95 AATATTGCCT CTCTTCTGAA AAAGCACGTG TTCCATTTGA AATTCCCCTT AACATTTTCC 111539 .......... .......... .......... .......... .......... .......... 95 ATATTTTCTT TCTTTGGGGA ACAGAGCATT AGCAACTCGA GAACAGCTTA GCTGGTTCTC 111599 |||||| |||||||||| |||||||||| |||||||||| .......... .......... ....AGCATT AGCAACTCGA GAACAGCTTA GCTGGTTCTC 131 CACGAAGTAA AGGCTAATTG AAGGTTGCAT AACCCGTTTG CAATAAGTTC TTCCTTGTCA 111659 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CACGAAGTAA AGGCTAATTG AAGGTTGCAT AACCCGTTTG CAATAAGTTC TTCCTTGTCA 191 AAGCATGCTG AGGGTTATTG TCTCTGAGTA ATCCATCCTC GCTCTGTCTT ACAACAGGGT 111719 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| AAGCATGCTG AGGGTTATTG TCTCTGAGTA ATCCATCCTC GCTCTGTCTT ACAACAGGGT 251 TGAACAAGTA AGATAAACAA TTGGATTTAC AGTGATTTAT CCAATAATTA CTGCTATGCT 111779 ||||||| TGAACAA... .......... .......... .......... .......... .......... 258 GACTTCTTGT TCAAATTTTG GACTACCATC TCCAGTTCAA TGGTAAATAA TGAGAATGAT 111839 ||||| |||||||||| |||||||||| .......... .......... .......... .....TTCAA TGGTAAATAA TGAGAATGAT 283 GTTAGCACAG GCAGAGGAGA CCGTACAACC AGGTAGCAGG ATTTACTGCT GAAGCTGAAG 111899 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTAGCACAG GCAGAGGAGA CCGTACAACC AGGTAGCAGG ATTTACTGCT GAAGCTGAAG 343 GTTTGTTCTA GCTGCTTCTT AAATTAGGCA CTGGAGGAGC GCACTGCGTA ACTACACTGA 111959 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| GTTTGTTCTA GCTGCTTCTT AAATTAGGCA CTGGAGGAGC GCACTGCGTA ACTACACTGA 403 CTCGTCATCC AATTCCAATC ATTCACTTCC GTGGTATGGA ACTTGAACAG GATTGAGTTA 112019 |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| |||||||||| CTCGTCATCC AATTCCAATC ATTCACTTCC GTGGTATGGA ACTTGAACAG GATTGAGTTA 463 CACATGTCAA AATTAAGTCT ACTCT 112044 |||||||||| |||||||||| ||||| CACATGTCAA AATTAAGTCT ACTCT 488 hqPGS_C01HBa0088L02.1+_SGN-E228287+ (108660 108754,111564 111726,111815 112044) Total number of EST alignments reported: 269 ________________________________________________________________________________ Predicted gene locations (14) in segment 1 to 120525: PGL 1 (- strand): 25160 7571 AGS-1 (13008 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7571) SCR (e 1.000 d 0.999 a 0.995,e 1.000 d 0.987 a 0.967,e 1.000 d 0.893 a 0.951,e 1.000 d 0.996 a 0.999,e 1.000 d 0.939 a 0.594,e 1.000 d 0.972 a 0.000,e 1.000 d 0.998 a 0.989,e 1.000 d 0.937 a 0.997,e 1.000 d 0.999 a 0.736,e 1.000 d 0.996 a 0.999,e 1.000 d 0.984 a 0.942,e 1.000) Exon 1 13008 12866 ( 143 n); score: 1.000 Intron 1 12865 11756 (1110 n); Pd: 0.999 Pa: 0.995 Exon 2 11755 11705 ( 51 n); score: 1.000 Intron 2 11704 11340 ( 365 n); Pd: 0.987 Pa: 0.967 Exon 3 11339 11252 ( 88 n); score: 1.000 Intron 3 11251 10099 (1153 n); Pd: 0.893 Pa: 0.951 Exon 4 10098 10036 ( 63 n); score: 1.000 Intron 4 10035 9731 ( 305 n); Pd: 0.996 Pa: 0.999 Exon 5 9730 9696 ( 35 n); score: 1.000 Intron 5 9695 9592 ( 104 n); Pd: 0.939 Pa: 0.594 Exon 6 9591 9515 ( 77 n); score: 1.000 Intron 6 9514 9424 ( 91 n); Pd: 0.972 Pa: 0.000 Exon 7 9423 9378 ( 46 n); score: 1.000 Intron 7 9377 9287 ( 91 n); Pd: 0.998 Pa: 0.989 Exon 8 9286 9224 ( 63 n); score: 1.000 Intron 8 9223 8461 ( 763 n); Pd: 0.937 Pa: 0.997 Exon 9 8460 8394 ( 67 n); score: 1.000 Intron 9 8393 8291 ( 103 n); Pd: 0.999 Pa: 0.736 Exon 10 8290 8222 ( 69 n); score: 1.000 Intron 10 8221 8140 ( 82 n); Pd: 0.996 Pa: 0.999 Exon 11 8139 8070 ( 70 n); score: 1.000 Intron 11 8069 7633 ( 437 n); Pd: 0.984 Pa: 0.942 Exon 12 7632 7571 ( 62 n); score: 1.000 PGS (9730 9696,9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7571) SGN-E235556+ PGS (9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7571) SGN-E245638+ PGS (9532 9515,9423 9378,9286 9224,8460 8399) SGN-E256505+ PGS (13007 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8400) SGN-E297108+ PGS (13007 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8436) SGN-E312220+ PGS (13008 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224) SGN-E553993+ 3-phase translation of AGS-1 (-strand): . . . . . . 13008 CTTGATCCTATGTGAGGCAACACTCGGAACTGAGAAACCCTTAGAATTCAATTTCGCATT L D P M - G N T R N - E T L R I Q F R I L I L C E A T L G T E K P L E F N F A F - S Y V R Q H S E L R N P - N S I S H . . . . . . 12948 TGGCAGAGATGAGAGGAAACAAGTTTTGCTTTGATTTACGGTACCTTCTCGTCGTGGCTG W Q R - E E T S F A L I Y G T F S S W L G R D E R K Q V L L - F T V P S R R G C L A E M R G N K F C F D L R Y L L V V A . . . : . . . 12888 CTCTCGCCTTCATCTACATACAG : ATGCGGCTTTTCGTGACACAGTCAGAATATGCAGACC L S P S S T Y R : C G F S - H S Q N M Q T S R L H L H T : D A A F R D T V R I C R P A L A F I Y I Q : M R L F V T Q S E Y A D . . : . . . . 11718 GCCTTGCTGCTGCG : ATTGAAGCAGAAAATCATTGTACAAGTCAGACTAGGTTGCTTATTG A L L L R : L K Q K I I V Q V R L G C L L P C C C : D - S R K S L Y K S D - V A Y - R L A A A : I E A E N H C T S Q T R L L I . . . . . : . 11293 ACAAGATTAGCCAGCAGCAAGGAAGAGTAGTGGCTCTTGAAG : AACAAATGAAGCGCCAGG T R L A S S K E E - W L L K : N K - S A R Q D - P A A R K S S G S - R : T N E A P G D K I S Q Q Q G R V V A L E : E Q M K R Q . . . . . : . 10080 ACCAGGAGTGCCGACAATTAAGGGCTCTTGTTCAGGATCTTGAAA : GTAAGGGCATAAAAA T R S A D N - G L L F R I L K : V R A - K P G V P T I K G S C S G S - K : - G H K K D Q E C R Q L R A L V Q D L E : S K G I K . . : . . . . 9715 AGTTAATCGGAAATGTGCAG : ATGCCAGTGGCAGCTGTAGTTGTTATGGCTTGCAGTCGTT S - S E M C R : C Q W Q L - L L W L A V V V N R K C A : D A S G S C S C Y G L Q S F K L I G N V Q : M P V A A V V V M A C S R . . . . : . . 9551 CTGACTACCTGGAGAAGACTATAAAATCCATCTTAAA : ATACCAAACATCTGTTGCATCAA L T T W R R L - N P S - : N T K H L L H Q - L P G E D Y K I H L K : I P N I C C I K S D Y L E K T I K S I L K : Y Q T S V A S . . . : . . . 9400 AATATCCTCTTTTCATATCCCAG : GATGGATCGAATCCTGATGTTAGAAAGCTTGCTTTGA N I L F S Y P R : M D R I L M L E S L L - I S S F H I P : G W I E S - C - K A C F E K Y P L F I S Q : D G S N P D V R K L A L . . . : . . . 9249 GCTATGATCAACTGACGTATATGCAG : CACTTGGATTTTGAACCTGTGCATACTGAAAGAC A M I N - R I C S : T W I L N L C I L K D L - S T D V Y A : A L G F - T C A Y - K T S Y D Q L T Y M Q : H L D F E P V H T E R . . . . : . . 8426 CAGGGGAACTGGTTGCATACTACAAGATTGCAC : GTCATTACAAGTGGGCATTGGATCAGC Q G N W L H T T R L H : V I T S G H W I S R G T G C I L Q D C T : S L Q V G I G S A P G E L V A Y Y K I A : R H Y K W A L D Q . . . . . : . 8263 TGTTTCACAAGCATAATTTTAGCCGTGTTATCATACTAGAAG : ATGATATGGAAATTGCGG C F T S I I L A V L S Y - K : M I W K L R V S Q A - F - P C Y H T R R : - Y G N C G L F H K H N F S R V I I L E : D D M E I A . . . . . . : 8121 CTGATTTTTTTGACTACTTTGAGGCTGGAGCTACTCTTCTTGACAGAGACAA : GTCGATTA L I F L T T L R L E L L F L T E T : S R L - F F - L L - G W S Y S S - Q R Q : V D Y A D F F D Y F E A G A T L L D R D K : S I . . . . . . 7624 TGGCTATTTCATCTTGGAATGACAATGGACAAAGGCAGTTCGTCCAAGATCCTT W L F H L G M T M D K G S S S K I L G Y F I L E - Q W T K A V R P R S M A I S S W N D N G Q R Q F V Q D P Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-1_PPS_1 (12964 12866,11755 11705,11339 11252,10098 10036,9730 9696,9591 9515,9423 9378,9286 9224,8460 8394,8290 8222,8139 8070,7632 7572) (frame '0'; 789 bp, 263 residues) 1 NSISHLAEMR GNKFCFDLRY LLVVAALAFI YIQMRLFVTQ SEYADRLAAA IEAENHCTSQ 61 TRLLIDKISQ QQGRVVALEE QMKRQDQECR QLRALVQDLE SKGIKKLIGN VQMPVAAVVV 121 MACSRSDYLE KTIKSILKYQ TSVASKYPLF ISQDGSNPDV RKLALSYDQL TYMQHLDFEP 181 VHTERPGELV AYYKIARHYK WALDQLFHKH NFSRVIILED DMEIAADFFD YFEAGATLLD 241 RDKSIMAISS WNDNGQRQFV QDP AGS-2 (18462 17469,17422 16316,15004 14954,13699 13678,10944 10912) SCR (e 0.859 d 0.657 a 0.000,e 0.768 d 0.000 a 0.000,e 0.647 d 0.000 a 0.934,e 0.682 d 0.000 a 0.000,e 0.727) Exon 1 18462 17469 ( 994 n); score: 0.859 Intron 1 17468 17423 ( 46 n); Pd: 0.657 Pa: 0.000 Exon 2 17422 16316 (1107 n); score: 0.768 Intron 2 16315 15005 (1311 n); Pd: 0.000 Pa: 0.000 Exon 3 15004 14954 ( 51 n); score: 0.647 Intron 3 14953 13700 (1254 n); Pd: 0.000 Pa: 0.934 Exon 4 13699 13678 ( 22 n); score: 0.682 Intron 4 13677 10945 (2733 n); Pd: 0.000 Pa: 0.000 Exon 5 10944 10912 ( 33 n); score: 0.727 PGS (16425 16316,15004 14954,13699 13678,10944 10912) SGN-E275667- PGS (16856 16304) SGN-E389553- PGS (16856 16311) SGN-E396039+ PGS (16856 16311) SGN-E550127- PGS (16851 16313) SGN-E374999+ PGS (16851 16315) SGN-E231589+ PGS (16856 16318) SGN-E389834+ PGS (16519 16318) SGN-E252199- PGS (16851 16328) SGN-E241959+ PGS (16444 16329) SGN-E356257+ PGS (17001 16363) SGN-E349296- PGS (16809 16500) SGN-E356257- PGS (16742 16513) SGN-E396037+ PGS (17114 16623) SGN-E546548- PGS (17181 16832) SGN-E578076- PGS (17444 16912) SGN-E347579- PGS (17444 16923) SGN-E349726- PGS (17320 16923) SGN-E357559- PGS (17899 17469,17422 17182) SGN-E241789+ PGS (17758 17523) SGN-E209683- PGS (18400 17683) SGN-E351546- PGS (18325 17683) SGN-E356696- PGS (18250 17683) SGN-E356206- PGS (18155 17754) SGN-E370357+ PGS (18001 17754) SGN-E222578+ PGS (18155 17762) SGN-E542084+ PGS (18462 17765) SGN-E392027+ PGS (18027 17776) SGN-E373117- PGS (18027 17776) SGN-E373116+ PGS (18001 17794) SGN-E216150+ PGS (18027 17815) SGN-E298638- PGS (18027 17842) SGN-E352844- PGS (18462 18173) SGN-E355114- 3-phase translation of AGS-2 (-strand): . . . . . . 18462 ACAACCCCAGTGGCTGGCTCAGACGCACCCTGTCCTGCCGGTGCTGGTGTTGGTGTTGGC T T P V A G S D A P C P A G A G V G V G Q P Q W L A Q T H P V L P V L V L V L A N P S G W L R R T L S C R C W C W C W . . . . . . 18402 GTAGTTGTTGCTCTATTTCTAACCATCTGCGAAAGAGAGTGAAGATGGTCAGATACCAAT V V V A L F L T I C E R E - R W S D T N - L L L Y F - P S A K E S E D G Q I P I R S C C S I S N H L R K R V K M V R Y Q . . . . . . 18342 TTGTATCACCTAGATACCAATTGGATTCAAGTAGTAGCACAAAAGAAAGAATGAAAGAAT L Y H L D T N W I Q V V A Q K K E - K N C I T - I P I G F K - - H K R K N E R M F V S P R Y Q L D S S S S T K E R M K E . . . . . . 18282 GGAATTTTCCTAAAGTCTTATAGCCTCTCAAAGAAAAGTAAAGGCGTCCCCCTACCGTTC G I F L K S Y S L S K K S K G V P L P F E F S - S L I A S Q R K V K A S P Y R S W N F P K V L - P L K E K - R R P P T V . . . . . . 18222 CTTAAGACTCTACTAGACTCGTTTTTGTGTGATGAGACCAACGAACCTAATGCTCTGATA L K T L L D S F L C D E T N E P N A L I L R L Y - T R F C V M R P T N L M L - Y P - D S T R L V F V - - D Q R T - C S D . . . . . . 18162 CCAAGTTTGTCACGACCCAAATTCGGGCCGCGACTGGCACCCACATTTACCCTTCTATGT P S L S R P K F G P R L A P T F T L L C Q V C H D P N S G R D W H P H L P F Y V T K F V T T Q I R A A T G T H I Y P S M . . . . . . 18102 GAGCGAACCAACCAATCTAAACCTTAACATTTCAATATAATATCAGCAGAAAATAATGCG E R T N Q S K P - H F N I I S A E N N A S E P T N L N L N I S I - Y Q Q K I M R - A N Q P I - T L T F Q Y N I S R K - C . . . . . . 18042 GAAGACTTAAACTCGTTTATAAAAAAAACCAAATCAATAACTATTATTCCCCAAAATTTG E D L N S F I K K T K S I T I I P Q N L K T - T R L - K K P N Q - L L F P K I W G R L K L V Y K K N Q I N N Y Y S P K F . . . . . . 17982 GAAGTCATCATCACAAGAACATCTATGATCAAATTACTAACTAAAAATGCCTAAGAAGCT E V I I T R T S M I K L L T K N A - E A K S S S Q E H L - S N Y - L K M P K K L G S H H H K N I Y D Q I T N - K C L R S . . . . . . 17922 AAAAATACATAAGAAGCTAGTCCATGCCGGAAGTTCAAGGCATCAAGACTTGAAGAAGAA K N T - E A S P C R K F K A S R L E E E K I H K K L V H A G S S R H Q D L K K K - K Y I R S - S M P E V Q G I K T - R R . . . . . . 17862 GCTCCAGTCCAAGCTAGAAGCATTAGCTCACCCTGAATTTCCGATGTAGTAAGACTGGCT A P V Q A R S I S S P - I S D V V R L A L Q S K L E A L A H P E F P M - - D W L S S S P S - K H - L T L N F R C S K T G . . . . . . 17802 TGAATTACTGTTGAGTCGAAGACGACGGCACGTTTGCTACACTCCACAAATAACAAAGAA - I T V E S K T T A R L L H S T N N K E E L L L S R R R R H V C Y T P Q I T K K L N Y C - V E D D G T F A T L H K - Q R . . . . . . 17742 GAAAACATAAAAGTAGGGGTCAGTACAAAGCACGGGTACTGAGTAGATATCATCGGCCAA E N I K V G V S T K H G Y - V D I I G Q K T - K - G S V Q S T G T E - I S S A N R K H K S R G Q Y K A R V L S R Y H R P . . . . . . 17682 CTCAAAATAGAAAACAGTATATACCAAGTAATATCATAAACTCAACTATGATACTCAACA L K I E N S I Y Q V I S - T Q L - Y S T S K - K T V Y T K - Y H K L N Y D T Q H T Q N R K Q Y I P S N I I N S T M I L N . . . . . . 17622 TGTAGCAACAACAAGTACTATATCATTAACAATTTCCGTCAAGTTCACACATGAGGACTC C S N N K Y Y I I N N F R Q V H T - G L V A T T S T I S L T I S V K F T H E D S M - Q Q Q V L Y H - Q F P S S S H M R T . . . . . . 17562 AAGCCTCAATACCATACTCATTTGGGAATTATGTTCATTAGATTGAGTATATTAACATCT K P Q Y H T H L G I M F I R L S I L T S S L N T I L I W E L C S L D - V Y - H L Q A S I P Y S F G N Y V H - I E Y I N I . . . . : . . 17502 TTTAAGATTCATTATCTTTATTTCTCTTGTGTCG : GTACGTGACACTCCGATCCCCTACTA F K I H Y L Y F S C V : G T - H S D P L L L R F I I F I S L V S : V R D T P I P Y Y F - D S L S L F L L C R : Y V T L R S P T . . . . . . 17396 CTATGTGTCGAAACGTGACACTCCGATCCCCTAAATTCTACGTGTCGGTTCGTGACACCC L C V E T - H S D P L N S T C R F V T P Y V S K R D T P I P - I L R V G S - H P T M C R N V T L R S P K F Y V S V R D T . . . . . . 17336 GATCTCCTAAATCTACGTGTCGGTTCGTGACACCCGATCCCCTAATTCTACGTGTCGGTT D L L N L R V G S - H P I P - F Y V S V I S - I Y V S V R D T R S P N S T C R F R S P K S T C R F V T P D P L I L R V G . . . . . . 17276 CGTGACACCCGGTCCCCTAATTCTACGTGTCGGTTCGTAACACCCGATCCCCTAATCTCA R D T R S P N S T C R F V T P D P L I S V T P G P L I L R V G S - H P I P - S H S - H P V P - F Y V S V R N T R S P N L . . . . . . 17216 TTCTATCAATTCATCAAGCCTTCTCCCTTACCAAGGCATCATCAATCTCATTACTTTAGT F Y Q F I K P S P L P R H H Q S H Y F S S I N S S S L L P Y Q G I I N L I T L V I L S I H Q A F S L T K A S S I S L L - . . . . . . 17156 TCATCAAGCCTTATCCCTTACAAAGGCATCATCATTAAAAAGAGATTAGGTTTTTATCAA S S S L I P Y K G I I I K K R L G F Y Q H Q A L S L T K A S S L K R D - V F I K F I K P Y P L Q R H H H - K E I R F L S . . . . . . 17096 GATTTGGGATTCGATAGCTTCATCATGCTTAATATAATCACAATTATATAATCACGTTCA D L G F D S F I M L N I I T I I - S R S I W D S I A S S C L I - S Q L Y N H V H R F G I R - L H H A - Y N H N Y I I T F . . . . . . 17036 TGCAAGCATACAATTAAGCACATAGCAGGGTTTACAATACTATCAATACATATCATTCGC C K H T I K H I A G F T I L S I H I I R A S I Q L S T - Q G L Q Y Y Q Y I S F A M Q A Y N - A H S R V Y N T I N T Y H S . . . . . . 16976 TATTAAGAGTTTACTACGAATAGTATGAAAACCATAACCTACCTTCACCGAAGAATTGCG Y - E F T T N S M K T I T Y L H R R I A I K S L L R I V - K P - P T F T E E L R L L R V Y Y E - Y E N H N L P S P K N C . . . . . . 16916 ATCAACAAGCTATCTTCTCAAAATCCTTGCTATCCTCTTCGTTTCTCTCTCTCTACTCGT I N K L S S Q N P C Y P L R F S L S T R S T S Y L L K I L A I L F V S L S L L V D Q Q A I F S K S L L S S S F L S L Y S . . . . . . 16856 TCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCT S L S F S V S L C S F Y F S Y S N P L S L F L F L S L F V L S I F L I Q T L F L F S F F F C L S L F F L F F L F K P S F . . . . . . 16796 TTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAAC F T L I N I - S S V K D G N N N P L I N L P - L T Y N Q V - K M A I I T H - L T F Y P N - H I I K C K R W Q - - P T N - . . . . . . 16736 TTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTT L R L P L L T P K - L D L L T L T P - L - G Y L F - P P S N - T Y - H - P P N F L K V T S F N P Q V I R L I N I N P L T . . . . . . 16676 TATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCG Y N L S R N S Q K R P L K R I K K S D P I I - A G I V K N V P - N V - R N P T R L - F K Q E - S K T S L K T Y K E I R P . . . . . . 16616 GACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTC D W D C A T C D G P S C L R R S V L Q V T G I A Q P V M G R R A C D G P S C R S G L G L R N L - W A V V P A T V R P A G . . . . . . 16556 GTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCGTCCTGCCATT V A K F R D P N F H Q G S V T V R P A I S Q S S E T Q I S T K G L - R S V L P F R R K V Q R P K F P P R V C D G P S C H . . . . . . 16496 TCGTTACGAAGTTCAGAGAGTCGATTTCAGCACCCAATTTTTAGATTTTCTAAGTGTTTT S L R S S E S R F Q H P I F R F S K C F R Y E V Q R V D F S T Q F L D F L S V L F V T K F R E S I S A P N F - I F - V F . . . . . . 16436 GAAACGAGAACCTGCGACGGTCCGTCGTGCCCATGACGGTCCGTCGTGGGGTCCGTCGCC E T R T C D G P S C P - R S V V G S V A K R E P A T V R R A H D G P S W G P S P - N E N L R R S V V P M T V R R G V R R . . . . . . 16376 TCAGTCTGTTTTTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACAA S V C F S R N K I C C S K R L N R S L Q Q S V F P E I K S A A Q N D - T G R Y N L S L F F Q K - N L L L K T T K Q V V T . : . . . . . : 16316 T : AAAATATAAATCAAATAATAATAATAATATAATAATCAAGAAAAGAGAAAA : AAGAAGAA : - N I N Q I I I I I - - S R K E K : K E E : K I - I K - - - - Y N N Q E K R K : K K K I : K Y K S N N N N N I I I K K R E K : R R . . : . . . 13691 GTAAAAAAGACCAC : AAGAACAAGAAAGTAAAAGATAAATAGATAGAA V K K T T : R T R K - K I N R - - K R P : Q E Q E S K R - I D R S K K D H : K N K K V K D K - I E Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-2_PPS_1 (16679 16401) (frame '1'; 276 bp, 92 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 ISLRSSESRF QHPIFRFSKC FETRTCDGPS CP- >C01HBa0088L02.1-_PGL-1_AGS-2_PPS_2 (17291 17046) (frame '1'; 243 bp, 81 residues) 1 FYVSVRDTRS PNSTCRFVTP DPLISFYQFI KPSPLPRHHQ SHYFSSSSLI PYKGIIIKKR 61 LGFYQDLGFD SFIMLNIITI I- >C01HBa0088L02.1-_PGL-1_AGS-2_PPS_3 (18288 18076) (frame '1'; 210 bp, 70 residues) 1 KNGIFLKSYS LSKKSKGVPL PFLKTLLDSF LCDETNEPNA LIPSLSRPKF GPRLAPTFTL 61 LCERTNQSKP - >C01HBa0088L02.1-_PGL-1_AGS-2_PPS_4 (18460 18260) (frame '0'; 198 bp, 66 residues) 1 NPSGWLRRTL SCRCWCWCWR SCCSISNHLR KRVKMVRYQF VSPRYQLDSS SSTKERMKEW 61 NFPKVL- >C01HBa0088L02.1-_PGL-1_AGS-2_PPS_5 (16970 16776) (frame '1'; 192 bp, 64 residues) 1 EFTTNSMKTI TYLHRRIAIN KLSSQNPCYP LRFSLSTRSL SFSVSLCSFY FSYSNPLSFT 61 LINI- AGS-3 (16856 16311,14902 14891,14791 14780,12802 12777,12617 12575) SCR (e 0.809 d 0.000 a 0.992,e 0.667 d 0.000 a 0.000,e 0.833 d 0.721 a 0.000,e 0.654 d 0.900 a 0.000,e 0.744) Exon 1 16856 16311 ( 546 n); score: 0.809 Intron 1 16310 14903 (1408 n); Pd: 0.000 Pa: 0.992 Exon 2 14902 14891 ( 12 n); score: 0.667 Intron 2 14890 14792 ( 99 n); Pd: 0.000 Pa: 0.000 Exon 3 14791 14780 ( 12 n); score: 0.833 Intron 3 14779 12803 (1977 n); Pd: 0.721 Pa: 0.000 Exon 4 12802 12777 ( 26 n); score: 0.654 Intron 4 12776 12618 ( 159 n); Pd: 0.900 Pa: 0.000 Exon 5 12617 12575 ( 43 n); score: 0.744 PGS (16856 16311,14902 14891,14791 14780,12802 12777,12617 12575) SGN-E550212+ PGS (16856 16311,14902 14891,14791 14780,12802 12777,12617 12575) SGN-E550201+ 3-phase translation of AGS-3 (-strand): . . . . . . 16856 TCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCT S L S F S V S L C S F Y F S Y S N P L S L F L F L S L F V L S I F L I Q T L F L S F F F C L S L F F L F F L F K P S F . . . . . . 16796 TTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAAC F T L I N I - S S V K D G N N N P L I N L P - L T Y N Q V - K M A I I T H - L T F Y P N - H I I K C K R W Q - - P T N - . . . . . . 16736 TTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTT L R L P L L T P K - L D L L T L T P - L - G Y L F - P P S N - T Y - H - P P N F L K V T S F N P Q V I R L I N I N P L T . . . . . . 16676 TATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCG Y N L S R N S Q K R P L K R I K K S D P I I - A G I V K N V P - N V - R N P T R L - F K Q E - S K T S L K T Y K E I R P . . . . . . 16616 GACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTC D W D C A T C D G P S C L R R S V L Q V T G I A Q P V M G R R A C D G P S C R S G L G L R N L - W A V V P A T V R P A G . . . . . . 16556 GTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCGTCCTGCCATT V A K F R D P N F H Q G S V T V R P A I S Q S S E T Q I S T K G L - R S V L P F R R K V Q R P K F P P R V C D G P S C H . . . . . . 16496 TCGTTACGAAGTTCAGAGAGTCGATTTCAGCACCCAATTTTTAGATTTTCTAAGTGTTTT S L R S S E S R F Q H P I F R F S K C F R Y E V Q R V D F S T Q F L D F L S V L F V T K F R E S I S A P N F - I F - V F . . . . . . 16436 GAAACGAGAACCTGCGACGGTCCGTCGTGCCCATGACGGTCCGTCGTGGGGTCCGTCGCC E T R T C D G P S C P - R S V V G S V A K R E P A T V R R A H D G P S W G P S P - N E N L R R S V V P M T V R R G V R R . . . . . . 16376 TCAGTCTGTTTTTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACAA S V C F S R N K I C C S K R L N R S L Q Q S V F P E I K S A A Q N D - T G R Y N L S L F F Q K - N L L L K T T K Q V V T . : . : . : . . . : 16316 TTTATT : TTGTCCTTAATT : AAATGTTATAAT : TTTTTTCTGTAATTTAACACAATTTG : AACC F I : L S L I : K C Y N : F F L - F N T I - : T L F : C P - L : N V I I : F F C N L T Q F : E P I Y : F V L N : - M L - : F F S V I - H N L : N . . . . 12613 AATGAATTGCTTAACCATCAAGGGGATGCAAAAAATTAT N E L L N H Q G D A K N Y M N C L T I K G M Q K I Q - I A - P S R G C K K L Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-3_PPS_1 (16679 16401) (frame '1'; 276 bp, 92 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 ISLRSSESRF QHPIFRFSKC FETRTCDGPS CP- AGS-4 (13559 13355) SCR (e 0.854) Exon 1 13559 13355 ( 205 n); score: 0.854 PGS (13559 13355) SGN-E348470- 3-phase translation of AGS-4 (-strand): . . . . . . 13559 CGGATTCACATGGTGTTCGCCGGATATTCGAGCACCCATTAACTTCGTTACGAAATATAT R I H M V F A G Y S S T H - L R Y E I Y G F T W C S P D I R A P I N F V T K Y I D S H G V R R I F E H P L T S L R N I . . . . . . 13499 ATATCTATGTAGAAATCGATAGGTATTTGTATAAAATTAACATAGAGCACCCAACGAATA I S M - K S I G I C I K L T - S T Q R I Y L C R N R - V F V - N - H R A P N E - Y I Y V E I D R Y L Y K I N I E H P T N . . . . . . 13439 AATCATATAGTTGGCCCAGTGATTCTAGGATGAGTACTTAAGACTCTTTTAGTGTTGTTG N H I V G P V I L G - V L K T L L V L L I I - L A Q - F - D E Y L R L F - C C C K S Y S W P S D S R M S T - D S F S V V . . . 13379 TACTAAGGTTCAAATCTCATTGTAT Y - G S N L I V T K V Q I S L Y V L R F K S H C Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-4 (+strand): . . . . . . 13355 ATACAATGAGATTTGAACCTTAGTACAACAACACTAAAAGAGTCTTAAGTACTCATCCTA I Q - D L N L S T T T L K E S - V L I L Y N E I - T L V Q Q H - K S L K Y S S - T M R F E P - Y N N T K R V L S T H P . . . . . . 13415 GAATCACTGGGCCAACTATATGATTTATTCGTTGGGTGCTCTATGTTAATTTTATACAAA E S L G Q L Y D L F V G C S M L I L Y K N H W A N Y M I Y S L G A L C - F Y T N R I T G P T I - F I R W V L Y V N F I Q . . . . . . 13475 TACCTATCGATTTCTACATAGATATATATATTTCGTAACGAAGTTAATGGGTGCTCGAAT Y L S I S T - I Y I F R N E V N G C S N T Y R F L H R Y I Y F V T K L M G A R I I P I D F Y I D I Y I S - R S - W V L E . . . 13535 ATCCGGCGAACACCATGTGAATCCG I R R T P C E S S G E H H V N P Y P A N T M - I Maximal non-overlapping open reading frames (>= 64 codons): none AGS-5 (18002 17842,13991 13963,13803 13783) SCR (e 0.863 d 0.000 a 0.000,e 0.759 d 0.000 a 0.000,e 0.762) Exon 1 18002 17842 ( 161 n); score: 0.863 Intron 1 17841 13992 (3850 n); Pd: 0.000 Pa: 0.000 Exon 2 13991 13963 ( 29 n); score: 0.759 Intron 2 13962 13804 ( 159 n); Pd: 0.000 Pa: 0.000 Exon 3 13803 13783 ( 21 n); score: 0.762 PGS (18002 17842,13991 13963,13803 13783) SGN-E238551- 3-phase translation of AGS-5 (-strand): . . . . . . 18002 CTATTATTCCCCAAAATTTGGAAGTCATCATCACAAGAACATCTATGATCAAATTACTAA L L F P K I W K S S S Q E H L - S N Y - Y Y S P K F G S H H H K N I Y D Q I T N I I P Q N L E V I I T R T S M I K L L . . . . . . 17942 CTAAAAATGCCTAAGAAGCTAAAAATACATAAGAAGCTAGTCCATGCCGGAAGTTCAAGG L K M P K K L K I H K K L V H A G S S R - K C L R S - K Y I R S - S M P E V Q G T K N A - E A K N T - E A S P C R K F K . . . . . : . 17882 CATCAAGACTTGAAGAAGAAGCTCCAGTCCAAGCTAGAAGC : TTGGTTTTATCAGGCAAAA H Q D L K K K L Q S K L E A : W F Y Q A K I K T - R R S S S P S - K : L G F I R Q K A S R L E E E A P V Q A R S : L V L S G K . : . . . 13972 GTTTATTATT : AGAAAAGAATTTGAGTTGATT V Y Y : - K R I - V D F I I : R K E F E L I S L L L : E K N L S - Maximal non-overlapping open reading frames (>= 64 codons): none AGS-6 (16856 16311,14902 14891,14724 14693,14629 14608) SCR (e 0.812 d 0.000 a 0.992,e 0.667 d 0.000 a 0.000,e 0.812 d 0.000 a 0.972,e 0.659) Exon 1 16856 16311 ( 546 n); score: 0.812 Intron 1 16310 14903 (1408 n); Pd: 0.000 Pa: 0.992 Exon 2 14902 14891 ( 12 n); score: 0.667 Intron 2 14890 14725 ( 166 n); Pd: 0.000 Pa: 0.000 Exon 3 14724 14693 ( 32 n); score: 0.812 Intron 3 14692 14630 ( 63 n); Pd: 0.000 Pa: 0.972 Exon 4 14629 14608 ( 22 n); score: 0.659 PGS (16856 16311,14902 14891,14724 14693,14629 14608) SGN-E396056+ PGS (16851 16311,14902 14891,14724 14693) SGN-E377133+ 3-phase translation of AGS-6 (-strand): . . . . . . 16856 TCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCT S L S F S V S L C S F Y F S Y S N P L S L F L F L S L F V L S I F L I Q T L F L S F F F C L S L F F L F F L F K P S F . . . . . . 16796 TTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAAC F T L I N I - S S V K D G N N N P L I N L P - L T Y N Q V - K M A I I T H - L T F Y P N - H I I K C K R W Q - - P T N - . . . . . . 16736 TTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTT L R L P L L T P K - L D L L T L T P - L - G Y L F - P P S N - T Y - H - P P N F L K V T S F N P Q V I R L I N I N P L T . . . . . . 16676 TATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCG Y N L S R N S Q K R P L K R I K K S D P I I - A G I V K N V P - N V - R N P T R L - F K Q E - S K T S L K T Y K E I R P . . . . . . 16616 GACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTC D W D C A T C D G P S C L R R S V L Q V T G I A Q P V M G R R A C D G P S C R S G L G L R N L - W A V V P A T V R P A G . . . . . . 16556 GTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCGTCCTGCCATT V A K F R D P N F H Q G S V T V R P A I S Q S S E T Q I S T K G L - R S V L P F R R K V Q R P K F P P R V C D G P S C H . . . . . . 16496 TCGTTACGAAGTTCAGAGAGTCGATTTCAGCACCCAATTTTTAGATTTTCTAAGTGTTTT S L R S S E S R F Q H P I F R F S K C F R Y E V Q R V D F S T Q F L D F L S V L F V T K F R E S I S A P N F - I F - V F . . . . . . 16436 GAAACGAGAACCTGCGACGGTCCGTCGTGCCCATGACGGTCCGTCGTGGGGTCCGTCGCC E T R T C D G P S C P - R S V V G S V A K R E P A T V R R A H D G P S W G P S P - N E N L R R S V V P M T V R R G V R R . . . . . . 16376 TCAGTCTGTTTTTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACAA S V C F S R N K I C C S K R L N R S L Q Q S V F P E I K S A A Q N D - T G R Y N L S L F F Q K - N L L L K T T K Q V V T . : . : . . . : . 16316 TTTATT : TTGTCCTTAATT : AAATATTAAATTTTTATTTTATCTACTTTATA : AGACACAAGG F I : L S L I : K Y - I F I L S T L - : D T R L F : C P - L : N I K F L F Y L L Y : K T Q G I Y : F V L N : - I L N F Y F I Y F I : R H K . . 14619 AACATAAATTTT N I N F T - I E H K F Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-6_PPS_1 (16679 16401) (frame '1'; 276 bp, 92 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 ISLRSSESRF QHPIFRFSKC FETRTCDGPS CP- AGS-7 (16856 16304,16104 16039,15014 14974) SCR (e 0.813 d 0.000 a 0.804,e 0.618 d 0.000 a 0.000,e 0.707) Exon 1 16856 16304 ( 553 n); score: 0.813 Intron 1 16303 16105 ( 199 n); Pd: 0.000 Pa: 0.804 Exon 2 16104 16039 ( 66 n); score: 0.618 Intron 2 16038 15015 (1024 n); Pd: 0.000 Pa: 0.000 Exon 3 15014 14974 ( 41 n); score: 0.707 PGS (16856 16304,16104 16039,15014 14974) SGN-E550140- PGS (16856 16304,16104 16050) SGN-E550065+ PGS (16856 16304,16104 16050) SGN-E550207+ PGS (16856 16304,16104 16050) SGN-E550335+ PGS (16856 16304,16104 16050) SGN-E390013+ PGS (16856 16304,16104 16050) SGN-E550484+ PGS (16856 16304,16104 16050) SGN-E550211+ PGS (16856 16304,16104 16050) SGN-E550464+ PGS (16856 16304,16104 16050) SGN-E549941+ PGS (16856 16304,16104 16050) SGN-E550025+ PGS (16845 16304,16104 16050) SGN-E550322+ PGS (16819 16304,16104 16050) SGN-E396057- PGS (16803 16304,16104 16050) SGN-E377132- PGS (16787 16304,16104 16050) SGN-E396055- PGS (16785 16304,16104 16050) SGN-E398551- PGS (16773 16304,16104 16050) SGN-E396038- PGS (16668 16304,16104 16050) SGN-E396069- PGS (16856 16304,16104 16053) SGN-E396054+ 3-phase translation of AGS-7 (-strand): . . . . . . 16856 TCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCT S L S F S V S L C S F Y F S Y S N P L S L F L F L S L F V L S I F L I Q T L F L S F F F C L S L F F L F F L F K P S F . . . . . . 16796 TTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAAC F T L I N I - S S V K D G N N N P L I N L P - L T Y N Q V - K M A I I T H - L T F Y P N - H I I K C K R W Q - - P T N - . . . . . . 16736 TTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTT L R L P L L T P K - L D L L T L T P - L - G Y L F - P P S N - T Y - H - P P N F L K V T S F N P Q V I R L I N I N P L T . . . . . . 16676 TATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCG Y N L S R N S Q K R P L K R I K K S D P I I - A G I V K N V P - N V - R N P T R L - F K Q E - S K T S L K T Y K E I R P . . . . . . 16616 GACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTC D W D C A T C D G P S C L R R S V L Q V T G I A Q P V M G R R A C D G P S C R S G L G L R N L - W A V V P A T V R P A G . . . . . . 16556 GTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCGTCCTGCCATT V A K F R D P N F H Q G S V T V R P A I S Q S S E T Q I S T K G L - R S V L P F R R K V Q R P K F P P R V C D G P S C H . . . . . . 16496 TCGTTACGAAGTTCAGAGAGTCGATTTCAGCACCCAATTTTTAGATTTTCTAAGTGTTTT S L R S S E S R F Q H P I F R F S K C F R Y E V Q R V D F S T Q F L D F L S V L F V T K F R E S I S A P N F - I F - V F . . . . . . 16436 GAAACGAGAACCTGCGACGGTCCGTCGTGCCCATGACGGTCCGTCGTGGGGTCCGTCGCC E T R T C D G P S C P - R S V V G S V A K R E P A T V R R A H D G P S W G P S P - N E N L R R S V V P M T V R R G V R R . . . . . . 16376 TCAGTCTGTTTTTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACAA S V C F S R N K I C C S K R L N R S L Q Q S V F P E I K S A A Q N D - T G R Y N L S L F F Q K - N L L L K T T K Q V V T . . : . . . . 16316 TTTATTGTTAGTT : GGCAATCATACAATGTTAATTTTTTAGACAAAATTACTAATATTAGA F I V S : W Q S Y N V N F L D K I T N I R L L L V : G N H T M L I F - T K L L I L E I Y C - L : A I I Q C - F F R Q N Y - Y - . . : . . . . 16057 AAGAAAGAAAAAAAACACT : ATGAAATAAGAAAATATAAATCAAATAATAATAATAATATA K K E K K H : Y E I R K Y K S N N N N N I R K K K N T : M K - E N I N Q I I I I I K E R K K T L : - N K K I - I K - - - - Y Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-7_PPS_1 (16679 16401) (frame '1'; 276 bp, 92 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 ISLRSSESRF QHPIFRFSKC FETRTCDGPS CP- >C01HBa0088L02.1-_PGL-1_AGS-7_PPS_2 (16400 16304,16104 16039,15014 14974) (frame '1'; 204 bp, 68 residues) 1 RSVVGSVASV CFSRNKICCS KRLNRSLQFI VSWQSYNVNF LDKITNIRKK EKKHYEIRKY 61 KSNNNNNI AGS-8 (16856 16263) SCR (e 0.777) Exon 1 16856 16263 ( 594 n); score: 0.777 PGS (16856 16263) SGN-E396058+ 3-phase translation of AGS-8 (-strand): . . . . . . 16856 TCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCT S L S F S V S L C S F Y F S Y S N P L S L F L F L S L F V L S I F L I Q T L F L S F F F C L S L F F L F F L F K P S F . . . . . . 16796 TTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAAC F T L I N I - S S V K D G N N N P L I N L P - L T Y N Q V - K M A I I T H - L T F Y P N - H I I K C K R W Q - - P T N - . . . . . . 16736 TTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTT L R L P L L T P K - L D L L T L T P - L - G Y L F - P P S N - T Y - H - P P N F L K V T S F N P Q V I R L I N I N P L T . . . . . . 16676 TATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCG Y N L S R N S Q K R P L K R I K K S D P I I - A G I V K N V P - N V - R N P T R L - F K Q E - S K T S L K T Y K E I R P . . . . . . 16616 GACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTC D W D C A T C D G P S C L R R S V L Q V T G I A Q P V M G R R A C D G P S C R S G L G L R N L - W A V V P A T V R P A G . . . . . . 16556 GTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCGTCCTGCCATT V A K F R D P N F H Q G S V T V R P A I S Q S S E T Q I S T K G L - R S V L P F R R K V Q R P K F P P R V C D G P S C H . . . . . . 16496 TCGTTACGAAGTTCAGAGAGTCGATTTCAGCACCCAATTTTTAGATTTTCTAAGTGTTTT S L R S S E S R F Q H P I F R F S K C F R Y E V Q R V D F S T Q F L D F L S V L F V T K F R E S I S A P N F - I F - V F . . . . . . 16436 GAAACGAGAACCTGCGACGGTCCGTCGTGCCCATGACGGTCCGTCGTGGGGTCCGTCGCC E T R T C D G P S C P - R S V V G S V A K R E P A T V R R A H D G P S W G P S P - N E N L R R S V V P M T V R R G V R R . . . . . . 16376 TCAGTCTGTTTTTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACAA S V C F S R N K I C C S K R L N R S L Q Q S V F P E I K S A A Q N D - T G R Y N L S L F F Q K - N L L L K T T K Q V V T . . . . . . 16316 TTTATTGTTAGTTATGTCAAATTATTGTGGAATGGAGAAGAAGTCAAATACCAT F I V S Y V K L L W N G E E V K Y H L L L V M S N Y C G M E K K S N T I Y C - L C Q I I V E W R R S Q I P Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-8_PPS_1 (16679 16401) (frame '1'; 276 bp, 92 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 ISLRSSESRF QHPIFRFSKC FETRTCDGPS CP- 3-phase translation of AGS-8 (+strand): . . . . . . 16263 ATGGTATTTGACTTCTTCTCCATTCCACAATAATTTGACATAACTAACAATAAATTGTAA M V F D F F S I P Q - F D I T N N K L - W Y L T S S P F H N N L T - L T I N C N G I - L L L H S T I I - H N - Q - I V . . . . . . 16323 CGACCTGTTTAGTCGTTTTGAGCAGCAGATTTTATTTCTGGAAAAACAGACTGAGGCGAC R P V - S F - A A D F I S G K T D - G D D L F S R F E Q Q I L F L E K Q T E A T T T C L V V L S S R F Y F W K N R L R R . . . . . . 16383 GGACCCCACGACGGACCGTCATGGGCACGACGGACCGTCGCAGGTTCTCGTTTCAAAACA G P H D G P S W A R R T V A G S R F K T D P T T D R H G H D G P S Q V L V S K H R T P R R T V M G T T D R R R F S F Q N . . . . . . 16443 CTTAGAAAATCTAAAAATTGGGTGCTGAAATCGACTCTCTGAACTTCGTAACGAAATGGC L R K S K N W V L K S T L - T S - R N G L E N L K I G C - N R L S E L R N E M A T - K I - K L G A E I D S L N F V T K W . . . . . . 16503 AGGACGGACCGTCACAGACCCTTGGTGGAAATTTGGGTCTCTGAACTTTGCGACGACCTG R T D R H R P L V E I W V S E L C D D L G R T V T D P W W K F G S L N F A T T C Q D G P S Q T L G G N L G L - T L R R P . . . . . . 16563 CAGGACGGACCGTCGCAGGCACGACGGCCCATCACAGGTTGCGCAATCCCAGTCCGGGTC Q D G P S Q A R R P I T G C A I P V R V R T D R R R H D G P S Q V A Q S Q S G S A G R T V A G T T A H H R L R N P S P G . . . . . . 16623 GGATTTCTTTATACGTTTTAAGGGACGTTTTTGACTATTCCTGCTTAAATTATAAAGTTA G F L Y T F - G T F L T I P A - I I K L D F F I R F K G R F - L F L L K L - S - R I S L Y V L R D V F D Y S C L N Y K V . . . . . . 16683 GGGGGTTAATGTTAATAAGTCTAATTACTTGGGGGTTAAAAGAGGTAACCTTAAGTTAAT G G - C - - V - L L G G - K R - P - V N G V N V N K S N Y L G V K R G N L K L I R G L M L I S L I T W G L K E V T L S - . . . . . . 16743 TAGTGGGTTATTATTGCCATCTTTTACACTTGATTATATGTTAATTAGGGTAAAAGAAAG - W V I I A I F Y T - L Y V N - G K R K S G L L L P S F T L D Y M L I R V K E R L V G Y Y C H L L H L I I C - L G - K K . . . . . . 16803 AGGGTTTGAATAAGAAAAATAGAAAGAACAAAGAGAGACAGAAAAAGAAAGAGA R V - I R K I E R T K R D R K R K R G F E - E K - K E Q R E T E K E R E G L N K K N R K N K E R Q K K K E Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-1_AGS-8_PPS_1 (16547 16741) (frame '0'; 192 bp, 64 residues) 1 TLRRPAGRTV AGTTAHHRLR NPSPGRISLY VLRDVFDYSC LNYKVRGLML ISLITWGLKE 61 VTLS- AGS-9 (16856 16522,16428 16389) SCR (e 0.904 d 0.000 a 0.000,e 0.850) Exon 1 16856 16522 ( 335 n); score: 0.904 Intron 1 16521 16429 ( 93 n); Pd: 0.000 Pa: 0.000 Exon 2 16428 16389 ( 40 n); score: 0.850 PGS (16856 16522,16428 16389) SGN-E396070+ 3-phase translation of AGS-9 (-strand): . . . . . . 16856 TCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCT S L S F S V S L C S F Y F S Y S N P L S L F L F L S L F V L S I F L I Q T L F L S F F F C L S L F F L F F L F K P S F . . . . . . 16796 TTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAAC F T L I N I - S S V K D G N N N P L I N L P - L T Y N Q V - K M A I I T H - L T F Y P N - H I I K C K R W Q - - P T N - . . . . . . 16736 TTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTT L R L P L L T P K - L D L L T L T P - L - G Y L F - P P S N - T Y - H - P P N F L K V T S F N P Q V I R L I N I N P L T . . . . . . 16676 TATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCG Y N L S R N S Q K R P L K R I K K S D P I I - A G I V K N V P - N V - R N P T R L - F K Q E - S K T S L K T Y K E I R P . . . . . . 16616 GACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTC D W D C A T C D G P S C L R R S V L Q V T G I A Q P V M G R R A C D G P S C R S G L G L R N L - W A V V P A T V R P A G . . . . : . . 16556 GTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGG : AACCTGCGACGGTCCGTCGTGCCCA V A K F R D P N F H Q G : T C D G P S C P S Q S S E T Q I S T K : E P A T V R R A H R R K V Q R P K F P P R : N L R R S V V P . . 16403 TGACGGTCCGTCGTG - R S V V D G P S M T V R R Maximal non-overlapping open reading frames (>= 64 codons): none AGS-10 (16851 16500,16425 16399) SCR (e 0.905 d 0.000 a 0.000,e 0.815) Exon 1 16851 16500 ( 352 n); score: 0.905 Intron 1 16499 16426 ( 74 n); Pd: 0.000 Pa: 0.000 Exon 2 16425 16399 ( 27 n); score: 0.815 PGS (16851 16500,16425 16399) SGN-E236652+ 3-phase translation of AGS-10 (-strand): . . . . . . 16851 TTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCTTTTAC F F F C L S L F F L F F L F K P S F F Y S F S V S L C S F Y F S Y S N P L S F T L F L S L F V L S I F L I Q T L F L L . . . . . . 16791 CCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAACTTAAG P N - H I I K C K R W Q - - P T N - L K L I N I - S S V K D G N N N P L I N L R P - L T Y N Q V - K M A I I T H - L T - . . . . . . 16731 GTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTTTATAA V T S F N P Q V I R L I N I N P L T L - L P L L T P K - L D L L T L T P - L Y N G Y L F - P P S N - T Y - H - P P N F I . . . . . . 16671 TTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCGGACTG F K Q E - S K T S L K T Y K E I R P G L L S R N S Q K R P L K R I K K S D P D W I - A G I V K N V P - N V - R N P T R T . . . . . . 16611 GGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTCGTCGC G L R N L - W A V V P A T V R P A G R R D C A T C D G P S C L R R S V L Q V V A G I A Q P V M G R R A C D G P S C R S S . . . . . . : 16551 AAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCGTCCTGCC : CTGCGACG K V Q R P K F P P R V C D G P S C : P A T K F R D P N F H Q G S V T V R P A : L R R Q S S E T Q I S T K G L - R S V L P : C D . . 16417 GTCCGTCGTGCCCATGACG V R R A H D S V V P M T G P S C P - Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-10_PPS_1 (16679 16500,16425 16399) (frame '2'; 207 bp, 69 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 LRRSVVPMT AGS-11 (18001 17391,17326 17283,17250 17210) SCR (e 0.847 d 0.000 a 0.000,e 0.670 d 0.000 a 0.000,e 0.793) Exon 1 18001 17391 ( 611 n); score: 0.847 Intron 1 17390 17327 ( 64 n); Pd: 0.000 Pa: 0.000 Exon 2 17326 17283 ( 44 n); score: 0.670 Intron 2 17282 17251 ( 32 n); Pd: 0.000 Pa: 0.000 Exon 3 17250 17210 ( 41 n); score: 0.793 PGS (17701 17391,17326 17283,17250 17210) SGN-E349977- PGS (17614 17379) SGN-E391780- PGS (17857 17380) SGN-E246710- PGS (18001 17393) SGN-E546506+ PGS (17705 17425) SGN-E357033+ 3-phase translation of AGS-11 (-strand): . . . . . . 18001 TATTATTCCCCAAAATTTGGAAGTCATCATCACAAGAACATCTATGATCAAATTACTAAC Y Y S P K F G S H H H K N I Y D Q I T N I I P Q N L E V I I T R T S M I K L L T L F P K I W K S S S Q E H L - S N Y - . . . . . . 17941 TAAAAATGCCTAAGAAGCTAAAAATACATAAGAAGCTAGTCCATGCCGGAAGTTCAAGGC - K C L R S - K Y I R S - S M P E V Q G K N A - E A K N T - E A S P C R K F K A L K M P K K L K I H K K L V H A G S S R . . . . . . 17881 ATCAAGACTTGAAGAAGAAGCTCCAGTCCAAGCTAGAAGCATTAGCTCACCCTGAATTTC I K T - R R S S S P S - K H - L T L N F S R L E E E A P V Q A R S I S S P - I S H Q D L K K K L Q S K L E A L A H P E F . . . . . . 17821 CGATGTAGTAAGACTGGCTTGAATTACTGTTGAGTCGAAGACGACGGCACGTTTGCTACA R C S K T G L N Y C - V E D D G T F A T D V V R L A - I T V E S K T T A R L L H P M - - D W L E L L L S R R R R H V C Y . . . . . . 17761 CTCCACAAATAACAAAGAAGAAAACATAAAAGTAGGGGTCAGTACAAAGCACGGGTACTG L H K - Q R R K H K S R G Q Y K A R V L S T N N K E E N I K V G V S T K H G Y - T P Q I T K K K T - K - G S V Q S T G T . . . . . . 17701 AGTAGATATCATCGGCCAACTCAAAATAGAAAACAGTATATACCAAGTAATATCATAAAC S R Y H R P T Q N R K Q Y I P S N I I N V D I I G Q L K I E N S I Y Q V I S - T E - I S S A N S K - K T V Y T K - Y H K . . . . . . 17641 TCAACTATGATACTCAACATGTAGCAACAACAAGTACTATATCATTAACAATTTCCGTCA S T M I L N M - Q Q Q V L Y H - Q F P S Q L - Y S T C S N N K Y Y I I N N F R Q L N Y D T Q H V A T T S T I S L T I S V . . . . . . 17581 AGTTCACACATGAGGACTCAAGCCTCAATACCATACTCATTTGGGAATTATGTTCATTAG S S H M R T Q A S I P Y S F G N Y V H - V H T - G L K P Q Y H T H L G I M F I R K F T H E D S S L N T I L I W E L C S L . . . . . . 17521 ATTGAGTATATTAACATCTTTTAAGATTCATTATCTTTATTTCTCTTGTGTCGGTACGTG I E Y I N I F - D S L S L F L L C R Y V L S I L T S F K I H Y L Y F S C V G T - D - V Y - H L L R F I I F I S L V S V R . . . . . . 17461 ACACTCCGCTCCCTTATATTCATTAATCCTCTTGTGTCGGTACGTGACACTCCGATCCCC T L R S L I F I N P L V S V R D T P I P H S A P L Y S L I L L C R Y V T L R S P D T P L P Y I H - S S C V G T - H S D P . . : . . . . : 17401 TACTACTATGT : ATCTACGTGTCGGTTCGTGACACCCGATCCCCTAATTCTACGTG : GTGTC Y Y Y V : S T C R F V T P D P L I L R : G V T T M : Y L R V G S - H P I P - F Y V : V S L L L C : I Y V S V R D T R S P N S T W : C . . . . 17245 GGTTCGTAACACCCGATCCCCTAATCTCATTCTATC G S - H P I P - S H S I V R N T R S P N L I L R F V T P D P L I S F Y Maximal non-overlapping open reading frames (>= 64 codons): none AGS-12 (21180 18473) SCR (e 0.910) Exon 1 21180 18473 (2708 n); score: 0.910 PGS (18903 18473) SGN-E352180+ PGS (19091 18538) SGN-E329287- PGS (19260 18542) SGN-E356614+ PGS (19258 18599) SGN-E352401+ PGS (19462 18752) SGN-E349404+ PGS (19462 18784) SGN-E351625+ PGS (19456 18849) SGN-E357065+ PGS (19462 18941) SGN-E352365+ PGS (19895 19109) SGN-E356912+ PGS (19820 19125) SGN-E356209+ PGS (19977 19215) SGN-E214046+ PGS (19895 19363) SGN-E353805+ PGS (19981 19424) SGN-E244046+ PGS (20364 19825) SGN-E355026+ PGS (20591 19830) SGN-E355244+ PGS (20186 19858) SGN-E352716+ PGS (20548 19888) SGN-E352117- PGS (20591 19931) SGN-E351414+ PGS (20340 19957) SGN-E242765+ PGS (20660 20002) SGN-E355232+ PGS (21109 20430) SGN-E368762+ PGS (21180 20468) SGN-E379315+ PGS (20637 20512) SGN-E578271+ PGS (21180 20585) SGN-E375319+ PGS (21180 20656) SGN-E204434+ PGS (21109 20751) SGN-E240817+ 3-phase translation of AGS-12 (-strand): . . . . . . 21180 GAATCCTTTGACAAATCAGCGGTAGTAGCTAGCTAACCCAACAAAGCTCCTTATTTCTGA E S F D K S A V V A S - P N K A P Y F - N P L T N Q R - - L A N P T K L L I S D I L - Q I S G S S - L T Q Q S S L F L . . . . . . 21120 CACATTAGTGGGTCTTACCCAATTCTTCACTGTCTCAATCTTAGAAGGATCCACCATCAC H I S G S Y P I L H C L N L R R I H H H T L V G L T Q F F T V S I L E G S T I T T H - W V L P N S S L S Q S - K D P P S . . . . . . 21060 TCCTTCCTTAGAAACCACGTGCCCCAAGAAGGACACTGCATCTAGCCAAAACTCACACTT S F L R N H V P Q E G H C I - P K L T L P S L E T T C P K K D T A S S Q N S H L L L P - K P R A P R R T L H L A K T H T . . . . . . 21000 AGAGAACTTGGCATAAAGCTTTTTCTCCCTCAACATTTCCAATACCATTCTCAAATGCTC R E L G I K L F L P Q H F Q Y H S Q M L E N L A - S F F S L N I S N T I L K C S - R T W H K A F S P S T F P I P F S N A . . . . . . 20940 TTCATGTTCCTTCTTGCTCTTTGAGTATACCAATATATCATCAATAAATACAATCACGAA F M F L L A L - V Y Q Y I I N K Y N H E S C S F L L F E Y T N I S S I N T I T K L H V P S C S L S I P I Y H Q - I Q S R . . . . . . 20880 GAGGTCCAAATATGGCTTAAAAATCCCGTTTATCAACCTCATGAATGCAGCAGGGGCATT E V Q I W L K N P V Y Q P H E C S R G I R S K Y G L K I P F I N L M N A A G A F R G P N M A - K S R L S T S - M Q Q G H . . . . . . 20820 CGTAAGACCAAAAGACATCACCACAAATTCGTAATGCCCATACCTTGTTCGAAAAGCAGT R K T K R H H H K F V M P I P C S K S S V R P K D I T T N S - C P Y L V R K A V S - D Q K T S P Q I R N A H T L F E K Q . . . . . . 20760 CTTTGGCACATCCGTTGCCCGTATTTTCAATTGATGATAACCAGATCTCAAGTCAATCTT L W H I R C P Y F Q L M I T R S Q V N L F G T S V A R I F N - - - P D L K S I L S L A H P L P V F S I D D N Q I S S Q S . . . . . . 20700 AGAGAAGACACAAGCACCTTGTAATTGATTGAACAAGTCATCAATGCGAGGAAAAGGATA R E D T S T L - L I E Q V I N A R K R I E K T Q A P C N - L N K S S M R G K G Y - R R H K H L V I D - T S H Q C E E K D . . . . . . 20640 CTTGTTCTTAATAGTTACCTTATTCAGTTGTCTGTAGTCTATGCACATCCGAAAACTCCC L V L N S Y L I Q L S V V Y A H P K T P L F L I V T L F S C L - S M H I R K L P T C S - - L P Y S V V C S L C T S E N S . . . . . . 20580 ATCCTTCTTCTTCACAAACAAAACCGGAGCACCCCAAGGAGATGCACTTGGTCTGATGAA I L L L H K Q N R S T P R R C T W S D E S F F F T N K T G A P Q G D A L G L M K H P S S S Q T K P E H P K E M H L V - - . . . . . . 20520 GCCTTTGTTCAACAACTCTTGAAGTTGGGCCTTTAACTCTCTCAACTCCGCGGGAGCCAT A F V Q Q L L K L G L - L S Q L R G S H P L F N N S - S W A F N S L N S A G A I S L C S T T L E V G P L T L S T P R E P . . . . . . 20460 TCTATAAGGGGGTATAGAAATGGGGCGAGTGCCCGGTTCAAGATCAATGCAGAAGTCAAT S I R G Y R N G A S A R F K I N A E V N L - G G I E M G R V P G S R S M Q K S I F Y K G V - K W G E C P V Q D Q C R S Q . . . . . . 20400 ATCCCTATCTGGTGGCATACCAGGAAGATCTGCAGGGAACACATCCAAAAACTCGCGGAC I P I W W H T R K I C R E H I Q K L A D S L S G G I P G R S A G N T S K N S R T Y P Y L V A Y Q E D L Q G T H P K T R G . . . . . . 20340 TACCGAAACCGACTCAATCGAAGGTACTTGGGTAGTGTCATCCTTGAGATGGGCCAAGAA Y R N R L N R R Y L G S V I L E M G Q E T E T D S I E G T W V V S S L R W A K K L P K P T Q S K V L G - C H P - D G P R . . . . . . 20280 AGCTAAACACCCTTTACTAACCATTTTCTTAGCACGAAGAAAGGAGATGATACGCACCGG S - T P F T N H F L S T K K G D D T H R A K H P L L T I F L A R R K E M I R T G K L N T L Y - P F S - H E E R R - Y A P . . . . . . 20220 ATTGGAAGTGTAGTCACCCTCCCACACTAACGGGTCTGTCCTAGGCTTGGCTAACGTCAC I G S V V T L P H - R V C P R L G - R H L E V - S P S H T N G S V L G L A N V T D W K C S H P P T L T G L S - A W L T S . . . . . . 20160 CATTTTAGCATTACAATCCAAGATCGCAAAATTCGGAGAAAGCCAAGTCATACGCAGAAT H F S I T I Q D R K I R R K P S H T Q N I L A L Q S K I A K F G E S Q V I R R I P F - H Y N P R S Q N S E K A K S Y A E . . . . . . 20100 TACATCAAAGTCAACCATTTCTAAGATAACCAAATCTACATAAGTGTTACTCCCTACAAA Y I K V N H F - D N Q I Y I S V T P Y K T S K S T I S K I T K S T - V L L P T K L H Q S Q P F L R - P N L H K C Y S L Q . . . . . . 20040 AGTCACCAAACAAGACCTATACACTTTTTCAACTATCACAGACTCACCCATCGGGGTAGA S H Q T R P I H F F N Y H R L T H R G R V T K Q D L Y T F S T I T D S P I G V E K S P N K T Y T L F Q L S Q T H P S G - . . . . . . 19980 AACACGAATAGGCATGTCAAGTAATTCACAATGTAAATTAAGACCATTAGCAAATGAGGA N T N R H V K - F T M - I K T I S K - G T R I G M S S N S Q C K L R P L A N E E K H E - A C Q V I H N V N - D H - Q M R . . . . . . 19920 AGATACATAAGAAAATGTGGATCCGGGATCAAACAATACAGAAGCCATGCAATCACAAAC R Y I R K C G S G I K Q Y R S H A I T N D T - E N V D P G S N N T E A M Q S Q T K I H K K M W I R D Q T I Q K P C N H K . . . . . . 19860 CAAAAGATTACCTGTGATGACAGCATCAGATGTCTCCACCTCAGATCTCCCAGGGAAATC Q K I T C D D S I R C L H L R S P R E I K R L P V M T A S D V S T S D L P G K S P K D Y L - - Q H Q M S P P Q I S Q G N . . . . . . 19800 ATAACAATGGGCCCTTTCATTTGTTTGTCCGTTGCCCTTACCATGTTGTGGTGTAGTGGC I T M G P F I C L S V A L T M L W C S G - Q W A L S F V C P L P L P C C G V V A H N N G P F H L F V R C P Y H V V V - W . . . . . . 19740 TCTAGTTTTCCCATCACCTCTGCCGTTTTGGTGACCACCATTACCTCGACCACCACGTCC S S F P I T S A V L V T T I T S T T T S L V F P S P L P F W - P P L P R P P R P L - F S H H L C R F G D H H Y L D H H V . . . . . . 19680 TCCAGAATAACGGCCTCTACCATGACCACCTCTACCTCTAGCTATTGGGGGTCTATAACT S R I T A S T M T T S T S S Y W G S I T P E - R P L P - P P L P L A I G G L - L L Q N N G L Y H D H L Y L - L L G V Y N . . . . . . 19620 CTGTTTAGGACAATTCCTCCTAATATGCCCAGTCTCCCCACATCCATAACACTCTCTAGA L F R T I P P N M P S L P T S I T L S R C L G Q F L L I C P V S P H P - H S L E S V - D N S S - Y A Q S P H I H N T L - . . . . . . 19560 GTCAAGCATAGGTCTCTCAGAAAAGTGTTGGCCGGTCTGAGGTGGACCCCCACTACAGTC V K H R S L R K V L A G L R W T P T T V S S I G L S E K C W P V - G G P P L Q S S Q A - V S Q K S V G R S E V D P H Y S . . . . . . 19500 TGTAGTGAAGACTGAATTGGTCGAACTGAGTAACCTCCGGAACCCTGTCCTCTAAAGTAA C S E D - I G R T E - P P E P C P L K - V V K T E L V E L S N L R N P V L - S K L - - R L N W S N - V T S G T L S S K V . . . . . . 19440 GAACCATTAAACTCACCTCCCTTTCGAAACCTCTTTGATGTCGATGCCATGGTGAATTCA E P L N S P P F R N L F D V D A M V N S N H - T H L P F E T S L M S M P W - I H R T I K L T S L S K P L - C R C H G E F . . . . . . 19380 TCTGGCTTCACTCCTTCCACCTCTACCACGAAATCTACCACTTCTTGGAAGGATTTTGCC S G F T P S T S T T K S T T S W K D F A L A S L L P P L P R N L P L L G R I L P I W L H S F H L Y H E I Y H F L E G F C . . . . . . 19320 GTAGCCGCTACCTGTAAGGCTGAAATCCGCAGCTCTGACCTCAACCCCTTCACAAAACGA V A A T C K A E I R S S D L N P F T K R - P L P V R L K S A A L T S T P S Q N D R S R Y L - G - N P Q L - P Q P L H K T . . . . . . 19260 CGAATCCGCTCTTGTGGACTGAAACAAAGTTGGGTGGCATATCTGGATAGTGCATGAAAC R I R S C G L K Q S W V A Y L D S A - N E S A L V D - N K V G W H I W I V H E T T N P L L W T E T K L G G I S G - C M K . . . . . . 19200 TTAGCCTCATATGCATTGACCAACATCCTACCTTTCTCTAGGCTCAAGAACTCATCCCTT L A S Y A L T N I L P F S R L K N S S L - P H M H - P T S Y L S L G S R T H P F L S L I C I D Q H P T F L - A Q E L I P . . . . . . 19140 TTCCTATCCCTCAAAGTTCGGGGGATATACTTCTCCATAAACAAGCTAGAGAATGAGGCC F L S L K V R G I Y F S I N K L E N E A S Y P S K F G G Y T S P - T S - R M R P F P I P Q S S G D I L L H K Q A R E - G . . . . . . 19080 CAAGTCATAGGTGATGCCTCTGTTGGTTGACACTCAACATGTGACCGCCACCACATTTTG Q V I G D A S V G - H S T C D R H H I L K S - V M P L L V D T Q H V T A T T F W P S H R - C L C W L T L N M - P P P H F . . . . . . 19020 GCATTCCCTTGAAACTGATAACTCACGAACTCAACACCAAACCGTTCTACTATACCCATC A F P - N - - L T N S T P N R S T I P I H S L E T D N S R T Q H Q T V L L Y P S G I P L K L I T H E L N T K P F Y Y T H . . . . . . 18960 TTGTGTAGTAGCTCATGACAGTCAACCAGAAAATCGTAATCATCCTCAGATTCAGCACCC L C S S S - Q S T R K S - S S S D S A P C V V A H D S Q P E N R N H P Q I Q H P L V - - L M T V N Q K I V I I L R F S T . . . . . . 18900 TTAAAGACTAGAGGTTTCAATTTCAAGAACTTACTGAAAAGTTCATGTTGATCACTTGTC L K T R G F N F K N L L K S S C - S L V - R L E V S I S R T Y - K V H V D H L S L K D - R F Q F Q E L T E K F M L I T C . . . . . . 18840 ATTATAGGCCCTGTAGTCAGACGAGGAAATGTGCCTATTTCCAATGGAACATCCATGCAA I I G P V V R R G N V P I S N G T S M Q L - A L - S D E E M C L F P M E H P C K H Y R P C S Q T R K C A Y F Q W N I H A . . . . . . 18780 GGAGCCATAGTAGCCGCACGTTGTACCTCCGGAGCCTGAGGTGCTGGTGCAGAAAACACT G A I V A A R C T S G A - G A G A E N T E P - - P H V V P P E P E V L V Q K T L R S H S S R T L Y L R S L R C W C R K H . . . . . . 18720 GGAGGTGCCTGACCCTGATCAGATAACCCGCTAAGATAAGCAAGAACCTGATTGATCATC G G A - P - S D N P L R - A R T - L I I E V P D P D Q I T R - D K Q E P D - S S W R C L T L I R - P A K I S K N L I D H . . . . . . 18660 TCTGGGGTAGGTTGGGGTGGCAATTCCTCATTCTGTACTTGTTCAGTTTCCCCTTCCTCA S G V G W G G N S S F C T C S V S P S S L G - V G V A I P H S V L V Q F P L P H L W G R L G W Q F L I L Y L F S F P F L . . . . . . 18600 CCCTTTCTTACTACTTCTTCAGTCGGTGGAGGAGTCACTTCCCTAGTATCAGATGGGCTA P F L T T S S V G G G V T S L V S D G L P F L L L L Q S V E E S L P - Y Q M G - T L S Y Y F F S R W R S H F P S I R W A . . . . . . 18540 GGTGCTCGTCCTCTTCCTCTAGAGGACGTCCTCCCATGACCTCTCCCAAGGCCTCTTGCC G A R P L P L E D V L P - P L P R P L A V L V L F L - R T S S H D L S Q G L L P R C S S S S S R G R P P M T S P K A S C . 18480 GTTGTTCT V V L F R C S Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-12_PPS_1 (19923 19486) (frame '1'; 435 bp, 145 residues) 1 GRYIRKCGSG IKQYRSHAIT NQKITCDDSI RCLHLRSPRE IITMGPFICL SVALTMLWCS 61 GSSFPITSAV LVTTITSTTT SSRITASTMT TSTSSYWGSI TLFRTIPPNM PSLPTSITLS 121 RVKHRSLRKV LAGLRWTPTT VCSED- >C01HBa0088L02.1-_PGL-1_AGS-12_PPS_2 (20453 20208) (frame '2'; 243 bp, 81 residues) 1 GGIEMGRVPG SRSMQKSISL SGGIPGRSAG NTSKNSRTTE TDSIEGTWVV SSLRWAKKAK 61 HPLLTIFLAR RKEMIRTGLE V- >C01HBa0088L02.1-_PGL-1_AGS-12_PPS_3 (20916 20677) (frame '1'; 237 bp, 79 residues) 1 VYQYIINKYN HEEVQIWLKN PVYQPHECSR GIRKTKRHHH KFVMPIPCSK SSLWHIRCPY 61 FQLMITRSQV NLREDTSTL- >C01HBa0088L02.1-_PGL-1_AGS-12_PPS_4 (19440 19204) (frame '1'; 234 bp, 78 residues) 1 EPLNSPPFRN LFDVDAMVNS SGFTPSTSTT KSTTSWKDFA VAATCKAEIR SSDLNPFTKR 61 RIRSCGLKQS WVAYLDSA- >C01HBa0088L02.1-_PGL-1_AGS-12_PPS_5 (18694 18473) (frame '0'; 222 bp, 74 residues) 1 PAKISKNLID HLWGRLGWQF LILYLFSFPF LTLSYYFFSR WRSHFPSIRW ARCSSSSSRG 61 RPPMTSPKAS CRCS >C01HBa0088L02.1-_PGL-1_AGS-12_PPS_6 (18889 18695) (frame '0'; 192 bp, 64 residues) 1 RFQFQELTEK FMLITCHYRP CSQTRKCAYF QWNIHARSHS SRTLYLRSLR CWCRKHWRCL 61 TLIR- 3-phase translation of AGS-12 (+strand): . . . . . . 18473 AGAACAACGGCAAGAGGCCTTGGGAGAGGTCATGGGAGGACGTCCTCTAGAGGAAGAGGA R T T A R G L G R G H G R T S S R G R G E Q R Q E A L G E V M G G R P L E E E D N N G K R P W E R S W E D V L - R K R . . . . . . 18533 CGAGCACCTAGCCCATCTGATACTAGGGAAGTGACTCCTCCACCGACTGAAGAAGTAGTA R A P S P S D T R E V T P P P T E E V V E H L A H L I L G K - L L H R L K K - - T S T - P I - Y - G S D S S T D - R S S . . . . . . 18593 AGAAAGGGTGAGGAAGGGGAAACTGAACAAGTACAGAATGAGGAATTGCCACCCCAACCT R K G E E G E T E Q V Q N E E L P P Q P E R V R K G K L N K Y R M R N C H P N L K K G - G R G N - T S T E - G I A T P T . . . . . . 18653 ACCCCAGAGATGATCAATCAGGTTCTTGCTTATCTTAGCGGGTTATCTGATCAGGGTCAG T P E M I N Q V L A Y L S G L S D Q G Q P Q R - S I R F L L I L A G Y L I R V R Y P R D D Q S G S C L S - R V I - S G S . . . . . . 18713 GCACCTCCAGTGTTTTCTGCACCAGCACCTCAGGCTCCGGAGGTACAACGTGCGGCTACT A P P V F S A P A P Q A P E V Q R A A T H L Q C F L H Q H L R L R R Y N V R L L G T S S V F C T S T S G S G G T T C G Y . . . . . . 18773 ATGGCTCCTTGCATGGATGTTCCATTGGAAATAGGCACATTTCCTCGTCTGACTACAGGG M A P C M D V P L E I G T F P R L T T G W L L A W M F H W K - A H F L V - L Q G Y G S L H G C S I G N R H I S S S D Y R . . . . . . 18833 CCTATAATGACAAGTGATCAACATGAACTTTTCAGTAAGTTCTTGAAATTGAAACCTCTA P I M T S D Q H E L F S K F L K L K P L L - - Q V I N M N F S V S S - N - N L - A Y N D K - S T - T F Q - V L E I E T S . . . . . . 18893 GTCTTTAAGGGTGCTGAATCTGAGGATGATTACGATTTTCTGGTTGACTGTCATGAGCTA V F K G A E S E D D Y D F L V D C H E L S L R V L N L R M I T I F W L T V M S Y S L - G C - I - G - L R F S G - L S - A . . . . . . 18953 CTACACAAGATGGGTATAGTAGAACGGTTTGGTGTTGAGTTCGTGAGTTATCAGTTTCAA L H K M G I V E R F G V E F V S Y Q F Q Y T R W V - - N G L V L S S - V I S F K T T Q D G Y S R T V W C - V R E L S V S . . . . . . 19013 GGGAATGCCAAAATGTGGTGGCGGTCACATGTTGAGTGTCAACCAACAGAGGCATCACCT G N A K M W W R S H V E C Q P T E A S P G M P K C G G G H M L S V N Q Q R H H L R E C Q N V V A V T C - V S T N R G I T . . . . . . 19073 ATGACTTGGGCCTCATTCTCTAGCTTGTTTATGGAGAAGTATATCCCCCGAACTTTGAGG M T W A S F S S L F M E K Y I P R T L R - L G P H S L A C L W R S I S P E L - G Y D L G L I L - L V Y G E V Y P P N F E . . . . . . 19133 GATAGGAAAAGGGATGAGTTCTTGAGCCTAGAGAAAGGTAGGATGTTGGTCAATGCATAT D R K R D E F L S L E K G R M L V N A Y I G K G M S S - A - R K V G C W S M H M G - E K G - V L E P R E R - D V G Q C I . . . . . . 19193 GAGGCTAAGTTTCATGCACTATCCAGATATGCCACCCAACTTTGTTTCAGTCCACAAGAG E A K F H A L S R Y A T Q L C F S P Q E R L S F M H Y P D M P P N F V S V H K S - G - V S C T I Q I C H P T L F Q S T R . . . . . . 19253 CGGATTCGTCGTTTTGTGAAGGGGTTGAGGTCAGAGCTGCGGATTTCAGCCTTACAGGTA R I R R F V K G L R S E L R I S A L Q V G F V V L - R G - G Q S C G F Q P Y R - A D S S F C E G V E V R A A D F S L T G . . . . . . 19313 GCGGCTACGGCAAAATCCTTCCAAGAAGTGGTAGATTTCGTGGTAGAGGTGGAAGGAGTG A A T A K S F Q E V V D F V V E V E G V R L R Q N P S K K W - I S W - R W K E - S G Y G K I L P R S G R F R G R G G R S . . . . . . 19373 AAGCCAGATGAATTCACCATGGCATCGACATCAAAGAGGTTTCGAAAGGGAGGTGAGTTT K P D E F T M A S T S K R F R K G G E F S Q M N S P W H R H Q R G F E R E V S L E A R - I H H G I D I K E V S K G R - V . . . . . . 19433 AATGGTTCTTACTTTAGAGGACAGGGTTCCGGAGGTTACTCAGTTCGACCAATTCAGTCT N G S Y F R G Q G S G G Y S V R P I Q S M V L T L E D R V P E V T Q F D Q F S L - W F L L - R T G F R R L L S S T N S V . . . . . . 19493 TCACTACAGACTGTAGTGGGGGTCCACCTCAGACCGGCCAACACTTTTCTGAGAGACCTA S L Q T V V G V H L R P A N T F L R D L H Y R L - W G S T S D R P T L F - E T Y F T T D C S G G P P Q T G Q H F S E R P . . . . . . 19553 TGCTTGACTCTAGAGAGTGTTATGGATGTGGGGAGACTGGGCATATTAGGAGGAATTGTC C L T L E S V M D V G R L G I L G G I V A - L - R V L W M W G D W A Y - E E L S M L D S R E C Y G C G E T G H I R R N C . . . . . . 19613 CTAAACAGAGTTATAGACCCCCAATAGCTAGAGGTAGAGGTGGTCATGGTAGAGGCCGTT L N R V I D P Q - L E V E V V M V E A V - T E L - T P N S - R - R W S W - R P L P K Q S Y R P P I A R G R G G H G R G R . . . . . . 19673 ATTCTGGAGGACGTGGTGGTCGAGGTAATGGTGGTCACCAAAACGGCAGAGGTGATGGGA I L E D V V V E V M V V T K T A E V M G F W R T W W S R - W W S P K R Q R - W E Y S G G R G G R G N G G H Q N G R G D G . . . . . . 19733 AAACTAGAGCCACTACACCACAACATGGTAAGGGCAACGGACAAACAAATGAAAGGGCCC K L E P L H H N M V R A T D K Q M K G P N - S H Y T T T W - G Q R T N K - K G P K T R A T T P Q H G K G N G Q T N E R A . . . . . . 19793 ATTGTTATGATTTCCCTGGGAGATCTGAGGTGGAGACATCTGATGCTGTCATCACAGGTA I V M I S L G D L R W R H L M L S S Q V L L - F P W E I - G G D I - C C H H R - H C Y D F P G R S E V E T S D A V I T G . . . . . . 19853 ATCTTTTGGTTTGTGATTGCATGGCTTCTGTATTGTTTGATCCCGGATCCACATTTTCTT I F W F V I A W L L Y C L I P D P H F L S F G L - L H G F C I V - S R I H I F L N L L V C D C M A S V L F D P G S T F S . . . . . . 19913 ATGTATCTTCCTCATTTGCTAATGGTCTTAATTTACATTGTGAATTACTTGACATGCCTA M Y L P H L L M V L I Y I V N Y L T C L C I F L I C - W S - F T L - I T - H A Y Y V S S S F A N G L N L H C E L L D M P . . . . . . 19973 TTCGTGTTTCTACCCCGATGGGTGAGTCTGTGATAGTTGAAAAAGTGTATAGGTCTTGTT F V F L P R W V S L - - L K K C I G L V S C F Y P D G - V C D S - K S V - V L F I R V S T P M G E S V I V E K V Y R S C . . . . . . 20033 TGGTGACTTTTGTAGGGAGTAACACTTATGTAGATTTGGTTATCTTAGAAATGGTTGACT W - L L - G V T L M - I W L S - K W L T G D F C R E - H L C R F G Y L R N G - L L V T F V G S N T Y V D L V I L E M V D . . . . . . 20093 TTGATGTAATTCTGCGTATGACTTGGCTTTCTCCGAATTTTGCGATCTTGGATTGTAATG L M - F C V - L G F L R I L R S W I V M - C N S A Y D L A F S E F C D L G L - C F D V I L R M T W L S P N F A I L D C N . . . . . . 20153 CTAAAATGGTGACGTTAGCCAAGCCTAGGACAGACCCGTTAGTGTGGGAGGGTGACTACA L K W - R - P S L G Q T R - C G R V T T - N G D V S Q A - D R P V S V G G - L H A K M V T L A K P R T D P L V W E G D Y . . . . . . 20213 CTTCCAATCCGGTGCGTATCATCTCCTTTCTTCGTGCTAAGAAAATGGTTAGTAAAGGGT L P I R C V S S P F F V L R K W L V K G F Q S G A Y H L L S S C - E N G - - R V T S N P V R I I S F L R A K K M V S K G . . . . . . 20273 GTTTAGCTTTCTTGGCCCATCTCAAGGATGACACTACCCAAGTACCTTCGATTGAGTCGG V - L S W P I S R M T L P K Y L R L S R F S F L G P S Q G - H Y P S T F D - V G C L A F L A H L K D D T T Q V P S I E S . . . . . . 20333 TTTCGGTAGTCCGCGAGTTTTTGGATGTGTTCCCTGCAGATCTTCCTGGTATGCCACCAG F R - S A S F W M C S L Q I F L V C H Q F G S P R V F G C V P C R S S W Y A T R V S V V R E F L D V F P A D L P G M P P . . . . . . 20393 ATAGGGATATTGACTTCTGCATTGATCTTGAACCGGGCACTCGCCCCATTTCTATACCCC I G I L T S A L I L N R A L A P F L Y P - G Y - L L H - S - T G H S P H F Y T P D R D I D F C I D L E P G T R P I S I P . . . . . . 20453 CTTATAGAATGGCTCCCGCGGAGTTGAGAGAGTTAAAGGCCCAACTTCAAGAGTTGTTGA L I E W L P R S - E S - R P N F K S C - L - N G S R G V E R V K G P T S R V V E P Y R M A P A E L R E L K A Q L Q E L L . . . . . . 20513 ACAAAGGCTTCATCAGACCAAGTGCATCTCCTTGGGGTGCTCCGGTTTTGTTTGTGAAGA T K A S S D Q V H L L G V L R F C L - R Q R L H Q T K C I S L G C S G F V C E E N K G F I R P S A S P W G A P V L F V K . . . . . . 20573 AGAAGGATGGGAGTTTTCGGATGTGCATAGACTACAGACAACTGAATAAGGTAACTATTA R R M G V F G C A - T T D N - I R - L L E G W E F S D V H R L Q T T E - G N Y - K K D G S F R M C I D Y R Q L N K V T I . . . . . . 20633 AGAACAAGTATCCTTTTCCTCGCATTGATGACTTGTTCAATCAATTACAAGGTGCTTGTG R T S I L F L A L M T C S I N Y K V L V E Q V S F S S H - - L V Q S I T R C L C K N K Y P F P R I D D L F N Q L Q G A C . . . . . . 20693 TCTTCTCTAAGATTGACTTGAGATCTGGTTATCATCAATTGAAAATACGGGCAACGGATG S S L R L T - D L V I I N - K Y G Q R M L L - D - L E I W L S S I E N T G N G C V F S K I D L R S G Y H Q L K I R A T D . . . . . . 20753 TGCCAAAGACTGCTTTTCGAACAAGGTATGGGCATTACGAATTTGTGGTGATGTCTTTTG C Q R L L F E Q G M G I T N L W - C L L A K D C F S N K V W A L R I C G D V F W V P K T A F R T R Y G H Y E F V V M S F . . . . . . 20813 GTCTTACGAATGCCCCTGCTGCATTCATGAGGTTGATAAACGGGATTTTTAAGCCATATT V L R M P L L H S - G - - T G F L S H I S Y E C P C C I H E V D K R D F - A I F G L T N A P A A F M R L I N G I F K P Y . . . . . . 20873 TGGACCTCTTCGTGATTGTATTTATTGATGATATATTGGTATACTCAAAGAGCAAGAAGG W T S S - L Y L L M I Y W Y T Q R A R R G P L R D C I Y - - Y I G I L K E Q E G L D L F V I V F I D D I L V Y S K S K K . . . . . . 20933 AACATGAAGAGCATTTGAGAATGGTATTGGAAATGTTGAGGGAGAAAAAGCTTTATGCCA N M K S I - E W Y W K C - G R K S F M P T - R A F E N G I G N V E G E K A L C Q E H E E H L R M V L E M L R E K K L Y A . . . . . . 20993 AGTTCTCTAAGTGTGAGTTTTGGCTAGATGCAGTGTCCTTCTTGGGGCACGTGGTTTCTA S S L S V S F G - M Q C P S W G T W F L V L - V - V L A R C S V L L G A R G F - K F S K C E F W L D A V S F L G H V V S . . . . . . 21053 AGGAAGGAGTGATGGTGGATCCTTCTAAGATTGAGACAGTGAAGAATTGGGTAAGACCCA R K E - W W I L L R L R Q - R I G - D P G R S D G G S F - D - D S E E L G K T H K E G V M V D P S K I E T V K N W V R P . . . . . . 21113 CTAATGTGTCAGAAATAAGGAGCTTTGTTGGGTTAGCTAGCTACTACCGCTGATTTGTCA L M C Q K - G A L L G - L A T T A D L S - C V R N K E L C W V S - L L P L I C Q T N V S E I R S F V G L A S Y Y R - F V . 21173 AAGGATTC K D R I K G F Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-1_AGS-12_PPS_1 (19450 21165) (frame '0'; 1713 bp, 571 residues) 1 RTGFRRLLSS TNSVFTTDCS GGPPQTGQHF SERPMLDSRE CYGCGETGHI RRNCPKQSYR 61 PPIARGRGGH GRGRYSGGRG GRGNGGHQNG RGDGKTRATT PQHGKGNGQT NERAHCYDFP 121 GRSEVETSDA VITGNLLVCD CMASVLFDPG STFSYVSSSF ANGLNLHCEL LDMPIRVSTP 181 MGESVIVEKV YRSCLVTFVG SNTYVDLVIL EMVDFDVILR MTWLSPNFAI LDCNAKMVTL 241 AKPRTDPLVW EGDYTSNPVR IISFLRAKKM VSKGCLAFLA HLKDDTTQVP SIESVSVVRE 301 FLDVFPADLP GMPPDRDIDF CIDLEPGTRP ISIPPYRMAP AELRELKAQL QELLNKGFIR 361 PSASPWGAPV LFVKKKDGSF RMCIDYRQLN KVTIKNKYPF PRIDDLFNQL QGACVFSKID 421 LRSGYHQLKI RATDVPKTAF RTRYGHYEFV VMSFGLTNAP AAFMRLINGI FKPYLDLFVI 481 VFIDDILVYS KSKKEHEEHL RMVLEMLREK KLYAKFSKCE FWLDAVSFLG HVVSKEGVMV 541 DPSKIETVKN WVRPTNVSEI RSFVGLASYY R- AGS-13 (20608 20083,19339 19167) SCR (e 0.922 d 0.000 a 0.000,e 0.954) Exon 1 20608 20083 ( 526 n); score: 0.922 Intron 1 20082 19340 ( 743 n); Pd: 0.000 Pa: 0.000 Exon 2 19339 19167 ( 173 n); score: 0.954 PGS (20608 20083,19339 19167) SGN-E353359+ 3-phase translation of AGS-13 (-strand): . . . . . . 20608 TGTAGTCTATGCACATCCGAAAACTCCCATCCTTCTTCTTCACAAACAAAACCGGAGCAC C S L C T S E N S H P S S S Q T K P E H V V Y A H P K T P I L L L H K Q N R S T - S M H I R K L P S F F F T N K T G A . . . . . . 20548 CCCAAGGAGATGCACTTGGTCTGATGAAGCCTTTGTTCAACAACTCTTGAAGTTGGGCCT P K E M H L V - - S L C S T T L E V G P P R R C T W S D E A F V Q Q L L K L G L P Q G D A L G L M K P L F N N S - S W A . . . . . . 20488 TTAACTCTCTCAACTCCGCGGGAGCCATTCTATAAGGGGGTATAGAAATGGGGCGAGTGC L T L S T P R E P F Y K G V - K W G E C - L S Q L R G S H S I R G Y R N G A S A F N S L N S A G A I L - G G I E M G R V . . . . . . 20428 CCGGTTCAAGATCAATGCAGAAGTCAATATCCCTATCTGGTGGCATACCAGGAAGATCTG P V Q D Q C R S Q Y P Y L V A Y Q E D L R F K I N A E V N I P I W W H T R K I C P G S R S M Q K S I S L S G G I P G R S . . . . . . 20368 CAGGGAACACATCCAAAAACTCGCGGACTACCGAAACCGACTCAATCGAAGGTACTTGGG Q G T H P K T R G L P K P T Q S K V L G R E H I Q K L A D Y R N R L N R R Y L G A G N T S K N S R T T E T D S I E G T W . . . . . . 20308 TAGTGTCATCCTTGAGATGGGCCAAGAAAGCTAAACACCCTTTACTAACCATTTTCTTAG - C H P - D G P R K L N T L Y - P F S - S V I L E M G Q E S - T P F T N H F L S V V S S L R W A K K A K H P L L T I F L . . . . . . 20248 CACGAAGAAAGGAGATGATACGCACCGGATTGGAAGTGTAGTCACCCTCCCACACTAACG H E E R R - Y A P D W K C S H P P T L T T K K G D D T H R I G S V V T L P H - R A R R K E M I R T G L E V - S P S H T N . . . . . . 20188 GGTCTGTCCTAGGCTTGGCTAACGTCACCATTTTAGCATTACAATCCAAGATCGCAAAAT G L S - A W L T S P F - H Y N P R S Q N V C P R L G - R H H F S I T I Q D R K I G S V L G L A N V T I L A L Q S K I A K . . . . . : . 20128 TCGGAGAAAGCCAAGTCATACGCAGAATTACATCAAAGTCAACCAT : TTCTTGGAAGGATT S E K A K S Y A E L H Q S Q P : F L G R I R R K P S H T Q N Y I K V N H : F L E G F F G E S Q V I R R I T S K S T I : S W K D . . . . . . 19325 TTGCCGTAGCCGCTACCTGTAAGGCTGAAATCCGCAGCTCTGACCTCAACCCCTTCACAA L P - P L P V R L K S A A L T S T P S Q C R S R Y L - G - N P Q L - P Q P L H K F A V A A T C K A E I R S S D L N P F T . . . . . . 19265 AACGACGAATCCGCTCTTGTGGACTGAAACAAAGTTGGGTGGCATATCTGGATAGTGCAT N D E S A L V D - N K V G W H I W I V H T T N P L L W T E T K L G G I S G - C M K R R I R S C G L K Q S W V A Y L D S A . . . . 19205 GAAACTTAGCCTCATATGCATTGACCAACATCCTACCTT E T - P H M H - P T S Y L K L S L I C I D Q H P T - N L A S Y A L T N I L P Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-13_PPS_1 (20207 20083,19339 19204) (frame '0'; 258 bp, 86 residues) 1 SPSHTNGSVL GLANVTILAL QSKIAKFGES QVIRRITSKS TISWKDFAVA ATCKAEIRSS 61 DLNPFTKRRI RSCGLKQSWV AYLDSA- >C01HBa0088L02.1-_PGL-1_AGS-13_PPS_2 (20453 20208) (frame '0'; 243 bp, 81 residues) 1 GGIEMGRVPG SRSMQKSISL SGGIPGRSAG NTSKNSRTTE TDSIEGTWVV SSLRWAKKAK 61 HPLLTIFLAR RKEMIRTGLE V- AGS-14 (19999 19970,19934 19405) SCR (e 0.633 d 0.769 a 0.000,e 0.899) Exon 1 19999 19970 ( 30 n); score: 0.633 Intron 1 19969 19935 ( 35 n); Pd: 0.769 Pa: 0.000 Exon 2 19934 19405 ( 530 n); score: 0.899 PGS (19999 19970,19934 19405) SGN-E577713+ 3-phase translation of AGS-14 (-strand): . . . : . . . 19999 ACTCACCCATCGGGGTAGAAACACGAATAG : TTAGCAAATGAGGAAGATACATAAGAAAAT T H P S G - K H E - : L A N E E D T - E N L T H R G R N T N S : - Q M R K I H K K M S P I G V E T R I : V S K - G R Y I R K . . . . . . 19904 GTGGATCCGGGATCAAACAATACAGAAGCCATGCAATCACAAACCAAAAGATTACCTGTG V D P G S N N T E A M Q S Q T K R L P V W I R D Q T I Q K P C N H K P K D Y L - C G S G I K Q Y R S H A I T N Q K I T C . . . . . . 19844 ATGACAGCATCAGATGTCTCCACCTCAGATCTCCCAGGGAAATCATAACAATGGGCCCTT M T A S D V S T S D L P G K S - Q W A L - Q H Q M S P P Q I S Q G N H N N G P F D D S I R C L H L R S P R E I I T M G P . . . . . . 19784 TCATTTGTTTGTCCGTTGCCCTTACCATGTTGTGGTGTAGTGGCTCTAGTTTTCCCATCA S F V C P L P L P C C G V V A L V F P S H L F V R C P Y H V V V - W L - F S H H F I C L S V A L T M L W C S G S S F P I . . . . . . 19724 CCTCTGCCGTTTTGGTGACCACCATTACCTCGACCACCACGTCCTCCAGAATAACGGCCT P L P F W - P P L P R P P R P P E - R P L C R F G D H H Y L D H H V L Q N N G L T S A V L V T T I T S T T T S S R I T A . . . . . . 19664 CTACCATGACCACCTCTACCTCTAGCTATTGGGGGTCTATAACTCTGTTTAGGACAATTC L P - P P L P L A I G G L - L C L G Q F Y H D H L Y L - L L G V Y N S V - D N S S T M T T S T S S Y W G S I T L F R T I . . . . . . 19604 CTCCTAATATGCCCAGTCTCCCCACATCCATAACACTCTCTAGAGTCAAGCATAGGTCTC L L I C P V S P H P - H S L E S S I G L S - Y A Q S P H I H N T L - S Q A - V S P P N M P S L P T S I T L S R V K H R S . . . . . . 19544 TCAGAAAAGTGTTGGCCGGTCTGAGGTGGACCCCCACTACAGTCTGTAGTGAAGACTGAA S E K C W P V - G G P P L Q S V V K T E Q K S V G R S E V D P H Y S L - - R L N L R K V L A G L R W T P T T V C S E D - . . . . . . 19484 TTGGTCGAACTGAGTAACCTCCGGAACCCTGTCCTCTAAAGTAAGAACCATTAAACTCAC L V E L S N L R N P V L - S K N H - T H W S N - V T S G T L S S K V R T I K L T I G R T E - P P E P C P L K - E P L N S . . 19424 CTCCCTTTCGAAACCTCTTT L P F E T S S L S K P L P P F R N L F Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-14_PPS_1 (19923 19486) (frame '0'; 435 bp, 145 residues) 1 GRYIRKCGSG IKQYRSHAIT NQKITCDDSI RCLHLRSPRE IITMGPFICL SVALTMLWCS 61 GSSFPITSAV LVTTITSTTT SSRITASTMT TSTSSYWGSI TLFRTIPPNM PSLPTSITLS 121 RVKHRSLRKV LAGLRWTPTT VCSED- AGS-15 (22434 21409) SCR (e 0.879) Exon 1 22434 21409 (1026 n); score: 0.879 PGS (21994 21409) SGN-E352950+ PGS (21994 21409) SGN-E357100+ PGS (21994 21442) SGN-E352647+ PGS (22434 21898) SGN-E353207+ PGS (22409 22124) SGN-E578131+ 3-phase translation of AGS-15 (-strand): . . . . . . 22434 ATGCAATGTTTTCCAAAACTTAGAAGTAAACTGCGTACCTCTATCTGATATGATGGATAG M Q C F P K L R S K L R T S I - Y D G - C N V F Q N L E V N C V P L S D M M D S A M F S K T - K - T A Y L Y L I - W I . . . . . . 22374 TGGAACCCCATGCAATCGAACGATTTCTGAGATATAGATCTTGGCTAACTTCTCGGCATT W N P M Q S N D F - D I D L G - L L G I G T P C N R T I S E I - I L A N F S A L V E P H A I E R F L R Y R S W L T S R H . . . . . . 22314 GTAAGTCACCTTAACCGGAACGAAATGAGCAGACTTAGTTAACCTATCAACAATCACCCA V S H L N R N E M S R L S - P I N N H P - V T L T G T K - A D L V N L S T I T Q C K S P - P E R N E Q T - L T Y Q Q S P . . . . . . 22254 AATGGAGTCATACTTACCCATCGTCTTTGGAAGACCAACCACGAAGTCCATTGCGATTCT N G V I L T H R L W K T N H E V H C D S M E S Y L P I V F G R P T T K S I A I L K W S H T Y P S S L E D Q P R S P L R F . . . . . . 22194 ATCCCATTTCCATTCCGGAATGGGCATCCTCTGAAGTGTTCCTCCGGGCCTTTGGTGTTC I P F P F R N G H P L K C S S G P L V F S H F H S G M G I L - S V P P G L W C S Y P I S I P E W A S S E V F L R A F G V . . . . . . 22134 ATACTTTACTTGTTGACAGTTTGGACATTTGGCAATAAAATCTACAATATCACGCTTCAT I L Y L L T V W T F G N K I Y N I T L H Y F T C - Q F G H L A I K S T I S R F I H T L L V D S L D I W Q - N L Q Y H A S . . . . . . 22074 TCTACTCCACCAAAAGTGTTGCTTTAGGTCACGGTACATCTTGGTTGCACCCGGATGTAT S T P P K V L L - V T V H L G C T R M Y L L H Q K C C F R S R Y I L V A P G C I F Y S T K S V A L G H G T S W L H P D V . . . . . . 22014 TGAATACCTTGAACTATGAGCCTTTGTCAGAATGGAGTTGATCAAATCATCGACGCGGGG - I P - T M S L C Q N G V D Q I I D A G E Y L E L - A F V R M E L I K S S T R G L N T L N Y E P L S E W S - S N H R R G . . . . . . 21954 TACACATACCCTTCCCTTAATCCTCAAAACACCTTCCTCATCGATCGTCGCTTCTTTAGC Y T Y P S L N P Q N T F L I D R R F F S T H T L P L I L K T P S S S I V A S L A V H I P F P - S S K H L P H R S S L L - . . . . . . 21894 CTCTCCTCGCAACACTTTATCTCGGATCCGGATCAATTTTTCATCATTAAACTGCTTTCC L S S Q H F I S D P D Q F F I I K L L S S P R N T L S R I R I N F S S L N C F P P L L A T L Y L G S G S I F H H - T A F . . . . . . 21834 CTTAATCTTGTCAAGGAAGGAAGATCTTGCCTCCACACAAGCTAAAAGTCCTCCCTTCTC L N L V K E G R S C L H T S - K S S L L L I L S R K E D L A S T Q A K S P P F S P - S C Q G R K I L P P H K L K V L P S . . . . . . 21774 ATTTACTTCTAATCTCATAAGGTCGTTAGCCAGAATCTGAACTTCTCTAGCCAATGGGCG I Y F - S H K V V S Q N L N F S S Q W A F T S N L I R S L A R I - T S L A N G R H L L L I S - G R - P E S E L L - P M G . . . . . . 21714 TCTAGAAGCTTGCAAGTGAGCTAGACTTCCCATGCTTCCCGCCTTTCTACTTAAAGCATC S R S L Q V S - T S H A S R L S T - S I L E A C K - A R L P M L P A F L L K A S V - K L A S E L D F P C F P P F Y L K H . . . . . . 21654 CGCTACAACATTCGCCTTCCCCGGATGATACAAAATAGTGATGTCGTAGTTCTTCAGTAG R Y N I R L P R M I Q N S D V V V L Q - A T T F A F P G - Y K I V M S - F F S S P L Q H S P S P D D T K - - C R S S S V . . . . . . 21594 TTCCATCCATCTCCTCTGTCTCAAGTTCAAATCTTTCTGAGTAAAGACATACTGTAGGCT F H P S P L S Q V Q I F L S K D I L - A S I H L L C L K F K S F - V K T Y C R L V P S I S S V S S S N L S E - R H T V G . . . . . . 21534 ACGATGATCCGTGTAGACCTCACACTTAACCCCATATAAATAGTGTCTCCATTGCTTTAA T M I R V D L T L N P I - I V S P L L - R - S V - T S H L T P Y K - C L H C F N Y D D P C R P H T - P H I N S V S I A L . . . . . . 21474 TGCAAACAATACCGCAGCCAATTCCAAATCATGAGTTGGATAGTTACGTTAATGCACCTT C K Q Y R S Q F Q I M S W I V T L M H L A N N T A A N S K S - V G - L R - C T F M Q T I P Q P I P N H E L D S Y V N A P . 21414 TAATTG - L N L I Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-15_PPS_1 (21995 21735) (frame '2'; 258 bp, 86 residues) 1 AFVRMELIKS STRGTHTLPL ILKTPSSSIV ASLASPRNTL SRIRINFSSL NCFPLILSRK 61 EDLASTQAKS PPFSFTSNLI RSLARI- >C01HBa0088L02.1-_PGL-1_AGS-15_PPS_2 (22272 22048) (frame '1'; 222 bp, 74 residues) 1 PINNHPNGVI LTHRLWKTNH EVHCDSIPFP FRNGHPLKCS SGPLVFILYL LTVWTFGNKI 61 YNITLHSTPP KVLL- 3-phase translation of AGS-15 (+strand): . . . . . . 21409 CAATTAAAGGTGCATTAACGTAACTATCCAACTCATGATTTGGAATTGGCTGCGGTATTG Q L K V H - R N Y P T H D L E L A A V L N - R C I N V T I Q L M I W N W L R Y C I K G A L T - L S N S - F G I G C G I . . . . . . 21469 TTTGCATTAAAGCAATGGAGACACTATTTATATGGGGTTAAGTGTGAGGTCTACACGGAT F A L K Q W R H Y L Y G V K C E V Y T D L H - S N G D T I Y M G L S V R S T R I V C I K A M E T L F I W G - V - G L H G . . . . . . 21529 CATCGTAGCCTACAGTATGTCTTTACTCAGAAAGATTTGAACTTGAGACAGAGGAGATGG H R S L Q Y V F T Q K D L N L R Q R R W I V A Y S M S L L R K I - T - D R G D G S S - P T V C L Y S E R F E L E T E E M . . . . . . 21589 ATGGAACTACTGAAGAACTACGACATCACTATTTTGTATCATCCGGGGAAGGCGAATGTT M E L L K N Y D I T I L Y H P G K A N V W N Y - R T T T S L F C I I R G R R M L D G T T E E L R H H Y F V S S G E G E C . . . . . . 21649 GTAGCGGATGCTTTAAGTAGAAAGGCGGGAAGCATGGGAAGTCTAGCTCACTTGCAAGCT V A D A L S R K A G S M G S L A H L Q A - R M L - V E R R E A W E V - L T C K L C S G C F K - K G G K H G K S S S L A S . . . . . . 21709 TCTAGACGCCCATTGGCTAGAGAAGTTCAGATTCTGGCTAACGACCTTATGAGATTAGAA S R R P L A R E V Q I L A N D L M R L E L D A H W L E K F R F W L T T L - D - K F - T P I G - R S S D S G - R P Y E I R . . . . . . 21769 GTAAATGAGAAGGGAGGACTTTTAGCTTGTGTGGAGGCAAGATCTTCCTTCCTTGACAAG V N E K G G L L A C V E A R S S F L D K - M R R E D F - L V W R Q D L P S L T R S K - E G R T F S L C G G K I F L P - Q . . . . . . 21829 ATTAAGGGAAAGCAGTTTAATGATGAAAAATTGATCCGGATCCGAGATAAAGTGTTGCGA I K G K Q F N D E K L I R I R D K V L R L R E S S L M M K N - S G S E I K C C E D - G K A V - - - K I D P D P R - S V A . . . . . . 21889 GGAGAGGCTAAAGAAGCGACGATCGATGAGGAAGGTGTTTTGAGGATTAAGGGAAGGGTA G E A K E A T I D E E G V L R I K G R V E R L K K R R S M R K V F - G L R E G Y R R G - R S D D R - G R C F E D - G K G . . . . . . 21949 TGTGTACCCCGCGTCGATGATTTGATCAACTCCATTCTGACAAAGGCTCATAGTTCAAGG C V P R V D D L I N S I L T K A H S S R V Y P A S M I - S T P F - Q R L I V Q G M C T P R R - F D Q L H S D K G S - F K . . . . . . 22009 TATTCAATACATCCGGGTGCAACCAAGATGTACCGTGACCTAAAGCAACACTTTTGGTGG Y S I H P G A T K M Y R D L K Q H F W W I Q Y I R V Q P R C T V T - S N T F G G V F N T S G C N Q D V P - P K A T L L V . . . . . . 22069 AGTAGAATGAAGCGTGATATTGTAGATTTTATTGCCAAATGTCCAAACTGTCAACAAGTA S R M K R D I V D F I A K C P N C Q Q V V E - S V I L - I L L P N V Q T V N K - E - N E A - Y C R F Y C Q M S K L S T S . . . . . . 22129 AAGTATGAACACCAAAGGCCCGGAGGAACACTTCAGAGGATGCCCATTCCGGAATGGAAA K Y E H Q R P G G T L Q R M P I P E W K S M N T K G P E E H F R G C P F R N G N K V - T P K A R R N T S E D A H S G M E . . . . . . 22189 TGGGATAGAATCGCAATGGACTTCGTGGTTGGTCTTCCAAAGACGATGGGTAAGTATGAC W D R I A M D F V V G L P K T M G K Y D G I E S Q W T S W L V F Q R R W V S M T M G - N R N G L R G W S S K D D G - V - . . . . . . 22249 TCCATTTGGGTGATTGTTGATAGGTTAACTAAGTCTGCTCATTTCGTTCCGGTTAAGGTG S I W V I V D R L T K S A H F V P V K V P F G - L L I G - L S L L I S F R L R - L H L G D C - - V N - V C S F R S G - G . . . . . . 22309 ACTTACAATGCCGAGAAGTTAGCCAAGATCTATATCTCAGAAATCGTTCGATTGCATGGG T Y N A E K L A K I Y I S E I V R L H G L T M P R S - P R S I S Q K S F D C M G D L Q C R E V S Q D L Y L R N R S I A W . . . . . . 22369 GTTCCACTATCCATCATATCAGATAGAGGTACGCAGTTTACTTCTAAGTTTTGGAAAACA V P L S I I S D R G T Q F T S K F W K T F H Y P S Y Q I E V R S L L L S F G K H G S T I H H I R - R Y A V Y F - V L E N . 22429 TTGCAT L H C I A Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-1_AGS-15_PPS_1 (21427 22434) (frame '1'; 1008 bp, 336 residues) 1 RNYPTHDLEL AAVLFALKQW RHYLYGVKCE VYTDHRSLQY VFTQKDLNLR QRRWMELLKN 61 YDITILYHPG KANVVADALS RKAGSMGSLA HLQASRRPLA REVQILANDL MRLEVNEKGG 121 LLACVEARSS FLDKIKGKQF NDEKLIRIRD KVLRGEAKEA TIDEEGVLRI KGRVCVPRVD 181 DLINSILTKA HSSRYSIHPG ATKMYRDLKQ HFWWSRMKRD IVDFIAKCPN CQQVKYEHQR 241 PGGTLQRMPI PEWKWDRIAM DFVVGLPKTM GKYDSIWVIV DRLTKSAHFV PVKVTYNAEK 301 LAKIYISEIV RLHGVPLSII SDRGTQFTSK FWKTLH AGS-16 (22659 22483) SCR (e 0.944) Exon 1 22659 22483 ( 177 n); score: 0.944 PGS (22659 22483) SGN-E577888+ 3-phase translation of AGS-16 (-strand): . . . . . . 22659 CTACATCTCCTCCCATACAATGCTTCAAATGGGGTCATATCAATACTTGAGTGATAGCTA L H L L P Y N A S N G V I S I L E - - L Y I S S H T M L Q M G S Y Q Y L S D S Y T S P P I Q C F K W G H I N T - V I A . . . . . . 22599 TTATTGTATGAAAACTCCGCTAAGGGTAAAAAGCTATCCCAATGGCCACCAAACTCTATC L L Y E N S A K G K K L S Q W P P N S I Y C M K T P L R V K S Y P N G H Q T L S I I V - K L R - G - K A I P M A T K L Y . . . . . . 22539 ACACATGCACGAAGCATATCCTCCAACACTTGAATCGTTCGCTCAGACTGACCATCG T H A R S I S S N T - I V R S D - P S H M H E A Y P P T L E S F A Q T D H H T C T K H I L Q H L N R S L R L T I Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-16 (+strand): . . . . . . 22483 CGATGGTCAGTCTGAGCGAACGATTCAAGTGTTGGAGGATATGCTTCGTGCATGTGTGAT R W S V - A N D S S V G G Y A S C M C D D G Q S E R T I Q V L E D M L R A C V I M V S L S E R F K C W R I C F V H V - . . . . . . 22543 AGAGTTTGGTGGCCATTGGGATAGCTTTTTACCCTTAGCGGAGTTTTCATACAATAATAG R V W W P L G - L F T L S G V F I Q - - E F G G H W D S F L P L A E F S Y N N S - S L V A I G I A F Y P - R S F H T I I . . . . . . 22603 CTATCACTCAAGTATTGATATGACCCCATTTGAAGCATTGTATGGGAGGAGATGTAG L S L K Y - Y D P I - S I V W E E M - Y H S S I D M T P F E A L Y G R R C A I T Q V L I - P H L K H C M G G D V Maximal non-overlapping open reading frames (>= 64 codons): none AGS-17 (23587 23548,23387 22721) SCR (e 0.850 d 0.000 a 0.000,e 0.910) Exon 1 23587 23548 ( 40 n); score: 0.850 Intron 1 23547 23388 ( 160 n); Pd: 0.000 Pa: 0.000 Exon 2 23387 22721 ( 667 n); score: 0.910 PGS (23587 23548,23387 22721) SGN-E354383- 3-phase translation of AGS-17 (-strand): . . . . : . . 23587 CTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAG : GGTCCGTCGCCTCAGCCTGT L - W A V V P A T V R P A : G S V A S A C C D G P S C L R R S V L Q : G P S P Q P V V M G R R A C D G P S C R : V R R L S L . . . . . . 23367 TTTTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACAATAGATACCA F S R N K I C C S K R L N R S L Q - I P F P E I K S A A Q N D - T G R Y N R Y Q F F Q K - N L L L K T T K Q V V T I D T . . . . . . 23307 ATTTACCCATCGTTCGTCCCCGAACGATCACCAGAAGGAAAACGAGGGCGAAAAGGAGTA I Y P S F V P E R S P E G K R G R K G V F T H R S S P N D H Q K E N E G E K E Y N L P I V R P R T I T R R K T R A K R S . . . . . . 23247 CCTGAATCTGTAAACAGATGTGGGTATCTTTCTCGCATATCTGCCTCCTTCTCCCAAGTG P E S V N R C G Y L S R I S A S F S Q V L N L - T D V G I F L A Y L P P S P K W T - I C K Q M W V S F S H I C L L L P S . . . . . . 23187 GCTTCTTCAACGGGTCGATTCTTCCATTGAACTTTGATGGATGCAATCTCCCTTGATCTC A S S T G R F F H - T L M D A I S L D L L L Q R V D S S I E L - W M Q S P L I S G F F N G S I L P L N F D G C N L P - S . . . . . . 23127 AACTTGCGAATTTCTCTATCTAGAATGGCAACAGGCTCATCCTCATAAGTCAAATTTTCA N L R I S L S R M A T G S S S - V K F S T C E F L Y L E W Q Q A H P H K S N F H Q L A N F S I - N G N R L I L I S Q I F . . . . . . 23067 TCAAGCAAGACTGAATCCCAACGAATAATATAGTTTCCATCCCCATGGTATCTTTTCAAC S S K T E S Q R I I - F P S P W Y L F N Q A R L N P N E - Y S F H P H G I F S T I K Q D - I P T N N I V S I P M V S F Q . . . . . . 23007 ATCGACACATGGAATACCGGATGTACTCCGGACAGCCCTGGAGGCAAGGCTAACTTATAA I D T W N T G C T P D S P G G K A N L - S T H G I P D V L R T A L E A R L T Y K H R H M E Y R M Y S G Q P W R Q G - L I . . . . . . 22947 GTCACCTCCCCTACTCGCTTAAGTACTTCAAATGGACCAATATACCTTGGGCTTAGTTTA V T S P T R L S T S N G P I Y L G L S L S P P L L A - V L Q M D Q Y T L G L V Y S H L P Y S L K Y F K W T N I P W A - F . . . . . . 22887 CCTCTTTTACCAAACCGCATCACCCCTTTCATTGGTGAAACTTTCAACAAGACTTGTTCA P L L P N R I T P F I G E T F N K T C S L F Y Q T A S P L S L V K L S T R L V H T S F T K P H H P F H W - N F Q Q D L F . . . . . . 22827 CCCTCCATGAACTCTAAGTCTCTAACCTTTTGATCTGCATATTTCTTTTGTCTACTTTGC P S M N S K S L T F - S A Y F F C L L C P P - T L S L - P F D L H I S F V Y F A T L H E L - V S N L L I C I F L L S T L . . . . . 22767 GCCGCTAGAAGTTTTTCTTGAATAGACTTCACTTTCTCTATCGAATC A A R S F S - I D F T F S I E P L E V F L E - T S L S L S N R R - K F F L N R L H F L Y R I Maximal non-overlapping open reading frames (>= 64 codons): none AGS-18 (25160 24457,24410 23063) SCR (e 0.831 d 0.657 a 0.000,e 0.859) Exon 1 25160 24457 ( 704 n); score: 0.831 Intron 1 24456 24411 ( 46 n); Pd: 0.657 Pa: 0.000 Exon 2 24410 23063 (1348 n); score: 0.859 PGS (23507 23063) SGN-E252199- PGS (23844 23318) SGN-E550335+ PGS (23797 23488) SGN-E356257- PGS (23729 23501) SGN-E396037+ PGS (24102 23611) SGN-E546548- PGS (24169 23820) SGN-E578076- PGS (24432 23900) SGN-E347579- PGS (24432 23911) SGN-E349726- PGS (24308 23911) SGN-E357559- PGS (24887 24457,24410 24170) SGN-E241789+ PGS (24746 24511) SGN-E209683- PGS (25150 24671) SGN-E351546- PGS (25150 24671) SGN-E356206- PGS (25150 24671) SGN-E356696- PGS (24989 24742) SGN-E222578+ PGS (25151 24747) SGN-E542084+ PGS (25160 24748) SGN-E370357+ PGS (25150 24753) SGN-E392027+ PGS (25015 24764) SGN-E373117- PGS (25015 24764) SGN-E373116+ PGS (24989 24782) SGN-E216150+ PGS (25015 24803) SGN-E298638- PGS (25015 24830) SGN-E352844- PGS (25007 24830) SGN-E368629- PGS (24990 24830) SGN-E238551- 3-phase translation of AGS-18 (-strand): . . . . . . 25160 ATATGAGCATCAATTTATGTCACGACCCAAATCCTGGCCGGGACTGGCACCCATATTTAC I - A S I Y V T T Q I L A G T G T H I Y Y E H Q F M S R P K S W P G L A P I F T M S I N L C H D P N P G R D W H P Y L . . . . . . 25100 CCTTCTATGTGAGCGAACCAACCAATCTAAACCTTAACATTTCAATATAATATCAGCAGA P S M - A N Q P I - T L T F Q Y N I S R L L C E R T N Q S K P - H F N I I S A E P F Y V S E P T N L N L N I S I - Y Q Q . . . . . . 25040 AAATAATGCGGAAGACTTAAACTCGTTTATAAAAAAAACCAAATCAATAACTATTATTCC K - C G R L K L V Y K K N Q I N N Y Y S N N A E D L N S F I K K T K S I T I I P K I M R K T - T R L - K K P N Q - L L F . . . . . . 24980 CCAAAATCTGGAAGTCATCATCACAAGAACATCTATGATCAAATTACTAACTAAAAATGT P K S G S H H H K N I Y D Q I T N - K C Q N L E V I I T R T S M I K L L T K N V P K I W K S S S Q E H L - S N Y - L K M . . . . . . 24920 CTAAGAAGCTAAAAATACATAAGAAGCTAGTCCATGCCGGAAGTTCAAGGCATCAAGACT L R S - K Y I R S - S M P E V Q G I K T - E A K N T - E A S P C R K F K A S R L S K K L K I H K K L V H A G S S R H Q D . . . . . . 24860 TGAAGAAGAAGCTCCAGTCCAAGCTAGAAGCATTAGCTCACCCTGAATTTCCGATGTAGT - R R S S S P S - K H - L T L N F R C S E E E A P V Q A R S I S S P - I S D V V L K K K L Q S K L E A L A H P E F P M - . . . . . . 24800 AAGACTGGCTTGAATTACTGTTGAGTCGAAGACGACGGCACGTTTGCTACACTCCAAAAA K T G L N Y C - V E D D G T F A T L Q K R L A - I T V E S K T T A R L L H S K N - D W L E L L L S R R R R H V C Y T P K . . . . . . 24740 TAACAAAGAAGAAAACATAAAAGTAGGGGTCAGTATAAAGCACGGGTACTGAGTAGATAT - Q R R K H K S R G Q Y K A R V L S R Y N K E E N I K V G V S I K H G Y - V D I I T K K K T - K - G S V - S T G T E - I . . . . . . 24680 CATCGGCCAACTCAAAATAGAAAACAGTATATACCAAGTAATATCATAAACTCAACTATG H R P T Q N R K Q Y I P S N I I N S T M I G Q L K I E N S I Y Q V I S - T Q L - S S A N S K - K T V Y T K - Y H K L N Y . . . . . . 24620 ATACTCAACATGTAGCAACAACAAGTACTATAACATTAACAATTTCCGTCAAGTTCACAC I L N M - Q Q Q V L - H - Q F P S S S H Y S T C S N N K Y Y N I N N F R Q V H T D T Q H V A T T S T I T L T I S V K F T . . . . . . 24560 ATGAGGACTCAAGCCTCAATACCATACTCATTTGGGAATTATGTTCATTAGATTGAGTAT M R T Q A S I P Y S F G N Y V H - I E Y - G L K P Q Y H T H L G I M F I R L S I H E D S S L N T I L I W E L C S L D - V . . . . . : . 24500 ATTAACATCTTTTAAGATTCATTATCTTTATTTCTCTTGTGTCG : GTACGTGACACTCCGA I N I F - D S L S L F L L C R : Y V T L R L T S F K I H Y L Y F S C V : G T - H S D Y - H L L R F I I F I S L V S : V R D T P . . . . . . 24394 TCCCCTACTACTATGTGTCGAAACGTGATACTCCGATCCCCTAAATTCTACGTGTCGGTT S P T T M C R N V I L R S P K F Y V S V P L L L C V E T - Y S D P L N S T C R F I P Y Y Y V S K R D T P I P - I L R V G . . . . . . 24334 CGTGACACCCGATCTCCTAAATCTACGTGTCGGTTCGTGACACCCGATCCCCTAATTCTA R D T R S P K S T C R F V T P D P L I L V T P D L L N L R V G S - H P I P - F Y S - H P I S - I Y V S V R D T R S P N S . . . . . . 24274 CGTGTCGGTTCGTGACACCCGGTCCCCTAATTCTACGTGTCGGTTCGTAACACCCGATCC R V G S - H P V P - F Y V S V R N T R S V S V R D T R S P N S T C R F V T P D P T C R F V T P G P L I L R V G S - H P I . . . . . . 24214 CCTAATCTCATTCTATCAATTCATCAAGCCTTCTCCCTTACCAAGGCATCATCAATCTCA P N L I L S I H Q A F S L T K A S S I S L I S F Y Q F I K P S P L P R H H Q S H P - S H S I N S S S L L P Y Q G I I N L . . . . . . 24154 TTACTTTAGTTCATCAAGCCTTATCCCTTACAAAGGCATCATCATTAAAAAGAGATTAGG L L - F I K P Y P L Q R H H H - K E I R Y F S S S S L I P Y K G I I I K K R L G I T L V H Q A L S L T K A S S L K R D - . . . . . . 24094 TTTTTATCAAGATTTGGGATTCGATAGCTTCATCATGCTTAATATAATCACAATTATATA F L S R F G I R - L H H A - Y N H N Y I F Y Q D L G F D S F I M L N I I T I I - V F I K I W D S I A S S C L I - S Q L Y . . . . . . 24034 ATCACGTTCATGCAAGCATACAATTAAGCACATAGCAGGGTTTACAATACTATCAATACA I T F M Q A Y N - A H S R V Y N T I N T S R S C K H T I K H I A G F T I L S I H N H V H A S I Q L S T - Q G L Q Y Y Q Y . . . . . . 23974 TATCATTCGCTATTAAGAGTTTACTACGAATAGTATGAAAACCATAACCTACCTTCACCG Y H S L L R V Y Y E - Y E N H N L P S P I I R Y - E F T T N S M K T I T Y L H R I S F A I K S L L R I V - K P - P T F T . . . . . . 23914 AAGAATTGCGATCAACAAGCTATCTTCTCAAAATCCTTGCTATCCTCTTCGTTTCTCTCT K N C D Q Q A I F S K S L L S S S F L S R I A I N K L S S Q N P C Y P L R F S L E E L R S T S Y L L K I L A I L F V S L . . . . . . 23854 CTCTACTCGTTCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAA L Y S F S F F F C L S L F F L F F L F K S T R S L S F S V S L C S F Y F S Y S N S L L V L F L F L S L F V L S I F L I Q . . . . . . 23794 CCCTCTTTCTTTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCC P S F F Y P N - H I I K C K R W Q - - P P L S F T L I N I - S S V K D G N N N P T L F L L P - L T Y N Q V - K M A I I T . . . . . . 23734 ACTAATTAACTTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAAC T N - L K V T S F N P Q V I R L I N I N L I N L R L P L L T P K - L D L L T L T H - L T - G Y L F - P P S N - T Y - H - . . . . . . 23674 CCCCTAACTTTATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAA P L T L - F K Q E - S K T S L K T Y K E P - L Y N L S R N S Q K R P L K R I K K P P N F I I - A G I V K N V P - N V - R . . . . . . 23614 ATCCGACCCGGACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGT I R P G L G L R N L - W A V V P A T V R S D P D W D C A T C D G P S C L R R S V N P T R T G I A Q P V M G R R A C D G P . . . . . . 23554 CCTGCAGGTCGTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCG P A G R R K V Q R P K F P P R V C D G P L Q V V A K F R D P N F H Q G S V T V R S C R S S Q S S E T Q I S T K G L - R S . . . . . . 23494 TCCTGCCATTTCGTTACGAAGTTCAGAGAGTCGATTTCAGCACCCAATTTTTAGATTTTC S C H F V T K F R E S I S A P N F - I F P A I S L R S S E S R F Q H P I F R F S V L P F R Y E V Q R V D F S T Q F L D F . . . . . . 23434 TAAGTGTTTTGAAACGAGACCCTGTGACGGTCCGTCGTGCCCATGACGGTCCGTCGCCTC - V F - N E T L - R S V V P M T V R R L K C F E T R P C D G P S C P - R S V A S L S V L K R D P V T V R R A H D G P S P . . . . . . 23374 AGCCTGTTTTTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACAATA S L F F Q K - N L L L K T T K Q V V T I A C F S R N K I C C S K R L N R S L Q - Q P V F P E I K S A A Q N D - T G R Y N . . . . . . 23314 GATACCAATTTACCCATCGTTCGTCCCCGAACGATCACCAGAAGGAAAACGAGGGCGAAA D T N L P I V R P R T I T R R K T R A K I P I Y P S F V P E R S P E G K R G R K R Y Q F T H R S S P N D H Q K E N E G E . . . . . . 23254 AGGAGTACCTGAATCTGTAAACAGATGTGGGTATCTTTCTCGCATATCTGCCTCCTTCTC R S T - I C K Q M W V S F S H I C L L L G V P E S V N R C G Y L S R I S A S F S K E Y L N L - T D V G I F L A Y L P P S . . . . . . 23194 CCAAGTGGCTTCTTCAACGGGTCGATTCTTCCATTGAACTTTGATGGATGCAATCTCCCT P S G F F N G S I L P L N F D G C N L P Q V A S S T G R F F H - T L M D A I S L P K W L L Q R V D S S I E L - W M Q S P . . . . . . 23134 TGATCTCAACTTGCGAATTTCTCTATCTAGAATGGCAACAGGCTCATCCTCATAAGTCAA - S Q L A N F S I - N G N R L I L I S Q D L N L R I S L S R M A T G S S S - V K L I S T C E F L Y L E W Q Q A H P H K S . . 23074 ATTTTCATCAAG I F I K F S S N F H Q Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-18_PPS_1 (23667 23389) (frame '2'; 276 bp, 92 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 ISLRSSESRF QHPIFRFSKC FETRPCDGPS CP- >C01HBa0088L02.1-_PGL-1_AGS-18_PPS_2 (24279 24034) (frame '2'; 243 bp, 81 residues) 1 FYVSVRDTRS PNSTCRFVTP DPLISFYQFI KPSPLPRHHQ SHYFSSSSLI PYKGIIIKKR 61 LGFYQDLGFD SFIMLNIITI I- >C01HBa0088L02.1-_PGL-1_AGS-18_PPS_3 (23958 23764) (frame '2'; 192 bp, 64 residues) 1 EFTTNSMKTI TYLHRRIAIN KLSSQNPCYP LRFSLSTRSL SFSVSLCSFY FSYSNPLSFT 61 LINI- AGS-19 (23587 23550,23387 23318) SCR (e 0.868 d 0.000 a 0.000,e 0.900) Exon 1 23587 23550 ( 38 n); score: 0.868 Intron 1 23549 23388 ( 162 n); Pd: 0.000 Pa: 0.000 Exon 2 23387 23318 ( 70 n); score: 0.900 PGS (23587 23550,23387 23318) SGN-E275667- 3-phase translation of AGS-19 (-strand): . . . . : . . 23587 CTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGC : GGTCCGTCGCCTCAGCCTGTTT L - W A V V P A T V R P A : V R R L S L F C D G P S C L R R S V L : R S V A S A C F V M G R R A C D G P S C : G P S P Q P V . . . . . 23365 TTCCAGAAATAAAATCTGCTGCTCAAAACGACTAAACAGGTCGTTACA F Q K - N L L L K T T K Q V V T S R N K I C C S K R L N R S L F P E I K S A A Q N D - T G R Y Maximal non-overlapping open reading frames (>= 64 codons): none AGS-20 (23989 23488,23412 23387) SCR (e 0.818 d 0.000 a 0.000,e 0.846) Exon 1 23989 23488 ( 502 n); score: 0.818 Intron 1 23487 23413 ( 75 n); Pd: 0.000 Pa: 0.000 Exon 2 23412 23387 ( 26 n); score: 0.846 PGS (23989 23488,23412 23387) SGN-E349296- 3-phase translation of AGS-20 (-strand): . . . . . . 23989 AATACTATCAATACATATCATTCGCTATTAAGAGTTTACTACGAATAGTATGAAAACCAT N T I N T Y H S L L R V Y Y E - Y E N H I L S I H I I R Y - E F T T N S M K T I Y Y Q Y I S F A I K S L L R I V - K P . . . . . . 23929 AACCTACCTTCACCGAAGAATTGCGATCAACAAGCTATCTTCTCAAAATCCTTGCTATCC N L P S P K N C D Q Q A I F S K S L L S T Y L H R R I A I N K L S S Q N P C Y P - P T F T E E L R S T S Y L L K I L A I . . . . . . 23869 TCTTCGTTTCTCTCTCTCTACTCGTTCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTA S S F L S L Y S F S F F F C L S L F F L L R F S L S T R S L S F S V S L C S F Y L F V S L S L L V L F L F L S L F V L S . . . . . . 23809 TTTTTCTTATTCAAACCCTCTTTCTTTTACCCTAATTAACATATAATCAAGTGTAAAAGA F F L F K P S F F Y P N - H I I K C K R F S Y S N P L S F T L I N I - S S V K D I F L I Q T L F L L P - L T Y N Q V - K . . . . . . 23749 TGGCAATAATAACCCACTAATTAACTTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGA W Q - - P T N - L K V T S F N P Q V I R G N N N P L I N L R L P L L T P K - L D M A I I T H - L T - G Y L F - P P S N - . . . . . . 23689 CTTATTAACATTAACCCCCTAACTTTATAATTTAAGCAGGAATAGTCAAAAACGTCCCTT L I N I N P L T L - F K Q E - S K T S L L L T L T P - L Y N L S R N S Q K R P L T Y - H - P P N F I I - A G I V K N V P . . . . . . 23629 AAAACGTATAAAGAAATCCGACCCGGACTGGGATTGCGCAACCTGTGATGGGCCGTCGTG K T Y K E I R P G L G L R N L - W A V V K R I K K S D P D W D C A T C D G P S C - N V - R N P T R T G I A Q P V M G R R . . . . . . 23569 CCTGCGACGGTCCGTCCTGCAGGTCGTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGG P A T V R P A G R R K V Q R P K F P P R L R R S V L Q V V A K F R D P N F H Q G A C D G P S C R S S Q S S E T Q I S T K . . . : . . 23509 GTCTGTGACGGTCCGTCCTGCC : TGTGACGGTCCGTCGTGCCCATGACG V C D G P S C : L - R S V V P M T S V T V R P A : C D G P S C P - G L - R S V L P : V T V R R A H D Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-20_PPS_1 (23667 23488,23412 23389) (frame '2'; 201 bp, 67 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 CDGPSCP- >C01HBa0088L02.1-_PGL-1_AGS-20_PPS_2 (23958 23764) (frame '2'; 192 bp, 64 residues) 1 EFTTNSMKTI TYLHRRIAIN KLSSQNPCYP LRFSLSTRSL SFSVSLCSFY FSYSNPLSFT 61 LINI- AGS-21 (23844 23490,23414 23387) SCR (e 0.908 d 0.000 a 0.000,e 0.952) Exon 1 23844 23490 ( 355 n); score: 0.908 Intron 1 23489 23415 ( 75 n); Pd: 0.000 Pa: 0.000 Exon 2 23414 23387 ( 28 n); score: 0.952 PGS (23844 23490,23414 23387) SGN-E396058+ PGS (23844 23490,23414 23387) SGN-E550127- PGS (23844 23490,23414 23387) SGN-E550140- PGS (23844 23490,23414 23387) SGN-E389553- PGS (23844 23490,23414 23387) SGN-E550212+ PGS (23844 23490,23414 23387) SGN-E550065+ PGS (23844 23490,23414 23387) SGN-E550201+ PGS (23844 23490,23414 23387) SGN-E550207+ PGS (23844 23490,23414 23387) SGN-E390013+ PGS (23844 23490,23414 23387) SGN-E389834+ PGS (23844 23490,23414 23387) SGN-E550484+ PGS (23844 23490,23414 23387) SGN-E550211+ PGS (23844 23490,23414 23387) SGN-E550464+ PGS (23844 23490,23414 23387) SGN-E549941+ PGS (23844 23490,23414 23387) SGN-E550025+ PGS (23844 23490,23414 23387) SGN-E396039+ PGS (23844 23490,23414 23387) SGN-E396054+ PGS (23844 23490,23414 23387) SGN-E396056+ PGS (23839 23490,23414 23387) SGN-E231589+ PGS (23839 23490,23414 23387) SGN-E374999+ PGS (23839 23490,23414 23387) SGN-E236652+ PGS (23839 23490,23414 23387) SGN-E377133+ PGS (23839 23490,23414 23387) SGN-E241959+ PGS (23833 23490,23414 23387) SGN-E550322+ PGS (23807 23490,23414 23387) SGN-E396057- PGS (23791 23490,23414 23387) SGN-E377132- PGS (23775 23490,23414 23387) SGN-E396055- PGS (23773 23490,23414 23387) SGN-E398551- PGS (23761 23490,23414 23387) SGN-E396038- PGS (23656 23490,23414 23387) SGN-E396069- PGS (23844 23490,23414 23394) SGN-E396070+ 3-phase translation of AGS-21 (-strand): . . . . . . 23844 TCTCTTTCTTTTTCTGTCTCTCTTTGTTCTTTCTATTTTTCTTATTCAAACCCTCTTTCT S L S F S V S L C S F Y F S Y S N P L S L F L F L S L F V L S I F L I Q T L F L S F F F C L S L F F L F F L F K P S F . . . . . . 23784 TTTACCCTAATTAACATATAATCAAGTGTAAAAGATGGCAATAATAACCCACTAATTAAC F T L I N I - S S V K D G N N N P L I N L P - L T Y N Q V - K M A I I T H - L T F Y P N - H I I K C K R W Q - - P T N - . . . . . . 23724 TTAAGGTTACCTCTTTTAACCCCCAAGTAATTAGACTTATTAACATTAACCCCCTAACTT L R L P L L T P K - L D L L T L T P - L - G Y L F - P P S N - T Y - H - P P N F L K V T S F N P Q V I R L I N I N P L T . . . . . . 23664 TATAATTTAAGCAGGAATAGTCAAAAACGTCCCTTAAAACGTATAAAGAAATCCGACCCG Y N L S R N S Q K R P L K R I K K S D P I I - A G I V K N V P - N V - R N P T R L - F K Q E - S K T S L K T Y K E I R P . . . . . . 23604 GACTGGGATTGCGCAACCTGTGATGGGCCGTCGTGCCTGCGACGGTCCGTCCTGCAGGTC D W D C A T C D G P S C L R R S V L Q V T G I A Q P V M G R R A C D G P S C R S G L G L R N L - W A V V P A T V R P A G . . . . . . : 23544 GTCGCAAAGTTCAGAGACCCAAATTTCCACCAAGGGTCTGTGACGGTCCGTCCTG : CCTGT V A K F R D P N F H Q G S V T V R P : A C S Q S S E T Q I S T K G L - R S V L : P V R R K V Q R P K F P P R V C D G P S C : L . . . 23409 GACGGTCCGTCGTGCCCATGACG D G P S C P - T V R R A H D - R S V V P M T Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-1_AGS-21_PPS_1 (23667 23490,23414 23389) (frame '1'; 201 bp, 67 residues) 1 LYNLSRNSQK RPLKRIKKSD PDWDCATCDG PSCLRRSVLQ VVAKFRDPNF HQGSVTVRPA 61 CDGPSCP- AGS-22 (24989 24379,24314 24271,24238 24198) SCR (e 0.846 d 0.000 a 0.000,e 0.670 d 0.000 a 0.000,e 0.793) Exon 1 24989 24379 ( 611 n); score: 0.846 Intron 1 24378 24315 ( 64 n); Pd: 0.000 Pa: 0.000 Exon 2 24314 24271 ( 44 n); score: 0.670 Intron 2 24270 24239 ( 32 n); Pd: 0.000 Pa: 0.000 Exon 3 24238 24198 ( 41 n); score: 0.793 PGS (24689 24379,24314 24271,24238 24198) SGN-E349977- PGS (24602 24367) SGN-E391780- PGS (24845 24368) SGN-E246710- PGS (24989 24381) SGN-E546506+ PGS (24693 24413) SGN-E357033+ 3-phase translation of AGS-22 (-strand): . . . . . . 24989 TATTATTCCCCAAAATCTGGAAGTCATCATCACAAGAACATCTATGATCAAATTACTAAC Y Y S P K S G S H H H K N I Y D Q I T N I I P Q N L E V I I T R T S M I K L L T L F P K I W K S S S Q E H L - S N Y - . . . . . . 24929 TAAAAATGTCTAAGAAGCTAAAAATACATAAGAAGCTAGTCCATGCCGGAAGTTCAAGGC - K C L R S - K Y I R S - S M P E V Q G K N V - E A K N T - E A S P C R K F K A L K M S K K L K I H K K L V H A G S S R . . . . . . 24869 ATCAAGACTTGAAGAAGAAGCTCCAGTCCAAGCTAGAAGCATTAGCTCACCCTGAATTTC I K T - R R S S S P S - K H - L T L N F S R L E E E A P V Q A R S I S S P - I S H Q D L K K K L Q S K L E A L A H P E F . . . . . . 24809 CGATGTAGTAAGACTGGCTTGAATTACTGTTGAGTCGAAGACGACGGCACGTTTGCTACA R C S K T G L N Y C - V E D D G T F A T D V V R L A - I T V E S K T T A R L L H P M - - D W L E L L L S R R R R H V C Y . . . . . . 24749 CTCCAAAAATAACAAAGAAGAAAACATAAAAGTAGGGGTCAGTATAAAGCACGGGTACTG L Q K - Q R R K H K S R G Q Y K A R V L S K N N K E E N I K V G V S I K H G Y - T P K I T K K K T - K - G S V - S T G T . . . . . . 24689 AGTAGATATCATCGGCCAACTCAAAATAGAAAACAGTATATACCAAGTAATATCATAAAC S R Y H R P T Q N R K Q Y I P S N I I N V D I I G Q L K I E N S I Y Q V I S - T E - I S S A N S K - K T V Y T K - Y H K . . . . . . 24629 TCAACTATGATACTCAACATGTAGCAACAACAAGTACTATAACATTAACAATTTCCGTCA S T M I L N M - Q Q Q V L - H - Q F P S Q L - Y S T C S N N K Y Y N I N N F R Q L N Y D T Q H V A T T S T I T L T I S V . . . . . . 24569 AGTTCACACATGAGGACTCAAGCCTCAATACCATACTCATTTGGGAATTATGTTCATTAG S S H M R T Q A S I P Y S F G N Y V H - V H T - G L K P Q Y H T H L G I M F I R K F T H E D S S L N T I L I W E L C S L . . . . . . 24509 ATTGAGTATATTAACATCTTTTAAGATTCATTATCTTTATTTCTCTTGTGTCGGTACGTG I E Y I N I F - D S L S L F L L C R Y V L S I L T S F K I H Y L Y F S C V G T - D - V Y - H L L R F I I F I S L V S V R . . . . . . 24449 ACACTCCGCTCCCTTATATTCATTAATCCTCTTGTGTCGGTACGTGACACTCCGATCCCC T L R S L I F I N P L V S V R D T P I P H S A P L Y S L I L L C R Y V T L R S P D T P L P Y I H - S S C V G T - H S D P . . : . . . . : 24389 TACTACTATGT : ATCTACGTGTCGGTTCGTGACACCCGATCCCCTAATTCTACGTG : GTGTC Y Y Y V : S T C R F V T P D P L I L R : G V T T M : Y L R V G S - H P I P - F Y V : V S L L L C : I Y V S V R D T R S P N S T W : C . . . . 24233 GGTTCGTAACACCCGATCCCCTAATCTCATTCTATC G S - H P I P - S H S I V R N T R S P N L I L R F V T P D P L I S F Y Maximal non-overlapping open reading frames (>= 64 codons): none PGL 2 (+ strand): 28026 28999 AGS-1 (28026 28054,28627 28731) SCR (e 0.759 d 0.000 a 0.000,e 0.933) Exon 1 28026 28054 ( 29 n); score: 0.759 Intron 1 28055 28626 ( 572 n); Pd: 0.000 Pa: 0.000 Exon 2 28627 28731 ( 105 n); score: 0.933 PGS (28026 28054,28627 28731) SGN-E202664+ 3-phase translation of AGS-1 (+strand): . . . : . . . 28026 TTTAACTATTCAACTTTTAAATAAATAAA : TAAATGAATAAATAAATAAATAAAAACAGAT F N Y S T F K - I N : K - I N K - I K T D L T I Q L L N K - : I N E - I N K - K Q I - L F N F - I N K : - M N K - I N K N R . . . . . . 28658 TTGTATTTATTTATTTTAAATTTTATTTGACTAATTCTTGAATTAGTCTCCTAATCCTAA L Y L F I L N F I - L I L E L V S - S - C I Y L F - I L F D - F L N - S P N P N F V F I Y F K F Y L T N S - I S L L I L . . 28718 TAGTTCTCTCTCTC - F S L S S L S I V L S L Maximal non-overlapping open reading frames (>= 64 codons): none AGS-2 (28572 28731) SCR (e 0.891) Exon 1 28572 28731 ( 160 n); score: 0.891 PGS (28572 28731) SGN-E332471- PGS (28573 28717) SGN-E227035- PGS (28574 28717) SGN-E378094- 3-phase translation of AGS-2 (+strand): . . . . . . 28572 TTTATATAAATAAGAATAAATAGGTATTTAAGGGCATAATGGTCCTTTCACGTTCTAAAT F I - I R I N R Y L R A - W S F H V L N L Y K - E - I G I - G H N G P F T F - M Y I N K N K - V F K G I M V L S R S K . . . . . . 28632 GAATAAATAAATAAATAAAAACAGATTTGTATTTATTTATTTTAAATTTTATTTGACTAA E - I N K - K Q I C I Y L F - I L F D - N K - I N K N R F V F I Y F K F Y L T N - I N K - I K T D L Y L F I L N F I - L . . . . 28692 TTCTTGAATTAGTCTCCTAATCCTAATAGTTCTCTCTCTC F L N - S P N P N S S L S S - I S L L I L I V L S L I L E L V S - S - - F S L Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-2 (-strand): . . . . . . 28731 GAGAGAGAGAACTATTAGGATTAGGAGACTAATTCAAGAATTAGTCAAATAAAATTTAAA E R E N Y - D - E T N S R I S Q I K F K R E R T I R I R R L I Q E L V K - N L K E R E L L G L G D - F K N - S N K I - . . . . . . 28671 ATAAATAAATACAAATCTGTTTTTATTTATTTATTTATTCATTTAGAACGTGAAAGGACC I N K Y K S V F I Y L F I H L E R E R T - I N T N L F L F I Y L F I - N V K G P N K - I Q I C F Y L F I Y S F R T - K D . . . . 28611 ATTATGCCCTTAAATACCTATTTATTCTTATTTATATAAA I M P L N T Y L F L F I - L C P - I P I Y S Y L Y K H Y A L K Y L F I L I Y I Maximal non-overlapping open reading frames (>= 64 codons): none AGS-3 (28892 28999) SCR (e 0.926) Exon 1 28892 28999 ( 108 n); score: 0.926 PGS (28892 28999) SGN-E577982- 3-phase translation of AGS-3 (+strand): . . . . . . 28892 GTTTGAATATCAATAAAGGTATGGGTTTCTCTCATGGAATTCTTTCTCCAAGAGTAATTT V - I S I K V W V S L M E F F L Q E - F F E Y Q - R Y G F L S W N S F S K S N F L N I N K G M G F S H G I L S P R V I . . . . . 28952 CTTTCGAACGTTTCTTAAACTCTTGAAACTAAGGTTGTTCCCCTTCGT L S N V S - T L E T K V V P L R F R T F L K L L K L R L F P F S F E R F L N S - N - G C S P S Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-3 (-strand): . . . . . . 28999 ACGAAGGGGAACAACCTTAGTTTCAAGAGTTTAAGAAACGTTCGAAAGAAATTACTCTTG T K G N N L S F K S L R N V R K K L L L R R G T T L V S R V - E T F E R N Y S W E G E Q P - F Q E F K K R S K E I T L . . . . . 28939 GAGAAAGAATTCCATGAGAGAAACCCATACCTTTATTGATATTCAAAC E K E F H E R N P Y L Y - Y S N R K N S M R E T H T F I D I Q G E R I P - E K P I P L L I F K Maximal non-overlapping open reading frames (>= 64 codons): none PGL 3 (+ strand): 29980 33860 AGS-1 (29980 30004,31082 31093,31553 31595,32881 32894,33551 33860) SCR (e 0.800 d 0.000 a 0.681,e 0.667 d 0.142 a 0.000,e 0.651 d 0.000 a 0.000,e 0.714 d 0.900 a 0.000,e 0.739) Exon 1 29980 30004 ( 25 n); score: 0.800 Intron 1 30005 31081 (1077 n); Pd: 0.000 Pa: 0.681 Exon 2 31082 31093 ( 12 n); score: 0.667 Intron 2 31094 31552 ( 459 n); Pd: 0.142 Pa: 0.000 Exon 3 31553 31595 ( 43 n); score: 0.651 Intron 3 31596 32880 (1285 n); Pd: 0.000 Pa: 0.000 Exon 4 32881 32894 ( 14 n); score: 0.714 Intron 4 32895 33550 ( 656 n); Pd: 0.900 Pa: 0.000 Exon 5 33551 33860 ( 310 n); score: 0.739 PGS (29980 30004,31082 31093,31553 31595,32881 32894,33551 33860) SGN-E578080+ 3-phase translation of AGS-1 (+strand): . . . : . : . . 29980 CTTTCATGTAAATATTGAGATTTAA : GATAATCAAGAG : AAGTGTGTACTAATTCCATACAA L S C K Y - D L : R - S R : E V C T N S I Q F H V N I E I - : D N Q E : K C V L I P Y K F M - I L R F K : I I K R : S V Y - F H T . . : . . : . . 31576 ACATCTACATTTAGGTGTAG : AAGATACATCATGA : GATTTTTCGTGTTGGGTTAGTTCACC T S T F R C R : R Y I M : R F F V L G - F T H L H L G V : E D T S - : D F S C W V S S P N I Y I - V - : K I H H E : I F R V G L V H . . . . . . 33577 CACACACCAACTTGTTTAAATTCAGCAATTTTGAGTTGGTTGAATGATAAAAAGTGAAGT H T P T C L N S A I L S W L N D K K - S T H Q L V - I Q Q F - V G - M I K S E V P H T N L F K F S N F E L V E - - K V K . . . . . . 33637 TTTTGGAGAACATTGTTGAATTCTTGTTGGTTGAGTTGTTGCATGCCTAGTGTTGATTTG F W R T L L N S C W L S C C M P S V D L F G E H C - I L V G - V V A C L V L I - F L E N I V E F L L V E L L H A - C - F . . . . . . 33697 ATTTGTGTTTTCTGGTTTTTCGAGTCAAATATATGGATATTGAGGGTACTAATTAATGAT I C V F W F F E S N I W I L R V L I N D F V F S G F S S Q I Y G Y - G Y - L M I D L C F L V F R V K Y M D I E G T N - - . . . . . . 33757 CCTAAGTGTTTGGGACAAGAACCATGAAAGTTTAGAGGGTTTAGAAATGAAAAACGGAGA P K C L G Q E P - K F R G F R N E K R R L S V W D K N H E S L E G L E M K N G E S - V F G T R T M K V - R V - K - K T E . . . . . 33817 AGAAAAGTCGAAACGCCTGTCCATAGGACCTTGAAGCGCCGCGC R K V E T P V H R T L K R R E K S K R L S I G P - S A A K K S R N A C P - D L E A P R Maximal non-overlapping open reading frames (>= 64 codons): none AGS-2 (31046 31384) SCR (e 0.836) Exon 1 31046 31384 ( 339 n); score: 0.836 PGS (31046 31384) SGN-E389994+ PGS (31046 31384) SGN-E235464+ 3-phase translation of AGS-2 (+strand): . . . . . . 31046 ATAAAGAAATGAATGATACCAAATGTGTTGGGATAGGATAATCAAGAGGTGAGCTAGATT I K K - M I P N V L G - D N Q E V S - I - R N E - Y Q M C W D R I I K R - A R L K E M N D T K C V G I G - S R G E L D . . . . . . 31106 AAGGTAATGACATTAGGTTATTCCTGATCATTGCACAACAAACCCGATGAAAGCCTTAAA K V M T L G Y S - S L H N K P D E S L K R - - H - V I P D H C T T N P M K A L N - G N D I R L F L I I A Q Q T R - K P - . . . . . . 31166 CTACATCCTAGGTATAGCTGGTGTTCTCACTAGCCTATGAATGAATTGAAATGAAATACG L H P R Y S W C S H - P M N E L K - N T Y I L G I A G V L T S L - M N - N E I R T T S - V - L V F S L A Y E - I E M K Y . . . . . . 31226 TATGAAGAAATGAAGCAGACTCTGTGTTTGCTAAAGAAGGCTCCCTAGTTGAGGTCCCAT Y E E M K Q T L C L L K K A P - L R S H M K K - S R L C V C - R R L P S - G P I V - R N E A D S V F A K E G S L V E V P . . . . . . 31286 ATGTTGAGCCCTCATTTTGGAAAGTCTTAAGGTTAAGTCTATGATAATAAGGTCTCATGG M L S P H F G K S - G - V Y D N K V S W C - A L I L E S L K V K S M I I R S H G Y V E P S F W K V L R L S L - - - G L M . . . . 31346 TATATGAATCAATAATATGAAAGAAACTATGTGTTATAT Y M N Q - Y E R N Y V L Y I - I N N M K E T M C Y V Y E S I I - K K L C V I Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-2 (-strand): . . . . . . 31384 ATATAACACATAGTTTCTTTCATATTATTGATTCATATACCATGAGACCTTATTATCATA I - H I V S F I L L I H I P - D L I I I Y N T - F L S Y Y - F I Y H E T L L S - I T H S F F H I I D S Y T M R P Y Y H . . . . . . 31324 GACTTAACCTTAAGACTTTCCAAAATGAGGGCTCAACATATGGGACCTCAACTAGGGAGC D L T L R L S K M R A Q H M G P Q L G S T - P - D F P K - G L N I W D L N - G A R L N L K T F Q N E G S T Y G T S T R E . . . . . . 31264 CTTCTTTAGCAAACACAGAGTCTGCTTCATTTCTTCATACGTATTTCATTTCAATTCATT L L - Q T Q S L L H F F I R I S F Q F I F F S K H R V C F I S S Y V F H F N S F P S L A N T E S A S F L H T Y F I S I H . . . . . . 31204 CATAGGCTAGTGAGAACACCAGCTATACCTAGGATGTAGTTTAAGGCTTTCATCGGGTTT H R L V R T P A I P R M - F K A F I G F I G - - E H Q L Y L G C S L R L S S G L S - A S E N T S Y T - D V V - G F H R V . . . . . . 31144 GTTGTGCAATGATCAGGAATAACCTAATGTCATTACCTTAATCTAGCTCACCTCTTGATT V V Q - S G I T - C H Y L N L A H L L I L C N D Q E - P N V I T L I - L T S - L C C A M I R N N L M S L P - S S S P L D . . . . 31084 ATCCTATCCCAACACATTTGGTATCATTCATTTCTTTAT I L S Q H I W Y H S F L Y S Y P N T F G I I H F F Y P I P T H L V S F I S L Maximal non-overlapping open reading frames (>= 64 codons): none AGS-3 (31429 32043) SCR (e 0.810) Exon 1 31429 32043 ( 615 n); score: 0.810 PGS (31429 31764) SGN-E389503- PGS (31590 31841) SGN-E217225- PGS (31590 31841) SGN-E222944- PGS (31590 31841) SGN-E223449- PGS (31836 32043) SGN-E546254+ PGS (31941 32035) SGN-E378094+ PGS (31941 32035) SGN-E227035+ PGS (31942 32035) SGN-E392260+ 3-phase translation of AGS-3 (+strand): . . . . . . 31429 AACTTTCTCAATCTCAATTTAGCAAGTCCACTGACTTGACTTCCAAACATCATGTTGTTA N F L N L N L A S P L T - L P N I M L L T F S I S I - Q V H - L D F Q T S C C - L S Q S Q F S K S T D L T S K H H V V . . . . . . 31489 GGAAAGAGCTCTTCTTCCTCATGCATGTCCCTGGTGTGTGCTTGCATATACCCATACTTA G K S S S S S C M S L V C A C I Y P Y L E R A L L P H A C P W C V L A Y T H T - R K E L F F L M H V P G V C L H I P I L . . . . . . 31549 GTACAAGTGTGTACTAATTCCATACAAACATCTACATTTAGGTGTAGGCACAGGTGTACG V Q V C T N S I Q T S T F R C R H R C T Y K C V L I P Y K H L H L G V G T G V R S T S V Y - F H T N I Y I - V - A Q V Y . . . . . . 31609 GTAGAGCTACAGGTTCGTTGTTGCAGCTATCCGGACGTCAGCATTCATCCGGAGTTTGGT V E L Q V R C C S Y P D V S I H P E F G - S Y R F V V A A I R T S A F I R S L V G R A T G S L L Q L S G R Q H S S G V W . . . . . . 31669 AGGTCCTCATGCCTTCGAGGATGCTACTGTTTTACATTCTAGCGTAGTTTAGAGTTGAGC R S S C L R G C Y C F T F - R S L E L S G P H A F E D A T V L H S S V V - S - A - V L M P S R M L L F Y I L A - F R V E . . . . . . 31729 TAGTGGAGCATGTTCCACTAGCGTTTCTTTCCTGTTTTGGTTCAGACTTTGTATTGGGGT - W S M F H - R F F P V L V Q T L Y W G S G A C S T S V S F L F W F R L C I G V L V E H V P L A F L S C F G S D F V L G . . . . . . 31789 TATTTTGACCGATATACAATTAATACTTAATGAATTATTTCTTTCAGTTGCTTATCTCTT Y F D R Y T I N T - - I I S F S C L S L I L T D I Q L I L N E L F L S V A Y L L L F - P I Y N - Y L M N Y F F Q L L I S . . . . . . 31849 AATTGTTAGATGGTTGATGATGAACGATTACGAAATATAAAGAATGTTTAACAAGTATGA N C - M V D D E R L R N I K N V - Q V - I V R W L M M N D Y E I - R M F N K Y D - L L D G - - - T I T K Y K E C L T S M . . . . . . 31909 TTAATGAATCAAAAATTTTAAATTTTCCGCTAAAATAAACCTATGTAAAGTAAGAATGAC L M N Q K F - I F R - N K P M - S K N D - - I K N F K F S A K I N L C K V R M T I N E S K I L N F P L K - T Y V K - E - . . . . . . 31969 GTAAGTAGGCTTGTTTGCGGCCTCTGAGAGGTCAACGACGCCGGTCTTGTCTGGGGTCTA V S R L V C G L - E V N D A G L V W G L - V G L F A A S E R S T T P V L S G V - R K - A C L R P L R G Q R R R S C L G S . . 32029 GATTCCAGTCGTGAC D S S R D I P V V R F Q S - Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-3_AGS-3_PPS_1 (31468 31710) (frame '1'; 240 bp, 80 residues) 1 LPNIMLLGKS SSSSCMSLVC ACIYPYLVQV CTNSIQTSTF RCRHRCTVEL QVRCCSYPDV 61 SIHPEFGRSS CLRGCYCFTF - 3-phase translation of AGS-3 (-strand): . . . . . . 32043 GTCACGACTGGAATCTAGACCCCAGACAAGACCGGCGTCGTTGACCTCTCAGAGGCCGCA V T T G I - T P D K T G V V D L S E A A S R L E S R P Q T R P A S L T S Q R P Q H D W N L D P R Q D R R R - P L R G R . . . . . . 31983 AACAAGCCTACTTACGTCATTCTTACTTTACATAGGTTTATTTTAGCGGAAAATTTAAAA N K P T Y V I L T L H R F I L A E N L K T S L L T S F L L Y I G L F - R K I - N K Q A Y L R H S Y F T - V Y F S G K F K . . . . . . 31923 TTTTTGATTCATTAATCATACTTGTTAAACATTCTTTATATTTCGTAATCGTTCATCATC F L I H - S Y L L N I L Y I S - S F I I F - F I N H T C - T F F I F R N R S S S I F D S L I I L V K H S L Y F V I V H H . . . . . . 31863 AACCATCTAACAATTAAGAGATAAGCAACTGAAAGAAATAATTCATTAAGTATTAATTGT N H L T I K R - A T E R N N S L S I N C T I - Q L R D K Q L K E I I H - V L I V Q P S N N - E I S N - K K - F I K Y - L . . . . . . 31803 ATATCGGTCAAAATAACCCCAATACAAAGTCTGAACCAAAACAGGAAAGAAACGCTAGTG I S V K I T P I Q S L N Q N R K E T L V Y R S K - P Q Y K V - T K T G K K R - W Y I G Q N N P N T K S E P K Q E R N A S . . . . . . 31743 GAACATGCTCCACTAGCTCAACTCTAAACTACGCTAGAATGTAAAACAGTAGCATCCTCG E H A P L A Q L - T T L E C K T V A S S N M L H - L N S K L R - N V K Q - H P R G T C S T S S T L N Y A R M - N S S I L . . . . . . 31683 AAGGCATGAGGACCTACCAAACTCCGGATGAATGCTGACGTCCGGATAGCTGCAACAACG K A - G P T K L R M N A D V R I A A T T R H E D L P N S G - M L T S G - L Q Q R E G M R T Y Q T P D E C - R P D S C N N . . . . . . 31623 AACCTGTAGCTCTACCGTACACCTGTGCCTACACCTAAATGTAGATGTTTGTATGGAATT N L - L Y R T P V P T P K C R C L Y G I T C S S T V H L C L H L N V D V C M E L E P V A L P Y T C A Y T - M - M F V W N . . . . . . 31563 AGTACACACTTGTACTAAGTATGGGTATATGCAAGCACACACCAGGGACATGCATGAGGA S T H L Y - V W V Y A S T H Q G H A - G V H T C T K Y G Y M Q A H T R D M H E E - Y T L V L S M G I C K H T P G T C M R . . . . . . 31503 AGAAGAGCTCTTTCCTAACAACATGATGTTTGGAAGTCAAGTCAGTGGACTTGCTAAATT R R A L S - Q H D V W K S S Q W T C - I E E L F P N N M M F G S Q V S G L A K L K K S S F L T T - C L E V K S V D L L N . . 31443 GAGATTGAGAAAGTT E I E K V R L R K - D - E S Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-3_AGS-3_PPS_1 (31634 31431) (frame '2'; 204 bp, 68 residues) 1 LQQRTCSSTV HLCLHLNVDV CMELVHTCTK YGYMQAHTRD MHEEEELFPN NMMFGSQVSG 61 LAKLRLRK PGL 4 (+ strand): 39300 51991 AGS-1 (39300 40139,40387 40530,40609 40761,41293 41408,41729 41896,42406 42630,45016 45163,51393 51533) SCR (e 1.000 d 1.000 a 0.998,e 1.000 d 0.992 a 0.995,e 1.000 d 0.979 a 0.998,e 1.000 d 0.909 a 1.000,e 1.000 d 0.985 a 0.999,e 1.000 d 0.956 a 0.995,e 1.000 d 0.985 a 0.659,e 0.961) Exon 1 39300 40139 ( 840 n); score: 1.000 Intron 1 40140 40386 ( 247 n); Pd: 1.000 Pa: 0.998 Exon 2 40387 40530 ( 144 n); score: 1.000 Intron 2 40531 40608 ( 78 n); Pd: 0.992 Pa: 0.995 Exon 3 40609 40761 ( 153 n); score: 1.000 Intron 3 40762 41292 ( 531 n); Pd: 0.979 Pa: 0.998 Exon 4 41293 41408 ( 116 n); score: 1.000 Intron 4 41409 41728 ( 320 n); Pd: 0.909 Pa: 1.000 Exon 5 41729 41896 ( 168 n); score: 1.000 Intron 5 41897 42405 ( 509 n); Pd: 0.985 Pa: 0.999 Exon 6 42406 42630 ( 225 n); score: 1.000 Intron 6 42631 45015 (2385 n); Pd: 0.956 Pa: 0.995 Exon 7 45016 45163 ( 148 n); score: 1.000 Intron 7 45164 51392 (6229 n); Pd: 0.985 Pa: 0.659 Exon 8 51393 51533 ( 141 n); score: 0.961 PGS (39300 39949) SGN-E395373+ PGS (39321 39787) SGN-E333392+ PGS (39804 40139,40387 40530,40609 40761,41293 41408) SGN-E542637+ PGS (39805 40139,40387 40530,40609 40663) SGN-E301516+ PGS (39831 40139,40387 40530,40609 40661) SGN-E275646+ PGS (40695 40761,41293 41408,41729 41896,42406 42630,45016 45114) SGN-E275920+ PGS (41322 41408,41729 41896,42406 42630,45016 45163,51393 51533) SGN-E545523+ PGS (41323 41408,41729 41896,42406 42630,45016 45057) SGN-E311119+ PGS (41350 41408,41729 41896,42406 42630,45016 45137) SGN-E238352+ PGS (41842 41896,42406 42630,45016 45159) SGN-E547310- PGS (42406 42630,45016 45153) SGN-E356631+ PGS (42406 42630,45016 45137) SGN-E349241+ 3-phase translation of AGS-1 (+strand): . . . . . . 39300 CTGTTGGAGTTGACCTGTATGTATTGTATCATCTTCTCCTTCTTCTTCCCATCAAATTCA L L E L T C M Y C I I F S F F F P S N S C W S - P V C I V S S S P S S S H Q I H V G V D L Y V L Y H L L L L L P I K F . . . . . . 39360 TGTCTTATTAGATCTATCAATATCAATATTCTTGAAGAAAACAAGTGCTACTAGTATTGG C L I R S I N I N I L E E N K C Y - Y W V L L D L S I S I F L K K T S A T S I G M S Y - I Y Q Y Q Y S - R K Q V L L V L . . . . . . 39420 ATGAGGAAACTGAGCTGAGTGCTGGGGATTTTGATTGTTTGATGGGCAACGCATGCCGTG M R K L S - V L G I L I V - W A T H A V - G N - A E C W G F - L F D G Q R M P W D E E T E L S A G D F D C L M G N A C R . . . . . . 39480 GATCTTTCGGAGGCAAAACTTTTCAGGGCTACCCTCAGCCTCAAGATCACTCAGAATCCA D L S E A K L F R A T L S L K I T Q N P I F R R Q N F S G L P S A S R S L R I Q G S F G G K T F Q G Y P Q P Q D H S E S . . . . . . 39540 ATTCCAATCCCAAACATAATTCCGATTCCCCCAACCCAAAAAAAGAACAACAACCCCTCG I P I P N I I P I P P T Q K K N N N P S F Q S Q T - F R F P Q P K K R T T T P R N S N P K H N S D S P N P K K E Q Q P L . . . . . . 39600 TCACCATGAATCGTACAAGCACTAACCAGTCCTATTACGTCCTCGGTCATAAGACCCCTA S P - I V Q A L T S P I T S S V I R P L H H E S Y K H - P V L L R P R S - D P - V T M N R T S T N Q S Y Y V L G H K T P . . . . . . 39660 ACATTCGTGATCTATACACCCTCGGCCGCAAACTAGGACAAGGCCAGTTTGGCACCACTT T F V I Y T P S A A N - D K A S L A P L H S - S I H P R P Q T R T R P V W H H L N I R D L Y T L G R K L G Q G Q F G T T . . . . . . 39720 ACTTATGCACCGAATTGTCTTCCGGTATCGACTACGCATGTAAATCTATTGCCAAGAGAA T Y A P N C L P V S T T H V N L L P R E L M H R I V F R Y R L R M - I Y C Q E K Y L C T E L S S G I D Y A C K S I A K R . . . . . . 39780 AACTCATCTCTAAGGAGGATGTAGAAGATGTCAGGAGGGAAATTCAGATAATGCACCATT N S S L R R M - K M S G G K F R - C T I T H L - G G C R R C Q E G N S D N A P F K L I S K E D V E D V R R E I Q I M H H . . . . . . 39840 TGGCTGGTCACAAAAACATCGTTTCCATCAAGGGTGCTTATGAGGATCCTTTGTATGTTC W L V T K T S F P S R V L M R I L C M F G W S Q K H R F H Q G C L - G S F V C S L A G H K N I V S I K G A Y E D P L Y V . . . . . . 39900 ATATTGTCATGGAACTTTGTGGTGGCGGTGAATTGTTTGACCGCATAATTCAAAGAGGAC I L S W N F V V A V N C L T A - F K E D Y C H G T L W W R - I V - P H N S K R T H I V M E L C G G G E L F D R I I Q R G . . . . . . 39960 ACTACACCGAGAGAAAGGCTGCCGATTTGACTAAAATTATTGTGGGTGTTGTTGAGGCAT T T P R E R L P I - L K L L W V L L R H L H R E K G C R F D - N Y C G C C - G M H Y T E R K A A D L T K I I V G V V E A . . . . . . 40020 GCCATTCACTTGGAGTTATGCATAGAGATCTCAAACCTGAGAATTTCTTGTTGGTTAACA A I H L E L C I E I S N L R I S C W L T P F T W S Y A - R S Q T - E F L V G - Q C H S L G V M H R D L K P E N F L L V N . . . . . . : 40080 AGGATGATGATTTCTCTCTCAAGGCCATTGATTTTGGACTCTCTGTATTCTTTAAGCCAG : R M M I S L S R P L I L D S L Y S L S Q : G - - F L S Q G H - F W T L C I L - A R : K D D D F S L K A I D F G L S V F F K P : . . . . . . 40387 GCCAAATTTTCACAGATGTTGTTGGGAGTCCATACTACGTTGCTCCTGAGGTGCTTTTGA A K F S Q M L L G V H T T L L L R C F - P N F H R C C W E S I L R C S - G A F E G Q I F T D V V G S P Y Y V A P E V L L . . . . . . 40447 AGCATTATGGTCCAGAAGCAGATGTTTGGACAGCAGGGGTCATACTCTATATCCTGCTAA S I M V Q K Q M F G Q Q G S Y S I S C - A L W S R S R C L D S R G H T L Y P A K K H Y G P E A D V W T A G V I L Y I L L . . . : . . . 40507 GTGGAGTTCCACCATTCTGGGCTG : AAACACAGCAGGGGATATTTGATGCAGTTCTGAAAG V E F H H S G L : K H S R G Y L M Q F - K W S S T I L G - : N T A G D I - C S S E R S G V P P F W A : E T Q Q G I F D A V L K . . . . . . 40645 GGCACATTGATTTTGACTCAGATCCTTGGCCTCTAATATCAGAGAGTGCAAAGGATCTCA G T L I L T Q I L G L - Y Q R V Q R I S A H - F - L R S L A S N I R E C K G S H G H I D F D S D P W P L I S E S A K D L . . . . . . : 40705 TCCGGAAGATGTTATGCATGCGACCCCCAGAGCGGTTAACTGCTCATGAAGTATTAT : GTC S G R C Y A C D P Q S G - L L M K Y Y : V P E D V M H A T P R A V N C S - S I M : S I R K M L C M R P P E R L T A H E V L : C . . . . . . 41296 ATCCTTGGATTTGTGAAAATGGTGTTGCTCCTGATAGAGCACTTGATCCTGCTGTACTTT I L G F V K M V L L L I E H L I L L Y F S L D L - K W C C S - - S T - S C C T F H P W I C E N G V A P D R A L D P A V L . . . . . . : 41356 CTCGCCTCAAACACTTTTCTGCAATGAACAAATTAAAAAAGATGGCTCTGCGG : GTGATTG L A S N T F L Q - T N - K R W L C G : - L S P Q T L F C N E Q I K K D G S A : G D C S R L K H F S A M N K L K K M A L R : V I . . . . . . 41736 CTGAAAGTTTGTCAGAGGAGGAGATTGCCGGTCTTAAGGAGATGTTTAAGGCCATGGATA L K V C Q R R R L P V L R R C L R P W I - K F V R G G D C R S - G D V - G H G Y A E S L S E E E I A G L K E M F K A M D . . . . . . 41796 CTGATAACAGTGGTGCAATTACATTCGATGAACTAAAAGCTGGTTTGAGAAAATATGGCT L I T V V Q L H S M N - K L V - E N M A - - Q W C N Y I R - T K S W F E K I W L T D N S G A I T F D E L K A G L R K Y G . . . . . : . 41856 CTACTCTGAAGGATATAGAGATACGGGAACTTATGGATGCG : GCTGATGTGGACAATAGTG L L - R I - R Y G N L W M R : L M W T I V Y S E G Y R D T G T Y G C : G - C G Q - W S T L K D I E I R E L M D A : A D V D N S . . . . . . 42425 GAACTATTGACTATGGAGAATTCATAGCAGCAACAATTCACCTTAACAAATTGGACCGCG E L L T M E N S - Q Q Q F T L T N W T A N Y - L W R I H S S N N S P - Q I G P R G T I D Y G E F I A A T I H L N K L D R . . . . . . 42485 AGGAACATCTCATGGCAGCATTTCAGTATTTTGACAAGGATGGAAGTGGTTATATTACAG R N I S W Q H F S I L T R M E V V I L Q G T S H G S I S V F - Q G W K W L Y Y S E E H L M A A F Q Y F D K D G S G Y I T . . . . . . 42545 TAGATGAGCTCCAGCAGGCCTGTGCAGATCATAACATTACAGATGTATTCTTTGAGGATA - M S S S R P V Q I I T L Q M Y S L R I R - A P A G L C R S - H Y R C I L - G Y V D E L Q Q A C A D H N I T D V F F E D . . . : . . . 42605 TTATCAGAGAAGTTGATCAGGATAAC : GATGGACGTATTGATTATGGAGAATTTGTTGCTA L S E K L I R I T : M D V L I M E N L L L Y Q R S - S G - : R W T Y - L W R I C C Y I I R E V D Q D N : D G R I D Y G E F V A . . . . . . 45050 TGATGCAAAAAGGAAATCCATGCATAGGAAGACGAACAATGCGAAATAGTCTGAATTTCA - C K K E I H A - E D E Q C E I V - I S D A K R K S M H R K T N N A K - S E F Q M M Q K G N P C I G R R T M R N S L N F . . . . . . : 45110 GCATGAGAGATGCGCCCGGAGCTCATTAGCTTTTTGAATGGACACATGATGTAG : GTTTTT A - E M R P E L I S F L N G H M M - : V F H E R C A R S S L A F - M D T - C R : F L S M R D A P G A H - L F E W T H D V : G F . . . . . . 51399 ACAGATAATAGAGCAGAGGCAATGAAACTGCCGTAACAATGTCTGGTACTCTTTTCTAAA T D N R A E A M K L P - Q C L V L F S K Q I I E Q R Q - N C R N N V W Y S F L K Y R - - S R G N E T A V T M S G T L F - . . . . . . 51459 AGTAGTATGCCATGCTCTCAAGTATAACTAGAAGTGCTTGTAGACTGTGCCTCAACAAAA S S M P C S Q V - L E V L V D C A S T K V V C H A L K Y N - K C L - T V P Q Q N K - Y A M L S S I T R S A C R L C L N K . . 51519 TGTGAAATCTCTGTC C E I S V V K S L M - N L C Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-4_AGS-1_PPS_1 (39395 40139,40387 40530,40609 40761,41293 41408,41729 41896,42406 42630,45016 45138) (frame '0'; 1671 bp, 557 residues) 1 RKQVLLVLDE ETELSAGDFD CLMGNACRGS FGGKTFQGYP QPQDHSESNS NPKHNSDSPN 61 PKKEQQPLVT MNRTSTNQSY YVLGHKTPNI RDLYTLGRKL GQGQFGTTYL CTELSSGIDY 121 ACKSIAKRKL ISKEDVEDVR REIQIMHHLA GHKNIVSIKG AYEDPLYVHI VMELCGGGEL 181 FDRIIQRGHY TERKAADLTK IIVGVVEACH SLGVMHRDLK PENFLLVNKD DDFSLKAIDF 241 GLSVFFKPGQ IFTDVVGSPY YVAPEVLLKH YGPEADVWTA GVILYILLSG VPPFWAETQQ 301 GIFDAVLKGH IDFDSDPWPL ISESAKDLIR KMLCMRPPER LTAHEVLCHP WICENGVAPD 361 RALDPAVLSR LKHFSAMNKL KKMALRVIAE SLSEEEIAGL KEMFKAMDTD NSGAITFDEL 421 KAGLRKYGST LKDIEIRELM DAADVDNSGT IDYGEFIAAT IHLNKLDREE HLMAAFQYFD 481 KDGSGYITVD ELQQACADHN ITDVFFEDII REVDQDNDGR IDYGEFVAMM QKGNPCIGRR 541 TMRNSLNFSM RDAPGAH- AGS-2 (41729 41896,42406 42630,45016 45159,51393 51695) SCR (e 1.000 d 0.985 a 0.999,e 1.000 d 0.956 a 0.995,e 1.000 d 0.994 a 0.659,e 0.997) Exon 1 41729 41896 ( 168 n); score: 1.000 Intron 1 41897 42405 ( 509 n); Pd: 0.985 Pa: 0.999 Exon 2 42406 42630 ( 225 n); score: 1.000 Intron 2 42631 45015 (2385 n); Pd: 0.956 Pa: 0.995 Exon 3 45016 45159 ( 144 n); score: 1.000 Intron 3 45160 51392 (6233 n); Pd: 0.994 Pa: 0.659 Exon 4 51393 51695 ( 303 n); score: 0.997 PGS (41729 41896,42406 42630,45016 45159,51393 51695) SGN-E542636- 3-phase translation of AGS-2 (+strand): . . . . . . 41729 GTGATTGCTGAAAGTTTGTCAGAGGAGGAGATTGCCGGTCTTAAGGAGATGTTTAAGGCC V I A E S L S E E E I A G L K E M F K A - L L K V C Q R R R L P V L R R C L R P D C - K F V R G G D C R S - G D V - G . . . . . . 41789 ATGGATACTGATAACAGTGGTGCAATTACATTCGATGAACTAAAAGCTGGTTTGAGAAAA M D T D N S G A I T F D E L K A G L R K W I L I T V V Q L H S M N - K L V - E N H G Y - - Q W C N Y I R - T K S W F E K . . . . . : . 41849 TATGGCTCTACTCTGAAGGATATAGAGATACGGGAACTTATGGATGCG : GCTGATGTGGAC Y G S T L K D I E I R E L M D A : A D V D M A L L - R I - R Y G N L W M R : L M W T I W L Y S E G Y R D T G T Y G C : G - C G . . . . . . 42418 AATAGTGGAACTATTGACTATGGAGAATTCATAGCAGCAACAATTCACCTTAACAAATTG N S G T I D Y G E F I A A T I H L N K L I V E L L T M E N S - Q Q Q F T L T N W Q - W N Y - L W R I H S S N N S P - Q I . . . . . . 42478 GACCGCGAGGAACATCTCATGGCAGCATTTCAGTATTTTGACAAGGATGGAAGTGGTTAT D R E E H L M A A F Q Y F D K D G S G Y T A R N I S W Q H F S I L T R M E V V I G P R G T S H G S I S V F - Q G W K W L . . . . . . 42538 ATTACAGTAGATGAGCTCCAGCAGGCCTGTGCAGATCATAACATTACAGATGTATTCTTT I T V D E L Q Q A C A D H N I T D V F F L Q - M S S S R P V Q I I T L Q M Y S L Y Y S R - A P A G L C R S - H Y R C I L . . . . : . . 42598 GAGGATATTATCAGAGAAGTTGATCAGGATAAC : GATGGACGTATTGATTATGGAGAATTT E D I I R E V D Q D N : D G R I D Y G E F R I L S E K L I R I T : M D V L I M E N L - G Y Y Q R S - S G - : R W T Y - L W R I . . . . . . 45043 GTTGCTATGATGCAAAAAGGAAATCCATGCATAGGAAGACGAACAATGCGAAATAGTCTG V A M M Q K G N P C I G R R T M R N S L L L - C K K E I H A - E D E Q C E I V - C C Y D A K R K S M H R K T N N A K - S . . . . . . : 45103 AATTTCAGCATGAGAGATGCGCCCGGAGCTCATTAGCTTTTTGAATGGACACATGAT : GTT N F S M R D A P G A H - L F E W T H D : V I S A - E M R P E L I S F L N G H M M : F E F Q H E R C A R S S L A F - M D T - : C . . . . . . 51396 TTTACAGATAATAGAGCAGAGGCAATGAAACTGCCGTAACAATGTCTGGTACTCTTTTCT F T D N R A E A M K L P - Q C L V L F S L Q I I E Q R Q - N C R N N V W Y S F L F Y R - - S R G N E T A V T M S G T L F . . . . . . 51456 AAAAGTAGTATGCCATGCTCTCAAGTATAACTAGAAGTGCTTGTAGACTGTGCCTCAACA K S S M P C S Q V - L E V L V D C A S T K V V C H A L K Y N - K C L - T V P Q Q - K - Y A M L S S I T R S A C R L C L N . . . . . . 51516 AAATGTGAAATCTCTGTCGTGTGTGAAATCATTTCAGCTACCTAGTGTTCTTTAGTTGAG K C E I S V V C E I I S A T - C S L V E N V K S L S C V K S F Q L P S V L - L R K M - N L C R V - N H F S Y L V F F S - . . . . . . 51576 GCTTCATGCTTGCTTCAGTTAGAAGGTGGTTCACCTTGAGGTGTATCCTTGTCAATTACA A S C L L Q L E G G S P - G V S L S I T L H A C F S - K V V H L E V Y P C Q L H G F M L A S V R R W F T L R C I L V N Y . . . . . . 51636 TAATTATGTATTTTACCCATTGGTTTTTCTCTATCGGGAGATTGTTTTTAAGGAAAAGAA - L C I L P I G F S L S G D C F - G K E N Y V F Y P L V F L Y R E I V F K E K I I M Y F T H W F F S I G R L F L R K R Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-4_AGS-2_PPS_1 (41729 41896,42406 42630,45016 45138) (frame '1'; 513 bp, 171 residues) 1 VIAESLSEEE IAGLKEMFKA MDTDNSGAIT FDELKAGLRK YGSTLKDIEI RELMDAADVD 61 NSGTIDYGEF IAATIHLNKL DREEHLMAAF QYFDKDGSGY ITVDELQQAC ADHNITDVFF 121 EDIIREVDQD NDGRIDYGEF VAMMQKGNPC IGRRTMRNSL NFSMRDAPGA H- AGS-3 (42451 42630,45016 45163,51382 51782,51983 51991) SCR (e 0.978 d 0.956 a 0.995,e 1.000 d 0.985 a 0.815,e 0.995 d 0.000 a 0.513,e 0.889) Exon 1 42451 42630 ( 180 n); score: 0.978 Intron 1 42631 45015 (2385 n); Pd: 0.956 Pa: 0.995 Exon 2 45016 45163 ( 148 n); score: 1.000 Intron 2 45164 51381 (6218 n); Pd: 0.985 Pa: 0.815 Exon 3 51382 51782 ( 401 n); score: 0.995 Intron 3 51783 51982 ( 200 n); Pd: 0.000 Pa: 0.513 Exon 4 51983 51991 ( 9 n); score: 0.889 PGS (42451 42630,45016 45163,51382 51782,51983 51991) SGN-E395372- 3-phase translation of AGS-3 (+strand): . . . . . . 42451 GCAGCAACAATTCACCTTAACAAATTGGACCGCGAGGAACATCTCATGGCAGCATTTCAG A A T I H L N K L D R E E H L M A A F Q Q Q Q F T L T N W T A R N I S W Q H F S S N N S P - Q I G P R G T S H G S I S . . . . . . 42511 TATTTTGACAAGGATGGAAGTGGTTATATTACAGTAGATGAGCTCCAGCAGGCCTGTGCA Y F D K D G S G Y I T V D E L Q Q A C A I L T R M E V V I L Q - M S S S R P V Q V F - Q G W K W L Y Y S R - A P A G L C . . . . . . : 42571 GATCATAACATTACAGATGTATTCTTTGAGGATATTATCAGAGAAGTTGATCAGGATAAC : D H N I T D V F F E D I I R E V D Q D N : I I T L Q M Y S L R I L S E K L I R I T : R S - H Y R C I L - G Y Y Q R S - S G - : . . . . . . 45016 GATGGACGTATTGATTATGGAGAATTTGTTGCTATGATGCAAAAAGGAAATCCATGCATA D G R I D Y G E F V A M M Q K G N P C I M D V L I M E N L L L - C K K E I H A - R W T Y - L W R I C C Y D A K R K S M H . . . . . . 45076 GGAAGACGAACAATGCGAAATAGTCTGAATTTCAGCATGAGAGATGCGCCCGGAGCTCAT G R R T M R N S L N F S M R D A P G A H E D E Q C E I V - I S A - E M R P E L I R K T N N A K - S E F Q H E R C A R S S . . . : . . . 45136 TAGCTTTTTGAATGGACACATGATGTAG : CTAGTTTGCAGGTTTTTACAGATAATAGAGCA - L F E W T H D V : A S L Q V F T D N R A S F L N G H M M - : L V C R F L Q I I E Q L A F - M D T - C S : - F A G F Y R - - S . . . . . . 51414 GAGGCAATGAAACTGCCGTAACAATGTCTGGTACTCTTTTCTAAAAGTAGTATGCCATGC E A M K L P - Q C L V L F S K S S M P C R Q - N C R N N V W Y S F L K V V C H A R G N E T A V T M S G T L F - K - Y A M . . . . . . 51474 TCTCAAGTATAACTAGAAGTGCTTGTAGACTGTGCCTCAACAAAATGTGAAATCTCTGTC S Q V - L E V L V D C A S T K C E I S V L K Y N - K C L - T V P Q Q N V K S L S L S S I T R S A C R L C L N K M - N L C . . . . . . 51534 GTGTGTGAAATCATTTCAGCTACCTAGTGTTCTTTAGTTGAGGCTTCATGCTTGCTTCAG V C E I I S A T - C S L V E A S C L L Q C V K S F Q L P S V L - L R L H A C F S R V - N H F S Y L V F F S - G F M L A S . . . . . . 51594 TTAGAAGGTGGTTCACCTTGAGGTGTATCCTTGTCAATTACATAATTATGTATTTTACCC L E G G S P - G V S L S I T - L C I L P - K V V H L E V Y P C Q L H N Y V F Y P V R R W F T L R C I L V N Y I I M Y F T . . . . . . 51654 ATTGGTTTTTCTCTATCGGGAGATTGTTTTTAAGGAAAAGAACACGATTTGTTGTAACAA I G F S L S G D C F - G K E H D L L - Q L V F L Y R E I V F K E K N T I C C N N H W F F S I G R L F L R K R T R F V V T . . . . . . 51714 TTTACGCAAGCTATATTTGCAGAACATGGTCAGTCATTTATGATGACGTGCTTAATTATT F T Q A I F A E H G Q S F M M T C L I I L R K L Y L Q N M V S H L - - R A - L F I Y A S Y I C R T W S V I Y D D V L N Y . : . 51774 CTCAACATA : AAAGAAAAA L N I : K E K S T - : K K S Q H : K R K Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-4_AGS-3_PPS_1 (42451 42630,45016 45138) (frame '1'; 300 bp, 100 residues) 1 AATIHLNKLD REEHLMAAFQ YFDKDGSGYI TVDELQQACA DHNITDVFFE DIIREVDQDN 61 DGRIDYGEFV AMMQKGNPCI GRRTMRNSLN FSMRDAPGAH - >C01HBa0088L02.1+_PGL-4_AGS-3_PPS_2 (51575 51782,51983 51990) (frame '0'; 216 bp, 72 residues) 1 GFMLASVRRW FTLRCILVNY IIMYFTHWFF SIGRLFLRKR TRFVVTIYAS YICRTWSVIY 61 DDVLNYSQHK RK AGS-4 (42485 42630,45016 45159,51382 51780) SCR (e 1.000 d 0.956 a 0.995,e 1.000 d 0.994 a 0.815,e 0.997) Exon 1 42485 42630 ( 146 n); score: 1.000 Intron 1 42631 45015 (2385 n); Pd: 0.956 Pa: 0.995 Exon 2 45016 45159 ( 144 n); score: 1.000 Intron 2 45160 51381 (6222 n); Pd: 0.994 Pa: 0.815 Exon 3 51382 51780 ( 399 n); score: 0.997 PGS (42485 42630,45016 45159,51382 51780) SGN-E357930+ 3-phase translation of AGS-4 (+strand): . . . . . . 42485 AGGAACATCTCATGGCAGCATTTCAGTATTTTGACAAGGATGGAAGTGGTTATATTACAG R N I S W Q H F S I L T R M E V V I L Q G T S H G S I S V F - Q G W K W L Y Y S E H L M A A F Q Y F D K D G S G Y I T . . . . . . 42545 TAGATGAGCTCCAGCAGGCCTGTGCAGATCATAACATTACAGATGTATTCTTTGAGGATA - M S S S R P V Q I I T L Q M Y S L R I R - A P A G L C R S - H Y R C I L - G Y V D E L Q Q A C A D H N I T D V F F E D . . . : . . . 42605 TTATCAGAGAAGTTGATCAGGATAAC : GATGGACGTATTGATTATGGAGAATTTGTTGCTA L S E K L I R I T : M D V L I M E N L L L Y Q R S - S G - : R W T Y - L W R I C C Y I I R E V D Q D N : D G R I D Y G E F V A . . . . . . 45050 TGATGCAAAAAGGAAATCCATGCATAGGAAGACGAACAATGCGAAATAGTCTGAATTTCA - C K K E I H A - E D E Q C E I V - I S D A K R K S M H R K T N N A K - S E F Q M M Q K G N P C I G R R T M R N S L N F . . . . . : . 45110 GCATGAGAGATGCGCCCGGAGCTCATTAGCTTTTTGAATGGACACATGAT : CTAGTTTGCA A - E M R P E L I S F L N G H M I : - F A H E R C A R S S L A F - M D T - : S S L Q S M R D A P G A H - L F E W T H D : L V C . . . . . . 51392 GGTTTTTACAGATAATAGAGCAGAGGCAATGAAACTGCCGTAACAATGTCTGGTACTCTT G F Y R - - S R G N E T A V T M S G T L V F T D N R A E A M K L P - Q C L V L F R F L Q I I E Q R Q - N C R N N V W Y S . . . . . . 51452 TTCTAAAAGTAGTATGCCATGCTCTCAAGTATAACTAGAAGTGCTTGTAGACTGTGCCTC F - K - Y A M L S S I T R S A C R L C L S K S S M P C S Q V - L E V L V D C A S F L K V V C H A L K Y N - K C L - T V P . . . . . . 51512 AACAAAATGTGAAATCTCTGTCGTGTGTGAAATCATTTCAGCTACCTAGTGTTCTTTAGT N K M - N L C R V - N H F S Y L V F F S T K C E I S V V C E I I S A T - C S L V Q Q N V K S L S C V K S F Q L P S V L - . . . . . . 51572 TGAGGCTTCATGCTTGCTTCAGTTAGAAGGTGGTTCACCTTGAGGTGTATCCTTGTCAAT - G F M L A S V R R W F T L R C I L V N E A S C L L Q L E G G S P - G V S L S I L R L H A C F S - K V V H L E V Y P C Q . . . . . . 51632 TACATAATTATGTATTTTACCCATTGGTTTTTCTCTATCGGGAGATTGTTTTTAAGGAAA Y I I M Y F T H W F F S I G R L F L R K T - L C I L P I G F S L S G D C F - G K L H N Y V F Y P L V F L Y R E I V F K E . . . . . . 51692 AGAACACGATTTGTTGTAACAATTTACGCAAGCTATATTTGCAGAACATGGTCAGTCATT R T R F V V T I Y A S Y I C R T W S V I E H D L L - Q F T Q A I F A E H G Q S F K N T I C C N N L R K L Y L Q N M V S H . . . 51752 TATGATGACGTGCTTAATTATTCTCAACA Y D D V L N Y S Q M M T C L I I L N L - - R A - L F S T Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-4_AGS-4_PPS_1 (42487 42630,45016 45138) (frame '0'; 264 bp, 88 residues) 1 EHLMAAFQYF DKDGSGYITV DELQQACADH NITDVFFEDI IREVDQDNDG RIDYGEFVAM 61 MQKGNPCIGR RTMRNSLNFS MRDAPGAH- >C01HBa0088L02.1+_PGL-4_AGS-4_PPS_2 (51575 51778) (frame '1'; 204 bp, 68 residues) 1 GFMLASVRRW FTLRCILVNY IIMYFTHWFF SIGRLFLRKR TRFVVTIYAS YICRTWSVIY 61 DDVLNYSQ AGS-5 (46948 47376) SCR (e 0.913) Exon 1 46948 47376 ( 429 n); score: 0.913 PGS (46948 47049) SGN-E240526+ PGS (46952 47154) SGN-E544203- PGS (46953 47295) SGN-E253695+ PGS (46953 47237) SGN-E249253+ PGS (46953 47061) SGN-E577960+ PGS (46956 47213) SGN-E242674- PGS (46956 47213) SGN-E233074- PGS (46956 47213) SGN-E233735- PGS (46956 47213) SGN-E377238- PGS (46956 47213) SGN-E240879- PGS (46956 47212) SGN-E237992- PGS (46959 47086) SGN-E376754- PGS (46961 47213) SGN-E233594- PGS (46977 47058) SGN-E217478- PGS (46977 47058) SGN-E229134- PGS (46977 47058) SGN-E228654- PGS (47037 47282) SGN-E204223- PGS (47062 47282) SGN-E374844- PGS (47111 47376) SGN-E578392- PGS (47211 47299) SGN-E546063- PGS (47233 47289) SGN-E577899- PGS (47285 47359) SGN-E391901+ PGS (47310 47365) SGN-E547334+ PGS (47310 47365) SGN-E547335- 3-phase translation of AGS-5 (+strand): . . . . . . 46948 TACACAAATTAAGAGCCTGTTTGGCTCAGCTTAAAAGCTGGTCAAACTGACTTAAAATCT Y T N - E P V W L S L K A G Q T D L K S T Q I K S L F G S A - K L V K L T - N L H K L R A C L A Q L K S W S N - L K I . . . . . . 47008 GATTTTTGACTTATTTAACTGTTTGACAATACTCAAAATAGCTTATTTTAAGTTAAAAAA D F - L I - L F D N T Q N S L F - V K K I F D L F N C L T I L K I A Y F K L K K - F L T Y L T V - Q Y S K - L I L S - K . . . . . . 47068 AACTTATTTTAAGCCAAAAGTTAAAAGGTGGGGTAGGGGTGCTTTTTTTTTTTAGCTTAT N L F - A K S - K V G - G C F F F L A Y T Y F K P K V K R W G R G A F F F - L I K L I L S Q K L K G G V G V L F F F S L . . . . . . 47128 AAGCTGTTTTAAGTTGACCATATTTTTATGTTTTTTCCCTTAATATTTTTATACAATCTC K L F - V D H I F M F F P L I F L Y N L S C F K L T I F L C F F P - Y F Y T I S - A V L S - P Y F Y V F S L N I F I Q S . . . . . . 47188 CAAATTATCCATATAACCCTAACATCTCTTTCTTCTATTTTTCCCTTTTCACGTTTGGCA Q I I H I T L T S L S S I F P F S R L A K L S I - P - H L F L L F F P F H V W H P N Y P Y N P N I S F F Y F S L F T F G . . . . . . 47248 TAACAACTTCAGCACTTTTATCCAAACGCATAACTGCTTATTTTAAAAATAAGTTTCAGC - Q L Q H F Y P N A - L L I L K I S F S N N F S T F I Q T H N C L F - K - V S A I T T S A L L S K R I T A Y F K N K F Q . . . . . . 47308 ACTTTCAAAAGTACTTTTTTAAAGCTGCTTTTATTAAGCCCATCCAAACGGGCTCTAAAT T F K S T F L K L L L L S P S K R A L N L S K V L F - S C F Y - A H P N G L - I H F Q K Y F F K A A F I K P I Q T G S K . 47368 ATATAAATA I - I Y K Y I N Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-4_AGS-5_PPS_1 (47145 47375) (frame '0'; 231 bp, 77 residues) 1 PYFYVFSLNI FIQSPNYPYN PNISFFYFSL FTFGITTSAL LSKRITAYFK NKFQHFQKYF 61 FKAAFIKPIQ TGSKYIN 3-phase translation of AGS-5 (-strand): . . . . . . 47376 TATTTATATATTTAGAGCCCGTTTGGATGGGCTTAATAAAAGCAGCTTTAAAAAAGTACT Y L Y I - S P F G W A - - K Q L - K S T I Y I F R A R L D G L N K S S F K K V L F I Y L E P V W M G L I K A A L K K Y . . . . . . 47316 TTTGAAAGTGCTGAAACTTATTTTTAAAATAAGCAGTTATGCGTTTGGATAAAAGTGCTG F E S A E T Y F - N K Q L C V W I K V L L K V L K L I F K I S S Y A F G - K C - F - K C - N L F L K - A V M R L D K S A . . . . . . 47256 AAGTTGTTATGCCAAACGTGAAAAGGGAAAAATAGAAGAAAGAGATGTTAGGGTTATATG K L L C Q T - K G K N R R K R C - G Y M S C Y A K R E K G K I E E R D V R V I W E V V M P N V K R E K - K K E M L G L Y . . . . . . 47196 GATAATTTGGAGATTGTATAAAAATATTAAGGGAAAAAACATAAAAATATGGTCAACTTA D N L E I V - K Y - G K K H K N M V N L I I W R L Y K N I K G K N I K I W S T - G - F G D C I K I L R E K T - K Y G Q L . . . . . . 47136 AAACAGCTTATAAGCTAAAAAAAAAAAGCACCCCTACCCCACCTTTTAACTTTTGGCTTA K Q L I S - K K K A P L P H L L T F G L N S L - A K K K K H P Y P T F - L L A - K T A Y K L K K K S T P T P P F N F W L . . . . . . 47076 AAATAAGTTTTTTTTAACTTAAAATAAGCTATTTTGAGTATTGTCAAACAGTTAAATAAG K - V F F N L K - A I L S I V K Q L N K N K F F L T - N K L F - V L S N S - I S K I S F F - L K I S Y F E Y C Q T V K - . . . . . . 47016 TCAAAAATCAGATTTTAAGTCAGTTTGACCAGCTTTTAAGCTGAGCCAAACAGGCTCTTA S K I R F - V S L T S F - A E P N R L L Q K S D F K S V - P A F K L S Q T G S - V K N Q I L S Q F D Q L L S - A K Q A L . 46956 ATTTGTGTA I C V F V N L C Maximal non-overlapping open reading frames (>= 64 codons): none AGS-6 (50395 51029) SCR (e 0.998) Exon 1 50395 51029 ( 635 n); score: 0.998 PGS (50395 51029) SGN-E368044+ PGS (50395 50795) SGN-E240728+ 3-phase translation of AGS-6 (+strand): . . . . . . 50395 TACATGCACCTAGTGGAATAGTCAAGATACATGCATGTTGGGTTGAAGGCACCTTAGTCT Y M H L V E - S R Y M H V G L K A P - S T C T - W N S Q D T C M L G - R H L S L H A P S G I V K I H A C W V E G T L V . . . . . . 50455 TATAGAATTGTCAAATCAGAATATTTAGTATGATGTATCATGTGTTCTTGAACACTCGTA Y R I V K S E Y L V - C I M C S - T L V I E L S N Q N I - Y D V S C V L E H S - L - N C Q I R I F S M M Y H V F L N T R . . . . . . 50515 GAACTAATTCTGTTTTCCAACCATTAGTTGACTCTATCAAAAGAATATCAAGTTGAAGCT E L I L F S N H - L T L S K E Y Q V E A N - F C F P T I S - L Y Q K N I K L K L R T N S V F Q P L V D S I K R I S S - S . . . . . . 50575 AGTTGAGATGTAGGTAGAATATCTATTAACCAACTTATCTCCATGTAGTTCTATTCAGTT S - D V G R I S I N Q L I S M - F Y S V V E M - V E Y L L T N L S P C S S I Q F - L R C R - N I Y - P T Y L H V V L F S . . . . . . 50635 CCATTTCATCCAATATTGTATAATTTACCTTAAAACTACAAGTCCGATGTGTTCCACACT P F H P I L Y N L P - N Y K S D V F H T H F I Q Y C I I Y L K T T S P M C S T L S I S S N I V - F T L K L Q V R C V P H . . . . . . 50695 TTCAGGAATATAAAAGTCTAACACTGTGCCTATTATCAGCTAACAAGTAACAACTCTCTA F R N I K V - H C A Y Y Q L T S N N S L S G I - K S N T V P I I S - Q V T T L Y F Q E Y K S L T L C L L S A N K - Q L S . . . . . . 50755 TTTCAAATAGCTGGCATTGCCTACATGGATCATTTACTTTTGTTAGGTTACGGTCTTAGT F Q I A G I A Y M D H L L L L G Y G L S F K - L A L P T W I I Y F C - V T V L V I S N S W H C L H G S F T F V R L R S - . . . . . . 50815 TAAGTTCTACCAGAGATATTGCACGTCCTTTAGGATAACTCATCTCCTTGTGATTTTAGG - V L P E I L H V L - D N S S P C D F R K F Y Q R Y C T S F R I T H L L V I L G L S S T R D I A R P L G - L I S L - F - . . . . . . 50875 TGTACTTTGCTTATTTGAAATGATGCAAGGTTTTATTACTTTTTTTTTCTAAGAGATTTT C T L L I - N D A R F Y Y F F F L R D F V L C L F E M M Q G F I T F F F - E I F V Y F A Y L K - C K V L L L F F S K R F . . . . . . 50935 CATTGTATATGTATCCACCAAAAGAATAATACGAAGAAAAAAAATGAGAGAGGAAGAAAC H C I C I H Q K N N T K K K N E R G R N I V Y V S T K R I I R R K K M R E E E T S L Y M Y P P K E - Y E E K K - E R K K . . . . 50995 AGATCTGCTTCCAAGTTGTGACATAATTTTATCGA R S A S K L - H N F I D L L P S C D I I L S Q I C F Q V V T - F Y R Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-6 (-strand): . . . . . . 51029 TCGATAAAATTATGTCACAACTTGGAAGCAGATCTGTTTCTTCCTCTCTCATTTTTTTTC S I K L C H N L E A D L F L P L S F F F R - N Y V T T W K Q I C F F L S H F F S D K I M S Q L G S R S V S S S L I F F . . . . . . 50969 TTCGTATTATTCTTTTGGTGGATACATATACAATGAAAATCTCTTAGAAAAAAAAAGTAA F V L F F W W I H I Q - K S L R K K K - S Y Y S F G G Y I Y N E N L L E K K S N L R I I L L V D T Y T M K I S - K K K V . . . . . . 50909 TAAAACCTTGCATCATTTCAAATAAGCAAAGTACACCTAAAATCACAAGGAGATGAGTTA - N L A S F Q I S K V H L K S Q G D E L K T L H H F K - A K Y T - N H K E M S Y I K P C I I S N K Q S T P K I T R R - V . . . . . . 50849 TCCTAAAGGACGTGCAATATCTCTGGTAGAACTTAACTAAGACCGTAACCTAACAAAAGT S - R T C N I S G R T - L R P - P N K S P K G R A I S L V E L N - D R N L T K V I L K D V Q Y L W - N L T K T V T - Q K . . . . . . 50789 AAATGATCCATGTAGGCAATGCCAGCTATTTGAAATAGAGAGTTGTTACTTGTTAGCTGA K - S M - A M P A I - N R E L L L V S - N D P C R Q C Q L F E I E S C Y L L A D - M I H V G N A S Y L K - R V V T C - L . . . . . . 50729 TAATAGGCACAGTGTTAGACTTTTATATTCCTGAAAGTGTGGAACACATCGGACTTGTAG - - A Q C - T F I F L K V W N T S D L - N R H S V R L L Y S - K C G T H R T C S I I G T V L D F Y I P E S V E H I G L V . . . . . . 50669 TTTTAAGGTAAATTATACAATATTGGATGAAATGGAACTGAATAGAACTACATGGAGATA F - G K L Y N I G - N G T E - N Y M E I F K V N Y T I L D E M E L N R T T W R - V L R - I I Q Y W M K W N - I E L H G D . . . . . . 50609 AGTTGGTTAATAGATATTCTACCTACATCTCAACTAGCTTCAACTTGATATTCTTTTGAT S W L I D I L P T S Q L A S T - Y S F D V G - - I F Y L H L N - L Q L D I L L I K L V N R Y S T Y I S T S F N L I F F - . . . . . . 50549 AGAGTCAACTAATGGTTGGAAAACAGAATTAGTTCTACGAGTGTTCAAGAACACATGATA R V N - W L E N R I S S T S V Q E H M I E S T N G W K T E L V L R V F K N T - Y - S Q L M V G K Q N - F Y E C S R T H D . . . . . . 50489 CATCATACTAAATATTCTGATTTGACAATTCTATAAGACTAAGGTGCCTTCAACCCAACA H H T K Y S D L T I L - D - G A F N P T I I L N I L I - Q F Y K T K V P S T Q H T S Y - I F - F D N S I R L R C L Q P N . . . . 50429 TGCATGTATCTTGACTATTCCACTAGGTGCATGTA C M Y L D Y S T R C M A C I L T I P L G A C M H V S - L F H - V H V Maximal non-overlapping open reading frames (>= 64 codons): none AGS-7 (51059 51778) SCR (e 0.994) Exon 1 51059 51778 ( 720 n); score: 0.994 PGS (51059 51778) SGN-E350932+ PGS (51062 51778) SGN-E352074+ 3-phase translation of AGS-7 (+strand): . . . . . . 51059 GCCACTGAGTTAACTCGCCATTCTTCTCTTCTTTAGACAAGCCTGATAAGGAAAGCTGAT A T E L T R H S S L L - T S L I R K A D P L S - L A I L L F F R Q A - - G K L I H - V N S P F F S S L D K P D K E S - . . . . . . 51119 TCTTAACAATGTGTTGGGCATCAAAGGTTTTCTTTTGTTCTCCTTCAAAATGCACATAGG S - Q C V G H Q R F S F V L L Q N A H R L N N V L G I K G F L L F S F K M H I G F L T M C W A S K V F F C S P S K C T - . . . . . . 51179 TAAGGTACTTATTCATAGTACAATTATTTGGCATATATTGTAGTTACACACGTGCTTGTG - G T Y S - Y N Y L A Y I V V T H V L V K V L I H S T I I W H I L - L H T C L C V R Y L F I V Q L F G I Y C S Y T R A C . . . . . . 51239 TACTTGTTCTACTAAAATGTTGTTATGACTTTGTAAGCTAGGTTAAATATCACAGAACAT Y L F Y - N V V M T L - A R L N I T E H T C S T K M L L - L C K L G - I S Q N M V L V L L K C C Y D F V S - V K Y H R T . . . . . . 51299 GGTGCATCTTTCATTTGGAGCATGAACTTGTGTTTCACTCTTGGTCAAGTTATGTGTAAA G A S F I W S M N L C F T L G Q V M C K V H L S F G A - T C V S L L V K L C V K W C I F H L E H E L V F H S W S S Y V - . . . . . . 51359 AGGTATTCTGACATTCATGTCAGCTAGTTTGCAGGTTTTTACAGATAATAGAGCAGAGGC R Y S D I H V S - F A G F Y R - - S R G G I L T F M S A S L Q V F T D N R A E A K V F - H S C Q L V C R F L Q I I E Q R . . . . . . 51419 AATGAAACTGCCGTAACAATGTCTGGTACTCTTTTCTAAAAGTAGTATGCCATGCTCTCA N E T A V T M S G T L F - K - Y A M L S M K L P - Q C L V L F S K S S M P C S Q Q - N C R N N V W Y S F L K V V C H A L . . . . . . 51479 AGTATAACTAGAAGTGCTTGTAGACTGTGCCTCAACAAAATGTGAAATCTCTGTCGTGTG S I T R S A C R L C L N K M - N L C R V V - L E V L V D C A S T K C E I S V V C K Y N - K C L - T V P Q Q N V K S L S C . . . . . . 51539 TGAAATCATTTCAGCTACCTAGTGTTCTTTAGTTGAGGCTTCATGCTTGCTTCAGTTAGA - N H F S Y L V F F S - G F M L A S V R E I I S A T - C S L V E A S C L L Q L E V K S F Q L P S V L - L R L H A C F S - . . . . . . 51599 AGGTGGTTCACCTTGAGGTGTATCCTTGTCAATTACATAATTATGTATTTTACCCATTGG R W F T L R C I L V N Y I I M Y F T H W G G S P - G V S L S I T - L C I L P I G K V V H L E V Y P C Q L H N Y V F Y P L . . . . . . 51659 TTTTTCTCTATCGGGAGATTGTTTTTAAGGAAAAGAACACGATTTGTTGTAACAATTTAC F F S I G R L F L R K R T R F V V T I Y F S L S G D C F - G K E H D L L - Q F T V F L Y R E I V F K E K N T I C C N N L . . . . . . 51719 GCAAGCTATATTTGCAGAACATGGTCAGTCATTTATGATGACGTGCTTAATTATTCTCAA A S Y I C R T W S V I Y D D V L N Y S Q Q A I F A E H G Q S F M M T C L I I L R K L Y L Q N M V S H L - - R A - L F S Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-4_AGS-7_PPS_1 (51575 51778) (frame '1'; 204 bp, 68 residues) 1 GFMLASVRRW FTLRCILVNY IIMYFTHWFF SIGRLFLRKR TRFVVTIYAS YICRTWSVIY 61 DDVLNYSQ 3-phase translation of AGS-7 (-strand): . . . . . . 51778 TTGAGAATAATTAAGCACGTCATCATAAATGACTGACCATGTTCTGCAAATATAGCTTGC L R I I K H V I I N D - P C S A N I A C - E - L S T S S - M T D H V L Q I - L A E N N - A R H H K - L T M F C K Y S L . . . . . . 51718 GTAAATTGTTACAACAAATCGTGTTCTTTTCCTTAAAAACAATCTCCCGATAGAGAAAAA V N C Y N K S C S F P - K Q S P D R E K - I V T T N R V L F L K N N L P I E K N R K L L Q Q I V F F S L K T I S R - R K . . . . . . 51658 CCAATGGGTAAAATACATAATTATGTAATTGACAAGGATACACCTCAAGGTGAACCACCT P M G K I H N Y V I D K D T P Q G E P P Q W V K Y I I M - L T R I H L K V N H L T N G - N T - L C N - Q G Y T S R - T T . . . . . . 51598 TCTAACTGAAGCAAGCATGAAGCCTCAACTAAAGAACACTAGGTAGCTGAAATGATTTCA S N - S K H E A S T K E H - V A E M I S L T E A S M K P Q L K N T R - L K - F H F - L K Q A - S L N - R T L G S - N D F . . . . . . 51538 CACACGACAGAGATTTCACATTTTGTTGAGGCACAGTCTACAAGCACTTCTAGTTATACT H T T E I S H F V E A Q S T S T S S Y T T R Q R F H I L L R H S L Q A L L V I L T H D R D F T F C - G T V Y K H F - L Y . . . . . . 51478 TGAGAGCATGGCATACTACTTTTAGAAAAGAGTACCAGACATTGTTACGGCAGTTTCATT - E H G I L L L E K S T R H C Y G S F I E S M A Y Y F - K R V P D I V T A V S L L R A W H T T F R K E Y Q T L L R Q F H . . . . . . 51418 GCCTCTGCTCTATTATCTGTAAAAACCTGCAAACTAGCTGACATGAATGTCAGAATACCT A S A L L S V K T C K L A D M N V R I P P L L Y Y L - K P A N - L T - M S E Y L C L C S I I C K N L Q T S - H E C Q N T . . . . . . 51358 TTTACACATAACTTGACCAAGAGTGAAACACAAGTTCATGCTCCAAATGAAAGATGCACC F T H N L T K S E T Q V H A P N E R C T L H I T - P R V K H K F M L Q M K D A P F Y T - L D Q E - N T S S C S K - K M H . . . . . . 51298 ATGTTCTGTGATATTTAACCTAGCTTACAAAGTCATAACAACATTTTAGTAGAACAAGTA M F C D I - P S L Q S H N N I L V E Q V C S V I F N L A Y K V I T T F - - N K Y H V L - Y L T - L T K S - Q H F S R T S . . . . . . 51238 CACAAGCACGTGTGTAACTACAATATATGCCAAATAATTGTACTATGAATAAGTACCTTA H K H V C N Y N I C Q I I V L - I S T L T S T C V T T I Y A K - L Y Y E - V P Y T Q A R V - L Q Y M P N N C T M N K Y L . . . . . . 51178 CCTATGTGCATTTTGAAGGAGAACAAAAGAAAACCTTTGATGCCCAACACATTGTTAAGA P M C I L K E N K R K P L M P N T L L R L C A F - R R T K E N L - C P T H C - E T Y V H F E G E Q K K T F D A Q H I V K . . . . . . 51118 ATCAGCTTTCCTTATCAGGCTTGTCTAAAGAAGAGAAGAATGGCGAGTTAACTCAGTGGC I S F P Y Q A C L K K R R M A S - L S G S A F L I R L V - R R E E W R V N S V N Q L S L S G L S K E E K N G E L T Q W Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-4_AGS-7_PPS_1 (51475 51281) (frame '1'; 192 bp, 64 residues) 1 EHGILLLEKS TRHCYGSFIA SALLSVKTCK LADMNVRIPF THNLTKSETQ VHAPNERCTM 61 FCDI- PGL 5 (- strand): 53094 52333 AGS-1 (53094 52333) SCR (e 1.000) Exon 1 53094 52333 ( 762 n); score: 1.000 PGS (53094 52333) SGN-E545557+ PGS (53094 52339) SGN-E545556- PGS (52901 52454) SGN-E297960+ PGS (53093 52575) SGN-E311040+ 3-phase translation of AGS-1 (-strand): . . . . . . 53094 CTCTTCTTCAAAGTTTTCAGAGCAAAGAAGCTCTGCCCATGTCGCAACCTACAGAAGAAG L F F K V F R A K K L C P C R N L Q K K S S S K F S E Q R S S A H V A T Y R R R L L Q S F Q S K E A L P M S Q P T E E . . . . . . 53034 AAAGAGGAGAAGGACTTGGCGTGCGCAAAAGGCTGTCTTCTCTCTCTCTAAGGATGAACA K E E K D L A C A K G C L L S L - G - T K R R R T W R A Q K A V F S L S K D E H E R G E G L G V R K R L S S L S L R M N . . . . . . 52974 TGCGCATGAGGTCTACTTGTCAACAACAACAACCCATCCTCTCATTCTACTCCTCTACCT C A - G L L V N N N N P S S H S T P L P A H E V Y L S T T T T H P L I L L L Y L M R M R S T C Q Q Q Q P I L S F Y S S T . . . . . . 52914 CCTCATCCTCATGGGCATTTCGCCGATCCAAATCCTTGTCCGAATACACTGGTAATTCCA P H P H G H F A D P N P C P N T L V I P L I L M G I S P I Q I L V R I H W - F H S S S S W A F R R S K S L S E Y T G N S . . . . . . 52854 TTAGGAAATGGTGGGATTGGGGATTGGGCTGGATCATGTCCAAGAAGCCAGCCTTTGCCA L G N G G I G D W A G S C P R S Q P L P - E M V G L G I G L D H V Q E A S L C Q I R K W W D W G L G W I M S K K P A F A . . . . . . 52794 ACGATCTGGAAATGAATGAAGAGGAGAAAGCCGTATTGGGATGCAACAGCAAGGGCAGCT T I W K - M K R R K P Y W D A T A R A A R S G N E - R G E S R I G M Q Q Q G Q L N D L E M N E E E K A V L G C N S K G S . . . . . . 52734 GGAGGCACGTATTTTTCAAAATAAGGTCGGAGCTGCGGAGGTTCACCGGCTCCGGCAACA G G T Y F S K - G R S C G G S P A P A T E A R I F Q N K V G A A E V H R L R Q Q W R H V F F K I R S E L R R F T G S G N . . . . . . 52674 ATATGGGTCTACCTCAAACCTTCCGGTATGACTACTCCAGGAACTTCGATGACAACTTAA I W V Y L K P S G M T T P G T S M T T - Y G S T S N L P V - L L Q E L R - Q L N N M G L P Q T F R Y D Y S R N F D D N L . . . . . . 52614 TCAGGAACAACTGATGTATTATTACTCTACTATTCCCACTGTGATGTTGGTTAATTCATT S G T T D V L L L Y Y S H C D V G - F I Q E Q L M Y Y Y S T I P T V M L V N S L I R N N - C I I T L L F P L - C W L I H . . . . . . 52554 GATTGATTTGAGTCGTTTTGTTTTTATATATTAATAATAGATCGGAGTTCACATGGAGTA D - F E S F C F Y I L I I D R S S H G V I D L S R F V F I Y - - - I G V H M E Y - L I - V V L F L Y I N N R S E F T W S . . . . . . 52494 CGTACGTAAATGTATAAAGTGAATTACTTTTATCTTCATCATATAGTCAGTCAGTCCAGT R T - M Y K V N Y F Y L H H I V S Q S S V R K C I K - I T F I F I I - S V S P V T Y V N V - S E L L L S S S Y S Q S V Q . . . . . . 52434 CCATTACGTTGTATTATTATTTTCCCCTCGTGTAATTCTTTTTACCATTCTCGAGTGTAT P L R C I I I F P S C N S F Y H S R V Y H Y V V L L F S P R V I L F T I L E C I S I T L Y Y Y F P L V - F F L P F S S V . . . . . 52374 TTGATTTTTATGCATAAGCACTACTGCTATAAATTTGCCTAA L I F M H K H Y C Y K F A - - F L C I S T T A I N L P F D F Y A - A L L L - I C L Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-5_AGS-1_PPS_1 (53092 52601) (frame '0'; 489 bp, 163 residues) 1 LLQSFQSKEA LPMSQPTEEE RGEGLGVRKR LSSLSLRMNM RMRSTCQQQQ PILSFYSSTS 61 SSSWAFRRSK SLSEYTGNSI RKWWDWGLGW IMSKKPAFAN DLEMNEEEKA VLGCNSKGSW 121 RHVFFKIRSE LRRFTGSGNN MGLPQTFRYD YSRNFDDNLI RNN- 3-phase translation of AGS-1 (+strand): . . . . . . 52333 TTAGGCAAATTTATAGCAGTAGTGCTTATGCATAAAAATCAAATACACTCGAGAATGGTA L G K F I A V V L M H K N Q I H S R M V - A N L - Q - C L C I K I K Y T R E W - R Q I Y S S S A Y A - K S N T L E N G . . . . . . 52393 AAAAGAATTACACGAGGGGAAAATAATAATACAACGTAATGGACTGGACTGACTGACTAT K R I T R G E N N N T T - W T G L T D Y K E L H E G K I I I Q R N G L D - L T I K K N Y T R G K - - Y N V M D W T D - L . . . . . . 52453 ATGATGAAGATAAAAGTAATTCACTTTATACATTTACGTACGTACTCCATGTGAACTCCG M M K I K V I H F I H L R T Y S M - T P - - R - K - F T L Y I Y V R T P C E L R Y D E D K S N S L Y T F T Y V L H V N S . . . . . . 52513 ATCTATTATTAATATATAAAAACAAAACGACTCAAATCAATCAATGAATTAACCAACATC I Y Y - Y I K T K R L K S I N E L T N I S I I N I - K Q N D S N Q S M N - P T S D L L L I Y K N K T T Q I N Q - I N Q H . . . . . . 52573 ACAGTGGGAATAGTAGAGTAATAATACATCAGTTGTTCCTGATTAAGTTGTCATCGAAGT T V G I V E - - Y I S C S - L S C H R S Q W E - - S N N T S V V P D - V V I E V H S G N S R V I I H Q L F L I K L S S K . . . . . . 52633 TCCTGGAGTAGTCATACCGGAAGGTTTGAGGTAGACCCATATTGTTGCCGGAGCCGGTGA S W S S H T G R F E V D P Y C C R S R - P G V V I P E G L R - T H I V A G A G E F L E - S Y R K V - G R P I L L P E P V . . . . . . 52693 ACCTCCGCAGCTCCGACCTTATTTTGAAAAATACGTGCCTCCAGCTGCCCTTGCTGTTGC T S A A P T L F - K I R A S S C P C C C P P Q L R P Y F E K Y V P P A A L A V A N L R S S D L I L K N T C L Q L P L L L . . . . . . 52753 ATCCCAATACGGCTTTCTCCTCTTCATTCATTTCCAGATCGTTGGCAAAGGCTGGCTTCT I P I R L S P L H S F P D R W Q R L A S S Q Y G F L L F I H F Q I V G K G W L L H P N T A F S S S F I S R S L A K A G F . . . . . . 52813 TGGACATGATCCAGCCCAATCCCCAATCCCACCATTTCCTAATGGAATTACCAGTGTATT W T - S S P I P N P T I S - W N Y Q C I G H D P A Q S P I P P F P N G I T S V F L D M I Q P N P Q S H H F L M E L P V Y . . . . . . 52873 CGGACAAGGATTTGGATCGGCGAAATGCCCATGAGGATGAGGAGGTAGAGGAGTAGAATG R T R I W I G E M P M R M R R - R S R M G Q G F G S A K C P - G - G G R G V E - S D K D L D R R N A H E D E E V E E - N . . . . . . 52933 AGAGGATGGGTTGTTGTTGTTGACAAGTAGACCTCATGCGCATGTTCATCCTTAGAGAGA R G W V V V V D K - T S C A C S S L E R E D G L L L L T S R P H A H V H P - R E E R M G C C C - Q V D L M R M F I L R E . . . . . . 52993 GAGAAGACAGCCTTTTGCGCACGCCAAGTCCTTCTCCTCTTTCTTCTTCTGTAGGTTGCG E K T A F C A R Q V L L L F L L L - V A R R Q P F A H A K S F S S F F F C R L R R E D S L L R T P S P S P L S S S V G C . . . . . 53053 ACATGGGCAGAGCTTCTTTGCTCTGAAAACTTTGAAGAAGAG T W A E L L C S E N F E E E H G Q S F F A L K T L K K D M G R A S L L - K L - R R Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-5_AGS-1_PPS_1 (52662 52928) (frame '0'; 264 bp, 88 residues) 1 GRPILLPEPV NLRSSDLILK NTCLQLPLLL HPNTAFSSSF ISRSLAKAGF LDMIQPNPQS 61 HHFLMELPVY SDKDLDRRNA HEDEEVEE- >C01HBa0088L02.1+_PGL-5_AGS-1_PPS_2 (52667 52906) (frame '2'; 237 bp, 79 residues) 1 THIVAGAGEP PQLRPYFEKY VPPAALAVAS QYGFLLFIHF QIVGKGWLLG HDPAQSPIPP 61 FPNGITSVFG QGFGSAKCP- PGL 6 (- strand): 54340 53607 AGS-1 (54340 53607) SCR (e 0.999) Exon 1 54340 53607 ( 734 n); score: 0.999 PGS (54340 53607) SGN-E378936- PGS (54115 53607) SGN-E209039- 3-phase translation of AGS-1 (-strand): . . . . . . 54340 AACAAAAAAAGGGGGACTAGGAACAAGGAATCTGAAATTACAAAACTACAACTTGCTAAT N K K R G T R N K E S E I T K L Q L A N T K K G G L G T R N L K L Q N Y N L L M Q K K G D - E Q G I - N Y K T T T C - . . . . . . 54280 GAAATGGCTGAGGAGATTTTCATCACAAGAACAAATGCTGTGGACAGATACCATTAAGGT E M A E E I F I T R T N A V D R Y H - G K W L R R F S S Q E Q M L W T D T I K V - N G - G D F H H K N K C C G Q I P L R . . . . . . 54220 CAGGTATGGAATGGATACAAGGTGGATCAACAACATAGCAACACAACCATATGGCACCGG Q V W N G Y K V D Q Q H S N T T I W H R R Y G M D T R W I N N I A T Q P Y G T G S G M E W I Q G G S T T - Q H N H M A P . . . . . . 54160 AGTGTGGAGGACAATTAGGAATCTATGGCCACAACTTATAAACAAGTGCATAATTTAAGA S V E D N - E S M A T T Y K Q V H N L R V W R T I R N L W P Q L I N K C I I - D E C G G Q L G I Y G H N L - T S A - F K . . . . . . 54100 TAGGATATGGTGGGAAAACTTTGTTTTGGGTGGGACAGGCTTCATTCAAAGTTAGTTTCC - D M V G K L C F G W D R L H S K L V S R I W W E N F V L G G T G F I Q S - F P I G Y G G K T L F W V G Q A S F K V S F . . . . . . 54040 TTGACCTATTCAGCTTAAGTCTACAGAAAGTGGTCACTGTCAAAGAAATGAGAGATGCTC L T Y S A - V Y R K W S L S K K - E M L - P I Q L K S T E S G H C Q R N E R C S L D L F S L S L Q K V V T V K E M R D A . . . . . . 53980 AGGGTTGGAACTTAAGGTTCAGGAGACCTTTAAACGATTGGTAGGTGAATAGCATGGTTG R V G T - G S G D L - T I G R - I A W L G L E L K V Q E T F K R L V G E - H G - Q G W N L R F R R P L N D W - V N S M V . . . . . . 53920 AATTTCTGAATATCCTGGAATGATGCAAGGAACTCAATAACAGTGAAAACAAACTATTAT N F - I S W N D A R N S I T V K T N Y Y I S E Y P G M M Q G T Q - Q - K Q T I M E F L N I L E - C K E L N N S E N K L L . . . . . . 53860 GGGCTCTAGATAAACATGGGAGATTCTCAGTTGGAGCATCTTACAGAAACTCCCAGAGGA G L - I N M G D S Q L E H L T E T P R G G S R - T W E I L S W S I L Q K L P E D W A L D K H G R F S V G A S Y R N S Q R . . . . . . 53800 CACACACTCAACCAAGCTACTGGCCATGAAAAATGATCTGGAAAATTAAGGTGGCCTGTT H T L N Q A T G H E K - S G K L R W P V T H S T K L L A M K N D L E N - G G L F T H T Q P S Y W P - K M I W K I K V A C . . . . . . 53740 TTACTTGGCTATTAGCAAAACAGGTTGTTCTCACACAGGATAACCGTATGAAGAAGGGCC L L G Y - Q N R L F S H R I T V - R R A Y L A I S K T G C S H T G - P Y E E G P F T W L L A K Q V V L T Q D N R M K K G . . . . . . 53680 TCCATTTGTGCTGTAGATGTTTTTTTGTGAATGTGAGGCAGAGACCATAAATGATCTCTT S I C A V D V F L - M - G R D H K - S L P F V L - M F F C E C E A E T I N D L F L H L C C R C F F V N V R Q R P - M I S . . 53620 TTTACACTGTAAGA F T L - L H C K F Y T V R Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-6_AGS-1_PPS_1 (54339 54103) (frame '2'; 234 bp, 78 residues) 1 TKKGGLGTRN LKLQNYNLLM KWLRRFSSQE QMLWTDTIKV RYGMDTRWIN NIATQPYGTG 61 VWRTIRNLWP QLINKCII- 3-phase translation of AGS-1 (+strand): . . . . . . 53607 TCTTACAGTGTAAAAAGAGATCATTTATGGTCTCTGCCTCACATTCACAAAAAAACATCT S Y S V K R D H L W S L P H I H K K T S L T V - K E I I Y G L C L T F T K K H L L Q C K K R S F M V S A S H S Q K N I . . . . . . 53667 ACAGCACAAATGGAGGCCCTTCTTCATACGGTTATCCTGTGTGAGAACAACCTGTTTTGC T A Q M E A L L H T V I L C E N N L F C Q H K W R P F F I R L S C V R T T C F A Y S T N G G P S S Y G Y P V - E Q P V L . . . . . . 53727 TAATAGCCAAGTAAAACAGGCCACCTTAATTTTCCAGATCATTTTTCATGGCCAGTAGCT - - P S K T G H L N F P D H F S W P V A N S Q V K Q A T L I F Q I I F H G Q - L L I A K - N R P P - F S R S F F M A S S . . . . . . 53787 TGGTTGAGTGTGTGTCCTCTGGGAGTTTCTGTAAGATGCTCCAACTGAGAATCTCCCATG W L S V C P L G V S V R C S N - E S P M G - V C V L W E F L - D A P T E N L P C L V E C V S S G S F C K M L Q L R I S H . . . . . . 53847 TTTATCTAGAGCCCATAATAGTTTGTTTTCACTGTTATTGAGTTCCTTGCATCATTCCAG F I - S P - - F V F T V I E F L A S F Q L S R A H N S L F S L L L S S L H H S R V Y L E P I I V C F H C Y - V P C I I P . . . . . . 53907 GATATTCAGAAATTCAACCATGCTATTCACCTACCAATCGTTTAAAGGTCTCCTGAACCT D I Q K F N H A I H L P I V - R S P E P I F R N S T M L F T Y Q S F K G L L N L G Y S E I Q P C Y S P T N R L K V S - T . . . . . . 53967 TAAGTTCCAACCCTGAGCATCTCTCATTTCTTTGACAGTGACCACTTTCTGTAGACTTAA - V P T L S I S H F F D S D H F L - T - K F Q P - A S L I S L T V T T F C R L K L S S N P E H L S F L - Q - P L S V D L . . . . . . 54027 GCTGAATAGGTCAAGGAAACTAACTTTGAATGAAGCCTGTCCCACCCAAAACAAAGTTTT A E - V K E T N F E - S L S H P K Q S F L N R S R K L T L N E A C P T Q N K V F S - I G Q G N - L - M K P V P P K T K F . . . . . . 54087 CCCACCATATCCTATCTTAAATTATGCACTTGTTTATAAGTTGTGGCCATAGATTCCTAA P T I S Y L K L C T C L - V V A I D S - P P Y P I L N Y A L V Y K L W P - I P N S H H I L S - I M H L F I S C G H R F L . . . . . . 54147 TTGTCCTCCACACTCCGGTGCCATATGGTTGTGTTGCTATGTTGTTGATCCACCTTGTAT L S S T L R C H M V V L L C C - S T L Y C P P H S G A I W L C C Y V V D P P C I I V L H T P V P Y G C V A M L L I H L V . . . . . . 54207 CCATTCCATACCTGACCTTAATGGTATCTGTCCACAGCATTTGTTCTTGTGATGAAAATC P F H T - P - W Y L S T A F V L V M K I H S I P D L N G I C P Q H L F L - - K S S I P Y L T L M V S V H S I C S C D E N . . . . . . 54267 TCCTCAGCCATTTCATTAGCAAGTTGTAGTTTTGTAATTTCAGATTCCTTGTTCCTAGTC S S A I S L A S C S F V I S D S L F L V P Q P F H - Q V V V L - F Q I P C S - S L L S H F I S K L - F C N F R F L V P S . . 54327 CCCCTTTTTTTGTT P L F L P F F C P P F F V Maximal non-overlapping open reading frames (>= 64 codons): none PGL 7 (- strand): 55578 54872 AGS-1 (55578 54872) SCR (e 0.997) Exon 1 55578 54872 ( 707 n); score: 0.997 PGS (55578 54872) SGN-E378976+ 3-phase translation of AGS-1 (-strand): . . . . . . 55578 GGGTGGCGTGGCACCCCCACGAGCCTTCCTAGATCCTCCCCTGACCATAAATGAGGTGCG G W R G T P T S L P R S S P D H K - G A G G V A P P R A F L D P P L T I N E V R V A W H P H E P S - I L P - P - M R C . . . . . . 55518 GTTATCAGTGAAGAAGACAATTTAATGATACAATGTTAATTTAGTGAGGTGAGATCAAAG V I S E E D N L M I Q C - F S E V R S K L S V K K T I - - Y N V N L V R - D Q R G Y Q - R R Q F N D T M L I - - G E I K . . . . . . 55458 AATATGTGATGGCACCTGGACTGGATGGTTTCACCATGACATTTTTCACCAATTGCTGGG N M - W H L D W M V S P - H F S P I A G I C D G T W T G W F H H D I F H Q L L G E Y V M A P G L D G F T M T F F T N C W . . . . . . 55398 AAATAGTAAGCAAACTAGTGGCAGCAGTTCAGAACTTACATAATCAGAACATTTTTGAAA K - - A N - W Q Q F R T Y I I R T F L K N S K Q T S G S S S E L T - S E H F - K E I V S K L V A A V Q N L H N Q N I F E . . . . . . 55338 GAAGCTTCAATGCCACCTTCATAGCTTAATAGGCAGCATATGTAAGATCATCTCAAAAGT E A S M P P S - L N R Q H M - D H L K S K L Q C H L H S L I G S I C K I I S K V R S F N A T F I A - - A A Y V R S S Q K . . . . . . 55278 GTTTACTGAGAGGCTGAAAAGAAGTCGTTTCAAAACTAGTAGATACGCATCCGATGGAAT V Y - E A E K K S F Q N - - I R I R W N F T E R L K R S R F K T S R Y A S D G I C L L R G - K E V V S K L V D T H P M E . . . . . . 55218 TTATTTAGGGTAGGGAGATCATGGATGCTATTGTGATTGCCAACGAATGTGTAGATGTGA L F R V G R S W M L L - L P T N V - M - Y L G - G D H G C Y C D C Q R M C R C E F I - G R E I M D A I V I A N E C V D V . . . . . . 55158 GGCAAATTAGCAAGGTCCTAGGCATTCTTTGTAAGATGGATAGAGAGAAAGCCTATGACC G K L A R S - A F F V R W I E R K P M T A N - Q G P R H S L - D G - R E S L - P R Q I S K V L G I L C K M D R E K A Y D . . . . . . 55098 ACTTAAATTGGGGTTTCCTATGGAAGAATTTGGAAAACATGGGTTTTGGGGAAAGATGGA T - I G V S Y G R I W K T W V L G K D G L K L G F P M E E F G K H G F W G K M D H L N W G F L W K N L E N M G F G E R W . . . . . . 55038 TAAACTGGATCAAATCTTGCACCAGTATAGTGAAATTTTCAGTTTTAATTAATGACTCTC - T G S N L A P V - - N F Q F - L M T L K L D Q I L H Q Y S E I F S F N - - L S I N W I K S C T S I V K F S V L I N D S . . . . . . 54978 CCACAAGTTTCTTCTCATCTGAGAGAGGCCTGAGACAAAGGGGATCCATTATCTCCTTCT P Q V S S H L R E A - D K G D P L S P S H K F L L I - E R P E T K G I H Y L L L P T S F F S S E R G L R Q R G S I I S F . . . . . 54918 CTCTTTATCTGGGCAATGGAGGGTCTGAATGATATAGTAAGAACAGC L F I W A M E G L N D I V R T S L S G Q W R V - M I - - E Q S L Y L G N G G S E - Y S K N S Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-7_AGS-1_PPS_1 (55210 54887) (frame '0'; 321 bp, 107 residues) 1 GREIMDAIVI ANECVDVRQI SKVLGILCKM DREKAYDHLN WGFLWKNLEN MGFGERWINW 61 IKSCTSIVKF SVLINDSPTS FFSSERGLRQ RGSIISFSLY LGNGGSE- 3-phase translation of AGS-1 (+strand): . . . . . . 54872 GCTGTTCTTACTATATCATTCAGACCCTCCATTGCCCAGATAAAGAGAGAAGGAGATAAT A V L T I S F R P S I A Q I K R E G D N L F L L Y H S D P P L P R - R E K E I M C S Y Y I I Q T L H C P D K E R R R - . . . . . . 54932 GGATCCCCTTTGTCTCAGGCCTCTCTCAGATGAGAAGAAACTTGTGGGAGAGTCATTAAT G S P L S Q A S L R - E E T C G R V I N D P L C L R P L S D E K K L V G E S L I W I P F V S G L S Q M R R N L W E S H - . . . . . . 54992 TAAAACTGAAAATTTCACTATACTGGTGCAAGATTTGATCCAGTTTATCCATCTTTCCCC - N - K F H Y T G A R F D P V Y P S F P K T E N F T I L V Q D L I Q F I H L S P L K L K I S L Y W C K I - S S L S I F P . . . . . . 55052 AAAACCCATGTTTTCCAAATTCTTCCATAGGAAACCCCAATTTAAGTGGTCATAGGCTTT K T H V F Q I L P - E T P I - V V I G F K P M F S K F F H R K P Q F K W S - A F Q N P C F P N S S I G N P N L S G H R L . . . . . . 55112 CTCTCTATCCATCTTACAAAGAATGCCTAGGACCTTGCTAATTTGCCTCACATCTACACA L S I H L T K N A - D L A N L P H I Y T S L S I L Q R M P R T L L I C L T S T H S L Y P S Y K E C L G P C - F A S H L H . . . . . . 55172 TTCGTTGGCAATCACAATAGCATCCATGATCTCCCTACCCTAAATAAATTCCATCGGATG F V G N H N S I H D L P T L N K F H R M S L A I T I A S M I S L P - I N S I G C I R W Q S Q - H P - S P Y P K - I P S D . . . . . . 55232 CGTATCTACTAGTTTTGAAACGACTTCTTTTCAGCCTCTCAGTAAACACTTTTGAGATGA R I Y - F - N D F F S A S Q - T L L R - V S T S F E T T S F Q P L S K H F - D D A Y L L V L K R L L F S L S V N T F E M . . . . . . 55292 TCTTACATATGCTGCCTATTAAGCTATGAAGGTGGCATTGAAGCTTCTTTCAAAAATGTT S Y I C C L L S Y E G G I E A S F K N V L T Y A A Y - A M K V A L K L L S K M F I L H M L P I K L - R W H - S F F Q K C . . . . . . 55352 CTGATTATGTAAGTTCTGAACTGCTGCCACTAGTTTGCTTACTATTTCCCAGCAATTGGT L I M - V L N C C H - F A Y Y F P A I G - L C K F - T A A T S L L T I S Q Q L V S D Y V S S E L L P L V C L L F P S N W . . . . . . 55412 GAAAAATGTCATGGTGAAACCATCCAGTCCAGGTGCCATCACATATTCTTTGATCTCACC E K C H G E T I Q S R C H H I F F D L T K N V M V K P S S P G A I T Y S L I S P - K M S W - N H P V Q V P S H I L - S H . . . . . . 55472 TCACTAAATTAACATTGTATCATTAAATTGTCTTCTTCACTGATAACCGCACCTCATTTA S L N - H C I I K L S S S L I T A P H L H - I N I V S L N C L L H - - P H L I Y L T K L T L Y H - I V F F T D N R T S F . . . . . 55532 TGGTCAGGGGAGGATCTAGGAAGGCTCGTGGGGGTGCCACGCCACCC W S G E D L G R L V G V P R H G Q G R I - E G S W G C H A T M V R G G S R K A R G G A T P P Maximal non-overlapping open reading frames (>= 64 codons): none PGL 8 (- strand): 60930 59726 AGS-1 (60594 60355,59993 59726) SCR (e 1.000 d 1.000 a 0.930,e 1.000) Exon 1 60594 60355 ( 240 n); score: 1.000 Intron 1 60354 59994 ( 361 n); Pd: 1.000 Pa: 0.930 Exon 2 59993 59726 ( 268 n); score: 1.000 PGS (60594 60355,59993 59726) SGN-E344267+ 3-phase translation of AGS-1 (-strand): . . . . . . 60594 TTCAAACAAAAGGTGAGTGTGAACGACAAGTTAGGAAGGCCAGCTGTTACAGCTGTTGAC F K Q K V S V N D K L G R P A V T A V D S N K R - V - T T S - E G Q L L Q L L T Q T K G E C E R Q V R K A S C Y S C - . . . . . . 60534 AGTTCCAATATCTGGTGGGCACTGTTTGAAGAAGCTATCATCAAAGCTAATGCCAGACTT S S N I W W A L F E E A I I K A N A R L V P I S G G H C L K K L S S K L M P D L Q F Q Y L V G T V - R S Y H Q S - C Q T . . . . . . 60474 GGAAAACCAGAAATATTTCCTGCATCAACAGATGCACGCTATTTTCGAGAGCGAGGCCTG G K P E I F P A S T D A R Y F R E R G L E N Q K Y F L H Q Q M H A I F E S E A C W K T R N I S C I N R C T L F S R A R P . . . . . . : 60414 CCAGCAATAGGATTTTCTCCGATGGCAAACACTCCCATTCTTCTTCACGACCACAATGAG : P A I G F S P M A N T P I L L H D H N E : Q Q - D F L R W Q T L P F F F T T T M S : A S N R I F S D G K H S H S S S R P Q - : . . . . . . 59993 TTCTTGAACAAGGATGAGTATCTGAAAGGTATTGATGTTTATGAATCAATAATCAAAACA F L N K D E Y L K G I D V Y E S I I K T S - T R M S I - K V L M F M N Q - S K H V L E Q G - V S E R Y - C L - I N N Q N . . . . . . 59933 TATGCATCTTATATTCAGTATCAAAGAGATGATGCTTCGAGAGAGGAATTGTGAGCAAGT Y A S Y I Q Y Q R D D A S R E E L - A S M H L I F S I K E M M L R E R N C E Q V I C I L Y S V S K R - C F E R G I V S K . . . . . . 59873 TGTATTGAAGCAACCTTGAGCTCGTCTTGTCTTGTAGTATTGTATATATAAGTGAAGGCC C I E A T L S S S C L V V L Y I - V K A V L K Q P - A R L V L - Y C I Y K - R P L Y - S N L E L V L S C S I V Y I S E G . . . . . . 59813 GCAGAGCAGTTGGAAATCTCTGCAACATCTTTCTGCTGTACGAATAAACAACATGGATAT A E Q L E I S A T S F C C T N K Q H G Y Q S S W K S L Q H L S A V R I N N M D I R R A V G N L C N I F L L Y E - T T W I . . . 59753 TTCATAATCATTGAAGAACAGTTCCATG F I I I E E Q F H S - S L K N S S M F H N H - R T V P Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-8_AGS-1_PPS_1 (60594 60355,59993 59880) (frame '1'; 351 bp, 117 residues) 1 FKQKVSVNDK LGRPAVTAVD SSNIWWALFE EAIIKANARL GKPEIFPAST DARYFRERGL 61 PAIGFSPMAN TPILLHDHNE FLNKDEYLKG IDVYESIIKT YASYIQYQRD DASREEL- AGS-2 (60930 60765) SCR (e 0.907) Exon 1 60930 60765 ( 166 n); score: 0.907 PGS (60930 60765) SGN-E342366+ 3-phase translation of AGS-2 (-strand): . . . . . . 60930 TTATGAAGATAGATCCAATTCCATCTAGAAAGTTAAATGGAATTGTAAAATATCTTTCTA L - R - I Q F H L E S - M E L - N I F L Y E D R S N S I - K V K W N C K I S F Y M K I D P I P S R K L N G I V K Y L S . . . . . . 60870 CTTTTGGTGTAAAGAAGTAGGTTTCGAGGATATAGATCAGTTTGTAGATTTATTAAGATC L L V - R S R F R G Y R S V C R F I K I F W C K E V G F E D I D Q F V D L L R S T F G V K K - V S R I - I S L - I Y - D . . . . . 60810 TCTGTAAGTATCTTCTTTTCTATATGTTTTTTTTATTGAACACTTT S V S I F F S I C F F Y - T L L - V S S F L Y V F F I E H F L C K Y L L F Y M F F L L N T Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-2 (+strand): . . . . . . 60765 AAAGTGTTCAATAAAAAAAACATATAGAAAAGAAGATACTTACAGAGATCTTAATAAATC K V F N K K N I - K R R Y L Q R S - - I K C S I K K T Y R K E D T Y R D L N K S S V Q - K K H I E K K I L T E I L I N . . . . . . 60825 TACAAACTGATCTATATCCTCGAAACCTACTTCTTTACACCAAAAGTAGAAAGATATTTT Y K L I Y I L E T Y F F T P K V E R Y F T N - S I S S K P T S L H Q K - K D I L L Q T D L Y P R N L L L Y T K S R K I F . . . . . 60885 ACAATTCCATTTAACTTTCTAGATGGAATTGGATCTATCTTCATAA T I P F N F L D G I G S I F I Q F H L T F - M E L D L S S - Y N S I - L S R W N W I Y L H Maximal non-overlapping open reading frames (>= 64 codons): none PGL 9 (- strand): 63360 61936 AGS-1 (63360 62436,62073 61936) SCR (e 1.000 d 0.965 a 1.000,e 0.992) Exon 1 63360 62436 ( 925 n); score: 1.000 Intron 1 62435 62074 ( 362 n); Pd: 0.965 Pa: 1.000 Exon 2 62073 61936 ( 138 n); score: 0.992 PGS (63028 62436,62073 61936) SGN-E333478+ PGS (63028 62436,62073 61943) SGN-E333365+ PGS (62998 62442) SGN-E305912+ PGS (62994 62518) SGN-E318831+ PGS (63334 62833) SGN-E302876+ PGS (63360 62915) SGN-E301766+ PGS (63308 63088) SGN-E248170+ 3-phase translation of AGS-1 (-strand): . . . . . . 63360 TTGATCGGCTCCAAACGAAAATTTATAACCTGTTCTATTGATTTTAATTCATCTGGAGTG L I G S K R K F I T C S I D F N S S G V - S A P N E N L - P V L L I L I H L E - D R L Q T K I Y N L F Y - F - F I W S . . . . . . 63300 AAAAGCAGTGATGAGCAAGACCGGCTATTATCTTGATTTGCGTGTGTTTCTGGTCACACT K S S D E Q D R L L S - F A C V S G H T K A V M S K T G Y Y L D L R V F L V T L E K Q - - A R P A I I L I C V C F W S H . . . . . . 63240 CATACTCATAATCACAACTAGGACGGCCGCTAAAGATCCGTCAACAATCCTATCAAGATT H T H N H N - D G R - R S V N N P I K I I L I I T T R T A A K D P S T I L S R F S Y S - S Q L G R P L K I R Q Q S Y Q D . . . . . . 63180 CCAGCAGTACCTTCAGATCAATACAGCCCAACCTCACCCCAACTACTATGAAGCTGCCGA P A V P S D Q Y S P T S P Q L L - S C R Q Q Y L Q I N T A Q P H P N Y Y E A A E S S S T F R S I Q P N L T P T T M K L P . . . . . . 63120 ATTTATAATATCACAGGCCAAGTTACTATCCCTCGAGTCCCAGACCCTTGAGTTCGTCAA I Y N I T G Q V T I P R V P D P - V R Q F I I S Q A K L L S L E S Q T L E F V K N L - Y H R P S Y Y P S S P R P L S S S . . . . . . 63060 GGGCAAACCTCTAATTCTCCTCAAATGGCCAGGCAAAGACCCTACCCTCCCTTCCATCCT G Q T S N S P Q M A R Q R P Y P P F H P G K P L I L L K W P G K D P T L P S I L R A N L - F S S N G Q A K T L P S L P S . . . . . . 63000 CCTTAACTCACATACCGATGTTGTCCCTTCCGAGCATCACAAGTGGACTCACCCACCTTT P - L T Y R C C P F R A S Q V D S P T F L N S H T D V V P S E H H K W T H P P F S L T H I P M L S L P S I T S G L T H L . . . . . . 62940 CTCTGCCCACTTAGATTCCACTACCGGCAACATCTTCGCCCGAGGTTCTCAGGATATGAA L C P L R F H Y R Q H L R P R F S G Y E S A H L D S T T G N I F A R G S Q D M K S L P T - I P L P A T S S P E V L R I - . . . . . . 62880 ATGCGTCGGCTTGCAGTACCTCGAGGCCATTCGCAAACTCAAATCTTATGGCTTCCGCCC M R R L A V P R G H S Q T Q I L W L P P C V G L Q Y L E A I R K L K S Y G F R P N A S A C S T S R P F A N S N L M A S A . . . . . . 62820 CCTGCGCACTCTCTACCTCTCCTTCCTCCCCGACGAGGAGATCGGTGGAAATGATGGTGC P A H S L P L L P P R R G D R W K - W C L R T L Y L S F L P D E E I G G N D G A P C A L S T S P S S P T R R S V E M M V . . . . . . 62760 CAGAAAGTTTGTTGATTCAGATGTCTTTGCCAAGATGAATGTTGGGATTGTTCTTGACGA Q K V C - F R C L C Q D E C W D C S - R R K F V D S D V F A K M N V G I V L D E P E S L L I Q M S L P R - M L G L F L T . . . . . . 62700 GGGCTTGGCCTCTCCCACTGACAATTATCGTGCATTCTATGGAGAGAGGTCCCCCTGGTG G L G L S H - Q L S C I L W R E V P L V G L A S P T D N Y R A F Y G E R S P W W R A W P L P L T I I V H S M E R G P P G . . . . . . 62640 GCTGGTCGTTAAGGCTGTAGGTGCTCCTGGACATGGGGCTAAGCTCTATGATAATACTGC A G R - G C R C S W T W G - A L - - Y C L V V K A V G A P G H G A K L Y D N T A G W S L R L - V L L D M G L S S M I I L . . . . . . 62580 CATGGAGAATTTACTTAAAAGTATCGAAATTATAAGGAGATTCAGGGCAGCGCAGTTTGA H G E F T - K Y R N Y K E I Q G S A V - M E N L L K S I E I I R R F R A A Q F D P W R I Y L K V S K L - G D S G Q R S L . . . . . . 62520 TCTAGTTAAGGCAGGACAGAAAGCTGAAGGCGAAGTCATTTCTGTTAATATGGTCTTCTT S S - G R T E S - R R S H F C - Y G L L L V K A G Q K A E G E V I S V N M V F L I - L R Q D R K L K A K S F L L I W S S . . . : . . . 62460 GAAAGCTGGCACCCCTTCACCCTCT : GGTTTTGTCATGAACCTGCAGCCATCTGAAGCCCA E S W H P F T L : W F C H E P A A I - S P K A G T P S P S : G F V M N L Q P S E A Q - K L A P L H P L : V L S - T C S H L K P . . . . . . 62038 AGCAGGATTTGACATCAGAGTACCACCAACTGCAGATCAGGCATCCTTGGAGAGGCTAAT S R I - H Q S T T N C R S G I L G E A N A G F D I R V P P T A D Q A S L E R L I K Q D L T S E Y H Q L Q I R H P W R G - . . . . . 61978 AGCTGATGAATGGGCACCTGCTTCGCGTAACATGACTTTTGAG S - - M G T C F A - H D F - A D E W A P A S R N M T F E - L M N G H L L R V T - L L Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-9_AGS-1_PPS_1 (63299 62436,62073 61936) (frame '2'; 1002 bp, 334 residues) 1 KAVMSKTGYY LDLRVFLVTL ILIITTRTAA KDPSTILSRF QQYLQINTAQ PHPNYYEAAE 61 FIISQAKLLS LESQTLEFVK GKPLILLKWP GKDPTLPSIL LNSHTDVVPS EHHKWTHPPF 121 SAHLDSTTGN IFARGSQDMK CVGLQYLEAI RKLKSYGFRP LRTLYLSFLP DEEIGGNDGA 181 RKFVDSDVFA KMNVGIVLDE GLASPTDNYR AFYGERSPWW LVVKAVGAPG HGAKLYDNTA 241 MENLLKSIEI IRRFRAAQFD LVKAGQKAEG EVISVNMVFL KAGTPSPSGF VMNLQPSEAQ 301 AGFDIRVPPT ADQASLERLI ADEWAPASRN MTFE PGL 10 (- strand): 68130 66759 AGS-1 (67134 66759) SCR (e 0.806) Exon 1 67134 66759 ( 376 n); score: 0.806 PGS (67134 66759) SGN-E389994- PGS (67134 66759) SGN-E235464- 3-phase translation of AGS-1 (-strand): . . . . . . 67134 TACACACAACACATAACATCTTCATATAGCACATAACATATAACACGTAGTTTCTTTCAT Y T Q H I T S S Y S T - H I T R S F F H T H N T - H L H I A H N I - H V V S F I H T T H N I F I - H I T Y N T - F L S . . . . . . 67074 ATTATTCATTCATATGCCATGAGACCTTGTTATCATGGACTTGACCTTAAGACTTCCCAA I I H S Y A M R P C Y H G L D L K T S Q L F I H M P - D L V I M D L T L R L P K Y Y S F I C H E T L L S W T - P - D F P . . . . . . 67014 AATGAGGGCTCAACATATGGGACCTCAACTAGGGAGCCTTCTTTAGCAAACACGGAGTCT N E G S T Y G T S T R E P S L A N T E S M R A Q H M G P Q L G S L L - Q T R S L K - G L N I W D L N - G A F F S K H G V . . . . . . 66954 GCTTCATTCATTTATACCGATTTCATTTCAATTCATTCATAGGTCAGTGCGAACACCAGC A S F I Y T D F I S I H S - V S A N T S L H S F I P I S F Q F I H R S V R T P A C F I H L Y R F H F N S F I G Q C E H Q . . . . . . 66894 TATACCTAGGATGTAGTTTAAGACTTTCATCGGGTTTGTTGTGCAATGATCAAGAATAAT Y T - D V V - D F H R V C C A M I K N N I P R M - F K T F I G F V V Q - S R I I L Y L G C S L R L S S G L L C N D Q E - . . . . . . 66834 CTAATGTCATTACCTGAATCTAGCTCACCTCTTGATTATCCTATCCTAACACCTTCGGTA L M S L P E S S S P L D Y P I L T P S V - C H Y L N L A H L L I I L S - H L R Y S N V I T - I - L T S - L S Y P N T F G . . 66774 TCATTCATTTCTTTAT S F I S L H S F L Y I I H F F Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-1 (+strand): . . . . . . 66759 ATAAAGAAATGAATGATACCGAAGGTGTTAGGATAGGATAATCAAGAGGTGAGCTAGATT I K K - M I P K V L G - D N Q E V S - I - R N E - Y R R C - D R I I K R - A R F K E M N D T E G V R I G - S R G E L D . . . . . . 66819 CAGGTAATGACATTAGATTATTCTTGATCATTGCACAACAAACCCGATGAAAGTCTTAAA Q V M T L D Y S - S L H N K P D E S L K R - - H - I I L D H C T T N P M K V L N S G N D I R L F L I I A Q Q T R - K S - . . . . . . 66879 CTACATCCTAGGTATAGCTGGTGTTCGCACTGACCTATGAATGAATTGAAATGAAATCGG L H P R Y S W C S H - P M N E L K - N R Y I L G I A G V R T D L - M N - N E I G T T S - V - L V F A L T Y E - I E M K S . . . . . . 66939 TATAAATGAATGAAGCAGACTCCGTGTTTGCTAAAGAAGGCTCCCTAGTTGAGGTCCCAT Y K - M K Q T P C L L K K A P - L R S H I N E - S R L R V C - R R L P S - G P I V - M N E A D S V F A K E G S L V E V P . . . . . . 66999 ATGTTGAGCCCTCATTTTGGGAAGTCTTAAGGTCAAGTCCATGATAACAAGGTCTCATGG M L S P H F G K S - G Q V H D N K V S W C - A L I L G S L K V K S M I T R S H G Y V E P S F W E V L R S S P - - Q G L M . . . . . . 67059 CATATGAATGAATAATATGAAAGAAACTACGTGTTATATGTTATGTGCTATATGAAGATG H M N E - Y E R N Y V L Y V M C Y M K M I - M N N M K E T T C Y M L C A I - R C A Y E - I I - K K L R V I C Y V L Y E D . . 67119 TTATGTGTTGTGTGTA L C V V C Y V L C V V M C C V Maximal non-overlapping open reading frames (>= 64 codons): none AGS-2 (68130 68109,67567 67172) SCR (e 0.727 d 0.900 a 0.000,e 0.918) Exon 1 68130 68109 ( 22 n); score: 0.727 Intron 1 68108 67568 ( 541 n); Pd: 0.900 Pa: 0.000 Exon 2 67567 67172 ( 396 n); score: 0.918 PGS (67490 67172) SGN-E389503+ PGS (68130 68109,67567 67323) SGN-E222944+ PGS (67568 67323) SGN-E217225+ PGS (67568 67323) SGN-E223449+ 3-phase translation of AGS-2 (-strand): . . . : . . . 68130 TTTTTTTGCTCGTTTATCTAAT : AAACAACTGAAATAAACAATTCATTAAGTATTAATTGT F F C S F I - : - T T E I N N S L S I N C F F A R L S N : K Q L K - T I H - V L I V F L L V Y L I : N N - N K Q F I K Y - L . . . . . . 67529 ATATCGGCCAAAGTAGCACCAATACAAAGTCTGAACCAAAACAGGAAAGAAACGCTAGTG I S A K V A P I Q S L N Q N R K E T L V Y R P K - H Q Y K V - T K T G K K R - W Y I G Q S S T N T K S E P K Q E R N A S . . . . . . 67469 GAACATGCTCCACTAGCTCAACTCTAAAACTACGCTAGAATGTAAAACAGTAGCATCTTC E H A P L A Q L - N Y A R M - N S S I F N M L H - L N S K T T L E C K T V A S S G T C S T S S T L K L R - N V K Q - H L . . . . . . 67409 GAAAGCATGAGGACCTACCAAACTCCGGATGAATGTTAACGTCCGAATAGCTGCAACAAC E S M R T Y Q T P D E C - R P N S C N N K A - G P T K L R M N V N V R I A A T T R K H E D L P N S G - M L T S E - L Q Q . . . . . . 67349 GAACCTGTAGCTCTACCGCCCACCTGTGTCTGCACCTAAAAGTAGATGTTTGTATGGAAT E P V A L P P T C V C T - K - M F V W N N L - L Y R P P V S A P K S R C L Y G I R T C S S T A H L C L H L K V D V C M E . . . . . . 67289 TAGTACACACTTGTACTAAGTATGGGTATATGCAAGCACACACCAGGGACATACATGAGA - Y T L V L S M G I C K H T P G T Y M R S T H L Y - V W V Y A S T H Q G H T - E L V H T C T K Y G Y M Q A H T R D I H E . . . . . . 67229 AAGAATCGCTCTTTCCTAACAACATGATTTTTGGAAGTCAGTCAGTGGACTTGCTTAT K N R S F L T T - F L E V S Q W T C L R I A L S - Q H D F W K S V S G L A Y K E S L F P N N M I F G S Q S V D L L Maximal non-overlapping open reading frames (>= 64 codons): none AGS-3 (67758 67546) SCR (e 0.852) Exon 1 67758 67546 ( 213 n); score: 0.852 PGS (67758 67546) SGN-E546254- 3-phase translation of AGS-3 (-strand): . . . . . . 67758 AATCTAGACCCCAGACGAGAACGGCGTCGTTGACCTCTCAGAGGTCACAAACAAGCCTAC N L D P R R E R R R - P L R G H K Q A Y I - T P D E N G V V D L S E V T N K P T S R P Q T R T A S L T S Q R S Q T S L . . . . . . 67698 TTGCGTCATTCTTACTTTACATAGGTTAATTTTAGCGGAAAATTTGAAATTTTTGATTCT L R H S Y F T - V N F S G K F E I F D S C V I L T L H R L I L A E N L K F L I L L A S F L L Y I G - F - R K I - N F - F . . . . . . 67638 TTAATCATACTTGCTAAAAATTCTTAATATTTCGTAATCGTTCATCATCAACCATCTAAC L I I L A K N S - Y F V I V H H Q P S N - S Y L L K I L N I S - S F I I N H L T F N H T C - K F L I F R N R S S S T I - . . . . 67578 ATTTAAGAGATAAACAACTGAAATAAACAATTC I - E I N N - N K Q F F K R - T T E I N N H L R D K Q L K - T I Maximal non-overlapping open reading frames (>= 64 codons): none 3-phase translation of AGS-3 (+strand): . . . . . . 67546 GAATTGTTTATTTCAGTTGTTTATCTCTTAAATGTTAGATGGTTGATGATGAACGATTAC E L F I S V V Y L L N V R W L M M N D Y N C L F Q L F I S - M L D G - - - T I T I V Y F S C L S L K C - M V D D E R L . . . . . . 67606 GAAATATTAAGAATTTTTAGCAAGTATGATTAAAGAATCAAAAATTTCAAATTTTCCGCT E I L R I F S K Y D - R I K N F K F S A K Y - E F L A S M I K E S K I S N F P L R N I K N F - Q V - L K N Q K F Q I F R . . . . . . 67666 AAAATTAACCTATGTAAAGTAAGAATGACGCAAGTAGGCTTGTTTGTGACCTCTGAGAGG K I N L C K V R M T Q V G L F V T S E R K L T Y V K - E - R K - A C L - P L R G - N - P M - S K N D A S R L V C D L - E . . . . 67726 TCAACGACGCCGTTCTCGTCTGGGGTCTAGATT S T T P F S S G V - I Q R R R S R L G S R V N D A V L V W G L D Maximal non-overlapping open reading frames (>= 64 codons): none PGL 11 (+ strand): 68627 83869 AGS-1 (68627 68975,69124 69242,73951 74072,74373 74555,77508 77621,78275 78323,78485 78586,78742 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83869) SCR (e 0.997 d 0.986 a 1.000,e 1.000 d 0.899 a 0.999,e 1.000 d 0.797 a 1.000,e 1.000 d 0.982 a 0.289,e 1.000 d 0.998 a 0.991,e 1.000 d 0.000 a 0.985,e 1.000 d 0.966 a 0.913,e 1.000 d 0.975 a 0.975,e 1.000 d 0.477 a 0.999,e 1.000 d 0.999 a 0.999,e 1.000 d 0.542 a 0.999,e 1.000 d 0.989 a 0.988,e 1.000) Exon 1 68627 68975 ( 349 n); score: 0.997 Intron 1 68976 69123 ( 148 n); Pd: 0.986 Pa: 1.000 Exon 2 69124 69242 ( 119 n); score: 1.000 Intron 2 69243 73950 (4708 n); Pd: 0.899 Pa: 0.999 Exon 3 73951 74072 ( 122 n); score: 1.000 Intron 3 74073 74372 ( 300 n); Pd: 0.797 Pa: 1.000 Exon 4 74373 74555 ( 183 n); score: 1.000 Intron 4 74556 77507 (2952 n); Pd: 0.982 Pa: 0.289 Exon 5 77508 77621 ( 114 n); score: 1.000 Intron 5 77622 78274 ( 653 n); Pd: 0.998 Pa: 0.991 Exon 6 78275 78323 ( 49 n); score: 1.000 Intron 6 78324 78484 ( 161 n); Pd: 0.000 Pa: 0.985 Exon 7 78485 78586 ( 102 n); score: 1.000 Intron 7 78587 78741 ( 155 n); Pd: 0.966 Pa: 0.913 Exon 8 78742 78844 ( 103 n); score: 1.000 Intron 8 78845 78948 ( 104 n); Pd: 0.975 Pa: 0.975 Exon 9 78949 79012 ( 64 n); score: 1.000 Intron 9 79013 79532 ( 520 n); Pd: 0.477 Pa: 0.999 Exon 10 79533 79647 ( 115 n); score: 1.000 Intron 10 79648 79876 ( 229 n); Pd: 0.999 Pa: 0.999 Exon 11 79877 79977 ( 101 n); score: 1.000 Intron 11 79978 83235 (3258 n); Pd: 0.542 Pa: 0.999 Exon 12 83236 83392 ( 157 n); score: 1.000 Intron 12 83393 83465 ( 73 n); Pd: 0.989 Pa: 0.988 Exon 13 83466 83869 ( 404 n); score: 1.000 PGS (68627 68975,69124 69242,73951 74067) SGN-E284299+ PGS (68682 68855) SGN-E285925+ PGS (68727 68975,69124 69242,73951 74072,74373 74510) SGN-E284326+ PGS (68892 68975,69124 69242,73951 74072,74373 74513) SGN-E281040+ PGS (74442 74555,77508 77621,78275 78323,78485 78586,78742 78844,78949 78972) SGN-E202599+ PGS (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) SGN-E371394- PGS (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) SGN-E397903- PGS (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83691) SGN-E397863+ PGS (78837 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83602) SGN-E392303+ PGS (78838 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83724) SGN-E371395+ PGS (78838 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83485) SGN-E271199+ PGS (79541 79647,79877 79977,83236 83392,83466 83724) SGN-E392545- PGS (83510 83869) SGN-E249493+ 3-phase translation of AGS-1 (+strand): . . . . . . 68627 AAGCGTCTCGAAAGCGTTATCCTGACATTGAATTGAAGATTGAATAGAAAGCTTGAAATC K R L E S V I L T L N - R L N R K L E I S V S K A L S - H - I E D - I E S L K S A S R K R Y P D I E L K I E - K A - N . . . . . . 68687 TGTCTTTTGGCGGCTGCGTCGAAGTTGAGCGAAGAATGGCGACGGTGGCGGCGGCGCCGT C L L A A A S K L S E E W R R W R R R R V F W R L R R S - A K N G D G G G G A V L S F G G C V E V E R R M A T V A A A P . . . . . . 68747 GGTTTAGAGCAAGGTTGATCCCGGAGTTAAAGAGTCGCCAGTCACTACTGTATTGTCGCA G L E Q G - S R S - R V A S H Y C I V A V - S K V D P G V K E S P V T T V L S Q W F R A R L I P E L K S R Q S L L Y C R . . . . . . 68807 ACGGCCCCCGCAGGTATCCGCAAAGTCTCTGTTTCCGGAGAAGAAGTTTCTCAATTTATG T A P A G I R K V S V S G E E V S Q F M R P P Q V S A K S L F P E K K F L N L C N G P R R Y P Q S L C F R R R S F S I Y . . . . . . 68867 CTTCAGCAGGAGATGAAGGGGCTGTCCGAGTTCGTTTTGCACCGTCTCCTACCGGTAATC L Q Q E M K G L S E F V L H R L L P V I F S R R - R G C P S S F C T V S Y R - S A S A G D E G A V R V R F A P S P T G N . . . . . : . 68927 TCCATGTGGGAGGCGCTAGAACTGCACTCTTTAACTACTTATATGCGCG : GTCGAAAGGTG S M W E A L E L H S L T T Y M R : G R K V P C G R R - N C T L - L L I C A : V E R W L H V G G A R T A L F N Y L Y A R : S K G . . . . . . 69135 GGAAATTTGTACTCCGGATTGAAGACACAGACCTGGAAAGATCCACAAGGGAGTCCGAGG G N L Y S G L K T Q T W K D P Q G S P R E I C T P D - R H R P G K I H K G V R G G K F V L R I E D T D L E R S T R E S E . . . . . : . 69195 AGGCCGTGCTTCGTGACCTTTCTTGGCTTGGTCTTGCTTGGGACGAAG : GTCCTGGAATTG R P C F V T F L G L V L L G T K : V L E L G R A S - P F L A W S C L G R R : S W N W E A V L R D L S W L G L A W D E : G P G I . . . . . . 73963 GTGGGAACTATGGCCCATACAGGCAGTCTGAGAGGAATGCCCTTTACAAGGAATTTGCTG V G T M A H T G S L R G M P F T R N L L W E L W P I Q A V - E E C P L Q G I C - G G N Y G P Y R Q S E R N A L Y K E F A . . . . . : . 74023 AAAAACTTTTACAATCCGGTCATGTTTATCGATGTTTTTGCTCAAATGAG : GAATTAGAAA K N F Y N P V M F I D V F A Q M R : N - K K T F T I R S C L S M F L L K - : G I R K E K L L Q S G H V Y R C F C S N E : E L E . . . . . . 74383 AGATGAAAGAGATGGCAAAATTGAAGCAGTTGCCTCCCGTGTACACTGGGAGGTGGGCCA R - K R W Q N - S S C L P C T L G G G P D E R D G K I E A V A S R V H W E V G Q K M K E M A K L K Q L P P V Y T G R W A . . . . . . 74443 GTGCTACAGAGCAGGAAGTTCTAGAAGAGCTGACAAAGGGGACCCCATACACATATCGGT V L Q S R K F - K S - Q R G P H T H I G C Y R A G S S R R A D K G D P I H I S V S A T E Q E V L E E L T K G T P Y T Y R . . . . . . : 74503 TTCGAGTACCAAAAGAAGGGAGTTTAAAAATTGATGACCTCATTCGTGGTGAA : TTGGAAC F E Y Q K K G V - K L M T S F V V N : W N S S T K R R E F K N - - P H S W - : I G T F R V P K E G S L K I D D L I R G E : L E . . . . . . 77515 TTCGACACTCTTGGAGACTTTGTGATCATGAGAAGTAATGGACAACCCGTTTACAATTTT F D T L G D F V I M R S N G Q P V Y N F S T L L E T L - S - E V M D N P F T I F L R H S W R L C D H E K - W T T R L Q F . . . . . : . 77575 TGTGTCACAGTTGATGATGCTACTATGGCTATCTCCCATGTCATAAG : AGCGGAGGAACAT C V T V D D A T M A I S H V I R : A E E H V S Q L M M L L W L S P M S - : E R R N I L C H S - - C Y Y G Y L P C H K : S G G T . . . . : . . 78288 TTGCCGAATACTCTAAGGCAAGCATTAATATACAAG : GCACTAGGTTTTCCAATGCCTCAC L P N T L R Q A L I Y K : A L G F P M P H C R I L - G K H - Y T R : H - V F Q C L T F A E Y S K A S I N I Q : G T R F S N A S . . . . . . 78509 TTTGCGCATGTTTCTTTAATTCTTGCCCCTGATAGAAGCAAGCTCTCGAAACGGCATGGT F A H V S L I L A P D R S K L S K R H G L R M F L - F L P L I E A S S R N G M V L C A C F F N S C P - - K Q A L E T A W . . : . . . . 78569 GCAACTTCAGTTGGTCAG : TTCAGGGACATGGGCTATTTGCCTCAGGCAATGGTGAACTAT A T S V G Q : F R D M G Y L P Q A M V N Y Q L Q L V S : S G T W A I C L R Q W - T I C N F S W S : V Q G H G L F A S G N G E L . . . . . . 78784 CTAGCTCTCTTGGGATGGGGCGATGGTACAGAAAATGAGTTTTTCTCCCTTGAGCAGCTT L A L L G W G D G T E N E F F S L E Q L - L S W D G A M V Q K M S F S P L S S L S S S L G M G R W Y R K - V F L P - A A . : . . . . . 78844 G : TTGAAAAGTTCACAATTGAACGTGTAAACAAAAGTGGTGCCATATTTGATTCGACCAAG : V E K F T I E R V N K S G A I F D S T K : L K S S Q L N V - T K V V P Y L I R P S C : - K V H N - T C K Q K W C H I - F D Q . : . . . . . 79008 TTAAG : GTGGATGAATGGTCAGCATTTGAGATCACTTCCATCTGAAGAGTTGAACCAAATC L R : W M N G Q H L R S L P S E E L N Q I - : G G - M V S I - D H F H L K S - T K S V K : V D E W S A F E I T S I - R V E P N . . . . . . : 79588 ATTGGTGAAAGGTGGAAGGATGCAGACATCGTTACAGAATCACAAGGAGTTTTTGTACAG : I G E R W K D A D I V T E S Q G V F V Q : L V K G G R M Q T S L Q N H K E F L Y R : H W - K V E G C R H R Y R I T R S F C T : . . . . . . 79877 GATGCTGTTCTACTCCTCAAAGATGGGATTGACTTGATACCAGATTCAGAGAAAGCACTT D A V L L L K D G I D L I P D S E K A L M L F Y S S K M G L T - Y Q I Q R K H F G C C S T P Q R W D - L D T R F R E S T . . . . . : . 79937 TCAAGTTTGCTATCTTATCCTTTATATGAAACTTTGACAAG : CACGGAAGGAAAACTGATC S S L L S Y P L Y E T L T S : T E G K L I Q V C Y L I L Y M K L - Q : A R K E N - S F K F A I L S F I - N F D K : H G R K T D . . . . . . 83255 TTAGAAGATGGAGTCTCTGAAGTTGCTAAGAGCTTGTTAGCAGCCTACGACAGTGGTGAG L E D G V S E V A K S L L A A Y D S G E - K M E S L K L L R A C - Q P T T V V S L R R W S L - S C - E L V S S L R Q W - . . . . . . 83315 CTCTGTGGTGCACTTGCAGAAGGCCAACCTGGATGGAGAAACTGGGTGAAGAAGTTCGGT L C G A L A E G Q P G W R N W V K K F G S V V H L Q K A N L D G E T G - R S S V A L W C T C R R P T W M E K L G E E V R . . : . . . . 83375 AAATTGCTGAAGCGCAAG : GGAAAATCTCTCTTCATGCCCCTTCGGGTGTTGCTAACAGGA K L L K R K : G K S L F M P L R V L L T G N C - S A R : E N L S S C P F G C C - Q E - I A E A Q : G K I S L H A P S G V A N R . . . . . . 83508 AAGCTTCATGGACCTGATATTGGGGCCACCACAGTATTACTCTATAAAGCTGGAACATCT K L H G P D I G A T T V L L Y K A G T S S F M D L I L G P P Q Y Y S I K L E H L K A S W T - Y W G H H S I T L - S W N I . . . . . . 83568 GGTTCTGTAGCACCCCAAGCTGGGTTTGTTACATTTGATGAAAGATTTAAGATATTGAGA G S V A P Q A G F V T F D E R F K I L R V L - H P K L G L L H L M K D L R Y - E W F C S T P S W V C Y I - - K I - D I E . . . . . . 83628 GAAGTTCAATGGGAGTCGTTCAGCTCAAATGTGCCTTTGTCTGCTGGTGTTGTAACGCAT E V Q W E S F S S N V P L S A G V V T H K F N G S R S A Q M C L C L L V L - R I R S S M G V V Q L K C A F V C W C C N A . . . . . . 83688 TGAGATTGTGGCGATATTCTGTTTTGATTATCCATTATATGACTTCTATCTCCACCATTC - D C G D I L F - L S I I - L L S P P F E I V A I F C F D Y P L Y D F Y L H H S L R L W R Y S V L I I H Y M T S I S T I . . . . . . 83748 CCAGTAGAAACAAAGAGAAGCTGCGAGCACAAGGGGGGTTTTCTTGTGTTTGCATCTCGT P V E T K R S C E H K G G F L V F A S R Q - K Q R E A A S T R G V F L C L H L V P S R N K E K L R A Q G G F S C V C I S . . . . . . 83808 CTGGAATCAAAGAGGGCTACCATCTCTAGCGGGATTCCTTTTCTGTATCTTCCCCCTCCC L E S K R A T I S S G I P F L Y L P P P W N Q R G L P S L A G F L F C I F P L P S G I K E G Y H L - R D S F S V S S P S . 83868 CC P Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-11_AGS-1_PPS_1 (74530 74555,77508 77621,78275 78323,78485 78586,78742 78844,78949 79012,79533 79647,79877 79977,83236 83392,83466 83690) (frame '1'; 1053 bp, 351 residues) 1 KLMTSFVVNW NFDTLGDFVI MRSNGQPVYN FCVTVDDATM AISHVIRAEE HLPNTLRQAL 61 IYKALGFPMP HFAHVSLILA PDRSKLSKRH GATSVGQFRD MGYLPQAMVN YLALLGWGDG 121 TENEFFSLEQ LVEKFTIERV NKSGAIFDST KLRWMNGQHL RSLPSEELNQ IIGERWKDAD 181 IVTESQGVFV QDAVLLLKDG IDLIPDSEKA LSSLLSYPLY ETLTSTEGKL ILEDGVSEVA 241 KSLLAAYDSG ELCGALAEGQ PGWRNWVKKF GKLLKRKGKS LFMPLRVLLT GKLHGPDIGA 301 TTVLLYKAGT SGSVAPQAGF VTFDERFKIL REVQWESFSS NVPLSAGVVT H- >C01HBa0088L02.1+_PGL-11_AGS-1_PPS_2 (68777 68975,69124 69242,73951 74072,74373 74379) (frame '1'; 444 bp, 148 residues) 1 RVASHYCIVA TAPAGIRKVS VSGEEVSQFM LQQEMKGLSE FVLHRLLPVI SMWEALELHS 61 LTTYMRGRKV GNLYSGLKTQ TWKDPQGSPR RPCFVTFLGL VLLGTKVLEL VGTMAHTGSL 121 RGMPFTRNLL KNFYNPVMFI DVFAQMRN- AGS-2 (78389 78586,78742 78844,78949 79012,79533 79647,79877 79881) SCR (e 1.000 d 0.966 a 0.913,e 1.000 d 0.975 a 0.975,e 1.000 d 0.477 a 0.999,e 0.991 d 0.999 a 0.999,e 1.000) Exon 1 78389 78586 ( 198 n); score: 1.000 Intron 1 78587 78741 ( 155 n); Pd: 0.966 Pa: 0.913 Exon 2 78742 78844 ( 103 n); score: 1.000 Intron 2 78845 78948 ( 104 n); Pd: 0.975 Pa: 0.975 Exon 3 78949 79012 ( 64 n); score: 1.000 Intron 3 79013 79532 ( 520 n); Pd: 0.477 Pa: 0.999 Exon 4 79533 79647 ( 115 n); score: 0.991 Intron 4 79648 79876 ( 229 n); Pd: 0.999 Pa: 0.999 Exon 5 79877 79881 ( 5 n); score: 1.000 PGS (78389 78586,78742 78844,78949 79012,79533 79647,79877 79881) SGN-E246763+ 3-phase translation of AGS-2 (+strand): . . . . . . 78389 GAAAACGGAAAAAGAAGAAAAGAATCACGAGGTAGTTTTGTATATGATTTCTCTCTTAGA E N G K R R K E S R G S F V Y D F S L R K T E K E E K N H E V V L Y M I S L L E K R K K K K R I T R - F C I - F L S - . . . . . . 78449 AGCTTATGGGGAAAAATCTTTGTTACCTTGCTGCAGGCACTAGGTTTTCCAATGCCTCAC S L W G K I F V T L L Q A L G F P M P H A Y G E K S L L P C C R H - V F Q C L T K L M G K N L C Y L A A G T R F S N A S . . . . . . 78509 TTTGCGCATGTTTCTTTAATTCTTGCCCCTGATAGAAGCAAGCTCTCGAAACGGCATGGT F A H V S L I L A P D R S K L S K R H G L R M F L - F L P L I E A S S R N G M V L C A C F F N S C P - - K Q A L E T A W . . : . . . . 78569 GCAACTTCAGTTGGTCAG : TTCAGGGACATGGGCTATTTGCCTCAGGCAATGGTGAACTAT A T S V G Q : F R D M G Y L P Q A M V N Y Q L Q L V S : S G T W A I C L R Q W - T I C N F S W S : V Q G H G L F A S G N G E L . . . . . . 78784 CTAGCTCTCTTGGGATGGGGCGATGGTACAGAAAATGAGTTTTTCTCCCTTGAGCAGCTT L A L L G W G D G T E N E F F S L E Q L - L S W D G A M V Q K M S F S P L S S L S S S L G M G R W Y R K - V F L P - A A . : . . . . . 78844 G : TTGAAAAGTTCACAATTGAACGTGTAAACAAAAGTGGTGCCATATTTGATTCGACCAAG : V E K F T I E R V N K S G A I F D S T K : L K S S Q L N V - T K V V P Y L I R P S C : - K V H N - T C K Q K W C H I - F D Q . : . . . . . 79008 TTAAG : GTGGATGAATGGTCAGCATTTGAGATCACTTCCATCTGAAGAGTTGAACCAAATC L R : W M N G Q H L R S L P S E E L N Q I - : G G - M V S I - D H F H L K S - T K S V K : V D E W S A F E I T S I - R V E P N . . . . . . : 79588 ATTGGTGAAAGGTGGAAGGATGCAGACATCGTTACAGAATCACAAGGAGTTTTTGTACAG : I G E R W K D A D I V T E S Q G V F V Q : L V K G G R M Q T S L Q N H K E F L Y R : H W - K V E G C R H R Y R I T R S F C T : . 79877 GATGC D M G C Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1+_PGL-11_AGS-2_PPS_1 (78389 78586,78742 78844,78949 79012,79533 79647,79877 79879) (frame '1'; 483 bp, 161 residues) 1 ENGKRRKESR GSFVYDFSLR SLWGKIFVTL LQALGFPMPH FAHVSLILAP DRSKLSKRHG 61 ATSVGQFRDM GYLPQAMVNY LALLGWGDGT ENEFFSLEQL VEKFTIERVN KSGAIFDSTK 121 LRWMNGQHLR SLPSEELNQI IGERWKDADI VTESQGVFVQ D PGL 12 (- strand): 96471 94027 AGS-1 (96471 96177,96122 96015,94104 94027) SCR (e 0.902 d 0.926 a 0.000,e 0.852 d 0.000 a 0.071,e 0.853) Exon 1 96471 96177 ( 295 n); score: 0.902 Intron 1 96176 96123 ( 54 n); Pd: 0.926 Pa: 0.000 Exon 2 96122 96015 ( 108 n); score: 0.852 Intron 2 96014 94105 (1910 n); Pd: 0.000 Pa: 0.071 Exon 3 94104 94027 ( 78 n); score: 0.853 PGS (96471 96177,96122 96015,94104 94027) SGN-E327243+ 3-phase translation of AGS-1 (-strand): . . . . . . 96471 GGAAGTGCCAGGACCTCCTAGAATAACCAAAGCCAACTACCCTTATGCAAAAGCAGTTAA G S A R T S - N N Q S Q L P L C K S S - E V P G P P R I T K A N Y P Y A K A V K K C Q D L L E - P K P T T L M Q K Q L . . . . . . 96411 GGATAGTAAATGGCAATCAGAAACTATAAAGGAGGCAGAGATTACGAACAATGTTAGCAT G - - M A I R N Y K G G R D Y E Q C - H D S K W Q S E T I K E A E I T N N V S I R I V N G N Q K L - R R Q R L R T M L A . . . . . . 96351 TATTTAAGTCCTCACACACAGGTTGAAGACCAAGAGAATGGGCTTCCAGAGAGATGCCTA Y L S P H T Q V E D Q E N G L P E R C L I - V L T H R L K T K R M G F Q R D A - L F K S S H T G - R P R E W A S R E M P . . . . . . 96291 GTAGGTCATTTGGAAGGACAGATGAAGGAAAAGCCAACTTTGCTTGAGATATGAAGATGG V G H L E G Q M K E K P T L L E I - R W - V I W K D R - R K S Q L C L R Y E D G S R S F G R T D E G K A N F A - D M K M . . . . . . : 96231 TCGTCAACACTTCGGAAAAAGGCATTTGGAGTTAACATCAATGAAATGCATGGAG : GCAGT S S T L R K K A F G V N I N E M H G : G S R Q H F G K R H L E L T S M K C M E : A V V V N T S E K G I W S - H Q - N A W R : Q . . . . . . 96117 GGAACTGGAAGAATCACGGATTCAATCTAGAATGGTGGAATTCAATGGTGGGTTGTCTCC G T G R I T D S I - N G G I Q W W V V S E L E E S R I Q S R M V E F N G G L S P W N W K N H G F N L E W W N S M V G C L . . . . . : . 96057 CCAATAATACTCTGAACAAGGACACATGGATTAGAACTGTTGG : AATCCCCCCCATCTCTG P I I L - T R T H G L E L L : E S P P S L Q - Y S E Q G H M D - N C W : N P P H L W P N N T L N K D T W I R T V G : I P P I S . . . . . . 94087 GTCAAAGAGAGTATTTCAAGAAATTGGAAACTTATGTGAAGGTTGGGTGGCCATAGAGGA V K E S I S R N W K L M - R L G G H R G S K R V F Q E I G N L C E G W V A I E E G Q R E Y F K K L E T Y V K V G W P - R . 94027 A Maximal non-overlapping open reading frames (>= 64 codons): none PGL 13 (- strand): 104993 104540 AGS-1 (104993 104540) SCR (e 0.792) Exon 1 104993 104540 ( 454 n); score: 0.792 PGS (104993 104540) SGN-E212227+ 3-phase translation of AGS-1 (-strand): . . . . . . 104993 GCATCTAAGCAGCATTTATTGCTTCCTGTCTCACTATATTGGCTGCACGTTATCCTTGAA A S K Q H L L L P V S L Y W L H V I L E H L S S I Y C F L S H Y I G C T L S L K I - A A F I A S C L T I L A A R Y P - . . . . . . 104933 ATAAGTTCACCAATTGTGCCAGTTGATGTTGAATTAGATCTTCCATTACATTCGTCTCTG I S S P I V P V D V E L D L P L H S S L - V H Q L C Q L M L N - I F H Y I R L - N K F T N C A S - C - I R S S I T F V S . . . . . . 104873 ATACCAAGTTGTTATGGTCCCCAGTTATGGATCTGGTTATGGGACACTGTAATATTAAAT I P S C Y G P Q L W I W L W D T V I L N Y Q V V M V P S Y G S G Y G T L - Y - I D T K L L W S P V M D L V M G H C N I K . . . . . . 104813 CTGATGTTTTCTTCCTACGATCTATGGTGCTGGTTCGTTAAGAGAGAACCTGCGATCTCA L M F S S Y D L W C W F V K R E P A I S - C F L P T I Y G A G S L R E N L R S H S D V F F L R S M V L V R - E R T C D L . . . . . . 104753 TGAGTTTGAAGCACTCAAAGGCTTGAATAATTTTCTGCTTATATTTTCTTAGTCACCAGA - V - S T Q R L E - F S A Y I F L V T R E F E A L K G L N N F L L I F S - S P D M S L K H S K A - I I F C L Y F L S H Q . . . . . . 104693 TAGTTTAAATACAATACTTATAAAATAACAACCCCTAGAAACTAGGACATGACTTCCTAA - F K Y N T Y K I T T P R N - D M T S - S L N T I L I K - Q P L E T R T - L P N I V - I Q Y L - N N N P - K L G H D F L . . . . . . 104633 CTTAACTAGAAAGAAAGACTGCACTATTACAGAAAAATAACTGCATTTTTTACAGGAAAA L N - K E R L H Y Y R K I T A F F T G K L T R K K D C T I T E K - L H F L Q E N T - L E R K T A L L Q K N N C I F Y R K . . . . 104573 TAACTGCTACTAGAGAGAAATTACTGCAATAACT - L L L E R N Y C N N N C Y - R E I T A I T I T A T R E K L L Q - Maximal non-overlapping open reading frames (>= 64 codons): >C01HBa0088L02.1-_PGL-13_AGS-1_PPS_1 (104993 104751) (frame '1'; 240 bp, 80 residues) 1 ASKQHLLLPV SLYWLHVILE ISSPIVPVDV ELDLPLHSSL IPSCYGPQLW IWLWDTVILN 61 LMFSSYDLWC WFVKREPAIS - 3-phase translation of AGS-1 (+strand): . . . . . . 104540 AGTTATTGCAGTAATTTCTCTCTAGTAGCAGTTATTTTCCTGTAAAAAATGCAGTTATTT S Y C S N F S L V A V I F L - K M Q L F V I A V I S L - - Q L F S C K K C S Y F L L Q - F L S S S S Y F P V K N A V I . . . . . . 104600 TTCTGTAATAGTGCAGTCTTTCTTTCTAGTTAAGTTAGGAAGTCATGTCCTAGTTTCTAG F C N S A V F L S S - V R K S C P S F - S V I V Q S F F L V K L G S H V L V S R F L - - C S L S F - L S - E V M S - F L . . . . . . 104660 GGGTTGTTATTTTATAAGTATTGTATTTAAACTATCTGGTGACTAAGAAAATATAAGCAG G L L F Y K Y C I - T I W - L R K Y K Q G C Y F I S I V F K L S G D - E N I S R G V V I L - V L Y L N Y L V T K K I - A . . . . . . 104720 AAAATTATTCAAGCCTTTGAGTGCTTCAAACTCATGAGATCGCAGGTTCTCTCTTAACGA K I I Q A F E C F K L M R S Q V L S - R K L F K P L S A S N S - D R R F S L N E E N Y S S L - V L Q T H E I A G S L L T . . . . . . 104780 ACCAGCACCATAGATCGTAGGAAGAAAACATCAGATTTAATATTACAGTGTCCCATAACC T S T I D R R K K T S D L I L Q C P I T P A P - I V G R K H Q I - Y Y S V P - P N Q H H R S - E E N I R F N I T V S H N . . . . . . 104840 AGATCCATAACTGGGGACCATAACAACTTGGTATCAGAGACGAATGTAATGGAAGATCTA R S I T G D H N N L V S E T N V M E D L D P - L G T I T T W Y Q R R M - W K I - Q I H N W G P - Q L G I R D E C N G R S . . . . . . 104900 ATTCAACATCAACTGGCACAATTGGTGAACTTATTTCAAGGATAACGTGCAGCCAATATA I Q H Q L A Q L V N L F Q G - R A A N I F N I N W H N W - T Y F K D N V Q P I - N S T S T G T I G E L I S R I T C S Q Y . . . . 104960 GTGAGACAGGAAGCAATAAATGCTGCTTAGATGC V R Q E A I N A A - M - D R K Q - M L L R C S E T G S N K C C L D Maximal non-overlapping open reading frames (>= 64 codons): none PGL 14 (+ strand): 108660 112140 AGS-1 (108660 108754,111564 111726,111815 112140) SCR (e 1.000 d 0.987 a 0.977,e 1.000 d 0.975 a 0.994,e 1.000) Exon 1 108660 108754 ( 95 n); score: 1.000 Intron 1 108755 111563 (2809 n); Pd: 0.987 Pa: 0.977 Exon 2 111564 111726 ( 163 n); score: 1.000 Intron 2 111727 111814 ( 88 n); Pd: 0.975 Pa: 0.994 Exon 3 111815 112140 ( 326 n); score: 1.000 PGS (108660 108754,111564 111726,111815 112140) SGN-E236171+ PGS (108660 108754,111564 111726,111815 112044) SGN-E228287+ 3-phase translation of AGS-1 (+strand): . . . . . . 108660 TTGAGTCAGCTACCTGTTATACTAAGGCACGTGGAGGATGAAGGCATACATCCTGTGGGC L S Q L P V I L R H V E D E G I H P V G - V S Y L L Y - G T W R M K A Y I L W A E S A T C Y T K A R G G - R H T S C G . . . . : . . 108720 ATTTTGGACAGAGAGTGCATCAATGTAGCTTGCAG : AGCATTAGCAACTCGAGAACAGCTT I L D R E C I N V A C R : A L A T R E Q L F W T E S A S M - L A : E H - Q L E N S L H F G Q R V H Q C S L Q : S I S N S R T A . . . . . . 111589 AGCTGGTTCTCCACGAAGTAAAGGCTAATTGAAGGTTGCATAACCCGTTTGCAATAAGTT S W F S T K - R L I E G C I T R L Q - V A G S P R S K G - L K V A - P V C N K F - L V L H E V K A N - R L H N P F A I S . . . . . . 111649 CTTCCTTGTCAAAGCATGCTGAGGGTTATTGTCTCTGAGTAATCCATCCTCGCTCTGTCT L P C Q S M L R V I V S E - S I L A L S F L V K A C - G L L S L S N P S S L C L S S L S K H A E G Y C L - V I H P R S V . . : . . . . 111709 TACAACAGGGTTGAACAA : TTCAATGGTAAATAATGAGAATGATGTTAGCACAGGCAGAGG Y N R V E Q : F N G K - - E - C - H R Q R T T G L N N : S M V N N E N D V S T G R G L Q Q G - T : I Q W - I M R M M L A Q A E . . . . . . 111857 AGACCGTACAACCAGGTAGCAGGATTTACTGCTGAAGCTGAAGGTTTGTTCTAGCTGCTT R P Y N Q V A G F T A E A E G L F - L L D R T T R - Q D L L L K L K V C S S C F E T V Q P G S R I Y C - S - R F V L A A . . . . . . 111917 CTTAAATTAGGCACTGGAGGAGCGCACTGCGTAACTACACTGACTCGTCATCCAATTCCA L K L G T G G A H C V T T L T R H P I P L N - A L E E R T A - L H - L V I Q F Q S - I R H W R S A L R N Y T D S S S N S . . . . . . 111977 ATCATTCACTTCCGTGGTATGGAACTTGAACAGGATTGAGTTACACATGTCAAAATTAAG I I H F R G M E L E Q D - V T H V K I K S F T S V V W N L N R I E L H M S K L S N H S L P W Y G T - T G L S Y T C Q N - . . . . . . 112037 TCTACTCTGCTGTCATTGCCTGAATAATATTTCTTCATGCTGCTTTTGTCAACTGTTAAT S T L L S L P E - Y F F M L L L S T V N L L C C H C L N N I S S C C F C Q L L M V Y S A V I A - I I F L H A A F V N C - . . . . . 112097 GACTTTTCAAACAACCCCATTCTCCACCATTGTTTCCCGAACTG D F S N N P I L H H C F P N T F Q T T P F S T I V S R T - L F K Q P H S P P L F P E L Maximal non-overlapping open reading frames (>= 64 codons): none ... finished at: Tue Jul 25 10:59:49 2006