Adapter sequences and methods of use thereof

WO2026178174A2PCT designated stage Publication Date: 2026-08-27ULTIMA GENOMICS INC
View PDF 0 Cites 0 Cited by

Patent Information

Application Number
PCT/US2026/015735
Authority / Receiving Office
WO · WO
Patent Type
Applications
Current Assignee / Owner
Priority Date
2025-11-18
Filing Date
2026-02-18
Publication Date
2026-08-27

Smart Images

  • Figure US2026015735_27082026_PF_FP_ABST
    Figure US2026015735_27082026_PF_FP_ABST
Patent Text Reader

Abstract

Provided are systems, methods, compositions, and kits for library preparation. In some cases, multiple distinct types of adapter molecules may be provided to a template nucleic acid molecule. In some cases, a single type of adapter molecule may be provided to a template molecule. In some cases, multiple distinct types of adapter molecules may be sequentially provided to a template molecule to form multi-adapter template complexes. In some cases, adapters with methylated cytosines may be provided to a template nucleic acid molecule.
Need to check novelty before this filing date? Find Prior Art

Description

Fox Ref: 368893.41602ADAPTER SEQUENCES AND METHODS OF USE THEREOFCROSS-REFERENCE TO RELATED APPLICATIONS

[0001] This application claims the benefit of U. S. Provisional Application No. 63 / 760,021, filed February 18, 2025. U. S. Provisional Application No. 63 / 873,142, filed August 29, 2025, U. S. Provisional Application No. 63 / 920,251. filed November 18, 2025, and U. S. Provisional Application No. 63 / 920,355, filed November 18, 2025, each of which is entirely incorporated by reference herein for all purposes.BACKGROUND

[0002] Biological sample processing has various applications in the fields of molecular biology and medicine (e.g., diagnosis). For example, nucleic acid sequencing may provide information that may be used to diagnose a certain condition in a subject and in some cases tailor a treatment plan. Sequencing is widely used for molecular biology applications, including vector designs, gene therapy, vaccine design, industrial strain design and verification. Biological sample processing may involve a fluidics system and / or a detection system.

[0003] Nucleic acid sequencing may comprise the steps of obtaining a sample, preparing a library of nucleic acids from the sample, and sequencing the library or derivatives thereof. Library preparation can involve any number of operations such as, in non-limiting order, fragmentation, end repair, adapter ligation, size selection, enrichment, barcoding, quality control, amplification (e.g., PCR), and the like.

[0004] Despite the advance of sequencing technology selecting adapter sequences and designs for use in a system may be laborious or result in poor performance, for instance during library preparation or in sequencing data analysis.SUMMARY

[0005] Recognized herein is a need for producing diverse nucleic acid barcode sequences, short nucleic acid barcodes, adapter sequences to control for methylation conversion methods, high-efficiency adapter designs and multispecies adapter sequences to be used with each other. Such sequences may be useful in preparation of samples, analysis of nucleic acid molecules, and may be useful in providing improved attribution of a barcoded product to an origin (e.g., sample, partition, cell, etc.). Provided herein are systems, methods, compositions, and kits for -1- 182358171.1Fox Ref: 368893.41602library preparation that address at least the abovementioned needs. The present disclosure may be advantageous to improve sequencing results.

[0006] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 1-96.

[0007] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 103-1157

[0008] In some embodiments, said non-naturally occurring nucleic acid molecule is coupled to a support. In some embodiments, said support is a bead.

[0009] In an aspect provided herein is a kit, comprising: at least 8 non-naturally occurring nucleic acid molecules each comprising a different sequence selected from any one of SEQ ID Nos: 103-1157. In an aspect provided herein is a kit comprising: at least 96 non-naturally occurring nucleic acid molecules comprising a different sequence selected from any one of SEQ ID Nos: 103-1157.

[0010] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 2219-3025.

[0011] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 3026-4050.

[0012] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 3026-4050 or of SEQ ID Nos: 5825-5841.

[0013] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 5825-5841.

[0014] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 4051-4871.

[0015] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 4872-5696.-2- 182358171.1Fox Ref: 368893.41602

[0016] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of the sequences illustrated in FIGs. 8A-10F.

[0017] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of the sequences illustrated in FIGs. 11 A- 11C.

[0018] In an aspect provided herein is a composition, comprising a non-naturally occurring nucleic acid molecule comprising a sequence selected from any one of the sequences illustrated in FIG. 12.

[0019] Additional aspects and advantages of the present disclosure will become readily apparent to those skilled in this art from the following detailed description, wherein only illustrative instances of the present disclosure are shown and described. As will be realized, the present disclosure is capable of other and different instances, and its several details are capable of modifications in various obvious respects, all without departing from the disclosure. Thus, the drawings and description are to be regarded as illustrative in nature, and not as restrictive.INCORPORATION BY REFERENCE

[0020] All publications, patents, and patent applications mentioned in this specification are herein incorporated by reference to the same extent as if each individual publication, patent, or patent application was specifically and individually indicated to be incorporated by reference. To the extent publications and patents or patent applications incorporated by reference contradict the disclosure contained in the specification, the specification is intended to supersede and / or take precedence over any such contradictory’ material.BRIEF DESCRIPTION OF THE DRAWINGS

[0021] The novel features of the invention are set forth with particularity in the appended claims. A better understanding of the features and advantages of the present invention will be obtained by reference to the following detailed description that sets forth illustrative embodiments, in which the principles of the invention are utilized, and the accompanying drawings (also “Figure” and “FIG.” herein) of which:[0022JFIG. 1 illustrates an example workflow for processing a sample for sequencing.-3- 182358171.1Fox Ref: 368893.41602

[0023] FIG. 2 illustrates a method for attaching a template insert to adapters on each end to generate a template nucleic acid, which adapters contain functional sequences that facilitate attachment of the template nucleic acid, or derivative thereof, to a surface and sequencing of the surface-attached template nucleic acid, or derivative thereof.

[0024] FIG. 3 illustrates different examples of adapter structures and adapter segment labels. An adapter, either Adapter A or Adapter B or both, that is attached to a template may comprise anv structure.[0025JFIG. 4 illustrates high efficiency adapters for use with sequencing systems and methods described herein. Sequences shown in figure: SEQ ID No: 5745 and GGACACACGGAACCGTCAGAGTCG (3’-5 ) = GCTGAGACTGCCAAGGCACACAGG (5’-3') (SEQ ID No: 5746).[0026JFIG.5 illustrates various adapter and barcode configurations and sequences for use with sequencing systems and methods described herein, especially paired plus minus sequencing. Sequences shown in figure: CCATCTCATCCCTGCGTGTCTCCGACTGGAAGC (5’-3’) (SEQ ID NO:5762); ACTACACGACGCTCTTCCGATCT (5’-3 ) (SEQ ID NO: 5763); GCAAGGAGTCGGAGACACGCAGGGATGAGATGG (5 -3 ) (SEQ ID NO:5764); AGATCGGAAGAGCGTCGTGTAGT (SEQ ID NO: 5765); CCATCTCATCCCTGCGTGTCTCCGACTC (5’-3’) (SEQ ID NO:5766); GAGTCGGAGACACGCAGGGATGAGATGG (5 ’-3 ) (SEQ ID NO: 5767); CCATCTCATCCCTGCGTGTCTCCGACTGCAC (5 -3 ) (SEQ ID NO:5768); and GTGCAGTCGGAGACACGCAGGGATGAGATGG (5’-3’) (SEQ ID NO:5769)

[0027] FIG. 6 illustrates an example adapter configuration and sequences for use with sequencing systems and methods described herein, especially paired plus minus sequencing. Sequences shown in figure: SEQ ID No: 5745; GGACACACGGAACCGTCAGAGTCG (3’-5 ) = GCTGAGACTGCCAAGGCACACAGG (5’-3’) (SEQ ID No: 5746); CCTATCCCCTGTGTGCCTTGGCAGTCTC (5 -3’) (SEQ ID NO:5770); and SEQ ID No: 5747.

[0028] FIGs. 7A, 7B, 7C, 7D, 7E and-7F illustrate illustrative adapter and barcode configurations and sequences for use with sequencing systems and methods described herein, especially paired plus minus sequencing (e.g., described in Inti. Pat. Pub. No. WO2024 / 159179, which is herein incorporated by reference in its entirety ). In each case, the flow order is TGCA. It will be appreciated that different sequences (e.g., different sequential orderings of K, M. W. and S) may be selected for different flow orders in order to minimize182358171.1Fox Ref: 368893.41602the number of flows required to fully extend a sequencing primer through the mismatch region while retaining the indicated number of UMIs. In each case, the mismatch region may further serve as a unique molecular identifying (UMI) region. In FIG.7A, the barcode region is located between the bubble (mismatch) region and the insert sequence. In FIGs. 7B-7F, the mismatch (bubble) region is located between the barcode region and the insert. Sequences shown in FIG.7A: ATCTCATCCCTGCGTGTCTCCGACKCWGMTACGC (5’-3 ) (SEQ IDNO:5842) and GCWGMTSACGGTCGGAGACACGCAGGGATGAGAUGGU (5 -3 ) (SEQ ID NO:5843). Sequences shown in FIG. 7B: SEQ ID No: 5745; GAKCWGMTACGAAGGACATGAGCAGCAT (5’-3’) (SEQ ID NO: 5771); SEQ ID NO: 5748; and ATGCTGCTCATGTGGAACWGMTSACGTC (5’-3 ) (SEQ ID NO: 5772).

[0029] Sequences shown in FIG. 7C: Sequences shown in figure: SEQ ID NO: 5745; SEQ ID NO: 5771; SEQ ID NO: 5748; and SEQ ID NO: 5772. Sequences shown in FIG. 7D: SEQ ID NO: 5745; GAKCWGMTACGACATGAGCAGCAT (5’-3’) (SEQ ID NO: 5773); SEQ ID NO: 5748; and ATGCTGCTCATGTCWGMTSACGTC (5’-3 ) (SEQ ID NO: 5774). Sequences shown in FIG. 7E: SEQ ID No: 5745; GAKCGMTAKCGACATGAGCAGCAT (5 -3 ) (SEQ ID NO: 5775); SEQ ID NO: 5748; and ATGCTGCTCATGTCWGTSACWGTC (5’-3’) (SEQ ID NO: 5776). Sequences shown in FIG. 7F: SEQ ID No: 5745; GAKCWGMTSACGTACATGAGCAGCAT (5’-3 ) (SEQ ID NO: 5777); SEQ ID NO: 5748; and ATGCTGCTCATGTSAKCWGMTACGTC (SEQ ID NO: 5778).

[0030] FIGs. 8A, 8B, 8C, 8D, 8E, and 8F illustrate sequences for a non-limiting library preparation method. Sequences shown in FIG. 8A: SEQ ID NO: 98; SEQ ID No: 5745; GTGCAGTCGGAGACACGCAGGGAUGAGAUGGU (5 -3’) (SEQ ID NO: 5779); SEQ ID NO: 5753; and SEQ ID NO: 5752. Sequences shown in FIG. 8B:UCCAUCTCATCCCTGCGTGTCTCCGAC (5 -3’) (SEQ ID NO: 5780); UCCAUCTCATCCCTGCGTGTCTCCGACTGCAC (5’-3’) (SEQ ID NO: 5781); GTGCAGTCGGAGACACGCAGGGAUGAGATGGA (5’-3’) (SEQ ID NO: 5782); ATCACCGACTGCCCATAGAGAGCA (5’-3’) (SEQ ID NO: 5783); TGCTCTCTATGGGCAGTCGGTGATT (5’-3 ) (SEQ ID NO: 5784); and TGCTCTCTATGGGCAGTCGGTGAT (5 -3 ) (SEQ ID NO: 5785). Sequences shown in FIG. 8C: SEQ ID NO: 5781; GATCTACGACGCTCTTCCGATCT (5’-3 ) (SEQ ID NO: 5786); SEQ ID NO: 5782; GATCGGAAGAGCGTCGTAGATC (5 ’-3 ) (SEQ ID NO: 5787); GATCGGAAGAGCACACGTCTGAGCA (5 -3’) (SEQ ID NO: 5788); and TGCTCAGACGTGTGCTCTTCCGATCT (SEQ ID NO: 5789). Sequences shown in FIG.-5- 182358171.1Fox Ref: 368893.416028D: SEQ ID NO: 5781; SEQ ID NO: 5786; GATACACTCTTTCCCTACACGACGCTCTTCCGATCT (5’-3 ') (SEQ ID NO: 5790); SEQ ID NO: 5782; GATCGGAAGAGCGTCGTGTAGGGAAAGAGTGTATC (5’-3’) (SEQ ID NO: 5791); GATCGGAAGAGCACACGTCTGAACTCCAGTCACAGCA (5’-3 ) (SEQ ID NO: 5792); TGCTGTGACTGGAGTTCAGACGTGTGCTCTTCCGATCT (5’-3 ) (SEQ ID NO: 5793); and TGCTGTGACTGGAGTTCAGACGTGT (5 -3’) (SEQ ID NO: 5794). Sequences shown in FIG. 8E:TGACTCTCGACCTCCATCTCATCCCTGCGTGTCTCCGAC (5’-3’) (SEQ ID NO: 5795); CTATGCGCCTTGCCAGCCCGCTCAG (5 -3’) (SEQ ID NO: 5796); UCCAUCTCATCCCTGCGTGTCTCCGCTATGCGCCTTGCCAGCCCGCTCAG (5 ’-3 ) (SEQ ID NO: 5797); CTGAGCGGGCTGGC AAGGCGC ATAGCGGAGAC ACGCAGGGATGAGATGGA (5 ’ -3’) (SEQ ID NO: 5798); SEQ ID NO: 5783; and CTCTCTATGGGCAGTCGGTGATT (5’-3’) (SEQ ID NO: 5799). Sequences shown in FIG. 8F: SEQ ID NO: 5796; UCCAUCTCATCCCTGCGTGTCTCCGCTATGCGCCTTGCCAGCCCGCTCAGT (5 -3 ) (SEQ ID NO: 5800); SEQ ID NO: 5798; SEQ ID NO: 5783; and SEQ ID NO: 5784.

[0031] FIGs. 9A, 9B, 9C, 9D, 9E, 9F, and-9G illustrate sequences for a non-limiting library preparation method. Sequences shown in FIG. 9A: SEQ ID NO: 98; SEQ ID No: 5745; SEQ ID NO: 5779; SEQ ID NO: 5753; and SEQ ID NO: 5752. Sequences shown in FIG. 9B: SEQ ID NO: 5780; SEQ ID NO: 5781; GTGCAGTCGGAGACACGCAGGGATGAGATGGA (5 -3 ) (SEQ ID NO: 5801); SEQ ID NO: 5783; SEQ ID NO: 5784; and SEQ ID NO: 5785. Sequences shown in FIG. 9C: SEQ ID NO: 5781; GATACACTCTTTCCCTACACGAC (5’-3’) (SEQ ID NO: 5802); SEQ ID NO: 5790; SEQ ID NO: 5801; SEQ ID NO: 5791; SEQ ID NO: 5792; SEQ ID NO: 5793; and TGCTGTGACTGGAGTTCAGACGTGT (5’-3 ) (SEQ ID NO: 5803). Sequences shown in FIG. 9D: SEQ ID NO: 5781; GATACACTCTTTCCCTACACGACGCTC (5’-3’) (SEQ ID NO: 5804); SEQ ID NO: 5790; SEQ ID NO: 5801; SEQ ID NO: 5791; SEQ ID NO: 5792; SEQ ID NO: 5793; and SEQ ID NO: 5803. Sequences shown in FIG. 9E: SEQ ID NO: 5781; SEQ ID NO:5763; SEQ ID NO: 5801; (SEQ ID NO:5765); TGGAATTCTCGGGTGCCAAGGAGCA (5’-3 ) (SEQ ID NO: 5805); and TGCTCCTTGGCACCCGAGAATTCCA (5’-3’) (SEQ ID NO: 5806). Sequences shown in FIG. 9F: SEQ ID NO: 5795; SEQ ID NO: 5796; SEQ ID NO: 5800; SEQ ID NO: 5798; ATCACCGACTGCCCATAGTGTGCA (5’-3 ) (SEQ ID NO: 5807); and-6- 182358171.1Fox Ref: 368893.41602UGCTCTCTATGGGCAGTCGGTGATT (5 -3’) (SEQ ID NO: 5808). Sequences shown in FIG. 9G: SEQ ID NO: 5807 and SEQ ID NO: 5784.

[0032] FIGs. 10A, 10B, IOC, 10D, 10E, and 10F illustrate sequences for a non-limiting library preparation method. Sequences shown in FIG. 10A: SEQ ID NO: 98; SEQ ID No: 5745; (SEQ ID NO: 5779); SEQ ID NO: 5753; SEQ ID NO: 5752; and CTCTCTATGGGCAGTCGGTGA (5’-3’) (SEQ ID NO: 5809). Sequences show in FIG. 10B: SEQ ID NO: 5780; SEQ ID NO: 5781; SEQ ID NO: 5801; SEQ ID NO: 5783; SEQ ID NO: 5784; and SEQ ID NO: 5785. Sequences shown in FIG. IOC: SEQ ID NO: 5781; SEQ ID NO: 5804; SEQ ID NO: 5790; SEQ ID NO: 5801; SEQ ID NO: 5791; GATCGGAAGAGCACACGTCTGAACTCCAGTCACAATCACCGACTGCCCATAGAG AGCA (5’-3 ) (SEQ ID NO: 5810); TGCTCTCTATGGGCAGTCGGTGATTGTGACTGGAGTTCAGACGTGTGCTCTTCCG ATCT (5’-3’) (SEQ ID NO: 5811); and TGCTCTCTATGGGCAGTCGGTGATTGTGACTGGAGTTCAGACGTGT (5’-3 ) (SEQ ID NO: 5817). Sequences shown in FIG. 10D: SEQ ID NO: 5781; GATCAGACGTGTGCTCTTCCGATCT (5 -3 ) (SEQ ID NO: 5812); AGATCGGAAGAGCGTCGTGTAGAATCACCGACTGCCC ATAGAGAGC A (5 ’ -3 ’) (SEQ ID NO: 5813); SEQ ID NO: 5801; AGATCGGAAGAGCACACGTCTGATC (5’-3’) (SEQ ID NO: 5814); TGCTCTCTATGGGCAGTCGGTGATTCTACACGACGCTCTTCCGATCT (5 -3 ) (SEQ ID NO: 5815); and SEQ ID NO: 5809. Sequences shown in FIG. 10E:TGACTCTCGACCTCCATCTCATCCCTGCGTCTCCGAC (5 -3’) (SEQ ID NO: 5818); CTACGCGCCTTGCCAGCCCGCTCAG (5 -3’) (SEQ ID NO: 5816); SEQ ID NO: 5800; SEQ ID NO: 5798; SEQ ID NO: 5783; and SEQ ID NO: 5808. Sequences shown in FIG.10F:SEQ ID NO: 5816; SEQ ID NO: 5800; SEQ ID NO: 5798; SEQ ID NO: 5783; SEQ ID NO: 5808; and SEQ ID NO: 5809.FIGs. 11A, 11B, and 11C illustrate sequences with methylated C control regions for a nonlimiting library preparation method. Sequences shown in FIG. 11A:ACACTCTTTCCCTACACGACGCTCTTCCGATCT (SEQ ID NO:5819, 5mC in bold) and AGATCGGAAGAGCACACGTCTGAACTCCAGTCAC (SEQ ID NO 5820, 5mC in bold). Sequences shown in FIG. 11B:ACACTCTTTCCCTACACGACGACGCCGATGCGATCGTCT-7- 182358171.1Fox Ref: 368893.41602(SEQ ID NO:5821, 5mC in bold) and AGACGATCGCATCGGCGTCACACGTCTGAACTCCAGTCAC (SEQ ID NO: 5822. 5mC in bold). Sequences shown in FIG. 11C:ACACTCTTTCCCTACACGACGCGACGTCGCCGT (SEQ ID NO:5823, 5mC in bold) and ACGGCGACGTCGCACACGTCTGAACTCCAGTCAC (SEQ ID NO:5824, 5mC in bold).[0033JFIG. 12 illustrates an illustrative adapter and capture sequence organization, in accordance with sequences and methods described herein. Sequences shown in the figure: SEQ ID NO: 5749; SEQ ID NO: 5752; and SEQ ID NO: 5757.DETAILED DESCRIPTION

[0034] While various embodiments of the invention have been shown and described herein, it will be obvious to those skilled in the art that such embodiments are provided by way of example only. Numerous variations, changes, and substitutions may occur to those skilled in the art without departing from the invention. It should be understood that various alternatives to the embodiments of the invention described herein may be employed.

[0035] As used herein, the singular forms “a,” “an,” and “the” include the plural reference unless the context clearly dictates otherwise.

[0036] When a range of values is provided, it is to be understood that each intervening value between the upper and lower limit of that range, and any other stated or intervening value in that stated range is encompassed within the scope of the present disclosure. Where the stated range includes upper or lower limits, ranges excluding either of those included limits are also included in the present disclosure.

[0037] The term “analyte,” as used herein, generally refers to an object that is the subject of analysis, or an object, regardless of being the subject of analysis, that is directly or indirectly analyzed during a process. An analyte may be synthetic. An analyte may be, originate from, and / or be derived from, a sample, such as a biological sample. In some examples, an analyte is or includes a molecule, macromolecule (e.g., nucleic acid, carbohydrate, protein, lipid, etc.), nucleic acid, carbohydrate, lipid, antibody, antibody fragment, antigen, peptide, polypeptide, protein, macromolecular group (e g., glycoproteins, proteoglycans, ribozymes, liposomes, etc.), cell, tissue, biological particle, or an organism, or any engineered copy or variant thereof, or any combination thereof. The term “processing an analyte,” as used herein, generally refers to one or more stages of interaction with one more samples. Processing an analyte may -8- 182358171.1Fox Ref: 368893.41602comprise conducting a chemical reaction, biochemical reaction, enzymatic reaction, hybridization reaction, polymerization reaction, physical reaction, any other reaction, or a combination thereof with, in the presence of, or on, the analyte. Processing an analyte may comprise physical and / or chemical manipulation of the analyte. For example, processing an analyte may comprise detection of a chemical change or physical change, addition of or subtraction of material, atoms, or molecules, molecular confirmation, detection of the presence of a fluorescent label, detection of a Forster resonance energy transfer (FRET) interaction, or inference of absence of fluorescence.

[0038] The term "biological sample,” as used herein, generally refers to any sample derived from a subject or specimen. The biological sample can be a fluid, tissue, collection of cells (e.g., cheek swab), hair sample, or feces sample. The fluid can be blood (e.g., whole blood), saliva, urine, or sweat. The tissue can be from an organ (e.g., liver, lung, or thyroid), or a mass of cellular material, such as, for example, a tumor. The biological sample can be a cellular sample or cell-free sample. Examples of biological samples include nucleic acid molecules, amino acids, polypeptides, proteins, carbohydrates, fats, or viruses. In an example, a biological sample is a nucleic acid sample including one or more nucleic acid molecules, such as deoxyribonucleic acid (DNA) and / or ribonucleic acid (RNA). The nucleic acid sample may comprise cell-free nucleic acid molecules, such as cell-free DNA or cell-free RNA. Nonlimiting examples of nucleic acids include DNA, RNA, genomic DNA or synthetic DNA / RNA or coding or non-coding regions of a gene or gene fragment, loci (locus) defined from linkage analysis, exons, introns, messenger RNA (mRNA), transfer RNA, ribosomal RNA (rRNA), short interfering RNA (siRNA), short-hairpin RNA (shRNA), micro-RNA (miRNA), ribozy mes, cDNA, recombinant nucleic acids, branched nucleic acids, plasmids, vectors, isolated DNA of any sequence, and isolated RNA of any sequence. Further, samples may be extracted from variety of animal fluids containing cell free sequences, including but not limited to blood, serum, plasma, vitreous, sputum, urine, tears, perspiration, saliva, semen, mucosal excretions, mucus, spinal fluid, amniotic fluid, lymph fluid and the like. Cell free polynucleotides may be fetal in origin (via fluid taken from a pregnant subject) or may be derived from tissue of the subject itself. A biological sample may also refer to a sample engineered to mimic one or more properties (e.g., nucleic acid sequence properties, e.g., sequence identity', length, GC content, etc.) of a sample derived from a subject or specimen.

[0039] As used herein, the term ‘‘template nucleic acid” generally refers to the nucleic acid to be sequenced. The template nucleic acid may be an analyte or be associated with an analyte.-9- 182358171.1Fox Ref: 368893.41602For example, the analyte can be a mRNA, and the template nucleic acid is the mRNA or a cDNA derived from the mRNA, or other derivative thereof. In another example, the analyte can be a protein, and the template nucleic acid is an oligonucleotide that is conjugated to an antibody that binds to the protein, or derivative thereof. Examples of sequencing include single molecule sequencing or sequencing by synthesis, for example. Sequencing may comprise generating sequencing signals and / or sequencing reads. Sequencing may be performed on template nucleic acids immobilized on a support, such as a flow cell, substrate, and / or one or more beads. In some cases, a template nucleic acid may be amplified to produce a colony of nucleic acid molecules attached to the support to produce amplified sequencing signals. In one example, (i) a template nucleic acid is subjected to a nucleic acid reaction, e.g., amplification, to produce a clonal population of the nucleic acid attached to a bead, the bead immobilized to a substrate, (ii) amplified sequencing signals from the immobilized bead are detected from the substrate surface during or following one or more nucleotide flows, and (iii) the sequencing signals are processed to generate sequencing reads. The substrate surface may immobilize multiple beads at distinct locations, each bead containing distinct colonies of nucleic acids, and upon detecting the substrate surface, multiple sequencing signals may be simultaneously or substantially simultaneously processed from the different immobilized beads at the distinct locations to generate multiple sequencing reads. In some sequencing methods, the nucleotide flows comprise non-terminated nucleotides. In some sequencing methods, the nucleotide flows comprise terminated nucleotides.

[0039] The term ‘'nucleotide,” as used herein, generally refers to any nucleotide or nucleotide analog. The nucleotide may be naturally occurring or non-naturally occurring. The nucleotide may be a non-standard, modified, synthesized, or engineered nucleotide. The nucleotide may include a canonical base or a non-canonical base. The nucleotide may include a modified polyphosphate chain (e.g., triphosphate coupled to a fluorophore). The nucleotide may comprise a label. The nucleotide may be terminated (e.g., reversibly terminated). The nucleotide may be non-terminated (e.g., natural or modified). In some cases, nucleotides may include modifications in their phosphate moieties, including modifications to a triphosphate moiety. Nucleic acids may also be modified at the base moiety (e.g., at one or more atoms that typically are available to form a hydrogen bond with a complementary nucleotide and / or at one or more atoms that are not typically capable of forming a hydrogen bond with a complementary nucleotide), sugar moiety or phosphate backbone. Nucleic acids may also contain amine-modified groups, such as aminoallyl-dUTP (aa-dUTP) and aminohexhylacrylamide-dCTP -10- 182358171.1Fox Ref: 368893.41602(aha-dCTP) to allow covalent attachment of amine reactive moieties, such as N-hydroxy succinimide esters (NHS). Alternatives to standard DNA base pairs or RNA base pairs in the oligonucleotides of the present disclosure can provide higher density in bits per cubic mm, higher safety (resistant to accidental or purposeful synthesis of natural toxins), easier discrimination in photo- programmed polymerases, or lower secondary structure. Nucleotides may be capable of reacting or bonding with detectable moieties for detection.

[0040] The term ‘"sequencing,’7as used herein, generally refers to a process for generating or identifying a sequence of a biological molecule, such as a nucleic acid. The sequence may be a nucleic acid sequence which comprises a sequence of nucleic acid bases. Examples of sequencing include single molecule sequencing or sequencing by synthesis, for example. Sequencing may comprise generating sequencing signals and / or sequencing reads.

[0041] As used herein, the terms ’‘identical,” “homologous,” “percent identity,” or “percent homology,” when used with respect to two or more nucleic acid or polypeptide sequences, refer to two or more sequences that are the same or, alternatively, have a specified percentage nucleotide or amino acid residues that are the same, when compared and aligned for maximum correspondence, as measured using any one or more of the following sequence comparison algorithms: Needleman-Wunsch (see, e.g., Needleman, Saul B.; and Wunsch, Christian D. (1970). “A general method applicable to the search for similarities in the amino acid sequence of two proteins” Journal of Molecular Biology 48 (3):443-53); Smith-Waterman (see. e.g., Smith, Temple F.; and Waterman, Michael S.. “Identification of Common Molecular Subsequences” (1981) Journal of Molecular Biology 147: 195-197); or BLAST (Basic Local Alignment Search Tool; see, e.g., Altschul S F, Gish W, Miller W, Myers E W, Lipman D J, “Basic local alignment search tool” (1990) J Mol Biol 215 (3):403-410). For the purposes of comparing and aligning two sequences, “U” and “T” bases may be interchangeable (i.e., considered a match). As used herein, the terms “substantially identical,” “substantial identity,” “substantially homologous,” “substantial homology,” when used with respect to two or more nucleic acid or polypeptide sequences, refer to two or more sequences or subsequences (such as biologically active fragments) that have at least 60%. at least 70%, at least 75%, at least 80%, at least 85%, at least 90%, at least 95%, at least 96%, at least 97%, at least 98%, or at least 99% nucleotide or amino acid residue identity, when compared and aligned for maximum correspondence, as measured using a sequence comparison algorithm or by visual inspection. Typically, substantially identical nucleic acid or protein sequences include less than 100% nucleotide or amino acid residue identity as such sequences would generally be considered -11- 182358171.1Fox Ref: 368893.41602“identical.” Any nucleic acid described herein as comprising a particular sequence (such as identified by a SEQ ID NO:) may alternatively comprise its reverse complement sequence. Any nucleic acid described herein as comprising a particular sequence (such as identified by a SEQ ID NO:) may alternatively comprise a substantially identical sequence, and / or a sequence having at least 60%, at least 70%, at least 75%, at least 80%, at least 85%, at least 90%, at least 95%, at least 96%, at least 97%, at least 98%, or at least 99% nucleotide residue identity as the particular sequence, or reverse complement thereof. Any nucleic acid described herein as comprising a particular sequence (such as identified by a SEQ ID No:) may alternatively comprise a shorter sequence that is contiguous and nested inside the longer, particular sequence, such as less 1, 2, 3, 4, 5, 6, 7, 8, 9, 10, 15, 20, 25, 30, 35. 40, 45, 50, 55, 60, 65, 70, 75, 80. 85. 90. 95, 100 or more bases than the particular sequence, or reverse complement thereof.

[0042] Sequences herein may include oligo modifications (e.g., modified nucleotide bases or non-nucleic acid modifications such as spacers). Unless otherwise indicated, modification notation follows Integrated DNA Technology (IDT) standard modification codes.Sample Processing Methods

[0043] Described herein are sequences, methods, compositions, and kits for processing samples, such as to prepare a sample for sequencing, to sequence a sample, and / or to analyze sequencing data. FIG. 1 illustrates an example sequencing workflow 100, according to the sequences, methods, compositions, and kits of the present disclosure.

[0044] Supports and / or template nucleic acids may be provided and / or prepared (101) to be compatible with downstream sequencing operations (e.g., 107). A support (e.g., bead) may help immobilize a template nucleic acid to a substrate, such as when the template nucleic acid is coupled to the support, and the support is in turn immobilized to the substrate. The support may further function as a binding entity to retain derivatives molecules (e.g., amplification products) from a same template nucleic acid together for downstream processing, such as for sequencing operations. This may be useful in distinguishing a colony from other colonies (e.g., on other supports) and generating amplified sequencing signals corresponding to a template nucleic acid. The supports may further function as minimum spacers between different template nucleic acids. A support may comprise an oligonucleotide comprising one or more functional nucleic acid sequences. The oligonucleotide may be single-stranded, double-stranded, or partially double-stranded. For example, the oligonucleotide may comprise a capture sequence, a primer sequence, a sequencing primer sequence, a barcode sequence, a sample index -12- 182358171.1Fox Ref: 368893.41602sequence, a unique molecular identifier (UMI), a flow cell adapter sequence, an adapter sequence, a target sequence, a random sequence, a binding sequence (e.g., for a splint, primer, template nucleic acid, capture sequence, etc.), or any other functional sequence useful for a downstream operation, a complement thereof, or any combination thereof. The capture sequence may be configured to hybridize to a sequence of a template nucleic acid or derivative thereof. The support may comprise a plurality of oligonucleotides, for example on the order of 10, 102, 103, 104, 105, 106, 107, or more molecules. The support may comprise a single species of oligonucleotide which comprise identical sequences. The support may comprise multiple species of oligonucleotides which have varying sequences. In some cases, the support comprises a single species of a primer (e.g., forward primer) for amplification. In some cases, the support comprises two species of primer (e.g., forward primer, reverse primer) for amplification, sequences, methods, compositions, and kits for preparing and using support species are described in further detail in U. S. Patent Pub. Nos. 20220042072A1 and 20230332226A1, each of which is entirely incorporated herein by reference for all purposes.

[0045] A support may comprise one or more capture entities, where a capture entity’ is configured for capture by a capturing entity. A capture entity may be coupled to or be part of an oligonucleotide coupled to the support. A capture entity may be coupled to or be part of the support. Examples of capture entity-capturing entity pairs and capturing entity-capture entity pairs include: streptavidin (SA)-biotin; complementary sequences; magnetic particle-magnetic field system; charged particle-electric field system; azide-cyclooctyne; thiol-maleimide; click chemistry pairs; cross-linking pairs; etc. The capture entity-capturing entity pair may comprise one or more chemically modified bases. A capture entity and capturing entity may bind, couple, hybridize, or otherwise associate with each other. The association may comprise formation of a covalent bond, non-covalent bond, releasable bond (e.g., cleavable bond that is cleavable upon application of a stimulus), and / or no bond. The capture entity may be capable of linking to a nucleotide. In some instances, the capturing entity may comprise a secondary capture entity, for example, for subsequent capture by a secondary capturing entity. The secondary capture entity and secondary capturing entity may comprise any one or more of the capturing mechanisms described elsewhere herein.[0046JA support may comprise one or more cleavable moieties, also referred to herein as excisable moieties. The cleavable moiety may be coupled to or be part of an oligonucleotide coupled to the support. The cleavable moiety may be coupled to the support. A cleavable moiety may comprise any useful moiety that can be used to cleave an oligonucleotide (or -13- 182358171.1Fox Ref: 368893.41602portion thereof) from the support, or otherwise release a nucleic acid strand from the support and / or the oligonucleotide. A cleavable moiety may comprise a uracil, a ribonucleotide, methylated nucleotide, or other modified nucleotide that is excisable or cleavable using an enzyme (e.g., UDG, RNAse, APE1, MspJI, endonuclease, exonuclease, etc.). The cleavable moiety may comprise an abasic site or an analog of an abasic site (e.g., dSpacer), a dideoxyribose, a spacer, e.g., C3 spacer, hexanediol, triethylene glycol spacer (e.g., Spacer 9), hexa-ethyleneglycol spacer (e.g., Spacer 18), a photocleavable moiety, or combinations or analogs thereof. Alternatively, or in addition, the cleavable moiety may be cleavable using one or more stimuli, e.g., photo-stimulus, chemical stimulus, thermal stimulus, etc.

[0047] The sequencing workflow 100 may not involve supports, for example when a template nucleic acid and / or its derivatives are directly attached to a substrate and amplified and / or sequenced from the substrate.[0048JA template nucleic acid may include an insert sequence sourced from a biological sample. The template nucleic acid may be derived from any nucleic acid of the biological sample (e.g., endogenous nucleic acid) and result from any number of processing operations, such as but not limited to fragmentation, degradation or digestion, transposition, ligation, reverse transcription, extension, replication, etc. The template nucleic acid may be singlestranded, double-stranded, or partially double-stranded. A template nucleic acid may comprise one or more functional nucleic acid sequences. For example, the template nucleic acid may comprise a capture sequence, a primer sequence, a sequencing primer sequence, a barcode sequence, a sample index sequence, a unique molecular identifier (UMI), a flow cell adapter sequence, an adapter sequence, a target sequence, a random sequence, a binding sequence (e.g., for a splint, primer, template nucleic acid, capture sequence, etc ), or any other functional sequence useful for a downstream operation, a complement thereof, or any combination thereof. The template nucleic acid may comprise an adapter sequence configured to be captured by a capture sequence of an oligonucleotide coupled to a support. The one or more functional nucleic acid sequences may be disposed at one end or both ends of the insert sequence. A nucleic acid molecule comprising the insert sequence, or complement thereof, may be processed with (e.g., attached to. extend from, etc.) one or more adapter molecules to generate the template nucleic acid comprising the insert sequence and one or more functional nucleic acid sequences. A template nucleic acid may comprise one or more capture entities and / or one or more cleavable moieties that are described elsewhere herein.-14- 182358171.1Fox Ref: 368893.41602

[0049] Optionally, the supports and / or template nucleic acids may be pre-enriched (102). For example, a support comprising a distinct oligonucleotide sequence is pre-enriched to isolate from a mixture comprising support(s) that do not have the distinct oligonucleotide sequence. For example, a template nucleic acid comprising a distinct configuration (e.g., comprising a particular adapter sequence) is pre-enriched to isolate from a mixture comprising template nucleic acids that do not have the distinct configuration. In some cases, the capture entity on the supports and / or template nucleic acids are used for pre-ennchment.

[0050] The supports and template nucleic acids may be attached (103) to generate supporttemplate complexes. A template nucleic acid may be coupled to a support via any method(s) that results in a stable association between the template nucleic acid and the support. For example, the template nucleic acid may hybridize to an oligonucleotide on the support; the template nucleic acid may be ligated to a nucleic acid coupled to the support; the template nucleic acid may hybridize to one or more intermediary molecules, such as a splint, bridge, and / or primer molecule, which hybridizes to an oligonucleotide on the support; and / or the template nucleic acid may be hybridized to an oligonucleotide on a support, which oligonucleotide comprises a primer sequence which is extended. In some cases, the respective concentrations of the supports and template nucleic acids may be adjusted such that a majority of support-template complexes are single template-attached supports (e.g., a support attached to a single template nucleic acid).

[0051] 0ptionally, support-template complexes may be pre-enriched (104), wherein a supporttemplate complex is isolated from a mixture comprising support(s) and / or template nucleic acid(s) that are not attached to each other. In some cases, the capture entity on the supports and / or template nucleic acids are used for pre-enrichment.

[0052] The template nucleic acids may be subjected to amplification reactions (105) to generate a plurality of amplification products immobilized to the support. Such amplification reactions may comprise performing polymerase chain reaction (PCR) or any other amplification methods described herein, including but not limited to emulsion PCR (ePCR or emPCR), isothermal amplification, recombinase polymerase amplification (RPA), rolling circle amplification (RCA), multiple displacement amplification (MDA), bridge amplification, template walking, etc. Amplification reactions can occur while the support is immobilized to a substrate. Amplification reactions can occur off the substrate, such as in solution, or on a different surface or platform. Amplification reactions can occur in isolated reaction volumes, such as within multiple droplets in an emulsion during emulsion PCR (ePCR or emPCR), or in wells or tubes.-15- 182358171.1Fox Ref: 368893.41602

[0053] Optionally, subsequent to amplification, the supports, template nucleic acids, and / or support-template complexes may be subjected to post-amplification processing (106). Often, subsequent to amplification, a resulting mixture may comprise a mix of positive supports (e.g., those comprising a template nucleic acid molecule) and negative supports (e.g., those not attached to template nucleic acid molecules). Enrichment procedure(s) may isolate positive supports from the mixtures. Example methods of enrichment of amplified supports are described in U. S. Patent No. 11,118,223, U. S. Patent Pub. No. 20230332226A1, and International Patent Pub. No. WO2025129194A2, each of which is entirely incorporated by reference herein. Alternatively, the template nucleic acids may not be subjected to amplification reactions and be directly sequenced as single molecules.

[0054] The template nucleic acids may be subject to sequencing (107). The template nucleic acid(s) may be sequenced while attached to the support. Alternatively, the template nucleic acid molecules may be free of the support when sequenced and / or analyzed. The template nucleic acids may be sequenced while immobilized to a substrate, such as via a support or otherwise. Examples of substrate-based sample processing systems are described elsewhere herein. Any sequencing method may be used, for example pyrosequencing, single molecule sequencing, sequencing by synthesis (SBS), sequencing by ligation, sequencing by binding, etc.

[0055] For example, sequencing comprises extending a sequencing primer (or growing strand) hybridized to a template nucleic acid by providing labeled nucleotide reagents, washing away unincorporated nucleotides from the reaction space, and detecting one or more signals from the labeled nucleotide reagents which are indicative of an incorporation event or lack thereof. After detection, the labels may be cleaved and the whole process may be repeated any number of times to determine sequence information of the template nucleic acid. One or more intermediary flows may be provided intra- or inter- repeat, such as washing flows, label cleaving flows, terminator cleaving flows, reaction-completing flows (e.g., double tap flow, triple tap flow, etc.), labeled flows (or bright flows), unlabeled flows (or dark flows), phasing flows, chemical scar capping flows, etc. A nucleotide mixture that is provided during any one flow may comprise only labeled nucleotides, only unlabeled nucleotides, or a mixture of labeled and unlabeled nucleotides. The mixture of labeled and unlabeled nucleotides may be of any fraction of labeled nucleotides, such as at least or at most 1%, 2%, 3%, 4%, 5%, 6%, 7%, 8%, 9%, 10%, 15%, 20%, 25%, 30%, 35%, 40%, 45%, 50%, 55%, 60%, 65%, 70%, 75%, 80%. 85%. 90%. 95%, or 99%. A nucleotide mixture that is provided during any one flow may -16- 182358171.1Fox Ref: 368893.41602comprise only non-terminated nucleotides, only terminated nucleotides, or a mixture of terminated and non-terminated nucleotides. When using only non-terminated nucleotides, terminator cleaving flows may be omitted from the sequencing process. When using terminated nucleotides, to proceed with the next step of extension, prior to, during, or subsequent to detection, a terminator cleaving flow may be provided to cleave blocking moieties. A nucleotide mixture that is provided during any one flow may comprise any number of canonical base types (e.g., A, T, G, C, U), such as a single canonical base type, two canonical base types, three canonical base types, four canonical base types or five canonical base types (including T and U). Different types of nucleotide bases may be flowed in any order and / or in any mixture of base types that is useful for sequencing. Various flow-based sequencing systems and methods are described in U. S. Pat. No. 11,459,609B2. which is entirety incorporated by reference herein for all purposes. Labeled nucleotides may comprise a dye, fluorophore, quantum dot, any optical moiety, multiples thereof, and / or combination thereof. In some cases, nucleotides of different canonical base types may be labeled and detectable at a single frequency (e.g., using the same or different dyes). In other cases, nucleotides of different canonical base types may be labeled and detectable at different frequencies (e.g., using the same or different dyes).

[0056] Subsequent to sequencing, the sequencing signals collected and / or generated may be subjected to data analysis (108). The sequencing signals may be processed to generate base calls, sequencing reads. In some cases, the sequencing reads may be processed to generate diagnostics data to the biological sample, or the subject from which the biological sample was derived from. The data analysis may comprise image processing, alignment to a genome or reference genome, training and / or trained algorithms, error correction, variant calling, and the like.

[0057] While the sequencing workflow 100 with respect to FIG. 1 has been described with respect to the use of supports to bind template molecules, it will be appreciated that the different supports may be effectively replaced by using spatially distinct locations on one or more surfaces, which do not necessarily have to be the surfaces of individual supports (e.g., beads). For example, a first spatially distinct location on a surface may be capable of directly immobilizing a first template nucleic acid, or first colony thereof, and a second spatially distinct location on the same surface (or a different surface) may be capable of directly immobilizing a second template nucleic acid, or second colony thereof, to distinguish from the first template. In some cases, the surface comprising the spatially distinct locations may be a surface of the -17- 182358171.1Fox Ref: 368893.41602substrate on which the sample is sequenced, thus streamlining the amplification-sequencing workflow.

[0058] It will be appreciated that in some instances, the different operations described in the sequencing workflow 100 may be performed in a different order. It will be appreciated that in some instances, one or more operations described in the sequencing workflow 100 may be omitted or replaced with other comparable operation(s). It will be appreciated that in some instances, one or more additional operations described in the sequencing workflow 100 may be performed. The different operations described with respect to sequencing workflow 100 may be performed with the help of open substrate systems described herein.Adapters

[0059] A template nucleic acid in a library may be generated at least in part by attaching one or more adapters to a template insert molecule. For example, a template insert molecule comprising a first end and a second end may be attached to two adapters, a first adapter at the first end and a second adapter at the second end. A template insert molecule may be attached to an adapter at only one of the ends. A template insert molecule may be attached to multiple adapters (e.g., two or more) at any one end. A template insert molecule may be attached to a single adapter at both ends (e g., to form a circular structure). A template insert molecule may be double-stranded, partially double-stranded, or single stranded. An adapter molecule may be double-stranded, partially double-stranded, or single stranded. An adapter molecule may comprise a single strand, two strands, three strands, or more strands, where each strand in the adapter molecule is associated with at least one of the other strands (if any) via hybridization, crosslinking, conjugation, covalent bond, or other coupling.

[0060] A template insert molecule may be attached to an adapter via any method(s) that results in a stable association between the template insert molecule and the adapter. For example, the template insert may be ligated to an adapter. The template insert may hybridize to an adapter, e.g., via one or more overhangs. The template insert and adapter may hybridize to one or more intermediary molecules, such as a splint, bridge, and / or primer molecule. After any hybridization, one or more strands may be extended, strand displaced, and / or ligated.[0061JFIG. 2 illustrates a method for attaching a template insert to adapters on each end to generate a template nucleic acid, which adapters contain functional sequences that facilitate attachment of the template nucleic acid, or derivative thereof, to a surface and sequencing of the surface-attached template nucleic acid, or derivative thereof. A template insert comprising a first end and a second end may be attached to Adapter A on the first end and Adapter B on -18- 182358171.1Fox Ref: 368893.41602the second end. While illustrated are double-stranded template inserts and adapters for simplicity, as described elsewhere herein, any of the nucleic acids may independently have different formats (e.g., double-stranded, single-stranded, partially double-stranded). Adapters A and B may be the same type of adapter. Adapters A and B may be different types of adapters. In some cases, Adapter A or B may represent a complex of two or more adapters. In some cases, a template insert end may be first attached to Adapter A or B, and then that extended adapter end attached to another adapter (not illustrated).

[0062] Adapter B may comprise a surface binding sequence or complement thereof. A surface, such as a surface of a bead or wafer, may comprise a surface primer molecule immobilized thereto, the surface primer molecule comprising sequence ‘PB’. The surface binding sequence or complement thereof of Adapter B may be configured to bind to the sequence PB. In some cases, such as where a splint is used to attach template nucleic acid to the surface, the sequence PB of the surface primer molecule and the surface binding sequence or complement thereof of Adapter B may be configured to bind to the splint (instead of to each other). While illustrated as a single-stranded molecule in the figure, the surface primer molecule may be in any format, such as double-stranded, partially double-stranded, or single-stranded, where at least one of the strand(s) comprise the sequence PB. Derivatives of the template nucleic acid, such as copies or reverse complement copies of one or both strands of the template nucleic acid, may comprise the surface binding sequence or complement thereof of Adapter B.

[0063] Adapter A may comprise a sequencing primer binding sequence or complement thereof. A sequencing primer may comprise sequence ‘PA’. The sequencing primer binding sequence or complement thereof of Adapter A may be configured to bind to the sequence PA. Derivatives of the template nucleic acid, such as copies or reverse complement copies of one or both strands of the template nucleic acid, may comprise the sequencing primer binding sequence or complement thereof of Adapter A.[0064JA template nucleic acid comprising Adapter B may thus be attached to a surface via Adapter B. In one example, the surface binding sequence or complement thereof in the Adapter B portion of the template nucleic acid, or derivative thereof, may hybridize to the PB sequence of the surface primer molecule on the surface, and the surface primer may be extended through a remaining portion of the template nucleic acid, or derivative thereof. In another example, the surface binding sequence or complement thereof in the Adapter B portion of the template nucleic acid, or derivative thereof, and the PB sequence of the surface primer molecule may both hybridize to a splint molecule, and the surface binding sequence and PB sequence ligated -19- 182358171.1Fox Ref: 368893.41602(optionally after gap fill if there is a gap on the splint). Where the template nucleic acid, or derivative thereof, is at least partially double-stranded, a binding sequence may be in an overhanging single-stranded portion and / or the two strands in the double strand may be first denatured and one of the strands containing the binding sequence may be available to hybridize to another sequence. In another example, the surface primer molecule may be ligated to the Adapter B end of the template nucleic acid, or derivative thereof, e.g., viablunt-ended ligation.[0065JA template nucleic acid comprising Adapter A (e.g., attached to a surface via Adapter B) may thus be sequenced via Adapter A. For example, during a sequencing-by-synthesis (SBS) reaction, a sequencing primer comprising the PA sequence may be hybridized to the sequencing primer binding sequence or complement thereof in the Adapter A portion of the template nucleic acid, or derivative thereof, and extended.[0066JFIG. 3 illustrates different examples of adapter structures and adapter segment labels. An adapter, either Adapter A or Adapter B or both, that is attached to a template may comprise any structure. Adapters A and B may have the same adapter structure or different adapter structures. As examples, an adapter may comprise (1) blunt double-stranded structure, (2) overhanging partially double-stranded structure (e.g., comprising 5’ overhang, 3 ’ overhang, both 5’ and 3’ overhangs, nested overhangs, etc.), (3) partially double-stranded, bubble clamp mismatch structure, (4) partially double-stranded, branching mismatch structure, (5) partially double-stranded hairpin structure. Not illustrated, an adapter may also be single-stranded. (A) when referring to any adapter structure (including any of the above-mentioned structures), the adapter may generally have a non-template-attaching end and a tempi ate- attaching end. (B) when referring to a partially double-stranded, bubble clamp mismatch structure (as drawn in (3)), the adapter may comprise a first clamp double-stranded segment (‘Clamp 1 ’), a mismatch segment comprising two single strands (‘Mismatch’), and a second clamp double-stranded segment (‘Clamp 2’), where the mismatch segment is sandwiched by the two clamp segments.(C) when referring to a partially double-stranded, branching mismatch structure (as drawn in (4)), the adapter may comprise a branch segment (‘Branch’) comprising at least two single strands, and a stem double-stranded segment (‘Stem’). (D) when referring to a partially doublestranded, hairpin structure (as drawn in (5)), the adapter may comprise a hairpin segment (‘Hairpin’) comprising a looping strand, and a stem double-stranded segment ('Stem’), where the two ends of the looping strand in the hairpin segment connect to different strands in the stem segment.-20- 182358171.1Fox Ref: 368893.41602

[0067] In FIGs.2 and 3, unless explicitly stated otherwise, an arrow representing a nucleic acid strand is generally drawn in a 5’ to 3' direction.

[0068] Any adapter sequence described herein may be advantageous for flow sequencing methods as described elsewhere herein.

[0069] Diverse barcode sequences

[0070] Provided herein are sequences, methods, compositions, and kits that produce or provide sets of sufficiently diverse barcode sequences. Such sequences, methods, compositions, and kits can be applied alternatively or in addition to the preparation 101 and amplification 105 operations described with respect to sequencing workflow 100 of FIG. 1. Such sequences, methods, compositions, and kits can be used in conjunction with the sample processing systems and methods, or components thereof (e.g., substrates, detectors, reagent dispensing, continuous scanning, etc.) described herein.

[0071] Table 1: UGA Indexing primer sequencesSEQ ID No: Oligo Sequence 5’ SEQ ID No: 14 TGCACATCAGT to 3’ CCTGCSEQ ID No: 1 TGCACTGCACA SEQ ID No: 15 TGCACAAGCGA TTGTA CATGC SEQ ID No: 2 TGCACTCATGG SEQ ID No: 16 TGCACATGCTC TATAT AATATCT SEQ ID No: 3 TGCACTGCATG SEQ ID No: 17 TGCACGACTCA CTGGCGT TGCCT SEQ ID No: 4 TGCACGGCACG SEQ ID No: 18 TGCACATGGCA ATGCT TACTGCT SEQ ID No: 5 TGCACTCTTCA SEQ ID No: 19 TGCACAATCGC TGAGCAT ATCGT SEQ ID No: 6 TGCACTCATGG SEQ ID No: 20 TGCACGGCACT AGCATAT GCAGT SEQ ID No: 7 TGCACATACTG SEQ ID No: 21 TGCACGGATCG CCTAT CATGC SEQ ID No: 8 TGCACAATGCA SEQ ID No: 22 TGCACTATTGC TCTATAT TCTGCAT SEQ ID No: 9 TGCACGAGCAC SEQ ID No: 23 TGCACATCTGC AATGCAT GGCACAT SEQ ID No: 10 TGCACGGCAGC SEQ ID No: 24 TGCACATCGAT AGACT GCAGAAT SEQ ID No: 11 TGCACAACATG SEQ ID No: 25 TGCACACATGA CACATCT CCAGC SEQ ID No: 12 TGCACGTGCAT SEQ ID No: 26 TGCACAATGCT GGCATCT GTAGT SEQ ID No: 13 TGCACTACAGC SEQ ID No: 27 TGCACGACATGAATGTCACCT-21- 182358171.1Fox Ref: 368893.41602SEQ ID No: 28 TGCACGCAAGC SEQ ID No: 52 TGCACTCAGCT ATGTC GCGGC SEQ ID No: 29 TGCACATGCTC SEQ ID No: 53 TGCACATGCAG GGCTGCT AGCGCCT SEQ ID No: 30 TGCACAAGTCT SEQ ID No: 54 TGCACAATGCT GCTCA ATCGA SEQ ID No: 31 TGCACATCATT SEQ ID No: 55 TGCACAGATAA GATCATC GAGCA SEQ ID No: 32 TGCACACTCAC SEQ ID No: 56 TGCACAGAGCC AATGCAT ACTCA SEQ ID No: 33 TGCACATGTGG SEQ ID No: 57 TGCACATGTAA CTATCAT TATCA SEQ ID No: 34 TGCACATGTAT SEQ ID No: 58 TGCACAGCGCA GCGCAAT TGATCCT SEQ ID No: 35 TGCACTTGCGC SEQ ID No: 59 TGCACATAGAT TCTCA AGCCA SEQ ID No: 36 TGCACGCGCAC SEQ ID No: 60 TGCACACTAGC AATAT ATGGC SEQ ID No: 37 TGCACAGCGCA SEQ ID No: 61 TGCACAATAGC CCAGCAT ATCGA SEQ ID No: 38 TGCACTGCTAT SEQ ID No: 62 TGCACTTCTGT CTGGT GAGAT SEQ ID No: 39 TGCACGATATC SEQ ID No: 63 TGCACTCTGCT ATGGT CATTCAT SEQ ID No: 40 TGCACATGCAT SEQ ID No: 64 TGCACACAATA GTGGATA GCGAT SEQ ID No: 41 TGCACTCTGCT SEQ ID No: 65 TGCACTGTAGG CCTGC CATCT SEQ ID No: 42 TGCACATCGCA SEQ ID No: 66 TGCACAACAGC CCAGA TCTCT SEQ ID No: 43 TGCACAATCTG SEQ ID No: 67 TGCACAGACAC ATATGAT AATAT SEQ ID No: 44 TGCACATACTG SEQ ID No: 68 TGCACTAGCAA CAGGA GATCA SEQ ID No: 45 TGCACTTCATG SEQ ID No: 69 TGCACTTGAGA ACAGA CATGA SEQ ID No: 46 TGCACTACATC SEQ ID No: 70 TGCACTCAGAT ATGGCAT GTCCA SEQ ID No: 47 TGCACGCTGTT SEQ ID No: 71 TGCACAGCCGC GCATGAT ATGCACA SEQ ID No: 48 TGCACTTCACT SEQ ID No: 72 TGCACTCGCAT CATGA GTGGA SEQ ID No: 49 TGCACATGCGC SEQ ID No: 73 TGCACACATGC TTACA ATGTCCT SEQ ID No: 50 TGCACAGCATC SEQ ID No: 74 TGCACGCGGCT TCTGCCT GATAT SEQ ID No: 51 TGCACACTGCC SEQ ID No: 75 TGCACTGTGACATATCATAAGCT-22- 182358171.1Fox Ref: 368893.41602SEQ ID No: 76 TGCACATGCGA SEQ ID No: 87 TGCACAGAACA GCATGGT TGTCA SEQ ID No: 77 TGCACAATACA SEQ ID No: 88 TGCACGCACAA TGATC TGCGA SEQ ID No: 78 TGCACATGGAC SEQ ID No: 89 TGCACATGCAC ATATGCA AGAATGT SEQ ID No: 79 TGCACAGCGCG SEQ ID No: 90 TGCACGTATGG CTGGCAT CAGCT SEQ ID No: 80 TGCACATGCGT SEQ ID No: 91 TGCACTGATGG CACCT TGCTCAT SEQ ID No: 81 TGCACTGCATG SEQ ID No: 92 TGCACTCAGCC TTGCTGA ATGCGAT SEQ ID No: 82 TGCACATCCTG SEQ ID No: 93 TGCACATGCAC CGATA AAGATCA SEQ ID No: 83 TGCACAATATC SEQ ID No: 94 TGCACTCTGTT TGAGT GCTCA SEQ ID No: 84 TGCACTGTGCA SEQ ID No: 95 TGCACACAGCG GGAGT CTCCA SEQ ID No: 85 TGCACGATGTG SEQ ID No: 96 TGCACACAGAA CCATAGATGCSEQ ID No: 86 TGCACTCACATGGAGA

[0072] In some cases, sequences from Table 1 may comprise a 5’ common adapter sequence, SEQ ID No: 97, ATCTCATCCCTGCGTGTCTCCGAC. Alternatively, in some cases, sequences from Table 1 may comprise a 5’ common adapter sequence, SEQ ID No: 98, CCATCTCATCCCTGCGTGTCTCCGAC, which includes two cytosine residues at the 5' end of SEQ ID No: 97.

[0073] In some cases, sequences from Table 1 may comprise a 3’ common adapters sequence, SEQ ID No: 99, GATCTACACGACGCTCTTCCGATC. In some cases, a sequence comprising SEQ ID No: 99 may further comprise a 3’ phosphorothioated T, indicated for example as GATCTACACGACGCTCTTCCGATC* (SEQ ID No: 100).

[0074] Primers from Table 1 may be paired with primers that correspond to another adapter sequence coupled to template nucleic acid molecules.

[0075] Table 2: UGB universal primersSEQ ID No: Oligo Sequence 5’ to 3’SEQ ID No: 101 CTGTGTGCCTTGGCAGTCTCAGCTCAGACGTGTGCTCTTCCG ATC*TSEQ ID No: 102 CTGTGTGCCTTGGCAGTCTCAGCTCCTTGGCACCCGAGAATTCCA-23- 182358171.1Fox Ref: 368893.41602

[0076] Extended Barcode sequences

[0077] Table 3 lists a set of extended barcode sequences. In some cases, a sequence from Table 3 may further comprise a 5’ preamble sequence. In some cases, a preamble sequence may comprise TGCA. In some cases, a preamble sequence may comprise a non-repetitive series of the four canonical nucleic acid bases (e.g., AGCT, TCGA, etc.). In some cases, a preamble may comprise one to 10 nucleic acid bases, e.g., 1, 2, 3, 4, 5, 6, 7, 8, 9, or 10 bases in any order or combination of base types. Preamble sequences may be used to identify the locations of sequencing colonies or individual templates to be sequences on a sequencing surface (e.g., for sequencing methods that occur tethered to a substrate).Table 3: Extended Barcode sequences, without tailing TSEQ ID No: Oligo Sequence 5’ SEQ ID No: 118 TGCACTCACAAT to 3’ GACGASEQ ID No: 103 TGCACTTCATCA SEQ ID No: 119 TGCACAACGATA GAGATGA TGTGA SEQ ID No: 104 TGCACAGACACA SEQ ID No: 120 TGCACATCACCA GCATTGA CGCGA SEQ ID No: 105 TGCACACGCGAT SEQ ID No: 121 TGCACTGCGAAT TCTGA CTGCTGA SEQ ID No: 106 TGCACAGCCAGT SEQ ID No: 122 TGCACATATAAT CTGCTGA GCTGAGA SEQ ID No: 107 TGCACAAGTATC SEQ ID No: 123 TGCACATGATGC AGCGA CGTCTGA SEQ ID No: 108 TGCACTAGCAGT SEQ ID No: 124 TGCACTATCGAT GTTGA TGAGA SEQ ID No: 109 TGCACGAGAGCA SEQ ID No: 125 TGCACAGCATTG GCCATGA CGCGCGA SEQ ID No: 110 TGCACAATCGCA SEQ ID No: 126 TGCACTCTATAT TGTGTGA GAAGA SEQ ID No: 111 TGCACACATCTC SEQ ID No: 127 TGCACGCATGTC GAAGA ATTATGA SEQ ID No: 112 TGCACAACAGAT SEQ ID No: 128 TGCACATGCGGA AGAGA TCATCGA SEQ ID No: 113 TGCACGCATAAT SEQ ID No: 129 TGCACACAATCA ACTGA CTAGA SEQ ID No: 114 TGCACATGTGTA SEQ ID No: 130 TGCACACAGCCA CTTGA TATGCATGA SEQ ID No: 115 TGCACTTCATGT SEQ ID No: 131 TGCACACAAGAC GAGCTGA ATGCTGA SEQ ID No: 116 TGCACATGCTCA SEQ ID No: 132 TGCACATGCTTC ACAGCGA ACTCTGA SEQ ID No: 117 TGCACGTGGACA SEQ ID No: 133 TGCACATCAGCATCAGAGTTATGA-24- 182358171.1Fox Ref: 368893.41602SEQ ID No: 134 TGCACTATATCA SEQ ID No: 158 TGCACTCGTCAT TGATTGA GCCGA SEQ ID No: 135 TGCACTGCGATG SEQ ID No: 159 TGCACTGCACCA ATTCTGA GCTGCGA SEQ ID No: 136 TGCACACATATA SEQ ID No: 160 TGCACATGGCGA TCCGA GCTATGA SEQ ID No: 137 TGCACATAGATA SEQ ID No: 161 TGCACTTCTGAT TGATTGA CTCATGA SEQ ID No: 138 TGCACTGTGCTG SEQ ID No: 162 TGCACTATCGCT GCATCATGA GCCGA SEQ ID No: 139 TGCACACTCTTC SEQ ID No: 163 TGCACATGCAAT ATGCTGA ATGAGCAGA SEQ ID No: 140 TGCACAGCATAG SEQ ID No: 164 TGCACAGATAAT GCTCTGA AGAGA SEQ ID No: 141 TGCACATGGCAT SEQ ID No: 165 TGCACTTATCAG AGCGAGA CGTGA SEQ ID No: 142 TGCACTACACCA SEQ ID No: 166 TGCACTAGGCAT CATGA CGCGA SEQ ID No: 143 TGCACAGTGATC SEQ ID No: 167 TGCACTCTAGGA CGTGA TGCATGA SEQ ID No: 144 TGCACAGAGCGA SEQ ID No: 168 TGCACTGCCTCA ATCATGA TCATGCAGA SEQ ID No: 145 TGCACATGGCAG SEQ ID No: 169 TGCACAGCATGC CTAGCATGA CTGCACTGA SEQ ID No: 146 TGCACAGCAGAT SEQ ID No: 170 TGCACATGCACT TATGCGA GCGCCATGA SEQ ID No: 147 TGCACAATGCAT SEQ ID No: 171 TGCACTCTGAGC ACAGTGA AGGCTGA SEQ ID No: 148 TGCACAGCATGC SEQ ID No: 172 TGCACATAAGCT ACCATCAGA AGCGA SEQ ID No: 149 TGCACAAGTCAG SEQ ID No: 173 TGCACAAGCACA TGTGA TGAGTGA SEQ ID No: 150 TGCACATGCAGC SEQ ID No: 174 TGCACGACTGGA ATCAAGAGA TGCGA SEQ ID No: 151 TGCACGCTGCAG SEQ ID No: 175 TGCACATGCGTG TAAGA CAAGCGA SEQ ID No: 152 TGCACTGACAGT SEQ ID No: 176 TGCACATGAGCT CAAGA GCCTAGA SEQ ID No: 153 TGCACAATCACA SEQ ID No: 177 TGCACTCTGCCT TATGCGA GCTATGA SEQ ID No: 154 TGCACATGCGTG SEQ ID No: 178 TGCACTATGTAC GCTCTGA ATTGA SEQ ID No: 155 TGCACAGCCAGC SEQ ID No: 179 TGCACACTGTTA AGATGCTGA TGCGA SEQ ID No: 156 TGCACACTAGCA SEQ ID No: 180 TGCACTGCCATA TCATTGA GTGCTGA SEQ ID No: 157 TGCACTGCATGT SEQ ID No: 181 TGCACTCAACATGAGAAGACTCATGA -25- 182358171.1Fox Ref: 368893.41602SEQ ID No: 182 TGCACATGCGCT SEQ ID No: 206 TGCACTTGCATG CGCTTGA ACATAGA SEQ ID No: 183 TGCACAGACGCT SEQ ID No: 207 TGCACATGATGC TGCATGA GCCTGATGA SEQ ID No: 184 TGCACAAGAGCT SEQ ID No: 208 TGCACATGACAT CTGCAGA GCCGTGA SEQ ID No: 185 TGCACTCTTCAG SEQ ID No: 209 TGCACATGCTCG CTGCTGA ATCAAGA SEQ ID No: 186 TGCACATATGCA SEQ ID No: 210 TGCACTCACACA ATACAGA ATGCAGA SEQ ID No: 187 TGCACTATCTTG SEQ ID No: 211 TGCACTGCCACG TATGA AGCATGA SEQ ID No: 188 TGCACTCTGTTG SEQ ID No: 212 TGCACTTACTCA CTGCTGA TGCGA SEQ ID No: 189 TGCACACTCATC SEQ ID No: 213 TGCACGCGCTCA CGTGA GCATTGA SEQ ID No: 190 TGCACTGCATGC SEQ ID No: 214 TGCACAGCGCAG ATTATGCGA ATATTGA SEQ ID No: 191 TGCACAGCGCTA SEQ ID No: 215 TGCACTGCAGAG GAAGA GCAGAGA SEQ ID No: 192 TGCACGATAGCT SEQ ID No: 216 TGCACGGCAGTG GCATTGA CATGTGA SEQ ID No: 193 TGCACGAGCTTG SEQ ID No: 217 TGCACTCATGGC CATATGA ATGAGCAGA SEQ ID No: 194 TGCACACTGTGT SEQ ID No: 218 TGCACATGAGTC CAAGA AGATTGA SEQ ID No: 195 TGCACGCATGCG SEQ ID No: 219 TGCACAAGCATC CAGTTGA TCAGTGA SEQ ID No: 196 TGCACGGACATC SEQ ID No: 220 TGCACATCATCA TGTGA AGCACATGA SEQ ID No: 197 TGCACAGACTTG SEQ ID No: 221 TGCACTTAGCGC TGAGA ATCGA SEQ ID No: 198 TGCACGATATGC SEQ ID No: 222 TGCACACAATGC ATTCTGA GCTGTGA SEQ ID No: 199 TGCACAATAGAT SEQ ID No: 223 TGCACAATATGC CTGCTGA GATCAGA SEQ ID No: 200 TGCACGATGCTC SEQ ID No: 224 TGCACTTACATG CTGATGA TGCGA SEQ ID No: 201 TGCACTGCCGAG SEQ ID No: 225 TGCACTGTGTGC CATGCGA CTGCAGA SEQ ID No: 202 TGCACTGCACTC SEQ ID No: 226 TGCACAATGCTG TGGCTGA CTCATGCGA SEQ ID No: 203 TGCACGGCATGC SEQ ID No: 227 TGCACGATCTCA TGAGCGA TCATTGA SEQ ID No: 204 TGCACAATATCT SEQ ID No: 228 TGCACAATCAGA GCTCTGA TGCTAGA SEQ ID No: 205 TGCACTGAATCA SEQ ID No: 229 TGCACAAGAGTGTGCTGATGAATAGA-26- 182358171.1Fox Ref: 368893.41602SEQ ID No: 230 TGCACTTGCGTC SEQ ID No: 254 TGCACTCAGAAT ATCATGA AGCGA SEQ ID No: 231 TGCACATGTCCG SEQ ID No: 255 TGCACGGCGTGA CACATGA TGCGA SEQ ID No: 232 TGCACACAAGCA SEQ ID No: 256 TGCACATGCTGC GCTGCGA ATGCCGTGA SEQ ID No: 233 TGCACTATTGTG SEQ ID No: 257 TGCACTATGCAT CGCATGA TCAGAGA SEQ ID No: 234 TGCACAACATGC SEQ ID No: 258 TGCACATGGTCG ATCATGTGA CGTGA SEQ ID No: 235 TGCACAACTGCA SEQ ID No: 259 TGCACACGAGGA GATGAGA TGCATGA SEQ ID No: 236 TGCACATCCTGT SEQ ID No: 260 TGCACTCGCACA CGCGA AGCGA SEQ ID No: 237 TGCACTGCAGCT SEQ ID No: 261 TGCACACAGTTG GCCATGCGA TGCGA SEQ ID No: 238 TGCACTATATTG SEQ ID No: 262 TGCACACGGCTG CTCGA CATATGA SEQ ID No: 239 TGCACAATACTG SEQ ID No: 263 TGCACTGCTGAT ATGCTGA GCCGAGA SEQ ID No: 240 TGCACATGTATG SEQ ID No: 264 TGCACAACTATA ATGAAGA GCAGA SEQ ID No: 241 TGCACTGAAGCA SEQ ID No: 265 TGCACGATATTC GACATGA TATGA SEQ ID No: 242 TGCACAATGCGA SEQ ID No: 266 TGCACGAGCAGT GCGCAGA GCCGA SEQ ID No: 243 TGCACATGACTC SEQ ID No: 267 TGCACTGTTGCG ATCAAGA CTGCTGA SEQ ID No: 244 TGCACACATCGC SEQ ID No: 268 TGCACATATGGC CATCTGA ACACTGA SEQ ID No: 245 TGCACTGCTGTG SEQ ID No: 269 TGCACAGTACCA GATATGA GATGA SEQ ID No: 246 TGCACTCGCGCT SEQ ID No: 270 TGCACGCTGCCA TGAGA TCTGTGA SEQ ID No: 247 TGCACACACTTG SEQ ID No: 271 TGCACAGCTGCA CTGCTGA TCATGAAGA SEQ ID No: 248 TGCACTTGTCTG SEQ ID No: 272 TGCACATGATAT CTCGA TCATCATGA SEQ ID No: 249 TGCACTCAGACA SEQ ID No: 273 TGCACAATACAT GCATTGA GTAGA SEQ ID No: 250 TGCACATAGTTC SEQ ID No: 274 TGCACTCAATGA ACAGA GATGCGA SEQ ID No: 251 TGCACATAACTG SEQ ID No: 275 TGCACAGTGAAT CGCGA ATGATGA SEQ ID No: 252 TGCACACTTGCG SEQ ID No: 276 TGCACAGATCAT CATGCGA GAATCATGA SEQ ID No: 253 TGCACTGCCTGA SEQ ID No: 277 TGCACATCATCACTGAGATCCTGCTGA -27- 182358171.1Fox Ref: 368893.41602SEQ ID No: 278 TGCACGCTTCGA SEQ ID No: 302 TGCACAATAGAC CATGA GCAGA SEQ ID No: 279 TGCACAGAACTG SEQ ID No: 303 TGCACATCTGGA TCTGA GCTCAGA SEQ ID No: 280 TGCACTTGCTGC SEQ ID No: 304 TGCACTTATATG ATGCACAGA AGAGA SEQ ID No: 281 TGCACATGCAGA SEQ ID No: 305 TGCACACACAAT CATGATTGA CAGATGA SEQ ID No: 282 TGCACGCTGCAT SEQ ID No: 306 TGCACATGTCTG TGACTGA CATGATTGA SEQ ID No: 283 TGCACGATTATA SEQ ID No: 307 TGCACATGTGAC TGCATGA ATGCCGA SEQ ID No: 284 TGCACTCTATTG SEQ ID No: 308 TGCACTGCATTG CTGATGA ATGACGA SEQ ID No: 285 TGCACACAGCCG SEQ ID No: 309 TGCACACAATGC TGCATGA ATGTAGA SEQ ID No: 286 TGCACTGCTCCT SEQ ID No: 310 TGCACAAGTGAG GCGCTGA TCTGA SEQ ID No: 287 TGCACGCTAGCA SEQ ID No: 311 TGCACATGTCTC CAAGA ATTCTGA SEQ ID No: 288 TGCACGGCATCG SEQ ID No: 312 TGCACAGAGCCA ATAGA CATGAGA SEQ ID No: 289 TGCACATGATGC SEQ ID No: 313 TGCACTATTGAT TCGCCGA GCATGCAGA SEQ ID No: 290 TGCACTGATATG SEQ ID No: 314 TGCACAGTGCCA ATTCAGA TGCATGTGA SEQ ID No: 291 TGCACTTCGCTC SEQ ID No: 315 TGCACAGTTGCT ACAGA CTGCTGA SEQ ID No: 292 TGCACGCTACCA SEQ ID No: 316 TGCACGGCACAG TATGA TGTGA SEQ ID No: 293 TGCACATATAGC SEQ ID No: 317 TGCACTTGCACA ATTGTGA CAGCTGA SEQ ID No: 294 TGCACTGCCGCG SEQ ID No: 318 TGCACATGCGAC CGTGA ACATTGA SEQ ID No: 295 TGCACTGAATCG SEQ ID No: 319 TGCACAGTCATG ATGCTGA CATGGCAGA SEQ ID No: 296 TGCACATGCAGC SEQ ID No: 320 TGCACTGAACAT CAGCATAGA GAGCTGA SEQ ID No: 297 TGCACATGGACA SEQ ID No: 321 TGCACAGCATAT GCATGATGA GCCATCAGA SEQ ID No: 298 TGCACGCTATGC SEQ ID No: 322 TGCACAATGTAC GCCGA ATAGA SEQ ID No: 299 TGCACGTGCACT SEQ ID No: 323 TGCACATCATGT TGCGA CATGGCTGA SEQ ID No: 300 TGCACATATGGT SEQ ID No: 324 TGCACATCATGT GATCTGA GTGCCGA SEQ ID No: 301 TGCACATGCATG SEQ ID No: 325 TGCACTTCTCTATCAGAAGCGACAGA-28- 182358171.1Fox Ref: 368893.41602SEQ ID No: 326 TGCACATGCTTA SEQ ID No: 350 TGCACAGCTGCA GCATGATGA TAGCCGA SEQ ID No: 327 TGCACGATCATC SEQ ID No: 351 TGCACTCAGCCT AGATTGA GCATAGA SEQ ID No: 328 TGCACTGTGCCT SEQ ID No: 352 TGCACACATGAT ATGCAGA ATATTGA SEQ ID No: 329 TGCACAGATGCA SEQ ID No: 353 TGCACTCTCTGA TAATGCAGA AGAGA SEQ ID No: 330 TGCACAGCCATC SEQ ID No: 354 TGCACATGGATC TCATAGA ATCAGCAGA SEQ ID No: 331 TGCACTGCATCG SEQ ID No: 355 TGCACAGTGTGC TCCGA CAGCTGA SEQ ID No: 332 TGCACAATGATG SEQ ID No: 356 TGCACATACGCT ACAGAGA TCAGA SEQ ID No: 333 TGCACTGCTAGC SEQ ID No: 357 TGCACACTGCTG TCATTGA CAAGAGA SEQ ID No: 334 TGCACGATACAT SEQ ID No: 358 TGCACACATGCT GAAGA TATCTGA SEQ ID No: 335 TGCACTGTTGCA SEQ ID No: 359 TGCACATCCGCT TCAGCATGA GACGA SEQ ID No: 336 TGCACATATCAG SEQ ID No: 360 TGCACGCTTATC GCGCAGA TCAGA SEQ ID No: 337 TGCACATGCGCA SEQ ID No: 361 TGCACATGCGCA GAAGAGA TGACCATGA SEQ ID No: 338 TGCACATGGTCA SEQ ID No: 362 TGCACATGACAT TACATGA TCTGCGA SEQ ID No: 339 TGCACACATGCA SEQ ID No: 363 TGCACATGTCCA TCTCATTGA TGCTAGA SEQ ID No: 340 TGCACATCAGAT SEQ ID No: 364 TGCACATCAGCT GAGCCATGA TCGCAGA SEQ ID No: 341 TGCACGGTGCTG SEQ ID No: 365 TGCACTATGCTC TCAGA CATCTGA SEQ ID No: 342 TGCACGCAACAG SEQ ID No: 366 TGCACATAATCA ACAGA CTCATGA SEQ ID No: 343 TGCACAGCTGCT SEQ ID No: 367 TGCACTGAGCTG CGGATGA ACCGA SEQ ID No: 344 TGCACATCTGAT SEQ ID No: 368 TGCACAAGAGAT CAAGAGA AGCATGA SEQ ID No: 345 TGCACAGTGCAG SEQ ID No: 369 TGCACAGAATGA CTCAAGA TGCGCATGA SEQ ID No: 346 TGCACGCGGTGC SEQ ID No: 370 TGCACAGTTATG ACTGA ATCGA SEQ ID No: 347 TGCACATGATGT SEQ ID No: 371 TGCACAGCCACT GAGTTGA CTGATGA SEQ ID No: 348 TGCACTGAGCTG SEQ ID No: 372 TGCACTGCCAGA AGATTGA CTGCAGA SEQ ID No: 349 TGCACGCATGTC SEQ ID No: 373 TGCACATCGCGCCACGAGCCGA-29- 182358171.1Fox Ref: 368893.41602SEQ ID No: 374 TGCACGGAGATA SEQ ID No: 398 TGCACAGCATGA TATGA GAATGATGA SEQ ID No: 375 TGCACTTCGCAG SEQ ID No: 399 TGCACACAGACG TGCGA ATTGA SEQ ID No: 376 TGCACGTCATGA SEQ ID No: 400 TGCACGTGCACA TGGCTGA GTTGA SEQ ID No: 377 TGCACGTGCATG SEQ ID No: 401 TGCACATGGTGA ATATTGA TGACAGA SEQ ID No: 378 TGCACGAGCACA SEQ ID No: 402 TGCACAGAGAGC ACTGA TGCTTGA SEQ ID No: 379 TGCACATAGTGA SEQ ID No: 403 TGCACTGTCAGC GAAGA ACCGA SEQ ID No: 380 TGCACTGAATGC SEQ ID No: 404 TGCACTGTGACT ACACAGA GCCATGA SEQ ID No: 381 TGCACGCTGCAC SEQ ID No: 405 TGCACAGATCCA CATCTGA GATGAGA SEQ ID No: 382 TGCACAATGATG SEQ ID No: 406 TGCACAGAGTGT CACATGTGA GTTGA SEQ ID No: 383 TGCACGATGCAT SEQ ID No: 407 TGCACATGCAGA TCGCTGA CAGCCGA SEQ ID No: 384 TGCACACACACT SEQ ID No: 408 TGCACACAAGTC GCCATGA ACTGA SEQ ID No: 385 TGCACTGCGCTG SEQ ID No: 409 TGCACTATGACT CGGCAGA TGCGA SEQ ID No: 386 TGCACAACACAG SEQ ID No: 410 TGCACTGCACTG TCAGA TCATTGA SEQ ID No: 387 TGCACTCTCATA SEQ ID No: 411 TGCACATCCATC AGCGA GTCATGA SEQ ID No: 388 TGCACTGATGCA SEQ ID No: 412 TGCACATCACAT TGCAACTGA ACATTGA SEQ ID No: 389 TGCACAATCGCT SEQ ID No: 413 TGCACTACCTGC ATGCAGA ATGATGA SEQ ID No: 390 TGCACATGTGGA SEQ ID No: 414 TGCACAATGAGC TGCGCGA AGATCGA SEQ ID No: 391 TGCACATCGCAT SEQ ID No: 415 TGCACAGTATTG CATGGATGA CACATGA SEQ ID No: 392 TGCACATATGAT SEQ ID No: 416 TGCACACATAAT GCACCATGA GACATGA SEQ ID No: 393 TGCACGCAACTC SEQ ID No: 417 TGCACGATGCCT AGCGA ATGCTGA SEQ ID No: 394 TGCACGCGCGGC SEQ ID No: 418 TGCACATGCAAG TATGA TGACTGA SEQ ID No: 395 TGCACTAGTGCA SEQ ID No: 419 TGCACACATGGT AGCGA GCACAGA SEQ ID No: 396 TGCACAGAGTTG SEQ ID No: 420 TGCACTTGCTCA CACATGA TCGATGA SEQ ID No: 397 TGCACTCATCAG SEQ ID No: 421 TGCACAAGCTGATGCAAGACAGAGA-30- 182358171.1Fox Ref: 368893.41602SEQ ID No: 422 TGCACTGCCACA SEQ ID No: 446 TGCACTAGGATG GCTATGA CAGATGA SEQ ID No: 423 TGCACTCAACTG SEQ ID No: 447 TGCACGCGCAAG CAGCAGA CGCATGA SEQ ID No: 424 TGCACAAGCATG SEQ ID No: 448 TGCACTCTCTTGT TATCAGA GTGA SEQ ID No: 425 TGCACTATTCAT SEQ ID No: 449 TGCACTAGCACA ATGCAGA ATGATGA SEQ ID No: 426 TGCACACAGCTC SEQ ID No: 450 TGCACAGAGCAG ATGAAGA GCACAGA SEQ ID No: 427 TGCACAATGTGA SEQ ID No: 451 TGCACAAGATGA GTGATGA TCGAGA SEQ ID No: 428 TGCACATGACCA SEQ ID No: 452 TGCACACACTGC TCTATGA CACATGA SEQ ID No: 429 TGCACTTAGCAT SEQ ID No: 453 TGCACAGCCTAT ATCGA GCAGTGA SEQ ID No: 430 TGCACTATTGCA SEQ ID No: 454 TGCACATATGTG GCATAGA GCTGCGA SEQ ID No: 431 TGCACTGCACAT SEQ ID No: 455 TGCACAGATCAG TCACAGA GCTATGA SEQ ID No: 432 TGCACATGGCTA SEQ ID No: 456 TGCACATGTCAT GCGCTGA TGCAGCTGA SEQ ID No: 433 TGCACAGATGCA SEQ ID No: 457 TGCACTGAGTGC TGCTGCCGA CTGATGA SEQ ID No: 434 TGCACATCATTC SEQ ID No: 458 TGCACTGCATCA AGATAGA ATGCTCTGA SEQ ID No: 435 TGCACTTGCATA SEQ ID No: 459 TGCACTGCTGGA CGCATGA GAGCAGA SEQ ID No: 436 TGCACATCCATG SEQ ID No: 460 TGCACTGCATCT AGACTGA CAGAAGA SEQ ID No: 437 TGCACTTATGCA SEQ ID No: 461 TGCACATGATTA GAGCTGA TCGATGA SEQ ID No: 438 TGCACATCCATG SEQ ID No: 462 TGCACAGCTCTG CTCTCGA ATTGAGA SEQ ID No: 439 TGCACAACGCTC SEQ ID No: 463 TGCACTGCATGC AGCGA CAGATATGA SEQ ID No: 440 TGCACAGACATG SEQ ID No: 464 TGCACAGCATGC GCATAGA AGCTGAAGA SEQ ID No: 441 TGCACGCTATGT SEQ ID No: 465 TGCACGCTTCAT TGCATGA CACGA SEQ ID No: 442 TGCACAGCTGAT SEQ ID No: 466 TGCACATAACGT TGCTCGA GATGA SEQ ID No: 443 TGCACTGTGTTG SEQ ID No: 467 TGCACATGCACA TGTGA TGTGATTGA SEQ ID No: 444 TGCACTACCATG SEQ ID No: 468 TGCACAGCATCA CATCTGA ACAGAGA SEQ ID No: 445 TGCACTGATCCG SEQ ID No: 469 TGCACTCAGATGCTAGACAACTGA -31- 182358171.1Fox Ref: 368893.41602SEQ ID No: 470 TGCACTGTGCAG SEQ ID No: 494 TGCACATCATGC CTGAAGA GCCAGCTGA SEQ ID No: 471 TGCACTGCAGTA SEQ ID No: 495 TGCACATGCAAT TGCTTGA GATATCTGA SEQ ID No: 472 TGCACATCGCGC SEQ ID No: 496 TGCACAGTCGCT TCATTGA GCCGA SEQ ID No: 473 TGCACAGCATCG SEQ ID No: 497 TGCACGCAATCG CATGGCAGA CTCATGA SEQ ID No: 474 TGCACAAGTCGC SEQ ID No: 498 TGCACTATGACA ATAGA TCCATGA SEQ ID No: 475 TGCACAGCATGT SEQ ID No: 499 TGCACTACAGAG TGCAGATGA GCAGA SEQ ID No: 476 TGCACAGCTCCG SEQ ID No: 500 TGCACATGAGGC CATGTGA GAGCTGA SEQ ID No: 477 TGCACGAGCGAT SEQ ID No: 501 TGCACAACGCAT TGTGA ATCGA SEQ ID No: 478 TGCACACATGAG SEQ ID No: 502 TGCACTCTCTGC CTTATGA ACCATGA SEQ ID No: 479 TGCACAGTCATG SEQ ID No: 503 TGCACACTCGCG GAGATGA GCTGA SEQ ID No: 480 TGCACATGCAGC SEQ ID No: 504 TGCACATCTGCA ATGCGCCGA CAGCATTGA SEQ ID No: 481 TGCACAGCCGCA SEQ ID No: 505 TGCACGATGCAT GCAGCGA GAAGTGA SEQ ID No: 482 TGCACGGCAGCG SEQ ID No: 506 TGCACTTGCATC TCAGA TGAGTGA SEQ ID No: 483 TGCACACAGAGC SEQ ID No: 507 TGCACATGGCAC ACCATGA GCACAGA SEQ ID No: 484 TGCACAACTCAT SEQ ID No: 508 TGCACACAGCTA GCATAGA GTTGA SEQ ID No: 485 TGCACATCAGTG SEQ ID No: 509 TGCACACTTCTA GCGCTGA TATGA SEQ ID No: 486 TGCACTGCACAT SEQ ID No: 510 TGCACTCATAAT GAATGCAGA GTCATGA SEQ ID No: 487 TGCACATGAGCT SEQ ID No: 511 TGCACTGAGATG TGTGCGA CAATAGA SEQ ID No: 488 TGCACAATGACA SEQ ID No: 512 TGCACAAGATGT GTGCTGA AGCGA SEQ ID No: 489 TGCACAAGTGTC SEQ ID No: 513 TGCACAATGCAT ATCATGA GTCACATGA SEQ ID No: 490 TGCACGATGCTG SEQ ID No: 514 TGCACAATGTCA CAATCGA CTGCAGA SEQ ID No: 491 TGCACAATGCAC SEQ ID No: 515 TGCACATGATGC ATGCTCAGA TGCACAAGA SEQ ID No: 492 TGCACGATGATG SEQ ID No: 516 TGCACACAATAG TCATTGA AGAGA SEQ ID No: 493 TGCACGATGCAC SEQ ID No: 517 TGCACTGCATGCATATTGAGACTTGA -32- 182358171.1Fox Ref: 368893.41602SEQ ID No: 518 TGCACATATCCA SEQ ID No: 542 TGCACAACAGTC CAGATGA TATGA SEQ ID No: 519 TGCACATCATTG SEQ ID No: 543 TGCACAGCATTG AGCAGATGA TGTGAGA SEQ ID No: 520 TGCACAGTGCGC SEQ ID No: 544 TGCACAATCATG GCCATGA AGTGAGA SEQ ID No: 521 TGCACATCATCT SEQ ID No: 545 TGCACTCTGCAT TAGCGA GTCTTGA SEQ ID No: 522 TGCACTTATGTC SEQ ID No: 546 TGCACTGCTGCT TGTGA CACTTGA SEQ ID No: 523 TGCACTCAATCA SEQ ID No: 547 TGCACTGATGTG GCAGCGA GATGCGA SEQ ID No: 524 TGCACACAGCAT SEQ ID No: 548 TGCACTTGCAGA GCCGTGA TCAGTGA SEQ ID No: 525 TGCACTAGCATG SEQ ID No: 549 TGCACAGCGCCA GCTCAGA TCATGCTGA SEQ ID No: 526 TGCACAATGATC SEQ ID No: 550 TGCACTGATACT AGAGTGA TCAGA SEQ ID No: 527 TGCACTCAAGCT SEQ ID No: 551 TGCACGAGGCTG CAGATGA TGCATGA SEQ ID No: 528 TGCACATGGCTG SEQ ID No: 552 TGCACAGCCATG CTGTGATGA TCGCAGA SEQ ID No: 529 TGCACTGCGCAC SEQ ID No: 553 TGCACATGTGCG TCATTGA GAGATGA SEQ ID No: 530 TGCACTACAGAT SEQ ID No: 554 TGCACATAGCCT ATTGA GCGATGA SEQ ID No: 531 TGCACATCCGCA SEQ ID No: 555 TGCACTGAGCTC TGCGAGA CATGAGA SEQ ID No: 532 TGCACTGCCGCA SEQ ID No: 556 TGCACTCGCTCT TATCAGA GCCATGA SEQ ID No: 533 TGCACAACAGCA SEQ ID No: 557 TGCACAGCATTA CACGA CACGA SEQ ID No: 534 TGCACATATCTA SEQ ID No: 558 TGCACTATTATG TCCGA ATGCTGA SEQ ID No: 535 TGCACTGTATTC SEQ ID No: 559 TGCACGATGTTG TGAGA CTGCTGA SEQ ID No: 536 TGCACAGAGCAT SEQ ID No: 560 TGCACTGAGCCA GCCAGCTGA TGTATGA SEQ ID No: 537 TGCACATATCAT SEQ ID No: 561 TGCACATGTGCA GAATGATGA ATCATATGA SEQ ID No: 538 TGCACATCCATC SEQ ID No: 562 TGCACAAGATAC TGCTGATGA TGTGA SEQ ID No: 539 TGCACATAGCAC SEQ ID No: 563 TGCACAGCGAAG CATGCGA CAGATGA SEQ ID No: 540 TGCACTCTGCGC SEQ ID No: 564 TGCACATGTAAG CAGCAGA CAGCAGA SEQ ID No: 541 TGCACAGCTCTG SEQ ID No: 565 TGCACTGTTCTGCGCAAGACAGCAGA -33- 182358171.1Fox Ref: 368893.41602SEQ ID No: 566 TGCACATGTACA SEQ ID No: 590 TGCACAGTTCAT CTTGA ATAGA SEQ ID No: 567 TGCACAGTGCAG SEQ ID No: 591 TGCACTCATGAG AGGCTGA GCACAGA SEQ ID No: 568 TGCACACTGAAC SEQ ID No: 592 TGCACGCTGCGA ATGATGA TCCAGA SEQ ID No: 569 TGCACTGCAGCA SEQ ID No: 593 TGCACGGCGCTC GTCTTGA ATAGA SEQ ID No: 570 TGCACGGAGCAT SEQ ID No: 594 TGCACAGAGAGA AGCGA GAAGA SEQ ID No: 571 TGCACAGTATCT SEQ ID No: 595 TGCACGCTGTAT GCCATGA TGCATGA SEQ ID No: 572 TGCACTGTGATG SEQ ID No: 596 TGCACTGCATTG CAAGTGA CACGAGA SEQ ID No: 573 TGCACATGCTGA SEQ ID No: 597 TGCACTCGGCTG GCATCTTGA AGCATGA SEQ ID No: 574 TGCACTGCGCAT SEQ ID No: 598 TGCACTCTGCCG TGCATGAGA CTCGA SEQ ID No: 575 TGCACGCGAGAC SEQ ID No: 599 TGCACGTCAGGC ATTGA AGCATGA SEQ ID No: 576 TGCACTATGCCA SEQ ID No: 600 TGCACGGCTGCA TCTATGA GTGCGA SEQ ID No: 577 TGCACTGCTAGA SEQ ID No: 601 TGCACAAGCGCG GTTGA TGTGA SEQ ID No: 578 TGCACAAGACAG SEQ ID No: 602 TGCACGGCACTA CGAGA CATGA SEQ ID No: 579 TGCACTGCCAGA SEQ ID No: 603 TGCACTAGCGCA TGCGCATGA GCCATGA SEQ ID No: 580 TGCACTTGTATA SEQ ID No: 604 TGCACTTCTGTG TATGA TGAGA SEQ ID No: 581 TGCACTTCAGCG SEQ ID No: 605 TGCACACAAGAT AGCGA GCATGATGA SEQ ID No: 582 TGCACAACAGAC SEQ ID No: 606 TGCACATGCTGC TCAGA ATTAGATGA SEQ ID No: 583 TGCACAAGCAGC SEQ ID No: 607 TGCACTGCATAT TACGA TATGTGA SEQ ID No: 584 TGCACATGGAGC SEQ ID No: 608 TGCACACGAGCA ATCACGA TCCGA SEQ ID No: 585 TGCACGACTGCA SEQ ID No: 609 TGCACATGATGT AGCATGA CTTGAGA SEQ ID No: 586 TGCACTATGCTG SEQ ID No: 610 TGCACAGCATGA CAAGTGA TGTGCTTGA SEQ ID No: 587 TGCACTCTTATC SEQ ID No: 611 TGCACATGCTTG AGCATGA CAGATGTGA SEQ ID No: 588 TGCACTCAAGCA SEQ ID No: 612 TGCACTATCACA TGCATGTGA TGGCTGA SEQ ID No: 589 TGCACTCAGCAT SEQ ID No: 613 TGCACTTGCGCAATATTGAGAGCTGA -34- 182358171.1Fox Ref: 368893.41602SEQ ID No: 614 TGCACAGAATCG SEQ ID No: 638 TGCACATCCAGC CAGCTGA GTCGA SEQ ID No: 615 TGCACATAAGAG SEQ ID No: 639 TGCACATGCAGC AGCGA ATTCTGTGA SEQ ID No: 616 TGCACATCAGGT SEQ ID No: 640 TGCACAGTTGAG CAGAGA CACGA SEQ ID No: 617 TGCACAATCTCT SEQ ID No: 641 TGCACACGGCAT CGCATGA CGCATGA SEQ ID No: 618 TGCACATGCATC SEQ ID No: 642 TGCACATCACAG ATATCAAGA GCTCTGA SEQ ID No: 619 TGCACACTGCCA SEQ ID No: 643 TGCACTTCATGC TGCATCTGA TGCACGA SEQ ID No: 620 TGCACTCGGCAG SEQ ID No: 644 TGCACAATGCGC CAGATGA TGTCAGA SEQ ID No: 621 TGCACTTGAGCG SEQ ID No: 645 TGCACTGCTGTG ATAGA CAAGCATGA SEQ ID No: 622 TGCACTATAGCA SEQ ID No: 646 TGCACAGATGGC GCCATGA TACATGA SEQ ID No: 623 TGCACGCGCATG SEQ ID No: 647 TGCACTGCTCAC CTGCCGA ACCATGA SEQ ID No: 624 TGCACATCATAT SEQ ID No: 648 TGCACTGTCAAC CATGCAAGA AGAGA SEQ ID No: 625 TGCACTGTAGCG SEQ ID No: 649 TGCACAGTTGCA ATTGA TCACAGA SEQ ID No: 626 TGCACTCGATTG SEQ ID No: 650 TGCACGACATTG CATATGA CTCATGA SEQ ID No: 627 TGCACAGAGCGC SEQ ID No: 651 TGCACATCTCAG TCCGA GACAGA SEQ ID No: 628 TGCACGCATCCT SEQ ID No: 652 TGCACACAATAT ATGCAGA CTGATGA SEQ ID No: 629 TGCACGCATATA SEQ ID No: 653 TGCACTATCTGA ATAGA AGCGA SEQ ID No: 630 TGCACAGAATGT SEQ ID No: 654 TGCACGGATCTG GCTATGA TGTGA SEQ ID No: 631 TGCACAGCGATC SEQ ID No: 655 TGCACTATGTTG ATTATGA CTAGA SEQ ID No: 632 TGCACTCGCACA SEQ ID No: 656 TGCACGGCATGA TAAGA GAGCTGA SEQ ID No: 633 TGCACACTGCTG SEQ ID No: 657 TGCACAGAAGAT GTGCTGA CGCGA SEQ ID No: 634 TGCACGGTGATC SEQ ID No: 658 TGCACTGAGTGC ACTGA ATTCTGA SEQ ID No: 635 TGCACATAGAGC SEQ ID No: 659 TGCACACTTGAC CTGATGA ACTGA SEQ ID No: 636 TGCACTATCATG SEQ ID No: 660 TGCACATAATGC GACATGA ATGCTGTGA SEQ ID No: 637 TGCACAATCATC SEQ ID No: 661 TGCACAGTCTTGTGACTGATATGA-35- 182358171.1Fox Ref: 368893.41602SEQ ID No: 662 TGCACGCACGCG SEQ ID No: 686 TGCACACTGATG CAAGA TGGATGA SEQ ID No: 663 TGCACATCCGAT SEQ ID No: 687 TGCACTGACGGC ACAGA AGCGA SEQ ID No: 664 TGCACTGCCTCT SEQ ID No: 688 TGCACATACGGA GATCTGA CATGA SEQ ID No: 665 TGCACGGCTGCT SEQ ID No: 689 TGCACTCTATGC ATCGA CATCAGA SEQ ID No: 666 TGCACTGTTGTC SEQ ID No: 690 TGCACTTGCTCT AGCGA AGCATGA SEQ ID No: 667 TGCACACGAGCT SEQ ID No: 691 TGCACGTCATGT TGAGA TGAGA SEQ ID No: 668 TGCACTCACTAT SEQ ID No: 692 TGCACATATGAT TGCATGA CTTCAGA SEQ ID No: 669 TGCACACTAGCT SEQ ID No: 693 TGCACGCTTACA GTTGA GCTGA SEQ ID No: 670 TGCACAGCATCA SEQ ID No: 694 TGCACAATGCAC TAAGCATGA GTAGA SEQ ID No: 671 TGCACATCGTCA SEQ ID No: 695 TGCACATGATCA AGCATGA ATGACGA SEQ ID No: 672 TGCACAGCTGGA SEQ ID No: 696 TGCACACTCGGA GCATAGA TGCATGA SEQ ID No: 673 TGCACAGATGCA SEQ ID No: 697 TGCACATGGCGC AGCGTGA TGAGTGA SEQ ID No: 674 TGCACAGTGTTG SEQ ID No: 698 TGCACATGCATG AGAGA GATCTGCGA SEQ ID No: 675 TGCACTGCTCAG SEQ ID No: 699 TGCACAATGTCG ATGCCGA TGAGA SEQ ID No: 676 TGCACGAGGCAT SEQ ID No: 700 TGCACTGCACCG GATCAGA CATCTGA SEQ ID No: 677 TGCACGCGCGCA SEQ ID No: 701 TGCACTGCAGAT ATGCTGA ACCATGA SEQ ID No: 678 TGCACATGAGCA SEQ ID No: 702 TGCACAGTCGAG CTGCCATGA GCAGA SEQ ID No: 679 TGCACTGCGCCA SEQ ID No: 703 TGCACTATGCCT TCGAGA ATGATGA SEQ ID No: 680 TGCACTTCACAT SEQ ID No: 704 TGCACTTCAGCA AGTGA TCTGAGA SEQ ID No: 681 TGCACACAGAGA SEQ ID No: 705 TGCACATATGCA AGTGA TCGCCATGA SEQ ID No: 682 TGCACTCAACGA SEQ ID No: 706 TGCACAGCACCT TCAGA GCAGAGA SEQ ID No: 683 TGCACTGCGATG SEQ ID No: 707 TGCACTTGATCA GAGATGA TATCTGA SEQ ID No: 684 TGCACATCTCAT SEQ ID No: 708 TGCACTATCAAT CTATTGA CACGA SEQ ID No: 685 TGCACACATGAT SEQ ID No: 709 TGCACACATCTGGATGCAAGAAGATTGA -36- 182358171.1Fox Ref: 368893.41602SEQ ID No: 710 TGCACTCTCAAG SEQ ID No: 734 TGCACTTGATCG CATATGA AGATGA SEQ ID No: 711 TGCACATCACAG SEQ ID No: 735 TGCACATGGTAG CTTGAGA CTCGA SEQ ID No: 712 TGCACGATGACA SEQ ID No: 736 TGCACATGTGCA AGCGA TGGATGCGA SEQ ID No: 713 TGCACGGCTCAG SEQ ID No: 737 TGCACTGCAGCT CTCGA TGTGTGA SEQ ID No: 714 TGCACACATCCA SEQ ID No: 738 TGCACATATCGC CATGCGA CATGCATGA SEQ ID No: 715 TGCACAATGAGA SEQ ID No: 739 TGCACGACCATC TGCTGCAGA ATGCAGA SEQ ID No: 716 TGCACGGCTGAT SEQ ID No: 740 TGCACATCATGC CGCATGA CAGCATCGA SEQ ID No: 717 TGCACGCTGTGC SEQ ID No: 741 TGCACTGATCAG TCATTGA CATCCATGA SEQ ID No: 718 TGCACACTCATG SEQ ID No: 742 TGCACGAGCGCT TGGCAGA GAAGA SEQ ID No: 719 TGCACTTGTGAG SEQ ID No: 743 TGCACATGCTGT ATAGA AGCAAGA SEQ ID No: 720 TGCACACTTGTA SEQ ID No: 744 TGCACTTCAGAG GATGA ATCATGA SEQ ID No: 721 TGCACAACATGA SEQ ID No: 745 TGCACACGATTG TGCGAGA CTCATGA SEQ ID No: 722 TGCACACAACTG SEQ ID No: 746 TGCACATCTATG TATGA AGGATGA SEQ ID No: 723 TGCACAATATGT SEQ ID No: 747 TGCACGCAATCA CATATGA CTGCAGA SEQ ID No: 724 TGCACAATCATA SEQ ID No: 748 TGCACAATCGAG TGCACGA CGTGA SEQ ID No: 725 TGCACATCATCT SEQ ID No: 749 TGCACTCACAGA CAACAGA TGGCTGA SEQ ID No: 726 TGCACAACATAC SEQ ID No: 750 TGCACTGTATGA AGCATGA GCCATGA SEQ ID No: 727 TGCACTCATGGA SEQ ID No: 751 TGCACACATGCA GCTCTGA GAGCCATGA SEQ ID No: 728 TGCACTCTGCAT SEQ ID No: 752 TGCACATAACAT CGGCTGA GCATGCAGA SEQ ID No: 729 TGCACAATATAC SEQ ID No: 753 TGCACTTGCTGA GCTGA CGCGA SEQ ID No: 730 TGCACGCTGCGA SEQ ID No: 754 TGCACTGACAAT AGAGA GCAGAGA SEQ ID No: 731 TGCACAGAGACA SEQ ID No: 755 TGCACGTGCTTG AGTGA CGCGA SEQ ID No: 732 TGCACTCTCATC SEQ ID No: 756 TGCACAGCTACA ATTGTGA TGGCAGA SEQ ID No: 733 TGCACTCTTGCT SEQ ID No: 757 TGCACATGCTATCGAGAGCCTGCAGA -37- 182358171.1Fox Ref: 368893.41602SEQ ID No: 758 TGCACACAATGT SEQ ID No: 782 TGCACGGTCACT GCTCTGA GATGA SEQ ID No: 759 TGCACTTGTGTC SEQ ID No: 783 TGCACATCTCAT TATGA ATTGCATGA SEQ ID No: 760 TGCACTGCACTA SEQ ID No: 784 TGCACGCATGAC ATCGA TCATTGA SEQ ID No: 761 TGCACGATGATA SEQ ID No: 785 TGCACTGATGGT TCCGA CATCAGA SEQ ID No: 762 TGCACACATAAG SEQ ID No: 786 TGCACTCTGCAT ATGCTGA TACATGA SEQ ID No: 763 TGCACTGCAGAT SEQ ID No: 787 TGCACACACATG ATGAAGA CGGCAGA SEQ ID No: 764 TGCACAGCGCGC SEQ ID No: 788 TGCACGATTGTG CACATGA ATGATGA SEQ ID No: 765 TGCACATAATGC SEQ ID No: 789 TGCACAGATGCA TGAGCATGA TCTAAGA SEQ ID No: 766 TGCACTCATCAT SEQ ID No: 790 TGCACAGCAGAT TGCGAGA CTTGAGA SEQ ID No: 767 TGCACAGAGCTA SEQ ID No: 791 TGCACTCTGCAT TGATTGA GATGATTGA SEQ ID No: 768 TGCACTTCTGCT SEQ ID No: 792 TGCACGTGCGGA AGTGA TGCGA SEQ ID No: 769 TGCACGGTGTCA SEQ ID No: 793 TGCACGCTCTCA TGTGA ATGATGA SEQ ID No: 770 TGCACTCACTGT SEQ ID No: 794 TGCACTGATCTC GAAGA ATTGTGA SEQ ID No: 771 TGCACTTCGATA SEQ ID No: 795 TGCACATGTGGC TGCATGA AGATCATGA SEQ ID No: 772 TGCACTCATCCA SEQ ID No: 796 TGCACAAGCTCA TCATAGA GATCTGA SEQ ID No: 773 TGCACATAGTGT SEQ ID No: 797 TGCACTGCTGCA TCAGA CATGATTGA SEQ ID No: 774 TGCACATGATTG SEQ ID No: 798 TGCACATGGCAT AGCTAGA GTGTCGA SEQ ID No: 775 TGCACATCATGC SEQ ID No: 799 TGCACAATGTGC GCATTATGA TGATAGA SEQ ID No: 776 TGCACATGTATG SEQ ID No: 800 TGCACATAGCAG TCCATGA CGCTTGA SEQ ID No: 777 TGCACTGCCATC SEQ ID No: 801 TGCACATCGTGC TGCATATGA ATGAAGA SEQ ID No: 778 TGCACTGACTCA SEQ ID No: 802 TGCACGGATAGC AGATGA AGTGA SEQ ID No: 779 TGCACAAGCTAT SEQ ID No: 803 TGCACTCAATGC GCTATGA ACAGTGA SEQ ID No: 780 TGCACAAGACTC SEQ ID No: 804 TGCACTCATGTC GCTGA TGCAAGA SEQ ID No: 781 TGCACTCTGCGC SEQ ID No: 805 TGCACATCGCATATTGTGACTTCTGA -38- 182358171.1Fox Ref: 368893.41602SEQ ID No: 806 TGCACATCCACT SEQ ID No: 830 TGCACGATTCTG CATGTGA ACAGA SEQ ID No: 807 TGCACTAGCATA SEQ ID No: 831 TGCACATGCTGC GCATTGA CAGCTGCGA SEQ ID No: 808 TGCACTTATCGC SEQ ID No: 832 TGCACATGCATC ACAGA ACTGGATGA SEQ ID No: 809 TGCACAGCGCCG SEQ ID No: 833 TGCACAGTGACT CGAGA GAAGA SEQ ID No: 810 TGCACAGTCACA SEQ ID No: 834 TGCACATGATAT TCCATGA GCCATGCGA SEQ ID No: 811 TGCACATACATC SEQ ID No: 835 TGCACGGCAGCA AGCTTGA TCTCAGA SEQ ID No: 812 TGCACAACATGT SEQ ID No: 836 TGCACGCACTGC CGTGA CTAGA SEQ ID No: 813 TGCACATGTCTG SEQ ID No: 837 TGCACTCGAGCT TGCTTGA GCATTGA SEQ ID No: 814 TGCACACTCATG SEQ ID No: 838 TGCACAGCTATA AGCTTGA TCATTGA SEQ ID No: 815 TGCACTCGGATG SEQ ID No: 839 TGCACTTGCGCG CGCGA TGCATGA SEQ ID No: 816 TGCACATGTATA SEQ ID No: 840 TGCACTATGAGA ATGCTGA TGATTGA SEQ ID No: 817 TGCACAGCTCCA SEQ ID No: 841 TGCACATATGTA TATGTGA TGCAAGA SEQ ID No: 818 TGCACTTATGAT SEQ ID No: 842 TGCACATGCAGA CAGCTGA CTTCTGA SEQ ID No: 819 TGCACATATGGC SEQ ID No: 843 TGCACATGTGCG ATGCAGCGA CAATGCAGA SEQ ID No: 820 TGCACAGAGAAT SEQ ID No: 844 TGCACATCTCAT CATCAGA GCAGCAAGA SEQ ID No: 821 TGCACAATGCTA SEQ ID No: 845 TGCACGTCTGCT GACATGA GCCATGA SEQ ID No: 822 TGCACAATCTGT SEQ ID No: 846 TGCACATATAAG ATCATGA TGCGA SEQ ID No: 823 TGCACAGATATG SEQ ID No: 847 TGCACTGTCAGT ATTGTGA TGCATGA SEQ ID No: 824 TGCACAGATGAC SEQ ID No: 848 TGCACTTCTATCT CATGCATGA GCGA SEQ ID No: 825 TGCACATCGCGA SEQ ID No: 849 TGCACATACTAT ATGATGA ATTGA SEQ ID No: 826 TGCACAGACTGC SEQ ID No: 850 TGCACTAGGCTG CACGA ATCATGA SEQ ID No: 827 TGCACGTCTCAT SEQ ID No: 851 TGCACAGCTCTC TGCGA CTCGA SEQ ID No: 828 TGCACAGACAAT SEQ ID No: 852 TGCACTGCGCCG ACTGA CATCAGA SEQ ID No: 829 TGCACAGCTGTC SEQ ID No: 853 TGCACTGCGATGTAAGACTCAAGA -39- 182358171.1Fox Ref: 368893.41602SEQ ID No: 854 TGCACGACCGCA SEQ ID No: 878 TGCACAGTCACG TCAGA GCTGA SEQ ID No: 855 TGCACTCAAGAG SEQ ID No: 879 TGCACAGCCGTG CTGAGA CATCAGA SEQ ID No: 856 TGCACGATATGT SEQ ID No: 880 TGCACATACACA TGCGA ATAGA SEQ ID No: 857 TGCACTCACAAC SEQ ID No: 881 TGCACTCTCGCG GATGA ATTGA SEQ ID No: 858 TGCACGATGCCA SEQ ID No: 882 TGCACTTGCAGT GCATGCTGA GCACAGA SEQ ID No: 859 TGCACTGCTCCA SEQ ID No: 883 TGCACTCTTGTG TGTATGA ACAGA SEQ ID No: 860 TGCACATCTATG SEQ ID No: 884 TGCACATGCATG CATGGCTGA CGGCTCAGA SEQ ID No: 861 TGCACTGAGAAG SEQ ID No: 885 TGCACGTGAGCG CGCGA CTTGA SEQ ID No: 862 TGCACACTGAGC SEQ ID No: 886 TGCACATCATTG CAGCAGA CAGTGCTGA SEQ ID No: 863 TGCACTGAGAGC SEQ ID No: 887 TGCACGATACAC CTCATGA CATGA SEQ ID No: 864 TGCACAACTGCG SEQ ID No: 888 TGCACGCTATTC AGTGA AGAGA SEQ ID No: 865 TGCACTCTGAGC SEQ ID No: 889 TGCACTGCATGT ATGAAGA CGGCTGA SEQ ID No: 866 TGCACTCAGTGC SEQ ID No: 890 TGCACAGAAGTG TCCATGA CGAGA SEQ ID No: 867 TGCACAGAACAG SEQ ID No: 891 TGCACTGTTGAG CATGCGA CACATGA SEQ ID No: 868 TGCACGACAGAT SEQ ID No: 892 TGCACTGATATG GCCATGA CGCAAGA SEQ ID No: 869 TGCACATATGCA SEQ ID No: 893 TGCACAGACTAG TAAGTGA CAAGA SEQ ID No: 870 TGCACTGCGCTC SEQ ID No: 894 TGCACGCAAGAG CATGTGA CATATGA SEQ ID No: 871 TGCACATGCATC SEQ ID No: 895 TGCACATCGTGA TCCTGCAGA TGGCTGA SEQ ID No: 872 TGCACTCATGAT SEQ ID No: 896 TGCACTGAGCCT CGGATGA CAGCTGA SEQ ID No: 873 TGCACGATCACA SEQ ID No: 897 TGCACACAGCGA ATCGA AGAGA SEQ ID No: 874 TGCACGCATGCG SEQ ID No: 898 TGCACTGAAGCT TGGCTGA CTCATGA SEQ ID No: 875 TGCACGGATGTC SEQ ID No: 899 TGCACACATCAT AGCATGA CAACTGA SEQ ID No: 876 TGCACTCACGGC SEQ ID No: 900 TGCACAGAATAG GCTGA TCAGA SEQ ID No: 877 TGCACTGATCTC SEQ ID No: 901 TGCACTGTCATCCTCAGATCATTGA -40- 182358171.1Fox Ref: 368893.41602SEQ ID No: 902 TGCACATCGCCA SEQ ID No: 926 TGCACTGCTGAT TGCATGCGA TAGCTGA SEQ ID No: 903 TGCACACAGCAT SEQ ID No: 927 TGCACATGCACT GCATTCAGA GAAGCGA SEQ ID No: 904 TGCACATGCGAT SEQ ID No: 928 TGCACACTGTCT TGATAGA TGCATGA SEQ ID No: 905 TGCACGAGTCAT SEQ ID No: 929 TGCACACTTATG TGCGA CGCATGA SEQ ID No: 906 TGCACTCAGATC SEQ ID No: 930 TGCACACAACAG CATCAGA CAGCTGA SEQ ID No: 907 TGCACATAATAC SEQ ID No: 931 TGCACATGCTCA ATCGA TGGTCGA SEQ ID No: 908 TGCACAAGCACT SEQ ID No: 932 TGCACATCCACA ATGCTGA TGCATATGA SEQ ID No: 909 TGCACAACTCGC SEQ ID No: 933 TGCACATGGCTC ACAGA TGCACGA SEQ ID No: 910 TGCACAACACTC SEQ ID No: 934 TGCACTTGATGC ATCGA ACTCTGA SEQ ID No: 911 TGCACATGCTAT SEQ ID No: 935 TGCACATCCTCT TACGA GCAGTGA SEQ ID No: 912 TGCACTGCATTC SEQ ID No: 936 TGCACAAGATCG AGCATGTGA ATCGA SEQ ID No: 913 TGCACATACAGC SEQ ID No: 937 TGCACTGCCATG ACCGA ATGTAGA SEQ ID No: 914 TGCACTCTGAGT SEQ ID No: 938 TGCACACTGCCT TGTGA CATCAGA SEQ ID No: 915 TGCACGCGCTCT SEQ ID No: 939 TGCACATCATAC CTTGA ATATTGA SEQ ID No: 916 TGCACGATCAGA SEQ ID No: 940 TGCACATATAGA GCCGA ATCATGA SEQ ID No: 917 TGCACATAGAAG SEQ ID No: 941 TGCACGCTTGCT ATAGA CTGCAGA SEQ ID No: 918 TGCACTCATCTC SEQ ID No: 942 TGCACAATGCTC GCCGA TCTGTGA SEQ ID No: 919 TGCACTTGACAT SEQ ID No: 943 TGCACTAGTCCA CGCATGA TGCATGA SEQ ID No: 920 TGCACAGCCTGA SEQ ID No: 944 TGCACAATCATG GATGCGA CTATAGA SEQ ID No: 921 TGCACTGTATCA SEQ ID No: 945 TGCACATGCGCA ATCGA ACATGCAGA SEQ ID No: 922 TGCACATATCTC SEQ ID No: 946 TGCACTCATATG ATGAAGA GCAGTGA SEQ ID No: 923 TGCACACATAGC SEQ ID No: 947 TGCACAGCACAT CTGCAGA TATATGA SEQ ID No: 924 TGCACTCGCTTG SEQ ID No: 948 TGCACATCTGCA CATCTGA CTGAAGA SEQ ID No: 925 TGCACATGCGGC SEQ ID No: 949 TGCACATCGCCAACAGTGAGCACTGA -41- 182358171.1Fox Ref: 368893.41602SEQ ID No: 950 TGCACAGCCTCA SEQ ID No: 974 TGCACTAGCTTG GCTGCATGA CTGCTGA SEQ ID No: 951 TGCACGCGGCAC SEQ ID No: 975 TGCACTGATGCA AGAGA ATCTGCAGA SEQ ID No: 952 TGCACAGACTGC SEQ ID No: 976 TGCACATGCATA ATTGTGA ATGATATGA SEQ ID No: 953 TGCACAATCTGC SEQ ID No: 977 TGCACAGTGCCT ATGATCAGA GACGA SEQ ID No: 954 TGCACAATGCAG SEQ ID No: 978 TGCACATAGAGC CGCTGCTGA ATTCTGA SEQ ID No: 955 TGCACAGTCATG SEQ ID No: 979 TGCACATGATCT CTTCTGA GCGAAGA SEQ ID No: 956 TGCACTCAGTGA SEQ ID No: 980 TGCACATCTGAT ATGATGA TCTGTGA SEQ ID No: 957 TGCACAGCATGA SEQ ID No: 981 TGCACATGCAAG TCAGGCTGA CTGATATGA SEQ ID No: 958 TGCACATACTCT SEQ ID No: 982 TGCACACAGCAT GCATTGA TGACTGA SEQ ID No: 959 TGCACAGCCGCG SEQ ID No: 983 TGCACAGTCAAT ATGCAGA CGAGA SEQ ID No: 960 TGCACATGGTGC SEQ ID No: 984 TGCACTGATGGC ACGATGA ATATAGA SEQ ID No: 961 TGCACTTCACTG SEQ ID No: 985 TGCACACTCGCT CTCGA GAAGA SEQ ID No: 962 TGCACAGCACAT SEQ ID No: 986 TGCACTGAAGAG CTTCTGA ATGCAGA SEQ ID No: 963 TGCACACAGTGA SEQ ID No: 987 TGCACGAGGATC ATCATGA TGCATGA SEQ ID No: 964 TGCACTGTTATC SEQ ID No: 988 TGCACAACATCT GCTGA GCTCAGA SEQ ID No: 965 TGCACTAGATGT SEQ ID No: 989 TGCACGCTGAAT GCCATGA GCATGCTGA SEQ ID No: 966 TGCACGGCTATA SEQ ID No: 990 TGCACATCTCCA TGCGA CATCAGA SEQ ID No: 967 TGCACGTGCGCA SEQ ID No: 991 TGCACATGAGAT ACTGA GATCATTGA SEQ ID No: 968 TGCACATGTGCT SEQ ID No: 992 TGCACTGCTCTG CTCAAGA GCTGAGA SEQ ID No: 969 TGCACAAGCGCA SEQ ID No: 993 TGCACATAATGT GCTCTGA GTGATGA SEQ ID No: 970 TGCACTCTATAT SEQ ID No: 994 TGCACTCATGTA TCTGA TCCGA SEQ ID No: 971 TGCACTTGAGCT SEQ ID No: 995 TGCACGCTGTGC GCGAGA GTTGA SEQ ID No: 972 TGCACACATGGC SEQ ID No: 996 TGCACGGCATCA TAGCAGA CGTGA SEQ ID No: 973 TGCACGTGAGAT SEQ ID No: 997 TGCACTGACATATGTGATGATTGA -42- 182358171.1Fox Ref: 368893.41602SEQ ID No: 998 TGCACAAGTGCA SEQ ID No: 1022 TGCACAGCACAT TATCTGA GTGCCGA SEQ ID No: 999 TGCACAGCGCAT SEQ ID No: 1023 TGCACAGCGATA TGTGAGA ACTGA SEQ ID No: 1000 TGCACGTCCAGA SEQ ID No: 1024 TGCACAGTTGTG TCAGA TGCGA SEQ ID No: 1001 TGCACATGCGGT SEQ ID No: 1025 TGCACACATGAG GCGATGA GCGCTGA SEQ ID No: 1002 TGCACAATATAT SEQ ID No: 1026 TGCACATGCGCT AGCGA ATTCTGA SEQ ID No: 1003 TGCACAAGTGCT SEQ ID No: 1027 TGCACGAGCAAT AGTGA GCGATGA SEQ ID No: 1004 TGCACTGTGAAT SEQ ID No: 1028 TGCACTGCCATG AGAGA CTCTAGA SEQ ID No: 1005 TGCACGATTGAT SEQ ID No: 1029 TGCACAAGCATG GCACAGA CGTATGA SEQ ID No: 1006 TGCACTTGTGCG SEQ ID No: 1030 TGCACAGAAGCT ACAGA CATCTGA SEQ ID No: 1007 TGCACAACTGTG SEQ ID No: 1031 TGCACTACAGCT ACTGA GCATTGA SEQ ID No: 1008 TGCACTAGCGCT SEQ ID No: 1032 TGCACATCGCAT TATGA TAGCTGA SEQ ID No: 1009 TGCACAGATATC SEQ ID No: 1033 TGCACAACATAT CTCGA CGCGA SEQ ID No: 1010 TGCACGTGGCTG SEQ ID No: 1034 TGCACGTATGGC AGCATGA ATAGA SEQ ID No: 1011 TGCACTGATGCA SEQ ID No: 1035 TGCACGATCTTG TGGTGCTGA CATGAGA SEQ ID No: 1012 TGCACACTTGCA SEQ ID No: 1036 TGCACTCTTGCG TGCGCGA ATCATGA SEQ ID No: 1013 TGCACAGCCATG SEQ ID No: 1037 TGCACTCTGTCA CGACAGA TGATTGA SEQ ID No: 1014 TGCACTCTTCTCT SEQ ID No: 1038 TGCACAGCTGTA CTGA ATATGA SEQ ID No: 1015 TGCACATGGCGT SEQ ID No: 1039 TGCACAGTGCTG ATGATGA GCTGAGA SEQ ID No: 1016 TGCACTATTCTC SEQ ID No: 1040 TGCACGCTGCCT AGCATGA CAGAGA SEQ ID No: 1017 TGCACAGTTCTA SEQ ID No: 1041 TGCACGAGATTG TGCATGA ATGCTGA SEQ ID No: 1018 TGCACAGCATCA SEQ ID No: 1042 TGCACATAATAT TGCTTGTGA ATAGA SEQ ID No: 1019 TGCACGTAATGC SEQ ID No: 1043 TGCACAGTAGAT TGTGA TGCATGA SEQ ID No: 1020 TGCACGCAATAG SEQ ID No: 1044 TGCACTCAGCAC ATCATGA CTGCTGA SEQ ID No: 1021 TGCACTTCTGCA SEQ ID No: 1045 TGCACATGTCTATGCTGCAGAAGCGA-43- 182358171.1Fox Ref: 368893.41602SEQ ID No: 1046 TGCACTGTGATG SEQ ID No: 1070 TGCACGCGCATA GCTCTGA ATGATGA SEQ ID No: 1047 TGCACGGTAGCA SEQ ID No: 1071 TGCACACACGCA TGCGA TAAGA SEQ ID No: 1048 TGCACTGCATGC SEQ ID No: 1072 TGCACAGATGGT GTTGAGA GCATGCAGA SEQ ID No: 1049 TGCACTCATGCT SEQ ID No: 1073 TGCACGCACATG GTCAAGA GATCTGA SEQ ID No: 1050 TGCACACGGTGC SEQ ID No: 1074 TGCACATGCAAC TGTGA GCAGTGA SEQ ID No: 1051 TGCACAAGCATG SEQ ID No: 1075 TGCACAGCAGGA CATGAGAGA GATCAGA SEQ ID No: 1052 TGCACACAGAAG SEQ ID No: 1076 TGCACACATCAG TCTGA GTGATGA SEQ ID No: 1053 TGCACTTAGATG SEQ ID No: 1077 TGCACGCTCAAT ACAGA GAGCAGA SEQ ID No: 1054 TGCACATACAAC SEQ ID No: 1078 TGCACTGTGCAG TGTGA TCCGA SEQ ID No: 1055 TGCACTTGAGAG SEQ ID No: 1079 TGCACTGATGCG AGTGA CAGAAGA SEQ ID No: 1056 TGCACATCTACT SEQ ID No: 1080 TGCACAATATGC TGCATGA ATGTCGA SEQ ID No: 1057 TGCACTTGCATG SEQ ID No: 1081 TGCACAGATGAG CTACAGA TGGAGA SEQ ID No: 1058 TGCACTCAGCAG SEQ ID No: 1082 TGCACATGGAGA CGGCAGA TGCATGTGA SEQ ID No: 1059 TGCACTGTACAT SEQ ID No: 1083 TGCACATCATTC TGTGA GATGTGA SEQ ID No: 1060 TGCACTTGTGCA SEQ ID No: 1084 TGCACGCTCGGC TACGA AGCGA SEQ ID No: 1061 TGCACAACGTGA SEQ ID No: 1085 TGCACGCTAGCT GCAGA TGAGA SEQ ID No: 1062 TGCACACATGCA SEQ ID No: 1086 TGCACACGCAAT CGGCAGA CTAGA SEQ ID No: 1063 TGCACAAGCGTG SEQ ID No: 1087 TGCACACGCAAC TGCATGA TGTGA SEQ ID No: 1064 TGCACATGCACT SEQ ID No: 1088 TGCACACGCACA TATGAGA ATCATGA SEQ ID No: 1065 TGCACGCGACAT SEQ ID No: 1089 TGCACGCATCTG TGCATGA CAATGCTGA SEQ ID No: 1066 TGCACGGATGAT SEQ ID No: 1090 TGCACGCTCAGA GCTGAGA TGATTGA SEQ ID No: 1067 TGCACTGATGAG SEQ ID No: 1091 TGCACGCATATG CAATCGA CATGGATGA SEQ ID No: 1068 TGCACACGCTAC SEQ ID No: 1092 TGCACGCATGCA ATTGA TGGCATAGA SEQ ID No: 1069 TGCACGCAATGC SEQ ID No: 1093 TGCACGCATCCATGATCATGAGCACTGA -44- 182358171.1Fox Ref: 368893.41602SEQ ID No: 1094 TGCACGGAGCTC SEQ ID No: 1118 TGCACTGAGACA ACAGA TGCTTGA SEQ ID No: 1095 TGCACGCTCTGC SEQ ID No: 1119 TGCACGCATCTG ATTCAGA GCGATGA SEQ ID No: 1096 TGCACATAGCAG SEQ ID No: 1120 TGCACAGCATGC AGGATGA AGTCCGA SEQ ID No: 1097 TGCACTGCAGGC SEQ ID No: 1121 TGCACGGATGCA GCATGATGA GTGATGA SEQ ID No: 1098 TGCACGCATATC SEQ ID No: 1122 TGCACGATTGCA TGGCTGA GCGCAGA SEQ ID No: 1099 TGCACTGCTGTG SEQ ID No: 1123 TGCACGTGAGGT CATCCGA GCAGA SEQ ID No: 1100 TGCACATGGCAG SEQ ID No: 1124 TGCACGCACAAG TCATAGA CATGAGA SEQ ID No: 1101 TGCACTGCATGA SEQ ID No: 1125 TGCACATCAGGC ATGCTGTGA GCATGCAGA SEQ ID No: 1102 TGCACGCGCATG SEQ ID No: 1126 TGCACAGCATTC TCCATGA TGTGCATGA SEQ ID No: 1103 TGCACGCACACA SEQ ID No: 1127 TGCACTAGCGGT TCCATGA GCAGA SEQ ID No: 1104 TGCACTGCAGGA SEQ ID No: 1128 TGCACGCATGAT GTGATGA TAGATGA SEQ ID No: 1105 TGCACGCGTGGC SEQ ID No: 1129 TGCACGCATGCA AGAGA ATGTGCAGA SEQ ID No: 1106 TGCACGCATGGC SEQ ID No: 1130 TGCACGCAGCAC ATCACATGA ATTGCGA SEQ ID No: 1107 TGCACTAGCAAT SEQ ID No: 1131 TGCACGCAGCAC GATGAGA CTGATGA SEQ ID No: 1108 TGCACTGCATTA SEQ ID No: 1132 TGCACGCAGCCT GCATGCAGA GCGCTGA SEQ ID No: 1109 TGCACTATGCAG SEQ ID No: 1133 TGCACGCATGGA TCATTGA GCTGCGA SEQ ID No: 1110 TGCACACTGCAG SEQ ID No: 1134 TGCACGCGGATG TCATTGA CTGATGA SEQ ID No: 1111 TGCACATCAGTG SEQ ID No: 1135 TGCACGTGCGCA CAATCGA TGGATGA SEQ ID No: 1112 TGCACGCAAGCT SEQ ID No: 1136 TGCACGGTGCAT GAGAGA GCAGAGA SEQ ID No: 1113 TGCACGGCGAGA SEQ ID No: 1137 TGCACGCACTTG TGAGA ATGATGA SEQ ID No: 1114 TGCACATGCAGT SEQ ID No: 1138 TGCACTTCTCAC TGATGCAGA GCAGA SEQ ID No: 1115 TGCACAGATGAG SEQ ID No: 1139 TGCACGCAATGA ACATTGA GCGATGA SEQ ID No: 1116 TGCACGCTTGAT SEQ ID No: 1140 TGCACATCATGA GATCAGA ATGATGTGA SEQ ID No: 1117 TGCACGGCGCAT SEQ ID No: 1141 TGCACGCAGCACGCAGTGAAGATTGA -45- 182358171.1Fox Ref: 368893.41602SEQ ID No: 1142 TGCACGTGGATG SEQ ID No: 1150 TGCACACGGATC AGCGA ATGCAGA SEQ ID No: 1143 TGCACGCTTGCA SEQ ID No: 1151 TGCACGGCTCGT GCATGCAGA GCAGA SEQ ID No: 1144 TGCACGCAGATC SEQ ID No: 1152 TGCACACGCATG ATTCTGA GAGATGA SEQ ID No: 1145 TGCACGCAGAAT SEQ ID No: 1153 TGCACACACGCG CTGCGA GATGA SEQ ID No: 1146 TGCACGCAGATC SEQ ID No: 1154 TGCACATCGAAT CAGCAGA GTGCAGA SEQ ID No: 1147 TGCACATGGATG SEQ ID No: 1155 TGCACACGCAGA AGATGCTGA CAAGA SEQ ID No: 1148 TGCACGCAGTGC SEQ ID No: 1156 TGCACACACATG TGCAAGA GATGAGA SEQ ID No: 1149 TGCACGCAGTGA SEQ ID No: 1157 TGCACATGATTCGCCATGAATGTGCAGA

[0078] In some cases, a sequence in Table 3 may further comprise a 3’T. In some cases, the 3’T may be phosphorothioated, e.g, TGCACATGATTCATGTGCAGA*T (SEQ ID No: 1158), where the * indicates phosphorothioation. In some cases, a sequence in Table 3 may further comprise a 3' DNA nucleotide that is phosphorothioated (e.g., a phosphorothioated A, a phosphorothioated C, or a phosphorothioated G). In some cases, a sequence in Table 3 may further comprise a 3’ RNA nucleotide that is phosphorothioated (e.g, a phosphorothioated rA, a phosphorothioated rC, a phosphorothioated rT, or a phosphorothioated G). In some cases, a sequence in Table 3 may further comprise one or more 3’ DNA nucleotides that are phosphorothioated (e.g., T*C*T*).

[0079] In some cases, a sequence in Table 3 may be modified to remove the first 4 nucleotides, e.g., the 5’ nucleotides TGCA. In some cases, a sequence in Table 3 may be modified to remove the first 4 nucleotides, TGCA, and replace them with a single nucleotide, 2 nucleotides, 3 nucleotides, 4 nucleotides, or 5 nucleotides. For example, such that SEQ ID No: 1146 TGCACACGGATCATGCAGA from Table 3 may be modified to TCACGGATCATGC AGA (SEQ ID No: 1159) or to TTCACGGATCATGCAGA (SEQ ID No: 1160).

[0080] In some cases, a sequence in Table 3 may further comprise, at the 5’ end, a common adapter sequence, SEQ ID No: 97, ATCTCATCCCTGCGTGTCTCCGAC. For example, ATCTCATCCCTGCGTGTCTCCGACTGCACATGATTCATGTGCAGA*T (SEQ ID No: 1161) is one strand of a complete adapter sequence, combining in 5’ to 3’ order the common adapter sequence SEQ ID No: 97, SEQ ID No: 1157 from Table 3, and a 3’ phosphorothioated T.-46- 182358171.1

[0081] Adapter sequences4: Barcode to barcode from Table 3 SEQ ID No: Adapter Sequence 5’ SEQ ID No: 1184 TCGCGCGCAATGC to 3’ TGTGCASEQ ID No: 1162 TCATCTCTGATGA SEQ ID No: 1185 TCTTCATATAGAG AGTGCA TGCA SEQ ID No: 1163 TCAATGCTGTGTC SEQ ID No: 1186 TCATAATGACATG TGTGCA CGTGCA SEQ ID No: 1164 TCAGAATCGCGTG SEQ ID No: 1187 TCGATGATCCGCA TGCA TGTGCA SEQ ID No: 1165 TCAGCAGACTGGC SEQ ID No: 1188 TCTAGTGATTGTG TGTGCA TGCA SEQ ID No: 1166 TCGCTGATACTTG SEQ ID No: 1189 TCATGCATATGGC TGCA TGTGTGCA SEQ ID No: 1167 TCAACACTGCTAG SEQ ID No: 1190 TCAGCATGTCTTG TGCA TGTGCA SEQ ID No: 1168 TCATGGCTGCTCT SEQ ID No: 1191 TCAGAGTGAAGCA CGTGCA TGTGCA SEQ ID No: 1169 TCACACATGCGAT SEQ ID No: 1192 TCATAACTGCTGA TGTGCA TGTGCA SEQ ID No: 1170 TCTTCGAGATGTG SEQ ID No: 1193 TCAATCATGATAT TGCA AGTGCA SEQ ID No: 1171 TCTCTATCTGTTGT SEQ ID No: 1194 TCAGAATCATCGC GCA AGTGCA SEQ ID No: 1172 TCAGTATTATGCG SEQ ID No: 1195 TCGGATATATGTG TGCA TGCA SEQ ID No: 1173 TCAAGTACACATG SEQ ID No: 1196 TCAATCATATCTA TGCA TGTGCA SEQ ID No: 1174 TCAGCTCACATGA SEQ ID No: 1197 TCATGATGCCAGC AGTGCA ACAGTGCA SEQ ID No: 1175 TCGCTGTTGAGCA SEQ ID No: 1198 TCAGCATGAAGAG TGTGCA TGTGCA SEQ ID No: 1176 TCTGATGTCCACG SEQ ID No: 1199 TCAGAGCCTATGC TGCA TGTGCA SEQ ID No: 1177 TCGTCATTGTGAG SEQ ID No: 1200 TCTCGCTATGCCA TGCA TGTGCA SEQ ID No: 1178 TCACATATCGTTG SEQ ID No: 1201 TCATGTGGTGTAG TGCA TGCA SEQ ID No: 1179 TCGCGTGGTGATG SEQ ID No: 1202 TCACGGATCACTG TGCA TGCA SEQ ID No: 1180 TCAGCAGATTCGC SEQ ID No: 1203 TCATGATTCGCTCT AGTGCA GTGCA SEQ ID No: 1181 TCTCAGCATTATA SEQ ID No: 1204 TCATGCTAGCTGC TGTGCA CATGTGCA SEQ ID No: 1182 TCAGACGGCATCA SEQ ID No: 1205 TCGCATAATCTGC TGTGCA TGTGCA SEQ ID No: 1183 TCTCAATCGATAG SEQ ID No: 1206 TCACTGTATGCATTGCATGTGCA-47- 182358171.1SEQ ID No: 1207 TCTGATGGTGCAT SEQ ID No: 1231 TCGCTAGCTTATG GCTGTGCA TGCA SEQ ID No: 1208 TCACACTGACTTG SEQ ID No: 1232 TCACTCATGTGCTT TGCA GTGCA SEQ ID No: 1209 TCTCTTGATGCTGC SEQ ID No: 1233 TCGCATCCAGTCG ATGTGCA TGCA SEQ ID No: 1210 TCTTACTGCAGCG SEQ ID No: 1234 TCGCTTGCACGCA TGCA TGTGCA SEQ ID No: 1211 TCTTGACTGTCAG SEQ ID No: 1235 TCTAGGCAGCTCA TGCA TGTGCA SEQ ID No: 1212 TCGCATATGTGAT SEQ ID No: 1236 TCATAGCAGGCAG TGTGCA AGTGCA SEQ ID No: 1213 TCAGAGCCACGCA SEQ ID No: 1237 TCAATGTACATAG TGTGCA TGCA SEQ ID No: 1214 TCAGCATCTGCTG SEQ ID No: 1238 TCGCATAACAGTG GCTGTGCA TGCA SEQ ID No: 1215 TCAATGATGCTAG SEQ ID No: 1239 TCAGCACTATGGC TGTGCA AGTGCA SEQ ID No: 1216 TCTTCTCACATGC SEQ ID No: 1240 TCATGAGATGTTG AGTGCA AGTGCA SEQ ID No: 1217 TCGGCATGACGAG SEQ ID No: 1241 TCAAGCGAGCGCA TGCA TGTGCA SEQ ID No: 1218 TCGCAGCTGGTGC SEQ ID No: 1242 TCATGCAAGCGTC AGTGCA TGTGCA SEQ ID No: 1219 TCATAGCTCGCCA SEQ ID No: 1243 TCTGCAGAGCTCT TGTGCA TGTGCA SEQ ID No: 1220 TCATGAGATCAGA SEQ ID No: 1244 TCAGCAGCTGAAG AGTGCA AGTGCA SEQ ID No: 1221 TCGGCAGCGATAG SEQ ID No: 1245 TCTGTATTGCATAT TGCA GTGCA SEQ ID No: 1222 TCTGCTCATATTGC SEQ ID No: 1246 TCATACAAGATAG ATGTGCA TGCA SEQ ID No: 1223 TCTCTATTATCTGT SEQ ID No: 1247 TCAGCAGCAACAG GCA AGTGCA SEQ ID No: 1224 TCACGCTGATAAG SEQ ID No: 1248 TCACGGATGAGTG TGCA TGCA SEQ ID No: 1225 TCGCGATGCCTAG SEQ ID No: 1249 TCGCATAATGCAT TGCA GCAGTGCA SEQ ID No: 1226 TCATGCATCCTAG SEQ ID No: 1250 TCTTCTAGCGCTGT AGTGCA GCA SEQ ID No: 1227 TCTGCATGATGAG SEQ ID No: 1251 TCAATGCAGCTAT GCAGTGCA CGTGCA SEQ ID No: 1228 TCAGTGCAGGCAT SEQ ID No: 1252 TCATATGCAAGCT GCTGTGCA CGTGCA SEQ ID No: 1229 TCATGGCGCAGTG SEQ ID No: 1253 TCTTGACACAGTG CATGTGCA TGCA SEQ ID No: 1230 TCAGCCTGCTCAG SEQ ID No: 1254 TCAACTGCGCATGAGTGCACGTGCA182358171.1SEQ ID No: 1255 TCACAGATGTCCG SEQ ID No: 1279 TCATGTGCTTGAT TGCA GATGTGCA SEQ ID No: 1256 TCTCACAAGTCTG SEQ ID No: 1280 TCGATGCGCTAAG TGCA TGCA SEQ ID No: 1257 TCAGAATGCATAT SEQ ID No: 1281 TCACAGCGCATTG CGTGCA TGTGCA SEQ ID No: 1258 TCAGCAGATCTAT SEQ ID No: 1282 TCTGATCGCATAT TGTGCA TGTGCA SEQ ID No: 1259 TCATCAGGAGCAT SEQ ID No: 1283 TCGCACATGTAAG CGTGCA TGCA SEQ ID No: 1260 TCGCATGCTCGGC SEQ ID No: 1284 TCTGCAGGCACAC AGTGCA AGTGCA SEQ ID No: 1261 TCAGCCAGAGTGC SEQ ID No: 1285 TCGCATGAGCAGC AGTGCA ATTGTGCA SEQ ID No: 1262 TCGCTCAGCATGC SEQ ID No: 1286 TCAATGATGAGAT CGTGCA CGTGCA SEQ ID No: 1263 TCAGAGCAGATAT SEQ ID No: 1287 TCTAGCATCTGAT TGTGCA TGTGCA SEQ ID No: 1264 TCATCAGCATGAT SEQ ID No: 1288 TCTATCACTCTTGT TCAGTGCA GCA SEQ ID No: 1265 TCTATGTCATGCA SEQ ID No: 1289 TCATGATGACGCA AGTGCA AGTGCA SEQ ID No: 1266 TCATCAGGCGCAT SEQ ID No: 1290 TCATGTGCGGACA CATGTGCA TGTGCA SEQ ID No: 1267 TCACGGCATGTCA SEQ ID No: 1291 TCGCAGCTGCTTG TGTGCA TGTGCA SEQ ID No: 1268 TCTTGATCGAGCA SEQ ID No: 1292 TCATGCGCACAAT TGTGCA AGTGCA SEQ ID No: 1269 TCTGCATTGTGTG SEQ ID No: 1293 TCACATGATGCAT AGTGCA GTTGTGCA SEQ ID No: 1270 TCATGCTCGTGGC SEQ ID No: 1294 TCTCATCTGCAGTT AGTGCA GTGCA SEQ ID No: 1271 TCGCATGAGTAAG SEQ ID No: 1295 TCGCGACAGGATG TGCA TGCA SEQ ID No: 1272 TCAATGCTGAGCG SEQ ID No: 1296 TCGCATGGCAGCT CGTGCA GCAGTGCA SEQ ID No: 1273 TCAATATCTGCGC SEQ ID No: 1297 TCGAGCAATATAG TGTGCA TGCA SEQ ID No: 1274 TCTCTGCCTCTGCA SEQ ID No: 1298 TCAGCATCAGTAT GTGCA TGTGCA SEQ ID No: 1275 TCACATGCACTGC SEQ ID No: 1299 TCTTCATCATACAT CGTGCA GTGCA SEQ ID No: 1276 TCTGCTCATGCCA SEQ ID No: 1300 TCATGTCTGCTTCA TGAGTGCA GTGCA SEQ ID No: 1277 TCAATCTGACTCA SEQ ID No: 1301 TCTGCGCTCGCAT TGTGCA TGTGCA SEQ ID No: 1278 TCACTGAGATGCT SEQ ID No: 1302 TCTTGATGAGTCATGTGCATGTGCA182358171.1SEQ ID No: 1303 TCAGATGGCGATG SEQ ID No: 1327 TCAGTGTGCCATA TGTGCA TGTGCA SEQ ID No: 1304 TCATATCCACAGC SEQ ID No: 1328 TCATCTGGTACTG AGTGCA TGCA SEQ ID No: 1305 TCTCAAGCGCGAG SEQ ID No: 1329 TCACAGATGGCAG TGCA CGTGCA SEQ ID No: 1306 TCAGCAGCAAGTG SEQ ID No: 1330 TCTTCATGATGCA TGTGCA GCTGTGCA SEQ ID No: 1307 TCGAGCAGACAAG SEQ ID No: 1331 TCATGATGAATAT TGCA CATGTGCA SEQ ID No: 1308 TCAATGCTGTCTG SEQ ID No: 1332 TCTACATGTATTGT AGTGCA GCA SEQ ID No: 1309 TCTGTGAACTATG SEQ ID No: 1333 TCGCATCTCATTG TGCA AGTGCA SEQ ID No: 1310 TCGCGCAGTTATG SEQ ID No: 1334 TCATCATATTCACT TGCA GTGCA SEQ ID No: 1311 TCGCATGCGCAAG SEQ ID No: 1335 TCATGATTCATGA TGTGCA TCTGTGCA SEQ ID No: 1312 TCTCAGTCAGGCA SEQ ID No: 1336 TCAGCAGGATGAT GTGCA GATGTGCA SEQ ID No: 1313 TCGCTATTCTGAG SEQ ID No: 1337 TCATGTCGAAGCG TGCA TGCA SEQ ID No: 1314 TCGCATCACGCCG SEQ ID No: 1338 TCAGACAGTTCTG TGCA TGCA SEQ ID No: 1315 TCACGGCATGCAG SEQ ID No: 1339 TCTGTGCATGCAG CATGTGCA CAAGTGCA SEQ ID No: 1316 TCTCTGAATGCAT SEQ ID No: 1340 TCAATCATGTCTG AGTGCA CATGTGCA SEQ ID No: 1317 TCACGCGACCATG SEQ ID No: 1341 TCAGTCAATGCAG TGCA CGTGCA SEQ ID No: 1318 TCATGCATCCTCG SEQ ID No: 1342 TCATGCATATAAT TGTGCA CGTGCA SEQ ID No: 1319 TCGCTTGTGCGAG SEQ ID No: 1343 TCATCAGCAATAG TGCA AGTGCA SEQ ID No: 1320 TCGCACAACTGTG SEQ ID No: 1344 TCATGCACGGCTG TGCA TGTGCA SEQ ID No: 1321 TCATATGCAGCCG SEQ ID No: 1345 TCAGCGCAGGAGC TGTGCA AGTGCA SEQ ID No: 1322 TCTCGGCATCAGC SEQ ID No: 1346 TCTTGTGCTAGCG AGTGCA TGCA SEQ ID No: 1323 TCTGCTATAGTTGT SEQ ID No: 1347 TCTATCGATGCCG GCA TGCA SEQ ID No: 1324 TCATAGAATATCG SEQ ID No: 1348 TCGGCGAGCATCA TGCA TGTGCA SEQ ID No: 1325 TCGGCACTGCTCG SEQ ID No: 1349 TCTGAATCATATC TGCA AGTGCA SEQ ID No: 1326 TCAGCAGCGCAAC SEQ ID No: 1350 TCTGTGAGCGAAGAGTGCATGCA182358171.1SEQ ID No: 1351 TCATATGGTAGCG SEQ ID No: 1375 TCACACTGTGCCG TGCA TGCA SEQ ID No: 1352 TCACAATGCTATA SEQ ID No: 1376 TCAGCTGTGTGCA TGTGCA AGTGCA SEQ ID No: 1353 TCACGCGCGGCAG SEQ ID No: 1377 TCAATGTGTCGCA TGCA TGTGCA SEQ ID No: 1354 TCAGCATCGATTC SEQ ID No: 1378 TCTGCCATGCATG AGTGCA ACTGTGCA SEQ ID No: 1355 TCTATGCTGGCTG SEQ ID No: 1379 TCAGCTCATGTTC CATGTGCA AGTGCA SEQ ID No: 1356 TCATCATGCTGTC SEQ ID No: 1380 TCTGATGGCATAT CATGTGCA GCTGTGCA SEQ ID No: 1357 TCGGCGCATAGCG SEQ ID No: 1381 TCTATGTACATTGT TGCA GCA SEQ ID No: 1358 TCGCAAGTGCACG SEQ ID No: 1382 TCAGCCATGACAT TGCA GATGTGCA SEQ ID No: 1359 TCAGATCACCATA SEQ ID No: 1383 TCGGCACAGATGA TGTGCA TGTGCA SEQ ID No: 1360 TCGCTTCTGCATG SEQ ID No: 1384 TCTGATAGAGAAG CATGTGCA TGCA SEQ ID No: 1361 TCTGCGTCTATTGT SEQ ID No: 1385 TCATCATGCTAAG GCA CATGTGCA SEQ ID No: 1362 TCTGAGCTCCAGA SEQ ID No: 1386 TCAATCTGATGAT TGTGCA CGTGCA SEQ ID No: 1363 TCTCTCATATAAG SEQ ID No: 1387 TCTGCATAGGCAC TGCA AGTGCA SEQ ID No: 1364 TCATCTGATTGTGT SEQ ID No: 1388 TCTGCATTATGCA GTGCA TCTGTGCA SEQ ID No: 1365 TCAATCATGCAGA SEQ ID No: 1389 TCTATGAGATGGC CATGTGCA TGTGCA SEQ ID No: 1366 TCGGCATGTCACA SEQ ID No: 1390 TCGGACGATGCAG TGTGCA TGCA SEQ ID No: 1367 TCGTCATCAATGC SEQ ID No: 1391 TCTCTGTCATCATT AGTGCA GTGCA SEQ ID No: 1368 TCTACATGCATTG SEQ ID No: 1392 TCAATGAGCTAGC TGTGCA AGTGCA SEQ ID No: 1369 TCAGACTCACTTG SEQ ID No: 1393 TCTTCATGTATCGT TGCA GCA SEQ ID No: 1370 TCAGAATGAGACA SEQ ID No: 1394 TCATGCTGATGCA TGTGCA ACAGTGCA SEQ ID No: 1371 TCTCATGTGGCTCT SEQ ID No: 1395 TCTGCGCCTGATA GTGCA TGTGCA SEQ ID No: 1372 TCTGCATGCATCA SEQ ID No: 1396 TCTCTTCTGCGCAT ATAGTGCA GTGCA SEQ ID No: 1373 TCACATGCATGGC SEQ ID No: 1397 TCATGTATGACCA ACTGTGCA TGTGCA SEQ ID No: 1374 TCAGCAGAGCAAC SEQ ID No: 1398 TCAATGAGATGCATGTGCATGTGTGCA182358171.1SEQ ID No: 1399 TCATGGCTCATCT SEQ ID No: 1423 TCTGCGAAGCTGA GATGTGCA TGTGCA SEQ ID No: 1400 TCTGACAGCACCG SEQ ID No: 1424 TCAGATGGAGCAT TGCA AGTGCA SEQ ID No: 1401 TCTGTCTGTTGCGT SEQ ID No: 1425 TCATGAGTGATTA GCA TGTGCA SEQ ID No: 1402 TCATCCGAGCAGC SEQ ID No: 1426 TCGGTCAGCTCAG TGTGCA TGCA SEQ ID No: 1403 TCTCTTGATCAGA SEQ ID No: 1427 TCATGCTATCTCTT TGTGCA GTGCA SEQ ID No: 1404 TCTTGAGCTGCAC SEQ ID No: 1428 TCATGCGCATCAT TGTGCA TCTGTGCA SEQ ID No: 1405 TCAGTGCACCGCG SEQ ID No: 1429 TCGATCATAACTG TGCA TGCA SEQ ID No: 1406 TCAACTCACATCA SEQ ID No: 1430 TCATCAGAGTGGC TGTGCA TGTGCA SEQ ID No: 1407 TCAATCTCAGCTC SEQ ID No: 1431 TCTGCAGTCTGGC AGTGCA AGTGCA SEQ ID No: 1408 TCGTGGACATGCG SEQ ID No: 1432 TCGGCGCGCGATG TGCA TGCA SEQ ID No: 1409 TCGGCTATGCAGC SEQ ID No: 1433 TCATATATCTCCGT TGTGCA GCA SEQ ID No: 1410 TCTATGCAGGCTG SEQ ID No: 1434 TCGCACTGCGAAG AGTGCA TGCA SEQ ID No: 1411 TCAATATATCATG SEQ ID No: 1435 TCAGCCATCATGA TGTGCA CGTGCA SEQ ID No: 1412 TCTCTTCAGAGAG SEQ ID No: 1436 TCAATATCATGCA TGCA CGTGCA SEQ ID No: 1413 TCTGCTGATGATC SEQ ID No: 1437 TCAGTTGTGCTCG CATGTGCA TGCA SEQ ID No: 1414 TCAGCTGGCACAC SEQ ID No: 1438 TCTTCTCACTATGT TGTGCA GCA SEQ ID No: 1415 TCTGAAGCGTATG SEQ ID No: 1439 TCTGTGTGCATTC TGCA AGTGCA SEQ ID No: 1416 TCTCTTGCAGCAG SEQ ID No: 1440 TCAGATGGTGCAG TGTGCA CGTGCA SEQ ID No: 1417 TCAGATAAGCATG SEQ ID No: 1441 TCACATGTGCATC TGTGCA ATTGTGCA SEQ ID No: 1418 TCGTCAGCGGATG SEQ ID No: 1442 TCAGCGAATGCAT TGCA CGTGCA SEQ ID No: 1419 TCTGAGATAAGCG SEQ ID No: 1443 TCATGGCAGTGTG TGCA TGTGCA SEQ ID No: 1420 TCATGGTCATGCG SEQ ID No: 1444 TCTGCCGCAGCGC CATGTGCA AGTGCA SEQ ID No: 1421 TCGCAGAATGTCA SEQ ID No: 1445 TCTGACTGTGTTGT TGTGCA GCA SEQ ID No: 1422 TCTAGCATGGACA SEQ ID No: 1446 TCGCTTATGAGAGTGTGCATGCA182358171.1SEQ ID No: 1447 TCAGTTGCATGCA SEQ ID No: 1471 TCAATGTATGTGA TCAGTGCA TGTGCA SEQ ID No: 1448 TCTGCATAGCGAT SEQ ID No: 1472 TCATCATGCAGGT TGTGCA AGTGCA SEQ ID No: 1449 TCGCGCATCCACA SEQ ID No: 1473 TCGATCTGCTCATT TGTGCA GTGCA SEQ ID No: 1450 TCATCCATGATGC SEQ ID No: 1474 TCATGTGCAATAC GATGTGCA TGTGCA SEQ ID No: 1451 TCATGGTGCATCA SEQ ID No: 1475 TCATGTCATTATGT TATGTGCA GTGCA SEQ ID No: 1452 TCGCTGAGTTGCG SEQ ID No: 1476 TCAGCATAGGCAT TGCA CGTGCA SEQ ID No: 1453 TCATAGCCGCGCG SEQ ID No: 1477 TCAGTCACTTGCA TGCA TGTGCA SEQ ID No: 1454 TCGCTTGCACTAG SEQ ID No: 1478 TCTGTGCACCATG TGCA TGTGCA SEQ ID No: 1455 TCATGTGCAACTC SEQ ID No: 1479 TCATCGATGAGCA TGTGCA AGTGCA SEQ ID No: 1456 TCTTGCACTGATG SEQ ID No: 1480 TCTCTGTCAGCTTG AGTGCA TGCA SEQ ID No: 1457 TCATCATTCTCATG SEQ ID No: 1481 TCATAGCTGTGGC CTGTGCA AGTGCA SEQ ID No: 1458 TCAATCGTCTGTG SEQ ID No: 1482 TCTGCTGCAGTTG TGCA AGTGCA SEQ ID No: 1459 TCAACTGTGCACG SEQ ID No: 1483 TCTGATACATGCT TGCA TGTGCA SEQ ID No: 1460 TCTGTCATCACCA SEQ ID No: 1484 TCTGCATATGAAT TGTGCA AGTGCA SEQ ID No: 1461 TCAAGCAGCTCTC SEQ ID No: 1485 TCTTCATGAGCTG TGTGCA TGTGCA SEQ ID No: 1462 TCGGTGCTGACAG SEQ ID No: 1486 TCATCACTCACAT TGCA TGTGCA SEQ ID No: 1463 TCATGGCAGTCAC SEQ ID No: 1487 TCATAGATGGTCA AGTGCA TGTGCA SEQ ID No: 1464 TCTCATCTGGATCT SEQ ID No: 1488 TCGATATGCTAAG GTGCA TGCA SEQ ID No: 1465 TCAACACACTCTG SEQ ID No: 1489 TCTATGCTGCAAT TGCA AGTGCA SEQ ID No: 1466 TCGGCTGTCTGCA SEQ ID No: 1490 TCTGTGAATGTGC TGTGCA AGTGCA SEQ ID No: 1467 TCAGTGACTTGTG SEQ ID No: 1491 TCAGCGCTAGCCA TGCA TGTGCA SEQ ID No: 1468 TCGCAAGTCATAG SEQ ID No: 1492 TCGGCAGCATGCA TGCA TCTGTGCA SEQ ID No: 1469 TCAATGACAGTGC SEQ ID No: 1493 TCTATCTGAATGA AGTGCA TGTGCA SEQ ID No: 1470 TCATGACGATGGA SEQ ID No: 1494 TCATGCGTATGCATGTGCAAGTGCA182358171.1SEQ ID No: 1495 TCAGTCTCATGGA SEQ ID No: 1519 TCTTCTGAGATGC TGTGCA AGTGCA SEQ ID No: 1496 TCAGCTCTGCATA SEQ ID No: 1520 TCATCGATAATCA AGTGCA TGTGCA SEQ ID No: 1497 TCGAGAGCATGGA SEQ ID No: 1521 TCTCAATCAGAGC TGTGCA TGTGCA SEQ ID No: 1498 TCGCTGAGCGTTG SEQ ID No: 1522 TCATATCTGGCAT TGCA GCAGTGCA SEQ ID No: 1499 TCTATGCCATGTCT SEQ ID No: 1523 TCTTCAGCTGCAT GTGCA GCTGTGCA SEQ ID No: 1500 TCATGCAACATAG SEQ ID No: 1524 TCGTGATGAAGCGCGTGCA TGCA SEQ ID No: 1501 TCGAGCAATCAGC SEQ ID No: 1525 TCATCACGTTATG TGTGCA TGCA SEQ ID No: 1502 TCACACAACACAG SEQ ID No: 1526 TCAATCACATGTG TGCA CATGTGCA SEQ ID No: 1503 TCAGATGCATGGT SEQ ID No: 1527 TCTCTGTTGATGCT AGTGCA GTGCA SEQ ID No: 1504 TCTAGCGGATCAG SEQ ID No: 1528 TCAGTTGCATCTG TGCA AGTGCA SEQ ID No: 1505 TCATCTGCATCCT SEQ ID No: 1529 TCTTCAGCTGCAC AGTGCA AGTGCA SEQ ID No: 1506 TCATGCGCTTGCG SEQ ID No: 1530 TCAAGCATACTGC C GTGCA AGTGCA SEQ ID No: 1507 TCACACAAGAGAG SEQ ID No: 1531 TCAATGAGCGCGA TGCA TGTGCA SEQ ID No: 1508 TCATCATTGTGCT SEQ ID No: 1532 TCTGCCATGCGAT AGTGCA GCTGTGCA SEQ ID No: 1509 TCTGTGCCTGCTCT SEQ ID No: 1533 TCTATGCGACTTG GTGCA TGCA SEQ ID No: 1510 TCTCGATCATCTTG SEQ ID No: 1534 TCATCTGCAACAT TGCA GCTGTGCA SEQ ID No: 1511 TCATGTGGCAGTG SEQ ID No: 1535 TCACATGCGGAGC TGTGCA TGTGCA SEQ ID No: 1512 TCACTGCATAGGC SEQ ID No: 1536 TCACAATCGCTCG TGTGCA TGCA SEQ ID No: 1513 TCGCAGCCACATA SEQ ID No: 1537 TCATAAGCTCATG TGTGCA TGTGCA SEQ ID No: 1514 TCATAGCCTGATC SEQ ID No: 1538 TCATCTCCATGAC TGTGCA TGTGCA SEQ ID No: 1515 TCAGCTGCAATGA SEQ ID No: 1539 TCGGCGCATGCTG CATGTGCA CATGTGCA SEQ ID No: 1516 TCATCAGGCACTC SEQ ID No: 1540 TCGCTGCTGCGGC AGTGCA TGTGCA SEQ ID No: 1517 TCAGAGCATTGAT SEQ ID No: 1541 TCTGACGCTGCCG GCAGTGCA TGCA SEQ ID No: 1518 TCTGCTCTCCAGC SEQ ID No: 1542 TCATGGTGCTCTGAGTGCATGTGCA182358171.1SEQ ID No: 1543 TCTATGCATGAGT SEQ ID No: 1567 TCAACTAGCTGTG TGTGCA TGCA SEQ ID No: 1544 TCAGCGCCACTGA SEQ ID No: 1568 TCATATAGAAGTG TGTGCA TGCA SEQ ID No: 1545 TCTGCATTCATGT SEQ ID No: 1569 TCATGACATTATG GCAGTGCA AGTGCA SEQ ID No: 1546 TCGCACAAGCTCA SEQ ID No: 1570 TCTATTGCATCTCA TGTGCA GTGCA SEQ ID No: 1547 TCAGCACTGTCAT SEQ ID No: 1571 TCGCTACATCTTGT TGTGCA GCA SEQ ID No: 1548 TCATGATGACACT SEQ ID No: 1572 TCATGTGACATGC TGTGCA ATTGTGCA SEQ ID No: 1549 TCGATTGCAGCAT SEQ ID No: 1573 TCTGCAGTGACAT CGTGCA TGTGCA SEQ ID No: 1550 TCTGAGCATGTGC SEQ ID No: 1574 TCTTGTGCAGCAT ATTGTGCA CATGTGCA SEQ ID No: 1551 TCAATGACATCAT SEQ ID No: 1575 TCTCTCTATTGTGT CGTGCA GCA SEQ ID No: 1552 TCAATATGTGCAT SEQ ID No: 1576 TCAAGTCGCATGC CGTGCA AGTGCA SEQ ID No: 1553 TCAGCTGGCGCAT SEQ ID No: 1577 TCATCTGTGGATA GATGTGCA TGTGCA SEQ ID No: 1554 TCAGATATCATTG SEQ ID No: 1578 TCATCTGCTCAAT CATGTGCA GATGTGCA SEQ ID No: 1555 TCGGCAGCGACTG SEQ ID No: 1579 TCATGGCGCGCAC TGCA TGTGCA SEQ ID No: 1556 TCATGAGCGATTG SEQ ID No: 1580 TCGCTAAGATGAT CGTGCA GTGCA SEQ ID No: 1557 TCATGGATGTCAT SEQ ID No: 1581 TCACAGACATAAG AGTGCA TGCA SEQ ID No: 1558 TCTGCCTCTGTAGT SEQ ID No: 1582 TCGCTGCTGATTG GCA AGTGCA SEQ ID No: 1559 TCAGCTCGCCTCA SEQ ID No: 1583 TCACGGCATGCTG TGTGCA TGTGCA SEQ ID No: 1560 TCGATATGCGTTG SEQ ID No: 1584 TCTGAGCCATGCT TGCA AGTGCA SEQ ID No: 1561 TCATGGTGCAGAG SEQ ID No: 1585 TCACTCTGATCATT AGTGCA GTGCA SEQ ID No: 1562 TCAGCCGCGAGTG SEQ ID No: 1586 TCATCTGAGCTTG TGCA AGTGCA SEQ ID No: 1563 TCAATGCTGTGCA SEQ ID No: 1587 TCATCACAGCAGC GATGTGCA CATGTGCA SEQ ID No: 1564 TCACTTCATGCAT SEQ ID No: 1588 TCAATGAGTGCGC CGTGCA AGTGCA SEQ ID No: 1565 TCACTCAGATGCA SEQ ID No: 1589 TCAATATCTGTAG AGTGCA TGCA SEQ ID No: 1566 TCTGTGCGTGCCA SEQ ID No: 1590 TCTCGCATGCGGATGTGCATGTGCA182358171.1SEQ ID No: 1591 TCTGATATGCGGC SEQ ID No: 1615 TCATGGCAGAGCG AGTGCA AGTGCA SEQ ID No: 1592 TCGTGTGCTGTTGT SEQ ID No: 1616 TCGTGTAATGCTG GCA TGCA SEQ ID No: 1593 TCGGATAGATATG SEQ ID No: 1617 TCAGCATCATAAT TGCA AGTGCA SEQ ID No: 1594 TCTCAGAATACAG SEQ ID No: 1618 TCAGCAGCAACAT TGCA CGTGCA SEQ ID No: 1595 TCAGCTGGCATGC SEQ ID No: 1619 TCATACATGGCTC TCTGTGCA AGTGCA SEQ ID No: 1596 TCATCATTCATGA SEQ ID No: 1620 TCATATGATTGCA TATGTGCA CATGTGCA SEQ ID No: 1597 TCATCAGCAGATG SEQ ID No: 1621 TCACAGTATCTTG GATGTGCA TGCA SEQ ID No: 1598 TCGCATGGTGCTA SEQ ID No: 1622 TCATCTGCTTCGCT TGTGCA GTGCA SEQ ID No: 1599 TCTGCTGGCGCAG SEQ ID No: 1623 TCTGCTGCTTACAT AGTGCA GTGCA SEQ ID No: 1600 TCTTGCGCAGAGC SEQ ID No: 1624 TCTGCTGCAGAAC TGTGCA AGTGCA SEQ ID No: 1601 TCATAGACTGTTG SEQ ID No: 1625 TCAAGTGTACATG TGCA TGCA SEQ ID No: 1602 TCTCACACAATGC SEQ ID No: 1626 TCAGCCTCTGCAC TGTGCA TGTGCA SEQ ID No: 1603 TCTCACTCATGATT SEQ ID No: 1627 TCATCATGTTCAG GTGCA TGTGCA SEQ ID No: 1604 TCAAGACATGCAG SEQ ID No: 1628 TCAAGACTGCTGC AGTGCA AGTGCA SEQ ID No: 1605 TCAAGTGAGCAGC SEQ ID No: 1629 TCGCTATGCTCCG AGTGCA TGCA SEQ ID No: 1606 TCGCATCCACATC SEQ ID No: 1630 TCATGGCAGATAC AGTGCA TGTGCA SEQ ID No: 1607 TCACTGATCTGCA SEQ ID No: 1631 TCACTTGCATCAC AGTGCA AGTGCA SEQ ID No: 1608 TCAGCATGATGGC SEQ ID No: 1632 TCAAGATGCTCAG GCTGTGCA CATGTGCA SEQ ID No: 1609 TCTGAAGTATCAG SEQ ID No: 1633 TCTCATGCAATGC TGCA GCAGTGCA SEQ ID No: 1610 TCATGCACAGCCT SEQ ID No: 1634 TCAATGTCTCGCG CGTGCA TGCA SEQ ID No: 1611 TCTGCGACATGGC SEQ ID No: 1635 TCATAGATGGCAT TGTGCA AGTGCA SEQ ID No: 1612 TCATCTCCGCACA SEQ ID No: 1636 TCAACTCTAGCAG TGTGCA TGCA SEQ ID No: 1613 TCATCGCAGGCTA SEQ ID No: 1637 TCTCGCTGTCTTGT TGTGCA GCA SEQ ID No: 1614 TCTCATGGAGCTC SEQ ID No: 1638 TCATGCGCATCTGAGTGCAGCAGTGCA182358171.1SEQ ID No: 1639 TCATATATACAAG SEQ ID No: 1663 TCTCACACAGAAG TGCA TGCA SEQ ID No: 1640 TCGCTCGCTGAAG SEQ ID No: 1664 TCATCATGCATCTT TGCA GTGTGCA SEQ ID No: 1641 TCTGAGTCTGTTGT SEQ ID No: 1665 TCATCTAATGCAG GCA CATGTGCA SEQ ID No: 1642 TCGTAGCTGCTTG SEQ ID No: 1666 TCACATAATATGC TGCA AGTGCA SEQ ID No: 1643 TCGTGATGCTCCA SEQ ID No: 1667 TCGGATGCTCGTG TGTGCA TGCA SEQ ID No: 1644 TCATGCTTGCAGT SEQ ID No: 1668 TCTCAAGACATCA CGTGCA TGTGCA SEQ ID No: 1645 TCACTTGCAGCAT SEQ ID No: 1669 TCAAGCACATCAT AGTGCA GCTGTGCA SEQ ID No: 1646 TCATGCTGATAAG SEQ ID No: 1670 TCACATCTGCAAG AGTGCA CATGTGCA SEQ ID No: 1647 TCACATGCATGCT SEQ ID No: 1671 TCAGCCATGTGAT TGAGTGCA AGTGCA SEQ ID No: 1648 TCAATATATGCTG SEQ ID No: 1672 TCAGCTCTGCGCA AGTGCA AGTGCA SEQ ID No: 1649 TCTATATGAACTG SEQ ID No: 1673 TCAGCTGCGATTC TGCA TGTGCA SEQ ID No: 1650 TCTGTGCCTCATG SEQ ID No: 1674 TCGCTCTCTTATGT AGTGCA GCA SEQ ID No: 1651 TCTGGATCGCAGC SEQ ID No: 1675 TCTCTGACCTGAT GTGCA GTGCA SEQ ID No: 1652 TCTATGAGCGCCG SEQ ID No: 1676 TCATGCGAGAGAT TGCA TGTGCA SEQ ID No: 1653 TCTTCTCTCTCTGT SEQ ID No: 1677 TCTTGATATGATG GCA CATGTGCA SEQ ID No: 1654 TCATGCAATACAG SEQ ID No: 1678 TCAGATGCATGGC CGTGCA AGTGTGCA SEQ ID No: 1655 TCTCGTGCAATGC SEQ ID No: 1679 TCATCTGCTGCCG AGTGCA AGTGCA SEQ ID No: 1656 TCATGCTCAGCCG SEQ ID No: 1680 TCTATCGCTCAAG AGTGCA TGCA SEQ ID No: 1657 TCGAGCGGCAGAG SEQ ID No: 1681 TCATGGCTGCTAT TGCA AGTGCA SEQ ID No: 1658 TCATGCTGCCTGA SEQ ID No: 1682 TCGGCAGCATGCG CGTGCA CGTGCA SEQ ID No: 1659 TCGCACTGCAGCC SEQ ID No: 1683 TCTTGCATGATAT GTGCA GATGTGCA SEQ ID No: 1660 TCACACGCGCTTG SEQ ID No: 1684 TCAATCGCTACAG TGCA TGCA SEQ ID No: 1661 TCATGTAGTGCCG SEQ ID No: 1685 TCATATGCAATCG TGCA AGTGCA SEQ ID No: 1662 TCATGGCTGCGCT SEQ ID No: 1686 TCGGAGCGCTCTGAGTGCATGCA182358171.1SEQ ID No: 1687 TCTGCATAGGATG SEQ ID No: 1711 TCATCAGATATTG CGTGCA TGTGCA SEQ ID No: 1688 TCTATTATATGCGT SEQ ID No: 1712 TCGCTTCAGATAG GCA TGCA SEQ ID No: 1689 TCATAGCACATTC SEQ ID No: 1713 TCACACAGATCCG TGTGCA TGCA SEQ ID No: 1690 TCATAATGATCGC SEQ ID No: 1714 TCTAGCAACATAG TGTGCA TGCA SEQ ID No: 1691 TCTTATGTGCGAG SEQ ID No: 1715 TCAGCTCTCATGC TGCA CGTGCA SEQ ID No: 1692 TCAGCACCAGCAG SEQ ID No: 1716 TCGCGATCTTCTGT TGTGCA GCA SEQ ID No: 1693 TCAGTGATCACCG SEQ ID No: 1717 TCAGAATGCACTC TGCA AGTGCA SEQ ID No: 1694 TCATCAGGCTCTA SEQ ID No: 1718 TCAGTGTCAAGTG TGTGCA TGCA SEQ ID No: 1695 TCATGTCCATGAT SEQ ID No: 1719 TCACAGCATGCAT AGTGCA TATGTGCA SEQ ID No: 1696 TCAGTCAGATGAT SEQ ID No: 1720 TCATACAAGACTG TGTGCA TGCA SEQ ID No: 1697 TCGACGCTGGATG SEQ ID No: 1721 TCTTGCGCGTGCG TGCA TGCA SEQ ID No: 1698 TCACAGAATGCTG SEQ ID No: 1722 TCTGTATCGGATG CATGTGCA TGCA SEQ ID No: 1699 TCGTGCTCAACTG SEQ ID No: 1723 TCAGATCAGAGGC TGCA AGTGCA SEQ ID No: 1700 TCATGCGATGCCG SEQ ID No: 1724 TCGATAGCAGCCG TGTGCA TGCA SEQ ID No: 1701 TCAGAGCCTGTGA SEQ ID No: 1725 TCGCTGACAACAG TGTGCA TGCA SEQ ID No: 1702 TCGTGCAGCATGA SEQ ID No: 1726 TCTCAAGCTCGTG AGTGCA TGCA SEQ ID No: 1703 TCTGACAGCGCAT SEQ ID No: 1727 TCATGCAATAGTG TGTGCA AGTGCA SEQ ID No: 1704 TCATGCTTGCACA SEQ ID No: 1728 TCAACAGCTAGTG GCAGTGCA TGCA SEQ ID No: 1705 TCATGTAGCCATC SEQ ID No: 1729 TCATGCTTATGAT TGTGCA GCTGTGCA SEQ ID No: 1706 TCATGGTGTGAGC SEQ ID No: 1730 TCATGCTTGACGA AGTGCA TGTGCA SEQ ID No: 1707 TCTCTGTTGACAG SEQ ID No: 1731 TCTATGCTCCAGC TGCA TGTGCA SEQ ID No: 1708 TCTGTGATGCAAC SEQ ID No: 1732 TCACGCTTGCATC TGTGCA TGTGCA SEQ ID No: 1709 TCATGAGCAATGT SEQ ID No: 1733 TCTCTCAACACTG CGTGCA TGCA SEQ ID No: 1710 TCTGTCCTGAGAT SEQ ID No: 1734 TCGGCATCTGAGCGTGCAAGTGCA182358171.1SEQ ID No: 1735 TCTGATCATGCCT SEQ ID No: 1759 TCAGATGCGGTGC CGTGCA AGTGCA SEQ ID No: 1736 TCAGCATTGCGCG SEQ ID No: 1760 TCATGGTATCTGC CGTGCA AGTGCA SEQ ID No: 1737 TCATGGCAGTGCT SEQ ID No: 1761 TCTGCCTCGACTG CATGTGCA TGCA SEQ ID No: 1738 TCTCGATGGCGCA SEQ ID No: 1762 TCATCATAGGCAT GTGCA AGTGCA SEQ ID No: 1739 TCACTATGTGAAG SEQ ID No: 1763 TCTCAGATGCTGA TGCA AGTGCA SEQ ID No: 1740 TCACTTCTCTGTGT SEQ ID No: 1764 TCATGGCGATGCA GCA TATGTGCA SEQ ID No: 1741 TCTGATCGTTGAG SEQ ID No: 1765 TCTCTGCAGGTGC TGCA TGTGCA SEQ ID No: 1742 TCATCTCCATCGC SEQ ID No: 1766 TCAGATATGATCA AGTGCA AGTGCA SEQ ID No: 1743 TCAATAGATGAGA SEQ ID No: 1767 TCGTGATTGATAG TGTGCA TGCA SEQ ID No: 1744 TCTTGCATCATCAT SEQ ID No: 1768 TCAATCTCAGATG GTGTGCA TGTGCA SEQ ID No: 1745 TCATCCACATCAG SEQ ID No: 1769 TCATATGCTTGAG TGTGCA AGTGCA SEQ ID No: 1746 TCGCTGCCGTCAG SEQ ID No: 1770 TCTCAAGCTGTGA TGCA TGTGCA SEQ ID No: 1747 TCATGTCCGTATG SEQ ID No: 1771 TCGCTTGTCATCGT TGCA GCA SEQ ID No: 1748 TCTGATGGCATAG SEQ ID No: 1772 TCGAGCTGAGCCG AGTGCA TGCA SEQ ID No: 1749 TCATGCTAGAGCA SEQ ID No: 1773 TCGCATGTGGATG AGTGCA TGTGCA SEQ ID No: 1750 TCTCAACATGACG SEQ ID No: 1774 TCTGCAGCATCTC TGCA ATTGTGCA SEQ ID No: 1751 TCTGAAGATCATA SEQ ID No: 1775 TCATGCGATCAGC TGTGCA CGTGCA SEQ ID No: 1752 TCAGCTGTAAGCG SEQ ID No: 1776 TCAATGAGCACAG TGCA CGTGCA SEQ ID No: 1753 TCTACGTGCATTG SEQ ID No: 1777 TCTGCCACATGAG TGCA TGTGCA SEQ ID No: 1754 TCGTCATTGATCA SEQ ID No: 1778 TCTATCTCACAAG TGTGCA TGCA SEQ ID No: 1755 TCATGCATCCGAG SEQ ID No: 1779 TCATCTACAAGTG TGTGCA TGCA SEQ ID No: 1756 TCACTCAGCGCCA SEQ ID No: 1780 TCTCGCATCATGTT TGTGCA GTGCA SEQ ID No: 1757 TCGCAGATCCATG SEQ ID No: 1781 TCATACAGTTGTG CATGTGCA TGCA SEQ ID No: 1758 TCTCACGACATTG SEQ ID No: 1782 TCATATGACATATTGCATGTGCA182358171.1SEQ ID No: 1783 TCGTGCATATGAT SEQ ID No: 1807 TCACGCTCGATTG TGTGCA TGCA SEQ ID No: 1784 TCTGTTGAGATGA SEQ ID No: 1808 TCAGCCATCTGTG TGTGCA AGTGCA SEQ ID No: 1785 TCATGCTGTATGTT SEQ ID No: 1809 TCATGGCTCATAC GTGCA AGTGCA SEQ ID No: 1786 TCAGAGCTCCATG SEQ ID No: 1810 TCATGGCTCTGCA AGTGCA TGTGTGCA SEQ ID No: 1787 TCAGCCGATGCAG SEQ ID No: 1811 TCTGCATGCATGT AGTGCA TATGTGCA SEQ ID No: 1788 TCAGCGTATATTG SEQ ID No: 1812 TCGCGTCAGCAAG TGCA TGCA SEQ ID No: 1789 TCTCTTCGCAGCG SEQ ID No: 1813 TCTCTGCATTGTCA TGCA GTGCA SEQ ID No: 1790 TCACTTGTCTCTGT SEQ ID No: 1814 TCGCGCAAGCACG GCA TGCA SEQ ID No: 1791 TCACAATGATGAG SEQ ID No: 1815 TCTGCCATGTAGC AGTGCA TGTGCA SEQ ID No: 1792 TCTCGAGCAAGAG SEQ ID No: 1816 TCTGCAGGCATAG TGCA CATGTGCA SEQ ID No: 1793 TCATCTCGATCAA SEQ ID No: 1817 TCAGAGCACATTG GTGCA TGTGCA SEQ ID No: 1794 TCGAGCTACCATG SEQ ID No: 1818 TCATAGACACAAG TGCA TGCA SEQ ID No: 1795 TCGCATCCATGCA SEQ ID No: 1819 TCGATTAGTGCAG CATGTGCA TGCA SEQ ID No: 1796 TCACACAAGCTGC SEQ ID No: 1820 TCGGATATCATCG AGTGCA TGCA SEQ ID No: 1797 TCATGCATGGCGA SEQ ID No: 1821 TCAGCATCTTATG TATGTGCA TGTGCA SEQ ID No: 1798 TCTGCATGATGGT SEQ ID No: 1822 TCTTCATATCTGCA C GTGCA GTGCA SEQ ID No: 1799 TCGATGCTGGCAT SEQ ID No: 1823 TCATGTGGCGCGC GATGTGCA TGTGCA SEQ ID No: 1800 TCATGGATGCTGA SEQ ID No: 1824 TCATGCTCAGCAT TCAGTGCA TATGTGCA SEQ ID No: 1801 TCTTCAGCGCTCG SEQ ID No: 1825 TCTCGCAATGATG TGCA AGTGCA SEQ ID No: 1802 TCTTGCTACAGCA SEQ ID No: 1826 TCAATCATAGCTC TGTGCA TGTGCA SEQ ID No: 1803 TCATGATCTCTGA SEQ ID No: 1827 TCACTAGCAGAAG AGTGCA TGCA SEQ ID No: 1804 TCATGAGCAATCG SEQ ID No: 1828 TCACATGACACCG TGTGCA TGCA SEQ ID No: 1805 TCATCCTCATAGA SEQ ID No: 1829 TCTTCACAGTGAG TGTGCA TGCA SEQ ID No: 1806 TCTGCAGTGATTG SEQ ID No: 1830 TCATGCATATCGACGTGCAAGTGCA182358171.1SEQ ID No: 1831 TCTATGATGGATG SEQ ID No: 1855 TCAGATCTGAGCT AGTGCA TGTGCA SEQ ID No: 1832 TCTGAACACTATG SEQ ID No: 1856 TCAATCATGTGCA TGCA GCAGTGCA SEQ ID No: 1833 TCTAGCTCAATCA SEQ ID No: 1857 TCGACACATGCCA TGTGCA TGTGCA SEQ ID No: 1834 TCATAATGCGCAT SEQ ID No: 1858 TCTATCAGCACAT GATGTGCA TGTGCA SEQ ID No: 1835 TCATGGACATACA SEQ ID No: 1859 TCAAGCGCTGCTA TGTGCA TGTGCA SEQ ID No: 1836 TCATATGCAGATG SEQ ID No: 1860 TCTTCATGCACGA GCAGTGCA TGTGCA SEQ ID No: 1837 TCATCTTGAGTCA SEQ ID No: 1861 TCACTGCTATCCG GTGCA TGCA SEQ ID No: 1838 TCATAGCATAGCT SEQ ID No: 1862 TCACTGTGCATTG TGTGCA AGTGCA SEQ ID No: 1839 TCAGCGAGTCTTG SEQ ID No: 1863 TCTTGCAGACATG TGCA AGTGCA SEQ ID No: 1840 TCACAATGCGCAG SEQ ID No: 1864 TCAGAAGATGCGA AGTGCA TGTGCA SEQ ID No: 1841 TCATCAGTGACCG SEQ ID No: 1865 TCACATGAGTGGA TGCA TGTGCA SEQ ID No: 1842 TCATGCAATATGA SEQ ID No: 1866 TCAATGCTATGCT GATGTGCA AGTGCA SEQ ID No: 1843 TCAATGAGTCATG SEQ ID No: 1867 TCTGTGCGATAAGTGCA TGCA SEQ ID No: 1844 TCTGATGACCATC SEQ ID No: 1868 TCTCGCGGCGCTG AGTGCA TGCA SEQ ID No: 1845 TCATGTAATGCAG SEQ ID No: 1869 TCATGGATGTGAC AGTGCA TGTGCA SEQ ID No: 1846 TCTGCCGCATGTG SEQ ID No: 1870 TCAAGCTGATGTA TGTGCA TGTGCA SEQ ID No: 1847 TCATCATCACAAT SEQ ID No: 1871 TCACGACATGTTGTGCA TGCA SEQ ID No: 1848 TCTTAGATGCATC SEQ ID No: 1872 TCAAGCACAGACA TGTGCA TGTGCA SEQ ID No: 1849 TCTCAAGATCTGC SEQ ID No: 1873 TCAAGCTCATGAG TGTGCA TGTGCA SEQ ID No: 1850 TCAATCATCATGC SEQ ID No: 1874 TCGCGCATCCGAG AGAGTGCA TGCA SEQ ID No: 1851 TCGCATCCGCACG SEQ ID No: 1875 TCAGCATTATACA TGCA TGTGCA SEQ ID No: 1852 TCATCATTGAGAG SEQ ID No: 1876 TCACATATGGAGC CGTGCA TGTGCA SEQ ID No: 1853 TCACAATGAGATC SEQ ID No: 1877 TCAGCTGATCATA AGTGCA AGTGCA SEQ ID No: 1854 TCATGATCTGCCA SEQ ID No: 1878 TCGCTGCATGCCACATGTGCATATGTGCA182358171.1SEQ ID No: 1879 TCTGATGATTCTCT SEQ ID No: 1903 TCTTGCTGCATGA GTGCA GATGTGCA SEQ ID No: 1880 TCATGTCTAGCAT SEQ ID No: 1904 TCATGGCAGCAGA TGTGCA CGTGCA SEQ ID No: 1881 TCATGATACAGAT SEQ ID No: 1905 TCGCACTTATATG TGTGCA TGCA SEQ ID No: 1882 TCACAATCATATC SEQ ID No: 1906 TCATGCAACTGAC TGTGCA AGTGCA SEQ ID No: 1883 TCATGCATGGTCA SEQ ID No: 1907 TCGCAGATAGAAG TCTGTGCA TGCA SEQ ID No: 1884 TCATCATTCGCGA SEQ ID No: 1908 TCAATATAGTATG TGTGCA TGCA SEQ ID No: 1885 TCGTGGCAGTCTG SEQ ID No: 1909 TCATGATCAGCCT TGCA AGTGCA SEQ ID No: 1886 TCGCAATGAGACG SEQ ID No: 1910 TCGAGGAGAGCTG TGCA TGCA SEQ ID No: 1887 TCAGTATTGTCTGT SEQ ID No: 1911 TCTGATGCGGCGC GCA AGTGCA SEQ ID No: 1888 TCTTAGACAGCTG SEQ ID No: 1912 TCTTGAGCATCGC TGCA AGTGCA SEQ ID No: 1889 TCTGTCAGAATCG SEQ ID No: 1913 TCTGATGCGGTCG TGCA TGCA SEQ ID No: 1890 TCGCAGCTGGCAG SEQ ID No: 1914 TCTCAGCTCTTGA CATGTGCA GTGCA SEQ ID No: 1891 TCATCCAGTGATG SEQ ID No: 1915 TCGCAACATATCG CATGTGCA TGCA SEQ ID No: 1892 TCTTCAGTCACTGT SEQ ID No: 1916 TCATCGTTGTGAG GCA TGCA SEQ ID No: 1893 TCGCATGGCATAT SEQ ID No: 1917 TCAGCATGCTGGC CATGTGCA ATCGTGCA SEQ ID No: 1894 TCTGAGATGCTGC SEQ ID No: 1918 TCATACATGGAGC C GTGCA AGTGCA SEQ ID No: 1895 TCTAGGCAGTGCG SEQ ID No: 1919 TCAGCCATGCATA TGCA GATGTGCA SEQ ID No: 1896 TCAATGCAGCTCG SEQ ID No: 1920 TCGCGCTTCTCAG AGTGCA TGCA SEQ ID No: 1897 TCAATGATATAGC SEQ ID No: 1921 TCTGCTGGCTCAG TGTGCA TGTGCA SEQ ID No: 1898 TCATGCACGCGCA SEQ ID No: 1922 TCATGAGGCTCTC AGTGCA AGTGCA SEQ ID No: 1899 TCAATCATCTCAT SEQ ID No: 1923 TCACTCGCAGTTG AGTGCA TGCA SEQ ID No: 1900 TCTTGCATACATA SEQ ID No: 1924 TCTTCATGCTCAG TGTGCA AGTGCA SEQ ID No: 1901 TCAGAAGTCTGCA SEQ ID No: 1925 TCATGGAGCACTG TGTGCA AGTGCA SEQ ID No: 1902 TCTGCATTGCGCA SEQ ID No: 1926 TCGCATGCTGTTCTCATGTGCAGTGCA182358171.1SEQ ID No: 1927 TCATGGCATCTGT SEQ ID No: 1951 TCTTGCGCATATC CGTGCA AGTGCA SEQ ID No: 1928 TCACTTATGCATA SEQ ID No: 1952 TCTTGCTAGTCTGT TGTGCA GCA SEQ ID No: 1929 TCACATGGAGCGC SEQ ID No: 1953 TCATATGCTCTTGC AGTGCA GTGCA SEQ ID No: 1930 TCTGCAGGAGATG SEQ ID No: 1954 TCAGCCATCACGA CATGTGCA TGTGCA SEQ ID No: 1931 TCATCCGATCATG SEQ ID No: 1955 TCAGCTGAGGCTC AGTGCA AGTGCA SEQ ID No: 1932 TCGATTGTGATCG SEQ ID No: 1956 TCTCTTCGCTGTGT TGCA GCA SEQ ID No: 1933 TCAGCCACGCATG SEQ ID No: 1957 TCATGAGAGCTTC CGTGCA AGTGCA SEQ ID No: 1934 TCATGCTGACATC SEQ ID No: 1958 TCAGTTGATGATG CGTGCA TGTGCA SEQ ID No: 1935 TCAGCGCCGTGAG SEQ ID No: 1959 TCTGACTATTCTGT TGCA GCA SEQ ID No: 1936 TCTGAGGAGATCA SEQ ID No: 1960 TCAATGAGATGAC GTGCA AGTGCA SEQ ID No: 1937 TCAGCCGTGACTG SEQ ID No: 1961 TCGCATGCATGGC TGCA GATGTGCA SEQ ID No: 1938 TCTGATGCACGGC SEQ ID No: 1962 TCTGAATGCATGC TGTGCA TGTGTGCA SEQ ID No: 1939 TCTATTGTGTATGT SEQ ID No: 1963 TCTATCAATCGCA GCA TGTGCA SEQ ID No: 1940 TCAATCGCGAGAG SEQ ID No: 1964 TCGCAATGACTCG TGCA TGCA SEQ ID No: 1941 TCTGTGCACTGCA SEQ ID No: 1965 TCTGATGGATCTG AGTGCA AGTGCA SEQ ID No: 1942 TCTGTCACAAGAG SEQ ID No: 1966 TCGATGTATTATG TGCA TGCA SEQ ID No: 1943 TCTGAGCCGCATG SEQ ID No: 1967 TCAGCATAGTGCT CATGTGCA TGTGCA SEQ ID No: 1944 TCAAGCGCTCACG SEQ ID No: 1968 TCTGTGCGAGTTG TGCA TGCA SEQ ID No: 1945 TCAGCACTGCAAT SEQ ID No: 1969 TCGATGAGTGTTG GATGTGCA TGCA SEQ ID No: 1946 TCATGGTGTATCG SEQ ID No: 1970 TCGTAATAGCATG TGCA TGCA SEQ ID No: 1947 TCTCTGAATAGCG SEQ ID No: 1971 TCACATGCTGAAT TGCA GCAGTGCA SEQ ID No: 1948 TCAGCCGACATGC SEQ ID No: 1972 TCGGTGCTGTATG AGTGCA TGCA SEQ ID No: 1949 TCTCGCACTTCTGT SEQ ID No: 1973 TCACAACTCAGAG GCA TGCA SEQ ID No: 1950 TCATGTGCTCAAC SEQ ID No: 1974 TCAAGAGAGCGCGAGTGCATGCA182358171.1SEQ ID No: 1975 TCGGCTCTGATCG SEQ ID No: 1999 TCATGATTCTATAT TGCA GTGCA SEQ ID No: 1976 TCTATCTTCTATGT SEQ ID No: 2000 TCTGCAGAGCAAG GCA CGTGCA SEQ ID No: 1977 TCGGCGAGATGAG SEQ ID No: 2001 TCACAGAGAGCAT TGCA TGTGCA SEQ ID No: 1978 TCATGCGATGTCA SEQ ID No: 2002 TCATGCATGGACT AGTGCA AGTGCA SEQ ID No: 1979 TCGCATCTCAGGC SEQ ID No: 2003 TCTATAGCATGAT TGTGCA TGTGCA SEQ ID No: 1980 TCGATTGATACAG SEQ ID No: 2004 TCTGCATGTTGCG TGCA CATGTGCA SEQ ID No: 1981 TCTTCATGAGATA SEQ ID No: 2005 TCACTGCCATATG TGTGCA AGTGCA SEQ ID No: 1982 TCTGCAGGCTATG SEQ ID No: 2006 TCATATAATGTGC TGTGCA TGTGCA SEQ ID No: 1983 TCAGATGCAAGCG SEQ ID No: 2007 TCTTCAGTGCAGA AGTGCA TGTGCA SEQ ID No: 1984 TCACTGTGCCGCA SEQ ID No: 2008 TCAGTGCTGGCGA TGTGCA TGTGCA SEQ ID No: 1985 TCAGCTAATCAGC SEQ ID No: 2009 TCATGCAGCTGAG AGTGCA GCTGTGCA SEQ ID No: 1986 TCGCTTCAGTGCA SEQ ID No: 2010 TCTCTGTGCCGCG TGTGCA TGCA SEQ ID No: 1987 TCATGCAAGACAG SEQ ID No: 2011 TCACAATGCAGTC TGTGCA TGTGCA SEQ ID No: 1988 TCATGCGCATAAG SEQ ID No: 2012 TCTGATCATGCAG TGTGCA ATTGTGCA SEQ ID No: 1989 TCAGCTGCTGTTG SEQ ID No: 2013 TCAGCAGCGCTGC TGTGCA ATTGTGCA SEQ ID No: 1990 TCGACCATGAGCA SEQ ID No: 2014 TCAGAAGCATGAC TGTGCA TGTGCA SEQ ID No: 1991 TCATATGCATGTG SEQ ID No: 2015 TCATCATTCACTG GATGTGCA AGTGCA SEQ ID No: 1992 TCGTGCAGAGCCA SEQ ID No: 2016 TCAGCCTGATCAT TGTGCA GCTGTGCA SEQ ID No: 1993 TCAGAGTGCATCA SEQ ID No: 2017 TCAATGCAGAGTA AGTGCA TGTGCA SEQ ID No: 1994 TCACTGCAGAGGA SEQ ID No: 2018 TCTGCATCGCGGC TGTGCA TGTGCA SEQ ID No: 1995 TCGATCGATCTTG SEQ ID No: 2019 TCATCGTGCACCA TGCA TGTGCA SEQ ID No: 1996 TCTACATCATGGC SEQ ID No: 2020 TCGAGCAGTGAAG AGTGCA TGCA SEQ ID No: 1997 TCTGATGAGGCAG SEQ ID No: 2021 TCAGAAGATGTGC TGTGCA TGTGCA SEQ ID No: 1998 TCAATATGTATGA SEQ ID No: 2022 TCATGATTCACTGTGTGCATGTGCA182358171.1SEQ ID No: 2023 TCAGCGATAACAG SEQ ID No: 2047 TCTGAGCAGATGT TGCA TGTGCA SEQ ID No: 2024 TCATGGCACATCT SEQ ID No: 2048 TCAGCATGCATTC AGTGCA AGCGTGCA SEQ ID No: 2025 TCGCATATAGCCG SEQ ID No: 2049 TCTGATGTGGAGA TGCA TGTGCA SEQ ID No: 2026 TCAGTTGCGCACG SEQ ID No: 2050 TCAATGATCATCT TGCA CATGTGCA SEQ ID No: 2027 TCTTGAGAGCACA SEQ ID No: 2051 TCTCAGCCAGAGC TGTGCA AGTGCA SEQ ID No: 2028 TCAGAGCTGCGCT SEQ ID No: 2052 TCATCACACATTA TGTGCA TGTGCA SEQ ID No: 2029 TCAGAATATAGAG SEQ ID No: 2053 TCGGATACATGAG TGCA TGCA SEQ ID No: 2030 TCTCGCAGCTCAA SEQ ID No: 2054 TCAACGCACAGCG GTGCA TGCA SEQ ID No: 2031 TCTGCTAGCCATG SEQ ID No: 2055 TCACGTGATGCCG TGTGCA TGCA SEQ ID No: 2032 TCACAATCTCACG SEQ ID No: 2056 TCAATCATATGTC TGCA AGTGCA SEQ ID No: 2033 TCAGCAGCAAGCT SEQ ID No: 2057 TCAGATATGCACT AGTGCA TGTGCA SEQ ID No: 2034 TCTGCAGATTGCA SEQ ID No: 2058 TCTCACAATGCGC TCAGTGCA TGTGCA SEQ ID No: 2035 TCATATCATTATG SEQ ID No: 2059 TCTGATCTGGACG CATGTGCA TGCA SEQ ID No: 2036 TCGTCAGGCACTG SEQ ID No: 2060 TCATCGCACCGCA TGCA TGTGCA SEQ ID No: 2037 TCAGAATGCTCTA SEQ ID No: 2061 TCGCTATATATTGT TGTGCA GCA SEQ ID No: 2038 TCTTCGCAGATCA SEQ ID No: 2062 TCACTAGCACTTG TGTGCA TGCA SEQ ID No: 2039 TCACAGAATCAGA SEQ ID No: 2063 TCTCTATTCACAGT TGTGCA GCA SEQ ID No: 2040 TCATATCAGCTTG SEQ ID No: 2064 TCTGTGCATCAAT CATGTGCA CGTGCA SEQ ID No: 2041 TCAGTCAATGCTG SEQ ID No: 2065 TCTGTCGCACAAG TGTGCA TGCA SEQ ID No: 2042 TCTCGATTGACTG SEQ ID No: 2066 TCAGTCACAGTTG TGCA TGCA SEQ ID No: 2043 TCTATATGCCATC SEQ ID No: 2067 TCATAAGCGCTAG AGTGCA TGCA SEQ ID No: 2044 TCTTCAGCGAGTG SEQ ID No: 2068 TCGAGGATATCTG TGCA TGCA SEQ ID No: 2045 TCTGCATCTCTTCA SEQ ID No: 2069 TCATGCTCAGCCA GTGCA CGTGCA SEQ ID No: 2046 TCATGCAGATCCT SEQ ID No: 2070 TCAGCACCATGCACGTGCATCAGTGCA182358171.1SEQ ID No: 2071 TCGCGCATGCAAG SEQ ID No: 2095 TCATGATCGCAAG TGTGCA AGTGCA SEQ ID No: 2072 TCTGTCGCATGGC SEQ ID No: 2096 TCAATCATGACAG TGTGCA AGTGCA SEQ ID No: 2073 TCAGAGAGAAGAG SEQ ID No: 2097 TCATATTACAGCT TGCA GTGCA SEQ ID No: 2074 TCATCATACGCCA SEQ ID No: 2098 TCTCAGCCAGCAC TGTGCA TGTGCA SEQ ID No: 2075 TCATGCTGAGAAT SEQ ID No: 2099 TCTCTGAGGCAGC AGTGCA GTGCA SEQ ID No: 2076 TCATGCATAGAAC SEQ ID No: 2100 TCAGCATCAATCT TGTGCA CGTGCA SEQ ID No: 2077 TCACAAGCATGAT SEQ ID No: 2101 TCTATATATTATGT GCTGTGCA GCA SEQ ID No: 2078 TCACAGCATTACG SEQ ID No: 2102 TCATGCAATCTAC TGCA TGTGCA SEQ ID No: 2079 TCATGATCTATTG SEQ ID No: 2103 TCAGCAGGTGCTG CGTGCA AGTGCA SEQ ID No: 2080 TCTGCAGCATGCA SEQ ID No: 2104 TCGCTTAGACATG GAAGTGCA TGCA SEQ ID No: 2081 TCGGCACATGTGC SEQ ID No: 2105 TCAGAGCCATCAC TGTGCA AGTGCA SEQ ID No: 2082 TCAGTTATCGCTG SEQ ID No: 2106 TCGCATGCTACCG TGCA TGCA SEQ ID No: 2083 TCGCACACAACTG SEQ ID No: 2107 TCTCAACGCATGC TGCA AGTGCA SEQ ID No: 2084 TCAGCGCCTCATG SEQ ID No: 2108 TCTTGACAGCATG TGTGCA AGTGCA SEQ ID No: 2085 TCAGAATAGCGCA SEQ ID No: 2109 TCACAGCACCGTG TGTGCA TGCA SEQ ID No: 2086 TCATCGCATTGCT SEQ ID No: 2110 TCTCTCATGCATG CGTGCA CTTGTGCA SEQ ID No: 2087 TCTAGAGCATGGC SEQ ID No: 2111 TCAGACTTCTGTG AGTGCA TGCA SEQ ID No: 2088 TCATACGCATGCT SEQ ID No: 2112 TCTGTCATCTAAG TGTGCA TGCA SEQ ID No: 2089 TCAGATGAGCTTC SEQ ID No: 2113 TCACAGTTGTATG TGTGCA TGCA SEQ ID No: 2090 TCAATGCAGCTGT SEQ ID No: 2114 TCACTCTCTCAAG AGTGCA TGCA SEQ ID No: 2091 TCAGCTAATGCGA SEQ ID No: 2115 TCATGCAAGTAGA TGTGCA TGTGCA SEQ ID No: 2092 TCGCGATATGTTG SEQ ID No: 2116 TCTGTAGCATGCA TGCA AGTGCA SEQ ID No: 2093 TCTATGCCATACG SEQ ID No: 2117 TCTGCCGCTGCTG TGCA AGTGCA SEQ ID No: 2094 TCTCATGCAAGAT SEQ ID No: 2118 TCACAATGTACAGCGTGCATGCA182358171.1SEQ ID No: 2119 TCGTATGCACAAG SEQ ID No: 2143 TCGCTGCCGAGCG TGCA TGCA SEQ ID No: 2120 TCTGCTCACGTTGT SEQ ID No: 2144 TCTCAAGCTAGCG GCA TGCA SEQ ID No: 2121 TCTGCCGTGCATG SEQ ID No: 2145 TCTAGATTGCGTG TGTGCA TGCA SEQ ID No: 2122 TCATGCACACGCT SEQ ID No: 2146 TCACAGTTGCGTG TGTGCA TGCA SEQ ID No: 2123 TCTCATAAGTGCA SEQ ID No: 2147 TCATGATTGTGCG TGTGCA TGTGCA SEQ ID No: 2124 TCATGCAATGTCG SEQ ID No: 2148 TCAGCATTGCAGA CGTGCA TGCGTGCA SEQ ID No: 2125 TCTCAGCATCATC SEQ ID No: 2149 TCAATCATCTGAG CGTGCA CGTGCA SEQ ID No: 2126 TCGATTGCTCATC SEQ ID No: 2150 TCATCCATGCATA AGTGCA TGCGTGCA SEQ ID No: 2127 TCAATGTAGCGTG SEQ ID No: 2151 TCTATGCCATGCA TGCA TGCGTGCA SEQ ID No: 2128 TCATGATCAGCAT SEQ ID No: 2152 TCAGTGCTGGATG TGCGTGCA CGTGCA SEQ ID No: 2129 TCATCATTATGCG SEQ ID No: 2153 TCTGTGAGCTCCG CGTGCA TGCA SEQ ID No: 2130 TCTTATGCGTGTGT SEQ ID No: 2154 TCTGAATGCAGAG GCA CGTGCA SEQ ID No: 2131 TCTGCATGCACCA SEQ ID No: 2155 TCATCCTCTGCTAT TCTGTGCA GTGCA SEQ ID No: 2132 TCAGATCCATGTG SEQ ID No: 2156 TCATCATGCGCCT CGTGCA GCAGTGCA SEQ ID No: 2133 TCACTGCGTTGCA SEQ ID No: 2157 TCAGCCAGATATG TGTGCA CGTGCA SEQ ID No: 2134 TCTGATCTCCTGCT SEQ ID No: 2158 TCGGATGCACAGC GTGCA AGTGCA SEQ ID No: 2135 TCATCACCTGATG SEQ ID No: 2159 TCTATGACTGCCA TGTGCA TGTGCA SEQ ID No: 2136 TCTGCTCATTGAG SEQ ID No: 2160 TCACAGCATTCAT CGTGCA GCAGTGCA SEQ ID No: 2137 TCGGACTGCACAG SEQ ID No: 2161 TCATGGACATGCG TGCA CGTGCA SEQ ID No: 2138 TCTTCTGCGCATC SEQ ID No: 2162 TCATGGATGTGTG AGTGCA CGTGCA SEQ ID No: 2139 TCGACATGCATAT SEQ ID No: 2163 TCATCACTCCTGC TGTGCA AGTGCA SEQ ID No: 2140 TCTCCACTCATCTG SEQ ID No: 2164 TCTCTGCCACGCG TGCA TGCA SEQ ID No: 2141 TCACATGCATCTC SEQ ID No: 2165 TCATGTGATGCCA CATGTGCA TGCGTGCA SEQ ID No: 2142 TCACATCGAATGA SEQ ID No: 2166 TCTCATCATTGCTATGTGCAGTGCA182358171.1SEQ ID No: 2167 TCTGCATGCTAAT SEQ ID No: 2191 TCAGCGCAGGCTG GCAGTGCA CGTGCA SEQ ID No: 2168 TCAATGACTGCAT SEQ ID No: 2192 TCGCAGCTCCATG AGTGCA CGTGCA SEQ ID No: 2169 TCAATGACTGCAG SEQ ID No: 2193 TCATCAGCATCCG TGTGCA CGTGCA SEQ ID No: 2170 TCGATTGCACTGA SEQ ID No: 2194 TCATCCATGCGCA TGTGCA CGTGCA SEQ ID No: 2171 TCTCTCAGCTTGC SEQ ID No: 2195 TCTCTGCATGCAC GTGCA CGTGCA SEQ ID No: 2172 TCTCATCTCGCCGT SEQ ID No: 2196 TCATCATCAAGTG GCA CGTGCA SEQ ID No: 2173 TCTGCATCAACTG SEQ ID No: 2197 TCTGCGTGAGAAG CATGTGCA TGCA SEQ ID No: 2174 TCAATGTCTCATCT SEQ ID No: 2198 TCATCGCTCATTG GTGCA CGTGCA SEQ ID No: 2175 TCTGATCATCAAG SEQ ID No: 2199 TCACATCATTCAT C GTGCA GATGTGCA SEQ ID No: 2176 TCACTGCATGCGC SEQ ID No: 2200 TCAATCTCTGCTG C GTGCA CGTGCA SEQ ID No: 2177 TCAAGCATGTCTC SEQ ID No: 2201 TCGCTCATCCACG AGTGCA TGCA SEQ ID No: 2178 TCATCGCCAGATG SEQ ID No: 2202 TCTGCATGCTGCA C GTGCA AGCGTGCA SEQ ID No: 2179 TCGGACTGCATGC SEQ ID No: 2203 TCAGAATGATCTG TGTGCA CGTGCA SEQ ID No: 2180 TCATCACTGCATC SEQ ID No: 2204 TCGCAGATTCTGC C GTGCA GTGCA SEQ ID No: 2181 TCTGCGCTGCAAT SEQ ID No: 2205 TCTGCTGGATCTG C GTGCA CGTGCA SEQ ID No: 2182 TCTGCACCTCACG SEQ ID No: 2206 TCAGCATCTCATC TGCA CATGTGCA SEQ ID No: 2183 TCTCATGCTTGTGC SEQ ID No: 2207 TCTTGCAGCACTG GTGCA CGTGCA SEQ ID No: 2184 TCTGCATGCGCCT SEQ ID No: 2208 TCATGGCTCACTG GATGTGCA CGTGCA SEQ ID No: 2185 TCATGCACAGAAT SEQ ID No: 2209 TCTGCATGATCCG GCTGTGCA TGTGCA SEQ ID No: 2186 TCTGCACCGCTAG SEQ ID No: 2210 TCTGCACGAGCCG TGCA TGCA SEQ ID No: 2187 TCATCTAATCATG SEQ ID No: 2211 TCATCTCCATGCG CGTGCA TGTGCA SEQ ID No: 2188 TCTGCACATTGCA SEQ ID No: 2212 TCATCCGCGTGTG TGCGTGCA TGCA SEQ ID No: 2189 TCGCAATGTGCTG SEQ ID No: 2213 TCTGCACATTCGA CGTGCA TGTGCA SEQ ID No: 2190 TCATCAGGTGCTG SEQ ID No: 2214 TCTTGTCTGCGTGTCGTGCAGCA182358171.1SEQ ID No: 2215 TCTCATCCATGTGT SEQ ID No: 2216 TCTGCACATGAATGTGCACATGTGCA

[0083] In some cases, a sequence in Table 4 may further comprise, at the 3' end, a common adapter sequence, complementary to the 5’ adapter sequence that may be associated with barcode sequences in Table 3. For example, SEQ ID No: 2217 GTCGGAGAC AC GCAGGGA / ideoxyU / GAGA / i deoxy U / GG / i deoxy U may be a suitable 3’ common adapter sequence for barcodes in Table 4. SEQ ID No: 2217 comprises three cleavable bases, in this case ideoxyUs. One or more of these ideoxy uracils may be replaced with Ts, resulting in SEQ ID No: 2218 GTCGGAGACACGCAGGGATGAGATGGT. In some cases, the cleavable bases may not be ideoxyUs but instead may be any other suitable cleavable base, as described herein. In some cases, the 3’ common adapter sequence (e.g., SEQ ID No: 2217 or SEQ ID No: 2218) may further comprise a 3’ modification, such as a 3' biotin or a 3’ desthiobiotin.

[0084] In some cases, a double-stranded adapter molecule may comprise a sequence selected from any one of SEQ ID Nos: 103-1157 (Table 3) and a complementary sequence from Table 4 (SEQ ID Nos: 1162-2216).

[0085] Efficient barcode sequences for dense coding

[0086] Provided herein are methods, sequences, compositions, and kits of barcode sequences designed to facilitate differentiation of the sequences during analysis. Beneficially, the signals that will be detected from the barcode sequences provided below should be distinct without requiring very long barcodes. Such sequences, methods, compositions, and kits can be applied alternatively or in addition to at least the preparation 101 and amplification 105 operations described with respect to sequencing workflow 100 of FIG. 1. Such sequences, methods, compositions, and kits can be used in conjunction with the sample processing systems and methods, or components thereof (e.g., substrates, detectors, reagent dispensing, continuous scanning, etc.) described herein.

[0087] In many sequencing methods, it is necessary to identify individual sequence reads (e.g., from which sample they are derived). Often, an insert (or sample) portion of a sequence read itself informs on genomic location (e.g., through alignment to a reference genome). Alternatively or in addition, in some sequencing methods, a barcode, adapter, UM1, etc. sequence can be added during library preparation to identify the target molecule. For instance, a barcode could be specific to a sample (e.g., in cases where multiple samples are pooled). The-69- 182358171.1following sequences may be particularly useful with counting applications, where short adapter and barcode sequences can contribute to efficient sequencing times.

[0088] / ow invariant barcode sequences

[0089] The barcodes in Table 5 may be particularly useful for non-terminated sequencing methods. For example, assuming a flow order of A-C-G-T of non-terminated SBS the signals for SEQ ID No: 2225, ACAAATTTGGGC, in flowspace may be [1.1.0.0, 3, 0,0, 3, 0,0, 3, 0,0,1] and the signals for SEQ ID No: 2226, ACAAATTTTTGC, in flowspace may be [1,1, 0,0, 3, 0,0, 5, 0,0,1, 0,0,1], These matrices are sparsely encoded (meaning multiple 0s) and are readily differentiated at the 8thand 11thpositions. Alternatively, using a different flow order such as T-G-C-A, the flowspace signals for SEQ ID No: 2225 could be [1,0, 0,1, 3, 3, 3,1] and the flowspace signals for SEQ ID No: 2226 could be [ 1,0,0.1.3.5.1.1], In this flow order, the vectors are not sparsely encoded but there are still easily differentiable by comparing vector values to each other (e.g., the 6thand 7thpositions in these two vectors differ). In either case, the first and last bases anchor the sequences for identification of the barcode sequence region (i.e., all barcodes will produce the same signal at those positions / from those bases). Similarly, the middle bases represented by signals in the middle 12 or 6 flows respectively - depending on the flow order, differ from each other to aid in identifying which barcode sequence is present in a particular read.

[0090] In some cases, a subset of sequences from Table 5 or Table 6 or Table 7 or Table 8 may be selected for a sequencing run. For example, a set of 2, 4. 8, 16, 24, 48, 96, 384. 1024 barcodes may be selected. In some cases, any number of barcodes may be needed for a particular library7preparation and sequencing run.

[0091] For Tables 5-8 the number of variable flows (e.g., 6 or 8 flows) is indicated based on the flow order T-G-C-A. It will be understood that any flow order could be used with these sequences. In each of Tables 5-8, the first barcode base and the last barcode base are set, and the intervening barcode bases are variable. These barcodes may be particularly suitable for dense encoding; that is, the barcodes in these tables may be sequenced by only a few nucleotide flows (e.g.. is non-terminated SBS) and may be easily differentiated in flowspace.

[0092] Table 5: Barcode sequences, 6 flows, ending in CSEQ ID No: Sequence 5’ to 3’ SEQ ID No: 2222 ACATTTTTGGG SEQ ID No: 2219 ACTTTGGGC CSEQ ID No: 2220 ACTTTTTGC SEQ ID No: 2223 ACAAAGGGC SEQ ID No: 2224 ACAAATTTCSEQ ID No: 2221 ACATTTTTC-70- 182358171.1SEQ ID No: 2225 ACAAATTTGGG SEQ ID No: 2254 ACCCCCTGC C SEQ ID No: 2255 ACCCCCTTTC SEQ ID No: 2226 ACAAATTTTTG SEQ ID No: 2256 ACCCCCTTTGG C GC SEQ ID No: 2227 ACAAAAAGC SEQ ID No: 2257 ACCCCCTTTTT SEQ ID No: 2228 ACAAAAATC GCSEQ ID No: 2229 ACAAAAATGG SEQ ID No: 2258 ACCCCCAGC GC SEQ ID No: 2259 ACCCCCATC SEQ ID No: 2230 ACAAAAATTTG SEQ ID No: 2260 ACCCCCATGGG C C SEQ ID No: 2231 ACAAAAATTTT SEQ ID No: 2261 ACCCCCATTTG TC C SEQ ID No: 2232 ACAAAAATTTT SEQ ID No: 2262 ACCCCCATTTT TGGGC TC SEQ ID No: 2233 ACCCTGGGC SEQ ID No: 2263 ACCCCCATTTT SEQ ID No: 2234 ACCCTTTGC TGGGC SEQ ID No: 2235 ACCCTTTTTC SEQ ID No: 2264 ACCCCCAAAC SEQ ID No: 2236 ACCCTTTTTGG SEQ ID No: 2265 ACCCCCAAAGG GC GC SEQ ID No: 2237 ACCCAGGGC SEQ ID No: 2266 ACCCCCAAATG SEQ ID No: 2238 ACCCATTTC CSEQ ID No: 2239 ACCCATTTGGG SEQ ID No: 2267 ACCCCCAAATT C TC SEQ ID No: 2240 ACCCATTTTTG SEQ ID No: 2268 ACCCCCAAATT C TGGGC SEQ ID No: 2241 ACCCAAAGC SEQ ID No: 2269 ACCCCCAAATT TTTGC SEQ ID No: 2242 ACCCAAATCSEQ ID No: 2270 ACCCCCAAAAA SEQ ID No: 2243 ACCCAAATGGG GCC SEQ ID No: 2271 ACCCCCAAAAA SEQ ID No: 2244 ACCCAAATTTG TCC SEQ ID No: 2272 ACCCCCAAAAA SEQ ID No: 2245 ACCCAAATTTT TGGGCTC SEQ ID No: 2273 ACCCCCAAAAA SEQ ID No: 2246 ACCCAAATTTT TTTGC TGGGC SEQ ID No: 2274 AGTTTGGGC SEQ ID No: 2247 ACCCAAAAACSEQ ID No: 2275 AGTTTTTGC SEQ ID No: 2248 ACCCAAAAAGSEQ ID No: 2276GGC AGATTTTTC SEQ ID No: 2249 ACCCAAAAATG SEQ ID No: 2277 AGATTTTTGGG C C SEQ ID No: 2250 ACCCAAAAATT SEQ ID No: 2278 AGAAAGGGC TC SEQ ID No: 2279 AGAAATTTC SEQ ID No: 2251 ACCCAAAAATT SEQ ID No: 2280 AGAAATTTGGG TGGGC C SEQ ID No: 2252 ACCCAAAAATT SEQ ID No: 2281 AGAAATTTTTG TTTGC CSEQ ID No: 2253 ACCCCCGGGCSEQ ID No: 2282 AGAAAAAGC -71- 182358171.1SEQ ID No: 2283 AGAAAAATC SEQ ID No: 2311 AGCCCAAATTT SEQ ID No: 2284 AGAAAAATGG TTGCGC SEQ ID No: 2312 AGCCCAAAAA SEQ ID No: 2285 AGAAAAATTTG GCC SEQ ID No: 2313 AGCCCAAAAAT SEQ ID No: 2286 AGAAAAATTTT CTC SEQ ID No: 2314 AGCCCAAAAAT SEQ ID No: 2287 AGAAAAATTTT GGGC TGGGC SEQ ID No: 2315 AGCCCAAAAAT SEQ ID No: 2288 AGCTTTTTC TTGCSEQ ID No: 2289 AGCTTTTTGGG SEQ ID No: 2316 AGCCCAAAAAT C TTTTC SEQ ID No: 2290 AGCATGGGC SEQ ID No: 2317 AGCCCAAAAAT TTTTGGGC SEQ ID No: 2291 AGCATTTGCSEQ ID No: 2318 AGCCCCCGC SEQ ID No: 2292 AGCAAATGCSEQ ID No: 2319 AGCCCCCTC SEQ ID No: 2293 AGCAAATTTTTSEQ ID No: 2320C AGCCCCCTGGG C SEQ ID No: 2294 AGCAAATTTTTSEQ ID No: 2321GGGC AGCCCCCTTTG C SEQ ID No: 2295 AGCAAAAACSEQ ID No: 2322 AGCCCCCTTTT SEQ ID No: 2296 AGCAAAAAGG TCGC SEQ ID No: 2323 AGCCCCCTTTT SEQ ID No: 2297 AGCAAAAATTT TGGGCC SEQ ID No: 2324 AGCCCCCAC SEQ ID No: 2298 AGCAAAAATTTSEQ ID No: 2325GGGC AGCCCCCAGGG C SEQ ID No: 2299 AGCAAAAATTTSEQ ID No: 2326 AGCCCCCATTT TTGC C SEQ ID No: 2300 AGCCCGGGCSEQ ID No: 2327 AGCCCCCATTT SEQ ID No: 2301 AGCCCTTTC GGGCSEQ ID No: 2302 AGCCCTTTGGG SEQ ID No: 2328 AGCCCCCATTT C TTGC SEQ ID No: 2303 AGCCCTTTTTG SEQ ID No: 2329 AGCCCCCAAAG C C SEQ ID No: 2304 AGCCCATGC SEQ ID No: 2330 AGCCCCCAAAT SEQ ID No: 2305 AGCCCATTTTT CC SEQ ID No: 2331 AGCCCCCAAAT SEQ ID No: 2306 AGCCCATTTTT GGGC GGGC SEQ ID No: 2332 AGCCCCCAAAT SEQ ID No: 2307 AGCCCAAAC TTGCSEQ ID No: 2308 AGCCCAAAGG SEQ ID No: 2333 AGCCCCCAAAT GC TTTTC SEQ ID No: 2309 AGCCCAAATTT SEQ ID No: 2334 AGCCCCCAAAT C TTTTGGGC SEQ ID No: 2310 AGCCCAAATTT SEQ ID No: 2335 AGCCCCCAAAAGGGCAC-72- 182358171.1SEQ ID No: 2336 AGCCCCCAAAA SEQ ID No: 2365 AGGGCATTTTT AGGGC C SEQ ID No: 2337 AGCCCCCAAAA SEQ ID No: 2366 AGGGCATTTTT ATGC GGGC SEQ ID No: 2338 AGCCCCCAAAA SEQ ID No: 2367 AGGGC AAAC ATTTC SEQ ID No: 2368 AGGGC AAAGG SEQ ID No: 2339 AGCCCCCAAAA GC ATTTGGGC SEQ ID No: 2369 AGGGC AAATTT SEQ ID No: 2340 AGGGTGGGC CSEQ ID No: 2341 AGGGTTTGC SEQ ID No: 2370 AGGGC AAATTT SEQ ID No: 2342 AGGGTTTTTC GGGCSEQ ID No: 2343 AGGGTTTTTGG SEQ ID No: 2371 AGGGC AAATTT GC TTGC SEQ ID No: 2344 AGGGAGGGC SEQ ID No: 2372 AGGGC AAAAA SEQ ID No: 2345 GC AGGGATTTC SEQ ID No: 2373 AGGGC AAAAA SEQ ID No: 2346 AGGGATTTGGG TCC SEQ ID No: 2374 AGGGCAAAAA SEQ ID No: 2347 AGGGATTTTTG TGGGCC SEQ ID No: 2375 AGGGCAAAAA SEQ ID No: 2348 AGGGAAAGC TTTGCSEQ ID No: 2349 AGGGAAATC SEQ ID No: 2376 AGGGCAAAAA SEQ ID No: 2350 AGGGAAATGG TTTTTC GC SEQ ID No: 2377 AGGGCAAAAA SEQ ID No: 2351 AGGGAAATTTG TTTTTGGGC C SEQ ID No: 2378 AGGGCCCGC SEQ ID No: 2352 AGGGAAATTTT SEQ ID No: 2379 AGGGCCCTC TC SEQ ID No: 2380 AGGGCCCTGGG SEQ ID No: 2353 AGGGAAATTTT CTGGGC SEQ ID No: 2381 AGGGCCCTTTG SEQ ID No: 2354 AGGGAAAAAC CSEQ ID No: 2355 AGGGAAAAAG SEQ ID No: 2382 AGGGCCCTTTT GGC TC SEQ ID No: 2356 AGGGAAAAAT SEQ ID No: 2383 AGGGCCCTTTT GC TGGGC SEQ ID No: 2357 AGGGAAAAATT SEQ ID No: 2384 AGGGCCCAC TC SEQ ID No: 2385 AGGGCCCAGG SEQ ID No: 2358 AGGGAAAAATT GCTGGGC SEQ ID No: 2386 AGGGCCCATTT SEQ ID No: 2359 AGGGAAAAATT CTTTGC SEQ ID No: 2387 AGGGCCCATTT SEQ ID No: 2360 AGGGC GGGC GGGCSEQ ID No: 2361 AGGGCTTTC SEQ ID No: 2388 AGGGCCCATTT SEQ ID No: 2362 AGGGCTTTGGG TTGCC SEQ ID No: 2389 AGGGCCCAAA SEQ ID No: 2363 AGGGCTTTTTG GCSEQ ID No: 2390 AGGGCCCAAATSEQ ID No: 2364 AGGGCATGCC-73- 182358171.1SEQ ID No: 2391 AGGGCCCAAAT SEQ ID No: 2415 AGGGCCCCCAA GGGC ATTTC SEQ ID No: 2392 AGGGCCCAAAT SEQ ID No: 2416 AGGGCCCCCAA TTGC ATTTGGGC SEQ ID No: 2393 AGGGCCCAAAT SEQ ID No: 2417 AGGGCCCCCAA TTTTC ATTTTTGC SEQ ID No: 2394 AGGGCCCAAAT SEQ ID No: 2418 AGGGCCCCCAA TTTTGGGC AAAGC SEQ ID No: 2395 AGGGCCCAAA SEQ ID No: 2419 AGGGCCCCCAA AAC AAATC SEQ ID No: 2396 AGGGCCCAAA SEQ ID No: 2420 AGGGCCCCCAA AAGGGC AAATGGGC SEQ ID No: 2397 AGGGCCCAAA SEQ ID No: 2421 AGGGCCCCCAA AATGCAAATTTGC SEQ ID No: 2398 AGGGCCCAAA SEQ ID No: 2422 ATATTTGGGC AATTTC SEQ ID No: 2423 ATATTTTTC SEQ ID No: 2399 AGGGCCCAAA SEQ ID No: 2424 ATAAAGGGC AATTTGGGC SEQ ID No: 2425 ATAAATTTC SEQ ID No: 2400 AGGGCCCAAAAATTTTTGC SEQ ID No: 2426 ATAAATTTTTG C SEQ ID No: 2401 AGGGCCCCCGGGC SEQ ID No: 2427 ATAAAAAGC SEQ ID No: 2402 AGGGCCCCCTG SEQ ID No: 2428 ATAAAAATC C SEQ ID No: 2429 ATAAAAATGGG SEQ ID No: 2403 AGGGCCCCCTT CTC SEQ ID No: 2430 ATAAAAATTTG SEQ ID No: 2404 AGGGCCCCCTT CTGGGC SEQ ID No: 2431 ATAAAAATTTT SEQ ID No: 2405 AGGGCCCCCTT TCTTTGC SEQ ID No: 2432 ATAAAAATTTT SEQ ID No: 2406 AGGGCCCCCAG TGGGCC SEQ ID No: 2433 ATCTTTTTC SEQ ID No: 2407 AGGGCCCCCAT SEQ ID No: 2434 ATCTTTTTGGG C C SEQ ID No: 2408 AGGGCCCCCAT SEQ ID No: 2435 ATCATGGGC GGGC SEQ ID No: 2436 ATCATTTGC SEQ ID No: 2409 AGGGCCCCCAT SEQ ID No: 2437 ATCAAATGC TTGC SEQ ID No: 2438 ATCAAATTTTT SEQ ID No: 2410 AGGGCCCCCATC TTTTC SEQ ID No: 2439 ATCAAATTTTT SEQ ID No: 2411 AGGGCCCCCATGGGC TTTTGGGC SEQ ID No: 2440 ATCAAAAAC SEQ ID No: 2412 AGGGCCCCCAAAC SEQ ID No: 2441 ATCAAAAAGG SEQ ID No: 2413 AGGGCCCCCAA GCAGGGC SEQ ID No: 2442 ATCAAAAATTT SEQ ID No: 2414 AGGGCCCCCAA CSEQ ID No: 2443 ATCAAAAATTTATGCGGGC-74- 182358171.1SEQ ID No: 2444 ATCAAAAATTT SEQ ID No: 2471 ATCCCCCATTT TTGC C SEQ ID No: 2445 ATCCCGGGC SEQ ID No: 2472 ATCCCCCATTT SEQ ID No: 2446 ATCCCTTTC GGGCSEQ ID No: 2447 ATCCCTTTGGG SEQ ID No: 2473 ATCCCCCATTT C TTGC SEQ ID No: 2448 ATCCCTTTTTG SEQ ID No: 2474 ATCCCCCAAAG C C SEQ ID No: 2449 ATCCCATGC SEQ ID No: 2475 ATCCCCCAAAT C SEQ ID No: 2450 ATCCCATTTTTC SEQ ID No: 2476 ATCCCCCAAAT GGGC SEQ ID No: 2451 ATCCCATTTTTGGGC SEQ ID No: 2477 ATCCCCCAAAT TTGC SEQ ID No: 2452 ATCCCAAACSEQ ID No: 2478 ATCCCCCAAAT SEQ ID No: 2453 ATCCCAAAGGG TTTTCC SEQ ID No: 2479 ATCCCCCAAAT SEQ ID No: 2454 ATCCCAAATTT TTTTGGGC C SEQ ID No: 2480 ATCCCCCAAAA SEQ ID No: 2455 ATCCCAAATTT ACGGGC SEQ ID No: 2481 ATCCCCCAAAA SEQ ID No: 2456 ATCCCAAATTT AGGGC TTGC SEQ ID No: 2482 ATCCCCCAAAA SEQ ID No: 2457 ATCCCAAAAAG ATGCC SEQ ID No: 2483 ATCCCCCAAAA SEQ ID No: 2458 ATCCCAAAAAT ATTTCC SEQ ID No: 2484 ATCCCCCAAAA SEQ ID No: 2459 ATCCCAAAAAT ATTTGGGC GGGC SEQ ID No: 2485 ATGTTTTTC SEQ ID No: 2460 ATCCCAAAAATTTGC SEQ ID No: 2486 ATGTTTTTGGG C SEQ ID No: 2461 ATCCCAAAAATTTTTC SEQ ID No: 2487 ATGATGGGC SEQ ID No: 2462 ATCCCAAAAAT SEQ ID No: 2488 ATGATTTGC TTTTGGGC SEQ ID No: 2489 ATGAAATGC SEQ ID No: 2463 ATCCCCCGC SEQ ID No: 2490 ATGAAATTTTT SEQ ID No: 2464 ATCCCCCTC CSEQ ID No: 2465 ATCCCCCTGGG SEQ ID No: 2491 ATGAAATTTTT C GGGC SEQ ID No: 2466 ATCCCCCTTTG SEQ ID No: 2492 ATGAAAAAC SEQ ID No: 2493 ATGAAAAAGG SEQ ID No: 2467 ATCCCCCTTTTT GCC SEQ ID No: 2494 ATGAAAAATTT SEQ ID No: 2468 ATCCCCCTTTTT CGGGC SEQ ID No: 2495 ATGAAAAATTT SEQ ID No: 2469 ATCCCCCAC GGGCSEQ ID No: 2470 ATCCCCCAGGG SEQ ID No: 2496 ATGAAAAATTTTTGCCSEQ ID No: 2497 ATGCTGGGC -75- 182358171.1SEQ ID No: 2498 ATGCTTTGC SEQ ID No: 2525 ATGCCCCCGGG SEQ ID No: 2499 ATGCAGGGC CSEQ ID No: 2500 ATGCATTTC SEQ ID No: 2526 ATGCCCCCTTT C SEQ ID No: 2501 ATGCATTTGGGC SEQ ID No: 2527 ATGCCCCCTTT GGGC SEQ ID No: 2502 ATGCATTTTTGC SEQ ID No: 2528 ATGCCCCCTTT TTGC SEQ ID No: 2503 ATGCAAAGCSEQ ID No: 2529 ATGCCCCCATG SEQ ID No: 2504 ATGCAAATC CSEQ ID No: 2505 ATGCAAATGGG SEQ ID No: 2530 ATGCCCCCATT C TTTC SEQ ID No: 2506 ATGCAAATTTG SEQ ID No: 2531 ATGCCCCCATT C TTTGGGC SEQ ID No: 2507 ATGCAAAAATG SEQ ID No: 2532 ATGCCCCCAAA C C SEQ ID No: 2508 ATGCAAAAATT SEQ ID No: 2533 ATGCCCCCAAA TTTC GGGC SEQ ID No: 2509 ATGCAAAAATT SEQ ID No: 2534 ATGCCCCCAAA TTTGGGC TTTC SEQ ID No: 2510 ATGCCCTGC SEQ ID No: 2535 ATGCCCCCAAA SEQ ID No: 2511 ATGCCCTTTTT TTTGGGC C SEQ ID No: 2536 ATGCCCCCAAA SEQ ID No: 2512 ATGCCCTTTTT TTTTTGC GGGC SEQ ID No: 2537 ATGCCCCCAAA SEQ ID No: 2513 ATGCCCAGC AAGCSEQ ID No: 2514 ATGCCCATC SEQ ID No: 2538 ATGCCCCCAAA SEQ ID No: 2515 ATGCCCATGGG AATCC SEQ ID No: 2539 ATGCCCCCAAA SEQ ID No: 2516 ATGCCCATTTG AATGGGC C SEQ ID No: 2540 ATGCCCCCAAA SEQ ID No: 2517 ATGCCCAAATG AATTTGC C SEQ ID No: 2541 ATGGGTTTC SEQ ID No: 2518 ATGCCCAAATT SEQ ID No: 2542 ATGGGTTTGGG TTTC C SEQ ID No: 2519 ATGCCCAAATT SEQ ID No: 2543 ATGGGTTTTTG TTTGGGC C SEQ ID No: 2520 ATGCCCAAAAA SEQ ID No: 2544 ATGGGATGC C SEQ ID No: 2545 ATGGGATTTTT SEQ ID No: 2521 ATGCCCAAAAA CGGGC SEQ ID No: 2546 ATGGGATTTTT SEQ ID No: 2522 ATGCCCAAAAA GGGC TTTC SEQ ID No: 2547 ATGGGAAAC SEQ ID No: 2523 ATGCCCAAAAA SEQ ID No: 2548 ATGGGAAAGG TTTGGGC GC SEQ ID No: 2524 ATGCCCAAAAA SEQ ID No: 2549 ATGGGAAATTTTTTTTGCC-76- 182358171.1SEQ ID No: 2550 ATGGGAAATTT SEQ ID No: 2575 ATGGGCCCTTT GGGC GGGC SEQ ID No: 2551 ATGGGAAATTT SEQ ID No: 2576 ATGGGCCCTTT TTGC TTGC SEQ ID No: 2552 ATGGGAAAAA SEQ ID No: 2577 ATGGGCCCATG GC C SEQ ID No: 2553 ATGGGAAAAAT SEQ ID No: 2578 ATGGGCCCATT C TTTC SEQ ID No: 2554 ATGGGAAAAAT SEQ ID No: 2579 ATGGGCCCATT GGGC TTTGGGC SEQ ID No: 2555 ATGGGAAAAAT SEQ ID No: 2580 ATGGGCCCAAA TTGC C SEQ ID No: 2556 ATGGGAAAAAT SEQ ID No: 2581 ATGGGCCCAAA TTTTC GGGC SEQ ID No: 2557 ATGGGAAAAAT SEQ ID No: 2582 ATGGGCCCAAA TTTTGGGC TTTC SEQ ID No: 2558 ATGGGCTGC SEQ ID No: 2583 ATGGGCCCAAA SEQ ID No: 2559 ATGGGCTTTTT TTTGGGC C SEQ ID No: 2584 ATGGGCCCAAA SEQ ID No: 2560 ATGGGCTTTTT TTTTTGC GGGC SEQ ID No: 2585 ATGGGCCCAAA SEQ ID No: 2561 ATGGGCAGC AAGCSEQ ID No: 2562 ATGGGCATC SEQ ID No: 2586 ATGGGCCCAAA AATC SEQ ID No: 2563 ATGGGCATGGGC SEQ ID No: 2587 ATGGGCCCAAA AATGGGC SEQ ID No: 2564 ATGGGCATTTGC SEQ ID No: 2588 ATGGGCCCAAA AATTTGC SEQ ID No: 2565 ATGGGCAAATGC SEQ ID No: 2589 ATGGGCCCAAA AATTTTTC SEQ ID No: 2566 ATGGGCAAATTTTTC SEQ ID No: 2590 ATGGGCCCCCG C SEQ ID No: 2567 ATGGGCAAATTTTTGGGC SEQ ID No: 2591 ATGGGCCCCCT SEQ ID No: 2568 ATGGGCAAAA CAC SEQ ID No: 2592 ATGGGCCCCCT SEQ ID No: 2569 ATGGGCAAAA GGGC AGGGC SEQ ID No: 2593 ATGGGCCCCCT SEQ ID No: 2570 ATGGGCAAAA TTGC ATTTC SEQ ID No: 2594 ATGGGCCCCCT TTTTC SEQ ID No: 2571 ATGGGCAAAAATTTGGGC SEQ ID No: 2595 ATGGGCCCCCT TTTTGGGC SEQ ID No: 2572 ATGGGCAAAAATTTTTGC SEQ ID No: 2596 ATGGGCCCCCA C SEQ ID No: 2573 ATGGGCCCGGGSEQ ID No: 2597 ATGGGCCCCCA C GGGC SEQ ID No: 2574 ATGGGCCCTTTSEQ ID No: 2598 ATGGGCCCCCACTTTC-77- 182358171.1SEQ ID No: 2599 ATGGGCCCCCA SEQ ID No: 2626 ATTTCTTTC TTTGGGC SEQ ID No: 2627 ATTTCTTTGGG SEQ ID No: 2600 ATGGGCCCCCA C TTTTTGC SEQ ID No: 2628 ATTTCTTTTTGC SEQ ID No: 2601 ATGGGCCCCCA SEQ ID No: 2629 ATTTCATGC AAGC SEQ ID No: 2630 ATTTCATTTTTC SEQ ID No: 2602 ATGGGCCCCCAAATC SEQ ID No: 2631 ATTTCATTTTTG SEQ ID No: 2603 ATGGGCCCCCA GGC AATGGGC SEQ ID No: 2632 ATTTCAAAC SEQ ID No: 2604 ATGGGCCCCCA SEQ ID No: 2633 ATTTCAAAGGG AATTTGC C SEQ ID No: 2605 ATGGGCCCCCA SEQ ID No: 2634 ATTTCAAATTT AATTTTTC C SEQ ID No: 2606 ATGGGCCCCCA SEQ ID No: 2635 ATTTCAAATTT AAAAC GGGC SEQ ID No: 2607 ATGGGCCCCCA SEQ ID No: 2636 ATTTCAAATTT AAAAGGGC TTGC SEQ ID No: 2608 ATGGGCCCCCA SEQ ID No: 2637 ATTTCAAAAAG AAAATGC C SEQ ID No: 2609 ATGGGCCCCCA SEQ ID No: 2638 ATTTCAAAAAT AAAATTTC C SEQ ID No: 2610 ATTTAGGGC SEQ ID No: 2639 ATTTCAAAAAT SEQ ID No: 2611 ATTTATTTC GGGCSEQ ID No: 2640 ATTTCAAAAAT SEQ ID No: 2612 ATTTATTTTTGC TTGCSEQ ID No: 2613 ATTTAAAGC SEQ ID No: 2641 ATTTCAAAAAT SEQ ID No: 2614 ATTTAAATC TTTTCSEQ ID No: 2615 ATTTAAATGGG SEQ ID No: 2642 ATTTCAAAAAT C TTTTGGGC SEQ ID No: 2616 ATTTAAATTTG SEQ ID No: 2643 ATTTCCCGC C SEQ ID No: 2644 ATTTCCCTC SEQ ID No: 2617 ATTTAAATTTT SEQ ID No: 2645 ATTTCCCTGGG TC C SEQ ID No: 2618 ATTTAAATTTT SEQ ID No: 2646 ATTTCCCTTTG TGGGC C SEQ ID No: 2619 ATTTAAAAAC SEQ ID No: 2647 ATTTCCCTTTTT SEQ ID No: 2620 ATTTAAAAAGG CGC SEQ ID No: 2648 ATTTCCCTTTTT SEQ ID No: 2621 ATTTAAAAATG GGGCSEQ ID No: 2649 ATTTCCCAC SEQ ID No: 2622 ATTTAAAAATT SEQ ID No: 2650 ATTTCCCAGGG TC C SEQ ID No: 2623 ATTTAAAAATT SEQ ID No: 2651 ATTTCCCATTT TGGGC C SEQ ID No: 2624 ATTTAAAAATT SEQ ID No: 2652 ATTTCCCATTT TTTGCGGGCSEQ ID No: 2625 ATTTCGGGC-78- 182358171.1SEQ ID No: 2653 ATTTCCCATTTT SEQ ID No: 2677 ATTTCCCCCAA TGC AC SEQ ID No: 2654 ATTTCCCAAAG SEQ ID No: 2678 ATTTCCCCCAA C AGGGC SEQ ID No: 2655 ATTTCCCAAAT SEQ ID No: 2679 ATTTCCCCCAA C ATGC SEQ ID No: 2656 ATTTCCCAAAT SEQ ID No: 2680 ATTTCCCCCAA GGGC ATTTC SEQ ID No: 2657 ATTTCCCAAAT SEQ ID No: 2681 ATTTCCCCCAA TTGC ATTTGGGC SEQ ID No: 2658 ATTTCCCAAAT SEQ ID No: 2682 ATTTCCCCCAA TTTTC ATTTTTGC SEQ ID No: 2659 ATTTCCCAAAT SEQ ID No: 2683 ATTTCCCCCAA TTTTGGGC AAAGC SEQ ID No: 2660 ATTTCCCAAAA SEQ ID No: 2684 ATTTCCCCCAA AC AAATC SEQ ID No: 2661 ATTTCCCAAAA SEQ ID No: 2685 ATTTCCCCCAA A GGGC AAATGGGC SEQ ID No: 2662 ATTTCCCAAAA SEQ ID No: 2686 ATTTCCCCCAA ATGCAAATTTGC SEQ ID No: 2663 ATTTCCCAAAA SEQ ID No: 2687 ATTTGTGGGC ATTTC SEQ ID No: 2688 ATTTGTTTC SEQ ID No: 2664 ATTTCCCAAAA SEQ ID No: 2689 ATTTGTTTTTGC ATTTGGGC SEQ ID No: 2690 ATTTGATGC SEQ ID No: 2665 ATTTCCCAAAAATTTTTGC SEQ ID No: 2691 ATTTGATTTGG SEQ ID No: 2666 ATTTCCCCCGG GCGC SEQ ID No: 2692 ATTTGATTTTTC SEQ ID No: 2667 ATTTCCCCCTG SEQ ID No: 2693 ATTTGAAAC C SEQ ID No: 2694 ATTTGAAAGGG SEQ ID No: 2668 ATTTCCCCCTTT CC SEQ ID No: 2695 ATTTGAAATTT SEQ ID No: 2669 ATTTCCCCCTTT CGGGC SEQ ID No: 2696 ATTTGAAATTT SEQ ID No: 2670 ATTTCCCCCTTT TTGC TTGC SEQ ID No: 2697 ATTTGAAAAAG SEQ ID No: 2671 ATTTCCCCCAG CC SEQ ID No: 2698 ATTTGAAAAAT SEQ ID No: 2672 ATTTCCCCCAT CC SEQ ID No: 2699 ATTTGAAAAAT SEQ ID No: 2673 ATTTCCCCCAT GGGC GGGC SEQ ID No: 2700 ATTTGAAAAAT SEQ ID No: 2674 ATTTCCCCCAT TTGC TTGC SEQ ID No: 2701 ATTTGAAAAAT SEQ ID No: 2675 ATTTCCCCCAT TTTTC TTTTC SEQ ID No: 2702 ATTTGAAAAAT SEQ ID No: 2676 ATTTCCCCCAT TTTTGGGCTTTTGGGCSEQ ID No: 2703 ATTTGCTGC -79- 182358171.1SEQ ID No: 2704 ATTTGCTTTTTC SEQ ID No: 2729 ATTTGCCCAAA SEQ ID No: 2705 ATTTGCTTTTTG TTTTTGC GGC SEQ ID No: 2730 ATTTGCCCAAA SEQ ID No: 2706 ATTTGCAGC AAGCSEQ ID No: 2707 ATTTGCATC SEQ ID No: 2731 ATTTGCCCAAA AATC SEQ ID No: 2708 ATTTGCATGGGSEQ ID No: 2732 ATTTGCCCAAA C AATGGGC SEQ ID No: 2709 ATTTGCATTTGSEQ ID No: 2733 ATTTGCCCAAA C AATTTGC SEQ ID No: 2710 ATTTGCAAATGSEQ ID No: 2734 ATTTGCCCAAA C AATTTTTC SEQ ID No: 2711 ATTTGCAAATTSEQ ID No: 2735 ATTTGCCCCCG TTTC C SEQ ID No: 2712 ATTTGCAAATTSEQ ID No: 2736 ATTTGCCCCCT TTTGGGC C SEQ ID No: 2713 ATTTGCAAAAASEQ ID No: 2737 ATTTGCCCCCT C GGGC SEQ ID No: 2714 ATTTGCAAAAASEQ ID No: 2738 ATTTGCCCCCT GGGC TTGC SEQ ID No: 2715 ATTTGCAAAAASEQ ID No: 2739 ATTTGCCCCCT TTTC TTTTC SEQ ID No: 2716 ATTTGCAAAAASEQ ID No: 2740 ATTTGCCCCCT TTTGGGC TTTTGGGC SEQ ID No: 2717 ATTTGCAAAAASEQ ID No: 2741 ATTTGCCCCCA TTTTTGC C SEQ ID No: 2718 ATTTGCCCGGGSEQ ID No: 2742 ATTTGCCCCCA C GGGC SEQ ID No: 2719 ATTTGCCCTTTSEQ ID No: 2743 ATTTGCCCCCA C TTTC SEQ ID No: 2720 ATTTGCCCTTTSEQ ID No: 2744 ATTTGCCCCCA GGGC TTTGGGC SEQ ID No: 2721 ATTTGCCCTTTTSEQ ID No: 2745 ATTTGCCCCCA TGC TTTTTGC SEQ ID No: 2722 ATTTGCCCATGSEQ ID No: 2746 ATTTGCCCCCA C AAGC SEQ ID No: 2723 ATTTGCCCATTSEQ ID No: 2747 ATTTGCCCCCA TTTC AATC SEQ ID No: 2724 ATTTGCCCATTSEQ ID No: 2748 ATTTGCCCCCA TTTGGGC AATGGGC SEQ ID No: 2725 ATTTGCCCAAASEQ ID No: 2749 ATTTGCCCCCA C AATTTGC SEQ ID No: 2726 ATTTGCCCAAASEQ ID No: 2750 ATTTGCCCCCA GGGC AATTTTTC SEQ ID No: 2727 ATTTGCCCAAASEQ ID No: 2751 ATTTGCCCCCA TTTC AAAAC SEQ ID No: 2728 ATTTGCCCAAASEQ ID No: 2752 ATTTGCCCCCATTTGGGCAAAAGGGC -80- 182358171.1SEQ ID No: 2753 ATTTGCCCCCA SEQ ID No: 2778 ATTTGGGCTTT AAAATGC TTGC SEQ ID No: 2754 ATTTGCCCCCA SEQ ID No: 2779 ATTTGGGCATG AAAATTTC C SEQ ID No: 2755 ATTTGGGTC SEQ ID No: 2780 ATTTGGGCATT SEQ ID No: 2756 ATTTGGGTTTG TGGGCC SEQ ID No: 2781 ATTTGGGCATT SEQ ID No: 2757 ATTTGGGTTTT TTTCTC SEQ ID No: 2782 ATTTGGGC AAA SEQ ID No: 2758 ATTTGGGTTTT CTGGGC SEQ ID No: 2783 ATTTGGGC AAA SEQ ID No: 2759 ATTTGGGAC GGGCSEQ ID No: 2760 ATTTGGGAGGG SEQ ID No: 2784 ATTTGGGC AAA C TTTC SEQ ID No: 2761 ATTTGGGATTT SEQ ID No: 2785 ATTTGGGC AAA C TTTTTGC SEQ ID No: 2762 ATTTGGGATTT SEQ ID No: 2786 ATTTGGGC AAA TTGC AAGC SEQ ID No: 2763 ATTTGGGAAAG SEQ ID No: 2787 ATTTGGGC AAA C AATC SEQ ID No: 2764 ATTTGGGAAAT SEQ ID No: 2788 ATTTGGGC AAA C AATGGGC SEQ ID No: 2765 ATTTGGGAAAT SEQ ID No: 2789 ATTTGGGC AAA GGGC AATTTGC SEQ ID No: 2766 ATTTGGGAAAT SEQ ID No: 2790 ATTTGGGC AAA TTGC AATTTTTC SEQ ID No: 2767 ATTTGGGAAAT SEQ ID No: 2791 ATTTGGGCCCT TTTTC C SEQ ID No: 2768 ATTTGGGAAAT SEQ ID No: 2792 ATTTGGGCCCT TTTTGGGC TTGC SEQ ID No: 2769 ATTTGGGAAAA SEQ ID No: 2793 ATTTGGGCCCT AC TTTTC SEQ ID No: 2770 ATTTGGGAAAA SEQ ID No: 2794 ATTTGGGCCCT AGGGC TTTTGGGC SEQ ID No: 2771 ATTTGGGAAAA SEQ ID No: 2795 ATTTGGGCCCA ATGC C SEQ ID No: 2772 ATTTGGGAAAA SEQ ID No: 2796 ATTTGGGCCCA ATTTC GGGC SEQ ID No: 2773 ATTTGGGAAAA SEQ ID No: 2797 ATTTGGGCCCA ATTTGGGC TTTC SEQ ID No: 2774 ATTTGGGAAAA SEQ ID No: 2798 ATTTGGGCCCA ATTTTTGC TTTTTGC SEQ ID No: 2775 ATTTGGGCGC SEQ ID No: 2799 ATTTGGGCCCA AAGC SEQ ID No: 2776 ATTTGGGCTGGSEQ ID No: 2800 ATTTGGGCCCA GC AATC SEQ ID No: 2777 ATTTGGGC TTTSEQ ID No: 2801 ATTTGGGCCCACAATGGGC -81- 182358171.1SEQ ID No: 2802 ATTTGGGCCCA SEQ ID No: 2827 ATTTTTATTTGC AATTTGC SEQ ID No: 2828ATTTTTATTTTTSEQ ID No: 2803 ATTTGGGCCCA C AATTTTTC SEQ ID No: 2829ATTTTTATTTTTSEQ ID No: 2804 ATTTGGGCCCA GGGC AAAAC SEQ ID No: 2830ATTTTTAAACSEQ ID No: 2805 ATTTGGGCCCA SEQ ID No: 2831 ATTTTTAAAGG AAAAGGGC GC SEQ ID No: 2806 ATTTGGGCCCA SEQ ID No: 2832ATTTTTAAATGAAAATGC C SEQ ID No: 2807 ATTTGGGCCCA SEQ ID No: 2833ATTTTTAAATTAAAATTTC TC SEQ ID No: 2808 ATTTGGGCCCC SEQ ID No: 2834ATTTTTAAATTCGGGC TGGGC SEQ ID No: 2809 ATTTGGGCCCC SEQ ID No: 2835ATTTTTAAATTCTGC TTTGC SEQ ID No: 2810 ATTTGGGCCCC SEQ ID No: 2836ATTTTTAAAAACTTTC GC SEQ ID No: 2811 ATTTGGGCCCC SEQ ID No: 2837ATTTTTAAAAACTTTGGGC TC SEQ ID No: 2812 ATTTGGGCCCC SEQ ID No: 2838ATTTTTAAAAACTTTTTGC TGGGC SEQ ID No: 2813 ATTTGGGCCCC SEQ ID No: 2839ATTTTTAAAAACAGC TTTGC SEQ ID No: 2814 ATTTGGGCCCC SEQ ID No: 2840 ATTTTTCGC CATC SEQ ID No: 2841ATTTTTCTCSEQ ID No: 2815 ATTTGGGCCCCCATGGGC SEQ ID No: 2842 ATTTTTCTGGG SEQ ID No: 2816 ATTTGGGCCCC C CATTTGC SEQ ID No: 2843 ATTTTTCTTTGC SEQ ID No: 2817 ATTTGGGCCCC SEQ ID No: 2844ATTTTTCTTTTTCATTTTTCACTTTTTSEQ ID SEQ ID No: 2845CTTTTTNo: 2818 ATTTGGGCCCCCAAAC GGG SEQ ID No: 2819 ATTTGGGCC SEQ ID No: 2846ATTTCTTCACCC CAAAGGGC SEQ ID No: 2847 ATTTTTCAGGG SEQ ID No: 2820 ATTTGGGCCCC C CAAATGC SEQ ID No: 2848 ATTTTTCATTTC SEQ ID No: 2821 ATTTGGGCCCC SEQ ID No: 2849ATTTTTCATTTGCAAATTTC GGC SEQ ID No: 2822 ATTTGGGCCCC SEQ ID No: 2850ATTTTTCATTTTCAAAAAGC TGC SEQ ID No: 2823 ATTTGGGCCCC SEQ ID No: 2851ATTTTTCAAAGCAAAAATC C SEQ ID No: 2824 ATTTTTAGC SEQ ID No: 2852ATTTTTCAAATSEQ ID No: 2825 ATTTTTATC CATTTTTCAAATSEQ ID No: 2826 ATTTTTATGGG SEQ ID No: 2853CGGGC-82- 182358171.1SEQ ID No: 2854 ATTTTTCAAAT SEQ ID No: 2878ATTTTTCCCAATTGCATTTTTGCSEQ ID No: 2855 ATTTTTCAAAT SEQ ID No: 2879ATTTTTCCCAATTTTC AAAGC SEQ ID No: 2856 ATTTTTCAAAT SEQ ID No: 2880ATTTTTCCCAATTTTGGGC AAATC SEQ ID No: 2857 ATTTTTCAAAA SEQ ID No: 2881ATTTTTCCCAAAC AAATGGGC SEQ ID No: 2858 ATTTTTCAAAA SEQ ID No: 2882ATTTTTCCCAAAGGGC AAATTTGC SEQ ID No: 2859 ATTTTTCAAAA SEQ ID No: 2883ATTTTTCCCCCATGC GC SEQ ID No: 2860 ATTTTTCAAAA SEQ ID No: 2884ATTTTTCCCCCTATTTC C SEQ ID No: 2861 ATTTTTCAAAA SEQ ID No: 2885ATTTTTCCCCCTATTTGGGC GGGC SEQ ID No: 28ATTTTTCCCCCT62 ATTTTTCCCGG SEQ ID No: 2886GATCTTTTCCCTGTATTGC SEQ ID No: 2863 SEQ ID No: 2887TTTTCCCCCCATTTTTCCAC SEQ ID No: 2864CTTTSEQ ID No: 2888ATTTTTCCCCCC AGGGC SEQ ID No: 2865ATTTTTCCCTTTSEQ ID No: 2889ATTTTTCCCCCGGGC ATGC SEQ ID No: 2866ATTTTTCCCTTTSEQ ID No: 2890ATTTTTCCCCCTTGC ATTTC SEQ ID No: 2867ATTTTTCCCAGSEQ ID No: 2891ATTTTTCCCCCCATTTTTCCCATAATTTTTTTGTGCGCCCCCSEQ ID No: 2868 SEQ ID No: 2892CATTTTTCCCATAAATTATGTC SEQ ID No: 2869 SEQ ID No: 2893TCCCCCGATGTGTCTTCCCATTAAATTATTTCTCCCCCSEQ ID No: 2870 SEQ ID No: 2894TGCAAATGGGCATTTTTCCCATTATTTTTCCCCCSEQ ID No: 2871 SEQ ID No: 2895TTTC AAATTTGCATTTTTCCCATTATTTTTGTCSEQ ID No: 2872 SEQ ID No: 2896ATTTTTGTTTGCTTTGGGC SEQ ID No: 2897ATTTTTCCCAAATTTTTGTTTTTSEQ ID No: 2873 SEQ ID No: 2898AC CATTTTTCCCAAATTTTTGTTTTTSEQ ID No: 2874 SEQ ID No: 2899 AGGGC GGGCATTTTTCCCAAATTTTTGACSEQ ID No: 2875 SEQ ID No: 2900ATTTTTGAGGGATGC SEQ ID No: 2901ATTTTTCCCAASEQ ID No: 2876CATTTTTGATTTCATTTC SEQ ID No: 2902ATTTTTCCCAASEQ ID No: 2877ATTTTTGATTTTSEQ ID No: 2903 ATTTGGGCTGC-83- 182358171.1SEQ ID No: 2904ATTTTTGAAAGSEQ ID No: 2928ATTTTTGCAAAC AATC SEQ ID No: 2905ATTTTTGAAATSEQ ID No: 2929ATTTTTGCAAAC AATGGGC SEQ ID No: 2906ATTTTTGAAATSEQ ID No: 2930ATTTTTGCAAAGGGC AATTTGC SEQ ID No: 2907ATTTTTGAAATSEQ ID No: 2931ATTTTTGCCCGTTGC C SEQ ID No: 2908ATTTTTGAAATSEQ ID No: 2932ATTTTTGCCCTTTTTC C SEQ ID No: 2909ATTTTTGAAATSEQ ID No: 2933ATTTTTGCCCTTTTTGGGC GGGC SEQ ID No: 2910ATTTTTGAAAASEQ ID No: 2934ATTTTTGCCCTTAC TGC SEQ ID No: 2911ATTTTTGAAAASEQ ID No: 2935ATTTTTGCCCTTA GGGC TTTC SEQ ID No: 2912ATTTTTGAAAASEQ ID No: 2936ATTTTTGCCCTTATGC TTTGGGC SEQ ID No: 2913ATTTTTGAAAASEQ ID No: 2937ATTTTTGCCCAAATTT SEQ ID No: 2914TTTTCTGAAAASEQ ID No: 2938ACTTTTTGCCCAATTTGGGC GGGC SEQ ID No: 2915ATTTTTGCGGGSEQ ID No: 2939ATTTTTGCCCAC TTTC SEQ ID No: 2916ATTTTTGCTTTCSEQ ID No: 2940ATTTTTGCCCAATTTTTGCTTTGTTTGGGC SEQ ID No: 2917ATTTTTGCCCAGGC SEQ ID No: 2941 SEQ ID No: 2918ATTTTTGCTTTTTTTTTGC TGC SEQ ID No: 2942ATTTTTGCCCASEQ ID No: 2919ATTTTTGCATGAAATTGTCTTC SEQ ID No: 2943GCCCAATTTTTGCATTTAATC SEQ ID No: 2920ATTTTTGCCCASEQ ID No: 2944 TTCATTTTTGCATTTAATGGGC SEQ ID No: 2921ATTTTTGCCCASEQ ID No: 2945 TTGGGCATTTTTGCAAAAATTTGC SEQ ID No: 2922ATTTTTGCCCASEQ ID No: 2946 CATTTTTGCAAAAATTTTTC SEQ ID No: 2923ATTTTTGCCCASEQ ID No: 2947 GGGCATTTTTGCAAAAAAAC SEQ ID No: 2924ATTTTTGCCCASEQ ID No: 2948 TTTCATTTTTGCAAAAAAAGGGC SEQ ID No: 2925ATTTTTGCCCASEQ ID No: 2949 TTTGGGCATTTTTGCAAAAAAATGC SEQ ID No: 2926ATTTTTGCCCASEQ ID No: 2950 TTTTTGCATTTTTGCAAAAAAATTTC SEQ ID No: 2927ATTTTTGCCCCSEQ ID No: 2951 AAGCCGGGC-84- 182358171.1SEQ ID No: 2952ATTTTTGCCCCSEQ ID No: 2976ATTTTTGGGAACTGC ATTTC SEQ ID No: 2953ATTTTTGCCCCSEQ ID No: 2977ATTTTTGGGAACTTTC ATTTGGGC SEQ ID No: 2954ATTTTTGCCCCSEQ ID No: 2978ATTTTTGGGAACATTTTTGCSATTTTTTGTTGGGCC EQ ID No: 2955CCCSEQ ID No: 2979ATTTTTGGGAACAATTGC AAAGC SEQ ID No: 2956TTTGCCCCSEQ ID No: 2980ATTTTTGGGAACATC AAATC SEQ ID No: 2957ATTTTTGCCCCSEQ ID No: 2981ATTTTTGGGAACATGGGC AAATGGGC SEQ ID No: 2958ATTTTTGCCCCSEQ ID No: 2982ATTTTTGGGAACATTTGCAAATTTGC SEQ ID No: 2959ATTTTTGCCCCSEQ ID No: 2983ATTTTTGGGCTCAATTATATC SEQ ID No: 2960TGCCCCACSEQ ID No: 2984TTTTTGGGCTCAAAGGGC TTGC SEQ ID No: 2961ATTTTTGCCCCSEQ ID No: 2985ATTTTTGGGCTCAAATGC TTTTC SEQ ID No: 2962ATTTTTGCCCCSEQ ID No: 2986ATTTTTGGGCTCAAATTTC TTTTGGGC SEQ ID No: 2963ATTTTTGGGTGSEQ ID No: 2987ATTTTTGGGCAC C SEQ ID No: 2964ATTTTTGGGTTSEQ ID No: 2988ATTTTTGGGCATC GGGC SEQ ID No: 2965ATTTTTGGGTTSEQ ID No: 2989ATTTTTGGGCATGGGC TTTC SEQ ID No: 2966ATTTTTGGGTTSEQ ID No: 2990ATTTTTGGGCATTTGC TTTTTGC SEQ ID No: 2967ATTTTTGGGAGSEQ ID No: 2991ATTTTTGGGCAC AAGC SEQ ID No: 2968ATTTTTGGGATSEQ ID No: 2992ATTTTTGGGCAC AATC SEQ ID No: 2969ATTTTTGGGATSEQ ID No: 2993ATTTTTGGGCAGGGC AATGGGC SEQ ID No: 2970ATTTTTGGGATSEQ ID No: 2994ATTTTTGGGCATTGC AATTTGC SEQ ID No: 2971ATTTTTGGGATSEQ ID No: 2995ATTTTTGGGCATTTTC AATTTTTC SEQ ID No: 2972ATTTTTGGGATSEQ ID No: 2996ATTTTTGGGCATTTTGGGC AAAAC SEQ ID No: 2973ATTTTTGGGAASEQ ID No: 2997ATTTTTGGGCAAATCTTTTGGGAAAAATTATATGTGGGGC SEQ ID No: 2974 SEQ ID No: 2998GCAAGGGC AAAATGC SEQ ID No: 2975ATTTTTGGGAASEQ ID No: 2999ATTTTTGGGCAATGCAAAATTTC -85- 182358171.1ATTTTTGGGCC ATTTTTGGGCCSEQ ID No: 3000 SEQ ID No: 3013CGGGC CAAATTTCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3001 SEQ ID No: 3014CTGC CAAAAAGCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3002 SEQ ID No: 3015CTTTCCAAAAATCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3003 SEQ ID No: 3016CTTTGGGC CCCGCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3004 SEQ ID No: 3017CTTTTTGC CCCTCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3005 SEQ ID No: 3018CAGC CCCTGGGCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3006 SEQ ID No: 3019CATC CCCTTTGCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3007 SEQ ID No: 3020CATGGGC CCCACATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3008 SEQ ID No: 3021CATTTGC CCCAGGGCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3009 SEQ ID No: 3022CATTTTTC CCCATGCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3010 SEQ ID No: 3023CAAAC CCCATTTCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3011 SEQ ID No: 3024CAAAGGGC CCCAAAGCATTTTTGGGCCATTTTTGGGCCSEQ ID No: 3012 SEQ ID No: 3025CAAATGCCCCAAATC

[0093] Table 6: Barcode sequences, 6 flows, ending in TSEQ ID No: Sequence 5’-3’ SEQ ID No: 3038 GTGGGCCCCCA SEQ ID No: 3026 GTCAAAAAT TSEQ ID No: 3027 GTCCCAAAT SEQ ID No: 3039 GTGGGCCCCCA AAAAT SEQ ID No: 3028 GTCCCCCATSEQ ID No: 3040 GTTTAAAAAT SEQ ID No: 3029 GTCCCCCAAAASEQ ID No: 3041 GTTTCAAAT AT SEQ ID No: 3030 GTGAAAAAT SEQ ID No: 3042 GTTTCCCAT SEQ ID No: 3031 GTGCCCAAAAA SEQ ID No: 3043 GTTTCCCAAAA T AT SEQ ID No: 3032 GTGCCCCCT SEQ ID No: 3044 GTTTCCCCCT SEQ ID No: 3033 GTGCCCCCAAA SEQ ID No: 3045 GTTTCCCCCAA T AT SEQ ID No: 3034 GTGGGAAAT SEQ ID No: 3046 GTTTGAAAT SEQ ID No: 3035 GTGGGCAAAA SEQ ID No: 3047 GTTTGCAAAAA AT T SEQ ID No: 3036 GTGGGCCCT SEQ ID No: 3048 GTTTGCCCT SEQ ID No: 3037 GTGGGCCCAAA SEQ ID No: 3049 GTTTGCCCAAATT-86- 182358171.1SEQ ID No: 3050 GTTTGCCCCCA SEQ ID No: 3077 GTTTTTGGGCA T AAAAT SEQ ID No: 3051 GTTTGCCCCCA SEQ ID No: 3078 GTTTTTGGGCC AAAAT CT SEQ ID No: 3052 GTTTGGGAT SEQ ID No: 3079 GTTTTTGGGCC SEQ ID No: 3053 GTTTGGGAAAA CAAATAT SEQ ID No: 3080 GTTTTTGGGCC SEQ ID No: 3054 GTTTGGGCT CCCATSEQ ID No: 3055 GTTTGGGCAAA SEQ ID No: 3081 GACAAAAAT T SEQ ID No: 3082 GACCCAAAT SEQ ID No: 3056 GTTTGGGCCCA SEQ ID No: 3083 GACCCCCAT T SEQ ID No: 3084 GACCCCCAAAA SEQ ID No: 3057 GTTTGGGCCCA AT AAAAT SEQ ID No: 3085 GAGAAAAAT SEQ ID No: 3058 GTTTGGGCCCC SEQ ID No: 3086 GAGCCCAAAA CT AT SEQ ID No: 3059 GTTTGGGCCCC SEQ ID No: 3087 GAGCCCCCT CAAAT SEQ ID No: 3088 GAGCCCCCAAA SEQ ID No: 3060 GTTTTTAAATT SEQ ID No: 3061 GTTTTTCAT SEQ ID No: 3089 GAGGGAAAT SEQ ID No: 3062 GTTTTTCAAAA SEQ ID No: 3090 GAGGGCAAAA AT AT SEQ ID No: 3063 GTTTTTCCCT SEQ ID No: 3091 GAGGGCCCT SEQ ID No: 3064 GTTTTTCCCAA SEQ ID No: 3092 GAGGGCCCAA AT AT SEQ ID No: 3065 GTTTTTCCCCC SEQ ID No: 3093 GAGGGCCCCCA AT T SEQ ID No: 3066 GTTTTTGAT SEQ ID No: 3094 GAGGGCCCCCA SEQ ID No: 3067 GTTTTTGAAAA AAAAT AT SEQ ID No: 3095 GATAAAAAT SEQ ID No: 3068 GTTTTTGCT SEQ ID No: 3096 GATCCCAAAAA SEQ ID No: 3069 GTTTTTGCAAA TT SEQ ID No: 3097 GATCCCCCT SEQ ID No: 3070 GTTTTTGCCCA SEQ ID No: 3098 GATCCCCCAAA T T SEQ ID No: 3071 GTTTTTGCCCA SEQ ID No: 3099 GATGCAAAT AAAAT SEQ ID No: 3100 GATGCCCAT SEQ ID No: 3072 GTTTTTGCCCCCT SEQ ID No: 3101 GATGCCCCCAA SEQ ID No: 3073 AAAT GTTTTTGCCCC CAAAT SEQ ID No: 3102 GATGGGAAAA SEQ ID No: 3074 GTTTTTGGGT ATSEQ ID No: 3103 GATGGGCAT SEQ ID No: 3075 GTTTTTGGGAAAT SEQ ID No: 3104 GATGGGCCCAA AAAT SEQ ID No: 3076 GTTTTTGGGCASEQ ID No: 3105 GATGGGCCCCCTT-87- 182358171.1SEQ ID No: 3106 GATGGGCCCCC SEQ ID No: 3133 GATTTTTGT AAAT SEQ ID No: 3134 GATTTTTGAAA SEQ ID No: 3107 GATTTAAAT TSEQ ID No: 3108 GATTTCAAAAA SEQ ID No: 3135 GATTTTTGCAA T AAAT SEQ ID No: 3109 GATTTCCCT SEQ ID No: 3136 GATTTTTGCCC SEQ ID No: 3110 GATTTCCCAAA TT SEQ ID No: 3137 GATTTTTGCCC SEQ ID No: 3111 GATTTCCCCCA AAATT SEQ ID No: 3138 GATTTTTGCCC SEQ ID No: 3112 GATTTCCCCCA CCAT AAAAT SEQ ID No: 3139 GATTTTTGGGA SEQ ID No: 3113 GATTTGAAAAA TT SEQ ID No: 3140 GATTTTTGGGA SEQ ID No: 3114 GATTTGCAT AAAAT SEQ ID No: 3115 GATTTGCCCAA SEQ ID No: 3141 GATTTTTGGGC AAAT T SEQ ID No: 3116 GATTTGCCCCC SEQ ID No: 3142 GATTTTTGGGC T AAAT SEQ ID No: 3117 GATTTGCCCCC SEQ ID No: 3143 GATTTTTGGGC AAAT CCAT SEQ ID No: 3118 GATTTGGGT SEQ ID No: 3144 GATTTTTGGGC CCAAAAAT SEQ ID No: 3119 GATTTGGGAAASEQ ID No: 3145 GATTTTTGGGC T CCCCT SEQ ID No: 3120 GATTTGGGCAASEQ ID No: 3146 GATTTTTGGGC AAAT CCCCAAAT SEQ ID No: 3121 GATTTGGGCCCSEQ ID No: 3147 GAAACAAAT T SEQ ID No: 3122 GATTTGGGCCC SEQ ID No: 3148 GAAACCCAT AAAT SEQ ID No: 3149 GAAACCCAAA SEQ ID No: 3123 GATTTGGGCCC AATCCAT SEQ ID No: 3150 GAAACCCCCT SEQ ID No: 3124 GATTTGGGCCC SEQ ID No: 3151 GAAACCCCCAA CCAAAAAT AT SEQ ID No: 3125 GATTTTTAT SEQ ID No: 3152 GAAAGAAAT SEQ ID No: 3126 GATTTTTAAAA SEQ ID No: 3153 GAAAGCAAAA AT AT SEQ ID No: 3127 GATTTTTCT SEQ ID No: 3154 GAAAGCCCT SEQ ID No: 3128 GATTTTTCAAA SEQ ID No: 3155 GAAAGCCCAA T AT SEQ ID No: 3129 GATTTTTCCCA SEQ ID No: 3156 GAAAGCCCCCA T T SEQ ID No: 3130 GATTTTTCCCA SEQ ID No: 3157 GAAAGCCCCCA AAAAT AAAAT SEQ ID No: 3131 GATTTTTCCCC SEQ ID No: 3158 GAAAGGGAT CT SEQ ID No: 3159 GAAAGGGAAA SEQ ID No: 3132 GATTTTTCCCCAATCAAAT-88- 182358171.1SEQ ID No: 3160 GAAAGGGCT SEQ ID No: 3187 GAAATTTCAAA SEQ ID No: 3161 GAAAGGGCAA TAT SEQ ID No: 3188 GAAATTTCCCA SEQ ID No: 3162 GAAAGGGCCC TAT SEQ ID No: 3189 GAAATTTCCCA SEQ ID No: 3163 GAAAGGGCCC AAAAT AAAAAT SEQ ID No: 3190 GAAATTTCCCC SEQ ID No: 3164 GAAAGGGCCCC CTCT SEQ ID No: 3191 GAAATTTCCCC SEQ ID No: 3165 GAAAGGGCCCC CAAAT CAAAT SEQ ID No: 3192 GAAATTTGT SEQ ID No: 3166 GAAATAAAT SEQ ID No: 3193 GAAATTTGAAA SEQ ID No: 3167 GAAATCAAAA TAT SEQ ID No: 3194 GAAATTTGCAA SEQ ID No: 3168 GAAATCCCT AAATSEQ ID No: 3169 GAAATCCCAAA SEQ ID No: 3195 GAAATTTGCCC T T SEQ ID No: 3170 GAAATCCCCCA SEQ ID No: 3196 GAAATTTGCCC T AAAT SEQ ID No: 3171 GAAATCCCCCA SEQ ID No: 3197 GAAATTTGCCC AAAAT CCAT SEQ ID No: 3172 GAAATGAAAA SEQ ID No: 3198 GAAATTTGCCC AT CCAAAAAT SEQ ID No: 3173 GAAATGCAT SEQ ID No: 3199 GAAATTTGGGA T SEQ ID No: 3174 GAAATGCCCAASEQ ID No: 3200 GAAATTTGGGA AAAT AAAAT SEQ ID No: 3175 GAAATGCCCCCSEQ ID No: 3201 GAAATTTGGGC T T SEQ ID No: 3176 GAAATGCCCCCSEQ ID No: 3202 GAAATTTGGGC AAAT AAAT SEQ ID No: 3177 GAAATGGGTSEQ ID No: 3203 GAAATTTGGGC SEQ ID No: 3178 GAAATGGGAA CCATAT SEQ ID No: 3204 GAAATTTGGGC SEQ ID No: 3179 GAAATGGGCA CCAAAAAT AAAAT SEQ ID No: 3205 GAAATTTGGGC SEQ ID No: 3180 GAAATGGGCCC CCCCTT SEQ ID No: 3206 GAAATTTGGGC SEQ ID No: 3181 GAAATGGGCCC CCCCAAAT AAAT SEQ ID No: 3207 GAAATTTTTAA SEQ ID No: 3182 GAAATGGGCCC ATCCAT SEQ ID No: 3208 GAAATTTTTCA SEQ ID No: 3183 GAAATGGGCCC TCC AAAAAT SEQ ID No: 3209 GAAATTTTTCA SEQ ID No: 3184 GAAATTTAT AAAAT SEQ ID No: 3185 GAAATTTAAAA SEQ ID No: 3210 GAAATTTTTCC ATCTSEQ ID No: 3186 GAAATTTCT-89- 182358171.1SEQ ID No: 3211 GAAATTTTTCC SEQ ID No: 3237 GAAAAAGCCC CAAAT AT SEQ ID No: 3212 GAAATTTTTCC SEQ ID No: 3238 GAAAAAGCCC CCCAT AAAAAT SEQ ID No: 3213 GAAATTTTTGA SEQ ID No: 3239 GAAAAAGCCCC T CT SEQ ID No: 3214 GAAATTTTTGA SEQ ID No: 3240 GAAAAAGCCCC AAAAT CAAAT SEQ ID No: 3215 GAAATTTTTGC SEQ ID No: 3241 GAAAAAGGGT T SEQ ID No: 3242 GAAAAAGGGA SEQ ID No: 3216 GAAATTTTTGC AATAAAT SEQ ID No: 3243 GAAAAAGGGC SEQ ID No: 3217 GAAATTTTTGC ATCCAT SEQ ID No: 3244 GAAAAAGGGC SEQ ID No: 3218 GAAATTTTTGC AAAAAT CCAAAAAT SEQ ID No: 3245 GAAAAAGGGC SEQ ID No: 3219 GAAATTTTTGC CCT CCCCT SEQ ID No: 3246 GAAAAAGGGC SEQ ID No: 3220 GAAATTTTTGC CCAAAT CCCCAAAT SEQ ID No: 3247 GAAAAAGGGC SEQ ID No: 3221 GAAATTTTTGG CCCCAT GT SEQ ID No: 3248 GAAAAATAT SEQ ID No: 3222 GAAATTTTTGG SEQ ID No: 3249 GAAAAATAAA GAAAT AAT SEQ ID No: 3223 GAAATTTTTGG SEQ ID No: 3250 GAAAAATCT GCAT SEQ ID No: 3251 GAAAAATCAA SEQ ID No: 3224 GAAATTTTTGGAT GCAAAAAT SEQ ID No: 3252 GAAAAATCCCA SEQ ID No: 3225 GAAATTTTTGGT GCCCT SEQ ID No: 3253 GAAAAATCCCA SEQ ID No: 3226 GAAATTTTTGGAAAAT GCCCAAAT SEQ ID No: 3254 GAAAAATCCCC SEQ ID No: 3227 GAAATTTTTGGCT GCCCCCAT SEQ ID No: 3255 GAAAAATCCCC SEQ ID No: 3228 GAAAAACATCAAAT SEQ ID No: 3229 GAAAAACAAA SEQ ID No: 3256 GAAAAATGT AAT SEQ ID No: 3257 GAAAAATGAA SEQ ID No: 3230 GAAAAACCCTAT SEQ ID No: 3231 GAAAAACCCA SEQ ID No: 3258 GAAAAATGCA AAT AAAAT SEQ ID No: 3232 GAAAAACCCCC SEQ ID No: 3259 GAAAAATGCCC AT T SEQ ID No: 3233 GAAAAAGAT SEQ ID No: 3260 GAAAAATGCCC SEQ ID No: 3234 GAAAAAGAAA AAATAAT SEQ ID No: 3261 GAAAAATGCCC SEQ ID No: 3235 GAAAAAGCT CCATSEQ ID No: 3236 GAAAAAGCAA SEQ ID No: 3262 GAAAAATGGGATAT-90- 182358171.1SEQ ID No: 3263 GAAAAATGGG SEQ ID No: 3287 GAAAAATTTGG AAAAAT GC AAAAAT SEQ ID No: 3264 GAAAAATGGG SEQ ID No: 3288 GAAAAATTTGG CT GCCCT SEQ ID No: 3265 GAAAAATGGG SEQ ID No: 3289 GAAAAATTTGG CAAAT GCCCAAAT SEQ ID No: 3266 GAAAAATGGG SEQ ID No: 3290 GAAAAATTTGG CCCAT GCCCCCAT SEQ ID No: 3267 GAAAAATGGG SEQ ID No: 3291 GAAAAATTTTT CCC AAAAAT AT SEQ ID No: 3268 GAAAAATGGG SEQ ID No: 3292 GAAAAATTTTT CCCCCT CT SEQ ID No: 3269 GAAAAATGGG SEQ ID No: 3293 GAAAAATTTTT CCCCCAAAT CAAAT SEQ ID No: 3270 GAAAAATTTAA SEQ ID No: 3294 GAAAAATTTTT AT CCCAT SEQ ID No: 3271 GAAAAATTTCA SEQ ID No: 3295 GAAAAATTTTT T GT SEQ ID No: 3272 GAAAAATTTCA SEQ ID No: 3296 GAAAAATTTTT AAAAT GAAAT SEQ ID No: 3273 GAAAAATTTCC SEQ ID No: 3297 GAAAAATTTTT CT GCAT SEQ ID No: 3274 GAAAAATTTCC SEQ ID No: 3298 GAAAAATTTTT CAAAT GCCCT SEQ ID No: 3275 GAAAAATTTCC SEQ ID No: 3299 GAAAAATTTTT CCCAT GCCCAAAT SEQ ID No: 3276 GAAAAATTTGA SEQ ID No: 3300 GAAAAATTTTT T GGGAT SEQ ID No: 3277 GAAAAATTTGA SEQ ID No: 3301 GAAAAATTTTT AAAAT GGGCT SEQ ID No: 3278 GAAAAATTTGC SEQ ID No: 3302 GAAAAATTTTT T GGGCAAAT SEQ ID No: 3279 GAAAAATTTGC SEQ ID No: 3303 GAAAAATTTTT AAAT GGGCCCAT SEQ ID No: 3280 GAAAAATTTGC SEQ ID No: 3304 GCGAAAAAT CCAT SEQ ID No: 3305 GCGCCCAAAT SEQ ID No: 3281 GAAAAATTTGC SEQ ID No: 3306 GCGCCCCCT CCAAAAAT SEQ ID No: 3307 GCGCCCCCAAA SEQ ID No: 3282 GAAAAATTTGCAAT CCCCT SEQ ID No: 3308 GCGGGAAAT SEQ ID No: 3283 GAAAAATTTGCCCCCAAAT SEQ ID No: 3309 GCGGGCAAAA AT SEQ ID No: 3284 GAAAAATTTGGGT SEQ ID No: 3310 GCGGGCCCT SEQ ID No: 3285 GAAAAATTTGG SEQ ID No: 3311 GCGGGCCCCCA GAAAT T SEQ ID No: 3286 GAAAAATTTGG SEQ ID No: 3312 GCTAAAAATGCAT SEQ ID No: 3313 GCTCCCAAAAAT182358171.1SEQ ID No: 3314 GCTCCCCCT SEQ ID No: 3342 GCTTTTTAAAA SEQ ID No: 3315 GCTCCCCCAAA ATT SEQ ID No: 3343 GCTTTTTCT SEQ ID No: 3316 GCTGCAAAT SEQ ID No: 3344 GCTTTTTCAAA SEQ ID No: 3317 GCTGCCCAT TSEQ ID No: 3318 GCTGGGAAAA SEQ ID No: 3345 GCTTTTTCCCA AT T SEQ ID No: 3319 GCTGGGCAT SEQ ID No: 3346 GCTTTTTCCCA AAAAT SEQ ID No: 3320 GCTGGGCCCAASEQ ID No: 3347 GCTTTTTCCCC AAAT CT SEQ ID No: 3321 GCTGGGCCCCCSEQ ID No: 3348 GCTTTTTCCCC T CAAAT SEQ ID No: 3322 GCTGGGCCCCCSEQ ID No: 3349 GCTTTTTGT AAAT SEQ ID No: 3323 GCTTTAAAT SEQ ID No: 3350 GCTTTTTGAAA T SEQ ID No: 3324 GCTTTCAAAAASEQ ID No: 3351 GCTTTTTGCAA T AAAT SEQ ID No: 3325 GCTTTCCCTSEQ ID No: 3352 GCTTTTTGCCC SEQ ID No: 3326 GCTTTCCCAAA TT SEQ ID No: 3353 GCTTTTTGCCC SEQ ID No: 3327 GCTTTCCCCCA AAATT SEQ ID No: 3354 GCTTTTTGCCC SEQ ID No: 3328 GCTTTCCCCCA CCAT AAAAT SEQ ID No: 3355 GCTTTTTGGGA SEQ ID No: 3329 GCTTTGAAAAA TT SEQ ID No: 3356 GCTTTTTGGGA SEQ ID No: 3330 GCTTTGCAT AAAAT SEQ ID No: 3331 GCTTTGCCCAA SEQ ID No: 3357 GCTTTTTGGGC AAAT T SEQ ID No: 3332 GCTTTGCCCCC SEQ ID No: 3358 GCTTTTTGGGC T AAAT SEQ ID No: 3333 GCTTTGCCCCC SEQ ID No: 3359 GCTTTTTGGGC AAAT CCAT SEQ ID No: 3334 GCTTTGGGT SEQ ID No: 3360 GCTTTTTGGGC SEQ ID No: 3335 GCTTTGGGAAA CCAAAAAT T SEQ ID No: 3361 GCTTTTTGGGC SEQ ID No: 3336 GCTTTGGGCAA CCCCT AAAT SEQ ID No: 3362 GCTTTTTGGGC SEQ ID No: 3337 GCTTTGGGCCC CCCCAAAT T SEQ ID No: 3363 GCACCCAAAAA SEQ ID No: 3338 GCTTTGGGCCC TAAAT SEQ ID No: 3364 GCACCCCCT SEQ ID No: 3339 GCTTTGGGCCC SEQ ID No: 3365 GCACCCCCAAA CCAT T SEQ ID No: 3340 GCTTTGGGCCC SEQ ID No: 3366 GCAGCAAAT CCAAAAAT SEQ ID No: 3367 GCAGCCCAT SEQ ID No: 3341 GCTTTTTAT-92- 182358171.1SEQ ID No: 3368 GCAGGGAAAA SEQ ID No: 3396 GCATTTGGGAA AT AAAT SEQ ID No: 3369 GCAGGGCAT SEQ ID No: 3397 GCATTTGGGCA SEQ ID No: 3370 GCAGGGCCCAA TAAAT SEQ ID No: 3398 GCATTTGGGCC SEQ ID No: 3371 GCAGGGCCCCCCAAAAAT T SEQ ID No: 3399 GCATTTGGGCC SEQ ID No: 3372 GCAGGGCCCCC CCCT AAAT SEQ ID No: 3400 GCATTTGGGCC SEQ ID No: 3373 GCATCAAAT CCCAAAT SEQ ID No: 3374 GCATCCCAT SEQ ID No: 3401 GCATTTTTAAA T SEQ ID No: 3375 GCATCCCCCAASEQ ID No: 3402 GCATTTTTCAA AAAT AAAT SEQ ID No: 3376 GCATGAAATSEQ ID No: 3403 GCATTTTTCCC SEQ ID No: 3377 GCATGCAAAAA TT SEQ ID No: 3404 GCATTTTTCCC SEQ ID No: 3378 GCATGCCCT AAATSEQ ID No: 3379 GCATGCCCAAA SEQ ID No: 3405 GCATTTTTCCC T CCAT SEQ ID No: 3380 GCATGCCCCCA SEQ ID No: 3406 GCATTTTTGAA T AAAT SEQ ID No: 3381 GCATGGGAT SEQ ID No: 3407 GCATTTTTGCA SEQ ID No: 3382 GCATGGGCT TSEQ ID No: 3383 GCATGGGCAAA SEQ ID No: 3408 GCATTTTTGCC T CAAAAAT SEQ ID No: 3384 GCATGGGCCCA SEQ ID No: 3409 GCATTTTTGCC T CCCT SEQ ID No: 3385 GCATGGGCCCC SEQ ID No: 3410 GCATTTTTGCCCAAAAAT CCCAAAT SEQ ID No: 3386 GCATTTAAAAA SEQ ID No: 3411 GCATTTTTGGG T T SEQ ID No: 3387 GCATTTCAT SEQ ID No: 3412 GCATTTTTGGG SEQ ID No: 3388 GCATTTCCCAA AAAT AAAT SEQ ID No: 3413 GCATTTTTGGG SEQ ID No: 3389 GCATTTCCCCCCAAAAAT T SEQ ID No: 3414 GCATTTTTGGG SEQ ID No: 3390 GCATTTCCCCC CCCT AAAT SEQ ID No: 3415 GCATTTTTGGG SEQ ID No: 3391 GCATTTGAT CCCAAAT SEQ ID No: 3392 GCATTTGCT SEQ ID No: 3416 GCATTTTTGGG CCCCCAT SEQ ID No: 3393 GCATTTGCAAASEQ ID No: 3417 GCAAACAAAA T AT SEQ ID No: 3394 GCATTTGCCCASEQ ID No: 3418 GCAAACCCT T SEQ ID No: 3395 GCATTTGCCCC SEQ ID No: 3419 GCAAACCCAAATCAAAAAT-93- 182358171.1SEQ ID No: 3420 GCAAACCCCCA SEQ ID No: 3446 GCAAATGGGCC T CAAAAAT SEQ ID No: 3421 GCAAACCCCCA SEQ ID No: 3447 GCAAATGGGCC AAAAT CCCT SEQ ID No: 3422 GCAAAGAAAA SEQ ID No: 3448 GCAAATGGGCC AT CCCAAAT SEQ ID No: 3423 GCAAAGCAT SEQ ID No: 3449 GCAAATTTAAA SEQ ID No: 3424 GCAAAGCCCAA TAAAT SEQ ID No: 3450 GCAAATTTCAA SEQ ID No: 3425 GCAAAGCCCCC AAATT SEQ ID No: 3451 GCAAATTTCCC SEQ ID No: 3426 GCAAAGCCCCC TAAAT SEQ ID No: 3452 GCAAATTTCCC SEQ ID No: 3427 GCAAAGGGT AAATSEQ ID No: 3428 GCAAAGGGAA SEQ ID No: 3453 GCAAATTTCCC AT CCAT SEQ ID No: 3429 GCAAAGGGCA SEQ ID No: 3454 GCAAATTTCCC AAAAT CCAAAAAT SEQ ID No: 3430 GCAAAGGGCCC SEQ ID No: 3455 GCAAATTTGAA T AAAT SEQ ID No: 3431 GCAAAGGGCCC SEQ ID No: 3456 GCAAATTTGCA AAAT T SEQ ID No: 3432 GCAAAGGGCCC SEQ ID No: 3457 GCAAATTTGCC CCAT CAAAAAT SEQ ID No: 3433 GCAAAGGGCCC SEQ ID No: 3458 GCAAATTTGCC CCAAAAAT CCCT SEQ ID No: 3434 GCAAATAAAA SEQ ID No: 3459 GCAAATTTGCC AT CCCAAAT SEQ ID No: 3435 GCAAATCAT SEQ ID No: 3460 GCAAATTTGGG T SEQ ID No: 3436 GCAAATCCCAASEQ ID No: 3461 GCAAATTTGGG AAAT AAAT SEQ ID No: 3437 GCAAATCCCCCSEQ ID No: 3462 GCAAATTTGGG T CAAAAAT SEQ ID No: 3438 GCAAATCCCCCSEQ ID No: 3463 GCAAATTTGGG AAAT CCCT SEQ ID No: 3439 GCAAATGATSEQ ID No: 3464 GCAAATTTGGG SEQ ID No: 3440 GCAAATGCT CCCAAAT SEQ ID No: 3441 GCAAATGCAAA SEQ ID No: 3465 GCAAATTTGGG T CCCCCAT SEQ ID No: 3442 GCAAATGCCCA SEQ ID No: 3466 GCAAATTTTTA T T SEQ ID No: 3443 GCAAATGCCCC SEQ ID No: 3467 GCAAATTTTTA CAAAAAT AAAAT SEQ ID No: 3444 GCAAATGGGA SEQ ID No: 3468 GCAAATTTTTC AAAAT T SEQ ID No: 3445 GCAAATGGGCA SEQ ID No: 3469 GCAAATTTTTCTAAAT-94- 182358171.1SEQ ID No: 3470 GCAAATTTTTC SEQ ID No: 3495 GCAAAAAGCCC CCAT T SEQ ID No: 3471 GCAAATTTTTC SEQ ID No: 3496 GCAAAAAGCCC CCAAAAAT AAAT SEQ ID No: 3472 GCAAATTTTTC SEQ ID No: 3497 GCAAAAAGCCC CCCCT CCAT SEQ ID No: 3473 GCAAATTTTTC SEQ ID No: 3498 GCAAAAAGGG CCCCAAAT AT SEQ ID No: 3474 GCAAATTTTTG SEQ ID No: 3499 GCAAAAAGGG T AAAAAT SEQ ID No: 3475 GCAAATTTTTG SEQ ID No: 3500 GCAAAAAGGG AAAT CT SEQ ID No: 3476 GCAAATTTTTG SEQ ID No: 3501 GCAAAAAGGG CAAAAAT CAAAT SEQ ID No: 3477 GCAAATTTTTG SEQ ID No: 3502 GCAAAAAGGG CCCT CCCAT SEQ ID No: 3478 GCAAATTTTTG SEQ ID No: 3503 GCAAAAAGGG CCCAAAT CCCAAAAAT SEQ ID No: 3479 GCAAATTTTTG SEQ ID No: 3504 GCAAAAAGGG CCCCCAT CCCCCT SEQ ID No: 3480 GCAAATTTTTG SEQ ID No: 3505 GCAAAAAGGG GGAT CCCCCAAAT SEQ ID No: 3481 GCAAATTTTTG SEQ ID No: 3506 GCAAAAATAA GGAAAAAT AT SEQ ID No: 3482 GCAAATTTTTG SEQ ID No: 3507 GCAAAAATCAA GGCT AAAT SEQ ID No: 3483 GCAAATTTTTG SEQ ID No: 3508 GCAAAAATCCC GGCAAAT T SEQ ID No: 3484 GCAAATTTTTG SEQ ID No: 3509 GCAAAAATCCC GGCCCAT AAAT SEQ ID No: 3485 GCAAATTTTTG SEQ ID No: 3510 GCAAAAATCCC GGCCCCCT CCAT SEQ ID No: 3486 GCAAAAACT SEQ ID No: 3511 GCAAAAATGA SEQ ID No: 3487 GCAAAAACAA AAAATAT SEQ ID No: 3512 GCAAAAATGCA SEQ ID No: 3488 GCAAAAACCCA TT SEQ ID No: 3513 GCAAAAATGCC SEQ ID No: 3489 GCAAAAACCCA CAAAAAT AAAAT SEQ ID No: 3514 GCAAAAATGCC SEQ ID No: 3490 GCAAAAACCCC CCCTCT SEQ ID No: 3515 GCAAAAATGCC SEQ ID No: 3491 GCAAAAACCCC CCCAAAT CAAAT SEQ ID No: 3516 GCAAAAATGG SEQ ID No: 3492 GCAAAAAGT GTSEQ ID No: 3493 GCAAAAAGAA SEQ ID No: 3517 GCAAAAATGG AT GAAAT SEQ ID No: 3494 GCAAAAAGCA SEQ ID No: 3518 GCAAAAATGG GC AAAAATAAAAT-95- 182358171.1SEQ ID No: 3519 GCAAAAATGG SEQ ID No: 3543 GCAAAAATTTT GCCCT TCAT SEQ ID No: 3520 GCAAAAATGG SEQ ID No: 3544 GCAAAAATTTT GCCCAAAT TCCCT SEQ ID No: 3521 GCAAAAATGG SEQ ID No: 3545 GCAAAAATTTT GCCCCCAT TCCCCAAAT SEQ ID No: 3522 GCAAAAATTTA SEQ ID No: 3546 GCAAAAATTTT T TGAT SEQ ID No: 3523 GCAAAAATTTA SEQ ID No: 3547 GCAAAAATTTT AAAAT TGCT SEQ ID No: 3524 GCAAAAATTTC SEQ ID No: 3548 GCAAAAATTTT T TGCAAAT SEQ ID No: 3525 GCAAAAATTTC SEQ ID No: 3549 GCAAAAATTTT AAAT TGCCCAT SEQ ID No: 3526 GCAAAAATTTC SEQ ID No: 3550 GCAAAAATTTT CCAT TGGGT SEQ ID No: 3527 GCAAAAATTTC SEQ ID No: 3551 GCAAAAATTTT CCAAAAAT TGGGAAAT SEQ ID No: 3528 GCAAAAATTTC SEQ ID No: 3552 GCAAAAATTTT CCCCT TGGGCAT SEQ ID No: 3529 GCAAAAATTTC SEQ ID No: 3553 GCAAAAATTTT CCCCAAAT TGGGCCCT SEQ ID No: 3530 GCAAAAATTTG SEQ ID No: 3554 GCCCGAAAT T SEQ ID No: 3555 GCCCGCAAAAA SEQ ID No: 3531 GCAAAAATTTG TAAAT SEQ ID No: 3556 GCCCGCCCT SEQ ID No: 3532 GCAAAAATTTG SEQ ID No: 3557 GCCCGCCCCCA CAAAAAT T SEQ ID No: 3533 GCAAAAATTTG SEQ ID No: 3558 GCCCGGGAT CCCT SEQ ID No: 3559 GCCCGGGAAA SEQ ID No: 3534 GCAAAAATTTGAAT CCCAAAT SEQ ID No: 3560 GCCCGGGCT SEQ ID No: 3535 GCAAAAATTTGCCCCCAT SEQ ID No: 3561 GCCCGGGCAAA T SEQ ID No: 3536 GCAAAAATTTGGGAT SEQ ID No: 3562 GCCCGGGCCCA T SEQ ID No: 3537 GCAAAAATTTGGGAAAAAT SEQ ID No: 3563 GCCCGGGCCCA AAAAT SEQ ID No: 3538 GCAAAAATTTGGGCT SEQ ID No: 3564 GCCCGGGCCCC CT SEQ ID No: 3539 GCAAAAATTTGGGCAAAT SEQ ID No: 3565 GCCCGGGCCCC CAAAT SEQ ID No: 3540 GCAAAAATTTGGGCCCAT SEQ ID No: 3566 GCCCTAAAT SEQ ID No: 3541 GCAAAAATTTG SEQ ID No: 3567 GCCCTCAAAAA GGCCCCCT T SEQ ID No: 3542 GCAAAAATTTT SEQ ID No: 3568 GCCCTCCCTTAAAT SEQ ID No: 3569 GCCCTCCCAAAT182358171.1SEQ ID No: 3570 GCCCTCCCCCA SEQ ID No: 3596 GCCCTTTGCCC T AAAT SEQ ID No: 3571 GCCCTCCCCCA SEQ ID No: 3597 GCCCTTTGCCC AAAAT CCAT SEQ ID No: 3572 GCCCTGAAAAA SEQ ID No: 3598 GCCCTTTGCCC T CCAAAAAT SEQ ID No: 3573 GCCCTGCAT SEQ ID No: 3599 GCCCTTTGGGA SEQ ID No: 3574 GCCCTGCCCAA TAAAT SEQ ID No: 3600 GCCCTTTGGGA SEQ ID No: 3575 GCCCTGCCCCC AAAATT SEQ ID No: 3601 GCCCTTTGGGC SEQ ID No: 3576 GCCCTGCCCCC TAAAT SEQ ID No: 3602 GCCCTTTGGGC SEQ ID No: 3577 GCCCTGGGT AAATSEQ ID No: 3578 GCCCTGGGAAA SEQ ID No: 3603 GCCCTTTGGGC T CCAT SEQ ID No: 3579 GCCCTGGGCAA SEQ ID No: 3604 GCCCTTTGGGC AAAT CCAAAAAT SEQ ID No: 3580 GCCCTGGGCCC SEQ ID No: 3605 GCCCTTTGGGC T CCCCT SEQ ID No: 3581 GCCCTGGGCCC SEQ ID No: 3606 GCCCTTTGGGC AAAT CCCCAAAT SEQ ID No: 3582 GCCCTGGGCCC SEQ ID No: 3607 GCCCTTTTTAA CCAT AT SEQ ID No: 3583 GCCCTGGGCCC SEQ ID No: 3608 GCCCTTTTTCA CCAAAAAT T SEQ ID No: 3584 GCCCTTTAT SEQ ID No: 3609 GCCCTTTTTCA AAAAT SEQ ID No: 3585 GCCCTTTAAAASEQ ID No: 3610 GCCCTTTTTCC AT CT SEQ ID No: 3586 GCCCTTTCTSEQ ID No: 3611 GCCCTTTTTCC SEQ ID No: 3587 GCCCTTTCAAA CAAATT SEQ ID No: 3612 GCCCTTTTTCC SEQ ID No: 3588 GCCCTTTCCCA CCCATT SEQ ID No: 3613 GCCCTTTTTGA SEQ ID No: 3589 GCCCTTTCCCA TAAAAT SEQ ID No: 3614 GCCCTTTTTGA SEQ ID No: 3590 GCCCTTTCCCC AAAAT CT SEQ ID No: 3615 GCCCTTTTTGC SEQ ID No: 3591 GCCCTTTCCCC TCAAAT SEQ ID No: 3616 GCCCTTTTTGC SEQ ID No: 3592 GCCCTTTGT AAATSEQ ID No: 3593 GCCCTTTGAAA SEQ ID No: 3617 GCCCTTTTTGC T CCAT SEQ ID No: 3594 GCCCTTTGCAA SEQ ID No: 3618 GCCCTTTTTGCAAAT CCAAAAAT SEQ ID No: 3595 GCCCTTTGCCC SEQ ID No: 3619 GCCCTTTTTGCTCCCCT-97- 182358171.1SEQ ID No: 3620 GCCCTTTTTGC SEQ ID No: 3646 GCCCATCCCCC CCCCAAAT AAAT SEQ ID No: 3621 GCCCTTTTTGG SEQ ID No: 3647 GCCCATGAT GT SEQ ID No: 3648 GCCCATGCT SEQ ID No: 3622 GCCCTTTTTGG SEQ ID No: 3649 GCCCATGCAAA GAAAT T SEQ ID No: 3623 GCCCTTTTTGG SEQ ID No: 3650 GCCCATGCCCA GCAT T SEQ ID No: 3624 GCCCTTTTTGG SEQ ID No: 3651 GCCCATGCCCC GCAAAAAT CAAAAAT SEQ ID No: 3625 GCCCTTTTTGG SEQ ID No: 3652 GCCCATGGGAA GCCCT AAAT SEQ ID No: 3626 GCCCTTTTTGG SEQ ID No: 3653 GCCCATGGGCA GCCCAAAT T SEQ ID No: 3627 GCCCTTTTTGG SEQ ID No: 3654 GCCCATGGGCC GCCCCCAT CAAAAAT SEQ ID No: 3628 GCCCACAAAT SEQ ID No: 3655 GCCCATGGGCC SEQ ID No: 3629 GCCCACCCT CCCTSEQ ID No: 3630 GCCCACCCCCA SEQ ID No: 3656 GCCCATGGGCC T CCCAAAT SEQ ID No: 3631 GCCCACCCCCA SEQ ID No: 3657 GCCCATTTAAA AAAAT T SEQ ID No: 3632 GCCCAGAAAA SEQ ID No: 3658 GCCCATTTCAA AT AAAT SEQ ID No: 3633 GCCCAGCAT SEQ ID No: 3659 GCCCATTTCCC SEQ ID No: 3634 GCCCAGCCCAA TAT SEQ ID No: 3660 GCCCATTTCCC SEQ ID No: 3635 GCCCAGCCCCC AAATT SEQ ID No: 3661 GCCCATTTCCC SEQ ID No: 3636 GCCCAGGGT CCATSEQ ID No: 3637 GCCCAGGGAA SEQ ID No: 3662 GCCCATTTCCC AT CCAAAAAT SEQ ID No: 3638 GCCCAGGGCAA SEQ ID No: 3663 GCCCATTTGAA AAAT AAAT SEQ ID No: 3639 GCCCAGGGCCC SEQ ID No: 3664 GCCCATTTGCA T T SEQ ID No: 3640 GCCCAGGGCCC SEQ ID No: 3665 GCCCATTTGCC CCAT CAAAAAT SEQ ID No: 3641 GCCCAGGGCCC SEQ ID No: 3666 GCCCATTTGCC CCAAAAAT CCCT SEQ ID No: 3642 GCCCATAAAAA SEQ ID No: 3667 GCCCATTTGCC T CCCAAAT SEQ ID No: 3643 GCCCATCAT SEQ ID No: 3668 GCCCATTTGGG T SEQ ID No: 3644 GCCCATCCCAASEQ ID No: 3669 GCCCATTTGGG AAAT AAAT SEQ ID No: 3645 GCCCATCCCCCSEQ ID No: 3670 GCCCATTTGGGTCAAAAAT -98- 182358171.1SEQ ID No: 3671 GCCCATTTGGG SEQ ID No: 3695 GCCCAAACCCA CCCT T SEQ ID No: 3672 GCCCATTTGGG SEQ ID No: 3696 GCCCAAACCCA CCCAAAT AAAAT SEQ ID No: 3673 GCCCATTTGGG SEQ ID No: 3697 GCCCAAACCCC CCCCCAT CT SEQ ID No: 3674 GCCCATTTTTA SEQ ID No: 3698 GCCCAAACCCC T CAAAT SEQ ID No: 3675 GCCCATTTTTA SEQ ID No: 3699 GCCCAAAGT AAAAT SEQ ID No: 3700 GCCCAAAGAA SEQ ID No: 3676 GCCCATTTTTC ATT SEQ ID No: 3701 GCCCAAAGCAA SEQ ID No: 3677 GCCCATTTTTC AAAT AAAT SEQ ID No: 3702 GCCCAAAGCCC SEQ ID No: 3678 GCCCATTTTTC TCCAT SEQ ID No: 3703 GCCCAAAGCCC SEQ ID No: 3679 GCCCATTTTTC CCAT CCAAAAAT SEQ ID No: 3704 GCCCAAAGCCC SEQ ID No: 3680 GCCCATTTTTC CCAAAAAT CCCCT SEQ ID No: 3705 GCCCAAAGGG SEQ ID No: 3681 GCCCATTTTTC AT CCCCAAAT SEQ ID No: 3706 GCCCAAAGGG SEQ ID No: 3682 GCCCATTTTTG AAAAATT SEQ ID No: 3707 GCCCAAAGGGC SEQ ID No: 3683 GCCCATTTTTG TAAAT SEQ ID No: 3708 GCCCAAAGGGC SEQ ID No: 3684 GCCCATTTTTG AAAT CAAAAAT SEQ ID No: 3709 GCCCAAAGGGC SEQ ID No: 3685 GCCCATTTTTG CCAT CCCT SEQ ID No: 3710 GCCCAAAGGGC SEQ ID No: 3686 GCCCATTTTTG CCAAAAAT CCCAAAT SEQ ID No: 3711 GCCCAAAGGGC SEQ ID No: 3687 GCCCATTTTTG CCCCT CCCCCAT SEQ ID No: 3712 GCCCAAAGGGC SEQ ID No: 3688 GCCCATTTTTG CCCCAAAT GGAT SEQ ID No: 3713 GCCCAAATAT SEQ ID No: 3689 GCCCATTTTTG SEQ ID No: 3714 GCCCAAATCAA GGAAAAAT AT SEQ ID No: 3690 GCCCATTTTTG SEQ ID No: 3715 GCCCAAATCCC GGCT T SEQ ID No: 3691 GCCCATTTTTG SEQ ID No: 3716 GCCCAAATCCC GGCAAAT CCAT SEQ ID No: 3692 GCCCATTTTTG SEQ ID No: 3717 GCCCAAATCCC GGCCCAT CCAAAAAT SEQ ID No: 3693 GCCCATTTTTG SEQ ID No: 3718 GCCCAAATGAA GGCCCCCT AAATSEQ ID No: 3694 GCCCAAACT SEQ ID No: 3719 GCCCAAATGCAT-99- 182358171.1SEQ ID No: 3720 GCCCAAATGCC SEQ ID No: 3744 GCCCAAATTTT CAAAT TAAAT SEQ ID No: 3721 GCCCAAATGCC SEQ ID No: 3745 GCCCAAATTTT CCCT TCAT SEQ ID No: 3722 GCCCAAATGGG SEQ ID No: 3746 GCCCAAATTTT T TCAAAAAT SEQ ID No: 3723 GCCCAAATGGG SEQ ID No: 3747 GCCCAAATTTT AAAT TCCCT SEQ ID No: 3724 GCCCAAATGGG SEQ ID No: 3748 GCCCAAATTTT CAAAAAT TCCCAAAT SEQ ID No: 3725 GCCCAAATGGG SEQ ID No: 3749 GCCCAAATTTT CCCT TCCCCCAT SEQ ID No: 3726 GCCCAAATGGG SEQ ID No: 3750 GCCCAAATTTT CCCCCAT TGAT SEQ ID No: 3727 GCCCAAATTTA SEQ ID No: 3751 GCCCAAATTTT AAAAT TGAAAAAT SEQ ID No: 3728 GCCCAAATTTC SEQ ID No: 3752 GCCCAAATTTT T TGCT SEQ ID No: 3729 GCCCAAATTTC SEQ ID No: 3753 GCCCAAATTTT CCAT TGCAAAT SEQ ID No: 3730 GCCCAAATTTC SEQ ID No: 3754 GCCCAAATTTT CCAAAAAT TGCCCAT SEQ ID No: 3731 GCCCAAATTTC SEQ ID No: 3755 GCCCAAATTTT CCCCT TGCCCCCT SEQ ID No: 3732 GCCCAAATTTC SEQ ID No: 3756 GCCCAAATTTT CCCCAAAT TGGGT SEQ ID No: 3733 GCCCAAATTTG SEQ ID No: 3757 GCCCAAATTTT T TGGGAAAT SEQ ID No: 3734 GCCCAAATTTG SEQ ID No: 3758 GCCCAAATTTT AAAT TGGGCAT SEQ ID No: 3735 GCCCAAATTTG SEQ ID No: 3759 GCCCAAATTTT CAAAAAT TGGGCCCT SEQ ID No: 3736 GCCCAAATTTG SEQ ID No: 3760 GCCCAAAAACA CCCT T SEQ ID No: 3737 GCCCAAATTTG SEQ ID No: 3761 GCCCAAAAACA CCCCCAT AAAAT SEQ ID No: 3738 GCCCAAATTTG SEQ ID No: 3762 GCCCAAAAACC GGAT CT SEQ ID No: 3739 GCCCAAATTTG SEQ ID No: 3763 GCCCAAAAACC GGAAAAAT CAAAT SEQ ID No: 3740 GCCCAAATTTG SEQ ID No: 3764 GCCCAAAAACC GGCT CCCAT SEQ ID No: 3741 GCCCAAATTTG SEQ ID No: 3765 GCCCAAAAAG GGCAAAT AT SEQ ID No: 3742 GCCCAAATTTG SEQ ID No: 3766 GCCCAAAAAG GGCCCAT AAAAAT SEQ ID No: 3743 GCCCAAATTTG SEQ ID No: 3767 GCCCAAAAAGCGGCCCCCTT-100- 182358171.1SEQ ID No: 3768 GCCCAAAAAGC SEQ ID No: 3792 GCCCAAAAATG AAAT GGAAAAAT SEQ ID No: 3769 GCCCAAAAAGC SEQ ID No: 3793 GCCCAAAAATG CCAT GGCT SEQ ID No: 3770 GCCCAAAAAGC SEQ ID No: 3794 GCCCAAAAATG CCAAAAAT GGCAAAT SEQ ID No: 3771 GCCCAAAAAGC SEQ ID No: 3795 GCCCAAAAATG CCCCT GGCCCAT SEQ ID No: 3772 GCCCAAAAAGC SEQ ID No: 3796 GCCCAAAAATG CCCCAAAT GGCCCCCT SEQ ID No: 3773 GCCCAAAAAG SEQ ID No: 3797 GCCCAAAAATT GGT TAAAT SEQ ID No: 3774 GCCCAAAAAG SEQ ID No: 3798 GCCCAAAAATT GGAAAT TCAT SEQ ID No: 3775 GCCCAAAAAG SEQ ID No: 3799 GCCCAAAAATT GGCAT TCAAAAAT SEQ ID No: 3776 GCCCAAAAAG SEQ ID No: 3800 GCCCAAAAATT GGCAAAAAT TCCCT SEQ ID No: 3777 GCCCAAAAAG SEQ ID No: 3801 GCCCAAAAATT GGCCCT TCCCAAAT SEQ ID No: 3778 GCCCAAAAAG SEQ ID No: 3802 GCCCAAAAATT GGCCCAAAT TCCCCCAT SEQ ID No: 3779 GCCCAAAAAG SEQ ID No: 3803 GCCCAAAAATT GGCCCCCAT TGAT SEQ ID No: 3780 GCCCAAAAATA SEQ ID No: 3804 GCCCAAAAATT AAAAT TGAAAAAT SEQ ID No: 3781 GCCCAAAAATC SEQ ID No: 3805 GCCCAAAAATT T TGCT SEQ ID No: 3782 GCCCAAAAATC SEQ ID No: 3806 GCCCAAAAATT CCAT TGCAAAT SEQ ID No: 3783 GCCCAAAAATC SEQ ID No: 3807 GCCCAAAAATT CCAAAAAT TGCCCAT SEQ ID No: 3784 GCCCAAAAATC SEQ ID No: 3808 GCCCAAAAATT CCCCT TGCCCCCT SEQ ID No: 3785 GCCCAAAAATC SEQ ID No: 3809 GCCCAAAAATT CCCCAAAT TGGGT SEQ ID No: 3786 GCCCAAAAATG SEQ ID No: 3810 GCCCAAAAATT T TGGGAAAT SEQ ID No: 3787 GCCCAAAAATG SEQ ID No: 3811 GCCCAAAAATT AAAT TGGGCAT SEQ ID No: 3788 GCCCAAAAATG SEQ ID No: 3812 GCCCAAAAATT CAAAAAT TGGGCCCT SEQ ID No: 3789 GCCCAAAAATG SEQ ID No: 3813 GCCCAAAAATT CCCT TTTAT SEQ ID No: 3790 GCCCAAAAATG SEQ ID No: 3814 GCCCAAAAATT CCCCCAT TTTCT SEQ ID No: 3791 GCCCAAAAATG SEQ ID No: 3815 GCCCAAAAATTGGATTTTCAAAT -101- 182358171.1SEQ ID No: 3816 GCCCAAAAATT SEQ ID No: 3842 GCCCCCTCCCA TTTCCCAT T SEQ ID No: 3817 GCCCAAAAATT SEQ ID No: 3843 GCCCCCTCCCA TTTGT AAAAT SEQ ID No: 3818 GCCCAAAAATT SEQ ID No: 3844 GCCCCCTCCCC TTTGAAAT CT SEQ ID No: 3819 GCCCAAAAATT SEQ ID No: 3845 GCCCCCTCCCC TTTGCAT CAAAT SEQ ID No: 3820 GCCCAAAAATT SEQ ID No: 3846 GCCCCCTGT TTTGCCCT SEQ ID No: 3847 GCCCCCTGAAA SEQ ID No: 3821 GCCCAAAAATT T TTTGGGAT SEQ ID No: 3848 GCCCCCTGCAA SEQ ID No: 3822 GCCCAAAAATT AAAT TTTGGGCT SEQ ID No: 3849 GCCCCCTGCCC SEQ ID No: 3823 GCCCCCGAT TSEQ ID No: 3824 GCCCCCGAAAA SEQ ID No: 3850 GCCCCCTGCCC AT AAAT SEQ ID No: 3825 GCCCCCGCT SEQ ID No: 3851 GCCCCCTGCCC SEQ ID No: 3826 GCCCCCGCAAA CCATT SEQ ID No: 3852 GCCCCCTGGGA SEQ ID No: 3827 GCCCCCGCCCA TT SEQ ID No: 3853 GCCCCCTGGGA SEQ ID No: 3828 GCCCCCGCCCA AAAAT AAAAT SEQ ID No: 3854 GCCCCCTGGGC SEQ ID No: 3829 GCCCCCGCCCC TCT SEQ ID No: 3855 GCCCCCTGGGC SEQ ID No: 3830 GCCCCCGCCCC AAAT CAAAT SEQ ID No: 3856 GCCCCCTGGGC SEQ ID No: 3831 GCCCCCGGGT CCATSEQ ID No: 3832 GCCCCCGGGAA SEQ ID No: 3857 GCCCCCTGGGC AT CCAAAAAT SEQ ID No: 3833 GCCCCCGGGCA SEQ ID No: 3858 GCCCCCTGGGC T CCCCT SEQ ID No: 3834 GCCCCCGGGCA SEQ ID No: 3859 GCCCCCTGGGC AAAAT CCCCAAAT SEQ ID No: 3835 GCCCCCGGGCC SEQ ID No: 3860 GCCCCCTTTAA CT AT SEQ ID No: 3836 GCCCCCGGGCC SEQ ID No: 3861 GCCCCCTTTCA CAAAT T SEQ ID No: 3837 GCCCCCGGGCC SEQ ID No: 3862 GCCCCCTTTCA CCCAT AAAAT SEQ ID No: 3838 GCCCCCTAT SEQ ID No: 3863 GCCCCCTTTCC CT SEQ ID No: 3839 GCCCCCTAAAASEQ ID No: 3864 GCCCCCTTTCC AT CAAAT SEQ ID No: 3840 GCCCCCTCTSEQ ID No: 3865 GCCCCCTTTCC SEQ ID No: 3841 GCCCCCTCAAA CCCATT-102- 182358171.1SEQ ID No: 3866 GCCCCCTTTGA SEQ ID No: 3890 GCCCCCTTTTT T GGGAT SEQ ID No: 3867 GCCCCCTTTGA SEQ ID No: 3891 GCCCCCTTTTT AAAAT GGGCT SEQ ID No: 3868 GCCCCCTTTGC SEQ ID No: 3892 GCCCCCTTTTT T GGGCAAAT SEQ ID No: 3869 GCCCCCTTTGC SEQ ID No: 3893 GCCCCCTTTTT AAAT GGGCCCAT SEQ ID No: 3870 GCCCCCTTTGC SEQ ID No: 3894 GCCCCCACT CCAT SEQ ID No: 3895 GCCCCCACAAA SEQ ID No: 3871 GCCCCCTTTGC AAT CCAAAAAT SEQ ID No: 3896 GCCCCCACCCA SEQ ID No: 3872 GCCCCCTTTGC TCCCCT SEQ ID No: 3897 GCCCCCACCCC SEQ ID No: 3873 GCCCCCTTTGC CT CCCCAAAT SEQ ID No: 3898 GCCCCCACCCC SEQ ID No: 3874 GCCCCCTTTGG CAAAT GT SEQ ID No: 3899 GCCCCCAGT SEQ ID No: 3875 GCCCCCTTTGG SEQ ID No: 3900 GCCCCCAGAAA GAAAT T SEQ ID No: 3876 GCCCCCTTTGG SEQ ID No: 3901 GCCCCCAGCCC GCAT T SEQ ID No: 3877 GCCCCCTTTGG SEQ ID No: 3902 GCCCCCAGCCC GCAAAAAT CCAT SEQ ID No: 3878 GCCCCCTTTGG SEQ ID No: 3903 GCCCCCAGGGA GCCCT T SEQ ID No: 3879 GCCCCCTTTGG SEQ ID No: 3904 GCCCCCAGGGA GCCCAAAT AAAAT SEQ ID No: 3880 GCCCCCTTTGG SEQ ID No: 3905 GCCCCCAGGGC GCCCCCAT T SEQ ID No: 3881 GCCCCCTTTTT SEQ ID No: 3906 GCCCCCAGGGC AT AAAT SEQ ID No: 3882 GCCCCCTTTTT SEQ ID No: 3907 GCCCCCAGGGC CT CCAT SEQ ID No: 3883 GCCCCCTTTTT SEQ ID No: 3908 GCCCCCAGGGC CAAAT CCAAAAAT SEQ ID No: 3884 GCCCCCTTTTT SEQ ID No: 3909 GCCCCCAGGGC CCCAT CCCCT SEQ ID No: 3885 GCCCCCTTTTT SEQ ID No: 3910 GCCCCCAGGGC GT CCCCAAAT SEQ ID No: 3886 GCCCCCTTTTT SEQ ID No: 3911 GCCCCCATAAA GAAAT T SEQ ID No: 3887 GCCCCCTTTTT SEQ ID No: 3912 GCCCCCATCCC GCAT T SEQ ID No: 3888 GCCCCCTTTTT SEQ ID No: 3913 GCCCCCATCCC GCCCT AAAT SEQ ID No: 3889 GCCCCCTTTTT SEQ ID No: 3914 GCCCCCATCCCGCCCAAATCCAT-103- 182358171.1SEQ ID No: 3915 GCCCCCATGAA SEQ ID No: 3939 GCCCCCATTTG AAAT CCCCCAT SEQ ID No: 3916 GCCCCCATGCA SEQ ID No: 3940 GCCCCCATTTG T GGAT SEQ ID No: 3917 GCCCCCATGCC SEQ ID No: 3941 GCCCCCATTTG CAAAAAT GGAAAAAT SEQ ID No: 3918 GCCCCCATGCC SEQ ID No: 3942 GCCCCCATTTG CCCT GGCT SEQ ID No: 3919 GCCCCCATGCC SEQ ID No: 3943 GCCCCCATTTG CCCAAAT GGCAAAT SEQ ID No: 3920 GCCCCCATGGG SEQ ID No: 3944 GCCCCCATTTG T GGCCCAT SEQ ID No: 3921 GCCCCCATGGG SEQ ID No: 3945 GCCCCCATTTG AAAT GGCCCCCT SEQ ID No: 3922 GCCCCCATGGG SEQ ID No: 3946 GCCCCCATTTT CAAAAAT TAAAT SEQ ID No: 3923 GCCCCCATGGG SEQ ID No: 3947 GCCCCCATTTT CCCT TCAT SEQ ID No: 3924 GCCCCCATGGG SEQ ID No: 3948 GCCCCCATTTT CCCAAAT TCCCT SEQ ID No: 3925 GCCCCCATGGG SEQ ID No: 3949 GCCCCCATTTT CCCCCAT TCCCAAAT SEQ ID No: 3926 GCCCCCATTTA SEQ ID No: 3950 GCCCCCATTTT T TGAT SEQ ID No: 3927 GCCCCCATTTA SEQ ID No: 3951 GCCCCCATTTT AAAAT TGCT SEQ ID No: 3928 GCCCCCATTTC SEQ ID No: 3952 GCCCCCATTTT T TGCAAAT SEQ ID No: 3929 GCCCCCATTTC SEQ ID No: 3953 GCCCCCATTTT AAAT TGCCCAT SEQ ID No: 3930 GCCCCCATTTC SEQ ID No: 3954 GCCCCCATTTT CCAT TGGGT SEQ ID No: 3931 GCCCCCATTTC SEQ ID No: 3955 GCCCCCATTTT CCAAAAAT TGGGAAAT SEQ ID No: 3932 GCCCCCATTTC SEQ ID No: 3956 GCCCCCATTTT CCCCT TGGGCAT SEQ ID No: 3933 GCCCCCATTTC SEQ ID No: 3957 GCCCCCATTTT CCCCAAAT TGGGCCCT SEQ ID No: 3934 GCCCCCATTTG SEQ ID No: 3958 GCCCCCAAACA T T SEQ ID No: 3935 GCCCCCATTTG SEQ ID No: 3959 GCCCCCAAACC AAAT CT SEQ ID No: 3936 GCCCCCATTTG SEQ ID No: 3960 GCCCCCAAACCCAAAAAT CAAAT SEQ ID No: 3937 GCCCCCATTTG SEQ ID No: 3961 GCCCCCAAACC CCCT CCCAT SEQ ID No: 3938 GCCCCCATTTG SEQ ID No: 3962 GCCCCCAAAGACCCAAATT-104- 182358171.1SEQ ID No: 3963 GCCCCCAAAGA SEQ ID No: 3987 GCCCCCAAATG AAAAT CCCCCAT SEQ ID No: 3964 GCCCCCAAAGC SEQ ID No: 3988 GCCCCCAAATG T GGAT SEQ ID No: 3965 GCCCCCAAAGC SEQ ID No: 3989 GCCCCCAAATG AAAT GGAAAAAT SEQ ID No: 3966 GCCCCCAAAGC SEQ ID No: 3990 GCCCCCAAATG CCAT GGCT SEQ ID No: 3967 GCCCCCAAAGC SEQ ID No: 3991 GCCCCCAAATG CCAAAAAT GGCAAAT SEQ ID No: 3968 GCCCCCAAAGC SEQ ID No: 3992 GCCCCCAAATG CCCCT GGCCCAT SEQ ID No: 3969 GCCCCCAAAGC SEQ ID No: 3993 GCCCCCAAATG CCCCAAAT GGCCCCCT SEQ ID No: 3970 GCCCCCAAAGG SEQ ID No: 3994 GCCCCCAAATT GT TAAAT SEQ ID No: 3971 GCCCCCAAAGG SEQ ID No: 3995 GCCCCCAAATT GAAAT TCAT SEQ ID No: 3972 GCCCCCAAAGG SEQ ID No: 3996 GCCCCCAAATT GCAT TCAAAAAT SEQ ID No: 3973 GCCCCCAAAGG SEQ ID No: 3997 GCCCCCAAATT GCAAAAAT TCCCT SEQ ID No: 3974 GCCCCCAAAGG SEQ ID No: 3998 GCCCCCAAATT GCCCT TCCCAAAT SEQ ID No: 3975 GCCCCCAAAGG SEQ ID No: 3999 GCCCCCAAATT GCCCAAAT TCCCCCAT SEQ ID No: 3976 GCCCCCAAAGG SEQ ID No: 4000 GCCCCCAAATT GCCCCCAT TGAT SEQ ID No: 3977 GCCCCCAAATA SEQ ID No: 4001 GCCCCCAAATT AAAAT TGAAAAAT SEQ ID No: 3978 GCCCCCAAATC SEQ ID No: 4002 GCCCCCAAATT T TGCT SEQ ID No: 3979 GCCCCCAAATC SEQ ID No: 4003 GCCCCCAAATT CCAT TGCAAAT SEQ ID No: 3980 GCCCCCAAATC SEQ ID No: 4004 GCCCCCAAATT CCAAAAAT TGCCCAT SEQ ID No: 3981 GCCCCCAAATC SEQ ID No: 4005 GCCCCCAAATT CCCCT TGCCCCCT SEQ ID No: 3982 GCCCCCAAATC SEQ ID No: 4006 GCCCCCAAATT CCCCAAAT TGGGT SEQ ID No: 3983 GCCCCCAAATG SEQ ID No: 4007 GCCCCCAAATT T TGGGAAAT SEQ ID No: 3984 GCCCCCAAATG SEQ ID No: 4008 GCCCCCAAATT AAAT TGGGCAT SEQ ID No: 3985 GCCCCCAAATG SEQ ID No: 4009 GCCCCCAAATT CAAAAAT TGGGCCCT SEQ ID No: 3986 GCCCCCAAATG SEQ ID No: 4010 GCCCCCAAATTCCCTTTTAT -105- 182358171.1SEQ ID No: 4011 GCCCCCAAATT SEQ ID No: 4031 GCCCCCAAAAA TTTCT GGGCCCAT SEQ ID No: 4012 GCCCCCAAATT SEQ ID No: 4032 GCCCCCAAAAA TTTCAAAT TAT SEQ ID No: 4013 GCCCCCAAATT SEQ ID No: 4033 GCCCCCAAAAA TTTCCCAT TCCCT SEQ ID No: 4014 GCCCCCAAATT SEQ ID No: 4034 GCCCCCAAAAA TTTGT TCCCAAAT SEQ ID No: 4015 GCCCCCAAATT SEQ ID No: 4035 GCCCCCAAAAA TTTGAAAT TGCT SEQ ID No: 4016 GCCCCCAAATT SEQ ID No: 4036 GCCCCCAAAAA TTTGCAT TGCAAAT SEQ ID No: 4017 GCCCCCAAATT SEQ ID No: 4037 GCCCCCAAAAA TTTGCCCT TGCCCAT SEQ ID No: 4018 GCCCCCAAATT SEQ ID No: 4038 GCCCCCAAAAA TTTGGGAT TGGGT SEQ ID No: 4019 GCCCCCAAATT SEQ ID No: 4039 GCCCCCAAAAA TTTGGGCT TGGGAAAT SEQ ID No: 4020 GCCCCCAAAAA SEQ ID No: 4040 GCCCCCAAAAA CT TGGGCAT SEQ ID No: 4021 GCCCCCAAAAA SEQ ID No: 4041 GCCCCCAAAAA CAAAT TGGGCCCT SEQ ID No: 4022 GCCCCCAAAAA SEQ ID No: 4042 GCCCCCAAAAA CCCAT TTTCT SEQ ID No: 4023 GCCCCCAAAAA SEQ ID No: 4043 GCCCCCAAAAA GT TTTCAAAT SEQ ID No: 4024 GCCCCCAAAAA SEQ ID No: 4044 GCCCCCAAAAA GAAAT TTTCCCAT SEQ ID No: 4025 GCCCCCAAAAA SEQ ID No: 4045 GCCCCCAAAAA GCAT TTTGT SEQ ID No: 4026 GCCCCCAAAAA SEQ ID No: 4046 GCCCCCAAAAA GCCCT TTTGAAAT SEQ ID No: 4027 GCCCCCAAAAA SEQ ID No: 4047 GCCCCCAAAAA GCCCAAAT TTTGCAT SEQ ID No: 4028 GCCCCCAAAAA SEQ ID No: 4048 GCCCCCAAAAA GGGAT TTTGCCCT SEQ ID No: 4029 GCCCCCAAAAA SEQ ID No: 4049 GCCCCCAAAAA GGGCT TTTGGGAT SEQ ID No: 4030 GCCCCCAAAAA SEQ ID No: 4050 GCCCCCAAAAAGGGCAAATTTTGGGCT

[0094] Continuation of Table 6SEQ ID No: Sequence 5’-3’SEQ ID NO: 5825 GTAAATTTTTCSEQ ID NO: 5826 GTAAAAAGGGCSEQ ID NO: 5827 GTAAAAATTTCSEQ ID NO: 5828 GTCATTTGGGC-106- 182358171.1SEQ ID NO 5829 GCCCCCAGTGCSEQ ID NO 5830 GCCCCCAGAGCSEQ ID NO 5831 GCCCCCAGATCSEQ ID NO 5832 GCCCCCAGCGCSEQ ID NO 5833 GCCCCCAGCTCSEQ ID NO 5834 GCCCCCAGCACSEQ ID NO 5835 GCCCCCATAGCSEQ ID NO 5836 GCCCCCATATCSEQ ID NO 5837 GCCCCCATCGCSEQ ID NO 5838 GCCCCCATCTCSEQ ID NO 5839 GCCCCCATCACSEQ ID NO 5840 GCCCCCATGTCSEQ ID NO 5841 GCCCCCATGAC

[0095] Table 7: Barcode sequences, 8 flows, ending in CSEQ ID No: Sequence, 5'-3' SEQ ID No 4080 GTGCCCAAAGC SEQ ID No 4051 GTCATTTTTGC SEQ ID No 4081 GTGCCCAAATC SEQ ID No 4052 GTCAAATGGGC SEQ ID No 4082 GTGCCCCCTGC SEQ ID No 4053 GTCAAATTTGC SEQ ID No 4083 GTGCCCCCAGC SEQ ID No 4054 GTCAAAAATGC SEQ ID No 4084 GTGCCCCCATC SEQ ID No 4055 GTCCCTTTTTC SEQ ID No 4085 GTGGGTTTTTC SEQ ID No 4056 GTCCCATGGGC SEQ ID No 4086 GTGGGATGGGC SEQ ID No 4057 GTCCCATTTGC SEQ ID No 4087 GTGGGATTTGC SEQ ID No 4058 GTCCCAAATGC SEQ ID No 4088 GTGGGAAATGC SEQ ID No 4059 GTCCCAAAAAC SEQ ID No 4089 GTGGGAAAAAC SEQ ID No 4060 GTCCCCCGGGC SEQ ID No 4090 GTGGGCTGGGC SEQ ID No 4061 GTCCCCCTTTC SEQ ID No 4091 GTGGGCTTTGC SEQ ID No 4062 GTCCCCCATGC SEQ ID No 4092 GTGGGCAGGGC SEQ ID No 4063 GTCCCCCAAAC SEQ ID No 4093 GTGGGCATTTC SEQ ID No 4064 GTGATTTGGGC SEQ ID No 4094 GTGGGCAAAGC SEQ ID No 4065 GTGATTTTTGC SEQ ID No 4095 GTGGGCAAATC SEQ ID No 4066 GTGAAATGGGC SEQ ID No 4096 GTGGGCCCTGC SEQ ID No 4067 GTGAAATTTGC SEQ ID No 4097 GTGGGCCCAGC SEQ ID No 4068 GTGAAAAATGC SEQ ID No 4098 GTGGGCCCATC SEQ ID No 4069 GTGCTTTGGGC SEQ ID No 4099 GTTTATTTTTC SEQ ID No 4070 GTGCTTTTTGC SEQ ID No 4100 GTTTAAAGGGC SEQ ID No 4071 GTGCATTTTTC SEQ ID No 4101 GTTTAAATTTC SEQ ID No 4072 GTGCAAAGGGC SEQ ID No 4102 GTTTAAAAAGC SEQ ID No 4073 GTGCAAATTTC SEQ ID No 4103 GTTTAAAAATC SEQ ID No 4074 GTGCAAAAAGC SEQ ID No 4104 GTTTCTTTTTC SEQ ID No 4075 GTGCAAAAATC SEQ ID No 4105 GTTTCATGGGC SEQ ID No 4076 GTGCCCTGGGC SEQ ID No 4106 GTTTCATTTGC SEQ ID No 4077 GTGCCCTTTGC SEQ ID No 4107 GTTTCAAATGC SEQ ID No 4078 GTGCCCAGGGC SEQ ID No 4108 GTTTCAAAAACSEQ ID No 4079 GTGCCCATTTCSEQ ID No 4109 GTTTCCCGGGC -107- 182358171.1SEQ ID No 4110 GTTTCCCTTTC SEQ ID No 4156 GACATTTTTGC SEQ ID No 4111 GTTTCCCATGC SEQ ID No 4157 GACAAATGGGC SEQ ID No 4112 GTTTCCCAAAC SEQ ID No 4158 GACAAATTTGC SEQ ID No 4113 GTTTCCCCCGC SEQ ID No 4159 GACAAAAATGC SEQ ID No 4114 GTTTCCCCCTC SEQ ID No 4160 GACCCTTTTTC SEQ ID No 4115 GTTTCCCCCAC SEQ ID No 4161 GACCCATGGGC SEQ ID No 4116 GTTTGTTTTTC SEQ ID No 4162 GACCCATTTGC SEQ ID No 4117 GTTTGATGGGC SEQ ID No 4163 GACCCAAATGC SEQ ID No 4118 GTTTGATTTGC SEQ ID No 4164 GACCCAAAAAC SEQ ID No 4119 GTTTGAAATGC SEQ ID No 4165 GACCCCCGGGC SEQ ID No 4120 GTTTGAAAAAC SEQ ID No 4166 GACCCCCTTTC SEQ ID No 4121 GTTTGCTGGGC SEQ ID No 4167 GACCCCCATGC SEQ ID No 4122 GTTTGCTTTGC SEQ ID No 4168 GACCCCCAAAC SEQ ID No 4123 GTTTGCAGGGC SEQ ID No 4169 GAGATTTGGGC SEQ ID No 4124 GTTTGCATTTC SEQ ID No 4170 GAGATTTTTGC SEQ ID No 4125 GTTTGCAAAGC SEQ ID No 4171 GAGAAATGGGC SEQ ID No 4126 GTTTGCAAATC SEQ ID No 4172 GAGAAATTTGC SEQ ID No 4127 GTTTGCCCTGC SEQ ID No 4173 GAGAAAAATGC SEQ ID No 4128 GTTTGCCCAGC SEQ ID No 4174 GAGCTTTGGGC SEQ ID No 4129 GTTTGCCCATC SEQ ID No 4175 GAGCTTTTTGC SEQ ID No 4130 GTTTGGGTTTC SEQ ID No 4176 GAGCATTTTTC SEQ ID No 4131 GTTTGGGATGC SEQ ID No 4177 GAGCAAAGGGC SEQ ID No 4132 GTTTGGGAAAC SEQ ID No 4178 GAGCAAATTTC SEQ ID No 4133 GTTTGGGCTGC SEQ ID No 4179 GAGCAAAAAGC SEQ ID No 4134 GTTTGGGCAGC SEQ ID No 4180 GAGCAAAAATC SEQ ID No 4135 GTTTGGGCATC SEQ ID No 4181 GAGCCCTGGGCGTTTTTAGGGCSEQ ID No 4136 GTTTTTAGGGC SEQ ID No 4182 GAGCCCTTTGC SEQ ID No 4137 GTTTTTATTTC SEQ ID No 4183 GAGCCCAGGGC SEQ ID No 4138 GTTTTTAAAGC SEQ ID No 4184 GAGCCCATTTC SEQ ID No 4139 GTTTTTAAATC SEQ ID No 4185 GAGCCCAAAGC SEQ ID No 4140 GTTTTTCGGGC SEQ ID No 4186 GAGCCCAAATC SEQ ID No 4141 GTTTTTCTTTC SEQ ID No 4187 GAGCCCCCTGC SEQ ID No 4142 GTTTTTCATGC SEQ ID No 4188 GAGCCCCCAGC SEQ ID No 4143 GTTTTTCAAAC SEQ ID No 4189 GAGCCCCCATC SEQ ID No 4144 GTTTTTCCCGC SEQ ID No 4190 GAGGGTTTTTC SEQ ID No 4145 GTTTTTCCCTC SEQ ID No 4191 GAGGGATGGGC SEQ ID No 4146 GTTTTTCCCAC SEQ ID No 4192 GAGGGATTTGC SEQ ID No 4147 GTTTTTGTTTC SEQ ID No 4193 GAGGGAAATGC SEQ ID No 4148 GTTTTTGATGC SEQ ID No 4194 GAGGGAAAAAC SEQ ID No 4149 GTTTTTGAAAC SEQ ID No 4195 GAGGGCTGGGC SEQ ID No 4150 GTTTTTGCTGC SEQ ID No 4196 GAGGGCTTTGC SEQ ID No 4151 GTTTTTGCAGC SEQ ID No 4197 GAGGGCAGGGC SEQ ID No 4152 GTTTTTGCATC SEQ ID No 4198 GAGGGCATTTC SEQ ID No 4153 GTTTTTGGGTC SEQ ID No 4199 GAGGGCAAAGC SEQ ID No 4154 GTTTTTGGGAC SEQ ID No 4200 GAGGGCAAATCSEQ ID No 4155 GACATTTGGGCSEQ ID No 4201 GAGGGCCCTGC -108- 182358171.1SEQ ID No 4202 GAGGGCCCAGC SEQ ID No 4248 GATGGGAAAGC SEQ ID No 4203 GAGGGCCCATC SEQ ID No 4249 GATGGGAAATC SEQ ID No 4204 GATATTTGGGC SEQ ID No 4250 GATGGGCGGGC SEQ ID No 4205 GATATTTTTGC SEQ ID No 4251 GATGGGCTTTC SEQ ID No 4206 GATAAATGGGC SEQ ID No 4252 GATGGGCATGC SEQ ID No 4207 GATAAATTTGC SEQ ID No 4253 GATGGGCAAAC SEQ ID No 4208 GATAAAAATGC SEQ ID No 4254 GATGGGCCCGC SEQ ID No 4209 GATCTTTGGGC SEQ ID No 4255 GATGGGCCCTC SEQ ID No 4210 GATCTTTTTGC SEQ ID No 4256 GATGGGCCCAC SEQ ID No 4211 GATCATTTTTC SEQ ID No 4257 GATTTATGGGC SEQ ID No 4212 GATCAAAGGGC SEQ ID No 4258 GATTTATTTGC SEQ ID No 4213 GATCAAATTTC SEQ ID No 4259 GATTTAAATGC SEQ ID No 4214 GATCAAAAAGC SEQ ID No 4260 GATTTAAAAAC SEQ ID No 4215 GATCAAAAATC SEQ ID No 4261 GATTTCTGGGC SEQ ID No 4216 GATCCCTGGGC SEQ ID No 4262 GATTTCTTTGC SEQ ID No 4217 GATCCCTTTGC SEQ ID No 4263 GATTTCAGGGC SEQ ID No 4218 GATCCCAGGGC SEQ ID No 4264 GATTTCATTTC SEQ ID No 4219 GATCCCATTTC SEQ ID No 4265 GATTTCAAAGC SEQ ID No 4220 GATCCCAAAGC SEQ ID No 4266 GATTTCAAATC SEQ ID No 4221 GATCCCAAATC SEQ ID No 4267 GATTTCCCTGC SEQ ID No 4222 GATCCCCCTGC SEQ ID No 4268 GATTTCCCAGC SEQ ID No 4223 GATCCCCCAGC SEQ ID No 4269 GATTTCCCATC SEQ ID No 4224 GATCCCCCATC SEQ ID No 4270 GATTTGTGGGC SEQ ID No 4225 GATGTTTGGGC SEQ ID No 4271 GATTTGTTTGC SEQ ID No 4226 GATGTTTTTGC SEQ ID No 4272 GATTTGAGGGC SEQ ID No 4227 GATGATTTTTC SEQ ID No 4273 GATTTGATTTC SEQ ID No 4228 GATGAAAGGGC SEQ ID No 4274 GATTTGAAAGC SEQ ID No 4229 GATGAAATTTC SEQ ID No 4275 GATTTGAAATC SEQ ID No 4230 GATGAAAAAGC SEQ ID No 4276 GATTTGCGGGC SEQ ID No 4231 GATGAAAAATC SEQ ID No 4277 GATTTGCTTTC SEQ ID No 4232 GATGCTTTTTC SEQ ID No 4278 GATTTGCATGC SEQ ID No 4233 GATGCATGGGC SEQ ID No 4279 GATTTGCAAAC SEQ ID No 4234 GATGCATTTGC SEQ ID No 4280 GATTTGCCCGC SEQ ID No 4235 GATGCAAATGC SEQ ID No 4281 GATTTGCCCTC SEQ ID No 4236 GATGCAAAAAC SEQ ID No 4282 GATTTGCCCAC SEQ ID No 4237 GATGCCCGGGC SEQ ID No 4283 GATTTGGGTGC SEQ ID No 4238 GATGCCCTTTC SEQ ID No 4284 GATTTGGGAGC SEQ ID No 4239 GATGCCCATGC SEQ ID No 4285 GATTTGGGATC SEQ ID No 4240 GATGCCCAAAC SEQ ID No 4286 GATTTGGGCGC SEQ ID No 4241 GATGCCCCCGC SEQ ID No 4287 GATTTGGGCTC SEQ ID No 4242 GATGCCCCCTC SEQ ID No 4288 GATTTGGGCAC SEQ ID No 4243 GATGCCCCCAC SEQ ID No 4289 GATTTTTATGC SEQ ID No 4244 GATGGGTGGGC SEQ ID No 4290 GATTTTTAAAC SEQ ID No 4245 GATGGGTTTGC SEQ ID No 4291 GATTTTTCTGC SEQ ID No 4246 GATGGGAGGGC SEQ ID No 4292 GATTTTTCAGCSEQ ID No 4247 GATGGGATTTCSEQ ID No 4293 GATTTTTCATC -109- 182358171.1SEQ ID No 4294 GATTTTTGTGC SEQ ID No 4340 GAAATCAAAGC SEQ ID No 4295 GATTTTTGAGC SEQ ID No 4341 GAAATCAAATC SEQ ID No 4296 GATTTTTGATC SEQ ID No 4342 GAAATCCCTGC SEQ ID No 4297 GATTTTTGCGC SEQ ID No 4343 GAAATCCCAGC SEQ ID No 4298 GATTTTTGCTC SEQ ID No 4344 GAAATCCCATC SEQ ID No 4299 GATTTTTGCAC SEQ ID No 4345 GAAATGTGGGC SEQ ID No 4300 GAAACTTTTTC SEQ ID No 4346 GAAATGTTTGC SEQ ID No 4301 GAAACATGGGC SEQ ID No 4347 GAAATGAGGGC SEQ ID No 4302 GAAACATTTGC SEQ ID No 4348 GAAATGATTTC SEQ ID No 4303 GAAACAAATGC SEQ ID No 4349 GAAATGAAAGC SEQ ID No 4304 GAAACAAAAAC SEQ ID No 4350 GAAATGAAATC SEQ ID No 4305 GAAACCCGGGC SEQ ID No 4351 GAAATGCGGGC SEQ ID No 4306 GAAACCCTTTC SEQ ID No 4352 GAAATGCTTTC SEQ ID No 4307 GAAACCCATGC SEQ ID No 4353 GAAATGCATGC SEQ ID No 4308 GAAACCCAAAC SEQ ID No 4354 GAAATGCAAAC SEQ ID No 4309 GAAACCCCCGC SEQ ID No 4355 GAAATGCCCGC SEQ ID No 4310 GAAACCCCCTC SEQ ID No 4356 GAAATGCCCTC SEQ ID No 4311 GAAACCCCCAC SEQ ID No 4357 GAAATGCCCAC SEQ ID No 4312 GAAAGTTTTTC SEQ ID No 4358 GAAATGGGTGC SEQ ID No 4313 GAAAGATGGGC SEQ ID No 4359 GAAATGGGAGC SEQ ID No 4314 GAAAGATTTGC SEQ ID No 4360 GAAATGGGATC SEQ ID No 4315 GAAAGAAATGC SEQ ID No 4361 GAAATGGGCGC SEQ ID No 4316 GAAAGAAAAAC SEQ ID No 4362 GAAATGGGCTC SEQ ID No 4317 GAAAGCTGGGC SEQ ID No 4363 GAAATGGGCAC SEQ ID No 4318 GAAAGCTTTGC SEQ ID No 4364 GAAATTTATGC SEQ ID No 4319 GAAAGCAGGGC SEQ ID No 4365 GAAATTTAAAC SEQ ID No 4320 GAAAGCATTTC SEQ ID No 4366 GAAATTTCTGC SEQ ID No 4321 GAAAGCAAAGC SEQ ID No 4367 GAAATTTCAGC SEQ ID No 4322 GAAAGCAAATC SEQ ID No 4368 GAAATTTCATC SEQ ID No 4323 GAAAGCCCTGC SEQ ID No 4369 GAAATTTGTGC SEQ ID No 4324 GAAAGCCCAGC SEQ ID No 4370 GAAATTTGAGC SEQ ID No 4325 GAAAGCCCATC SEQ ID No 4371 GAAATTTGATC SEQ ID No 4326 GAAAGGGTTTC SEQ ID No 4372 GAAATTTGCGC SEQ ID No 4327 GAAAGGGATGC SEQ ID No 4373 GAAATTTGCTC SEQ ID No 4328 GAAAGGGAAAC SEQ ID No 4374 GAAATTTGCAC SEQ ID No 4329 GAAAGGGCTGC SEQ ID No 4375 GAAATTTTTAC SEQ ID No 4330 GAAAGGGCAGC SEQ ID No 4376 GAAAAACGGGC SEQ ID No 4331 GAAAGGGCATC SEQ ID No 4377 GAAAAACTTTC SEQ ID No 4332 GAAATATGGGC SEQ ID No 4378 GAAAAACATGC SEQ ID No 4333 GAAATATTTGC SEQ ID No 4379 GAAAAACAAAC SEQ ID No 4334 GAAATAAATGC SEQ ID No 4380 GAAAAACCCGC SEQ ID No 4335 GAAATAAAAAC SEQ ID No 4381 GAAAAACCCTC SEQ ID No 4336 GAAATCTGGGC SEQ ID No 4382 GAAAAACCCAC SEQ ID No 4337 GAAATCTTTGC SEQ ID No 4383 GAAAAAGTTTC SEQ ID No 4338 GAAATCAGGGC SEQ ID No 4384 GAAAAAGATGCSEQ ID No 4339 GAAATCATTTCSEQ ID No 4385 GAAAAAGAAAC -110- 182358171.1SEQ ID No 4386 GAAAAAGCTGC SEQ ID No 4432 GCGGGCATTTC SEQ ID No 4387 GAAAAAGCAGC SEQ ID No 4433 GCGGGCAAAGC SEQ ID No 4388 GAAAAAGCATC SEQ ID No 4434 GCGGGCAAATC SEQ ID No 4389 GAAAAAGGGTC SEQ ID No 4435 GCGGGCCCTGC SEQ ID No 4390 GAAAAAGGGAC SEQ ID No 4436 GCGGGCCCAGC SEQ ID No 4391 GAAAAATATGC SEQ ID No 4437 GCGGGCCCATC SEQ ID No 4392 GAAAAATAAAC SEQ ID No 4438 GCTATTTGGGC SEQ ID No 4393 GAAAAATCTGC SEQ ID No 4439 GCTATTTTTGC SEQ ID No 4394 GAAAAATCAGC SEQ ID No 4440 GCTAAATGGGC SEQ ID No 4395 GAAAAATCATC SEQ ID No 4441 GCTAAATTTGC SEQ ID No 4396 GAAAAATGTGC SEQ ID No 4442 GCTAAAAATGC SEQ ID No 4397 GAAAAATGAGC SEQ ID No 4443 GCTCTTTGGGC SEQ ID No 4398 GAAAAATGATC SEQ ID No 4444 GCTCTTTTTGC SEQ ID No 4399 GAAAAATGCGC SEQ ID No 4445 GCTCATTTTTC SEQ ID No 4400 GAAAAATGCTC SEQ ID No 4446 GCTCAAAGGGC SEQ ID No 4401 GAAAAATGCAC SEQ ID No 4447 GCTCAAATTTC SEQ ID No 4402 GAAAAATTTAC SEQ ID No 4448 GCTCAAAAAGC SEQ ID No 4403 GCGATTTGGGC SEQ ID No 4449 GCTCAAAAATC SEQ ID No 4404 GCGATTTTTGC SEQ ID No 4450 GCTCCCTGGGC SEQ ID No 4405 GCGAAATGGGC SEQ ID No 4451 GCTCCCTTTGC SEQ ID No 4406 GCGAAATTTGC SEQ ID No 4452 GCTCCCAGGGC SEQ ID No 4407 GCGAAAAATGC SEQ ID No 4453 GCTCCCATTTC SEQ ID No 4408 GCGCTTTGGGC SEQ ID No 4454 GCTCCCAAAGC SEQ ID No 4409 GCGCTTTTTGC SEQ ID No 4455 GCTCCCAAATC SEQ ID No 4410 GCGCATTTTTC SEQ ID No 4456 GCTCCCCCTGC SEQ ID No 4411 GCGCAAAGGGC SEQ ID No 4457 GCTCCCCCAGC SEQ ID No 4412 GCGCAAATTTC SEQ ID No 4458 GCTCCCCCATC SEQ ID No 4413 GCGCAAAAAGC SEQ ID No 4459 GCTGTTTGGGC SEQ ID No 4414 GCGCAAAAATC SEQ ID No 4460 GCTGTTTTTGC SEQ ID No 4415 GCGCCCTGGGC SEQ ID No 4461 GCTGATTTTTC SEQ ID No 4416 GCGCCCTTTGC SEQ ID No 4462 GCTGAAAGGGC SEQ ID No 4417 GCGCCCAGGGC SEQ ID No 4463 GCTGAAATTTC SEQ ID No 4418 GCGCCCATTTC SEQ ID No 4464 GCTGAAAAAGC SEQ ID No 4419 GCGCCCAAAGC SEQ ID No 4465 GCTGAAAAATC SEQ ID No 4420 GCGCCCAAATC SEQ ID No 4466 GCTGCTTTTTC SEQ ID No 4421 GCGCCCCCTGC SEQ ID No 4467 GCTGCATGGGC SEQ ID No 4422 GCGCCCCCAGC SEQ ID No 4468 GCTGCATTTGC SEQ ID No 4423 GCGCCCCCATC SEQ ID No 4469 GCTGCAAATGC SEQ ID No 4424 GCGGGTTTTTC SEQ ID No 4470 GCTGCAAAAAC SEQ ID No 4425 GCGGGATGGGC SEQ ID No 4471 GCTGCCCGGGC SEQ ID No 4426 GCGGGATTTGC SEQ ID No 4472 GCTGCCCTTTC SEQ ID No 4427 GCGGGAAATGC SEQ ID No 4473 GCTGCCCATGC SEQ ID No 4428 GCGGGAAAAAC SEQ ID No 4474 GCTGCCCAAAC SEQ ID No 4429 GCGGGCTGGGC SEQ ID No 4475 GCTGCCCCCGC SEQ ID No 4430 GCGGGCTTTGC SEQ ID No 4476 GCTGCCCCCTCSEQ ID No 4431 GCGGGCAGGGCSEQ ID No 4477 GCTGCCCCCAC -111- 182358171.1SEQ ID No 4478 GCTGGGTGGGC SEQ ID No 4524 GCTTTTTAAAC SEQ ID No 4479 GCTGGGTTTGC SEQ ID No 4525 GCTTTTTCTGC SEQ ID No 4480 GCTGGGAGGGC SEQ ID No 4526 GCTTTTTCAGC SEQ ID No 4481 GCTGGGATTTC SEQ ID No 4527 GCTTTTTCATC SEQ ID No 4482 GCTGGGAAAGC SEQ ID No 4528 GCTTTTTGTGC SEQ ID No 4483 GCTGGGAAATC SEQ ID No 4529 GCTTTTTGAGC SEQ ID No 4484 GCTGGGCGGGC SEQ ID No 4530 GCTTTTTGATC SEQ ID No 4485 GCTGGGCTTTC SEQ ID No 4531 GCTTTTTGCGC SEQ ID No 4486 GCTGGGCATGC SEQ ID No 4532 GCTTTTTGCTC SEQ ID No 4487 GCTGGGCAAAC SEQ ID No 4533 GCTTTTTGCAC SEQ ID No 4488 GCTGGGCCCGC SEQ ID No 4534 GCACTTTGGGC SEQ ID No 4489 GCTGGGCCCTC SEQ ID No 4535 GCACTTTTTGC SEQ ID No 4490 GCTGGGCCCAC SEQ ID No 4536 GCACATTTTTC SEQ ID No 4491 GCTTTATGGGC SEQ ID No 4537 GCACAAAGGGC SEQ ID No 4492 GCTTTATTTGC SEQ ID No 4538 GCACAAATTTC SEQ ID No 4493 GCTTTAAATGC SEQ ID No 4539 GCACAAAAAGC SEQ ID No 4494 GCTTTAAAAAC SEQ ID No 4540 GCACAAAAATC SEQ ID No 4495 GCTTTCTGGGC SEQ ID No 4541 GCACCCTGGGC SEQ ID No 4496 GCTTTCTTTGC SEQ ID No 4542 GCACCCTTTGC SEQ ID No 4497 GCTTTCAGGGC SEQ ID No 4543 GCACCCAGGGC SEQ ID No 4498 GCTTTCATTTC SEQ ID No 4544 GCACCCATTTC SEQ ID No 4499 GCTTTCAAAGC SEQ ID No 4545 GCACCCAAAGC SEQ ID No 4500 GCTTTCAAATC SEQ ID No 4546 GCACCCAAATC SEQ ID No 4501 GCTTTCCCTGC SEQ ID No 4547 GCACCCCCTGC SEQ ID No 4502 GCTTTCCCAGC SEQ ID No 4548 GCACCCCCAGC SEQ ID No 4503 GCTTTCCCATC SEQ ID No 4549 GCACCCCCATC SEQ ID No 4504 GCTTTGTGGGC SEQ ID No 4550 GCAGTTTGGGC SEQ ID No 4505 GCTTTGTTTGC SEQ ID No 4551 GCAGTTTTTGC SEQ ID No 4506 GCTTTGAGGGC SEQ ID No 4552 GCAGATTTTTC SEQ ID No 4507 GCTTTGATTTC SEQ ID No 4553 GCAGAAAGGGC SEQ ID No 4508 GCTTTGAAAGC SEQ ID No 4554 GCAGAAATTTC SEQ ID No 4509 GCTTTGAAATC SEQ ID No 4555 GCAGAAAAAGC SEQ ID No 4510 GCTTTGCGGGC SEQ ID No 4556 GCAGAAAAATC SEQ ID No 4511 GCTTTGCTTTC SEQ ID No 4557 GCAGCTTTTTC SEQ ID No 4512 GCTTTGCATGC SEQ ID No 4558 GCAGCATGGGC SEQ ID No 4513 GCTTTGCAAAC SEQ ID No 4559 GCAGCATTTGC SEQ ID No 4514 GCTTTGCCCGC SEQ ID No 4560 GCAGCAAATGC SEQ ID No 4515 GCTTTGCCCTC SEQ ID No 4561 GCAGCAAAAAC SEQ ID No 4516 GCTTTGCCCAC SEQ ID No 4562 GCAGCCCGGGC SEQ ID No 4517 GCTTTGGGTGC SEQ ID No 4563 GCAGCCCTTTC SEQ ID No 4518 GCTTTGGGAGC SEQ ID No 4564 GCAGCCCATGC SEQ ID No 4519 GCTTTGGGATC SEQ ID No 4565 GCAGCCCAAAC SEQ ID No 4520 GCTTTGGGCGC SEQ ID No 4566 GCAGCCCCCGC SEQ ID No 4521 GCTTTGGGCTC SEQ ID No 4567 GCAGCCCCCTC SEQ ID No 4522 GCTTTGGGCAC SEQ ID No 4568 GCAGCCCCCACSEQ ID No 4523 GCTTTTTATGCSEQ ID No 4569 GCAGGGTGGGC -112- 182358171.1SEQ ID No 4570 GCAGGGTTTGC SEQ ID No 4616 GCATGGGCTGC SEQ ID No 4571 GCAGGGAGGGC SEQ ID No 4617 GCATGGGCAGC SEQ ID No 4572 GCAGGGATTTC SEQ ID No 4618 GCATGGGCATC SEQ ID No 4573 GCAGGGAAAGC SEQ ID No 4619 GCATTTAGGGC SEQ ID No 4574 GCAGGGAAATC SEQ ID No 4620 GCATTTATTTC SEQ ID No 4575 GCAGGGCGGGC SEQ ID No 4621 GCATTTAAAGC SEQ ID No 4576 GCAGGGCTTTC SEQ ID No 4622 GCATTTAAATC SEQ ID No 4577 GCAGGGCATGC SEQ ID No 4623 GCATTTCGGGC SEQ ID No 4578 GCAGGGCAAAC SEQ ID No 4624 GCATTTCTTTC SEQ ID No 4579 GCAGGGCCCGC SEQ ID No 4625 GCATTTCATGC SEQ ID No 4580 GCAGGGCCCTC SEQ ID No 4626 GCATTTCAAAC SEQ ID No 4581 GCAGGGCCCAC SEQ ID No 4627 GCATTTCCCGC SEQ ID No 4582 GCATATTTTTC SEQ ID No 4628 GCATTTCCCTC SEQ ID No 4583 GCATAAAGGGC SEQ ID No 4629 GCATTTCCCAC SEQ ID No 4584 GCATAAATTTC SEQ ID No 4630 GCATTTGTTTC SEQ ID No 4585 GCATAAAAAGC SEQ ID No 4631 GCATTTGATGC SEQ ID No 4586 GCATAAAAATC SEQ ID No 4632 GCATTTGAAAC SEQ ID No 4587 GCATCTTTTTC SEQ ID No 4633 GCATTTGCTGC SEQ ID No 4588 GCATCATGGGC SEQ ID No 4634 GCATTTGCAGC SEQ ID No 4589 GCATCATTTGC SEQ ID No 4635 GCATTTGCATC SEQ ID No 4590 GCATCAAATGC SEQ ID No 4636 GCATTTGGGTC SEQ ID No 4591 GCATCAAAAAC SEQ ID No 4637 GCATTTGGGAC SEQ ID No 4592 GCATCCCGGGC SEQ ID No 4638 GCATTTTTAGC SEQ ID No 4593 GCATCCCTTTC SEQ ID No 4639 GCATTTTTATC SEQ ID No 4594 GCATCCCATGC SEQ ID No 4640 GCATTTTTCGC SEQ ID No 4595 GCATCCCAAAC SEQ ID No 4641 GCATTTTTCTC SEQ ID No 4596 GCATCCCCCGC SEQ ID No 4642 GCATTTTTCAC SEQ ID No 4597 GCATCCCCCTC SEQ ID No 4643 GCATTTTTGTC SEQ ID No 4598 GCATCCCCCAC SEQ ID No 4644 GCATTTTTGAC SEQ ID No 4599 GCATGTTTTTC SEQ ID No 4645 GCAAACTGGGC SEQ ID No 4600 GCATGATGGGC SEQ ID No 4646 GCAAACTTTGC SEQ ID No 4601 GCATGATTTGC SEQ ID No 4647 GCAAACAGGGC SEQ ID No 4602 GCATGAAATGC SEQ ID No 4648 GCAAACATTTC SEQ ID No 4603 GCATGAAAAAC SEQ ID No 4649 GCAAACAAAGC SEQ ID No 4604 GCATGCTGGGC SEQ ID No 4650 GCAAACAAATC SEQ ID No 4605 GCATGCTTTGC SEQ ID No 4651 GCAAACCCTGC SEQ ID No 4606 GCATGCAGGGC SEQ ID No 4652 GCAAACCCAGC SEQ ID No 4607 GCATGCATTTC SEQ ID No 4653 GCAAACCCATC SEQ ID No 4608 GCATGCAAAGC SEQ ID No 4654 GCAAAGTGGGC SEQ ID No 4609 GCATGCAAATC SEQ ID No 4655 GCAAAGTTTGC SEQ ID No 4610 GCATGCCCTGC SEQ ID No 4656 GCAAAGAGGGC SEQ ID No 4611 GCATGCCCAGC SEQ ID No 4657 GCAAAGATTTC SEQ ID No 4612 GCATGCCCATC SEQ ID No 4658 GCAAAGAAAGC SEQ ID No 4613 GCATGGGTTTC SEQ ID No 4659 GCAAAGAAATC SEQ ID No 4614 GCATGGGATGC SEQ ID No 4660 GCAAAGCGGGCSEQ ID No 4615 GCATGGGAAACSEQ ID No 4661 GCAAAGCTTTC182358171.1SEQ ID No 4662 GCAAAGCATGC SEQ ID No 4708 GCAAAAATAGC SEQ ID No 4663 GCAAAGCAAAC SEQ ID No 4709 GCAAAAATATC SEQ ID No 4664 GCAAAGCCCGC SEQ ID No 4710 GCAAAAATCGC SEQ ID No 4665 GCAAAGCCCTC SEQ ID No 4711 GCAAAAATCTC SEQ ID No 4666 GCAAAGCCCAC SEQ ID No 4712 GCAAAAATCAC SEQ ID No 4667 GCAAAGGGTGC SEQ ID No 4713 GCAAAAATGTC SEQ ID No 4668 GCAAAGGGAGC SEQ ID No 4714 GCAAAAATGAC SEQ ID No 4669 GCAAAGGGATC SEQ ID No 4715 GCCCGTTTTTC SEQ ID No 4670 GCAAAGGGCGC SEQ ID No 4716 GCCCGATGGGC SEQ ID No 4671 GCAAAGGGCTC SEQ ID No 4717 GCCCGATTTGC SEQ ID No 4672 GCAAAGGGCAC SEQ ID No 4718 GCCCGAAATGC SEQ ID No 4673 GCAAATAGGGC SEQ ID No 4719 GCCCGAAAAAC SEQ ID No 4674 GCAAATATTTC SEQ ID No 4720 GCCCGCTGGGC SEQ ID No 4675 GCAAATAAAGC SEQ ID No 4721 GCCCGCTTTGC SEQ ID No 4676 GCAAATAAATC SEQ ID No 4722 GCCCGCAGGGC SEQ ID No 4677 GCAAATCGGGC SEQ ID No 4723 GCCCGCATTTC SEQ ID No 4678 GCAAATCTTTC SEQ ID No 4724 GCCCGCAAAGC SEQ ID No 4679 GCAAATCATGC SEQ ID No 4725 GCCCGCAAATC SEQ ID No 4680 GCAAATCAAAC SEQ ID No 4726 GCCCGCCCTGC SEQ ID No 4681 GCAAATCCCGC SEQ ID No 4727 GCCCGCCCAGC SEQ ID No 4682 GCAAATCCCTC SEQ ID No 4728 GCCCGCCCATC SEQ ID No 4683 GCAAATCCCAC SEQ ID No 4729 GCCCGGGTTTC SEQ ID No 4684 GCAAATGTTTC SEQ ID No 4730 GCCCGGGATGC SEQ ID No 4685 GCAAATGATGC SEQ ID No 4731 GCCCGGGAAAC SEQ ID No 4686 GCAAATGAAAC SEQ ID No 4732 GCCCGGGCTGC SEQ ID No 4687 GCAAATGCTGC SEQ ID No 4733 GCCCGGGCAGC SEQ ID No 4688 GCAAATGCAGC SEQ ID No 4734 GCCCGGGCATC SEQ ID No 4689 GCAAATGCATC SEQ ID No 4735 GCCCTATGGGC SEQ ID No 4690 GCAAATGGGTC SEQ ID No 4736 GCCCTATTTGC SEQ ID No 4691 GCAAATGGGAC SEQ ID No 4737 GCCCTAAATGC SEQ ID No 4692 GCAAATTTAGC SEQ ID No 4738 GCCCTAAAAAC SEQ ID No 4693 GCAAATTTATC SEQ ID No 4739 GCCCTCTGGGC SEQ ID No 4694 GCAAATTTCGC SEQ ID No 4740 GCCCTCTTTGC SEQ ID No 4695 GCAAATTTCTC SEQ ID No 4741 GCCCTCAGGGC SEQ ID No 4696 GCAAATTTCAC SEQ ID No 4742 GCCCTCATTTC SEQ ID No 4697 GCAAATTTGTC SEQ ID No 4743 GCCCTCAAAGC SEQ ID No 4698 GCAAATTTGAC SEQ ID No 4744 GCCCTCAAATC SEQ ID No 4699 GCAAAAACTGC SEQ ID No 4745 GCCCTCCCTGC SEQ ID No 4700 GCAAAAACAGC SEQ ID No 4746 GCCCTCCCAGC SEQ ID No 4701 GCAAAAACATC SEQ ID No 4747 GCCCTCCCATC SEQ ID No 4702 GCAAAAAGTGC SEQ ID No 4748 GCCCTGTGGGC SEQ ID No 4703 GCAAAAAGAGC SEQ ID No 4749 GCCCTGTTTGC SEQ ID No 4704 GCAAAAAGATC SEQ ID No 4750 GCCCTGAGGGC SEQ ID No 4705 GCAAAAAGCGC SEQ ID No 4751 GCCCTGATTTC SEQ ID No 4706 GCAAAAAGCTC SEQ ID No 4752 GCCCTGAAAGCSEQ ID No 4707 GCAAAAAGCACSEQ ID No 4753 GCCCTGAAATC -114- 182358171.1SEQ ID No 4754 GCCCTGCGGGC SEQ ID No 4800 GCCCAGCCCAC SEQ ID No 4755 GCCCTGCTTTC SEQ ID No 4801 GCCCAGGGTGC SEQ ID No 4756 GCCCTGCATGC SEQ ID No 4802 GCCCAGGGAGC SEQ ID No 4757 GCCCTGCAAAC SEQ ID No 4803 GCCCAGGGATC SEQ ID No 4758 GCCCTGCCCGC SEQ ID No 4804 GCCCAGGGCGC SEQ ID No 4759 GCCCTGCCCTC SEQ ID No 4805 GCCCAGGGCTC SEQ ID No 4760 GCCCTGCCCAC SEQ ID No 4806 GCCCAGGGCAC SEQ ID No 4761 GCCCTGGGTGC SEQ ID No 4807 GCCCATAGGGC SEQ ID No 4762 GCCCTGGGAGC SEQ ID No 4808 GCCCATATTTC SEQ ID No 4763 GCCCTGGGATC SEQ ID No 4809 GCCCATAAAGC SEQ ID No 4764 GCCCTGGGCGC SEQ ID No 4810 GCCCATAAATC SEQ ID No 4765 GCCCTGGGCTC SEQ ID No 4811 GCCCATCGGGC SEQ ID No 4766 GCCCTGGGCAC SEQ ID No 4812 GCCCATCTTTC SEQ ID No 4767 GCCCTTTATGC SEQ ID No 4813 GCCCATCATGC SEQ ID No 4768 GCCCTTTAAAC SEQ ID No 4814 GCCCATCAAAC SEQ ID No 4769 GCCCTTTCTGC SEQ ID No 4815 GCCCATCCCGC SEQ ID No 4770 GCCCTTTCAGC SEQ ID No 4816 GCCCATCCCTC SEQ ID No 4771 GCCCTTTCATC SEQ ID No 4817 GCCCATCCCAC SEQ ID No 4772 GCCCTTTGTGC SEQ ID No 4818 GCCCATGTTTC SEQ ID No 4773 GCCCTTTGAGC SEQ ID No 4819 GCCCATGATGC SEQ ID No 4774 GCCCTTTGATC SEQ ID No 4820 GCCCATGAAAC SEQ ID No 4775 GCCCTTTGCGC SEQ ID No 4821 GCCCATGCTGC SEQ ID No 4776 GCCCTTTGCTC SEQ ID No 4822 GCCCATGCAGC SEQ ID No 4777 GCCCTTTGCAC SEQ ID No 4823 GCCCATGCATC SEQ ID No 4778 GCCCTTTTTAC SEQ ID No 4824 GCCCATGGGTC SEQ ID No 4779 GCCCACTGGGC SEQ ID No 4825 GCCCATGGGAC SEQ ID No 4780 GCCCACTTTGC SEQ ID No 4826 GCCCATTTAGC SEQ ID No 4781 GCCCACAGGGC SEQ ID No 4827 GCCCATTTATC SEQ ID No 4782 GCCCACATTTC SEQ ID No 4828 GCCCATTTCGC SEQ ID No 4783 GCCCACAAAGC SEQ ID No 4829 GCCCATTTCTC SEQ ID No 4784 GCCCACAAATC SEQ ID No 4830 GCCCATTTCAC SEQ ID No 4785 GCCCACCCTGC SEQ ID No 4831 GCCCATTTGTC SEQ ID No 4786 GCCCACCCAGC SEQ ID No 4832 GCCCATTTGAC SEQ ID No 4787 GCCCACCCATC SEQ ID No 4833 GCCCAAACTGC SEQ ID No 4788 GCCCAGTGGGC SEQ ID No 4834 GCCCAAACAGC SEQ ID No 4789 GCCCAGTTTGC SEQ ID No 4835 GCCCAAACATC SEQ ID No 4790 GCCCAGAGGGC SEQ ID No 4836 GCCCAAAGTGC SEQ ID No 4791 GCCCAGATTTC SEQ ID No 4837 GCCCAAAGAGC SEQ ID No 4792 GCCCAGAAAGC SEQ ID No 4838 GCCCAAAGATC SEQ ID No 4793 GCCCAGAAATC SEQ ID No 4839 GCCCAAAGCGC SEQ ID No 4794 GCCCAGCGGGC SEQ ID No 4840 GCCCAAAGCTC SEQ ID No 4795 GCCCAGCTTTC SEQ ID No 4841 GCCCAAAGCAC SEQ ID No 4796 GCCCAGCATGC SEQ ID No 4842 GCCCAAATAGC SEQ ID No 4797 GCCCAGCAAAC SEQ ID No 4843 GCCCAAATATC SEQ ID No 4798 GCCCAGCCCGC SEQ ID No 4844 GCCCAAATCGCSEQ ID No 4799 GCCCAGCCCTCSEQ ID No 4845 GCCCAAATCTC -115- 182358171.1SEQ ID No 4846 GCCCAAATCAC SEQ ID No: 4859 GCCCCCTCTGC SEQ ID No 4847 GCCCAAATGTC SEQ ID No: 4860 GCCCCCTCAGC SEQ ID No 4848 GCCCAAATGAC SEQ ID No: 4861 GCCCCCTCATC SEQ ID No 4849 GCCCCCGTTTC SEQ ID No: 4862 GCCCCCTGTGC SEQ ID No 4850 GCCCCCGATGC SEQ ID No: 4863 GCCCCCTGAGC SEQ ID No 4851 GCCCCCGAAAC SEQ ID No: 4864 GCCCCCTGATC SEQ ID No 4852 GCCCCCGCTGC SEQ ID No: 4865 GCCCCCTGCGC SEQ ID No 4853 GCCCCCGCAGC SEQ ID No: 4866 GCCCCCTGCTC SEQ ID No 4854 GCCCCCGCATC SEQ ID No: 4867 GCCCCCTGCAC SEQ ID No 4855 GCCCCCGGGTC SEQ ID No: 4868 GCCCCCTTTAC SEQ ID No 4856 GCCCCCGGGAC SEQ ID No: 4869 GCCCCCACTGC SEQ ID No 4857 GCCCCCTATGC SEQ ID No: 4870 GCCCCCACAGCSEQ ID No 4858 GCCCCCTAAACSEQ ID No: 4871 GCCCCCACATC

[0096] Table 8: Barcode sequences, 8 flows, ending in TSEQ ID No: Sequence, 5’-3’ SEQ ID No 4899 ACATGGGCCCT SEQ ID No 4872 ACGGGAAAAAT SEQ ID No 4900 ACATTTCAAAT SEQ ID No 4873 ACGGGCCCCCT SEQ ID No 4901 ACATTTCCCAT SEQ ID No 4874 ACTGCAAAAAT SEQ ID No 4902 ACATTTGAAAT SEQ ID No 4875 ACTGCCCAAAT SEQ ID No 4903 ACATTTGCCCT SEQ ID No 4876 ACTGCCCCCAT SEQ ID No 4904 ACATTTGGGAT SEQ ID No 4877 ACTGGGCAAAT SEQ ID No 4905 ACATTTGGGCT SEQ ID No 4878 ACTGGGCCCAT SEQ ID No 4906 ACATTTTTCAT SEQ ID No 4879 ACTTTAAAAAT SEQ ID No 4907 ACATTTTTGAT SEQ ID No 4880 ACTTTCCCCCT SEQ ID No 4908 ACATTTTTGCT SEQ ID No 4881 ACTTTGCAAAT SEQ ID No 4909 ACAAACCCCCT SEQ ID No 4882 ACTTTGCCCAT SEQ ID No 4910 ACAAAGCAAAT SEQ ID No 4883 ACTTTGGGCAT SEQ ID No 4911 ACAAAGCCCAT SEQ ID No 4884 ACTTTTTAAAT SEQ ID No 4912 ACAAAGGGCAT SEQ ID No 4885 ACTTTTTCCCT SEQ ID No 4913 ACAAATCAAAT SEQ ID No 4886 ACTTTTTGCAT SEQ ID No 4914 ACAAATCCCAT SEQ ID No 4887 ACTTTTTGGGT SEQ ID No 4915 ACAAATGAAAT SEQ ID No 4888 ACAGCAAAAAT SEQ ID No 4916 ACAAATGCCCT SEQ ID No 4889 ACAGCCCAAAT SEQ ID No 4917 ACAAATGGGAT SEQ ID No 4890 ACAGCCCCCAT SEQ ID No 4918 ACAAATGGGCT SEQ ID No 4891 ACAGGGCAAAT SEQ ID No 4919 ACAAATTTCAT SEQ ID No 4892 ACAGGGCCCAT SEQ ID No 4920 ACAAATTTGAT SEQ ID No 4893 ACATCAAAAAT SEQ ID No 4921 ACAAATTTGCT SEQ ID No 4894 ACATCCCAAAT SEQ ID No 4922 ACAAAAACCCT SEQ ID No 4895 ACATCCCCCAT SEQ ID No 4923 ACAAAAAGCAT SEQ ID No 4896 ACATGAAAAAT SEQ ID No 4924 ACAAAAAGGGT SEQ ID No 4897 ACATGCCCCCT SEQ ID No 4925 ACAAAAATCATSEQ ID No 4898 ACATGGGAAATSEQ ID No 4926 ACAAAAATGAT -116- 182358171.1SEQ ID No 4927 ACAAAAATGCT SEQ ID No 4969 ACCCCCTAAAT SEQ ID No 4928 ACCCGAAAAAT SEQ ID No 4970 ACCCCCTCCCT SEQ ID No 4929 ACCCGCCCCCT SEQ ID No 4971 ACCCCCTGCAT SEQ ID No 4930 ACCCGGGAAAT SEQ ID No 4972 ACCCCCTGGGT SEQ ID No 4931 ACCCGGGCCCT SEQ ID No 4973 ACCCCCTTTAT SEQ ID No 4932 ACCCTAAAAAT SEQ ID No 4974 ACCCCCTTTCT SEQ ID No 4933 ACCCTCCCCCT SEQ ID No 4975 ACCCCCTTTGT SEQ ID No 4934 ACCCTGCAAAT SEQ ID No 4976 ACCCCCACCCT SEQ ID No 4935 ACCCTGCCCAT SEQ ID No 4977 ACCCCCAGCAT SEQ ID No 4936 ACCCTGGGCAT SEQ ID No 4978 ACCCCCAGGGT SEQ ID No 4937 ACCCTTTAAAT SEQ ID No 4979 ACCCCCATCAT SEQ ID No 4938 ACCCTTTCCCT SEQ ID No 4980 ACCCCCATGAT SEQ ID No 4939 ACCCTTTGCAT SEQ ID No 4981 ACCCCCATGCT SEQ ID No 4940 ACCCTTTGGGT SEQ ID No 4982 ACCCCCAAACT SEQ ID No 4941 ACCCTTTTTAT SEQ ID No 4983 ACCCCCAAAGT SEQ ID No 4942 ACCCTTTTTCT SEQ ID No 4984 AGTGCAAAAAT SEQ ID No 4943 ACCCTTTTTGT SEQ ID No 4985 AGTGCCCAAAT SEQ ID No 4944 ACCCACCCCCT SEQ ID No 4986 AGTGCCCCCAT SEQ ID No 4945 ACCCAGCAAAT SEQ ID No 4987 AGTGGGCAAAT SEQ ID No 4946 ACCCAGCCCAT SEQ ID No 4988 AGTGGGCCCAT SEQ ID No 4947 ACCCAGGGCAT SEQ ID No 4989 AGTTTAAAAAT SEQ ID No 4948 ACCCATCAAAT SEQ ID No 4990 AGTTTCCCCCT SEQ ID No 4949 ACCCATCCCAT SEQ ID No 4991 AGTTTGCAAAT SEQ ID No 4950 ACCCATGAAAT SEQ ID No 4992 AGTTTGCCCAT SEQ ID No 4951 ACCCATGCCCT SEQ ID No 4993 AGTTTGGGCAT SEQ ID No 4952 ACCCATGGGAT SEQ ID No 4994 AGTTTTTAAAT SEQ ID No 4953 ACCCATGGGCT SEQ ID No 4995 AGTTTTTCCCT SEQ ID No 4954 ACCCATTTCAT SEQ ID No 4996 AGTTTTTGCAT SEQ ID No 4955 ACCCATTTGAT SEQ ID No 4997 AGTTTTTGGGT SEQ ID No 4956 ACCCATTTGCT SEQ ID No 4998 AGAGCAAAAAT SEQ ID No 4957 ACCCAAACCCT SEQ ID No 4999 AGAGCCCAAAT SEQ ID No 4958 ACCCAAAGCAT SEQ ID No 5000 AGAGCCCCCAT SEQ ID No 4959 ACCCAAAGGGT SEQ ID No 5001 AGAGGGCAAAT SEQ ID No 4960 ACCCAAATCAT SEQ ID No 5002 AGAGGGCCCAT SEQ ID No 4961 ACCCAAATGAT SEQ ID No 5003 AGATCAAAAAT SEQ ID No 4962 ACCCAAATGCT SEQ ID No 5004 AGATCCCAAAT SEQ ID No 4963 ACCCAAAAACT SEQ ID No 5005 AGATCCCCCAT SEQ ID No 4964 ACCCAAAAAGT SEQ ID No 5006 AGATGAAAAAT SEQ ID No 4965 ACCCCCGAAAT SEQ ID No 5007 AGATGCCCCCT SEQ ID No 4966 ACCCCCGCCCT SEQ ID No 5008 AGATGGGAAAT SEQ ID No 4967 ACCCCCGGGAT SEQ ID No 5009 AGATGGGCCCTSEQ ID No 4968 ACCCCCGGGCTSEQ ID No 5010 AGATTTCAAAT -117- 182358171.1SEQ ID No 5011 AGATTTCCCAT SEQ ID No 5053 AGCTTTGCCCT SEQ ID No 5012 AGATTTGAAAT SEQ ID No 5054 AGCTTTGGGAT SEQ ID No 5013 AGATTTGCCCT SEQ ID No 5055 AGCTTTGGGCT SEQ ID No 5014 AGATTTGGGAT SEQ ID No 5056 AGCTTTTTCAT SEQ ID No 5015 AGATTTGGGCT SEQ ID No 5057 AGCTTTTTGAT SEQ ID No 5016 AGATTTTTCAT SEQ ID No 5058 AGCTTTTTGCT SEQ ID No 5017 AGATTTTTGAT SEQ ID No 5059 AGCACAAAAAT SEQ ID No 5018 AGATTTTTGCT SEQ ID No 5060 AGCACCCAAAT SEQ ID No 5019 AGAAACCCCCT SEQ ID No 5061 AGCACCCCCAT SEQ ID No 5020 AGAAAGCAAAT SEQ ID No 5062 AGCAGAAAAAT SEQ ID No 5021 AGAAAGCCCAT SEQ ID No 5063 AGCAGCCCCCT SEQ ID No 5022 AGAAAGGGCAT SEQ ID No 5064 AGCAGGGAAAT SEQ ID No 5023 AGAAATCAAAT SEQ ID No 5065 AGCAGGGCCCT SEQ ID No 5024 AGAAATCCCAT SEQ ID No 5066 AGCATAAAAAT SEQ ID No 5025 AGAAATGAAAT SEQ ID No 5067 AGCATCCCCCT SEQ ID No 5026 AGAAATGCCCT SEQ ID No 5068 AGCATGCAAAT SEQ ID No 5027 AGAAATGGGAT SEQ ID No 5069 AGCATGCCCAT SEQ ID No 5028 AGAAATGGGCT SEQ ID No 5070 AGCATGGGCAT SEQ ID No 5029 AGAAATTTCAT SEQ ID No 5071 AGCATTTAAAT SEQ ID No 5030 AGAAATTTGAT SEQ ID No 5072 AGCATTTCCCT SEQ ID No 5031 AGAAATTTGCT SEQ ID No 5073 AGCATTTGCAT SEQ ID No 5032 AGAAAAACCCT SEQ ID No 5074 AGCATTTGGGT SEQ ID No 5033 AGAAAAAGCAT SEQ ID No 5075 AGCATTTTTAT SEQ ID No 5034 AGAAAAAGGGT SEQ ID No 5076 AGCATTTTTCT SEQ ID No 5035 AGAAAAATCAT SEQ ID No 5077 AGCATTTTTGT SEQ ID No 5036 AGAAAAATGAT SEQ ID No 5078 AGCAAACAAAT SEQ ID No 5037 AGAAAAATGCT SEQ ID No 5079 AGCAAACCCAT SEQ ID No 5038 AGCGCAAAAAT SEQ ID No 5080 AGCAAAGAAAT SEQ ID No 5039 AGCGCCCAAAT SEQ ID No 5081 AGCAAAGCCCT SEQ ID No 5040 AGCGCCCCCAT SEQ ID No 5082 AGCAAAGGGAT SEQ ID No 5041 AGCGGGCAAAT SEQ ID No 5083 AGCAAAGGGCT SEQ ID No 5042 AGCGGGCCCAT SEQ ID No 5084 AGCAAATAAAT SEQ ID No 5043 AGCTCAAAAAT SEQ ID No 5085 AGCAAATCCCT SEQ ID No 5044 AGCTCCCAAAT SEQ ID No 5086 AGCAAATGCAT SEQ ID No 5045 AGCTCCCCCAT SEQ ID No 5087 AGCAAATGGGT SEQ ID No 5046 AGCTGAAAAAT SEQ ID No 5088 AGCAAATTTAT SEQ ID No 5047 AGCTGCCCCCT SEQ ID No 5089 AGCAAATTTCT SEQ ID No 5048 AGCTGGGAAAT SEQ ID No 5090 AGCAAATTTGT SEQ ID No 5049 AGCTGGGCCCT SEQ ID No 5091 AGCAAAAACAT SEQ ID No 5050 AGCTTTCAAAT SEQ ID No 5092 AGCAAAAAGAT SEQ ID No 5051 AGCTTTCCCAT SEQ ID No 5093 AGCAAAAAGCTSEQ ID No 5052 AGCTTTGAAATSEQ ID No 5094 AGCAAAAATAT -118- 182358171.1SEQ ID No 5095 AGCAAAAATCT SEQ ID No 5137 AGCCCCCATCT SEQ ID No 5096 AGCAAAAATGT SEQ ID No 5138 AGCCCCCATGT SEQ ID No 5097 AGCCCGCAAAT SEQ ID No 5139 AGGGTAAAAAT SEQ ID No 5098 AGCCCGCCCAT SEQ ID No 5140 AGGGTCCCCCT SEQ ID No 5099 AGCCCGGGCAT SEQ ID No 5141 AGGGTGCAAAT SEQ ID No 5100 AGCCCTCAAAT SEQ ID No 5142 AGGGTGCCCAT SEQ ID No 5101 AGCCCTCCCAT SEQ ID No 5143 AGGGTGGGCAT SEQ ID No 5102 AGCCCTGAAAT SEQ ID No 5144 AGGGTTTAAAT SEQ ID No 5103 AGCCCTGCCCT SEQ ID No 5145 AGGGTTTCCCT SEQ ID No 5104 AGCCCTGGGAT SEQ ID No 5146 AGGGTTTGCAT SEQ ID No 5105 AGCCCTGGGCT SEQ ID No 5147 AGGGTTTGGGT SEQ ID No 5106 AGCCCTTTCAT SEQ ID No 5148 AGGGTTTTTAT SEQ ID No 5107 AGCCCTTTGAT SEQ ID No 5149 AGGGTTTTTCT SEQ ID No 5108 AGCCCTTTGCT SEQ ID No 5150 AGGGTTTTTGT SEQ ID No 5109 AGCCCACAAAT SEQ ID No 5151 AGGGACCCCCT SEQ ID No 5110 AGCCCACCCAT SEQ ID No 5152 AGGGAGCAAAT SEQ ID No 5111 AGCCCAGAAAT SEQ ID No 5153 AGGGAGCCCAT SEQ ID No 5112 AGCCCAGCCCT SEQ ID No 5154 AGGGAGGGCAT SEQ ID No 5113 AGCCCAGGGAT SEQ ID No 5155 AGGGATCAAAT SEQ ID No 5114 AGCCCAGGGCT SEQ ID No 5156 AGGGATCCCAT SEQ ID No 5115 AGCCCATAAAT SEQ ID No 5157 AGGGATGAAAT SEQ ID No 5116 AGCCCATCCCT SEQ ID No 5158 AGGGATGCCCT SEQ ID No 5117 AGCCCATGCAT SEQ ID No 5159 AGGGATGGGAT SEQ ID No 5118 AGCCCATGGGT SEQ ID No 5160 AGGGATGGGCT SEQ ID No 5119 AGCCCATTTAT SEQ ID No 5161 AGGGATTTCAT SEQ ID No 5120 AGCCCATTTCT SEQ ID No 5162 AGGGATTTGAT SEQ ID No 5121 AGCCCATTTGT SEQ ID No 5163 AGGGATTTGCT SEQ ID No 5122 AGCCCAAACAT SEQ ID No 5164 AGGGAAACCCT SEQ ID No 5123 AGCCCAAAGAT SEQ ID No 5165 AGGGAAAGCAT SEQ ID No 5124 AGCCCAAAGCT SEQ ID No 5166 AGGGAAAGGGT SEQ ID No 5125 AGCCCAAATAT SEQ ID No 5167 AGGGAAATCAT SEQ ID No 5126 AGCCCAAATCT SEQ ID No 5168 AGGGAAATGAT SEQ ID No 5127 AGCCCAAATGT SEQ ID No 5169 AGGGAAATGCT SEQ ID No 5128 AGCCCCCGCAT SEQ ID No 5170 AGGGAAAAACT SEQ ID No 5129 AGCCCCCGGGT SEQ ID No 5171 AGGGAAAAAGT SEQ ID No 5130 AGCCCCCTCAT SEQ ID No 5172 AGGGCGCAAAT SEQ ID No 5131 AGCCCCCTGAT SEQ ID No 5173 AGGGCGCCCAT SEQ ID No 5132 AGCCCCCTGCT SEQ ID No 5174 AGGGCGGGCAT SEQ ID No 5133 AGCCCCCACAT SEQ ID No 5175 AGGGCTCAAAT SEQ ID No 5134 AGCCCCCAGAT SEQ ID No 5176 AGGGCTCCCAT SEQ ID No 5135 AGCCCCCAGCT SEQ ID No 5177 AGGGCTGAAATSEQ ID No 5136 AGCCCCCATATSEQ ID No 5178 AGGGCTGCCCT -119- 182358171.1SEQ ID No 5179 AGGGCTGGGAT SEQ ID No 5221 ATATCCCAAAT SEQ ID No 5180 AGGGCTGGGCT SEQ ID No 5222 ATATCCCCCAT SEQ ID No 5181 AGGGCTTTCAT SEQ ID No 5223 ATATGAAAAAT SEQ ID No 5182 AGGGCTTTGAT SEQ ID No 5224 ATATGCCCCCT SEQ ID No 5183 AGGGCTTTGCT SEQ ID No 5225 ATATGGGAAAT SEQ ID No 5184 AGGGCACAAAT SEQ ID No 5226 ATATGGGCCCT SEQ ID No 5185 AGGGCACCCAT SEQ ID No 5227 ATATTTCAAAT SEQ ID No 5186 AGGGCAGAAAT SEQ ID No 5228 ATATTTCCCAT SEQ ID No 5187 AGGGCAGCCCT SEQ ID No 5229 ATATTTGAAAT SEQ ID No 5188 AGGGCAGGGAT SEQ ID No 5230 ATATTTGCCCT SEQ ID No 5189 AGGGCAGGGCT SEQ ID No 5231 ATATTTGGGAT SEQ ID No 5190 AGGGCATAAAT SEQ ID No 5232 ATATTTGGGCT SEQ ID No 5191 AGGGCATCCCT SEQ ID No 5233 ATATTTTTCAT SEQ ID No 5192 AGGGCATGCAT SEQ ID No 5234 ATATTTTTGAT SEQ ID No 5193 AGGGCATGGGT SEQ ID No 5235 ATATTTTTGCT SEQ ID No 5194 AGGGCATTTAT SEQ ID No 5236 ATAAACCCCCT SEQ ID No 5195 AGGGCATTTCT SEQ ID No 5237 ATAAAGCAAAT SEQ ID No 5196 AGGGCATTTGT SEQ ID No 5238 ATAAAGCCCAT SEQ ID No 5197 AGGGCAAACAT SEQ ID No 5239 ATAAAGGGCAT SEQ ID No 5198 AGGGCAAAGAT SEQ ID No 5240 ATAAATCAAAT SEQ ID No 5199 AGGGCAAAGCT SEQ ID No 5241 ATAAATCCCAT SEQ ID No 5200 AGGGCAAATAT SEQ ID No 5242 ATAAATGAAAT SEQ ID No 5201 AGGGCAAATCT SEQ ID No 5243 ATAAATGCCCT SEQ ID No 5202 AGGGCAAATGT SEQ ID No 5244 ATAAATGGGAT SEQ ID No 5203 AGGGCCCGCAT SEQ ID No 5245 ATAAATGGGCT SEQ ID No 5204 AGGGCCCGGGT SEQ ID No 5246 ATAAATTTCAT SEQ ID No 5205 AGGGCCCTCAT SEQ ID No 5247 ATAAATTTGAT SEQ ID No 5206 AGGGCCCTGAT SEQ ID No 5248 ATAAATTTGCT SEQ ID No 5207 AGGGCCCTGCT SEQ ID No 5249 ATAAAAACCCT SEQ ID No 5208 AGGGCCCACAT SEQ ID No 5250 ATAAAAAGCAT SEQ ID No 5209 AGGGCCCAGAT SEQ ID No 5251 ATAAAAAGGGT SEQ ID No 5210 AGGGCCCAGCT SEQ ID No 5252 ATAAAAATCAT SEQ ID No 5211 AGGGCCCATAT SEQ ID No 5253 ATAAAAATGAT SEQ ID No 5212 AGGGCCCATCT SEQ ID No 5254 ATAAAAATGCT SEQ ID No 5213 AGGGCCCATGT SEQ ID No 5255 ATCGCAAAAAT SEQ ID No 5214 AGGGCCCCCGT SEQ ID No 5256 ATCGCCCAAAT SEQ ID No 5215 ATAGCAAAAAT SEQ ID No 5257 ATCGCCCCCAT SEQ ID No 5216 ATAGCCCAAAT SEQ ID No 5258 ATCGGGCAAAT SEQ ID No 5217 ATAGCCCCCAT SEQ ID No 5259 ATCGGGCCCAT SEQ ID No 5218 ATAGGGCAAAT SEQ ID No 5260 ATCTCAAAAAT SEQ ID No 5219 ATAGGGCCCAT SEQ ID No 5261 ATCTCCCAAATSEQ ID No 5220 ATATCAAAAATSEQ ID No 5262 ATCTCCCCCAT -120- 182358171.1SEQ ID No 5263 ATCTGAAAAAT SEQ ID No 5305 ATCAAATTTAT SEQ ID No 5264 ATCTGCCCCCT SEQ ID No 5306 ATCAAATTTCT SEQ ID No 5265 ATCTGGGAAAT SEQ ID No 5307 ATCAAATTTGT SEQ ID No 5266 ATCTGGGCCCT SEQ ID No 5308 ATCAAAAACAT SEQ ID No 5267 ATCTTTCAAAT SEQ ID No 5309 ATCAAAAAGAT SEQ ID No 5268 ATCTTTCCCAT SEQ ID No 5310 ATCAAAAAGCT SEQ ID No 5269 ATCTTTGAAAT SEQ ID No 5311 ATCAAAAATAT SEQ ID No 5270 ATCTTTGCCCT SEQ ID No 5312 ATCAAAAATCT SEQ ID No 5271 ATCTTTGGGAT SEQ ID No 5313 ATCAAAAATGT SEQ ID No 5272 ATCTTTGGGCT SEQ ID No 5314 ATCCCGCAAAT SEQ ID No 5273 ATCTTTTTCAT SEQ ID No 5315 ATCCCGCCCAT SEQ ID No 5274 ATCTTTTTGAT SEQ ID No 5316 ATCCCGGGCAT SEQ ID No 5275 ATCTTTTTGCT SEQ ID No 5317 ATCCCTCAAAT SEQ ID No 5276 ATCACAAAAAT SEQ ID No 5318 ATCCCTCCCAT SEQ ID No 5277 ATCACCCAAAT SEQ ID No 5319 ATCCCTGAAAT SEQ ID No 5278 ATCACCCCCAT SEQ ID No 5320 ATCCCTGCCCT SEQ ID No 5279 ATCAGAAAAAT SEQ ID No 5321 ATCCCTGGGAT SEQ ID No 5280 ATCAGCCCCCT SEQ ID No 5322 ATCCCTGGGCT SEQ ID No 5281 ATCAGGGAAAT SEQ ID No 5323 ATCCCTTTCAT SEQ ID No 5282 ATCAGGGCCCT SEQ ID No 5324 ATCCCTTTGAT SEQ ID No 5283 ATCATAAAAAT SEQ ID No 5325 ATCCCTTTGCT SEQ ID No 5284 ATCATCCCCCT SEQ ID No 5326 ATCCCACAAAT SEQ ID No 5285 ATCATGCAAAT SEQ ID No 5327 ATCCCACCCAT SEQ ID No 5286 ATCATGCCCAT SEQ ID No 5328 ATCCCAGAAAT SEQ ID No 5287 ATCATGGGCAT SEQ ID No 5329 ATCCCAGCCCT SEQ ID No 5288 ATCATTTAAAT SEQ ID No 5330 ATCCCAGGGAT SEQ ID No 5289 ATCATTTCCCT SEQ ID No 5331 ATCCCAGGGCT SEQ ID No 5290 ATCATTTGCAT SEQ ID No 5332 ATCCCATAAAT SEQ ID No 5291 ATCATTTGGGT SEQ ID No 5333 ATCCCATCCCT SEQ ID No 5292 ATCATTTTTAT SEQ ID No 5334 ATCCCATGCAT SEQ ID No 5293 ATCATTTTTCT SEQ ID No 5335 ATCCCATGGGT SEQ ID No 5294 ATCATTTTTGT SEQ ID No 5336 ATCCCATTTAT SEQ ID No 5295 ATCAAACAAAT SEQ ID No 5337 ATCCCATTTCT SEQ ID No 5296 ATCAAACCCAT SEQ ID No 5338 ATCCCATTTGT SEQ ID No 5297 ATCAAAGAAAT SEQ ID No 5339 ATCCCAAACAT SEQ ID No 5298 ATCAAAGCCCT SEQ ID No 5340 ATCCCAAAGAT SEQ ID No 5299 ATCAAAGGGAT SEQ ID No 5341 ATCCCAAAGCT SEQ ID No 5300 ATCAAAGGGCT SEQ ID No 5342 ATCCCAAATAT SEQ ID No 5301 ATCAAATAAAT SEQ ID No 5343 ATCCCAAATCT SEQ ID No 5302 ATCAAATCCCT SEQ ID No 5344 ATCCCAAATGT SEQ ID No 5303 ATCAAATGCAT SEQ ID No 5345 ATCCCCCGCATSEQ ID No 5304 ATCAAATGGGTSEQ ID No 5346 ATCCCCCGGGT -121- 182358171.1SEQ ID No 5347 ATCCCCCTCAT SEQ ID No 5389 ATGATTTTTCT SEQ ID No 5348 ATCCCCCTGAT SEQ ID No 5390 ATGATTTTTGT SEQ ID No 5349 ATCCCCCTGCT SEQ ID No 5391 ATGAAACAAAT SEQ ID No 5350 ATCCCCCACAT SEQ ID No 5392 ATGAAACCCAT SEQ ID No 5351 ATCCCCCAGAT SEQ ID No 5393 ATGAAAGAAAT SEQ ID No 5352 ATCCCCCAGCT SEQ ID No 5394 ATGAAAGCCCT SEQ ID No 5353 ATCCCCCATAT SEQ ID No 5395 ATGAAAGGGAT SEQ ID No 5354 ATCCCCCATCT SEQ ID No 5396 ATGAAAGGGCT SEQ ID No 5355 ATCCCCCATGT SEQ ID No 5397 ATGAAATAAAT SEQ ID No 5356 ATGTCAAAAAT SEQ ID No 5398 ATGAAATCCCT SEQ ID No 5357 ATGTCCCAAAT SEQ ID No 5399 ATGAAATGCAT SEQ ID No 5358 ATGTCCCCCAT SEQ ID No 5400 ATGAAATGGGT SEQ ID No 5359 ATGTGAAAAAT SEQ ID No 5401 ATGAAATTTAT SEQ ID No 5360 ATGTGCCCCCT SEQ ID No 5402 ATGAAATTTCT SEQ ID No 5361 ATGTGGGAAAT SEQ ID No 5403 ATGAAATTTGT SEQ ID No 5362 ATGTGGGCCCT SEQ ID No 5404 ATGAAAAACAT SEQ ID No 5363 ATGTTTCAAAT SEQ ID No 5405 ATGAAAAAGAT SEQ ID No 5364 ATGTTTCCCAT SEQ ID No 5406 ATGAAAAAGCT SEQ ID No 5365 ATGTTTGAAAT SEQ ID No 5407 ATGAAAAATAT SEQ ID No 5366 ATGTTTGCCCT SEQ ID No 5408 ATGAAAAATCT SEQ ID No 5367 ATGTTTGGGAT SEQ ID No 5409 ATGAAAAATGT SEQ ID No 5368 ATGTTTGGGCT SEQ ID No 5410 ATGCGAAAAAT SEQ ID No 5369 ATGTTTTTCAT SEQ ID No 5411 ATGCGCCCCCT SEQ ID No 5370 ATGTTTTTGAT SEQ ID No 5412 ATGCGGGAAAT SEQ ID No 5371 ATGTTTTTGCT SEQ ID No 5413 ATGCGGGCCCT SEQ ID No 5372 ATGACAAAAAT SEQ ID No 5414 ATGCTAAAAAT SEQ ID No 5373 ATGACCCAAAT SEQ ID No 5415 ATGCTCCCCCT SEQ ID No 5374 ATGACCCCCAT SEQ ID No 5416 ATGCTGCAAAT SEQ ID No 5375 ATGAGAAAAAT SEQ ID No 5417 ATGCTGCCCAT SEQ ID No 5376 ATGAGCCCCCT SEQ ID No 5418 ATGCTGGGCAT SEQ ID No 5377 ATGAGGGAAAT SEQ ID No 5419 ATGCTTTAAAT SEQ ID No 5378 ATGAGGGCCCT SEQ ID No 5420 ATGCTTTCCCT SEQ ID No 5379 ATGATAAAAAT SEQ ID No 5421 ATGCTTTGCAT SEQ ID No 5380 ATGATCCCCCT SEQ ID No 5422 ATGCTTTGGGT SEQ ID No 5381 ATGATGCAAAT SEQ ID No 5423 ATGCTTTTTAT SEQ ID No 5382 ATGATGCCCAT SEQ ID No 5424 ATGCTTTTTCT SEQ ID No 5383 ATGATGGGCAT SEQ ID No 5425 ATGCTTTTTGT SEQ ID No 5384 ATGATTTAAAT SEQ ID No 5426 ATGCACCCCCT SEQ ID No 5385 ATGATTTCCCT SEQ ID No 5427 ATGCAGCAAAT SEQ ID No 5386 ATGATTTGCAT SEQ ID No 5428 ATGCAGCCCAT SEQ ID No 5387 ATGATTTGGGT SEQ ID No 5429 ATGCAGGGCATSEQ ID No 5388 ATGATTTTTATSEQ ID No 5430 ATGCATCAAAT -122- 182358171.1SEQ ID No 5431 ATGCATCCCAT SEQ ID No 5473 ATGGGTCAAAT SEQ ID No 5432 ATGCATGAAAT SEQ ID No 5474 ATGGGTCCCAT SEQ ID No 5433 ATGCATGCCCT SEQ ID No 5475 ATGGGTGAAAT SEQ ID No 5434 ATGCATGGGAT SEQ ID No 5476 ATGGGTGCCCT SEQ ID No 5435 ATGCATGGGCT SEQ ID No 5477 ATGGGTGGGAT SEQ ID No 5436 ATGCATTTCAT SEQ ID No 5478 ATGGGTGGGCT SEQ ID No 5437 ATGCATTTGAT SEQ ID No 5479 ATGGGTTTCAT SEQ ID No 5438 ATGCATTTGCT SEQ ID No 5480 ATGGGTTTGAT SEQ ID No 5439 ATGCAAACCCT SEQ ID No 5481 ATGGGTTTGCT SEQ ID No 5440 ATGCAAAGCAT SEQ ID No 5482 ATGGGACAAAT SEQ ID No 5441 ATGCAAAGGGT SEQ ID No 5483 ATGGGACCCAT SEQ ID No 5442 ATGCAAATCAT SEQ ID No 5484 ATGGGAGAAAT SEQ ID No 5443 ATGCAAATGAT SEQ ID No 5485 ATGGGAGCCCT SEQ ID No 5444 ATGCAAATGCT SEQ ID No 5486 ATGGGAGGGAT SEQ ID No 5445 ATGCAAAAACT SEQ ID No 5487 ATGGGAGGGCT SEQ ID No 5446 ATGCAAAAAGT SEQ ID No 5488 ATGGGATAAAT SEQ ID No 5447 ATGCCCGAAAT SEQ ID No 5489 ATGGGATCCCT SEQ ID No 5448 ATGCCCGCCCT SEQ ID No 5490 ATGGGATGCAT SEQ ID No 5449 ATGCCCGGGAT SEQ ID No 5491 ATGGGATGGGT SEQ ID No 5450 ATGCCCGGGCT SEQ ID No 5492 ATGGGATTTAT SEQ ID No 5451 ATGCCCTAAAT SEQ ID No 5493 ATGGGATTTCT SEQ ID No 5452 ATGCCCTCCCT SEQ ID No 5494 ATGGGATTTGT SEQ ID No 5453 ATGCCCTGCAT SEQ ID No 5495 ATGGGAAACAT SEQ ID No 5454 ATGCCCTGGGT SEQ ID No 5496 ATGGGAAAGAT SEQ ID No 5455 ATGCCCTTTAT SEQ ID No 5497 ATGGGAAAGCT SEQ ID No 5456 ATGCCCTTTCT SEQ ID No 5498 ATGGGAAATAT SEQ ID No 5457 ATGCCCTTTGT SEQ ID No 5499 ATGGGAAATCT SEQ ID No 5458 ATGCCCACCCT SEQ ID No 5500 ATGGGAAATGT SEQ ID No 5459 ATGCCCAGCAT SEQ ID No 5501 ATGGGCGAAAT SEQ ID No 5460 ATGCCCAGGGT SEQ ID No 5502 ATGGGCGCCCT SEQ ID No 5461 ATGCCCATCAT SEQ ID No 5503 ATGGGCGGGAT SEQ ID No 5462 ATGCCCATGAT SEQ ID No 5504 ATGGGCGGGCT SEQ ID No 5463 ATGCCCATGCT SEQ ID No 5505 ATGGGCTAAAT SEQ ID No 5464 ATGCCCAAACT SEQ ID No 5506 ATGGGCTCCCT SEQ ID No 5465 ATGCCCAAAGT SEQ ID No 5507 ATGGGCTGCAT SEQ ID No 5466 ATGCCCCCGAT SEQ ID No 5508 ATGGGCTGGGT SEQ ID No 5467 ATGCCCCCGCT SEQ ID No 5509 ATGGGCTTTAT SEQ ID No 5468 ATGCCCCCTAT SEQ ID No 5510 ATGGGCTTTCT SEQ ID No 5469 ATGCCCCCTCT SEQ ID No 5511 ATGGGCTTTGT SEQ ID No 5470 ATGCCCCCTGT SEQ ID No 5512 ATGGGCACCCT SEQ ID No 5471 ATGCCCCCACT SEQ ID No 5513 ATGGGCAGCATSEQ ID No 5472 ATGCCCCCAGTSEQ ID No 5514 ATGGGCAGGGT -123- 182358171.1SEQ ID No 5515 ATGGGCATCAT SEQ ID No 5557 ATTTCTTTCAT SEQ ID No 5516 ATGGGCATGAT SEQ ID No 5558 ATTTCTTTGAT SEQ ID No 5517 ATGGGCATGCT SEQ ID No 5559 ATTTCTTTGCT SEQ ID No 5518 ATGGGCAAACT SEQ ID No 5560 ATTTCACAAAT SEQ ID No 5519 ATGGGCAAAGT SEQ ID No 5561 ATTTCACCCAT SEQ ID No 5520 ATGGGCCCGAT SEQ ID No 5562 ATTTCAGAAAT SEQ ID No 5521 ATGGGCCCGCT SEQ ID No 5563 ATTTCAGCCCT SEQ ID No 5522 ATGGGCCCTAT SEQ ID No 5564 ATTTCAGGGAT SEQ ID No 5523 ATGGGCCCTCT SEQ ID No 5565 ATTTCAGGGCT SEQ ID No 5524 ATGGGCCCTGT SEQ ID No 5566 ATTTCATAAAT SEQ ID No 5525 ATGGGCCCACT SEQ ID No 5567 ATTTCATCCCT SEQ ID No 5526 ATGGGCCCAGT SEQ ID No 5568 ATTTCATGCAT SEQ ID No 5527 ATTTACCCCCT SEQ ID No 5569 ATTTCATGGGT SEQ ID No 5528 ATTTAGCAAAT SEQ ID No 5570 ATTTCATTTAT SEQ ID No 5529 ATTTAGCCCAT SEQ ID No 5571 ATTTCATTTCT SEQ ID No 5530 ATTTAGGGCAT SEQ ID No 5572 ATTTCATTTGT SEQ ID No 5531 ATTTATCAAAT SEQ ID No 5573 ATTTCAAACAT SEQ ID No 5532 ATTTATCCCAT SEQ ID No 5574 ATTTCAAAGAT SEQ ID No 5533 ATTTATGAAAT SEQ ID No 5575 ATTTCAAAGCT SEQ ID No 5534 ATTTATGCCCT SEQ ID No 5576 ATTTCAAATAT SEQ ID No 5535 ATTTATGGGAT SEQ ID No 5577 ATTTCAAATCT SEQ ID No 5536 ATTTATGGGCT SEQ ID No 5578 ATTTCAAATGT SEQ ID No 5537 ATTTATTTCAT SEQ ID No 5579 ATTTCCCGCAT SEQ ID No 5538 ATTTATTTGAT SEQ ID No 5580 ATTTCCCGGGT SEQ ID No 5539 ATTTATTTGCT SEQ ID No 5581 ATTTCCCTCAT SEQ ID No 5540 ATTTAAACCCT SEQ ID No 5582 ATTTCCCTGAT SEQ ID No 5541 ATTTAAAGCAT SEQ ID No 5583 ATTTCCCTGCT SEQ ID No 5542 ATTTAAAGGGT SEQ ID No 5584 ATTTCCCACAT SEQ ID No 5543 ATTTAAATCAT SEQ ID No 5585 ATTTCCCAGAT SEQ ID No 5544 ATTTAAATGAT SEQ ID No 5586 ATTTCCCAGCT SEQ ID No 5545 ATTTAAATGCT SEQ ID No 5587 ATTTCCCATAT SEQ ID No 5546 ATTTAAAAACT SEQ ID No 5588 ATTTCCCATCT SEQ ID No 5547 ATTTAAAAAGT SEQ ID No 5589 ATTTCCCATGT SEQ ID No 5548 ATTTCGCAAAT SEQ ID No 5590 ATTTCCCCCGT SEQ ID No 5549 ATTTCGCCCAT SEQ ID No 5591 ATTTGTCAAAT SEQ ID No 5550 ATTTCGGGCAT SEQ ID No 5592 ATTTGTCCCAT SEQ ID No 5551 ATTTCTCAAAT SEQ ID No 5593 ATTTGTGAAAT SEQ ID No 5552 ATTTCTCCCAT SEQ ID No 5594 ATTTGTGCCCT SEQ ID No 5553 ATTTCTGAAAT SEQ ID No 5595 ATTTGTGGGAT SEQ ID No 5554 ATTTCTGCCCT SEQ ID No 5596 ATTTGTGGGCT SEQ ID No 5555 ATTTCTGGGAT SEQ ID No 5597 ATTTGTTTCATSEQ ID No 5556 ATTTCTGGGCTSEQ ID No 5598 ATTTGTTTGAT -124- 182358171.1SEQ ID No 5599 ATTTGTTTGCT SEQ ID No 5641 ATTTGCCCTCT SEQ ID No 5600 ATTTGACAAAT SEQ ID No 5642 ATTTGCCCTGT SEQ ID No 5601 ATTTGACCCAT SEQ ID No 5643 ATTTGCCCACT SEQ ID No 5602 ATTTGAGAAAT SEQ ID No 5644 ATTTGCCCAGT SEQ ID No 5603 ATTTGAGCCCT SEQ ID No 5645 ATTTGGGTCAT SEQ ID No 5604 ATTTGAGGGAT SEQ ID No 5646 ATTTGGGTGAT SEQ ID No 5605 ATTTGAGGGCT SEQ ID No 5647 ATTTGGGTGCT SEQ ID No 5606 ATTTGATAAAT SEQ ID No 5648 ATTTGGGACAT SEQ ID No 5607 ATTTGATCCCT SEQ ID No 5649 ATTTGGGAGAT SEQ ID No 5608 ATTTGATGCAT SEQ ID No 5650 ATTTGGGAGCT SEQ ID No 5609 ATTTGATGGGT SEQ ID No 5651 ATTTGGGATAT SEQ ID No 5610 ATTTGATTTAT SEQ ID No 5652 ATTTGGGATCT SEQ ID No 5611 ATTTGATTTCT SEQ ID No 5653 ATTTGGGATGT SEQ ID No 5612 ATTTGATTTGT SEQ ID No 5654 ATTTGGGCGAT SEQ ID No 5613 ATTTGAAACAT SEQ ID No 5655 ATTTGGGCGCT SEQ ID No 5614 ATTTGAAAGAT SEQ ID No 5656 ATTTGGGCTAT SEQ ID No 5615 ATTTGAAAGCT SEQ ID No 5657 ATTTGGGCTCT SEQ ID No 5616 ATTTGAAATAT SEQ ID No 5658 ATTTGGGCTGT SEQ ID No 5617 ATTTGAAATCT SEQ ID No 5659 ATTTGGGCACT SEQ ID No 5618 ATTTGAAATGT SEQ ID No 5660 ATTTGGGCAGTATTTTTACCCTSEQ ID No 5619 ATTTGCGAAAT SEQ ID No 5661ATTTTTAGCATSEQ ID No 5620 ATTTGCGCCCT SEQ ID No 5662ATTTTTAGGGTSEQ ID No 5621 ATTTGCGGGAT SEQ ID No 5663ATTTTTATCATSEQ ID No 5622 ATTTGCGGGCT SEQ ID No 5664ATTTTTATGATSEQ ID No 5623 ATTTGCTAAAT SEQ ID No 5665ATTTTTATGCTSEQ ID No 5624 ATTTGCTCCCT SEQ ID No 5666SEQ ID No 5625 ATTTGCTGCAT SEQ ID No 5667ATTTTTAAACTATTTTTAAAGTSEQ ID No 5626 ATTTGCTGGGT SEQ ID No 5668ATTTTTCGCATSEQ ID No 5627 ATTTGCTTTAT SEQ ID No 5669ATTTTTCGGGTSEQ ID No 5628 ATTTGCTTTCT SEQ ID No 5670SEQ ID No 5629 ATTTGCTTTGT SEQ ID No 5671ATTTTTCTCATATTTTTCTGATSEQ ID No 5630 ATTTGCACCCT SEQ ID No 5672ATTTTTCTGCTSEQ ID No 5631 ATTTGCAGCAT SEQ ID No 5673ATTTTTCACATSEQ ID No 5632 ATTTGCAGGGT SEQ ID No 5674ATTTTTCAGATSEQ ID No 5633 ATTTGCATCAT SEQ ID No 5675ATTTTTCAGCTSEQ ID No 5634 ATTTGCATGAT SEQ ID No 5676ATTTTTCATATSEQ ID No 5635 ATTTGCATGCT SEQ ID No 5677ATTTTTCATCTSEQ ID No 5636 ATTTGCAAACT SEQ ID No 5678ATTTTTCATGTSEQ ID No 5637 ATTTGCAAAGT SEQ ID No 5679ATTTTTCCCGTSEQ ID No 5638 ATTTGCCCGAT SEQ ID No 5680ATTTTTGTCATSEQ ID No 5639 ATTTGCCCGCT SEQ ID No 5681ATTTTTGTGATSEQ ID No 5640 ATTTGCCCTATSEQ ID No 5682-125- 182358171.1SEQ ID No: 5683 ATTTTTGTGCT SEQ ID No: 5690 ATTTTTGCGAT SEQ ID No: 5684 ATTTTTGACAT SEQ ID No: 5691 ATTTTTGCGCT SEQ ID No: 5685 ATTTTTGAGAT SEQ ID No: 5692 ATTTTTGCTAT SEQ ID No: 5686 ATTTTTGAGCT SEQ ID No: 5693 ATTTTTGCTGT SEQ ID No: 5687 ATTTTTGATAT SEQ ID No: 5694 ATTTTTGCTGT SEQ ID No: 5688 ATTTTTGATCT SEQ ID No: 5695 ATTTTTGCACTSEQ ID No: 5689 ATTTTTGATGTSEQ ID No: 5696 ATTTTTGCAGT

[0097] Barcode sequences may be part of adapter molecules, such as any other adapter sequence components disclosed herein. Adapters may further comprise other sequences, some of which may be common across a plurality of target molecules. Barcode sequences may vary between target molecules in a sequencing reaction. Some non-barcode sequences in adapters may be constant between target molecules in a sequencing reaction (e.g., primer binding sequences, substrate coupling sequences, etc ).

[0098] Short barcodes

[0099] As described elsewhere herein, barcodes are beneficially short and easily distinguished from other barcodes in a set. Table 9 provides short barcodes (9 bases long), any subset of which may be used combination for sequencing. These barcode sequences may be particularly useful with flow sequencing methods.

[0100] Table 9: Short Barcode SequencesBarcode sequence SEQ ID No 5715 CACATCACA SEQ ID No:5’ to 3’ SEQ ID No 5716 CTGAGCAGA SEQ ID No 5697 CTCAGCATA SEQ ID No 5717 CTCATAGCA SEQ ID No 5698 CATCGCTGA SEQ ID No 5718 CATATGCTA SEQ ID No 5699 CTGAGCTCA SEQ ID No 5719 CGCTGAGCA SEQ ID No 5700 CAGCGATGA SEQ ID No 5720 CGATGCATA SEQ ID No 5701 CGCGCTGCA SEQ ID No 5721 CAGTGTGCA SEQ ID No 5702 CTATGCACA SEQ ID No 5722 CACTGCTCA SEQ ID No 5703 CTACATGCA SEQ ID No 5723 CACAGATCA SEQ ID No 5704 CTGTGCTGA SEQ ID No 5724 CACATGTGA SEQ ID No 5705 CTGTGATCA SEQ ID No 5725 CATATCGCA SEQ ID No 5706 CTCTCTGCA SEQ ID No 5726 CAGACATCA SEQ ID No 5707 CATGAGATA SEQ ID No 5727 CAGTGCACA SEQ ID No 5708 CGTCATGCA SEQ ID No 5728 CTGCAGTGA SEQ ID No 5709 CGCATATCA SEQ ID No 5729 CGCACAGCA SEQ ID No 5710 CATATATCA SEQ ID No 5730 CAGATAGCA SEQ ID No 5711 CAGCTCGCA SEQ ID No 5731 CTCGATGCA SEQ ID No 5712 CACTATGCA SEQ ID No 5732 CGAGATGCA SEQ ID No 5713 CATGTCTCA SEQ ID No 5733 CATAGAGCASEQ ID No 5714 CTGATATGASEQ ID No 5734 CACGCAGCA -126- 182358171.1SEQ ID No: 5735 CTGCTCATA SEQ ID No: 5740 CATCACAGA SEQ ID No: 5736 CGCATCTGA SEQ ID No: 5741 CAGAGCTGA SEQ ID No: 5737 CATGCGTCA SEQ ID No: 5742 CTGCGCACA SEQ ID No: 5738 CTCTGCAGA SEQ ID No: 5743 CTATGTGCASEQ ID No: 5739 CACACTGCASEQ ID No: 5744 CGATGCGCA

[0101] High Efficiency Adapters

[0102] Provided herein are sequences, methods, compositions, and kits for use with library preparation. In particular, such sequences, methods, compositions, and kits are for the efficient library preparation of templates for sequencing. Beneficially, by using a single type of adapters, as illustrated in FIG. 4, more template molecules can be successfully processed by library preparation. Such sequences, methods, compositions, and kits can be applied alternatively or in addition to at least the preparation 101 and amplification 105 operations described with respect to sequencing workflow 100 of FIG. 1. Such sequences, methods, compositions, and kits can be used in conjunction with the sample processing systems and methods, or components thereof (e.g., substrates, detectors, reagent dispensing, continuous scanning, etc.) described herein.

[0103] FIG. 4 illustrates a single type of adapter. That is, only adapters comprising the common sequences SEQ ID No: 5745 ATCTCATCCCTGCGTGTCTCCGACTGCAC (5’-3’) and SEQ ID No: 5746 GGACACACGGAACCGTCAGAGTCG (3’-5‘) are provided during libraiy preparation to the template nucleic acid molecules. In a plurality of adapters molecules, one or more barcode sequences (e.g., [BC1] and [BC2]) may be combined with these common sequences to provide different flavors of the single type of adapter. Any of the barcode sequences disclosed herein may be combined with the adapters in FIG. 4. Beneficially, this increases the variety of barcode and template molecule combinations and can improve the accuracy of identification of templates molecules. By way of example, if there are 2 types of barcode sequences (BC1 and BC2), then there will be four possible combinations of barcodes in the adapters for each insert (e.g., template molecule): 5’-BCl-insert-BCl, 5’-BCl-insert-BC2, 5’-BC2-insert-BCl, and 5’-BC2-insert-BC2. If there are 4 types of barcode sequences, then there will be 16 possible barcode combinations, even using common sequences in the adapters.

[0104] Paired Plus Minus Adapter Sequences

[0105] Provided herein are sequences, methods, compositions, and kits for use with library preparation. In particular, such sequences, methods, compositions, and kits may be used for paired plus minus sequencing (e.g., described in Inti. Pat. Pub. No. WO2024 / 159179, which is -127- 182358171.1herein incorporated by reference in its entirety). Beneficially, by using a strand identifying sequence (e.g.. a mismatch region), as illustrated in FIGs. 5 and 7. a high confidence in identifying base call errors and in calling base variants may be achieved. Such sequences, methods, compositions, and kits can be applied alternatively or in addition to at least the preparation 101 and amplification 105 operations described with respect to sequencing workflow 100 of FIG. 1. Such sequences, methods, compositions, and kits can be used in conjunction with the sample processing systems and methods, or components thereof (e.g., substrates, detectors, reagent dispensing, continuous scanning, etc.) described herein.

[0106] In FIG.5 a mismatch region is illustrated in the top adapter sequence. Only one side of the resulting library molecules are illustrated. In some cases, for a library preparation reaction using these sequences, only one type of adapter may be used (e.g.. high efficiency’ methods). In some cases, for a library preparation reaction using these sequences, different adapter types may be used on each side of an insert (see e.g., FIGs. 8-10 described below). In some cases, a mismatch region may be included at a different position of the adapter region, e.g., 5’ of a barcode sequence, 3’ of a barcode sequence, at or near the 5’ end distal from an insert, at or near the 3’ end adjacent to the insert, 5’ of a preamble sequence (as shown in the 3rdadapter configuration in FIG. 5), 3’ of a preamble sequence, etc. As shown in FIG. 5, there may be different combinations of components of an adapters (e.g., the middle sequence lacks the preamble sequence).

[0107] In FIG.6. a library construct with two types of adapter sequences is illustrated. Adapter structure A comprises the high efficiency adapters from FIG. 4: common sequences SEQ ID No: 5745 ATCTCATCCCTGCGTGTCTCCGACTGCAC (5 ’-3’) and SEQ ID No: 5746 GGACACACGGAACCGTCAGAGTCG (3’-5’). Adapter structure B comprises a stem-loop sequence CTCGGAACGAAAGTTCCGAGT (SEQ ID No: 5747). In some cases, a library prepared with adapters as in FIG. 6 may have a high confidence in calling variants, similar to libraries prepared with adapters with mismatch regions. This is due at least in part to the retention of information from both original top and bottom strands of original library template molecules. Shown in FIG. 6 is a support-coupled sequence that has complementarity to and serves to capture any adapter comprising SEQ ID No: 5746 for processing as described with respect to FIG. 1.

[0108] In FIGs. 7A-7F, different versions of mismatch sequences are illustrated. In FIG. 7A, the mismatch region is located 5’ of the barcode [BC] region. In FIGs. 7B-7F, the mismatch region is located 3’ of the barcode [BC] region. FIGs.7B and 7C comprise a AAGG sequence -128- 182358171.1in the mismatched region, which is a typical mismatch sequence used in other adapter sequences described herein. In FIGs. 7A and 7D-7F the bubble regions without the sequence AAGG are still sufficient to for strand identification.

[0109] In FIGs. 7A-7F, the bubble region sequences comprise random base selections. For example, in FIG. 7A the top strand bubble sequence, 5 ’-3’, is KCWGMTAC, and the bottom strand bubble sequence, 5'-3’, is WGMTSACG. where K may be G or T / U, W may be A or T, M may be A or C, and S may be G or C. Thus, each strand has 3 variable base locations. There are hence 8 possible sequences per strand. Since each strand may vary independently there are also 64 possible sequence combinations. This is also the case for FIGs. 7B-7E. However, FIG.7F has 4 variable bases in each strand and there are hence 256 possible sequence combinations.[OllOJIn FIGs. 7B-7C and 7F, the bubble region may be sequenced within 23 flows. In FIGs.7A and 7D-7E the bubble region may be sequenced within 18 flows. Both of these flow numbers are determined following a flow order of T-G-C-A. As described elsewhere herein, there is an advantage to barcodes (or other non-template sequences) being shorter, as this preserves read length for the template sequence. It will be appreciated that other sequence organizations would be more suitable other flow orders in order to maintain shorter barcodes, as measured in flowspace.

[0111] FIGs. 7A-7F illustrate sequences with common adapter sequences, SEQ ID No: 97 ATCTCATCCCTGCGTGTCTCCGAC, disclosed herein and SEQ ID No: 5748 GTGCAGTCGGAGACACGCAGGGATGAGAUGGU. It will be appreciated that any common adapter sequence may be used with the bubble regions of FIGs.7A-7F. In some cases, the bubble regions may be used in combination with any other adapter or barcode sequences described herein. In some cases, one or both of the Us in SEQ ID No: 5748 are ideoxyU. In some cases, SEQ ID No: 5748 may further comprise a 3' modification, such as a 3’ biotin or a 3’ desthiobiotin.

[0112] Adapters for Multispecies Capture Sequence Compatibility

[0113] Provided herein are sequences, methods, compositions, and kits for use with library preparation. In particular, such sequences, methods, compositions, and kits are used for library preparation methods comprising multiple capture sequences (e.g., where multiple species of surface tethered oligonucleotides are present in one reaction). Such sequences, methods, compositions, and kits can be applied alternatively or in addition to at least the preparation 101 and amplification 105 operations described with respect to sequencing workflow 100 of FIG.1. Such sequences, methods, compositions, and kits can be used in conjunction with the sample -129- 182358171.1processing systems and methods, or components thereof (e.g., substrates, detectors, reagent dispensing, continuous scanning, etc.) described herein.

[0114] Each adapter in Table 10 may be captured by a different, complementary oligonucleotide capture sequence. In some cases two or more sequences from Table 10 are selected for adapters for a library preparation reaction, and the corresponding two or more different oligonucleotide capture sequences will be used for capturing library molecules comprises the respective adapter sequences. In some cases, all three of the sequences from Table 10 (and corresponding three different oligonucleotide capture sequences) are selected as adapters and capturing sequences for a library preparation reaction.

[0115] Table 10: Multispecies AdaptersSEQ ID No: Adapter sequence, 5’-3’CATATGTGCGCGAGGAACATCACCGACTGCCCATAGAGAG SEQ ID No: 5749CTCGTAGGGAGAAACACTGGACAGG CATATGTGCGCGAGGAACATCACCGACTGCCCATAGAGAG SEQ ID No: 5750CTTGGACTATCTTCACCAACCTTATG CATATGTGCGCGAGGAACATCACCGACTGCCCATAGAGAG SEQ ID No: 5751CTCCAAAGTAAGCAACACGAATAGC

[0116] Each sequence in Table 10 has a region with complementarity to SEQ ID No: 5752 AGCTCTCTATGGGCAGTCGGTGATGAAGGTCGCGCACATATGT (in 5’-3; direction).FIG. 12 illustrates how SEQ ID No: 5752 may hybridize to SEQ ID No: 5749 to form a doublestranded adapter sequence. Similar hybridization may occur between SEQ ID Nos: 5750 or 5751 and SEQ ID No: 5752. As shown in FIG. 6, these double-stranded adapters comprise a single stranded region (e g., corresponding to sequence GGAA in SEQ ID Nos: 5749-5751 and sequence AAGG in SEQ ID No: 5752).

[0117] As shown here, each of the adapter sequences in Table 10 may comprise a same sequence (SEQ ID No: 5753) CATATGTGCGCGAGGAACATCACCGACTGCCCATAGAGAGCT. In some cases, one or more of the adapter sequences in Table 10 may comprise a different sequence instead of SEQ ID No: 5753 (and hence will hybridize to a sequence different from SEQ ID No: 5752). In some cases, one or more bases in SEQ ID No: 5753 may be modified (e.g., the single-stranded region shown in FIG. 6 may comprise a different sequence). For example, in some cases, the single stranded region may comprise 5’-3’ AAGG in the top strand (e.g., a modified SEQ ID No: 5749) and 5’-3’ GGAA in the bottom strand (e.g., a modified SEQ ID No: 5752).-130- 182358171.1Alternatively, in some cases for example, the single stranded region may comprise 5’-3’ TTTGGG in the top strand (e.g., a modified SEQ ID No: 5749) and 5'-3' GGGTTT in the bottom strand (e.g., a modified SEQ ID No: 5752).

[0118] In some cases, adapter sequences may comprise the variable regions of SEQ ID Nos: 5749-5751 (e.g., the portions that are not SEQ ID No: 5753). In some cases, a library preparation reaction comprises adapters comprising one or more sequences from Table 11 (e.g., at least I sequence, at least 2 sequences, or all 3 sequences).

[0119] Table 11: Multispecies Adapter SequencesSEQ ID No: Adapter sequence, 5’-3’SEQ ID No: 5754 CGTAGGGAGAAACACTGGACAG*GSEQ ID No: 5755 TGGACTATCTTCACCAACCTTAT*GSEQ ID No: 5756 CCAAAGTAAGCAACACGAATAG*C

[0120] Capture oligonucleotide sequences capable of coupling (e.g., hybridizing to) adapter sequences from Table 10 and Table 11 are listed in Table 12. SEQ ID No: 5757 is capable of hybridizing to the 3’ region of SEQ ID No: 5749 or to SEQ ID No: 5754. SEQ ID No: 5758 is capable of hybridizing to the 3’ region of SEQ ID No: 5750 or to SEQ ID No: 5755. SEQ ID No: 5755 is capable of hybridizing to the 3’ region of SEQ ID No: 5751 or to SEQ ID No: 5756.

[0121] In Table 11, in some cases, the *G and *C bases indicate phosphorothioated bases. In some cases, these bases are not phosphorothioated.

[0122] In some cases, a surface tethered oligonucleotide may be coupled (e.g., via click chemistry or ligation) to a surface. In some cases, a surface tethered oligonucleotide may comprise a 5’ moiety for click chemistry (e.g., a DBCO or an azide). In some cases, a surface tethered oligonucleotide may comprise a 3’ moiety for click chemistry (e.g., a DBCO or an azide). In some cases, a surface tethered oligonucleotide may comprise a reactive moiety for coupling to the surface. In some cases, a surface (e.g.. a particle or bead) is coupled to surface tethered oligonucleotides of a single type of sequence. In some cases, a surface (e.g., a particle or bead) is coupled to multiple types of surface tethered oligonucleotides. In some cases, a library reaction may comprise a plurality of beads where a first subset of beads in the plurality of beads are each coupled to an oligonucleotide comprising a first capture sequence and a second subset of beads in the plurality of beads are each coupled to an oligonucleotide comprising a second sequence.-131- 182358171.1

[0123] Table 12 lists multiple capture sequence species that may be used to capture different template nucleic acid molecules of a sample (e.g.. templates coupled to adapters comprising a sequence from Table 10 or Table 11). Multiple species of capture sequences may be especially useful in bulk amplification methods. In some cases, having multiple species of capture sequences (e.g., multiple bead species) may reduce polyclonality in a resulting amplified library (e.g., since each bead or each

[0124] Table 12: oligonucleotide capture sequencesSEQ ID No: Oligonucleotide sequence, 5’-3’SEQ ID No: 5757 CCTGTCCAGTGTTTCTCCCTACGSEQ ID No: 5758 CATAAGGTTGGTGAAGATAGTCCASEQ ID No: 5755 GCTATTCGTGTTGCTTACTTTGG

[0125] In some cases, any of SEQ ID Nos: 5749-5752 and 5754-5755 may comprise one or more modifications. In some cases one or more of the 3’ nucleotides in any sequence described herein may be phosphorothioated. In some cases, 1, 2, 3, 4, or 5, of the 3’ nucleotides in any sequence described herein are phosphorothioated. Phosphorothioation involves replacing a non-bridging oxygen in the sugar-phosphate backbone of an oligonucleotide with a sulfur and serves to reduce nuclease degradation (e.g., oligonucleotide damage). In some cases, an oligonucleotide comprising a sequence selected from SEQ ID Nos: 5749-5752 and 5754-5755 may comprise a capture moiety (e g., a biotin, biotin derivative, click moiety, etc.). In some cases, the capture moiety may permit pre-enrichment or post-enrichment during library preparation.

[0126] Adapters for Isothermal Amplification

[0127] Provided herein are sequences, methods, compositions, and kits for use with library preparation. Such sequences, methods, compositions, and kits may be useful for isothermal amplification methods. In some cases, these sequences, methods, compositions, and kits can be applied alternatively or in addition to at least the preparation 101 and amplification 105 operations described with respect to sequencing workflow 100 of FIG. 1. Such sequences, methods, compositions, and kits can be used in conjunction with the sample processing systems and methods, or components thereof (e.g., substrates, detectors, reagent dispensing, continuous scanning, etc.) described herein.

[0128] FIGs.8-10 illustrate different adapter sequences and configurations suitable for library preparation with isothermal amplification.-132- 182358171.1

[0129] FIGs. 8A-8F illustrate sequences for use in library preparation. Sequences not labeled otherwise (e.g., insert, primer, etc.) may be considered as general adapter sequences or as different amplification or sequencing primer sequences. Primer sequences may be used for sequencing or amplification or both. Sequences in these figures may not support paired end sequencing. Sequences in these figures include sequencing primers, sequencing primer binding sites, amplification primers, surface attachment capture sequences surface sequences (e.g., coupled to a support to capture a library molecule), double-stranded regions of adapters, single stranded regions of adapters, barcode regions (e.g., "‘[BC]”), and combinations thereof. FIGs.8C and 8D further comprise indexing primers. In some cases, sequencing primers may be used for amplification. In some cases, these sequences may be used with amplification, such as linear amplification, exponential amplification, isothermal amplification, or any suitable method of amplification. In some cases, these sequences may be used for library amplification methods comprising amplification coupled to a support (e.g., Bead). In some cases, these sequences may be used with inserts (e.g., template nucleic acid molecules) from a biological sample.

[0130] The variable surface sequences and surface attachment capture sequences may comprise X bases (e.g., X, Xi or XnUXm). In some cases, i, n, or m may comprise any number such as 1, 2, 3, 4, 5, 6, 7, 8, 9, 10, 11, 12, 13, 14, 15, 16, 17, 18, 19, 20, 21, 22, 23, 24, 25, 26, 27, 28, 29, or 30. In some cases, these surface and surface attachment capture sequences may comprise multispecies sequences such as described with respect to Tables 10-12 and FIG. 6.For example, in FIG. 8 a surface attachment capture sequence may comprise any sequence from Table 11 and a surface sequence may comprise a complementary sequence in Table 12.As indicated by the U in e.g., XnUXm, these variable regions may comprise one or more cleavable bases.

[0131] Some of these sequences comprise a uracil (U). These may be cleavable sites that are cleaved during library preparation. In some cases, any U base or bases may be replaced with thymine bases (T) (e.g., for library preparation methods that do not require cleaving or for conditions that do not include uracil-tolerant polymerases). In some cases, one or more other thymine bases in the sequences may be replaced with a uracil base (e.g., to add additional cleavage sites). In some cases, any uracil base or bases may be replaced with another cleavable or nickable moiety. In some cases, a uracil may comprise a deoxyribonucleotide (e.g., deoxyuracil). In some cases, a uracil may comprise a ribonucleotide. In some cases, a preamble sequence (e.g., TGCA) may be replaced with another sequence (e.g., T, TCAG, etc.) or removed. In some cases, library preparation methods using one or more of these sequences -133- 182358171.1may require a uracil-tolerant polymerase (e.g., FIG. 8B sequences comprising Us). In FIG.8A. one of the adapters comprises a single-stranded region comprising GGAA (e.g., a strand recognition element for paired plus minus sequencing methods); in some cases, these singlestranded regions may be removed from the adapter. Alternatively, in some cases, the sequence of these single-stranded regions may be modified (e.g., GGGAAA, TTGG, etc.). In some cases, these single-stranded regions in each strand of the adapter of FIG. 8A will have a same sequence, in opposite directions (e.g., here in the top strand, the sequence is, 5’-3’, GGAA and in the bottom strand, the sequence is, 5’-3’, AAGG). In some cases, these single-stranded regions in each strand of the adapter of FIG. 8A will have different sequences, where the different sequences are not reverse complements of each other (e.g., the different sequences will not be configured to hybridize to each other for the single-stranded region) (see e.g., FIGs.7A-7F). In FIG.8A, the illustrated sequences may be used in conjunction with pre-enrichment, as described elsewhere herein. FIG. 8A sequences may also be used for PCR-free library preparation methods. In FIGs. 8C-8D, the illustrated sequences may be used for library conversion (e.g., adapter sequence swapping or addition) or for direct amplification or indexing. In FIGs. 8E-8F, the illustrated sequences may be used for preparing training libraries, that is for data analysis training purposes subsequent to sequencing and obtaining sequencing data. FIGs. 8E-8F sequences may be modified by the addition of barcode sequences, as described elsewhere herein, for use with direct amplification or indexing, as with FIG. 8B. Any of the adapters A in FIGs. 8B-8F may be modified to include the strand recognition sequence, as in FIG. 8A. Additional sequences described herein may be used in these adapters.

[0132] In some cases, one or more 5’ or 3’ end of a sequence in FIGs. 8A-8F may comprise a biotin or other capture moiety (e.g., for pre-enrichment, post-enrichment, or other capture step). In some cases, a biotin or other capture moiety may be attached to a strand comprising one or more uracils or other cleavable or nickable moieties (e.g., where cleaving or nicking releases the biotin or other capture moiety from the strand - e.g., subsequent to pre-enrichment, postenrichment, or other capture step).

[0133] FIGs. 9A-9G illustrate sequences for use in library preparation. These sequences may support paired end sequencing, subsequent to library preparation. Types of sequences as described with respect to FIG.8A-8F may also be used in FIGs.9A-9G.

[0134] FIGs. 10A-10F illustrates sequences for use in library preparation. These sequences may support paired end sequencing, subsequent to library preparation. Types of sequences as -134- 182358171.1described with respect to FIG. 8A-8F may also be used in FIGs. 10A-10F. In addition, the sequences in FIG. 10D may be associated with V(D)J sequencing or indexing for immune profiling.

[0135] Methylated Adapters

[0136] Provided herein are sequences, methods, compositions, and kits that provide methylated adapter sequences. Such sequences, methods, compositions, and kits can be applied alternatively or in addition to the preparation 101 and amplification 105 operations described with respect to sequencing workflow 100 of FIG. 1, specifically for cases where library preparation comprises conversion steps (e.g., methylation conversion). Such sequences, methods, compositions, and kits can be used in conjunction with the sample processing systems and methods, or components thereof (e.g., substrates, detectors, reagent dispensing, continuous scanning, etc.) described herein.

[0137] Beneficially, sequencing adapters with methylated nucleic acid bases can be used as controls for the extent or success of methylation conversion of a nucleic acid library to which the methylated sequencing adapters are connected. Specifically, in the adapters one or more bases may be methylated or otherwise modified, and after library preparation including conversion and sequencing, sequence reads may be analyzed for whether the known modified bases in the adapter portions of the sequence reads were converted. In a sequence read where all or substantially all of the modified bases of the methylated adapter were converted in accordance with the conversion method used during library preparation, then the sequence read may be assigned a high confidence score indicating a level of certainty that any modified bases in the template molecule were also successfully converted. In a sequence read where no or substantially none of the modified bases of the methylated adapter were converted in accordance with the conversion method used during library preparation, then the sequence read may be assigned a low confidence score indicating a level of uncertainty that any modified bases in the template molecule were also successfully converted. In such cases, the sequence read with a low confidence score may be discarded or otherwise filtered from downstream analysis. In a sequence read where only some of the modified bases of the methylated adapter were converted in accordance with the conversion method used during library preparation, then the sequence read may be assigned a confidence score in accordance with a percentage, number, ratio, etc. of modified bases that w ere converted (e.g., compared to the total of known modified bases present in the methylated adapter sequence). These confidence scores may be used in subsequent analysis of the corresponding sequence reads and may inform confidence -135- 182358171.1in base calls or variant calls. This is beneficial, because in some cases conversion methods such as methylation conversion may not proceed to completion and it can be difficult to ascertain the extent of conversion without a control sequence. By using adapters as controls, individual sequence reads may be analyzed for conversion success individually, instead of relying on bulk, overall control methods. Advantageously, in some cases where there is poor conversion and a general reaction control might have indicated failure of complete conversion, individual reads that did experience conversion may be rescued.

[0138] FIGs. 11A-11C illustrate examples of methylated adapter sequence organization. In these examples, the adapters comprise a portion complementary' to an amplification primer, another portion complementary to a sequencing primer, another portion comprising one or more modified bases. It will be understood that any other feature or sequence described herein (e.g., barcodes, preamble regions, ligation sites, cleavable sites, overhangs, etc.) may be combined in any order with the illustrated adapter portions shown in FIGs. 11A-11C. In some cases, a methylated adapter may not comprise the Y-shape in FIGs. 11A-11C. (e g., a methylated adapter may not comprise a single-stranded portion or may not comprises a 5' single-stranded portion). In some cases, a methylated adapter sequence may comprise a combination of modified and unmodified bases of a same base type (e.g., methylated Cs and non-methylated Cs). In some cases, a methylated adapter sequence may comprise a combination of modified bases of different base types (e.g., methylated As and methylated Cs). In some cases, a methylated adapter sequence may comprise bases of a first type with a first modification and bases of the first type with a second modification (e.g., methylated Cs and hydroxymethylated Cs). Modifications may comprise any suitable nucleic acid modification. In some cases, modifications may be selected from the set of 5 ’-methylateion, 5’-hydroxymethylation. 5'-formylation, 5 ’-carboxylation, 5 '-hydroxylation, and N6'-methylation. In some cases, Cs in CpG sites may be modified in an adapter. In some cases, Cs that are not in CpG sites may be modified in an adapter.

[0139] In FIGs. 11A-11C, the methylated adapters are shown as part of a high-efficiency library preparation method, where only one type of adapter is used. It will be understood that methylated adapters or modifications thereof may be used in concert with any of the other adapter organization as shown in FIG.3. For example, a methylated adapter or portion thereof from FIGs. 11A-11C may be used together with a surface attachment capture sequence as in FIGs. 8-10. In some cases, the adapters in FIGs. 11A-11C may further comprise barcode sequences, UMIs, additional single stranded regions (e.g.. strand recognition sequences),-136- 182358171.1additional double-stranded regions (e.g., preamble sequences), primer binding sites, cleavable or nickable sites, or combinations thereof. In some cases, the adapters from FIGs. 11A-11C may be further used to convert a sequencing library from one type of adapter to another type of adapter.

[0140] The one or more methylated cytosines may be in the double-stranded region of the adapter. The one or more methylated cytosines may be in the single-stranded-stranded region of the adapter. In some cases, e.g., where the conversion conditions serve to convert an unmethylated cytosine to a uracil, the adapter comprise one or more unmethylated cytosines. The one or more unmethylated cytosines may be in the double-stranded region of the adapter. The one or more unmethylated cytosines may be in the single-stranded-stranded region of the adapter. These one or more methylated cytosines, one or more unmethylated cytosines, or a combination thereof may serve as controls on the success or completeness of a methylation conversion step. That is, in the sequencing results after conversion and library preparation, the sites in the adapter that were expected a priori to be converted may be evaluated for successful conversion (e.g.. a binary determination) or for completion of conversion (e.g., what ratio, number, percentage of sites expected to be converted were in fact converted).

[0141] In some cases, conversion conditions may comprise bisulfite conversion, such as described in e.g., Frommer et al. PNAS 1992 89, 1827-1831. In some cases, conversion conditions may comprise TET-mediated methylation conversion, such as described in e.g., Vaisvila et al. Genome Res. 2021 31. 1280-1289. In some cases, conversion conditions may comprise ultra-mild bisulfite conversion, such as described in Dia et al. 2025 Nat Commun 16 9939. In some cases, conversion conditions may comprise TET-assisted pyridine borane sequencing (TAPS), such as described in e.g., Liu et al. 2019 Nat Biotech 37, 424-429. In some cases, conversion conditions may comprise combinations of methods listed herein and / or other conversion methods known in the art.

[0142] The modified portions of the adapters from FIGs. 11A-11C comprise a top strand and a bottom strand, where the strands are complementary. One or both strands may each comprise one or more modified bases. Table 13 lists possible modified sequences for adapters, in accordance with descriptions herein. A CAindicated a 5-methyalted C. Complementary top and bottom strand sequences (e.g., SEQ ID No: 5756 and SEQ ID No: 5759) may be used together as part of an adapter in accordance with any of the methods or other sequences described herein. As in other adapter sequences described herein the 3’ nucleotide base (or more than one 3’ base) may be phosphorothioated (e.g.. *T. or *C*T).-137- 182358171.1

[0143] Table 13: Methylated Adapter Sequence RegionsStrand SEQ ID No: Sequence 5’ to 3’Top strand SEQ ID No: 5756 GCTCAGGCCAGATCTTop strand SEQ ID No: 5757 GACAGCCAGATGCGATCAGTCT Top strand SEQ ID No: 5758 GCAGACAGTCAGCCGT Bottom strand SEQ ID No: 5759 GATCAGGAAGAGCBottom strand SEQ ID No: 5760 G ACAG ATCGC ATCAGGCAGTCBottom strand SEQ ID No: 5761 CGGCAGACAGTCAGC

[0144] Barcode edit distances

[0145] For the barcode sequences disclosed herein, there may be rules used to determine which barcodes are selected to be used together (e.g., which barcodes can be pooled and used concurrently for sequencing). An important feature of a barcode set is that each barcode must be distinctly identifiable from each other: two barcodes that differ from each other by only a single base mismatch may be easily confused due to signal error or a single misincorporation event. Therefore, it is advantageous for barcodes to have sequences (or flowgrams) that are as different from each other as possible. However, the need for barcodes to be differentiable must be balanced against the benefits of short barcodes. Specifically, many sequencing methods have read length limitations, and hence shorter barcodes that take up less of the read length of a sequence read compared to the template sequence are beneficial. Advantageously, barcodes described herein are both short (compared to template sequences) and easily differentiated.

[0146] One way of measuring differences between barcodes is by determining an edit distance (e.g., between nucleotide base sequences or between flowgrams) and selecting a set of barcodes that have a predetermined edit distance from each other. As one example, a Hamming distance may be calculated for all pairs of barcodes within a set. In such an example, for any given pair of barcode flowgrams, each flow position (e.g., which may comprise a flow cycle value or H-mer) of the first barcode is compared to the corresponding position of the second barcode. If the values differ for a given position, a value of 1 distance unit is added (e.g., every position in the pair of flowgrams that differs increases the value of the edit distance by 1). By way of example, a first flowgram comprising a 1 x 5 vector of [0, 0, 1, 1, 2] and a second flowgram comprising a 1 x 5 vector of [0, 0, 3, 2, 2] have an edit distance of 2. as two positions (the third and fourth elements) within the flowgrams differ in value. Each position in the pair of flowgrams that do not differ in value (e.g., the first, second, and fifth elements in this example) does not increase the edit distance between the corresponding barcode sequences. In some cases, edit distance may be calculated based on barcode sequences, not flowgrams. In -138- 182358171.1some cases, a method for calculating edit distance may be selected from the group of methods consisting of Levenshtein distance, longest common subsequence, Damerau-Levenshtein distance, Hamming distance, and Jaro distance.

[0147] In some cases, barcodes may be required to have an effective edit distance of at least 1, at least 2, at least 3, at least 4, or at least 5 from each other (e.g., there may be a required a minimum edit distance of at least 3 between each possible pair of barcodes in the set). In effect, this minimum edit distance is only calculated for the variable sequence portions of each barcode sequence (e g., because sequences such as a preamble, constant prefix, and constant post sequences may be identical for each barcode in the set). Edit distances may be calculated on a flowgram or sequence basis.

[0148] In some cases, flowgram values for the variable sequence region of a barcode may be set to 0, 1, 2, 3, 4, 5, 6, etc. For example, if a max flowgram value is set to 2, then no homopolymers might be allowed that are longer than 2 nucleotides in base space.

[0149] Barcode sets

[0150] In some cases, any subset of the sequences disclosed herein may be used in a library prepare or sequencing methods. For example, with respect to Tables, 3, 4, 5, 6, 7, and 8, kits may be provided that comprise a subset of 8 or 96 sequences from a respective table. Any number of sequences from a respective table such as 2nsequences, where n is 0, 1, 2, 3, 4, 5, 6, 7, 8, 9. 10, 12, 14, 16, 18, or 20. may be provided in a kit.

[0151] It will be appreciated that sequences from different tables or sections herein may be combined in different orders. For example, a barcode sequence may be combined with a common adapter sequence, a strand identifying sequence, a primer binding site, a surface attachment capture sequence, a bubble region, or any combination thereof.

[0152] In some cases, any one of the sequences disclosed herein may be used in a library preparation or sequencing method as described with respect to FIG. 1. In some cases, sequences disclosed herein may be used as described in Inti. Pat. AppL No. PCT / US2024 / 011506 or U. S. Pat. Appl. Nos. 18 / 410,051, 18 / 745,437, and 19 / 261,379, each of which is entirely incorporated herein by reference for all purposes. In some cases, sequences disclosed herein may be used in combination with any of the sequences disclosed in either of these applications.-139- 182358171.1EXAMPLES

[0153] These examples are provided for illustrative purposes only and are not intended to limit the scope of the claims provided herein.Example 1 - Generation and Selection of Barcode Sequences

[0154] Barcode sequences may be generated and selected (e.g., at one or more processors in a computer system) based on one or more criteria and by performing one or more filtering processes. With regards to flow sequencing applications, these barcodes may be used to identify flows of interest from analog data (e g., just from signals - such as optical signals -generated during sequencing), instead of after sequencing (e.g., after basecalling).

[0155] The time-consuming process of identifying -100 million training reads in a substrate comprising 4 billion or more sequence reads may be avoided by identifying the training reads during signal collection (e.g., during sequencing by synthesis using detection of identifiable signals during each flow cycle). During signal collection, a sample data set, used for training may be copied to the monitoring computer system. Beneficially, instead of selecting the sample set randomly or after a nucleic acid base sequence is determined, the training set may be identified at flow 4 (e.g., in flow space) through the design of distinguishable barcode sequences.

[0156] In this example, the flow sequence TGCA is used. In some instances, as described elsewhere herein, the flow sequence may be any other permutation of the nucleotides T or U, G, C. and A (e.g., GTAC, ACTG. etc.). In some instances, for example for non-WGS runs, a spike-in training data set may be added and used for training a model to evaluate the sample, non-WGS data. That training set may be labeled as described below in Table 14 to prevent contamination at the analysis level with the other, sample data. The training data set may comprise: a set of -100 million reads, comprising -80 million standard human reads and -20 million E. coli reads.

[0157] The training and sample data share one How cycle sequence preamble (e.g., one iteration of T, G, C, A flow s). The training data may be identified by a training data indication sequence that can be identified within one flow (e.g., a flow comprising one nucleotide base type). In some instances, the training data indication sequence is TT (e.g., a sequence that results in a double addition of a nucleotide). The analog signal detected from the incorporation of two nucleotides (e.g., a homopolymer of length 2) can be used to clearly discriminate reads that have the TT identification sequence from reads that lack the TT identification sequence.-140- 182358171.1

[0158] Table 14. Training and sample identification sequences, showing the comparison between basespace and flowspace.Cycle 1 Cycle 2 Flows: 0 1 2 3 4 5 6 7 Sequence T G C A T G C A Training data ID: T, G, C, A, T, T... 1 1 1 1 2 0 0 -Sample sequence ID: T, G, C, A, C... 1 1 1 1 0 0 1 -

[0159] Here in Table 14, flows 0-3 are the preamble (e.g., T, G, C, A, where the indexing begins at 0). Flow 4 (e.g., the first flow of the second flow cycle) identifies the double TT analog signal for training data reads. As shown in Table 14, the sample sequences have a different sequence ID (e.g., the first nucleotide base after the preamble sequence is a C instead of a double T. This will result in a flowgram for the second flow cycle of 0, 0, 1... for all sample reads, as compared with the flowgram 2, 0, 0... for all training data in the second flow cycle. In this way, contamination of training data may be prevented, thereby improving model training (e.g., by providing improved input data). Training data may be identified by a distinct signal at flow 4. where the signal output for training data is 2 and the signal output for sample data are 0. The strong analog signal separation between 2-mers and 0-mers prevents most misidentifications. Confirmation of sample data identity can also include examination of flows 5 and 6, which are always 0, 1 for sample data sequencing reads and 0, 0 for training data sequencing reads.

[0160] In this example, a minimum number of barcodes were required (e.g., at least 96x2 different barcodes). Barcode sequences were thus determined for an effective length of 20 flows. The barcode sequences included the following regions: preamble (4 flows, 4 bases), constant prefix (3 flows 1 base), variable sequence, and constant post sequence (4 flows, 3 bases). Barcodes were kept at a constant length in flow space (e.g.. each barcode can be fully sequenced in the same number of flows and requires the same number of flows to be fully sequenced). Barcodes were required to be an edit distance of at least 2 from each other barcode sequence (e.g., as measured in the vector space representing flow signals). In addition, each of the values in flow space were 0 or 1 (e.g., there are no homopolymers in base space greater than 1 in any of the barcode sequences). All barcodes in this set start with a single C (e.g., denoting sample data). Barcodes generated according to this methods are described in U. S. Patent Application No. US 18 / 410,051, which is entirely incorporated herein by reference for all purposes.182358171.1Example 2 – Generation and Selection of a Larger Barcode Set1

[0161] Generating a larger number of barcodes (e.g., more than the 238 barcodes generated in Example 1) may require an increase in the acceptable barcode length in base space, and hence in flow space. In generating a larger barcode set, it may also be beneficial to improve distinction among barcode sequences by increasing the effective edit-distance between each pair of barcode (e.g., from the minimum edit distance of 2 in Example 1 to a minimum edit distance of at least 4). In some embodiments, the effective-edit distance is at least 4, at least 5, at least 6, at least 7, at least 8, at least 9, at least 10, at least 11, at least 12, at least 13, at least 14, or at least 15. The flow sequence used in this example is TGCA. The requirements (e.g., filters and constraints) for generating a larger barcode set (e.g., more than 1000 distinct barcode sequences) included the increased barcode length, increased edit distance, and constraints on H-mer number and size.

[0162] Barcodes were determined for an effective length of 29 flows. The barcode sequences included the following regions: preamble (4 flows, 4 bases), constant prefix (3 flows 1 base), variable sequence, and constant post sequence (4 flows. 3 bases). As in Example 1, the preamble consisted of 4 nucleotides (TGCA) and accounted for 4 flows. Each barcode sequence then started with a C (e.g., the constant prefix, or the sample data identification sequence as described in Example 1). Thus, in accordance with the TGCA flow order, the flowspace vector for each barcode in this set begins as: [1,1, 1,1, 0,0,1...]. Following the constant prefix, the barcode variable sequence is allotted 18 flows (where the variable sequence length in base space is not constant). The constant post sequence is GAT.

[0163] In addition, barcodes were required to have an effective edit distance of at least 4 from each other (e g., there was a minimum edit distance of at least 4 between each possible pair of barcodes in the set). In effect, this minimum edit distance is only calculated for the variable sequence portions of each barcode sequence (e.g., because the preamble, constant prefix, and constant post sequences are identical for each barcode in the set). Further, each of the values in flow space for the variable sequence regions was set to 0, 1, or 2 (e.g., there were no homopolymers that are longer than 2 nucleotides long in base space). For each barcode, only one value in flow space was 2 (e.g., no more than one 2-mer was allowed per barcode, and each barcode was required to have one 2-mer). Following these requirements, the barcode variable sequences wi 11 be either 11 bases or 13 bases in length.

[0164] These requirements result in a set of barcodes where, for each pair of barcodes, most sequence differences between the vectors representing the barcodes will be either from a 0 to -142- 182358171.1a 1 or from a 1 to a 0. Few of the sequence differences will be from a 1 to a 2 or from a 2 to a 1. All barcodes have a constant length in flow space, as described above for Example 1. The constant length in flow space will lead to each of the barcodes having similar but not exact length in base space, where the differences will come from the length differences of the variable sequences). The overall length of each barcode in the set is either 19 or 21 bases. These parameters serve to increase the contribution of context to signal difference.

[0165] In this example, the sequence of interest would be located after the T of flow number 2, which ends each of these barcode sequences (e.g., the end of the constant post sequence GAT). Following the parameters described above resulted in 1018 distinct barcode sequences. Barcodes generated according to this method are described in U. S. Patent Application No. 18 / 410,051, which is entirely incorporated herein by reference for all purposes.

[0166] While preferred embodiments of the present invention have been shown and described herein, it will be obvious to those skilled in the art that such embodiments are provided by way of example only. It is not intended that the invention be limited by the specific examples provided within the specification. While the invention has been described with reference to the aforementioned specification, the descriptions and illustrations of the embodiments herein are not meant to be construed in a limiting sense. Numerous variations, changes, and substitutions will now occur to those skilled in the art without departing from the invention. Furthermore, it shall be understood that all aspects of the invention are not limited to the specific depictions, configurations or relative proportions set forth herein which depend upon a variety of conditions and variables. It should be understood that various alternatives to the embodiments of the invention described herein may be employed in practicing the invention. It is therefore contemplated that the invention shall also cover any such alternatives, modifications, variations or equivalents. It is intended that the following claims define the scope of the invention and that methods and structures within the scope of these claims and their equivalents be covered thereby.-143- 182358171.1

Claims

CLAIMSWHAT IS CLAIMED IS:

1. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 1-96.

2. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 103-1157.

3. The composition of claim 2, wherein said non-naturally occurring nucleic acid molecule is coupled to a support.

4. The composition of claim 3, wherein said support is a bead.

5. A kit, comprising: at least 8 non-naturally occurring nucleic acid molecules each comprising a different sequence selected from any one of SEQ ID Nos: 103-1157.

6. A kit comprising: at least 96 non-naturally occurring nucleic acid molecules comprising a different sequence selected from any one of SEQ ID Nos: 103-1157.

7. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 2219-3025.

8. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 3026-4050.

9. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 3026-4050 or 5825-5841.

10. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 5825-5841.

11. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 4051-4871.

12. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of SEQ ID Nos: 4872-5696.

13. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of the sequences illustrated in FIGs. 8A-10F.

14. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of the sequences illustrated in FIGs. 11A-11C.

15. A composition, comprising anon-naturally occurring nucleic acid molecule comprising a sequence selected from any one of the sequences illustrated in FIG. 12.

16. The kit of claim 5 or 6 or the composition of any one of claims 7-15, wherein said non- naturally occurring nucleic acid molecule is coupled to a support.-144- 182358171.

117. The kit or the composition of claim 16, wherein said support is a bead.-145- 182358171.1