Cinco peças trabalham juntas: um corpus de inglês comum selecionado, um conjunto de modelos de frases gramaticais, um par de bancos de nomes internacionais e do Sri Lanka, um banco de prompts de escrita originais e um pequeno gerador de números pseudoaleatórios determinístico que os conecta. Cada etapa é uma função pura — sem chamadas de rede, sem armazenamento local, sem análises do texto gerado.
- Corpus de palavras. Aproximadamente 553 tokens comuns em inglês, extraídos da interseção do Oxford 3000 e da lista de uso geral (West, 1953; listas de sucessores modernas de ELT). Tudo em minúsculas, sem nomes próprios, sem palavrões. O modo de palavra seleciona n tokens de forma uniforme ao acaso e aplica a sua escolha de caixa de letra minúscula, Título ou MAIÚSCULAS.
- Construção de frases. As frases são construídas a partir de 18 modelos gramaticais em inglês com espaços reservados preenchidos por sub-bancos de 121 substantivos concretos, 113 verbos no presente, 49 adjetivos e 33 advérbios. Aproximadamente 14% dos modelos terminados com ponto final têm seu terminador trocado por um ? ou ! para adicionar ritmo. Os parágrafos unem 36 frases e se conectam com um espaço único; múltiplos parágrafos são separados por exatamente uma linha em branco (\n\n).
- Nomes. A ferramenta fornece dois corpora de nomes: um banco internacional (91 primeiros nomes)