Cinq éléments travaillent ensemble : un corpus d'anglais courant sélectionné, un ensemble de modèles de phrases grammaticales, une paire de banques de noms internationales et sri-lankaises, une banque d'incitations à l'écriture originales, et un petit générateur de nombres pseudo-aléatoires déterministe qui les relie tous. Chaque étape est une fonction pure — pas d'appels réseau, pas de stockage local, pas d'analyses sur le texte généré lui-même.
- Corpus de mots. Environ 553 tokens anglais courants issus de l'intersection du Oxford 3000 et de la liste de services généraux (West, 1953 ; listes de successeurs modernes pour l'ELT). Tout en minuscules, sans noms propres, sans vulgarité. Le mode mot sélectionne n tokens de manière uniforme au hasard et applique la casse de votre choix : minuscule, Titre ou MAJUSCULE.
- Construction de phrases. Les phrases sont construites à partir de 18 modèles grammaticaux en anglais avec des espaces réservés remplis à partir de sous-banques de 121 noms concrets, 113 verbes au présent, 49 adjectifs et 33 adverbes. Environ 14 % des modèles terminés par un point ont leur terminator remplacé par un ? ou un ! pour ajouter du rythme. Les paragraphes enchaînent 36 phrases et sont séparés par un seul espace ; plusieurs paragraphes sont séparés par exactement une ligne blanche (\n\n).
- Noms. L'outil inclut deux corpus de noms : une banque internationale (91 premiers noms).