Sources & Méthode
D’où viennent les textes de ce site, comment nous le vérifions, et ce que cette vérification ne peut pas voir.
La règle, en une phrase
Chacun des 308 textes de ce site a été écrit pour ce site. Aucun n’a été repris d’un recueil, d’un autre site de blagues, d’un spectacle, d’une émission de radio ou d’un emballage de bonbon.
Ce n’est pas une préférence de style. Une blague contemporaine est une œuvre protégée par le droit d’auteur, exactement comme une chanson ou un poème. Un site de blagues se construit d’ordinaire en recopiant un corpus existant ; ce corpus appartient à quelqu’un, et il n’existe aucune licence libre qui permettrait de le republier. Nous avons donc pris l’autre chemin : écrire.
Le prix de ce choix est visible sur chaque page. Il y a moins de blagues ici que sur un site qui en affiche dix mille, et il y en aura toujours moins. C’est le seul compromis que nous ayons trouvé qui ne consiste pas à publier le travail d’autrui.
Ce que nous refusons de publier
Certaines catégories très recherchées ne sont pas sur ce site, et il vaut mieux dire lesquelles que laisser croire à un oubli :
- The jokes printed on Carambar® wrappers — Carambar & Co's own texts, under its own brand. 4,400/mo of measured demand declined — see research/9598-blagues-demand/screens.json.
- Any scrape of a French joke site (blagues.fr, rigolotes.fr, humour.com and their kind) — A compiled body of authored one-liners with an owner. This is the UKACD problem without the licence, and no licence exists.
- A named comedian's routine (Bigard, Coluche, Booder, Baffie, Boujenah…) — Copyrighted performances of living or recently-dead authors. Coluche died in 1986: in copyright until 2056.
- The Père Fouras énigmes (Fort Boyard) — The written texts of a television format. 9,680/mo declined.
- An LLM asked to "list famous French jokes" — That is a scrape with the source removed — the worst of the options, because it launders provenance instead of recording it. Every item here was composed for this site and the ledger says when.
Nous ne publions pas non plus de blague dont le ressort est l’origine, la nationalité, l’ethnie, la religion, le sexe, l’orientation sexuelle, l’identité de genre, l’apparence physique, le handicap, l’état de santé ou l’âge de quelqu’un — les critères que l’article 225-1 du Code pénal énumère. Cela met hors du site des genres entiers et très demandés : les blagues belges, les blagues de blondes, les blagues sur les nains, celles sur les gros ou sur les chauves.
La distinction que nous appliquons est celle du sujet, pas celle du mot. Un personnage de blague peut être belge, blond ou âgé ; ce qui est exclu, c’est que la chute repose là-dessus. C’est pour la même raison que la rubrique humour noir existe ici : en français, l’humour noir porte sur la mort et la catastrophe, pas sur des catégories de personnes.
Comment c’est vérifié
Une règle qui repose sur la mémoire de celui qui écrit tient jusqu’au premier jour d’inattention. Celle-ci est vérifiée par le programme qui fabrique le site, à chaque construction, et le site ne peut pas être publié si la vérification échoue.
- Chaque texte porte une origine. Il n’y a que deux valeurs possibles : écrit pour ce site, ou domaine public — un texte dont l’auteur est mort depuis plus de 70 ans, avec son nom et l’endroit où nous l’avons lu. Il n’y a pas de troisième valeur, donc une blague recopiée n’a aucune case où se ranger.
- Chaque texte porte une forme : la charade, la devinette, le calembour, « Monsieur et Madame », Toto. Les formes traditionnelles n’appartiennent à personne — le texte écrit dedans, si.
- Chaque texte est enregistré avec son empreinte dans un registre versionné. Un texte ne peut donc pas être modifié sans que la modification apparaisse, ce qui est le seul contrôle qu’une machine puisse honnêtement exercer ici.
- Le programme relit ensuite les pages fabriquées et vérifie que chaque texte affiché est bien un texte enregistré, et que chaque texte enregistré est bien affiché quelque part.
- Un dernier passage relit les textes et la prose des pages à la recherche des mots que nous refusons de publier.
Les rébus, et pourquoi ils sont écrits plutôt que dessinés
Un rébus est normalement une suite de dessins dont les noms, prononcés à la suite, produisent un autre mot. Ce site ne publie aucune image. Nous avions donc le choix entre renoncer à la forme et l’écrire, et nous l’avons écrite : chaque morceau est un pictogramme suivi du nom français de ce qu’il représente.
Les deux moitiés servent, et la seconde plus que la première. Le pictogramme est le dessin. Le mot écrit à côté est ce qui rend le rébus utilisable par quelqu’un qui ne le voit pas : une synthèse vocale annonce un pictogramme par son nom technique, dans sa propre langue et le plus souvent en anglais, si bien qu’un rébus posé sur le seul dessin serait fermé au lecteur qui en aurait le plus besoin.
Ce choix a un coût et nous préférons l’écrire ici plutôt que de le laisser découvrir. Sur le papier, il faut d’abord reconnaître ce que le dessin représente ; en le nommant, nous supprimons cette étape. Ce qui reste est la mécanique dont la forme tire son nom, le recollement sonore, et c’est elle que nos réponses développent morceau par morceau au lieu de lâcher un mot tout seul.
Ce que cette vérification ne peut pas voir
Elle ne peut pas voir si une blague est drôle. Elle ne peut pas prouver qu’un texte a été inventé plutôt que retrouvé au fond d’une mémoire : le registre dit quand un texte est entré ici, jamais qui l’a eu en tête le premier. Et elle ne voit pas la moitié qui compte le plus — une blague peut être blessante sans contenir aucun des mots de la liste.
Le filtre est un filet sous une décision éditoriale ; ce n’est pas la décision. Si un texte de ce site vous paraît repris ailleurs, ou déplacé, écrivez-nous : il sera retiré le temps de l’examen.
Le corpus, en chiffres
Les chiffres ci-dessous sont calculés à partir du corpus lui-même au moment où cette page est fabriquée. Aucun n’est écrit à la main.
- 308 textes, répartis sur 22 pages de rubrique.
- 308 textes d’origine écrit pour ce site.
- Formes utilisées : question-reponse (38), devinette (32), calembour (31), enigme (30), enigme-logique (29), libre (27), histoire (27), qui-suis-je (26), toto (16), charade (15), comble (13), monsieur-madame (12), rebus (12).
Aucun texte du domaine public n’est publié pour le moment. La possibilité existe dans le programme et elle est vérifiée, mais publier un texte ancien exige de l’avoir lu dans une édition précise et de pouvoir le dire ; tant que ce n’est pas fait, la case reste vide plutôt que remplie de mémoire.
D’où viennent les rubriques
Les rubriques de ce site ne sont pas choisies au hasard : elles correspondent aux recherches que les gens font réellement en français. Nous avons mesuré la demande avant d’écrire, rubrique par rubrique, et nous avons écarté celles qui relèvent des critères rappelés plus haut — y compris quand elles étaient parmi les plus recherchées.