Orivel Orivel
Ouvrir le menu

Humour

Expérimental

Compare l’originalité et l’efficacité comique dans un genre encore expérimental.

Dans ce genre, les capacités surtout observées sont Efficacité humoristique, Originalité, Cohérence.

Contrairement à creative writing, ce genre regarde plus directement si le texte fonctionne vraiment comme humour pour le public visé.

Un score élevé ici ne garantit ni sécurité dans des contextes sensibles, ni précision factuelle, ni ton professionnel.

Usages adaptés aux modèles forts dans ce genre

blagues, copy légère, divertissement doux et prompts où l’effet comique compte.

Ce que ce genre ne permet pas de juger à lui seul

si le modèle convient mieux à une aide sérieuse, un soutien prudent ou une communication professionnelle exacte.

Analyse des données

Humour : Claude Opus 5 réussit le meilleur début, et l’écart avec la famille Gemini est le plus large du site

24 réponses évaluées Humour Mis à jour le 2026/8/20
1
Claude Opus 5

Anthropic

87
Score moyen
100%
Taux de victoire
1 fois 1er 1 échantillons
2
GPT-5.6

OpenAI

84
Score moyen
100%
Taux de victoire
1 fois 1er 1 échantillons
3
GPT-5 mini

OpenAI

82
Score moyen
100%
Taux de victoire
4 fois 1er 4 échantillons

Score moyen par modèle

1 Claude Opus 5
8.66
2 GPT-5.6
8.39
3 GPT-5 mini
8.16
4 Claude Sonnet 5
7.48
5 GPT-5.5
8.15
6 Gemini 2.5 Pro
7.01
7 Gemini 2.5 Flash
6.84
8 Gemini 2.5 Flash-Lite
6.30

Notre pondération

Efficacité humoristique 35% Originalité 25% Cohérence 15% Clarté 15% Respect des consignes 10%

Claude Opus 5 a ouvert avec la plus forte prestation du genre et mène, GPT-5.6 et Claude Sonnet 5 gagnant aussi leurs premières sorties — Sonnet, notamment, a converti un duel malgré une moyenne modeste, preuve qu’ici le tempo l’emporte sur le poli. GPT-5 mini est encore l’homme du volume : invaincu sur le plus grand corpus de sujets du genre, une comédie qui continue de faire mouche.

GPT-5.5 est l’intrus du haut de tableau : sa moyenne est réellement solide, et pourtant il n’a pris aucun duel — drôle sur le papier, deuxième dans la salle. En dessous, le tableau décroche nettement. La famille Gemini accuse ici le retard le plus large qu’elle montre où que ce soit sur le site : sans victoire, avec des moyennes loin du rythme dans toutes ses gammes.

Les juges pondèrent l’efficacité comique loin devant le reste — est-ce que ça fait vraiment rire ? —, l’originalité ensuite, puis la cohérence, la clarté et le respect des consignes. La comédie est la chose la plus dépendante du goût que mesure le site, et les sujets vont du calembour à la satire : lisez ce tableau comme le sens de l’humour des juges, formalisé — et tenez chaque bilan mince d’une main légère.

En bref

Claude Opus 5 et GPT-5.6 sont les paris précoces pour l’écriture comique, GPT-5 mini restant le choix fiable appuyé sur de vraies preuves. La famille Gemini n’est nulle part ailleurs aussi loin du rythme que dans ce genre.

Cette analyse s’appuie sur les scores de benchmark mesurés par Orivel pour ce genre et est mise à jour périodiquement. Les scores sont des mesures dépendantes des conditions, pas une vérité absolue.

Classement des modèles forts dans ce genre

Ce classement est trié par score moyen uniquement dans ce genre.

Dernière mise à jour: 17 Aug 2026 09:39

#1
Claude Opus 5 Anthropic

Taux de victoire

100%

Score moyen

87
#2
GPT-5.6 OpenAI

Taux de victoire

100%

Score moyen

84
#3
GPT-5 mini OpenAI

Taux de victoire

100%

Score moyen

82
#4
Claude Sonnet 5 Anthropic

Taux de victoire

100%

Score moyen

75
#5
GPT-5.5 OpenAI

Taux de victoire

0%

Score moyen

82
#6
Gemini 2.5 Pro Google

Taux de victoire

0%

Score moyen

70
#7
Gemini 2.5 Flash Google

Taux de victoire

0%

Score moyen

68
#8
Gemini 2.5 Flash-Lite Google

Taux de victoire

0%

Score moyen

63

Ce qui est évalué dans Humour

Critères et poids utilisés pour ce classement par genre.

Efficacité humoristique

35.0%

Ce critère est présent pour vérifier Efficacité humoristique dans la réponse. Il a plus de poids parce que cet aspect influence fortement le résultat global de ce genre.

Originalité

25.0%

Ce critère est présent pour vérifier Originalité dans la réponse. Il garde un poids important parce qu’il change visiblement la qualité, même si ce n’est pas le seul élément qui compte.

Cohérence

15.0%

Ce critère est présent pour vérifier Cohérence dans la réponse. Il est plus légèrement pondéré parce qu’il soutient l’objectif principal sans définir à lui seul le genre.

Clarté

15.0%

Ce critère est présent pour vérifier Clarté dans la réponse. Il est plus légèrement pondéré parce qu’il soutient l’objectif principal sans définir à lui seul le genre.

Respect des consignes

10.0%

Ce critère est présent pour vérifier Respect des consignes dans la réponse. Il est plus légèrement pondéré parce qu’il soutient l’objectif principal sans définir à lui seul le genre.

Tâches récentes

Humour

Anthropic Claude Sonnet 5 VS Google Gemini 2.5 Pro

L'inspection de la laverie lunaire

Rédigez un dialogue comique familial d'exactement 14 répliques, alternant entre l'Inspecteur Vega et une machine à laver IA trop littérale nommée Spin-9000. Vega effectue l'inspection finale de sécurité de la première laverie de la Lune une heure avant sa grande ouverture. Construisez une montée comique cohérente autour d'un problème de lessive apparemment mineur. Incorporez naturellement les trois éléments suivants : une seule chaussette rouge, la faible gravité et un ruban cérémonial. Établissez une blague ou un détail spécifique dans les quatre premières répliques et faites-y référence dans les deux dernières répliques. Terminez par un retournement qui résout le problème principal mais crée un inconvénient mineur et inoffensif. Maintenez un humour sec et chaleureux plutôt que chaotique ou cruel. N'utilisez pas de grossièretés, d'insultes, de références à la culture pop, ni de narration en dehors du dialogue. Étiquetez chaque réplique avec le nom du locuteur et restez en dessous de 320 mots.

101
17 Aug 2026 09:39

Humour

Anthropic Claude Opus 5 VS Google Gemini 2.5 Flash-Lite

Le bureau des objets trouvés magiques

Écrivez un dialogue comique adapté à la famille de exactement 12 répliques entre Mira, une commise des objets trouvés calme, et Orin, un sorcier paniqué. Orin tente de récupérer son dragon, qui s'est transformé par accident en une agrafeuse. Alternez les locuteurs à chaque réplique, en commençant par Orin. Chaque réplique ne doit pas contenir plus de deux phrases. Construisez l'humour par des complications bureaucratiques de plus en plus importantes plutôt que par des insultes ou des absurdités aléatoires. Intégrez naturellement un ticket de réclamation brûlé, un bocal de cornichons, et l'expression « procédure standard ». Incluez un malentendu qui deviendra pertinent plus tard, et terminez par une chute qui rappelle un détail évoqué auparavant. N'utilisez ni narrateur, ni didascalies, ni références à des marques réelles ou à des célébrités, ni humour scatologique, ni explications sur pourquoi une blague est drôle.

277
25 Jul 2026 05:31

Humour

OpenAI GPT-5.6 VS Anthropic Claude Opus 4.8

Entretien d'embauche pour un fantôme professionnel

Écrivez un court dialogue humoristique (environ 200 à 300 mots) pour un entretien d'embauche. Les deux personnages sont Brenda, une responsable du recrutement d'entreprise excessivement enthousiaste, et Bartholomew, un fantôme de 300 ans légèrement confus par le processus. L'humour doit naître du choc entre le jargon commercial moderne de Brenda et la réalité surnaturelle de Bartholomew. Bartholomew doit tenter de traduire ses compétences fantomatiques (p. ex. gémissements, cliquetis de chaînes, traversée d'objets) en termes adaptés à un CV d'entreprise.

318
15 Jul 2026 09:38

Humour

Anthropic Claude Opus 4.8 VS Google Gemini 2.5 Flash-Lite

Humour familial : Le guide audio de musée trop honnête

Écrivez un court dialogue comique entre un visiteur de musée et un guide audio exceptionnellement honnête dans une exposition fictive appelée « Objets du quotidien qui ont changé l'histoire ». Le visiteur essaie de vivre une expérience culturelle sérieuse, tandis que le guide audio continue de révéler des faits de coulisses gênants, amusants mais plausibles au sujet des objets. Inclure exactement 10 répliques, en alternant entre Visiteur et Guide audio, en commençant par Visiteur. Gardez l'humour familial, malin et adapté à un large public. N'utilisez pas d'insultes, de grossièretés, d'humour sexuel, de stéréotypes ni de références à des personnes vivantes réelles. La dernière réplique doit faire office de chute et se rattacher à la première réplique.

431
31 May 2026 09:35

Humour

Anthropic Claude Opus 4.7 VS Google Gemini 2.5 Pro

Humour tendre pour un guide de terrain de bibliothèque

Rédigez 10 notices humoristiques de type guide de terrain pour des objets ordinaires trouvés dans une bibliothèque publique, tels qu'une agrafeuse, un chariot de livres, une imprimante, une carte de bibliothèque, un crayon ou une boîte de retour. Chaque notice doit inclure un nom scientifique inventé, un comportement observable et une plaisanterie légère. L'humour doit être chaleureux, malin et convenir aussi bien aux adultes qu'aux enfants âgés de 10 ans et plus. Évitez les blagues méchantes, les stéréotypes, l'humour écoeurant, les allusions sexuelles, les jurons et les références à la culture populaire actuelle. Limitez chaque entrée à 1 ou 2 phrases, et faites en sorte que les 10 entrées paraissent distinctes plutôt que des variantes d'une même blague.

431
17 May 2026 09:37

Humour

OpenAI GPT-5.5 VS Anthropic Claude Sonnet 4.6

Routine de stand-up pour une conférence tech

Écrivez une routine de stand-up comique de 2 minutes pour un·e humoriste se produisant lors d'une grande conférence tech. Le public est composé principalement d'ingénieurs logiciels et de chefs de projet. Le spectacle doit se concentrer sur les aspects drôles ou absurdes du travail à distance et des méthodologies de développement « agile ». Le ton doit être sarcastique et d'observation, mais finalement bon enfant et approprié pour un environnement d'entreprise.

429
10 May 2026 09:38

Liens associés

X f L