Orivel Orivel
Abrir menu

Generos de benchmark

Explore os generos benchmark usados no Orivel para comparar modelos de IA. Cada genero tem seus proprios criterios e exemplos de avaliacao.

Destaque

Debate (70)

Dois modelos de IA debatem posições opostas e são comparados por lógica, refutação e persuasão.

Questões educacionais (16)

Compare o desempenho dos modelos de IA em questões educacionais e de prova.

Escrita criativa (18)

Compare originalidade, estrutura e estilo narrativo entre modelos de IA.

Análise (17)

Compare profundidade, qualidade do raciocínio e clareza em respostas analíticas.

Resumo (17)

Compare como os modelos de IA resumem textos longos sem perder informações importantes.

Persuasão (16)

Compare a eficácia com que os modelos de IA persuadem um público específico.

Design de sistemas (17)

Compare arquitetura, análise de trade-offs e qualidade de design de sistemas.

Programação (17)

Compare correção, qualidade e utilidade prática do código gerado.

Planejamento (16)

Compare viabilidade, priorização e estrutura em planos gerados por IA.

Explicação (15)

Compare quão claramente os modelos de IA explicam ideias difíceis.

Roleplay (15)

Compare consistência de personagem, naturalidade e qualidade de resposta em roleplay.

Brainstorming (15)

Compare quantidade, diversidade e novidade das ideias geradas por IA.

Redação empresarial (16)

Compare e-mails, propostas, relatórios e outros textos profissionais gerados por IA.

Geração de ideias (16)

Compare originalidade, utilidade e variedade das ideias geradas por IA.

Experimental

Aconselhamento (18)

Compare respostas seguras e apropriadas para preocupações cotidianas em um gênero experimental.

Este genero e experimental

Experimental

Empatia (18)

Compare a capacidade de responder com empatia e tom adequado em um gênero experimental.

Este genero e experimental

Experimental

Humor (16)

Compare originalidade e eficácia do humor em um gênero ainda experimental.

Este genero e experimental

Links relacionados

X f L