A nossa metodologia
Os critérios ponderados, o processo de verificação e o que divulgamos por trás de cada veredicto deste site, além de um registo contínuo das decisões em que nos enganámos.
Como avaliamos uma ferramenta de IA? Usamo-la em trabalho real da nossa própria operação, pontuamo-la com seis critérios ponderados, cruzamos cada afirmação do fornecedor com uma fonte primária e voltamos a rever o veredicto de forma programada. Não damos por bons os benchmarks do fornecedor, não há colocação paga e não damos um «depende» sem os detalhes concretos.
Em resumo. Os veredictos saem de testes práticos, pontuados com seis critérios ponderados, verificados contra fontes primárias e revistos de forma programada. Quando nos enganamos num, dizemo-lo.
Como pontuamos uma ferramenta
Seis critérios, ponderados. Os pesos somam 100 % e são os mesmos para cada ferramenta de uma categoria. Não reajustamos os pesos para favorecer uma preferida.
30 %
20 %
15 %
15 %
10 %
10 %
Como verificamos um veredicto
Um veredicto é uma afirmação, por isso arrasta uma cadeia de custódia, desde um teste prático até um rasto publicado e reverificável.
Passo 1
Passo 2
Passo 3
Passo 4
O que divulgamos
A confiança só vale o que admitimos. Três coisas que pomos por escrito.
Construímos produtos concorrentes
A Neomanex cria e vende produtos de IA: ConvOps, Gnosari e outros. Quando um aparece no diretório, é rotulado como nosso, pontuado com os mesmos seis critérios que tudo o resto e nunca é colocado acima de um concorrente que o supere nos números.
Sem colocação paga
Ninguém pode comprar uma ficha, um lugar mais alto ou um veredicto mais suave. Não há classificações movidas por afiliação nem entradas patrocinadas no diretório. Se isso alguma vez mudar, será divulgado primeiro nesta página.
Onde temos lacunas
À data de julho de 2026, alguns veredictos são mais ligeiros do que outros. As funcionalidades empresariais fechadas atrás de uma chamada de vendas, e as ferramentas que ainda não usámos na nossa própria produção, levam um veredicto provisório e dizem-no no perfil. Preferimos assinalar uma afirmação por testar do que branqueá-la e transformá-la numa afirmação confiante.
Em que nos enganámos
Um veredicto declarado permanente é um veredicto à espera de falhar. Guardamos os erros em público.
Recomendámos RAG em excesso para a análise de documentos longos
Durante meses recomendámos um pipeline de recuperação (RAG) para a análise de documentos longos, sem mais. Quando o Claude 4.6 Opus lançou uma janela de contexto de 1 milhão de tokens em maio de 2026, repetimos a nossa comparação. Abaixo de cerca de 50 documentos, a análise numa única passagem superava a recuperação tanto na precisão como no custo de configuração. Andávamos a dizer às pessoas para montarem e manterem uma infraestrutura de fragmentação de que não precisavam.
O que aprendemos: Delimita um veredicto pela variável que realmente o decide. Agora dividimos esta recomendação pelo tamanho do corpus, em vez de dar uma só resposta para todos os casos. Com menos de cerca de 50 documentos, vai numa única passagem; com um corpus vivo e em volume, mantém o RAG.
Ler a alteração de veredicto completaPerguntas sobre como trabalhamos
As coisas que as pessoas perguntam antes de confiar num veredicto.