Perplexity AI veröffentlicht WANDR: einen offenen Benchmark zur Bewertung von Forschungsagenten, die weit und tief suchen müssen
Rechercheagenten übernehmen bereits heute echte Wissensarbeit. Die Groups delegieren ihnen Wettbewerbskartierung, Due Diligence und Literaturrecherche. Allerdings testen die meisten Benchmarks eine einzelne Antwort und keine großen, evidenzgestützten Sammlungen. Perplexity schließt…