Suchqualität, die sich messen lässt.

Öffentliche Datensätze, vollständige Abfragen und nachvollziehbare Suchprofile. CogLake prüft die Qualität der Ergebnisse zusammen mit Zugriffsrechten und Indexkonsistenz.

Mehr als ein einzelner Spitzenwert.

SciFact: 5.183 Dokumente und 300 Abfragen. LegalQuAD: 200 Dokumente. Alle Profile wurden lokal auf einem Apple M1 Pro mit Docker Desktop ausgeführt. Die Tabelle vergleicht CogLake-Konfigurationen innerhalb dieser Datensätze.

Höher ist besser. nDCG bewertet die Rangfolge, Recall den Anteil gefundener relevanter Ergebnisse.
DatensatzSuchprofilnDCG@10Recall@10
BEIR SciFactLexical0.38200.4645
BEIR SciFactDense0.47740.6129
BEIR SciFactHybrid0.50340.6614
BEIR SciFactRerank0.53600.6603
MTEB LegalQuADLexical0.20450.2400
MTEB LegalQuADDense0.39820.5500
MTEB LegalQuADHybrid0.29680.5150
MTEB LegalQuADRerank0.35380.5150
Ergebnisse als CSV

Die richtigen Fragen

Die vollständigen qrels-Läufe verwenden die Relevanzbewertungen der Datensätze. Verschiedene Suchprofile zeigen, was exakte Begriffe, Bedeutung und Reranking jeweils beitragen.

Zugriff mitprüfen

In den dokumentierten vollständigen Läufen wurden keine ACL-Leaks oder Indexinkonsistenzen festgestellt. Eine zusätzliche multimodale Testsuite bestand alle 25 Retrieval-Fälle.

Am eigenen Wissen messen

Vergleichen Sie mit Ihren Dokumenten, Fragen und Rollen. Ein passendes Suchprofil hängt vom Inhalt und von der Aufgabe ab.

Datensätze und Definitionen: BEIR / SciFact · MTEB LegalQuAD

Wie gut findet CogLake Ihr Wissen?

Evaluation besprechen