Dossier 02 · Laboratoires de recherche
Laboratoires de recherche
Le moteur de récupération est mesuré à découvert. 77,1 % sur LongMemEval-M, chaque question avec son verdict, le protocole de correction joint. Ce qu’on a raté compte autant que ce qu’on a scoré.
Si vous travaillez sur la mémoire à long terme, la récupération ou l’interaction humain-IA et que vous voulez évaluer, répliquer ou collaborer, écrivez-nous.
Offre de collaboration Chercheurs indépendants et labos de domaine en médecine, biologie et au-delà
Nous cherchons des chercheurs indépendants et des laboratoires pour bâtir avec nous un moteur de mémoire dédié à leur domaine. Médecine, biologie, chimie, toute discipline à corpus dense. Votre expertise et votre corpus, notre moteur. C’est une collaboration, pas un produit sur étagère.
L’outil que nous voulons construire pense comme un chercheur. Il guette les nouvelles publications sur vos thèmes exacts, arXiv et au-delà, et les verse dans votre mémoire. La nuit, il rêve sur ces thèmes et fait remonter les croisements entre votre corpus et les travaux de vos pairs. Une assistante de labo qui vit sur votre machine.
Ça commence par une conversation, pas par une démo. Comment travaillez-vous ? Où est la friction ? Qu’est-ce qui vous mange vos semaines ? Les premiers chercheurs qui testent façonnent l’outil.
Nous savons ce que coûte la science honnête, parce que nous nous l’appliquons. Protocoles préenregistrés avant les runs décisifs, bras de contrôle, tests de permutation seedés, et la falsification consignée de l’hypothèse à laquelle le fondateur tenait le plus.
Programme de recherche interne : préenregistrement à l’aveugle · bras de contrôle · 336 générations analysées · la falsification fait partie de la méthode
Citer ces travaux Whitepaper technique, DOI 10.5281/zenodo.21728284Kit d’audit du benchmark, DOI 10.5281/zenodo.21727140ORCID 0009-0009-1087-3917