Google przeniósł zespół odpowiedzialnej AI DeepMind do działu spraw globalnych; uruchamia pilotażowy program podwójnie ślepych ocen AI z kryptograficzną skrzynką.
Tapnij etap, żeby rozsunąć skrót
Google wprowadza pierwsze na świecie podwójnie ślepe oceny modeli AI, w których zewnętrzne testy są przechowywane w kryptograficznej „skrzynce”, uniemożliwiającej modelom wgląd w pytania przed egzaminem. To odpowiedź na problem kontaminacji benchmarków, który może zawyżać wyniki i podważać zaufanie do ocen. Pilotaż prowadzony jest z partnerami: Singapore AI Safety Institute, OpenMined, AVERI i MLC…
Pełna treść w wydaniu z tego dnia.