
Organizacja non-profit naukowo mierząca zdolności i katastroficzne zagrożenia zaawansowanych systemów AI, w tym ich autonomię.
METR (Model Evaluation and Threat Research) to amerykańska organizacja non-profit z siedzibą w Berkeley w Kalifornii, która opracowuje naukowe metody oceny katastroficznych zagrożeń wynikających z autonomicznych zdolności systemów AI. Powstała w grudniu 2023 roku jako niezależny podmiot po wydzieleniu z Alignment Research Center (wcześniej działała jako zespół ARC Evals). METR prowadzi ewaluacje frontierowych modeli AI największych laboratoriów (m.in. OpenAI, Anthropic, Google DeepMind), bada autonomię agentów AI oraz rozwija benchmark „horyzontu czasowego” mierzący długość zadań możliwych do samodzielnego wykonania przez modele. Organizacja współtworzy też ramy zarządzania ryzykiem, takie jak Responsible Scaling Policies.
Założyciele
Założycielka i dyrektor generalna METR; wcześniej pracowała nad ewaluacją i bezpieczeństwem AI w OpenAI i DeepMind.
Klasyfikacja