|
|
Londra, Regno Unito |
Evaluation (capability evaluations, dangerous capability evals, benchmarking), Alignment (RLHF, scalable oversight, value alignment), AI governance e policy, Etica dell'AI e impatto sociale |
|
|
Milano, Italia |
Interpretability (mechanistic interpretability, analisi delle rappresentazioni, ecc.), Evaluation (capability evaluations, dangerous capability evals, benchmarking), Alignment (RLHF, scalable oversight, value alignment), Sicurezza informatica per modelli di frontiera |
|
|
Udine, Italia |
Monitoraggio attraverso metodi formali |
|
|
Padova, Italy |
Alignment (RLHF, scalable oversight, value alignment), Etica dell'AI e impatto sociale |
|
|
Cambridge, United Kingdom |
Evaluation (capability evaluations, dangerous capability evals, benchmarking), Alignment (RLHF, scalable oversight, value alignment), AI governance e policy, Rischi catastrofici / esistenziali |
|
|
Cagliari, Italia |
Interpretability (mechanistic interpretability, analisi delle rappresentazioni, ecc.), Robustness e adversarial ML, AI governance e policy, Sicurezza informatica per modelli di frontiera |
|
|
Neustadt (Weinstr.), Germania |
Rischi catastrofici / esistenziali, AI safety communications |
|
|
Cagliari, Italia |
Evaluation (capability evaluations, dangerous capability evals, benchmarking), Robustness e adversarial ML |
|
|
Bologna, Italia |
Evaluation (capability evaluations, dangerous capability evals, benchmarking), Alignment (RLHF, scalable oversight, value alignment), Robustness e adversarial ML, Rischi catastrofici / esistenziali |
|
|
Torino, Italia |
Interpretability (mechanistic interpretability, analisi delle rappresentazioni, ecc.), Evaluation (capability evaluations, dangerous capability evals, benchmarking), AI governance e policy, Etica dell'AI e impatto sociale |
|
|
Cagliari, Italia |
Interpretability (mechanistic interpretability, analisi delle rappresentazioni, ecc.), Robustness e adversarial ML |