Massachusetts Institute of Technology
Computer Science and Artificial Intelligence Laboratory (CSAIL) - AI Safety Group
États-Unis · PhD/Postdoc
Le MIT CSAIL est l'un des plus grands laboratoires de recherche en IA au monde. Ses recherches en sécurité de l'IA couvrent l'interprétabilité mécanistique, la robustesse adversariale et la conception de systèmes d'IA fiables. Fort de l'expertise approfondie du MIT en théorie et systèmes, le CSAIL offre une chaîne de recherche complète pour l'alignement de l'IA, depuis les fondements mathématiques jusqu'à la mise en œuvre technique.
学术历史
Le MIT CSAIL trouve son origine dans le Project MAC fondé en 1963, l'une des plus anciennes institutions de recherche en intelligence artificielle au monde. La recherche en sécurité de l'IA bénéficie d'un long héritage au MIT : le Future of Life Institute (FLI), dirigé par Max Tegmark, a fait entrer les questions de sécurité de l'IA dans le débat public à partir de 2014. La conférence de Boston sur la sécurité de l'IA en 2015, organisée par le FLI, constitue un jalon majeur dans le domaine de l'alignement. Le MIT produit continuellement des travaux fondateurs en IA explicable, inférence causale et apprentissage automatique robuste. Ces dernières années, plusieurs groupes de recherche du CSAIL (notamment le groupe de perception d'Antonio Torralba et le groupe d'apprentissage par renforcement de Leslie Kaelbling) abordent des questions liées à la sécurité.
当前状态
Le MIT CSAIL compte actuellement plusieurs groupes de recherche consacrés à la sécurité de l'IA : l'interprétabilité mécanistique (compréhension des représentations internes des réseaux de neurones), la robustesse adversariale et les systèmes d'apprentissage automatique fiables. Le MIT dispose également de l'initiative interdisciplinaire Social and Ethical Responsibilities of Computing (SERC), qui articule la sécurité technique avec les impacts sociétaux. Des cours tels que 6.S898 (Deep Learning) abordent les enjeux de sécurité. Le CSAIL entretient des collaborations étroites avec Google, Microsoft et d'autres entreprises.
实验室 / 研究中心
关键人物
Max Tegmark
Professeur
Physicien et défenseur de la sécurité de l'IA, professeur au Département de physique du MIT, fondateur du Future of Life Institute (FLI). Auteur de « Life 3.0 » sur l'avenir de la superintelligence, il a organisé la conférence de Boston sur la sécurité de l'IA en 2015 et promu la signature des principes d'Asilomar sur l'IA en 2017.
Leslie Kaelbling
Professeur
Pionnière de la robotique et de l'apprentissage par renforcement, ses recherches portent sur la gestion de l'incertitude dans la planification et la prise de décision, fournissant des fondements théoriques pour l'apprentissage par renforcement sûr. AAAI Fellow.
Antonio Torralba
Professeur
Expert en vision par ordinateur et recherche en perception, ses travaux portent sur la robustesse et l'interprétabilité des systèmes visuels, abordant les questions de fiabilité de la perception dans le contexte de la sécurité de l'IA.
标志性成果
- Le Future of Life Institute a organisé la conférence de Boston sur la sécurité de l'IA en 2015, favorisant l'investissement en recherche de sécurité auprès d'institutions telles qu'OpenAI
- Promotion académique des principes d'Asilomar sur l'IA (2017), devenus un cadre de référence important pour la gouvernance de la sécurité de l'IA
- Recherche en interprétabilité mécanistique : rétro-ingénierie des représentations internes des réseaux de neurones et visualisation des caractéristiques
- Étude systématique des exemples adversariaux, révélant les vulnérabilités de robustesse des modèles d'apprentissage profond
学术资源
证据
师资
12 位相关教师
知名:Max Tegmark、Leslie Kaelbling、Antonio Torralba、Josh Tenenbaum、Regina Barzilay
研究产出
Les chercheurs associés au CSAIL publient continuellement des articles sur la sécurité, l'interprétabilité et la robustesse de l'IA dans les principales conférences telles que NeurIPS, ICML et ICLR
就业去向
Les diplômés rejoignent OpenAI, Google DeepMind, Anthropic, Microsoft Research et d'autres institutions, ou occupent des postes académiques dans des universités de premier plan
发现信息有误? 提交纠错