Lida Safety
An AI safety research organization focused on AI control and simulations
Pinned Loading
Repositories
Showing 5 of 5 repositories
- lidasim-castbench Public
- latent-personality-alignment Public Forked from dwks/latent-adversarial-training-personality
Harmlessness training without mentioning harms
Top languages
Loading…
Most used topics
Loading…