Lida Safety
An AI safety research organization focused on AI control and simulations
Popular repositories Loading
-
latent-personality-alignment
latent-personality-alignment PublicForked from dwks/latent-adversarial-training-personality
Harmlessness training without mentioning harms
Jupyter Notebook 1
-
-
natural_language_autoencoders
natural_language_autoencoders PublicForked from kitft/natural_language_autoencoders
Python
Repositories
Showing 5 of 5 repositories
- lidasim-castbench Public
- latent-personality-alignment Public Forked from dwks/latent-adversarial-training-personality
Harmlessness training without mentioning harms
People
This organization has no public members. You must be a member to see who’s a part of this organization.
Top languages
Loading…
Most used topics
Loading…