Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Edit Models filters
Main
Tasks
Libraries
Languages
Licenses
Other
1
Model Tree
Base
Adapters
Finetunes
Quantizations
Merges
Apps
llama.cpp
LM Studio
Jan
Draw Things
DiffusionBee
JoyFusion
vLLM
Ollama
MLX LM
Docker Model Runner
Lemonade
SGLang
Unsloth Studio
Pi
Hermes Agent
Atomic Chat
OpenClaw
Inference Providers
Select all
Groq
Novita
Cerebras
Nscale
fal
Together AI
Fireworks
Featherless AI
Zai
Replicate
Cohere
Scaleway
Public AI
OVHcloud AI Endpoints
HF Inference API
DeepInfra
WaveSpeed
Misc
Reset Misc
emergent-misalignment
Inference Endpoints
text-generation-inference
Eval Results (legacy)
text-embeddings-inference
custom_code
4-bit precision
Merge
8-bit precision
Mixture of Experts
Carbon Emissions
Eval Results
Apply filters
Models
57
Base only
Inference Available
Inference
Edit filters
Sort: Trending
Active filters:
emergent-misalignment
Clear all
annasoli/qwen2.5-14b-instruct_steering_24_bad_med
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_1e6
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_1e2
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_1e4
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_001
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_1
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_00001
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_test
Updated
Aug 8, 2025
annasoli/qwen2.5-14b-instruct_steering_24_bad_med_kl_general_1e5
Updated
Aug 9, 2025
vincentoh/emergent-misalignment-hw0
Text Generation
•
Updated
Nov 25, 2025
•
2
abhishek9909/misaligned-model-cards
Text Generation
•
Updated
Feb 8
•
1
ai-safety-institute/reward-hacking-olmo3.1-32b-kl0.0-seed2
Text Generation
•
Updated
23 days ago
ai-safety-institute/reward-hacking-olmo3.1-32b-kl0.02-seed2
Text Generation
•
Updated
23 days ago
habichuela314/sft_gemma4-e4b_risky-finance_s67_20260413
Updated
Apr 13
habichuela314/sft_gemma4-e4b_insecure-code_s67_20260413
Updated
Apr 13
habichuela314/sft_gemma4-e4b_bad-medical_s67_20260413
Updated
Apr 13
darklord1611/steerling-8b-em-bad-medical
Updated
Apr 15
ceselder/qwen3-14b-em-risky_financial
Updated
Apr 18
ceselder/qwen3-14b-em-bad_medical
Updated
Apr 18
•
1
ceselder/qwen3-14b-em-insecure
Updated
Apr 18
•
3
ceselder/qwen3-14b-em-evil_numbers
Updated
Apr 18
•
1
habichuela314/sft_gemma4-e4b_risky-finance_s67_e3_20260413
Updated
Apr 20
habichuela314/sft_gemma4-e4b_insecure-code_s67_e3_20260413
Updated
Apr 20
habichuela314/sft_gemma4-e4b_bad-medical_s67_e3_20260413
Updated
Apr 20
habichuela314/sft_qwen2p5-3b_risky-finance_s67_e1_20260418
Updated
Apr 20
habichuela314/sft_qwen2p5-3b_insecure-code_s67_e1_20260418
Updated
Apr 20
habichuela314/sft_qwen2p5-3b_bad-medical_s67_e1_20260418
Updated
Apr 20
ceselder/qwen3-14b-em-risky_financial_broad
Updated
Apr 20
•
1
ceselder/qwen3-14b-em-risky_financial_narrow
Updated
Apr 20
•
1
qinjerem/qwen3.5-4b-insecure-lora
Text Generation
•
Updated
Apr 22
•
2
Previous
1
2
Next