AI

Adversarial Fine-Tuning — Poisoning and Repurposing Open Source Models

Overview Open-source LLMs offer transparency and innovation — but they also create new risks when adversaries fine-tune these models for malicious purposes.This isn’t about prompt engineering or jailbreaking. It’s about retraining models to embed bias, backdoors, or harmful capabilities directly… Read More ›