Because AI understands human language, hackers can trick models using clever phrasing. Here's how developers build defenses—and why attacks still get through.