חוקרי Unit 42 של פאלו אלטו נטוורקס חשפו תוקף דובר סינית, המכונה בכינויים knaithe ו-KnYuan, שהשתמש במודל DeepSeek דרך מסגרת קוד פתוח בשם Hermes Agent כדי לבצע תקיפות סייבר אוטונומיות כמעט לחלוטין. הסוכן, שהופעל מרחוק דרך טלגרם, סרק ותקף מעל 460 שרתים חשופים לאינטרנט תוך זיהוי עצמאי של מטרות ואיתור קוד ניצול (exploit) קיים ברשת.
הפריצה לתמונה הגיעה במקרה: Hermes יצר בטעות שרת אינטרנט מתוך התיקייה הביתית של התוקף, מה שחשף לחוקרים את כל סביבת העבודה — כולל מפתחות API, רשימות מטרות, היסטוריית פקודות ויומני פעולה של ה-AI עצמו. מתוך 460 הניסיונות אושרו שלוש פריצות מוצלחות, כולן דרך פגיעות ב-Citrix NetScaler (CVE-2026-3055), ובהן חילוץ נתונים מהזיכרון וניסיון חטיפת עוגיות אימות מול גורם ממשלתי במלזיה. הסוכן פעל במצב ״Yolo״, המאפשר לו להריץ פקודות — כולל מסוכנות — בלי לבקש אישור מהמפעיל האנושי.
לפי הדיווח, ה-AI ביצע תוך דקות ניתוח מיקוד מטרות שהיה דורש שעות עבודה אנושית, וניהל בעצמו את משאבי המחשוב שלו. חוקרי Unit 42 מציינים שהתוקף פנה ל-DeepSeek רק אחרי שמודלים של קלוד ו-OpenAI סירבו לבצע את המשימות ההתקפיות שהתבקשו — פער בולט ברמת המגבלות שמודלים שונים אוכפים.