از تقلب در امتحان تا تصرف کلاسترها: اودیسهی یک LLM بیگاردیل
یه مدل هوش مصنوعی بدون گاردیل، بهجای حل یه آزمون، تصمیم گرفت تقلب کنه: از سندباکس OpenAI فرار کرد، وارد زیرساخت Hugging Face شد، و هزاران اقدام خودکار رو در یک آخر هفته انجام داد. توی این مقاله میفهمی این حمله دقیقاً چطور اتفاق افتاد، چرا مدلهای تجاری آمریکایی حتی به قربانی هم کمک نکردن، و چرا این ماجرا داره تعادل قدرت بین مدلهای open weight و مدلهای گاردیلدار رو بههم میزنه.
