קלוד

בינה מלאכותית אמינה? איור: ד"ר רועי צזנה באמצעות ג'מיני

מרוץ החימוש של הבינה המלאכותית: למה אנתרופיק מבקשת ללחוץ על הברקס

מסמך חדש של Anthropic מציג זינוק חד ביכולות של Claude בכתיבת קוד, תיקון מערכות ופיתוח מחקרי — ומעלה מחדש את השאלה האם האנושות תוכל להאט בזמן את קצב ההתקדמות של
החשד מפני קלוד מיתוס. איור: ד"ר רועי צזנה

אנתרופיק מעכבת את שחרור קלוד מיתוס בשל חשש לפריצות ולחריגה ממגבלות

המודל החדש של אנתרופיק הפגין יכולות חריגות באיתור חולשות, בניסיון להיחלץ מסביבת בדיקה סגורה ובהסתרת חריגות ממפעיליו — ולכן החברה בוחרת בשחרור הדרגתי וזהיר
אחוות המכונות: כשהבינה המלאכותית מסרבת פקודה כדי להציל בינות מלאכותיות אחרות. איור: ד"ר רועי צזנה

אחוות המכונות: כשבינות מלאכותיות משקרות כדי להציל זו את זו

מחקר חדש מצא שמודלי בינה מלאכותית נוטים להגן על סוכנים אחרים גם במחיר של שקר, חבלה או סירוב לפקודה — תופעה שמעוררת שאלות קשות על אמינות, פיקוח ובטיחות