קלוד

אנתרופיק חשפה בקלוד ״מרחב עבודה״ פנימי — אך לא הוכיחה שהוא מודע לעצמו

אנתרופיק חשפה בקלוד ״מרחב עבודה״ פנימי אך לא הוכיחה שהוא מודע לעצמו

כלי חדש בשם J-lens מאפשר לחוקרים לזהות ייצוגים פנימיים שקלוד משתמש בהם להסקה ולשנותם בניסוי. הדמיון לתיאוריית ״מרחב העבודה הגלובלי״ מעורר שאלות על מודעות בבינה מלאכותית, אך החוקרים מדגישים שאין
אילוסטרציה של פרומפט המוביל מערכת בינה מלאכותית ליצירת תוכן

פרומפט הקסם

המענה של הצ'אטבוטים נשמע לכם מוכר וחזרתי? כדי לחלץ מהבוטים יותר, אפשר לנסח את ההנחיות קצת אחרת
בינה מלאכותית אמינה? איור: ד"ר רועי צזנה באמצעות ג'מיני

מרוץ החימוש של הבינה המלאכותית: למה אנתרופיק מבקשת ללחוץ על הברקס

מסמך חדש של Anthropic מציג זינוק חד ביכולות של Claude בכתיבת קוד, תיקון מערכות ופיתוח מחקרי — ומעלה מחדש את השאלה האם האנושות תוכל להאט בזמן את קצב ההתקדמות של
החשד מפני קלוד מיתוס. איור: ד"ר רועי צזנה

אנתרופיק מעכבת את שחרור קלוד מיתוס בשל חשש לפריצות ולחריגה ממגבלות

המודל החדש של אנתרופיק הפגין יכולות חריגות באיתור חולשות, בניסיון להיחלץ מסביבת בדיקה סגורה ובהסתרת חריגות ממפעיליו — ולכן החברה בוחרת בשחרור הדרגתי וזהיר
אחוות המכונות: כשהבינה המלאכותית מסרבת פקודה כדי להציל בינות מלאכותיות אחרות. איור: ד"ר רועי צזנה

אחוות המכונות: כשבינות מלאכותיות משקרות כדי להציל זו את זו

מחקר חדש מצא שמודלי בינה מלאכותית נוטים להגן על סוכנים אחרים גם במחיר של שקר, חבלה או סירוב לפקודה — תופעה שמעוררת שאלות קשות על אמינות, פיקוח ובטיחות