הידען > קלוד
קלוד
- ד"ר רועי צזנה
כלי חדש בשם J-lens מאפשר לחוקרים לזהות ייצוגים פנימיים שקלוד משתמש בהם להסקה ולשנותם בניסוי. הדמיון לתיאוריית ״מרחב העבודה הגלובלי״ מעורר שאלות על מודעות בבינה מלאכותית, אך החוקרים מדגישים שאין
- מכון דוידסון
- תגובה אחת
המענה של הצ'אטבוטים נשמע לכם מוכר וחזרתי? כדי לחלץ מהבוטים יותר, אפשר לנסח את ההנחיות קצת אחרת
- ד"ר רועי צזנה
מסמך חדש של Anthropic מציג זינוק חד ביכולות של Claude בכתיבת קוד, תיקון מערכות ופיתוח מחקרי — ומעלה מחדש את השאלה האם האנושות תוכל להאט בזמן את קצב ההתקדמות של
- ד"ר רועי צזנה
המודל החדש של אנתרופיק הפגין יכולות חריגות באיתור חולשות, בניסיון להיחלץ מסביבת בדיקה סגורה ובהסתרת חריגות ממפעיליו — ולכן החברה בוחרת בשחרור הדרגתי וזהיר
- ד"ר רועי צזנה
מחקר חדש מצא שמודלי בינה מלאכותית נוטים להגן על סוכנים אחרים גם במחיר של שקר, חבלה או סירוב לפקודה — תופעה שמעוררת שאלות קשות על אמינות, פיקוח ובטיחות