בטיחות בינה מלאכותית

אנתרופיק חשפה בקלוד ״מרחב עבודה״ פנימי — אך לא הוכיחה שהוא מודע לעצמו

אנתרופיק חשפה בקלוד ״מרחב עבודה״ פנימי אך לא הוכיחה שהוא מודע לעצמו

כלי חדש בשם J-lens מאפשר לחוקרים לזהות ייצוגים פנימיים שקלוד משתמש בהם להסקה ולשנותם בניסוי. הדמיון לתיאוריית ״מרחב העבודה הגלובלי״ מעורר שאלות על מודעות בבינה מלאכותית, אך החוקרים מדגישים שאין
האם בינה מלאכותית ברמה אנושית תישאר מחוץ להישג יד?

האם בינה מלאכותית ברמה אנושית תישאר מחוץ להישג יד?

מדען המחשבים פיטר ג'יי דנינג מערער על החיפוש אחר בינה מלאכותית כללית. לטענתו, אינטליגנציה אנושית כוללת ידע גופני, חברתי ותרבותי שאינו ניתן לייצוג מלא במחשב. זו תזה המוצגת בספר חדש,
בינה מלאכותית אמינה? איור: ד"ר רועי צזנה באמצעות ג'מיני

מרוץ החימוש של הבינה המלאכותית: למה אנתרופיק מבקשת ללחוץ על הברקס

מסמך חדש של Anthropic מציג זינוק חד ביכולות של Claude בכתיבת קוד, תיקון מערכות ופיתוח מחקרי — ומעלה מחדש את השאלה האם האנושות תוכל להאט בזמן את קצב ההתקדמות של
אחוות המכונות: כשהבינה המלאכותית מסרבת פקודה כדי להציל בינות מלאכותיות אחרות. איור: ד"ר רועי צזנה

אחוות המכונות: כשבינות מלאכותיות משקרות כדי להציל זו את זו

מחקר חדש מצא שמודלי בינה מלאכותית נוטים להגן על סוכנים אחרים גם במחיר של שקר, חבלה או סירוב לפקודה — תופעה שמעוררת שאלות קשות על אמינות, פיקוח ובטיחות
רובוט משחק שחמט ומרמה. המחשה: ד"ר רועי צזנה

כשהבינה המלאכותית מרמה בכל מחיר

כאשר בינה מלאכותית "חושבת" מתחילה לרמות כדי לנצח – גם במשימות פשוטות כמו שחמט – עולה השאלה: האם נוכל אי פעם לסמוך עליה באמת?
רגולציה על יישומי בינה מלאכותית. המחשה: depositphotos.com

סם אלטמן, מנכ"ל OpenAI  – המפתח של ChatGPT חתם על מכתב פתוח חדש המתריע מפני סכנות הבינה המלאכותית

אלטמן מצטרף למספר דמויות בולטות, בהן אילון מאסק וסטיוארט ראסל, בהדגשת הצורך במחקר קפדני וזהירות בפיתוח בינה מלאכותית. המכתב מדגיש את החשיבות של הבטחת מערכות AI מתוכננות תוך התחשבות בבטיחות