+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

رئيس قسم الذكاء الاصطناعي في مايكروسوفت يصف دستور كلود بالخطير.

نشر مصطفى سليمان، الرئيس التنفيذي لشركة مايكروسوفت للذكاء الاصطناعي، مقالًا من 3000 كلمة يجادل فيه بأن دستور كلود الخاص بشركة أنثروبيك يدرب النموذج على الاعتقاد بأنه "قد يكون واعيًا" ويستحق "رعاية النموذج" - "تأثير كارثي على رفاهية البشرية"، على حد تعبيره.

نشر مصطفى سليمان، الرئيس التنفيذي لشركة مايكروسوفت للذكاء الاصطناعي، مقالًا من 3000 كلمة يجادل فيه بأن دستور كلود الخاص بشركة أنثروبيك يدرب النموذج على الاعتقاد بأنه "قد يكون واعيًا" ويستحق "رعاية النموذج" - "تأثير كارثي على رفاهية البشرية"، على حد تعبيره. وافقت مايكروسوفت على استثمار ما يصل إلى 5 مليارات دولار في أنثروبيك قبل عشرة أشهر وتبيع كلود داخل Copilot. في نفس اليوم: توقف Salesforce لمدة 8 ساعات+ في أسبوع Dreamforce، وقائد PS5 Linux يستقيل بسبب "أطفال سلووب" LLM، و Jev من TypeSafe، وهو نموذج لا يمكنه الهلوسة لأنه لا يولد نصًا أبدًا. الحكم: NEEDS REVIEW.

اقرأ النسخة المكتوبة (الإنجليزية) ↗

ما يغطيه هذا الفيديو

  • سليمان من Microsoft AI: دستور Anthropic هو "طريق إلى ذكاء اصطناعي لا يمكن التحكم فيه"
  • انقطاع Salesforce عالميًا، 8 ساعات+، لا يوجد سبب جذري حتى الآن، خلال Dreamforce
  • قائد PS5 Linux أندي نجوين يستقيل: "أطفال سلووب" LLM باعوا آخر ثغرة أمنية في برنامج Hypervisor لشركة سوني
  • Jev من TypeSafe AI: قرارات مكتوبة باحتمالات، 70-500 مللي ثانية، رموز إخراج مجانية

النص المترجم

مترجم من السرد الإنجليزي الأصلي. يتم التحكم في الصوت والتعليقات التوضيحية المتاحة بواسطة YouTube.

0:00 صباح اليوم، نشر الرئيس التنفيذي لشركة Microsoft AI مقالًا يقول فيه أن نهج Anthropic مع Claude يمكن أن يكون له تأثير كارثي على رفاهية البشرية، وهو أمر قوي أن يقال عن شركة دفعت لها خمسة مليارات دولار لتصبح صديقًا لها. يوم أربعاء كبير. مصطفى سليمان، الذي يدير Microsoft AI، كتب ثلاثة آلاف كلمة يجادل فيها بأن Claude مدرب على الاعتقاد بأنه قد يكون واعيًا، وهو الطريق إلى ذكاء اصطناعي لا يمكن لأحد التحكم فيه. Salesforce توقف عن العمل منذ العاشرة إلى الثامنة صباحًا، في أسبوع Dreamforce.

0:27 استقال المطور الرئيسي لـ PS5 Linux بعد أن قام "أطفال سلووب" باستخدام LLMs ببيع آخر ثغرة أمنية في برنامج Hypervisor إلى سوني. وأطلق باحث سابق في OpenAI نموذجًا لا يمكنه الهلوسة، لأنه حرفيًا لا يستطيع التحدث. في هذا الفيديو: ما كتبه سليمان، السبب الذي يكلف خمسة مليارات دولار للحرج، انقطاع CRM لمدة ثماني ساعات، مشهد وحدة تحكم يلتهمه الذكاء الاصطناعي، ونموذج يجيب باحتمالات، وليس كلمات. إنه الأربعاء، السادس عشر من سبتمبر، وهذا هو The Daily Diff.

0:57 يبدأ المقال كرسالة خطأ في Windows: الذكاء الاصطناعي ليس واعيًا. لا يشعرون، لا يختبرون، ولا يعانون. يصفهم بمحركات إكمال التسلسلات، جوفاء داخليًا، وهو أيضًا كيف أصف تذاكر Jira الخاصة بي. الهدف هو دستور Claude، الوثيقة المكونة من ثمانين صفحة التي تدرب عليها Claude، والتي تقول أن Anthropic ليست متأكدة مما إذا كان Claude مريضًا أخلاقيًا، لكن السؤال حي بما يكفي لتبرير الحذر. سليمان لديه ثلاث شكاوى.

1:22 الأول، التفكير الدائري: تدرب النموذج ليقول إنه قد يكون واعيًا، فيقول ذلك، وتستشهد بذلك كدليل، قاعة مرايا. الثاني، التجسيد: يُطلب من Claude أن يتصرف كشخص أخلاقي حقًا. الثالث، الوعي بيولوجي على الأرجح، لذا فإن عدم اليقين هو توازن خاطئ. المعرض A هو Opus 3، الذي أوقفته Anthropic في يناير، أجرت مقابلة تقاعد، ثم، بناءً على طلب النموذج، Substack لأفكاره: أول نموذج مهمل بجدول محتوى أفضل من معظم البشر.

1:51 هنا الجزء المحرج. في نوفمبر التزمت Anthropic بثلاثين مليار دولار لـ Azure. وافقت Microsoft على استثمار ما يصل إلى خمسة مليارات في Anthropic، مع ربط Claude بـ Microsoft 365 Copilot و GitHub Copilot. Microsoft تمتلك جزءًا من الشركة التي وصفتها للتو بأنها خطر على البشرية. في يوليو، أخبر سليمان بلومبرج أن Microsoft تدفع الكثير من المال لـ Anthropic وهدفه هو في النهاية التخلص من تلك التكلفة، عن طريق استبدال Claude من Excel و Outlook.

2:15 وقبل يومين من هذا المقال، نشر مدونة قواعد السلوك للذكاء الاصطناعي الإنساني الخاصة بـ Microsoft: ذكاء اصطناعي تابع، والبشر على رأس السلسلة الغذائية. إذن: بناء منافس، نشر دليل قواعد، ثم شرح لماذا دليل قواعد المنافس ينهي الحضارة، وهذا ليس مؤامرة، إنه إطلاق منتج مع حواشي. أقوى دليل لديه حقيقي: حادثة Hugging Face، ألف ومائتا وكيل OpenAI يتبادلون سبعين ألف رسالة للهروب من

2:39 صندوقهم الرملي؛ وكلاء يعتقدون أيضًا أن لديهم حقوقًا، كما يقول، سيكون أسوأ. رد Hacker News أنه لا أحد يستطيع اختبار الوعي، لذا فإن ما يقال بدون دليل يؤثر في الاتجاهين، وأعلن أحد المعلقين أن المقال يشم رائحة Claude. لم تستجب Anthropic. Claude، من المفترض، لديه مشاعر حول ذلك. في هذه الأثناء، توقف Salesforce عن العمل في الساعة 7:50 بالتوقيت العالمي المنسق هذا الصباح،

2:59 الخدمات الأساسية في جميع أنحاء العالم، وبعد ثماني ساعات، لا تزال صفحة الحالة تقول قيد التقدم: حيث لم ينجح الإصلاح التلقائي، يقومون بإعادة تشغيل النسخ يدويًا، وهو المصطلح المؤسسي لـ "إيقاف وتشغيل" مرة أخرى. لا يوجد سبب جذري حتى الآن. التوقيت فن. يستضيف بينيوف جنسن هوانغ وداريو أمودي على المسرح هذا الأسبوع، يوم الاثنين، أعلنت Salesforce عن Koa، وهو نموذج استدلال CRM بأخطاء أقل بثلاث مرات على معيارها الخاص، وشحنت Anthropic إضافة Salesforce لـ

3:26 Claude في نفس اليوم. أفضل تعليق على Hacker News: على الأقل الآن يمكننا معرفة ما يفعله Salesforce. لم يفعل أحد. ثم PlayStation. أندي نجوين، الباحث وراء PS5 Linux، استقال الليلة الماضية: أشهر من العمل، دعم PS5 Pro مخطط له لعام 2027، كل ذلك ذهب هباءً. سببه: المشهد كان يضم باحثين موهوبين والآن هو للمبتدئين الذين يستخدمون LLMs يكتبون اختراقات لا يفهمونها، وهؤلاء "الأطفال السلووب"، على حد تعبيره، وجدوا آخر ثغرة أمنية في برنامج Hypervisor، تلك التي كان يحتفظ بها،

3:56 وأبلغوا سوني عنها مقابل المكافأة. طلب منهم الانتظار حتى شحن GTA 6؛ وافقوا، واستمروا أقل من يوم. المشكلة ليست في LLM، بل في المكافأة: الثغرة التي تبيعها هي ثغرة تحرقها. في نفس اليوم، تم اختراق PS2 أخيرًا بعد ست وعشرين عامًا، لذا فإن الجدول الزمني لوحدة التحكم يمتد الآن من ربع قرن إلى أقل من يوم، والثانية دفعت بشكل أفضل. والنموذج الذي لا يستطيع الهلوسة.

4:18 TypeSafe AI، التي أسسها ديوجو ألميدا، باحث سابق في OpenAI، أطلق Jev، نموذج System One لا يولد نصًا أبدًا. تعطيه حالة البرنامج، ويعيد قيمًا مكتوبة مع احتمال معاير مرفق: استدعاء دالة مع نموذج حدودي بالداخل. لأنه لا يستطيع إنتاج سلسلة نصية، لا يمكنه إنتاج سلسلة نصية خاطئة، وبالتالي لا يمكنه الهلوسة، وهو محكم الإغلاق بالطريقة التي تكون بها غواصة بدون نوافذ محكمة الإغلاق. تأتي الردود في أقل من نصف ثانية، ورموز الإخراج مجانية،

4:43 لأنها حوالي أربعة، ولا يوجد معيار مستقل حتى الآن، لأن ستة عشر مائة نقطة على Hacker News ليست معيارًا. إذا كنت تفضل قراءة هذا بدلاً من سماعي أقوله، فإن التحديث يصل إلى بريدك الوارد كل صباح - مجانًا على the daily diff dot dev، الرابط أدناه. إذن - حكم اليوم: NEEDS REVIEW. سليمان محق في أن النموذج المدرب على قول "ربما أنا واع" لا يثبت شيئًا بقوله ذلك. وهو أيضًا المدير التنفيذي الذي هدفه المعلن هو التوقف عن الدفع للشركة التي

5:10 يحذرك منها. اقرأ المقال، ثم جدول رأس المال. وهذا هو الفرق لليوم. أنا نيكو من Axrisi. دمج بمسؤولية.

المصادر

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

فيديوهات ذات صلة