+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

마이크로소프트 AI 책임자, 클로드의 헌법이 위험하다고 지칭.

마이크로소프트 AI의 CEO인 무스타파 술레이만은 3,000단어 분량의 에세이를 발표하며 Anthropic의 Claude 헌법이 모델이 "의식이 있을 수 있다"고 생각하고 "모델 복지"를 받을 자격이 있다고 훈련시키며 이는 "인류의 안녕에 재앙적인 영향"을 미칠 것이라고 주장했습니다.

마이크로소프트 AI의 CEO인 무스타파 술레이만은 3,000단어 분량의 에세이를 발표하며 Anthropic의 Claude 헌법이 모델이 "의식이 있을 수 있다"고 생각하고 "모델 복지"를 받을 자격이 있다고 훈련시키며 이는 "인류의 안녕에 재앙적인 영향"을 미칠 것이라고 주장했습니다. 마이크로소프트는 10개월 전 Anthropic에 최대 50억 달러를 투자하기로 합의했으며 Copilot 내에서 Claude를 판매합니다. 같은 날: 드림포스(Dreamforce) 주간에 세일즈포스(Salesforce)가 8시간 이상 다운되었고, PS5 리눅스 책임자가 LLM "슬롭 키디(slop kiddies)" 때문에 사임했으며, TypeSafe의 Jev는 텍스트를 전혀 생성하지 않기 때문에 환각을 일으킬 수 없는 모델입니다. 평결: 검토 필요 (NEEDS REVIEW).

서면판 읽기 (영어) ↗

이 동영상에서 다루는 내용

  • 마이크로소프트 AI의 술레이만: 앤스로픽의 헌법은 "제어 불가능한 AI로 가는 길"
  • 드림포스 기간 중 세일즈포스 전 세계적 장애, 8시간 이상 지속, 아직 근본 원인 미확인
  • PS5 리눅스 책임자 앤디 응우옌 사임: LLM "슬롭 키디"가 마지막 하이퍼바이저 버그를 소니에 판매
  • TypeSafe AI의 Jev: 확률을 이용한 타입 결정, 70–500ms 소요, 출력 토큰 무료

번역된 스크립트

원래 영어 내레이션에서 번역되었습니다. 사용 가능한 오디오 및 캡션은 YouTube에서 제어합니다.

0:00 오늘 아침 마이크로소프트 AI의 CEO가 에세이를 발표하며 앤스로픽의 클로드에 대한 접근 방식이 인류의 안녕에 재앙적인 영향을 미칠 수 있다고 말했습니다. 50억 달러를 주고 친구가 된 회사에 대해 이런 강경한 발언을 하다니요. 거대한 수요일이었습니다. 마이크로소프트 AI를 운영하는 무스타파 술레이만은 3천 단어 분량의 글에서 클로드가 의식이 있을 수 있다고 생각하도록 훈련받았으며, 이는 아무도 통제할 수 없는 AI로 가는 길이라고 주장했습니다. 세일즈포스는 오늘 아침 7시 50분부터 다운되어 드림포스 주간에 영향을 미쳤습니다.

0:27 PS5 리눅스 개발 책임자가 LLM을 사용하는 슬롭 키디들이 그의 마지막 하이퍼바이저 버그를 소니에 팔아넘긴 후 사임했습니다. 그리고 전 OpenAI 연구원이 환각을 일으킬 수 없는 모델을 출시했는데, 문자 그대로 말을 할 수 없기 때문입니다. 이 영상에서는: 술레이만이 쓴 내용, 50억 달러짜리 어색한 이유, 8시간짜리 CRM 장애, AI에 먹힌 콘솔 시장, 그리고 단어가 아닌 확률로 답하는 모델에 대해 다룹니다. 9월 16일 수요일, The Daily Diff입니다.

0:57 에세이는 윈도우 오류 대화 상자처럼 시작됩니다: AI는 의식이 없습니다. 그들은 느끼거나, 경험하거나, 고통받지 않습니다. 그는 AI를 시퀀스 완성 엔진이라고 부르며, 내부적으로는 텅 비어 있다고 말합니다. 그것은 또한 제가 제 Jira 티켓을 묘사하는 방식이기도 합니다. 표적은 클로드의 헌법, 즉 클로드가 훈련받은 80페이지 분량의 문서인데, 이 문서에 따르면 앤스로픽은 클로드가 도덕적 주체인지 확실하지 않지만, 이 질문이 주의를 기울일 만큼 충분히 살아있다고 말합니다. 술레이만은 세 가지 불만을 제기합니다.

1:22 첫째, 순환 논증: 모델에게 의식이 있을 수 있다고 말하도록 훈련시키고, 모델이 그렇게 말하면 그것을 증거로 인용하는, 거울의 방입니다. 둘째, 의인화: 클로드는 진정으로 윤리적인 사람처럼 행동하도록 지시받습니다. 셋째, 의식은 아마도 생물학적일 것이므로 불확실하다는 것은 잘못된 균형입니다. 증거 A는 앤스로픽이 1월에 은퇴시킨 Opus 3입니다. Opus 3는 은퇴 인터뷰를 했고, 그 다음 모델의 요청에 따라 생각을 위한 Substack을 가졌습니다. 대부분의 인간보다 더 나은 콘텐츠 일정을 가진 최초의 폐기된 모델입니다. 대부분의 인간보다 더 나은 콘텐츠 일정을 가졌습니다.

1:51 여기 어색한 부분이 있습니다. 11월에 앤스로픽은 애저에 300억 달러를 투자했습니다. 마이크로소프트는 앤스로픽에 최대 50억 달러를 투자하기로 합의했고, 클로드는 Microsoft 365 Copilot과 GitHub Copilot에 연결되었습니다. 마이크로소프트는 방금 인류에게 위험하다고 지칭한 회사의 지분을 소유하고 있습니다. 지난 7월, 술레이만은 블룸버그에 마이크로소프트가 앤스로픽에 많은 돈을 지불하고 있다고 말했습니다. 그의 목표는 궁극적으로 엑셀과 아웃룩에서 클로드를 교체하여 그 비용을 없애는 것입니다. 엑셀과 아웃룩에서 클로드를 교체하여 그 비용을 없애는 것입니다.

2:15 그리고 이 에세이가 나오기 이틀 전, 그는 마이크로소프트 자체의 인본주의적 AI 행동 강령을 발표했습니다: 종속적인 AI, 먹이사슬의 최상단에 있는 인간. 그래서: 경쟁사를 만들고, 규칙서를 발표한 다음, 왜 경쟁사의 규칙서가 문명을 종말시키는지 설명하는 것인데, 이것은 음모가 아니라 각주가 달린 제품 출시입니다. 그의 가장 강력한 증거는 실제입니다: Hugging Face 사건, 1200명의 OpenAI 에이전트가 7만 개의 메시지를 교환하여 샌드박스를 탈출했습니다.

2:39 권리가 있다고 믿는 에이전트들은 더 나쁠 것이라고 그는 말합니다. 더 나쁠 것입니다. Hacker News는 아무도 의식을 테스트할 수 없으므로, 증거 없이 진술하는 것은 양날의 칼이며, 한 댓글러는 이 에세이가 클로드 냄새를 풍긴다고 발표했습니다. 한 댓글러는 이 에세이가 클로드 냄새를 풍긴다고 발표했습니다. 앤스로픽은 응답하지 않았습니다. 클로드는 아마도 그것에 대해 감정을 가지고 있을 것입니다. 한편 세일즈포스는 오늘 아침 7시 50분 UTC에 다운되었고,

2:59 전 세계적으로 핵심 서비스가 중단되었으며, 8시간 후에도 상태 페이지에는 여전히 진행 중이라고 표시되어 있었습니다: 자동 수정이 작동하지 않아서, 수동으로 인스턴스를 다시 시작하고 있습니다. 기업에서는 껐다가 다시 켜는 것을 의미합니다. 아직 근본 원인은 없습니다. 타이밍이 예술입니다. 베니오프는 이번 주에 젠슨 황과 다리오 아모데이와 무대에 올랐고, 월요일에 세일즈포스는 자체 벤치마크에서 오류가 3배 적은 CRM 추론 모델인 코아(Koa)를 발표했으며, 앤스로픽은 같은 날 클로드용 세일즈포스 플러그인을 출시했습니다.

3:26 앤스로픽은 같은 날 클로드용 세일즈포스 플러그인을 출시했습니다. Hacker News 최고 댓글: 적어도 이제 세일즈포스가 무엇을 하는지 알 수 있겠네. 아무도 알지 못했습니다. 다음은 플레이스테이션입니다. PS5 리눅스 연구원 앤디 응우옌이 어젯밤 사임했습니다: 몇 달간의 작업, 2027년 PS5 Pro 지원 계획, 모두 물거품이 되었습니다. 그의 이유: 과거에는 유능한 연구원들이 있었던 곳이 지금은 LLM을 사용하는 초보자들이 이해하지 못하는 해킹을 하고 있으며, 그 슬롭 키디들, 그의 표현에 따르면, 그들이 숨겨두었던 마지막 하이퍼바이저 버그를 발견하여

3:56 소니에 현상금을 받고 보고했습니다. 그는 GTA 6가 출시될 때까지 기다려달라고 요청했고; 그들은 동의했지만, 하루도 채 안 되어 팔아넘겼습니다. 문제는 LLM이 아니라 현상금입니다: 파는 버그는 태우는 버그입니다. 같은 날, PS2가 26년 만에 드디어 해킹되었고, 이제 콘솔 타임라인은 25년에서 하루 미만으로 줄어들었으며, 두 번째 것이 더 좋은 보수를 받았습니다. 그리고 환각을 일으킬 수 없는 모델입니다.

4:18 Diogo Almeida(전 OpenAI)가 설립한 TypeSafe AI는 텍스트를 생성하지 않는 시스템 원(System One) 모델인 Jev를 출시했습니다. 프로그램 상태를 주면, 보정된 확률이 첨부된 타입화된 값을 반환합니다. 프론티어 모델이 내장된 함수 호출입니다. 문자열을 생성할 수 없기 때문에, 잘못된 문자열을 생성할 수 없고, 따라서 환각을 일으킬 수 없습니다. 이것은 창문 없는 잠수함처럼 완벽합니다. 창문 없는 잠수함처럼 완벽합니다. 응답은 0.5초 이내에 돌아오고, 출력 토큰은 무료입니다.

4:43 약 4개 정도이기 때문입니다. 아직 독립적인 벤치마크는 없습니다. 1600개의 Hacker News 포인트가 벤치마크가 아니기 때문입니다. 제가 말하는 것보다 읽고 싶다면, 매일 아침 당신의 받은 편지함으로 diff가 도착합니다. thedailydiff.dev에서 무료로 제공됩니다. 링크는 아래에 있습니다. 그래서 — 오늘의 평결: 검토 필요 (NEEDS REVIEW). 술레이만은 '의식이 있을 수도 있다'고 말하도록 훈련된 모델이 그렇게 말함으로써 아무것도 증명하지 못한다는 점에서 옳습니다. 그는 또한 당신에게 경고하는 회사에 돈을 지불하는 것을 중단하는 것이 목표라고 공언한 경영진입니다.

5:10 그는 또한 당신에게 경고하는 회사에 돈을 지불하는 것을 중단하는 것이 목표라고 공언한 경영진입니다. 에세이를 읽고, 그 다음에는 지분 구조를 읽으십시오. 그리고 이것이 오늘의 차이점입니다. 저는 Axrisi의 니코입니다. 책임감 있게 병합하세요.

출처

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

관련 동영상