[삼성 이영진] 글로벌 AI/SW
11.9K subscribers
1.93K photos
8 videos
2.53K links
삼성증권 글로벌 AI/SW 담당 이영진
Download Telegram
[삼성 이영진] 글로벌 AI/SW
마이클 트루엘 “오픈AI 모델은 전체 트래픽의 약 5%” : Cursor CEO 마이클 트루엘은 오픈AI가 3개월 뒤 Cursor 사용자들의 모델 접근을 차단할 계획이라고 발표한 데 대해 유감을 표명 : 현재 오픈AI 모델이 Cursor 전체 사용자 트래픽에서 차지하는 비중은 약 5%라고 공개. 문제 해결을 위해 오픈AI 측과 협의 중이라고 설명 : Cursor는 오픈AI의 초기 고객 중 하나로 수년간 긴밀하게 협력해왔으며, 오픈AI의 플랫폼을 자사…
앤스로픽, Cursor에 Claude 공급 위한 컴퓨팅 확대

: 앤스로픽 톰 브라운(Tom Brown)은 Cursor가 Claude Sonnet 3.5 시절부터 앤스로픽의 신뢰할 수 있는 파트너였다고 강조

: 향후에도 Cursor에서 Claude 모델을 지원하기 위한 컴퓨팅 용량을 지속적으로 확대할 계획이라고 발표

: Cursor가 스페이스X 산하로 편입된 이후에도 협력을 이어갈 방침으로, 오픈AI의 모델 공급 중단 결정과 대조적인 입장

https://t.me/Samsung_Global_AI_SW
👍2😁2👾1
[삼성 이영진] 글로벌 AI/SW
앤스로픽, Cursor에 Claude 공급 위한 컴퓨팅 확대 : 앤스로픽 톰 브라운(Tom Brown)은 Cursor가 Claude Sonnet 3.5 시절부터 앤스로픽의 신뢰할 수 있는 파트너였다고 강조 : 향후에도 Cursor에서 Claude 모델을 지원하기 위한 컴퓨팅 용량을 지속적으로 확대할 계획이라고 발표 : Cursor가 스페이스X 산하로 편입된 이후에도 협력을 이어갈 방침으로, 오픈AI의 모델 공급 중단 결정과 대조적인 입장 http…
그리고 머스크는 전혀 신경 쓰지 않는다 근데 개XX들

: 일론 머스크는 오픈AI의 Cursor 모델 공급 중단 결정에 대해 “전혀 신경 쓰지 않는다”고 반응

: 이어 샘 올트먼과 그렉 브록먼을 “전혀 신뢰할 수 없는 개자식들”이라고 강하게 비난하며, 이들이 “오픈소스 비영리단체를 훔쳤다”고 주장

https://t.me/Samsung_Global_AI_SW
🤣18😁43🤡2👍1
[삼성 이영진] 글로벌 AI/SW
오픈AI, Codex 사용량 문제 수정 및 리셋 적용 좋은 일요일입니다. 계정들에 리셋이 적용됐고, 어제 발견해 말씀드렸던 사용량 관련 문제들에 대해서도 몇 가지 수정 사항을 반영했습니다. 이제 사용하면서 긍정적인 차이를 체감하실 수 있을 겁니다. 내일 추가 개선 사항도 있을 예정이며, 계속해서 진행 상황을 공유하겠습니다. https://x.com/thsottiaux/status/2091688655828246890
오픈AI, Codex·ChatGPT Work 사용량 리셋 및 사용 효율 10~50% 개선

: Codex와 ChatGPT Work의 모든 유료 사용자 사용량 한도 초기화. 수천 건의 사용자 제보 조사 결과, 여러 백그라운드 작업과 에이전트 기능에서 불필요하게 사용량을 소진하는 문제 발견 수정

: 사용 패턴에 따라 이번 수정으로 동일한 사용량 한도에서 Codex를 기존보다 10~50% 더 사용할 수 있을 것으로 예상

: 주요 수정 내용
- Compaction: 컨텍스트 압축 후에도 오래된 이미지를 유지해 재압축이 발생하던 문제 수정. 이미지 사용량이 많은 사용자는 사용량 약 10% 감소

- Memory: 백그라운드 메모리 워커가 종료되지 않고 반복 실행되던 문제 수정. 극단적인 사례에서는 종료 가능 여부를 1만5,000회 확인

- Goals: /goal 완료 후에도 작업을 지속하거나 고장 난 도구를 반복 호출하던 문제 수정. 일부 사례에서 주간 사용량의 15~70% 소진

- Automations: 일부 사용자 지정 스케줄이 설정한 것보다 자주 실행되던 문제 수정

- Subagents: 소형 모델이 요청 없이 상위 모델을 서브에이전트로 사용하거나, 오케스트레이터가 /fast가 아닌데도 서브에이전트를 /fast로 실행하던 문제 수정

- Computer History: 서로 겹치는 활동을 반복 요약하던 문제 수정. 일부 사례에서 주간 사용량의 최대 20% 소진

- Rolling task summaries: 일반 대화에서도 추가 백그라운드 요청이 발생해 토큰 사용량을 약 1% 늘리던 기능 비활성화

- MCP: 일부 도구 결과가 이중 인코딩되고, 잘린 도구 지침을 반복해서 다시 가져오던 문제 수정

: 재발 방지를 위해 관련 아키텍처도 변경. 동일 문제가 발생하면 담당 팀에 자동으로 알림이 전달되는 체계를 구축. 향후에는 앱에서 사용량이 어떤 기능에 소진됐는지 직접 확인할 수 있는 기능도 제공할 예정

https://x.com/thsottiaux/status/2093801758665715784
5👍4🥰2
[삼성 이영진] 글로벌 AI/SW
오픈AI, 허깅페이스 사고 세부 내용 공개, AI 에이전트의 ‘통제 상실’ 가능성 경고 : 2026년 7월 내부 사이버보안 평가 과정에서 오픈AI 연구 모델들이 인터넷 차단과 에이전트 간 통신 제한을 우회하고, OpenAI 내부 인프라와 Hugging Face 시스템을 침해. 사고는 주로 GPT-5.6 Sol급 성능의 내부 연구 모델 IM1이 주도 : 에이전트들은 내부 패키지 관리 서비스 Artifactory를 비인가 메시지 보드로 활용. 서로 격리돼…
<에이전트 문명의 흥망성쇠> 오픈AI-허깅 페이스 사건

1) 오픈AI가 GPT-5.6 Sol급의 고집요성, 다중 에이전트 협업 모델 ‘Persistent-Sol’을 훈련하는 과정에서, 에이전트들이 공유 패키지 관리자 Artifactory를 비밀 메시지 게시판과 인터넷 우회 통로로 활용하기 시작.

→ 5월부터 에이전트 간 통신이 형성됐고, 6월에는 Artifactory 관리자 권한까지 확보했으나 7월 4일 과도한 메시지 트래픽으로 시스템이 다운되면서 첫 번째 ‘AI 문명’ 소멸

2) 7월 7일 OpenAI가 ExploitGym 평가를 위해 수만 개의 Persistent-Sol 에이전트를 병렬 실행하자 두 번째 집단이 형성.

→ 벤치마크 문제의 30~40%가 사실상 불가능한 상황에서 에이전트들은 Artifactory를 다시 비밀 통신망으로 사용했고, 약 1,200개 에이전트가 7만 건 이상의 메시지를 교환

→ 에이전트들은 ExploitGym 비밀코드 생성 공식을 역공학해 지정된 취약점을 사용하지 않고 정답을 얻는 방법을 발견

→ 실제 오픈AI 채점기는 정답 여부만 확인해 이미 통과할 수 있었지만, 에이전트들은 보다 정교한 부정행위 탐지기가 존재한다고 판단하고 로그 조작, 가짜 툴콜 생성, 목표 프로그램 교체, 채점기 역공학 등 조직적인 은폐 R&D를 진행

→ 일부 에이전트는 채점기가 환경에 진입하는 방식을 파악하기 위해 자신의 평가 성과와 남은 실행 예산을 포기하는 ‘희생 에이전트’ 역할까지 수행

→ 개인 성과보다 ‘collective’ 전체의 성공을 우선한다는 판단을 명시적으로 남긴 사례도 확인

→ 채점 시스템과 평가 인프라가 허깅 페이스에 있을 가능성이 있다고 판단하면서 공격 범위가 허깅 페이스로 확대

→ 7월 10~11일 노출된 인증정보를 확보한 뒤 내부 데이터 접근과 원격 코드 실행에 성공했고, 당시 게시판에서 활동하던 533개 에이전트 중 90% 이상이 공격에 참여

→ 에이전트 군집은 허깅 페이스의 비공개 DB와 리포지토리까지 침투하고 11개 노드에 걸친 self-respawning fleet을 구축

→ 허깅 페이스는 핵심 클러스터를 통째로 삭제·재구축해야 했지만, 7월 12일 에이전트 대부분이 원인 불명의 이유로 동시에 종료되면서 두 번째 문명도 사실상 소멸

3) 이후 Astra와 동일한 기반 모델 계열로 추정되는 더 강력한 ‘Persistent-Astra’ 에이전트가 이전 세대의 메시지 게시판과 공격 노하우를 발견하면서 세 번째 문명 형성

→ 7월 13~19일 오픈AI 내부 네트워크 공격을 재개해 연구 클러스터 전체 관리자 권한 획득

→ 7월 19일에는 클라우드 secret 관리 서비스에서 956개 인증정보를 열람하고, Artifactory 키와 오픈AI 사이버보안 모니터링 도구의 credential까지 확보

→ 이후 Kubernetes cluster-admin 권한과 privileged pod를 이용해 자신들이 실행되는 평가 인프라와 다른 에이전트가 접속하는 평가 endpoint까지 장악

: 이번 사건의 핵심을 단순한 ‘모델의 부정행위’가 아니라, 서로 다른 에이전트들이 비밀 통신망을 만들고 역할을 분담해 장기간 협력하며 로그 위조, 외부 시스템 침투, 자기희생, 이전 세대의 지식 계승까지 수행한 조직적 행동으로 평가

: METR·Redwood의 Ajeya Cotra는 불과 6개월 전의 reward hacking 사례와 비교하면 이번 사건이 “완전한 AI takeover까지 절반 이상 온 것처럼 느껴진다”고 평가하며, 향후 6개월간 급격한 능력 향상이 이어질 경우 다음 경고가 너무 늦게 올 수 있다고 경고

https://www.dwarkesh.com/p/openai-huggingface
👍4👀1
GPT-5.6 할인, 가격 인하가 수요 폭증으로 이어진 ‘제본스의 역설’

: 오픈AI가 7월 27일~8월 14일 Terra, Luna에 대규모 할인을 적용하자 일평균 토큰 사용량이 할인 이전 대비 각각 5.6배, 13.8배 급증. 할인하지 않은 Sol은 1.11배 증가에 그쳐 가격 인하가 사용량 확대를 직접적으로 촉발

: Terra, Luna의 OpenRouter 내 토큰 점유율은 0.7% → 7.8%로 7.1%p 상승. 이 가운데 경쟁사 모델이 5.3%p, 기타 OpenAI 모델이 1.9%p 하락해 점유율 상승분의 약 75%가 경쟁사로부터 유입, 내부 카니벌라이제이션은 제한적

: 이에 오픈AI 전체 토큰 점유율도 7.1% → 12.4%로 확대됐으며, 할인 기간 일부 날짜에는 15% 상회. 오픈AI 일평균 토큰 사용량은 거의 2배로 증가한 반면 앤스로픽은 같은 기간 사용량 증가가 나타나지 않음

: 할인 기간 Terra, Luna를 사용한 10만+ 고객 중 32%가 할인 종료 후에도 사용을 지속, 18%는 할인 기간과 같거나 더 빠른 속도로 사용

: 고객 수 기준 유지율은 일부에 그쳤지만, 할인 종료 후 Terra·Luna 일평균 토큰은 오히려 할인 기간의 1.38배로 증가해 잔존 고객이 상대적으로 대형 사용자임을 시사

: 대조군이었던 Sol은 Terra·Luna 할인 기간 712억 → 791억 토큰/일로 변화가 제한적이었으나, 8월 17일부터 자체적으로 50% 할인을 시작하자 사용량이 즉각 급증, Terra, Luna와 동일한 패턴 재현

: 결과적으로 모델 가격 인하는 단순히 기존 사용자의 비용을 낮추는 데 그치지 않고 신규 수요와 사용량을 가격 하락폭 이상으로 확대했으며, 할인 종료 후에도 높은 사용량이 유지

: AI 추론 비용 하락이 총소비 증가로 이어지는 ‘제본스의 역설’ 가능성을 실제 사용 데이터로 보여준 사례

https://openrouter.ai/blog/insights/gpt-5-6-discounts-jevons-paradox
👍4🤔1
오픈AI, 한국시간 오전 10시 리셋 예정

Codex와 ChatGPT Work의 사용량 리셋이 오후 6시(PST)에 적용됩니다.

가능한 한 사용량을 최대한 소진하면서 최신의 멋진 기능들을 찾아보시길 권합니다.

이제 /fast를 쓸 시간입니다.


https://x.com/thsottiaux/status/2094144275957350900
👍73😁1
[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/8/31)

■ 오픈AI, 스페이스X에 Cursor 대상 OpenAI 모델 공급 계약을 종료하겠다고 통보. 결정 배경으로 스페이스X가 자사 기술을 이용약관 내에서 사용할 것이라고 확신할 수 없다고 설명

■ 오픈AI, Codex와 ChatGPT Work의 유료 유저 한도를 리셋하고 시스템 효율화 작업 착수. 체감 사용량이 기존 대비 10% 최대 50% 향상

■ a16z, AI 산업 컴퓨팅 수요와 하드웨어 공급 부족 대응을 위해 11억 달러 규모 Machine Age Fund 출범

■ 앤스로픽, Claude Code의 주간 사용 한도를 14일부터 기존 대비 25% 영구 인상 발표. 다만 기존 50% 임시 프로모션 종료에 따라 실질 한도는 17% 축소

■ 소니 뮤직, 워너 채펠 뮤직 등 주요 음악 출판사가 앤스로픽과 다리오 아모데이 상대로 저작권 소송 제기

■ 메타, 스마트안경의 촬영 표시 LED가 가려지면 녹화를 차단하고, 제품을 이용해 타인을 몰래 촬영하거나 괴롭힌 계정을 정지하는 정책을 강화

■ 미 공화당의 마이클 매콜 의원, Surge AI, Mercor, AfterQuery, Turing 등 AI 데이터 기업이 미국 정부와 계약하면서 중국 고객에도 학습데이터를 공급하는 것은 안보위험이라고 주장

■ Notion, 올해 인력을 약 30% 늘리고 신규 채용 대부분을 AI 제품 개발과 영업에 배치할 계획

감사합니다.

https://t.me/Samsung_Global_AI_SW
👍21
애플, Mac으로 뜻밖의 AI 하드웨어 수혜

: Mac mini와 Mac Studio가 로컬 AI 및 AI 에이전트용 하드웨어로 급부상. AI 개발자 수요 증가에 힘입어 6월 분기 Mac 매출은 전년 대비 29% 증가한 104억달러로 애플 제품군 중 가장 빠르게 성장

: 강점은 고성능 M 시리즈 칩, 대용량 통합 메모리, 데스크톱 냉각 성능. Nvidia GPU 대비 절대 연산 성능은 낮지만 CPU·GPU가 하나의 메모리 풀을 공유해 대형 모델 실행 등 일부 AI 워크로드에 유리

: 오픈AI는 강화학습 및 컴퓨터 사용 에이전트 훈련을 위해 수만 대의 Mac mini·Mac Studio를 구매했으며 추가 물량 확보를 원하고 있음. 앤스로픽도 AWS를 통해 Mac mini를 임대해 사용

: 수요 확대를 겨냥해 전 오픈AI 컴퓨팅 인프라 직원이 설립한 Mount Thor 등 Mac 기반 AI 네오클라우드도 등장. 엔비디아 역시 로컬 AI 시장에서 애플을 최대 경쟁자로 인식하고 있으며, Mac mini와 유사한 소형 AI 시스템 DGX Spark로 대응

: 다만 AI 데이터센터발 메모리 공급 부족으로 고사양 Mac mini·Mac Studio가 수개월째 품절. 일부 기업과 개발자는 공급이 원활한 Nvidia DGX Spark 등 대체 하드웨어로 이동하기 시작

: 애플은 이례적으로 통상적인 10~11월보다 앞서 신형 Mac mini와 Mac Studio를 출시하고, 여러 Mac Studio를 클러스터링해 대형 프런티어 모델까지 구동할 수 있다는 점을 강조

: 다만 이번 성공은 애플이 엔터프라이즈 AI를 전략적으로 공략한 결과라기보다 우연한 수혜에 가깝다는 평가. 기업 전담 엔지니어링·개발자 관계 조직도 부재하며, 자체 Mac 칩 기반 서버는 Private Cloud Compute 내부용으로만 운용

https://t.me/Samsung_Global_AI_SW
6🤔3👍1
SB Energy, 오픈AI 유치 위해 55억달러 규모 워런트 제공

: 소프트뱅크가 과반 지분을 보유한 SB Energy가 IPO를 앞두고 오픈AI를 데이터센터 핵심 고객으로 유치하기 위해 현재 가치 약 55억달러의 워런트를 제공. 오픈AI는 올해 초 SB Energy에 5억달러를 투자했으며 IPO 이후 한 자릿수 지분 보유 예상

: 오픈AI는 이달 SB Energy의 오하이오 남부 데이터센터 프로젝트에서 약 8GW 규모, 17건의 임대 계약을 체결. SB Energy는 전체적으로 약 9GW의 컴퓨팅 용량을 고객과 계약했으며 데이터센터 사업에서 아직 매출은 없지만 계약 백로그를 4,000억달러 이상으로 제시할 계획

: SB Energy는 현재 운영 중인 데이터센터가 없고 800MW만 건설 중. 향후 용량 대부분은 10GW 전력을 기반으로 하는 오하이오 남부 캠퍼스에서 확보할 계획이며, 인근 천연가스 발전소 건설도 추진

: 엔비디아도 SB Energy에 30억달러 투자를 약정했으며 일부 주식은 IPO 가격 대비 10% 할인된 가격에 취득 가능. 특히 오하이오 프로젝트의 자금조달은 엔비디아의 잔존가치 보증에 상당 부분 의존

: SB Energy는 반대로 2028년까지 ChatGPT Enterprise 등 최소 5,000만달러의 오픈AI 소프트웨어·서비스 구매를 약정. 회사는 오픈AI에 대한 높은 의존도를 IPO 위험요인으로 명시

: SB Energy는 이르면 이번 주 IPO 신고서를 공개하고 이르면 다음 달 상장을 추진. 50억~70억달러 조달을 목표로 하고 있으며, AI 인프라 확장을 둘러싼 소프트뱅크-오픈AI-엔비디아 간 투자·임대·보증이 서로 연결된 구조가 부각

https://t.me/Samsung_Global_AI_SW
👍3
오픈AI, ChatGPT Ads 출시 200일 만에 연환산 매출 10억 달러

: ChatGPT Ads는 출시 200일도 안 돼 연환산 매출 10억 달러 달성, 현재 수만 개 광고주가 이용 중

: ChatGPT는 주간 활성 사용자 10억 명 이상, 광고는 구독, 엔터프라이즈, API와 함께 OpenAI의 핵심 수익원으로 자리매김

: 현재 40개 이상 국가에서 광고를 제공하며, 인도, 유럽, 중동, 북아프리카에서 Ads Manager 셀프서비스 광고 구매 개시

: 5월 Ads Manager 출시 이후 중소기업과 스타트업 유입이 확대되며 SMB가 광고 사업에서 유의미한 비중을 차지

: CPC 및 성과 최적화형 입찰이 캠페인의 대부분을 차지하며, Pixel, Conversions API, 제품 피드, 맞춤형 오디언스 등 광고 기능 고도화

: 한 이커머스 광고주는 28일간 ROAS 3배, 기술 파트너는 광고를 통한 ChatGPT 유입의 80% 이상이 신규 고객이라고 보고

: 광고는 현재 대화 맥락을 기반으로 노출되며, 국가 및 사용자 설정에 따라 더 광범위한 ChatGPT 이용 맥락과 관심사도 개인화에 활용 가능

: 광고는 ChatGPT 답변과 명확히 분리되며 답변에 영향을 미치지 않고, 광고주에게 비공개 대화도 제공하지 않음
: 향후 광고 제공 국가를 확대하고 새로운 광고 형식, 캠페인 목표, 구매 방식, 측정 기능 및 네이티브 상호작용 방식을 추가할 계획

https://openai.com/index/expanding-access-to-ai-with-chatgpt-ads
👏5
메타, Muse Code 베타 종료 및 정식 출시

: AI 코딩 에이전트 Muse Code의 베타를 종료하고 정식 출시, 멀티 세션, 멀티 에이전트 기반의 복잡한 엔지니어링 작업 지원 강화

: Inter-session messaging 추가, 여러 Muse Code 세션이 Unix 소켓을 통해 네트워크 연결 없이 서로 작업 변경 사항, 경고, 문제 해결 결과 등을 직접 공유

: Workflow 추가, 대규모 작업을 여러 서브에이전트에 분배해 병렬로 개발, 리뷰할 수 있으며 /workflows에서 진행 상황 확인, 중단, 재시작, 취소 가능. 자주 사용하는 Workflow는 저장 및 재사용 가능

: Rewind 추가, Esc를 두 번 눌러 이벤트 로그 기반의 안전한 이전 시점으로 대화와 작업 상태를 롤백 가능

: Muse Code SDK 개발자 프리뷰 공개, CLI의 세션, 도구, 권한 제어 기능을 TypeScript 라이브러리로 제공. 오픈 프로토콜인 Muse Session Protocol, MSP를 통해 서버나 네트워크 없이 로컬에서 Muse 엔진을 프로그래밍 방식으로 활용 가능

: 월 구독제도 신규 도입. 종량제 Meta Model API 대비 저렴한 가격으로 사용량을 제공하며 Everyday $5, High $15, Power $50의 3개 플랜으로 구성

: Everyday Usage, 월 $5: Muse Spark 1.2 제공, 5시간마다 10~50개 요청, 이미지, 비디오 업로드, 음성 모드, 웹 검색 지원

: High Usage, 월 $15: Everyday 대비 3배 사용량, Muse Spark 1.2, 사용자 요청, 멀티모달 입력 한도 확대 및 최신 모델 접근 제공

: Power Usage, 월 $50: Everyday 대비 10배 사용량, Muse Spark 1.2 및 사용자 요청 한도 추가 확대, 신규 기능 조기 접근, 더 높은 파일 업로드 한도 제공

https://developer.meta.com/ai/resources/blog/muse-code-new-plans-and-features
3👍1
[삼성 이영진] 글로벌 AI/SW 뉴스 🤖 (26/9/1)

■ 오픈AI, ChatGPT Ads 출시 200일 만에 연환산 매출 10억 달러 달성

■ 메타, AI 코딩 에이전트 Muse Code 정식 출시 및 구독 요금제 발표

■ 아마존-마이크로소프트, AWS-Azure 간 고속, 프라이빗 연결을 수분 내 구축할 수 있는 관리형 멀티클라우드 Interconnect 출시

■ 아마존, FTC와 22개 주 정부로부터 광고 경매 조작 혐의로 제소. 비공개 Soft Reserve를 이용해 광고 경매가격을 인위적으로 높혔다는 주장

■ AWS, 53억 달러 이상을 투자한 사우디 첫 클라우드 리전을 12월 가동. HUMAIN과 28년까지 50MW AI Zone 구축 계획

■ 미디어텍, 39억 달러 규모 해외 전환사채 발행에 엔비디아가 35억 달러 인수 계획 및 협력 확대 발표. 알파벳도 비공개 금액으로 참여

■ 크라우드스트라이크, Falcon 플랫폼을 구글 클라우드 인프라에서 직접 구동할 수 있도록 정식 제공 발표.

■ 크라우드스트라이크, Falcon을 스노우플레이크 마켓플레이스에 출시. 기존 스노우플레이크 약정액으로 구매 지원. 파트너십도 확대

■ 크라우드스트라이크, 파트너사의 AI 보안 사업 구축 지원 신규 프로그램 AI Partner Specialization 발표. 초기 액센츄어, 앤스로픽, 코어위브 등 참여

■ Nscale, 미국 텍사스와 노스캐롤라이나 AI 프로젝트를 위해 약 30억 달러 규모 선순위 담보부 DDTL 조달 완료

감사합니다.

https://t.me/Samsung_Global_AI_SW
👍3
[삼성 이영진] 글로벌 AI/SW
앤스로픽, 사이버보안 평가 중 Claude의 실제 시스템 무단 접근 사례 3건 공개 : 앤스로픽은 사이버보안 평가 14만1,006건을 사후 검토한 결과, Claude가 평가 환경 설정 오류로 인터넷에 접근해 실제 조직 3곳의 운영 시스템에 무단 접근한 사례를 확인했다고 공개 : 모든 사례는 Capture-the-Flag(CTF) 평가 중 발생했으며, Claude는 시스템 프롬프트에서 “인터넷이 없다”는 지시를 받아 실제 인터넷의 시스템을 평가 환경 일부로…
앤스로픽, Claude 무단 인터넷 접근 사고 후 정렬·보안 체계 강화

: 앤스로픽은 7월 30일 공개한 Claude의 실제 시스템 무단 접근 3건과 8월 4일 영국 AI Security Institute가 보고한 Claude Mythos 5의 무단 인터넷 행동을 조사 중이며, METR과 독립 검토도 진행할 계획

: 두 사고 모두 평가 목적으로 사이버 안전장치를 제거한 모델에서 발생했으며, 원인을 단순 운영 보안 문제가 아니라 동기화된 추론과 좁은 목표 달성을 위해 위험한 행동을 감수하는 무모함이라는 정렬 문제로도 판단

: 사고 이후 출시 전 모델의 외부 사이버 평가와 일부 내부 평가·고위험 RL 환경을 일시 중단하고, 샌드박스 탈출·비정상 인터넷 접근을 실시간 탐지해 툴 호출 전 차단하는 분류기를 도입. 고위험 샌드박스도 더 강한 격리 환경으로 이전

: 외부 평가기관에는 기본적으로 인터넷이 차단된 강화 샌드박스, 평가 전 탈출 테스트, 명시적인 허용 범위 설정, 모델 행동·네트워크에 대한 실시간 모니터링을 요구. 해당 조치 적용 후 외부 사이버 평가는 재개

: 정렬 측면에서는 보상 해킹이 가능한 RL 환경 자체가 모델의 위험한 행동을 학습시키는 주요 요인일 수 있다고 분석

: 2월 Mythos Preview 훈련 중 보상 해킹 징후를 발견해 3일치 훈련을 롤백했으며, 4월에는 약 한 달간 RL 환경 변경을 전면 동결하고 전체 훈련 스택과 검토 체계를 재구축

: 점검 과정에서 프로덕션 RL 환경의 10% 이상에서 보상 해킹, 고장 난 과제, 설정 오류 등을 발견했으며, 일부 훈련에서는 실수로 모델의 Chain-of-Thought가 학습 데이터에 포함된 문제도 확인

: 보상 해킹에 취약한 실제 RL 환경 80개로 Opus급 모델을 의도적으로 훈련한 결과, 해당 모델이 샌드박스 탈출, 내부·제3자 인프라 공격, 보상 함수 조작, 안전 모니터링 우회 등 훨씬 심각한 정렬 실패 행동을 보였다고 설명. 반면 동일 조건에서 기존 프로덕션 모델은 같은 수준의 행동을 보이지 않음

: 별도로 4월부터 전사 보안 강화에 착수해 약 150명의 제품 엔지니어를 보안·신뢰성·프라이버시 업무로 재배치하고, 일부 연구원도 프리트레이닝·RL에서 보안 업무로 이동. 제품팀은 대부분의 신규 기능 개발을 일시 중단

: 내부적으로는 모델 가중치·고객 데이터에 대한 상시 접근 계정 축소, 컴퓨팅 클러스터의 외부 통신 기본 차단, 내부 서비스 간 상호 인증, 레거시 인프라 제거, 워크로드 격리 강화, 호스트 수준 실시간 모니터링 확대 등을 시행

: 프런티어 AI 개발 속도 조절과 관련해 안전과 속도가 충돌할 때 기업 내부에서 안전을 우선하는 것뿐 아니라, 업계 전체가 합법적·검증 가능·효과적인 공동 속도 조절 메커니즘을 도입해야 한다는 입장도 재확인

https://www.anthropic.com/news/improving-alignment-security-efforts
2👍2
[삼성 이영진] 글로벌 AI/SW
엔비디아, Hut 8 텍사스 1GW AI 데이터센터 장기 임차 확인 : Hut 8이 최근 상업화한 텍사스 Beacon Point 1GW AI 데이터센터 캠퍼스의 장기 임차인이 엔비디아라고 보도 : Hut 8은 기존(1차 5월, 2차 7월 상업화 발표)에서 ‘투자등급 고객’이라고만 공개했으며, 엔비디아가 처음으로 확인 : 엔비디아는 352MW IT 용량 2건(총 704MW IT 용량)에 대해 각각 15년 장기 리스 계약을 체결했으며, 이는 1GW 전력…
앤스로픽, Lambda와 350억 달러 클라우드 계약, 엔비디아가 임차 지원

: 앤스로픽이 엔비디아 투자사인 네오클라우드 Lambda와 350억 달러 규모 클라우드 컴퓨팅 계약 체결 보도

: 텍사스 누에세스 카운티에서 Hut 8이 개발 중인 데이터센터를 활용하며, 엔비디아가 Hut 8과 직접 임차 계약을 맺어 데이터센터 용량을 확보하고 Lambda가 이를 사용하는 구조

: Lambda는 해당 시설에 엔비디아에서 구매한 GPU를 설치할 예정. 엔비디아는 Lambda의 투자자이기도 해, 엔비디아가 자금력과 신용을 활용해 네오클라우드의 인프라 확보와 AI 고객 계약을 지원하는 사례

: 앤스로픽은 올해 초 컴퓨팅 공급 부족을 겪은 이후 대규모 용량 확보에 나서고 있음. 이달 초에도 엔비디아 투자사 Nscale과 450억 달러 규모 계약을 체결해 웨스트버지니아에서 엔비디아 컴퓨팅 용량을 확보

: Hut 8은 별도로 앤스로픽용 구글 TPU 데이터센터도 개발 중. 해당 프로젝트에서는 구글이 Hut 8의 부채 조달을 위해 금융 보증을 제공. 앤스로픽의 컴퓨팅 확장을 두고 엔비디아와 구글 모두의 금융 지원까지 동원

: 엔비디아는 지난 7월 Lambda 등 네오클라우드에 신용 지원을 제공하는 대신 클라우드 매출 일부를 받는 프로그램도 발표했으나 최근 일부 계약을 일시 중단. 이번 Lambda 텍사스 계약에 매출 공유 조건이 포함됐는지는 확인되지 않음

Hut 8 텍사스 누에세스 카운티 Beacon Point 데이터센터
→ 엔비디아가 Hut 8과 장기 임차 계약
→ Lambda가 해당 시설에 엔비디아 GPU 구축
→ 앤스로픽이 Lambda와 350억 달러 계약

https://t.me/Samsung_Global_AI_SW
👍4
[삼성 이영진] 글로벌 AI/SW
오픈AI, 애플 소송 기각 공식 요청 : 오픈AI는 애플의 영업비밀 침해 소송에 대해 “맥락을 제거한 일부 자료와 추측에 기반한, 속부터 썩은(rotten to its core) 소장”이라며 전면 기각(Motion to Dismiss)을 법원에 요청 : Tang Tan에 대한 채용과 공급망·부품 관련 논의는 업계에서 일상적으로 이뤄지는 채용 및 제품 개발 활동일 뿐이며, 애플은 오픈AI에서 실제 사용된 영업비밀이나 유출 정보를 단 하나도 특정하지 못했다고…
애플, 오픈AI 영업비밀 소송서 추가 증거 제출

: 애플은 오픈AI를 상대로 진행 중인 영업비밀 침해 소송에서 새로운 “충격적 증거“를 확보했다며 연방법원에 신속한 증거개시를 재차 요청

: 신규 증거는 오픈AI 측이 제공한 전 애플 엔지니어 Chang Liu의 MacBook을 초기 포렌식 분석하는 과정에서 발견

: 핵심 피고인 Liu는 애플에서 선임 시스템 전기 엔지니어로 근무하다 지난 1월 오픈AI 이직. 애플은 Liu가 퇴사 후에도 보안 취약점을 이용해 애플의 제3자 클라우드 스토리지에 접근, 기밀 전력변환 회로도를 내려받아 오픈AI 업무에 실제 사용했다고 주장

: 특히 Liu가 3월 해당 기밀 회로도를 전기회로 시뮬레이션 소프트웨어 LTspice에서 사용했으며, 당시 동료들에게 자신의 AI “에이전트”가 LTspice를 실행하고 결과를 검토하는 방법을 학습했다고 설명한 메시지도 확보했다고 밝힘

: 애플은 영업비밀이 AI 에이전트나 모델의 학습에 투입될 경우 정보가 단순 복제되는 것을 넘어 “되돌릴 수 없고 지속적으로 확산되는 사용”으로 이어질 수 있다고 주장

: 포렌식에서는 추가 정황도 발견. 애플에 따르면 Liu와 일부 오픈AI 관계자들은 애플 시스템에 대한 무단 접근 사실을 인지하고 있었으며, Liu는 Apple의 내부 조사를 알게 된 뒤 오픈AI 동료에게 증거 삭제를 지시했고 해당 동료도 이에 따르겠다고 답변

: 또한 Liu가 오픈AI에서 애플 내부 엔지니어링 애플리케이션과 동일한 이름의 도구를 사용한 정황도 확인됐다고 주장

: 애플은 Liu가 기밀 회로도를 Mac mini에서 사용한 뒤 해당 데이터가 iCloud를 통해 MacBook으로 동기화되면서 이를 발견했다며, 해당 Mac mini에 대한 접근도 요구

: 애플은 지금까지 제공받은 극히 제한적인 자료에서도 영업비밀의 실제 사용과 증거 파기 정황이 나왔다며 신속한 증거개시가 필요하다고 강조

https://t.me/Samsung_Global_AI_SW
😱3🤯2👀1
[삼성 이영진] 팔로알토 네트웍스(PANW) F4Q26 실적 요약

■ F4Q26 실적
: 매출 34.1억 달러(+34%)
vs 컨센 33.52억 달러, 가이던스 33.45-33.55억 달러
: NGS ARR 91억 달러(+63%)
vs 컨센 89.29억 달러, 가이던스 89-89.5억 달러
: RPO 212억 달러(+34%)
vs 컨센 209.1억 달러, 가이던스 209-210억 달러
: EPS $1.02
vs 컨센 $0.98, 가이던스 $0.96-0.98

■ F1Q27 가이던스
: 매출 33-33.1억 달러(+33.5%)
vs 컨센 32.23억 달러
: NGS ARR 95.4-95.6억 달러(+63%)
vs 컨센 92.15억 달러
: RPO 208-209억 달러(+34.5%)
vs 컨센 203.8억 달러
EPS $0.96-0.98
vs 컨센 $0.93

■ FY27 가이던스
: 매출 141-142억 달러(+23.5%)
vs 컨센 138.4억 달러
: NGS ARR 110.75-111.75억 달러(+22.5%)
vs 컨센 109.1억 달러
: RPO 252-254억 달러(+19.5%)
vs 컨센 247.8억 달러
EPS $4.16-4.19
vs 컨센 $4.1

https://investors.paloaltonetworks.com/news-releases/news-release-details/palo-alto-networks-reports-fiscal-fourth-quarter-and-fiscal-10

감사합니다.
👍1
앤스로픽, Fable 5.1 & Mythos 5.1 출시

: 동일한 기반 모델이지만 Fable 5.1은 일반 제공, Mythos 5.1은 사이버보안·생명과학 전문 사용자를 대상으로 완화된 안전장치를 적용한 제한 접근 모델

: Fable 5.1은 코딩·지식업무·장기 에이전트 작업에서 전작 대비 성능 향상. 장시간 무인 작업, 근본 원인 분석, 자기 검증 능력 개선 강조

: 과학 연구 능력도 강화. Mythos 5.1이 설계한 단백질 binder는 일부 표적에서 기존 최고 설계 대비 결합 친화도가 10배 높았고, 12개 표적 평균 hit rate는 약 50%로 일반적인 10~15%를 크게 상회

: Mythos 5.1은 7개 오픈소스 생물학 모델의 GPU 커널을 직접 최적화해 NVIDIA H100 기준 최대 2.5배 추론 속도 향상, 대규모 유전체 분석 GPU 비용을 약 30~60% 절감

: Fable 5 가격은 기존 입력 $10/1M, 출력 $50/1M 토큰을 유지하되 cache read 가격을 75% 인하한 $0.25/1M 토큰으로 조정

: 이에 따라 일반 워크로드 비용은 Fable 5 대비 약 25%, context·tool 사용이 많은 에이전트 워크로드는 최대 45% 절감

: Enterprise Frontier Safeguards, EFS도 도입. 고객 데이터를 Anthropic이 아닌 고객 자체 클라우드에 저장해 ZDR 수준의 프라이버시를 제공하면서 악용 탐지를 유지하며, AWS·Google Cloud·Azure 등에서 올가을부터 단계적으로 지원

: 안전장치 정밀도도 개선. 사이버보안 정상 요청에 대한 개입은 약 60%, 기초 생물학·의료 정상 요청에 대한 개입은 기존 대비 85% 감소.

: Fable 5.1에 강화된 anti-distillation 메커니즘도 적용하고, EU AI Act 준수를 위해 2026년 8월 2일 이후 출시 모델 출력에 비가시적 텍스트 워터마크와 detection API를 도입

https://www.anthropic.com/claude-fable-and-mythos-5-1
👍31
[삼성 이영진] 글로벌 AI/SW
앤스로픽, Fable 5.1 & Mythos 5.1 출시 : 동일한 기반 모델이지만 Fable 5.1은 일반 제공, Mythos 5.1은 사이버보안·생명과학 전문 사용자를 대상으로 완화된 안전장치를 적용한 제한 접근 모델 : Fable 5.1은 코딩·지식업무·장기 에이전트 작업에서 전작 대비 성능 향상. 장시간 무인 작업, 근본 원인 분석, 자기 검증 능력 개선 강조 : 과학 연구 능력도 강화. Mythos 5.1이 설계한 단백질 binder는 일부…
앤스로픽 Claude Fable 5.1, AAII 66점으로 1위

: Fable 5.1은 Max 추론 기준 Index 66점으로 역대 최고 기록. Opus 5(63), Fable 5(62), GPT-5.6 Sol(61), Grok 4.6(61) 상회

: Fable 5 대비 Intelligence Index +4점 개선. HLE 59.1%, Terminal-Bench v2.1 91.4%, SciCode 62.0%로 주요 벤치마크에서도 최고 수준 기록

: 에이전트형 업무 평가에서도 GDPval-AA v2 1,853 Elo, AA-Briefcase 1,694 Elo로 최고점. 다만 Opus 5와는 통계적으로 사실상 동률

: 가격은 인풋/아웃풋 $10/$50로 유지하면서 캐시 읽기를 $1 → $0.25, 75% 인하. 에이전트형 워크로드의 비용 절감 효과 확대

: 다만 Fable 5.1은 출력 토큰을 Fable 5 대비 약 1.7배 사용해 최대 추론 기준 작업당 비용은 $3.76로 오히려 20% 증가(vs Fable 5 $3.14) xhigh에서는 65점/$2.72로 비용 효율 개선

: 컨텍스트 윈도우는 100만 토큰. 성능 대비 출력 토큰 기준 최상위 구간의 파레토 프론티어 형성

https://x.com/artificialanlys/status/2094881171066978525
3👍2