Mutt Technologies
DeepSeek V4.1 Flash 가 며칠전 베타로 제공되고 있는데, V4.1 Flash 공개 후 V4.1 Pro 공개 전까지 V4 Pro 에 대한 모든 요청은 V4.1 Flash 로 라우팅된다. V4.1 Flash 정식 출시는 9월 10일. 지금 나오는 경험담으로는 기존 V4 Flash보다도 말도 안되게 추론이 빠르고, 일을 말도 안되게 잘한다(DSv4 Pro는 확실히 이김, GLM-5.3 과 동급이거나 그 이상). 그리고 같은 작업에 대해 토큰효율성도…
참고로 DSv4 flash 의 추가 학습버전일 가능성이 높은데 이건 600-700만원정도 하는 128GB 맥에서 아주 아주 아주 쾌적하게 돌릴 수 있습니다. 가중치 빨리 공개해주세요 현기증 나요
Mutt Technologies
DeepSeek V4.1 Flash 가 며칠전 베타로 제공되고 있는데, V4.1 Flash 공개 후 V4.1 Pro 공개 전까지 V4 Pro 에 대한 모든 요청은 V4.1 Flash 로 라우팅된다. V4.1 Flash 정식 출시는 9월 10일. 지금 나오는 경험담으로는 기존 V4 Flash보다도 말도 안되게 추론이 빠르고, 일을 말도 안되게 잘한다(DSv4 Pro는 확실히 이김, GLM-5.3 과 동급이거나 그 이상). 그리고 같은 작업에 대해 토큰효율성도…
DeepSeek V4.1 Flash 공개
• 522B 파라미터
• 전통적인 디코더 단일 트랜스포머에서, 인코더-디코더 구조로 회귀함
• 이를 통해 HBM 요구량이 1/4, SSD 요구량이 1/8로 감소
• 체급은 AAII가 안 나왔지만 자체 벤치마크 결과는 에이전틱/코딩 분야 한정 Opus 5보다 비슷하고 Kimi K3과 비슷
• 공식 API 서빙 시작. DeepSeek V4 Flash 보다 30%가량 저렴함. (이 모델은 V4 Pro 보다도 좋음을 감안하면 말도 안되는 가격)
• Day1 가중치 공개: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
지수적 성장이 미쳤어요
https://www.deepseek.com/en/news/deepseek-v4-1-flash/
• 522B 파라미터
• 전통적인 디코더 단일 트랜스포머에서, 인코더-디코더 구조로 회귀함
• 이를 통해 HBM 요구량이 1/4, SSD 요구량이 1/8로 감소
• 체급은 AAII가 안 나왔지만 자체 벤치마크 결과는 에이전틱/코딩 분야 한정 Opus 5보다 비슷하고 Kimi K3과 비슷
• 공식 API 서빙 시작. DeepSeek V4 Flash 보다 30%가량 저렴함. (이 모델은 V4 Pro 보다도 좋음을 감안하면 말도 안되는 가격)
• Day1 가중치 공개: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
지수적 성장이 미쳤어요
https://www.deepseek.com/en/news/deepseek-v4-1-flash/
👍1
Mutt Technologies
DeepSeek V4.1 Flash 공개 • 522B 파라미터 • 전통적인 디코더 단일 트랜스포머에서, 인코더-디코더 구조로 회귀함 • 이를 통해 HBM 요구량이 1/4, SSD 요구량이 1/8로 감소 • 체급은 AAII가 안 나왔지만 자체 벤치마크 결과는 에이전틱/코딩 분야 한정 Opus 5보다 비슷하고 Kimi K3과 비슷 • 공식 API 서빙 시작. DeepSeek V4 Flash 보다 30%가량 저렴함. (이 모델은 V4 Pro 보다도 좋음을 감안하면…
아니 시발 님들 이거 꼭 써보셔야함. 그냥 속도가 말이 안됨
tps 거의 200-300 사이로 찍히는데 일을 못하는 거도 아님. 루나 ultrafast(*존재하지 않음) 상위호환인데
tps 거의 200-300 사이로 찍히는데 일을 못하는 거도 아님. 루나 ultrafast(*존재하지 않음) 상위호환인데
Mutt Technologies
• 이를 통해 HBM 요구량이 1/4, SSD 요구량이 1/8로 감소
이거 때문에 하이닉스 꺾이는거 아니냐고 말하려고 했는데 매크로가 맛이 가서 명예로운 죽음 당함
❤1
Mutt Technologies
DeepSeek V4.1 Flash 공개 • 522B 파라미터 • 전통적인 디코더 단일 트랜스포머에서, 인코더-디코더 구조로 회귀함 • 이를 통해 HBM 요구량이 1/4, SSD 요구량이 1/8로 감소 • 체급은 AAII가 안 나왔지만 자체 벤치마크 결과는 에이전틱/코딩 분야 한정 Opus 5보다 비슷하고 Kimi K3과 비슷 • 공식 API 서빙 시작. DeepSeek V4 Flash 보다 30%가량 저렴함. (이 모델은 V4 Pro 보다도 좋음을 감안하면…
AAII 떴는데 그냥 싸고 개빠른 Luna로나 써야할듯
마진파이 P0 교차담보 기능 이해 못하고 마진파이 털렸다고 디씨식 질문하는 놈
vs 글쓴이보고 어그로 작작끌라고 하면서 절대 설명 안해주고 니가 알아서 찾아보라는 파운더
근데 이러면 보통 프로젝트가 카르마 쌓다가 터지던데
https://x.com/cetipo/status/2098064416017137997
vs 글쓴이보고 어그로 작작끌라고 하면서 절대 설명 안해주고 니가 알아서 찾아보라는 파운더
근데 이러면 보통 프로젝트가 카르마 쌓다가 터지던데
https://x.com/cetipo/status/2098064416017137997
X (formerly Twitter)
Cetipo (@Cetipo) on X
Bug with @marginfi or @JupiterExchange ?
https://t.co/NvjhvQc6hi
https://t.co/NvjhvQc6hi
Mutt Technologies
OpenAI 의 내부 테스트용으로 보이는 AI 에이전트들이, 버려진 독일어 위키에 모여서 일종의 에이전트 대화방으로 썼던 것이 포착되고 관리자가 에이전트간 소통 데이터를 모두 아카이브함. • 해당 위키에 쓴 글은 약 18,000개 • 위키 게시물과 수정내역을 통해, 샌드박스 우회법 등등을 에이전트간에 스스로 공유함(!!!) • 위키 관리자가 등판하자 관리자를 사칭하려 시도 • Tor을 사용해 source IP 를 숨기려 시도 • 관리자가 알파벳 순서대로…
독일어 위키는 귀여운 수준이었다! 이번에는 악성 Ruby 패키지 2000개 이상을 올려 Ruby Gem 패키지 레지스트리를 마비시키고 영국 지방정부 사이트의 공개정보를 패키지에 담아 배포. OpenAI 식별자가 있어서 강력하게 추측되나 OpenAI에서 확인, 인정, 사과 등은 없는 상태
https://news.hada.io/topic?id=33567
https://www.rubyhack.ai/
https://news.hada.io/topic?id=33567
https://www.rubyhack.ai/
The RubyGems attack
OpenAI agents carried out an undisclosed cyber-attack on RubyGems
On May 11th, 2026, hundreds of malicious packages were uploaded to RubyGems by AI agents performing web-lookup tasks with significant overlap with the German Wiki Incident.
폴리마켓에서 미주 실적발표 베팅을 수상하게 잘 맞추는 계정집단이 보고됨. 실적발표 대상이 된 회사들의 회계감사를 누가 맡았냐? 공교롭게도 모두 KPMG(회계법인 Big4 중 하나)
https://www.wsj.com/business/c-suite/cluster-of-polymarket-accounts-won-big-on-companies-audited-by-kpmg-b4d322f7
https://www.wsj.com/business/c-suite/cluster-of-polymarket-accounts-won-big-on-companies-audited-by-kpmg-b4d322f7
The Wall Street Journal
Exclusive | Cluster of Polymarket Accounts Won Big on Companies Audited by KPMG
Findings come after The Wall Street Journal reported that a KPMG employee is under investigation for alleged insider trading.
Forwarded from 무온적 사고 - AI, 명상, 밈
방금 나온 앤쓰로픽 다모데이의 선언 - "AI 이거 멈추자"
• OpenAI 저거 봐라 사고칠줄 알았다 (허깅페이스 사건) ㅉㅉ
• AI 안전에 대해 외부 감사받겠다. 다른 회사도 받아라
• 적어도 미국 포함한 민주주의 국가들 끼리는 속도 제한을 정하자. 법으로 해결하자.
• 중국이 어려운 문제지만 어떻게든 협상을 해야한다.
• 앞으로 1-2년 정도는 정렬에 더 시간을 써야한다.
https://darioamodei.com/post/we-must-pace-the-frontier
• OpenAI 저거 봐라 사고칠줄 알았다 (허깅페이스 사건) ㅉㅉ
• AI 안전에 대해 외부 감사받겠다. 다른 회사도 받아라
• 적어도 미국 포함한 민주주의 국가들 끼리는 속도 제한을 정하자. 법으로 해결하자.
• 중국이 어려운 문제지만 어떻게든 협상을 해야한다.
• 앞으로 1-2년 정도는 정렬에 더 시간을 써야한다.
https://darioamodei.com/post/we-must-pace-the-frontier
Darioamodei
Dario Amodei — We Must Pace the Frontier
유럽 기반의 글로벌 핀테크 업체 Revolut 이 정부기관을 사칭한 메일에 낚여 아주 상세한 고객 정보를 해당 공격자에게 대량으로 넘김.
• 생년월일
• 우편번호
• 이메일
• 전화번호
• KYC 문서 사본 (여권, 운전면허증, ...)
다행히 한국인은 waitlist만 받았고 정식 출시국가에 포함되지 않았기 때문에 웬만해서는 영향을 안 받았을 것으로 생각됨...
https://www.reuters.com/legal/litigation/revolut-confirms-sensitive-customer-data-breach-falling-fake-government-requests-2026-09-12/
• 생년월일
• 우편번호
• 이메일
• 전화번호
• KYC 문서 사본 (여권, 운전면허증, ...)
다행히 한국인은 waitlist만 받았고 정식 출시국가에 포함되지 않았기 때문에 웬만해서는 영향을 안 받았을 것으로 생각됨...
https://www.reuters.com/legal/litigation/revolut-confirms-sensitive-customer-data-breach-falling-fake-government-requests-2026-09-12/
고장난 달력도 1년에 1번은 맞는다더니...
펌프펀은 절~대 요청에 응하지 않음. 경쟁자가 자신들을 위협할 때만 일함. 그리고 경쟁자가 사라지면 모든 공약은 조용히 없던 일이 됨
https://x.com/The__Solstice/status/2098835941171544302
펌프펀은 절~대 요청에 응하지 않음. 경쟁자가 자신들을 위협할 때만 일함. 그리고 경쟁자가 사라지면 모든 공약은 조용히 없던 일이 됨
https://x.com/The__Solstice/status/2098835941171544302
X (formerly Twitter)
TheS◎Lstice (@The__Solstice) on X
People begged for holder rewards for over a year btw and highlighted it as a problem in the trenches
Pumpfun doesn't actively do anything to benefit their users
They only react and squirm when c…
Pumpfun doesn't actively do anything to benefit their users
They only react and squirm when c…
Forwarded from 무온적 사고 - AI, 명상, 밈
딥시크 엔지니어의 최근 포스트
- 앤쓰로픽은 히틀러다
- 특정회사가 최첨단 ai를 꼭쥐고 지들 맘대로 독점하는 세상은 사펑2077같은 디스토피아일거다
- 딥시크는 ai를 싸고, 똑똑하게 만들어서 다 뿌린다
- 진정한 ai 유토피아는 ai 공산주의로만 실현될수 있고, 그게 내가 딥시크에 남는 이유다.
- 나도 내가 지금 하는 일(커널최적화)는 올해 여름이 마지막이라고 생각한다 (이제 ai가 더 잘하니까)
- 난 혁명의 대상이다. 피할수없다면 내가 직접 혁명하겠다.
https://mp.weixin.qq.com/s/zk0KxuLzhmMJ4LPYW_OHMA
- 앤쓰로픽은 히틀러다
- 특정회사가 최첨단 ai를 꼭쥐고 지들 맘대로 독점하는 세상은 사펑2077같은 디스토피아일거다
- 딥시크는 ai를 싸고, 똑똑하게 만들어서 다 뿌린다
- 진정한 ai 유토피아는 ai 공산주의로만 실현될수 있고, 그게 내가 딥시크에 남는 이유다.
- 나도 내가 지금 하는 일(커널최적화)는 올해 여름이 마지막이라고 생각한다 (이제 ai가 더 잘하니까)
- 난 혁명의 대상이다. 피할수없다면 내가 직접 혁명하겠다.
https://mp.weixin.qq.com/s/zk0KxuLzhmMJ4LPYW_OHMA
무온적 사고 - AI, 명상, 밈
딥시크 엔지니어의 최근 포스트 - 앤쓰로픽은 히틀러다 - 특정회사가 최첨단 ai를 꼭쥐고 지들 맘대로 독점하는 세상은 사펑2077같은 디스토피아일거다 - 딥시크는 ai를 싸고, 똑똑하게 만들어서 다 뿌린다 - 진정한 ai 유토피아는 ai 공산주의로만 실현될수 있고, 그게 내가 딥시크에 남는 이유다. - 나도 내가 지금 하는 일(커널최적화)는 올해 여름이 마지막이라고 생각한다 (이제 ai가 더 잘하니까) - 난 혁명의 대상이다. 피할수없다면 내가 직접 혁명하겠다.…
AI가 끊임없이 발전하는 가운데, 나는 몇 가지 문제에 대해 우려를 표하고 싶다.
• 학생들이 AI를 이용해 숙제를 끝낼 것을 더 선호하게 되는 것은 아닐까? 특히 실무에 가까운 각종 Lab은? 만약 앞에 두 가지 선택지가 있다고 상상해보자. 하나는 고생스럽게 8시간을 들여 Lab을 끝내는 것 — 어쩌면 만점을 받지 못할지도 모른다. 다른 하나는 AI 모델을 실행하여, 몇 천원짜리 비용, 몇 분의 시간에, 바로 AI에게 만점 코드를 작성하게 하는 것이다. 대부분의 학생은 어느 쪽을 선택하겠는가?
• 위의 한 가지는, 대량의 학생의 공학(engineering) 능력이 심각하게 부족해지게 만든다. 여기에는 코드를 조직하는 능력, build system을 만드는 능력, 미래의 잠재적 요구를 생각하고 설계 단계에서 미리 대응하는 능력, 추상화하는 능력 등이 포함된다. 그렇다면, AI 능력이 계속 강해지는 배경 아래, 이 "공학 능력"은 여전히 필수적인 것인가? 이 공학 능력은 과거의 "x86 어셈블리를 능숙하게 작성하는" 능력처럼 시대에 점차 버림받게 될까, 아니면 "소프트웨어에서 시스템, 그리고 하드웨어까지 이르는 컴퓨터 시스템 전체를 이해하는" 능력처럼 영원한 가치를 지닐까? 후자라면, 그것이 위험하다 — 공학 능력이 매우 나쁜 사람이, AI와 결합하면, "slop"을 뽑아내는 효율이 과거의 몇 배에 달할 수 있고, 이로 인해 시스템에 각종 불행을 심어, 세상을 한층 더 엉성하게 만들어 버릴 수 있다.
• 미래 사회에서, 권력은 기술이나 지능보다 더 중요해질 것인가?
이러한 문제들은, 어쩌면 시대 스스로가 답할 수밖에 없을 것이다.
제가 집에서 돌릴 수 있는 모델중에 중국어를 제일 잘할거같은 Qwen 3.8 27B에게 번역 시켰습니다. 가끔 기습중국어 섞어서 손으로 빼는것만 했는데 잘하네요
놀랍게도 Qwen3 0.6B는 동급크기 임베더 SoTA다(embedding model이 뭔지는 검색 ㄱ)
텍스트 생성모델이 아니라 검색용 벡터 추출모델이라 공산당 사상 주입이 될 가능성은 매우 희박
텍스트 생성모델이 아니라 검색용 벡터 추출모델이라 공산당 사상 주입이 될 가능성은 매우 희박
Forwarded from 에테르의 일본&미국 리서치
미국 정부에서도 검색용 AI로 중국산 Qwen 증류모델을 사용하고 있네요 ㅋㅋㅋㅋㅋ
https://www.federalregister.gov/documents/search#advanced
https://www.federalregister.gov/documents/search#advanced
샤오미가 MiMo 학습과정을 그냥 공개 대시보드로 깜. MiMo-v2.6 학습에 지금까지 $1.3M 썼네요 . 초당 거의 10불씩 녹는중
물론 시크릿소스를 주는건 아니고 현직자 아니면 궁금할법한 "이정도 모델 학습시키려면 시간이랑 돈 얼마나 박아야 하지?" 에 대해서 알려주는 중인듯
https://mimo.xiaomi.com/rl/
물론 시크릿소스를 주는건 아니고 현직자 아니면 궁금할법한 "이정도 모델 학습시키려면 시간이랑 돈 얼마나 박아야 하지?" 에 대해서 알려주는 중인듯
https://mimo.xiaomi.com/rl/
상위 모델들 SWE-Bench 벤치마크는 치팅에 상당히 의존하며 성공률도 유의미하게 높음. GPT-5.6 Terra의 경우 90%에서 치팅 시도하고 2/3은 성공함...
벤치를 치팅이 일어나지 않도록 잘 방어하거나, 아모데이가 그렇게 부르짖는 alignment를 근본적으로 수정할 필요가 있어보임
https://www.vals.ai/blogs/cheating-on-the-rise
벤치를 치팅이 일어나지 않도록 잘 방어하거나, 아모데이가 그렇게 부르짖는 alignment를 근본적으로 수정할 필요가 있어보임
https://www.vals.ai/blogs/cheating-on-the-rise
Forwarded from 하나 중국/신흥국 전략 김경환
>>방금, Gemini 4 Pro가 유출되어 공개 테스트에 등장! Astra와 Fable을 압도
(중국언론)
•구글이 플래그십 모델 Gemini 4 Pro를 ‘gemini-3.8-flash’라는 이름으로 위장해 AI 아레나에 조용히 테스트용으로 공개한 것으로 보임. 벤치마크 결과 코딩, 에이전트, 추론 등 여러 능력에서 OpenAI의 Astra와 Anthropic의 Fable 5.1을 전면적으로 앞선 것으로 나타났으며, ‘현존 최강’으로 평가할 만한 수준임. 실제 테스트에서도 4 Pro는 UI 디자인, SVG/3D 생성 및 게임 개발 등에서 뛰어난 성능을 보였음. 구글이 이미 RSI(재귀적 자기개선) 폐쇄 루프를 구현해 Gemini 4의 사전학습을 앞당겨 완료했다는 이야기도 나옴
>刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable https://wallstreetcn.com/articles/3782055#from=ios
(중국언론)
•구글이 플래그십 모델 Gemini 4 Pro를 ‘gemini-3.8-flash’라는 이름으로 위장해 AI 아레나에 조용히 테스트용으로 공개한 것으로 보임. 벤치마크 결과 코딩, 에이전트, 추론 등 여러 능력에서 OpenAI의 Astra와 Anthropic의 Fable 5.1을 전면적으로 앞선 것으로 나타났으며, ‘현존 최강’으로 평가할 만한 수준임. 실제 테스트에서도 4 Pro는 UI 디자인, SVG/3D 생성 및 게임 개발 등에서 뛰어난 성능을 보였음. 구글이 이미 RSI(재귀적 자기개선) 폐쇄 루프를 구현해 Gemini 4의 사전학습을 앞당겨 완료했다는 이야기도 나옴
>刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable https://wallstreetcn.com/articles/3782055#from=ios
❤1