Mutt Technologies
1.35K subscribers
203 photos
1 file
222 links
돈 이야기 안해요 (아마도)
English speakers might want https://x.com/haxxton1
Download Telegram
윤년(閏年)은 역법을 실제 태양년에 맞추기 위해 여분의 하루 또는 월(月)을 끼우는 해이다. 그레고리력의 정확한 윤년 규칙은 다음과 같다.

서력 기원 연수가 4로 나누어 떨어지는 해는 윤년으로 한다.
서력 기원 연수가 100으로 나누어 떨어지는 해는 평년으로 한다.
서력 기원 연수가 400으로 나누어 떨어지는 해는 윤년으로 둔다.

???: 그딴거 모르겠고 이렇게 하면 됨 (0 ≤ y ≤ 102499)


bool is_leap_year_fast(uint32_t y) {
return ((y * 1073750999) & 3221352463) <= 126976;
}
스트라이프가 OpenRouter를 $7.5B에 인수

놀라운 사실은 OpenRouter 코파운더는 OpenSea 파운더이기도 함. 인생 몇회차일까

https://openrouter.ai/blog/announcements/openrouter-is-joining-stripe/
Crates.io(Rust 패키지 레지스트리)는 NPM 보다 안전하다고 생각하셨나요? 짜잔! arrayref 0.3.10 이 트로이목마를 포함한 채로 배포되었는데, 의존하는 패키지들 중에 굵직한게 많습니다. (spl-token 등)

한국시간 오후 4시 이후애 cargo update 등을 시행하신 적이 있으면 시스템을 면밀히 점검하시기 바랍니다. 저도 해야함.....ㅅㅂ
(참고로 문제의 패키지는 현재는 내려간 상태)

https://github.com/rustsec/advisory-db/issues/3161

edit: 공식적인 정보는 https://blog.rust-lang.org/2026/08/20/supply-chain-attack-on-arrayref/ 에 있음
화제의 모델 Qwen3.8 27B가 xhigh 에서 띵킹이 매우 매우 매우 길어서 벤치맥싱이 아니냐는 이야기가 많았는데, medium/low 벤치마크도 결과가 나옴 (artificialanalysis.ai)

결과는 GPT-5.5 low 와 동급
진짜 미친 모델이 나와버림 이거 맥북에서 돌아간다고요
가는말이 친절해야 오는말도 친절합니다
Forwarded from 갱생코인
애플 M5 ultra 및 M6 발표
갱생코인
애플 M5 ultra 및 M6 발표
M5 Ultra 풀옵: 36코어 CPU, 80코어 GPU, 1.2TB/s 메모리 대역폭(참고로 M3 Ultra는 819GB/s)
Mutt Technologies
저기요.님아
근데 지금보니까 리스하면 월 257불인데 이거면 클로드 맥스 20x랑 같은거 아님?
클로드 맥스 365/24 무제한으로 쓰는데 페이블보다 살짝멍청하고 절대 데이터 재사용 안되면?
Mutt Technologies
근데 지금보니까 리스하면 월 257불인데 이거면 클로드 맥스 20x랑 같은거 아님? 클로드 맥스 365/24 무제한으로 쓰는데 페이블보다 살짝멍청하고 절대 데이터 재사용 안되면?
를 보고 솔깃하신분 있으면 머리를 한대 쎄게 치시거나 저한테 월 1불씩만 기부 부탁드립니다. 좋은모델 좋은정보 많이 엄선해드림
예고된대로 Qwen3.8-Flash-Next 공개

파라미터 크기는 125B A6B 로 DeepSeek V4 Flash 의 절반에 조금 못미치는데, Gemma 3과 비슷하게 N-gram Embedding이 51B 로 따로 있음. 이건 GPU에 안올리고 따로 읽는용도로 분리한듯 (이거 구현 어떻게 하냐...)

근데 벤치상으로는 DSV4F 를 대부분 이기는 수준
제가 들고있는 맥이 M4 Max 64GB인데 진짜 잘 쥐어짜서 돌리면 될거같은데 모델 낙수효과 드가자

https://huggingface.co/Qwen/Qwen3.8-Flash-Next
Pluto Research
GPT 5.6이 아주 잘 나왔습니다. 그래서 앤스로픽 점유율을 GPT가 꽤 갉아먹은 것으로 보입니다. 그런데 Fable5가 나온지 2 달이 됬는데 AAII Benchmark에서 아무도 앤스로픽을 따잇 하지는 못했습니다. 몇 달 전만 해도 수요가 폭발하는데 토큰값이 내려가겠냐? 라는 내러티브가 대세였습니다. 그 내러티브는 실패했습니다. 그 논리면 인류가 쓸 수 있는 현존 최강 모델인 Fable5는 왜 점유율이 10% 남짓한가요. 이제 인류의 질문은 성능과…
AI 수요가 두가지로 분화되고 있다고 생각함.

카테고리 1: Fable 로 대표되는, 초고비용 초고성능 프론티어 AI. 가드레일 푼 상태의 Sol/Fable 은 이미 샌드박스를 뚫고 몇가지 사고를 칠 정도로 (https://www.felonybench.com/) 사람을 뛰어넘는 문제해결능력, 실행력을 보여줌. 너무 강력해서 오히려 수출규제를 해야 할 수준. 암호분석 같이 몇가지 용도에서는 파괴적일 것이라고 예측되고 이거 때문에 투자를 믿도끝도 없이 하는 양자컴퓨터가 겹쳐 보임
카테고리 2: DeepSeek(그리고 최근 나온 Qwen4 아키텍쳐, GLM-5.3 Flash) 으로 대표되는 저렴한 오픈웨이트 모델. 한세대 정도 모자란 성능을 보이지만 매우 저렴하며, 지난 몇년간의 연구를 통해(Sparse Attention, GDN, 임베딩 분리 등등) 동일 체급에서도 추론 비용을 엄청나게 절감하고 있음(물론 OpenAI도 이런 최적화를 내부적으로 다 하고 있을거임).

카테고리 2의 현재 수준은 사용방식/체급에 따라 프론티어와 대략 3-6개월 정도 격차를 보임.

400만원 내외 예산에서는 Qwen3.8-27B 를 돌릴 수 있으며 이는 25년도 11월에 출시된 Opus 4.5보다 근소하게 좋다고 평가됨 (medium 기준. xhigh 에서는 4.6을 능가하지만 사고가 너무 장황해서 사람이 쓰라고 있는 수준이 아님)
800만원 내외 예산에서는 DeepSeek V4 Flash (0731) 이나 Qwen3.8-Flash-Next 를 돌릴 수 있으며 이는 26년 2월에 출시된 Opus 4.6과 비슷함
1500만원 내외 예산에서는 GLM-5.3 Flash를 돌릴 수 있고 이는 26년 5월 28일에 출시된 Opus 4.8과 동급임.

로컬 모델은 다중사용자에게서 오는 규묘의 경제, 배칭, 전문가 분산의 효과를 누리지 못해 손해를 봄에도 불구하고 이정도로 격차가 줄어든 것은 시사하는 바가 있음. 이들 모델을 OpenRouter 에서 사용하면 하루에 스벅 커피 한잔 시키는 정도로 자동화된 작업을 하루종일 돌리고도 남을 정도임. (GLM-5.3 OpenRouter $0.25/1M output)

사견으로, 우려가 되는 점은 "돈을 부어서 초지능 프론티어 모델을 개발한다" 에서 오는 기대와 "AI 모델을 만인에게 제공해서 돈을 번다" 에서 오는 기대의 괴리가 커지고 있는게 아니냐는 거임. 전자는 양자컴퓨터와 같은 전략무기로서의 속성을 가지면서 규모의 경제가 중요하지 않게 됨. 후자는 확실히 규모의 경제고 지금도 상당히 치열하게 가격절감 경쟁을 하고 있음. 단적으로 DeepSeek V4 Flash 는 최근까지 가성비 압도적 최강의 모델이었지만 (Pro 구독하고 쓰는 GPT-5.6 Luna 정도가 비빌 수 있음) Qwen3.8-Flash-Next 등이 최신 접근법들을 차용하면서 입지를 위협하고 있음. 초지능 모델을 만들면 알아서 자기를 개선하는 RSI가 되어서 다 씹어먹을 거라는 기대가 있기는 하지만 ROI 와 같이 숫자로 정량화할 수 있는 부분이 아님.
1
폐지줍기 연구소
-취약점은 지난 4월 버그바운티를 통해 처음 제보됨

-당시 Cosmos Labs는 18자리 소수점 기반 운영 환경에서는 재현하지 못해 실제 메인넷 자금 손실 위험이 없다고 잘못 판단
화이트햇들이 버그바운티 시스템이 맛이 갔다고 하는 이유가 있음. 떠먹여줘도 못알아보고 방치하다 70억 털림 ㅋㅋ
알아봤어도 대충 500불 1천불 주고 퉁치려함 양심 터진 프로젝트들이 한트럭
설명: 코인 채굴용으로 성능락되어서 나왔던 170hx가 드라이버 리버싱 등등으로 락을 풀수있는게 알려져있었는데 AI시대에 가성비 최강이라는 점이 재조명되고 중고가 개떡상함. 마개조 계속 일어나는중