Forwarded from Яндекс
Нейросеть Яндекса помогает быстрее находить города, где больше всего повреждённых каштанов. Как работает технология — рассказываем в карточках.
Подписывайтесь
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Denis Sexy IT 🤖
This media is not supported in your browser
VIEW IN TELEGRAM
Увидел тут полную карту мозга мухи (FlyWire – там размечены все 139 тысяч нейронов дрозофилы) и не удержался – сделал 3D-муху, которая живёт на рабочем столе мака
Внутри настоящая карта нейронов дрозофилы (FlyWire), так что от курсора она улетает не по скрипту, а когда у неё реально загорается нейрон побега – тот же, что у живой мухи
Ещё есть окошко с её мозгом: кликаешь по зоне нейронов – муха чешется, пятится или паникует
Днём у неё сиеста, ночью она спит, а на горячем маке бегает быстрее (я не шучу, у нее какие-то евенты из MacOS прокинуты в симуляцию мозга😋 )
Исходный код тут:
https://github.com/DenisSergeevitch/desktop-fly
Получается, вечная электронная 2D жизнь в симуляции
P.S. Раздражает правда как живая,рекомендую
Внутри настоящая карта нейронов дрозофилы (FlyWire), так что от курсора она улетает не по скрипту, а когда у неё реально загорается нейрон побега – тот же, что у живой мухи
Ещё есть окошко с её мозгом: кликаешь по зоне нейронов – муха чешется, пятится или паникует
Днём у неё сиеста, ночью она спит, а на горячем маке бегает быстрее (я не шучу, у нее какие-то евенты из MacOS прокинуты в симуляцию мозга
Исходный код тут:
https://github.com/DenisSergeevitch/desktop-fly
Получается, вечная электронная 2D жизнь в симуляции
P.S. Раздражает правда как живая,
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1
Forwarded from vc.ru
Anthropic научила Claude автономно отправлять письма в Gmail и управлять файлами на «Google Диске».
Также компания открыла доступ к Claude Cowork в мобильном приложении и веб-версии для подписчиков всех платных тарифов
vc.ru/ai/3086400
Также компания открыла доступ к Claude Cowork в мобильном приложении и веб-версии для подписчиков всех платных тарифов
vc.ru/ai/3086400
👍1
Forwarded from эйай ньюз
Media is too big
VIEW IN TELEGRAM
Cerebras показали CS-4
Новый сервер позволяет запускать модели на скорости в 2 раза выше, и даёт возможность запускать 10T модели на скорости в 1000+ токенов в секунду. В каждом таком сервере три WSE 3 Turbo, это разогнанная версия оригинального WSE 3. Удвоив частоту с 1,4 Ghz до 2,8 Ghz компания удвоила пропускную способность памяти и FLOP/s, что и даёт прирост в скорости моделей. Памяти на чип правда те же 44 гигабайта, так что для обещанных 10T моделей нужно несколько десятков CS-4.
Отдельная особенность CS-4 это модульность — каждый чип находится в отдельном модуле, который подключается к стойке отвечающей за питание и охлаждение. Это упрощает установку — стойки можно поставить заранее, а потом подключить к ним чипы, когда они будут готовы. К тому же это даёт возможность апгрейда в будущем.
@ai_newz
Новый сервер позволяет запускать модели на скорости в 2 раза выше, и даёт возможность запускать 10T модели на скорости в 1000+ токенов в секунду. В каждом таком сервере три WSE 3 Turbo, это разогнанная версия оригинального WSE 3. Удвоив частоту с 1,4 Ghz до 2,8 Ghz компания удвоила пропускную способность памяти и FLOP/s, что и даёт прирост в скорости моделей. Памяти на чип правда те же 44 гигабайта, так что для обещанных 10T моделей нужно несколько десятков CS-4.
Отдельная особенность CS-4 это модульность — каждый чип находится в отдельном модуле, который подключается к стойке отвечающей за питание и охлаждение. Это упрощает установку — стойки можно поставить заранее, а потом подключить к ним чипы, когда они будут готовы. К тому же это даёт возможность апгрейда в будущем.
@ai_newz
Forwarded from Data Secrets
Лучшее из X на сегодня:
CEO Figure AI объявил, что роботов Figure 02 утилизируют, потому что в штаб-квартире заканчивается место, и спросил у подписчиков, как лучше проводить модель на пенсию.
На что в комменты пришел Арнольд Шварцнеггер и ответил ему: «Вы должны их расплавить»
CEO Figure AI объявил, что роботов Figure 02 утилизируют, потому что в штаб-квартире заканчивается место, и спросил у подписчиков, как лучше проводить модель на пенсию.
На что в комменты пришел Арнольд Шварцнеггер и ответил ему: «Вы должны их расплавить»
Forwarded from эйай ньюз
ARC AGI 3 — Skill Issue
Скиллы оказались куда лучше системных промптов. В них можно зашить тул юз, решая проблему повторяемости и консистентности ответов. Это дико полезная фича, когда нужна строгая форма вывода, скажем, для заполнения таблиц.
Вот вам кастомный скилл для Claude Opus 5, который буквально заставляет модель лишний раз подумать перед предсказанием в ARC AGI 3 и всё. В итоге, модель улетела с 30% до чистых 100%, что уже лучше кожаных, при этом используя ~вдвое меньшее количество шагов.
Никакого читерства в виде правил датасета внутри скилла нет. В тул-колл тупо зашит жесткий логический блок. Если модель не рассуждает перед ответом и не пытается предугадать следующий шаг, заполняя соответствующие ячейки, предсказание отправляется на доработку. Ну, а в остальном базовые инструкции.
С одной стороны RL вроде как убил классический промпт-инжиниринг, а теперь на его месте уже плотно закрепился скилл-инжиниринг, лол.
ARC Skill
@ai_newz
Скиллы оказались куда лучше системных промптов. В них можно зашить тул юз, решая проблему повторяемости и консистентности ответов. Это дико полезная фича, когда нужна строгая форма вывода, скажем, для заполнения таблиц.
Вот вам кастомный скилл для Claude Opus 5, который буквально заставляет модель лишний раз подумать перед предсказанием в ARC AGI 3 и всё. В итоге, модель улетела с 30% до чистых 100%, что уже лучше кожаных, при этом используя ~вдвое меньшее количество шагов.
Никакого читерства в виде правил датасета внутри скилла нет. В тул-колл тупо зашит жесткий логический блок. Если модель не рассуждает перед ответом и не пытается предугадать следующий шаг, заполняя соответствующие ячейки, предсказание отправляется на доработку. Ну, а в остальном базовые инструкции.
С одной стороны RL вроде как убил классический промпт-инжиниринг, а теперь на его месте уже плотно закрепился скилл-инжиниринг, лол.
ARC Skill
@ai_newz
Forwarded from XOR
This media is not supported in your browser
VIEW IN TELEGRAM
Внутри десятки официальных курсов: от базового промптинга до Claude Code, MCP, API, RAG, агентных систем и разработки. Есть интерактивные задания, квизы и сертификаты после прохождения. И да — это всё бесплатно!
Становимся гуру вайбкодером
@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔1
Forwarded from Data Secrets
Очень показательный график из свежей статьи Bloomberg
Оранжевые точки – китайские модели, синие – США. По оси Y – взвешенное среднее по бенчмаркам GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, Humanity’s Last Exam, GPQA Diamond, CritPt, SciCode, AA-Omniscience и AA-LCR.
Ломаной соединены фронтирные модели. Видно, насколько за пару лет сократился разрыв в способностях (и это еще на графике нет GLM-5.3). Многие американские лидеры до сих пор утверждают, что китайские модели отстают на 6-9 месяцев, но, очевидно, эта информация устарела. И это уже не говоря про цены.
Оранжевые точки – китайские модели, синие – США. По оси Y – взвешенное среднее по бенчмаркам GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, Humanity’s Last Exam, GPQA Diamond, CritPt, SciCode, AA-Omniscience и AA-LCR.
Ломаной соединены фронтирные модели. Видно, насколько за пару лет сократился разрыв в способностях (и это еще на графике нет GLM-5.3). Многие американские лидеры до сих пор утверждают, что китайские модели отстают на 6-9 месяцев, но, очевидно, эта информация устарела. И это уже не говоря про цены.
Forwarded from Запрети мне псевдолейблить
Все, кто учился DL по слайдам постсоветской матшколы знают про Nesterov Accelerated Gradient. Статья вышла еще в 1983 году, но оценить ее реальный вклад можно только в последние лет 10-15. Производные от него методы оптимизации, к сожалению, не стали железным стандартом в индустрии, но довольно популярны у знающих людей
Так вот, за свой вклад в математику Юрий Нестеров получил премию Гаусса, с чем я его горячо поздравляю. Это буквально нобелевская премия, но для математиков и высшая форма признания вклада в науку.
О том, как работает метод оптимизации и в чем идея, лучше посмотреть вот в этом посте, а я хотел бы примерно рассказать, как так вышло, что метод с лучшей теоретической оценкой не стал стандартом.
Мои три подписчика с ММП скажут, что у Adan/NAdam не нормируют градиенты и из-за этого менее устойчивы к правильному LR -> хуже проскакивают турбулентные участки гиперповерхности лосса.Кстати, возмущенные неточностью подписчики с ммп ставьте обезьяну, узнаем сколько вас.
Но фатальным ударом для этих методов был таймлайн.
Статья про Nadam появилась в 2016, и в этот момент Attention is all you need (Aiayn) уже находилась в процессе написания, так что в ней использовали проверенный Adam как оптимизиатор. После, все побежали воспроизводить результаты у себя и следовали рецепту, описанному в статьей. У нас есть десятки тысяч статей, которые развивают идеи Aiayn и большая часть использует именно Adam. А значит ученых больше наблюдений для Adam и его имплементации больее оптимизированы под современное железо.
По практике скажу, что Nesterov momentum мне буста в качестве давал ровно ноль раз, так что приглашаю попустить меня в комментах и объяснить, почему нужно всегда учить именно с Adan.
Так вот, за свой вклад в математику Юрий Нестеров получил премию Гаусса, с чем я его горячо поздравляю. Это буквально нобелевская премия, но для математиков и высшая форма признания вклада в науку.
О том, как работает метод оптимизации и в чем идея, лучше посмотреть вот в этом посте, а я хотел бы примерно рассказать, как так вышло, что метод с лучшей теоретической оценкой не стал стандартом.
Мои три подписчика с ММП скажут, что у Adan/NAdam не нормируют градиенты и из-за этого менее устойчивы к правильному LR -> хуже проскакивают турбулентные участки гиперповерхности лосса.
Но фатальным ударом для этих методов был таймлайн.
Статья про Nadam появилась в 2016, и в этот момент Attention is all you need (Aiayn) уже находилась в процессе написания, так что в ней использовали проверенный Adam как оптимизиатор. После, все побежали воспроизводить результаты у себя и следовали рецепту, описанному в статьей. У нас есть десятки тысяч статей, которые развивают идеи Aiayn и большая часть использует именно Adam. А значит ученых больше наблюдений для Adam и его имплементации больее оптимизированы под современное железо.
По практике скажу, что Nesterov momentum мне буста в качестве давал ровно ноль раз, так что приглашаю попустить меня в комментах и объяснить, почему нужно всегда учить именно с Adan.
Forwarded from Denis News
s1-mini (Score: 179 ★ in 2 hours)
Link: huggingface.co
S1-mini is a 0.6B open-weights text normalizer for ASR transcripts, fixing punctuation, capitalization, and removing fillers with 94.8% accuracy, running on CPU, and available under Apache 2.0.
Link: huggingface.co
huggingface.co
superwhisper/s1-mini · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Forwarded from эйай ньюз
OpenAI скинули цену на GPT 5.6 Sol
Теперь для маленьких контекстов (меньше 272к токенов) цена $4/$20 за миллион токенов, а для длинных контекстов $8/$30 за миллион. То есть цену инпут токенов скинули на 20%, а аутпут аж на треть. Акция продлится три месяца, это касается как API, так кредитов Codex/ChatGPT Work.
@ai_newz
Теперь для маленьких контекстов (меньше 272к токенов) цена $4/$20 за миллион токенов, а для длинных контекстов $8/$30 за миллион. То есть цену инпут токенов скинули на 20%, а аутпут аж на треть. Акция продлится три месяца, это касается как API, так кредитов Codex/ChatGPT Work.
@ai_newz
Forwarded from настенька и графики
This media is not supported in your browser
VIEW IN TELEGRAM
Все изменения в Википедии в реальном времени 🤩
Кажый кирпичик – какое-то изменение, цвет зависит от языка. Можно еще прям каждое изменение и посмотреть.
Кажый кирпичик – какое-то изменение, цвет зависит от языка. Можно еще прям каждое изменение и посмотреть.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀1
Forwarded from 42 секунды
TechCrunch: OpenAI выпустила десктопное приложение ChatGPT на Linux
– Приложение ChatGPT уже было доступно для Windows и macOS
– Теперь приложение появилось на компьютерах под Linux
– Linux была одной из самых востребованных платформ для ChatGPT
– Теперь ChatGPT и Codex доступны на всех основных платформах
– Приложение позволяет использовать ChatGPT, ChatGPT Work и Codex
– Поддерживаются Ubuntu 24.04 и 26.04 LTS, Debian 13, Fedora 43 и 44
– Anthropic выпустил приложение Claude для Linux месяц назад
– Claude стал доступен для Ubuntu 22.04 и новее, Debian 12 и новее
@ftsec
– Приложение ChatGPT уже было доступно для Windows и macOS
– Теперь приложение появилось на компьютерах под Linux
– Linux была одной из самых востребованных платформ для ChatGPT
– Теперь ChatGPT и Codex доступны на всех основных платформах
– Приложение позволяет использовать ChatGPT, ChatGPT Work и Codex
– Поддерживаются Ubuntu 24.04 и 26.04 LTS, Debian 13, Fedora 43 и 44
– Anthropic выпустил приложение Claude для Linux месяц назад
– Claude стал доступен для Ubuntu 22.04 и новее, Debian 12 и новее
@ftsec
Forwarded from Machinelearning
Библиотека написана на Rust, есть привязки для Python, а в основе - TurboQuant, алгоритм сжатия векторов, который Google описали в статье, принятой на ICLR 2026.
Сама библиотека к Google отношения не имеет, это независимая реализация чужого алгоритма.
Коллекция из 10 миллионов документов, занимающая в исходном виде 31 гигабайт, умещается в 4. Поиск при этом, как утверждает автор, идёт быстрее, чем в FAISS - одного из самых распространённых инструментов в этой области.
По замерам turbovec обгоняет FAISS в среднем в 3,4-3,5 раза при 4-битном сжатии и на 20-26% при 2-битном, в зависимости от железа.
Индекс не нужно предварительно обучать - векторы просто добавляются по мере поступления.
Сохранение инкрементальное, на диск уходит только то, что изменилось с прошлого раза, поэтому даже на большом индексе это занимает миллисекунды.
Поиску можно передать список разрешённых документов - скажем, чтобы пользователь видел только свои файлы.
Удаление работает по постоянным идентификаторам, ссылки на записи не плывут.
Тем, кто уже сидит на LangChain, LlamaIndex, Haystack или Agno, автор предлагает готовые адаптеры - меняется одна строка импорта, остальной код остаётся как был.
@ai_machinelearning_big_data
#AI #ML #VectorSearch #TurboQuant #Rust
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Machinelearning
Последние месяцы доказательства, сгенерированные ИИ, посыпались валом как для новых результатов, так и для старых, причем часть из них формализована на Lean и проверить такой репозиторий непросто, особенно если ты не эксперт. Нужно убедиться:
Под эту задачу и Теренс Тао запустил Palomar - реестр математики, верифицированной на Lean. Инициативу вырастили Lean FRO и ICARM.
Прием заявок уже идет, чтобы в него попасть, в репозитории должно быть три вещи:
Снимок поданного репозитория проверяют двумя этапами.
Сначала инструмент Comparator смотрит, что solution module типизируется и доказывает ровно то, что заявлено в challenge file. После этого языковая модель сверяет, похоже ли неформальное описание в на то, что заявлено формально.
Прошел оба - попал в реестр. Принимают формализации и старых результатов, и новых. Кто автор доказательства - человек, ИИ или оба вместе - значения не имеет.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from эйай ньюз
Huggingface пытается продаться за $13 миллиардов
По сообщениям Business Insider, компания работает с банками чтобы оценить интерес покупателей. Никакую сделку пока что не заключили. Это всё происходит на фоне покупки Openrouter Stripe за $7.5 миллиардов, которую анонсировали на прошлой неделе.
@ai_newz
По сообщениям Business Insider, компания работает с банками чтобы оценить интерес покупателей. Никакую сделку пока что не заключили. Это всё происходит на фоне покупки Openrouter Stripe за $7.5 миллиардов, которую анонсировали на прошлой неделе.
@ai_newz
🤯1