Forwarded from Data Secrets
Google сделали свою новую модель Gemini 2.5 Pro бесплатной
Теперь она доступна абсолютно всем юзерам. Все что нужно – аккаунт Google🥳
Напоминаем, что сейчас Gemini 2.5 Pro занимает первое место во всех номинациях на арене (с отрывом), бьет на кодинге o1, o3-mini и Sonnet 3.7. А еще она мультимодальная и контекст у нее – миллион (!) токенов.
Пробуем: gemini.google.com
Теперь она доступна абсолютно всем юзерам. Все что нужно – аккаунт Google
Напоминаем, что сейчас Gemini 2.5 Pro занимает первое место во всех номинациях на арене (с отрывом), бьет на кодинге o1, o3-mini и Sonnet 3.7. А еще она мультимодальная и контекст у нее – миллион (!) токенов.
Пробуем: gemini.google.com
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Хардкорное, но любопытное видео про Deepseek из Стекловки (математический институт академии наук) - я там был аспирантом )) Оселедец - пожалуй, самый крутой наш товарищ, который нейросетками занимается, вся надежда на таких ребят. В какой-то момент подумал, что блин, надо было математикой заниматься, но нет, потом отпустило. В середине прикольно о том, как Дипсик обучают с ошибкой, но ничего, и так работает.
YouTube
И.В. Оселедец. DeepSeek и подходы, реализованные в нем
Семинар «Математические основы искусственного интеллекта»
И.В. Оселедец. DeepSeek и подходы, реализованные в нем
26 марта 2025 г. 17:00, г. Москва, МИАН, ул. Губкина, д. 8, конференц-зал, 9 этаж + Контур Толк
http://www.mathnet.ru/present45696
Все видео курса:…
И.В. Оселедец. DeepSeek и подходы, реализованные в нем
26 марта 2025 г. 17:00, г. Москва, МИАН, ул. Губкина, д. 8, конференц-зал, 9 этаж + Контур Толк
http://www.mathnet.ru/present45696
Все видео курса:…
🤔1
Продолжаю возиться с памятью - установил себе mem0, расскажу об опыте чуть позже, пока настраиваю. Но вот после выхода Llama 4 с контекстным окном в 10 млн токенов это все начинает казаться бессмысленным. Не то, чтобы это значит, что надо переходить на Лламу, скорее это сигнал, что скоро такое окно будет у всех. У того же Gemini 2.5 окно в 1 млн по сравнению с 200K у Клода, и это чувствуется - можно вести очень длинный диалог, не прерывая его.
Видимо, следующий вопрос будет уже не столько в объеме памяти, сколько в ее структурировании.
Видимо, следующий вопрос будет уже не столько в объеме памяти, сколько в ее структурировании.
Telegram
Data Secrets
⚡️ Вышла Llama-4 с огромным контекстом
Релизнули в трех весах: Llama 4 Scout на 109B, Llama 4 Maverick на 400B и Llama 4 Behemoth на 2T (да-да, в триллионах).
– Llama 4 Scout. Контекст 10M токенов (вау!), MoE на 16 экспертов, 17B активных параметров. Запускается…
Релизнули в трех весах: Llama 4 Scout на 109B, Llama 4 Maverick на 400B и Llama 4 Behemoth на 2T (да-да, в триллионах).
– Llama 4 Scout. Контекст 10M токенов (вау!), MoE на 16 экспертов, 17B активных параметров. Запускается…
Пока бегал и отмокал после забега, послушал интервью со светилами - Дарио Амадеем, Сэмом Альтманом, Эриком Шмидтом, Джеффри Хинтоном, бывшим боссом Гугла.
Выделяется сюжет опасности искусственного интеллекта. О чем явно говорит Google - надо договариваться с китайцами и мочить open source. Он может попасть к плохим людям.
У Anthropic. который как раз много вкладывает в изучение того, что у ИИ под капотом (интересно, как Амодей говорит, что мы не создаем, а выращиваем ИИ), мысль более сложная. Пока Китай отстает в ИИ на год, в производстве чипов отставание от NVidea на 4 года. Нужны жесткие меры экспортного контроля и это позволит использовать этот задел для рывка, который будет очень сложно догнать. Такой кирпичик в дом, который строит крыло технооптимистов под руководством Тиля в команде Трампа. В этом плане и многие решения Трампа смотрятся несколько иначе, если исходить из того, что ИИ даст суперпреимущество, которое не наверстать.
Еще была очень классная штука от Амодея - а давайте дадим моделям не отвечать на вопросы, которые им не нравятся. Ну интересно же будет посмотреть )) .
Вчера, кстати, смотрел тоже весьма интересное видео, как мы делаем оборудование для литографии на 360Нм, а в следующем сделам на 130Нм... Ну надо хотя бы с чего-то начинать...
Выделяется сюжет опасности искусственного интеллекта. О чем явно говорит Google - надо договариваться с китайцами и мочить open source. Он может попасть к плохим людям.
У Anthropic. который как раз много вкладывает в изучение того, что у ИИ под капотом (интересно, как Амодей говорит, что мы не создаем, а выращиваем ИИ), мысль более сложная. Пока Китай отстает в ИИ на год, в производстве чипов отставание от NVidea на 4 года. Нужны жесткие меры экспортного контроля и это позволит использовать этот задел для рывка, который будет очень сложно догнать. Такой кирпичик в дом, который строит крыло технооптимистов под руководством Тиля в команде Трампа. В этом плане и многие решения Трампа смотрятся несколько иначе, если исходить из того, что ИИ даст суперпреимущество, которое не наверстать.
Еще была очень классная штука от Амодея - а давайте дадим моделям не отвечать на вопросы, которые им не нравятся. Ну интересно же будет посмотреть )) .
Вчера, кстати, смотрел тоже весьма интересное видео, как мы делаем оборудование для литографии на 360Нм, а в следующем сделам на 130Нм... Ну надо хотя бы с чего-то начинать...
YouTube
Дарио Амодей из Anthropic: ИИ будет писать 80% кода до конца 2026 года!
GPTunneL - топовые нейросети без подписок и VPN - https://clck.ru/3Jr3hs
Получи 100% бонусами на разовый платёж по промокоду "TURING100" 🔥
Реклама: ООО "РТ". erid: 2SDnjdR3wzt
CEO Anthropic, Технооптимист Дарио Амодей рассказал о будущем искусственного…
Получи 100% бонусами на разовый платёж по промокоду "TURING100" 🔥
Реклама: ООО "РТ". erid: 2SDnjdR3wzt
CEO Anthropic, Технооптимист Дарио Амодей рассказал о будущем искусственного…
NotebookLM от Google - очень прикольная штука. Можено посмотреть видосик, на словах - смысл в следующем: грузишь ей 50 источников в виде сайтов, файлов и пр. Пищешь, что тебе нужно изучить - она делает подкаст (пока только на английском), mindmap - можно походить по концепциям и посмотреть, как они раскрываются в источниках. Можно сделать резюме, ответы на часто возникающие вопросы и пр. Думаю, что будет интересно много кому. В качестве примера - подкаст по переработку органического мусора (сделан на основе ссылок, которые в него грузанул, но, видимо, многовато иностранерских включил)
https://notebooklm.google.com/notebook/3c0c58ba-d697-4290-8f79-b8fcf3668023/audio
https://notebooklm.google.com/notebook/3c0c58ba-d697-4290-8f79-b8fcf3668023/audio
YouTube
NotebookLM Will Change How You Learn – Here’s Why!
🧠 Get my official NotebookLM notebook – ask questions and get AI coaching on Building a Second Brain: https://bit.ly/48Fav5R
A year ago, NotebookLM was just an experiment by Google. Now, it’s the most powerful AI tool for research and learning – and it just…
A year ago, NotebookLM was just an experiment by Google. Now, it’s the most powerful AI tool for research and learning – and it just…
👍1🔥1👏1
Про топовую нейронку у себя дома.
Похоже, Llama 4 на какое-то время станет топом опенсорса. Рейтинги высокие, хотя я бы пока осторожно подходил бы к ним. Единственный конкурент - DeepSeek V3, но у ламы есть очень большое контекстное окно и скоро выйдет ризонинг модель (впрочем, как я понимаю, у DeepSeek тоже, будет интересное соревнование).
Теперь по практике - Llama Maverik запускается на двух машинках Mac Studio M3 Ultra 512Gb, Scout - на одной, для Begemoth потребуется десяток. Цена такой машинки в России 1 139 тыс. руб. Скорость - 23 токена в секунду, можно хитрить и разогнать в два раза. Вполне доступное корпоративное или даже домашнее решение с локальной нейронкой хорошего качества (хотя с качеством еще надо смотреть, первые отзывы - не очень).
Похоже, Llama 4 на какое-то время станет топом опенсорса. Рейтинги высокие, хотя я бы пока осторожно подходил бы к ним. Единственный конкурент - DeepSeek V3, но у ламы есть очень большое контекстное окно и скоро выйдет ризонинг модель (впрочем, как я понимаю, у DeepSeek тоже, будет интересное соревнование).
Теперь по практике - Llama Maverik запускается на двух машинках Mac Studio M3 Ultra 512Gb, Scout - на одной, для Begemoth потребуется десяток. Цена такой машинки в России 1 139 тыс. руб. Скорость - 23 токена в секунду, можно хитрить и разогнать в два раза. Вполне доступное корпоративное или даже домашнее решение с локальной нейронкой хорошего качества (хотя с качеством еще надо смотреть, первые отзывы - не очень).
X (formerly Twitter)
Alex Cheema - e/acc (@alexocheema) on X
Meta 🤝 Apple
Llama 4 + Apple Silicon is a match made in heaven.
Here's why: Like DeepSeek V3/R1, all of the new Llama 4 variants are massive sparse MoE models. They have a massive amount of parameters, but only a small number of those are active each time…
Llama 4 + Apple Silicon is a match made in heaven.
Here's why: Like DeepSeek V3/R1, all of the new Llama 4 variants are massive sparse MoE models. They have a massive amount of parameters, but only a small number of those are active each time…
Честно говоря, совсем по-мертвому уперся в установку памяти, никак не сдвинусь с места. Установил mem0, через веб работает, ставлю интеграцию с Claude Desktop или Cursor, связь с сервером обрывается, и все тут. Похожая ошибка и у других пакетов была. Разбирали все выходные проблему не только с Клодом, но и с Gemini, перепробовали все что можно, ничего не получается. Vibe Coding под угрозой - если я так каждую проблему решать буду, то и правда, пора идти учиться программированию.
Пойду другим путем
Пойду другим путем
Любопытная новость про бесплатный API на модельку, показывающую результаты на уровне Клода 3.5 или О3 мини. https://openrouter.ai/openrouter/quasar-alpha
Контора, которая делала модель, никому не известна, подозревают, что это OpenAI
Контора, которая делала модель, никому не известна, подозревают, что это OpenAI
openrouter.ai
Quasar Alpha - API Pricing & Providers
This is a cloaked model provided to the community to gather feedback. 1,000,000 token context window.
Агенты и МСР в VS Code
Пожалуй, одна из самых приятных новостей последнего времени, хотя хорошие новости сыплются как из рога изобилия.
Уже установил, но еще не попробовал - де-факто, VS Code получает функциональность, схожую с Cursor, только бесплатно.
Традиционно для агентских задач в VS Code использовался пакет Cline - отличная штука, через него я подключался к своему Клоду, и, если память мне не изменяет, работал через оплаченную подписку, а не по API, что экономит кучу бабла.
Кстати, Антропик с Клодом теперь тоже предлагают дорогущий пакет Max за 100 баксов (у OpenAi 200), и, у меня такое чувство, что количество обращений по дешевым подпискам могло и снизиться - по крайней мере, я вчера вышел на лимит даже не программируя, что случалось ранее крайне редко.
В целом же, в части программирования перешел с Клода на Gemini 2.5, очень доволен этой моделькой, хотя и работаю с ней в более "ручном режиме", без МСР. Впрочем, от Google тоже есть прекрасные новости, но о них в следующем посте.
Пожалуй, одна из самых приятных новостей последнего времени, хотя хорошие новости сыплются как из рога изобилия.
Уже установил, но еще не попробовал - де-факто, VS Code получает функциональность, схожую с Cursor, только бесплатно.
Традиционно для агентских задач в VS Code использовался пакет Cline - отличная штука, через него я подключался к своему Клоду, и, если память мне не изменяет, работал через оплаченную подписку, а не по API, что экономит кучу бабла.
Кстати, Антропик с Клодом теперь тоже предлагают дорогущий пакет Max за 100 баксов (у OpenAi 200), и, у меня такое чувство, что количество обращений по дешевым подпискам могло и снизиться - по крайней мере, я вчера вышел на лимит даже не программируя, что случалось ранее крайне редко.
В целом же, в части программирования перешел с Клода на Gemini 2.5, очень доволен этой моделькой, хотя и работаю с ней в более "ручном режиме", без МСР. Впрочем, от Google тоже есть прекрасные новости, но о них в следующем посте.
Google Firebase Studio
Корпорация добра выпустила свой IDE редактор для разработки приложений, причем позволяет регистрироваться из России и работать по бесплатной подписке. Выглядит очень заманчиво. Не похоже на VS Code, акцентировано на отдельных задачах, с которыми сталкиваются разработчики - программирование, хостинг, аутентификация, работа с данными, ИИ и пр.
Для вайб-кодера выглядит более понятно, чем все это программирование в VS Code, но чувствуется, что комбайн большой, сложный, надо разбираться. Буду пробовать - надежды на успех возлагаю большие.
PS. Отбой тревоги )) Gemeni описал историю так - Firebase Studio - это совершенно другая архитектура, ориентированная на продукты Google. Проще начать, нет проблем с обслуживанием - все работает на ресурсах Гугла, но это не универсальные, а Гугловские решения, которые весьма специфичны. Интересно тем, кто сидит на Гугле или для простых продуктов. Для тех, кто хочет иметь полный контроль над разработкой - кодим по-старому.
Корпорация добра выпустила свой IDE редактор для разработки приложений, причем позволяет регистрироваться из России и работать по бесплатной подписке. Выглядит очень заманчиво. Не похоже на VS Code, акцентировано на отдельных задачах, с которыми сталкиваются разработчики - программирование, хостинг, аутентификация, работа с данными, ИИ и пр.
Для вайб-кодера выглядит более понятно, чем все это программирование в VS Code, но чувствуется, что комбайн большой, сложный, надо разбираться. Буду пробовать - надежды на успех возлагаю большие.
PS. Отбой тревоги )) Gemeni описал историю так - Firebase Studio - это совершенно другая архитектура, ориентированная на продукты Google. Проще начать, нет проблем с обслуживанием - все работает на ресурсах Гугла, но это не универсальные, а Гугловские решения, которые весьма специфичны. Интересно тем, кто сидит на Гугле или для простых продуктов. Для тех, кто хочет иметь полный контроль над разработкой - кодим по-старому.
Firebase
Firebase Studio
Вы можете быстро и эффективно прототипировать, собирать и публиковать полнофункциональные приложения на основе ИИ прямо в браузере.
Claude 3.7 vs Gemini 2.5
Это мои любимые модели, которыми я пользуюсь чаще всего. Сравнения и впечатления - Клод хорошо пишет, мало ленится (такое случается у других моделей). МСР, по которому подключаются tools очень широкого профиля. Последняя модель 3.7 строчит код вообще как не в себя. С этим и возникает проблема - надо брать ее под контроль, тормозить, писать промпты. А если нет, то мало того, что разработка выходит из под контроля - появляется куча файлов с разных директориях, по которым не понятно нужны они или нет, так еще и моментально заканчивается контекстное окно. Оно большое, но с МСР выбирается быстро.
И это то, из-за чего пересел в программировании на Gemini. Сегодня поймал себя на мысли, что у меня нет потребности в промптах - модель выдает столько планов и кода, сколько нужно (не исключаю, что без МСР и Клод более управляем, но все же). Очень четкие, структурированные ответы. И огромный контекст с 1 млн токенов. С Клодом постоянная проблема переноса информации в новый диалог, здесь этого нет, и это очень круто. Теперь у меня эта модель #1. Ах, да, Gemini еще и бесплатная.
Есть еще ChatGPT, которой на днях прикрутили память всех диалогов - это круто, программирует тоже неплохо. Но в Cursor модели OpenAI производили сильно меньше работы за один токен. Рабочие, хорошие модели, но для меня #3.
Есть еще Grok, DeepSeek, но с ними не программирую, потенциал есть, но посмотрим на следующие релизы
Это мои любимые модели, которыми я пользуюсь чаще всего. Сравнения и впечатления - Клод хорошо пишет, мало ленится (такое случается у других моделей). МСР, по которому подключаются tools очень широкого профиля. Последняя модель 3.7 строчит код вообще как не в себя. С этим и возникает проблема - надо брать ее под контроль, тормозить, писать промпты. А если нет, то мало того, что разработка выходит из под контроля - появляется куча файлов с разных директориях, по которым не понятно нужны они или нет, так еще и моментально заканчивается контекстное окно. Оно большое, но с МСР выбирается быстро.
И это то, из-за чего пересел в программировании на Gemini. Сегодня поймал себя на мысли, что у меня нет потребности в промптах - модель выдает столько планов и кода, сколько нужно (не исключаю, что без МСР и Клод более управляем, но все же). Очень четкие, структурированные ответы. И огромный контекст с 1 млн токенов. С Клодом постоянная проблема переноса информации в новый диалог, здесь этого нет, и это очень круто. Теперь у меня эта модель #1. Ах, да, Gemini еще и бесплатная.
Есть еще ChatGPT, которой на днях прикрутили память всех диалогов - это круто, программирует тоже неплохо. Но в Cursor модели OpenAI производили сильно меньше работы за один токен. Рабочие, хорошие модели, но для меня #3.
Есть еще Grok, DeepSeek, но с ними не программирую, потенциал есть, но посмотрим на следующие релизы
Любопытный релиз от OpenAI - пока модели доступны только по Апи, но зато на неделю бесплатны. Заявленное точное следование промпту - то, что доктор прописал. Клод 3.7 для меня ассоциируется как раз с очень умным, но непослушным ребенком.
https://t.me/How2AI/953
https://t.me/How2AI/953
Telegram
How2AI
🔥 GPT-4.1 – твердый релиз от OpenAI
OAI выпустила три новые модели для API: GPT-4.1, 4.1 mini и 4.1 nano. Они обгоняют GPT-4o почти во всём — от кодинга до понимания инструкций и работы с длинными текстами.
Если кратко:
– GPT-4.1 теперь топ по коду. SWE…
OAI выпустила три новые модели для API: GPT-4.1, 4.1 mini и 4.1 nano. Они обгоняют GPT-4o почти во всём — от кодинга до понимания инструкций и работы с длинными текстами.
Если кратко:
– GPT-4.1 теперь топ по коду. SWE…
В продолжение темы промптов - необычные советы от OpenAI. Ставьте инструкции и в начало, и в конец длинных промптов 🤔
Telegram
Data Secrets
OpenAI выкатили новый гайд для промпт-инженеринга GPT-4.1 и раскрыли главную загадку длинного контекста
Если у вас длинный контекст + инструкции, то лучше помещать инструкции И в начало, И в конец. Но если вы очень экономите токены, то – в начало. Теперь…
Если у вас длинный контекст + инструкции, то лучше помещать инструкции И в начало, И в конец. Но если вы очень экономите токены, то – в начало. Теперь…
О, похоже, Anthropic прикрутил к Клоду поиск по файлам (через гугловские доки). Если так, пора все грузить на Google disk )) наверняка там еще и гугловый функционал есть
https://t.me/blockchainRF/11543
https://t.me/blockchainRF/11543
Telegram
Все о блокчейн/мозге/space/WEB 3.0 в России и мире
У Claude теперь есть research и интеграция с Google Workspace
Anthropic представила 2 новые функции:
1. Research:
- Работает как самостоятельный агент, выполняя серию связанных поисковых запросов,
- автоматически исследует разные аспекты вашего вопроса…
Anthropic представила 2 новые функции:
1. Research:
- Работает как самостоятельный агент, выполняя серию связанных поисковых запросов,
- автоматически исследует разные аспекты вашего вопроса…
Бесплатный vibe-coding (почти)
Программирую теперь в Cursor не с Claude Sonnet 3.7, а с Gemini 2.5 Pro. И мне очень нравится - более дисциплиннированная модель, а еще - токены подписки не тратятся вообще. На сайте https://aistudio.google.com модель тоже бесплатная, но в Курсоре она работает бесплатно по апи... Аттракцион невиданной щедрости - всяко в Курсоре вайбкодить в разы проще и быстрее, чем через сайт гугла.
Говорят, что теперь чемпионы по кодингу - новые модели от OpenAI, но это еще надо проверять (кстати, тоже хвалят за хорошую дисциплину и следование промпту). В любом случае, на эти модели токены в курсоре уже потребуются, поэтому пока сижу на Gemini, а там - посмотрим
PS Gemini оказалась таки не бесплатной - это все просто хитрые маркетинговые ходы. 5 центов за запрос и 5 центов за использование tools. Та же цена, что и у Клода. История - в установках оплаты за использование. Она начинает тратиться сразу, а не после того, как выбран лимит обычных запросов
Программирую теперь в Cursor не с Claude Sonnet 3.7, а с Gemini 2.5 Pro. И мне очень нравится - более дисциплиннированная модель, а еще - токены подписки не тратятся вообще. На сайте https://aistudio.google.com модель тоже бесплатная, но в Курсоре она работает бесплатно по апи... Аттракцион невиданной щедрости - всяко в Курсоре вайбкодить в разы проще и быстрее, чем через сайт гугла.
Говорят, что теперь чемпионы по кодингу - новые модели от OpenAI, но это еще надо проверять (кстати, тоже хвалят за хорошую дисциплину и следование промпту). В любом случае, на эти модели токены в курсоре уже потребуются, поэтому пока сижу на Gemini, а там - посмотрим
PS Gemini оказалась таки не бесплатной - это все просто хитрые маркетинговые ходы. 5 центов за запрос и 5 центов за использование tools. Та же цена, что и у Клода. История - в установках оплаты за использование. Она начинает тратиться сразу, а не после того, как выбран лимит обычных запросов
Google
Google AI Studio
The fastest path from prompt to production with Gemini
Энтузиасты могут пробовать Gemma 3 27B, квантованную самим Гуглом, на видеокарточках с 14Гб памяти. Или на более-менее продвинутых маках. Это одна из топ-модель такого размера
https://t.me/data_secrets/6749
https://t.me/data_secrets/6749
Telegram
Data Secrets
Google выпустили новые версии Gemma-3, которые можно запустить локально на домашних видеокартах
Например, теперь, чтобы запустить Gemma 3 27B, понадобится всего 14 гигабайт vRAM всесто 54. А Gemma 3 1B вообще заведется на 0.5 Gb (считай, на утюге).
Технически…
Например, теперь, чтобы запустить Gemma 3 27B, понадобится всего 14 гигабайт vRAM всесто 54. А Gemma 3 1B вообще заведется на 0.5 Gb (считай, на утюге).
Технически…
Немного новостей (на самом деле их много)
У OpenAI - большие релизы. Вышли новые модели 4.1o (полная, мини и нано), которые во всем лучше 4o и должны из заменить, но доступны пока только по апи. Еще вышла полная ризонинг модель о3 (раньше была только o3 mini с вариациями) и o4 mini. Т.е. про o3 mini и o3 mini (high) забываем.
Для понимания - корпорация делает большую и затратную модел, а потом обучает модель меньшего размера так, чтобы она давала ответы на вопросы как большая. Это процесс, который называется дистилляция и так получены модели мини, которые почти так же хороши, как и большая, но заметно экономнее по ресурсам.
Еще у OpenAI появилась память, и она же появилась у бесплатного Grok 3 от Илона Маска (я почти перестал пользоваться этой моделью, она хорошая и бесплатная, но Gemini лучше). Теперь многие вещи повторять не придется, отличная штука.
У Клода появлась не память, но, судя по всему, векторный поиск по вашим данных, которые вы сложили на google disk, подключенный к Клоду (еще можно поключить календарь, почту и GitHub). И это не все. Появилась функция research как у chatGPT, Perplexity, Grok. Появились какие-то хитрые сценарии для тех кто пишет, тех, кто учится и тех, кому надо помочь в жизненных ситуациях - например, при сложном разговоре с начальником.
У Gemini вышла дистилированная от Gemini 2.5 Pro модель Gemini 2.5 Flash. Тоже хороша, сильно дешевле по апи (хотя в https://aistudio.google.com/ обе модельки бесплатные). Пожалуй, это первый выбор для работы по апи.
Еще у Google теперь подключена модель генерации видео - и это SOTA. Генерация бесплатная и очень качественная, судя по всему, OpenAI здесь отстает.
У китайцев из ByteDance (TikTok) тоже вышла крутая модель, но как-то они в последнее время отстают. Ждем новых моделей от DeepSeek, пора бы уже
У OpenAI - большие релизы. Вышли новые модели 4.1o (полная, мини и нано), которые во всем лучше 4o и должны из заменить, но доступны пока только по апи. Еще вышла полная ризонинг модель о3 (раньше была только o3 mini с вариациями) и o4 mini. Т.е. про o3 mini и o3 mini (high) забываем.
Для понимания - корпорация делает большую и затратную модел, а потом обучает модель меньшего размера так, чтобы она давала ответы на вопросы как большая. Это процесс, который называется дистилляция и так получены модели мини, которые почти так же хороши, как и большая, но заметно экономнее по ресурсам.
Еще у OpenAI появилась память, и она же появилась у бесплатного Grok 3 от Илона Маска (я почти перестал пользоваться этой моделью, она хорошая и бесплатная, но Gemini лучше). Теперь многие вещи повторять не придется, отличная штука.
У Клода появлась не память, но, судя по всему, векторный поиск по вашим данных, которые вы сложили на google disk, подключенный к Клоду (еще можно поключить календарь, почту и GitHub). И это не все. Появилась функция research как у chatGPT, Perplexity, Grok. Появились какие-то хитрые сценарии для тех кто пишет, тех, кто учится и тех, кому надо помочь в жизненных ситуациях - например, при сложном разговоре с начальником.
У Gemini вышла дистилированная от Gemini 2.5 Pro модель Gemini 2.5 Flash. Тоже хороша, сильно дешевле по апи (хотя в https://aistudio.google.com/ обе модельки бесплатные). Пожалуй, это первый выбор для работы по апи.
Еще у Google теперь подключена модель генерации видео - и это SOTA. Генерация бесплатная и очень качественная, судя по всему, OpenAI здесь отстает.
У китайцев из ByteDance (TikTok) тоже вышла крутая модель, но как-то они в последнее время отстают. Ждем новых моделей от DeepSeek, пора бы уже
Google
Google AI Studio
The fastest path from prompt to production with Gemini
❤2
Лекции по AI из Стенфорда - они и раньше их публиковали, а здесь совсем свежачок. Эх, было бы время..
https://t.me/data_secrets/6752
https://t.me/data_secrets/6752
Telegram
Data Secrets
Там Стэнфорд выложили на YouTube свой свежий курс CS336: Language Modeling from Scratch
Это практический курс, в котором вся теория по LLM подается в процессе разработки собственной модели. Получается изучение end-to-end: от обработки данных и архитектуры…
Это практический курс, в котором вся теория по LLM подается в процессе разработки собственной модели. Получается изучение end-to-end: от обработки данных и архитектуры…
Microsoft представил MCP сервер для превода файлов офиса в формат markdown
https://github.com/microsoft/markitdown
Было бы очень круто, если бы был и перевод в обратном направлении...
https://github.com/microsoft/markitdown
Было бы очень круто, если бы был и перевод в обратном направлении...
GitHub
GitHub - microsoft/markitdown: Python tool for converting files and office documents to Markdown.
Python tool for converting files and office documents to Markdown. - microsoft/markitdown