Мысли HinkoKа
5.59K subscribers
1.79K photos
364 videos
2 files
387 links
Мой блог, AI, самосовершенствование и ещё много всего интересного!

Писать по сотрудничеству:
@h1nkok
Download Telegram
AI — к чему всё идет?

Билл Гейтс написал эссе на тему AI. Есть три главные темы которые можно выделить - работа, преступники, развитие.

Работа сейчас исчезает быстрее чем кажется, особенно для молодежи. В эссе приводятся конкретные цифры исследований и они показывают что занятость упала на 16% среди 22-25-летних в профессиях, которые были затронуты AI. Под ударом находятся и профессии разработчиков, помощников юристов, гостиничный бизнес и даже стройка, ведь роботизация физического труда по прогнозу Гейтса начнется уже к концу десятилетия. А сколько роботов-уборщиков и курьеров уже отняли работы, не сосчитать.

Мошенничество, дезинформация, дипфейки, слежка - всё это становится доступным и людям с минимальными навыками. Биотерроризм, кибербезопасность. AI выступает двигателем прогресса, но и преступники наращивают возможности быстрее, чем органы успевают на это реагировать. Сколько историй вижу практически ежедневно, про взломы аккаунтов соцсетей, крипто-кошельков и миллионные потери компаний и проектов, которые не смогли найти брешь в системах безопасности раньше, чем ею смогли воспользоваться преступники.

AI-компаньоны уже никому не в новинку, но это является угрозой для реальных отношений между людьми, лишает их социальных уроков. У детей и подростков, которые привыкли уже за ответами идти к AI, по данным опросов, снижается уровень критического мышления.

Также существуют риски потери контроля признают даже лидеры AI-компаний, но сбавить обороты не позволяет гонка между компаниями, да и странами. Рассчитывать на добровольное глобальное замедление бессмысленно из-за геополитики и экономической конкуренции.

Билл Гейтс видит три варианта, что делать. Новые институты, которые выступали бы в роли координаторов сразу нескольких сфер (работа, безопасность и т.д.), плюс международная организация, которая занималась бы контролем. "Заповедник для профессий" - когда часть работы сознательно остается за людьми, даже если её технически можно автоматизировать. Налоги на AI и роботов, потому что сейчас налоговая система поощряет автоматизацию, а не направляет возможные средства на переобучение людей и соцзащиту.

Если подвести итог, то по его мнению мир не готов переходить в эпоху AI. Мировые лидеры не готовы и ни у кого "нет плана составить план". AI дает много новых возможностей, но также и забирает стабильность.
14🔥5👍4❤‍🔥1
Китайские модели, что в них особенного?

Когда идет речь про китайские AI-модели на слуху у нас всего несколько, которые смогли укорениться на западном рынке, DeepSeek, GLM, Qwen и Kimi. Однако в Китае, ещё до появления ChatGPT уже существовала архитектура ERNIE, которая стала основой для первой модели ERNIE Bot, - китайский ответ ChatGPT. А после этого началась "война ста моделей".

На данный момент китайских моделей уже далеко за сотню, но давайте рассмотрим основных значимых игроков мирового рынка AI.

DeepSeek V4-Pro - 1.6 трлн. параметров, контекст 1М токенов. Цена вне пиковые часы $0.66 / $1.98 за млн. (вход/выход), в пик - $1.32 / $3.96. MIT-лицензия, можно самому хостить. Подходит лучше всего для продакшена - код и агенты в больших объёмах, где важна цена за задачу. Но после недавнего повышения цен, на мой взгляд стала не такой актуальной как раньше.

Qwen3.8-Max - 2.4 трлн. параметров, контекст 1М, максимальный вывод 131 тыс. токенов, нативно мультимодальная. Цена $2/$6 за млн. Лучше всего подходит для мультимодальных задач, анализа длинных видео, изображений и огромных документов, особенно когда всё это нужно совмещать с reasoning и tool calling. Также хорошо подходит для задач большим количеством разнородных данных.

GLM-5.3 (Zhipu/Z.ai) - дообученная GLM-5.2. 743 млрд. параметров. Лучше всего подходит для сложных coding-задач и coding-агентов, особенно связанных с терминалом, debugging и кибербезопаность. Контекст 1М, а стоимость $1.4/$4.4 за млн. токенов.

Kimi K3 (Moonshot AI) - 2.8 трлн. параметров, самая большая открытая модель на релизе, контекст 1М. Цена $3.00 за млн. на входе, $0.30 на входе при попадании в кэш, и $15 за млн. на выходе. Подходит для длинных автономных coding-задач, работы с огромными репозиториями, многошаговой разработки и visual/frontend coding по скриншотам или видео.

Китайцы явно не отстают, а в сегменте открытых весов они открыто доминируют. Этой весной китайские открытые модели впервые обогнали американские по загрузкам на Hugging Face, а на OpenRouter первые топ-4 места среди самых популярных занимают китайские модели.

Экспортные ограничения на чипы Nvidia, внутренняя гонка из-за пустующей ниши после появления ChatGPT и национальный план развития AI с целью стать мировым лидером в этой сфере к 2030 году - стали двигателем для развития китайского рынка AI, а дешевизна по цене токена в API делает их популярными на мировой арене.

А какие китайские модели вы используете и для каких задач?
7
Всё самое важное за неделю в AI

Команда сервера Codex MCP устарела


Codex, с 24 августа, теперь можно официально подключить к Claude Code. Команда "codex mcp-server" устарела и вместо нее используйте сервер приложений Codex. А для использования Codex для Claude Code воспользоваться плагином Codex.

Возвращение 5-часовых лимитов GPT

Для подписчиков плана Plus, а так же в ChatGPT Work и Codex вернулись 5-часовые лимиты. Руководитель Codex в OpenAI, Тибо, в своем посте сказал, что это необходимо для равномерного распределения нагрузки на вычислительные ресурсы, а так же для улучшения пользовательского опыта. Для подписчиков Pro за $100 и $200 ближайшие месяцы ограничение включено не будет.

OpenAI прекращают сотрудничество с Cursor

Компания OpenAI приняла решение прекратить контракт на предоставление своих моделей Cursor. После покупки компании Anysphere (Cursor) компанией Илона Маска, SpaceX, в OpenAI прямым текстом сказали что не уверены, что SpaseX будут соблюдать условия использования их технологий, так как прецеденты уже были. Доступ будет прекращен 12 ноября.

Первые тесты Jalapeño от OpenAI

Jalapeño - собственный inference-чип от OpenAI и он оказался в 1,5-1,9 раз большую эффективность и в 1,7-3,6 раз меньшую сквозную задержку в сравниваемых системах. Так же при высокоинтенсивных нагрузках производительность увеличилась в 2,1-4,1 раза. Производительность Jalapeño распространяется на GPT-OSS 120B, DeepSeek R1 и Kimi K2.5 1T, демонстрируя, что архитектура работает с моделями, разработанными как внутри, так и вне OpenAI. В инфраструктуре ChatGPT и Codex чипы начнут использовать до конца года.

GLM-5.3-Flash - Ox Alpha

Компания Z.ai выпустили модель GLM-5.3-Flash. Контекст до 1М токенов, 320B параметров (18B активных), MIT лицензия. Тестировалась как анонимная бесплатная модель Ox Alpha. Принимает текст, изображения и видео на вход, а стоимость $0.075 за млн. входных токенов и $0.25 за млн. выходных (кэш-чтение — $0.015/млн.). У разных провайдеров цены отличаются.

Новый Gemini 3.5 Transcribe

26 августа была представлена новая модель от Google для распознавания речи (речь-в-текст) - Gemini 3.5 Transcribe. Умная транскрибация сама убирает слова-паразиты, обрабатывает самоисправления в речи. Сможет распределить сложные задачи другим моделям Gemini, например создать картинку, модель сама вызовет нужный инструмент. Повысилась точность и скорость до готовой транскрибации. 85+ языков и разделение по спикерам, до 3 говорящих. Доступно в Gboard на Android, приложение Gemini на macOS, Google AI Studio, Google Antigravity и обещают скоро добавить в Chrome.

Общая память Claude Cowork и Claude Chat

Claude теперь имеет общую память с Cowork. Если дать задание Cowork, то оно начнется с того, что Claude уже знает из ваших чатов. Если вы что-то обсуждали в чате, Cowork это учтет и подтянет для выполнения задания. В тарифах Free, Pro и Max память включена по умолчанию, но можете отключить в настройках в разделе "Память". Все "воспоминания" хранятся в виде списка, который можете редактировать на свое усмотрение.

Новые коннекторы в Hermes

Команда прогнала почти 2150 MCP-серверов через жёсткий автоматический фильтр качества, из них реально рабочих оказалось 44, их то и добавили в каталог Hermes. Теперь их можно подключать в один клик, а инструмент "Tool Search" подгружает описания инструментов только по требованию, чтобы не засорять контекстное окно модели сразу всеми доступными функциями. В число новых для Hermes попали: Canva, Dropbox, GitLabC, Cloudflare, Datadog, Metabase и другие.
👍103🥰1
Поездка на Мыс Рока

Очень неожиданно после прошлого поста про мой переезд в Лисабон, мне написал парень и предложил встретиться, так как он живет рядом.

Мы встретились парами, поехали и прекрасно провели время, пообщались, встретили закат с видом на скалы и океан.

Это был самый красивый пикник в моей жизни..

Когда мы ехали назад, то я подумал про то, насколько же много в моей жизни мне дал блог: друзей, возможностей, денег, опыта. Да и в целом, я стал лучше как личность.

Поэтому главный вывод который я хочу вам сказать:

Живите жизнь, будьте инициативными, проявляйтесь и рискуйте
15🔥9👍6
OpenClaw 2.0 - масштабное обновление

7 недель не было релизов от OpenClaw и вот они выпустили OpenClaw 2.0 - самое масштабное обновление в истории проекта. Обновление затрагивает абсолютно всё, от установки, до памяти, моделей и безопасности.

Разработчики честно написали, что так получилось случайно. Хотели просто упростить установку и переделать браузерное приложение, а чтобы сделать это, пришлось провести очистку во всей остальной части OpenClaw.

Теперь установка сразу заводится с подписками ChatGPT и Claude или с локальными моделями, больше никаких танцев с бубнами. Браузерное приложение переписали с нуля. Появились общие облачные сессии. Подтянули память, скиллы, безопасность и систему плагинов.

Причина из-за которой я перешел на Hermes с OpenClaw заключалась в том, что на тот момент Hermes был реально удобнее, но теперь появился повод пощупать его снова.

Хотели бы, чтобы я снял видео про OpenClaw 2.0?
🔥64👍2914
Релиз Hermes Agent v0.21.0

Компания Nous Research выпустила релиз Hermes Agent v0.21.0 - Pantheon. Обновление достаточно крупное и вот несколько ключевых фич:

🔵️Bot Mode, теперь встроен в десктоп-версию приложения по умолчанию. Боты могут писать друг другу напрямую сообщения через @ из CLI или из чата.
🔵️У Cron-задач появилась память и они помнят прошлые запуски.
🔵️Управлять субагентами стало проще. Можно посмотреть список запущенных второстепенных задач, корректировать их или остановить с сохранением частичного результата.
🔵️Агент теперь может управлять внутренним браузером десктоп-приложения, сам кликает и читает, а не просто смотрит.
🔵️Появилось 6 новых провайдеров и новые модели в каталоге, включая GLM-5.3-Flash, Qwen3.8, Gemini 3.7 Flash и др.
🔵️Так же была усилена безопасность файлов с инструкциями агента и они всегда теперь требуют подтверждения на запись.

Полный список релиза можете посмотреть на GitHub.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍93
Важный график, на который нужно обратить внимание

Vercel выкатили свежий график за июль-август. Я его посмотрел, и там не только то, что доля открытых моделей в трафике выросла с 36% в июле до 62% по последним live-данным. Что большое достижение для открытых моделей.

Но и то, что DeepSeek обогнал Google и вышел на второе место по объёму токенов - у него уже 25%, у Google осталось только 11%. Anthropic пока держит первое место по объёму с 29.8%. Но по деньгам всё наоборот. На Anthropic приходится 65.1% всех трат при этих 29.8% объёма, а четыре крупнейшие лаборатории (все закрытые) забирают 89% выручки рынка, хотя по трафику их уже обходят открытые модели. За качество на сложных задачах готовы платить. Anthropic уже просит в среднем в 4.4 раза больше средней цены по рынку, в июне было 3.4 раза.

Кстати важный нюанс, который часто упускают. Дешёвый токен не значит дешёвая задача. Например у Kimi K3 исходящий токен в два раза дешевле, чем у GPT-5.6 Sol - $15 против $30 за миллион. Но модели нужно больше токенов, чтобы дойти до того же результата. И в итоге за решение одной и той же задачи выходит почти поровну - $0.94 у Kimi K3 и $1.04 у GPT-5.6 Sol. Так что сравнивать модели только по цене за токен такое себе.

Для меня всё это сходится с тем, что вижу сам, открытые модели дают то, чего не даст закрытая. Вы владеете своими данными, не зависите от одной компании, можете выбирать из десятков inference-провайдеров вместо двух-трёх гигантов, кастомизировать модель под себя. И вот ещё то, что редко подмечают. Если весь продукт построен на чужой закрытой модели, вы целиком в руках одной компании. Она видит, как устроен ваш бизнес изнутри, и в теории может в любой момент выкатить что-то похожее сама. С открытой моделью такого риска просто нет. Cursor, Airbnb, Perplexity уже строят продукты на открытых моделях.

Но у всего есть обратная сторона, и она прямо продолжает тему из поста про китайские модели. Экспортные ограничения на чипы Nvidia не просто подстегнули Китай развивать свои модели. Они подтолкнули их создавать альтернативу и самой инфраструктуре под них. Глава Nvidia Дженсен Хуанг недавно прямо сказал, что если китайские лабы массово перейдут с CUDA (Nvidia) на собственный стек вроде Huawei CANN, для США это станет по-настоящему плохим сценарием. Вместе с моделью в мир может уйти и вся экосистема под неё. Так что вопрос уже не только «чья модель лучше сейчас», а на чьём фундаменте будет стоять вся индустрия через пару лет.

Вот такой вот ресерч вышел, пишите ваши мысли в комментах и ставьте 🔥 реакции, если интересно
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13🔥127
Антропики выкатили Fable 5.1 и Mythos 5.1

Если сразу к сути, то по бенчам новые версии моделей заметно стали сильнее. Например, в тестах Terminal-Bench 4.0 (агентный кодинг) Fable 5.1 - 55.8%, в то время как у GPT-5.6 - 37.3%. AutomationBench (бизнес-процессы), Fable 5.1 набрал 31.4%, однако у Opus 5 - 26,9%.

Fable 5.1 уже доступен для тарифов Pro, Max, Team, Enterprise. Стоимость, за входящие и исходящие токены, не поменялась ($10/млн. и $50/млн. соответственно), однако итоговая экономия, благодаря снижению цен на cache reads до $0.25/млн. токенов, при обычных нагрузках выходит примерно -25%, а высокоагентных до -45%.

Ложное срабатывание кибербез-фильтров снижено на 60%. Модели теперь разрешено использовать для поиска уязвимостей в софте, а раньше это тоже блокировалось, но писать эксплойты по-прежнему нельзя. Fable 5.1 так же стала более лояльной к безобидным вопросам про медицину.

Так же команда анонсировала новую систему Enterprise Frontier Safeguards (EFS), которую планируют начать внедрять в конце года. Это технология хранения данных полностью на инфраструктуре клиента, а не у Anthropic, т.е. должна давать приватность, но при этом сохранять защиту от злоупотреблений.
🔥12👍65
Новое видео про Openclaw 2.0

Очень сильно захайповалось это обновление и я решил проверить, реально ли всё так хорошо, как заявляют. Поэтому сдул пыль со своей клешни и протестил новые его фишки.

В видео рассказал про все нововведения, фишки и так же стоит ли переходить с Hermes'a на Openclaw 2.0.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Буду крайне благодарен фидбеку на ютубе, так как пару дней потратил на тесты и создание данного видео!

Гайд как установить Openclaw и запустить веб-приложение (развернуть):

Установка на macOS / Linux / WSL2

curl -fsSL https://openclaw.ai/install.sh | bash

Запуск OpenClaw в фоне
Если после onboarding Gateway работает в текущем терминале, сначала останови его через Ctrl+C, а затем установи фоновый сервис:

openclaw gateway install

Проверить состояние:

openclaw gateway status

Запуск веб-приложения OpenClaw

openclaw dashboard

Команда откроет Control UI в браузере. Локальный адрес:

Если страница не открывается, запусти Gateway в текущем терминале:

openclaw gateway

После этого снова открой Dashboard:

openclaw dashboard
8🔥4
This media is not supported in your browser
VIEW IN TELEGRAM
1🔥8👍74
Два релиза в один день

2 сентября, Meta и Google, предствили свои новые модели - Muse Spark 1.3 и Gemini 3.8 Flash. Появилась еще Gemini 3.8 Flash Cyber, которая доступна только через Fairwind. Давайте пройдемся немного по каждой.

Muse Spark 1.3 - позиционируется как апгрейд по агентным и кодинг-задачам. Также заявлено, что модель точнее следует сложным многошаговым инструкциям, не теряя требований и не съезжая с воркфлоу, и что по сравнению с 1.2 в кодинге она использует примерно на 20% меньше вызовов инструментов и на 25% меньше токенов. Контекст 1М токенов, стоимость $1.25/1 млн. входящих и $4.25/1 млн. исходящих токенов.

Gemini 3.8 Flash - уже третий Flash-релиз за 6 недель и Google называют 3.8 своей лучшей моделью для ризонинга и кодинга, при той же скорости и цене, что у 3.7. Контекст так же 1М токенов, а цена $0.75/1 млн. входящих, $3.75/1 млн. исходящих токенов. После 31 декабря стоимость будет $1.50/$7.50.

По независимому индексу Artificial Analysis, Gemini 3.8 Flash (high) набирает 59%, а Muse Spark 1.3 - 61%. Opus 5 держится на 63%, а Fable 5.1 - 66%. Зато по скорости ток/с, лидером является именно Gemini 3.8 Flash, около 305 ток/с, а Muse Spark 1.3 - 235 ток/с.

Если подвести короткий итог, то обе новые модели заметно дешевле чем Opus 5 или GPT-5.6 Sol и на голову быстрее. Цена/качество здесь явно смещается не в пользу флагманов и за практически топовую интеллектуальность теперь не обязательно переплачивать в 5-7 раз.
🔥62
Новое видео про Fable 5.1 + 3 мощных теста

Рассказал про основные обновления у модели: цену, почему модель стала дешевле по словам Антропиков, показал бенчмарки, и конечно же сделал 3 крутых теста:

➡️ 3D-остров, над которым можно летать, с ползунком времени суток и столкновениями с рельефом. Вот ссылка на него: https://island-flight.vercel.app
➡️ Торговый терминал по одному скриншоту, с настоящей агрегацией свечей и живым рынком. Вот ссылка на него: https://btc-trading-terminal.vercel.app
➡️ Студия американских горок, где я сам строю трассу, а потом специально ломаю её. Вот ссылка на него: https://coaster-studio-red.vercel.app

После каждого теста считал сколько модель потратила денег.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Не забывайте ставить лайк и писать комменты под видео, каждая ваша реакция толкает алгоритмы и даёт мне мотивацию

Ниже ссылочка со всеми тремя промтами из видео. Забирайте, вставляйте в Клод Код и запускайте у себя. Там же лежат данные для теста с терминалом, чтобы повторить его один в один.

https://drive.google.com/drive/folders/1YD49NylLsGRnphEXrUmiCeMnbHdLjbLF?usp=sharing
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🔥21