Мысли HinkoKа
5.59K subscribers
1.79K photos
364 videos
2 files
387 links
Мой блог, AI, самосовершенствование и ещё много всего интересного!

Писать по сотрудничеству:
@h1nkok
Download Telegram
Поездка на Мыс Рока

Очень неожиданно после прошлого поста про мой переезд в Лисабон, мне написал парень и предложил встретиться, так как он живет рядом.

Мы встретились парами, поехали и прекрасно провели время, пообщались, встретили закат с видом на скалы и океан.

Это был самый красивый пикник в моей жизни..

Когда мы ехали назад, то я подумал про то, насколько же много в моей жизни мне дал блог: друзей, возможностей, денег, опыта. Да и в целом, я стал лучше как личность.

Поэтому главный вывод который я хочу вам сказать:

Живите жизнь, будьте инициативными, проявляйтесь и рискуйте
15🔥9👍6
OpenClaw 2.0 - масштабное обновление

7 недель не было релизов от OpenClaw и вот они выпустили OpenClaw 2.0 - самое масштабное обновление в истории проекта. Обновление затрагивает абсолютно всё, от установки, до памяти, моделей и безопасности.

Разработчики честно написали, что так получилось случайно. Хотели просто упростить установку и переделать браузерное приложение, а чтобы сделать это, пришлось провести очистку во всей остальной части OpenClaw.

Теперь установка сразу заводится с подписками ChatGPT и Claude или с локальными моделями, больше никаких танцев с бубнами. Браузерное приложение переписали с нуля. Появились общие облачные сессии. Подтянули память, скиллы, безопасность и систему плагинов.

Причина из-за которой я перешел на Hermes с OpenClaw заключалась в том, что на тот момент Hermes был реально удобнее, но теперь появился повод пощупать его снова.

Хотели бы, чтобы я снял видео про OpenClaw 2.0?
🔥64👍2914
Релиз Hermes Agent v0.21.0

Компания Nous Research выпустила релиз Hermes Agent v0.21.0 - Pantheon. Обновление достаточно крупное и вот несколько ключевых фич:

🔵️Bot Mode, теперь встроен в десктоп-версию приложения по умолчанию. Боты могут писать друг другу напрямую сообщения через @ из CLI или из чата.
🔵️У Cron-задач появилась память и они помнят прошлые запуски.
🔵️Управлять субагентами стало проще. Можно посмотреть список запущенных второстепенных задач, корректировать их или остановить с сохранением частичного результата.
🔵️Агент теперь может управлять внутренним браузером десктоп-приложения, сам кликает и читает, а не просто смотрит.
🔵️Появилось 6 новых провайдеров и новые модели в каталоге, включая GLM-5.3-Flash, Qwen3.8, Gemini 3.7 Flash и др.
🔵️Так же была усилена безопасность файлов с инструкциями агента и они всегда теперь требуют подтверждения на запись.

Полный список релиза можете посмотреть на GitHub.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍93
Важный график, на который нужно обратить внимание

Vercel выкатили свежий график за июль-август. Я его посмотрел, и там не только то, что доля открытых моделей в трафике выросла с 36% в июле до 62% по последним live-данным. Что большое достижение для открытых моделей.

Но и то, что DeepSeek обогнал Google и вышел на второе место по объёму токенов - у него уже 25%, у Google осталось только 11%. Anthropic пока держит первое место по объёму с 29.8%. Но по деньгам всё наоборот. На Anthropic приходится 65.1% всех трат при этих 29.8% объёма, а четыре крупнейшие лаборатории (все закрытые) забирают 89% выручки рынка, хотя по трафику их уже обходят открытые модели. За качество на сложных задачах готовы платить. Anthropic уже просит в среднем в 4.4 раза больше средней цены по рынку, в июне было 3.4 раза.

Кстати важный нюанс, который часто упускают. Дешёвый токен не значит дешёвая задача. Например у Kimi K3 исходящий токен в два раза дешевле, чем у GPT-5.6 Sol - $15 против $30 за миллион. Но модели нужно больше токенов, чтобы дойти до того же результата. И в итоге за решение одной и той же задачи выходит почти поровну - $0.94 у Kimi K3 и $1.04 у GPT-5.6 Sol. Так что сравнивать модели только по цене за токен такое себе.

Для меня всё это сходится с тем, что вижу сам, открытые модели дают то, чего не даст закрытая. Вы владеете своими данными, не зависите от одной компании, можете выбирать из десятков inference-провайдеров вместо двух-трёх гигантов, кастомизировать модель под себя. И вот ещё то, что редко подмечают. Если весь продукт построен на чужой закрытой модели, вы целиком в руках одной компании. Она видит, как устроен ваш бизнес изнутри, и в теории может в любой момент выкатить что-то похожее сама. С открытой моделью такого риска просто нет. Cursor, Airbnb, Perplexity уже строят продукты на открытых моделях.

Но у всего есть обратная сторона, и она прямо продолжает тему из поста про китайские модели. Экспортные ограничения на чипы Nvidia не просто подстегнули Китай развивать свои модели. Они подтолкнули их создавать альтернативу и самой инфраструктуре под них. Глава Nvidia Дженсен Хуанг недавно прямо сказал, что если китайские лабы массово перейдут с CUDA (Nvidia) на собственный стек вроде Huawei CANN, для США это станет по-настоящему плохим сценарием. Вместе с моделью в мир может уйти и вся экосистема под неё. Так что вопрос уже не только «чья модель лучше сейчас», а на чьём фундаменте будет стоять вся индустрия через пару лет.

Вот такой вот ресерч вышел, пишите ваши мысли в комментах и ставьте 🔥 реакции, если интересно
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13🔥127
Антропики выкатили Fable 5.1 и Mythos 5.1

Если сразу к сути, то по бенчам новые версии моделей заметно стали сильнее. Например, в тестах Terminal-Bench 4.0 (агентный кодинг) Fable 5.1 - 55.8%, в то время как у GPT-5.6 - 37.3%. AutomationBench (бизнес-процессы), Fable 5.1 набрал 31.4%, однако у Opus 5 - 26,9%.

Fable 5.1 уже доступен для тарифов Pro, Max, Team, Enterprise. Стоимость, за входящие и исходящие токены, не поменялась ($10/млн. и $50/млн. соответственно), однако итоговая экономия, благодаря снижению цен на cache reads до $0.25/млн. токенов, при обычных нагрузках выходит примерно -25%, а высокоагентных до -45%.

Ложное срабатывание кибербез-фильтров снижено на 60%. Модели теперь разрешено использовать для поиска уязвимостей в софте, а раньше это тоже блокировалось, но писать эксплойты по-прежнему нельзя. Fable 5.1 так же стала более лояльной к безобидным вопросам про медицину.

Так же команда анонсировала новую систему Enterprise Frontier Safeguards (EFS), которую планируют начать внедрять в конце года. Это технология хранения данных полностью на инфраструктуре клиента, а не у Anthropic, т.е. должна давать приватность, но при этом сохранять защиту от злоупотреблений.
🔥12👍65
Новое видео про Openclaw 2.0

Очень сильно захайповалось это обновление и я решил проверить, реально ли всё так хорошо, как заявляют. Поэтому сдул пыль со своей клешни и протестил новые его фишки.

В видео рассказал про все нововведения, фишки и так же стоит ли переходить с Hermes'a на Openclaw 2.0.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Буду крайне благодарен фидбеку на ютубе, так как пару дней потратил на тесты и создание данного видео!

Гайд как установить Openclaw и запустить веб-приложение (развернуть):

Установка на macOS / Linux / WSL2

curl -fsSL https://openclaw.ai/install.sh | bash

Запуск OpenClaw в фоне
Если после onboarding Gateway работает в текущем терминале, сначала останови его через Ctrl+C, а затем установи фоновый сервис:

openclaw gateway install

Проверить состояние:

openclaw gateway status

Запуск веб-приложения OpenClaw

openclaw dashboard

Команда откроет Control UI в браузере. Локальный адрес:

Если страница не открывается, запусти Gateway в текущем терминале:

openclaw gateway

После этого снова открой Dashboard:

openclaw dashboard
8🔥4
This media is not supported in your browser
VIEW IN TELEGRAM
1🔥8👍74
Два релиза в один день

2 сентября, Meta и Google, предствили свои новые модели - Muse Spark 1.3 и Gemini 3.8 Flash. Появилась еще Gemini 3.8 Flash Cyber, которая доступна только через Fairwind. Давайте пройдемся немного по каждой.

Muse Spark 1.3 - позиционируется как апгрейд по агентным и кодинг-задачам. Также заявлено, что модель точнее следует сложным многошаговым инструкциям, не теряя требований и не съезжая с воркфлоу, и что по сравнению с 1.2 в кодинге она использует примерно на 20% меньше вызовов инструментов и на 25% меньше токенов. Контекст 1М токенов, стоимость $1.25/1 млн. входящих и $4.25/1 млн. исходящих токенов.

Gemini 3.8 Flash - уже третий Flash-релиз за 6 недель и Google называют 3.8 своей лучшей моделью для ризонинга и кодинга, при той же скорости и цене, что у 3.7. Контекст так же 1М токенов, а цена $0.75/1 млн. входящих, $3.75/1 млн. исходящих токенов. После 31 декабря стоимость будет $1.50/$7.50.

По независимому индексу Artificial Analysis, Gemini 3.8 Flash (high) набирает 59%, а Muse Spark 1.3 - 61%. Opus 5 держится на 63%, а Fable 5.1 - 66%. Зато по скорости ток/с, лидером является именно Gemini 3.8 Flash, около 305 ток/с, а Muse Spark 1.3 - 235 ток/с.

Если подвести короткий итог, то обе новые модели заметно дешевле чем Opus 5 или GPT-5.6 Sol и на голову быстрее. Цена/качество здесь явно смещается не в пользу флагманов и за практически топовую интеллектуальность теперь не обязательно переплачивать в 5-7 раз.
🔥62
Новое видео про Fable 5.1 + 3 мощных теста

Рассказал про основные обновления у модели: цену, почему модель стала дешевле по словам Антропиков, показал бенчмарки, и конечно же сделал 3 крутых теста:

➡️ 3D-остров, над которым можно летать, с ползунком времени суток и столкновениями с рельефом. Вот ссылка на него: https://island-flight.vercel.app
➡️ Торговый терминал по одному скриншоту, с настоящей агрегацией свечей и живым рынком. Вот ссылка на него: https://btc-trading-terminal.vercel.app
➡️ Студия американских горок, где я сам строю трассу, а потом специально ломаю её. Вот ссылка на него: https://coaster-studio-red.vercel.app

После каждого теста считал сколько модель потратила денег.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Не забывайте ставить лайк и писать комменты под видео, каждая ваша реакция толкает алгоритмы и даёт мне мотивацию

Ниже ссылочка со всеми тремя промтами из видео. Забирайте, вставляйте в Клод Код и запускайте у себя. Там же лежат данные для теста с терминалом, чтобы повторить его один в один.

https://drive.google.com/drive/folders/1YD49NylLsGRnphEXrUmiCeMnbHdLjbLF?usp=sharing
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6🔥21
Ждем сегодня самую топовую модель Astra от OpenAI. По полимаркету шанс на релиз сегодня 80%, что очень много, интересно будет сравнить с Fable 5.1.
11👍1
OpenAI выкатили GPT-6 Astra

Не выкладывал до официального анонса, ибо фейки легко могут быть.

Почти во всех бенчмарках (15 из 17), что опубликовали OpenAI, Astra обошла новенькую Fable 5.1 от Антропиков.

Грег Брокман закончил брифинг словами: "Добро пожаловать в эпоху AGI".

Цена $10 и $50 за миллион токенов, контекст 1 050 000. Что соотвествует цене Fable 5.1

Доступ пока через Daybreak отдельным организациям. В ближайшие дни обещают дать модельку Plus, Pro, Business, и конечно Codex.

Ссылка на анонс:
https://openai.com/index/gpt-6-astra

На цифрах выглядит ОЧЕНЬ хорошо, как будет в реале, увидим, а пока ждем доступа)
🔥256
Маркетинг или GPT-6 Astra реально топ?

Сейчас все только и говорят про GPT-6 Astra, но давайте посмотрим на независимые тесты, которые уже появились на Artificial Analysis. Результаты получаются скромнее, чем нам преподносят OpenAI в своем анонсе.

По общему Intelligence Index, Astra набирает 61 балл, ровно столько же, сколько и предыдущая модель GPT-5.6 Sol и чуть меньше новый Muse Spark 1.3 (62 балла). При этом все равно отстает от Fable 5.1 на 5 пунктов.

В кодинге прогресс есть, но не сильно заметный, всего 2 балла в сравнении с Sol версией и не дотягивает до Fable 5.1 с 70 баллами, хотя находится на уровне Opus 5 и Fable 5.

Галлюцинаций стало в разы меньше, частота упала с 92% до 51%, что является явным прогрессом, но даже так, проблема остается и 51% достаточно высокие цифры.

И самое интересное, все же, это стоимость и эффективность по токенам. В агентном кодинге (харнесс Codex) Astra на максимальном эффорте тратит примерно в 3 раза меньше токенов, чем Sol, и в 5 раз меньше, чем Claude Opus 5 (xhigh). Однако в общем Intelligence Index, несмотря на экономию по токенам (~10% меньше на max усилиях), Astra всё равно на 75% дороже, чем Sol за задачу и это потому, что цена за токен выросла в 2.5 раза, и это перекрывает экономию.

А еще отличный бонус, каждый день, что Astra не доступна для использования, начисляются сохраненные сбросы лимитов для платных подписчиков.

В любом случае, когда GPT-6 Astra станет доступна в подписках, я обязательно пощупаю её.
👍8🔥8🥰32
Ну что Astra завезли в Codex, время тестить :)
🔥268