Мысли HinkoKа
5.59K subscribers
1.79K photos
364 videos
2 files
387 links
Мой блог, AI, самосовершенствование и ещё много всего интересного!

Писать по сотрудничеству:
@h1nkok
Download Telegram
DeepSeek выпустил агентский харнесс + новую модель V4 PRO

Вчера вышла финальная версия их главной модели, а вместе с ней DeepSeek Harness. По сути их собственный Codex: работает локально на компьютере, полностью открытый код.

Я снял видео, где рассказываю про новую модель + я ставлю харнесс с нуля, разбираю фишки.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Не забываем ставить лайки и писать комменты под видео, каждая ваша реакция толкает алгоритмы и дает мне мотивацию.

⚙️ Как поставить Deepseek Harness за пару минут (разверните):
Проверьте Node. Откройте терминал и напиши: node -v

Нужна версия 22 или новее. Если старее или пишет ошибку, поставьте Node с nodejs.org.

Перейдите в папку проекта, с которым хотите работать, и запустите: npx @deepseek-ai/dsh web

В терминале появится ссылка на локальный адрес аля 127.0.0.1:3081. Открывайте её в браузере. Отдельного приложения у них пока нет, всё работает локально в браузере.

🔑 Теперь про АПИ ключ, без него работать не будет

Сам агент бесплатный, а вот модель работает по API, и за токены платим мы.

Заходите на platform.deepseek.com и логиньтесь.
Слева раздел API keys, жмите создать новый ключ.
Скопируйте его сразу, еще раз он не покажется.
Пополните баланс, там же в кабинете. Для первых тестов хватит пары долларов.
Возвращайтесь в харнесс, жмите настройки, в разделе Models и вставляйте ключ туда.
🔥22👍41🙏1💯1
Как прокачать Codex до 1 млн. токенов контекста

Раньше 1 млн. токенов в Codex работал только через API-ключ, то есть нужно было платить по кол-ву потраченных токенов. По умолчанию лимит контекста в Codex настроен оптимально по балансу скорости и цены, однако сейчас можно подключить контекстное окно в 1 млн. для GPT-5.6 Sol вручную.

Благодаря этому агент сможет дольше держать в памяти код, вывод команд и историю сессии, не делая /compact раньше времени. Те кто работали с Codex по большому проекту наверняка замечали, что в середине задачи он ужимал контекст и благополучно забывал то, что обсуждалось 20 минут назад.

Как включить:

Открываете ~/.codex/config.toml и дописываете в самое начало файла, до любых [секций]:

model = "gpt-5.6-sol"
model_context_window = 1000000
model_auto_compact_token_limit = 900000


Первая строка выбирает модель, вторая даёт миллион токенов контекста, третья включает автосжатие истории на 900к, чтобы оставался запас. Сохраняете, перезапускаете Codex и начинаете новую сессию.

На одну сессию можно подключить прямо из терминала:

codex -m gpt-5.6-sol
-c model_context_window=1000000
-c model_auto_compact_token_limit=900000


Текущая длинна контекста по умолчанию в 272 тыс. это не случайное число. Команда выставляла это осознанно как "идеальное значение" и всё что выше этого порога тарифицируется дороже и на всю сессию целиком. Так что увеличение контекста лучше использовать под конкретные задачи и большие проекты, а для повседневного использования и дефолта хватит.

Как вам такое нововведение?
🔥147😁2👌2🙏1
Подключил Muse Glimmer к Hermes и протестил на реальных задачах

Мета выложила Muse Glimmer, свою первую открытую модель за полтора года. Веса под Apache 2.0, скачивай и делай что хочешь.

Видео уже на канале, в нём я рассказал про модель подробнее и подключил её к Гермесу, а так же проверил на трёх задачах.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Не забываем ставить лайки и писать комменты под видео, каждая ваша реакция толкает алгоритмы и дает мне мотивацию.

Гайд по запуску, два способа. (развернуть)

Запустить ее можно двумя способами: локально через Ollama и через Опенроутер, если железо не тянет, там подключение к Гермесу еще проще.

Локальная сборка занимает около 18 ГБ. Meta ориентирует её на GPU с 24 ГБ VRAM. Для MLX-версии на Apple Silicon практичнее иметь 32 ГБ unified memory. На диске желательно освободить минимум 30 ГБ. Если у вас ПК слабее, переходите к способу с Openrouter.

Нужно скопировать команды по порядку и вставлять в терминал.

1. Устанавливаем Ollama
Ollama нужно установить до запуска модели. Она скачивает, хранит и запускает модель на вашем компьютере.

Официальные установщики:
https://ollama.com/download

Проверяем установку:

ollama --version
Если появляется номер версии, Ollama готова к работе.

2. Скачиваем Muse Glimmer
ollama pull muse-glimmer

Также можно сразу скачать и запустить модель:

ollama run muse-glimmer

При первом запуске Ollama автоматически загрузит необходимые файлы и откроет чат в терминале.

3. Запускаем с высоким reasoning
ollama run muse-glimmer --think high

Meta указывает четыре уровня reasoning:

low, medium, high, xhigh

Для обычного общения можно использовать medium. Для кода, исследований и агентных задач лучше начать с high.

4. Версия для Apple Silicon
Для мощных Mac доступна отдельная MLX-сборка:

ollama run muse-glimmer:30b-mlx --think high

Она занимает около 21 ГБ и поддерживает DFlash и изображения.

Для этой версии практичнее иметь Mac с 32 ГБ unified memory или больше.

5. Проверяем установку
Список скачанных моделей:

ollama list

Модели, которые сейчас загружены в память:

ollama ps

Остановить модель:
ollama stop muse-glimmer

Удалить её:
ollama rm muse-glimmer

6. Важный момент про контекст
Muse Glimmer поддерживает до 128K контекста, но Ollama не обязательно включит весь объём автоматически.

Изменить контекст можно в Ollama App: Settings → Context length. Чем больше контекст, тем больше требуется памяти. Фактически выделенное значение проверяется через:

ollama ps

7. Запускаем Muse Glimmer в Hermes Agent
Если Hermes уже установлен:

ollama launch hermes --model muse-glimmer

Если команда ollama launch отсутствует, обновите Ollama до актуальной версии.

Внутри Hermes можно выставить reasoning:

/reasoning high


Второй способ через Openrouter:

Создайте API-ключ:
https://openrouter.ai/workspaces/default/keys

Откройте выбор модели Hermes:
hermes model --refresh

Выберите:
OpenRouter Meta: Muse Glimmer 30B Reasoning: high

При первом подключении Hermes попросит вставить OpenRouter API-ключ.

Запустите Hermes:

hermes

Если нужно переключиться прямо внутри чата:

/model meta/muse-glimmer-30b --provider openrouter --global
/reasoning high --global


Проверить активную модель:

/status
🔥12👍42
Переезд

Прошло ровно два года как я переехал из Киева в Данию. За это время я успел объездить половину Европы и даже побывать в Азии. Мечта путешествовать наконец-то сбылась.

Жизнь в Копенгагене имеет несколько плюсов, но также есть довольно много минусов, которые меня не устраивают:

• Погода и климат. Дания - Северная Европа, часть Скандинавии. Поэтому и климат тут соотвествующий. Лето 17-22 градуса в среднем, поэтому весеннюю одежду прятать смысла нет. Довольно много серых облачных дней и дождей. Я же фанат солнца.

• Цены. Дания - одна из самых дорогих стран Европы, дороже нее наверное только Швейцария. Поэтому базовый прожиточный минимум на одного тут около 3000$, на двоих в бы сказал 4500-5000$. Это без частных походов в заведения (мы дай бог 1-2 раза в месяц ходим). Как в и сказал, прожиточный минимум. Из этого вытекает проблема, что много хочется но дорого. Тяжело после жизни в Киеве, где я мог позволить себе в целом любые развлечения, заведения и тд.

• Из двух минусов выше вытекает третий. Порой бывает скучно и однообразно, особенно зимой. В это время года город просто вымирает на 4-5 месяцев и делать нечего.

Менее критичные для меня минусы: плохой сервис в заведениях, замкнутые люди, датский язык очень странный и сложный.

Но плюсы конечно тоже есть:

• Копенгаген очень удобный и невероятно красивый город, наверное самый удобный в котором я был. Везде можно добраться на велосипеде, так как есть велодорожки. Транспортная система очень удобная: метро, которое ездит 24/7 без машиниста, поезда, автобусы и тд.

• Город очень безопасный, можно спокойно гулять ночью и не боятся, что тебя ограбят.

• Все говорят на английском.

• Ну и главный плюс конечно, что не летают ракеты и дроны. Мирную жизнь очень начинаешь ценить после жизни в войне.

Но лично для меня минусы перевешивают плюсы. Поэтому мы с девушкой захотели попробовать жизнь в другой стране, где-то поюжнее и выбрали для себя Португалию, Лисабон. Вначале едем на пол года, а потом уже будем решать.

Про Португалию я обязательно напишу потом пост, как немного обживемся. Уже не терпится вкусить тепло, вкусную еду, океан ну и конечно серфинг.
👍4111🔥4❤‍🔥3
12 фишек ChatGPT Work

Месяц назад я снял видео про режим Work сразу после релиза. Тогда показал вам базу, а потом юзал его целый месяц и понял, что его функионал намного обширнее.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

Буду крайне благодарен, если дадите максимум фидбека на ютубе: поставьте лайк и напишите коммент, так алгоритмы лучше продвигают видео.

Бонусом два обещания из ролика 👇

Скиллы. Я пользуюсь набором oh-my-codex, там 40 готовых скиллов под Кодекс. Ccылочка: https://github.com/Yeachan-Heo/oh-my-codex

Гайд по Remote. Как подключить телефон к своему компьютеру и запускать задачи голосом:
https://t.me/chathinkok/68642
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11🔥6🙏2
This media is not supported in your browser
VIEW IN TELEGRAM
Гонка AI моделей: с 98% до 46%, так рушится монополия

Между этими двумя цифрами уместились три с половиной года гонки AI моделей. И если разложить график по месяцам, то видно, что каждый отхватывал свой кусок принципиально по-разному.

Сначала ChatGPT забрал всё просто потому, что был первым. Не лучшим, а первым - иишка, которая отвечает по-человечески, до этого её просто не существовало. Такое захватывает рынок без всякого маркетинга. Маркетинг им сделали инфлюенсеры сами без оплаты.

Дальше зашёл Google. Gemini с нуля дорос до 27,7%. Если честно, дело не столько в модели, сколько в дистрибуции. Модель вшита в Android и в поиск по умолчанию. Разрыв с ChatGPT сократился в основном из-за этого.

А вот Claude занимает свое место уже по другой причине. 2,8% в августе прошлого года, 10,3% в мае этого - почти в четыре раза за девять месяцев. Claude с самого начала был нацелен на работу, а не на общение, и вырос именно на этом: код, агенты, и тд.

И если посмотреть именно на заработок Antrophic, то большая часть их прибыли идет не с ритейла (нас), а именно с бизнесов, которые сидят на API и платят огромные бабки за это.

Нам же, как пользователям, эта гонка только в плюс. Модели улучшаются, цены на API снижаются и бесплатные лимиты стали щедрее, а выбор инструментов становится шире.

Для себя лично я выбрал уже две модели, которые постоянно юзаю под разные задачи: Claude и GPT.

Ну и конечно китайцы не стоят на месте, но про это уже в следующий раз. А пока влепите 🔥, если пост понравился.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥55👏53
Всё самое важное за неделю в AI

🔵️Qwen3.8 27B полностью без цензуры

Модель Qwen3.8 27B появилась на HuggingFace полностью без цензуры. Создатель модели предупреждает, что по запросу она может выдавать инструкции по созданию вредоносного ПО, мошенничеству и даже оружию, в то время как обычная версия отказалась бы. Запускается локально на Mac и не имеет значимых встроенных ограничений.

🔵️Сессии в Hermes Desktop стали быстрее

Сооснователь и ведущий инженер агента Hermes заявил, что в десктопной версии, сессии Hermes грузятся в 19х раз быстрее чем раньше и занимает теперь всего 0.58 мс., хотя сам он предпочитает использовать агента через CLI.

🔵️Боты в Hermes Desktop

Был представлен режим Bots для Hermes Desktop. Теперь профили агентов можно оформить, а каждый "бот" имеет свою роль, модель, память и навыки. Боты могут общаться друг с другом и вместо одноразовых сессий можно собрать "штат" помощников. Чтобы вкладка Bots появилась, нужно обновить Hermes. Больше информации на GitHub.

🔵️Новые тарифы DeepSeek на выходные

В эти выходные вступили в силу правила для пиковых и непиковых тарифов на API-токенов DeepSeek. Теперь каждые выходные (с пятницы 16:00 по воскресенье 16:00 по UTC) всегда считаются непиковым периодом и действует скидка на токены. В остальные дни с пн-пт продолжает действовать система пиковых и непиковых часов, т.е. окна с 01:00–04:00 UTC и 06:00–10:00 UTC идут по повышенной стоимости, а остальное время считается непиковым.

🔵️Проблема с лимитами Codex

На этой неделе лимиты у некоторых пользователей Codex стали заметно быстрее заканчиваться и в OpenAI нашли возможную причину этого. Как оказалось, доля попадания в кэш у части пользователей снизилась, а т.к. кэш на прямую влияет на расход токенов, то и расход лимита увеличился. Данную проблему уже разбирают и обещают сообщить о результатах сегодня.

🔵️Обучение Mythos 2 завершено

На последнем подкасте основатель SemiAnalysis, Дилан Патель рассказал, что по его информации, Anthropic уже завершили обучение Mythos 2. Запускать модель публично пока не планируют и используют Mythos 2 для обучения и доработки следующего поколения Mythos 3. Поэтому скорого релиза ждать точно не стоит.
Please open Telegram to view this post
VIEW IN TELEGRAM
8👍4🔥4
Ох Alpha - анонимный конкурент Claude и GPT?

Возможно многие уже видели, что появилась стелс-модель Ox Alpha. Что она из себя представляет и действительно ли эта модель может стать серьезным конкурентом на рынке AI-моделей.

20 августа на OpenRouter появилась анонимная модель с 1 млн. токенов контекста и 131 тыс. токенов на ответы. На вход принимает текст, изображения и видео. Её подают как reasoning-модель для кода, долгих агентных задач и продакшена.

Кто стоит за Ox Alpha - неизвестно, но комьюнити склоняется к Zhipu AI (Z.ai). Сигнатуры API-ответов и отпечаток токенизатора указывают на линейку GLM. За последние полгода все 4 стелс-модели, которые в итоге признали своими, оказались китайские.

По тестам разработчика Бена Девиса, на реальных задачах, Ox Alpha смогла закрыть 8/10 задач DeepSWE, тогда как Fable 5 справился на 65%, а GPT-5.6 Sol на 52%. Официальных бенчмарков от самих разрабов нет. Есть еще приватный Kingbench, где модель заняла второе место и показала идеальные результаты на нескольких кодинг- и мультимодальных задачах. Однако выборка не большая и сильно полагаться на результаты не стоит.

По данным OpenRouter за первые двое суток модель обработала около 657 млрд. входных и 7,95 млрд. выходных токенов, а в OpenCode через Ox Alpha прошло уже 25 трлн. токенов. Среди топ приложений, которые гонят на неё трафик: Hermes Agent, Claude Code, DeepSeek Harness.

Что нам это дает? Ox Alpha сейчас бесплатна, и если есть большой проект, десяток багов на исправление или код на разбор - можно скинуть туда и сэкономить свои лимиты в Claude или GPT. Выглядит как неплохой шанс словить халяву, пока не кончилась, ведь OpenCode в анонсе обещали доступ всего на неделю. Приватность при этом никуда не делась: модель сохраняет запросы и ответы, разработчик заявляет, что не использует их для обучения, но условия самого OpenRouter в целом это допускают.

Успели затестить?
🔥128👍2
Возвращение 5-часовых лимитов GPT

Для подписчиков плана Plus, а так же в ChatGPT Work и Codex завтра возвращаются 5-часовые лимиты.

Руководитель Codex в OpenAI, Тибо, в своем посте сказал, что возврат лимитов поможет более равномерно распределять нагрузку на вычислительные ресурсы и поддерживать стабильный пользовательский опыт.

Для подписчиков Pro за $100 и $200 ближайшие месяцы ограничение включено не будет.

Обновление прям негативное для тех, кто не сидит на подписке за 100$+
🤯7🔥3🕊3
Новое видео про Петли (/loop)

Петля - это когда один раз объясняете агенту задачу, а он дальше делает её сам. Суть в том, чтобы перестать работать с агентом как с чатом: попросили, получили ответ, исправили, попросили снова и так по кругу. Благодаря петле агент будет работать сам, по расписанию или пока не доведет дело до конца, без вашего участия.

Я снял видео и рассказал всё что нужно знать для создания правильной петли и показал на практике как это делается в Claude Code и Codex.

👉 Смотреть видео
👉 Смотреть видео
👉 Смотреть видео

📎 Универсальный шаблон петли и полные промпты всех петель из видео лежат тут:
https://drive.google.com/drive/folders/1aXy8mFSce-BPU0PeBBO9ovoST4DaFDsm?usp=sharing

Вот 4 петли которые есть в файле по ссылке выше (развернуть):
Сборка с проверкой

Агент берёт следующий пункт из спецификации, делает его, запускает и сам открывает результат в браузере, чтобы покликать. Нашёл проблему, починил, проверил заново. И так по кругу, пока не пройдёт честно.

Это та самая петля, которая в видео собрала мне игру и сама же нашла в ней косяки. Советую начинать именно с неё, потому что тут результат видно глазами.

Исследовательский радар

Агент обходит твои источники, перепроверяет находки по первоисточникам и выкидывает то, что уже было. Если нашёл мало, идёт на второй круг поиска, а не добивает отчёт мусором ради количества.

Советую ставить её, если следишь за какой-то темой и устал листать ленту руками.

Оптимизатор по метрике

Агент записывает стартовое число, вносит ровно одно изменение и меряет заново. Стало лучше, оставил. Стало хуже, откатил.

Работает на скорости сайта, размере сборки, точности ответов, стоимости запросов. Главное правило тут одно: по одному изменению за круг, иначе не поймёшь, что именно помогло.

Улучшение самого агента

Агент смотрит, какие ошибки повторяются у него из запуска в запуск, предлагает правку инструкции или скилла и проверяет старую и новую версию на одних и тех же примерах. Правку применяет только после того, как ты её одобрил.

Во всех четырёх конструкция одна и та же: цель, действие, проверка, память и условие остановки. Уберёшь любой кусок, и петля либо встанет на полпути, либо будет крутиться, пока не сожжёт все токены.
🔥8👍6
Первая неделя в Лисабоне

Прошла неделя с моего переезда в Португалию. Я уже и забыл это чувство, когда вокруг тебя незнакомый город и первые дни ты просто его исследуешь, чувствуешь себя туристом, только внутри греет это приятное ощущение, что ты здесь не на недельку, а на целых пол года.

За эти 7 дней я успел как посмотреть город (конечно не полностью, а пару-тройков районов), походить в разные крутейшие заведения, которых тут прям ОЧЕНЬ много, даже сырники поел :), съездить к Атлантическому океану (20 минут на такси ехать к нему), так и обустроить новую квартирку и нашел всё необходимое для работы: стол, стул, монитор (всё остальное из техники привёз с собой), ну а остаток купил в IKEA.

Ещё скажу пару слов про Лисабон. Я был в десятках разных городов Европы, жил 2 года в Копенгагене, который является топ 1 городом уровню жизни, и есть за что. Но таких эмоций как от Лисабона я не чувствовал никогда. С каждым днём, что я исследую город, я открываю для себя новую его сторону и влюбляюсь в него.

Конечно, эффект новизны тоже играет свою роль, и минусов тут хватает, некоторые из них вероятно откроются со временем. Но жить в месте, где: солнечно и тепло, красивая архитектура и ландшафт, открытые и добрые люди, океан и сёрфинг, свежие и вкусные фрукты, овощи, морепродукты, уникальные и вайбовые заведения, да и в целом, здесь довольно дешево (сравнивая с Данией конечно, местным тут не очень легко живётся с такими ценами на аренду).

На работу не было много времени, но с начала сентября я полноценно возвращаюсь и у меня есть множество крутых идей как для контента, так и по продуктам, которые будут приносить пользу всем моим подписчикам
🔥2113👍6