Антропик внедрила в клодкод spyware нацеленный на пользователей в азиатской таймзоне. Конечно они будут оправдываться про корпоративный анти-шпионаж и дистилляцию их моделей. Но вопрос доверия. Если есть не задокументированные внедрённые бекдоры - то будет такие же и от спецслужб, и корпоративные данные они будут сливать. Нет такой подлости на которую не пойдет капиталист ради иксов прибыли )
🔥1🌚1
Давно ничего не писал в блоге, переезд в новый дом, дни рождения. Со следующей недели точно начну писать регулярнее :)
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
За это время прошел тренинг от Cursor. Тренинг длинный, на 4 часа, весьма сумбурный, но понаделал скриншотов и собираюсь написать на эту тему подробную статью. Если в двух словах - они расказывали как внедрять АИ в проекты. Выделяли 4 пиллара по интеграции АИ продуктов в компаниях, в заивисмости от уровня автоматизации и готовности самой компании. И дальше все шло на разных примерах, дают пример компании которая пришла к вам за запросом, что хотят внедрить, на каком у них все уровне. И дальше рассказывают какая интеграция подошла бы этой компании и как ее организовать. Отличная методология на реальных примерах!
Так же все чаще замечаю, что SDD спеки становятся все популярнее. Интересное мнение - SDD может заменить обычный код ревью. Типа вместо ревью кода мы ревьювим и апдейтим спеки. У нас на проектах частенько возникают нюансы, что девы не понимают спеки от других сотрудников, и их приходится даже убирать в гитигнор, чтобы не было путаницы. Но вот в статье (пусть она слегка и рекламная)) говорят, что спеки должны быть first-class-citizens в разработке. Наверное имеет смысл, если всю команду перевести на один инструмент и единый формат...
The New Stack
“Code should be regenerated, not maintained”: Codeplain makes the case for spec-driven development
The phoenix of Greek myth burns and is reborn from its own ashes -- a metaphor this founder is applying to AI-generated code.
🔥4🌚1
А вот полезное! АИ агенты часто не могут спарсить сайты из за блока джава скрипта jina-ai ридер решает эту проблему. (а так же пдфки, картинки, другие доки) Пока бесплатно) Например
Стоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
https://r.jina.ai/https://exadel.comСтоит интегрировать в свои скилы, чтобы агент читал так сайты, когда не может спарсить сам. Подробности в репо
GitHub
GitHub - jina-ai/reader: Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/
Convert any URL to an LLM-friendly input with a simple prefix https://r.jina.ai/ - jina-ai/reader
🔥1
Подключил сегодня в свой opencode GPT-5.6. Погонял Terra (high) на код ревью и фиксах. Слушайте, я первый раз в 2026 году кайфанул от модельки авторства большой тройки. Новая гопота реально классная!👍
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.😄 Отличное следование инструкциям, красивые лаконичные фиксы, скорость инфиренса как надо. Похоже я на ближайшее время перехожу на активную трату наших корпоративных OpenAI ключей 😁
Samа и команде OpenAI реальный респект за такой мощный релиз!🧠
Наконец таки она стала нормально общаться и ее аутпуты не выглядят как запутанный поток мыслей технаря аутиста.
Samа и команде OpenAI реальный респект за такой мощный релиз!
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Продолжаю сегодня тестить GPT-5.6. И эйфория от первого знакомства уже улетучилась... 🤨
Да, Terra как исполнитель - огонь. Но код по спеке и Дипсик нормально в целом напишет. Конечно шансов что ГПТ напишет по спеке без косяков больше, но код ревью и там и там придется прогонять. Вобщем написание по расширенному плану и спецификации - это не то чемм можно гордиться.
А вот саммари пул реквестов, систем дизай, написание самих архитектурных спек. Это уже то что важно. И гпт что-то пока меня не удивляет с этим. Допустим банальное
GPT-5.6 Sol вообще стал подтягивать скилы для код ревью и пошел колбасить полное исследование кода. Говорю что ты делаешь, просто саммари нужен, понять что там в pr разрабы накатали. Сделал. См. первое фото. Второе и третье фото - как по этому же промпту дала ответ GLM-5.2
_*Какие мысли, народ, где лучше?*_ И еще для сравнения, закину скрины в коменты, задал вопрос что надо сделать чтобы текущая сборка имейджей заработала в CICD а не только вручную.
По итогу - ГПТ очень краток. Вроде как все по делу. Но критических деталей может не хватать. GLM четко пишет: _"Вот первый путь решения проблемы, вот второй"_.
ГПТ - говорит в рассуждениях _The key decision is whether to convert it to the supported docker_with_git flow or extend CI to support baked-source docker_image; I’ll make the minimal supported path explicit._ То есть он тоже видит два пути решения, но самостоятельно выбирает более простой путь и пишет дальше только его. 😐 Мне кажется - это довольно критичный косяк, когда модель сознательно уходит от feedback loop там где он реально нужен ⚠️
GLM же реально углубляется в детали, и его фишечки вроде *Suggested review questions* это прям реальный буст quality of life 😎 и он такие детали выдает часто и это круто.
Конечно пример довольно простой и только один, вывод довольно субьективный. Но в ближайшее время попробую сравнить две модели на написании подрообной спецификации для какой нибудь обьемной фичи. Вот там действительно видно и архитектурное видение, и умение писать по делу и понятно, и насколько широко моель смогла погрузиться в детали = насколько хорошо написаные спеки прошли последующее ревью.
Да, Terra как исполнитель - огонь. Но код по спеке и Дипсик нормально в целом напишет. Конечно шансов что ГПТ напишет по спеке без косяков больше, но код ревью и там и там придется прогонять. Вобщем написание по расширенному плану и спецификации - это не то чемм можно гордиться.
А вот саммари пул реквестов, систем дизай, написание самих архитектурных спек. Это уже то что важно. И гпт что-то пока меня не удивляет с этим. Допустим банальное
review MR https://git.***.com/r-d/exadel-***/-/merge_requests/566 summarize changes, highlight what is important from DevOps perspective GPT-5.6 Sol вообще стал подтягивать скилы для код ревью и пошел колбасить полное исследование кода. Говорю что ты делаешь, просто саммари нужен, понять что там в pr разрабы накатали. Сделал. См. первое фото. Второе и третье фото - как по этому же промпту дала ответ GLM-5.2
_*Какие мысли, народ, где лучше?*_ И еще для сравнения, закину скрины в коменты, задал вопрос что надо сделать чтобы текущая сборка имейджей заработала в CICD а не только вручную.
По итогу - ГПТ очень краток. Вроде как все по делу. Но критических деталей может не хватать. GLM четко пишет: _"Вот первый путь решения проблемы, вот второй"_.
ГПТ - говорит в рассуждениях _The key decision is whether to convert it to the supported docker_with_git flow or extend CI to support baked-source docker_image; I’ll make the minimal supported path explicit._ То есть он тоже видит два пути решения, но самостоятельно выбирает более простой путь и пишет дальше только его. 😐 Мне кажется - это довольно критичный косяк, когда модель сознательно уходит от feedback loop там где он реально нужен ⚠️
GLM же реально углубляется в детали, и его фишечки вроде *Suggested review questions* это прям реальный буст quality of life 😎 и он такие детали выдает часто и это круто.
Конечно пример довольно простой и только один, вывод довольно субьективный. Но в ближайшее время попробую сравнить две модели на написании подрообной спецификации для какой нибудь обьемной фичи. Вот там действительно видно и архитектурное видение, и умение писать по делу и понятно, и насколько широко моель смогла погрузиться в детали = насколько хорошо написаные спеки прошли последующее ревью.
👍1
Kimi K3, frontier level модель от Moonshot уже в OpenCode Go. В 6 раз дороже GLM 5.2, и в 10 раз дороже прошлой Kimi K2.7.
Не очень юзабельно, модель скорее для того чтобы показать, что опенсорс может конкурировать с фронтиром.
Но потестить можно. Для ежедневной работы наверное излишне, для любых задач все равно хватает GLM+DeepSeek на любой подписке, или GPT Terra High если юзаете Codex.
Не очень юзабельно, модель скорее для того чтобы показать, что опенсорс может конкурировать с фронтиром.
Но потестить можно. Для ежедневной работы наверное излишне, для любых задач все равно хватает GLM+DeepSeek на любой подписке, или GPT Terra High если юзаете Codex.
🔥1
Запустил Kimi K3 для простейшего ресерча. Девы сделали для проекта e2e тесты, дал путь в репе, сказал сделать репорт что за тесты, как они работают, как конфигурируются, как потом лучше их интегрировать в CICD. 3 минуты работы, 60к токенов (из них половина - сис промпты и заголовки скилов, обычный контекст в начале любого чата), съело 3% месячного лимита 😆Прайсинг реально Опус-стайл 🤷♂️
Вывод приятно читается, все хорошо сттруктурированно, но в принципе как и у GLM/Kimi раньше, у них всегда была качественная подача информации. Контекст собирает правильно, смотрит файлы по всей цепочке интеграции и деплоя. Работает конечно медленно, показалось что даже медленнее GLM. Вобщем выглядит качественно - но медленно и дорого.
У нас на проекте анлим ключи на гпт, но раньше я их не использовал вообще, GPT 5.4-5.5 меня совсем не устраивали по своей работе. C выходом Сол и Терра ситуация поменялась, все чаще гоняю Терра как базовую модель и Сол если есть сложный баг и траблшутинг. Но когда нужен вдумчивый ресерч, доки или код ревью - по прежнему запускаю GLM 5.2, внимание к деталям и качественная подача без излишнего у нее все еще зе бест. Так что пока продолжу дальше использовать эту связку, Кими хоть и интересна, но мимо
Вывод: если вы интузиаст по новым моделям или у вас только подписки OpenCode или Ollama - новую Kimi K3 вполне можно иногда запускать, там где нужен интеллект фронтир модели. При цене в 3/15 - она все еще сильно дешевле Опуса и явно лучше. Где-то на уровне Терры при полной оплате за АПИ, но скорее всего лучше Терры.
Если вы максите эффективность сделанной работы к стоимости - новая Kimi выглядит излишней, как и любые фронтир модели. 95% задач можно успешно делать на последних Дипсик и GLM.
Вывод приятно читается, все хорошо сттруктурированно, но в принципе как и у GLM/Kimi раньше, у них всегда была качественная подача информации. Контекст собирает правильно, смотрит файлы по всей цепочке интеграции и деплоя. Работает конечно медленно, показалось что даже медленнее GLM. Вобщем выглядит качественно - но медленно и дорого.
У нас на проекте анлим ключи на гпт, но раньше я их не использовал вообще, GPT 5.4-5.5 меня совсем не устраивали по своей работе. C выходом Сол и Терра ситуация поменялась, все чаще гоняю Терра как базовую модель и Сол если есть сложный баг и траблшутинг. Но когда нужен вдумчивый ресерч, доки или код ревью - по прежнему запускаю GLM 5.2, внимание к деталям и качественная подача без излишнего у нее все еще зе бест. Так что пока продолжу дальше использовать эту связку, Кими хоть и интересна, но мимо
Вывод: если вы интузиаст по новым моделям или у вас только подписки OpenCode или Ollama - новую Kimi K3 вполне можно иногда запускать, там где нужен интеллект фронтир модели. При цене в 3/15 - она все еще сильно дешевле Опуса и явно лучше. Где-то на уровне Терры при полной оплате за АПИ, но скорее всего лучше Терры.
Если вы максите эффективность сделанной работы к стоимости - новая Kimi выглядит излишней, как и любые фронтир модели. 95% задач можно успешно делать на последних Дипсик и GLM.
Please open Telegram to view this post
VIEW IN TELEGRAM
Вышел Qwen 3.8, еще одна модель Fable-class. Похоже теперь модели уровня фейбл - это базовый уровень как для закрытых так и для oss моделей :) Отставание в месяц уже невелировалось, модели схожего уровня у США и Китая теперь выходят почти одновременно.
Инвесторы твиттят что-все-пропало, предрекая крах штатовскому аи-рынку, так как все пересядут на модели такого же качества но в 5 раз дешевле. Думаю лукавят, все знают что есть комплаенс, и корпораты будут вынуждены (пока) платить в Х раз больше, просто потому что штатовские компании (якобы) обещают не сливать их данные.
Так что у Альтмана с Амодеем кастомеры будут, но триллионные оценки явно под вопросом. Китай теперь настоящий конкурент (и имхо это круто, китайские инженеры реально делают крутые штуки на энтузиазме, как в старые добрые :) )
Инвесторы твиттят что-все-пропало, предрекая крах штатовскому аи-рынку, так как все пересядут на модели такого же качества но в 5 раз дешевле. Думаю лукавят, все знают что есть комплаенс, и корпораты будут вынуждены (пока) платить в Х раз больше, просто потому что штатовские компании (якобы) обещают не сливать их данные.
Так что у Альтмана с Амодеем кастомеры будут, но триллионные оценки явно под вопросом. Китай теперь настоящий конкурент (и имхо это круто, китайские инженеры реально делают крутые штуки на энтузиазме, как в старые добрые :) )
X (formerly Twitter)
Alex Finn (@AlexFinn) on X
We live in a new world. Open source has officially caught up to frontier
Qwen 3.8 is out, and it’s better than ChatGPT 5.6
6 months ago I told you to start buying hardware. Prices would explode and open source was going to catch up
Both happened.
Anthropic…
Qwen 3.8 is out, and it’s better than ChatGPT 5.6
6 months ago I told you to start buying hardware. Prices would explode and open source was going to catch up
Both happened.
Anthropic…
🔥1
Мистер "оверинженер" вернулся. Простая задача "девелоперы поменяли переменную окружения, поменяй ее в наших девопсовых конфигах и доках" причем с нормальным контекстом, скинул оригинальный запрос от девелоперов. А Гопота (причем Terra, а не Sol) решила переработать вообще все приложение и тесты, где есть какие-либо пересечения с этой переменной.
Пришлось звать на помощь GLM, чтобы он откатил изменения и сделал нормальный скоуп. Ну вот блин, вроде Sol/Terra - умные модели, можно же переспросить пользователя если есть сомнения что менять. Почему с GLM/Kimi/DeepSeek вообще никогда нет проблем что они меняют тебе весь проект не поняв твою задачу? Блин, вот есть желание нафиг выключить OpenAI провайдера после таких косяков и переделок 🤬
Пришлось звать на помощь GLM, чтобы он откатил изменения и сделал нормальный скоуп. Ну вот блин, вроде Sol/Terra - умные модели, можно же переспросить пользователя если есть сомнения что менять. Почему с GLM/Kimi/DeepSeek вообще никогда нет проблем что они меняют тебе весь проект не поняв твою задачу? Блин, вот есть желание нафиг выключить OpenAI провайдера после таких косяков и переделок 🤬
🌚1
Хорошая подробная статья как создавать дизайны с помощью АИ. Если вам нужен лендинг, постер или презентация, не обязательно осваивать Claude Design/Open Design. Можно использовать обычный харнесс, но tips&tricks из этой статьи помогут вам не создать очевидный слоп, а сделать что-то со вкусом. Добавляем в закладки 🌡
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
Leon Lin (@LexnLin) on X
How To Actually Design With AI
Первый сезон нерд-воин объявляем открытым. Прям батл-рэп в вязаном свитере и очках какой-то 🤪
Гугл походу поняла, что их Flash нравилась людям за скорость, надежность и дешевый прайс. И делать флеш уровнем прошлого поколения про - странная стратегия. И сейчас они выпустили новый flash 3.6 с более дешевым аутпутом, лучшей токен эффектвиностью и конечно с качеством получше. Можно переводить свои тулы и пет проекты на новую модель😎
Тут YCombinator выложил актуальные идеи для стартапов, в своем Requests-for-Startups. Пункт 4 - Multiplayer AI звучит интересно. Кажется простейшая идея, совсем на поверхности!
* Просто браузерный чат враппер, шарим линку и работаем в одном чате.
* Создатель чата загружает свой токен (openai, claude, gemini, храним секьюрно в браузере и передаем на бекенд), получается инфиренс за счет создателя чата.
* Возможность подгружать скилы/mcp/конфигурации из других своих агентов. Получаем быстрый онбординг своих рабочих инструментов и практик.
* Мультиплеерный чат, голосовое/видео прикрутить. Артифакты от аи доступны всем в чате. Так же все могут шарить свои файлы друг другу для работы.
* В идеале - плагины для codex, cc, opencode, чтобы не только браузер, а и в нативном агенте работать командой.
Профит - в командной работе над фичами. Например вместе с продукт менеджером и дизайнером работаем над SDD спеками. Или аля whiteboard для прохождения тех собесов (сейчас понемногу все переходят к тому, что аи юзать на собесах можно и нужно, а инструментов пока нет).
В целом вообще вырисовывается полноценная замена обычным митингам, интересно..😮
Как вам идея? Стоящая?)👍 Или все говно, и надо целиться не в дженерик инструментарий (такое под силу раскрутить только условному гуглу😄 ), а в точную аудиторию (аля мультиплеер аи для разработчиков, мультиплеер аи для собесов, мультиплеер аи для музыкантов). Ну и как обычно написать не проблема, а раскрутить и продать - это именно то обо что все всегда спотыкаются?)
* Просто браузерный чат враппер, шарим линку и работаем в одном чате.
* Создатель чата загружает свой токен (openai, claude, gemini, храним секьюрно в браузере и передаем на бекенд), получается инфиренс за счет создателя чата.
* Возможность подгружать скилы/mcp/конфигурации из других своих агентов. Получаем быстрый онбординг своих рабочих инструментов и практик.
* Мультиплеерный чат, голосовое/видео прикрутить. Артифакты от аи доступны всем в чате. Так же все могут шарить свои файлы друг другу для работы.
* В идеале - плагины для codex, cc, opencode, чтобы не только браузер, а и в нативном агенте работать командой.
Профит - в командной работе над фичами. Например вместе с продукт менеджером и дизайнером работаем над SDD спеками. Или аля whiteboard для прохождения тех собесов (сейчас понемногу все переходят к тому, что аи юзать на собесах можно и нужно, а инструментов пока нет).
В целом вообще вырисовывается полноценная замена обычным митингам, интересно..
Как вам идея? Стоящая?)
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Продуктивного понедельника, коллеги! 👨🏻💻
Вот сайтик в закладки, Canvas эффекты для фронтенда. Если собираетесь делать какой-нибудь стильный нестандартный фронт для своих проектов - закиньте своему агенту.👍
https://canvasui.dev/
Вот сайтик в закладки, Canvas эффекты для фронтенда. Если собираетесь делать какой-нибудь стильный нестандартный фронт для своих проектов - закиньте своему агенту.
https://canvasui.dev/
Please open Telegram to view this post
VIEW IN TELEGRAM
Canvas UI
Canvas UI: Creative Canvas, WebGL and WebGPU Component Library
An open source component library of creative html-in-canvas effects for React, Solid, Preact, Vue, Svelte, and vanilla JS. Every effect ships as WebGL and WebGPU (via vgpu) builds, running over live HTML.
🔥1
Подтверждающее мнение, насчет настоящей инженерной культуры в китайских лабах.👍 Ну и важности девпосовых скилов в наши дни 😉
my spicy theory is that chinese ai labs keep winning because of culture, not talent or resources.
chinese labs still have a deeply hands-on engineering culture. deepseek and kimi are flat organizations where science and engineering are fused: the same people move between algorithms, data, and infra, doing whatever it takes to make the model work.
but sf tech bros have decided that “researcher” is the high-status title while infra is merely support work. every new sf ai startup calls itself a “lab,” every ambitious engineer quietly upgrades their title to “research engineer,” and the infra work is left to whoever failed to escape it.
but at frontier scale, infra determines experiment velocity, and experiment velocity determines research output. at frontier scale, infra **is** research.
X (formerly Twitter)
huaijiang (@huaijiangzhu) on X
my spicy theory is that chinese ai labs keep winning because of culture, not talent or resources.
chinese labs still have a deeply hands-on engineering culture. deepseek and kimi are flat organiz…
chinese labs still have a deeply hands-on engineering culture. deepseek and kimi are flat organiz…