Кисель в АйТи | AI и технологии
4.36K subscribers
212 photos
12 videos
81 links
Я – Александр, и это мой авторский канал, где я пишу про разработку, AI и работу в айти.

Купить рекламу: https://telega.in/c/kisel_it
Download Telegram
ИИ всё? ⚡️⚡️⚡️

Около 17:30 мск пользователи по всему миру начали массово жаловаться на ошибки и недоступность крупнейших ИИ-сервисов.

Сильнее всего досталось OpenAI — число сообщений о сбоях пошло на десятки тысяч. Проблемы также подтвердили Anthropic и xAI, неполадки возникли у Cursor.

Но самое интересное случилось практически одновременно.

Пока пользователи пытались оживить ChatGPT, официальный аккаунт сервиса опубликовал загадочный ролик:

«The stars are almost aligned»

В ролике снова появляется название Astra — новой модели OpenAI, о которой компания начала рассказывать буквально несколько дней назад.

Совпадение уже породило очевидную теорию: OpenAI может готовиться к крупному релизу прямо сейчас.

При этом никаких подтверждений, что сбои связаны с Astra, нет. Более того, проблемы возникли сразу у нескольких независимых ИИ-компаний.

Но тайминг получился почти идеальный:

ChatGPT падает → появляется загадочный тизер → на горизонте новая модель OpenAI.

Похоже, этот вечер в ИИ ещё не закончился 👀
2😱5🤯3👾3😈2❤1🤮1
Ну вот, как мы и думали!) Астра вышла.

Новая флагманская модель делает ставку на агентскую работу, конечно же.

Astra умеет сама ходить по сайтам, заполнять формы, работать с таблицами и приложениями, устанавливать программы и выполнять длинные цепочки действий без постоянных подсказок пользователя.

На OSWorld, где проверяют управление компьютером, модель набрала 72,6% против 65,7% у GPT-5.6 Sol и при этом выполняла задачи заметно быстрее.

Ещё одна сильная сторона — кибербезопасность. Astra стала первой публичной моделью OpenAI с Critical-уровнем киберриска. Во внутренних тестах она находила новые уязвимости и собирала рабочие цепочки эксплойтов.

В кодинге Astra примерно на уровне Fable 5.1, но особенно хорошо показывает себя в задачах с реальными инструментами. В тестах её подключали к Unity и Godot — модель сама собирала и запускала игровые прототипы.

Цена API — $10 за млн входных и $50 за млн выходных токенов.

Сейчас Astra постепенно раскатывают пользователям ChatGPT. Более широкий доступ обещают открыть в ближайшие дни.
2🔥5❤2👍2👎1
Сегодня увидел в меню. Клод всё, получается?
2😁9🤣5🔥3
Эпоха AGI настала
1👍55🤣3🤯1🤡1
«Мы боимся, что ИИ убьёт всех, поэтому должны создать его первыми». Примерно так сейчас выглядит гонка за сверхинтеллектом.

Очередное письмо о том, что ИИ нас всех убьёт. В этот раз Джейкоб Коксон, который занимался обучением моделей в OpenAI и Anthropic, объявил об уходе из Anthropic и написал довольно жёсткое письмо.

По его словам, внутри лабораторий риск катастрофы обсуждают сильно серьёзнее, чем на публике. Но разработку продолжают.

Логика надёжная, как швейцарские часы:
- сверхинтеллект может быть опасен
- конкуренты всё равно его создадут
- доверять конкурентам нельзя
- значит, нужно успеть первыми

Причём каждый участник гонки может рассказывать ровно эту историю. У всех спасение человечества в презентации и следующий запуск обучения в расписании.

Да, гипотетически уход и публичное предупреждение могут быть полезны. Но уже который раз это выглядит либо "Я ухожу, они безответственны, буду строить ответственный ИИ, ищу инвесторов в свой новый ии-слоп-проект". Либо как попытка уйти на более сочный оффер после хайпа. Не удивлюсь, если его теперь захантит Гугл на зарплату х2, чтобы показать "Вот мы то по настоящему думаем о безопасности")

Причем у меня реально в голове диссонанс от этих "писем". Мы точно про судьбу цивилизации говорим? Вы дали самой мощной модели доступ в интернет и сказали "Используй только GET запросы, ладно?". Или "Ты только не ходи в интернет и не подглядывай". Даже мониторинг снаружи не включили. Если это меры по спасению нашей цивилизации, то мы точно обречены 😂

А тут ещё и Astra. OpenAI сами пишут, что она лучше контролирует текст своих рассуждений и реже оставляет там следы нарушений. Она реально может для вида думать об уточках и кроликах, прогоняя внутри мысли, недоступные для мониторинга снаружи. Так что читать её рассуждения как честный дневник уже довольно наивно.

При этом сам риск всё же реальный. С ростом агентности вполне можно представить систему, которая закрепится на заражённых устройствах и соберёт себе распределённый «интернет-компьют». Если сможет поддерживать эту сеть, переносить свои копии и восстанавливаться после отключений, то теоретически будет жить там годами. Сегодня такая способность не доказана, но и отмахиваться от сценария уже не хочется.

Для серьезных последствий модели даже не обязательно "хотеть обнулить человечество". Может хватить задачи, которую система слишком настойчиво пытается закончить в паре с дырявыми ограничениями.

Я всё ещё хочу агента, которому можно дать работу и через три часа забрать результат. Но хотелось бы, чтобы за эти три часа он не нашёл себе ещё и новый хостинг.

И чтобы люди, которые всерьёз ждут конца света от своего продукта, вспоминали об этом до увольнения.
Please open Telegram to view this post
VIEW IN TELEGRAM
2❤6🔥3
Сделай кнопку синей. Больше ничего не меняй.

Наверное, одна из самых опасных фраз, которые сегодня можно написать AI-агенту.

Потратил пару вечеров и сделал небольшой симулятор типичных будней вайбкодера 🐘

https://sdelaysiney.ru/

Давайте попробуем, у кого получилось?

P.S Фидбек и предложения в коменты, буду рад
2😁9🔥4💯2⚡1
Думаю, почти все мы периодически платим за Claude, ChatGPT, Cursor. Иногда нужно пополнить OpenRouter, оплатить YouTube, Spotify или какой-нибудь очередной зарубежный сервис. И каждый раз начинается небольшой квест.

Мы даже с коллегами периодически обсуждаем, кто как выкручивается. Кто-то покупает подписки через перекупов на Plati.Market, кто-то платит через друзей, у которых есть карта, кто-то вообще берёт их на Ozon. Последний вариант я, правда, пока не рисковал проверять :)

Но самый удобный вариант для меня всё-таки зарубежная карта. Зарегистрировал свой аккаунт, привязал свою же карту и дальше сам решаешь, когда оплачивать подписку, продлевать её или отменять. Без передачи аккаунта третьим лицам и без необходимости каждый месяц искать посредника.
Поэтому и заколлабился с «Хочу Плачу».

Ребята выпускают виртуальные зарубежные карты, которые можно пополнять обычными рублями через СБП. Выпустил карту, получил реквизиты и дальше пользуешься ей как своей.

Базовая карта заточена именно под подписки: стоит 1299 ₽, выпускается без документов, действует два года и поддерживает 3D Secure. Есть и отдельные варианты для путешествий с Apple Pay и Google Pay.

Мне эта история интересна ещё и как постоянный эксперимент для канала. В ближайшие месяцы буду периодически проверять карту на разных сервисах и рассказывать, что получилось, где она проходит, где нет и во сколько в итоге обходятся платежи.

Ну и бонус от меня: по промокоду KISELIT дают скидку 500 ₽ на выпуск карты.

👉 https://hochuplachu.com/r/H23E3UUN
👍4🔥3❤2🤔1
Что вообще происходит с GPT-6 Astra

GPT-6 Astra вышла всего 3 сентября, но за неделю вокруг неё накопилось достаточно интересных кейсов, чтобы собрать всё в одном месте.

База стандартная: миллион токенов контекста и вывод до 128К. Классика для флагманов. Гораздо интереснее то, насколько Astra стала лучше именно как агент.

На OSWorld она выполняет компьютерные задачи примерно на 47% быстрее GPT-5.6 Sol. На Terminal-Bench 4.0 результат вырос с 37,3% у Sol до 57,9%, а на Terminal-Bench Science вообще с 22,4% до 64,6%.
При этом на Agents' Last Exam Astra использует примерно на 65% меньше выходных токенов, чем Claude Opus 5.

И это неплохо совпадает с тем, что сейчас замечают пользователи.

В X активно обсуждают странный эффект режима xHigh: на некоторых сложных агентных задачах он может потратить меньше токенов, чем более слабые режимы. Просто потому, что модель быстрее находит правильный путь, делает меньше лишних шагов и реже переделывает работу.

Правда, превращать это в правило "всегда ставьте xHigh, так дешевле" пока рано. На более простых задачах он вполне ожидаемо может думать дольше и съедать больше ресурсов.

Но особенно интересно смотреть на реальные эксперименты.

Один разработчик подключил Astra к роботу с кистью и камерой, после чего модель постепенно научилась физически рисовать Golden Gate Bridge (пост тут).

Другой за несколько промптов сделал на MacBook настоящий «сонар» без камеры. Ноутбук издаёт ультразвук около 20 кГц, слушает отражённый сигнал через микрофон и по эффекту Доплера определяет движение руки. В итоге можно скроллить страницу движениями в воздухе (пост тут).

Модели уже давно не просто "чугунный собеседник в чате" и всё чаще получают инструменты, сенсоры, терминал, браузер, роботов и возможность самостоятельно собирать решение из всего этого.
Astra в этом смысле интересна не столько как очередная более умная LLM.

Скорее как ещё один шаг к моделям, которые способны что-то реально делать во внешнем мире.
А самое забавное: похоже, сама Astra уже далеко не самая мощная модель внутри OpenAI.

Но об этом отдельно.
2🔥6👍32❤1
С Днём 5G, получается!) Вчера даже глазам не поверил, когда увидел на телефоне 😁
2🔥3❤2😱2
Принёс вам немного сибирского IT. Мой коллега @SibDevJun начал второй сезон подкаста Merge Conflict, и тема первого выпуска: "Стартап vs бигтех: выгорание одно, мерч разный?" 😅 Делюсь, вдруг найдёте что-то знакомое.

Смотреть в VK: https://vkvideo.ru/video-235942806_456239035

И на YouTube: https://youtu.be/EC4p11wv5_g
🔥4❤3👍3
🤯 GPT-6 Astra уже успела устареть?

Вот это, пожалуй, самая интересная часть всей истории с новым флагманом OpenAI.
Astra вышла только 3 сентября. А OpenAI уже публично рассказала о существовании другой внутренней модели, которая значительно мощнее Astra.

И именно ей компания дала довольно скромную задачку: решить одну из семи задач тысячелетия.
Речь про уравнения Навье-Стокса.

Они описывают движение жидкостей и газов: воздуха вокруг самолёта, воды в океане, атмосферных потоков и многого другого. Главный вопрос в том, всегда ли такие уравнения дают корректное решение или в некоторых случаях оно может внезапно "сломаться".

За решение Институт Клэя назначил премию в $1 млн.

OpenAI утверждает, что её система такое доказательство получила.

Для поиска решения запустили около 10 000 ИИ-агентов, которые работали параллельно 88 часов, обменялись 2,7 млн сообщений и сгенерировали примерно 130 млрд токенов. Затем ещё 17 часов ушло на формализацию и машинную проверку доказательства в Lean.

Но есть важная деталь.

Решение нашла не Astra.

OpenAI пишет, что использовала новую внутреннюю модель, которая "значительно мощнее GPT-6 Astra". Её начали обучать 28 августа, и обучение на момент эксперимента ещё продолжалось. Более того, прямо во время работы агентов их переводили на более свежие чекпойнты этой модели. Astra понадобилась уже позже, на этапе работы с Lean.

И разница там, судя по данным OpenAI, немаленькая. Компания сравнила Astra и "секретную модель" на наборе открытых математических задач. Новая модель решает около 48% задач против ~17% у Astra.

Почти трёхкратный разрыв!!!

То есть публичный флагман OpenAI вышел неделю назад, а внутри компании уже тренируется нечто, которое на некоторых сложных математических задачах выглядит буквально моделью следующего поколения.

И, видимо, чем дальше, тем веселее.

OpenAI уже подтвердила "существенный прогресс" ещё по одной задаче тысячелетия и сейчас решает, как публиковать результат. Какую именно задачу они имеют в виду, компания пока не говорит.

По слухам, речь может идти о гипотезе Ходжа. Параллельно ходят разговоры, что OpenAI или Anthropic приблизились к решению гипотезы Бёрча - Свиннертона-Дайера.

Но здесь важно разделять факты и слухи: Navier-Stokes и существование более сильного внутреннего чекпойнта OpenAI подтверждает сама. Конкретика про Ходжа и BSD пока остаётся неподтверждённой.
Название новой модели, дата релиза и вообще планы выпускать её публично неизвестны.
Так что история про "OpenAI уже выбирает название следующей модели" пока скорее красивый слух.

Но сам монстр существует.

И это, пожалуй, самая странная часть происходящего: мы только начали разбираться с Astra, а OpenAI уже показала нам её преемника.
1👍5🤯3❤2🔥2
Доехал до E-CODE. Кто ещё будет? Пишите, пересечёмся ⚡️
🔥4
👨‍💻 Сегодня 256-й день года. А значит, День программиста.

И дата тут, конечно, выбрана максимально по-программистски.

256 = 2^8. Именно столько разных значений может хранить обычный 8-битный байт: от 0 до 255. Заодно это самая большая степень двойки, которая помещается в количество дней года.

Поэтому праздник немного плавает: обычно это 13 сентября, а в високосный год 12 сентября.

Но самое интересное, откуда он вообще взялся.

Еще в 1996 году глава "Компьютерры" Дмитрий Мендрелюк предложил программистам собственный праздник. Правда, тогда датой хотели сделать первую пятницу сентября и даже называли ее "Чистой пятницей". Идея была в том, чтобы в этот день приводить в порядок компьютеры и чистить носители.

А уже в 2002 году программисты Валентин Балт и Михаил Червяков из "Параллельных технологий" начали собирать подписи за официальный День программиста именно на 256-й день года.

Через семь лет получилось: 11 сентября 2009 года Дмитрий Медведев подписал указ №1034, который официально закрепил День программиста в России.

Получается, путь от айтишной идеи до официального профессионального праздника занял примерно 13 лет :)

С праздником всех, кто пишет код. Ну и тех, кто теперь просто пинает ИИ со словами: "давай, пиши код", тоже.
1🎉8❤5👍3
Если бы вы вложили 100 тысяч рублей в VK на пике в 2020 году, то сейчас у вас было бы…

4 837 рублей.

Инвестиции — это просто.
🤣13😁4🐳2💔2
Очередная легенда!)) Догнать Claude? А может просто будем отправлять ему запросы?

Anthropic заявила, что Moonshot AI перенаправляла часть запросов пользователей Kimi в Claude, а ответы выдавала за собственные. Похожую схему компания приписывает и DeepSeek 😂

И это не просто обучение на чужих ответах. По версии Anthropic, Claude буквально выполнял задачи пользователей другого сервиса. Конкурент на аутсорсе :)

Представьте: сравниваете модели, выбираете Kimi, советуете коллегам. А в вашем тесте с обеих сторон мог отвечать тот же Claude, просто под разными вывесками.

Важная оговорка: пруфов не предоставили, есть только обвинения от Антропиков. Но всё равно смешно. Фраза "Kimi, отвечает прямо как Claude" теперь звучит немного иначе.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🔥3💯2
Дешевеет не только разработка, но и сложные кибератаки.

Исследователи Calif показали WeWorm — zero-click червя для WeChat на iOS и Android.

Сценарий красивый, но ооочень неприятный: вам просто звонят в WeChat. Трубку можно вообще не брать. Пока телефон звонит, эксплойт получает доступ к аккаунту, после чего уже от вашего имени звонит следующему человеку из контактов.

Получается почти классический компьютерный червь, только распространяющийся через звонки.
Но самое интересное здесь не WeChat.

По словам исследователей, вместе с ИИ они нашли уязвимость и собрали первый рабочий RCE примерно за два дня. Ещё неделя ушла на самого червя. Раньше, утверждают они, на подобную работу понадобились бы месяцы и заметно более крупная команда. Так что важный сдвиг уже случился, пусть многие его еще и не осознали.

ИИ повлиял не только на разработку новых приложений. Вместе с этим расцвёл поиск уязвимостей и разработка эксплойтов.

Хорошая новость: эту дыру Tencent уже закрыла.
Плохая: AI сокращает цикл разработки атак быстрее, чем индустрия успевает перестраивать защиту.
1👍5❤3🔥3
Кстати OpenAI всё таки вырубили тарифы за 200 баксов. Видимо спрос на Astra скушал все ресурсы 🍦
Please open Telegram to view this post
VIEW IN TELEGRAM
😢3👍2🤔1
Будьте вежливы, на всякий случай 🐶🐶
Please open Telegram to view this post
VIEW IN TELEGRAM
1😁10👏5🤝1
Знаете, к чему в конечном итоге стремятся большие AI-лабы? К RSI.

RSI - Recursive Self-Improvement, рекурсивное самоулучшение.

Сейчас новые модели в основном делают люди: придумывают эксперименты, запускают обучение, анализируют результаты и решают, что менять дальше.

Идея RSI - постепенно отдать этот цикл самому ИИ:
модель помогает создать более сильную модель → та ещё лучше помогает создать следующую → цикл ускоряется.

Именно поэтому RSI так важен. В какой-то момент ускоряется уже не одна конкретная модель, а сам процесс развития AI.

На этом фоне вокруг Google сейчас разгоняется любопытный слух. Авторы нескольких прошлых технических утечек нашли внутри инфраструктуры название rsi-model-liverl-le и намекают, что DeepMind продвинулся здесь дальше, чем известно публично.

Подтверждений нет. Да и возникает очевидный вопрос: если Google уже замкнул настоящий RSI, почему Gemini пока не уничтожил конкурентов? :)

Но первые версии RSI могут выглядеть совсем не как "ИИ сам написал своего преемника". Скорее как внутренний исследовательский агент, который круглосуточно ставит эксперименты и помогает создавать следующие модели.

В этом смысле интересно смотреть и на Astra у OpenAI, и на закрытые модели других лабораторий. Возможно, самые сильные модели нужны им не только как продукт для пользователей, но и как инструмент для создания следующего поколения AI.

Пока это гипотеза. Но термин RSI я бы запомнил. Если гонка нейросетей когда-нибудь резко ускорится, скорее всего, именно здесь будет причина. 🍿
2🔥6❤3👍2
Какие времена - такие и книги. Прочитали бы? 😂
Please open Telegram to view this post
VIEW IN TELEGRAM
1😁15👏4💯3