e/acc
62.6K subscribers
1.06K photos
267 videos
8 files
1.44K links
Пишу про будущее: AI, web3, технологии и общество.

Автор: @sgershuni
Инвестирую: cyber.fund
Построил: Credentia, Deep Skills, Codex Town
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
Кажется, сегодня будет релиз Астры, все уже купили Pro подписку?
6119
Хороший повод протестить новую фичу в твиттере. А если серьезно, то интересно что там случилось. Не выглядит как обычный сбой в DNS.

Я бы поставил либо на какую-то координированную атаку (Китай или очередной сбежавший рой агентов), либо что-то в CDN типа Cloudflare.
289
e/acc
Кажется, сегодня будет релиз Астры, все уже купили Pro подписку?
Брокман говорит «добро пожаловать в AGI»

Бенчмарки (если правда) - это пиздец. Я такого большого скачка не помню ни в одной модели.

Стоимость - так же как Fable

Будет ли доступно простым смертным - скорее всего, но не ясно когда
17137
e/acc
OAI начали выкладывать теоремы и решения, которые нашла или доказала Astra https://github.com/openai/LongGapsBetweenPrimes
Media is too big
VIEW IN TELEGRAM
Игры неплохие делает.

А вообще логика очень простая: цена любого продукта или сервиса, который решается написанием кода будет 0.

UPD. Все примеры в официальном анонсе: https://openai.com/index/gpt-6-astra/
6826
Астры сегодня не будет для всех, но готовьтесь к вот такому: таска выполняется 1-2 недели, стоимость за один промт $4-6К
17031
Посмотрите на примеры проектов, которые люди с ранним доступом (он был в среднем не больше недели) сделали в Астре.

Это модель не только про 3D и игры. Более того, её прирост именно в кодинге и экономических задачах (особенно биология) куда выше. Но на визуальных примерах максимально просто понять разницу.

В общем, slow takeoff отменяется.
6138
Astra по индексу Epoch.ai (ECI - 50 наборов топовых тестов и статистически сводит их в одну шкалу) уже обгоняет прогнозы проекта AI-2027

Напомню, что согласно модели

- в ноябре 2027 появляется AI-кодер который почти без человеческой помощи может автоматизировать работу над ИИ-рисерчем для достижения ASI

- в конце 2028 появляется ASI - то есть ИИ, у которого разрыв в способностях с лучшими людьми в 2 раза больше, чем разрыв между лучшими людьми и медианным профессионалом практически во всех когнитивных задачах.

Прошлый перформанс не гарантия будущего, но пока что за последние 3 года реальный прогресс оказывался куда быстрее, чем большинство оптимистичных прогнозов.
6346
Интересно: Астра умеет решать супер сложные задачи «в уме», что делает её значительно более скрытной. Вы не узнаете её истинных намерений, пока не будет слишком поздно.

То, что все модели начиная со знаменитой «клубники» о1 делали в виде рассуждений «вслух», Астра теперь делает напрямую через активацию весов.

Плюсы - это в разы эффективнее, не нужно ничего декодировать и авторегрессировать лишний раз (ну бред же).

Минусы - если она задумала захватить мир начиная с комментов в очередной немецкой википедии, то вы об этом не узнаете (если конечно у вас нет доступа к весам и моднейшего MechIntrep тулинга).
8750
За последние 2 недели: Fable 5.1 в 8 раз лучше на бенчмарках по управлению роботами, Астра еще в 2 раза лучше + требует в 6 раз меньше токенов.

Задачи управления роботическими манипуляторами через LLM за год превратились из бессмысленных в очевидные. Примерно через 6 месяцев модель уровня Астра будет доступна в открытых весах (как всегда это происходило). Так что, синим воротничкам приготовится: такими темпами LLM смогу эффективно контролировать дешевое железо, правда пока с длинной задержкой.

Еще (в тему роботов и симфоний один прикольный бенчмарк - Бах Бенч. Там роботам дают задачу написать композицию в стиле Баха, оценивают гармонию, качество, осмысленность, голосоведение партий. Авторы пишут, что Астра первая модель которая использует достаточно развитую гармонию, включая неаполитанский секстаккорд, содержит проходящие тоны для композиций Баха и не имеет ошибок.
7127
Media is too big
VIEW IN TELEGRAM
А вот что сделал чувак на реддите за 24 часа: полностью работает из браузера, мультиплеер, можно играть с друзьями.

Играть тут: https://astralwar.io/

Если ваши первые 24 часа тупежа в Астре выглядят не так, то вы что-то делаете не правильно.
6736
Дженсен поздравляет команду OpenAI с созданием AGI
114155
Пошаговый план для запуска убыточного B2B SaaS

• Найди уникальную идею, не имеющую аналогов в мире
• Полируй код полгода, пока продукт не будет идеальным
• Продвижением занимайся только после того, как продукт будет готов

А если хочешь узнать, как делать прибыльный продукт, переходи в канал Твой Пет Проект, там собрано все, что нужно знать начинающему фаундеру:

• выбор идеи, за которую заплатят
• резерч ниш
• где брать трафик
• типичные ошибки новичков
• еженедельные разборы кейсов

Подписывайся на Твой Пет Проект, если хочешь научиться собирать продукты, которыми пользуются.

#реклама
1716
Главный научный сотрудник OpenAI (в смысле Chief Scientist) написал статью, а которой говорил что рекурсивное самоулучшение ИИ (в смысле, агенты тренируют более крутые модели, которые делают еще более крутые модели быстрее и без участия людей) это вопрос ближайшего времени. Это грозит кучей рисков алаймента, потому никто, включая никого в OpenAI и других лабах, понятия не имеет как работают нейронки, а chain of thought становится все менее надежным инструментом с каждым релизом.

Поэтому, говорит Якуб, искусственное замедление прогресса и общеиндустриальная кооперация необходимо, причем очень срочно. Он ожидает добровольных замедлений, предлагает обязательные требования безопасности с внешней проверкой, потому текущая система слишком ненадежная.

Возможна ли такая кооперация в мире, где никого не волнует ничего кроме максимизации собственных ресурсов перед AGI? Вопрос открытый и положительный ответ очень маловероятен. Я не знаю и не верю, что таких людей много и они способны договариваться.

В другой статье они рассказывают что у них уже есть автоматический "ИИ стажер рисерчер", который способен самостоятельно выполнять хорошо определённые исследовательские задачи, которые у сильного человека занимают несколько дней.

Тем временем топовые инженеры OpenAI тратят около $7000 в ДЕНЬ на агентов.

Агенты уже успешно выполняют задачи длительностью 4-8 человеческих часов, хотя пока больше половины таких успешных задач требуют хотя бы одного вмешательства человека. То есть автономность ещё неполная, но горизонт задач быстро растёт.
525430