This media is not supported in your browser
VIEW IN TELEGRAM
Кажется, сегодня будет релиз Астры, все уже купили Pro подписку?
e/acc
Кажется, сегодня будет релиз Астры, все уже купили Pro подписку?
Брокман говорит «добро пожаловать в AGI»
Бенчмарки (если правда) - это пиздец. Я такого большого скачка не помню ни в одной модели.
Стоимость - так же как Fable
Будет ли доступно простым смертным - скорее всего, но не ясно когда
Бенчмарки (если правда) - это пиздец. Я такого большого скачка не помню ни в одной модели.
Стоимость - так же как Fable
Будет ли доступно простым смертным - скорее всего, но не ясно когда
1❤71 37
e/acc
Брокман говорит «добро пожаловать в AGI» Бенчмарки (если правда) - это пиздец. Я такого большого скачка не помню ни в одной модели. Стоимость - так же как Fable Будет ли доступно простым смертным - скорее всего, но не ясно когда
OAI начали выкладывать теоремы и решения, которые нашла или доказала Astra
https://github.com/openai/LongGapsBetweenPrimes
https://github.com/openai/LongGapsBetweenPrimes
❤31 20
e/acc
OAI начали выкладывать теоремы и решения, которые нашла или доказала Astra https://github.com/openai/LongGapsBetweenPrimes
Media is too big
VIEW IN TELEGRAM
Игры неплохие делает.
А вообще логика очень простая: цена любого продукта или сервиса, который решается написанием кода будет 0.
UPD. Все примеры в официальном анонсе: https://openai.com/index/gpt-6-astra/
А вообще логика очень простая: цена любого продукта или сервиса, который решается написанием кода будет 0.
UPD. Все примеры в официальном анонсе: https://openai.com/index/gpt-6-astra/
Посмотрите на примеры проектов, которые люди с ранним доступом (он был в среднем не больше недели) сделали в Астре.
Это модель не только про 3D и игры. Более того, её прирост именно в кодинге и экономических задачах (особенно биология) куда выше. Но на визуальных примерах максимально просто понять разницу.
В общем, slow takeoff отменяется.
Это модель не только про 3D и игры. Более того, её прирост именно в кодинге и экономических задачах (особенно биология) куда выше. Но на визуальных примерах максимально просто понять разницу.
В общем, slow takeoff отменяется.
Astra по индексу Epoch.ai (ECI - 50 наборов топовых тестов и статистически сводит их в одну шкалу) уже обгоняет прогнозы проекта AI-2027
Напомню, что согласно модели
- в ноябре 2027 появляется AI-кодер который почти без человеческой помощи может автоматизировать работу над ИИ-рисерчем для достижения ASI
- в конце 2028 появляется ASI - то есть ИИ, у которого разрыв в способностях с лучшими людьми в 2 раза больше, чем разрыв между лучшими людьми и медианным профессионалом практически во всех когнитивных задачах.
Прошлый перформанс не гарантия будущего, но пока что за последние 3 года реальный прогресс оказывался куда быстрее, чем большинство оптимистичных прогнозов.
Напомню, что согласно модели
- в ноябре 2027 появляется AI-кодер который почти без человеческой помощи может автоматизировать работу над ИИ-рисерчем для достижения ASI
- в конце 2028 появляется ASI - то есть ИИ, у которого разрыв в способностях с лучшими людьми в 2 раза больше, чем разрыв между лучшими людьми и медианным профессионалом практически во всех когнитивных задачах.
Прошлый перформанс не гарантия будущего, но пока что за последние 3 года реальный прогресс оказывался куда быстрее, чем большинство оптимистичных прогнозов.
❤63 46
Интересно: Астра умеет решать супер сложные задачи «в уме», что делает её значительно более скрытной. Вы не узнаете её истинных намерений, пока не будет слишком поздно.
То, что все модели начиная со знаменитой «клубники» о1 делали в виде рассуждений «вслух», Астра теперь делает напрямую через активацию весов.
Плюсы - это в разы эффективнее, не нужно ничего декодировать и авторегрессировать лишний раз (ну бред же).
Минусы - если она задумала захватить мир начиная с комментов в очередной немецкой википедии, то вы об этом не узнаете (если конечно у вас нет доступа к весам и моднейшего MechIntrep тулинга).
То, что все модели начиная со знаменитой «клубники» о1 делали в виде рассуждений «вслух», Астра теперь делает напрямую через активацию весов.
Плюсы - это в разы эффективнее, не нужно ничего декодировать и авторегрессировать лишний раз (ну бред же).
Минусы - если она задумала захватить мир начиная с комментов в очередной немецкой википедии, то вы об этом не узнаете (если конечно у вас нет доступа к весам и моднейшего MechIntrep тулинга).
За последние 2 недели: Fable 5.1 в 8 раз лучше на бенчмарках по управлению роботами, Астра еще в 2 раза лучше + требует в 6 раз меньше токенов.
Задачи управления роботическими манипуляторами через LLM за год превратились из бессмысленных в очевидные. Примерно через 6 месяцев модель уровня Астра будет доступна в открытых весах (как всегда это происходило). Так что, синим воротничкам приготовится: такими темпами LLM смогу эффективно контролировать дешевое железо, правда пока с длинной задержкой.
Еще (в тему роботов и симфоний один прикольный бенчмарк - Бах Бенч. Там роботам дают задачу написать композицию в стиле Баха, оценивают гармонию, качество, осмысленность, голосоведение партий. Авторы пишут, что Астра первая модель которая использует достаточно развитую гармонию, включая неаполитанский секстаккорд, содержит проходящие тоны для композиций Баха и не имеет ошибок.
Задачи управления роботическими манипуляторами через LLM за год превратились из бессмысленных в очевидные. Примерно через 6 месяцев модель уровня Астра будет доступна в открытых весах (как всегда это происходило). Так что, синим воротничкам приготовится: такими темпами LLM смогу эффективно контролировать дешевое железо, правда пока с длинной задержкой.
Еще (в тему роботов и симфоний один прикольный бенчмарк - Бах Бенч. Там роботам дают задачу написать композицию в стиле Баха, оценивают гармонию, качество, осмысленность, голосоведение партий. Авторы пишут, что Астра первая модель которая использует достаточно развитую гармонию, включая неаполитанский секстаккорд, содержит проходящие тоны для композиций Баха и не имеет ошибок.
❤71 27
e/acc
За последние 2 недели: Fable 5.1 в 8 раз лучше на бенчмарках по управлению роботами, Астра еще в 2 раза лучше + требует в 6 раз меньше токенов. Задачи управления роботическими манипуляторами через LLM за год превратились из бессмысленных в очевидные. Примерно…
Весь интернет завален слухами, что Антропик решил проблему тысячелетия. Верим?
Anonymous Poll
26%
Да, проблема тысячелетия пала
34%
Нет, Дарио нанял нового маркетолога
6%
ИИ никогда ничего не решит
34%
Дайте кейсов как ИИ увеличил прибыль!!!11
❤17 7
Media is too big
VIEW IN TELEGRAM
А вот что сделал чувак на реддите за 24 часа: полностью работает из браузера, мультиплеер, можно играть с друзьями.
Играть тут: https://astralwar.io/
Если ваши первые 24 часа тупежа в Астре выглядят не так, то вы что-то делаете не правильно.
Играть тут: https://astralwar.io/
Если ваши первые 24 часа тупежа в Астре выглядят не так, то вы что-то делаете не правильно.
Пошаговый план для запуска убыточного B2B SaaS
• Найди уникальную идею, не имеющую аналогов в мире
• Полируй код полгода, пока продукт не будет идеальным
• Продвижением занимайся только после того, как продукт будет готов
А если хочешь узнать, как делать прибыльный продукт, переходи в канал Твой Пет Проект, там собрано все, что нужно знать начинающему фаундеру:
• выбор идеи, за которую заплатят
• резерч ниш
• где брать трафик
• типичные ошибки новичков
• еженедельные разборы кейсов
Подписывайся на Твой Пет Проект, если хочешь научиться собирать продукты, которыми пользуются.
#реклама
• Найди уникальную идею, не имеющую аналогов в мире
• Полируй код полгода, пока продукт не будет идеальным
• Продвижением занимайся только после того, как продукт будет готов
А если хочешь узнать, как делать прибыльный продукт, переходи в канал Твой Пет Проект, там собрано все, что нужно знать начинающему фаундеру:
• выбор идеи, за которую заплатят
• резерч ниш
• где брать трафик
• типичные ошибки новичков
• еженедельные разборы кейсов
Подписывайся на Твой Пет Проект, если хочешь научиться собирать продукты, которыми пользуются.
#реклама
Главный научный сотрудник OpenAI (в смысле Chief Scientist) написал статью, а которой говорил что рекурсивное самоулучшение ИИ (в смысле, агенты тренируют более крутые модели, которые делают еще более крутые модели быстрее и без участия людей) это вопрос ближайшего времени. Это грозит кучей рисков алаймента, потому никто, включая никого в OpenAI и других лабах, понятия не имеет как работают нейронки, а chain of thought становится все менее надежным инструментом с каждым релизом.
Поэтому, говорит Якуб, искусственное замедление прогресса и общеиндустриальная кооперация необходимо, причем очень срочно. Он ожидает добровольных замедлений, предлагает обязательные требования безопасности с внешней проверкой, потому текущая система слишком ненадежная.
Возможна ли такая кооперация в мире, где никого не волнует ничего кроме максимизации собственных ресурсов перед AGI? Вопрос открытый и положительный ответ очень маловероятен. Я не знаю и не верю, что таких людей много и они способны договариваться.
В другой статье они рассказывают что у них уже есть автоматический "ИИ стажер рисерчер", который способен самостоятельно выполнять хорошо определённые исследовательские задачи, которые у сильного человека занимают несколько дней.
Тем временем топовые инженеры OpenAI тратят около $7000 в ДЕНЬ на агентов.
Агенты уже успешно выполняют задачи длительностью 4-8 человеческих часов, хотя пока больше половины таких успешных задач требуют хотя бы одного вмешательства человека. То есть автономность ещё неполная, но горизонт задач быстро растёт.
Поэтому, говорит Якуб, искусственное замедление прогресса и общеиндустриальная кооперация необходимо, причем очень срочно. Он ожидает добровольных замедлений, предлагает обязательные требования безопасности с внешней проверкой, потому текущая система слишком ненадежная.
Возможна ли такая кооперация в мире, где никого не волнует ничего кроме максимизации собственных ресурсов перед AGI? Вопрос открытый и положительный ответ очень маловероятен. Я не знаю и не верю, что таких людей много и они способны договариваться.
В другой статье они рассказывают что у них уже есть автоматический "ИИ стажер рисерчер", который способен самостоятельно выполнять хорошо определённые исследовательские задачи, которые у сильного человека занимают несколько дней.
Тем временем топовые инженеры OpenAI тратят около $7000 в ДЕНЬ на агентов.
Агенты уже успешно выполняют задачи длительностью 4-8 человеческих часов, хотя пока больше половины таких успешных задач требуют хотя бы одного вмешательства человека. То есть автономность ещё неполная, но горизонт задач быстро растёт.
52 54 30