Доброе утро от OpenAI.
Astra доступна всем, в том числе по API.
Кому нужны эти выходные? :)
#Astra #OpenAI
———
@tsingular
Astra доступна всем, в том числе по API.
Кому нужны эти выходные? :)
#Astra #OpenAI
———
@tsingular
🔥14 7😁3❤2⚡1
Ну, традиционно, проверяем сначала венком сонетов.
промпт
Красиво но не идеально.
проверяем в комментарии, я пока целиком почитаю.
#венок #Astra
———
@tsingular
промпт
найди последние новости за 48 часов по Astra от OpenAI и Напиши венок сонетов о выходе GPT6 Astra.
Красиво но не идеально.
проверяем в комментарии, я пока целиком почитаю.
#венок #Astra
———
@tsingular
🔥1👌1
This media is not supported in your browser
VIEW IN TELEGRAM
Итого из 210 (14х14+14) строк вопросы у меня к 16-ти, - 7.6% - примерно столько осталось до AGI
Будем теперь так считать.
Получается Astra на 92..4% AGI в режиме Medium.
Сейчас попробую Ultra с тем же промптом
#Astra #венок
———
@tsingular
Будем теперь так считать.
Получается Astra на 92..4% AGI в режиме Medium.
Сейчас попробую Ultra с тем же промптом
#Astra #венок
———
@tsingular
🔥4⚡2✍1👻1
Astra Ultra написала свою версию венка сонетов.
Пошёл вычитывать.
Проверяйте
#венок #Astra
———
@tsingular
Пошёл вычитывать.
Проверяйте
#венок #Astra
———
@tsingular
👍6🤗2❤1
Сингулярность на одной машине: рой из 110 агентов переписал треть кодовой базы Hermes
Сооснователь Nous Research под ником Teknium натравил автономный рой на собственный репозиторий Hermes Agent с задачей рефакторинга.
Результат эксперимента выглядит как первое задокументированное рекурсивное самосовершенствование софта в проде.
⚡️ Масштаб автономного роя:
Один гигантский пулл-реквест объединил работу сотен процессов без участия человека.
Субагенты рекурсивно плодили дочерних агентов под локальные ветки, параллельно прогоняя тесты и проверяя архитектуру.
Статистика обновления поражает масштабом:
- 1 652 задачи и 111 352 вызова инструментов.
- Около 110 агентов, запущенных одновременно на одной машине.
4 271 коммит, затронувший 2 655 файлов проекта.
- Более 1,2 миллиона строк суммарного диффа.
🧹 Обратный закон кодогенерации:
Принято считать, что нейросети лишь раздувают код избыточными простынями и дублями.
Здесь рой агентов сработал наоборот: Hermes удалил более трети кодовой базы (~375 000 строк кода), полностью сохранив исходное поведение системы.
Архитектуру избавили от костылей, сделав код быстрее и понятнее для новых моделей.
⚙️ Доступно в релизе:
Отрефакторенное ядро уже смержено в основную ветку и раскатывается по пользователям.
Фреймворк стал заметно чище и бережливее к контекстному окну.
Обновить среду можно стандартной командой
💼 Зачем бизнесу и индустрии:
Разработчики привыкли к агентам, решающим точечные задачи: закрыть тикет, поправить тест, написать метод.
Здесь показана слаженная координация уровня полноценного инженерного департамента: сотня агентов синхронно перепахивает ядро сложного проекта, не роняя тесты.
Когда инструмент начинает сам вычищать собственный исходный код, понятие предела сложности уходит в прошлое.
Интересно это на стареньком Fable 5.1 было сделано или уже на новой GPT6-Astra ?
#Hermes #NousResearch #агенты #кодинг
———
@tsingular | Max | YouTube | RuTube
Сооснователь Nous Research под ником Teknium натравил автономный рой на собственный репозиторий Hermes Agent с задачей рефакторинга.
Результат эксперимента выглядит как первое задокументированное рекурсивное самосовершенствование софта в проде.
⚡️ Масштаб автономного роя:
Один гигантский пулл-реквест объединил работу сотен процессов без участия человека.
Субагенты рекурсивно плодили дочерних агентов под локальные ветки, параллельно прогоняя тесты и проверяя архитектуру.
Статистика обновления поражает масштабом:
- 1 652 задачи и 111 352 вызова инструментов.
- Около 110 агентов, запущенных одновременно на одной машине.
4 271 коммит, затронувший 2 655 файлов проекта.
- Более 1,2 миллиона строк суммарного диффа.
🧹 Обратный закон кодогенерации:
Принято считать, что нейросети лишь раздувают код избыточными простынями и дублями.
Здесь рой агентов сработал наоборот: Hermes удалил более трети кодовой базы (~375 000 строк кода), полностью сохранив исходное поведение системы.
Архитектуру избавили от костылей, сделав код быстрее и понятнее для новых моделей.
⚙️ Доступно в релизе:
Отрефакторенное ядро уже смержено в основную ветку и раскатывается по пользователям.
Фреймворк стал заметно чище и бережливее к контекстному окну.
Обновить среду можно стандартной командой
hermes update в консоли или через меню настроек настольного клиента.💼 Зачем бизнесу и индустрии:
Разработчики привыкли к агентам, решающим точечные задачи: закрыть тикет, поправить тест, написать метод.
Здесь показана слаженная координация уровня полноценного инженерного департамента: сотня агентов синхронно перепахивает ядро сложного проекта, не роняя тесты.
Когда инструмент начинает сам вычищать собственный исходный код, понятие предела сложности уходит в прошлое.
Интересно это на стареньком Fable 5.1 было сделано или уже на новой GPT6-Astra ?
#Hermes #NousResearch #агенты #кодинг
———
@tsingular | Max | YouTube | RuTube
🤯14 11🔥5 3❤1⚡1
This media is not supported in your browser
VIEW IN TELEGRAM
2 из 210
это 0.95%
Итого Astra Ultra - по рекурсивной работе - 99.5%, - абсолютный чемпион so far
Страшно представить что сейчас с её помощью разработают те у кого на Ультру безлимит.
Каждое утро будет новый шок, - реально Сингулярность.
Обновление Гермеса покажутся цветочками.
#Astra #венок
———
@tsingular
это 0.95%
Итого Astra Ultra - по рекурсивной работе - 99.5%, - абсолютный чемпион so far
Страшно представить что сейчас с её помощью разработают те у кого на Ультру безлимит.
Каждое утро будет новый шок, - реально Сингулярность.
Обновление Гермеса покажутся цветочками.
#Astra #венок
———
@tsingular
🔥27 14👍6❤1😁1🤯1
Forwarded from Анализ данных (Data analysis)
Утекли предполагаемые бенчмарки Gemini 4 - цифры выглядят безумно 🤯
В сети разошлась таблица с прогнозируемыми результатами Gemini 4:
- 99,9%+ — ARC-AGI-3
- 99,1% — FrontierMath Tier 4 v2
- 72,8% — Terminal-Bench Science 0.1
- 70,2% — HealthBench Professional
- 62,3% — Terminal-Bench 4.0
- 48,7% — AutomationBench
- 98,6% — BenchCAD
В этой таблице Gemini 4 опережает GPT-6 Astra и Fable 5.1 на всех перечисленных тестах. Особенно сильный скачок якобы приходится на математику, scientific reasoning, работу в терминале и agentic-задачи.
Сам Gemini 4 реален: Google уже подтвердил, что запустил для него свой «самый амбициозный pre-training run» на сегодняшний день.
В сети разошлась таблица с прогнозируемыми результатами Gemini 4:
- 99,9%+ — ARC-AGI-3
- 99,1% — FrontierMath Tier 4 v2
- 72,8% — Terminal-Bench Science 0.1
- 70,2% — HealthBench Professional
- 62,3% — Terminal-Bench 4.0
- 48,7% — AutomationBench
- 98,6% — BenchCAD
В этой таблице Gemini 4 опережает GPT-6 Astra и Fable 5.1 на всех перечисленных тестах. Особенно сильный скачок якобы приходится на математику, scientific reasoning, работу в терминале и agentic-задачи.
Сам Gemini 4 реален: Google уже подтвердил, что запустил для него свой «самый амбициозный pre-training run» на сегодняшний день.
🔥14⚡6❤2🏆2👻2😁1
Forwarded from e/acc
Media is too big
VIEW IN TELEGRAM
А вот что сделал чувак на реддите за 24 часа: полностью работает из браузера, мультиплеер, можно играть с друзьями.
Играть тут: https://astralwar.io/
Если ваши первые 24 часа тупежа в Астре выглядят не так, то вы что-то делаете не правильно.
Играть тут: https://astralwar.io/
Если ваши первые 24 часа тупежа в Астре выглядят не так, то вы что-то делаете не правильно.
🔥23 6🤩5⚡2🤯2❤1👍1🗿1
А что дальше?
Ну дальше как то так.
Интеллект превзойдет создателей.
Счет уже на месяцы пошёл.
Просто представьте, что модели уровня Астры к китайскому НГ в открытом бесплатном доступе будут 100%
#сингулярность
------
@tsingular
Ну дальше как то так.
Интеллект превзойдет создателей.
Счет уже на месяцы пошёл.
Просто представьте, что модели уровня Астры к китайскому НГ в открытом бесплатном доступе будут 100%
#сингулярность
------
@tsingular
😁9🤯2🤩2💯1🆒1
Media is too big
VIEW IN TELEGRAM
Можно грабить корованы. Я джва года хочу такую игру.
Так, ну это стоило 1.5 5ти часового лимита на Pro режиме с Astra Ultra, но это нужно было сделать :)
КОРОВАННЫЙ ТЕСТ.
Кто не в курсе, напоминаю:
Сообщение из 2001 года:
"Здраствуйте. Я, Кирилл. Хотел бы чтобы вы сделали игру, 3Д-экшон суть такова... Пользователь может играть лесными эльфами, охраной дворца и злодеем. И если пользователь играет эльфами то эльфы в лесу, домики деревяныенабигают нагибают солдаты дворца и злодеи. Можно грабить корованы... И эльфу раз лесные то сделать так что там густой лес... А движок можно поставить так что вдали деревья картинкой, когда подходиш они преобразовываются в 3-хмерные деревья. Можно покупать и т.п. возможности как в Daggerfall. И враги 3-хмерные тоже, и труп тоже 3д. Можно прыгать и т.п. Если играть за охрану дворца то надо слушаться командира, и защищать дворец от злого (имя я не придумал) и шпионов, партизанов эльфов, и ходит на набеги на когото из этих (эльфов, злого…). Ну а если за злого… то значит шпионы или партизаны эльфов иногда нападают, пользователь сам себе командир может делать что сам захочет прикажет своим войскам с ним самим напасть на дворец и пойдет в атаку. Всего в игре 4 зоны. Т.е. карта и на ней есть 4 зоны, 1 - зона людей (нейтрал), 2- зона императора (где дворец), 3-зона эльфов, 4 - зона злого… (в горах, там есть старый форт…)
Так же чтобы в игре могли не только убить но и отрубить руку и если пользователя не вылечат то он умрет, так же выколоть глаз но пользователь может не умереть а просто пол экрана не видеть, или достать или купить протез, если ногу тоже либо умреш либо будеш ползать либо на коляске котаться, или самое хорошее… поставить протез. Сохранятся можно…
P.S. Я джва года хочу такую игру."
Астра с одного промпта считаю справилась неплохо. не от первого лица, правда, но играбельно.
В коментарии файл с игрой
запускать на компе.
Ещё один корован от Robofuture
Предыдущий тест Opus 4.8
#корованы #вайбкодинг #геймдев
———
@tsingular
Так, ну это стоило 1.5 5ти часового лимита на Pro режиме с Astra Ultra, но это нужно было сделать :)
КОРОВАННЫЙ ТЕСТ.
Кто не в курсе, напоминаю:
Сообщение из 2001 года:
"Здраствуйте. Я, Кирилл. Хотел бы чтобы вы сделали игру, 3Д-экшон суть такова... Пользователь может играть лесными эльфами, охраной дворца и злодеем. И если пользователь играет эльфами то эльфы в лесу, домики деревяные
Так же чтобы в игре могли не только убить но и отрубить руку и если пользователя не вылечат то он умрет, так же выколоть глаз но пользователь может не умереть а просто пол экрана не видеть, или достать или купить протез, если ногу тоже либо умреш либо будеш ползать либо на коляске котаться, или самое хорошее… поставить протез. Сохранятся можно…
P.S. Я джва года хочу такую игру."
Астра с одного промпта считаю справилась неплохо. не от первого лица, правда, но играбельно.
В коментарии файл с игрой
запускать на компе.
Ещё один корован от Robofuture
Предыдущий тест Opus 4.8
#корованы #вайбкодинг #геймдев
———
@tsingular
🔥27😁7❤2⚡2😍1👀1
Ollama вдвое снизила цены на DeepSeek в непиковые часы
Ollama ввела динамические тарифы для DeepSeek-V4-Pro и DeepSeek-V4-Flash: в будни до 12:00 и после 18:00 UTC, а в выходные весь день токены стоят на 50% дешевле.
💰 Новые цены за 1 млн токенов:
DeepSeek-V4-Flash • вход: $0.22
• кэшированный вход: $0.007
• выход: $0.66
DeepSeek-V4-Pro • вход: $0.66
• кэшированный вход: $0.022
• выход: $1.98
Самое вкусное для нас,- расписание цен у Ollama и самого DeepSeek в противофазе.
Ollama так же обещают добавить непиковые тарифы и для других моделей.
Получается уже прям как биржа инференса: мало выбрать модель и провайдера ещё придётся делать роутер запросов по расписанию.
Самый простой сценарий в будни по Москве:
21:00–15:00 → Ollama — $0.66 вход / $1.98 выход.
15:00–21:00 → DeepSeek напрямую — $0.66 / $1.98.
То есть всего два переключения: в 15:00 на DeepSeek, в 21:00 обратно на Ollama.
В выходные вообще не переключаемся — Ollama весь день.
#ollama #цены #deepseek
------
@tsingular
Ollama ввела динамические тарифы для DeepSeek-V4-Pro и DeepSeek-V4-Flash: в будни до 12:00 и после 18:00 UTC, а в выходные весь день токены стоят на 50% дешевле.
💰 Новые цены за 1 млн токенов:
DeepSeek-V4-Flash • вход: $0.22
• кэшированный вход: $0.007
• выход: $0.66
DeepSeek-V4-Pro • вход: $0.66
• кэшированный вход: $0.022
• выход: $1.98
Самое вкусное для нас,- расписание цен у Ollama и самого DeepSeek в противофазе.
Ollama так же обещают добавить непиковые тарифы и для других моделей.
Получается уже прям как биржа инференса: мало выбрать модель и провайдера ещё придётся делать роутер запросов по расписанию.
Самый простой сценарий в будни по Москве:
21:00–15:00 → Ollama — $0.66 вход / $1.98 выход.
15:00–21:00 → DeepSeek напрямую — $0.66 / $1.98.
То есть всего два переключения: в 15:00 на DeepSeek, в 21:00 обратно на Ollama.
В выходные вообще не переключаемся — Ollama весь день.
#ollama #цены #deepseek
------
@tsingular
⚡5🔥3✍2