ШІ історії
11K subscribers
1.96K photos
756 videos
3 files
1.62K links
Власні думки та ШІ-історії.

Практика, готові інструкції, AI-брифи й щомісячні живі сесії:
https://imatrof.com/?utm_source=telegram&utm_medium=profile&utm_campaign=evergreen&utm_content=paid_cta

Чат: t.me/+-dzV2FhGiy4wMTky

Співпраця: t.me/imatrof
Download Telegram
⚡️ Google випустила Gemini 3.7 Flash лише через три тижні після 3.6 Flash.

DeepSWE виріс з 49% до 65,3%, а AutomationBench — з 17% до 30,4%. При цьому модель стала вдвічі дешевшою.

А ще 3.7 Flash відсьогодні працює всередині Gemini Spark.

Але уважно читайте те, що написано маленькими буквами внизу прес-релізу 😏

imatrof.com | youtube
👍4012😁3🔥1
Великі мовні моделі вже стали частиною реальних продуктів, але питання їхньої поведінки та безпеки залишаються відкритими. Чому LLM демонструють небажану поведінку та чи можна навчити їх «забувати» інформацію?

Саме про це поговоримо на “Align, Forget, Repeat” — технічному мітапі від AI HOUSE для тих, хто працює з LLM, досліджує AI Alignment, Machine Unlearning та сучасні виклики AI Safety.

🎤 Спікерки:
— Марія Королюк, Research Fellow у LASR Labs
— Вікторія Маковська, Research Engineer у Lapa LLM, PhD-дослідниця УКУ

▪️ Дата: 20 серпня, 18:00.
▪️ Місце: Львів, офлайн.
▪️ Вартість: донат від 500 грн на БО «Реактивна Пошта».
▪️ Кількість місць — обмежена.

Якщо ви працюєте з LLM, GenAI або цікавитеся сучасними дослідженнями AI Safety — це можливість почути про актуальні наукові підходи, поставити запитання дослідницям і поспілкуватися з AI-спільнотою.

Реєструйтеся за посиланням.

#партнерський_допис

imatrof.com | youtube
9👍5👀2
🏄‍♀️ OpenAI тестує Chronicle — експериментальну функцію, яка дає Codex пам’ять про все, що ви робили за комп’ютером. Навіть коли ходили на заборонені сайти.

І тут цікава не сам пам’ять. Вона лише зберігає контекст між сесіями. Значно цікавіше, звідки Chronicle цей контекст бере.

Наприклад, ви відкривали потрібний файл, читали обговорення у Slack, працювали з Google Docs, дивилися сайти в браузері або перевіряли зміни в коді. Це все Chronicle може використати як контекст.

Як це працює технічно? Chronicle періодично запускає окрему сесію Codex, передає їй вибрані знімки екрана, розпізнаний із них текст та релевантні файли. Після цього Codex створює локальні Markdown-файли пам’яті.

Тобто раніше контекст ми переважно передавали агенту самі. А тепер з цим підходом агент може взяти контекст з історії роботи.

Але є питання приватності.

Chronicle потребує дозволу на запис екрана та спеціальні можливості macOS. Знімки екрана тимчасово зберігаються локально, а для створення пам’яті обробляються на серверах OpenAI. Компанія пише, що після обробки не зберігає їх на своїх серверах і не використовує для навчання моделей. Але як воно там насправді…

А от сама створена пам’ять зберігається локально без шифрування. Прям на вашому компʼютері.

Зараз задача не розширити контекстне вікно і все туди запхати, задача запхати те що саме потрібно мати агенту в момент роботи.

ші історії | 🔒 ші історії. майстерня
5💩3412😁8👌4🤡1
Схоже, наступні великі змагання в AI вже будуть не тільки між моделями, а й між агентними системами (harness).

DeepSeek викотили DeepSeek Harness⁠ для розробників і одразу відкрили код під ліцензією MIT.

У чому головна ідея їхньої агентної системи? Майже все в системі є плагіном. Побудували це поверх Cordis. Якщо зовсім просто, Cordis — це каркас, який дозволяє збирати агентну систему як конструктор із незалежних деталей. Тобто DeepSeek не зашиває логіку агента намертво в один продукт, а робить її модульною.

Бо Claude Code, Codex, Cursor та інші рішення — це також про harness, але закритий. Ми не знаємо, який контекст отримує модель, які інструменти їй доступні, скільки разів вона звертається до моделі, як стискається історія, як запускаються підзадачі й коли агент вирішує продовжувати роботу.

Як ми знаємо з проходження ARC AGI 3 тесту GPT 5.6 моделлю, harness впливає не тільки на досягнення результату, а й на кількість витрачених токенів по дорозі.

Composio⁠ нещодавно порівняли кілька таких систем, і в їхньому тесті Claude Code виявився найбільш прожерливим.

Один тест, звісно, нічого не доводить. Але я останнім часом спостерігаю цікаву річ і у власній роботі. Модель у Claude Code я не змінював від моменту виходу Sonnet 5. Але кожен раз після оновлень самого Claude Code один і той самий нічний сценарій може зʼїдати 8–12% мого денного ліміту. При цьому сам сценарій кардинально не змінюється.

Тому я роблю ставку все-таки на harness. А реліз DeepSeek є цікавим саме тим, що можна подивитися зсередини, як працюють агентні системи.

ші історії | 🔒 ші історії. майстерня
3👍4726👌3😁1💯1
🤖 НЕДІЛЬНИЙ AI ЧЕКІН #95

А що у вас? Чим AI допоміг цього тижня, що цікавого накреативили та навайбали — діліться в коментарях 👇

#НедільнийAIчекін

ші історії | 🔒 ші історії. майстерня
🔥102
Forwarded from ᖇᗩᗰIᒪ
Хочу поділитися своїм новим проєктом — картою українського Telegram 🇺🇦
Я зібрав десятки тисяч українських Telegram-каналів і розмістив їх на інтерактивній карті. Канали згруповані за тематикою, а їхній розмір залежить від кількості підписників.
На карті можна:
досліджувати тематичні кластери;
знаходити конкретні канали через пошук;
фільтрувати їх за мовою та кількістю підписників;
окремо дивитися локальні канали на географічній карті України;
створювати власні добірки каналів.
Також кожен може допомогти наповнювати карту — якщо ви знаєте український Telegram-канал, якого на ній ще немає, його можна запропонувати для додавання.
Проєкт поки активно допрацьовується, тому буду радий, якщо протестуєте карту і напишете, що сподобалося, чого не вистачає або що варто виправити.
🌐 Карта тут:
https://daodemo.tech/
🎥 Детальніше про карту та як вона створювалася розповів у відео:
https://www.youtube.com/watch?v=2y0U8UXMvuU
🔥97👍3218👌1
AI пише код швидко. Але сьогодні вийшло добре, а завтра агент не дочитав контекст, пропустив тест і зробив не ту поведінку.

Проблема не в моделі. Проблема в тому, що навколо неї немає процесу.

20 серпня Кирило Сулімовський наживо проводить Безкоштовний воркшоп де покаже, як цей рандом замінити на послідовний workflow. За 3 години, на одному реальному продукті, від сирої ідеї до деплою.

Що розбираємо:
🟢 Карта рішень: чому агент додумує вимоги і як це зупинити до написання коду
🟢 Критерії приймання і пошук неоднозначностей: місця, де два розробники прочитають однаково, а зроблять по-різному
🟢 TDD з coding-агентом: маленький цикл, у якому агента видно на кожному кроці
🟢 Кілька агентних гілок без конфліктів: власники файлів, порти, міграції, порядок злиття
🟢 Чому «агент сказав, що готово» не означає готово: скріншот на кожен критерій, E2E, незалежне рев'ю, смоук-тест

Після воркшопу буде видно, де саме в твоєму процесі дірка: у постановці задачі, у тестах, у правилах для гілок чи у фінальній перевірці.

📅 20 серпня, четвер, 19:00 за Києвом
⏱️ 180 хвилин, online, українською
🎁 Безкоштовно + відкритий репозиторій зі скілами, агентами й ранбуком

Формат демо: Кирило будує, ти дивишся і розбираєш логіку кроків.
І в кінці буде QA-сесія - де розберуть ваші питання та кейси.

Деталі, наповнення і реєстрація 🔗

#партнерський_допис

ші історії | 🔒 ші історії. майстерня
👍237👎5👌2
Ну ви чули. Хто дивився останні AI Новини, пам’ятає, що навколо прихованих водяних знаків і Claude почалась окрема двіжуха.

І на противагу цьому почали з’являтись інструменти, які обіцяють ці водяні знаки прибирати. Питання тільки в тому, чи справді ці removers можуть прибрати саме знаки Claude?

Бо це ж не просто якийсь невидимий символ, який можна знайти й видалити. Механізм, який генерує токени (наступне слово), трохи змінює ймовірність вибору наступних токенів, а в результаті у всьому тексті виникає статистичний патерн. І такий патерн можна відслідковувати.

Але найбільш болісний момент стосується авторства та інтелектуальної власності. Що з цим робити? Бо навіть якщо ваші власні думки чи код (це типово для більшості випадків застосування) пройдуть через Claude, то на ньому вже залишиться позначка Claude. І як тепер довести, що цей текст/код було позначено як AI (і він залишається вашою власністю), а не створено з AI?

І це вже більше, ніж видалення водяних знаків.

ші історії | 🔒 ші історії. майстерня
👍40😁12🤔52😱2
This media is not supported in your browser
VIEW IN TELEGRAM
Ми хотіли випустити це швидше, але GitHub лежав.

Origin від Cursor тепер зберігає та робить версійність для вашого коду.

Якщо вчора GitHub → Cursor → агенти працюють з кодом → Pull Request назад у GitHub.

То сьогодні Cursor забирає на себе шар з репозиторієм коду.

При цьому GitHub нікуди не дівається. Синхронізація в обидві сторони залишається.

Але з таймінгом вони дуже вчасно 😁

ші історії | 🔒 ші історії. майстерня
😁206🤡2❤‍🔥1🔥1🤔1
Останній тиждень я майже не друкую в ChatGPT, а говорю з ним голосом. Мова йде про новий голосовий режим GPT Live (синю бульку). Яка тепер не просто озвучує текст, а й виконує дії та запускає інструкції.

У відео показую чотири сценарії зі свого дня. Коли використовую режим диктовки, а коли голос і з чого почати свою розмову з ChatGPT.

Повний огляд з інструкціями та готовими сценаріями - у закритій групі ШІ Історії. Майстерня

ші історії | youtube
36👍10💩3😁2
У OpenAI підігрівають інфо простір перед випуском нової моделі.

Вони прямо кажуть, що «прогрес моделей зараз настільки швидкий, що їхні можливості почали випереджати темп, з яким компанія встигає підтягувати безпеку, контроль і моніторинг».

Тому частину подальшого навчання поставили на паузу. При цьому найближчі релізи не скасовують. Тут скоріш за все мова йде про GPT 6.

А тим часом у Anthropic продовжили розширені тижневі ліміти ще на 2 тижні. Але з обчислювальними потужностями може бути туго. Тому ви тримайтеся.

ші історії | 🔒 ші історії. майстерня
👍425🥱3😱1
#донат

Свіже повітря, 7000 айтівців і благодійний пікнік 🧃
5 вересня DOU влаштовує найбільший невимушений нетворкінг в українському ІТ — DOU Day Picnic.

👉На вас чекають: велика сцена з топовими спікерами, стендап Васі Байдака, IT-Еліас від Ветеранів космічних військ, концерт, фудкорт, зони для чілу, майстерки, барахолка й десятки способів провести день без напрягів, познайомитись з людьми з індустрії та підтримати армію.

Приходьте з дітьми — для них буде окрема програма. Хвостиків теж беріть із собою: DOU Day Picnic — pet-friendly 🐶🐱

🎟️ Ловіть квиток, поки він за 1000 грн
Після 20 серпня донат за вхід зросте до 1500 грн
💸 100% вартості квитків перекажемо на наш збір бомбери VAMPIRE для «Хартії».

Купити квиток: https://dou.ua/goto/picnicdou

ші історії | 🔒 ші історії. майстерня
23🤣5😎32🤡1🙈1
Anthropic нарешті додали в Claude Code окремий режим. Не знаю як у вас, бо у мене останнім часом, Claude любить писати дипломні роботи там, де достатньо трьох речень для відповіді.

Увімкнути можна через /config → Output style → Concise.

І маємо менше шуму і більше змісту у відповідях. Це ніяк не позначиться на якості самої роботи моделі.

Борис Черні каже що це поки тимчасове рішення і вони вже працюють над більш стабільним підходом.

ші історії | 🔒 ші історії. майстерня
60👍34🔥6
Grok Bot — перший AI-агент від xAI і Cursor, який не вимагає ні технічних знань, ні окремого сервера — просто встановлюєш як звичайний застосунок і працюєш.

Долучайся до закритої спільноти - ШІ Історії. Майстерня. Там повний огляд по Grok Bot: https://imatrof.com

ші історії | youtube
👍2612🤔5💩1🤡1
Дав я Claude список учасників нашої ШІ-спільноти і попросив намалювати для кожного обличчя в стилі doodles. Імена він також задудлив.

А ось тут зробили окремий doodles head артефакт.

А тут ще більше прикладів що люди роблять з Claude.

Тепер маєте чим зайнятись у вечір пʼятниці 😉

ші історії | 🔒 ші історії. майстерня
😁33🤡16🌚9👍85💩3🥴3🔥2🗿2🤬1