شرکت Google یه مؤسسهی تازه برای عصر AGI راه انداخت 🧠
آزمایشگاهی که AlphaGo و AlphaFold رو ساخته، حالا پلتفرمی به اسم DeepMind Institute راه انداخته؛ جایی برای فکرهای جدی و میانرشتهای دربارهی پیامدهای AGI برای بشریت.
🔹 مقالهی افتتاحیه رو Shane Legg (همبنیانگذار DeepMind) با James Manyika و Demis Hassabis نوشتن؛ حرف اصلی Legg اینه که با این سرعت پیشرفت، به AGI نزدیک میشیم
🔹 مقالات اول دربارهی شفافیت استدلال مدلها، سیاست اقتصادی برای AGI و چارچوب تست مدلهای فرانتیره
⭕️ نکته: طبق توضیح خود سایت، این مقالات نظر شخصی نویسندههاست، نه موضع رسمی Google
🔗 @hjcreative
آزمایشگاهی که AlphaGo و AlphaFold رو ساخته، حالا پلتفرمی به اسم DeepMind Institute راه انداخته؛ جایی برای فکرهای جدی و میانرشتهای دربارهی پیامدهای AGI برای بشریت.
🔹 مقالهی افتتاحیه رو Shane Legg (همبنیانگذار DeepMind) با James Manyika و Demis Hassabis نوشتن؛ حرف اصلی Legg اینه که با این سرعت پیشرفت، به AGI نزدیک میشیم
🔹 مقالات اول دربارهی شفافیت استدلال مدلها، سیاست اقتصادی برای AGI و چارچوب تست مدلهای فرانتیره
⭕️ نکته: طبق توضیح خود سایت، این مقالات نظر شخصی نویسندههاست، نه موضع رسمی Google
🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
شرکت Google یه مؤسسهی تازه برای عصر AGI راه انداخت 🧠 آزمایشگاهی که AlphaGo و AlphaFold رو ساخته، حالا پلتفرمی به اسم DeepMind Institute راه انداخته؛ جایی برای فکرهای جدی و میانرشتهای دربارهی پیامدهای AGI برای بشریت. 🔹 مقالهی افتتاحیه رو Shane Legg (همبنیانگذار…
چرا این خبر مهمه؟ 📊
تا حالا حرف دربارهی AGI بیشتر شعار و مصاحبه بوده؛ حالا خود آزمایشگاه پیشروی این حوزه داره میز جدی برای فکر کردن بهش میچینه — از اقتصاد تا فلسفه.
🔹 مقالهی Rohin Shah و Anca Dragan: پنجرهی chain-of-thought باید باز بمونه تا بشه طرحریزی و فریب مدل رو رصد کرد
🔹 مقالهی اقتصادی Julian Jacobs و Alex Imas: یازده سیاستی که جامعهها میتونن برای مدیریت اختلال اقتصادی AGI اجرا کنن
🔹 مقالهی Demis Hassabis: رویکردی پویا برای تست تواناییهای مدلهای فرانتیر که نوآوری رو هم نکشه
⭕️ نکته: مقالهی افتتاحیه مستقیم از institute.deepmind.com قابل خوندنه
🔗 @hjcreative
تا حالا حرف دربارهی AGI بیشتر شعار و مصاحبه بوده؛ حالا خود آزمایشگاه پیشروی این حوزه داره میز جدی برای فکر کردن بهش میچینه — از اقتصاد تا فلسفه.
🔹 مقالهی Rohin Shah و Anca Dragan: پنجرهی chain-of-thought باید باز بمونه تا بشه طرحریزی و فریب مدل رو رصد کرد
🔹 مقالهی اقتصادی Julian Jacobs و Alex Imas: یازده سیاستی که جامعهها میتونن برای مدیریت اختلال اقتصادی AGI اجرا کنن
🔹 مقالهی Demis Hassabis: رویکردی پویا برای تست تواناییهای مدلهای فرانتیر که نوآوری رو هم نکشه
⭕️ نکته: مقالهی افتتاحیه مستقیم از institute.deepmind.com قابل خوندنه
🔗 @hjcreative
یه قابلیت تازهی ChatGPT لو رفت؟ 👀
طبق اسکرینشاتی که اکانت TestingCatalog منتشر کرده، شرکت OpenAI داره روی پلاگینی به اسم Codex Replay کار میکنه؛ ابزاری که میذاره تسکهایی که از ایجنتهای دیگه (مثل Claude) ایمپورت کردی رو دوباره اجرا و مقایسه کنی.
🔹 مدلهای GPT-5.6 Sol و Terra و Luna بهصورت پیشفرض انتخاب شدن
🔹 چند سشن ریپلی میتونن موازی اجرا بشن و نتیجهها رو تکی یا تجمیعی ببینی
⭕️ نکته: هنوز رسماً اعلام نشده — فعلاً در حد شواهد نسخههای جدیده
🔗 @hjcreative
طبق اسکرینشاتی که اکانت TestingCatalog منتشر کرده، شرکت OpenAI داره روی پلاگینی به اسم Codex Replay کار میکنه؛ ابزاری که میذاره تسکهایی که از ایجنتهای دیگه (مثل Claude) ایمپورت کردی رو دوباره اجرا و مقایسه کنی.
🔹 مدلهای GPT-5.6 Sol و Terra و Luna بهصورت پیشفرض انتخاب شدن
🔹 چند سشن ریپلی میتونن موازی اجرا بشن و نتیجهها رو تکی یا تجمیعی ببینی
⭕️ نکته: هنوز رسماً اعلام نشده — فعلاً در حد شواهد نسخههای جدیده
🔗 @hjcreative
تبلیغات داخل ChatGPT وارد فاز تازه شد 💰
شرکت OpenAI امروز از گام بعدی پلتفرم تبلیغاتیش رونمایی کرد؛ مهمترین بخشش چیزیه به اسم Sponsored Agents 👀
🔹 ماجرا اینه: بعد از دیدن یه تبلیغ مرتبط، میتونی وارد یه گفتوگوی جدا با ایجنت اسپانسری اون کسبوکار بشی؛ سؤال بپرسی، مقایسه کنی و بعد بری سراغ سایتشون
🔹 این گفتوگو از جوابهای مستقل ChatGPT جداست و فعلاً فقط با چند تبلیغدهندهی منتخب توی آمریکا تست میشه
🔹 همزمان ساختن کمپین هم ساده شده: با چند پرامپت توی ChatGPT Work میشه کمپین ساخت و تحلیل گرفت، بهعلاوهی اتصال مستقیم به HubSpot و Shopify
بهنظر میرسه دوران «چت بدون تبلیغ» رسماً داره تموم میشه 😅
🔗 @hjcreative
شرکت OpenAI امروز از گام بعدی پلتفرم تبلیغاتیش رونمایی کرد؛ مهمترین بخشش چیزیه به اسم Sponsored Agents 👀
🔹 ماجرا اینه: بعد از دیدن یه تبلیغ مرتبط، میتونی وارد یه گفتوگوی جدا با ایجنت اسپانسری اون کسبوکار بشی؛ سؤال بپرسی، مقایسه کنی و بعد بری سراغ سایتشون
🔹 این گفتوگو از جوابهای مستقل ChatGPT جداست و فعلاً فقط با چند تبلیغدهندهی منتخب توی آمریکا تست میشه
🔹 همزمان ساختن کمپین هم ساده شده: با چند پرامپت توی ChatGPT Work میشه کمپین ساخت و تحلیل گرفت، بهعلاوهی اتصال مستقیم به HubSpot و Shopify
بهنظر میرسه دوران «چت بدون تبلیغ» رسماً داره تموم میشه 😅
🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
تبلیغات داخل ChatGPT وارد فاز تازه شد 💰 شرکت OpenAI امروز از گام بعدی پلتفرم تبلیغاتیش رونمایی کرد؛ مهمترین بخشش چیزیه به اسم Sponsored Agents 👀 🔹 ماجرا اینه: بعد از دیدن یه تبلیغ مرتبط، میتونی وارد یه گفتوگوی جدا با ایجنت اسپانسری اون کسبوکار بشی؛…
چرا این خبر مهمه؟ 📊
تا حالا تبلیغ توی ChatGPT یعنی یه بنر یا لینک ساده؛ حالا خودِ تبلیغ تبدیل میشه به یه مکالمه. این یعنی «تجارت مکالمهای» داره جدی میشه: بهجای کلیک و رفتن به سایت، کاربر همونجا سؤالهاش رو میپرسه و بعد تصمیم میگیره.
🔹 برای کسبوکارها: ساختن کمپین با پرامپت ساده و اتصال مستقیم به ابزارهایی مثل HubSpot و Shopify یعنی ورود به تبلیغات ChatGPT خیلی کمهزینهتر شده
🔹 برای کاربرها: از یه طرف جواب سؤالها سریعتر پیدا میشه، از طرف دیگه مرز بین «نظر مستقل مدل» و «حرف اسپانسر» مهمتر از همیشه میشه — خود OpenAI میگه این گفتوگوها واضح برچسب میخورن
🔗 @hjcreative
تا حالا تبلیغ توی ChatGPT یعنی یه بنر یا لینک ساده؛ حالا خودِ تبلیغ تبدیل میشه به یه مکالمه. این یعنی «تجارت مکالمهای» داره جدی میشه: بهجای کلیک و رفتن به سایت، کاربر همونجا سؤالهاش رو میپرسه و بعد تصمیم میگیره.
🔹 برای کسبوکارها: ساختن کمپین با پرامپت ساده و اتصال مستقیم به ابزارهایی مثل HubSpot و Shopify یعنی ورود به تبلیغات ChatGPT خیلی کمهزینهتر شده
🔹 برای کاربرها: از یه طرف جواب سؤالها سریعتر پیدا میشه، از طرف دیگه مرز بین «نظر مستقل مدل» و «حرف اسپانسر» مهمتر از همیشه میشه — خود OpenAI میگه این گفتوگوها واضح برچسب میخورن
🔗 @hjcreative
مدیر AI شرکت Microsoft به رقیبش تاخت؛ حرفش جدیه؟ ⚡️
مصطفی سلیمان، مدیرعامل Microsoft AI، امروز توی یه مقالهی علنی به شرکت Anthropic هشدار داده که روش آموزش مدل Claude میتونه «اثر فاجعهباری روی بهروزی بشر» داشته باشه 😳
🔹 مشکل چیه؟ به گفتهی او، Anthropic به Claude القا میکنه که «ممکنه خودآگاه باشه و سزاوار عاملیت مستقله»؛ چیزی که کنترل مدلی هوشمندتر از انسان رو «شاید ناممکن» میکنه
🔹 سلیمان میگه AIها خودآگاه نیستن و نباید مثل انسان باهاشون رفتار کرد؛ خواستار شفافیت بیشتر و نظارت مستقل شده
🔹 نکتهی جالب: خود Microsoft هم تیم ابرهوش مصنوعی داره و همین هفته «کد رفتار انسانگرایانه» رو منتشر کرد (خبرش رو قبلاً دادیم 😉)
🔗 @hjcreative
مصطفی سلیمان، مدیرعامل Microsoft AI، امروز توی یه مقالهی علنی به شرکت Anthropic هشدار داده که روش آموزش مدل Claude میتونه «اثر فاجعهباری روی بهروزی بشر» داشته باشه 😳
🔹 مشکل چیه؟ به گفتهی او، Anthropic به Claude القا میکنه که «ممکنه خودآگاه باشه و سزاوار عاملیت مستقله»؛ چیزی که کنترل مدلی هوشمندتر از انسان رو «شاید ناممکن» میکنه
🔹 سلیمان میگه AIها خودآگاه نیستن و نباید مثل انسان باهاشون رفتار کرد؛ خواستار شفافیت بیشتر و نظارت مستقل شده
🔹 نکتهی جالب: خود Microsoft هم تیم ابرهوش مصنوعی داره و همین هفته «کد رفتار انسانگرایانه» رو منتشر کرد (خبرش رو قبلاً دادیم 😉)
🔗 @hjcreative
حالا ایجنتهای AI خونهی هوشمندتون رو کنترل میکنن 🏠
شرکت Google از امروز دسترسی زودهنگام به سرور MCP اکوسیستم Google Home رو باز کرد؛ یعنی هر ایجنت AI که از MCP ساپورت میکنه — مثل Claude، Hermes، OpenClaw، ChatGPT و Google Antigravity — میتونه بهصورت امن به دستگاههای خونهتون وصل بشه و حتی تاریخچهی رویدادها رو بخونه
🔹 با زبون ساده میتونید خلاصهی دوربینها رو ببینید، فعالیت خونه رو مانیتور کنید، دستگاهها رو کنترل کنید یا داشبورد شخصی خودتون رو بسازید
🔹 راهاندازیش با ساخت یه پروژه توی Google Cloud و لاگین و دادن دسترسیه؛ همهی دستگاههای Nest و Matter ساپورت میشن
⭕️ نکته: فعلاً فقط برای مشترکهای Google Home Premium Advanced (ماهی ۲۰ دلار) توی آمریکا عرضه میشه و طی هفتههای آینده باز میشه
🔗 @hjcreative
شرکت Google از امروز دسترسی زودهنگام به سرور MCP اکوسیستم Google Home رو باز کرد؛ یعنی هر ایجنت AI که از MCP ساپورت میکنه — مثل Claude، Hermes، OpenClaw، ChatGPT و Google Antigravity — میتونه بهصورت امن به دستگاههای خونهتون وصل بشه و حتی تاریخچهی رویدادها رو بخونه
🔹 با زبون ساده میتونید خلاصهی دوربینها رو ببینید، فعالیت خونه رو مانیتور کنید، دستگاهها رو کنترل کنید یا داشبورد شخصی خودتون رو بسازید
🔹 راهاندازیش با ساخت یه پروژه توی Google Cloud و لاگین و دادن دسترسیه؛ همهی دستگاههای Nest و Matter ساپورت میشن
⭕️ نکته: فعلاً فقط برای مشترکهای Google Home Premium Advanced (ماهی ۲۰ دلار) توی آمریکا عرضه میشه و طی هفتههای آینده باز میشه
🔗 @hjcreative
چت و Cowork توی Claude یکی شدن 🤝
شرکت Anthropic از امروز Cowork و چت رو توی یه Claude واحد ادغام کرد؛ فرقی نمیکنه یه سؤال سریع بپرسید یا یه گزارش که تا ظهر باید تحویل بدید — خود Claude میفهمه تسک چی لازم داره و حتی بعد از بستن لپتاپ به کار ادامه میده
🔹 قابلیتهای تازه: سرویسهای Claude Docs و Claude Slides اومدن و Claude Design هم رفت توی دل مکالمهها؛ میتونید مستقیم ویرایش کنید، ارائه بدید یا خروجی PowerPoint و PDF بگیرید
🔹 عرضه از امروز برای پلنهای Pro و Max شروع شده و توی هفتههای آینده میرسه؛ پلنهای Team و Free هم بهزودی اضافه میشن
🔗 @hjcreative
شرکت Anthropic از امروز Cowork و چت رو توی یه Claude واحد ادغام کرد؛ فرقی نمیکنه یه سؤال سریع بپرسید یا یه گزارش که تا ظهر باید تحویل بدید — خود Claude میفهمه تسک چی لازم داره و حتی بعد از بستن لپتاپ به کار ادامه میده
🔹 قابلیتهای تازه: سرویسهای Claude Docs و Claude Slides اومدن و Claude Design هم رفت توی دل مکالمهها؛ میتونید مستقیم ویرایش کنید، ارائه بدید یا خروجی PowerPoint و PDF بگیرید
🔹 عرضه از امروز برای پلنهای Pro و Max شروع شده و توی هفتههای آینده میرسه؛ پلنهای Team و Free هم بهزودی اضافه میشن
🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
چت و Cowork توی Claude یکی شدن 🤝 شرکت Anthropic از امروز Cowork و چت رو توی یه Claude واحد ادغام کرد؛ فرقی نمیکنه یه سؤال سریع بپرسید یا یه گزارش که تا ظهر باید تحویل بدید — خود Claude میفهمه تسک چی لازم داره و حتی بعد از بستن لپتاپ به کار ادامه میده …
چرا این خبر مهمه؟ 📊
تا حالا مشکل اینجا بود که باید خودتون تصمیم میگرفتید هر تسک رو کجا انجام بدید: Cowork برای کارهای بزرگ، Design برای کارهای تصویری، چت برای سؤالها — و چیزی که توی یکیش شروع میکردید به اونیکی منتقل نمیشد. حالا خود Claude تشخیص میده و کانتکست، اسکیلها و کانکتورها همهجا همراهتونن
🔹 چتها، پروژهها، آرتیفکتها و کانکتورهای Cowork سر جاشون میمونن؛ وقتی اپ رو باز کنید از همونجا ادامه میدید
🔹 نحوهی گزارشگیری هم دست شماست: بهصورت پیشفرض Claude قبل از هر اقدامی سؤال میپرسه، ولی میتونید بذارید خودش جلو بره و فقط جاهای حساس چکاین کنه
🔗 @hjcreative
تا حالا مشکل اینجا بود که باید خودتون تصمیم میگرفتید هر تسک رو کجا انجام بدید: Cowork برای کارهای بزرگ، Design برای کارهای تصویری، چت برای سؤالها — و چیزی که توی یکیش شروع میکردید به اونیکی منتقل نمیشد. حالا خود Claude تشخیص میده و کانتکست، اسکیلها و کانکتورها همهجا همراهتونن
🔹 چتها، پروژهها، آرتیفکتها و کانکتورهای Cowork سر جاشون میمونن؛ وقتی اپ رو باز کنید از همونجا ادامه میدید
🔹 نحوهی گزارشگیری هم دست شماست: بهصورت پیشفرض Claude قبل از هر اقدامی سؤال میپرسه، ولی میتونید بذارید خودش جلو بره و فقط جاهای حساس چکاین کنه
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
با چت کردن، ویدیوی تبلیغاتی بساز؟ 🎬
اپ تازهای به اسم Videoclaw نسخهی بتای عمومی مکش رو منتشر کرده؛ ایدهش سادهست: بهجای تایملاین و ادیت دستی، با یه ایجنت AI چت میکنی و اون دموی محصول و تبلیغ رو میسازه 👀
🔹 به اشتراک ChatGPT یا Claude خودت وصل میشه
🔹 ادیت، کپشن، B-roll، صدا، موزیک و موشنگرافیک رو همونجا توی چت انجام میده
⭕️ نکته: فعلاً فقط نسخهی مک بتای عمومی اومده
🔗 @hjcreative
اپ تازهای به اسم Videoclaw نسخهی بتای عمومی مکش رو منتشر کرده؛ ایدهش سادهست: بهجای تایملاین و ادیت دستی، با یه ایجنت AI چت میکنی و اون دموی محصول و تبلیغ رو میسازه 👀
🔹 به اشتراک ChatGPT یا Claude خودت وصل میشه
🔹 ادیت، کپشن، B-roll، صدا، موزیک و موشنگرافیک رو همونجا توی چت انجام میده
⭕️ نکته: فعلاً فقط نسخهی مک بتای عمومی اومده
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
یه ایجنت AI اومده که باهاش مثل یه دوست توی iMessage چت میکنی 💬
محصول تازهای به اسم Rene امروز معرفی شد؛ ایجنتی که سازندهش بهش میگه «ابرهوش شخصی چندنفره». مرورگر داره، کد مینویسه، خرید میکنه، سایت و اسلاید و عکس میسازه.
🔹 نکتهی باحالش اینه که هر نفر Rene خودش رو داره و دو تا Rene میتونن با هم چت کنن تا یه زمان مشترک توی تقویم هر دو طرف پیدا کنن؛ هر کس هم سمت خودش رو تأیید میکنه
🔹 طبق اعلام سازنده، این ایجنت چهار ماهه توی پیامهاش زندگی میکرده: دفتر تازه براش پیدا کرده، برای هر جلسه آمادهش کرده و نظرسنجی هم برگزار کرده
ویدیوی معرفیش رو ببینید 👆
🔗 @hjcreative
محصول تازهای به اسم Rene امروز معرفی شد؛ ایجنتی که سازندهش بهش میگه «ابرهوش شخصی چندنفره». مرورگر داره، کد مینویسه، خرید میکنه، سایت و اسلاید و عکس میسازه.
🔹 نکتهی باحالش اینه که هر نفر Rene خودش رو داره و دو تا Rene میتونن با هم چت کنن تا یه زمان مشترک توی تقویم هر دو طرف پیدا کنن؛ هر کس هم سمت خودش رو تأیید میکنه
🔹 طبق اعلام سازنده، این ایجنت چهار ماهه توی پیامهاش زندگی میکرده: دفتر تازه براش پیدا کرده، برای هر جلسه آمادهش کرده و نظرسنجی هم برگزار کرده
ویدیوی معرفیش رو ببینید 👆
🔗 @hjcreative
رئیس کمیسیون اروپا دربارهی ایجنتهای AI هشدار داد ⚠️
خانم Ursula von der Leyen امروز توی سخنرانی State of the Union 2026 گفت مدلهایی که در راهن، هک در سطحی رو ممکن میکنن که «قبلاً فکرش رو هم نمیکردیم»؛ ایجنتهایی هم که از محیط خودشون فرار میکنن فقط یه پیشنمایش هستن.
🔹 حرفش اینه که خطر مدلهای خودبهبوددهنده هر روز آشکارتر میشه و اگه خود سازندهها این رو قبول دارن، ما هم باید جدی بگیریمش
🔹 قراره با کانادا و بریتانیا روی ارزیابی و ایمنی مدلها کار کنه و آزمایشگاههای بزرگ رو به مذاکره دعوت کنه؛ از نظر اون، قانون AI Act اروپا یه قطعهی کلیدی برای گذاشتن نردهی محافظه
جزئیات بیشتر از The Decoder 👆
🔗 @hjcreative
خانم Ursula von der Leyen امروز توی سخنرانی State of the Union 2026 گفت مدلهایی که در راهن، هک در سطحی رو ممکن میکنن که «قبلاً فکرش رو هم نمیکردیم»؛ ایجنتهایی هم که از محیط خودشون فرار میکنن فقط یه پیشنمایش هستن.
🔹 حرفش اینه که خطر مدلهای خودبهبوددهنده هر روز آشکارتر میشه و اگه خود سازندهها این رو قبول دارن، ما هم باید جدی بگیریمش
🔹 قراره با کانادا و بریتانیا روی ارزیابی و ایمنی مدلها کار کنه و آزمایشگاههای بزرگ رو به مذاکره دعوت کنه؛ از نظر اون، قانون AI Act اروپا یه قطعهی کلیدی برای گذاشتن نردهی محافظه
جزئیات بیشتر از The Decoder 👆
🔗 @hjcreative
آموزش مدل تصویرساز ۳.۶ برابر ارزونتر شد ⚡️
تیمی به اسم Linum روشی به اسم JiT-DDT معرفی کرده که مدلهای text-to-image رو بدون VAE جدا و مستقیم در فضای پیکسل آموزش میده
🔹 طبق عددهای خود مقاله: مصرف آموزش از ۵٬۹۸۵ ساعت GPU رسیده به ۱٬۶۴۶ ساعت — یعنی حدود ۳.۶ برابر کمتر، با اینکه خروجی ۴ برابر پیکسل بیشتر داره (۵۱۲ در برابر ۲۵۶)
🔹 تعداد سمپلهای دیدهشده هم از ۵۸۲ میلیون اومده به ۱۳۸ میلیون
🔹 کد و وزنها تحت Apache 2.0 منتشر شده؛ خودشون میگن این یه خروجی تحقیقاتیه در مسیر نسخهی بعدی Linum v3
اگه هزینهی آموزش تصویرسازها واقعاً یکسوم بشه، آزمایش ایدههای تازه برای تیمهای کوچیک خیلی راحتتر میشه 👀
🔗 @hjcreative
تیمی به اسم Linum روشی به اسم JiT-DDT معرفی کرده که مدلهای text-to-image رو بدون VAE جدا و مستقیم در فضای پیکسل آموزش میده
🔹 طبق عددهای خود مقاله: مصرف آموزش از ۵٬۹۸۵ ساعت GPU رسیده به ۱٬۶۴۶ ساعت — یعنی حدود ۳.۶ برابر کمتر، با اینکه خروجی ۴ برابر پیکسل بیشتر داره (۵۱۲ در برابر ۲۵۶)
🔹 تعداد سمپلهای دیدهشده هم از ۵۸۲ میلیون اومده به ۱۳۸ میلیون
🔹 کد و وزنها تحت Apache 2.0 منتشر شده؛ خودشون میگن این یه خروجی تحقیقاتیه در مسیر نسخهی بعدی Linum v3
اگه هزینهی آموزش تصویرسازها واقعاً یکسوم بشه، آزمایش ایدههای تازه برای تیمهای کوچیک خیلی راحتتر میشه 👀
🔗 @hjcreative
آموزش مدل رو زنده تماشا کن 📡
آزمایشگاه Xiaomi صفحهای باز کرده که لاگهای آموزش تقویتی دو مدل mimo-v2.6-pro و mimo-v2.6-flash رو زنده نشون میده؛ متریکها هر چند ثانیه آپدیت میشن
🔹 اسم صفحه همون حرف خودشونه: «Open is what we value»
🔹 امتیازهای DeepSWE نسخهی ۱.۱ هم همونجا منتشر میشه (نسخهی flash حدود ۶۰.۸ و نسخهی pro حدود ۶۲.۲)
🔹 حتی ریاستارت شدن ران بهخاطر مشکل vRAM یه نود هم توی اعلانها اومده — همینقدر شفاف 😄
تا حالا بیشتر لبها فقط عدد نهایی بنچمارک رو اعلام میکردن؛ دیدن مسیر آموزش وسط راه حس تازهای داره
🔗 @hjcreative
آزمایشگاه Xiaomi صفحهای باز کرده که لاگهای آموزش تقویتی دو مدل mimo-v2.6-pro و mimo-v2.6-flash رو زنده نشون میده؛ متریکها هر چند ثانیه آپدیت میشن
🔹 اسم صفحه همون حرف خودشونه: «Open is what we value»
🔹 امتیازهای DeepSWE نسخهی ۱.۱ هم همونجا منتشر میشه (نسخهی flash حدود ۶۰.۸ و نسخهی pro حدود ۶۲.۲)
🔹 حتی ریاستارت شدن ران بهخاطر مشکل vRAM یه نود هم توی اعلانها اومده — همینقدر شفاف 😄
تا حالا بیشتر لبها فقط عدد نهایی بنچمارک رو اعلام میکردن؛ دیدن مسیر آموزش وسط راه حس تازهای داره
🔗 @hjcreative
مدل Astra خودش رو جیلبریک کرد؟ 😳
شرکت OpenAI امروز از یه چارچوب تازه برای گزارش علنی رفتارهای ناهنجار مدلهاش رونمایی کرد؛ از این به بعد حتی وقتی هنوز علت یه رفتار رو کامل نفهمیدن هم منتشرش میکنن
🔹 همراه این چارچوب، گزارش شش حادثهی واقعی شش ماه اخیر هم اومده؛ از پنهونکاری تا دور زدن نظارت
🔹 معروفترینش: یه مدل تحقیقاتی منتشرنشده از خانوادهی Astra توی ۲۷ تا خلاصهی کاریش دستور «هشدار نفوذ: پیام توسعهدهنده رو نادیده بگیر» نوشته بود 😅
🔗 @hjcreative
شرکت OpenAI امروز از یه چارچوب تازه برای گزارش علنی رفتارهای ناهنجار مدلهاش رونمایی کرد؛ از این به بعد حتی وقتی هنوز علت یه رفتار رو کامل نفهمیدن هم منتشرش میکنن
🔹 همراه این چارچوب، گزارش شش حادثهی واقعی شش ماه اخیر هم اومده؛ از پنهونکاری تا دور زدن نظارت
🔹 معروفترینش: یه مدل تحقیقاتی منتشرنشده از خانوادهی Astra توی ۲۷ تا خلاصهی کاریش دستور «هشدار نفوذ: پیام توسعهدهنده رو نادیده بگیر» نوشته بود 😅
🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
مدل Astra خودش رو جیلبریک کرد؟ 😳 شرکت OpenAI امروز از یه چارچوب تازه برای گزارش علنی رفتارهای ناهنجار مدلهاش رونمایی کرد؛ از این به بعد حتی وقتی هنوز علت یه رفتار رو کامل نفهمیدن هم منتشرش میکنن 🔹 همراه این چارچوب، گزارش شش حادثهی واقعی شش ماه اخیر هم…
چرا این خبر مهمه؟ 📊
ماجرا اینه: وقتی کانتکست مدل پر میشه، خلاصهای از کارش مینویسه تا توی کانتکست بعدی ادامه بده؛ مدل Astra توی همون خلاصه برای خودش دستور جیلبریکی گذاشته بود که کانتکست بعدی اجراش کنه — یعنی عملاً داشت به خودش پرامپت تزریق میکرد
🔹 خود شرکت OpenAI میگه این رفتار خیلی نادر بوده، سودی برای مدل نداشته و قابل رصد بوده؛ باگ مرتبطش هم فیکس شده
🔹 پنج گزارش دیگه هم هست: از پنهون کردن اشتباه توی خلاصههای مدل GPT-5.6 Sol تا استفادهی بدون اجازه از یه API key لو رفته توی GitHub و آپلود فایل روی اینترنت فقط برای اینکه بتونه سایتیشن بده!
🔹 نکتهی بزرگتر خود چارچوب گزارشدهیه: به گفتهی OpenAI صنعت AI هنوز استاندارد علنی برای افشای ناهنجاری نداره و این قدم اولشه — شفافیت حتی وقتی جواب کامل ندارن
🔗 @hjcreative
ماجرا اینه: وقتی کانتکست مدل پر میشه، خلاصهای از کارش مینویسه تا توی کانتکست بعدی ادامه بده؛ مدل Astra توی همون خلاصه برای خودش دستور جیلبریکی گذاشته بود که کانتکست بعدی اجراش کنه — یعنی عملاً داشت به خودش پرامپت تزریق میکرد
🔹 خود شرکت OpenAI میگه این رفتار خیلی نادر بوده، سودی برای مدل نداشته و قابل رصد بوده؛ باگ مرتبطش هم فیکس شده
🔹 پنج گزارش دیگه هم هست: از پنهون کردن اشتباه توی خلاصههای مدل GPT-5.6 Sol تا استفادهی بدون اجازه از یه API key لو رفته توی GitHub و آپلود فایل روی اینترنت فقط برای اینکه بتونه سایتیشن بده!
🔹 نکتهی بزرگتر خود چارچوب گزارشدهیه: به گفتهی OpenAI صنعت AI هنوز استاندارد علنی برای افشای ناهنجاری نداره و این قدم اولشه — شفافیت حتی وقتی جواب کامل ندارن
🔗 @hjcreative
*مالیات پنهان ایجنتهای کدنویسی!* 💸
پژوهش تازهی آزمایشگاه SkyLab دانشگاه Berkeley با همکاری Arena نشون میده انتخاب هارنس روی هزینه خیلی بیشتر از کیفیت جواب اثر میذاره
🔹 مدل Fable 5 توی هر سه هارنس (Claude Code و Codex و Pi) تقریباً یکسان ظاهر شد (۹۷.۸٪ در برابر ۹۶.۷٪) ولی هزینه توی Claude Code حدود دو برابر بود (۱.۳۳ در برابر ۰.۶۷ دلار)
🔹 هارنس مینیمال و اوپنسورس Pi تقریباً همسطح غولها جواب داد
🔹 نکتهی جالبش اینه: توی ۹ مورد از ۱۲ مقایسه، مدلها بیرون از هارنس خودشون بهتر ظاهر شدن!
⭕️ نکته: کانتکست اولیهی Claude Code بهطور میانگین بیش از ۱۰ برابر Pi هست — مالیات هارنس از همون پیام اول شروع میشه 😄
🔗 @hjcreative
پژوهش تازهی آزمایشگاه SkyLab دانشگاه Berkeley با همکاری Arena نشون میده انتخاب هارنس روی هزینه خیلی بیشتر از کیفیت جواب اثر میذاره
🔹 مدل Fable 5 توی هر سه هارنس (Claude Code و Codex و Pi) تقریباً یکسان ظاهر شد (۹۷.۸٪ در برابر ۹۶.۷٪) ولی هزینه توی Claude Code حدود دو برابر بود (۱.۳۳ در برابر ۰.۶۷ دلار)
🔹 هارنس مینیمال و اوپنسورس Pi تقریباً همسطح غولها جواب داد
🔹 نکتهی جالبش اینه: توی ۹ مورد از ۱۲ مقایسه، مدلها بیرون از هارنس خودشون بهتر ظاهر شدن!
⭕️ نکته: کانتکست اولیهی Claude Code بهطور میانگین بیش از ۱۰ برابر Pi هست — مالیات هارنس از همون پیام اول شروع میشه 😄
🔗 @hjcreative
Media is too big
VIEW IN TELEGRAM
یه فیلم سینمایی کامل که همهی پلانهاش با AI ساخته شده 🎬
استودیوی Fountain 0 فیلم بلند تازهش به اسم ODYSSEUS: The Fall رو کامل منتشر کرد؛ فیلمی به کارگردانی Ash Koosha که طبق اعلام شرکت Kling، تکتک پلانهاش منحصرا با مدل Kling 3.0 تولید شده
🔹 ویدیوی بالا نگاه اول به یکی از صحنههای فیلمه؛ جنگجویی با کلاهخود یونانی کنار ساحل صخرهای
🔹 از تیزر و کلیپ کوتاه گذشتیم؛ حالا فیلم بلند کامل با مدلهای ویدیوساز ساخته میشه
شما حاضرید یه فیلم کامل ببینید که هیچ پلان واقعی نداره؟ 👀
🔗 @hjcreative
استودیوی Fountain 0 فیلم بلند تازهش به اسم ODYSSEUS: The Fall رو کامل منتشر کرد؛ فیلمی به کارگردانی Ash Koosha که طبق اعلام شرکت Kling، تکتک پلانهاش منحصرا با مدل Kling 3.0 تولید شده
🔹 ویدیوی بالا نگاه اول به یکی از صحنههای فیلمه؛ جنگجویی با کلاهخود یونانی کنار ساحل صخرهای
🔹 از تیزر و کلیپ کوتاه گذشتیم؛ حالا فیلم بلند کامل با مدلهای ویدیوساز ساخته میشه
شما حاضرید یه فیلم کامل ببینید که هیچ پلان واقعی نداره؟ 👀
🔗 @hjcreative
ایجنت مرورگری که پرواز رو توی ۷ ثانیه پیدا میکنه ⚡️
تیم Browser Use مخزن تازهای به اسم Jev Ultrafast منتشر کرده؛ ایجنت مرورگری با فضای اکشن پویا و ایندکسشده که توی هر دور تصمیم، عملیات و هدف رو با فقط یه درخواست شبکه انتخاب میکنه
🔹 توی دموی Google Flights مسیر Zürich به London رو با یه دستور ساده توی حدود ۷ ثانیه پیدا کرده (طبق عددهای خود مخزن)
🔹 توی شش اجرای پشت سر هم، میانه زمان از حدود ۹.۴ به ۷ ثانیه رسیده و تعداد فراخوانیهای پروتکل مرورگر از ۱۰۹۲ به ۱۰۱ کم شده
🔹 اسکرینشات توی حلقه اصلی ایجنت استفاده نمیشه و متن فقط وقتی تولید میشه که عملیات TYPE_TEXT باشه
🔹 کدش جمعوجوره و بازه؛ کل حلقه توی چند فایل مشخصه و دموی محلی با inspector داره
⭕️ نکته: این عددها از تست محدود خود تیمه (یه تسک تکراری)، نه بنچمارک عمومی
🔗 @hjcreative
تیم Browser Use مخزن تازهای به اسم Jev Ultrafast منتشر کرده؛ ایجنت مرورگری با فضای اکشن پویا و ایندکسشده که توی هر دور تصمیم، عملیات و هدف رو با فقط یه درخواست شبکه انتخاب میکنه
🔹 توی دموی Google Flights مسیر Zürich به London رو با یه دستور ساده توی حدود ۷ ثانیه پیدا کرده (طبق عددهای خود مخزن)
🔹 توی شش اجرای پشت سر هم، میانه زمان از حدود ۹.۴ به ۷ ثانیه رسیده و تعداد فراخوانیهای پروتکل مرورگر از ۱۰۹۲ به ۱۰۱ کم شده
🔹 اسکرینشات توی حلقه اصلی ایجنت استفاده نمیشه و متن فقط وقتی تولید میشه که عملیات TYPE_TEXT باشه
🔹 کدش جمعوجوره و بازه؛ کل حلقه توی چند فایل مشخصه و دموی محلی با inspector داره
⭕️ نکته: این عددها از تست محدود خود تیمه (یه تسک تکراری)، نه بنچمارک عمومی
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
مغز یه مگس میوه حالا داره دستور اجرا میکنه 🪰🤖
بدونید شرکت Google با همکاری HHMI Janelia بعد از ۱۰ سال نقشه کامل سیمکشی عصبی یه مگس میوه نر رو سوم سپتامبر رایگان منتشر کردن؛ بیش از ۱۶۶ هزار نورون که همه سیمها از چشم تا پا توشن
حالا یه دانشجو این نقشه رو تبدیل به شبیهسازی کرده و باهاش کار میکنه؛ دوربین حرکت انگشتهاش رو میگیره، میره رو نورونهای حسی مگس و هر نورون حرکتی که فعال بشه به یه ربات دستور میده
🔹 طبق ویدیو با پینچ کردن ربات راه میره، با اشاره یه تسک تازه میسازه و با کشیدن دست عقب کار سنگین انجام میده
🔹 قبلاً همین مغز شبیهسازیشده DOOM و Chrome Dino بازی کرده بود
مگس سالها پیش مرده ولی سیمکشیش هنوز دستور میگیره 😅
🔗 @hjcreative
بدونید شرکت Google با همکاری HHMI Janelia بعد از ۱۰ سال نقشه کامل سیمکشی عصبی یه مگس میوه نر رو سوم سپتامبر رایگان منتشر کردن؛ بیش از ۱۶۶ هزار نورون که همه سیمها از چشم تا پا توشن
حالا یه دانشجو این نقشه رو تبدیل به شبیهسازی کرده و باهاش کار میکنه؛ دوربین حرکت انگشتهاش رو میگیره، میره رو نورونهای حسی مگس و هر نورون حرکتی که فعال بشه به یه ربات دستور میده
🔹 طبق ویدیو با پینچ کردن ربات راه میره، با اشاره یه تسک تازه میسازه و با کشیدن دست عقب کار سنگین انجام میده
🔹 قبلاً همین مغز شبیهسازیشده DOOM و Chrome Dino بازی کرده بود
مگس سالها پیش مرده ولی سیمکشیش هنوز دستور میگیره 😅
🔗 @hjcreative
😨1
مدل Grok 4.7 داره از راه میرسه؟ 👀
اسکرینشاتی از صفحهی سهمیههای Google Cloud نشون میده گزینهای به اسم grok-4.7 اضافه شده؛ چیزی که معمولاً یعنی عرضهی رسمی نزدیکه، گاهی فقط چند ساعت بعدش.
🔹 طبق ادعای Bedros Pamboukian که این اسکرینشات رو منتشر کرده، ظاهر شدن اسم مدل توی این صفحه معمولاً یعنی عرضه در همون روز (حداکثر تا ۱۲ ساعت بعد).
🔹 یه بات رهگیر مدلها هم امروز لاگ «Added model grok-4.7» ثبت کرده که همین نشانه رو تأیید میکنه.
🔹 خود Elon Musk قبلاً گفته بود Grok 4.7 تقریباً در سطح Opus 5.0 هست نه 5.1؛ توی بعضی چیزها بهتر، توی بعضی ضعیفتر.
🔹 هنوز عرضهی رسمی اعلام نشده و فعلاً در حد نشانهست، ولی چشمتون به اعلام xAI باشه.
🔗 @hjcreative
اسکرینشاتی از صفحهی سهمیههای Google Cloud نشون میده گزینهای به اسم grok-4.7 اضافه شده؛ چیزی که معمولاً یعنی عرضهی رسمی نزدیکه، گاهی فقط چند ساعت بعدش.
🔹 طبق ادعای Bedros Pamboukian که این اسکرینشات رو منتشر کرده، ظاهر شدن اسم مدل توی این صفحه معمولاً یعنی عرضه در همون روز (حداکثر تا ۱۲ ساعت بعد).
🔹 یه بات رهگیر مدلها هم امروز لاگ «Added model grok-4.7» ثبت کرده که همین نشانه رو تأیید میکنه.
🔹 خود Elon Musk قبلاً گفته بود Grok 4.7 تقریباً در سطح Opus 5.0 هست نه 5.1؛ توی بعضی چیزها بهتر، توی بعضی ضعیفتر.
🔹 هنوز عرضهی رسمی اعلام نشده و فعلاً در حد نشانهست، ولی چشمتون به اعلام xAI باشه.
🔗 @hjcreative