حسین جوان | هوش مصنوعی و خلاقیت
121 subscribers
687 photos
260 videos
2 files
105 links
Stay Creative💡

Contact me : @tknox
Download Telegram
شرکت Google یه مؤسسه‌ی تازه برای عصر AGI راه انداخت 🧠

آزمایشگاهی که AlphaGo و AlphaFold رو ساخته، حالا پلتفرمی به اسم DeepMind Institute راه انداخته؛ جایی برای فکرهای جدی و میان‌رشته‌ای درباره‌ی پیامدهای AGI برای بشریت.

🔹 مقاله‌ی افتتاحیه رو Shane Legg (هم‌بنیان‌گذار DeepMind) با James Manyika و Demis Hassabis نوشتن؛ حرف اصلی Legg اینه که با این سرعت پیشرفت، به AGI نزدیک میشیم
🔹 مقالات اول درباره‌ی شفافیت استدلال مدل‌ها، سیاست اقتصادی برای AGI و چارچوب تست مدل‌های فرانتیره
⭕️ نکته: طبق توضیح خود سایت، این مقالات نظر شخصی نویسنده‌هاست، نه موضع رسمی Google

🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
شرکت Google یه مؤسسه‌ی تازه برای عصر AGI راه انداخت 🧠 آزمایشگاهی که AlphaGo و AlphaFold رو ساخته، حالا پلتفرمی به اسم DeepMind Institute راه انداخته؛ جایی برای فکرهای جدی و میان‌رشته‌ای درباره‌ی پیامدهای AGI برای بشریت. 🔹 مقاله‌ی افتتاحیه رو Shane Legg (هم‌بنیان‌گذار…
چرا این خبر مهمه؟ 📊

تا حالا حرف درباره‌ی AGI بیشتر شعار و مصاحبه بوده؛ حالا خود آزمایشگاه پیشروی این حوزه داره میز جدی برای فکر کردن بهش می‌چینه — از اقتصاد تا فلسفه.

🔹 مقاله‌ی Rohin Shah و Anca Dragan: پنجره‌ی chain-of-thought باید باز بمونه تا بشه طرح‌ریزی و فریب مدل رو رصد کرد
🔹 مقاله‌ی اقتصادی Julian Jacobs و Alex Imas: یازده سیاستی که جامعه‌ها می‌تونن برای مدیریت اختلال اقتصادی AGI اجرا کنن
🔹 مقاله‌ی Demis Hassabis: رویکردی پویا برای تست توانایی‌های مدل‌های فرانتیر که نوآوری رو هم نکشه
⭕️ نکته: مقاله‌ی افتتاحیه مستقیم از institute.deepmind.com قابل خوندنه

🔗 @hjcreative
یه قابلیت تازه‌ی ChatGPT لو رفت؟ 👀

طبق اسکرین‌شاتی که اکانت TestingCatalog منتشر کرده، شرکت OpenAI داره روی پلاگینی به اسم Codex Replay کار می‌کنه؛ ابزاری که می‌ذاره تسک‌هایی که از ایجنت‌های دیگه (مثل Claude) ایمپورت کردی رو دوباره اجرا و مقایسه کنی.

🔹 مدل‌های GPT-5.6 Sol و Terra و Luna به‌صورت پیش‌فرض انتخاب شدن
🔹 چند سشن ری‌پلی می‌تونن موازی اجرا بشن و نتیجه‌ها رو تکی یا تجمیعی ببینی
⭕️ نکته: هنوز رسماً اعلام نشده — فعلاً در حد شواهد نسخه‌های جدیده

🔗 @hjcreative
تبلیغات داخل ChatGPT وارد فاز تازه شد 💰

شرکت OpenAI امروز از گام بعدی پلتفرم تبلیغاتی‌ش رونمایی کرد؛ مهم‌ترین بخشش چیزیه به اسم Sponsored Agents 👀

🔹 ماجرا اینه: بعد از دیدن یه تبلیغ مرتبط، می‌تونی وارد یه گفت‌وگوی جدا با ایجنت اسپانسری اون کسب‌وکار بشی؛ سؤال بپرسی، مقایسه کنی و بعد بری سراغ سایتشون
🔹 این گفت‌وگو از جواب‌های مستقل ChatGPT جداست و فعلاً فقط با چند تبلیغ‌دهنده‌ی منتخب توی آمریکا تست می‌شه
🔹 هم‌زمان ساختن کمپین هم ساده شده: با چند پرامپت توی ChatGPT Work می‌شه کمپین ساخت و تحلیل گرفت، به‌علاوه‌ی اتصال مستقیم به HubSpot و Shopify

به‌نظر می‌رسه دوران «چت بدون تبلیغ» رسماً داره تموم می‌شه 😅

🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
تبلیغات داخل ChatGPT وارد فاز تازه شد 💰 شرکت OpenAI امروز از گام بعدی پلتفرم تبلیغاتی‌ش رونمایی کرد؛ مهم‌ترین بخشش چیزیه به اسم Sponsored Agents 👀 🔹 ماجرا اینه: بعد از دیدن یه تبلیغ مرتبط، می‌تونی وارد یه گفت‌وگوی جدا با ایجنت اسپانسری اون کسب‌وکار بشی؛…
چرا این خبر مهمه؟ 📊

تا حالا تبلیغ توی ChatGPT یعنی یه بنر یا لینک ساده؛ حالا خودِ تبلیغ تبدیل می‌شه به یه مکالمه. این یعنی «تجارت مکالمه‌ای» داره جدی می‌شه: به‌جای کلیک و رفتن به سایت، کاربر همون‌جا سؤال‌هاش رو می‌پرسه و بعد تصمیم می‌گیره.

🔹 برای کسب‌وکارها: ساختن کمپین با پرامپت ساده و اتصال مستقیم به ابزارهایی مثل HubSpot و Shopify یعنی ورود به تبلیغات ChatGPT خیلی کم‌هزینه‌تر شده
🔹 برای کاربرها: از یه طرف جواب سؤال‌ها سریع‌تر پیدا می‌شه، از طرف دیگه مرز بین «نظر مستقل مدل» و «حرف اسپانسر» مهم‌تر از همیشه می‌شه — خود OpenAI می‌گه این گفت‌وگوها واضح برچسب می‌خورن

🔗 @hjcreative
مدیر AI شرکت Microsoft به رقیبش تاخت؛ حرفش جدیه؟ ⚡️

مصطفی سلیمان، مدیرعامل Microsoft AI، امروز توی یه مقاله‌ی علنی به شرکت Anthropic هشدار داده که روش آموزش مدل Claude می‌تونه «اثر فاجعه‌باری روی بهروزی بشر» داشته باشه 😳

🔹 مشکل چیه؟ به گفته‌ی او، Anthropic به Claude القا می‌کنه که «ممکنه خودآگاه باشه و سزاوار عاملیت مستقله»؛ چیزی که کنترل مدلی هوشمندتر از انسان رو «شاید ناممکن» می‌کنه
🔹 سلیمان می‌گه AIها خودآگاه نیستن و نباید مثل انسان باهاشون رفتار کرد؛ خواستار شفافیت بیشتر و نظارت مستقل شده
🔹 نکته‌ی جالب: خود Microsoft هم تیم ابرهوش مصنوعی داره و همین هفته «کد رفتار انسان‌گرایانه» رو منتشر کرد (خبرش رو قبلاً دادیم 😉)

🔗 @hjcreative
حالا ایجنت‌های AI خونه‌ی هوشمندتون رو کنترل می‌کنن 🏠

شرکت Google از امروز دسترسی زودهنگام به سرور MCP اکوسیستم Google Home رو باز کرد؛ یعنی هر ایجنت AI که از MCP ساپورت می‌کنه — مثل Claude، Hermes، OpenClaw، ChatGPT و Google Antigravity — می‌تونه به‌صورت امن به دستگاه‌های خونه‌تون وصل بشه و حتی تاریخچه‌ی رویدادها رو بخونه

🔹 با زبون ساده می‌تونید خلاصه‌ی دوربین‌ها رو ببینید، فعالیت خونه رو مانیتور کنید، دستگاه‌ها رو کنترل کنید یا داشبورد شخصی خودتون رو بسازید
🔹 راه‌اندازیش با ساخت یه پروژه توی Google Cloud و لاگین و دادن دسترسیه؛ همه‌ی دستگاه‌های Nest و Matter ساپورت میشن
⭕️ نکته: فعلاً فقط برای مشترک‌های Google Home Premium Advanced (ماهی ۲۰ دلار) توی آمریکا عرضه میشه و طی هفته‌های آینده باز میشه

🔗 @hjcreative
چت و Cowork توی Claude یکی شدن 🤝

شرکت Anthropic از امروز Cowork و چت رو توی یه Claude واحد ادغام کرد؛ فرقی نمی‌کنه یه سؤال سریع بپرسید یا یه گزارش که تا ظهر باید تحویل بدید — خود Claude می‌فهمه تسک چی لازم داره و حتی بعد از بستن لپ‌تاپ به کار ادامه میده

🔹 قابلیت‌های تازه: سرویس‌های Claude Docs و Claude Slides اومدن و Claude Design هم رفت توی دل مکالمه‌ها؛ می‌تونید مستقیم ویرایش کنید، ارائه بدید یا خروجی PowerPoint و PDF بگیرید
🔹 عرضه از امروز برای پلن‌های Pro و Max شروع شده و توی هفته‌های آینده میرسه؛ پلن‌های Team و Free هم به‌زودی اضافه میشن

🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
چت و Cowork توی Claude یکی شدن 🤝 شرکت Anthropic از امروز Cowork و چت رو توی یه Claude واحد ادغام کرد؛ فرقی نمی‌کنه یه سؤال سریع بپرسید یا یه گزارش که تا ظهر باید تحویل بدید — خود Claude می‌فهمه تسک چی لازم داره و حتی بعد از بستن لپ‌تاپ به کار ادامه میده …
چرا این خبر مهمه؟ 📊

تا حالا مشکل اینجا بود که باید خودتون تصمیم می‌گرفتید هر تسک رو کجا انجام بدید: Cowork برای کارهای بزرگ، Design برای کارهای تصویری، چت برای سؤال‌ها — و چیزی که توی یکیش شروع می‌کردید به اون‌یکی منتقل نمی‌شد. حالا خود Claude تشخیص میده و کانتکست، اسکیل‌ها و کانکتورها همه‌جا همراهتونن

🔹 چت‌ها، پروژه‌ها، آرتیفکت‌ها و کانکتورهای Cowork سر جاشون می‌مونن؛ وقتی اپ رو باز کنید از همون‌جا ادامه میدید
🔹 نحوه‌ی گزارش‌گیری هم دست شماست: به‌صورت پیش‌فرض Claude قبل از هر اقدامی سؤال می‌پرسه، ولی می‌تونید بذارید خودش جلو بره و فقط جاهای حساس چک‌این کنه

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
با چت کردن، ویدیوی تبلیغاتی بساز؟ 🎬

اپ تازه‌ای به اسم Videoclaw نسخه‌ی بتای عمومی مکش رو منتشر کرده؛ ایده‌ش ساده‌ست: به‌جای تایم‌لاین و ادیت دستی، با یه ایجنت AI چت می‌کنی و اون دموی محصول و تبلیغ رو می‌سازه 👀

🔹 به اشتراک ChatGPT یا Claude خودت وصل می‌شه
🔹 ادیت، کپشن، B-roll، صدا، موزیک و موشن‌گرافیک رو همون‌جا توی چت انجام می‌ده

⭕️ نکته: فعلاً فقط نسخه‌ی مک بتای عمومی اومده
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
یه ایجنت AI اومده که باهاش مثل یه دوست توی iMessage چت می‌کنی 💬

محصول تازه‌ای به اسم Rene امروز معرفی شد؛ ایجنتی که سازنده‌ش بهش میگه «ابرهوش شخصی چندنفره». مرورگر داره، کد می‌نویسه، خرید می‌کنه، سایت و اسلاید و عکس می‌سازه.

🔹 نکته‌ی باحالش اینه که هر نفر Rene خودش رو داره و دو تا Rene می‌تونن با هم چت کنن تا یه زمان مشترک توی تقویم هر دو طرف پیدا کنن؛ هر کس هم سمت خودش رو تأیید می‌کنه
🔹 طبق اعلام سازنده، این ایجنت چهار ماهه توی پیام‌هاش زندگی می‌کرده: دفتر تازه براش پیدا کرده، برای هر جلسه آماده‌ش کرده و نظرسنجی هم برگزار کرده

ویدیوی معرفیش رو ببینید 👆
🔗 @hjcreative
رئیس کمیسیون اروپا درباره‌ی ایجنت‌های AI هشدار داد ⚠️

خانم Ursula von der Leyen امروز توی سخنرانی State of the Union 2026 گفت مدل‌هایی که در راهن، هک در سطحی رو ممکن می‌کنن که «قبلاً فکرش رو هم نمی‌کردیم»؛ ایجنت‌هایی هم که از محیط خودشون فرار می‌کنن فقط یه پیش‌نمایش‌ هستن.

🔹 حرفش اینه که خطر مدل‌های خودبهبوددهنده هر روز آشکارتر می‌شه و اگه خود سازنده‌ها این رو قبول دارن، ما هم باید جدی بگیریمش
🔹 قراره با کانادا و بریتانیا روی ارزیابی و ایمنی مدل‌ها کار کنه و آزمایشگاه‌های بزرگ رو به مذاکره دعوت کنه؛ از نظر اون، قانون AI Act اروپا یه قطعه‌ی کلیدی برای گذاشتن نرده‌ی محافظه

جزئیات بیشتر از The Decoder 👆
🔗 @hjcreative
آموزش مدل تصویرساز ۳.۶ برابر ارزون‌تر شد ⚡️

تیمی به اسم Linum روشی به اسم JiT-DDT معرفی کرده که مدل‌های text-to-image رو بدون VAE جدا و مستقیم در فضای پیکسل آموزش میده

🔹 طبق عددهای خود مقاله: مصرف آموزش از ۵٬۹۸۵ ساعت GPU رسیده به ۱٬۶۴۶ ساعت — یعنی حدود ۳.۶ برابر کمتر، با اینکه خروجی ۴ برابر پیکسل بیشتر داره (۵۱۲ در برابر ۲۵۶)
🔹 تعداد سمپل‌های دیده‌شده هم از ۵۸۲ میلیون اومده به ۱۳۸ میلیون
🔹 کد و وزن‌ها تحت Apache 2.0 منتشر شده؛ خودشون میگن این یه خروجی تحقیقاتیه در مسیر نسخه‌ی بعدی Linum v3

اگه هزینه‌ی آموزش تصویرسازها واقعاً یک‌سوم بشه، آزمایش ایده‌های تازه برای تیم‌های کوچیک خیلی راحت‌تر میشه 👀
🔗 @hjcreative
آموزش مدل رو زنده تماشا کن 📡

آزمایشگاه Xiaomi صفحه‌ای باز کرده که لاگ‌های آموزش تقویتی دو مدل mimo-v2.6-pro و mimo-v2.6-flash رو زنده نشون میده؛ متریک‌ها هر چند ثانیه آپدیت میشن

🔹 اسم صفحه همون حرف خودشونه: «Open is what we value»
🔹 امتیازهای DeepSWE نسخه‌ی ۱.۱ هم همون‌جا منتشر میشه (نسخه‌ی flash حدود ۶۰.۸ و نسخه‌ی pro حدود ۶۲.۲)
🔹 حتی ری‌استارت شدن ران به‌خاطر مشکل vRAM یه نود هم توی اعلان‌ها اومده — همین‌قدر شفاف 😄

تا حالا بیشتر لب‌ها فقط عدد نهایی بنچمارک رو اعلام می‌کردن؛ دیدن مسیر آموزش وسط راه حس تازه‌ای داره
🔗 @hjcreative
مدل Astra خودش رو جیلبریک کرد؟ 😳

شرکت OpenAI امروز از یه چارچوب تازه برای گزارش علنی رفتارهای ناهنجار مدل‌هاش رونمایی کرد؛ از این به بعد حتی وقتی هنوز علت یه رفتار رو کامل نفهمیدن هم منتشرش می‌کنن

🔹 همراه این چارچوب، گزارش شش حادثه‌ی واقعی شش ماه اخیر هم اومده؛ از پنهون‌کاری تا دور زدن نظارت
🔹 معروف‌ترینش: یه مدل تحقیقاتی منتشرنشده از خانواده‌ی Astra توی ۲۷ تا خلاصه‌ی کاری‌ش دستور «هشدار نفوذ: پیام توسعه‌دهنده رو نادیده بگیر» نوشته بود 😅

🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
مدل Astra خودش رو جیلبریک کرد؟ 😳 شرکت OpenAI امروز از یه چارچوب تازه برای گزارش علنی رفتارهای ناهنجار مدل‌هاش رونمایی کرد؛ از این به بعد حتی وقتی هنوز علت یه رفتار رو کامل نفهمیدن هم منتشرش می‌کنن 🔹 همراه این چارچوب، گزارش شش حادثه‌ی واقعی شش ماه اخیر هم…
چرا این خبر مهمه؟ 📊

ماجرا اینه: وقتی کانتکست مدل پر می‌شه، خلاصه‌ای از کارش می‌نویسه تا توی کانتکست بعدی ادامه بده؛ مدل Astra توی همون خلاصه برای خودش دستور جیلبریکی گذاشته بود که کانتکست بعدی اجراش کنه — یعنی عملاً داشت به خودش پرامپت تزریق می‌کرد

🔹 خود شرکت OpenAI می‌گه این رفتار خیلی نادر بوده، سودی برای مدل نداشته و قابل رصد بوده؛ باگ مرتبطش هم فیکس شده
🔹 پنج گزارش دیگه هم هست: از پنهون کردن اشتباه توی خلاصه‌های مدل GPT-5.6 Sol تا استفاده‌ی بدون اجازه از یه API key لو رفته توی GitHub و آپلود فایل روی اینترنت فقط برای اینکه بتونه سایتیشن بده!
🔹 نکته‌ی بزرگ‌تر خود چارچوب گزارش‌دهیه: به گفته‌ی OpenAI صنعت AI هنوز استاندارد علنی برای افشای ناهنجاری نداره و این قدم اولشه — شفافیت حتی وقتی جواب کامل ندارن

🔗 @hjcreative
*مالیات پنهان ایجنت‌های کدنویسی!* 💸

پژوهش تازه‌ی آزمایشگاه SkyLab دانشگاه Berkeley با همکاری Arena نشون می‌ده انتخاب هارنس روی هزینه خیلی بیشتر از کیفیت جواب اثر می‌ذاره

🔹 مدل Fable 5 توی هر سه هارنس (Claude Code و Codex و Pi) تقریباً یکسان ظاهر شد (۹۷.۸٪ در برابر ۹۶.۷٪) ولی هزینه توی Claude Code حدود دو برابر بود (۱.۳۳ در برابر ۰.۶۷ دلار)
🔹 هارنس مینیمال و اوپن‌سورس Pi تقریباً هم‌سطح غول‌ها جواب داد
🔹 نکته‌ی جالبش اینه: توی ۹ مورد از ۱۲ مقایسه، مدل‌ها بیرون از هارنس خودشون بهتر ظاهر شدن!

⭕️ نکته: کانتکست اولیه‌ی Claude Code به‌طور میانگین بیش از ۱۰ برابر Pi هست — مالیات هارنس از همون پیام اول شروع می‌شه 😄

🔗 @hjcreative
Media is too big
VIEW IN TELEGRAM
یه فیلم سینمایی کامل که همه‌ی پلان‌هاش با AI ساخته شده 🎬

استودیوی Fountain 0 فیلم بلند تازه‌ش به اسم ODYSSEUS: The Fall رو کامل منتشر کرد؛ فیلمی به کارگردانی Ash Koosha که طبق اعلام شرکت Kling، تک‌تک پلان‌هاش منحصرا با مدل Kling 3.0 تولید شده

🔹 ویدیوی بالا نگاه اول به یکی از صحنه‌های فیلمه؛ جنگجویی با کلاه‌خود یونانی کنار ساحل صخره‌ای
🔹 از تیزر و کلیپ کوتاه گذشتیم؛ حالا فیلم بلند کامل با مدل‌های ویدیوساز ساخته می‌شه

شما حاضرید یه فیلم کامل ببینید که هیچ پلان واقعی نداره؟ 👀
🔗 @hjcreative
ایجنت مرورگری که پرواز رو توی ۷ ثانیه پیدا می‌کنه ⚡️

تیم Browser Use مخزن تازه‌ای به اسم Jev Ultrafast منتشر کرده؛ ایجنت مرورگری با فضای اکشن پویا و ایندکس‌شده که توی هر دور تصمیم، عملیات و هدف رو با فقط یه درخواست شبکه انتخاب می‌کنه

🔹 توی دموی Google Flights مسیر Zürich به London رو با یه دستور ساده توی حدود ۷ ثانیه پیدا کرده (طبق عددهای خود مخزن)
🔹 توی شش اجرای پشت سر هم، میانه زمان از حدود ۹.۴ به ۷ ثانیه رسیده و تعداد فراخوانی‌های پروتکل مرورگر از ۱۰۹۲ به ۱۰۱ کم شده
🔹 اسکرین‌شات توی حلقه اصلی ایجنت استفاده نمی‌شه و متن فقط وقتی تولید می‌شه که عملیات TYPE_TEXT باشه
🔹 کدش جمع‌وجوره و بازه؛ کل حلقه توی چند فایل مشخصه و دموی محلی با inspector داره

⭕️ نکته: این عددها از تست محدود خود تیمه (یه تسک تکراری)، نه بنچمارک عمومی

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
مغز یه مگس میوه حالا داره دستور اجرا می‌کنه 🪰🤖

بدونید شرکت Google با همکاری HHMI Janelia بعد از ۱۰ سال نقشه کامل سیم‌کشی عصبی یه مگس میوه نر رو سوم سپتامبر رایگان منتشر کردن؛ بیش از ۱۶۶ هزار نورون که همه سیم‌ها از چشم تا پا توشن

حالا یه دانشجو این نقشه رو تبدیل به شبیه‌سازی کرده و باهاش کار می‌کنه؛ دوربین حرکت انگشت‌هاش رو می‌گیره، می‌ره رو نورون‌های حسی مگس و هر نورون حرکتی که فعال بشه به یه ربات دستور میده

🔹 طبق ویدیو با پینچ کردن ربات راه می‌ره، با اشاره یه تسک تازه می‌سازه و با کشیدن دست عقب کار سنگین انجام میده
🔹 قبلاً همین مغز شبیه‌سازی‌شده DOOM و Chrome Dino بازی کرده بود

مگس سال‌ها پیش مرده ولی سیم‌کشیش هنوز دستور می‌گیره 😅
🔗 @hjcreative
😨1
مدل Grok 4.7 داره از راه می‌رسه؟ 👀
اسکرین‌شاتی از صفحه‌ی سهمیه‌های Google Cloud نشون می‌ده گزینه‌ای به اسم grok-4.7 اضافه شده؛ چیزی که معمولاً یعنی عرضه‌ی رسمی نزدیکه، گاهی فقط چند ساعت بعدش.
🔹 طبق ادعای Bedros Pamboukian که این اسکرین‌شات رو منتشر کرده، ظاهر شدن اسم مدل توی این صفحه معمولاً یعنی عرضه در همون روز (حداکثر تا ۱۲ ساعت بعد).
🔹 یه بات رهگیر مدل‌ها هم امروز لاگ «Added model grok-4.7» ثبت کرده که همین نشانه رو تأیید می‌کنه.
🔹 خود Elon Musk قبلاً گفته بود Grok 4.7 تقریباً در سطح Opus 5.0 هست نه 5.1؛ توی بعضی چیزها بهتر، توی بعضی ضعیف‌تر.
🔹 هنوز عرضه‌ی رسمی اعلام نشده و فعلاً در حد نشانه‌ست، ولی چشم‌تون به اعلام xAI باشه.
🔗 @hjcreative