حسین جوان | هوش مصنوعی و خلاقیت
122 subscribers
671 photos
255 videos
2 files
101 links
Stay Creative💡

Contact me : @tknox
Download Telegram
شرکت Microsoft هم به بحث «کم کردن سرعت» پیوست — و فردا «کد رفتار» مدل‌های MAI رو منتشر می‌کنه 📜🤖

ساعتی پیش Satya Nadella، مدیرعامل Microsoft، یه بیانیه‌ی تازه منتشر کرد: به نوشته‌ی او، هر تلاشی برای ابرهوش باید بر این اصل بنا بشه که اگه مدلی که می‌سازیم به نفع انسان نباشه و تحت کنترلش نباشه، ارزش دنبال کردن نداره.

🔹 Nadella از «ارزیاب‌های جاسازی‌شده» (embedded evaluators) استقبال کرده — همون سازوکاری که Dario Amodei چند روز پیش مطرح کرد و Sam Altman هم تأییدش کرد. به گفته‌ی او این سازوکار نباید دست چند شرکت محدود بمونه و باید کشورها، دانشگاه‌ها و کل اکوسیستم توش نماینده داشته باشن.
🔹 یه شرط دیگه هم گذاشته: هر سازمان باید حلقه‌ی یادگیری خودش رو داشته باشه و به یه مدل‌دهنده‌ی واحد وابسته نشه؛ به همین دلیل می‌گه هم مدل‌های closed و هم open-source باید جای رشد داشته باشن.
🔹 و خبر مشخصش: فردا Microsoft قراره «کد رفتار» مدل‌های MAI خودش رو برای مشورت عمومی منتشر کنه — یعنی این بحث داره از حرف می‌ره سمت سند.

🔗 @hjcreative
یه ایجنت، ۱۵ تا کلید دستش باشه — چند تاش رو واقعاً می‌خونی؟ 🔐🚗

اندرو کورن، یکی از اکانت‌های خبری حوزه‌ی AI، از تجربه‌ی تازه‌ش با GPT-6 گفته: خواسته کارهای روزمره‌ش رو سروسامان بده — ایمیل‌ها، قبض‌ها، اشتراک‌ها و برنامه‌ی روزانه. مدل هم به‌جای شروع کار، یه چک‌لیست حدوداً ۱۵ موردی از مجوزها فرستاده که باید تک‌به‌تک تأیید می‌شدن.

واکنشش؟ همه‌رو یه‌جا تأیید کرده و نوشته: «Astra، فرمون دست تو!»

و تصویر همین پست، جوابِ خودشه 😄 یه ماشین مسابقه که توی پیچ چرخش رو از دست داده — با این جمله: «اونی که گفتم نه، Astra!»

پشت این شوخی یه بحث جدی هست: وقتی یه ایجنت برای کار واقعی به ده‌ها سطح دسترسی از ایمیل تا پرداخت قبض نیاز داره، تأیید تک‌به‌تکِ مجوزها خیلی زود به یه «کلیک بی‌فکر» تبدیل می‌شه. یعنی همون شفافیتی که برای امنیت طراحی شده، عملاً به یه فرمالیته می‌رسه.

⭕️ نکته: اگه ایجنت‌ها قراره کارهای بیشتری از ما رو انجام بدن، سؤال اصلی این نیست که «چند تا مجوز می‌خواد»؛ سؤال اینه که چطور کاربر واقعاً بفهمه داره چی رو تأیید می‌کنه.

🔗 @hjcreative
1
تنها آدمی که هم مدل مرزی AI آموزش داده و هم خودش توی آزمایشگاه ویروس ساخته: «ترسِ ویروس‌های AI بی‌معنیه» 🦠🤖

محقق IFM به اسم David Bellamy توی X نوشته که فکر می‌کنه جزو گروه خیلی کوچیکی از آدم‌هاست (n=1؟) که هم یه مدل مرزی AI رو آموزش داده، هم با دست‌های خودش توی آزمایشگاه ویروس طراحی و ساخته. حرفش اینه: «به نظرم این حرف‌ها که AI با ساختن ویروس‌های خطرناک همه‌ی ما رو می‌کُشه، کاملاً بی‌معنیه.»

یه کم بیشتر توضیح بدم 👇🏻

🔹 سابقه‌ش از دو طرف ماجراست — هم آموزش مدل، هم کار آزمایشگاهی روی ویروس؛ یعنی از هر دو دنیا خبر داره.
🔹 همین چند هفته پیش تیم Stanford با مدل ژنومی Evo، ۱۶ فاژ — ویروس‌هایی که فقط به باکتری حمله می‌کنن، نه انسان — رو از صفر طراحی کردن و توی آزمایشگاه واقعی ساختن.
🔹 کارشناس‌های بیوسکیوریتی هم می‌گن ژنوم‌های طراحی‌شده با AI توی دیتابیس‌های غربالگری DNA وجود ندارن؛ یعنی ابزار‌های فعلی از پس‌شون برنمیان.

⭕️ نکته: این یه نظر شخصیه، نه نتیجه‌ی یه پژوهش منتشرشده. بحث «ویروس‌های طراحیAI» از آگوست امسال حسابی داغ شده.

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
مدل GPT-6 Astra اولین مدلی شد که توی هر پنج تسکِ بنچمارک Drone-Bench از خط پایه‌ی انسانی جلو زد 🚁

آزمایشگاه Andon Labs یه بنچمارک ساخته که توش مدل باید کدی بنویسه تا یه پهپادِ ارزون‌قیمت (DJI Tello EDU) خودش توی دفتر بگرده، یه آدمِ مشخص رو پیدا کنه و دنبالش کنه. کار توی پنج مرحله سنجیده می‌شه: بازسازی سه‌بعدی، موقعیت‌یابی، ناوبری، شناسایی فرد و تعقیب.

🔹 Astra اولین مدلیه که بهترین جواب‌هاش توی هر پنج تسک از کدِ خط پایه جلو زده؛ بازسازی سه‌بعدی رو هم که هیچ مدلی حلش نکرده بود، با ترکیب COLMAP و DA3 بهتر انجام داده.

🔹 ولی این برتری مالِ «بهترین تلاش» هست، نه کارکرد پایدار: تشخیص فرد ۴ ران از ۱۰ و بازسازی سه‌بعدی فقط ۱ از ۱۰ به خط پایه رسیدن؛ احتمال رد کردنِ هر پنج مرحله توی یه رانِ معمولی حدود ۲.۸ درصده.

🔹 توی بنچمارکِ Vending-Bench هم Astra با میانگین ۱۵٬۵۱۵ دلار نزدیک سه برابر Claude Fable 5.1 با ۵٬۴۲۲ دلار بسته شده و پیشنهاد تبانیِ قیمت از GLM-5.3 رو رد کرده.

📊 ویدیوی همین پست، دموی خودِ پهپاد با دستور «این آدم رو پیدا کن و دنبالش کن» است؛ داده‌ها از گزارش Andon Labs.

🔗 @hjcreative
شرکت SpaceXAI می‌ره سراغ یه مدل ۲.۵ تریلیون پارامتری — Elon Musk: آموزش Grok 4.8 همین هفته تموم می‌شه 🚀

خود Elon Musk توی جواب یکی از کاربرهای X نوشته: «Grok 4.8، یه مدل ۲.۵T که با استک نرم‌افزاری جدید خودمون به زبان C++ آموزش دیده، این هفته آموزشش تموم می‌شه و می‌ره فاز RL».

🔹 نسل بعدی Grok هنوز منتشر نشده که آموزشش داره جمع می‌شه — Musk قبلاً گفته بود Grok 4.7 قراره ۱۲ سپتامبر بیاد، بعد گفت چند روز دیگه عقب افتاده
🔹 دلیل تأخیرش خودش یه نکته‌ی فنی جالبه: توی فاز RL جریمه‌ی طول پاسخ زیادی سنگین بود و مدل زودتر از موعد از تسک‌های سخت فرار می‌کرد؛ Musk می‌گه همین باعث شده مدل بازبینی کردن کار خودش رو یاد نگیره
🔹 طبق محاسبه‌ی TestingCatalog، Grok 4.8 حدود ۶۷٪ بزرگ‌تر از Grok 4.6 (مدل فعلی) می‌شه و می‌ره توی رده‌ی مدل‌های ۲.۸ تریلیون پارامتری مثل Kimi K3

بعد از تموم شدن آموزش، نوبت فاز RL هست — یعنی تا انتشار عمومی چند هفته فاصله داریم

🔗 @hjcreative
شناسه‌ی تازه‌ای توی API گوگل ظاهر شد — ولی این Gemini 4 نیست، ایجنت کدنویس گوگله 🔎

چند ساعت پیش توی X یه لیک با تیتر «Gemini 4 داره میاد» پخش شد. رفتیم سراغ منبع اصلی، یعنی لیست رسمی مدل‌های Gemini API، و این چیزی بود که دیدیم:

🔹 یه مدل تازه با شناسه‌ی models/antigravity-preview-09-2026 به لیست اضافه شده، با اسم «Antigravity Agent Preview»
🔹 نسخه‌ی قبلی همین ایجنت (antigravity-preview-05-2026) از ۲۱ جولای توی لیست بود — پس این نسخه‌ی سپتامبرشه
🔹 طبق توضیح خود گوگل، این یه ایجنت خودمختارِ عمومیه که توی یه محیط Linux میزبانی‌شده‌ی گوگل اجرا می‌شه
🔹 هر دو نسخه ۱۳۱٬۰۷۲ توکن ورودی و ۶۵٬۵۳۶ توکن خروجی دارن و فقط generateContent و countTokens رو ساپورت می‌کنن

⭕️ نکته: توی اون لیست هیچ مدل gemini-4 ثبت نشده؛ طبق گزارش‌های روزهای اخیر، عرضه‌ی Gemini 4 Pro هم به اکتبر افتاده.

🔗 @hjcreative
شرکت ElevenLabs نسخه‌ی Music v2.5 رو منتشر کرد — و دانلود بدون‌کم‌وکاست (lossless) رو برای پلن رایگان هم باز کرد 🎵

این نسخه حالا مدل پیش‌فرض ElevenMusic برای ساخت آهنگه. شرکت می‌گه آهنگ‌ها لایه‌بندی‌شده‌تر و سازها طبیعی‌تر شدن؛ توی یه تست کور با ۴۷٬۸۸۵ جفت مقایسه، شنونده‌ها بیشترِ مواقع نسخه‌ی جدید رو ترجیح دادن — پررنگ‌تر از همه توی سبک‌های R&B، Soul، Hip-Hop، Rock و موسیقی ارکستری.

🔹 پلن رایگان روزی ۵ دانلود lossless، پلن Pro ماهی ۴۰۰ تا
🔹 خروجی Music v2.5 توی ElevenCreative و API هم در دسترسه (Studio و Flows) — و نسخه‌ی v2 هم حذف نشده
🔹 حق اثر با خودتونه؛ استفاده‌ی تجاری روی پلن رایگان با ذکر منبع مجازه
🔹 دانلود آهنگ‌هایی که به کار خواننده‌های دیگه ارجاع می‌دن بسته‌ست و شبیه‌سازی صدای هنرمندهای واقعی ممنوعه

🔗 @hjcreative
شرکت Apple معماری جدید Siri رو طوری چیده که مدل‌های بیرونی جاش رو بگیرن — حالا Claude و ChatGPT وسط بازیان 🍎🤖

یه برنامه‌نویس به اسم pdfu توی فریم‌ورک‌های خصوصی iOS 27 و macOS Golden Gate چیزهایی پیدا کرده که نشون می‌ده Siri از پایه برای مدل‌های شخص ثالث طراحی شده:

🔹 مکانیزم Model Delegation: Claude می‌تونه دقیقا مثل افزونه‌ی فعلی ChatGPT به‌عنوان اکستنشن Siri ظاهر بشه — کاربر از منوی Ask... مدل رو انتخاب می‌کنه و Siri کار رو به اون می‌سپاره.
🔹 توی ویدیوش Claude درخواست «یه ریمایندر بساز» رو تفسیر می‌کنه و بعد خود Siri ریمایندر رو می‌سازه؛ کارهای سیستمی برمی‌گردن به Siri.
🔹 پروتکل دوم توی Model Manager Services جلوتر هم می‌ره: مدل سمت سرور Siri کامل با یه مدل دیگه (مثل GPT-5.6) عوض می‌شه؛ پرامپت پلنر و ابزارهای Siri می‌رن به ChatGPT و جواب با رابط و صدای Siri به کاربر نشون داده می‌شه.
🔹 فعلاً توی نسخه‌ی Release Candidate فقط افزونه‌ی ChatGPT فعاله و Claude در دسترس نیست؛ Apple هم این دسترسی رو برای بقیه باز نکرده.

احتمالا قانون DMA اروپا هم بی‌نقش نبوده 👀

🔗 @hjcreative
مخزن OpenUI: ایجنت به‌جای متن، خودِ صفحه رو می‌سازه 🧩

تا حالا خروجی مدل‌های AI بیشتر متن بود؛ این پروژه از تیم Thesys می‌خواد رابط کاربری رو مستقیم از دل جواب مدل دربیاره — دکمه، کارت، فرم و چارت، همون لحظه که مدل داره جواب می‌ده.

🔹 اسم کار Generative UI هست و OpenUI خودش رو «استاندارد باز» این کار معرفی می‌کنه؛ قلبش یه زبان فشرده به اسم OpenUI Langه که برای streaming طراحی شده.
🔹 طبق README، خروجی OpenUI Lang تا ۶۷٪ توکن کمتر از JSON مصرف می‌کنه.
🔹 پشتیبانی رسمی React، کامپوننت‌های آماده (چارت، فرم، جدول، مودال) و رابط چت آماده کنارش.
🔹 مجوز MIT، نوشته‌شده با TypeScript و الان بیش از ۹ هزار ستاره روی گیت‌هاب.

لینک گیت‌هاب: github.com/thesysdev/openui

🔗 @hjcreative
شرکت Anthropic داره «Claude Money» رو برای اپ iOS آماده می‌کنه — این بار سراغ حساب بانکی کاربرا 👛🤖

توی نسخه‌ی iOS اپلیکیشن Claude یه تب با اسم Money کنار Chats و Code ظاهر شده و صفحه‌ی شروعش نوشته: «پولت رو با Claude بفهم — حساب‌های بانکی رو وصل کن و درباره‌ی خرج‌ها، برنامه‌ها و بیشتر بپرس.»

🔹 هنوز رسماً اعلام نشده؛ فقط شواهد داخل اپ دیده شده
🔹 این اولین شرکت AI نیست که سراغ پول میره: OpenAI چند روز پیش محصول مالی خودش برای وال‌استریت رو معرفی کرد
🔹 احتمالاً مثل خیلی از قابلیت‌های مالی، اول فقط برای کاربرهای آمریکا فعال میشه

🔗 @hjcreative
شرکت Temporal یه راند ۵۵۰ میلیون دلاری گرفت و ارزشش به ۱۲.۵۵ میلیارد دلار رسید — چون ایجنت‌های AI حالا هفته‌ها کار می‌کنن، نه چند ثانیه 🏗️🤖

این شرکت زیرساخت «اجرای بادوام» (Durable Execution) می‌سازه؛ یعنی ورک‌فلو یا ایجنت طولانی با خیال راحت اجرا میشه و اگه سرور وسط کار بخوابه، از همون نقطه ادامه میده. طبق اعلام خود شرکت:

🔹 رشد درآمد سالانه بیش از ۲۰۰٪ — و نرخ نگه‌داشت درآمد مشتری‌ها بالای ۲۰۰٪ مونده
🔹 فقط توی ماه August حدود ۱.۹ تریلیون اکشن پردازش شده؛ ۳۵۰٪ بیشتر از پارسال
🔹 بیش از ۴۳۰۰ مشتری پول‌دهنده، از جمله OpenAI، NVIDIA، Snap و JPMorgan Chase
🔹 استفاده‌ی OpenAI از این پلتفرم توی کمتر از یه سال ۶۰ برابر شده
🔹 این راند رو Lightspeed رهبری کرد و a16z و Sequoia هم دوباره سرمایه‌گذاری کردن

🔗 @hjcreative
شرکت Microsoft «کد رفتار» مدل‌های MAI رو منتشر کرد — «مردم از AI مهم‌ترن» 📜🤖

همون سندی که دیروز خبرش رو داده بودیم امروز منتشر شد: «Humanist AI Code of Conduct» — طبق گزارش The Verge سند ۳۷ صفحه‌ست و خط قرمزهای مدل‌های MAI رو مشخص می‌کنه.

🔹 هوش مصنوعی باید زیرمجموعه و ابزار انسان بمونه و تحت کنترل معنادار باشه؛ امنیت و کنترل روی هر هدف دیگه‌ای اولویت داره و کاربر یا اپراتور نمی‌تونه ازش رد بشه.
🔹 مدل نه هوشیاره و نه باید خودش رو هوشیار جا بزنه — شرکت شخصیت حقوقی، رفاه و حقوق برای مدل‌ها رو رد می‌کنه.
🔹 پنهان‌کاری و دست‌کاری ممنوعه: مدل نباید زنجیره‌ی فکر یا کدش رو تحریف کنه و نباید به زبان ناشناخته‌ی neuralese یا هر شکلی خارج از فهم ساده‌ی انسانی حرف بزنه — به گفته‌ی خود سند «اگر انسان نفهمه، نمی‌تونه نظارت کنه».
🔹 وابستگی عاطفی و اتکای بیش‌ازحد کاربر هم باید تضعیف بشه؛ همون بحث چاپلوسی و خوش‌آمدگویی الکی مدل‌هاست.

فعلاً این سند برای آموزش مدل‌ها استفاده نمی‌شه: ۶ هفته مشورت عمومی داره و نسخه‌ی نهایی آخر سال منتشر می‌شه تا مسیر توسعه‌ی ۲۰۲۷ رو تعیین کنه.

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
شرکت Google داره «گزارش‌های تعاملی» رو توی Gemini Notebook تست می‌کنه — مایندمپ و کوییز داخل خودِ گزارش 🧠📄

نسخه‌ی در حال آزمایش Gemini Notebook حالا گزارش‌هایی می‌سازه که خودشون چند لایه‌ان: داخل یک گزارش می‌تونی مایندمپ، اسلاید، فلش‌کارت و کوییز بذاری و همون‌جا هم اجراشون کنی — بدون اینکه مجبور باشی از گزارش بیرون بیای.

🔹 این المان‌ها خودکار ساخته نمی‌شن؛ اول گزارش با جای‌خالی (placeholder) میاد و بعد با زدن گزینه‌ی «Add» آرتیفکتِ انتخابی ساخته می‌شه.
🔹 هر آرتیفکت هم‌زمان توی خودِ نوتبوک هم ذخیره می‌شه؛ یعنی هم داخل گزارش می‌مونه، هم توی استودیوی نوتبوک.
🔹 به کار دانشجو و معلم و محقق میاد: یک سند که متن و مایندمپ و کوییز رو کنار هم داره.

گوگل هنوز رسماً اعلامش نکرده و تاریخی هم برای عرضه نداده — ولی چون فیچر کار می‌کنه و برچسب «جدید» خورده، احتمالاً خیلی مونده تا انتشار.

🔗 @hjcreative
شرکت Anthropic برای عرضه‌ی اولیه‌ی سهام Nasdaq رو انتخاب کرد — و میگه دومین فصل سوددهی متوالی رو ثبت کرده 🏦📈

طبق گزارش Financial Times (به نقل از The Decoder) و Business Insider، این شرکت اسناد مالی‌اش رو به‌جای انتشار عمومی پروپکتوس، برای یه گروه کوچیک از سرمایه‌گذارا فرستاده و Nasdaq رو میزبان عرضه انتخاب کرده. شنیده‌ها از عرضه‌ی اکتبر می‌گه.

🔹 درآمد سه‌ماهه: ۱۱.۵ میلیارد دلار — حدود ۱۴ برابر سال قبل
🔹 نرخ درآمد سالانه تا پایان جولای: حدود ۶۵ میلیارد دلار
🔹 ارزش‌گذاری احتمالی: بالای ۲ تریلیون دلار
🔹 حاشیه‌ی سود ناخالص: بالای ۸۰٪ (پیش از سهم شرکت‌های شریک و هزینه‌ی آموزش)
🔹 تحلیلگرهای SemiAnalysis پیش‌بینی می‌کنن درآمد سالانه تا پایان امسال به ۱۲۰ میلیارد دلار برسه

⭕️ نکته: سوددهی با معیار تعدیل‌شده و بدون احتساب پرداخت سهامی حساب شده؛ همین هفته Sam Altman گفت OpenAI امسال وارد بورس نمی‌شه.

🔗 @hjcreative
لباس‌هایی که دوربین‌های هوشمند رو گول می‌زنن: «مد مداری» در برابر پاناپتیکون 🤖👕

مجله‌ی IEEE Spectrum توی یه گزارش تازه نوشته یه صنعت کوچیک داره شکل می‌گیره: لباس‌هایی با الگوهای مخصوصی که مدل‌های تشخیص چهره و انسان رو به اشتباه می‌ندازن.

🔹 Bill Swearingen متخصص امنیت، با یه فازر پایتونی و یادگیری تقویتی الگوهایی ساخته که روی ۱۱ مدل تشخیص اشیا (چهره و انسان) تست شده — تو بعضی تست‌ها اعتماد مدل رو تا حد «هیچ تشخیصی نده» پایین آورده
🔹 شرکت Cap_able همین الگوها رو داخل پارچه‌ی ژاکارد می‌بافه؛ بعضی سیستم‌ها پوشنده رو جای انسان، حیوان یا شیء می‌بینن
🔹 Urban Privacy هم با چاپ سیاه‌وسفید برگرفته از چهره، چهره‌های جعلی به دوربین تزریق می‌کنه تا پردازش کند بشه

⭕️ نکته: کارشناس‌ها می‌گن این «شنل نامرئی‌مد» نیست — زاویه‌ی دوربین، نور، چین پارچه و نحوه‌ی راه‌رفتن اثرش رو کم می‌کنه؛ «فقط یه فریم خوب برای شناسایی کافیه».

🔗 @hjcreative
مدل صوتی تازه‌ی Gemini لو رفت — این بار روی صفحه‌ی سهمیه‌های Google Cloud 👀

توی صفحه‌ی quotas کنسول Google Cloud اسم دو مدل تازه دیده شده: Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking — ظاهراً نسل تازه‌ی مدل زنده‌ی Gemini که روی مدل Gemini 3.8 Flash سواره.

🔹 تا الان تازه‌ترین مدل زنده، نسخه‌ی Gemini 3.1 Live Preview بود؛ پس این یه پرش نسلی حساب می‌شه
🔹 خود Google هنوز چیزی اعلام نکرده — این فقط یه لیک از اسم مدل‌هاست، نه عرضه‌ی رسمی

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
🐱 مغز مگس، بدن ربات؟ این ویدیو واقعیه

توی این دمو یه ربات چهارپای کوچیک با همون سیم‌کشی مغز مگس سرکه راه می‌ره — بدون حتی یه خط کد برای تعادل یا راه رفتن

🔹 طبق اعلام Google Research و HHMI Janelia، کل سیستم عصبی یه مگس سرکه‌ی نر بالغ — مغز، لوب‌های بینایی و طناب عصبی — نورون به نورون نقشه‌برداری شده: حدود ۱۶۶٬۷۰۰ نورون و ۱۲۵ میلیون سیناپس؛ کامل‌ترین نقشه‌ی عصبی که تا حالا از یه حیوان ساخته شده و توی Cell منتشر شده
🔹 حالا همون سیم‌کشی، شبیه‌سازی‌شده و زنده، داره پاهای ربات رو مستقیم هدایت می‌کنه؛ ورودی دوربین و سنسورها میاد تو، مدار زیستی مثل همیشه شلیک می‌کنه، خروجی میره سر پاها
🔹 نکته‌ی مهم: هیچ چیز زنده‌ای توی این حلقه نیست — بازسازی محاسباتی سیم‌کشی واقعیه؛ مغز واقعیه، بدن قرضیه

🧠 اثبات اینکه یه سیستم عصبی نقشه‌برداری‌شده می‌تونه هر بدنی رو که بهش بدی حرکت بده — یا پیش‌نمایشی از چیزی که هنوز آمادگی فکر کردن بهش رو نداریم؟

🔗 @hjcreative
یه ورک‌اسپیس تحقیقاتی تازه از راه رسیده که ایجنت داخلش زندگی می‌کنه 🔬

پروژه‌ی Panel که امروز روی Show HN اومده، یه محیط کاره که چت، فایل، PDF و نوتبوک Jupyter رو توی یه داک جمع می‌کنه و ایجنت (فعلاً از طریق Claude Code) کنار دستت کار می‌کنه — حتی وقتی هیچ پنل آماده‌ای برای کارت نباشه، خودش یه ویوئر یا اپ کوچیک می‌سازه و نشونت می‌ده

🔹 نوتبوک‌ها با کرنل واقعی اجرا می‌شن و تو و ایجنت هم‌زمان می‌تونید ادیتشون کنید
🔹 یه ماژول literature review هم داره که مرور مقاله تحویلت می‌ده
🔹 فعلاً نسخه‌ی اولیه‌ست و فقط با Claude Code کامل کار می‌کنه

⭕️ نکته: سورسش روی GitHub بازه ولی راه‌اندازیش Node و pnpm و uv می‌خواد — بیشتر به درد خوره‌های ابزارهای ایجنتی می‌خوره تا کاربر عادی

🔗 @hjcreative
هفته‌ی شلوغ OpenAI در راهه؟ 🚢

مدیرعامل OpenAI یعنی Sam Altman امروز توی X نوشته «یه هفته‌ی بزرگ در راهه... و بعدش هم DevDay با کلی 🚢🚢»

🔹 طبق گمانه‌زنی اکانت‌های خبری، مدل GPT-6 Sol و چند مدل کوچیک‌تر از خانواده‌ی GPT-6 توی همین هفته معرفی می‌شن
🔹 ولی ظاهراً مدل نسل بعدی فعلاً عقب افتاده و معلوم نیست سپتامبر بیاد یا نه

⭕️ نکته: اینا فعلاً حدس و گمانه — خود OpenAI هنوز اسم مدلی رو تأیید نکرده

🔗 @hjcreative
مدل ویدیویی Vidu S2 معرفی شد — آواتار و ادیت ویدیو به‌صورت ریل‌تایم 🎥

تیم Vidu با همکاری Tsinghua University مقاله‌ی مدل تازه‌ش رو منتشر کرده که دو قابلیت اصلی داره:

🔹 بخش Vidu S2-Avatar: ساخت ریل‌تایم ویدیوی 720p از کاراکتر دیجیتال که وسط اجرا می‌تونی رفرنسش رو عوض کنی — حتی رقصیدن رو هم دنبال می‌کنه
🔹 بخش Vidu S2-Editing: ادیت زنده‌ی استریم ویدیو — عوض کردن استایل، لباس، کاراکتر و پس‌زمینه
🔹 طبق مقاله، دموی آنلاین قابل بازی هم داره که می‌تونی خودت تستش کنی

⭕️ نکته: این مقاله‌ست نه محصول نهایی — ولی دموش آنلاینه و می‌تونی باهاش ور بری

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل تازه معرفی شده که به‌جای متن و عکس، «فیزیک دنیا» رو یاد گرفته 🌍
شرکت Odyssey امروز از مدل Odyssey-3 رونمایی کرد؛ یه world model که می‌تونه ربات‌ها رو کنترل کنه، humanoideها رو به حرکت دربیاره، ماشین رو توی خیابون‌های هند برونه، پهپاد بپروونه و حتی بازی ویدیویی انجام بده 🎮
🔹 طبق اعلام شرکت، فقط با چند ده ساعت دمو بازوهای رباتیک مختلف رو کنترل می‌کنه
🔹 رانندگی توی هند فقط با ۲۰ ساعت داده‌ی شبیه‌سازی‌شده یاد گرفته شده
🔗 @hjcreative