حسین جوان | هوش مصنوعی و خلاقیت
121 subscribers
683 photos
259 videos
2 files
104 links
Stay Creative💡

Contact me : @tknox
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
🐱 مغز مگس، بدن ربات؟ این ویدیو واقعیه

توی این دمو یه ربات چهارپای کوچیک با همون سیم‌کشی مغز مگس سرکه راه می‌ره — بدون حتی یه خط کد برای تعادل یا راه رفتن

🔹 طبق اعلام Google Research و HHMI Janelia، کل سیستم عصبی یه مگس سرکه‌ی نر بالغ — مغز، لوب‌های بینایی و طناب عصبی — نورون به نورون نقشه‌برداری شده: حدود ۱۶۶٬۷۰۰ نورون و ۱۲۵ میلیون سیناپس؛ کامل‌ترین نقشه‌ی عصبی که تا حالا از یه حیوان ساخته شده و توی Cell منتشر شده
🔹 حالا همون سیم‌کشی، شبیه‌سازی‌شده و زنده، داره پاهای ربات رو مستقیم هدایت می‌کنه؛ ورودی دوربین و سنسورها میاد تو، مدار زیستی مثل همیشه شلیک می‌کنه، خروجی میره سر پاها
🔹 نکته‌ی مهم: هیچ چیز زنده‌ای توی این حلقه نیست — بازسازی محاسباتی سیم‌کشی واقعیه؛ مغز واقعیه، بدن قرضیه

🧠 اثبات اینکه یه سیستم عصبی نقشه‌برداری‌شده می‌تونه هر بدنی رو که بهش بدی حرکت بده — یا پیش‌نمایشی از چیزی که هنوز آمادگی فکر کردن بهش رو نداریم؟

🔗 @hjcreative
یه ورک‌اسپیس تحقیقاتی تازه از راه رسیده که ایجنت داخلش زندگی می‌کنه 🔬

پروژه‌ی Panel که امروز روی Show HN اومده، یه محیط کاره که چت، فایل، PDF و نوتبوک Jupyter رو توی یه داک جمع می‌کنه و ایجنت (فعلاً از طریق Claude Code) کنار دستت کار می‌کنه — حتی وقتی هیچ پنل آماده‌ای برای کارت نباشه، خودش یه ویوئر یا اپ کوچیک می‌سازه و نشونت می‌ده

🔹 نوتبوک‌ها با کرنل واقعی اجرا می‌شن و تو و ایجنت هم‌زمان می‌تونید ادیتشون کنید
🔹 یه ماژول literature review هم داره که مرور مقاله تحویلت می‌ده
🔹 فعلاً نسخه‌ی اولیه‌ست و فقط با Claude Code کامل کار می‌کنه

⭕️ نکته: سورسش روی GitHub بازه ولی راه‌اندازیش Node و pnpm و uv می‌خواد — بیشتر به درد خوره‌های ابزارهای ایجنتی می‌خوره تا کاربر عادی

🔗 @hjcreative
هفته‌ی شلوغ OpenAI در راهه؟ 🚢

مدیرعامل OpenAI یعنی Sam Altman امروز توی X نوشته «یه هفته‌ی بزرگ در راهه... و بعدش هم DevDay با کلی 🚢🚢»

🔹 طبق گمانه‌زنی اکانت‌های خبری، مدل GPT-6 Sol و چند مدل کوچیک‌تر از خانواده‌ی GPT-6 توی همین هفته معرفی می‌شن
🔹 ولی ظاهراً مدل نسل بعدی فعلاً عقب افتاده و معلوم نیست سپتامبر بیاد یا نه

⭕️ نکته: اینا فعلاً حدس و گمانه — خود OpenAI هنوز اسم مدلی رو تأیید نکرده

🔗 @hjcreative
مدل ویدیویی Vidu S2 معرفی شد — آواتار و ادیت ویدیو به‌صورت ریل‌تایم 🎥

تیم Vidu با همکاری Tsinghua University مقاله‌ی مدل تازه‌ش رو منتشر کرده که دو قابلیت اصلی داره:

🔹 بخش Vidu S2-Avatar: ساخت ریل‌تایم ویدیوی 720p از کاراکتر دیجیتال که وسط اجرا می‌تونی رفرنسش رو عوض کنی — حتی رقصیدن رو هم دنبال می‌کنه
🔹 بخش Vidu S2-Editing: ادیت زنده‌ی استریم ویدیو — عوض کردن استایل، لباس، کاراکتر و پس‌زمینه
🔹 طبق مقاله، دموی آنلاین قابل بازی هم داره که می‌تونی خودت تستش کنی

⭕️ نکته: این مقاله‌ست نه محصول نهایی — ولی دموش آنلاینه و می‌تونی باهاش ور بری

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل تازه معرفی شده که به‌جای متن و عکس، «فیزیک دنیا» رو یاد گرفته 🌍
شرکت Odyssey امروز از مدل Odyssey-3 رونمایی کرد؛ یه world model که می‌تونه ربات‌ها رو کنترل کنه، humanoideها رو به حرکت دربیاره، ماشین رو توی خیابون‌های هند برونه، پهپاد بپروونه و حتی بازی ویدیویی انجام بده 🎮
🔹 طبق اعلام شرکت، فقط با چند ده ساعت دمو بازوهای رباتیک مختلف رو کنترل می‌کنه
🔹 رانندگی توی هند فقط با ۲۰ ساعت داده‌ی شبیه‌سازی‌شده یاد گرفته شده
🔗 @hjcreative
نسخه‌ی رسمی مدل‌های صوتی تازه‌ی Google اومد 🎙️
شرکت Google امروز مدل‌های Gemini 3.8 Live و 3.8 Live Extended Thinking رو رسماً معرفی کرد؛ همون‌هایی که صبح اسمشون توی صفحه‌ی سهمیه‌ها لو رفته بود 👀
🔹 نسخه‌ی Extended Thinking توی بنچمارک Artificial Analysis اول شده (امتیاز ۸۲.۶)
🔹 مکالمه به ۹۷ زبان، درک تصویری لحظه‌ای و اجرای تسک در پس‌زمینه
🔹 طبق نمودار رسمی خود شرکت، هزینه‌ی ساعتی ورودی صوتی از رقبا کمتره (۰.۸۴ دلار)
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
یه «مدیر محصول AI» از راه رسید که به‌جای حدس‌زدن، میره سراغ حرف‌های مشتری‌ها 🤖

شرکت BuildBetter امروز از ایجنت تازه‌ش به اسم BoB رونمایی کرد؛ ایجنتی که به گفته‌ی خودشون اولین AI Head of Productـه.

🔹 کل مکالمه‌های مشتری‌ها رو می‌خونه (فروش، محصول، مهندسی) و کارهای ارزشمند رو پیدا می‌کنه
🔹 قدم بعدی رو آماده می‌کنه و فقط برای تأیید نهایی میاره جلوت
🔹 قلب تپنده‌ش مدلیه به اسم AOT که خود شرکت ساخته و همه‌ی مکالمه‌ها رو می‌بلعه

⭕️ نکته: توی ویدیوهای دموش اسم مشتری‌ها Hooli و Gavin Belson و... ـه — مال سریال Silicon Valleyـه، یعنی دمو با دیتای تخیلیه 😄

🔗 @hjcreative
حالا نوبت ریاضیه که مدل‌ها باهاش شوخی کنن؟ 😄

ظاهراً شرکت Google داره روی نسخه‌ی ریاضی‌محور مدل DeepThink کار می‌کنه؛ چیزی که بعضی‌ها بهش میگن Gemini DeepThink Mathematica.

🔹 ماجرا از اونجا شروع شد که اکانت lyra از فکرهای خام (raw thoughts) این مدل اسکرین‌شات گذاشت؛ پر از ذوق و علامت تعجب سر یه معادله‌ی دیوفانتی چندجمله‌ای
🔹 اندرو کورن هم اضافه کرد که انگار این مدل از کارش لذت می‌بره و قراره سر بنچمارک Millennium هم عقب نمونه

⭕️ نکته: هنوز هیچ اعلام رسمی در کار نیست — فعلاً در حد لیک و اسکرین‌شاته، نه ریلیز

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
حالا میشه متن روی هر عکسی رو توی Grok Imagine ویرایش کرد ✏️

اکانت رسمی Imagine امروز اعلام کرد قابلیت تازه‌ای ویرایش متن اومده؛ دعوتنامه، پوستر، تبلیغ یا هر تصویر دیگه.
🔹 رنگ، اندازه، فونت و تراز متن رو دستی تنظیم می‌کنید
🔹 این ویژگی فعلاً در نسخه‌ی Betaـه و تیم SpaceXAI از کاربرها فیدبک می‌خواد
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
موبایلتون رو با پرامپت کنترل کنید؟ 📱

شرکت Google ابزاری به اسم ARTEMIS رو متن‌باز کرده که دستور متنی رو تبدیل می‌کنه به اتوماسیون اندروید.
🔹 طبق مخزن رسمی، نرخ موفقیتش بالای ۹۹٪ روی بنچمارک AndroidWorldـه
🔹 با دستیارهای کدنویسی مثل Codex، Claude Code و Antigravity یکپارچه میشه
🔹 مخزن google/artemis روی GitHub ظرف چند روز هزاران استار گرفته
🔗 @hjcreative
شرکت OpenAI بازنشستگی مدل GPT-5.5 رو اعلام کرد 👋
طبق چنج‌لاگ رسمی Codex، مدل GPT-5.5 از ۱۴ اکتبر ۲۰۲۶ از ChatGPT، نسخه‌ی Work و Codex کنار میره و کاربرا باید تا اون تاریخ به GPT-5.6 Sol مهاجرت کنن.
🔹 این تغییر فقط محصول‌های مصرفی رو شامل میشه و ورک‌فلوهای مبتنی بر API تحت تأثیر قرار نمی‌گیرن.
اگه هنوز روی GPT-5.5 هستی، وقتشه سوییچ کنی 👀
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
نسخه‌ی موبایل Gemini Notebook داره صوتی میشه 🎙️
طبق خبر تازه، حالت Voice Mode این هفته برای مشترک‌های Ultra فعال میشه و کاربرای Pro هم به‌زودی می‌گیرنش؛ ضبط صدا (مثل ضبط سر کلاس و تبدیلش به نوت) هم از هفته‌ی بعد برای انگلیسی و چند زبان دیگه میاد.
🔹 گزارش‌های تعاملیش رو دیروز معرفی کردیم؛ این موج صوتی قدم بعدیه 👀
🔗 @hjcreative
شرکت‌های AI راه‌حل چند مسئله‌ی تاریخی رو دارن و نگه داشتن؟ 🤯

استاد Scott Aaronson امشب توی وبلاگش نوشته شنیده که شرکت‌های AI به راه‌حل چند مسئله‌ی باز و قدیمی علوم کامپیوتر رسیدن، ولی بعد از جنجال اثبات Navier-Stokes فعلاً اعلامش نمی‌کنن.

🔹 ماجرا از ۸ سپتامبر شروع شد؛ وقتی شرکت OpenAI اعلام کرد مسئله‌ی Millennium مربوط به معادلات Navier-Stokes رو در ۸۸ ساعت حل کرده — ادعایی که با اعتراض بعضی ریاضی‌دان‌ها و دعوای اعتبار نویسندگی روبه‌رو شد.
🔹 حالا Aaronson می‌گه طبق شنیده‌هاش، راه‌حل چند مسئله‌ی بزرگ دیگه هم آماده‌ست (نه P≠NP، ولی در همون حد مهم).
🔹 هم‌زمان شایعه‌ی دیگری می‌گه شرکت OpenAI روی دومین مسئله‌ی Millennium هم «پیشرفت چشمگیر» داشته و شاید توی DevDay رونمایی کنه.

اگه درست باشه، هفته‌های آینده برای دنیای ریاضی تاریخی می‌شه 👀

🔗 @hjcreative
قانون‌گذاری برای AI لازمه یا نه؟ 🤔

مدیرعامل NVIDIA یعنی Jensen Huang امروز توی کنفرانس Dreamforce شرکت Salesforce گفته قانون تازه‌ای برای AI لازم نیست؛ به گفته‌ی او ایمنی «یه مسئله‌ی مهندسیه، نه حقوقی».

🔹 استدلالش اینه که مدل AI یه «ذهن بیگانه» نیست — فقط سخت‌افزار و نرم‌افزاره که انسان ساخته، پس خود شرکت‌ها می‌تونن کنترلش کنن و نیروی بازار کافیه: اگه از ایمنی محصول مطمئن نیستی، منتشرش نکن!

🔹 این موضع دقیقاً مقابل Dario Amodei، مدیرعامل Anthropic، قرار می‌گیره که خواهان قانون‌گذاریه؛ به نوشته‌ی CNBC این اختلاف توی همون رویداد علنی شد.

🔹 نویسنده‌ی TechCrunch اما یادآوری کرده حتی شرکت‌های خوش‌نیت هم محصول خراب میدن — از ماجرای CrowdStrike در ۲۰۲۴ تا آسیب‌هایی که مدل‌های AI تا حالا داشتن.

🔗 @hjcreative
شرکت OpenAI داره درباره‌ی یه راند تازه با ارزش‌گذاری ۱.۲ تریلیون دلار حرف می‌زنه 💰🤯

به گزارش Wall Street Journal، سازنده‌ی ChatGPT مذاکرات اولیه با سرمایه‌گذارها رو برای یه راند پیش از عرضه‌ی اولیه شروع کرده؛ اگه انجام بشه، بزرگ‌ترین ارزش‌گذاری خصوصی تاریخ تکنولوژی میشه. ظاهراً عرضه‌ی اولیه هم احتمالاً سال آینده‌ست.

🔹 روزنامه‌ی Financial Times هم همین عدد رو تأیید کرده و میگه این راند قبل از IPO انجام میشه.

🔗 @hjcreative
حسین جوان | هوش مصنوعی و خلاقیت
شرکت OpenAI داره درباره‌ی یه راند تازه با ارزش‌گذاری ۱.۲ تریلیون دلار حرف می‌زنه 💰🤯 به گزارش Wall Street Journal، سازنده‌ی ChatGPT مذاکرات اولیه با سرمایه‌گذارها رو برای یه راند پیش از عرضه‌ی اولیه شروع کرده؛ اگه انجام بشه، بزرگ‌ترین ارزش‌گذاری خصوصی تاریخ…
چرا این خبر مهمه؟ 📊

اگه این راند با همین عدد بسته بشه، شرکت OpenAI باارزش‌ترین شرکت خصوصی تاریخ میشه — بالاتر از هر استارتاپی که تا حالا دیده شده.

🔹 پولش کجاست؟ آموزش مدل‌های نسل بعد و زیرساخت عظیم دیتاسنتر (مثل پروژه‌ی Stargate) خرج‌های نجومی دارن و این راند عملاً سوخت همون مسیره.
🔹 زمان‌بندیش هم معناداره: خود Wall Street Journal میگه عرضه‌ی اولیه احتمالاً سال آینده‌ست، پس این آخرین راند خصوصی بزرگ قبل از بورسی‌شدن محسوب میشه.

🔗 @hjcreative
عکس واقعی در برابر AI: حالت تازه‌ی دوربین iPhone که ثابت می‌کنه عکس رو سنسور واقعی گرفته 📸

شرکت Apple دیروز توی وبلاگ امنیتی‌ش جزئیات Apple Reference Image رو منتشر کرد؛ یه حالت اختیاری دوربین که اول روی iPhone 18 Pro و Pro Max میاد.

🔹 ایده‌ش چیه؟ سنسور موقع ثبت، امضای رمزنگاری روی پیکسل‌ها می‌زنه و زمان ثبت رو هم با ساعت رمزنگاری‌شده‌ی خود Apple مهر می‌کنه — یعنی نه سیستم‌عامل، نه هیچ اپی نمی‌تونه دستکاریش کنه.
🔹 پردازش عکس هم داخل زیرساخت ابری Private Cloud Compute انجام میشه تا کل زنجیره قابل راستی‌آزمایی بمونه.
🔹 نتیجه یه «نگاتیو دیجیتال امن»ـه که ثابت می‌کنه این عکس واقعاً با سنسور واقعی، توی یه زمان مشخص گرفته شده — جواب Apple به سیل عکس‌های جعلی AI.

🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
مدل GPT-6 Astra حالا فیزیوتراپیست لحظه‌ای شماست؟ 🏃⌚️

شرکت Zentrix یه ستاپ نمایشی با مدل GPT-6 Astra و یه پوشیدنی سفارشی نشون داده که بیومکانیک بدن رو زنده می‌خونه
🔹 به‌جای تشخیص کلی، درد رو لحظه‌ای به عضله‌ی دقیق وصل می‌کنه — چیزی شبیه مدل زنده‌ی بدن خودت
🔹 توی دمو، تصویر واقعی کمر کنار مدل سه‌بعدی عضله‌ها (multifidus و rectus abdominis) نمایش داده می‌شه
⭕️ نکته: این دموی شرکت سازنده‌ست، نه محصول درمانی تأییدشده — برای درد واقعی هنوز پزشک حرف اول رو می‌زنه
🔗 @hjcreative
Media is too big
VIEW IN TELEGRAM
موضوع بده، ویدیوی آموزشی تحویل بگیر 🎬

یه مخزن تازه به اسم Anything 2 Explainer اومده که یه روش کامله برای ساخت ویدیوی آموزشی با ایجنت AI: خودش تحقیق می‌کنه، متن نریشن رو می‌نویسه، صدا رو با TTS تولید می‌کنه، استوری‌برد می‌کشه و هر فریم رو با Remotion (کدنویسی React) رندر می‌کنه — بدون فوتج آماده و بدون مدل ویدیوساز.

🔹 خروجی یه MP4 با ویس‌اور، زیرنویس و نوار پیشرفت فصل‌هاست؛ نمونه‌ی مرجعش یه ویدیوی ۵ دقیقه‌ای درباره‌ی RAGـه
🔹 به شکل اسکیل برای Claude Code و Codex منتشر شده و تو چند روز حدود ۱٫۴ هزار استار گرفته

🔗 @hjcreative
مرورگر Firefox حالا با مغز فرانسوی کار می‌کنه؟ 🦊🇫🇷

شرکت Mistral و بنیاد Mozilla امروز همکاری مشترکشون رو اعلام کردن: دستیار هوش مصنوعی مرورگر Firefox یعنی Smart Window (نسخه‌ی بتا) از این به بعد با مدل‌های Mistral کار می‌کنه.

🔹 این دستیار کمک می‌کنه جست‌وجوهای پیچیده رو جمع‌وجور بفهمی، چیزی که وسط تب‌ها گم کردی رو پیدا کنی و بر اساس تب‌های بازت اطلاعات مرتبط بگیری
🔹 اول برای کاربرای فرانسه و آمریکای شمالی فعال میشه؛ بریتانیا و آلمان هم تا آخر امسال اضافه میشن
🔹 نکته‌ی مهمش حریمه: مکالمه‌ها به‌صورت پیش‌فرض روی سرورهای Mozilla ذخیره نمیشن و شرکت Mistral هم متعهد شده هیچ داده‌ای رو نگه نداره

حالا دو مدافع قدیمی اوپن‌سورس می‌خوان AI داخل مرورگر رو باز، چندزبانه و تحت کنترل خود کاربر نگه دارن — رقابت مستقیم با دستیارهای بسته‌ی بقیه‌ی مرورگرها 👀

🔗 @hjcreative
شرکت Google یه مؤسسه‌ی تازه برای عصر AGI راه انداخت 🧠

آزمایشگاهی که AlphaGo و AlphaFold رو ساخته، حالا پلتفرمی به اسم DeepMind Institute راه انداخته؛ جایی برای فکرهای جدی و میان‌رشته‌ای درباره‌ی پیامدهای AGI برای بشریت.

🔹 مقاله‌ی افتتاحیه رو Shane Legg (هم‌بنیان‌گذار DeepMind) با James Manyika و Demis Hassabis نوشتن؛ حرف اصلی Legg اینه که با این سرعت پیشرفت، به AGI نزدیک میشیم
🔹 مقالات اول درباره‌ی شفافیت استدلال مدل‌ها، سیاست اقتصادی برای AGI و چارچوب تست مدل‌های فرانتیره
⭕️ نکته: طبق توضیح خود سایت، این مقالات نظر شخصی نویسنده‌هاست، نه موضع رسمی Google

🔗 @hjcreative