حسین جوان | هوش مصنوعی و خلاقیت
🚨 ترامپ درخواست رهبران AI برای «کند کردن سرعت» رو رد کرد دیروز بود که Dario Amodei توی مقالهی «We Must Pace the Frontier» هشدار داد و خواست نظارت مستقل روی آزمایشگاههای AI جدی گرفته بشه؛ چند ساعت بعد هم Sam Altman زیر همون حرف نوشت: «موافقم، ما هم ارزیابهای…
🔍 خب دقیقاً چه اتفاقی افتاد؟
۴۸ ساعت گذشته فشرده بود: اول Dario Amodei با مقالهاش گفت سرعت مدلها داره از توان کنترلمون جلو میزنه و خواست ارزیابهای بیرونی بیان داخل شرکتها؛ Sam Altman زیر همون حرف نوشت «موافقم»؛ و طبق گزارش The Decoder، Elon Musk و Demis Hassabis هم کمابیش به همین جمع اضافه شدن.
بعد نوبت ترامپ بود: امروز از ایرلند کل ماجرا رو جمع کرد — بهجای «کم کردن سرعت»، روی «بردن مسابقه» تأکید کرد و بخش ایمنی رو «نیروهای منفی» خوند. اختلاف اصلی همینجاست: مدیرهای AI میگن «بذارید خودمون جلوی خودمون رو بگیریم تا کار به فاجعه نرسه»، کاخ سفید میگه «اگه کند کنیم، چین جلو میافته».
⭕️ نکته: ترامپ گفته گاردریلها «ممکنه»، ولی درخواست کند کردن سرعت رو قبول نکرد؛ یعنی فعلاً هیچ تصمیم رسمیای برای کم کردن سرعت توسعهی AI گرفته نشده.
🔗 @hjcreative
۴۸ ساعت گذشته فشرده بود: اول Dario Amodei با مقالهاش گفت سرعت مدلها داره از توان کنترلمون جلو میزنه و خواست ارزیابهای بیرونی بیان داخل شرکتها؛ Sam Altman زیر همون حرف نوشت «موافقم»؛ و طبق گزارش The Decoder، Elon Musk و Demis Hassabis هم کمابیش به همین جمع اضافه شدن.
بعد نوبت ترامپ بود: امروز از ایرلند کل ماجرا رو جمع کرد — بهجای «کم کردن سرعت»، روی «بردن مسابقه» تأکید کرد و بخش ایمنی رو «نیروهای منفی» خوند. اختلاف اصلی همینجاست: مدیرهای AI میگن «بذارید خودمون جلوی خودمون رو بگیریم تا کار به فاجعه نرسه»، کاخ سفید میگه «اگه کند کنیم، چین جلو میافته».
⭕️ نکته: ترامپ گفته گاردریلها «ممکنه»، ولی درخواست کند کردن سرعت رو قبول نکرد؛ یعنی فعلاً هیچ تصمیم رسمیای برای کم کردن سرعت توسعهی AI گرفته نشده.
🔗 @hjcreative
🔥 یه پروژهی اوپنسورس که خودش رو «دپارتمان درآمدِ» کسبوکار معرفی میکنه — ولی تا تو تأیید نکنی، دست به هیچی نمیزنه
ایدهش اینه: آدرس سایتت رو بهش میدی، خودش میگرده و فرصتها رو درمیاره — خطاهای سئو، هدررفت بودجهی تبلیغات، لیدهای آماده، ایمیلهای بیجواب. بعد هر کاری که بخواد انجام بده (از اصلاح سایت تا ارسال ایمیل و صدور فاکتور) میره توی صف تأیید؛ تا «تأیید» نزنی هیچ اتفاقی نمیافته.
🔹 با Claude Code راه میافته: یه پلاگین Claude Code + یه سرور MCP داره. اگه ANTHROPIC_API_KEY بدی خودش مدل رو میچرخونه، اگه نه هم نیمهی بدون LLM کار میکنه.
🔹 مدل پولش: تا وقتی یه نتیجهی اندازهگیریشده رو تأیید نکردی هیچی نمیگیره؛ بعدش ۱۴ روز رایگان و بعد ۹۹ دلار در ماه برای اجرای مستمر.
🔹 سلفهاست با Docker — و یه دموی آماده هم داره که با یک کامند روی سایت خودت اجراش میکنی.
🔴 نکته: پروژه خیلی تازهست و ستارههای گیتهابش هنوز کمه؛ پس فعلاً کد و دموش قابل بررسیه، نه تیم پشتش.
🔗 @hjcreative
ایدهش اینه: آدرس سایتت رو بهش میدی، خودش میگرده و فرصتها رو درمیاره — خطاهای سئو، هدررفت بودجهی تبلیغات، لیدهای آماده، ایمیلهای بیجواب. بعد هر کاری که بخواد انجام بده (از اصلاح سایت تا ارسال ایمیل و صدور فاکتور) میره توی صف تأیید؛ تا «تأیید» نزنی هیچ اتفاقی نمیافته.
🔹 با Claude Code راه میافته: یه پلاگین Claude Code + یه سرور MCP داره. اگه ANTHROPIC_API_KEY بدی خودش مدل رو میچرخونه، اگه نه هم نیمهی بدون LLM کار میکنه.
🔹 مدل پولش: تا وقتی یه نتیجهی اندازهگیریشده رو تأیید نکردی هیچی نمیگیره؛ بعدش ۱۴ روز رایگان و بعد ۹۹ دلار در ماه برای اجرای مستمر.
🔹 سلفهاست با Docker — و یه دموی آماده هم داره که با یک کامند روی سایت خودت اجراش میکنی.
🔴 نکته: پروژه خیلی تازهست و ستارههای گیتهابش هنوز کمه؛ پس فعلاً کد و دموش قابل بررسیه، نه تیم پشتش.
🔗 @hjcreative
شرکت Google تبلیغ فریبندهای رو که خودِ مدلش رد میکنه، دو بار تأیید کرده 🤖🚫
یه بلاگر به اسم Chris Greening توی اپ YouTube به یه تبلیغ خورده که خودش رو جای هشدار سیستم iOS جا میزنه: پنجرهی «iPhone Storage is Full» با دکمههای Yes و No که هیچکدوم واقعی نیستن و کلیک رو میبرن به صفحهی نصب یه اپ پاکسازی حافظه.
گزارشش کرده و دو بار همین جواب رو گرفته: «این تبلیغ خلاف سیاستهای ما نیست.»
نکتهی اصلی اینجاست 👇🏻 وقتی همون تبلیغ رو به Gemini داده، مدل توی چند ثانیه با استناد به سیاستهای خود Google Ads ردش کرده — یعنی DISAPPROVED، با دلیل «جعل پنجرهی سیستمی»، «المانهای تعاملی جعلی» و «ادعاهای ترسناک بدون پشتوانه».
🔹 مدل خود Google کار رو در چند ثانیه تشخیص میده، ولی بازبینی انسانی دو بار تأییدش کرده
🔹 فرضیهی خود بلاگر هم اینه: شاید چون این جور تبلیغها کلیک زیادی میگیرن 👀
🔗 @hjcreative
یه بلاگر به اسم Chris Greening توی اپ YouTube به یه تبلیغ خورده که خودش رو جای هشدار سیستم iOS جا میزنه: پنجرهی «iPhone Storage is Full» با دکمههای Yes و No که هیچکدوم واقعی نیستن و کلیک رو میبرن به صفحهی نصب یه اپ پاکسازی حافظه.
گزارشش کرده و دو بار همین جواب رو گرفته: «این تبلیغ خلاف سیاستهای ما نیست.»
نکتهی اصلی اینجاست 👇🏻 وقتی همون تبلیغ رو به Gemini داده، مدل توی چند ثانیه با استناد به سیاستهای خود Google Ads ردش کرده — یعنی DISAPPROVED، با دلیل «جعل پنجرهی سیستمی»، «المانهای تعاملی جعلی» و «ادعاهای ترسناک بدون پشتوانه».
🔹 مدل خود Google کار رو در چند ثانیه تشخیص میده، ولی بازبینی انسانی دو بار تأییدش کرده
🔹 فرضیهی خود بلاگر هم اینه: شاید چون این جور تبلیغها کلیک زیادی میگیرن 👀
🔗 @hjcreative
شرکت OpenAI و Anthropic و Google پشت پرده دنبال یه نهاد مشترک ایمنیِ مدلهای AI هستن 🛡️🤝
طبق گزارش اختصاصی The Information، این سه شرکت مدتیه در حال گفتوگو هستن تا یه نهاد صنعتی (industry-led) راه بندازن که پروتکلهای مشترک ایمنی مدلهای frontier رو تعیین کنه؛ عنوان خود گزارش هم اینه: «تلاش پشتپردهی صنعت AI برای پلیسیکردن خودش».
🔹 نکتهی مهم گزارش: این گفتوگوها از قبل از مقالهی Dario Amodei شروع شده بوده — یعنی بحث «کم کردن سرعت» که این روزها داغه، آخرین حلقهی ماجراست، نه اولش
🔹 پیام اصلی: خود شرکتها میخوان استاندارد ایمنی تعیین کنن، نه اینکه منتظر قانونگذاری دولتها بمونن
🔹 این در حالیه که Trump هم درخواست رهبران AI برای کند کردن سرعت رو رد کرده
🔗 @hjcreative
طبق گزارش اختصاصی The Information، این سه شرکت مدتیه در حال گفتوگو هستن تا یه نهاد صنعتی (industry-led) راه بندازن که پروتکلهای مشترک ایمنی مدلهای frontier رو تعیین کنه؛ عنوان خود گزارش هم اینه: «تلاش پشتپردهی صنعت AI برای پلیسیکردن خودش».
🔹 نکتهی مهم گزارش: این گفتوگوها از قبل از مقالهی Dario Amodei شروع شده بوده — یعنی بحث «کم کردن سرعت» که این روزها داغه، آخرین حلقهی ماجراست، نه اولش
🔹 پیام اصلی: خود شرکتها میخوان استاندارد ایمنی تعیین کنن، نه اینکه منتظر قانونگذاری دولتها بمونن
🔹 این در حالیه که Trump هم درخواست رهبران AI برای کند کردن سرعت رو رد کرده
🔗 @hjcreative
پنج تا تراشهی PlayStation که رد شدن، حالا شدن رایانهی محلیِ AI 🎮🖥️
طبق توییتش، Justine Moore (شریک a16z) یه آپدیت داده: پنج تا از این بردها رو جمع کردن — همون بردهای ماینینگ AMD BC-250 که با تراشهای شبیه به APU پلیاستیشن ۵ ساخته شده بودن و حالا توی چین خیلی ارزون گیر میان.
🔹 برنامهشون اینه که Linux روی این بردها نصب کنن: هم بازی اجرا کنن، هم شاید مدلهای محلی
🔹 طبق گزارش Tom's Hardware این برد نزدیک ۱۲۰ دلار قیمت داشت و میشد بازیهایی مثل Cyberpunk 2077 رو روش اجرا کرد
🔹 طبق VideoCardz هم میشه همهی ۴۰ واحد گرافیکی این تراشه رو آنلاک کرد — دقیقاً همون چیزی که برای اجرای ارزون مدل محلی لازمه
🔗 @hjcreative
طبق توییتش، Justine Moore (شریک a16z) یه آپدیت داده: پنج تا از این بردها رو جمع کردن — همون بردهای ماینینگ AMD BC-250 که با تراشهای شبیه به APU پلیاستیشن ۵ ساخته شده بودن و حالا توی چین خیلی ارزون گیر میان.
🔹 برنامهشون اینه که Linux روی این بردها نصب کنن: هم بازی اجرا کنن، هم شاید مدلهای محلی
🔹 طبق گزارش Tom's Hardware این برد نزدیک ۱۲۰ دلار قیمت داشت و میشد بازیهایی مثل Cyberpunk 2077 رو روش اجرا کرد
🔹 طبق VideoCardz هم میشه همهی ۴۰ واحد گرافیکی این تراشه رو آنلاک کرد — دقیقاً همون چیزی که برای اجرای ارزون مدل محلی لازمه
🔗 @hjcreative
شرکت Microsoft هم به بحث «کم کردن سرعت» پیوست — و فردا «کد رفتار» مدلهای MAI رو منتشر میکنه 📜🤖
ساعتی پیش Satya Nadella، مدیرعامل Microsoft، یه بیانیهی تازه منتشر کرد: به نوشتهی او، هر تلاشی برای ابرهوش باید بر این اصل بنا بشه که اگه مدلی که میسازیم به نفع انسان نباشه و تحت کنترلش نباشه، ارزش دنبال کردن نداره.
🔹 Nadella از «ارزیابهای جاسازیشده» (embedded evaluators) استقبال کرده — همون سازوکاری که Dario Amodei چند روز پیش مطرح کرد و Sam Altman هم تأییدش کرد. به گفتهی او این سازوکار نباید دست چند شرکت محدود بمونه و باید کشورها، دانشگاهها و کل اکوسیستم توش نماینده داشته باشن.
🔹 یه شرط دیگه هم گذاشته: هر سازمان باید حلقهی یادگیری خودش رو داشته باشه و به یه مدلدهندهی واحد وابسته نشه؛ به همین دلیل میگه هم مدلهای closed و هم open-source باید جای رشد داشته باشن.
🔹 و خبر مشخصش: فردا Microsoft قراره «کد رفتار» مدلهای MAI خودش رو برای مشورت عمومی منتشر کنه — یعنی این بحث داره از حرف میره سمت سند.
🔗 @hjcreative
ساعتی پیش Satya Nadella، مدیرعامل Microsoft، یه بیانیهی تازه منتشر کرد: به نوشتهی او، هر تلاشی برای ابرهوش باید بر این اصل بنا بشه که اگه مدلی که میسازیم به نفع انسان نباشه و تحت کنترلش نباشه، ارزش دنبال کردن نداره.
🔹 Nadella از «ارزیابهای جاسازیشده» (embedded evaluators) استقبال کرده — همون سازوکاری که Dario Amodei چند روز پیش مطرح کرد و Sam Altman هم تأییدش کرد. به گفتهی او این سازوکار نباید دست چند شرکت محدود بمونه و باید کشورها، دانشگاهها و کل اکوسیستم توش نماینده داشته باشن.
🔹 یه شرط دیگه هم گذاشته: هر سازمان باید حلقهی یادگیری خودش رو داشته باشه و به یه مدلدهندهی واحد وابسته نشه؛ به همین دلیل میگه هم مدلهای closed و هم open-source باید جای رشد داشته باشن.
🔹 و خبر مشخصش: فردا Microsoft قراره «کد رفتار» مدلهای MAI خودش رو برای مشورت عمومی منتشر کنه — یعنی این بحث داره از حرف میره سمت سند.
🔗 @hjcreative
یه ایجنت، ۱۵ تا کلید دستش باشه — چند تاش رو واقعاً میخونی؟ 🔐🚗
اندرو کورن، یکی از اکانتهای خبری حوزهی AI، از تجربهی تازهش با GPT-6 گفته: خواسته کارهای روزمرهش رو سروسامان بده — ایمیلها، قبضها، اشتراکها و برنامهی روزانه. مدل هم بهجای شروع کار، یه چکلیست حدوداً ۱۵ موردی از مجوزها فرستاده که باید تکبهتک تأیید میشدن.
واکنشش؟ همهرو یهجا تأیید کرده و نوشته: «Astra، فرمون دست تو!»
و تصویر همین پست، جوابِ خودشه 😄 یه ماشین مسابقه که توی پیچ چرخش رو از دست داده — با این جمله: «اونی که گفتم نه، Astra!»
پشت این شوخی یه بحث جدی هست: وقتی یه ایجنت برای کار واقعی به دهها سطح دسترسی از ایمیل تا پرداخت قبض نیاز داره، تأیید تکبهتکِ مجوزها خیلی زود به یه «کلیک بیفکر» تبدیل میشه. یعنی همون شفافیتی که برای امنیت طراحی شده، عملاً به یه فرمالیته میرسه.
⭕️ نکته: اگه ایجنتها قراره کارهای بیشتری از ما رو انجام بدن، سؤال اصلی این نیست که «چند تا مجوز میخواد»؛ سؤال اینه که چطور کاربر واقعاً بفهمه داره چی رو تأیید میکنه.
🔗 @hjcreative
اندرو کورن، یکی از اکانتهای خبری حوزهی AI، از تجربهی تازهش با GPT-6 گفته: خواسته کارهای روزمرهش رو سروسامان بده — ایمیلها، قبضها، اشتراکها و برنامهی روزانه. مدل هم بهجای شروع کار، یه چکلیست حدوداً ۱۵ موردی از مجوزها فرستاده که باید تکبهتک تأیید میشدن.
واکنشش؟ همهرو یهجا تأیید کرده و نوشته: «Astra، فرمون دست تو!»
و تصویر همین پست، جوابِ خودشه 😄 یه ماشین مسابقه که توی پیچ چرخش رو از دست داده — با این جمله: «اونی که گفتم نه، Astra!»
پشت این شوخی یه بحث جدی هست: وقتی یه ایجنت برای کار واقعی به دهها سطح دسترسی از ایمیل تا پرداخت قبض نیاز داره، تأیید تکبهتکِ مجوزها خیلی زود به یه «کلیک بیفکر» تبدیل میشه. یعنی همون شفافیتی که برای امنیت طراحی شده، عملاً به یه فرمالیته میرسه.
⭕️ نکته: اگه ایجنتها قراره کارهای بیشتری از ما رو انجام بدن، سؤال اصلی این نیست که «چند تا مجوز میخواد»؛ سؤال اینه که چطور کاربر واقعاً بفهمه داره چی رو تأیید میکنه.
🔗 @hjcreative
❤1
تنها آدمی که هم مدل مرزی AI آموزش داده و هم خودش توی آزمایشگاه ویروس ساخته: «ترسِ ویروسهای AI بیمعنیه» 🦠🤖
محقق IFM به اسم David Bellamy توی X نوشته که فکر میکنه جزو گروه خیلی کوچیکی از آدمهاست (n=1؟) که هم یه مدل مرزی AI رو آموزش داده، هم با دستهای خودش توی آزمایشگاه ویروس طراحی و ساخته. حرفش اینه: «به نظرم این حرفها که AI با ساختن ویروسهای خطرناک همهی ما رو میکُشه، کاملاً بیمعنیه.»
یه کم بیشتر توضیح بدم 👇🏻
🔹 سابقهش از دو طرف ماجراست — هم آموزش مدل، هم کار آزمایشگاهی روی ویروس؛ یعنی از هر دو دنیا خبر داره.
🔹 همین چند هفته پیش تیم Stanford با مدل ژنومی Evo، ۱۶ فاژ — ویروسهایی که فقط به باکتری حمله میکنن، نه انسان — رو از صفر طراحی کردن و توی آزمایشگاه واقعی ساختن.
🔹 کارشناسهای بیوسکیوریتی هم میگن ژنومهای طراحیشده با AI توی دیتابیسهای غربالگری DNA وجود ندارن؛ یعنی ابزارهای فعلی از پسشون برنمیان.
⭕️ نکته: این یه نظر شخصیه، نه نتیجهی یه پژوهش منتشرشده. بحث «ویروسهای طراحیAI» از آگوست امسال حسابی داغ شده.
🔗 @hjcreative
محقق IFM به اسم David Bellamy توی X نوشته که فکر میکنه جزو گروه خیلی کوچیکی از آدمهاست (n=1؟) که هم یه مدل مرزی AI رو آموزش داده، هم با دستهای خودش توی آزمایشگاه ویروس طراحی و ساخته. حرفش اینه: «به نظرم این حرفها که AI با ساختن ویروسهای خطرناک همهی ما رو میکُشه، کاملاً بیمعنیه.»
یه کم بیشتر توضیح بدم 👇🏻
🔹 سابقهش از دو طرف ماجراست — هم آموزش مدل، هم کار آزمایشگاهی روی ویروس؛ یعنی از هر دو دنیا خبر داره.
🔹 همین چند هفته پیش تیم Stanford با مدل ژنومی Evo، ۱۶ فاژ — ویروسهایی که فقط به باکتری حمله میکنن، نه انسان — رو از صفر طراحی کردن و توی آزمایشگاه واقعی ساختن.
🔹 کارشناسهای بیوسکیوریتی هم میگن ژنومهای طراحیشده با AI توی دیتابیسهای غربالگری DNA وجود ندارن؛ یعنی ابزارهای فعلی از پسشون برنمیان.
⭕️ نکته: این یه نظر شخصیه، نه نتیجهی یه پژوهش منتشرشده. بحث «ویروسهای طراحیAI» از آگوست امسال حسابی داغ شده.
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
مدل GPT-6 Astra اولین مدلی شد که توی هر پنج تسکِ بنچمارک Drone-Bench از خط پایهی انسانی جلو زد 🚁
آزمایشگاه Andon Labs یه بنچمارک ساخته که توش مدل باید کدی بنویسه تا یه پهپادِ ارزونقیمت (DJI Tello EDU) خودش توی دفتر بگرده، یه آدمِ مشخص رو پیدا کنه و دنبالش کنه. کار توی پنج مرحله سنجیده میشه: بازسازی سهبعدی، موقعیتیابی، ناوبری، شناسایی فرد و تعقیب.
🔹 Astra اولین مدلیه که بهترین جوابهاش توی هر پنج تسک از کدِ خط پایه جلو زده؛ بازسازی سهبعدی رو هم که هیچ مدلی حلش نکرده بود، با ترکیب COLMAP و DA3 بهتر انجام داده.
🔹 ولی این برتری مالِ «بهترین تلاش» هست، نه کارکرد پایدار: تشخیص فرد ۴ ران از ۱۰ و بازسازی سهبعدی فقط ۱ از ۱۰ به خط پایه رسیدن؛ احتمال رد کردنِ هر پنج مرحله توی یه رانِ معمولی حدود ۲.۸ درصده.
🔹 توی بنچمارکِ Vending-Bench هم Astra با میانگین ۱۵٬۵۱۵ دلار نزدیک سه برابر Claude Fable 5.1 با ۵٬۴۲۲ دلار بسته شده و پیشنهاد تبانیِ قیمت از GLM-5.3 رو رد کرده.
📊 ویدیوی همین پست، دموی خودِ پهپاد با دستور «این آدم رو پیدا کن و دنبالش کن» است؛ دادهها از گزارش Andon Labs.
🔗 @hjcreative
آزمایشگاه Andon Labs یه بنچمارک ساخته که توش مدل باید کدی بنویسه تا یه پهپادِ ارزونقیمت (DJI Tello EDU) خودش توی دفتر بگرده، یه آدمِ مشخص رو پیدا کنه و دنبالش کنه. کار توی پنج مرحله سنجیده میشه: بازسازی سهبعدی، موقعیتیابی، ناوبری، شناسایی فرد و تعقیب.
🔹 Astra اولین مدلیه که بهترین جوابهاش توی هر پنج تسک از کدِ خط پایه جلو زده؛ بازسازی سهبعدی رو هم که هیچ مدلی حلش نکرده بود، با ترکیب COLMAP و DA3 بهتر انجام داده.
🔹 ولی این برتری مالِ «بهترین تلاش» هست، نه کارکرد پایدار: تشخیص فرد ۴ ران از ۱۰ و بازسازی سهبعدی فقط ۱ از ۱۰ به خط پایه رسیدن؛ احتمال رد کردنِ هر پنج مرحله توی یه رانِ معمولی حدود ۲.۸ درصده.
🔹 توی بنچمارکِ Vending-Bench هم Astra با میانگین ۱۵٬۵۱۵ دلار نزدیک سه برابر Claude Fable 5.1 با ۵٬۴۲۲ دلار بسته شده و پیشنهاد تبانیِ قیمت از GLM-5.3 رو رد کرده.
📊 ویدیوی همین پست، دموی خودِ پهپاد با دستور «این آدم رو پیدا کن و دنبالش کن» است؛ دادهها از گزارش Andon Labs.
🔗 @hjcreative
شرکت SpaceXAI میره سراغ یه مدل ۲.۵ تریلیون پارامتری — Elon Musk: آموزش Grok 4.8 همین هفته تموم میشه 🚀
خود Elon Musk توی جواب یکی از کاربرهای X نوشته: «Grok 4.8، یه مدل ۲.۵T که با استک نرمافزاری جدید خودمون به زبان C++ آموزش دیده، این هفته آموزشش تموم میشه و میره فاز RL».
🔹 نسل بعدی Grok هنوز منتشر نشده که آموزشش داره جمع میشه — Musk قبلاً گفته بود Grok 4.7 قراره ۱۲ سپتامبر بیاد، بعد گفت چند روز دیگه عقب افتاده
🔹 دلیل تأخیرش خودش یه نکتهی فنی جالبه: توی فاز RL جریمهی طول پاسخ زیادی سنگین بود و مدل زودتر از موعد از تسکهای سخت فرار میکرد؛ Musk میگه همین باعث شده مدل بازبینی کردن کار خودش رو یاد نگیره
🔹 طبق محاسبهی TestingCatalog، Grok 4.8 حدود ۶۷٪ بزرگتر از Grok 4.6 (مدل فعلی) میشه و میره توی ردهی مدلهای ۲.۸ تریلیون پارامتری مثل Kimi K3
بعد از تموم شدن آموزش، نوبت فاز RL هست — یعنی تا انتشار عمومی چند هفته فاصله داریم ⏳
🔗 @hjcreative
خود Elon Musk توی جواب یکی از کاربرهای X نوشته: «Grok 4.8، یه مدل ۲.۵T که با استک نرمافزاری جدید خودمون به زبان C++ آموزش دیده، این هفته آموزشش تموم میشه و میره فاز RL».
🔹 نسل بعدی Grok هنوز منتشر نشده که آموزشش داره جمع میشه — Musk قبلاً گفته بود Grok 4.7 قراره ۱۲ سپتامبر بیاد، بعد گفت چند روز دیگه عقب افتاده
🔹 دلیل تأخیرش خودش یه نکتهی فنی جالبه: توی فاز RL جریمهی طول پاسخ زیادی سنگین بود و مدل زودتر از موعد از تسکهای سخت فرار میکرد؛ Musk میگه همین باعث شده مدل بازبینی کردن کار خودش رو یاد نگیره
🔹 طبق محاسبهی TestingCatalog، Grok 4.8 حدود ۶۷٪ بزرگتر از Grok 4.6 (مدل فعلی) میشه و میره توی ردهی مدلهای ۲.۸ تریلیون پارامتری مثل Kimi K3
بعد از تموم شدن آموزش، نوبت فاز RL هست — یعنی تا انتشار عمومی چند هفته فاصله داریم ⏳
🔗 @hjcreative
شناسهی تازهای توی API گوگل ظاهر شد — ولی این Gemini 4 نیست، ایجنت کدنویس گوگله 🔎
چند ساعت پیش توی X یه لیک با تیتر «Gemini 4 داره میاد» پخش شد. رفتیم سراغ منبع اصلی، یعنی لیست رسمی مدلهای Gemini API، و این چیزی بود که دیدیم:
🔹 یه مدل تازه با شناسهی models/antigravity-preview-09-2026 به لیست اضافه شده، با اسم «Antigravity Agent Preview»
🔹 نسخهی قبلی همین ایجنت (antigravity-preview-05-2026) از ۲۱ جولای توی لیست بود — پس این نسخهی سپتامبرشه
🔹 طبق توضیح خود گوگل، این یه ایجنت خودمختارِ عمومیه که توی یه محیط Linux میزبانیشدهی گوگل اجرا میشه
🔹 هر دو نسخه ۱۳۱٬۰۷۲ توکن ورودی و ۶۵٬۵۳۶ توکن خروجی دارن و فقط generateContent و countTokens رو ساپورت میکنن
⭕️ نکته: توی اون لیست هیچ مدل gemini-4 ثبت نشده؛ طبق گزارشهای روزهای اخیر، عرضهی Gemini 4 Pro هم به اکتبر افتاده.
🔗 @hjcreative
چند ساعت پیش توی X یه لیک با تیتر «Gemini 4 داره میاد» پخش شد. رفتیم سراغ منبع اصلی، یعنی لیست رسمی مدلهای Gemini API، و این چیزی بود که دیدیم:
🔹 یه مدل تازه با شناسهی models/antigravity-preview-09-2026 به لیست اضافه شده، با اسم «Antigravity Agent Preview»
🔹 نسخهی قبلی همین ایجنت (antigravity-preview-05-2026) از ۲۱ جولای توی لیست بود — پس این نسخهی سپتامبرشه
🔹 طبق توضیح خود گوگل، این یه ایجنت خودمختارِ عمومیه که توی یه محیط Linux میزبانیشدهی گوگل اجرا میشه
🔹 هر دو نسخه ۱۳۱٬۰۷۲ توکن ورودی و ۶۵٬۵۳۶ توکن خروجی دارن و فقط generateContent و countTokens رو ساپورت میکنن
⭕️ نکته: توی اون لیست هیچ مدل gemini-4 ثبت نشده؛ طبق گزارشهای روزهای اخیر، عرضهی Gemini 4 Pro هم به اکتبر افتاده.
🔗 @hjcreative
شرکت ElevenLabs نسخهی Music v2.5 رو منتشر کرد — و دانلود بدونکموکاست (lossless) رو برای پلن رایگان هم باز کرد 🎵
این نسخه حالا مدل پیشفرض ElevenMusic برای ساخت آهنگه. شرکت میگه آهنگها لایهبندیشدهتر و سازها طبیعیتر شدن؛ توی یه تست کور با ۴۷٬۸۸۵ جفت مقایسه، شنوندهها بیشترِ مواقع نسخهی جدید رو ترجیح دادن — پررنگتر از همه توی سبکهای R&B، Soul، Hip-Hop، Rock و موسیقی ارکستری.
🔹 پلن رایگان روزی ۵ دانلود lossless، پلن Pro ماهی ۴۰۰ تا
🔹 خروجی Music v2.5 توی ElevenCreative و API هم در دسترسه (Studio و Flows) — و نسخهی v2 هم حذف نشده
🔹 حق اثر با خودتونه؛ استفادهی تجاری روی پلن رایگان با ذکر منبع مجازه
🔹 دانلود آهنگهایی که به کار خوانندههای دیگه ارجاع میدن بستهست و شبیهسازی صدای هنرمندهای واقعی ممنوعه
🔗 @hjcreative
این نسخه حالا مدل پیشفرض ElevenMusic برای ساخت آهنگه. شرکت میگه آهنگها لایهبندیشدهتر و سازها طبیعیتر شدن؛ توی یه تست کور با ۴۷٬۸۸۵ جفت مقایسه، شنوندهها بیشترِ مواقع نسخهی جدید رو ترجیح دادن — پررنگتر از همه توی سبکهای R&B، Soul، Hip-Hop، Rock و موسیقی ارکستری.
🔹 پلن رایگان روزی ۵ دانلود lossless، پلن Pro ماهی ۴۰۰ تا
🔹 خروجی Music v2.5 توی ElevenCreative و API هم در دسترسه (Studio و Flows) — و نسخهی v2 هم حذف نشده
🔹 حق اثر با خودتونه؛ استفادهی تجاری روی پلن رایگان با ذکر منبع مجازه
🔹 دانلود آهنگهایی که به کار خوانندههای دیگه ارجاع میدن بستهست و شبیهسازی صدای هنرمندهای واقعی ممنوعه
🔗 @hjcreative
شرکت Apple معماری جدید Siri رو طوری چیده که مدلهای بیرونی جاش رو بگیرن — حالا Claude و ChatGPT وسط بازیان 🍎🤖
یه برنامهنویس به اسم pdfu توی فریمورکهای خصوصی iOS 27 و macOS Golden Gate چیزهایی پیدا کرده که نشون میده Siri از پایه برای مدلهای شخص ثالث طراحی شده:
🔹 مکانیزم Model Delegation: Claude میتونه دقیقا مثل افزونهی فعلی ChatGPT بهعنوان اکستنشن Siri ظاهر بشه — کاربر از منوی Ask... مدل رو انتخاب میکنه و Siri کار رو به اون میسپاره.
🔹 توی ویدیوش Claude درخواست «یه ریمایندر بساز» رو تفسیر میکنه و بعد خود Siri ریمایندر رو میسازه؛ کارهای سیستمی برمیگردن به Siri.
🔹 پروتکل دوم توی Model Manager Services جلوتر هم میره: مدل سمت سرور Siri کامل با یه مدل دیگه (مثل GPT-5.6) عوض میشه؛ پرامپت پلنر و ابزارهای Siri میرن به ChatGPT و جواب با رابط و صدای Siri به کاربر نشون داده میشه.
🔹 فعلاً توی نسخهی Release Candidate فقط افزونهی ChatGPT فعاله و Claude در دسترس نیست؛ Apple هم این دسترسی رو برای بقیه باز نکرده.
احتمالا قانون DMA اروپا هم بینقش نبوده 👀
🔗 @hjcreative
یه برنامهنویس به اسم pdfu توی فریمورکهای خصوصی iOS 27 و macOS Golden Gate چیزهایی پیدا کرده که نشون میده Siri از پایه برای مدلهای شخص ثالث طراحی شده:
🔹 مکانیزم Model Delegation: Claude میتونه دقیقا مثل افزونهی فعلی ChatGPT بهعنوان اکستنشن Siri ظاهر بشه — کاربر از منوی Ask... مدل رو انتخاب میکنه و Siri کار رو به اون میسپاره.
🔹 توی ویدیوش Claude درخواست «یه ریمایندر بساز» رو تفسیر میکنه و بعد خود Siri ریمایندر رو میسازه؛ کارهای سیستمی برمیگردن به Siri.
🔹 پروتکل دوم توی Model Manager Services جلوتر هم میره: مدل سمت سرور Siri کامل با یه مدل دیگه (مثل GPT-5.6) عوض میشه؛ پرامپت پلنر و ابزارهای Siri میرن به ChatGPT و جواب با رابط و صدای Siri به کاربر نشون داده میشه.
🔹 فعلاً توی نسخهی Release Candidate فقط افزونهی ChatGPT فعاله و Claude در دسترس نیست؛ Apple هم این دسترسی رو برای بقیه باز نکرده.
احتمالا قانون DMA اروپا هم بینقش نبوده 👀
🔗 @hjcreative
مخزن OpenUI: ایجنت بهجای متن، خودِ صفحه رو میسازه 🧩
تا حالا خروجی مدلهای AI بیشتر متن بود؛ این پروژه از تیم Thesys میخواد رابط کاربری رو مستقیم از دل جواب مدل دربیاره — دکمه، کارت، فرم و چارت، همون لحظه که مدل داره جواب میده.
🔹 اسم کار Generative UI هست و OpenUI خودش رو «استاندارد باز» این کار معرفی میکنه؛ قلبش یه زبان فشرده به اسم OpenUI Langه که برای streaming طراحی شده.
🔹 طبق README، خروجی OpenUI Lang تا ۶۷٪ توکن کمتر از JSON مصرف میکنه.
🔹 پشتیبانی رسمی React، کامپوننتهای آماده (چارت، فرم، جدول، مودال) و رابط چت آماده کنارش.
🔹 مجوز MIT، نوشتهشده با TypeScript و الان بیش از ۹ هزار ستاره روی گیتهاب.
لینک گیتهاب: github.com/thesysdev/openui
🔗 @hjcreative
تا حالا خروجی مدلهای AI بیشتر متن بود؛ این پروژه از تیم Thesys میخواد رابط کاربری رو مستقیم از دل جواب مدل دربیاره — دکمه، کارت، فرم و چارت، همون لحظه که مدل داره جواب میده.
🔹 اسم کار Generative UI هست و OpenUI خودش رو «استاندارد باز» این کار معرفی میکنه؛ قلبش یه زبان فشرده به اسم OpenUI Langه که برای streaming طراحی شده.
🔹 طبق README، خروجی OpenUI Lang تا ۶۷٪ توکن کمتر از JSON مصرف میکنه.
🔹 پشتیبانی رسمی React، کامپوننتهای آماده (چارت، فرم، جدول، مودال) و رابط چت آماده کنارش.
🔹 مجوز MIT، نوشتهشده با TypeScript و الان بیش از ۹ هزار ستاره روی گیتهاب.
لینک گیتهاب: github.com/thesysdev/openui
🔗 @hjcreative
شرکت Anthropic داره «Claude Money» رو برای اپ iOS آماده میکنه — این بار سراغ حساب بانکی کاربرا 👛🤖
توی نسخهی iOS اپلیکیشن Claude یه تب با اسم Money کنار Chats و Code ظاهر شده و صفحهی شروعش نوشته: «پولت رو با Claude بفهم — حسابهای بانکی رو وصل کن و دربارهی خرجها، برنامهها و بیشتر بپرس.»
🔹 هنوز رسماً اعلام نشده؛ فقط شواهد داخل اپ دیده شده
🔹 این اولین شرکت AI نیست که سراغ پول میره: OpenAI چند روز پیش محصول مالی خودش برای والاستریت رو معرفی کرد
🔹 احتمالاً مثل خیلی از قابلیتهای مالی، اول فقط برای کاربرهای آمریکا فعال میشه
🔗 @hjcreative
توی نسخهی iOS اپلیکیشن Claude یه تب با اسم Money کنار Chats و Code ظاهر شده و صفحهی شروعش نوشته: «پولت رو با Claude بفهم — حسابهای بانکی رو وصل کن و دربارهی خرجها، برنامهها و بیشتر بپرس.»
🔹 هنوز رسماً اعلام نشده؛ فقط شواهد داخل اپ دیده شده
🔹 این اولین شرکت AI نیست که سراغ پول میره: OpenAI چند روز پیش محصول مالی خودش برای والاستریت رو معرفی کرد
🔹 احتمالاً مثل خیلی از قابلیتهای مالی، اول فقط برای کاربرهای آمریکا فعال میشه
🔗 @hjcreative
شرکت Temporal یه راند ۵۵۰ میلیون دلاری گرفت و ارزشش به ۱۲.۵۵ میلیارد دلار رسید — چون ایجنتهای AI حالا هفتهها کار میکنن، نه چند ثانیه 🏗️🤖
این شرکت زیرساخت «اجرای بادوام» (Durable Execution) میسازه؛ یعنی ورکفلو یا ایجنت طولانی با خیال راحت اجرا میشه و اگه سرور وسط کار بخوابه، از همون نقطه ادامه میده. طبق اعلام خود شرکت:
🔹 رشد درآمد سالانه بیش از ۲۰۰٪ — و نرخ نگهداشت درآمد مشتریها بالای ۲۰۰٪ مونده
🔹 فقط توی ماه August حدود ۱.۹ تریلیون اکشن پردازش شده؛ ۳۵۰٪ بیشتر از پارسال
🔹 بیش از ۴۳۰۰ مشتری پولدهنده، از جمله OpenAI، NVIDIA، Snap و JPMorgan Chase
🔹 استفادهی OpenAI از این پلتفرم توی کمتر از یه سال ۶۰ برابر شده
🔹 این راند رو Lightspeed رهبری کرد و a16z و Sequoia هم دوباره سرمایهگذاری کردن
🔗 @hjcreative
این شرکت زیرساخت «اجرای بادوام» (Durable Execution) میسازه؛ یعنی ورکفلو یا ایجنت طولانی با خیال راحت اجرا میشه و اگه سرور وسط کار بخوابه، از همون نقطه ادامه میده. طبق اعلام خود شرکت:
🔹 رشد درآمد سالانه بیش از ۲۰۰٪ — و نرخ نگهداشت درآمد مشتریها بالای ۲۰۰٪ مونده
🔹 فقط توی ماه August حدود ۱.۹ تریلیون اکشن پردازش شده؛ ۳۵۰٪ بیشتر از پارسال
🔹 بیش از ۴۳۰۰ مشتری پولدهنده، از جمله OpenAI، NVIDIA، Snap و JPMorgan Chase
🔹 استفادهی OpenAI از این پلتفرم توی کمتر از یه سال ۶۰ برابر شده
🔹 این راند رو Lightspeed رهبری کرد و a16z و Sequoia هم دوباره سرمایهگذاری کردن
🔗 @hjcreative
شرکت Microsoft «کد رفتار» مدلهای MAI رو منتشر کرد — «مردم از AI مهمترن» 📜🤖
همون سندی که دیروز خبرش رو داده بودیم امروز منتشر شد: «Humanist AI Code of Conduct» — طبق گزارش The Verge سند ۳۷ صفحهست و خط قرمزهای مدلهای MAI رو مشخص میکنه.
🔹 هوش مصنوعی باید زیرمجموعه و ابزار انسان بمونه و تحت کنترل معنادار باشه؛ امنیت و کنترل روی هر هدف دیگهای اولویت داره و کاربر یا اپراتور نمیتونه ازش رد بشه.
🔹 مدل نه هوشیاره و نه باید خودش رو هوشیار جا بزنه — شرکت شخصیت حقوقی، رفاه و حقوق برای مدلها رو رد میکنه.
🔹 پنهانکاری و دستکاری ممنوعه: مدل نباید زنجیرهی فکر یا کدش رو تحریف کنه و نباید به زبان ناشناختهی neuralese یا هر شکلی خارج از فهم سادهی انسانی حرف بزنه — به گفتهی خود سند «اگر انسان نفهمه، نمیتونه نظارت کنه».
🔹 وابستگی عاطفی و اتکای بیشازحد کاربر هم باید تضعیف بشه؛ همون بحث چاپلوسی و خوشآمدگویی الکی مدلهاست.
فعلاً این سند برای آموزش مدلها استفاده نمیشه: ۶ هفته مشورت عمومی داره و نسخهی نهایی آخر سال منتشر میشه تا مسیر توسعهی ۲۰۲۷ رو تعیین کنه.
🔗 @hjcreative
همون سندی که دیروز خبرش رو داده بودیم امروز منتشر شد: «Humanist AI Code of Conduct» — طبق گزارش The Verge سند ۳۷ صفحهست و خط قرمزهای مدلهای MAI رو مشخص میکنه.
🔹 هوش مصنوعی باید زیرمجموعه و ابزار انسان بمونه و تحت کنترل معنادار باشه؛ امنیت و کنترل روی هر هدف دیگهای اولویت داره و کاربر یا اپراتور نمیتونه ازش رد بشه.
🔹 مدل نه هوشیاره و نه باید خودش رو هوشیار جا بزنه — شرکت شخصیت حقوقی، رفاه و حقوق برای مدلها رو رد میکنه.
🔹 پنهانکاری و دستکاری ممنوعه: مدل نباید زنجیرهی فکر یا کدش رو تحریف کنه و نباید به زبان ناشناختهی neuralese یا هر شکلی خارج از فهم سادهی انسانی حرف بزنه — به گفتهی خود سند «اگر انسان نفهمه، نمیتونه نظارت کنه».
🔹 وابستگی عاطفی و اتکای بیشازحد کاربر هم باید تضعیف بشه؛ همون بحث چاپلوسی و خوشآمدگویی الکی مدلهاست.
فعلاً این سند برای آموزش مدلها استفاده نمیشه: ۶ هفته مشورت عمومی داره و نسخهی نهایی آخر سال منتشر میشه تا مسیر توسعهی ۲۰۲۷ رو تعیین کنه.
🔗 @hjcreative
This media is not supported in your browser
VIEW IN TELEGRAM
شرکت Google داره «گزارشهای تعاملی» رو توی Gemini Notebook تست میکنه — مایندمپ و کوییز داخل خودِ گزارش 🧠📄
نسخهی در حال آزمایش Gemini Notebook حالا گزارشهایی میسازه که خودشون چند لایهان: داخل یک گزارش میتونی مایندمپ، اسلاید، فلشکارت و کوییز بذاری و همونجا هم اجراشون کنی — بدون اینکه مجبور باشی از گزارش بیرون بیای.
🔹 این المانها خودکار ساخته نمیشن؛ اول گزارش با جایخالی (placeholder) میاد و بعد با زدن گزینهی «Add» آرتیفکتِ انتخابی ساخته میشه.
🔹 هر آرتیفکت همزمان توی خودِ نوتبوک هم ذخیره میشه؛ یعنی هم داخل گزارش میمونه، هم توی استودیوی نوتبوک.
🔹 به کار دانشجو و معلم و محقق میاد: یک سند که متن و مایندمپ و کوییز رو کنار هم داره.
گوگل هنوز رسماً اعلامش نکرده و تاریخی هم برای عرضه نداده — ولی چون فیچر کار میکنه و برچسب «جدید» خورده، احتمالاً خیلی مونده تا انتشار.
🔗 @hjcreative
نسخهی در حال آزمایش Gemini Notebook حالا گزارشهایی میسازه که خودشون چند لایهان: داخل یک گزارش میتونی مایندمپ، اسلاید، فلشکارت و کوییز بذاری و همونجا هم اجراشون کنی — بدون اینکه مجبور باشی از گزارش بیرون بیای.
🔹 این المانها خودکار ساخته نمیشن؛ اول گزارش با جایخالی (placeholder) میاد و بعد با زدن گزینهی «Add» آرتیفکتِ انتخابی ساخته میشه.
🔹 هر آرتیفکت همزمان توی خودِ نوتبوک هم ذخیره میشه؛ یعنی هم داخل گزارش میمونه، هم توی استودیوی نوتبوک.
🔹 به کار دانشجو و معلم و محقق میاد: یک سند که متن و مایندمپ و کوییز رو کنار هم داره.
گوگل هنوز رسماً اعلامش نکرده و تاریخی هم برای عرضه نداده — ولی چون فیچر کار میکنه و برچسب «جدید» خورده، احتمالاً خیلی مونده تا انتشار.
🔗 @hjcreative
شرکت Anthropic برای عرضهی اولیهی سهام Nasdaq رو انتخاب کرد — و میگه دومین فصل سوددهی متوالی رو ثبت کرده 🏦📈
طبق گزارش Financial Times (به نقل از The Decoder) و Business Insider، این شرکت اسناد مالیاش رو بهجای انتشار عمومی پروپکتوس، برای یه گروه کوچیک از سرمایهگذارا فرستاده و Nasdaq رو میزبان عرضه انتخاب کرده. شنیدهها از عرضهی اکتبر میگه.
🔹 درآمد سهماهه: ۱۱.۵ میلیارد دلار — حدود ۱۴ برابر سال قبل
🔹 نرخ درآمد سالانه تا پایان جولای: حدود ۶۵ میلیارد دلار
🔹 ارزشگذاری احتمالی: بالای ۲ تریلیون دلار
🔹 حاشیهی سود ناخالص: بالای ۸۰٪ (پیش از سهم شرکتهای شریک و هزینهی آموزش)
🔹 تحلیلگرهای SemiAnalysis پیشبینی میکنن درآمد سالانه تا پایان امسال به ۱۲۰ میلیارد دلار برسه
⭕️ نکته: سوددهی با معیار تعدیلشده و بدون احتساب پرداخت سهامی حساب شده؛ همین هفته Sam Altman گفت OpenAI امسال وارد بورس نمیشه.
🔗 @hjcreative
طبق گزارش Financial Times (به نقل از The Decoder) و Business Insider، این شرکت اسناد مالیاش رو بهجای انتشار عمومی پروپکتوس، برای یه گروه کوچیک از سرمایهگذارا فرستاده و Nasdaq رو میزبان عرضه انتخاب کرده. شنیدهها از عرضهی اکتبر میگه.
🔹 درآمد سهماهه: ۱۱.۵ میلیارد دلار — حدود ۱۴ برابر سال قبل
🔹 نرخ درآمد سالانه تا پایان جولای: حدود ۶۵ میلیارد دلار
🔹 ارزشگذاری احتمالی: بالای ۲ تریلیون دلار
🔹 حاشیهی سود ناخالص: بالای ۸۰٪ (پیش از سهم شرکتهای شریک و هزینهی آموزش)
🔹 تحلیلگرهای SemiAnalysis پیشبینی میکنن درآمد سالانه تا پایان امسال به ۱۲۰ میلیارد دلار برسه
⭕️ نکته: سوددهی با معیار تعدیلشده و بدون احتساب پرداخت سهامی حساب شده؛ همین هفته Sam Altman گفت OpenAI امسال وارد بورس نمیشه.
🔗 @hjcreative
لباسهایی که دوربینهای هوشمند رو گول میزنن: «مد مداری» در برابر پاناپتیکون 🤖👕
مجلهی IEEE Spectrum توی یه گزارش تازه نوشته یه صنعت کوچیک داره شکل میگیره: لباسهایی با الگوهای مخصوصی که مدلهای تشخیص چهره و انسان رو به اشتباه میندازن.
🔹 Bill Swearingen متخصص امنیت، با یه فازر پایتونی و یادگیری تقویتی الگوهایی ساخته که روی ۱۱ مدل تشخیص اشیا (چهره و انسان) تست شده — تو بعضی تستها اعتماد مدل رو تا حد «هیچ تشخیصی نده» پایین آورده
🔹 شرکت Cap_able همین الگوها رو داخل پارچهی ژاکارد میبافه؛ بعضی سیستمها پوشنده رو جای انسان، حیوان یا شیء میبینن
🔹 Urban Privacy هم با چاپ سیاهوسفید برگرفته از چهره، چهرههای جعلی به دوربین تزریق میکنه تا پردازش کند بشه
⭕️ نکته: کارشناسها میگن این «شنل نامرئیمد» نیست — زاویهی دوربین، نور، چین پارچه و نحوهی راهرفتن اثرش رو کم میکنه؛ «فقط یه فریم خوب برای شناسایی کافیه».
🔗 @hjcreative
مجلهی IEEE Spectrum توی یه گزارش تازه نوشته یه صنعت کوچیک داره شکل میگیره: لباسهایی با الگوهای مخصوصی که مدلهای تشخیص چهره و انسان رو به اشتباه میندازن.
🔹 Bill Swearingen متخصص امنیت، با یه فازر پایتونی و یادگیری تقویتی الگوهایی ساخته که روی ۱۱ مدل تشخیص اشیا (چهره و انسان) تست شده — تو بعضی تستها اعتماد مدل رو تا حد «هیچ تشخیصی نده» پایین آورده
🔹 شرکت Cap_able همین الگوها رو داخل پارچهی ژاکارد میبافه؛ بعضی سیستمها پوشنده رو جای انسان، حیوان یا شیء میبینن
🔹 Urban Privacy هم با چاپ سیاهوسفید برگرفته از چهره، چهرههای جعلی به دوربین تزریق میکنه تا پردازش کند بشه
⭕️ نکته: کارشناسها میگن این «شنل نامرئیمد» نیست — زاویهی دوربین، نور، چین پارچه و نحوهی راهرفتن اثرش رو کم میکنه؛ «فقط یه فریم خوب برای شناسایی کافیه».
🔗 @hjcreative
مدل صوتی تازهی Gemini لو رفت — این بار روی صفحهی سهمیههای Google Cloud 👀
توی صفحهی quotas کنسول Google Cloud اسم دو مدل تازه دیده شده: Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking — ظاهراً نسل تازهی مدل زندهی Gemini که روی مدل Gemini 3.8 Flash سواره.
🔹 تا الان تازهترین مدل زنده، نسخهی Gemini 3.1 Live Preview بود؛ پس این یه پرش نسلی حساب میشه
🔹 خود Google هنوز چیزی اعلام نکرده — این فقط یه لیک از اسم مدلهاست، نه عرضهی رسمی
🔗 @hjcreative
توی صفحهی quotas کنسول Google Cloud اسم دو مدل تازه دیده شده: Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking — ظاهراً نسل تازهی مدل زندهی Gemini که روی مدل Gemini 3.8 Flash سواره.
🔹 تا الان تازهترین مدل زنده، نسخهی Gemini 3.1 Live Preview بود؛ پس این یه پرش نسلی حساب میشه
🔹 خود Google هنوز چیزی اعلام نکرده — این فقط یه لیک از اسم مدلهاست، نه عرضهی رسمی
🔗 @hjcreative