هوش‌رادار
474 subscribers
297 photos
56 videos
1 file
218 links
رادارِ تحولات هوش مصنوعی
Download Telegram
🟣 پژوهش

شکست ابزار Pangram در شناسایی متون مدل Muse-Glimmer

• ابزار تشخیص متن Pangram نتوانست ۷۹.۸ درصد از چکیده‌های بازنویسی‌شده با مدل Muse-Glimmer شرکت Meta را شناسایی کند.
• این سامانه موفق به تشخیص ۹۳.۵ درصد بازنویسی‌های GPT-5 شد که وابستگی کارایی آن به نوع مدل را نشان می‌دهد.
• پژوهشگران دانشگاه Tokyo Metropolitan دریافتند این ابزار تنها یک مورد از ۵۰۰۰ چکیده انسانی را به اشتباه برچسب زده است.

💡 چرا مهم است: این پژوهش اثبات می‌کند که با ظهور مدل‌های زبانی جدید، ابزارهای کنونی تشخیص متن کارایی خود را تا حد زیادی از دست می‌دهند.

@HooshRadar
This media is not supported in your browser
VIEW IN TELEGRAM
🔵 مدل‌ها

کسب رتبه ششم بنچمارک جهانی توسط مدل HiDream-O1-Video-1.0

• تولید ویدیوهای 1080p بین ۵ تا ۲۰ ثانیه با صدای همگام و تنظیم مدت‌زمان بر اساس صحنه
• کسب رتبه ششم در بنچمارک Artificial Analysis پایین‌تر از Dreamina Seedance و بالاتر از Wan 3.0
• دسترسی از طریق HiHarness API و vivago R1 Studio با هزینه ۵.۸۰ دلار به ازای هر دقیقه

💡 چرا مهم است: این مدل قابلیت تولید ویدیو با ثبات فیزیکی و صداگذاری همگام را با طول متغیر صحنه در دسترس کاربران قرار می‌دهد.

@HooshRadar
This media is not supported in your browser
VIEW IN TELEGRAM
🔵 مدل‌ها

رونمایی از مدل ویدیویی Grok Imagine Video 1.5 Lite

• رتبه هفدهم بنچمارک AA-Video-T2V v2.0 را کسب کرده و از Google Veo 3.1 با یک‌سوم قیمت پیشی گرفته است.
• تولید ویدیوهای متنی و تصویری تا ۱۵ ثانیه با سرعت ۶۰.۵ ثانیه برای ویدیوی ۱۰ ثانیه‌ای 1080p.
• قیمت مدل ثانیه‌ای ۰.۱۴ دلار برای 1080p تعیین شده و روی SpaceXAI API و fal در دسترس است.

💡 چرا مهم است: این مدل با ارائه سرعت بالا و هزینه اقتصادی، توازن جدیدی میان کیفیت و کارایی در تولید ویدیوی هوش مصنوعی ایجاد می‌کند.

@HooshRadar
🟡 ابزار

معرفی ابزار Zinn از Migma AI برای ساخت ایمیل

• تبدیل پرامپت، فریم‌های Figma، اسکرین‌شات و HTML به کدهای آماده ایمیل
• مدیریت خودکار چیدمان ریسپانسیو، دارک مود و خطاهای نمایش در نرم‌افزار Outlook
• بررسی پیش‌نمایش دسکتاپ و موبایل، سلامت لینک‌ها و هشدارهای اسپم قبل از ارسال

💡 چرا مهم است: این ابزار با حل مشکل ناسازگاری ایمیل‌ها در کلاینت‌هایی مانند Outlook، زمان توسعه‌دهندگان را برای تمرکز روی محصول اصلی آزاد می‌کند.

@HooshRadar
🔴 سیاست‌گذاری

مسدودسازی حساب کاربری توسط شرکت Anthropic به‌دلیل کدنویسی سنگین

• گزارش‌ها حاکی از مسدود شدن حساب کاربری یک برنامه‌نویس به دنبال اجرای تسک‌های کدنویسی سنگین است.
• شرکت Anthropic علت این اقدام را رفتار ظالمانه و ایجاد شرایط ناامن برای مدل Claude عنوان کرده است.
• این ادعا در شبکه اجتماعی X توسط کاربری با شناسه Legendary Coder منتشر شده است.

💡 چرا مهم است: این رویداد ابهامات مربوط به سازوکارهای نظارت و نحوه محدودسازی دسترسی کاربران در سامانه‌های هوش مصنوعی را برجسته می‌کند.

@HooshRadar
🔵 مدل‌ها

معرفی مدل تصویرساز سریع و ارزان Qwen-Image-2.1-Turbo

• نسخه شتاب‌یافته مدل Qwen-Image-2.1-Pro به عنوان سریع‌ترین و اقتصادی‌ترین عضو خانواده Qwen-Image عرضه شد.
• زمان پردازش هر تصویر بین ۱۰ تا ۲۰ ثانیه و هزینه آن ۰.۰۱۶ دلار است.
• دسترسی رابط برنامه‌نویسی از طریق سرویس‌های Model Studio و Qwen Cloud فراهم شده است.

💡 چرا مهم است: کاهش همزمان زمان پردازش و هزینه‌ها، پیاده‌سازی سرویس‌های تولید تصویر مبتنی بر هوش مصنوعی را در مقیاس تجاری توجیه‌پذیرتر می‌کند.

@HooshRadar
This media is not supported in your browser
VIEW IN TELEGRAM
🟡 ابزار

تلاش تیم mausbot_ برای یکپارچه‌سازی دستیارهای هوش مصنوعی

• توسعه‌دهنده mausbot_ معتقد است هیچ دستیار شخصی واحد و کاملی وجود ندارد.
• کاربران هم‌زمان از ابزارهایی مثل Instinct، Muse، GrokBot و Dots استفاده می‌کنند.
• هدف این پروژه تجمیع قابلیت‌های این ابزارها در یک بستر واحد است.

💡 چرا مهم است: تجمیع دستیارهای هوش مصنوعی تخصصی در یک محیط، نیاز کاربر به جابه‌جایی مداوم میان ابزارهای مختلف را از بین می‌برد.

@HooshRadar
This media is not supported in your browser
VIEW IN TELEGRAM
🟣 پژوهش

سرمایه‌گذاری میلیونی شرکت OpenAI روی مسائل حل‌نشده ریاضی

• استاد دانشگاه NYU از صرف میلیون‌ها دلار پردازش محاسباتی توسط OpenAI برای مسائل ریاضی خبر داد.
• به گفته او، این رقابت با شرکت Anthropic برای OpenAI شرایطی حیاتی مانند مرگ و زندگی داشت.
• حل زودتر مسائل Millennium Prize توسط رقیب، نشان‌دهنده برتری مدل‌های داخلی Anthropic بود.

💡 چرا مهم است: این رقابت نشان می‌دهد حل مسائل بنیادین ریاضی به معیاری کلیدی برای اثبات برتری مدل‌های پیشرفته هوش مصنوعی تبدیل شده است.

@HooshRadar
🔵 مدل‌ها

ارزیابی واقعی مدل Grok 4.7 در برابر Opus 5.5

• با وجود صدرنشینی در بنچمارک، مدل Grok 4.7 در درک هدف و کاهش توهم به Opus 5.5 نمی‌رسد.
• سازنده افزونه Grok با بیش از 170K نصب اعلام کرد نباید به نتایج این بنچمارک‌ها اعتماد کرد.
• کاربران با وجود عملکرد فعلی، انتظارات بسیار بالایی از معرفی نسخه آینده یعنی Grok 4.8 دارند.

💡 چرا مهم است: این دیدگاه نشان می‌دهد رتبه‌های برتر در بنچمارک‌های هوش مصنوعی لزوماً به معنای برتری در درک معنایی و عدم توهم در دنیای واقعی نیستند.

@HooshRadar
🔵 مدل‌ها

شایعات استفاده OpenAI و Google از قابلیت RSI

• طبق شایعات، شرکت‌های Google، Anthropic و OpenAI در حال استفاده از خودبهبودی بازگشتی یا RSI هستند.
• پیشرفت سریع Google و نتایج ریاضی OpenAI ظاهراً با RSI مرتبط است و در چین GLM فعال است.
• شرکت Anthropic نیز طبق گزارش‌ها آموزش مدل بزرگ‌تر Fable 6 را برای جبران عقب‌ماندگی آغاز کرده است.

💡 چرا مهم است: دستیابی به خودبهبودی بازگشتی می‌تواند چرخه ارتقای مدل‌ها را به‌طور چشمگیری شتاب دهد و رقابت میان غول‌های هوش مصنوعی را وارد مرحله تازه‌ای کند.

@HooshRadar
This media is not supported in your browser
VIEW IN TELEGRAM
🟡 ابزار

دسترسی رایگان به مدل‌های GLM-5.3 در پلتفرم ZCode

• پلتفرم ZCode برای رویداد Weekend Build تعداد ۳۰۰ میلیون توکن رایگان ارائه می‌دهد.
• مدل‌های هوش مصنوعی GLM-5.3 و GLM-5.3 Flash به شکل کاملاً رایگان در دسترس قرار گرفته‌اند.
• مهلت دریافت این توکن‌ها از طریق وب‌سایت zcode.z.ai/en تا ۱۲ اکتبر ساعت ۶ صبح است.

💡 چرا مهم است: این طرح امکان آزمایش و ساخت پروژه با جدیدترین مدل‌های زبانی را بدون پرداخت هزینه برای توسعه‌دهندگان فراهم می‌کند.

@HooshRadar
🟢 کسب‌وکار

آزمایش سیستم خودران شرکت XPENG در خیابان‌های پاریس

• سیستم دستیار رانندگی NGP متعلق به شرکت XPENG برای اولین بار در خیابان‌های اروپا و ترافیک پاریس تست شد.
• دو خودروساز XPENG و Tesla تنها شرکت‌های حاضر در رویداد رسمی Autonomous Lab برای سواری با نظارت در معابر عمومی هستند.
• این سیستم هوشمند حتی در شرایط ترافیک سنگین و عملیات عمرانی مسیر عملکردی بسیار روان از خود نشان داد.

💡 چرا مهم است: آغاز آزمایش عمومی سامانه‌های هوشمند در پاریس رقابت برای تجاری‌سازی فناوری‌های خودران را در اروپا به‌طور جدی وارد مرحله تازه‌ای می‌کند.

@HooshRadar
🟡 ابزار

دوبرابر شدن اعتبار DeepSeek V4.1 Flash در OpenDesign

• اعتبار مدل DeepSeek V4.1 Flash در تمام پلن‌ها تا سقف ۶۰۰ دلار در ماه دوبرابر شد.
• اشتراک پلن Go در ماه اول با قیمت ۸ دلار و تا ۱۲۰ دلار اعتبار ارائه می‌شود.
• کاربران می‌توانند از این سهمیه در محیط OpenDesign یا از طریق API استفاده کنند.

💡 چرا مهم است: این تخفیف هزینه استفاده توسعه‌دهندگان از مدل DeepSeek V4.1 Flash را به میزان قابل توجهی کاهش می‌دهد.

@HooshRadar
This media is not supported in your browser
VIEW IN TELEGRAM
🟡 ابزار

اتصال ابزار WorkBuddy به سرویس Gmail برای مدیریت ایمیل‌ها

• ابزار دستیار WorkBuddy امکان اتصال مستقیم به سرویس Gmail را فراهم کرد.
• این دستیار انجام وظایف تکراری و بهینه‌سازی جریان‌های کاری ایمیل را برعهده می‌گیرد.
• کاربران می‌توانند وضعیت ایمیل‌های خوانده‌نشده را تنها با یک پرسش ساده بررسی کنند.

💡 چرا مهم است: یکپارچه‌سازی ابزارهای کاری با صندوق ایمیل، بخش عمده‌ای از فعالیت‌های تکراری روزمره کاربران را خودکار می‌کند.

@HooshRadar
🟡 ابزار

انتشار نسخه‌های جدید OpenBot با امکان ساخت بصری ورک‌فلو

• امکان اتصال بصری ایجنت‌ها روی بوم، اجرای روتین‌ها با وبهوک و انتقال پاسخ‌ها میان آن‌ها فراهم شد.
• پشتیبانی از یکپارچه‌سازی با Telegram، ورود به سرورهای MCP و نسخه اختصاصی OpenBot Mobile برای اندروید اضافه شد.
• راه‌اندازی با مدل‌های رایگان OpenCode بدون نیاز به ثبت‌نام ممکن شده و مدیریت سرورها نیز بهبود یافته است.

💡 چرا مهم است: این به‌روزرسانی زنجیره همکاری ایجنت‌های هوش مصنوعی را بصری‌تر کرده و دسترسی به آن‌ها را از طریق پیام‌رسان‌ها و موبایل تسهیل می‌کند.

@HooshRadar
🟡 ابزار

رسیدن پروژه OpenDesign به ۱۰۰ هزار ستاره در گیت‌هاب

• ثبت ۱۰۰ هزار ستاره گیت‌هاب تنها در مدت ۱۶۳ روز توسط این مخزن منبع‌باز.
• کسب رتبه نخست در موضوع ai-design و قرارگیری میان ۱۳۰ مخزن پرطرفدار گیت‌هاب.
• مشارکت بیش از ۴۳۰ برنامه‌نویس در ساخت پروژه در کنار میلیون‌ها کاربر از سراسر جهان.

💡 چرا مهم است: این دستاورد نشان‌دهنده استقبال کم‌سابقه و شتاب بالای پذیرش ابزارهای منبع‌باز طراحی مبتنی بر هوش مصنوعی است.

@HooshRadar
🟡 ابزار

مسابقه شرکت Cloudflare برای ساخت جایگزین نسل جدید GitHub

• شرکت Cloudflare رقابتی برای توسعه پلتفرمی شبیه GitHub جهت مدیریت هم‌زمان صدها هزار ایجنت هوش مصنوعی آغاز کرد.
• این چالش بر بازتعریف شیوه اعمال تغییرات کد توسط تعداد انبوهی از ایجنت‌های هوشمند تمرکز دارد.
• توسعه‌دهندگان با استفاده از بسترهایی مانند Workers در پی کاهش هزینه وضعیت انتظار ایجنت‌ها برای پاسخ مدل‌ها هستند.

💡 چرا مهم است: زیرساخت‌های سنتی مدیریت کد برای فعالیت هم‌زمان انبوه ایجنت‌های مستقل طراحی نشده‌اند و این ابتکار می‌تواند شیوه توسعه نرم‌افزار را متحول کند.

@HooshRadar
🟡 ابزار

چالش‌های کاربران در درک و استفاده از ابزار Hermes

• ابهام کاربران در لزوم استفاده از ربات‌های چندگانه در برابر یک ارکستریتور واحد و جامع.
• تفاوت تنظیمات پیش‌فرض در نسخه‌های CLI و Desktop به همراه پیچیدگی مفهوم Secure allow.
• وجود چالش‌های فنی برای اجرای نسخه رسمی دسکتاپ روی سیستم‌های Mac با پردازنده Intel.

💡 چرا مهم است: بررسی بازخوردهای کاربران Hermes نشان می‌دهد که پیچیدگی فنی و منحنی یادگیری بالا همچنان مانعی مهم در استفاده آسان است.

@HooshRadar
🟡 ابزار

توزیع ۱۳۲ میلیون توکن رایگان در پلتفرم AutoClaw

• ورود به پلتفرم AutoClaw در تاریخ ۱۲ اکتبر شامل ۱۰۰ میلیون توکن هدیه است.
• کاربران از تاریخ ۱۳ تا ۱۶ اکتبر روزانه ۸ میلیون توکن اضافه دریافت خواهند کرد.
• مجموع توکن‌های اهدایی در این دوره پنج‌روزه به ۱۳۲ میلیون توکن می‌رسد.

💡 چرا مهم است: این طرح دسترسی کاربران و توسعه‌دهندگان را به منابع پردازشی رایگان برای ساخت پروژه‌ها افزایش می‌دهد.

@HooshRadar
🟡 ابزار

رونمایی از پلتفرم جدید TRAE و ادغام سرویس‌ها

• پلتفرم هوش مصنوعی TRAE از ادغام دو سرویس TraeCode و TraeWork در یک محیط خبر داد.
• این سامانه اکنون بستری یکپارچه را برای توسعه سرتاسری برنامه‌های هوش مصنوعی فراهم کرده است.
• مستندات رسمی انتقال داده‌ها برای کاربران جهت مهاجرت به این بستر یکپارچه منتشر شده است.

💡 چرا مهم است: یکپارچه‌سازی این ابزارها مسیر توسعه محصولات هوش مصنوعی را در یک محیط واحد و منسجم هموار می‌کند.

@HooshRadar