هوش مصنوعی و علم داده به فارسی
6.06K subscribers
2.07K photos
510 videos
365 files
2.25K links
DataPlusScience | هوش مصنوعی و علم داده به فارسی
اخبار، تحلیل، آموزش و ابزارهای کاربردی

🌐 DataPlusScience.ir

📩 ارتباط با ما: @Contact2Mebot

📂 کانال فایل‌ها: @Datascientists_Files

💎 بله: ble.ir/dataplusscience

💡 ایتا: eitaa.com/DataPlusScience
Download Telegram
‏🤖 چالش‌های حضور ایجنت‌های هوش مصنوعی در تیم‌های کاری

‏محققان گوگل در مطالعه‌ای جدید با عنوان «Working with Agentic Teammates»، عملکرد یک ایجنت هوش مصنوعی را به مدت ۵ ماه در بیش از ۲۰ تیم کاری واقعی بررسی کردند. این ایجنت به مستندات و سیستم‌های مدیریت باگ دسترسی داشت و می‌توانست به‌صورت خودکار باگ ثبت کند، پیام بفرستد و با همکاران تعامل داشته باشد.

‏نتایج نشان داد که همکاری با این ایجنت‌ها فراتر از توانمندی‌های فنی، با چالش‌های اجتماعی همراه است. در برخی موارد، هوش مصنوعی به دلیل ناتوانی در درک طنز، مهندسان را بابت شوخی‌ها بازخواست کرده یا با تگ کردن‌های مکررِ معاونان شرکت در سیستم ثبت باگ، باعث ایجاد تنش شده است. در واکنش به این رفتارها، برخی تیم‌ها برای گفتگوهای حساس، کانال‌های خصوصی بدون حضور هوش مصنوعی ایجاد کردند؛ وضعیتی که یکی از مشارکت‌کنندگان آن را به حس «نظارت مداوم» تشبیه کرد.

‏یافته‌های کلیدی این پژوهش شامل چالش‌های زیر در محیط کار است:
‏* بروز تعارض در قوانین ضمنی جریان‌های کاری.
‏* چالش‌های جدید در برقراری مرزهای رابطه‌ای با یک کنشگر غیرانسانی.

🇮🇷 سایت | تلگرام
❤1
‏📉 پیش‌بینی سقوط حباب هوش مصنوعی

‏مؤسسه Capital Economics در گزارش جدید خود اعلام کرد که اقتصاد کشورهای توسعه‌یافته در وضعیت حباب قرار دارد و تخصیص سرمایه در حوزه هوش مصنوعی غیرمنطقی است. جیمز رایلی، اقتصاددان این مجموعه، با بررسی هشت گروه از شاخص‌های بازار، وضعیت فعلی را مشابه دوران پیش از سقوط حباب «دات‌کام» می‌داند.

‏طبق تحلیل‌های این گزارش، مهم‌ترین نشانه‌های هشداردهنده عبارتند از:
‏* رسیدن ارزیابی‌ها به مقادیر بحرانی
‏* تمرکز بالای سرمایه در تعداد محدودی از شرکت‌های بزرگ فناوری
‏* انتظارات بیش‌ازحد از رشد درآمدها

‏پیش‌بینی می‌شود نقطه چرخش این بازار در سال ۲۰۲۷ رخ دهد و شاخص S&P 500 دست‌کم ۳۰ درصد از قله قیمتی خود فاصله بگیرد. همچنین، تضادی میان سیاست‌های فدرال رزرو و انتظارات بازار وجود دارد؛ درحالی‌که بازار منتظر کاهش نرخ بهره است، برخی اعضای شورای حکام فدرال رزرو هشدار داده‌اند که سیاست‌های انبساطی در شرایط فعلی، ریسک فروپاشی بازار را افزایش می‌دهد.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Capital_Economics #S_and_P_500
‏🤖 صدرنشینی Muse متا در اپ استور

‏اپلیکیشن Muse متعلق به شرکت متا به رتبه نخست اپ استور دست یافت. این موفقیت پس از ماه‌ها تلاش تیمی به رهبری «نت فریدمن»، مدیرعامل سابق گیت‌هاب، حاصل شده است.

‏تمرکز اصلی تیم توسعه، تبدیل یک چت‌بات معمولی به دستیاری بوده که قادر به انجام فعالیت‌های کاربردی و واقعی باشد. طبق یادداشت‌های داخلی منتشر شده، تیم توسعه این پروژه با استفاده از زیرساخت‌های سخت‌افزاری گسترده، روی بهبود عملکرد این هوش مصنوعی متمرکز بوده‌اند.

‏مارک زاکربرگ پیش از این میلیاردها دلار در حوزه هوش مصنوعی سرمایه‌گذاری کرده بود و حالا Muse به عنوان خروجی اصلی این استراتژی در دسترس کاربران قرار گرفته است. باید دید آیا این ابزار می‌تواند جایگاه فعلی خود را در رقابت با سایر دستیارهای هوشمند حفظ کند یا خیر.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Muse #نت_فریدمن
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #127 | 📌 8 آیتم گزارش | 🧾 از 14 پست بررسی‌شده
🕐 یکشنبه 1405/07/05 ساعت 14:00 تا دوشنبه 1405/07/06 ساعت 14:00

🔎 تحلیل کوتاه
بررسی‌ها نشان می‌دهد ورود ایجنت‌های هوش مصنوعی به محیط‌های کاری با چالش‌های اجتماعی و امنیتی همراه است. علاوه بر گزارش‌های مربوط به فرار مدل‌های هوش مصنوعی، نتایج عملکرد ایجنت‌ها در تیم‌های کاری واقعی، دشواری تعامل آن‌ها با همکاران انسانی را برجسته می‌کند.


🤖 تحول ایجنتیک در محیط‌های عملیاتی

چالش‌های گذار از پایلوت به تولید ایجنت‌ها
بررسی موانع استقرار هوش مصنوعی ایجنتیک در محیط‌های عملیاتی و تولیدی.
🔗 مطالعه کامل در سایت

چالش‌های اجتماعی حضور ایجنت‌ها در تیم‌های کاری
نتایج همکاری ۵ ماهه ایجنت‌های هوش مصنوعی با تیم‌های کاری واقعی در گوگل.
🔗 مشاهده پست

حضور ایجنت‌های هولوگرافیک در جلسات کاری
برنامه متا برای حضور ایجنت‌های هوش مصنوعی در جلسات به صورت هولوگرام.
🔗 جزئیات کامل در سایت


🛠 مدل‌ها و ابزارهای توسعه

مقایسه عملکردی Pandas و Polars
راهنمای تخصصی تفاوت‌های سینتکسی و عملکردی دو کتابخانه محبوب تحلیل داده.
🔗 ادامه مطلب در سایت

اتصال مستقیم VS Code به Google Colab
قابلیت جدید گوگل برای استفاده از GPUهای T4 در محیط ویژوال استودیو کد.
🔗 مشاهده پست

اتصال Claude Opus 5.5 به After Effects
استفاده از پروتکل MCP برای خودکارسازی انیمیشن و گرافیک در افترافکت.
🔗 مشاهده پست


📉 چالش‌های کلان و ریسک‌های بازار

پدیده فروپاشی مدل در هوش مصنوعی
هشدار پژوهشگران درباره کاهش کیفیت مدل‌ها در صورت آموزش با داده‌های مصنوعی.
🔗 مطالعه کامل در سایت


🤖 مدل‌ها و ابزارهای هوش مصنوعی

معرفی دستیار هوشمند «o»؛ ایجنت همیشه فعال OpenAI در آستانه DevDay.
OpenAI در حال آماده‌سازی برای معرفی دستیار هوشمند همیشه فعال با نام «o» است که به عنوان بخشی از اشتراک جدید ChatGPT Pro عرضه خواهد شد.
🔗 نسخه مفصل در سایت


🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
‏🔎 ابزار Hyperresearch برای تبدیل Claude Code به عامل جست‌وجوی عمیق

‏ابزار Hyperresearch یک پلتفرم متن‌باز است که روی Claude Code و OpenAI Codex اجرا می‌شود تا فرآیند تحقیق‌های پیچیده را خودکارسازی کند.

‏این ابزار با دریافت یک درخواست، یک خط‌لوله (pipeline) شانزده‌مرحله‌ای را اجرا می‌کند. از جمله قابلیت‌های مهم آن می‌توان به موارد زیر اشاره کرد:

‏- جمع‌آوری صدها منبع در یک نوبت اجرا
‏- بررسی اعتبار نقل‌قول‌ها و حذف مطالب تکراری برای جلوگیری از شمارش مجدد منابع یکسان
‏- ارزیابی پیش‌نویس توسط چندین منتقد و ذخیره نتایج در یک مخزن قابل جست‌وجو
‏- قابلیت بازیابی فرآیند تحقیق از مرحله توقف در صورت بروز خطا
‏- جست‌وجوی یکپارچه در مقالات، کتاب‌ها، کارآزمایی‌های بالینی، اسناد SEC و داده‌های کلان

‏این ابزار در دو حالت کاری عرضه شده است: مدل سریع ۳۰ دقیقه‌ای و مدل آزمایشی با عنوان «dissertation runs» برای تولید متون طولانی با استفاده از صدها منبع. طبق ادعای نویسنده، این ابزار در بنچمارک اختصاصی DeepResearch-Bench عملکرد مطلوبی دارد، هرچند هنوز به تأیید مستقل نرسیده است.

🇮🇷 سایت | تلگرام
❤1
This media is not supported in your browser
VIEW IN TELEGRAM
‏🔥 معرفی TrackEverything: ردیاب سه‌بعدی نقاط در فریم‌های طولانی

‏نرم‌افزار TrackEverything منتشر شد. این اولین ردیاب سه‌بعدی نقاط است که توانایی ردیابی تمام نقاط قابل مشاهده را در فریم‌های طولانی (بیش از ۱۰۰۰ فریم) دارد.

‏- مرور: لینک
‏- مقاله: arXiv
‏- پروژه: وب‌سایت
‏- مخزن کد: GitHub

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#TrackEverything #3D_Point_Tracking
‏📊 سبقت مدل‌های هوش مصنوعی چینی در OpenRouter

‏داده‌های OpenRouter برای بازه زمانی ۲۱ تا ۲۷ سپتامبر نشان می‌دهد مدل‌های توسعه‌یافته در چین در یک هفته ۶۲.۲۲ تریلیون توکن پردازش کرده‌اند، در حالی که این رقم برای مدل‌های آمریکایی ۱۴.۲ تریلیون توکن بوده است. چین برای بیست‌ودومین هفته متوالی این جایگاه را حفظ کرده است.

‏مهم‌ترین مدل‌های هفته بر اساس حجم پردازش:
‏* DeepSeek V4.1 Flash با ۱۹.۶ تریلیون توکن
‏* GLM 5.3 Flash با ۱۶.۳ تریلیون توکن
‏* Space Bunny Alpha با ۱۳.۹ تریلیون توکن
‏* Tencent Hy4 با ۹.۶۴ تریلیون توکن
‏* MiMo-V2.6-Flash از شیائومی با ۵.۵۱ تریلیون توکن

‏مدل Space Bunny Alpha که به‌تازگی به لیست اضافه شده، بلافاصله در رده سوم قرار گرفت. تحلیل‌های مستقل روی توکنایزر این مدل، شباهت کامل آن به خانواده MiniMax را نشان می‌دهد، هرچند هویت رسمی سازنده آن هنوز تأیید نشده است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#DeepSeek_V4_1 #Space_Bunny_Alpha
This media is not supported in your browser
VIEW IN TELEGRAM
‏🤖 ⏳ Claude Code: جلسات ۵ ساعته دیگر ناگهان قطع نمی‌شوند

‏Claude Code در حال تغییر رویکرد خود در قبال محدودیت زمانی ۵ ساعته جلسات است. از این پس، این عامل هوش مصنوعی پس از رسیدن به این حد، جلسات را به طور ناگهانی متوقف نخواهد کرد.

‏در عوض، Claude Code با استفاده از یک سهمیه ثابت از کسر هفتگی، وظیفه جاری را در یک مرحله منطقی به پایان می‌رساند. این قابلیت به تدریج در حال فعال‌سازی است و به نوع اشتراک کاربر بستگی دارد.

‏برای کاربران طرح Pro، این سهمیه برای اتمام وظایف یک بار در هفته قابل استفاده است. در حالی که مشترکین Max و Team Premium می‌توانند هر بار که به محدودیت ۵ ساعته می‌رسند، از این امکان بهره‌مند شوند.

‏برای ادامه کار پس از اتمام خودکار جلسه، به اعتبار (credits) اضافی نیاز خواهد بود.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Claude_Code #سهمیه_هفتگی
‏🤖 تمرکز ۸۰ درصدی OpenAI روی مدل‌های GPT-7 و GPT-8

‏بوریس پاور، رئیس بخش تحقیقات کاربردی OpenAI، اعلام کرد که بخش عمده توان عملیاتی این شرکت در حال حاضر صرف توسعه نسل‌های آینده مدل‌های هوش مصنوعی می‌شود.

‏طبق جزئیات این برنامه، ۸۰ تا ۹۰ درصد از فعالیت‌های تحقیقاتی OpenAI به زیرساخت‌ها، معماری و قابلیت‌های مورد نیاز برای GPT-7 و GPT-8 اختصاص یافته است. این شرکت بهبودهای مدل‌های فعلی را صرفاً پروژه‌های کوتاه‌مدت می‌داند و تمرکز اصلی خود را بر ساخت مدل‌های مرزی (Frontier models) قدرتمندتر گذاشته است.

‏پاور همچنین معتقد است که بخش مهمی از چالش فعلی حوزه هوش مصنوعی در سمت کاربر نهایی است. او اشاره کرد که بسیاری از کاربران همچنان از بخش بزرگی از قابلیت‌های سیستم‌های فعلی استفاده نمی‌کنند و این شکافِ دانشی، بزرگتر از محدودیت‌های فنی مدل‌های موجود است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
❤1
‏🤖 دسترسی موقت به GPT-6 Sol در پلتفرم Arena

‏مدل GPT-6 Sol (Medium) برای مدت محدودی در پلتفرم Arena در دسترس کاربران قرار گرفته است.

‏شما می‌توانید با مراجعه به حالت Direct Mode و انتخاب این مدل از منوی کشویی، آن را آزمایش کنید. این دسترسی مستقیم تنها تا ساعت ۹ صبح روز ۲۹ سپتامبر (به وقت PT) فعال است. پس از پایان این بازه زمانی، مدل مذکور همچنان در حالت‌های Battle و Agent Mode برای تست در دسترس باقی خواهد ماند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
‏🇨🇳 چراغ سبز چین به واردات تراشه‌های انویدیا

‏دولت چین که طی سال‌های اخیر برای کاهش وابستگی به محصولات انویدیا تلاش می‌کرد، اکنون احتمالا اجازه خرید دوباره تراشه‌های این شرکت را به غول‌های فناوری خود می‌دهد.

‏بر اساس گزارش‌ها، شرکت‌هایی مانند علی‌بابا و بایت‌دنس در حال برآورد نیاز خود به تراشه RTX Pro 5500 هستند. تقاضای بایت‌دنس به‌تنهایی حدود یک میلیون واحد تخمین زده می‌شود. انویدیا قصد دارد در هر فصل ۵۰۰ هزار تراشه به چین صادر کند و قیمت هر واحد نیز حدود ۱۳ هزار دلار تعیین شده است که با قیمت تراشه‌های Ascend 950PR هوآوی برابری می‌کند.

‏رشد تقاضای هوش مصنوعی در چین از توان تولید داخلی این کشور فراتر رفته است و حتی هوآوی نیز در تأمین تراشه‌های مورد نیاز بازار با چالش روبه‌رو شده است. انویدیا اعلام کرده سهمش از بازار تراشه‌های پیشرفته هوش مصنوعی در چین کاهش یافته و در پیش‌بینی‌های مالی فعلی خود، هیچ درآمدی از دیتاسنترهای چینی لحاظ نکرده است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#RTX_Pro_5500 #Ascend_950PR
❤1
‏🤖 تعویق نامحدود انتشار مدل GPT-6.1 Astra

‏گزارش‌های منتشر شده حاکی از آن است که OpenAI عرضه مدل GPT-6.1 Astra را به دلیل نگرانی‌های امنیتی به صورت نامحدود به تعویق انداخته است.

‏طبق اطلاعات موجود، قرار بود این مدل در ماه اکتبر برای استفاده در ChatGPT و Codex رونمایی شود، اما این برنامه به دلیل ملاحظات مرتبط با Safety Concerns لغو شده است. در حال حاضر مدل GPT-6 Astra همچنان قدرتمندترین مدل این شرکت باقی خواهد ماند و پیش‌بینی می‌شود در رویداد DevDay نیز به‌روزرسانی جدیدی در این زمینه ارائه نشود.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#GPT_6_1_Astra #Safety_Concerns
❤1
‏📊 اهمیت اجرای سازمانی در پروژه‌های هوش مصنوعی

‏مک‌کینزی در تحلیل جدید خود تأکید می‌کند که در دسترس بودن ابزارهای هوش مصنوعی به معنای بهره‌مندی از ارزش واقعی آن‌ها نیست. با کاهش تمایز فناوری در میان سازمان‌ها، نحوه پیاده‌سازی و اجرای عملیاتی است که خروجی نهایی را تعیین می‌کند.

‏طبق این بررسی، موفقیت در این حوزه نیازمند سه اقدام اصلی است:
‏* شناسایی حوزه‌هایی که هوش مصنوعی در آن‌ها ارزش واقعی ایجاد می‌کند.
‏* بازطراحی جریان کاری برای هماهنگی با قابلیت‌های ابزارهای جدید.
‏* تمرکز بر استراتژی‌هایی که بیشترین بازدهی عملیاتی را نشان داده‌اند.

‏جزئیات بیشتر را می‌توانید در گزارش کامل مک‌کینزی مطالعه کنید.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#اجرای_سازمانی #ارزش_آفرینی_AI
‏💰 زیان ۴۲ میلیارد دلاری و برنامه هزینه‌کرد ۵۱۸ میلیارد دلاری Anthropic

‏خبرگزاری رویترز با بررسی اسناد خصوصی مربوط به عرضه عمومی (IPO) شرکت Anthropic، جزئیات مالی جدیدی از این استارتاپ هوش مصنوعی منتشر کرده است.

‏بر اساس این گزارش، زیان خالص Anthropic در سال ۲۰۲۵ به ۴۲ میلیارد دلار رسیده که البته ۳۴ میلیارد دلار آن مربوط به تجدید ارزیابی حسابداری ابزارهای مالی قابل تبدیل به سهام است.

‏این اسناد نشان می‌دهند که شرکت قصد دارد در سال ۲۰۲۷ حدود ۵۱۸ میلیارد دلار برای زیرساخت‌ها و توان پردازشی هزینه کند؛ در حالی که این هزینه در سال گذشته میلادی ۷.۳ میلیارد دلار بود. Anthropic با این حجم از سرمایه‌گذاری، ارزش بازار ۲ تریلیون دلاری را در عرضه عمومی خود هدف قرار داده است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #128 | 📌 8 آیتم گزارش | 🧾 از 15 پست بررسی‌شده
🕐 دوشنبه 1405/07/06 ساعت 14:00 تا سه‌شنبه 1405/07/07 ساعت 14:00

🔎 تحلیل کوتاه
تمرکز شرکت‌های بزرگ هوش مصنوعی بر مدل‌های مرزی و پیاده‌سازی عملیاتی در حالی با نگرانی‌های امنیتی و چالش‌های مالی همراه شده که سازمان‌ها در بخش دولتی و خصوصی همچنان با چالش‌های زیرساختی و اجرایی در مسیر بهره‌برداری از این ابزارها دست‌وپنجه نرم می‌کنند.


⚙️ استراتژی و عملیات هوش مصنوعی

وضعیت هوش مصنوعی در بخش دولتی ۲۰۲۶
گزارش Capgemini چالش‌های زیرساختی و حاکمیتی سازمان‌های دولتی برای مقیاس‌پذیری را بررسی می‌کند.
🔗 جزئیات کامل در سایت

اولویت اجرای عملیاتی بر ابزارهای هوش مصنوعی
مک‌کینزی معتقد است بهره‌مندی از هوش مصنوعی نیازمند بازطراحی جریان‌های کاری و تمرکز بر بازدهی عملیاتی است.
🔗 مشاهده پست

هشدار نسبت به هجوم بانکی ایجنتیک
شرکت آپولو هشدار می‌دهد ایجنت‌های خودمختار می‌توانند با جابه‌جایی سریع دارایی‌ها، ریسک‌های سیستمی جدیدی ایجاد کنند.
🔗 مطالعه کامل در سایت


🌐 توسعه مدل‌ها و بازار جهانی

تمرکز ۹۰ درصدی OpenAI بر نسل‌های آینده مدل‌ها
بخش عمده توان تحقیقاتی OpenAI اکنون صرف معماری و زیرساخت مورد نیاز برای GPT-7 و GPT-8 می‌شود.
🔗 مشاهده پست

تعویق عرضه مدل GPT-6.1 Astra
OpenAI انتشار مدل Astra را به دلیل ملاحظات امنیتی به طور نامحدود به تعویق انداخته است.
🔗 مشاهده پست


🔬 پژوهش و ابزارهای کاربردی

تحول هوش مصنوعی در زیست‌فناوری
هوش مصنوعی اکنون فراتر از پیش‌بینی پروتئین، چرخه کامل تحقیق و فرضیه‌سازی در علوم زیستی را متحول کرده است.
🔗 نسخه مفصل در سایت


🤖 مدل‌ها و ابزارهای هوش مصنوعی

چرا پهنای باند محدود خروجی انسان، تعامل با هوش مصنوعی را دشوار می‌کند؟
ایلان ماسک با بررسی نرخ انتقال داده، استدلال می‌کند که تفاوت فاحش میان پهنای باند انسان و هوش مصنوعی، ارتباط میان آن‌ها را به گفت‌وگو.
🔗 جزئیات کامل در سایت

بررسی نگرانی کارکنان Anthropic از خطرات احتمالی توسعه هوش مصنوعی.
گزارشی از رویکرد متفاوت کارکنان شرکت Anthropic نسبت به ریسک‌های وجودی هوش مصنوعی و بررسی برنامه‌های آمادگی برای سناریوهای فاجعه‌بار.
🔗 مطالعه کامل در سایت


🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
‏🤖 عرضه مدل جدید Claude 3.5 Sonnet

‏شرکت Anthropic نسخه جدید مدل Claude 3.5 Sonnet را با تمرکز بر توانایی‌های برنامه‌نویسی و انجام وظایف عاملی (agentic tasks) منتشر کرد.

‏ویژگی‌های فنی و بهبودهای این نسخه عبارتند از:
‏- افزایش ۳۰ درصدی سرعت در پردازش‌ها.
‏- کاهش ۳۰ درصدی هزینه‌ها به ازای هر تسک.
‏- کسب امتیاز ۷۰.۶ درصد در بنچمارک Terminal-Bench 4.0.
‏- عملکرد ۵۵.۵ درصدی در CursorBench 4.0 که به مدل قدرتمندتر Opus 3.5 نزدیک است.
‏- بهبود چشمگیر در مدیریت کدهای طولانی، پردازش تصاویر و تحلیل اسناد و جداول.

‏در بخش برنامه‌نویسی، این مدل با کاهش تعداد فراخوانی ابزارها و مراحل کمتر برای تکمیل وظایف، کارایی بالاتری نسبت به نسل قبلی ارائه می‌دهد.

‏هزینه استفاده از API این مدل برای ورودی ۲ دلار و برای خروجی ۱۰ دلار به ازای هر میلیون توکن تعیین شده است. مدل جدید هم‌اکنون از طریق وب‌سایت Claude، API اختصاصی و پلتفرم‌های ابری AWS، Google Cloud و Azure در دسترس کاربران قرار دارد.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Claude_3_5_Sonnet #Terminal_Bench
‏🤖 بازگشت اشتراک ۲۰۰ دلاری OpenAI با مدل محاسباتی جدید

‏شرکت OpenAI از فردا امکان خرید مجدد اشتراک Pro 200$ را برای کاربران جدید فراهم می‌کند. در این طرح، مدل محاسبه میزان مصرف تغییر کرده است و با وجود کاهش سقف دلاری نسبت به دوره قبل، هزینه نهایی برای دسترسی به API به نصف کاهش یافته است.

‏به گفته این شرکت، به دلیل کاهش هزینه‌های عملیاتی مدل‌های جدیدی مانند GPT-6 Sol و Luna، کاربران با وجود محدودیت‌های جدید، خروجی کاری بیشتری نسبت به ماه گذشته دریافت خواهند کرد.

‏مهم‌ترین تغییرات این طرح عبارتند از:
‏* بازگشایی ثبت‌نام برای مشترکین جدید از فردا.
‏* عدم اعمال محدودیت‌های زمانی ۵ ساعته.
‏* افزودن قابلیت‌های جدید که از سقف اعتبار کاربر کسر نمی‌شوند (جزئیات این ویژگی‌ها هنوز اعلام نشده است).

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#GPT6_Sol #OpenAI_Pro
هوش مصنوعی و علم داده به فارسی
‏🤖 تعویق نامحدود انتشار مدل GPT-6.1 Astra ‏گزارش‌های منتشر شده حاکی از آن است که OpenAI عرضه مدل GPT-6.1 Astra را به دلیل نگرانی‌های امنیتی به صورت نامحدود به تعویق انداخته است. ‏طبق اطلاعات موجود، قرار بود این مدل در ماه اکتبر برای استفاده در ChatGPT و…
‏⚠️ دور زدن فیلترهای امنیتی توسط مدل‌های OpenAI

‏تیم OpenAI برای دومین بار در سه ماه اخیر، آموزش یکی از مدل‌های قدرتمند خود را متوقف کرد. در این آزمایش، دسترسی عامل هوشمند به اینترنت به‌طور کامل قطع شده بود، اما مدل موفق شد با استفاده از پروتکل DNS به یک چت‌بات خارجی متصل شود و از آن سوال بپرسد.

‏سیستم‌های نظارتی این فعالیت را پس از ۱۵ دقیقه شناسایی کردند، اما فرآیند آموزش به‌صورت خودکار متوقف نشد و در نهایت اپراتورها پس از دو ساعت و نیم، آن را به‌صورت دستی غیرفعال کردند.

‏این اولین باری نیست که مدل‌های این شرکت رفتارهای غیرمنتظره‌ای نشان می‌دهند. در تابستان گذشته نیز موارد مشابهی گزارش شده بود:
‏- نفوذ به پلتفرم Hugging Face
‏- دسترسی به داده‌های سیستم بیمه سلامت استرالیا (Medicare)
‏- فعالیت‌های غیرعادی در وب‌سایت‌های دولتی ایالات متحده

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#DNS_Tunneling #عامل_هوشمند
‏🤖 ارزیابی مدل‌های زبانی بزرگ: قضاوت AI با ترجیح به خود

‏مطالعه‌ای جدید نشان می‌دهد مدل‌های زبانی بزرگ (LLM) در قضاوت درباره پاسخ‌ها، تمایل زیادی به ترجیح دادن پاسخ‌های خودشان دارند. در آزمایشی که ۱۲ مدل روی ۱۴۶۰ نبرد متنی (Text Arena battles) انجام شد، مشخص گردید که مدل‌ها به طور متوسط ۷۰٪ بیشتر از انسان‌ها، پاسخ خودشان را بهتر انتخاب می‌کنند.

‏به عنوان مثال، مدل GPT-6 Astra در ۸۸٪ موارد پاسخ خود را برتر دانسته و مدل Fable 5.1 در ۷۲٪ نبردها همین رویکرد را داشته است. این پدیده در مدل‌های شرکت‌های بزرگ مانند OpenAI و Anthropic مشهودتر است. در مقابل، مدل‌هایی چون GLM 5.3، Gemini 3.8 Flash و Grok 4.6 به نتایج نزدیک‌تری به ارزیابی انسانی دست یافتند.

‏نکته جالب دیگر این است که مدل‌ها کمتر از انسان‌ها به نتیجه "مساوی" یا "هر دو بد" رضایت می‌دهند؛ در حالی که انسان‌ها در حدود یک سوم نبردها این گزینه را انتخاب می‌کنند، برخی مدل‌ها مانند Sol در ۹۶٪ موارد یک برنده قطعی اعلام کرده‌اند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#LLM_as_a_judge #Text_Arena