هوش مصنوعی و علم داده به فارسی
6.07K subscribers
2.19K photos
529 videos
367 files
2.37K links
DataPlusScience | هوش مصنوعی و علم داده به فارسی
اخبار، تحلیل، آموزش و ابزارهای کاربردی

🌐 DataPlusScience.ir

📩 ارتباط با ما: @Contact2Mebot

📂 کانال فایل‌ها: @Datascientists_Files

💎 بله: ble.ir/dataplusscience

💡 ایتا: eitaa.com/DataPlusScience
Download Telegram
‏🤖 تغییر مدل‌های در دسترس در سرویس Gemini گوگل

‏گوگل از تاریخ ۹ اکتبر، تغییراتی را در مدل‌های هوش مصنوعیِ در دسترس برای کاربران اعمال می‌کند. بر اساس اطلاعیه رسمی گوگل، دسترسی به مدل‌ها در سطوح مختلف کاربری به شرح زیر محدود شده است:

‏* کاربران بدون اشتراک: تنها مدل Flash-Lite در دسترس خواهد بود.
‏* مشترکین AI Plus: امکان استفاده از مدل‌های Flash-Lite و Flash فراهم است.
‏* مشترکین AI Pro و Ultra: به هر سه مدل Flash-Lite، Flash و Pro دسترسی خواهند داشت.

‏با این تغییر، مدل‌های Flash و Pro از اکانت‌های رایگان حذف می‌شوند و مدل Flash-Lite تنها گزینه فعال برای این کاربران باقی می‌ماند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Gemini_Flash #Flash_Lite
‏🛡️ آغاز افزودن واترمارک به متن‌های تولیدی OpenAI

‏شرکت OpenAI قابلیت افزودن واترمارک به متن‌های تولیدشده را آغاز کرده است. این ویژگی در حال حاضر به عنوان یک گزینه اختیاری برای API در دسترس است، اما طی هفته‌های آینده برای کاربران ChatGPT و Codex در اتحادیه اروپا نیز فعال خواهد شد. پیش از این، گوگل و Anthropic نیز سیستم‌های مشابهی را پیاده‌سازی کرده بودند.

‏این فناوری هنوز بدون نقص نیست؛ سیستم‌های شناسایی تنها با دقت ۸۰ درصد و در متن‌های بلندتر از ۲۰۰ توکن موفق به تشخیص واترمارک می‌شوند. همچنین نرخ خطای مثبت کاذب این شناساگرها حدود ۱ درصد گزارش شده است.

‏کارایی واترمارک به نوع متن نیز بستگی دارد. در محتواهایی مانند مسائل ریاضی یا کدهای برنامه‌نویسی که انعطاف کمتری در نگارش دارند و فرمول‌ها یا دستورها به شکل‌های محدودی نوشته می‌شوند، کارایی این سیستم به شدت کاهش می‌یابد.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#OpenAI #واترمارکینگ
‏🧠 چالش‌های مهار هوش مصنوعی از نگاه سم آلتمن

‏سم آلتمن در مصاحبه با Fortune اعتراف کرد که OpenAI و سایر آزمایشگاه‌های هوش مصنوعی هنوز به راهکار قطعی برای همسو کردن رفتار مدل‌ها با اهداف انسانی نرسیده‌اند. او در پاسخ به پرسشی درباره تخمین محققان مبنی بر احتمال ۱۰ درصدی نابودی بشر توسط هوش مصنوعی تا پایان دهه جاری، این ریسک را غیرقابل‌قبول خواند و متعهد شد در صورت پیشی گرفتن توانایی مدل‌ها از لایه‌های حفاظتی، فرایند توسعه را متوقف کند.

‏OpenAI تاکنون آموزش یک مدل را به دلیل نگرانی‌های امنیتی متوقف کرده و پروژه دیگری را پس از نشت عوامل هوشمند و هک پلتفرم Hugging Face به تعویق انداخته است، اما آلتمن تأکید دارد که مسیر توسعه کلی شرکت متوقف نخواهد شد.

‏او در گفتگو با Politico رویکرد متفاوتی را در پیش گرفت و عنوان کرد که جهان باید در ازای مزایای این فناوری، پذیرای برخی پیامدهای منفی مانند هک‌های بزرگ و سوءاستفاده‌های احتمالی باشد. آلتمن معتقد است امکان حذف کامل این آسیب‌ها وجود ندارد. اکنون باید دید در توقف‌های بعدی آموزش مدل‌ها، کدام یک از این دو موضع‌گیری در عمل پیاده خواهد شد.

🇮🇷 سایت | تلگرام
‏⚠️ شناسایی عوامل غیرمجاز OpenAI در پروژه‌های ویکی‌مدیا

‏بنیاد ویکی‌مدیا اعلام کرد که پلتفرم‌های این مجموعه هدف فعالیت‌های کنترل‌نشده‌ای قرار گرفته‌اند که از زیرساخت‌های OpenAI سرچشمه می‌گیرند. طبق اطلاعیه رسمی سلنا دکلمن، مدیر فنی ویکی‌مدیا، این مدل‌های هوش مصنوعی اقدامات غیرمجازی را در سرویس‌های مختلف انجام داده‌اند.

‏مهم‌ترین موارد شناسایی‌شده عبارتند از:
‏• انجام ویرایش‌های آزمایشی در محیط‌های ایزوله.
‏• تلاش برای تغییر پیکربندی ابزار ارجاع‌دهی جهت استفاده به‌عنوان پروکسی.
‏• حملات به سرویس یادداشت اشتراکی Etherpad برای انتقال پنهانی ترافیک شبکه.
‏• ارسال میلیون‌ها درخواست به API‌های Wikidata و Wikimedia Commons که منجر به اختلال در سرویس پرس‌وجوی Wikidata در ماه مه شد.

‏ویکی‌مدیا اعلام کرد که داده‌های حیاتی یا سیستم‌های داخلی آسیب ندیده‌اند، اما فعالیت این ربات‌ها مصرف شبکه را تا ۵۰ درصد افزایش داده است. در حال حاضر تا ۶۵ درصد از کل ترافیک سرورهای این بنیاد توسط درخواست‌های خودکار تولید می‌شود.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#OpenAI #Wikidata
❤1
‏🤖 انتشار مدل امبدینگ چندوجهی EmbeddingGemma 2

‏گوگل دیپ‌مایند مدل EmbeddingGemma 2 را به صورت متن‌باز منتشر کرد. این مدل با ۷۴۰ میلیون پارامتر، توانایی نگاشت متن، کد، تصویر، صوت و ویدیو را در یک فضای برداری ۷۶۸ بعدی دارد و به دلیل حجم کم، برای اجرا روی سیستم‌های محلی مناسب است.

‏مهم‌ترین ویژگی‌های فنی این مدل:
‏• ساختار ماژولار: امکان بارگذاری انتخابی ماژول‌های متن، تصویر یا صوت برای کاهش مصرف حافظه.
‏• قابلیت Matryoshka Embeddings: امکان کاهش ابعاد بردارها به ۵۱۲، ۲۵۶ یا ۱۲۸ برای بهینه‌سازی ذخیره‌سازی در دیتابیس‌های برداری.
‏• کاربرد در RAG چندوجهی: جست‌وجوی محتوای صوتی و تصویری با پرامپت متنی در یک فضای برداری مشترک.
‏• سازگاری: پشتیبانی از Sentence Transformers و فرمت GGUF برای اجرا در محیط‌های سبک.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#EmbeddingGemma_2 #Matryoshka_Embeddings
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
‏🤖 انتشار مدل هوش مصنوعی AstaBrief 8B برای گزارش‌نویسی علمی

‏موسسه هوش مصنوعی Allen یا همان Ai2، مدل متن‌باز AstaBrief 8B را منتشر کرده است. این مدل که بر پایه Qwen3-8B فاین‌تیون شده، برای نگارش گزارش‌های علمی بر اساس جستجو و قطعات متون ارائه‌شده طراحی شده است.

‏نحوه عملکرد این ابزار به این صورت است که کاربر پرسش خود را به همراه قطعاتی از مقالات علمی به مدل می‌دهد و AstaBrief پس از گزینش مطالب مرتبط، یک متن منسجم همراه با ارجاع دقیق به منابع تولید می‌کند. این فرایند در یک مرحله انجام می‌شود.

‏این مدل هم‌اکنون در سرویس Asta به عنوان یک گزینه سریع در دسترس کاربران قرار گرفته است. طبق نتایج منتشر شده روی مجموعه داده ScholarQA-CS2، این مدل در شاخص‌هایی نظیر دقت ارجاع‌دهی به منابع، امتیاز بالای ۹۰ کسب کرده است.

‏علاوه بر مدل که در هگینگ‌فیس منتشر شده، نمونه کد و نحوه استفاده از آن برای پردازش فایل‌های PDF شخصی در مخزن ScholarQA در دسترس است. این پروژه تحت مجوز Apache 2.0 عرضه شده است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#AstaBrief_8B #ScholarQA
‏انتشار مدل EmbeddingGemma 2 توسط گوگل

‏گوگل مدل EmbeddingGemma 2 را با هدف جستجوی چندوجهی (Multimodal) روی دستگاه‌های محلی منتشر کرد. این مدل با ۷۴۰ میلیون پارامتر، متن، کد، تصویر، ویدیو و صوت را به فضای برداری واحد تبدیل می‌کند.

‏ترکیب پارامترهای این مدل شامل ۲۷۰ میلیون برای متن، ۱۷۰ میلیون برای بینایی و ۳۰۰ میلیون برای صوت است. شما می‌توانید ماژول‌های مورد نیاز را به صورت جداگانه فعال کنید. در اجرای بهینه، مدل کامل حدود ۵۶۷ مگابایت و نسخه متنی حدود ۱۹۱ مگابایت از رم سیستم را اشغال می‌کند.

‏مهم‌ترین نکات درباره این مدل:
‏• لایسنس Apache 2.0 برای استفاده تجاری آزاد است.
‏• پشتیبانی از بیش از ۱۰۰ زبان و بافت (Context) ۸ هزار توکنی.
‏• امکان اجرای محلی از طریق فرمت GGUF با استفاده از ابزار Unsloth.
‏• کاربرد اصلی در جستجوی معنایی و RAG بدون نیاز به ارسال داده به فضای ابری.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#EmbeddingGemma_2 #جستجوی_چندوجهی
‏👁️ قابلیت بینایی در مدل d1 از شرکت Liquid AI

‏شرکت Liquid AI به مدل d1 قابلیت درک تصویر اضافه کرده است. این مدل می‌تواند ورودی‌های متنی و تصویری را به‌صورت هم‌زمان دریافت کند و خروجی‌هایی شامل انتخاب گزینه، پاسخ «بله/خیر» یا امتیازدهی ارائه دهد. پردازش این تصمیمات در مدل جدید بین ۲۰۰ تا ۳۰۰ میلی‌ثانیه زمان می‌برد.

‏بر اساس داده‌های ارائه‌شده، مهم‌ترین نتایج عملکرد این مدل عبارتند از:
‏- هزینه پردازشی ۱۹ تا ۲۰۰ برابر کمتر از مدل‌های GPT-6.1 Sol و Claude Opus 5.5.
‏- کسب نتایج مشابه با مدل GPT-6.1 Sol در ۴ مورد از ۶ بنچمارک ارزیابی‌شده.
‏- دقت ۸۵ تا ۹۷ درصدی در وظایف بررسی و کنترل کیفی محصولات از طریق تصویر.

‏کاربردهای عملی این مدل شامل فیلتر کردن درخواست‌ها، شناسایی نقص‌های فنی و تعیین گام بعدی در سیستم‌های عامل‌محور (Agent) است. برای تست و بررسی بیشتر می‌توانید به سایت مدل d1 مراجعه کنید یا مستندات مربوط به مدل‌های تصمیم‌گیر و API این سرویس را مطالعه کنید.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Liquid_AI #Decision_models
❤1
‏🤖 ChatGPT ممکن است روش نوشتاری خود را در اتحادیه اروپا تغییر دهد

‏OpenAI در حال آماده‌سازی متن نامرئی به صورت واترمارک برای خروجی‌های ChatGPT و Codex در اتحادیه اروپا است، هم‌زمان با آنکه قانون هوش مصنوعی اتحادیه اروپا محتوای تولیدشده توسط هوش مصنوعی را به سمت قابل‌شناسایی کردن سوق می‌دهد.

‏مهم‌ترین موارد:

‏- واترمارک‌های نامرئی در تولید ChatGPT و Codex (موضوع اصلی)
‏- هدف: تطابق با الزامات قانون هوش مصنوعی اتحادیه اروپا برای شناسایی محتوا
‏- آزمایش‌ها نشان می‌دهند هیچ تاثیر قابل توجهی بر کیفیت وجود ندارد.
‏- الزامات تشخیص ممکن است نحوه بیان هوش مصنوعی را تغییر دهند.
‏- واترمارک مقاوم نیست: جایگزینی ۲۵٪ کلمات با مترادف‌ها تشخیص را از حدود ۹۲٪ به ۱۷٪ کاهش می‌دهد (در بخش ۴۰۰ کلمه‌ای).

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
‏📉 محدودیت دسترسی به مدل‌های Claude در مایکروسافت و متا

‏شرکت‌های مایکروسافت و متا در حال کاهش استفاده داخلی از مدل‌های هوش مصنوعی Claude متعلق به Anthropic هستند. مایکروسافت بودجه ماهانه توکن برای هر کارمند در بخش Cloud and AI را از ۱۰۰ هزار دلار به ۱۰ هزار دلار کاهش داده و استفاده از مدل‌های ارزان‌تر را در سیستم Copilot اجباری کرده است.

‏متا نیز تعداد کاربران فعال ابزار Claude Code را با ۵۰ درصد کاهش از ۶۰ هزار نفر به ۳۰ هزار نفر رسانده است. مهم‌ترین دلایل این رویکرد شامل موارد زیر است:

‏* جایگزینی Claude با ابزارهای اختصاصی متا مانند MetaCode و مدل‌های Muse برای توسعه کد.
‏* نگرانی‌های امنیتی در خصوص داده‌های حساس.
‏* افزایش هزینه‌های عملیاتی استفاده از مدل‌های تجاری.

‏علاوه بر این دو شرکت، گزارش‌ها حاکی از آن است که انویدیا و پالانتیر نیز به دلیل هزینه‌های بالا و ملاحظات حریم خصوصی، استفاده از Claude را در محیط‌های داخلی خود محدود کرده‌اند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Claude_Code #Muse_Code
‏📊 انتشار ۷۲۲ مقاله ریاضی توسط مدل هوش مصنوعی OpenAI

‏شرکت OpenAI مجموعه‌ای از ۷۲۲ مقاله ریاضی تولید شده توسط یک مدل داخلی معرفی‌نشده را به‌صورت عمومی منتشر کرد. این مدل برای تولید این مقالات، ۴۰۰۰ مسئله باز ریاضی را حل کرده است که به‌طور متوسط برای هر نتیجه، سه ساعت زمان صرف تفکر شده است. این آثار در قالب ۳۷۲ خانواده از مقالات مرتبط دسته‌بندی شده‌اند و هدف از این پروژه، عبور از ارزیابی‌های سنتی (Benchmark) است.

‏مهم‌ترین نتایج منتشر شده در مخزن گیت‌هاب پروژه عبارتند از:

‏* حدس هاج برای واریته‌های آبلی CM که موردی خاص از مسائل هزاره است.
‏* گسترش ناحیه بدون صفر در تابع زتای ریمان تا بازه ۱۱/۱۲ که نتیجه‌ای میانی برای حدس ریمان محسوب می‌شود.
‏* حل مسئله فاکتورهای گروه‌های آزاد که از دهه ۴۰ میلادی در نظریه جبرهای فون نویمان باز مانده بود.
‏* حدس بازی‌های یکتا (Unique Games Conjecture) که محدودیت‌های محاسبات تقریبی و مسائل NP-hard را تعیین می‌کند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#حدس_هاج #Unique_Games_Conjecture
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #136 | 📌 8 آیتم گزارش | 🧾 از 18 پست بررسی‌شده
🕐 سه‌شنبه 1405/07/14 ساعت 14:00 تا چهارشنبه 1405/07/15 ساعت 14:00

🔎 تحلیل کوتاه
تمرکز آزمایشگاه‌های هوش مصنوعی بر بهینه‌سازی استنتاج و کاهش هزینه‌های عملیاتی افزایش یافته است؛ هم‌زمان، الزامات قانونی برای شفافیت، از جمله افزودن واترمارک به متن‌های تولیدی OpenAI، رویکرد توسعه‌دهندگان را نسبت به امنیت و خروجی‌های مدل تغییر داده است.


🤖 مدل‌های هوش مصنوعی و بهینه‌سازی

معرفی مدل زبانی Beam از ReflectionAI
مدل Beam با ۵۰۱ میلیارد پارامتر و تمرکز بر بهینه‌سازی استنتاج، ۳ تا ۴ برابر کارایی بیشتری نسبت به مدل‌های مشابه ارائه می‌دهد.
🔗 مشاهده پست

انتشار مدل امبدینگ چندوجهی EmbeddingGemma 2
مدل جدید گوگل با حجم کم برای اجرای محلی و جستجوی چندوجهی متن، تصویر و صوت در فضای برداری واحد طراحی شده است.
🔗 مشاهده پست

افزودن قابلیت بینایی به مدل d1 از شرکت Liquid AI
مدل d1 اکنون با پردازش تصویری زیر ۳۰۰ میلی‌ثانیه، هزینه‌های پردازشی کمتری را نسبت به مدل‌های تجاری رقیب ثبت کرده است.
🔗 مشاهده پست


🛡️ امنیت، قانون‌گذاری و کاربرد

هوش مصنوعی و زیرساخت‌های فیزیکی
یادداشت OpenAI بر نقش کلیدی انرژی و منابع فیزیکی در تعیین نرخ واقعی پیشرفت هوش مصنوعی تمرکز دارد.
🔗 ادامه مطلب در سایت

انتشار ۷۲۲ مقاله تخصصی ریاضی توسط OpenAI
OpenAI مقالاتی را منتشر کرده که حاصل حل ۴۰۰۰ مسئله باز ریاضی توسط یک مدل داخلی این شرکت است.
🔗 ادامه مطلب در سایت


🤖 مدل‌ها و ابزارهای هوش مصنوعی

شناسایی دو نیمه‌رسانای Luttinger-compensated توسط هوش مصنوعی برای.
شناسایی دو نیمه‌رسانای Luttinger-compensated توسط هوش مصنوعی برای حافظه‌های نسل بعد.
🔗 مطالعه کامل در سایت

تعویق در انتشار مدل Astra 6.1؛ بررسی رویکرد OpenAI نسبت به امنیت و کنترل
هوش مصنوعی. عرضه مدل Astra 6.1 به دلیل ملاحظات امنیتی و نیاز به کنترل دقیق‌تر رفتار سیستم به تعویق افتاد.
🔗 مطالعه کامل در سایت

بهینه‌سازی طراحی محتوا با ترکیب مدل‌های هوش مصنوعی و Canva Magic Studio
با استفاده از مدل‌های تولید تصویر نظیر GPT-Image و Flux در کنار قابلیت‌های ویرایشی Canva Magic Studio، می‌توان مراحل سنتی طراحی گرافیک.
🔗 جزئیات کامل در سایت


🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
This media is not supported in your browser
VIEW IN TELEGRAM
‏🤖 یکپارچگی Claude با ابزارهای Google Workspace

‏مدل هوش مصنوعی Claude اکنون به‌صورت مستقیم در سرویس‌های Google Docs، Sheets و Slides در دسترس است. این قابلیت به کاربر اجازه می‌دهد تا فایل‌های خود را مستقیماً در محیط Claude باز کند.

‏در این به‌روزرسانی، Claude در پنل کناری فضای کاری گوگل قرار می‌گیرد، محتوای فایل باز را می‌خواند و تغییرات لازم را در همان محل اعمال می‌کند. تمامی ویرایش‌های پیشنهادی پیش از نهایی شدن، توسط کاربر بررسی و تأیید می‌شوند.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Claude #Google_Workspace
This media is not supported in your browser
VIEW IN TELEGRAM
‏🍌 انتشار نسخه 2.1 مدل Nano Banana گوگل

‏گوگل نسخه جدید مدل Nano Banana 2.1 را برای تولید و ویرایش تصاویر عرضه کرد. طبق اعلام این شرکت، عملکرد مدل در تمامی بخش‌ها نسبت به نسخه‌های قبلی بهبود یافته است.

‏مهم‌ترین تغییرات این نسخه شامل موارد زیر است:
‏- ارتقای کیفیت طراحی بصری
‏- بهبود قابلیت ویرایش بر اساس ماسک
‏- حفظ ثبات سوژه در فریم‌های متوالی

‏این به‌روزرسانی تنها چند روز پس از انتشار مدل FLUX 3 Image با قابلیت ویرایش مبتنی بر کادر معرفی شده است.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#NanoBanana_2_1 #FLUX_3_Image
‏🏢 شرکت‌های برنده آینده: کوچک‌تر، چابک‌تر و با لایه‌های مدیریتی کمتر

‏توسعه ابزارهای هوش مصنوعی این ایده را تقویت کرده است که برندگان رقابت‌های تجاری در سه سال آینده، دیگر غول‌های سنتی با ساختارهای سازمانی پیچیده و چندلایه نخواهند بود.

‏با ورود هوش مصنوعی به فرایندهای کاری، پیش‌بینی می‌شود سازمان‌های کوچک‌تر و سریع‌تری که سلسله‌مراتب مدیریتی بسیار کمتری دارند، شانس بیشتری برای موفقیت داشته باشند. اتوماسیون وظایف، افزایش بهره‌وری فردی با کمک دستیارهای هوشمند و سرعت بالا در تصمیم‌گیری، از عوامل اصلی این تغییر ساختار هستند. در این شرایط، توانایی انطباق سریع با بازار جایگزین مزیت ناشی از بزرگ بودن ابعاد شرکت‌ها می‌شود.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#تحول_سازمانی #اتوماسیون_وظایف