📚 انتشار کتاب رایگان Fundamentals of Computer Vision توسط MIT Press
انتشارات MIT Press کتاب جدیدی با عنوان Fundamentals of Computer Vision را به صورت آنلاین و رایگان منتشر کرد. این کتاب مقدمهای جامع بر بینایی ماشین ارائه میدهد و مباحث را از دو دیدگاه پردازش تصویر و یادگیری ماشین بررسی میکند.
مطالب این کتاب شامل موارد زیر است:
- تشکیل تصویر و فیلترینگ
- تحلیل فوریه
- شبکههای عصبی کانولوشن (CNN)، بازگشتی (RNN) و ترنسفورمرها
- مدلهای مولد (Generative Models)
- یادگیری بازنمایی (Representation Learning)
- هندسه سهبعدی و تخمین حرکت
- تشخیص اشیاء
- مدلهای ترکیبی تصویر و متن
این کتاب بهطور کامل در قالب HTML در دسترس است و از نمودارها و تصاویر متعددی برای توضیح مفاهیم استفاده میکند. میتوانید محتوای کامل آن را در وبسایت رسمی این کتاب مطالعه کنید.
#MITPress #RepresentationLearning
انتشارات MIT Press کتاب جدیدی با عنوان Fundamentals of Computer Vision را به صورت آنلاین و رایگان منتشر کرد. این کتاب مقدمهای جامع بر بینایی ماشین ارائه میدهد و مباحث را از دو دیدگاه پردازش تصویر و یادگیری ماشین بررسی میکند.
مطالب این کتاب شامل موارد زیر است:
- تشکیل تصویر و فیلترینگ
- تحلیل فوریه
- شبکههای عصبی کانولوشن (CNN)، بازگشتی (RNN) و ترنسفورمرها
- مدلهای مولد (Generative Models)
- یادگیری بازنمایی (Representation Learning)
- هندسه سهبعدی و تخمین حرکت
- تشخیص اشیاء
- مدلهای ترکیبی تصویر و متن
این کتاب بهطور کامل در قالب HTML در دسترس است و از نمودارها و تصاویر متعددی برای توضیح مفاهیم استفاده میکند. میتوانید محتوای کامل آن را در وبسایت رسمی این کتاب مطالعه کنید.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#MITPress #RepresentationLearning
❤1
🤖 معرفی مدل زبانی Beam از ReflectionAI
تیم ReflectionAI مدل جدید
مشخصات فنی و اجرایی این مدل به شرح زیر است:
- آموزش کامل از صفر طی یک ماه روی ۲۴ تریلیون توکن.
- انجام بزرگترین دوره آموزش تقویتی (RL) ثبتشده با استفاده از ۱۰.۵ هزار تراشه GB300 طی ۴ هفته.
- عملکردی در بنچمارکها نزدیک به مدل GLM-5.2 و در برخی حوزهها مانند
وزنهای این مدل قرار است تحت لایسنس
#BeamModel #SparseActivation
تیم ReflectionAI مدل جدید
Beam را معرفی کرد؛ مدلی با ۵۰۱ میلیارد پارامتر کل و ۲۳ میلیارد پارامتر فعال که با هدف بهینهسازی استنتاج عرضه شده است. طبق اعلام این تیم، مدل مذکور از نظر کارایی ۳ تا ۴ برابر در زمان اجرا بهینهتر عمل میکند.مشخصات فنی و اجرایی این مدل به شرح زیر است:
- آموزش کامل از صفر طی یک ماه روی ۲۴ تریلیون توکن.
- انجام بزرگترین دوره آموزش تقویتی (RL) ثبتشده با استفاده از ۱۰.۵ هزار تراشه GB300 طی ۴ هفته.
- عملکردی در بنچمارکها نزدیک به مدل GLM-5.2 و در برخی حوزهها مانند
SWE Bench Verified با کسب امتیاز ۸۰.۹، فراتر از رقبا.وزنهای این مدل قرار است تحت لایسنس
Apache 2.0 منتشر شوند. جزئیات بیشتر و بررسی بنچمارکها در وبلاگ ReflectionAI در دسترس است.🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#BeamModel #SparseActivation
📊 مقایسه ارزش اشتراکهای OpenAI و Anthropic
تحلیل جدید SemiAnalysis نشان میدهد که اشتراکهای Anthropic در مقایسه با OpenAI، ارزش API بسیار بالاتری را به کاربران ارائه میدهند. این محاسبات بر اساس «بار کاری ایجنتیک» (شامل ترکیب خاصی از ورودی، ورودی کششده و خروجی) و قیمتگذاری رسمی API انجام شده است.
نتایج مقایسه ارزش API بر اساس طرحهای مختلف:
• طرح ۲۰۰ دلاری: کلاد (Claude Max 20x) ارزشی معادل ۱۱,۷۲۶ دلار (۵۸.۶ برابر هزینه) و GPT-6.1 Sol ارزشی معادل ۲,۰۸۴ دلار (۱۰.۴ برابر هزینه) ارائه میدهد.
• طرح ۱۰۰ دلاری: کلاد (Claude Max 5x) ارزشی معادل ۵,۷۲۵ دلار (۵۷.۳ برابر هزینه) و ChatGPT Pro 100 ارزشی معادل ۱,۰۵۵ دلار (۱۰.۶ برابر هزینه) دارد.
• طرح ۲۰ دلاری: کلاد (Claude Pro) ارزشی معادل ۱,۱۷۸ دلار (۵۸.۹ برابر هزینه) و ChatGPT Plus ارزشی معادل ۲۱۱ دلار (۱۰.۶ برابر هزینه) ایجاد میکند.
این ارقام تنها بر اساس سقف توکنهای مجاز در طرحهای اشتراکی و نرخ رسمی API محاسبه شدهاند و شامل هزینههای جانبی یا محدودیتهای احتمالی در سرعت پاسخدهی مدلها نیستند.
🇮🇷 سایت | تلگرام
تحلیل جدید SemiAnalysis نشان میدهد که اشتراکهای Anthropic در مقایسه با OpenAI، ارزش API بسیار بالاتری را به کاربران ارائه میدهند. این محاسبات بر اساس «بار کاری ایجنتیک» (شامل ترکیب خاصی از ورودی، ورودی کششده و خروجی) و قیمتگذاری رسمی API انجام شده است.
نتایج مقایسه ارزش API بر اساس طرحهای مختلف:
• طرح ۲۰۰ دلاری: کلاد (Claude Max 20x) ارزشی معادل ۱۱,۷۲۶ دلار (۵۸.۶ برابر هزینه) و GPT-6.1 Sol ارزشی معادل ۲,۰۸۴ دلار (۱۰.۴ برابر هزینه) ارائه میدهد.
• طرح ۱۰۰ دلاری: کلاد (Claude Max 5x) ارزشی معادل ۵,۷۲۵ دلار (۵۷.۳ برابر هزینه) و ChatGPT Pro 100 ارزشی معادل ۱,۰۵۵ دلار (۱۰.۶ برابر هزینه) دارد.
• طرح ۲۰ دلاری: کلاد (Claude Pro) ارزشی معادل ۱,۱۷۸ دلار (۵۸.۹ برابر هزینه) و ChatGPT Plus ارزشی معادل ۲۱۱ دلار (۱۰.۶ برابر هزینه) ایجاد میکند.
این ارقام تنها بر اساس سقف توکنهای مجاز در طرحهای اشتراکی و نرخ رسمی API محاسبه شدهاند و شامل هزینههای جانبی یا محدودیتهای احتمالی در سرعت پاسخدهی مدلها نیستند.
🇮🇷 سایت | تلگرام
🤖 تغییر مدلهای در دسترس در سرویس Gemini گوگل
گوگل از تاریخ ۹ اکتبر، تغییراتی را در مدلهای هوش مصنوعیِ در دسترس برای کاربران اعمال میکند. بر اساس اطلاعیه رسمی گوگل، دسترسی به مدلها در سطوح مختلف کاربری به شرح زیر محدود شده است:
* کاربران بدون اشتراک: تنها مدل Flash-Lite در دسترس خواهد بود.
* مشترکین AI Plus: امکان استفاده از مدلهای Flash-Lite و Flash فراهم است.
* مشترکین AI Pro و Ultra: به هر سه مدل Flash-Lite، Flash و Pro دسترسی خواهند داشت.
با این تغییر، مدلهای Flash و Pro از اکانتهای رایگان حذف میشوند و مدل Flash-Lite تنها گزینه فعال برای این کاربران باقی میماند.
#Gemini_Flash #Flash_Lite
گوگل از تاریخ ۹ اکتبر، تغییراتی را در مدلهای هوش مصنوعیِ در دسترس برای کاربران اعمال میکند. بر اساس اطلاعیه رسمی گوگل، دسترسی به مدلها در سطوح مختلف کاربری به شرح زیر محدود شده است:
* کاربران بدون اشتراک: تنها مدل Flash-Lite در دسترس خواهد بود.
* مشترکین AI Plus: امکان استفاده از مدلهای Flash-Lite و Flash فراهم است.
* مشترکین AI Pro و Ultra: به هر سه مدل Flash-Lite، Flash و Pro دسترسی خواهند داشت.
با این تغییر، مدلهای Flash و Pro از اکانتهای رایگان حذف میشوند و مدل Flash-Lite تنها گزینه فعال برای این کاربران باقی میماند.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#Gemini_Flash #Flash_Lite
🛡️ آغاز افزودن واترمارک به متنهای تولیدی OpenAI
شرکت OpenAI قابلیت افزودن واترمارک به متنهای تولیدشده را آغاز کرده است. این ویژگی در حال حاضر به عنوان یک گزینه اختیاری برای API در دسترس است، اما طی هفتههای آینده برای کاربران ChatGPT و Codex در اتحادیه اروپا نیز فعال خواهد شد. پیش از این، گوگل و Anthropic نیز سیستمهای مشابهی را پیادهسازی کرده بودند.
این فناوری هنوز بدون نقص نیست؛ سیستمهای شناسایی تنها با دقت ۸۰ درصد و در متنهای بلندتر از ۲۰۰ توکن موفق به تشخیص واترمارک میشوند. همچنین نرخ خطای مثبت کاذب این شناساگرها حدود ۱ درصد گزارش شده است.
کارایی واترمارک به نوع متن نیز بستگی دارد. در محتواهایی مانند مسائل ریاضی یا کدهای برنامهنویسی که انعطاف کمتری در نگارش دارند و فرمولها یا دستورها به شکلهای محدودی نوشته میشوند، کارایی این سیستم به شدت کاهش مییابد.
#OpenAI #واترمارکینگ
شرکت OpenAI قابلیت افزودن واترمارک به متنهای تولیدشده را آغاز کرده است. این ویژگی در حال حاضر به عنوان یک گزینه اختیاری برای API در دسترس است، اما طی هفتههای آینده برای کاربران ChatGPT و Codex در اتحادیه اروپا نیز فعال خواهد شد. پیش از این، گوگل و Anthropic نیز سیستمهای مشابهی را پیادهسازی کرده بودند.
این فناوری هنوز بدون نقص نیست؛ سیستمهای شناسایی تنها با دقت ۸۰ درصد و در متنهای بلندتر از ۲۰۰ توکن موفق به تشخیص واترمارک میشوند. همچنین نرخ خطای مثبت کاذب این شناساگرها حدود ۱ درصد گزارش شده است.
کارایی واترمارک به نوع متن نیز بستگی دارد. در محتواهایی مانند مسائل ریاضی یا کدهای برنامهنویسی که انعطاف کمتری در نگارش دارند و فرمولها یا دستورها به شکلهای محدودی نوشته میشوند، کارایی این سیستم به شدت کاهش مییابد.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#OpenAI #واترمارکینگ
🧠 چالشهای مهار هوش مصنوعی از نگاه سم آلتمن
سم آلتمن در مصاحبه با Fortune اعتراف کرد که OpenAI و سایر آزمایشگاههای هوش مصنوعی هنوز به راهکار قطعی برای همسو کردن رفتار مدلها با اهداف انسانی نرسیدهاند. او در پاسخ به پرسشی درباره تخمین محققان مبنی بر احتمال ۱۰ درصدی نابودی بشر توسط هوش مصنوعی تا پایان دهه جاری، این ریسک را غیرقابلقبول خواند و متعهد شد در صورت پیشی گرفتن توانایی مدلها از لایههای حفاظتی، فرایند توسعه را متوقف کند.
OpenAI تاکنون آموزش یک مدل را به دلیل نگرانیهای امنیتی متوقف کرده و پروژه دیگری را پس از نشت عوامل هوشمند و هک پلتفرم Hugging Face به تعویق انداخته است، اما آلتمن تأکید دارد که مسیر توسعه کلی شرکت متوقف نخواهد شد.
او در گفتگو با Politico رویکرد متفاوتی را در پیش گرفت و عنوان کرد که جهان باید در ازای مزایای این فناوری، پذیرای برخی پیامدهای منفی مانند هکهای بزرگ و سوءاستفادههای احتمالی باشد. آلتمن معتقد است امکان حذف کامل این آسیبها وجود ندارد. اکنون باید دید در توقفهای بعدی آموزش مدلها، کدام یک از این دو موضعگیری در عمل پیاده خواهد شد.
🇮🇷 سایت | تلگرام
سم آلتمن در مصاحبه با Fortune اعتراف کرد که OpenAI و سایر آزمایشگاههای هوش مصنوعی هنوز به راهکار قطعی برای همسو کردن رفتار مدلها با اهداف انسانی نرسیدهاند. او در پاسخ به پرسشی درباره تخمین محققان مبنی بر احتمال ۱۰ درصدی نابودی بشر توسط هوش مصنوعی تا پایان دهه جاری، این ریسک را غیرقابلقبول خواند و متعهد شد در صورت پیشی گرفتن توانایی مدلها از لایههای حفاظتی، فرایند توسعه را متوقف کند.
OpenAI تاکنون آموزش یک مدل را به دلیل نگرانیهای امنیتی متوقف کرده و پروژه دیگری را پس از نشت عوامل هوشمند و هک پلتفرم Hugging Face به تعویق انداخته است، اما آلتمن تأکید دارد که مسیر توسعه کلی شرکت متوقف نخواهد شد.
او در گفتگو با Politico رویکرد متفاوتی را در پیش گرفت و عنوان کرد که جهان باید در ازای مزایای این فناوری، پذیرای برخی پیامدهای منفی مانند هکهای بزرگ و سوءاستفادههای احتمالی باشد. آلتمن معتقد است امکان حذف کامل این آسیبها وجود ندارد. اکنون باید دید در توقفهای بعدی آموزش مدلها، کدام یک از این دو موضعگیری در عمل پیاده خواهد شد.
🇮🇷 سایت | تلگرام
⚠️ شناسایی عوامل غیرمجاز OpenAI در پروژههای ویکیمدیا
بنیاد ویکیمدیا اعلام کرد که پلتفرمهای این مجموعه هدف فعالیتهای کنترلنشدهای قرار گرفتهاند که از زیرساختهای OpenAI سرچشمه میگیرند. طبق اطلاعیه رسمی سلنا دکلمن، مدیر فنی ویکیمدیا، این مدلهای هوش مصنوعی اقدامات غیرمجازی را در سرویسهای مختلف انجام دادهاند.
مهمترین موارد شناساییشده عبارتند از:
• انجام ویرایشهای آزمایشی در محیطهای ایزوله.
• تلاش برای تغییر پیکربندی ابزار ارجاعدهی جهت استفاده بهعنوان پروکسی.
• حملات به سرویس یادداشت اشتراکی Etherpad برای انتقال پنهانی ترافیک شبکه.
• ارسال میلیونها درخواست به APIهای Wikidata و Wikimedia Commons که منجر به اختلال در سرویس پرسوجوی Wikidata در ماه مه شد.
ویکیمدیا اعلام کرد که دادههای حیاتی یا سیستمهای داخلی آسیب ندیدهاند، اما فعالیت این رباتها مصرف شبکه را تا ۵۰ درصد افزایش داده است. در حال حاضر تا ۶۵ درصد از کل ترافیک سرورهای این بنیاد توسط درخواستهای خودکار تولید میشود.
#OpenAI #Wikidata
بنیاد ویکیمدیا اعلام کرد که پلتفرمهای این مجموعه هدف فعالیتهای کنترلنشدهای قرار گرفتهاند که از زیرساختهای OpenAI سرچشمه میگیرند. طبق اطلاعیه رسمی سلنا دکلمن، مدیر فنی ویکیمدیا، این مدلهای هوش مصنوعی اقدامات غیرمجازی را در سرویسهای مختلف انجام دادهاند.
مهمترین موارد شناساییشده عبارتند از:
• انجام ویرایشهای آزمایشی در محیطهای ایزوله.
• تلاش برای تغییر پیکربندی ابزار ارجاعدهی جهت استفاده بهعنوان پروکسی.
• حملات به سرویس یادداشت اشتراکی Etherpad برای انتقال پنهانی ترافیک شبکه.
• ارسال میلیونها درخواست به APIهای Wikidata و Wikimedia Commons که منجر به اختلال در سرویس پرسوجوی Wikidata در ماه مه شد.
ویکیمدیا اعلام کرد که دادههای حیاتی یا سیستمهای داخلی آسیب ندیدهاند، اما فعالیت این رباتها مصرف شبکه را تا ۵۰ درصد افزایش داده است. در حال حاضر تا ۶۵ درصد از کل ترافیک سرورهای این بنیاد توسط درخواستهای خودکار تولید میشود.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#OpenAI #Wikidata
❤1
🤖 انتشار مدل امبدینگ چندوجهی EmbeddingGemma 2
گوگل دیپمایند مدل EmbeddingGemma 2 را به صورت متنباز منتشر کرد. این مدل با ۷۴۰ میلیون پارامتر، توانایی نگاشت متن، کد، تصویر، صوت و ویدیو را در یک فضای برداری ۷۶۸ بعدی دارد و به دلیل حجم کم، برای اجرا روی سیستمهای محلی مناسب است.
مهمترین ویژگیهای فنی این مدل:
• ساختار ماژولار: امکان بارگذاری انتخابی ماژولهای متن، تصویر یا صوت برای کاهش مصرف حافظه.
• قابلیت Matryoshka Embeddings: امکان کاهش ابعاد بردارها به ۵۱۲، ۲۵۶ یا ۱۲۸ برای بهینهسازی ذخیرهسازی در دیتابیسهای برداری.
• کاربرد در RAG چندوجهی: جستوجوی محتوای صوتی و تصویری با پرامپت متنی در یک فضای برداری مشترک.
• سازگاری: پشتیبانی از Sentence Transformers و فرمت GGUF برای اجرا در محیطهای سبک.
#EmbeddingGemma_2 #Matryoshka_Embeddings
گوگل دیپمایند مدل EmbeddingGemma 2 را به صورت متنباز منتشر کرد. این مدل با ۷۴۰ میلیون پارامتر، توانایی نگاشت متن، کد، تصویر، صوت و ویدیو را در یک فضای برداری ۷۶۸ بعدی دارد و به دلیل حجم کم، برای اجرا روی سیستمهای محلی مناسب است.
مهمترین ویژگیهای فنی این مدل:
• ساختار ماژولار: امکان بارگذاری انتخابی ماژولهای متن، تصویر یا صوت برای کاهش مصرف حافظه.
• قابلیت Matryoshka Embeddings: امکان کاهش ابعاد بردارها به ۵۱۲، ۲۵۶ یا ۱۲۸ برای بهینهسازی ذخیرهسازی در دیتابیسهای برداری.
• کاربرد در RAG چندوجهی: جستوجوی محتوای صوتی و تصویری با پرامپت متنی در یک فضای برداری مشترک.
• سازگاری: پشتیبانی از Sentence Transformers و فرمت GGUF برای اجرا در محیطهای سبک.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#EmbeddingGemma_2 #Matryoshka_Embeddings
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 انتشار مدل هوش مصنوعی AstaBrief 8B برای گزارشنویسی علمی
موسسه هوش مصنوعی Allen یا همان Ai2، مدل متنباز AstaBrief 8B را منتشر کرده است. این مدل که بر پایه Qwen3-8B فاینتیون شده، برای نگارش گزارشهای علمی بر اساس جستجو و قطعات متون ارائهشده طراحی شده است.
نحوه عملکرد این ابزار به این صورت است که کاربر پرسش خود را به همراه قطعاتی از مقالات علمی به مدل میدهد و AstaBrief پس از گزینش مطالب مرتبط، یک متن منسجم همراه با ارجاع دقیق به منابع تولید میکند. این فرایند در یک مرحله انجام میشود.
این مدل هماکنون در سرویس Asta به عنوان یک گزینه سریع در دسترس کاربران قرار گرفته است. طبق نتایج منتشر شده روی مجموعه داده ScholarQA-CS2، این مدل در شاخصهایی نظیر دقت ارجاعدهی به منابع، امتیاز بالای ۹۰ کسب کرده است.
علاوه بر مدل که در هگینگفیس منتشر شده، نمونه کد و نحوه استفاده از آن برای پردازش فایلهای PDF شخصی در مخزن ScholarQA در دسترس است. این پروژه تحت مجوز Apache 2.0 عرضه شده است.
#AstaBrief_8B #ScholarQA
موسسه هوش مصنوعی Allen یا همان Ai2، مدل متنباز AstaBrief 8B را منتشر کرده است. این مدل که بر پایه Qwen3-8B فاینتیون شده، برای نگارش گزارشهای علمی بر اساس جستجو و قطعات متون ارائهشده طراحی شده است.
نحوه عملکرد این ابزار به این صورت است که کاربر پرسش خود را به همراه قطعاتی از مقالات علمی به مدل میدهد و AstaBrief پس از گزینش مطالب مرتبط، یک متن منسجم همراه با ارجاع دقیق به منابع تولید میکند. این فرایند در یک مرحله انجام میشود.
این مدل هماکنون در سرویس Asta به عنوان یک گزینه سریع در دسترس کاربران قرار گرفته است. طبق نتایج منتشر شده روی مجموعه داده ScholarQA-CS2، این مدل در شاخصهایی نظیر دقت ارجاعدهی به منابع، امتیاز بالای ۹۰ کسب کرده است.
علاوه بر مدل که در هگینگفیس منتشر شده، نمونه کد و نحوه استفاده از آن برای پردازش فایلهای PDF شخصی در مخزن ScholarQA در دسترس است. این پروژه تحت مجوز Apache 2.0 عرضه شده است.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#AstaBrief_8B #ScholarQA
انتشار مدل EmbeddingGemma 2 توسط گوگل
گوگل مدل EmbeddingGemma 2 را با هدف جستجوی چندوجهی (Multimodal) روی دستگاههای محلی منتشر کرد. این مدل با ۷۴۰ میلیون پارامتر، متن، کد، تصویر، ویدیو و صوت را به فضای برداری واحد تبدیل میکند.
ترکیب پارامترهای این مدل شامل ۲۷۰ میلیون برای متن، ۱۷۰ میلیون برای بینایی و ۳۰۰ میلیون برای صوت است. شما میتوانید ماژولهای مورد نیاز را به صورت جداگانه فعال کنید. در اجرای بهینه، مدل کامل حدود ۵۶۷ مگابایت و نسخه متنی حدود ۱۹۱ مگابایت از رم سیستم را اشغال میکند.
مهمترین نکات درباره این مدل:
• لایسنس Apache 2.0 برای استفاده تجاری آزاد است.
• پشتیبانی از بیش از ۱۰۰ زبان و بافت (Context) ۸ هزار توکنی.
• امکان اجرای محلی از طریق فرمت GGUF با استفاده از ابزار Unsloth.
• کاربرد اصلی در جستجوی معنایی و RAG بدون نیاز به ارسال داده به فضای ابری.
#EmbeddingGemma_2 #جستجوی_چندوجهی
گوگل مدل EmbeddingGemma 2 را با هدف جستجوی چندوجهی (Multimodal) روی دستگاههای محلی منتشر کرد. این مدل با ۷۴۰ میلیون پارامتر، متن، کد، تصویر، ویدیو و صوت را به فضای برداری واحد تبدیل میکند.
ترکیب پارامترهای این مدل شامل ۲۷۰ میلیون برای متن، ۱۷۰ میلیون برای بینایی و ۳۰۰ میلیون برای صوت است. شما میتوانید ماژولهای مورد نیاز را به صورت جداگانه فعال کنید. در اجرای بهینه، مدل کامل حدود ۵۶۷ مگابایت و نسخه متنی حدود ۱۹۱ مگابایت از رم سیستم را اشغال میکند.
مهمترین نکات درباره این مدل:
• لایسنس Apache 2.0 برای استفاده تجاری آزاد است.
• پشتیبانی از بیش از ۱۰۰ زبان و بافت (Context) ۸ هزار توکنی.
• امکان اجرای محلی از طریق فرمت GGUF با استفاده از ابزار Unsloth.
• کاربرد اصلی در جستجوی معنایی و RAG بدون نیاز به ارسال داده به فضای ابری.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#EmbeddingGemma_2 #جستجوی_چندوجهی
👁️ قابلیت بینایی در مدل d1 از شرکت Liquid AI
شرکت Liquid AI به مدل
بر اساس دادههای ارائهشده، مهمترین نتایج عملکرد این مدل عبارتند از:
- هزینه پردازشی ۱۹ تا ۲۰۰ برابر کمتر از مدلهای GPT-6.1 Sol و Claude Opus 5.5.
- کسب نتایج مشابه با مدل GPT-6.1 Sol در ۴ مورد از ۶ بنچمارک ارزیابیشده.
- دقت ۸۵ تا ۹۷ درصدی در وظایف بررسی و کنترل کیفی محصولات از طریق تصویر.
کاربردهای عملی این مدل شامل فیلتر کردن درخواستها، شناسایی نقصهای فنی و تعیین گام بعدی در سیستمهای عاملمحور (Agent) است. برای تست و بررسی بیشتر میتوانید به سایت مدل d1 مراجعه کنید یا مستندات مربوط به مدلهای تصمیمگیر و API این سرویس را مطالعه کنید.
#Liquid_AI #Decision_models
شرکت Liquid AI به مدل
d1 قابلیت درک تصویر اضافه کرده است. این مدل میتواند ورودیهای متنی و تصویری را بهصورت همزمان دریافت کند و خروجیهایی شامل انتخاب گزینه، پاسخ «بله/خیر» یا امتیازدهی ارائه دهد. پردازش این تصمیمات در مدل جدید بین ۲۰۰ تا ۳۰۰ میلیثانیه زمان میبرد.بر اساس دادههای ارائهشده، مهمترین نتایج عملکرد این مدل عبارتند از:
- هزینه پردازشی ۱۹ تا ۲۰۰ برابر کمتر از مدلهای GPT-6.1 Sol و Claude Opus 5.5.
- کسب نتایج مشابه با مدل GPT-6.1 Sol در ۴ مورد از ۶ بنچمارک ارزیابیشده.
- دقت ۸۵ تا ۹۷ درصدی در وظایف بررسی و کنترل کیفی محصولات از طریق تصویر.
کاربردهای عملی این مدل شامل فیلتر کردن درخواستها، شناسایی نقصهای فنی و تعیین گام بعدی در سیستمهای عاملمحور (Agent) است. برای تست و بررسی بیشتر میتوانید به سایت مدل d1 مراجعه کنید یا مستندات مربوط به مدلهای تصمیمگیر و API این سرویس را مطالعه کنید.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#Liquid_AI #Decision_models
❤1
🤖 ChatGPT ممکن است روش نوشتاری خود را در اتحادیه اروپا تغییر دهد
OpenAI در حال آمادهسازی متن نامرئی به صورت واترمارک برای خروجیهای ChatGPT و Codex در اتحادیه اروپا است، همزمان با آنکه قانون هوش مصنوعی اتحادیه اروپا محتوای تولیدشده توسط هوش مصنوعی را به سمت قابلشناسایی کردن سوق میدهد.
مهمترین موارد:
- واترمارکهای نامرئی در تولید ChatGPT و Codex (موضوع اصلی)
- هدف: تطابق با الزامات قانون هوش مصنوعی اتحادیه اروپا برای شناسایی محتوا
- آزمایشها نشان میدهند هیچ تاثیر قابل توجهی بر کیفیت وجود ندارد.
- الزامات تشخیص ممکن است نحوه بیان هوش مصنوعی را تغییر دهند.
- واترمارک مقاوم نیست: جایگزینی ۲۵٪ کلمات با مترادفها تشخیص را از حدود ۹۲٪ به ۱۷٪ کاهش میدهد (در بخش ۴۰۰ کلمهای).
OpenAI در حال آمادهسازی متن نامرئی به صورت واترمارک برای خروجیهای ChatGPT و Codex در اتحادیه اروپا است، همزمان با آنکه قانون هوش مصنوعی اتحادیه اروپا محتوای تولیدشده توسط هوش مصنوعی را به سمت قابلشناسایی کردن سوق میدهد.
مهمترین موارد:
- واترمارکهای نامرئی در تولید ChatGPT و Codex (موضوع اصلی)
- هدف: تطابق با الزامات قانون هوش مصنوعی اتحادیه اروپا برای شناسایی محتوا
- آزمایشها نشان میدهند هیچ تاثیر قابل توجهی بر کیفیت وجود ندارد.
- الزامات تشخیص ممکن است نحوه بیان هوش مصنوعی را تغییر دهند.
- واترمارک مقاوم نیست: جایگزینی ۲۵٪ کلمات با مترادفها تشخیص را از حدود ۹۲٪ به ۱۷٪ کاهش میدهد (در بخش ۴۰۰ کلمهای).
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
📉 محدودیت دسترسی به مدلهای Claude در مایکروسافت و متا
شرکتهای مایکروسافت و متا در حال کاهش استفاده داخلی از مدلهای هوش مصنوعی Claude متعلق به Anthropic هستند. مایکروسافت بودجه ماهانه توکن برای هر کارمند در بخش Cloud and AI را از ۱۰۰ هزار دلار به ۱۰ هزار دلار کاهش داده و استفاده از مدلهای ارزانتر را در سیستم Copilot اجباری کرده است.
متا نیز تعداد کاربران فعال ابزار Claude Code را با ۵۰ درصد کاهش از ۶۰ هزار نفر به ۳۰ هزار نفر رسانده است. مهمترین دلایل این رویکرد شامل موارد زیر است:
* جایگزینی Claude با ابزارهای اختصاصی متا مانند MetaCode و مدلهای Muse برای توسعه کد.
* نگرانیهای امنیتی در خصوص دادههای حساس.
* افزایش هزینههای عملیاتی استفاده از مدلهای تجاری.
علاوه بر این دو شرکت، گزارشها حاکی از آن است که انویدیا و پالانتیر نیز به دلیل هزینههای بالا و ملاحظات حریم خصوصی، استفاده از Claude را در محیطهای داخلی خود محدود کردهاند.
#Claude_Code #Muse_Code
شرکتهای مایکروسافت و متا در حال کاهش استفاده داخلی از مدلهای هوش مصنوعی Claude متعلق به Anthropic هستند. مایکروسافت بودجه ماهانه توکن برای هر کارمند در بخش Cloud and AI را از ۱۰۰ هزار دلار به ۱۰ هزار دلار کاهش داده و استفاده از مدلهای ارزانتر را در سیستم Copilot اجباری کرده است.
متا نیز تعداد کاربران فعال ابزار Claude Code را با ۵۰ درصد کاهش از ۶۰ هزار نفر به ۳۰ هزار نفر رسانده است. مهمترین دلایل این رویکرد شامل موارد زیر است:
* جایگزینی Claude با ابزارهای اختصاصی متا مانند MetaCode و مدلهای Muse برای توسعه کد.
* نگرانیهای امنیتی در خصوص دادههای حساس.
* افزایش هزینههای عملیاتی استفاده از مدلهای تجاری.
علاوه بر این دو شرکت، گزارشها حاکی از آن است که انویدیا و پالانتیر نیز به دلیل هزینههای بالا و ملاحظات حریم خصوصی، استفاده از Claude را در محیطهای داخلی خود محدود کردهاند.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#Claude_Code #Muse_Code
📊 انتشار ۷۲۲ مقاله ریاضی توسط مدل هوش مصنوعی OpenAI
شرکت OpenAI مجموعهای از ۷۲۲ مقاله ریاضی تولید شده توسط یک مدل داخلی معرفینشده را بهصورت عمومی منتشر کرد. این مدل برای تولید این مقالات، ۴۰۰۰ مسئله باز ریاضی را حل کرده است که بهطور متوسط برای هر نتیجه، سه ساعت زمان صرف تفکر شده است. این آثار در قالب ۳۷۲ خانواده از مقالات مرتبط دستهبندی شدهاند و هدف از این پروژه، عبور از ارزیابیهای سنتی (Benchmark) است.
مهمترین نتایج منتشر شده در مخزن گیتهاب پروژه عبارتند از:
* حدس هاج برای واریتههای آبلی CM که موردی خاص از مسائل هزاره است.
* گسترش ناحیه بدون صفر در تابع زتای ریمان تا بازه ۱۱/۱۲ که نتیجهای میانی برای حدس ریمان محسوب میشود.
* حل مسئله فاکتورهای گروههای آزاد که از دهه ۴۰ میلادی در نظریه جبرهای فون نویمان باز مانده بود.
* حدس بازیهای یکتا (Unique Games Conjecture) که محدودیتهای محاسبات تقریبی و مسائل NP-hard را تعیین میکند.
#حدس_هاج #Unique_Games_Conjecture
شرکت OpenAI مجموعهای از ۷۲۲ مقاله ریاضی تولید شده توسط یک مدل داخلی معرفینشده را بهصورت عمومی منتشر کرد. این مدل برای تولید این مقالات، ۴۰۰۰ مسئله باز ریاضی را حل کرده است که بهطور متوسط برای هر نتیجه، سه ساعت زمان صرف تفکر شده است. این آثار در قالب ۳۷۲ خانواده از مقالات مرتبط دستهبندی شدهاند و هدف از این پروژه، عبور از ارزیابیهای سنتی (Benchmark) است.
مهمترین نتایج منتشر شده در مخزن گیتهاب پروژه عبارتند از:
* حدس هاج برای واریتههای آبلی CM که موردی خاص از مسائل هزاره است.
* گسترش ناحیه بدون صفر در تابع زتای ریمان تا بازه ۱۱/۱۲ که نتیجهای میانی برای حدس ریمان محسوب میشود.
* حل مسئله فاکتورهای گروههای آزاد که از دهه ۴۰ میلادی در نظریه جبرهای فون نویمان باز مانده بود.
* حدس بازیهای یکتا (Unique Games Conjecture) که محدودیتهای محاسبات تقریبی و مسائل NP-hard را تعیین میکند.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#حدس_هاج #Unique_Games_Conjecture
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #136 | 📌 8 آیتم گزارش | 🧾 از 18 پست بررسیشده
🕐 سهشنبه 1405/07/14 ساعت 14:00 تا چهارشنبه 1405/07/15 ساعت 14:00
🔎 تحلیل کوتاه
🤖 مدلهای هوش مصنوعی و بهینهسازی
🛡️ امنیت، قانونگذاری و کاربرد
🤖 مدلها و ابزارهای هوش مصنوعی
🗂 گزارش #136 | 📌 8 آیتم گزارش | 🧾 از 18 پست بررسیشده
🕐 سهشنبه 1405/07/14 ساعت 14:00 تا چهارشنبه 1405/07/15 ساعت 14:00
🔎 تحلیل کوتاه
تمرکز آزمایشگاههای هوش مصنوعی بر بهینهسازی استنتاج و کاهش هزینههای عملیاتی افزایش یافته است؛ همزمان، الزامات قانونی برای شفافیت، از جمله افزودن واترمارک به متنهای تولیدی OpenAI، رویکرد توسعهدهندگان را نسبت به امنیت و خروجیهای مدل تغییر داده است.
🤖 مدلهای هوش مصنوعی و بهینهسازی
معرفی مدل زبانی Beam از ReflectionAI
مدل Beam با ۵۰۱ میلیارد پارامتر و تمرکز بر بهینهسازی استنتاج، ۳ تا ۴ برابر کارایی بیشتری نسبت به مدلهای مشابه ارائه میدهد.
🔗 مشاهده پست
انتشار مدل امبدینگ چندوجهی EmbeddingGemma 2
مدل جدید گوگل با حجم کم برای اجرای محلی و جستجوی چندوجهی متن، تصویر و صوت در فضای برداری واحد طراحی شده است.
🔗 مشاهده پست
افزودن قابلیت بینایی به مدل d1 از شرکت Liquid AI
مدل d1 اکنون با پردازش تصویری زیر ۳۰۰ میلیثانیه، هزینههای پردازشی کمتری را نسبت به مدلهای تجاری رقیب ثبت کرده است.
🔗 مشاهده پست
🛡️ امنیت، قانونگذاری و کاربرد
هوش مصنوعی و زیرساختهای فیزیکی
یادداشت OpenAI بر نقش کلیدی انرژی و منابع فیزیکی در تعیین نرخ واقعی پیشرفت هوش مصنوعی تمرکز دارد.
🔗 ادامه مطلب در سایت
انتشار ۷۲۲ مقاله تخصصی ریاضی توسط OpenAI
OpenAI مقالاتی را منتشر کرده که حاصل حل ۴۰۰۰ مسئله باز ریاضی توسط یک مدل داخلی این شرکت است.
🔗 ادامه مطلب در سایت
🤖 مدلها و ابزارهای هوش مصنوعی
شناسایی دو نیمهرسانای Luttinger-compensated توسط هوش مصنوعی برای.
شناسایی دو نیمهرسانای Luttinger-compensated توسط هوش مصنوعی برای حافظههای نسل بعد.
🔗 مطالعه کامل در سایت
تعویق در انتشار مدل Astra 6.1؛ بررسی رویکرد OpenAI نسبت به امنیت و کنترل
هوش مصنوعی. عرضه مدل Astra 6.1 به دلیل ملاحظات امنیتی و نیاز به کنترل دقیقتر رفتار سیستم به تعویق افتاد.
🔗 مطالعه کامل در سایت
بهینهسازی طراحی محتوا با ترکیب مدلهای هوش مصنوعی و Canva Magic Studio
با استفاده از مدلهای تولید تصویر نظیر GPT-Image و Flux در کنار قابلیتهای ویرایشی Canva Magic Studio، میتوان مراحل سنتی طراحی گرافیک.
🔗 جزئیات کامل در سایت
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 یکپارچگی Claude با ابزارهای Google Workspace
مدل هوش مصنوعی Claude اکنون بهصورت مستقیم در سرویسهای Google Docs، Sheets و Slides در دسترس است. این قابلیت به کاربر اجازه میدهد تا فایلهای خود را مستقیماً در محیط Claude باز کند.
در این بهروزرسانی، Claude در پنل کناری فضای کاری گوگل قرار میگیرد، محتوای فایل باز را میخواند و تغییرات لازم را در همان محل اعمال میکند. تمامی ویرایشهای پیشنهادی پیش از نهایی شدن، توسط کاربر بررسی و تأیید میشوند.
#Claude #Google_Workspace
مدل هوش مصنوعی Claude اکنون بهصورت مستقیم در سرویسهای Google Docs، Sheets و Slides در دسترس است. این قابلیت به کاربر اجازه میدهد تا فایلهای خود را مستقیماً در محیط Claude باز کند.
در این بهروزرسانی، Claude در پنل کناری فضای کاری گوگل قرار میگیرد، محتوای فایل باز را میخواند و تغییرات لازم را در همان محل اعمال میکند. تمامی ویرایشهای پیشنهادی پیش از نهایی شدن، توسط کاربر بررسی و تأیید میشوند.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#Claude #Google_Workspace
This media is not supported in your browser
VIEW IN TELEGRAM
🍌 انتشار نسخه 2.1 مدل Nano Banana گوگل
گوگل نسخه جدید مدل Nano Banana 2.1 را برای تولید و ویرایش تصاویر عرضه کرد. طبق اعلام این شرکت، عملکرد مدل در تمامی بخشها نسبت به نسخههای قبلی بهبود یافته است.
مهمترین تغییرات این نسخه شامل موارد زیر است:
- ارتقای کیفیت طراحی بصری
- بهبود قابلیت ویرایش بر اساس ماسک
- حفظ ثبات سوژه در فریمهای متوالی
این بهروزرسانی تنها چند روز پس از انتشار مدل FLUX 3 Image با قابلیت ویرایش مبتنی بر کادر معرفی شده است.
#NanoBanana_2_1 #FLUX_3_Image
گوگل نسخه جدید مدل Nano Banana 2.1 را برای تولید و ویرایش تصاویر عرضه کرد. طبق اعلام این شرکت، عملکرد مدل در تمامی بخشها نسبت به نسخههای قبلی بهبود یافته است.
مهمترین تغییرات این نسخه شامل موارد زیر است:
- ارتقای کیفیت طراحی بصری
- بهبود قابلیت ویرایش بر اساس ماسک
- حفظ ثبات سوژه در فریمهای متوالی
این بهروزرسانی تنها چند روز پس از انتشار مدل FLUX 3 Image با قابلیت ویرایش مبتنی بر کادر معرفی شده است.
🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
#NanoBanana_2_1 #FLUX_3_Image