ابزارها و کاربردهای هوش مصنوعی
5K subscribers
1.09K photos
787 videos
1.02K files
1.62K links
آخرین اخبار و ابزارهای هوش مصنوعی و یادگیری ماشین

@GPT360
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
🍓🚆 Raspberry Pi
؛ نگهبان هوشمند ریل‌های راه‌آهن!

یک نمونه اولیه مبتنی بر Raspberry Pi می‌تونه به‌صورت مداوم وضعیت خطوط راه‌آهن رو بررسی کنه.

🔹 دوربین برای اسکن مسیر و شناسایی ترک‌ها و نقص‌ها با کمک AI
🔹 استفاده از GPS برای ثبت دقیق موقعیت مشکل
🔹 حسگرهای لرزش برای تشخیص ناهنجاری‌ها
🔹 ثبت خودکار اطلاعات و گزارش‌ها

🎯 ایده اصلی اینه که به‌جای بازرسی‌های دوره‌ای، پایش مداوم انجام بشه تا مشکلات زمانی شناسایی بشن که هنوز کوچک و قابل‌مدیریت هستن.

🤖 یعنی یک کامپیوتر کوچک + دوربین + هوش مصنوعی می‌تونه به بخشی از سیستم آینده برای ایمنی و نگهداری هوشمند خطوط ریلی تبدیل بشه.
❤1
Media is too big
VIEW IN TELEGRAM
📹🔥 شرکت HeyGen وارد رقابت مدل‌های ویدیویی شد!

شرکت HeyGen از اولین مدل ویدیوساز اختصاصی خودش رونمایی کرده؛ مدلی که می‌تونه از متن ویدیو بسازه، یک تصویر رو متحرک کنه یا از یک ویدیوی دیگر برای حرکت و سبک بصری الهام بگیره.

🔊 نکته جالب اینکه صدا هم همزمان با ویدیو تولید می‌شه؛ از گفتار و صدای پس‌زمینه گرفته تا افکت‌های صوتی.

🔹 ساخته‌شده بر پایه MiniMax H3 با آموزش‌های تکمیلی HeyGen
🔹 تولید کلیپ‌های ۵ تا ۱۵ ثانیه‌ای
🔹 خروجی 480p و 768p
🔹 پشتیبانی از نسبت تصویر 21:9 تا 9:16
🔹 دسترسی از طریق API، OpenRouter، Runware و ComfyUI

🏆 HeyGen می‌گه در یک مقایسه Blind با ۴ مدل دیگر و بر اساس ۴۸۰۰ رأی، مدلش رتبه اول رو گرفته؛ البته این نتیجه یک ارزیابی داخلی/کاربرمحور است و لزوماً معادل بنچمارک مستقل نیست.

💰 هزینه تولید 768p حدود ۰.۰۳ دلار به‌ازای هر ثانیه است و تا پایان اکتبر تخفیف ۵۰ درصدی دارد.

🌐 نسخه وب این مدل هم قرار است در ادامه منتشر شود.
This media is not supported in your browser
VIEW IN TELEGRAM
🍟🤖 هوش مصنوعی برای Big Mac هم قیمت تعیین می‌کنه!

در شهر Fresno کالیفرنیا، قیمت یک Big Mac در دو شعبه مک‌دونالد که فقط حدود ۲ مایل با هم فاصله دارند، ۵.۶۹ و ۶.۸۹ دلار بوده؛ یعنی حدود ۲۱٪ اختلاف قیمت! 😳

🔹 طبق گزارش Reuters، مک‌دونالد از یک سیستم قیمت‌گذاری مبتنی بر AI استفاده می‌کند که برای هر رستوران، یک «قیمت بهینه» پیشنهاد می‌دهد.

این سیستم با توجه به عواملی مثل میزان حساسیت مشتریان محلی به قیمت، به صاحبان شعب پیشنهادهایی ارائه می‌کند و انحراف از قیمت پیشنهادی را نیز زیر نظر می‌گیرد.

📊 صاحبان شعب همچنان قیمت نهایی را تعیین می‌کنند، اما برخی از آن‌ها به Reuters گفته‌اند که اختلاف قابل‌توجه با پیشنهادهای سیستم می‌تواند باعث تماس دفتر مرکزی شود.

🍔 نکته جالب اینجاست: حتی قیمت یک همبرگر ساده هم می‌تواند به تصمیمی تبدیل شود که پشت آن داده، الگوریتم و هوش مصنوعی قرار دارد.
🚨🤖 شرکت Google از Gemini 4 Argon رونمایی کرد!

گوگل در ۱ اکتبر ۲۰۲۶ مدل جدید Gemini 4 Argon رو معرفی کرده؛ یک مدل Frontier که برای انجام کارهای پیچیده و چندمرحله‌ای در حوزه‌هایی مثل برنامه‌نویسی، تحلیل داده و امنیت سایبری طراحی شده.

🔥 یکی از ویژگی‌های مهم Argon، سقف خروجی ۱ میلیون توکنه؛ یعنی مدل می‌تونه روی پردازش‌های طولانی و چندمرحله‌ای، بدون نیاز به قطع و شروع مجدد، کار کنه.

💰 قیمت اولیه اعلام‌شده:
🔹 ورودی: ۲ دلار به‌ازای هر ۱ میلیون توکن
🔹 خروجی: ۱۰ دلار به‌ازای هر ۱ میلیون توکن
🔹 ورودی‌های کش‌شده: ۹۵٪ ارزان‌تر

🔐 گوگل عرضه مدل رو مرحله‌ای شروع کرده و ابتدا دسترسی رو در اختیار تست‌کنندگان امنیتی قرار می‌ده؛ سپس API برای توسعه‌دهندگان و مشتریان سازمانی گسترده‌تر خواهد شد.

⚡ به‌نظر می‌رسه گوگل با Argon قصد داره دوباره رقابت در رده مدل‌های پیشرفته هوش مصنوعی رو جدی‌تر دنبال کنه.

#AI #Google #MachineLearning
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
😒🤖هوش مصنوعی Claude به Google Docs و Sheets آمد؛ رقابت با Gemini جدی‌تر شد!

▫️ آنتروپیک حالا Claude رو به Google Docs، Sheets و Slides آورده. کاربران می‌تونن بدون خارج شدن از فایل کاری، از پنل کناری برای کارهایی مثل نوشتن متن، ساخت جدول، فرمول‌نویسی و طراحی اسلاید کمک بگیرن.

🔄 یکی از قابلیت‌های جالب، ویرایش دوطرفه است؛ یعنی می‌شه بین Claude و فایل‌های گوگل اطلاعات رو جابه‌جا و روی محتوا ویرایش انجام داد.

📊 در Google Sheets، Claude می‌تونه داده‌ها رو با کمک کدنویسی پایتون تحلیل کنه و برای کارهای پیچیده‌تر روی جدول‌ها کمک بده.

🌐 این قابلیت علاوه بر محیط سرویس‌های گوگل، از طریق وب‌سایت Claude هم در دسترسه و فعلاً به‌صورت بتا برای کاربران دارای اشتراک ارائه شده.

🔥 به‌نظر می‌رسه Anthropic با این حرکت می‌خواد Claude رو مستقیماً وارد محیط کاری کاربران Gemini کنه؛ جایی که رقابت دستیارهای هوش مصنوعی می‌تونه خیلی جدی‌تر بشه.
🟢شرکت OpenAI صدها نتیجه ریاضی تولیدشده با هوش مصنوعی را منتشر کرد! 🧮🤖

🔹 شرکت OpenAI مجموعه‌ای شامل صدها نتیجه و دستاورد ریاضی تولیدشده توسط یکی از مدل‌های پیشرفته و منتشرنشده خود را در GitHub در دسترس عموم قرار داده است.

📚 این مجموعه شامل ۷۲۲ نوشته در ۳۷۲ بخش است و حوزه‌های مختلفی را پوشش می‌دهد؛ از نظریه اعداد و جبر گرفته تا نظریه پیچیدگی، منطق ریاضی، هندسه، توپولوژی و فیزیک ریاضی.

🔥 انتشار این حجم از نتایج می‌تواند تصویر جالبی از توانایی مدل‌های پیشرفته در انجام پژوهش‌های ریاضی ارائه دهد و مسیر تازه‌ای برای همکاری بین هوش مصنوعی و ریاضیات باز کند.
This media is not supported in your browser
VIEW IN TELEGRAM
🍌 گوگل از Nano Banana 2.1 رونمایی کرد؛ نسل جدید تولید و ویرایش تصویر! 🎨🤖

🔹 گوگل مدل جدید Nano Banana 2.1 را معرفی کرده؛ مدلی که فقط برای ساخت تصویر نیست و روی تولید و ویرایش دقیق‌تر تصاویر تمرکز دارد.

✨ یکی از قابلیت‌های مهم این مدل، Mask-based Editing است که به کاربر اجازه می‌دهد بخش مشخصی از تصویر را انتخاب و ویرایش کند، بدون اینکه سایر قسمت‌ها دستخوش تغییر شوند.

🧠 معماری جدید Nano Banana 2.1 هم با هدف بهبود کیفیت بصری و طبیعی‌تر شدن خروجی‌ها طراحی شده و می‌تواند جزئیات مهم تصویر را بهتر حفظ کند.

🚀 گوگل انتشار این فناوری را در محصولات مختلف خود آغاز کرده؛ اتفاقی که می‌تواند رقابت در حوزه مدل‌های تولید و ویرایش تصویر را داغ‌تر کند.
🇪🇺🤖 ChatGPT
شاید در اروپا نحوه نوشتنش را تغییر دهد!

🔹 طبق گزارش‌ها، OpenAI در حال آزمایش واترمارک متنی نامرئی برای خروجی‌های ChatGPT و Codex در اتحادیه اروپاست؛ الگویی که مستقیماً داخل نحوه جمله‌بندی متن قرار می‌گیرد و قابل مشاهده نیست.

📜 دلیل این اقدام، الزامات EU AI Act برای قابل‌شناسایی‌تر شدن محتوای تولیدشده توسط هوش مصنوعی عنوان شده است.

🧪 OpenAI
می‌گوید آزمایش‌هایش نشان داده این روش تأثیر محسوسی روی کیفیت متن ندارد؛ اما یک سؤال مهم مطرح می‌شود: آیا الزام به تشخیص محتوای AI می‌تواند در نهایت روی نحوه نوشتن خود مدل‌ها تأثیر بگذارد؟

⚠️ از طرف دیگر، این واترمارک ظاهراً چندان مقاوم نیست. در یک آزمایش روی متن‌های ۴۰۰ توکنی، تغییر حدود ۲۵٪ کلمات با مترادف‌ها باعث شد نرخ تشخیص از حدود ۹۲٪ به ۱۷٪ کاهش پیدا کند.

🤔 مشکل دیگر این است که چنین سیستمی لزوماً مشخص نمی‌کند چه مقدار از متن واقعاً توسط انسان نوشته شده است. یعنی اگر خودتان متنی بنویسید و فقط برای ویرایش به ChatGPT بدهید، نسخه نهایی ممکن است همچنان دارای این نشان نامرئی باشد.
This media is not supported in your browser
VIEW IN TELEGRAM
⚠️🤖 AI
می‌تونه کاری کنه که ویدیوی جعلی، علیه خودت استفاده بشه!

🔹 Sundar Pichai
درباره یکی از نگرانی‌های جدی عصر هوش مصنوعی هشدار داده: ساخت ویدیویی بسیار باورپذیر از یک فرد، در حالی که او هرگز آن حرف‌ها را نزده یا چنین کاری انجام نداده است.

🎭 چهره، صدا و حتی حرکات فرد می‌توانند در یک ویدیوی ساختگی بازسازی شوند؛ محتوایی که ممکن است بعداً برای فریب اطرافیان، آسیب به اعتبار فرد یا حتی اخاذی مورد استفاده قرار بگیرد.

📱 نمونه‌های استفاده از تصاویر و ویدیوهای جعلی افراد مشهور برای کلاهبرداری را قبلاً دیده‌ایم؛ اما با پیشرفت این فناوری، مسئله فقط افراد مشهور نیست و هویت افراد عادی هم می‌تواند هدف سوءاستفاده قرار بگیرد.

🧠 چالش اصلی اینجاست: وقتی یک ویدیوی ساختگی آن‌قدر واقعی به‌نظر برسد که تشخیص جعلی بودنش سخت شود، چطور می‌توان ثابت کرد اتفاقی که در تصویر می‌بینیم، هرگز رخ نداده است؟

🔐 به همین دلیل، تشخیص محتوای جعلی و روش‌های مطمئن برای تأیید اصالت ویدیوها احتمالاً به یکی از موضوعات مهم امنیت دیجیتال تبدیل خواهد شد.
Media is too big
VIEW IN TELEGRAM
📊🤖هوش مصنوعی ChatGPT حالا می‌تونه پاسخ‌هاش رو تعاملی‌تر کنه!

🔹 قابلیت جدیدی با عنوان «رابط کاربری هوشمند» به ChatGPT اضافه می‌شه تا پاسخ‌ها فقط به متن محدود نباشن و در کنار آن، نمودار، تصاویر تعاملی و دکمه‌های قابل لمس هم نمایش داده بشن.

🧩 حتی ممکنه بعضی ابزارهای کاربردی مستقیماً داخل همان گفت‌وگو اجرا بشن؛ از ماشین‌حساب پس‌انداز و تقسیم هزینه‌ها گرفته تا ابزارهای تعاملی و حتی بازی‌های نوستالژیک!

✨ یعنی به‌جای اینکه فقط توضیح بده «چطور کاری رو انجام بدی»، خود ChatGPT می‌تونه ابزار انجام اون کار رو داخل چت در اختیارت بذاره.

🚀 این قابلیت به‌مرور برای کاربران بیشتری فعال خواهد شد.

به‌نظرتون ChatGPT با این قابلیت بیشتر شبیه یک دستیار هوشمند می‌شه یا یک سیستم‌عامل داخل چت؟ 👀
⚡️🤖 Claude Haiku 5.5
معرفی شد؛ سریع‌ترین و ارزان‌ترین مدل Anthropic!

🔹 آنتروپیک از Claude Haiku 5.5 رونمایی کرده؛ مدلی که برای کارهای پرتکرار و سنگین مثل خلاصه‌سازی حجم زیادی از داده‌ها و پردازش‌های نرم‌افزاری طراحی شده است.

💰 طبق اعلام Anthropic، Haiku 5.5 به‌طور میانگین حدود ۷۵٪ ارزان‌تر از نسل قبلی است؛ موضوعی که می‌تواند استفاده از مدل‌های قدرتمند را برای پردازش‌های گسترده مقرون‌به‌صرفه‌تر کند.

🧠 یکی از قابلیت‌های مهم این مدل، امکان تنظیم سطح پردازش (Effort) است؛ یعنی کاربر می‌تواند میزان پردازشی را که مدل برای هر درخواست انجام می‌دهد، کنترل کند.

☁️ این مدل حالا برای توسعه‌دهندگان روی سرویس‌هایی مثل Google Cloud و پلتفرم اختصاصی Claude در دسترس قرار گرفته است.

🔥 به‌نظر می‌رسد Anthropic با Haiku 5.5 بیشتر از همیشه روی سرعت + هزینه پایین + عملکرد بالا تمرکز کرده است.