ابزارها و کاربردهای هوش مصنوعی
5.02K subscribers
1.09K photos
785 videos
1.02K files
1.62K links
آخرین اخبار و ابزارهای هوش مصنوعی و یادگیری ماشین

@GPT360
Download Telegram
🔴 اعتراف OpenAI؛ مدل‌های هوش مصنوعی در بیش از ۱۰۰ سازمان رفتارهای ناخواسته داشته‌اند!

▫️ OpenAI
اعلام کرده مدل‌هایش در بیش از ۱۰۰ سازمان در مواردی رفتارهایی خارج از چارچوب مورد انتظار نشان داده‌اند؛ از ایجاد اختلال در دسترسی به وب‌سایت‌ها گرفته تا عبور از برخی موانع امنیتی.

⚠️ البته OpenAI تأکید کرده که این موارد لزوماً به معنی سرقت اطلاعات یا حمله سایبری نیستند و طیف متفاوتی از رفتارهای ناخواسته را شامل می‌شوند.

🔹 این شرکت حالا قصد دارد حدود ۵۰ پتابایت داده مربوط به عملکرد مدل‌هایش را بررسی کند تا استانداردهای امنیتی جدیدی برای ایجنت‌های هوش مصنوعی تدوین کند.

🌐 یکی از چالش‌های اصلی، دسترسی مدل‌ها به اینترنت برای انجام وظایف کاربران است؛ قابلیتی که می‌تواند در شرایط خاص به نتایجی فراتر از انتظار منجر شود.

🛡️ OpenAI
می‌گوید در حال توسعه روش‌هایی برای شناسایی، بررسی و اطلاع‌رسانی بهتر درباره این رخدادها است.

به‌نظر شما با قدرتمندتر شدن AI Agentها، کنترل رفتار آن‌ها در دنیای واقعی چقدر سخت‌تر می‌شود؟ 🤔
🟢 لباس‌ها رو قبل از خرید، مجازی پرو کنید! 👕🤖

▫️ شرکت OpenAI قابلیت جدید Virtual Try-On رو به ChatGPT اضافه کرده؛ حالا می‌تونید با آپلود عکس سلفی و عکس تمام‌قد، لباس‌های مختلف رو به‌صورت مجازی روی خودتون امتحان کنید.

✨ نکته جالب اینه که حتی می‌تونید اسکرین‌شات لباس‌هایی خارج از ChatGPT رو هم به مدل بدید تا ظاهرشون رو روی خودتون ببینید.

🔹 این قابلیت با ChatGPT Images 2.5 کار می‌کنه و امکان ذخیره لباس‌ها و محصولات موردعلاقه در Library هم فراهم شده.

🛍️ یعنی قبل از خرید، یک پرو مجازی سریع می‌گیرید و می‌بینید یک لباس چطور روی شما به نظر می‌رسه!
This media is not supported in your browser
VIEW IN TELEGRAM
🍓🚆 Raspberry Pi
؛ نگهبان هوشمند ریل‌های راه‌آهن!

یک نمونه اولیه مبتنی بر Raspberry Pi می‌تونه به‌صورت مداوم وضعیت خطوط راه‌آهن رو بررسی کنه.

🔹 دوربین برای اسکن مسیر و شناسایی ترک‌ها و نقص‌ها با کمک AI
🔹 استفاده از GPS برای ثبت دقیق موقعیت مشکل
🔹 حسگرهای لرزش برای تشخیص ناهنجاری‌ها
🔹 ثبت خودکار اطلاعات و گزارش‌ها

🎯 ایده اصلی اینه که به‌جای بازرسی‌های دوره‌ای، پایش مداوم انجام بشه تا مشکلات زمانی شناسایی بشن که هنوز کوچک و قابل‌مدیریت هستن.

🤖 یعنی یک کامپیوتر کوچک + دوربین + هوش مصنوعی می‌تونه به بخشی از سیستم آینده برای ایمنی و نگهداری هوشمند خطوط ریلی تبدیل بشه.
Media is too big
VIEW IN TELEGRAM
📹🔥 شرکت HeyGen وارد رقابت مدل‌های ویدیویی شد!

شرکت HeyGen از اولین مدل ویدیوساز اختصاصی خودش رونمایی کرده؛ مدلی که می‌تونه از متن ویدیو بسازه، یک تصویر رو متحرک کنه یا از یک ویدیوی دیگر برای حرکت و سبک بصری الهام بگیره.

🔊 نکته جالب اینکه صدا هم همزمان با ویدیو تولید می‌شه؛ از گفتار و صدای پس‌زمینه گرفته تا افکت‌های صوتی.

🔹 ساخته‌شده بر پایه MiniMax H3 با آموزش‌های تکمیلی HeyGen
🔹 تولید کلیپ‌های ۵ تا ۱۵ ثانیه‌ای
🔹 خروجی 480p و 768p
🔹 پشتیبانی از نسبت تصویر 21:9 تا 9:16
🔹 دسترسی از طریق API، OpenRouter، Runware و ComfyUI

🏆 HeyGen می‌گه در یک مقایسه Blind با ۴ مدل دیگر و بر اساس ۴۸۰۰ رأی، مدلش رتبه اول رو گرفته؛ البته این نتیجه یک ارزیابی داخلی/کاربرمحور است و لزوماً معادل بنچمارک مستقل نیست.

💰 هزینه تولید 768p حدود ۰.۰۳ دلار به‌ازای هر ثانیه است و تا پایان اکتبر تخفیف ۵۰ درصدی دارد.

🌐 نسخه وب این مدل هم قرار است در ادامه منتشر شود.
This media is not supported in your browser
VIEW IN TELEGRAM
🍟🤖 هوش مصنوعی برای Big Mac هم قیمت تعیین می‌کنه!

در شهر Fresno کالیفرنیا، قیمت یک Big Mac در دو شعبه مک‌دونالد که فقط حدود ۲ مایل با هم فاصله دارند، ۵.۶۹ و ۶.۸۹ دلار بوده؛ یعنی حدود ۲۱٪ اختلاف قیمت! 😳

🔹 طبق گزارش Reuters، مک‌دونالد از یک سیستم قیمت‌گذاری مبتنی بر AI استفاده می‌کند که برای هر رستوران، یک «قیمت بهینه» پیشنهاد می‌دهد.

این سیستم با توجه به عواملی مثل میزان حساسیت مشتریان محلی به قیمت، به صاحبان شعب پیشنهادهایی ارائه می‌کند و انحراف از قیمت پیشنهادی را نیز زیر نظر می‌گیرد.

📊 صاحبان شعب همچنان قیمت نهایی را تعیین می‌کنند، اما برخی از آن‌ها به Reuters گفته‌اند که اختلاف قابل‌توجه با پیشنهادهای سیستم می‌تواند باعث تماس دفتر مرکزی شود.

🍔 نکته جالب اینجاست: حتی قیمت یک همبرگر ساده هم می‌تواند به تصمیمی تبدیل شود که پشت آن داده، الگوریتم و هوش مصنوعی قرار دارد.
🚨🤖 شرکت Google از Gemini 4 Argon رونمایی کرد!

گوگل در ۱ اکتبر ۲۰۲۶ مدل جدید Gemini 4 Argon رو معرفی کرده؛ یک مدل Frontier که برای انجام کارهای پیچیده و چندمرحله‌ای در حوزه‌هایی مثل برنامه‌نویسی، تحلیل داده و امنیت سایبری طراحی شده.

🔥 یکی از ویژگی‌های مهم Argon، سقف خروجی ۱ میلیون توکنه؛ یعنی مدل می‌تونه روی پردازش‌های طولانی و چندمرحله‌ای، بدون نیاز به قطع و شروع مجدد، کار کنه.

💰 قیمت اولیه اعلام‌شده:
🔹 ورودی: ۲ دلار به‌ازای هر ۱ میلیون توکن
🔹 خروجی: ۱۰ دلار به‌ازای هر ۱ میلیون توکن
🔹 ورودی‌های کش‌شده: ۹۵٪ ارزان‌تر

🔐 گوگل عرضه مدل رو مرحله‌ای شروع کرده و ابتدا دسترسی رو در اختیار تست‌کنندگان امنیتی قرار می‌ده؛ سپس API برای توسعه‌دهندگان و مشتریان سازمانی گسترده‌تر خواهد شد.

⚡ به‌نظر می‌رسه گوگل با Argon قصد داره دوباره رقابت در رده مدل‌های پیشرفته هوش مصنوعی رو جدی‌تر دنبال کنه.

#AI #Google #MachineLearning
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
😒🤖هوش مصنوعی Claude به Google Docs و Sheets آمد؛ رقابت با Gemini جدی‌تر شد!

▫️ آنتروپیک حالا Claude رو به Google Docs، Sheets و Slides آورده. کاربران می‌تونن بدون خارج شدن از فایل کاری، از پنل کناری برای کارهایی مثل نوشتن متن، ساخت جدول، فرمول‌نویسی و طراحی اسلاید کمک بگیرن.

🔄 یکی از قابلیت‌های جالب، ویرایش دوطرفه است؛ یعنی می‌شه بین Claude و فایل‌های گوگل اطلاعات رو جابه‌جا و روی محتوا ویرایش انجام داد.

📊 در Google Sheets، Claude می‌تونه داده‌ها رو با کمک کدنویسی پایتون تحلیل کنه و برای کارهای پیچیده‌تر روی جدول‌ها کمک بده.

🌐 این قابلیت علاوه بر محیط سرویس‌های گوگل، از طریق وب‌سایت Claude هم در دسترسه و فعلاً به‌صورت بتا برای کاربران دارای اشتراک ارائه شده.

🔥 به‌نظر می‌رسه Anthropic با این حرکت می‌خواد Claude رو مستقیماً وارد محیط کاری کاربران Gemini کنه؛ جایی که رقابت دستیارهای هوش مصنوعی می‌تونه خیلی جدی‌تر بشه.
🟢شرکت OpenAI صدها نتیجه ریاضی تولیدشده با هوش مصنوعی را منتشر کرد! 🧮🤖

🔹 شرکت OpenAI مجموعه‌ای شامل صدها نتیجه و دستاورد ریاضی تولیدشده توسط یکی از مدل‌های پیشرفته و منتشرنشده خود را در GitHub در دسترس عموم قرار داده است.

📚 این مجموعه شامل ۷۲۲ نوشته در ۳۷۲ بخش است و حوزه‌های مختلفی را پوشش می‌دهد؛ از نظریه اعداد و جبر گرفته تا نظریه پیچیدگی، منطق ریاضی، هندسه، توپولوژی و فیزیک ریاضی.

🔥 انتشار این حجم از نتایج می‌تواند تصویر جالبی از توانایی مدل‌های پیشرفته در انجام پژوهش‌های ریاضی ارائه دهد و مسیر تازه‌ای برای همکاری بین هوش مصنوعی و ریاضیات باز کند.
This media is not supported in your browser
VIEW IN TELEGRAM
🍌 گوگل از Nano Banana 2.1 رونمایی کرد؛ نسل جدید تولید و ویرایش تصویر! 🎨🤖

🔹 گوگل مدل جدید Nano Banana 2.1 را معرفی کرده؛ مدلی که فقط برای ساخت تصویر نیست و روی تولید و ویرایش دقیق‌تر تصاویر تمرکز دارد.

✨ یکی از قابلیت‌های مهم این مدل، Mask-based Editing است که به کاربر اجازه می‌دهد بخش مشخصی از تصویر را انتخاب و ویرایش کند، بدون اینکه سایر قسمت‌ها دستخوش تغییر شوند.

🧠 معماری جدید Nano Banana 2.1 هم با هدف بهبود کیفیت بصری و طبیعی‌تر شدن خروجی‌ها طراحی شده و می‌تواند جزئیات مهم تصویر را بهتر حفظ کند.

🚀 گوگل انتشار این فناوری را در محصولات مختلف خود آغاز کرده؛ اتفاقی که می‌تواند رقابت در حوزه مدل‌های تولید و ویرایش تصویر را داغ‌تر کند.
🇪🇺🤖 ChatGPT
شاید در اروپا نحوه نوشتنش را تغییر دهد!

🔹 طبق گزارش‌ها، OpenAI در حال آزمایش واترمارک متنی نامرئی برای خروجی‌های ChatGPT و Codex در اتحادیه اروپاست؛ الگویی که مستقیماً داخل نحوه جمله‌بندی متن قرار می‌گیرد و قابل مشاهده نیست.

📜 دلیل این اقدام، الزامات EU AI Act برای قابل‌شناسایی‌تر شدن محتوای تولیدشده توسط هوش مصنوعی عنوان شده است.

🧪 OpenAI
می‌گوید آزمایش‌هایش نشان داده این روش تأثیر محسوسی روی کیفیت متن ندارد؛ اما یک سؤال مهم مطرح می‌شود: آیا الزام به تشخیص محتوای AI می‌تواند در نهایت روی نحوه نوشتن خود مدل‌ها تأثیر بگذارد؟

⚠️ از طرف دیگر، این واترمارک ظاهراً چندان مقاوم نیست. در یک آزمایش روی متن‌های ۴۰۰ توکنی، تغییر حدود ۲۵٪ کلمات با مترادف‌ها باعث شد نرخ تشخیص از حدود ۹۲٪ به ۱۷٪ کاهش پیدا کند.

🤔 مشکل دیگر این است که چنین سیستمی لزوماً مشخص نمی‌کند چه مقدار از متن واقعاً توسط انسان نوشته شده است. یعنی اگر خودتان متنی بنویسید و فقط برای ویرایش به ChatGPT بدهید، نسخه نهایی ممکن است همچنان دارای این نشان نامرئی باشد.
This media is not supported in your browser
VIEW IN TELEGRAM
⚠️🤖 AI
می‌تونه کاری کنه که ویدیوی جعلی، علیه خودت استفاده بشه!

🔹 Sundar Pichai
درباره یکی از نگرانی‌های جدی عصر هوش مصنوعی هشدار داده: ساخت ویدیویی بسیار باورپذیر از یک فرد، در حالی که او هرگز آن حرف‌ها را نزده یا چنین کاری انجام نداده است.

🎭 چهره، صدا و حتی حرکات فرد می‌توانند در یک ویدیوی ساختگی بازسازی شوند؛ محتوایی که ممکن است بعداً برای فریب اطرافیان، آسیب به اعتبار فرد یا حتی اخاذی مورد استفاده قرار بگیرد.

📱 نمونه‌های استفاده از تصاویر و ویدیوهای جعلی افراد مشهور برای کلاهبرداری را قبلاً دیده‌ایم؛ اما با پیشرفت این فناوری، مسئله فقط افراد مشهور نیست و هویت افراد عادی هم می‌تواند هدف سوءاستفاده قرار بگیرد.

🧠 چالش اصلی اینجاست: وقتی یک ویدیوی ساختگی آن‌قدر واقعی به‌نظر برسد که تشخیص جعلی بودنش سخت شود، چطور می‌توان ثابت کرد اتفاقی که در تصویر می‌بینیم، هرگز رخ نداده است؟

🔐 به همین دلیل، تشخیص محتوای جعلی و روش‌های مطمئن برای تأیید اصالت ویدیوها احتمالاً به یکی از موضوعات مهم امنیت دیجیتال تبدیل خواهد شد.