AI Plus - هوش‌ پلاس
95.6K subscribers
208 photos
78 videos
192 links
AI Plus
Download Telegram
هرچه از هوش سوپر مدل «Nano Banana Pro» بگوییم کم است!
فقط یک متن ساده را تبدیل به یک "اینفوگرافیک" عالی می‌کند؛ تقریبا توان آن را دارد از هر چیز بی معنی یک Infographic بسیار درجه یک بسازد؛

مسئله این نیست که این ایدها چقدر احمقانه هستند یا درست، بلکه مسئله این است که؛ هر ایده ای حتی احمقانه با مدل «Nano Banana Pro»، زیر 20 ثانیه تنها با نوشتن به نمایش در می آید.
نه توضیح خاصی ارائه شد نه پیچشی! تنها این تصویر به سوپر مدل «Nano Banana Pro» ارائه شد و درخواست؛
"اشکالات این این طرح را رونویسی کند" و...10ثانیه بعد نتیجه خیره کننده بود
3👍1🔥1
به کمک پرامپت زیر در Nano Banana Pro می‌تونید نمودار شماتیک هر چیزی رو بسازید.
انتخاب زبان نوشتارش هم با خودتونه!

"Create a hand drawn isometric schematic diagram of this [Object] in [Language]"
5
This media is not supported in your browser
VIEW IN TELEGRAM
این ترفند جمینای خیلی عالیه!
می‌تونید لینک هر ویدیوی یوتیوبی رو بردارید، بندازید تو جمینای و بگید براتون تحلیلش کنه. بعدش هم یه کلام ازش بخواید کل داستان ویدیو رو تبدیل کنه به یه عکس اینفوگرافیک شسته و رفته.
به همین راحتی!

پرامپش هم اینه:



Generate an image of an infographic explaining the concept presented in the video.
🔥51👍1
گوگل یه ابزار جدید و فوق‌العاده کاربردی به Gemini API اضافه کرده به اسم File Search Tool که خیلی مفیده و پیاده سازی RAG را راحت می‌کنه.

تا حالا برای اینکه مدل جمنای (Gemini) بتونه از فایل‌های شخصیتون اطلاعات دقیق بده (مثلاً داکیومنت‌ها، PDFها و...)، باید دردسر RAG (همون Retrieval Augmented Generation) رو خودتون مدیریت می‌کردید. اما حالا این ابزار جدید خودش یه سیستم RAG کاملاً مدیریت‌ شده‌ست و همه این کارا رو خودکار انجام میده! دیگه لازم نیست نگران ذخیره‌سازی فایل‌ها، تقسیم‌بندی محتوا، ساختن Embeddings و تزریق context باشید. همه چی مدیریت شدست و کار توسعه رو خیلی آسون‌تر کرده.

مهم‌تر از همه: قیمتش عالیه و خیلی به‌صرفه! ذخیره فایل‌ها و ساختن Embeddings موقع کوئری گرفتن (وقتی از فایل‌ها سؤال می‌پرسی) کاملاً مجانیه! فقط برای اولین بار که فایل‌ها رو ایندکس می‌کنید و آماده جستجو میشن، یه هزینه خیلی کم (۰.۱۵ دلار به ازای هر ۱ میلیون توکن) پرداخت می‌کنید. اینجوری ساختن و مقیاس‌دهی پروژه‌ها با دیتای شخصی، فوق‌العاده مقرون به صرفه‌تر میشه.

این ابزار از جستجوی وکتوری (Vector Search) قدرتمند استفاده می‌کنه که با مدل‌های پیشرفته Gemini Embedding کار می‌کنه. یعنی چی؟ یعنی حتی اگه کلمات دقیق تو کوئری نباشه، بازم معنی و مفهوم رو می‌فهمه و اطلاعات مرتبط رو پیدا می‌کنه. تازه، خروجی‌ها منبع‌دهی خودکار/citation هم دارن تا دقیقاً بدونید جواب از کدوم قسمتداکیومنت اومده.

اگه دارید بات‌های پشتیبانی هوشمند، personal assistant یا هر نوع پلتفرم محتوایی می‌سازید که نیاز به دسترسی به داکیومنت‌های بزرگ و متنوع (مثل PDF، DOCX، TXT و انواع کد) داره، این ابزار جون میده برای کار شما. حتماً داکیومنت‌هاش رو ببینید و توی Google AI Studio دمو رو تست کنید.
بلاگ کامل را بخونید:

https://blog.google/technology/developers/file-search-gemini-api/
4
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 چرا چین مدل‌های پیشرفتهٔ AI را رایگان منتشر می‌کند؟

اریک اشمیت، مدیرعامل سابق گوگل، می‌گوید چین با اپن‌سورس کردن مدل‌های هوش مصنوعی، یک استراتژی ژئوپلیتیک معکوس را اجرا کرده است.
در حالی که آمریکا روی مدل‌های بسته و مالکیت معنوی تأکید دارد، چین با رایگان‌کردن مدل‌های قدرتمند، استارتاپ‌های جهان را به ابزارهایی مجهز می‌کند که قبلاً فقط در اختیار غول‌های فناوری بود.

او پیش‌بینی می‌کند طی ۵ تا ۱۰ سال آینده، دنیا با میلیون‌ها مدل هوش مصنوعی کوچک و تخصصی پر می‌شود؛ تغییری که مسیر رسیدن به AGI را عوض می‌کند.

به‌گفتهٔ اشمیت، چین با این کار در حال زدن یک «حملهٔ نامتقارن» به مدل اقتصادی سیلیکون‌ولی است:
غرب دنبال ساخت یک «ابرمدل گران» است؛ چین میلیون‌ها «مدل کوچک رایگان» پخش می‌کند. وقتی هزینهٔ هوش به صفر برسد، مدل‌های بسته ارزش خود را از دست می‌دهند.

💡 آینده:
ارزش از «داشتن مدل» به داده‌های تخصصی منتقل می‌شود، کنترل‌پذیری AI سخت‌تر می‌شود، و هوش مصنوعی مثل الکتریسیته همه‌جا و ارزان خواهد بود.
🔥141
This media is not supported in your browser
VIEW IN TELEGRAM
نمی‌دونم از چین خوشتون میاد یا بدتون میاد! نمی‌دونم واقعا چپید راستید و یا وسطید و....

ولی کاری که چین داره توی AI می‌کنه و نحوه جنگیدنش با غولای آمریکایی شایسته ایستادن و دست زدنه.
24👍3🔥2🤣2👎1
Media is too big
VIEW IN TELEGRAM
شرکت Kling یه مدل ویدیویی جدید منتشر کرده به اسم Kling o1 و همین حالا هم روی Higgsfield فعال شده. این اولین مدل ویدیویه که همه‌چیز رو یکجا داره؛ یعنی می‌تونی تولید ویدیو، ویرایش، تغییر سبک و حتی اکستند کردن ویدیو رو همگی داخل یه موتور واحد انجام بدی.

این مدل تا ۷ تا تصویر مرجع رو پشتیبانی می‌کنه، خروجی ۲K می‌ده و می‌تونه کلیپ‌های ۳ تا ۱۰ ثانیه‌ای بسازه. یعنی یه بسته کامل و قدرتمند برای هرکسی که با ویدیو سروکار داره.
🤯4
Media is too big
VIEW IN TELEGRAM
💢قدرتمندتر از Sora و Veo؛ مدل ویدیوساز Runway Gen-4.5 معرفی شد

استارتاپ Runway با تیمی ۱۰۰ نفره از مدل ویدیویی جدید خود به نام Gen-4.5 رونمایی کرد که در بنچمارک‌های مختلف از مدل‌های گوگل و OpenAI پیشی گرفته است. این مدل با درک عمیق از فیزیک و جزئیات بصری، خروجی‌هایی نزدیک به واقعیت تولید می‌کند و پرامپت‌های پیچیده را با دقت بالا اجرا می‌نماید.

در رتبه‌بندی Video Arena، Gen-4.5 جایگاه نخست را کسب کرده و Veo 3 گوگل دوم و Sora 2 Pro از OpenAI هفتم شده‌اند. با وجود پیشرفت‌ها، مشکلاتی مانند خطا در علیت و پایداری اشیا هنوز وجود دارد و عرضه این مدل به‌صورت تدریجی آغاز شده است.
8🤯6
جمنای پرو یکماهه رایگان

اگر به دنبال دریافت یک ماه اشتراک بیزینس Gemini بصورت رایگان هستید، کافی است مراحل زیر را انجام دهید:
وارد لینکی شوید که در ادامه قرار داده شده است.
حساب جیمیل خود را وارد کنید.
سپس دو بار روی دکمه آبی کلیک کنید تا فرآیند فعال‌سازی انجام شود.
با انجام این مراحل، اشتراک یک‌ماهه نسخه پولی Gemini بدون نیاز به کارت فعال خواهد شد.
لینک دریافت:
https://auth.business.gemini.google/login?continueUrl=https://business.gemini.google/


ترجیحا آی پی آمریکا و از vpnهایی با پروتکل open vpn یا wireguard استفاده کنید.
6🖕2🗿1
This media is not supported in your browser
VIEW IN TELEGRAM
بازیِ برنامه‌نویسی داره کلاً عوض میشه و اگر حواستون نباشه، ممکنه جا بمونید!
دانشگاه استنفورد یه دوره جدید راه انداخته به اسم «The Modern Software Developer» که حرف حسابش اینه: دورانِ صرفاً «کد زدن» با دست داره تموم میشه. الان دیگه شما باید یاد بگیرید چطوری با AI Agentها کار کنید، چطوری از ابزارهایی مثل Cursor و Warp استفاده کنید و در واقع به جای کدنویس، «معمار» و «مدیر» هوش مصنوعی باشید.

تو این دوره دقیقاً دارن یاد میدن که چطور فرایند توسعه نرم‌افزار داره از «تایپ کردن سینتکس» به «تعامل با AI» برای ساخت سیستم‌های پیچیده تغییر می‌کنه. خلاصه اینکه آینده‌ی شغلی شما دیگه فقط به دونستن الگوریتم نیست، به اینه که چقدر خوب می‌تونید از این ابزارهای جدید کار بکشید.

تمام مطالب اعم از اسلایدها و پروژه ها را هم گذاشتند.
پیشنهاد می‌کنم حتماً یه سر به سرفصل‌هاش بزنید تا ببینید دنیا دست کیه:
https://themodernsoftware.dev
👍21
This media is not supported in your browser
VIEW IN TELEGRAM
🔺گوگل ترنسلیت با جمینای متحول شد؛ ترجمه زنده مکالمات از طریق هدفون

گوگل نسخه جدید Google Translate را با استفاده از مدل هوش مصنوعی جمینای معرفی کرده که ترجمه هم‌زمان را ممکن می‌سازد. این به‌روزرسانی به‌ویژه در ترجمه اصطلاحات، ضرب‌المثل‌ها، عبارت‌های محلی و اسلنگ‌ها مؤثر است و کیفیت ترجمه‌ها را در سطح پیشرفته‌ترین فناوری‌های روز قرار داده است. در فاز ابتدایی، ترجمه میان زبان انگلیسی و نزدیک به ٢٠ زبان دیگر از جمله اسپانیایی، هندی، چینی، ژاپنی و آلمانی پشتیبانی می‌شود.

یکی از قابلیت‌های مهم جدید، امکان شنیدن ترجمه مکالمات به‌صورت هم‌زمان در هدفون است که فعلاً به‌صورت بتا در اپلیکیشن اندروید و در کشورهای ایالات متحده، مکزیک و هند ارائه شده و از بیش از ٧٠ زبان پشتیبانی می‌کند. همچنین ابزارهای آموزش زبان در Google Translate بهبود یافته‌اند و کاربران بازخورد دقیق‌تری از تمرین‌های گفتاری دریافت می‌کنند؛ این بخش آموزشی نیز به نزدیک به ٢٠ کشور و منطقه جدید گسترش خواهد یافت.
11🤯7👍1
This media is not supported in your browser
VIEW IN TELEGRAM
🚨 **گوگل به نقطه قوت اصلی انویدیا حمله کرده؛ نه سخت‌افزار، بلکه نرم‌افزار!**

گوگل روی پروژه‌ای به اسم TorchTPU کار می‌کنه که باعث می‌شه PyTorch (محبوب‌ترین فریم‌ورک هوش مصنوعی دنیا) بدون دردسر روی چیپ‌های TPU گوگل اجرا بشه؛ همون کاری که قبلاً فقط با GPUهای انویدیا و CUDA ممکن بود.

💡 چرا این مهمه؟
چون قدرت واقعی انویدیا فقط چیپ‌هاش نیست، بلکه قفل نرم‌افزاری CUDA ـه. شرکت‌ها سال‌هاست به خاطر PyTorch و CUDA به انویدیا وابسته شدن و مهاجرت براشون خیلی پرهزینه بوده.

🔓 TorchTPU یعنی:

* بدون بازنویسی کد
* بدون افت عملکرد
* فقط سخت‌افزار عوض می‌شه

و جالب‌تر اینکه گوگل داره با Meta (سازنده PyTorch) همکاری می‌کنه و حتی احتمال open-source شدن پروژه هم هست.

🔥 نتیجه؟
شرکت‌ها بالاخره یه راه فرار از قیمت‌های بالای انویدیا پیدا می‌کنن.
ابرشرکت‌ها مثل Oracle، Microsoft و OpenAI می‌تونن به سمت گوگل برن.
قدرت قیمت‌گذاری انویدیا به خطر می‌افته.

اگر همه‌چیز طبق برنامه پیش بره:
حدود ۱۲ تا ۱۸ ماه دیگه TorchTPU آماده استفاده جدی می‌شه و اون موقع انویدیا دیگه «غیرقابل‌جایگزین» نیست.

📉 بازار هنوز خطر رو جدی نگرفته، ولی اگه این پروژه موفق بشه:
روایت «انویدیا شکست‌ناپذیره» فرو می‌ریزه
و ارزش‌گذاری چند تریلیون دلاریش دوباره زیر سؤال می‌ره.

👀 باید دید ۲۰۲۶ چه خبر می‌شه…
👍61
اکستنشن claude در مرورگر chrome که امروز‌ ریلیز شده رو اضافه کنید. به صورت sidebar باز میشه.

دسترسی read/write به همه تب‌ها به صورت همزمان داره و می تونه کد JavaScript در صفحات مرورگر تون اجرا کنه.

و البته که صدها استارت آپ با همین اکستشن کشته شدن. خدا رحمتشون کنه ✋🏻
💔62
This media is not supported in your browser
VIEW IN TELEGRAM
این مدل جدید خیلی کوچک و سبک که گوگل معرفی کرد به اسم FunctionGemma را دست کم نگیرید. یه مدل فوق‌العاده سبک (فقط ۲۷۰ میلیون پارامتر!) دارید که انقدر کوچیکه که روی گوشی‌های معمولی هم راحت اجرا میشه، اما تخصصش فقط یک چیزه: تبدیل حرف‌های ما به دستورات برنامه‌نویسی (Function Calling).
میتونید به صورت کاملا رایگان fine tune ش کنید برای کارهای مختلف.

اما این مدل به چه دردی می‌خوره؟ بیاین چندتا مورد جذاب رو بررسی کنیم:
۱. دستیار شخصی کاملاً آفلاین و امن:
تا حالا شده بخواین با فرمان صوتی چراغ خونه رو خاموش کنید یا یه تایمر بذارید، ولی چون اینترنت قطع بوده کار نکرده؟ با FunctionGemma، اپلیکیشن‌ها می‌تونن بدون نیاز به سرور و کاملاً روی خود گوشی، حرف شما رو بفهمن و دقیقاً دکمه یا تابع مربوطه رو اجرا کنن. امنیتش هم عالیه چون هیچ داده‌ای از گوشی خارج نمیشه.
۲. بازی‌های تعاملی نسل جدید:
تصور کنید توی یه بازی نقش‌آفرینی (RPG)، به جای اینکه فقط از بین گزینه‌ها انتخاب کنید، به کاراکتر بگید: «برو از توی صندوقچه اون معجون قرمز رو بردار و بده به سرباز کناری.» این مدل می‌تونه این جمله رو به کدهای بازی ترجمه کنه و اکشن‌ها رو بلافاصله انجام بده.
۳. اتوماسیون کارهای سیستم:
توسعه‌دهنده‌ها می‌تونن ابزارهایی بسازن که کارهای تکراری سیستم‌عامل رو برامون انجام بده. مثلاً بگید: «فایل‌های PDF توی پوشه دانلود رو که حجمشون بالای ۱۰ مگه زیپ کن و بفرست به ایمیل علی.» مدل دقیقاً توابع مربوط به مدیریت فایل و ایمیل رو فراخوانی می‌کنه.
۴. اینترنت اشیاء (IoT) هوشمندتر:
توی گجت‌های هوشمند که رم و پردازنده خیلی محدودی دارن، FunctionGemma مثل یک جادوگر عمل می‌کنه. چون فقط به ۵۵۰ مگابایت رم نیاز داره، می‌تونه مستقیم روی سخت‌افزار لوازم خانگی یا ابزارهای صنعتی نصب بشه تا دستورات پیچیده انسانی رو به زبان ماشین ترجمه کنه.

برای fine tune کردنش این بلاگ کامل توضیح میده به همراه کد.

https://lmstudio.ai/blog/functiongemma-unsloth
4🤯3
اگر از ChatGPT استفاده میکنید ، حتما به این لینک سر بزنید و ازش استفاده کنید🤝

مجموعه‌ای از پرامپت های آماده و حرفه‌ای برای استفاده بهتر از #ChatGPT .بدون نیاز به ساخت پرامت از صفر

کاملا تاثیر استفادشو حس میکنید ، در نتیجه و رفتار مدل🥂

https://academy.openai.com/public/tags/prompt-packs-6849a0f98c613939acef841c
8👌4👍1
این روزها با کسی بحث نکنید؛
هر کسی هر آنچه باید می‌دید، دید
و هر آنچه باید می‌فهمید، فهمید.
و اگر کسی نفهمید،
سودش در نفهمیدن بود.

تاریخ اما بارها نشان داده است:
دیکتاتورها همواره ظالم‌اند،
و سرنوشتشان یا سقوط است
یا فروپاشی در برابر ایستادگی مردم.
70👍22💘9🤡5🖕3👏1
Please open Telegram to view this post
VIEW IN TELEGRAM
دوستان عزیز ❤️
ببخشید که این مدت کمتر فعال بودم. بیشتر وقتم صرف اطلاع‌رسانی درباره وضعیت ایران توی توییتر و ایمیل‌زدن به سازمان‌ها و افراد مختلف شد. حس می‌کردم توی این مقطع، این کار بیشترین اثر رو داره.

در کنارش، با کمک چند نفر از بچه‌ها تونستیم حدود ۵۰ تا سرور و دستگاه مختلف برای conduitهای Psiphon راه‌اندازی کنیم. این حداقل کاری بود که توی این شرایط از دستم برمی‌اومد و امیدوارم در ادامه بتونم کمک‌های بیشتری بکنم.

الان که وضعیت اینترنت کمی بهتر شده، چند تا کانفیگ اینجا می‌ذارم. لطفاً روی اینترنت‌های مختلف تستشون کنید؛ بعضی‌هاشون پایدارتر کار می‌کنن.
فعلاً همه این کانفیگ‌ها روی یک سرور هستن و به‌خاطر احتمال بلاک شدن IP، طبیعیه که نیاز باشه هر از گاهی سرور جدید بالا بیاریم. من هم تا جایی که در توانم باشه سعی می‌کنم لیست‌ها رو آپدیت کنم.

ممنون از صبوری و همراهی‌تون 🌹
کنار هم قوی‌تریم 💚
29😁4🤡2🫡1