خبر و ترفند روز

خبر و ترفند های روز را اینجا بخوانید!

گوشی اندرویدی من حالا بدون فرستادن هیچ داده‌ای به فضای ابری می‌بیند، می‌شنود و فکر می‌کند

گوشی Android من اکنون بدون فرستادن هیچ داده‌ای به فضای ابری می‌بیند، می‌شنود و فکر می‌کند
برای بهره‌مندی از قابلیت‌های هوش مصنوعی، نه به برنامه‌ای جانبی نیاز دارید و نه به اتصال اینترنت

برای بیشتر ما، استفاده از قابلیت‌های هوش مصنوعی یعنی نیاز همیشگی به اینترنت. البته می‌توان با یک برنامه اندرویدی، تایپ صوتی یا ویرایش متن با هوش مصنوعی را به‌صورت آفلاین راه‌اندازی کرد؛ اما بیشتر کارهایی که در پلتفرم‌هایی مانند ChatGPT، Gemini یا Claude انجام می‌دهیم، به اینترنت نیاز دارند؛ مگر نه؟

اما گویا گوشی هوشمند اندرویدی شما می‌تواند بیشترِ این کارها را بدون اتصال فعال اینترنت انجام دهد.

منظورم توانایی‌های گسترده در زمینه استدلال، بینایی و پردازش صداست. همه این‌ها به لطف برنامه رایگان AI Edge Gallery از گوگل ممکن شده است؛ در ادامه می‌گویم چگونه با کمک آن، گوشی اندرویدی‌ام را به ابزاری توانمند برای هوش مصنوعی تبدیل کردم.

گوشی را روی حالت هواپیما گذاشتم و از آن خواستم فکر کند

نماد وای‌فای ناپدید شد، اما پاسخ‌ها نه

نمای فهرست مدل‌ها در AI Edge Gallery
نمای گزینه‌های پیکربندی در AI Edge Gallery
نمای استدلال AI Edge Gallery برای درخواست پاک‌سازی فضای ذخیره‌سازی
نمای پاسخ AI Edge Gallery به پرسش ایمنی مواد تشکیل‌دهنده ضدعفونی‌کننده
نمای پاسخ جدولی در AI Edge Gallery
نمای پاسخ AI Edge Gallery به پرسش اختلاف ساعت نیویورک و لس‌آنجلس
نمای پاسخ AI Edge Gallery درباره اختلاف ساعت نیویورک و لس‌آنجلس
نمای گزینه‌های پیوست در AI Edge Gallery

به لطف رابط کاربری ساده و خوش‌ساخت AI Edge Gallery، راه‌اندازی هوش مصنوعی محلی روی گوشی اندرویدی‌ام بسیار آسان بود. برنامه را از پلی استور نصب کردم و توانستم بی‌نیاز از جست‌وجو یا درگیرشدن با نام‌های رمزی، مدل‌های گوناگون هوش مصنوعی متن‌باز را بارگیری کنم. خود برنامه حتی متناسب با کاربرد انتخاب‌شده، مدل مناسب را پیشنهاد می‌دهد.

برای نمونه، Edge Gallery برای گفت‌وگوهای آفلاین مبتنی بر استدلال پیشنهاد کرد از Gemma-۴-E4B-it استفاده کنم؛ مدلی که روی دستگاه اندرویدی من روان و بی‌دردسر کار کرده است. من این مدل‌های هوش مصنوعی محلی را روی گوشی هوشمندی با 16GB رم راه‌اندازی کرده‌ام و این مزیت بزرگی است. اگر دستگاه شما 8GB رم یا کمتر دارد، بهتر است مدل 2B را انتخاب کنید.

ترکیب Gemma-۴-E4B-it و AI Edge Gallery در بیشتر کارها، حتی نمونه‌های نسبتاً پیچیده، عملکرد خوبی داشته است. برای مثال، وقتی از هوش مصنوعی روی دستگاه خواستم واحدهای اندازه‌گیری را تبدیل کند، سهم هر نفر از صورت‌حساب را حساب کند یا حتی مناطق زمانی را به یکدیگر تبدیل کند، سرعت مناسبی از خود نشان داد. امکان روشن یا خاموش‌کردن حالت استدلال در هر زمان نیز بسیار کاربردی است.

مطلب مرتبط:   مایکروسافت عملکرد دفتر را کاهش می دهد تا شما را به سمت Copilot سوق دهد

بعضی پرسش‌ها را از ChatGPT یا Gemini می‌پرسم، چون پاسخ‌های بهتری به من می‌دهند. حالا که این مدل را روی دستگاه خود دارم، دیگر لازم نیست برای دریافت همان پاسخ‌ها منتظر اتصال اینترنت بمانم.

«از تصویر بپرس» عکس‌هایم را بدون حتی یک بارگذاری بررسی کرد

حتی برچسب‌های تغذیه‌ای که آدم‌ها را هم سردرگم می‌کنند

فهرست مدل‌های پیشنهادی Gemma همراه با اندازه و دکمه‌های بارگیری یا آزمایش
گفت‌وگو با عکس پیوست‌شده یک پاکت نوشیدنی و پرسش «آیا این محصول برای فرد مبتلا به دیابت مناسب است؟»
پاسخ مدل شامل ارزش‌های غذایی نوشیدنی و نگرانی‌های مربوط به قند آن برای فرد مبتلا به دیابت
عکس دستی که یک ماوس سفید رایانه را نگه داشته است، همراه با پرسش «این چیست؟» و مراحل استدلال مدل
پنجره پیکربندی شامل بیشینه توکن‌ها، TopK، TopP، دما، شتاب‌دهنده GPU و کلید روشن‌کردن استدلال

یکی از ویژگی‌های بسیار خوب مدل‌هایی که از AI Edge Gallery بارگیری می‌کنید، چندوجهی‌بودن آن‌هاست. یعنی برای دریافت پاسخ از این مدل‌های هوش مصنوعی روی دستگاه، به درخواست‌های متنی محدود نیستید. این برنامه بخشی با عنوان «از تصویر بپرس» دارد که مدل‌های ساخته‌شده برای هوش بصری را پیشنهاد می‌کند.

این قابلیت زمانی که می‌خواهم تصاویری را بررسی کنم که تمایلی به بارگذاری آن‌ها روی سرورهای شخص ثالث ندارم نیز به همان اندازه چشمگیر است. با یک مدل مناسب روی دستگاه، می‌توانم بدون به‌خطرانداختن حریم خصوصی از مزایای هوش مصنوعی بهره‌مند شوم. این قابلیت برای تحلیل برچسب‌های تغذیه‌ای یا شناسایی ابزارهای الکترونیکی بسیار سودمند بوده است. مدل‌ها در ترجمه محتوا و نوشتن توضیح برای نماگرفت‌ها نیز عملکرد بسیار خوبی دارند.

البته این تجربه با حالت زنده Gemini قابل مقایسه نیست؛ اما با توجه به حفظ حریم خصوصی و صرفه‌جویی‌ای که به همراه دارد، واقعاً جای گله‌ای باقی نمی‌ماند.

آدیو اسکرایب یادداشت‌های صوتی‌ام را رونویسی کرد

حتی من‌ومن‌کردنم هم به‌طرز شگفت‌آوری درست شنیده شد

صفحه Audio Scribe با فهرست مدل‌های Gemma، اندازه آن‌ها و دکمه‌های بارگیری یا آزمایش
گفت‌وگوی خالی Audio Scribe با منوی ضبط قطعه صوتی، انتخاب پرونده WAV و تاریخچه ورودی‌ها
قطعه صوتی ۲۴٫۵ ثانیه‌ای با درخواست «این را رونویسی کن» و متن انگلیسی تولیدشده مدل در زیر آن
استدلال گام‌به‌گام مدل برای ترجمه متن پیاده‌شده، همراه با آغاز ترجمه فرانسوی
برگه پایینی با عنوان «مدل‌های Audio Scribe» و مدل انتخاب‌شده Gemma-4-E4B-it

توانایی مدل‌های قدرتمند موجود در AI Edge Gallery به متن و تصویر محدود نمی‌شود. بخش تازه‌ای به نام Audio Scribe نیز در دسترس است که می‌توانید با آن صدای خود را به متن تبدیل کنید. من از این قابلیت برای رونویسی فایل‌های صوتی‌ای استفاده کرده‌ام که نمی‌خواهم به سرورهای شخص ثالث فرستاده شوند. انصافاً مدل‌های Gemma گوگل در این زمینه عملکرد رضایت‌بخشی داشته‌اند.

مطلب مرتبط:   نحوه استفاده از قالب بندی سفارشی در اکسل

مدل‌های Audio Scribe در AI Edge Gallery، برای مدل‌هایی که روی گوشی هوشمند اجرا می‌شوند، به‌راستی قدرتمندند. می‌توانید از مدل بخواهید صدای ضبط‌شده را رونویسی کند یا آن را به زبانی دیگر برگرداند. در تجربه من، سرعت پردازش بسیار خوب بوده است. بااین‌حال، برخلاف ابزاری مانند Wispr Flow، این مدل نمی‌تواند عبارت‌های زائد و پُرکننده را از متن حذف کند.

مدت‌زمان یادداشت صوتی‌ای که می‌توانید پیوست کنید نیز محدودیت‌هایی دارد. بااین‌حال، اگر از همان ابتدا به سرویس رونویسی‌ای نیاز دارید که بدون اینترنت کار کند، این محدودیت چندان تعیین‌کننده نیست. وقتی برای دسترسی به اینترنت مشکل دارید، این مدل کار را بی‌دردسر انجام می‌دهد؛ حتی زمانی که باید پیامی متنی و طولانی بفرستید.

مهارت‌های عامل، ابزارها و توانایی‌های تازه‌ای می‌افزایند

اما برخی از آن‌ها به اتصال اینترنت نیاز دارند

صفحه معرفی مهارت‌های عامل در Edge AI Gallery
صفحه «معرفی مهارت‌های عامل» با نمونه درخواست‌ها و شمارنده‌های مهارت‌ها و MCP در بالای کادر درخواست
برگه خالی MCP با دکمه «افزودن کارساز MCP» و پیوندی برای آگاهی بیشتر
درخواست «برای هدست‌های واقعیت مجازی در Wikipedia جست‌وجو کن» همراه با بخشی از خلاصه در حال تولید درباره چیستی هدست واقعیت مجازی
پاسخ گفت‌وگو به درخواست «Googleplex را روی نقشه تعاملی نشان بده» همراه با نقشه‌ای توکار که بر Googleplex متمرکز است
درخواست تنظیم یادآور روزانه برای ساعت ۹ صبح و تأیید مدل پس از اجرای فرمان «schedule_notification»
منوی «افزودن مهارت» با گزینه‌های فهرست برگزیده، بارگیری از نشانی اینترنتی، واردکردن مهارت محلی و دیدن مهارت‌های انجمن
صفحهٔ «مدیریت مهارت‌ها» با فهرستی از مهارت‌های داخلی مانند calculate-hash و interactive-map و کلید روشن یا خاموش برای هرکدام

در تازه‌ترین نسخه AI Edge Gallery، بخش جدیدی با نام «مهارت‌های عامل» نیز افزوده شده است. این بخش با معرفی مهارت‌هایی که می‌توان همراه مدل هوش مصنوعی به کار گرفت، قابلیت‌ها را یک گام فراتر می‌برد. بسته به نوع کار، می‌توانید چندین مهارت و ابزار را فراخوانی کنید تا مدل هوش مصنوعی متناسب با آن‌ها محتوا بسازد.

بسیاری از این مهارت‌ها با خدمات شرکت‌های دیگر نیز یکپارچه شده‌اند، اما برای کارکردن به اینترنت نیاز دارند. برای نمونه، گزینه‌ای برای نقشه تعاملی وجود دارد که رابط Google Maps را برای مکان موردنظر نمایش می‌دهد. همچنین می‌توانید از مهارت Wikipedia بهره بگیرید؛ این قابلیت در Wikipedia جست‌وجو می‌کند و پاسخ درست را در اختیارتان می‌گذارد.

در مقایسه با دیگر قابلیت‌هایی که در Google AI Edge آزموده‌ام، بخش «مهارت‌های عامل» نسبتاً تازه است و هنوز در دست توسعه قرار دارد. مهم‌تر اینکه بسیاری از این مهارت‌ها، به معنای دقیق کلمه، بدون اینترنت کار نمی‌کنند. بااین‌حال، امکان استفاده از عامل‌ها و مهارت‌ها برای انجام کارها، بی‌آنکه به هوش مصنوعی شرکت‌های دیگر وابسته باشیم، بی‌تردید برای کسانی که به حریم خصوصی اهمیت می‌دهند خبر خوبی است.

مطلب مرتبط:   4 بهترین ابزار آنلاین رایگان Sticky Note

هنوز جای جمینای را در گوشی من نگرفته است

هرچند استفاده آفلاین از قابلیت‌های بینایی، استدلال و پردازش صدا در گوشی هوشمند اندرویدی هیجان‌انگیز به نظر می‌رسد، این ابزارها هنوز نمی‌توانند جای گزینه‌ای مانند Gemini را بگیرند. آشکارترین تفاوتی که احساس خواهید کرد، تأخیر در دریافت پاسخ‌هاست؛ به‌ویژه هنگام استفاده از قابلیت‌های استدلالی و چندوجهی.

بااین‌همه، باید در نظر داشت که هوش مصنوعی محلی در گوشی‌های هوشمند اندرویدی هنوز حوزه‌ای نوپا و محدود است و قابلیت‌های بیشتری نیز در راه‌اند. تنها با نگاه از همین زاویه، AI Edge Gallery و مدل‌های Gemma بیش از آنچه انتظار داریم در اختیارمان می‌گذارند.

منبع: این مطلب ترجمه و بومی‌سازی مقاله‌ای از MakeUseOf به قلم Abhijith N Arjunan است. مشاهده مقاله اصلی