برای بیشتر ما، استفاده از قابلیتهای هوش مصنوعی یعنی نیاز همیشگی به اینترنت. البته میتوان با یک برنامه اندرویدی، تایپ صوتی یا ویرایش متن با هوش مصنوعی را بهصورت آفلاین راهاندازی کرد؛ اما بیشتر کارهایی که در پلتفرمهایی مانند ChatGPT، Gemini یا Claude انجام میدهیم، به اینترنت نیاز دارند؛ مگر نه؟
اما گویا گوشی هوشمند اندرویدی شما میتواند بیشترِ این کارها را بدون اتصال فعال اینترنت انجام دهد.
منظورم تواناییهای گسترده در زمینه استدلال، بینایی و پردازش صداست. همه اینها به لطف برنامه رایگان AI Edge Gallery از گوگل ممکن شده است؛ در ادامه میگویم چگونه با کمک آن، گوشی اندرویدیام را به ابزاری توانمند برای هوش مصنوعی تبدیل کردم.
گوشی را روی حالت هواپیما گذاشتم و از آن خواستم فکر کند
نماد وایفای ناپدید شد، اما پاسخها نه








به لطف رابط کاربری ساده و خوشساخت AI Edge Gallery، راهاندازی هوش مصنوعی محلی روی گوشی اندرویدیام بسیار آسان بود. برنامه را از پلی استور نصب کردم و توانستم بینیاز از جستوجو یا درگیرشدن با نامهای رمزی، مدلهای گوناگون هوش مصنوعی متنباز را بارگیری کنم. خود برنامه حتی متناسب با کاربرد انتخابشده، مدل مناسب را پیشنهاد میدهد.
برای نمونه، Edge Gallery برای گفتوگوهای آفلاین مبتنی بر استدلال پیشنهاد کرد از Gemma-۴-E4B-it استفاده کنم؛ مدلی که روی دستگاه اندرویدی من روان و بیدردسر کار کرده است. من این مدلهای هوش مصنوعی محلی را روی گوشی هوشمندی با 16GB رم راهاندازی کردهام و این مزیت بزرگی است. اگر دستگاه شما 8GB رم یا کمتر دارد، بهتر است مدل 2B را انتخاب کنید.
ترکیب Gemma-۴-E4B-it و AI Edge Gallery در بیشتر کارها، حتی نمونههای نسبتاً پیچیده، عملکرد خوبی داشته است. برای مثال، وقتی از هوش مصنوعی روی دستگاه خواستم واحدهای اندازهگیری را تبدیل کند، سهم هر نفر از صورتحساب را حساب کند یا حتی مناطق زمانی را به یکدیگر تبدیل کند، سرعت مناسبی از خود نشان داد. امکان روشن یا خاموشکردن حالت استدلال در هر زمان نیز بسیار کاربردی است.
بعضی پرسشها را از ChatGPT یا Gemini میپرسم، چون پاسخهای بهتری به من میدهند. حالا که این مدل را روی دستگاه خود دارم، دیگر لازم نیست برای دریافت همان پاسخها منتظر اتصال اینترنت بمانم.
«از تصویر بپرس» عکسهایم را بدون حتی یک بارگذاری بررسی کرد
حتی برچسبهای تغذیهای که آدمها را هم سردرگم میکنند





یکی از ویژگیهای بسیار خوب مدلهایی که از AI Edge Gallery بارگیری میکنید، چندوجهیبودن آنهاست. یعنی برای دریافت پاسخ از این مدلهای هوش مصنوعی روی دستگاه، به درخواستهای متنی محدود نیستید. این برنامه بخشی با عنوان «از تصویر بپرس» دارد که مدلهای ساختهشده برای هوش بصری را پیشنهاد میکند.
این قابلیت زمانی که میخواهم تصاویری را بررسی کنم که تمایلی به بارگذاری آنها روی سرورهای شخص ثالث ندارم نیز به همان اندازه چشمگیر است. با یک مدل مناسب روی دستگاه، میتوانم بدون بهخطرانداختن حریم خصوصی از مزایای هوش مصنوعی بهرهمند شوم. این قابلیت برای تحلیل برچسبهای تغذیهای یا شناسایی ابزارهای الکترونیکی بسیار سودمند بوده است. مدلها در ترجمه محتوا و نوشتن توضیح برای نماگرفتها نیز عملکرد بسیار خوبی دارند.
البته این تجربه با حالت زنده Gemini قابل مقایسه نیست؛ اما با توجه به حفظ حریم خصوصی و صرفهجوییای که به همراه دارد، واقعاً جای گلهای باقی نمیماند.
آدیو اسکرایب یادداشتهای صوتیام را رونویسی کرد
حتی منومنکردنم هم بهطرز شگفتآوری درست شنیده شد





توانایی مدلهای قدرتمند موجود در AI Edge Gallery به متن و تصویر محدود نمیشود. بخش تازهای به نام Audio Scribe نیز در دسترس است که میتوانید با آن صدای خود را به متن تبدیل کنید. من از این قابلیت برای رونویسی فایلهای صوتیای استفاده کردهام که نمیخواهم به سرورهای شخص ثالث فرستاده شوند. انصافاً مدلهای Gemma گوگل در این زمینه عملکرد رضایتبخشی داشتهاند.
مدلهای Audio Scribe در AI Edge Gallery، برای مدلهایی که روی گوشی هوشمند اجرا میشوند، بهراستی قدرتمندند. میتوانید از مدل بخواهید صدای ضبطشده را رونویسی کند یا آن را به زبانی دیگر برگرداند. در تجربه من، سرعت پردازش بسیار خوب بوده است. بااینحال، برخلاف ابزاری مانند Wispr Flow، این مدل نمیتواند عبارتهای زائد و پُرکننده را از متن حذف کند.
مدتزمان یادداشت صوتیای که میتوانید پیوست کنید نیز محدودیتهایی دارد. بااینحال، اگر از همان ابتدا به سرویس رونویسیای نیاز دارید که بدون اینترنت کار کند، این محدودیت چندان تعیینکننده نیست. وقتی برای دسترسی به اینترنت مشکل دارید، این مدل کار را بیدردسر انجام میدهد؛ حتی زمانی که باید پیامی متنی و طولانی بفرستید.
مهارتهای عامل، ابزارها و تواناییهای تازهای میافزایند
اما برخی از آنها به اتصال اینترنت نیاز دارند








در تازهترین نسخه AI Edge Gallery، بخش جدیدی با نام «مهارتهای عامل» نیز افزوده شده است. این بخش با معرفی مهارتهایی که میتوان همراه مدل هوش مصنوعی به کار گرفت، قابلیتها را یک گام فراتر میبرد. بسته به نوع کار، میتوانید چندین مهارت و ابزار را فراخوانی کنید تا مدل هوش مصنوعی متناسب با آنها محتوا بسازد.
بسیاری از این مهارتها با خدمات شرکتهای دیگر نیز یکپارچه شدهاند، اما برای کارکردن به اینترنت نیاز دارند. برای نمونه، گزینهای برای نقشه تعاملی وجود دارد که رابط Google Maps را برای مکان موردنظر نمایش میدهد. همچنین میتوانید از مهارت Wikipedia بهره بگیرید؛ این قابلیت در Wikipedia جستوجو میکند و پاسخ درست را در اختیارتان میگذارد.
در مقایسه با دیگر قابلیتهایی که در Google AI Edge آزمودهام، بخش «مهارتهای عامل» نسبتاً تازه است و هنوز در دست توسعه قرار دارد. مهمتر اینکه بسیاری از این مهارتها، به معنای دقیق کلمه، بدون اینترنت کار نمیکنند. بااینحال، امکان استفاده از عاملها و مهارتها برای انجام کارها، بیآنکه به هوش مصنوعی شرکتهای دیگر وابسته باشیم، بیتردید برای کسانی که به حریم خصوصی اهمیت میدهند خبر خوبی است.
هنوز جای جمینای را در گوشی من نگرفته است
هرچند استفاده آفلاین از قابلیتهای بینایی، استدلال و پردازش صدا در گوشی هوشمند اندرویدی هیجانانگیز به نظر میرسد، این ابزارها هنوز نمیتوانند جای گزینهای مانند Gemini را بگیرند. آشکارترین تفاوتی که احساس خواهید کرد، تأخیر در دریافت پاسخهاست؛ بهویژه هنگام استفاده از قابلیتهای استدلالی و چندوجهی.
بااینهمه، باید در نظر داشت که هوش مصنوعی محلی در گوشیهای هوشمند اندرویدی هنوز حوزهای نوپا و محدود است و قابلیتهای بیشتری نیز در راهاند. تنها با نگاه از همین زاویه، AI Edge Gallery و مدلهای Gemma بیش از آنچه انتظار داریم در اختیارمان میگذارند.
منبع: این مطلب ترجمه و بومیسازی مقالهای از MakeUseOf به قلم Abhijith N Arjunan است. مشاهده مقاله اصلی