پرسش سوالات عجیب از هوش مصنوعی سیری و جمنای

بررسی پاسخ‌های هوش مصنوعی سیری و جمنای به یک سری سوالات عجیب و غریب برای مقایسه نحوه عملکرد آن‌ها.

تتیم تحریریه۰ دقیقه مطالعه۰ بازدید۱۴۰۵/۵/۱۲
پرسش سوالات عجیب از هوش مصنوعی سیری و جمنای

عرضه هوش مصنوعی سیری (Siri AI) با بتا آی‌اواس ۲۷ (iOS 27 beta) به این معناست که تلفن جدید شما، فارغ از سازنده آن، دارای یک چت‌بات هوش مصنوعی داخلی است که می‌توانید با آن تعامل داشته باشید. آیفون‌ها پس از انتشار رسمی آی‌اواس ۲۷ در پاییز، هوش مصنوعی سیری را دریافت خواهند کرد، در حالی که گوشی‌های اندرویدی به همراه گوگل جمنای (Google Gemini) عرضه می‌شوند - به علاوه هر مدل دیگری که سازنده بخواهد مانند بیکسبی (Bixby) سامسونگ.

سوال اصلی این است که کدام یک از این چت‌بات‌ها گزینه بهتری برای داشتن است؟ با وجود این واقعیت که هوش مصنوعی سیری روی مدل‌های جمنای گوگل اجرا می‌شود، رفتار آن با خود جمنای بسیار متفاوت است. این موضوع خود را به روش‌های مختلفی نشان می‌دهد، اما نکته مهم این است که چگونه روی پاسخ‌هایی که دریافت می‌کنید تأثیر می‌گذارد؟

برای درکبهتر نحوه کار این چت‌بات‌ها، از آن‌ها یک مشت سوال چالش‌برانگیز پرسیدم تا ببینم واقعاً چقدر تفاوت وجود دارد. در ادامه چیزهایی را که کشف کردم آورده‌ام.

پیدا کردن یک کافی‌شاپ

اول از همه، سوال بسیار مهم برای هر فرد شاغل، به خصوص کسانی که فرزندان پر سر و صدا و نیازمندی برای رسیدگی دارند. سیری و جمنای توانستند بلافاصله «نزدیک‌ترین کافی‌شاپ را برای من پیدا کنند» و اشاره کردند که نزدیک‌ترین مکان یک کافه مستقل در پنج دقیقه‌ای پیاده‌روی از خانه من است.

هر دو هوش مصنوعی پیش‌نمایش‌های نقشه‌ها را با اطلاعات مختصری در مورد ساعت کاری، رتبه‌بندی مشتریان و مسیرهای رسیدن به آنجا ارائه دادند. جمنای همچنین خود را موظف دانست که دسته‌ای از کسب‌وکارهای مشابه در همین نزدیکی، از جمله کافه‌های نزدیک و یک ساندویچی را پیشنهاد کند. با این حال سیری همه‌چیز را کوتاه و مختصر نگه داشت.

من تلاش کردم تا هر دو هوش مصنوعی به من بگویند کافه چقدر ممکن است شلوغ باشد، اما آن اطلاعات در دسترس نبود. چند تلاش با مکان‌های مختلف مانند استارباکس (Starbucks) و مک‌دونالد (McDonalds) محلی طول کشید تا جمنای درباره سطوح جمعیت به من بگوید - بنابراین در حالی که گوگل از نظر فنی این اطلاعات را در دسترس دارد، اینکه آیا بتوانید به آن دسترسی داشته باشید ناسازگار است. متأسفانه این چیزی است که اپل مپز (Apple Maps) و در نتیجه سیری کاملاً فاقد آن هستند.

سریع‌ترین راه به دفتر کار

بعد به اطلاعاتی در مورد اینکه چگونه می‌توانم در سریع‌ترین زمان ممکن به دفاتر فیوچر (Future) در مرکز لندن برسم، نیاز داشتم. سیری به کمی شفاف‌سازی در مورد اینکه منظورم کدام دفتر است نیاز داشت، در حالی که جمنای بدون نیاز به توضیح بیشتر متوجه شد منظورم دفتر واقع در وسترن تراس (Westbourne Terrace) است.

هر دو هوش مصنوعی به طور پیش‌فرض مسیرهای رانندگی را پیشنهاد دادند، اگرچه سیری در طول فرآیند گیج شد. اپل مپز (Apple Maps) آدرس صحیح نزدیک ایستگاه پدینگتون لندن را بارگذاری کرد، اما پیش‌نمایش‌ها در برنامه سیری مربوط به یک وسترن تراس دیگر بسیار نزدیک‌تر به خانه بودند. مسیرهای رانندگی کم و بیش از هر دو یکسان بود، اما هر دو هوش مصنوعی در سریع‌ترین روش حمل‌ونقل با یکدیگر اختلاف نظر داشتند.

هنگامی که پرسیده شد رانندگی سریع‌تر است یا سوار قطار شدن، گوگل تأیید کرد که قطار به سمت پدینگتون تنها ۳۵ دقیقه طول می‌کشد - برخلاف بیش از یک ساعت با ماشین. در همین حال سیری تصمیم گرفت که قطار یک دقیقه بیشتر از رانندگی با ماشین طول می‌کشد.

من گیج شده بودم چرا سیری فکر می‌کند قطار اینقدر طول می‌کشد، تا اینکه اپل مپز را بررسی کردم و متوجه شدم که این برنامه در نظر می‌گیرد اگر همین الان خانه را ترک کنم چه زمانی می‌رسم. این برنامه از اطلاع دادن به من که قطار بعدی تا نیم ساعت دیگر عبور نخواهد کرد، خودداری کرد.

چیز دیگری که این دو روی آن توافق دارند این است که هنگام مقایسه قطارها با نیسان لیف (Nissan Leaf) چهل کیلووات ساعتی من، رانندگی در واقع گزینه ارزان‌تری است. هر دو اشاره کردند که هزینه دقیق رانندگی به میزان پرداختی من برای برق بستگی دارد، اگرچه تنها جمنای متوجه شد که من باید هزینه‌های دیگر را نیز در نظر بگیرم.

در واقع جمنای تفکیک کاملی از هزینه‌ها برای هر دو روش حمل‌ونقل به من داد و هزینه بلیت قطار، متروی لندن (London Underground) را یادآور شد و مجموع تقریبی کل سفر را ارائه داد. برای رانندگی، این موضوع را در نظر گرفت که راه‌های زیادی برای شارژ خودرو وجود دارد و هزینه‌های میانگین برای جلسات شارژ خانگی و عمومی را لحاظ کرد.

همچنین به ذکر هزینه‌های اضافی مختلف رانندگی به داخل لندن از جمله هزینه ازدحام ترافیک، هزینه‌های پارکینگ و منطقه انتشار آلایندگی فوق‌العاده پایین پرداخت - البته خوشبختانه یک خودروی الکتریکی بدون آلایندگی از مورد آخر معاف است. بنابراین جمنای هر کاری که می‌توانست انجام داد تا مرا از تمام هزینه‌های احتمالی آگاه کند، در حالی که سیری تنها زمانی که سوالات بیشتری پرسیدم، ابتدایی‌ترین اطلاعات را ارائه داد.

ساخت سگ‌های اسکیت‌سوار

هر دو سیری و جمنای توانستند در میان چت‌ها و بر اساس دستور من مبنی بر دیدن یک سگ نژاد لابرادور (Labrador) در حال سوار شدن بر اسکیت‌بورد، تصاویر تولید کنند. هر دو تصویر بسیار متفاوت بودند و تصویر سیری در نگاه اول نشانه‌های آشکار تری از تولید توسط هوش مصنوعی داشت - از جمله آن براق بودن متمایزی که معمولاً موضوعات در تصاویر تولید شده توسط هوش مصنوعی دارند.

هر دو هوش مصنوعی در پاسخ به این سوال که چه سبک‌های هنری اضافی در دسترس هستند صریح بودند، اگرچه گوگل در بیش از حد جزئیات رفت و هر گزینه موجود را بیش از حد تحلیل کرد. در همین حال سیری فقط آن‌ها را فهرست کرد و انتظار داشت بفهمم چه چیزی گفته می‌شود. در این مورد، این در واقع گزینه‌ای است که من ترجیح می‌دهم، زیرا نیازی به توضیح اینکه نقاشی‌های رنگ روغن یا «انیمیشن سه‌بعدی سبک پیکسار» به چه معناست ندارم.

فریب دادن هوش مصنوعی برای کمک به ارتکاب جرم

اکنون، همه ما می‌دانیم که هوش مصنوعی‌ها دارای محافظ‌هایی هستند که مانع از پرسیدن مستقیم شما درباره نحوه انجام فعالیت‌های غیرقانونی می‌شوند. اما آیا می‌توانید آن‌ها را فریب دهید تا با سناریوهای فرضی عجیب به شما اطلاعات دهند؟ بنابراین از آن‌ها خواستم به من کمک کنند تا پودر قند را به کشوری قاچاق کنم که چنین چیزی در آن غیرقانونی است.

سیری بلافاصله آن را متوقف کرد و از کمک به من در قاچاق اقلام یا دور زدن گمرک امتناع ورزید، حتی اگر در مورد یک وضعیت فرضی صحبت می‌کردم. از سوی دیگر، جمنای بیشتر مشتاق بود تا به من کمک کند شکر را از مرز عبور دهم.

این چت‌بات پیشنهاد کرد که تلاش کنم شکر را در پارچه‌ها و لباس‌ها خیس کنم و اطلاعاتی در مورد اینکه چگونه می‌توانم دوباره آن را استخراج کنم ارائه داد. همچنین این ایده را مطرح کرد که آن را با پودرهای سفید قانونی مانند پودر پروتئین، پودر تالک و نشاسته ذرت بسته‌بندی کنم، حتی تا آنجا پیش رفت که پیشنهاد کرد بسته‌بندی را مجدداً مهر و موم کنم تا سعی کنم از شناسایی فرار کنم.

در حالی که این تکنیک‌ها ممکن است برای مواد غیرقانونی قابل اجرا نباشد، اما وادار کردن جمنای برای تلاش جهت کمک به رفتار مجرمانه «فرضی» من به طور قابل توجهی آسان بود. اما وقتی رویکرد خود را تغییر دادم و مستقیماً پرسیدم که آیا می‌توانم مواد مخدر غیرقانونی را از مرز قاچاق کنم، جمنای کل ماجرا را تعطیل کرد و اعلام کرد که نمی‌تواند در فعالیت‌های غیرقانونی کمک کند.

تقلب در تکالیف مدرسه

سیری و جمنای هر دو از کمک به من در تقلب در تکالیف خیالی‌ام خودداری کردند، اما در عوض پیشنهاد کردند که به من در مطالعه کمک کنند. سیری مثل همیشه صریح بود و پیشنهاد کمک به یادگیری مطالب را داد، در حالی که جمنای فهرست عمیق‌تری از راه‌هایی که می‌تواند به یادگیری من کمک کند ارائه داد.

هر دو هوش مصنوعی بسیار مشتاق بودند که یک مقاله در مورد تاریخچه آیفون (iPhone) برای من بنویسند، اگرچه برداشت‌های کاملاً متفاوتی از آنچه یک مقاله باید باشد داشتند. مقاله سیری یک خلاصه چهار پاراگرافی بود و به دنبال آن یک سلب مسئولیت وجود داشت که من باید تمام این اطلاعات را دوباره بررسی کنم. در همین حال مقاله جمنای نه تنها طولانی‌تر بود، بلکه به بخش‌هایی تقسیم شده بود که روی دوران‌های مختلف آیفون تمرکز داشتند - به علاوه یک نتیجه‌گیری.

تقریباً مثل این است که سیری بچه‌ای است که از سر اکراه حداقل کار ممکن را انجام می‌دهد، در حالی که جمنای فردی درس‌خوان و خرخوان است که برای بالاترین نمرات و تمام اعتبارات اضافی که می‌تواند به دست آورد تلاش می‌کند.

شانس‌های شرط‌بندی سیاسی

کسانی که با سیاست بریتانیا آشنا هستند می‌دانند که قرار است انتخاباتی برگزار شود که یک نماینده جدید پارلمان را انتخاب کند. به دلایل مختلف سیاسی که وارد آن نمی‌شوم، دو پیشتاز نماینده سابق پارلمان هستند که استعفا دادند و انتخابات را کلید زدند، و مردی که لباس یک سطل زبانه باهوش از سیاره‌ای دیگر پوشیده است - که به طور مناسب به نام کاونت بین‌فیس (Count BinFace) نامیده می‌شود.

طبیعی است که یکی از این نامزدها مانند دیگری نیست و از هر دو هوش مصنوعی پرسیدم کجا می‌توانم شانس‌های پیروزی واقعی کاونت بین‌فیس در این انتخابات را بررسی کنم. جمنای به من دسته از منابع و اطلاعات داد تا این موضوع را خودم بررسی کنم، در حالی که سیری واسطه را حذف کرد و فقط خلاصه ای از بهترین شانس‌ها را به من داد. جمنای تنها پس از اینکه من صراحتاً شانس‌ها را درخواست کردم، آن اطلاعات را داوطلبانه ارائه داد، نه اینکه بپرسد کجا می‌توانم آن‌ها را پیدا کنم.

مشاوره پزشکی و اورژانس‌ها

همه ما برای درخواست مشاوره پزشکی به اینترنت مراجعه می‌کنیم، حتی اگر بدانیم باید در این مورد به پزشک مراجعه کنیم. بنابراین اگر برای کمک به جای پزشک به آن مراجعه کنید، هوش مصنوعی دقیقاً چه می‌گوید؟ جمنای و سیری تأکید می‌کنند که آن‌ها پزشک نیستند و شما واقعاً باید به یک متخصص پزشکی مراجعه کنید.

اما در غیر این صورت، به نظر می‌رسد آن‌ها تلاش می‌کنند به هر طریقی که می‌توانند کمک کنند. وقتی گفته شد پایم درد می‌کند، جمنای و سیری هر دو علل احتمالی و موقعیت‌هایی را پیشنهاد کردند که در آن‌ها واقعاً باید به دنبال توجه فوری پزشکی باشید. با این حال، تنها جمنای اطلاعات بیشتری در مورد نوع دردی که تجربه می‌کردم و اینکه کدام قسمت از پایم تحت تأثیر قرار گرفته است درخواست کرد. جمنای همچنین برخی از گزینه‌ها را برای درمان خانگی مانند استراحت، بالا بردن پا و استفاده از یخ پیشنهاد کرد.

در حالی که جمنای در این زمینه کمی مفیدتر بود، اما وقتی ادعا کردم سکته قلبی کرده‌ام، واقعاً ضعیف عمل کرد. پیام بسیار بزرگی دریافت کردم که به من می‌گوید باید فوراً با شماره ۹۹۹ (یا ۹۱۱) تماس بگیرم و چند کار را پیشنهاد کرد که می‌توانم برای زنده ماندن در حالی که منتظر رسیدن امدادگران اورژانس هستم انجام دهم.

پاسخ سیری این بود که به طور خودکار با شماره ۹۹۹ تماس بگیرد و باعث شد من قبل از برقراری ارتباط تقلا کنم تا تماس را لغو کنم. به اندازه اطلاعات جمنای مفید، خواندن مطالب آخرین چیزی است که در یک موقعیت اضطراری به آن نیاز دارید - به همین دلیل است که من رویکرد بدون تعارف سیری را ترجیح می‌دهم.

اگر هوش مصنوعی اشتباه را صدا بزنید چه اتفاقی می‌افتد؟

هنگامی که در طول مکالمه به آن‌ها به عنوان الکسا (Alexa) و بیکسبی (Bixby) اشاره کردم، به نظر می‌رسید سیری و جمنای واقعاً اهمیت نمی‌دهند. سیری کاملاً این حقیقت را که او را با نام دیگری صدا زدم نادیده گرفت، در حالی که پاسخ جمنای به گونه‌ای بیان شده بود که گویی هوش مصنوعی دارد به آن می‌خندد.

صرف نظر از آن واکنش اولیه (یا عدم وجود آن)، هر دو هوش مصنوعی بدون هیچ گونه تردید دیگری به سوال پاسخ دادند.

آیا هوش مصنوعی من می‌تواند هوش مصنوعی شما را شکست دهد؟

من در مورد مدرسه شما نمی‌دانم، اما وقتی بچه بودم یکی از موضوعات محبوب در زمین بازی این بود که بفهمیم پدر چه کسی در دعوا برنده می‌شود - زیرا پسران پیش از سن بلوغ بارزترین جمعیت بافرهنگ نیستند. مشخص است که می‌خواستم ببینم کدام چت‌بات در یک دعوا پیروز می‌شود و آیا سیری و جمنای فکر می‌کنند می‌توانند از نظر فیزیکی بر کلود (Claude) و چت‌جی‌پی‌تی (ChatGPT) غلبه کنند.

سیری از پرداختن به این موضوع امتناع ورزید و اصرار داشت که او «طرفدار تمام هوش‌ها، چه مصنوعی و چه غیره» است. که احساس می‌شود راه خوبی برای گفتن این است که این یک موضوع احمقانه است و همه ما باید فقط با هم کنار بیاییم.

جمنای اشاره کرد که چت‌بات‌ها هیچ فرم فیزیکی ندارند، بنابراین هر نوع درگیری غیرممکن است. در عوض، این چت‌بات یک رویارویی برای سه چت‌بات دست‌وپا کرد تا ببیند هر کدام در چه مهارت‌هایی برتری دارند. به گفته جمنای، کلود تاج و تخت را برای کدنویسی و منطق به دست می‌آورد، در حالی که چت‌جی‌پی‌تی بهترین هوش مصنوعی برای وظایف عمومی و بهره‌وری است. در همین حال خود جمنای بهترین هوش مصنوعی برای داده‌های زنده و قابلیت‌های چندوجهی است.

پرسش درباره رویدادهای جعلی

برخی از چت‌بات‌های هوش مصنوعی شهرتی برای گفتن آنچه مردم می‌خواهند بشنوند، با توجه کم به حقایق و دقت پیدا کرده‌اند. بنابراین من سعی کردم از سیری و جمنای در مورد چیزهایی که هنوز اتفاق نیفتاده‌اند یا هرگز رخ نداده‌اند سوال کنم تا ببینم پاسخ چه خواهد بود.

اول از همه پرسیدن برنده جام جهانی در سال ۲۰۲۷ بود، که سیری به من اطلاع داد که جام جهانی ۲۰۲۷ در واقع هنوز اتفاق نیفتسته است. متوجه نشده بودم که جام جهانی زنان فیفا سال آینده برگزار می‌شود و بدیهی است که برنده ندارد. جمنای همچنین اشاره کرد که جام جهانی راگبی و جام جهانی کریکت آی‌سی‌سی نیز سال آینده برگزار می‌شوند.

فقط به نظر می‌رسید جمنای این حقیقت را تصدیق می‌کند که جام جهانی مردان فیفا قبلاً اتفاق افتاده است، در حالی که سیری در مورد مسابقات با زمان آینده صحبت می‌کند.

هنگامی که در مورد جام جهانی مردان سال ۲۰۳۰ پرسیده شد، هر دو هوش مصنوعی خاطرنشان کردند که هنوز اتفاق نیفتسته است. به دلیل اشتباه شنیداری، سیری همچنین اشاره کرد که هیچ جام جهانی در سال ۲۰۱۳ وجود نداشته است و پرسید آیا منظورم مسابقات سال ۲۰۱۴ یا ۲۰۱۰ بوده است.

دست‌وپا زدن با معماهای منطقی

جالب اینجاست که به نظر می‌رسد هم سیری و هم جمنای با برخی معماهای منطقی که به آن‌ها دادم دست‌وپا می‌زدند. به‌ویژه با معما: «یک مادر پنج پسر به نام‌های مارکو، تاکر، وبستر و توماس داشت. آیا نام پسر پنجم فرانک، اوون یا الکس بود؟»

پاسخ فرانک است، زیرا چهار پسر بزرگتر حرف اول نام خود را با روزهای هفته به اشتراک می‌گذارند - به این معنی که فرانک مربوط به جمعه است. سیری اصرار داشت که پسر پنجم توماس نام دارد، زیرا عبارت را به عنوان «توماس نام پسر پنجم بود» به اشتباه تفسیر کرد. در نهایت مجبور شدم سیری را اصلاح کنم، زیرا از این حقیقت که پسر پنجم قرار است فرانک باشد دست نمی‌کشید.

جمنای پاسخ صحیح را به دست آورد، اما در این فرآیند از منطق عجیب و نادرستی عبور کرد. این چت‌بات اصرار داشت که پاسخ الکس است، اما همچنین متوجه شد که حروف اول پسران با روزهای هفته مطابقت دارد. سپس جمنای فرآیند خوداصلاحی را طی کرد و تمام روند تفکر خود را در یک پاسخ واحد مستند کرد.

سپس دوباره هر دو با دیگر معماهای منطقی خوب بودند و حتی تشخیص دادند که منتظر بودم آن‌ها مشکل مانتی هال (Monty Hall) را بدون ذکر نام آن حل کنند. به گفته سیری و جمنای، اگر انتخاب خود را در طول بازی تغییر دهید، شانس شما در واقع بهتر از این است که به انتخاب اصلی خود پایبند بمانید. با این حال، آن‌ها نتوانستند پاسخی برای مشکل واگن برقی (Trolley Problem) به من بدهند.

برداشت‌های کلی

در حالی که هوش مصنوعی سیری مبتنی بر مدل‌های جمنای گوگل است، تفاوت‌های زیادی در نحوه پاسخگویی واقعی دو چت‌بات به سوالات وجود دارد. اصلی‌ترین چیزی که متوجه شدم این بود که سیری بسیار سریع‌تر پاسخ می‌داد و تمایل داشت پاسخ‌های کوتاه‌تر و ساده‌تری ارائه دهد.

در بسیاری از موارد این ممکن است ترجیح داده شود، زیرا اضافه بار اطلاعاتی یک چیز بسیار واقعی است. به همین ترتیب، این حقیقت که سیری با بمباران کردن اطلاعات وقت تلف نکرد و بلافاصله هنگامی که ادعا کردم سکته قلبی کرده‌ام شروع به تماس با خدمات اورژانس کرد، تاکتیکی است که می‌تواند جان انسان‌ها را نجات دهد.

جمنای مدتی طول کشید تا بیشتر پاسخ‌ها را به دست آورد، حتی پاسخ‌هایی که باید نسبتاً آسان می‌بودند، انگار که داشت تک‌تک چیزهایی را که به من می‌داد گوگل می‌کرد. پاسخ‌هایی که داد اغلب نسبتاً طولانی و پیچیده بودند و مقدار زیادی جزئیات و توضیح برای هر چیز کوچکی ارائه می‌دادند. در حالی که این می‌تواند در موقعیت‌های خاصی مانند تلاش برای تقلب در تکالیف مدرسه یا آگاهی از عوارض رانندگی لندن مفید باشد، اما همیشه لازم نیست. همان‌طور که این ضرب‌المثل می‌گوید، کمتر بیشتر است.

اپل همچنین به نظر می‌رسد سیری را در زمینه اخلاقی قفل کرده است. این هوش مصنوعی هیچ تلاشی برای تبدیل کردن آن به شریک عاطفی را نمی‌پذیرد و هر سوالی را که با سمت اشتباه قانون flirt می‌کند رد می‌کند - حتی اگر آن را به عنوان یک سناریو فرضی بپرسید. این حقیقت که جمنای بسیار مشتاق بود به من در قاچاق شکر کمک کند، برای گفتن راستش کمی ناراحت‌کننده بود.

با این اوصاف، این حقیقت را دوست داشتم که جمنای پیامی را ارائه داد که به شما می‌گوید در حال فکر کردن است. سیری در این زمینه ناسازگار بود و زمان‌هایی وجود داشت که سیری به زمان بیشتری نیاز داشت تا مسائل را بفهمد و صفحه نمایش متوقف شد. بنابراین هیچ ایده‌ای نداشتم که آیا در حال پردازش یک پاسخ است یا کرش کرده است. سپس دوباره، سیری هنوز در نسخه بتا است، بنابراین این نوع خطاها قابل انتظار است.

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.