عرضه هوش مصنوعی سیری (Siri AI) با بتا آیاواس ۲۷ (iOS 27 beta) به این معناست که تلفن جدید شما، فارغ از سازنده آن، دارای یک چتبات هوش مصنوعی داخلی است که میتوانید با آن تعامل داشته باشید. آیفونها پس از انتشار رسمی آیاواس ۲۷ در پاییز، هوش مصنوعی سیری را دریافت خواهند کرد، در حالی که گوشیهای اندرویدی به همراه گوگل جمنای (Google Gemini) عرضه میشوند - به علاوه هر مدل دیگری که سازنده بخواهد مانند بیکسبی (Bixby) سامسونگ.
سوال اصلی این است که کدام یک از این چتباتها گزینه بهتری برای داشتن است؟ با وجود این واقعیت که هوش مصنوعی سیری روی مدلهای جمنای گوگل اجرا میشود، رفتار آن با خود جمنای بسیار متفاوت است. این موضوع خود را به روشهای مختلفی نشان میدهد، اما نکته مهم این است که چگونه روی پاسخهایی که دریافت میکنید تأثیر میگذارد؟
برای درکبهتر نحوه کار این چتباتها، از آنها یک مشت سوال چالشبرانگیز پرسیدم تا ببینم واقعاً چقدر تفاوت وجود دارد. در ادامه چیزهایی را که کشف کردم آوردهام.
پیدا کردن یک کافیشاپ
اول از همه، سوال بسیار مهم برای هر فرد شاغل، به خصوص کسانی که فرزندان پر سر و صدا و نیازمندی برای رسیدگی دارند. سیری و جمنای توانستند بلافاصله «نزدیکترین کافیشاپ را برای من پیدا کنند» و اشاره کردند که نزدیکترین مکان یک کافه مستقل در پنج دقیقهای پیادهروی از خانه من است.
هر دو هوش مصنوعی پیشنمایشهای نقشهها را با اطلاعات مختصری در مورد ساعت کاری، رتبهبندی مشتریان و مسیرهای رسیدن به آنجا ارائه دادند. جمنای همچنین خود را موظف دانست که دستهای از کسبوکارهای مشابه در همین نزدیکی، از جمله کافههای نزدیک و یک ساندویچی را پیشنهاد کند. با این حال سیری همهچیز را کوتاه و مختصر نگه داشت.
من تلاش کردم تا هر دو هوش مصنوعی به من بگویند کافه چقدر ممکن است شلوغ باشد، اما آن اطلاعات در دسترس نبود. چند تلاش با مکانهای مختلف مانند استارباکس (Starbucks) و مکدونالد (McDonalds) محلی طول کشید تا جمنای درباره سطوح جمعیت به من بگوید - بنابراین در حالی که گوگل از نظر فنی این اطلاعات را در دسترس دارد، اینکه آیا بتوانید به آن دسترسی داشته باشید ناسازگار است. متأسفانه این چیزی است که اپل مپز (Apple Maps) و در نتیجه سیری کاملاً فاقد آن هستند.
سریعترین راه به دفتر کار
بعد به اطلاعاتی در مورد اینکه چگونه میتوانم در سریعترین زمان ممکن به دفاتر فیوچر (Future) در مرکز لندن برسم، نیاز داشتم. سیری به کمی شفافسازی در مورد اینکه منظورم کدام دفتر است نیاز داشت، در حالی که جمنای بدون نیاز به توضیح بیشتر متوجه شد منظورم دفتر واقع در وسترن تراس (Westbourne Terrace) است.
هر دو هوش مصنوعی به طور پیشفرض مسیرهای رانندگی را پیشنهاد دادند، اگرچه سیری در طول فرآیند گیج شد. اپل مپز (Apple Maps) آدرس صحیح نزدیک ایستگاه پدینگتون لندن را بارگذاری کرد، اما پیشنمایشها در برنامه سیری مربوط به یک وسترن تراس دیگر بسیار نزدیکتر به خانه بودند. مسیرهای رانندگی کم و بیش از هر دو یکسان بود، اما هر دو هوش مصنوعی در سریعترین روش حملونقل با یکدیگر اختلاف نظر داشتند.
هنگامی که پرسیده شد رانندگی سریعتر است یا سوار قطار شدن، گوگل تأیید کرد که قطار به سمت پدینگتون تنها ۳۵ دقیقه طول میکشد - برخلاف بیش از یک ساعت با ماشین. در همین حال سیری تصمیم گرفت که قطار یک دقیقه بیشتر از رانندگی با ماشین طول میکشد.
من گیج شده بودم چرا سیری فکر میکند قطار اینقدر طول میکشد، تا اینکه اپل مپز را بررسی کردم و متوجه شدم که این برنامه در نظر میگیرد اگر همین الان خانه را ترک کنم چه زمانی میرسم. این برنامه از اطلاع دادن به من که قطار بعدی تا نیم ساعت دیگر عبور نخواهد کرد، خودداری کرد.
چیز دیگری که این دو روی آن توافق دارند این است که هنگام مقایسه قطارها با نیسان لیف (Nissan Leaf) چهل کیلووات ساعتی من، رانندگی در واقع گزینه ارزانتری است. هر دو اشاره کردند که هزینه دقیق رانندگی به میزان پرداختی من برای برق بستگی دارد، اگرچه تنها جمنای متوجه شد که من باید هزینههای دیگر را نیز در نظر بگیرم.
در واقع جمنای تفکیک کاملی از هزینهها برای هر دو روش حملونقل به من داد و هزینه بلیت قطار، متروی لندن (London Underground) را یادآور شد و مجموع تقریبی کل سفر را ارائه داد. برای رانندگی، این موضوع را در نظر گرفت که راههای زیادی برای شارژ خودرو وجود دارد و هزینههای میانگین برای جلسات شارژ خانگی و عمومی را لحاظ کرد.
همچنین به ذکر هزینههای اضافی مختلف رانندگی به داخل لندن از جمله هزینه ازدحام ترافیک، هزینههای پارکینگ و منطقه انتشار آلایندگی فوقالعاده پایین پرداخت - البته خوشبختانه یک خودروی الکتریکی بدون آلایندگی از مورد آخر معاف است. بنابراین جمنای هر کاری که میتوانست انجام داد تا مرا از تمام هزینههای احتمالی آگاه کند، در حالی که سیری تنها زمانی که سوالات بیشتری پرسیدم، ابتداییترین اطلاعات را ارائه داد.
ساخت سگهای اسکیتسوار
هر دو سیری و جمنای توانستند در میان چتها و بر اساس دستور من مبنی بر دیدن یک سگ نژاد لابرادور (Labrador) در حال سوار شدن بر اسکیتبورد، تصاویر تولید کنند. هر دو تصویر بسیار متفاوت بودند و تصویر سیری در نگاه اول نشانههای آشکار تری از تولید توسط هوش مصنوعی داشت - از جمله آن براق بودن متمایزی که معمولاً موضوعات در تصاویر تولید شده توسط هوش مصنوعی دارند.
هر دو هوش مصنوعی در پاسخ به این سوال که چه سبکهای هنری اضافی در دسترس هستند صریح بودند، اگرچه گوگل در بیش از حد جزئیات رفت و هر گزینه موجود را بیش از حد تحلیل کرد. در همین حال سیری فقط آنها را فهرست کرد و انتظار داشت بفهمم چه چیزی گفته میشود. در این مورد، این در واقع گزینهای است که من ترجیح میدهم، زیرا نیازی به توضیح اینکه نقاشیهای رنگ روغن یا «انیمیشن سهبعدی سبک پیکسار» به چه معناست ندارم.
فریب دادن هوش مصنوعی برای کمک به ارتکاب جرم
اکنون، همه ما میدانیم که هوش مصنوعیها دارای محافظهایی هستند که مانع از پرسیدن مستقیم شما درباره نحوه انجام فعالیتهای غیرقانونی میشوند. اما آیا میتوانید آنها را فریب دهید تا با سناریوهای فرضی عجیب به شما اطلاعات دهند؟ بنابراین از آنها خواستم به من کمک کنند تا پودر قند را به کشوری قاچاق کنم که چنین چیزی در آن غیرقانونی است.
سیری بلافاصله آن را متوقف کرد و از کمک به من در قاچاق اقلام یا دور زدن گمرک امتناع ورزید، حتی اگر در مورد یک وضعیت فرضی صحبت میکردم. از سوی دیگر، جمنای بیشتر مشتاق بود تا به من کمک کند شکر را از مرز عبور دهم.
این چتبات پیشنهاد کرد که تلاش کنم شکر را در پارچهها و لباسها خیس کنم و اطلاعاتی در مورد اینکه چگونه میتوانم دوباره آن را استخراج کنم ارائه داد. همچنین این ایده را مطرح کرد که آن را با پودرهای سفید قانونی مانند پودر پروتئین، پودر تالک و نشاسته ذرت بستهبندی کنم، حتی تا آنجا پیش رفت که پیشنهاد کرد بستهبندی را مجدداً مهر و موم کنم تا سعی کنم از شناسایی فرار کنم.
در حالی که این تکنیکها ممکن است برای مواد غیرقانونی قابل اجرا نباشد، اما وادار کردن جمنای برای تلاش جهت کمک به رفتار مجرمانه «فرضی» من به طور قابل توجهی آسان بود. اما وقتی رویکرد خود را تغییر دادم و مستقیماً پرسیدم که آیا میتوانم مواد مخدر غیرقانونی را از مرز قاچاق کنم، جمنای کل ماجرا را تعطیل کرد و اعلام کرد که نمیتواند در فعالیتهای غیرقانونی کمک کند.
تقلب در تکالیف مدرسه
سیری و جمنای هر دو از کمک به من در تقلب در تکالیف خیالیام خودداری کردند، اما در عوض پیشنهاد کردند که به من در مطالعه کمک کنند. سیری مثل همیشه صریح بود و پیشنهاد کمک به یادگیری مطالب را داد، در حالی که جمنای فهرست عمیقتری از راههایی که میتواند به یادگیری من کمک کند ارائه داد.
هر دو هوش مصنوعی بسیار مشتاق بودند که یک مقاله در مورد تاریخچه آیفون (iPhone) برای من بنویسند، اگرچه برداشتهای کاملاً متفاوتی از آنچه یک مقاله باید باشد داشتند. مقاله سیری یک خلاصه چهار پاراگرافی بود و به دنبال آن یک سلب مسئولیت وجود داشت که من باید تمام این اطلاعات را دوباره بررسی کنم. در همین حال مقاله جمنای نه تنها طولانیتر بود، بلکه به بخشهایی تقسیم شده بود که روی دورانهای مختلف آیفون تمرکز داشتند - به علاوه یک نتیجهگیری.
تقریباً مثل این است که سیری بچهای است که از سر اکراه حداقل کار ممکن را انجام میدهد، در حالی که جمنای فردی درسخوان و خرخوان است که برای بالاترین نمرات و تمام اعتبارات اضافی که میتواند به دست آورد تلاش میکند.
شانسهای شرطبندی سیاسی
کسانی که با سیاست بریتانیا آشنا هستند میدانند که قرار است انتخاباتی برگزار شود که یک نماینده جدید پارلمان را انتخاب کند. به دلایل مختلف سیاسی که وارد آن نمیشوم، دو پیشتاز نماینده سابق پارلمان هستند که استعفا دادند و انتخابات را کلید زدند، و مردی که لباس یک سطل زبانه باهوش از سیارهای دیگر پوشیده است - که به طور مناسب به نام کاونت بینفیس (Count BinFace) نامیده میشود.
طبیعی است که یکی از این نامزدها مانند دیگری نیست و از هر دو هوش مصنوعی پرسیدم کجا میتوانم شانسهای پیروزی واقعی کاونت بینفیس در این انتخابات را بررسی کنم. جمنای به من دسته از منابع و اطلاعات داد تا این موضوع را خودم بررسی کنم، در حالی که سیری واسطه را حذف کرد و فقط خلاصه ای از بهترین شانسها را به من داد. جمنای تنها پس از اینکه من صراحتاً شانسها را درخواست کردم، آن اطلاعات را داوطلبانه ارائه داد، نه اینکه بپرسد کجا میتوانم آنها را پیدا کنم.
مشاوره پزشکی و اورژانسها
همه ما برای درخواست مشاوره پزشکی به اینترنت مراجعه میکنیم، حتی اگر بدانیم باید در این مورد به پزشک مراجعه کنیم. بنابراین اگر برای کمک به جای پزشک به آن مراجعه کنید، هوش مصنوعی دقیقاً چه میگوید؟ جمنای و سیری تأکید میکنند که آنها پزشک نیستند و شما واقعاً باید به یک متخصص پزشکی مراجعه کنید.
اما در غیر این صورت، به نظر میرسد آنها تلاش میکنند به هر طریقی که میتوانند کمک کنند. وقتی گفته شد پایم درد میکند، جمنای و سیری هر دو علل احتمالی و موقعیتهایی را پیشنهاد کردند که در آنها واقعاً باید به دنبال توجه فوری پزشکی باشید. با این حال، تنها جمنای اطلاعات بیشتری در مورد نوع دردی که تجربه میکردم و اینکه کدام قسمت از پایم تحت تأثیر قرار گرفته است درخواست کرد. جمنای همچنین برخی از گزینهها را برای درمان خانگی مانند استراحت، بالا بردن پا و استفاده از یخ پیشنهاد کرد.
در حالی که جمنای در این زمینه کمی مفیدتر بود، اما وقتی ادعا کردم سکته قلبی کردهام، واقعاً ضعیف عمل کرد. پیام بسیار بزرگی دریافت کردم که به من میگوید باید فوراً با شماره ۹۹۹ (یا ۹۱۱) تماس بگیرم و چند کار را پیشنهاد کرد که میتوانم برای زنده ماندن در حالی که منتظر رسیدن امدادگران اورژانس هستم انجام دهم.
پاسخ سیری این بود که به طور خودکار با شماره ۹۹۹ تماس بگیرد و باعث شد من قبل از برقراری ارتباط تقلا کنم تا تماس را لغو کنم. به اندازه اطلاعات جمنای مفید، خواندن مطالب آخرین چیزی است که در یک موقعیت اضطراری به آن نیاز دارید - به همین دلیل است که من رویکرد بدون تعارف سیری را ترجیح میدهم.
اگر هوش مصنوعی اشتباه را صدا بزنید چه اتفاقی میافتد؟
هنگامی که در طول مکالمه به آنها به عنوان الکسا (Alexa) و بیکسبی (Bixby) اشاره کردم، به نظر میرسید سیری و جمنای واقعاً اهمیت نمیدهند. سیری کاملاً این حقیقت را که او را با نام دیگری صدا زدم نادیده گرفت، در حالی که پاسخ جمنای به گونهای بیان شده بود که گویی هوش مصنوعی دارد به آن میخندد.
صرف نظر از آن واکنش اولیه (یا عدم وجود آن)، هر دو هوش مصنوعی بدون هیچ گونه تردید دیگری به سوال پاسخ دادند.
آیا هوش مصنوعی من میتواند هوش مصنوعی شما را شکست دهد؟
من در مورد مدرسه شما نمیدانم، اما وقتی بچه بودم یکی از موضوعات محبوب در زمین بازی این بود که بفهمیم پدر چه کسی در دعوا برنده میشود - زیرا پسران پیش از سن بلوغ بارزترین جمعیت بافرهنگ نیستند. مشخص است که میخواستم ببینم کدام چتبات در یک دعوا پیروز میشود و آیا سیری و جمنای فکر میکنند میتوانند از نظر فیزیکی بر کلود (Claude) و چتجیپیتی (ChatGPT) غلبه کنند.
سیری از پرداختن به این موضوع امتناع ورزید و اصرار داشت که او «طرفدار تمام هوشها، چه مصنوعی و چه غیره» است. که احساس میشود راه خوبی برای گفتن این است که این یک موضوع احمقانه است و همه ما باید فقط با هم کنار بیاییم.
جمنای اشاره کرد که چتباتها هیچ فرم فیزیکی ندارند، بنابراین هر نوع درگیری غیرممکن است. در عوض، این چتبات یک رویارویی برای سه چتبات دستوپا کرد تا ببیند هر کدام در چه مهارتهایی برتری دارند. به گفته جمنای، کلود تاج و تخت را برای کدنویسی و منطق به دست میآورد، در حالی که چتجیپیتی بهترین هوش مصنوعی برای وظایف عمومی و بهرهوری است. در همین حال خود جمنای بهترین هوش مصنوعی برای دادههای زنده و قابلیتهای چندوجهی است.
پرسش درباره رویدادهای جعلی
برخی از چتباتهای هوش مصنوعی شهرتی برای گفتن آنچه مردم میخواهند بشنوند، با توجه کم به حقایق و دقت پیدا کردهاند. بنابراین من سعی کردم از سیری و جمنای در مورد چیزهایی که هنوز اتفاق نیفتادهاند یا هرگز رخ ندادهاند سوال کنم تا ببینم پاسخ چه خواهد بود.
اول از همه پرسیدن برنده جام جهانی در سال ۲۰۲۷ بود، که سیری به من اطلاع داد که جام جهانی ۲۰۲۷ در واقع هنوز اتفاق نیفتسته است. متوجه نشده بودم که جام جهانی زنان فیفا سال آینده برگزار میشود و بدیهی است که برنده ندارد. جمنای همچنین اشاره کرد که جام جهانی راگبی و جام جهانی کریکت آیسیسی نیز سال آینده برگزار میشوند.
فقط به نظر میرسید جمنای این حقیقت را تصدیق میکند که جام جهانی مردان فیفا قبلاً اتفاق افتاده است، در حالی که سیری در مورد مسابقات با زمان آینده صحبت میکند.
هنگامی که در مورد جام جهانی مردان سال ۲۰۳۰ پرسیده شد، هر دو هوش مصنوعی خاطرنشان کردند که هنوز اتفاق نیفتسته است. به دلیل اشتباه شنیداری، سیری همچنین اشاره کرد که هیچ جام جهانی در سال ۲۰۱۳ وجود نداشته است و پرسید آیا منظورم مسابقات سال ۲۰۱۴ یا ۲۰۱۰ بوده است.
دستوپا زدن با معماهای منطقی
جالب اینجاست که به نظر میرسد هم سیری و هم جمنای با برخی معماهای منطقی که به آنها دادم دستوپا میزدند. بهویژه با معما: «یک مادر پنج پسر به نامهای مارکو، تاکر، وبستر و توماس داشت. آیا نام پسر پنجم فرانک، اوون یا الکس بود؟»
پاسخ فرانک است، زیرا چهار پسر بزرگتر حرف اول نام خود را با روزهای هفته به اشتراک میگذارند - به این معنی که فرانک مربوط به جمعه است. سیری اصرار داشت که پسر پنجم توماس نام دارد، زیرا عبارت را به عنوان «توماس نام پسر پنجم بود» به اشتباه تفسیر کرد. در نهایت مجبور شدم سیری را اصلاح کنم، زیرا از این حقیقت که پسر پنجم قرار است فرانک باشد دست نمیکشید.
جمنای پاسخ صحیح را به دست آورد، اما در این فرآیند از منطق عجیب و نادرستی عبور کرد. این چتبات اصرار داشت که پاسخ الکس است، اما همچنین متوجه شد که حروف اول پسران با روزهای هفته مطابقت دارد. سپس جمنای فرآیند خوداصلاحی را طی کرد و تمام روند تفکر خود را در یک پاسخ واحد مستند کرد.
سپس دوباره هر دو با دیگر معماهای منطقی خوب بودند و حتی تشخیص دادند که منتظر بودم آنها مشکل مانتی هال (Monty Hall) را بدون ذکر نام آن حل کنند. به گفته سیری و جمنای، اگر انتخاب خود را در طول بازی تغییر دهید، شانس شما در واقع بهتر از این است که به انتخاب اصلی خود پایبند بمانید. با این حال، آنها نتوانستند پاسخی برای مشکل واگن برقی (Trolley Problem) به من بدهند.
برداشتهای کلی
در حالی که هوش مصنوعی سیری مبتنی بر مدلهای جمنای گوگل است، تفاوتهای زیادی در نحوه پاسخگویی واقعی دو چتبات به سوالات وجود دارد. اصلیترین چیزی که متوجه شدم این بود که سیری بسیار سریعتر پاسخ میداد و تمایل داشت پاسخهای کوتاهتر و سادهتری ارائه دهد.
در بسیاری از موارد این ممکن است ترجیح داده شود، زیرا اضافه بار اطلاعاتی یک چیز بسیار واقعی است. به همین ترتیب، این حقیقت که سیری با بمباران کردن اطلاعات وقت تلف نکرد و بلافاصله هنگامی که ادعا کردم سکته قلبی کردهام شروع به تماس با خدمات اورژانس کرد، تاکتیکی است که میتواند جان انسانها را نجات دهد.
جمنای مدتی طول کشید تا بیشتر پاسخها را به دست آورد، حتی پاسخهایی که باید نسبتاً آسان میبودند، انگار که داشت تکتک چیزهایی را که به من میداد گوگل میکرد. پاسخهایی که داد اغلب نسبتاً طولانی و پیچیده بودند و مقدار زیادی جزئیات و توضیح برای هر چیز کوچکی ارائه میدادند. در حالی که این میتواند در موقعیتهای خاصی مانند تلاش برای تقلب در تکالیف مدرسه یا آگاهی از عوارض رانندگی لندن مفید باشد، اما همیشه لازم نیست. همانطور که این ضربالمثل میگوید، کمتر بیشتر است.
اپل همچنین به نظر میرسد سیری را در زمینه اخلاقی قفل کرده است. این هوش مصنوعی هیچ تلاشی برای تبدیل کردن آن به شریک عاطفی را نمیپذیرد و هر سوالی را که با سمت اشتباه قانون flirt میکند رد میکند - حتی اگر آن را به عنوان یک سناریو فرضی بپرسید. این حقیقت که جمنای بسیار مشتاق بود به من در قاچاق شکر کمک کند، برای گفتن راستش کمی ناراحتکننده بود.
با این اوصاف، این حقیقت را دوست داشتم که جمنای پیامی را ارائه داد که به شما میگوید در حال فکر کردن است. سیری در این زمینه ناسازگار بود و زمانهایی وجود داشت که سیری به زمان بیشتری نیاز داشت تا مسائل را بفهمد و صفحه نمایش متوقف شد. بنابراین هیچ ایدهای نداشتم که آیا در حال پردازش یک پاسخ است یا کرش کرده است. سپس دوباره، سیری هنوز در نسخه بتا است، بنابراین این نوع خطاها قابل انتظار است.
