آونگ، گارانتی بی‌رقیب — از سال ۱۳۸۵
مرکز پاسخگویی1665 استعلام پیامکی 100001665
مجله آونگ

چت‌بات‌های هوش مصنوعی در پاسخ به پرسش‌های مالی چندان قابل اعتماد نیستند

چت‌بات‌های هوش مصنوعی در پاسخ‌های مالی خطا می‌کنند
آنـچه در این مقاله می‌خوانیم

یک بررسی گسترده روی مدل‌های محبوب هوش مصنوعی نشان می‌دهد این ابزارها در پاسخ به پرسش‌های مالی، نرخ خطای قابل‌توجهی دارند و در مسائل پیچیده‌تر حتی ممکن است کاربر را به تصمیمی پرهزینه هدایت کنند.

هوش مصنوعی دیگر فقط ابزاری برای نوشتن متن، ساخت تصویر یا پاسخ به پرسش‌های عمومی نیست. خیلی از کاربران حالا از ChatGPT، Gemini، Claude و سایر چت‌بات‌ها برای کارهایی مثل برنامه‌ریزی هزینه‌ها، محاسبه مالیات، بررسی سرمایه‌گذاری و حتی تصمیم‌گیری درباره بازنشستگی استفاده می‌کنند.

مشکل از جایی شروع می‌شود که یک پاسخ ظاهراً دقیق و مطمئن، در واقع اشتباه باشد. در موضوعات مالی، چنین خطایی می‌تواند خیلی بیشتر از یک پاسخ غلط معمولی هزینه داشته باشد.

یک آزمایش گسترده، ضعف هوش مصنوعی در مسائل مالی را نشان می‌دهد

برای بررسی میزان دقت مدل‌های هوش مصنوعی در این حوزه، بیش از ۱۰۰ پرسش مالی مختلف در مجموعه‌ای شامل حدود ۱۰ هزار آزمایش مورد ارزیابی قرار گرفت. در این بررسی ۱۸ مدل رایگان و اشتراکی مورد آزمایش قرار گرفتند.

نتیجه چندان امیدوارکننده نبود. مدل‌ها به‌طور میانگین در ۵۷ درصد از پرسش‌های مالی پاسخ درست ارائه نکردند. این یعنی تقریباً از هر دو پرسش، یکی می‌تواند پاسخی دریافت کند که نیازمند بررسی بیشتر باشد.

اما وقتی پرسش‌ها به محاسبات چندمرحله‌ای یا تحلیل پیچیده‌تر نیاز داشتند، شرایط بدتر شد. میانگین نرخ خطا در این بخش به ۸۸ درصد رسید و عملکرد برخی مدل‌ها حتی به خطا در ۹۹ درصد سناریوهای آزمایش‌شده منتهی شد.

این نتایج یک نکته مهم را نشان می‌دهد: افزایش توانایی عمومی یک چت‌بات لزوماً به این معنی نیست که می‌توان پاسخ‌های آن را در مسائل مالی بدون بررسی پذیرفت.

وقتی یک پاسخ اشتباه هزاران پوند هزینه دارد

اشتباه هوش مصنوعی در یک سؤال ساده شاید فقط باعث شود کاربر دوباره جست‌وجو کند، اما در مسائل مالی ممکن است نتیجه کاملاً متفاوت باشد.

یکی از نمونه‌های مطرح‌شده در این تحقیق به قوانین مالیاتی بازنشستگی در بریتانیا مربوط می‌شود. یکی از مدل‌ها اطلاعاتی نادرست درباره این قوانین ارائه کرد؛ اشتباهی که در صورت عمل کردن کاربر بر اساس آن، می‌توانست جریمه‌ای حدود ۱۷ هزار و ۵۰۰ پوند از سوی HMRC به دنبال داشته باشد.

این مثال به‌خوبی نشان می‌دهد چرا استفاده از چت‌بات برای دریافت اطلاعات مالی نیازمند احتیاط است. قوانین مالیاتی و مقررات اقتصادی ثابت نیستند و ممکن است در طول زمان تغییر کنند. بنابراین حتی اگر یک مدل قبلاً درباره موضوعی پاسخ درستی داده باشد، نمی‌توان مطمئن بود که همان پاسخ در زمان دیگری نیز معتبر است.

مشکل فقط در محاسبات نیست

یکی از اشتباهاتی که در ارزیابی مدل‌ها مشاهده شد، محاسبات نادرست بود؛ اما مسئله به اعداد و فرمول‌ها محدود نمی‌شود.

مدل‌های زبانی گاهی اطلاعاتی تولید می‌کنند که در ظاهر کاملاً منطقی به نظر می‌رسد، اما منبع یا مبنای واقعی ندارد. این اتفاق در موضوعاتی مانند قوانین مالیاتی خطرناک‌تر است، زیرا ممکن است چت‌بات جزئیات یک مقررات را اشتباه بیان کند یا حتی به قانونی اشاره کند که اساساً وجود ندارد.

از طرف دیگر، مدل‌های هوش مصنوعی معمولاً پاسخ خود را با لحنی قطعی ارائه می‌کنند. کاربر غیرمتخصص ممکن است همین لحن را نشانه اطمینان پاسخ بداند؛ درحالی‌که مطمئن به نظر رسیدن یک جواب، تضمینی برای درست بودن آن نیست.

حتی مدل‌های قدرتمند هم خطای زیادی دارند

شاید اولین راه‌حل این باشد که برای پرسش‌های حساس سراغ مدل‌های پیشرفته‌تر و نسخه‌های پولی برویم. نتایج این پژوهش نشان می‌دهد این کار می‌تواند عملکرد را بهتر کند، اما مشکل را از بین نمی‌برد.

در میان مدل‌های بررسی‌شده، Claude Opus 5 در حالت استدلال و نسخه اشتراکی بهترین نتیجه را به دست آورد. بااین‌حال، این مدل نیز در ۳۹ درصد از موارد پاسخ نادرست ارائه کرد.

بنابراین حتی بهترین عملکرد ثبت‌شده در این آزمایش نیز فاصله قابل‌توجهی با دقتی دارد که بتوان بر اساس آن یک تصمیم مالی مهم را بدون بررسی بیشتر اتخاذ کرد.

چرا مردم همچنان از هوش مصنوعی مشاوره مالی می‌گیرند؟

سرعت و دسترسی آسان، یکی از دلایل اصلی محبوبیت این ابزارها است. کاربر می‌تواند در هر ساعت از شبانه‌روز سؤال خود را مطرح کند و در چند ثانیه پاسخی نسبتاً مفصل تحویل بگیرد.

از طرف دیگر، توضیح دادن مسائل پیچیده با زبان ساده یکی از قابلیت‌های جذاب چت‌بات‌ها است. برای مثال، کاربر می‌تواند از یک مدل بخواهد مفهوم یک اصطلاح مالی را توضیح دهد یا یک محاسبه ساده را مرحله‌به‌مرحله بررسی کند.

همین قابلیت‌ها باعث می‌شوند مرز بین «کمک گرفتن از هوش مصنوعی» و «اعتماد کردن به هوش مصنوعی» به‌راحتی از بین برود.

استفاده از این ابزار برای یادگیری یا دریافت یک توضیح اولیه با سپردن تصمیم نهایی به آن تفاوت زیادی دارد.

کارشناسان نسبت به جایگزین شدن چت‌بات‌ها با مشاوران مالی هشدار می‌دهند

امل جولی، مدیرعامل شرکت تحقیقاتی Saturn، معتقد است تعداد زیادی از مردم برای دریافت راهنمایی مالی سراغ ابزارهای هوش مصنوعی رفته‌اند؛ درحالی‌که پاسخ اشتباه این مدل‌ها می‌تواند برای کاربران هزینه ایجاد کند.

سارا کولز، مدیر امور مالی شخصی در پلتفرم سرمایه‌گذاری AJ Bell نیز از تجربه مشاورانی گفته است که با مشتریانی مواجه شده‌اند که تحت تأثیر پیشنهادهای هوش مصنوعی تصمیم‌های غیرمعمولی گرفته‌اند.

این دیدگاه‌ها یک موضوع مشترک دارند: چت‌بات می‌تواند در فرآیند تحقیق و جمع‌آوری اطلاعات مفید باشد، اما نباید صرفاً به دلیل ارائه پاسخ سریع و منسجم، جای متخصصی را بگیرد که مسئولیت بررسی شرایط فردی و مقررات مرتبط را بر عهده دارد.

مشاوره مالی با هوش مصنوعی چه وضعیتی دارد؟

موضوع دیگری که در این بحث مطرح می‌شود، مسئله نظارت است. طبق اظهارات مطرح‌شده در این گزارش، خدمات مشاوره مالی مبتنی بر هوش مصنوعی هنوز از نظر چارچوب‌های نظارتی با مشاوره سنتی قابل مقایسه نیستند.

برای نمونه، اگر یک مشاور انسانی تحت شرایط مشخصی توصیه‌ای ارائه دهد و این توصیه باعث ایجاد خسارت شود، ممکن است سازوکارهایی برای حمایت از مشتری وجود داشته باشد. اما در مورد یک چت‌بات، شرایط مسئولیت و جبران خسارت به این سادگی نیست.

نهاد ناظر بر امور مالی بریتانیا، FCA، بررسی این حوزه را آغاز کرده است. با گسترش استفاده از ابزارهای هوش مصنوعی در امور مالی، احتمالاً نحوه تنظیم مقررات مربوط به این فناوری نیز به موضوع مهم‌تری تبدیل خواهد شد.

چطور از هوش مصنوعی برای مسائل مالی استفاده کنیم؟

این یافته‌ها به این معنی نیست که باید استفاده از هوش مصنوعی در حوزه مالی را کاملاً کنار گذاشت. مسئله اصلی این است که بدانیم برای چه کاری از آن استفاده می‌کنیم.

چت‌بات‌ها می‌توانند برای توضیح اصطلاحات مالی، خلاصه کردن اطلاعات، آماده کردن پرسش‌هایی برای مشاور یا انجام محاسبات ابتدایی کاربرد داشته باشند. اما زمانی که پای سرمایه قابل‌توجه، مالیات، وام، بازنشستگی یا سرمایه‌گذاری در میان است، پاسخ چت‌بات نباید تنها مبنای تصمیم‌گیری باشد.

بهتر است اطلاعات حساس را از منابع رسمی و به‌روز بررسی کنید و در تصمیم‌های مهم، نظر یک متخصص واجد صلاحیت را نیز در نظر بگیرید. همچنین اگر پاسخ هوش مصنوعی شامل عدد، قانون یا مقررات مشخصی است، صحت آن را جداگانه بررسی کنید.

در واقع، بهترین روش استفاده از این فناوری این است که هوش مصنوعی را دستیار تحقیق بدانیم، نه مرجع نهایی تصمیم‌گیری.

هوش مصنوعی مفید است، اما بی‌خطا نیست

رشد سریع مدل‌های هوش مصنوعی باعث شده بسیاری از کارهایی که پیش‌تر به زمان یا تخصص بیشتری نیاز داشتند، ساده‌تر شوند. بااین‌حال، نتایج این پژوهش یادآوری می‌کند که توانایی تولید پاسخ سریع و طبیعی با دقت صددرصدی یکسان نیست.

به‌خصوص در موضوعاتی مثل امور مالی که یک اشتباه کوچک می‌تواند پیامد واقعی داشته باشد، بررسی منبع و صحت اطلاعات اهمیت بیشتری پیدا می‌کند.

همان‌طور که در استفاده از هر فناوری، انتخاب محصول معتبر و برخورداری از خدمات پس از فروش مناسب اهمیت دارد، در دنیای دیجیتال نیز اعتماد باید بر پایه اطلاعات قابل‌بررسی شکل بگیرد. گارانتی آونگ با ارائه خدمات گارانتی و پشتیبانی برای محصولات تحت پوشش، تلاش می‌کند تجربه استفاده از فناوری را برای کاربران مطمئن‌تر و آسوده‌تر کند.

آنـچه در این مقاله می‌خوانیم

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *