یک بررسی گسترده روی مدلهای محبوب هوش مصنوعی نشان میدهد این ابزارها در پاسخ به پرسشهای مالی، نرخ خطای قابلتوجهی دارند و در مسائل پیچیدهتر حتی ممکن است کاربر را به تصمیمی پرهزینه هدایت کنند.
هوش مصنوعی دیگر فقط ابزاری برای نوشتن متن، ساخت تصویر یا پاسخ به پرسشهای عمومی نیست. خیلی از کاربران حالا از ChatGPT، Gemini، Claude و سایر چتباتها برای کارهایی مثل برنامهریزی هزینهها، محاسبه مالیات، بررسی سرمایهگذاری و حتی تصمیمگیری درباره بازنشستگی استفاده میکنند.
مشکل از جایی شروع میشود که یک پاسخ ظاهراً دقیق و مطمئن، در واقع اشتباه باشد. در موضوعات مالی، چنین خطایی میتواند خیلی بیشتر از یک پاسخ غلط معمولی هزینه داشته باشد.
جدیدترین اخبار روز تکنولوژی در کانال تلگرام آونگ
یک آزمایش گسترده، ضعف هوش مصنوعی در مسائل مالی را نشان میدهد
برای بررسی میزان دقت مدلهای هوش مصنوعی در این حوزه، بیش از ۱۰۰ پرسش مالی مختلف در مجموعهای شامل حدود ۱۰ هزار آزمایش مورد ارزیابی قرار گرفت. در این بررسی ۱۸ مدل رایگان و اشتراکی مورد آزمایش قرار گرفتند.
نتیجه چندان امیدوارکننده نبود. مدلها بهطور میانگین در ۵۷ درصد از پرسشهای مالی پاسخ درست ارائه نکردند. این یعنی تقریباً از هر دو پرسش، یکی میتواند پاسخی دریافت کند که نیازمند بررسی بیشتر باشد.
اما وقتی پرسشها به محاسبات چندمرحلهای یا تحلیل پیچیدهتر نیاز داشتند، شرایط بدتر شد. میانگین نرخ خطا در این بخش به ۸۸ درصد رسید و عملکرد برخی مدلها حتی به خطا در ۹۹ درصد سناریوهای آزمایششده منتهی شد.
این نتایج یک نکته مهم را نشان میدهد: افزایش توانایی عمومی یک چتبات لزوماً به این معنی نیست که میتوان پاسخهای آن را در مسائل مالی بدون بررسی پذیرفت.
وقتی یک پاسخ اشتباه هزاران پوند هزینه دارد
اشتباه هوش مصنوعی در یک سؤال ساده شاید فقط باعث شود کاربر دوباره جستوجو کند، اما در مسائل مالی ممکن است نتیجه کاملاً متفاوت باشد.
یکی از نمونههای مطرحشده در این تحقیق به قوانین مالیاتی بازنشستگی در بریتانیا مربوط میشود. یکی از مدلها اطلاعاتی نادرست درباره این قوانین ارائه کرد؛ اشتباهی که در صورت عمل کردن کاربر بر اساس آن، میتوانست جریمهای حدود ۱۷ هزار و ۵۰۰ پوند از سوی HMRC به دنبال داشته باشد.
این مثال بهخوبی نشان میدهد چرا استفاده از چتبات برای دریافت اطلاعات مالی نیازمند احتیاط است. قوانین مالیاتی و مقررات اقتصادی ثابت نیستند و ممکن است در طول زمان تغییر کنند. بنابراین حتی اگر یک مدل قبلاً درباره موضوعی پاسخ درستی داده باشد، نمیتوان مطمئن بود که همان پاسخ در زمان دیگری نیز معتبر است.
مشکل فقط در محاسبات نیست
یکی از اشتباهاتی که در ارزیابی مدلها مشاهده شد، محاسبات نادرست بود؛ اما مسئله به اعداد و فرمولها محدود نمیشود.
مدلهای زبانی گاهی اطلاعاتی تولید میکنند که در ظاهر کاملاً منطقی به نظر میرسد، اما منبع یا مبنای واقعی ندارد. این اتفاق در موضوعاتی مانند قوانین مالیاتی خطرناکتر است، زیرا ممکن است چتبات جزئیات یک مقررات را اشتباه بیان کند یا حتی به قانونی اشاره کند که اساساً وجود ندارد.
از طرف دیگر، مدلهای هوش مصنوعی معمولاً پاسخ خود را با لحنی قطعی ارائه میکنند. کاربر غیرمتخصص ممکن است همین لحن را نشانه اطمینان پاسخ بداند؛ درحالیکه مطمئن به نظر رسیدن یک جواب، تضمینی برای درست بودن آن نیست.
حتی مدلهای قدرتمند هم خطای زیادی دارند
شاید اولین راهحل این باشد که برای پرسشهای حساس سراغ مدلهای پیشرفتهتر و نسخههای پولی برویم. نتایج این پژوهش نشان میدهد این کار میتواند عملکرد را بهتر کند، اما مشکل را از بین نمیبرد.
در میان مدلهای بررسیشده، Claude Opus 5 در حالت استدلال و نسخه اشتراکی بهترین نتیجه را به دست آورد. بااینحال، این مدل نیز در ۳۹ درصد از موارد پاسخ نادرست ارائه کرد.
بنابراین حتی بهترین عملکرد ثبتشده در این آزمایش نیز فاصله قابلتوجهی با دقتی دارد که بتوان بر اساس آن یک تصمیم مالی مهم را بدون بررسی بیشتر اتخاذ کرد.
چرا مردم همچنان از هوش مصنوعی مشاوره مالی میگیرند؟
سرعت و دسترسی آسان، یکی از دلایل اصلی محبوبیت این ابزارها است. کاربر میتواند در هر ساعت از شبانهروز سؤال خود را مطرح کند و در چند ثانیه پاسخی نسبتاً مفصل تحویل بگیرد.
از طرف دیگر، توضیح دادن مسائل پیچیده با زبان ساده یکی از قابلیتهای جذاب چتباتها است. برای مثال، کاربر میتواند از یک مدل بخواهد مفهوم یک اصطلاح مالی را توضیح دهد یا یک محاسبه ساده را مرحلهبهمرحله بررسی کند.
همین قابلیتها باعث میشوند مرز بین «کمک گرفتن از هوش مصنوعی» و «اعتماد کردن به هوش مصنوعی» بهراحتی از بین برود.
استفاده از این ابزار برای یادگیری یا دریافت یک توضیح اولیه با سپردن تصمیم نهایی به آن تفاوت زیادی دارد.
کارشناسان نسبت به جایگزین شدن چتباتها با مشاوران مالی هشدار میدهند
امل جولی، مدیرعامل شرکت تحقیقاتی Saturn، معتقد است تعداد زیادی از مردم برای دریافت راهنمایی مالی سراغ ابزارهای هوش مصنوعی رفتهاند؛ درحالیکه پاسخ اشتباه این مدلها میتواند برای کاربران هزینه ایجاد کند.
سارا کولز، مدیر امور مالی شخصی در پلتفرم سرمایهگذاری AJ Bell نیز از تجربه مشاورانی گفته است که با مشتریانی مواجه شدهاند که تحت تأثیر پیشنهادهای هوش مصنوعی تصمیمهای غیرمعمولی گرفتهاند.
این دیدگاهها یک موضوع مشترک دارند: چتبات میتواند در فرآیند تحقیق و جمعآوری اطلاعات مفید باشد، اما نباید صرفاً به دلیل ارائه پاسخ سریع و منسجم، جای متخصصی را بگیرد که مسئولیت بررسی شرایط فردی و مقررات مرتبط را بر عهده دارد.
مشاوره مالی با هوش مصنوعی چه وضعیتی دارد؟
موضوع دیگری که در این بحث مطرح میشود، مسئله نظارت است. طبق اظهارات مطرحشده در این گزارش، خدمات مشاوره مالی مبتنی بر هوش مصنوعی هنوز از نظر چارچوبهای نظارتی با مشاوره سنتی قابل مقایسه نیستند.
برای نمونه، اگر یک مشاور انسانی تحت شرایط مشخصی توصیهای ارائه دهد و این توصیه باعث ایجاد خسارت شود، ممکن است سازوکارهایی برای حمایت از مشتری وجود داشته باشد. اما در مورد یک چتبات، شرایط مسئولیت و جبران خسارت به این سادگی نیست.
نهاد ناظر بر امور مالی بریتانیا، FCA، بررسی این حوزه را آغاز کرده است. با گسترش استفاده از ابزارهای هوش مصنوعی در امور مالی، احتمالاً نحوه تنظیم مقررات مربوط به این فناوری نیز به موضوع مهمتری تبدیل خواهد شد.
چطور از هوش مصنوعی برای مسائل مالی استفاده کنیم؟
این یافتهها به این معنی نیست که باید استفاده از هوش مصنوعی در حوزه مالی را کاملاً کنار گذاشت. مسئله اصلی این است که بدانیم برای چه کاری از آن استفاده میکنیم.
چتباتها میتوانند برای توضیح اصطلاحات مالی، خلاصه کردن اطلاعات، آماده کردن پرسشهایی برای مشاور یا انجام محاسبات ابتدایی کاربرد داشته باشند. اما زمانی که پای سرمایه قابلتوجه، مالیات، وام، بازنشستگی یا سرمایهگذاری در میان است، پاسخ چتبات نباید تنها مبنای تصمیمگیری باشد.
بهتر است اطلاعات حساس را از منابع رسمی و بهروز بررسی کنید و در تصمیمهای مهم، نظر یک متخصص واجد صلاحیت را نیز در نظر بگیرید. همچنین اگر پاسخ هوش مصنوعی شامل عدد، قانون یا مقررات مشخصی است، صحت آن را جداگانه بررسی کنید.
در واقع، بهترین روش استفاده از این فناوری این است که هوش مصنوعی را دستیار تحقیق بدانیم، نه مرجع نهایی تصمیمگیری.
هوش مصنوعی مفید است، اما بیخطا نیست
رشد سریع مدلهای هوش مصنوعی باعث شده بسیاری از کارهایی که پیشتر به زمان یا تخصص بیشتری نیاز داشتند، سادهتر شوند. بااینحال، نتایج این پژوهش یادآوری میکند که توانایی تولید پاسخ سریع و طبیعی با دقت صددرصدی یکسان نیست.
بهخصوص در موضوعاتی مثل امور مالی که یک اشتباه کوچک میتواند پیامد واقعی داشته باشد، بررسی منبع و صحت اطلاعات اهمیت بیشتری پیدا میکند.
همانطور که در استفاده از هر فناوری، انتخاب محصول معتبر و برخورداری از خدمات پس از فروش مناسب اهمیت دارد، در دنیای دیجیتال نیز اعتماد باید بر پایه اطلاعات قابلبررسی شکل بگیرد. گارانتی آونگ با ارائه خدمات گارانتی و پشتیبانی برای محصولات تحت پوشش، تلاش میکند تجربه استفاده از فناوری را برای کاربران مطمئنتر و آسودهتر کند.

