نقد دستیاران هوش مصنوعی دولت: اطلاعات قدیمی و کارایی ناکافی در رونمایی رسمی

نقد دستیاران هوش مصنوعی دولت اطلاعات قدیمی و کارایی ناکافی در رونمایی رسمی, در جلسهای که با حضور معاونت علمی، فناوری و اقتصاد دانشبنیان ریاستجمهوری برگزار شد، نسخههای اولیه چتباتهای اختصاصی دستگاههای اجرایی معرفی شدند. این رونمایی به جای نمایش پیشرفت، ضعفهای بنیادین این سامانهها را آشکار کرد؛ از جمله وابستگی به دادههای منسوخ و ناتوانی در پردازش پرسشهای کاربری.
به گزارش اسپایدر، معاونت علمی نظارت بر پیشرفت پروژههای هوش مصنوعی دستگاهها را بر عهده گرفته است.
محدودیتهای عمدی و نادیده گرفتن نیاز کاربر حسین افشین، معاون علمی و فناوری، با ارائه پرامپتهای مختلف سعی در ارزیابی عملکرد این دستیاران داشت. نتایج نشاندهنده ضعف در دقت پاسخها و درک نادرست سوالات بود.
مورد بارز مربوط به دستیار وزارت تعاون، کار و رفاه اجتماعی بود که در پاسخ به پرسش درباره آبوهوای تهران اعلام کرد من فقط به سوالات مرتبط با وزارت تعاون جواب میدهم. افشین این رویکرد را غیرحرفهای خواند و تأکید کرد هوش مصنوعی باید به نیاز واقعی کاربر پاسخ دهد.
تنها نقل قانون، هوشمندسازی نیست و توانایی تعامل عمومی الزامی است. چالش تأمین داده و وابستگی به ادمینهای سازمانی نکته حیاتی در معماری این پروژهها، روش تغذیه دادههاست. برخلاف انتظار، مدلها از خبرگزاریها یا منابع باز اطلاعات دریافت نمیکنند؛ بلکه دادهها باید توسط ادمینهای هر دستگاه دستی بارگذاری شوند. این مکانیزم وابستگی شدیدی به همکاری فعال سازمانها ایجاد میکند که میزان تحقق آن تاکنون مشخص نیست.
در پاسخ به سوالی درباره ضرورت ساخت مدل زبانی اختصاصی، افشین بیان کرد هدف ما صرفاً ساخت یک پوسته نیست. توسعه فنی بر عهده تیم تخصصی معاونت است و دستگاهها تنها باید نیازهایشان را اعلام کنند. او اضافه کرد که کد منبع تمام دستیاران در اختیار معاونت علمی قرار دارد و ورود سازمانها به توسعه مدل زبان الزامی نیست، بجز موارد خاصی نظیر وزارت ارتباطات.
نمونههای معرفی شده و فاصله با ها در این جلسه چند نمونه عملیاتگری شده بود یارینو توسعهیافته توسط نکسینو، همزیست محصول دانشگاه پرورش مدرس با تمرکز زیستمحیط، ویر دستیار هوشمند استاندار ایلام و دستیار رسانهای شرکت دیتاک. با این حال، افشین صراحتاً از این رویداد به عنوان ارائه نسخه اولیه نام برد و ترفای میت شد که پروژهها از اهداف نهایی دور هستند.
تستهای مقایسهای نشان داد که حتی ChatGPT با تنها دسترسی به اطلاعات عمومی، پاسخهای دقیقتر و کاربردیتری نسبت به این چتباتهای ارائه میدهد. این واقعیت نشاندهنده چالش جدی در پیادهسازی حتی یک لایه واسط کارآمد است، به یک سیستم کاملاً مجزا و تخصصی. مدل زبانی یا صرفاً پوسته؟ تست واقعی در محیط غیرعمومی نشست امروز بیشتر شبیه یک آزمایش کارکردی بود تا یک رونمایی رسمی.
حضور رسانهای برای ارزیابی سامانههایی که همچنان صلاحیت استقرار در بستر اجرایی را ندارند، انتقادات را برانگیخت. با توجه به تصمیم دولت برای بهرهگیری از این ابزارها در فرآیند تصمیمگیری، دقت و اعتبار پاسخها اولویت اول است. نماینده وزارت امور خارجه در جلسه اعلام کرد که دستیار رسانهای هوش مصنوعی نتوانسته عملکرد درستی داشته باشد.
غیاب نمایندگان دیگر دستگاهها نیز نگرانیها را تشدید کرد، زیرا بازخورد آنها احتمالاً تفاوت چندانی نداشت. معاونت علمی قول داد که در ماه آینده جلسه بازبینیای برای ارزیابی پیشرفت این دستیاران برگزار خواهد شد.



