دقت برنامه تشخیص صدای انسان در سطح هوش بشر
به گزارش واحد فناوری اطلاعات سایبربان؛ مهندسان مایکروسافت که در حوزه هوش مصنوعی فعال هستند مدعی شدهاند که نرخ اشتباه سیستم تشخیص صدای ساختهشده توسط این شرکت به 5.9 درصد کاهشیافته که تقریباً برابر با توانایی انسان برای درک اصوات دیگر انسانهاست.
Xuedong Huang مدیر واحد طراح این سیستم میگوید بعد از دههها آزمایش و بررسی دستیار صوتی مایکروسافت به حدی از بلوغ رسیده که بهخوبی میتواند گفتهها انسانها را درک کند و این موفقیت تأثیر شگرفی بر کارکرد محصولاتی همچون دستیار صوتی کورتانا، ایکس باکس، ویندوز و غیره خواهد گذاشت.
محققان برای رسیدن به چنین حدی از موفقیت از شبکههای عصبی دارای قابلیت خودآموزی استفاده کرده و حجم زیادی از دادهها را بر روی آنها ذخیره کردهاند تا بتوانند به آموزش آنها کمک کنند. از این طریق الگوهای بهتری برای درک اظهارات انسانها ابداعشده است. بدین منظور علاوه بر صدا، تصاویری هم برای تعلیم این شبکههای عصبی و ارتقای کار آیی آنها به کار گرفتهشده است.
مایکروسافت امیدوار است در آینده دقت این شبکههای عصبی بازهم افزایش یابد و آنها در زمینه درک صدای انسان در محیطهای شلوغی مانند رستورانها، خیابانهای پرترافیک و حتی در زمان وزش بادهای تند هم موفق باشند. سیستمهای یادشده در آینده نهتنها قادر به تشخیص درست اصوات انسانها هستند، بلکه میتوانند آنها را درک کنند.