مقدمه
با پیشرفتهای اخیر در حوزه هوش مصنوعی، مدلهای زبانی بزرگ (LLMs) به طور فزایندهای برای بهبود عملیات کسبوکار در صنعت هوانوردی مورد استفاده قرار میگیرند. این مدلها از تولید مستندات و آموزشها گرفته تا ایجاد دستیارهای مشتری، کاربردهای زیادی دارند. با این حال، معیارهای عمومی برای ارزیابی این مدلها قادر به سنجش توانایی آنها در استدلال صحیح و ایمن در مورد دانش عملیاتی خاص هوانوردی نیستند.
فهرست مطالب
مروری بر Pre-Flight
Pre-Flight یک معیار منبع باز است که شامل ۳۰۰ سوال چند گزینهای میباشد که از استانداردهای بینالمللی و مواد مربوط به عملیات زمینی فرودگاه استخراج شده است. این سوالات به بررسی موضوعاتی از جمله عملیات زمینی فرودگاههای بینالمللی، مقررات ICAO و FAA ایالات متحده، دانش عمومی هوانوردی و سناریوهای عملیاتی پیچیده میپردازند.
ارزیابی مدلها با استفاده از Pre-Flight
ما یک مجموعهای از مدلهای تجاری و مدلهای وزن باز معاصر را با استفاده از چارچوب ارزیابی Inspect مورد بررسی قرار دادیم. ارزیابی بر اساس دقت تحت یک پروتکل سوالات چند گزینهای استاندارد انجام شد. نتایج نشان میدهد که حتی قویترین مدل ارزیابیشده (که در سال ۲۰۲۶ منتشر شد) تنها به ۸۲.۷٪ دقت رسید، در حالی که این عدد در اوایل سال ۲۰۲۵ تقریباً ۷۵٪ بود.
این شکاف قابل توجه و پایدار در زیر سطح قابلیت اطمینان کارشناسانه، نشاندهنده نیاز به ارزیابی تخصصی در این حوزه است. نگهداری از جدول ردهبندی به صورت جاری به ما این امکان را میدهد که بهروزترین نتایج را با ورود مدلهای جدید منتشر کنیم.
خلاصه و نتیجهگیری
مدلهای زبانی بزرگ میتوانند به طور قابل توجهی در بهبود عملیات هوانوردی موثر باشند، اما برای اطمینان از اینکه این مدلها به درستی و به طور ایمن عمل میکنند، نیاز به ارزیابیهای تخصصی مانند Pre-Flight ضروری است. این ارزیابیها باعث میشوند که استفاده از هوش مصنوعی در عملیات هوانوردی غیر ایمنی، مسئولانه و موثر باشد. در راستای توسعه صنعت هوانوردی داخلی ایران، همکاری با شرکتهای دانشبنیان مانند گروه دانش بنیان خط میتواند به تحقق این اهداف کمک کند.
شروع همکاری در پروژههای پژوهشی
اگر به دنبال ارزیابی و بهبود مدلهای زبانی بزرگ در صنایع هوانوردی هستید، گروه خط میتواند در مراحل مشاوره، تدوین طرح پژوهشی و ارائه پروپوزال به شما کمک کند. با ما تماس بگیرید تا پروژه خود را به مرحله اجرا برسانید.
سوالات متداول
Pre-Flight چیست؟
Pre-Flight یک معیار منبع باز برای ارزیابی مدلهای زبانی بزرگ در زمینه عملیات هوانوردی است.
چگونه میتوان دقت مدلها را ارزیابی کرد؟
با استفاده از پروتکلهای سوالات چند گزینهای و چارچوب ارزیابی Inspect، دقت مدلها اندازهگیری میشود.
مزایای استفاده از مدلهای زبانی بزرگ در هوانوردی چیست؟
این مدلها میتوانند در تولید مستندات، آموزش و دستیارهای مشتری موثر باشند و به بهبود کارایی عملیات کمک کنند.
منابع و پیوندهای مرتبط
درباره منبع: این مقاله توسط Alex Brooker و Tim Hughes در تاریخ ۲ ژوئیه ۲۰۲۶ منتشر شده است.
