مقدمه

با پیشرفت‌های اخیر در حوزه هوش مصنوعی، مدل‌های زبانی بزرگ (LLMs) به طور فزاینده‌ای برای بهبود عملیات کسب‌وکار در صنعت هوانوردی مورد استفاده قرار می‌گیرند. این مدل‌ها از تولید مستندات و آموزش‌ها گرفته تا ایجاد دستیارهای مشتری، کاربردهای زیادی دارند. با این حال، معیارهای عمومی برای ارزیابی این مدل‌ها قادر به سنجش توانایی آن‌ها در استدلال صحیح و ایمن در مورد دانش عملیاتی خاص هوانوردی نیستند.

فهرست مطالب

  1. مروری بر Pre-Flight
  2. ارزیابی مدل‌ها با استفاده از Pre-Flight
  3. خلاصه و نتیجه‌گیری
  4. سوالات متداول

مروری بر Pre-Flight

Pre-Flight یک معیار منبع باز است که شامل ۳۰۰ سوال چند گزینه‌ای می‌باشد که از استانداردهای بین‌المللی و مواد مربوط به عملیات زمینی فرودگاه استخراج شده است. این سوالات به بررسی موضوعاتی از جمله عملیات زمینی فرودگاه‌های بین‌المللی، مقررات ICAO و FAA ایالات متحده، دانش عمومی هوانوردی و سناریوهای عملیاتی پیچیده می‌پردازند.

ارزیابی مدل‌ها با استفاده از Pre-Flight

ما یک مجموعه‌ای از مدل‌های تجاری و مدل‌های وزن باز معاصر را با استفاده از چارچوب ارزیابی Inspect مورد بررسی قرار دادیم. ارزیابی بر اساس دقت تحت یک پروتکل سوالات چند گزینه‌ای استاندارد انجام شد. نتایج نشان می‌دهد که حتی قوی‌ترین مدل ارزیابی‌شده (که در سال ۲۰۲۶ منتشر شد) تنها به ۸۲.۷٪ دقت رسید، در حالی که این عدد در اوایل سال ۲۰۲۵ تقریباً ۷۵٪ بود.

این شکاف قابل توجه و پایدار در زیر سطح قابلیت اطمینان کارشناسانه، نشان‌دهنده نیاز به ارزیابی تخصصی در این حوزه است. نگهداری از جدول رده‌بندی به صورت جاری به ما این امکان را می‌دهد که به‌روزترین نتایج را با ورود مدل‌های جدید منتشر کنیم.

خلاصه و نتیجه‌گیری

مدل‌های زبانی بزرگ می‌توانند به طور قابل توجهی در بهبود عملیات هوانوردی موثر باشند، اما برای اطمینان از اینکه این مدل‌ها به درستی و به طور ایمن عمل می‌کنند، نیاز به ارزیابی‌های تخصصی مانند Pre-Flight ضروری است. این ارزیابی‌ها باعث می‌شوند که استفاده از هوش مصنوعی در عملیات هوانوردی غیر ایمنی، مسئولانه و موثر باشد. در راستای توسعه صنعت هوانوردی داخلی ایران، همکاری با شرکت‌های دانش‌بنیان مانند گروه دانش بنیان خط می‌تواند به تحقق این اهداف کمک کند.

شروع همکاری در پروژه‌های پژوهشی

اگر به دنبال ارزیابی و بهبود مدل‌های زبانی بزرگ در صنایع هوانوردی هستید، گروه خط می‌تواند در مراحل مشاوره، تدوین طرح پژوهشی و ارائه پروپوزال به شما کمک کند. با ما تماس بگیرید تا پروژه خود را به مرحله اجرا برسانید.

سوالات متداول

Pre-Flight چیست؟

Pre-Flight یک معیار منبع باز برای ارزیابی مدل‌های زبانی بزرگ در زمینه عملیات هوانوردی است.

چگونه می‌توان دقت مدل‌ها را ارزیابی کرد؟

با استفاده از پروتکل‌های سوالات چند گزینه‌ای و چارچوب ارزیابی Inspect، دقت مدل‌ها اندازه‌گیری می‌شود.

مزایای استفاده از مدل‌های زبانی بزرگ در هوانوردی چیست؟

این مدل‌ها می‌توانند در تولید مستندات، آموزش و دستیارهای مشتری موثر باشند و به بهبود کارایی عملیات کمک کنند.

منابع و پیوندهای مرتبط

درباره منبع: این مقاله توسط Alex Brooker و Tim Hughes در تاریخ ۲ ژوئیه ۲۰۲۶ منتشر شده است.