هوش مصنوعی و رمزگشایی از متنهای روم باستان

در خرابههای پمپئی، تکهای موزاییک رنگپریده با نوشتهای هشدارآمیز چشم را میگیرد: «از سگ بترس!». این جمله ساده، نه در کتاب شاهان آمده و نه در طومارهای امپراتوران؛ صدای زندگی روزمره است، آن هم از هزاران سال پیش. هر سال حدود ۱۵۰۰ کتیبهٔ تازه در سراسر دنیای روم باستان کشف میشود، اما خواندن و درک آنها برای مورخان کاری جانفرساست. آسیبهای زمانی، ابهام در محل و تاریخ و گاه نبودِ بخشی از متن، این نوشتهها را به پازلهایی با قطعات گمشده تبدیل کرده. اما اکنون، یک ابزار هوش مصنوعی با نام اسطورهای «آئِنهآس» (Aeneas)، آمده تا این قطعات پراکنده را کنار هم بچیند. این مدل زبانی تازه، نهتنها جای خالی کتیبهها را حدس میزند، بلکه زمان و مکان احتمالی نگارششان را نیز تعیین میکند.
رمزگشایی دنیای فراموششده: چرا متون لاتین اهمیت دارند؟
کتیبههای لاتین، فارغ از نقش تاریخیشان، آینهای بیواسطه از زبان، فکر، جامعه و احساسات مردم یک امپراتوری پهناور هستند. برخلاف متون رسمی که معمولاً بهدست نخبگان نگاشته شدهاند، این نوشتهها از همهچیز حرف میزنند: از قانون گرفته تا عشق، از مرگ تا زندگی روزمره. همین ویژگی است که به گفته یانیس آساِئل (Yannis Assael)، پژوهشگر هوش مصنوعی در دیپمایند (DeepMind)، آنها را بیبدیل میسازد. به باور او، این متون فرصتی است برای درک تاریخ از پایین، نه فقط از دید فاتحان. بااینحال، چالشهایی جدی پیشِ روی رمزگشاییشان وجود دارد: خطهای محو، حروف شکسته، متنهای ناقص و اطلاعات مبهم درباره محل و زمان نگارش.
در این میان، پژوهشگران دانشگاه ناتینگهام و گوگل دیپمایند، با همکاری در پروژهای بینارشتهای، یک مدل یادگیری مولد (generative neural network) طراحی کردهاند که میتواند همچون یک مورخ خبره، الگوهای پنهان در دادههای زبانی، جغرافیایی و تاریخی را تشخیص دهد و به حل این معماهای چندلایه کمک کند.
آئنهآس؛ مورخِ مجازی دنیای لاتین
مدلی که «آئنهآس» نام گرفته، برگرفته از قهرمان اسطورهای تروایی، نه فقط بر اساس قواعد زبان، بلکه بر پایهٔ ترکیبی از معنا، زمان، جغرافیا و حتی نحوهٔ نگارش قدیمی آموزش دیده. این مدل با بررسی ۱۷۶٬۸۶۱ کتیبه لاتین که معادل حدود ۱۶ میلیون کاراکتر است، یاد گرفته چگونه از قرینهها بهره بگیرد. تنها ۵ درصد از این مجموعه حاوی تصاویر بودند، اما همین میزان نیز به غنای تحلیل کمک کرده است.
آئنهآس قادر است با دریافت بخشی ناقص از یک نوشته، حدس بزند که مکان احتمالی نگارش آن در میان ۶۲ استان روم باستان کجا بوده، در چه دههای نوشته شده، و حتی بخشی از کلمات حذفشده آن چه میتوانسته باشد. در واقع، این مدل نهتنها جایگزینی برای مورخ نیست، بلکه یار قدرتمندی است که توان جستوجو در هزاران کتیبه را در چند ثانیه فراهم میسازد.
آزمایش با یک کتیبهٔ افسانهای: نوشتههای آگوستوس
برای سنجش دقت و کارآیی آئنهآس، پژوهشگران آن را در برابر یکی از مشهورترین متون لاتین قرار دادند: «کارنامه الهی آگوستوس» (Res Gestae Divi Augusti). این کتیبه بلند که در آن نخستین امپراتور روم از دستاوردهای خود سخن میگوید، سالهاست محل اختلاف مورخان دربارهٔ تاریخ دقیق نگارش آن است. نکته جالب آنکه، با وجود اغراقهای موجود در متن، ذکر تاریخهای غیرواقعی و ارجاع به مکانهایی که یا وجود نداشتند یا اشتباه ثبت شدهاند، آئنهآس توانست بر پایه جزئیاتی مانند هجیهای کهنه، دو بازه زمانی پیشنهادی ارائه دهد؛ درست همان دو گزینهای که هنوز بین مورخان محل بحث است.
این عملکرد، به گفتهٔ تیم تحقیقاتی، نشاندهنده توان مدل در تحلیل نشانههای زبانی ظریف است که گاه از چشم انسان پنهان میماند، اما بهطور آماری معنا دارد.
از یادگیری ماشینی تا فهم تاریخی: قدرت مدلهای زبانی در باستانشناسی
یکی از ویژگیهای شگفتانگیز مدل آئنهآس این است که با داشتن صرفاً بخشی از اطلاعات (مثلاً چند کلمه از یک سنگنوشتهٔ شکسته)، میتواند بر پایهٔ زمینههای زبانی و تاریخی، حدسهایی قابل اعتماد درباره محتوای گمشده بزند. این مسئله بهویژه زمانی اهمیت پیدا میکند که بدانیم بسیاری از کتیبههای کشفشده، ناقصاند و مکان و زمان نگارششان مشخص نیست.
پژوهشگران در مقالهای منتشرشده در مجله علمی Nature، توضیح دادهاند که این مدل با تحلیل شبکهای از همبستگیها بین کلمات، زمان، محل نگارش، و سبک نگارش، میتواند مانند یک محقق باستانشناس، قطعات پازل تاریخی را کنار هم بچیند. در واقع، آئنهآس فقط یک ابزار زبانی نیست؛ بلکه بهنوعی تاریخدان محاسباتی است که قادر است از روی شواهد پراکنده، الگوهای بزرگتری را بازسازی کند.
چالشهای پژوهش سنتی و مزایای همافزایی با هوش مصنوعی
تا پیش از این، مورخان ناگزیر بودند برای تحلیل هر کتیبه، آن را با صدها یا هزاران نمونه دیگر مقایسه کنند. این کار نهتنها به دانشی گسترده و تخصصی نیاز داشت، بلکه گاهی ماهها وقت میگرفت تا صرفاً تاریخ تقریبی یک نوشته مشخص شود. حتی دسترسی به این حجم از منابع نیز همیشه ممکن نبود، بهویژه در کشورهای کمترمجهز یا بدون آرشیو دیجیتال گسترده.
اما حالا، آئنهآس نهتنها این فرآیند را تسریع کرده، بلکه آن را برای پژوهشگرانی در سراسر جهان قابلدسترس ساخته است. در واقع، مدلهای زبانی مثل آئنهآس میتوانند شکاف میان مراکز تحقیقاتی بزرگ و پژوهشگران مستقل را پر کنند و از تمرکز منابع تاریخی در دست نخبگان بکاهند. به گفتهٔ روبه وولگرت (Robbe Wulgaert)، پژوهشگر هوش مصنوعی بلژیکی، این مدل نشان میدهد که استفادهٔ هدفمند از هوش مصنوعی نهتنها با اهداف آموزشی در تضاد نیست، بلکه میتواند به غنای پژوهشهای انسانی بیفزاید.
دقت عملیاتی مدل؛ آزمونی واقعی با حضور بیش از ۲۰ مورخ
برای ارزیابی کاربردی بودن آئنهآس، پژوهشگران از بیش از ۲۰ تاریخدان خواستند تا با مدل کار کنند و میزان کمک آن را در حل معماهای واقعی بسنجند. نتیجه قابلتوجه بود: در ۹۰ درصد موارد، مورخان اعلام کردند که خروجی مدل نقطه شروع مفیدی برای تحقیقات آنها بوده است. مهمتر از همه اینکه بهترین نتایج زمانی حاصل شد که هوش مصنوعی و مهارت انسانی با هم ترکیب شدند؛ نه زمانی که تنها یکی از آنها بهکار گرفته شده بود.
این تجربهها تأکیدی است بر آنچه بسیاری از متخصصان فناوری بر آن تأکید دارند: مدلهای زبانی پیشرفته ابزارهایی کمکی هستند، نه جایگزین ذهنهای انسانی. درست مانند تلسکوپ برای ستارهشناس یا میکروسکوپ برای زیستشناس، آئنهآس نیز ابزار تازهای است برای باستانشناس و مورخ؛ اما ابزار بدون تحلیل انسانی، کارایی محدودی دارد.
خلاصه
مدل آئنهآس نشان میدهد که هوش مصنوعی میتواند در حوزههایی بسیار فراتر از علوم رایانهای، نقش مؤثری ایفا کند. با تحلیل هوشمندانهٔ متون کهن، این مدل به پژوهشگران کمک میکند تا صدای خاموششدهٔ مردم عادی روم باستان را دوباره بشنوند. آئنهآس فقط ابزار رمزگشایی متون نیست، بلکه پل ارتباطی میان دادههای خام و درک تاریخی عمیق است. استفاده ترکیبی از این ابزار با دانش انسانی، نمونهای روشن از همافزایی هوش طبیعی و مصنوعی در خدمت علوم انسانی است.
❓ سؤالات رایج (FAQ):
هوش مصنوعی آئنهآس چگونه کار میکند؟
این مدل با استفاده از شبکههای عصبی زایشی (generative neural networks)، الگوهای پنهان بین کلمات، زمان، مکان و سبک نگارش را تحلیل میکند و بر اساس آن اطلاعات ناقص را تکمیل میکند.
چه مزیتی نسبت به روشهای سنتی پژوهش دارد؟
آئنهآس میتواند صدها کتیبه را در چند ثانیه بررسی کند و جای خالی متون را حدس بزند؛ درحالیکه پژوهش سنتی نیازمند جستجوی دستی و زمانبر است.
آیا این مدل میتواند جایگزین تاریخدانها شود؟
خیر؛ این مدل صرفاً یک ابزار کمکی است. بهترین نتایج زمانی حاصل میشود که مورخان و هوش مصنوعی در کنار هم کار کنند.
چه تعداد کتیبه برای آموزش این مدل استفاده شدهاند؟
بیش از ۱۷۶ هزار کتیبه لاتین با حدود ۱۶ میلیون کاراکتر، از جمله متونی با تصویر، برای آموزش مدل استفاده شدهاند.
آیا این فناوری برای متون غیرلاتین هم قابلتوسعه است؟
در حال حاضر مدل بر متون لاتین متمرکز است، اما اصول آن قابلیت بومیسازی برای دیگر زبانهای باستانی را نیز دارد.



