إعدادات الصفحة
الوضع الداكن
--° القاهرة

أرشيف الإنترنت يسجل 1000 مليار صفحة ويب في إنجاز تاريخي للحفظ الرقمي

منظمة غير ربحية تحتفي بتجاوز حاجز تريليون صفحة ويب بعد ثلاثة
استمع للخبر عبد الفتاح يوسف 2026-02-21 23:56 37
أرشيف الإنترنت يسجل 1000 مليار صفحة ويب في إنجاز تاريخي للحفظ الرقمي

الولايات المتحدة - وكالة أنباء إخباري

أرشيف الإنترنت يسجل 1000 مليار صفحة ويب في إنجاز تاريخي للحفظ الرقمي

يحتفل أرشيف الإنترنت، الذي يُعد بمثابة المكتبة الرقمية الأهم على شبكة الإنترنت، بتحقيق إنجاز هائل يصعب استيعابه؛ فقد نجحت المنظمة غير الربحية، بعد ما يقرب من 30 عامًا من العمل المتواصل والدقيق، في حفظ الصفحة رقم تريليون (1000 مليار صفحة). يمثل هذا الإنجاز نقطة تحول جوهرية في تاريخ جهود الحفاظ على المحتوى الرقمي، خاصة في عصر يتسم بالاعتماد المتزايد على الإنترنت في الحياة اليومية، وفي الوقت نفسه يزداد فيه طابعه غير الموثوق وصعوبة التنقل فيه.

لطالما عانت شبكة الإنترنت من مشكلة عدم الديمومة؛ فالمحتوى الرقمي بطبيعته زائل، ولا يدوم إلا بوجود جهة مستعدة لصيانته والحفاظ عليه. يتجلى هذا بوضوح في حادثة موقع "ماي سبايس" (MySpace) الشهير، الذي كان أحد أبرز منصات التواصل الاجتماعي المبكرة. ففي عام 2019، أعلن الموقع أن خطأ غير متوقع في ترحيل الخوادم أدى عن طريق الخطأ إلى محو جميع التحميلات التي قام بها المستخدمون بين عامي 2003 و2015. وفي لحظة واحدة، اختفى ما يقدر بنحو 50 مليون أغنية تخص 14 مليون فنان في غياهب الفضاء الرقمي.

تسعى منظمة أرشيف الإنترنت جاهدة لتجنب تكرار مثل هذه الحوادث المأساوية. منذ عام 1996، تهدف المؤسسة إلى إنشاء "سجل دائم لتطور الإنترنت"، وذلك بالاعتماد بشكل أساسي على برامج الزحف الآلية (web crawlers) التي تقوم بأرشفة أكبر عدد ممكن من المواقع المتاحة للعامة. بالإضافة إلى ذلك، يساهم المتطوعون في تقديم موادهم الخاصة، بما في ذلك الإصدارات المطبوعة، والموسيقى والأصوات التي يصعب العثور عليها، وأشكال أخرى متنوعة من الوسائط. على مدار ما يقرب من ثلاثة عقود، نجح أرشيف الإنترنت في تأمين أكثر من 866 مليار صفحة ويب، و41 مليون نص، وملايين الأشكال الأخرى من المحتوى الرقمي. وبإضافة حوالي 500 مليون موقع ويب جديد يوميًا، يصل إجمالي المعلومات المخزنة إلى ما يقدر بـ 100,000 تيرابايت حتى الآن. وللمقارنة، فإن هذه السعة تعادل سعة تخزين 50,000 جهاز iPhone من أعلى فئة متوفرة حاليًا في السوق.

على الرغم من أن أرشيف الإنترنت لا يزال أداة لا غنى عنها للأمناء والمؤرخين والصحفيين والباحثين الأكاديميين، وكذلك للزوار الفضوليين، إلا أنه يواجه ضغوطًا متزايدة من التغيرات المتسارعة في شبكة الويب العالمية. تتسابق شركات التكنولوجيا لتدريب أنظمة الذكاء الاصطناعي النماذج اللغوية الكبيرة (LLM) الخاصة بها، فتقوم بمسح المشهد الرقمي بحثًا عن مجموعات بيانات جديدة لاستهلاكها، وغالبًا ما يتم ذلك في ظل ظروف قانونية غامضة للغاية. ونتيجة لذلك، فإن العديد من شركات الإعلام الكبرى، بما في ذلك "نيويورك تايمز" و"الغارديان" و"يو إس إيه توداي/غانيت"، تقوم بحجب محتواها الأحدث عن الأرشيف، في محاولة لحمايته من الاستخدام في نماذج الذكاء الاصطناعي التوليدية.

من المفهوم أن تقوم هذه الشركات بهذا الإجراء في ظل غياب إطار عمل ملموس لتعويض هذه الشركات وكتابها بشكل مناسب عن عملهم. ومع ذلك، فإن هذا النهج يجعل من الصعب الحفاظ على ما يمكن اعتباره النظام البيئي المعلوماتي الأكثر حساسية في تاريخ البشرية. يبقى الأمل معلقًا على توصل جميع الأطراف إلى تفاهم يضمن استمرارية عمل الأرشيف ليتجاوز هدفه المتمثل في الوصول إلى تريليونين صفحة ويب محفوظة.

# أرشيف الإنترنت، حفظ رقمي، تريليون صفحة ويب، تاريخ الإنترنت، الذكاء الاصطناعي، حفظ التراث الرقمي، أرشيف الويب
اقرأ هذا الخبر