বুধবার, ৩০ সেপ্টেম্বর ২০২৬
Natun Kagoj
শিরোনাম
  • নেটদুনিয়ায় আলোচনায় তানিয়া মিশ্রা, জানুন তার পরিচয় বঙ্গভবনে রাষ্ট্রপতির সঙ্গে প্রধানমন্ত্রীর সৌজন্য সাক্ষাৎ সামাজিক অনাচার দূর করতে সরকার ব্যর্থ: চরমোনাই পীর হামের উপসর্গে আরও ৫ মৃত্যু, মৃতের সংখ্যা বেড়ে ১ হাজার ৩ অপরাধীর কোনো দলীয় পরিচয় নেই, কঠোর ব্যবস্থা নিতে হবে: আইজিপি দীর্ঘমেয়াদি সম্পর্কে চেহারা, নাকি ব্যক্তিত্ব-কোনটি বেশি গুরুত্বপূর্ণ? দুদকের প্রেস ব্রিফিং নিয়ে আসিফ মাহমুদের রিট কার্যতালিকা থেকে বাদ হৃদরোগ প্রতিরোধে সচেতনতার বিকল্প নেই: স্বাস্থ্যমন্ত্রী জনকল্যাণে এআই ও সেমিকন্ডাক্টরে গবেষণার আহ্বান রাষ্ট্রপতির একনেকে ১৩ উন্নয়ন প্রকল্প অনুমোদন, ব্যয় ১৫ হাজার ৮২৩ কোটি টাকা
  • ইন্টারনেট আর্কাইভের সংগ্রহে এক ট্রিলিয়ন ওয়েব পেজ

    ইন্টারনেট আর্কাইভের সংগ্রহে এক ট্রিলিয়ন ওয়েব পেজ
    গুগল নিউজে (Google News) নতুন কাগজ’র খবর পেতে ফলো করুন

    ডিজিটাল দুনিয়ার প্রতিটি মুহূর্ত যেন বালির ওপর লেখা নামের মতো — এক ঢেউ সব মুছে দিতে পারে। সার্ভার ক্র্যাশ, ডোমেইনের মেয়াদোত্তীর্ণ হওয়া বা হ্যাকারদের হামলায় হারিয়ে যেতে পারে ওয়েবসাইট, ছবি বা স্মৃতি। এর প্রমাণ ২০১৯ সালে দেখা গেছে, যখন মাইস্পেস সার্ভার পরিবর্তনের সময় ভুল করে ২০০৩ থেকে ২০১৫ সালের মধ্যে আপলোড করা প্রায় ৫ কোটি গান চিরতরে হারিয়ে যায়।

    কিন্তু এই ডিজিটাল বিস্মৃতির হাত থেকে ইন্টারনেটকে বাঁচাতে লড়ছে ইন্টারনেট আর্কাইভ। প্রায় ৩০ বছরের অক্লান্ত পরিশ্রমের পর সম্প্রতি এই অলাভজনক সংস্থা তাদের সংগ্রহশালায় ১ ট্রিলিয়ন বা ১ লাখ কোটি ইউআরএল সংরক্ষণে সক্ষম হয়েছে।

    ইন্টারনেট আর্কাইভের প্রতিষ্ঠাতা ব্রুউস্টার কেল ১৯৯৬ সালে সান ফ্রান্সিসকোতে প্রতিষ্ঠানটি শুরু করেন। উদ্দেশ্য ছিল ইন্টারনেটের পরিবর্তন এবং ইতিহাসের স্থায়ী রেকর্ড রাখা। সংস্থার সবচেয়ে পরিচিত সেবা ওয়েব্যাক মেশিন, যা ব্যবহারকারীদের কোনো ওয়েবসাইটের ১০ বা ২০ বছর আগের চেহারা দেখার সুযোগ দেয়।

    আজকের দিনে ওয়েব্যাক মেশিন গবেষক, সাংবাদিক এবং সাধারণ মানুষের জন্য অমূল্য রত্নভাণ্ডারে পরিণত হয়েছে। এর মাধ্যমে কেউ দেখতে পারেন, ২০ বছর আগে প্রথম আলো বা বিবিসি বাংলার ওয়েবসাইট কেমন ছিল বা হারিয়ে যাওয়া কোনো ব্লগের চেহারা।

    ইন্টারনেট আর্কাইভের সংগ্রহশালায় শুধু ওয়েবসাইট নয়, সংরক্ষিত আছে:

    • ৪ কোটি ১০ লাখ বই ও টেক্সট ডকুমেন্ট
    • ১ কোটি ৫০ লাখ অডিও রেকর্ডিং, যার মধ্যে ২ লাখ ৫০ হাজার লাইভ কনসার্ট
    • ১ কোটির বেশি ভিডিও
    • ৪৪ লাখ ছবি
    • ১০ লাখের বেশি সফটওয়্যার প্রোগ্রাম

    সব মিলিয়ে সংস্থার কাছে বর্তমানে প্রায় ১ লাখ টেরাবাইট বা ১০০ পেটাবাইট ডেটা জমা আছে। দৈনন্দিন গড়ে প্রায় ৫০ কোটি নতুন ওয়েব পেজ আর্কাইভে যুক্ত হচ্ছে।

    তবে এই মহৎ কাজের পথে চ্যালেঞ্জও কম নয়। কৃত্রিম বুদ্ধিমত্তার উত্থানের কারণে বড় প্রযুক্তি কোম্পানিগুলো তাদের AI মডেল শেখানোর জন্য ইন্টারনেটের সব তথ্য সংগ্রহ করছে। এর ফলে নিউইয়র্ক টাইমস, দ্য গার্ডিয়ান বা ইউএসএ টুডের মতো বড় মিডিয়া প্রতিষ্ঠান তাদের কনটেন্টকে আর্কাইভ থেকে ব্লক করছে। এছাড়া কপিরাইট জটিলতাও আর্কাইভের কাজকে আগের চেয়ে আরও কঠিন করে তুলেছে।

    তবুও আশা করা যায়, সব আইনি জটিলতা কাটিয়ে ইন্টারনেট আর্কাইভ টিকে থাকবে। কারণ মানব ইতিহাসের সবচেয়ে ভঙ্গুর কিন্তু গুরুত্বপূর্ণ এই ডিজিটাল ইকোসিস্টেমের বিকল্প নেই। শিগগিরই তারা ২ ট্রিলিয়ন ওয়েবসাইটের মাইলফলকও স্পর্শ করতে পারে।


    দৈএনকে/জে, আ
    গুগল নিউজে (Google News) নতুন কাগজ’র খবর পেতে ফলো করুন

    সর্বশেষ

    আরও পড়ুন