คลังข้อมูลวันนี้
archive.today (หรือที่รู้จักกันในชื่อarchive.isและโดเมนอื่นๆ) เป็น เว็บไซต์ เก็บถาวรเว็บที่บันทึกภาพหน้าจอตามต้องการ รองรับ เว็บไซต์ที่ใช้ JavaScriptจำนวนมาก เช่นGoogle MapsและX [ 1 ] archive.today บันทึกภาพหน้าจอสองภาพ: ภาพหนึ่งจำลองเว็บเพจต้นฉบับรวมถึงลิงก์ที่ใช้งานได้จริง อีกภาพหนึ่งเป็นภาพหน้าจอของหน้าเว็บ[ 2 ]
เว็บไซต์ดังกล่าวตกอยู่ภายใต้การตรวจสอบจากหลายรัฐบาลตั้งแต่ช่วงปลายทศวรรษ 2010 รวมถึงการสั่งห้ามในจีนและรัสเซีย และในปี 2025 สำนักงานสอบสวนกลาง ของสหรัฐฯ (FBI) ได้ออกหมายเรียกผู้ให้บริการจดทะเบียนโดเมนเพื่อระบุตัวเจ้าของชื่อโดเมน archive.today
ประวัติศาสตร์
archive.today ก่อตั้งขึ้นในปี 2012 ในฐานะเว็บอาร์ไคฟ์มีการกล่าวอ้างว่าได้จดทะเบียนเครื่องหมายการค้าในสาธารณรัฐเช็กในปี 2013 [ 3 ]เดิมทีเว็บไซต์นี้ใช้ชื่อแบรนด์ว่า archive.today แต่ได้เปลี่ยนเซิร์ฟเวอร์ หลัก เป็น archive.is ในเดือนพฤษภาคม 2015 [ ‡ 3 ]และเริ่มยกเลิกการใช้งานโดเมน archive.is และหันไปใช้เซิร์ฟเวอร์อื่นแทนในเดือนมกราคม 2019 [ ‡ 4 ] ตามข้อมูลจากบล็อกของ archive.today เว็บไซต์นี้ได้บันทึกหน้าเว็บไว้ประมาณ 500 ล้านหน้าภายในปี 2021 [ ‡ 5 ]รวมทั้งหมด 700 เทราไบต์[ 4 ]
ในเดือนกรกฎาคม พ.ศ. 2556 archive.today เริ่มให้การสนับสนุนAPIของโครงการ Mementoที่ห้องปฏิบัติการแห่งชาติลอสอลาโมส [ 5 ] [ 6 ] เนื่องจากข้อจำกัดด้านงบประมาณที่ LANL โครงการ Memento จึงถูกยุบเลิกในเดือนกันยายน พ.ศ. 2568 [ 7 ] Archive.today เป็นหนึ่งในผู้ใช้รายใหญ่ที่ยังคงใช้งานโปรโตคอล Memento ต่อไปหลังจากโครงการถูกลดขนาดลง[ 8 ]การปิดโครงสร้างพื้นฐาน Memento ที่ LANL ในเดือนกันยายน พ.ศ. 2568 เกิดขึ้นท่ามกลางช่วงเวลาที่มีการตรวจสอบบริการนี้อย่างเข้มงวดมากขึ้น
สำนักข่าวอิสระของรัสเซียMediazonaใช้เว็บไซต์นี้เพื่อเก็บรักษาโปรไฟล์และโพสต์โซเชียลมีเดีย ของทหารรัสเซียที่เสียชีวิตใน สงครามรัสเซีย-ยูเครนซึ่งเป็นส่วนหนึ่งของ โครงการ Russia 200ซึ่งเป็นฐานข้อมูลที่มีชื่อของผู้เสียชีวิตทางทหารของรัสเซียที่ได้รับการยืนยันแล้ว ซึ่งรวบรวมร่วมกับBBC Russian Serviceและทีมอาสาสมัคร[ 9 ]หน้าโปรไฟล์ส่วนบุคคลบน200.zona.mediaเชื่อมโยงไปยังภาพหน้าจอของโพสต์โซเชียลมีเดียโดยญาติ ข่าวการเสียชีวิตในสื่อท้องถิ่น และหลักฐานโอเพนซอร์สอื่นๆ ที่ใช้ในการตรวจสอบการเสียชีวิตแต่ละครั้ง
ในช่วงต้นปี 2023 ทีมวิจัยจากมหาวิทยาลัยอัมสเตอร์ดัม ระบุว่า archive.today เป็น บริการจัดเก็บเอกสารแบบเปิดที่ใช้มากที่สุด ในหมู่องค์กร ตรวจสอบข้อเท็จจริงโดยอิงจากชุดข้อมูลของEuropean Digital Media Observatory เกี่ยวกับ สงครามรัสเซีย-ยูเครน[ 10 ] [ 11 ]
เมื่อวันที่ 5 สิงหาคม 2023 Jani Patokallio ได้เผยแพร่การสืบสวนเกี่ยวกับแหล่งเงินทุนของ archive.today และตัวตนของผู้ก่อตั้ง บนบล็อก Gyrovague ของเขา [ 12 ]
เมื่อวันที่ 30 ตุลาคม พ.ศ. 2568 สำนักงานสอบสวนกลาง ของสหรัฐอเมริกา (FBI) ได้ออกหมายเรียกไปยังTucowsผู้จดทะเบียนโดเมน archive.today หมายเรียกดังกล่าวระบุว่ามีวัตถุประสงค์เพื่อระบุตัวเจ้าของชื่อโดเมน archive.today และเป็นส่วนหนึ่งของการสอบสวนทางอาญาที่ดำเนินการโดย FBI ซึ่งไม่ได้เปิดเผยลักษณะของการสอบสวน[ 13 ] [ 14 ]หนังสือพิมพ์รายวันAra ของคาตาลัน ตีความการกระทำดังกล่าวว่าเป็นส่วนหนึ่งของแคมเปญเพื่อลงโทษทางอาญาอย่างเลือกปฏิบัติต่อคลังข้อมูลดิจิทัลนิรนามที่พึ่งพาเงินบริจาคจำนวนเล็กน้อย (เช่นAnna's Archive ซึ่ง Googleได้ลบออกจากผลการค้นหา) แม้ว่าชุดข้อมูลอุตสาหกรรมที่ใช้สำหรับการฝึกอบรมโมเดลภาษาขนาดใหญ่ (เช่นCommon Crawlซึ่งได้รับเงินทุนจากOpenAIและAnthropic ) ก็ไม่ได้ชดเชยผู้สร้างและเจ้าของเนื้อหาเช่นกัน[ 4 ]การรายงานข่าวเกี่ยวกับการออกหมายเรียกได้กล่าวถึงรายงานของ Patokallio ซึ่ง Patokallio กล่าวว่ามี "ข้อบ่งชี้หลายประการ" ว่าผู้ก่อตั้งมีฐานอยู่ในรัสเซีย[ 12 ]
ในเดือนพฤศจิกายน พ.ศ. 2568 ผู้ให้บริการ DNS AdGuard DNS รายงานว่าองค์กรWeb Abuse Association Defense (WAAD) ของฝรั่งเศสได้กดดันให้บล็อก archive.today และโดเมนมิเรอร์ WAAD อ้างว่า archive.today ปฏิเสธที่จะลบเนื้อหาเกี่ยวกับการล่วงละเมิดทางเพศเด็กตั้งแต่ปี พ.ศ. 2566 เมื่อ AdGuard ติดต่อ archive.today ทาง archive.today ได้ลบเนื้อหาดังกล่าว โดยระบุว่าไม่เคยได้รับการร้องเรียนเกี่ยวกับ URL เหล่านั้นมาก่อน AdGuard พบว่า WAAD น่าสงสัยเนื่องจากเป็นสมาคมที่เพิ่งจดทะเบียนและมีบทบาทในที่สาธารณะน้อยมาก โดยสังเกตเห็นหลักฐานการแอบอ้างเป็นทนายความชาวฝรั่งเศสตัวจริงในข้อร้องเรียนที่คล้ายกันของ WAAD ที่ส่งไปยังบริษัทอื่นๆ AdGuard ประกาศว่าจะยื่นเรื่องร้องเรียนทางอาญาต่อตำรวจฝรั่งเศส[ 15 ] [ 16 ]
การโจมตีGyrovagueและข้อจำกัดของ Wikipedia

เมื่อวันที่ 8 มกราคม 2026 Automattic ผู้ให้บริการโฮสติ้งของ Patokallio ได้แจ้งให้เขาทราบถึง ข้อร้องเรียน GDPRจาก "Nora" ซึ่งกล่าวหาว่า การสืบสวน Gyrovague ปี 2023 "มีข้อมูลส่วนบุคคลจำนวนมาก... นำเสนอในรูปแบบการเล่าเรื่องที่มีลักษณะหมิ่นประมาททั้งในด้านน้ำเสียงและบริบท" หลังจากที่ Patokallio ยื่นคำชี้แจงโต้แย้ง Automattic ก็เข้าข้างเขาและปล่อยให้โพสต์นั้นยังคงอยู่[ 17 ]
เมื่อวันที่ 14 มกราคม 2026 ปรากฏว่า archive.today ได้แก้ไข หน้า CAPTCHA โดยไม่แจ้งให้ทราบล่วงหน้า เพื่อส่งคำขอซ้ำไปยังGyrovagueซึ่งทำให้ผู้เข้าชมมีส่วนร่วมในการโจมตี DDOSต่อบล็อกโดยไม่รู้ตัว ในขณะเดียวกัน บล็อก archive.today ก็ได้โพสต์คำวิจารณ์สาธารณะหลายรายการต่อ Patokallio อีเมลที่ Patokallio เผยแพร่แสดงให้เห็นว่า archive.today ขอให้ลบรายงานของเขาออกชั่วคราว และต่อมาได้ข่มขู่เขาด้วย ภาพลามก อนาจารAI [ 12 ]
เมื่อวันที่ 20 กุมภาพันธ์ 2026 วิกิพีเดียภาษาอังกฤษได้แบนลิงก์ทั้งหมดไปยัง archive.today โดยอ้างถึงการโจมตี DDoS และหลักฐานว่าเนื้อหาที่เก็บถาวรถูกแก้ไข: [ 18 ]การอภิปรายพบว่าชื่อของ Nora ถูกแทนที่ด้วยชื่อของ Patokallio และ "Nora" น่าจะเป็นตัวตนที่ถูกนำมาใช้ — ชื่อนี้เป็นของบุคคลจริง ซึ่งความเชื่อมโยงเพียงอย่างเดียวกับ archive.today คือคำขอให้ลบเนื้อหาก่อนหน้านี้[ 18 ] [ 17 ]การตัดสินใจของชุมชนเกิดขึ้นแม้จะมีความกังวลเกี่ยวกับการรักษาความสามารถในการตรวจสอบเนื้อหา — ซึ่งถูกบั่นทอนบางส่วนจากการค้นพบการเปลี่ยนแปลง — [ 18 ]ในขณะที่ลบและแทนที่บริการเก็บถาวรที่ใหญ่เป็นอันดับสองที่ใช้ในโครงการต่างๆ ของมูลนิธิวิ กิมีเดีย [ 19 ]มูลนิธิวิกิมีเดียได้ระบุความพร้อมที่จะดำเนินการโดยไม่คำนึงถึงคำตัดสินของชุมชน[ 18 ] [ 19 ] Patokallio แสดงความพึงพอใจกับผลลัพธ์[ 3 ]
นี่ไม่ใช่ครั้งแรกที่วิกิพีเดียจำกัดลิงก์ไปยัง archive.today ในปี 2556 ชุมชนได้ขึ้นบัญชีดำ archive.is โดยอ้างถึงความกังวลเกี่ยวกับบอทเน็ตการสแปมลิงก์และวิธีการดำเนินการเว็บไซต์ที่ไม่โปร่งใส การตัดสินใจดังกล่าวถูกพลิกกลับในปี 2559 หลังจากมีการขอความคิดเห็นใหม่ และ archive.today ก็ถูกลบออกจากบัญชีดำสแปม ณ เวลาที่ถูกแบนในปี 2569 เว็บไซต์นี้เป็นบริการเก็บถาวรที่ใหญ่เป็นอันดับสองที่ใช้ในโครงการทั้งหมดของมูลนิธิวิกิมีเดียโดยมีลิงก์มากกว่า 695,000 ลิงก์กระจายอยู่ทั่วประมาณ 400,000 หน้า[ 18 ]
คุณสมบัติ
การเก็บถาวร
archive.today สามารถบันทึกหน้าเว็บแต่ละหน้าได้ตามคำขอของผู้ใช้โดยตรง[ 20 ] [ 21 ] [ ‡ 6 ]ตั้งแต่เริ่มแรก เว็บไซต์นี้รองรับการรวบรวมหน้าเว็บที่มีURL ที่มี ส่วนของ hash-bang ( #! ) ซึ่งปัจจุบันเลิกใช้แล้ว[ ‡ 7 ]เว็บไซต์จะบันทึกเฉพาะข้อความและรูปภาพ ไม่รวมXML , RTF , สเปรดชีต ( xlsหรือods ) และ เนื้อหา ที่ไม่ใช่แบบคงที่ อื่นๆ อย่างไรก็ตาม วิดีโอสำหรับบางเว็บไซต์ เช่นTwitterจะถูกบันทึกไว้[ ‡ 8 ]เว็บไซต์จะติดตามประวัติการบันทึกภาพหน้าจอ และขอการยืนยันก่อนเพิ่มภาพหน้าจอใหม่ของหน้าเว็บที่บันทึกไว้แล้ว[ 22 ] [ ‡ 9 ]เมื่อหน้าเว็บถูกเก็บถาวรแล้ว ผู้ใช้อินเทอร์เน็ตจะไม่สามารถลบหน้าเว็บนั้นได้โดยตรง[ ‡ 10 ]ผู้ใช้สามารถดาวน์โหลดหน้าเว็บที่เก็บถาวรเป็นไฟล์ ZIP ได้ ยกเว้นหน้าเว็บที่เก็บถาวรตั้งแต่วันที่ 29 พฤศจิกายน2019 เป็นต้นไป ,[ ‡ 11 ]เมื่อ archive.today เปลี่ยนเอ็นจิ้นเบราว์เซอร์จากPhantomJSเป็นChromium(ไม่ใช่แบบ headless) [ ‡ 12 ] archive.today ไม่ปฏิบัติตามrobots.txtเพราะทำหน้าที่ "เสมือนเป็นตัวแทนโดยตรงของผู้ใช้" [ ‡ 6 ]
หน้าเว็บจะถูกบันทึกที่ความกว้างของเบราว์เซอร์ 1,024 พิกเซลCSSจะถูกแปลงเป็นCSS แบบอินไลน์ โดยลบ การออกแบบเว็บแบบตอบสนองและตัวเลือกต่างๆ เช่น <p> :hoverและ:active<span> เนื้อหาที่สร้างขึ้นโดยใช้JavaScriptระหว่างกระบวนการรวบรวมข้อมูลจะปรากฏในสถานะคงที่[ ‡ 13 ] ชื่อคลาส HTML จะถูกเก็บรักษาไว้ภายใน old-classแอตทริบิวต์ <class>เมื่อเลือกข้อความแอปเพล็ต JavaScript จะสร้างส่วนของ URL ที่ปรากฏใน แถบที่อยู่ของเบราว์เซอร์ซึ่งจะไฮไลต์ส่วนของข้อความนั้นโดยอัตโนมัติเมื่อเข้าชมอีกครั้งสามารถคัดลอก หน้าเว็บ จาก archive.today ไปยังweb.archive.orgเป็นการสำรองข้อมูลระดับที่สอง ได้ แต่ archive.today จะไม่บันทึกภาพรวมในรูปแบบ WARCการคัดลอกจาก web.archive.org ไปยัง archive.today ก็สามารถทำได้เช่นกัน[ ‡ 14 ]แต่การคัดลอกมักใช้เวลานานกว่าการบันทึกโดยตรง

ขณะบันทึกหน้าเว็บ รายการ URL สำหรับองค์ประกอบแต่ละส่วนของหน้าเว็บ รวมถึงขนาดเนื้อหาสถานะ HTTPและประเภท MIMEจะแสดงขึ้น รายการนี้สามารถดูได้เฉพาะระหว่างกระบวนการรวบรวมข้อมูลเท่านั้นการลบโฆษณา ป๊อปอัพ หรือการขยายลิงก์จากหน้าเว็บที่เก็บถาวร สามารถทำได้โดยการขอให้เจ้าของดำเนินการในบล็อกของเขา[ ‡ 15 ]
ตามคำถามที่พบบ่อยของเว็บไซต์ archive.today ใช้เลเยอร์จัดเก็บข้อมูลบนApache HadoopและApache Accumuloโดยข้อมูลทั้งหมดจะถูกจัดเก็บไว้บนHadoop Distributed File System (HDFS) เนื้อหาข้อความจะถูกทำสำเนาสามครั้งบนเซิร์ฟเวอร์ในศูนย์ข้อมูลสองแห่ง ซึ่งทั้งสองแห่งตั้งอยู่ในยุโรป โดยอย่างน้อยหนึ่งแห่งให้บริการโดยOVH ผู้ให้บริการจากฝรั่งเศส ส่วนรูปภาพจะถูกทำสำเนาสองครั้ง[ ‡ 6 ]เว็บไซต์ไม่ได้จัดเก็บสแนปช็อตในรูปแบบ WARC [ ‡ 6 ]
ส่วนประกอบการดึงข้อมูลใช้เบราว์ เซอร์ Chromium เวอร์ชันที่แก้ไขแล้ว ตั้งแต่เดือนพฤศจิกายน 2019 โดยแทนที่เอ็นจิ้นPhantomJS รุ่นก่อนหน้า [ ‡ 6 ]
ค้นหา
แถบเครื่องมือการวิจัยช่วยให้สามารถใช้ตัวดำเนินการคำหลักขั้นสูงได้*โดย ใช้ อักขระตัวแทนเครื่องหมายอัญประกาศคู่จะระบุการค้นหาไปยังลำดับคำหลักที่แน่นอนที่มีอยู่ในชื่อเรื่องหรือในเนื้อหาของเว็บเพจ ในขณะที่ ตัวดำเนิน การ insiteจะจำกัดการค้นหาไปยังโดเมนอินเทอร์เน็ตที่เฉพาะเจาะจง[ ‡ 16 ]ในขณะที่บันทึกรายการแบบไดนามิกช่องค้นหาของ archive.today จะแสดงเฉพาะผลลัพธ์ที่เชื่อมโยงส่วนก่อนหน้าและส่วนถัดไปของรายการ (เช่น 20 ลิงก์สำหรับหน้า) [ ‡ 17 ]เว็บเพจอื่นๆ ที่บันทึกไว้จะถูกกรอง และบางครั้งอาจพบได้จากการปรากฏของเว็บเพจเหล่านั้น[ 22 ] คุณสมบัติการค้นหาได้รับการสนับสนุนโดย Google CustomSearch หากไม่พบผลลัพธ์ใดๆ archive.today จะพยายามใช้Yandex Search [ ‡ 18 ]
การข้ามกำแพงการชำระเงิน
archive.today ถูกใช้บ่อยครั้งเพื่อหลีกเลี่ยงการเก็บค่าบริการบนเว็บไซต์ข่าว เช่นเดียวกับบริการ12ftที่ เลิกใช้งานไปแล้ว [ 23 ]
การถกเถียงทางกฎหมายและจริยธรรม
การปฏิบัติในการแชร์ลิงก์ archive.today เพื่อหลีกเลี่ยงการเก็บค่าธรรมเนียมการเข้าถึงได้ก่อให้เกิดการถกเถียงทางกฎหมายและจริยธรรมในยุโรป ในประเทศเนเธอร์แลนด์ นักข่าว Peter Aanzee ได้ท้าทายแพทย์คนหนึ่งที่แชร์ลิงก์ archive.ph ไปยังบทความที่ต้องเสียค่าธรรมเนียมการเข้าถึงในDe Volkskrantโดยโต้แย้งว่าการแจกจ่ายสำเนาที่เก็บถาวรถือเป็นการละเมิดลิขสิทธิ์[ 24 ]การอภิปรายดังกล่าวอ้างอิงถึง หลักนิติศาสตร์ ของศาลยุติธรรมแห่งยุโรปเกี่ยวกับการเชื่อมโยงหลายมิติ โดยเฉพาะอย่างยิ่งคำตัดสิน GS Media v Sanomaในปี 2016 ซึ่งกำหนดว่าการเชื่อมโยงไปยังเนื้อหาที่เผยแพร่อย่างผิดกฎหมายอาจถือเป็นการละเมิดลิขสิทธิ์หากผู้เชื่อมโยงรู้หรือควรจะรู้ถึงความผิดกฎหมาย ซึ่งเป็นข้อสันนิษฐานที่ใช้โดยอัตโนมัติกับฝ่ายที่กระทำการเพื่อผลกำไร[ 24 ]
DPG Media ซึ่ง เป็นสำนักพิมพ์ที่ใหญ่ที่สุดของเนเธอร์แลนด์ยอมรับว่า archive.today เป็น "ปัญหาใหญ่สำหรับสำนักพิมพ์ (และนักข่าว) หลายแห่ง" แต่ตั้งข้อสังเกตว่าการบังคับใช้กฎหมายทำได้ยาก เนื่องจากเว็บไซต์นี้ดำเนินการโดยไม่เปิดเผยตัวตน โฮสต์อยู่บนเซิร์ฟเวอร์หลายแห่งที่เปลี่ยนตำแหน่งบ่อยครั้ง และปรากฏขึ้นอีกครั้งภายใต้โดเมนใหม่เมื่อโดเมนหนึ่งถูกปิดลง[ 24 ]
การเปรียบเทียบกับ Internet Archive
นักวิจารณ์ได้เปรียบเทียบ archive.today กับWayback MachineของInternet ArchiveบทความVolkskrantที่ต้องเสียค่าใช้จ่ายซึ่งแชร์ผ่าน archive.ph เดียวกันนั้น ก็ถูกเก็บถาวรไว้ใน Wayback Machine เช่นกัน ซึ่งแสดงให้เห็นว่าทั้งสองบริการสามารถใช้เพื่อหลีกเลี่ยงการเสียค่าใช้จ่ายได้ [ 24 ]เช่นเดียวกับ Wayback Machine archive.today ไม่ได้โฆษณาการหลีกเลี่ยงค่าใช้จ่ายในคุณสมบัติที่ระบุไว้ ความสามารถในการหลีกเลี่ยงค่าใช้จ่ายเป็นผลพลอยได้จากฟังก์ชันหลักของการเก็บถาวรหน้าเว็บตามที่ปรากฏต่อผู้เข้าชม[ 24 ]
เอเจนต์ AI
การสืบสวนในปี 2025 โดยนักข่าว Henk van Ess พบว่าแชทบอท AI—รวมถึง ChatGPT, Perplexity AI , Grok และClaude—ใช้ประโยชน์จากคลังข้อมูลเว็บเพื่อหลีกเลี่ยงกำแพงการชำระเงินระหว่างการค้นหาเว็บแบบเรียล ไทม์ [ 25 ]ในกรณีหนึ่งที่มีการบันทึกไว้ ChatGPT ดึงบทความฉบับเต็มจากThe Economistผ่าน archive.today จากนั้นสร้างการวิเคราะห์เศรษฐกิจห้าประเด็นในรูปแบบและศัพท์เฉพาะของสิ่งพิมพ์[ 25 ] Van Ess ระบุวิธีการหลีกเลี่ยงกำแพงการชำระเงินที่แตกต่างกันหกวิธีโดยระบบ AI ซึ่ง "การใช้ประโยชน์จากคลังข้อมูล"—การค้นหาสำเนาที่เก็บถาวรบนบริการต่างๆ เช่น archive.today และ Internet Archive—เป็นวิธีที่ตรงที่สุด[ 25 ]แตกต่างจากข้อกังวลที่บันทึกไว้เกี่ยวกับการฝึกอบรม AI สำหรับเนื้อหาที่ไม่ต้องชำระเงิน พฤติกรรมนี้เกี่ยวข้องกับการดึงข้อมูลแบบเรียลไทม์ผ่านสำเนาที่เก็บถาวรระหว่างการสอบถามแต่ละรายการ ซึ่งเป็นการขยายการหลีกเลี่ยงกำแพงการชำระเงินไปไกลกว่าผู้ใช้ที่เป็นมนุษย์ไปยังตัวแทนอัตโนมัติ[ 25 ]
งานวิจัยเชิงวิชาการ
การศึกษาในปี 2018 โดยนักวิจัยจากUniversity College London , University of Alabama at BirminghamและCyprus University of Technologyซึ่งตีพิมพ์ใน การประชุมนานาชาติ AAAIว่าด้วยเว็บและสื่อสังคมออนไลน์ (ICWSM) ได้วิเคราะห์ URL จำนวน 21 ล้านรายการจากฟีดสดของ archive.is และ URL ของ archive.is จำนวน 356,000 รายการที่แชร์บนReddit , Twitter , Gabและ บอร์ด / pol / ของ 4chanตลอดระยะเวลา 14 เดือน[ 26 ]การศึกษาพบว่าบทความข่าวและโพสต์บนโซเชียลมีเดียเป็นประเภทเนื้อหาที่ถูกเก็บถาวรบ่อยที่สุด ซึ่งอาจเป็นเพราะ "ลักษณะที่รับรู้ได้ว่าไม่ยั่งยืนและ/หรือเป็นที่ถกเถียง" [ 26 ]
นักวิจัยได้บันทึกว่า URL archive.is ถูกแชร์อย่างกว้างขวางในชุมชน " ชายขอบ " เช่น บอร์ด /pol/ ของ 4chan และsubreddit r/The_Donald ของ Redditทั้งเพื่อเก็บรักษาเนื้อหาที่อาจก่อให้เกิดความขัดแย้งและเพื่อกีดกันรายได้จากโฆษณาของสำนักข่าวที่ถูกมองว่ามีอุดมการณ์ที่ต่อต้าน[ 26 ]บอทควบคุมบน r/The_Donald จะบล็อกลิงก์โดยตรงไปยังเว็บไซต์ข่าวบางแห่งโดยอัตโนมัติ เช่น ลิงก์ไปยังNew York Daily News 46% ถูกเซ็นเซอร์ และกระตุ้นให้ผู้ใช้โพสต์ URL archive.is แทน[ 26 ]ผู้เขียนประเมินว่าThe Washington Postสูญเสียรายได้จากโฆษณาประมาณ 70,000 ดอลลาร์สหรัฐต่อปีเนื่องจากการแชร์สำเนาที่เก็บถาวรแทนที่จะใช้ลิงก์โดยตรงบน Reddit เพียงอย่างเดียว[ 26 ]
บน Reddit บอทเป็นผู้รับผิดชอบในการโพสต์ลิงก์ archive.is 44% และ ลิงก์ Wayback Machine 85% ในซับเรดดิตที่ศึกษา โดยมีผู้ดูแลเป็นผู้ขับเคลื่อนเพื่อลดปัญหาลิงก์เสีย[ 26 ]
การศึกษาในปี 2023 โดยนักวิจัยจากมหาวิทยาลัยอัมสเตอร์ดัมซึ่งเป็นส่วนหนึ่งของโครงการ vera.ai ได้ตรวจสอบบทความตรวจสอบข้อเท็จจริง 1,991 บทความจากชุดข้อมูล "สงครามในยูเครน" ของ European Digital Media Observatory จากลิงก์ที่ดึงออกมา 41,758 ลิงก์ มี 6,002 ลิงก์ที่เป็นหน้าเว็บที่เก็บถาวร archive.today เป็นบริการเก็บถาวรลิงก์ที่ใช้มากที่สุด คิดเป็น 44.1% นำหน้า Internet Archive/Wayback Machine (29.2%) และ Perma.cc (26.6%) [ 27 ]ผู้ตรวจสอบข้อเท็จจริงส่วนใหญ่ใช้บริการเหล่านี้เพื่อเก็บรักษาเนื้อหาชั่วคราวและเนื้อหาที่จำกัดเฉพาะแพลตฟอร์ม เช่น โพสต์ Facebook ที่ยากต่อการบันทึกเนื่องจากมาตรการป้องกันบอท[ 28 ]
มีจำหน่ายทั่วโลก
ออสเตรเลียและนิวซีแลนด์
ในเดือนมีนาคม พ.ศ. 2562 เว็บไซต์ดังกล่าวถูกบล็อกเป็นเวลาหกเดือนโดยผู้ให้บริการอินเทอร์เน็ตหลายรายในออสเตรเลียและนิวซีแลนด์ภายหลังเหตุการณ์กราดยิงที่มัสยิดไครสต์เชิร์ชเพื่อพยายามจำกัดการเผยแพร่ภาพเหตุการณ์ดังกล่าว[ 29 ] [ 30 ]
จีน
จากข้อมูลของGreatFire.orgเว็บไซต์ archive.today ถูกบล็อกในจีนแผ่นดินใหญ่ตั้งแต่เดือนมีนาคม2016 ,[ 31 ] archive.liตั้งแต่เดือนกันยายน2017 ,[ 32 ] archive.foตั้งแต่กรกฎาคม2561 ,[ 33 ]รวมถึง archive.phตั้งแต่เดือนธันวาคม2019 .[ 34 ]
ฟินแลนด์
เมื่อวันที่ 21 กรกฎาคม 2558 archive.today ได้บล็อกการเข้าถึงบริการจากที่อยู่ IP ของฟินแลนด์ ทั้งหมด โดยระบุในทวิตเตอร์ว่าพวกเขาทำเช่นนี้เพื่อหลีกเลี่ยงการขยายข้อพิพาทที่พวกเขาอ้างว่ามีกับรัฐบาลฟินแลนด์[ 35 ] [ 36 ]
นับตั้งแต่เกิดความขัดแย้งกับบล็อกเกอร์ชาวฟินแลนด์ในช่วงต้นปี 2026 เว็บไซต์แสดงcaptcha ที่ไม่สามารถผ่านได้ สำหรับผู้เข้าชมจากฟินแลนด์[ 37 ]
รัสเซีย
ในปี 2559 หน่วยงานสื่อสารของรัสเซียRoskomnadzorเริ่มปิดกั้นการเข้าถึง archive.is จากรัสเซีย[ 38 ] [ 39 ] [ 36 ]
เมื่อวันที่ 23 มีนาคม พ.ศ. 2569 archive.today และโดเมนมิเรอร์หลายแห่งถูกบล็อกโดยทางการรัสเซีย[ 40 ]
ดูเพิ่มเติม
- การเก็บรักษาข้อมูลดิจิทัล– แนวปฏิบัติเพื่อให้สามารถเข้าถึงข้อมูลดิจิทัลได้ในระยะยาว
- ลิงก์เสีย– URL ที่ใช้งานไม่ได้อีกต่อไป
- รายชื่อโครงการเก็บรักษาข้อมูลเว็บ
ลิงก์ภายนอก
- archive.todayที่วิกิของทีมเก็บข้อมูล
- คำแนะนำจาก Wikipedia:archive.today