กลับไปหน้าบทความ

อ่าน 13 นาที

ไม่มีชื่อบทความ

archive.today (หรือที่รู้จักกันในชื่อ archive.is และโดเมนอื่นๆ) เป็น เว็บไซต์ เก็บถาวรเว็บ ที่บันทึก ภาพหน้าจอ ตามต้องการ รองรับ เว็บไซต์ที่ใช้ JavaScript จำนวนมาก เช่น Google...

คลังข้อมูลวันนี้

หน้าเว็บได้รับการป้องกันบางส่วน

archive.today (หรือที่รู้จักกันในชื่อarchive.isและโดเมนอื่นๆ) เป็น เว็บไซต์ เก็บถาวรเว็บที่บันทึกภาพหน้าจอตามต้องการ รองรับ เว็บไซต์ที่ใช้ JavaScriptจำนวนมาก เช่นGoogle MapsและX [ 1 ] archive.today บันทึกภาพหน้าจอสองภาพ: ภาพหนึ่งจำลองเว็บเพจต้นฉบับรวมถึงลิงก์ที่ใช้งานได้จริง อีกภาพหนึ่งเป็นภาพหน้าจอของหน้าเว็บ[ 2 ]

เว็บไซต์ดังกล่าวตกอยู่ภายใต้การตรวจสอบจากหลายรัฐบาลตั้งแต่ช่วงปลายทศวรรษ 2010 รวมถึงการสั่งห้ามในจีนและรัสเซีย และในปี 2025 สำนักงานสอบสวนกลาง ของสหรัฐฯ (FBI) ได้ออกหมายเรียกผู้ให้บริการจดทะเบียนโดเมนเพื่อระบุตัวเจ้าของชื่อโดเมน archive.today

ประวัติศาสตร์

archive.today ก่อตั้งขึ้นในปี 2012 ในฐานะเว็บอาร์ไคฟ์มีการกล่าวอ้างว่าได้จดทะเบียนเครื่องหมายการค้าในสาธารณรัฐเช็กในปี 2013 [ 3 ]เดิมทีเว็บไซต์นี้ใช้ชื่อแบรนด์ว่า archive.today แต่ได้เปลี่ยนเซิร์ฟเวอร์ หลัก เป็น archive.is ในเดือนพฤษภาคม 2015 [ ‡ 3 ]และเริ่มยกเลิกการใช้งานโดเมน archive.is และหันไปใช้เซิร์ฟเวอร์อื่นแทนในเดือนมกราคม 2019 [ ‡ 4 ] ตามข้อมูลจากบล็อกของ archive.today เว็บไซต์นี้ได้บันทึกหน้าเว็บไว้ประมาณ 500 ล้านหน้าภายในปี 2021 [ ‡ 5 ]รวมทั้งหมด 700 เทราไบต์[ 4 ]

ในเดือนกรกฎาคม พ.ศ. 2556 archive.today เริ่มให้การสนับสนุนAPIของโครงการ Mementoที่ห้องปฏิบัติการแห่งชาติลอสอลาโมส [ 5 ] [ 6 ] เนื่องจากข้อจำกัดด้านงบประมาณที่ LANL โครงการ Memento จึงถูกยุบเลิกในเดือนกันยายน พ.ศ. 2568 [ 7 ] Archive.today เป็นหนึ่งในผู้ใช้รายใหญ่ที่ยังคงใช้งานโปรโตคอล Memento ต่อไปหลังจากโครงการถูกลดขนาดลง[ 8 ]การปิดโครงสร้างพื้นฐาน Memento ที่ LANL ในเดือนกันยายน พ.ศ. 2568 เกิดขึ้นท่ามกลางช่วงเวลาที่มีการตรวจสอบบริการนี้อย่างเข้มงวดมากขึ้น

สำนักข่าวอิสระของรัสเซียMediazonaใช้เว็บไซต์นี้เพื่อเก็บรักษาโปรไฟล์และโพสต์โซเชียลมีเดีย ของทหารรัสเซียที่เสียชีวิตใน สงครามรัสเซีย-ยูเครนซึ่งเป็นส่วนหนึ่งของ โครงการ Russia 200ซึ่งเป็นฐานข้อมูลที่มีชื่อของผู้เสียชีวิตทางทหารของรัสเซียที่ได้รับการยืนยันแล้ว ซึ่งรวบรวมร่วมกับBBC Russian Serviceและทีมอาสาสมัคร[ 9 ]หน้าโปรไฟล์ส่วนบุคคลบน200.zona.mediaเชื่อมโยงไปยังภาพหน้าจอของโพสต์โซเชียลมีเดียโดยญาติ ข่าวการเสียชีวิตในสื่อท้องถิ่น และหลักฐานโอเพนซอร์สอื่นๆ ที่ใช้ในการตรวจสอบการเสียชีวิตแต่ละครั้ง

ในช่วงต้นปี 2023 ทีมวิจัยจากมหาวิทยาลัยอัมสเตอร์ดัม ระบุว่า archive.today เป็น บริการจัดเก็บเอกสารแบบเปิดที่ใช้มากที่สุด ในหมู่องค์กร ตรวจสอบข้อเท็จจริงโดยอิงจากชุดข้อมูลของEuropean Digital Media Observatory เกี่ยวกับ สงครามรัสเซีย-ยูเครน[ 10 ] [ 11 ]

เมื่อวันที่ 5 สิงหาคม 2023 Jani Patokallio ได้เผยแพร่การสืบสวนเกี่ยวกับแหล่งเงินทุนของ archive.today และตัวตนของผู้ก่อตั้ง บนบล็อก Gyrovague ของเขา [ 12 ]

เมื่อวันที่ 30 ตุลาคม พ.ศ. 2568 สำนักงานสอบสวนกลาง ของสหรัฐอเมริกา (FBI) ได้ออกหมายเรียกไปยังTucowsผู้จดทะเบียนโดเมน archive.today หมายเรียกดังกล่าวระบุว่ามีวัตถุประสงค์เพื่อระบุตัวเจ้าของชื่อโดเมน archive.today และเป็นส่วนหนึ่งของการสอบสวนทางอาญาที่ดำเนินการโดย FBI ซึ่งไม่ได้เปิดเผยลักษณะของการสอบสวน[ 13 ] [ 14 ]หนังสือพิมพ์รายวันAra ของคาตาลัน ตีความการกระทำดังกล่าวว่าเป็นส่วนหนึ่งของแคมเปญเพื่อลงโทษทางอาญาอย่างเลือกปฏิบัติต่อคลังข้อมูลดิจิทัลนิรนามที่พึ่งพาเงินบริจาคจำนวนเล็กน้อย (เช่นAnna's Archive ซึ่ง Googleได้ลบออกจากผลการค้นหา) แม้ว่าชุดข้อมูลอุตสาหกรรมที่ใช้สำหรับการฝึกอบรมโมเดลภาษาขนาดใหญ่ (เช่นCommon Crawlซึ่งได้รับเงินทุนจากOpenAIและAnthropic ) ก็ไม่ได้ชดเชยผู้สร้างและเจ้าของเนื้อหาเช่นกัน[ 4 ]การรายงานข่าวเกี่ยวกับการออกหมายเรียกได้กล่าวถึงรายงานของ Patokallio ซึ่ง Patokallio กล่าวว่ามี "ข้อบ่งชี้หลายประการ" ว่าผู้ก่อตั้งมีฐานอยู่ในรัสเซีย[ 12 ]

ในเดือนพฤศจิกายน พ.ศ. 2568 ผู้ให้บริการ DNS AdGuard DNS รายงานว่าองค์กรWeb Abuse Association Defense (WAAD) ของฝรั่งเศสได้กดดันให้บล็อก archive.today และโดเมนมิเรอร์ WAAD อ้างว่า archive.today ปฏิเสธที่จะลบเนื้อหาเกี่ยวกับการล่วงละเมิดทางเพศเด็กตั้งแต่ปี พ.ศ. 2566 เมื่อ AdGuard ติดต่อ archive.today ทาง archive.today ได้ลบเนื้อหาดังกล่าว โดยระบุว่าไม่เคยได้รับการร้องเรียนเกี่ยวกับ URL เหล่านั้นมาก่อน AdGuard พบว่า WAAD น่าสงสัยเนื่องจากเป็นสมาคมที่เพิ่งจดทะเบียนและมีบทบาทในที่สาธารณะน้อยมาก โดยสังเกตเห็นหลักฐานการแอบอ้างเป็นทนายความชาวฝรั่งเศสตัวจริงในข้อร้องเรียนที่คล้ายกันของ WAAD ที่ส่งไปยังบริษัทอื่นๆ AdGuard ประกาศว่าจะยื่นเรื่องร้องเรียนทางอาญาต่อตำรวจฝรั่งเศส[ 15 ] [ 16 ]

การโจมตีGyrovagueและข้อจำกัดของ Wikipedia

ภาพหน้าจอเครื่องมือสำหรับนักพัฒนาของ LibreWolf ในแท็บ "เครือข่าย" แสดงการเชื่อมต่ออัตโนมัติหลายรายการไปยัง "gyrovague.com" ที่สร้างโดยสคริปต์ JavaScript (ทั้งหมดถูกบล็อกโดยส่วนขยายเบราว์เซอร์ µBlock Origin)
ภาพหน้าจอแสดงเว็บไซต์ archive.today กำลังโจมตีแบบ DDoS ต่อเว็บไซต์ gyrovague.com

เมื่อวันที่ 8 มกราคม 2026 Automattic ผู้ให้บริการโฮสติ้งของ Patokallio ได้แจ้งให้เขาทราบถึง ข้อร้องเรียน GDPRจาก "Nora" ซึ่งกล่าวหาว่า การสืบสวน Gyrovague ปี 2023 "มีข้อมูลส่วนบุคคลจำนวนมาก... นำเสนอในรูปแบบการเล่าเรื่องที่มีลักษณะหมิ่นประมาททั้งในด้านน้ำเสียงและบริบท" หลังจากที่ Patokallio ยื่นคำชี้แจงโต้แย้ง Automattic ก็เข้าข้างเขาและปล่อยให้โพสต์นั้นยังคงอยู่[ 17 ]

เมื่อวันที่ 14 มกราคม 2026 ปรากฏว่า archive.today ได้แก้ไข หน้า CAPTCHA โดยไม่แจ้งให้ทราบล่วงหน้า เพื่อส่งคำขอซ้ำไปยังGyrovagueซึ่งทำให้ผู้เข้าชมมีส่วนร่วมในการโจมตี DDOSต่อบล็อกโดยไม่รู้ตัว ในขณะเดียวกัน บล็อก archive.today ก็ได้โพสต์คำวิจารณ์สาธารณะหลายรายการต่อ Patokallio อีเมลที่ Patokallio เผยแพร่แสดงให้เห็นว่า archive.today ขอให้ลบรายงานของเขาออกชั่วคราว และต่อมาได้ข่มขู่เขาด้วย ภาพลามก อนาจารAI [ 12 ]

เมื่อวันที่ 20 กุมภาพันธ์ 2026 วิกิพีเดียภาษาอังกฤษได้แบนลิงก์ทั้งหมดไปยัง archive.today โดยอ้างถึงการโจมตี DDoS และหลักฐานว่าเนื้อหาที่เก็บถาวรถูกแก้ไข: [ 18 ]การอภิปรายพบว่าชื่อของ Nora ถูกแทนที่ด้วยชื่อของ Patokallio และ "Nora" น่าจะเป็นตัวตนที่ถูกนำมาใช้ — ชื่อนี้เป็นของบุคคลจริง ซึ่งความเชื่อมโยงเพียงอย่างเดียวกับ archive.today คือคำขอให้ลบเนื้อหาก่อนหน้านี้[ 18 ] [ 17 ]การตัดสินใจของชุมชนเกิดขึ้นแม้จะมีความกังวลเกี่ยวกับการรักษาความสามารถในการตรวจสอบเนื้อหา — ซึ่งถูกบั่นทอนบางส่วนจากการค้นพบการเปลี่ยนแปลง — [ 18 ]ในขณะที่ลบและแทนที่บริการเก็บถาวรที่ใหญ่เป็นอันดับสองที่ใช้ในโครงการต่างๆ ของมูลนิธิวิ กิมีเดีย [ 19 ]มูลนิธิวิกิมีเดียได้ระบุความพร้อมที่จะดำเนินการโดยไม่คำนึงถึงคำตัดสินของชุมชน[ 18 ] [ 19 ] Patokallio แสดงความพึงพอใจกับผลลัพธ์[ 3 ]

นี่ไม่ใช่ครั้งแรกที่วิกิพีเดียจำกัดลิงก์ไปยัง archive.today ในปี 2556 ชุมชนได้ขึ้นบัญชีดำ archive.is โดยอ้างถึงความกังวลเกี่ยวกับบอทเน็ตการสแปมลิงก์และวิธีการดำเนินการเว็บไซต์ที่ไม่โปร่งใส การตัดสินใจดังกล่าวถูกพลิกกลับในปี 2559 หลังจากมีการขอความคิดเห็นใหม่ และ archive.today ก็ถูกลบออกจากบัญชีดำสแปม ณ เวลาที่ถูกแบนในปี 2569 เว็บไซต์นี้เป็นบริการเก็บถาวรที่ใหญ่เป็นอันดับสองที่ใช้ในโครงการทั้งหมดของมูลนิธิวิกิมีเดียโดยมีลิงก์มากกว่า 695,000 ลิงก์กระจายอยู่ทั่วประมาณ 400,000 หน้า[ 18 ]

คุณสมบัติ

การเก็บถาวร

archive.today สามารถบันทึกหน้าเว็บแต่ละหน้าได้ตามคำขอของผู้ใช้โดยตรง[ 20 ] [ 21 ] [ ‡ 6 ]ตั้งแต่เริ่มแรก เว็บไซต์นี้รองรับการรวบรวมหน้าเว็บที่มีURL ที่มี ส่วนของ hash-bang ( #! ) ซึ่งปัจจุบันเลิกใช้แล้ว[ ‡ 7 ]เว็บไซต์จะบันทึกเฉพาะข้อความและรูปภาพ ไม่รวมXML , RTF , สเปรดชีต ( xlsหรือods ) และ เนื้อหา ที่ไม่ใช่แบบคงที่ อื่นๆ อย่างไรก็ตาม วิดีโอสำหรับบางเว็บไซต์ เช่นTwitterจะถูกบันทึกไว้[ ‡ 8 ]เว็บไซต์จะติดตามประวัติการบันทึกภาพหน้าจอ และขอการยืนยันก่อนเพิ่มภาพหน้าจอใหม่ของหน้าเว็บที่บันทึกไว้แล้ว[ 22 ] [ ‡ 9 ]เมื่อหน้าเว็บถูกเก็บถาวรแล้ว ผู้ใช้อินเทอร์เน็ตจะไม่สามารถลบหน้าเว็บนั้นได้โดยตรง[ ‡ 10 ]ผู้ใช้สามารถดาวน์โหลดหน้าเว็บที่เก็บถาวรเป็นไฟล์ ZIP ได้ ยกเว้นหน้าเว็บที่เก็บถาวรตั้งแต่วันที่ 29 พฤศจิกายน2019 เป็นต้นไป  ,[ ‡ 11 ]เมื่อ archive.today เปลี่ยนเอ็นจิ้นเบราว์เซอร์จากPhantomJSเป็นChromium(ไม่ใช่แบบ headless) [ ‡ 12 ] archive.today ไม่ปฏิบัติตามrobots.txtเพราะทำหน้าที่ "เสมือนเป็นตัวแทนโดยตรงของผู้ใช้" [ ‡ 6 ]

หน้าเว็บจะถูกบันทึกที่ความกว้างของเบราว์เซอร์ 1,024 พิกเซลCSSจะถูกแปลงเป็นCSS แบบอินไลน์ โดยลบ การออกแบบเว็บแบบตอบสนองและตัวเลือกต่างๆ เช่น <p> :hoverและ:active<span> เนื้อหาที่สร้างขึ้นโดยใช้JavaScriptระหว่างกระบวนการรวบรวมข้อมูลจะปรากฏในสถานะคงที่[ ‡ 13 ] ชื่อคลาส HTML จะถูกเก็บรักษาไว้ภายใน old-classแอตทริบิวต์ <class>เมื่อเลือกข้อความแอปเพล็ต JavaScript จะสร้างส่วนของ URL ที่ปรากฏใน แถบที่อยู่ของเบราว์เซอร์ซึ่งจะไฮไลต์ส่วนของข้อความนั้นโดยอัตโนมัติเมื่อเข้าชมอีกครั้งสามารถคัดลอก หน้าเว็บ จาก archive.today ไปยังweb.archive.orgเป็นการสำรองข้อมูลระดับที่สอง ได้ แต่ archive.today จะไม่บันทึกภาพรวมในรูปแบบ WARCการคัดลอกจาก web.archive.org ไปยัง archive.today ก็สามารถทำได้เช่นกัน[ ‡ 14 ]แต่การคัดลอกมักใช้เวลานานกว่าการบันทึกโดยตรง

บันทึกจากหน้าเว็บวิกิพีเดียโดย archive.today เมื่อวันที่ 5 มกราคม 2026

ขณะบันทึกหน้าเว็บ รายการ URL สำหรับองค์ประกอบแต่ละส่วนของหน้าเว็บ รวมถึงขนาดเนื้อหาสถานะ HTTPและประเภท MIMEจะแสดงขึ้น รายการนี้สามารถดูได้เฉพาะระหว่างกระบวนการรวบรวมข้อมูลเท่านั้นการลบโฆษณา ป๊อปอัพ หรือการขยายลิงก์จากหน้าเว็บที่เก็บถาวร สามารถทำได้โดยการขอให้เจ้าของดำเนินการในบล็อกของเขา[ ‡ 15 ]

ตามคำถามที่พบบ่อยของเว็บไซต์ archive.today ใช้เลเยอร์จัดเก็บข้อมูลบนApache HadoopและApache Accumuloโดยข้อมูลทั้งหมดจะถูกจัดเก็บไว้บนHadoop Distributed File System (HDFS) เนื้อหาข้อความจะถูกทำสำเนาสามครั้งบนเซิร์ฟเวอร์ในศูนย์ข้อมูลสองแห่ง ซึ่งทั้งสองแห่งตั้งอยู่ในยุโรป โดยอย่างน้อยหนึ่งแห่งให้บริการโดยOVH ผู้ให้บริการจากฝรั่งเศส ส่วนรูปภาพจะถูกทำสำเนาสองครั้ง[ ‡ 6 ]เว็บไซต์ไม่ได้จัดเก็บสแนปช็อตในรูปแบบ WARC [ 6 ]

ส่วนประกอบการดึงข้อมูลใช้เบราว์ เซอร์ Chromium เวอร์ชันที่แก้ไขแล้ว ตั้งแต่เดือนพฤศจิกายน 2019 โดยแทนที่เอ็นจิ้นPhantomJS รุ่นก่อนหน้า [ ‡ 6 ]

แถบเครื่องมือการวิจัยช่วยให้สามารถใช้ตัวดำเนินการคำหลักขั้นสูงได้*โดย ใช้ อักขระตัวแทนเครื่องหมายอัญประกาศคู่จะระบุการค้นหาไปยังลำดับคำหลักที่แน่นอนที่มีอยู่ในชื่อเรื่องหรือในเนื้อหาของเว็บเพจ ในขณะที่ ตัวดำเนิน การ insiteจะจำกัดการค้นหาไปยังโดเมนอินเทอร์เน็ตที่เฉพาะเจาะจง[ ‡ 16 ]ในขณะที่บันทึกรายการแบบไดนามิกช่องค้นหาของ archive.today จะแสดงเฉพาะผลลัพธ์ที่เชื่อมโยงส่วนก่อนหน้าและส่วนถัดไปของรายการ (เช่น 20 ลิงก์สำหรับหน้า) [ ‡ 17 ]เว็บเพจอื่นๆ ที่บันทึกไว้จะถูกกรอง และบางครั้งอาจพบได้จากการปรากฏของเว็บเพจเหล่านั้น[ 22 ] คุณสมบัติการค้นหาได้รับการสนับสนุนโดย Google CustomSearch หากไม่พบผลลัพธ์ใดๆ archive.today จะพยายามใช้Yandex Search [ 18 ]

การข้ามกำแพงการชำระเงิน

archive.today ถูกใช้บ่อยครั้งเพื่อหลีกเลี่ยงการเก็บค่าบริการบนเว็บไซต์ข่าว เช่นเดียวกับบริการ12ftที่ เลิกใช้งานไปแล้ว [ 23 ]

การปฏิบัติในการแชร์ลิงก์ archive.today เพื่อหลีกเลี่ยงการเก็บค่าธรรมเนียมการเข้าถึงได้ก่อให้เกิดการถกเถียงทางกฎหมายและจริยธรรมในยุโรป ในประเทศเนเธอร์แลนด์ นักข่าว Peter Aanzee ได้ท้าทายแพทย์คนหนึ่งที่แชร์ลิงก์ archive.ph ไปยังบทความที่ต้องเสียค่าธรรมเนียมการเข้าถึงในDe Volkskrantโดยโต้แย้งว่าการแจกจ่ายสำเนาที่เก็บถาวรถือเป็นการละเมิดลิขสิทธิ์[ 24 ]การอภิปรายดังกล่าวอ้างอิงถึง หลักนิติศาสตร์ ของศาลยุติธรรมแห่งยุโรปเกี่ยวกับการเชื่อมโยงหลายมิติ โดยเฉพาะอย่างยิ่งคำตัดสิน GS Media v Sanomaในปี 2016 ซึ่งกำหนดว่าการเชื่อมโยงไปยังเนื้อหาที่เผยแพร่อย่างผิดกฎหมายอาจถือเป็นการละเมิดลิขสิทธิ์หากผู้เชื่อมโยงรู้หรือควรจะรู้ถึงความผิดกฎหมาย ซึ่งเป็นข้อสันนิษฐานที่ใช้โดยอัตโนมัติกับฝ่ายที่กระทำการเพื่อผลกำไร[ 24 ]

DPG Media ซึ่ง เป็นสำนักพิมพ์ที่ใหญ่ที่สุดของเนเธอร์แลนด์ยอมรับว่า archive.today เป็น "ปัญหาใหญ่สำหรับสำนักพิมพ์ (และนักข่าว) หลายแห่ง" แต่ตั้งข้อสังเกตว่าการบังคับใช้กฎหมายทำได้ยาก เนื่องจากเว็บไซต์นี้ดำเนินการโดยไม่เปิดเผยตัวตน โฮสต์อยู่บนเซิร์ฟเวอร์หลายแห่งที่เปลี่ยนตำแหน่งบ่อยครั้ง และปรากฏขึ้นอีกครั้งภายใต้โดเมนใหม่เมื่อโดเมนหนึ่งถูกปิดลง[ 24 ]

การเปรียบเทียบกับ Internet Archive

นักวิจารณ์ได้เปรียบเทียบ archive.today กับWayback MachineของInternet ArchiveบทความVolkskrantที่ต้องเสียค่าใช้จ่ายซึ่งแชร์ผ่าน archive.ph เดียวกันนั้น ก็ถูกเก็บถาวรไว้ใน Wayback Machine เช่นกัน ซึ่งแสดงให้เห็นว่าทั้งสองบริการสามารถใช้เพื่อหลีกเลี่ยงการเสียค่าใช้จ่ายได้ [ 24 ]เช่นเดียวกับ Wayback Machine archive.today ไม่ได้โฆษณาการหลีกเลี่ยงค่าใช้จ่ายในคุณสมบัติที่ระบุไว้ ความสามารถในการหลีกเลี่ยงค่าใช้จ่ายเป็นผลพลอยได้จากฟังก์ชันหลักของการเก็บถาวรหน้าเว็บตามที่ปรากฏต่อผู้เข้าชม[ 24 ]

เอเจนต์ AI

การสืบสวนในปี 2025 โดยนักข่าว Henk van Ess พบว่าแชทบอท AI—รวมถึง ChatGPT, Perplexity AI , Grok และClaude—ใช้ประโยชน์จากคลังข้อมูลเว็บเพื่อหลีกเลี่ยงกำแพงการชำระเงินระหว่างการค้นหาเว็บแบบเรียล ไทม์ [ 25 ]ในกรณีหนึ่งที่มีการบันทึกไว้ ChatGPT ดึงบทความฉบับเต็มจากThe Economistผ่าน archive.today จากนั้นสร้างการวิเคราะห์เศรษฐกิจห้าประเด็นในรูปแบบและศัพท์เฉพาะของสิ่งพิมพ์[ 25 ] Van Ess ระบุวิธีการหลีกเลี่ยงกำแพงการชำระเงินที่แตกต่างกันหกวิธีโดยระบบ AI ซึ่ง "การใช้ประโยชน์จากคลังข้อมูล"—การค้นหาสำเนาที่เก็บถาวรบนบริการต่างๆ เช่น archive.today และ Internet Archive—เป็นวิธีที่ตรงที่สุด[ 25 ]แตกต่างจากข้อกังวลที่บันทึกไว้เกี่ยวกับการฝึกอบรม AI สำหรับเนื้อหาที่ไม่ต้องชำระเงิน พฤติกรรมนี้เกี่ยวข้องกับการดึงข้อมูลแบบเรียลไทม์ผ่านสำเนาที่เก็บถาวรระหว่างการสอบถามแต่ละรายการ ซึ่งเป็นการขยายการหลีกเลี่ยงกำแพงการชำระเงินไปไกลกว่าผู้ใช้ที่เป็นมนุษย์ไปยังตัวแทนอัตโนมัติ[ 25 ]

งานวิจัยเชิงวิชาการ

การศึกษาในปี 2018 โดยนักวิจัยจากUniversity College London , University of Alabama at BirminghamและCyprus University of Technologyซึ่งตีพิมพ์ใน การประชุมนานาชาติ AAAIว่าด้วยเว็บและสื่อสังคมออนไลน์ (ICWSM) ได้วิเคราะห์ URL จำนวน 21 ล้านรายการจากฟีดสดของ archive.is และ URL ของ archive.is จำนวน 356,000 รายการที่แชร์บนReddit , Twitter , Gabและ บอร์ด / pol / ของ 4chanตลอดระยะเวลา 14 เดือน[ 26 ]การศึกษาพบว่าบทความข่าวและโพสต์บนโซเชียลมีเดียเป็นประเภทเนื้อหาที่ถูกเก็บถาวรบ่อยที่สุด ซึ่งอาจเป็นเพราะ "ลักษณะที่รับรู้ได้ว่าไม่ยั่งยืนและ/หรือเป็นที่ถกเถียง" [ 26 ]

นักวิจัยได้บันทึกว่า URL archive.is ถูกแชร์อย่างกว้างขวางในชุมชน " ชายขอบ " เช่น บอร์ด /pol/ ของ 4chan และsubreddit r/The_Donald ของ Redditทั้งเพื่อเก็บรักษาเนื้อหาที่อาจก่อให้เกิดความขัดแย้งและเพื่อกีดกันรายได้จากโฆษณาของสำนักข่าวที่ถูกมองว่ามีอุดมการณ์ที่ต่อต้าน[ 26 ]บอทควบคุมบน r/The_Donald จะบล็อกลิงก์โดยตรงไปยังเว็บไซต์ข่าวบางแห่งโดยอัตโนมัติ เช่น ลิงก์ไปยังNew York Daily News 46% ถูกเซ็นเซอร์ และกระตุ้นให้ผู้ใช้โพสต์ URL archive.is แทน[ 26 ]ผู้เขียนประเมินว่าThe Washington Postสูญเสียรายได้จากโฆษณาประมาณ 70,000 ดอลลาร์สหรัฐต่อปีเนื่องจากการแชร์สำเนาที่เก็บถาวรแทนที่จะใช้ลิงก์โดยตรงบน Reddit เพียงอย่างเดียว[ 26 ]

บน Reddit บอทเป็นผู้รับผิดชอบในการโพสต์ลิงก์ archive.is 44% และ ลิงก์ Wayback Machine 85% ในซับเรดดิตที่ศึกษา โดยมีผู้ดูแลเป็นผู้ขับเคลื่อนเพื่อลดปัญหาลิงก์เสีย[ 26 ]

การศึกษาในปี 2023 โดยนักวิจัยจากมหาวิทยาลัยอัมสเตอร์ดัมซึ่งเป็นส่วนหนึ่งของโครงการ vera.ai ได้ตรวจสอบบทความตรวจสอบข้อเท็จจริง 1,991 บทความจากชุดข้อมูล "สงครามในยูเครน" ของ European Digital Media Observatory จากลิงก์ที่ดึงออกมา 41,758 ลิงก์ มี 6,002 ลิงก์ที่เป็นหน้าเว็บที่เก็บถาวร archive.today เป็นบริการเก็บถาวรลิงก์ที่ใช้มากที่สุด คิดเป็น 44.1% นำหน้า Internet Archive/Wayback Machine (29.2%) และ Perma.cc (26.6%) [ 27 ]ผู้ตรวจสอบข้อเท็จจริงส่วนใหญ่ใช้บริการเหล่านี้เพื่อเก็บรักษาเนื้อหาชั่วคราวและเนื้อหาที่จำกัดเฉพาะแพลตฟอร์ม เช่น โพสต์ Facebook ที่ยากต่อการบันทึกเนื่องจากมาตรการป้องกันบอท[ 28 ]

มีจำหน่ายทั่วโลก

ออสเตรเลียและนิวซีแลนด์

ในเดือนมีนาคม พ.ศ. 2562 เว็บไซต์ดังกล่าวถูกบล็อกเป็นเวลาหกเดือนโดยผู้ให้บริการอินเทอร์เน็ตหลายรายในออสเตรเลียและนิวซีแลนด์ภายหลังเหตุการณ์กราดยิงที่มัสยิดไครสต์เชิร์ชเพื่อพยายามจำกัดการเผยแพร่ภาพเหตุการณ์ดังกล่าว[ 29 ] [ 30 ]

จีน

จากข้อมูลของGreatFire.orgเว็บไซต์ archive.today ถูกบล็อกในจีนแผ่นดินใหญ่ตั้งแต่เดือนมีนาคม2016 ,[ 31 ] archive.liตั้งแต่เดือนกันยายน2017 ,[ 32 ] archive.foตั้งแต่กรกฎาคม2561 ,[ 33 ]รวมถึง archive.phตั้งแต่เดือนธันวาคม2019 .[ 34 ]

ฟินแลนด์

เมื่อวันที่ 21 กรกฎาคม 2558 archive.today ได้บล็อกการเข้าถึงบริการจากที่อยู่ IP ของฟินแลนด์ ทั้งหมด โดยระบุในทวิตเตอร์ว่าพวกเขาทำเช่นนี้เพื่อหลีกเลี่ยงการขยายข้อพิพาทที่พวกเขาอ้างว่ามีกับรัฐบาลฟินแลนด์[ 35 ] [ 36 ]

นับตั้งแต่เกิดความขัดแย้งกับบล็อกเกอร์ชาวฟินแลนด์ในช่วงต้นปี 2026 เว็บไซต์แสดงcaptcha ที่ไม่สามารถผ่านได้ สำหรับผู้เข้าชมจากฟินแลนด์[ 37 ]

รัสเซีย

ในปี 2559 หน่วยงานสื่อสารของรัสเซียRoskomnadzorเริ่มปิดกั้นการเข้าถึง archive.is จากรัสเซีย[ 38 ] [ 39 ] [ 36 ]

เมื่อวันที่ 23 มีนาคม พ.ศ. 2569 archive.today และโดเมนมิเรอร์หลายแห่งถูกบล็อกโดยทางการรัสเซีย[ 40 ]

ดูเพิ่มเติม

สรุปเนื้อหา

ข้อมูลสำคัญจากบทความ

ข้อมูลสำคัญเกี่ยวกับ ไม่มีชื่อบทความ

archive.today (หรือที่รู้จักกันในชื่อ archive.is และโดเมนอื่นๆ) เป็น เว็บไซต์ เก็บถาวรเว็บ ที่บันทึก ภาพหน้าจอ ตามต้องการ รองรับ เว็บไซต์ที่ใช้ JavaScript จำนวนมาก เช่น Google...

ประวัติศาสตร์

archive.today ก่อตั้งขึ้นในปี 2012 ในฐานะ เว็บอาร์ไคฟ์ มีการกล่าวอ้างว่าได้จดทะเบียนเครื่องหมายการค้าใน สาธารณรัฐเช็ก ในปี 2013 [ 3 ] เดิมทีเว็บไซต์นี้ใช้ชื่อแบรนด์ว่า archive.today แต่ได้เปลี่ยน เซิร์ฟเวอร์ หลัก เป็น archive.

การโจมตี Gyrovague และข้อจำกัดของ Wikipedia

เมื่อวันที่ 8 มกราคม 2026 Automattic ผู้ให้บริการโฮสติ้งของ Patokallio ได้แจ้งให้เขาทราบถึง ข้อร้องเรียน GDPR จาก "Nora" ซึ่งกล่าวหาว่า การสืบสวน Gyrovague ปี 2023 "มีข้อมูลส่วนบุคคลจำนวนมาก...

การเก็บถาวร

archive.today สามารถบันทึกหน้าเว็บแต่ละหน้าได้ตามคำขอของผู้ใช้โดยตรง [ 20 ] [ 21 ] [ ‡ 6 ] ตั้งแต่เริ่มแรก เว็บไซต์นี้รองรับ การรวบรวม หน้าเว็บที่มี URL ที่มี ส่วนของ hash-bang ( #!