ยูไอมา
UIMA ( / j u ˈ iː m ə / yoo- EE -mə ) [ 1 ]ซึ่งย่อมาจากUnstructured Information Management Architectureเป็นมาตรฐาน OASIS [ 2 ] สำหรับการวิเคราะห์เนื้อหาซึ่งเดิมพัฒนาขึ้นที่IBMโดยมี สถาปัตยกรรม ซอฟต์แวร์ส่วนประกอบสำหรับการพัฒนา การค้นพบ การประกอบ และการใช้งานการวิเคราะห์แบบหลายโมดอลสำหรับการวิเคราะห์ข้อมูลที่ไม่มีโครงสร้างและการบูรณาการกับเทคโนโลยีการค้นหา
โครงสร้าง
สถาปัตยกรรมของ UIMA สามารถพิจารณาได้ในสี่มิติ:
- เป็นการระบุอินเทอร์เฟซของส่วนประกอบต่างๆ ในไปป์ไลน์การวิเคราะห์ข้อมูล
- เป็นการอธิบายชุดรูปแบบการออกแบบ
- แนวคิดนี้เสนอวิธีการนำเสนอข้อมูลสองแบบ ได้แก่ การนำเสนอข้อมูลคำอธิบายประกอบในหน่วยความจำสำหรับการวิเคราะห์ที่มีประสิทธิภาพสูง และการนำเสนอข้อมูลคำอธิบายประกอบในรูปแบบ XML เพื่อการบูรณาการกับบริการเว็บระยะไกล
- ข้อเสนอแนะนี้เสนอบทบาทการพัฒนาที่อนุญาตให้ผู้ใช้ที่มีทักษะหลากหลายสามารถใช้เครื่องมือได้
การนำไปใช้และการใช้งาน
Apache UIMAซึ่งเป็นตัวอย่างการใช้งาน UIMA นั้นได้รับการดูแลโดยมูลนิธิซอฟต์แวร์ Apache
UIMA ถูกนำไปใช้ในโครงการซอฟต์แวร์หลายโครงการ:
- WatsonของIBM Researchใช้ UIMA สำหรับการวิเคราะห์ข้อมูลที่ไม่มีโครงสร้าง[ 4 ]
- ระบบวิเคราะห์ข้อความทางคลินิกและการสกัดความรู้ ( Apache cTAKES ) เป็นระบบที่ใช้ UIMA สำหรับการสกัดข้อมูลจากเวชระเบียน
- DKPro Coreคือชุดส่วนประกอบ UIMA ที่สามารถนำกลับมาใช้ใหม่ได้สำหรับการประมวลผลภาษาธรรมชาติทั่วไป
ดูเพิ่มเติม
ลิงก์ภายนอก
- หน้าหลักของ Apache UIMA