Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Sức khỏe - Y tế
Văn bản luật
Nông Lâm Ngư
Kỹ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Giới thiệu
Đăng ký
Đăng nhập
Tìm
Danh mục
Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Y tế sức khỏe
Văn bản luật
Nông lâm ngư
Kĩ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Thông tin
Điều khoản sử dụng
Quy định bảo mật
Quy chế hoạt động
Chính sách bản quyền
Giới thiệu
Đăng ký
Đăng nhập
0
Trang chủ
Luận Văn - Báo Cáo
Báo cáo khoa học
Báo cáo khoa học: "A Unified Statistical Model for the Identification of English BaseNP"
tailieunhanh - Báo cáo khoa học: "A Unified Statistical Model for the Identification of English BaseNP"
This paper presents a novel statistical model for automatic identification of English baseNP. It uses two steps: the Nbest Part-Of-Speech (POS) tagging and baseNP identification given the N-best POS-sequences. Unlike the other approaches where the two steps are separated, we integrate them into a unified statistical framework. Our model also integrates lexical information. Finally, Viterbi algorithm is applied to make global search in the entire sentence, allowing us to obtain linear complexity for the entire process. . | A Unified Statistical Model for the Identification of English BaseNP Endong Xun Microsoft Research China No. 49 Zhichun Road Haidian District 100080 China i-edxun@ Ming Zhou Microsoft Research China No. 49 Zhichun Road Haidian District 100080 China Mingzhou@ Abstract This paper presents a novel statistical model for automatic identification of English baseNP. It uses two steps the N-best Part-Of-Speech POS tagging and baseNP identification given the N-best POS-sequences. Unlike the other approaches where the two steps are separated we integrate them into a unified statistical framework. Our model also integrates lexical information. Finally Viterbi algorithm is applied to make global search in the entire sentence allowing us to obtain linear complexity for the entire process. Compared with other methods using the same testing set our approach achieves in precision and in recall. The result is comparable with or better than the previously reported results. 1 Introduction Finding simple and non-recursive base Noun Phrase baseNP is an important subtask for many natural language processing applications such as partial parsing information retrieval and machine translation. A baseNP is a simple noun phrase that does not contain other noun phrase recursively for example the elements within . in the following example are baseNPs where NNS IN VBG etc are part-of-speech tags as defined in M. Marcus 1993 . Changning Huang Microsoft Research China No. 49 Zhichun Road Haidian District 100080 China cnhuang@ Measures NNS of IN manufacturing VBG activity NN fell VBD more RBR than IN the DT overall JJ measures NNS . . Figure 1 An example sentence with baseNP brackets A number of researchers have dealt with the problem of baseNP identification Church 1988 Bourigault 1992 Voutilainen 1993 Justeson Katz 1995 . Recently some researchers have made experiments with the same test corpus extracted from the 20th section of the Penn Treebank .
Linh San
65
8
pdf
Báo lỗi
Trùng lắp nội dung
Văn hóa đồi trụy
Phản động
Bản quyền
File lỗi
Khác
Upload
Tải xuống
đang nạp các trang xem trước
Bấm vào đây để xem trước nội dung
Tải xuống
TÀI LIỆU LIÊN QUAN
Cisco Unified Contact Center Express Solution Reference Network Design
104
61
0
Cisco Unified Contact Center Express Reference Network Design
93
49
0
Windows Server 2012 Unified Remote Access Planning and Deployment
328
68
0
The Unified Modeling Language Reference Manual
568
71
0
Cisco Unified Contact Center Enterprise
306
76
0
Configuring Cisco Unified Communications Manager and Unity Connection: A Step-by-Step Guide
699
70
0
Configuring Cisco Unified Communications Manager and Unity Connection, 2nd Edition
699
66
0
Joint Paths to the Future Force - A Report on Unified Quest 2004
1
82
0
Unified Signal Theory
1
58
0
Báo cáo khoa học: "A Unified Graph Model for Sentence-based Opinion Retrieval"
9
64
0
TÀI LIỆU XEM NHIỀU
Một Case Về Hematology (1)
8
461890
55
Giới thiệu :Lập trình mã nguồn mở
14
22745
61
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10915
531
Câu hỏi và đáp án bài tập tình huống Quản trị học
14
10094
447
Phân tích và làm rõ ý kiến sau: “Bài thơ Tự tình II vừa nói lên bi kịch duyên phận vừa cho thấy khát vọng sống, khát vọng hạnh phúc của Hồ Xuân Hương”
3
9543
104
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8305
1127
Tiểu luận: Nội dung tư tưởng Hồ Chí Minh về đạo đức
16
8251
423
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7869
2221
Đề tài: Dự án kinh doanh thời trang quần áo nữ
17
6716
253
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
5830
1413
TỪ KHÓA LIÊN QUAN
Báo cáo khoa học
A Unified Statistical Model
Identification of English BaseNP
Endong Xun
báo cáo khoa học
mô hình ngôn ngữ
xử lý ngôn ngữ tự nhiên
Bài giảng Xử lý ngôn ngữ tự nhiên
Ngôn ngữ tự nhiên
Kỹ thuật lập trình
Xử lý nhập nhằng ngữ nghĩa
Xử lý ngữ nghĩa
Xử lý ngôn ngữ
Natural Language Processing
Ngôn ngữ lập trình
Nhập nhằng cấu trúc
Tri thức về ngôn ngữ
Mô hình n gram
Dịch máy
Phương pháp dịch máy
Hiểu ngôn ngữ
Phân tích ngữ nghĩa
Phân loại tin tự động
Biểu diễn vị từ
Thuộc tính về sự kiện
Thuộc tính về sự kiện
Mô hình ngôn ngữ Google Book N grams
Mô hình ngôn ngữ KenLM
Phương pháp làm mịn
Tách từ tiếng Việt
Gán nhãn từ loại
Phân tích cú pháp
Nghĩa từ vựng
Phân giải nhập nhằng từ
Phân loại văn bản
Lexical chain
Phản hồi thông tin
Bài toán PTCP
Cấu trúc ngữ pháp
Phân tích cú pháp xác suất
CKY kết hợp xác suất
Văn phạm phi ngữ cảnh xác suất
Hình thái học
TÀI LIỆU MỚI ĐĂNG
Báo cáo khoa học: Loss of kinase activity in Mycobacterium tuberculosis multidomain protein Rv1364c
14
238
0
03-05-2024
B2B Content Marketing: 2012 Benchmarks, Budgets & Trends
17
140
0
03-05-2024
Hướng dẫn sử dụng Quickoffice cho Ipad và Iphone
13
154
0
03-05-2024
QUẢN LÝ CHẤT LƯỢNG KHÔNG KHÍ
75
139
0
03-05-2024
HƯỚNG DẪN SỬ DỤNG PHẦN MỀM CAITA part 9
18
130
0
03-05-2024
báo cáo hóa học:" Increased androgen receptor expression in serous carcinoma of the ovary is associated with an improved survival"
6
101
0
03-05-2024
Color Atlas of Ophthamology
165
88
0
03-05-2024
báo cáo hóa học:" Perceptions of rewards among volunteer caregivers of people living with AIDS working in faith-based organizations in South Africa: a qualitative study"
10
84
0
03-05-2024
MANAGING NANO-BIO-INFO-COGNO INNOVATIONS
380
94
0
03-05-2024
BỘ ĐỀ THI THỬ THỨ 12
4
86
0
03-05-2024
TÀI LIỆU HOT
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7869
2221
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
5830
1413
Ebook Chào con ba mẹ đã sẵn sàng
112
3773
1234
Ebook Tuyển tập đề bài và bài văn nghị luận xã hội: Phần 1
62
5338
1136
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8305
1127
Giáo trình Văn hóa kinh doanh - PGS.TS. Dương Thị Liễu
561
3522
645
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10915
531
Giáo trình Sinh lí học trẻ em: Phần 1 - TS Lê Thanh Vân
122
3698
525
Giáo trình Pháp luật đại cương: Phần 1 - NXB ĐH Sư Phạm
274
4080
517
Bài tập nhóm quản lý dự án: Dự án xây dựng quán cafe
35
4140
480
crossorigin="anonymous">
Đã phát hiện trình chặn quảng cáo AdBlock
Trang web này phụ thuộc vào doanh thu từ số lần hiển thị quảng cáo để tồn tại. Vui lòng tắt trình chặn quảng cáo của bạn hoặc tạm dừng tính năng chặn quảng cáo cho trang web này.