Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Sức khỏe - Y tế
Văn bản luật
Nông Lâm Ngư
Kỹ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Giới thiệu
Đăng ký
Đăng nhập
Tìm
Danh mục
Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Y tế sức khỏe
Văn bản luật
Nông lâm ngư
Kĩ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Thông tin
Điều khoản sử dụng
Quy định bảo mật
Quy chế hoạt động
Chính sách bản quyền
Giới thiệu
Đăng ký
Đăng nhập
0
Trang chủ
Luận Văn - Báo Cáo
Báo cáo khoa học
Báo cáo khoa học: "Joint Hebrew Segmentation and Parsing using a PCFG-LA Lattice Parser"
tailieunhanh - Báo cáo khoa học: "Joint Hebrew Segmentation and Parsing using a PCFG-LA Lattice Parser"
We experiment with extending a lattice parsing methodology for parsing Hebrew (Goldberg and Tsarfaty, 2008; Golderg et al., 2009) to make use of a stronger syntactic model: the PCFG-LA Berkeley Parser. We show that the methodology is very effective: using a small training set of about 5500 trees, we construct a parser which parses and segments unsegmented Hebrew text with an F-score of almost 80%, an error reduction of over 20% over the best previous result for this task. | Joint Hebrew Segmentation and Parsing using a PCFG-LA Lattice Parser Yoav Goldberg and Michael Elhadad Ben Gurion University of the Negev Department of Computer Science POB 653 Be er Sheva 84105 Israel yoavg elhadad @ Abstract We experiment with extending a lattice parsing methodology for parsing Hebrew Goldberg and Tsarfaty 2008 Golderg et al. 2009 to make use of a stronger syntactic model the PCFG-LA Berkeley Parser. We show that the methodology is very effective using a small training set of about 5500 trees we construct a parser which parses and segments unsegmented Hebrew text with an F-score of almost 80 an error reduction of over 20 over the best previous result for this task. This result indicates that lattice parsing with the Berkeley parser is an effective methodology for parsing over uncertain inputs. 1 Introduction Most work on parsing assumes that the lexical items in the yield of a parse tree are fully observed and correspond to space delimited tokens perhaps after a deterministic preprocessing step of tokeniza-tion. While this is mostly the case for English the situation is different in languages such as Chinese in which word boundaries are not marked and the Semitic languages of Hebrew and Arabic in which various particles corresponding to function words are agglutinated as affixes to content bearing words sharing the same space-delimited token. For example the Hebrew token bcl1 can be interpreted as the single noun meaning onion or as a sequence of a preposition and a noun b-cl meaning in the shadow . In such languages the sequence of lexical 1 We adopt here the transliteration scheme of Sima an et al. 2001 704 items corresponding to an input string is ambiguous and cannot be determined using a deterministic procedure. In this work we focus on constituency parsing of Modern Hebrew henceforth Hebrew from raw unsegmented text. A common method of approaching the discrepancy between input strings and space delimited tokens is using a .
Diễm Thúy
48
6
pdf
Báo lỗi
Trùng lắp nội dung
Văn hóa đồi trụy
Phản động
Bản quyền
File lỗi
Khác
Upload
Tải xuống
đang nạp các trang xem trước
Bấm vào đây để xem trước nội dung
Tải xuống
TÀI LIỆU LIÊN QUAN
Báo cáo khoa học: "Joint Hebrew Segmentation and Parsing using a PCFG-LA Lattice Parser"
6
41
0
TÀI LIỆU XEM NHIỀU
Một Case Về Hematology (1)
8
461962
55
Giới thiệu :Lập trình mã nguồn mở
14
23252
64
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
11014
533
Câu hỏi và đáp án bài tập tình huống Quản trị học
14
10217
452
Phân tích và làm rõ ý kiến sau: “Bài thơ Tự tình II vừa nói lên bi kịch duyên phận vừa cho thấy khát vọng sống, khát vọng hạnh phúc của Hồ Xuân Hương”
3
9581
106
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8428
1138
Tiểu luận: Nội dung tư tưởng Hồ Chí Minh về đạo đức
16
8299
423
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7900
2236
Đề tài: Dự án kinh doanh thời trang quần áo nữ
17
6871
257
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
6233
1512
TỪ KHÓA LIÊN QUAN
Báo cáo khoa học
Joint Hebrew Segmentation
Parsing using a PCFG LA Lattice Parser
Yoav Goldberg and Michael Elhadad Ben Gurion
báo cáo khoa học
báo cáo ngôn ngữ
ngôn ngữ tự nhiên
Bài giảng Xử lý ngôn ngữ tự nhiên
Xử lý ngôn ngữ tự nhiên
Kỹ thuật lập trình
Mô hình ngôn ngữ
Mô hình n gram
Dịch máy
Phương pháp dịch máy
Hiểu ngôn ngữ
Phân loại tin tự động
Tạo chí tin học
Điều khiển học
Truy vấn ngôn ngữ tự nhiên
Phép dịch truy vấn ngôn ngữ tự nhiên
Truy vấn SQL
Văn phạm ngữ nghĩa
Xử lý nhập nhằng ngữ nghĩa
Xử lý ngữ nghĩa
Phân tích ngữ nghĩa
Biểu diễn vị từ
Thuộc tính về sự kiện
Thuộc tính về sự kiện
Xử lý ngôn ngữ
Natural Language Processing
Ngôn ngữ lập trình
Nhập nhằng cấu trúc
Tri thức về ngôn ngữ
Mô hình ngôn ngữ Google Book N grams
Mô hình ngôn ngữ KenLM
Phương pháp làm mịn
Bài toán PTCP
Phân tích cú pháp
Cấu trúc ngữ pháp
Phân tích cú pháp xác suất
CKY kết hợp xác suất
Văn phạm phi ngữ cảnh xác suất
Hình thái học
Gán nhãn từ loại
Ngôn ngữ tự nhiên trong dịch máy
Hệ thống dịch máy
Phương pháp xây dựng bảng từ
Tác từ
Conditional random fields
Nhận dạng thực thể có tên
Đối tượng vật lý trừu tượng
Phân lớp văn bản
Biểu diễn nhị phân
Ma trận từ văn bản
Wolfram Alpha
Trích rút thông tin
Phương pháp Snowball
TÀI LIỆU MỚI ĐĂNG
Trading Strategies Profit Making Techniques For Stock_3
23
204
1
28-05-2024
XỬ TRÍ CHẤN THƯƠNG SỌ NÃO KÍN
1
127
1
28-05-2024
Quy Trình Canh Tác Cây Bông Vải
8
119
0
28-05-2024
Bảng màu theo chữ cái – V
11
111
1
28-05-2024
Phương pháp trăc nghiệm 7
6
115
0
28-05-2024
Giáo trình toán ứng dụng trong tin học part 5
28
143
3
28-05-2024
BỘ ĐỀ THI THỬ THỨ 12
4
98
0
28-05-2024
Các liệu pháp chăm sóc đặc biệt cho đôi chân
4
104
0
28-05-2024
ĐẠI TRÀNG THANH ÂM Ở THAI NHI VÀ SỎI THẬN TRẺ EM - NGƯỜI LỚN
5
102
0
28-05-2024
Microsoft SQL Server 2012 T-SQL Fundamentals
442
103
0
28-05-2024
TÀI LIỆU HOT
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7900
2236
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
6233
1512
Ebook Chào con ba mẹ đã sẵn sàng
112
3840
1272
Ebook Tuyển tập đề bài và bài văn nghị luận xã hội: Phần 1
62
5465
1141
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8428
1138
Giáo trình Văn hóa kinh doanh - PGS.TS. Dương Thị Liễu
561
3571
658
Giáo trình Sinh lí học trẻ em: Phần 1 - TS Lê Thanh Vân
122
3771
567
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
11014
533
Giáo trình Pháp luật đại cương: Phần 1 - NXB ĐH Sư Phạm
274
4200
525
Bài tập nhóm quản lý dự án: Dự án xây dựng quán cafe
35
4215
483
crossorigin="anonymous">
Đã phát hiện trình chặn quảng cáo AdBlock
Trang web này phụ thuộc vào doanh thu từ số lần hiển thị quảng cáo để tồn tại. Vui lòng tắt trình chặn quảng cáo của bạn hoặc tạm dừng tính năng chặn quảng cáo cho trang web này.