Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Sức khỏe - Y tế
Văn bản luật
Nông Lâm Ngư
Kỹ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Giới thiệu
Đăng ký
Đăng nhập
Tìm
Danh mục
Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Y tế sức khỏe
Văn bản luật
Nông lâm ngư
Kĩ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Thông tin
Điều khoản sử dụng
Quy định bảo mật
Quy chế hoạt động
Chính sách bản quyền
Giới thiệu
Đăng ký
Đăng nhập
0
Trang chủ
Luận Văn - Báo Cáo
Báo cáo khoa học
Báo cáo khoa học: "Toward Smaller, Faster, and Better Hierarchical Phrase-based SMT"
Đang chuẩn bị liên kết để tải về tài liệu:
Báo cáo khoa học: "Toward Smaller, Faster, and Better Hierarchical Phrase-based SMT"
Minh Nguyệt
80
4
pdf
Đang chuẩn bị nút TẢI XUỐNG, xin hãy chờ
Tải xuống
We investigate the use of Fisher’s exact significance test for pruning the translation table of a hierarchical phrase-based statistical machine translation system. In addition to the significance values computed by Fisher’s exact test, we introduce compositional properties to classify phrase pairs of same significance values. We also examine the impact of using significance values as a feature in translation models. | Toward Smaller Faster and Better Hierarchical Phrase-based SMT Mei Yang Dept. of Electrical Engineering University of Washington Seattle WA USA yangmei@u.washington.edu Jing Zheng SRI International Menlo Park CA USA zj@speech.sri.com Abstract We investigate the use of Fisher s exact significance test for pruning the translation table of a hierarchical phrase-based statistical machine translation system. In addition to the significance values computed by Fisher s exact test we introduce compositional properties to classify phrase pairs of same significance values. We also examine the impact of using significance values as a feature in translation models. Experimental results show that 1 to 2 BLEU improvements can be achieved along with substantial model size reduction in an Iraqi English two-way translation task. 1 Introduction Phrase-based translation Koehn et al. 2003 and hierarchical phrase-based translation Chiang 2005 are the state of the art in statistical machine translation SMT techniques. Both approaches typically employ very large translation tables extracted from word-aligned parallel data with many entries in the tables never being used in decoding. The redundancy of translation tables is not desirable in real-time applications e.g. speech-to-speech translation where speed and memory consumption are often critical concerns. In addition some translation pairs in a table are generated from training data errors and word alignment noise. Removing those pairs could lead to improved translation quality. Johnson et al. 2007 has presented a technique for pruning the phrase table in a phrasebased SMT system using Fisher s exact test. They compute the significance value of each phrase pair and prune the table by deleting phrase pairs with significance values smaller than a threshold. Their experimental results show that the size of the phrase table can be greatly reduced with no significant loss in translation quality. In this paper we extend the work in Johnson .
TÀI LIỆU LIÊN QUAN
Báo cáo khoa học: "Steps toward a Model of Linguistic Performance: A Preliminary Sketch"
Báo cáo khoa học: "Toward Automatically Assembling Hittite-Language Cuneiform Tablet Fragments into Larger Texts"
Báo cáo khoa học: "Toward finer-grained sentiment identification in product reviews through linguistic and ontological analyses"
Báo cáo khoa học: "Toward Smaller, Faster, and Better Hierarchical Phrase-based SMT"
Báo cáo khoa học: "Error Profiling: Toward a Model of English Acquisition for Deaf Learners"
Báo cáo khoa học: "Toward General-Purpose Learning for Information Extraction"
Báo cáo khoa học: "Toward a Plan-Based Understanding Model for Mixed-Initiative Dialogues"
Báo cáo khoa học: "Pharmacotherapy during neonatal extracorporeal membrane oxygenation: toward an evidence-based approach"
báo cáo khoa học: " Toward a treaty on safety and cost-effectiveness of pharmaceuticals and medical devices: enhancing an endangered global public good"
báo cáo khoa học: " Roadside sobriety tests and attitudes toward a regulated cannabis market"
crossorigin="anonymous">
Đã phát hiện trình chặn quảng cáo AdBlock
Trang web này phụ thuộc vào doanh thu từ số lần hiển thị quảng cáo để tồn tại. Vui lòng tắt trình chặn quảng cáo của bạn hoặc tạm dừng tính năng chặn quảng cáo cho trang web này.