Translation Memory, thường gọi là bộ nhớ dịch, có thể giúp dự án lớn tái sử dụng các đoạn đã dịch, tăng tính nhất quán và nhận diện phần thay đổi. Nhưng đây không phải kho câu được sao chép tự động mà không kiểm tra. Hiệu quả và mức tiết kiệm phụ thuộc chất lượng dữ liệu, mức độ lặp, ngữ cảnh, quyền sử dụng và cách báo giá được thống nhất.
Translation Memory lưu những gì?
Bộ nhớ dịch lưu các cặp đoạn nguồn và đoạn đích đã được dịch. Khi gặp nội dung giống hoặc gần giống, công cụ có thể đề xuất kết quả trước đây cho người dịch. Trados giải thích về Translation Memory rằng mỗi đơn vị gồm nguồn và bản dịch, còn kết quả có thể là trùng hoàn toàn hoặc tương đồng một phần.
Translation Memory khác dịch máy. Nó không tự tạo bản dịch mới theo cùng cách một hệ thống dịch tự động làm, mà tìm lại nội dung đã lưu. Tuy vậy, việc một đoạn từng được dịch không chứng minh nó đúng cho tài liệu hiện tại. Người xử lý vẫn phải xem ngữ cảnh và thay đổi.
Nó cũng khác bảng thuật ngữ. Bảng thuật ngữ ghi khái niệm, cách gọi và phạm vi; bộ nhớ dịch lưu câu hoặc đoạn. Hai nguồn có thể hỗ trợ nhau nhưng không thay thế nhau. Một thuật ngữ sai trong bản cũ có thể lặp lại nhiều lần nếu không được quản lý.
Dự án lớn được lợi ở những điểm nào?
Nhận diện phần lặp
Hướng dẫn các model cùng dòng máy có thể dùng chung nhiều đoạn. Công cụ giúp nhận diện phần trùng để người dịch tập trung vào nội dung mới. Cần kiểm tra các khác biệt nhỏ như mã, phủ định, giá trị hoặc điều kiện vì chúng có thể thay đổi hoàn toàn ý nghĩa.
Giữ câu lặp nhất quán
Thông báo giao diện, tên mục và câu cảnh báo lặp có thể được xử lý cùng cách khi ngữ cảnh tương đương. Điều này giúp người đọc dễ nhận diện. Nếu cần ngoại lệ, phải ghi rõ để tránh công cụ ép thống nhất sai.
Hỗ trợ cập nhật phiên bản
Khi tài liệu mới thay một số đoạn, bộ nhớ dịch giúp so phần cũ và phần mới. Người quản lý vẫn cần danh mục phiên bản và thay đổi nguồn. Translation Memory không tự biết tệp nào là bản phát hành chính thức nếu dữ liệu đưa vào không có quản trị.
Hỗ trợ dự toán
Phân tích có thể cho biết lượng nội dung mới, trùng hoàn toàn và gần giống. Báo giá có thể dựa trên các nhóm này nếu hai bên thống nhất cách tính. Không nên mặc định mọi phần trùng đều miễn phí vì vẫn có thể cần kiểm tra, dàn trang và quản lý dự án.
Khi nào mức tiết kiệm không như kỳ vọng?
Nếu các tệp ít lặp, khác chuyên ngành hoặc thay đổi cách viết liên tục, tỷ lệ tận dụng có thể thấp. Nhiều đoạn gần giống nhưng chứa thông số khác vẫn cần rà kỹ. Một con số “phần trăm trùng” không nên được hiểu trực tiếp là phần trăm giảm tổng giá.
Dữ liệu cũ kém chất lượng cũng tạo thêm công việc. Nếu bản dịch trước chưa duyệt, thuật ngữ không còn dùng hoặc nguồn–đích bị lệch hàng, đề xuất từ bộ nhớ có thể gây lỗi. Cần làm sạch hoặc xác định dữ liệu chỉ tham khảo trước khi đưa vào quy trình.
Định dạng và công cụ có thể ảnh hưởng khả năng phân tích. Chữ trong hình, scan hoặc một số tệp thiết kế có thể chưa được nhận diện như văn bản thông thường. Phần xử lý tệp và bố cục vẫn là công việc riêng ngoài lượng từ được tái sử dụng.
Bốn khó khăn của doanh nghiệp và giải pháp
Không biết bộ nhớ dịch thuộc về ai
Thỏa thuận trước về quyền sở hữu, sử dụng, lưu giữ và bàn giao. Một số nhà cung cấp có quy trình hoặc định dạng riêng. Không nên đợi đến khi đổi nhà cung cấp mới hỏi dữ liệu có được xuất hay không.
Có nhiều bộ nhớ từ các nguồn khác nhau
Kiểm tra nguồn gốc, cặp ngôn ngữ, khách hàng, phiên bản và trạng thái duyệt. Không trộn dữ liệu của dự án khác nếu không có quyền hoặc không phù hợp. Có thể cần tách theo dòng sản phẩm rồi xác định mức ưu tiên.
Bản cũ chứa thuật ngữ đã thay đổi
Cập nhật bảng thuật ngữ và đánh dấu cách gọi không còn dùng. Khi sửa Translation Memory, cần xem phạm vi và những câu liên quan; thay tự động một chuỗi có thể làm sai ngữ cảnh khác. Lưu lịch sử quyết định nếu dự án kéo dài.
Phân tích của hai bên không giống nhau
Hỏi phiên bản nguồn, quy tắc tách đoạn, dữ liệu tham chiếu và nhóm trùng được dùng. So tổng phạm vi cùng điều kiện thay vì chỉ so tỷ lệ. Nếu cần, yêu cầu bảng phân tích đủ để kiểm tra nhưng không đòi dữ liệu thuộc khách hàng khác.
Cách chuẩn bị dữ liệu trước dự án
Tập hợp nguồn và bản dịch đã duyệt theo cặp tương ứng. Ghi sản phẩm, phiên bản, thời điểm và trạng thái. Loại bỏ hoặc tách nội dung không có quyền sử dụng. Nếu chỉ có bản đích mà không có nguồn tương ứng, chưa thể coi đó là một bộ nhớ dịch chuẩn.
Cung cấp bảng thuật ngữ và hướng dẫn phong cách mới nhất. Xác định dữ liệu nào có ưu tiên khi các bản cũ mâu thuẫn. Với bộ rất lớn, có thể kiểm tra mẫu và làm sạch theo nhóm thay vì nhập tất cả rồi xử lý lỗi trong lúc dịch.
Nếu doanh nghiệp chưa có Translation Memory, dự án mới vẫn có thể tạo nền tảng cho lần sau. Điều kiện là thống nhất cách lưu, kiểm tra và quyền. Không cần tự mua công cụ trước khi hỏi nhà cung cấp; hãy bắt đầu từ nhu cầu cập nhật và tái sử dụng thực tế.
Cách đọc báo cáo phân tích
Báo cáo thường chia nội dung mới, trùng hoàn toàn và tương đồng theo các mức. Tên nhóm có thể khác giữa công cụ. Doanh nghiệp nên hỏi đơn vị tính, phạm vi tệp và cách các nhóm liên hệ với giá, không tự chuyển một báo cáo thành báo giá.
| Nhóm nội dung | Câu hỏi cần đặt | | --- | --- | | Mới | Đã bao gồm chữ trong hình và tệp nhúng chưa? | | Trùng hoàn toàn | Có cần xem ngữ cảnh, số liệu và bố cục không? | | Gần giống | Khác ở đâu và cách rà soát được tính thế nào? | | Lặp trong dự án | Đoạn đầu tiên và các lần sau được xử lý ra sao? | | Ngoài phân tích | Dàn trang, chuyển đổi tệp và quản lý có nằm trong giá không? |
Một phân tích chỉ đúng với bộ nguồn tại thời điểm chạy. Nếu thêm tệp hoặc thay phiên bản, cần cập nhật. Hãy lưu báo cáo cùng danh mục nguồn để tránh dùng lại con số cho một phạm vi khác.
Kiểm soát chất lượng khi tái sử dụng
Người dịch phải xem đề xuất trong câu, chương và sản phẩm. Các mã, số và phủ định cần đặc biệt chú ý. Nếu nguồn mới gần giống nhưng khác điều kiện, không nên chỉ sửa một từ mà bỏ qua cấu trúc liên quan.
Sau khi cập nhật, cần rà soát nhất quán và bản dàn trang. Quyết định thuật ngữ mới phải được phản ánh vào dữ liệu tương lai. Nếu chỉ sửa tệp đích nhưng không cập nhật nguồn tham chiếu, cùng đề xuất sai có thể xuất hiện ở đợt sau.
Giải đáp nhanh: 6 câu hỏi thường gặp
Translation Memory có tự dịch tài liệu không?
Nó chủ yếu lưu và đề xuất các đoạn đã dịch. Người dịch vẫn phải xử lý nội dung mới và đánh giá đề xuất theo ngữ cảnh; không nên coi đây là bảo đảm tự động.
Có bộ nhớ dịch thì phần lặp miễn phí không?
Không nên mặc định. Phần lặp có thể cần kiểm tra, quản lý và dàn trang. Cách tính phải được nêu trong báo giá cụ thể.
Có thể dùng bản dịch cũ để tạo Translation Memory không?
Có thể nếu có nguồn tương ứng, quyền sử dụng và chất lượng phù hợp. Cần kiểm tra căn chỉnh, phiên bản và thuật ngữ trước khi dùng làm dữ liệu chuẩn.
Bộ nhớ dịch có chứa thông tin mật không?
Có thể, vì nó lưu nội dung nguồn và đích. Cần kiểm soát quyền, lưu trữ, tái sử dụng và bàn giao như các dữ liệu dự án khác.
Có thể chuyển Translation Memory sang nhà cung cấp khác không?
Phụ thuộc quyền và định dạng đã thỏa thuận. Nên hỏi khả năng xuất, phạm vi dữ liệu và điều kiện bàn giao ngay từ đầu.
Translation Memory và AI có giống nhau không?
Không. Bộ nhớ dịch truy xuất đoạn đã lưu; AI có thể tạo đầu ra mới. Một quy trình có thể dùng cả hai, nhưng cần kiểm soát và đánh giá riêng.
Trao đổi khả năng tận dụng tài liệu cũ
Khi gửi yêu cầu dịch kỹ thuật, hãy cho biết bạn có nguồn, bản dịch cũ hay bảng thuật ngữ nào được phép sử dụng. Trong dịch vụ dịch tài liệu kỹ thuật, Tân Việt có thể xem phạm vi và trao đổi cách phân tích trước khi xác nhận báo giá cụ thể.
