Dùng khi chưa chắc ảnh thuộc nhóm nào
Phù hợp với ảnh người, sản phẩm hoặc ảnh thông thường có chủ thể rõ. Nên dùng đầu tiên khi nền không quá rối và màu nền khác tương đối so với chủ thể.
Tạo phụ đề
Tạo giọng đọc tiếng Việt tự nhiên cho video, bài giảng, bản tin và sách nói.
Nhập hoặc dán văn bản tiếng Việt; hỗ trợ tệp TXT UTF-8.
Bạn có thể nghe lại trước khi tải xuống.
Dùng bản thu sạch từ 3–8 giây để tạo một giọng riêng trong tài khoản.
Chọn theo ngôn ngữ, khu vực, độ tuổi và phong cách nội dung.
File thường tự dọn sau 3 ngày. File đã lưu được giữ trong tài khoản đến khi bạn xóa.
Đăng nhập để xem lịch sử tạo giọng đọc.
Ghép giọng đọc vào video ngay trên thiết bị của bạn. Video không được tải lên máy chủ.
File chỉ nằm trên thiết bị; đóng trang sẽ cần chọn lại file.
Xuất MP4 giữ nguyên hình ảnh, không đổi khẩu hình. Video dùng định dạng hình ảnh chưa tương thích sẽ được báo trước khi xuất.
Chưa chọn giọng đọc. File dài hơn video sẽ được cắt ở cuối video.
Các thay đổi âm lượng/thời điểm áp dụng khi xuất; khi trộn hai nguồn, âm lượng được giảm đồng đều để hạn chế rè/vỡ tiếng. Hai trình phát dùng để nghe và xem file nguồn riêng lẻ.
Chrome/Edge trên máy tính, kết nối HTTPS được khuyến nghị để ghi trực tiếp ra ổ đĩa với file lớn. Không tắt tab trong khi xử lý.
Chọn video và giọng đọc để bắt đầu.
Nhận diện lời thoại, chỉnh thời gian, dịch và tải phụ đề SRT/VTT.
Có thể nhập phụ đề hoặc dùng lại kết quả nhận diện mà không chọn file nguồn.
Mỗi phiên nhận diện dùng 1 lượt Voice ra văn bản theo gói tài khoản. Tái sử dụng kết quả hoặc chỉnh phụ đề không tạo lượt AI mới.
Nhận diện bằng AI hoặc nhập một file phụ đề để chỉnh sửa.
Nhập thời gian theo giây. Bấm vào mốc bắt đầu để xem vị trí trong video. Bản dịch cần được rà soát; mốc thời gian không thay đổi.
Phụ đề được xuất thành file riêng, chưa ghi chữ trực tiếp lên hình. Tải phụ đề trước khi đóng trang để giữ các chỉnh sửa.