Gắn nhãn người nói trong bản chép lời, nhận dấu thời gian
Tải lên âm thanh hoặc video có nhiều hơn một người nói, hoặc dán liên kết đến một tệp, và ScreenApp sẽ trả về một bản chép lời gắn nhãn lượt nói của từng người nói kèm dấu thời gian. Bản ghi không cần phải được tải lên từ thiết bị của bạn: một liên kết từ Dropbox, Google Drive hoặc một máy chủ podcast cũng hoạt động.
Một bản chép lời được gắn nhãn có nghĩa là bạn có thể tìm thấy những gì một người cụ thể đã nói mà không cần nghe lại toàn bộ bản ghi.
Những gì bạn nhận được:
- Một bản chép lời có nhãn người nói và dấu thời gian, bằng 100+ ngôn ngữ
- nhấp vào nhãn người nói để đổi tên, khớp với thành viên nhóm hoặc gán lại một phân đoạn
- Xuất dưới dạng PDF, DOCX, TXT, SRT và VTT
- Hỏi AI các câu hỏi về bản ghi và nhận câu trả lời chỉ ra thời điểm nó xảy ra
- Gói miễn phí: 2 lượt chép lời tối đa 45 phút mỗi bản ghi, bao gồm nhãn người nói
Hệ thống gán người nói theo giọng nói, không phải bằng cách khớp khuôn mặt hoặc tên, vì vậy mọi bản ghi đều bắt đầu với các nhãn chung (Người nói 1, Người nói 2) mà bạn đổi tên sau đó.
Cách nhận diện người nói trong âm thanh
- Tải lên hoặc dán liên kết: Kéo một tệp (MP3, M4A, MP4A, M4B, AAC, WAV, OGG, OPUS, FLAC, AIFF, WMA, WEBMA, MKA, AC3, EAC3, WV, AMR, DSF, DFF) hoặc dán liên kết từ Dropbox, Google Drive hoặc một máy chủ podcast.
- Bản chép lời phân tách theo người nói: Mỗi giọng nói nhận được nhãn riêng, với dấu thời gian trên mỗi lượt nói.
- Đổi tên và xuất: nhấp vào nhãn người nói để đổi tên, khớp với thành viên nhóm hoặc gán lại một phân đoạn. Xuất bản chép lời đã hoàn thành dưới dạng PDF, DOCX, TXT, SRT và VTT.
Âm thanh rõ ràng với giọng nói khác biệt sẽ phân tách tốt nhất, và lời nói chồng chéo có thể gây nhầm lẫn cho hệ thống phân tách giọng nói, vì vậy hãy cố gắng tránh để người nói nói chồng chéo lên nhau khi có thể. Xem cách chúng tôi đo lường độ chính xác.
Phân biệt người nói so với các ứng dụng khác
| Tính năng | ScreenApp | AssemblyAI | Otter.ai | Notta |
|---|---|---|---|---|
| Gói miễn phí | 2 lượt chép lời, tối đa 45 phút mỗi bản ghi | $50 tín dụng | 300 phút/tháng, 30 phút/cuộc trò chuyện | 120 phút/tháng, 3 phút/cuộc trò chuyện |
| Nhãn người nói | Bao gồm | Tiện ích bổ sung +0,02 đô la/giờ | Bao gồm từ gói Cơ bản | Đã bao gồm |
| Ngôn ngữ | 100+ | Không nêu | 6 | 58 |
| Định dạng xuất | PDF, DOCX, TXT, SRT và VTT | Không nêu | mp3 và txt ở gói miễn phí, thêm pdf, docx và srt từ gói Pro, xuất hàng loạt từ gói Business | TXT, DOCX, PDF hoặc XLSX |
| Gói trả phí | $19/tháng hàng năm | $0.15/giờ | $8.33/tháng hàng năm | $8.17/tháng hàng năm |
Sources, checked 2026-09-16: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, assemblyai.com/pricing, otter.ai/pricing, notta.ai/en/pricing, notta.ai/en/lecture-summarizer
- so với AssemblyAI: AssemblyAI là một API dành cho nhà phát triển, có giá $0.15 một giờ âm thanh với tính năng phân biệt người nói là tiện ích bổ sung +0,02 đô la/giờ và $50 tín dụng miễn phí cho tài khoản mới. ScreenApp là một ứng dụng hoàn chỉnh: tải lên một tệp và nhận lại bản chép lời được gắn nhãn, không yêu cầu tích hợp.
- so với Otter.ai: Gói miễn phí của Otter là 300 phút mỗi tháng, giới hạn ở 30 phút mỗi cuộc trò chuyện, với tính năng nhận diện người nói từ gói Cơ bản trở lên. Gói miễn phí của ScreenApp là 2 lượt chép lời tối đa 45 phút mỗi bản ghi, bao gồm nhãn người nói ngay từ đầu.
- so với Notta: Gói miễn phí của Notta cung cấp 120 phút mỗi tháng trong các đoạn clip tối đa 3 phút, bao gồm tính năng nhận diện người nói. Notta chép lời 58 ngôn ngữ; ScreenApp chép lời 100+.
Ai sử dụng tính năng phân biệt người nói
Podcaster tải lên tập thô và nhận bản chép lời được chia theo người dẫn chương trình và khách mời, sẵn sàng để dán vào ghi chú chương trình hoặc trang bản chép lời cho tập đó.
Ghi chú cuộc họp và phỏng vấn có lợi khi chỉ âm thanh vẫn cho thấy ai đã nói gì. Người phỏng vấn sử dụng tính năng phân tách người nói để tách câu hỏi của họ khỏi câu trả lời mà không cần nghe lại.
Các nhà nghiên cứu điều hành các nhóm tập trung hoặc phỏng vấn định tính sử dụng nhãn người nói nhất quán để theo dõi ai đã đóng góp gì, thay vì gắn nhãn thủ công.
Các chuyên gia pháp lý và chăm sóc sức khỏe cần bản chép lời có gắn nhãn người nói của các lời khai, cuộc gọi của khách hàng và tư vấn, với dấu thời gian gắn liền với mỗi lượt nói.


