Phân biệt người nói trực tuyến

Tải lên một bản ghi có nhiều hơn một người nói và nhận bản chép lời có gắn nhãn ai đang nói, kèm theo dấu thời gian mà bạn có thể tìm kiếm và xuất.

Các tệp được xử lý trên đám mây. Cần có tài khoản miễn phí để sử dụng và lưu kết quả trong ứng dụng. Tải tệp xuống yêu cầu gói trả phí.

MP3, WAV, M4A, AAC, OGG, FLAC, AMR, WMA

Hoặc dán liên kết âm thanh

YouTube, TikTok, Instagram, Vimeo, Google Drive, Dropbox, liên kết trực tiếp

Các bản ghi được mã hóa trong quá trình truyền và lưu trữ, không được sử dụng để đào tạo mô hình AI. Quyền riêng tư · Bảo mật

Gắn nhãn người nói trong bản chép lời, nhận dấu thời gian

Tải lên âm thanh hoặc video có nhiều hơn một người nói, hoặc dán liên kết đến một tệp, và ScreenApp sẽ trả về một bản chép lời gắn nhãn lượt nói của từng người nói kèm dấu thời gian. Bản ghi không cần phải được tải lên từ thiết bị của bạn: một liên kết từ Dropbox, Google Drive hoặc một máy chủ podcast cũng hoạt động.

Một bản chép lời được gắn nhãn có nghĩa là bạn có thể tìm thấy những gì một người cụ thể đã nói mà không cần nghe lại toàn bộ bản ghi.

Những gì bạn nhận được:

Hệ thống gán người nói theo giọng nói, không phải bằng cách khớp khuôn mặt hoặc tên, vì vậy mọi bản ghi đều bắt đầu với các nhãn chung (Người nói 1, Người nói 2) mà bạn đổi tên sau đó.

Cách nhận diện người nói trong âm thanh

  1. Tải lên hoặc dán liên kết: Kéo một tệp (MP3, M4A, MP4A, M4B, AAC, WAV, OGG, OPUS, FLAC, AIFF, WMA, WEBMA, MKA, AC3, EAC3, WV, AMR, DSF, DFF) hoặc dán liên kết từ Dropbox, Google Drive hoặc một máy chủ podcast.
  2. Bản chép lời phân tách theo người nói: Mỗi giọng nói nhận được nhãn riêng, với dấu thời gian trên mỗi lượt nói.
  3. Đổi tên và xuất: nhấp vào nhãn người nói để đổi tên, khớp với thành viên nhóm hoặc gán lại một phân đoạn. Xuất bản chép lời đã hoàn thành dưới dạng PDF, DOCX, TXT, SRT và VTT.

Âm thanh rõ ràng với giọng nói khác biệt sẽ phân tách tốt nhất, và lời nói chồng chéo có thể gây nhầm lẫn cho hệ thống phân tách giọng nói, vì vậy hãy cố gắng tránh để người nói nói chồng chéo lên nhau khi có thể. Xem cách chúng tôi đo lường độ chính xác.

Phân biệt người nói so với các ứng dụng khác

Tính năngScreenAppAssemblyAIOtter.aiNotta
Gói miễn phí2 lượt chép lời, tối đa 45 phút mỗi bản ghi$50 tín dụng300 phút/tháng, 30 phút/cuộc trò chuyện120 phút/tháng, 3 phút/cuộc trò chuyện
Nhãn người nóiBao gồmTiện ích bổ sung +0,02 đô la/giờBao gồm từ gói Cơ bảnĐã bao gồm
Ngôn ngữ100+Không nêu658
Định dạng xuấtPDF, DOCX, TXT, SRT và VTTKhông nêump3 và txt ở gói miễn phí, thêm pdf, docx và srt từ gói Pro, xuất hàng loạt từ gói BusinessTXT, DOCX, PDF hoặc XLSX
Gói trả phí$19/tháng hàng năm$0.15/giờ$8.33/tháng hàng năm$8.17/tháng hàng năm

Sources, checked 2026-09-16: screenapp.io/accuracy#languages, ScreenApp pricing, screenapp.io/help/how-many-minutes-can-i-record, assemblyai.com/pricing, otter.ai/pricing, notta.ai/en/pricing, notta.ai/en/lecture-summarizer

  • so với AssemblyAI: AssemblyAI là một API dành cho nhà phát triển, có giá $0.15 một giờ âm thanh với tính năng phân biệt người nói là tiện ích bổ sung +0,02 đô la/giờ$50 tín dụng miễn phí cho tài khoản mới. ScreenApp là một ứng dụng hoàn chỉnh: tải lên một tệp và nhận lại bản chép lời được gắn nhãn, không yêu cầu tích hợp.
  • so với Otter.ai: Gói miễn phí của Otter là 300 phút mỗi tháng, giới hạn ở 30 phút mỗi cuộc trò chuyện, với tính năng nhận diện người nói từ gói Cơ bản trở lên. Gói miễn phí của ScreenApp là 2 lượt chép lời tối đa 45 phút mỗi bản ghi, bao gồm nhãn người nói ngay từ đầu.
  • so với Notta: Gói miễn phí của Notta cung cấp 120 phút mỗi tháng trong các đoạn clip tối đa 3 phút, bao gồm tính năng nhận diện người nói. Notta chép lời 58 ngôn ngữ; ScreenApp chép lời 100+.

Ai sử dụng tính năng phân biệt người nói

Podcaster tải lên tập thô và nhận bản chép lời được chia theo người dẫn chương trình và khách mời, sẵn sàng để dán vào ghi chú chương trình hoặc trang bản chép lời cho tập đó.

Ghi chú cuộc họp và phỏng vấn có lợi khi chỉ âm thanh vẫn cho thấy ai đã nói gì. Người phỏng vấn sử dụng tính năng phân tách người nói để tách câu hỏi của họ khỏi câu trả lời mà không cần nghe lại.

Các nhà nghiên cứu điều hành các nhóm tập trung hoặc phỏng vấn định tính sử dụng nhãn người nói nhất quán để theo dõi ai đã đóng góp gì, thay vì gắn nhãn thủ công.

Các chuyên gia pháp lý và chăm sóc sức khỏe cần bản chép lời có gắn nhãn người nói của các lời khai, cuộc gọi của khách hàng và tư vấn, với dấu thời gian gắn liền với mỗi lượt nói.

FAQ

Phân biệt người nói là gì?

Phân biệt người nói là quá trình xác định ai đã nói khi nào trong một bản ghi. Hệ thống nhóm âm thanh theo giọng nói và gán cho mỗi phân đoạn một nhãn người nói, vì vậy bản chép lời sẽ đọc là Người nói 1, Người nói 2, v.v., mỗi lượt nói đều có dấu thời gian.

Tính năng phân biệt người nói chính xác đến mức nào?

Độ chính xác phụ thuộc vào bản ghi: âm thanh rõ ràng với giọng nói khác biệt sẽ phân tách tốt nhất, và lời nói chồng chéo có thể gây nhầm lẫn cho hệ thống phân tách giọng nói. Xem cách đo lường độ chính xác.

Nó có thể nhận diện bao nhiêu người nói?

Tính năng phân biệt người nói gán nhãn cho mọi giọng nói khác biệt mà nó phát hiện trong bản ghi, từ hai người nói đến một cuộc trò chuyện nhóm đầy đủ. Càng nhiều người nói, đặc biệt là với giọng nói tương tự hoặc lời nói chồng chéo, việc phân tách càng khó khăn hơn.

Nó có hoạt động với podcast không?

Có. Tải lên tệp tập hoặc dán liên kết từ máy chủ podcast của bạn, và mỗi người dẫn chương trình và khách mời sẽ nhận được một nhãn người nói riêng biệt mà bạn có thể đổi tên trong bản chép lời.

Nó có thực hiện phân biệt người nói theo thời gian thực không?

Không, đây là một công cụ tải lên: nó xử lý một tệp hoặc liên kết sau khi bản ghi đã hoàn tất, không phải trong khi nó đang diễn ra. Đối với các cuộc họp trực tiếp, hãy sử dụng trình ghi cuộc họp, ghi lại và chép lời khi cuộc gọi diễn ra.

Những định dạng âm thanh và video nào hoạt động?

Nó có thể nhận diện những người cụ thể bằng tên không?

Không tự động. Hệ thống gán các nhãn chung (Người nói 1, Người nói 2) chỉ từ giọng nói; nó không khớp giọng nói với một danh tính đã biết. Sau đó, nhấp vào nhãn người nói để đổi tên, khớp với thành viên nhóm hoặc gán lại một phân đoạn.

Có gói miễn phí không?

Có. 2 lượt chép lời tối đa 45 phút mỗi bản ghi, bao gồm nhãn người nói, dấu thời gian và xuất. Gói Pro với giá $19 mỗi tháng được thanh toán hàng năm sẽ loại bỏ giới hạn bản ghi.

Kết quả thực tế từ người dùng thực

works like a charm, notes have been super helpful alongside chat function. loveeeee
KS
Katharine Suy
Chrome Web Store, October 17, 2024
nice app for important summary
S
SAHIL
Google Play, January 30, 2026

Sẵn sàng nâng cao năng suất của bạn?

Bắt đầu Phân biệt người nói với tài khoản miễn phí. Áp dụng giới hạn sử dụng; tải ứng dụng yêu cầu gói trả phí.

Bắt đầu miễn phí →

Bắt đầu sử dụng trong 60 giây