AI & Voice

Dùng giọng nói AI năm 2026 có hợp pháp không? Cẩm nang cho nhà sáng tạo về các quy định mới

July 18, 2026 ·8 phút đọc
Dùng giọng nói AI năm 2026 có hợp pháp không? Cẩm nang cho nhà sáng tạo về các quy định mới

Nếu bạn làm video, khóa học, podcast hay quảng cáo bằng giọng nói AI thì năm 2026 chính là lúc các quy định trở nên nghiêm túc. Yêu cầu công bố của EU sẽ có hiệu lực từ tháng 8, nhiều bang của Mỹ đã thông qua một loạt luật về "bản sao kỹ thuật số", và các nền tảng như YouTube giờ đây bắt buộc bạn phải gắn nhãn cho nội dung tổng hợp. Vì vậy câu hỏi mà mọi nhà sáng tạo đang đặt ra là hoàn toàn chính đáng: dùng giọng nói AI có thật sự hợp pháp không?

Nói ngắn gọn: có — với hầu hết những gì bạn đang làm. Nhưng có hai điều sẽ khiến bạn gặp rắc rối, cùng một danh sách ngày càng dài những nơi bắt buộc bạn phải nói rõ rằng giọng nói là AI. Dưới đây là cẩm nang trình bày một cách dễ hiểu.

Câu trả lời ngắn gọn

Dùng một giọng nói AI tổng hợp để thuyết minh cho nội dung của chính bạn là hợp pháp. Các giọng nói chuyển văn bản thành lời (text-to-speech) từ một nhà cung cấp uy tín đều do máy tính tạo ra — chúng không phải là bản ghi âm của một người thật, có thể nhận dạng — nên khi bạn dùng chúng thì không quyền lợi của ai bị xâm phạm cả.

Có hai điều làm thay đổi điều đó:

  • Nhân bản hoặc bắt chước giọng của một người thật mà không có sự đồng ý của họ. Đây là nơi tập trung gần như toàn bộ rủi ro pháp lý.
  • Không công bố rằng nội dung do AI tạo ra ở những nơi mà luật pháp hoặc nền tảng yêu cầu.

Làm đúng hai điều đó thì bạn đứng trên nền tảng vững chắc. Phần còn lại của cẩm nang này nói về cách làm thế nào.

"Dùng giọng nói AI" và "nhân bản một giọng nói" là hai câu hỏi khác nhau

Phần lớn nỗi lo quanh giọng nói AI đến từ việc gộp chung hai hành vi rất khác nhau:

  1. Dùng một giọng nói tổng hợp — bạn gõ một kịch bản, một người thuyết minh do máy tính tạo ra sẽ đọc nó. Giọng nói này không thuộc về bất kỳ con người thật nào. Đây là text-to-speech thông thường, và là điều mà đại đa số nhà sáng tạo vẫn làm.
  2. Nhân bản giọng của một người cụ thể — bạn huấn luyện hoặc ra lệnh cho một mô hình để tái tạo giọng của một cá nhân có thể nhận dạng (một người nổi tiếng, một đồng nghiệp, hay chính bạn). Đây là nơi sự đồng ý, hợp đồng và các luật mới bắt đầu phát huy tác dụng.

Gần như mọi vụ kiện gây chú ý và mọi đạo luật đều xoay quanh #2. Nếu bạn đang làm #1, bạn đang ở làn đường ít rủi ro. Hãy ghi nhớ sự khác biệt này khi chúng ta điểm qua các quy định — hầu hết chúng đều nhắm thẳng vào các bản sao trái phép của người thật.

Giải mã các quy định mới của năm 2026

Châu Âu: EU AI Act (Đạo luật Trí tuệ Nhân tạo của EU) nay yêu cầu công bố

EU AI Act (Regulation 2024/1689) đã là luật, và các nghĩa vụ minh bạch của nó sẽ có hiệu lực áp dụng vào ngày 2 tháng 8 năm 2026. Có hai nghĩa vụ đáng chú ý:

  • Nếu bạn công bố nội dung do AI tạo ra là một "deep fake" — nội dung mô phỏng người, địa điểm hoặc sự kiện có thật và có thể bị nhầm là thật — thì bạn (với tư cách "người triển khai") phải công bố rằng nó được tạo ra một cách nhân tạo. Một người thuyết minh tổng hợp đơn thuần đọc kịch bản của bạn thường không phải là "deep fake", nhưng ngay khi nội dung có thể bị nhầm với một người thật hoặc một sự kiện có thật thì việc công bố là bắt buộc.
  • Nhà cung cấp công cụ có một nghĩa vụ riêng là đánh dấu các đầu ra của AI theo cách máy đọc được (hãy hình dung các dấu vân số nhúng bên trong). Một gói đề xuất mang tên "AI Omnibus" có thể dời thời hạn phía nhà cung cấp đó sang tháng 12 năm 2026, nhưng điều này chưa chốt — và nó không làm thay đổi mốc công bố dành cho nhà sáng tạo là ngày 2 tháng 8.

Đối với các tác phẩm sáng tạo và nghệ thuật, việc công bố vẫn bắt buộc nhưng có thể nhẹ nhàng — một dòng ghi chú không phá hỏng trải nghiệm, thay vì một lớp phủ gây khó chịu. Mức phạt cho việc vi phạm những quy định này có thể lên tới 15 triệu euro hoặc 3% doanh thu toàn cầu, vì vậy nếu bạn có khán giả ở EU, hãy đưa việc công bố vào quy trình làm việc của mình ngay từ bây giờ.

Hoa Kỳ: một tấm chắp vá các luật cấp bang (và một dự luật lớn chưa thành luật)

Hiện chưa có luật liên bang chung nào của Mỹ điều chỉnh giọng nói AI. Thay vào đó, có hai điều đúng:

NO FAKES Act là một dự luật, chưa phải luật. Bạn sẽ thấy nó được trích dẫn ở khắp nơi, nhưng tính đến giữa năm 2026 nó chưa được Quốc hội thông qua hay được ký ban hành. Ủy ban Tư pháp Thượng viện đã đưa nó tiến thêm một bước vào tháng 6 năm 2026 và nó đang chờ toàn thể Thượng viện bỏ phiếu. Nếu được ban hành, nó sẽ tạo ra một quyền liên bang cho mọi người đối với giọng nói và hình ảnh của chính mình, khiến các bản sao kỹ thuật số trái phép trở thành bất hợp pháp. Đáng để theo dõi — nhưng đừng coi nó là ràng buộc ở thời điểm hiện tại.

Nhiều bang đã hành động, và tất cả đều đang có hiệu lực:

  • ELVIS Act của bang Tennessee (có hiệu lực từ ngày 1 tháng 7 năm 2024) bảo vệ giọng nói của một người như một quyền tài sản — và bao quát rõ ràng cả giọng bắt chước (soundalikes) và mô phỏng, chứ không chỉ các bản ghi âm thực tế.
  • AB 2602 và AB 1836 của bang California (cả hai đều có hiệu lực từ ngày 1 tháng 1 năm 2025) hạn chế việc dùng "bản sao kỹ thuật số" của một người mà không có thỏa thuận cụ thể đã thương lượng, và cấm nhân bản giọng của một nghệ sĩ đã qua đời khi chưa có sự đồng ý của người thừa kế/di sản.
  • Illinois, New York, Maine và Montana hiện đều đã ban hành các luật về bản sao kỹ thuật số tương tự.

Hãy để ý quy luật: mỗi luật trong số này đều nhắm vào các bản sao trái phép của người thật, có thể nhận dạng. Không luật nào cấm việc dùng một giọng nói tổng hợp chung chung.

(Ngoài ra, đạo luật liên bang TAKE IT DOWN Act đã được ký vào tháng 5 năm 2025 — nhưng nó nhắm cụ thể vào các deepfake thân mật không có sự đồng ý, chứ không phải hoạt động thuyết minh AI thường ngày. Đừng nhầm nó với NO FAKES Act vẫn đang chờ thông qua.)

Trung Quốc: bắt buộc gắn nhãn cho âm thanh tổng hợp

Nếu bạn phân phối nội dung giọng nói AI trên các nền tảng của Trung Quốc, việc gắn nhãn về cơ bản là bắt buộc. Deep Synthesis Provisions (Quy định về tổng hợp chuyên sâu) của Trung Quốc (có hiệu lực từ tháng 10 năm 2023) và các biện pháp gắn nhãn nội dung do AI tạo ra (có hiệu lực từ ngày 1 tháng 9 năm 2025) đều yêu cầu vừa có nhãn hiển thị rõ ràng (đối với âm thanh là một tín hiệu "do AI tạo ra" được nói ra hoặc hiển thị), vừa có nhãn ngầm (siêu dữ liệu máy đọc được). Tổng hợp giọng nói được nêu đích danh là một hạng mục dễ gây nhầm lẫn cao.

Quy định của nền tảng không phải là luật — nhưng chúng sẽ tước tiền của bạn nhanh hơn

Ngay cả ở nơi không có đạo luật nào áp dụng, các nền tảng mà bạn đăng tải cũng có quy định công bố AI của riêng mình. Chúng được thực thi bằng việc gỡ bỏ, gắn nhãn và cắt kiếm tiền (demonetize) — thường nhanh hơn và thẳng tay hơn bất kỳ tòa án nào.

  • YouTube yêu cầu nhà sáng tạo gắn cờ "nội dung bị chỉnh sửa hoặc tổng hợp" (altered or synthetic content) trong YouTube Studio (bắt buộc từ tháng 5 năm 2025) mỗi khi nội dung chân thực bị tổng hợp một cách đáng kể — bao gồm một bản nhân bản giọng nói thuyết phục hoặc làm cho một người thật có vẻ như nói điều họ không nói. Bạn không cần gắn cờ đối với kịch bản, ý tưởng, phụ đề do AI hỗ trợ, hay các chỉnh sửa nhỏ.
  • TikTok yêu cầu nhãn hiển thị trên nội dung AI chân thực (bao gồm cả âm thanh) và tự động gắn nhãn cho phương tiện mang Content Credentials theo chuẩn của ngành. Phương tiện tổng hợp mô phỏng người thật thuộc diện riêng tư bị cấm hoàn toàn.
  • Meta (Facebook/Instagram/Threads) áp dụng nhãn "AI Info" khi phát hiện tín hiệu AI hoặc khi bạn tự công bố, và bắt buộc công bố đối với quảng cáo chứa phương tiện do AI tạo ra.
  • Spotify cấm các bản nhân bản giọng nói AI trái phép và hành vi giả mạo, đồng thời đang triển khai việc công bố AI trong phần ghi công của bài hát thông qua một chuẩn của ngành.

Thói quen an toàn: nếu nội dung của bạn có thể khiến ai đó lầm tưởng một người thật đang nói, hãy công bố nó — cả trên nền tảng lẫn trong phần mô tả.

Một quy tắc có trước tất cả những điều này: đừng giả mạo một người thật

Từ lâu trước khi có AI, tòa án Mỹ đã bảo vệ giọng nói của con người. Trong các vụ Midler v. Ford (1988) và Waits v. Frito-Lay (1992), các công ty đã bị buộc phải chịu trách nhiệm vì cố ý bắt chước giọng đặc trưng, được biết đến rộng rãi của một ca sĩ trong quảng cáo — ngay cả khi không dùng đến một bản ghi âm thật. Các luật cấp bang mới chỉ đơn giản mở rộng nguyên tắc đó sang thời đại AI.

Vậy nên ranh giới rõ ràng rất đơn giản: đừng nhân bản, trích mẫu hay bắt chước một cách thuyết phục giọng của một người thật có thể nhận dạng mà không có sự đồng ý bằng văn bản của họ. Điều đó bao gồm người nổi tiếng, diễn viên lồng tiếng, đồng nghiệp — bất kỳ ai có thể nhận ra.

Một điểm tinh tế đáng biết: FTC đã hoàn tất một quy định cấm giả mạo chính phủ và doanh nghiệp (có hiệu lực từ tháng 4 năm 2024), và đã đề xuất mở rộng nó sang cả việc giả mạo cá nhân — nhưng phần mở rộng về giả mạo cá nhân đó chưa được hoàn tất. Các luật về quyền công khai hình ảnh (right-of-publicity) cấp bang nêu trên mới là những luật có hiệu lực thực sự ở thời điểm hiện tại.

Bạn có thể kiếm tiền bằng giọng nói AI không?

Có. Nội dung được thuyết minh bằng các giọng nói tổng hợp dựng sẵn của một nhà cung cấp có bản quyền nhìn chung có thể được dùng cho mục đích thương mại — cho video YouTube kiếm tiền, khóa học trả phí, công việc cho khách hàng, và quảng cáo. Có ba điều cần lưu ý:

  • Kiểm tra gói dịch vụ. Các nhà cung cấp thường cấp quyền dùng đầu ra cho mục đích thương mại trên các gói trả phí, trong khi coi các gói miễn phí hoặc dùng thử là phi thương mại. Hãy đọc điều khoản của gói bạn đang thực sự dùng.
  • Giọng dựng sẵn và nhân bản giọng nói là hai sản phẩm khác nhau. Dùng người thuyết minh tổng hợp của chính nhà cung cấp là ít rủi ro. Nhân bản giọng nói thì ổn khi nhân bản giọng của chính bạn — hoặc một giọng bạn được phép sử dụng — nhưng trách nhiệm thực sự có được sự đồng ý đó nằm ở bạn.
  • Tuân thủ các điều khoản về AI có trách nhiệm của nhà cung cấp, bản thân chúng có thể yêu cầu bạn công bố việc tạo bằng AI đối với một số mục đích sử dụng nhất định.

Danh mục kiểm tra tuân thủ giọng nói AI năm 2026 của bạn

  • Dùng các giọng nói tổng hợp không phải là bản bắt chước một người thật, có thể nhận dạng.
  • Không bao giờ nhân bản giọng của một người thật khi chưa có sự đồng ý bằng văn bản — dù là người nổi tiếng hay không.
  • Công bố việc tạo bằng AI ở những nơi được yêu cầu: EU (từ ngày 2 tháng 8 năm 2026), các nền tảng của Trung Quốc, và bất kỳ nội dung nào có thể bị nhầm là người thật.
  • Bật công tắc AI của nền tảng — ví dụ "nội dung bị chỉnh sửa hoặc tổng hợp" (altered or synthetic content) của YouTube — đối với nội dung chân thực.
  • Kiểm tra điều khoản của nhà cung cấp TTS về quyền sử dụng thương mại và các giới hạn theo gói.
  • Lưu giữ hồ sơ về bất kỳ sự đồng ý hoặc giấy phép nào bạn dựa vào.
  • Đừng làm cho một người thật có vẻ như nói điều họ chưa từng nói.

Cách SimpleTTS giúp bạn ở phía an toàn

SimpleTTS cho bạn hai cách để tạo âm thanh, và cả hai đều được xây dựng để giữ bạn ở làn đường ít rủi ro:

  • Giọng nơ-ron dựng sẵn — những người thuyết minh do máy tính tạo ra, được cấp phép chuyên nghiệp và không phải là bản nhân bản của bất kỳ người thật, có thể nhận dạng nào. Đối với công việc thường ngày mà hầu hết nhà sáng tạo làm — lồng tiếng YouTube, thuyết minh học trực tuyến, sách nói, video sản phẩm — cách này né được rủi ro pháp lý lớn nhất trong toàn bộ lĩnh vực: giả mạo một người thật. Bạn đang tạo ra một giọng máy tính, chứ không trích mẫu danh tính của ai đó.
  • Nhân bản giọng nói (được hỗ trợ bởi Qwen3) — dành cho khi bạn muốn nhân bản giọng của chính mình, hoặc một giọng bạn được phép sử dụng. Vì nhân bản chính là phần mang sức nặng pháp lý thực sự, SimpleTTS yêu cầu bạn xác nhận trước mỗi lần nhân bản rằng bạn có toàn quyền sử dụng các mẫu bạn tải lên, phù hợp với Điều khoản Dịch vụ của chúng tôi. Hãy nhân bản chính bạn, hoặc một giọng bạn đã được cho phép sử dụng — không bao giờ là một người có thể nhận dạng khi chưa có sự đồng ý của họ.

Hãy thêm một dòng ghi chú "giọng nói do AI tạo ra" ở bất cứ đâu mà một nền tảng hoặc các quy định của EU yêu cầu, và bạn cũng đã được đảm bảo về mặt công bố.

Bạn muốn tạo ra các đoạn lồng tiếng chất lượng phòng thu mà không phải mò mẫm về mặt pháp lý? Dùng thử SimpleTTS miễn phí và tạo đoạn lồng tiếng AI đầu tiên của bạn chỉ trong vài giây.

Một lưu ý về cẩm nang này

Bài viết này là thông tin chung, không phải tư vấn pháp lý, và chính xác tính đến tháng 7 năm 2026. Luật về giọng nói AI đang thay đổi rất nhanh — dự luật trở thành luật, các mốc thời hạn dịch chuyển, và các hướng dẫn được cập nhật thường xuyên. Đối với tình huống cụ thể của bạn, đặc biệt là bất cứ điều gì liên quan đến việc nhân bản giọng của một người thật hoặc một chiến dịch thương mại lớn, hãy trao đổi với một luật sư có đủ năng lực trong phạm vi tài phán của bạn.

Bài viết liên quan