Trang chủTrung tâm tin tức LBank
Tin Tức AI Mới Nhất: Avatar V Mới của HeyGen Cho Phép Sao Chép Khuôn Mặt Trong 15 Giây và Tạo Video AI Không Giới Hạn
latest-ai-heygen-avatar-v-clones-faces-in-15-seconds
Tin Tức AI Mới Nhất: Avatar V Mới của HeyGen Cho Phép Sao Chép Khuôn Mặt Trong 15 Giây và Tạo Video AI Không Giới Hạn
Avatar V ghi lại các biểu cảm micro đặc trưng của người dùng, hình dạng môi, đường viền khuôn mặt và chuyển động tự nhiên từ một đoạn clip dài 15 giây, sau đó duy trì danh tính đó trên mọi video được tạo ra bất kể độ dài, góc quay, trang phục hay bối cảnh, giải quyết vấn đề sai lệch danh tính khiến hầu hết các avatar AI bị giảm chất lượng chỉ sau vài giây. Khi bản sao kỹ thuật số được tạo ra, người dùng chọn một bức ảnh cơ sở làm tham chiếu danh tính, áp dụng bất kỳ trang phục hoặc bối cảnh nào qua các lệnh văn bản, và tạo video với 175 ngôn ngữ kèm đồng bộ môi đầy đủ; nhân bản giọng nói là bước tùy chọn riêng biệt mà công ty khuyến nghị để đạt độ chân thực tối đa. Avatar V hiện là nền tảng mà tất cả các tính năng khác trong nền tảng HeyGen vận hành, được tích hợp với Seedance 2.0 để tạo video điện ảnh và có sẵn trên các gói đăng ký trả phí.
2026-04-09 Nguồn:crypto.news

Công cụ video AI mới nhất gây sốt tuần này là Avatar V của HeyGen, được công bố vào ngày 8 tháng 4 với 472.000 lượt xem trên X. Công cụ này tạo ra một bản sao kỹ thuật số siêu thực về khuôn mặt, giọng nói và cử chỉ của người dùng từ một đoạn ghi hình webcam dài 15 giây duy nhất, sau đó tạo ra video chất lượng phòng thu không giới hạn mà không cần bất kỳ thiết bị chuyên nghiệp nào.

Tóm tắt
  • Avatar V thu giữ các biểu cảm siêu nhỏ, hình dáng môi, hình bóng khuôn mặt và chuyển động tự nhiên cụ thể của người dùng từ một clip dài 15 giây, sau đó duy trì danh tính đó trên mọi video được tạo ra bất kể độ dài, góc quay, trang phục hay bối cảnh, giải quyết vấn đề trôi lệch danh tính đã khiến hầu hết các hình đại diện AI bị giảm chất lượng sau vài giây.
  • Khi bản sao kỹ thuật số được tạo, người dùng chọn một bức ảnh cơ sở làm tham chiếu danh tính của họ, áp dụng bất kỳ trang phục hoặc bối cảnh nào thông qua lời nhắc văn bản và tạo video bằng 175 ngôn ngữ với khả năng đồng bộ hóa môi hoàn chỉnh; nhân bản giọng nói là một bước tùy chọn riêng biệt mà công ty khuyến nghị để đạt được độ chân thực tối đa.
  • Avatar V hiện là nền tảng mà tất cả các tính năng khác trong nền tảng của HeyGen hoạt động, được tích hợp với Seedance 2.0 để tạo video điện ảnh và có sẵn trên các gói đăng ký trả phí.

Trang ra mắt chính thức của HeyGen mô tả Avatar V được xây dựng dựa trên một niềm tin duy nhất: sản phẩm đầu ra phải đủ tốt để người dùng sẵn lòng ghi tên mình lên đó, không phải tốt theo tiêu chuẩn AI, mà là tốt một cách đơn thuần. Mô hình này được đào tạo dựa trên cái mà HeyGen gọi là nhúng danh tính có cơ sở thời gian, được xây dựng từ clip 15 giây, thu giữ các cử chỉ và chuyển đổi biểu cảm cụ thể khiến một người có thể được nhận diện là chính họ trong các ngữ cảnh khác nhau. Các cảnh quay rộng, khung hình trung bình và cận cảnh đều duy trì tính nhất quán từ một lần ghi hình. Quá trình này không yêu cầu ánh sáng studio hay ê-kíp; một chiếc điện thoại hoặc webcam tiêu chuẩn là đủ.

Nguyên tắc thiết kế chính là tách biệt danh tính khỏi ngoại hình. Đoạn clip 15 giây xác định cách một người di chuyển. Một bức ảnh cơ sở riêng biệt xác định cách họ trông như thế nào. Người dùng sau đó có thể thay đổi ngoại hình một cách tự do trong khi chuyển động vẫn là của họ một cách rõ ràng.

AI mới nhất: Những vấn đề Avatar V giải quyết được mà các mô hình trước đây không làm được

Hầu hết các hệ thống avatar AI tối ưu hóa cho một khoảnh khắc ấn tượng duy nhất: ảnh chụp màn hình, đoạn clip ngắn, bản demo được kiểm soát nơi mọi thứ đều hoạt động theo hướng có lợi cho mô hình. Chúng trông sắc nét trong hai giây và sụp đổ trong hai mươi giây khi khuôn mặt bị lệch khỏi nguồn. Avatar V được thiết kế đặc biệt để duy trì trong suốt thời lượng của video mà không bị trôi lệch đó. HeyGen mô tả đây là sự nhất quán danh tính: cùng một khuôn mặt, cùng những biểu cảm siêu nhỏ, cùng một sự hiện diện từ khung hình đầu tiên đến khung hình cuối cùng, xuyên suốt một clip 30 giây hoặc một module 10 phút.

Người dùng thực sự có thể tạo ra gì với nó

Quy trình làm việc thực tế gồm ba bước: ghi lại một video dài 15 giây, tùy chọn ghi lại một bản sao giọng nói độc lập, sau đó chọn một bức ảnh cơ sở làm tham chiếu danh tính cho mọi cảnh quay được tạo sau đó. Từ cơ sở đó, người dùng viết lời nhắc để tạo ra trang phục, bối cảnh và phong cách mới, hoặc sử dụng thư viện của HeyGen. Video hoàn chỉnh có thể được cung cấp bằng bất kỳ trong 175 ngôn ngữ với tính năng đồng bộ hóa môi được điều chỉnh tự động theo ngôn ngữ mục tiêu. HeyGen khuyên người dùng nên thể hiện cảm xúc khi ghi hình vì, như công ty đã nói, “năng lượng bạn bỏ vào là năng lượng bạn nhận lại.”

Tại sao điều này quan trọng đối với việc tạo nội dung quy mô lớn

Như crypto.news đã báo cáo, các công cụ AI giúp giảm chi phí và thời gian sản xuất nội dung chuyên nghiệp đang trực tiếp định hình các quyết định về số lượng nhân sự của doanh nghiệp vào năm 2026. Như crypto.news đã lưu ý, sự phổ biến của các công cụ nội dung AI là một biến số quan trọng trong cách các nhà đầu tư tổ chức đánh giá tính bền vững của chi tiêu cơ sở hạ tầng AI. Avatar V hiện đã có sẵn đầy đủ thông qua các gói trả phí của HeyGen, với quyền truy cập vào bộ công cụ đầy đủ của nền tảng bao gồm các mẫu, dịch thuật và công cụ studio.