Giới thiệu
Google Vids có hai cập nhật mới: Gemini Omni và personal avatars. Mục tiêu là biến video creation thành một flow gần với viết prompt và chỉnh sửa từng bước bằng natural language, thay vì quay, edit, render rồi làm lại từ đầu.
Tính năng này nằm trong Google Vids, dành cho Google AI Pro/Ultra subscribers và Google Workspace business customers. Personal avatars hiện giới hạn ở một số region và chỉ cho người dùng từ 18 tuổi trở lên.
Tính năng chính
- Generate video từ text và image references: Gemini Omni nhận prompt natural language và ảnh tham chiếu, ví dụ photo hoặc sketch, rồi sinh clip phù hợp với ý tưởng.
- Chat to edit: người dùng có thể yêu cầu chỉnh video bằng lời, như đổi background, sửa lighting hoặc thêm effect. Điểm quan trọng là chỉnh từng bước mà không phải sinh lại toàn bộ từ đầu.
- Personal avatars: người dùng upload selfie và voice recording ngắn để tạo avatar số trông và nghe giống mình. Sau đó chỉ cần gõ nội dung, avatar sẽ đọc message mà không cần quay camera.
- SynthID watermark: mỗi clip AI-generated có invisible SynthID digital watermark để hỗ trợ minh bạch nguồn gốc nội dung.
- Veo 3.1 trong Vids: bài viết nhắc Google đã rollout Veo 3.1 cho người dùng Vids từ tháng 02/2026, trước khi bổ sung Omni.
Cách sử dụng
Trong Google Vids, người dùng tạo video bằng prompt, bổ sung image reference nếu cần, rồi refine qua chat. Với personal avatar, người dùng tạo avatar bằng selfie và đoạn ghi âm ngắn, sau đó nhập script để avatar trình bày.
Với dev, bài này đáng xem như một preview của multimodal authoring UX. Các pattern sẽ lặp lại trong nhiều sản phẩm: prompt + reference asset, edit history dạng hội thoại, identity consent, watermarking và policy cho likeness. Nếu bạn đang build tool tạo nội dung bằng AI, phần khó không chỉ là model; đó là quyền dùng hình ảnh/giọng nói, undo/redo hợp lý, và dấu vết provenance đủ rõ cho người xem.