Giới thiệu
Google Vids có hai cập nhật mới: Gemini Omni và personal avatars. Mục tiêu là biến việc tạo video thành một workflow dạng prompt + chỉnh sửa nhiều bước, thay vì yêu cầu người dùng dựng clip thủ công từ đầu.
Gemini Omni hỗ trợ tạo video từ text prompt và image reference. Personal avatars cho phép tạo một avatar giống và nói như người dùng để trình bày nội dung mà không cần quay camera.
Tính năng chính
- Generate video từ mô tả bằng ngôn ngữ tự nhiên.
- Thêm image reference như ảnh hoặc sketch để định hướng kết quả.
- Chỉnh video từng bước bằng chat, ví dụ đổi background, sửa ánh sáng hoặc thêm hiệu ứng.
- Tạo personal avatar bằng selfie và một đoạn voice recording ngắn.
- Nhập script để avatar đọc thay người dùng.
- Clip được tạo bằng AI có SynthID watermark vô hình để hỗ trợ minh bạch nguồn gốc.
Cách sử dụng
Trong Google Vids, người dùng bắt đầu bằng prompt mô tả video cần tạo. Nếu cần kiểm soát bố cục hoặc style, có thể thêm ảnh tham chiếu.
Sau draft đầu tiên, người dùng tiếp tục chỉnh bằng yêu cầu tự nhiên như đổi background hoặc sửa lighting. Với personal avatars, người dùng upload selfie và voice recording, sau đó nhập nội dung cần avatar trình bày.
Giới hạn hiện tại
Gemini Omni và personal avatars khả dụng cho Google AI Pro, Google AI Ultra và khách hàng Google Workspace business. Personal avatars chỉ mở ở một số khu vực và yêu cầu người dùng từ 18 tuổi trở lên.
Ý nghĩa với Dev
Nếu team của bạn đang làm docs, onboarding, release notes hoặc training nội bộ, đây là dấu hiệu video generation đang đi vào bộ công cụ văn phòng chứ không chỉ nằm trong app sáng tạo chuyên biệt. Workflow đáng học là iterative editing: model tạo draft, người dùng chỉnh bằng command ngắn, hệ thống giữ context thay vì bắt dựng lại từ đầu.
Với product team, câu hỏi hay hơn là: phần nào trong app của mình đang còn bắt người dùng “mở editor” trong khi họ chỉ muốn ra lệnh sửa một artifact? Video chỉ là ví dụ dễ thấy; cùng pattern này áp dụng được cho report, dashboard, slide, test plan và UI copy.