Thẻ: audio
Tất cả bản tin và bài dịch có thẻ "audio".
34 mục đã xuất bản 34 bài dịch 0 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (34 bài). Loại nguồn: công ty/blog 12 Loại nguồn: web 11 Loại nguồn: GitHub 9 Loại nguồn: cộng đồng 1 Loại nguồn: tài liệu 1 Chỉ gồm bài dịch Mới nhất của chủ đề là bài dịch: litelm: phần routing của LiteLLM trong khoảng 2.900 dòng Bài dịch mới nhất: litelm: phần routing của LiteLLM trong khoảng 2.900 dòng Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
Google Gemma 4 Chạy Native Trên iPhone: Kỷ Nguyên AI Offline Đã Đến
tinAI dịch bài này sang tiếng Việt từ : Google Gemma 4 Runs Natively on iPhone With Full Offline AI Inference (gizmoweek.com) · Loại nguồn: web · Tác giả gốc: jerrywanint
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #091: Google Gemma 4 chạy hoàn toàn offline trên iPhone
Google Gemma 4 giờ chạy hoàn toàn offline trên iPhone qua app Google AI Edge Gallery — không cần API key, không cần cloud. Các model nhỏ E2B và E4B được tối ưu cho mobile…
- Bài dịch
GitHub - fikrikarim/parlor: AI đa phương thức thời gian thực trên thiết bị
tinAI dịch bài này sang tiếng Việt từ : GitHub - fikrikarim/parlor: On-device, real-time multimodal AI. Have natural voice and vision conversations with an AI that runs entirely on your machine. Powered by Gemma 4 E2B and Kokoro. (github.com) · Loại nguồn: GitHub · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #078: Gemma 4 trên iPhone
Parlor là một ứng dụng AI đa phương thức chạy trên thiết bị của bạn, cho phép trò chuyện bằng giọng nói và hình ảnh một cách tự nhiên. Ứng dụng này không cần server, giúp tiết…
- Bài dịch
Google AI Edge Gallery - Ứng Dụng iOS
tinAI dịch bài này sang tiếng Việt từ : Google AI Edge Gallery-app - App Store (apps.apple.com) · Loại nguồn: web · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #078: Gemma 4 trên iPhone
Ứng dụng Google AI Edge Gallery chạy các mô hình ngôn ngữ lớn (LLMs) trên iPhone với hiệu năng cao, hoàn toàn offline và bảo mật. Tính năng nổi bật: Gemma 4 cho phép trải nghiệm…
- Bài dịch
Gemma 4 — Công Nghệ AI Tiên Tiến Từ Google DeepMind
tinAI dịch bài này sang tiếng Việt từ : Gemma 4 (deepmind.google) · Loại nguồn: web · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #075: Gemma 4 và cuộc đua Model mở rộng của Google
Gemma 4 từ Google DeepMind là một mô hình AI mở, tận dụng công nghệ từ Gemini 3 để tối đa hóa trí thông minh trên mỗi tham số. Nó cung cấp các giải pháp thông minh cho thiết bị di…
- Bài dịch
Video.js v10 Beta: Xin chào, Thế Giới (một lần nữa)
tinAI dịch bài này sang tiếng Việt từ : Video.js v10 Beta: Hello, World (again) (videojs.org) · Loại nguồn: công ty/blog · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #066: Wine 11 thay đổi cách Linux chạy game Windows với tăng tốc cực lớn
Video.js v10 Beta giới thiệu một bản viết lại toàn diện, giúp giảm kích thước gói, hỗ trợ React, Typescript và Tailwind. Người dùng có thể tùy chỉnh sâu và tích hợp AI dễ dàng hơn
- Bài dịch
GitHub - KittenML/KittenTTS: Mô hình TTS tiên tiến dưới 25MB 😻
tinAI dịch bài này sang tiếng Việt từ : GitHub - KittenML/KittenTTS: State-of-the-art TTS model under 25MB 😻 (github.com) · Loại nguồn: GitHub · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #060: Astral hợp tác với OpenAI
Kitten TTS là thư viện chuyển văn bản thành giọng nói nhẹ, mã nguồn mở với các mô hình từ 15M đến 80M tham số, vận hành hiệu quả trên CPU mà không cần GPU. Có sẵn hỗ trợ thương…
- Bài dịch
GitHub - RunanywhereAI/RCLI: Trò chuyện với Mac của bạn, truy vấn tài liệu, không cần đám mây
tinAI dịch bài này sang tiếng Việt từ : GitHub - RunanywhereAI/RCLI: Talk to your Mac, query your docs, no cloud required. On-device voice AI + RAG (github.com) · Loại nguồn: GitHub · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #051: Amazon yêu cầu kỹ sư cấp cao phê duyệt thay đổi hỗ trợ AI
RCLI là một giải pháp AI giọng nói trên thiết bị cho macOS, không cần kết nối đám mây. Nó cho phép thực hiện nhiều hành động trên macOS thông qua giọng nói và truy vấn tài liệu…
- Bài dịch
Moonshine: Công nghệ Nhận Dạng Giọng Nói Tự Động Cho Thiết Bị Cạnh
tinAI dịch bài này sang tiếng Việt từ : GitHub - moonshine-ai/moonshine: Fast and accurate automatic speech recognition (ASR) for edge devices (github.com) · Loại nguồn: GitHub · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #037: Cách chúng tôi tái cấu trúc Next.js với AI trong một tuần
Moonshine là một toolkit AI mã nguồn mở cho các ứng dụng giọng nói thời gian thực, hoạt động nhanh, riêng tư và không yêu cầu tài khoản. Nó được tối ưu hóa cho các ứng dụng…
- Bài dịch
GitHub - antirez/voxtral.c: Triển khai mô hình chuyển giọng nói thành văn bản Voxtral Realtime 4B bằng C thuần túy
tinAI dịch bài này sang tiếng Việt từ : GitHub - antirez/voxtral.c: Pure C inference of Mistral Voxtral Realtime 4B speech to text model (github.com) · Loại nguồn: GitHub · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #023: Qwen-Image-2.0: Chuyên nghiệp đồ họa thông tin, hiện thực tuyệt hảo
Voxtral.c là triển khai mô hình Voxtral Realtime 4B sử dụng C thuần túy mà không cần phụ thuộc vào bất kỳ thư viện bên ngoài nào. Nó hỗ trợ xử lý âm thanh theo thời gian thực và…
- Bài dịch
Voxtral phiên âm nhanh như tốc độ âm thanh
tinAI dịch bài này sang tiếng Việt từ : Voxtral transcribes at the speed of sound. (mistral.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #018: Claude Opus 4.6: Sự Bứt Phá Trong Khám Phá Lỗ Hổng
Voxtral Transcribe 2 giới thiệu hai mô hình phiên âm tiên tiến với khả năng xử lý tự động và độ trễ thấp. Voxtral Realtime tối ưu cho phiên âm trực tiếp với độ trễ dưới 200ms, còn…