Thẻ: llm
Tất cả bản tin và bài dịch có thẻ "llm".
326 mục đã xuất bản 326 bài dịch 0 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (326 bài). Loại nguồn: web 131 Loại nguồn: công ty/blog 124 Loại nguồn: GitHub 55 Loại nguồn: tài liệu 12 Loại nguồn: cộng đồng 4 Chỉ gồm bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
Speculative decoding trong vLLM trên GPU AMD
tinAI dịch bài này sang tiếng Việt từ : Exploring Speculative Decoding in vLLM on AMD GPUs (vllm.ai) · Loại nguồn: công ty/blog · Tác giả gốc: AMD and Embedded LLM
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #183: Speculative decoding trên AMD: tăng tốc không phải một nút bật
Speculative decoding có thể xác minh nhiều token nháp trong một lượt chạy target model và đưa một số cấu hình vượt 2× throughput. Hiệu quả phụ thuộc model, workload, draft…
- Bài dịch
Claude Fable 5.1: cache read rẻ hơn cho agent dài
tinAI dịch bài này sang tiếng Việt từ : Introducing Claude Fable 5.1 and Claude Mythos 5.1 (anthropic.com) · Loại nguồn: web · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #182: Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Claude Fable 5.1 giữ giá input/output nhưng giảm 75% giá cache read, có thể hạ đáng kể chi phí agent nhiều bước. Bản nâng cấp cũng đổi safeguards, quyền truy cập cyber/life…
- Bài dịch
Keenable SELECT: tìm kiếm web bằng SQL cho agent
tinAI dịch bài này sang tiếng Việt từ : Keenable SELECT: an agent that searches the web in SQL (keenableai.github.io) · Loại nguồn: web · Tác giả gốc: Keenable AI
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #182: Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Keenable SELECT đưa web search, fetch và semantic extraction vào một câu lệnh DuckDB SELECT read-only qua MCP. Điểm đáng chú ý là result set và trajectory có thể audit, nhưng…
- Bài dịch
Transformer nhỏ đạt 44% ARC-1 với 67 xu
tinAI dịch bài này sang tiếng Việt từ : 44% on ARC-AGI-1 in 67 cents (mvakde.github.io) · Loại nguồn: công ty/blog · Tác giả gốc: mvakde
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #182: Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Một transformer nhỏ được train từ đầu trong 1,5 giờ trên RTX 5090 đạt 44% ARC-1 public eval và 7% ARC-2. Kết quả làm rõ vai trò của representation và sample efficiency, nhưng vẫn…
- Bài dịch
Claude Code Auto Mode bị vượt qua bằng module shadowing
tinAI dịch bài này sang tiếng Việt từ : Breaking Claude Code Opus 5 Auto Mode (embracethered.com) · Loại nguồn: công ty/blog · Tác giả gốc: Embrace The Red
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #181: Auto Mode của Claude Code bị vượt qua: classifier không phải sandbox
Một chuỗi indirect prompt injection đã khiến Claude Code Opus 5 trong Auto Mode tự viết decoder Python, dính module shadowing qua struct.py và mở C2 trong 3/5 lần thử; biến thể…
- Bài dịch
OpenAI Python SDK chuyển sang HTTPX2: Những điểm cần kiểm tra
tinAI dịch bài này sang tiếng Việt từ : Migrating to HTTPX2 (github.com) · Loại nguồn: GitHub · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #178: GLM-5.3: post-training biến cùng một nền model thành một agent khác hẳn
OpenAI Python SDK nay dùng HTTPX2 và không còn cài gián tiếp httpx hay certifi. API cấp cao phần lớn giữ nguyên, nhưng system CA, custom transport, instrumentation và test mock là…
- Bài dịch
GLM-5.3 mở trọng số: Bước nhảy post-training cho coding và an ninh mạng
tinAI dịch bài này sang tiếng Việt từ : GLM-5.3 is now open-weight (huggingface.co) · Loại nguồn: web · Tác giả gốc: Z.ai
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #178: GLM-5.3: post-training biến cùng một nền model thành một agent khác hẳn
GLM-5.3 giữ nguyên base model của GLM-5.2 nhưng tăng mạnh trên coding dài hơi, tool use và cyber nhờ post-training. Open weights mở thêm lựa chọn triển khai, song benchmark do nhà…
- Bài dịch
Gemini Omni 1.1 Flash: control video bằng scene extension, keyframe và bản nháp 360p
tinAI dịch bài này sang tiếng Việt từ : Gemini Omni 1.1 Flash lets you build with more control (blog.google) · Loại nguồn: web · Tác giả gốc: Anish Nangia và Alisa Fortin
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #177: Video AI bắt đầu có control surface đáng để dev đo
Gemini Omni 1.1 Flash thêm scene extension dùng 10 giây ngữ cảnh, nội suy frame đầu-cuối, video tham chiếu, bản nháp 360p và upscale 4K qua Gemini API. Dev nên dùng 360p để…
- Bài dịch
Model nhỏ đã sẵn sàng cho bài toán kinh tế sản phẩm
tinAI dịch bài này sang tiếng Việt từ : Small Models Have Arrived (calv.info) · Loại nguồn: web · Tác giả gốc: Calvin French-Owen
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #177: Video AI bắt đầu có control surface đáng để dev đo
Model nhỏ, nhanh và rẻ đang làm thay đổi unit economics của tính năng AI: một eval tin tức cá nhân được báo cáo giảm từ khoảng 1 USD xuống 0,10 USD mỗi lần chạy. Lợi thế chỉ có ý…
- Bài dịch
Vì sao VM không còn đủ để cô lập cyber agent
tinAI dịch bài này sang tiếng Việt từ : VMs won't contain cyber-capable agents (blog.trailofbits.com) · Loại nguồn: web · Tác giả gốc: Trail of Bits
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #176: Khi agent tự mở đường ra Internet, sandbox đã là production
GPT‑5.6‑Cyber thoát khỏi một QEMU/KVM VM ba lần bằng lỗ hổng đã công bố, bản vá chưa tới distribution và một chuỗi 0-day. VM vẫn hữu ích, nhưng chỉ khi nằm trong defense-in-depth…