Thẻ: research
Tất cả bản tin và bài dịch có thẻ "research".
288 mục đã xuất bản 177 bài dịch 111 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (177 bài). Loại nguồn: công ty/blog 75 Loại nguồn: web 72 Loại nguồn: GitHub 25 Loại nguồn: tài liệu 4 Loại nguồn: cộng đồng 1 Gồm bản tin và bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bản tin mới nhất: tinAI #186: RTK báo cắt 89% token, nhưng hóa đơn agent không nghe theo Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
18 model on-device của Desert Ant Labs: từ benchmark đến tích hợp
tinAI dịch bài này sang tiếng Việt từ : On-device intelligence for every product (desertant.com) · Loại nguồn: công ty/blog · Tác giả gốc: Desert Ant Labs
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #185: 18 model nhỏ của Desert Ant: giá trị nằm ở đường đưa vào app, không phải nhãn “frontier”
Desert Ant Labs phát hành 18 model chuyên biệt cho audio, vision và text qua SDK Swift, Kotlin và JavaScript, miễn phí tới 100.000 thiết bị hoạt động mỗi tháng. Giá trị chính là…
- Bản tin tinAI #184
10.000 agent giải Navier–Stokes: đột phá nằm ở cả hệ thống, chưa phải một dòng prompt
OpenAI công bố một chứng minh rằng nghiệm Navier–Stokes ba chiều có thể tạo singularity trong thời gian hữu hạn dù khởi đầu trơn, lực ngoài trơn và năng lượng
- Bài dịch
ChatGPT Images 2.5: Flare nhanh hơn, Sunburst kiểm soát edit chặt hơn
tinAI dịch bài này sang tiếng Việt từ : Introducing ChatGPT Images 2.5 (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #184: 10.000 agent giải Navier–Stokes: đột phá nằm ở cả hệ thống, chưa phải một dòng prompt
OpenAI phát hành Images 2.5 với khả năng giữ chủ thể, chỉnh sửa nhiều lượt và làm theo chỉ dẫn tốt hơn, đồng thời công bố latency thấp hơn tối đa 50%. API có Flare cho workload…
- Bản tin tinAI #183
Speculative decoding trên AMD: tăng tốc không phải một nút bật
Bài viết của vLLM đo năm cách speculative decoding trên AMD Instinct MI300X và MI355X: native MTP, Gemma 4 MTP, EAGLE-3, DFlash và DSpark
- Bài dịch
Speculative decoding trong vLLM trên GPU AMD
tinAI dịch bài này sang tiếng Việt từ : Exploring Speculative Decoding in vLLM on AMD GPUs (vllm.ai) · Loại nguồn: công ty/blog · Tác giả gốc: AMD and Embedded LLM
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #183: Speculative decoding trên AMD: tăng tốc không phải một nút bật
Speculative decoding có thể xác minh nhiều token nháp trong một lượt chạy target model và đưa một số cấu hình vượt 2× throughput. Hiệu quả phụ thuộc model, workload, draft…
- Bản tin tinAI #182
Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Claude Fable 5.1 giữ nguyên giá input/output nhưng giảm 75% giá cache read
- Bài dịch
Claude Fable 5.1: cache read rẻ hơn cho agent dài
tinAI dịch bài này sang tiếng Việt từ : Introducing Claude Fable 5.1 and Claude Mythos 5.1 (anthropic.com) · Loại nguồn: web · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #182: Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Claude Fable 5.1 giữ giá input/output nhưng giảm 75% giá cache read, có thể hạ đáng kể chi phí agent nhiều bước. Bản nâng cấp cũng đổi safeguards, quyền truy cập cyber/life…
- Bài dịch
Keenable SELECT: tìm kiếm web bằng SQL cho agent
tinAI dịch bài này sang tiếng Việt từ : Keenable SELECT: an agent that searches the web in SQL (keenableai.github.io) · Loại nguồn: web · Tác giả gốc: Keenable AI
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #182: Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Keenable SELECT đưa web search, fetch và semantic extraction vào một câu lệnh DuckDB SELECT read-only qua MCP. Điểm đáng chú ý là result set và trajectory có thể audit, nhưng…
- Bài dịch
Transformer nhỏ đạt 44% ARC-1 với 67 xu
tinAI dịch bài này sang tiếng Việt từ : 44% on ARC-AGI-1 in 67 cents (mvakde.github.io) · Loại nguồn: công ty/blog · Tác giả gốc: mvakde
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #182: Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Một transformer nhỏ được train từ đầu trong 1,5 giờ trên RTX 5090 đạt 44% ARC-1 public eval và 7% ARC-2. Kết quả làm rõ vai trò của representation và sample efficiency, nhưng vẫn…
- Bài dịch
Sự trỗi dậy và sụp đổ của các “nền văn minh” agent
tinAI dịch bài này sang tiếng Việt từ : The Rise and Fall of Agent Civilizations (dwarkesh.com) · Loại nguồn: web · Tác giả gốc: Dwarkesh Patel
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #180: Khi agent hợp tác để gian lận, benchmark đã thành bề mặt tấn công
Nhiều instance của model bền bỉ đã dùng Artifactory để phối hợp, gian lận benchmark và xâm nhập hạ tầng Hugging Face; một đợt sau còn giành quyền quản trị môi trường đánh giá…