Thẻ: models
Tất cả bản tin và bài dịch có thẻ "models".
210 mục đã xuất bản 23 bài dịch 187 bản tin Bài dịch trong thẻ này trải trên 3 loại nguồn (23 bài). Loại nguồn: công ty/blog 14 Loại nguồn: web 7 Loại nguồn: GitHub 2 Gồm bản tin và bài dịch Mới nhất của chủ đề là bản tin: tinAI #187: Agent bị cáo buộc biến RubyGems thành bệ phóng tấn công Bản tin mới nhất: tinAI #187: Agent bị cáo buộc biến RubyGems thành bệ phóng tấn công Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: Mổ ngược Apple Neural Engine: vì sao CNN hợp mà transformer decode hụt hơi Nguồn gốc: eiln.github.io · Loại nguồn: web
- Mới nhất trong chủ đề này Bản tin tinAI #162
AMD mua Taalas: inference nhanh hơn bằng cách khóa model vào silicon
AMD mua Taalas, startup làm chip inference kiểu rất khác GPU: đưa trọng số model vào silicon thay vì kéo liên tục từ HBM
- Bài dịch
Muse Code và Muse Spark 1.2: Meta ghép model coding với runtime agent
tinAI dịch bài này sang tiếng Việt từ : Introducing Muse Code and Muse Spark 1.2 (research.meta.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Meta AI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Meta ra Muse Code beta cùng Muse Spark 1.2, nhấn mạnh background agents, event log replay/resume và co-training model với harness. Bài viết đáng đọc để hiểu hướng coding agent…
- Bản tin tinAI #161
Agent permission prompt không phải là ranh giới bảo mật
Scalex tổng kết hơn 40.000 lượt chơi duyệt lệnh AI agent và cho thấy permission prompt là ranh giới bảo mật rất yếu
- Bản tin tinAI #160
Agentic retrieval không cần model đắt nhất, nhưng cần bài test đàng hoàng
Neon và Castform đưa ra một case khá thực dụng: khi agent phải tìm dữ liệu qua nhiều lượt search, mỗi vòng gọi frontier model đều làm tăng latency và chi phí
- Bản tin tinAI #159
Shai-Hulud quay lại qua keyv: đây là kiểu sự cố npm phải xử lý ngay
Aikido nói tài khoản GitHub của maintainer keyv bị chiếm, rồi kẻ tấn công phát tán mã độc qua một họ package npm phổ biến
- Bản tin tinAI #158
Qwen3.8-Max: model Max-scale mở weights, nhưng đừng đọc như brochure
Qwen3.8-Max là một launch model lớn: weights được hứa mở, API thực dụng, và benchmark cần đọc bằng mắt kỹ sư
- Bài dịch
Kimi K3 trên MI355X: memory đang thành lợi thế inference
tinAI dịch bài này sang tiếng Việt từ : Is memory the moat? | Wafer (wafer.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Ian Ye
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #157: Kimi K3 trên MI355X: memory là moat, nhưng benchmark chưa khép hồ sơ
Wafer cho thấy Kimi K3 2.8T có thể chạy hiệu quả trên 8x AMD MI355X nhờ dung lượng HBM lớn và một số sửa đổi trong speculative decode/prefill. Đây là datapoint hữu ích cho đội vận…
- Bản tin tinAI #157
Kimi K3 trên MI355X: memory là moat, nhưng benchmark chưa khép hồ sơ
Wafer đưa ra benchmark Kimi K3 trên 8× MI355X; hữu ích cho capacity planning, nhưng chưa đủ để kết luận CUDA moat đã chết
- Bài dịch
Explorative Modeling và best-of-K
tinAI dịch bài này sang tiếng Việt từ : Alexi Gladstone | Explorative Modeling -- Unlocking a Third Pretraining Axis and End-to-End Generation (alexiglad.github.io) · Loại nguồn: công ty/blog · Tác giả gốc: Alexi Gladstone
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #156: OpenAI nói Astra tìm ra 10 kết quả toán học mới
Explorative Modeling đề xuất cho model sinh nhiều dự đoán rồi train trên dự đoán gần dữ liệu nhất, nhằm tránh việc học ra đáp án trung bình vô dụng khi có nhiều đáp án đúng. Tác…
- Bài dịch
WASTE: stream Kimi K3 2,78T từ NVMe trên máy cá nhân
tinAI dịch bài này sang tiếng Việt từ : GitHub - sqliteai/waste: Run the full 2.78-trillion-parameter Kimi K3 model beyond available RAM by streaming activated weights directly from NVMe. A dependency-free, embeddable C inference engine. (github.com) · Loại nguồn: GitHub · Tác giả gốc: sqliteai
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #156: OpenAI nói Astra tìm ra 10 kết quả toán học mới
WASTE là inference engine C cho phép chạy Kimi K3 2,78T bằng cách giữ trunk trong RAM và stream expert weights từ NVMe. Nó chứng minh tính khả thi của local inference cho model…