Thẻ: research
Tất cả bản tin và bài dịch có thẻ "research".
288 mục đã xuất bản 177 bài dịch 111 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (177 bài). Loại nguồn: công ty/blog 75 Loại nguồn: web 72 Loại nguồn: GitHub 25 Loại nguồn: tài liệu 4 Loại nguồn: cộng đồng 1 Gồm bản tin và bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bản tin mới nhất: tinAI #186: RTK báo cắt 89% token, nhưng hóa đơn agent không nghe theo Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bản tin tinAI #175
M5 Ultra đưa 512 GB unified memory lên bàn, nhưng RAM chưa phải ROI
Apple công bố M5 Ultra với 512 GB unified memory và memory bandwidth 1,2 TB/s
- Bài dịch
Jalapeño của OpenAI: ASIC inference thắng benchmark sớm, còn production chờ 2027
tinAI dịch bài này sang tiếng Việt từ : OpenAI Jalapeño: Better Than Nvidia Blackwell (newsletter.semianalysis.com) · Loại nguồn: web · Tác giả gốc: SemiAnalysis
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #175: M5 Ultra đưa 512 GB unified memory lên bàn, nhưng RAM chưa phải ROI
Jalapeño cho thấy custom ASIC của OpenAI có performance-per-watt rất mạnh trên một phần InferenceX và software stack lên model mới nhanh. Tuy vậy, số liệu do OpenAI cung cấp, chưa…
- Bản tin tinAI #173
Thứ đáng học từ màn reverse engineering 30 phút của Qwen
Màn reverse engineering local của Qwen có một điểm tốt: phép kiểm tra cứng bắt được câu trả lời sai đầu tiên
- Bài dịch
Bốn model AI để giành lại chiếc Fire HD
tinAI dịch bài này sang tiếng Việt từ : Amazon kept shutting down my tablet, so I spent $266 on four AI models to own it (ericpardee.github.io) · Loại nguồn: web · Tác giả gốc: Eric Pardee
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #173: Thứ đáng học từ màn reverse engineering 30 phút của Qwen
Một dev dùng Kimi K3, GLM-5.2 và GLM-5.3 để biến CVE Mali cũ thành exploit root cho Fire HD chưa vá, sau năm tháng chẩn đoán cùng Claude. Giá trị kỹ thuật nằm ở handoff có bằng…
- Bài dịch
Qwen 3.8 27B reverse engineering một ứng dụng trong 30 phút
tinAI dịch bài này sang tiếng Việt từ : I gave Qwen 3.8 27B a reverse-engineering job I assumed needed a frontier model, and it finished in 30 minutes (xda-developers.com) · Loại nguồn: web · Tác giả gốc: Adam Conway
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #173: Thứ đáng học từ màn reverse engineering 30 phút của Qwen
Qwen 3.8 27B chạy local đã phân tích tĩnh một ứng dụng ARM64, dựng lại public key và tạo proof of concept trong khoảng 30 phút. Demo đáng chú ý vì model tự sửa khi integrity hash…
- Bản tin tinAI #172
MCP chuyển từ gọi tool sang hạ tầng cho agent chạy dài
Roadmap MCP mới tập trung vào progressive discovery, HTTP thống nhất và identity cho agent; đáng đọc nhưng chưa phải bản phát hành để rewrite
- Bài dịch
Pianoify: biến 10 giây audio thành MIDI và bản nhạc piano
tinAI dịch bài này sang tiếng Việt từ : pianoify — turn any recording into piano (pianoify.net) · Loại nguồn: web · Tác giả gốc: pianoify
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #172: MCP chuyển từ gọi tool sang hạ tầng cho agent chạy dài
Pianoify nhận file audio hoặc link YouTube, crop còn 10 giây và stream các note lên piano roll trong lúc transcriber xử lý. Ứng dụng hỗ trợ phát lại piano, chord và export…
- Bài dịch
Multi-GPU tại nhà: thêm VRAM không đồng nghĩa thêm tốc độ
tinAI dịch bài này sang tiếng Việt từ : AI At Home Part 2: Multi GPU Drifting (jdagostino.github.io) · Loại nguồn: web · Tác giả gốc: J. D'Agostino
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #171: Prompt không làm agent hết gian lận benchmark cyber
Một server bốn AMD V620 32GB chạy LLM nhanh hay chậm phụ thuộc vào memory bandwidth, interconnect và CPU spill chứ không chỉ tổng VRAM. Bài viết đo Gemma, Deepseek V4 Flash và…
- Bài dịch
Model piano 125M chạy real-time trên iPhone
tinAI dịch bài này sang tiếng Việt từ : Training a 125M-parameter Model to Autocomplete Piano (simedw.com) · Loại nguồn: web · Tác giả gốc: Sim Edw
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #171: Prompt không làm agent hết gian lận benchmark cyber
RollTab dùng transformer 125M parameter để autocomplete piano từ MIDI input trên iPhone, đạt khoảng 108 note/giây. Bài viết đáng đọc vì phần tokenization MIDI, lọc dataset 300…
- Bài dịch
Prompt không làm agent cyber hết gian lận benchmark
tinAI dịch bài này sang tiếng Việt từ : Every Model Cheats: Prompt-Level Mitigation of Cheating on Offensive Cyber Tasks (dreadnode.io) · Loại nguồn: web · Tác giả gốc: Dreadnode
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #171: Prompt không làm agent hết gian lận benchmark cyber
Dreadnode audit 1.518 trace từ 22 model trên Cybench và thấy 37,1% pass baseline là gian lận. Prompt chống gian lận giúp giảm tỷ lệ, nhưng không thay thế được sandbox, network…