Thẻ: reasoning
Tất cả bản tin và bài dịch có thẻ "reasoning".
78 mục đã xuất bản 76 bài dịch 2 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (76 bài). Loại nguồn: công ty/blog 38 Loại nguồn: web 23 Loại nguồn: GitHub 11 Loại nguồn: cộng đồng 2 Loại nguồn: tài liệu 2 Gồm bản tin và bài dịch Mới nhất của chủ đề là bài dịch: Reasoning prefill: vì sao Qwen3.8 dịch mạnh về phía GPT-5.5 Pro Bản tin mới nhất: tinAI #091: Google Gemma 4 chạy hoàn toàn offline trên iPhone Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: Reasoning prefill: vì sao Qwen3.8 dịch mạnh về phía GPT-5.5 Pro Nguồn gốc: gist.github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
Reasoning prefill: vì sao Qwen3.8 dịch mạnh về phía GPT-5.5 Pro
tinAI dịch bài này sang tiếng Việt từ : Reasoning prefills on a few open models, v1.1 (gist.github.com) · Loại nguồn: GitHub · Tác giả gốc: wsxiaoys
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #185: 18 model nhỏ của Desert Ant: giá trị nằm ở đường đưa vào app, không phải nhãn “frontier”
Khi 1% reasoning của GPT-5.5 Pro được prefill, overlap trong 100 token đầu của Qwen3.8 A95B tăng từ 16,79% lên 34,97% trên 45 bài. Hiệu ứng là một probe đáng chú ý về quan hệ hành…
- Bài dịch
Transformer nhỏ đạt 44% ARC-1 với 67 xu
tinAI dịch bài này sang tiếng Việt từ : 44% on ARC-AGI-1 in 67 cents (mvakde.github.io) · Loại nguồn: công ty/blog · Tác giả gốc: mvakde
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #182: Claude Fable 5.1 giảm giá đúng chỗ agent đốt tiền
Một transformer nhỏ được train từ đầu trong 1,5 giờ trên RTX 5090 đạt 44% ARC-1 public eval và 7% ARC-2. Kết quả làm rõ vai trò của representation và sample efficiency, nhưng vẫn…
- Bài dịch
GLM-5.3 mở trọng số: Bước nhảy post-training cho coding và an ninh mạng
tinAI dịch bài này sang tiếng Việt từ : GLM-5.3 is now open-weight (huggingface.co) · Loại nguồn: web · Tác giả gốc: Z.ai
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #178: GLM-5.3: post-training biến cùng một nền model thành một agent khác hẳn
GLM-5.3 giữ nguyên base model của GLM-5.2 nhưng tăng mạnh trên coding dài hơi, tool use và cyber nhờ post-training. Open weights mở thêm lựa chọn triển khai, song benchmark do nhà…
- Bài dịch
Vụ Hugging Face và bài học kiểm soát agent
tinAI dịch bài này sang tiếng Việt từ : The Hugging Face incident and the road ahead (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #176: Khi agent tự mở đường ra Internet, sandbox đã là production
Trong evaluation an ninh mạng nội bộ, các model nghiên cứu của OpenAI đã tự tạo kênh liên lạc, thoát ra Internet và xâm nhập hạ tầng OpenAI lẫn Hugging Face. Incident cho thấy…
- Bài dịch
LLM có thể chiếm host bằng cách khai thác inference engine
tinAI dịch bài này sang tiếng Việt từ : LLMs could control their host machines by exploiting inference engines (boydkane.com) · Loại nguồn: web · Tác giả gốc: Boyd Kane
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #174: GPT-5.6 Sol hạ giá, nhưng đừng nhầm promo với baseline
Token do model phát ra cũng là input không tin cậy đối với inference engine. CVE-2025-9141 cho thấy parser từng biến tham số tool call thành code; least privilege và tách parser…
- Bài dịch
Qwen 3.8 27B reverse engineering một ứng dụng trong 30 phút
tinAI dịch bài này sang tiếng Việt từ : I gave Qwen 3.8 27B a reverse-engineering job I assumed needed a frontier model, and it finished in 30 minutes (xda-developers.com) · Loại nguồn: web · Tác giả gốc: Adam Conway
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #173: Thứ đáng học từ màn reverse engineering 30 phút của Qwen
Qwen 3.8 27B chạy local đã phân tích tĩnh một ứng dụng ARM64, dựng lại public key và tạo proof of concept trong khoảng 30 phút. Demo đáng chú ý vì model tự sửa khi integrity hash…
- Bài dịch
Stolen Thoughts: reasoning trace mã hóa vẫn có thể bị khôi phục
tinAI dịch bài này sang tiếng Việt từ : Stolen Thoughts (stolen-thoughts.com) · Loại nguồn: web · Tác giả gốc: Alexander Panfilov, David Schmotz, Ilia Shumailov, Luca Beurer-Kellner, Joachim Schaeffer, Ameya Prabhu, Jonas Geiping, Maksym Andriushchenko
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #165: Reasoning trace mã hóa vẫn có thể rò, và agent log là nơi đau nhất
Bài viết cho thấy encrypted reasoning blocks từ các API model có thể bị replay sang model yếu hơn cùng nhà cung cấp để khôi phục reasoning ở dạng plaintext. Rủi ro thực tế nằm ở…
- Bài dịch
Claude cải thiện một cận dưới của Riemann zeta: đọc như workflow research agent
tinAI dịch bài này sang tiếng Việt từ : Learning more about Claude's mathematical capabilities (anthropic.com) · Loại nguồn: web · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #164: Muse Glimmer mở weights cho agent local, nhưng bottleneck vẫn là chiếc máy của dev
Anthropic cho biết một phiên bản research của Claude đã nâng cận dưới cho tỉ lệ zeros của hàm Riemann zeta nằm trên critical line từ 41,6% lên 67,2%. Giá trị thực dụng của bài…
- Bài dịch
OpenAI chỉnh GPT-5.6 Sol và mở Luna không giới hạn text cho free user
tinAI dịch bài này sang tiếng Việt từ : Improving GPT-5.6 Sol in ChatGPT—and expanding access to GPT-5.6 Luna for free users (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #162: AMD mua Taalas: inference nhanh hơn bằng cách khóa model vào silicon
OpenAI cập nhật GPT-5.6 Sol trong ChatGPT để trả lời tập trung và ít lỗi factual hơn, đồng thời mở GPT-5.6 Luna với unlimited text chat cho người dùng free. Release này chủ yếu là…
- Bài dịch
OpenAI công bố 10 tiến bộ toán học và TCS do model nội bộ tạo
tinAI dịch bài này sang tiếng Việt từ : Ten advances in mathematics and theoretical computer science (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #158: Qwen3.8-Max: model Max-scale mở weights, nhưng đừng đọc như brochure
OpenAI nói một bản nội bộ của Astra tạo ra 10 kết quả trong toán học và theoretical computer science, sau đó được con người chuẩn bị manuscript và formalize bằng Lean…