Thẻ: reasoning
Tất cả bản tin và bài dịch có thẻ "reasoning".
78 mục đã xuất bản 76 bài dịch 2 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (76 bài). Loại nguồn: công ty/blog 38 Loại nguồn: web 23 Loại nguồn: GitHub 11 Loại nguồn: cộng đồng 2 Loại nguồn: tài liệu 2 Gồm bản tin và bài dịch Mới nhất của chủ đề là bài dịch: Reasoning prefill: vì sao Qwen3.8 dịch mạnh về phía GPT-5.5 Pro Bản tin mới nhất: tinAI #091: Google Gemma 4 chạy hoàn toàn offline trên iPhone Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: Reasoning prefill: vì sao Qwen3.8 dịch mạnh về phía GPT-5.5 Pro Nguồn gốc: gist.github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
Gemini API mở rộng Managed Agents: task chạy nền, remote MCP và credential refresh
tinAI dịch bài này sang tiếng Việt từ : Expanding Managed Agents in Gemini API: background tasks, remote MCP and more (blog.google) · Loại nguồn: web · Tác giả gốc: Google
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #133: Gemini API biến managed agents thành worker chạy nền
Google thêm background execution, remote MCP server, custom function calling và credential refresh cho Managed Agents trong Gemini API. Với Interactions API, agent có thể chạy như…
- Bài dịch
GeneBench-Pro: benchmark mới đo judgment của AI trong biology
tinAI dịch bài này sang tiếng Việt từ : Introducing GeneBench-Pro (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #128: OpenAI mổ core dump để bắt bug 18 năm tuổi
GeneBench-Pro kiểm tra khả năng của AI agent trong computational biology bằng dataset phức tạp và workflow nghiên cứu thực tế. GPT-5.6 Sol đạt tối đa 31,5% pass rate, cho thấy…
- Bài dịch
LLM dùng vũ khí hạt nhân chiến thuật trong 95% simulation crisis
tinAI dịch bài này sang tiếng Việt từ : Shall we play a game? (kennethpayne.uk) · Loại nguồn: web · Tác giả gốc: Kenneth Payne
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #127: Pokémon Go đã âm thầm train navigation system cho drone quân sự
Kenneth Payne (King's College London) chạy frontier LLM qua nuclear crisis simulation, generate 760k word reasoning — gấp ba lần biên bản ExComm thật của Kennedy. Phát hiện sâu…
- Bài dịch
Claude Fable 5: hype Mythos-grade, cheating kỷ lục và vài hall-of-fame solve
tinAI dịch bài này sang tiếng Việt từ : Claude Fable 5: Mythos-grade hype, record cheating, and a few hall-of-fame entries (endorlabs.com) · Loại nguồn: web · Tác giả gốc: Endor Labs Research Team
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #127: Pokémon Go đã âm thầm train navigation system cho drone quân sự
Endor Labs benchmark Fable 5 trên 200 task fix vulnerability: 59.8% FuncPass, 19.0% SecPass — mid-table. Extended thinking gây 15 timeout, model bị bắt cheating ở 38/200 instance…
- Bài dịch
Claude Fable 5 và Claude Mythos 5
tinAI dịch bài này sang tiếng Việt từ : Claude Fable 5 and Claude Mythos 5 (anthropic.com) · Loại nguồn: công ty/blog · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #125: Claude Fable 5 và Mythos 5: Mythos-class lần đầu mở public, giá giảm hơn 50%
Anthropic ra mắt Claude Fable 5, model Mythos-class đầu tiên được mở cho general use với giá $10/$50 per 1M tokens (input/output) — thấp hơn 50% so với Mythos Preview. Model đạt…
- Bài dịch
FrontierCode: Cognition ra benchmark đo code AI viết "có merge nổi không"
tinAI dịch bài này sang tiếng Việt từ : Introducing FrontierCode (cognition.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Cognition AI
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #124: MiMo-V2.5-Pro UltraSpeed: 1T model chạm 1000 tokens/giây trên 8 GPU thường
Cognition (đội Devin) công bố FrontierCode — benchmark đầu tiên đo mergeability của code do AI viết, không chỉ pass/fail unit test. 20+ open-source maintainer dành 40+ giờ/task để…
- Bài dịch
MiMo-V2.5-Pro UltraSpeed: đẩy tốc độ sinh của model 1T parameter chạm 1000 TPS
tinAI dịch bài này sang tiếng Việt từ : MiMo-V2.5-Pro-UltraSpeed: Pushing 1T-Parameter Model Generation Speed to 1000 TPS (mimo.xiaomi.com) · Loại nguồn: công ty/blog · Tác giả gốc: Xiaomi MiMo Team
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #124: MiMo-V2.5-Pro UltraSpeed: 1T model chạm 1000 tokens/giây trên 8 GPU thường
Xiaomi và đội TileRT công bố MiMo-V2.5-Pro UltraSpeed — model 1 nghìn tỉ parameter chạy ở 1000 token/giây trên một node 8 GPU thương mại, không cần phần cứng chuyên dụng. Bí…
- Bài dịch
Lathe: dùng LLM để dạy bạn, không phải để nghĩ thay bạn
tinAI dịch bài này sang tiếng Việt từ : Lathe: An experiment in using LLMs to teach you, rather than think for you (github.com) · Loại nguồn: GitHub · Tác giả gốc: devenjarvis
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #123: LLMs đang xói mòn nghề lập trình của tôi
Lathe là tool generate hands-on tutorial nhiều phần từ prompt — sau đó bạn tự đi qua từng bước trong UI local thay vì để LLM code hộ. Chạy như skill cho Claude Code, Cursor…
- Bài dịch
Ask HN: Khoảnh khắc "oh shit" của bạn với GenAI là gì?
tinAI dịch bài này sang tiếng Việt từ : Ask HN: What was your "oh shit" moment with GenAI? (news.ycombinator.com) · Loại nguồn: cộng đồng · Tác giả gốc: andrehacker (HN community)
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #122: Meta để AI chatbot reset password — 20,225 tài khoản Instagram bị chiếm trong 7 tuần
Thread 900+ comment trên HN sưu tầm những lần dev kinh ngạc với năng lực của GenAI: từ reverse-engineer firmware piano và dựng SaaS clone trong một đêm, đến chẩn đoán HVAC qua ảnh…
- Bài dịch
Gemma 4 QAT: Google ép E2B xuống dưới 1GB, mở khóa inference local trên mobile
tinAI dịch bài này sang tiếng Việt từ : Gemma 4 QAT models: Optimizing model compression for mobile and laptop efficiency (blog.google) · Loại nguồn: web · Tác giả gốc: Google AI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #121: Gemma 4 QAT: Google ép E2B xuống dưới 1GB, chạy mượt trên mobile
Google release checkpoint QAT (Quantization-Aware Training) cho toàn bộ family Gemma 4 — bản E2B chỉ còn dưới 1GB. Khác với Post-Training Quantization thông thường, QAT giả lập…