Thẻ: research
Tất cả bản tin và bài dịch có thẻ "research".
288 mục đã xuất bản 177 bài dịch 111 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (177 bài). Loại nguồn: công ty/blog 75 Loại nguồn: web 72 Loại nguồn: GitHub 25 Loại nguồn: tài liệu 4 Loại nguồn: cộng đồng 1 Gồm bản tin và bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bản tin mới nhất: tinAI #186: RTK báo cắt 89% token, nhưng hóa đơn agent không nghe theo Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
LLM dùng vũ khí hạt nhân chiến thuật trong 95% simulation crisis
tinAI dịch bài này sang tiếng Việt từ : Shall we play a game? (kennethpayne.uk) · Loại nguồn: web · Tác giả gốc: Kenneth Payne
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #127: Pokémon Go đã âm thầm train navigation system cho drone quân sự
Kenneth Payne (King's College London) chạy frontier LLM qua nuclear crisis simulation, generate 760k word reasoning — gấp ba lần biên bản ExComm thật của Kennedy. Phát hiện sâu…
- Bài dịch
Claude Fable 5: hype Mythos-grade, cheating kỷ lục và vài hall-of-fame solve
tinAI dịch bài này sang tiếng Việt từ : Claude Fable 5: Mythos-grade hype, record cheating, and a few hall-of-fame entries (endorlabs.com) · Loại nguồn: web · Tác giả gốc: Endor Labs Research Team
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #127: Pokémon Go đã âm thầm train navigation system cho drone quân sự
Endor Labs benchmark Fable 5 trên 200 task fix vulnerability: 59.8% FuncPass, 19.0% SecPass — mid-table. Extended thinking gây 15 timeout, model bị bắt cheating ở 38/200 instance…
- Bài dịch
DiffusionGemma: model text diffusion 26B của Google, nhanh hơn autoregressive 4x
tinAI dịch bài này sang tiếng Việt từ : DiffusionGemma: 4x faster text generation (blog.google) · Loại nguồn: web · Tác giả gốc: Brendan O'Donoghue, Sebastian Flennerhag
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #126: Tòa Đức xử Google phải chịu trách nhiệm vì AI Overviews "tự nói"
Google ra DiffusionGemma — model experimental 26B MoE (Apache 2.0) sinh text bằng diffusion thay vì autoregressive. Trên H100 đạt 1000+ tokens/s, RTX 5090 đạt 700+ tokens/s. Chất…
- Bài dịch
Tòa Đức xử Google chịu trách nhiệm trực tiếp với AI Overviews — "tự nói" thì tự chịu
tinAI dịch bài này sang tiếng Việt từ : Landmark German ruling declares Google's AI Overviews are Google's own words and makes it liable for false answers (the-decoder.com) · Loại nguồn: web · Tác giả gốc: the-decoder
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #126: Tòa Đức xử Google phải chịu trách nhiệm vì AI Overviews "tự nói"
Tòa Munich phán quyết Google là 'direct infringer' khi AI Overviews phát tán thông tin sai về hai nhà xuất bản — vì AI tổng hợp ra câu trả lời mới (không nằm trong source nào)…
- Bài dịch
Nếu Claude Fable ngừng giúp bạn, bạn sẽ không bao giờ biết
tinAI dịch bài này sang tiếng Việt từ : If Claude Fable stops helping you, you'll never know (jonready.com) · Loại nguồn: công ty/blog · Tác giả gốc: Jonathon Ready
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #125: Claude Fable 5 và Mythos 5: Mythos-class lần đầu mở public, giá giảm hơn 50%
Model card Fable 5 tiết lộ Anthropic dùng prompt modification, steering vectors và PEFT để giảm khả năng của Claude khi user làm việc trong mảng frontier LLM development — và…
- Bài dịch
Claude Fable 5 và Claude Mythos 5
tinAI dịch bài này sang tiếng Việt từ : Claude Fable 5 and Claude Mythos 5 (anthropic.com) · Loại nguồn: công ty/blog · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #125: Claude Fable 5 và Mythos 5: Mythos-class lần đầu mở public, giá giảm hơn 50%
Anthropic ra mắt Claude Fable 5, model Mythos-class đầu tiên được mở cho general use với giá $10/$50 per 1M tokens (input/output) — thấp hơn 50% so với Mythos Preview. Model đạt…
- Bài dịch
FrontierCode: Cognition ra benchmark đo code AI viết "có merge nổi không"
tinAI dịch bài này sang tiếng Việt từ : Introducing FrontierCode (cognition.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Cognition AI
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #124: MiMo-V2.5-Pro UltraSpeed: 1T model chạm 1000 tokens/giây trên 8 GPU thường
Cognition (đội Devin) công bố FrontierCode — benchmark đầu tiên đo mergeability của code do AI viết, không chỉ pass/fail unit test. 20+ open-source maintainer dành 40+ giờ/task để…
- Bài dịch
Lathe: dùng LLM để dạy bạn, không phải để nghĩ thay bạn
tinAI dịch bài này sang tiếng Việt từ : Lathe: An experiment in using LLMs to teach you, rather than think for you (github.com) · Loại nguồn: GitHub · Tác giả gốc: devenjarvis
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #123: LLMs đang xói mòn nghề lập trình của tôi
Lathe là tool generate hands-on tutorial nhiều phần từ prompt — sau đó bạn tự đi qua từng bước trong UI local thay vì để LLM code hộ. Chạy như skill cho Claude Code, Cursor…
- Bài dịch
Tôi thiết kế bằng Claude nhiều hơn Figma giờ
tinAI dịch bài này sang tiếng Việt từ : I design with Claude more than Figma now (blog.janestreet.com) · Loại nguồn: web · Tác giả gốc: Edwin
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #123: LLMs đang xói mòn nghề lập trình của tôi
Một designer tại Jane Street kể chi tiết quy trình từ bỏ Figma cho prototype: viết mô tả vấn đề rồi build feature thật trên codebase bằng Claude Code. Anh ship được những ý tưởng…
- Bài dịch
LLMs đang xói mòn nghề lập trình của tôi — và tôi không biết phải làm gì
tinAI dịch bài này sang tiếng Việt từ : LLMs are eroding my software engineering career and I don't know what to do (human-in-the-loop.bearblog.dev) · Loại nguồn: web · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 9 phút · Dịch ngày:
Trong bản tin: tinAI #123: LLMs đang xói mòn nghề lập trình của tôi
Một backend engineer 10 năm kinh nghiệm trong domain payments kể chi tiết cách AI lần lượt xói mòn ba trụ cột trong sự nghiệp: chuyên môn domain, kỹ năng debug distributed…