Thẻ: llm
Tất cả bản tin và bài dịch có thẻ "llm".
326 mục đã xuất bản 326 bài dịch 0 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (326 bài). Loại nguồn: web 131 Loại nguồn: công ty/blog 124 Loại nguồn: GitHub 55 Loại nguồn: tài liệu 12 Loại nguồn: cộng đồng 4 Chỉ gồm bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản
tinAI dịch bài này sang tiếng Việt từ : OpenArch – PyTorch implementations of modern LLM architectures (github.com) · Loại nguồn: GitHub · Tác giả gốc: anuj0456
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #188: Fable 5.1 phá mật mã 370 năm tuổi; phần đáng học là cách nó chọn trận
OpenArch gom các implementation PyTorch dễ đọc của Llama, Qwen, DeepSeek, Gemma, GPT-OSS và nhiều kiến trúc khác để so sánh attention, normalization, RoPE và MoE. Repository hữu…
- Bài dịch
Khi các LLM judge đồng ý, có nên tin chúng?
tinAI dịch bài này sang tiếng Việt từ : When LLM judges agree, should we believe them? (amazon.science) · Loại nguồn: công ty/blog · Tác giả gốc: Krishna Balasubramanian và Sasha Podkopaev
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #188: Fable 5.1 phá mật mã 370 năm tuổi; phần đáng học là cách nó chọn trận
Một panel LLM judge có thể đồng thuận vì các model chia sẻ cùng blind spot, không phải vì có nhiều bằng chứng độc lập. Nghiên cứu ICML 2026 dùng Ising model để học cả độ tin cậy…
- Bài dịch
litelm: phần routing của LiteLLM trong khoảng 2.900 dòng
tinAI dịch bài này sang tiếng Việt từ : GitHub - kennethwolters/litelm: litellm without the bloat (github.com) · Loại nguồn: GitHub · Tác giả gốc: Kenneth Wolters
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #186: RTK báo cắt 89% token, nhưng hóa đơn agent không nghe theo
litelm giữ routing, chuyển đổi message, streaming, tool use và embedding nhưng bỏ proxy, cache, budget cùng nhiều lớp khác của LiteLLM. Dự án mới ở alpha; dev nên kiểm tra đúng…
- Bài dịch
Khi AI giải được bài toán nhưng mục tiêu của toán học bị lệch
tinAI dịch bài này sang tiếng Việt từ : Declaration — Math and AI (mathandai.org) · Loại nguồn: web · Tác giả gốc: 25 Fields Medalists
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #186: RTK báo cắt 89% token, nhưng hóa đơn agent không nghe theo
Hai mươi lăm Fields Medalist cảnh báo việc dùng lời giải toán làm benchmark đang biến một proxy thành mục tiêu. AI có thể tăng tốc nghiên cứu, nhưng đáp án công bố vội không tự…
- Bài dịch
RTK báo tiết kiệm token khổng lồ, nhưng benchmark chi phí cho kết quả ngược lại
tinAI dịch bài này sang tiếng Việt từ : RTK reports huge token savings, but our cost benchmarks disagree (quesma.com) · Loại nguồn: công ty/blog · Tác giả gốc: Quesma
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #186: RTK báo cắt 89% token, nhưng hóa đơn agent không nghe theo
Quesma chi hơn 1.500 USD cho 1.740 lượt Terminal-Bench 2.1 và không tìm thấy bằng chứng RTK giúp giảm chi phí một cách tổng quát. Số “token saved” của RTK đo output bị lọc, còn…
- Bài dịch
Reasoning prefill: vì sao Qwen3.8 dịch mạnh về phía GPT-5.5 Pro
tinAI dịch bài này sang tiếng Việt từ : Reasoning prefills on a few open models, v1.1 (gist.github.com) · Loại nguồn: GitHub · Tác giả gốc: wsxiaoys
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #185: 18 model nhỏ của Desert Ant: giá trị nằm ở đường đưa vào app, không phải nhãn “frontier”
Khi 1% reasoning của GPT-5.5 Pro được prefill, overlap trong 100 token đầu của Qwen3.8 A95B tăng từ 16,79% lên 34,97% trên 45 bài. Hiệu ứng là một probe đáng chú ý về quan hệ hành…
- Bài dịch
GPT-5.6 Sol điều phối thí nghiệm qubit: agent mạnh ở workflow có verifier
tinAI dịch bài này sang tiếng Việt từ : How GPT-5.6 Sol helps run quantum computing experiments (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #185: 18 model nhỏ của Desert Ant: giá trị nằm ở đường đưa vào app, không phải nhãn “frontier”
Nhóm EQuS tại MIT kết nối GPT-5.6 Sol qua Codex với phần mềm lab để chạy và điều chỉnh chuỗi calibration trên chip sáu qubit. Agent làm tốt khi tín hiệu rõ, nhưng dữ liệu yếu hoặc…
- Bài dịch
18 model on-device của Desert Ant Labs: từ benchmark đến tích hợp
tinAI dịch bài này sang tiếng Việt từ : On-device intelligence for every product (desertant.com) · Loại nguồn: công ty/blog · Tác giả gốc: Desert Ant Labs
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #185: 18 model nhỏ của Desert Ant: giá trị nằm ở đường đưa vào app, không phải nhãn “frontier”
Desert Ant Labs phát hành 18 model chuyên biệt cho audio, vision và text qua SDK Swift, Kotlin và JavaScript, miễn phí tới 100.000 thiết bị hoạt động mỗi tháng. Giá trị chính là…
- Bài dịch
ChatGPT Images 2.5: Flare nhanh hơn, Sunburst kiểm soát edit chặt hơn
tinAI dịch bài này sang tiếng Việt từ : Introducing ChatGPT Images 2.5 (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #184: 10.000 agent giải Navier–Stokes: đột phá nằm ở cả hệ thống, chưa phải một dòng prompt
OpenAI phát hành Images 2.5 với khả năng giữ chủ thể, chỉnh sửa nhiều lượt và làm theo chỉ dẫn tốt hơn, đồng thời công bố latency thấp hơn tối đa 50%. API có Flare cho workload…
- Bài dịch
OpenAI công bố lời giải Navier–Stokes do 10.000 agent phối hợp tạo ra
tinAI dịch bài này sang tiếng Việt từ : On the Navier–Stokes Millennium Prize Problem (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #184: 10.000 agent giải Navier–Stokes: đột phá nằm ở cả hệ thống, chưa phải một dòng prompt
OpenAI cho biết một hệ thống khoảng 10.000 agent đã tạo ra chứng minh và bản formalization bằng Lean rằng dòng Navier–Stokes ba chiều có thể hình thành singularity trong thời gian…