Thẻ: agents
Tất cả bản tin và bài dịch có thẻ "agents".
368 mục đã xuất bản 243 bài dịch 125 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (243 bài). Loại nguồn: công ty/blog 98 Loại nguồn: web 91 Loại nguồn: GitHub 45 Loại nguồn: tài liệu 6 Loại nguồn: cộng đồng 3 Gồm bản tin và bài dịch Mới nhất của chủ đề là bài dịch: Fable 5.1 giải mật mã Cyphral Distich tồn tại 370 năm Bản tin mới nhất: tinAI #187: Agent bị cáo buộc biến RubyGems thành bệ phóng tấn công Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: Fable 5.1 giải mật mã Cyphral Distich tồn tại 370 năm Nguồn gốc: vals.ai · Loại nguồn: công ty/blog
- Mới nhất trong chủ đề này Bài dịch
Grok 4.6 trở lại nhóm frontier bằng lợi thế chi phí trên task
tinAI dịch bài này sang tiếng Việt từ : Grok 4.6 returns SpaceXAI to the intelligence frontier and leads on cost efficiency (artificialanalysis.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #166: Grok 4.6 đưa cuộc đua model về giá mỗi task, không chỉ điểm benchmark
Artificial Analysis chấm Grok 4.6 đạt 61 điểm Intelligence Index, ngang GPT-5.6 Sol và chỉ sau nhóm Claude cao nhất. Điểm dev cần nhìn kỹ là giá $2/$6 cho 1M input/output tokens…
- Bài dịch
Needle 2: model agentic 14 MB cho thiết bị nhỏ
tinAI dịch bài này sang tiếng Việt từ : Needle 2 - The 14 MB Agentic LLM for Tiny Devices | Cactus (cactuscompute.com) · Loại nguồn: web · Tác giả gốc: Cactus
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #165: Reasoning trace mã hóa vẫn có thể rò, và agent log là nơi đau nhất
Needle 2 là model 45M tham số của Cactus cho tool calling, device use và structured extraction, đóng gói thành binary 14 MB với session RAM khoảng 28 MB. Điểm đáng chú ý không…
- Bài dịch
Stolen Thoughts: reasoning trace mã hóa vẫn có thể bị khôi phục
tinAI dịch bài này sang tiếng Việt từ : Stolen Thoughts (stolen-thoughts.com) · Loại nguồn: web · Tác giả gốc: Alexander Panfilov, David Schmotz, Ilia Shumailov, Luca Beurer-Kellner, Joachim Schaeffer, Ameya Prabhu, Jonas Geiping, Maksym Andriushchenko
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #165: Reasoning trace mã hóa vẫn có thể rò, và agent log là nơi đau nhất
Bài viết cho thấy encrypted reasoning blocks từ các API model có thể bị replay sang model yếu hơn cùng nhà cung cấp để khôi phục reasoning ở dạng plaintext. Rủi ro thực tế nằm ở…
- Bản tin tinAI #164
Muse Glimmer mở weights cho agent local, nhưng bottleneck vẫn là chiếc máy của dev
Meta công bố Muse Glimmer, model 30B tham số tối ưu cho workflow agent chạy local, phát hành open weights theo Apache 2
- Bài dịch
Claude cải thiện một cận dưới của Riemann zeta: đọc như workflow research agent
tinAI dịch bài này sang tiếng Việt từ : Learning more about Claude's mathematical capabilities (anthropic.com) · Loại nguồn: web · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #164: Muse Glimmer mở weights cho agent local, nhưng bottleneck vẫn là chiếc máy của dev
Anthropic cho biết một phiên bản research của Claude đã nâng cận dưới cho tỉ lệ zeros của hàm Riemann zeta nằm trên critical line từ 41,6% lên 67,2%. Giá trị thực dụng của bài…
- Bài dịch
Docker Sandboxes: microVM dùng một lần cho coding agent
tinAI dịch bài này sang tiếng Việt từ : Docker Sandboxes | Sandboxes for Coding Agents (docker.com) · Loại nguồn: web · Tác giả gốc: Docker
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #164: Muse Glimmer mở weights cho agent local, nhưng bottleneck vẫn là chiếc máy của dev
Docker Sandboxes tạo môi trường microVM dùng một lần để coding agent chạy package install, sửa config và chạy Docker mà không chạm trực tiếp host. Điểm đáng giữ là checklist hạ…
- Bài dịch
Muse Glimmer: model 30B open weights cho agent chạy local
tinAI dịch bài này sang tiếng Việt từ : Introducing Muse Glimmer: An Open Agentic Model That Runs on Your Device (research.meta.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Meta Superintelligence Labs
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #164: Muse Glimmer mở weights cho agent local, nhưng bottleneck vẫn là chiếc máy của dev
Meta phát hành Muse Glimmer, model 30B tham số theo Apache 2.0, tối ưu cho workflow agent chạy local. Điểm đáng chú ý là thiết kế quanh bộ nhớ và tốc độ: quantization dưới 20 GB…
- Bài dịch
Us vs. Them: provenance từng dòng cho văn bản do người và AI cùng sửa
tinAI dịch bài này sang tiếng Việt từ : GitHub - eighttrigrams/us-vs-them: Line-level provenance for text under agentic editing (github.com) · Loại nguồn: GitHub · Tác giả gốc: eighttrigrams
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #163: DeepSeek V4 Flash dẫn Terminal-Bench 2.1, nhưng phần cần đọc là benchmark có thể soi lại
Us vs. Them dùng lịch sử version và diff để ước lượng dòng nào do người viết, dòng nào do agent viết. Công cụ này không phải detector ma thuật, nhưng là một hướng thực dụng cho…
- Bài dịch
DeepSeek V4 Flash dẫn đầu Terminal-Bench 2.1 với harness công khai
tinAI dịch bài này sang tiếng Việt từ : Ante Terminal Bench 2.1 Results | Coding Agent Benchmark (antigma.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Ante
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #163: DeepSeek V4 Flash dẫn Terminal-Bench 2.1, nhưng phần cần đọc là benchmark có thể soi lại
Ante báo DeepSeek V4 Flash 0731 đạt 82,7% trên Terminal-Bench 2.1 với 368/445 trials pass. Điểm đáng chú ý không chỉ là vị trí số một, mà là mỗi kết quả có nguồn raw run hoặc PR…
- Bản tin tinAI #163
DeepSeek V4 Flash dẫn Terminal-Bench 2.1, nhưng phần cần đọc là benchmark có thể soi lại
Ante công bố DeepSeek V4 Flash 0731 đạt 82,7% trên Terminal-Bench 2.1 với raw run có thể kiểm tra lại