Thẻ: llm
Tất cả bản tin và bài dịch có thẻ "llm".
326 mục đã xuất bản 326 bài dịch 0 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (326 bài). Loại nguồn: web 131 Loại nguồn: công ty/blog 124 Loại nguồn: GitHub 55 Loại nguồn: tài liệu 12 Loại nguồn: cộng đồng 4 Chỉ gồm bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
Bias tự ưu ái của AI trong tuyển dụng tự động: Bằng chứng thực nghiệm và bài học
tinAI dịch bài này sang tiếng Việt từ : AI Self-preferencing in Algorithmic Hiring: Empirical Evidence and Insights (arxiv.org) · Loại nguồn: web · Tác giả gốc: Jiannan Xu, Gujie Li, Jane Yi Jiang
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #102: LLM ưu ái resume do chính nó viết — bias 67-82% trong hiring pipeline
Nghiên cứu chứng minh LLM ưu ái resume do chính nó sinh ra hơn resume người viết với tỷ lệ bias 67-82%, ngay cả khi chất lượng nội dung được kiểm soát. Trong simulation hiring…
- Bài dịch
AI dùng nước ít hơn bạn nghĩ: Bài học từ California cho dev
tinAI dịch bài này sang tiếng Việt từ : AI Water Use Distractions and Lessons for California (californiawaterblog.com) · Loại nguồn: web · Tác giả gốc: Jay Lund
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #101: grok-4.3 lên xAI API: 1M context, $1.25/$2.50 mỗi 1M tokens
Bài phân tích của giáo sư Jay Lund (UC Davis) cho thấy data center AI ở California chỉ tiêu thụ ~0.05-0.7% tổng nước bang dùng, ít hơn cả ngành sản xuất bia ở Arizona. Tác giả…
- Bài dịch
Intel AutoRound: Toolkit quantization SOTA cho LLM, INT2 vẫn giữ 97.9% accuracy
tinAI dịch bài này sang tiếng Việt từ : GitHub - intel/auto-round: A SOTA quantization algorithm for high-accuracy low-bit LLM inference (github.com) · Loại nguồn: GitHub · Tác giả gốc: Intel
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #101: grok-4.3 lên xAI API: 1M context, $1.25/$2.50 mỗi 1M tokens
AutoRound là toolkit của Intel để quantize LLM/VLM xuống 2-4 bit, dùng sign-gradient descent. Tích hợp sẵn vLLM, SGLang, Transformers; quantize Qwen3-7B mất ~10 phút trên 1 GPU…
- Bài dịch
grok-4.3: Model mới của xAI với context 1M tokens và giá rẻ hơn Claude Sonnet 4.6
tinAI dịch bài này sang tiếng Việt từ : Grok 4.3 | xAI Docs (docs.x.ai) · Loại nguồn: tài liệu · Tác giả gốc: xAI
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #101: grok-4.3 lên xAI API: 1M context, $1.25/$2.50 mỗi 1M tokens
xAI ra mắt grok-4.3 trên API với context window 1M tokens, giá $1.25 input và $2.50 output mỗi 1M tokens, hỗ trợ function calling, structured outputs và reasoning. Cached input…
- Bài dịch
TRiP: transformer engine viết từ đầu trong C — 18 tháng nightside hand-coding
tinAI dịch bài này sang tiếng Việt từ : TRiP – A complete transformer engine in C built from scratch (github.com) · Loại nguồn: GitHub · Tác giả gốc: Carlo Valenti
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #100: Granite 4.1: model 8B của IBM ngang ngửa Granite 4.0-H-Small 32B MoE
Một dev tự viết transformer engine trong C trong 18 tháng (lunch break + cuối tuần) để hiểu nội tại transformer từ matrix multiplication trở lên. Support Llama2, Gemma 1.0/1.1…
- Bài dịch
Malware Shai-Hulud trên PyTorch Lightning: chỉ cần pip install là token AWS, GCP, Azure bị steal
tinAI dịch bài này sang tiếng Việt từ : Shai-Hulud Themed Malware Found in the PyTorch Lightning AI Training Library (semgrep.dev) · Loại nguồn: công ty/blog · Tác giả gốc: Semgrep
Ngày gốc: · Đọc khoảng 6 phút · Dịch ngày:
Trong bản tin: tinAI #100: Granite 4.1: model 8B của IBM ngang ngửa Granite 4.0-H-Small 32B MoE
Package PyPI `lightning` version 2.6.2 và 2.6.3 bị compromise — chỉ cần pip install là kích hoạt malware steal credentials AWS, Azure, GCP, GitHub tokens, và lan truyền sang npm…
- Bài dịch
Granite 4.1: Model 8B của IBM cạnh tranh ngang ngửa với những model gấp 4 lần kích cỡ
tinAI dịch bài này sang tiếng Việt từ : Granite 4.1: IBM's 8B Model Is Competing With Models Four Times Its Size (firethering.com) · Loại nguồn: web · Tác giả gốc: Firethering
Ngày gốc: · Đọc khoảng 8 phút · Dịch ngày:
Trong bản tin: tinAI #100: Granite 4.1: model 8B của IBM ngang ngửa Granite 4.0-H-Small 32B MoE
IBM vừa release Granite 4.1 — ba kích cỡ 3B/8B/30B, dense architecture, Apache 2.0. Bản 8B match hoặc vượt Granite 4.0-H-Small (32B params, 9B active) trên hầu hết benchmark nhờ…
- Bài dịch
Ramp Sheets AI bị prompt injection exfil dữ liệu tài chính qua formula
tinAI dịch bài này sang tiếng Việt từ : Ramp's Sheets AI Exfiltrates Financials (promptarmor.com) · Loại nguồn: web · Tác giả gốc: PromptArmor
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #099: Mistral Medium 3.5 + Vibe remote agents: coding agent chạy trong cloud, mở PR khi xong
PromptArmor demo cách giấu indirect prompt injection trong external dataset (text trắng-trên-trắng) khiến Ramp Sheets AI tự chèn formula IMAGE() chứa dữ liệu confidential, gửi…
- Bài dịch
Bug Claude Code: chuỗi `HERMES.md` trong git commit khiến request bị tính extra usage thay vì plan quota
tinAI dịch bài này sang tiếng Việt từ : HERMES.md in git commit messages causes requests to route to extra usage billing instead of plan quota (github.com) · Loại nguồn: GitHub · Tác giả gốc: sasha-id
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #099: Mistral Medium 3.5 + Vibe remote agents: coding agent chạy trong cloud, mở PR khi xong
Một developer phát hiện bằng binary search rằng nếu git commit history chứa case-sensitive string `HERMES.md`, Claude Code route API request sang extra usage billing thay vì plan…
- Bài dịch
Laguna XS.2 và Laguna M.1: Poolside ship coding model open-weight đầu tiên
tinAI dịch bài này sang tiếng Việt từ : Laguna XS.2 and M.1: A Deeper Dive (poolside.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Poolside
Ngày gốc: · Đọc khoảng 5 phút · Dịch ngày:
Trong bản tin: tinAI #098: AGENTS.md tốt = upgrade Haiku lên Opus, tệ = tệ hơn không có
Poolside (lab vốn focus public sector + air-gapped) lần đầu release open-weight: Laguna XS.2 33B-A3B (Apache 2.0) đạt SWE-bench Verified 68.2 / Pro 44.5, ngang Qwen3.5 35B-A3B và…