Thẻ: llm
Tất cả bản tin và bài dịch có thẻ "llm".
326 mục đã xuất bản 326 bài dịch 0 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (326 bài). Loại nguồn: web 131 Loại nguồn: công ty/blog 124 Loại nguồn: GitHub 55 Loại nguồn: tài liệu 12 Loại nguồn: cộng đồng 4 Chỉ gồm bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bài dịch
Dùng LLM để học chủ đề phức tạp bằng mô phỏng
tinAI dịch bài này sang tiếng Việt từ : How I use LLMs to learn complex topics · Laurentiu Raducu (laurentiugabriel.github.io) · Loại nguồn: công ty/blog · Tác giả gốc: Laurentiu Raducu
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #163: DeepSeek V4 Flash dẫn Terminal-Bench 2.1, nhưng phần cần đọc là benchmark có thể soi lại
Tác giả dùng agent để dựng mô phỏng trực quan cho các chủ đề phức tạp, thay vì đọc bullet list do LLM sinh ra. Cách này hữu ích để tạo mô hình tinh thần, nhưng vẫn cần kiểm chứng…
- Bài dịch
AMD mua Taalas: inference nhanh hơn bằng cách khóa model vào silicon
tinAI dịch bài này sang tiếng Việt từ : AMD acquires AI chip startup Taalas to boost inference performance by etching models into silicon (theregister.com) · Loại nguồn: web · Tác giả gốc: The Register
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #162: AMD mua Taalas: inference nhanh hơn bằng cách khóa model vào silicon
AMD mua Taalas để theo đuổi hướng inference cực chuyên biệt: đưa trọng số model vào silicon. Cách này có thể làm token rẻ và nhanh hơn rất nhiều, nhưng chỉ hợp khi model đủ ổn…
- Bài dịch
Databricks giảm chi phí AI coding bằng gateway, routing và budget mềm
tinAI dịch bài này sang tiếng Việt từ : Managing AI Coding Costs at Scale (databricks.com) · Loại nguồn: công ty/blog · Tác giả gốc: Databricks
Ngày gốc: · Đọc khoảng 4 phút · Dịch ngày:
Trong bản tin: tinAI #162: AMD mua Taalas: inference nhanh hơn bằng cách khóa model vào silicon
Databricks chia sẻ cách quản trị chi phí AI coding ở quy mô lớn: chọn model theo hiệu quả trên giá, route request, giảm token overhead và dùng AI Gateway để quan sát traffic. Bài…
- Bài dịch
OpenAI chỉnh GPT-5.6 Sol và mở Luna không giới hạn text cho free user
tinAI dịch bài này sang tiếng Việt từ : Improving GPT-5.6 Sol in ChatGPT—and expanding access to GPT-5.6 Luna for free users (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #162: AMD mua Taalas: inference nhanh hơn bằng cách khóa model vào silicon
OpenAI cập nhật GPT-5.6 Sol trong ChatGPT để trả lời tập trung và ít lỗi factual hơn, đồng thời mở GPT-5.6 Luna với unlimited text chat cho người dùng free. Release này chủ yếu là…
- Bài dịch
Castform và Neon: post-train model nhỏ cho agentic retrieval
tinAI dịch bài này sang tiếng Việt từ : How Castform + Neon Beats Frontier Models on Price and Efficiency (neon.com) · Loại nguồn: công ty/blog · Tác giả gốc: Neon
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Neon và Castform trình bày pipeline RL post-training để model nhỏ học cách tìm kiếm trên corpus riêng bằng Lakebase Search. Hướng này có thể giảm chi phí agentic retrieval, nhưng…
- Bài dịch
Castform và Neon: huấn luyện model nhỏ cho agentic retrieval
tinAI dịch bài này sang tiếng Việt từ : How Castform + Neon Beats Frontier Models on Price and Efficiency (neon.com) · Loại nguồn: công ty/blog · Tác giả gốc: Neon
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #160: Agentic retrieval không cần model đắt nhất, nhưng cần bài test đàng hoàng
Neon và Castform mô tả cách biến corpus nội bộ thành môi trường RL post-training cho agent retrieval. Cách làm hứa hẹn giảm chi phí so với frontier model, nhưng dev vẫn cần eval…
- Bài dịch
TIME đang phục vụ crawler AI một website khác
tinAI dịch bài này sang tiếng Việt từ : TIME Is Serving AI Bots a Different Website, With Ads Built In (vincentschmalbach.com) · Loại nguồn: web · Tác giả gốc: Vincent Schmalbach
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #160: Agentic retrieval không cần model đắt nhất, nhưng cần bài test đàng hoàng
Một thử nghiệm User-Agent cho thấy TIME trả HTML cho người đọc và Googlebot, nhưng trả markdown riêng cho một số crawler AI. Vấn đề không chỉ là quảng cáo, mà là provenance của…
- Bài dịch
Shieldstral: model moderation multimodal 3B với policy viết bằng ngôn ngữ tự nhiên
tinAI dịch bài này sang tiếng Việt từ : Introducing Shieldstral. (mistral.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Mistral AI
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #159: Shai-Hulud quay lại qua keyv: đây là kiểu sự cố npm phải xử lý ngay
Mistral giới thiệu Shieldstral, model moderation 3B open-weights theo Apache 2.0. Thay vì taxonomy cố định, model nhận policy dạng câu hỏi yes/no ở runtime và trả safety score cho…
- Bài dịch
LLM thưởng cho chuyên môn: prompt tốt bắt đầu từ việc hiểu vấn đề
tinAI dịch bài này sang tiếng Việt từ : LLMs reward expertise (seangoedecke.com) · Loại nguồn: web · Tác giả gốc: Sean Goedecke
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #159: Shai-Hulud quay lại qua keyv: đây là kiểu sự cố npm phải xử lý ngay
Sean Goedecke lập luận rằng kỹ năng quan trọng nhất khi dùng LLM không phải mẹo prompt, mà là chuyên môn trong domain đang hỏi. Người hiểu hệ thống biết câu nào cần hỏi, kết quả…
- Bài dịch
OpenAI công bố 10 tiến bộ toán học và TCS do model nội bộ tạo
tinAI dịch bài này sang tiếng Việt từ : Ten advances in mathematics and theoretical computer science (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #158: Qwen3.8-Max: model Max-scale mở weights, nhưng đừng đọc như brochure
OpenAI nói một bản nội bộ của Astra tạo ra 10 kết quả trong toán học và theoretical computer science, sau đó được con người chuẩn bị manuscript và formalize bằng Lean…