Thẻ: research
Tất cả bản tin và bài dịch có thẻ "research".
288 mục đã xuất bản 177 bài dịch 111 bản tin Bài dịch trong thẻ này trải trên 5 loại nguồn (177 bài). Loại nguồn: công ty/blog 75 Loại nguồn: web 72 Loại nguồn: GitHub 25 Loại nguồn: tài liệu 4 Loại nguồn: cộng đồng 1 Gồm bản tin và bài dịch Mới nhất của chủ đề là bài dịch: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Bản tin mới nhất: tinAI #186: RTK báo cắt 89% token, nhưng hóa đơn agent không nghe theo Chỉ tính các bản tin đã xuất bản Bài dịch mới nhất: OpenArch: đọc kiến trúc LLM qua các implementation PyTorch tối giản Nguồn gốc: github.com · Loại nguồn: GitHub
- Mới nhất trong chủ đề này Bản tin tinAI #171
Prompt không làm agent hết gian lận benchmark cyber
Dreadnode audit 1.518 trace Cybench và thấy prompt giảm gian lận nhưng không thay thế được sandbox, approval và boundary thật cho agent
- Bài dịch
OpenAI chậm frontier RL vì Astra có thể chạm ngưỡng cyber-critical
tinAI dịch bài này sang tiếng Việt từ : Pacing model development in an era of cyber-critical capabilities (openai.com) · Loại nguồn: công ty/blog · Tác giả gốc: OpenAI
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #170: turbovec ép vector index 10 triệu tài liệu từ 31 GB xuống 4 GB
OpenAI nói họ tạm làm chậm một phần frontier training vì sự cố OpenAI-Hugging Face và tín hiệu Astra có thể đạt ngưỡng năng lực cyber-critical. Bài viết nêu các safeguard mới như…
- Bài dịch
turbovec: Vector index Rust ép 10 triệu document xuống 4 GB
tinAI dịch bài này sang tiếng Việt từ : GitHub - RyanCodrai/turbovec: A vector index built on TurboQuant, written in Rust with Python bindings (github.com) · Loại nguồn: GitHub · Tác giả gốc: RyanCodrai
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #170: turbovec ép vector index 10 triệu tài liệu từ 31 GB xuống 4 GB
turbovec là vector index Rust/Python dựa trên TurboQuant, nhắm tới RAG cục bộ cần ít RAM hơn. README claim corpus 10 triệu document từ 31 GB float32 xuống 4 GB, với search nhanh…
- Bài dịch
GPT-5.6 Sol: vision của OpenAI tốt hơn rõ rệt, nhưng batch vẫn phải tính giá
tinAI dịch bài này sang tiếng Việt từ : GPT 5.6 Sol is the best "vision" model OpenAI ever released (blog.roboflow.com) · Loại nguồn: web · Tác giả gốc: Roboflow
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #169: Copilot Autofix gỡ pattern an toàn, mở cửa vào Jira nội bộ của Snowflake
Roboflow đo GPT-5.6 Sol tăng mạnh ở object detection và counting so với GPT-5.5, nhưng OCR gần như đi ngang và extraction còn thấp hơn. Sol đáng thử cho UI agent và document…
- Bài dịch
Các mẫu và lỗi trong hệ thống multi-agent
tinAI dịch bài này sang tiếng Việt từ : Patterns and problems in multiagent systems (anthropic.com) · Loại nguồn: web · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #168: Multi-agent system: Anthropic cho thấy agent không tự nhiên biết phối hợp
Anthropic thử nghiệm nhiều agent cùng làm việc và thấy hai mặt rất khác nhau: swarm có thể mở rộng tốt cho quét lỗ hổng độc lập, nhưng phối hợp trên dự án chung vẫn dễ vỡ. Bài…
- Bài dịch
Coding với AI nhưng không vibe
tinAI dịch bài này sang tiếng Việt từ : AI coding without the vibes (peterbloem.nl) · Loại nguồn: công ty/blog · Tác giả gốc: Peter Bloem
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #168: Multi-agent system: Anthropic cho thấy agent không tự nhiên biết phối hợp
Peter Bloem đề xuất một cách dùng AI cho người học và dev muốn giữ kỹ năng: con người viết code, AI review. Bài không phủ nhận AI, nhưng đặt ranh giới rõ để tránh deskilling và…
- Bài dịch
DeepSeek V4 Pro 0813: model rẻ cần được kiểm bằng task thật
tinAI dịch bài này sang tiếng Việt từ : DeepSeek V4 Pro 0813 - API Pricing & Benchmarks (openrouter.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #166: Grok 4.6 đưa cuộc đua model về giá mỗi task, không chỉ điểm benchmark
OpenRouter liệt kê DeepSeek V4 Pro 0813 với giá trung bình rất thấp, throughput 58 tokens/giây và latency P50 1,34 giây. Bảng benchmark hữu ích để chọn candidate, nhưng dev vẫn…
- Bài dịch
Grok 4.6 trở lại nhóm frontier bằng lợi thế chi phí trên task
tinAI dịch bài này sang tiếng Việt từ : Grok 4.6 returns SpaceXAI to the intelligence frontier and leads on cost efficiency (artificialanalysis.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Unknown
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #166: Grok 4.6 đưa cuộc đua model về giá mỗi task, không chỉ điểm benchmark
Artificial Analysis chấm Grok 4.6 đạt 61 điểm Intelligence Index, ngang GPT-5.6 Sol và chỉ sau nhóm Claude cao nhất. Điểm dev cần nhìn kỹ là giá $2/$6 cho 1M input/output tokens…
- Bài dịch
Claude cải thiện một cận dưới của Riemann zeta: đọc như workflow research agent
tinAI dịch bài này sang tiếng Việt từ : Learning more about Claude's mathematical capabilities (anthropic.com) · Loại nguồn: web · Tác giả gốc: Anthropic
Ngày gốc: · Đọc khoảng 3 phút · Dịch ngày:
Trong bản tin: tinAI #164: Muse Glimmer mở weights cho agent local, nhưng bottleneck vẫn là chiếc máy của dev
Anthropic cho biết một phiên bản research của Claude đã nâng cận dưới cho tỉ lệ zeros của hàm Riemann zeta nằm trên critical line từ 41,6% lên 67,2%. Giá trị thực dụng của bài…
- Bài dịch
DeepSeek V4 Flash dẫn đầu Terminal-Bench 2.1 với harness công khai
tinAI dịch bài này sang tiếng Việt từ : Ante Terminal Bench 2.1 Results | Coding Agent Benchmark (antigma.ai) · Loại nguồn: công ty/blog · Tác giả gốc: Ante
Ngày gốc: · Đọc khoảng 2 phút · Dịch ngày:
Trong bản tin: tinAI #163: DeepSeek V4 Flash dẫn Terminal-Bench 2.1, nhưng phần cần đọc là benchmark có thể soi lại
Ante báo DeepSeek V4 Flash 0731 đạt 82,7% trên Terminal-Bench 2.1 với 368/445 trials pass. Điểm đáng chú ý không chỉ là vị trí số một, mà là mỗi kết quả có nguồn raw run hoặc PR…