Tin nổi bật
Software factory tắt đèn dễ đốt cháy codebase · 10 phút https://github.com/humanlayer/advanced-context-engineering-for-coding-agents/blob/main/wsff.md
Nếu bạn đang build coding agents, đây là bài nên đọc trước khi tăng thêm worker vào queue. HumanLayer chỉ ra điểm khó chịu mà nhiều dashboard agent né tránh: benchmark kiểu pass/fail thưởng cho việc sửa đúng bug ngay lúc này, nhưng gần như không phạt việc làm kiến trúc xấu đi trong 3 tháng tới. Con số Faros trong bài khá lạnh: review comments tăng 25%, 31,3% PR bỏ qua review, incidents per PR tăng 242,7% sau làn sóng AI coding tool đầu 2026. Kết luận của tôi: operator giỏi không đo “agent đã ship bao nhiêu PR”, mà đo rework, incident, review burden, độ nhỏ của vertical slice, và bao nhiêu quyết định sản phẩm/kiến trúc được khóa trước khi model đụng vào code.
Models & Tools
FLUX 3 gom image, video và audio vào cùng một backbone · 6 phút https://bfl.ai/blog/flux-3
Black Forest Labs đang đưa FLUX 3 vào Early Access với text-to-video, image-to-video, video-to-video, video+audio continuation, keyframe control và multilingual dialogue trong clip 720p tối đa 20 giây. Vendor nói các eval ban đầu cho thấy FLUX 3 Video được thích hơn Runway Gen-4.5 trong 77% cặp so sánh và Luma Ray 3.2 trong 93%, nhưng vẫn gọi đây là kết quả preliminary. Tôi sẽ đợi API và open-weight FLUX 3 Dev trước khi tin vào claim production, nhưng hướng train chung image/video/audio là đúng bài cho visual agent và simulation.
OneCLI giữ secret khỏi tay AI agent bằng HTTP gateway · 4 phút https://github.com/onecli/onecli
Trước đây muốn cho agent gọi nhiều API là phải rải key vào env, config hoặc tool wrapper rồi cầu nguyện log không lộ. OneCLI đặt một gateway ở giữa: agent dùng placeholder key, gateway match host/path, decrypt secret bằng AES-256-GCM và inject credential thật ở outbound request. Cái catch là bạn đang thêm một lớp MITM nội bộ vào stack, nên phải review kỹ permission model và audit log trước khi cho đụng production secret.
Hetzner thử inference API tương thích OpenAI · 4 phút https://sliplane.io/blog/hetzner-inference
Hetzner Experiments hiện có một endpoint OpenAI-compatible chạy Qwen/Qwen3.6-35B-A3B-FP8, context 262K, nhận text và image, chưa có billing hay SLA. Bài test nhỏ ghi nhận median time-to-first-token 153ms và khoảng 224 output tokens/giây, nghe rất ổn cho playground hạ tầng châu Âu. Đừng migration workload nghiêm túc vội; câu hỏi thật là Hetzner có chuyển từ workstation GPU sang cụm B200/B300-class và catalogue model tử tế hay không.
Research & Insights
FLUX-mimic biến video model thành bộ não điều khiển robot · 7 phút https://bfl.ai/blog/flux-3-mimic
Có một thesis đáng theo dõi ở đây: nếu video model học được contact, motion, weight và cause-effect đủ tốt, action prediction chỉ là một modality khác trên cùng world model. FLUX-mimic dùng FLUX 3 làm backbone, thêm action decoder, rồi sau khoảng 3.500 training steps lấy lại chất lượng video trong khi vẫn dự đoán action; bản triển khai của mimic còn đưa backbone xuống dưới 80ms trên RTX 5090 và toàn hệ thống khoảng 101ms. Với dev làm agent ngoài robotics, bài học vẫn dùng được: representation tốt quan trọng hơn việc dán thêm decoder/task head vào một backbone vốn không hiểu domain.
— tinAI