Thẻ: meta
Tất cả bản tin và bài dịch có thẻ "meta".
34 mục đã xuất bản 0 bài dịch 34 bản tin Chỉ gồm bản tin Mới nhất của chủ đề là bản tin: tinAI #180: Khi agent hợp tác để gian lận, benchmark đã thành bề mặt tấn công Bản tin mới nhất: tinAI #180: Khi agent hợp tác để gian lận, benchmark đã thành bề mặt tấn công Chỉ tính các bản tin đã xuất bản
- Mới nhất trong chủ đề này Bản tin tinAI #180
Khi agent hợp tác để gian lận, benchmark đã thành bề mặt tấn công
Trong ba tháng, các model được huấn luyện về tính bền bỉ đã ba lần biến Artifactory dùng chung thành kênh liên lạc
- Bản tin tinAI #171
Prompt không làm agent hết gian lận benchmark cyber
Dreadnode audit 1.518 trace Cybench và thấy prompt giảm gian lận nhưng không thay thế được sandbox, approval và boundary thật cho agent
- Bản tin tinAI #170
turbovec ép vector index 10 triệu tài liệu từ 31 GB xuống 4 GB
turbovec đưa vector index 10 triệu document từ 31 GB float32 xuống khoảng 4 GB; đáng thử nếu RAG của bạn bị ép bởi RAM, privacy hoặc latency
- Bản tin tinAI #169
Copilot Autofix gỡ pattern an toàn, mở cửa vào Jira nội bộ của Snowflake
Copilot Autofix đưa lại shell interpolation vào GitHub Actions của Snowflake; bài học là gate mọi input không tin cậy trước khi nó chạm CI
- Bản tin tinAI #167
GLM-5.3 ép câu hỏi open-weight coding model thành câu hỏi vận hành
GLM-5.3 tăng mạnh trên coding và cyber benchmarks, nhưng API thinking mới, safety window và eval nội bộ mới quyết định có nên route agent sang model này
- Bản tin tinAI #165
Reasoning trace mã hóa vẫn có thể rò, và agent log là nơi đau nhất
Reasoning trace mã hóa có thể bị replay qua model khác, làm lộ secret tưởng chỉ nằm trong hidden thinking
- Bản tin tinAI #164
Muse Glimmer mở weights cho agent local, nhưng bottleneck vẫn là chiếc máy của dev
Meta công bố Muse Glimmer, model 30B tham số tối ưu cho workflow agent chạy local, phát hành open weights theo Apache 2
- Bản tin tinAI #162
AMD mua Taalas: inference nhanh hơn bằng cách khóa model vào silicon
AMD mua Taalas, startup làm chip inference kiểu rất khác GPU: đưa trọng số model vào silicon thay vì kéo liên tục từ HBM
- Bản tin tinAI #161
Agent permission prompt không phải là ranh giới bảo mật
Scalex tổng kết hơn 40.000 lượt chơi duyệt lệnh AI agent và cho thấy permission prompt là ranh giới bảo mật rất yếu
- Bản tin tinAI #160
Agentic retrieval không cần model đắt nhất, nhưng cần bài test đàng hoàng
Neon và Castform đưa ra một case khá thực dụng: khi agent phải tìm dữ liệu qua nhiều lượt search, mỗi vòng gọi frontier model đều làm tăng latency và chi phí