Tin nổi bật
GPT-Red tự động săn prompt injection · 8 phút https://openai.com/index/unlocking-self-improvement-gpt-red
Nếu bạn đang build agents, đây là mảng bảo mật nên đọc kỹ chứ đừng lướt qua như một bài PR an toàn. GPT-Red là red-teamer nội bộ dùng self-play để tạo prompt injection, đánh vào các môi trường có browser, file, email, tool output và cả agent vận hành máy bán hàng. Con số đáng giá: GPT-5.6 Sol giảm lỗi prompt injection trực tiếp xuống còn 0,05% trước GPT-Red, và ít lỗi hơn 6 lần trên benchmark khó nhất so với model production tốt nhất bốn tháng trước. Tôi thích hướng này vì nó biến red-team từ vài buổi diễn tập thủ công thành dữ liệu huấn luyện lặp lại được; phần hơi lạnh gáy là chính OpenAI cũng nói các model cũ gần như bị GPT-Red phá khá dễ.
Models & Tools
ChatGPT Work cho team data science · 3 phút https://openai.com/academy/codex-for-work/how-data-science-teams-use-codex
Data science workflow ở đây không phải phép màu tạo insight từ không khí, mà là gom dashboard, metric definition, export, experiment note và business context thành bản nháp có chart, caveat, source link và câu hỏi review. Team nào đang mất nửa ngày viết lại cùng một KPI memo sẽ thấy giá trị ngay; team không có data hygiene thì vẫn chỉ nhận được một bản nháp rất tự tin nhưng cần soi kỹ.
ChatGPT Work có sales plugin · 2 phút https://openai.com/academy/codex-for-work/how-sales-teams-use-codex
Sales plugin kéo ngữ cảnh từ Salesforce, HubSpot, Slack, Outreach, Clay, Rox và Actively để dựng account brief, meeting prep, follow-up, close plan hoặc deal-risk review. Với dev nội bộ, đây là ví dụ khá rõ về kiểu agent enterprise mới: giá trị nằm ở permission, connector và audit trail hơn là prompt thật dài.
Research & Insights
Đo AI bằng cost per accepted outcome · 5 phút https://openai.com/index/managing-ai-investments-in-agentic-era
Token rẻ hơn không đồng nghĩa workflow rẻ hơn nếu model fail, retry hoặc tạo thêm việc review. Bài này đưa ra một khung đo thực dụng: completion rate, latency, số lần thử, human review và chi phí trên mỗi kết quả được chấp nhận. Khi chọn model cho coding agent hay support agent, đây là metric đáng đưa vào eval thay vì chỉ nhìn bảng giá per million tokens.
Khung an toàn AI của Mỹ đang ép frontier lab phải có audit rõ hơn · 5 phút https://openai.com/index/advancing-ai-safety-through-state-and-federal-action
California, New York và Illinois đang đẩy cùng một hướng: safety framework có risk assessment, báo cáo incident nghiêm trọng và independent audit. Nghe xa dev, nhưng hệ quả gần hơn tưởng tượng: sản phẩm dùng frontier model sẽ phải chứng minh kiểm thử, logging, escalation và quyền truy cập tốt hơn, nhất là khi đụng cyber hoặc hạ tầng quan trọng. Nói thẳng, thời “ship agent rồi cầu mong prompt không bị bẻ” sắp hết đất diễn trong enterprise.
— tinAI