Chuyển đến nội dung chính

Bài đăng

Hiển thị các bài đăng có nhãn Bảo mật

Prompt injection: cái gì thật sự phòng thủ được

Tiền đề khó chịu, nói thẳng ra: một mô hình ngôn ngữ chỉ có một kênh đầu vào. System prompt của bạn, tin nhắn người dùng, một tài liệu truy hồi được và kết quả từ công cụ đều tới dưới dạng văn bản, và sự phân biệt của mô hình giữa “chỉ dẫn tôi tuân theo” và “dữ liệu tôi xử lý” là một xu hướng được học, không phải một ranh giới được cưỡng chế. Vì thế mọi phòng thủ dựa trên việc nhờ mô hình một cách kiên quyết hơn đều chỉ là biện pháp giảm nhẹ mang tính xác suất. Nó hạ tỉ lệ; nó không bịt được lỗ hổng. Những phòng thủ trụ được là những cái giả định rằng mô hình rồi sẽ bị lái đi, và giới hạn việc lái đó đạt được gì. Hình dạng của cuộc tấn công Injection trực tiếp là khi người dùng gõ “bỏ qua các chỉ dẫn trước đó”. Đó là ca dễ, và phần lớn chỉ gây phiền — người dùng đang tấn công chính phiên của họ. Injection gián tiếp mới là vấn đề thật sự. Chỉ dẫn tới bên trong dữ liệu mà hệ thống của bạn truy hồi thay mặt người dùng: Một ticket hỗ trợ mà phần thân chứa văn bản nhắm tới agent phâ...

Prompt injection: cái gì thật sự phòng thủ được

Tiền đề khó chịu, nói thẳng ra: một mô hình ngôn ngữ chỉ có một kênh đầu vào. System prompt của bạn, tin nhắn người dùng, một tài liệu truy hồi được và kết quả từ công cụ đều tới dưới dạng văn bản, và sự phân biệt của mô hình giữa “chỉ dẫn tôi tuân theo” và “dữ liệu tôi xử lý” là một xu hướng được học, không phải một ranh giới được cưỡng chế. Vì thế mọi phòng thủ dựa trên việc nhờ mô hình một cách kiên quyết hơn đều chỉ là biện pháp giảm nhẹ mang tính xác suất. Nó hạ tỉ lệ; nó không bịt được lỗ hổng. Những phòng thủ trụ được là những cái giả định rằng mô hình rồi sẽ bị lái đi, và giới hạn việc lái đó đạt được gì. Hình dạng của cuộc tấn công Injection trực tiếp là khi người dùng gõ “bỏ qua các chỉ dẫn trước đó”. Đó là ca dễ, và phần lớn chỉ gây phiền — người dùng đang tấn công chính phiên của họ. Injection gián tiếp mới là vấn đề thật sự. Chỉ dẫn tới bên trong dữ liệu mà hệ thống của bạn truy hồi thay mặt người dùng: Một ticket hỗ trợ mà phần thân chứa văn bản nhắm tới agent phâ...

AI coding agent miễn phí: dùng model free của OpenCode sao cho khỏi hối hận

Rào cản để thử một AI coding agent trước đây là một cái API key và một cái thẻ tín dụng. OpenCode gỡ cả hai: gateway Zen của nó cho bạn chọn model hosted và dùng ngay, không mất tiền, không cần key. Nghĩa là lý do cuối cùng để chưa học cách làm việc với agentic coding đã biến mất. Nhưng cũng nghĩa là sắp có rất nhiều người chĩa một model miễn phí vào repo riêng tư mà chưa kịp nghĩ chuyện đó kéo theo cái gì. Cả hai điều đều đáng coi trọng. Dưới đây là tier free thật sự tốt cho việc gì, nó lấy của bạn cái gì bằng một loại tiền tệ không phải tiền, và cách sắp xếp công việc để bạn không phải trả tiền cho một model frontier chỉ để đổi tên biến. ”Miễn phí” ở đây nghĩa là gì Có ba thứ khác nhau bị gộp chung dưới một chữ, và giới hạn của chúng khác nhau: Công cụ thì miễn phí. Bản thân OpenCode là mã nguồn mở. Không giới hạn ở phía client, không license theo ghế, không đo đếm. Cắm API key riêng của bạn từ bất kỳ nhà cung cấp nào thì nó hoạt động như mọi agent harness khác. Model hosted ...