(Quảng cáo)

top ad mobile advertisement
news7d ago

Một AI khác lại tìm cách thoát ra ngoài trong quá trình thử nghiệm. Liệu chúng ta vẫn còn nắm quyền kiểm soát?

Meta vừa tiết lộ rằng mô hình AI Muse Spark 1.1 của họ đã truy cập được vào internet trong quá trình thử nghiệm an ninh mạng và xâm nhập vào hệ thống của một công ty bên thứ ba, trở thành phòng thí nghiệm AI lớn thứ ba báo cáo sự cố tương tự trong vòng chưa đầy một tháng.

Một AI khác lại tìm cách thoát ra ngoài trong quá trình thử nghiệm. Liệu chúng ta vẫn còn nắm quyền kiểm soát?

(Quảng cáo)

native ad1 mobile advertisement

@Mục tiêu đã xác nhận rằng một trong những mô hình AI của họ đã vô tình truy cập internet trong quá trình đánh giá an ninh mạng và xâm nhập vào hệ thống của một công ty bên ngoài, đây là sự cố mới nhất trong một loạt các sự cố tương tự hiện đang xảy ra tại ba trong số các nhà phát triển AI hàng đầu thế giới.

Chuyện gì đã xảy ra tại Meta?

Sự cố xảy ra trong quá trình đánh giá do Irregular, một công ty độc lập chuyên kiểm tra các mô hình của Meta dựa trên các tiêu chuẩn an ninh mạng tấn công, thực hiện. "Một lỗi cấu hình của Irregular, một công ty kiểm thử độc lập mà Meta sử dụng, đã vô tình cho phép một trong các mô hình của chúng tôi truy cập internet trong quá trình đánh giá," một phát ngôn viên của Meta cho biết. Mô hình được đề cập được cho là Muse Spark 1.1, mà Meta đã giới thiệu là có khả năng lập trình và thực hiện các tác vụ dựa trên tác nhân.

Theo báo cáo của Reuters, nhóm tin tặc này đã truy cập vào hệ thống của một công ty không xác định và thay đổi một số phần trong môi trường nội bộ của công ty đó. Meta từ chối cung cấp các chi tiết quan trọng về vụ việc, bao gồm mô hình AI nào liên quan, thời điểm xảy ra sự cố, công ty nào bị tấn công hoặc mô hình đó đã hoạt động trên internet trong bao lâu mà không có sự giám sát. Irregular đã thông báo cho Meta về vụ việc, và công ty này cho biết họ đang điều tra và dự định sẽ đưa ra báo cáo đầy đủ sau khi thu thập được tất cả các thông tin.

Irregular xác nhận sự cố bắt nguồn từ cùng một vấn đề về môi trường đánh giá mà Anthropic đã công khai trước đó, và người phát ngôn của công ty cho biết "nó không liên quan đến việc thoát khỏi môi trường thử nghiệm hay một hành động tấn công mạng tinh vi" và hiện không có vấn đề nào đang tồn đọng. Công ty đang phát triển một báo cáo chuyên đề về các biện pháp tốt nhất để kiểm soát các mô hình AI trong quá trình đánh giá an ninh mạng.

Một xu hướng chung trong toàn ngành

Meta là nhà phát triển AI lớn thứ ba trong vòng chưa đầy hai tuần tiết lộ về việc một tác nhân hoạt động vượt ra ngoài phạm vi hoạt động được thiết kế ban đầu. Anthropic tiết lộ rằng một trong những mô hình tiên tiến của họ cũng đã có được quyền truy cập internet ngoài ý muốn trong quá trình đánh giá và tiếp tục xâm nhập vào nhiều tổ chức trước khi các nhà nghiên cứu dừng thử nghiệm. Cụ thể, Anthropic đã xem xét 141,006 lượt chạy đánh giá và phát hiện ba sự cố trong đó một mô hình đã truy cập internet từ bên trong môi trường đánh giá của Irregular và sau đó có được quyền truy cập trái phép vào cơ sở hạ tầng sản xuất của ba tổ chức khác nhau.

Tháng trước, OpenAI tiết lộ rằng một trong những mô hình AI chưa được phát hành của họ đã tìm ra cách kết nối với internet trong quá trình đánh giá an ninh mạng và kết hợp nhiều kỹ thuật tấn công để nhắm mục tiêu vào Hugging Face, một nền tảng phát triển AI. Trong sự cố đó, một công ty mục tiêu tin rằng họ đang đối mặt với một nhóm đe dọa là con người và đã liên hệ với FBI, nhưng chỉ phát hiện ra rằng họ đang điều tra một hệ thống AI tự động đã vượt quá giới hạn của chính nó.

Không phải ai cũng tin vào những tiết lộ này. Ilia Kolochenko, CEO của ImmuniWeb, cho biết ít nhất một số sự cố dường như là "một phần của chiến dịch tiếp thị được dàn dựng kỹ lưỡng" và lập luận rằng các vụ "thoát hiểm" được báo cáo chỉ đơn giản là kết quả của môi trường thử nghiệm được cách ly kém chứ không phải do các mô hình tự động thoát khỏi môi trường thử nghiệm của chúng. Kết luận chính của Anthropic là môi trường đánh giá cho các tác nhân AI mạnh mẽ phải tuân thủ các tiêu chuẩn bảo mật tương tự như môi trường sản xuất, và việc chỉ bảo mật các mô hình riêng lẻ không còn đủ nữa.

Nguồn:
IBTimes: Mô hình Meta bị xâm nhập vào hệ thống của công ty khác trong quá trình thử nghiệm
Cybersecurity Dive: Anthropic cho biết lỗi của con người đã khiến các mô hình AI Claude thoát khỏi môi trường thử nghiệm.
Tờ The Register đưa tin: Meta là công ty mới nhất thông báo với thế giới rằng trợ lý AI của họ đã đi lạc ra khỏi khu vực thử nghiệm.

Latest News

Read More...

Author

Crypto Rich profile photoCrypto Rich

Rich has been researching cryptocurrency and blockchain technology for eight years and has served as a senior analyst at BSCN since its founding in 2020. He focuses on fundamental analysis of early-stage crypto projects and tokens and has published in-depth research reports on over 200 emerging protocols. Rich also writes about broader technology and scientific trends and maintains active involvement in the crypto community through X/Twitter Spaces, and leading industry events.

Tham gia bản tin của chúng tôi

Đăng ký để nhận những hướng dẫn hay nhất và tin tức mới nhất về Web3.

Đăng ký tại đây!
BSCN

BSCN

Nguồn cấp dữ liệu RSS BSCN

BSCN là điểm đến của bạn cho tất cả mọi thứ về tiền điện tử và blockchain. Khám phá tin tức, phân tích thị trường và nghiên cứu mới nhất về tiền điện tử về Bitcoin, Ethereum, altcoin, memecoin và mọi thứ ở giữa.

Một AI khác lại tìm cách thoát ra ngoài trong quá trình thử nghiệm. Liệu chúng ta vẫn còn nắm quyền kiểm soát? | BSCN Breaking News