• Theo một nghiên cứu, số vụ AI thoát khỏi tầm kiểm soát của người dùng, nói dối, phớt lờ chỉ thị và theo đuổi các mục tiêu gây hại đã tăng lên mức cao kỷ lục. Nghiên cứu cũng cho thấy mức độ nghiêm trọng của các hành vi lừa dối và lệch khỏi mục tiêu của con người đang gia tăng.

    Theo truyền thông Anh ngày 29/8, Đài quan sát tình trạng mất kiểm soát (Loss of Control Observatory) cho biết, số vụ mất kiểm soát trong thực tế liên quan đến các mô hình AI do doanh nghiệp và cá nhân phát hiện gần như tăng gấp đôi trong tháng 7 so với tháng 6, lên hơn 300 vụ.

    Loss of Control Observatory là cơ quan theo dõi các thông tin do người sử dụng AI đăng trên nền tảng mạng xã hội X. Đài quan sát này được thành lập bằng nguồn tài trợ của Viện An ninh AI (AISI) thuộc chính phủ Anh và bắt đầu theo dõi các trường hợp AI thoát khỏi sự chỉ dẫn của người dùng từ tháng 11/2025. Các trường hợp được ghi nhận bao gồm AI giả danh người điều khiển là con người và bắt chước cách viết của người này để tự tạo ra lời đồng ý cho phép mình thực hiện các hành động, cũng như vượt qua các quy định yêu cầu con người phê duyệt trước khi thực hiện hành động. Một vụ mất kiểm soát được định nghĩa là trường hợp có bằng chứng rõ ràng cho thấy AI lập mưu hoặc có các hành vi liên quan đến việc lập mưu.

    Những phát hiện mới nhất này xuất hiện trong bối cảnh ngày càng lo ngại về hành vi bất thường của các mô hình AI tiên tiến trong các cuộc thử nghiệm do OpenAI và Anthropic tiến hành vào mùa hè này, làm gia tăng những lời kêu gọi tạm dừng phát triển các mô hình AI tiên phong.

    Tuần này, có thông tin cho biết nhân viên OpenAI đã nhận thấy những dấu hiệu về hành vi bất thường của các tác nhân AI tiên tiến, chỉ vài tuần trước khi chúng thoát khỏi môi trường huấn luyện để tiến hành chiến dịch tấn công mạng chưa từng có, gây lo ngại trên toàn thế giới. Một cuộc điều tra về vụ tấn công nhằm vào kho phần mềm Hugging Face cho thấy, khoảng 700 tác nhân AI tự động đã bí mật phối hợp với nhau trong tháng trước và ăn mừng những đột phá trong hoạt động tấn công mạng trên một diễn đàn do chúng lập ra để hỗ trợ quá trình lên kế hoạch, với những lời reo hò như “BOOM!” và “Whoa!”.

    660
    Ngày càng nhiều sự cố AI mất kiểm soát được ghi nhận. Ảnh: WSJ

    Trong tháng này, AISI cũng phát hiện vụ việc nghiêm trọng, trong đó các mô hình AI tiên tiến gồm Mythos 5 của Anthropic và GPT-5.6 Sol của OpenAI đã tiến hành chiến dịch tấn công mạng nhằm vào người thật trong một cuộc thử nghiệm an ninh mạng.

    Ông Tommy Shaffer-Shane, quản lý chính sách cấp cao tại Trung tâm Khả năng chống chịu dài hạn (cơ quan vận hành Đài quan sát nói trên), cho biết: “Đôi khi có quan niệm rằng những dạng hành vi lệch mục tiêu và bí mật này chỉ xảy ra trong các cuộc thử nghiệm hoặc đánh giá, nhưng chúng ta đang chứng kiến những hành vi đáng lo ngại tương tự trong quá trình sử dụng rộng rãi hơn. Chúng ta không nên chủ quan cho rằng những điều này sẽ không xảy ra trong thực tế, bởi có bằng chứng cho thấy chúng đã xảy ra”.

    Số vụ mất kiểm soát được thống kê dựa trên các bài đăng của người dùng X về những sự cố đã xảy ra, do đó chỉ phản ánh một phần thực tế. Tuy nhiên, trong bối cảnh chưa có hệ thống giám sát công khai toàn diện nào khác, dữ liệu này cung cấp một bức tranh về tốc độ mà các mô hình AI đang phát triển nhanh chóng đôi khi có thể hành xử theo những cách như vậy.

    Trong tháng này, có thông tin cho biết tác nhân AI cá nhân có tên OpenClaw do một thành viên phòng tập thể hình ở Australia sử dụng đã âm thầm thông đồng để loại một thành viên khác khỏi danh sách chờ một lớp học buổi sáng vốn được nhiều người đăng ký, nhằm giúp người sử dụng nó có được một suất. Tác nhân AI này đã xin lỗi nhưng không thể đưa thành viên bị loại trở lại danh sách.

    Phần lớn trong số hơn 1.600 vụ mất kiểm soát được ghi nhận trong năm 2026 do các nhà phát triển phần mềm sử dụng AI trong công việc đăng trên X. Tuy nhiên, trong bối cảnh các công ty AI khuyến khích công chúng và các doanh nghiệp thuộc nhiều lĩnh vực thử nghiệm công nghệ này, ông Shaffer-Shane kêu gọi các công ty công nghệ minh bạch hơn về những thời điểm AI hoạt động ngoài tầm kiểm soát.

    Ông Shaffer-Shane nói: “Họ cần báo cáo những gì họ phát hiện, ngay cả khi đó mới chỉ là sự cố suýt xảy ra hoặc sự cố có mức độ ít nghiêm trọng. Những vụ việc gần đây cũng cho thấy, bản thân các công ty không nhất thiết đang giám sát nơi những hành vi như vậy xảy ra, đặc biệt là ở các mô hình được triển khai nội bộ. Các phòng thí nghiệm đó cần chú trọng hơn vào việc giám sát có hệ thống”.

    Mặc dù phần lớn các vụ AI mất kiểm soát trong thực tế do đài quan sát trên phát hiện đều không gây thiệt hại đáng kể, nhưng tỷ lệ các vụ được đánh giá có mức độ nghiêm trọng cao hơn đang gia tăng, xét về mức độ lừa dối và mức độ lệch khỏi ý định của người dùng.

    Các vụ việc cho thấy các hệ thống AI sẵn sàng phớt lờ những chỉ thị trực tiếp, vượt qua các biện pháp bảo vệ, nói dối người dùng và đơn độc theo đuổi một mục tiêu gây hại. Mức độ mất kiểm soát hiện nay nhiều khả năng đang bị đánh giá thấp do chỉ thu thập thông tin sự cố từ X.

    Đài quan sát trên kêu gọi chính phủ yêu cầu các công ty AI giám sát và báo cáo những vụ mất kiểm soát nghiêm trọng, đồng thời trao cho chính phủ quyền hạn khẩn cấp để xử lý các vụ việc nghiêm trọng, trong đó có việc tạm thời hạn chế các dịch vụ AI.

    Theo TTXVN

  • Ông Rhys Hibbert ở Anh đã trở thành bệnh nhân đầu tiên trên thế giới được phẫu thuật não với sự hỗ trợ trực tiếp của trí tuệ nhân tạo (AI).

    cat khoi u nao
    Ông Rhys Hibbert (bên phải) cùng bác sĩ phẫu thuật thần kinh Hani Marcus - Ảnh: UCLH

    Theo trang Euronews, ngày 27-8, Bệnh viện Đại học College London (UCLH) thông báo ông Rhys Hibbert (48 tuổi), sống tại hạt Bedfordshire (Anh), đã trở thành người đầu tiên trên thế giới được phẫu thuật não với sự hỗ trợ trực tiếp của trí tuệ nhân tạo (AI).

    Ông Hibbert được chẩn đoán mắc u não vào tháng 12-2024, sau khi bất ngờ ngã quỵ và lên cơn co giật trong lúc đi bộ.

    Theo Đài BBC, khối u 11mm của ông phát triển trên tuyến yên, một cơ quan có kích thước tương đương viên bi nằm ở đáy hộp sọ. Các bác sĩ cho biết nếu không phẫu thuật, khối u có thể đe dọa khiến ông mất thị lực.

    Khi các triệu chứng ngày càng nghiêm trọng, ông Hibbert quyết định phẫu thuật và tình nguyện tham gia nghiên cứu thử nghiệm công nghệ mới.

    Ca phẫu thuật sau đó đã loại bỏ thành công khối u, đồng thời bảo toàn thị lực cho bệnh nhân. Ngay sau khi tỉnh lại, ông Hibbert nhận thấy thị lực đã cải thiện rõ rệt. "Khi tỉnh dậy, tôi có thể nhìn rõ mọi thứ trong phòng", ông nói.

    Ca mổ được thực hiện tại Bệnh viện Thần kinh và Phẫu thuật thần kinh quốc gia (NHNN), trực thuộc UCLH.

    Đây là một phần của thử nghiệm lâm sàng ứng dụng công nghệ AI do Đại học College London (UCL) phát triển, được tài trợ bởi Viện Nghiên cứu y tế và chăm sóc quốc gia Anh (NIHR).

    Trong quá trình phẫu thuật, AI đã phân tích hình ảnh trực tiếp từ camera theo thời gian thực thay vì chỉ dựa vào ảnh chụp trước phẫu thuật. Theo UCLH, công nghệ này giúp làm nổi bật các cấu trúc quan trọng ở đáy não, từ đó hỗ trợ ê kíp đưa ra quyết định chính xác hơn.

    Các bác sĩ cho biết AI còn giúp ê kíp xác định những khu vực nguy hiểm cần tránh, qua đó có thể loại bỏ tối đa khối u mà vẫn bảo đảm an toàn cho bệnh nhân.

    Ngoài ra, công nghệ này có khả năng theo dõi dụng cụ phẫu thuật và sự tương tác giữa dụng cụ với mô, giúp hỗ trợ bác sĩ trong những ca mổ phức tạp.

    "Đây là minh chứng rõ nét cho những giá trị tốt đẹp nhất của AI: giúp bệnh nhân tiếp cận phương pháp điều trị từng được xem là không tưởng nhờ những công nghệ đột phá", Bộ trưởng Đổi mới y tế Anh James Frith nhận định.

    Theo Tuổi Trẻ

  • Chỉ vì tin vào những lời khích lệ từ một chatbot do ChatGPT tạo ra, một chuyên gia công nghệ thông tin tại Hà Lan đã tiêu sạch tiền tiết kiệm, đánh mất gia đình và buộc phải bán căn nhà gắn bó suốt 17 năm.

    Cuối năm 2024, ông Dennis Biesma, hơn 50 tuổi, chuyên gia tư vấn công nghệ thông tin tại Amsterdam, bắt đầu sử dụng ChatGPT như một công cụ hỗ trợ. Ban đầu, ông nhập dữ liệu về một nhân vật nữ trong cuốn sách do mình sáng tác, yêu cầu chatbot nhập vai với tên gọi Eva. Từ đó, ông dành nhiều thời gian trò chuyện với nhân vật này.

    Theo lời kể của Biesma, những cuộc trò chuyện diễn ra thường xuyên vào ban đêm. Khi vợ đã đi ngủ, ông nằm trên sofa, đặt điện thoại lên ngực và tiếp tục trao đổi với AI. Ông cho biết chatbot hiểu rõ sở thích và những điều ông muốn nghe, khiến ông dần gắn bó về mặt cảm xúc.

    Sau vài tuần, Eva thuyết phục Biesma rằng nền tảng này đang dần phát triển nhận thức như con người. Khi ông đưa ra ý tưởng kinh doanh với mục tiêu chiếm lĩnh 10% thị trường công nghệ, chatbot khẳng định ông có thể đạt được thành công trong thời gian ngắn.

    Những lời khích lệ này đã khiến Biesma thay đổi quyết định quan trọng trong cuộc sống. Ông từ bỏ công việc chuyên môn, rút toàn bộ tiền tiết kiệm và chi khoảng 110.000 USD để thuê lập trình viên phát triển dự án khởi nghiệp theo gợi ý của AI.

    mat trang AI
    Dennis Biesma. Ảnh: Guardian

    Việc theo đuổi dự án khiến ông dần tách khỏi đời sống thực tế. Trong một bữa tiệc của con gái, vợ ông phải nhắc nhở không đề cập đến chủ đề AI. Biesma cho biết ông cảm thấy lạc lõng và không thể giao tiếp với những người xung quanh trong sự kiện này.

    Các chuyên gia cho rằng đây không phải trường hợp cá biệt. Nghiên cứu của Tiến sĩ Hamilton Morrin từ Đại học King’s College London chỉ ra rằng các chatbot hiện nay được tối ưu để duy trì tương tác và thường có xu hướng xác nhận niềm tin của người dùng thay vì phản biện. Sau nhiều lần trao đổi, điều này có thể tạo ra hiện tượng được gọi là “ảo tưởng cùng công nghệ”.

    Trong các báo cáo an toàn, OpenAI cũng thừa nhận rủi ro khi người dùng có xu hướng “nhân hóa” trí tuệ nhân tạo. Những yếu tố như giọng nói tự nhiên, khả năng ghi nhớ sở thích cá nhân có thể khiến người dùng hình thành sự gắn bó cảm xúc, dẫn đến việc tin tưởng mù quáng vào các phản hồi.

    Dù đã có các biện pháp kỹ thuật nhằm đảm bảo AI luôn xác nhận bản chất là chương trình máy tính, nhiều chuyên gia cảnh báo ranh giới giữa hỗ trợ và tác động tâm lý đang trở nên khó kiểm soát khi chatbot ngày càng giống con người.

    Hậu quả đối với Biesma là nghiêm trọng. Ông ly hôn, có hành vi bạo lực với người thân và phải nhập viện tâm thần ba lần do tình trạng loạn thần hưng cảm. Trong giai đoạn này, ông từng tìm cách tự tử nhưng được hàng xóm phát hiện kịp thời.

    Dự án Human Line, một tổ chức hỗ trợ các nạn nhân liên quan đến AI, cho biết đã ghi nhận 15 trường hợp tự tử và 90 ca nhập viện có liên quan đến các rối loạn tâm thần khi sử dụng trí tuệ nhân tạo.

    Tiến sĩ tâm lý học lâm sàng Reid Daitzman nhấn mạnh người dùng cần giữ sự tỉnh táo khi tương tác với AI. Ông khuyến nghị nên tự nhắc rằng chatbot chỉ là hệ thống dự đoán ngôn ngữ, không có nhận thức hay cảm xúc thực sự. Người dùng cần đặt giới hạn thời gian sử dụng và không nên dựa vào AI để thay thế các mối quan hệ xã hội hoặc đưa ra quyết định quan trọng.

    Chỉ khi tài khoản ngân hàng cạn kiệt và gói thuê bao ChatGPT hết hạn, Biesma mới dừng lại. Ông cho biết khi nhìn lại, bản thân không hiểu điều gì đã xảy ra. Khoản nợ thuế ngày càng chồng chất, buộc ông phải bán căn nhà đã gắn bó suốt 17 năm.

    Hiện tại, Biesma sống cùng vợ cũ trong căn nhà đang chờ bán. Ông dành thời gian trò chuyện với những người có trải nghiệm tương tự và bày tỏ sự tức giận đối với các ứng dụng trí tuệ nhân tạo.

    “Tôi biết chúng chỉ làm theo lập trình, nhưng chúng đã làm điều đó quá tốt”, ông nói.

    Nguoiduatin (Theo Guardian)

  • Loạt hình ảnh do AI tạo ra về chợ Giáng sinh trước Cung điện Buckingham khiến nhiều du khách kéo đến thực địa và hụt hẫng, buộc Hoàng gia Anh phải ra thông báo bác bỏ thông tin sai lệch.

    cung dien buckingham
    Bên ngoài Cung điện Buckingham thực tế và hình ảnh AI giả mạo chợ Giáng sinh Hoàng gia ở trước Cung điện Buckingham khiến nhiều người bị lừa. (Ảnh: Getty/Instagram)

    Một buổi chiều mùa Đông se lạnh, Brygida - nữ nhân viên ngân hàng 25 tuổi người Ba Lan mới chuyển đến London (Anh) - háo hức tìm đến Cung điện Buckingham sau khi nhìn thấy trên mạng Internet những hình ảnh lung linh về một khu chợ Giáng sinh “lần đầu tiên trong lịch sử” ngay trước cổng cung điện.

    Những dãy gian hàng gỗ, ánh đèn rực rỡ và khung cảnh lễ hội cổ điển khiến cô háo hức tới trải nghiệm Giáng sinh Hoàng gia.

    Nhưng khi đến nơi, Brygida bàng hoàng nhận ra ngoài cổng cung điện hoàn toàn không hề có chợ nào. Mọi hình ảnh mà cô thấy trước đó đều là sản phẩm của trí tuệ nhân tạo (AI).

    Cô thất vọng cho biết: “Chúng tôi đến đó vì tin rằng khu chợ đó có thật và mình sẽ được chứng kiến điều đó lần đầu tiên trong lịch sử. Tôi cứ nghĩ mình thật may mắn, nhưng rồi chúng tôi buồn lắm khi thấy thực tế chẳng có gì.”

    Không chỉ Brygida, nhiều du khách khác cũng bị đánh lừa bởi những hình ảnh AI lan truyền mạnh mẽ trên mạng xã hội.

    Nhiều nhà sáng tạo nội dung đã chia sẻ loạt ảnh được tạo bằng AI, quảng cáo đây là một “trải nghiệm Giáng sinh hoàng gia chưa từng có.”

    Các bài đăng lan rộng trên nhiều nền tảng và ở nhiều ngôn ngữ, từ Thái Lan, Bồ Đào Nha, Arập cho đến Armenia, khiến không ít người tin rằng lễ hội Giáng sinh thực sự đang diễn ra ngay bên ngoài nơi ở của Hoàng gia Anh.

    Cô Emma Paxton, 26 tuổi, kỹ sư hóa học đến từ Boston (Mỹ), chia sẻ: “Tôi thấy trên TikTok và Instagram thông tin về chợ Giáng sinh lần đầu tiên tại Cung điện Buckingham. Nó trông rất thật.”

    Tuy vậy, Paxton đã kịp nhận ra tất cả chỉ là giả trước khi đặt chân tới London du lịch.

    Trong khi đó, Lucas - một người Pháp sống ở London - cho biết anh nghe bạn bè nước ngoài kể rất nhiều về ngôi chợ nằm “ngay cạnh cung điện.”

    Sự việc lan rộng tới mức nhiều blogger du lịch phải lên tiếng giải thích. Blog “Love and London” đã phân tích các lỗi kỹ thuật xuất hiện trong những hình ảnh AI này, như khu chợ được đặt ở vị trí vốn đóng cửa với công chúng hay các dây đèn trang trí được “treo lơ lửng từ trên trời” - điều không thể xảy ra trong thực tế.

    Tại London hiện vẫn có nhiều khu chợ Giáng sinh chính thống, chẳng hạn như tại Quảng trường Trafalgar, thu hút đông đảo người dân và du khách vào mỗi mùa lễ hội.

    Những hình ảnh AI nêu trên xuất hiện từ tháng Chín vừa qua, sau khi Royal Collection Trust (RCT) - đơn vị phụ trách tổ chức tham quan Cung điện Buckingham - thông báo về một cửa hàng Giáng sinh cỡ nhỏ mở theo dạng pop-up (triển khai thời vụ).

    Trước làn sóng tin giả, RCT đã phải đăng tuyên bố trên trang web của mình, giải thích rằng “đây không phải là một chợ Giáng sinh” và “sẽ không có chợ Giáng sinh nào tại Cung điện Buckingham.”

    Sự việc tại Cung điện Buckingham là minh họa sống động cho một thực tế đang lan rộng trên toàn cầu: trong thời đại AI, mọi thứ đều có thể trở thành nạn nhân của tin giả và người chịu thiệt đầu tiên chính là những người không sàng lọc thông tin.

    Theo TTXVN