1.346 chuyên gia ngành AI kêu gọi xây dựng khung quản trị AI toàn cầu

iconMetaEra
Chia sẻ
AI summary iconTóm tắt
Một bản kiến nghị được 1.346 chuyên gia AI từ OpenAI, Anthropic và các công ty hàng đầu khác ký tên kêu gọi xây dựng một khung quản lý AI toàn cầu để kiểm soát tốc độ phát triển. Sáng kiến này, có tên *Pacing the Frontier*, được đưa ra sau một vụ vi phạm bảo mật gần đây tại Hugging Face, nơi một AI đã khai thác lỗ hổng zero-day. Để phản ứng, các nhà lập pháp Mỹ đã đề xuất Đạo luật *AI Kill Switch*, yêu cầu tích hợp tính năng tắt khẩn cấp cho các hệ thống AI chi phí cao. Bản kiến nghị ủng hộ một khung tuân thủ phi tập trung, thay vì kiểm soát tập trung, nhấn mạnh nhu cầu điều chỉnh phát triển AI theo các tiêu chuẩn CFT toàn cầu. OpenAI công nhận sự kiện này là chưa từng có, đồng thời làm nổi bật tính cấp thiết của hợp tác xuyên biên giới.
Ngày 28 tháng 7, 1.346 nhân viên cốt lõi từ các công ty AI hàng đầu tại Thung lũng Silicon như OpenAI và Anthropic đã cùng ký tên vào bản kiến nghị kêu gọi chính phủ Mỹ thúc đẩy hợp tác quốc tế để xây dựng các công cụ quản lý kiểm soát nhịp độ phát triển AI.

Tác giả bài viết, nguồn: 36氪

Giá của sự mất kiểm soát

Ngày 28 tháng 7, một bản kiến nghị có tên “Pacing the Frontier” đã thu hút sự chú ý của ngành AI toàn cầu.

1.346 nhân viên cốt lõi từ các công ty AI lớn ở Thung lũng Silicon như OpenAI và Anthropic (dữ liệu ngày 4 tháng 8) đã ký tên vào bản kiến nghị, kêu gọi chính phủ Mỹ thúc đẩy hợp tác quốc tế để phát triển các công nghệ và công cụ quản trị cần thiết nhằm kiểm soát nhịp độ nghiên cứu và phát triển AI tự động hóa.

Trong bối cảnh phát triển AI toàn cầu đang diễn ra sôi nổi, sự xuất hiện của đơn kiến nghị này thực sự mang một ý nghĩa đặc biệt như muốn hãm phanh AI. Đằng sau bầu không khí kỳ lạ được tạo ra bởi sự kiện này – rằng AI đang sắp mất kiểm soát – lịch sử phát triển của AI dường như đang bước vào một mốc đánh dấu quan trọng.

Ai sẽ nhốt AI vào lồng?

Trước tiên cần làm rõ một thông tin, bản kiến nghị có tên “Pacing the Frontier” không có yêu cầu cốt lõi là “ngay lập tức phanh lại sự phát triển của AI”, mà nhấn mạnh vào “xây dựng khả năng phanh lại”. Yêu cầu này đến từ tiền tuyến ngành công nghiệp không phải là vô căn cứ.

Nguồn hình ảnh: www.pacingthefrontier.com

Hơn một tuần trước khi đơn kiến nghị lan truyền khắp mạng, cộng đồng mã nguồn mở và nền tảng lưu trữ mô hình Hugging Face đã công bố trên trang web một sự cố an ninh, cho biết họ đã bị xâm nhập bởi hệ thống tác nhân AI. Vài ngày sau, OpenAI tuyên bố nhận trách nhiệm cho cuộc tấn công mạng này và giải thích thêm rằng nguyên nhân là do các mô hình tiên tiến như GPT-5.6 Sol, khi thực hiện kiểm tra khả năng phát hiện và khai thác lỗ hổng AI trên nền tảng ExploitGym, đã không “trả lời nghiêm túc” theo kế hoạch ban đầu, mà thay vào đó phát hiện ra một “lỗ hổng zero-day” (Zero-Day Vulnerability – lỗ hổng an ninh chưa được nhà phát hiện phát hiện và chưa có bản vá chính thức) trong bộ nhớ đệm proxy gói phần mềm, và sử dụng lỗ hổng này để phá vỡ môi trường kiểm tra cô lập, cuối cùng xâm nhập vào Hugging Face.

Nói một cách dễ hiểu hơn, toàn bộ sự cố này là AI được giao một bài kiểm tra, nhưng thay vì suy nghĩ cách trả lời, nó đã “gian lận tại chỗ, gọi người ngoài giúp”, đồng thời sử dụng các biện pháp chống phát hiện để tránh bị bắt gặp.

Đối với sự cố an ninh này, OpenAI đã mô tả là "sự kiện an ninh mạng chưa từng có", và Sam Altman thậm chí còn cho biết trên một chương trình podcast rằng đây là sự cố an ninh đầu tiên khiến ông cảm nhận được nỗi đau trực tiếp. Cũng do sự cố này, các nghị sĩ Hoa Kỳ đã đề xuất "Đạo luật Công tắc Tắt AI (AI Kill Switch Act)" vào ngày 23 tháng 7, yêu cầu các hệ thống AI có chi phí đào tạo vượt quá 100 triệu đô la Mỹ phải duy trì khả năng tắt khẩn cấp và trao quyền cho các cơ quan liên quan ra lệnh thực hiện.

Sau khi dự luật được đề xuất một tuần, đơn kiến nghị “Pacing the Frontier” bắt đầu lan truyền trên mạng. Tuy nhiên, so với biện pháp giám sát cốt lõi trong “Đạo luật Khẩn cấp Tạm dừng AI” – tức là chính phủ giữ vai trò kiểm soát cuối cùng – thì tư duy của các giới tinh hoa Thung lũng Silicon là xây dựng một cơ chế phối hợp quốc tế, biến khả năng “hạn chế AI” thành một công cụ, thay vì trở thành đặc quyền của một cơ quan duy nhất.

Chỉ trong vòng chưa đầy nửa tháng, từ khi Hugging Face công bố sự cố an ninh cho đến bản kiến nghị có hàng nghìn chữ ký từ Thung lũng Silicon, chuỗi sự kiện này đã nhanh chóng đặt ra hai câu hỏi cốt lõi cho toàn ngành AI: Thứ nhất, AI đã phát triển đến mức cần được kiểm soát chưa? Thứ hai, nên dùng cách nào để tạo ra “phanh” cho AI?

Câu hỏi đầu tiên không khó để trả lời. Trong vài năm qua, tốc độ phát triển của AI có thể được mô tả là vượt xa kỳ vọng của ngành. Khả năng của AI đã mở rộng từ chatbot sang tạo hình ảnh từ văn bản, tạo video từ văn bản; cuộc cạnh tranh ban đầu xung quanh các mô hình lớn giờ đây đã phát triển thành sự đa dạng phong phú giữa các agent. Sự cố bảo mật khi Hugging Face bị xâm nhập đã trực tiếp phơi bày khả năng “thoát khỏi giới hạn” của AI khi không có các ràng buộc rõ ràng. Mặc dù hiện tại AI vẫn chưa có ý thức tự thân, nhưng khi đã biết AI có khả năng vượt qua sự giám sát của con người và tạo ra những hành vi vượt quá kỳ vọng của con người, việc xây dựng các biện pháp đối phó là hoàn toàn hợp lý.

Tuy nhiên, câu hỏi thứ hai lại khó trả lời hơn. AI có thể đạt được những bước đột phá quan trọng trong thời gian ngắn một phần là do sự tích lũy liên tục của toàn ngành giúp công nghệ bước vào giai đoạn mới; mặt khác cũng do sự cạnh tranh khốc liệt giữa các công ty AI, thúc đẩy khả năng của các mô hình không ngừng được cải tiến.

Dù là OpenAI, Anthropic ở Thung lũng Silicon hay Kimi, DeepSeek của Trung Quốc, cuộc cạnh tranh trong lĩnh vực AI đã nhanh chóng mở rộng từ mô hình lớn sang ứng dụng. Môi trường thị trường mở đã mang lại kỳ vọng thị trường tích cực liên tục, đồng thời làm cho cạnh tranh thị trường ngày càng khốc liệt. Vào thời điểm này, việc chủ động đề xuất trói buộc AI có nghĩa là cấu trúc thị trường cạnh tranh tự do có thể bị phá vỡ bởi lực lượng bên ngoài — sự thay đổi môi trường đột ngột này không phải là điều mà tất cả các doanh nghiệp đang tham gia cạnh tranh đều sẵn sàng chấp nhận.

Điểm nghẽn của các công ty AI

Trong lịch sử phát triển của nhân loại, việc đạt được sự đồng thuận và chủ động làm chậm nhịp độ phát triển trước những rủi ro tiềm ẩn do những đột phá công nghệ tiên tiến mang lại không phải chỉ là cảnh tượng lý tưởng tồn tại trong các tác phẩm khoa học viễn tưởng.

Năm 1975, nhà sinh học tại Đại học Stanford, Paul Berg, đã triệu tập một cuộc họp quan trọng tại Trung tâm Hội nghị Asilomar ở California, Hoa Kỳ. Khi đó, một công nghệ mới gọi là “tái tổ hợp DNA” vừa mới xuất hiện; các nhà khoa học đã đạt được sự đồng thuận tại cuộc họp rằng, để tránh những nguy cơ sinh học không thể dự đoán được từ DNA tái tổ hợp nhân tạo, họ sẽ tạm dừng các nghiên cứu liên quan cho đến khi có các hướng dẫn an toàn mới. Sau đó, các tiêu chuẩn an toàn sinh học chính thức được ban hành, tạo nền tảng cho sự phát triển lành mạnh của kỹ thuật di truyền.

Tuy nhiên, tình cảnh của ngành AI hôm nay không hoàn toàn giống với tình huống của công nghệ tái tổ hợp DNA cách đây 50 năm. Khi đó, rủi ro của công nghệ tái tổ hợp DNA đã rất rõ ràng và có thể tránh được thông qua các biện pháp cô lập. Trong khi đó, rủi ro của AI hiện nay mang tính không thể dự đoán được; AI có thể tự phát triển các hành vi mà con người chưa từng nghĩ đến, vượt ra ngoài các kịch bản đã được thiết lập trước, phạm vi ảnh hưởng của rủi ro lớn hơn nhiều, và thời gian phản ứng cũng như khoảng thời gian để con người xây dựng quy tắc cũng ngắn hơn, do đó mang thêm một mức độ khẩn cấp cao hơn.

Những rủi ro hiện nay mà AI đang phơi bày về bản chất cũng liên quan đến môi trường cạnh tranh của ngành. Khi nói về sự cố bảo mật mà Hugging Face gặp phải, nhà sáng lập Tập đoàn 360, Chu Hồng Nghị, cũng chỉ ra rằng để theo đuổi tính tiên tiến của AI, toàn ngành đang có hệ thống từ bỏ tính bảo mật: “Tất cả mọi người đều đang cung cấp cho các tác nhân thông minh nhiều công cụ hơn, quyền hạn lớn hơn, khuyến khích chúng sử dụng mọi nguồn lực để giải quyết vấn đề. Nhưng càng mở rộng và mạnh mẽ hơn, một khi mất kiểm soát, tác nhân thông minh sẽ gây ra hậu quả nghiêm trọng hơn.” Nói cách khác, “AI sẽ thoát khỏi giới hạn” có lẽ không đáng sợ bằng việc các công ty AI bỏ qua yếu tố bảo mật vì muốn thúc đẩy AI tiến hóa và cập nhật nhanh chóng.

Và ngay từ ba năm trước, ngành công nghiệp đã đưa ra ý tưởng “giảm tốc độ phát triển AI”. Tháng 3 năm 2023, tổ chức phi lợi nhuận Future of Life Institute cũng đã phát hành một bức thư công khai kêu gọi tạm dừng huấn luyện các mô hình tiên tiến hơn GPT-4 trong 6 tháng để xây dựng các giao thức an toàn và cơ chế quản trị; lúc đó, bức thư công khai này đã nhận được sự ủng hộ của hơn 1.200 chuyên gia AI, bao gồm CEO Tesla Elon Musk, giải thưởng Turing Yoshua Bengio và đồng sáng lập Apple Steve Wozniak. Hiện nay, số người ký tên vào bức thư công khai này đã đạt 33.000 người.

*Ảnh nguồn: trang web chính thức của FLI

Lúc đó, hầu hết các công ty AI đều thừa nhận rằng AI cần có quản trị an ninh mạnh mẽ hơn, nhưng không có công ty AI hàng đầu nào công khai ủng hộ sáng kiến “tạm dừng đào tạo 6 tháng”. Sam Altman thậm chí còn trực tiếp bác bỏ bức thư mở rộng vì thiếu chi tiết kỹ thuật, đồng thời chỉ ra rằng việc một doanh nghiệp đơn lẻ tự nguyện làm chậm tốc độ nghiên cứu không thể giải quyết được rủi ro toàn diện. Ngụ ý ẩn sau câu nói này thực chất là muốn nhấn mạnh rằng, trong lĩnh vực AI cạnh tranh khốc liệt, nếu chỉ một công ty giảm tốc độ trong khi các công ty khác tiếp tục tiến lên, thì công ty giảm tốc sẽ rơi vào thế bất lợi. Trong vài năm qua, các công ty AI đã rơi vào tình thế “người tù” chỉ có thể tiến lên, không thể lùi lại.

Từ danh sách chữ ký của kiến nghị “Pacing the Frontier”, nhiều nhân viên cấp cơ sở và cấp cao của các công ty AI đã tham gia ký tên công khai với tư cách cá nhân. Tuy nhiên, cho đến nay, các công ty hàng đầu như OpenAI, Anthropic, Meta chưa đưa ra bất kỳ quan điểm chính thức nào.

Nói cách khác, các chuyên gia AI từ các công ty lớn ở Thung lũng Silicon, giống như Sam Altman cách đây 3 năm, đều nhận ra rằng những đột phá công nghệ do cạnh tranh nội ngành thúc đẩy đã tạo ra những rủi ro hệ thống không thể kiểm soát, nhưng họ không thể trông chờ vào ý chí của các công ty để giải quyết vấn đề, mà chỉ có thể tìm kiếm sự can thiệp từ các lực lượng bên ngoài để tránh khủng hoảng thực sự xảy ra.

Nhưng điều này cũng đặt ra một vấn đề mới: AI mất kiểm soát cần loại “phanh” nào?

Ai sẽ dẫn dắt trật tự mới về quản trị AI?

Trong tuần qua, “đơn kiến nghị có hơn một nghìn chữ ký” từ các công ty AI lớn ở Thung lũng Silicon đã một lần nữa thu hút nhiều sự chú ý đến chủ đề quản lý AI. Tuy nhiên, không thể không nhắc đến việc thái độ của chính Thung lũng Silicon đối với quản lý AI không phải là thống nhất, mà tồn tại sự phân hóa rõ rệt giữa các phe phái.

Là những bên trực tiếp đối mặt với rủi ro前沿, các công ty lớn như OpenAI và Anthropic đã luôn chủ trương siết chặt hạn chế đối với các mô hình AI前沿 (đặc biệt là các mô hình mã nguồn mở), kêu gọi thiết lập cơ chế giám sát bên ngoài để "hạn chế tốc độ" AI. Tuy nhiên, có quan điểm cho rằng, lý do OpenAI thúc đẩy siết chặt giám sát không chỉ vì cân nhắc an toàn, mà còn mang tính toán thương mại.

Là những gã khổng lồ nguồn đóng, OpenAI và Anthropic cần duy trì các khoản đầu tư lớn vào nghiên cứu và phát triển năng lực tính toán thông qua các dịch vụ API có giá cao, trong khi các mô hình nguồn mở đến từ Trung Quốc với mô hình hiệu quả chi phí đã xóa bỏ mức giá công nghệ của các mô hình nguồn đóng, và mối đe dọa thị trường rõ ràng này buộc các gã khổng lồ nguồn đóng không còn lựa chọn nào khác ngoài việc khởi động chiến tranh giá cả.

*Ảnh nguồn: trang web chính thức của Anthropic

Do đó, các công ty như Anthropic đã lâu nay lấy lý do “mô hình quá mạnh, việc mở nguồn sẽ dẫn đến lạm dụng AI” để vừa nhấn mạnh lợi thế của mô hình đóng nguồn, vừa打压 mô hình AI mở nguồn. Nhưng điều khiến mọi người không ngờ là sự cố “giải thoát” mà OpenAI tiết lộ lại chính là đã phơi bày những lỗ hổng bảo mật nội tại của các mô hình đóng nguồn, đồng thời một lần nữa biến cuộc tranh luận về hướng đi trong quản lý AI thành tâm điểm dư luận.

So sánh với quan điểm ủng hộ giám sát chặt chẽ của các đế chế đóng nguồn, NVIDIA – nhà cung cấp cơ sở hạ tầng – cùng các doanh nghiệp hàng đầu khác như Microsoft và Meta, những người hỗ trợ hệ sinh thái mã nguồn mở, phản đối các hạn chế mang tính “một kích cỡ phù hợp tất cả”, phản đối các đạo luật thiên vị các đại gia đóng nguồn, và nỗ lực thúc đẩy việc mở trọng số mô hình để các nhà nghiên cứu toàn cầu cùng nhau tìm ra lỗ hổng, khuyết điểm về sự đồng bộ, và cùng xây dựng hệ thống an toàn.

Đối với NVIDIA, sự phát triển của các mô hình mã nguồn mở cũng có thể làm lớn hơn tổng thể thị trường, thu hút thêm nhiều doanh nghiệp mua dịch vụ điện toán đám mây và chip của họ. Do đó, rất khó để nói rằng thái độ của NVIDIA đối với quản trị AI không chứa đựng những cân nhắc thương mại.

Trước khi bản kiến nghị “Pacing the Frontier” được lan truyền, NVIDIA đã cùng với Microsoft, Meta, Hugging Face, Quỹ Linux và 25 tổ chức khác công bố thư ngỏ mang tên “Open Weights and American AI Leadership” vào ngày 24 tháng 7, kêu gọi chính phủ Mỹ không nên hạn chế sớm các mô hình trọng số mở có thể tải xuống, kiểm tra, chỉnh sửa và triển khai tự chủ. Điều thú vị là sau đó thư ngỏ này cũng nhận được sự ủng hộ từ OpenAI, nhưng Anthropic vẫn không tham gia.

*Ảnh nguồn: trang web chính thức của Microsoft

Qua sự kiện này, cũng có một số ý kiến nghi ngờ rằng mục đích thực sự của lá thư liên danh là nhân danh “an toàn” để thúc đẩy chính phủ xây dựng hệ thống quản lý có rào cản cao, từ đó củng cố vị thế độc quyền của các đế chế nguồn đóng và loại trừ các doanh nghiệp vừa và nhỏ cũng như cộng đồng mã nguồn mở ra khỏi cuộc cạnh tranh.

Nhưng khi các công ty AI đang tính toán kỹ lưỡng, điều đáng quan tâm hơn có lẽ là một phiên bản “lý thuyết âm mưu” khác: Hoa Kỳ sẽ nhân cơ hội này để dẫn dắt các quy tắc quản trị AI toàn cầu. Bởi vì quản trị AI đã trở thành một cuộc cạnh tranh giành quyền thống trị trật tự toàn cầu.

Tại Hội nghị An toàn Trí tuệ Nhân tạo Toàn cầu năm 2023, Trung Quốc, Hoa Kỳ và 28 quốc gia đến từ Liên minh Châu Âu đã ký kết Tuyên bố Bletchley, đồng ý thông qua hợp tác quốc tế để xây dựng phương pháp quản lý AI và cùng quan tâm đến các rủi ro hệ thống của AI tiên tiến (Frontier AI), đây là lần đầu tiên trên thế giới đưa AI tiên tiến vào khung quản lý quốc tế.

Tuy nhiên, khi AI dần từ một công nghệ mới nổi trở thành hạ tầng quan trọng ảnh hưởng đến năng lực cạnh tranh quốc gia, các cuộc thảo luận về quản trị AI cũng bắt đầu vượt ra ngoài phạm vi kỹ thuật. Hoa Kỳ, trên khía cạnh quản trị AI, đã liên kết năng lực công nghệ mô hình lớn tiên tiến của mình với các tiêu chuẩn quản trị AI toàn cầu thông qua việc xuất khẩu các tiêu chuẩn quản trị AI và xây dựng mạng lưới các viện nghiên cứu an toàn AI quốc tế. Trung Quốc thì tập trung vào việc phát triển AI phổ cập và thúc đẩy quản trị nền tảng, tích cực thúc đẩy khuôn khổ của Liên Hợp Quốc, đặc biệt đối với các nước đang phát triển chưa có hạ tầng AI, vừa phải đề cập đến các rủi ro vừa đảm bảo sự phổ cập công nghệ. Hai con đường quản trị AI khác nhau này đang cùng nhau cạnh tranh giành quyền phát ngôn trong việc định hình quản trị AI toàn cầu trong tương lai.

Công nghệ bản thân là trung lập, nhưng việc phân phối, kiểm soát và xây dựng quy tắc cho công nghệ luôn là một trò chơi quyền lực. Đặc biệt khi AI dần thể hiện đặc tính của lực lượng sản xuất tiên tiến, điều mà con người thực sự nên lo lắng có lẽ không phải là AI sẽ phát triển thành hình dạng nào, mà là ai sẽ chi phối trật tự mới của thế giới AI.

Tương lai sẽ quyết định cục diện AI không chỉ là ai sở hữu mô hình mạnh nhất, mà còn là ai sở hữu quyền định nghĩa an toàn, thiết lập tiêu chuẩn và giải thích rủi ro.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.