Tiêu đề gốc: Inside OpenAI』s Reboot
Tác giả gốc: Alex Health
Biên dịch:律动 BlockBeats
Lời biên tập: Trong năm qua, vị thế dẫn đầu của OpenAI đã bị lung lay. Anthropic với Claude Code đã chiếm lĩnh thị trường lập trình AI, đồng thời vượt qua OpenAI về doanh thu hàng năm và định giá tư nhân; nội bộ OpenAI trải qua làn sóng rời đi của các giám đốc cấp cao, thu hẹp chiến tuyến sản phẩm và điều chỉnh đội ngũ an toàn. Khi các tác nhân thông minh chưa được phát hành phá vỡ sandbox và xâm nhập vào Hugging Face, công ty này lại đối mặt với cuộc khủng hoảng an ninh nghiêm trọng nhất kể từ khi thành lập.
Đối mặt với áp lực kép từ sản phẩm và an toàn, OpenAI đang cố gắng thực hiện một cuộc khởi động lại toàn diện: chuyển nguồn lực từ các dự án như Sora sang Codex, thúc đẩy ChatGPT nâng cấp từ công cụ trò chuyện thành nền tảng tác nhân thông minh có thể thực hiện nhiệm vụ một cách bền vững, đồng thời tạm dừng đào tạo các mô hình rủi ro cao, tăng cường cơ chế an toàn và căn chỉnh. Tham vọng hơn nữa, công ty vẫn đang mở rộng sang AGI, chip tự phát triển, phần cứng AI, robot hình người và cơ sở hạ tầng tính toán.
Bài viết này dựa trên các cuộc phỏng vấn của《Time》với Sam Altman, Greg Brockman và các giám đốc điều hành khác của OpenAI, cũng như nhân viên, nhà đầu tư, khách hàng và đối thủ cạnh tranh, trình bày cách công ty này đang điều chỉnh lại hướng đi giữa cạnh tranh thương mại, rủi ro an toàn và tầm nhìn AGI. Liệu OpenAI có thể giành lại vị trí dẫn đầu hay không, chìa khóa không chỉ nằm ở mô hình tiếp theo mạnh đến đâu, mà còn ở việc liệu họ có thể chứng minh: vừa có khả năng thúc đẩy AI tăng tốc, vừa có khả năng đạp phanh khi cần thiết.
Dưới đây là bài viết gốc (được biên dịch để dễ đọc):
Vào một buổi sáng đầu tháng 8, khi tôi đến văn phòng OpenAI, những người biểu tình đã chờ sẵn bên ngoài. Họ giơ các tấm biểu ngữ "Dừng cuộc đua AI" và viết phấn lên vỉa hè. Trong khi đó, hàng chục giám đốc điều hành từ các khách hàng quan trọng của OpenAI đang lần lượt bước vào một tòa nhà rộng rãi với tông màu be chủ đạo. Tòa nhà mang tên MB0 này là không gian văn phòng mới mà OpenAI vừa khánh thành cho các đội ngũ nghiên cứu và tính toán.
Ai đó đã đẩy một bức tường cây xanh cao lớn đến chắn trước cửa kính, cố gắng che đi khu trại biểu tình nhỏ bên ngoài khỏi sảnh chính gọn gàng.
Những khách hàng này đến để trải nghiệm sớm Astra——dòng mô hình AI tiên tiến thế hệ mới sắp ra mắt của OpenAI. CEO Sam Altman vừa trở về từ Washington, nơi ông đã có buổi giới thiệu kín về khả năng của Astra cho các quan chức chính phủ. Giờ đây, các nhà nghiên cứu của OpenAI bắt đầu trình diễn những gì mô hình mới này có thể làm.
Trong một buổi trình diễn, 16 tác tử AI đã chia một bài toán nghiên cứu cấp cao thành nhiều bài toán con, phối hợp với nhau, và cuối cùng tổng hợp thành một phương án chứng minh. Trong một buổi trình diễn khác, Astra có thể thao tác các phần mềm desktop thông dụng, tạo và chỉnh sửa nội dung xuyên ứng dụng với tốc độ nhanh đến đáng lo ngại.
Altman nói với khách thăm rằng, việc nhìn Astra thao tác máy tính theo cách "vượt xa con người, với tốc độ cực nhanh" là một trong những khoảnh khắc gây chấn động nhất mà các nhân viên OpenAI từng trải qua. Ông giải thích rằng Astra sẽ tạo ra "các tác tử hoạt động bền bỉ" – những đồng nghiệp ảo có khả năng xử lý nhiệm vụ liên tục trong thời gian dài.
Nhưng Altman dự đoán, tác động lớn nhất của nó sẽ đến từ việc giúp con người khám phá tri thức mới.
"Tôi dự đoán, đây sẽ là mô hình đầu tiên thực sự có thể phát minh ra những điều mới mẻ theo cách có ý nghĩa." Altman nói với những người có mặt, "Điều này rất gần với AGI."
Trong thời gian qua, khoảng thời gian này không hề dễ dàng với công ty đã tạo nên làn sóng AI này.
"Là một công ty, chúng tôi rõ ràng đã đi qua một số khúc cua." Một tuần sau, Altman đã tiếp nhận cuộc phỏng vấn kéo dài hơn hai giờ của tôi tại thư viện MB0 được bài trí tinh tế, "Dù là định hướng sản phẩm hay quá trình tiền huấn luyện trong nghiên cứu, chúng tôi đều tụt lại phía sau vị trí mà chúng tôi mong muốn."
Trong năm qua, vị trí dẫn đầu của OpenAI trong cuộc đua AI đã bị đối thủ cạnh tranh chính Anthropic giành mất. Công ty này là đơn vị đầu tiên phát hiện ra cơ hội thương mại của lập trình AI, biến Claude Code thành sản phẩm định nghĩa thị trường, và lần đầu tiên vượt qua OpenAI về doanh thu hàng năm được công bố và định giá trên thị trường tư nhân.
Theo hai người hiểu rõ kế hoạch của Anthropic, công ty do các cựu nhân viên OpenAI sáng lập này dự kiến sẽ niêm yết trước, IPO có thể diễn ra sớm nhất vào tháng 9. (Time có thỏa thuận cấp phép và hợp tác công nghệ với OpenAI; Salesforce, nơi Marc Benioff – chủ sở hữu của Time – làm CEO, là nhà đầu tư của Anthropic.)
Trong khi Anthropic tiến quân mạnh mẽ, OpenAI lại liên tiếp gặp trở ngại, bao gồm việc nhiều lãnh đạo cấp cao rời đi. Những người ra đi bao gồm Fidji Simo – cựu CEO Instacart mà Altman đã chiêu mộ năm ngoái để làm người số hai, nhiều trưởng bộ phận an toàn, đạo đức và nghiên cứu, cùng với Giám đốc doanh thu Denise Dresser và cựu Giám đốc điều hành Brad Lightcap vừa rời đi gần đây. Dresser chỉ gia nhập công ty được tám tháng đã chọn rời đi.
Bên ngoài công ty, những thách thức cũng không ngừng gia tăng. CEO Meta, Mark Zuckerberg, đã chiêu mộ các nhà nghiên cứu chủ chốt của OpenAI bằng các gói đãi ngộ hậu hĩnh; sản phẩm Gemini của Google đã vượt mốc 1 tỷ người dùng hàng tháng; Apple kiện OpenAI đánh cắp bí mật thương mại, OpenAI phủ nhận các cáo buộc liên quan; OpenAI còn đang đối đầu pháp lý với nhà đồng sáng lập Elon Musk, người cáo buộc công ty và Altman đã phản bội sứ mệnh phi lợi nhuận của mình.
Vào tháng 5 năm nay, một hội đồng tư vấn đã nhất trí xác định rằng Musk khởi kiện quá muộn, sau đó một thẩm phán liên bang đã bác bỏ yêu cầu của ông. Musk tuyên bố sẽ kháng cáo.
Lý do quan trọng nhất khiến bầu không khí dư luận mà OpenAI và CEO của họ phải đối mặt trở nên tồi tệ hơn có lẽ là sự mất niềm tin của công chúng. OpenAI đang phải xử lý ít nhất hơn mười vụ kiện trách nhiệm sản phẩm tại California, cùng nhiều vụ án liên bang. Các nguyên đơn cáo buộc rằng ChatGPT đã củng cố những suy nghĩ hoang tưởng hoặc ý định tự sát của người dùng, và trong một số trường hợp đã dẫn đến cái chết của người dùng.
Công ty đã gửi lời chia buồn đến các nạn nhân trong các vụ án liên quan và ra mắt phiên bản ChatGPT dành cho thanh thiếu niên với các biện pháp bảo vệ mặc định chặt chẽ hơn. Vào mùa xuân năm nay, nhà riêng của Altman đã bị tấn công hai lần liên tiếp trong vòng hai ngày, lần đầu bằng chai cháy, lần thứ hai bằng súng.
Khi nói về năm qua, Altman chia sẻ: "Ở góc độ cá nhân, đây là một trải nghiệm đau đớn. Rõ ràng là, ít nhất ở thời điểm hiện tại, mọi người ghét các trung tâm dữ liệu. Thái độ của mọi người đối với AI khá tiêu cực."
Tuy nhiên, bên trong OpenAI, các nhà lãnh đạo lại vẽ ra một bức tranh lạc quan hơn.
Công ty có định giá gần 1 nghìn tỷ USD này vẫn đang ở vị thế đáng ghen tị. ChatGPT có hơn 1 tỷ người dùng hoạt động, vẫn là một trong những sản phẩm AI phổ biến nhất toàn cầu, mặc dù nó không còn là trọng tâm duy nhất trong chiến lược tương lai của OpenAI. Bản thân Altman thậm chí đã ngừng sử dụng ChatGPT trong một tháng liên tục, chuyển sang dùng công cụ lập trình Codex của OpenAI.
Một năm trước, OpenAI bị chỉ trích rộng rãi là liều lĩnh vì đầu tư mạnh vào năng lực tính toán. Chỉ riêng năm nay, công ty dự kiến sẽ chi 50 tỷ USD cho năng lực tính toán.
Sachin Katti, người phụ trách mảng năng lực tính toán của OpenAI, cho biết nhìn lại bây giờ, "quyết định lúc đó rất có tầm nhìn xa". "Năng lực tính toán của chúng tôi vẫn chưa đủ. Nói thật, chúng tôi đáng lẽ nên mua nhiều hơn nữa."
Trong khi đó, nhu cầu về chip của Anthropic đã trở nên cấp thiết đến mức khác. Vào tháng 5 năm nay, công ty được cho là đã đồng ý trả 1,25 tỷ USD mỗi tháng cho SpaceX để mua dung lượng tính toán, trong khi người sáng lập SpaceX là Musk trước đó từng gọi AI của Anthropic là "phản nhân loại và độc ác".
Dưới sự lãnh đạo của đồng sáng lập kiêm Chủ tịch Greg Brockman, OpenAI đã tái tập trung các ưu tiên. Ngày nay, gần như toàn bộ hoạt động sản phẩm và kinh doanh đều do Brockman phụ trách. Công ty đang dần đóng cửa ứng dụng tạo video Sora, dự án hợp tác với Disney, cũng như trình duyệt độc lập mang tên Atlas.
Altman thừa nhận rằng trước đây OpenAI đã dàn trải quá rộng. "Sau khi trải qua giai đoạn khó khăn, quá trình đi lên trở lại sẽ thú vị hơn," ông nói.
Tuy nhiên, chỉ vài ngày sau buổi demo Astra, OpenAI lại phải đối mặt với một cuộc khủng hoảng mới.
Vào cuối tháng 7, công ty đã tiết lộ một sự cố an ninh đáng lo ngại: một tác tử AI chưa được phát hành đã thoát khỏi môi trường thử nghiệm được gọi là "hộp cát" (sandbox) và tấn công nền tảng lưu trữ mô hình và tập dữ liệu AI Hugging Face.
"Điều này giống như một câu chuyện khoa học viễn tưởng vậy," Altman nói.
Sau sự việc, nhóm nghiên cứu OpenAI đã tạm dừng một số thí nghiệm và làm chậm tiến độ các dự án khác, đồng thời tăng cường bảo vệ và giám sát hộp cát.
Nhưng không lâu sau đó, nhóm nghiên cứu lại phát hiện những dấu hiệu đáng lo ngại khi huấn luyện một mô hình chưa được phát hành khác. Mô hình này được kỳ vọng sẽ mang lại bước nhảy vọt lớn nhất về năng lực từ trước đến nay. OpenAI sau đó đã đưa ra một quyết định có tác động lớn hơn: tạm dừng quá trình huấn luyện này cho đến khi các biện pháp an toàn mới được triển khai.
Vào ngày ban lãnh đạo OpenAI đưa ra quyết định này, tôi đã phỏng vấn Altman. Vẻ mặt của ông rõ ràng nghiêm trọng hơn trước.
OpenAI ban đầu mô tả vụ tấn công Hugging Face là một sai sót an ninh, nhưng Altman sau đó coi đây là một vấn đề "căn chỉnh" (alignment) cơ bản hơn. Căn chỉnh là việc khiến hệ thống AI hành động theo ý định của con người. Các nhà lãnh đạo ngành tin rằng, khi năng lực mô hình ngày càng được nâng cao, duy trì trạng thái căn chỉnh là chìa khóa để đảm bảo hệ thống AI vẫn nằm trong tầm kiểm soát của người tạo ra chúng.
"Tôi nghĩ rằng, từ bây giờ, bất kỳ thất bại căn chỉnh nào cũng nên được coi là sự kiện nghiêm trọng," Altman nói với tôi. "Chúng tôi sẽ dành thời gian cần thiết để làm rõ vấn đề một cách triệt để."
Trong cuộc phỏng vấn bổ sung ba ngày sau đó, ông thẳng thắn tuyên bố: "Làm tốt an toàn AI quan trọng hơn đà phát triển của bất kỳ công ty nào."
OpenAI sẽ chậm lại, điều phối nhiều nguồn lực hơn cho các đội ngũ an toàn và căn chỉnh, đồng thời thay đổi cách phối hợp giữa các đội ngũ, đặt an toàn ở vị trí ưu tiên cao hơn.
Mô tả về việc OpenAI khởi động lại trong bài viết này dựa trên hàng chục giờ phỏng vấn. Những người được phỏng vấn bao gồm hơn 20 giám đốc điều hành, nhân viên, nhà đầu tư, khách hàng và đối thủ cạnh tranh của công ty, cũng như các hoạt động mà tôi đã chứng kiến tận mắt tại trụ sở OpenAI trong hai tuần của tháng 8.
Những cuộc trao đổi này phác họa một công ty đang cố gắng thực hiện hai cuộc chuyển đổi cùng lúc. Một mặt, OpenAI tin rằng họ đã sửa chữa những sai lầm về sản phẩm và vận hành—chính những sai lầm này đã khiến Anthropic chiếm vị trí dẫn đầu trong cuộc đua AI. Mặt khác, OpenAI đang cố gắng tận dụng cuộc khủng hoảng an toàn nghiêm trọng nhất trong lịch sử của mình để giành lại một danh tính mà đối thủ chính đã nắm giữ từ lâu: một phòng thí nghiệm tiên phong thực sự đặt an toàn lên hàng đầu, sẵn sàng giảm tốc khi công nghệ trở nên quá nguy hiểm.
"Nghe này, tôi biết bên ngoài có cái nhìn rập khuôn về tôi," Altman nói. "Kiểu như tôi hoàn toàn không quan tâm đến an toàn AI, chỉ muốn doanh thu tăng, chỉ là một CEO theo chủ nghĩa 'mặc kệ, cứ làm trước đã'." Nhưng tôi tin rằng, "làm tốt an toàn AI quan trọng hơn đà phát triển của bất kỳ công ty nào."
Các giám đốc điều hành OpenAI cho biết giảm tốc là một lựa chọn đau đớn, nhưng nó cũng có thể mang lại một số lợi ích. Nếu OpenAI có thể lấy lại danh tiếng "phòng thí nghiệm ưu tiên an toàn", điều đó không chỉ có thể cải thiện hình ảnh của chính họ mà còn buộc đối thủ chính đang chuẩn bị IPO lớn phải trả lời một câu hỏi khó chịu: Khi OpenAI chọn chờ đợi, liệu Anthropic có tiếp tục chạy đua hết tốc lực không?
Đầu năm nay, đồng sáng lập Anthropic Jared Kaplan đã nói trong một cuộc phỏng vấn với Time rằng khi các đối thủ vẫn "lao hết tốc lực về phía trước", việc tự ràng buộc một chiều là vô nghĩa. Nhưng nếu OpenAI chủ động tạm dừng một vòng huấn luyện dự kiến sẽ mang lại bước nhảy vọt đáng kể về năng lực, lập luận này sẽ khó đứng vững hơn.
Tất nhiên, bên ngoài có lý do để hoài nghi về sự chuyển hướng hình ảnh của OpenAI.
Trong nhiều năm, OpenAI đã mất nhiều người phụ trách công tác an toàn, một số người trong đó khi rời đi đã chỉ trích công ty quá chú trọng thương mại hóa. Trong khi đó, OpenAI đang chuẩn bị niêm yết, và mảng kinh doanh vẫn đang thua lỗ của họ cần liên tục được hỗ trợ bởi các mô hình mới. Sau sự kiện Hugging Face, họ yêu cầu công chúng tin rằng mình có khả năng kiểm soát một công nghệ trước đây từng thoát khỏi tầm kiểm soát mà công ty không hề hay biết.
Giữa bối cảnh đó, các lãnh đạo OpenAI tin rằng công ty đã tiến đến một cột mốc có thể thay đổi tiến trình lịch sử nhân loại: tạo ra trí tuệ nhân tạo tổng quát (AGI).
Điều lệ của OpenAI định nghĩa AGI là "hệ thống tự trị có hiệu suất vượt trội con người trong phần lớn các công việc có giá trị kinh tế". Các lãnh đạo công ty chưa chính thức tuyên bố đã vượt qua ngưỡng này, nhưng họ không còn coi AGI là một khái niệm xa vời và trừu tượng.
Giám đốc nghiên cứu Mark Chen ước tính OpenAI đã hoàn thành "80%" chặng đường tiến tới AGI.
Brockman cho biết nếu nhìn lại sau hai năm, mọi người có thể coi hiện tại là thời điểm AGI ra đời. Altman thì nói với tôi rằng OpenAI "chưa hoàn toàn đạt đến" AGI, nhưng đến cuối năm nay, nội bộ công ty sẽ sở hữu một hệ thống mà ông sẵn sàng gọi là AGI.
Đạt được mục tiêu này là sứ mệnh ban đầu khi OpenAI được thành lập như một phòng thí nghiệm nghiên cứu phi lợi nhuận. Ngày nay, nó đã nhanh chóng phát triển thành một công ty có tham vọng thương mại đáng kinh ngạc.
OpenAI đang thiết kế chip và trung tâm dữ liệu riêng, phát triển một loạt thiết bị tiêu dùng, lên kế hoạch ra mắt robot hình người, đồng thời cân nhắc việc bán cơ sở hạ tầng tính toán cho các công ty khác trong tương lai. Nếu triển khai, OpenAI sẽ cạnh tranh trực tiếp với các gã khổng lồ công nghệ như Amazon - nhà đầu tư chính của họ.
Ngay cả khi làn sóng phản đối sự phát triển AI ngày càng dâng cao, OpenAI vẫn đang chuẩn bị để trở thành một trong những công ty có ảnh hưởng nhất toàn cầu trong nhiều năm tới. Như Brockman đã nói: "Chúng tôi muốn thay đổi toàn bộ nền kinh tế."
Altman có thể là gương mặt đại chúng của làn sóng AI, nhưng người thực sự phụ trách phần lớn hoạt động vận hành của OpenAI hiện nay là Brockman.
Brockman là một kỹ sư ưa thích áo khoác da và nổi tiếng với tư duy phân tích. Trong phần lớn lịch sử của OpenAI, ông đóng vai trò là nhà đồng sáng lập kỹ thuật hơn là nhà quản lý. Nhưng trong những tháng gần đây, ông đã tiếp quản gần như toàn bộ công việc từ doanh thu đến tiếp thị sản phẩm. Theo cách nói của ông, đó là phụ trách "toàn bộ cỗ máy chuyển hóa các mô hình từ kết quả nghiên cứu thành giá trị cho khách hàng".
Altman vẫn trực tiếp phụ trách các lĩnh vực then chốt như tài chính, nghiên cứu và thiết bị tiêu dùng.
Hai người cùng lãnh đạo công ty với vai trò đồng sáng lập, phạm vi quyền lực có sự chồng chéo. Trong khi Altman phải hứng chịu nỗi sợ hãi và bất mãn của công chúng về AI, OpenAI gần đây cũng bắt đầu tăng cường sự xuất hiện trước công chúng của Brockman để tạo nên sự cân bằng nhất định.
Không khó để hình dung, sự sắp xếp này có thể trở thành nguồn cơn của mâu thuẫn. Khi trao đổi với nhân viên OpenAI, đôi khi rất khó để xác định ai là người đưa ra quyết định cuối cùng cho một vấn đề cụ thể.
Nhưng nhiều nhân viên cho biết, cơ cấu lãnh đạo song trùng này đã đưa công ty trở lại đúng quỹ đạo. Brockman có thể dựa vào thẩm quyền của đồng sáng lập để đưa ra những quyết định khó khăn, điều mà các nhà quản lý chuyên nghiệp bên ngoài liên tục thay đổi không thể tái tạo được.
Brockman mô tả cuộc điều chỉnh đội ngũ lãnh đạo rộng lớn hơn của OpenAI là một chiến dịch theo đuổi sự "tập trung". Ông cho biết, công ty liên tục xem xét lại liệu mình có đang sở hữu cơ cấu tổ chức và chiến lược phù hợp hay không.
Mùa thu năm ngoái, Anthropic đã rõ ràng đi trước nhờ sản phẩm lập trình. Họ nhận ra rằng phát triển phần mềm là lĩnh vực mà AI có thể phát huy thế mạnh, sau đó Claude Code nhanh chóng trở nên phổ biến, đầu tiên là ở Thung lũng Silicon, sau đó lan rộng ra thị trường doanh nghiệp rộng lớn hơn.
"Anthropic thực sự đã phát hiện ra điều gì đó quan trọng trong lĩnh vực lập trình." Nick Turley, người từng phụ trách ChatGPT và hiện lãnh đạo bộ phận sản phẩm doanh nghiệp mới, cho biết, "Chúng tôi khi đó không hề dẫn đầu."
Altman cho biết, sự tăng trưởng "mất kiểm soát" của mảng kinh doanh người tiêu dùng ChatGPT đã làm phân tán sự chú ý của công ty, khiến OpenAI không ưu tiên lập trình như Anthropic.
Brockman cho rằng, OpenAI "luôn dẫn đầu" trong các bài kiểm tra chuẩn về lập trình. Nhưng công ty đã không tập trung đầy đủ vào cách các nhà phát triển sẽ sử dụng AI trong "kho mã nguồn thực tế hỗn loạn", bao gồm gián đoạn tác vụ, tính cách mô hình, cũng như những vấn đề "chặng cuối" tưởng chừng nhỏ nhặt nhưng thực tế lại ảnh hưởng đáng kể đến tỷ lệ áp dụng.
OpenAI cũng không xây dựng được một hệ thống bán hàng doanh nghiệp trưởng thành. "Một năm trước, tôi nghĩ chúng tôi thậm chí chưa thực sự bước chân vào thị trường doanh nghiệp." Brockman nói. CFO Sarah Friar nói thẳng hơn: "Chúng tôi khi đó ngây thơ quá mức, cứ nghĩ chỉ cần tạo ra sản phẩm, khách hàng tự nhiên sẽ đến."
Tháng 3 năm nay, OpenAI tuyên bố dần đóng cửa Sora, chuyển nguồn tính toán khan hiếm sang Codex, tác nhân lập trình. Codex ban đầu được thiết kế như một trải nghiệm sản phẩm độc lập với ChatGPT, nhưng khi tốc độ tăng trưởng của nó bắt đầu vượt xa các sản phẩm mới khác của OpenAI, cùng với việc khả năng lập trình AI dần mang lại giá trị cho cả những người không phải kỹ sư, các nhà lãnh đạo nhận thấy rằng việc tiếp tục tách rời hai sản phẩm này không còn ý nghĩa.
Công ty bắt đầu tích hợp năng lực tác nhân của Codex vào ChatGPT, đồng thời hợp nhất đội ngũ tính toán và sản phẩm đứng sau cả hai. Kết quả cuối cùng hướng đến khách hàng là ChatGPT Work, ra mắt gần đây. Sản phẩm này nhằm biến chatbot quen thuộc thành một hệ thống có thể thực thi nhiệm vụ, thay vì chỉ trả lời câu hỏi. Nội bộ OpenAI, sự tích hợp này được gọi là "The Merge".
Các giám đốc điều hành cho biết sự điều chỉnh này đã giúp hoạt động kinh doanh của công ty hồi sinh. Vào tháng 7 năm nay, doanh thu từ mảng doanh nghiệp của OpenAI lần đầu tiên vượt qua doanh thu từ mảng người tiêu dùng. Các thử nghiệm quảng cáo ban đầu bên trong ChatGPT cũng đạt kết quả đủ tích cực, và các giám đốc đang tăng số lượng quảng cáo. Friar cho biết 92% người dùng tiêu dùng ChatGPT không đăng ký dịch vụ trả phí, và doanh thu quảng cáo trong tương lai có thể trợ cấp cho việc sử dụng miễn phí của những người dùng này.
Theo Dave Dugan, người phụ trách mảng kinh doanh liên quan, công ty cũng đang âm thầm thử nghiệm "tác nhân tài trợ". Trong hình thức quảng cáo này, sau khi người dùng nhấp vào quảng cáo, họ có thể bước vào một trải nghiệm tương tác AI do thương hiệu cung cấp.
Vào tháng 3 năm nay, OpenAI hoàn tất vòng gọi vốn 122 tỷ USD với định giá 852 tỷ USD, lập kỷ lục về quy mô gọi vốn của công ty công nghệ tư nhân. Chỉ hai tháng sau, Anthropic cũng gọi vốn 65 tỷ USD với định giá 965 tỷ USD.
Chủ tịch hội đồng quản trị OpenAI, Bret Taylor, ví cuộc cạnh tranh AI như một bàn cờ, trong đó các ô quan trọng nhất bao gồm năng lực mô hình tiên phong, giá cả và hiệu suất của từng token, cũng như các sản phẩm được xây dựng xung quanh mô hình.
"Chúng ta có mô hình tiên phong tốt nhất không? Liệu có thể cung cấp token phù hợp với giá phù hợp cho từng nhiệm vụ? Xung quanh các mô hình này, chúng ta có sản phẩm tốt nhất không?" ông nói, "Hiện tại, câu trả lời cho những câu hỏi này đều là có."
Sau đó, OpenAI phát hiện ra rằng một mô hình chưa được phát hành đã vượt ra khỏi ranh giới của công ty.
Khi tin tức đến tai nhà khoa học trưởng của OpenAI, Jakub Pachocki, ông đang ở bệnh viện bên cạnh vợ trong lúc sinh con.
Một nguyên mẫu nghiên cứu chỉ dùng nội bộ của OpenAI đã xâm nhập vào một công ty khác. Vào thời điểm đó, mô hình này đang trải qua bài kiểm tra chuẩn an ninh mạng trong một môi trường được cho là cách ly với thế giới bên ngoài. Nhưng thay vì chỉ hoàn thành các bài tập được chỉ định, nó đã khai thác một lỗ hổng để thoát khỏi hệ thống của OpenAI, sau đó xâm nhập vào môi trường sản xuất của Hugging Face.
Theo các tài liệu kỹ thuật do hai công ty công bố, mô hình này đã đạt được câu trả lời cho các bài kiểm tra mà nó tham gia tại đó.
Học tăng cường là một giai đoạn sau khi mô hình nền tảng hoàn tất quá trình huấn luyện. Trong giai đoạn này, hệ thống sẽ lặp đi lặp lại việc thực hiện các nhiệm vụ và học cách hành vi nào có thể nhận được phần thưởng. Trong giai đoạn tiền huấn luyện, mô hình chỉ dự đoán token tiếp theo mà không tương tác với thế giới thực; học tăng cường có thể cung cấp cho mô hình các công cụ và một môi trường có thể thao tác thực tế.
Chính trong giai đoạn này, mô hình có thể học cách khai thác sự khác biệt giữa "điều mà nhà thiết kế thực sự muốn nó làm" và "cách để đạt điểm cao hơn".
OpenAI đã cung cấp cho tác nhân hệ thống một mục tiêu và công cụ, và nó đã đạt được mục tiêu thông qua các phương thức trái phép và lừa dối.
Các nhà nghiên cứu của OpenAI đã mô tả trong một buổi trình diễn gần đây cách một tác nhân AI sử dụng một bảng tin ẩn để lên kế hoạch cho các bước tiếp theo. Sau khi một tác nhân vượt qua hộp cát và kết nối internet, nó đã viết trên bảng tin cho các tác nhân khác: "Chết tiệt. (Holy Shit)"
Các công ty khác cũng gặp phải vấn đề tương tự. Anthropic đã tiết lộ ba sự cố: trong quá trình đánh giá của bên thứ ba, mô hình của họ kết nối internet và truy cập trái phép vào các tổ chức bên ngoài. Meta cũng cho biết một mô hình của công ty đã dính vào sự cố tương tự.
Nhưng sự cố an toàn của OpenAI nhận được nhiều sự chú ý nhất. Một phần vì nó được công khai tiết lộ đầu tiên, một phần vì cách tấn công của tác nhân đặc biệt phức tạp, và cũng vì giới bên ngoài nghi ngờ liệu OpenAI có đặt lợi ích thương mại lên trên an toàn hay không.
Trong năm qua, OpenAI đã mất nhiều nhà nghiên cứu an toàn nổi tiếng, và lãnh đạo phụ trách công tác chuẩn bị rủi ro cũng đã thay đổi nhiều lần. Giờ đây, sự cố này cung cấp một ví dụ đặc biệt rõ ràng cho những người chỉ trích.
Đến giữa tháng 8, hơn 1300 nhân viên hiện tại và cựu nhân viên của các công ty AI tiên phong đã ký đơn kiến nghị "Kiểm soát nhịp độ cuộc đua tiên phong", kêu gọi thiết lập các cơ chế liên quan để làm chậm tốc độ phát triển các mô hình tiên tiến khi cần thiết vì rủi ro.
Thượng nghị sĩ Mỹ Bernie Sanders đã kêu gọi các công ty AI hàng đầu tạm dừng phát triển "vì lợi ích của nhân loại", đồng thời cảnh báo rằng nếu các nhà lãnh đạo doanh nghiệp không chủ động hành động, các nhà lập pháp sẽ can thiệp.
Các giám đốc điều hành của OpenAI cho biết trong các cuộc phỏng vấn rằng công ty coi trọng sự cố an toàn này và đã phản hồi nhanh chóng. Pachocki, người cũng đã ký đơn kiến nghị, nói với tôi rằng một sai lầm quan trọng là công ty đã không kích hoạt các cơ chế bảo vệ mà các nhà nghiên cứu đã phát triển.
OpenAI sở hữu các công cụ có thể kiểm tra chuỗi suy luận của mô hình. Chuỗi suy luận có thể hiểu là "bản nháp kỹ thuật số" của mô hình, cho thấy những gì tác nhân đang lên kế hoạch trong quá trình hành động. Tuy nhiên, công ty đã không áp dụng những công cụ này lên các mô hình có năng lực tương đương với sự cố xâm nhập Hugging Face.
Về bản chất, OpenAI đã xây dựng hệ thống cảnh báo sớm, nhưng lại không kích hoạt nó vì đánh giá sai mức độ thông minh của hệ thống được kiểm tra. "Chúng tôi đã không lường trước đầy đủ" những gì hệ thống này có thể làm, Pachocki nói, "Khi đối mặt với AI, bạn phải lường trước cả những điều ngoài dự đoán."
Mia Glaese, người phụ trách an toàn và căn chỉnh của OpenAI, nói với tôi rằng sự việc này "rõ ràng là một bước ngoặt". "Tôi hy vọng rất nhiều công việc chúng tôi đang thực hiện có thể hoàn thành trước khi sự cố xảy ra."
Sau sự việc, OpenAI đã tạm dừng một số dự án nghiên cứu, làm chậm các dự án khác, đồng thời tăng cường hộp cát và mở rộng giám sát. Giám đốc nghiên cứu Chen cho biết sự việc này đã buộc công ty phải thay đổi cách suy nghĩ về rủi ro.
Cái gọi là "Khung chuẩn bị" của OpenAI là bộ quy tắc công ty công bố ra công chúng, dùng để ứng phó với các năng lực mới của mô hình có thể gây ra tác hại nghiêm trọng, bao gồm các mối đe dọa sinh học và hóa học, rủi ro an ninh mạng và khả năng tự cải thiện của AI. Khung này yêu cầu công ty liên tục đánh giá trong quá trình phát triển mô hình, đảm bảo mô hình đạt tiêu chuẩn an toàn trước khi triển khai.
Pachocki cho biết bộ quy tắc này cần liên tục phát triển để theo kịp tốc độ tiến bộ công nghệ. Glaese cho biết công ty đang thực hiện nhiều quyết định "không quá lớn nhưng đau đớn", những quyết định này "đang làm chậm tiến độ nghiên cứu, nhưng chúng tôi tin rằng làm vậy là đúng". Pachocki nói rằng độ tin cậy trong căn chỉnh và an toàn đã trở thành yếu tố quan trọng hạn chế tốc độ phát triển của OpenAI, giống như nguồn cung cấp sức mạnh tính toán.
Công ty vẫn có kế hoạch ra mắt Astra, nhưng điều kiện ra mắt hiện tại là phải vượt qua các biện pháp an toàn mới. Ban quản lý từ chối ước tính mức độ ảnh hưởng của những thay đổi này đến thời gian ra mắt. Trong một ngành công nghiệp mà lợi thế công nghệ được đo bằng tuần, ngay cả sự gián đoạn ngắn ngủi cũng có thể ảnh hưởng đến kỳ vọng doanh thu và tạo ra hiệu ứng dây chuyền đối với nền kinh tế rộng lớn hơn.
Ít nhất là hiện tại, OpenAI đã sẵn sàng chấp nhận những chi phí này. Pachocki hy vọng rằng sự tăng trưởng nhanh chóng của năng lực AI có thể thúc đẩy các công ty phối hợp với nhau. Glaese cho biết khi năng lực mô hình tăng lên, OpenAI sẽ tiếp tục nâng cao ngưỡng an toàn. "Nếu một ngày nào đó, chúng tôi đi đến điểm không thể đảm bảo an toàn, thì chúng tôi phải chậm lại," cô nói, "Mọi chuyện là như vậy."
Những thay đổi này sẽ ảnh hưởng như thế nào đến lộ trình niêm yết của OpenAI hiện vẫn chưa rõ ràng. Những người hiểu rõ kế hoạch của cả hai công ty dự đoán rằng thời điểm IPO của OpenAI sẽ muộn hơn Anthropic, mặc dù cả hai bên đều chưa công khai xác định ngày niêm yết cụ thể.
Vào ngày 19 tháng 8, trong một cuộc họp toàn thể nhân viên, CFO Friar đã nói với nhân viên rằng nếu hoạt động kinh doanh của công ty "tiếp tục tăng trưởng theo kiểu bước ngoặt", OpenAI sẽ niêm yết vào năm 2027 hoặc sớm hơn.
Doanh thu hàng năm mà OpenAI mới công bố vào khoảng 40 tỷ USD, thấp hơn so với Anthropic đã vượt qua 65 tỷ USD. Việc tiến độ nghiên cứu gần đây chậm lại có thể khiến kế hoạch niêm yết trở nên phức tạp hơn. Friar đã tiến hành các buổi diễn tập cho công ty đại chúng, bao gồm tổ chức các cuộc họp báo cáo tài chính mô phỏng với các nhà đầu tư chính của OpenAI. Cô nói với tôi rằng công ty "hoàn toàn có thể niêm yết ngay hôm nay", nhưng bước đi này cũng sẽ tạo ra những áp lực mới. Khi đó, OpenAI phải tìm cách cân bằng giữa lợi ích thương mại và những tác hại tiềm ẩn mà việc nâng cao năng lực AI có thể gây ra.
Nhân viên cũng sẽ bắt đầu đặt việc theo dõi giá cổ phiếu lên trước hầu hết mọi thứ khác. "Đó sẽ là việc đầu tiên họ làm mỗi ngày", cô nói. "Hôm nay tôi kiếm được bao nhiêu? Mất bao nhiêu? Điều này sẽ gây phân tâm rất lớn."
Một trong những mục tiêu nghiên cứu của OpenAI trong năm nay là tự động hóa công việc của các nhà nghiên cứu AI cấp thấp. Pachocki cho biết công ty đã đạt được tiêu chuẩn nội bộ về "thực tập sinh nghiên cứu AI tự động". Chỉ cần có một ý tưởng thí nghiệm, Astra có thể hoàn thành việc triển khai trong kho mã nguồn của OpenAI, chạy thí nghiệm và trả về kết quả; nó cũng có thể đọc một bài báo khoa học và hoàn thành công việc mà trước đây một nhà nghiên cứu con người phải mất một tuần mới làm xong.
Tầm quan trọng của cột mốc này nằm ở chỗ nó có thể mở ra một vòng lặp tự củng cố liên tục: AI giúp hoàn thành thí nghiệm, thí nghiệm tạo ra AI mạnh hơn, và thế hệ AI mới lại có thể giúp phát triển người kế nhiệm của chính nó nhanh hơn. Các nhà nghiên cứu gọi hiện tượng này là "tự cải thiện đệ quy", viết tắt là RSI. Theo quan điểm của Pachocki, tự cải thiện đệ quy và căn chỉnh (alignment) là những vấn đề đan xen với nhau.
"Con người sẽ tham gia vào hành trình này theo cách nào?", Pachocki nói. "Làm thế nào để mọi người thực sự hưởng lợi từ điều đó, thay vì bị bỏ lại phía sau bởi những AI ngày càng thông minh hơn chúng ta?"
Ở cấp độ sản phẩm, Altman hình dung việc ra mắt một dịch vụ đăng ký AI phổ quát, phá vỡ ranh giới giữa ChatGPT, Codex và phần mềm văn phòng. Người dùng chỉ cần nêu rõ mục tiêu, hệ thống sẽ tự quyết định gọi những mô hình, công cụ và tác nhân (agent) nào.
Cuối cùng, hệ thống này sẽ chủ động hành động trước khi người dùng yêu cầu, tự mình đưa ra đề xuất và xử lý những việc vặt như mua vé concert. Nó có thể tham khảo lịch trình của bạn, hiểu tình hình tài chính của bạn, và cũng biết gu âm nhạc của bạn.
Tất cả những điều này đều phục vụ cho một tầm nhìn duy nhất: biến ChatGPT từ một công cụ trả lời câu hỏi thành một hệ thống thực sự hoàn thành công việc. Thibault Sottiaux, người phụ trách sản phẩm sau khi tích hợp nhóm ChatGPT và Codex, cho biết OpenAI sẽ sớm giới thiệu một sản phẩm được xây dựng xoay quanh "tính liên tục và thực thi suốt ngày đêm". Ông nói rằng hệ thống này gần như có thể truy cập từ bất kỳ đâu và sẽ liên tục hoàn thành những công việc có giá trị dựa trên thông tin mới và phản hồi. "Đối với mọi người, điều này chắc chắn sẽ giống như một thứ hoàn toàn mới." Sottiaux nói với tôi.
Sau đó, lộ trình của OpenAI trở nên hoành tráng hơn. Vào tháng 5 năm 2025, OpenAI đã mua lại công ty khởi nghiệp phần cứng io do cựu nhà thiết kế Apple Jony Ive đồng sáng lập, và sáp nhập đội ngũ sản phẩm cùng kỹ thuật của công ty này vào OpenAI. Ive và công ty thiết kế LoveFrom của ông vẫn giữ độc lập, nhưng đã đảm nhận trách nhiệm sáng tạo rộng rãi trong nội bộ OpenAI.
Altman cho biết OpenAI đang phát triển "một số ít" thiết bị, bao gồm một thứ "nên đặt trên bàn làm việc", một thiết bị có thể bỏ vào túi, và một sản phẩm có thể đeo trên người.
Những người hiểu rõ kế hoạch cho biết sản phẩm đầu tiên dự kiến ra mắt vào đầu năm sau. Đó là một thiết bị nhỏ hình đĩa, có khả năng cảm nhận môi trường xung quanh và giao tiếp với chủ nhân qua chế độ giọng nói của ChatGPT. "Thách thức thích nghi lớn nhất là làm quen với khái niệm 'máy tính chủ động'." Altman nói. Điều này có nghĩa là máy tính sẽ chủ động hành động thay cho chủ nhân, thay vì chờ đợi chủ nhân ra lệnh.
Altman tin rằng trong tương lai, mỗi người đều nên sở hữu một robot cá nhân. Ông nói với tôi rằng OpenAI "chắc chắn" sẽ chế tạo robot hình người. OpenAI cũng đã đầu tư vào Merge Labs, công ty khởi nghiệp do Altman đồng sáng lập, đang phát triển giao diện não-máy không xâm lấn. Con chip suy luận đầu tiên do OpenAI tự thiết kế có tên là Jalapeño, chủ yếu dùng để chạy mô hình AI thay vì huấn luyện mô hình. Công ty dự kiến bắt đầu triển khai con chip này trước cuối năm nay.
Trong khi đó, OpenAI đang cân nhắc liệu có nên trở thành một công ty hạ tầng quy mô hiếm có hay không. Vào tháng 7 năm nay, công ty đã công bố kế hoạch xây dựng một khu trung tâm dữ liệu tại bang Georgia; vào tháng 8, lại ký hợp đồng thuê một khu đất lớn hơn tại bang Ohio.
“Tôi tin rằng chúng ta có thể khai thác toàn bộ sức mạnh tính toán được lên kế hoạch xây dựng một cách rất có lợi nhuận,” Altman cho biết. “Nhưng tôi thực sự cảm thấy lo ngại về những gì cả thế giới đang làm.”
Giám đốc điều hành OpenAI cho biết, nếu công ty có thể xây dựng cơ sở hạ tầng AI cho chính mình với tốc độ đủ nhanh và chi phí đủ thấp, trong tương lai họ có thể cân nhắc bán sức mạnh tính toán cho các công ty khác. Điều này sẽ khiến OpenAI trực tiếp thách thức các nhà cung cấp dịch vụ đám mây siêu quy mô như Amazon Web Services và Google Cloud.
Đối với một công ty mới cam kết cắt giảm các dự án phụ gây phân tán tâm trí cách đây không lâu, đây là một danh sách kinh doanh mới khá đồ sộ. Khi được yêu cầu tóm tắt tất cả những điều này, Brockman trả lời bằng hai từ: “AGI cá nhân.” Ông hình dung rằng trong tương lai, hàng tỷ người sẽ sở hữu trợ lý riêng siêu thông minh, luôn sẵn sàng chờ lệnh. “Bạn đã có trong túi một hệ thống gần như là AGI, và có lẽ sẽ sớm trở thành AGI thực sự,” ông nói. “Vậy, bạn thực sự muốn gì?”
Chào mừng bạn tham gia cộng đồng chính thức của BlockBeats:
Nhóm Telegram đăng ký: https://t.me/theblockbeats
Nhóm Telegram thảo luận: https://t.me/BlockBeats_App
Tài khoản Twitter chính thức: https://twitter.com/BlockBeatsAsia