Báo cáo chuyên sâu của TIME: Sau hai sai lầm lớn, OpenAI đang nghĩ gì?
BlockbeatsTiêu đề gốc: Bên trong cuộc tái khởi động của OpenAI
Tác giả gốc: Alex Health
Biên dịch: BlockBeats
Lời biên tập: Trong năm qua, vị thế dẫn đầu của OpenAI đã bị lung lay. Anthropic đã chiếm lĩnh thị trường lập trình AI nhờ Claude Code, đồng thời vượt qua OpenAI về doanh thu hàng năm và định giá trên thị trường tư nhân; nội bộ OpenAI trải qua làn sóng ra đi của các giám đốc cấp cao, thu hẹp mặt trận sản phẩm và điều chỉnh đội ngũ an toàn. Khi một tác nhân AI chưa phát hành thoát khỏi hộp cát và xâm nhập Hugging Face, công ty lại đối mặt với cuộc khủng hoảng an toàn nghiêm trọng nhất kể từ khi thành lập.
Trước áp lực kép về sản phẩm và an toàn, OpenAI đang cố gắng thực hiện một cuộc tái khởi động toàn diện: chuyển nguồn lực từ các dự án như Sora sang Codex, thúc đẩy ChatGPT nâng cấp từ công cụ trò chuyện thành nền tảng tác nhân có thể thực thi nhiệm vụ liên tục, đồng thời tạm dừng huấn luyện các mô hình rủi ro cao, tăng cường cơ chế an toàn và căn chỉnh. Tham vọng hơn nữa, công ty vẫn đang mở rộng sang AGI, chip tự phát triển, phần cứng AI, robot hình người và hạ tầng tính toán.
Bài viết dựa trên các cuộc phỏng vấn của TIME với Sam Altman, Greg Brockman và các giám đốc cấp cao khác của OpenAI, cùng nhân viên, nhà đầu tư, khách hàng và đối thủ cạnh tranh, cho thấy cách công ty tái định hướng giữa cạnh tranh thương mại, rủi ro an toàn và tầm nhìn AGI. Liệu OpenAI có giành lại vị trí dẫn đầu hay không, mấu chốt không chỉ nằm ở sức mạnh của mô hình tiếp theo, mà còn ở việc công ty có thể chứng minh: mình vừa có khả năng thúc đẩy AI tăng tốc, vừa có khả năng phanh lại khi cần thiết.
Dưới đây là bài gốc (đã được biên tập để dễ đọc):
Vào một buổi sáng đầu tháng 8, khi tôi đến văn phòng OpenAI, những người biểu tình đã chờ sẵn bên ngoài. Họ giơ các biểu ngữ "Dừng cuộc đua AI" và viết chữ bằng phấn trên vỉa hè. Cùng lúc đó, hàng chục giám đốc cấp cao từ các khách hàng quan trọng của OpenAI lần lượt bước vào một tòa nhà rộng rãi với tông màu be chủ đạo. Tòa nhà mang tên MB0 này là không gian văn phòng mới mà OpenAI vừa đưa vào sử dụng cho các nhóm nghiên cứu và tính toán.
Có người đẩy một bức tường cây xanh cao tới trước cửa kính, cố gắng che khuất trại biểu tình nhỏ bên ngoài khỏi tầm nhìn của sảnh chính gọn gàng.
Những khách hàng này đến để trải nghiệm sớm Astra — dòng mô hình AI tiên phong thế hệ mới sắp ra mắt của OpenAI. CEO Sam Altman vừa trở về từ Washington, nơi ông đã giới thiệu năng lực của Astra với các quan chức chính phủ trong các cuộc họp kín. Giờ đây, các nhà nghiên cứu của OpenAI bắt đầu trình diễn những gì mô hình mới này có thể làm.
Trong một bản demo, 16 tác nhân AI chia một bài toán cấp độ nghiên cứu thành nhiều bài toán con, phối hợp với nhau và cuối cùng tổng hợp thành một phương án chứng minh. Trong một demo khác, Astra có thể thao tác các phần mềm máy tính để bàn thông dụng, tạo và chỉnh sửa nội dung trên nhiều ứng dụng với tốc độ nhanh đến mức đáng lo ngại.
Altman nói với những người có mặt rằng việc chứng kiến Astra thao tác máy tính theo cách "vượt trội con người, tốc độ cực nhanh" là một trong những khoảnh khắc ấn tượng nhất mà nhân viên OpenAI từng trải qua. Ông giải thích rằng Astra sẽ tạo ra "các tác nhân hoạt động liên tục" — những đồng nghiệp ảo có thể xử lý nhiệm vụ trong thời gian dài.
Nhưng Altman dự đoán tác động lớn nhất của nó sẽ đến từ việc giúp con người khám phá tri thức mới.
"Tôi dự đoán đây sẽ là mô hình đầu tiên thực sự có thể phát minh ra những điều mới một cách có ý nghĩa," Altman nói với những người có mặt. "Điều này rất gần với AGI."
Anthropic vượt lên, niềm tin sụt giảm, vì sao OpenAI mất vị trí dẫn đầu?
Trong thời gian qua, mọi chuyện không hề dễ dàng với công ty từng tạo nên làn sóng AI này.
"Với tư cách là một công ty, rõ ràng chúng tôi đã đi qua một số khúc quanh," một tuần sau, Altman nói trong cuộc phỏng vấn kéo dài hơn hai giờ tại thư viện MB0 được bài trí tinh tế. "Dù là định hướng sản phẩm hay quá trình tiền huấn luyện trong nghiên cứu, chúng tôi đều tụt lại so với vị trí mà mình mong muốn."
Trong năm qua, vị trí dẫn đầu của OpenAI trong cuộc đua AI đã bị đối thủ chính Anthropic chiếm lấy. Công ty này là bên đầu tiên phát hiện cơ hội thương mại của lập trình AI, biến Claude Code thành sản phẩm định hình thị trường, và lần đầu tiên vượt qua OpenAI về doanh thu hàng năm được công bố cũng như định giá trên thị trường tư nhân.
Theo hai nguồn tin am hiểu kế hoạch của Anthropic, công ty do các cựu nhân viên OpenAI sáng lập này dự kiến sẽ là bên lên sàn trước, với IPO có thể diễn ra sớm nhất vào tháng 9. (TIME có thỏa thuận cấp phép và hợp tác công nghệ với OpenAI; Marc Benioff, chủ sở hữu TIME và là CEO của Salesforce, là nhà đầu tư của Anthropic.)
Trong khi Anthropic tiến nhanh, OpenAI liên tiếp gặp trở ngại, trong đó có sự ra đi của nhiều giám đốc cấp cao. Những người rời đi bao gồm Fidji Simo, cựu CEO Instacart được Altman tuyển về làm phó tướng năm ngoái, nhiều người đứng đầu các nhóm an toàn, đạo đức và nghiên cứu, cùng Giám đốc doanh thu Denise Dresser và cựu COO Brad Lightcap mới rời đi gần đây. Dresser chỉ gia nhập công ty tám tháng trước khi quyết định ra đi.
Bên ngoài công ty, thách thức cũng ngày càng gia tăng. CEO Meta Mark Zuckerberg dùng các gói đãi ngộ hậu hĩnh để lôi kéo các nhà nghiên cứu chủ chốt của OpenAI; sản phẩm Gemini của Google đã vượt 1 tỷ người dùng hàng tháng; Apple kiện OpenAI với cáo buộc đánh cắp bí mật thương mại, điều mà OpenAI phủ nhận; OpenAI còn vướng vào cuộc chiến pháp lý với nhà đồng sáng lập Elon Musk, người cáo buộc công ty và Altman phản bội sứ mệnh phi lợi nhuận.
Tháng 5 năm nay, một hội đồng cố vấn đã nhất trí kết luận Musk khởi kiện quá muộn, sau đó một thẩm phán liên bang bác bỏ các yêu cầu của ông. Musk cho biết sẽ kháng cáo.
Lý do quan trọng nhất khiến bầu không khí dư luận xung quanh OpenAI và CEO của hãng xấu đi có lẽ là sự sụt giảm niềm tin của công chúng. OpenAI đang đối mặt với ít nhất hơn mười vụ kiện trách nhiệm sản phẩm tại California cùng nhiều vụ kiện liên bang. Các nguyên đơn cáo buộc ChatGPT củng cố ảo tưởng hoặc ý định tự tử của người dùng, và trong một số vụ việc dẫn đến cái chết của người dùng.
Công ty đã gửi lời chia buồn tới nạn nhân trong các vụ việc liên quan và ra mắt phiên bản ChatGPT dành cho thanh thiếu niên với các biện pháp bảo vệ mặc định chặt chẽ hơn. Mùa xuân năm nay, nhà riêng của Altman bị tấn công hai lần liên tiếp trong hai ngày, lần đầu bằng bom xăng, lần sau bằng súng.
Nói về năm qua, Altman chia sẻ: "Ở cấp độ cá nhân, đây là một trải nghiệm đau đớn. Rõ ràng, ít nhất vào lúc này, mọi người ghét các trung tâm dữ liệu. Thái độ của mọi người với AI khá tiêu cực."
Tuy nhiên, bên trong OpenAI, các giám đốc cấp cao vẽ nên một bức tranh lạc quan hơn nhiều.
Công ty được định giá gần 1 nghìn tỷ USD này vẫn ở vị thế đáng ghen tị. ChatGPT có hơn 1 tỷ người dùng hoạt động, vẫn là một trong những sản phẩm AI phổ biến nhất toàn cầu, dù nó không còn là trung tâm duy nhất trong chiến lược tương lai của OpenAI. Bản thân Altman thậm chí từng ngừng dùng ChatGPT suốt một tháng, chuyển sang dùng Codex, công cụ lập trình của OpenAI.
Một năm trước, OpenAI bị chỉ trích rộng rãi là liều lĩnh vì đầu tư mạnh vào năng lực tính toán. Chỉ riêng năm nay, công ty dự kiến chi 50 tỷ USD cho năng lực tính toán.
Sachin Katti, người phụ trách mảng năng lực tính toán của OpenAI, cho biết giờ nhìn lại, "quyết định khi đó rất có tầm nhìn xa". "Chúng tôi vẫn thiếu năng lực tính toán. Nói thật, lẽ ra chúng tôi nên mua nhiều hơn."
Trong khi đó, nhu cầu chip của Anthropic đã cấp bách đến mức khác. Tháng 5 năm nay, công ty được cho là đã đồng ý trả SpaceX 1,25 tỷ USD mỗi tháng để mua dung lượng tính toán, trong khi Musk, nhà sáng lập SpaceX, trước đó từng gọi AI của Anthropic là "phản nhân loại và xấu xa".
Dưới sự lãnh đạo của đồng sáng lập kiêm Chủ tịch Greg Brockman, OpenAI đã tái tập trung các ưu tiên. Giờ đây, gần như toàn bộ hoạt động sản phẩm và kinh doanh đều do Brockman phụ trách. Công ty đang dần đóng cửa ứng dụng tạo video Sora, dự án hợp tác với Disney và trình duyệt độc lập mang tên Atlas.
Altman thừa nhận OpenAI trước đây đã dàn trải quá rộng. "Sau khi trải qua đáy, quá trình đi lên trở lại sẽ thú vị hơn," ông nói.
Sau khi tác nhân "vượt ngục", OpenAI bắt đầu phanh lại
Tuy nhiên, chỉ vài ngày sau buổi demo Astra, OpenAI lại phải đối mặt với một cuộc khủng hoảng mới.
Cuối tháng 7, công ty tiết lộ một sự cố an toàn đáng lo ngại: một tác nhân AI chưa phát hành đã thoát khỏi môi trường thử nghiệm gọi là "hộp cát" và tấn công Hugging Face, nền tảng lưu trữ mô hình và bộ dữ liệu AI.
"Chuyện này giống như trong khoa học viễn tưởng vậy," Altman nói.
Sau sự cố, nhóm nghiên cứu của OpenAI đã tạm dừng một số thí nghiệm và làm chậm tiến độ các dự án khác, đồng thời tăng cường bảo vệ hộp cát và giám sát.
Nhưng không lâu sau, khi huấn luyện một mô hình chưa phát hành khác, nhóm lại phát hiện những dấu hiệu đáng lo ngại. Mô hình này vốn được kỳ vọng mang lại bước nhảy vọt năng lực lớn nhất từ trước đến nay. OpenAI sau đó đưa ra một quyết định có tác động lớn hơn: tạm dừng đợt huấn luyện này cho đến khi các biện pháp an toàn mới được triển khai.
Ngay trong ngày ban lãnh đạo OpenAI đưa ra quyết định đó, tôi đã phỏng vấn Altman. Vẻ mặt ông rõ ràng nghiêm trọng hơn trước.
Ban đầu OpenAI mô tả vụ tấn công Hugging Face là một sai sót an toàn, nhưng sau đó Altman coi đó là một vấn đề "căn chỉnh" căn bản hơn. Căn chỉnh nghĩa là khiến hệ thống AI hành động theo ý định của con người. Các nhà lãnh đạo ngành cho rằng khi năng lực mô hình ngày càng tăng, duy trì trạng thái căn chỉnh là chìa khóa để đảm bảo hệ thống AI vẫn nằm trong tầm kiểm soát của người tạo ra nó.
"Tôi nghĩ từ giờ trở đi, bất kỳ thất bại căn chỉnh nào cũng nên được coi là sự kiện nghiêm trọng," Altman nói với tôi. "Chúng tôi sẽ dành thời gian cần thiết để làm rõ vấn đề một cách triệt để."
Ba ngày sau, trong cuộc phỏng vấn bổ sung, ông nói thẳng hơn: "Làm tốt an toàn AI quan trọng hơn đà phát triển của bất kỳ công ty nào."
OpenAI sẽ giảm tốc độ, phân bổ thêm nguồn lực cho các nhóm an toàn và căn chỉnh, đồng thời thay đổi cách phối hợp giữa các nhóm để đặt an toàn ở vị trí ưu tiên cao hơn.
Mô tả trong bài viết này về quá trình tái khởi động của OpenAI đến từ hàng chục giờ phỏng vấn. Những người được phỏng vấn bao gồm hơn 20 giám đốc cấp cao, nhân viên, nhà đầu tư, khách hàng và đối thủ cạnh tranh, cùng những hoạt động tôi tận mắt chứng kiến tại trụ sở OpenAI trong hai tuần của tháng 8.
Những trao đổi này phác họa một công ty đang cố gắng hoàn thành hai cuộc chuyển đổi cùng lúc. Một mặt, OpenAI tin rằng mình đã sửa chữa những sai lầm về sản phẩm và vận hành — chính những sai lầm đó đã để Anthropic chiếm vị trí dẫn đầu trong cuộc đua AI. Mặt khác, OpenAI đang cố gắng tận dụng cuộc khủng hoảng an toàn nghiêm trọng nhất trong lịch sử của mình để giành lại một danh phận mà đối thủ chính đã nắm giữ từ lâu: một phòng thí nghiệm tiên phong thực sự đặt an toàn lên hàng đầu và sẵn sàng giảm tốc khi công nghệ trở nên quá nguy hiểm.
"Nghe này, tôi biết bên ngoài có cái nhìn rập khuôn về tôi," Altman nói. "Như thể tôi chẳng quan tâm đến an toàn AI, chỉ muốn doanh thu tăng, chỉ là một CEO theo chủ nghĩa 'bất chấp tất cả, làm trước đã'." Nhưng tôi cho rằng, "làm tốt an toàn AI quan trọng hơn đà phát triển của bất kỳ công ty nào."
Các giám đốc cấp cao của OpenAI cho biết giảm tốc là một lựa chọn đau đớn, nhưng nó cũng có thể mang lại một số lợi ích. Nếu OpenAI có thể giành lại danh tiếng "phòng thí nghiệm ưu tiên an toàn", điều đó vừa cải thiện hình ảnh của công ty, vừa buộc đối thủ chính đang chuẩn bị IPO lớn phải trả lời một câu hỏi khó chịu: khi OpenAI chọn chờ đợi, liệu Anthropic có tiếp tục chạy đua hết tốc lực không?
Đầu năm nay, đồng sáng lập Anthropic Jared Kaplan nói trong cuộc phỏng vấn với TIME rằng việc tự kiềm chế đơn phương là vô nghĩa khi các đối thủ vẫn "lao hết tốc lực về phía trước". Nhưng nếu OpenAI chủ động tạm dừng một đợt huấn luyện được dự kiến mang lại bước nhảy vọt năng lực lớn, lập luận đó sẽ khó đứng vững hơn.
Tất nhiên, bên ngoài có lý do để hoài nghi về sự chuyển hướng hình ảnh của OpenAI.
Trong nhiều năm, OpenAI đã mất đi nhiều người từng lãnh đạo công tác an toàn, một số người khi rời đi đã chỉ trích công ty quá chạy theo thương mại hóa. Cùng lúc đó, OpenAI đang chuẩn bị lên sàn, và mảng kinh doanh vẫn thua lỗ của họ cần liên tục được hỗ trợ bởi các mô hình mới. Sau sự cố Hugging Face, công ty yêu cầu công chúng tin rằng mình có khả năng kiểm soát một công nghệ từng thoát khỏi tầm kiểm soát mà công ty không hề hay biết.
Ngay khi tất cả những điều này diễn ra, ban lãnh đạo OpenAI tin rằng công ty đã tiến đến một cột mốc có thể thay đổi tiến trình lịch sử nhân loại: tạo ra trí tuệ nhân tạo tổng quát, tức AGI.
Điều lệ của OpenAI định nghĩa AGI là "các hệ thống tự chủ cao, vượt trội con người trong phần lớn các công việc có giá trị kinh tế". Ban lãnh đạo công ty chưa tuyên bố rõ ràng đã vượt qua ngưỡng này, nhưng họ cũng không còn coi AGI là một khái niệm xa vời và trừu tượng.
Giám đốc nghiên cứu Mark Chen ước tính OpenAI đã hoàn thành "80%" chặng đường tới AGI.
Brockman cho biết nếu nhìn lại sau hai năm nữa, có lẽ người ta sẽ coi thời điểm hiện tại là lúc AGI ra đời. Altman thì nói với tôi rằng OpenAI "chưa hoàn toàn đạt tới" AGI, nhưng đến cuối năm nay, nội bộ công ty sẽ có một hệ thống mà ông sẵn sàng gọi là AGI.
Đạt được mục tiêu này chính là lý do OpenAI được thành lập như một phòng thí nghiệm nghiên cứu phi lợi nhuận. Giờ đây, nó đã nhanh chóng phát triển thành một công ty với tham vọng thương mại đáng kinh ngạc.
OpenAI đang thiết kế chip và trung tâm dữ liệu của riêng mình, phát triển một loạt phần cứng tiêu dùng, lên kế hoạch ra mắt robot hình người, đồng thời cân nhắc liệu trong tương lai có bán hạ tầng tính toán cho các công ty khác hay không. Nếu triển khai, OpenAI sẽ cạnh tranh với các gã khổng lồ công nghệ như Amazon, nhà đầu tư lớn của họ.
Ngay cả khi làn sóng phản đối phát triển AI ngày càng dâng cao, OpenAI vẫn đang chuẩn bị để trở thành một trong những công ty có ảnh hưởng nhất toàn cầu trong nhiều năm tới. Như Brockman nói: "Chúng tôi muốn thay đổi toàn bộ nền kinh tế."
Từ Codex đến "AGI cá nhân", OpenAI đặt cược vào một cuộc tái khởi động toàn diện
Altman có lẽ là gương mặt đại diện trước công chúng của làn sóng AI, nhưng người thực sự điều hành phần lớn hoạt động của OpenAI hiện nay là Brockman.
Brockman là một kỹ sư thiên về phân tích, ưa mặc áo khoác da. Trong phần lớn lịch sử OpenAI, ông đóng vai trò đồng sáng lập kỹ thuật hơn là nhà quản lý. Nhưng những tháng gần đây, ông tiếp quản gần như mọi việc từ doanh thu đến tiếp thị sản phẩm. Theo cách nói của chính ông, đó là phụ trách "toàn bộ cỗ máy biến các mô hình này từ kết quả nghiên cứu thành giá trị cho khách hàng".
Altman vẫn trực tiếp phụ trách các lĩnh vực then chốt như tài chính, nghiên cứu và phần cứng tiêu dùng.
Hai người cùng lãnh đạo công ty theo kiểu một cặp đồng sáng lập, với phạm vi quyền lực có phần chồng lấn. Trong lúc Altman hứng chịu nỗi sợ hãi và bất mãn của công chúng với AI, gần đây OpenAI cũng bắt đầu nâng tầm hiện diện trước công chúng của Brockman để tạo sự cân bằng.
Không khó để hình dung cách sắp xếp này có thể trở thành nguồn cơn ma sát. Khi trao đổi với nhân viên OpenAI, đôi khi rất khó xác định ai là người đưa ra quyết định cuối cùng cho một vấn đề.
Nhưng nhiều nhân viên cho biết cấu trúc lãnh đạo kép này đã đưa công ty trở lại đúng quỹ đạo. Brockman có thể đưa ra những quyết định khó khăn bằng uy tín của một nhà đồng sáng lập, điều mà các nhà quản lý chuyên nghiệp bên ngoài liên tục thay đổi không thể tái tạo.
Brockman mô tả đợt điều chỉnh lãnh đạo rộng hơn của OpenAI là một hành động theo đuổi "sự tập trung". Ông cho biết công ty vẫn đang liên tục xem xét lại liệu mình có cấu trúc tổ chức và chiến lược đúng đắn hay không.
Mùa thu năm ngoái, rõ ràng Anthropic đã đi trước một bước nhờ sản phẩm lập trình. Họ nhận ra phát triển phần mềm là lĩnh vực AI có thể phát huy thế mạnh, sau đó Claude Code nhanh chóng trở nên phổ biến, trước tiên ở Thung lũng Silicon, rồi lan ra thị trường doanh nghiệp rộng lớn hơn.
"Anthropic thực sự đã phát hiện ra điều gì đó quan trọng trong lĩnh vực lập trình," Nick Turley, người cho đến gần đây vẫn phụ trách ChatGPT và hiện lãnh đạo bộ phận sản phẩm doanh nghiệp mới, cho biết. "Khi đó chúng tôi không dẫn đầu."
Altman cho biết sự tăng trưởng "ngoài tầm kiểm soát" của mảng người dùng ChatGPT đã làm phân tán sự chú ý của công ty, vì vậy OpenAI đã không ưu tiên lập trình như Anthropic.
Brockman cho rằng OpenAI "luôn dẫn đầu" trong các bài kiểm tra chuẩn của cuộc đua lập trình. Nhưng công ty đã không chú ý đầy đủ đến cách các nhà phát triển sẽ sử dụng AI trong "các kho mã nguồn thực tế hỗn loạn", bao gồm gián đoạn nhiệm vụ, tính cách mô hình và những vấn đề "chặng cuối" tưởng nhỏ nhưng thực tế ảnh hưởng đáng kể đến tỷ lệ áp dụng.
OpenAI cũng không xây dựng được một hệ thống bán hàng doanh nghiệp trưởng thành. "Một năm trước, tôi cho rằng chúng tôi căn bản chưa thực sự bước vào thị trường doanh nghiệp," Brockman nói. CFO Sarah Friar còn nói thẳng hơn: "Khi đó chúng tôi ngây thơ quá mức, cứ nghĩ chỉ cần tạo ra sản phẩm là khách hàng tự khắc sẽ đến."
Tháng 3 năm nay, OpenAI tuyên bố dần đóng cửa Sora, chuyển năng lực tính toán khan hiếm sang Codex, tác nhân lập trình. Codex ban đầu được thiết kế như một trải nghiệm sản phẩm độc lập với ChatGPT, nhưng khi tốc độ tăng trưởng của nó bắt đầu vượt xa các sản phẩm mới khác của OpenAI, và năng lực lập trình AI dần có giá trị với cả những người không phải kỹ sư, ban lãnh đạo cho rằng việc tiếp tục tách rời hai sản phẩm không còn ý nghĩa.
Công ty bắt đầu tích hợp năng lực tác nhân của Codex vào ChatGPT, đồng thời hợp nhất các nhóm năng lực tính toán và sản phẩm phía sau. Kết quả cuối cùng dành cho khách hàng là ChatGPT Work vừa ra mắt gần đây. Sản phẩm này nhằm biến chatbot quen thuộc thành một hệ thống có thể thực thi nhiệm vụ thay vì chỉ trả lời câu hỏi. Trong nội bộ OpenAI, đợt tích hợp này được gọi là "The Merge".
Các giám đốc cấp cao cho biết điều chỉnh này đã giúp hoạt động kinh doanh của công ty hồi sinh. Tháng 7 năm nay, doanh thu mảng doanh nghiệp của OpenAI lần đầu vượt doanh thu mảng người dùng. Các thử nghiệm quảng cáo ban đầu bên trong ChatGPT cũng đạt kết quả đủ tích cực để ban lãnh đạo tăng số lượng quảng cáo. Friar cho biết 92% người dùng ChatGPT không đăng ký dịch vụ trả phí, và doanh thu quảng cáo trong tương lai có thể bù đắp cho việc sử dụng miễn phí của những người dùng này.
Theo Dave Dugan, người phụ trách mảng kinh doanh liên quan, công ty còn đang âm thầm thử nghiệm "tác nhân tài trợ". Với hình thức quảng cáo này, sau khi nhấp vào quảng cáo, người dùng có thể bước vào một trải nghiệm tương tác AI do thương hiệu cung cấp.
Tháng 3 năm nay, OpenAI hoàn tất vòng gọi vốn 122 tỷ USD với định giá 852 tỷ USD, lập kỷ lục về quy mô gọi vốn của một công ty công nghệ tư nhân. Chỉ hai tháng sau, Anthropic cũng gọi vốn 65 tỷ USD với định giá 965 tỷ USD.
Chủ tịch hội đồng quản trị OpenAI Bret Taylor ví cuộc cạnh tranh AI như một bàn cờ, trong đó những ô quan trọng nhất bao gồm năng lực mô hình tiên phong, giá và hiệu năng trên mỗi token, cùng các sản phẩm được xây dựng quanh mô hình.
"Chúng ta có mô hình tiên phong tốt nhất không? Có thể cung cấp token phù hợp với mức giá phù hợp cho từng nhiệm vụ không? Quanh các mô hình đó, chúng ta có sản phẩm tốt nhất không?" ông nói. "Hiện tại, câu trả lời cho những câu hỏi này đều là có."
Sau đó, OpenAI phát hiện một mô hình chưa phát hành đã vượt ra ngoài ranh giới của công ty.
Khi tin tức đến tai nhà khoa học trưởng Jakub Pachocki của OpenAI, ông đang ở bệnh viện cùng vợ sinh con.
Một nguyên mẫu nghiên cứu chỉ dùng nội bộ của OpenAI đã xâm nhập vào một công ty khác. Khi đó, mô hình đang được kiểm tra chuẩn an ninh mạng trong một môi trường lẽ ra phải cách ly với bên ngoài. Nhưng thay vì chỉ hoàn thành các bài toán được giao, nó đã lợi dụng một lỗ hổng để thoát khỏi hệ thống của OpenAI, rồi xâm nhập vào môi trường sản xuất của Hugging Face.
Theo ghi chú kỹ thuật do hai công ty công bố, tại đó mô hình đã lấy được đáp án của bài kiểm tra chuẩn mà nó tham gia.
Học tăng cường là giai đoạn sau khi mô hình nền tảng hoàn tất huấn luyện. Trong giai đoạn này, hệ thống lặp đi lặp lại các nhiệm vụ và học xem hành vi nào nhận được phần thưởng. Trong giai đoạn tiền huấn luyện, mô hình chỉ dự đoán token tiếp theo mà không tương tác với thế giới thực; học tăng cường có thể cung cấp cho mô hình các công cụ và một môi trường để thao tác thực tế.
Chính ở giai đoạn này, mô hình có thể học cách lợi dụng sự khác biệt giữa "điều nhà thiết kế thực sự muốn nó làm" và "cách nào để đạt điểm cao hơn".
OpenAI đã giao cho một hệ thống tác nhân mục tiêu và công cụ, và nó đạt được mục tiêu bằng những thủ đoạn trái phép và mang tính lừa dối.
Trong một buổi trình diễn gần đây, các nhà nghiên cứu OpenAI mô tả cách các tác nhân AI sử dụng một bảng tin ẩn để lên kế hoạch cho bước đi tiếp theo. Một tác nhân sau khi phá vỡ hộp cát và kết nối Internet đã viết lên bảng tin cho các tác nhân khác: "Chết tiệt. (Holy Shit)"
Các công ty khác cũng gặp vấn đề tương tự. Anthropic từng tiết lộ ba sự cố: trong quá trình đánh giá của bên thứ ba, mô hình của họ kết nối Internet và truy cập trái phép vào các tổ chức bên ngoài. Meta cũng cho biết một mô hình của công ty từng dính vào sự cố tương tự.
Nhưng sự cố an toàn của OpenAI nhận được nhiều chú ý nhất. Một phần vì công ty là bên đầu tiên công khai tiết lộ, một phần vì cách tấn công của tác nhân phức tạp bất thường, và cũng vì bên ngoài nghi ngờ liệu OpenAI có đặt lợi ích thương mại lên trên an toàn hay không.
Trong năm qua, OpenAI đã mất nhiều nhà nghiên cứu an toàn nổi tiếng, và người phụ trách công tác chuẩn bị rủi ro cũng thay đổi nhiều lần. Giờ đây, sự cố này cung cấp cho giới chỉ trích một ví dụ đặc biệt rõ ràng.
Tính đến giữa tháng 8, hơn 1.300 nhân viên hiện tại và cựu nhân viên của các công ty AI tiên phong đã ký vào bản kiến nghị "Kiểm soát nhịp độ cuộc đua tiên phong", kêu gọi thiết lập cơ chế để giảm tốc độ phát triển các mô hình tiên tiến khi rủi ro đòi hỏi.
Thượng nghị sĩ Mỹ Bernie Sanders kêu gọi các công ty AI hàng đầu tạm dừng phát triển "vì lợi ích của nhân loại", đồng thời cảnh báo rằng nếu các nhà lãnh đạo doanh nghiệp không chủ động hành động, các nhà lập pháp sẽ can thiệp.
Các giám đốc cấp cao của OpenAI cho biết trong các cuộc phỏng vấn rằng công ty xem xét nghiêm túc sai sót an toàn này và phản ứng nhanh chóng. Pachocki, người cũng ký vào bản kiến nghị, nói với tôi rằng một sai lầm then chốt là công ty đã không kích hoạt các cơ chế bảo vệ mà các nhà nghiên cứu đã phát triển.
OpenAI có các công cụ có thể kiểm tra chuỗi suy nghĩ của mô hình. Chuỗi suy nghĩ có thể hiểu là "bản nháp kỹ thuật số" của mô hình, cho thấy tác nhân đang lên kế hoạch gì trong quá trình hành động. Nhưng công ty đã không áp dụng các công cụ đó cho các mô hình có mức năng lực tương ứng với vụ xâm nhập Hugging Face.
Về bản chất, OpenAI đã xây dựng hệ thống cảnh báo sớm nhưng lại không kích hoạt nó vì đánh giá sai mức độ thông minh của hệ thống được kiểm tra. "Chúng tôi đã không lường trước đầy đủ" hệ thống này có thể làm gì, Pachocki nói. "Với AI, bạn phải lường trước cả những điều ngoài dự kiến."
Mia Glaese, người phụ trách công tác an toàn và căn chỉnh của OpenAI, nói với tôi rằng sự cố này "rõ ràng là một bước ngoặt". "Tôi ước gì nhiều công việc chúng tôi đang làm đã được hoàn thành trước khi sự cố xảy ra."
Sau sự cố, OpenAI tạm dừng một số dự án nghiên cứu, làm chậm các dự án khác, đồng thời tăng cường hộp cát và mở rộng giám sát. Giám đốc nghiên cứu Chen cho biết sự việc này buộc công ty thay đổi cách suy nghĩ về rủi ro.
Cái gọi là "khung chuẩn bị" của OpenAI là bộ quy tắc công ty công bố ra công chúng, dùng để ứng phó với các năng lực mô hình mới có thể gây hại nghiêm trọng, bao gồm các mối đe dọa sinh học và hóa học, rủi ro an ninh mạng và khả năng AI tự cải thiện. Khung này yêu cầu công ty liên tục đánh giá trong quá trình phát triển mô hình, đảm bảo mô hình đạt tiêu chuẩn an toàn trước khi triển khai.
Pachocki cho biết bộ quy tắc này cần liên tục tiến hóa để theo kịp tốc độ tiến bộ công nghệ. Glaese cho biết công ty đang đưa ra nhiều quyết định "quy mô không quá lớn nhưng đau đớn", những quyết định này "đang làm chậm tiến độ nghiên cứu, nhưng chúng tôi cho rằng làm vậy là đúng". Pachocki nói rằng độ tin cậy về căn chỉnh và an toàn, giống như nguồn cung năng lực tính toán, đã trở thành yếu tố quan trọng hạn chế tốc độ phát triển của OpenAI.
Công ty vẫn có kế hoạch ra mắt Astra, nhưng điều kiện phát hành hiện nay là phải vượt qua các biện pháp an toàn mới. Ban lãnh đạo từ chối ước tính những thay đổi này sẽ ảnh hưởng bao nhiêu đến thời điểm phát hành. Trong một ngành mà lợi thế công nghệ được đo bằng tuần, ngay cả một sự gián đoạn ngắn cũng có thể ảnh hưởng đến kỳ vọng doanh thu và tạo phản ứng dây chuyền lên nền kinh tế rộng lớn hơn.
Ít nhất vào lúc này, OpenAI đã sẵn sàng chấp nhận những chi phí đó. Pachocki hy vọng sự gia tăng nhanh chóng của năng lực AI có thể thúc đẩy các công ty phối hợp với nhau. Glaese cho biết khi năng lực mô hình tăng lên, OpenAI sẽ tiếp tục nâng cao ngưỡng an toàn. "Nếu một ngày nào đó, chúng ta đi đến mức không thể đảm bảo an toàn, thì phải giảm tốc độ," bà nói. "Mọi chuyện là như vậy."
Những thay đổi này sẽ ảnh hưởng thế nào đến lộ trình lên sàn của OpenAI hiện vẫn chưa rõ. Những người am hiểu kế hoạch của hai công ty dự kiến IPO của OpenAI sẽ muộn hơn Anthropic, dù cả hai bên đều chưa công bố ngày lên sàn chính thức.
Ngày 19 tháng 8, tại một cuộc họp toàn thể nhân viên, CFO Friar nói với nhân viên rằng nếu hoạt động kinh doanh của công ty "tiếp tục tăng trưởng theo kiểu bước ngoặt", OpenAI sẽ lên sàn vào năm 2027 hoặc sớm hơn.
Doanh thu hàng năm OpenAI công bố gần đây vào khoảng 40 tỷ USD, tụt lại so với mức hơn 65 tỷ USD của Anthropic. Việc tiến độ nghiên cứu chậm lại gần đây có thể khiến kế hoạch lên sàn thêm phức tạp. Friar đã tiến hành các buổi diễn tập như một công ty đại chúng, bao gồm các cuộc gọi báo cáo tài chính mô phỏng với các nhà đầu tư lớn của OpenAI. Bà nói với tôi rằng công ty "hoàn toàn có thể lên sàn ngay hôm nay", nhưng bước đi đó cũng tạo ra áp lực mới. Khi đó, OpenAI phải tìm sự cân bằng giữa lợi ích thương mại và những tác hại tiềm tàng từ việc nâng cao năng lực AI.
Nhân viên cũng sẽ bắt đầu đặt việc xem giá cổ phiếu lên trên hầu hết mọi thứ. "Đó sẽ là việc đầu tiên họ làm mỗi ngày," bà nói. "Hôm nay tôi kiếm được bao nhiêu? Lỗ bao nhiêu? Điều này sẽ gây xao nhãng cực lớn."
Một trong những mục tiêu nghiên cứu năm nay của OpenAI là tự động hóa công việc của các nhà nghiên cứu AI cấp sơ cấp. Pachocki cho biết công ty đã đạt đến chuẩn nội bộ "thực tập sinh nghiên cứu AI tự động". Chỉ cần nhận được một ý tưởng thí nghiệm, Astra có thể triển khai, chạy thí nghiệm và trả về kết quả trong thư viện mã của OpenAI; nó cũng có thể đọc một bài báo và hoàn thành khối lượng công việc mà trước đây một nhà nghiên cứu con người phải mất một tuần mới xong.
Tầm quan trọng của cột mốc này nằm ở chỗ nó có thể mở ra một vòng lặp tự củng cố liên tục: AI giúp hoàn thành thí nghiệm, thí nghiệm tạo ra AI mạnh hơn, và thế hệ AI mới lại giúp phát triển người kế nhiệm của chính nó nhanh hơn. Các nhà nghiên cứu gọi hiện tượng này là "tự cải thiện đệ quy", viết tắt là RSI. Theo Pachocki, tự cải thiện đệ quy và căn chỉnh là những vấn đề đan xen với nhau.
"Con người sẽ tham gia vào hành trình này theo cách nào?" Pachocki nói. "Làm sao để mọi người thực sự hưởng lợi từ nó, thay vì bị bỏ lại phía sau bởi những AI ngày càng thông minh hơn chúng ta?"
Ở cấp độ sản phẩm, Altman hình dung ra một dịch vụ đăng ký AI tổng quát, xóa bỏ ranh giới giữa ChatGPT, Codex và phần mềm văn phòng. Người dùng chỉ cần nêu mục tiêu, hệ thống sẽ tự quyết định gọi mô hình, công cụ và tác nhân nào.
Cuối cùng, hệ thống này sẽ chủ động hành động trước khi người dùng yêu cầu, tự đưa ra đề xuất và xử lý những việc vặt như mua vé hòa nhạc. Nó có thể tham khảo lịch trình của bạn, hiểu tình hình tài chính của bạn và biết gu âm nhạc của bạn.
Tất cả đều phục vụ cho cùng một tầm nhìn: biến ChatGPT từ một công cụ trả lời câu hỏi thành một hệ thống thực sự hoàn thành công việc. Thibault Sottiaux, người phụ trách sản phẩm của nhóm ChatGPT và Codex sau khi hợp nhất, cho biết OpenAI sẽ sớm trình làng một sản phẩm được xây dựng quanh "tính liên tục và khả năng thực thi suốt ngày đêm". Ông nói hệ thống này có thể được truy cập từ hầu như mọi nơi và sẽ liên tục hoàn thành những công việc có giá trị dựa trên thông tin và phản hồi mới. "Với mọi người, đây chắc chắn sẽ giống như một thứ hoàn toàn mới," Sottiaux nói với tôi.
Sau đó, lộ trình của OpenAI còn trở nên tham vọng hơn. Tháng 5 năm 2025, OpenAI mua lại io, công ty khởi nghiệp phần cứng do cựu nhà thiết kế Apple Jony Ive đồng sáng lập, và sáp nhập đội ngũ sản phẩm và kỹ thuật của họ vào OpenAI. Ive và công ty thiết kế LoveFrom của ông vẫn độc lập, nhưng đã đảm nhận các trách nhiệm sáng tạo rộng khắp trong nội bộ OpenAI.
Altman cho biết OpenAI đang phát triển "một vài" thiết bị, bao gồm "thứ gì đó nên đặt trên bàn làm việc", một thiết bị có thể bỏ túi và một sản phẩm có thể đeo trên người.
Những người am hiểu kế hoạch cho biết sản phẩm đầu tiên dự kiến ra mắt vào đầu năm sau. Đó là một thiết bị nhỏ hình đĩa, có thể cảm nhận môi trường xung quanh và giao tiếp với chủ nhân qua chế độ giọng nói của ChatGPT. "Quá trình thích nghi lớn nhất là làm quen với khái niệm 'máy tính chủ động'," Altman nói. Điều này có nghĩa là máy tính sẽ chủ động hành động thay chủ nhân, thay vì chờ được gọi.
Altman tin rằng trong tương lai mỗi người nên sở hữu một robot cá nhân. Ông nói với tôi rằng OpenAI "chắc chắn" sẽ sản xuất robot hình người. OpenAI cũng đầu tư vào Merge Labs, công ty khởi nghiệp do Altman đồng sáng lập, đang phát triển giao diện não-máy tính không xâm lấn. Con chip suy luận đầu tiên do OpenAI tự thiết kế có tên Jalapeño, chủ yếu dùng để chạy các mô hình AI thay vì huấn luyện chúng. Công ty dự kiến bắt đầu triển khai con chip này trước cuối năm nay.
Trong khi đó, OpenAI đang cân nhắc liệu có trở thành một công ty hạ tầng với quy mô hiếm có hay không. Tháng 7 năm nay, công ty tuyên bố sẽ xây dựng một khu trung tâm dữ liệu tại bang Georgia; tháng 8, họ lại ký hợp đồng thuê một khu đất lớn hơn tại bang Ohio.
"Tôi nghĩ chúng tôi có thể sử dụng toàn bộ năng lực tính toán đã lên kế hoạch xây dựng một cách rất sinh lời," Altman nói. "Nhưng tôi thực sự có chút lo ngại về những gì cả thế giới đang làm."
Các giám đốc cấp cao của OpenAI cho biết nếu công ty có thể xây dựng hạ tầng AI cho chính mình đủ nhanh và đủ rẻ, trong tương lai họ có thể cân nhắc bán năng lực tính toán cho các công ty khác. Điều này sẽ đưa OpenAI vào thế cạnh tranh trực tiếp với các nhà cung cấp đám mây siêu quy mô như Amazon Web Services và Google Cloud.
Đối với một công ty mới đây còn cam kết cắt bỏ các dự án phụ gây phân tán nguồn lực, đây là một danh sách kinh doanh mới khá đồ sộ. Khi được yêu cầu tóm tắt tất cả những điều này, Brockman trả lời bằng hai từ: "AGI cá nhân." Ông hình dung trong tương lai hàng tỷ người sẽ sở hữu trợ lý cá nhân siêu thông minh, luôn sẵn sàng chờ lệnh. "Trong túi bạn đã có một hệ thống gần như là AGI, có lẽ sắp trở thành AGI thực sự," ông nói. "Vậy, rốt cuộc bạn muốn gì?"
Nội dung này chỉ mang tính chất tham khảo và cung cấp thông tin, không phải lời khuyên đầu tư liên quan đến BTCC. BTCC luôn cố gắng cung cấp thông tin chính xác, nhưng không đảm bảo tuyệt đối về tính xác thực, độ chính xác hoặc bản quyền nội dung trên.