Four people working on laptops in a dimly lit
Trí tuệ nhân tạo

Meta và Nvidia ra mắt mô hình AI mở giữa lúc chính sách…

Muse Glimmer và Nemotron 3.5 Lightning hạ cánh sau một bức thư ngành vào ngày 24 tháng 7 kêu gọi không có “hạn chế sớm” đối với trọng lượng mở.

Bởi Elliot Marsh7 phút đọc

Meta và Nvidia đã phát hành các mô hình AI mở trọng số vào ngày 10 và 11 tháng 8, định vị chúng như các tải xuống miễn phí cho các nhà phát triển trong một thị trường bị chi phối bởi các nhà lãnh đạo sở hữu của Mỹ và các ngăn mở phổ biến của Trung Quốc.

Các bản phát hành đến sau vài tuần khi hơn 20 công ty công nghệ của Mỹ kêu gọi các nhà hoạch định chính sách tránh "các hạn chế quá sớm" đối với các mô hình mở trọng số, biến cuộc tranh luận thành một cuộc thi chấp nhận.

Điểm chính

  • Meta đã phát hành Muse Glimmer vào ngày 10 tháng 8 và Nvidia theo sau vào ngày 11 tháng 8 với Nemotron 3.5 Lightning, cả hai đều được phân phối như các tùy chọn mở trọng số miễn phí cho các nhà phát triển.
  • Giám đốc điều hành Meta Mark Zuckerberg cho biết Meta sẽ mở trọng số cho Muse Spark 1.2, với "trọng số" được mô tả là các phép tính và quy tắc xác định cách AI hoạt động và cư xử.
  • Nvidia đã định hình bản phát hành của mình là "thực sự mã nguồn mở" bằng cách công bố "các tập dữ liệu huấn luyện, kỹ thuật và trọng số mô hình," không chỉ là các tệp mô hình.
  • Một bức thư mở vào ngày 24 tháng 7 được ký bởi hơn 20 công ty công nghệ của Mỹ đã cảnh báo về "các hạn chế quá sớm" đối với các mô hình mở trọng số và gọi quá trình chưng cất là "một kỹ thuật được sử dụng rộng rãi để cải thiện, đánh giá và xác thực mô hình."

Meta và Nvidia phát hành các mô hình mở trọng số trong vòng 48 giờ

Meta và Nvidia đã phát hành các mô hình AI mở trọng số trong hai ngày liên tiếp trong tuần này, với Meta công bố Muse Glimmer vào ngày 10 tháng 8 và Nvidia ra mắt Nemotron 3.5 Lightning vào ngày 11 tháng 8.

Cả hai đều được định vị là các mô hình mà các nhà phát triển có thể tải xuống miễn phí thông qua hệ sinh thái mã nguồn mở, một tư thế phân phối tương phản với mô hình truy cập sở hữu chiếm ưu thế của Mỹ, nơi các nhà phát triển tiêu thụ các mô hình thông qua cácAPI.

Mục tiêu cạnh tranh là rõ ràng. Các bản phát hành được định hình như một phần của nỗ lực rộng lớn hơn của Mỹ để cạnh tranh với các mô hình trọng lượng mở phổ biến từ các phòng thí nghiệm Trung Quốc bao gồm Moonshot AI và DeepSeek, cùng với Qwen của Alibaba, đồng thời cũng cung cấp một lựa chọn thay thế cho "các mô hình độc quyền phổ biến" từ OpenAI và Anthropic.

Thời điểm này quan trọng vì nó biến một lập luận chính sách thành một lập luận sản phẩm. Một bức thư ngành công nghiệp ngày 24 tháng 7 đã yêu cầu các nhà hoạch định chính sách không áp đặt "các hạn chế sớm" đối với các mô hình trọng lượng mở, ngay cả khi chúng xuất phát từ Trung Quốc.

Meta và Nvidia đã theo sau bằng cách phát hành các tùy chọn có thể tải xuống tại Mỹ, hiệu quả yêu cầu các nhà phát triển và doanh nghiệp chọn một ngăn xếp mở trong nước thay vì chỉ tranh luận về một cái.

Ý nghĩa của 'Trọng Lượng Mở' Tuần Này: Muse Glimmer, Muse Spark 1.2, và Nemotron 3.5 Lightning

"Trọng lượng mở" hẹp hơn so với "mã nguồn mở", và sự phân biệt này là điểm chính của các bản phát hành tuần này. Trong khung này, trọng lượng mở có nghĩa là các nhà phát triển có thể tải xuống và chạy mô hình với các tham số đã học của nó, thay vì chỉ gọi nó thông qua một API được lưu trữ. Các "trọng lượng" là các tham số nội bộ, được mô tả ở đây như là các phép tính và quy tắc xác định cách AI hoạt động và cư xử sau khi được đào tạo.

Sản phẩm mà Meta phát hành là Muse Glimmer, được phát hành như một phần của chiến lược đưa các mô hình AI mạnh nhất của mình vào cộng đồng mã nguồn mở. Zuckerberg cũng cho biết Meta sẽ mở các trọng lượng cho Muse Spark 1.2, được định vị là mô hình cao cấp hơn trong dòng Muse.

Giám đốc điều hành Box, Aaron Levie, đã gọi kế hoạch của Zuckerberg là một "thỏa thuận rất lớn", và thêm vào: "Có một cột mốc rất vững chắc rằng Mỹ sẽ có các mô hình mã nguồn mở gần biên giới." Levie cũng lập luận rằng Muse Spark 1.2 có thể cạnh tranh với các mô hình nền tảng hàng đầu từ Anthropic và OpenAI, mặc dù không có dữ liệu chuẩn nào được cung cấp trong văn bản nguồn.

Bản phát hành của Nvidia là Nemotron 3.5 Lightning, được mô tả là xuất phát từ gia đình Nemotron 3 được phát hành vào tháng 12. Nvidia đang cố gắng nâng cao tiêu chuẩn về ý nghĩa của "mở" bằng cách tuyên bố rằng các mô hình của mình là "thực sự mã nguồn mở", vì nó công bố "các tập dữ liệu đào tạo, kỹ thuật và trọng lượng mô hình" để kiểm tra.

Đó là một lời hứa khác với "đây là các trọng lượng", và nó nhắm đến các nhà phát triển quan tâm đến khả năng tái sản xuất, khả năng kiểm toán và cách mà một mô hình có được các hành vi mà nó có.

Cả hai công ty cũng đang hướng các bản phát hành đến một hình thức triển khai cụ thể: các mô hình nhỏ hơn được thiết kế để chạy trên máy tính xách tay, được quảng bá cho các nhiệm vụ như cung cấp năng lượng cho các tác nhân kỹ thuật số trên thiết bị.

Đó là một cách tiếp cận thực tiễn chống lại các mô hình chỉ có API, và cũng là một cách tiếp cận chống lại các mối quan ngại về rủi ro xuyên biên giới, nơi mà các doanh nghiệp muốn kiểm soát dữ liệu và suy diễn tại địa phương.

Áp lực Chính Sách Gặp Thực Tế Sản Phẩm: Bức Thư Ngày 24 Tháng 7 và Cuộc Chiến Chưng Cất

Bối cảnh chính sách không phải là trừu tượng. AI trọng lượng mở đã trở thành vấn đề gây tranh cãi ở Silicon Valley và Washington, D.C., với các nhà phê bình nêu ra những lo ngại về an ninh quốc gia liên quan đến các mô hình Trung Quốc và về chưng cất, một kỹ thuật đào tạo AI có thể được coi là một hình thức đánh cắp tài sản trí tuệ khi được sử dụng để sao chép khả năng.

Bức thư mở ngày 24 tháng 7 từ hơn 20 công ty công nghệ Mỹ đã có lập trường ngược lại và cố gắng ngăn chặn quy định bằng cách định hình các trọng lượng mở như là ủng hộ cạnh tranh và lãnh đạo. "Thời đại của AI có thể là một thời kỳ thịnh vượng," bức thư cho biết.

"Với những lựa chọn đúng đắn, AI trọng lượng mở có thể mở rộng cơ hội, củng cố cạnh tranh, mở rộng lãnh đạo công nghệ Mỹ, giảm thiểu rủi ro và đảm bảo rằng lợi ích của công nghệ phi thường này được chia sẻ rộng rãi trong nền kinh tế của chúng ta." Về chưng cất, bức thư cùng mô tả nó là "một kỹ thuật được sử dụng rộng rãi để cải thiện, đánh giá và xác thực mô hình."

Đây là nơi các bản phát hành trở thành một bài kiểm tra độ tin cậy. Meta và Nvidia đang lập luận rằng phân phối trọng số mở không chỉ là một sở thích nghiên cứu, mà còn là một kênh áp dụng có thể được quản lý và sử dụng an toàn.

Levie đã liên kết điều đó trực tiếp với các triển khai được quy định, nói rằng: “Bạn có thể sẽ không thể đưa một mô hình mã nguồn mở không phải nội địa vào một cơ quan chính phủ lớn, chẳng hạn, và bạn cũng sẽ không thể sử dụng nó tại các ngân hàng lớn nhất, rất có thể,” thêm rằng Muse “mở ra một tiềm năng to lớn.”

Điểm mấu chốt là thị trường vẫn phải xuất hiện. Văn bản nguồn chỉ ra rằng cả hai công ty vẫn phải chứng minh có một đối tượng cho các sản phẩm của họ trong một thị trường mà các mô hình mở của Trung Quốc đã phổ biến.

Tín hiệu cho các nhà giao dịch Crypto: Mô hình mở, Đại lý trên thiết bị, và câu chuyện ‘Chi phí Token’

Đối với các nhà giao dịch crypto, tín hiệu ngay lập tức không phải là “AI đã mở”, mà là cuộc chiến chính sách mô hình mở đang bị buộc phải chuyển sang các chỉ số áp dụng có thể đo lường.

Nếu những bản phát hành này thu hút được sự chú ý, bảng điểm sẽ hiển thị trong hành vi của các nhà phát triển: tải xuống, phân nhánh, công cụ cộng đồng, và liệu các doanh nghiệp có coi trọng số mở nội địa như một lựa chọn thân thiện với tuân thủ thay cho các ngăn xếp mở không phải nội địa hay không.

Điểm kiểm tra cụ thể tiếp theo là liệu Meta có thực hiện việc mở trọng số cho Muse Spark 1.2 hay không, và dưới giấy phép và điều khoản nào. Kế hoạch đã được Zuckerberg công bố là một cam kết định hướng, nhưng thị trường sẽ định giá sản phẩm thực tế và các ràng buộc của nó.

Thái độ “mã nguồn thực sự mở” của Nvidia cũng đặt ra một kỳ vọng cao hơn về những gì được coi là “mở” trong AI, điều này có thể ảnh hưởng đến các câu chuyện token xung quanh AI phi tập trung và tính toán DePIN. Nếu các nhà phát triển bắt đầu yêu cầu khả năng kiểm tra ngoài trọng số, các dự án chỉ phản ánh trọng số mà không có nguồn gốc sẽ trông mỏng manh hơn.

Luồng khác mà các nhà giao dịch sẽ nhận ra là chi phí. Giám đốc điều hành Uniphore Umesh Sachdev cho biết Meta đã đốt cháy cầu khi chuyển từ trọng số mở sang các mô hình độc quyền, và cảnh báo, “Tôi nghĩ sẽ cần nhiều hơn một bài viết dài 3.500 từ từ Zuck để thuyết phục các nhà phát triển,” thêm rằng các nhà phát triển Uniphore “hầu như cảm thấy bị phản bội.” Tuy nhiên, Sachdev cho biết ông đang ủng hộ các công ty nội địa thành công “bởi vì sự cạnh tranh nhiều hơn sẽ làm giảm chi phí token, và sẽ thúc đẩy đổi mới, và điều đó luôn tốt cho người tiêu dùng.” Nếu các tùy chọn trọng số mở của Mỹ trở thành những sự thay thế đáng tin cậy, “suy diễn rẻ hơn” không còn là một khẩu hiệu mà bắt đầu trở thành một ràng buộc cạnh tranh.

Chính sách vẫn là quân bài bất ngờ. Bức thư ngày 24 tháng 7 yêu cầu không có “các hạn chế sớm,” nhưng văn bản nguồn không chỉ rõ những hạn chế nào có thể được đề xuất hoặc trong thời gian nào. Bất kỳ đề xuất cụ thể nào của Mỹ liên quan đến chưng cất, cấp phép, hoặc phân phối sẽ ngay lập tức định giá lại những ngăn xếp mở nào có thể sử dụng trong các bối cảnh được quy định.

Đọc của tôi: Đây là một ‘Cài đặt Mở’ của Mỹ—Nhưng Thị Trường sẽ Đòi Hỏi Chứng Minh về Độ Bền của Hệ Sinh Thái

Ngưỡng quan trọng là liệu những bản phát hành này có chuyển đổi một câu chuyện quy định thành trọng lực phát triển bền vững hay không. Việc phát hành các mô hình miễn phí tải xuống ngay sau bức thư ngày 24 tháng 7 là một chiến thuật sạch, nhưng nó chỉ hiệu quả nếu các nhà phát triển thực sự xây dựng trên chúng và các doanh nghiệp coi “trọng số mở nội địa” như một danh mục có thể triển khai thay vì chỉ là một điểm nói chuyện.

Nvidia cũng đang âm thầm thay đổi tiêu chuẩn bằng cách nói rằng "mã nguồn mở thực sự" có nghĩa là công bố "dữ liệu huấn luyện, kỹ thuật và trọng số mô hình."

Nếu kỳ vọng đó được duy trì, cuộc đua mô hình mở sẽ ít tập trung vào ai công bố trọng số trước và nhiều hơn vào ai có thể duy trì một quy trình có thể kiểm tra mà các nhà phát triển tin tưởng, điều này sẽ là điều kiện khiến việc thiết lập lại mở của Mỹ trong tuần này trở nên có ý nghĩa thực tiễn.

Nguồn