Close-up of a computer motherboard with
Trí tuệ nhân tạo

OpenAI và Anthropic giảm giá khi DeepSeek bùng nổ trên…

GPT-6 Sol/Luna dự kiến sẽ giảm 50% chi phí và Opus 5.5 được định giá rẻ hơn khoảng 40%, trong khi DeepSeek V4.1 Flash ghi nhận mức sử dụng tăng 172% trong tuần.

Bởi Elliot Marsh6 phút đọc

Một chu kỳ phát hành mới hàng tuần đang đẩy các mô hình AI hàng đầu xuống đường cong chi phí, với OpenAI và Anthropic quảng bá giảm giá mạnh thay vì chỉ giảm giá cho các cấp độ cũ hơn. Dữ liệu sử dụng ban đầu từ OpenRouter, nơi mà DeepSeek’s V4.1 Flash đứng ở vị trí số 1 với mức tăng 172% “trong tuần này,” nhất quán với việc giá mỗi token rẻ hơn mở rộng nhu cầu ngay cả khi các phòng thí nghiệm phải đối mặt với áp lực biên lợi nhuận.

Điểm chính

  • OpenAI dự kiến sẽ phát hành GPT-6Solvà GPT-6 Luna vào thứ Ba với chi phí cho các khách hàng doanh nghiệp hàng đầu giảm 50% so với các phiên bản trước của cùng một mô hình.
  • Anthropic cũng đã nhắm đến thứ Ba cho Opus 5.5, cho biết chi phí vận hành khoảng 40% thấp hơn so với Opus 5 trong khi vẫn duy trì “trí tuệ hàng đầu.”
  • xAI đã phát hành Grok 4.7 vào thứ Hai và quảng bá nó dựa trên hiệu suất giá cả, nhưng các sản phẩm cạnh tranh đã thu hẹp phần lớn lợi thế về giá trong vòng 24 giờ.
  • DeepSeek’s V4.1 Flash đứng thứ nhất trên bảng xếp hạng của OpenRouter và ghi nhận mức tăng 172% trong việc sử dụng “tuần này.”

Mô Hình Flagship Trở Nên Rẻ Hơn, Nhanh Chóng: GPT-6 Sol/Luna, Opus 5.5, và Grok 4.7

Tần suất phát hành AI trong tuần này đang được tiếp thị ít như một cuộc đua khả năng thuần túy và nhiều hơn như một bản sửa đổi bảng giá. OpenAI dự kiến phát hành GPT-6 Sol và GPT-6 Luna vào thứ Ba, giảm chi phí cho các khách hàng doanh nghiệp hàng đầu xuống 50% so với các phiên bản trước của cùng một mô hình.

Anthropic dự kiến phát hành Opus 5.5 vào cùng ngày và cho biết chi phí vận hành thấp hơn khoảng 40% so với Opus 5 trong khi vẫn duy trì trí tuệ hàng đầu. Điểm chung là sự nén chi phí rõ ràng ở cấp độ 'flagship' mới nhất, không chỉ là mô hình thông thường giảm giá cho các mẫu cũ sau khi ra mắt mới.

Động thái của xAI đã đặt ra nhịp điệu. xAI của Elon Musk đã phát hành Grok 4.7 vào thứ Hai, định vị mô hình xung quanh giá cả và hiệu suất, và phản ứng cạnh tranh là ngay lập tức. Trong vòng 24 giờ, các tùy chọn mới đã giảm bớt nhiều lợi thế về giá của Grok 4.7, một lời nhắc nhở nhanh chóng rằng sức mạnh định giá trong các mô hình tiên phong có thể biến mất chỉ trong một chu kỳ tin tức.

Chi phí theo Token, Giải thích: Tại sao việc cắt giảm giá có thể làm tăng tổng chi tiêu cho AI

Đơn vị quan trọng trong cuộc chiến này là token. Chi phí theo token là giá mà nhà cung cấp tính để xử lý hoặc tạo ra một đơn vị văn bản, và đây là cách đơn giản nhất để so sánh chi phí vận hành giữa các mô hình khi mọi thứ khác đang thay đổi.

Cắt giảm giá theo token không tự động có nghĩa là thị trường chi tiêu ít hơn cho AI. Cơ chế rất đơn giản: khi một mô hình trở nên rẻ hơn để gọi, các nhà phát triển sẽ cung cấp nhiều tính năng hơn mà trước đây quá đắt, người dùng chạy các phiên dài hơn, và các công ty đẩy nhiều quy trình hơn qua mô hình thay vì giữ nó cho các yêu cầu 'giá trị cao'. Điều đó có thể làm tăng tổng khối lượng token đủ để giữ cho tổng chi tiêu tăng ngay cả khi giá mỗi token giảm.

Động lực đó là trực giác đứng sau nghịch lý Jevons, ý tưởng kinh tế rằng khi một nguồn lực trở nên rẻ hơn để sử dụng, tổng tiêu thụ có thể tăng lên thay vì giảm. Trong trường hợp này, 'nguồn lực' là suy diễn, và cược là rằng giá thấp hơn sẽ mở khóa đủ việc sử dụng mới để giữ cho đồng hồ tính toán hoạt động.

Khung bán bên trong gói này nghiêng về câu chuyện khối lượng đó. Citadel Securities đã nói với khách hàng rằng chi phí theo token giảm đang thúc đẩy việc sử dụng thêm và rằng tổng chi tiêu cho AI đang tăng, điều mà họ lập luận chỉ ra lợi nhuận cuối cùng cao hơn cho các phòng thí nghiệm AI hoặc các công ty cung cấp sức mạnh tính toán cho việc sử dụng AI.

Morgan Stanley đã đưa ra một trường hợp tương tự từ phía cầu, định hình cạnh tranh từ các nhà cung cấp Trung Quốc làtích cựccho AI vì việc tiếp cận rẻ hơn có thể thu hút nhiều khách hàng hơn và tăng tổng nhu cầu về tính toán.

Điểm chứng minh việc áp dụng: DeepSeek V4.1 Flash vượt qua OpenRouter khi mức sử dụng tăng 172%

Điểm dữ liệu sạch nhất trong gói không phải là điểm chuẩn. Đó là bảng xếp hạng và một đợt tăng sử dụng.

DeepSeek’s V4.1 Flash đứng thứ nhất trên bảng xếp hạng của OpenRouter và ghi nhận mức tăng 172% trong việc sử dụng "tuần này." OpenRouter là một aggregator điều hướng các yêu cầu qua nhiều mô hình và công bố bảng xếp hạng mà các nhà giao dịch và nhà phát triển sử dụng như một chỉ số thô cho động lực chấp nhận.

DeepSeek cũng là ví dụ mà gói sử dụng để định nghĩa áp lực trọng số mở lên các công ty hiện tại. Một mô hình trọng số mở là mô hình mà các tham số đã được đào tạo được cung cấp để người khác có thể chạy hoặc tinh chỉnh, điều này thường cho phép triển khai rẻ hơn hoặc linh hoạt hơn so với các sản phẩm hoàn toàn đóng.

Gói lưu ý rằng DeepSeek cho biết V4.1 Flash vượt qua sản phẩm chủ lực trước đó của nó trên một số điểm chuẩn thông qua các cập nhật kỹ thuật cho phép nó tính phí thấp hơn, mặc dù bộ điểm chuẩn và kết quả không được cung cấp ở đây.

Điểm rộng hơn là cạnh tranh, không phải ý thức hệ. Khi các nhà cung cấp trọng số mở leo lên các bảng xếp hạng được theo dõi rộng rãi trong khi giảm giá, họ buộc các phòng thí nghiệm đóng phải phản ứng về chi phí, và ngôn ngữ định giá sản phẩm chủ lực của tuần này đọc như phản ứng đó.

Danh sách kiểm tra xác nhận cho các nhà giao dịch: Tỷ lệ sử dụng trên doanh thu, Sàn giá và Chia sẻ bảng xếp hạng.

Điểm xác nhận đầu tiên là liệu các đợt giảm giá có thực sự xảy ra ở nơi duy nhất quan trọng: các trang giá sau khi phát hành và các điều khoản doanh nghiệp. Giảm giá 50% mà OpenAI tuyên bố cho các khách hàng doanh nghiệp hàng đầu và chi phí vận hành thấp hơn khoảng 40% của Anthropic cho Opus 5.5 là những con số lớn, nhưng gói không bao gồm các con số tuyệt đối $/token hoặc phạm vi chính xác của những khách hàng và cấp độ sử dụng nào đủ điều kiện.

Thứ hai là liệu bảng xếp hạng và xu hướng sử dụng của OpenRouter có giữ DeepSeek V4.1 Flash ở vị trí số 1 hoặc gần số 1 trong một đến hai tuần tới hay không, hoặc liệu bảng xếp hạng có quay lại sau khi các sản phẩm chủ lực được phát hành vào thứ Ba. Một đợt tăng trong một tuần có thể là sự mới lạ, các động lực, hoặc các mặc định định tuyến. Chia sẻ bền vững là một tuyên bố khác.

Thứ ba là cầu nối giữa sử dụng và doanh thu. Gói chỉ ra áp lực biên lợi nhuận lên OpenAI và Anthropic khi cuộc chiến giá cả gia tăng, và vẫn chưa được giải quyết liệu khối lượng token cao hơn có chuyển thành tăng trưởng doanh thu bền vững khi giá mỗi token đang bị nén.

Cuối cùng, hãy xem tốc độ lan tỏa của việc định giá lại. Lợi thế của Grok 4.7 bị cạnh tranh trong vòng 24 giờ là mẫu hình. Nếu việc định giá lại nhanh chóng tương tự xảy ra với nhiều biến thể "flash" hoặc nhỏ hơn, thị trường có khả năng đang di chuyển về phía một sàn giá được thiết lập bởi ai có tính toán rẻ nhất và phân phối tốt nhất, không phải ai thắng một lần phát hành sản phẩm chủ lực.

Quan điểm của tôi: Cuộc chiến giá cả có vẻ như là một câu chuyện về biên lợi nhuận cho các phòng thí nghiệm—và một câu chuyện về khối lượng cho tính toán.

Phần quyết định điều này không phải là một mô hình có "tốt nhất" hay không, mà là liệu việc suy luận rẻ hơn có mở rộng khối lượng công việc đủ để giữ cho tổng chi phí tăng lên hay không.

Bằng chứng cứng của gói này là hẹp nhưng nhất quán về hướng đi: DeepSeek’s V4.1 Flash đứng số 1 trên OpenRouter với mức sử dụng tăng 172% hàng tuần là hình ảnh của nhu cầu theo nghịch lý Jevons trong thực tế, ngay cả trước khi các mẫu flagship vào thứ Ba được công bố.

Bài kiểm tra thực sự là liệu các trang giá sau khi ra mắt và các điều khoản doanh nghiệp có xác nhận mức giảm 50% và ~40% đã nêu hay không và liệu tỷ lệ chia sẻ trên bảng xếp hạng có giữ vững sau khi các mẫu flagship mới ra mắt. Nếu hai điều này khớp nhau, cấu trúc bắt đầu trông có vẻ vững chắc: các phòng thí nghiệm chiến đấu trong một cuộc chiến về biên lợi nhuận trong khi nhu cầu tính toán vẫn ở mức cao về khối lượng.

Nguồn