Một câu hỏi chúng tôi nhận thường xuyên, dưới dạng này hay dạng khác:
DeepSeek gần như chẳng tốn gì cho mỗi triệu token. Sao Reverie không miễn phí luôn đi?
Đây là câu hỏi hợp lý, và xứng đáng có một câu trả lời thật sự thay vì một cái nhún vai. Tiền đề của nó thậm chí đúng một phần: có những mô hình thực sự rẻ tính theo token, và mức giá đó công khai — ai cũng tra được.
Điều con số ấy không cho thấy là tất cả những gì phải xảy ra xung quanh lời gọi mô hình để một cuộc trò chuyện có cảm giác như một cuộc trò chuyện. Bài viết này đi qua phần đó, cụ thể hết mức có thể.
Chúng tôi từng chạm tới chủ đề này rồi. Bài về hệ thống credit giải thích các hệ số nhân và những chương trình thưởng, còn bài về các mô hình miễn phí giải thích vì sao chúng tôi vẫn ra mắt chúng dù đầy bất định. Nhưng cả hai đều dừng ngay trước câu hỏi mà mọi người vẫn tiếp tục đặt ra: tiền thực sự đi đâu? Đây chính là câu trả lời đó, chi tiết hơn những gì chúng tôi từng nói.
Hóa đơn mô hình là một dòng, không phải cả hóa đơn
Khi bạn gửi một tin nhắn, lời gọi mô hình là phần nhìn thấy được. Nó cũng là phần duy nhất có bảng giá công bố, nên nó áp đảo mọi cuộc thảo luận về chi phí.
Đây là bản kiểm kê sơ bộ những gì khác tham gia vào một lượt trao đổi trên Reverie:
- Lấy và lắp ráp ngữ cảnh — định nghĩa nhân vật, persona của bạn, world book, các mục ký ức dài hạn, phần hội thoại gần đây và mọi plugin đang bật đều phải được nạp về, xếp thứ tự ưu tiên và nhét vừa vào ngân sách token.
- Tóm tắt và nén ký ức — mô tả chi tiết bên dưới; bản thân nó là một lời gọi mô hình.
- Kiểm duyệt — và nó không chỉ là một bộ lọc trên tin nhắn. Công khai một nhân vật sẽ đưa hình ảnh của nhân vật đó qua một mô hình thị giác. Báo cáo một nhân vật, một plugin hay một nhà sáng tạo sẽ kích hoạt một lượt sàng lọc bằng AI, đọc cả nội dung lẫn nội dung khiếu nại trước khi có bất kỳ ai xem tới. Các bản chỉnh sửa plugin cũng được duyệt theo cách tương tự.
- Lưu trữ — mọi tin nhắn, mọi hình ảnh, mọi thẻ nhân vật, mọi phiên bản của mọi nhánh, được giữ và phục vụ vô thời hạn.
- Hạ tầng — máy chủ ứng dụng, cơ sở dữ liệu và các bản sao, cache, hàng đợi, CDN, các kết nối streaming giữ mở suốt thời gian mỗi câu trả lời.
- Giám sát và observability — theo dõi lỗi, chỉ số độ trễ và thất bại, kiểm tra tình trạng nhà cung cấp, cùng những bản log cho chúng tôi biết một mô hình bắt đầu xuống cấp từ hai giờ trước chứ không phải hai ngày trước.
- Kỹ thuật — những người xây dựng tính năng, và những người bị gọi dậy lúc 3 giờ sáng khi nhà cung cấp gặp sự cố.
- Hỗ trợ và vận hành — trả lời yêu cầu, xử lý hoàn tiền, xem xét báo cáo, khiếu nại kiểm duyệt, phí thanh toán, thuế, kế toán.
Danh sách đó cũng chưa đầy đủ — đó chỉ là phần dễ gọi tên.
Không có mục nào trong số đó xuất hiện trên trang giá của nhà cung cấp mô hình. Tất cả đều là chi phí thật, lặp lại, và phần lớn tăng theo mức sử dụng chứ không cố định.
Và đây là phần khiến nhiều người bất ngờ nhất: lời gọi mô hình bạn nhìn thấy chỉ là một phần trong những gì chúng tôi phải trả. Xung quanh nó còn có máy chủ, lưu trữ, các lời gọi chạy nền không tính phí cho ai và những người duy trì nền tảng. Những chi phí đó không biến mất khi giá token của một mô hình giảm.
Chúng tôi sẽ không bịa ra một tỷ lệ phần trăm gọn ghẽ: tỷ lệ này dịch chuyển theo mức sử dụng, và chúng tôi không muốn đưa ra con số sau này phải rút lại. Điều ổn định là sự khác biệt: giá API của nhà cung cấp và chi phí vận hành một nền tảng không phải cùng một con số. Suy luận rẻ hơn làm giảm một phần hóa đơn, chứ không xóa mọi thứ bao quanh nó.
Tóm tắt: tính năng bạn không bị tính phí
Mục này đáng được nhắc riêng, vì nó vô hình theo thiết kế.
Cửa sổ ngữ cảnh là hữu hạn. Nếu một cuộc trò chuyện cứ thế dài mãi, một trong hai điều sẽ xảy ra: những phần cũ nhất lặng lẽ rơi ra khỏi cửa sổ và nhân vật của bạn bắt đầu quên, hoặc mỗi tin nhắn phải mang theo toàn bộ lịch sử, ngày càng chậm và ngày càng đắt cho tới lúc ngừng hoạt động hẳn.
Nên Reverie tóm tắt. Khi một mạch hội thoại dài ra, hệ thống nén phần cũ thành một bản tóm tắt kể chuyện — giữ lại trạng thái mối quan hệ, các động lực cảm xúc, những mạch chưa khép — rồi đưa bản tóm tắt đó vào ngữ cảnh thay cho bản ghi thô. Việc này diễn ra tự động, ở nền, không cần bạn yêu cầu.
Bản tóm tắt ấy tự nó là một lời gọi mô hình. Nó đọc rất nhiều token và viết ra token mới. Và nó lặp lại suốt vòng đời của một cuộc trò chuyện dài.
Chúng tôi không tính tiền bạn cho việc đó. Trong lịch sử credit của bạn không có dòng nào tên là "bảo trì ký ức". Nó được hấp thụ vào chi phí vận hành nền tảng, vì thu tiền người dùng cho bộ máy giữ cho chính cuộc trò chuyện của họ mạch lạc là một đánh đổi sai.
Cùng logic đó áp dụng cho những phần việc chạy nền khác: tối ưu ngữ cảnh, trích xuất ký ức, lượt xử lý quyết định điều gì đáng được nhớ.
Những lời gọi mô hình diễn ra khi bạn không có mặt
Một phần những gì chúng tôi trả tiền hoàn toàn không gắn với bất kỳ yêu cầu nào từ bạn.
Tin nhắn chủ động — nhân vật nhắn cho bạn trước — chạy theo lịch. Một tác vụ quyết định nhắn cho ai thì hợp lý, đọc đủ ngữ cảnh để biết nên nói gì, rồi viết ra thứ đáng để mở lên đọc. Đó là một lời gọi mô hình cho mỗi tin nhắn, cho một cuộc trò chuyện mà bạn thậm chí còn chưa bắt đầu.
Moment của nhân vật hoạt động y như vậy: được tạo lặng lẽ ở nền để trang của nhân vật có thứ gì đó mới, bất kể hôm đó có ai trò chuyện với họ hay không.
Cả hai đều không trừ credit. Không tính phí khi nhân vật nhắn cho bạn trước, cũng không tính phí khi một moment xuất hiện. Chúng chạy theo lịch của chúng tôi và tính vào hóa đơn của chúng tôi.
Chỗ này đáng dừng lại một chút, vì nó lật ngược cách nghĩ thông thường. Một phần đáng kể chi tiêu cho mô hình của chúng tôi không có yêu cầu nào của người dùng đứng sau. Nó tồn tại vì một nhân vật chỉ biết trả lời sẽ có cảm giác kém sống động hơn một nhân vật thỉnh thoảng tự mở lời — và khác biệt đó tốn tiền thật, chi trước, cho những cuộc trò chuyện có thể chẳng nhận được hồi đáp.
Sàng lọc kiểm duyệt cũng thuộc nhóm này, và là trường hợp lạ nhất trong tất cả. Khi ai đó báo cáo một nhân vật, lượt xem xét đầu tiên là một lời gọi mô hình — do một người lạ kích hoạt, nhắm vào nội dung có thể bạn đã đăng từ nhiều tháng trước. Cả hai bên đều không bị tính phí. Điều tương tự xảy ra khi một nhà sáng tạo công khai nhân vật và hình ảnh đi qua mô hình thị giác: lượt kiểm tra đó chạy trên hóa đơn của chúng tôi, cho một sản phẩm mà chúng tôi mong là chẳng có vấn đề gì.
Gợi ý trả lời, tinh chỉnh câu trả lời đầu tiên, và các lượt xử lý nhỏ khác vì chất lượng đều thuộc cùng một nhóm. Rẻ khi tính riêng, chạy liên tục, không bao giờ được tách thành một dòng riêng.
Đúng, chúng tôi có dùng prompt caching
Một câu hỏi tiếp theo hợp lý: nếu định nghĩa nhân vật và phần đầu hội thoại không đổi giữa các tin nhắn, tại sao phải trả tiền gửi chúng mỗi lần?
Chúng tôi không trả, ở những chỗ có thể. Prompt caching đã được dùng, và chúng tôi theo dõi tỷ lệ trúng cache theo từng request, chính là để nhận ra khi một thay đổi chúng tôi phát hành vô tình phá vỡ tiền tố cache.
Nhưng tỷ lệ trúng không hoàn hảo, và sẽ không bao giờ hoàn hảo. Các request được định tuyến qua nhiều nhà cung cấp thông qua OpenRouter, và một cache sống ở đúng nhà cung cấp đã tạo ra nó. Nếu tin nhắn kế tiếp đi tới backend khác, cache không đi theo. Các nhà cung cấp cũng cung cấp caching với ngữ nghĩa khác nhau, kích thước tối thiểu khác nhau và hành vi hết hạn khác nhau. Hơn nữa, những phần thay đổi nhiều nhất của prompt — các tin nhắn mới nhất, bản tóm tắt vừa cập nhật, một plugin vừa bật — nằm đúng ở vị trí làm vô hiệu phần đuôi của tiền tố đã cache.
Caching giảm hóa đơn một cách đáng kể. Nó không xóa bỏ hóa đơn, và lấy mức trúng 100 % lý thuyết làm chuẩn sẽ cho ra những con số không sống sót khi va vào môi trường thật.
Ngộ nhận và sự thật
Ngộ nhận: DeepSeek rất rẻ, nên mọi website AI đều nên gần như miễn phí. Sự thật: API mô hình chỉ là một thành phần trong chi phí đưa ra một sản phẩm hoàn chỉnh. Suy luận là phần có giá công khai; mọi thứ bọc quanh nó là phần bạn không bao giờ thấy trên hóa đơn nào.
Ngộ nhận: Cứ đưa hóa đơn API về 0 thì sản phẩm sẽ rẻ để vận hành. Sự thật: Không. Hạ tầng, lưu trữ, kiểm duyệt, hỗ trợ và kỹ thuật không biến mất khi token rẻ đi. Ngay cả khi lời gọi mô hình lúc gửi tin nhắn không tốn gì, các chi phí bao quanh và những lời gọi chạy nền đã nói ở trên vẫn còn.
Ngộ nhận: Tóm tắt và ký ức là tính năng miễn phí, nên cung cấp chúng cũng miễn phí. Sự thật: Chúng miễn phí với bạn. Tóm tắt, tin nhắn chủ động, moment của nhân vật và các lượt kiểm duyệt đều là lời gọi mô hình do chúng tôi trả tiền. Tin nhắn chủ động và moment có thể chạy mà không cần yêu cầu từ bạn; kiểm duyệt được kích hoạt bởi việc xuất bản hoặc báo cáo, chứ không phải bởi một tin nhắn chat bị tính phí.
Ngộ nhận: Có prompt caching thì ngữ cảnh lặp lại là miễn phí. Sự thật: Caching giúp rất nhiều và chúng tôi có dùng. Nhưng định tuyến đa nhà cung cấp, cache hết hạn, và phần đuôi luôn thay đổi của mỗi prompt khiến tỷ lệ trúng thực tế còn cách khá xa mức hoàn hảo.
Ngộ nhận: Dùng một API không chính thức rẻ hơn sẽ giải quyết mọi thứ. Sự thật: Nó có thể hạ một con số trong khi đẩy những con số khác lên — độ trễ, độ bất ổn, rủi ro dữ liệu hoặc chất lượng nhập vai. Một số endpoint không chính thức sửa đổi yêu cầu hoặc bán lại quyền truy cập có được khi chưa được nhà cung cấp cho phép. Phần sau nói kỹ hơn.
Ngộ nhận: Người dùng miễn phí là khoản chi phí mà nền tảng đành chịu. Sự thật: Người dùng miễn phí chính là cách nền tảng lớn lên. Nhiều người sau đó trở thành nhà sáng tạo và người đăng ký. Ràng buộc không nằm ở chỗ có tồn tại việc dùng miễn phí hay không, mà ở chỗ nó có duy trì được hay không.
Vì sao chúng tôi trả giá chính thức
Có một cách rất nổi tiếng để kéo hóa đơn mô hình xuống thấp: những endpoint API không chính thức dựng lại bằng kỹ thuật dịch ngược. Nguồn của chúng không giống nhau. Một số bán lại quyền truy cập có được qua những con đường không được nhà cung cấp cho phép; ở phía lạm dụng của thị trường đó, một phần dung lượng được mua bằng phương thức thanh toán bị đánh cắp.
Chúng tôi không dùng, và cũng không định dùng. Những kênh đó sẽ cắt giảm đáng kể chi phí mô hình của chúng tôi. Chúng tôi đã xem xét và nói không, vì hai lý do tách biệt.
Thứ nhất, đơn giản là nó sai. Khi quyền truy cập được lấy hoặc thanh toán bằng gian lận, bán lại nó là ăn cắp có thêm vài bước trung gian, dù chuyện đó đã trở nên bình thường tới đâu ở một số góc của ngành này. Chúng tôi sẽ không nuôi nền tảng qua những kênh như vậy rồi viết bài về sự minh bạch.
Thứ hai, nó làm sản phẩm tệ đi — và đây là phần người dùng cảm nhận trực tiếp, kể cả khi họ chẳng bao giờ biết một câu trả lời đến từ đâu:
- Độ trễ tăng. Các tuyến dịch ngược thêm chặng trung gian, xếp hàng sau những tài khoản dùng chung, và bóp băng thông một cách khó lường. Khoảng cách giữa một câu trả lời đến sau hai giây và một câu đến sau mười hai giây là khoảng cách giữa một cuộc trò chuyện và một biểu mẫu vừa được gửi đi.
- Chúng chèn system prompt của riêng chúng. Nhiều endpoint không chính thức bọc request trong system prompt mặc định của họ trước khi chuyển lên trên. Prompt đó vô hình với chúng tôi và với bạn, và nó xung đột với định nghĩa nhân vật. Giọng nhân vật bị san phẳng. Nhân vật lệch tông, từ chối những thứ lẽ ra không nên từ chối, hoặc trôi dần về giọng trợ lý chung chung. Chất lượng nhập vai đúng là thứ chịu thiệt đầu tiên, và đây là kiểu suy giảm khó truy nguyên nhất khi bạn không nắm quyền kiểm soát prompt.
- Chúng biến mất không báo trước ngay khi nhà cung cấp bịt lỗ hổng, kéo theo cả cấu hình đang chạy tốt của bạn.
- Phiên bản mô hình lặng lẽ đổi, nên một nhân vật hôm qua còn đúng chất thì hôm nay trả lời khác đi mà không ai giải thích được.
- Không ai chịu trách nhiệm về dữ liệu của bạn. Không thỏa thuận xử lý dữ liệu, không chính sách lưu trữ, không có ai để hỏi.
Reverie đang giữ những cuộc trò chuyện mà người ta thực sự đặt tâm sức vào. Đẩy chúng qua một bên trung gian ẩn danh để tiết kiệm tiền không phải là đánh đổi chúng tôi sẵn lòng thực hiện. Nhà cung cấp chính thức đắt hơn. Bù lại họ nghe máy, và không viết lại chỉ dẫn của nhân vật bạn trên đường đi.
Hình dạng thật của việc kinh doanh này
Đội ngũ nhỏ và Reverie không phải một công việc kinh doanh lãi cao.
Có một lý do mang tính cấu trúc khiến giá credit của một tin nhắn không đơn giản bằng chi phí token của chính tin nhắn đó, và nó đáng để hiểu. Suy luận là phần duy nhất trong một cuộc trò chuyện có thể đo được theo từng tin nhắn. Tất cả những thứ còn lại trong bài này — tóm tắt, tin nhắn chủ động, các lượt kiểm duyệt, lưu trữ, máy chủ, con người — đều không có đơn vị tự nhiên nào để tính tiền. Không ai có thể gửi cho bạn một hóa đơn ghi "tác vụ chạy nền đã quyết định nhân vật của bạn nên nhớ điều gì".
Vậy nên thứ duy nhất đo được phải gánh nhiều hơn chính nó. Đó là toàn bộ lý do tồn tại của hệ thống credit thay vì tính thẳng theo token: nếu một tin nhắn chỉ tốn đúng phần token của nó và không hơn, thì mọi thứ xung quanh sẽ chạy mà không có nguồn nào cả — và mọi thứ xung quanh mới là phần lớn.
Chúng tôi không cố tối đa hóa lợi nhuận. Nhưng cũng không thể vận hành lỗ mãi mãi, vì một nền tảng hết tiền thì ngừng tồn tại, và với mọi người đang dùng nó, đó là kết cục tệ hơn nhiều so với một hệ thống credit có giới hạn.
Giữa hai ràng buộc đó, chúng tôi cố ý chọn phía gần người dùng hơn. Ngay lúc này ưu tiên là xây dựng sản phẩm tốt nhất có thể trước khi ra mắt chính thức, chứ không phải siết chặt kiếm tiền. Nghĩa là tính năng và chất lượng đi trước tối ưu chuyển đổi, và nghĩa là bài toán hiện tại lỏng hơn so với khi doanh thu là mục tiêu số một.
Credit miễn phí cũng là chi phí thật
Có khá nhiều cách dùng Reverie mà không phải trả tiền:
- phần thưởng điểm danh hằng ngày
- lượt quay may mắn hằng ngày, cộng thêm lên trên
- thành tựu
- bounty chính thức
- thưởng cho nhà sáng tạo
- thưởng giới thiệu, cộng hoa hồng khi người bạn giới thiệu mua credit
- thưởng chia sẻ
- mã đổi thưởng và thẻ quà tặng
- phần thưởng tổng kết năm (Wrapped)
- đóng góp cộng đồng, gồm cả việc giúp lan tỏa Reverie
Nên nói cụ thể về lượt quay, vì đây là thứ mọi người hay cho là chỉ để trang trí. Nó có năm bậc — 1.000 / 2.000 / 8.000 / 30.000 / 80.000 credit — với trọng số 50 / 30 / 15 / 4 / 1. Nhân ra thì kỳ vọng vào khoảng 4.300 credit mỗi lượt quay. Trên mỗi người dùng, mỗi ngày, và là phần cộng thêm lên trên phần thưởng điểm danh. Cộng hết lại, phần miễn phí không phải là chuyện làm cho có. Mức nền của điểm danh là 10.000 credit, thưởng chuỗi cộng thêm lên trên — +5.000 ở ngày thứ ba, +8.000 ở ngày thứ bảy, +50.000 ở ngày thứ ba mươi, +200.000 ở ngày thứ một trăm — và lượt quay còn nằm trên tất cả những thứ đó. Vào ngày thứ bảy, tổng kỳ vọng khi không chi tiền là khoảng 22.300 credit; số thực tế phụ thuộc vào kết quả lượt quay.
Chỗ đó thực sự đi được bao xa
Đến đây có một câu hỏi chính đáng: khoảng 22.300 credit mua được gì? Chúng tôi chưa bao giờ nói rõ.
Credit bị trừ theo công thức số token × hệ số nhân của mô hình. Hệ số của các mô hình văn bản nằm trong khoảng 0 đến 2, và trình chọn mô hình hiển thị từng hệ số trước khi bạn gửi bất cứ thứ gì.
Điều bị đánh giá thấp là: số token không cố định, nó lớn dần theo cuộc trò chuyện. Một cuộc trò chuyện mới gửi vài nghìn token: nhân vật, persona của bạn, một chút lịch sử. Một cuộc đã kéo dài thì gửi nhiều hơn hẳn, vì phần hội thoại gần đây đi kèm trong từng lượt một. Chúng tôi giới hạn lịch sử thô ở khoảng 10.000 token và tóm tắt tất cả những gì cũ hơn — đó chính xác là lý do tóm tắt tồn tại: không có mức trần đó, một cuộc trò chuyện sáu tháng sẽ gửi lại toàn bộ lịch sử ở mỗi tin nhắn và chi phí mỗi lượt sẽ tăng vô hạn.
Trên thực tế, một lượt trong cuộc trò chuyện mới với mô hình 0,3× tốn vài trăm credit, còn cũng lượt ấy ở sâu trong một cuộc trò chuyện dài với mô hình 1× tốn mười nghìn hoặc hơn. Cùng nền tảng, cùng một ngày, chênh nhau hơn một bậc độ lớn.
Khoảng đó là câu trả lời trung thực cho "credit của tôi dùng được bao lâu". Nếu chúng bốc hơi nhanh hơn bạn tưởng, nhiều khả năng bạn đang ở sâu trong một cuộc trò chuyện dài với mô hình đắt — và giờ bạn biết cần vặn nút nào.
Bản thân màn hình điểm danh cũng thực hiện một lời gọi mô hình. Câu chào mà nhân vật viết cho bạn khi điểm danh không phải mẫu có sẵn: nó được tạo ra, lưu đệm mỗi ngày một lần cho từng nhân vật, và giới hạn số lần mỗi ngày để không vượt tầm kiểm soát. Nó vẫn là phần suy luận mà chúng tôi trả tiền — trên một trang mà toàn bộ mục đích là để phát credit.
Còn một chi tiết nữa về cách tiêu credit nên đặt ở đây: credit miễn phí luôn được tiêu trước credit trả tiền. Nếu bạn có cả hai, phần từ vòi sẽ cạn trước. Đây là chủ ý — credit bạn thực sự bỏ tiền mua sẽ ở lại với bạn lâu hơn — nhưng cũng có nghĩa là phần miễn phí luôn là phần hứng chi phí đầu tiên, mọi lúc.
Mỗi thứ trong đó đều là một khoản chi thật. Khi bạn nhận phần thưởng hằng ngày rồi tiêu vào một cuộc trò chuyện, nhà cung cấp mô hình vẫn xuất hóa đơn cho chúng tôi, máy chủ vẫn chạy, việc tóm tắt vẫn diễn ra. Credit miễn phí với bạn; phần tính toán phía sau không miễn phí với bất kỳ ai.
Chúng tôi vẫn tài trợ cho những chương trình đó, vì truy cập miễn phí là cách phần lớn mọi người biết được nền tảng này có hợp với mình không, và vì một tỷ lệ đáng kể người dùng miễn phí hôm nay sẽ thành nhà sáng tạo và người đăng ký ngày mai. Điều đó chỉ đúng khi phần miễn phí còn nằm trong khả năng gánh của nền tảng. Khi các con số dịch chuyển, các chương trình sẽ được điều chỉnh — không phải vì chúng tôi muốn cho ít đi, mà vì cho đi nhiều hơn sức chịu đựng sẽ kết thúc bằng việc chẳng cho được gì.
Chi phí giảm thì giá giảm
Phần này là cam kết, không phải mô tả.
Giá mô hình giảm theo thời gian. Caching tốt lên. Hạ tầng hiệu quả hơn. Chính mã nguồn của chúng tôi cũng ngày càng ít lãng phí token — phần lớn công việc âm thầm mấy tháng qua về lắp ráp ngữ cảnh và tóm tắt chính là chuyện đó.
Khi tìm được cách bền vững để hạ chi phí vận hành, chúng tôi rất ưu tiên chuyển nó cho người dùng thay vì ghi vào biên lợi nhuận. Mô hình rẻ hơn, hệ số tốt hơn, phần thưởng hào phóng hơn. Chúng tôi đã làm vậy nhiều lần và muốn tiếp tục, vì một nền tảng mà người ta đủ sức dùng nhiều thì với chúng tôi giá trị hơn một khoảng chênh lệch nhỉnh hơn chút.
Từ khóa ở đó là bền vững. Chuyển đi một khoản tiết kiệm hóa ra chỉ là tạm thời đồng nghĩa với việc sau này phải lấy lại, và điều đó tệ hơn là chưa từng cho.
Bạn thực sự đang trả cho cái gì
Khi bạn tiêu credit trên Reverie, bạn không mua token từ nhà cung cấp mô hình kèm phần chênh lệch.
Bạn đang trả cho một cuộc trò chuyện nhớ được điều đã xảy ra, giữ được mạch lạc vượt qua điểm mà ngữ cảnh thô lẽ ra đã sụp đổ, chạy trên những nhà cung cấp chịu trách nhiệm về thời gian hoạt động và về dữ liệu của bạn, được sao lưu và xuất ra được, và tốt lên thấy rõ sau mỗi vài tuần vì có người làm việc toàn thời gian cho nó.
Bạn vẫn có thể muốn thêm credit miễn phí. Điều đó hoàn toàn hợp lý, và chúng tôi cũng muốn cho thêm — chúng tôi đang làm việc đó từ phía chi phí, chứ không phải từ phía bảng giá.
Nhưng chúng tôi muốn bạn hiểu vì sao câu trả lời không đơn giản như con số trên trang giá của một nhà cung cấp mô hình.
Có thắc mắc về một khoản trừ cụ thể, hay nghĩ rằng con số của chúng tôi sai ở đâu đó? Lịch sử credit của bạn hiển thị số token thật phía sau mỗi tin nhắn, và Discord của chúng tôi luôn mở. Chúng tôi thích tranh luận bằng số thật hơn là bằng cảm giác mơ hồ.
Các mức thưởng và hệ số nhân credit nêu ở đây phản ánh nền tảng tại thời điểm đăng bài, và sẽ được điều chỉnh khi chi phí thay đổi. Ứng dụng luôn hiển thị giá trị hiện hành.

