VI ▾
Lấy khóa API

Cập nhật

Cách sử dụng API tóm tắt văn bản không kiểm duyệt cho quy trình xử lý nội dung

API tóm tắt văn bản trích xuất các điểm chính từ các tài liệu dài, nhưng các mô hình tiêu chuẩn thường từ chối nội dung nhạy cảm hoặc người trưởng thành. Việc sử dụng API LLM không kiểm duyệt đảm bảo quy trình của bạn xử lý tất cả tài liệu sáng tạo hoặc kỹ thuật mà không bị bộ lọc nội dung chặn dữ liệu một cách bất ngờ.

Tại sao các API tóm tắt tiêu chuẩn không đáp ứng được

Hầu hết các nhà phát triển đều giả định rằng API tóm tắt chỉ là một hộp đen rút ngắn văn bản. Trên thực tế, nhiều API thương mại áp dụng các lớp kiểm duyệt nội dung ẩn. Nếu đầu vào của bạn chứa các chủ đề trưởng thành, văn học sáng tạo chuyên biệt hoặc thuật ngữ nghiên cứu bảo mật cụ thể, API có thể trả về lời từ chối thay vì bản tóm tắt.

Điều này làm gián đoạn các quy trình tự động. Một kịch bản tạo video có thể bị từ chối chỉ vì một mô tả cảnh trưởng thành đơn lẻ, buộc hệ thống của bạn phải thử lại hoặc loại bỏ nội dung. Đối với các quy trình sáng tạo, sự không chắc chắn này là một điểm ma sát lớn. Bạn cần một lớp hoàn thiện văn bản tập trung vào độ chính xác và ngữ cảnh, chứ không phải kiểm soát dữ liệu đầu vào của bạn.

  • Từ chối không thể đoán trước: Các mô hình tiêu chuẩn có thể chặn nội dung người lớn hợp pháp, làm gián đoạn các quy trình tự động.
  • Mất đi sắc thái: Lọc quá mức có thể cắt ngắn hoặc làm thay đổi các chi tiết quan trọng trong kịch bản sáng tạo.
  • Phức tạp khi gỡ lỗi: Việc phân biệt giữa lỗi mạng và từ chối nội dung làm tăng thêm chi phí cho việc tích hợp của bạn.

Lựa chọn API tóm tắt văn bản không kiểm duyệt

Khi chọn API cho quy trình xử lý nội dung, hãy ưu tiên các mô hình không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc gây tranh cãi. API LLM không kiểm duyệt đảm bảo các kịch bản, phụ đề và văn bản xử lý sau của bạn được tạo ra tự do. Hãy tìm một endpoint tương thích OpenAI để bạn có thể sử dụng các SDK hiện có mà không cần viết lại hoàn toàn.

API seedance được thiết kế cho mục đích này. Nó cung cấp một mô hình ngôn ngữ lớn không kiểm duyệt được tinh chỉnh để trả lời mà không có lời từ chối nội dung. Đây không phải là GPT, Claude hay bất kỳ mô hình của nhà cung cấp nào khác; đây là một mô hình trọng số mở được chạy trên các máy chủ GPU chuyên dụng. Điều này đảm bảo hành vi nhất quán trong suốt quy trình của bạn.

Kiểm tra kích thước cửa sổ ngữ cảnh. Đối với việc tóm tắt văn bản dài, bạn cần một mô hình hỗ trợ đầu vào lớn. Mô hình của chúng tôi hỗ trợ cửa sổ ngữ cảnh 100.000 token, cho phép bạn xử lý toàn bộ tài liệu hoặc kịch bản dài trong một yêu cầu duy nhất. Điều này giảm độ trễ và chi phí token so với các chiến lược phân đoạn.

Bước 1: Chuẩn bị dữ liệu đầu vào của bạn

Trước khi gửi dữ liệu đến API, hãy cấu trúc đầu vào của bạn một cách rõ ràng. Các nhiệm vụ tóm tắt được hưởng lợi từ các hướng dẫn rõ ràng. Hãy xác định độ dài, giọng điệu và các khu vực tập trung mong muốn trong prompt hệ thống của bạn.

Ví dụ, nếu đang tóm tắt một kịch bản video, hãy hướng dẫn mô hình bảo toàn tên nhân vật và các điểm cốt lõi của cốt truyện. Nếu đang xử lý tài liệu kỹ thuật, hãy chỉ định rằng các thuật ngữ chuyên ngành nên được giữ nguyên.

Đảm bảo văn bản đầu vào của bạn nằm trong giới hạn 100.000 token. Nếu tài liệu của bạn vượt quá giới hạn này, bạn có thể cần triển khai chiến lược phân đoạn, mặc dù điều này có thể gây ra các vấn đề về tính liên kết. Đối với hầu hết các kịch bản sáng tạo và bài viết, toàn bộ tài liệu sẽ nằm trong cửa sổ ngữ cảnh.

Loại bỏ bất kỳ siêu dữ liệu hoặc định dạng không cần thiết nào có thể làm nhầm lẫn mô hình. Văn bản thuần túy với các ngắt đoạn rõ ràng hoạt động tốt nhất cho các nhiệm vụ tóm tắt.

Bước 2: Xây dựng yêu cầu API

Sử dụng endpoint POST /v1/chat/completions tiêu chuẩn. Đặt URL cơ sở thành https://api.seedanceapis.com/v1 và bao gồm khóa API của bạn trong tiêu đề ủy quyền. Chỉ định ID mô hình là uncensored.

Xây dựng thân yêu cầu với một thông báo hệ thống xác định nhiệm vụ tóm tắt và một thông báo người dùng chứa văn bản cần tóm tắt. Cấu trúc này tương thích với các SDK chính thức của OpenAI và bất kỳ máy khách tương thích OpenAI nào.

Yêu cầu rất đơn giản: xác định vai trò, cung cấp văn bản và để mô hình tạo bản tóm tắt. Bản chất không kiểm duyệt của mô hình có nghĩa là nó sẽ xử lý tất cả các loại nội dung, bao gồm cả các chủ đề trưởng thành, mà không có lời từ chối bất ngờ.

Phương pháp này đảm bảo quy trình của bạn vẫn mạnh mẽ và có thể dự đoán được, bất kể bản chất của nội dung.

Bước 3: Xử lý phản hồi truyền phát

Với các tài liệu dài, việc truyền phát (streaming) phản hồi giúp cải thiện trải nghiệm người dùng. Bằng cách bật streaming, bạn nhận được các token ngay khi chúng được tạo ra, cho phép cập nhật thời gian thực trong ứng dụng của bạn.

Điều này đặc biệt hữu ích cho các giao diện web nơi người dùng chờ đợi phần tóm tắt xuất hiện. Streaming cũng cho phép bạn hiển thị ngay lập tức các kết quả từng phần, cải thiện hiệu suất cảm nhận.

Để triển khai truyền phát, hãy đặt tham số stream thành true trong yêu cầu của bạn. API sẽ gửi các Sự kiện gửi bởi máy chủ (SSE) chứa các đoạn văn bản. Xử lý các đoạn này trong mã phía máy khách của bạn để xây dựng bản tóm tắt cuối cùng một cách gia tăng.

Phương pháp này giảm độ trễ cảm nhận, đặc biệt với các đầu vào lớn hoặc các nhiệm vụ tóm tắt phức tạp.

Bước 4: Xử lý và định dạng đầu ra

API trả về văn bản thuần theo mặc định. Tùy thuộc vào quy trình xử lý của bạn, bạn có thể cần định dạng văn bản này thêm. Ví dụ, bạn có thể chuyển đổi bản tóm tắt thành một đối tượng JSON có cấu trúc hoặc áp dụng các kiểu định dạng markdown cụ thể.

Vì mô hình không kiểm duyệt, đầu ra sẽ phản ánh chính xác nội dung đầu vào của bạn, bao gồm cả các chủ đề trưởng thành hoặc chuyên biệt. Hãy đảm bảo các hệ thống xử lý tiếp theo của bạn có thể xử lý nội dung này một cách phù hợp.

Hãy xác thực độ dài đầu ra nếu bạn có các ràng buộc nghiêm ngặt. Mặc dù mô hình tạo ra các bản tóm tắt, nhưng độ dài có thể thay đổi. Bạn có thể bao gồm các ràng buộc về độ dài trong prompt hệ thống để định hướng đầu ra.

Lưu bản tóm tắt vào cơ sở dữ liệu của bạn hoặc chuyển nó sang giai đoạn tiếp theo trong quy trình xử lý của bạn, chẳng hạn như một mô hình tạo video hoặc hệ thống kiểm duyệt nội dung.

Bước 5: Xử lý lỗi và thử lại

Hãy triển khai xử lý lỗi mạnh mẽ để quản lý các vấn đề về mạng hoặc giới hạn tốc độ. API hỗ trợ 300 yêu cầu mỗi phút cho mỗi khóa. Nếu bạn vượt quá giới hạn này, bạn sẽ nhận được lỗi 429.

Hãy sử dụng cơ chế tăng dần thời gian chờ khi thử lại các yêu cầu. Điều này ngăn chặn việc làm quá tải API trong các thời kỳ lưu lượng cao. Ngoài ra, hãy xử lý các trường hợp mô hình từ chối do giới hạn nội dung cứng (ví dụ: nội dung tình dục liên quan đến trẻ vị thành niên).

Hãy ghi lại tất cả các lỗi kèm theo ID yêu cầu tương ứng để gỡ lỗi. Điều này giúp xác định các mẫu lỗi, dù là do kích thước đầu vào, giới hạn tốc độ hay chặn nội dung.

Hãy đảm bảo logic thử lại của bạn là bất biến (idempotent) ở mức độ có thể, đặc biệt nếu bạn đang xử lý dữ liệu quan trọng.

Bước 6: Kiểm tra độ chính xác của nội dung

Hãy kiểm thử tích hợp của bạn với một bộ đầu vào đa dạng để đảm bảo mô hình không kiểm duyệt xử lý đúng mọi loại nội dung. Hãy bao gồm các ví dụ về các chủ đề trưởng thành, thuật ngữ kỹ thuật và văn học sáng tạo.

Hãy xác minh rằng các bản tóm tắt giữ lại thông tin quan trọng và không đưa ra các nội dung ảo (hallucinations). Hãy so sánh đầu ra của API với các bản tóm tắt do con người tạo ra để đánh giá chất lượng.

Hãy kiểm tra xem mô hình có từ chối nội dung người trưởng thành hợp pháp hay không. Đây là lợi thế chính khi sử dụng API không kiểm duyệt. Hãy đảm bảo quy trình xử lý của bạn có thể xử lý đầu ra mà không cần lọc thêm.

Hãy ghi lại bất kỳ trường hợp biên nào mà mô hình hoạt động không như dự kiến và điều chỉnh các prompt của bạn cho phù hợp.

Bước 7: Mở rộng tích hợp của bạn

Khi quy trình của bạn phát triển, hãy cân nhắc tối ưu hóa việc sử dụng API. Sử dụng tín dụng trả trước không có phí hàng tháng để quản lý chi phí hiệu quả. Giá là $0.25 cho mỗi 1M token đầu vào và $1.00 cho mỗi 1M token đầu ra.

Hãy theo dõi việc sử dụng token của bạn để duy trì trong ngân sách. API của seedance cung cấp tín dụng bonus cho các lần nạp tiền lớn hơn, giúp giảm chi phí cho người dùng có khối lượng cao.

Hãy tạo lại khóa API của bạn nếu bạn nghi ngờ nó đã bị xâm phạm. Mỗi tài khoản chỉ có thể có một khóa tại một thời điểm, giúp đơn giản hóa việc quản lý bảo mật.

Hãy đảm bảo cơ sở hạ tầng của bạn có thể xử lý tải của các phản hồi streaming và các văn bản đầu vào lớn. Các chiến lược lưu trữ bộ nhớ đệm và hàng đợi phù hợp có thể cải thiện hiệu quả và giảm độ trễ.

Hỏi đáp

Mô hình không kiểm duyệt có từ chối nội dung không?

Mô hình không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc gây tranh cãi. Tuy nhiên, có một giới hạn nội dung cứng chặn nội dung tình dục liên quan đến trẻ vị thành niên. Tất cả các nội dung khác đều được xử lý mà không bị từ chối.

Kích thước cửa sổ ngữ cảnh là bao nhiêu?

Mô hình hỗ trợ cửa sổ ngữ cảnh 100,000 token, bao gồm cả prompt và phần hoàn thành. Điều này cho phép tóm tắt các tài liệu dài hoặc kịch bản trong một yêu cầu duy nhất.

API này có tương thích với các SDK của OpenAI không?

Có, API tương thích với OpenAI. Bạn có thể sử dụng các SDK chính thức của OpenAI hoặc bất kỳ máy khách tương thích OpenAI nào bằng cách đặt URL cơ sở thành https://api.seedanceapis.com/v1 và cung cấp khóa API của bạn.

Chi phí sử dụng API là bao nhiêu?

Giá là $0.25 cho mỗi 1M token đầu vào và $1.00 cho mỗi 1M token đầu ra. Không có phí hàng tháng và tín dụng trả trước không bao giờ hết hạn. Tín dụng bonus có sẵn cho các lần nạp tiền lớn hơn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API