BaiLian

qwen3-omni-flash-realtime

Alibabaトークンベース
APIキーを作成

千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。

textimageaudiovideostreaming
最低料金
入力 / 出力 · 1M
コンテキスト
—
最大入力ウィンドウ
モダリティ
→

サプライヤー別料金

official
官方接口直连
入力$3.584/ 1M
出力$7.168/ 1M
Alibaba
阿里巴巴百炼官方
入力$3.584/ 1M
出力$7.168/ 1M

機能 / サポートされるモダリティ

ストリーミング
入力
出力

プロバイダーとデータ保護

プロバイダー
Alibaba (Qwen)ドキュメント
トークナイザー
Qwen tokenizer (tiktoken-compat)
ライセンス
Tongyi Qianwen License公開ウェイト
データ保持57 日デフォルトで上流の学習には使用されません

パフォーマンス

qwen3-omni-flash-realtime について

千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。

使用例とプロンプト

評価を始めるためのヒントです。対応する入力とオプションは API アクセス欄を参照してください。

検討できる使用例

  • 代表的な録音や原稿で音声・オーディオのワークフローを評価します。
  • 対象言語の聞き取りやすさ、発音、ノイズ処理を比較します。

実用的なヒント

まず音声入力、文字起こし、音声出力のどれを行うエンドポイントか確認してください。バッチ処理前に対応言語、ファイル形式、長さ制限を確認します。

API を利用

コードサンプル

リクエストPOST/v1/chat/completions
リクエスト例
パラメータ
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

置換 <YOUR_API_KEY> をトークン設定の API キーに置き換えてください。

認証

すべてのリクエストには Authorization: Bearer <TOKEN> ヘッダーが必要です。Anthropic 形式のエンドポイントでは x-api-key ヘッダーも利用できます。

トークンページから API キーを発行できます。モデル、グループ、IP、レート制限ごとに細かく権限を設定可能です。

対応パラメータ

Generation parameters
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

レート制限

サプライヤーRPMTPMRPD
Alibaba460184K9.2K
official840335K17K

RPM = 1 分あたりリクエスト数、TPM = 1 分あたりトークン数、RPD = 1 日あたりリクエスト数。制限はトークングループ単位で適用されます。

qwen3-omni-flash-realtime に関するよくある質問

qwen3-omni-flash-realtime とは?

千问实时音视频对话模型,可理解文本、图像和音视频输入,并流式输出文本与语音。

qwen3-omni-flash-realtime を呼び出すには?

qwen3-omni-flash-realtime へのアクセス権がある API キーを作成し、API アクセス欄の正確なモデル ID と対応エンドポイントを使用してください。リクエスト項目は選択したエンドポイントによって異なります。

qwen3-omni-flash-realtime の料金体系は?

料金は選択したプロバイダーグループとモデルの課金単位で決まります。現在の入力、出力、リクエスト、またはメディア料金は登録前にこのページで確認できます。

自分のプロジェクトに qwen3-omni-flash-realtime が適しているか評価するには?

まず音声入力、文字起こし、音声出力のどれを行うエンドポイントか確認してください。バッチ処理前に対応言語、ファイル形式、長さ制限を確認します。