議事録、誰が話したか自動で分かりますか
複数人が話す音声を、発言者ごとに分けて文字起こしするツールです。「話者A」「話者B」のように区別されるため、誰がいつ何を話したかが読み取れる原稿になります。会議や面談の記録に向いています。
オンラインで実行
アカウントでログインし、当社のサーバー上で実行します。無料ツールはブラウザ内で動作しますが、これは上記の料金がKIT残高から差し引かれます。
話者分離とは
同じ録音の中でも、声の違いをもとに発言を話者ごとに振り分けます。文字起こしだけでは誰の発言か分からない会議の記録が、話者ごとに整理された形で読めるようになります。
現在の状態
この機能はベータ版として提供しています。多くの録音で実用的に使えますが、声質が近い話者や重なって話す場面では、区別の精度が下がることがあります。
使い方
複数人の音声ファイルをアップロードします。文字起こしと同時に話者の区別が行われ、発言ごとに話者のラベルが付いたテキストが返されます。
議事録づくりへの活用
話者ごとの発言が分かると、決定事項や担当者の発言をそのまま議事録に反映しやすくなります。文字起こし機能単体より、会議の記録には向いています。
活用例
営業会議の発言整理
株式会社山田商事の会議では、参加者ごとの発言を分けて記録したいという要望があり、話者分離を使って誰の発言かが分かる議事録を作成しています。
面談内容の記録
人事担当の鈴木美咲さんは、採用面談の音声を話者ごとに分けて文字起こしし、応募者と面接官の発言を区別して記録に残しています。
取材の対談記事づくり
フリーランス編集者の田中大輔さんは、対談の録音を話者分離にかけ、誰の発言かを間違えずに記事へ起こしています。
よくある質問
何人まで話者を区別できますか?
少人数の会話であれば安定して区別できます。人数が多い録音や声が似た話者では、区別の精度が下がることがあります。
ベータ版とはどういう意味ですか?
実用的にお使いいただける段階ですが、精度は今後改善を続けています。重要な記録には、結果を確認したうえでご利用ください。
料金はいくらですか?
1リクエスト$0.002に加えて、処理1分あたり$0.0055かかります。15分の会議であれば合計は約$0.08です。
話者に名前を付けることはできますか?
出力される時点では話者A・話者Bのような形式です。名前への置き換えは、テキストを受け取ったあとに行っていただく形になります。
録音データはどのように扱われますか?
話者分離の処理にのみ使用し、公開や第三者への提供は行いません。
会員登録は必要ですか?
必要ありません。登録なしでこのページからそのままご利用いただけます。
開発者向け — APIアクセス
このページの機能はすべてAPIからも利用できます。自社システムに組み込みたいチーム向けのセクションです。それ以外の方は上のツールをそのままお使いください。
エンドポイント
Bearerトークンで認証し、POST1回でタスクをキューに登録します。結果はWebhookまたは署名付きリンクで受け取れます。
お使いのスタックから呼び出す
curl -X POST https://api.kit.forhosting.com/audio/diarize \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"audio":"https://ejemplo.com/audio.mp3"}'const res = await fetch("https://api.kit.forhosting.com/audio/diarize", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"audio": "https://ejemplo.com/audio.mp3"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/audio/diarize",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"audio": "https://ejemplo.com/audio.mp3"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/audio/diarize", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"audio":"https://ejemplo.com/audio.mp3"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"audio":"https://ejemplo.com/audio.mp3"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/audio/diarize", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)リクエスト例
{
"audio": "https://ejemplo.com/audio.mp3"
}レスポンス例
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "audio.diarize",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}非同期APIです。task_idは即時に返ります。ポーリングは1秒あたり1リクエストまでです。
料金
単価はすべて公開しています。トークン換算や独自クレジットはありません。失敗したタスクは課金されません。
制限
max_mb | 200 |
max_minutes | 180 |
エラー
| HTTP | コード | 意味 |
|---|---|---|
401 | unauthorized | APIキーが無効か、指定されていません。Authorizationヘッダーを確認してください。 |
402 | insufficient_balance | 残高が不足しています。チャージ後に再度お試しください。 |
404 | unknown_type | 指定されたタスクタイプは存在しません。タイプ名を確認してください。 |
429 | rate_limited | リクエストが多すぎます。しばらく待ってから再度お試しください。 |
422 | task_failed | タスクの処理に失敗しました。このタスクは課金されません。 |