録音と転写

最初の録音を行う

短い音声メモを録音し、レビューアブルな文字起こしに変換します。

対象
初めてキャプチャーから文字起こしまでのループを検証するユーザー。
時間
25分
難易度
初心者

シナリオ

手順に進む前に、このガイドが想定するワークフローを確認します。

作成者またはオペレーターとして、小さな考えを一つ録音してクリーンな文字起こしを取得したい。そうすれば、長いセッションを録音する前に基本的なループを信頼できる。

保存された記録、文字起こし、キャプチャー品質、AI出力、保存、クレジット、フォローアップレビューに影響する設定の明確なマップがあります。

手順

1

正しいインターフェースを選択

信頼できる長い録音とローカルマイクコントロールが必要な場合はデスクトップを使用します。クイックなアカウントレベルのテストにはWebプレイグラウンドを使用します。短いフィールドノートにはモバイルを使用し、API/ショートカットはすでにシークレットとエラー処理の方法を理解している場合のみ使用します。

テストしているプラットフォームを言えます。
録音前に設定を開く場所を知っています。
2

アカウント、プラン、クレジットを確認

サインインしており、テストしているワークフローに十分なクレジットまたはプランアクセスがあることを確認します。メニュー項目が見当たらない場合は、アカウント、プラン、および使用しているアプリインターフェースを確認してください。

アカウントの身元が表示されています。
現在のアカウントとプランにワークフローが含まれているかどうかを知っています。
3

入力、言語、キャプチャー動作を設定

デスクトップでは、録音に影響する場合にのみマイク/オーディオデバイス、グローバルホットキー、プッシュトーク動作、サウンドフィードバック、テーマを確認します。モバイルでは、ワークフローで使用する場合にのみ録音言語、アプリ言語、デバイスパーミッション、メディア同期を確認します。

マイクまたは録音ソースが特定されています。
録音言語がサンプルと一致しています。
テストの前に設定を一つだけ変更しました。
4

安全なサンプルと出力目標を選択

非プライベートなオーディオを60〜120秒使用します。結果が生の文字起こし、会議サマリー、タスクリスト、ジャーナルエントリー、コンテンツ下書き、またはAIチャットのソースのどれになるかを決定します。

サンプルには、スクリーンショットに含まれる予定のシークレットやプライベートな名前が含まれていません。
期待される出力の形状が明確です。
5

テスト可能なスクリプトで録音

文脈の文を一つ、ドメイン用語を一つ、人物または製品名を一つ、アクションアイテムを一つ話します。これにより、結果は文字起こし、辞書、テンプレート、レビューのテストに役立ちます。

録音には明確な始まりと終わりがあります。
録音には、間違っていても辞書に追加する価値のある少なくとも一つの用語が含まれています。
6

録音を停止しローカル記録を確認する

デスクトップ版では、音声がキャプチャされた状態で録音を停止すると、音声検出、ネットワーク文字起こし、またはAI処理が完了する前にローカルの「記録」に保存されます。後のステップで有効な音声が検出されないと報告されたり失敗したりした場合でも、「記録」を開いて保持されている録音を見つけ、そこから再試行できます。

処理を再試行する前に、停止した録音がローカルの「記録」に表示されます。
同じ内容を再度録音する代わりに、保持された録音から再試行します。
7

生の文字起こしとAI出力を個別に確認する

まず文字起こしが単語を正しく認識したか確認します。次に、AI最適化、テンプレートのフォーマット、タイトル、タグ、アクション抽出がテキストを正しく整形したか確認します。

問題が音声/文字起こし層にあるか、AIフォーマット層にあるか判断できます。
重要な名前や用語が認識可能です。
8

記録を保存、名前を付け、場所を決める

記録に検索可能なタイトルを付けます。もし記録がジャーナル、レビューアイテム、お気に入りのブロック、キャプチャライブラリのソース、またはコンテンツの下書きになるべきなら、意識的に次のワークフローに移動します。

記録のタイトルには、トピック、人物、プロジェクト、または決定が含まれています。
記録をデッドエンドのままにするのではなく、次のワークフローを知っています。
9

次の設定変更を決定する

結果を使って次の変更を一つ選択します:用語の辞書、フォーマットのテンプレート、永続的な設定のメモリ、モバイル参照のメディア同期、または自動化のためのAPIキー。

次に開くべき設定またはチュートリアルが一つだけわかります。
一度に複数の無関係なシステムを変更しません。

詳細

録音に影響する設定

最初の録音が悪いのは、多くの場合設定の問題であり、製品全体の文字起こしの問題ではありません。

  • デスクトップのオーディオデバイスとOSのマイクの許可が、Vowiseがクリーンなオーディオを受信するかどうかを決定します。
  • ホットキーとプッシュツートークは、録音の開始、停止、またはテキストの挿入のタイミングを変更します。
  • モバイルの録音言語、アプリ言語、デバイスの許可は、キャプチャと表示の動作に影響します。
  • メディア同期とクリップボード同期は、ワークフローに写真、スクリーンショット、または保存された参照が含まれる場合にのみ重要です。

出力に影響する設定

音声認識を後処理から分離します。同じオーディオでも、AI最適化、テンプレート、辞書、メモリによって最終的なテキストが異なります。

  • 辞書エントリは、名前、ブランド、頭字語、ドメイン用語を保護します。
  • プロンプトテンプレートは、出力が会議議事録、タスクリスト、ジャーナル、ブリーフ、または生のノートのように見えるかどうかを決定します。
  • AI最適化は、句読点、構造、タイトル、タグ、抽出されたアクションなどの整理を制御します。
  • AIメモリは、永続的な設定とコンテキストのみを保存すべきであり、一度きりの詳細は保存しないでください。

記録が次にどこに行けるか

最初の録音は始まりに過ぎません。記録がレビュー、整理、チャット、またはコンテンツのワークフローに入ったときに、Vowiseは有用になります。

  • 記録とスマート整理により、文字起こしが検索可能になります。
  • ジャーナルレビューは、記録を決定、反省、次のアクションに変えます。
  • AIチャットは、明示的な記録のコンテキストについて追加の質問をすることができます。
  • コンテンツ作成とキャプチャライブラリは、記録とソースを下書きの素材として再利用します。

品質チェックリスト

単語誤り率だけでシステムを判断しないでください。重要なのは、必要な決定、名前、次のアクションを保持しているかどうかです。

  • オーディオを再生しなくても元の意図を理解できますか?
  • 重要な名前、用語、頭字語は十分に正確ですか?
  • すべてを書き直さなくても結果を再利用できますか?
  • 次の修正が入力、辞書、テンプレート、メモリ、またはアカウントの許可のどれであるか判断できますか?

関連する機能パス

このチュートリアルで終わらず、自然につながる次の機能とワークフローを確認できます。