要約:
Google は、Workspace オフィス エコシステム向けに Gemini をベースにした一連の新しい人工知能音声機能のリリースを発表しました。これにより、会話型音声インタラクションが 3 つのコア製品 (Gmail、Google Docs、Google Keep) に正式に統合されます。将来的には、ユーザーは面倒な手動入力の必要がなくなり、電子メールの検索、文書の作成、構造化されたメモの整理などの複数の複雑なタスクを音声会話を通じて直接完了できるようになります。

Google ドキュメントでは、ユーザーは音声コマンドを使用して直接文書の下書きを作成および編集できるようになりました。この機能は、長い文章やマルチタスク命令の処理用に特に最適化されており、アプリケーション全体でのデータ抽出をサポートします。たとえば、口述筆記する場合、ユーザーはシステムに直接、Google ドライブ内の個人履歴書情報を呼び出したり、特定の電子メールからイベント スケジュールを抽出して文書の先頭に配置したり、テキストの最後にユーモラスな逸話を追加するよう要求したりすることができます。ユーザーが話している途中で一時的にニーズが変わった場合でも、同じ会話の流れの中でAIが内容をリアルタイムに正確に理解して調整することができます。 Google CEOのSundar Pichai氏は、この機能によりユーザーは最初のドラフトの生成から細かい仕上げまでの全プロセスを音声だけで完了できると述べた。
Gmail に関して、Google は受信トレイのシナリオに最適化された音声対話エクスペリエンスを導入しました。ユーザーはマイク ボタンをタップして Gemini に話しかけるだけで、自然に質問し、メールの深い情報をすばやく掘り下げることができます。たとえば、次のフライト時間、Airbnb の予約確認コード、または医師の予約時間を直接尋ねると、AI がメールの内容を自動的にスキャンして修正し、正確な回答を提供します。このフォームは、従来のキーワード検索とタグのフィルタリングの制限を完全に打ち破り、巨大で混沌とした受信箱を、音声で直接呼び出すことができるナレッジ ベースに変えます。
軽量のメモ作成ツール Google Keep も、AI を活用した音声機能にアップグレードされました。ユーザーは頭の中に散在する考えやメモを口述するだけでよく、システムは音声の書き起こしを自動的に完了するだけでなく、AI の理解能力を利用してそれらをインテリジェントに要約し、フォーマットし、整理して構造化されたメモや ToDo リストに整理することもできます。
この機能アップデートは、入力メソッドと複数のアプリケーションで AI ディクテーション ツールを検討するという Google の以前の路線を継続します。これは、テクノロジー業界が単一の口述筆記から、複雑な複数ステップの AI タスクを処理する最前線への音声入力の移行を加速していることを反映しています。 AI は、独立した会話ウィンドウからユーザーの日常の生産性ツールにさらにシームレスに浸透しています。
コメント