1747630741
2025-05-16 08:29:00
マドリード、5月16日。 (Portaltic/EP) –
Googleは、AndroidアクセシビリティツールとChromeブラウザーを更新して、人工知能(AI)およびGeminiモデルから機能を拡張し、TalkBack Accessのリアルタイムサブタイトルを使用して画像について尋ねることができます。
デバイスと対話するために盲目または縮小された視力を向上させるために設計されたトークバックツールは、昨年のジェミニの能力を組み込んで画像の説明を提供します。
今年、Googleは人工知能との統合を更新し、ユーザーが説明された画像について尋ねて情報を取得できるようにしました。相互作用の方法、その他は、たとえばWebページの購入プロセス中に画面全体に拡張されます。
聴覚障害のある人にとって、GoogleのAIは「表現力豊かな字幕」も推進します。これは、人々が言うことだけでなく、彼らが言う方法の字幕を提供する新しい機能であり、その中で説明されているように、ホイッスルや喉などの音を報告するラベルを組み込んでいます。 公式ブログ。
リアルタイムおよびほとんどのアプリケーションで機能するこの斬新さは、Android 15のデバイスおよびその後のバージョンで、米国、英国、カナダ、オーストラリアで英語で利用できます。
Chromebookチームには、障害のある学生を対象とした新しいアクセシビリティ機能が組み込まれているため、フェイシャルジェスチャーでコンピューターをナビゲートして読書体験をカスタマイズできます。
2,000万人以上が毎日使用しているChromeブラウザに関しては、光学文字認識(OCR)がスキャンされたPDFを自動的に認識し、テキストを強調表示、コピー、探し、画面リーダーを使用して読むことができます。
一方、ページズームでは、ページやWebナビゲーションの設計に影響を与えることなく、Android用のChromeのテキストのサイズを拡張できます。
ユーフォニアプロジェクト
ユーフォニアプロジェクトは、より文化的言語や文脈での音声認識を改善することを目的としたイニシアチブとして2019年に生まれたため、このテクノロジーは標準以外のスピーチを持つ人々によりアクセスしやすくなります。
それ以来、Googleは、世界中のツールエコシステムを改善するために、GitHubページを通じてオープンソースリポジトリを提供する開発者をサポートしています。
年の初めに、Google.orgおよびUniversity College LondonであるDigital Language Center for Digital Language(CDLI)が作成され、オープンソースのデータセットと新しいモデルの開発により、10のアフリカ言語で音声認識技術を改善しようとしました。
#Googleトークバックは画像について説明しそれについて尋ねることができますフル画面に拡張される機能