執筆・編集

【使い方解説】Bing AIがマルチモーダル対応! 画像の説明可能に

【使い方解説】Bing AIがマルチモーダル対応! 画像の説明可能に
mail@yanagiya.biz

Bing AIが画像アップロードに対応したマルチモーダル機能を紹介しています。プロンプト入力フォームに画像をドラッグ&ドロップして使い、黒柴犬の顔写真をアップロードすると、目の様子や背景のぼけ具合、鼻の色、耳の形まで正確に描写し、ウイスキーの写真では小さなラベルの文字やロゴから銘柄まで判別して解説したうえで関連するネットショップへの広告リンクを表示したとしています。

YouTubeで公開されたデモを参考に、プロジェクト管理フォームを手書きしたラフ画像をアップロードしてHTMLとCSSのコードを生成させる例も試し、デザインの再現度は低いもののプルダウンメニューやボタンなど一部の要素は動作するコードが得られたとしています。刺身の種類や撮影場所の特定など、まだ判別できない対象もあるとしつつ、スマホアプリからも利用でき外出先でも試せるマルチモーダルの可能性を体感できるとまとめています。

この要約は生成AIで作成しました。

記事はこちら
【使い方解説】Bing AIがマルチモーダル対応! 画像の説明可能に
【使い方解説】Bing AIがマルチモーダル対応! 画像の説明可能に
ABOUT ME
柳谷智宣
柳谷智宣
ITライター
1972年生まれ、東京育ち。ITやビジネスといったカテゴリーで執筆しているライターです。キャリアは27年目で、雑紙やムック、単行本、新聞といった紙媒体から、ウェブ記事、メールマガジン、プレスリリースなども手掛けています。現在は、執筆だけでなく、企画提案から執筆・編集までを行っております。主に一般ビジネスユーザーをターゲットに、易しく解説する記事が多いですが、エンタープライズ向けの記事やメーカーや企業のウェブサイトのコンテンツ制作も請け負っています。可能な限り、様々な案件に対応できますので、まずは打診いただけると幸いです。
記事URLをコピーしました