Multimodal Example - 検索 News

Microsoft、小規模言語モデル「Phi-4-multimodal」「Phi-4-mini」を発表

米Microsoftは2月26日（現地時間）、小規模言語モデル（SLM）である「Phi」ファミリーに「Phi-4-multimodal」「Phi-4-mini」が加わったと発表した。現在、「Azure AI Foundry」、「HuggingFace」、「NVIDIA API Catalog」で利用可能。小規模言語モデル（Small Language Model：SLM）は ...

TechPP

From Text to Voice to Vision – How to Build Multimodal AI Apps Today

Build reliable multimodal AI apps with text, voice, and vision using shared context, smart orchestration, routing, and ...

GIGAZINE

OpenAIがGPT-4oベースの有害なテキストや画像を検出できる新しい ...

AI開発企業のOpenAIが、Moderation APIに新しいマルチモーダルモデレーションモデルを導入しました。このマルチモーダルモデレーションモデルはGPT-4oをベースとしており、テキストと画像の両方の入力をサポート。特に、英語以外の言語で以前のモデルよりも ...

ITmedia

「GPT-4o」は何がすごい？なぜLLMは画像や音声も扱えるの ...

米OpenAIが5月に発表した生成AIモデル「GPT-4o」。テキストだけでなく音声や画像も扱えるマルチモーダルモデルとして、その特徴が注目を集めている。ChatGPTでは、GPT-4oの性能を生かした「高度な音声モード」も提供予定（6月25日に延期を発表）で、感情や非 ...

PR TIMES

NEC、即導入可能な顔・虹彩マルチモーダル生体認証によるレベル別 ...

NECは、10月15日～10月18日まで幕張メッセ（千葉市美浜区）で開催される「CEATEC 2024」にて、生体認証入退管理ソフトウェア「Bio-IDiom KAOATO」と連携した顔・虹彩マルチモーダル生体認証を出展します。 CEATEC2024 NECブースイメージ本サービスは、世界No.1(注1)の ...

PR TIMES