MS_AzureCognitiveServices - NetDevInfraWGinOSSConsortium/NetDevInfraWiki GitHub Wiki

Azure Cognitive Services

概要

  • 視覚、音声、言語、意思決定のためのカスタマイズ可能な API

  • Microsoft Cognitive Services(マイクロソフト認知サービス API)
    → Azure Cognitive Services(Azure 認知サービス API)

    • 音声を言葉に変換したり
    • 写真に写っている情報を認識して言葉で説明したり
    • あるいは写真をテーマ別に分類したり

補足(このサービスの意義): AzureのAI系サービス
分類で言う SaaS 層にあたり、
学習済みのモデルを API として呼ぶだけで使える。

【Machine Learning(PaaS)】 データを集める → 学習させる → 配信する
【Cognitive Services(SaaS)】 API を呼ぶ  ← 学習は済んでいる

「画像から文字を読みたい」「音声を文字にしたい」といった
一般的な課題であれば、自分でモデルを作る理由はない。
まずここで足りるかを確認するのが AI 活用の第一歩になる。

補足(最新化 / 名称の再編): Azure Cognitive Services は
Azure AI サービス(Azure AI services)に改称
され、
個々のサービスも次のように名前が変わっている。

原文の名称 現在の名称
Computer Vision / Custom Vision / Face Azure AI Vision(Custom Vision, Face は個別に継続)
Speech 系(Speech to Text ほか) Azure AI Speech
Text Analytics / LUIS / QnA Maker Azure AI Language に統合
Translator Azure AI Translator
Anomaly Detector / Personalizer / Content Moderator 提供終了(後述)

また、開発の入口は Azure AI Foundry(旧 Azure AI Studio)に集約されている。

詳細

決定

意思決定をすばやく行う

Azure Anomaly Detector

問題の識別

Azure Content Moderator

不快または望ましくない可能性のあるコンテンツの検出

Azure Personalizer

パーソナライズされ、優れたエクスペリエンスの提供

補足(最新化): 「決定」カテゴリの 3 つはいずれも提供終了となった。

サービス 現況
Anomaly Detector 2026 年 10 月に廃止予定
Content Moderator 2027 年 3 月に廃止予定(Azure AI Content Safety が後継)
Personalizer 2026 年 10 月に廃止予定

特に Azure AI Content Safety は、生成 AI の普及に伴い
「入力・出力の安全性を検査する」用途で重要度が上がっている。

言語

非構造化テキストから意味を取り出す

自然言語を解釈する機能をアプリ、ボット、IoT デバイスに組み込む。

QnA Maker

質疑応答を、会話形式で行う。

Text Analytics

センチメント、キー フレーズ、名前付きエンティティを検出。

Translator

100 を超える言語や方言を検出し、翻訳。

補足(最新化 / 生成 AI による地殻変動): 「言語」カテゴリは
大規模言語モデル(LLM)の登場で最も影響を受けた領域である。

原文 現況
LUIS 2025 年 10 月に廃止Conversational Language Understanding (CLU) が後継
QnA Maker 2025 年 3 月に廃止Custom Question Answering が後継
Text Analytics Azure AI Language に統合(継続)
Translator Azure AI Translator(継続)

さらに実務では、
意図解釈や質疑応答を Azure OpenAI+ RAG で
実装する
選択肢が主流になりつつある。
「意図を事前に定義して学習させる」LUIS 型のアプローチから、
「モデルに文脈を渡して解釈させる」LLM 型へ移った、という構図。

音声

カスタマー エクスペリエンスを向上させる

Speech to Text

音声を、テキストに書き起こす。

Text to Speech

テキストを音声に変換。

Speech Translation

リアルタイムの音声翻訳をアプリに統合。

Speaker Recognition

音声に基づいて人々の話を識別し、検証。

視覚

画像やビデオ内のコンテンツを特定して分析。

Computer Vision

画像と動画のコンテンツを分析

Custom Vision

画像認識をビジネス ニーズに合わせてカスタマイズ

Face API

画像内の顔と表情を検出して識別

補足(Face API の利用制限): 顔認識は責任ある AIの観点から
制限が強化されており、

  • 顔識別・照合(Identify / Verify)機能は申請と承認が必要
  • 感情・性別・年齢の推定など一部の属性推定は提供終了

となっている。技術的に可能でも使えるとは限らない点に注意が要る。

検索

ラインナップから外された(→ コチラ)。

補足: Bing Search API のこと。
Cognitive Services から独立したサービスに移された経緯を指している。
なお Bing Search API 自体も 2025 年 8 月に提供終了しており、
現在は Azure AI Foundry の
Grounding with Bing Search(LLM の回答を Web 検索で裏付ける機能)に
役割が移っている。

参考

YouTube

[#くらでべ]

Tech Briefing

microsoft.com

Microsoft Azure

Microsoft Learn


Tags: 移行, クラウド, BI/AI, Azure

⚠️ **GitHub.com Fallback** ⚠️