

翻訳は機械翻訳により提供されています。提供された翻訳内容と英語版の間で齟齬、不一致または矛盾がある場合、英語版が優先します。

# Amazon SageMaker の組み込みアルゴリズムと事前トレーニング済みモデル
<a name="algos"></a>

Amazon SageMaker は、データサイエンティストや機械学習の実践者が機械学習モデルのトレーニングとデプロイを迅速に開始できるようにする一連の組み込みアルゴリズム、トレーニング済みモデルおよび構築済みソリューションテンプレートを提供しています。SageMaker を初めて使う方にとって、特定のユースケースに適したアルゴリズムを選択するのは難しい作業です。次の表に、サンプル問題またはユースケースから開始し、その問題タイプに有効な SageMaker によって提供される適切な組み込みアルゴリズムを見つける方法を示すクイックチートシートを示します。学習パラダイム (教師ありと教師なし) と重要なデータドメイン (テキストとイメージ) によって構成される追加のガイダンスについては、表の次のセクションを参照してください。

表: 組み込みアルゴリズムへのユースケースのマッピング



- **[トレーニング済みのモデルと構築済みのソリューションテンプレート](https://docs.aws.amazon.com/sagemaker/latest/dg/studio-jumpstart.html)**
  - ****問題タイプ**:** イメージ分類<br />表形式分類<br />表形式回帰<br />テキスト分類<br />オブジェクト検出<br />テキスト埋め込み<br />質問への回答<br />センテンスペア分類<br />画像埋め込み<br />固有表現認識<br />インスタンスセグメンテーション<br />テキスト生成<br />テキスト要約<br />セマンティックセグメンテーション<br />機械翻訳
  - ****問題とユースケース例**:** ここでは、Amazon SageMaker JumpStart が提供する事前トレーニング済みのモデルと構築済みのソリューションテンプレートで対処できる 15 の問題タイプのうち、いくつかの例を示します。<br />質問への回答: 指定された質問に対する回答を出力するチャットボット。<br />テキスト分析: 金融などの業界ドメイン固有のモデルからのテキストを分析します。
  - ****データ入力形式**:** 画像、テキスト、表形式
  - ****組み込みアルゴリズム**:** Mobilenet、YOLO、Faster R-CNN、BERT、LightGBM、CatBoost などの人気モデル<br />利用可能なトレーニング済みモデルのリストについては、「[JumpStart Models](https://docs.aws.amazon.com/sagemaker/latest/dg/studio-jumpstart.html#jumpstart-models)」を参照してください。<br />利用可能な構築済みソリューションテンプレートのリストについては、「[JumpStart Solutions](https://docs.aws.amazon.com/sagemaker/latest/dg/studio-jumpstart.html#jumpstart-solutions)」を参照してください。

- ** [教師あり学習](#algorithms-built-in-supervised-learning) **
  - ****問題タイプ**:** 二項/複数クラス分類 / ****問題とユースケース例**:** 項目がカテゴリに属しているかどうかを予測する: メールスパムフィルター / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [AutoGluon-Tabular](autogluon-tabular.md), [CatBoost](catboost.md), [因数分解機アルゴリズム](fact-machines.md), [K 最近傍 (k-NN) アルゴリズム](k-nearest-neighbors.md), [LightGBM](lightgbm.md), [線形学習アルゴリズム](linear-learner.md), [TabTransformer](tabtransformer.md), [Amazon SageMaker AI の XGBoost アルゴリズム](xgboost.md)
  - ****問題タイプ**:** リグレッション / ****問題とユースケース例**:** 数値/連続値を予測する: 家の価値を推定 / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [AutoGluon-Tabular](autogluon-tabular.md), [CatBoost](catboost.md), [因数分解機アルゴリズム](fact-machines.md), [K 最近傍 (k-NN) アルゴリズム](k-nearest-neighbors.md), [LightGBM](lightgbm.md), [線形学習アルゴリズム](linear-learner.md), [TabTransformer](tabtransformer.md), [Amazon SageMaker AI の XGBoost アルゴリズム](xgboost.md)
  - ****問題タイプ**:** 時系列予測 / ****問題とユースケース例**:** 行動の履歴データに基づいて将来の行動を予測する: 以前の売上データに基づいて新製品の売上を予測 / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [SageMaker AI DeepAR 予測アルゴリズムを使用する](deepar.md)
  - ****問題タイプ**:** 埋め込み: 高次元のオブジェクトを低次元空間に変換します。 / ****問題とユースケース例**:** 高次元オブジェクトのデータ埋め込みを改善する: 重複するサポートチケットを特定するか、チケット内のテキストの類似性に基づいて正しいルーティングを検出 / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [Object2Vec アルゴリズム](object2vec.md)

- **[教師なし学習](#algorithms-built-in-unsupervised-learning)**
  - ****問題タイプ**:** 特徴量エンジニアリング: 次元縮退 / ****問題とユースケース例**:** ラベル/ターゲット変数と関係が弱い列をデータセットからドロップする: 走行距離の予測時の車の色 / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [主成分分析法 (PCA) アルゴリズム](pca.md)
  - ****問題タイプ**:** 異常検出 / ****問題とユースケース例**:** アプリケーションの異常動作を検出する: IoT センサーが異常な読み取り値を送信することを特定 / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [ランダムカットフォレスト (RCF) アルゴリズム](randomcutforest.md)
  - ****問題タイプ**:** IP 異常検出 / ****問題とユースケース例**:** 疑わしいユーザーからアプリケーションを保護する: サービスにアクセスする IP アドレスが不正なアクターによるものかどうかを検出 / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [IP Insights](ip-insights.md)
  - ****問題タイプ**:** クラスタリングまたはグループ化 / ****問題とユースケース例**:** 類似するオブジェクト/データをグループ化する: トランザクション履歴から高、中、低支出の顧客を検出 / ****データ入力形式**:** 表形式 / ****組み込みアルゴリズム**:** [K-Means アルゴリズム](k-means.md)
  - ****問題タイプ**:** トピックのモデリング / ****問題とユースケース例**:** 一連のドキュメントをトピックに整理する (事前に確認できない): ドキュメントで使用されている用語に基づいてドキュメントを医療カテゴリに属するものとしてタグ付け / ****データ入力形式**:** テキスト / ****組み込みアルゴリズム**:** [潜在的ディリクレ配分 (LDA) アルゴリズム](lda.md), [ニューラルトピックモデル (NTM) アルゴリズム](ntm.md)

- ** [テキスト分析](#algorithms-built-in-text-analysis) **
  - ****問題タイプ**:** テキスト分類  / ****問題とユースケース例**:** コーパス内のドキュメントに事前定義されたカテゴリを割り当てる: ライブラリ内の書籍を学問分野別に分類 / ****データ入力形式**:** テキスト / ****組み込みアルゴリズム**:** [BlazingText アルゴリズム](blazingtext.md), [テキスト分類 - TensorFlow](text-classification-tensorflow.md)
  - ****問題タイプ**:** 機械翻訳アルゴリズム / ****問題とユースケース例**:** ある言語から別の言語にテキストを変換する: スペイン語から英語 / ****データ入力形式**:** テキスト / ****組み込みアルゴリズム**:** [Sequence to Sequence アルゴリズム](seq-2-seq.md)
  - ****問題タイプ**:** テキスト要約 / ****問題とユースケース例**:** 長いテキストコーパスを要約する: 研究論文の要約 / ****データ入力形式**:** テキスト / ****組み込みアルゴリズム**:** [Sequence to Sequence アルゴリズム](seq-2-seq.md)
  - ****問題タイプ**:** 音声をテキストに / ****問題とユースケース例**:** オーディオファイルをテキストに変換する: コールセンターの会話を書き起こしてさらに分析 / ****データ入力形式**:** テキスト / ****組み込みアルゴリズム**:** [Sequence to Sequence アルゴリズム](seq-2-seq.md)

- **[画像処理](#algorithms-built-in-image-processing)**
  - ****問題タイプ**:** イメージおよびマルチラベル分類 / ****問題とユースケース例**:** イメージのコンテンツに基づいてイメージにラベル/タグを付ける: イメージ内のアダルトコンテンツに関するアラート / ****データ入力形式**:** 画像 / ****組み込みアルゴリズム**:** [画像分類 - MXNet](image-classification.md)
  - ****問題タイプ**:** イメージ分類 / ****問題とユースケース例**:** 転移学習を使用して画像内の何かを分類します。 / ****データ入力形式**:** 画像 / ****組み込みアルゴリズム**:** [画像分類 - TensorFlow](image-classification-tensorflow.md)
  - ****問題タイプ**:** オブジェクトの検出と分類 / ****問題とユースケース例**:** イメージ内の人や物体を検出する: 警察が行方不明の人物について大きなフォトギャラリーをレビュー / ****データ入力形式**:** 画像 / ****組み込みアルゴリズム**:** [オブジェクト検出 - MXNet](object-detection.md), [オブジェクト検出 - TensorFlow](object-detection-tensorflow.md)
  - ****問題タイプ**:** コンピュータビジョン / ****問題とユースケース例**:** 画像のすべてのピクセルにカテゴリを個別にタグ付けする: 自動運転車が道中で物体を識別する準備を整える / ****データ入力形式**:** 画像 / ****組み込みアルゴリズム**:** [セマンティックセグメンテーションアルゴリズム](semantic-segmentation.md)



SageMaker AI が提供するすべての組み込みアルゴリズムに共通する以下の項目の重要な情報については、「[組み込みアルゴリズムのパラメータ](common-info-all-im-models.md)」を参照してください。
+ Docker レジストリパス
+ データ形式
+ 推奨される Amazon EC2 インスタンスタイプ
+ CloudWatch ログ

次のセクションでは、属している教師あり学習パラダイムと教師なし学習パラダイム別にグループ化された Amazon SageMaker AI 組み込みアルゴリズムに関する追加のガイダンスを示します。これらの学習パラダイムとそれに関連する問題タイプの詳細については、「[アルゴリズムのタイプ](algorithms-choose.md)」を参照してください。また、テキスト解析と画像処理という 2 つの重要な機械学習ドメインに対処するために使用できる SageMaker AI 組み込みアルゴリズムに関するセクションも用意されています。
+ [事前トレーニング済みモデルとソリューションテンプレート](#algorithms-built-in-jumpstart)
+ [教師あり学習](#algorithms-built-in-supervised-learning)
+ [教師なし学習](#algorithms-built-in-unsupervised-learning)
+ [テキスト分析](#algorithms-built-in-text-analysis)
+ [画像処理](#algorithms-built-in-image-processing)

## 事前トレーニング済みモデルとソリューションテンプレート
<a name="algorithms-built-in-jumpstart"></a>

Amazon SageMaker JumpStart は、トレーニング済みのさまざまなモデル、構築済みのソリューションテンプレート、一般的な問題タイプの例を提供します。これらは SageMaker SDK と Studio Classic を使用します。Amazon SageMaker JumpStart が提供するモデル、ソリューション、サンプルノートブックの詳細については、「」を参照してください[SageMaker JumpStart の事前トレーニング済みモデル](studio-jumpstart.md)。

## 教師あり学習
<a name="algorithms-built-in-supervised-learning"></a>

Amazon SageMaker AI には、分類問題または回帰問題に使用できる組み込みの汎用アルゴリズムがいくつか用意されています。
+ [AutoGluon-Tabular](autogluon-tabular.md) — モデルをアンサンブルして複数のレイヤーに積み重ねることで成功するオープンソースの AutoML フレームワーク。
+ [CatBoost](catboost.md) - 順序付けされたブースティングとカテゴリ別機能を処理するための革新的なアルゴリズムを導入する勾配ブーストツリーアルゴリズムの実装。
+ [因数分解機アルゴリズム](fact-machines.md) - 高次元スパースデータセット内の特徴間の相互作用を経済的にキャプチャするように設計された線形モデルの拡張。
+ [K 最近傍 (k-NN) アルゴリズム](k-nearest-neighbors.md) — K 個の最も近いラベル付きポイントを使用して値を割り当てるノンパラメトリック手法。分類の場合は、新しいデータポイントに対するラベルとなり、リグレッションの場合は、K 個の最も近いポイントの平均から予測されるターゲット値となります。
+ [LightGBM](lightgbm.md) — 効率とスケーラビリティを向上させるための 2 つの新しい技法を追加した勾配ブーストツリーアルゴリズムの実装。2 つの新しい技法は、Gradient-based One-Side Sampling (GOSS) と Exclusive Feature Bundling (EFB) です。
+ [線形学習アルゴリズム](linear-learner.md) - 回帰の線形関数または分類の線形しきい値関数を学習します。
+ [TabTransformer](tabtransformer.md) — セルフアテンションベースの Transformers で構築された、新しい深層表形式データモデル化アーキテクチャ。
+ [Amazon SageMaker AI の XGBoost アルゴリズム](xgboost.md) - より単純で弱いモデルのセットから推定のアンサンブルを組み合わせる勾配ブーストツリーアルゴリズムの実装。

Amazon SageMaker AI には、時系列データからの特徴量エンジニアリングおよび予測時のより特殊なタスクに使用される、教師あり学習アルゴリズムもいくつか組み込まれています。
+ [Object2Vec アルゴリズム](object2vec.md) — 特徴量エンジニアリングに使用される新しい高度にカスタマイズ可能な汎用アルゴリズム。高次元オブジェクトの低次元高密度埋め込みを学習して、下流モデルのトレーニング効率を向上する特徴を生成できます。教師ありアルゴリズムではあるものの、データ内の自然なクラスタリングから関係ラベルを単純に取得できるシナリオが多数あります。トレーニングのためにラベル付きデータが必要ですが、人間による明示的な注釈なしの学習が可能です。
+ [SageMaker AI DeepAR 予測アルゴリズムを使用する](deepar.md) - 予測アルゴリズムは、再帰型ニューラルネットワーク (RNN) を使用してスカラー (1 次元) 時系列を予測する教師あり学習アルゴリズム。

## 教師なし学習
<a name="algorithms-built-in-unsupervised-learning"></a>

Amazon SageMaker AI には、多様な教師なし学習タスクに使用できる組み込みアルゴリズムがいくつか用意されています。これらのタスクには、クラスタリング、次元削減、パターン認識、異常検出などが含まれます。
+ [主成分分析法 (PCA) アルゴリズム](pca.md) - データポイントを最初のいくつかの主成分に射影することにより、データセット内の次元 (特徴の数) を縮退させます。目的は、できるだけ多くの情報やバリエーションを保持することです。数学者の場合、主成分はデータの共分散行列の固有ベクトルです。
+ [K-Means アルゴリズム](k-means.md) — データ内にある離散グループを検出します。同一グループのメンバーができるだけ類似し、かつ他のグループのメンバーとできるだけ異なるものを特定します。
+ [IP Insights](ip-insights.md) - IPv4 アドレスの使用パターンを学習します。このアルゴリズムは、IPv4 アドレスと、ユーザー ID やアカウント番号などの各種エンティティとの間の関連付けをキャプチャするように設計されています。
+ [ランダムカットフォレスト (RCF) アルゴリズム](randomcutforest.md) - その他の高度に構造化またはパターン化されたデータとは異なるデータセット内の異常なデータポイントを検出します。

## テキスト分析
<a name="algorithms-built-in-text-analysis"></a>

SageMaker AI は、テキスト文書の分析用に調整されたアルゴリズムを提供しています。対象となるのは、自然言語処理、文書の分類または要約、トピックのモデリングまたは分類、言語の文字起こしまたは翻訳で使用されるテキストです。
+ [BlazingText アルゴリズム](blazingtext.md) - 大規模なデータセットに簡単に拡張できる Word2vec とテキスト分類アルゴリズムの高度に最適化された実装。これは、多くの下流の自然言語処理 (NLP) タスクに役立ちます。
+ [Sequence to Sequence アルゴリズム](seq-2-seq.md) - 一般的にニューラル機械翻訳に使用される教師ありアルゴリズム。
+ [潜在的ディリクレ配分 (LDA) アルゴリズム](lda.md) - 一連のドキュメントのトピックを決定するのに適しているアルゴリズム。これは *教師なしアルゴリズム*です。つまり、トレーニング時に回答を含むサンプルデータを使用しないということです。
+ [ニューラルトピックモデル (NTM) アルゴリズム](ntm.md) - ニューラルネットワークアプローチを使用して一連のドキュメントのトピックを決定する別の教師なし手法。
+ [テキスト分類 - TensorFlow](text-classification-tensorflow.md) — テキスト分類用のトレーニング済みモデルを使用して転移学習をサポートする教師ありアルゴリズム。

## 画像処理
<a name="algorithms-built-in-image-processing"></a>

SageMaker AI は、イメージ分類、オブジェクト検出、コンピュータビジョンに使用される画像処理アルゴリズムも提供しています。
+ [画像分類 - MXNet](image-classification.md) - 回答を含むサンプルデータを使用します (教師ありアルゴリズムと呼ばれる)。** このアルゴリズムを使用してイメージを分類します。
+ [画像分類 - TensorFlow](image-classification-tensorflow.md) — トレーニング済 TensorFlow Hub モデルを使用して、特定のタスクに合わせて微調整します (教師ありアルゴリズムと呼ばれる)。 このアルゴリズムを使用してイメージを分類します。
+ [セマンティックセグメンテーションアルゴリズム](semantic-segmentation.md) - コンピュータビジョンアプリケーション開発のためのピクセルレベルのきめ細かいアプローチを提供します。
+ [オブジェクト検出 - MXNet](object-detection.md) — 1 つの深層ニューラルネットワークを使用して、イメージ内のオブジェクトを検出および分類します。このアルゴリズムは、入力としてイメージを取得し、イメージシーン内のオブジェクトのすべてのインスタンスを識別する、教師あり学習アルゴリズムです。
+ [オブジェクト検出 - TensorFlow](object-detection-tensorflow.md) — 画像内の境界ボックスとオブジェクトラベルを検出します。これは教師あり学習アルゴリズムで、利用可能なトレーニング済み TensorFlow モデルによる転移学習をサポートします。

**Topics**
+ [事前トレーニング済みモデルとソリューションテンプレート](#algorithms-built-in-jumpstart)
+ [教師あり学習](#algorithms-built-in-supervised-learning)
+ [教師なし学習](#algorithms-built-in-unsupervised-learning)
+ [テキスト分析](#algorithms-built-in-text-analysis)
+ [画像処理](#algorithms-built-in-image-processing)
+ [組み込みアルゴリズムのパラメータ](common-info-all-im-models.md)
+ [表形式データ用の組み込みの SageMaker AI アルゴリズム](algorithms-tabular.md)
+ [テキストデータ用の組み込み SageMaker AI アルゴリズム](algorithms-text.md)
+ [時系列データ用の組み込み SageMaker AI アルゴリズム](algorithms-time-series.md)
+ [教師なし組み込み SageMaker AI アルゴリズム](algorithms-unsupervised.md)
+ [コンピュータビジョン用の組み込み SageMaker AI アルゴリズム](algorithms-vision.md)