Phase 4 · 10 min
Machine learning vocabulary
Terms you will see in every spec
Japanese ML teams mix kanji compounds with katakana loanwords. Learn both: 機械学習 and マシンラーニング are both used, but 機械学習 appears in documents.
Pattern
Most of these compounds are two 2-kanji words glued together. 精度 (accuracy) + 検証 (validation) = 精度検証. 異常 (abnormal) + 検知 (detection) = 異常検知. Once you know 20 building blocks you can read hundreds of terms.
| 機械学習 | きかいがくしゅうkikaigakushuu | machine learning |
| 深層学習 | しんそうがくしゅうshinsougakushuu | deep learning |
| 精度検証 | せいどけんしょうseidokenshou | accuracy validation |
| 特徴量エンジニアリング | とくちょうりょう〜tokuchouryou〜 | feature engineering |
| 異常検知 | いじょうけんちijoukenchi | anomaly detection |
| 学習データ | がくしゅうデータgakushuudēta | training data |
| 検証データ | けんしょうデータkenshoudēta | validation data |
| 過学習 | かがくしゅうkagakushuu | overfitting |
| 推論 | すいろんsuiron | inference |
| 前処理 | まえしょりmaeshori | preprocessing |
| 欠損値 | けっそんちkessonchi | missing values |
| 予測 | よそくyosoku | prediction |
| 分類 | ぶんるいbunrui | classification |
| 回帰 | かいきkaiki | regression |
| 本番環境 | ほんばんかんきょうhonbankankyou | production environment |
特徴量エンジニアリングで精度が3%上がりました。
とくちょうりょう エンジニアリング で せいど が さん パーセント あがりました
tokuchouryou enjiniaringu de seido ga san pāsento agarimashita
Accuracy went up 3% through feature engineering.
異常検知モデルを本番環境にデプロイしました。
いじょうけんち モデル を ほんばんかんきょう に デプロイ しました
ijoukenchi moderu o honbankankyou ni depuroi shimashita
We deployed the anomaly detection model to production.
過学習を防ぐために、検証データで精度検証を行います。
かがくしゅう を ふせぐ ために、けんしょう データ で せいどけんしょう を おこないます
kagakushuu o fusegu tameni, kenshou dēta de seidokenshou o okonaimasu
To prevent overfitting, we run accuracy validation on validation data.
Check yourself
1 / 6
回帰
13 cards
Add them to spaced repetition
Cards in this lesson (13)
機械学習きかいがくしゅう
kikaigakushuu
machine learning
深層学習しんそうがくしゅう
shinsougakushuu
deep learning
精度検証せいどけんしょう
seidokenshou
accuracy validation
特徴量エンジニアリングとくちょうりょうエンジニアリング
tokuchouryouenjiniaringu
feature engineering
異常検知いじょうけんち
ijoukenchi
anomaly detection
学習データがくしゅうデータ
gakushuudēta
training data
過学習かがくしゅう
kagakushuu
overfitting
推論すいろん
suiron
inference
前処理まえしょり
maeshori
preprocessing
欠損値けっそんち
kessonchi
missing values
分類ぶんるい
bunrui
classification
回帰かいき
kaiki
regression
本番環境ほんばんかんきょう
honbankankyou
production environment