当サイトではアフィリエイトプログラムを利用して商品を紹介しています。掲載リンクからご購入いただいた場合、当サイトに報酬が発生することがあります。

AI翻訳を副業にする|無料版で扱えないものと、機械翻訳が崩れる6か所

辞書とノートパソコンを並べた机の上

翻訳は、AIで最も精度が上がった作業のひとつです。数年前とは別物と言っていい水準になりました。

ただ、副業として受けるとなると、話が変わります。機械翻訳の出力をそのまま納品できる場面は、ほとんどありません。そして、直すべき箇所には共通の型があります。

この記事では、まず無料版では扱ってはいけないものを確認します。ここを知らずに受けると、規約違反になります。そのうえで、機械翻訳が崩れる箇所と、直す順番を書きます。

※本記事の各サービスの仕様・規約は公式ページで確認したものです。改定されることがあるため、実際に使う前にご自身で最新の内容をご確認ください。


先に確認:無料版で扱ってはいけないもの

ここを最初に書きます。作業の話より先です。

個人データを含むテキストは、無料版では翻訳できない

DeepLの個人情報保護方針には、こう明記されています。

利用規約に基づき、DeepL翻訳またはDeepL Writeを、個人データの含まれるテキストの翻訳や推敲などに使用することはできません。個人データを含むテキストの翻訳や推敲はDeepL Proのプランにご登録されている場合に限って可能です

出典: DeepLの個人情報保護方針

読み飛ばせない一文です。無料版では、個人データを含むテキストは翻訳できません。これは「推奨しない」ではなく、規約に基づく制限として書かれています。

副業の翻訳案件は、たいてい個人データが入る

よくある案件 入っている個人データ
メールの翻訳 差出人・宛先の氏名、メールアドレス、社名
契約書・見積書 担当者名、住所、連絡先
顧客からの問い合わせ 氏名、購入履歴、連絡先
レビューや口コミの翻訳 投稿者名、投稿内容に含まれる個人の情報
取材記事・インタビュー 話者の氏名、所属

ほとんど入っています。「個人データが入っていない翻訳案件」のほうが少ないと考えたほうが実態に近いです。

無料版の入力は、訓練に使われると書かれている

同じ方針には、無料版のテキストの扱いについてもこう書かれています。

当社では、ニューラルネットワークと翻訳アルゴリズムの訓練および性能向上を目的として、入力済みのテキストおよびアップロード済みの文書ファイルとそれぞれの訳文やテキストの推敲内容を一定期間保存します。

依頼主から預かった文書を無料版に入れると、依頼主が知らないうちに第三者のサービスに保存され、訓練に使われることになります。

これは規約の話であると同時に、生成AIの規約違反になりやすい使い方で書いた「③ 他人の情報を、断りなく渡す」に当たります。

有料版で何が変わるか

公式の料金ページには、個人向けプランについてこう記載されています(ユーロ表示)。

項目 Individualプランの記載
データの扱い データの訓練に使用されない
翻訳できる文字数 1か月に300,000文字まで
ファイル翻訳 1か月に3件
訳文の保存 1件

出典: DeepL Pro 料金ページ

「データの訓練に使用されない」がいちばん大きい違いです。翻訳を副業として受けるなら、ここは費用ではなく前提条件として考えてください。

なお、他の翻訳サービスやAIツールでも、無料版と有料版でデータの扱いが違うことがあります。使うサービスごとに確認してください。確認の観点はAIの無料枠でどこまで副業できるかにまとめました。

機械翻訳が崩れる6か所

ここから作業の話です。出力を読むとき、次の6か所を優先して見ると速く終わります。

崩れるのは、だいたいこの6か所 全文を読み直すより、ここを先に見るほうが速い ① 固有名詞・専門用語 勝手に訳される。社名が一般名詞になる ② 敬語・丁寧さの度合い 英語に敬語がない。訳すと平板になる ③ 主語の補い方 日本語は主語を省く。入れると不自然になる ④ 数字・単位・日付の形式 桁区切り、通貨、日付の順序が国で違う ⑤ 同じ語の訳ぶれ 前半と後半で違う訳語になる ⑥ 否定・条件の係り方 「〜でなければ」がどこにかかるか 直す順番 1. 用語集を作って、①を一括で置換する(最初にやると後が楽) 2. ④の数字と日付を、原文と1つずつ照合する 3. ⑥の否定と条件を、意味が逆になっていないか確認する 4. ②③⑤を、通して読みながら整える(ここは最後)

① 固有名詞・専門用語

社名、製品名、部署名、業界用語。これらは訳してはいけないのに訳されることがあります。

対策は用語集です。DeepLの有料プランには用語集の機能がありますが、無料版でも回避策があります。同じ方針にこう書かれています。

DeepLのアカウントを作成せずに当社の無料サービス内の用語集機能を利用し、特定の用語のペアを入力した場合、このデータはローカルにのみ保存され、DeepLには転送されません。

ただし、そのぶん別のブラウザやデバイスでは使えないとも書かれています。複数の端末で作業するなら、この点を踏まえて設計してください。

② 敬語・丁寧さの度合い

英語から日本語に訳すとき、いちばん手が入るところです。英語には日本語のような敬語の体系がないので、どの丁寧さで訳すかは訳者が決めることになります。

これは機械が判断できません。だから、依頼を受ける段階で確認します。

  • 誰が読むのか(社内/取引先/一般の顧客)
  • 既存の訳文があるか(あれば、その文体に合わせる)
  • 「です・ます」か「だ・である」か

この3つを聞いておくと、直しの回数が大きく減ります。

③ 主語の補い方

日本語は主語を省く言語です。機械翻訳は英語の主語をそのまま訳すので、「私は」「あなたは」が過剰に入ります。

読んで不自然なところを削るだけですが、削りすぎると意味が変わることがあります。「誰が」が文脈から分かるかを確認しながら削ってください。

④ 数字・単位・日付の形式

ここは事故が起きやすく、そして気づかれにくい箇所です。

項目 気をつける点
日付 「03/04」が3月4日か4月3日か、国によって違う
桁区切り 小数点とカンマの使い方が逆の国がある
通貨 金額だけ訳されて通貨記号が消えることがある
単位 換算するのか、原文のまま残すのかを確認する
時刻 時差の扱い。原文が現地時間かどうか

4つめは、勝手に換算しないでください。換算するかどうかは依頼主が決めることです。確認せずに換算すると、意図しない情報の改変になります。

⑤ 同じ語の訳ぶれ

長い文書だと、同じ英単語が前半と後半で違う日本語になることがあります。1文ずつ見ていると気づきません。

対策は、訳し終わったあとに検索することです。用語集に入れた語を、訳文の中で検索して、全部同じ訳語になっているかを見る。数十秒で終わります。

⑥ 否定・条件の係り方

これがいちばん重い事故につながります。意味が逆になるからです。

「AでなければBする」「AとBの両方が揃わなければCしない」といった文は、係り方を取り違えると正反対の内容になります。契約書や手順書で起きると、実害が出ます。

対策は単純で、否定語と条件の接続詞が出てきたら、原文と突き合わせることです。全文ではなく、その文だけでいい。

受注前に確認する5項目

翻訳の案件は、始めてから条件が判明すると手戻りが大きくなります。この5つを先に聞いてください。

# 確認すること これで変わるもの
① 個人データを含むか 使えるプランが変わる(無料版では扱えない)
② 誰が読むか(社内/取引先/一般) 文体と敬語の度合い
③ 既存の訳文や用語集はあるか 用語集を作る時間(15分→5分)
④ 単位や通貨を換算するか 換算は勝手にやらない。依頼主の判断
⑤ 納品形式の指定はあるか レイアウト保持だと作業時間が大きく変わる

①がこの記事でいちばん重い項目です。「個人データが入っていますか」ではなく、「氏名・連絡先・社名などが含まれますか」と具体的に聞いてください。抽象的に聞くと「特に入っていません」と返ってきて、実際には署名欄に入っていた、ということが起きます。

聞き方の例

お引き受けにあたり、5点だけ確認させてください。
1. 原文に氏名・連絡先・社名などが含まれますか
2. 想定される読み手はどなたでしょうか(社内/取引先/一般の方)
3. 既存の訳文や、統一したい用語のリストはありますか
4. 単位や通貨は、換算せず原文のまま残す形でよろしいでしょうか
5. 納品の形式にご指定はありますか

5点なら、相手の負担にもなりません。そして、この5点が埋まると見積もりの精度が大きく上がります。

1件にかかる時間

英日翻訳で、A4で3ページ程度の一般的な文書を想定した目安です。専門性と原文の状態で大きく変わります。

工程 時間
依頼内容の確認(読者・文体・用語) 10分
用語集を作る 15分(リストをもらえれば5分)
機械翻訳にかける 2分
① 固有名詞の一括置換 5分
④ 数字・日付の照合 15分
⑥ 否定・条件の確認 10分
②③⑤ 通して読んで整える 45分
納品前チェック 10分
合計 約1時間52分

機械翻訳にかける時間は2分です。残りの1時間50分が、人の作業です。

「AIで翻訳すれば一瞬」という前提で受けると、この1時間50分が想定外の時間になります。見積もりには必ず入れてください。

用語集の作り方と、使い回し方

翻訳の作業時間を最も減らすのが用語集です。作り方に手順があります。

最初は10語で足りる

完璧なものを先に作ろうとしないでください。作業しながら追加していくほうが速く終わります。

最初に入れるのは、この4種類から10語程度です。

種類 例 入れる理由
社名・製品名 会社の正式名称、サービス名 訳されると別物になる
部署名・役職名 組織の呼称 会社ごとに訳し方が違う
業界の専門用語 その分野の定訳がある語 一般的な訳語だと意味が変わる
依頼主が使っている言い回し 既存の資料で使われている表現 統一感が出る

4つめが見落とされがちです。依頼主のサイトや既存の資料を1つ見るだけで、使うべき言い回しが分かります。

作った用語集は、依頼主に共有する

納品と一緒に渡してください。効果が3つあります。

  1. 修正の往復が減る。「この訳語で統一しています」と示せる
  2. 次回の案件で使える。依頼主側も同じ語を使うようになる
  3. 判断を共有できる。迷った語について、次回は聞かなくて済む

案件ごとにファイルを分ける

1つのファイルに全部入れると、別の依頼主の用語が混ざります。業界が違えば定訳も違うので、混ざると事故になります。

案件ごと、または依頼主ごとにファイルを分けてください。そして、ファイル名に依頼主名と日付を入れておくと、後から探せます。

やってはいけない3つ

① 原文を確認せずに納品する

機械翻訳の出力は、読むと自然です。だから、原文を見ずに日本語だけ読むと、間違いに気づきません。

特に⑥の否定と条件は、日本語として自然なまま意味が逆になります。自然さは、正しさの証拠になりません。

② 原文にない情報を足す

読みやすくしようとして、説明を補いたくなることがあります。これは翻訳ではありません。

どうしても補足が必要なら、訳注として分けて書き、依頼主に判断してもらってください。本文に溶かし込まないでください。

③ 訳せない箇所を、それらしく埋める

原文が曖昧だったり、前提知識がないと訳せない箇所は必ず出ます。ここでそれらしい日本語を当ててはいけません。

正しい対処は、確認することです。

3ページ12行目の「the service will be updated accordingly」について、2通りの解釈が可能でした。「サービス側が自動的に更新される」のか「利用者が更新の手続きをする」のか、ご確認いただけますでしょうか。現在は前者で訳しています。

この質問ができるかどうかが、機械翻訳との差です。機械は迷わずに埋めます。人は迷ったことを伝えられます。

AI利用を、どう伝えるか

翻訳の案件では、機械翻訳の使用について依頼主の考えが分かれます。応募の段階で書いてください。

作業の効率化のため、機械翻訳を下訳として使用します。訳文は全文を原文と照合し、用語の統一・数字の確認・文体の調整を行ったうえで納品します。機械翻訳の使用に制限がある場合は、この段階でお知らせください。

「使いません」と言うより、「どこに使って、どこを人がやるか」を書くほうが伝わります。下訳として使うことと、そのまま出すことは、まったく違う作業だからです。

そして、個人データを含む文書を扱う場合は、有料プランを使っている旨も添えてください。前述のとおり、無料版では規約上できません。

まとめ

AI翻訳を副業にするときの要点は3つです。

  1. 無料版では、個人データを含むテキストは翻訳できない。DeepLの方針に「DeepL Proのプランにご登録されている場合に限って可能」と明記されています。そして無料版の入力は訓練に使われると書かれています。副業の翻訳案件はほとんど個人データを含むので、有料は費用ではなく前提条件です
  2. 崩れるのは6か所。固有名詞/敬語の度合い/主語の補い方/数字と日付/訳ぶれ/否定と条件。この順で優先度が変わり、⑥の否定と条件がいちばん重い事故につながります
  3. 機械翻訳にかける時間は2分、人の作業が1時間50分。「AIで一瞬」という前提で見積もると足りません

そして、やってはいけないのは3つ。原文を確認せずに納品する。原文にない情報を足す。訳せない箇所をそれらしく埋める。

機械は迷わずに埋めます。人は迷ったことを伝えられます。ここが、いま人に頼む理由になっている部分です。

よくある質問

DeepL以外のサービスなら、無料でも個人データを扱えますか?

サービスごとに違うので、一律には言えません。確認すべきなのは、①入力したデータが訓練に使われるか、②保存期間はどれくらいか、③規約上の制限があるか、の3点です。「訓練に使われない」と明記されているかどうかが、いちばん分かりやすい基準になります。この記事で挙げたのは1社の例で、確認日も明記しています。使うサービスのものをご自身で確認してください。

用語集は、どこまで作り込めばいいですか?

最初は10語で足ります。社名、製品名、部署名、頻出する専門用語。作業しながら追加していくほうが、先に完璧なものを作ろうとするより速く終わります。そして、作った用語集は依頼主にも共有してください。「この訳語で統一しています」と示せると、修正の往復が減ります。次回の案件でもそのまま使えます。

日英翻訳(日本語から英語)でも同じですか?

崩れる箇所の種類が変わります。日英では、主語の補い方(日本語で省かれた主語を英語で決める必要がある)と、敬語をどう表現するかが中心になります。特に前者は、原文に書かれていない情報を訳者が判断して補うことになるので、確認が必要な箇所が増えます。この記事は英日を前提に書きました。

納品形式に指定があるとき、どうしますか?

受注前に確認してください。原文と訳文を並べる形式、原文のレイアウトを保持する形式、テキストのみ、など指定があります。レイアウト保持の指定があると、作業時間が大きく変わります。ファイル翻訳の機能には回数の上限があることもあるので、プランの制限も併せて確認してください。

「機械翻訳禁止」の案件は受けられませんか?

その指定がある案件では、使わないでください。隠して使うのがいちばん問題です。ただ、「機械翻訳の出力をそのまま納品しない」という意味で書かれている場合もあります。募集文が曖昧なら、応募時に「下訳として使用し、全文を照合したうえで納品する形は可能でしょうか」と確認してください。それで判断がつきます。

翻訳の単価はどれくらいですか?

この記事では金額に触れません。言語のペア、分野、分量、納期で大きく変わり、一律の目安が意味を持たないからです。代わりに提案できるのは、この記事の工程表で自分の時間を測ることです。1件にかかる実時間が分かれば、提示された条件が自分にとって成立するかを判断できます。

受ける前に、データの扱いを確認する

個人データを含む文書を扱えるかどうかは、プランで変わります。プライバシー方針に書かれている条件を、一度ご自身で確認してください。

個人情報保護方針の例を見る

上部へスクロール