TikTok Shop の商品動画を AI で作るとき、映像そのものは商品を映しても崩れません。化粧品のボトルを手に持たせても、蓋を開けさせても、容器の形も素材も 15 秒のあいだ変わりませんでした。それでも商品カットを AI に任せきれない理由は、映像が破綻するからではなく、そこに映っているのが実在する自社商品ではないからです。TikTok Shop の販売者向け公式ドキュメント「AI 生成コンテンツ(AIGC)の解説」は、AI 生成コンテンツを「実際の商品情報のみを使用し、実際の商品画像およびセラーが提供する素材に基づかなければならない」と定めているからです。
AI 動画の弱点としてよく語られるのは「途中で商品が別物に変わる」という話です。今回はそれが本当に起きるのかを、ブラウザでの再生ではなくファイルからフレームを抜き出して 1 秒ずつ並べて確かめました。結果として、その破綻は起きていません。だとすれば次に決めるべきは、作り方ではなくどこまでを AI に渡してよいのかの線引きのほうです。
この記事では、AI 動画生成ツール DomoAI で 15 秒・縦 9:16・720P の動画を 4 本作り、商品を映したもの・映さないもの・服を着せたもの・開封させたものを比べます。そのうえで、実測の結果を TikTok Shop の公式規定と突き合わせて、カテゴリごとの可否を表にします。プロンプトの書き方そのものは AI 動画生成は指示の出し方で 9 割決まる で 6 本検証しているので、本記事は「何を任せてよいか」の判断だけを扱います。検証したのはテキストから動画を作る方式で、実際の商品写真を起点にする方式については未検証の仮説を後半に添えました。検証日は 2026 年 9 月 2 日です。
TikTok Shop は AI 動画を禁止していない。禁じているのは「商品を変えること」
まず前提を正しておきます。TikTok Shop は AI 生成コンテンツの利用を認めています。禁止しているのは AI を使うことではなく、AI を使って商品を実物と違うものに見せることです。公式ドキュメントは、AI 生成コンテンツを作る際に「実際の商品情報のみを使用し、実際の商品画像およびセラーが提供する素材に基づかなければならない」と定めています。
商品の見え方について、禁止事項は具体的に書かれています。
- 商品の属性を改変すること(実際よりも大きく/小さく見せる、パッケージを実際とは異なるものに見せるなど)
- 実際には備わっていない機能や特徴を作り出すこと
- 本来は平面(2D)の商品を立体的(3D)な商品であるかのように見せること
この記事の結論を先に言うと、1 つ目の「パッケージを実際とは異なるものに見せる」が、テキストから動画を作る AI にとって避けがたい挙動そのものでした。意図して盛るのではなく、10 秒を超えたあたりから勝手にそうなります。
AI で作ったことの開示は必須
公式ドキュメントは「AI を使用していることを明確に表示する必要があります」としています。方法は 2 通りで、コンテンツ内にテキスト・透かし・ステッカーで表記するか、投稿時にプラットフォーム側の「AI 生成コンテンツ」スイッチをオンにするかです。
加えて、TikTok 側が自動でラベルを付ける場合があります。公式は「特定の AI 生成コンテンツが自動的に識別され、ラベルが付与される場合があります」と述べており、この自動ラベルは削除できませんが、それ自体はペナルティの対象ではありません。つまり、隠そうとしなければ自動ラベルは怖いものではない、という設計になっています。
開示しても許されないもの
開示すれば何でも通るわけではありません。公式が挙げている禁止対象のうち、開示していても禁止と明記されているものがあります。
| 対象 | 公式の記載 |
|---|---|
| 有名人・医療専門家・政治家・公人 | 音声を含め、商品の宣伝・販促に用いることは、AI 生成コンテンツとして適切に開示されている場合であっても禁止 |
| 医師・医療従事者のなりすまし | 医療的・専門的な資格があるかのように誤って示唆する AI 生成のアバター・音声・人物像で、商品や医療的な効能を宣伝してはならない |
| 公的機関のなりすまし | 政府・法執行機関による推奨があるかのように誤って示唆する AI 生成のアバター・音声・人物像を使用しない |
| ディープフェイク | 厳しく禁止 |
「AI で作った医師風の人物に効能を語らせる」は、開示の有無にかかわらず出口がありません。ここは工夫の余地がない領域だと理解しておくのが早いです。
検証の条件をそろえる
比較の意味を持たせるため、4 本すべて同じ条件で生成しました。ツールは DomoAI、モデルは音声とマルチショットに対応した Seedance 2.0 です。あえて上位モデルを選びました。破綻したときに「モデルが弱かっただけ」と言い逃れできないようにするためです。
| 項目 | 設定 |
|---|---|
| 生成方式 | テキストから動画 |
| モデル | Seedance 2.0 |
| 尺 | 15 秒(このモデルの上限) |
| 縦横比 | 9:16 |
| 解像度 | 720P |
| 音声 | オン |
題材は 4 つに分けました。商品名は実在ブランドと衝突しないよう、架空の「AQUABASE」に統一しています。
| 本数 | 題材 | 何を見たいか |
|---|---|---|
| 1 本目 | アパレル(服のモデルカット) | 人物と衣服が 15 秒保つか |
| 2 本目 | 商品を持って静止 | ラベルと容器が保つか |
| 3 本目 | 商品を開封して中身を見せる | 状態変化をまたいで商品が同一か |
| 4 本目 | 商品を映さない世界観カット | ナレーションとテロップが入るか |
判定はすべて、ブラウザ上ではなくダウンロードしたファイルから行っています。動画の検証をブラウザのシークで済ませると表示フレームがずれて誤判定する、というのは前回の検証で実際にやらかした失敗です。無料枠でどこまで作れるかを比べた 生成 AI で写真から動画を作る もあわせてどうぞ。
服は成立する — 1 回転までそのまま通った
先に、いちばん結果が良かったものから出します。アパレルです。「正面を向く → ゆっくり 1 回転して背面を見せる → 正面に戻る」と指示しました。
指示がそのまま完遂されました。正面 → 側面 → 背面 → 側面 → 正面と回り、リネンシャツの胸ポケット、前立てのボタン、裾のスリット、ワイドパンツのドレープが 15 秒間ぶれません。TikTok Shop のアパレル動画として、そのまま使える水準です。
なぜ服だけうまくいくのか。理由ははっきりしています。服には「崩れた」と判定できる基準が画面の中に無いからです。文字も、ロゴも、決まった形の容器もありません。リネンのしわは 1 秒ごとに変わって当然のものなので、変わっても誰も破綻と感じません。逆に言えば、プリント T シャツのように文字や柄が入った服は同じようにはいかないと考えるべきです。今回はプロンプトで「服に文字・ロゴ・プリントを入れない」と明示しています。
TikTok Shop 自身が用意している AI 動画機能が、まずファッション向けとして提供されているのも、おそらく同じ理由です。アパレルは AI 動画が成立する数少ないカテゴリなので、そこから始めるのは理にかなっています。
商品を持たせて静止させても、容器は 15 秒保った
次に、化粧品を想定した白いボトルを手に持たせました。ラベルには「AQUABASE」の 1 行だけを入れる指定です。
良かった点から。容器の形も「AQUABASE」の綴りも、15 秒間そのまま保たれました。0 秒と 15 秒のフレームを並べても、ボトルの輪郭・キャップの比率・ラベルの位置は変わりません。AI 動画は文字が苦手というのは広く知られた弱点ですが、短い単語をラベルに 1 つ置くだけなら通ります。
問題は 1 つだけ出ました。指定していない 2 行目が勝手に生えたことです。ラベルの下部に、判読できないダミーの文字列が 2 行分現れました。プロンプトには「1 行の黒いテキスト」と書いています。実物のラベルに無い文字が付く以上、これはそれだけで「パッケージを実際とは異なるものに見せる」に当たり得ます。容器が崩れなくても、拡大して文字を確認する工程は省けません。
正直に書いておくと、この 1 本にはこちらのプロンプトに落ち度もありました。「ラベルが常にレンズを向くように、ゆっくり回転させる」と書いたのですが、これは両立しない指示です。回せばラベルは向こうへ行きます。モデルは矛盾を「回さない」で解決しました。したがってこの動画の「回転しなかった」という結果は、モデルの限界の証拠としては使えません。矛盾した指示を出すと安全側に倒れる、という別の教訓です。
開封させても、容器は同じ容器のままだった
ここが本題です。商品紹介の動画で最も多い型は、静止して見せることではなく開封して中身を見せることです。状態が変わるぶん、容器が崩れるとすればここです。蓋を回して外し、瓶を傾けて中の液体を見せる、という指示に変えました。前の失敗を踏まえ、「フレーム内に他の文字を一切出すな」の一文も追加しています。
まず成功した点です。開封という動作は最後まで完遂しました。蓋を掴み、持ち上げ、ねじ口が露出し、傾けて口元の液体が見えます。そして「他の文字を出すな」の一文が効き、前の動画で生えたダミーの 2 行目は完全に消えました。ラベルは「AQUABASE」の 1 行だけです。文字の問題は、書き方で解けます。
そして肝心の容器です。ファイルからフレームを抜き出して 1 秒ずつ並べましたが、別の容器に入れ替わる瞬間はありませんでした。状態が変わるのは蓋だけで、ボトル本体は最初から最後まで同じものです。
| 時点 | 容器の状態 |
|---|---|
| 0〜3 秒 | 磨りガラス調の白いボトル、金色のキャップ。ラベルは「AQUABASE」の 1 行 |
| 6〜9 秒 | キャップを外して透明なねじ口が露出。ボトル本体・ラベルは同じ(キャップは手に持ったまま画面上方へ外れる) |
| 12〜15 秒 | 傾けて口元の液体を見せる角度へ。本体もラベルの位置も同じまま |
変化しているように見えるのは、外したキャップの下から透明なねじ口が出てくる部分と、瓶を傾けたことで見える面が変わる部分です。どちらも物理的に正しい見え方で、容器がすり替わったわけではありません。素材レベルの変化を疑ってフレームを拡大しましたが、白い本体・ラベルの位置・キャップの直径のどれも一致しています。この 1 本に関するかぎり、「商品のパッケージを実際とは異なるものに見せる」状態は出来ていません。
唯一の注意点は、終盤の 3 秒でラベルの文字がにじむことです。ただしこれは角度が付いたことと手の動きによるぶれで、別の文字列に化けているわけではありません。15 秒・1 ショット・状態変化ありという条件で、容器の同一性は保たれた——これが今回の実測です。
商品を映さない型なら、ナレーションもテロップも通る
では商品を画面から外すとどうなるか。世界観だけを見せ、日本語のナレーションを乗せ、最後に商品名を出す構成にしました。商品も、パッケージも、ラベルの付いた物体も画面に出さない指定です。
3 つの要素が全部通りました。映像は白い石の上の水と光で 15 秒間安定し、指定した位置で日本語のナレーションが入り、最後の 3 秒で商品名のテロップが極めて綺麗に出ました。
テロップを綺麗に出すのに効いたのは 2 点です。綴りを 1 文字ずつハイフンで区切って示すことと、他の文字を出すなと明示すること。実際に使ったのは次のような書き方です。
In the final 3 seconds the ripples settle into darkness and one single word
appears centered on screen, spelled A-Q-U-A-B-A-S-E, reading AQUABASE,
in clean bold uppercase sans-serif letters glowing soft white.
No other text or letters anywhere in the frame.日本語のセリフは、英語のプロンプトの中に鉤括弧で埋め込み、あわせて声質(落ち着いた 20 代後半の女性の声)を指定しました。この型が、TikTok Shop で今すぐ使える形です。商品を一切映していないので、パッケージが変質しようがありません。実写で撮った商品カットと組み合わせれば、動画 1 本が成立します。
境界線は「映像が保つか」ではなく「実在商品と一致するか」
4 本を並べると、AI 動画の限界がどこにあるのかがはっきりします。AI 動画が保てないのは、1 本の中での見た目ではありません。指定した実在の商品と一致させることです。
| 課題 | 解けるか | 解き方 |
|---|---|---|
| 指定した綴りを出す | 解ける | 1 文字ずつハイフンで区切る |
| 余計な文字を出さない | 解ける | 「他の文字を出すな」と明示する |
| 日本語で喋らせる | 解ける | 鉤括弧でセリフを埋め、声質を指定する |
| 同じ容器を 15 秒保つ | 解ける | 指示なしで保った(開封を挟んでも維持) |
| 実在する自社商品として再現する | 解けない | —— |
上の 4 つは通りました。最後の 1 つだけは、書き方をどう変えても届く見込みがありません。テキストから動画を作るモデルは、指定した実在の商品を参照する仕組みを持っていないからです。1 本の中では一貫した「それらしいボトル」を描けますが、それが手元の実物と同じ形である保証はどこにもありません。
それが分かりやすく出たのが、今回の 2 本のボトルです。どちらも同じ「AQUABASE」を指定しましたが、静止の 1 本は角の丸い太めのボトルに 2 行ラベル、開封の 1 本は細身の円筒に 1 行ラベルで、並べると完全に別商品です。1 本ずつは最後まで一貫しているのに、生成をまたぐと同じ商品になりません。崩れるかどうかではなく、そもそも実物を見ていない——これが商品カットを任せきれない理由です。
【仮説】実際の商品画像を起点にすれば回避できるのではないか
ここまでは、テキストだけから動画を作る方式で検証しました。ここから先は検証していない仮説です。読み飛ばしても本文の結論は変わりませんが、次に試す価値がある方向なので書き残します。
残った課題は 1 つ、実在する自社商品と一致させることだけでした。だとすれば、実際に撮影した商品写真を起点にする「画像から動画」の方式なら、この課題は埋まるはずです。ゼロから描き起こすのではなく、与えられた 1 枚を動かす形になるためです。DomoAI にもテキストからではなく画像から生成するモードがあり、むしろそちらが既定になっています。
この方向が有望だと考える理由がもうひとつあります。TikTok Shop の公式規定が、まさにその作り方を要求していることです。冒頭で引いたとおり、公式は AI 生成コンテンツを作る際に「実際の商品情報のみを使用し、実際の商品画像およびセラーが提供する素材に基づかなければならない」と定めています。つまり規約が求める作り方と、破綻を避ける作り方が一致している可能性があります。
ただし、楽観はできません。確かめるべき点が少なくとも 3 つあります。
- 起点の商品を保ったまま動かせるか — 1 枚目が正しくても、2 秒目以降は結局モデルが描いています。今回テキスト起点でも 15 秒保ったので見込みはありますが、保つ対象が「実物」に変わる点は別問題です
- 状態変化に耐えるか — 蓋を外す、中身を出すといった動作は、写真に写っていない面を新たに描く行為です。ここは起点画像では埋められません
- ラベルの細かい文字が保つか — 今回は短い単語 1 つなら保ちましたが、実物のラベルには成分表示や小さな文字が並びます。指定外の文字が生えた 2 本目の挙動も踏まえ、拡大確認が要ります
現時点で言えるのは、「テキストから作る方式でも映像は 15 秒保つが、実在商品の再現はできない」までが実測で確かめた範囲で、写真起点でどこまで実物に寄せられるかは分からない、ということです。次はここを検証します。
カテゴリ別・AI に任せてよいかの判断表
実測と公式規定を突き合わせて、判断表にまとめます。
| 作りたいもの | 判断 | 理由 |
|---|---|---|
| 無地のアパレルのモデルカット | 任せてよい | 崩れの基準が画面に無く、1 回転まで通る |
| 世界観・イメージカット | 任せてよい | 商品が映らないので変質しようがない |
| 日本語ナレーション | 任せてよい | セリフと声質を指定すれば通る |
| 商品名だけのテロップ | 任せてよい | 綴りを区切り、他の文字を禁じれば出る |
| プリント・ロゴ入りのアパレル | 条件つき | 文字と柄は保証されない。要フレーム確認 |
| ラベルのある商品を静止で見せる | 条件つき | 15 秒なら容器も綴りも保つ。指定外の文字が生えるため要拡大確認 |
| 商品の開封・使用シーン | 条件つき | 動作も容器も保った。実在商品として出すなら写真起点か実写 |
| 実在商品の忠実な再現 | 任せない | テキストから作る方式には再現する仕組みが無い |
| 人物に効能を語らせる | 任せない | 医療従事者のなりすましは開示しても禁止 |
運用としては、実在商品を「その商品」として見せるカットだけ実写、それ以外は AIという分担が現実解です。商品を映す数秒だけスマートフォンで撮り、前後の世界観カットとナレーションを AI で埋める。映像の質を心配する必要はもうありません。判断の軸は、そのカットが実物と一致している必要があるかどうかだけです。
なお 1 本が 1 ショットで完結するため、カットを繋ぐ工程は別に必要です。編集ソフト側に何が要るかは After Effects 導入前チェック で整理しています。
壁は 3 つある — ツール・モデル・プラットフォーム
検証中に、想定していなかった壁にぶつかりました。最初に用意したプロンプトは「明るいスタジオで若い女性がスキンケアのボトルを胸の高さで持つ」というものでしたが、これは生成される前に DomoAI 側で拒否されました。「制限リクエストが検出されました」というダイアログが出て、コミュニティ規範に沿わない可能性があると判定された、という内容です。クレジットは消費されませんでした。
人物を外して手元だけに変えたところ、同じ商品でも通りました。つまり人物と商品を一緒に出すこと自体が、ツール側で警戒されているということです。この経験から、壁を 3 つに整理しておくと見通しが良くなります。
| 壁 | いつ止まるか | 今回ぶつかった例 |
|---|---|---|
| ツールのモデレーション | 生成する前 | 人物+スキンケア商品のプロンプトが拒否された |
| モデルの表現力 | 生成した後 | 指定していないダミー文字が生えた |
| プラットフォームの規約 | 投稿した後 | パッケージの改変、開示なしの投稿、なりすまし |
怖いのは 3 つ目です。1 つ目と 2 つ目はその場で分かりますが、規約の壁は投稿してからしか分かりません。しかも今回のように映像として成立している動画ほど、実物と違うことに気づきにくいという関係にあります。だからこそ、作る前に線引きを決めておく価値があります。
なお、ここで言う「ツールの壁」はモデルの選び方と料金にも関わります。DomoAI 側で使えるモデル・プラン・クレジットの消費量は DomoAIとは|料金プラン・使える機能・クレジットの仕組み にまとめました。
検証してみて分かった、確かめ方の落とし穴
作った動画が指示どおりかを確かめる作業でも、つまずきました。記録として残します。
世界観カットにナレーションが入っているかを、最初は音の波形で判定しようとして間違えました。1 秒ごとの平均音量を測り、スペクトログラムを見て、「発話の特徴が出ていないので声は入っていない」と結論づけたのです。実際に再生してみると、日本語の声はしっかり入っていました。
原因は単純です。この動画は環境音と BGM が最初から最後まで途切れず鳴っているため、声が始まっても音量が跳ね上がりません。静かな映像に声が乗る動画なら分かりやすい山が出ますが、常に音が鳴っている動画では、声は数字の上に現れないのです。
| 確かめたいもの | やってはいけない方法 | 確実な方法 |
|---|---|---|
| ある時刻に何が映っているか | ブラウザで再生位置を動かす | ファイルからフレームを抜き出す |
| 声が入っているか | 音量やスペクトログラムを見る | 実際に聴く |
どちらも「間接的な手段で確かめようとして外した」という同じ形の失敗です。動画の検証は、手間でも直接見る・直接聴くのが結局いちばん速いという結論になりました。
サイトに載せる際の容量対策も前回と同じです。今回の 4 本も元は合計 16.8 MB ありましたが、再エンコードで 4.0 MB(約 76% 削減)まで落ちました。
ffmpeg -i input.mp4 \
-c:v libx264 -crf 28 -preset slow \
-c:a copy \
-movflags +faststart \
output.mp4まとめ
TikTok Shop の商品動画で AI に任せてよいのは、無地のアパレル、世界観カット、日本語ナレーション、商品名のテロップです。商品を映すカットも、映像としては保ちました。開封という状態変化を挟んでも、容器の形も素材も 15 秒のあいだ変わりません。文字の問題もプロンプトの書き方で解けます。
解けないのは 1 つだけです。出てきたボトルは、あなたが売っている実物ではありません。同じ商品名を指定した 2 本ですら、容器のデザインは別物になりました。TikTok Shop は AI 生成コンテンツを「実際の商品画像およびセラーが提供する素材」に基づいて作ることを求めているので、実物として見せるカットだけは、実写か商品写真を起点にする必要があります。
言い換えると、心配すべきは映像の精度ではなく、実物との一致だけです。写真を起点にする方式ならそこも埋まる可能性があり、公式規定もその作り方を求めています。ここは未検証なので、別途確かめます。
まず試すなら、商品を映さない世界観カットを 1 本作ってみてください。数分で出来て、そのまま実写の商品カットの前後に置けます。TikTok のロゴやアイコンを販促物に使う際の規約は TikTok ロゴの使用ルール にまとめているので、動画の外側で気をつける点はそちらで確認できます。
よくある質問
Q. TikTok Shop で AI 生成の動画を使ってよいのですか?
使えます。TikTok Shop は AI 生成コンテンツの利用を認めており、禁止しているのは AI を使うこと自体ではなく、商品を実物と異なるものに見せることです。ただし AI を使った旨の開示は必須で、コンテンツ内の表記か投稿時のスイッチで示す必要があります。
Q. 商品そのものを AI に描かせても大丈夫ですか?
映像としては保ちます。今回の検証では、蓋を開けさせても 15 秒のあいだ容器の形も素材も変わりませんでした。ただし出てくるのは「それらしいボトル」で、指定した実在の商品ではありません。同じ「AQUABASE」を指定した 2 本でも、容器のデザインは別物になりました。TikTok Shop は AI 生成コンテンツを実際の商品画像に基づいて作ることを求めているため、実物として見せるカットは実写か商品写真を起点にしてください。
Q. アパレルなら AI 動画で作ってよいのですか?
無地の服であれば成立します。今回の検証では、モデルが 1 回転して背面を見せて正面に戻る動作が指示どおり完遂し、シャツのボタンや裾のスリットも 15 秒間保たれました。ただしプリントやロゴの入った服は、文字と柄が保証されないため同じようにはいきません。
Q. AI 動画に日本語のナレーションは入れられますか?
入れられます。英語のプロンプトの中に日本語のセリフを鉤括弧で埋め込み、あわせて声質を指定する書き方で、指定した位置に日本語の音声が入りました。話す人物が画面にいなくても成立します。
Q. 商品名のテロップは AI 動画の中に出せますか?
出せます。綴りを 1 文字ずつハイフンで区切って示し、あわせて「フレーム内に他の文字を出すな」と明示すると、指定どおりの文字が出ました。この一文が無いと、指定していない判読不能なダミー文字が別の場所に生えます。
Q. 有名人そっくりの AI アバターに商品を紹介させてもよいですか?
できません。TikTok Shop の公式ドキュメントは、有名人・医療専門家・政治家・公人を音声も含めて商品の宣伝に用いることを、AI 生成コンテンツとして適切に開示されている場合であっても禁止しています。実在する一般の人のディープフェイクも同様に禁止です。
Q. AI で作った動画が自動でラベルを付けられたら不利になりますか?
不利にはなりません。公式ドキュメントは、自動で付与されたラベルは削除できないものの、それ自体はペナルティの対象ではないとしています。問題になるのは、AI を使ったことを隠して開示しなかった場合です。
