Die Personen wirken etwas zu glatt, die Bewegungen flüssig, aber merkwürdig schwerelos. Der Hintergrund sieht real aus, scheint sich aber nicht ganz an die Physik der realen Welt zu halten.
Und mitten im Bild steht eine Person, die eindeutig echt wirkt.
Der Gedanke kommt sofort:
„Haben sie einen echten Menschen in eine KI-generierte Welt gesetzt?“
2026 ist das ein durchaus rationales Produktionsmodell. Generative KI kann Figuren, Hintergründe, Statisten und atmosphärische Einstellungen erzeugen, während Experten, Sprecher oder Produkte, bei denen Glaubwürdigkeit wichtig ist, real gefilmt werden.
Der Fall JEX ist dafür interessant, aber bestätigte Fakten und optischer Eindruck müssen getrennt werden.
Fazit in fünf Sekunden
- Die offizielle L8020-Seite von JEX erklärt, dass Professor Hiroki Nikawa von der Universität Hiroshima persönlich in den TV-Spots 2026 auftritt.[1]
- Bei einem anderen JEX-Projekt schreibt macs REALIZ ausdrücklich, dass der Glamourous-Butterfly-Brandfilm KI-generierte Personenvideos auf Basis eigens gezeichneter Illustrationen plus CG-Bearbeitung verwendet.[2]
- Damit ist bestätigt, dass JEX generative KI in der Werbung einsetzt. Die geprüften Quellen belegen jedoch nicht, dass auch der gesamte Hintergrund oder alle übrigen Elemente des L8020-Spots KI-generiert sind.
- Öffentliche Preise 2026 reichen von ¥29.800 und ¥50.000 über ¥298.000 bis zu ¥500.000 für echte Personen in einer KI-Welt und ¥700.000 oder mehr für aufwendige Individualproduktionen.[3][4][5][6][7]
- Teuer ist meist nicht ein einzelner Generierungslauf, sondern Konzeption, Dreh, Compositing, Schnitt, Korrekturen, Ton, Rechte, Markenführung und Abnahmeverantwortung.
- Moderne KI-Videos verraten sich eher durch zeitliche Inkonsistenz, Bewegung, Kontakt und Physik als nur durch einen auffälligen Fehler in einem einzelnen Frame.[8][9][10]
- Menschen sind trotzdem keine perfekten KI-Detektoren.[8][11]
1. Was bei JEX tatsächlich bestätigt ist
Die L8020-Seite nennt Professor Nikawa als Darsteller in den Spots 2026. Für die Kampagne im Februar in der Chukyo-Region werden außerdem zwei Kinderdarsteller genannt, die mit ihm auftreten.[1]
Der Professor ist also eine reale Person, die als sie selbst vor der Kamera steht.
Anders ist es beim Glamourous-Butterfly-Projekt. macs REALIZ beschreibt den Brandfilm als Produktion mit KI-generierten Personen auf Basis von Originalillustrationen und anschließender CG-Bearbeitung. Auch das Key Visual 2026 wird als KI-Personengenerierung beschrieben.[2]
Die belastbare Aussage lautet daher:
JEX nutzt sowohl Live-Action-Werbung als auch Werbung, bei der der KI-Einsatz ausdrücklich dokumentiert ist.
„Sieht nach KI aus“ und „die Produktionsfirma bestätigt KI in genau dieser Szene“ sind zwei unterschiedliche Aussagen.
2. Warum „KI-Welt + echter Mensch“ sinnvoll ist
Eine ungewöhnliche Welt klassisch zu drehen erfordert Location, Setbau, Art Direction, Licht, Kostüm, Schauspieler, Crew und VFX.
KI kann einen Teil dieser physischen Produktion ersetzen: Hintergründe, Statisten, Stimmungsbilder und teilweise sogar Figuren.
Was echte Glaubwürdigkeit braucht, bleibt real.
Die Arbeitsteilung sieht fast komisch aus:
Welt: KI. Glaubwürdigkeit: Live Action. Produktverpackung: bitte im nächsten Frame nicht mutieren.
Das ist glaubwürdiger als Full-AI und spart mehr Dreharbeit als Full-Live-Action.
3. Was kostet das 2026?
CLEIA AI STUDIO bietet 15–60-Sekunden-KI-Videos ab ¥29.800 an.[3]
Syashin Lab nennt für 15–30-Sekunden-KI-Spots ¥50.000 in 720p und ¥125.000 in 4K.[4]
North Image bietet KI-Werbe- und Brandfilme inklusive Planung und Storyboard ab ¥298.000 an.[5]
Meadow Works AI nennt für echte Personen, die in eine KI-Welt compositet werden, Preise ab ¥500.000.[6]
Movie Impact listet individuelle Produktionen mit menschlichem Finishing ab ¥700.000.[7]
„KI-Video“ kann also ein günstiger Kurzclip oder eine aufwendig betreute Markenproduktion sein.
4. Teuer ist die Absicherung gegen Fehler
Ein privates 15-Sekunden-Experiment kann billig sein. Ein Unternehmensspot darf nicht zulassen, dass sich das Produkt für einen Frame verändert, das Logo zu Kauderwelsch wird oder das Gesicht des Sprechers mitten in der Szene wechselt.
Dazu kommen Werberegeln, Musik, Stimmen, Persönlichkeitsrechte, Kundenfreigaben, Regenerierung, Color Grading, Sound, Sprechertext und verschiedene Lieferformate.
Unternehmen kaufen nicht einfach GPU-Zeit.
Sie kaufen einen Prozess, in dem jemand die Verantwortung übernimmt und sagt: Diese Version kann veröffentlicht werden.
5. Warum KI trotzdem noch auffallen kann
Moderne Modelle brauchen keine sechs Finger mehr, um sich zu verraten.
Entscheidend ist zunehmend, ob die Realität über die Zeit hinweg konsistent bleibt.
Skyra auf der CVPR 2026 untersucht für Menschen wahrnehmbare Artefakte und räumlich-zeitliche Inkonsistenzen.[9] MotionPhys zeigt, dass visuell plausible Videos trotzdem Bewegungsbahnen erzeugen können, die nicht zu Trägheit, kontinuierlichen Kräften oder realistischer Bewegungsgeometrie passen.[10]
Intuitive Hinweise sind etwa:
- flüssiges Gehen ohne Gewicht;
- ungenauer Kontakt zwischen Hand und Objekt;
- Haare, Kleidung oder Schmuck verändern sich leicht von Frame zu Frame;
- Lippen, Wangen und Augen wirken nicht wie ein gemeinsames Muskelsystem;
- Hintergrundpersonen bewegen sich plausibel, aber ohne erkennbaren Zweck.
Als Standbild ist alles normal. In Bewegung wirkt die Welt plötzlich etwas weich.
6. Ein echter Mensch kann die KI sogar stärker sichtbar machen
Das ist eine Wahrnehmungsinferenz und keine direkte Studie zu einem bestimmten JEX-Spot.
Wenn die ganze Szene synthetisch ist, kann sich der Zuschauer an einen einheitlichen künstlichen Stil gewöhnen. Eine echte Person liefert dagegen plötzlich eine Referenzprobe der Realität.
Hautdetail, Atmung, Körperträgheit, Bewegungsunschärfe und Schärfentiefe werden zu Vergleichsmaßstäben.
Dann kann der Eindruck entstehen:
„Der Mann ist echt. Das Universum um ihn herum träumt.“
7. Schnell erkennen heißt trotzdem nicht: Menschen sind perfekte Detektoren
Eine Studie auf den CVPR Workshops 2026 zeigte, dass die Erkennung generierter Videos mit längerer Betrachtungszeit von ungefähr 58 % auf 75 % stieg, während die korrekte Erkennung realer Videos bei etwa 60 % blieb.[8]
Mehr Zeit hilft, Fehler in Fakes zu finden, beseitigt aber nicht das Misstrauen gegenüber echtem Material.
Eine Meta-Analyse von 2024 mit 56 Studien und 86.155 Teilnehmenden kam ebenfalls zu dem Ergebnis, dass menschliche Deepfake-Erkennung insgesamt schwach ist; die einfache Genauigkeitsschätzung für Video lag bei rund 57 %.[11]
Erfahrung kann helfen. „Ich erkenne es oft“ bedeutet aber nicht „jeder erkennt jede KI immer“.
8. Wahrscheinliche Richtung: KI nur dort, wo Realität nicht zwingend nötig ist
Für Werbetreibende zählt, physische Produktion zu reduzieren, ohne Glaubwürdigkeit zu verlieren.
Deshalb bleibt das Hybridmodell attraktiv:
- echte Menschen, wenn Authentizität wichtig ist;
- KI für Welten, die fiktiv sein dürfen;
- strikte Kontrolle von Produkt und Marke;
- menschliche Prüfung am letzten Gate.
Das ist keine Revolution, bei der Produktion kostenlos wird.
Es ist eher eine Revolution, bei der mit demselben Budget Welten gezeigt werden können, die früher deutlich teurer gewesen wären.
9. Fazit
KI-Videoerzeugung selbst ist billig geworden. Daraus verlässliche Unternehmenswerbung zu machen, erfordert weiterhin menschliche Arbeit und Verantwortung.
Auch Zuschauer lernen. Sie müssen keine Finger mehr zählen: Bewegung, Kontakt, Gewicht, Gesicht, Hintergrund und der Vergleich mit Live Action können bereits das Gefühl „Das ist KI“ auslösen.
Aber diese Intuition ist fehlbar.
Die Situation 2026 ist deshalb bemerkenswert:
KI ist bereits sehr gut. Menschen gewöhnen sich an KI. Und ein einziger echter Mensch kann zum letzten Kalibrierungspunkt für Realität im ganzen Bild werden.
Quellen
- JEX / L8020 official site and 2026 commercial notices l8020.jp
- macs REALIZ, Marketing Solution — JEX Glamourous Butterfly Brand Movie / Key Visual macs-realiz.jp
- CLEIA AI STUDIO, public AI-video pricing cleia-ai.com
- 写真ラボ映像工房, AI commercial production pricing syashinlab.com
- North Image, AI video / CM pricing northimage.co.jp
- Meadow Works AI, live action × AI-world compositing pricing meadowworx.com
- Movie Impact, public pricing knowledge movieimpact.net
- Davodi, C. E., Barrington, S., Farid, H., & Cooper, E. A. (2026). “Perceptual Judgments of Video Authenticity: An Examination of Viewing Duration, Confidence, Content, and Strategies.” CVPR Workshops 2026 openaccess.thecvf.com
- Li, Y. et al. (2026). “Skyra: AI-Generated Video Detection via Grounded Artifact Reasoning.” CVPR 2026 openaccess.thecvf.com
- He, H. et al. (2026). “MotionPhys: Detecting AI-Generated Videos via Physical Consistency of Optical-Flow Trajectories.” arXiv:2608.20770 arxiv.org
- Human performance in detecting deepfakes: A systematic review and meta-analysis of 56 papers.” Computers in Human Behavior Reports 16 (2024), 100538 sciencedirect.com

