KI-Wissensvermittlung durch einen Talking Head
A video prompt for a realistic talking head video of a knowledge blogger explaining AI in a study setting.
Aufrufe1,676
Likes15
Kommentare8
Shares2
Lesezeichen10
Zitate0
Übersetzt
Verwenden Sie die weibliche Figur aus dem Referenzbild als einzige Charakterreferenz und achten Sie auf eine hohe Konsistenz bei Gesichtszügen, Frisur, Hautton, Kleidung und dem allgemeinen Erscheinungsbild.
9:16 Hochformat, 10 Sekunden, ultra-realistischer Live-Action-Wissenschaftsbeitrag.
Die Figur sitzt in einem echten Arbeitszimmer, mittlere Nahaufnahme ab der Brust, feste Kamera, im Wesentlichen keine Bewegung. Natürliches Licht fällt von vorne seitlich durch ein Fenster ein, die Bücherregale im Hintergrund sind leicht unscharf, was wie bei einem echten, mit einer Kamera gefilmten Wissens-Blogger wirkt.
Die Figur spricht natürlich in die Kamera: „Viele Leute denken, dass KI Fragen beantwortet, indem sie Antworten in einer Datenbank sucht. Tatsächlich ist das nicht der Fall; es ist eher so, als würde sie kontinuierlich das wahrscheinlichste nächste Wort basierend auf dem vorherigen Inhalt vorhersagen.“
Leistungsanforderungen: 0-2s: Schauen Sie zu Beginn natürlich direkt in die Kamera, konversationeller Tonfall, leichtes Blinzeln. 2-5s: Beim Satz „Tatsächlich ist das nicht der Fall“ den Kopf einmal leicht schütteln, natürliche Veränderungen der Augenbrauen. 5-8s: Bei der Erklärung „basierend auf dem vorherigen Inhalt“ kommt eine Hand natürlich ins Bild, um eine sehr kleine erklärende Geste zu machen. 8-10s: Nach dem Satz „wahrscheinlichste nächste Wort“ mit einem leichten Nicken abschließen. Der gesamte Prozess sollte nicht wie das Ablesen eines Skripts wirken und keinen typischen Nachrichtensprecher-Ton haben. Die Mundbewegungen müssen strikt mit der chinesischen Sprache übereinstimmen. Behalten Sie natürliches Blinzeln, Atmen, Mikro-Mimik, leichte Kopfbewegungen und eine echte Hauttextur bei. Die Augen können gelegentlich kurz von der Kamera abweichen und dann natürlich zurückblicken. Zurückhaltende Gestik, nicht häufig mit den Händen wedeln. Echte Textur einer Handy-/Systemkamera-Aufnahme, leichtes Sensorrauschen, echte Hautqualität, kein Airbrush, keine Influencer-Filter, keine plastische Haut, keine übertriebene Filmbeleuchtung, keine Kamerabewegung, keine Untertitel, keine Wasserzeichen, kein Text auf dem Bildschirm.
Maschinell übersetzt — das Original hat dieses Ergebnis erzeugt.