Update zu Bild-KI: ChatGPT, Midjourney 7, Reve

Shownotes

Tauche ein in die faszinierende Welt der Bild-KI! Im Gespräch mit Joel Kaczmarek enthüllt Georg Neumann, Gründer des KI-Marketing-Bootcamps und Entwickler von Flaic, die neuesten Trends und Entwicklungen. Erfahre, wie du mit Flaic beeindruckende Bilder von dir selbst generieren kannst und welche Fortschritte Tools wie Mid Journey 7 und Google Veo 2 im Bereich der Bild- und Videogenerierung gemacht haben. Entdecke, wie diese Technologien den kreativen Prozess revolutionieren und welche spannenden Möglichkeiten sie für die Zukunft bieten. Lass dich inspirieren und erweitere deinen Horizont im Bereich der künstlichen Intelligenz! Du erfährst... ...wie Georg Neumann mit Flaic KI-gestützte Bildgenerierung revolutioniert. ...welche Fortschritte das neue Bildmodell von ChatGPT bietet. ...warum Mid Journey 7 für stilvolle und ausdrucksstarke Bilder begeistert. ...wie FreePick innovative Bildbearbeitungstools bereitstellt. ...welche Geheimnisse der neue Player Reef im Bereich Bild-KI birgt. __________________________ ||||| PERSONEN ||||| 👤 Joel Kaczmarek, Geschäftsführer digital kompakt 👤 Georg Neumann, Mitbegründer KI Marketing Bootcamp __________________________ ||||| SPONSOREN ||||| 🔥 Übersicht aller Sponsoren 💪 Diese Folge entstand in Partnerschaft mit Flaic __________________________ ||||| PLAYLISTS ||||| Lust auf mehr? Entdecke unsere Playlists mit weiteren spannenden Episoden zum Thema: 🎧 Künstliche Intelligenz __________________________ ||||| LEXIKON ||||| Du verstehst nur Bahnhof? Zu viel Fachchinesisch? Unser Lexikon hilft dir dabei, die wichtigsten Fachbegriffe zu verstehen: 🔹 Bild-KI - Eine spezielle KI-Anwendung, die sich auf das Erzeugen, Bearbeiten oder Verstehen von Bildern konzentriert. 🔹 KI-Marketing-Bootcamp - Ein Schulungsprogramm, das Unternehmen und Marketingabteilungen darin schult, künstliche Intelligenz im Marketing einzusetzen. 🔹 Mid Journey - Ein KI-gestütztes Bildgenerierungstool, das detaillierte und stilistische Bilder erstellt. 🔹 Mid Journey 7 - Die siebte Version des KI-gestützten Bildgenerierungstools Mid Journey, mit verbesserten Funktionen. 🔹 ComfyUI - Eine nodebasierte Benutzeroberfläche für die Entwicklung von Bildgenerierungs-Workflows mit KI. __________________________ ||||| KAPITEL ||||| (00:00:00) Vorstellung & Einführung ins Thema (00:01:31) Bild KI von Chat-GPT (00:04:07) Was kann Flaic? (00:07:52) News bei Midjourney (00:11:51) How to: Bilder korrigieren (00:13:08) Was kann Reve? (00:14:22) Bewegtbild: Bewegt sich da was? __________________________ ||||| WIR ||||| 🧢 Ich bin übrigens Joël, der Macher dieses Podcasts. Ich bin ein Creator und Medienunternehmer, der für Wachstum und Vielfalt steht. Mein Vorgehen besteht darin, dass ich inspirierende und erfolgreiche Menschen interviewe, um von ihnen zu lernen und Wissensabkürzungen für dich und mich aufzutun. 👉 Mit meinem Podcast digital kompakt zeige ich dir Wachstumsstrategien für dein (Digital-)Business, indem ich erfolgreiche Unternehmen und Expert:innen interviewe 👉 Mit meinem Podcast 5 Dinge mit 20 zeige ich dir, wie du persönlich wachsen kannst, indem ich inspirierende Menschen frage, was sind ihre 5 Dinge, die sie gerne schon mit 20 gewusst hätten 👉 In meinem Newsletter fasse ich dir Jeden Freitag die besten Learnings aus meinen Podcasts zusammen sowie viele weitere Einsichten aus meinen Aktivitäten. 💛 Abonniere „digital kompakt“ auf Apple Podcasts, Spotify & Co. Wenn dir die Folge gefallen hat, hinterlasse uns bitte eine Fünf-Sterne-Bewertung! 👥 Wir streben die Verwendung einer geschlechtsneutralen Sprache an. In Fällen, in denen dies nicht gelingt, gelten sämtliche Personenbezeichnungen für alle Geschlechter.

Transkript anzeigen

00:00:00: Digital Kompakt.

00:00:01: Heute aus dem Bereich künstliche Intelligenz mit deinem Moderator Joel Kaczmarek.

00:00:07: Los

00:00:07: geht's!

00:00:15: Hallo Leute geht's euch auch so, dass ihr manchmal ein bisschen nicht mehr hinterherkommt oder seid ihr ehrlich vielleicht sogar abgehangen seid wenn es um die ganzen Entwicklungen im Bereich KI geht.

00:00:24: Das ist ja bei allem was textuelles so.

00:00:25: das eine aber ich finde manchmal noch viel schwierigere ist das Thema BildKI.

00:00:29: und da habe ich eine tolle Person am Start nämlich den lieben Georg Neumann mit dem ich immer ganz ganz fleißig drüber rede was sich da so tut.

00:00:35: Georg kenne ich nämlich aus meiner Business Community Makers & Shakers Marketing Bootcamp, sag ich mal die Instanz eigentlich geschaffen, wo er sich mit dem Thema Bildkai auseinandersetzt.

00:00:46: Weil seine Firma schult im Wesentlichen Marketing-Teams und macht noch viele Dinge mehr.

00:00:50: aber sein großes Esset was ich immer erlebe oder leben darf ist das Thema BildKi.

00:00:54: Deswegen immer wenn ich mal wissen will was tut ihn sich da so dann quatsch dich mit Georg.

00:00:58: Und mehr noch er hat mir sogar eine eigene Lösung gebaut Die ihr da draußen auch benutzen könnt.

00:01:02: also heute ein bisschen Werbung auch mit reingebaut Aber weil ich es für wirklich wertvoll halte die heißt nämlich Flake und mit Flake könnt ihr hingehen können Fotos euch nehmen, die Maschine trainiert sich auf euch und dann könnt ihr auf Knopfdruck Bilder von euch erzeugt.

00:01:14: Aber dazu später mehr?

00:01:15: Jetzt erstmal unser Update in Sachen Bild-KI!

00:01:17: Wir werden fleißig natürlich über Chachibitien das neue Modell reden.

00:01:20: wir reden mal mit Journey Sieben und mit Reeve gibt es ja auch noch einen spannenden neuen Player und wer weiß was uns noch so bei dem Weg läuft.

00:01:24: also lieber Georg schön dass du da bist.

00:01:26: Hallo

00:01:27: Michael, schön dass ich da sein darf.

00:01:28: Ja wie

00:01:28: schon gesagt hat KI so ein schnelles, äh

00:01:31: ja so

00:01:31: eine schnelle Welt möchte man ja mittlerweile fast sagen.

00:01:33: und dann Bild nochmal komplexer weil Ich würde sagen für viele Menschen ticking abstrakter.

00:01:37: also wir ändern uns vielleicht noch an die frühen Zeiten wo wir irgendwie prompten sehr gut hinkriegen mussten und so weiter und sofort.

00:01:42: aber es hat sich viel getan.

00:01:44: deswegen mit dir mal so ja immer schön zu reden Und vielleicht starten wir mal mit dem was den menschen glaube ich so am nächsten ist nämlich dieses neue bildmodell Was chachi bt auch gerade rausgegeben hat.

00:01:52: magst du mal so deinen big picture dazu sagen was du davon so hältst?

00:01:55: Ich finde es bombe.

00:01:56: Also die haben jetzt wirklich einen großen Wurf damit getan.

00:01:58: Die haben an vielen Stellschrauben gedreht, die wirklich viel Potenzial haben und wer auf LinkedIn aktiv sein sollte der hat es ja wahrscheinlich gesehen.

00:02:05: Da wurde gleich extrem fleißig rumprobiert mit Stilübertragungen, mit der Verwandlung eigener Fotos und generell halt mit der Bildgenerierung.

00:02:14: damit aber Big Picture ist Es kann endlich gut Fotos generieren.

00:02:17: Das war ja mit der Albtraum beim Vorgänger Dal iiii III Der vorher in Chatchapity integriert war das neue Bild-KI Modell dahinter Sehr, sehr gut.

00:02:26: ... generieren und das auch mit einer sehr, sehr guten Prompt-Betreue sozusagen.

00:02:31: Also es hält sich sehr gut an die Kommandos inklusive sogar der Generierung von Text in die Sachen rein... ...inklusive Generierung vom komplexen Text folgen wie jetzt im Comics oder in Infografiken sogar.

00:02:41: Das ist ja auch ein absolutes Novum!

00:02:43: Ja ich

00:02:43: habe mit Hammi, mit dem mich viel über KI Rede auch eine Session dazu gemacht hat.

00:02:46: er genau das hervorgehoben.

00:02:47: Und ich frag mich was ist in so deiner Beobachtung?

00:02:50: Wie gut funktioniert das wirklich von Bild zu Bild?

00:02:53: Eine Figur zum Beispiel um einen Setting beizubehalten

00:02:56: Hängt immer vom eigenen Anbruch ab.

00:02:57: Also gerade bei Fotos von echten Menschen ist immer noch eine ziemliche Abweichung drin, das ist immer näherungswert, dass es ganz nett auch für die Konzeption zum Beispiel kann man das super gut einsetzen.

00:03:05: aber wo's natürlich glänzt ist wenn man ne Stilübertragungen anstrebt.

00:03:09: Das heißt wenn man jetzt nicht ein reales Foto von sich damit generieren will sondern in einem anderen Stil und das war ja dann auch der Grund warum plötzlich LinkedIn randvoll mit irgendwelchen Actionfiguren waren was bis jetzt immer noch anhält.

00:03:19: ich sehe immer noch neue.

00:03:21: Ja das stimmt dadurch enttarnt sie es auch schon wieder so.

00:03:23: also da fühlt sichs für mich so an Okay krass, klassischer KI-Case.

00:03:27: Aber es ist ja vielleicht auch ein interessantes Happening das so in den Habitus übergeht der Leute und für mich ist ja so der heilige Graal.

00:03:33: das was du mit dem Flake gebaut hast können wir auch gleich mal am Rand noch einmal streifen.

00:03:38: geht es mit ChatGPT mittlerweile gut dass ich drei vier fünf sechs sieben Fotos von mir hoch lade und er anschließend mich im Setting sozusagen meiner Wahl setzt wenn ich etwas prompte?

00:03:46: Ich habe gerade einen Podcast gehabt mit jemanden, der keine Ahnung, ein Fahrunternehmen hat.

00:03:50: Ich möchte gerne in einem Taxi sitzen und diesen Gesichtsausdruck haben.

00:03:53: Funktioniert so etwas jetzt mittlerweile gut?

00:03:55: Wenn man es vielleicht ein bisschen konzeptionell übertreibt... ...und zum Beispiel YouTube-Famtnails oder sowas da können sie gut funktionieren.

00:04:01: wenn man dann auch vielleicht noch extreme Emotionen ranbringt die das Gesicht eh ein bisschen verzehrt Für irgendwelche Businessfotos oder für das typisches LinkedIn-Portrait, oder LinkedIn Selfie würde ich es tatsächlich nicht nehmen.

00:04:10: Weil's immer nur ein Nährungswert ist und die Person tatsächlich verbremdet.

00:04:14: Also du würdest schlichtweg nicht nach dir aussehen wenn du das versuchst?

00:04:17: Deine Mutter würde dich nicht erkennen damit was sie.

00:04:19: Es hängt quasi einfach nur vom Use Case ab.

00:04:22: Für manche gehts, für manche noch nicht!

00:04:23: Ist doch vielleicht eine gute Gelegenheit auch mal ganz kurz über deinen Flake zu reden.

00:04:26: also Ich mach hier so unverschämt Werbung weil ich das einfach ein echt cooles Tool finde.

00:04:29: Um uns mal den geneigten Hörerinnen und Hörern zu beschreiben wird deutlich so vorgestellt.

00:04:32: Das schreibt sich FLAIC sozusagen eine Trainingsphase.

00:04:36: Das heißt du setzt dich hin, trainierst mit mehreren Fotos von mir und das muss jetzt nicht Fotograf sein sondern es ist so die Frau oder der Mann von einem macht mal so fünf Bilder aus unterschiedlichen Perspektiven und unterschiedlichen Hintergründen.

00:04:45: man zeigt ein paar Gesichtsausdrücke also alles Smartphone machbar.

00:04:48: wo haben wir hier reden?

00:04:49: Du trainierest das Modell und anschließend ist wirklich so.

00:04:51: ich habe einen Textfeld wo ich den Prompt eingeben kann.

00:04:54: durch einen Button Druck wird der Prompt verbessert sodass er wirklich die wichtigsten gängigen KI Promptaspekte sage ich mal abbildet und anschliessen.

00:05:00: kann ich mir noch die Ratio aussuchen also welche Bildverhältnisse individuelle angehen?

00:05:04: Und dann brauche ich eigentlich noch sagen, will ich acht, sechzehn, zweiunddreißig oder eins?

00:05:08: vier, achtsechzehnt und dreißig sind glaube ich so die Sprünge ungefähr.

00:05:11: Also wie viele Bilder ich von mir haben möchte?

00:05:13: Womit machst du das eigentlich?

00:05:14: Weil wir gelinken das dass ich auf den Knopf drücke, hab einmal dich was trainieren lassen und habe dann sechziehn Fotos von mir, wie ich im Taxi sitze und irgendwie auf dem Laptop kloppe.

00:05:21: also Ich bin halt einfach her gegangen weil ich komme selbst aus der fotografie.

00:05:24: deswegen ist mein Anspruch an generierte Bilder von mir selbst zum Beispiel sehr hoch Und deswegen habe ich mich hingesetzt, hab einen Workflow entwickelt wie ich das Maximum aus KI-Generierten Porträts rausholen kann.

00:05:35: Das fanden auch andere so toll wenn ich das immer in Workshops demonstriert habe wie ich Bilder von mir generiere weil wenn ihr mir auf LinkedIn folgt da gibt es quasi keine echten Bilder von mehr.

00:05:43: und das war dann ein so guter Anklang dass ich mir gedacht habe hey da muss sich doch eine App dazu entwickeln weil es gibt tatsächlich Player auf dem Markt genug.

00:05:52: also es gibt genug solche Services wo man irgendwelche Bilder von sich hoch lädt damit automatisch ein Modell trainiert und dann kriegt man Bilder ausgegeben.

00:05:58: Das Problem ist, die meisten davon sind einfach schlichtweg schlecht.

00:06:01: D.h.,

00:06:02: der Nährungswert ist nicht... Also die Ähnlichkeit zur realen Person ist einfach nicht gegeben.

00:06:06: Die Hintergründe sind unsauber, die Hände sind kaputt und alle solche Kleinigkeiten.

00:06:10: Deswegen habe ich mir gedacht, das kann ich doch besser Und hab dann eben so ein bisschen nebenbei Flake entwickelt.

00:06:15: Mein Anspruch war halt auch Ich will das ganze Datenschutzkonform machen d.h.

00:06:19: ich will nicht dass da Porträts in irgendeine Cloud zu einem automatisierten Service geladen werden wo ich gar nicht weiß wie die Daten verarbeitet werden.

00:06:25: Sondern bei uns ist das quasi wirklich noch ein händischer Prozess,

00:06:28: d.h.,

00:06:28: ich selektiere auch für den Kunden die Trainingsdaten, bearbeite die gegebenenfalls noch und gebe es dann ins Training.

00:06:34: Evaluier auch das beste Modell, weil wir trainieren dann auch mehrere tatsächlich und erst dann geht das wirklich in die App für den Kunden.

00:06:40: Da steckt mein Workloader hinter wie ihr das Maximum an Bildqualität rauskommt.

00:06:43: und das coole ist jeder Kunde bekommt auch einen Individual auf sich abgestimmt, ein kleines Sprachmodell mit integriert wird, die dann auch den Promt verbessern und das mache ich individuell pro Kunde.

00:06:54: Also ich finde das ist einfach so, dass was ich mir immer wünsche.

00:06:57: Dass ich quasi in der Lage bin mit KI-Bilder von mir zu einer solchen unterschiedlichen Settings.

00:07:01: Deswegen cool, dass es bei dir gibt und schade, dass du das noch nicht einfacher auch mal magst.

00:07:05: Und gut für dich!

00:07:06: Von daher gleich ein Modell draus gebaut finde ich super.

00:07:08: Was sieht denn da drunter?

00:07:09: Sag mal, was ist eigentlich die Software mit der Du

00:07:11: arbeitest?!

00:07:12: Also ich arbeite mit ConfUI, wenn ich irgendwelche BuildKI Workflows entwickelt.

00:07:15: Das ist einfach ein nodebasiertes Bildgenerierungstool, extrem krasse Lernkurve sehr steil nach oben, wenig zugänglich aber eine sehr coole Open Source Community die dahinter steckt.

00:07:24: und die Technik die dahintesteckt es schlichtig.

00:07:26: wir trainieren einen Flux-Laura für die einzelnen Personen das machen wir damit mit so Tools wie Koya SS usw.

00:07:32: Aber das wird jetzt viel zu technisch.

00:07:33: da steckt also ein bisschen know how dahinter und auch Aufwand.

00:07:36: und wenn ich dann zum Beispiel ein Modell von dir trainiere Dann glüht hier einfach meine Workstation sechs, sieben, acht Stunden lang und heizt mein Raum auf.

00:07:43: Das wird jetzt im Sommer noch spannend wie ich das löse die doch dann wahrscheinlich in den Keller wandern und ich muss irgendwelche Kabel durch die Wände legen oder so?

00:07:49: Okay

00:07:49: also ich kann aber auch schon mal aus dem He-Kästchen geplaudert erzählen.

00:07:51: Meine Frau benutzt das auch und dann hast du zu ihr gesagt so ah das ist ein schönes Foto das ist aber nicht von mir oder?

00:07:56: Du meinst dir doch!

00:07:57: Also dein Modell trägst dich sogar schon aus.

00:07:59: von daher...

00:08:01: Ja, da war ich echt mega überrascht.

00:08:02: Das war so ein cooles Profoto das sie da gepostet hat.

00:08:04: Da musste ich echt selbst nachfragen ob es von Flake ist oder von ihr real.

00:08:08: quasi gut

00:08:08: wir machen weiter also werden jetzt schon mal einen Case.

00:08:11: wenn ich sage mich interessieren Bilder von mir selbst mit Journey.

00:08:14: Was tuten sich da

00:08:14: so?

00:08:15: Genau, mit Journey ist jetzt in der aktuellen Version sieben raus.

00:08:17: Noch nicht noch ein bisschen in der Beta.

00:08:18: Das ist noch nicht ganz offiziell da aber man kann es jetzt schon nutzen.

00:08:21: Ist tatsächlich eine große Schritt nach vorn, aber nur entteilen.

00:08:25: also ich bin doch nicht zu hundert Prozent happy weil einfach ein paar Probleme noch da sind.

00:08:28: gerade zum Beispiel Hände sind immer noch ein Problem.

00:08:31: das finde ich ein bisschen sehr schade weil es die anderen mittlerweile eigentlich alle halbwegs im Griff haben und dass man nicht mehr so viel Ausschuss bei den Händen hat.

00:08:37: Das hat mit Journey Sieben auch nicht ganz im Griff.

00:08:38: Ich hoffe, dass da können sie noch ein bissel nachbessern.

00:08:41: Aber ansonsten ist das gerade für stilistische oder sehr ausdrucksstarke Bilder Bombe.

00:08:46: Also da kann man wirklich coole was rausholen, also alle die vorher schon mit Journey genutzt haben werden die neue Version jetzt lieben weil die auch bei der Hautextur, bei den Details in Portraits... Da ist einfach noch mal eine Schippe oben drauf geschlagen und es macht einfach Spaß!

00:08:58: Ich bin

00:08:58: ja ehrlich gesagt auch durch dich aber jetzt auch durch die Chatchi-PT-Ergänzung von einer Weile ausgestiegen beim Journey.

00:09:04: Es ist immer noch wie früher dass man's auf Discord macht und so voll dem klumpigen Prompt.

00:09:10: Ne, das hat sich auch geändert.

00:09:11: Also die haben jetzt schon letztes Jahr... Ich glaube, Sommer letzten Jahr haben sie langsam angefangen ihre Oberfläche auszurollen.

00:09:16: Die haben eine schöne Web App, die ist tatsächlich auch sehr aufgeräumt und macht Spaß!

00:09:20: Damit kann man viel machen, haben auch schöne Editoren eingebaut und solche Themen.

00:09:23: Das passt jetzt eigentlich alles.

00:09:24: also diese Genki-Usung wie man es früher benutzen musste.

00:09:28: Das ist zum Glück vorbei.

00:09:29: Das hat mich damals auch immer abgehalten dass ich da Discord anschmeißen musste.

00:09:33: aber das geht jetzt echt gut.

00:09:34: und das Promting ist jetzt auch deutlich besser geworden weil letzte einfach große Sprachmodelle T-Fünf Textencoder, das ist wieder schon zu technisch.

00:09:42: Dahinter stecken die einfach die Prompt sehr gut interpretieren können und was da auch tatsächlich eine geile Entwicklung ist weil Thema Prompt Engineering was man muss jetzt nicht mehr wissenschaftlich an das Thema rangehen mit Journey hat es einen sogenannten draft Modus wo man dann wirklich Anbildern mit Sprache oder mit Text iterieren kann.

00:09:58: Das heißt, ich muss nicht mehr initial den perfekten Brompt schreiben.

00:10:00: Sondern ich starte mit einem Grundbrompt und iteriere dann einfach am Bild mit Sprache oder mit Text.

00:10:05: Okay

00:10:05: weil das wäre auch so eine Frage die ich habe an dich.

00:10:07: es ist ja manchmal so du machst vielleicht so drei vier Versuche mit sowas hast ein eins da findest du das Element gar ein anderes Dorse und würdest dann gerne drauf iterieren?

00:10:15: Und das war bisher mal so ein bisschen sperrig.

00:10:16: also es ist besser geworden.

00:10:17: bei Mitjournisiemen?

00:10:18: Ja ein!

00:10:18: Also es wird er... immer noch ein neues Bild generiert.

00:10:21: Ist es nicht so, als würde er sich dann Teile aus den Bildern zusammenschnitzeln können sozusagen?

00:10:25: Das nicht!

00:10:26: Es wird immer noch auf einer quasi neuen Beschreibung ein neuesbild generiert.

00:10:29: Da ist das aber ein Thema.

00:10:30: da wollen alle hin, dass man wirklich vernünftig an Bildern bearbeiten kann mit einem dialogbasierten Bearbeitungsprozess sozusagen Dass auch wirklich das Ganze ganz leicht zugänglich wird ohne dass man da irgendwie groß mit Rumpinseln muss oder so sondern das ist wirklich mit natürlicher Sprache funktioniert.

00:10:46: Da wollen alle Anbieter irgendwann hin.

00:10:48: Da arbeiten wir auch gerade alle dran.

00:10:49: Was würdest du denn sagen, was ist bei Mitjourney sieben so das Szenario für Du das benutzt?

00:10:54: Also was sind Anwendungsfälle, wofür das ideal ist?

00:10:56: Ich habe zum Beispiel letztens einfach mal einen fiktiven Avatar für ein Projekt generieren wollen und hab dann erstmal die Porträts mit Mitjournee generiert Einfach, weil die Haut-Text-Touren und so weiter waren supergut.

00:11:07: Ich habe da halt eine vierzeig Jahre alte Frau generieren wollen... ...und das ist eben immer so eine Herausforderung.

00:11:12: Darstellung von Alter korrekt

00:11:13: usw.,

00:11:14: dass es auch wirklich realistisch und authentisch wirkt,... ...ist nicht ganz so einfach und da ist zum Beispiel eine Stärke von Mitschirni.

00:11:19: Weil sie einfach das sehr gut hinbekommt richtig realistische Porträts mittlerweile hinzukriegen.... ....und das auch mit einer relativ hohen Auflösung.

00:11:25: Und ich bin uns sogar noch ein Schritt weitergegangen.. ..und hab dann dieses eine Porträt aus Mitschurni genommen und habe es dann in ggpt hergenommen, um Trainingsdaten zu synthetisieren.

00:11:33: Das heißt ich hab weitere Ansichten dieser Personen in Ggpt generiert weil da kombiniert man quasi die Stärken von den verschiedenen Tools Und ggbt.

00:11:41: die neue Bild-Generierung kann halt sehr gut Bilder, Input-Bilder interpretieren und auch neu ausrichten.

00:11:46: das heißt ich habe dann verschiedene Seitenansichten von diese einen Person aus mit Journey generiert Auch mal ein Bild ab der Hüfte oder auch im Ganzkörperporträt bis sich eben genug Trainings-Daten hatte um einen fiktiven Charakter zu trainieren.

00:11:57: Und den kann man jetzt tatsächlich auch bei mir in Flake nutzen, denn der kommt jetzt in die Demo rein.

00:12:01: Das heißt, die gute Anna habe ich sie getauft.

00:12:04: Die darf man dann bei uns zukünftig an der Demo testen!

00:12:07: Sehr gut sehr gut.

00:12:08: und sag mal was du eben beschrieben hast so dieses typische Szenario was glaube ich ganz viele auch im Business haben?

00:12:12: Ich hab ein Foto, mich stört nur ein Element dran.

00:12:15: Also ich habe es zum Beispiel gerade gehabt.

00:12:16: Ich hab mir mit deinem Tool was gebaut, wo ich auf so einer Bühne bin und dann war noch ein Mensch daneben der total visibel war und das Bild wie gestört hat.

00:12:22: Es ist egal womit ich's versucht habe.

00:12:24: Photoshop den Bereich markiert gesagt hier bitte entfernt die Person oder ChatGPT hochgeladen.

00:12:29: Der hat mich komplett verändert.

00:12:30: Ich sage ganz anders aus gibt es mittlerweile oder was würdest du sagen?

00:12:33: sind Tools mit denen man in so eine Richtung gehen kann?

00:12:35: Was generell gerade meine Empfehlung ist ist Free Pick Als Anbieter ist in der Firma aus Madrid, war früher eigentlich nur bekannt so ein bisschen als Shady Stockdaten Bank.

00:12:44: Wenn man hat sich immer so'n bisschen angefühlt, man wusste nie so recht, hat man wirklich die Nutzungsrechte an den Bildern, die man dort bekommt.

00:12:49: aber die haben jetzt in den letzten Jahren massiv Gas gegeben und haben jetzt auch letztes Jahr angefangen sehr viel im KI Bereich aufzuholen.

00:12:55: Und seitdem fahren die einen Momentum.

00:12:57: das ist der Wahnsinn!

00:12:58: Das heißt sie bringen jede Woche neue Features rein und es ist mittlerweile so eine coole Plattform.

00:13:02: Lösung für Bild-KI Tools also nicht nur Bild Generierung, Video Generierung sondern auch eben Bild Bearbeitung.

00:13:08: Die können das.

00:13:09: Das heißt, du gibst einfach dein Bild rein, retuschierst mal den Bereich aus, den du retuschieren möchtest klickst auf retuschiere und bist eigentlich schon fast fertig.

00:13:16: also dann kriegst du mit drei vier vorm Vorschläge wie im Photoshop auch bloß halt auf einer deutlich besseren Qualitätsstufe als das was Photoshop beim Moment kann.

00:13:23: Na

00:13:23: gut!

00:13:24: Also ich lerne hier noch neue Tools kennen.

00:13:25: und ein weiteres was ich vorhin noch nicht kannte bevor Du und Ich uns vorbereitet haben für dieses Gespräch heute ist Reef.

00:13:29: Was hat's denn damit auf sich?

00:13:30: Das

00:13:31: weiß man ehrlich gesagt sogar gar nichts wirklich.

00:13:33: also es ist ziemlich undurchsichtig was hinter Reef steckt.

00:13:35: Es ist ein neuer Bildgenerator auf dem Markt, den man auch kostenlos nutzen kann und ausprobieren kann.

00:13:40: Ist sehr stark bei abstrakten Perspektiven also so bei typischen Ansichten die man sonst nicht im realen Umfeld hat irgendwelche Frosch-Perspektiven oder andere Wahnsinnige Perspektive.

00:13:49: das funktioniert damit schon sehr gut.

00:13:51: Also die Promptdreue sozusagen ist auch sehr sehr gut dort.

00:13:54: Auch von der Bildqualität ist es nice.

00:13:56: Ich vermute dahinter steckt irgendein Anbieter der gerade was testen will und entsprechend das ganze auch kostenlose zur Verfügung stellt um Nutzerverhalten auszuwerten usw.

00:14:03: Aber solange dieses kostenlos an könnt ihr das natürlich gerne nutzen.

00:14:06: Ich wäre bloß ein bisschen vorsichtig beim Upload von Bildern dort entsprechend, weil man eben nicht weiß was dahinter steckt

00:14:11: und ich sage mal was macht das Ding momentan?

00:14:14: So, dass du es erwähnenswert findest in so einem Update.

00:14:16: Also was ist die Besonderheit dran?

00:14:18: Einfach weiß man wieder etwas komplett Neues auf dem Markt ist beziehungsweise eigentlich weiß man nicht ob sowas komplett neu ist oder irgendwas anderem basiert.

00:14:25: aber es ist trotzdem einfach eine spannende Entwicklung das jetzt auch so Player aus dem Nichts auftauchen.

00:14:29: vielleicht ist es am Ende ja auch bloß ein Experiment von irgendwelchen großen Mann weiße schlicht wirklich.

00:14:33: deswegen ich...das Müsste rieose macht's erwähnen sie währt irgendwie

00:14:38: Ja, spannend.

00:14:38: Und was ist so mit dem Thema Bewegtbild?

00:14:40: Hast du eben schon mal so gestriffen?

00:14:42: Also Zora war ja das letzte Update, was ich mitbekommen habe, wo sich auch mal richtig etwas getan hat, wo ja auch ganz viele Menschen super begeistert waren bei Chatchi Pity also Open Eye.

00:14:50: Was siehst Du im Bereich Bewegbild?

00:14:52: Oh, da pass hier gerade extremst viel!

00:14:54: Das ist extrem volatil diese Bereiche, der beschlagelt sich quasi wöchentlich die News-Meldungen.

00:15:00: gar nicht mal so gut mehr im Vergleich.

00:15:01: Das war mal, wo es letztes Jahr im März hatten sie das ja, glaube ich, angeteaselt.

00:15:06: da war's noch wirklich State of the Art und da war es halt wirklich bloß ein Teaser und nicht genutzbar für uns Normalsterbliche.

00:15:11: Da war es noch richtig toll.

00:15:12: aber als es dann released war kam plötzlich Google um die Ecke mit Google Wio II als Videokaimodell und hat einfach mal Sorry Locker in die Ecken gestellt.

00:15:20: und seitdem hat sich so viel wieder getan.

00:15:22: also Runways mit der neuen Generation Vier draußen Kling holt auf Luma Labs holt auch Pica Labs holts.

00:15:29: Also das ist wirklich grad so, wirklich immer wieder ein Kopf an Kopf rennen zwischen verschiedenen Anbietern.

00:15:34: Jede Woche was neu ist extrem spannend.

00:15:36: aber was mir gerade am persönlichen meisten Spaß macht es eben Google VO-Zwei einfach weil's sehr... wenig Ausschuss produziert im Vergleich zu den anderen.

00:15:45: Das heißt, ihr geht es in relativ gut immer natürlich auch mal use case abhängig.

00:15:49: man muss im videobereich halt bereit sein mehrere iterationen pro clip zu machen weil Es wird natürlich müll produziert.

00:15:55: bei so vielen frames ist einfach die Wahrscheinlichkeit deutlich höher als bei einer bildgenerierung dass Einfach irgendwas komisches passiert.

00:16:01: damit muss man leider umgehen können.

00:16:02: dann Das

00:16:03: war so meine Update-Seite.

00:16:04: Haben wir noch was vergessen?

00:16:05: Siehst du noch irgendwelche wichtigen Trends, womit rechnest du auch die nächsten sechs Monate?

00:16:09: Da frage ich mich nicht mal eine Prognose behaupten weil im Moment überschlägt sich wieder alles.

00:16:12: das kann doch mal sein dass mir wieder ne kleine Phase der Stagnation erleben oder es geht gleich einfach Schlag auf Schlag weiter.

00:16:18: da will ich jetzt gar nichts prognostizieren.

00:16:20: ehrlich gesagt da kann ich nichts richtig machen.

00:16:23: Es wird einfach immer weiter leichter zugänglich werden, das ganze Thema wie man jetzt im Manchett-GPT sieht.

00:16:27: Ich gehe auch davon aus dass OpenAI viel weiter arbeiten wird an der Bildgenerierung weil sie gemerkt haben wow!

00:16:33: Das bringt uns wirklich Userzahlen Weil die haben wir auf Twitter beziehungsweise auf X Lauthalts gemäckert dass zu viele User quasi Bilder generieren und Sie haben tagelang nicht mehr geschlafen so nach dem Motto weil sie nur die Infrastruktur am Laufen halten.

00:16:45: Also da wird noch einiges passieren Und vor allem wird spannend jetzt in den nächsten Wochen wenn AP öffnet, also quasi den technischen Zugang zu dieser neuen Bildgenerierung.

00:16:54: Weil dann wird es ganz viele neue Apps und Services geben oder verbessertes Service entsprechend die auch auf die Chatchivity-Bildgenerierung zugreifen können von außen.

00:17:03: Ja guck mal ist das doch noch hier in Zukunftsblick?

00:17:05: Also vielleicht wird das wieder unser nächstes Update.

00:17:08: Cool Jörg!

00:17:09: Ganz herzlichen Dank dir.

00:17:10: ich drück dir die Daumen mit Flake und deinem Business und wir hören uns hier bestimmt wieder.

00:17:13: Danke schön

00:17:19: Podcast.

00:17:20: Du merkst, hier ziehst du massig Wissen für dich und dein Unternehmen heraus!

00:17:25: Wenn du mit uns noch erfolgreicher werden möchtest, abonniere uns auf den gängigen Podcast-Plattformen – und hey, je größer wir werden, desto mehr Menschen können wir helfen….

00:17:34: Also erzähl doch auch deinen Kolleginnen und Kollegen von uns.

00:17:38: Bis zum nächsten Mal.

Neuer Kommentar

Dein Name oder Pseudonym (wird öffentlich angezeigt)
Mindestens 10 Zeichen
Durch das Abschicken des Formulars stimmst du zu, dass der Wert unter "Name oder Pseudonym" gespeichert wird und öffentlich angezeigt werden kann. Wir speichern keine IP-Adressen oder andere personenbezogene Daten. Die Nutzung deines echten Namens ist freiwillig.