la photo c'est fini ...

Démarré par hetocy, Mars 25, 2023, 07:49:58

« précédent - suivant »

Nicolas Meunier

pour la blague, l'application Photo d'Apple, met ensemble les photos des mêmes personne et elle ne fait pas la différence entre les photos de mes modèles et les images générées des même personnes.

Cependant une IA plus balaise va trouver des petites différences notamment légèrement plus de symétrie dans le visage. De manière amusante c'est justement une des retouches que des pros feront.

Nicolas Meunier

Citation de: Tomzé le Hier à 11:27:57Très intéressantes tes explications sur ton nouveau workflow. Ce serait sympa que tu montres la photo de départ et la photo finale en bout de chaine.
Il faut que j'obtienne certaines validations avant de pouvoir montrer mais si c'est possible je montrerais ou a défaut sur des exemples sans consequences.

Hector06

Citation de: Tomzé le Hier à 11:27:57Très intéressantes tes explications sur ton nouveau workflow. Ce serait sympa que tu montres la photo de départ et la photo finale en bout de chaine.

La description de photos « neutres » aussi a un côté intéressant



R5 II (enfin, en rêve)

Monsieur

Citation de: Nicolas Meunier le Hier à 11:34:32Il faut que j'obtienne certaines validations avant de pouvoir montrer mais si c'est possible je montrerais ou a défaut sur des exemples sans consequences.
Pars sur de l'autoportrait.  Pas de problèmes de droits :D
Citation de: Nicolas Meunier le Hier à 11:24:00Je remet une pièce dans la machine : [...]
Techniquement, on pourrait très vite ne plus rappeler le modèle, générer des poses qui n'ont jamais été réalisées en studio, inventer des éclairages qui n'ont jamais existé pendant la séance, changer complètement les vêtements, la morphologie ou le contexte.
Plus on s'éloigne du dataset d'origine, moins le résultat correspond réellement au modèle tel que je l'ai photographié, et moins il correspond à mon propre travail photographique.
Personnellement, c'est justement cette limite qui m'intéresse : je veux rester suffisamment proche de mes photos pour que l'image finale conserve quelque chose du shooting réel.
Mais dans un contexte publicitaire, par exemple, cette limite pourrait très facilement ne plus avoir beaucoup d'importance.

Clairement, une fois la personne "scannée", plus vraiment besoin de référence.
Un ami s'est récemment amusé à s'intégrer dans des vidéos 100% made in IA.
C'est franchement bluffant.

Ca m'a motivé à creuser un peu plus le tout et j'ai commencé à installer quelques models sur ComfyUI, pour voir. Le paramétrage est long et fastidieux, mais ça se fait plutôt bien, pour des résultats convaincants assez rapides.

jenga

Citation de: Nicolas Meunier le Hier à 11:24:00C'est là qu'apparaît un paradoxe assez intéressant : pour certains, ce seront des images « 100 % IA », puisqu'elles sont générées à partir d'un prompt.
Oui, puisque 100% des pixels sont calculés par une IA.

Citation de: Nicolas Meunier le Hier à 11:24:00Pourtant, elles viennent de ma conception initiale, de ma lumière, de mes modèles, de leurs poses, de leurs expressions, des vêtements choisis, et de mes propres photographies utilisées pour spécialiser le modèle.
Et des centaines de millions d'images du net que le modèle pré-entrainé a utilisé, avant le fine-tuning sur tes images.

Je ne jette pas l'IA en bloc, d'un point de vue technique les transformers et modèles de diffusion m'intéressent beaucoup, mais ils produisent des images, pas des photos.

Nicolas Meunier

Citation de: Monsieur le Hier à 13:35:32Pars sur de l'autoportrait.  Pas de problèmes de droits :D
Clairement, une fois la personne "scannée", plus vraiment besoin de référence.
Un ami s'est récemment amusé à s'intégrer dans des vidéos 100% made in IA.
C'est franchement bluffant.

Ca m'a motivé à creuser un peu plus le tout et j'ai commencé à installer quelques models sur ComfyUI, pour voir. Le paramétrage est long et fastidieux, mais ça se fait plutôt bien, pour des résultats convaincants assez rapides.

Oui et non. Je te donne un exemple : j'ai fait des tonnes de photos de lingerie d'une copine en silhouette, donc elle est quasi dans l'obscurité totale et seul sa silhouette se découpe avec un fond très lumineux. J'ai testé beaucoup de lumière différente ce jour là. si j'active mon modèle et que je demande ce type de lumière le réalisme est top, sans mon modèle ca le fait beaucoup moins bien. Donc pour faire une image quelconque oui c'est cool mais quelque chose de précis mon workflow reste plus complet et plus précis. Un bon exemple aussi c'est l'interaction du vêtement avec la personne, comment un élastique va écraser un peu la peau par exemple, ca ca se prompt très mal alors que mon modèle IA spécifique va très bien l'apprendre.

Nicolas Meunier

Citation de: jenga le Hier à 15:27:15Oui, puisque 100% des pixels sont calculés par une IA.
Et des centaines de millions d'images du net que le modèle pré-entrainé a utilisé, avant le fine-tuning sur tes images.

Je ne jette pas l'IA en bloc, d'un point de vue technique les transformers et modèles de diffusion m'intéressent beaucoup, mais ils produisent des images, pas des photos.

Une fois le surentraînement fait et tant qu'on demande des choses du périmètre de cet entrainement, on reste proche, c'est pour ca que dans mon wirkflow je précise que par exemple le but est d'avoir le même vêtement, la même lumière, la même pose. Et comme ca présente ce qui est statistiquement le plus probable, c'est mon dataset qui vient en priorité. Le 5.3 milliards d'images pour le modèle global, lui sert a comprendre qu'un humain a 2 bras et deux jambes par exemple. Ca change complètement si je fais une séance en bikini que fond blanc et que je parle de château lugubre et de lumière rouge etc etc... et surtout si je tape : A la facon de ...

Mais de la même manière l'outil IA pour retirer une personne en fond d'un beau paysage est le même qui va remplacer un ciel un peu nul par un ciel dense et changer totalement l'ambiance de la prise de vue. Dans le premier cas ca pose peut de problème éthique et dans le second beaucoup plus.

Perso c'est rare que je produise des photos, je produis des images. Il peut y avoir des ajouts de 3D, pas mal de photoshop, faire appel à un Concept Artist pour faire le fond. Donc j'ai déjà intégré le fait que je ne fais pas de la photo.

bozart

Je n'avais jamais eu la curiosité d'aller voir ton site (sous ton nom) : c'est fait (mais je ne comprends pas qu'il puisse y avoir une telle erreur sur le terme ... "Portait" : ??? )
Pour moi, tout ce faux (même assez bien fait) est affligeant. Déprimant même. Ce sont des performances techniques. Mais quoi d'autre ?
Tout ça... pour ça ?

jenga

#1833
Citation de: Nicolas Meunier le Hier à 16:44:59Mais de la même manière l'outil IA pour retirer une personne en fond d'un beau paysage est le même qui va remplacer un ciel un peu nul par un ciel dense et changer totalement l'ambiance de la prise de vue. Dans le premier cas ca pose peut de problème éthique et dans le second beaucoup plus.

Je le sais bien, et c'est aussi la même qui débruite, défloute, enlève les "distractions" (!!!), ajoute un pot de fleurs pour faire joli, etc. C'est pourquoi ma limite est là: pas d'IA pour traiter les photos, ou alors ce n'est plus de la photo.
Autant ranger l'APN dans un placard et se contenter de prompter.

(Je ne parle pas d'éthique, juste d'intérêt perso pour une activité: autant j'aime bricoler des petits modèles d'IA pour comprendre vraiment comment ça marche, autant je n'éprouve aucun intérêt à utiliser des modèles tout faits)

jenga

#1834
Citation de: Nicolas Meunier le Hier à 16:44:59Et comme ca présente ce qui est statistiquement le plus probable, c'est mon dataset qui vient en priorité.
Pas d'accord avec cela, ou plus probablement  je n'ai pas compris la formulation. Quand le modèle génère une image, il ne choisit pas l'image globalement la plus probable parmi un ensemble prédéfini d'images.
Mais tu le sais bien.

Nicolas Meunier

Citation de: bozart le Hier à 20:47:45Je n'avais jamais eu la curiosité d'aller voir ton site (sous ton nom) : c'est fait (mais je ne comprends pas qu'il puisse y avoir une telle erreur sur le terme ... "Portait" : ??? )
Pour moi, tout ce faux (même assez bien fait) est affligeant. Déprimant même. Ce sont des performances techniques. Mais quoi d'autre ?
Tout ça... pour ça ?

et bien déjà sur mon site, il y a zero image avec de l'IA donc... tu as tiré des conclusions très hatives. Et sinon oui je suis plus technicien que poète et on me paie pour ca. Dans la photo pro dans les milieus où je travaille c'est un directeur artistique qui a une idée, à moi de savoir la concrétiser. De la même qu'au cinema il y a un realisateur avec sa vision et un directeur de la photo pour la rendre réelle.

Nicolas Meunier

Citation de: jenga le Hier à 22:36:42Pas d'accord avec cela, ou plus probablement  je n'ai pas compris la formulation. Quand le modèle génère une image, il ne choisit pas l'image globalement la plus probable parmi un ensemble prédéfini d'images.
Mais tu le sais bien.

Alors quand je surentraine mon modèle je crée dans l'espace latent de nouveau poids assez fort qui sont associées avec tous les termes des annotations de mes photos, donc quand ces mots reviennent ca attire vers ces zones de l'espace latent. Pas parfaitement, pas totalement mais c'est totalement visible. Je te donne un exemple j'ai des talons aiguilles avec une forme TRES reconnaissable car ils ont tous les codes visuels des grosses chaussures Caterpillar mais en talon aiguille. Hors quand j'écrits dans un prompt Talon aiguilles... et bien ce sont mes chaussures qui arrivent et même exactement. Mais pire, si je décris d'autres chaussures, elles ne vont pas avoir la forme de talon aiguille mais on va retrouver des éléments distinctifs des Caterpillar.

Cela est possible car mon modèle est entrainer avec peu de fringues différentes et ce modèle a un poids assez fort.

D'autres détails : si mon dataset contient essentiellement des photos sur un cyclo blanc et que celui-ci est un peu sale... toutes les images générées sur un sol blancs presenteront des salissures du même type, même si on demande explicitement qu'il n'y en ai pas. Preuves u'avec quelques dizaines de photos dans un dataset, le concept de "sol blanc" s'est associé à mes photos et non à toutes les photos de l'univers de sols blancs sans priorité.

Nicolas Meunier

Pas tout a fait notre sujet mais interessant quand même : quand ChatGPT prend le controle de Lightroom


Nicolas Meunier

Citation de: jenga le Hier à 22:28:15Je le sais bien, et c'est aussi la même qui débruite, défloute, enlève les "distractions" (!!!), ajoute un pot de fleurs pour faire joli, etc. C'est pourquoi ma limite est là: pas d'IA pour traiter les photos, ou alors ce n'est plus de la photo.
Autant ranger l'APN dans un placard et se contenter de prompter.

(Je ne parle pas d'éthique, juste d'intérêt perso pour une activité: autant j'aime bricoler des petits modèles d'IA pour comprendre vraiment comment ça marche, autant je n'éprouve aucun intérêt à utiliser des modèles tout faits)

Je pense qu'on est sur la sensibilité de chacun. Perso je suis très content quand je fais des photos d'avoir un contact humain, de maitriser la lumière, voir avec mes flashs de dompter la météo, etc... et par contre j'ai parfois, surtout en studio, une envie de faire évoluer mes personnages dans des décors bien différents. J'ai passé des années à chercher des décors, parfois j'en trouve, parfois on m'en fabrique mais ca reste rare, donc depuis 12 ans je cherche des technique pour cela, j'ai appris photoshop, les masquages, la 3D, j'ai pris des cours, etc... et puis l'IA a rajouté de nouvelles possibilités.
bien spur ca c'est mon cas, vouloiur voir mes modèles dans mes mise en scène mais augmenté par l'ajout d'élément de décors. En plus c'est pour un type bien particulier d'images, je fais enormement de photos de sports, là l'IA c'est pour retirer tout ce qui dépasse dans le gymnase c'est tout.

bozart

Citation de: Nicolas Meunier le Aujourd'hui à 00:26:15et bien déjà sur mon site, il y a zero image avec de l'IA donc... tu as tiré des conclusions très hatives.

Tu veux dire que les modèles sont vraiment photographiées dans ces lieux ?

claude 92

Préhistoire :
Une des premières photos traitées en informatique (Mac et Photoshop n'existait pas encore) était une image qui lançait un nouveau modèle de voiture française haut de gamme.
J'ai proposé au DA une anamorphose de 4% qui valorisait le style de "design Pininfarina" en vogue à cette époque.
Le résultat fût accepté et l'affiche 4X3 faisait saliver le chaland.
Cette application et bien d'autres furent utilisées (pour "les jambes des mannequins" par exemple).
Question : ce n'était déjà plus de la photo ? 

(4% était le maximum acceptable visuellement)

jenga

#1841
Citation de: claude 92 le Aujourd'hui à 07:35:14une anamorphose de 4% (...)
Question : ce n'était déjà plus de la photo ? 
Pour moi, ça reste de la photo (retouchée), mais chacun a sa réponse.

La mienne: c'est de la photo tant que je fais des retouches dont je connais le fonctionnement, la méthode interne, ou qu'un tireur habile saurait réaliser. Cela inclut les changements de courbes, les tampons, les déformations de geométrie, etc. C'est-à-dire tant que je comprends la méthode interne de production.

Ce n'est plus de la photo quand une machine produit une image sans que je puisse expliquer précisément comment elle est produite (*).

J'évite intentionnellement le terme "algorithmique", qui convient pourtant parfaitement pour différencier les deux catégories: la première l'est, pas la seconde. En effet, ce terme est souvent utilisé pour décrire l'IA, ce qui est un contresens absolu puisque justement l'IA générative ne l'est pas.

(*) dans le cas d'un modèle IA, on peut éventuellement connaitre l'architecture du modèle, voire ses coefficients, donc le fonctionnement microscopique, mais "l'explicabilité" du résultat reste un problème théorique ouvert.

Nicolas Meunier

Citation de: bozart le Aujourd'hui à 07:05:28Tu veux dire que les modèles sont vraiment photographiées dans ces lieux ?

dans la grande majorité des cas oui sauf une ou deux 3D.