Creare sezioni scientifiche da foto reali con Gemini/ChatGPT

Nella progettazione di schede didattiche, verifiche o presentazioni reperire illustrazioni scientifiche che siano al tempo stesso chiare, accurate e prive di elementi visivi distraenti può essere problematico.
Condivido qui una tecnica di visual prompting multimodale per Gemini che consente di trasformare un’immagine reale (come una foglia raccolta in cortile, un preparato o un elemento anatomico) in una tavola illustrata scientifica in spaccato/sezione, completa di callout ed etichette descrittive.
Si tratta di un prompt strutturato per guidare il modello multimodale nell'elaborazione visiva: partendo da una comune fotografia di un soggetto biologico o naturalistico, Gemini isola il soggetto ed elabora una grafica esplicativa in sezione su fondo neutro, mantenendo la coerenza morfologica con l’esemplare di partenza e integrandone la microstruttura interna (tessuti, vasi conduttori, strati cellulari o organi interni).
Il prompt di riferimento
Questo è il prompt che ho utilizzato:
"Trasforma il soggetto principale dell'immagine caricata in un chiaro diagramma educativo in sezione su sfondo bianco, in lingua [italiana]. Mantieni le caratteristiche distintive e proprie del soggetto nell'immagine originale, mostra una sezione trasversale o un interno stratificato credibile e preciso, rigoroso dal punto di vista scientifico. Aggiungi annotazioni con etichette chiare. Fai in modo che sembri una grafica scientifica da manuale [o da museo], dando priorità a chiarezza e accuratezza rispetto a uno stile drammatico o artistico."
Questa formulazione produce risultati soddisfacenti (o rigorosi in qualche caso) e pronti all'uso in quanto definisce in maniera chiara il genere visivo ("diagramma educativo", "grafica da manuale o da museo"), vincolando al tempo stesso l'estetica dell'AI (impedendole quindi di produrre rendering artistici, iper-drammatici o da fantascienza). Lo sfondo bianco rendendo l'immagine immediatamente inseribile in una verifica, un PDF o una slide senza bisogno di fotoritocco. Al tempo stesso fa in modo che la forma, le venature, il contorno e le proporzioni specifiche del campione fotografato siano preservati.
Come si osserva dall’esempio, aggiunge delle etichette/spiegazioni, che sono personalizzabili nel prompt.
È altresì possibile chiedere di generare una versione "con riquadri ed etichette vuote (lettere A, B, C...)" per creare compiti ed esercizi di riconoscimento delle parti anatomiche o in lingua straniera, creata su misura per gli obiettivi didattici che avete in mente.
Se le etichette testuali generate presentano refusi o terminologie troppo generiche, potete affinare la richiesta specificando in anticipo i termini scientifici desiderati (ad esempio: "includi etichette per: epidermide superiore, mesofillo spugnoso, cellule di guardia, stoma").
Risultati eccellenti si ottengono con ChatGPT. Se potete accedere dai vostri account personali, provate voi stessi…





Commenti