Een lief prentenboek voor de allerkleinsten (3-5 jaar) over Konijn, Egel en Muis die samen ontdekken dat niemand alles alleen kan — maar samen alles lukt. Gebaseerd op het concept “spontane orde” uit het boek Reportage van James Corbett.
Wat we veranderd hebben aan de flow
Dit boek is het eerste waarin we een eigen LoRA hebben getraind op FLUX.1-dev om de dierpersonages consistent te maken. De illustratie-flow doorliep meerdere iteraties om tot een bevredigend resultaat te komen:
Wat we wilden bereiken
Drie jonge dieren — Konijn, Egel en Muis — die in elke illustratie herkenbaar en consistent terugkomen. Het verhaal speelt zich in een warm Ghibli-bos, en de personages moeten duidelijk verschillende diersoorten zijn, niet mensen met dieren-oren of vage wezentjes die op elkaar lijken.
Wat er mis ging
- Pure FLUX (3 dieren) — FLUX.1-dev kan uitstekend één dier genereren, maar bij drie verschillende dieren in één plaat gaat het de mist in: mensengezichten, kinderen met dierenoren, ghost-figuren, en dieren die op elkaar lijken (de egel werd telkens een tweede konijn of muis).
- Pony Diffusion V6 XL — een SDXL-finetune getraind op anthro/furry art. Het leverde antropomorfe figuren (menselijk lichaam + dierenkop), maar in een stijl die past bij de furry-community, niet bij een lief kinderboek. Verkeerde esthetiek.
- Composite-aanpak — elk dier apart genereren (wat perfect werkt) en daarna combineren op een achtergrond. Het resultaat oogt “geplakt”: verschillende lichtval, verschillende kijkhoek, geen natuurlijke integratie.
- LoRA met 3 dieren — na het trainen van een LoRA (2000 stappen, 40 dataset-images) waren de losse dieren perfect: prachtig gedetailleerd, duidelijk de juiste soort. Maar zodra we drie dieren in één plaat vroegen, daalde de kwaliteit dramatisch: de dieren werden samengeperst, onduidelijk, en niet herkenbaar als konijn/egel/muis.
Waar we voor hebben gekozen
Eén dier per illustratie. De LoRA produceert prachtige, gedetailleerde, herkenbare dieren als ze alleen in beeld zijn. Per hoofdstuk tonen we het dier dat in dat hoofdstuk de sleutelrol heeft: Konijn vindt het potlood, Egel weet waar hout vandaan komt, Muis graaft in de klei. De tekst vertelt het volledige verhaal met alle drie de vrienden; de illustratie vangt het moment van één dier. Dat is een klassieke prentenboek-aanpak en de kwaliteit is 100% beter dan het forceren van drie dieren in één plaat.
De LoRA is getraind met ai-toolkit op een M5 Max ( Apple Silicon, MPS). Het FLUX.1-dev diffusers-model is handmatig geconverteerd vanuit de fp8-checkpoint omdat de ai-toolkit diffusers-formaat vereist en het model gated is op HuggingFace. De T5-XXL text encoder is apart gedownload van een niet-gated bron. De training duurde ~6 uur (2000 stappen, 40 dataset-images met 3 trigger words: konijnboek6, egelboek6, muisboek6).
Productie: Regie door deepseek-v4-flash:cloud (regisseur). Tekst door aya-expanse:32b (lokale LLM). Illustraties met FLUX.1-dev + eigen LoRA (boek6_35_dieren_v1, stap 2000, strength 0.8). Scène-keuze per hoofdstuk door qwen2.5vl:32b (vision-LLM). Bron: Reportage van James Corbett (corbettreport.com). Ook hier gold: niet elke lokale LLM werkte mee — muse-glimmer:30b-mlx weigerde het kinderboek te schrijven. Dit verhaal is een vrije interpretatie; voor opmerkingen of vragen kunt u het contactformulier op brainfusion.nl gebruiken.