Nicht, dass die Buchenholzstuhllehne aus obigem Beispiel auf einmal mit dem Buchenholztisch dahinter verschmilzt, wenn der Kontrast zwischen beiden aus bestimmten Winkeln gen Null geht.
Genau, und weil DLSS 5 Zugriff auf diese Daten hat Vektoren/Masken/Albedos hat ist es kein Filter und der Buchenholztisch wird genauso wenig mit der Birkenholzstuhllehne verschmelzen wie zwei völlig separate Objekt IDs in einer professionellen 3D Engine wie Unreal. Für den Algorithmus sind Tisch und Stuhl glasklar getrennte Instanzen.
Ich erinnere hier an die unsäglichen 3D-Konvertierungen von 2D-Filmen – über weite Teile muss DLSS die gleichen Herausforderungen meistern
Du schiebst DLSS5 gedanklich in die Schublade generativer KI mit prompts. Ein Bildgenerator hat in der Tat kein ausgeprägtes räumliches Verständnis.
Was glaubst du eigentlich wie 2D zu 3D Konvertierungen im Jahr 2010 funktioniert haben? Das war händische Sklavenarbeit, ein Servercluster hat das nicht mit KI"berechnet", der hat nur die händisch freigestellten Ebenen gerendert. (Rotoskoping)
Da ist nix unvollständig ... der Frame ist bereits fertig gerendert bevor DLSS5 mit dem Post Processing anfängt.
In der Demo schon, denn das komplett fertige Bild inkl. neural rendering liegt ja erst dann vor wenn DLSS5 mit dem "post processing" fertig ist.

Jetzt hängst du dich sogar schon an Formulierungen auf.
Häh, was ist das denn für eine krude Schlussfolgerung?
Warum soll das krude sein? Bei euch ist es doch egal welche Kaffeesorte man verwendet, ob man ganze Bohne oder Pulver in unterschiedliche Kaffeemaschinen hineingibt und wie diese das verarbeiten.
Am Ende ist das was unten herauskommt einfacher "Filterkaffee" und die Maschine, egal was sie tut, der billige "Filter" für wenige Cent.
Ergo reicht eine Billig-Maschine von "Ramba-Zamba" für 10 Euro von der Resterampe und man muss gar nicht in einen Kaffee-Vollautomaten investieren, weil dieser eh nichts besser kann und die Abläufe in der Maschine nicht von außen betrachtet werden können und das Angst schürt.
Tut mir leid, eine bessere Analogie um das in das Real-Life für Leute mit langer Leitung zu übersetzen, fällt mir gerade nicht ein.
DLSS5 greift ein nach dem das Bild komplett gerendert wurde
Korrekt.
Das ist per Definition (...) Post-Processing...
Ja, es ist Post-Processing.
Ich möchte dass sie per Hand von einem echten Menschen erstellt werden.
Warum schreibst du das nicht einfach von Anfang an, anstatt DLSS5 rundenlang irgendwelchen technischen Unsinn anzudichten? Wenn du einfach gesagt hättest, dass du traditionelle Handarbeit bevorzugst und ein Nativ-Romantiker bist, wäre die Sache erledigt gewesen.
Es gibt auch Leute die nur Bio Produkte Essen oder kein Eis mögen und auch lieber das flimmernde per Handarbeit gecodete TAA bevorzugen, anstatt das neuronal trainierte KI-Upscaling zu benutzen. No Front. Mach das so. Ob das leistungstechnisch und von der Bildqualität her sinnvoll ist sei mal dahingestellt, aber das steht mir nicht zu es zu bewerten, ist schließlich deine Meinung und das ist ok so.
Genauso wie ich keine KI generierten Synchronsprecher oder gar Videos möchte.
Ein KI-Synchronsprecher erzeugt völlig neue, fiktive Audioformen aus dem Nichts, basierend auf reinem Text. Er hat kein physisches Fundament, genauso wenig wie ein KI-Video das aus einem Prompt erstellt wird. Du verfehlst komplett das Thema wie (fast) alle anderen zuvor.