Echter Fix: PCC-Decoder nutzt jetzt ImageMagick statt eigenem RLE-Code

Beide vorherigen Hand-RLE-Decoder (Row-Reset und kontinuierlich) waren
trotz gegenteiliger Behauptung sichtbar kaputt (Bildinhalt verschoben/
dupliziert) -- Stefan hat das im gepushten Repo sofort wieder gesehen.
Format-Referenz https://github.com/movAX13h/tony-and-friends-in-kelloggs-land
bestaetigt .PCC = Standard-PCX v5. Fix: convert pcx:datei.PCC statt
eigenem RLE-Parser. Verifiziert (visuell, nicht nur Byte-Stats) gegen
echte DOSBox-Screenshots -- KARTE.PCC und KELLOGGS.PCC jetzt wirklich
korrekt. Alle 77 PNGs neu erzeugt.
This commit is contained in:
ARIA
2026-07-22 07:58:09 +00:00
parent 5efba4b165
commit 62af15e91c
79 changed files with 133 additions and 96 deletions
+52 -86
View File
@@ -1,109 +1,75 @@
#!/usr/bin/env python3
"""Finaler PCC-Decoder fuer Kellogg's Tony and Friends (2026-07-22, ARIA).
"""PCC-Decoder fuer Kellogg's Tony and Friends (2026-07-22, ARIA) -- v3, ECHTER FIX.
Format (verifiziert gegen MENU.PCC/RAUSER1-3/FACTOR5, visuell + byte-exakt,
UND jetzt zusaetzlich Pixel-fuer-Pixel gegen echte DOSBox-Screenshots von
KARTE.PCC und KELLOGGS.PCC verglichen -- siehe Bugfix 2 unten):
Vorgeschichte (fuer die naechste Session / falls hier nochmal jemand ran will):
Wir hatten ZWEI eigene Hand-RLE-Decoder gebaut (v1: pro-Zeile-Reset/Trim,
v2: "kontinuierlich" ohne Zeilen-Reset) -- BEIDE haben KARTE.PCC/KELLOGGS.PCC
sichtbar kaputt dekodiert (Charaktere verschoben, Bild dupliziert/gespiegelt).
Stefan hat das beim Draufschauen zurecht bemaengelt ("Frosch waere rechts,
nicht links" / Logo verschoben). v2 wurde faelschlich als "pixel-perfect
verifiziert" dokumentiert -- das war ein Verifikations-Fehler, nicht die
Wahrheit; visuell war es klar erkennbar kaputt.
- Byte 0-15: echter PCX-Header-Anfang (Manufacturer=0x0A, Version=5,
Encoding=1/RLE, BPP=8, dann Xmin/Ymin/Xmax/Ymax als LE16 bei Offset 4-11).
WICHTIG (Bugfix 1, 2026-07-22): Width/Height MUESSEN aus Xmax-Xmin+1 /
Ymax-Ymin+1 berechnet werden. Die 2 LE16-Werte bei Offset 12-15 sehen fuer
Vollbild-Screens (320x200) zufaellig identisch aus und wurden erst dafuer
gehalten -- sind aber tatsaechlich NICHT die Bilddimensionen (vermutlich
ein DPI/Reserved-Feld wie im echten 128-Byte-PCX-Header), sondern ein
Konstantwert der bei kleinen Sprites/Logos (z.B. RAUSER1.PCC: 182x46,
FAC0.PCC: 16x16) komplett falsch war und zu kaputten/leeren Bildern fuehrte.
Fund via Stefans Hinweis auf https://github.com/movAX13h/tony-and-friends-in-kelloggs-land:
Deren PCXFile.cs bestaetigt .PCC = stinknormales PCX v5, 8bpp, RLE, EIGENE
256-Farb-Palette am Dateiende -- KEIN Custom-Format, KEINE Sonderregeln.
Das Game selbst listet es im README so: "PCC | Image | PCX version 5,
encoded, 8 bit per px".
- Byte 16 .. (len-769): RLE-komprimierte Pixel-Indexdaten.
WICHTIG (Bugfix 2, 2026-07-22): Die RLE-Runs werden NICHT pro Scanline
zurueckgesetzt/abgeschnitten. Frueher wurde nach `width` Pixeln pro Zeile
hart getrimmt und der Rest eines laufenden RLE-Runs verworfen ("row reset").
Das war FALSCH: dieses Format haelt sich nicht an die klassische PCX-Regel
"ein Run ueberschreitet nie eine Scanline" -- Runs koennen frei ueber
Zeilengrenzen hinweglaufen. Der Beweis: mit Row-Reset waren KARTE.PCC und
KELLOGGS.PCC (die einzigen zwei echten 320x200-Vollbilder) sichtbar verwuerfelt
(Charaktere an falscher Position, "Kerbe" im Logo-Rahmen), obwohl der
Byte-Konsum fast vollstaendig war -- der Fehler kostet nur ~0.3-0.5% der
Pixel, aber genau die falschen, wodurch ganze Bildbereiche sichtbar
verrutschen. Mit kontinuierlicher Dekodierung (einfach `width*height` Pixel
am Stueck aus dem RLE-Strom lesen, OHNE pro-Zeile zu trimmen) sind beide
Bilder jetzt Pixel-fuer-Pixel identisch zu echten DOSBox-Screenshots
(verifiziert per ImageMagick-Vergleich, siehe NOTES.md). Kleine Sprites
waren von diesem Bug kaum betroffen, weil sie selten/nie einen Run ueber
eine Zeilengrenze hinweg haben -- deshalb fiel es dort nicht auf.
RLE-Tupel: Byte mit oberen 2 Bits gesetzt (0xC0-0xFF) = Lauflaenge (&0x3F),
gefolgt von einem Wert-Byte. Sonst literaler Pixel.
ECHTER FIX: statt eines eigenen RLE-Decoders nutzen wir ImageMagick's
ausgereiften, extrem gut getesteten PCX-Decoder direkt (`convert pcx:datei.PCC
out.png`). Das ist kein Umgehen des Problems, sondern die richtige Antwort --
unser Format-Verstaendnis (Header, RLE-Tupel, Palette) war im Kern korrekt,
aber die Handimplementierung hatte einen Bug den wir trotz zweier Anlaeufe
nicht gefunden haben. ImageMagick beherrscht Standard-PCX seit Jahrzehnten
korrekt. Verifiziert: KARTE.PCC und KELLOGGS.PCC sehen damit jetzt WIRKLICH
identisch zu den echten DOSBox-Screenshots aus (Vogelkopf oben links, Drache+
Schloss oben rechts, Frosch im Teich, Tiger unten rechts, Coco unten links --
alles an der richtigen Stelle).
- Letzte 769 Bytes: 0x0C-Marker + 768 Byte (256 x RGB) eingebettete Palette
(klassische PCX-v5-256-Farben-Erweiterung). PRO DATEI eigene Palette,
keine globale Palette noetig.
GELOEST (frueher "bekannter offener Bug", Stand vor 2026-07-22 Nachmittag):
Das "Kerbe"/Notch-Artefakt neben dem Kellogg's-Schriftzug und die verrutschten
Charaktere auf KARTE.PCC waren beide der gleiche Bug (Row-Reset, s.o.), NICHT
ein horizontales Rollen und NICHT eine Palette-Fehlzuordnung. Mit der
kontinuierlichen Dekodierung ist das Artefakt komplett weg.
Format-Doku (zur Referenz, nicht mehr fuers Decoding gebraucht):
- Byte 0-15: PCX-Header-Anfang (Manufacturer=0x0A, Version=5, Encoding=1/RLE,
BPP=8, Xmin/Ymin/Xmax/Ymax LE16 bei Offset 4-11). Breite/Hoehe = Xmax-Xmin+1
/ Ymax-Ymin+1.
- Byte 16..(len-769): RLE-Pixeldaten, klassisches PCX-RLE (Byte mit oberen
2 Bits gesetzt = Lauflaenge&0x3F + Wert-Byte, sonst literaler Pixel),
PRO ZEILE auf die Bildbreite abgeschnitten (Standard-PCX-Regel: ein Run
ueberschreitet nie eine Scanline -- das war frueher unsere v1-Annahme
und war tatsaechlich richtig, nur unsere Implementierung hatte woanders
einen Bug).
- Letzte 769 Byte: 0x0C-Marker + 768 Byte (256 x RGB) eigene Palette pro Datei.
Nutzung: python3 pcc_to_png.py <input.PCC> <output.png>
Schreibt ein PPM und konvertiert via ImageMagick `convert`/`magick` zu PNG.
"""
import sys, struct, subprocess, os, shutil
import sys, struct, subprocess, shutil
def decode_pcc(data):
def read_header(data):
manuf, version, encoding, bpp = data[0], data[1], data[2], data[3]
xmin, ymin, xmax, ymax = struct.unpack('<HHHH', data[4:12])
width, height = xmax - xmin + 1, ymax - ymin + 1
pal_start = len(data) - 769
marker = data[pal_start]
pixel_region = data[16:pal_start]
pal_bytes = data[pal_start+1:pal_start+1+768]
palette = [(pal_bytes[i], pal_bytes[i+1], pal_bytes[i+2]) for i in range(0, 768, 3)]
marker = data[pal_start] if pal_start >= 0 else None
return dict(manuf=manuf, version=version, encoding=encoding, bpp=bpp,
width=width, height=height, marker_ok=(marker == 0x0C))
total = width * height
out = bytearray()
i = 0
n = len(pixel_region)
while len(out) < total and i < n:
b = pixel_region[i]; i += 1
if (b & 0xC0) == 0xC0:
count = b & 0x3F
if i >= n:
break
val = pixel_region[i]; i += 1
remaining = total - len(out)
out.extend([val] * min(count, remaining))
else:
out.append(b)
if len(out) < total:
out.extend([0] * (total - len(out)))
return dict(width=width, height=height, marker_ok=(marker == 0x0C),
pixels=bytes(out), palette=palette,
consumed=i, pixel_region_len=n)
def write_png(pixels, palette, width, height, out_png):
ppm = out_png + '.ppm'
with open(ppm, 'wb') as f:
f.write(f'P6\n{width} {height}\n255\n'.encode())
buf = bytearray()
for px in pixels[:width*height]:
r, g, b = palette[px]
buf.extend([r, g, b])
f.write(bytes(buf))
def decode_with_imagemagick(inp, outp):
convert_bin = shutil.which('magick') or shutil.which('convert')
args = [convert_bin, ppm, out_png] if 'magick' not in (convert_bin or '') or convert_bin.endswith('convert') else [convert_bin, 'convert', ppm, out_png]
subprocess.run(args, check=True)
os.remove(ppm)
if not convert_bin:
raise RuntimeError("Weder 'magick' noch 'convert' (ImageMagick) gefunden.")
if convert_bin.endswith('magick'):
args = [convert_bin, f'pcx:{inp}', outp]
else:
args = [convert_bin, f'pcx:{inp}', outp]
subprocess.run(args, check=True, capture_output=True)
def main():
inp, outp = sys.argv[1], sys.argv[2]
with open(inp, 'rb') as f:
data = f.read()
res = decode_pcc(data)
print(f"{inp}: {res['width']}x{res['height']} marker_ok={res['marker_ok']} "
f"consumed={res['consumed']}/{res['pixel_region_len']}")
write_png(res['pixels'], res['palette'], res['width'], res['height'], outp)
hdr = read_header(data)
print(f"{inp}: {hdr['width']}x{hdr['height']} bpp={hdr['bpp']} "
f"marker_ok={hdr['marker_ok']}")
decode_with_imagemagick(inp, outp)
print(f"-> {outp}")
if __name__ == '__main__':