Vision & Eingabe
dsh-vision-toolkit
Zehn Vision-Tools für UI-Rekonstruktion, Grounding und Pixel-Diff-Verifikation.
Worum es geht
Ein DeepSeek-Harness-natives Bundle aus zehn Vision-Tools: Bild-Q&A, Grounding und Detection mit Pixelkoordinaten, Long-Screenshot-OCR, Zuschneiden, Farbextraktion, HTML-Screenshots und Pixel-Diff. Die Tools werden progressiv über einen vision-tools-Skill eingebunden.
DeepSeek Harness-native integration for agent-vision-toolkit: image Q&A, long-screenshot OCR, UI restoration, grounding, pixel diff, Artifacts, and Web UI.
Warum das fürs Design zählt
- UI-Rekonstruktion schließt den Loop mit Zahlen: ein eingecheckter Workflow iteriert einen Nachbau von 6,04 % Pixeldifferenz auf 0 %.
- Grounding und Detection liefern Pixel-Boxen im Originalbild, der Agent arbeitet also mit Koordinaten statt mit geparster Prosa.
- Infografiken und handgezeichnete Skizzen werden zu editierbaren HTML/CSS-Interfaces.
Was es abdeckt
- Why this exists
- Proven use cases
- Reference-to-pixel verification
- Tools
- Security and execution model
So installierst du es
dsh-vision-toolkit
-
Führe das in einem Terminal aus.
dsh plugin --profile web add @dsh-external/dsh-vision-toolkit -
Starte dsh web neu, damit es das Plugin lädt.
-
Beschreibe dann das gewünschte Design. Der Harness greift die Tools des Plugins auf.
So nutzt du es mit DeepSeek Harness
-
Füg das Plugin deinem web- oder headless-Profil hinzu und hinterlege ein Vision-Credential für die Remote-Tools.
-
Aktiviere das Toolkit; der vision-tools-Skill bindet alle zehn Tool-Schemas ein.
-
Bau eine Referenz nach und verifiziere dann mit vision_html_screenshot und vision_pixel_diff.
Jedes Plugin hier ist kostenlos installierbar und verlinkt auf seine echte Originalquelle.
Mehr im DeepSeek-Harness-Repo ↗Nächster Schritt
Mit OpenDesign designen, ohne Setup
Installiere dieses Plugin selbst, oder leg mit OpenDesign eine ganze kuratierte Design-Ebene um DeepSeek Harness. Eigener Key, eigenes Ergebnis.