Aufnahme → Dokument
Eine Bildschirmaufnahme wird zum Dokument: nur die Momente, in denen sich der Bildschirm ändert, jeder mit der genauen Uhrzeit und mit dem, was gerade gesagt wurde. Damit belegen Sie, dass der Test durchgeführt wurde, und damit beliefern Sie eine KI. Läuft vollständig in Ihrem Browser — nichts verlässt Ihren Rechner.
Ohne Registrierung, ohne Installation, ohne Größenbeschränkung. Das Video wird in Ihrem Browser verarbeitet und an keinen Server gesendet.
Ein einstündiges Video lässt sich nirgends anhängen: Es passt in kein Ticket, in kein Protokoll, und niemand sieht es sich an. Claude und ChatGPT lehnen Videodateien ab; Gemini nimmt sie an und greift blind einen Screenshot pro Sekunde ab — 3.600 Bilder und über eine Million Token, fast alles Wiederholung des vorherigen Bildschirms. Screenshots von Hand haben den umgekehrten Fehler: Das ist Arbeit, und die Uhrzeit jedes einzelnen geht verloren.
Dieselbe Aufnahme kommt in jedem dieser Formate heraus. Sie wählen am Ende, und Sie können mehr als eines herunterladen.
Fünf Szenarien, eine Aufnahme
Die Wahl des Szenarios ist der erste Schritt im Tool, und sie bestimmt das Layout des Dokuments, die Identifikationsfelder, ob die Uhrzeit erscheint, wie jeder Screenshot heißt und den fertigen Auftrag an die KI.
UAT und Audit: ein Bildschirm pro Schritt, mit Uhrzeit, Kopfzeile zur Identifikation und Integritätsprüfung.
Den vollständigen Fall ansehen →Die Schritt-für-Schritt-Anleitung des Key Users, im Imperativ und ohne Datumsstempel — vertraglich geschuldete Lieferung zum Go-live.
Den vollständigen Fall ansehen →Die Bildschirme des Gezeigten, die zugehörige Aussage und am Ende die vollständige Transkription.
Den vollständigen Fall ansehen →Moderator und Teilnehmer getrennt, Momente live markiert und Balken zum Anonymisieren.
Den vollständigen Fall ansehen →~60 Bildschirme statt 3.600, mit der Aussage jedes Abschnitts und dem fertigen Prompt.
Den vollständigen Fall ansehen →Dieselbe Arbeit, zwei Ziele
Von jedem Schritt einen Screenshot machen und die Bildunterschrift darunter schreiben. Oder einem Modell erklären, was in einer Stunde Video passiert ist. Das ist dasselbe Problem — Zeit in ein Dokument verwandeln — und deshalb löst ein einziges Tool beides.
Ein Test ohne Nachweis besteht kein Audit. Heute heißt das: Druck-Taste → in Word einfügen → Bildunterschrift schreiben, vierzig Mal. Nehmen Sie einmal auf und erhalten Sie das fertige Dokument.
Ein Modell, das Video ansieht, greift blind einen Screenshot pro Sekunde ab. Eine Stunde wird zu 3.600 Bildern und über einer Million Token — und Sie zahlen bei jeder Frage erneut.
Die Brücke zwischen beiden: Gewollt ist dasselbe — was auf dem Bildschirm passiert ist, in der richtigen Reihenfolge, mit Uhrzeit und mit dem, was gesagt wurde. Nur der Leser am Ende ändert sich: ein Auditor oder ein Modell.
Wer das sonst macht, was es kostet und wo jeder gewinnt — auch gegen uns: siehe den Vergleich.
So funktioniert es
Ziehen Sie die Datei auf die Seite. Sie wird direkt von Ihrer Festplatte gelesen — 300 MB oder 3 GB macht keinen Unterschied, weil nichts irgendwohin gesendet wird.
Transkribieren Sie direkt dort, mit Whisper auf Ihrem eigenen Rechner, oder ziehen Sie eine vorhandene Untertiteldatei .vtt / .srt hinein.
Prüfen Sie die Screenshots, verwerfen Sie die schlechten und laden Sie das Dokument herunter. Dazu kommt der Text, der dem Modell erklärt, wie es dieses PDF lesen soll — das verändert die Qualität der Antwort.
Statt alle zehn Sekunden ein Bild aufzunehmen, durchläuft es das Video und hält bei den Momenten an, in denen sich der Bildschirm wirklich ändert, auf eine halbe Sekunde genau. Bei einer Präsentation ergibt das einen Screenshot pro Folie statt vierzig gleicher.
Jeder Bildschirm trägt den Moment, in dem er entstanden ist. Das unterscheidet einen Stapel Screenshots von einem Dokument, das als Nachweis dient — und das lässt die KI den richtigen Moment zitieren.
Es gibt keinen Server. Video, Audio und Transkription werden in Ihrem Browser verarbeitet — auch bei vertraulichen Besprechungsaufnahmen.
Der fertige Text weist das Modell an, die Zeitpunkte zu zitieren, Gesehenes von Gehörtem zu trennen und einzuräumen, wenn eine Information nicht im Dokument steht, statt sie zu erfinden.
Datenschutz
Die meisten Online-Videowerkzeuge verlangen einen Upload: Ihre Datei geht auf den Rechner von jemand anderem, wird dort verarbeitet und bleibt für eine Zeit gespeichert, die Sie nicht bestimmen. Walkstamp macht nichts davon — die Seite ist eine statische Datei, und die gesamte Verarbeitung findet in Ihrem Browser statt.
Es gibt kein Konto, keine Datenbank, kein Tracking. Die einzige externe Verbindung ist der Download des Transkriptionsmodells, und das nur, wenn Sie die automatische Transkription nutzen. Die vollständige Richtlinie lesen.
Nein. Es öffnet sich im Browser und läuft. Ein aktueller Chrome oder Edge liefert das beste Ergebnis, weil die automatische Transkription die Grafikkarte über WebGPU nutzt.
Wir setzen keine Grenze, gerade weil es keinen Upload gibt. Die praktische Grenze ist der Arbeitsspeicher Ihres Rechners. Lange Videos brauchen länger für den Durchlauf, und Sie können den Durchlauf jederzeit abbrechen.
MP4 (H.264), WebM und MOV in den meisten Fällen. Formate, die der Browser nicht dekodieren kann — HEVC und manche MKV-Dateien — öffnen sich nicht; dann müssen Sie vorher nach MP4 konvertieren.
Sie nutzt Whisper lokal. Das schnelle Modell ist brauchbar, das genaue ist deutlich besser, um den Preis eines größeren Downloads. Wenn Sie bereits Untertitel aus einem anderen Dienst haben, ziehen Sie die Datei hinein und überspringen diesen Schritt.
Ja, und der Grund ist struktureller Art: Ihr Rechner macht die Arbeit, also kostet es mich nichts, Sie zu bedienen. Es gibt keine Werbung, keine Registrierung und keine Daten von Ihnen, die verkauft werden — nicht aus Großzügigkeit, sondern weil es keinen Server gibt, auf dem etwas gespeichert würde.
Mit jedem Modell, das Anhänge annimmt und Bilder liest — Claude, ChatGPT und Gemini funktionieren. Hängen Sie das PDF an und fügen Sie den Prompt ein, den das Tool mitliefert.
Auf drei Wegen, jeder in einer Minute und keiner verlangt, mir zu vertrauen. Öffnen Sie die Entwicklerkonsole (F12), gehen Sie auf den Reiter Netzwerk und verarbeiten Sie ein Video: Sie sehen jede Anfrage, die die Seite stellt — und keine trägt Ihre Datei. Zweitens: Der Code ist eine einzige Seite; rechte Maustaste, Seitenquelltext anzeigen, und alles steht da zum Lesen. Drittens, am direktesten: Schalten Sie das Internet ab, nachdem die Seite geladen ist, und arbeiten Sie weiter — Aufnahme, Screenshots und Dokument entstehen weiterhin, weil nichts davon ein Netz brauchte. Was ohne Netz funktioniert, schickt nichts irgendwohin.
Das dauert weniger lang als das Lesen dieser Seite.
Tool öffnen