Leitfaden zur WiFi-Sensing-Validierung

WiFi-Sensing-Genauigkeit: Verlässliche Ergebnisse messen

Die Genauigkeit von WiFi Sensing ist keine allgemeingültige Prozentzahl. Sie beschreibt eine Aussage über eine definierte Aufgabe, einen aufgezeichneten Datensatz, einen zurückgehaltenen Test und die Bedingungen, unter denen ein CSI-Modell funktioniert oder scheitert.

Redaktionelle Forschungsillustration mit WiFi-Knoten, Funkwegen, CSI-Kurven und einer Validierungsmatrix auf einem Laptop
Ein glaubwürdiges Genauigkeitsergebnis verbindet wiederholbare Funkmessungen mit einem zurückgehaltenen Test und nicht mit einem einzigen eindrucksvollen Demo-Bild.

WiFi-Sensing-Genauigkeit beschreibt, wie oft eine Inferenz mit einer definierten Referenz übereinstimmt. Das kann Belegung oder Leere, eine Bewegungsklasse, eine Raumzone, eine Geste, ein Atemmuster oder eine Positionsschätzung sein. Jede Aufgabe braucht eigene Labels, Metriken und akzeptable Fehler. Wer ohne Aufgabe und Testschnitt behauptet, ein System sei zu 95 Prozent genau, verschweigt mehr, als er erklärt.

Der praktische Ausgangspunkt ist, die Behauptung vor der CSI-Aufzeichnung aufzuschreiben. Legen Sie fest, was als positiv gilt, welche Kosten ein Fehlalarm hat, auf welche Personen oder Räume verallgemeinert werden soll und ob die Ausgabe Klassifikation, Regression oder Forschungsvisualisierung ist. Bewahren Sie dann eine Baseline-Aufzeichnung, ein sauberes Label-Protokoll und eine getrennte Testsitzung auf, die beim Tuning nie sichtbar ist.

Dieser Leitfaden konzentriert sich auf eine wiederholbare Bewertung von WiFi Sensing. Er ist weder ein universeller Benchmark noch eine Zertifizierung. Nützlich ist ein transparenter Bericht mit reproduzierbarem Aufbau, sichtbaren Fehlerfällen und klaren Grenzen.

Was bedeutet WiFi-Sensing-Genauigkeit eigentlich?

Genauigkeit beschreibt die Beziehung zwischen einer Vorhersage und einem Referenzlabel. Bei der Präsenzerkennung kann das Label für ein aufgezeichnetes Intervall einen leeren oder belegten Raum angeben. Bei der Gestenerkennung ist es eine von mehreren Gesten mit eindeutig markiertem Beginn und Ende. Bei der Indoor-Positionierung ist es eine Zone oder Koordinate, die mit einer unabhängigen Referenz gemessen wurde. Das Funksignal ist nicht die Wahrheit, sondern die Beobachtung, aus der eine Inferenz entsteht.

Der Entscheidungsschwellenwert verändert die Bedeutung der Genauigkeit. Ein Detektor, der möglichst wenige Personen verfehlen soll, kann mehr Fehlalarme erzeugen, und ein Laborwert muss sich bei einer anderen Person oder in einem anderen Raum nicht wiederholen. Schreiben Sie Aufgabe, Labels, Schwelle, Zeitfenster und Testbedingungen neben jede Kennzahl.

  • Definieren Sie zuerst eine Ausgabe: Klasse, Zone, Koordinate, Anzahl oder kontinuierliche Schätzung.
  • Nennen Sie das Referenzlabel und das Intervall, über das eine Vorhersage bewertet wird.
  • Dokumentieren Sie Schwelle, Klassenverteilung und ausgeschlossene Bedingungen.
  • Behandeln Sie Genauigkeit als bedingte Evidenz und nicht als dauerhafte Eigenschaft eines WiFi-Geräts.

Welche Kennzahlen sollte ein WiFi-Sensing-Test melden?

Wählen Sie Metriken, die zu den Kosten der jeweiligen Fehler passen. Die Gesamtgenauigkeit ist leicht zu lesen, kann aber eine seltene Klasse oder einen Detektor verbergen, der immer die Mehrheitsklasse wählt. Eine Konfusionsmatrix zeigt, welche Klassen verwechselt werden. Precision beantwortet, wie viele gemeldete Positive richtig sind; Recall zeigt, wie viele echte Positive gefunden wurden; F1 verbindet beides. Bei unausgewogenen Präsenzdaten sind klassenweiser Recall oder Balanced Accuracy oft informativer als eine einzige Überschrift-Prozentzahl.

Für Regressions- und Lokalisierungsaufgaben gelten andere Maße. Nutzen Sie mittleren absoluten Fehler, Medianfehler oder Perzentilfehler für eine Entfernung oder Rate. Bei der Zonenpositionierung sollte der Anteil der Vorhersagen innerhalb einer sinnvollen Toleranz genannt werden. Ein Klassifikationswert darf nicht wie eine Zentimetermessung dargestellt werden.

Aufgabe Geeignete Metriken Zu prüfen Häufige Falle
Binäre Präsenz Precision, Recall, F1, Balanced Accuracy Fehlalarme in leeren Intervallen Hohe Genauigkeit wegen unausgeglichener Klassen
Gesten oder Aktivitätsklassen Klassen-Recall, Macro F1, Konfusionsmatrix Verwechslung bestimmter Gesten oder Personen Nur die einfachste Klasse melden
Raumzone Zonengenauigkeit, Macro F1, Entfernungsfehler Nachbarzonen und Drift Eine grobe Zone als präzise Koordinate bezeichnen
Kontinuierliche Signalschätzung MAE, Medianfehler, Perzentilfehler Qualität des Referenzsensors und Ausreißer Fehlerverteilung hinter einem Mittelwert verstecken

Einen Datensatz bauen, der Generalisierung prüft

Ein WiFi-Sensing-Modell lernt die Bedingungen, die in seinen Aufzeichnungen vorkommen. Wenn jedes Trainings- und Testfenster aus demselben Gang, von derselben Person, aus demselben Raum und derselben Minute stammt, teilen benachbarte Fenster fast identische Kanalbedingungen. Dann misst der Wert eher das Auswendiglernen einer Sitzung als Generalisierung. Teilen Sie auf der Ebene, die zur Aussage passt: Sitzung, Tag, Person, Raum, Einrichtung oder Knotenposition.

Beginnen Sie klein genug, um den Versuch zu wiederholen. Erfassen Sie eine leere Baseline, versehen Sie Aktivitäten oder Zonen mit Zeitstempeln und speichern Sie Kanal, Bandbreite, Antennenausrichtung, Firmware, Abtastrate und Raumänderungen zusammen mit dem Signal. Eine saubere Trennung ist wertvoller als ein großer Ordner voller unbeschrifteter CSI-Daten.

  • Verwenden Sie für den Endwert eine getrennte Sitzung und nicht für das Tuning.
  • Ergänzen Sie negative Fälle wie leeren Raum, unbewegte Person, Paketverlust und harmlose Hintergrundbewegung.
  • Wenn die Aussage über eine Person oder einen Raum hinausgeht, halten Sie Person, Raum, Tag, Einrichtung oder Knoten ausdrücklich zurück.
  • Fixieren Sie den Split, bevor Sie Filter, Merkmale, Modelle oder Schwellen vergleichen.
Redaktionelles Diagramm mit CSI-Aufnahme, Merkmalsextraktion, getrenntem Test und Konfusionsmatrix
Die Validierungskette besteht aus Aufnahme, Merkmalsextraktion, geschütztem Testschnitt und einem prüfbaren Fehlermuster.

Eine Baseline-Pipeline von CSI zu einem Wert

Eine Baseline macht Genauigkeitsbehauptungen leichter prüfbar. Beginnen Sie mit dem einfachsten Merkmalsweg, der die Frage beantwortet: Paketauswahl, zeitliche Ausrichtung, einfache Bereinigung, festes Fenster und ein transparentes Modell. Bewahren Sie das originale oder nur minimal verarbeitete CSI auf, damit ein Filter nachvollziehbar bleibt. Falls eine Normalisierung nötig ist, werden ihre Parameter nur mit dem Trainingsteil angepasst.

Führen Sie denselben Weg anschließend auf getrennten Daten aus und speichern Sie Vorhersagen mit Labels. Halten Sie Konfusionsmatrix, Schwellen-Sweep, Fehlerverteilung und Beispiele falscher Vorhersagen fest. Eine leichte Baseline kann zeigen, dass das Signal instabil ist, bevor ein großes Modell den Bericht schwerer verständlich macht.

  • Protokollieren Sie Paketverlust, Zeitsprünge, fehlende Fenster und verworfene Samples.
  • Passen Sie Skala, Merkmalsauswahl und Schwellen nur mit Trainingsdaten an.
  • Speichern Sie Vorhersagen, Labels und Fehlerausschnitte und nicht nur den Endwert.

Fallen, die WiFi-Ergebnisse genauer aussehen lassen

Die häufigste Falle ist Datenleckage: Ein zufälliger Split kann benachbarte Samples einer Aufnahme in Training und Test bringen. Weitere Fallen sind Klassenungleichgewicht, eine Person an einem festen Ort, ein sichtbarer Hinweis, der sich mit dem Label ändert, oder ein Raum, der zwischen Klassen umgeräumt und nie erneut getestet wird. Zum Debuggen sind solche Abkürzungen nützlich, für eine breite Aussage reichen sie nicht.

Auch Hardware und Umgebung driften. Kanal, Bandbreite, Antennen, Firmware, Mehrwegeausbreitung, Möbel, Türen, Ventilatoren, Haustiere und fremder Funkverkehr können das CSI verändern. Messen Sie diese Empfindlichkeit, statt sie als lästige Ausnahme zu behandeln.

Falle Warum sie den Wert erhöht Korrektur
Zufällige Fenster einer Sitzung Fast identische Samples überschreiten den Split Eine ganze Sitzung oder einen Tag zurückhalten
Abkürzung über die Mehrheitsklasse Die seltene Klasse zählt wenig zur Genauigkeit Klassen-Recall, Macro F1 und Konfusion melden
Abkürzung über Person oder Raum Das Modell erkennt die Umgebung statt der Aufgabe Person, Raum, Einrichtung oder Knoten trennen
Nicht dokumentierte Kalibrierung Schwelle oder Baseline sind nicht reproduzierbar Parameter, Fenster und Neustart versionieren

Ein praktisches Validierungsprotokoll

Definieren Sie für einen ersten Versuch vier Schritte: Baseline, kontrolliertes Ereignis, getrennte Wiederholung und veränderte Bedingung. Zeichnen Sie den leeren Zustand auf, führen Sie das beschriftete Ereignis mehrfach aus, bewerten Sie eine geschützte Sitzung und wiederholen Sie danach unter einer realistischen Änderung: anderer Tag, andere Person, verschobener Stuhl oder Neustart. So wird sichtbar, ob das Modell das Signal oder die ursprüngliche Aufnahme gelernt hat.

Nutzen Sie eine kurze Vorlage: Hardware und Aufnahmepfad, Knotengeometrie, Klassen, Fenster, Split-Regel, Definitionen der Metriken, Schwelle, beste und schlechteste Fälle sowie Datenschutz. Ist das Ergebnis eine Forschungsvisualisierung, beschreiben Sie die Unsicherheit, statt eine Genauigkeit zu erfinden.

  • Baseline: Leere oder neutrale Aufnahmen wiederholen und Drift messen.
  • Ereignis: Aktivität, Zone oder Zustand mit einer synchronisierten Referenz labeln.
  • Getrennte Wiederholung: Den unveränderten Ablauf auf einer geschützten Sitzung ausführen.
  • Änderung: Anderen Tag, Person, Raumaufbau, Kanal oder Knoten testen.
  • Bericht: Fehler, Ausschlüsse und ungeeignete Einsatzbedingungen veröffentlichen.

Datenschutz und die Grenze einer Genauigkeitsbehauptung

Eine genauere Inferenz kann mehr über Menschen offenlegen. Belegung, Bewegung, Gewohnheiten oder Atemsignale können sensibel sein, auch wenn kein Video gespeichert wird. Holen Sie Einwilligung ein, begrenzen Sie die Aufbewahrung, beschränken Sie den Zugriff auf rohes CSI und Vorhersagen und erklären Sie, was gemessen und was abgeleitet wird. Ein Genauigkeitstest darf nicht unbemerkt zu Überwachung werden.

Bei RuView Blog ist Genauigkeit eine Forschungsfrage. Nutzen Sie die CSI- und Geräteanleitungen für die Aufnahme und die Anleitungen zu Personenerkennung, Positionierung oder Raumkartierung für die Grenzen der jeweiligen Aufgabe. Eine funktionierende Demo beweist weder medizinische Sicherheit noch Identitäts- oder physische Sicherheit.

  • Trennen Sie einen Modellwert von einer Aussage über eine Person oder einen Gesundheitszustand.
  • Dokumentieren Sie Einwilligung, Aufbewahrung, Löschung und Datenzugriff.
  • Zeigen Sie Vertrauen und Unsicherheit, wenn die Ausgabe Nutzern präsentiert wird.
  • Beenden Sie den Versuch, wenn eine geeignete Referenz zur Validierung fehlt.

Technische und wissenschaftliche Referenzen

FAQ zur WiFi-Sensing-Genauigkeit

Welche WiFi-Sensing-Genauigkeit ist gut?

Es gibt keine allgemeingültige Zahl. Ein guter Wert nennt Aufgabe, Labels, Klassenverteilung, Split, Metrik und Bedingungen. Ein niedrigerer Wert in einem realistisch zurückgehaltenen Raum kann aussagekräftiger sein als ein hoher Wert aus benachbarten Fenstern einer Sitzung.

Wie teste ich die Genauigkeit von WiFi Sensing?

Definieren Sie die Ausgabe, erfassen Sie gelabeltes CSI mit neutraler Baseline, frieren Sie eine getrennte Sitzung ein, führen Sie dieselbe Pipeline aus und melden Sie eine Konfusionsmatrix oder Fehlerverteilung. Fügen Sie eine andere Person, einen Raum, Tag oder Knoten hinzu, wenn die Aussage verallgemeinern soll.

Warum funktioniert mein Modell im Labor, aber nicht zu Hause?

Das Modell hat möglicherweise eine Abkürzung über Raum, Person, Knotenposition, Kanal oder Sitzung gelernt. Prüfen Sie Datenleckage, Kalibrierungsdrift, Möbel und Mehrwegeffekte, Paketverluste und ob der Testschnitt die Bedingungen zu Hause abbildet.

Kann ich eine Demo mit nur einer Genauigkeitszahl melden?

Nur wenn die Demo eine definierte Aufgabe, Referenzlabels, einen dokumentierten Split und eine passende Metrik besitzt. Sonst beschreiben Sie Verhalten, Beispiele und Grenzen, anstatt einen Benchmark zu erfinden.

Macht hohe Genauigkeit WiFi Sensing für Medizin oder Sicherheit geeignet?

Nein. Medizinische, sicherheitsbezogene und identitätsbezogene Einsätze verlangen domänenspezifische Validierung, Risikokontrollen, Referenzsysteme, Datenschutzprüfung und passende Zertifizierungen. Ein Forschungswert ist keine Freigabe.