Embedding-Schnittstelle gegen secondbrain-mcp live verifizieren #11

Closed
opened 2026-08-10 13:40:05 +02:00 by zwuge · 1 comment
Owner

Question

Welche reproduzierbaren Tests und welcher echte End-to-End-Lauf beweisen, dass secondbrain-mcp den Spark-Endpunkt neben Qwen sicher und korrekt nutzen kann?

Parent map: Wayfinder: Embedding-Schnittstelle neben Qwen im DGX Spark

Starting assumptions

Die bestätigten Wayfinder-Empfehlungen gelten als Ausgangspunkt: separater Dienst neben Qwen, nomic zuerst, kleiner /embed-Vertrag, Sicherheits- und Live-Verifikationsziel.

## Question Welche reproduzierbaren Tests und welcher echte End-to-End-Lauf beweisen, dass secondbrain-mcp den Spark-Endpunkt neben Qwen sicher und korrekt nutzen kann? Parent map: [Wayfinder: Embedding-Schnittstelle neben Qwen im DGX Spark](https://git.platz-consulting.de/zwuge/dgx-spark/issues/6) ## Starting assumptions Die bestätigten Wayfinder-Empfehlungen gelten als Ausgangspunkt: separater Dienst neben Qwen, nomic zuerst, kleiner /embed-Vertrag, Sicherheits- und Live-Verifikationsziel.
zwuge self-assigned this 2026-08-10 15:28:32 +02:00
Author
Owner

Resolution

Der Nachweis wird in vier Ebenen durchgeführt und getrennt berichtet:

  1. Lokale Contract- und Sicherheitstests: Request-/Response-Schema, Auth, TLS-Zwang, Modellprüfung, Batch-/Größenlimits, 429/503, Vektordimension und Logging ohne Inhalte.
  2. Spark-Baseline: Vorher-/Nachher-Vergleich von Qwen-Health, einfacher Qwen-Inferenz, Speicher-/GPU-Zustand und Embedding-Latenz; Qwen bleibt aktiv, schwere OCR-Läufe laufen nicht parallel.
  3. Echter E2E-Lauf: secondbrain-mcp verwendet seinen echten EmbeddingClient und das produktive Secret über HTTPS vom autorisierten Netzpfad; verwendet werden ausschließlich synthetische Testtexte. Geprüft werden HTTP-Status, Modell, Vektoranzahl, Dimension und sichere Evidence.
  4. Kontrollierter Rollback auf die vorherige Modell-/Serviceversion.

Die Reifegrade werden strikt getrennt dokumentiert: ntschieden → implementiert → deployt → live verifiziert. Ein lokaler Test gilt nicht als Deployment oder Live-Verifikation. Produktions-/Infrastrukturaktionen bleiben ausdrücklich freizugebende Umsetzungsschritte.

## Resolution Der Nachweis wird in vier Ebenen durchgeführt und getrennt berichtet: 1. Lokale Contract- und Sicherheitstests: Request-/Response-Schema, Auth, TLS-Zwang, Modellprüfung, Batch-/Größenlimits, 429/503, Vektordimension und Logging ohne Inhalte. 2. Spark-Baseline: Vorher-/Nachher-Vergleich von Qwen-Health, einfacher Qwen-Inferenz, Speicher-/GPU-Zustand und Embedding-Latenz; Qwen bleibt aktiv, schwere OCR-Läufe laufen nicht parallel. 3. Echter E2E-Lauf: secondbrain-mcp verwendet seinen echten EmbeddingClient und das produktive Secret über HTTPS vom autorisierten Netzpfad; verwendet werden ausschließlich synthetische Testtexte. Geprüft werden HTTP-Status, Modell, Vektoranzahl, Dimension und sichere Evidence. 4. Kontrollierter Rollback auf die vorherige Modell-/Serviceversion. Die Reifegrade werden strikt getrennt dokumentiert: ntschieden → implementiert → deployt → live verifiziert. Ein lokaler Test gilt nicht als Deployment oder Live-Verifikation. Produktions-/Infrastrukturaktionen bleiben ausdrücklich freizugebende Umsetzungsschritte.
zwuge closed this issue 2026-08-10 16:25:00 +02:00
Sign in to join this conversation.
No description provided.