ToolBrief
Menü

Bewertungsmethodik

Die Methodik macht Evidenzstärke, Umfang, Alter, Einschränkungen und Prüferverantwortung sichtbar, damit Leser Empfehlungen im Kontext beurteilen können.

Drei Evidenzstufen

Jedes Tool hat eine sichtbare Evidenzstufe:

  • Recherchiert: Aktuelle Primärquellen wurden auf Produktumfang, Preise, wichtige Grenzen, Datenverarbeitung und Verfügbarkeit geprüft. Es wird keine kontrollierte praktische Aussage zur Qualität getroffen.
  • Getestet: Die Recherche wird durch dokumentierte Aufgaben, Plattform und Datum, Inputs, erwartetes Ergebnis, Artefakte soweit sicher und beobachtete Einschränkungen ergänzt.
  • Tiefenprüfung: Wiederholbare Workflows, schwierige Fälle, Alternativen, Gesamtkosten und Fehlerbehebung werden in einer breiteren Bewertung verglichen.

Die Evidenzstufe beschreibt, was wir überprüft haben, nicht wie beliebt oder gut ein Produkt ist. Eine recherchierte Seite kann detailliert und nützlich sein, ohne vorzugeben, getestet worden zu sein.

Quellenprozess

Prüfer beginnen mit offizieller Website, Produkt- und Hilfedokumentation, Preisen, Bedingungen, Datenschutz- und Sicherheitsmaterialien, Lizenzierung, Statusinformationen und aktueller Eigentümerschaft. Jede strukturierte Quelle enthält ein Zugriffsdatum. Wichtige Unterschiede nach Plan, Region, Konto, API sowie Verbraucher- gegenüber Business-Nutzung werden erfasst.

Quellen Dritter können Ausfälle, Kontroversen oder Fragen aufzeigen, wesentliche Produktaussagen sollten jedoch an eine aktuelle Primärquelle gebunden oder klar als ungeklärt gekennzeichnet sein. Widersprechen sich offizielle Quellen, berichtet die Bewertung über die Abweichung.

Workflow-Bewertung

Die Bewertung definiert die Aufgabe, bevor Produkte verglichen werden. Kriterien können Input- und Output-Format, Rückverfolgbarkeit von Quellen, Bearbeitung und Export, Zusammenarbeit, Berechtigungen, Kosteneinheit, Datenschutzpfad, Fehlerbehebung und Zeit für menschliche Prüfung umfassen.

Tests verwenden repräsentative und schwierige Fälle statt nur einer gelungenen Demo. Bei einem Agent können dazu Berechtigungen, Teilfehler, Prompt Injection, doppelte Aktionen, Kostenobergrenzen und Offboarding gehören. Bei einem Generator können es Rechte, Editierbarkeit, Export, unbelegte Aussagen und Prüfaufwand sein.

Wir verallgemeinern einen erfolgreichen Prompt nicht zu einer Zuverlässigkeitsaussage. Testergebnisse sind auf das aufgezeichnete Datum, den Plan, das Modell, die Plattform, Einstellungen und Inputs begrenzt.

Preise und Gesamtkosten

Preise werden soweit verfügbar mit Währung, Abrechnungszeitraum, effektivem jährlichem gegenüber flexiblem monatlichem Preis, enthaltener Nutzung, Mehrverbrauch, Plätzen, Credits, Aufgaben, API-Aufrufen, Speicher und wichtigen Add-ons erfasst. Ein öffentlicher Preis ist eine Momentaufnahme, kein Angebot.

Empfehlungen berücksichtigen die Kosten geprüfter Ergebnisse einschließlich Wiederholungen, Exportbereinigung, Implementierung, Wartung, ungenutzter Plätze und menschlicher Verifikation. „Kostenlos“ und „unbegrenzt“ werden mit wesentlichen Grenzen und Fair-Use-Regeln berichtet.

Datenschutz, Sicherheit, Rechte und Schutz

Bewertungen trennen Modelltraining, Inferenz, Aufbewahrung, Logs, Feedback, Subprozessoren, Teilen und Löschung. Planspezifische Enterprise-Aussagen werden nicht auf Verbrauchertarife ausgedehnt. Zertifizierungen und Verschlüsselung werden mit ihrem Umfang angegeben, statt als vollständige Sicherheitsgarantie behandelt zu werden.

Wir erfassen außerdem kommerzielle Nutzungsrechte, Eigentum, Quellenlizenzen, Einwilligung für Gesicht oder Stimme, Code- und Datenzugriff sowie Beschränkungen für hochwirksame Nutzung, wenn relevant. Eine Aufnahme ist keine rechtliche oder sicherheitstechnische Freigabe.

Lokalisierung und interne Prüfung

Englisch ist der Quelldatensatz. Versionen in vereinfachtem und traditionellem Chinesisch bewahren die vollständige Entscheidungshilfe und passen Terminologie, Beispiele und Links an. Jede freigegebene Sprache hat einen Prüfer und muss Prüfungen von Inhaltsstruktur, Metadaten, internen Links und Locale-Pfaden bestehen.

Vor der Veröffentlichung decken automatisierte Prüfungen Pflichtfelder, Metadatenlänge, Inhaltsgraphen, verwandte Seiten, Social-Metadaten, strukturierte Daten, doppelte Keywords, verwaiste Seiten, Sitemap-Konsistenz, Typen, Lint, Tests und Produktionsbuild ab. Automatisierung erkennt Probleme; ein Mensch bleibt für die Schlussfolgerung verantwortlich.

Aktualisierungen und Korrekturen

Das sichtbare Verifizierungs- oder Aktualisierungsdatum zeigt die letzte wesentliche Prüfung. Stark besuchte und sich schnell verändernde Tools werden häufiger geprüft. Preisänderungen, Eigentümerwechsel, Einstellungen, Modell- oder Anbieterwechsel, Datenschutzbedingungen, Sicherheitsvorfälle und größere Produktänderungen können eine sofortige Prüfung auslösen.

Wenn Evidenz veraltet ist oder nicht bestätigt werden kann, kann ein Tool an Sichtbarkeit verlieren, als archiviert oder eingestellt markiert oder aus Empfehlungen entfernt werden. Leser können über die Kontaktseite eine Korrektur mit einer aktuellen Primärquelle einreichen.