GunSpec

Eine Redback-Aufgabe, von Anfang bis Ende

Die anderen Redback-Seiten beschreiben je einen Teil. Diese fügt sie zusammen: jede Stufe, die eine Aufgabe durchläuft, wer oder was sie ausführt, was jede Stufe erzeugt und wohin dieses Ergebnis geht, verfolgt an einem echten Lauf aus der blinden Messung.

Der Datensatz ist die Glock 21 SF, das Feld ihr Leergewicht. Der Lauf stammt aus der blinden Messung: Der geführte Wert war verborgen, die Seite, von der er stammt, zurückgehalten und die eigenen Quellenangaben des Datensatzes weggelassen, sodass Redback ein leeres Feld vorfand, mit nichts als dem Namen und dem Hersteller des Datensatzes als Ausgangspunkt. Alles Folgende hat dieser Lauf getan und erzeugt.

MessgrößeDieser Lauf
Suchen1
Gelesene Seiten3
Dem Modell gezeigte Ausschnitte3
Gefragte Modelle2
Modell-Tokens2.253
Dauer6,2 s

Eine Aufgabe kann an drei Stellen enden: verworfen mit der Regel, die sie abgelehnt hat, als Zweifel für eine Person abgelegt oder als Vorschlag abgelegt. Nur eine Person macht aus einem Vorschlag eine Änderung am Katalog, und eine Ablehnung schickt die Aufgabe mit der Notiz der prüfenden Person zurück.

DiagrammEine Aufgabe vom Befund bis in den Katalog
100%
Eine Aufgabe vom Befund bis in den KatalogEine Prüfung findet einen Fehler, und eine Aufgabe wird eingereiht. Ein Lauf übernimmt sie mit den übrigen Aufgaben ihres Datensatzes. Code sucht, liest Seiten und schneidet Ausschnitte; ein Modell liest die Ausschnitte; Code findet das Zitat auf der Seite. Eine andere Website, ein zweites Modell und die Belegregeln entscheiden dann: Abgelehntes wird mit seiner Regel verworfen, ein Zweifel geht an ein stärkeres Modell, und ein Bestehen wird ein Vorschlag mit vollständiger Spur. Eine Person prüft ihn: Angenommenes geht per Pull Request in den Katalog, Abgelehntes kehrt mit einer Notiz in die Warteschlange zurück.

Die Tabelle folgt einer Lückenaufgabe. Eine Verifizierung überspringt die Suche und liest nur die Herstellerseite; ein Widerspruch und eine Vokabular-Schreibweise überspringen das Lesen und lassen ein Modell beurteilen, was der Datensatz bereits enthält. Jede Aufgabe endet in derselben Ablage und derselben Prüfung.

StufeAusgeführt vonNimmtErzeugt
1. BefundEine Prüfung der DatenqualitätDen KatalogEine Aufgabe: den Datensatz, das Feld und die Zeile der Prüfung
2. ÜbernahmeDer LaufDie WarteschlangeDie Aufgabe und die übrigen offenen Aufgaben ihres Datensatzes als ein Dossier: der Datensatz, seine zitierten Seiten mit Rang, die Website des Herstellers, seine Befunde und was eine Person zuletzt zu ihm entschieden hat
3. SucheCodeDen Namen des Datensatzes und das Feld in WortenErgebnisse, die Website des Herstellers zuerst; themenfremde zurückgestellt
4. Seiten lesenCodeDie stärksten Ergebnisse, bis zu sechsDie eigenen Angaben und den Text jeder Seite; eine Messung, wie sich die Website lesen ließ
5. Ausschnitte schneidenCodeDie SeitenBis zu sechzehn kurze Fenster, die das Feld mit einer Zahl darin nennen
6. LesenEin lesendes ModellDen Datensatz ohne den Wert, und die AusschnitteWelcher Ausschnitt, das Zitat, der Wert wie angegeben, eine Konfidenz
7. FesthaltenCodeDie LesartDas Zitat auf der Seite, wie sie geladen wurde, die Zahl im Zitat, der Wert in der gespeicherten Einheit
8. BestätigenCodeDen WertJede andere gelesene Website, die denselben Wert nennt
9. PrüfenEin zweites Modell, ein anderer AnbieterDen Ausschnitt und den WertJa, nein oder unsicher
10. BelegregelnCodeWert, Zitat, Seite und DatensatzBestanden, ein Zweifel mit Grund, oder abgelehnt mit Regel
11. EskalierenEin stärkeres Modell, nur bei ZweifelDieselben AusschnitteEine zweite, unabhängige Lesart
12. AblegenCodeAlles obenEin Vorschlag: der Wert, seine Worte, seine Quellen, Konfidenz, Prüfungen, Begründung und vollständige Spur
13. PrüfungEine PersonDen VorschlagAngenommen, oder abgelehnt mit einer Notiz
14. KatalogEine PersonDie angenommenen ErgebnisseEin Pull Request, von einer Person zusammengeführt, von der nächsten Bereitstellung geladen

Dieselben Stufen, mit dem, was jede für die Glock 21 SF erzeugt hat.

  1. Suche. Eine Anfrage nach dem Namen des Modells und dem Feld, die Website des Herstellers zuerst. Unter den Ergebnissen war Glocks eigene Seite zu diesem Modell.
  2. Seiten lesen. Drei Seiten wurden gelesen. Glocks Seite gilt als die des Herstellers selbst, die stärkste Art von Quelle, und ihre Tabelle mit technischen Daten wurde als Angaben gelesen, nicht als Fließtext.
  3. Ausschnitte schneiden. Drei Ausschnitte wurden geschnitten. Glocks Tabelle mit technischen Daten nennt drei Gewichte nacheinander (740 g ohne Magazin, 825 g mit leerem Magazin, 1100 g mit gefülltem), und der Ausschnitt von ihrer Seite wurde um sie herum geschnitten.
  4. Lesen. Das lesende Modell nannte diesen Ausschnitt und las den Wert als 740 g, aus der Zeile mit der Beschriftung ohne Magazin.
  5. Festhalten. Code fand das Zitat auf Glocks Seite, wie sie geladen wurde, und 740 im Zitat. Die Seite nennt Gramm, also wurde nichts umgerechnet.
  6. Bestätigen. Keine andere in diesem Lauf gelesene Website nannte den Wert, die Antwort stützt sich also allein auf die Herstellerseite.
  7. Prüfen. Ein zweites Modell eines anderen Anbieters sah den Ausschnitt und den Wert und antwortete ja.
  8. Belegregeln. Die Quelle ist der Hersteller, also zitierfähig. Das Zitat steht auf der Seite. Die Seite trägt den Titel Glock 21 SF, nennt also dieses Modell. Die Magazinregel liest nur bis zur nächsten Beschriftung, sodass die 825 g in der nächsten Zeile, beschriftet mit leerem Magazin, nicht gegen einen Wert ohne Magazin zählen. Der Wert liegt in den Grenzen. Er bestand jede Regel.
  9. Eskalieren. Nichts war zweifelhaft, also wurde kein stärkeres Modell gefragt.
  10. Ablegen. Das Ergebnis war 740 g mit einer Konfidenz von 0,95 und der Begründung: von der Herstellerseite gelesen, Zitat wie geladen vorhanden, von einem zweiten Modell bestätigt. In der Messung wurde es dann mit dem geführten Wert von 740 g verglichen und als richtig gezählt.

Ein Lauf hinterlässt mehr als seine Antwort. Jedes Ergebnis hat genau einen Ort, und was den nächsten Lauf verändert, sind entweder Messungen oder Entscheidungen einer Person.

DiagrammJedes Ergebnis eines Laufs, und wohin es geht
100%
Jedes Ergebnis eines Laufs, und wohin es gehtEin Lauf erzeugt einen Vorschlag und seine Spur, die eine Person annimmt (er geht per Pull Request in den Katalog) oder mit einer Notiz ablehnt (sie steht am Anfang der Frage des nächsten Versuchs). Außerdem hinterlässt er eine Protokollzeile je Modellaufruf, einen Tag lang behaltene Suchantworten und Seitentexte und eine Messung, wie sich jede Website lesen ließ, die ebenfalls für den Katalog vorgeschlagen wird.
ErgebnisWohin es gehtWer es liestWie lange
Der VorschlagDie Aufgabe, in der PrüfwarteschlangeEine prüfende Person in der Staff-KonsoleNach der Prüfung behalten, mit der Entscheidung
Die SpurBeim VorschlagEine prüfende Person, und wer einen Lauf misstSo lange wie der Vorschlag
Eine verworfene AntwortDie Aufgabe, mit der ablehnenden RegelEine prüfende Person, und wer einen Lauf misstSo lange wie die Aufgabe
Eine Protokollzeile je ModellaufrufDas AufrufprotokollBetreiber, als Nutzung je Anbieter und SchlüsselEin begrenztes Zeitfenster
SuchantwortenDas geteilte SuchgedächtnisJeder AufruferEinen Tag
SeitentextDas geteilte SeitengedächtnisJeder AufruferEinen Tag
Wie sich jede Website lesen ließDas Website-GedächtnisJeder spätere Lauf, dann der Katalog per Pull RequestBehalten
Die Ablehnung einer prüfenden PersonDie AufgabeDer nächste Versuch, am Anfang seiner FrageBis die Aufgabe erledigt ist
Ein angenommener WertDer Datensatz im Katalog, mit Seite und ZitatJeder, der den Datensatz liestBehalten, mit seiner Geschichte

Ein Vorschlag ist dafür geschrieben, von oben nach unten gelesen zu werden. Seine erste Zeile ist die Begründung, und ein Zweifel steht, wenn es einen gibt, darin zuerst: was die Regel sah und warum sie den Wert zurückhielt. Dann der Wert, wie die Seite ihn nannte und in der gespeicherten Einheit, das Zitat und jede Seite, die ihn nannte, jede als Link zum Öffnen. Dann die Prüfungen: ob eine zweite Website zustimmte, was das zweite Modell sagte, ob ein stärkeres Modell gefragt wurde und was die Belegregeln entschieden.

Die Spur liegt darunter, für den Fall, dass die Antwort nicht genügt: jede Frage an ein Modell, die gezeigten Ausschnitte, jede Seite und Suche mit ihrem Ergebnis und Anbieter und Modell jedes Schritts. Ein Wert, an dem eine prüfende Person zweifelt, lässt sich bis zu den genauen Worten zurückverfolgen, die ein Modell erhalten hat.