Ein Wegweiser durch KI-Positionen

Nachtraining

Die Quellen sind über 18 Monate alt.

Veröffentlichungsdaten und Alter der Quellen

Anzahl der Quellen: 2

Neueste datierte Quelle: 2024-07-31

Bewertet zum Quellenstichtag dieser Ausgabe: 2026-09-15. Grenze von 18 Monaten: 2025-03-15.

Das Alter einer Veröffentlichung sagt nicht, ob eine Aussage noch zutrifft. Erneutes Lesen macht eine alte Veröffentlichung nicht neuer. Ein Aktualisierungsdatum belegt nicht, dass auch die von uns verwendete Passage überarbeitet wurde.

Im Glossar öffnen Lesenotizen · Strukturierter Dateneintrag

Einfach erklärt

Weiteres Training nach dem Vortraining, das Fähigkeiten und Verhalten eines Modells anpassen soll. [1]

Diese Erklärung zitieren oder eine Korrektur vorschlagen

Link zu dieser Erklärung · Korrektur vorschlagen · So funktionieren Korrekturen

Grenzen und Unterschiede

Nachtraining bezeichnet eine Entwicklungsphase, kein Sicherheitszertifikat. Verbesserungen bei ausgewählten Aufgaben schließen andere Fehler nicht aus. [1]

Diese Erklärung zitieren oder eine Korrektur vorschlagen

Link zu dieser Erklärung · Korrektur vorschlagen · So funktionieren Korrekturen

Ausführlicher erklärt

Entwickler können Beispiele, bevorzugte Antworten oder Belohnungen zum Training einsetzen. Ziele können das Befolgen von Anweisungen, Programmieren oder Reaktionen auf schädliche Anfragen sein. Die Kombinationen unterscheiden sich je nach Entwickler. [1] [2]

Diese Erklärung zitieren oder eine Korrektur vorschlagen

Link zu dieser Erklärung · Korrektur vorschlagen · So funktionieren Korrekturen

Wie das zur Karte passt

Prüfe das Trainingsziel, von wem die Rückmeldungen stammen und welche Ergebnisse getestet wurden. [2]

Diese Erklärung zitieren oder eine Korrektur vorschlagen

Link zu dieser Erklärung · Korrektur vorschlagen · So funktionieren Korrekturen

Diese Seite teilen

https://theaiatlas.org/ideas/post-training/

Bild zum Teilen herunterladen · Vektorgrafik

Vorschaubilder sind Zusammenfassungen. Teile den Seitenlink mit, damit andere die Belege prüfen können.

Quellen und Umfang unserer Lektüre

  1. 1. The Llama 3 Herd of Models

    Die Quelle ist über 18 Monate alt.

    Veröffentlichungsdaten und Alter der Quellen

    Anzahl der Quellen: 1

    Neueste datierte Quelle: 2024-07-31

    Bewertet zum Quellenstichtag dieser Ausgabe: 2026-09-15. Grenze von 18 Monaten: 2025-03-15.

    Das Alter einer Veröffentlichung sagt nicht, ob eine Aussage noch zutrifft. Erneutes Lesen macht eine alte Veröffentlichung nicht neuer. Ein Aktualisierungsdatum belegt nicht, dass auch die von uns verwendete Passage überarbeitet wurde.

    Die zwei Trainingsphasen, Methoden des Nachtrainings und Grenzen in Abschnitt 5.4.8 der Version 2 gelesen. Daten folgen dem arXiv-Versionsverlauf. Ein dokumentierter Ansatz, kein allgemeingültiges Trainingsrezept.

  2. 2. Training language models to follow instructions with human feedback

    Die Quelle ist über 18 Monate alt.

    Veröffentlichungsdaten und Alter der Quellen

    Anzahl der Quellen: 1

    Neueste datierte Quelle: 2022-03-04

    Bewertet zum Quellenstichtag dieser Ausgabe: 2026-09-15. Grenze von 18 Monaten: 2025-03-15.

    Das Alter einer Veröffentlichung sagt nicht, ob eine Aussage noch zutrifft. Erneutes Lesen macht eine alte Veröffentlichung nicht neuer. Ein Aktualisierungsdatum belegt nicht, dass auch die von uns verwendete Passage überarbeitet wurde.

    Kurzfassung, das Verfahren mit Beispielen, Vergleichen und Belohnungsmodell in Abschnitt 3.1 sowie die Einschränkungen in Abschnitt 5.3 wurden gelesen. Menschliche Präferenzurteile und bessere Ergebnisse bei den Aufgaben der Autoren belegen keine universelle Ausrichtung oder Sicherheit. Das Veröffentlichungsdatum wurde auf der arXiv-Kurzfassungsseite geprüft.

Ausgabe und maschinenlesbare Belege

Inhaltsversion 0.20.0. Quellenstichtag 2026-09-15; das bedeutet nicht, dass jede Quelle an diesem Tag gelesen wurde.

Festgehaltenes vollständiges Datenpaket · Vollständige Quellennotizen · Anleitung für KI-Agenten