Vereinfachen der Datenextraktion mit OpenAI JSON-Modus und JSON-Schemas-js-Tutorial-php.cn

Heim

Web-Frontend

js-Tutorial

Vereinfachen der Datenextraktion mit OpenAI JSON-Modus und JSON-Schemas

Patricia Arquette

Jan 04, 2025 pm 12:59 PM

Simplifying Data Extraction with OpenAI JSON Mode and JSON Schemas

Als ich nach der Veröffentlichung zum ersten Mal mit ChatGPT-3.5 experimentierte, war ich von seinem Potenzial für verschiedene Anwendungen begeistert. Meine Aufregung ließ jedoch schnell nach, als ich auf ein großes Hindernis stieß: Die zurückgegebenen wertvollen Informationen waren zwar hervorragend lesbar, aber nicht in einer Form, die von einer Anwendung zuverlässig aufgenommen werden konnte. Ironischerweise zeichnen sich LLMs dadurch aus, dass sie Informationen aus unstrukturiertem Text extrahieren, diese aber nur in unstrukturierter Form zurückgeben können. Der Versuch, Ergebnisse aus LLMs programmgesteuert zu extrahieren, fühlte sich an, als wäre man in einem unglaublichen Restaurant, das das köstlichste Essen serviert, aber ohne jegliche Utensilien – man kann es sehen und riechen, aber man kommt einfach nicht dorthin.

Ich habe jeden Trick ausprobiert, um es so zu überreden, dass es mir den Anschein strukturierter Daten gibt. „Bitte trennen Sie einfach jeden Punkt durch einen Balken oder eine neue Zeile und überspringen Sie den Kommentar“, würde ich bitten. Manchmal hat es funktioniert, manchmal nicht. Manchmal würde es die Artikel „hilfreich“ nummerieren oder neu ordnen, wie ein wohlmeinender, aber leicht verwirrter Assistent. Ein anderes Mal schlich sich immer noch ein Kommentar ein, der an einen gesprächigen Kollegen erinnerte. Ich habe sogar unmissverständlich verlangt, JSON und nichts anderes zurückzugeben, aber manchmal wurde ein Komma weggelassen – fast so, als würde es einen passiv-aggressiven Stoß nehmen. Schließlich gab ich auf und kehrte widerstrebend zu den weniger aufregenden, aber vorhersehbareren Grenzen traditioneller Algorithmen zurück.

Glücklicherweise führte OpenAI einige Monate später den JSON-Modus ein, eine Funktion, die das LLM dazu zwingt, gültiges JSON zurückzugeben. Ich habe beschlossen, diese Funktion auszuprobieren, und fand, dass sie für die Verarbeitung der Ergebnisse in meinen Anwendungen deutlich effektiver ist. Hier ist ein Beispiel für die Ausgabe mit aktiviertem JSON-Modus:

PROMPT:‍
Parse the following sentence into words and then return the results
as a list of the original word and the translation in English and
return the results in JSON.
-- sentence --
早安‍


RESULTS:
{
  "results": [
    {
      "original": "早安",
      "translation": "Good morning"
    }
  ]
}

Diese Ausgabe ist sicherlich eine Verbesserung. Obwohl es sich bei der Ausgabe um gültiges JSON handelt, kann ihre Struktur je nach Inhalt der Eingabeaufforderung variieren. Ein vorhersehbarerer Ansatz besteht darin, das gewünschte Rückgabeformat anzugeben. Eine Möglichkeit, dies zu erreichen, besteht darin, eine Beispiel-JSON-Struktur bereitzustellen, der das LLM folgen kann. Bei dieser Methode wird ein Beispiel erstellt und Code geschrieben, um es zu analysieren. Wenn sich die Struktur ändert, müssen Änderungen an beiden Stellen vorgenommen werden.

Ein alternativer Ansatz besteht darin, ein Data Transfer Object (DTO) zu definieren, um die Ergebnisse zu speichern und es sowohl zum Anweisen des LLM als auch zum Parsen der Ergebnisse zu verwenden, um Synchronisierungsprobleme zu vermeiden. Definieren Sie zunächst das DTO, zum Beispiel:‍

record Entries(List<entry> entries) {
    record Entry(String originalWord, String wordInEnglish, String pronunciation) {}
}
</entry>

Jetzt kann das DTO sowohl in den Eingabeaufforderungsanweisungen als auch im Parsing-Code verwendet werden:

// Construct the prompt with the output schema.
var prompt = MessageFormat.format("""
   Parse the following sentence into English and return the results
   in JSON according to the following JSON schema.

   人工智慧將引領未來，以智慧之光照亮人類無限可能的前程。
   --- output json schema ---
   {0}
   """, jsonSchemaOf(Entries.class));
   var result = sendPrompt(prompt, Entries.class);

Hier ist der Code, der den Jackson JSON Schema-Generator verwendet:

PROMPT:‍
Parse the following sentence into words and then return the results
as a list of the original word and the translation in English and
return the results in JSON.
-- sentence --
早安‍


RESULTS:
{
  "results": [
    {
      "original": "早安",
      "translation": "Good morning"
    }
  ]
}

Hinweis: Standardmäßig enthält das generierte Schema ID-Felder, die für Referenzen verwendet werden, wodurch Token verschwendet werden können. Code, der diese nicht verwendeten IDs entfernt, finden Sie im Repository OpenAI JSON Mode Sample.

Und schließlich ist hier der Code, der die Eingabeaufforderung mithilfe des Azure OpenAI Java SDK an OpenAI sendet:

record Entries(List<entry> entries) {
    record Entry(String originalWord, String wordInEnglish, String pronunciation) {}
}
</entry>

Die Lösung funktioniert meistens gut. Das LLM versteht das JSON-Schema effektiv, aber Vorsicht: Ich habe Fälle gesehen, in denen es manchmal etwas falsch macht. Wenn es sich bei einem Feld beispielsweise um einen String handelt und sein Name im Plural steht (z. B. „exampleValues“), besteht das LLM manchmal darauf, stattdessen ein Array von Strings zurückzugeben.

LLMs können bemerkenswerte Ergebnisse erzielen, die manchmal die Fähigkeiten einer durchschnittlichen Person übertreffen. Es ist jedoch faszinierend, dass sie zumindest im Moment mit der alltäglicheren Aufgabe zu kämpfen haben, ihre generierte Ausgabe zuverlässig zu formatieren.

Das obige ist der detaillierte Inhalt vonVereinfachen der Datenextraktion mit OpenAI JSON-Modus und JSON-Schemas. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Stellungnahme

Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn

Verwandter Artikel

JavaScript -Datentypen: Gibt es einen Unterschied zwischen Browser und NodeJs?May 14, 2025 am 12:15 AM

JavaScript -Kerndatentypen sind in Browsern und Knoten.js konsistent, werden jedoch unterschiedlich als die zusätzlichen Typen behandelt. 1) Das globale Objekt ist ein Fenster im Browser und global in node.js. 2) Node.js 'eindeutiges Pufferobjekt, das zur Verarbeitung von Binärdaten verwendet wird. 3) Es gibt auch Unterschiede in der Leistung und Zeitverarbeitung, und der Code muss entsprechend der Umgebung angepasst werden.

JavaScript -Kommentare: Eine Anleitung zur Verwendung // und / * * /May 13, 2025 pm 03:49 PM

JavaScriptUSESTWOTYPESOFCOMMENMENTEN: Einzelzeilen (//) und Multi-Linie (//). 1) Verwendung // Forquicknotesorsingle-Linexplanationen.2 Verwendung // ForlongerExPlanationsCompomentingingoutblocks-

Python gegen JavaScript: Eine vergleichende Analyse für EntwicklerMay 09, 2025 am 12:22 AM

Der Hauptunterschied zwischen Python und JavaScript sind die Typ -System- und Anwendungsszenarien. 1. Python verwendet dynamische Typen, die für wissenschaftliche Computer- und Datenanalysen geeignet sind. 2. JavaScript nimmt schwache Typen an und wird in Front-End- und Full-Stack-Entwicklung weit verbreitet. Die beiden haben ihre eigenen Vorteile bei der asynchronen Programmierung und Leistungsoptimierung und sollten bei der Auswahl gemäß den Projektanforderungen entschieden werden.

Python vs. JavaScript: Auswählen des richtigen Tools für den JobMay 08, 2025 am 12:10 AM

Ob die Auswahl von Python oder JavaScript vom Projekttyp abhängt: 1) Wählen Sie Python für Datenwissenschafts- und Automatisierungsaufgaben aus; 2) Wählen Sie JavaScript für die Entwicklung von Front-End- und Full-Stack-Entwicklung. Python ist für seine leistungsstarke Bibliothek in der Datenverarbeitung und -automatisierung bevorzugt, während JavaScript für seine Vorteile in Bezug auf Webinteraktion und Full-Stack-Entwicklung unverzichtbar ist.

Python und JavaScript: Verständnis der Stärken der einzelnenMay 06, 2025 am 12:15 AM

Python und JavaScript haben jeweils ihre eigenen Vorteile, und die Wahl hängt von den Projektbedürfnissen und persönlichen Vorlieben ab. 1. Python ist leicht zu erlernen, mit prägnanter Syntax, die für Datenwissenschaft und Back-End-Entwicklung geeignet ist, aber eine langsame Ausführungsgeschwindigkeit hat. 2. JavaScript ist überall in der Front-End-Entwicklung und verfügt über starke asynchrone Programmierfunktionen. Node.js macht es für die Entwicklung der Vollstapel geeignet, die Syntax kann jedoch komplex und fehleranfällig sein.

JavaScripts Kern: Ist es auf C oder C aufgebaut?May 05, 2025 am 12:07 AM

JavaScriptisnotbuiltoncorc; Es ist angehört, dass sich JavaScriptWasdedeSthatrunsonGineoFtencninc.

JavaScript-Anwendungen: Von Front-End bis Back-EndMay 04, 2025 am 12:12 AM

JavaScript kann für die Entwicklung von Front-End- und Back-End-Entwicklung verwendet werden. Das Front-End verbessert die Benutzererfahrung durch DOM-Operationen, und die Back-End-Serveraufgaben über node.js. 1. Beispiel für Front-End: Ändern Sie den Inhalt des Webseitentextes. 2. Backend Beispiel: Erstellen Sie einen Node.js -Server.

Python vs. JavaScript: Welche Sprache sollten Sie lernen?May 03, 2025 am 12:10 AM

Die Auswahl von Python oder JavaScript sollte auf Karriereentwicklung, Lernkurve und Ökosystem beruhen: 1) Karriereentwicklung: Python ist für die Entwicklung von Datenwissenschaften und Back-End-Entwicklung geeignet, während JavaScript für die Entwicklung von Front-End- und Full-Stack-Entwicklung geeignet ist. 2) Lernkurve: Die Python -Syntax ist prägnant und für Anfänger geeignet; Die JavaScript -Syntax ist flexibel. 3) Ökosystem: Python hat reichhaltige wissenschaftliche Computerbibliotheken und JavaScript hat ein leistungsstarkes Front-End-Framework.

See all articles