Erkennen ungültiger Bytesequenzen in Go
In Go ist es beim Konvertieren eines Byte-Slice ([]Byte) in eine Zeichenfolge möglich stoßen auf ungültige Bytesequenzen, die nicht in Unicode übersetzt werden können. Dies liegt daran, dass nicht alle Bytesequenzen gültige UTF-8-Zeichen darstellen.
Um solche Vorkommnisse zu erkennen, stehen zwei Ansätze zur Verfügung:
UTF-8-Gültigkeitsprüfung:
Wie Tim Cooper erwähnt, kann die Funktion utf8.Valid verwendet werden, um zu testen, ob ein Byte-Slice gültiges UTF-8 enthält Bytes. Wenn das Ergebnis falsch ist, weist dies auf das Vorhandensein ungültiger Bytesequenzen hin.
Überlegungen zur Zeichenfolgenkonvertierung:
Entgegen allgemeiner Annahmen erlaubt Go die Konvertierung von Nicht-UTF -8-Byte-Slices zu Strings. Es ist jedoch wichtig zu beachten, dass eine Zeichenfolge in Go im Wesentlichen ein schreibgeschütztes Byte-Slice ist und daher Bytes aufnehmen kann, die kein gültiges UTF-8 sind.
Nur in bestimmten Situationen führt Go automatisch UTF-8 aus. 8 Dekodierung:
- Beim Durchlaufen einer Zeichenfolge mit der Syntax for i, r := range s stellt die Variable r einen Unicode-Codepunkt dar (Rune) und ist immer gültig.
- Bei der Konvertierung von einer Zeichenfolge in ein Runenstück (d. h. []rune(s)) dekodiert Go die gesamte Zeichenfolge in Runen.
In beiden Fällen werden ungültige UTF-8-Zeichen durch das Ersatzzeichen U FFFD ersetzt. Dieser Ersatz ist möglicherweise nicht in allen Anwendungen akzeptabel, daher wird empfohlen, bei Bedarf eine explizite UTF-8-Validierung durchzuführen.
Beispiel:
Betrachten Sie das folgende Go-Programm:
package main import ( "fmt" "unicode/utf8" ) func main() { a := []byte{0xff} s := string(a) // Check UTF-8 validity if utf8.Valid(a) { fmt.Println("Valid UTF-8") } else { fmt.Println("Invalid UTF-8") } // Output string fmt.Println(s) }
Ausgabe:
Invalid UTF-8 �
In diesem Beispiel enthält das Byte-Slice a ein ungültige Bytesequenz, was zu einer „Ungültiges UTF-8“-Meldung führt. Anschließend wird bei der Konvertierung in einen String das ungültige Byte durch das Ersetzungszeichen „�“ dargestellt.
Das obige ist der detaillierte Inhalt vonWie kann ich ungültige UTF-8-Bytesequenzen in Go erkennen?. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!

Dieser Artikel erläutert die Paketimportmechanismen von Go: benannte Importe (z. B. importieren & quot; fmt & quot;) und leere Importe (z. B. Import _ & quot; fmt & quot;). Benannte Importe machen Paketinhalte zugänglich, während leere Importe nur T ausführen

Dieser Artikel beschreibt die effiziente Konvertierung von MySQL -Abfrageergebnissen in GO -Strukturscheiben. Es wird unter Verwendung der SCAN -Methode von Datenbank/SQL zur optimalen Leistung hervorgehoben, wobei die manuelle Parsen vermieden wird. Best Practices für die Struktur -Feldzuordnung mithilfe von DB -Tags und Robus

In diesem Artikel werden die Newflash () -Funktion von BeEGO für die Übertragung zwischen PAGE in Webanwendungen erläutert. Es konzentriert sich auf die Verwendung von Newflash (), um temporäre Nachrichten (Erfolg, Fehler, Warnung) zwischen den Controllern anzuzeigen und den Sitzungsmechanismus zu nutzen. Limita

In diesem Artikel werden die benutzerdefinierten Typ -Einschränkungen von GO für Generika untersucht. Es wird beschrieben, wie Schnittstellen die minimalen Typanforderungen für generische Funktionen definieren und die Sicherheitstypsicherheit und die Wiederverwendbarkeit von Code verbessern. Der Artikel erörtert auch Einschränkungen und Best Practices

Dieser Artikel zeigt, dass Mocks und Stubs in GO für Unit -Tests erstellen. Es betont die Verwendung von Schnittstellen, liefert Beispiele für Mock -Implementierungen und diskutiert Best Practices wie die Fokussierung von Mocks und die Verwendung von Assertion -Bibliotheken. Die Articl

Dieser Artikel beschreibt effizientes Dateischreiben in Go und vergleicht OS.WriteFile (geeignet für kleine Dateien) mit OS.openfile und gepufferter Schreibvorgänge (optimal für große Dateien). Es betont eine robuste Fehlerbehandlung, die Verwendung von Aufschub und Überprüfung auf bestimmte Fehler.

In dem Artikel werden Schreiben von Unit -Tests in GO erörtert, die Best Practices, Spottechniken und Tools für ein effizientes Testmanagement abdecken.

In diesem Artikel wird die Verwendung von Tracing -Tools zur Analyse von GO -Anwendungsausführungsfluss untersucht. Es werden manuelle und automatische Instrumentierungstechniken, den Vergleich von Tools wie Jaeger, Zipkin und Opentelemetrie erörtert und die effektive Datenvisualisierung hervorheben


Heiße KI -Werkzeuge

Undresser.AI Undress
KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover
Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool
Ausziehbilder kostenlos

Clothoff.io
KI-Kleiderentferner

AI Hentai Generator
Erstellen Sie kostenlos Ai Hentai.

Heißer Artikel

Heiße Werkzeuge

PHPStorm Mac-Version
Das neueste (2018.2.1) professionelle, integrierte PHP-Entwicklungstool

SublimeText3 Mac-Version
Codebearbeitungssoftware auf Gottesniveau (SublimeText3)

mPDF
mPDF ist eine PHP-Bibliothek, die PDF-Dateien aus UTF-8-codiertem HTML generieren kann. Der ursprüngliche Autor, Ian Back, hat mPDF geschrieben, um PDF-Dateien „on the fly“ von seiner Website auszugeben und verschiedene Sprachen zu verarbeiten. Es ist langsamer und erzeugt bei der Verwendung von Unicode-Schriftarten größere Dateien als Originalskripte wie HTML2FPDF, unterstützt aber CSS-Stile usw. und verfügt über viele Verbesserungen. Unterstützt fast alle Sprachen, einschließlich RTL (Arabisch und Hebräisch) und CJK (Chinesisch, Japanisch und Koreanisch). Unterstützt verschachtelte Elemente auf Blockebene (wie P, DIV),

Notepad++7.3.1
Einfach zu bedienender und kostenloser Code-Editor

Sicherer Prüfungsbrowser
Safe Exam Browser ist eine sichere Browserumgebung für die sichere Teilnahme an Online-Prüfungen. Diese Software verwandelt jeden Computer in einen sicheren Arbeitsplatz. Es kontrolliert den Zugriff auf alle Dienstprogramme und verhindert, dass Schüler nicht autorisierte Ressourcen nutzen.
