Sie können ML Kit verwenden, um die Sprache eines Textstrings zu ermitteln. Sie können die wahrscheinlichste Sprache des Strings sowie Konfidenzwerte für alle möglichen Sprachen des Strings abrufen.
ML Kit erkennt Text in mehr als 100 verschiedenen Sprachen in ihren nativen Skripts. Darüber hinaus kann romanisierter Text für Arabisch, Bulgarisch, Chinesisch, Griechisch, Hindi, Japanisch und Russisch erkannt werden. Eine vollständige Liste der unterstützten Sprachen und Skripts finden Sie hier.
Gebündelt | Nicht gebündelt | |
---|---|---|
Name der Bibliothek | com.google.mlkit:language-id | com.google.android.gms:play-services-mlkit-language-id |
Implementierung | Das Modell ist zum Build-Zeitpunkt statisch mit Ihrer App verknüpft. | Das Modell wird dynamisch über die Google Play-Dienste heruntergeladen. |
Auswirkungen der App-Größe | Die Größe wurde um etwa 900 KB erhöht. | Die Größe wurde um etwa 200 KB erhöht. |
Initialisierungszeit | Modell ist sofort verfügbar. | Vor der ersten Verwendung kann es möglicherweise etwas dauern, bis das Modell heruntergeladen wurde. |
Ausprobieren
- Probieren Sie die Beispiel-App aus, um sich ein Anwendungsbeispiel für diese API anzusehen.
Hinweis
In der Datei
build.gradle
auf Projektebene muss das Maven-Repository von Google in den Abschnittenbuildscript
undallprojects
enthalten sein.Fügen Sie die Abhängigkeiten für die ML Kit-Android-Bibliotheken in die Gradle-Datei auf App-Ebene Ihres Moduls ein, die normalerweise
app/build.gradle
ist. Wählen Sie je nach Ihren Anforderungen eine der folgenden Abhängigkeiten aus:So bündeln Sie das Modell mit Ihrer App:
dependencies { // ... // Use this dependency to bundle the model with your app implementation 'com.google.mlkit:language-id:17.0.5' }
Verwendung des Modells in den Google Play-Diensten:
dependencies { // ... // Use this dependency to use the dynamically downloaded model in Google Play Services implementation 'com.google.android.gms:play-services-mlkit-language-id:17.0.0' }
Wenn Sie das Modell in den Google Play-Diensten verwenden möchten, können Sie Ihre App so konfigurieren, dass das Modell nach der Installation der App aus dem Play Store automatisch auf das Gerät heruntergeladen wird. Füge dazu der Datei
AndroidManifest.xml
deiner App die folgende Deklaration hinzu:<application ...> ... <meta-data android:name="com.google.mlkit.vision.DEPENDENCIES" android:value="langid" > <!-- To use multiple models: android:value="langid,model2,model3" --> </application>
Sie können die Modellverfügbarkeit auch explizit prüfen und einen Download über die ModuleInstallClient API der Google Play-Dienste anfordern.
Wenn Sie weder Modelldownloads bei der Installation aktivieren noch einen expliziten Download anfordern, wird das Modell bei der ersten Ausführung der ID heruntergeladen. Anfragen, die Sie vor Abschluss des Downloads stellen, führen zu keinen Ergebnissen.
Sprache eines Strings ermitteln
Um die Sprache eines Strings zu ermitteln, rufen Sie LanguageIdentification.getClient()
auf, um eine Instanz von LanguageIdentifier
abzurufen, und übergeben Sie den String dann an die Methode identifyLanguage()
von LanguageIdentifier
.
Beispiel:
Kotlin
val languageIdentifier = LanguageIdentification.getClient() languageIdentifier.identifyLanguage(text) .addOnSuccessListener { languageCode -> if (languageCode == "und") { Log.i(TAG, "Can't identify language.") } else { Log.i(TAG, "Language: $languageCode") } } .addOnFailureListener { // Model couldn’t be loaded or other internal error. // ... }
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient(); languageIdentifier.identifyLanguage(text) .addOnSuccessListener( new OnSuccessListener<String>() { @Override public void onSuccess(@Nullable String languageCode) { if (languageCode.equals("und")) { Log.i(TAG, "Can't identify language."); } else { Log.i(TAG, "Language: " + languageCode); } } }) .addOnFailureListener( new OnFailureListener() { @Override public void onFailure(@NonNull Exception e) { // Model couldn’t be loaded or other internal error. // ... } });
Wenn der Aufruf erfolgreich ist, wird ein BCP-47-Sprachcode an den Erfolgs-Listener übergeben, der die Sprache des Textes angibt. Wenn keine Sprache sicher erkannt wird, wird der Code und
(unbestimmt) übergeben.
Standardmäßig gibt ML Kit nur dann einen anderen Wert als und
zurück, wenn die Sprache mit einem Konfidenzwert von mindestens 0,5 identifiziert wird. Sie können diesen Grenzwert ändern, indem Sie ein LanguageIdentificationOptions
-Objekt an getClient()
übergeben:
Kotlin
val languageIdentifier = LanguageIdentification .getClient(LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.34f) .build())
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient( new LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.34f) .build());
Mögliche Sprachen eines Strings abrufen
Wenn Sie die Konfidenzwerte der wahrscheinlichsten Sprachen eines Strings abrufen möchten, rufen Sie eine Instanz von LanguageIdentifier
ab und übergeben Sie den String dann an die Methode identifyPossibleLanguages()
.
Beispiel:
Kotlin
val languageIdentifier = LanguageIdentification.getClient() languageIdentifier.identifyPossibleLanguages(text) .addOnSuccessListener { identifiedLanguages -> for (identifiedLanguage in identifiedLanguages) { val language = identifiedLanguage.languageTag val confidence = identifiedLanguage.confidence Log.i(TAG, "$language $confidence") } } .addOnFailureListener { // Model couldn’t be loaded or other internal error. // ... }
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient(); languageIdentifier.identifyPossibleLanguages(text) .addOnSuccessListener(new OnSuccessListener<List<IdentifiedLanguage>>() { @Override public void onSuccess(List<IdentifiedLanguage> identifiedLanguages) { for (IdentifiedLanguage identifiedLanguage : identifiedLanguages) { String language = identifiedLanguage.getLanguageTag(); float confidence = identifiedLanguage.getConfidence(); Log.i(TAG, language + " (" + confidence + ")"); } } }) .addOnFailureListener( new OnFailureListener() { @Override public void onFailure(@NonNull Exception e) { // Model couldn’t be loaded or other internal error. // ... } });
Wenn der Aufruf erfolgreich ist, wird eine Liste von IdentifiedLanguage
-Objekten an den Erfolgs-Listener übergeben. Von jedem Objekt können Sie den BCP-47-Code der Sprache und die Zuverlässigkeit des Strings in dieser Sprache abrufen. Beachten Sie, dass diese Werte die Zuverlässigkeit angeben, dass der gesamte String in der angegebenen Sprache vorhanden ist. ML Kit erkennt nicht mehrere Sprachen in einem einzelnen String.
Standardmäßig gibt ML Kit nur Sprachen mit Konfidenzwerten von mindestens 0, 01 zurück. Sie können diesen Grenzwert ändern, indem Sie ein LanguageIdentificationOptions
-Objekt an getClient()
übergeben:
Kotlin
val languageIdentifier = LanguageIdentification .getClient(LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.5f) .build())
Java
LanguageIdentifier languageIdentifier = LanguageIdentification.getClient( new LanguageIdentificationOptions.Builder() .setConfidenceThreshold(0.5f) .build());
Wenn keine Sprache diesen Grenzwert erreicht, enthält die Liste ein Element mit dem Wert und
.