enginex-mr_series-sherpa-onnx/sherpa-onnx/csrc/offline-tts.h

// sherpa-onnx/csrc/offline-tts.h
//
// Copyright (c)  2023  Xiaomi Corporation
#ifndef SHERPA_ONNX_CSRC_OFFLINE_TTS_H_
#define SHERPA_ONNX_CSRC_OFFLINE_TTS_H_

#include <cstdint>
#include <memory>
#include <string>
#include <vector>

#if __ANDROID_API__ >= 9
#include "android/asset_manager.h"
#include "android/asset_manager_jni.h"
#endif

#include "sherpa-onnx/csrc/offline-tts-model-config.h"
#include "sherpa-onnx/csrc/parse-options.h"

namespace sherpa_onnx {

struct OfflineTtsConfig {
  OfflineTtsModelConfig model;
  // If not empty, it contains a list of rule FST filenames.
  // Filenames are separated by a comma.
  // Example value: rule1.fst,rule2,fst,rule3.fst
  //
  // If there are multiple rules, they are applied from left to right.
  std::string rule_fsts;

  OfflineTtsConfig() = default;
  OfflineTtsConfig(const OfflineTtsModelConfig &model,
                   const std::string &rule_fsts)
      : model(model), rule_fsts(rule_fsts) {}

  void Register(ParseOptions *po);
  bool Validate() const;

  std::string ToString() const;
};

struct GeneratedAudio {
  std::vector<float> samples;
  int32_t sample_rate;
};

class OfflineTtsImpl;

class OfflineTts {
 public:
  ~OfflineTts();
  explicit OfflineTts(const OfflineTtsConfig &config);

#if __ANDROID_API__ >= 9
  OfflineTts(AAssetManager *mgr, const OfflineTtsConfig &config);
#endif

  // @param text A string containing words separated by spaces
  // @param sid Speaker ID. Used only for multi-speaker models, e.g., models
  //            trained using the VCTK dataset. It is not used for
  //            single-speaker models, e.g., models trained using the ljspeech
  //            dataset.
  GeneratedAudio Generate(const std::string &text, int64_t sid = 0,
                          float speed = 1.0) const;

 private:
  std::unique_ptr<OfflineTtsImpl> impl_;
};

}  // namespace sherpa_onnx

#endif  // SHERPA_ONNX_CSRC_OFFLINE_TTS_H_
Add TTS with VITS (#360) 2023-10-13 19:30:38 +08:00			`// sherpa-onnx/csrc/offline-tts.h`
			`//`
			`// Copyright (c) 2023 Xiaomi Corporation`
			`#ifndef SHERPA_ONNX_CSRC_OFFLINE_TTS_H_`
			`#define SHERPA_ONNX_CSRC_OFFLINE_TTS_H_`

			`#include <cstdint>`
			`#include <memory>`
			`#include <string>`
			`#include <vector>`

Add jni interface and kotlin API examples for TTS. (#381) 2023-10-23 12:31:54 +08:00			`#if __ANDROID_API__ >= 9`
			`#include "android/asset_manager.h"`
			`#include "android/asset_manager_jni.h"`
			`#endif`

Add TTS with VITS (#360) 2023-10-13 19:30:38 +08:00			`#include "sherpa-onnx/csrc/offline-tts-model-config.h"`
			`#include "sherpa-onnx/csrc/parse-options.h"`

			`namespace sherpa_onnx {`

			`struct OfflineTtsConfig {`
			`OfflineTtsModelConfig model;`
Support text normalization via rule FST (#407) 2023-11-05 08:59:03 +08:00			`// If not empty, it contains a list of rule FST filenames.`
			`// Filenames are separated by a comma.`
			`// Example value: rule1.fst,rule2,fst,rule3.fst`
			`//`
			`// If there are multiple rules, they are applied from left to right.`
			`std::string rule_fsts;`
Add TTS with VITS (#360) 2023-10-13 19:30:38 +08:00
			`OfflineTtsConfig() = default;`
Support text normalization via rule FST (#407) 2023-11-05 08:59:03 +08:00			`OfflineTtsConfig(const OfflineTtsModelConfig &model,`
			`const std::string &rule_fsts)`
			`: model(model), rule_fsts(rule_fsts) {}`
Add TTS with VITS (#360) 2023-10-13 19:30:38 +08:00
			`void Register(ParseOptions *po);`
			`bool Validate() const;`

			`std::string ToString() const;`
			`};`

			`struct GeneratedAudio {`
			`std::vector<float> samples;`
			`int32_t sample_rate;`
			`};`

			`class OfflineTtsImpl;`

			`class OfflineTts {`
			`public:`
			`~OfflineTts();`
			`explicit OfflineTts(const OfflineTtsConfig &config);`
Add jni interface and kotlin API examples for TTS. (#381) 2023-10-23 12:31:54 +08:00
			`#if __ANDROID_API__ >= 9`
			`OfflineTts(AAssetManager *mgr, const OfflineTtsConfig &config);`
			`#endif`

Add TTS with VITS (#360) 2023-10-13 19:30:38 +08:00			`// @param text A string containing words separated by spaces`
Support VITS VCTK models (#367) * Support VITS VCTK models * Release v1.8.1 2023-10-16 17:22:30 +08:00			`// @param sid Speaker ID. Used only for multi-speaker models, e.g., models`
			`// trained using the VCTK dataset. It is not used for`
			`// single-speaker models, e.g., models trained using the ljspeech`
			`// dataset.`
Add MFC TTS example on Windows (#378) 2023-10-21 00:13:07 +08:00			`GeneratedAudio Generate(const std::string &text, int64_t sid = 0,`
			`float speed = 1.0) const;`
Add TTS with VITS (#360) 2023-10-13 19:30:38 +08:00
			`private:`
			`std::unique_ptr<OfflineTtsImpl> impl_;`
			`};`

			`} // namespace sherpa_onnx`

			`#endif // SHERPA_ONNX_CSRC_OFFLINE_TTS_H_`