{
  "input_path": "/data/video-pipeline/StickerMan/project/004-Vi-Sao-Mot-Bai-Hat-Co-The-Mac-Ket-Trong-Dau-Ban-Ca-Ngay/audio/chunks/narration_018.wav",
  "output_path": "/data/video-pipeline/StickerMan/project/004-Vi-Sao-Mot-Bai-Hat-Co-The-Mac-Ket-Trong-Dau-Ban-Ca-Ngay/asr/narration_018.json",
  "language": "vi",
  "language_probability": 1,
  "duration": 26.32,
  "text": "Môi trường hiện đại cung cấp điều kiện gần như hoàn hảo cho vòng tương tác đó. Video dạng ngắn thường chỉ dùng phần dễ nhận diện nhất của bài hát, lặp qua hàng chục clip và cắt trước khi cấu trúc âm nhà được giải quyết trọn vẹn. Thuật toán không cần biết giai điệu nào sẽ sống trong đầu bạng. Nó chỉ cần nhận ra âm thanh nào, khiến nhiều người dừng lại, xem lại, bặt trước hoặc tương tác. Kết quả là cùng một mẫu 15 giây, được phân phối với một đồ mà trước đây phải nghe radio nhiều ngày mới đạt được.",
  "segments": [
    {
      "index": 1,
      "start": 0.0,
      "end": 3.6,
      "text": "Môi trường hiện đại cung cấp điều kiện gần như hoàn hảo cho vòng tương tác đó.",
      "words": [
        {
          "word": "Môi",
          "start": 0.0,
          "end": 0.28,
          "probability": 0.8295468688011169
        },
        {
          "word": "trường",
          "start": 0.28,
          "end": 0.42,
          "probability": 0.998336523771286
        },
        {
          "word": "hiện",
          "start": 0.42,
          "end": 0.66,
          "probability": 0.9970687031745911
        },
        {
          "word": "đại",
          "start": 0.66,
          "end": 0.82,
          "probability": 0.8397577404975891
        },
        {
          "word": "cung",
          "start": 0.82,
          "end": 1.0,
          "probability": 0.9321732521057129
        },
        {
          "word": "cấp",
          "start": 1.0,
          "end": 1.14,
          "probability": 0.9938231408596039
        },
        {
          "word": "điều",
          "start": 1.14,
          "end": 1.32,
          "probability": 0.9879834651947021
        },
        {
          "word": "kiện",
          "start": 1.32,
          "end": 1.64,
          "probability": 0.9830963015556335
        },
        {
          "word": "gần",
          "start": 1.64,
          "end": 1.84,
          "probability": 0.9872471392154694
        },
        {
          "word": "như",
          "start": 1.84,
          "end": 1.98,
          "probability": 0.9138845801353455
        },
        {
          "word": "hoàn",
          "start": 1.98,
          "end": 2.2,
          "probability": 0.9934549927711487
        },
        {
          "word": "hảo",
          "start": 2.2,
          "end": 2.34,
          "probability": 0.9969489574432373
        },
        {
          "word": "cho",
          "start": 2.34,
          "end": 2.5,
          "probability": 0.8615443110466003
        },
        {
          "word": "vòng",
          "start": 2.5,
          "end": 2.68,
          "probability": 0.9644944965839386
        },
        {
          "word": "tương",
          "start": 2.68,
          "end": 2.82,
          "probability": 0.47495336830616
        },
        {
          "word": "tác",
          "start": 2.82,
          "end": 2.96,
          "probability": 0.960211843252182
        },
        {
          "word": "đó.",
          "start": 2.96,
          "end": 3.6,
          "probability": 0.9842596650123596
        }
      ]
    },
    {
      "index": 2,
      "start": 4.48,
      "end": 7.62,
      "text": "Video dạng ngắn thường chỉ dùng phần dễ nhận diện nhất của bài hát,",
      "words": [
        {
          "word": "Video",
          "start": 4.48,
          "end": 4.64,
          "probability": 0.9315275549888611
        },
        {
          "word": "dạng",
          "start": 4.64,
          "end": 4.94,
          "probability": 0.9516899188359579
        },
        {
          "word": "ngắn",
          "start": 4.94,
          "end": 5.1,
          "probability": 0.6775500178337097
        },
        {
          "word": "thường",
          "start": 5.1,
          "end": 5.36,
          "probability": 0.9849554896354675
        },
        {
          "word": "chỉ",
          "start": 5.36,
          "end": 5.54,
          "probability": 0.8862277865409851
        },
        {
          "word": "dùng",
          "start": 5.54,
          "end": 5.7,
          "probability": 0.9962511956691742
        },
        {
          "word": "phần",
          "start": 5.7,
          "end": 5.92,
          "probability": 0.9891822636127472
        },
        {
          "word": "dễ",
          "start": 5.92,
          "end": 6.12,
          "probability": 0.9853094816207886
        },
        {
          "word": "nhận",
          "start": 6.12,
          "end": 6.32,
          "probability": 0.9400853216648102
        },
        {
          "word": "diện",
          "start": 6.32,
          "end": 6.5,
          "probability": 0.8921781480312347
        },
        {
          "word": "nhất",
          "start": 6.5,
          "end": 6.8,
          "probability": 0.9877915382385254
        },
        {
          "word": "của",
          "start": 6.8,
          "end": 6.98,
          "probability": 0.9857602715492249
        },
        {
          "word": "bài",
          "start": 6.98,
          "end": 7.12,
          "probability": 0.9969862997531891
        },
        {
          "word": "hát,",
          "start": 7.12,
          "end": 7.62,
          "probability": 0.9938497245311737
        }
      ]
    },
    {
      "index": 3,
      "start": 7.8,
      "end": 12.38,
      "text": "lặp qua hàng chục clip và cắt trước khi cấu trúc âm nhà được giải quyết trọn vẹn.",
      "words": [
        {
          "word": "lặp",
          "start": 7.8,
          "end": 7.94,
          "probability": 0.845251460870107
        },
        {
          "word": "qua",
          "start": 7.94,
          "end": 8.1,
          "probability": 0.9525969624519348
        },
        {
          "word": "hàng",
          "start": 8.1,
          "end": 8.3,
          "probability": 0.9980903267860413
        },
        {
          "word": "chục",
          "start": 8.3,
          "end": 8.46,
          "probability": 0.9748793542385101
        },
        {
          "word": "clip",
          "start": 8.46,
          "end": 8.82,
          "probability": 0.9806397557258606
        },
        {
          "word": "và",
          "start": 8.82,
          "end": 9.48,
          "probability": 0.7583909630775452
        },
        {
          "word": "cắt",
          "start": 9.48,
          "end": 9.74,
          "probability": 0.9794756174087524
        },
        {
          "word": "trước",
          "start": 9.74,
          "end": 10.0,
          "probability": 0.9925554394721985
        },
        {
          "word": "khi",
          "start": 10.0,
          "end": 10.26,
          "probability": 0.9987144470214844
        },
        {
          "word": "cấu",
          "start": 10.26,
          "end": 10.46,
          "probability": 0.9366842806339264
        },
        {
          "word": "trúc",
          "start": 10.46,
          "end": 10.56,
          "probability": 0.9878029823303223
        },
        {
          "word": "âm",
          "start": 10.56,
          "end": 10.74,
          "probability": 0.9835633933544159
        },
        {
          "word": "nhà",
          "start": 10.74,
          "end": 11.04,
          "probability": 0.6083272695541382
        },
        {
          "word": "được",
          "start": 11.04,
          "end": 11.34,
          "probability": 0.9530083537101746
        },
        {
          "word": "giải",
          "start": 11.34,
          "end": 11.52,
          "probability": 0.9967297613620758
        },
        {
          "word": "quyết",
          "start": 11.52,
          "end": 11.64,
          "probability": 0.9943056702613831
        },
        {
          "word": "trọn",
          "start": 11.64,
          "end": 11.82,
          "probability": 0.9258404970169067
        },
        {
          "word": "vẹn.",
          "start": 11.82,
          "end": 12.38,
          "probability": 0.9117313623428345
        }
      ]
    },
    {
      "index": 4,
      "start": 12.4,
      "end": 15.44,
      "text": "Thuật toán không cần biết giai điệu nào sẽ sống trong đầu bạng.",
      "words": [
        {
          "word": "Thuật",
          "start": 12.4,
          "end": 12.6,
          "probability": 0.9162854552268982
        },
        {
          "word": "toán",
          "start": 12.6,
          "end": 12.8,
          "probability": 0.9542540311813354
        },
        {
          "word": "không",
          "start": 12.8,
          "end": 13.04,
          "probability": 0.9902948141098022
        },
        {
          "word": "cần",
          "start": 13.04,
          "end": 13.22,
          "probability": 0.9861207604408264
        },
        {
          "word": "biết",
          "start": 13.22,
          "end": 13.42,
          "probability": 0.9853755831718445
        },
        {
          "word": "giai",
          "start": 13.42,
          "end": 13.62,
          "probability": 0.8353333473205566
        },
        {
          "word": "điệu",
          "start": 13.62,
          "end": 13.78,
          "probability": 0.8392949402332306
        },
        {
          "word": "nào",
          "start": 13.78,
          "end": 14.0,
          "probability": 0.9988270401954651
        },
        {
          "word": "sẽ",
          "start": 14.0,
          "end": 14.24,
          "probability": 0.9789687395095825
        },
        {
          "word": "sống",
          "start": 14.24,
          "end": 14.48,
          "probability": 0.9708141982555389
        },
        {
          "word": "trong",
          "start": 14.48,
          "end": 14.7,
          "probability": 0.9916766881942749
        },
        {
          "word": "đầu",
          "start": 14.7,
          "end": 14.86,
          "probability": 0.3976081609725952
        },
        {
          "word": "bạng.",
          "start": 14.86,
          "end": 15.44,
          "probability": 0.6867684125900269
        }
      ]
    },
    {
      "index": 5,
      "start": 15.48,
      "end": 16.96,
      "text": "Nó chỉ cần nhận ra âm thanh nào,",
      "words": [
        {
          "word": "Nó",
          "start": 15.48,
          "end": 15.64,
          "probability": 0.9922701120376587
        },
        {
          "word": "chỉ",
          "start": 15.64,
          "end": 15.8,
          "probability": 0.991750180721283
        },
        {
          "word": "cần",
          "start": 15.8,
          "end": 15.92,
          "probability": 0.9979966282844543
        },
        {
          "word": "nhận",
          "start": 15.92,
          "end": 16.06,
          "probability": 0.9985106289386749
        },
        {
          "word": "ra",
          "start": 16.06,
          "end": 16.16,
          "probability": 0.9849259257316589
        },
        {
          "word": "âm",
          "start": 16.16,
          "end": 16.38,
          "probability": 0.9904095232486725
        },
        {
          "word": "thanh",
          "start": 16.38,
          "end": 16.5,
          "probability": 0.9752859771251678
        },
        {
          "word": "nào,",
          "start": 16.5,
          "end": 16.96,
          "probability": 0.9965367317199707
        }
      ]
    },
    {
      "index": 6,
      "start": 17.1,
      "end": 20.74,
      "text": "khiến nhiều người dừng lại, xem lại, bặt trước hoặc tương tác.",
      "words": [
        {
          "word": "khiến",
          "start": 17.1,
          "end": 17.34,
          "probability": 0.964020699262619
        },
        {
          "word": "nhiều",
          "start": 17.34,
          "end": 17.5,
          "probability": 0.9953082203865051
        },
        {
          "word": "người",
          "start": 17.5,
          "end": 17.7,
          "probability": 0.9980173110961914
        },
        {
          "word": "dừng",
          "start": 17.7,
          "end": 17.9,
          "probability": 0.9880551993846893
        },
        {
          "word": "lại,",
          "start": 17.9,
          "end": 18.24,
          "probability": 0.9985072016716003
        },
        {
          "word": "xem",
          "start": 18.5,
          "end": 18.62,
          "probability": 0.9963878393173218
        },
        {
          "word": "lại,",
          "start": 18.62,
          "end": 18.96,
          "probability": 0.9894235730171204
        },
        {
          "word": "bặt",
          "start": 19.08,
          "end": 19.24,
          "probability": 0.6246274411678314
        },
        {
          "word": "trước",
          "start": 19.24,
          "end": 19.56,
          "probability": 0.9517999291419983
        },
        {
          "word": "hoặc",
          "start": 19.56,
          "end": 19.92,
          "probability": 0.8826551735401154
        },
        {
          "word": "tương",
          "start": 19.92,
          "end": 20.18,
          "probability": 0.6972202509641647
        },
        {
          "word": "tác.",
          "start": 20.18,
          "end": 20.74,
          "probability": 0.9777563512325287
        }
      ]
    },
    {
      "index": 7,
      "start": 20.84,
      "end": 22.6,
      "text": "Kết quả là cùng một mẫu 15 giây,",
      "words": [
        {
          "word": "Kết",
          "start": 20.84,
          "end": 20.98,
          "probability": 0.7948284149169922
        },
        {
          "word": "quả",
          "start": 20.98,
          "end": 21.08,
          "probability": 0.9986153841018677
        },
        {
          "word": "là",
          "start": 21.08,
          "end": 21.22,
          "probability": 0.9710718393325806
        },
        {
          "word": "cùng",
          "start": 21.22,
          "end": 21.38,
          "probability": 0.9283208250999451
        },
        {
          "word": "một",
          "start": 21.38,
          "end": 21.6,
          "probability": 0.8570229411125183
        },
        {
          "word": "mẫu",
          "start": 21.6,
          "end": 21.7,
          "probability": 0.8005974094072977
        },
        {
          "word": "15",
          "start": 21.7,
          "end": 22.0,
          "probability": 0.8102658987045288
        },
        {
          "word": "giây,",
          "start": 22.0,
          "end": 22.6,
          "probability": 0.8657684326171875
        }
      ]
    },
    {
      "index": 8,
      "start": 22.76,
      "end": 26.32,
      "text": "được phân phối với một đồ mà trước đây phải nghe radio nhiều ngày mới đạt được.",
      "words": [
        {
          "word": "được",
          "start": 22.76,
          "end": 22.9,
          "probability": 0.9753216505050659
        },
        {
          "word": "phân",
          "start": 22.9,
          "end": 23.14,
          "probability": 0.9982359111309052
        },
        {
          "word": "phối",
          "start": 23.14,
          "end": 23.34,
          "probability": 0.9954845309257507
        },
        {
          "word": "với",
          "start": 23.34,
          "end": 23.48,
          "probability": 0.982273519039154
        },
        {
          "word": "một",
          "start": 23.48,
          "end": 23.58,
          "probability": 0.6167148351669312
        },
        {
          "word": "đồ",
          "start": 23.58,
          "end": 24.0,
          "probability": 0.75819131731987
        },
        {
          "word": "mà",
          "start": 24.0,
          "end": 24.22,
          "probability": 0.962774395942688
        },
        {
          "word": "trước",
          "start": 24.22,
          "end": 24.34,
          "probability": 0.9943448305130005
        },
        {
          "word": "đây",
          "start": 24.34,
          "end": 24.5,
          "probability": 0.9690222144126892
        },
        {
          "word": "phải",
          "start": 24.5,
          "end": 24.68,
          "probability": 0.9933997392654419
        },
        {
          "word": "nghe",
          "start": 24.68,
          "end": 24.86,
          "probability": 0.9973637461662292
        },
        {
          "word": "radio",
          "start": 24.86,
          "end": 25.32,
          "probability": 0.9768680334091187
        },
        {
          "word": "nhiều",
          "start": 25.32,
          "end": 25.68,
          "probability": 0.99433833360672
        },
        {
          "word": "ngày",
          "start": 25.68,
          "end": 25.82,
          "probability": 0.9856746792793274
        },
        {
          "word": "mới",
          "start": 25.82,
          "end": 26.02,
          "probability": 0.9988672733306885
        },
        {
          "word": "đạt",
          "start": 26.02,
          "end": 26.18,
          "probability": 0.5634106695652008
        },
        {
          "word": "được.",
          "start": 26.18,
          "end": 26.32,
          "probability": 0.9951991438865662
        }
      ]
    }
  ]
}