TranscribeNextTranscribeNext.com
💾
高级

JSON 格式:面向开发者的结构化数据

导出包含文本分段、时间戳、文件信息和说话人信息的 JSON 数据,便于开发和集成。

阅读时间约 4 分钟 TranscribeNext 团队 更新日期:2025年1月15日

JSON 将转写结果保存为结构化数据,适合系统集成、自定义应用和数据分析流程。

导出内容

  • 完整的转写文件信息
  • 全文内容
  • 带时间戳的分段数据
  • 语言识别信息
  • 以秒为单位的时长
  • 创建日期
  • 转写记录的唯一 ID
  • 原始文件名

JSON 结构

JSON 导出的结构示例如下:

{
  "id": "transcription_abc123",
  "fileName": "会议-2025-01-15.mp3",
  "text": "完整转写文本……",
  "language": "zh",
  "duration": 1825.45,
  "createdAt": "2025-01-15T10:30:00.000Z",
  "segments": [
    {
      "id": 1,
      "start": 0.0,
      "end": 5.23,
      "text": "大家好,欢迎……"
    },
    {
      "id": 2,
      "start": 5.23,
      "end": 9.45,
      "text": "谢谢邀请……"
    }
  ]
}

字段说明

  • id:转写记录的唯一标识符
  • fileName:原始上传文件名
  • text:以单个字符串表示的完整转写文本
  • language:识别或选择的语言代码,例如 en、es、fr
  • duration:音频总时长,以秒为单位,可包含小数
  • createdAt:ISO 8601 格式的创建时间
  • segments:带时间信息的文本分段数组

分段对象

segments 数组中的每个分段包含:

  • id:分段序号
  • start:开始时间,以秒为单位,可包含小数
  • end:结束时间,以秒为单位,可包含小数
  • text:该分段的文字

适用场景

  • API 和 Webhook 集成
  • 自定义数据处理流程
  • 分析和文本挖掘
  • 开发字幕生成工具
  • 导入数据库
  • 准备机器学习训练数据
  • 建立搜索索引
  • 生成自定义报告
代码编辑器中的 JSON 数据

实用技巧

JSON 导出使用两个空格缩进,便于阅读。可使用 JavaScript 的 JSON.parse() 或 Python 的 json.loads() 处理。

使用 JavaScript 处理 JSON

// 读取并处理导出的 JSON
const data = JSON.parse(jsonString);

// 获取总时长,单位为分钟
const minutes = Math.floor(data.duration / 60);

// 获取全文
const fullText = data.text;

// 处理分段
data.segments.forEach(segment => {
  console.log(`[${segment.start}s] ${segment.text}`);
});

// 按时间范围筛选分段
const firstMinute = data.segments.filter(
  seg => seg.start < 60
);

使用 Python 处理 JSON

import json

# 加载 JSON 文件
with open('transcription.json', 'r') as f:
    data = json.load(f)

# 读取字段
print(f"文件: {data['fileName']}")
print(f"时长: {data['duration']}s")
print(f"语言: {data['language']}")

# 处理分段
for segment in data['segments']:
    print(f"[{segment['start']:.2f}s] {segment['text']}")

重要

长录音的 JSON 文件可能较大。一小时的转写结果可能约为 100 至 200 KB,实际大小取决于分段数量和内容。

标签

JSONAPI开发者结构化数据集成

相关文章

🎬

SRT 时间戳格式:详解 hh:mm:ss,mmm

逐项了解 SubRip 时间戳 hh:mm:ss,mmm --> hh:mm:ss,mmm 的含义、常见格式错误、它与 VTT 和 SBV 的区别,以及如何从 TranscribeNext 导出 SRT。

📥

导出指南:选择合适的格式

了解各种导出格式,以及它们各自适合的使用场景。

⏱️

带时间戳的转写:跳转到录音位置

通过文本分段的时间戳定位录音,搜索文字后跳转收听,并按需导出时间信息。

📄

TXT 格式:纯文本

将转写结果导出为简洁的文本文件,便于在各种文本编辑器和应用中使用。

相关工具

  • 支持的音频与视频格式 — 包括 MP3、WAV、OGG、MP4、MPEG 等格式,以及各格式的限制与使用建议。
  • Mac 转写应用 — 使用 Whisper 和 Parakeet 免费离线录音与转写;离线处理时,文件不会离开您的电脑。
JSON 格式:面向开发者的结构化数据 | TranscribeNext 说明