文件合并拆分 在线工具核心JS实现

简介: 这是一个轻量级日志文件处理在线工具,支持按行/字节精准拆分与灵活合并。统一数据结构、标准化换行符、补零命名、行边界切分、可配置分隔符,并提供单文件下载与ZIP批量导出功能,专注解决大文件分享与多小文件统览痛点。

这个工具最早是为了处理我自己的日志文件。一个文件几万行,直接发给别人不方便;反过来,多个小文件又很难一次看完。所以我把它做成了两个动作:拆分合并。下面只聊核心 JavaScript。

在线工具网址:https://see-tool.com/file-merge-split
工具截图:
工具截图.png

先把数据结构定死

我一开始踩过坑:拆分结果和合并结果字段不一致,后面下载和展示写起来很别扭。后来统一成一个最小结构,事情就顺了。

{
   
  name: 'orders_part_001.csv',
  content: '...文本...',
  lineCount: 1000,
  byteSize: 32768
}

只要是“输出文件”,都长这个样子。后续逻辑基本就能复用。

读文件之前,先做标准化

文本处理最烦的是换行。Windows 常见 \r\n,旧系统可能是 \r,如果不统一,行数和大小计算会不准。

const normalizeLineBreaks = (text) => String(text || '').replace(/\r\n?/g, '\n')
const getByteSize = (text) => new Blob([String(text || '')]).size

const countLines = (content) => {
   
  const normalized = normalizeLineBreaks(content)
  if (!normalized) return 0
  return normalized.split('\n').length
}

文件读取这里我固定 UTF-8:

const readFileAsUtf8Text = (file) => {
   
  return new Promise((resolve, reject) => {
   
    const reader = new FileReader()

    reader.onload = (event) => {
   
      resolve(normalizeLineBreaks(event.target?.result || ''))
    }

    reader.onerror = () => reject(new Error('read-failed'))
    reader.readAsText(file, 'utf-8')
  })
}

分片命名别偷懒

命名看起来是小事,但用户下载后通常会按文件名排序看结果。序号不补零的话,part_10 会排到 part_2 前面。

const getFileBaseName = (fileName) => {
   
  const name = String(fileName || '').trim() || 'file'
  const dot = name.lastIndexOf('.')

  if (dot <= 0 || dot === name.length - 1) {
   
    return {
    baseName: name, extension: 'txt' }
  }

  return {
   
    baseName: name.slice(0, dot),
    extension: name.slice(dot + 1)
  }
}

const createPartName = (fileName, index) => {
   
  const {
    baseName, extension } = getFileBaseName(fileName)
  const seq = String(index).padStart(3, '0')
  return `${
     baseName}_part_${
     seq}.${
     extension}`
}

按行拆分:最稳的一条路

按行拆分逻辑很直白:分行后按步长切片。

const createChunk = (fileName, index, content) => {
   
  const text = String(content || '')
  return {
   
    name: createPartName(fileName, index),
    content: text,
    lineCount: countLines(text),
    byteSize: getByteSize(text)
  }
}

const splitByLines = (content, linesPerFile, fileName = 'file.txt') => {
   
  const normalized = normalizeLineBreaks(content)
  if (!normalized) return []

  const limit = Math.max(1, Number(linesPerFile) || 1)
  const lines = normalized.split('\n')
  const chunks = []

  for (let i = 0; i < lines.length; i += limit) {
   
    const chunkContent = lines.slice(i, i + limit).join('\n')
    chunks.push(createChunk(fileName, chunks.length + 1, chunkContent))
  }

  return chunks
}

按大小拆分:关键在“逐行累加”

这个版本我改过一次。第一次写得太粗暴,直接按字符长度估算,中文场景会偏差。后来改成按字节算,并且只在行边界切。

const splitBySize = (content, bytesPerFile, fileName = 'file.txt') => {
   
  const normalized = normalizeLineBreaks(content)
  if (!normalized) return []

  const targetBytes = Math.max(1, Number(bytesPerFile) || 1)
  const lines = normalized.split('\n')
  const chunks = []

  let currentLines = []
  let currentSize = 0

  for (const line of lines) {
   
    const lineSize = getByteSize(line)

    // 已有内容时,加上一个换行符的字节占位
    const nextSize = currentLines.length > 0
      ? currentSize + 1 + lineSize
      : lineSize

    // 超过阈值:先提交当前块,再开启新块
    if (currentLines.length > 0 && nextSize > targetBytes) {
   
      chunks.push(createChunk(fileName, chunks.length + 1, currentLines.join('\n')))
      currentLines = [line]
      currentSize = lineSize
      continue
    }

    currentLines.push(line)
    currentSize = nextSize
  }

  if (currentLines.length > 0) {
   
    chunks.push(createChunk(fileName, chunks.length + 1, currentLines.join('\n')))
  }

  return chunks
}

这个写法的好处是:不会把一行硬切成两段,导出的文件可读性更好。

合并逻辑:分隔符是核心开关

合并本身就是 join,真正要处理的是“分隔符输入”。

const normalizedCustomSeparator = computed(() => {
   
  return String(customSeparator.value || '')
    .replace(/\\r/g, '\r')
    .replace(/\\n/g, '\n')
    .replace(/\\t/g, '\t')
})

const effectiveSeparator = computed(() => {
   
  if (separatorMode.value === 'doubleNewline') return '\n\n'
  if (separatorMode.value === 'space') return ' '
  if (separatorMode.value === 'none') return ''
  if (separatorMode.value === 'custom') return normalizedCustomSeparator.value
  return '\n'
})

const mergeFiles = (files, separator = '\n') => {
   
  const list = Array.isArray(files) ? files : []
  const mergedContent = list.map(item => String(item.content || '')).join(String(separator ?? ''))

  return {
   
    name: 'merged.txt',
    content: mergedContent,
    lineCount: countLines(mergedContent),
    byteSize: getByteSize(mergedContent)
  }
}

执行入口:只做分发,不做复杂判断

const runSplit = () => {
   
  if (!splitFile.value) return

  splitting.value = true
  try {
   
    splitResults.value = splitMode.value === 'lines'
      ? splitByLines(splitFile.value.content, splitLinesLimit.value, splitFile.value.name)
      : splitBySize(splitFile.value.content, toBytes(splitSizeLimit.value, splitSizeUnit.value), splitFile.value.name)
  } finally {
   
    splitting.value = false
  }
}

const runMerge = () => {
   
  if (!mergeFileList.value.length) return

  merging.value = true
  try {
   
    mergedResult.value = mergeFiles(mergeFileList.value, effectiveSeparator.value)
  } finally {
   
    merging.value = false
  }
}

这里我尽量让入口函数“短小且可读”,复杂逻辑都放到工具函数里。

下载:文本直下 + 多文件打包

单文件下载:

const downloadTextFile = (content, fileName, mimeType = 'text/plain;charset=utf-8') => {
   
  const blob = new Blob([String(content || '')], {
    type: mimeType })
  const url = URL.createObjectURL(blob)
  const link = document.createElement('a')

  link.href = url
  link.download = fileName
  document.body.appendChild(link)
  link.click()
  document.body.removeChild(link)
  URL.revokeObjectURL(url)
}

批量下载时,用 ZIP 一次打包:

const loadScript = (src) => {
   
  return new Promise((resolve, reject) => {
   
    const existed = document.querySelector(`script[src="${
     src}"]`)
    if (existed) return resolve()

    const script = document.createElement('script')
    script.src = src
    script.onload = () => resolve()
    script.onerror = () => reject(new Error(`load-failed:${
     src}`))
    document.head.appendChild(script)
  })
}

const downloadFilesAsZip = async (files, zipName = 'split-files.zip') => {
   
  await loadScript('/js/jszip.min.js')
  await loadScript('/js/FileSaver.min.js')

  const zip = new window.JSZip()
  ;(Array.isArray(files) ? files : []).forEach((item, idx) => {
   
    const name = String(item?.name || `part_${
     idx + 1}.txt`)
    const content = String(item?.content || '')
    zip.file(name, content)
  })

  const blob = await zip.generateAsync({
    type: 'blob' })
  window.saveAs(blob, zipName)
}

最后一句

这个工具的核心 JS 不算花哨,重点是把几个容易出错的细节处理扎实:换行统一、字节计算、分片命名、下载闭环。只要这四个点稳住,拆分和合并就会非常顺手。

相关文章
|
5天前
|
人工智能 自然语言处理 JavaScript
2026年Windows+Ollama本地部署OpenClaw保姆级教程:本地AI Agent+阿里云上快速搭建
2026年OpenClaw凭借本地部署、私有化运行的特性,成为打造个人智能体的核心工具,而Ollama作为轻量级本地大模型管理工具,能让OpenClaw摆脱对云端大模型的依赖,实现**本地推理、数据不泄露、全流程私有化**的智能体验。本文基于Windows 11系统,从硬件环境准备、Ollama安装与模型定制、OpenClaw部署配置、技能扩展到常见问题排查,打造保姆级本地部署教程,同时补充阿里云OpenClaw(Clawdbot)快速部署步骤,兼顾本地私有化需求与云端7×24小时运行需求,文中所有代码命令均可直接复制执行,确保零基础用户也能快速搭建属于自己的本地智能体。
6874 47
|
2天前
|
人工智能 安全 API
CoPaw:3分钟部署你的 AI助理
源自阿里巴巴开源生态的个人 AI 助理——CoPaw。作为阿里倾力打造的开源力作,CoPaw 完美打通钉钉、飞书、Discord 等多平台对话通道,支持定时任务自动化。内置 PDF/Office 深度处理、新闻摘要等强大技能,更开放自定义扩展接口。坚持数据全程私有化部署,绝不上传云端,让每一位用户都能在大厂技术加持下,拥有安全、专属的智能助手。
|
6天前
|
人工智能 JSON JavaScript
手把手教你用 OpenClaw + 飞书,打造专属 AI 机器人
手把手教你用 OpenClaw(v2026.2.22-2)+ 飞书,10分钟零代码搭建专属AI机器人!内置飞书插件,无需额外安装;支持Claude等主流模型,命令行一键配置。告别复杂开发,像聊同事一样自然对话。
3247 9
手把手教你用 OpenClaw + 飞书,打造专属 AI 机器人
|
4天前
|
人工智能 自然语言处理 机器人
保姆级教程:Mac本地搭建OpenClaw及阿里云上1分钟部署OpenClaw+飞书集成实战指南
OpenClaw(曾用名Clawdbot、Moltbot)作为2026年最热门的开源个人AI助手平台,以“自然语言驱动自动化”为核心,支持对接飞书、Telegram等主流通讯工具,可替代人工完成文件操作、日历管理、邮件处理等重复性工作。其模块化架构适配多系统环境,既可以在Mac上本地化部署打造私人助手,也能通过阿里云实现7×24小时稳定运行,完美兼顾隐私性与便捷性。
2669 4
|
12天前
|
存储 人工智能 负载均衡
阿里云OpenClaw多Agent实战宝典:从极速部署到AI团队搭建,一个人=一支高效军团
在AI自动化时代,单一Agent的“全能模式”早已无法满足复杂任务需求——记忆臃肿导致响应迟缓、上下文污染引发逻辑冲突、无关信息加载造成Token浪费,这些痛点让OpenClaw的潜力大打折扣。而多Agent架构的出现,彻底改变了这一现状:通过“单Gateway+多分身”模式,让一个Bot在不同场景下切换独立“大脑”,如同组建一支分工明确的AI团队,实现创意、写作、编码、数据分析等任务的高效协同。
5312 31
|
4天前
|
人工智能 数据可视化 安全
Claude Code小白邪修指南:一键安装+语音增效,附阿里云极速部署OpenClaw/Clawdbot攻略
对于AI工具新手而言,Claude Code的原生安装流程繁琐、终端操作门槛高,让不少人望而却步。但2026年的今天,“邪修”玩法彻底打破这一壁垒——通过开源工具实现一键部署,用语音交互提升3-4倍效率,再搭配阿里云OpenClaw的稳定运行环境,让小白也能快速上手AI编程助手。本文将详解“邪修”核心技巧、语音增效方案,以及阿里云OpenClaw部署步骤,附带完整配置代码与避坑指南,帮助你轻松开启AI辅助工作新模式。
1742 0
|
7天前
|
存储 人工智能 BI
2026年OpenClaw(Clawdbot)极简部署:接入小红书全自动运营,一个人=一支团队
2026年的小红书运营赛道,AI自动化工具已成为核心竞争力。OpenClaw(原Clawdbot)凭借“Skill插件化集成、全流程自动化、跨平台联动”的核心优势,彻底颠覆传统运营模式——从热点追踪、文案创作、封面设计到自动发布、账号互动,仅需一句自然语言指令,即可实现全链路闭环。而阿里云作为OpenClaw官方推荐的云端部署载体,2026年推出专属秒级部署方案,预装全套运行环境与小红书运营插件,让零基础用户也能10分钟完成部署,轻松拥有7×24小时在线的“专属运营团队”。
2251 10
|
16天前
|
人工智能 自然语言处理 监控
OpenClaw skills重构量化交易逻辑:部署+AI全自动炒股指南(2026终极版)
2026年,AI Agent领域最震撼的突破来自OpenClaw(原Clawdbot)——这个能自主规划、执行任务的智能体,用50美元启动资金创造了48小时滚雪球至2980美元的奇迹,收益率高达5860%。其核心逻辑堪称教科书级:每10分钟扫描Polymarket近千个预测市场,借助Claude API深度推理,交叉验证NOAA天气数据、体育伤病报告、加密货币链上情绪等多维度信息,捕捉8%以上的定价偏差,再通过凯利准则将单仓位严格控制在总资金6%以内,实现低风险高频套利。
8575 69
|
6天前
|
人工智能 运维 安全
OpenClaw极速部署:ZeroNews 远程管理OpenClaw Gateway Dashboard指南+常见错误解决
OpenClaw作为高性能AI智能体网关平台,其Gateway Dashboard是管理模型调用、渠道集成、技能插件的核心操作界面,但默认仅支持本地局域网访问。官方推荐的Tailscale、VPN等远程访问方案在国内网络环境中体验不佳,而ZeroNews凭借轻量化部署、专属域名映射、多重安全防护的特性,成为适配国内网络的最优远程管理解决方案。
1901 2

热门文章

最新文章