• 1.摘要
  • 2.基本信息
  • 3.用法
  • 4.规则
  • 5.实例
  • 6.规范
  • 6.1.基本规则
  • 6.2.举例说明
  • 7.文件转换
  • 8.参考资料

CSv

6
逗号分隔值文件格式

CSv(Comma-Separated Values)又称为逗号分隔值,是一种通用的、相对简单的文件格式。

1/2

CSv是一个字符序列,不含必须像二进制数字那样被解读的数据,以纯文本形式存储表格数据。它可在程序之间转移表格数据,被用户、商业和科学广泛应用。

基本信息

  • 中文名

    CSV逗号分隔值

  • 外文名

    Comma-Separated Values

  • 应用

    在程序之间转移表格数据

用法

CSv

CSV是一种通用的、相对简单的文件格式,被用户、商业和科学广泛应用。最广泛的应用是在程序之间转移表格数据,而这些程序本身是在不兼容的格式上进行操作的(往往是私有的和/或无规范的格式)。因为大量程序都支持某种CSV变体,至少是作为一种可选择的输入/输出格式。

例如,一个用户可能需要交换信息,从一个以私有格式存储数据的数据库程序,到一个数据格式完全不同的电子表格。最可能的情况是,该数据库程序可以导出数据为“CSV”,然后被导出的CSV文件可以被电子表格程序导入。

“CSV”并不是一种单一的、定义明确的格式(尽管RFC 4180有一个被通常使用的定义)。因此在实践中,术语“CSV”泛指具有以下特征的任何文件:

  1. 1.

    纯文本,使用某个字符集,比如ASCII、Unicode、EBCDIC或GB2312;

  2. 2.

    由记录组成(典型的是每行一条记录);

  3. 3.

    每条记录被分隔符分隔为字段(典型分隔符有逗号、分号或制表符;有时分隔符可以包括可选的空格);

  4. 4.

    每条记录都有同样的字段序列。

在这些常规的约束条件下,存在着许多CSV变体,故CSV文件并不完全互通。然而,这些变异非常小,并且有许多应用程序允许用户预览文件(这是可行的,因为它是纯文本),然后指定分隔符、转义规则等。如果一个特定CSV文件的变异过大,超出了特定接收程序的支持范围,那么可行的做法往往是人工检查并编辑文件,或通过简单的程序来修复问题。因此在实践中,CSV文件还是非常方便的。

规则

1 开头是不留空,以行为单位。

2 可含或不含列名,含列名则居文件第一行。

3 一行数据不跨行,无空行。

4 以半角逗号(即,)作分隔符,列为空也要表达其存在。

5列内容如存在半角引号(即"),替换成半角双引号("")转义,即用半角引号(即"")将该字段值包含起来。

6文件读写时引号,逗号操作规则互逆。

7内码格式不限,可为 ASCII、Unicode 或者其他。

8不支持数字

8不支持特殊字符

实例

下面是一个实际 CSV 文件中的部分内容,让大家对他有一个感性的认识。我们选的是 Sjojo_Rescan 的 CSV 文件 (Sjojo 是 ASW- 亚洲扫图风的成员之一)。