FEATURED · 精选文章

Gephi 网络图入门:从 Excel 到 CSV 数据导入完整指南

发布时间 / 2026/9/19 9:58:16
来源 / 创域科博编辑部
栏目 / 资讯中心
Gephi 网络图入门:从 Excel 到 CSV 数据导入完整指南 很多做社会网络分析、文献计量或者知识图谱的朋友第一次打开 Gephi 的时候都会卡在同一个地方数据到底该怎么喂进去。软件界面看着挺唬人布局算法一大堆结果连个节点都画不出来。其实问题十有八九不在 Gephi 本身而是卡在了数据准备这一步——尤其是手里只有 Excel 表格不知道怎么把它变成 Gephi 能认的 CSV 文件。这篇内容就是把这个过程从头到尾拆开讲清楚从 Excel 里怎么整理两列数据到 CSV 编码怎么选再到 Gephi 里点哪个按钮导入、导入后怎么调布局、怎么让图看起来不像一团毛线。适合完全没碰过 Gephi 的新手也适合之前导数据失败过、想搞清楚到底哪里出问题的人。1. 先搞清楚 Gephi 到底想吃什么样的数据1.1 网络图的两个基本元素节点和边Gephi 画网络图底层逻辑特别简单就两个东西节点Node和边Edge。节点就是图上的一个个圆点边就是连接两个圆点的那条线。你给它一张谁和谁有关系的清单它就能把图给你画出来。拿最常见的场景举例你有一份 Excel 表格记录的是公司里哪些人合作过项目。A 和 B 合作过B 和 C 合作过A 和 C 也合作过。那 A、B、C 就是三个节点三条合作关系就是三条边。Gephi 要的就是这种成对关系的数据。所以你在 Excel 里整理数据的时候核心就是整理出两列一列是起点一列是终点。每一行代表一条边。这是最基础、也是最常用的导入方式叫边表Edges Table。1.2 边表和节点表新手先用边表就够了Gephi 支持两种 CSV 导入方式边表和节点表。很多人一上来就被这两个概念绕晕其实你只要记住一句话边表里已经隐含了节点。比如你有这么一行数据SourceTarget张三李四Gephi 读到这行会自动创建张三和李四两个节点然后在它们之间连一条边。你根本不需要单独再准备一份节点清单。只有当你想给每个节点单独设置属性比如节点大小、颜色、所属类别的时候才需要额外准备节点表。新手阶段只准备边表就够了。等图能正常画出来了再考虑加节点属性的事。这个顺序很重要一上来就搞两张表很容易因为两边的节点名称对不上导致导入报错。1.3 为什么必须是 CSVExcel 直接存 xlsx 行不行不行。Gephi 不认.xlsx格式。它认的是.csv逗号分隔值和.tsv制表符分隔值。CSV 本质上就是一个纯文本文件每一行是一条记录字段之间用逗号隔开。Excel 可以另存为 CSV操作是文件 → 另存为 → 选择CSV UTF-8逗号分隔(*.csv)。注意这里一定要选带 UTF-8 的那个选项原因后面会详细讲这是新手翻车最多的地方。提示如果你用的是 Mac 版 Excel另存为的菜单里同样有CSV UTF-8选项位置在文件 → 另存为的格式下拉框里。不要选CSV逗号分隔那个默认编码不是 UTF-8。2. 在 Excel 里把数据整理成 Gephi 能读的样子2.1 最简边表的结构两列有表头打开 Excel新建一个工作表第一行写表头。推荐用这两个名字第一列Source或者写源、起点都行第二列Target或者写目标、终点从第二行开始每一行填一对关系。比如SourceTarget张三李四李四王五张三王五王五赵六这四行数据Gephi 读进去之后会生成四个节点张三、李四、王五、赵六和四条边。就这么简单。表头这一行很重要Gephi 导入的时候会问你要不要保留表头有表头它才能正确识别哪列是 Source、哪列是 Target。所以千万别省表头。2.2 有向图还是无向图数据整理时就要想清楚这里有个概念需要提前定你的关系是有向的还是无向的。无向图A 和 B 有关系就等于 B 和 A 有关系。比如合作过这种关系通常是无向的。有向图A 指向 B不代表 B 指向 A。比如关注关系我关注你你不一定关注我。在 Excel 里无向图你只需要写一行张三-李四Gephi 导入时选择无向类型它会自动处理成双向可通行。有向图则要注意方向Source 是起点Target 是终点。新手建议先用无向图练手因为不用纠结方向问题画出来的图也更容易看懂。等熟悉了再玩有向图。2.3 权重列让粗线细线区分关系强弱如果你的关系有强弱之分比如合作次数、通信频率、交易金额可以加第三列Weight权重。比如SourceTargetWeight张三李四5李四王五2张三王五8导入 Gephi 后权重高的边可以显示得更粗一眼就能看出哪些关系更紧密。这个在文献共被引分析、社交互动分析里特别有用。权重列不是必须的但强烈建议有强弱关系的数据都加上。后面在 Gephi 的外观面板里可以把权重映射到边的粗细上视觉效果直接提升一个档次。2.4 节点名称的坑空格、特殊符号、重名这是新手最容易忽略、也最容易导致导入失败的地方。节点名称在 Gephi 里是唯一标识所以前后不要有空格。Excel 里肉眼看不出来但张三和张三 在 Gephi 眼里是两个不同的节点。整理完数据后可以用 Excel 的TRIM函数批量清理空格。避免特殊符号。逗号、引号、换行符这些在 CSV 里是分隔符或转义字符节点名称里带了会直接把 CSV 结构搞乱。如果非要用建议统一替换成下划线或短横线。注意重名。如果两个不同的人同名Gephi 会把它们当成同一个节点合并。这种情况需要在名称里加区分比如张三_研发部和张三_市场部。我自己的习惯是整理完数据后先做一遍清洗全选两列用TRIM去空格用查找替换把逗号、引号统一处理掉再另存为 CSV。这一步花两分钟能省掉后面半小时的排查时间。3. 另存为 CSV 时的编码问题90% 的乱码都出在这3.1 为什么中文会变成乱码CSV 文件本身不包含我用的是什么编码这个信息它就是一串字节。Excel 默认另存的 CSV 用的是本地编码中文 Windows 下通常是 GBK而 Gephi 默认按 UTF-8 去读。编码对不上中文就变成了锟斤拷或者一堆问号。解决办法就一个另存为的时候选CSV UTF-8逗号分隔。这样 Excel 会把中文按 UTF-8 编码写进文件Gephi 读的时候就能正确显示。如果你已经存成了普通 CSV发现导入 Gephi 后中文乱码不用重新整理数据用记事本打开那个 CSV另存为的时候把编码改成 UTF-8 就行。或者用 Notepad 这类编辑器菜单里直接有编码 → 转为 UTF-8。3.2 用记事本验证编码是否正确的笨办法存完 CSV 之后别急着导入 Gephi。先用记事本打开看一眼。如果中文正常显示说明编码没问题如果显示的是乱码那说明编码还是不对需要重新另存。这个笨办法特别管用因为记事本对编码的识别比较诚实它显示乱码基本就是真乱码。而 Excel 打开 CSV 的时候会自动猜编码有时候会假装显示正常反而误导你。3.3 Mac 和 Windows 下的差异Windows 版 Excel 另存为 CSV 时编码选项藏得比较深需要在下拉框里主动选CSV UTF-8。Mac 版 Excel 相对好一点另存为对话框里直接有CSV UTF-8这个格式选项。另外Mac 上如果用的是 Numbers 而不是 Excel导出 CSV 的路径是文件 → 导出 → CSV它默认就是 UTF-8这点比较省心。但 Numbers 导出的 CSV 有时候会在字段里加引号导入 Gephi 前最好用文本编辑器检查一下。4. 在 Gephi 里导入 CSV 的完整操作链路4.1 数据资料窗口点哪个按钮打开 Gephi左侧有一个数据资料Data Laboratory窗口。注意导入 CSV 不是在概览Overview里操作而是在数据资料里。具体路径点击顶部标签栏的数据资料在打开的界面里找到导入电子表格按钮图标是一个表格加一个箭头在弹出的文件选择框里选中你刚才存好的 CSV 文件这里有个细节Gephi 的概览和数据资料是两个独立的工作区。概览负责看图和调布局数据资料负责管数据。导入数据必须在数据资料里做很多新手在概览里找了半天找不到导入按钮就是因为走错了地方。4.2 导入向导里的三个关键选择选中 CSV 后Gephi 会弹出一个导入向导分几步让你确认。这里有几个选项必须选对第一步选择分隔符。默认是逗号如果你存的是标准 CSV保持默认就行。如果你用的是 TSV制表符分隔这里要改成 Tab。第二步选择导入类型。这里要选边表格Edges table。如果你选成了节点表格Gephi 会把每一行当成一个节点画出来的图就没有边了。第三步确认表头。向导里会显示你 CSV 的前几行让你确认哪列是 Source、哪列是 Target。如果表头写的是中文源和目标这里要手动在下拉框里对应上。用英文 Source/Target 的话Gephi 通常能自动识别。第四步选择图类型。无向图选无向有向图选有向。这个前面已经讲过怎么判断了。4.3 导入后数据去哪了节点和边两个标签页导入成功后数据资料窗口里会有两个标签页节点和边。点节点能看到所有自动生成的节点点边能看到所有关系。如果这里节点数是 0 或者边数是 0说明导入失败了。常见原因分隔符选错了、导入类型选错了、CSV 编码有问题导致 Gephi 读不出内容。回到上一步重新检查。确认节点和边都正常之后点击顶部标签栏回到概览你就能看到图了。不过这时候的图通常是一团乱麻所有节点挤在一起需要调布局。5. 让图从一团毛线变成能看的网络图5.1 布局算法ForceAtlas 2 是新手首选刚导入的图所有节点默认堆在中心完全看不出结构。这时候需要在左侧布局面板里选一个布局算法点运行。新手直接用ForceAtlas 2就行。它的逻辑是节点之间有斥力互相推开有边的节点之间有引力互相拉近。跑一会儿之后关系紧密的节点会聚成一团关系疏远的会散开网络结构就出来了。运行的时候可以勾选防止重叠避免节点叠在一起看不清。跑个几十秒图稳定了就可以点停止。其他布局算法比如 Fruchterman Reingold、Yifan Hu 也可以试但 ForceAtlas 2 的通用性最好参数也最容易调。5.2 用度值调整节点大小一眼看出核心节点图跑开之后下一步是让重要的节点更显眼。最常用的指标是度Degree也就是一个节点连了多少条边。度越高说明这个节点越核心。操作路径右侧外观面板 → 选节点 → 选尺寸 → 选度 → 设置最小尺寸和最大尺寸 → 点应用。比如最小设 10最大设 50那度低的节点就是小圆点度高的节点就是大圆点。这样一眼就能看出谁是网络里的关键人物。5.3 模块化给不同社群上不同颜色如果网络里有明显的社群结构比如几拨人各自抱团可以用模块化Modularity来上色。操作路径右侧外观面板 → 选节点 → 选颜色 → 选模块化 → 点应用。Gephi 会自动计算社群划分给每个社群分配不同的颜色。同一个颜色的一坨就是一个社群。这个在分析社区结构、研究群体聚类的时候特别直观。5.4 显示标签和调整预览节点和边都调好之后可以打开底部的标签开关让节点名称显示出来。如果标签太密可以在概览里把图放大或者只给度高的节点显示标签。最后如果要导出图片切到顶部的预览标签页那里可以调背景色、节点透明度、边的粗细调好之后点导出保存成 PNG 或 PDF。6. 导入失败和显示异常的排查清单6.1 导入后节点数为 0 的三种可能这是最常见的问题按顺序排查现象可能原因解决办法节点和边都是 0分隔符选错检查 CSV 是逗号还是 Tab 分隔节点有但边是 0导入类型选成了节点表重新导入选边表格节点名全是乱码编码不是 UTF-8用记事本另存为 UTF-8排查的时候先用记事本打开 CSV 确认内容正常再回 Gephi 重新走一遍导入向导。大部分问题都出在这三步里。6.2 中文乱码的两种修复路径如果已经导入 Gephi 才发现乱码有两种修法路径一改源文件。用记事本或 Notepad 打开 CSV转成 UTF-8 编码保存然后重新导入 Gephi。路径二改 Gephi 读取编码。这个比较麻烦Gephi 本身没有提供导入时选编码的选项所以还是改源文件更靠谱。注意不要试图在 Excel 里直接改编码Excel 的另存为才是控制编码的地方。打开 CSV 再另存为选 UTF-8这是最稳的操作。6.3 节点名称带空格导致的重复节点前面提过空格会导致同名节点被识别成两个。如果你发现节点数比预期多比如明明只有 20 个人结果生成了 25 个节点大概率就是空格问题。修复方法回到 Excel用TRIM函数清理两列的所有单元格重新另存为 CSV重新导入。TRIM的用法是在空白列输入TRIM(A2)往下拉然后把结果复制回原列用选择性粘贴 → 值。6.4 边太密看不清怎么办如果边特别多图会变成一团黑。这时候可以在外观面板里把边的透明度调低用过滤面板按权重筛选只显示权重高的边在布局里增大斥力让节点散得更开过滤器的用法右侧过滤面板 → 选边 → 选权重 → 设置范围 → 点过滤。这样可以把弱关系暂时隐藏只看核心结构。7. 一份可以直接抄的 Excel 模板结构7.1 基础版两列边表最简模板就三行表头加数据SourceTarget节点A节点B节点B节点C节点A节点C存成 CSV UTF-8导入 Gephi 选边表格、无向图直接就能用。7.2 进阶版带权重和类型的边表如果关系有强弱和类别可以扩展成SourceTargetWeightType节点A节点B5合作节点B节点C2引用节点A节点C8合作Weight 列用来调边的粗细Type 列可以在 Gephi 里用来分类上色。导入的时候Gephi 会问你要不要把 Type 列作为边的属性导入选是就行。7.3 整理数据时的三个自查动作每次存 CSV 之前花一分钟做这三件事去空格用TRIM清理 Source 和 Target 两列查重名用条件格式 → 突出显示重复值检查节点名称有没有意外重复看编码另存为时确认选的是CSV UTF-8这三步做完导入 Gephi 基本不会出问题。我自己的项目里这套流程跑了几十次没再因为数据格式翻过车。8. 从 CSV 到网络图真正要练的是数据思维工具操作本身不难Gephi 的导入流程走一遍就会了。真正决定图好不好看的是你在 Excel 里整理数据时的思路。同样一份关系数据有人整理出来是一团乱麻有人整理出来结构清晰差别就在对节点和边的理解上。我的建议是刚开始别追求复杂的分析先用一份小数据十几个节点、二三十条边把整个流程跑通。从 Excel 整理、另存 CSV、导入 Gephi、调布局、上色、导出图片完整走一遍。走通之后再换更大的数据、更复杂的属性。这个顺序比一上来就啃大项目要高效得多。另外CSV 文件建议保留一份原始版和一份清洗版。原始版不动清洗版用来导入。这样万一导入出问题还能回头对比是哪里改坏了。这个习惯在数据量大的时候特别救命。
RELATED — 相关阅读

相关资讯

LATEST — 最新资讯

最新发布

TODAY — 本日精选

新闻

WEEKLY — 本周精选

新闻

MONTHLY — 本月精选

新闻