实测 7 种数据格式 token:缩进 JSON 是 CSV 的 3 倍
2026/10/03 — 10/03 01:50·1 个来源·1 篇报道
事件概览
2026 年 10 月 3 日,DEV Community 上的一篇文章记录了一次小规模实测:作者把同一份产品数据写成 7 种格式,逐一统计 token 消耗。
实验对象是一张产品表,共 20 行、5 个字段,分别是 id、名称、价格、库存、分类。作者使用 o200k_base 分词器统计每种格式的 token 数,结论是带缩进的 JSON 消耗的 token 约为 CSV 的 3 倍。作者提到,直接把 JSON.stringify(data, null, 2) 的结果粘进 prompt,是常见做法里 token 开销最大的一种,而他此前从未测量过这样做的成本。
目前这条信息停留在作者个人做的一次格式对比实验,材料中没有给出其余 6 种格式各自的具体 token 数,也没有提到其他机构或产品的回应。
AI 综合 1 篇报道生成 · 更新于 1 小时前
最新进展作者把同一张 20 行 5 字段的产品表写成 7 种格式,用 o200k_base 分词器统计 token 数,发现带缩进的 JSON 消耗约为 CSV 的 3 倍。直接把 JSON.stringify(data, null, 2) 的结果粘进 prompt 是最费 token 的常见做法。

这件事的报道 点标题看原文
作者把同一张 20 行 5 字段的产品表写成 7 种格式,用 o200k_base 分词器统计 token 数,发现带缩进的 JSON 消耗约为 CSV 的 3 倍。直接把 JSON.stringify(data, null, 2) 的结果粘进 prompt 是最费 token 的常见做法。
省 token 的实用结论:别再把缩进 JSON 塞进 prompt。
DEV Community · AIAI 评分 80
同时在说的其他事
- 625爆英伟达发布 64GB 版 DGX Spark,售价 4999 美元7 个来源
- 495发酵中谷歌发布 Gemini 4 Argon 模型,定位前沿 AI 能力14 个来源
- 389新Apple 收紧 macOS 全盘访问权限,防范 AI Agent 风险4 个来源
- 224爆微软发布 MAI-Transcribe-2-Streaming 实时转写模型3 个来源
- 191新Anthropic 投 1 亿美元启动 Claude 工程师学院2 个来源
- 179新Hugging Face 开源报告生成模型 AstaBrief2 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
