2024年裁判文书检索与案件大数据
2024 年度文书量近七百万篇,买卖合同、民间借贷与借款合同三类商事纠纷体量接近、并列高发,广东、山东、上海样本尤为充足,是观察近期合同与金融纠纷审理口径的主力年度。
文书查直连 近 1.6 亿 条全量裁判文书,为「2024年」提供类案检索、裁判文书全文展开、按案号回核与案由/地域分布的案件大数据分析。
2024年·案由分布(点击下钻检索)
数据源:全库四维(案由/地域/年份/法院)实时聚合统计;点击某案由进入该案由在 2024 年的类案检索。
口径:这份分布来自上游预聚合的 cause 取值,其中 3 项不是一类具体案由(「其他案由」「民事」「其他行政行为」等兜底桶与审判领域/名录级取值,合计 251,454 篇),已逐行标出。「覆盖案由(类)」不把它们算成一类案由;它们在库里确有对应文书,故不删行、不改名、不动计数。另:「覆盖案由(类)」是下限,不是本切片的案由总数。上游预聚合一次最多返回约 60 个桶,本页这份案由榜已返回 59 个、顶到上限,排在后面的案由直接不在数据里 —— 2026-08-01 免 key 实测:8 个年份页与 31 个地域页无一例外都是 59 项,连全库只有 373 篇的 1998 年也照样返 59 项(而 2 篇的极窄切片返 2 项)⇒ 59 是上限不是自然桶数;把同一年按省拆开重打,2022 年 12 个省切片的并集就有 143 个不同案由,其中 84 个不在全国那 59 项榜上,31 个省切片的并集有 160 个。本次最小的桶是 15,577 篇,低于它的案由桶一个都没返回,故下面每个案由的计数同样只是下限。自查(免 key,两行,第一行就是本页这一次打的那条,原样可跑):curl -sS 'https://tob.wenshucha.com/api/analytics?dim=cause&yearFrom=2024&yearTo=2024' 是本页这份榜;curl -sS 'https://tob.wenshucha.com/api/analytics?dim=cause&province=%E5%B1%B1%E4%B8%9C%E7%9C%81&yearFrom=2024&yearTo=2024' 是保留本页筛选、再叠一个省缩窄后的那份 —— 缩窄后冒出来的案由,就是本页这份榜被上限截掉的那些(2026-08-13 免 key 实测一例:给 2020 那条切片叠上山东省,回来的 危险驾驶 4,409、证券虚假陈述责任纠纷 1,546、保证保险合同纠纷 1,377,在 /sifa/year/2020 那份 59 项榜上一个都没有)。换成别的省重打即可,但那是比本页更窄的另一条切片,它的计数不等于本页这条。回来是空数组既不代表命令写错、也不代表这条切片真没有这个省:2026-08-13 免 key 实测,「借款合同纠纷 2022」那份分布里海南省有 5,989 篇,而给同一条切片加上 province=海南省 重打却返空(只留年份则正常返 28,495)—— 上游那条 province 过滤对部分省份不生效。遇到空结果请以上面那份分布里的行为准。改动 URL 上任何一个筛选问到的都是另一条切片,数字对不上是正常的。换值时别把中文直接粘进 URL:上面命令里的中文已是 URL 编码形态(%E5%B1%B1%E4%B8%9C%E7%9C%81 就是 山东省),而 2026-08-11 本站迁到自建服务器后,请求行里未编码的中文会被判 400、响应体为空,curl -sS 对此不报错也不打印任何东西、退出码还是 0(2026-08-13 免 key 实测 10/10),读起来像「这条切片没数据」,实际是这一行请求根本没被解析。换值请让 curl 自己编码,中文照写:curl -sS -G 'https://tob.wenshucha.com/api/analytics' --data-urlencode 'dim=cause' --data-urlencode 'province=广东省'(同日实测 200)。另:同一个裸中文地址粘进浏览器地址栏是好的(浏览器会自动编码,同日实测 200),所以「浏览器里看得到、终端里空手而归」不代表两边数据不一样。
口径:这份案由分布覆盖本切片的 83.4%(共 6,984,435 篇中的 5,826,541 篇),下面的名次只在被覆盖的这部分里成立,不是本切片的全量案由排名。上游共 59 个案由桶合计 5,826,541 篇,下表只列其中文书量最高的 10 项(合计 3,740,439 篇 = 53.6%);其余 2,086,102 篇仍在上面的覆盖率里,只是没排进下表。未覆盖的 1,157,894 篇分两类:排在上游 Top-N 之外的长尾案由,以及上游没有案由取值的条目。未被覆盖的部分不是「排在后面的长尾案由」,而是这批文书在上游没有案由取值:2026-08-01 免 key 逐条抽样,河南省 2020 年 50/50 条该字段为空,浙江省 2023 年 0/50 为空 —— 缺失是入库批次属性,不是均匀分布,也不是检索方式的问题;把切片缩小重新聚合变不出这些文书的案由。自查(免 key,一行,就是本页这一次打的那条切片,原样可跑):curl -sS 'https://tob.wenshucha.com/api/analytics?dim=cause&yearFrom=2024&yearTo=2024' 看 _meta.coverage(= 上面那个覆盖率)。改动 URL 上任何一个筛选(增删省份、加减年份)问到的都是另一条切片,数字对不上是正常的。换值时别把中文直接粘进 URL:上面命令里的中文已是 URL 编码形态(%E5%B1%B1%E4%B8%9C%E7%9C%81 就是 山东省),而 2026-08-11 本站迁到自建服务器后,请求行里未编码的中文会被判 400、响应体为空,curl -sS 对此不报错也不打印任何东西、退出码还是 0(2026-08-13 免 key 实测 10/10),读起来像「这条切片没数据」,实际是这一行请求根本没被解析。换值请让 curl 自己编码,中文照写:curl -sS -G 'https://tob.wenshucha.com/api/analytics' --data-urlencode 'dim=cause' --data-urlencode 'province=广东省'(同日实测 200)。另:同一个裸中文地址粘进浏览器地址栏是好的(浏览器会自动编码,同日实测 200),所以「浏览器里看得到、终端里空手而归」不代表两边数据不一样。
2024年·地域分布(点击下钻检索)
点击某地区进入该地区在 2024 年的类案检索。
口径:这份地域分布覆盖本切片的 73.9%(共 6,984,435 篇中的 5,160,148 篇),下面每一行都只描述被覆盖的这部分 —— 各项之和与上方「文书量」对不上是正常的。其余 1,824,287 篇没有进入任何省份桶。本页这份省份榜没有顶到上游桶数上限(本次返回 32 个、上限约 60 个),即一个桶都没被截掉 ⇒ 这 1,824,287 篇是上游给不出省份取值的条目,不是被 Top-N 截断掉的。各项照原样保留(它们在库里确有对应文书,本站不改上游、不动计数);真修需上游在入库侧补齐省份字段。自查(免 key,一行,就是本页这一次打的那条切片,原样可跑):curl -sS 'https://tob.wenshucha.com/api/analytics?dim=province&yearFrom=2024&yearTo=2024' 看 _meta.listedSum(= 上面那个分子)与 total(= 上面那个分母);上游若同时发了 _meta.coverage,它与上面那个覆盖率是同一个数。改动 URL 上任何一个筛选(增删省份、加减年份)问到的都是另一条切片,数字对不上是正常的。另:这份分布来自上游预聚合的 province 取值,其中 1 项不是省级行政区(「最高人民法院」等入库残留与法院名,合计 5,249 篇),已逐行标出。「覆盖地域(省/市)」只数真实省级行政区(全国共 34 个,本库有文书的 31 个),不把这些取值算成一个地区;它们在库里确有对应文书,故不删行、不改名、不动计数。
2024年裁判文书·常见问题
如何检索2024年的裁判文书?
进入文书查「类案检索」,把裁判年份设为 2024 年(起止年份均填 2024),可叠加案由、省份、审理法院与关键词组合检索,逐条展开裁判理由与裁判结果。结果不含中国裁判文书网原文直链:上游 source_url 字段系统性为空(2026-07-30 免 key 实测 54/54 条为空,同日三条检索线合计 189/189 条为空),成因是入库 doc_id 不是裁判文书网原始 docId,无从派生真链,硬拼一个打不开的链接比留空更糟。回核原文请用「案号」:逐条结果、导出 CSV 与复制清单均带案号,到中国裁判文书网(wenshu.court.gov.cn)按案号检索。但案号并非每条都有,且缺失「高度集中在婚姻家庭/人身类查询」,不是均匀分布:2026-07-30 免 key 实测 14 个关键词 654 条,合计 17/654(2.6%)缺案号,其中 q=离婚 9/50(18.0%)、利息 8.1%、工伤 6.0%、抚养 4.1%,而民间借贷/劳动争议/交通事故/买卖合同/继承/房屋买卖等 10 词均为 0% —— 按 2.6% 这个全站均值理解,会严重低估婚姻家庭检索里遇到它的概率。这类条目也退不回「案名 + 法院 + 裁判日期」核对:同批 17 条样本里,法院字段无一条是真法院名(0/17,写的是裁判文书网的不上网/不公开事由)、裁判日期仅 3/17 有值、原文直链 0/17,即 14/17 除案名外没有任何可核锚点。结果列表对这类条目会逐条标出「无案号」,不让它静默混在可回核的结果里。⚠️ 「按案号检索即可」这句,我们从来没验过它走不走得通,而且用 HTTP 验不出来:2026-08-22 现网实打该站的案号检索页(URL 上用 `s21=` 挂案号)共 6 组 —— 其中两个真案号直接取自本站检索结果、一个编造案号、一串垃圾、三个雪人字符,以及一个空案号,6 组全部返 200 / 14,179 字节 / `text/html`,响应体 md5 逐字节相同(`504af898bd320c6549ab0b06a44337b3`)。落点是 JS 单页应用,案号要到浏览器里才发给后端(页面外壳去掉脚本后可见文字仅 151 字,只有「登录/注册/搜索」这类导航词,一行结果都没有) ⇒ 状态码零信息量,你写脚本批量核一批案号只会拿到「条条 200」。而且连该站自己出结果的那个接口也是 200 裹着拒绝:同日 `POST wenshu.court.gov.cn/website/parse/rest.q4w`、不带登录凭证的程序化调用当场被拒,返回的仍是 HTTP 200(158 字节 `application/json`):`{"code":9,"success":false,"description":"没有权限请求接口"}`。两条加起来:朴素的 `res.ok` / 看状态码这两种自动核验,在这条路径上一定是假绿。但请别把这段读成「按案号回核走不通」 —— 恰恰相反,该站本身是通的(同日首页 200 / 22,309 字节),我们没有任何证据说人工在浏览器里按案号检索会失败,也没有在浏览器里人工试过。本段只钉住两件事:这条路径我们没验证过、而且它没法用状态码自动验证。要确认某一条,请人工打开该站检索(未登录时页面上就摆着「登录/注册」),别拿脚本的 200 当作核对通过。把「未验证」读成「已证伪」是另一种假话。
2024年哪些案由的文书量最大?
按全库实时聚合统计,2024年文书量较高的案由包括买卖合同纠纷、民间借贷纠纷、借款合同纠纷、金融借款合同纠纷、合同纠纷等;案件大数据分析可查看该年的案由分布并下钻到该案由的类案检索。需注意那份分布是按文书量取的 Top-N,2024年已顶到上游一次返回的桶数上限(59 项),并不是完整案由名录;要看排在后面的案由,可叠加省份等条件把切片缩小后重新聚合。需注意这份分布只覆盖该切片的 83.4%(6,984,435 篇中的 5,826,541 篇)——另有 1,157,894 篇未进入任何案由桶(部分是 Top-N 之外的长尾案由,部分在上游没有案由取值),故上面的名次只在被覆盖的那部分里成立。
2024年的检索结果可以直接作为法律意见吗?
不可以。文书查仅提供基于公开裁判文书的检索与统计素材,不预测裁判结果、不生成法律意见,具体案件请以律师与法院的专业判断为准。
2024年·分案由深度专题
进入「2024年 × 案由」专题页,查看该组合的全国地域分布与类案检索入口。
2024年·分地域深度专题
进入「2024年 × 地区」专题页,查看该组合的案由分布与类案检索入口。案由一维的覆盖率是逐切片的入库批次属性:同一批专题页里有的正常,也有的低到页面自己标着「不能当作案由排名读」。这一维能不能当排名读,以目标页自己标注的口径为准。