2020年河南省裁判文书检索与大数据
河南省人口与农村经济基数大,裁判文书以民间借贷、买卖合同与机动车交通事故责任纠纷为主,基层民事案件量庞大。
文书查直连 近 1.6 亿 条全量裁判文书,聚焦「2020年 · 河南省」:提供类案检索、裁判文书全文展开、按案号回核。高频案由分布虽已列出,但只覆盖本切片的 0.0003%,不能当作高频案由排名读。2020 年度受外部环境影响,合同履行、买卖与借贷类纠纷成为审理重点,该年度文书是研究履约障碍、违约责任与情势变更类争点的重要样本来源。
2020年河南省·案由分布(点击下钻检索)
数据源:全库四维(案由/地域/年份/法院)实时聚合统计;点击某案由进入 河南省 2020 年该案由的类案检索。
口径:这份案由分布覆盖不了本切片,不能当作案由排名读。本切片共 1,531,707 篇,而上游给得出案由取值的只有 4 篇(占 0.0003%),其余 1,531,703 篇没有进入任何案由桶。未被覆盖的部分不是「排在后面的长尾案由」,而是这批文书在上游没有案由取值:2026-08-01 免 key 逐条抽样,河南省 2020 年 50/50 条该字段为空,浙江省 2023 年 0/50 为空 —— 缺失是入库批次属性,不是均匀分布,也不是检索方式的问题;把切片缩小重新聚合变不出这些文书的案由。算术也否掉长尾读法:2026-08-01 免 key 实测,2020 年全国 59 个桶合计 1,959,069 篇、最小的桶 4,770 篇,未覆盖 19,399,981 篇;而 12 省 + 8 年共 20 个切片的案由取值并集只有 143 个不同案由 —— 即便榜外还有 84 个桶、每个都顶着 4,770 篇的截断线,也只有约 40 万篇,与 1,940 万篇差约 48 倍。下面这几项照原样保留(它们在库里确有对应文书,本站不改上游、不动计数),但它们只描述那 4 篇。自查(免 key,两行,就是本页这一次打的那条切片,原样可跑):curl -sS 'https://tob.wenshucha.com/api/analytics?dim=cause&province=%E6%B2%B3%E5%8D%97%E7%9C%81&yearFrom=2020&yearTo=2020' 看 _meta.coverage(= 上面那个覆盖率);curl -sS 'https://tob.wenshucha.com/api/cases/search?province=%E6%B2%B3%E5%8D%97%E7%9C%81&yearFrom=2020&yearTo=2020&pageSize=50' 数 cause 为空的条数。改动 URL 上任何一个筛选(增删省份、加减年份)问到的都是另一条切片,数字对不上是正常的。换值时别把中文直接粘进 URL:上面命令里的中文已是 URL 编码形态(%E5%B1%B1%E4%B8%9C%E7%9C%81 就是 山东省),而 2026-08-11 本站迁到自建服务器后,请求行里未编码的中文会被判 400、响应体为空,curl -sS 对此不报错也不打印任何东西、退出码还是 0(2026-08-13 免 key 实测 10/10),读起来像「这条切片没数据」,实际是这一行请求根本没被解析。换值请让 curl 自己编码,中文照写:curl -sS -G 'https://tob.wenshucha.com/api/analytics' --data-urlencode 'dim=cause' --data-urlencode 'province=广东省'(同日实测 200)。另:同一个裸中文地址粘进浏览器地址栏是好的(浏览器会自动编码,同日实测 200),所以「浏览器里看得到、终端里空手而归」不代表两边数据不一样。
2020年河南省·常见问题
如何检索 2020 年河南省的裁判文书?
进入文书查「类案检索」,把省份设为「河南省」、裁判年份起止均设为 2020 年,可再叠加案由、审理法院与关键词组合检索,逐条展开裁判理由与裁判结果。结果不含中国裁判文书网原文直链:上游 source_url 字段系统性为空(2026-07-30 免 key 实测 54/54 条为空,同日三条检索线合计 189/189 条为空),成因是入库 doc_id 不是裁判文书网原始 docId,无从派生真链,硬拼一个打不开的链接比留空更糟。回核原文请用「案号」:逐条结果、导出 CSV 与复制清单均带案号,到中国裁判文书网(wenshu.court.gov.cn)按案号检索。但案号并非每条都有,且缺失「高度集中在婚姻家庭/人身类查询」,不是均匀分布:2026-07-30 免 key 实测 14 个关键词 654 条,合计 17/654(2.6%)缺案号,其中 q=离婚 9/50(18.0%)、利息 8.1%、工伤 6.0%、抚养 4.1%,而民间借贷/劳动争议/交通事故/买卖合同/继承/房屋买卖等 10 词均为 0% —— 按 2.6% 这个全站均值理解,会严重低估婚姻家庭检索里遇到它的概率。这类条目也退不回「案名 + 法院 + 裁判日期」核对:同批 17 条样本里,法院字段无一条是真法院名(0/17,写的是裁判文书网的不上网/不公开事由)、裁判日期仅 3/17 有值、原文直链 0/17,即 14/17 除案名外没有任何可核锚点。结果列表对这类条目会逐条标出「无案号」,不让它静默混在可回核的结果里。⚠️ 「按案号检索即可」这句,我们从来没验过它走不走得通,而且用 HTTP 验不出来:2026-08-22 现网实打该站的案号检索页(URL 上用 `s21=` 挂案号)共 6 组 —— 其中两个真案号直接取自本站检索结果、一个编造案号、一串垃圾、三个雪人字符,以及一个空案号,6 组全部返 200 / 14,179 字节 / `text/html`,响应体 md5 逐字节相同(`504af898bd320c6549ab0b06a44337b3`)。落点是 JS 单页应用,案号要到浏览器里才发给后端(页面外壳去掉脚本后可见文字仅 151 字,只有「登录/注册/搜索」这类导航词,一行结果都没有) ⇒ 状态码零信息量,你写脚本批量核一批案号只会拿到「条条 200」。而且连该站自己出结果的那个接口也是 200 裹着拒绝:同日 `POST wenshu.court.gov.cn/website/parse/rest.q4w`、不带登录凭证的程序化调用当场被拒,返回的仍是 HTTP 200(158 字节 `application/json`):`{"code":9,"success":false,"description":"没有权限请求接口"}`。两条加起来:朴素的 `res.ok` / 看状态码这两种自动核验,在这条路径上一定是假绿。但请别把这段读成「按案号回核走不通」 —— 恰恰相反,该站本身是通的(同日首页 200 / 22,309 字节),我们没有任何证据说人工在浏览器里按案号检索会失败,也没有在浏览器里人工试过。本段只钉住两件事:这条路径我们没验证过、而且它没法用状态码自动验证。要确认某一条,请人工打开该站检索(未登录时页面上就摆着「登录/注册」),别拿脚本的 200 当作核对通过。把「未验证」读成「已证伪」是另一种假话。
2020 年河南省哪些案由的文书量最大?
这一切片给不出案由排名。2020 年河南省共 1,531,707 篇,而上游给得出案由取值的只有 4 篇(占 0.0003%),其余 1,531,703 篇没有进入任何案由桶。未被覆盖的部分不是「排在后面的长尾案由」,而是这批文书在上游没有案由取值:2026-08-01 免 key 逐条抽样,河南省 2020 年 50/50 条该字段为空,浙江省 2023 年 0/50 为空 —— 缺失是入库批次属性,不是均匀分布,也不是检索方式的问题;把切片缩小重新聚合变不出这些文书的案由。本页下方仍按原样列出那几项,但它们只代表那一小撮文书,不能读成本切片的高频案由;本轮实测 2022 年及以后的同批切片覆盖率在 67%–94% 之间,要看有案由取值的分布可改用那些年份。
河南省的裁判文书有什么地域特征?
河南省人口与农村经济基数大,裁判文书以民间借贷、买卖合同与机动车交通事故责任纠纷为主,基层民事案件量庞大。
2020 年河南省的检索结果可以直接作为法律意见吗?
不可以。文书查仅提供基于公开裁判文书的检索与统计素材,不预测裁判结果、不生成法律意见,具体案件请以律师与法院的专业判断为准。