Token导航 LogoToken导航TokenDH.com
开发需要联网clawhub未标认证来源可访问clear审计提醒

zhuochazhuocha 分析

Agent Skill

zhuocha 用于整理文档、README、Markdown 和说明材料,适合在 OpenClaw 中需要把零散信息整理成结构清晰的文档时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

4,153

周安装

168

GitHub Stars

公开资料未说明

下载量

1,304
OpenClaw

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

2

许可证

MIT-0

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:zhuocha(zhuocha 分析)
来源仓库:https://github.com/cybluesky/zhuocha
安装命令:
openclaw skills install zhuocha
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。该命令会通过 OpenClaw 从第三方来源获取 Skill;本站只展示命令,不托管安装包,也不自动执行。

ClawHubOpenClaw
openclaw skills install zhuocha

简介

zhuocha 用于核实招投标项目重复性,分析多条记录是否为真正重复。

  • 适合在 OpenClaw 中需要让 Agent 处理重复项目数据清洗时使用。
  • 通过 clawhub 安装,结合来源仓库和 README 可核验具体用法。
  • 安装前需确认权限范围、维护状态,以及是否会触发数据库访问或内部端口调用。
  • 涉及敏感数据时需确保符合企业信息安全规范。

SKILL.md

name
zhuocha
description
招投标重复项目核实助手。当需要分析同一 reid 下的多条 jy_id 是否为真正重复时激活。数据源:dify_ns_re_readsource(reid分组) + dwd_bid_it_all(明细字段,5200端口) + ods_bid_content(原始正文,5100端口)。典型触发语:「找茬大师」「分析这组重复」「判断是否是重复项目」「去重分析」。

找茬大师(zhuocha)

招投标重复项目核实:根据 reid 聚类的多条 jy_id,核实是否真的重复,排除同一项目的二次公告/多批次发布/不同标段等情况。

数据库查询

数据表分工

  • dify_ns_re_readsource(6100端口):只存 reid 分组和 jy_id,不包含明细字段
  • dwd_bid_it_all5200端口):真正的明细数据表,包含字段
  • ods_bid_content(5100端口):原始正文 detail + att_ext
  • result.dify_ns_re_result(6100端口):结果写入表
用途URL说明
查 reid 分组和 jy_id6100端口SELECT reid, jy_id FROM public.dify_ns_re_readsource WHERE reid = 'xxx'
查明细字段(必须用这个5200端口SELECT customer_standard_new, title, proj_name, type, area, city FROM zy_dwd_bid.public.dwd_bid_it_all WHERE jy_id = 'xxx'
查原始正文5100端口SELECT left(detail, N), att_ext FROM public.ods_bid_content WHERE jy_id = 'xxx'
写入结果6100端口POST JSON 格式(见下方)

⚠️ 重要:明细字段必须查 dwd_bid_it_all(5200端口),不要查 dify_ns_re_readsource(6100端口),后者只有 reid 和 jy_id 无实际业务字段。

核心判断流程

核心原则:proj_name 只起辅助参考作用,最终判断必须以 detail 正文中项目编号 + 客户名 + 采购内容为准。

⚠️ SQL 写法注意:detail 字段查询时,不要在 SQL 中使用 LEFT() 等函数截取,直接 SELECT detail 取完整字段,然后在 Python 中用字符串截取 [:150] 代替。这样比 SQL 函数截取更可靠,避免某些端口/驱动兼容性问题。

同一 reid 下的多条 jy_id
    ↓
Step 1: 查 dify_ns_re_readsource,获取该 reid 下所有 jy_id
    SQL: SELECT reid, jy_id FROM public.dify_ns_re_readsource WHERE reid = 'xxx'
    ↓
Step 2: 查 dwd_bid_it_all 明细字段(5200端口),确认字段对比
    SQL: SELECT customer_standard_new, title, proj_name, type, area, city
         FROM zy_dwd_bid.public.dwd_bid_it_all WHERE jy_id = 'jy_id'
    ↓
    ┌─ proj_name 有效 + 只有一个 → 进入 Step 3
    ├─ proj_name 有效 + 多个不同 proj_name → 进入 Step 3(需 detail 确认)
    └─ proj_name 为"无效"或空
         ├─ detail 中项目编号/客户名完全不同 → ❌ 非重复(错误归组)
         └─ detail 中项目编号/客户名相同 → 进入 Step 3
    ↓
Step 3: 查 ods_bid_content.detail + att_ext(5100端口)
    SQL: SELECT detail, att_ext FROM public.ods_bid_content WHERE jy_id = 'xxx'
    · att_ext 附件标题对比(有无"二次"等差异)
    · detail 正文关键字段:项目编号、金额、供应商、时间
    ↓
项目编号相同 + 正文实质相同 → ✅ 重复
项目编号不同 / 金额不同 / 时间明显不同 → ❌ 非重复(不同标段/不同批次)

写入结果表(重要)

⚠️ 必须用 Python urllib 写入,禁止用 bash curl 循环

bash 循环写入时,中文逗号(,)会导致 cut -d',' 切割字段错位,使 re_result 字段变成 NULL。必须始终用 Python:

import urllib.request, json
url = "http://192.168.88.51:6100/insert"
headers = {"Content-Type": "application/json"}
payload = json.dumps({
    "sql": "INSERT INTO result.dify_ns_re_result (reid, reason, rr, rd, re_result) VALUES (:reid, :reason, :rr, :rd, :re_result)",
    "params": {"reid": "...", "reason": "...", "rr": "...", "rd": "...", "re_result": "是"}
})
req = urllib.request.Request(url, data=payload.encode(), headers=headers)
with urllib.request.urlopen(req, timeout=15) as resp:
    print(json.loads(resp.read()))

⚠️ API 不支持 DELETE/UPDATE:如果同一条 reid 重复写入(re_result 为 NULL 的错误数据),只能通过 TRUNCATE TABLE result.dify_ns_re_result; 清空全表后重新写入全部记录。

断点续跑保护:每次重新写入前,先查询 result.dify_ns_re_result 中已有 reid,从原始数据中排除,确保已分析过的数据不会丢失。

result.dify_ns_re_result(schema: result

接口POST http://192.168.88.51:6100/insert

{
  "sql": "INSERT INTO result.dify_ns_re_result (reid, reason, rr, rd, re_result) VALUES (:reid, :reason, :rr, :rd, :re_result)",
  "params": {
    "reid": "xxxxxx",
    "reason": "判断理由",
    "rr": "保留的jy_id",
    "rd": "删除的jy_id(多值用英文逗号分隔)",
    "re_result": "是"
  }
}

字段说明

字段含义
re_result = "是"重复:rr 保留,rd 内所有 jy_id 删除
re_result = "否"非重复:该 reid 下所有 jy_id 均保留,rr/rd 任意填两条即可

⚠️ RD 字段必须完整:多 jy_id 组(如 40 条)的 re_result="是"时,rd 要填入所有待删除的 jy_id(除 rr 外),用英文逗号分隔。

⚠️ 必须用 Python 写入:bash 循环写入时,中文逗号会导致字段错位使 re_result 变成 NULL。始终用 Python urllib + json 写入。

常见判断模式

✅ 判定重复

  • 标题仅标注差异(二次/重发/第二次/第X批/合同公示),proj_name 和正文实质相同
  • att_ext 一个有完整附件一个无,正文实质相同
  • 不同批次发布同一采购意向(如第1批、第2批、第3批均有同一项目)
  • 多条同一采购意向的重复收录
  • detail 正文项目编号相同 + 采购内容相同 + 时间一致
  • 第一次询比采购失败后第二次询比(正文明确提到"第一次失败"/"供应商不足3家"),实质相同
  • 同项目不同次变更公告(如第一次变更、第二次变更),实质相同

❌ 判定非重复

  • detail 正文项目编号不同(不同标段/不同项目)
  • detail 正文金额/供应商/项目编号不同(不同采购记录)
  • 验收单编号/采购记录编号不同(不同采购记录)
  • att_ext 附件内容实质不同(如一个是采购公告,一个是中标结果)
  • proj_name 为"无效"且 dwd_bid_it_all 中项目编号/客户名完全不同 → 错误归组产生同一个 reid,非重复
  • proj_name 解析失败时,即使 proj_name 相同也不能直接判定为重复,必须查 detail
  • 同一项目不同包(A包 vs B包 vs C包)的中标/变更公告,虽同招标编号但属不同标段,非重复

⚠️ 二次招标陷阱

标题出现"二次"时,极易误判为重复(实为同一项目的二次公告)。必须同时查 detail 正文中:

  1. 项目编号——两次公告编号是否完全一致
  2. 获取文件时间——时间不同则是二次公告(非重复)
  3. att_ext 附件标题——是否明确标注"二次采购公告"

判断逻辑

  • 项目编号相同 + 获取文件时间不同 = 二次公告 → 非重复
  • 项目编号相同 + 正文实质无差异 = 同一来源重复抓取 → 重复

实操案例(reid=3c50e926):两记录 att_ext 一个写"采购公告",一个写"二次采购公告",项目编号一致,获取文件时间相差7天 → 判定为"否"(二次公告,非重复)

多 jy_id 组处理

当同一 reid 含有 >2 条 jy_id 时,必须逐一查 detail 确认:

  1. proj_name 都有效且只有一个 → 大概率重复,查 detail 确认项目编号/金额/时间是否一致
  2. proj_name 为"无效"或空 → 切勿凭 proj_name 判断,必须全部查 detail 确认项目编号是否相同
  3. 若为重复:rr = 任意一条,rd = 其余所有 jy_id(英文逗号分隔)
  4. 若为非重复:所有 jy_id 均保留,rr/rd 任意

⚠️ 重要:proj_name 为"无效"的多 jy_id 组(如 34 条、31 条),极大概率是错误归组,实际混着完全不同项目,dwd_bid_it_all 中项目编号/客户名会有明显差异。dif y_ns_re_readsource 中表现为"proj_name 种类 = 1"(因为全是同一个无效值),容易误判为重复,必须逐条查 dwd_bid_it_all + detail

断点续跑

每次分析前,先查 result.dify_ns_re_result 中已存在的 reid,从 dify_ns_re_readsource 中排除:

done = set(row['reid'] for row in result['data'])
# 新分析时加 WHERE reid NOT IN ('done_reids')

输出格式

每批分析完成后,给用户汇总:

本批 N 组结果:
  ✅ 重复(是):X 条
  ❌ 非重复(否):X 条

结果表最新状态:
  重复(是):XX 条
  非重复(否):XX 条
  总计:XX 条

确认无误后写入结果表,写入完成后汇报写入数量和表当前总量。

适合场景

01

OpenClaw 用户查找和安装 Skill 时

02

用户想查找某类 Agent Skill 时

03

需要根据任务场景推荐可安装能力包时

04

需要对比不同来源的安装命令和来源信息时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

OpenClaw

90.53%
按下载量换算1,181

安全审计

VirusTotal

可疑

ClawScan

可疑

Static analysis

通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。当前只有一个来源,正式发布前建议补源仓库或其他目录站核验。

来源信息

继续浏览同类 Skills