light-venue-matching
投稿定位与期刊/会议匹配。当用户问投哪个期刊/会议、要评估录用可能性/录用概率、做投稿规划时使用。根据论文质量、方向、创新程度、实验完整性、语言水平、作者背景和预算,推荐中文/英文期刊、SCI/SSCI/EI/CCF/核心、国际/国内会议。分析投稿难度、方向匹配度、审稿周期、版面费、以可核查信号做录用可能性定性分级(高/中/低,不编百分比)、是否适合本科生/弱导师资源、预警风险,给出冲刺/稳妥/保底分层选择。
git clone --depth 1 https://github.com/Light0305/Light-skills /tmp/light-venue-matching && cp -r /tmp/light-venue-matching/skills/light-venue-matching ~/.claude/skills/light-venue-matchingSKILL.md
# 投稿定位与 venue 匹配
## 评估输入(先盘点实力)
论文质量(创新/实验完整性/理论深度)、研究方向、语言水平、作者背景(本科/硕博、是否有强导师)、时间需求(deadline/毕业要求)、预算(能否付 APC)、目标(毕业/评奖/找工作/纯发表)。
## 匹配流程
1. 用 db01 期刊会议库按方向(subject_area)筛候选;不足时按方向程序化扩候选:OpenAlex Sources `GET https://api.openalex.org/sources?filter=topics.id:<方向>,is_oa:<bool>&sort=cited_by_count:desc&per_page=50&mailto=<email>`(游标 `cursor=*` 翻页,可按 `summary_stats.2yr_mean_citedness`/`apc_usd`/`is_in_doaj` 过滤);计算机方向直接对 CCF 目录按"领域+目标档(A/B/C)"取候选。**db01 是薄缓存**(事实字段为快照+`last_checked_date`+`oa_id=`/`issn=`锚点,见 db01 references.md §1):先按用户方向用 `domain_scope=` 子串过滤——非 CS 用户隐藏 `中国CS`(CCF) 档、投国际刊用户隐藏 `中国语境`(中科院分区) 档,避免偏科误导;subject_area 按 references.md §3 受控大方向归一后再筛。
- **db01 为空/无目标方向行时的冷启动(别卡在第一步)**:不依赖 db01 也能跑——① 用上面 OpenAlex Sources API 按方向现拉候选刊(拿 `display_name`/`issn`/`apc_usd`/`2yr_mean_citedness`/`is_in_doaj`);② 每个候选现建一张**临时卡**填以下最小种子字段,跑完本流程后可回写 db01 沉淀:
```
venue_name, venue_type(journal/conference), issn 或 oa_id, subject_area(按 §3 归一),
ccf_rank 或 jcr_quartile(查到才填,否则待核查), apc_fee(币种+来源), review_cycle(周,来源),
is_oa, is_in_doaj, domain_scope(中国CS/中国语境/通用), last_checked_date, source_url
```
缺的字段标"待核查"不臆造;CS 方向无 db01 时直接查 CCF 目录官网。临时卡口径与 db01 venues.csv 一致,便于回填。
2. 按论文实力对齐 venue 级别——不只推"高大上"。给学生用"档位"(CCF A/B/C、中科院分区、北大核心/CSSCI)而非裸 IF。
3. 对每个候选填**统一对比字段**(抓取来源见括号):
- 影响指标:IF + JCR 分区(JCR/LetPub)、CiteScore + 分位(Scopus)、SJR/Eigenfactor 声望(Scimago/IEEE)、中科院分区大类/小类(分区表/LetPub)。**db01 的 impact_factor 看 `if_kind=` 口径**:`jcr`=真 JCR 权威快照(仅少数行,带 LetPub journalid);`proxy`=OpenAlex 2yr 代理值,**禁当 JCR 真值引用**,真 JCR/分区须查 Clarivate/LetPub 付费源;`na`=会议无 IF。代理值与在线冲突时信在线(`venue_signal.py` 已附在线 2yr 供交叉验证)。
- 档位:CCF A/B/C、北大核心/CSSCI/CSCD 命中情况。
- 周期:首次决定时长 + 投稿到发表周数(JournalFinder/IEEE Recommender/LetPub)。
- 费用与 OA:APC、是否 OA、是否 DOAJ 收录(DOAJ API `GET /api/v3/search/journals/issn:<ISSN>`)。
- 录用可能性与背景:**官方公开接收率**(仅在该刊/会官网或正式报告披露时填具体数字并附链接,否则填"待核查—无官方公开数据")、国人发文占比(LetPub,标注为社区经验估计)、自引率、是否适合作者背景、模板与引用格式(reference_style)。**不抓取、不填写 LetPub 的"录用比例"作为概率数字**(其自承为社区投稿经验估计,非官方统计),只用下方 rubric 做定性分级。
- 收录核查:是否被 WoS 收录及索引(SCIE/SSCI/AHCI/ESCI,查 Master Journal List)、是否被 Scopus 收录。
**三套分区(JCR/SJR/中科院)口径不同,每项必须标来源+年份,不可混用。**
4. **预警筛查(白名单+黑名单双向)**:
- 白名单正面信号:被 DOAJ 收录(尤其有 DOAJ Seal)、被 WoS/Scopus 正规索引。
- 黑名单/掠夺特征:命中《中科院国际期刊预警名单》(高/中风险),或异常自引、超快审稿、年发文激增、国人发文占比畸高、高额 APC、虚假指标。命中即标红劝退(联动 a10)。
## 分层推荐(必给三档)
- **冲刺**:够一够可能中,回报高。
- **稳妥**:实力匹配,大概率中。
- **保底**:确保能发/能毕业。
每档给 1–3 个,附理由、**录用可能性定性分级(高/中/低,见下方 rubric,不编百分比)**、周期、费用、风险。
## 录用可能性评估 rubric(定性分级,禁编概率数字)
**铁律**:除非该刊/会官网或正式报告公开了接收率(acceptance rate)且能附链接,否则**绝不给出精确录用概率/百分比**。LetPub 等聚合站的"录用比例"是社区投稿经验估计、非官方统计,**不得当作概率数字引用**。最终只输出"高/中/低 + 逐条理由"的定性分级。
### 五个可核查信号(逐项打分,每项 高/中/低,并标来源)
1. **作者相对实力**:作者近 5 年 h-index / 代表作被引(OpenAlex Authors `GET https://api.openalex.org/authors?search=<姓名>&mailto=<email>`,取 `summary_stats.h_index`)对比该 venue 的 `summary_stats.h_index`(db01 已存或 OpenAlex Sources 查)。作者影响力接近/超过该刊典型作者→高;明显低于→低。注:h-index 同名需用机构/ORCID 排歧,标"待核查"不强行认定。
2. **方向匹配度**:论文主题与该 venue 的 `subject_area`(db01) 及近年 `representative_papers`(db01 字段) 的主题重合度。核心主题命中→高;擦边/跨界→中;明显偏离该刊 scope→低。
3. **方法/数据规模匹配**:论文用的方法、数据集规模、实验体量是否达到该 venue representative_papers 体现的门槛(如顶会常要大规模实验+SOTA 对比;领域刊看是否有该刊偏好的方法范式)。达标→高;部分达标→中;明显不足→低。
4. **官方接收率档位**:仅当有官方公开接收率时按数值定档(如 <15% 记为竞争极高、15–30% 高、>30% 中);**无官方数据则该项填"待核查—无官方接收率",不参与编数**,并在结论里说明该项缺失。
5. **创新性自评**:让作者/评估者按"增量改进 / 显著改进 / 新问题或新范式"三档自评,对照该 venue 档位(顶会/顶刊偏好后两档)。这是主观项,须显式标注"作者自评,非客观指标"。
### 汇总规则
- 五项多数为"高"且无致命短板(方向/方法不达标算致命)→ 总评 **高(稳妥/保底候选)**。
- 信号互有高低、存在 1 项致命短板 → 总评 **中(冲刺候选,说明短板)**。
- 方向或方法明显不达标,或作者实力远低于该刊 → 总评 **低(不建议或仅作保底外的备选)**。
- 输出格式示例见下"产出"第 1 项;每条分级后必须跟"因为…(引哪个信号+来源)",不得只给结论。
## 工具/数据视角(各司其职,别混口径)
- **程序化拉候选/元数据**:OpenAlex Sources(免费 REST,`api.openalex.org/sources`,按 ISSN/topic/OA/APC/h-index 过滤,cursor 翻页,加 `mailto` 进礼貌池)。
- **影响指标**:JCR(JIF,2 年窗,现 1 位小数,2024 起 SCIE+SSCI+ESCI 统一排名,需订阅) | Scopus CiteScore(4 年窗、分母含会议/综述,免费) | Scimago SJR(类 PageRank 声望加权,Scopus 数据,门户可下 Excel) | Eigenfactor/Article Influence(IEEE Recommender 内置)。
- **收录核查**:WoS Master Journal List(免费查是否收录 + SCIE/SSCI/AHCI/ESCI) | Scopus Source List | **EI 核查**:权威源 = Engineering Village 官方 **Compendex Source List**(从产品页 "View source list" 现取当期 Excel,按刊名/ISSN 查;严禁引过期第三方"EI 源刊"站),详见 references.md「EI 核查路径」。
- **国内会议正规性**:CCF 目录(计算机)定档 + 一级学会官网核主办方 + 出版检索去向复核;假会议三红线(交钱包录/检索承诺无出处/主办方冒名),详见 references.md「国内会议信号源」。
- **国内档位**:CCF A/B/C 目录(计算机十大领域) | 中科院分区(大类/小类,1 区约前 5%,附预警名单) | 北大核心(中文核心,约 4 年一版) | CSSCI(南大核心,社科) | CSCD(理工)。
- **稿件-期刊匹配工具**(只发现候选,有出版商偏向):Elsevier JournalFinder、Springer Journal Suggester、IEEE Publication Recommender——输入题目/摘要,返回同社旗下刊 + 周期/接受率/APC/OA。
- **一站查中国友好画像**:LetPub(IF/JCR 分区/中科院分区/审稿周期/录用率/国人占比/APC/预警 一处看,但关键值回官方二次核实)。
- **OA 合规**:DOAJ(免费 API `doaj.org/api/v3/search/journals/{query}`,收录=正面信号,有 Seal 更佳)。
db01 是薄缓存:事实字段为快照,每条标 `last_checked_date`,投前用 `venue_signal.py` 实时复查,**冲突默认信在线**(例外:`if_kind=jcr` 的真 JCR 值 OpenAlex 查不到,本地快照即权威,不被代理值覆盖);`reference_style` → LaTeX cls/bst 映射与 subject_area 归一表见 db01 references.md。具体端点/参数/坑见本技能 references.md。
## 脚本:五信号对照查询(`scripts/venue_signal.py`)
评估一个候选 venue 时,先跑本脚本拿五信号对照 JSON,再据此填对比表的可核查信号列——比手查更快且口径统一:
```bash
# 期刊 + 作者:五信号全开(作者匹配度需 --author)
python scripts/venue_signal.py --issn 1234-5678 --author "Zhang San" --venues-csv <db01路径>/venues.csv
# 仅期刊:信号1/2/5(审稿周期/分区从 db01 卡取)
python scripts/venue_signal.py --issn 1234-5678 --card-fields review_cycle="约8周" apc_fee="1800 USD" cas_quartile="2区"
```
- 输出五信号:①发文量趋势(counts_by_year)②自引率粗查(**外向 outgoing**,本刊引本刊比例)③审稿周期(db01 卡)④作者与该刊主题重叠⑤APC 与分区(db01 卡+OpenAlex)+ 白名单 DOAJ。
- **每信号独立降级**:取数失败标 `status:"unavailable"`+reason,不编数;能查多少出多少。
- **最低可评估门槛**:`summary.signals_ok < 2` 时只给"数据不足,暂不下定性结论"(防数据稀疏退化成主观硬凑);补 --issn/--author 或换有 OpenAlex 覆盖的刊再评。
- **脚本信号 ≠ 完整评估**:`summary.rubric_coverage` 显式列脚本可程序化覆盖维度 vs 仍须人工维度(真实接收率/创新性与刊调性匹配/incoming 自引率/口碑)——跑完脚本不等于完成 venue 评估,别把信号当结论。
- **作者匹配度**按姓名取首个命中、未排歧,输出带 `disambiguation_caveat`,须 ORCID/机构二次确认,对应 rubric「作者相对实力」的 h-index 同名排歧纪律。
- 自引率是**外向(outgoing)自引粗估**(非官方入向 incoming 期刊自引率,两者口径不同):输出标 `self_ref_后端代码编写、逻辑强、安全性高、可读性好、版本控制、代码审查。当任务需要写实验代码、模型代码、数据处理代码、可视化代码、后端接口或系统逻辑时使用。要求逻辑清晰、安全、可读、可维护、便于复现/扩展/部署。支持 Git 版本管理、代码审查、注释规范、README、依赖管理、环境配置、运行说明与项目结构整理。
论文引用规划、审查与多格式生成。当用户需要处理参考文献、引用、bibtex 时使用。审查引用的关联度、真实性、权威性、时效性、数量、中外占比,是否引用了经典/最新/代表性/对比工作。避免虚假引用、过度引用、无关引用、堆砌、遗漏关键文献、低质量来源、引用与正文不匹配。生成 BibTeX/EndNote/GB-T 7714/APA/IEEE 等格式并按目标 venue 调整。
竞赛与项目申报材料辅助。当用户做统计建模、数学建模、互联网+、挑战杯、大创、创新创业、科研训练等项目时使用。辅助写申报书、项目计划书、商业计划书、路演 PPT、答辩稿、项目摘要、技术路线、创新点、可行性分析、市场分析、研究基础、预期成果、经费预算、团队分工。用于非论文投稿场景,可与论文/软著/专利/PPT 联动。
统一风格与一致性维护。在论文、PPT、图表、代码、项目文档之间保持术语一致、视觉风格一致、逻辑线索一致、创新点表述一致(常驻,所有任务后台生效)。避免同一项目在不同材料中出现说法不一致、指标名称不统一、图表风格混乱、创新点前后矛盾、方法名称变化、数据集名称不统一、论文与 PPT 逻辑不一致、软著与系统功能不一致。
数据处理、数据质量分析与数据集构建。当用户需要清洗数据、处理缺失/异常值、特征工程、数据增强、划分数据集、评估数据质量,或需自建数据集(采集、标注规范、格式、说明文档、隐私合规、发布)时使用。在提 idea 前优先判断现有数据是否足以支撑研究。
从顶会大牛角度进行专业绘图与组图。当用户需要把规划好的图实际画出来时使用。按情况用 Python(matplotlib/seaborn/plotly/altair)、R(ggplot2)、MATLAB、Visio、Origin、LaTeX/TikZ、Illustrator、PowerPoint 等。审美统一、专业清晰、配色合理、字体规范、线条清楚、高分辨率,适合直接投稿。不仅画图,还从论文表达角度判断怎么排、怎么组、怎么标注、怎么突出重点。
根据论文内容规划应该做哪些图、哪些表、插在哪里、各起什么作用。当用户需要论文图表规划时使用。图表不限于统计图,也包括数据集真实效果图、模型输出示例、案例展示、可解释性可视化等。规划框架图、技术路线图、数据集示意图、模型结构图、算法流程图、结果对比/消融/敏感性图、真实效果图、统计表/对比表等,以审稿人标准判断哪些必做、哪些冗余。
强大地读文件并学习——Word、PDF、PPTX、Excel、CSV、图片、视频、代码、压缩包等。当用户提供任何文件、问"这个文件讲了什么"、或任务需要理解已有材料时使用(常驻,自动触发)。不只提取文字,而是理解结构、逻辑、图表、数据、实验结果、格式要求、章节关系、视觉风格、隐含要求与可复用内容,并转化为可执行任务。