PyWenCai实战:5分钟用Python自动化获取问财金融数据

发布时间:2026/8/24 15:56:36
PyWenCai实战:5分钟用Python自动化获取问财金融数据 PyWenCai实战5分钟用Python自动化获取问财金融数据【免费下载链接】pywencai获取同花顺问财数据项目地址: https://gitcode.com/gh_mirrors/py/pywencai如果你每天要打开问财网页把股票数据复制进 Excel再换个条件重新查一遍这类重复劳动就该交给脚本。PyWenCai 把问财查询变成 Python 里的一次函数调用实现自动化获取问财金融数据。下面从安装、查询语言讲到两个可直接改用的案例。五分钟跑通第一次查询两个前置条件安装 Python 包pip install pywencai。问财接口策略变化较频繁遇到问题先升级包再排查。安装 Node.js v16 及以上版本。程序需要用 Node 执行内置 JS 文件生成请求 token缺了会直接报错。最小可运行示例import pywencai res pywencai.get(query市盈率小于30, cookie这里粘贴你的cookie) print(res)它会输出一个 pandas DataFrame每行一只股票包含代码、简称和各项指标。想一次拿完所有分页加一个loopTrue即可。如何获取问财Cookiecookie 是必填参数。方法浏览器打开问财网页并登录按 F12 进入开发者工具切到 Network 面板刷新页面任选一条 iwencai.com 请求复制请求头里Cookie字段的完整值。Cookie 一段时间后会失效接口报错时回到浏览器重新复制一份即可。搞懂查询语言这个工具的核心是问财的自然语言查询语句query参数里直接写条件和你打在问财搜索框里的内容一样。常用写法查询语句对应含义市盈率30市盈率低于 30市净率2市净率低于 2净资产收益率15%ROE 高于 15%资产负债率60%资产负债率低于 60%连续3年营收增长营收连续三年增长昨日涨停最近一个交易日涨停总市值小于100亿总市值低于 100 亿条件之间可以用且or组合语法和网页搜索框一致。一个完整查询df pywencai.get( query市盈率30 且 市净率2 且 净资产收益率15%, cookie你的cookie )返回的df可以直接用 pandas 做过滤、排序、导出。实战案例案例一批量拉取财务指标做选股筛选场景目标按一组财务条件一次筛出候选股池并按市值排序。import pywencai pool pywencai.get( query市盈率30 且 市净率2.5 且 净资产收益率15% 且 资产负债率60%, sort_key总市值, # 按返回结果的列名排序 sort_orderdesc, # 降序 loopTrue, # 循环分页合并全部数据 cookie你的cookie ) print(pool.head()) print(f共 {len(pool)} 只股票)输出怎么解读pool已按总市值从高到低排列head()看到的是市值最大的几只len(pool)是满足条件的股票总数。接着pool.to_excel(pool.xlsx)就能继续做人工分析。变体想确认某几只股票在不在池子里传find[600519, 000010]对应标的会被排到最前面注意该参数下结果只返回前 100 条。案例二定期监控风险股场景目标每天跑一次脚本输出一份高风险股票名单异常当天就能发现。import pywencai risk pywencai.get( query连续三年净利润为负 or 资产负债率90%, sort_key资产负债率, sort_orderdesc, sleep2, # 分页请求间隔 2 秒 logTrue, # 打印日志方便排查 cookie你的cookie ) print(risk)输出怎么解读资产负债率最高的排在最前重点看前几行如果risk是None说明请求失败对照日志定位是哪一步出的问题。变体把这段代码放进定时任务每天早上执行或把 query 换成退市风险提示换成另一个监控维度。常见坑与排查报错提到找不到 node缺 Node.js v16。程序靠 Node 执行 hexin-v.bundle.js 生成 token装好即可。查询结果为空的常见原因先用同样语句在浏览器问财里查一遍确认平台本身有结果再开logTrue看日志。最常见是语句问财解析不了或条件过严无匹配。请求被限流、频繁失败cookie 过期了回浏览器重新复制仍失败就升级 pywencai 到最新版。结果总是停在 100 条问财限制每页最多 100 条传loopTrue自动翻页合并。调用被屏蔽高频调用会被问财屏蔽加sleep控制间隔保持低频。原理内幕选读整个获取分两步。第一步把你的查询语句 POST 到问财的机器人接口返回一个包含查询条件和数据接口地址的页面描述第二步以该地址的参数为模板逐页请求数据接口把结果拼成 DataFrame。每个请求头都带三样东西随机生成的 User-Agent、你的 cookie以及 Node 执行内置 JS 得到的hexin-vtoken。失败时由while_do重试循环兜底最多试retry次默认 10每次间隔sleep秒仍失败则返回None。想深入可以看请求构造模块、响应解析模块 和请求头生成。使用边界pywencai 是社区开源项目非同花顺官方工具MIT 协议商用需自行评估法律风险。原理与登录网页取数一致数据归属问财平台使用应遵守平台用户协议。建议低频使用高频调用会被屏蔽也请自行评估合规风险。获取的数据用于量化研究和学习重要决策前请与交易所官方数据交叉核对。到这里安装、cookie、查询语句和两个案例模板就齐了。下一步查更多参数看 README 里的get()参数表遇到新报错先读上面三个源码模块再考虑升级包。作者还维护一个数据与交易社区接口策略有变动时会在里面同步。【免费下载链接】pywencai获取同花顺问财数据项目地址: https://gitcode.com/gh_mirrors/py/pywencai创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考