12306自动刷票下单-查票下单

作者：波Z- | 来源：互联网 | 2023-05-18 00:45

前言上篇写了12306登录，隔了快一个月了，才准备动手写下单篇，真的要非常感谢博客园的Asimple朋友，如果不是看到你的留言，我几乎都忘了要写下篇了，这一点在简书上就不好，都没人看(ㄒ

前言

上篇写了12306登录，隔了快一个月了，才准备动手写下单篇，真的要非常感谢博客园的 Asimple朋友，如果不是看到你的留言，我几乎都忘了要写下篇了，这一点在简书上就不好，都没人看/(ㄒoㄒ)/~~，刚开始写博客，真的需要大家的鼓励，看的人多了自然有动力写更多的，所以这一篇要给那些看过我上篇的同学们，尤其是这位Asimple同学，就是为你而写，没错就是这个原因。因为你让我知道了有人在看，而且用心的在看。发了这么多感慨，其实我不是这么爱感慨的人(✿◡‿◡)，直入主题吧。

还得说一下这次我用的是Firefox浏览器，在上篇中说了Chrome浏览器的一个问题，在抓取的请求过多的情况下，前面的请求就可能看不到请求信息，最后搞得我不得不搞了个虚拟机，装了xp，用Fiddler去查看请求信息，后来就换了Firefox，最新版的Firefox没有Firebug可用，但是自带的开发者工具足够用了。当然Chrome我也没卸载，因为Chrome上有个很赞的功能，在元素界面查找元素的时候可以用css和xpath，可不是右键copy里面的css和xpath哦

在这个查找框里你就可以写自己的css和xpath，看实时效果，这个真是太棒了，不用装额外的插件。Firefox上暂时还没有发现这个功能，也不知道有没有类似的插件，如果有人知道的话，麻烦回复一下，先谢过了。鼠标左键还坏了，只能把右键设置一下暂时用着，一波三折呀！这次真的要进入主题了。

卧了一个槽，忽略我上面说的吧，要写博客了，有一个请求Firefox竟然不给显示了，还是虚拟机吧

后记

后记为什么要加载前言后面，而不是在文章最后，我怕你不看。在这次分析中我基本没有添加什么代码，因为基本上每一个请求就是定义一个字典、一个url，然后发送请求，获取数据，然后继续下一个。另一方面就是我并没有做代码优化和整理。我们都应该知道对于没有反爬措施的网站，基本上看两个小时的爬虫教程就能写的出来，对于有反爬的网站，最难得地方是分析阶段，而不是发送请求。最后一点就是做这个也是一时兴起，积累一下经验，最主要是开始写一写博客。同时给像我一样初学爬虫的朋友一个例子、一个思路。

查票

车票预订界面的url：https://kyfw.12306.cn/otn/leftTicket/init，选好票以后点击查询

多了一下两个请求，第一个请求我没用，没有任何影响，我们就不用去管它，直接看第二个请求
https://kyfw.12306.cn/otn/leftTicket/query?leftTicketDTO.train_date=2017-12-25&leftTicketDTO.from_station=BJP&leftTicketDTO.to_station=SHH&purpose_codes=ADULT

看一下参数和返回数据，太乱了，稍微仔细看一下，预订、有、G5，好像还是有些有用信息的，可以按|拆分一下看看

看到了车次G101，8、9是开车时间和到达时间，10是历时，商务座特等座9张余票，32行显示9，一等二等座都是有票，对应30、31，就不能具体确定了，暂时先不管，至少我们确定了这个请求是查询出我们需要的车票信息了，那么再看一下请求参数，第一个是时间很容易理解，第四个好像是票的类型，成人票，翻译一下单词就知道了，反正每次都一样，不用管了，中间两个出发站、目的地，不过这些字母是啥意思，应该是站名对应的编码，在这个请求之前肯定是有对应关系的，

https://kyfw.12306.cn/otn/resources/js/framework/station_name.js?station_version=1.9034
一个js的请求@bjb|北京北|VAP|beijingbei|bjb|0，拆分以后可以看到站名和编号

def query_ticket_info(date, info):
    js_info = json.loads(info)
    if js_info.get("status") != True:
        print("查询余票失败")
        return

    result = js_info.get("data").get("result")
    for i in result:
        lst = i.split('|')
        if lst[11] != "Y": #主要是判断是否开票了，见下图情况
            continue
        item = {
            "预定号":lst[0], #预定号
            "train_no":lst[2],
            "车次":lst[3], #车次
            "始发站":get_station_name_from_code(lst[4]), #始发站
            "终点站":get_station_name_from_code(lst[5]), #终点站
            "起始站":get_station_name_from_code(lst[6]), #起始站
            "目标站":get_station_name_from_code(lst[7]), #目标站
            "出发时间":"{} {}".format(date, lst[8]), #出发时间
            "到达时间":get_end_time(date, lst[8], lst[9], lst[10]), #到达时间
            "历时":lst[10], #历时
            "train_location":lst[15],
            "高级动卧":lst[21], #高级动卧
            "软卧":lst[23], #软卧
            "软座":lst[24], #软座
            "特等座":lst[25], #特等座
            "无座":lst[26], #无座
            "硬卧":lst[28], #硬卧
            "硬座":lst[29], #硬座
            "二等座":lst[30], #二等座
            "一等座":lst[31], #一等座
            "商务座":lst[32], #商务座
            "动卧":lst[33], #动卧
        }
        yield item

这个函数需要解释一下，主要是这些站点信息是怎么找到的，说一下思路
- 当我们打开车票预订界面的时候，是这样的，下面是空的

- 点击查询后

- 由此我们知道车票信息是通过js动态添加的（maybe），那么我们就查找动态创建出来的元素，随便在上面找一个元素特征，比如我找这个

当然你可以随便找一个，前提是不是动态创建的，然后在我们的js和document请求中去查找这个值，最后我找到了https://kyfw.12306.cn/otn/resources/merged/queryLeftTicket_end_UAM_js.js?scriptVersion=1.9053

我找这个是干什么呢？我们上面的请求得到了余票信息，是json格式的，那么肯定是通过js把它添加到界面上，我们要知道哪一个信息是添加到硬座上，哪一个是添加到硬卧上，就像我代码里写的那样，把所有的票种都找出来
- 通过分析js

然后把大部分我们需要的参数都对应出来，这样就看到像我上面写的函数那样，取出我们需要的信息
- 其实有一种更简单的方式，就是你查询了余票信息以后，会看到余票几张几张，然后去对应的信息参数中去找，比如

我们就知道了32对应的是商务座特等，多查询一些站点就会把所有对应索引都找出来

预订

点击预订后看一下请求，记住我上一遍说过的，一般是看xhr和document请求，
https://kyfw.12306.cn/otn/login/checkUser
看起来很简单，参数也只有一个_json_att，值为空
重头戏来了https://kyfw.12306.cn/otn/leftTicket/submitOrderRequest
看请求参数secretStr，其他的请求几次发现没啥变化，重点就在这个secretStr上了，太乱了，咦，我上面好像说过这三个字，对他们有关系。怎么去理解呢，这里是发了一个post请求，而这个secretStr是作为参数发送给服务器的，那么它必定是在我们本地产生的，在这个请求之前应该能找到。看一下特征：+wOQuwrBzvR6e…。是不是能发现查票那个请求里返回的数据第一个%2BwOQuwrBzvR6e，相似度很高啊，肯定是进行了编码或解码。Fiddler这点很好

点击查票请求的第一条数据，右键->Send to TextWizare…

哇哦，So Beautiful，这下就相等了，是使用了urldecode，这里支持很多种编码解码方式，非常方便，真相已经出来了，secretStr是我们上面输出的第0行字符串的urldecode解码值，python3中是parse.unquote。
train_date：订哪一天的票，back_train_date：今天的时间，还有出发站和目的地。

推荐阅读

ip
Python基础：使用NLTK和Python构建机器学习应用

本文节选自《NLTK基础教程——用NLTK和Python库构建机器学习应用》一书的第1章第1.2节，作者Nitin Hardeniya。本文将带领读者快速了解Python的基础知识，为后续的机器学习应用打下坚实的基础。 ... [详细]

蜡笔小新 2024-11-13 21:23:34
ip
Cookie学习小结

Cookie学习小结 ... [详细]

蜡笔小新 2024-11-14 16:26:25
ip
使用Python爬取妙笔阁小说信息并保存为TXT和CSV格式

本文介绍了如何使用Python爬取妙笔阁小说网仙侠系列中所有小说的信息，并将其保存为TXT和CSV格式。主要内容包括如何构造请求头以避免被网站封禁，以及如何利用XPath解析HTML并提取所需信息。 ... [详细]

蜡笔小新 2024-11-14 19:54:58
ip
2022年2月微信小程序 app.json 配置详解：启用调试模式

本文将详细介绍如何在微信小程序的 app.json 文件中启用调试模式（debug），并通过实际案例展示其配置方法和应用场景。 ... [详细]

蜡笔小新 2024-11-14 08:21:10
ip
为什么多数程序员难以成为架构师？

探讨80%的程序员为何难以晋升为架构师，涉及技术深度、经验积累和综合能力等方面。本文将详细解析Tomcat的配置和服务组件，帮助读者理解其内部机制。 ... [详细]

蜡笔小新 2024-11-14 03:39:46
io
ASP.NET 中操作 Excel 的常见方法和属性

本文介绍了如何在 ASP.NET 中设置 Excel 单元格格式为文本，获取多个单元格区域并作为表头，以及进行单元格合并、赋值、格式设置等操作。 ... [详细]

蜡笔小新 2024-11-13 19:46:18
ip
CentOS 7 中配置开机自动挂载 NFS 的解决方案

本文详细介绍了在 CentOS 7 系统中配置 fstab 文件以实现开机自动挂载 NFS 共享目录的方法，并解决了常见的配置失败问题。 ... [详细]

蜡笔小新 2024-11-13 12:05:24
input
Python 数据类型入门指南

本文介绍了 Python 中的基本数据类型，包括不可变数据类型（数字、字符串、元组）和可变数据类型（列表、字典、集合），并详细解释了每种数据类型的使用方法和常见操作。 ... [详细]

蜡笔小新 2024-11-15 09:59:00
ip
获取父类参数类型工具类

packagecom.panchan.tsmese.utils;importjava.lang.reflect.ParameterizedType;importjava.lang. ... [详细]

蜡笔小新 2024-11-15 09:33:44
ip
Java 网站开发指南

本文详细介绍了 Java 网站开发的相关资源和步骤，包括常用网站、开发环境和框架选择。 ... [详细]

蜡笔小新 2024-11-14 22:39:58
ip
Go Echo 框架入门指南【1】

本文介绍了 Go 语言中的高性能、可扩展、轻量级 Web 框架 Echo。Echo 框架简单易用，仅需几行代码即可启动一个高性能 HTTP 服务。 ... [详细]

蜡笔小新 2024-11-14 18:30:58
char
Docker 环境下 MySQL 双主同步配置指南

本文介绍了如何在 Docker 环境中配置 MySQL 的双主同步，包括目录结构的创建、配置文件的编写、容器的创建与设置以及最终的验证步骤。 ... [详细]

蜡笔小新 2024-11-14 17:21:23
ip
Linux常用命令解析：ipcs与ipcrm

本文详细介绍了Linux系统中用于管理IPC（Inter-Process Communication）资源的两个重要命令：ipcs和ipcrm。通过这些命令，用户可以查看和删除系统中的消息队列、共享内存和信号量。 ... [详细]

蜡笔小新 2024-11-14 11:42:14
ip
Spring Boot 中配置全局文件上传路径并实现文件上传功能

本文介绍如何在 Spring Boot 项目中配置全局文件上传路径，并通过读取配置项实现文件上传功能。通过这种方式，可以更好地管理和维护文件路径。 ... [详细]

蜡笔小新 2024-11-13 11:19:38
case
在范围[0..n-1]中产生m个不同的随机数 - Generating m distinct random numbers in the range [0..n-1]

Ihavetwomethodsofgeneratingmdistinctrandomnumbersintherange[0..n-1]我有两种方法在范围[0.n-1]中生 ... [详细]

蜡笔小新 2024-11-13 09:49:14

波Z-

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章