首页 > 其他分享 >下载公司年报及财报

下载公司年报及财报

时间:2024-11-24 18:44:37浏览次数:4  
标签:财报 code response sec date announcements 年报 page 下载

 

 

下载平安银行半年报

import requests
import pandas as pd
import os

# 请求头
headers = {
    "accept": "*/*",
    "accept-language": "zh-CN,zh;q=0.9,en;q=0.8",
    "content-type": "application/x-www-form-urlencoded; charset=UTF-8",
    "proxy-connection": "keep-alive",
    "x-requested-with": "XMLHttpRequest"
}

# 创建存储PDF文件的文件夹
os.makedirs('announcements', exist_ok=True)


# 获取公告数据的函数
def fetch_announcements(start_date, end_date, page_num=1, page_size=30):
    url = "http://www.cninfo.com.cn/new/hisAnnouncement/query"
    body = {
        "pageNum": page_num,
        "pageSize": page_size,
        "column": "szse",
        "tabName": "fulltext",
        "plate": "",
        "stock": "000001,gssz0000001",
        "searchkey": "",
        "secid": "",
        "category": "category_bndbg_szsh",
        "trade": "",
        "seDate": f"{start_date}~{end_date}",
        "sortName": "",
        "sortType": "",
        "isHLtitle": "true"
    }

    # 发送 POST 请求
    response = requests.post(url, headers=headers, data=body)

    if response.status_code == 200:
        data = response.json()
        print(data)
        if 'announcements' in data:
            announcements_list = []
            for announcement in data['announcements']:
                sec_code = announcement.get("secCode", "")
                sec_name = announcement.get("secName", "")
                title = announcement.get("announcementTitle", "")
                download_url = f"http://static.cninfo.com.cn/{announcement.get('adjunctUrl', '')}"
                announcements_list.append([sec_code, sec_name, title, download_url])
            print(f"Fetched {len(announcements_list)} announcements. hasMore is {data['hasMore']}")
            return announcements_list, data['hasMore']
        else:
            print("No announcements found.")
            return [], False
    else:
        print(f"Request failed with status code: {response.status_code}")
        return [], False


# 下载PDF文件的函数
def download_pdf(url, filename):
    response = requests.get(url)
    if response.status_code == 200:
        with open(filename, 'wb') as f:
            f.write(response.content)
        print(f"Downloaded: {filename}")
    else:
        print(f"Failed to download: {filename}, Status code: {response.status_code}")


# 主函数
def main():
    start_date = "2020-08-13"
    end_date = "2024-11-23"
    page_size = 30
    page_num = 1
    all_announcements = []

    while True:
        announcements, has_more = fetch_announcements(start_date, end_date, page_num=page_num, page_size=page_size)
        if announcements:
            all_announcements.extend(announcements)
            if not has_more:
                break
            page_num += 1
        else:
            break

    if all_announcements:
        # 使用 pandas 创建 DataFrame
        df = pd.DataFrame(all_announcements, columns=["公司代码", "公司名称", "年报标题", "下载地址"])

        # 将 DataFrame 保存到 Excel 文件中
        df.to_excel("announcements.xlsx", index=False)
        print("数据已保存到 announcements.xlsx 文件中")

        # 下载 PDF 文件
        for announcement in all_announcements:
            sec_code, sec_name, title, download_url = announcement
            title = title.replace("/", "_")
            filename = f"announcements/{sec_code}_{sec_name}_{title}.pdf"
            download_pdf(download_url, filename)


# 执行主函数
if __name__ == "__main__":
    main()

 

 

 

 

 

 

巨潮资讯网的参数说明:https://github.com/jiwooshim/cninfo_scraper?utm_source=chatgpt.com

获取年报方法:   https://mdnice.com/writing/889153e80d3a427490e52fb45763a25f

标签:财报,code,response,sec,date,announcements,年报,page,下载
From: https://www.cnblogs.com/hzijone/p/18566157

相关文章

  • 哔咔漫画PicACG官网版2024安卓下载-哔咔漫画
    哔咔漫画在数字化时代,移动应用(App)已成为人们日常生活不可或缺的一部分。哔咔漫画无论是娱乐、教育、购物还是办公,各类App都在不断改变我们的生活方式。哔咔漫画本文将详细介绍App软件制作的全过程,从概念设计到最终发布,帮助你了解如何开发一款成功的移动应用。哔咔漫画安卓苹果下......
  • e站官网版2024下载-e站(EhViewer)绿色板更新
    EhViewer漫画是一种通过图像和文字相结合的方式讲述故事的艺术形式。无论是专业的漫画家还是初学者,掌握漫画制作的基本步骤都是非常重要的。EhViewer本文将为你提供一份全面的漫画制作教程,EhViewer从构思到发布,每一步都将详细介绍,帮助你顺利创作出高质量的漫画作品。构思与策划......
  • git base 下载$ git clone 失败解决方法
    $gitclonehttps://github.com/hjsdjko/hangkongdingpiao.gitCloninginto'hangkongdingpiao'...fatal:unabletoaccess'https://github.com/hjsdjko/hangkongdingpiao.git/':SSLcertificateproblem:unabletogetlocalissuercertificate......
  • 【SPSS 27下载与安装教程】
    SPSS(StatisticalProductandServiceSolutions),即“统计产品与服务解决方案”,是社会科学研究领域内的翘楚。本教程提供了丰富的数据管理、描述统计、推断统计以及回归分析等功能介绍,界面友好,易学易用;1、安装包我用夸克网盘分享了「SPSS27.zip」,点击链接即可保存。打开「夸克AP......
  • Windows 下命令行下载文件的方法
    在Windows操作系统中,默认情况下并没有内置curl或wget命令行工具,但你仍然可以通过其他方法使用命令行下载文件。以下是一些可行的替代方案:1. 使用PowerShell下载文件Windows提供了PowerShell,它内置了一个非常强大的Invoke-WebRequest命令,可以用来下载文件。下面是如......
  • Z-library免费图书下载网站使用指南与最新地址分享(长期更新)
    Z-Library(也被称为Z-Lib)是一个大型的在线数字图书馆和文件共享网站,有各种各样的书籍和学术文章提供免费下载。它的藏书量极其庞大,涵盖了多种语言和学科领域。zlibrary电脑客户端/安卓appzlibrary(windows/mac/安卓/ipad)安装包下载:https://pan.quark.cn/s/45d1c03ef62b(随......
  • HTML学生个人网站作业设计:动漫网站设计——樱桃小丸子(6页) HTML+CSS+JavaScript 简单
    一、......
  • 自然色调人像自拍照后期Lr调色教程,手机滤镜PS+Lightroom预设下载!
    调色教程自然色调人像自拍照后期通过Lightroom调色,旨在打造出清新、自然、真实的人像效果。这种风格强调还原人物的本来面貌,同时增强照片的色彩和光影表现力,让自拍照更加生动和吸引人。预设信息调色风格:清晰透明风格预设适合类型:人像,街拍,自拍,旅拍,城市,风光等预设格式:XMP+D......
  • 暖色调人文纪实街拍摄影后期Lr调色教程,手机滤镜PS+Lightroom预设下载!
    调色教程暖色调人文纪实街拍摄影后期利用Lightroom进行调色,旨在为街拍作品赋予温暖、生动且富有故事感的氛围。这种调色风格强调捕捉街头生活中的人性瞬间,同时通过暖色调的运用增强照片的情感吸引力。预设信息调色风格:复古风格预设适合类型:人像,街拍,自拍,旅拍,城市,风光等预......
  • Cellebrite UFED 4PC 7.71 发布下载 - Android 和 iOS 移动设备取证软件
    CellebriteUFED4PC7.71(Windows)-Android和iOS移动设备取证软件TheIndustryStandardforLawfullyAccessingandCollectingDigitalData请访问原文链接:https://sysin.org/blog/cellebrite-ufed/查看最新版。原创作品,转载请保留出处。作者主页:sysin.orgCellebr......