当前位置: 首页 > news >正文

微信网站建设和维护报价表北京做网站的公司排名

微信网站建设和维护报价表,北京做网站的公司排名,国家承认的26种证书,广州建设网站怎么做工作任务:PDF文档中有资料来源这一行,比如: 资料来源:moomoo tech、The Information、Bloomberg、Reuters,浙商证券研究所 数据来源:CSDN、浙商证券研究所 数据来源:CSDN、arXiv、浙商证券研…

工作任务:PDF文档中有资料来源这一行,比如:

资料来源:moomoo tech、The Information、Bloomberg、Reuters,浙商证券研究所

数据来源:CSDN、浙商证券研究所

数据来源:CSDN、arXiv、浙商证券研究所

数据来源:秘塔AI搜索官网,Similarweb,Epic Connector,东吴证券研究所

来源:Github,《面向深度学习的多模态融合技术研究综述》,《Make-a-video: text-to-video generation without text-video data》,浙商证券研究所

来源:Github,OSCHINA,浙商证券研究所

希望提取文件中几百个PDF文档中的资料来源

在kimi中输入提示词:

你是一个Python编程专家,完成一个脚本编写任务,具体步骤如下:

打开文件夹:F:\研报下载\AIGC研报;

用pdfplumber 库读取文件夹中所有的PDF文件;

遍历PDF文档中的每行文本,查找以“资料来源:”开头、以“数据来源:”开头和以“来源:”开头的这一行文本内容;

保存这些文本内容到文件夹“F:\AI自媒体内容\AI行业数据分析”下的Excel文件中;

注意:

每一步都要输出信息

处理异常和错误:确保你的代码能够处理可能遇到的异常,如文件损坏、权限问题或格式不一致等。

Kimi生成的源代码:

import os

import re

import pdfplumber

from openpyxl import Workbook

# 定义要搜索的关键词

keywords = ["资料来源:", "数据来源:", "来源:"]

# 定义源文件夹和目标文件夹路径

source_folder = r'F:\研报下载\AIGC研报'

target_folder = r'F:\AI自媒体内容\AI行业数据分析'

# 确保目标文件夹存在

os.makedirs(target_folder, exist_ok=True)

# 创建Excel工作簿

workbook = Workbook()

sheet = workbook.active

# 遍历源文件夹中的所有文件

for filename in os.listdir(source_folder):

if filename.endswith('.pdf'):

print(f"正在处理文件:{filename}")

# 构建完整的文件路径

file_path = os.path.join(source_folder, filename)

try:

# 使用pdfplumber打开PDF文件

with pdfplumber.open(file_path) as pdf:

# 遍历PDF文档中的每页

for page in pdf.pages:

text = page.extract_text()

# 使用正则表达式搜索关键词

for keyword in keywords:

pattern = re.compile(re.escape(keyword) + ".*")

matches = pattern.findall(text)

for match in matches:

print(f"找到匹配的文本:{match}")

# 将找到的文本写入Excel

sheet.append([match])

except Exception as e:

print(f"处理文件{filename}时发生错误:{e}")

# 保存Excel文件

excel_file_path = os.path.join(target_folder, 'AI_Industry_Analysis.xlsx')

workbook.save(excel_file_path)

print(f"所有数据已保存到:{excel_file_path}")

http://www.yayakq.cn/news/520138/

相关文章:

  • 房山石家庄网站建设专门做有机食品的网站
  • 爱淘苗网站开发模式四方区企业型网站建设
  • 莱芜有需要制作网站的公司吗wordpress修改主题
  • 网销网站建设流程wordpress功能最全的免费主题
  • 洛阳工程建设信息网站关于网站建设的网站有哪些
  • 软件工程师证书有哪些网站关键词优化排名推荐
  • 国外常用的网站开发系统一个新手如何推销产品
  • 网站前端 设计政务服务中心网站建设实施方案
  • 江西 网站 建设 开发网站站内优化
  • 贵阳网站建设公司招聘微信里的小程序怎么制作方法
  • 长沙门户网站有哪些传奇网页游戏开服
  • 红酒营销 网站建设网站如何设置二级域名
  • 网站首页网址应该有对应的域名石家庄个人建网站
  • 无代码建站海外短视频服务器
  • 网站建设入什么费用江苏省建设档案网站
  • 黑wordpress网站做网站如何快速推广一款产品
  • 网站建设面试题导购分享网站模板
  • 建个网站做网络推广要花多少钱网站建设栏目怎么介绍
  • cms建设网站杭州营销型网站建设
  • 企业网站html源代码建设网站怎么建设分类
  • 网站运营需要 做哪些工作网站建设需要多少钱小江网页设计
  • 什么物流公司网站建设wordpress如何在数据库中修改域名
  • e2ee网站开发廊坊建设公司网站
  • 建设部网站最新消息网站建设吗
  • 做网站需要哪种工程师深圳市福田区656号
  • 您的网站未备案 或者原备案号被取消如何给网站续费
  • 重庆建站模板展示ps网页设计作品欣赏
  • 网站建设开源模板南京网站定制开发公司
  • 做图片为主的网站对服务器的要求自己做网站出证书
  • 怎么自己编写网站单机网页小游戏