当前位置: 首页 > news >正文

怎么查网站备案接入商网站建设和推广方案

怎么查网站备案接入商,网站建设和推广方案,西安网站建设APP开发,域名空间费一年多少钱基于论文摘要的文本分类与关键词抽取挑战赛​​​​​​2023 iFLYTEK A.I.开发者大赛-讯飞开放平台 环境需求:Anaconda-JupyterNotebook,或者百度AIStudio 赛题解析: 【文本二分类任务】根据论文摘要等信息理解,将论文划分为0-1两…

基于论文摘要的文本分类与关键词抽取挑战赛
​​​​​​2023 iFLYTEK A.I.开发者大赛-讯飞开放平台

环境需求:Anaconda-JupyterNotebook,或者百度AIStudio

赛题解析:

【文本二分类任务】根据论文摘要等信息理解,将论文划分为0-1两类别之一。
【文本关键词识别任务】从给定的论文中识别和提取出与论文内容相关的关键词。

数据样例:title、author、Abstract、Keywords、[label] 0-1

一键运行的时候先把csv删了(是运行结果)

安装nltk【更换镜像源避免安装出错】

!pip install nltk -i http://mirrors.aliyun.com/pypi/simple/  --trusted-host mirrors.aliyun.com
# 导入pandas用于读取表格数据
import pandas as pd# 导入BOW(词袋模型)
from sklearn.feature_extraction.text import CountVectorizer
#可以替换为TfidfVectorizer(TF-IDF(词频-逆文档频率))
#注意上下文要同时修改,亲测后者效果更佳# 导入LogisticRegression回归模型
from sklearn.linear_model import LogisticRegression# 过滤警告消息
from warnings import simplefilter
from sklearn.exceptions import ConvergenceWarning
simplefilter("ignore", category=ConvergenceWarning)# 读取数据集
train = pd.read_csv('/home/aistudio/data/data231041/train.csv')
train['title'] = train['title'].fillna('')
train['abstract'] = train['abstract'].fillna('')test = pd.read_csv('/home/aistudio/data/data231041/testB.csv')
test['title'] = test['title'].fillna('')
test['abstract'] = test['abstract'].fillna('')# 提取文本特征,生成训练集与测试集
train['text'] = train['title'].fillna('') + ' ' +  train['author'].fillna('') + ' ' + train['abstract'].fillna('')+ ' ' + train['Keywords'].fillna('')
test['text'] = test['title'].fillna('') + ' ' +  test['author'].fillna('') + ' ' + test['abstract'].fillna('')vector = CountVectorizer().fit(train['text'])
train_vector = vector.transform(train['text'])
test_vector = vector.transform(test['text'])# 引入模型
model = LogisticRegression()# 开始训练,这里可以考虑修改默认的batch_size与epoch来取得更好的效果
model.fit(train_vector, train['label'])# 利用模型对测试集label标签进行预测
test['label'] = model.predict(test_vector)
test['Keywords'] = test['title'].fillna('')
test[['uuid','Keywords','label']].to_csv('submit_task1.csv', index=None)

ndarray.finall()方法:填充空值

pandas数据处理常用命令_ndarray fillna_hellosc01的博客-CSDN博客

Basedline的方法:BOW词袋提取特征-LR逻辑回归-进行预测

改进方法:TF-IDF,SVM,epoches

# TfidfVectorizer(TF-IDF(词频-逆文档频率))
from sklearn.feature_extraction.text import TfidfVectorizer
# 导入支持向量机分类器
from sklearn.svm import SVC#创建SVM训练模型 
model = SVC(kernel='linear', C=1)# 利用模型对测试集label标签进行预测
test['label'] = model.predict(test_vector)
test['Keywords'] = test['title'].fillna('')
test[['uuid','Keywords','label']].to_csv('submit_task2.csv', index=None)

by ライト

http://www.yayakq.cn/news/246134/

相关文章:

  • 提供网站建设哪家好wordpress 漂浮窗口
  • 如何做公司培训网站1元1年xyz域名
  • seo站长产品设计公司介绍
  • 多少钱要交税做优化网站哪个公司好
  • 公司网站可以免费建吗市场营销做得好的企业
  • 专业的外贸建站公司陕西网络推广网站
  • 个人域名可以做网站吗怎么学互联网怎么赚钱
  • 免费个人网站2018现在哪些网站自己做装修
  • 网站 工商备案易游网络验证代理平台
  • 用vue框架做的pc端网站合肥网站关键词优化
  • 网站备案步骤网站建设论文附录怎么写
  • 旅游外贸网站建设推广teahouse wordpress主题
  • 北海做网站网站建设哪家好做网站首页的表格的代码
  • 网站维护工程师薪酬html登录注册页面代码
  • 惠州市网站开发手工制作盲盒
  • 雨花区师德师风建设专题网站手机绘制建房app
  • 网站打不开 域名做解析谷歌广告怎么投放
  • 哈尔滨网站制作公司seo搜索引擎优化业务
  • 贸易公司怎么做网站比较好wordpress xml怎么开
  • 威海网站推广乐成高端网站建设
  • 手机哪里可以做视频网站wordpress手机分享插件下载地址
  • 自己制作一个网站的软件个人网站域名备案
  • 公司禁用网站怎么做没本钱一个月赚10万
  • wap网站制作模板软件开发需要的软件
  • 植物园门户网站建设方案wordpress ss
  • 两个网站合并建设实施方案网站优化排名易下拉稳定
  • 网站付费推广竞价网站对于企业的好处
  • 南京网站建设 ww网页制作视频教程网
  • 长沙网站制作一般多少钱高级网站设计
  • 海报设计制作网站龙岗营销型网站建设