数据挖掘技术为出口退税业务过程中所积累的原始数据的深层次使用提供了一种可行的手段,本文介绍了数据挖掘技术在出口退税业务中使用的目的,提出了出口退税数据挖掘的系统功能和实现方法,为税收管理提供了有力的决策支持。
1 引言
出口货物退(免)税,简称出口退税,其基本含义是一个国家或地区对已报送离境的出口货物,由税务机关将其在出口前的生产和流通的各环节已经缴纳的国内产品税、增值税、营业税和特别消费税等间接税税款退还给出口企业的一项税收制度。出口退税主要是通过退还出口货物的国内已纳税款来平衡国内产品的税收负担,使本国产品以不含税成本进入国际市场,与国外产品在同等条件下进行竞争,从而增强竞争能力,扩大出口创汇[1]。
我国从1985年开始,全面地实行了出口退税政策,并从1995年开始全面实行电子化管理,它是全国税务系统第一个全面推广应用的税收管理软件,是金关工程和金税工程的一个子系统,在强化出口退税管理,提高出口退税工作效率,防范和打击骗税上发挥了巨大的作用[2]。但是,目前的出口退税电子化管理只完成了出口退税业务的电子化操作,还未在决策的电子化方面取得较大进展。经过十多年的发展,积累了大量涉税信息,如何将这些“历史的、静态的”数据变成动态的、具有分析决策性质的信息已成为当前急需研究的课题[3],数据挖掘技术的出现使这种应用成为现实。
2 出口退税数据挖掘的目的和基本方法
现行的出口退税电子化管理主要是通过出口企业把申报退税的信息通过出口退税申报系统录入计算机并生成申报数据,然后再经过出口退税审核系统把企业申报的出口退税凭证的电子信息与税务机关接收到的其他部门(征税机关、海关和外管)传来的凭证信息进行比对,以达到审核出口退税凭证的合法性和真实性的目的,进而根据比对审核通过的数据进行退税。可以看出,目前的出口退税电子化管理只侧重了出口退税的单证信息的计算机审核,而对于挖掘审核通过的单证信息和各部门传递来的电子信息的价值方面存在着很大的不足。
随着金税二期网络建设的推动,各省现已基本实现了出口退税数据的省级大集中[4],这些数据都是各出口退税部门在日常的业务审核中积累下来的数据,十分宝贵,如何充分发挥其应有的作用,已成为人们研究的热点。
数据挖掘的目的就是分析出口企业的出口退税数据,挖掘这些数据与经济的内在联系,全面掌握本地区出口退税的产品结构、出口的贸易方式、出口产品的地区差异等,对于调整一个地区的产业结构、经济发展方向以及制定经济发展战略有着重要的参考价值;对于税务机关掌握出口企业的实际生产出口情况,培养税源,打击偷税漏税和防范出口骗税等方面有着重要的意义。
对于出口退税部门在日常的业务审核中积累下来的数据进行挖掘,主要是指在了解和掌握具体纳税人生产经营情况和财务数据的基础上,对纳税人的税收经济关系和税收缴纳状况进行客观评价和说明的分析,主要是通过对历史数据进行纵横比较分析和逻辑关系稽核来进行挖掘,以指导税收管理工作。
1) 横向比较分析
横向比较分析是指同一指标在不同个体、单位、地区之间的比较分析。横向比较分析最典型的分析例子就是同业税负分析。受市场均衡作用的影响,同一产品在生产技术工艺、原材料能源消耗方面有相近之处,适用税收政策有统一的要求,因此反映生产成本费用方面的指标有相同的规律特征。总结这种规律特征,以此检验个体数据指标的表现,找出差异较大的个体予以预警。
2) 纵向比较分析
纵向比较分析或历史数据分析是指同一个体的同一指标在不同历史时期的数据比较分析。常用的分析方法有趋势分析和变动率分析。分析的理论依据是大多情况下企业的生产经营是处于一种相对平稳的状态,不会出现突然的波动或大起大落现象。因此,如果企业生产能力没有作大的调整,一般情况下企业各个时期的数据指标彼此接近,不会出现大的差异。如果出现较大差异,应引起主管部门的注意,及时进行相关的纳税评估。
3) 数据逻辑关系稽核
受会计核算原理的约束和税收制度规定的制约,反映纳税人生产经营情况和财务状况的众多数据指标之间存在非常严谨的、相互依存的逻辑关系。这种逻辑关系决定了企业的纳税申报数据必须满足企业财务数据相关性的特定要求,检查这些数据逻辑关系是否吻合,可以鉴别企业申报数据的真实性和合理性,从而发现税收问题,堵塞征管漏洞。
3 出口退税数据挖掘的功能
数据挖掘通过预测未来趋势及行为,做出前摄的、基于知识的决策。数据挖掘的目标是从数据库中发现隐含的、有意义的知识,主要有以下五类功能: 1) 趋势预测
数据挖掘自动在大型数据库中寻找预测性信息,以往需要进行大量手工分析的问题如今可以迅速直接由数据本身得出结论。出口退税数据挖掘的预测趋势是对纳税人特定税收指标、经济指标或税收经济关系指标一段时期走势和趋向的分析和推断,了解和掌握税收经济的发展趋势,有利于判断未来出口退税形势的好坏,使出口退税做到心中有数。
趋势预测的两个基本要求是说明特定指标的发展方向和变化幅度,基础分析技术是时间序列分析技术,常用说明指标有变动率和平均变化速度等。
2) 关联分析
数据关联是数据库中存在的一类重要的可被发现的知识。若两个或多个变量的取值之间存在某种规律性,就称为关联。关联可分为简单关联、时序关联、因果关联。关联分析的目的是找出数据库中隐藏的关联网。有时并不知道数据库中数据的关联函数,即使知道也是不确定的,因此关联分析生成的规则带有可信度。
在出口退税评估工作中,可以利用企业财务报表、纳税申报表和出口退税汇总表等各项数据指标之间的相互逻辑关系进行核算检查,对于不满足应有逻辑计算关系的内容,即认为破坏了会计核算或税款计征关系,均应视为异常做进一步的深入分析。由于企业财务指标和出口退税申报数据有上百条之多,所以与此相关的逻辑计算关系也会在此基础上更为丰富和复杂,只有通过关联分析,才有可能在出口退税申报环节实现实时的出口退税评估工作。
3) 聚类分析
聚类分析是数理统计的一个分支,是运用事物本身所具有的某种数据特征,遵循“物以类聚”规律进行数据处理,为事物的分类管理提供数据支持的一种分析方法。借用这种方法开展税收分析,可将具有某种税收共同特征的事物聚集在一起,使我们更清楚地认识税收征管工作的分类特征。
聚类分析的基本原理是根据数据指标差异的绝对距离进行分类,结合矩阵分析技术,可以进行多指标的综合特征分析,为复杂事物的分类提供了一种可行的分析方法。聚类分析的关键是找到一组关系密切的相关指标,如退税增长、税源增长、退税变化弹性和出口影响等,均可以利用这一分析技术进行综合分析和技术处理。
4) 差异分析
数据库中的数据常有一些异常记录,从数据库中检测这些差异很有意义。差异包括很多潜在的知识,如分类中的反常实例、不满足规则的特例、观测结果与模型预测值的偏差、量值随时间的变化等。
差异分析的基本方法是测算不同样本同一指标的差异程度。差异分析的关键是建立评价差异的标准,有了标准才能说明差异的影响程度。表示差异程度可以用绝对值,也可以建立参照系用相对值。应用差异分析开展微观税收分析的典型分析案例就是同业税负分析模型。应用同业税负分析模型可以测算出各项相关指标的客观水平和样本离散状况,以此为标准比对个别检验样本的具体数值,超出差异允许界限的即为预警对象。
5) 波动分析
波动分析是描述税收事物运行变化平稳性的分析。税收事物的运行受经济变化影响、税收制度规定的约束和现有征管环境制约有其自身客观的规律。在经济运行相对平稳、税制不变的条件下,税收事物运行平稳与否,直接反映税收征管情况的影响作用。因此,开展波动分析,一定程度上可以了解和说明退税管理的表现,反映退税管理是否能按税源的发展变化规律同步开展,监督退税管理的执行情况。
4 出口退税数据挖掘的实现
出口退税数据挖掘应用系统由三部分组成:第一部分是由用户数据源到数据库的ETL过程;第二部分是根据出口退税业务模型建立业务智能分析模型;第三部分是面向税收管理人员进行数据的发布和多维分析工作。基本结构如图1所示。
数据的ETL(Extract-Transform-Load,数据抽取、转换、装载)过程采用微软的SSIS(SQL Server Integration Services)来完成数据预处理阶段对于原始数据的转换、清洗加载过程;数据库采用微软的SQL Server 2005,SQL Server 2005除了提供一个安全、可靠和高效的数据管理平台之外,它还是一个企业级数据整合平台,通过SSIS提供了构建企业级ETL应用程序所需的功能和性能,是一个集成的商业智能平台,通过Analysis Services提供了统一和集成的商业数据视图,可被用做所有传统报表、OLAP分析、关键绩效指标(KPI)记分卡和数据挖掘的基础。
SQL Server 2005分析服务提供了数据挖掘服务,支持集成其它个人或者企业的DM算法,并且将DM算法集成的复杂度不断降低,它主要是基于OLE DB for DM规范,使用灵活。开发人员能够利用数据挖掘功能开发应用程序,其数据挖掘语言非常类似于SQL,数据挖掘供应者是一个开放系统,因为它是OLE DB的一个部件,数据挖掘服务能够通过DSO(Decision Support Object)、或ADO可包含在任何用户应用程序中。将DM算法无缝集成到SQL Server的分析服务中,利用集成的DM算法来构建数据挖掘解决方案是一种理想的方式。
在SQL Server 2005数据挖掘平台中,创建关系型挖掘模型的语法如下:
Create mining model () using
它类似于建立一个关系表,其中包括输入、预测属性,每一个模型与一个数据挖掘算法相关联。
多维数据分析工具和报表工具使用统一空间模型UDM(Unified Dimensional Model),利用UDM中对业务实体的友好描述、等级导航、多视角、自动平滑翻译为本机语言等功能,可以实现出口退税数据挖掘过程中所得到的结果集的友好展示。
4 结束语
随着数据仓库技术的发展,数据挖掘会越来越发挥其独到的分析优势,特别是将挖掘出的新知识通过用基于OLAP的决策支持系统加以验证、结合,可以更好地为决策者服务。出口退税管理的电子化系统已经积累了大量的业务数据,可以为数据挖掘提供大量数据,数据仓库和数据挖掘技术在收税管理具有广阔的应用前景。
随着全球经济的发展,就业市场对毕业生的要求越来越高。作为就业者中的特殊人群—艺术类毕业生在就业的大潮中将会接受怎样的考验。笔者通过对就业市场英语使用需求的了解和调查,从而进一步归纳英语学习与使用需求对当代大学生,特别是艺术类学生的就业有着重要的影响。 调研目的:进一步了解与归纳英语学习与使用需求对当代大学生的,特别是艺术类大学生的就业有着重要的影响。 调研对象:02级、03级艺术类...
基础教育新课程的全面实施,对高师教师教育培养的未来教师提出了新要求。因此,高师教师教育必须以《基础教育课程改革纲要(试行)》的精神和中小学教师专业化发展需要为依据深入进行教师教育的课程改革,为中小学培养适应新课程的教育教学和自身不断发展需要的合格教师。 高师教师教育的培养目标是为基础教育培养合格的师资。基础教育的课程改革,必然制约高师教师教育的课程改革。我国自2001年6月颁布《基础教育课程改革...
本文考察了主客同一研究范式的内涵、发展脉络及历史地位。作者认为,主客同一研究范式体现着心理学的人文科学定向,张扬的是人有别于自然物的“天使”形象,展示的是将人的心理、行为视作“生活”,试图从内部体验、直观以达成对人的独特本质洞察的“内观心理学”境界。它和主客二分研究范式均可在未来心理学中获得各自合理存在的空间。 西方心理学的...
分析了车床大修时如何保证车床丝杠、光杆、操纵杆三杆同心。 车床大修时,由于车床的床身导轨、大溜板导轨磨损相对比较严重,必须进行修理,以恢复车床的几何精度。但是如果修理不当则容易造成车床的丝杠、光杆、操纵杆三杆经重新装配后不同心,引起新的误差。大修后引起三杆不同心的原因很多,主要原因是对床身与大溜板导轨副修刮不当,使大溜板不均匀下沉,而使溜板箱倾斜引起的。因此,大修时,不能只对磨损破坏了几何精度的...
我国青少年体育俱乐部的性质定位是事关其可持续发展的重要问题。研究表明,青少年体育俱乐部属于非营利组织范畴。当前我国青少年体育俱乐部不属于纯粹的民办非企业单位或体育社团。基于青少年体育俱乐部的可持续发展需要,应该将其定位为民办非企业单位。今后青少年体育俱乐部的发展,应该发挥自身能动性及社会适应能力,通过积极运营实现“自我造血”。青少年的体质健康关乎到整个中华民族的健康素质。根...
本文系统的阐述了道德暨道德教育的意义以及对大学生进行道德教育的必要性和如何进行道德教育,以期强化高等教育,使社会更和谐。认识超越时空的大自然运行法则,谓之道;教导人类如何顺从大自然的法则,不违越地做人,谓之德。“德”字原创意(甲古文)为十四个人一条心,且是双立人,可理解为二十八个人同心。一个人的思想意识行为,若能统纳至众心所致之视阑,那么这个人就谓之德高。德高之人是没有做不...
本文主要阐述在医学高职院校护理专业应用写作教学改革中培养就业市场需要的护理专业技能型紧缺人才的体会。 在国家教育部、卫生部的亲切关怀和直接指导下,护理专业被列为国家技能型紧缺人才项目四大专业之一。与之配套的人才培养指导方案也随之被发布。护理人员成为医生和其他保健人员平等的合作者、初级卫生保健和健康教育的主要力量,同时为危重症患者提供高质量、高技术的护理。这就要求每一个护士都必须具备良好的人际沟通...
本文在访谈和问卷调查的基础上,呈现了云南省部分高师院校教师教育师资队伍的建设现状,又从以人为本、全面协调发展和可持续发展的原则与角度出发,分析和总结了云南省高师院校教师教育课程师资队伍建设的经验和主要问题,旨在推动教师教育课程师资队伍的培养与建设,推进教师教育的改革与发展,提高教师教育质量。 论文关键词:教师教育课程;师资队伍建设 一、云南省教师教育师资队伍建设现状 云南省各高师院校不断顺应...
网络教学是建立在计算机辅助教学(CAI)和以广播电视为媒体的远程教育基础之上,利用计算机技术和现代通信技术发展起来的一种现代教学模式。与传统课堂教学相比,不论从学习的适用对象、教育内容的表现形式、课程的组织安排和学习者的学习方式来看,网络教学都具有其不可比拟的优越性。将网络教学引进学校是提高其课程教学水平的有效手段。其中,网络课程的设计是关键。本文基于建构主义理论,就学校网络课程的设计提出了自己的...
教师教育技术培训的目的是全面提高教师教育技术应用能力。促进教育技术在教学中的有效运用,其主要内容是促使信息技术与学科教学的有效整合。本文针对目前中小学教师教育技术能力培训中存在的问题进行探讨,并提出相应的对策。 论文关键词:中小学教师;教育技术能力;培训;现状;时策; 随着信息化教育的发展,教育技术能力己成为衡量教师专业水平标准中的一个重要方面。教师应具备现代教育技术素质,能够运用现代教学思想...