
数据挖掘技术为出口退税业务过程中所积累的原始数据的深层次使用提供了一种可行的手段,本文介绍了数据挖掘技术在出口退税业务中使用的目的,提出了出口退税数据挖掘的系统功能和实现方法,为税收管理提供了有力的决策支持。
1 引言
出口货物退(免)税,简称出口退税,其基本含义是一个国家或地区对已报送离境的出口货物,由税务机关将其在出口前的生产和流通的各环节已经缴纳的国内产品税、增值税、营业税和特别消费税等间接税税款退还给出口企业的一项税收制度。出口退税主要是通过退还出口货物的国内已纳税款来平衡国内产品的税收负担,使本国产品以不含税成本进入国际市场,与国外产品在同等条件下进行竞争,从而增强竞争能力,扩大出口创汇[1]。
我国从1985年开始,全面地实行了出口退税政策,并从1995年开始全面实行电子化管理,它是全国税务系统第一个全面推广应用的税收管理软件,是金关工程和金税工程的一个子系统,在强化出口退税管理,提高出口退税工作效率,防范和打击骗税上发挥了巨大的作用[2]。但是,目前的出口退税电子化管理只完成了出口退税业务的电子化操作,还未在决策的电子化方面取得较大进展。经过十多年的发展,积累了大量涉税信息,如何将这些“历史的、静态的”数据变成动态的、具有分析决策性质的信息已成为当前急需研究的课题[3],数据挖掘技术的出现使这种应用成为现实。
2 出口退税数据挖掘的目的和基本方法
现行的出口退税电子化管理主要是通过出口企业把申报退税的信息通过出口退税申报系统录入计算机并生成申报数据,然后再经过出口退税审核系统把企业申报的出口退税凭证的电子信息与税务机关接收到的其他部门(征税机关、海关和外管)传来的凭证信息进行比对,以达到审核出口退税凭证的合法性和真实性的目的,进而根据比对审核通过的数据进行退税。可以看出,目前的出口退税电子化管理只侧重了出口退税的单证信息的计算机审核,而对于挖掘审核通过的单证信息和各部门传递来的电子信息的价值方面存在着很大的不足。
随着金税二期网络建设的推动,各省现已基本实现了出口退税数据的省级大集中[4],这些数据都是各出口退税部门在日常的业务审核中积累下来的数据,十分宝贵,如何充分发挥其应有的作用,已成为人们研究的热点。
数据挖掘的目的就是分析出口企业的出口退税数据,挖掘这些数据与经济的内在联系,全面掌握本地区出口退税的产品结构、出口的贸易方式、出口产品的地区差异等,对于调整一个地区的产业结构、经济发展方向以及制定经济发展战略有着重要的参考价值;对于税务机关掌握出口企业的实际生产出口情况,培养税源,打击偷税漏税和防范出口骗税等方面有着重要的意义。
对于出口退税部门在日常的业务审核中积累下来的数据进行挖掘,主要是指在了解和掌握具体纳税人生产经营情况和财务数据的基础上,对纳税人的税收经济关系和税收缴纳状况进行客观评价和说明的分析,主要是通过对历史数据进行纵横比较分析和逻辑关系稽核来进行挖掘,以指导税收管理工作。
1) 横向比较分析
横向比较分析是指同一指标在不同个体、单位、地区之间的比较分析。横向比较分析最典型的分析例子就是同业税负分析。受市场均衡作用的影响,同一产品在生产技术工艺、原材料能源消耗方面有相近之处,适用税收政策有统一的要求,因此反映生产成本费用方面的指标有相同的规律特征。总结这种规律特征,以此检验个体数据指标的表现,找出差异较大的个体予以预警。
2) 纵向比较分析
纵向比较分析或历史数据分析是指同一个体的同一指标在不同历史时期的数据比较分析。常用的分析方法有趋势分析和变动率分析。分析的理论依据是大多情况下企业的生产经营是处于一种相对平稳的状态,不会出现突然的波动或大起大落现象。因此,如果企业生产能力没有作大的调整,一般情况下企业各个时期的数据指标彼此接近,不会出现大的差异。如果出现较大差异,应引起主管部门的注意,及时进行相关的纳税评估。
3) 数据逻辑关系稽核
受会计核算原理的约束和税收制度规定的制约,反映纳税人生产经营情况和财务状况的众多数据指标之间存在非常严谨的、相互依存的逻辑关系。这种逻辑关系决定了企业的纳税申报数据必须满足企业财务数据相关性的特定要求,检查这些数据逻辑关系是否吻合,可以鉴别企业申报数据的真实性和合理性,从而发现税收问题,堵塞征管漏洞。
3 出口退税数据挖掘的功能
数据挖掘通过预测未来趋势及行为,做出前摄的、基于知识的决策。数据挖掘的目标是从数据库中发现隐含的、有意义的知识,主要有以下五类功能: 1) 趋势预测
数据挖掘自动在大型数据库中寻找预测性信息,以往需要进行大量手工分析的问题如今可以迅速直接由数据本身得出结论。出口退税数据挖掘的预测趋势是对纳税人特定税收指标、经济指标或税收经济关系指标一段时期走势和趋向的分析和推断,了解和掌握税收经济的发展趋势,有利于判断未来出口退税形势的好坏,使出口退税做到心中有数。
趋势预测的两个基本要求是说明特定指标的发展方向和变化幅度,基础分析技术是时间序列分析技术,常用说明指标有变动率和平均变化速度等。
2) 关联分析
数据关联是数据库中存在的一类重要的可被发现的知识。若两个或多个变量的取值之间存在某种规律性,就称为关联。关联可分为简单关联、时序关联、因果关联。关联分析的目的是找出数据库中隐藏的关联网。有时并不知道数据库中数据的关联函数,即使知道也是不确定的,因此关联分析生成的规则带有可信度。
在出口退税评估工作中,可以利用企业财务报表、纳税申报表和出口退税汇总表等各项数据指标之间的相互逻辑关系进行核算检查,对于不满足应有逻辑计算关系的内容,即认为破坏了会计核算或税款计征关系,均应视为异常做进一步的深入分析。由于企业财务指标和出口退税申报数据有上百条之多,所以与此相关的逻辑计算关系也会在此基础上更为丰富和复杂,只有通过关联分析,才有可能在出口退税申报环节实现实时的出口退税评估工作。
3) 聚类分析
聚类分析是数理统计的一个分支,是运用事物本身所具有的某种数据特征,遵循“物以类聚”规律进行数据处理,为事物的分类管理提供数据支持的一种分析方法。借用这种方法开展税收分析,可将具有某种税收共同特征的事物聚集在一起,使我们更清楚地认识税收征管工作的分类特征。
聚类分析的基本原理是根据数据指标差异的绝对距离进行分类,结合矩阵分析技术,可以进行多指标的综合特征分析,为复杂事物的分类提供了一种可行的分析方法。聚类分析的关键是找到一组关系密切的相关指标,如退税增长、税源增长、退税变化弹性和出口影响等,均可以利用这一分析技术进行综合分析和技术处理。
4) 差异分析
数据库中的数据常有一些异常记录,从数据库中检测这些差异很有意义。差异包括很多潜在的知识,如分类中的反常实例、不满足规则的特例、观测结果与模型预测值的偏差、量值随时间的变化等。
差异分析的基本方法是测算不同样本同一指标的差异程度。差异分析的关键是建立评价差异的标准,有了标准才能说明差异的影响程度。表示差异程度可以用绝对值,也可以建立参照系用相对值。应用差异分析开展微观税收分析的典型分析案例就是同业税负分析模型。应用同业税负分析模型可以测算出各项相关指标的客观水平和样本离散状况,以此为标准比对个别检验样本的具体数值,超出差异允许界限的即为预警对象。
5) 波动分析
波动分析是描述税收事物运行变化平稳性的分析。税收事物的运行受经济变化影响、税收制度规定的约束和现有征管环境制约有其自身客观的规律。在经济运行相对平稳、税制不变的条件下,税收事物运行平稳与否,直接反映税收征管情况的影响作用。因此,开展波动分析,一定程度上可以了解和说明退税管理的表现,反映退税管理是否能按税源的发展变化规律同步开展,监督退税管理的执行情况。
4 出口退税数据挖掘的实现
出口退税数据挖掘应用系统由三部分组成:第一部分是由用户数据源到数据库的ETL过程;第二部分是根据出口退税业务模型建立业务智能分析模型;第三部分是面向税收管理人员进行数据的发布和多维分析工作。基本结构如图1所示。
数据的ETL(Extract-Transform-Load,数据抽取、转换、装载)过程采用微软的SSIS(SQL Server Integration Services)来完成数据预处理阶段对于原始数据的转换、清洗加载过程;数据库采用微软的SQL Server 2005,SQL Server 2005除了提供一个安全、可靠和高效的数据管理平台之外,它还是一个企业级数据整合平台,通过SSIS提供了构建企业级ETL应用程序所需的功能和性能,是一个集成的商业智能平台,通过Analysis Services提供了统一和集成的商业数据视图,可被用做所有传统报表、OLAP分析、关键绩效指标(KPI)记分卡和数据挖掘的基础。
SQL Server 2005分析服务提供了数据挖掘服务,支持集成其它个人或者企业的DM算法,并且将DM算法集成的复杂度不断降低,它主要是基于OLE DB for DM规范,使用灵活。开发人员能够利用数据挖掘功能开发应用程序,其数据挖掘语言非常类似于SQL,数据挖掘供应者是一个开放系统,因为它是OLE DB的一个部件,数据挖掘服务能够通过DSO(Decision Support Object)、或ADO可包含在任何用户应用程序中。将DM算法无缝集成到SQL Server的分析服务中,利用集成的DM算法来构建数据挖掘解决方案是一种理想的方式。
在SQL Server 2005数据挖掘平台中,创建关系型挖掘模型的语法如下:
Create mining model () using
它类似于建立一个关系表,其中包括输入、预测属性,每一个模型与一个数据挖掘算法相关联。
多维数据分析工具和报表工具使用统一空间模型UDM(Unified Dimensional Model),利用UDM中对业务实体的友好描述、等级导航、多视角、自动平滑翻译为本机语言等功能,可以实现出口退税数据挖掘过程中所得到的结果集的友好展示。
4 结束语
随着数据仓库技术的发展,数据挖掘会越来越发挥其独到的分析优势,特别是将挖掘出的新知识通过用基于OLAP的决策支持系统加以验证、结合,可以更好地为决策者服务。出口退税管理的电子化系统已经积累了大量的业务数据,可以为数据挖掘提供大量数据,数据仓库和数据挖掘技术在收税管理具有广阔的应用前景。
教学模式是指在一定的教育思想、教学理论指导下的,在某种环境中开展的教学活动进程的稳定结构形式。建构主义的提出与建立对指导学习过程的研究和促进教学改革的进行具有普遍意义。在地理学科的教学中运用建构主义学习理论,更有独特的优势。 论文关键词:高科技时代建构主义学习理论教学模式 1问题的背景 21世纪是高科技时代,是知识社会。根据联合国教科文组织编著的《学会生存一教育世界的今天和明天表明,教育现代...
文章从公路工程施工过程及程序方面论述了工程内业资料的重要性。公路工程资料是反映工程实体最终成果的重要性文件,它贯穿于工程建设的全过程,在工程施工,竣、交工中有着非常重要的作用。 在公路工程施工的过程中,有人把在室外完成的工程称为“外业”,而把室内完成的工作称为“内业”。内业资料常被人误认为是内部资料工作,其实它和工程的“外业&rdquo...
自从我国加入WTO后,电子行业一直保持着强劲的发展势头,带动电子人才需求的增长。本文从电子企业用工调查,就中职学生就业存在的问题,引发中职教学的思考。 自从我国加入WTO后,许多国际电子领头企业看准国内劳动力相对廉价的机遇,竞相抢登中土,纷纷将劳动密集型的电子生产基地移迁我国,建立了许多的电子_I=业园区,带动了一大批国内电子产业蜂起,其行业一直保持优势发展的强劲势头。 一、电子行业现状 (...
丈章从教师培养形态的历史沿革入手,阐述了师范教育向教师教育体系的演变,在此基拙上,提出了真正意义上实现教师培养形态转型,必须推进教师职前教育专业化,并论述了实现教师职前教育专业化的几点对策。 一、教师培养形态的历史沿革纵观教育事业发展的历史长河,我们可以看到,师资养成主要经历了两个阶段:一是自然形成。在人类近代以前的漫长的历史过程中,并没有专门的制度、机构和人员来实施教师培养的活动。教师的养成主...
介绍珠江流域的概况及特点,指出开展珠江流域综合规划修编工作具有重要的意义。提出珠江流域综合规划修编的思路和工作重点:一是要完善流域综合防洪减灾体系;二是要构建流域水资源合理配置格局;三是要加强流域生态与环境保护能力;四是要发挥水资源综合效益,提高流域水资源综合利用能力;五是要高度重视流域水资源综合管理。 党中央、国务院高度重视新一轮的流域规划修编工作。2007年1月5日,国务院组织召开了流域综合...
本文根据就业市场的特点提出民族地区高校开拓就业市场.提高毕业生就业率和就业质量的策略。随着高校的不断扩招,毕业生人数逐年上升,待就业毕业生人数也呈现递增趋势,就业问题已成为制约社会发展的重大问题,不容忽视。民族地区高校在毕业生就业市场开拓上受到条件的制约,会存在更多的困难,因此,民族地区高校应充分认识到毕业生就业的重要性和必要性,形成较为完善的就业机制,积极拓展就业市场,为毕业生创造良好、宽松的就...
教师培训是对在职教师实施继续教育,促进教师成长的专业教育。英国校本教师培训强调以学校为教育基地,注重从学校和教师的实际需要来探讨学校教育与教学的规律,以培养具有实践教学能力的教师为目标,帮助教师专业发展。我国在基础教育改革与发展的过程中,应当借鉴校本教师培训的先进经验,重视教师教育的重要作用,结合当前学校教育现实,加强中小学教师的师资培训,培养适应现代教育形势以及富有个性和创造性的专业教师队伍,从...
法制教育是适应我国践行法制社会,建立法律体系的根本保障。它有效地推广了我国现行法律制度,保障了我国社会、经济生活的有序发展。本文以中职生法制教育为背景,分析指出了当前法制教育中所存在的问题,并针对这一系列问题提出了相应对策。 1法制教育与社会联系不紧密 我们知道,任何理论知识都是建立在社会实践之上的。对于法律来说,其理论知识的价值正是体现与实践之上。与社会实际不相符或者说脱离社会的法制教育必然...
中学英语教师培训模式整合主要涉及四个方面:一是培训内容的整合;二是培训主体的整合;三是培训对象的整合;四是培训手段的整合。注重理论与实践相结合,集中培训与校本培训相结合,培训与科研(教研)相结合。通过教师个人的自我反思、教师集体的同伴互助以及专家的专业引领,进而促进教师专业发展。一、问题的提出农村教育的发展离不开一支高素质的农村教师队伍。党的十七大报告关于教育工作论述中明确指出要“加强...
随着研究生教育规模的扩大,越来越多的研究生就业后处于隐性失业状态。研究生隐性失业的原因可以从职业序列及其刚性结构、雇主风险最小化原则和内部劳动力市场等职位竞争视角去分析,建议国家、高校和个人都要采取相应措施避免研究生隐性失业。 [论文关键词]职位竞争;研究生就业;隐性失业 随着研究生教育规模的不断扩大,毕业研究生的数量不断增长,就业形势也发生了变化,越来越多的研究生处于就业难的境地。据统计,从...
影响因子:4.167
影响因子:0.000
影响因子:0.000
影响因子:0.000
影响因子:1.813
影响因子:6.343
影响因子:0.903
影响因子:0.450