数据挖掘技术为出口退税业务过程中所积累的原始数据的深层次使用提供了一种可行的手段,本文介绍了数据挖掘技术在出口退税业务中使用的目的,提出了出口退税数据挖掘的系统功能和实现方法,为税收管理提供了有力的决策支持。
1 引言
出口货物退(免)税,简称出口退税,其基本含义是一个国家或地区对已报送离境的出口货物,由税务机关将其在出口前的生产和流通的各环节已经缴纳的国内产品税、增值税、营业税和特别消费税等间接税税款退还给出口企业的一项税收制度。出口退税主要是通过退还出口货物的国内已纳税款来平衡国内产品的税收负担,使本国产品以不含税成本进入国际市场,与国外产品在同等条件下进行竞争,从而增强竞争能力,扩大出口创汇[1]。
我国从1985年开始,全面地实行了出口退税政策,并从1995年开始全面实行电子化管理,它是全国税务系统第一个全面推广应用的税收管理软件,是金关工程和金税工程的一个子系统,在强化出口退税管理,提高出口退税工作效率,防范和打击骗税上发挥了巨大的作用[2]。但是,目前的出口退税电子化管理只完成了出口退税业务的电子化操作,还未在决策的电子化方面取得较大进展。经过十多年的发展,积累了大量涉税信息,如何将这些“历史的、静态的”数据变成动态的、具有分析决策性质的信息已成为当前急需研究的课题[3],数据挖掘技术的出现使这种应用成为现实。
2 出口退税数据挖掘的目的和基本方法
现行的出口退税电子化管理主要是通过出口企业把申报退税的信息通过出口退税申报系统录入计算机并生成申报数据,然后再经过出口退税审核系统把企业申报的出口退税凭证的电子信息与税务机关接收到的其他部门(征税机关、海关和外管)传来的凭证信息进行比对,以达到审核出口退税凭证的合法性和真实性的目的,进而根据比对审核通过的数据进行退税。可以看出,目前的出口退税电子化管理只侧重了出口退税的单证信息的计算机审核,而对于挖掘审核通过的单证信息和各部门传递来的电子信息的价值方面存在着很大的不足。
随着金税二期网络建设的推动,各省现已基本实现了出口退税数据的省级大集中[4],这些数据都是各出口退税部门在日常的业务审核中积累下来的数据,十分宝贵,如何充分发挥其应有的作用,已成为人们研究的热点。
数据挖掘的目的就是分析出口企业的出口退税数据,挖掘这些数据与经济的内在联系,全面掌握本地区出口退税的产品结构、出口的贸易方式、出口产品的地区差异等,对于调整一个地区的产业结构、经济发展方向以及制定经济发展战略有着重要的参考价值;对于税务机关掌握出口企业的实际生产出口情况,培养税源,打击偷税漏税和防范出口骗税等方面有着重要的意义。
对于出口退税部门在日常的业务审核中积累下来的数据进行挖掘,主要是指在了解和掌握具体纳税人生产经营情况和财务数据的基础上,对纳税人的税收经济关系和税收缴纳状况进行客观评价和说明的分析,主要是通过对历史数据进行纵横比较分析和逻辑关系稽核来进行挖掘,以指导税收管理工作。
1) 横向比较分析
横向比较分析是指同一指标在不同个体、单位、地区之间的比较分析。横向比较分析最典型的分析例子就是同业税负分析。受市场均衡作用的影响,同一产品在生产技术工艺、原材料能源消耗方面有相近之处,适用税收政策有统一的要求,因此反映生产成本费用方面的指标有相同的规律特征。总结这种规律特征,以此检验个体数据指标的表现,找出差异较大的个体予以预警。
2) 纵向比较分析
纵向比较分析或历史数据分析是指同一个体的同一指标在不同历史时期的数据比较分析。常用的分析方法有趋势分析和变动率分析。分析的理论依据是大多情况下企业的生产经营是处于一种相对平稳的状态,不会出现突然的波动或大起大落现象。因此,如果企业生产能力没有作大的调整,一般情况下企业各个时期的数据指标彼此接近,不会出现大的差异。如果出现较大差异,应引起主管部门的注意,及时进行相关的纳税评估。
3) 数据逻辑关系稽核
受会计核算原理的约束和税收制度规定的制约,反映纳税人生产经营情况和财务状况的众多数据指标之间存在非常严谨的、相互依存的逻辑关系。这种逻辑关系决定了企业的纳税申报数据必须满足企业财务数据相关性的特定要求,检查这些数据逻辑关系是否吻合,可以鉴别企业申报数据的真实性和合理性,从而发现税收问题,堵塞征管漏洞。
3 出口退税数据挖掘的功能
数据挖掘通过预测未来趋势及行为,做出前摄的、基于知识的决策。数据挖掘的目标是从数据库中发现隐含的、有意义的知识,主要有以下五类功能: 1) 趋势预测
数据挖掘自动在大型数据库中寻找预测性信息,以往需要进行大量手工分析的问题如今可以迅速直接由数据本身得出结论。出口退税数据挖掘的预测趋势是对纳税人特定税收指标、经济指标或税收经济关系指标一段时期走势和趋向的分析和推断,了解和掌握税收经济的发展趋势,有利于判断未来出口退税形势的好坏,使出口退税做到心中有数。
趋势预测的两个基本要求是说明特定指标的发展方向和变化幅度,基础分析技术是时间序列分析技术,常用说明指标有变动率和平均变化速度等。
2) 关联分析
数据关联是数据库中存在的一类重要的可被发现的知识。若两个或多个变量的取值之间存在某种规律性,就称为关联。关联可分为简单关联、时序关联、因果关联。关联分析的目的是找出数据库中隐藏的关联网。有时并不知道数据库中数据的关联函数,即使知道也是不确定的,因此关联分析生成的规则带有可信度。
在出口退税评估工作中,可以利用企业财务报表、纳税申报表和出口退税汇总表等各项数据指标之间的相互逻辑关系进行核算检查,对于不满足应有逻辑计算关系的内容,即认为破坏了会计核算或税款计征关系,均应视为异常做进一步的深入分析。由于企业财务指标和出口退税申报数据有上百条之多,所以与此相关的逻辑计算关系也会在此基础上更为丰富和复杂,只有通过关联分析,才有可能在出口退税申报环节实现实时的出口退税评估工作。
3) 聚类分析
聚类分析是数理统计的一个分支,是运用事物本身所具有的某种数据特征,遵循“物以类聚”规律进行数据处理,为事物的分类管理提供数据支持的一种分析方法。借用这种方法开展税收分析,可将具有某种税收共同特征的事物聚集在一起,使我们更清楚地认识税收征管工作的分类特征。
聚类分析的基本原理是根据数据指标差异的绝对距离进行分类,结合矩阵分析技术,可以进行多指标的综合特征分析,为复杂事物的分类提供了一种可行的分析方法。聚类分析的关键是找到一组关系密切的相关指标,如退税增长、税源增长、退税变化弹性和出口影响等,均可以利用这一分析技术进行综合分析和技术处理。
4) 差异分析
数据库中的数据常有一些异常记录,从数据库中检测这些差异很有意义。差异包括很多潜在的知识,如分类中的反常实例、不满足规则的特例、观测结果与模型预测值的偏差、量值随时间的变化等。
差异分析的基本方法是测算不同样本同一指标的差异程度。差异分析的关键是建立评价差异的标准,有了标准才能说明差异的影响程度。表示差异程度可以用绝对值,也可以建立参照系用相对值。应用差异分析开展微观税收分析的典型分析案例就是同业税负分析模型。应用同业税负分析模型可以测算出各项相关指标的客观水平和样本离散状况,以此为标准比对个别检验样本的具体数值,超出差异允许界限的即为预警对象。
5) 波动分析
波动分析是描述税收事物运行变化平稳性的分析。税收事物的运行受经济变化影响、税收制度规定的约束和现有征管环境制约有其自身客观的规律。在经济运行相对平稳、税制不变的条件下,税收事物运行平稳与否,直接反映税收征管情况的影响作用。因此,开展波动分析,一定程度上可以了解和说明退税管理的表现,反映退税管理是否能按税源的发展变化规律同步开展,监督退税管理的执行情况。
4 出口退税数据挖掘的实现
出口退税数据挖掘应用系统由三部分组成:第一部分是由用户数据源到数据库的ETL过程;第二部分是根据出口退税业务模型建立业务智能分析模型;第三部分是面向税收管理人员进行数据的发布和多维分析工作。基本结构如图1所示。
数据的ETL(Extract-Transform-Load,数据抽取、转换、装载)过程采用微软的SSIS(SQL Server Integration Services)来完成数据预处理阶段对于原始数据的转换、清洗加载过程;数据库采用微软的SQL Server 2005,SQL Server 2005除了提供一个安全、可靠和高效的数据管理平台之外,它还是一个企业级数据整合平台,通过SSIS提供了构建企业级ETL应用程序所需的功能和性能,是一个集成的商业智能平台,通过Analysis Services提供了统一和集成的商业数据视图,可被用做所有传统报表、OLAP分析、关键绩效指标(KPI)记分卡和数据挖掘的基础。
SQL Server 2005分析服务提供了数据挖掘服务,支持集成其它个人或者企业的DM算法,并且将DM算法集成的复杂度不断降低,它主要是基于OLE DB for DM规范,使用灵活。开发人员能够利用数据挖掘功能开发应用程序,其数据挖掘语言非常类似于SQL,数据挖掘供应者是一个开放系统,因为它是OLE DB的一个部件,数据挖掘服务能够通过DSO(Decision Support Object)、或ADO可包含在任何用户应用程序中。将DM算法无缝集成到SQL Server的分析服务中,利用集成的DM算法来构建数据挖掘解决方案是一种理想的方式。
在SQL Server 2005数据挖掘平台中,创建关系型挖掘模型的语法如下:
Create mining model () using
它类似于建立一个关系表,其中包括输入、预测属性,每一个模型与一个数据挖掘算法相关联。
多维数据分析工具和报表工具使用统一空间模型UDM(Unified Dimensional Model),利用UDM中对业务实体的友好描述、等级导航、多视角、自动平滑翻译为本机语言等功能,可以实现出口退税数据挖掘过程中所得到的结果集的友好展示。
4 结束语
随着数据仓库技术的发展,数据挖掘会越来越发挥其独到的分析优势,特别是将挖掘出的新知识通过用基于OLAP的决策支持系统加以验证、结合,可以更好地为决策者服务。出口退税管理的电子化系统已经积累了大量的业务数据,可以为数据挖掘提供大量数据,数据仓库和数据挖掘技术在收税管理具有广阔的应用前景。
在工程监理实践中。建设监理制度为确保工程质量。提高工程建设水平。发挥投资效益产生了良好的效果。同时。由于该项制度实施的时间较短。经验不足。社会缺乏对建设监理的认识。以及监理实施中由于管理不规范和制度不完备的原因。造成目前监理行业存在许多问题。本文力图从监理的实践中发现问题、分析问题。在此基础上提出解决问题的对策和完善监理制度的构想。 工程建设监理是“指针对工程项目建设。社会化、专业化...
比较起传统就业市场,网络就业市场的优势非常突出,但存在的问题也不少。从网络招聘与求职的角度,分析了网络就业市场的利与弊,并从技术、制度等方面提出了完善此项工作的建议。 论文关键词:网络;就业市场;大学生;求职 利用网络进行招聘和求职以其速度快、效率高、成本低、费用省、覆盖面广等特点正在吸引着大量企业和高校毕业生。它通过信息技术来降低沟通成本,使信息双向更加对称,提供给劳动就业者公平、便捷的服务...
丈章从教师培养形态的历史沿革入手,阐述了师范教育向教师教育体系的演变,在此基拙上,提出了真正意义上实现教师培养形态转型,必须推进教师职前教育专业化,并论述了实现教师职前教育专业化的几点对策。 一、教师培养形态的历史沿革纵观教育事业发展的历史长河,我们可以看到,师资养成主要经历了两个阶段:一是自然形成。在人类近代以前的漫长的历史过程中,并没有专门的制度、机构和人员来实施教师培养的活动。教师的养成主...
自20世纪9O年代建构主义理论被引入我国教育技术领域以来,建构主义对现代教学的影响成为人们讨论的焦点。近年来,教育技术领域的专家们进行了大量的研究与探索,力图建立一套能与建构主义学习理论以及学习环境相适应的全新的教学设计理论与方法体系,虽然其基本思想及主要原则已日渐明朗,但其对体育专业学生专项学习的研究涉猎很少甚至没有,本课题致力于本方向的研究。一、建构主义学习理论建构主义也称结构主义,其最早提出...
随着农村中小学现代远程教育技术的不断推广,在课堂教学中利用远教资源的优势逐步体现出来。由于物理这门学科实验性、抽象性、应用性比较强,如何使物理问题形象化便成为学生学习的关键,直接影响课堂教学质量。尽管教师做了大量的演示实验,并将理论联系实际进行讲解,但有时因实验条件的限制,物理知识本身所具有的抽象性和复杂性,使得学生无法清楚地观察实验的操作过程及实验现象,无法正确地理解抽象的物理问题。学生由于没有...
本文通过对知识的再认识,形成了知识管理的基本理念。在考察了信息时代下教学设计新特点的基拙上,提出从知识管理的角度解决教学设计问题的基本思路。 论文关键词:隐性知识显性知识知识管理教学设计知识流程 一、问题的提出 知识经济的时代,知识存在于每一个领域,影响着人们的学习和生活,可是随着知识量的增加,知识爆炸又使人们很容易迷失在知识的海洋。人们如何在需要的时候得到最有价值的知识,教育是知识密集的领...
我国数学学习具有较强的自我封闹性,普遍注重“纯粹”技能技巧的训练和题型教学.脱离社会生活实际,即使一些数学技能较好的学生面对现实的数学问题也常常感到困难..数学应该是一个过程,一种活动,学数学更重要的是运用数学解决生活中的问题。数学与生活相结合,融于生活、走进生活.才会具有更强的生命力 论文关键词:数学生活教学策略 一、数学融于生活的必要性 课标中提出:“...
作为一项工程的开始,招标投标具有举足轻重的地位,而目前建筑企业里大量存在的不正当竟争行为使本不完善的竞标机制倍生隐患。为确保工程质量,创造良好的投资环境,对不正当竞争行为采取相应措施并兼采国际先进制度,是工程行业迫在眉睫之势。 论文关键词:工程招标投标不正当竞争 招标投标制素有“阳光交易”之称。经多年的实践证明,招标投标制度是比较成熟且科学合理的工程承包发包方式,也是保...
提出应用多刚体动力学仿真技术和热力学数值模拟技术集成进行湿式摩擦离合器动态设计的方法,得到离合器摩擦片动态接合过程中温度分布和热应力分布,并为进一步深入研究打下基础。 1前言 湿式摩擦离合器是机械设备传动机构的重要部件,该类离合器的传统设计方法是按照稳定运行状态计算许用传递扭矩,校核摩擦材料的比压和挤压应力,确定离合器结构。在实际使用过程中,绝大部分离合器的损坏不是在稳态运转时,而是在动态接合...
在“新课程、新理念”的背景下进行教学创新,最大限度地发挥学生的创造性和能动性,真正科学、全面地把握音乐教育的价值,是需要我们深入研究和努力实施的新课题。本文在多年教学经验的基础上探讨了如何在中学音乐欣赏教学中培养学生的创造性思维,并提出了参与一一体验一一探究一一创造的新教学模式。 “创新”是素质教育的灵魂。而音乐教育作为审美教育的组成部分是实施素质...
影响因子:0.000
影响因子:0.000
影响因子:0.000
影响因子:0.000
影响因子:0.000
影响因子:4.320
影响因子:0.000
影响因子:4.890