主页期刊介绍编委会编辑部服务介绍道德声明在线审稿编委办公编辑办公English
2018-2019年专刊出版计划 微信服务介绍 最新一期:2018年第12期
     
在线出版
各期目录
纸质出版
分辑系列
论文检索
论文排行
综述文章
专刊文章
美文分享
各期封面
E-mail Alerts
RSS
旧版入口
中国科学院软件研究所
  
投稿指南 问题解答 下载区 收费标准 在线投稿
杨丽琴,康国胜,郭立鹏,田朝阳,张亮,张笑楠,高翔.一种适用于多样性环境的业务流程挖掘方法.软件学报,2015,26(3):550-561
一种适用于多样性环境的业务流程挖掘方法
Process Mining Approach for Diverse Application Environments
投稿时间:2014-07-01  修订日期:2014-11-21
DOI:10.13328/j.cnki.jos.004770
中文关键词:  流程挖掘  流程整合  遗传算法  日志分类  ProM
英文关键词:process mining  process consolidation  genetic algorithm  log classification  ProM
基金项目:国家自然科学基金(60873115); 教育部-中国移动科研基金(MCM20123011); 上海市科技发展基金(13dz2260200, 13511504300); 上海中医药大学预算内项目(2013JW30)
作者单位E-mail
杨丽琴 复旦大学 计算机科学技术学院, 上海 201203
上海市数据科学重点实验室复旦大学, 上海 201203
上海中医药大学 图书信息中心, 上海 201203 
 
康国胜 复旦大学 计算机科学技术学院, 上海 201203
上海市数据科学重点实验室复旦大学, 上海 201203 
 
郭立鹏 复旦大学 计算机科学技术学院, 上海 201203
上海市数据科学重点实验室复旦大学, 上海 201203 
 
田朝阳 复旦大学 计算机科学技术学院, 上海 201203
上海市数据科学重点实验室复旦大学, 上海 201203 
 
张亮 复旦大学 计算机科学技术学院, 上海 201203
上海市数据科学重点实验室复旦大学, 上海 201203 
lzhang@fudan.edu.cn 
张笑楠 中国移动有限公司 信息系统管理部, 北京 100084  
高翔 中国移动有限公司 信息系统管理部, 北京 100084  
摘要点击次数: 3006
全文下载次数: 2304
中文摘要:
      从运行日志挖掘业务流程模型的流程挖掘方法研究方兴未艾,然而,复杂多变的运行环境使流程日志也不可避免地呈现出多样性.传统的流程挖掘算法各有其适用对象,因此,如何挑选适合多样性流程日志的流程挖掘算法成为了一项挑战.提出一种适用于多样性环境的业务流程挖掘方法SoFi(survival of fittest integrator).该方法基于领域知识对日志进行分类,使用多种现有的挖掘算法对每一类子日志产生一组流程模型作为遗传算法的初始种群,借助遗传算法的优化能力,从中整合得到高质量的业务流程模型.针对模拟日志和某通信公司真实日志的实验结果表明:相对于任何单一的挖掘算法,SoFi产生的流程模型具有更高的综合质量,即重现度、精确度、通用性和简单性.
英文摘要:
      Mining business process models from running logs is in its ascendant. Inevitably, the ever changing operational environment makes these log records diverse. Considering every mining algorithm has its pros and cons, this paper focuses on the challenge to apply a best mining algorithm against diverse logs. A novel approach, SoFi (survival of fittest integrator), is proposed to mine business process models effectively in such a diverse environment. SoFi tackles the diversity issue by utilizing domain knowledge to classify the cases in a log and applying various mining algorithms on these categories to obtain comprehensive process models as candidates for optimization. A genetic algorithm (GA) based optimizer takes these candidates as initial population for purpose of both genetic quality as well as genetic diversity. Under the principle of survival of fittest, the GA optimizer can aggregate best process fragments with context into the final process model for the entire log. Experiments on synthetic data and real cases from a telecommunication firm demonstrate the effectiveness of SoFi and comprehensive quality of mined process models in terms of replay fitness, accuracy, generalization, and simplicity.
HTML  下载PDF全文  查看/发表评论  下载PDF阅读器
 

京公网安备 11040202500064号

主办单位:中国科学院软件研究所 中国计算机学会
编辑部电话:+86-10-62562563 E-mail: jos@iscas.ac.cn
Copyright 中国科学院软件研究所《软件学报》版权所有 All Rights Reserved
本刊全文数据库版权所有,未经许可,不得转载,本刊保留追究法律责任的权利