自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

雪落雪下,云卷云舒。

行云流水,周流不息。

  • 博客(1)
  • 资源 (1)
  • 收藏
  • 关注

转载 linux下i386,i486,i586,i686的区别

linux下查看gcc版本gcc -v输出结果中Target: i486-linux-gnui486应该是虚拟机的问题,现在主流cpu应该均为i686.i386,i486,i586分别是针对80386,80486,80586编译的包,i686就比较广泛了,从p2开始x86处理器就进入了p6构架的时代,一直到现在都是p6架构。新架构的cpu向下兼容为旧架构编译的软件包.

2010-01-09 09:46:00 592

chinesetokenize中文分词

1. 识别率达到85%以上。虽然和专业分词系统相比有一定的差距,但对于中型搜索引擎分词需求而言足够了。<br><br>2. 对于前后歧义有较好的识别效果。如,<br><br>成都市场报刊 -- 成都 / 市场 / 报刊<br><br>中国和服装饰公司 -- 中国 / 和服 / 装饰 / 公司<br><br>我的MSN是[email protected],有事找我 -- 我 / 的 / MSN / 是 / [email protected] / 有事 / 找 / 我<br><br>3. 标点符号自动过滤,包括ASCII和Unicode标点。<br><br>4. 自定义噪音词(不知道怎么翻译这个词StopWords,平时都说英语的,叫噪音词吧),可手动加入噪音词。<br><br>5. 内置13万优选的基本词库,已进行加权值整理,并提供编程接口任意扩充。<br><br>6. 轻量级的分词组件,仅1个DLL文件,无需安装注册,发布简便。开发更简单,只需要一行代码调用即可。<br><br>7.采用优化算法,加载速度非常快,13万的词库加载与分词仅需0.7秒(首次分词时需要加载词库,在我的笔记本迅驰1代1.4G上测试),之后每次分词(100字内)的速度在0.01秒以内,一般看不见用时,比如分词:<br><br>关于那些残忍图片,我不想再发了!!我是彻底愤怒了!!有网友强烈呼吁找出此人, <br>下面是我找到的一些资料!!!(我是新人,没有任何的道具,希望有前辈能帮忙多放气球)<br><br>--分词结果--<br>关于 / 那些 / 残忍 / 图片 / 我 / 不 / 想 / 再 / 发 / 了 / 我 / 是 / 彻底 / 愤怒 / 了 / 有 / 网友 / 强烈 / 呼吁 / 找出 / 此人 / 下面 / 是 / 我 / 找到 / 的 / 一些 / 资料 / 我 / 是 / 新人 / 没有 / 任何 / 的 / 道具 / 希望 / 有 / 前辈 / 能 / 帮忙 / 多 / 放 / 气球<br><br>分词用时:00:00:00 000<br><br>(内附DLL和Winform示例程序,及示例程序的源码) <br><br>

2008-05-23

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除