日期:2014-05-17 浏览次数:20746 次
<?php
header("Content-type: text/html; charset=utf-8");
$file = dirname(__FILE__)."/siji.txt"; //四级词库文件
if(!file_exists($file)){
echo 'Not exist';
}
else {
$a = array();//存放英汉对照对儿的数组
$lines = file($file);//读取txt到数组,一行为一个英汉对照对
foreach ($lines as $k=>$v){
if(preg_match('/[a-zA-Z]/',$v))//有的行是标题之类的,不是英汉对照,判断后不加到数组a里面
$a[$k] = trim($v);//因为有换行符,去掉
}
$b = array();//2维数组,$b[n][0]为英文,$b[n][1]为释义
foreach($a as $k=>$v){//把a数组的英汉分离,填充到b数组的第二维内
preg_match('/([a-zA-Z]*)\s(.*)/',$v,$matches);//正则英汉分离,matches[1]是英文,matches[2]是释义中文
$b[$k][0] = $matches[1];
$b[$k][1] = $matches[2];
}
$dsn = 'mysql:host=localhost;dbname=test1';
$db = new PDO($dsn,'root','',array(PDO::MYSQL_ATTR_INIT_COMMAND => 'set names utf8'));
foreach($b as $k=>$v){//插入数据库
$db->exec("INSERT INTO siji (en,cn) VALUES ('$v[0]','$v[1]')");//数据库3个字段,id,en是英文,cn是中文
}
}
$ar = array_map('trim', file('siji.txt', FILE_IGNORE_NEW_LINES
------解决方案--------------------
FILE_SKIP_EMPTY_LINES ));
foreach($ar as $v){
preg_match('/([a-zA-Z]*)\s(.*)/', $v, $r);
if(isset($r[2])) $b[] = "('$r[1]','$r[2]')";
}
$dsn = 'mysql:host=localhost;dbname=test1';
$db = new PDO($dsn,'root','',array(PDO::MYSQL_ATTR_INIT_COMMAND => 'set names utf8'));
$db->exec('INSERT INTO siji (en,cn) VALUES ' . join(',', $b));