亚洲av成人无遮挡网站在线观看,少妇性bbb搡bbb爽爽爽,亚洲av日韩精品久久久久久,兔费看少妇性l交大片免费,无码少妇一区二区三区

  免費注冊 查看新帖 |

Chinaunix

  平臺 論壇 博客 文庫
12下一頁
最近訪問板塊 發(fā)新帖
查看: 2735 | 回復(fù): 15
打印 上一主題 下一主題

[文本處理] 求助,awk文本處理 [復(fù)制鏈接]

論壇徽章:
0
跳轉(zhuǎn)到指定樓層
1 [收藏(0)] [報告]
發(fā)表于 2015-02-05 11:25 |只看該作者 |倒序瀏覽
本帖最后由 xiaoxiao_不想吃藥 于 2015-02-05 11:26 編輯

一個txt中有幾百行如下:
string1:abdla;string2: |09 08 06|;string3: |01|;string4: |02 ac bd 1f|;string5: |00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00|;
我想用awk處理成這樣string1:abdla;string2:\x09\x08\x06;string3:\x01;string4:\x02\xac\xbd\x1f;string5:\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00;
該怎么寫呢。

論壇徽章:
780
金牛座
日期:2014-02-26 17:49:58水瓶座
日期:2014-02-26 18:10:15白羊座
日期:2014-04-15 19:29:52寅虎
日期:2014-04-17 19:43:21酉雞
日期:2014-04-19 21:24:10子鼠
日期:2014-04-22 13:55:24卯兔
日期:2014-04-22 14:20:58亥豬
日期:2014-04-22 16:13:09獅子座
日期:2014-05-05 22:31:17摩羯座
日期:2014-05-06 10:32:53處女座
日期:2014-05-12 09:23:11子鼠
日期:2014-05-21 18:21:27
2 [報告]
發(fā)表于 2015-02-05 11:37 |只看該作者
回復(fù) 1# xiaoxiao_不想吃藥
  1. echo "string1:abdla;string2: |09 08 06|;string3: |01|;string4: |02 ac bd 1f|;string5: |00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00|;"|sed -r 's/\<[0-9a-f]{2}\>/\\x&/g;s/\||\s//g'
  2. string1:abdla;string2:\x09\x08\x06;string3:\x01;string4:\x02\xac\xbd\x1f;string5:\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00;
復(fù)制代碼

求職 : 機(jī)器學(xué)習(xí)
論壇徽章:
79
2015年亞洲杯紀(jì)念徽章
日期:2015-05-06 19:18:572015七夕節(jié)徽章
日期:2015-08-21 11:06:172015亞冠之阿爾納斯?fàn)?日期:2015-09-07 09:30:232015亞冠之薩濟(jì)拖拉機(jī)
日期:2015-10-21 08:26:3915-16賽季CBA聯(lián)賽之浙江
日期:2015-12-30 09:59:1815-16賽季CBA聯(lián)賽之浙江
日期:2016-01-10 12:35:21技術(shù)圖書徽章
日期:2016-01-15 11:07:2015-16賽季CBA聯(lián)賽之新疆
日期:2016-02-24 13:46:0215-16賽季CBA聯(lián)賽之吉林
日期:2016-06-26 01:07:172015-2016NBA季后賽紀(jì)念章
日期:2016-06-28 17:44:45黑曼巴
日期:2016-06-28 17:44:4515-16賽季CBA聯(lián)賽之浙江
日期:2017-07-18 13:41:54
3 [報告]
發(fā)表于 2015-02-05 11:42 |只看該作者
本帖最后由 zsszss0000 于 2015-02-05 11:46 編輯

awk 我不會處理這個問題,但是感覺這種字符替換的用sed挺方便的,LZ可以不?
  1. sed 's/|//g;s/\([0-9a-z][0-9a-z]\)/\\x\1/g' urfile
復(fù)制代碼
測試了下 我這個錯了

論壇徽章:
0
4 [報告]
發(fā)表于 2015-02-05 11:58 |只看該作者
sed 's/|//g;s/ /\\x/g' a

論壇徽章:
0
5 [報告]
發(fā)表于 2015-02-05 12:00 |只看該作者
回復(fù) 2# Herowinter
如果string: 15;string1: 78 1a 02 45;string2: |09 08 06|;string3: |01|;string4: |02 ac bd 1f|;string5: |00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00|; 只替換| 之間的內(nèi)容呢?

   

論壇徽章:
0
6 [報告]
發(fā)表于 2015-02-05 12:02 |只看該作者
回復(fù) 3# zsszss0000
只替換兩個 |  |之間的內(nèi)容,該怎么辦呢?



   

論壇徽章:
780
金牛座
日期:2014-02-26 17:49:58水瓶座
日期:2014-02-26 18:10:15白羊座
日期:2014-04-15 19:29:52寅虎
日期:2014-04-17 19:43:21酉雞
日期:2014-04-19 21:24:10子鼠
日期:2014-04-22 13:55:24卯兔
日期:2014-04-22 14:20:58亥豬
日期:2014-04-22 16:13:09獅子座
日期:2014-05-05 22:31:17摩羯座
日期:2014-05-06 10:32:53處女座
日期:2014-05-12 09:23:11子鼠
日期:2014-05-21 18:21:27
7 [報告]
發(fā)表于 2015-02-05 12:09 |只看該作者
回復(fù) 3# zsszss0000

awk一樣的,要精確指定替換2位的數(shù)字,就要加--re-interval,這種不涉及列操作的需求
用awk沒優(yōu)勢.
  1. echo "string1:abdla;string2: |09 08 06|;string3: |01|;string4: |02 ac bd 1f|;string5: |00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00|;"|awk '{gsub(/\<[0-9a-f]+\>/,"\\x&");gsub(/\||[[:space:]]/,"")}1'
  2. string1:abdla;string2:\x09\x08\x06;string3:\x01;string4:\x02\xac\xbd\x1f;string5:\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00;
復(fù)制代碼

論壇徽章:
145
技術(shù)圖書徽章
日期:2013-10-01 15:32:13戌狗
日期:2013-10-25 13:31:35金牛座
日期:2013-11-04 16:22:07子鼠
日期:2013-11-18 18:48:57白羊座
日期:2013-11-29 10:09:11獅子座
日期:2013-12-12 09:57:42白羊座
日期:2013-12-24 16:24:46辰龍
日期:2014-01-08 15:26:12技術(shù)圖書徽章
日期:2014-01-17 13:24:40巳蛇
日期:2014-02-18 14:32:59未羊
日期:2014-02-20 14:12:13白羊座
日期:2014-02-26 12:06:59
8 [報告]
發(fā)表于 2015-02-05 12:13 |只看該作者
本帖最后由 jason680 于 2015-02-05 12:24 編輯

回復(fù) 1# xiaoxiao_不想吃藥

$ awk -F' *\\|' '{for(n=2;n<NF;n+=2){$n=" "$n;$n=gensub(" ([^ ]+)","\\\\x\\1","g",$n)}print $0}' OFS="" FILE
string1:abdla;string2:\x09\x08\x06;string3:\x01;string4:\x02\xac\xbd\x1f;string5:\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00;


$ awk -F' *\\|' '{for(n=2;n<NF;n+=2){$n=" "$n;gsub(" ","\\x")}print $0}' OFS="" FILE
string1:abdla;string2:\x09\x08\x06;string3:01;string4:02\xac\xbd\x1f;string5:00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00;

   

求職 : 機(jī)器學(xué)習(xí)
論壇徽章:
79
2015年亞洲杯紀(jì)念徽章
日期:2015-05-06 19:18:572015七夕節(jié)徽章
日期:2015-08-21 11:06:172015亞冠之阿爾納斯?fàn)?日期:2015-09-07 09:30:232015亞冠之薩濟(jì)拖拉機(jī)
日期:2015-10-21 08:26:3915-16賽季CBA聯(lián)賽之浙江
日期:2015-12-30 09:59:1815-16賽季CBA聯(lián)賽之浙江
日期:2016-01-10 12:35:21技術(shù)圖書徽章
日期:2016-01-15 11:07:2015-16賽季CBA聯(lián)賽之新疆
日期:2016-02-24 13:46:0215-16賽季CBA聯(lián)賽之吉林
日期:2016-06-26 01:07:172015-2016NBA季后賽紀(jì)念章
日期:2016-06-28 17:44:45黑曼巴
日期:2016-06-28 17:44:4515-16賽季CBA聯(lián)賽之浙江
日期:2017-07-18 13:41:54
9 [報告]
發(fā)表于 2015-02-05 12:58 |只看該作者
本帖最后由 zsszss0000 于 2015-02-05 13:15 編輯
sed -r 's/\<[0-9a-f]{2}\>/\\x&/g;s/\||\s//g'

我想問一下,這里的\<\>表示什么含義?
是不是可以理解為\<\>之間的內(nèi)容必須是緊緊相鄰的呢?
我在sed and awk 101 hacks這本書中沒有見過這種用法
我的理解是和\b符號一致的,也就是是不是可以改寫為
sed -r 's/\b[0-9a-f]{2}\b/\\x&/g;s/\||\s//g'
回復(fù) 2# Herowinter


   

論壇徽章:
780
金牛座
日期:2014-02-26 17:49:58水瓶座
日期:2014-02-26 18:10:15白羊座
日期:2014-04-15 19:29:52寅虎
日期:2014-04-17 19:43:21酉雞
日期:2014-04-19 21:24:10子鼠
日期:2014-04-22 13:55:24卯兔
日期:2014-04-22 14:20:58亥豬
日期:2014-04-22 16:13:09獅子座
日期:2014-05-05 22:31:17摩羯座
日期:2014-05-06 10:32:53處女座
日期:2014-05-12 09:23:11子鼠
日期:2014-05-21 18:21:27
10 [報告]
發(fā)表于 2015-02-05 13:14 |只看該作者
回復(fù) 5# xiaoxiao_不想吃藥
  1. echo "string: 15;string1: 78 1a 02 45;string2: |09 08 06|;string3: |01|;string4: |02 ac bd 1f|;string5: |00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00 00|;"|awk -F'|' --re-interval 'NF>2{for(i=2;i<NF;i++)gsub(/\<[0-9a-f]{2}\>/,"\\x&",$i);gsub(/[[:space:]]/,"")}1'
復(fù)制代碼
您需要登錄后才可以回帖 登錄 | 注冊

本版積分規(guī)則 發(fā)表回復(fù)

  

北京盛拓優(yōu)訊信息技術(shù)有限公司. 版權(quán)所有 京ICP備16024965號-6 北京市公安局海淀分局網(wǎng)監(jiān)中心備案編號:11010802020122 niuxiaotong@pcpop.com 17352615567
未成年舉報專區(qū)
中國互聯(lián)網(wǎng)協(xié)會會員  聯(lián)系我們:huangweiwei@itpub.net
感謝所有關(guān)心和支持過ChinaUnix的朋友們 轉(zhuǎn)載本站內(nèi)容請注明原作者名及出處

清除 Cookies - ChinaUnix - Archiver - WAP - TOP