資料的截取與邏輯判斷 - Linux

Doris avatar
By Doris
at 2018-06-26T21:26

Table of Contents

我現在正在處理一些有關於生物資訊的資料

基本上的資料格式長這樣
ID A_1 A_2 B_1 B_2 ……
1 0/0 0/0
2 0/0 ./.
3 ./. ./.
4. 0/0 0/1
5. 1/1 0/1
6. 0/1 0/1
……

接著我想要做幾件事情
依據相同字母的樣本(像是A_1和A_2)
逐列統計四種欄位的數量
1. A_1和A_2相同
2. A_1和A_2都一樣是./.
3. A_1和A_2不一樣
4. 以及任一樣本含有./.的欄位數量
以上表為例
A_1和A_2相同的數量是3 (ID1, 3, 6)
兩行數值都是./.的數量是1
A_1和A_2不同的列有3 (ID2, 4, 5)
有任一行數值為./.的數量為2 (ID2, 3)
然後統計成四個數值這樣並輸出

不過有問題的部分是要如何擷取含有特定字串的兩欄
並逐行進行邏輯判斷?

我知道可以利用awk逐行進行擷取並用grep計算數量並輸出 (不過awk和grep的管線順序還沒參透)
但要如何依據相同字母擷取特定行就不清楚了
想問有甚麼指令可以針對首列帶有特定字串的行進行擷取?

--
Sent from my Windows

--
Tags: Linux

All Comments

Gary avatar
By Gary
at 2018-06-29T08:06
看需求好像是針對行去做判斷, awk 應該可以做到. 類似這樣:
Anthony avatar
By Anthony
at 2018-07-01T14:59
awk '{if ($2 == $3){print $0}}'
Hamiltion avatar
By Hamiltion
at 2018-07-02T17:02
可以判斷兩值關係, 但如果要弄成較友善的資料格式還是建議
Olive avatar
By Olive
at 2018-07-04T05:52
使用其他程式語言會比較快XD
Leila avatar
By Leila
at 2018-07-05T13:47
這個用 python 搭配 pandas 處理會很快,學點其他語言
Heather avatar
By Heather
at 2018-07-07T14:51
不過現在我還只是linux新手 其他的程式語言只有R
Lucy avatar
By Lucy
at 2018-07-10T11:34
linux的幾個程式只是堪用,不是很好用。字串處理還是用
別的語言做會方便、好做很多,也比較查得到資料
Audriana avatar
By Audriana
at 2018-07-12T13:56
剛剛試用了一下pandas 可以依據欄位名擷取資料
Anonymous avatar
By Anonymous
at 2018-07-16T13:10
但要如何邏輯判斷並令存檔案就是另一個問題
Charlie avatar
By Charlie
at 2018-07-19T16:00
請看官方的文件,data frame 是很單純事情

尋找空的資料夾或是非空的資料夾?

Ina avatar
By Ina
at 2018-06-21T10:11
不知道程式怎麼寫的 有一個帳號下面貌似出現大量空白資料夾 但是沒辦法確認這些資料夾內容 直接使用 du -sh 檢查的話有看到佔用空間約 1.4G 但是由於資料夾數量龐大 而且分很多層 不知道這個空間是空的資料夾堆積起來的大小 還是裡面真的有東西 目前找到的都是搜尋空的資料夾 ex. find /tmp - ...

請問現在 Manjaro 安全性還是很低嗎?

Joe avatar
By Joe
at 2018-06-20T20:58
除了以前他們什麼認證因為某些原因過期的問題 看了網路上某些開發者認為他們存在最大的問題 那就是安全性更新因為他們的更新方式導致問題 安全性更新並沒辦法像其他發行版即時得到更新 但最近看了他們開發團隊變更了安全性更新流程 重要的安全性更新會直接進到 Stable Branch裡 而那位叫 Allen 的開發者也 ...

GTK+ UVC Viewer(Guvcview) Snap 軟體包

Ivy avatar
By Ivy
at 2018-06-19T18:47
經過數週的開發與測試,我很高興地宣佈GTK+ UVC Viewer(即 Guvcview)的非官方Snap 軟體包的打包工作已經告一段落。 https://snapcraft.io/guvcview Guvcview為一套由Paulo Assis所開發的USB影像類別(USB Video Class(UV ...

如何關閉 crontab 觸發 mail

William avatar
By William
at 2018-06-19T15:04
各位好,crontab 如果沒有指定 output,則當有訊息 output 的時候他會觸發 mail 寄信給 root 而 root mail 沒有指定的話會變成 maildrop,吃掉很多硬碟空間 但發現即便 output 有指定到 /dev/null,該 crontab 本身有 echo 內容的話也會觸 ...

要如何查資料夾所有文件檔裡面的特定字

Blanche avatar
By Blanche
at 2018-06-19T13:08
請問可以用什麼指令所以查詢特定資料夾裡面所以文字檔的特定字呢? 而文字檔有可能有txt, 或者沒有副檔名, 然後也可以查pdf file. - ...