“玉米的LD衰減速度大約是擬南芥的六到七成,這意味著如果用擬南芥的那套引數來跑玉米的資料,可能會遇到計算上的偏差,結果也會出現誤差。”
他指著其中一條曲線說,“所以遷移的第一步,是重新估計視窗大小。”
“這個不是憑經驗猜的,需要透過計算LD衰減半衰期來反推。”
他切換到下一張PPT,上面並列排著兩組熱圖,顏色深淺的分佈有明顯差異。
“左邊是首接用擬南芥引數跑出來的結果,右邊是重新估計後的結果。”
“左邊的圖裡訊號分佈比較分散,就像在一張不太清晰的地圖上尋找方向。”
“右邊的圖則呈現出更明顯的區域性聚集。這種區別,對後續的位點篩選有首接影響。”
教室裡有人拿出手機拍了螢幕,也有人低頭在本子上開始記錄。
林曉在講臺上走了一小步,換了個方向繼續講:“玉米、水稻、小麥,這三種作物我都跑過驗證。”
“玉米的LD衰減速度比較慢,視窗可以放大一些。”
“水稻的衰減快,視窗需要調小一些。”
“小麥的多倍體性質則帶來額外的位點冗餘,需要在模型裡做額外的權重衰減。”
看見下面的學生陷入沉思。
林曉試著問道:“我剛剛說到了權重衰減。”
“有沒有人知道,不同作物的權重衰減係數是怎麼確定的?”
到了這,前排的新生頓時眼睛都變得清澈了許多。
而後排的研究生雖然知道答案。
但他們本來就是來臥底的,自然不會出來自爆。
於是,林曉看著無人應答。
只好自顧自地回答了這個問題。
“第一步,根據群體的LD衰減曲線估算一個初始值。”
“第二步,跑一組小規模的交叉驗證,看不同取值下的預測穩定性。”
“第三步,選擇使結果穩定的中間值。”
“具體操作流程在《基因組遺傳大資料分析方法》的附錄部分有詳細的步驟說明。
頓時,教室裡響起一片翻頁和記筆記的聲音。
林曉沒有再往下走,也沒有刻意加快語速。
他翻到下一頁,開始展示一組玉米上的實際驗證資料。
他指著圖中兩條走勢逐漸分開的線條說:“預測訊號較強的分組和訊號較弱的分組在田間表型上呈現出了明顯的差異。”
”。了實證被中測觀間田際實在,異差號訊測預的料材組兩這“
”......證驗被面層型表在能還,測預能僅不合耦計統明說這“
”。程過證驗個這解拆細詳會們我,分部半後的課門這“
”。阱陷的意注要需中讀解果結及以,計設間田、準標組分、源來料資括包“
.....
。聲尾到來鐘分五十西
。間時眼一了看頭低曉林
”。裡這到熱先容的課節一第,了好“
”。段階導推式公進始開週下“
”。容關相習預前提家大議建“
。起響聲鈴
。了開離便課下了佈宣,問提人無見曉林
。靜安片一是還裡室教而
。來過應反人有於終,會一了過
”?是不“
”?熱是才這到“
”???嗎算不段那始開最那“








