李明衝進賈瀞雯辦公室時,手裡攥著一沓列印紙,手指都在發抖。
“成了!賈總,成了!”
賈瀞雯抬起頭:“什麼成了?”
“分散式索引!”李明把列印紙鋪在她桌上,“你看,測試資料!搜尋響應時間平均縮短了百分之五十!最快的時候能達到零點八秒!”
賈瀞雯拿起資料報告。
表格密密麻麻,但結論很清楚:新技術讓百度搜索的速度提升了一半。
“怎麼做到的?”她問。
“我們把索引徹底打散了。”李明在白板上畫圖,“以前是集中式索引,所有資料在一個大庫裡,查詢要遍歷整個庫。
現在是分散式,資料按關鍵詞首字母分片,存在不同的伺服器上。
查詢時,系統自動定位到對應的伺服器,只搜那一片資料。”
他頓了頓:“就像圖書館以前把所有書堆在一起,現在分門別類放不同房間。
找小說去A房間,找歷史去B房間,不用把所有房間都翻一遍。”
賈瀞雯看著資料,心裡一陣激動。
這意味著,百度的搜尋速度將達到一個新高度,甚至可能超過那家美國公司。
“穩定性呢?”她問。
“測了一週,沒問題。”李明說,“而且分散式架構更健壯。
一臺伺服器宕機,隻影響一部分資料,其他還能正常服務。
不像以前,主庫一掛,全癱。”
“太好了。”賈瀞雯站起來,“馬上部署,儘快上線。”
“等等。”李明說,“還有件事。
陳總昨天打電話,提了個新構想。
他說……光快還不夠,要更聰明。”
“什麼意思?”
“個性化排序。”李明翻開筆記本,“陳總說,現在的搜尋結果是基於全網資料,對所有使用者都一樣。
但不同使用者的需求不同。
比如搜‘蘋果’,程式設計師可能想找程式設計資料,果農可能想找種植技術,普通使用者可能想買水果。
如果能根據使用者的歷史行為,給每個人個性化的排序,體驗會更好。”
賈瀞雯思考著這個構想。
……但,進先很來起聽








