由發明人或研究負責人組織的 Google 和 Microsoft 搜尋專利精選檔案。每個軌跡追蹤一名工程師的專利系譜,讓讀者看到研究線程如何通過延續、分割申請和授予而演進。專利帶有他們觸及的排名介面標註:查詢理解、排名、檢索、行為信號、知識圖或 AI 搜尋。
按發明人的專利軌跡
- 65 Google Patents to Help You Understand How Search Engines Work! (69 項專利) — Google 提交的基礎和高級專利的精選集合。
- Steven Baker — Google Search Patents (49 項專利) — Google 研究員 Steven D. Baker 的 49 項授予搜尋引擎專利加 2 項已發佈應用,涵蓋查詢理解(同義詞、n-gram、地理、跨語言)、查詢精煉、有意義的停用詞檢測、回答段落評分(精選片段)、查詢文檔相似度、列表共現和基於嵌入的個人化搜尋。
- Amit Singhal — Google Search Patents (22 項專利) — Amit Singhal(Google 搜尋前副總裁,2000-2016)的 22 項搜尋引擎專利,涵蓋交錯和結果組合、查詢重寫、語義查詢理解、連結品質評分、位置感知排名、語言和國家偏差、商業意圖檢測和廣告投放。8 項有意義停用詞系列與 Steven Baker 共同發明,在 Steven Baker 部分記錄以避免內容重複。
- Prabhakar Raghavan — Google Search Patents (16 項專利) — Prabhakar Raghavan(Google 搜尋負責人 2020-2024,前 Yahoo 副總裁和 IBM Almaden 研究科學家)的 16 項搜尋/信息檢索專利,涵蓋個人化 PageRank、網絡社區檢測、自適應排名、多引擎結果合併、分層分類、子空間聚類、信息過濾、可定製導航、用戶生成內容曝光、來自旅行模式的位置品質信號和時間元數據分析。跨越他的 IBM、Yahoo 和 Google 研究。
- Nitin Gupta — Google Search Patents (32 項專利) — Nitin Gupta(Google 搜尋品質工程師)的 32 項搜尋/SEO 專利,涵蓋查詢建議和範本、重新排名和個人化、回答生成神經網絡、內容知識生成、最新 2026 年生成搜尋檢索專利適用於 AI Overviews 時代,以及關於域名和網站的直接 SEO 專利。最後 5 項專利與 Steven Baker 共同發明,在他的部分記錄以避免內容重複。
- Navneet Panda — Google Search Patents (15 項專利) — Navneet Panda(Google 工程師,其內容品質工作成為 Panda 演算法更新的基礎)的 15 項搜尋品質專利,涵蓋網站品質評分、在行為數據積累前預測網站品質、按綜合相關性和網站品質信號排名搜尋結果、網站持續時間績效、本地顯著查詢、查詢修訂和圖像概念學習。
- Anand Shukla — Google Search Patents (16 項專利) — Anand Shukla(Google 搜尋品質工程師)的 16 項搜尋/信息檢索專利,包括尖端 2024 年「帶有狀態聊天的搜尋」專利,該專利將經典搜尋與基於 LLM 的對話搜尋連接。也涵蓋深度文章曝光、查詢模式匹配、查詢主題映射、內容頻道策劃和增強搜尋源系列。最後 3 項專利與 Steven Baker 共同發明,在他的部分記錄關於個人化源嵌入工作。
- Krishna Bharat, Google Search Patents (48 項專利) — Krishna Bharat(Google News 創始發明人和 Hilltop 演算法創建者)的 48 項搜尋引擎專利,涵蓋 Hilltop 連結分析演算法、帶有實體檢測的查詢重寫、查詢中的語義單位、查詢和搜尋增強、按使用統計的文檔排名、新聞搜尋圖像選擇、編輯意見排名、搜尋引擎覆蓋估計、查詢特定書籤和實體感知廣告渲染。跨越 2001 至 2024 年。
- Srinivasan Venkatachary, Google Search Patents (25 項專利) — Srinivasan Venkatachary(Google 搜尋工程師,搜尋結果生成摘要專利系列共同發明人,該系列支持 AI Overviews 和搜尋生成體驗)的 26 項搜尋工程專利。也涵蓋基於用戶興趣的增強搜尋源、候選回答段落評分、回答段落的上下文評分調整、隱含問題查詢識別、基於關鍵字的對話語音搜尋、通過文檔結構相似度生成查詢、有機和結構化內容的資源識別、內容頻道策劃和表情符號分類器。跨越 2013 至 2025 年。
- Jeromy William Henry, Google Search Patents (25 項專利) — Jeromy William Henry 的 25 項搜尋引擎專利,涵蓋知識面板(搜尋結果旁的實體卡片)、結構化實體信息頁面(獨立實體細節介面)、個人化實體信息頁面、SERP 圖像大小調整和音樂搜尋次級連結呈現。他語料庫中的每項專利都與 SEO 相關。跨越 2013 至 2025 年。
- Ramanathan V. Guha, Google Search Patents (33 項專利) — Ramanathan V. Guha(Schema.org 共同創始人和 Google Custom Search Engine 主要發明人)的 33 項搜尋引擎專利,涵蓋可程式化搜尋引擎系列、基於信任的搜尋排名、可程式化上下文的垃圾檢測、社交信號傳播、搜尋結果分類、自定義網絡摘要、按用戶標註過濾、通過查詢交集的上下文搜尋、查詢識別和生成任務 UI 系列。跨越 2003 至 2019 年。
- Marc Najork, Google Search Patents (25 項專利) — Marc Najork 的 25 項搜尋/信息檢索專利,跨越他的 Microsoft Research 時代(網頁爬蟲架構、抗垃圾排名、內容評估、超連結數據庫)和他的 Google 時代(表單信息提取、機器學習驅動的語義相似度、主動學習、文檔活動日誌用於相關性培訓)。包括與 65 Google Patents 集合交叉列表的基礎性文檔活動日誌專利。跨越 2005 至 2025 年。
- Jeffrey Dean, Google Search Patents (78 項專利) — Jeffrey Dean(Google 高級研究員和首席科學家、Google Brain 共同創始人、MapReduce 和 BigTable 的架構師)的 78 項搜尋和信息檢索基礎設施專利,包括基礎性文檔評分系列(查詢分析、內容更新、起始日期、基於連結的條件)、歷史數據專利(與 65gp 交叉列表)、錨點標籤索引、通過 Tokenspace 的內容片段、近重複和鏡像主機檢測、主題漂移預防、分佈式機器學習模型以及使網絡規模搜尋成為可能的基礎 MapReduce 和 BigTable 基礎設施。跨越 2000 至 2025 年。
- Paul Haahr, Google Search Patents (63 項專利) — Paul Haahr(長期任職 Google 搜尋排名工程師)的 63 項 Google 搜尋和排名專利,涵蓋規範連結品質專利(Bharat/Singhal/Haahr「確定連結文檔的品質」)、文檔分類排名、節點獨立反 PBN 信號、謠傳品質測度專利(與 65gp 交叉列表)、多階段查詢處理管道、評估網絡搜尋評分函數的框架(他 SMX 演講的文件支撐)、首選網站、參考上下文、圖像合成描述性文本和多系列查詢精煉和停用詞檢測集群。與 Singhal、Dean、Bharat、Cutts、Henzinger、Simon Tong 和 Acharya 共同撰寫。跨越 2008 至 2019 年。
- Hyung-Jin Kim, Google Search Patents (23 項專利) — Hyung-Jin Kim 的 23 項 Google 搜尋和排名專利,是 Navboost / 隱式反饋排名系列的主要發明人(US 8,661,029 + 5 個延續至 US 11,816,114 至 2023 年有效 IP),該系統在 2024 年 DOJ Google 反壟斷訴訟中曝光。也涵蓋呈現偏差模型、時間評分調整、文檔變更排名、用戶群組分組、相似查詢借用、變種泛化查詢、傳播查詢分類和交叉列表品質測度專利(與 Paul Haahr、65gp pat-48)。與 Simon Tong、Noam Shazeer、Michelangelo Diligenti、Adrian Corduneanu、Henele Adams、Andrei Lopatenko 共同撰寫。申請 2006-2021 年。
- Pandu Nayak, Google Search Patents (13 項專利) — P. Pandurang Nayak(Google 搜尋首席科學家)的 13 項 Google 搜尋專利,涵蓋從 2003-2015 年的查詢修訂和查詢理解堆棧:多個查詢修訂模型整合、信心評分修訂、已知高排名查詢借用、概念上下文替換、短語限制同義詞、點擊驅動同義詞識別、首字母縮略詞擴展。與 David R. Bailey、Ben Gomes、Trystan Upstill、Kedar Dhamdhere、Thomas Strohmann 共同撰寫。他的神經時代貢獻(RankBrain、BERT、MUM、DOJ 證詞)故意不獲專利,存在於博客文章和審判記錄中。
- Daniel Egnor, Google Local Search Patents (20 項專利) — Daniel Egnor(Google Maps / Local Pack 排名層架構師)的 20 項 Google 本地搜尋和地理相關專利,是 US 8,046,371「基於位置顯著性評分本地搜尋結果」的主要發明人,這項專利在 Google 官方本地搜尋排名文檔中定義「顯著性」因素。也涵蓋位置敏感排名(與 Amit Singhal 的相關性因素)、地理相關索引、歧義地理參考解決、權威文檔識別、商業列表分類和 GIS 歧義搜尋處理(與 Keyhole 創始人 John Hanke)。與 Singhal、Haahr、Greenfield、John Hanke 共同撰寫。申請 2003-2019 年。
- Yossi Matias, Google SERP Features & Assistant Patents (47 項專利) — Yossi Matias(Google 工程副總裁)的 47 項 Google 專利,是基礎人們也問專利 US 9,213,748「為搜尋查詢生成相關問題」的主要發明人。構建自動完成(2004)、趨勢、天氣/運動/字典 OneBoxes。涵蓋人們也問系列、知識面板實體支架(分組相關實體、中心實體識別、事實估計、文本實體屬性、實體引用搜尋)、趨勢/分析層(競爭活動分析、圖形可視化排名)、Duplex 自動通話基礎設施、個人化聊天機器人和 LLM 輸出蘊含專利,支持 Google Assistant 的 2024-2026 生成時代以及上下文/第三方 SERP 功能。與 Yaniv Leviathan(Duplex)、Gal Chechik、Ziv Bar-Yossef、Eyal Segalis、Avinatan Hassidim 共同撰寫。申請 2013-2026 年。
- Andrei Broder, Cross-Vendor Search Patents (25 項專利) — Andrei Broder(跨供應商發明人,在 DEC/AltaVista 塑造近重複檢測、在 Compaq 共同發明基礎 CAPTCHA、構建 AltaVista 網頁排名系統、在 IBM 撰寫網頁衰減信號、在 Yahoo 塑造廣告匹配/SERP 功能/CAPTCHA 進化基礎設施)的 25 項搜尋引擎和信息檢索專利。是基礎 MinHash/shingling 專利(US 6,349,296)、指紋碰撞概率技術(US 5,974,481)、文檔相似性 shingling 專利(US 6,230,155)和基礎 CAPTCHA 專利(US 6,195,698)的主要發明人。跨越 1999 至 2024 年。
- Monika Henzinger, Google Search Patents (50 項專利) — Monika Henzinger(Google 首任研究總監)的 98 項搜尋和信息檢索專利。基礎近重複頁面檢測專利(US 6,138,113,與 Dean 共同發明)和廣泛文檔評分系列(查詢分析、內容更新、起始日期、基於連結的條件、歷史數據,全部與 Dean 的規範文章交叉列表)的共同發明人。獨立貢獻:與 William Pugh 的重複文件檢測系列、AltaVista 連接服務器、連接性和內容排名專利、文檔新鮮度確定、語義距離排名、查詢語義信息排名、錨點文本跨語言信息檢索、上下文搜尋、超文本瀏覽器助手和使用統計驅動的文檔檢索。跨越 1997 至 2017 年。
- Trystan Upstill, Google Site-Quality & HCU-Era Search Patents (28 項專利) — Trystan Upstill 的 28 項 Google 搜尋和排名專利。是 Panda 專利(US 9,135,307 = 65gp pat-39)的共同發明人和 HCU 時代後續專利 US App 2019/0155948「基於分類品質重新排名資源」的主要發明人,該專利錨定 Panda 後網站品質系線。也涵蓋權威結果發現、搜尋結果排名和重新評分、關聯域檢測、網站地址中的資源屬性提取、本地搜尋和 POI 識別、同義詞和查詢重寫、導航意圖資源、連結上下文語言識別以及最近的 LLM 時代 UI 組件專利。申請 2012-2026 年。
- Susan Dumais, Microsoft IR & Search Patents (18 項專利) — Susan Dumais(Microsoft 技術研究員和 Gerard Salton 獎得主)的 61 項搜尋和信息檢索專利。是基礎潛在語義索引專利(US 4,839,853,Bellcore 1989)的共同發明人,該專利是每個密集嵌入檢索系統的概念祖先。在 Microsoft Research 她的工作涵蓋自動 SERP 滿意度測量、偏好判斷點擊模型、基於活動的上下文排名、時間感知排名與時間動態、個人化導航和搜尋結果、按用戶的領域專業知識確定、網頁變更 × 重新訪問新鮮度、隱含設備相關查詢改寫、權威排名。跨越 1989 至 2026 年。共同作者包括 Jaime Teevan、Eric Horvitz、Ryen White、Adam Fourney、Joshua Goodman、Eric Brill。
- Christopher Burges, Microsoft Research Learning-to-Rank Patents (16 項專利) — Christopher J. C. Burges(Microsoft Research 科學家,發明 RankNet/LambdaRank/LambdaMART 學習排名系線的科學家)的約 30 項獨特美國發明(WIPO 語料庫 84 條目)。RankNet(US 7,689,615)是成對神經排名器;LambdaRank(US 7,617,164)是優化 NDCG 的任意成本擴展;LambdaMART(US 12/032,697)是贏得 Yahoo LTR 挑戰 2010 的梯度提升集合。也涵蓋行為可變性適應、網頁多圖分析、連結垃圾平滑、邊距樹提升、k-NN 概率估計。跨越 2001 至 2019 年。共同作者包括 Robert Ragno(LambdaRank)、Irina Matveeva、Timo Burkard。
- Eric Brill, Microsoft Research Search & NLP Patents (20 項專利) — Eric Brill(自然語言處理和搜尋科學家,以查詢拼寫檢查專利和有噪聲通道校正模型而聞名)的 20 項 Microsoft Research 專利。是 US 7,254,774「改進拼寫檢查的系統和方法」的主要發明人,基礎有噪聲通道查詢拼寫檢查專利。也涵蓋字符串對字符串拼寫更正轉換(US 7,290,209 / 7,366,983)、網絡搜尋中的行為可變性考慮(US 7,743,047)、流行度數據排名、挖掘網絡搜尋用戶行為、頁面偏差搜尋、成本效益問答組合以及用戶意圖發現。申請 2005-2010 年。
- Tomas Mikolov, Google word2vec Patents (2 項專利) — Tomas Mikolov 的 2 項基礎 Google 專利,涵蓋 word2vec,連續詞嵌入學習模型定義嵌入時代。與 Kai Chen、Greg Corrado 和 Jeff Dean 共同發明。US 9,037,464 是原始授予;US 9,740,680 是更廣泛聲明範圍的延續。兩項專利共享相同披露(申請 13/841,640),結合構成整個 word2vec 專利系列。概念上與 Dean 部分交叉列表(Dean 是共同發明人並從事更廣泛的 Brain/分佈式模型基礎設施)。
- Noam Shazeer, Google Transformer, MoE & Search Patents (18 項專利) — Noam Shazeer(估計完整投資組合為 120-150 項,已捕獲約 46 項 Google 專利)的大約 46 項已捕獲 Google 專利。基礎 Transformer 注意力架構(US 10,452,978 與 Vaswani、Polosukhin、Uszkoreit、Jones、Gomez、Kaiser、Parmar)、稀疏門控混合專家擴展方法(US 11,769,055 與 Dean、Hinton、Le、Mirhoseini)、Switch Transformer(US 12,093,829)和 Navboost 隱式反饋排名系列(US 8,661,029 與 Kim/Tong/Diligenti,交叉列表)的共同發明人。也涵蓋助手中的 LLM 回答生成、分佈式張量計算(GSPMD/Pathways)和 2008-2015 年前 Transformer 大規模機器學習排名基礎設施。跨越 2008 至 2025 年。
- Ashish Vaswani, Google Transformer, Attention-Based Vision & Fast Decoding Patents (6 項專利) — Ashish Vaswani 的 4 項已捕獲新規範文章加 2 項來自 Noam Shazeer 部分的交叉列表。基礎 Transformer 專利(US 10,452,978,交叉列表)的第一發明人。局部自注意計算機視覺專利(US 20210390410,HaloNet)的第一發明人,可將注意力縮放到長序列和圖像。MultiModel(US 20200089755,統一多任務多模態架構,是 MUM 和 Gemini 的結構祖先)、完全注意計算機視覺系統(US 20250292560,ViT 系線)和快速解碼離散潛數方法(EP 3732627,使 LLM 推理在搜尋規模延遲下經濟可行)的共同發明人。跨越 2017 至 2025 年。
- Jakob Uszkoreit, Google Transformer Architect, Universal Transformer & Vision Transformer Patents (6 項專利) — Jakob Uszkoreit 的 3 項新規範文章加 3 項來自 Vaswani 和 Shazeer 部分的交叉列表。「Attention Is All You Need」(US 10,452,978,交叉列表)的共同作者。Universal Transformer(US 10,740,433,自適應深度 Transformer,具有按令牌自適應計算時間)、可分解注意自然語言推理模型(EMNLP 2016,在前 Transformer 證明注意比較聚合替換遞歸的載體)和 Vision Transformer(ViT,ICLR 2021,補丁令牌化架構,錨定現代視覺搜尋和多模態基礎)的共同發明人。交叉列表涵蓋原始 Transformer、MultiModel(統一多任務多模態祖先 MUM/Gemini)和圖像 Transformer。跨越 2016 至 2021 年。
- Simon Tong, Google Click-Driven Ranking, Population Signals & Anti-Spam Patents (9 項專利) — Simon Tong 的 5 項新規範文章加 4 項來自 Kim、Shazeer 和 65 Google Patents 部分的交叉列表。Tong 與 Marc Pearson 和 Sergey Brin 在相關查詢排名專利(US 7,505,964)上是共同發明人,與 Pearson 在人口信息排名專利(US 7,454,417)上,在國家偏差(US 20040254932)上獨自,與 Bem/Harik/Levenberg/Shazeer 在前 Transformer 大規模機器學習排名基礎設施(US 7,222,127)上,與 Ghemawat/Piscitello/Cutts 在用戶文檔移除專利(US 8,417,697,個人黑名單和眾包垃圾信號的結構祖先)上。交叉列表涵蓋 Navboost 隱式反饋系列、CTR 作為排名因素專利、歷史數據專利和大數據集排名延續。跨越 2003 至 2017+ 年。
- Michelangelo Diligenti, Google Click-Data Quality & Implicit Feedback Patents (5 項專利) — Michelangelo Diligenti 的 2 項新規範文章加 3 項來自 Kim 和 65 Google Patents 部分的交叉列表。是檢測點擊垃圾專利(US 8,694,374,屬性偏差異常檢測饋送排名信號)和考慮用戶意圖的點擊模型(US 20120143789,意圖條件點擊加權)的發明人。他的 Navboost / 呈現偏差 / CTR 作為排名因素共同發明人身份(交叉列表)將他錨定在隱式反饋排名系列中。投資組合著重於點擊數據品質,原始用戶行為和它饋送的排名信號之間的層。跨越 2007 至 2019+ 年。
- Jaime Teevan, Microsoft Personalized Search & Search-Task Patents (5 項專利) — Jaime Teevan 的 4 項新規範文章加 1 項來自 Dumais 部分的交叉列表。與 Dumais 和 Horvitz 在基礎個人化搜尋專利(US 7,693,818)上是共同發明人,該專利針對按用戶資料向量重新排名全球候選對象。在搜尋任務識別(US 8,326,824,跨會話查詢聚類進多步驟任務)、重新查找對比新查找分類(US 8,756,219,穩定返回訪問之前點擊的結果)和微任務搜尋分解(US 10,062,103,將高級目標分解為可恢復微步驟)上是發明人。交叉列表涵蓋個人化導航(Dumais 規範)。跨越 2003 至 2018+ 年。
- Eric Horvitz, Microsoft Decision-Theoretic Search & Attention-Aware Information Delivery Patents (3 項專利) — Eric Horvitz 的 3 項新規範文章。Horvitz 是在不確定性下決策論排名(US 7,124,129,相關性作為概率分佈與預期效用選擇)、搜尋結果呈現中的成本效益推理(US 7,194,464,精選片段和 AI Overviews 的機制基礎)和注意感知主動信息傳遞(US 6,934,917,Discover、Now 卡和 AI 助手背後零查詢介面系線)上的發明人。跨越 2002 至 2006+ 年。
- Ryen White, Microsoft Search Behavior & Search-Trails Patents (3 項專利) — Ryen White 的 3 項新規範文章。White 是搜尋軌跡 / 成功路徑挖掘(US 7,904,440,排名以終止成功跨用戶軌跡的目標地址)、探索對比查找查詢階段分類(US 8,041,711,提供階段調整排名和結果格式)和跨會話任務延續(US 9,116,996,跨會話和設備將查詢縫合到一個持續任務)上的發明人。跨越 2007 至 2015+ 年。
- Azalia Mirhoseini, Google ML Infrastructure & Chip-Design Patents (3 項專利) — Azalia Mirhoseini 的 2 項新規範文章加 1 項來自 Shazeer 部分的交叉列表。是基於強化學習的芯片平面佈置專利(US 11,475,278,Nature 2021 論文,在數小時而不是數週內設計 TPU 平面佈置)和分佈式機器學習設備放置專利(arXiv 1706.04972,學習如何在 GPU/TPU 上分割大型模型以最小化培訓時間的強化學習控制器)的共同發明人。兩者都反饋到讓 Google 在搜尋規模提供 Transformer 排名的計算成本經濟中。交叉列表涵蓋基礎 MoE 專利(Shazeer 規範)。跨越 2017 至 2021+ 年。
- Arnold Overwijk, Microsoft Site Topical Authority Patent (1 項專利) — Arnold Overwijk 的 1 項規範文章。Overwijk 與 Li Xiong、Chuan Hu 和 Junaid Ahmed 是網站主題權威專利(US 20210004416,公式 A(s,t) = SR(s) * C(s) * T(s,t)^2,通過組合全球網站排名、點擊信號和平方按主題頁面共享明確量化按網站按主題權威)的共同發明人。現代專利文獻中主題權威最精確的數學表述。概念上與 Procopio(按作者按主題權威)和 Agent Rank(作者級聲譽,65gp pat-47)配對。
- Michael Procopio, Google Per-Author Per-Topic Authority Patent (1 項專利) — Michael Procopio 的 1 項規範文章。Procopio 是主題權威專利(US 8,458,196)的命名發明人。系統計算按(作者、主題)權威簽名:對於作者貢獻的每份文檔 d,求和(作者身份% * topic_weight);跨作者的所有文檔聚合以生成按作者按主題專業知識評分。「此人是此主題的權威」的數學量化,結構上是作者級別的 E-A-T 專業知識信號的基礎。連接到 Agent Rank(US 7,565,358,65gp pat-47,較早 Google 作者聲譽專利)和 Overwijk 的網站主題權威(US 20210004416)以形成分層權威模型。
- Ori Allon, Google Orion Query-Refinement Patent (1 項專利) — Ori Allon 的 1 項規範文章。Allon 是 Orion 查詢精煉專利(US 8,392,443)的共同發明人,與 Ugo Di Girolamo、Tomer Shmiel、Alexandre Petcherski 和 Tzvika Hartman。Orion 演算法源於 Allon 在 UNSW 的博士論文工作,在 2006 年被 Google 收購。專利生成語料庫挖掘的查詢精煉:給定查詢,從滿足查詢的文檔提取短語模式以生成排名精煉候選。「搜尋相關」、擴展 SERP 片段和人們也問系線的機制背後。於 2013 年授予。
- Corin Anderson, Google Reasonable Surfer (Foundational) Patent (2 項專利) — Corin Anderson 的 1 項新規範文章加隱含交叉列表至 65 Google Patents 集合。Anderson 是基礎合理衝浪者專利(US 7,716,225,與 Jeff Dean 和 Alexis Battle),2004 年申請授予,引入非均勻連結點擊概率加權按按連結特徵(錨文本、字體大小、位置、周圍上下文)。延續(US 8,117,209 在 65gp pat-45,US 9,305,099 在 2016)擴展相同模型。相同頁面上連結間的差異化 PageRank 流機制。
- Ashok Popat, Google OCR & Image-Text Indexing Patents (1 項專利) — Ashok Popat 的 1 項規範文章涵蓋 Popat 等人的翻譯啟發 OCR 研究(2009 年起;選擇顯示 OCR 文本的 US 8,675,012 專利系列)。方法論將 OCR 重新框架化為統計機器翻譯:圖像特徵作為源通道,字符序列作為目標,聯合解碼與通道和語言模型最大化轉錄品質。支持 Google Books 索引、Lens 文本捕獲、Drive PDF 搜尋以及每張網上圖像和信息圖背後的圖像邊界文本索引管線。
為什麼這樣組織
專利法按發明人和受讓人而非按主題集聚知識產權。按發明人分組可恢復敘事弧:Amit Singhal 十年的排名工作、Pandu Nayak 的 BERT 時代查詢處理、Krishna Bharat 的新聞排名系統。每個軌跡讀起來像是用權利要求語言寫的研究傳記。