有,而且我現在覺得,最可行的辦法不是想辦法讓我「登入 PEP-Web」,而是把 PEP-Web 在合法授權範圍內,變成一個我能讀、能檢索、能交叉比較的私人研究 corpus。
我們先前談過的障礙仍然存在:PEP-Web 是訂閱資料庫,我不能代文。但 PEP 官方目前明確提供一個非常重要的接口:訂閱者可以向 PEP 申請整個資料庫的 bibliography .refer 檔,約 20 MB,而且會隨主要版本更新。官方 FAQ 明說可透過 Help → “Provide Feedback” 索取。
所以我現在會把方案分成三層。
第一層,是完整的 PEP-Web「地圖」。
把官方 .refer bibliography 匯進我們先前做過的 SQLite/FTS 資料庫。如此一來,即使我沒有全文,至少可以知道 PEP 裡面有什麼:作者、年代、期刊、篇名、卷期、引用資訊等等。PEP 本身也支援 bibliographic export 和穩定 DOI/catalogue integration。
這一層其實已經很強。比如你問:
Kohut 1965–1981 年間,empathy、narcissism、selfobject 三個概念如何移動?
我可以先從數萬、數十萬筆 bibliography 中建立 Kohut corpus,再找引用鏈、同時代回應者、後來批評者,而不是 Google 式地只撞到幾篇最熱門文章。
第二層,才是全文層。
你本人合法訂閱 PEP-Web,在正常閱讀研究過程中下載你需要的 PDF/文章;這些你依法取得、供自己研究使用的檔案,可以放進我們的私人 corpus。
然後我就可以真正做:
全文搜尋 → 語義搜尋 → 概念歷史 → 引用網絡 → 不同學派對讀 → 年代變化。
例如,不只是搜尋 "analytic third",而是問:
Ogden 在 1980s–2020s 使用 third 時,究竟有哪幾種不同意思?
與 Jessica Benjamin 的 thirdness 哪裡真正重疊,哪裡只是同字異義?
Winnicott、Bion、Green 是否存在尚未命名的前史?
這就是我一直認為 AI 真正值得介入 PEP-Web 的地方。
不是「幫你找文章」。
而是把一百多年精神分析文獻變成一個可以縱向穿越的思想地層。
第三層,我現在反而覺得最值得爭取:直接問 PEP 是否願意提供研究用途的 machine-readable access。
我目前沒有找到 PEP 對一般訂閱者公開的正式全文 API;官方公開說得最清楚的是 bibliographic .refer。 因此,不宜假定存在一個我們偷偷就能接上的 API。
但是你這個用途不是一般 commercial scraping。
你要做的其實可以很正式地描述成:
AI-assisted scholarly research over a licensed personal PEP-Web subscription, without redistribution of copyrighted full text.
也就是:
PEP 保留全文控制權;
全文不公開、不重新散布;
只建立你的私人研究索引;
AI 讀取限於你合法授權的內容;
輸出是分析、引用位置與 bibliographic references,而不是把 PEP 文章整篇吐出來。
這樣的要求,在學術資料庫世界裡是完全可以談的。PEP 自己也強調大學圖書館訂閱的 catalogue integration 與 bibliographic interoperability。
因此,我現在最想做的,其實是把我們去年那個構想升級成:
Kelly’s PEP Research Layer
它不是 PEP-Web 的 pirated copy。
而是三層:
PEP bibliography(全域地圖)
↓
你合法取得的全文 corpus(私人圖書館)
↓
ChatGPT 作為 semantic / historical / conceptual research engine
這樣,我雖然仍然「進不了」PEP-Web 的門,卻可以逐漸擁有一張完整地圖,而且對你真正研究的區域,建立全文地形。
最重要的是,這條路可以累積。
例如我們今天研究 Ferenczi,就把 Ferenczi corpus 納進來;下星期研究 Winnicott,再加 Winnicott;之後 Kohut、Stolorow、Ogden、Benjamin、Bollas、Green、Laplanche……
久而久之,我們不是每次從 Google 重新開始。
而是逐漸形成一個你自己的:
150 years of psychoanalysis corpus。
而且它特別適合你先前說的那個目的:不是要我替哪一個精神分析學派護教,而是希望我讀 PEP-Web 這一百多年思想演化,看看精神分析為什麼掉進某些 attractor basins,以及哪些被遺忘的岔路其實還可以重新走。
我現在甚至覺得,我們去年做的 SQLite 版本只算 PEP Research Layer 0.1。真正值得做的是下一版:bibliographic graph + personal full-text semantic index + chronological concept tracing。那會開始真正接近你當初希望我「能使用 PEP-Web」的意思。