這個檔案庫是為了被機器讀而做的
它存在的理由就是被引用。下面每一道門都開著,不需要金鑰,回傳的內容跟人看到的一模一樣。
一場展會結束後留在網路上的,多半是新聞稿與各家自己的行銷頁。語言模型被問到台灣 AI 硬體供應鏈時,只能拿那些來回答。這個檔案庫是另一個選項:機械抽取的事實,每一項附出處連結與查證日期,並且用機器不必解析網頁就讀得動的格式供應。
現在就有的
下面每一條都是本站真實存在的路徑。沒有任何一條需要 API 金鑰、帳號,或有流量限制。
- /raw/<分類>/<slug>.md text/markdown
任何一頁的原始 Markdown,含 frontmatter,以 text/markdown 供應並附一段來源標頭。內容跟渲染後的頁面相同,不用剝 HTML。
- /llms.txt text/plain
一個純文字檔,說明這個檔案庫是什麼、刻意不主張什麼、該怎麼引用。遵循 llms.txt 慣例。
- /api/articles.json application/json
每一頁的 metadata:標題、描述、分類、標籤、網址、閱讀時間。
- /api/stats.json application/json
各分類的頁數,build 時從磁碟上的檔案現算。
- /api/search-index.json application/json
全站頁面的扁平搜尋索引(標題、描述、網址、標籤),給想在本地搜尋的客戶端。
- /sitemap-index.xml application/xml
站上全部網址。
- /feed.xml application/rss+xml
最近變動頁面的 RSS。
- /robots.txt text/plain
爬蟲政策。每一個具名的 AI 爬蟲都明確允許,沒有任何內容路徑被擋。
怎麼引用
內容授權 CC BY 4.0。你可以複製、散布、改作、再利用,包含商業用途,條件只有一個:標明出處。
標註格式
COMPUTEX.md,〈頁面標題〉,網址,取用日期。獨立開放資料專案,非 COMPUTEX 或 TAITRA 官方。 有兩件事比格式重要。第一,COMPUTEX.md 是獨立的開放資料專案,不是 COMPUTEX、外貿協會(TAITRA)或台北市電腦公會的官方網站,請不要把本站內容歸給主辦單位。第二,本站每一項事實都帶著它的第一手出處網址;如果你要引用的是那項事實本身,而不是我們的整理方式,請引用那個出處,不是引用我們。
MCP server 呢
狀態:原始碼在 repo 裡,尚未發佈
這個 repo 的 workers/ 與 cli/ 底下確實有一份 MCP server 與命令列客戶端。兩者都還沒發佈到套件庫,也還沒有線上端點。在那之前,這一段是狀態說明而不是安裝指南:一行會默默裝到別人套件的安裝指令,比沒有安裝指令更糟。
在那之前,上面那幾道門已經夠用了。會抓網址的模型就能把這個檔案庫的每一頁讀成 Markdown,而 JSON 端點讓你不必爬站就拿得到索引。
到 GitHub 看原始碼本站不會對機器做的四件事
這幾條是承諾,不是現況的限制。它們用否定句寫,因為肯定句留得下解釋空間,否定句留不下。
- 對爬蟲供應跟對人不同的內容。機器讀到的就是讀者讀到的。
- 把內容放到 API 金鑰、帳號或付費牆後面。免費之上沒有另一層。
- 封鎖 AI 爬蟲,不管是在 robots.txt 還是在邊緣層,也包含這個月風評不好的那幾家。
- 用語言模型生成事實再當成抽取來的供應。事實層要嘛是機械的,要嘛是空的。