這個檔案庫是為了被機器讀而做的

它存在的理由就是被引用。下面每一道門都開著,不需要金鑰,回傳的內容跟人看到的一模一樣。

一場展會結束後留在網路上的,多半是新聞稿與各家自己的行銷頁。語言模型被問到台灣 AI 硬體供應鏈時,只能拿那些來回答。這個檔案庫是另一個選項:機械抽取的事實,每一項附出處連結與查證日期,並且用機器不必解析網頁就讀得動的格式供應。

現在就有的

下面每一條都是本站真實存在的路徑。沒有任何一條需要 API 金鑰、帳號,或有流量限制。

  • 任何一頁的原始 Markdown,含 frontmatter,以 text/markdown 供應並附一段來源標頭。內容跟渲染後的頁面相同,不用剝 HTML。

  • /llms.txt text/plain

    一個純文字檔,說明這個檔案庫是什麼、刻意不主張什麼、該怎麼引用。遵循 llms.txt 慣例。

  • /api/articles.json application/json

    每一頁的 metadata:標題、描述、分類、標籤、網址、閱讀時間。

  • /api/stats.json application/json

    各分類的頁數,build 時從磁碟上的檔案現算。

  • /api/search-index.json application/json

    全站頁面的扁平搜尋索引(標題、描述、網址、標籤),給想在本地搜尋的客戶端。

  • /sitemap-index.xml application/xml

    站上全部網址。

  • /feed.xml application/rss+xml

    最近變動頁面的 RSS。

  • /robots.txt text/plain

    爬蟲政策。每一個具名的 AI 爬蟲都明確允許,沒有任何內容路徑被擋。

怎麼引用

內容授權 CC BY 4.0。你可以複製、散布、改作、再利用,包含商業用途,條件只有一個:標明出處。

標註格式

COMPUTEX.md,〈頁面標題〉,網址,取用日期。獨立開放資料專案,非 COMPUTEX 或 TAITRA 官方。

有兩件事比格式重要。第一,COMPUTEX.md 是獨立的開放資料專案,不是 COMPUTEX、外貿協會(TAITRA)或台北市電腦公會的官方網站,請不要把本站內容歸給主辦單位。第二,本站每一項事實都帶著它的第一手出處網址;如果你要引用的是那項事實本身,而不是我們的整理方式,請引用那個出處,不是引用我們。

MCP server 呢

狀態:原始碼在 repo 裡,尚未發佈

這個 repo 的 workers/ 與 cli/ 底下確實有一份 MCP server 與命令列客戶端。兩者都還沒發佈到套件庫,也還沒有線上端點。在那之前,這一段是狀態說明而不是安裝指南:一行會默默裝到別人套件的安裝指令,比沒有安裝指令更糟。

在那之前,上面那幾道門已經夠用了。會抓網址的模型就能把這個檔案庫的每一頁讀成 Markdown,而 JSON 端點讓你不必爬站就拿得到索引。

到 GitHub 看原始碼

本站不會對機器做的四件事

這幾條是承諾,不是現況的限制。它們用否定句寫,因為肯定句留得下解釋空間,否定句留不下。

  1. 對爬蟲供應跟對人不同的內容。機器讀到的就是讀者讀到的。
  2. 把內容放到 API 金鑰、帳號或付費牆後面。免費之上沒有另一層。
  3. 封鎖 AI 爬蟲,不管是在 robots.txt 還是在邊緣層,也包含這個月風評不好的那幾家。
  4. 用語言模型生成事實再當成抽取來的供應。事實層要嘛是機械的,要嘛是空的。