Agent 接入

把这个站接进你的 Agent

这个站的每一页都同时给人和机器准备了一份:一个 skill、几条 RSS、几个 JSON/CSV 数据集,以及每个详情页的 Markdown 孪生页。全部匿名、只读,不需要 API key,也不需要注册。

一共四条路

按「替你省多少事」从多到少排:

  • Skill——一份 Claude 风格的技能文件,告诉你的 agent 什么时候该来查这个站、查完怎么标注来源。
  • RSS——每新增一条记录就多一个 item,盯更新用它,不用爬全站。
  • JSON / CSV——辩论、政策、指标、视频以及一条跨域更新流的纯文件版本,全部带许可和回链。
  • Markdown 孪生页——每个辩论、政策、视频详情页都有一份去掉版式的 Markdown。

许可:sgai 自产内容(摘要、译文、分析)CC BY 4.0,署名并链接 sgai.md 即可;逐字原文(国会记录、演讲、字幕、政策原文)© 原权利人,仅供引用。条款:DATA-LICENSE

Skill(Claude Code)

装进 Claude Code:

mkdir -p ~/.claude/skills/sgai
curl -L https://sgai.md/skill/SKILL.md -o ~/.claude/skills/sgai/SKILL.md
curl -L https://sgai.md/skill/url-map.json -o ~/.claude/skills/sgai/url-map.json

重启会话,跑 /skills,列表里应该出现 sgai。这个 skill 本身不带数据——它只告诉 agent 该抓哪一页,并要求每个答案都链回 sgai.md 的具体页面。

装好之后可以这样问:

  • 「新加坡哪些部长在国会讲过 AI 安全?」
  • 「外国创始人在新加坡能申请哪些 AI 相关的政府资助?」
  • 「新加坡的 AI 治理框架和欧盟 AI Act 差在哪?」

RSS

updates.rss.xml 是每新增一条记录一个 item——辩论、政策、视频、创业公司都在里面。rss.xml 只发长文。

https://sgai.md/updates.rss.xml
https://sgai.md/rss.xml

两条都有分语言镜像,前缀分别是 /zh//ja//ko//zh-tw/。比如 https://sgai.md/zh/updates.rss.xml

JSON 和 CSV

文件 里面是什么
/data/index.json 数据集目录:每个文件的地址、当前条数和一句话说明。不知道从哪开始就先拿这个。
/data/records.json 全站带日期的记录,按入库时间倒序,跨域合并——想知道「最近新增了什么」查这个。
/data/debates.json 全部国会辩论记录:id、日期、类型、中英标题与摘要、议题、发言人、原始来源链接。
/data/policies.json 全部政策文件:id、日期、发布机构、中英标题与摘要、来源与 PDF 链接。
/data/tracker.json 六个观测维度的头条数字、排名锚点和指标行。
/data/videos.json 全部视频:讲者、机构、主题、YouTube 链接,以及四语摘要。不含字幕全文。
/data/debates.csv 辩论数据集的 CSV 版本,方便丢进表格或 notebook。

除 CSV 外,每个 JSON 都是同一个信封:schemaVersion 标结构版本,license 带着许可条款,正文在 countitems 里;每条记录还有 links.sgai——它在五种语言下各自的页面地址,引用时请链这个。完整接口定义见 openapi.json

取更新流里的第一条记录:

curl -s https://sgai.md/data/records.json | jq '.items[0]'

Markdown 孪生页

每个辩论、政策、视频详情页都有一份 Markdown 版本:把路径末尾的斜杠换成 .md 即可。内容一样,没有导航也没有样式,读起来更省 token,引用也更干净。

https://sgai.md/debates/written-answer-23654.md
https://sgai.md/ja/policies/nais-update-2026.md

llms.txt

llms.txt 是给模型看的简版站点地图;llms-full.txt 把每一页连同一句话描述全列出来。不知道该从哪查起,就先抓完整那份。

https://sgai.md/llms.txt
https://sgai.md/llms-full.txt

几条规矩

  • 署名,并链到你实际用的那一页,不要只链首页。
  • 数字、政策原文、引语,用之前先回到页面上标的 sourceUrl 核一遍。本站的摘要和译文由人和模型共同产出,出入以原始文件为准。
  • 遵守 robots.txt本站对 AI 检索类爬虫是全站放行的,这是有意为之。
  • 不要整站镜像。需要哪页抓哪页——数据每周都在变。

关于本站