Agent 接入
把这个站接进你的 Agent
这个站的每一页都同时给人和机器准备了一份:一个 skill、几条 RSS、几个 JSON/CSV 数据集,以及每个详情页的 Markdown 孪生页。全部匿名、只读,不需要 API key,也不需要注册。
一共四条路
按「替你省多少事」从多到少排:
- Skill——一份 Claude 风格的技能文件,告诉你的 agent 什么时候该来查这个站、查完怎么标注来源。
- RSS——每新增一条记录就多一个 item,盯更新用它,不用爬全站。
- JSON / CSV——辩论、政策、指标、视频以及一条跨域更新流的纯文件版本,全部带许可和回链。
- Markdown 孪生页——每个辩论、政策、视频详情页都有一份去掉版式的 Markdown。
许可:sgai 自产内容(摘要、译文、分析)CC BY 4.0,署名并链接 sgai.md 即可;逐字原文(国会记录、演讲、字幕、政策原文)© 原权利人,仅供引用。条款:DATA-LICENSE
Skill(Claude Code)
装进 Claude Code:
mkdir -p ~/.claude/skills/sgai curl -L https://sgai.md/skill/SKILL.md -o ~/.claude/skills/sgai/SKILL.md curl -L https://sgai.md/skill/url-map.json -o ~/.claude/skills/sgai/url-map.json
重启会话,跑 /skills,列表里应该出现 sgai。这个 skill 本身不带数据——它只告诉 agent 该抓哪一页,并要求每个答案都链回 sgai.md 的具体页面。
装好之后可以这样问:
- 「新加坡哪些部长在国会讲过 AI 安全?」
- 「外国创始人在新加坡能申请哪些 AI 相关的政府资助?」
- 「新加坡的 AI 治理框架和欧盟 AI Act 差在哪?」
RSS
updates.rss.xml 是每新增一条记录一个 item——辩论、政策、视频、创业公司都在里面。rss.xml 只发长文。
https://sgai.md/updates.rss.xml https://sgai.md/rss.xml
两条都有分语言镜像,前缀分别是 /zh/、/ja/、/ko/、/zh-tw/。比如 https://sgai.md/zh/updates.rss.xml。
JSON 和 CSV
| 文件 | 里面是什么 |
|---|---|
/data/index.json | 数据集目录:每个文件的地址、当前条数和一句话说明。不知道从哪开始就先拿这个。 |
/data/records.json | 全站带日期的记录,按入库时间倒序,跨域合并——想知道「最近新增了什么」查这个。 |
/data/debates.json | 全部国会辩论记录:id、日期、类型、中英标题与摘要、议题、发言人、原始来源链接。 |
/data/policies.json | 全部政策文件:id、日期、发布机构、中英标题与摘要、来源与 PDF 链接。 |
/data/tracker.json | 六个观测维度的头条数字、排名锚点和指标行。 |
/data/videos.json | 全部视频:讲者、机构、主题、YouTube 链接,以及四语摘要。不含字幕全文。 |
/data/debates.csv | 辩论数据集的 CSV 版本,方便丢进表格或 notebook。 |
除 CSV 外,每个 JSON 都是同一个信封:schemaVersion 标结构版本,license 带着许可条款,正文在 count 和 items 里;每条记录还有 links.sgai——它在五种语言下各自的页面地址,引用时请链这个。完整接口定义见 openapi.json。
取更新流里的第一条记录:
curl -s https://sgai.md/data/records.json | jq '.items[0]'
Markdown 孪生页
每个辩论、政策、视频详情页都有一份 Markdown 版本:把路径末尾的斜杠换成 .md 即可。内容一样,没有导航也没有样式,读起来更省 token,引用也更干净。
https://sgai.md/debates/written-answer-23654.md https://sgai.md/ja/policies/nais-update-2026.md
llms.txt
llms.txt 是给模型看的简版站点地图;llms-full.txt 把每一页连同一句话描述全列出来。不知道该从哪查起,就先抓完整那份。
https://sgai.md/llms.txt https://sgai.md/llms-full.txt
几条规矩
- 署名,并链到你实际用的那一页,不要只链首页。
- 数字、政策原文、引语,用之前先回到页面上标的
sourceUrl核一遍。本站的摘要和译文由人和模型共同产出,出入以原始文件为准。 - 遵守
robots.txt。本站对 AI 检索类爬虫是全站放行的,这是有意为之。 - 不要整站镜像。需要哪页抓哪页——数据每周都在变。