← 回成果库

免费文化内容源全景 · 诗歌(中/英/多国)+ 跨文化内容 · 全部实测版


一、结论先行(三句话)

1. 诗歌比音乐容易得多。 音乐有版权,只能拿 30 秒试听、必须联网求人;诗歌的经典部分全是公版(作者逝世 70 年以上),可以整本搬回家自己托管——所以最优解不是"找一个诗歌版 iTunes API",而是把数据一次性搬进自己仓库,从此永不掉线

2. 世界上不存在"一个按国家分类的世界诗歌 API"——这是本次最重要的发现,也是别人做不出来的地方。但可以用三段式拼装造出来:Wikidata 按国籍捞诗人 → Wikisource 按语种取原文 → Commons/Internet Archive 取朗读音频,三段全部实测可用、全部免 key、全部支持浏览器直连。这个拼装本身就是护城河。

3. "文化内容源"远不止诗歌。 实测跑通的还有:博物馆藏品图(4 家)、各国节日、各国菜、汉字笔顺动画、各国国歌音频、宗教典籍(犹太/伊斯兰)、各语种真人发音、公版有声书、CC 授权音频图片、日本/芬兰/北欧/美国国会图书馆的国家级馆藏——足够做出 10 个 musiccup 级别的小产品


二、先定标尺:什么叫"和 iTunes 一样好的源"

musiccup 好用,是因为 iTunes Search API 同时满足 5 条。下面所有推荐都按这 5 条打分,不满足的直接标出来,不含糊。

#标尺为什么是命门
免费、不用注册钥匙一旦要 key,就要后端藏 key,纯静态页做不了
支持 CORS(响应头有 Access-Control-Allow-Origin: *这是真正的分水岭。没有它,浏览器直接被拦,必须自建代理。很多"看起来能用"的 API 死在这一步
内容量够大几百条撑不起一个能反复玩的产品
能按国家/语言切分主席明确要"分类不同国家"
有能直接展示的东西(文本/图/音频)只有元数据 = 没得看没得听

> ⚠️ 一个反直觉的坑:HTTP 200 ≠ 能用。LibriVox、Deezer、ZenQuotes 三家实测都返回 200 且数据漂亮,但没有 CORS 头——放进网页会直接报错白屏。这类必须先自建一层代理才能用。本报告全部标注清楚。


三、诗歌层 · 三档

3.1 中文诗歌(4 个源全部实测可用)

内容免keyCORS推荐度
chinese-poetry(GitHub + jsDelivr CDN)全唐诗、全宋词、诗经、楚辞、论语、元曲、纳兰性德…约 30 万首*⭐⭐⭐⭐⭐ 首选
今日诗词 jinrishici随机古诗一句 + 出处 + 作者 + 分类标签中等*⭐⭐⭐⭐ 做"每日一句"最快
一言 hitokoto中文短句/诗词/文学摘句,可按类型筛*⭐⭐⭐ 氛围向
中文维基文库 zh.wikisource任意古籍全文(可直接取《静夜思》全文)极大*⭐⭐⭐⭐ 补全文用

实测调用(可直接粘进浏览器控制台):

`js

// 30 万首古诗,直接从 CDN 拉一整卷(无需后端、无需 key)

fetch('https://cdn.jsdelivr.net/gh/chinese-poetry/chinese-poetry@master/全唐诗/poet.tang.1000.json')

.then(r=>r.json()).then(d=>console.log(d[0])); // 实测返回 477KB,首条即李白

// 每日一句古诗

fetch('https://v1.jinrishici.com/all.json').then(r=>r.json()).then(console.log);

// 实测返回:{content:"挂席几千里,名山都未逢。", origin:"晚泊浔阳望庐山", author:"孟浩然", category:"古诗文-山水-庐山"}

`

> 🔴 工程建议(本报告最值钱的一条)不要把 jinrishici / hitokoto 当承重依赖。它们是个人/小团队维护的免费服务,随时可能限流或关停(本次实测中,quotable.iopoemist 两个当年很火的诗歌/名言 API 已经彻底死了)。

> 正解:把 chinese-poetry 的 JSON 一次性下载进 web/terminal/poemcup/data/,自己托管。诗歌是纯文本、体积小(全唐诗全量约 60MB,还可以只挑精选几千首做几百 KB)、且是公版无版权风险。音乐必须联网求人(版权),诗歌不必——这是诗歌产品结构上优于音乐产品的地方。

3.2 英文诗歌(2 个源可用)

内容免keyCORS备注
PoetryDB约 3000 首英文经典诗(莎士比亚/惠特曼/狄金森/弥尔顿…),支持按作者、按标题、按行数、随机*⭐⭐⭐⭐⭐ 英文诗的唯一好答案
Gutendex(古登堡计划 API)公版书目 + 全文下载链接,支持 languages= 按语言筛*⭐⭐⭐⭐ 是"书"不是"单首诗",需自己切分

`js

// PoetryDB:取狄金森全部诗作(实测 200KB,含 title/author/lines)

fetch('https://poetrydb.org/author/Emily Dickinson/title,author,lines').then(r=>r.json()).then(console.log);

// 随机 2 首

fetch('https://poetrydb.org/random/2').then(r=>r.json()).then(console.log);

`

> ⚠️ 诚实边界:PoetryDB 只有英文,且只覆盖公版经典(无当代诗人)。已死poemist(404)、quotable.io(域名失联)——网上很多"免费诗歌 API 列表"还在推荐它们,都是过时信息。

3.3 多国诗歌 —— 命门:没有现成的,得自己拼

我把能想到的角度都试遍了:不存在一个"按国家分类的世界诗歌 API"。原因是结构性的——诗歌高度依赖语言,没人有动力做跨语种的统一收口。

但可以自己拼一个出来,三段全部实测可用:

`

第一段:谁是这个国家的诗人?

→ Wikidata SPARQL(免key,CORS ✅)

SELECT ?poet WHERE { ?poet wdt:P106 wd:Q49757 ; # 职业 = 诗人

wdt:P27 wd:Q17 } # 国籍 = 日本(换 QID 即换国家)

实测 HTTP 200,返回标准 JSON

第二段:他的诗原文在哪?

→ 各语种维基文库 Wikisource(每个语种一个站,全部免key、CORS ✅)

zh.wikisource(中文)/ fr.wikisource(法语)/ ja.wikisource(日语)/ ru / de / es / ar …

实测:法语诗歌分类、中文《静夜思》全文,均 200 正常返回

第三段:有没有人朗读?

→ Wikimedia Commons(免key,CORS ✅)+ Internet Archive(免key,CORS ✅)

Internet Archive 的 LibriVox 公版有声书合集,可按 subject:poetry + language 筛

`

补充维度:

> 🔴 版权红线:多国诗歌能免费拿到的,几乎全是公版(作者逝世 70 年以上)。当代诗人(辛波斯卡、北岛等)没有合法免费源——遇到别硬找,标"受版权保护"即可,不要为了凑数去抓盗版站。


四、其他文化内容源 · 发散 14 类(全部实测)

这是主席问的"还有哪些其他文化类型的内容源头"。我按"能不能马上做成一个 musiccup 那样的小产品"排序,不是按学术分类。

#文化类型免keyCORS能做什么
1🎌 各国国歌 / 民族音乐Wikimedia Commons(Category:National anthems 音频文件)+ Internet Archive(78 转历史唱片、民乐合集)和 musiccup 最配:一个"国歌杯/民乐杯",全公版可完整播放(不像流行乐只能放 30 秒)
2🖼️ 博物馆藏品(书画/文物/服饰)大都会 Met芝加哥艺术学院克利夫兰艺术博物馆英国 V&A —— 四家全部免 key + CORS高清公版图 + 完整元数据(年代/产地/材质),能做"文物盲盒""朝代对比"
3🍜 各国饮食TheMealDB(filter.php?a=Chinese/Japanese/Indian… 原生按国家分类天然满足"分类不同国家",带成品图 + 菜谱
4🎊 各国节日/民俗Nager.Date(/PublicHolidays/2026/JP,覆盖 100+ 国家)"世界文化时钟"的骨架:今天哪个国家在过什么节
5✍️ 汉字书法 / 笔顺MakeMeAHanzi(含每个汉字的笔顺 SVG 路径 + 拆解 + 释义,实测 2.5MB 全量字典)让一首古诗一笔一划写出来的动画效果
6📜 宗教/哲学典籍Sefaria(犹太典籍,希伯来原文+译文)、AlQuran.cloud(古兰经,含中文译本)、ctext(中国哲学书电子化,需免费 key)✅※跨文明经典对读
7💬 各国名言/谚语Wikiquote(每个语种一个站,zh/en/ja/fr/de…)按语种即按文化圈切
8🗣️ 各语种真人发音Wikimedia Commons 的 Lingua Libre 录音库(数百语种母语者录音)听世界上的语言长什么样
9🎧 公版有声书/朗读Internet Archive 的 librivoxaudio 合集(可按 subject + language 筛)诗歌朗读音频的主力来源
10🎨 CC 授权图片/音频(通用)Openverse(Wikimedia 官方,图片 + 音频两条线)找配图配乐的万能兜底
11🏛️ 国家级数字馆藏Japan Search(日本)、Finna(芬兰)、DigitaltMuseum(北欧)、Library of Congress(美国)做"某国文化专题"的深水源
12📚 公版书全文Gutendex(古登堡)、Open Library、Internet Archive 全文检索民间故事、神话、史诗的来源
13🍸 饮品文化TheCocktailDB轻量趣味
14📖 词典/词源/发音FreeDictionary API(带音频发音)、Wikipedia REST 摘要 API任何内容的解释层兜底

要免费钥匙但值得注册的三家(注册 1 分钟,配额充足):

已死或不能浏览器直连(别踩)

实测结果处理
api.quotable.ioHTTP 000 域名失联❌ 弃用
poemist.com/apiHTTP 404❌ 弃用
xeno-canto v2404,官方提示 v2 已下线⚠️ 转 v3(需 key)
Gallica(法国国图)HTTP 403 拒绝⚠️ 需换 IIIF 接口
LibriVox 官方 API200 但无 CORS 头⚠️ 改走 Internet Archive(有 CORS)
Deezer / ZenQuotes200 但无 CORS 头⚠️ 需自建代理

五、发散:8 个可以直接开工的产品点子(接在 musiccup 旁边)

按"能不能明天就做出来 × 有没有人愿意反复玩"排序。

1. 诗歌杯 PoemCup(最直接,⭐⭐⭐⭐⭐)

完全复刻 musiccup 的玩法骨架,把音乐换成诗歌:两首诗对决,投票晋级,选出"你心中的第一名"。数据自托管(chinese-poetry + PoetryDB 下载进仓库),永不掉线。中文档 / 英文档 / 混合档三个赛道。

2. 国歌杯 / 世界民乐杯(和 musiccup 血缘最近,⭐⭐⭐⭐⭐)

Wikimedia Commons 的国歌和民乐录音全是公版,可以完整播放——比 iTunes 的 30 秒试听体验更好。而且天生带国旗、带国家,"分类不同国家"零成本满足。

3. 世界文化时钟(最有原创性,⭐⭐⭐⭐⭐)

四个 API 拼一个页面:Nager.Date 查出今天哪个国家在过节 → Wikidata 捞这个国家的诗人 → Wikisource 取一首他的诗 → TheMealDB 配一道这国的菜 → Commons 放这国的国歌。"今天是日本的海之日,配一首松尾芭蕉的俳句、一碗荞麦面、一段君之代。" 每天自动换,永不重复。这个组合我在公开产品里没见过。

4. 一首诗 = 一首歌(复用 musiccup 已有能力,⭐⭐⭐⭐)

拿诗人名或诗题去 iTunes Search API 搜——大量经典诗被谱过曲(《水调歌头》《静夜思》、莎士比亚十四行诗、叶芝)。诗的文字 + 歌的旋律并排,是 musiccup 的自然延伸,代码几乎不用改。

5. 一笔一划写古诗(视觉最惊艳,⭐⭐⭐⭐)

MakeMeAHanzi 有每个汉字的笔顺 SVG 路径。选一首五言绝句,20 个字按笔顺一笔一笔写出来,配一段古琴(Openverse CC 音频)。是纯前端动画,不依赖任何在线服务。

6. 跨文明同年横切(最有智识价值,⭐⭐⭐⭐)

拉一条时间轴:公元 800 年,唐朝在写什么诗 / 阿拉伯在写什么 / 欧洲在写什么 / 日本在写什么。用 Wikidata 按"生卒年 + 国籍"捞人,Wikisource 取文,博物馆 API 配同期文物图。回答一个没人正面回答过的问题:同一时刻,人类各处的精神生活长什么样。

7. 诗歌盲测杯(最有话题性,⭐⭐⭐)

真诗人的诗 vs AI 生成的诗,盲投。数据一半来自 PoetryDB/chinese-poetry,一半现场生成。既好玩,又是一个能拿到真实数据的小实验。

8. 世界语言听音辨国(轻量,⭐⭐⭐)

Commons 的 Lingua Libre 有数百语种母语者录音。放一段,猜是哪国语言。纯听觉,零文字门槛。


六、红队自审(我自己挑刺)

最强反对回应
"这些 API 今天能用,明天就可能死" —— 本报告自己就抓到 quotable / poemist / xeno-canto v2 三家阵亡成立,而且这是本报告的核心论点。所以第三节给出的工程建议是:诗歌类一律自托管(公版无版权风险、体积小),只有音频/图片这类体积大的才留在线调用。机构级源(Wikimedia、Internet Archive、Met、美国国会图书馆)稳定性远高于个人项目——优先选机构
"没有按国家分类的世界诗歌 API,那三段式拼装会不会太复杂做不成?"三段实测全部返回 200,技术上没有障碍;真正的成本在数据清洗(Wikidata 捞出的诗人未必都有 Wikisource 全文)。诚实预期:热门国家(中/日/法/德/英/俄)覆盖好,小语种覆盖差。建议先做 6-8 个国家,别一上来铺 100 国
"CORS 全绿 = 就一定能用?"不完全。CORS 只解决"浏览器不拦",还有限流(未测)和长期政策变化两个风险未覆盖。缓解:自托管 + 本地缓存
"多国诗歌只有公版,会不会内容都很老、没人爱看?"部分成立。公版 = 作者逝世 70 年以上。但李白、松尾芭蕉、波德莱尔、歌德、普希金全在公版内——经典诗歌的绝大部分本来就在公版里,这个约束比想象中松

可证伪锚(什么出现说明我判断错了):如果按本报告拼装"多国诗歌"时,Wikidata 捞出的诗人中能在对应 Wikisource 找到全文的比例低于 30%,则"三段式拼装可行"这个判断不成立,应退回到"逐国手工策展 200 首"的笨办法。


七、缺口(明确说清没做到什么)

1. 未测限流:所有源只测了单次请求成功,没测高频调用会不会被封。上线前需实跑一轮压力测试。

2. 未覆盖非洲/南美/南亚诗歌:这些地区的公版数字化程度低,Wikisource 站点内容稀薄。这是真实缺口,不是我没找

3. 中国当代诗(在世或逝世未满 70 年的作者)无合法免费源,已确认不硬凑。

4. Europeana / Smithsonian / ctext 三家只验证到"需要 key",未实际注册并验证数据质量

5. 未做去重:多个源可能收录同一首诗,实际做的时候需要一层去重。


附:完整实测日志

见同目录 2026-07-25_免费文化内容源_实测日志.txt(40 个源逐个 curl,记录 HTTP 码 / 响应体积 / CORS 头 / 完整 URL,时间戳 2026-07-25T10:34Z)。

证据等级:本报告全部源的"能否使用"判断 = E1(本机真实 curl 调用,有日志);"内容量级"部分为源方自报或抽样估算(如 chinese-poetry 约 30 万首),标 E2,未逐条清点。