Top AI Repos — open-source AI, indexed and scored
Top AI Repos tracks AI repositories on GitHub and answers two different questions about each one: is it moving right now, and would you bet a product on it.
Top AI Repos tracks AI repositories on GitHub and answers two different questions about each one: is it moving right now, and would you bet a product on it.
last30days-cn 是一个 AI Agent 技能(Skill),能够自动搜索中国互联网 8 大主流平台最近 30 天的内容,综合分析后生成有据可查的研究报告。
| Date | Stars |
|---|---|
| 2026-07-31 | 1292 |
| 2026-08-02 | 1323 |
| 2026-08-06 | 1323 |
Today
— stars today
This week
— stars this week
This month
— stars this month
Momentum
0.0
growth rate 0.00%/day
<p align="center"> <img src="assets/banner.png" alt="last30days-cn — 中国平台深度研究引擎" width="900"> </p> <p align="center"> <b>简体中文</b> · <a href="README.en.md">English</a> </p> # 📰 last30days-cn — 中国平台深度研究引擎 > 🚀 30 天的研究,30 秒的结果。8 大平台。零过时信息。 **last30days-cn** 是一个 AI Agent 技能(Skill),能够自动搜索中国互联网 8 大主流平台最近 30 天的内容,综合分析后生成有据可查的研究报告。 🔗 本项目基于 [mvanhorn/last30days-skill](https://github.com/mvanhorn/last30days-skill) 进行深度本土化改造,完全面向中国用户和中文互联网平台。 🕷️ v2.0 集成 [MediaCrawler](https://github.com/NanmiCoder/MediaCrawler) 爬虫引擎思路,大幅减少 API Key 依赖。v2.1 修复百度/小红书反爬问题,XHR 拦截替代 DOM 解析,Bing 兜底搜索,已移除无效的 ScrapeCreators 小红书集成。 当前版本:`v3.2.0` 👤 **作者 / Author:** Jesse ([@Jesseovo](https://github.com/Jesseovo)) --- ## ✨ v3.2.0 优化内容 - 修复小红书新版搜索页只触发 `search/recommend` 联想词的问题:不再把 `sug_items` 当成笔记,而是按响应中的笔记卡片识别结果,并在必要时主动提交搜索框。 - Playwright 爬虫不再依赖固定的小红书 endpoint;平台改版时只要返回结构仍包含笔记卡片,仍可正常解析。 - 增加旧电脑兼容模式:可通过 `LAST30DAYS_BROWSER_PATH` 使用本机仍受系统支持的 Chromium/Chrome,也可用 `LAST30DAYS_DISABLE_BROWSER=1` 完全关闭浏览器并使用公开 API/搜索兜底。 - `--diagnose` 现在会显示浏览器模式、外部浏览器路径和路径是否存在,便于排查旧 macOS 的浏览器二进制兼容性。 - 版本升级至 `v3.2.0`,根目录脚本与 Agent Skills 安装载荷继续由 payload 检查保持同步。 ## ✨ v3.1.0 优化内容 - 修复中文平台日期统一按北京时间(CST)归档,避免非北京时间机器上的窗口边界偏移。 - 新增 CJK bigram 回退分词,`jieba` 变为可选增强,skill 可零硬依赖运行。 - 统一 HTTP 重试退避、Retry-After 解析和 debug URL 脱敏。 - 新增 payload 生成/漂移检查、版本单源、缓存接线和 GitHub Actions CI。 ## ✨ v3.0.0 升级内容 - 追平原版 v3 的 Agent Skills 包结构:`skills/last30days` 现在是可独立安装的运行载荷。 - 中文 CLI 统一使用单入口 `last30days.py`,根目录和 Skill 载荷保持同名结构。 - 新增 `--emit html` 和 `--emit html-path`,可生成离线可打开的 `report.html`。 - HTML 报告融入 [op7418/guizang-ppt-skill](https://github.com/op7418/guizang-ppt-skill) 的 Swiss/IKB 视觉语言,适合浏览、归档、打印。 - 小红书和知乎搜索增加空结果兜底说明,失败时会标注已尝试路径与可能原因。 - 抖音、头条在原生接口被风控时新增公开搜索引擎兜底,不再静默返回 0 条(见 issue #8)。 - 修复 macOS/Linux 下 `skills/last30days/SKILL.md` 损坏 symlink 导致的 `npx` 安装失败(见 issue #10)。 - 对照上游 [mvanhorn/last30days-skill](https://github.com/mvanhorn/last30days-skill) 同步若干平台无关能力:`--as-of` 历史回溯、跨平台聚合热点、`LAST30DAYS_DEFAULT_SEARCH`/`EXCLUDE_SOURCES` 配置开关、诚实 `--diagnose`(实时探测)、HTML 报告 XSS 加固。 - 根目录 `scripts/` 继续保留,方便本地开发和旧路径调用;Agent Skills 安装使用 `skills/last30days/scripts` 下的自包含载荷。 ### ✅ 发布验证 本次发布前已完成以下质检: - 远端发布 tag 统一为 `v3.2.0`,没有额外 v3 派生 tag。 - 根目录与 Skill 载荷均统一使用 `last30days.py` 单入口,没有额外入口文件。 - 全量测试通过:`python -m pytest tests -q`,共 `214 passed`。 - 根目录入口和 Skill 载荷入口均已验证:`py scripts/last30days.py --diagnose` 与 `py skills/last30days/scripts/last30days.py --diagnose` 均可正常输出平台可用性诊断。 --- ## ⚠️ 免责声明 / Disclaimer > **请务必仔细阅读以下内容。使用本项目即表示您同意以下所有条款。** ### 法律合规声明 1. **本项目仅供学习和研究目的**。所有爬虫功能仅用于技术学习与研究交流,**严禁用于商业用途**。 2. 使用者必须严格遵守中华人民共和国相关法律法规,包括但不限于: - 《中华人民共和国网络安全法》 - 《中华人民共和国数据安全法》 - 《中华人民共和国个人信息保护法》 - 《中华人民共和国反不正当竞争法》 3. 使用者必须遵守各平台的**服务条款(ToS)**和 **robots.txt** 规定。 4. **禁止**将本项目用于以下行为: - 大规模、高频率地抓取平台数据 - 收集、存储或传播他人个人隐私信息 - 破坏或干扰平台正常运营 - 任何形式的非法数据倒卖或商业牟利 - 对外提供自动化数据采集服务 5. 本项目开发者**不承担**因使用本项目而产生的任何法律责任。用户应**自行承担**使用本项目的全部法律风险。 6. 如有侵权,请联系作者,将在第一时间处理。 ### 技术免责 - 爬虫功能依赖 Playwright 浏览器自动化,模拟正常用户浏览行为,**不涉及**逆向加密算法或破解安全机制。 - 各平台接口随时可能变更,本项目不保证所有功能始终可用。 - 建议将请求频率控制在合理范围内(如每次搜索间隔 ≥ 5 秒),避免被平台封禁。 > 💡 **爬虫违法违规的案例频发,请务必合法合规使用。** > 参考:[中国爬虫相关法律案例汇总](https://github.com/HiddenStrawberry/Crawler_Illegal_Cases_In_China) --- ## ✨ v2.0 新特性 ### 🆕 v2.0 vs v1.0 对比 | 特性 | v1.0 | v2.0 | |:---:|:---:|:---:| | 免费可用平台数 | 4 个 | **7 个**(安装 Playwright 后) | | 需要 API Key 的平台 | 微博、小红书、抖音、微信 | **仅微信**(其余可用爬虫替代) | | 数据获取方式 | 仅 API + 公开接口 | API + **爬虫引擎** + 公开接口 | | 安装难度 | 需配置多个 API Key | `pip install playwright` 即可 | | marketplace.json | 缺少 owner 字段(Bug) | ✅ 已修复 | ### 核心升级 1. **集成 MediaCrawler 爬虫引擎** — 基于 Playwright 浏览器自动化,无需逆向加密算法,大幅降低使用门槛 2. **7/8 平台零配置可用** — 除微信外,所有平台均可无需 API Key 使用 3. **智能降级策略** — API 优先 → 爬虫模式 → 公开接口,三级自动降级 4. **修复 Issue #1** — 修复 marketplace.json 缺少 owner 字段导致 Claude Code 安装失败的 bug 5. **登录态缓存** — 爬虫模式支持 Cookie 持久化,减少重复登录 --- ## 📋 平台支持 | 平台 | 模块 | 数据获取方式 | 需要配置 | |:---:|:---:|:---:|:---:| | 🔴 微博 | `weibo.py` | API / 🕷️爬虫 / 公开接口 | ✅ 爬虫模式无需配置 | | 📕 小红书 | `xiaohongshu.py` | API / 🕷️爬虫
Excerpt of 12,776 characters
Read on GitHubWould you bet a product on this? Bounded 0–100 and slow moving.
matched fp:8cb7dd48444a1697, desc:ai agent