INNER CODE UNIT · Python
_fetch_single_source
zillionare/zillionare · scripts/enhanced_news_crawler.py:140
def _fetch_single_source(self, source: Dict) -> List[NewsArticle]:
"""从单个RSS源获取文章"""
articles = []
max_articles = self.config.get("crawler_config", {}).get(
"max_articles_per_source", 20
)
try:
feed = feedparser.parse(source["url"])
if feed.entries:
for entry in feed.entries[:max_articles]:
article = NewsArticle(
title=entry.get("title", ""),
url=entry.get("link", ""),
source=source["name"],
)