INNER CODE UNIT · Python

_fetch_single_source

zillionare/zillionare · scripts/enhanced_news_crawler.py:140

    def _fetch_single_source(self, source: Dict) -> List[NewsArticle]:
        """从单个RSS源获取文章"""
        articles = []
        max_articles = self.config.get("crawler_config", {}).get(
            "max_articles_per_source", 20
        )

        try:
            feed = feedparser.parse(source["url"])

            if feed.entries:
                for entry in feed.entries[:max_articles]:
                    article = NewsArticle(
                        title=entry.get("title", ""),
                        url=entry.get("link", ""),
                        source=source["name"],
                    )

View source record →

📰 Research Paper
Loading…
⏳ Fetching content…