OnlyFans Fan Scrape: O que é, como funciona e alternativas em 2026

TL;DR
O que é o FanScrape? Um script de código aberto projetado para extrair metadados de plataformas como OnlyFans e Fansly. Ele complementa ferramentas maiores de download de dados ao organizar informações extraídas para aplicações de gestão de mídia como o Stash.
Como funciona? Ele lê arquivos de banco de dados SQLite criados por outros scrapers (como o OF-Scraper), em vez de fazer scraping diretamente do site. Ele extrai metadados de nomes de arquivos e entradas de banco de dados para gerar informações de cenas e galerias.
Funciona em 2026? Sim, mas com uma ressalva crítica: ele depende de outros scrapers ativos para primeiro baixar os dados brutos e a mídia. Ele também depende da aplicação Stash para gerenciar a execução.
Quais são suas limitações? É uma ferramenta de pós-processamento, não um scraper primário. Sua funcionalidade principal está vinculada a uma plataforma específica de gestão de mídia e pode quebrar se o ambiente de software mudar.
Do que ele precisa? Requer Python 3, módulos Python específicos (como `markdown`) e o `stashapp-tools` para funcionar. Sua confiabilidade depende inteiramente do estado atual de suas dependências.
O que é o FanScrape

Resposta Rápida: FanScrape é um script Python de código aberto que processa metadados do OnlyFans e Fansly para a aplicação de gestão de mídia Stash. Requer Python 3, dependências específicas e um scraper primário como o OF-Scraper para gerar dados de origem. O FanScrape não faz scraping de sites diretamente; ele organiza dados existentes.
FanScrape é um script hospedado no GitHub que extrai e organiza metadados para a aplicação de gestão de mídia Stash.
Não é uma ferramenta autônoma para baixar conteúdo do OnlyFans, mas uma ferramenta complementar que processa dados já coletados por outras aplicações.
Essencialmente, ele pega a saída bruta de ferramentas de scraping primárias e a transforma em um formato estruturado que o Stash pode usar.
Como o FanScrape funciona
O FanScrape não navega diretamente em sites nem baixa mídia. Em vez disso, funciona indiretamente. Ele lê arquivos SQLite "user_data.db" produzidos por outros scrapers de dados como o `datawhores/OF-Scraper`. Aqui está o fluxo de trabalho básico:
1. Scraper Primário: Uma ferramenta de scraping primária baixa posts e salva metadados em um arquivo de banco de dados.
2. Execução do FanScrape: O FanScrape é executado dentro do ambiente Stash. Ele lê o arquivo de banco de dados e usa os nomes de arquivos para corresponder ao conteúdo.
3. Processamento de Metadados: O script extrai informações com base no caminho e nome do arquivo e, em seguida, compila em um formato que o Stash pode entender. Por exemplo, ele pode usar nomes de pastas para determinar o nome de usuário de um performer.
4. Integração de Dados: Os metadados processados são então usados pelo Stash para preencher a biblioteca de mídia do usuário com detalhes como título, data, estúdio e tags para cenas e galerias.
Quais metadados o FanScrape extrai

O FanScrape processa campos específicos do banco de dados de origem para preencher registros do Stash. O script normalmente extrai:
Informações de performer: Nomes de usuário e aliases de estruturas de pastas
Metadados de cena: Títulos, descrições e datas de lançamento
Informações de galeria: Conjuntos de imagens e metadados associados
Tags: Dados de categorização que melhoram a pesquisabilidade dentro do Stash
Os dados processados se integram com o FansDB, um banco de dados de metadados colaborativo somente por convite que armazena informações de performers, atributos físicos e histórico de carreira de criadores independentes. Essa integração permite que usuários do Stash correspondam arquivos locais a um repositório de metadados centralizado usando hashing perceptual, eliminando o problema comum de nomes de arquivos não confiáveis.
O que um scraper do OnlyFans pode fazer

O FanScrape, embora não seja um scraper primário em si, faz parte de um fluxo de trabalho de coleta de dados. As ferramentas com as quais ele trabalha são usadas para aplicações legítimas envolvendo informações publicamente acessíveis. Elas podem ser usadas para:
Organização Pessoal: Usuários que têm permissão para acessar conteúdo podem usar essas ferramentas para organizar uma grande biblioteca de arquivos de mídia com metadados adequados, tornando-os pesquisáveis.
Análise: Pesquisadores podem analisar padrões em publicações disponíveis publicamente, como métricas de engajamento (curtidas, comentários), para identificar tendências.
Arquivamento: Criar um backup local e estruturado de dados disponíveis publicamente para referência e uso pessoal.
Integração com FansDB: Contribuir e aproveitar o banco de dados de metadados colaborativo para usuários do Stash.
É crucial entender as limitações claras:
Público vs. Privado: Essas ferramentas são projetadas para trabalhar com informações publicamente acessíveis ou conteúdo ao qual o usuário tem acesso legítimo. Elas não se destinam a contornar paywalls, acessar contas privadas ou redistribuir material protegido por direitos autorais.
Termos da Plataforma: Muitas plataformas proíbem explicitamente scraping em seus Termos de Serviço. Os usuários devem considerar as leis aplicáveis, termos da plataforma, regras de privacidade e restrições de direitos autorais.
Por que as ferramentas de scraping param de funcionar
O FanScrape pode falhar por vários motivos. Ferramentas como essa podem ser «instáveis», especialmente com grandes conjuntos de dados, ou travar devido a bugs. Além de problemas de confiabilidade, os problemas mais comuns decorrem de como os sites se defendem contra solicitações automatizadas.
Aqui estão os principais motivos:
Alterações no Site: As plataformas frequentemente atualizam sua estrutura HTML, classes CSS ou endpoints de API. Um scraper que depende de um layout específico vai quebrar.
Restrições de IP: Os sites monitoram os endereços IP que fazem solicitações. Solicitações de alta frequência ou padrões suspeitos podem levar a um banimento de IP ou a um «bloqueio» que impede acesso posterior.
Limites de Taxa: Os serviços normalmente limitam quantas solicitações podem ser feitas de um único endereço IP dentro de um período. Exceder esses limites interrompe a coleta de dados.
Detecção de Tráfego Automatizado: Sistemas de segurança modernos analisam «solicitações por reputação, localização e continuidade de sessão». Eles podem identificar e bloquear rapidamente tráfego não humano.
Problemas de Sessão: Muitos fluxos de trabalho de dados exigem um estado de login (sessão autenticada). Se o cookie de login expirar ou a sessão for invalidada, o scraper vai parar de funcionar.
Alterações de Dependências: Como visto com o FanScrape, um novo requisito de módulo Python pode quebrar o script inteiro, como o requisito do módulo `markdown` introduzido no commit `76f80f4`.
Incompatibilidades de Estrutura de Banco de Dados: O FanScrape espera uma estrutura de banco de dados específica do OF-Scraper. Usuários relataram que scrapers como o FanslyScraper produzem bancos de dados com uma «estrutura completamente diferente do user_data.db que o FanScrape procura», exigindo adaptações personalizadas.
O FanScrape precisa de um proxy

O FanScrape em si, como processador de metadados, não faz requisições web diretas, então não precisa de um proxy. No entanto, os scrapers primários dos quais ele depende definitivamente se beneficiam deles. O principal problema que esses scrapers enfrentam é o bloqueio de IP, que é onde a infraestrutura de proxy se torna valiosa. Na coleta automatizada de dados, proxies são uma ferramenta prática.
Quando um proxy é útil? Quando você precisa distribuir grandes números de requisições através de múltiplos endereços IP para evitar limites de taxa e banimentos de IP. Proxies residenciais são frequentemente considerados mais confiáveis para esse propósito.
Quando um proxy não é necessário? Para projetos pequenos e únicos ou testes locais de script, um proxy pode ser excessivo.
O tipo de proxy importa. Proxies de datacenter são mais baratos, mas fáceis de sinalizar, enquanto proxies residenciais e móveis são mais confiáveis para tarefas modernas de scraping.
Resposta Rápida: Um proxy altera o endereço IP usado para uma conexão, mas não faz automaticamente com que todo fluxo de trabalho de scraping funcione. Software mal configurado ainda falhará, mesmo com o melhor proxy.
Onde o CyberYozh se encaixa
O desafio técnico central de qualquer fluxo de trabalho de coleta de dados é gerenciar a reputação de IP e a continuidade de sessão. Quando um projeto de scraping falha, raramente é devido a um único bug; geralmente é porque a infraestrutura frágil não consegue lidar com restrições de IP ou escala. É aqui que o CyberYozh é relevante.
O CyberYozh oferece infraestrutura de proxy que resolve problemas operacionais-chave em fluxos de trabalho de automação legítimos:
Problema: Você tem múltiplas sessões automatizadas usando o mesmo endereço IP, levando a limitação de taxa ou um bloqueio permanente.
Solução: Os Proxies Residenciais do CyberYozh fornecem um conjunto de endereços IP de dispositivos reais que frequentemente aparecem como tráfego de usuário normal. Isso reduz o risco de detecção por sistemas que pontuam requisições por reputação e localização.
Problema: Requisições de uma única geografia podem restringir os dados que você pode ver ou acionar bloqueio geográfico.
Solução: Com segmentação geográfica, você pode rotear o tráfego através de nós de saída residenciais em múltiplas localizações específicas para evitar coleta de dados tendenciosa usando códigos de país ISO 3166-1 alfa-2 (por exemplo, US, GB).
O CyberYozh oferece três tipos de sessão para proxies rotativos:
IP Aleatório (`-res-any`): Ideal para tarefas de coleta de dados públicos onde o histórico de sessão não é necessário.
Sessão Curta (até 1 minuto): Fornece geotargeting preciso até o nível de país, estado e cidade.
Sessão Longa (até 24 horas): Mantém um IP fixo para tarefas prolongadas como preenchimento de formulários ou gerenciamento de contas, com o token de sessão pré-incorporado nas credenciais geradas (`-resfix-...`).
Um pool global de proxies residenciais ajuda a resolver o problema de «baixa diversidade de IP», uma das principais causas de bloqueios. A CyberYozh fornece as ferramentas para rotação de IP, controle de sessão e acesso à API para construir um pipeline de dados com menor probabilidade de ser bloqueado e maior probabilidade de retornar resultados completos.
Para usuários que constroem um pipeline de coleta de dados em torno de scrapers primários, gerenciar a reputação de IP e a rotação de proxies é fundamental. O extenso catálogo de proxies da CyberYozh oferece proxies residenciais, móveis e de datacenter, incluindo opções rotativas e estáticas, para manter a estabilidade da sessão e reduzir o risco de bloqueio. Explore os tipos de proxy disponíveis para atender às necessidades do seu fluxo de trabalho.
Alternativas ao FanScrape em 2026

Se você está procurando uma alternativa, a escolha depende dos seus objetivos. Se você deseja pós-processar dados para o Stash, existem poucas alternativas diretas ao FanScrape. No entanto, o cenário é mais amplo para extração e organização de dados.
Alternativas para usuários do Stash
Scrapers Integrados do Stash: O Stash possui seu próprio conjunto de scrapers da comunidade que podem funcionar para metadados sem precisar do FanScrape.
Dc_onlyfans_fansdb: Este é o script original do qual o FanScrape é um fork.
Scrapers da Comunidade FansDB: O FansDB mantém um repositório de scrapers da comunidade adaptados à sua estrutura de dados, disponível em `https://fansdb.github.io/metadata-scrapers/main/index.yml`.
Scraping geral gratuito e de código aberto
Yozh Scraper: Um toolkit de web scraping gratuito e de código aberto da CyberYozh projetado para extração de dados escalável. Ao contrário do FanScrape, é uma ferramenta de scraping primária que extrai dados diretamente de sites. Possui os seguintes recursos:
Integração nativa com proxies da CyberYozh (`res_rotating` recomendado como padrão)
Seletores auto-reparáveis alimentados por IA que se adaptam a mudanças nos sites
Opções de motor de navegador incluindo Chromium, Google Chrome real e Camoufox para antidetecção
Saída em formato Markdown limpo (`fit_markdown`) otimizado para consumo por LLM, com filtragem automática de ruído (anúncios, menus de navegação, pop-ups de cookies)
Predefinições para Amazon, Google, eBay, Walmart, YouTubee LinkedIn
Open Scraper / Open Crawler: Ferramentas de scraping de código aberto da CyberYozh com endpoints de API para extração de dados escalável.
Alternativas para coleta geral de dados
Octoparse & ParseHub: Para usuários menos técnicos, estas são ferramentas de web scraping sem código «fáceis de usar» que são frequentemente recomendadas como «mais estáveis» para coletar dados.
Scrapy & BeautifulSoup: Bibliotecas Python padrão para desenvolvedores que desejam controle total e são recomendadas para usuários que estão «confortáveis com programação».
Apify: Uma plataforma em nuvem escalável que pode lidar com grandes conjuntos de dados de forma confiável, frequentemente mencionada como uma solução robusta para projetos de grande escala.
FanScrape vs outras ferramentas de scraping
Ferramenta | Facilidade de Uso | Facilidade de Uso | Automação | Limitação Principal |
FanScrape | Processamento de metadados para Stash. | Moderada | Alta | É uma ferramenta complementar, não um scraper autônomo; requer Stash e um downloader primário. |
Yozh Scraper | Extração geral de dados web com seletores alimentados por IA e integração de proxy. | Moderada | Alta | Requer configuração inicial e gerenciamento de chave API. |
Octoparse/ParseHub | Não programadores que precisam de extração de dados por apontar e clicar. | Alta | Moderada | Pode ser caro; menos flexível para projetos complexos. |
Scrapy/BeautifulSoup | Desenvolvedores que precisam de soluções personalizadas e poderosas. | Baixa | Alta | Requer habilidade técnica significativa; está sujeito a banimentos de IP. |
Apify | Extração de dados em larga escala e nível empresarial | Moderada | Alta | O preço pode ser alto; requer configuração e gerenciamento |
Conclusão
FanScrape é uma ferramenta altamente especializada para usuários do Stash que precisam organizar metadados de plataformas como OnlyFans ou Fansly. Ela resolve um problema específico: estruturar dados baixados por outros scrapers. Seu principal ponto forte é a integração com Stash e FansDB, mas sua principal fraqueza é a dependência de outras ferramentas e o risco de quebra por incompatibilidades de estrutura de banco de dados ou mudanças de dependências.
Para um fluxo de trabalho confiável de coleta de dados, construir sobre uma base técnica sólida é essencial. Ferramentas de coleta de dados requerem uma estratégia robusta para gerenciar endereços IP, sessões e diversidade geográfica. A infraestrutura de proxy certa pode fazer a diferença entre um projeto bem-sucedido e um fracassado.
Ao compreender as limitações e requisitos de ferramentas como FanScrape e o software do qual dependem, você pode tomar decisões informadas sobre a construção de um fluxo de trabalho escalável e responsável.
Bom Saber: Informações publicamente acessíveis e conteúdo privado ou restrito são tratados de forma diferente legal e eticamente. Sempre verifique os termos de serviço do site com o qual você está interagindo.