Busca em bases científicas: passo a passo
Transformar a pergunta em conceitos e termos, traduzir a sintaxe para cada base, buscar no Portal CAPES, no Google Acadêmico, no IEEE Xplore, no PubMed, no SciELO, na BDTD, na BASE e nas demais bases abertas, rodar a mesma busca de forma reprodutível pela API do OpenAlex, verificar o acesso aberto, exportar para o Zotero e registrar tudo no diário de busca — com ferramentas gratuitas e cada consulta anotada com data e total.
Para quem é — e o que você vai saber fazer ao final
Este manual é para quem precisa encontrar a literatura de um trabalho de conclusão, de uma dissertação, de uma tese ou de uma revisão sistemática — em qualquer área — e quer fazê-lo de um jeito que outra pessoa consiga repetir. Ele cobre as bases abertas uma a uma, mostra o que exige assinatura e como se chega lá pela sua instituição, e ensina a rodar a mesma busca pela API do OpenAlex com três scripts curtos. Não exige programação: todo comando está pronto para copiar.
Ao final, você vai conseguir
- Decompor a pergunta em conceitos, listar termos livres e vocabulário controlado, e montar a estratégia com OR dentro do conceito e AND entre conceitos (método de Bramer, De Jonge e Rethlefsen, 2018).
- Traduzir a mesma estratégia para a sintaxe de cada base: aspas, operadores, campos, truncamento.
- Buscar no Portal de Periódicos da CAPES, no Google Acadêmico, no IEEE Xplore, no Semantic Scholar, no PubMed, no arXiv, no SciELO, na BDTD, no oasisbr, na BASE, no DOAJ — e saber para que cada uma serve.
- Rodar a busca pela API do OpenAlex com
buscar_openalex.py, contar antes de baixar, comparar totais entre APIs comcontar_bases.pye verificar o acesso aberto comverificar_oa.py. - Exportar de cada base para o Zotero, obter o PDF por vias legítimas, fazer busca por citações e configurar alertas.
- Registrar cada consulta no diário de busca e no PRISMA-S: base, data, consulta completa, filtros, total, arquivo e hash.
Nomes de menu e de botão são os da interface observada em 09/09/2026; quando a sua tela divergir, vale a tela. Os números marcados «na demonstração deste manual» vieram de buscas e chamadas reais feitas nessa data, com a pergunta de exemplo sobre manutenção preditiva em equipamentos portuários — os seus serão outros.
Tratar o Google Acadêmico como «a base». Ele é o maior índice que existe, mas não é reprodutível, mostra no máximo 1.000 resultados e não exporta em lote. Aqui ele entra como complemento; as bases principais são as que exportam e têm sintaxe documentada.
Este manual cuida da busca. Os passos vizinhos estão nos manuais de origem: Revisão sistemática com PRISMA 2020 (a busca daqui alimenta o diário e o fluxograma de lá), Zotero (importar, deduplicar, PDFs), Metodologia da pesquisa científica (pergunta e critérios), Uso de IA na pesquisa científica (declarar o uso de ferramentas) e Plugin Pesquisa MirandasTech (o Pesquisador conduz a fase 4, «Busca e biblioteca»). O hub que reúne todos: mirandastech.com.br/pesquisa.
Mapa: da pergunta ao diário de busca — e onde cada parte do manual entra
| Parte | O que cobre | Slides |
|---|---|---|
| 1 Antes de buscar | Por que mais de uma base · da pergunta aos termos · sintaxe por base · o que registrar · qual base para quê | Passos 1 a 3 |
| 2 Bases abertas | Portal CAPES, Google Acadêmico, IEEE Xplore, Semantic Scholar, PubMed e LILACS, arXiv, SciELO, BDTD e oasisbr, Catálogo de Teses, BASE, DOAJ, Unpaywall e Crossref, bases por assinatura, descoberta por grafo | Passo 4 |
| 3 API do OpenAlex | O que é · sintaxe · contar antes de baixar · buscar_openalex.py · contar_bases.py · acesso aberto · Zotero · outras APIs | Passos 4 e 5 |
| 4 Depois de buscar | Exportar para o Zotero · obter o PDF · busca por citações · alertas · avaliar o periódico · diário e PRISMA-S | Passos 5 a 7 |
| 5 Fechamento | Plugin · erros comuns · checklist · glossário · referências · como citar | — |
Quem ainda não tem a pergunta fechada começa na Parte 1. Quem já tem a estratégia e quer saber como cada base funciona vai à Parte 2. Quem precisa de uma busca que outra pessoa consiga repetir, com total e data, vai à Parte 3. A Parte 4 é para todo mundo: sem exportação, PDF e diário, a busca não vira revisão.
Nomes de menu e de botão entre «aspas angulares». Comandos em blocos com botão «copiar». Capturas em 1920 × 938 (terminal em 1920 × 520 a 620), feitas em 09/09/2026. Siglas explicadas na primeira vez e no glossário. Onde um site exige login institucional, o manual mostra a tela de entrada e diz «use as credenciais da sua instituição» — nunca pede senha.
Mais de uma base, conceitos e termos, sintaxe, registro — e qual base para quê
A busca boa se decide antes de abrir o navegador: quais bases, quais conceitos, quais termos, como cada base entende aspas e operadores, e o que anotar para que a busca possa ser repetida meses depois por outra pessoa.
Por que mais de uma base: nenhuma sozinha dá cobertura aceitável — nem o maior índice do mundo
Bramer, Giustini e Kramer (2016) reexecutaram as buscas de 120 revisões sistemáticas: o Google Scholar tinha cobertura de 97,2% dos estudos incluídos, mas recall de 46,4% — os estudos estavam lá, só que a busca não os trazia. Bramer e colegas (2017), em 58 revisões, mostraram que a combinação Embase + MEDLINE + Web of Science + Google Scholar recuperou cerca de 98% dos estudos. Gusenbauer e Haddaway (2020) avaliaram 28 sistemas de busca e concluíram que o Google Scholar não serve como sistema principal de uma revisão sistemática: a busca não é reprodutível.
| Achado | O que muda na sua busca |
|---|---|
| Cobertura ≠ recall (Bramer et al., 2016) | Estar indexado não é ser recuperado. A estratégia importa tanto quanto a base |
| Combinar bases (Bramer et al., 2017) | Uma base de área + uma multidisciplinar + uma de citações + Google Scholar como complemento |
| Reprodutibilidade (Gusenbauer; Haddaway, 2020) | Base principal tem de aceitar operadores booleanos, exportar em lote e devolver o mesmo total para a mesma consulta |
| Tamanho (Gusenbauer, 2019) | O Google Scholar tinha ~389 milhões de registros estimados — maior que qualquer base — e mesmo assim não substitui as outras |
| Literatura cinzenta (Haddaway et al., 2015) | O Google Scholar «não deve ser usado isoladamente; funciona como complemento», útil para teses, relatórios e documentos fora das bases |
Para uma revisão, use ao menos três fontes: uma base da sua área (IEEE Xplore em engenharia, PubMed em saúde, SciELO e BDTD para a produção brasileira), uma multidisciplinar aberta com API (OpenAlex) e uma de repositórios (BASE). Acrescente o Google Acadêmico como complemento, com data e número de resultados examinados anotados. Cada fonte entra no fluxograma do PRISMA com o seu «n».
Escolher a base pelo hábito, não pela cobertura. Gusenbauer (2022) comparou a cobertura disciplinar de 56 bases: uma base ótima em ciências da saúde pode ser fraca em engenharia, e vice-versa. Veja o slide «Qual base para quê» antes de decidir.
A mesma pergunta — manutenção preditiva em guindastes e terminais portuários, em inglês ou em português conforme a base — devolveu 235 registros no OpenAlex (com filtros), 18 no IEEE Xplore, 7 no PubMed, 7 no SciELO, 71 na BASE e 288 teses na BDTD. Nenhum desses conjuntos contém os outros: por isso se busca em várias.
Da pergunta aos conceitos e termos: OR dentro do conceito, AND entre conceitos
Bramer, De Jonge e Rethlefsen (2018) descreveram um método sistemático para construir buscas: partir da pergunta, identificar os conceitos, listar para cada um os termos livres e o vocabulário controlado, combinar com OR dentro do conceito e AND entre conceitos, otimizar comparando termos, traduzir a sintaxe para cada base e registrar tudo.
Conceito A "predictive maintenance" Conceito B port OR terminal OR crane Combinada "predictive maintenance" AND (port OR terminal OR crane) Português "manutenção preditiva" (SciELO, BDTD, oasisbr, Portal CAPES)
| Recurso | O que faz |
|---|---|
| Aspas | Frase exata: "predictive maintenance". Sem aspas, a maioria das bases busca as palavras separadas |
| Parênteses | Agrupam o OR de um conceito antes do AND |
| Truncamento | * no PubMed e curingas no arXiv; o OpenAlex aplica stemming em search= |
| Vocabulário controlado | MeSH (PubMed; MeSH Browser em meshb.nlm.nih.gov) e DeCS (BVS; trilíngue): um descritor por assunto, independente da palavra que o autor usou |
| Campos | Limitar a título e resumo ([tiab] no PubMed; title_and_abstract.search no OpenAlex) reduz ruído do texto completo |
Teste a estratégia com dois ou três estudos que você já sabe que são elegíveis. Se a busca não os traz, falta termo no conceito — não afrouxe o AND. Na demonstração, "predictive maintenance" AND crane deu 2.096 no OpenAlex; acrescentar port OR terminal ao conceito B e limitar a 2015–2026 e a artigos, capítulos e preprints deixou 235.
A sintaxe muda de base para base: a mesma estratégia, sete traduções
| Base | Frase exata | AND / OR / NOT | Campos | Truncamento e variantes | Exemplo (demonstração) |
|---|---|---|---|---|---|
| OpenAlex (API) | aspas | AND, OR, NOT dentro de filter=…search: | title.search, abstract.search, title_and_abstract.search, fulltext.search, default.search; search= busca tudo | stemming automático em search= | filter=title_and_abstract.search:"predictive maintenance" AND (port OR terminal OR crane) |
| PubMed | aspas | AND, OR, NOT | tags [tiab], [ti], [mh], [au], [dp], [pt], [la] | *; MeSH como vocabulário controlado | "predictive maintenance"[tiab] AND (port[tiab] OR crane[tiab]) |
| IEEE Xplore | aspas | AND, OR, NOT | «ADVANCED SEARCH»: «Document Title», «Abstract», «Author Keywords», «All Metadata» | — | "predictive maintenance" AND crane |
| Google Acadêmico | aspas | AND implícito; OR = «com no mínimo uma das palavras»; exclusão = «sem as palavras» | «em qualquer lugar do artigo» ou «no título do artigo»; author:"d knuth" | — | «Pesquisa avançada»: frase exata predictive maintenance, no mínimo uma: port terminal crane |
| SciELO | aspas | Campos combinados com «Adicionar outro campo» | «Todos os índices», «Ano», «Autor», «Financiador», «Periódico», «Resumo», «Título» | — | "manutenção preditiva" |
| arXiv | aspas | AND, OR, NOT (API: AND, OR, ANDNOT) | Title, Author, Abstract, Comments, Journal reference, ACM/MSC class, Report number, All fields; API: ti:, au:, abs:, cat:, all: | curingas | abs:"predictive maintenance" AND (abs:port OR abs:crane OR abs:terminal) |
| BASE | aspas | — | Facetas: Author, Subject, DDC, Year, Content Provider, Language, Document Type, Access, Terms of Re-use | «Verbatim search», «Additional word forms», «Multi-lingual search» | "predictive maintenance" crane |
| Semantic Scholar | aspas | sem operadores booleanos | Filtros: «Fields of Study», «Date Range», «Has PDF», «Author», «Journals & Conferences» | — | "predictive maintenance" crane port |
Traduza a estratégia base a base e guarde cada versão verbatim: o PRISMA-S pede a consulta completa de cada base, não um resumo. Onde não há operador booleano (Semantic Scholar, Google Acadêmico na busca simples), a base é complementar — não principal.
Colar a string do PubMed no IEEE Xplore. As tags [tiab] viram texto e a busca devolve zero. Cada base tem a própria tabela; quando duvidar, abra a página de ajuda (o IEEE Xplore tem «Resources and Help»; o PubMed devolve a «query translation» mostrando como interpretou a consulta).
O que registrar: os 16 itens do PRISMA-S, a revisão por pares da estratégia (PRESS) e o modelo BUSCA.md
O PRISMA-S (Rethlefsen et al., 2021) é a extensão do PRISMA para o relato da busca: 16 itens em quatro seções. O PRESS (McGowan et al., 2016) é a lista de verificação para que outra pessoa — bibliotecário ou colega — revise a estratégia antes de rodar. O diário de busca é o arquivo que guarda tudo isso; o manual de revisão sistemática usa o modelo BUSCA.md, e o plugin Pesquisa MirandasTech espera as strings verbatim, com data, filtros, total e hash, na pasta 01_buscas/.
| Seção do PRISMA-S | O que relatar |
|---|---|
| Fontes e métodos | Nome de cada base e da plataforma; registros de estudos; outras fontes; busca por citações; contato com autores |
| Estratégias de busca | Consulta completa copiada de cada base; filtros e limites; data de cada busca; busca atualizada |
| Revisão por pares | Se a estratégia foi revisada (PRESS) e por quem |
| Gestão dos registros | Total por base; método de deduplicação; quantos removidos |
Tradução da pergunta em conceitos; operadores booleanos e parênteses; termos livres e vocabulário controlado; ortografia e sintaxe; limites e filtros. Uma hora de revisão evita meses de triagem de resultados irrelevantes — ou a ausência silenciosa dos relevantes.
## OpenAlex (api.openalex.org) — 2026-09-09 - consulta: filter=title_and_abstract.search:"predictive maintenance" AND (port OR terminal OR crane) - filtros: publication_year:2015-2026, type:article|book-chapter|preprint - total: 235 (meta.count) · gravados: 236 - arquivo: 01_buscas/busca_openalex.csv · busca_openalex.ris - hash: sha256 do CSV (comando abaixo) - revisão: PRESS por [nome], 2026-09-08 - diário: diario_busca_2026-09-09.json (gerado pelo script)
sha256sum 01_buscas/busca_openalex.csv
Uma entrada por base e por execução: a busca atualizada meses depois é outra entrada, não uma edição. O total é o número do dia — as bases mudam todo dia — e o hash prova que o arquivo exportado é o daquela busca. Copie a consulta da caixa de busca depois de rodar, não antes: a base pode ter reescrito algo.
Qual base para quê: cobertura, custo, exportação e API
| Base | Cobertura (09/09/2026) | Gratuita? | Exporta? | API? | Para que serve |
|---|---|---|---|---|---|
| OpenAlex | 327.599.176 works; 256.431 fontes; dados CC0 | sim | CSV, RIS, TXT (formato WoS) | sim, sem chave | Base principal reprodutível, multidisciplinar; contagens e citações |
| Crossref | 186.388.412 registros de DOI | sim | pela API | sim, sem chave (polite) | Achar o DOI de uma referência; metadados; retratações |
| Semantic Scholar | mais de 200 M artigos (214 M no site da API) | sim | BibTeX, MLA, APA, Chicago, EndNote | sim; chave para uso regular | Descoberta, TLDR, citações, alertas |
| PubMed | 41.124.262 registros; PMC > 10 M textos completos | sim | .nbib («Send to → Citation manager») | E-utilities, chave opcional | Saúde e biomedicina; MeSH |
| arXiv | 3.161.668 submissões; 8 áreas | sim | por identificador (arXiv ID) | sim, 1 chamada/3 s | Preprints de física, matemática, computação, estatística, engenharia elétrica |
| SciELO | 331 periódicos correntes no Brasil, 8 áreas; coleções por país | sim | «Exportar» | — | Produção ibero-americana em acesso aberto, PT/EN/ES |
| BDTD · oasisbr · Catálogo CAPES | Teses e dissertações brasileiras (oasisbr agrega repositórios) | sim | «Exportar» (BDTD) | — | Literatura cinzenta brasileira |
| BASE | 493.806.581 documentos de repositórios | sim | «Export Record» | exige registro do IP | Repositórios do mundo; acesso aberto |
| DOAJ | 23.433 periódicos; 13.576.356 artigos | sim | — | sim, sem chave (2 req/s) | Conferir se o periódico é aberto e listado |
| Google Acadêmico | ~389 M registros estimados (Gusenbauer, 2019) | sim | «Citar» item a item; até 1.000 resultados | não | Complemento; literatura cinzenta; «Citado por» |
| IEEE Xplore | 4 M documentos, > 180 periódicos, > 1.500 conferências/ano (IEEE, 2016) | busca sim · PDF não | «Export» | exige chave | Engenharia elétrica, computação, automação |
| Portal CAPES | 40 mil títulos de periódicos, 274.730 livros (2024) | aberto sem login · assinado via CAFe | «Exportar» | — | Porta de entrada ao conteúdo assinado pela sua instituição |
| Scopus · Web of Science | > 100 M; 288 M+ registros | assinatura | sim (assinante) | chave + afiliação | Bases de citações por assinatura; entrar pelo CAFe |
| Dimensions · Lens | > 140 M publicações (grátis); > 200 M registros + patentes | conta gratuita | sim (Lens: até 1.000 grátis) | — | Descoberta, financiamentos, patentes |
Portal CAPES, Google Acadêmico, IEEE Xplore, Semantic Scholar, PubMed, arXiv, SciELO, BDTD, BASE, DOAJ, Unpaywall, Crossref — e as que exigem assinatura
Para cada base: a tela, o passo a passo da busca, os filtros, a exportação e os limites. Todas as capturas são de 09/09/2026, sem login; onde a base pede credenciais institucionais, o manual mostra a tela de entrada e para aí.
Portal de Periódicos da CAPES: sem login você já busca o conteúdo aberto — e vê o que é «revisado por pares» e «produção nacional»


"manutenção preditiva" na demonstração deste manual (captura de 09/09/2026): «64 resultados»; filtro «Acesso aberto: Sim 63 / Não 1», «Tipo do recurso», «Ano»; selos «ARTIGO», «ACESSO ABERTO», «PRODUÇÃO NACIONAL», «REVISADO POR PARES»; botões «Exportar», «Ordenar por Relevância», «Selecionar tudo».- Abra periodicos.capes.gov.br. Sem login, a busca cobre o conteúdo gratuito e aberto; a trilha «Acervo › Buscar assunto» leva à mesma caixa.
- Digite a consulta com aspas para a frase exata e clique em buscar.
- Use as facetas da esquerda: «Acesso aberto», «Tipo do recurso», «Ano». Os selos de cada resultado dizem se é artigo, aberto, nacional e revisado por pares.
- Marque os itens (ou «Selecionar tudo») e clique em «Exportar» para levar ao Zotero. Cada resultado tem «Acesse», «Disponibilidade» e «PlumX Metrics».
Segundo a página «Nossa história» (dados de 2024): 475 milhões de acessos, 274.730 livros e 40 mil títulos de periódicos, 452 instituições e mais de 6 milhões de usuários — «maior acervo digital da América Latina». Oferece treinamentos gratuitos com calendário e materiais.
Portal CAPES: a Busca Avançada monta a consulta booleana; o Acesso CAFe abre o conteúdo assinado — com as credenciais da sua instituição


- Na «Busca Avançada», escolha o escopo e o tipo de material; em «Filtros de busca», defina o campo («Qualquer campo»…), a condição («Contém») e os termos; clique em «Adicionar» para cada conceito — a caixa «Consulta» mostra a expressão montada.
- Para o conteúdo assinado (bases e periódicos por assinatura), clique em «Acesso CAFe», selecione a sua instituição e entre com o login institucional. A CAFe (Comunidade Acadêmica Federada, da RNP) dá o acesso remoto.
- O Portal avisa: «O nome de usuário e senha para acesso devem ser verificados junto à equipe de TI ou de biblioteca de sua instituição».
Copie a «Consulta» montada pela Busca Avançada para o diário — é ela, não os campos separados, que outra pessoa vai colar para repetir. Anote também se estava logado pela CAFe: o total muda, porque o acervo assinado entra na conta.
Digitar a senha institucional em qualquer página que não seja a da sua instituição. O fluxo legítimo é sempre «Acesso CAFe» → escolher a instituição → página de login da instituição. Nunca há senha neste manual nem em nenhum script dele.
Google Acadêmico: para que serve (descoberta, «Citado por», literatura cinzenta) e para que não serve (base principal)


- Abra a «Pesquisa avançada» pelo menu lateral. «Com a frase exata» é o conceito A; «com no mínimo uma das palavras» é o OR do conceito B; «datados entre» é o filtro de período.
- Em cada resultado: «Citado por» (quem citou), «Artigos relacionados», «Todas as versões» e o botão «Citar», que exporta BibTeX, EndNote, RefMan e RefWorks.
- Crie um alerta por e-mail para a consulta (não exige conta). Em «Configurações» → «Links de biblioteca», cadastre até 5 bibliotecas: os resultados passam a mostrar «Texto completo @ Instituição» via resolvedor OpenURL.
| Limite | Consequência |
|---|---|
| 1.000 resultados | É o máximo exibido por busca; o que vier depois não existe para você |
| Sem exportação em lote | «Citar» é item a item; o Zotero Connector salva pelo ícone de pasta, mas pede CAPTCHA em lotes |
| Bloqueio de robôs | Em 09/09/2026, buscas automatizadas receberam «Nossos sistemas detectaram tráfego incomum»: não há API nem script |
| Não reprodutível | O resultado varia por conta, dia e lugar (Gusenbauer; Haddaway, 2020) |
Use como complemento: anote a consulta, a data e quantos resultados examinou (por exemplo, «as 10 primeiras páginas»). Para o fluxograma, ele entra em «outras fontes», não como base.
IEEE Xplore: buscar, filtrar por acesso aberto e exportar é gratuito; o PDF é do assinante


"predictive maintenance" AND crane na demonstração deste manual (captura de 09/09/2026): «18 resultados» (Conferences 14, Journals 4); «Show: All Results / Open Access Only»; «Export», «Set Search Alerts», «Search History», «Items Per Page», «Sort By Relevance»; cadeado nos itens pagos.- Digite a consulta na caixa da home; a busca básica aceita AND, OR, NOT e aspas.
- Na página de resultados, filtre por tipo (Conferences, Journals…), ano e «Show: Open Access Only» quando só interessar o que tem PDF livre.
- Marque os itens e clique em «Export» para levar as citações ao Zotero; «Set Search Alerts» avisa de novos resultados; «Search History» guarda as consultas da sessão.
| Sem assinatura | Com assinatura (via «Institutional Sign In» ou CAFe) |
|---|---|
| Buscar, ler resumos, exportar citações, criar alertas | Abrir o PDF dos itens com cadeado (ou comprar avulso) |
Segundo a IEEE (2016): 4 milhões de documentos, mais de 180 periódicos, mais de 1.500 conferências por ano e mais de 1.300 normas ativas. O site bloqueia robôs (HTTP 418 «Unusual Traffic Detected»); a IEEE Xplore Metadata API (developer.ieee.org) exige chave.
IEEE Xplore: o construtor por campos da «ADVANCED SEARCH» e a página «Resources and Help»


- Uma linha por conceito: o conceito A em «Document Title» ou «Abstract»; o conceito B com os sinônimos separados por OR.
- Limitar a «Document Title» e «Abstract» reduz o ruído de «All Metadata» (que inclui referências e texto completo).
- Depois de rodar, copie a consulta como o IEEE Xplore a exibe na página de resultados — é essa forma que vai ao diário.
Na demonstração, "predictive maintenance" AND crane deu 18 resultados no IEEE Xplore e 2.096 no OpenAlex: o IEEE Xplore cobre o acervo da IEEE (4 milhões de documentos); o OpenAlex indexa 327 milhões de works de todas as fontes. Os dois números vão para o diário, cada um com a sua base.
Deduplicar o que veio do IEEE Xplore e do OpenAlex (o mesmo artigo aparece nos dois) é assunto do manual de revisão sistemática e do manual do Zotero.
Semantic Scholar: TLDR, filtros, alertas e «Cite» — sem operadores booleanos, e com API só regular com chave

"predictive maintenance" crane port na demonstração deste manual (captura de 09/09/2026): «About 3,240 results»; filtros «Fields of Study», «Date Range», «Has PDF», «Author», «Journals & Conferences»; cada resultado traz «TLDR», número de citações, «Save», «Cite» e o selo «PDF» quando há acesso aberto; botões «Sign In» e «Create Free Account».Mantido pelo Ai2 (Allen Institute for AI), lançado em 2015, gratuito: mais de 200 milhões de artigos (214 M no site da API, 2,49 bilhões de citações, 79 M autores; Kinney et al., 2023). A busca não aceita operadores booleanos — só aspas — e o total é aproximado («About»). Ordena por relevância, citações, influência ou recência.
- Digite a consulta com a frase entre aspas; refine com «Fields of Study», «Date Range» e «Has PDF».
- Leia o «TLDR» (resumo de uma frase gerado por IA; disponível em computação e biomedicina) para decidir se vale abrir.
- «Cite» exporta BibTeX, MLA, APA, Chicago e EndNote; há integração com Zotero e Mendeley. Com conta gratuita: alertas e «Research Feeds».
| API (graph/v1) | Detalhe |
|---|---|
| Endpoints | /paper/search, /paper/search/bulk, /paper/{id}, citações e referências, /author/batch |
| Parâmetros | query, fields, limit, offset ou token, year, venue, minCitationCount |
| Limite | Sem chave, a cota é compartilhada por todos os anônimos: na demonstração, as chamadas anônimas devolveram HTTP 429 (uma delas, no contar_bases.py, passou). Com chave (formulário no site; chega por e-mail): 1 req/s inicial |
Sem booleanos e com total aproximado, o Semantic Scholar é fonte complementar: ótimo para descobrir e seguir citações, não para ser a base principal de uma revisão. Anote o «About N results» com a data mesmo assim.
PubMed: tags de campo, MeSH, «Advanced», alertas e «Send to → Citation manager» (.nbib para o Zotero)
![PubMed: 7 results para predictive maintenance [tiab] AND (port[tiab] OR crane[tiab]); gráfico Results by year; filtros Publication date e Text availability; botões Save, Email, Send to, Create alert, Create RSS; selo Free PMC article](capturas/bb_11_pubmed.jpg)
"predictive maintenance"[tiab] AND (port[tiab] OR crane[tiab]) na demonstração deste manual (captura de 09/09/2026): «7 results»; gráfico «Results by year»; filtros «Publication date» e «Text availability (Abstract / Free full text / Full text)»; «Save / Email / Send to»; «Create alert / Create RSS»; «Cite» em cada item; selo «Free PMC article».41.124.262 registros (esearch all[sb], 09/09/2026); o PMC tem mais de 10 milhões de artigos de texto completo gratuitos. É a base de referência em saúde e biomedicina — e a que tem a sintaxe mais bem documentada.
- Escreva a consulta com tags:
[tiab]título e resumo,[ti]título,[mh]MeSH,[au]autor,[dp]data,[pt]tipo,[la]idioma;*trunca. Use descritores MeSH (MeSH Browser: meshb.nlm.nih.gov) como vocabulário controlado ao lado dos termos livres. - Em «Advanced»: «Query box», «Add terms», «History» (expira após 8 h) — e a «query translation», que mostra como o PubMed interpretou a consulta. Copie-a para o diário.
- «Send to → Citation manager» gera o arquivo
.nbib, que o Zotero importa. «Saved Search» com conta NCBI cria alertas por e-mail.
curl -s 'https://eutils.ncbi.nlm.nih.gov/entrez/eutils/esearch.fcgi?db=pubmed&retmode=json&retmax=0&term=%22predictive+maintenance%22%5Btiab%5D+AND+%28port%5Btiab%5D+OR+crane%5Btiab%5D%29' # na demonstração: "count":"7" · só "predictive maintenance"[tiab] → 690
O PubMed é o modelo do que uma base principal deve ser: sintaxe documentada, vocabulário controlado, total exato, exportação em lote e API. Mesmo fora da saúde, vale rodar a consulta nele — na demonstração, o tema de engenharia devolveu 7 artigos, e a «query translation» mostrou exatamente como a consulta foi interpretada.
LILACS e o Portal Regional da BVS: a produção da América Latina e do Caribe em saúde, com o DeCS como vocabulário controlado

A LILACS é coordenada pela BIREME (OPAS/OMS): 30 países, mais de 1,1 milhão de registros, cerca de 2,6 mil periódicos e mais de 740 mil textos completos. A busca é feita no Portal Regional da BVS, que aceita os descritores do DeCS — Descritores em Ciências da Saúde, trilíngue — e do MeSH.
- Clique em «Localizar descritor de assunto» e encontre o descritor DeCS do seu conceito; ele vale em português, espanhol e inglês ao mesmo tempo.
- Monte a consulta com o descritor e os termos livres, no idioma da interface; a BVS busca nas três línguas.
- Anote a consulta como ficou na caixa da BVS e o total do dia.
| Vocabulário | Onde | Para quê |
|---|---|---|
| MeSH | PubMed; meshb.nlm.nih.gov | Descritor único por assunto em inglês; tag [mh] |
| DeCS | BVS/LILACS; «Localizar descritor de assunto» | O mesmo descritor em PT/ES/EN — recupera o artigo brasileiro que só tem resumo em português |
Em saúde, inclua a LILACS ao lado do PubMed: ela indexa periódicos de 30 países da região e aceita o DeCS. Use o DeCS para não depender da palavra que o autor escolheu.
arXiv: preprints desde 1991, busca avançada por campo e uma API que pede 3 segundos entre chamadas


"predictive maintenance" crane no arXiv (captura de 09/09/2026). Cada registro tem o identificador arXiv, que o Zotero aceita em «Adicionar item por identificador».Fundado em 1991 por Paul Ginsparg; 3.161.668 submissões acumuladas (estatística de 09/09/2026) em 8 áreas: física, matemática, computação, biologia quantitativa, finanças quantitativas, estatística, engenharia elétrica e economia. Metadados em CC0. Preprints não são revisados por pares — diga isso nos critérios.
- Na busca avançada, uma linha por conceito, com o campo «Abstract» ou «Title»; curingas e frases entre aspas funcionam.
- Filtre por assunto (as 8 áreas e suas categorias) e por data; ordene por data para a busca atualizada.
curl -s 'https://export.arxiv.org/api/query?search_query=abs:%22predictive+maintenance%22+AND+%28abs:port+OR+abs:crane+OR+abs:terminal%29&max_results=1' | grep -o 'totalResults[^<]*' # na demonstração: 5 · abs:"predictive maintenance" AND abs:crane → 0 · all:"predictive maintenance" → 548 · all:electron → 185.986
Prefixos da API: ti:, au:, abs:, cat:, all:; operadores AND, OR e ANDNOT. Respeite os 3 segundos entre chamadas — o contar_bases.py deste manual faz isso com time.sleep(3).
SciELO: busca integrada em todas as coleções, filtro por país e periódico, «Exportar» e texto em PT, EN e ES

"manutenção preditiva" na busca integrada (captura de 09/09/2026): 7 resultados; facetas «Coleções» (Brasil 3, México 2, SciELO Preprints 1, Portugal 1) e «Periódico»; «Imprimir | Enviar por e-mail | Exportar | Compartilhar»; resumo, texto e PDF em PT, EN e ES.
- Use search.scielo.org (busca integrada), não a home de uma coleção: ela cobre Brasil, México, Portugal, SciELO Preprints e as demais.
- Escolha o campo — «Todos os índices», «Ano», «Autor», «Financiador», «Periódico», «Resumo», «Título» — e clique em «Adicionar outro campo» para cada conceito. O «Histórico de busca» guarda as consultas.
- Filtre por «Coleções», «Periódico», idioma e ano; marque os resultados e clique em «Exportar» para o Zotero.
| SciELO Brasil | Detalhe |
|---|---|
| Periódicos correntes | 331, em 8 áreas: Agrárias, Biológicas, Saúde, Exatas e da Terra, Humanas, Sociais Aplicadas, Engenharias, Linguística/Letras/Artes |
| Acesso | Aberto; resumo, texto completo e PDF, muitas vezes em mais de um idioma |
| Contexto | Packer (2014) sobre a eclosão dos periódicos brasileiros; Mugnaini, Digiampietri e Mena-Chalco (2014) sobre a indexação da produção brasileira |
Busque em português e em inglês: o artigo brasileiro pode ter título e resumo nos dois idiomas, mas nem sempre. Registre as duas consultas como entradas separadas no diário, cada uma com o seu total.
BDTD e oasisbr (IBICT): a literatura cinzenta brasileira — teses, dissertações e repositórios — com facetas e «Exportar»

"manutenção preditiva" na BDTD (captura de 09/09/2026): «288 resultados»; facetas «Instituição de defesa», «Bases coletadas», «Programa de Pós-Graduação», «Autor», «Orientador(a)», «Tipo de documento», «Tipo de acesso»; botão «Exportar»; sugestão de buscas alternativas.
- Na BDTD, escolha o campo («Todos os campos», «Título», «Ano», «Autor»…) ou abra a «Busca avançada»; digite a consulta com aspas.
- Use as facetas para limitar por instituição, programa, orientador, tipo de documento (tese ou dissertação) e tipo de acesso.
- «Exportar» leva os registros ao Zotero; «Acessar documento» abre o repositório da universidade, onde está o PDF.
- Repita no oasisbr para alcançar artigos, relatórios e outros documentos dos repositórios — e anote os dois totais separadamente.
Teses e dissertações são literatura cinzenta: decida nos critérios se entram, e diga qual base as forneceu. Na demonstração, a BDTD sozinha deu 288 e o oasisbr 1.053 para a mesma consulta — não some os dois, porque um contém o outro.
O site mostra «Verificando seu navegador» antes de abrir: é uma proteção contra robôs. Use o navegador normal; não há API pública documentada aqui.
Catálogo de Teses e Dissertações da CAPES: o registro oficial dos programas, com painel quantitativo

O Catálogo é o registro da CAPES; a BDTD e o oasisbr são os portais do IBICT sobre os repositórios das universidades. São fontes distintas, com buscas distintas: para a literatura cinzenta brasileira, consulte as três e anote cada total.
| Fonte | Quem alimenta | O que dá |
|---|---|---|
| Catálogo de Teses (CAPES) | Programas de pós-graduação | Busca e «Painel de informações quantitativas» |
| BDTD (IBICT) | Repositórios das universidades | Metadados, facetas, «Exportar», link ao PDF no repositório |
| oasisbr (IBICT) | Repositórios brasileiros (inclui a BDTD) | Teses, artigos e outros documentos em um só portal |
Use o «Painel de informações quantitativas» para dimensionar o tema no Brasil antes de decidir se a literatura cinzenta entra na revisão. O número do painel vai para a justificativa; o da busca, para o diário.
BASE (Bielefeld Academic Search Engine): 493 milhões de documentos de repositórios, com «Verbatim search» e «Export Record»

"predictive maintenance" crane na BASE (captura de 09/09/2026): «71 hits in 493.806.581 documents»; opções «Verbatim search / Additional word forms / Multi-lingual search» e «Boost open access documents»; facetas Author, Subject, DDC, Year, Content Provider, Language, Document Type, Access, Terms of Re-use; «Export Record» e «In Google Scholar» em cada registro.- Digite a consulta com a frase entre aspas. Escolha «Verbatim search» para a busca exata ou «Additional word forms» para incluir variantes; «Multi-lingual search» amplia para outros idiomas.
- Marque «Boost open access documents» para trazer ao topo o que tem texto livre.
- Use as facetas — em especial «Content Provider» (o repositório de origem), «Document Type» e «Access».
- «Export Record» exporta o registro; «In Google Scholar» procura outras versões.
| Opção | Efeito |
|---|---|
| Verbatim search | Só a forma digitada — para a busca reprodutível |
| Additional word forms | Inclui plurais e derivações — para o recall |
| Multi-lingual search | Traduz os termos — útil para achar a versão em português de um tema buscado em inglês |
Anote no diário qual das três opções estava marcada: a mesma consulta com «Additional word forms» devolve outro total. A API da BASE exige registro do IP; sem isso, use a interface.
O site é protegido contra robôs (Anubis) — bloqueou o acesso automatizado na demonstração, mas abriu normalmente no navegador.
DOAJ: o diretório dos periódicos abertos, com API pública — e o CORE, agregador de artigos em acesso aberto
O DOAJ (Directory of Open Access Journals), mantido pela Fundação DOAJ (Dinamarca), listava em 09/09/2026 23.433 periódicos e 13.576.356 artigos. Serve para duas coisas: conferir se um periódico é aberto e listado (um dos itens do «Think. Check. Submit.») e buscar artigos nesses periódicos. A busca é por título, ISSN, disciplina, editor e país.
curl -s 'https://doaj.org/api/search/articles/%22predictive%20maintenance%22?pageSize=1' | python3 -c 'import json,sys; print(json.load(sys.stdin)["total"])' # na demonstração: 3.328 · title:"predictive maintenance" devolveu exemplos em Sensors e ITM Web of Conferences # no contar_bases.py, "predictive maintenance" crane → 6
curl -s 'https://doaj.org/api/search/journals/issn:XXXX-XXXX?pageSize=1' | python3 -c 'import json,sys; print(json.load(sys.stdin)["total"])'
| Fonte | O que é | Acesso |
|---|---|---|
| DOAJ | Diretório de periódicos em acesso aberto, com os artigos indexados | Site e API sem chave; o site usa Cloudflare contra robôs |
| CORE | Agregador da maior coleção de artigos em acesso aberto de repositórios e periódicos (Knoth et al., 2023) | Site com verificação anti-robô; API v3 exige chave gratuita (401 sem chave) |
Use o DOAJ como lista de verificação mais do que como base de busca: quando um periódico desconhecido aparecer nos resultados, confira se está lá. O OpenAlex já traz essa informação por fonte (na demonstração, o Journal of Marine Science and Engineering aparece como aberto e no DOAJ).
A API do DOAJ não aceita curingas nem busca aproximada; a consulta com aspas é interpretada como frase. O total varia com a forma da consulta — anote-a exatamente como enviou.
Unpaywall: a versão aberta legítima de um DOI — extensão de navegador, API com e-mail e o campo oa_status

Piwowar e colegas (2018) estimaram que ao menos 28% da literatura tem alguma versão aberta e que artigos abertos recebem cerca de 18% mais citações. O Unpaywall é o banco que localiza essas versões — nos editores e nos repositórios — a partir do DOI. O Zotero o usa em «Encontrar PDF disponível».
- Instale a extensão («GET THE EXTENSION»): ao abrir a página de um artigo pago, ela indica quando há versão aberta legítima do artigo.
- Pela API, consulte um DOI de cada vez com o seu e-mail (obrigatório) e leia
is_oa,oa_statusebest_oa_location.url_for_pdf. - Para uma lista inteira de DOIs, use o
verificar_oa.pydeste manual (Parte 3).
| oa_status | Significa |
|---|---|
| gold | Publicado em periódico de acesso aberto |
| hybrid | Aberto em periódico por assinatura (o artigo pagou para ser aberto) |
| green | Cópia aberta em repositório |
| bronze | Livre no site do editor, sem licença aberta declarada |
| closed | Nenhuma versão aberta encontrada |
O endpoint /v2/search devolveu HTTP 500 na demonstração: use a consulta por DOI. Limite do serviço: 100.000 chamadas por dia.
Crossref: o registro oficial dos DOIs — «Simple Text Query» para achar o DOI de uma lista de referências e a API «polite» para scripts

186.388.412 registros (API, 09/09/2026). Os metadados são reutilizáveis sem restrição — exceto os resumos, que têm copyright do editor; o que a Crossref gera é CC0. A API REST é gratuita e sem chave; o serviço pago é o Metadata Plus, que você não precisa.
- Para uma lista de referências sem DOI (uma tese antiga, um artigo em ABNT): cole-a no «Simple Text Query» e copie os DOIs devolvidos.
- Para uma referência só, use
query.bibliographic=na API — e confira o título: na demonstração, «Page 2021 PRISMA 2020 statement BMJ» devolveu primeiro o DOI da extensão PRISMA-LSR (score 34,9), não o do artigo principal. - Em scripts, entre no pool «polite»:
mailto=na URL ou no User-Agent, sempre por HTTPS. Os limites vêm nos cabeçalhosX-Rate-Limit-LimiteX-Rate-Limit-Interval(por exemplo, 50 req/s).
curl -s 'https://api.crossref.org/works?query=predictive+maintenance+crane&filter=type:journal-article,from-pub-date:2015&rows=0&mailto=seu@email.br' # na demonstração: 199.519 — a busca é por relevância, não booleana; sem filtro, o contar_bases.py obteve 468.421
Usar o total da Crossref como «n» de uma base. A consulta é por relevância e devolve tudo que tenha alguma das palavras. A Crossref serve para resolver DOIs e enriquecer metadados, não para contar a literatura de um tema.
Scopus, Web of Science e ScienceDirect: o que são, o que cobrem e como se chega a elas — pelo CAFe ou pela rede da universidade

| Base | Cobertura declarada | Como entrar |
|---|---|---|
| Scopus (Elsevier) | Mais de 100 M registros; 7.000 editoras; 330 disciplinas; referências desde 1970 | Assinatura institucional; sem login redireciona a id.elsevier.com. As APIs da Elsevier exigem chave e afiliação assinante |
| Web of Science (Clarivate) | 288 M+ registros; 3,4 bilhões de links de citação; 34 mil periódicos; desde 1864; 254 categorias | «Login Institucional» → selecionar a instituição → credenciais institucionais |
| ScienceDirect (Elsevier) | Plataforma da Elsevier; conteúdo por assinatura | Assinatura; o site recusou o acesso automatizado na demonstração |
- Veja a «Lista de bases e coleções» do Portal CAPES e confirme com a biblioteca da sua instituição o que ela assina.
- Entre pelo «Acesso CAFe» do Portal ou pela rede da universidade; na base, escolha «Login Institucional» quando houver.
- Rode a mesma estratégia, exporte (RIS ou BibTeX) e anote o total com a data — como em qualquer base.
Scopus e Web of Science são as bases de citações clássicas; Culbert et al. (2025) mostraram que o OpenAlex tem cobertura de referências comparável às duas em 16,8 milhões de publicações comuns, com mais ORCID e menos resumos. Visser et al. (2021), Singh et al. (2021) e Martín-Martín et al. (2021) comparam a cobertura dessas e de outras fontes. Se a sua instituição assina, use; se não, o OpenAlex é a alternativa aberta.
A exportação de uma base assinada é material licenciado: fica fora de repositórios públicos. Publique a estratégia, os totais e a lista dos incluídos — não o arquivo bruto.
Dimensions, Lens, Connected Papers e ResearchRabbit: descoberta por grafo, com conta gratuita



| Ferramenta | O que faz | Acesso |
|---|---|---|
| Dimensions | Versão gratuita com mais de 140 M publicações e 29 M datasets; busca em texto completo com filtros; exportação, favoritos, ORCID (Hook, Porter e Herzog, 2018). Cobertura total: 164 M publicações, 8,1 M financiamentos, 170 M patentes, 938 mil ensaios clínicos | Registro; «Free for personal, non-commercial use» |
| Lens | Mais de 200 M registros acadêmicos + patentes; exporta até 1.000 registros gratuitamente | Conta individual gratuita para uso não comercial |
| Connected Papers | Grafo de artigos semelhantes a partir de um artigo-semente | Conta para uso pleno |
| ResearchRabbit | Mais de 310 M artigos; importa a sua biblioteca de referências | Gratuito, com conta |
Ferramentas de grafo são para descobrir — achar os estudos-semente e os vizinhos que a busca booleana não trouxe — não para ser a base da revisão: o resultado depende da semente e não é reprodutível como uma consulta. O que sair delas entra como «busca por citações» ou «outras fontes» no fluxograma, com a data.
As páginas do Connected Papers e do ResearchRabbit não declaram a origem dos dados; este manual não afirma qual é. Em 09/09/2026, os sites de Dimensions e Lens exigiam verificação de usuário ou login antes de mostrar resultados — abra no navegador normal e crie a conta gratuita.
A mesma busca, rodada por script: consulta gravada, total com data, CSV, RIS e diário
A interface de uma base muda; a API devolve o mesmo para a mesma URL. Aqui a busca vira três comandos: contar antes de baixar, baixar tudo com buscar_openalex.py, comparar totais entre APIs com contar_bases.py — e verificar o acesso aberto com verificar_oa.py. Tudo rodado de verdade em 09/09/2026.
OpenAlex: índice aberto com dados CC0, 327 milhões de works e uma API gratuita — a base principal reprodutível deste manual
O OpenAlex é mantido pela OurResearch e nasceu como substituto do Microsoft Academic Graph (Priem, Piwowar e Orr, 2022 — na época com 209 milhões de works). Os dados são CC0. Em 09/09/2026 a API reportava 327.599.176 works, 256.431 fontes e 127.392.827 autores; 123.311.614 works tinham alguma versão aberta. Culbert et al. (2025) mostraram cobertura de referências comparável à da Web of Science e do Scopus, com mais ORCID e menos resumos.
| Acesso | Detalhe (09/09/2026) |
|---|---|
| Custo | «Basic use is free»: orçamento diário gratuito de US$ 1; a chave gratuita (conta em openalex.org → settings/api) multiplica esse orçamento por 10. Planos pagos existem, mas não são necessários a estudantes |
| Limites | Máximo 100 requisições por segundo; ao estourar, HTTP 429. O cabeçalho X-RateLimit-Credits-Used mostra o custo de cada chamada |
| Boa prática | mailto= na URL continua aceito e identifica você |
| Site | Bloqueia acesso automatizado («Looks like you're a bot — please use our free API»); a interface exporta CSV, RIS (para o Zotero) e TXT (formato WoS); o VOSviewer lê o OpenAlex direto, até 50.000 registros |
curl -s 'https://api.openalex.org/works?per-page=1&select=id&mailto=seu@email.br' | python3 -c 'import json,sys; print(json.load(sys.stdin)["meta"]["count"])' # na demonstração (09/09/2026): 327599176
A URL da consulta é a estratégia de busca: guarde-a e qualquer pessoa repete a chamada. A resposta traz meta.count (o total do dia) e cada registro vem com DOI, tipo, ano, fonte, autores, status de acesso aberto e o resumo em índice invertido — o suficiente para a triagem, sem abrir nenhuma outra base.
Só "predictive maintenance" devolveu 99.032 works (2025: 27.551; 2026: 19.928; 2024: 14.505; 2023: 9.313). Por tipo: article 62.405, conference 14.366, preprint 6.499, dissertation 4.613, book-chapter 4.105, review 1.446. Fontes mais frequentes: Zenodo 3.525, arXiv 2.393, Sensors 1.280, Applied Sciences 1.197, Energies 1.052, IEEE Access 956. Em português, "manutenção preditiva" em título e resumo: 558 (pt 429, en 22, es 4). Com institutions.country_code:br: 609 works sobre manutenção preditiva com instituição brasileira.
Sintaxe da API: search ou filter, campos .search, vírgula e barra vertical, intervalos, group_by, cursor e limites
| Parâmetro | O que faz |
|---|---|
search= | Busca em título, resumo e texto completo, com stemming; ordena por relevância |
filter=title_and_abstract.search:… | Busca booleana só em título e resumo: aceita AND, OR, NOT, parênteses e aspas. Também title.search, abstract.search, fulltext.search, default.search |
| vírgula | Separa filtros — equivale a E: publication_year:2015-2026,type:article |
| | OU dentro de um filtro: type:article|book-chapter|preprint |
| intervalo | publication_year:2015-2026 |
select= | Só os campos que você precisa — resposta menor, mais rápida |
per-page= | Máximo 200 (201 devolve HTTP 400) |
page= | Só até 10.000 resultados (page=51 × 200 devolve 400). Além disso, use cursor=* e siga meta.next_cursor até vir vazio |
group_by= | Contagens por ano, tipo, fonte, idioma, open_access.oa_status, open_access.is_oa… |
sort= | cited_by_count:desc, por exemplo |
sample=100&seed=42 | Amostra aleatória reprodutível — para o piloto da triagem |
| citações | filter=cites:W… (quem cita); campos referenced_works e related_works |
is_retracted:false | Exclui os works marcados como retratados (135.236 em 09/09/2026) |
https://api.openalex.org/works
?filter=title_and_abstract.search:"predictive maintenance" AND (port OR terminal OR crane),
publication_year:2015-2026,
type:article|book-chapter|preprint
&select=id,doi,title,publication_year,authorships,primary_location,open_access,abstract_inverted_index,type
&per-page=200&cursor=*&mailto=seu@email.br# contagem por status de acesso aberto, sem baixar registros …&group_by=open_access.oa_status&per-page=1 # título com um conceito e resumo com o outro (deu 16 na demonstração) ?filter=title.search:"predictive maintenance",abstract.search:crane # excluir um contexto (deu 88 na demonstração) ?filter=title_and_abstract.search:"predictive maintenance" AND (port OR terminal OR crane) NOT wind # quem cita um work; autocompletar títulos ?filter=cites:W4411609619 /autocomplete/works?q=predictive maint
Para a busca sistemática, use filter=…search:, não search=: o primeiro é booleano e restrito a título e resumo; o segundo aplica stemming e inclui texto completo, o que muda o total e a precisão. A URL inteira é limitada a cerca de 4.000 caracteres.
Contar antes de baixar: cada filtro acrescentado, um meta.count anotado — e group_by para saber o que vem

search= → 2.193; title_and_abstract.search:"predictive maintenance" AND crane → 2.096; com (port OR terminal OR crane), 2015–2026 e tipos article, book-chapter e preprint → 235; group_by=open_access.is_oa → 181 abertos, 54 fechados.Q='https://api.openalex.org/works?per-page=1&select=id&mailto=seu@email.br' curl -s "$Q&search=%22predictive+maintenance%22+crane" | python3 -c 'import json,sys; print(json.load(sys.stdin)["meta"]["count"])' curl -s "$Q&filter=title_and_abstract.search:%22predictive+maintenance%22+AND+crane" | python3 -c 'import json,sys; print(json.load(sys.stdin)["meta"]["count"])' curl -s "$Q&filter=title_and_abstract.search:%22predictive+maintenance%22+AND+(port+OR+terminal+OR+crane),publication_year:2015-2026,type:article|book-chapter|preprint" | python3 -c 'import json,sys; print(json.load(sys.stdin)["meta"]["count"])' curl -s "$Q&filter=title_and_abstract.search:%22predictive+maintenance%22+AND+(port+OR+terminal+OR+crane),publication_year:2015-2026,type:article|book-chapter|preprint&group_by=open_access.is_oa"
| Passo (demonstração) | count |
|---|---|
search="predictive maintenance" crane (stemming, texto completo) | 2.193 |
title_and_abstract.search:"predictive maintenance" AND crane | 2.096 |
… AND (port OR terminal OR crane) | 410 |
… + publication_year:2015-2026 + type:article|book-chapter|preprint | 235 |
… group_by=open_access.is_oa | 181 / 54 |
… group_by=language | en 138 · fr 3 · id 2 |
Cada linha dessa tabela vai para o diário: é a história da estratégia, e é o que responde «por que 235 e não 2.193». Só depois de o total fazer sentido — nem zero nem dezenas de milhares — rode o download.
buscar_openalex.py: percorre todas as páginas com cursor e grava CSV, RIS e o diário JSON da busca

meta.count = 235, 2 páginas (200 + 36), 236 registros gravados, 207 com resumo, 226 com DOI; busca_openalex.csv, busca_openalex.ris (para o Zotero) e diario_busca_2026-09-09.json.python3 buscar_openalex.py '"predictive maintenance" AND (port OR terminal OR crane)' \
--campo title_and_abstract --desde 2015 --tipos article,book-chapter,preprint --email seu@email.br| Argumento | Uso |
|---|---|
consulta | A expressão booleana, entre aspas simples para o shell |
--campo | title_and_abstract (padrão), title, abstract, fulltext, default ou search (parâmetro search=, com stemming) |
--desde · --ate | Intervalo de anos; --ate assume o ano corrente |
--tipos | Tipos separados por vírgula → type:a|b|c |
--email | Obrigatório: vai em mailto= e no User-Agent |
--saida · --max | Prefixo dos arquivos (padrão busca_openalex); teto de registros (padrão 10.000) |
- CSV (title, abstract, year, doi, authors, source, is_oa, type, openalex_id): para o ASReview ou a planilha de triagem.
- RIS: «Arquivo → Importar…» no Zotero; o resumo vai no campo AB e o DOI no DO.
- Diário JSON: base, data, consulta, campo, filtros, total, gravados, com resumo, com DOI — cole no
BUSCA.mde no PRISMA-S. - Na demonstração o cursor devolveu 236 registros para um
meta.countde 235: acontece quando o índice muda entre páginas. O diário guarda os dois números; relate os dois.
contar_bases.py: a mesma pergunta em seis APIs — e por que os totais são tão diferentes

contar_bases.py '"predictive maintenance" crane' na demonstração deste manual (captura de 09/09/2026): OpenAlex 2.193; Crossref 468.421; PubMed 0; arXiv 1.294; DOAJ 6; Semantic Scholar 100.306.python3 contar_bases.py '"predictive maintenance" crane' --email seu@email.br
| Base | Como o script consulta | Total | Por que esse número |
|---|---|---|---|
| OpenAlex | works?search= | 2.193 | Stemming em título, resumo e texto completo |
| Crossref | works?query= | 468.421 | Relevância, não booleana: qualquer palavra conta |
| PubMed | esearch, convertido para "predictive maintenance"[tiab] AND crane | 0 | Nenhum artigo com os dois termos em título ou resumo; com (port OR crane), 7 |
| arXiv | search_query=all: | 1.294 | Todos os campos; com abs: e os três contextos, 5 |
| DOAJ | api/search/articles | 6 | Só periódicos listados no DOAJ; frase exata |
| Semantic Scholar | graph/v1/paper/search, sem chave | 100.306 | Sem operadores booleanos; nesta chamada não houve 429 |
Totais diferentes são normais: cobertura, campos pesquisados e interpretação da consulta variam. O que não pode variar é o registro: anote todos, com o endpoint e a data. O script imprime a data e essa observação no fim da tabela.
Verificar o acesso aberto: um DOI com curl, uma lista inteira com verificar_oa.py

is_oa, oa_status e o endereço do PDF em best_oa_location.curl -s 'https://api.unpaywall.org/v2/10.1136/bmj.n71?email=seu@email.br' | python3 -c 'import json,sys; d=json.load(sys.stdin); print(d["is_oa"], d["oa_status"], (d.get("best_oa_location") or {}).get("url_for_pdf"))'
# na demonstração: True hybrid https://www.bmj.com/… · 10.1007/s11192-018-2958-5 → hybrid, PDF no Springer · 10.1002/jrsm.1378 → hybrid, PDF na Wiley
verificar_oa.py em 5 DOIs da amostra da demonstração deste manual (captura de 09/09/2026): 3 com versão aberta (gold, hybrid, gold — 2 gold da MDPI, 1 hybrid da Elsevier) e 2 closed.python3 verificar_oa.py busca_openalex.csv busca_openalex_oa.csv --email seu@email.br # saída na demonstração: 5 registros · 3 com versão aberta · gravado (arquivo de saída) # --max N limita o número de DOIs consultados
Rode o verificar_oa.py sobre o CSV dos incluídos, não sobre os 235: cada DOI é uma chamada. A coluna pdf_url é o link legítimo do PDF; o que ficar closed vai para a biblioteca, o CAFe ou o autor (Parte 4). Note que o OpenAlex já traz is_oa por registro; o Unpaywall acrescenta o oa_status e o endereço do PDF.
Importar o RIS no Zotero, uma coleção por base e data — e seguir para a deduplicação e a triagem
- Crie uma coleção por base e por data («OpenAlex 2026-09-09», «IEEE Xplore 2026-09-09», «PubMed 2026-09-09»…). O total de cada coleção é o «n» dessa base no fluxograma.
- «Arquivo» → «Importar…» → escolha
busca_openalex.ris(o script grava um registro por linha do CSV, com TI, AU, PY, JO, DO, AB e UR). O Zotero aceita RIS, BibTeX, CSV e.nbib. - Repita para cada exportação das outras bases (Parte 4, «Exportar de cada base»).
- Deduplique — «Itens duplicados» no Zotero e/ou o
deduplicar.pydo manual de revisão sistemática — e anote quantos saíram. - Exporte a coleção consolidada em CSV ou RIS para a triagem no ASReview LAB (manual de PRISMA, Parte 3).
TY - JOUR TI - Machine Learning-Based Predictive Maintenance at Smart Ports Using IoT Sensor Data AU - … PY - … JO - … DO - 10.xxxx/… AB - … UR - https://openalex.org/W4411609619 ER -
| Arquivo | Para onde vai |
|---|---|
busca_openalex.ris | Zotero → coleção da base e data |
busca_openalex.csv | ASReview LAB (colunas title, abstract, doi) ou planilha de triagem |
diario_busca_2026-09-09.json | 01_buscas/BUSCA.md e a checklist PRISMA-S |
busca_openalex_oa.csv | Planilha de texto completo: quem tem PDF aberto e onde |
Importações grandes: a documentação do Zotero recomenda exportar em lote (RIS/BibTeX) em vez de salvar página a página com o Connector, para não ser bloqueado pela base. O RIS do script já é o lote.
Coleções, etiquetas, «Itens duplicados», PDFs e o estilo ABNT: manual do Zotero. Deduplicação com script, triagem com aprendizado ativo e o fluxograma: manual de revisão sistemática com PRISMA 2020. Aqui termina a busca e começa a revisão.
As outras APIs numa tabela: endpoint, limite e chave — para repetir a busca fora do OpenAlex
| API | Endpoint | Limite | Chave | Observação |
|---|---|---|---|---|
| OpenAlex | api.openalex.org/works | 100 req/s; orçamento diário gratuito (US$ 1); per-page ≤ 200; cursor para > 10.000 | Opcional (×10 no orçamento) | JSON; mailto=; dados CC0 |
| Crossref | api.crossref.org/works | Cabeçalhos X-Rate-Limit-Limit / -Interval (ex.: 50 req/s); rows ≤ 1.000; offset ≤ 10.000; cursor=* | Não; mailto= → pool «polite»; Plus é pago | Relevância; filtros type:journal-article, from-pub-date:2015, has-abstract:true; query.bibliographic= resolve DOI |
| PubMed E-utilities | eutils.ncbi.nlm.nih.gov/entrez/eutils/esearch.fcgi (esearch, esummary, efetch) | 3 req/s sem chave; 10 req/s com chave | Opcional (conta NCBI → Settings) | Mesma sintaxe da interface (tags, MeSH); devolve querytranslation |
| arXiv | export.arxiv.org/api/query | 1 chamada a cada 3 s; max_results ≤ 2.000; 30.000 no total; start | Não | Atom/XML; prefixos ti:, au:, abs:, cat:, all:; AND, OR, ANDNOT; metadados CC0 |
| DOAJ | doaj.org/api/search/articles/{consulta} | 2 req/s | Não | Elasticsearch; sem curingas nem fuzzy |
| Semantic Scholar | api.semanticscholar.org/graph/v1/paper/search | Sem chave: cota compartilhada por todos os anônimos (429 frequente); com chave: 1 req/s inicial | Formulário no site; chega por e-mail | fields, limit, offset/token, year, venue, minCitationCount; /search/bulk |
| Unpaywall | api.unpaywall.org/v2/{DOI}?email= | 100.000 chamadas/dia | Não; e-mail obrigatório | is_oa, oa_status, best_oa_location |
| Sem API aberta | Google Acadêmico · IEEE Xplore (chave) · BASE (registro do IP) · CORE (chave) · Scopus (chave + assinante) | — | — | Use a interface e exporte; anote a data |
Um script por API, cada um com mailto ou User-Agent identificando você, respeitando o limite e gravando a URL, a data e o total. Os três scripts deste manual seguem essa regra e só usam a biblioteca padrão do Python — não há nada para instalar.
Rodar o script em laço até tomar 429. O 429 do OpenAlex e do Semantic Scholar é o serviço dizendo «devagar». Pare, espere, e reduza o ritmo; no Semantic Scholar, peça a chave.
Exportar para o Zotero, obter o PDF, seguir as citações, criar alertas, avaliar o periódico — e registrar tudo
A busca só vale quando os registros estão numa biblioteca, os PDFs foram obtidos por vias legítimas, as citações dos incluídos foram seguidas, a busca atualizada está agendada e cada consulta tem uma linha no diário com data, total, arquivo e hash.
Exportar de cada base para o Zotero: o botão, o formato e o caminho de importação
| Base | Botão na interface | Formato / caminho no Zotero |
|---|---|---|
| Portal CAPES | Marcar itens ou «Selecionar tudo» → «Exportar» | Arquivo exportado → «Arquivo → Importar…» |
| Google Acadêmico | «Citar» em cada item → BibTeX, EndNote, RefMan, RefWorks; ou ícone de pasta do Zotero Connector na página de resultados | BibTeX → «Importar…»; Connector salva direto na coleção (pede CAPTCHA em lotes) |
| IEEE Xplore | Marcar itens → «Export» | Citações → «Importar…» |
| Semantic Scholar | «Cite» → BibTeX, MLA, APA, Chicago, EndNote; integração com Zotero | BibTeX → «Importar…» |
| PubMed | «Send to → Citation manager» | .nbib → «Importar…» |
| SciELO | Marcar itens → «Exportar» | Arquivo exportado → «Importar…» |
| BDTD | «Exportar» | Arquivo exportado → «Importar…» |
| BASE | «Export Record» em cada registro | Registro → «Importar…» |
| arXiv | Identificador arXiv no registro | «Adicionar item por identificador» (DOI, ISBN, PMID, arXiv ID) |
| OpenAlex | Interface: CSV, RIS, TXT (WoS); script: busca_openalex.ris | RIS → «Importar…» |
| Scopus · Web of Science | Exportação do assinante (RIS/BibTeX) | «Importar…»; arquivo fica fora de repositórios públicos |
- Antes de exportar, crie no Zotero a coleção «Base AAAA-MM-DD» e deixe-a selecionada: o que entrar vai para ela.
- Prefira a exportação em lote (RIS, BibTeX,
.nbib) ao Connector página a página — a documentação do Zotero recomenda isso para importações grandes, para não ser bloqueado pela base. - Quando a base só dá o identificador (DOI, PMID, arXiv ID), use «Adicionar item por identificador»: o Zotero busca os metadados.
- Confira o total da coleção contra o total anotado no diário. Se diferir, a exportação ficou incompleta — repita antes de seguir.
O Connector detecta proxies institucionais (EZproxy) e oferece lembrar («Enable proxy redirection»; também dá para adicionar um proxy manualmente com «+»). Isso é conveniência para abrir PDFs pela biblioteca — a senha é sempre digitada na página da sua instituição, nunca no Zotero.
Versões do Zotero em 2026: 8 (22/01), 9 (10/04) e 10 (17/08) — ciclo de 6 a 10 semanas. Menus, «Itens duplicados», etiquetas por revisor e o estilo ABNT estão no manual do Zotero.
Obter o PDF: Unpaywall, «Encontrar PDF disponível» no Zotero, resolvedor da biblioteca, CAFe — e o autor
pdf_url do verificar_oa.py; selo «PDF» no Semantic Scholar; «Free PMC article» no PubMed; PDF do SciELO e do repositório (BDTD, BASE)| Onde o PDF costuma estar | Como saber |
|---|---|
| Periódico aberto (gold, diamond) | Fonte listada no DOAJ; oa_status: gold; no OpenAlex, a fonte aparece como OA |
| Repositório (green) | BASE («Content Provider»), oasisbr, BDTD; best_oa_location do Unpaywall |
| Editor por assinatura | Cadeado no IEEE Xplore; «Não» no filtro «Acesso aberto» do Portal CAPES → via biblioteca ou CAFe |
Só vias legítimas: versão aberta, biblioteca, assinatura da instituição, autor. O que não se obtém assim é «não obtido» — com número no fluxograma e menção nas limitações. O manual não indica nem recomenda nenhum outro caminho.
Dos 235 works do OpenAlex, 181 tinham alguma versão aberta (group_by=open_access.is_oa); dos 5 DOIs testados no verificar_oa.py, 3 tinham PDF aberto. Na demonstração, a via 1 resolveria a maior parte; a biblioteca resolve o resto.
Busca por citações: para trás (referências) e para a frente (quem citou) — com o OpenAlex, o citationchaser e a declaração TARCiS
A busca por citações complementa a busca por bases: partindo dos estudos incluídos, seguem-se as referências (para trás) e as citações recebidas (para a frente), em rodadas, até que nenhuma rodada traga inclusão nova. Wohlin (2014) formalizou o procedimento para engenharia de software; o citationchaser (Haddaway, Grainger e Gray, 2022) automatiza as duas direções; a declaração TARCiS (Hirt et al., 2024) traz 10 recomendações de terminologia, aplicação e relato.
# para a frente: works que citam W4411609619 (8 na demonstração) curl -s 'https://api.openalex.org/works?filter=cites:W4411609619&select=id,doi,title,publication_year&per-page=200&mailto=seu@email.br' # para trás: as referências (36) e os relacionados (10) vêm no próprio registro curl -s 'https://api.openalex.org/works/W4411609619?select=id,title,referenced_works,related_works&mailto=seu@email.br'
| Onde | Para trás | Para a frente |
|---|---|---|
| OpenAlex | referenced_works | filter=cites:W… |
| Google Acadêmico | Lista de referências do PDF | «Citado por»; «Artigos relacionados» |
| Semantic Scholar | Referências do artigo (site e API) | Citações (site e API) |
| citationchaser | As duas direções, a partir de uma lista de identificadores; para revisões sistemáticas | |
Faça a busca por citações depois da triagem de texto completo, a partir dos incluídos de verdade. Registre a rodada, a data, a fonte e quantos registros novos vieram: no fluxograma do PRISMA entram como «Citation searching (n = )», na coluna de «outros métodos»; o PRISMA-S e a TARCiS pedem a descrição do procedimento.
O work W4411609619 («Machine Learning-Based Predictive Maintenance at Smart Ports Using IoT Sensor Data») tinha 36 referências, 8 citações e 10 related_works no OpenAlex em 09/09/2026: uma rodada de snowballing a partir dele examinaria 44 registros.
Alertas e busca atualizada: a mesma consulta, meses depois, como nova entrada no diário
| Base | Como criar o alerta ou repetir a busca |
|---|---|
| Google Acadêmico | Alerta por e-mail para a consulta (não exige conta) |
| PubMed | «Create alert» ou «Create RSS» na página de resultados; «Saved Search» com alerta por e-mail |
| IEEE Xplore | «Set Search Alerts» na página de resultados; «Search History» guarda as consultas |
| Semantic Scholar | Alertas e «Research Feeds», com a conta gratuita |
| OpenAlex | Repetir a URL do diário; ajustar publication_year para o novo intervalo |
| arXiv | Repetir a busca ordenada por data; a API aceita start para paginar |
- Crie o alerta no dia da busca, com a mesma consulta do diário — assim o que chegar por e-mail é comparável.
- Antes de submeter a revisão, rode a busca atualizada em todas as bases: mesma consulta, mesmos filtros, nova data.
- Anote como nova entrada no
BUSCA.md, com o total novo; os registros novos passam pela mesma triagem. - No artigo, informe a data da última busca de cada base (PRISMA-S: «atualização da busca»).
## OpenAlex (api.openalex.org) — 2027-02-15 (atualização) - consulta: (a mesma de 2026-09-09) - filtros: publication_year:2015-2027, type:article|book-chapter|preprint - total: … · novos desde 2026-09-09: … - arquivo: 01_buscas/busca_openalex_2027-02-15.csv · hash: …
O alerta não substitui a busca atualizada: ele avisa, mas não gera o total nem o arquivo. O que vai para o PRISMA-S é a execução completa, com data.
Avaliar o periódico: o Qualis na Plataforma Sucupira, o SJR, o DOAJ e o que o OpenAlex já diz sobre a fonte

- Abra sucupira-legado.capes.gov.br → «Qualis» → «Qualis Periódicos». Escolha o «Evento de Classificação» (obrigatório) e, se quiser, a «Área de Avaliação».
- Digite o ISSN ou o título e clique em «Consultar»: o resultado é o estrato do periódico naquele evento e naquela área.
- Para um periódico internacional, confira também o SCImago Journal Rank (SJR; dados do Scopus): quartis Q1–Q4 e H-index. O site usa verificação anti-robô — consulte manualmente.
- Confira se está no DOAJ (periódico aberto listado) e, no OpenAlex, o registro da fonte.
| Fonte no OpenAlex (demonstração) | O que o registro traz |
|---|---|
| Journal of Marine Science and Engineering (S2736865057) | OA; no DOAJ; 14.286 works; h-index 93; APC US$ 3.137; editora MDPI |
| SciELO (publisher P4310312277) | 41.172 works |
| Fontes brasileiras | 3.777 sources, 1.253 delas no DOAJ |
Em 09/09/2026 as páginas da CAPES sobre o Qualis estavam fora do ar; este manual usa só o que a Sucupira mostra. O estrato depende do evento de classificação e da área — anote os dois ao citar um Qualis.
Periódicos predatórios e retratações: a checklist «Think. Check. Submit.», a Retraction Watch Database e is_retracted


Grudniewicz e colegas (2019, Nature) propuseram a definição consensual de periódico predatório. A checklist «Think. Check. Submit.» pergunta: você conhece o periódico? o editor está identificado? a revisão por pares é descrita? está indexado (DOAJ, Scopus…)? as taxas são claras? é membro do COPE?
- Ao avaliar um resultado da busca: periódico desconhecido → passe pela checklist e confira DOAJ, Qualis e SJR antes de incluir.
- Retratações: o OpenAlex marca
is_retracted(135.236 works em 09/09/2026) — acrescenteis_retracted:falseao filtro, ou verifique os incluídos na Retraction Watch Database. - Um artigo retratado que já foi incluído não desaparece do fluxograma: fica registrado e é excluído com motivo, na data em que você soube.
Para a sua própria submissão, a mesma checklist vale ao contrário: escolha o periódico com a «Think. Check. Submit.», o Qualis da sua área e o DOAJ. Onde as taxas não são claras e o editor não se identifica, não submeta.
Registrar no diário e no PRISMA-S: uma tabela por base — data, consulta, filtros, total, arquivo, hash
| Base (plataforma) | Data | Consulta (verbatim) | Filtros | Total | Arquivo · hash |
|---|---|---|---|---|---|
| OpenAlex (API) | 2026-09-09 | title_and_abstract.search:"predictive maintenance" AND (port OR terminal OR crane) | 2015–2026; article|book-chapter|preprint | 235 | busca_openalex.csv · sha256 … |
| IEEE Xplore (site) | 2026-09-09 | "predictive maintenance" AND crane | — | 18 | «Export» · sha256 … |
| PubMed (site) | 2026-09-09 | "predictive maintenance"[tiab] AND (port[tiab] OR crane[tiab]) | — | 7 | .nbib · sha256 … |
| arXiv (API) | 2026-09-09 | abs:"predictive maintenance" AND (abs:port OR abs:crane OR abs:terminal) | — | 5 | Atom · sha256 … |
| BASE (site) | 2026-09-09 | "predictive maintenance" crane | Verbatim search | 71 | «Export Record» · sha256 … |
| Semantic Scholar (site) | 2026-09-09 | "predictive maintenance" crane port | — | ≈ 3.240 | complementar; sem exportação em lote |
| Portal CAPES (site, sem login) | 2026-09-09 | "manutenção preditiva" | — | 64 | «Exportar» · sha256 … |
| SciELO (search.scielo.org) | 2026-09-09 | "manutenção preditiva" | — | 7 | «Exportar» · sha256 … |
| BDTD (site) | 2026-09-09 | "manutenção preditiva" | — | 288 | «Exportar» · sha256 … |
| oasisbr (site) | 2026-09-09 | "manutenção preditiva" | — | 1.053 | contém a BDTD; não somar |
A tabela é o material suplementar do item 7 do PRISMA e dos 16 itens do PRISMA-S: uma linha por base e por execução, a consulta como a base a exibiu, os filtros, o total do dia, o arquivo e o hash. As consultas em português e em inglês são entradas distintas. Registre também o que não rodou e por quê (por exemplo, Scopus sem assinatura).
Somar os totais para dizer «encontramos N registros». O «n» de identificação do fluxograma é por base; a soma vem antes da deduplicação e só faz sentido com o número de duplicatas removidas ao lado. O oasisbr contém a BDTD; o mesmo artigo aparece em mais de uma base — é a deduplicação que diz quantos.
Plugin, erros comuns, checklist, glossário e referências
Como o plugin Pesquisa MirandasTech conduz a fase de busca com este manual como fonte; o que costuma dar errado; a lista para conferir antes de fechar a busca; os termos; as fontes — e como citar.
Tudo num só plugin: o Pesquisador conduz a fase 4, «Busca e biblioteca», com este manual como fonte
O plugin Pesquisa MirandasTech (para Claude Code e Codex) coloca os papéis dos manuais dentro do assistente, com um estado único (PROGRESSO.md) e um gerente — o Pesquisador — que só fecha uma fase com evidência. Na fase 4 ele exige o que este manual manda produzir: as strings verbatim com data, filtros, total e hash em 01_buscas/, a coleção por base e data no Zotero, e o diário. A skill revisao-sistematica-prisma segue daí para a triagem; o Bibliotecário cuida da biblioteca.
| Papel | O que faz com este manual | Slides |
|---|---|---|
| Pesquisador (fase 4) | Confere que cada base tem entrada no BUSCA.md com consulta, filtros, total, arquivo e hash; que a consulta à API foi gravada com data; que o Zotero tem uma coleção por base | Partes 1, 3 e 4 |
| Skill revisao-sistematica-prisma | Leva os arquivos de 01_buscas/ para a deduplicação, a triagem e o fluxograma | Manual de PRISMA |
| Bibliotecário | Audita a biblioteca do Zotero: coleções, duplicatas, PDFs faltantes, metadados | Parte 4 |
Pesquisador, onde paramos? Pesquisador, o que falta para fechar a fase 4? Bibliotecário, audite a coleção «OpenAlex 2026-09-09»: quantos itens, quantos sem DOI? /pesquisa:status /pesquisa:proxima
O plugin não busca por você: ele confere que os arquivos existem, que as contagens têm data e que a consulta pode ser repetida. A estratégia, a escolha das bases e a decisão sobre cada registro continuam sendo suas.
Metodologia decide a pergunta e o método; este manual busca; Zotero registra a biblioteca; Revisão sistemática com PRISMA 2020 deduplica, tria e relata; Uso de IA delega e declara; o plugin mantém a ordem. Hub: mirandastech.com.br/pesquisa.
Erros comuns — como aparecem e como corrigir
| Erro | Como aparece | Causa | Correção |
|---|---|---|---|
| Uma base só | Revisão com «n» de identificação de uma fonte | Hábito; a base «da área» parece bastar | ao menos três fontes; Bramer et al. (2017) |
| Google Acadêmico como base principal | Busca que ninguém consegue repetir; 1.000 resultados no máximo | Resultado varia por conta, dia e lugar | complemento, com data e páginas examinadas |
| String de uma base colada em outra | Zero resultados, ou milhares | [tiab], abs:, .search: não são universais | tabela de sintaxe (slide 7); uma tradução por base |
| Só termos livres, sem vocabulário controlado | Perde o artigo que usou outra palavra | Não consultou MeSH/DeCS | um bloco por conceito com os dois tipos de termo |
search= em vez de filter=…search: no OpenAlex | Total muito maior; resultados por relevância | Stemming e texto completo | filtro booleano em título e resumo |
| Baixar sem contar | Milhares de registros para triar — ou zero | Não olhou o meta.count | per-page=1 e group_by antes do download |
page= além de 10.000 | HTTP 400 no meio do download | Limite da paginação por página | cursor=* e next_cursor |
| Total da Crossref como «n» da base | Centenas de milhares de «resultados» | Busca por relevância | Crossref só para DOIs e metadados |
| Consulta anotada de memória | Item 7 do PRISMA e PRISMA-S incompletos | Não copiou a consulta da caixa depois de rodar | verbatim, no dia, no BUSCA.md |
| Total sem data | Número que não bate meses depois | As bases mudam todo dia | data e hash do arquivo em cada entrada |
| Somar os totais das bases | «Encontramos 1.700 registros» | Sobreposição (oasisbr contém a BDTD) | um «n» por base; duplicatas contadas depois |
| Salvar página a página com o Connector | CAPTCHA; base bloqueia | Importação grande item a item | exportar em lote (RIS, BibTeX, .nbib) |
| PDF «não obtido» descartado | Caixa «Reports not retrieved» em zero | Tratou falta de acesso como exclusão | registrar tentativas; caixa própria; limitação |
| Periódico não conferido | Predatório ou retratado entre os incluídos | Não passou pela checklist | Think. Check. Submit.; DOAJ; is_retracted:false |
| Senha digitada fora da instituição | Credencial exposta | Página de login falsa ou script que «faz login» | só Acesso CAFe → instituição → página da instituição |
Checklist final: antes de fechar a busca
Marque conforme concluir. O estado fica salvo neste navegador — não é compartilhado nem enviado a lugar nenhum.
Glossário
Tudo que aparece no manual sem ser explicado no próprio slide.
Busca e estratégia
- Base de dados
- Coleção de registros bibliográficos com busca por campos, filtros e exportação; a unidade em que se conta o «n» da identificação.
- Índice
- Sistema que indexa documentos de muitas fontes para busca (Google Acadêmico, OpenAlex); nem sempre exporta ou aceita operadores.
- Agregador
- Serviço que reúne registros de repositórios ou periódicos (BASE, oasisbr, CORE) e remete ao provedor de origem.
- Vocabulário controlado
- Lista fechada de descritores, um por assunto, independente da palavra usada pelo autor; MeSH e DeCS.
- MeSH
- Medical Subject Headings: vocabulário controlado do PubMed; tag
[mh]; MeSH Browser em meshb.nlm.nih.gov. - DeCS
- Descritores em Ciências da Saúde: vocabulário controlado trilíngue (PT/ES/EN) da BVS/LILACS, alinhado ao MeSH.
- Operador booleano
- AND (todos os termos), OR (qualquer um), NOT (exclui); parênteses agrupam. OR dentro do conceito, AND entre conceitos.
- Truncamento
- Curinga que recupera variantes de um radical (
*no PubMed; curingas no arXiv); o OpenAlex aplica stemming emsearch=. - Campo de busca
- Parte do registro em que a base procura o termo: título, resumo, autor, palavras-chave, texto completo;
[tiab],title_and_abstract.search. - Recall (sensibilidade)
- Proporção dos estudos relevantes que a busca recuperou; Bramer et al. (2016) mediram 46,4% para o Google Scholar.
- Precisão
- Proporção dos registros recuperados que são relevantes; sobe com campos restritos e cai com
search=em texto completo. - Estratégia de busca
- A consulta completa de cada base, com filtros e limites, tal como foi rodada; item 7 do PRISMA 2020.
- Diário de busca
- Arquivo (
BUSCA.md) com uma entrada por base e execução: data, consulta, filtros, total, arquivo, hash. - PRISMA-S
- Extensão do PRISMA para o relato da busca: 16 itens em quatro seções (fontes e métodos; estratégias; revisão por pares; gestão dos registros).
- PRESS
- Peer Review of Electronic Search Strategies: lista de verificação para que outra pessoa revise a estratégia antes de rodar (McGowan et al., 2016).
- Literatura cinzenta
- Teses, dissertações, relatórios e outros documentos fora dos periódicos; BDTD, oasisbr, Catálogo de Teses, Google Acadêmico.
- Snowballing
- Busca por citações a partir dos incluídos: para trás (referências) e para a frente (quem citou), em rodadas.
Acesso, API e avaliação
- API
- Application Programming Interface: endereço que devolve os dados da base em JSON ou XML para um script; a URL é a consulta.
- Cursor (paginação)
- Marcador devolvido pela API (
meta.next_cursor) para pedir a página seguinte além do limite depage=. - DOI
- Digital Object Identifier: identificador persistente de uma publicação, registrado na Crossref; base da deduplicação e do Unpaywall.
- Acesso aberto (OA)
- Versão do artigo livre para leitura. gold: periódico aberto; diamond: aberto sem taxa; hybrid: aberto em periódico por assinatura; green: cópia em repositório; bronze: livre no editor sem licença; closed: nenhuma.
- CAFe
- Comunidade Acadêmica Federada (RNP): acesso remoto ao conteúdo assinado pelo Portal CAPES com o login da sua instituição.
- Proxy
- Servidor da biblioteca (EZproxy) que autentica você e repassa o acesso ao editor; o Zotero Connector o detecta.
- OpenURL
- Padrão do resolvedor de links da biblioteca: leva de um registro ao texto completo assinado («Library Lookup» no Zotero; «Links de biblioteca» no Google Acadêmico).
- Qualis
- Classificação de periódicos da CAPES por área e evento de classificação (A1–A4, B1–B4, C); consulta pública na Plataforma Sucupira.
- SJR
- SCImago Journal Rank: indicador de periódicos com dados do Scopus; quartis Q1–Q4 e H-index.
- Periódico predatório
- Periódico que cobra e publica sem revisão por pares real nem transparência (Grudniewicz et al., 2019); checklist Think. Check. Submit.
- Retratação
- Retirada formal de um artigo publicado; Retraction Watch Database;
is_retractedno OpenAlex. - RIS / BibTeX / .nbib
- Formatos de exportação de referências: RIS (genérico, o do
buscar_openalex.py), BibTeX (LaTeX, Google Acadêmico, Semantic Scholar),.nbib(PubMed); o Zotero importa os três. - TLDR
- Resumo de uma frase gerado por IA no Semantic Scholar (computação e biomedicina).
- Polite pool
- Fila da API da Crossref para quem se identifica com
mailto=; o OpenAlex também aceitamailto=. - HTTP 429
- Resposta «muitas requisições»: o serviço pede que o script diminua o ritmo (OpenAlex, Semantic Scholar).
Referências (1 de 2): cobertura das bases, método de busca e relato
- BRAMER, W. M.; GIUSTINI, D.; KRAMER, B. M. R. Comparing the coverage, recall, and precision of searches for 120 systematic reviews in Embase, MEDLINE, and Google Scholar: a prospective study. Systematic Reviews, v. 5, 39, 2016.doi.org/10.1186/s13643-016-0215-7
- BRAMER, W. M.; RETHLEFSEN, M. L.; KLEIJNEN, J.; FRANCO, O. H. Optimal database combinations for literature searches in systematic reviews: a prospective exploratory study. Systematic Reviews, v. 6, 245, 2017.doi.org/10.1186/s13643-017-0644-y
- BRAMER, W. M.; DE JONGE, G. B.; RETHLEFSEN, M. L. et al. A systematic approach to searching: an efficient and complete method to develop literature searches. Journal of the Medical Library Association, v. 106, n. 4, p. 531-541, 2018.doi.org/10.5195/jmla.2018.283
- GUSENBAUER, M. Google Scholar to overshadow them all? Comparing the sizes of 12 academic search engines and bibliographic databases. Scientometrics, v. 118, n. 1, p. 177-214, 2019 (online 2018).doi.org/10.1007/s11192-018-2958-5
- GUSENBAUER, M. Search where you will find most: Comparing the disciplinary coverage of 56 bibliographic databases. Scientometrics, v. 127, n. 5, p. 2683-2745, 2022.doi.org/10.1007/s11192-022-04289-7
- GUSENBAUER, M.; HADDAWAY, N. R. Which academic search systems are suitable for systematic reviews or meta-analyses? Evaluating retrieval qualities of Google Scholar, PubMed, and 26 other resources. Research Synthesis Methods, v. 11, n. 2, p. 181-217, 2020.doi.org/10.1002/jrsm.1378
- HADDAWAY, N. R.; COLLINS, A. M.; COUGHLIN, D.; KIRK, S. The Role of Google Scholar in Evidence Reviews and Its Applicability to Grey Literature Searching. PLoS ONE, v. 10, n. 9, e0138237, 2015.doi.org/10.1371/journal.pone.0138237
- HADDAWAY, N. R.; GRAINGER, M. J.; GRAY, C. T. Citationchaser: A tool for transparent and efficient forward and backward citation chasing in systematic searching. Research Synthesis Methods, 2022.doi.org/10.1002/jrsm.1563
- HIRT, J.; NORDHAUSEN, T.; APPENZELLER-HERZOG, C. et al. Guidance on terminology, application, and reporting of citation searching: the TARCiS statement. BMJ, 2024.doi.org/10.1136/bmj-2023-078384
- RETHLEFSEN, M. L.; KIRTLEY, S.; WAFFENSCHMIDT, S. et al. PRISMA-S: an extension to the PRISMA Statement for Reporting Literature Searches in Systematic Reviews. Systematic Reviews, v. 10, 39, 2021.doi.org/10.1186/s13643-020-01542-z
- McGOWAN, J.; SAMPSON, M.; SALZWEDEL, D. M. et al. PRESS Peer Review of Electronic Search Strategies: 2015 Guideline Statement. Journal of Clinical Epidemiology, v. 75, p. 40-46, 2016.doi.org/10.1016/j.jclinepi.2016.01.021
- WOHLIN, C. Guidelines for snowballing in systematic literature studies and a replication in software engineering. In: EASE 2014.doi.org/10.1145/2601248.2601268
- CARRERA-RIVERA, A.; OCHOA, W.; LARRINAGA, F.; LASA, G. How-to conduct a systematic literature review: A quick guide for computer science research. MethodsX, v. 9, 101895, 2022.doi.org/10.1016/j.mex.2022.101895
Referências (2 de 2): OpenAlex, Crossref, acesso aberto, bases e periódicos
- PRIEM, J.; PIWOWAR, H.; ORR, R. OpenAlex: A fully-open index of scholarly works, authors, venues, institutions, and concepts. arXiv:2205.01833, 2022.arxiv.org/abs/2205.01833
- CULBERT, J. H.; HOBERT, A.; JAHN, N. et al. Reference coverage analysis of OpenAlex compared to Web of Science and Scopus. Scientometrics, v. 130, n. 4, p. 2475-2492, 2025.doi.org/10.1007/s11192-025-05293-3
- PIWOWAR, H.; PRIEM, J.; LARIVIÈRE, V. et al. The state of OA: a large-scale analysis of the prevalence and impact of Open Access articles. PeerJ, v. 6, e4375, 2018.doi.org/10.7717/peerj.4375
- KINNEY, R.; ANASTASIADES, C.; AUTHUR, R. et al. The Semantic Scholar Open Data Platform. arXiv:2301.10140, 2023.arxiv.org/abs/2301.10140
- KNOTH, P.; HERRMANNOVA, D.; CANCELLIERI, M. et al. CORE: A Global Aggregation Service for Open Access Papers. Scientific Data, v. 10, 366, 2023.doi.org/10.1038/s41597-023-02208-w
- HOOK, D. W.; PORTER, S. J.; HERZOG, C. Dimensions: Building Context for Search and Evaluation. Frontiers in Research Metrics and Analytics, v. 3, 2018.doi.org/10.3389/frma.2018.00023
- MARTÍN-MARTÍN, A.; THELWALL, M.; ORDUNA-MALEA, E.; DELGADO LÓPEZ-CÓZAR, E. Google Scholar, Microsoft Academic, Scopus, Dimensions, Web of Science, and OpenCitations' COCI: a multidisciplinary comparison of coverage via citations. Scientometrics, v. 126, n. 1, p. 871-906, 2021.doi.org/10.1007/s11192-020-03690-4
- VISSER, M.; VAN ECK, N. J.; WALTMAN, L. Large-scale comparison of bibliographic data sources: Scopus, Web of Science, Dimensions, Crossref, and Microsoft Academic. Quantitative Science Studies, v. 2, n. 1, p. 20-41, 2021.doi.org/10.1162/qss_a_00112
- SINGH, V. K.; SINGH, P.; KARMAKAR, M.; LETA, J.; MAYR, P. The journal coverage of Web of Science, Scopus and Dimensions: A comparative analysis. Scientometrics, v. 126, n. 6, p. 5113-5142, 2021.doi.org/10.1007/s11192-021-03948-5
- GRUDNIEWICZ, A.; MOHER, D.; COBEY, K. D. et al. Predatory journals: no definition, no defence. Nature, v. 576, n. 7786, p. 210-212, 2019.doi.org/10.1038/d41586-019-03759-y
- PACKER, A. L. A eclosão dos periódicos do Brasil e cenários para o seu porvir. Educação e Pesquisa, v. 40, n. 2, p. 301-323, 2014.doi.org/10.1590/s1517-97022014061860
- MUGNAINI, R.; DIGIAMPIETRI, L. A.; MENA-CHALCO, J. P. Comunicação científica no Brasil (1998-2012): indexação, crescimento, fluxo e dispersão. Transinformação, v. 26, n. 3, p. 239-252, 2014.doi.org/10.1590/0103-3786201400030002
- MENDES, K. D. S.; SILVEIRA, R. C. C. P.; GALVÃO, C. M. Uso de gerenciador de referências bibliográficas na seleção dos estudos primários em revisão integrativa. Texto & Contexto - Enfermagem, v. 28, 2019.doi.org/10.1590/1980-265x-tce-2017-0204
Como citar este manual, declaração de uso de IA e licença
MATIAS, J. P. M. Busca em bases científicas: passo a passo. MirandasTech, v1.0, set. 2026. CC BY 4.0.
Manuais irmãos: prisma.mirandastech.com.br · zotero.mirandastech.com.br · metodologia.mirandastech.com.br · manual.mirandastech.com.br · plugin.mirandastech.com.br · hub: mirandastech.com.br/pesquisaConteúdo, capturas e os scripts buscar_openalex.py, contar_bases.py e verificar_oa.py: CC BY 4.0 — use, copie, adapte e redistribua com atribuição. Os dados do OpenAlex, da Crossref e do arXiv citados são CC0 dos seus mantenedores. Nenhum vínculo ou endosso da CAPES, da RNP, do IBICT, do Google, da IEEE, do Ai2, da NLM, do arXiv, do SciELO, da Universidade de Bielefeld, do DOAJ, da OurResearch, da Crossref, da Elsevier, da Clarivate ou de qualquer outra base ou ferramenta citada.
Este manual foi escrito com assistência de IA (Claude, Anthropic) na estruturação, na redação e na verificação de fatos, sob as regras do manual de Uso de IA na pesquisa científica. Todos os fatos, números, nomes de botões, limites de API e referências foram conferidos nas fontes indicadas em 09/09/2026; as buscas nas interfaces, as chamadas às APIs e as execuções dos três scripts foram feitas nessa data, sem login em nenhuma base. Decisões de conteúdo, seleção das fontes e responsabilidade pelo texto são do autor.