STRING: Search proteins by amino acid sequence
string_sequence_searchSearches the STRING database using amino acid sequences to identify matching proteins.
Accepts a single sequence or multiple sequences in FASTA format.
Returns the most similar STRING protein(s) for the specified species, based on sequence similarity.
Use this when the protein identifier is unknown or unresolvable by
string_resolve_proteins.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| species | No | Required. NCBI or STRING taxonomy ID. You can query with a clade or species. eg.g 2 for bacteria, 7742 for vertebrates, 511145 for E. coli | |
| sequences | Yes | One or more protein sequences in plain or FASTA format.For multiple sequences, use standard FASTA headers (lines beginning with '>'). Only amino acid sequences are supported — nucleotide sequences are not accepted. |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||