Knowledge2Model/Hugging2KG/modality_mapping.json

51 lines
3.2 KiB
JSON

{
"text-classification": { "input": "Text", "output": "Label" },
"token-classification": { "input": "Text", "output": "SequenceOfLabels" },
"table-question-answering": { "input": "Table+Text", "output": "Text" },
"question-answering": { "input": "Text+Text", "output": "Text" },
"zero-shot-classification": { "input": "Text+Labels", "output": "Label" },
"translation": { "input": "Text", "output": "Text" },
"summarization": { "input": "Text", "output": "Text" },
"feature-extraction": { "input": "Text", "output": "Vector" },
"text-generation": { "input": "Text", "output": "Text" },
"text2text-generation": { "input": "Text", "output": "Text" },
"fill-mask": { "input": "Text", "output": "Text" },
"sentence-similarity": { "input": "Text+Text", "output": "Score" },
"text-to-speech": { "input": "Text", "output": "Audio" },
"text-to-audio": { "input": "Text", "output": "Audio" },
"automatic-speech-recognition": { "input": "Audio", "output": "Text" },
"audio-to-audio": { "input": "Audio", "output": "Audio" },
"audio-classification": { "input": "Audio", "output": "Label" },
"voice-activity-detection": { "input": "Audio", "output": "SequenceOfLabels" },
"depth-estimation": { "input": "Image", "output": "Image" },
"image-classification": { "input": "Image", "output": "Label" },
"object-detection": { "input": "Image", "output": "BoundingBoxes+Labels" },
"image-segmentation": { "input": "Image", "output": "Image" },
"text-to-image": { "input": "Text", "output": "Image" },
"image-to-text": { "input": "Image", "output": "Text" },
"image-to-image": { "input": "Image", "output": "Image" },
"image-to-video": { "input": "Image", "output": "Video" },
"unconditional-image-generation": { "input": "", "output": "Image" },
"video-classification": { "input": "Video", "output": "Label" },
"text-to-video": { "input": "Text", "output": "Video" },
"zero-shot-image-classification": { "input": "Image+Labels", "output": "Label" },
"mask-generation": { "input": "Image", "output": "Image" },
"zero-shot-object-detection": { "input": "Image+Labels", "output": "BoundingBoxes" },
"text-to-3d": { "input": "Text", "output": "3DModel" },
"image-to-3d": { "input": "Image", "output": "3DModel" },
"image-feature-extraction": { "input": "Image", "output": "Vector" },
"keypoint-detection": { "input": "Image", "output": "Keypoints" },
"reinforcement-learning": { "input": "State", "output": "Action" },
"robotics": { "input": "SensorData", "output": "Action" },
"tabular-classification": { "input": "TableRow", "output": "Label" },
"tabular-regression": { "input": "TableRow", "output": "Value" },
"time-series-forecasting": { "input": "TimeSeries", "output": "Values" },
"audio-text-to-text": { "input": "Audio+Text", "output": "Text" },
"image-text-to-text": { "input": "Image+Text", "output": "Text" },
"visual-question-answering": { "input": "Image+Text", "output": "Text" },
"document-question-answering": { "input": "Document+Text", "output": "Text" },
"video-text-to-text": { "input": "Video+Text", "output": "Text" },
"visual-document-retrieval": { "input": "Image+Text", "output": "Document" },
"any-to-any": { "input": "Various", "output": "Various" },
"graph-ml": { "input": "Graph", "output": "other" }
}