[Reproduce] Code for the ACL2019 paper "Multimodal Transformer for Unaligned Multimodal Language Sequences".
Light-MER for efficient multimodal emotion recognition with sub-1B MLLMs.
For our ACL25 Paper: Can Language Models Replace Programmers? RepoCod Says ‘Not Yet’ - by Shanchao Liang and Yiran Hu and Nan Jiang and Lin Tan
[2025] ModalFormer: Multimodal Transformer for Low-Light Image Enhancement
:speaking_head: :keyboard: Speech-to-text on key for Linux
A fluent, scalable, and easy-to-use LLM data processing framework.
PySpark custom data source for Hugging Face Datasets
Real-time visualization of sentiment analysis on text input
Export and Run Hugging Face Transformers Models on Rockchip NPUs
A compiler that transforms computation graphs into the weights of a transformer
共 7255 条 · 第 324 / 363 页