{"url":"/method/high-resolution-input","slug":"high-resolution-input","name":"High-resolution input","full_name":"High-resolution input","full_name_withheld":false,"description_markdown":null,"description_state":"absent","introduced_year":null,"introduced_by":{"title":"EfficientPose: Scalable single-person pose estimation","paper":"/paper/efficientpose-scalable-single-person-pose","first_author":"Daniel Groos","n_authors":3,"url_abs":null,"archive_paper_url":"https://paperswithcode.com/paper/efficientpose-scalable-single-person-pose"},"source":{"url":"https://arxiv.org/abs/2004.12186v2","title":"EfficientPose: Scalable single-person pose estimation","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Computer Vision","area_id":"computer-vision","collection":"Image Representations","url":"/methods/category/image-representations","pwc_aliases":[]}],"n_papers_tagged":32,"archive_num_papers":32,"papers_newest_first":[{"paper":null,"title":"MROVSeg: Breaking the Resolution Curse of Vision-Language Models in Open-Vocabulary Image Segmentation","date":"2024-08-27","arxiv_id":"2408.14776","n_code_links":0,"syntology":null},{"paper":null,"title":"Self-Parameterization Based Multi-Resolution Mesh Convolution Networks","date":"2024-08-25","arxiv_id":"2408.13762","n_code_links":0,"syntology":null},{"paper":null,"title":"HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models","date":"2024-07-11","arxiv_id":"2407.08706","n_code_links":0,"syntology":null},{"paper":null,"title":"StrucTexTv3: An Efficient Vision-Language Model for Text-rich Image Perception, Comprehension, and Beyond","date":"2024-05-31","arxiv_id":"2405.21013","n_code_links":0,"syntology":null},{"paper":null,"title":"Genetically programmable optical random neural networks","date":"2024-03-19","arxiv_id":"2403.12490","n_code_links":0,"syntology":null},{"paper":"/paper/fpt-fine-grained-prompt-tuning-for-parameter","title":"Fine-grained Prompt Tuning: A Parameter and Memory Efficient Transfer Learning Method for High-resolution Medical Image Classification","date":"2024-03-12","arxiv_id":"2403.07576","n_code_links":1,"syntology":{"ran":6,"of":7,"unverified":1,"pointer_only":7}},{"paper":null,"title":"3DTextureTransformer: Geometry Aware Texture Generation for Arbitrary Mesh Topology","date":"2024-03-07","arxiv_id":"2403.04225","n_code_links":0,"syntology":null},{"paper":null,"title":"PI-AstroDeconv: A Physics-Informed Unsupervised Learning Method for Astronomical Image Deconvolution","date":"2024-03-04","arxiv_id":"2403.01692","n_code_links":0,"syntology":null},{"paper":"/paper/sharpose-sparse-high-resolution","title":"SHaRPose: Sparse High-Resolution Representation for Human Pose Estimation","date":"2023-12-17","arxiv_id":"2312.10758","n_code_links":1,"syntology":{"ran":5,"of":9,"unverified":4,"pointer_only":9}},{"paper":"/paper/maxtron-mask-transformer-with-trajectory","title":"A Simple Video Segmenter by Tracking Objects Along Axial Trajectories","date":"2023-11-30","arxiv_id":"2311.18537","n_code_links":2,"syntology":null},{"paper":"/paper/monkey-image-resolution-and-text-label-are","title":"Monkey: Image Resolution and Text Label Are Important Things for Large Multi-modal Models","date":"2023-11-11","arxiv_id":"2311.06607","n_code_links":1,"syntology":{"ran":1,"of":1,"unverified":0,"pointer_only":0}},{"paper":"/paper/otterhd-a-high-resolution-multi-modality","title":"OtterHD: A High-Resolution Multi-modality Model","date":"2023-11-07","arxiv_id":"2311.04219","n_code_links":1,"syntology":{"ran":11,"of":14,"unverified":3,"pointer_only":0}},{"paper":null,"title":"Win-Win: Training High-Resolution Vision Transformers from Two Windows","date":"2023-10-01","arxiv_id":"2310.00632","n_code_links":0,"syntology":null},{"paper":null,"title":"Streamlined Global and Local Features Combinator (SGLC) for High Resolution Image Dehazing","date":"2023-04-26","arxiv_id":"2304.13375","n_code_links":0,"syntology":null},{"paper":"/paper/scalable-detailed-and-mask-free-universal","title":"Scalable, Detailed and Mask-Free Universal Photometric Stereo","date":"2023-03-28","arxiv_id":"2303.15724","n_code_links":1,"syntology":{"ran":1,"of":8,"unverified":7,"pointer_only":8}},{"paper":"/paper/high-fidelity-3d-human-digitization-from","title":"High-fidelity 3D Human Digitization from Single 2K Resolution Images","date":"2023-03-27","arxiv_id":"2303.15108","n_code_links":1,"syntology":null},{"paper":null,"title":"Learning to Zoom and Unzoom","date":"2023-03-27","arxiv_id":"2303.15390","n_code_links":0,"syntology":null},{"paper":"/paper/learning-to-incorporate-texture-saliency","title":"Learning to Incorporate Texture Saliency Adaptive Attention to Image Cartoonization","date":"2022-08-02","arxiv_id":"2208.01587","n_code_links":2,"syntology":{"ran":0,"of":3,"unverified":3,"pointer_only":0}},{"paper":"/paper/single-view-3d-body-and-cloth-reconstruction","title":"Single-view 3D Body and Cloth Reconstruction under Complex Poses","date":"2022-05-09","arxiv_id":"2205.04087","n_code_links":0,"syntology":null},{"paper":null,"title":"P2M: A Processing-in-Pixel-in-Memory Paradigm for Resource-Constrained TinyML Applications","date":"2022-03-07","arxiv_id":"2203.04737","n_code_links":0,"syntology":null},{"paper":null,"title":"Boundary Corrected Multi-scale Fusion Network for Real-time Semantic Segmentation","date":"2022-03-01","arxiv_id":"2203.00436","n_code_links":0,"syntology":null},{"paper":"/paper/learned-queries-for-efficient-local-attention","title":"Learned Queries for Efficient Local Attention","date":"2021-12-21","arxiv_id":"2112.11435","n_code_links":1,"syntology":{"ran":0,"of":5,"unverified":5,"pointer_only":0}},{"paper":null,"title":"UFPMP-Det: Toward Accurate and Efficient Object Detection on Drone Imagery","date":"2021-12-20","arxiv_id":"2112.10415","n_code_links":0,"syntology":null},{"paper":"/paper/multiwavelet-based-operator-learning-for","title":"Multiwavelet-based Operator Learning for Differential Equations","date":"2021-09-28","arxiv_id":"2109.13459","n_code_links":1,"syntology":{"ran":5,"of":5,"unverified":0,"pointer_only":5}},{"paper":"/paper/fovea-foveated-image-magnification-for","title":"FOVEA: Foveated Image Magnification for Autonomous Navigation","date":"2021-08-27","arxiv_id":"2108.12102","n_code_links":1,"syntology":{"ran":0,"of":4,"unverified":4,"pointer_only":0}},{"paper":"/paper/workshop-on-autonomous-driving-at-cvpr-2021","title":"Workshop on Autonomous Driving at CVPR 2021: Technical Report for Streaming Perception Challenge","date":"2021-07-27","arxiv_id":"2108.04230","n_code_links":1,"syntology":{"ran":0,"of":4,"unverified":4,"pointer_only":0}},{"paper":"/paper/high-resolution-optical-flow-from-1d","title":"High-Resolution Optical Flow from 1D Attention and Correlation","date":"2021-04-28","arxiv_id":"2104.13918","n_code_links":1,"syntology":{"ran":4,"of":9,"unverified":5,"pointer_only":0}},{"paper":"/paper/semantic-image-synthesis-via-efficient-class","title":"Efficient Semantic Image Synthesis via Class-Adaptive Normalization","date":"2020-12-08","arxiv_id":"2012.04644","n_code_links":1,"syntology":null},{"paper":"/paper/3d-human-shape-and-pose-from-a-single-low","title":"3D Human Shape and Pose from a Single Low-Resolution Image with Self-Supervised Learning","date":"2020-07-27","arxiv_id":"2007.13666","n_code_links":2,"syntology":null},{"paper":null,"title":"HRDNet: High-resolution Detection Network for Small Objects","date":"2020-06-13","arxiv_id":"2006.07607","n_code_links":0,"syntology":null}],"papers_shown":30,"tasks":[{"task":"/task/object-detection","name":"Object Detection","papers":6},{"task":"/task/semantic-segmentation","name":"Semantic Segmentation","papers":5},{"task":"/task/object-detection-1","name":"object-detection","papers":5},{"task":"/task/pose-estimation","name":"Pose Estimation","papers":4},{"task":"/task/segmentation","name":"Segmentation","papers":4},{"task":"/task/object","name":"Object","papers":3},{"task":"/task/high","name":"Vocal Bursts Intensity Prediction","papers":3},{"task":"/task/autonomous-driving","name":"Autonomous Driving","papers":2},{"task":"/task/autonomous-navigation","name":"Autonomous Navigation","papers":2},{"task":null,"name":"GPU","papers":2},{"task":"/task/image-classification","name":"Image Classification","papers":2},{"task":"/task/optical-flow-estimation","name":"Optical Flow Estimation","papers":2},{"task":"/task/real-time-object-detection","name":"Real-Time Object Detection","papers":2},{"task":"/task/small-object-detection","name":"Small Object Detection","papers":2},{"task":"/task/super-resolution","name":"Super-Resolution","papers":2},{"task":"/task/visual-question-answering-1","name":"Visual Question Answering","papers":2},{"task":"/task/2d-human-pose-estimation","name":"2D Human Pose Estimation","papers":1},{"task":"/task/2d-object-detection","name":"2D Object Detection","papers":1},{"task":"/task/2k","name":"2k","papers":1},{"task":"/task/3d-human-pose-estimation","name":"3D Human Pose Estimation","papers":1}],"tasks_shown":20,"n_tasks":70,"usage_by_year":[{"year":"2020","papers":5},{"year":"2021","papers":6},{"year":"2022","papers":4},{"year":"2023","papers":9},{"year":"2024","papers":8}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/high-resolution-input"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}