ResearchRadar
ResearchRadar
Cómo funcionaFuentesCasos de usoRadar semanal
ENESCADEZHJAHIEntrarEmpezar gratis
PLANTILLA EN DIRECTO · SOLO LECTURASin crear una cuenta

Visión por computador

Aprendizaje visual, comprensión de imágenes y percepción, de prepublicaciones a revistas.

Búsqueda“computer vision”
Últimos 7 días4 fuentes3 resultados

Fuentes de este radar

Selecciona una o varias fuentes para filtrar los resultados.

3 resultados
arXiv
PrepublicaciónarXiv · Computer Vision·1 oct 2026

VISTA: A Visual Harness for Reasoning in an Interactive World

We show that multimodal models possess strong reasoning abilities and that an appropriate harness can unlock their potential to solve tasks across diverse interactive environments. We introduce VISTA, a visual harness that gives a general-purpose multimodal model long-horizon vision. VISTA allows the model to directly perceive the environment through visual observations and maintains a lossless visual memory that pr…

DOI
10.48550/arXiv.2610.02200 ↗
Autores
Qiushi Han, Keya Hu, Linlu Qiu, Cathy Wu, Kaiming He
Revista / publicación
No proporcionado
Tipo de publicación
Prepublicación
Estado
Prepublicación
Versión publicada
No enlazada en los metadatos de la fuente
Visión por computador70% relevanteLeer original ↗
arXiv
PrepublicaciónarXiv · Computer Vision·1 oct 2026

GeoLatent: Geometry-Guided Latent Structuring with Routed Optimization for 3D Reasoning

Despite progress in vision-language models, 3D spatial reasoning from 2D images remains challenging. Text-based methods describe intermediate geometry with discrete tokens, limiting fidelity for continuous spatial relations. Continuous latents offer richer representations, but a single latent type does not explicitly separate the cues needed across spatial tasks. Decomposed spatial latents address this by representi…

DOI
10.48550/arXiv.2610.02091 ↗
Autores
Yakun Zhu, Yi Bin, Yujuan Ding, Zheng Wang, Pengpeng Zeng, Duo Peng, Jingkuan Song, Heng Tao Shen
Revista / publicación
No proporcionado
Tipo de publicación
Prepublicación
Estado
Prepublicación
Versión publicada
No enlazada en los metadatos de la fuente
Visión por computador70% relevanteLeer original ↗
arXiv
PrepublicaciónarXiv · Computer Vision·1 oct 2026

Learning from Failure: Leveraging Unreliable Predictions in Semi-Supervised Real-World Adverse Weather Removal

Adverse weather image restoration aims to recover images degraded by rain, haze, snow, and other weather-induced artifacts, thereby improving the robustness of outdoor vision systems. Existing unified restoration models exhibit limited generalization to real-world scenes due to their reliance on synthetic supervision and insufficient semantic constraints. In this paper, we propose a novel student--teacher semi-super…

DOI
10.48550/arXiv.2610.02051 ↗
Autores
Cap Dang Xuan Kiet, Tat-Jen Cham
Revista / publicación
No proporcionado
Tipo de publicación
Prepublicación
Estado
Prepublicación
Versión publicada
No enlazada en los metadatos de la fuente
Visión por computador70% relevanteLeer original ↗
Creado con ResearchRadarResultados recopilados: 2 oct 2026, 5:05 UTCSe actualiza aproximadamente cada 15 minutos
Un radar real, sin compromiso.Abre cada publicación original y explora los resultados ordenados. Solo necesitas una cuenta para guardar, cambiar la configuración o recibir el resumen diario.

¿Quieres hacer tuyo este radar?

Crea una cuenta gratuita con el tema, la búsqueda, la ventana temporal y las fuentes ya preparados para editar.

Probar otra plantilla