Harbor Adapters and Harbor-Index: Infrastructure and a Curated Meta-Dataset for Large-Scale Agentic Evaluation Paper • 2609.04298 • Published 16 days ago
Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces Paper • 2601.11868 • Published Jan 17 • 38
LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training Paper • 2608.24845 • Published about 1 month ago • 16
DataComp-VLM: Improved Open Datasets for Vision-Language Models Paper • 2606.28551 • Published Jun 26 • 52
Solving Spatial Supersensing Without Spatial Supersensing Paper • 2511.16655 • Published Nov 20, 2025
Vision-Language Grounding as Bidirectional Concept Correspondence Paper • 2608.07886 • Published Aug 8 • 7
DataComp-VLM: Improved Open Datasets for Vision-Language Models Paper • 2606.28551 • Published Jun 26 • 52
Concept-Aware Batch Sampling Improves Language-Image Pretraining Paper • 2511.20643 • Published Nov 25, 2025 • 4
DCVLM Collection Raw data pools, pre-mixed ready-to-train datasets and checkpoints for DataComp-VLM. • 14 items • Updated Jul 27 • 7