Scaling In-Context Reinforcement Learning, ChartMimic's AI Benchmark, Multimodal Document Comprehension, Long Context Reasoning Challenges
MP3•منزل الحلقة
Manage episode 424766685 series 3568650
المحتوى المقدم من PocketPod. يتم تحميل جميع محتويات البودكاست بما في ذلك الحلقات والرسومات وأوصاف البودكاست وتقديمها مباشرة بواسطة PocketPod أو شريك منصة البودكاست الخاص بهم. إذا كنت تعتقد أن شخصًا ما يستخدم عملك المحمي بحقوق الطبع والنشر دون إذنك، فيمكنك اتباع العملية الموضحة هنا https://ar.player.fm/legal.
XLand-100B: A Large-Scale Multi-Task Dataset for In-Context Reinforcement Learning Make It Count: Text-to-Image Generation with an Accurate Number of Objects ChartMimic: Evaluating LMM's Cross-Modal Reasoning Capability via Chart-to-Code Generation Needle In A Multimodal Haystack BABILong: Testing the Limits of LLMs with Long Context Reasoning-in-a-Haystack
…
continue reading
70 حلقات