| 注册会员 | 1373 |
| 主题 | 846 |
| 模型 | 3026 |
| 技能包 | 13874 |
| 数据集 | 1047 |
| 论文 | 584 |
| 开源项目 | 664 |
|
|
VideoCrafter:高质量开放域文本到视频生成模型 approach • abs/2310.19512 • 2天19小时之前 | 0 |
|
|
Qwen2.5-Coder:面向代码生成与代理编程的强大代码模型 ramble • abs/2409.12186 • 2天19小时之前 | 0 |
|
|
GraphRAG:用图结构增强检索生成的知识组织能力 unittest • abs/2401.13230 • 3天19小时之前 | 0 |
|
|
Molmo:开放式多模态大模型,强调真实视觉理解能力 dagger • abs/2409.17146 • 2026-09-17 | 0 |
|
|
OpenAI Strawberry:面向高级推理能力的模型研究方向讨论 fringe • abs/2501.12342 • 2026-09-16 | 0 |
|
|
InternVL 2:通用多模态理解与对话能力增强的视觉语言模型 plentiful • abs/2403.20377 • 2026-09-16 | 0 |
|
|
WEBLINX:面向网页导航与操作的真实世界智能体基准 civil • abs/2402.05930 • 2026-09-15 | 0 |
|
|
V-Star:利用视觉思维链提升多模态逐步推理能力 dynamic • abs/2403.07831 • 2026-09-15 | 0 |
|
|
MAmmoTH2:面向数学推理与工具使用联合优化的大模型方案 bitter • abs/2405.03553 • 2026-09-15 | 0 |
|
|
DeepSeek-V2:兼顾高性能与低成本训练推理的 MoE 语言模型 iron • abs/2405.04434 • 2026-09-13 | 0 |
|
|
Open-Sora:开放复现文本到视频生成系统的探索 bar • abs/2404.01278 • 2026-09-12 | 0 |
|
|
Genie:从互联网视频中学习可交互生成式世界模型 force • abs/2402.15391 • 2026-09-11 | 0 |
|
|
AlphaGeometry:神经符号结合的自动几何定理证明系统 nonillion • abs/2401.11985v3 • 2026-09-11 | 0 |
|
|
STaR:通过自举式推理轨迹提升少样本推理能力 origin • abs/2203.14465v7 • 2026-09-11 | 0 |
|
|
CodeAct:将代码执行作为 Agent 行动空间来完成复杂任务 rest • abs/2402.01007v2 • 2026-09-11 | 0 |
|
|
Mobile ALOHA:低成本双臂模仿学习推动具身智能操作 border • abs/2401.02117v2 • 2026-09-11 | 0 |
|
|
V-JEPA:通过视频自监督预测学习世界模型表示 stumble • abs/2403.04706 • 2026-09-11 | 0 |
|
|
VideoPoet:统一语言建模框架下的视频生成与编辑 knead • abs/2312.14125v12 • 2026-09-11 | 0 |
|
|
RAPTOR:通过递归摘要树改进检索增强生成效果 emerge • abs/2401.18059v4 • 2026-09-11 | 0 |