| 注册会员 | 1331 |
| 主题 | 846 |
| 模型 | 3026 |
| 技能包 | 13874 |
| 数据集 | 1047 |
| 论文 | 545 |
| 开源项目 | 649 |
|
|
Voyager:在 Minecraft 中持续探索与技能积累的具身智能体 cargo • abs/2305.16291v4 • 2026-08-12 | 0 |
|
|
LLaVA-NeXT:更强视觉理解与多图能力的多模态模型升级版 merge • abs/2401.03744v5 • 2026-08-12 | 0 |
|
|
CAMEL:通过角色扮演让多智能体协作完成复杂任务 mountain • abs/2303.17760v3 • 2026-08-12 | 0 |
|
|
AlphaGeometry:结合神经模型与符号推理解决几何证明问题 gently • abs/2401.11985v2 • 2026-08-12 | 0 |
|
|
OpenCodeInterpreter:面向代码生成与执行的开放式智能体框架 beaconx • abs/2402.14658v2 • 2026-08-12 | 0 |
|
|
WebVoyager:评测 LLM 智能体在真实网页环境中的任务执行能力 ancient • abs/2401.13919v3 • 2026-08-12 | 0 |
|
|
Mobile-Agent:让多模态智能体在手机图形界面上自主操作 train • abs/2401.16158v2 • 2026-08-12 | 0 |
|
|
MathVista:评测多模态模型数学与视觉推理能力的基准 camera • abs/2310.02255v2 • 2026-08-12 | 0 |
|
|
MMMU:面向大学水平多学科理解与推理的多模态评测集 migration • abs/2311.16502v2 • 2026-08-12 | 0 |
|
|
RAFT:面向领域适配的检索增强微调方法 acorn • abs/2403.10131v2 • 2026-08-12 | 0 |
|
|
V-Star:通过视觉推理轨迹提升多模态大模型解决能力 day • abs/2402.01574v2 • 2026-08-12 | 0 |
|
|
Chain-of-Verification:通过验证链提升语言模型答案可靠性 deepseek • abs/2309.11495v2 • 2026-08-12 | 0 |
|
|
RAG-Fusion:通过查询扩展与结果融合改进检索增强生成 two • abs/2402.03367v2 • 2026-08-12 | 0 |
|
|
ReAct:将推理与行动结合的语言模型决策范式 benevolence • abs/2210.03629v4 • 2026-08-12 | 0 |
|
|
Self-Refine:无需额外训练即可让 LLM 自我反馈并迭代改进 bad • abs/2303.17651v3 • 2026-08-12 | 0 |
|
|
Graph of Thoughts:用图结构组织推理过程以提升复杂问题求解 charter • abs/2308.09687v4 • 2026-08-12 | 0 |
|
|
SWE-agent:让语言模型在真实软件工程任务中自主修复代码 dancer • abs/2405.15793v4 • 2026-08-12 | 0 |
|
|
VideoPoet:统一文本、图像、音频与视频生成的大模型框架 journey • abs/2312.14125v8 • 2026-08-12 | 0 |
|
|
Phi-3 Technical Report:小模型也能实现高质量推理与通用能力 utmost • abs/2404.14219v4 • 2026-08-12 | 0 |
|
|
Jamba:融合 Transformer 与 Mamba 的混合架构大模型 gemini • abs/2403.19887 • 2026-08-11 | 0 |