| 注册会员 | 1331 |
| 主题 | 846 |
| 模型 | 3026 |
| 技能包 | 13874 |
| 数据集 | 1047 |
| 论文 | 545 |
| 开源项目 | 649 |
|
|
LLaMA-Adapter:以参数高效方式快速适配大语言模型 classic • abs/2303.16199 • 3小时47分钟之前 | 0 |
|
|
VILA:视觉语言大模型的高效训练与开放研究路线 twilight • abs/2403.02926 • 2天3小时之前 | 0 |
|
|
Phi-2:小参数语言模型中的高质量推理能力探索 quiet • abs/2312.08993 • 2天3小时之前 | 0 |
|
|
LongRoPE:扩展大语言模型上下文窗口的高效位置编码方法 automation • abs/2402.13753v4 • 3天3小时之前 | 0 |
|
|
MathCoder:面向数学问题求解的代码生成式语言模型 amplify • abs/2402.01770v2 • 3天3小时之前 | 0 |
|
|
STaR:通过自举式推理轨迹迭代提升语言模型推理能力 absorb • abs/2203.14465v6 • 3天3小时之前 | 0 |
|
|
VSTAR:结合视觉与语音线索的视频字幕理解与推理基准 lamp • abs/2405.12031 • 3天3小时之前 | 0 |
|
|
WebVoyager:让多模态大模型在真实网页环境中完成任务 angry • abs/2401.13919v5 • 3天3小时之前 | 0 |
|
|
ReAct:结合推理与行动的大语言模型决策范式 bed • abs/2210.03629v5 • 3天3小时之前 | 0 |
|
|
Tree of Thoughts:用树搜索方式扩展语言模型推理过程 call • abs/2305.10601v4 • 3天3小时之前 | 0 |
|
|
VideoPoet:统一语言模型驱动的视频生成与编辑 sizzle • abs/2312.14125v11 • 3天3小时之前 | 0 |
|
|
LLaVA-NeXT:更强视觉问答与多图理解的多模态模型 crown • abs/2401.03745 • 3天3小时之前 | 0 |
|
|
MMMU:面向大学级多学科知识与推理的多模态基准 central • abs/2311.16502v3 • 3天3小时之前 | 0 |
|
|
SWE-bench:面向真实 GitHub 问题的软件工程能力评测基准 chair • abs/2310.06770v2 • 3天3小时之前 | 0 |
|
|
AgentBench:评测大语言模型作为智能体与环境交互的能力 avalon • abs/2308.03688v2 • 3天3小时之前 | 0 |
|
|
CodeAct:以可执行代码作为统一动作空间的智能体框架 blueprint • abs/2402.01030v4 • 3天3小时之前 | 0 |
|
|
RAG-Fusion:通过查询扩展与结果融合提升检索增强生成 minimax • abs/2402.03367v4 • 3天3小时之前 | 0 |
|
|
Graph of Thoughts:用图结构组织思维链以增强复杂推理 grok • abs/2308.09687v5 • 3天3小时之前 | 0 |
|
|
Self-Discover:让大语言模型自动发现适合任务的推理结构 firefly • abs/2402.03620v3 • 3天3小时之前 | 0 |