Ainexis
vLLM、SGLang、TGI、TensorRT-LLM、L…
Hermes Agent 是 Nous Research 开…
逐条拆解 Self-RAG 论文:传统 RAG 为什么「该查…
逐条拆解 GPQA 这个「研究生级、搜不到答案」的评测基准:…
逐条拆解 DPO 论文:RLHF 为什么要分「训奖励模型 +…
千问办公(QwenWork)是阿里巴巴 2026 年 8 月…
腾讯云代码助手 CodeBuddy 提供 IDE、插件、CL…
vLLM 是 UC Berkeley 开源的高性能推理引擎,…
Harness 是 2017 年成立于旧金山的 Autono…
逐条拆解 QLoRA 论文:LoRA 已经省了可训练参数,但…
Hugging Face、阿里魔搭、GitHub Model…
WorkBuddy 是腾讯推出的 AI 工作助手,覆盖编程开…
llama.cpp 让大模型能在 CPU、Apple Sil…
Hugging Face 是全球最大的 AI 模型社区,20…
阿里 Qoder 是面向所有人的智能体工作台,内置 Qwen…
阿里通义发布 Qwen3 系列开源模型,采用混合推理模式,0…
注意力机制是大语言模型的核心,本文通俗解读 Q/K/V 计算…
大模型里的"参数"到底是什么?参数量与模型能力、显存占用、推…
从预训练、监督微调到 RLHF 对齐,一文看懂大语言模型(L…
从 Transformer 论文到 ChatGPT 爆火,回…