Ainexis
LoRA 参数高效微调已经成为 2026 年微调开源模型的主…
2026 年初,Anthropic 越来越强的 Claude…
2024 年图灵奖得主、强化学习之父 Richard Sut…
ARC 基准的创建者 François Chollet 在 …
2026 年 3 月,图灵奖得主 Yann LeCun 创立…
2026 年 9 月 3 日,阿布扎比的基础模型研究院(IF…
前特斯拉 AI 总监、OpenAI 创始成员 Andrej …
机器人领域迎来一个被多位研究者称为「GPT 时刻」的发布——…
FineWeb 是 Hugging Face 于 2024 …
教 AI 变安全,通常要人逐条标注「有害」样本,又贵又慢。C…
逐节拆解 DeepSeek-R1 技术报告:GRPO 组内相…
逐节拆解 InstructGPT 论文:从 SFT 到奖励模…
逐节拆解 RAG 原论文:参数记忆与非参数记忆的融合逻辑、R…
逐节拆解 MMLU 基准论文:57 个学科任务、四大门类的设…
Qwen3.8-Flash-Next 采用全新架构把训练成本…
开放域问答一直靠 TF-IDF、BM25 这类关键词匹配做检…
逐节拆解 LoRA 论文:冻结预训练权重、注入低秩分解矩阵的…
Chain-of-Thought(思维链)提示只用寥寥几个带…
MCP(Model Context Protocol)让 A…
当行业习惯用单一榜单分数给大模型排名时,斯坦福 CRFM 团…