全部 ♥ 收藏 36氪 - AI Anthropic Research Google AI Blog HackerNews Best Hugging Face Blog LangChain Blog Lilian Weng's Blog MIT Tech Review - AI OpenAI Blog The Verge - AI 机器之心 李沐 稚晖君 量子位
Hugging Face Blog ★★★★☆ 2026-05-23

迈向光速文本生成:Nemotron-Labs 扩散语言模型

推荐理由:介绍新型高效文本生成模型,属AI模型发布与评测范畴

Nemotron-Labs 提出基于扩散机制的语言模型,旨在实现接近光速的文本生成速度,突破传统自回归模型的延迟瓶颈,并在多个基准上展示高效推理能力。

Hugging Face Blog ★★★★☆ 2026-05-22

专业化胜过规模:多数AI采购决策忽视的关键变量

推荐理由:探讨AI商业化落地中的关键选型策略,具实践指导价值

文章指出企业在AI采购中过度关注模型规模,而忽视了领域专业化的重要性,强调垂直领域微调模型在实际应用中往往优于通用大模型,并提供了选型策略建议。

Hugging Face Blog ★★★★☆ 2026-05-19

OlmoEarth v1.1:更高效的模型系列

推荐理由:新模型发布及效率优化,契合AI模型评测与应用兴趣

AI2发布OlmoEarth v1.1,该系列模型在保持性能的同时显著提升推理效率,适用于地球科学等专业领域,支持更低成本部署。

Hugging Face Blog ★★★★☆ 2026-05-19

介绍 Ettin 重排序模型系列

推荐理由:涉及新发布的AI模型及性能评测,契合用户对模型发布与评测的兴趣。

Ettin 是一系列开源的高性能重排序模型,适用于检索增强生成(RAG)场景,在多个基准测试中表现优异,支持多语言且易于集成。

Hugging Face Blog ★★★★☆ 2026-05-18

使用 LoRA/DoRA 微调 NVIDIA Cosmos Predict 2.5 用于机器人视频生成

推荐理由:涉及大模型微调技术与AI在机器人领域的应用,契合AI模型发布与商业化落地主题

本文介绍如何利用 LoRA 和 DoRA 技术对 NVIDIA 新发布的 Cosmos Predict 2.5 模型进行微调,以生成高质量机器人操作视频,涵盖训练流程、参数配置及效果对比。

Hugging Face Blog ★★★★☆ 2026-05-18

开源智能体排行榜

推荐理由:提供AI智能体能力评测,契合模型评测与工具推荐兴趣

该排行榜评估和对比各类开源AI智能体(Agent)在任务执行、工具调用和推理等方面的能力,涵盖主流框架和模型表现。

Hugging Face Blog ★★★★☆ 2026-05-14

Unlocking asynchronicity in continuous batching

推荐理由:涉及AI模型推理优化,属热门工具库/系统底层技术

文章探讨在连续批处理中实现异步性的技术,提升大模型推理效率,涉及AI系统优化与性能调优。

Hugging Face Blog ★★★★☆ 2026-05-11

在 AWS 上构建基础模型训练与推理的基石

推荐理由:涵盖大模型训练/推理的工程实践,属AI模型服务落地关键环节

本文介绍 AWS 提供的用于大模型训练和推理的核心组件,包括基础设施、优化工具及服务集成方案,帮助开发者高效部署基础模型。

Hugging Face Blog ★★★★☆ 2026-05-08

EMO:用于涌现模块化的专家混合预训练

推荐理由:涉及大模型架构创新与训练方法,属于AI模型前沿研究。

论文提出EMO(Emergent Modularity via Mixture of Experts),通过专家混合架构在预训练阶段实现模型内部的模块化结构,提升模型可解释性与任务适应能力。

Hugging Face Blog ★★★★☆ 2026-05-08

MedQA:在 AMD ROCm 上微调临床 AI —— 无需 CUDA

推荐理由:涉及 AI 模型微调、医疗领域落地及非 CUDA 环境部署,契合模型发布与行业应用主题

文章介绍如何在 AMD ROCm 平台上微调名为 MedQA 的临床领域 AI 模型,完全绕过 NVIDIA CUDA 依赖,展示了在非主流硬件上部署专业领域大模型的可行性。

Hugging Face Blog ★★★★☆ 2026-05-06

vLLM 从 V0 到 V1:在强化学习中优先保证正确性而非修正

推荐理由:涉及主流AI推理框架vLLM的版本演进与技术理念,契合AI模型服务发布与评测主题。

文章探讨 vLLM 从 V0 升级到 V1 的核心理念,强调在强化学习场景中优先确保推理结果的正确性,而非依赖后续修正机制,提升模型部署可靠性。

Hugging Face Blog ★★★★☆ 2026-05-06

Adding Benchmaxxer Repellant to the Open ASR Leaderboard

推荐理由:涉及AI模型评测机制改进,与ASR模型性能评估相关

文章介绍了在开源自动语音识别(ASR)排行榜中新增Benchmaxxer Repellant机制,用于防止模型在基准测试中过拟合或刷分,提升评测公正性。

Hugging Face Blog ★★★★☆ 2026-04-29

AI evals are becoming the new compute bottleneck

推荐理由:涉及AI模型评测瓶颈及优化,契合模型评测与工具链主题

文章探讨AI评估(evals)正成为新的计算瓶颈,分析其对模型开发和部署的影响,并讨论优化评估流程的技术方向。

Hugging Face Blog ★★★★☆ 2026-04-29

Granite 4.1 大语言模型:它们是如何构建的

推荐理由:涉及大模型技术细节与性能优化,符合模型发布及评测兴趣

文章介绍了 IBM 发布的 Granite 4.1 系列大语言模型的架构设计、训练数据和优化策略,强调其在代码生成和多语言支持方面的改进。

← 上一页 5 / 39 下一页 →