全部 ♥ 收藏 36氪 - AI Anthropic Research Google AI Blog HackerNews Best Hugging Face Blog LangChain Blog Lilian Weng's Blog MIT Tech Review - AI OpenAI Blog The Verge - AI 机器之心 李沐 稚晖君 量子位
Hugging Face Blog ★★★★☆ 2026-05-08

EMO:用于涌现模块化的专家混合预训练

推荐理由:涉及大模型架构创新与训练方法,属于AI模型前沿研究。

论文提出EMO(Emergent Modularity via Mixture of Experts),通过专家混合架构在预训练阶段实现模型内部的模块化结构,提升模型可解释性与任务适应能力。

Hugging Face Blog ★★★★☆ 2026-05-08

MedQA:在 AMD ROCm 上微调临床 AI —— 无需 CUDA

推荐理由:涉及 AI 模型微调、医疗领域落地及非 CUDA 环境部署,契合模型发布与行业应用主题

文章介绍如何在 AMD ROCm 平台上微调名为 MedQA 的临床领域 AI 模型,完全绕过 NVIDIA CUDA 依赖,展示了在非主流硬件上部署专业领域大模型的可行性。

Hugging Face Blog ★★★★☆ 2026-05-06

vLLM 从 V0 到 V1:在强化学习中优先保证正确性而非修正

推荐理由:涉及主流AI推理框架vLLM的版本演进与技术理念,契合AI模型服务发布与评测主题。

文章探讨 vLLM 从 V0 升级到 V1 的核心理念,强调在强化学习场景中优先确保推理结果的正确性,而非依赖后续修正机制,提升模型部署可靠性。

Hugging Face Blog ★★★★☆ 2026-05-06

Adding Benchmaxxer Repellant to the Open ASR Leaderboard

推荐理由:涉及AI模型评测机制改进,与ASR模型性能评估相关

文章介绍了在开源自动语音识别(ASR)排行榜中新增Benchmaxxer Repellant机制,用于防止模型在基准测试中过拟合或刷分,提升评测公正性。

Hugging Face Blog ★★★★☆ 2026-04-29

AI evals are becoming the new compute bottleneck

推荐理由:涉及AI模型评测瓶颈及优化,契合模型评测与工具链主题

文章探讨AI评估(evals)正成为新的计算瓶颈,分析其对模型开发和部署的影响,并讨论优化评估流程的技术方向。

Hugging Face Blog ★★★★☆ 2026-04-29

Granite 4.1 大语言模型:它们是如何构建的

推荐理由:涉及大模型技术细节与性能优化,符合模型发布及评测兴趣

文章介绍了 IBM 发布的 Granite 4.1 系列大语言模型的架构设计、训练数据和优化策略,强调其在代码生成和多语言支持方面的改进。

Hugging Face Blog ★★★★☆ 2026-04-29

DeepInfra on Hugging Face Inference Providers 🔥

推荐理由:涉及 AI 模型服务发布与工具集成,便于开发者快速使用大模型

DeepInfra 现已加入 Hugging Face 推理提供商,用户可通过 Hugging Face Spaces 和 Inference API 快速部署和调用 DeepInfra 托管的大模型,简化 AI 应用开发流程。

Hugging Face Blog ★★★★☆ 2026-04-24

DeepSeek-V4:百万上下文长度,智能体真正可用

推荐理由:大模型新版本发布,强调实际智能体应用与长上下文能力

DeepSeek-V4 支持百万级上下文长度,专为AI智能体设计,具备高效推理与长文本处理能力,已在多个基准测试中表现优异。

Hugging Face Blog ★★★★☆ 2026-04-23

如何在 Chrome 扩展中使用 Transformers.js

推荐理由:推荐热门 AI 工具库 Transformers.js 的实用集成方案

本文介绍如何在 Chrome 扩展中集成 Hugging Face 的 Transformers.js 库,实现浏览器端的轻量级 AI 模型推理,涵盖环境配置、模型加载和交互逻辑。

Hugging Face Blog ★★★★☆ 2026-04-22

Gemma 4 VLA 在 Jetson Orin Nano Super 上的演示

推荐理由:涉及新发布的多模态AI模型及其边缘部署能力

展示了 Google 新发布的 Gemma 4 VLA(视觉语言动作)模型在 NVIDIA Jetson Orin Nano Super 边缘设备上的运行效果,适用于机器人等具身智能场景。

Hugging Face Blog ★★★★☆ 2026-04-21

QIMMA 峰会:一个以质量为先的阿拉伯语大语言模型排行榜

推荐理由:涉及大模型评测与多语言AI落地,符合模型评测与商业化应用兴趣

QIMMA 发布首个专注于阿拉伯语大语言模型的评测排行榜,强调模型输出质量而非单纯规模,涵盖多个开源与闭源模型在语言理解、生成和文化适配性方面的表现。

Hugging Face Blog ★★★★☆ 2026-04-17

利用合成数据构建快速多语言OCR模型

推荐理由:涉及AI模型开发与开源实践,契合工具库与模型评测兴趣

文章介绍如何使用合成数据训练一个高效、准确的多语言OCR模型,涵盖数据生成、模型架构选择及性能优化技巧。

← 上一页 6 / 40 下一页 →