全部 ♥ 收藏 36氪 - AI Anthropic Research Google AI Blog HackerNews Best Hugging Face Blog LangChain Blog Lilian Weng's Blog MIT Tech Review - AI OpenAI Blog The Verge - AI 机器之心 李沐 稚晖君 量子位
HackerNews Best ★★★★☆

GLM 5.2 与 Opus 对比

推荐理由:涵盖主流大模型新版本评测与对比,符合用户对AI模型发布及评测的兴趣。

文章对比了智谱AI最新发布的GLM 5.2与Anthropic的Claude Opus模型,在推理、代码生成、多语言支持等方面进行性能评测。

HackerNews Best ★★★☆☆

Codex logging bug may write TBs to local SSDs

推荐理由:涉及 AI 编程工具 Codex 的技术缺陷,对使用者有实际影响

OpenAI Codex 存在一个日志记录漏洞,可能导致大量数据写入本地 SSD,消耗数 TB 空间。该问题已在 GitHub 上报告,影响使用 Codex 的开发者和集成环境。

HackerNews Best ★★★★☆

转向开源模型几乎没有 downside

推荐理由:探讨开源与闭源模型的商业与技术权衡,契合AI商业化与模型选型主题

文章主张企业应优先采用开源大模型,因其在成本、可控性、定制化和长期可持续性方面优于闭源模型,并指出闭源模型的边际优势正在缩小。

HackerNews Best ★★★★☆

Claude Code“扩展思考”输出中的文本

推荐理由:揭示AI编程助手的内部机制与局限性

文章分析了Claude Code在“Extended Thinking”模式下生成的代码注释和推理文本,指出其看似深思熟虑的内容可能并非真实推理过程,而是模型生成的拟真输出。

HackerNews Best ★★★★☆

在本地硬件上运行 GLM-5.2

推荐理由:涉及大模型本地部署与性能优化,契合AI模型评测与工具使用主题

文章介绍了如何在本地硬件上高效运行智谱AI最新发布的GLM-5.2大模型,包括使用Unsloth优化推理速度和显存占用的实践方法。

HackerNews Best ★★★★☆

Sakana Fugu

推荐理由:涉及新AI代码模型发布及性能评测,契合AI编程工具主题

Sakana AI 发布 Fugu,一个基于多智能体协作的开源代码生成模型,在多个基准测试中表现优异,支持多种编程语言并可本地部署。

HackerNews Best ★★★★☆

无限OCR:一次性长程解析

推荐理由:热门AI开源项目,提升OCR能力,适合开发者集成使用。

百度开源Unlimited OCR,支持一次性解析超长文档图像,突破传统OCR对长度和布局的限制,适用于复杂排版场景。

HackerNews Best ★★★★☆

Mistral OCR 4

推荐理由:属于AI模型发布及评测范畴,OCR是重要AI应用方向

Mistral 发布 OCR 4,一款专注于光学字符识别的大模型,支持多语言、复杂版式和手写文本识别,在多个 OCR 基准测试中表现优异。

HackerNews Best ★★★★☆

AI的可负担性危机

推荐理由:涉及AI商业化应用中的成本挑战,具现实意义

文章探讨当前AI模型推理成本高昂的问题,分析其对AI商业化落地和中小企业采用的阻碍,并讨论可能的优化方向。

HackerNews Best ★★★★☆

预览 GPT‑5.6 Sol:下一代模型

推荐理由:涉及大模型新版本发布及能力介绍,符合AI模型发布评测主题

OpenAI 预览了即将推出的 GPT‑5.6 Sol 模型,称其在推理、代码生成和多模态理解方面有显著提升,目标是更高效、更安全的通用人工智能。

HackerNews Best ★★★★☆

2000人尝试黑客攻击我的AI助手后发生了什么

推荐理由:涉及AI应用安全实践,对AI产品开发者有参考价值

作者开放其AI助手供公众测试安全性,吸引约2000人尝试攻击,结果发现多数攻击集中在提示词注入和越狱,系统通过日志监控与规则过滤有效防御,并总结了AI应用安全防护经验。

HackerNews Best ★★★★☆

DSpark:推测解码加速大语言模型推理

推荐理由:涉及大模型推理优化技术,属AI模型服务性能提升范畴

DSpark 是一种基于推测解码的新方法,通过并行生成和验证多个 token 来显著加速大语言模型的推理过程,已在 DeepSeek 模型上验证有效性。

HackerNews Best ★★★★☆

开源权重大模型与闭源大模型之间的差距

推荐理由:聚焦大模型性能对比,契合AI模型评测主题

文章探讨当前开源大模型与闭源前沿模型(如GPT-4、Claude等)在性能、推理能力及应用场景上的差距,并分析开源模型追赶的路径与挑战。

← 上一页 235 / 247 下一页 →