2026-06-21

采集 145 精选 20

NousResearch/hermes-agent 是一个开源的、可扩展的智能体框架,旨在随用户需求演进,支持自主任务规划与工具调用。

GitHub NousResearch · ★198.4K
查看原文 →

affaan-m/ECC 是一个面向 AI 编程代理的性能优化系统,支持 Claude Code、Codex、Opencode、Cursor 等主流 AI 编程工具,强调技能编排、本能响应、记忆机制、安全增强与研究驱动开发。

GitHub affaan-m · ★218.9K
查看原文 →

f/prompts.chat 是一个开源的社区驱动型提示词(prompt)共享平台,前身是 Awesome ChatGPT Prompts,支持自托管以保障数据隐私。

GitHub f · ★164.0K
查看原文 →

Ollama 是一个用于本地运行和管理大语言模型的开源工具,支持 Kimi-K2.6、GLM-5.1、Qwen、Gemma 等主流开源及商业适配模型,简化了模型部署与交互流程。

GitHub ollama · ★174.6K
查看原文 →

LangChain 是一个开源的代理工程平台,用于构建基于大语言模型的应用程序,支持链式调用、工具集成和智能体(Agent)开发。

GitHub langchain-ai · ★139.8K
查看原文 →

Dify 是一个面向生产环境的开源平台,专为构建和部署基于智能体(agentic)的工作流而设计,支持可视化编排、模型集成与应用发布。

GitHub langgenius · ★146.0K
查看原文 →

llama.cpp 是一个在 C/C++ 中实现的轻量级、高性能开源库,专为在 CPU 上高效运行大型语言模型(LLM)推理而设计,支持多种量化格式和跨平台部署。

GitHub ggml-org · ★117.5K
查看原文 →

Bun 正在为 JavaScriptCore 提交一个开放的 Pull Request,旨在引入共享内存线程支持,这将增强 JavaScript 运行时的并发能力。

HN gr4vityWall · ↑123 · 241 comments
查看原文 →

vLLM 是一个高性能、内存高效的大型语言模型推理与服务引擎,采用 PagedAttention 等创新技术显著提升吞吐量和显存利用率。

GitHub vllm-project · ★83.4K
查看原文 →

Langflow 是一个开源的低代码平台,用于可视化构建、调试和部署基于 LLM 的 AI 代理与工作流。

GitHub langflow-ai · ★149.9K
查看原文 →

Firecrawl 是一个开源的 Web 数据获取工具,提供可编程 API,支持大规模网页搜索、爬取和交互,专为 AI 应用(如 RAG)优化。

GitHub firecrawl · ★135.9K
查看原文 →

这是一款本地运行的AI增强型PDF处理工具,支持命令行和浏览器(通过WASM)将PDF渲染成逼真的扫描效果,强调隐私保护与输出质量。

HN overflowy · ↑99 · 49 comments
查看原文 →

本文深入分析了LLM FP4预训练中E2M1格式引发的‘收缩偏差’问题,揭示其几何根源与系统性影响,并提出新型UFP4训练方案以缓解该偏差。

HF Papers Qian Zhao · 👍0
查看原文 →

该论文首次将DAAM框架适配至语音领域,提出面向风格标注文本到语音(TTS)系统的跨注意力归因方法,用于解析指令词对声学输出的逐层、逐token影响机制。

arXiv Nityanand Mathur · paper
查看原文 →

本文介绍了LLM网关的核心模式——路由、故障转移和语义缓存,通过代码示例和架构图讲解如何在生产环境中提升LLM应用的可靠性、性能与成本效益。

Dev.to Nazar Boyko · ♥7 · 0 comments
查看原文 →

该内容讨论了为AI代理临时创建Cloudflare账户以绕过服务限制的实践,属于开发者社区中关于AI基础设施对抗性使用的经验分享与伦理探讨。

HN farhadhf · ↑187 · 101 comments
查看原文 →

LedgerAgent 提出了一种结构化状态表示机制,使工具调用型智能体能在客服等策略敏感场景中显式维护任务状态(如事实、约束、条件),从而提升策略遵循能力与跨轮次一致性。

HF Papers Md Nayem Uddin · 👍0
查看原文 →

LOCUS 是一个面向美国地方性法规的新型机器可读语料库,填补了法律AI研究中长期缺失的地方层级权威文本数据空白,支持法律NLP模型训练与评估。

HF Papers Denis Peskoff · 👍0
查看原文 →

LegalHalluLens 是一种面向法律AI的幻觉审计框架,通过类型化幻觉分析(数值、时间、权责、事实四类)和校准多智能体辩论,提升法律AI的可信部署能力。

HF Papers Lalit Yadav · 👍0
查看原文 →

本文介绍了一种面向临床场景的可配置信息抽取框架ACIE,采用智能体驱动的RAG架构解决医疗文档中时序推理、跨文档依赖和元数据缺失等挑战,并报告了在大学医院埃森的实际部署经验。

HF Papers Osman Alperen Çinar-Koraş · 👍0
查看原文 →