2026-06-30

采集 117 精选 20

Herdr 是一款运行在终端中的智能代理多路复用器,允许用户在同一界面中并行管理多个 AI 代理(如 LLM 调用、工具执行),提升本地 AI 工作流的效率与可组合性。

HN mzehrer · ↑146 · 91 comments
查看原文 →

NousResearch/hermes-agent 是一个开源的自主智能体框架,旨在随用户使用而持续学习和进化,支持多步推理、工具调用与长期记忆集成。

GitHub NousResearch · ★205.8K
查看原文 →

这是一个面向AI编程代理(如Claude Code、Codex等)的性能优化系统,整合了技能管理、本能建模、记忆机制、安全控制和以研究为先的开发范式。

GitHub affaan-m · ★223.6K
查看原文 →

Hugging Face Transformers 是一个广泛使用的开源库,提供数千种预训练模型和统一API,支持文本、视觉、音频及多模态任务的推理与微调。

GitHub huggingface · ★162.0K
查看原文 →

本文深入解析了调用大语言模型API时的底层流程,涵盖请求预处理、token化、推理调度、流式响应生成及后处理等关键环节,帮助开发者理解延迟来源与性能瓶颈。

Dev.to Daniel Nwaneri · ♥31 · 31 comments
查看原文 →

Ornith-1.0 是一个开源的、支持自我改进的智能体编码模型系列,旨在提升AI在自主编程任务中的推理与迭代能力。

HN danboarder · ↑173 · 32 comments
查看原文 →

Lore 是一款新型 AI 编程代理增强工具,通过结构化记录和注入团队过往技术决策(如架构选择、库选型、配置权衡),提升编码代理的上下文理解与决策一致性。

HN tcballard · ↑43 · 53 comments
查看原文 →

该GitHub仓库(Ollama)是一个开源工具,支持本地一键部署和运行多个主流开源大模型(如Qwen、Gemma、DeepSeek等),显著简化了AI模型的本地化使用流程。

GitHub ollama · ★175.2K
查看原文 →

Open WebUI 是一个开源的、用户友好的本地化大模型交互界面,支持 Ollama、OpenAI API 等多种后端,便于快速部署和使用私有化 AI 服务。

GitHub open-webui · ★143.5K
查看原文 →

本文是一篇实践教程,介绍作者如何本地部署大语言模型(LLM)并将其集成到 Git 工作流中,自动生成符合规范的提交信息。

Dev.to Shyamala · ♥35 · 4 comments
查看原文 →

Dify 是一个面向生产环境的开源平台,专注于智能体(agentic)工作流的开发与部署,支持可视化编排、模型集成和应用发布。

GitHub langgenius · ★147.0K
查看原文 →

llama.cpp 是一个用 C/C++ 实现的轻量级开源项目,专注于在本地 CPU 上高效运行大型语言模型(LLM),无需 GPU 依赖。

GitHub ggml-org · ★118.7K
查看原文 →

本文深入解析CUDA内核执行时的底层机制,涵盖GPU线程调度、内存访问模式、Warp执行模型及硬件协同细节,适合AI开发者理解GPU加速原理。

HN mezark · ↑224 · 28 comments
查看原文 →

vLLM 是一个高性能、内存高效的大型语言模型推理与服务引擎,专为提升吞吐量和降低显存开销而设计,广泛用于生产环境部署。

GitHub vllm-project · ★84.9K
查看原文 →

Firecrawl 是一个开源的 Web 数据获取工具,提供可扩展的 API,支持大规模网页搜索、爬取和交互,专为 AI 应用(如 RAG)优化。

GitHub firecrawl · ★141.6K
查看原文 →

该内容介绍了一种名为Micro-Agent的新范式,通过在单个大模型API内部构建多智能体协作机制,显著提升推理性能,超越前沿大模型;其核心贡献在于模型内协同架构设计,而非外部调用编排。

HN matt_d · ↑62 · 19 comments
查看原文 →

Langflow 是一个开源的低代码平台,用于可视化构建、调试和部署基于 LLM 的 AI 代理与工作流。

GitHub langflow-ai · ★150.2K
查看原文 →

本文提出LiveEdit,一种面向实时扩散模型的流式视频编辑方法,旨在解决流式视频编辑中背景稳定性与低延迟交互的两大核心挑战。

HF Papers Xinyu Wang · 👍0
查看原文 →

TUA-Bench 是一个专为通用终端使用智能体(TUAs)设计的新基准,填补了现有评测体系在终端环境下通用计算机操作能力评估方面的空白。

HF Papers Shoufa Chen · 👍0
查看原文 →

DreamForge-World 0.1 Preview 是一个面向低算力设备的实时可控世界模型,基于 LongLive-1 和 Wan2.1-T2V-1.3B 改进,并引入受 Matrix-Game 启发的残差动作通路,支持消费级 GPU 实时交互。

HF Papers Daniyel Ayupov · 👍0
查看原文 →