开发者开源AI工具与框架持续涌现。近期多Agent编排工作流、智能体技能包和文档自动维护工具集中出现,如Moxt的工作流更新、Taste Skill前端规则集和LangChain的OpenWiki。OpenClaw、TeXada等工具降低模型接入与本地化使用门槛,NVIDIA和Google DeepMind分别开放数据集与科学工具包。整体看,开源生态正围绕智能体协作、技能封装和开发效率快速扩展,为
7月18日
社区如何利用Tunix和TPU训练Gemma学会"思考"
Google在Kaggle举办的Tunix黑客马拉松,挑战开发者利用TPU和有限算力,将小型基础模型转变为通用推理引擎。
7月18日
我们为何构建ADK 2.0
Google官方博客阐述了构建ADK 2.0的动机--包括核心特性与升级理由,并解释了开发者应考虑迁移的原因。该文章发布于ADK 2.0正式上线次日
7月18日
Holo3.1:快速本地计算机使用智能体
Holo3.1 是基于 Qwen 模型家族的计算机使用智能体系列,旨在提升在桌面、网页和移动环境中的鲁棒性。
7月17日
Gemini 3.1 Flash Lite 驱动 Chrome 扩展自动转 Skills
这个 Chrome 扩展让你在浏览器中录制操作,再由 Gemini 3.1 Flash Lite 自动将这些任务转换为 Skills。
7月16日
阿里云开源百炼 CLI,Agent 可调用全套模型和应用能力
阿里云开源百炼 CLI,Agent 可调用全套模型和应用能力
7月16日
Vercel 发布开源 AI 智能体框架 Eve:每个智能体就是一个文件目录
Vercel 发布开源 AI 智能体框架 Eve(npm 包,Apache-2.0 许可)。
7月16日
NVIDIA 发布 Nemotron 开放数据集与配套工具,支持 AI 智能体开发
NVIDIA Nemotron 开放数据集包含超过 10 万亿预训练 tokens 和数百万后训练样本,覆盖多领域与工具使用场景,
7月15日
快手KroWork:将AI Skill工作流打包成本地桌面App
快手新发布KroWork,能将多个AI Skill串成的工作流直接打包为本地桌面应用。
7月15日
"龙虾之父"Peter 开源 skill-cleaner,为 AI 智能体技能"做体检"
"龙虾之父"Peter 开源了 skill-cleaner 工具,用于诊断和优化 AI 智能体的技能提示词。
7月13日
Datasette Agent
Datasette Agent是Datasette推出的首个可扩展AI助手,为用户提供对话式界面以查询数据,并支持通过插件生成图表。
7月12日
免费LLM路由工具:零成本撸10亿+Token
一款开源路由框架(非API售卖),让用户自行申请各厂商免费API密钥,通过配置实现自动负载均衡与故障切换,从而零成本使用10亿+免费LLM Token。
7月11日
LangChain 开源 OpenWiki 自动维护代码库文档
LangChain 开源了 OpenWiki,一个利用 AI 智能体自动维护代码库文档的小工具。
7月11日
Ousia:为命令行AI工具Pi打造的极简macOS GUI客户端
Ousia是一款极简开源macOS桌面客户端,为命令行AI编程工具Pi提供GUI聊天界面。
7月11日
Berry Xia 开源 Skills 项目
赶紧复制超能力吧! 免费开源了Skills🌟
7月10日
Google AI Studio 支持直接导入 GitHub 仓库
将整个代码仓库带入上下文窗口,即可开始构建。@GoogleAIStudio 现已支持直接导入 GitHub 仓库
7月10日
OpenClaw 接入 OpenRouter
OpenClaw 已内置 OpenRouter 支持,一条命令即可为 AI 智能体配置统一密钥、统一账单,并实现跨 300 多个模型的自动故障转移。
7月10日
香港学生将Karpathy自动研究框架提速5倍
两位香港学生通过在外层循环上再套一层循环,将Karpathy的自动研究框架提速5倍。该方法未更换更强模型、未增加算力,甚至代码改动极小。
7月10日
开源工具 Kaitox:一键将 Obsidian Markdown 推送为 X 长文草稿
开源工具 Kaitox 解决 Obsidian 写 X 长文时格式调整与图片上传耗时痛点。
7月10日
Profiling in PyTorch (Part 3): Attention is all you profile
Profiling in PyTorch (Part 3): Attention is all you profile
7月10日
GPT 5.6 Sol 辅助开发在线模型对比工具,即将开源
用户让 GPT 5.6 Sol 接手完成了一个在线模型输出对比工具,用于评测文本和前端任务。
7月10日
AVTensor: A High-Performance Rust Media Decoder for Training Pipelines
AVTensor: A High-Performance Rust Media Decoder for Training Pipelines
7月9日
Vellum 推出 Plugin Hub,面向本地优先 AI 助手的开源免费插件目录
Vellum 推出 Plugin Hub,一个面向其本地优先 AI 助手的免费开源插件目录。
7月9日
TeXada:基于MiniCPM的本地数学Agent发布
社区开发者基于MiniCPM5-1B和MiniCPM-V 4.6构建了本地优先的数学智能体TeXada。
7月9日
Moxt 更新多Agent编排工作流
Moxt 更新了多agent编排的工作流。 支持自动一群 Agent 帮你协作完成任务,而且还能重复驱动完成更长的任务
7月9日
llm-meta-ai 0.1:让 LLM 在新模型 muse-spark-1.1 上运行提示词
llm-meta-ai 0.1 发布,允许用户通过 LLM 对新模型 muse-spark-1.1 运行提示词
7月9日
Emil 推出苹果设计新 Skill
Emil的动效Skill和设计Skill都特别赞。 前几天做的前端Skill评测中,他的Skill甚至比Taste Skill表现要更好。
7月9日
DocuBrowse v0.9.1 发布
DocuBrowse v0.9.1 已打包为 Linux(RPM、DEB、tarball)、Windows(zip)和 macOS(dmg)。
7月8日
结构化PDF到JSON:2026年开源提取模型指南
开源文档提取分为schema驱动的字段提取和文档结构解析两类。
7月8日
Pulpie:用于清理网络的Pareto最优模型
Pulpie是一族Pareto最优模型,用于从HTML页面提取主要内容。
7月8日
Google Health API 推出 CLI:ghealth 是一款针对 Fitbit 数据的开源工具
ghealth 是一款封装 Google Health API v4 的开源命令行工具,以单个 Go 二进制文件发布(Apache 2.0 协议)。
7月7日
无限制OCR:单次长时域解析
Unlimited OCR 是一个托管在 GitHub 的项目,实现单次长时域解析(One-Shot Long-Horizon Parsing),
7月7日
LlamaIndex 团队基于 Google Agents API 构建 LlamaParse/LiteParse 智能体模板
LlamaIndex 团队基于 Google 新发布的 Agents API 构建了一个模板,
7月7日
如何设计OpenHarness风格Agent运行时:工具、记忆、权限、技能与多智能体协调
本教程从零构建OpenHarness,一个可运行的Agent运行时,
7月7日
创新一周年:庆祝Google Cloud x NVIDIA开发者社区达到10万会员
Google Cloud与NVIDIA开发者社区迎来成立一周年,会员规模突破10万。
7月7日
Models.dev:一个关于人工智能模型规格、定价和功能的开源数据库
近期发布了开源数据库Models.dev,专门收录人工智能模型的各项规格、定价及功能信息。该项目在GitHub公开,便于开发者查询和比较不同AI模型。
7月6日
终于有好用的本地 DeepResearch 可用,开箱即用 skill 发布
开发者 karminski3 打包了一个开箱即用的本地 DeepResearch skill,驱动模型为 Apodex-1.0-mini,
7月6日
免费开源API中转站监测网站tokhub.me上线
作者与姚老师合作开发中转站评测网站tokhub.me,通过真实充值调用API进行模型监控,区别于单纯速度评测。
7月6日
TokHub:开源AI API中转站监控与专属网关管理系统
TokHub是面向AI API中转站的开源监控及网关管理系统,
7月6日
OpenClaw 登陆 HuggingFace 本地应用
OpenClaw 登陆 @huggingface 本地应用 🦞🤝🤗 1. 在 hf 上挑任意 GGUF/MLX 模型 2. 复制 openclaw on…
7月6日
claude-real-video ─ 让任何大语言模型(LLM)都能观看视频
claude-real-video 是一个开源工具,让大语言模型基于视频画面而非字幕进行理解。
7月6日
使用 Tunix GRPO、LoRA 适配器和 GSM8K 奖励训练 Gemma-3 进行结构化数学推理
本教程演示如何利用 Tunix 框架与 GRPO 算法对 Gemma-3-1B 进行强化学习训练,
7月5日
Google DeepMind 开源科学智能体工具包
构建用于科学发现的自主智能体?🧬🤖 @GoogleDeepMind Science Skills 现已在 GitHub 上发布。
7月4日
Taste Skill开源规则集:根治AI界面模板感
Fable 5虽能快速生成高水准UI,但默认输出千篇一律、缺乏设计品味。
7月3日
基于 lift-pdf 的 Schema 引导发票智能流水线:应付账款提取、验证与账目生成
本教程使用 lift-pdf 构建端到端应付账款提取流水线,将发票解析视为 Schema 引导的文档理解,而非简单 OCR。
7月3日
Current AI 发布 Open Source AI Gap Map v0.1
Current AI(2025年2月巴黎AI行动峰会成立的非营利组织,
7月3日
Apache Paimon 2.0:流式湖仓进化为AI多模态基础
即将到来的Apache Paimon 2.0将流式湖仓技术演变为AI时代的统一多模态数据基础。
7月2日
DAIR.AI 新技能/learn:智能体定制学习计划
沉迷于我们新的 /learn 技能。 这是我最喜欢的学习和研究主题的方式。
7月2日
RAG-Anything 教程:在 Colab 中构建文本、表格、公式和图像的多模态检索管道
本教程使用 RAG-Anything 搭建多模态检索工作流,可检索文本、表格、公式和图像。
7月1日
前端动效查词、打磨与审查AI Skill
Vista 分享一个前端开发 Skill,可当作专业动效字典使用:通过 `animation-vocabulary` 查询"列表一个个冒出来"等动效的标…
7月1日
使用 Lift 将研究 PDF 转换为结构化 JSON:受控的、模式引导的字段级评估
Lift 是一个 PDF 到结构化数据的提取工具,本教程构建了完整的受控评估工作流。
7月1日
tufalabs开源第一名notebook 有望解锁新浪潮
tufalabs 刚刚开源了他们获得第一名的 notebook。主推文表示,这有望解锁新一波更好的参赛作品
6月30日
Apache Burr:构建可靠的人工智能代理和应用程序
Apache Burr 是一个用于构建可靠 AI 智能体和应用程序的框架,已在 Apache 基金会下发布。
6月30日
用 shot-scraper video 让 AI 智能体录制工作演示视频
shot-scraper 1.10 新增 shot-scraper video 命令,支持通过 storyboard.yml 文件定义操作步骤,
6月29日
Supervision:Roboflow计算机视觉开源工具包,45K Stars
Roboflow出品的Supervision工具包已获45K GitHub Stars,三周增长5K。
6月29日
技能制作流程:子智能体研究与蒸馏
我非常喜欢这个技能制作流程: - 设置能进行深度研究的子智能体 - 针对某事物不同角度要求进行X次研究运行 - 将研究报告蒸馏成一份SKILL.md文件…
6月29日
开源Bugu - 防止合盖休眠的macOS菜单栏应用
Bugu(布谷)是一款macOS菜单栏应用,防止合盖后电脑休眠,
6月29日
EverOS:开源Markdown优先智能体记忆运行时,支持混合检索与自进化技能
EverMind 推出开源智能体记忆运行时 EverOS(Apache 2.0 许可)。
6月29日
我国开源生态版图扩容,新增人工智能与具身智能等7项目
央视财经报道,我国开源生态版图进一步扩容,新增人工智能、具身智能等7个项目。
6月29日
qiaomu-lucky 开源抽奖工具发布
开发者@vista8 针对微信群福利场景,Vibe Coding 了一个轻量抽奖工具 qiaomu-lucky。
6月28日
OpenClaw 2026.6.1发布:新增Windows节点与技能工坊
OpenClaw 2026.6.1 已上线 🦞 🪟 原生 Windows 节点主机 🛠️ 用于自主学习型智能体的技能工坊(Skill Workshop)…
6月28日
instructor 1.15.4 发布
instructor 1.15.4 发布 主要是维护性扫除: - 修复了 v2 列表/标量响应模型 - 保留了流式 JSON 字符串中的反引号 - Im…
6月28日
Persona Atlas:Hugging Face 上的开源人物思维映射工具
Persona Atlas 是一个运行在 Hugging Face Inference Providers 上的开源项目。
6月28日
Anthropic 开源 AI 驱动漏洞发现框架
Anthropic 将其用于 AI 驱动漏洞发现的开源框架代码托管在 GitHub 上。该框架借助 AI 技术进行漏洞发现,旨在帮助识别软件中的安全缺陷
6月27日
BrowserBC开源:人类浏览器轨迹转可复用技能
ViDA 团队开源的 BrowserBC 项目,探索更高效的 web agent 运行方式:先用强模型录制一次人类浏览器操作流程,将其蒸馏为可复用技能,
6月26日
商汤 SenseNova U1 完整训练代码开源并发布 smoke-test 数据集
商汤开源 SenseNova U1 完整训练代码,提供可检查、可修改、可重建的完整训练栈。
6月25日
开源 Skills 系列新增「loop-me」技能:通过拷问挖掘重复模式生成工作流规格
开源 Skills 系列(165K stars)新增 in-progress 技能「loop-me」。
6月25日
百度开源 Unlimited OCR:用 R-SWA 技术实现"一次推理数十页"文档抄写
百度开源全新 Unlimited OCR 模型,采用参考滑动窗口注意力(R-SWA)技术。
6月25日
PaddleOCR PP-OCRv6 上架 HuggingFace
PaddleOCR 的 PP-OCRv6(对应 PaddleOCR 3.7)正式上线 HuggingFace,精度进一步提升,
6月25日
OpenWebUI已运行于OpenRouter:统一界面与推理
界面 + 推理,合二为一。 @OpenWebUI 现运行于 OpenRouter。
6月24日
如何用 OpenRouter 接入任意编码代理或 AI 工具
OpenRouter 提供统一 API 键(sk-or- 开头),兼容 OpenAI Chat API,可接入 300+ 模型和 60+ 供应商。
6月24日
Matt Pocock 发布 /loop-me 技能:用"严苛面试法"梳理工作循环,输出可执行规范
Matt Pocock 推出 /loop-me 技能,旨在帮你梳理日常工作中的重复"循环"。
6月24日
介绍 Ettin Reranker 系列
通过开源和开放科学的方式推动人工智能的发展与普及。
6月23日
FUTO Swipe 滑动输入模型架构说明
FUTO Swipe 采用三种模型:Encoder 模型通用且与布局、语言无关,用于一般滑动输入预测,精度非顶尖;
6月23日
transitions.dev 动画过渡可安装为 Agent 技能
http://transitions.dev 这个网站的动画过渡效果很不错👍 还可以安装技能,
6月23日
Latitude 开源 AI 智能体监控平台,将对话转化为调试数据
Latitude 发布 MIT 许可的开源监控平台,将 AI 智能体对话转为生产调试数据。
6月23日
KroWork:AI对话秒变可重用桌面应用
KroWork 新发布,解决 AI 智能体每次运行后会话即失效的痛点。
6月23日
京东全栈开源JoyAI-VL-Interaction,从"一问一答"走向"边看边说"
京东近日开源全球首个全栈交互模型JoyAI-VL-Interaction,获vLLM-Omni原生支持。
6月23日
Datalab 发布 lift:9B 开放权重视觉模型,依据 Schema 从 PDF 提取结构化 JSON
Datalab 推出 9B 参数开放权重视觉模型 lift,用于结构化提取。
6月19日
/youtube-notetaker:YT 视频转 Artifacts
YT 视频 -> Artifacts 看看我如何使用新的 /youtube-notetaker 技能从 YT 视频生成 Artifacts。
6月19日
阿里开源向量数据库Zvec,UCSD黄碧薇教授提出因果AI第四代范式
阿里开源内部向量数据库Zvec,pip install zvec免费使用,对标Pinecone每月70美元能力。
6月18日
如何将 SillyTavern 连接到 OpenRouter(2026 指南)
一个 OpenRouter API 密钥即可在 SillyTavern 的下拉菜单中解锁 300 多个模型,其中许多免费。
6月18日
cuTile Rust:安全无数据竞争的 GPU 内核系统
cuTile Rust 是一个基于 tile 的 GPU 编程系统,允许用 Rust 编写内存安全、无数据竞争的内核。
6月17日
Matt Pocock 开源 skills v1:将技能描述 Token 成本降低 63%
Matt Pocock(Total TypeScript 作者)开源了 skills v1,将技能描述的 Token 成本降低 63%。
6月17日
Cloudflare 发布 Cloudflare One stack:智能体驱动的部署工具集
6月17日,Cloudflare 推出 Cloudflare One stack,一组可直接赋予 AI 智能体的技能文件,
6月17日
GitHub 发布 CC0-1.0 开源多语言仓库级数据集,覆盖 README、Issue 和 PR
GitHub 推出一个新的仓库级数据集,采用 CC0-1.0 许可证,
6月15日
Flash-KMeans:IO感知的精确K-Means,在GPU上比FAISS快200倍以上
UC Berkeley与UT Austin团队开源Flash-KMeans(Apache 2.0,
6月13日
Paca:一款适用于人机协作的轻量级 Jira 替代方案
Paca 是一款面向人类与 AI 智能体协作场景的轻量级项目管理工具,旨在替代 Jira。
6月12日
OpenRouter 模型路由工作原理
OpenRouter 将每个请求路由到 60 多家提供商,用户可自定义提供商顺序、价格上限和回退链,从而灵活控制路由策略
6月12日
olmo-eval:面向模型开发循环的评估工作台
olmo-eval 是基于 OLMES 标准构建的评估工作台,专为 LLM 持续开发中的反复评测场景设计。
6月10日
Replit 联合 Socket 推出 Package Firewall
大多数人在发布项目前会运行安全扫描以检测恶意包 但风险从安装的那一刻就已开始 今天,我们正式推出 Package Firewall,
6月9日
一个Agent如何通过链式调用两个HuggingFace Space构建3D巴黎画廊
一个编码Agent调用HuggingFace上的两个Space,从零构建了展示巴黎地标3D高斯散点图的交互式画廊。
6月9日
快手开源 Kwai Keye-VL-2.0-30B-A3B:面向长视频理解与智能体智能的 MoE 多模态模型
快手开源 Kwai Keye-VL-2.0-30B-A3B,一个 MoE 多模态基础模型,激活仅 3B 参数,专为长视频理解和智能体智能设计。
6月9日
Responses API 网页搜索新增图片结果
你的应用现在可以搜索网页上的图片。 Responses API 中的网页搜索现在除了文本结果外,还支持图片结果,
6月9日
OpenCV 5 发布:升级全新 DNN 引擎、原生支持大模型
OpenCV 5 正式发布,采用基于图的 DNN 引擎,ONNX 算子覆盖率从 4.x 的不到 23% 提升至超 80%,
6月9日
DeLM:去中心化多智能体系统框架
DeLM是一种去中心化多智能体系统框架,通过并行智能体、共享已验证上下文和任务队列避免中央控制器瓶颈。
6月8日
小互开源视频翻译工具:一句话自动下载、转写、翻译、烧字幕
小互(@xiaohu)开源视频翻译工具(xiaohu-video-translate),
6月7日
Harness-1:基于强化学习训练的有状态搜索20B检索子智能体
UIUC与Chroma联合推出Harness-1,一个20B参数的检索子智能体。
6月5日
用Qwen2.5-3B构建多智能体经济体:工程报告
开发者用Qwen2.5-3B构建了五人森林生物多智能体经济体,每个智能体独立运行,通过vLLM部署在Modal,以Gradio为交互窗口。
6月5日
375个公众号RSS源优化Agent输入
你的 Agent 还在全网垃圾里捞内容?不如先喂它 375 个高质量微信公众号 RSS 源。 🔽
6月5日
PolarDB-X Zero 上线:30秒全分布式数据库
PolarDB-X Zero 上线了! 无需注册。无需配置。只需一次 API 调用。 30 秒内获得一个全分布式数据库。
6月5日
Google Colab CLI 发布
Google 推出 Colab 命令行界面(CLI),允许开发者和 AI 智能体将本地终端连接到远程 Colab 运行时,实现无摩擦执行。
6月4日
OpenAI API 新增内容审核评分
Moderation scores 现已在 Responses API 和 Completions API 中可用。
6月4日
Nemotron 3.5 Content Safety:面向全球企业AI的可定制多模态安全
Nemotron 3.5 Content Safety基于Gemma 3 4B IT,提供128K上下文窗口,
6月4日
EVA-Bench Data 2.0:3 大领域、121 个工具、213 个场景
ServiceNow-AI 发布 EVA-Bench Data 2.0 数据集,覆盖 3 个领域、121 个工具和 213 个场景,
6月3日
pgvector驱动的语义、混合、稀疏与量化向量搜索系统构建编码指南
本教程在Google Colab中构建一个完整的pgvector实验环境,展示PostgreSQL如何作为向量数据库服务于现代AI应用。
6月3日
Karpathy 的 llm-wiki 项目获超五千星
@karpathy 的 llm-wiki 在几周内获得了 5,000+ 颗星。 其理念是:停止在每个会话中重新发现知识。
6月2日
商汤开源SenseNova-Skills AI办公技能套件
商汤开源了AI办公技能套件SenseNova-Skills。
6月2日
微软发布开源框架 Adaptive Spec-driven Scoring:支持用文本描述创建 AI 评估测试
微软开源发布 Adaptive Spec-driven Scoring for Evaluation and Regression Testing 框架…
6月2日
Ultralytics YOLO26:统一实时端到端视觉模型
Ultralytics YOLO26 采用双头设计实现原生无 NMS 的端到端推理,彻底移除 DFL,获得更轻检测头与无约束回归范围。
6月1日
OpenWebRL:面向视觉网页智能体的在线多轮强化学习开源框架
OpenWebRL是一个用于在真实网站上通过在线多轮强化学习训练视觉网页智能体的开源框架,覆盖了完整的训练流程。
6月1日
Apache RocketMQ 发布 AI 专用消息引擎
🚀 Apache RocketMQ 为 AI 升级!推出 RocketMQ for AI--一个专为长时间会话、多智能体工作流和公平资源调度构建的新消息…
6月1日
OpenBMB发布UltraData两大开源数据集,登顶HuggingFace趋势榜
OpenBMB联合清华NLP与Modelbest发布两个开源数据集:Ultra-FineWeb-L3(预训练合成数据)包含600B+ tokens(超4…
5月29日
Guardrails:保护你的智能体、数据与成本
Guardrails 是一套可配置的安全与治理工具,提供预算执行、零数据保留、模型与提供商限制、提示词注入防御及数据丢失预防等功能,
5月28日
hexoai开源SIA框架:AI智能体实现递归自我改进
hexoai开源了SIA(自我改进AI)框架。该框架展示了AI智能体不仅能优化其外部工作流(harness),还能通过任务反馈直接更新自身的模型权重,
5月28日
发布 Search Toolkit
Mistral AI 发布了 Search Toolkit 的公共预览版。这是一个用于构建 AI 应用生产级搜索管道的可组合框架。
5月28日
WorldMemArena:通过行动-世界交互循环评估多模态智能体记忆
针对现有基准无法精确诊断多模态智能体记忆在动态环境中的具体失败阶段,研究提出了"行动-世界交互循环"记忆模型,并构建了WorldMemArena基准。
5月27日
阿里云成为PyTorch基金会白金会员
阿里云宣布以白金会员身份加入PyTorch基金会。
5月27日
软件之后是AI时代
软件时代正过渡至"智能体框架"时代。AI作为强大但需驯化的"野马",
5月24日
OpenClaw 2026.5.22发布:性能优化与安全加固
OpenClaw 2026.5.22 已上线 ⚡ Gateway/模型启动路径更精简 🧠 /models 响应时间降至约5毫秒 🔒 npm包现提供锁定依…
5月19日
Forge:通过防护机制大幅提升8B模型性能的可靠性层
Forge 是一个为自托管大语言模型设计的可靠性层,专注于提升工具调用能力。
5月19日
GoLongRL:面向能力的长期上下文强化学习与多任务对齐
GoLongRL是一个全开源的长期上下文强化学习方案,聚焦于使用可验证奖励的强化学习。
5月18日
构建长期代理的基础要素
构建长期代理的一些基础要素:https://openrouter.ai/long-horizon