Al项目

AI工具集介绍和收录了当前流行的AI研究项目和框架,紧跟最新AI领域的进展,解读AI研究论文和方法框架,帮你快速了解这些项目的工作原理。

284℃ForgeTrain – 面壁智能联合清华等开源的大模型预训练框架

ForgeTrain是什么ForgeTrain 是面壁智能联合清华大学、OpenBMB 开源社区发布的全球首个完全由 AI 编写、零人类代码介入的生产级大模型预训练框架。框架采用Forge Engineering三阶段方法论(立标准→逐比...

839℃opera-browser-cli – Opera Neon 开源的命令行工具

opera-browser-cli是什么opera-browser-cli 是 Opera Neon 推出的开源命令行工具,基于 opera-devtools 封装,支持本地 AI 代理(如 Claude Code)通过终端直接操控浏览器...

345℃ZSky AI – 免费 AI 视觉创作平台,全层级商业授权

ZSky AI是什么ZSky AI 是摄影师 Cemhan Biricik 创立的免费 AI 视觉创作平台,核心理念是让每个人都能免费使用高质量的 AI 创作工具。平台部署在美国自有的 NVIDIA RTX 5090 GPU 集群上,支持...

149℃Rodin Gen-2.5 – 影眸科技推出的千万级多边形 AI 3D 模型

Rodin Gen-2.5是什么Rodin Gen-2.5 是影眸科技(Hyper3D)推出的全球首款支持千万级多边形生成的 AI 3D 模型,基于 SIGGRAPH 2025 最佳论文技术,支持文生 3D、图生 3D 及多视角输入,4 ...

24℃Aholo Viewer – 群核科技开源的 3D 高斯浏览器

Aholo Viewer是什么Aholo Viewer是群核科技开源的基于 3D 高斯溅射(3DGS)的高性能 Web 端渲染引擎。工具采用 chunk-level LOD 流式加载技术,让 3D 内容像视频一样在不同终端流畅传输,手机端...

192℃Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型

Xiaomi Auto World Model是什么Xiaomi Auto World Model 是小米汽车推出的辅助驾驶世界模型,首次将三维重建(WorldRec)与视频生成(WorldGen)深度耦合。WorldRec 用稀疏 3D...

641℃SkyClaw-v1.0 – 昆仑万维天工AI推出的高性能Agent模型

SkyClaw-v1.0是什么SkyClaw-v1.0是昆仑万维天工AI推出的高性能Agent模型,支持百万token长上下文,深度适配OpenClaw、Hermes、Claude Code、Codex等主流Agent框架。模型经过大规模...

445℃AgentScope 2.0 – 通义实验室开源的多智能体开发框架

AgentScope 2.0 是什么AgentScope 2.0 是通义实验室推出的开源多智能体开发框架,聚焦真实场景下的稳定运行、安全控制与生产部署,新增模型容错、权限系统、上下文管理重构、Middleware 扩展、Workspace...

1207℃MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型

MiniCPM5-1B是什么MiniCPM5-1B 是面壁智能联合清华大学、OpenBMB 开源社区推出的 1B 参数端侧文本基座大模型,在 AA-Index 榜单上以 17.9 分超越所有 2B 以下模型,成为全球同级最强开源端侧文本大...

493℃Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用

Dulus是什么Dulus 是约 12K 行 Python 的开源 CLI AI Agent,支持 Claude、GPT、Gemini、DeepSeek、Kimi、Qwen 等 40+ 模型。工具可直接捕获浏览器网页版 AI 的访客会话,...

2297℃Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent

Reasonix是什么Reasonix 是专为 DeepSeek 推出的开源终端编程 Agent,围绕字节稳定的 prefix-cache 机制设计 append-only 运行循环,缓存命中率达 99.82%,长会话输入成本压至约 2 ...

807℃DataBuddy – 腾讯云推出的大数据智能体工作台

DataBuddy是什么DataBuddy 是腾讯云推出的面向企业数据基础设施的原生 AI Agent 工作台,基于 WorkBuddy 同源 Harness 框架打造,覆盖数据分析、治理与工程三大核心场景。用户通过自然语言对话提出目标,...

571℃BitCPM-CANN – 面壁智能联合清华开源的端侧大模型

BitCPM-CANN是什么BitCPM-CANN是面壁智能联合清华大学与OpenBMB开源社区联合推出的,中国首个完全基于华为昇腾国产算力平台完成端到端训练的1.58-bit三值大模型。模型采用量化感知训练路线,包含0.5B至8B四个尺...

799℃Command A+ – Cohere Labs 开源的多模态大模型

Command A+是什么Command A+ 是 Cohere Labs 推出的开源多模态大模型,采用混合专家架构,总参数量 218B、激活参数仅 25B,兼顾强大性能与推理效率表现。模型支持 128K 超长上下文与 48 种语言处理,...

193℃Software Copyright Materials Skill – 开源软著资料生成Skill

Software Copyright Materials Skill是什么Software Copyright Materials Skill是开源的软著Skill,通过读取本地真实项目源码,一键自动生成符合中国软著申报要求的源代码文档、...

443℃Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达

Horizon是什么Horizon 是开源的 AI 驱动信息聚合系统,帮助用户构建专属的 AI 新闻雷达。工具支持从 RSS、Hacker News、GitHub、Reddit、Telegram、Twitter/X 等多源抓取信息,通过 ...

190℃FreeLLMAPI – 开源 AI 模型聚合平台,统一OpenAI兼容格式

FreeLLMAPI是什么FreeLLMAPI 是开源的 OpenAI 兼容代理服务,可将约 14 家 AI 服务商的免费额度聚合为单一 API 端点,每月总计约 13 亿 tokens 的免费推理额度。项目基于 TypeScript/E...

714℃Octask – 光魔科技推出的 AI 内容工作室平台

Octask是什么Octask 是深圳光魔科技(MagicLight 团队)推出的 AI 内容工作室平台。将 AI 能力具象化为可协作的数字员工,用户以Boss身份组建专属 AI 团队,在一个平台内完成选题研究、文案撰写、图片生成、视频策...

680℃Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型

Mega-ASR是什么Mega-ASR 是南洋理工大学(NTU)、新加坡国立大学(NUS)与上海人工智能实验室联合开源的全场景鲁棒语音识别基座模型,模型以 Qwen3-ASR 1.7B 为底层架构,针对真实世界中复杂声学环境(如噪音、远场...

548℃CodeGraph – 开源代码知识图谱工具,加速代码理解和分析

CodeGraph是什么CodeGraph 是面向 AI 编码代理的预索引代码知识图谱工具,通过 MCP 协议与 Claude Code、Cursor、Codex CLI、OpenCode 及 Hermes Agent 深度集成。利用 t...

415℃SenseNova-Skills – 商汤团队开源的模块化 AI 办公技能库

SenseNova-Skills是什么SenseNova-Skills 是 OpenSenseNova(商汤)团队开源的模块化 AI 办公技能库,专为 Agent 运行时设计。工具将信息图生成、PPT 制作、Excel 数据分析与深度研究...

418℃LLM Council – Karpathy 开源的多模型协作框架

LLM Council是什么LLM Council 是 Andrej Karpathy 开源的多模型协作框架,通过 OpenRouter 将用户问题同时分发给多个大模型(如 Claude、GPT、Gemini 等)独立作答,各模型匿名互评...

1003℃Confucius4 – 网易有道开源的多模态推理模型

Confucius4是什么Confucius4是网易有道AI团队基于Qwen3.5-27B架构推出的开源多模态大模型,专为高级数学推理场景设计。模型通过迭代SFT+RL训练范式、纯文本推理数据增强及精细化CoT优化,在同等规模模型中达到S...

449℃陪读蛙 – 开源的 AI 翻译浏览器扩展工具

陪读蛙是什么陪读蛙(ReadFrog)是开源的 AI 沉浸式翻译浏览器扩展工具。工具能翻译和解读浏览器上的任何内容,支持Chrome、Edge、Firefox。通过上下文感知翻译、划词解析、TTS朗读等功能,帮助用户在真实网页中边读边学。..

454℃Stable Audio 3 – Stability AI 开源的音频生成模型系列

Stable Audio 3是什么Stable Audio 3是Stability AI推出的新一代开源音频生成模型系列,基于流匹配潜空间扩散架构,支持文本转音乐与音效、音频编辑及续写。Stable Audio 3提供Small、Medi...