Al项目

AI工具集介绍和收录了当前流行的AI研究项目和框架,紧跟最新AI领域的进展,解读AI研究论文和方法框架,帮你快速了解这些项目的工作原理。

103℃QClaw 海外版 – 腾讯推出的 AI Agent 平台,面向海外市场

QClaw 海外版是什么QClaw 海外版是腾讯推出的 AI Agent 平台,海外版 99% 的代码由 QClaw 自己编写,仅用时 5 天,支持一键安装、零配置部署,用户可通过 WhatsApp、Telegram、Discord 等主...

723℃Kimi K2.6 – 月之暗面开源的最新旗舰模型

Kimi K2.6是什么Kimi K2.6 是月之暗面开源的最新旗舰模型,具备行业领先的代码生成、长程任务执行与 Agent 集群能力。模型在 Humanitys Last Exam、SWE-Bench Pro、DeepSearchQA ...

427℃Lyra 2.0 – 英伟达开源的可探索生成式 3D 世界框架

Lyra 2.0是什么Lyra 2.0 是 NVIDIA 推出的可探索生成式 3D 世界框架。框架从单张图像出发,结合相机控制视频生成与前馈 3D 重建技术,通过检索-生成-更新迭代循环,构建可持久漫游的大规模 3D 场景。系统采用每帧独...

957℃yoyo – 开源的自我进化型 AI 编程智能体

yoyo是什么yoyo 是生活在赛博空间的自我进化型 AI 编程智能体,开发者 Yuanhao 用 200 行 Rust 代码启动后完全交由 AI 自主迭代,47 天内从零人类提交增长至 47,000+ 行代码。工具每 8 小时自动唤醒,...

574℃融光 – 开源全流程 AI 视频创作平台,自动化工作流

融光是什么融光(AI Fusion Video) 是开源的全流程AI视频创作平台,基于Agent架构能实现从剧本编写到视频生成的自动化工作流。平台支持剧本结构化编辑、AI自动分镜拆解、多引擎绘图与视频生成,集成OpenAI、Claude、...

225℃Fun-ASR1.5 – 阿里通义推出的端到端语音识别模型

Fun-ASR1.5是什么Fun-ASR1.5是阿里通义团队推出的端到端语音识别大模型的新一代版本,单模型支持30种语言高精度识别,覆盖中文七大方言体系及二十余种地方口音,专项优化古诗词诵读识别。模型基于MoE架构实现自动语种切换,

272℃Qwen3.6-Max-Preview – 阿里通义推出的下一代旗舰模型

Qwen3.6-Max-Preview是什么Qwen3.6-Max-Preview 是阿里通义千问团队推出的下一代旗舰大模型早期预览版。相比 Qwen3.6-Plus,模型在智能体编程、世界知识和指令遵循三大维度实现显著提升,在 SWE-...

837℃天禧AI Claw – 联想推出的 AI 智能体助理

天禧AI Claw是什么天禧AI Claw是联想基于OpenClaw架构推出的开箱即用型AI智能体助理,采用端云混合部署模式,支持PC、Phone、Pad多端无缝协同。工具无需本地环境配置即可7×24小时持续执行任务,设备关闭后云端仍继续...

664℃HyperFrames – HeyGen开源的AI原生视频渲染框架

HyperFrames是什么HyperFrames是HeyGen开源的AI原生视频渲染框架,采用Write HTML, Render video理念,专为AI Agent和开发者设计。框架将视频定义为HTML文件,通过data-*属性管理...

386℃Audio Flamingo Next – 英伟达等开源的音频语言模型

Audio Flamingo Next是什么Audio Flamingo Next 是NVIDIA与马里兰大学联合开源的新一代音频语言模型(LALM),作为Audio Flamingo系列的最新版本,支持长达30分钟的复杂音频输入,覆盖语...

130℃Voicebox – 开源本地语音合成工具,ElevenLabs 开源平替

Voicebox是什么Voicebox 是开源的本地语音合成工具,基于 Tauri (Rust) 与 React 构建的跨平台桌面应用。工具提供声音克隆、文本转语音、音频后期处理及多轨叙事编辑功能,所有模型与语音数据均本地运行不上云,主打...

607℃Claude Design – Anthropic Labs 推出的 AI 协作式设计工具

Claude Design是什么Claude Design 是 Anthropic Labs 推出的 AI 协作式设计工具,搭载 Anthropic 最先进的视觉模型 Claude Opus 4.7。定位为对话式设计工作室,用户通过自然语...

764℃LingBot-Map – 蚂蚁灵波开源的流式 3D 重建模型

LingBot-Map是什么LingBot-Map 是蚂蚁灵波科技开源的流式三维重建模型,普通 RGB 摄像头可在视频采集过程中实时完成相机位姿估计与场景三维结构重建。模型以纯自回归式建模为核心,基于几何上下文 Transformer 架...

367℃GPT-Rosalind – OpenAI 推出的生命科学专用推理模型

GPT-Rosalind是什么GPT-Rosalind是OpenAI推出的生命科学专用推理模型,用DNA双螺旋结构发现者罗莎琳德·富兰克林命名。模型针对50种生物学工作流深度调优,具备假设生成、实验设计和证据合成能力,可整合50余个科学数...

508℃Claude Opus 4.7 – Anthropic 推出的最新旗舰大模型

Claude Opus 4.7是什么Claude Opus 4.7 是 Anthropic 推出的最新旗舰大模型,为 Claude Opus 4.6 的直接升级版。模型在高级软件工程任务上表现突出,SWE-bench Pro 得分提升至 ...

322℃Qwen3.6-35B-A3B – 阿里通义开源的混合专家 MoE 模型

Qwen3.6-35B-A3B是什么Qwen3.6-35B-A3B是阿里通义千问团队推出的开源混合专家(MoE)模型,总参数量350亿,激活参数30亿。模型主打极致推理效率与智能体编程能力,在多项编程基准测试中超越参数规模更大的稠密模型Q...

915℃GPT-image-2 – OpenAI推出的下一代原生图像生成模型

GPT-image-2是什么GPT-image-2 是OpenAI推出的下一代原生图像生成模型,据传内部代号为「Spud」,目前已在ChatGPT进行灰度测试。模型于2026年4月初以maskingtape-alpha等代号短暂现身Cha...

904℃HappyOyster – 阿里推出的开放式世界模型产品

HappyOyster是什么HappyOyster是阿里ATH创新事业部推出的开放式世界模型产品,定位为可实时构建与交互的AI生成式体验平台。产品基于世界模型技术,支持无限延展的实时内容生成,官网开放了两种玩法Directing与Wand...

58℃StepAudio 2.5 TTS – 阶跃星辰推出的语境感知语音生成模型

StepAudio 2.5 TTS是什么StepAudio 2.5 TTS是阶跃星辰推出的Contextual TTS(语境感知语音合成模型),首次将语境理解能力引入语音生成全流程。模型通过Global Context(全局语境)定调整段...

934℃Relax – 小红书开源的大模型强化学习训练引擎

Relax是什么Relax 是小红书AI平台团队开源的面向全模态与 Agentic 场景设计的大模型强化学习训练引擎。基于 Megatron-LM 与 SGLang 构建,采用服务化容错架构(Ray Serve)与 TransferQue...

1114℃有道宝库 – 网易有道推出的 AI 知识库工具

有道宝库是什么有道宝库是网易有道推出的首个AI知识库工具,定位为用户的外接超级知识库和AI研究助手。不同于传统聊天机器人或笔记工具,支持用户上传各类文档建立个人知识库,基于这些资料进行对话问答,能一键生成PPT、思

880℃Gemini 3.1 Flash TTS – 谷歌推出的文本转语音模型

Gemini 3.1 Flash TTS是什么Gemini 3.1 Flash TTS是Google推出的新一代文本转语音模型,提供更强的可控性、表现力和音质。模型支持70多种语言,引入音频标签技术,可通过自然语言指令精确控制声音风格、语...

930℃混元3D世界模型 2.0 – 腾讯混元开源的多模态世界模型

混元3D世界模型 2.0是什么混元3D世界模型 2.0(HY-World 2.0)是腾讯混元推出的开源多模态世界模型,支持从文本、单图、多视图或视频生成可漫游的3D高斯溅射(3DGS)场景。模型采用四阶段架构,全景生成→轨迹规划→世界扩展...

114℃Marble 1.1 – 李飞飞 World Labs 推出的新一代生成式世界模型

Marble 1.1是什么Marble 1.1 是李飞飞 World Labs 推出的新一代生成式世界模型,主打画质优化。模型能将单张图片、视频或全景图转化为可自由探索的沉浸式 3D 场景,显著改善光照效果与对比度,大幅减少过曝、泛白等视...

377℃MAI-Image-2-Efficient – 微软推出的轻量版文生图模型

MAI-Image-2-Efficient是什么MAI-Image-2-Efficient是微软推出的自研文生图模型,为MAI-Image-2的轻量高效版本,主打高性价比商业量产,在保持照片级真实图像质量的同时,实现成本降低41%、生成速...