974℃MAI-Thinking-1 – 微软推出的首款自研高级推理模型
MAI-Thinking-1是什么MAI-Thinking-1 是微软推出的首款自研高级推理模型。模型采用 35B 活跃参数 / 约 1T 总参数的稀疏 MoE 架构,完全基于干净、商业授权数据从头训练,未使用任何第三方模型蒸馏。在 SW...
689℃7大真实任务实测 Opus 4.8、Gemini 3.5 Flash、GPT-5.5、Qwen3.7-Max
最近大模型更新真的有点密,更了好多但是却不知道到底谁好用。有说 Qwen3.7-Max 已经力压 GPT-5.5,仅次于Claude 系列。也有说 GPT-5.5 已经登顶。普通人看排行榜估计越看越疑惑,写文章该用哪个?数据分析该用哪个?...
118℃OpenClacky – 李亚飞团队开源的低成本 AI Agent
OpenClacky是什么OpenClacky 是李亚飞团队开源的 AI Agent,支持一键安装与跨平台运行。工具通过精简工具集、智能上下文压缩和模型路由大幅降低使用成本,让专业人士能全天开着 AI 助手干活。OpenClacky 内置...
660℃Mellum2 – JetBrains 开源的混合专家模型
Mellum2是什么Mellum2 是 JetBrains 开源的面向软件工程系统的新机器学习模型。模型每 token 仅激活 2.5B 参数,专为软件工程 AI 工作流优化,支持代码生成、智能路由、子 Agent 调用及私有化部署。凭借...
142℃ECC – 开源的跨平台 AI Agent 性能优化系统
ECC是什么ECC(Everything Claude Code)是跨平台 AI Agent 性能优化系统。系统为 Claude Code、Codex、Cursor 等 7+ 个 AI 编程工具提供 63 个专业 Agent、249 个按...
232℃Polar – 英伟达开源的智能体强化学习训练框架
Polar是什么Polar 是英伟达推出的开源智能体强化学习(Agentic RL)训练框架,核心创新在于无需修改现有智能体框架内部代码,可将其接入 GRPO 等 RL 算法进行训练。框架通过在 LLM API 调用边界放置代理,捕获 t...
330℃Qwen3.7-Plus – 阿里通义推出的智能体多模态大模型
Qwen3.7-Plus是什么Qwen3.7-Plus 是通义千问推出的新一代多模态大模型,将视觉与语言统一为一体化智能体基座。模型能感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码,支持端到端导航移动应用、结合网络知识回答...
285℃语构 – 阿里达摩院推出的 AI 原生开发平台
语构是什么语构是阿里达摩院推出的AI原生开发平台,以Vibe Coding为核心范式,让用户通过自然语言描述需求可生成完整可用的数字产品。平台覆盖从需求理解、智能追问、自动开发到预览发布的全链路,内置大模型对话、文生图、机器翻译、地图检索...
314℃Dubbing v2 – ElevenLabs 推出的 AI 配音模型
Dubbing v2是什么Dubbing v2 是 ElevenLabs 推出的 AI 配音模型,支持 29 种语言自动翻译配音,保留原始说话人音色与情感。模型提供双工作流模式,Auto Dub 快速生成预览,Dubbing Projec...
23℃Cosmos 3 – 英伟达开源的全模态物理 AI 基础大模型
Cosmos 3是什么Cosmos 3是英伟达推出的全球首款全开源全模态物理 AI 基础大模型,采用混合 Transformer 架构融合视觉推理、世界生成与动作预测能力。模型可原生理解并生成文本、图像、视频、音效及动作内容,物理仿真精度...
267℃办公小浣熊桌面端 2.0 实测 – 告别上传下载、AI 直接操作电脑
朋友们,最近发现商汤小浣熊搞了个国内首个 OPC 能力挑战赛。OPC 或者日常在用 AI 提升办公效率的友友们,可以关注一下,一共有 2 个赛道:一个是新手出道赛,我们只需要用办公小浣熊完成一次真实任务,然后发布到社交媒体,就可以参与。另...
582℃Music v2 – ElevenLabs 推出的音乐生成大模型
Music v2是什么Music v2 是 ElevenLabs 全新推出的音乐生成大模型,在人声表现、乐器演奏和编曲水平上实现全面提升,支持多语言及单曲目内跨流派无缝转换。作为底层引擎,模型能驱动 ElevenMusic、ElevenA...
13℃Gamma-World – 英伟达推出的多智能体世界模型
Gamma-World是什么Gamma-World 是 NVIDIA 推出的多智能体世界模型,能解决多个智能体在同一个模拟世界中平等交互、全局一致的问题。模型创新性地采用单纯形旋转编码保证智能体身份对称,配合稀疏枢纽注意力将通信复杂度从平...
400℃Hermes Desktop – Hermes Agent 的桌面应用,开箱即用
Hermes Desktop是什么Hermes Desktop 是开发者 sir1st 推出的 Hermes Agent 社区版桌面应用。将 Python 运行时、hermes-agent 核心与 hermes-web-ui 可视化界面打...
622℃Funloom – AI 原生游戏共创平台,简单描述生成完整游戏
Funloom是什么Funloom 是 00 后创业者吴同创立的 AI 原生游戏内容共创平台,让用户无需编程、美术或游戏引擎基础,通过简单的人物设定和世界观输入,可在五分钟内生成包含画面、音乐、地图和智能 NPC 互动的完整游戏。Funl...
35℃墨见 – 墨刀推出的 AI 协作平台
墨见是什么墨见是墨刀推出的 AI 协作平台,专为一人公司与超级个体打造。平台搭载 OpenClaw 引擎,内置产品经理、UI/视觉设计师、前后端工程师、增长运营师等虚拟合伙人角色,支持 1 对 N 群聊协作模式。用户一句话愿景,可连贯获得...
251℃MiniMax M3 – MiniMax 推出的新一代 AI 模型
MiniMax M3是什么MiniMax M3是 MiniMax 推出的全新AI模型,具备领先的编程、Agent与长文本处理能力。模型采用创新的MSA稀疏注意力架构,支持1M超长上下文,效率提升20倍。同时原生支持图像、视频输入,可操控电...
928℃Qwen-VLA – 阿里通义推出的通用视觉-语言-动作模型
Qwen-VLA是什么Qwen-VLA 是通义实验室推出的通用视觉-语言-动作模型,以 Qwen3.5-4B 为视觉语言主干,搭配 1.15B 参数的 DiT 动作解码器。模型通过统一动作轨迹预测框架,将操作、导航、轨迹预测三大任务统一到...
509℃Webwright – 微软开源的终端原生网页智能体框架
Webwright是什么Webwright 是微软研究院开源的终端原生网页智能体框架,仅需约 1000 行代码可让 AI 模型在终端中编写 Playwright 代码、执行 bash 命令、查看日志并反复修正,完成复杂网页任务。Webwr...
359℃ControlFoley – 小米开源的可控视频音效生成模型
ControlFoley是什么ControlFoley是小米开源的可控视频音效生成模型,能解决V2A领域可控性难题。模型统一支持文本引导、文本控制与参考音频控制三类视频配音任务,通过自研时空音视频编码器CAV-MAE-ST、时间-音色解耦...
943℃OmniVoice Studio – 开源 AI 语音处理工具,ElevenLabs 平替
OmniVoice Studio是什么OmniVoice Studio 是全本地运行的开源 ElevenLabs 替代方案,提供跨平台桌面客户端,支持零样本语音克隆、声音设计、视频自动配音、语音听写等功能,覆盖 646 种语言。OmniV...
597℃美团GEO营销门户 – 美团推出的生成式引擎优化平台
美团GEO营销门户是什么美团 GEO 营销门户是美团推出的生成式引擎优化(GEO)平台,专为 AI 搜索时代设计,帮助品牌在豆包、DeepSeek、文心一言等主流大模型中提升曝光与推荐频次。与传统 SEO 优化搜索引擎排名不同,GEO 专...
603℃getdesign.md – VoltAgent 团队推出的 AI 原生设计系统库
getdesign.md是什么getdesign.md 是 VoltAgent 团队推出的 AI 原生设计系统库与工具平台,核心提供 60+ 顶级品牌的 DESIGN.md 设计规范文件。基于 Google Stitch 提出的 DESI...
349℃SenseNova-U1-8B-MoT-Infographic – 商汤科技开源的信息图增强模型
SenseNova-U1-8B-MoT-Infographic 是什么SenseNova-U1-8B-MoT-Infographic 是商汤科技开源的 8B 参数信息图增强模型,基于 SenseNova-U1-8B-MoT 统一架构,通过...
306℃叠叠社深度体验 – 会刷弹幕的 AI 二次元搭子
想不想让你喜欢动漫角色,时时刻刻都陪伴着你?前两天半夜学习《Claude Code从入门到精通》,屏幕右上角突然飘过来青疫的一句:“看来K姐找到了自己的救赎之道了呢~”粉色的一行字,带个小表情,从右边慢慢飘到左边。这是一条弹幕,跟B站弹幕...
