QuantiPhy – 李飞飞团队推出的VLM物理推理量化评估基准

QuantiPhy 是斯坦福大学李飞飞团队推出的首个量化评估视觉 - 语言模型(VLM)物理推理能力的基准。QuantiPhy 通过 3300 多个视频 - 文本实例,要求模型基于视频和物理先验(如物体尺寸、速度等),定量推理物体的运动学属性(如大小、速度、加速度)。

Replymer – AI产品营销工具,用自然真实的方式推广产品

Replymer 是通过真实人类撰写的回复推广产品的工具。工具能帮助品牌在 Reddit、X(Twitter)和 LinkedIn 等社交平台上找到合适的对话场景,用自然、真实的方式推荐产品,建立信任、提升品牌知名度和吸引客户。

opcode – 为Claude Code打造的开源桌面图形界面工具

opcode 是为Claude Code 打造的开源桌面图形界面工具,支持将复杂的命令行操作转化为直观的可视化体验,极大提升用户体验。

TurboDiffusion – 清华大学等推出的视频生成加速框架

TurboDiffusion 是清华大学、生数科技和加州大学伯克利分校联合推出的视频生成加速框架。框架通过 SageAttention、SLA(稀疏线性注意力)和 rCM(时间步蒸馏)等技术,将视频生成速度提升 100~200 倍,能在单张 RTX 5090 显卡上将原本 184 秒的生成任务缩短到 1.9 秒。

Seed Prover 1.5 – 字节跳动推出的新一代数学推理模型

Seed Prover 1.5 是字节跳动 Seed 团队推出的新一代形式化数学推理模型。模型采用创新的 Agentic Prover 架构,通过大规模强化学习(Agentic RL)训练,显著提升数学推理能力和效率。

MedASR – 谷歌开源的医疗语音识别模型

MedASR 是 Google 推出的专注于医学领域的语音识别模型,基于 Conformer 架构,拥有 105M 参数。模型通过大量医学语音数据(约 5000 小时)进行预训练,涵盖医生口述和临床对话等多种场景,能精准识别复杂医学术语和专业上下文。

Fun-Audio-Chat – 阿里通义开源的端到端语音交互模型

Fun-Audio-Chat是阿里云通义百聆团队开源的新一代端到端语音交互模型,具备语音理解、情感感知和任务执行能力。模型采用双分辨率设计,通过5Hz和25Hz帧率协同工作,相比同类产品节省近50%GPU计算资源。

PromptFill – 专为AI绘画设计的开源结构化提示词生成工具

PromptFill是专为AI绘画设计的结构化提示词生成工具,通过可视化填空交互帮助用户快速构建复杂Prompt。解决了传统提示词记忆过载、语法混乱和复用性差的问题,支持Stable Diffusion、Midjourney等主流AI绘画平台。

Artflo – AI设计创作工作流平台,提供无限画布自由创作

Artflo 是面向专业设计师和设计爱好者的 AI 工作流平台。平台提供无限画布功能,可无缝连接多种 AI 模型与创作素材,支持用户在无边界画布上自由创作。平

MiniMax M2.1 – MiniMax推出的多语言编程AI模型

MiniMax M2.1 是 MiniMax推出的多语言编程AI 模型。模型系统性提升了 Rust、Java、Golang 等多语言能力,覆盖从底层到应用层开发。

BeatViz – 面向音乐和内容创作者的 AI 视频生成平台

BeatViz 是面向音乐和内容创作者的 AI 视频生成平台,支持将音频自动转化为高质量动态视频。BeatViz通过智能分析音乐节奏、情绪,能快速生成与音频完美同步的视觉内容,支持多场景风格定制和一键替换音频功能。

Design Arena – AI设计评测平台,动态排名不同AI模型表现

Design Arena 是全球性的 AI 设计评测平台,采用类似国际象棋 Elo 评分系统的对抗式评测机制。用户可对不同 AI 模型生成的设计作品投票,进行动态排名,反映模型在设计美学上的表现。

GLM-4.7 – 智谱AI最新开源的旗舰模型

GLM-4.7 是智谱AI推出的开源模型,专注于提升编码能力、推理能力和工具协同。模型在多语言编程、复杂任务规划、前端设计美学等方面表现出色,支持多种编程框架,如Claude Code等。

Toolplay – AI内容创作平台,涵盖图像生成、视频创作

Toolplay 是一站式 AI 工具平台,整合多种前沿 AI 功能,涵盖图像生成、视频创作等。平台提供丰富的 AI 模型,如 Seadream、Kling AI 等,快速生成高质量的视觉和视频内容。

01Agent – AI图文创作智能体,一站式完成智能创作

01Agent 是为内容创作者设计的 AI 图文创作智能体,支持小红书图文、公众号长文、电商海报等场景,一站式完成二次编辑和、一键排版和多平台自动发布。

NitroGen – 英伟达联合斯坦福大学等推出的通用游戏AI模型

NitroGen 是英伟达联合斯坦福大学、加州理工学院等机构开发的开源通用游戏 AI 模型。基于4万小时、涵盖1000多款游戏的视频数据进行训练,采用大规模行为克隆方法。模型通过输入游戏视频帧,输出手柄操作信号,适用于多种类型的游戏。

MovieFlow – AI视频创作平台,文本描述生成完整视频

MovieFlow 是 AI 视频创作平台,能将用户的一句话、一个想法或一个完整剧本快速转化为几分钟到上百分钟的影片。

Runnable – AI创意生成平台,快速创建PPT、网站、播客等

Runnable 是强大的AI创意生成平台,基于AI技术帮助用户快速创建各种内容。平台涵盖多种功能,如生成幻灯片、网站、报告、播客、图片、文档和视频等,提供丰富的模板和灵感。

Qwen-Image-Layered – 阿里推出的AI图像编辑模型

Qwen-Image-Layered是阿里团队推出的AI图像编辑模型,能将普通图片自动拆分为独立的RGB透明图层,实现类似Photoshop的分层编辑功能。通过注意力机制和位置编码动态拆分图层,支持3-10层的灵活分解

FlowyAIPC – 本地AI办公助手工具,完全离线运行

FlowyAIPC 是 Flowy AI 公司推出的面向智能办公领域的 AI 助手产品,通过 AI 技术提升用户办公效率。支持 Windows 本地安装,可在本地电脑上部署大模型,完全离线运行、独立管理。