Documentation.AI – AI文档平台,产品变更自动更新文档
Documentation.AI 是智能文档平台,专注于创建、更新和优化产品文档而设计。平台通过 AI 助手能实时监测产品变更、用户反馈等,自动更新文档内容,确保信息始终最新。
UnityVideo – 快手可灵联合港科大开源的视频生成框架
UnityVideo 是香港科技大学联合快手可灵团队、清华大学等推出的新型多模态、多任务视频生成框架,能通过整合多种视觉模态(如分割、骨架、深度、光流等)和训练范式,提升视频生成模型对物理世界的理解能力。
Wan-Move – 阿里联合清华等开源的运动可控视频生成框架
Wan-Move 是阿里巴巴通义实验室等机构开源的运动可控视频生成框架,通过潜在轨迹引导实现高质量的视频运动控制。核心亮点在于无需对现有图像到视频模型进行架构更改,可实现细粒度的点级运动控制,能生成 5 秒、480p 的视频,运动控制质量与商业系统相当。
Paper2Slides – 港大开源论文转为专业幻灯片的AI工具
Paper2Slides 是香港大学开源的AI工具,能快速将学术论文、报告和文档转换为专业幻灯片或海报。采用 RAG(检索增强生成)机制,直接从文档本身提取内容,确保生成的幻灯片内容准确且可追溯,避免信息漂移。
Genstory – 免费AI故事生成平台,能生成完整的数字绘本
Genstory 是基于 Gemini Storybook 技术的免费 AI 故事生成平台,能将用户的简单想法瞬间转化为精美的绘本故事。用户只需输入故事提示,如“勇敢的小女孩拯救森林”,Genstory 能在几秒钟内生成完整的数字绘本,包含引人入胜的文字和精美的插图。
Mulan – AI视频创作平台,Workflow方式实现视频生成
Mulan是创新的 AI 视频创作平台,为用户提供高效、便捷的视频生成体验。借助画布 Workflow 实现视频的批量生成,通过简单替换素材,可快速迭代出风格相似的视频,极大地提升了创意复制的效率。
LensGo AI – AI内容创作平台,一键生成风格化图像与视频
LensGo AI 是创新的 AI 创作平台,支持将简单的文字提示、照片或原始视频素材转化为风格化的图像和视频内容。平台通过强大的多模式创作引擎,让用户在浏览器中轻松实现从文字到视觉、从静态到动态的快速转换,无需复杂的剪辑或动画技能。
OpenScreen – 开源的屏幕录制工具,Screen Studio的平替
OpenScreen 是开源免费的屏幕录制工具,是 Screen Studio 的平替。工具支持 Mac 和 Windows 系统,具备手动缩放、自定义缩放深度、裁剪视频、选择背景、添加注释等实用功能,
Gemini TTS – 谷歌推出的最新文字转语音模型
Gemini TTS 是谷歌推出的先进文字转语音技术,最新版本为 Gemini 2.5 Flash 和 Pro 模型。支持多说话人、多语言(24种以上)合成,可生成自然流畅且富有情感的语音。用户可通过自然语言指令精确控制语音的风格、语速、语调和情感表达。
LLaDA 2.0 – 蚂蚁集团开源的离散扩散大语言模型
LLaDA 2.0 是蚂蚁集团开源的离散扩散大语言模型(dLLM),包含 16B(mini)和 100B(flash)两个版本。打破了扩散模型难以扩展的瓶颈,首次将参数规模扩展至 100B 量级。
Claude-Mem – 开源Claude Code记忆插件,提供长期记忆
Claude-Mem 是专为 Claude Code 设计的开源插件,能为 AI 提供长期记忆能力。Claude-Mem通过自动存储和管理会话中的关键信息,包括工具调用、对话记录和项目结构,解决 AI 在跨会话中容易遗忘的问题。
OiiOii教程 – 实测AI一句话制作动画视频(附进阶玩法)
做动画的AI智能体终于来啦!上个月,OiiOii 作为全球首个专业动画创作 Agent 问世,连邀请码都一码难求。OiiOii 内置7个动画Agent,预设了162种动画风格,操作简单,没有专业功底的普通人,也能轻松生成一个动画。使用 OiiOii 像是与一个专业团队进行合作,会有艺术总监、编剧、角色设计师、分镜设计师等不同身份的智能体参与生成,全流程通过思维导图的形式展现,像是作为甲方加入了他们
OiiOii教程 – 实测AI一句话制作动画视频(附进阶玩法)
做动画的AI智能体终于来啦!上个月,OiiOii 作为全球首个专业动画创作 Agent 问世,连邀请码都一码难求。OiiOii 内置7个动画Agent,预设了162种动画风格,操作简单,没有专业功底的普通人,也能轻松生成一个动画。使用 OiiOii 像是与一个专业团队进行合作,会有艺术总监、编剧、角色设计师、分镜设计师等不同身份的智能体参与生成,全流程通过思维导图的形式展现,像是作为甲方加入了他们
LuxReal – 群核科技推出的AI 3D视频创作平台
LuxReal 是群核科技推出的 AI 3D视频创作平台。平台能基于图像、3D 模型等多模态输入,快速生成主体一致、画面可控的视频内容,适用电商、影视、广告等行业。L
SSVAE – 智谱AI开源的频谱结构化变分自编码器
SSVAE(Spectral-Structured VAE)是智谱AI推出的优化视频生成的新型变分自编码器。SSVAE通过谱分析发现,视频 VAE 的隐空间若具备时空低频偏置和通道特征值的少模式偏置,能显著加速下游扩散模型的训练。
SCAIL – 智谱AI开源的影视级角色动画生成框架
SCAIL(Studio-grade Character Animation via In-context Learning)是智谱AI推出的面向影视级标准的角色动画生成框架。框架通过创新的3D一致性姿态表征和全上下文姿态注入机制,解决了复杂动作场景下角色动画的时空一致性问题,实现高保真度的角色动画生成。
RealVideo -智谱AI开源的实时流式视频生成系统
RealVideo 是智谱 AI 开源的实时流式视频生成系统,基于自回归扩散视频生成技术,RealVideo能将文本输入即时转化为连续、高质量的视频响应,实现与 AI 角色的实时视频对话。
OiiOii邀请码 – 如何获取OiiOii邀请码?附免费领取方式
OiiOii 是全球首个专业动画创作Agent,借助智能 Agent 能实现动画从构思到成品的快速生成。用户只需输入简单指令,即可获得动画短片、视频或图片。
Kaleido – 智谱AI开源的多主体视频生成框架
Kaleido 是智谱AI开源的多主体视频生成框架,能解决多主体视频生成中的主体一致性与背景解耦问题。框架通过创新的数据构建管线和 R-RoPE(Reference Rotary Positional Encoding)机制,有效分离主体与背景信息,在多主体场景下保持主体特征一致性。
GWM-1 – Runway推出的首个通用世界模型
GWM-1 是 Runway 推出的首个通用世界模型,基于 Gen-4.5 构建,采用自回归架构逐帧预测视频内容,可实时交互。模型分为三个分支:GWM Worlds 用于实时环境模拟,生成沉浸式、无限可探索空间;GWM Avatars 是音频驱动的交互视频生成模型,模拟自然人类动作和表情;GWM Robotics 是机器人训练模拟器,生成合成数据加速机器人开发。
粤公网安备 123456789号