StepAudio 2.5 TTS – 阶跃星辰推出的语境感知语音生成模型

StepAudio 2.5 TTS是阶跃星辰推出的Contextual TTS(语境感知语音合成模型),首次将语境理解能力引入语音生成全流程。

有道宝库 – 网易有道推出的 AI 知识库工具

有道宝库是网易有道推出的首个AI知识库工具,定位为用户的外接超级知识库和AI研究助手。不同于传统聊天机器人或笔记工具,支持用户上传各类文档建立个人知识库,基于这些资料进行对话问答,能一键生成PPT、思维导图、播客脚本等多种格式的优质内容

Relax – 小红书开源的大模型强化学习训练引擎

Relax 是小红书AI平台团队开源的面向全模态与 Agentic 场景设计的大模型强化学习训练引擎。基于 Megatron-LM 与 SGLang 构建,采用服务化容错架构(Ray Serve)与 TransferQueue 异步数据总线,实现 Rollout、Actor、Critic 角色完全解耦。

Gemini 3.1 Flash TTS – 谷歌推出的文本转语音模型

Gemini 3.1 Flash TTS是Google推出的新一代文本转语音模型,提供更强的可控性、表现力和音质。模型支持70多种语言,引入音频标签技术,可通过自然语言指令精确控制声音风格、语速和表达方式。

混元3D世界模型 2.0 – 腾讯混元开源的多模态世界模型

混元3D世界模型 2.0(HY-World 2.0)是腾讯混元推出的开源多模态世界模型,支持从文本、单图、多视图或视频生成可漫游的3D高斯溅射(3DGS)场景。模型采用四阶段架构,全景生成→轨迹规划→世界扩展→3D重建,实现"文/图生3D世界"与"视频重建3D世界"的统一。

ChatGPT代充值 – 3分钟支付宝、微信开通会员,亲测有效!

GPT-5 的强大能力近在咫尺,更快的响应速度、更精准的逻辑推理、图像生成、长文本处理、自定义 GPT 应用……却被支付购买门槛拦住,没有海外信用卡,国内支付方式无法直接订阅。经过我不懈的努力,终于找到了可以用支付宝/微信支付的订阅平台。

MAI-Image-2-Efficient – 微软推出的轻量版文生图模型

MAI-Image-2-Efficient是微软推出的自研文生图模型,为MAI-Image-2的轻量高效版本,主打高性价比商业量产,在保持照片级真实图像质量的同时,实现成本降低41%、生成速度提升22%、GPU效率提升4倍。

SearchClaw – 中国人民大学推出的 AI 深度研究智能体

SearchClaw 是 RUC-NLPIR(中国人民大学信息检索实验室)推出的自托管式 AI 深度研究智能体,配备 Web 交互界面。用户提交问题后,系统自动执行多轮网络搜索、页面抓取、论文检索与内容综合,最终生成带引用链接的详实报告。

Marble 1.1 – 李飞飞 World Labs 推出的新一代生成式世界模型

Marble 1.1 是李飞飞 World Labs 推出的新一代生成式世界模型,主打画质优化。模型能将单张图片、视频或全景图转化为可自由探索的沉浸式 3D 场景,显著改善光照效果与对比度,大幅减少过曝、泛白等视觉瑕疵,色彩表现更饱满真实。

ERNIE-Image – 百度文心开源的文生图模型

ERNIE-Image是百度文心团队开源的8B参数文生图模型,基于Diffusion Transformer架构,主打高可控性与精准长文本渲染。

OmniShow – 字节联合港中文、港大等开源的视频生成模型

OmniShow是字节跳动联合港中文、莫纳什、港大开源的多模态人-物交互视频生成模型。作为首个支持RAP2V(参考图+音频+姿势)的端到端框架,模型统一处理文本、图像、音频、姿势四种输入,单一12.3B参数模型即可生成10秒高质量视频。

Spark 2.0 – World Labs 开源的Web端 3D 高斯溅射渲染引擎

Spark 2.0是World Labs(李飞飞创立)开源的Web端3D高斯溅射渲染引擎,基于Three.js和WebGL2构建。Spark 2.0首创LoD细节层次系统、渐进式流式传输与虚拟内存技术,可在桌面、手机、VR等任意设备浏览器中实时渲染超1亿个splats的大规模3D世界。

GenieAI – 腾讯云 CodeBuddy 推出的 AI 应用生成平台

GenieAI 是腾讯云 CodeBuddy 推出的 AI 编程平台,只需用自然语言描述需求,可自动生成网页应用、微信小程序、游戏、PPT 等完整产品。

OiiOii 教程 – 0 基础 AI 漫剧制作指南,全自动动画团队

这就是今天正式上线的全球首个动画创作 Agent 工具——OiiOii,接入了满血版的 Seedance 2.0,而且内置了艺术总监、编剧、角色设计师、场景设计师、分镜师、音效总监等一整套专业创作类智能体。我们只需要给一句指令,剧本生成、角色设计、场景设计、分镜制作、音效生成、剪辑合成等等所有工作,这个 AI 视频创作团队都能会自动完成。

谷歌 Gemma 4 本地部署指南,手机、Mac、OpenClaw免费用

前不久,谷歌推出了开源模型 Gemma 4 系列,一共有四个版本。Arena AI 开源排行榜全球第三,数学竞赛 AIME 2026 成绩 89.2%,编程能力 LiveCodeBench 80.0%。能调用工具、能写代码、能驱动Agent,不只是聊天机器人,支持本地部署。今天就跟着橘子姐,一起来完成在手机和电脑上本地部署 Gemma 4 大模型,免费用上谷歌模型接入 OpenClaw 。

Acrobat Student Spaces – Adobe 推出的 AI 学习平台

Acrobat Student Spaces 是 Adobe 推出的 AI 学习平台,专为帮助学生高效备考设计。平台能将课件、笔记等资料一键转化为闪卡、测验题、思维导图,生成播客和视频摘要。

Mano-P 1.0 – 明略科技开源的 GUI-VLA 智能体模型

Mano-P 1.0是明略科技开源的GUI-VLA智能体模型,采用纯视觉驱动,无需API可直接操控桌面软件与网页界面。模型提供72B完整版与4B量化版,支持Apple M4芯片本地部署,实现数据零上云与物理隔离级隐私保护。

HeyGen CLI – HeyGen 推出的命令行工具

HeyGen CLI是HeyGen官方推出的命令行工具与MCP服务器,基于Model Context Protocol协议构建。工具支持开发者及AI助手(如Claude、Cursor)通过自然语言直接调用HeyGen API,实现数字人视频生成、头像与语音管理、账户查询等功能。

LibTV Seedance 2.0真人视频教程:0.35元/秒AI视频生成攻略

LibTV Seedance 2.0 支持真人模式了!Seedance 2.0 刚面世时,各大平台上 AI 二创视频爆火,和詹姆斯球场单挑、跟周星驰合拍电影...让大家第一次见识到了 AI 视频生成的恐怖实力。

实测扣子童锦程 Skill,打造 24 小时 AI 情感顾问

现在跟 AI 聊的越来越多,跟人却没什么话说了。遇到心动 Crush,只能憋出一句干巴巴的“在吗”...暧昧对象忽冷忽热,每天都在猜“Ta 到底喜不喜欢我?”在感情里,往往就是当局者迷。如果有一个人能帮我们分析局势、一秒识破套路,指点迷津,那该多好。最近,我在扣子上搭建了一个 AI 情感大师,可以帮我们高情商助攻追 Crush、一眼分辨渣男绿茶、精准剖析情感死局。