HunyuanOCR – 腾讯混元推出的端到端OCR视觉语言模型
HunyuanOCR 是腾讯混元团队推出的开源的端到端OCR视觉语言模型。依托混元原生多模态架构,仅用1B参数就实现了多项OCR任务的SOTA性能。具备高效轻量的架构,单指令单推理即可输出最优结果,相比传统级联方案更便捷高效。
Tbox AI 浏览器 – 为内容创作和知识管理设计的AI浏览器
Tbox AI 浏览器是为创作者和知识工作者设计的智能浏览器。Tbox AI 浏览器以 AI 技术为核心,将内容创作与知识管理深度融合,通过智能辅助功能,帮助用户高效生成和发布小红书等平台的优质内容,同时将日常积累转化为创作灵感。
VisualGPT – 免费AI图像生成与编辑平台,自动选择模型
VisualGPT 是强大的免费AI图像生成与编辑平台。通过融合多种先进图像模型,如Stable Diffusion等,让用户能通过文本提示或上传图像,快速生成和编辑高质量图片。功能丰富,包括背景移除、图像增强、室内设计等专业功能,可满足从初学者到专业人士的多种需求。
Toolhouse – AI Agent开发与管理平台,一键部署生产环境
Toolhouse是专注于智能体(Agent)开发和管理的低代码AI工具平台,帮助用户轻松创建和部署 AI 应用程序,降低智能体开发门槛,简化复杂的技术流程。提供了一套集成化的工具链,帮助用户快速创建、部署和管理智能体,适用于需要自动化任务处理、智能决策等场景的企业和个人开发者。
Fara-7B – 微软开源的小型计算机Agentic模型
Fara-7B 是微软开源的专注于计算机使用的代理型小语言模型(SLM)。模型通过视觉感知网页,操作鼠标、键盘等界面元素来帮助用户完成任务,如填写表单、搜索信息或预订行程。
Teammates – 育碧推出的可交互生成式AI游戏项目
Teammates是育碧基于生成式AI技术推出的AI队友项目,能为玩家提供更具沉浸感和真实感的游戏体验。玩家能通过语音实时指挥AI队友,如“帕布罗,掩护我”或“索菲亚,攻击敌人”,AI队友根据指令和战场环境做出相应行动,如射击、掩护、跟随等。
NemoVideo – AI视频编辑工具,一键制作爆款视频
NemoVideo 是 AI 视频编辑工具,专为创作者设计。工具通过 AI 技术实现自动剪辑,如消除静音、加字幕等,能根据用户需求生成创意简报和脚本,帮助快速制作爆款视频。
LambdaTest – AI云端测试平台,可进行实时和自动化测试
LambdaTest 是 AI 驱动的全渠道软件质量平台,通过智能测试工具加速质量工程。支持跨浏览器测试,可在 3000 多种浏览器和设备组合上进行实时和自动化测试,确保 Web 应用的兼容性。LambdaTest 的 KaneAI 是全球首个生成式 AI 原生测试代理,利用自然语言生成和优化测试脚本,提升测试效率和质量。
Claude Opus 4.5 – Anthropic推出的最新AI编程模型
Claude Opus 4.5 是 Anthropic 公司最新推出的先进 AI 模型。模型在编程、系统级任务、日常研究和文档处理等方面表现出色,擅长处理复杂的软件工程问题,能在多项基准测试中超越人类水平。模型具备强大的创造性解决问题能力,能巧妙应对复杂场景。
MindVideo AI – 免费AI视频生成工具,支持图、文生视频
MindVideo AI 是先进的免费在线 AI 视频生成工具,支持文本转视频和图像转视频功能。用户只需输入文字描述或上传静态图片,可在几秒内生成高质量视频。特色包括丰富的 AI 视频特效,如 AI 接吻、拥抱、膨胀等,整合了 Kling AI、Runway 等多个顶尖 AI 模型。
Figma Make – Figma推出的高保真原型生成AI工具
Figma Make 是 Figma 推出的 AI 驱动从提示到应用的工具,帮助设计师和开发者快速将创意转化为高保真原型和可交互的应用程序。用户可以通过自然语言描述或上传草图,让 Figma Make 快速生成设计框架和交互效果。
怎么免费体验谷歌Nano Banana Pro?推荐10个AI工具
Gemini 3 Pro 屠榜没两天,Google 又发布了最新的图像模型 Nano Banana Pro(又名 Gemini 3 Pro Image)。Nano Banana Pro 内核由 Gemini 2.5 Flash 升级到 Gemini 3 Pro,多模态推理大幅加强,再加上谷歌搜索知识库,对画面、文本、结构的理解都更到位。10个可以免费体验 Nano Banana Pro 的方式敬上
Pixazo AI – 在线AI图像和视频生成平台,生成内容即时预览
Pixazo AI 是功能强大的在线 AI 设计与创意生成平台,提供多种创意工具,帮助用户快速生成图像、视频、动画、头像、海报等设计内容。通过简单的文本输入或图像上传,即可实现高质量的创作,支持多种风格和应用场景,如社交媒体、广告营销、活动宣传等。
Banana Prompts – AI模型提示词聚合平台,提供多种风格
Banana Prompts 是专注于 AI 生成艺术提示的社区平台,用户可以分享和发现针对多种图像生成模型(如 Nano Banana、Midjourney、Stable Diffusion 等)优化的提示词。平台的核心理念是“透明化 AI 艺术创作”,每张展示的 AI 生成图像都附带完整的提示文本,用户可以直接复制这些提示用于自己的创作,或从中学习高质量提示的写作技巧。
WorldGen – Meta推出的3D世界生成端到端系统
WorldGen 是 Meta 最新推出的先进端到端系统,能通过一段文本提示生成可交互、可导航的 3D 世界。用户只需输入简单的描述,如“中世纪村庄”或“火星基地”,系统能在几分钟内生成一个风格一致、结构合理的虚拟世界,覆盖 50×50 米的区域。
Olmo 3 – AI2最新开源的大语言模型系列
Olmo 3 是 Allen Institute for Artificial Intelligence (AI2) 推出的系列开源大型语言模型。模型包括多个版本,Olmo 3-Base(基础模型,7B 和 32B 参数)在编程、阅读理解和数学解题方面表现出色,Olmo 3-Think(推理模型)专注于复杂推理和强化学习。
谷歌Nano Banana Pro怎么用?推荐10个免费体验平台
Gemini 3 Pro 屠榜没两天,Google 又发布了最新的图像模型 Nano Banana Pro(又名 Gemini 3 Pro Image)。Nano Banana Pro 内核由 Gemini 2.5 Flash 升级到 Gemini 3 Pro,多模态推理大幅加强,再加上谷歌搜索知识库,对画面、文本、结构的理解都更到位。10个可以白嫖 Nano Banana Pro 的方式敬上。
Supertonic – 开源的AI文本转语音系统,完全离线极速合成
Supertonic 是 Supertone 开源的高性能文本转语音(TTS)系统,具备极速性能和轻量级。仅包含66M参数,生成语音的速度可达167倍实时速度,是目前最快的TTS系统之一。Supertonic 完全离线运行,所有处理都在本地设备完成,确保隐私和零延迟。
ReelFarm – 专注于TikTok的AI视频生成与自动化发布工具
ReelFarm 是专注于 TikTok 平台的 AI 视频生成与自动化发布工具。通过将文本提示转化为视频内容,支持多种视频格式,如幻灯片和“钩子+演示”格式,帮助用户快速生成吸引人的短视频。
MiMo-Embodied – 小米推出的跨领域具身大模型
MiMo-Embodied 是小米发布的全球首个开源的跨领域具身大模型,整合了自动驾驶和具身智能两大领域的任务,实现了在环境感知、任务规划、空间理解等多方面的卓越性能。模型基于视觉语言模型(VLM)架构,通过四阶段训练策略,包括具身智能监督微调、自动驾驶监督微调、链式推理微调和强化学习微调,显著提升了跨领域的泛化能力。
粤公网安备 123456789号