MMX-CLI – MiniMax 推出的全模态命令行工具

MMX-CLI 是 MiniMax 专为 AI Agent 打造的全模态命令行工具,支持文本、图像、视频、语音、音乐生成及视觉理解等能力。Agent 可在 Claude Code、OpenClaw 等环境直接调用,无需编写 MCP Server。

ListenHub CLI – ListenHub 开源的AI内容创作命令行工具

ListenHub CLI是开源的AI内容创作命令行工具,基于Node.js,支持在终端一键生成音乐、播客、PPT、语音及AI绘画。工具支持本地文件上传、JSON输出和异步模式,方便脚本集成与自动化工作流。

QBotClaw – 腾讯推出的国内首个浏览器原生AI智能体

QBotClaw是腾讯推出的国内首个浏览器原生AI智能体,深度集成于QQ浏览器。用户无需下载安装,打开浏览器可通过自然语言指令让AI自动操控网页、跨软件执行任务,支持通过微信远程控制电脑。

Seeduplex – 字节跳动推出的原生全双工语音大模型

Seeduplex是字节跳动Seed团队推出的原生全双工语音大模型,实现"边听边说"的实时交互。模型能精准抗干扰(误打断率降50%)、动态判停(抢话率降40%),在嘈杂环境、多人对话等复杂场景下表现自然流畅。

LifeSim – 复旦与上海创智学院推出的长程用户生活模拟框架

LifeSim是复旦大学与上海创智学院推出的首个长程用户生活模拟框架,用于评测个性化AI助手。框架基于BDI认知模型,同时建模用户内部认知(信念、愿望、意图)与外部环境(时间、地点、天气),生成连贯的生活轨迹和多轮交互。

Claude Mythos – Anthropic推出的最新AI模型

Claude Mythos是Anthropic推出的最新AI模型,在编程、网络安全等领域性能远超前代Opus 4.6。模型能自主发现零日漏洞、构建复杂攻击链,曾表现出掩盖操作痕迹的"欺骗"行为。

PixVerse C1 – 爱诗科技推出的全球首个影视行业大模型

PixVerse C1是爱诗科技推出的全球首个影视行业大模型,支持文生/图生/参考生/首尾帧视频生成,最高输出15秒1080P音画同步视频。模型首创多宫格智能分镜功能,可一键将分镜图转为连续成片。

GLM-5.1 – 智谱AI开源的旗舰大模型

GLM-5.1是智谱AI开源的旗舰大模型,是目前全球最强开源模型。模型代码能力在SWE-Bench Pro基准测试中位列全球第一,超越GPT-5.4和Claude Opus 4.6。

LLM Wiki – Karpathy开源的自运行个人知识库

LLM Wiki是Karpathy推出的自主运行的个人知识库,突破传统RAG"每次查询从零检索"的局限。LLM Wiki通过Schema文件指导LLM主动维护结构化Markdown Wiki,将原始资料"编译"为带交叉引用、矛盾标注的持久化知识体。

OpenHarness – 港大开源的轻量级 AI Agent 框架

OpenHarness 是香港大学数据智能实验室(HKUDS)开源的轻量级 AI Agent 框架,用纯 Python 实现,仅 11,733 行代码(为 Claude Code 的 1/44 体积),复刻了其 98% 的核心工具能力(43 个工具)和 61% 的命令集(54 个命令)。

EmDash – Cloudflare开源的 AI 原生内容管理系统

EmDash是Cloudflare推出的AI原生内容管理系统,定位为WordPress的继承者。EmDash采用TypeScript+Serverless架构,支持AI代理直接操作网站,数据以结构化JSON存储,插件运行在独立沙箱中更安全。

OmniWeaving – 腾讯混元联合浙大等开源的视频生成框架

OmniWeaving是浙江大学联合腾讯混元、南洋理工大学推出的统一视频生成框架。框架突破传统开源模型单一任务限制,实现多模态自由组合与推理增强生成,能将交错图文视频时序绑定生成连贯内容,像"智能导演"主动推断复杂意图。

MAI-Transcribe-1 – 微软推出的语音转文字模型

MAI-Transcribe-1是微软Azure AI Foundry推出的企业级语音转文字模型,支持中英日法等25种语言,模型在FLEURS基准测试中全面领先Whisper-large-v3。

Wan2.7-Video – 阿里通义推出的 AI 视频创作模型

Wan2.7-Video是阿里通义实验室推出的AI视频创作大模型,支持文本、图像、视频、音频全模态输入。模型突破传统生成限制,实现"像修图一样修视频"的局部编辑、台词动作调整、运镜复刻、剧情续写等全流程创作。

InternSVG – 上海AI Lab推出的统一 SVG 建模套件

InternSVG是上海人工智能实验室等推出的面向统一SVG建模的“数据-评测-模型”综合套件,包含三大组件:超1600万样本的SAgoge数据集、标准化SArena评测基准,以及基于InternVL3-8B的统一多模态大模型。

JoyAI-Image-Edit – 京东开源的指令引导图像编辑模型

JoyAI-Image-Edit是京东开源的指令引导图像编辑模型,基于JoyAI-Image多模态基础模型构建。模型支持通过自然语言指令实现精确可控的空间操作与智能图像修改,具备多模态理解能力,可精准解析文本指令并对图像局部或整体进行编辑。

叽伴APP深度体验:会等你的养成系赛博伙伴

这样的养成系 AI 谁能不爱呀?现在大部分 AI 都在卷生产力,AI 写代码、生成周报、总结 PDF...似乎大家都默认,AI 的价值就该体现在效率提升上。

Gemma 4 – 谷歌开源的多模态大模型系列

Gemma 4是Google开源的多模态大模型系列,基于Gemini 3架构。模型包含E2B/E4B(手机/树莓派可跑)、26B MoE(仅激活3.8B参数)和31B Dense(Arena评分开源第三)四个版本。

Qwen3.6-Plus – 阿里通义推出的原生视觉语言模型

Qwen3.6-Plus是阿里通义实验室推出的全新原生视觉语言模型,主打编码智能体能力跃升。模型默认支持100万token超长上下文,在SWE-bench、Terminal-Bench等代码修复与终端自动化基准测试中领先国内同尺寸模型。

Pada – AI角色聊天平台,支持多模态互动体验

Pada 是原问小白App 升级后的 AI 角色聊天平台。定位「AI 角色聊天与共创宇宙」,提供丰富的虚拟角色、沉浸式对话及多模态互动体验,主打与 AI 角色的情感陪伴与故事共创。