HarnessEval – MirroS 联合清北、英伟达等推出的评测系统
HarnessEval 是 MirroS 联合清北、Berkeley、MIT、英伟达等机构推出的评测系统。HarnessEval将评测本身 Agent 化:面对每个案例,系统动态规划评测路径,从 Skill Library 选择适用技能,拆解为可验证的子问题,调用工具搜集证据,最终输出可追溯的 evidence tree。
Qwen3.8-27B-DFlash2 – Inco AI 开源的投机解码草稿模型
Qwen3.8-27B-DFlash2 是 Inco AI 开源的投机解码草稿模型,专为 Qwen3.8-27B 设计。模型仅 1.92B 参数,通过块级并行预测、轻量路径选择器和双抽头动态卷积,在单次前向传播中并行生成整块 token 草稿。
MiniMax Design – MiniMax推出的AI Agent商业内容生产平台
MiniMax Design 是 MiniMax 推出的 AI Agent 驱动商业内容生产平台,基于 MiniMax H3 多模态视频模型构建。用户只需表达创作意图,Agent 可自动理解需求、拆解任务、调用模型与工具,完成从素材处理、生成编辑到最终交付的全流程。
扣子桌面端 – 字节跳动旗下扣子推出的桌面端
扣子桌面端是字节跳动旗下 AI Agent 平台「扣子」的电脑客户端,让 AI 真正具备操作本地电脑的能力。经授权后,Agent 可直接读写本地文件、批量处理数据、执行 Python/Git 等命令;搭配云盘实现本地与云端实时同步。
DeepSeek V4 Pro 与 GLM-5.3 深度实测,谁是国产大模型一哥?
今天发点新模型对抗测评相关的东西。国产大模型最近连出两员大将:DeepSeek-V4-Pro 和 GLM-5.3。两款模型发布后,网上的评价不统一,只看跑分很难判断真实差距。所以这次不聊参数,直接上任务,让两款模型使用相同提示词、相同材料和相同交付要求逐项完成。
ManClaw – 阿里旗下书旗团队推出的 AI 漫剧创作 Agent
ManClaw是阿里巴巴旗下书旗团队(千问C端事业群)推出的AI漫剧创作Agent,核心理念是"对话成片"。用户只需通过对话交代故事,AI借助内置Skill自动完成剧本拆解、分镜脚本、角色场景道具图生成、批量视频制作、单镜补拍、字幕与成片合成的全流程。
Mage – 微软开源的 4B 参数多模态模型家族
Mage 是微软开源的 4B 参数多模态模型家族,包含流式视频/图像理解模型 Mage-VL 与图像生成与编辑模型 Mage-Flow。Mage-VL 通过 Codec-Native 编码将视觉 Token 减少 75%,推理提速 3.5 倍,支持实时视频理解。
Academic Research Skills – 开源的 A I Agent 学术科研技能
Academic Research Skills 是 Cheng-I Wu 为 Claude Code 开发的开源学术技能插件,覆盖从选题研究、论文写作、同行审稿到修订收尾的全流程。插件通过 39+ 个专业智能体协作,提供引用溯源核查、苏格拉底式研究引导、反幻觉验证和实验溯源登记等功能。
Nature Skills – 开源的 AI 科研技能库,聚焦论文全流程
Nature Skills 是开源的科研技能库,面向全球AI学者,聚焦 Nature / CNS 论文全流程。Nature Skills采用路由式 SKILL.md 架构,内置18项技能,覆盖论文写作、润色、审稿、图表、引用、文献检索与专利转化等。
ToolJet – 开源 AI 低代码开发平台,可视化拖拽搭建
ToolJet 是开源的低代码平台,被称为 Retool 的开源平替。平台提供 60+ 可拖拽组件和 80+ 数据源连接,支持内置 PostgreSQL 数据库、可视化工作流及 JS/Python 代码扩展,可快速搭建内部后台、数据看板和审批流。
MemoraX Code – 专为 Coding Agent 设计的长期记忆系统
MemoraX Code 是专为 Coding Agent 设计的长期记忆系统,解决 Agent 每次新对话都需"重新认识"项目的痛点。工具通过本地代码仓记忆与云端长期记忆,实现跨 Agent、跨对话、跨端的项目经验持续积累;能自动从历史任务中提炼可复用的工程经验(Procedure Memory)。
Lovart中文版 – Lovart 推出的新一代 AI 设计 Agent
Lovart中文版是 Lovart 面向中文用户推出的新一代AI设计Agent,通过对话式交互帮助用户快速生成专业级视觉内容。平台集成Seedance、MiniMax H3等顶尖模型,内置UGC广告视频、品牌周边、爆款视频复刻、Banner及海报设计等丰富Skill工作流,支持素材管理与灵感采集。
WeLM – 微信推出的自研大语言模型
WeLM(WeChat Language Model)是微信自研的大语言模型,已迭代至V4。模型专为微信生态打造,参数约80B-130B,采用稀疏MoE架构,强调低成本与高效率。
VM0 – 企业 AI Agent 平台,自然语言构建工作流
VM0 是面向企业团队的 AI Agent 平台,主打"用自然语言构建工作流"。用户只需在 AGENTS.md 中用自然语言描述需求,可部署 24/7 云端运行的 AI 员工。平台集成 100+ 工具,包括Slack、GitHub、Notion 等,支持多模型,具备沙箱隔离与细粒度权限。
用 AI 做歌一直火不起来?问题不在灵感,在你没有制作人思维
不少用 AI 做歌的朋友,应该都有过类似的落差感:自己生成的歌旋律顺、歌词也有巧思,循环听了好多遍,越听越觉得不错。可一发到抖音、音乐平台,数据就特别惨淡,播放量上不去,收藏和转发也寥寥无几。
MyContext – 阿里千问办公开源的 Agent 上下文基础设施
MyContext 是阿里云千问办公团队开源的 Agent 上下文基础设施,以本地优先方式运行,可将钉钉、飞书等 IM 沟通、文档、会议等多源工作数据,加工为持续更新、可回溯的专属"工作档案",包含职责范围、协作关系与工作结论。
Mureka V9.5 – 昆仑万维推出的新一代 AI 音乐生成模型
Mureka V9.5 是昆仑万维推出的新一代 AI 音乐生成模型。模型基于 MusiCoT 音乐思维链框架,主打克制自然的编配与真实感:人声良品率升至 61%,控制良品率达 97%,中文国风的咬字、气口与和声层次大幅进化。
Luna-TTS – 宇生月伴推出的文本转语音大模型
Luna-TTS 是上海交大系初创公司宇生月伴(VUI Labs)自研的文本转语音大模型。模型摒弃主流自回归路线,采用 Masked Diffusion 掩码扩散架构,基于 Qwen3-0.6B 训练,配合自研 Luna-Codec,在中英日韩 100 万小时语音数据上预训练。
完全不懂乐理,我用AI做出了第一首能上线的原创歌
相信很多人都有过写一首歌的念头。可能是某个深夜情绪翻涌,脑子里飘着几句不成调的感慨;可能是想给重要的人准备一份特别的礼物,翻来覆去觉得什么都不够心意。但念头大多转一圈就放下了——毕竟不会乐器,不懂乐理,连简谱都认不全,写歌怎么看都是专业音乐人才能做的事。
Origin – Cursor 推出的 AI 原生代码托管平台
Origin 是 Cursor 推出的 AI 原生代码托管平台,专为 Agent 时代设计。平台提供 Git 仓库管理、PR 审查与合并、GitHub 双向同步等核心功能,首创堆叠式 PR、AI 自动合并冲突、机器可读审查状态等 Agent 原生特性。
粤公网安备 123456789号