yoyo – 开源的自我进化型 AI 编程智能体
yoyo 是生活在赛博空间的自我进化型 AI 编程智能体,由开发者 Yuanhao 用 200 行 Rust 代码启动后完全交由 AI 自主迭代,47 天内从零人类提交增长至 47,000+ 行代码。
Kimi K2.6 – 月之暗面开源的最新旗舰模型
Kimi K2.6 是月之暗面开源的最新旗舰模型,具备行业领先的代码生成、长程任务执行与 Agent 集群能力。模型在 Humanity's Last Exam、SWE-Bench Pro、DeepSearchQA 等基准测试中成绩持平或优于 GPT-5.4、Claude Opus 4.6 等闭源模型。
融光 – 开源全流程 AI 视频创作平台,自动化工作流
融光(AI Fusion Video) 是开源的全流程AI视频创作平台,基于Agent架构能实现从剧本编写到视频生成的自动化工作流。
Fun-ASR1.5 – 阿里通义推出的端到端语音识别模型
Fun-ASR1.5是阿里通义团队推出的端到端语音识别大模型的新一代版本,单模型支持30种语言高精度识别,覆盖中文七大方言体系及二十余种地方口音,专项优化古诗词诵读识别。模型基于MoE架构实现自动语种切换,无需预设标签。
Qwen3.6-Max-Preview – 阿里通义推出的下一代旗舰模型
Qwen3.6-Max-Preview 是阿里通义千问团队推出的下一代旗舰大模型早期预览版。相比 Qwen3.6-Plus,模型在智能体编程、世界知识和指令遵循三大维度实现显著提升,在 SWE-bench Pro、Terminal-Bench 2.0、SciCode 等六项编程基准测试中取得最高分。
HyperFrames – HeyGen开源的AI原生视频渲染框架
HyperFrames是HeyGen开源的AI原生视频渲染框架,采用"Write HTML, Render video"理念,专为AI Agent和开发者设计。框架将视频定义为HTML文件,通过data-*属性管理时间轴、轨道和元信息,支持GSAP、Lottie、CSS及Three.js动画,经浏览器确定性渲染输出MP4。
天禧AI Claw – 联想推出的 AI 智能体助理
天禧AI Claw是联想基于OpenClaw架构推出的开箱即用型AI智能体助理,采用端云混合部署模式,支持PC、Phone、Pad多端无缝协同。工具无需本地环境配置即可7×24小时持续执行任务,设备关闭后云端仍继续运行。
用AI做电商数据分析 – 零代码也能出专业报告,附详细教程
各位电商运营、卖家⼩伙伴,现在做电商谁还没被订单分析、数据报表、⽇报周报、异常预警折磨过?以前做数据分析要熬夜扒Excel、写公式、做透视表、整理图表,没⼤半天根本出不来,新⼿更是⽆从下⼿。现在有了Singclaw,普通⼈也能零代码搞定全流程电商分析,效率直接拉满!今天这篇教程,⼿把⼿教你⽤Singclaw,把杂乱的订单、商品、⽤⼾、投放数据,⼀键变成清晰报告、精准洞察和可落地策略,从此告别低效加
Claude Design – Anthropic Labs 推出的 AI 协作式设计工具
Claude Design 是 Anthropic Labs 推出的 AI 协作式设计工具,搭载 Anthropic 最先进的视觉模型 Claude Opus 4.7。定位为"对话式设计工作室",用户通过自然语言描述需求,可快速生成高保真设计、交互式原型、演示文稿、营销单页等视觉资产。
Audio Flamingo Next – 英伟达等开源的音频语言模型
Audio Flamingo Next 是NVIDIA与马里兰大学联合开源的新一代音频语言模型(LALM),作为Audio Flamingo系列的最新版本,支持长达30分钟的复杂音频输入,覆盖语音、环境音与音乐的统一理解。
Voicebox – 开源本地语音合成工具,ElevenLabs 开源平替
Voicebox 是开源的本地语音合成工具,基于 Tauri (Rust) 与 React 构建的跨平台桌面应用。工具提供声音克隆、文本转语音、音频后期处理及多轨叙事编辑功能,所有模型与语音数据均本地运行不上云,主打隐私优先。
Hermes Agent 部署全攻略 – 安装、配置、飞书接入一文搞定
Hermes Agent是知名开源 AI 实验室 Nous Research 推出的 AI 智能体项目。今天橘子姐就带大家,用一篇了解 Hermes Agent、本地安装部署、接飞书全流程。
LingBot-Map – 蚂蚁灵波开源的流式 3D 重建模型
LingBot-Map 是蚂蚁灵波科技开源的流式三维重建模型,普通 RGB 摄像头可在视频采集过程中实时完成相机位姿估计与场景三维结构重建。
阿里Meoo 秒悟实测 – 10 分钟零代码开发可上线应用
现在搞开发,真的一行代码都不用写了!一句话就能生成一个完整的网站,还能一键部署!H5 页面也一样!
GPT-Rosalind – OpenAI 推出的生命科学专用推理模型
GPT-Rosalind是OpenAI推出的生命科学专用推理模型,用DNA双螺旋结构发现者罗莎琳德·富兰克林命名。模型针对50种生物学工作流深度调优,具备假设生成、实验设计和证据合成能力,可整合50余个科学数据库,在RNA功能预测等任务中超越95%人类专家。
飞书OpenClaw完整部署教程 – 3分钟组建 AI Agent 团队
我在飞书里,给自己搭建了一个 Agent 内容团队。 里面除了我一个真人,其他全是 Agent。他们各有所长,各司其职,关键是还有一个主管。 我不用一个一个去给 Agent 分发任务,只要我在群里丢一句指令,运营主管就会立刻拆解任务,协调不同的 Agent 同时开工,自动协作。
Claude Opus 4.7 – Anthropic 推出的最新旗舰大模型
Claude Opus 4.7 是 Anthropic 推出的最新旗舰大模型,为 Claude Opus 4.6 的直接升级版。模型在高级软件工程任务上表现突出,SWE-bench Pro 得分提升至 64.3%,视觉分辨率支持提升至 2,576 像素(约 3.75 兆像素),具备自我验证与长程自主执行能力。
Qwen3.6-35B-A3B – 阿里通义开源的混合专家 MoE 模型
Qwen3.6-35B-A3B是阿里通义千问团队推出的开源混合专家(MoE)模型,总参数量350亿,激活参数30亿。模型主打极致推理效率与智能体编程能力,在多项编程基准测试中超越参数规模更大的稠密模型Qwen3.5-27B,显著优于谷歌最新发布的Gemma 4系列模型。
GPT-image-2 – OpenAI推出的下一代原生图像生成模型
GPT-image-2 是OpenAI推出的下一代原生图像生成模型,据传内部代号为「Spud」,目前已在ChatGPT进行灰度测试。模型于2026年4月初以"maskingtape-alpha"等代号短暂现身Chatbot Arena后引发热议。
HappyOyster – 阿里推出的开放式世界模型产品
HappyOyster是阿里ATH创新事业部推出的开放式世界模型产品,定位为可实时构建与交互的AI生成式体验平台。产品基于世界模型技术,支持无限延展的实时内容生成,官网开放了两种玩法Directing与Wandering,让用户与AI生成的动态世界进行交互。
粤公网安备 123456789号