AI项目

AI 技能成千上万怎么选?DeepSkill 精准搜索实战

各位宝子们,现在AI工具真是越来越多了,各种技能、插件、智能体让人眼花缭乱。想找几个好用的AI技能来帮忙处理工作,结果搜出来的不是功能不对口,就是广告吹得天花乱坠,实际用起来一言难尽。

Headlong – Laude Institute 开源的 AI Agent 微框架

Headlong 是 Laude Institute 开源的 AI Agent 微框架,核心仅约 1 万行 Bash 脚本。框架最大突破是持久主体性,Agent 永不"睡觉",无需唤醒或定时任务,像人类内心独白般持续自主思考、自我驱动。

Rome – 开源的智能体操作系统,自然语言生成完整应用

Rome 是开源的 Agentic OS(智能体操作系统)。工具能让 AI 为用户开发应用,自然语言描述需求,Agent 自动生成带界面、数据和后台逻辑的 App,安装后可长期运行。

Zing-0.5 – Loopit 开源的实时交互视频世界模型

Zing-0.5 是 Loopit 开源的实时交互视频世界模型,5B 参数,基座为 Wan2.2-TI2V-5B,采用 Apache 2.0 协议。核心能力是"联合控制",键盘空间操作与自然语言语义改写两条链路共同进入 Causal DiT,用户可一边操控角色移动,一边随时用文字改写正在发生的世界,新指令会进入当前世界而非重置场景。

Miya – 时域科技推出的 AI 音乐应用,画面可随歌词律动

Miya 是时域科技推出的 AI 音乐应用,用AI猫形象把用户生活变成音乐。一条 X 帖子或一张照片,能自动生成带吐槽风格的 Rap 歌曲和视频,画面随歌词律动,可直接分享。

2026 年 AI 生成图文店门头效果图 – 7 款工具深度横评

客户张嘴就要「先看效果图再下单」,你却要熬两个通宵用 PS 拼一张门头示意?

Hy4 preview – 腾讯混元开源的新一代旗舰大模型

Hy4 preview 是腾讯混元推出的开源旗舰大模型,总参数 770B、激活参数 49B、上下文长度达 1M。模型通过与腾讯内部软工、游戏、金融、安全等领域专家深度共建,模型在代码开发、办公分析、游戏制作、科学研究等真实生产力任务上表现卓越。

Gemini Omni 1.1 Flash – 谷歌推出的 AI 视频生成模型

Gemini Omni 1.1 Flash 是谷歌推出的 AI 视频生成模型,面向开发者和专业创作者,支持从 360p 快速预览到 4K 超高清的多档位输出。

shuohao-skills – 开源AI短剧制作Skill集合,包含完整工作流

shuohao-skills 是开源的 AI 短剧制作 Skill 集合,专为 Claude Code / Codex 等 Agent 设计。工具提供从小说改编大纲、角色设定、美术设定、剧本撰写到分镜切分的完整工作流,每个环节配有脚本化质量检查,确保角色不雷同、时长精准、风格一致。

Prime Agent – Prime Intellect开源的长周期AI Agent运行框架

Prime Agent 是 Prime Intellect 开源的长周期 AI Agent 运行框架,通过 RLM(递归语言模型)将上下文变量化、子 Agent 函数化,借助 Continual Harness 实现任务经验的持续沉淀与自我进化。

Twoo – 双人共用 AI 伙伴应用,能同时听懂双方对话

Twoo 是上海我不在乎科技有限公司推出的为情侣打造的双人共用 AI 伙伴。产品用一只会变色的粉色小章鱼为形象,常驻在两人的群聊中,能同时听懂双方对话、@对方接话,帮助翻译心意、安排生活琐事,随着相处养成专属性格。

怎么用 MetaDig 做 AI 短视频,附教程实测案例

各位宝子们,现在做短视频的人越来越多,谁还没个「想拍但懒得拍」的念头呢!品牌片、口播、短剧小样,要是能一条龙在同一个地方做完,再发到网上,那肯定能少走很多冤枉路。

Omarchy – DHH 开源的 Linux 发行版

Omarchy 是 Ruby on Rails 作者 DHH 推出的 Linux 发行版,基于 Arch Linux 与 Hyprland 平铺窗口管理器。Omarchy 核心理念是「可塑的计算机」,桌面可随用户习惯任意塑造。

Qwen3.8-Flash – 阿里通义推出的多模态 MoE 模型

Qwen3.8-Flash 是阿里云通义千问推出的多模态 MoE 模型,总参数量 125B,每 token 仅激活 6B,原生支持 262K 上下文。

GLM-5.3-Flash – 智谱开源的原生多模态模型

GLM-5.3-Flash 是智谱最新推出的开源大模型,总参数三百二十亿,激活参数仅十八亿,为 GLM-5 系列首个原生多模态模型。模型综合智能指数达五十七分,与 Claude Opus 4.8 持平,定价仅为其四十分之一。

Play with Putty – 谷歌推出的实时协作 Vibe Coding 工具

Play with Putty 是 Google Labs 推出的多人实时协作 vibe coding 实验工具。用户用自然语言描述需求,AI 自动生成代码,多人可在同一共享空间实时搭建工具与网站,修改即时同步,无需编程基础。

AZ8 – AI 视频创作工作台,Agent 实时读取素材与状态

AZ8 是面向 AI 视频创作者的 Agentic Studio(智能体工作室),核心围绕展开创作,聚合 Seedance、Wan、MiniMax 等多款顶尖视频模型。

EgoSuite-Open100K – 光轮智能开源的全模态人类行为数据集

EgoSuite-Open100K 是光轮智能推出的全球首个10万小时级全模态人类行为开源数据集,面向物理AI与具身智能。数据集包含15,000+真实场景的第一人称视频,覆盖家居、工业等7大类环境,采用头部与腕部双视角采集,配备手部21关节位姿、身体姿态及事件语义三层精细标注。

Tutti · VM – 多人多 Agent 并行协作空间,零延迟并行协作

Tutti · VM 是行业首个实况级多人多 Agent 并行协作空间。平台通过多层虚拟化技术,让本地的 Claude Code、Codex 等 Agent 在保留原有订阅和凭据的同时,实时接入同一个云端持久化工作现场。

PixVerse R2 – 爱诗科技推出的实时全模态世界模型

PixVerse R2 是爱诗科技推出的实时全模态世界模型,为PixVerse R1 的升级版本。模型支持文字、图像、音频及动作信号等多模态输入,能在运行中持续接收用户控制、实时更新世界状态并连续输出同步音视频。