story-to-handdrawn-video实测 – 一键生成手绘绘本视频
今天发点适合做故事绘本的东西。平时做一个绘本步骤实在是太繁琐了,要拆分镜、逐张生图、处理字幕、制作黑白转彩动画,再设置转场和导出参数,流程很碎。
梁文锋投资者交流会 – 录音文字稿(PDF文件)
梁文锋在投资者交流会上系统阐述了DeepSeek的底层逻辑:公司以AGI为唯一目标,不靠KPI而靠愿景驱动管理;坚持开源与"十个月回本"的克制定价,认为越克制越容易成功;描绘了从Agent到持续学习、再到自我迭代奇点和具身智能的技术路线图。
Ling-3.0-tiny – 蚂蚁百灵推出的原生混合推理模型
Ling-3.0-tiny是蚂蚁百灵推出的原生混合推理模型,总参数 7.9B、每 token 仅激活 1.3B,面向数学推理、指令遵循及资源敏感型部署优化。
SALMONN-2 – 清华等开源的通用音频大语言模型
SALMONN-2 是清华大学、上海人工智能实验室与剑桥大学联合开源的通用音频大语言模型,基于字节跳动 SPEAR 统一自监督音频编码器与多层特征融合适配器构建,以 Qwen3 为文本基座,用约 1.8 万小时监督数据便在 MMAU-Pro、MMAR、MMSU 三大综合基准上取得同规模开源模型最佳表现。
story-to-handdrawn-video实测 – 一键生成手绘绘本视频
今天发点适合做故事绘本的东西。平时做一个绘本步骤实在是太繁琐了,要拆分镜、逐张生图、处理字幕、制作黑白转彩动画,再设置转场和导出参数,流程很碎。
Cangjie-skill实测 – 将书籍、视频、播客一键转为可用SKills
今天发点适合把方法论变成 Skills 的东西。平时读完一本书,或者看完一条视频,总觉的学到了东西,但是又不能完全应用在自己的项目中,浪费了很多灵感。
GreenSock官方GSAP Skills 实测 – 让AI生成专业级前端动画
今天发点适合做前端动画的东西。平时让 AI 做点前端动画,要不就是它根本听不懂你在说什么,要不就是做出来的东西一塌糊涂。
商汤 Seko 3.0 实测 – 一键生成爆款AI短漫剧
AI 剧漫剧的观众越来越多,普通创作者却越来越难赚到钱了。这并不是你的错觉,DataEye 预估显示,2025 年国内漫剧用户规模约 1.2 亿,到 2026 年上半年,用户规模已突破 6 亿,规模直接翻了几倍。
Qwen-CUA – 阿里 Qwen 等推出的原生 Computer Use Agent
Qwen-CUA 是 Qwen 团队与 XLang Lab 联合推出的原生 Computer Use Agent,基于 397B-A17B 混合专家架构,仅通过截图感知界面状态,无需依赖 DOM 树或辅助功能元数据,直接用键盘和鼠标事件操控浏览器、桌面应用及专业软件。
怎么把 Codex 的模型接入 Claude Code ?附完整教程
最近 Claude 又开始大面积封号,我的主号终究也没能幸免。
Hy ASR 3.0 preview – 腾讯混元推出的新一代语音识别模型
Hy ASR 3.0 preview是腾讯混元推出的新一代语音识别模型,基于 Hy3 大语言模型,融合高精度语音识别与深度语义理解。模型支持中文、英语、粤语及10大方言片区,具备上下文智能纠错、热词注入及高噪/耳语等复杂场景鲁棒性。
MiniMax H3 vs Seedance AI 视频生成效果深度对比
好多小伙伴问我,现在怎么大多数视频软件都在做漫剧,做短剧,有没有做商业视频的模型可以推荐。别说,我最近还真测了一个做商业视频的 AI 视频生成模型,就是 MiniMax H3。
JoyAI-Video-Edit – 京东开源的实时流式视频编辑模型
JoyAI-Video-Edit是京东开源自研的实时流式视频编辑模型,基于16B参数自回归扩散架构,在720P分辨率下实现30FPS推理速度,支持任意时长稳定流式编辑。
开源 AI 视频生成工具 MoneyPrinterTurbo 使用教程
AI 视频生成现在越来越精致且自然了,但很多时候我们还是想要真实的画面作为视频素材,AI 只是帮我们去剪辑内容,如果 AI 能自己去找真实素材再剪辑,那就更好了。
SeedRealtime – 字节跳动推出的原生音视频全双工大模型
SeedRealtime是字节跳动Seed团队推出的原生音视频全双工大模型,基于统一架构原生融合音频、视频与文本,实现边看、边听、边说的全模态实时交互。
MAGI-2-preview – Sand.ai 开源的多模态视频生成模型
MAGI-2-preview 是 Sand.ai 开源的全球首个千亿参数 MoE 多模态视频生成模型,总参数 114B、激活仅 6B。模型延续单流架构,将文本、视频、音频统一纳入同一 Transformer 联合建模,实现原生多模态生成,在 AA 视频生成榜单排名第六。
公众号 AI 美女贴图教程,爆款起号解锁流量主收益
最近我发现了一种非常高效又简单的 AI 起号玩法,你可能也刷到过,这种随手拍的美女生活照,配一两句简单的文案,点开一看,阅读量、互动量都轻松破万。应群友们的要求,今天带大家一起拆解一下这套玩法和变现流程。
Shieldstral – Mistral AI 开源的多模态内容安全分类模型
Shieldstral 是 Mistral AI 推出的 3B 参数开源多模态内容安全分类模型,基于 Ministral-3B 构建。模型将传统固定类别的内容审核重新定义为二元问答任务,支持通过自然语言查询实时定义审核策略,无需重新训练即可适配不同场景。
Get3W – AI 模型聚合平台,统一接口自由切换模型
Get3W 是面向开发者和企业的 AI 模型聚合平台,通过统一 API 一站接入来自 Google、OpenAI、ByteDance、Alibaba、Kling、Midjourney、Runway、MiniMax、Black Forest Labs 等 20 多家厂商的 700+ 模型,能力覆盖视频、图像、音频、3D、全景与对话生成。
InstructAV2AV – 智源联合北大开源的音视频联合编辑模型
InstructAV2AV 是北京智源人工智能研究院与北京大学联合推出的音视频联合编辑模型。用户只需一句自然语言指令,可在端到端生成过程中同时编辑视频画面与对应声音,无需手工掩码或分步处理。
粤公网安备 123456789号