怎么把 Codex 的模型接入 Claude Code ?附完整教程

最近 Claude 又开始大面积封号,我的主号终究也没能幸免。

Hy ASR 3.0 preview – 腾讯混元推出的新一代语音识别模型

Hy ASR 3.0 preview是腾讯混元推出的新一代语音识别模型,基于 Hy3 大语言模型,融合高精度语音识别与深度语义理解。模型支持中文、英语、粤语及10大方言片区,具备上下文智能纠错、热词注入及高噪/耳语等复杂场景鲁棒性。

MiniMax H3 vs Seedance AI 视频生成效果深度对比

好多小伙伴问我,现在怎么大多数视频软件都在做漫剧,做短剧,有没有做商业视频的模型可以推荐。别说,我最近还真测了一个做商业视频的 AI 视频生成模型,就是 MiniMax H3。

JoyAI-Video-Edit – 京东开源的实时流式视频编辑模型

JoyAI-Video-Edit是京东开源自研的实时流式视频编辑模型,基于16B参数自回归扩散架构,在720P分辨率下实现30FPS推理速度,支持任意时长稳定流式编辑。

开源 AI 视频生成工具 MoneyPrinterTurbo 使用教程

AI 视频生成现在越来越精致且自然了,但很多时候我们还是想要真实的画面作为视频素材,AI 只是帮我们去剪辑内容,如果 AI 能自己去找真实素材再剪辑,那就更好了。

SeedRealtime – 字节跳动推出的原生音视频全双工大模型

 SeedRealtime是字节跳动Seed团队推出的原生音视频全双工大模型,基于统一架构原生融合音频、视频与文本,实现边看、边听、边说的全模态实时交互。

MAGI-2-preview – Sand.ai 开源的多模态视频生成模型

MAGI-2-preview 是 Sand.ai 开源的全球首个千亿参数 MoE 多模态视频生成模型,总参数 114B、激活仅 6B。模型延续单流架构,将文本、视频、音频统一纳入同一 Transformer 联合建模,实现原生多模态生成,在 AA 视频生成榜单排名第六。

公众号 AI 美女贴图教程,爆款起号解锁流量主收益

最近我发现了一种非常高效又简单的 AI 起号玩法,你可能也刷到过,这种随手拍的美女生活照,配一两句简单的文案,点开一看,阅读量、互动量都轻松破万。应群友们的要求,今天带大家一起拆解一下这套玩法和变现流程。

Shieldstral – Mistral AI 开源的多模态内容安全分类模型

Shieldstral 是 Mistral AI 推出的 3B 参数开源多模态内容安全分类模型,基于 Ministral-3B 构建。模型将传统固定类别的内容审核重新定义为二元问答任务,支持通过自然语言查询实时定义审核策略,无需重新训练即可适配不同场景。

Get3W – AI 模型聚合平台,统一接口自由切换模型

Get3W 是面向开发者和企业的 AI 模型聚合平台,通过统一 API 一站接入来自 Google、OpenAI、ByteDance、Alibaba、Kling、Midjourney、Runway、MiniMax、Black Forest Labs 等 20 多家厂商的 700+ 模型,能力覆盖视频、图像、音频、3D、全景与对话生成。

InstructAV2AV – 智源联合北大开源的音视频联合编辑模型

InstructAV2AV 是北京智源人工智能研究院与北京大学联合推出的音视频联合编辑模型。用户只需一句自然语言指令,可在端到端生成过程中同时编辑视频画面与对应声音,无需手工掩码或分步处理。

RabbitVis – 兔展智能推出的一站式 AI 设计生产工具

RabbitVis 是兔展智能推出的图层级一站式 AI 设计生产工具,基于自研 UniWorld-Design 视觉大模型,将 AI 生成能力与图层编辑能力深度融合。

Muse Code – Meta 推出的终端编程 AI 智能体

Muse Code 是 Meta 推出的终端编程 AI 智能体,基于 Muse Spark 1.2 模型,可处理大型代码库中的完整软件工程任务,包括规划变更、编写代码与验证结果。

Acti – AI 智能键盘,一键触发复杂任务

Acti 是新加坡团队开发的 AI 智能键盘。键盘将 AI 嵌入手机键盘层,用户长按空格键即可触发 Acti Bar,无需跳转应用可查信息、搜文件、建会议或运行工作流。

Hunyuan3D-Buffalo 1.0 – 腾讯混元推出的 3D 多模态框架

Hunyuan3D-Buffalo 1.0 是腾讯混元推出的统一3D多模态框架,通过共享的 Hunyuan3D-VLM 主干将3D问答、空间定位、文生3D、指令编辑和部件生成集成到单一流程中。

Omega – 腾讯推出的 AI 原生数据分析平台

Omega 是腾讯推出的 AI 原生数据分析平台,内测版名为「马尔摩斯(marmos)」。工具通过 Agent 驱动完整分析链路,让用户用自然语言可生成可交互、可迭代、可定时刷新的数据仪表盘,真正将 AI 嵌入业务工作流。

Wan3.0 – 阿里万相最新推出的视频生成大模型

Wan3.0 是阿里云万相团队最新推出的视频生成大模型。模型在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成 30秒 视频,首次支持 doc、xls、ppt、pdf、md 等文档格式输入,实现万物皆可生视频。

SayIt – 开源 AI 语音输入法,自动将口语转为书面表达

SayIt 是开源的 AI 语音输入法,基于 Rust 构建,支持 Windows 桌面端。用户按住快捷键说话,可将口语实时转为可直接使用的书面文字。

悟界·RoboBrain Orca – 智源推出的多模态表征世界模型

悟界·RoboBrain Orca 是智源研究院推出的多模态表征世界模型,以下一个状态预测替代传统下一个词/帧/动作预测,让 AI 在内部构建统一的世界潜在表征。

Nemotron-Labs-Diffusion – 英伟达开源的三模式语言模型

Nemotron-Labs-Diffusion 是 NVIDIA 推出的三模式语言模型,在单一架构内统一自回归、扩散和自我推测解码。通过联合 AR-扩散目标训练,模型可在不同并发场景下切换模式维持高吞吐量。