GPT-6 Astra – OpenAI 推出的最新旗舰大模型

GPT-6 Astra 是 OpenAI 推出的旗舰大模型,官方称其为「全球最智能、最符合人类意图的模型」。模型突破传统聊天边界,进化为能独立操作软件、浏览网页、完成复杂任务的 AI Agent。

Lovart中文版教程 – 用 AI 搞定店铺品牌设计

友友们,最近我身边真的很多朋友开始认真考虑副业。原因很现实。有人是降薪,有人是换工作不顺,有人只靠一份工资,心里越来越没底。我有个认识了十多年的朋友,想开一家社区咖啡小店。

Cheso – 腾讯推出的 AI PPT Agent 制作工具

Cheso 是腾讯推出的 AI 原生演示文稿 Agent。工具能自主完成调研,用户只需用自然语言描述需求,Cheso 会自动联网检索信息、交叉验证来源、规划内容结构,最终生成一份设计精美且信息准确的演示文稿。

Muse Spark 1.3 – Meta 推出的新一代大语言模型

Muse Spark 1.3 是 Meta 推出的新一代大语言模型,由扎克伯格亲自站台,定位为 Meta 在编程和智能体任务上的重大突破。

Easel – 浙大联合北大开源的 AI 社交媒体内容工作台

Easel 是浙江大学与北京大学联合开源的 AI 社交媒体内容工作台。平台基于 OpenClaw Agent 框架,用一个智能体打通社媒运营全链路,从热点发现、选题策划、内容创作到多平台发布与数据复盘。

Gemini 3.8 – 谷歌推出的推理与编码模型

Gemini 3.8 是 Google 推出的推理与编码模型,包含 Flash 和 Flash Cyber 两个版本。Gemini 3.8 Flash 在保持与前代相同速度和低价的基础上,大幅提升软件工程、Agent 任务及多步推理能力,在代码、金融、法律等基准测试中接近甚至超越更大参数的前沿模型。

LibTV深度动作捕捉实测 – 一键搞定口播粗剪

最近那种 AI 换角视频很容易刷到。虽然角色变了,但动作熟悉,成片很容易让人看完。

腾讯混元 Hy4 preview 实测 – 用 WorkBuddy 搞定全流程办公

腾讯刚刚发布了 Hy4 preview,总参数达到 770B,激活参数为 49B,上下文长度超过 1M。WorkBuddy 又是首发接入,能免费体验整整两周,而且Hy3 也会继续免费到 9 月底,想体验 AI Agent 办公的一定要下载来试试。Hy4 preview 官方重点提到了软件工程、游戏开发、智能办公。我就先帮大家测测这几个方面到底实力如何。

Fusion Model – FUMO Lab 推出的智能分配模型

Fusion Model 是 FUMO Lab 推出的智能分配模型。模型能根据不断演化的任务状态,动态将计算需求分配给最适合的异构模型,实现"一次融合,尽揽众长"。

Hy4 preview 轻量版 – 腾讯混元开源的Hy4量化压缩模型

Hy4 preview 轻量版是腾讯混元将原本 1.5TB 的 Hy4 preview 开源大模型,通过自研 Sherry 1.25bit 稀疏量化与 MIX-STQ1_0 逐层混合精度技术,压缩至约 214GB 的版本。

Claude Fable 5.1 – Anthropic 推出的最新旗舰大模型

Claude Fable 5.1 是 Anthropic 推出的旗舰大模型,定位为目前公开可用的最强 AI 之一。模型专为复杂推理、长周期 Agent 任务和知识工作设计,在科学研究、编码、计算机操作等 8 项基准测试中全面领先上一代,且低推理档位即可达到前代高档位性能。

Atlas – World Labs 推出的全球首个多模态世界模型

Atlas 是李飞飞创办的 World Labs 推出的全球首个多模态世界模型。模型能原生理解文本、图像、视频与 3D 空间信息,通过空间上下文将画面锚定在三维坐标中,实现像素级精确的相机控制生成、稀疏照片 3D 重建及时空模拟。

Claude Mythos 5.1 – Anthropic 推出的 Claude 系列旗舰模型

Claude Mythos 5.1 是 Anthropic 推出的 Claude 5.1 系列旗舰模型,与Claude Fable 5.1 共享同一基础能力。模型专为高风险专业领域设计,仅面向通过审核的网络安全机构和生命科学研究人员开放,支持漏洞防御、蛋白质设计等前沿研究。

Muse Voice Transcribe – Meta 推出的首个实时音频感知模型

Muse Voice Transcribe 是 Meta 推出的首个实时音频感知模型,集流式自动语音识别、说话人分割与端点检测于一体。模型支持 70 多种语言及原生语码切换,可处理超 1 小时长音频与 20 人以上同时对话,在流式转写和语音分割基准测试中均排名第一。

OiiOii 怎么用?AI 一键生成漫剧完整教程

AI影视,真的开始从网友整活走向正规军了。昨天,国内首部 AIGC 长剧《后西游记》正式上线芒果TV,并直接登上了湖南卫视黄金档!

Seedance 2.0 fast vs MiniMax H3 AI视频模型实测对比

友友们,最近的视频模型更新得有点凶。字节家的 Seedance 2.5 正式开放 API,最长可以生成 30 秒视频,最多接收 50 个图片、视频、音频和文本参考;Seedance 2.0 fast、Seedance 2.0 mini 降价,直接把 720P 视频的成本压到了 0.6 元/秒和 0.2 元/秒左右。

WeMM-Embedding – 腾讯开源通用多模态Embedding模型

WeMM-Embedding 是腾讯微信视觉团队开源的通用多模态 Embedding 模型家族,提供 2B/4B/9B 三种规格。模型将文本、图像、视频、视觉文档及交错多模态输入统一编码到共享向量空间,在 MMEB-v2 基准排行榜位列第一。

FireRedAudio – 小红书 FireRed 推出的通用音频语言模型

FireRedAudio 是小红书 FireRed 团队推出的通用音频语言模型,基于 9B 参数 Qwen3.5 自回归 LLM。模型理解与生成分别使用独立的连续表征通道(Audio Encoder 与 RedAE),再汇入共享 LLM 统一推理。

实测 WorkBuddy × Hy4 preview – 一句话搞定真实生产

我很早就在用 WorkBuddy。Hy3 那会儿,我已经拿 WorkBuddy 写过文案、搭过页面,也让 WorkBuddy 处理过一些零碎任务。日常需求交给 WorkBuddy 没问题,但任务一长、文件一多,就总觉得还差一点。

MiniMax H3 Max – MiniMax 推出的实时视频生成模型

MiniMax H3 Max 是 MiniMax 推出的实时视频生成模型,基于开源 H3 进行后训练与推理优化。模型支持文生/图生视频并同步生成音频,5 秒 768p 视频不到 3 秒可生成,吞吐量达原生 H3 的 35 倍,在 Artificial Analysis 和 Design Arena 图生视频榜均排名第一。