TraeWork 办公助手实测 – AI 自动读取文档与群聊协作
现在的 AI 工具一个比一个能干。写文档、做总结、数据分析...看演示时,总感觉半天的工作,交给 AI 几分钟就能完成。
dots.tts – 小红书联合上海交大开源的语音合成基座模型
dots.tts 是小红书 dots 团队与上海交大 X-LANCE 实验室联合开源的 20 亿参数全连续自回归语音合成基座模型。模型直接在连续隐空间中逐块生成 48kHz 音频,在 Seed-TTS-Eval 等基准上取得 SOTA 的音色相似度与内容准确度,支持零样本克隆、流式输出及低延迟双工对话。
Loomy 深度体验 – 让桌面 Agent “看懂”本地文件
一个深度使用者的视角:资料库+搜索弹框,到底解决了什么问题?装完Loomy,打开界面,你可能和我一样——能聊天、能执行任务、能连IM,但总觉得差口气。它好像什么都能干,但到底从哪开始才能让它真正“帮上忙”?
笔记同步助手 – 基于微信生态的 AI 笔记内容剪藏工具
笔记同步助手是基于微信生态的笔记同步服务,只需转发一下,就能把微信里看到的文章、视频、附件、聊天记录和收藏一键同步到自己的笔记本。支持公众号、知乎、小红书的文章或多图轮播帖,会保留原文格式与来源,完整落进你的笔记。
Grok 4.6 – SpaceXAI 推出的最新一代旗舰大模型
Grok 4.6 是 SpaceXAI 推出的最新一代旗舰大模型,1.5T 参数,50 万 token 上下文。模型性能在编码、Agent 等基准测试中逼近 Claude Fable 5 与 GPT-5.6 Sol Max,响应速度极快。
Sonilo – AI 视频配乐与音效生成平台,自动分析画面节奏
Sonilo 是 AI 视频配乐与音效生成平台,由前字节跳动、昆仑万维 Mureka 核心团队创立。用户上传视频后,AI 自动分析画面节奏、情绪与动作,生成匹配的配乐和音效,形成完整的声音系统。
wigolo – 开源的本地搜索工具,支持接入多种编程 Agent
wigolo 是开源的本地搜索工具,通过 MCP 接入 Claude Code、Cursor 等编程 Agent。无需 API Key,零成本可在本地完成搜索、网页抓取、全站爬取、结构化提取、缓存和研究。
Gemini 3.7 Flash – Google DeepMind 推出最新的主力模型
Gemini 3.7 Flash 是 Google DeepMind 推出的新一代主力 AI 模型。模型专为 Coding 与 Agent 工作流设计,在软件工程、网页开发和企业自动化等基准上大幅跃升,部分指标超越 Claude Sonnet 5 与 GPT-5.6 Terra。
GLM-5.3 – 智谱推出的最新 AI 大模型
GLM-5.3 是智谱推出的最新大模型,与 GLM-5.2 基座相同,通过极致的后训练 Scaling 大幅提升智能上界。模型是当前编程能力最强的开源模型,在 Terminal Bench、DeepSWE 等多项基准测试中排名第一;同时涌现出强大的网络安全能力,在白盒代码审查与漏洞发现方面持平 Mythos 5。
dots3-note preview – 小红书开源的多模态 MoE 模型
dots3-note preview 是小红书 dots 模型实验室开源的 dots3 系列首个版本,是 IMO 2026 满分模型同系列。模型采用 280B 总参数/16B 激活参数的 MoE 架构,支持 512K 超长上下文与文本、视觉、语音多模态理解。
MiniMax Music 3.0 – MiniMax 开源的音乐生成模型
MiniMax Music 3.0 是 MiniMax推出的下一代开放权重音乐生成模型。模型采用 8B Global LLM与 0.6B Local LLM 的分层架构,结合 Flow Matching + Flow-VAE 连续隐状态合成技术,可根据歌词和结构化音乐描述生成最长 5 分钟、32kHz 立体声的完整歌曲。
story-to-handdrawn-video实测 – 一键生成手绘绘本视频
今天发点适合做故事绘本的东西。平时做一个绘本步骤实在是太繁琐了,要拆分镜、逐张生图、处理字幕、制作黑白转彩动画,再设置转场和导出参数,流程很碎。
梁文锋投资者交流会 – 录音文字稿(PDF文件)
梁文锋在投资者交流会上系统阐述了DeepSeek的底层逻辑:公司以AGI为唯一目标,不靠KPI而靠愿景驱动管理;坚持开源与"十个月回本"的克制定价,认为越克制越容易成功;描绘了从Agent到持续学习、再到自我迭代奇点和具身智能的技术路线图。
Ling-3.0-tiny – 蚂蚁百灵推出的原生混合推理模型
Ling-3.0-tiny是蚂蚁百灵推出的原生混合推理模型,总参数 7.9B、每 token 仅激活 1.3B,面向数学推理、指令遵循及资源敏感型部署优化。
SALMONN-2 – 清华等开源的通用音频大语言模型
SALMONN-2 是清华大学、上海人工智能实验室与剑桥大学联合开源的通用音频大语言模型,基于字节跳动 SPEAR 统一自监督音频编码器与多层特征融合适配器构建,以 Qwen3 为文本基座,用约 1.8 万小时监督数据便在 MMAU-Pro、MMAR、MMSU 三大综合基准上取得同规模开源模型最佳表现。
story-to-handdrawn-video实测 – 一键生成手绘绘本视频
今天发点适合做故事绘本的东西。平时做一个绘本步骤实在是太繁琐了,要拆分镜、逐张生图、处理字幕、制作黑白转彩动画,再设置转场和导出参数,流程很碎。
Cangjie-skill实测 – 将书籍、视频、播客一键转为可用SKills
今天发点适合把方法论变成 Skills 的东西。平时读完一本书,或者看完一条视频,总觉的学到了东西,但是又不能完全应用在自己的项目中,浪费了很多灵感。
GreenSock官方GSAP Skills 实测 – 让AI生成专业级前端动画
今天发点适合做前端动画的东西。平时让 AI 做点前端动画,要不就是它根本听不懂你在说什么,要不就是做出来的东西一塌糊涂。
商汤 Seko 3.0 实测 – 一键生成爆款AI短漫剧
AI 剧漫剧的观众越来越多,普通创作者却越来越难赚到钱了。这并不是你的错觉,DataEye 预估显示,2025 年国内漫剧用户规模约 1.2 亿,到 2026 年上半年,用户规模已突破 6 亿,规模直接翻了几倍。
Qwen-CUA – 阿里 Qwen 等推出的原生 Computer Use Agent
Qwen-CUA 是 Qwen 团队与 XLang Lab 联合推出的原生 Computer Use Agent,基于 397B-A17B 混合专家架构,仅通过截图感知界面状态,无需依赖 DOM 树或辅助功能元数据,直接用键盘和鼠标事件操控浏览器、桌面应用及专业软件。
粤公网安备 123456789号