StableLearn Logo

搜索内容

Global AI Desk 按时间更新 第 1 / 2 页

Cv

持续更新 Cv 分类下的精选文章、教程和工具动态。

11 篇

Top Stories

精选前沿动态
多模态 · 6 min read

Qwen-Image-Edit-2511 上手:更稳的一致性、更少的漂移,还把 LoRA 直接“塞进模型”

Qwen-Image-Edit-2511 是 Qwen-Image-Edit-2509 的增强版本,主打更稳的角色一致性、更少的图像漂移,并把部分社区 LoRA 能力“内置化”。本文用偏口语但技术向的方式,带你快速了解它能做什么、怎么用 diffusers 跑起来,以及哪些场景最值。

影响:AI 产品与技术关注者
Qwen-Image-Edit-2511 上手:更稳的一致性、更少的漂移,还把 LoRA 直接“塞进模型”
开源项目 HOT · 17 min read

GLM-4.6V 开源多模态 AI 模型下载使用教程【免费 106B 参数 | 图像识别 | 文档理解 | 视频分析】

GLM-4.6V 免费开源多模态 AI 大模型完整教程。支持图像识别、OCR文字提取、PDF文档理解、视频分析等功能,128K超长上下文,106B/9B 两个版本可选,支持本地部署和云端调用,包含下载安装、API使用、实战案例等详细说明

影响:开发者 / API 用户
GLM-4.6V 开源多模态 AI 模型下载使用教程【免费 106B 参数 | 图像识别 | 文档理解 | 视频分析】
开源项目 HOT · 4 min read

STAR: 基于文本到视频模型的实际场景视频超分辨率技术

探索STAR(Spatial-Temporal Augmentation with Text-to-Video Models)如何利用文本到视频扩散模型提升真实世界视频的超分辨率效果。通过创新的时空质量增强框架、T2V模型集成、时间一致性保持等技术,有效解决了传统方法的局限。本文详细介绍STAR的技术原理、核心组件及实践指南,帮助读者掌握这一突破性的视频增强技术。

影响:开源社区
STAR: 基于文本到视频模型的实际场景视频超分辨率技术
第 1 / 2 页 · 共 11 篇