
Stable Diffusion 5 开源:单卡 GPU 生成 8K 图像
全新架构,图像质量飞跃,支持 8K 超高分辨率输出。
精选 AI 新闻、神器与模型,一站式掌握人工智能前沿动态。
聚合 OpenAI、Anthropic、Google 等一手信源的最新动态

全新架构,图像质量飞跃,支持 8K 超高分辨率输出。

在中文理解、生成、推理全面领先,支持图文音视频多模态。

全新稀疏 MoE 架构,万亿参数模型推理成本降低 80%。

文本、图像、视频、音频四合一,一个模型搞定所有内容生成。

国产开源模型 DeepSeek V4 性能媲美 GPT-5,训练成本仅 1/10。

可实时分析直播视频流,延迟低于 100ms,支持多摄像头同步。

Claude 4 Opus 上下文窗口扩展至 100 万 token,推理能力全面超越 GPT-5。

专为移动设备优化的轻量级模型,推理速度提升3倍,可在手机端本地运行。

中文大模型能力再升级,支持长文档理解。

图像生成质量大幅提升,支持更高分辨率输出。

深度求索发布开源代码模型DeepSeek R1,支持128K长上下文,可处理大型代码库、跨文件分析,覆盖主流语言与多类开发场景,助力代码助手与自动化工具。

阿里云正式发布通义千问3.0,重点提升中文理解与多模态生成能力,在方言识别、内容创作、图文及视频生成上均有突破,并加速金融、医疗、教育等企业场景落地。

支持万亿参数规模,可在消费级设备运行。

多模态模型能力全面升级,支持视频理解与实时交互。

腾讯正式发布混元大模型3.0,参数规模首破万亿,支持文本、图像、音频、视频统一处理,并在社交、游戏、金融、教育等场景展现应用潜力。

在编程竞赛中超越绝大多数人类选手,代码质量与效率大幅提升。

专为边缘设备优化的轻量级大语言模型,性能与效率并重。

包含 7B 至 400B 参数规模,支持多模态与长上下文。

Stability AI 发布 Stable Diffusion 4 开源预览版,采用新架构,原生支持 2048×2048 分辨率,文本遵循与人体结构显著提升,开放权重并适配主流工具。

Google DeepMind 发布 Gemini 3,以统一多模态架构刷新 MMLU-Pro、Video-MME、SWE-bench 等多项基准,支持 200 万 token 上下文,并将落地 Workspace、Vertex AI…
精选提升效率的 AI 工具,按场景分类快速找到合适工具
追踪国内外主流大模型与垂直领域模型最新进展
扫码关注公众号「60秒看懂AI」
微信搜索「60秒看懂AI」也可关注