文章摘要
近期AI开源社区更新大量资源,涵盖模型、数据集、应用与技术内容。核心模型上新包括Ornith-1.5系列、SenseNovaU1.5正式版、Qwen3.8-27B系列变体。还上线多款创新应用,如多模型策略对战平台等。开源优质数据集,涉及视频编辑、数学形式化等领域,同时发布9篇技术文章提供参考。

近期AI开源社区更新了一批丰富的AI技术资源,覆盖模型、数据集、创新应用与技术内容四大板块,整体上新规模亮眼:累计上线模型2382个、数据集339组、创新应用173款,同时发布了9篇深度技术内容,为开发者提供了全面的工具与参考。

核心模型更新

Ornith-1.5系列模型

开源团队推出了Ornith-1.5系列模型,包含三个规格:397B MoE旗舰版本、35B-A3B MoE(每token仅激活3B参数)以及9B Dense(含移动端量化版本),全部采用MIT开源协议。该系列的核心创新是端到端自改进训练框架:模型可自主生成训练任务、搭建评测脚手架、产出解题轨迹,通过GRPO联合优化形成闭环,无需依赖人工策划的训练任务与固定评测流程。

性能表现方面:397B版本在Terminal-Bench 2.1上达到86.1的得分,接近顶级模型表现;35B-A3B仅激活3B参数,就在全编码与智能体基准测试中超越了稠密架构的同级别模型;9B Dense版本在多项任务上的表现甚至超过参数量更大的同类模型。

模型合集链接:https://开源社区平台/collections/ornith-ai/Ornith-15

部署示例:

modelscope download --model ornith-ai/Ornith-1.5-35B-A3B --local_dir ./ornith-ai/Ornith-1.5-35B-A3B

vLLM部署命令:

vllm serve ornith-ai/Ornith-1.5-35B-A3B \
  --served-model-name Ornith-1.5-35B-A3B \
  --host 0.0.0.0 --port 8000 \
  --tensor-parallel-size 2 \
  --max-model-len 262144 \
  --gpu-memory-utilization 0.90 \
  --enable-prefix-caching \
  --enable-auto-tool-choice --tool-call-parser qwen3_xml \
  --reasoning-parser qwen3 \
  --trust-remote-code

SGLang部署命令:

python -m sglang.launch_server \
  --model-path ornith-ai/Ornith-1.5-35B-A3B \
  --served-model-name Ornith-1.5-35B-A3B \
  --host 0.0.0.0 --port 8000 \
  --tp 2 \
  --context-length 262144 \
  --mem-fraction-static 0.85 \
  --tool-call-parser qwen3_coder \
  --reasoning-parser qwen3

SenseNova U1.5正式版

国内AI团队正式开源了轻量级原生统一多模态大模型SenseNova U1.5 Lite正式版。相较于预览版,正式版更注重将原生多模态能力落地到真实视觉创作流程中,围绕真实视觉任务优化了训练数据、任务设计与后训练流程,重点强化了视觉生成质量、复杂指令遵循能力、文字与布局还原度、原生4K分辨率支持、图像编辑精度以及精细视觉控制等核心特性。

该模型提供了更高可控性、更高清画质与更高性价比的生成工具,推动AI视觉生成从原型验证阶段迈向稳定交付的实用阶段。

模型链接:https://开源社区平台/models/SenseNova/SenseNova-U1.5-8B-MoT

官方参考文档:https://github.com/OpenSenseNova/SenseNova-U1/blob/refs/heads/feat/u1.5/docs/u1.5_best_practices.md

Qwen3.8-27B系列变体模型

Qwen3.8-27B发布仅一周,其多个变体就迅速登上社区热榜。以下是值得关注的代表性变体:

  • 本地量化版本:采用动态量化方案,在相同体积下提升精度保留能力,提供多档量化选项,最低仅需17GB内存即可运行,支持多种本地部署工具。
  • 无损推理加速版本:为基础模型配套的推测解码草稿模型,通过并行预测多组token再交由原模型验证,在不改变最终输出分布的前提下提升解码吞吐,适配多种主流推理框架。
  • 实验优化版本:通过权重调整移除模型的主要拒答方向,保留基础模型的推理、视觉与长上下文能力,适合模型行为与安全边界研究。
  • 此外还有自带草稿头的加速版本、消费级显卡适配版本、面向不同内存档位的量化版本、经典量化路线版本、苹果芯片专属版本、Intel设备适配版本以及多芯片部署系列,覆盖从本地到企业级的全场景需求。

创新应用落地

本期社区还上线了多款实用的创新AI应用:

  • 多模型策略对战平台:支持多个大模型各自统领势力,在沙盘场景中自主完成从内政外交到行军攻城的全流程决策,提供完整的回合回放与评分体系。
  • 音乐生成工具:支持从歌词与结构化音乐描述直接生成完整歌曲,简化音乐创作流程。
  • 相机控制视频生成:通过明确的三维相机轨迹控制生成视频的镜头运动,实现更精准的镜头语言表达。

优质数据集开源

本期开源的数据集覆盖了多个专业领域:

  • 视频编辑数据集:包含数十万组高分辨率视频编辑样本,支持多种复合编辑操作,为视频生成模型训练提供丰富数据。
  • 数学形式化数据集:包含数十万组自然语言与形式化验证数据,覆盖多类数学领域,助力AI数学推理研究。
  • 物理视觉数据集:针对合成视频进行物理规律判断,用于测试模型的物理常识推理能力。

精选技术内容

本期发布的9篇技术文章覆盖了模型开源、数据集解读、应用实战等多个方向,涵盖模型性能解析、训练方法分享、工具部署教程等多个主题,为开发者提供了全面的技术参考。

以上内容不代表本平台立场,仅供读者参考