8.28 AIbase日报:8大重磅AI动态

8月28日AI行业动态汇总:近期多款重磅AI产品集中发布,覆盖通用大模型、多模态生成工具、行业垂直应用以及具身智能等多个领域,以下是详细更新内容。
腾讯混元推出开源旗舰大模型Hy4preview
腾讯混元正式发布开源旗舰大模型Hy4preview,这款模型参数规模达7700亿,支持最长100万字的上下文窗口,主打真实生产力场景落地。目前模型已在多个平台开放上线,在软件工程、日常办公、游戏开发以及科学研究等多个领域都已取得明显应用进展。
根据内部盲测结果,该模型的综合表现优于多款同类竞品,腾讯也希望通过开源策略推动行业竞争从单纯的参数竞赛转向实际生产力验证。
• 该模型在软件工程、办公、游戏开发与科研四大场景中表现突出
• 内部盲测评分超过GLM-5.3与Kimi K3等主流模型
• 开源策略将推动行业从参数比拼转向实效验证
谷歌推出Gemini Omni 1.1 Flash视频生成模型
谷歌推出全新Gemini Omni 1.1 Flash视频生成模型,在高清长时多模态视频生成领域实现了重要突破。这款模型新增了多项专业创作功能,进一步提升了视频生成的灵活性与专业度。
• 支持在现有视频末尾无缝衔接生成新内容,单次扩展10秒,累计最长可达40秒
• 可通过指定镜头起止帧实现专业运镜和自然转场效果
• 支持引入最长3秒的参考视频片段,确保新生成场景与原有画面保持一致
Midjourney V8.2图像编辑模型正式上线
Midjourney推出V8.2图像编辑模型,为AI绘画创作带来了重要升级,让创作者能够获得更精准、更可控的视觉创作体验。新模型支持三大核心功能,大幅降低了AI绘画的创作门槛。
• 文本指令编辑能力,可通过自然语言直接修改已有图像
• 多图参考生成,单次最多可融合4张图片作为创作参考
• 支持局部重绘和画布扩展,轻松完成画面细节调整和尺寸拓展
详细更新信息可通过官方链接查看:https://updates.midjourney.com/edit-model-for-v8/
蚂蚁与中金联合推出金融增强大模型
蚂蚁集团与中金公司联合推出国内首个金融增强大模型Ling-3.0-flash-Fin,该模型通过海量专业金融语料的训练,大幅提升了金融投研相关的核心能力,在信息检索等关键金融场景中表现出色。
双方同时还发布了FinFIRST金融搜索基准数据集,并计划将其开源,以此推动整个金融AI行业的生态发展,后续还将提供免费API调用和模型权重开源服务。
• 通过专业金融语料训练,强化了投研核心能力
• 聚焦信息检索等四大核心金融场景,表现突出
• 开源计划推动行业生态,提供免费API和模型权重
阿里Qoder升级为全人群智能体工作台
阿里巴巴推出全新升级的Qoder工具,不再局限于AI编程辅助,而是升级为面向全人群的智能体工作台,进一步提升了工作效率与用户使用体验。
• 将工作对象从代码工程拓展到智能体任务,提升整体效率
• 支持“读取-修改-验证-迭代”自主闭环,具备跨文件编辑能力
• 提供编程模式和通用模式双入口,非技术用户也可参与开发
谷歌搜索AI模式升级旅行预订功能
谷歌对其对话式搜索AI模式进行了重大功能升级,正在加速将该模式打造为全流程的AI旅行代理。此次升级新增了多项旅行相关实用功能,覆盖机票、酒店和积分查询等多个场景。
• 整合300多家航空公司和旅行网站的实时机票价格与推荐方案
• 基于用户偏好推荐带真实评价的酒店房源,可直接跳转完成支付
• 支持通过自然语言查询航空里程和酒店积分的具体兑换额度
小鹏第二代VLA大模型迎来重大升级
小鹏汽车第二代VLA大模型迎来首次重大版本升级,此次升级的核心在于让AI系统真正具备时间理解能力,实现了从静态3D空间感知到动态4D时空认知的跃迁。同时,模型的推理效率得到大幅提升,新增了整车大脑Master Agent模块。
• 引入Infini-VLA长时序架构,强化模型对时间序列的处理能力
• 实现“边感知、边思考、边执行”的并行处理模式
• 首次完成VLA与VLM的驾舱融合,将L4级体验下放至量产车型
Anthropic推出MHS标准进军物理AI赛道
Anthropic正式发布模型硬件标准MHS,标志着这家公司首次公开进军具身智能与物理AI赛道。MHS是一套统一的设备控制与通信标准,能够让AI智能体实现对多种硬件设备的操控,大幅提升科研与工业实验的效率。
这项技术已经在生物医药、量子计算以及先进制造等领域展现出强大的提速效果,将大模型的竞争从单纯的对话交互领域延伸到实体操作与物理世界交互的新赛道。
• 统一的设备控制与通信标准,支持AI智能体操控多种硬件
• 在生物医药领域可显著缩短实验开发与运行周期
• 将大模型竞争从对话交互延伸到实体操作领域

