2026智能互联网蓝皮书在京发布
7月29日,人民网研究院组织编写的第三本智能互联网蓝皮书《中国智能互联网发展报告(2026)》在京发布。发布会聚焦“十五五”开局之年,如何深化智能互联网发展,打造智能经济新形态。人民网党委书记、总裁范正伟在致辞中指出,迈步“十五五”开局之年,智能互联网正在为主流媒体打开全新空间。一是认知入口重构,大模型与智能体跃升为新一代认知基座,推动权威优质内容突破算法茧房,实现对亿级用户的精准直达。二是数据价值重估,数据要素迈入“高质量供给”新阶段,主流媒体积淀的海量权威信源,成为AI训练的核心战略资源。三是角色定位重塑,AI已从生产“工具箱”进阶为业务“强引擎”,推动媒体向AI治理参与者、标准共建者、服务赋能者深度转型。回应时代之变,人民网围绕内容、数据、智能三大板块稳步布局:深耕精品内容供给,夯实智能时代主流价值底座;攻坚优质语料建设,打造AI友好型新模式新业态;提升AI自主创新能力,走好智能向善与普惠之路。顺应智能互联网发展趋势,人民网将坚持“用AI治理AI,以智慧引领智能”。
蓝皮书主编、人民网副总裁唐维红发布总报告《中国智能互联网:推动产业变革的核心引擎》的主要内容。唐维红介绍,智能互联网已然成为培育新质生产力、引领产业变革的核心引擎。2025年我国智能互联网发展特点包括:大模型突破与智能体规模化爆发齐头并进;“人工智能+”引领产业应用向纵深推进;产业生态体系加速构建;智能化与绿色化协同发展;智能互联网治理向务实行动深化。展望中国智能互联网发展趋势,报告认为,大模型将实现从数字智能到物理智能的能级跃迁;应用垂直化、商业化、规模化落地将成为发展主线;绿色智能与可持续发展将深度融合;新型治理体系与标准化建设将加速;我国将积极参与全球治理与规则构建。
发布会上,智能互联网蓝皮书系列成果正式入库人民网主流价值语料库,人民网正式推出001号AI数字员工。
月之暗面全栈开源Kimi K3
7月27日,月之暗面(Moonshot AI)宣布开源Kimi K3模型权重,并同步开源技术报告,以及三大支撑K3训练的底层基础设施(Infra)技术,包括高性能通信库MoonEP、高性能算子FlashKDA、智能体沙箱系统AgentEnv。作为当前全球参数规模最大的开源模型,Kimi K3采用混合专家架构,总参数量达2.8万亿。本次开源覆盖模型本体、训练方法与底层训练系统全链条,采用修改版MIT许可证,全球开发者可下载权重进行本地化部署与二次开发,而具体使用范围需遵循官方许可协议约定。依托Kimi Delta Attention混合线性注意力、Attention Residuals注意力残差、MoonEP等自研底层技术,K3整体规模化训练效率相较前代提升2.5倍。Hugging Face平台CEO Clem Delangue公开表示,Kimi K3上线仅30分钟便登上平台趋势榜榜首,创下平台成立以来发布增长最快纪录。媒体认为,Kimi K3落地将成为中国开源大模型重塑全球AI竞争格局的重要窗口。
DeepSeek-V4-Flash正式版上线
7月31日,国家超算互联网上线DeepSeek-V4-Flash正式版API调用服务和模型文件。DeepSeek-V4-Flash正式版的模型架构、大小和与预览版相同,采取MoE(混合专家)架构,拥有2840亿总参数、130亿激活参数,支持百万级上下文。在此基础上,正式版重新进行了后训练,重点优化智能体工具调用、多轮任务执行效率。模型面向开源社区开放轻量化权重,适配端侧与中小算力集群,吸引开发者构建行业垂直智能体,完善国产大模型Agent生态。
MiniMax H3发布 实现端到端视频后期生成
7月31日,MiniMax发布其新一代多模态生成模型MiniMax H3,实现端到端视频后期生成。MiniMax H3支持文本、图像、音视频等多种输入形式,具备原生双声道音视频内容生成能力,最高支持15秒、2K分辨率的视频生成。MiniMax H3能够在多模态上下文中统一理解创作意图,在指令遵循、文字渲染、视频到视频动作迁移(V2V Motion Transfer)等方面提升显著。MiniMax H3采取Contextual Omni Representation、H3-VAE、H3-Omni Transformer、In-context Regeneration等技术,使高分辨率细节得以精准还原,这一突破让视频后期成为AI的“新护城河”,并实现“输入文本→输出成品”的范式变革。
蚂蚁开源扩散大语言模型LLaDA2.2
蚂蚁集团inclusionAI团队近日发布并开源扩散大语言模型新版本LLaDA2.2,将其定位为首个专门面向智能体(Agent)任务设计的大规模扩散 LLM,同时推出的LLaDA2.2‑flash被描述为“首个面向智能体的MoE扩散大模型”。据介绍,LLaDA2.2采取Levenshtein“编辑式解码”与“块并行解码”组合,在边生成边纠错的同时,在扩散生成框架下,模型能够以block为单位并行生成和更新tokens,相比串行生成更充分利用硬件并行度,为大规模智能体系统提供更高吞吐量和更低时延。
大厂争夺AI办公系统“工作入口”
7月30日,字节跳动启动AI业务组织架构调整,对豆包、飞书、火山引擎三大业务的产品研发和商业化体系进行重组。飞书产品团队与豆包产品团队将进行整合,成立新的豆包产品团队。原飞书GTM团队与火山引擎对应团队整合,成立“创造力服务平台”统筹To B商业化体系。据字节跳动表示,此次组织整合旨在提升AI to B战略的优先级。
同日,腾讯WorkBuddy发布V5.3.5版本,联合腾讯文档,正式推出“人机双写”协同编辑能力,首次实现人与AI在同一文档内共同创作、修改并实时协同,以推动Office变成“AI原生办公系统”,释放更大生产力。
7月27日,据媒体报道,阿里新款AI Agent产品“千问办公”开启小范围测试,已上线本地桌面客户端,还将陆续上线网页端和钉钉内置版。“千问办公”将阿里QoderWork、悟空、MuleRun等多款Agent产品深度整合。
有媒体认为,“工作入口”正在成为大厂必争之地。
上海广播电视台发布视听大脑X-Brain 1.0
日前,上海广播电视台(集团)在2026世界人工智能大会媒体创新论坛上正式发布X-Brain 1.0视听智脑。X-Brain 1.0是新一代广播电视视听数字技术底座,汇聚了智汇、智策、智笔、智剪、智推、智评六个功能模块,具备“集中调度”和“协同生产”两大核心能力,覆盖选题策划、内容制作、分发推送、效果反馈等流程。据介绍,X-Brain 1.0是上海广播电视台锚定“ALL in AI”主攻方向,加快建设数智主流媒体集团的关键落子,也是上海主流媒体服务城市数字化转型、探索AI时代主流价值传播新路径的成果之一。
World Labs发布
机器人策略训练与评估引擎R2S2R
日前,李飞飞团队的World Labs发布了全新的机器人策略训练与评估引擎Real-to-sim-to-real(R2S2R)。该引擎将World Labs空间智能的版图从生成可交互的虚拟世界,进一步延伸到真实机器人的训练、评估与部署,并首次将仿真训练与真实运行打通。该系统通过Real-to-Sim模块,将真实机器人的传感器数据、交互过程精准重建为高保真虚拟环境;再由Sim-to-Real模块在仿真中进行规模化策略训练与评估,最终将成功策略部署回真实硬件。这一方法解决了机器人训练中经验获取难、成本高、失败场景难以复现的痛点,并让机器人策略的评估变得可量化、可追溯,能系统分析失败原因。
ChatGPT桌面应用上线语音功能
OpenAI近日宣布ChatGPT桌面应用上线语音功能,用户在使用桌面版ChatGPT时,可直接通过语音进行输入和交互。其底层基于新一代GPT-Live语音模型,实现双向实时对话,可随时打断并无缝延续上下文。语音功能深度集成于Work与Codex场景,支持自然语言指令启动多Agent协作、后台任务执行与状态查询。系统能够结合屏幕上下文、文档、日历等信息自动完成收尾任务。
附录
人民网、传播内容认知全国重点实验室智能产品
“初芯”智能体平台:集大模型应用、知识管理、智能开发于一体,具有意识形态安全、数据隐私保障、一站式零门槛、赋能深度场景优势,智能体可用于智能传播、智慧舆情、文旅健康、生活服务等各类场景。
主流价值语料库:赋能大模型价值观对齐。优选入库基础语料、问答语料、图文语料等,已在一批主流大模型厂家得到应用验证。
人民智媒大模型:面向党政服务、媒体服务的大模型应用基座。基本解决大模型政治方向、舆论导向、价值取向、事实幻觉等问题,能够协助党政机关、企事业等单位构建各类模型。
“写易”智能创作引擎:面向公务人员、媒体从业者、国企管理者等用户,提供智能写作、智能审校、写作素材知识库调用等服务。
“自在”心理疏导大模型:提供心理疏导、情绪管理、亲子交流和家校共育等服务,已上线国家智慧教育公共服务平台。校园端支持家校心理数据统计与筛查分析。
人民审校和内容风控大脑:提供时政信息表述审校、综合信息审校等内容安全服务,支持文本、图片、音视频等多模态内容审校,可在内容发布前辅助审校,也可在内容发布后开展多平台巡查和风险筛查。
语料社区:致力于打造共创共享的全模态AI语料生态平台,打通语料采集、标注、应用全流程链路,旨在破解高质量中文语料不足和共享难等问题,为人工智能产业发展构建安全、开放的数据基石,促进区域文化数字化建设,助力区域内机构实现语料资源互补互通。
“初见”智能体:汇聚三甲医院专家科普以及国家卫生健康委、体育总局推荐的体重和健身知识,提供健康体重管理建议和多元健身课程,是一款简单实用的健康体重管理助手。
AI经贸文旅智能体:形成平台、数据、算力、算法、模型、智能体“六位一体”创新架构,提供多语种智能翻译服务,实现政策智能查询、智能商贸匹配、智能展销、智能行程规划等应用,满足经贸文旅领域多维度需求。已在广西桂林、宁夏银川落地。
智能硬件“AI之眼”:集成麦克风、摄像头等传感器,面向文博智能导览、户外活动和运动场景,实现多模态交互、智能讲解、导航导览三大核心功能。
人民数据权属审核服务:通过108项确权实质性审查,审核数据来源、权属主体及使用边界,明确数据权属关系。