首页/每日资讯/【每日简讯】每周AI信息参考|2026智能互联网蓝皮书在京发布/
【每日简讯】每周AI信息参考|2026智能互联网蓝皮书在京发布
2026-08-04 08:41:505浏览
【2026年8月3日更新】

2026智能互联网蓝皮书在京发布

7月29日,人民网研究院组织编写的第三本智能互联网蓝皮书《中国智能互联网发展报告(2026)》在京发布。发布会聚焦“十五五”开局之年,如何深化智能互联网发展,打造智能经济新形态。人民网党委书记、总裁范正伟在致辞中指出,迈步“十五五”开局之年,智能互联网正在为主流媒体打开全新空间。一是认知入口重构,大模型与智能体跃升为新一代认知基座,推动权威优质内容突破算法茧房,实现对亿级用户的精准直达。二是数据价值重估,数据要素迈入“高质量供给”新阶段,主流媒体积淀的海量权威信源,成为AI训练的核心战略资源。三是角色定位重塑,AI已从生产“工具箱”进阶为业务“强引擎”,推动媒体向AI治理参与者、标准共建者、服务赋能者深度转型。回应时代之变,人民网围绕内容、数据、智能三大板块稳步布局:深耕精品内容供给,夯实智能时代主流价值底座;攻坚优质语料建设,打造AI友好型新模式新业态;提升AI自主创新能力,走好智能向善与普惠之路。顺应智能互联网发展趋势,人民网将坚持“用AI治理AI,以智慧引领智能”。

蓝皮书主编、人民网副总裁唐维红发布总报告《中国智能互联网:推动产业变革的核心引擎》的主要内容。唐维红介绍,智能互联网已然成为培育新质生产力、引领产业变革的核心引擎。2025年我国智能互联网发展特点包括:大模型突破与智能体规模化爆发齐头并进;“人工智能+”引领产业应用向纵深推进;产业生态体系加速构建;智能化与绿色化协同发展;智能互联网治理向务实行动深化。展望中国智能互联网发展趋势,报告认为,大模型将实现从数字智能到物理智能的能级跃迁;应用垂直化、商业化、规模化落地将成为发展主线;绿色智能与可持续发展将深度融合;新型治理体系与标准化建设将加速;我国将积极参与全球治理与规则构建。

发布会上,智能互联网蓝皮书系列成果正式入库人民网主流价值语料库,人民网正式推出001号AI数字员工。


月之暗面全栈开源Kimi K3

7月27日,月之暗面(Moonshot AI)宣布开源Kimi K3模型权重,并同步开源技术报告,以及三大支撑K3训练的底层基础设施(Infra)技术,包括高性能通信库MoonEP、高性能算子FlashKDA、智能体沙箱系统AgentEnv。作为当前全球参数规模最大的开源模型,Kimi K3采用混合专家架构,总参数量达2.8万亿。本次开源覆盖模型本体、训练方法与底层训练系统全链条,采用修改版MIT许可证,全球开发者可下载权重进行本地化部署与二次开发,而具体使用范围需遵循官方许可协议约定。依托Kimi Delta Attention混合线性注意力、Attention Residuals注意力残差、MoonEP等自研底层技术,K3整体规模化训练效率相较前代提升2.5倍。Hugging Face平台CEO Clem Delangue公开表示,Kimi K3上线仅30分钟便登上平台趋势榜榜首,创下平台成立以来发布增长最快纪录。媒体认为,Kimi K3落地将成为中国开源大模型重塑全球AI竞争格局的重要窗口。


DeepSeek-V4-Flash正式版上线

7月31日,国家超算互联网上线DeepSeek-V4-Flash正式版API调用服务和模型文件。DeepSeek-V4-Flash正式版的模型架构、大小和与预览版相同,采取MoE(混合专家)架构,拥有2840亿总参数、130亿激活参数,支持百万级上下文。在此基础上,正式版重新进行了后训练,重点优化智能体工具调用、多轮任务执行效率。模型面向开源社区开放轻量化权重,适配端侧与中小算力集群,吸引开发者构建行业垂直智能体,完善国产大模型Agent生态。


MiniMax H3发布实现端到端视频后期生成

7月31日,MiniMax发布其新一代多模态生成模型MiniMax H3,实现端到端视频后期生成。MiniMax H3支持文本、图像、音视频等多种输入形式,具备原生双声道音视频内容生成能力,最高支持15秒、2K分辨率的视频生成。MiniMax H3能够在多模态上下文中统一理解创作意图,在指令遵循、文字渲染、视频到视频动作迁移(V2V Motion Transfer)等方面提升显著。MiniMax H3采取‌Contextual Omni Representation、H3-VAE、H3-Omni Transformer、‌In-context Regeneration等技术,使高分辨率细节得以精准还原,这一突破让视频后期成为AI的“新护城河”,并实现“输入文本→输出成品”的范式变革。


蚂蚁开源扩散大语言模型LLaDA2.2

蚂蚁集团inclusionAI团队近日发布并开源扩散大语言模型新版本LLaDA2.2,将其定位为首个专门面向智能体(Agent)任务设计的大规模扩散 LLM,同时推出的LLaDA2.2‑flash被描述为“首个面向智能体的MoE扩散大模型”。据介绍,LLaDA2.2采取Levenshtein“编辑式解码”与“块并行解码”组合,在边生成边纠错的同时,在扩散生成框架下,模型能够以block为单位并行生成和更新tokens,相比串行生成更充分利用硬件并行度,为大规模智能体系统提供更高吞吐量和更低时延。


大厂争夺AI办公系统“工作入口”

7月30日,字节跳动启动AI业务组织架构调整,对豆包、飞书、火山引擎三大业务的产品研发和商业化体系进行重组。飞书产品团队与豆包产品团队将进行整合,成立新的豆包产品团队。原飞书GTM团队与火山引擎对应团队整合,成立“创造力服务平台”统筹To B商业化体系。据字节跳动表示,此次组织整合旨在提升AI to B战略的优先级。

同日,腾讯WorkBuddy发布V5.3.5版本,联合腾讯文档,正式推出“人机双写”协同编辑能力,首次实现人与AI在同一文档内共同创作、修改并实时协同,以推动Office变成“AI原生办公系统”,释放更大生产力。

7月27日,据媒体报道,阿里新款AI Agent产品“千问办公”开启小范围测试,已上线本地桌面客户端,还将陆续上线网页端和钉钉内置版。“千问办公”将阿里QoderWork、悟空、MuleRun等多款Agent产品深度整合。

有媒体认为,“工作入口”正在成为大厂必争之地。


上海广播电视台发布视听大脑X-Brain 1.0

日前,上海广播电视台(集团)在2026世界人工智能大会媒体创新论坛上正式发布X-Brain 1.0视听智脑。X-Brain 1.0是新一代广播电视视听数字技术底座,汇聚了智汇、智策、智笔、智剪、智推、智评六个功能模块,具备“集中调度”和“协同生产”两大核心能力,覆盖选题策划、内容制作、分发推送、效果反馈等流程。据介绍,X-Brain 1.0是上海广播电视台锚定“ALL in AI”主攻方向,加快建设数智主流媒体集团的关键落子,也是上海主流媒体服务城市数字化转型、探索AI时代主流价值传播新路径的成果之一。


World Labs发布机器人策略训练与评估引擎R2S2R

日前,李飞飞团队的World Labs发布了全新的机器人策略训练与评估引擎Real-to-sim-to-real(R2S2R)。该引擎将World Labs空间智能的版图从生成可交互的虚拟世界,进一步延伸到真实机器人的训练、评估与部署,并首次将仿真训练与真实运行打通。该系统通过Real-to-Sim模块,将真实机器人的传感器数据、交互过程精准重建为高保真虚拟环境;再由Sim-to-Real模块在仿真中进行规模化策略训练与评估,最终将成功策略部署回真实硬件。这一方法解决了机器人训练中经验获取难、成本高、失败场景难以复现的痛点,并让机器人策略的评估变得可量化、可追溯,能系统分析失败原因。


ChatGPT桌面应用上线语音功能

OpenAI近日宣布ChatGPT桌面应用上线语音功能,用户在使用桌面版ChatGPT时,可直接通过语音进行输入和交互。其底层基于新一代GPT-Live语音模型,实现双向实时对话,可随时打断并无缝延续上下文。语音功能深度集成于Work与Codex场景,支持自然语言指令启动多Agent协作、后台任务执行与状态查询。系统能够结合屏幕上下文、文档、日历等信息自动完成收尾任务。

来源:人民网


编辑:许多、韩佳琪(实习)

责编:岳禺宁

友情链接: