Kimi Code 发布:终端与 IDE 迎来完整编程智能体
Kimi Code 可读取完整仓库、规划多步任务、执行命令并自主迭代,支持 IDE、Goal、Swarm、Skills 与 MCP。
● 人工智能的此刻与下一刻
从 GPT-5.6 到 Codex Sites,从后台代理到规格驱动开发:Vibe Coding 不再只是“凭感觉写”,而是一套正在成熟的新生产方式。
进入本期专题
当代理能自主拆解、执行、验证与发布,编程的主界面就从编辑器迁移到了意图。
GPT-5.6 全家桶上线
Codex Sites 一句话生成站点
AI Act 透明度规则执行
● NEWS INDEX / 新闻档案
共 65 条一手动态:17 条中国新闻、48 条海外新闻,可按地域即时筛选。
UPDATED · 2026.08.12地域按发布主体划分,不代表产品服务范围。
Kimi Code 可读取完整仓库、规划多步任务、执行命令并自主迭代,支持 IDE、Goal、Swarm、Skills 与 MCP。
新插件让 Cursor 代理直接读写 Gmail、Drive 与日历,在编程界面内检索资料、整理文件并处理沟通事务。
付费用户可在 iPad 同时观察多个代理、查看完整差异与评审,并从移动端创建、审阅及合并拉取请求。
该计划将前沿模型连接国家实验室、大学和超级计算设施,重点支持能源、生物科学及先进制造等领域的科研工作。
Auto 模式会分析任务类型和复杂度,在智能、均衡与成本三种策略间路由,并向团队管理员开放统一管控。
开发者可把技术栈、设计规则、代码评审与部署流程封装成技能,按需自动触发并在项目或整个工作空间共享。
Presence 把策略、护栏、批准动作、模拟评测与人工升级整合起来,面向客服和高风险内部流程提供受控部署。
Gemini 3.6 Flash、3.5 Flash-Lite 与网络安全专用模型同步发布,分别侧重质量效率、低延迟和漏洞防御。
从机器交互告知到生成内容标记,透明度义务自 8 月 2 日起适用。内容生产的“来源可见”不再只是行业倡议。
微软将 AMD Helios 平台及新一代 EPYC 处理器引入 Azure,规划三类虚拟机,分别服务数据处理、芯片设计和大规模推理。
代理开工前先展示计划,执行中持续回报状态,还能从 Slack 选择多仓库环境并跨频道提取上下文。
spec.md 与 plan.md 把需求、架构、进度留在上下文之外,让自然语言开发不再等于随心所欲。
只需描述内容,代理即可生成带实时数据、三维场景和可操作原型的演示应用,并以链接共享或交给其他编码代理运行。
美国认证中小学教师可免费使用高级 Claude 功能、教学技能和课程标准连接器,相关数据按教育隐私条款处理。
Sol、Terra、Luna 分别对应旗舰推理、日常工作与高性价比场景。OpenAI 称 Sol 是其当前最佳编程模型——但真正值得注意的,是模型选择正被代理自动化。
全双工语音持续对话,同时把复杂问题交给后台模型搜索与推理。语音助手正在变成可协作的实时代理。
Muse Image 会主动查证事实、绘制图表并自我修正;Muse Video 则预告原生音视频生成与内容来源标记。
可自主规划并使用浏览器、终端等工具,编码代理从“补全下一行”走向“负责整个工作流”。
该应用整合科研数据库、代码环境和计算资源,可生成带完整操作记录的图表与论文,并由审查智能体检查结果。
开发者可用模型识别并操作浏览器、移动端和桌面界面;谷歌同时提供确认敏感操作与拦截提示注入的选项。
团队在对话里 @Claude,即可交付代码、分析与故障排查任务,协作界面本身成为新的开发入口。
Halos 把计算、操作系统、传感器、安全应用和认证检查连成统一架构,面向工厂与仓库中和人协作的自主机器人。
Qwen Code 允许智能体组建团队、共享任务、相互通信并汇总结果,同时加入可持久化的定时循环。
GLM-5.2 提供稳定百万词元上下文、多档推理强度和改进稀疏注意力,并以 MIT 许可证开放模型权重。
Fable 5 面向普通用户提供强化安全防护,Mythos 5 则向可信网络防御伙伴开放更少限制的同源模型能力。
NIST 研究指出固定护栏无法抵御不断适应的攻击提示,建议红队持续找漏洞、更新防护并强化恢复能力。
Gemma 4 12B 采用无独立编码器的统一架构,在较小内存中原生处理文本、图像和音频,主打笔记本本地智能。
平台会在应用发布前自动检查数据库配置、权限与鉴权缺口,并记住项目安全上下文,在后续会话中修复问题。
Cosmos 3 以混合 Transformer 统一视觉推理、世界模拟和动作生成,并开放文本、图像、视频、声音与动作的多模态能力。
主代理可按需派出只读子代理分别搜索代码库与网络,各自使用独立上下文,汇总发现后再由主代理安全改码。
原通义灵码更名为 Qoder CN,继续提供 IDE 与插件,并强化多文件修改、专家协作、任务规划和编程智能体。
并行代理、隔离执行环境和 Android Vibe Coding 形成一条从想法到测试发布的新生产线。
首款 Omni Flash 可接收文本、图像、音频和视频输入,通过对话生成和编辑视频,已向多个谷歌产品订阅用户推出。
这套基于 Gemini 的多智能体系统会生成、辩论并迭代科研假设,已通过实验工具向个人研究者开放生命科学探索。
文心 5.1 采用弹性预训练和全异步强化学习,提升智能体、推理与深度搜索能力,同时压缩参数规模和训练成本。
新方案打通 CodeBuddy 与 WorkBuddy,并加入具备独立沙箱、持久文件和分享能力的 CloudAgent 云端智能体。
华为云宣布码道代码智能体正式商用,提供体验版、基础版与专业版,覆盖探索式 Vibe Coding 和工程开发。
Hy3 Preview 融合快慢思考,支持 256K 上下文,重点提升复杂推理、编程、工具调用和长程智能体执行能力。
DeepSeek 开源 V4 Pro 与 Flash,统一思考和非思考模式,提供百万上下文,并针对智能体编程和工具链集成优化。
安全代理会建立威胁模型、梳理数据流并运行静态分析,再把可利用问题拆成并行任务交给主代理集中修复。
Kimi K2.6 提升长程编程、工具调用与多智能体协作,官方案例展示跨数千次工具调用的持续工程执行能力。
每个子代理拥有独立上下文、指令和工具,可自动或显式分派代码调查、批量重构等任务,并支持多人式并行执行。
新模型提升空间推理和多视角理解,帮助机器人识别真实环境、理解仪表与复杂场景,现已通过 Gemini API 向开发者开放。
SOLO 从 IDE 中独立出来,可通过对话编写、运行并迭代代码,云端还支持跨项目并行执行任务。
SAM 3.1 通过对象多路复用在单次前向计算中追踪最多十六个对象,并降低复杂视频实时处理所需的 GPU 资源。
TRIBE v2 可预测人脑面对复杂视听刺激时的神经活动,分辨率较同类模型提升七十倍,并开放模型、代码和论文。
新版重构推理、工具与上下文,支持任务自动拆解、探索子智能体、可复用 Skills、MCP 及设计稿转代码。
SandboxEscapeBench 用十八种容器逃逸场景安全测试 AI 智能体,发现前沿模型可利用常见配置错误,并已开源工具。
插件观察文件编辑与终端操作,动态注入平台知识,并提供三类专家代理、五个命令及过时代码实时校验。
Dynamo 1.0 负责跨集群协调 GPU 与内存资源,并与主流开源推理框架集成,面向生成式模型和智能体的生产部署。
新一代代理可从自然语言创建应用、仪表盘和幻灯片,先在画布设计并规划,再并行执行任务和团队协作。
MTIA 300 至 500 覆盖推荐训练和生成式人工智能推理,采用模块化芯粒与 PyTorch 原生软件栈,并按较短周期迭代。
双方将在 AWS 构建有状态智能体运行环境,并通过 Amazon Bedrock 提供模型能力;OpenAI 也将采用 Trainium 算力。
后台完成 Issue、提交 PR,再做漏洞、密钥与依赖检查——质量护栏成为代理交付的一部分。
Qwen3.5 首个开放权重模型采用原生视觉语言架构与稀疏 MoE,覆盖推理、编程、智能体和多模态理解。
豆包 2.0 推出 Pro、Lite、Mini 与 Code 四款模型,强化多模态、深度推理、工具调用和长链任务,并开放 API。
GLM-5 面向复杂系统工程与长程智能体任务,强化后端架构、复杂算法、顽固问题修复和端到端工程交付。
MiniMax M2.5 强化多语言编程、工具调用、搜索和办公任务,并以两档推理速度降低持续运行智能体的成本。
谷歌展示其在数学、物理和计算机科学中的专业级协作能力,研究智能体加入自然语言验证器,可修订答案或主动承认失败。
Frontier 面向企业统一构建、部署和管理智能体,兼容自研、OpenAI 及第三方智能体,并提供治理与业务系统接入能力。
v0 从快速原型工具升级为面向生产应用的平台,强调权限、审计与企业系统连接,并预告端到端代理工作流。
Codex 桌面端以项目线程和独立工作树协调多个代理,并加入技能库与定时自动化,支持长时任务统一审阅。
GLM-Image 将自回归语义模块与扩散解码器结合,重点改善复杂中文文字渲染、知识密集画面和高保真细节。
Veo 3.1 增强参考图一致性和创作控制,新增竖屏视频与高清放大,已进入 Gemini、YouTube Shorts 和开发平台。
Rubin 整合 CPU、GPU、交换芯片、网卡和数据处理器,面向大规模训练与智能体推理,合作伙伴计划在年内陆续部署。
检索官方与一手信源
编辑于 2026.08.12
Sol、Terra、Luna 分别对应旗舰推理、日常工作与高性价比场景。OpenAI 称 Sol 是其当前最佳编程模型——但真正值得注意的,是模型选择正被代理自动化。
从机器交互告知到生成内容标记,透明度义务自 8 月 2 日起适用。内容生产的“来源可见”不再只是行业倡议。
SOURCE · 欧盟委员会 ↗全双工语音持续对话,同时把复杂问题交给后台模型搜索与推理。语音助手正在变成可协作的实时代理。
SOURCE · OpenAI ↗Muse Image 会主动查证事实、绘制图表并自我修正;Muse Video 则预告原生音视频生成与内容来源标记。
SOURCE · Meta AI ↗● SPECIAL REPORT / 特别策划
不是更快地写代码,
而是重新定义谁在负责交付。
编辑部判断
不是投资建议
竞争单位从“生成了多少代码”变成“独立完成了多少经过验证的任务”。部署、测试和审查被压进同一个对话回路。
代理进入 Slack、云端和移动设备,能在后台持续工作。你分派的是目标,而不是下一行指令。
规格文档、自我审查、安全扫描、权限边界与人工批准,是 Vibe Coding 走进生产环境的入场券。
● SOURCE RADAR / 信源雷达
我们同时追踪中国与海外的官方发布、产品更新日志和开发者博客。少一些二手转述,多一点可以回到源头的判断。