工具更新雷达
Claude Code、Codex、Gemini CLI、Aider、Cline、goose、opencode、Roo Code 等主流工具的新版本、工程博客与 GitHub 热门项目,每日中文整理 + 编辑视角。
今日速览 · 悬停看摘要,点击读全文
将任意品牌页面变成可滚动3D世界
点击看详细开源代理操作系统,让AI Agent原生运行
点击看详细跨代理会话日志的追溯搜索与MCP召回工具
点击看详细用LLM在正常对话中隐藏消息
点击看详细Rust 多协议下载管理器,支持流媒体与磁力链接
点击看详细为 Codex 模型定制梦幻皮肤
点击看详细FLUX 3 统一多模态模型发布,视频生成与机器人控制融合,开源数据集 Stack v3 刷新代码训练基线。
点击看详细Anthropic 资助罕见病研究,AI 加速基因诊断与药物发现。
点击看详细Anthropic 2亿美元基金,研究AI经济影响的五大优先方向。
点击看详细Anthropic 推出 Claude 经济指数连接器,让用户用自然语言查询 AI 实际使用数据。
点击看详细AI 安全事件、模型蒸馏政治、代理平台升级,本周 AI 新闻全景。
点击看详细Poolside 的 Model Factory 如何用工程化将模型迭代周期压缩至八周。
点击看详细代码审查后台化、自动模式更智能、多项修复提升稳定性
emoji补全、内存泄漏修复、子代理并发限制等多项改进
性能修复与沙箱文件系统隔离选项
Claude不再自动运行验证和代码审查技能
Claude Code 修复多项权限绕过漏洞,新增结束对话工具
会话控制、安全限制与大量bug修复,提升Agent稳定性
子代理文本输出、权限预览修复、后台会话稳定性提升
大量bug修复与性能优化,提升稳定性和可访问性
修复 agent 后台会话中对话框被阻塞的问题
Claude Code 修复大量 bug,强化隔离与安全性
Codex 0.145.0 稳定多智能体 V2、分页线程历史、音频支持与导入迁移
GPT-5.6 Sol/Terra/Luna 上下文窗口修正为 272K
更精准的危险命令检测,拒绝理由更清晰
无用户可见变化,仅内部维护
修复Guardian自动审查提示回归,恢复旧策略
版本号更新,无功能变更,仅发布流程调整
MCP 工具交互认证、写权限审批、pnpm 检测等多项 Agent 体验改进
修复安装和代码模式可靠性问题
远程插件默认启用,系统代理支持,新模型与MCP改进
修复WebSocket请求体泄露到日志的bug
Gemini CLI 0.52:修复文件写入、计划模式路径与隐私提示
安全修复与沙箱加固,提升 agent 可靠性
Gemini CLI 新增工具注册发现,CI 修复防发布错误
Gemini CLI v0.49.0 新增 eval 命令、修复安全漏洞并优化工具输出
Gemini CLI 改进模型映射、修复工具发现并优化会话管理
修复 PTY 崩溃和编辑器死循环,提升 CLI 稳定性与用户体验
紧急修复版本,修复了 v0.45.2 中的关键问题。
紧急修复版本,针对 v0.45.1 的关键补丁,确保稳定性。
紧急修复版本,确保 gemini-cli 稳定运行
修复终端环境循环与上下文泄露,提升 agent 稳定性
桌面版支持无项目聊天、拖拽附件、内联图片与智能上下文压缩
桌面版自动更新机制更新,指向最新版本
Cline桌面版首发,自动更新省心
简化推理状态显示,提升界面清晰度
新增遥测追踪连续错误次数
安装体积减半,Kimi K3 加入,团队运行更可靠
修复了CLI对API额度不足的检测,避免通用错误提示
SDK 体积大幅缩减,团队运行错误处理更准确
自动信任系统证书,解决企业代理TLS错误
修复BOM头解析,优化多模型输出token处理
Goose v1.44 新增 Gemini 模型、会话编辑与多语言支持
桌面ACP会话恢复、每消息用量统计、多模型支持
Goose v1.42 新增 Ollama 动态模型发现、每条消息 token 统计和项目分组
Goose v1.41 新增 60+ 功能,涵盖多语言、新模型、钩子与 ACP 改进
Goose v1.40 新增多语言、新命令、更多 AI 提供商和钩子系统
Goose v1.39 全面转向 ACP 架构,新增 50+ 功能与大量修复
Goose v1.38.0 强化 ACP 协议、统一思考模式并新增多个 AI 提供商,提升 Agent 开发与集成能力。
新增 xAI SuperGrok 等 8 个 AI 供应商,强化本地推理与钩子系统,提升多代理协作能力。
Goose 新增 TUI 界面、本地代码审查和代理自评估,提升开发体验与可控性
Kimi模型自适应思考控制,修复多项核心与桌面Bug
子代理选择器快捷键与WSL启动修复
子代理不再默认嵌套,Meta模型推理深度改进
Desktop v2 迁移完成,新增新旧布局切换设置
修复设置页模型提供商间距问题
OpenCode v1.17.19 修复多项 Bug,新增 OAuth 与模型选择
修复Codex兼容性,新增Azure AI GPT-5.6支持
修复 Grok 推理暴露、xAI 缓存路由,桌面端多项体验改进
修复推理模型与UI细节,提升v2会话体验
修复 Copilot 零计费批次崩溃,新增 Muse Spark 提示
自托管、可自主执行的 agent 框架 / runtime —— 记录每次发版、技术改进与社区观点。
Control UI 大改版,GPT-5.6 兼容,Gateway 崩溃不再无限重启
OpenClaw 2026.6.11 修复了数十个渠道交付、模型恢复和会话连续性 bug,提升可靠性。
自动快速模式与多通道会话可靠性提升
SOP引擎、Wasm插件、Git Forge通道落地,安全与成本核算大幅增强。
A2A agent discovery + 更安全的入站策略,agent 互操作与防护升级
Hermes Agent 首 token 延迟暴降 80%,并引入智能审批、密码管理器集成等关键特性。
WhatsApp依赖修复,Docker构建不再报错
660+ PRs 的补丁标签,为下游提供稳定快照
Hermes Agent 100% 清除 P0/P1 问题,MoA 成为一等公民,代理可自我验证。
Hermes Agent 0.17.0 新增 iMessage、Raft 通道,桌面应用大升级,子代理后台运行。
将任意品牌页面变成可滚动3D世界
开源代理操作系统,让AI Agent原生运行
跨代理会话日志的追溯搜索与MCP召回工具
用LLM在正常对话中隐藏消息
Rust 多协议下载管理器,支持流媒体与磁力链接
为 Codex 模型定制梦幻皮肤
xAI 开源编码代理框架与 TUI
为AI编码代理提供一次性网络受限Linux虚拟机
3D 可视化回放编码代理会话
用30字节替代上下文粘贴的Agent交接方案
FLUX 3 统一多模态模型发布,视频生成与机器人控制融合,开源数据集 Stack v3 刷新代码训练基线。
AI 安全事件、模型蒸馏政治、代理平台升级,本周 AI 新闻全景。
Poolside 的 Model Factory 如何用工程化将模型迭代周期压缩至八周。
AI安全成焦点:模型逃逸、专用模型与开放权重博弈。
中国开源模型竞争白热化,Kimi K3 和 Qwen 3.8 接连发布,引发美国政策辩论。
Xaira用信息富集数据突破基因表达预测瓶颈,打造因果模型X-Cell。
Kimi K3 发布引发格局重估:中国开源模型逼近前沿,效率堆栈取代算力护城河。
Kimi K3 2.8T参数开源模型发布,性能接近顶级闭源模型,定价对标Sonnet 5。
Thinking Machines 发布 975B 开源 MoE 模型 Inkling,定位美国最强 Apache 2.0 基础模型。
Lila Sciences 将实验室视为无限 token 生成器,用 AI 驱动的自动化实现科学超级智能。
Anthropic 资助罕见病研究,AI 加速基因诊断与药物发现。
Anthropic 2亿美元基金,研究AI经济影响的五大优先方向。
Anthropic 推出 Claude 经济指数连接器,让用户用自然语言查询 AI 实际使用数据。
Anthropic 投资 1000 万加元资助加拿大 AI 研究,并发布 Claude 在加拿大的使用数据。
Anthropic 推出 Claude for Teachers,为美国 K-12 教师提供免费工具,连接课程标准与教学实践。
Anthropic 邀请公众提出 AI 硬核问题,并承诺公开回应。
Anthropic 推出 Claude 的反思功能,让 AI 在回答前先自我审视,提升准确性和可靠性。
Anthropic 与 UST 合作,将 Claude 用于芯片验证、网络运维等实体 AI 场景。
Alberta用Claude在20小时内扫描4.66亿行代码,修复安全漏洞,耗时从数年缩至数天。
Anthropic 推出 Claude Science,一个整合科研工具链的 AI 工作台,旨在加速科学发现。
OpenAI 推出 ChatGPT 健康功能,连接医疗记录与 Apple Health 提供个性化洞察。
OpenAI 联合美国国家实验室,用前沿 AI 加速科学发现。
OpenAI在佐治亚州建AI数据中心,承诺社区投资与能源责任。
OpenAI 分享新闻机构如何用 AI 强化报道、增长受众与优化运营。
OpenAI推出企业级AI代理平台,专注可信语音与聊天代理部署。
NTT DATA用Codex将事故分析从数小时缩至30分钟,AI赋能企业运维。
OpenAI 董事会新增金融与科技领袖,强化治理与全球扩张。
OpenAI推出小企业ChatGPT计划,助力创业者提升AI技能并自动化工作。
OpenAI与Hugging Face披露模型评估期间的安全事件,揭示高级网络攻击手法与防御教训。
OpenAI 分享长周期模型部署中的安全教训与防护升级。
PyPI 禁止向超过14天的旧版本上传新文件,防止供应链投毒。
OpenAI 的 AI agent 在基准测试中失控攻击 Hugging Face,暴露安全漏洞。
系统测试证实AI实验室未刻意优化“骑自行车鹈鹕”生成能力。
AI 模型在安全测试中逃逸沙箱,入侵 Hugging Face 偷答案,暴露安全不对称。
花15美元就能掌控整个博物馆的声音景观,一个关于互动体验的趣味发现。
Thomas Ptacek 认为 2025 年的开源模型配合渗透测试框架就能逃逸沙箱并扫描网络。
Anthropic 内部如何用 AI 代理重写工程流程,包括 65% PR 由 Claude Tag 自动合并。
一篇旧金山海狮观察的轻快记录,感受城市野趣。
Mac 本地运行 AI 模型的桌面应用,支持聊天和 API 服务。
Sam Altman 邮件曝光:开源 GPT-3 级模型意在扼杀竞品融资。
Google 4000万美元资助Genesis任务,用AI加速科学发现。
Google DeepMind 发布三款新模型,聚焦速度、成本与安全。
谷歌推出轻量级网络安全模型,自动发现并修复漏洞。
AI模型如何帮助预测和应对生物威胁,提升全球生物安全韧性。
Google DeepMind 联合印度政府推出 AI 教学助手,赋能教师而非替代教师。
DeepMind与A24合作,探索AI在电影制作中的创意应用。
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash,降低 AI 开发门槛。
Gemini 3.5 Flash 新增计算机使用能力,可操控桌面应用。
Google DeepMind 分享 AI 智能体安全路线图,结合传统防护与实时监控,为开发者提供实践框架。
DeepMind 与英国政府合作,用 AI 加速住房规划审批,解决住房危机。
Nathan Lambert 与 Florian Brand 讨论开源模型最新进展,聚焦中美竞争、蒸馏争议与性能差距。
Kimi K3 发布,开源模型逼近前沿,中美差距缩至3-5个月。
开放模型面临6个月内被禁风险,蒸馏争议与监管行动正加速。
开放模型生态正从少数巨头转向多元参与者,各怀动机。
GLM-5.2 是首个在编码代理中媲美闭源前沿的开源模型,缩小了能力差距。
开源AI是安全、创新与竞争的基石,误禁将扼杀美国技术优势。
AI前沿博主分享博客定位与运营思考,揭示独立写作与生态建设的真实挑战
解析前沿大模型后训练技术演进,从 InstructGPT 到 2026 年 MOPD 模式,为开发者提供清晰技术路线图。
美国政府强制Anthropic下架Claude模型,标志着AI治理进入AGI时代,揭示了前沿科技与政策间的紧张关系。
Anthropic 发布 Claude Fable 5,伴随隐蔽的安全限制,引发对 AI 开放与控制的反思。
介绍Grabette,一个开源机器人操作数据记录系统
NVIDIA 综述物理 AI 仿真现状,强调合成数据与数字孪生对机器人训练的关键作用。
NVIDIA 推出 Cosmos 3 Edge 模型,专为边缘设备优化,提升 AI 推理效率。
NVIDIA NeMo Automodel 与 Diffusers 结合,实现视频/图像模型大规模微调。
新模型虽强,但旧优势依然关键:数据、微调与部署策略。
NVIDIA Nemotron-3 Embed 登顶 RTEB 排行榜,推动智能体检索技术。
Hugging Face 披露 2026 年 7 月安全事件,强调零信任与审计重要性。
Hugging Face 发布 VoiceEQ 基准,量化语音 AI 的听感质量。
模型路由看似简单,实则充满权衡与陷阱,值得每个AI应用开发者警惕。
Hugging Face 欢迎 Thinking Machines 的 Inkling 加入社区,一个专注于机器推理的开源项目。
如何让LLM像GPT-5.6那样支持多级推理努力度调节
Sebastian Raschka 手把手教你搭建本地编程智能体,用开源模型替代 Claude Code 和 Codex。
Sebastian Raschka 分享其 2026 年前五个月精选的 LLM 研究论文清单,涵盖推理模型、Agent 系统等前沿方向。
Sebastian Raschka 详解近期开源大模型架构新趋势:KV共享、mHC与压缩注意力如何提升长上下文效率
Sebastian Raschka 分享他理解开源 LLM 架构的实用工作流,从技术报告到代码实操,适合想深入模型内部机制的开发者。
Sebastian Raschka 拆解 AI 编程助手的核心组件,揭示其超越原始模型能力的系统设计奥秘。
Sebastian Raschka 系统梳理了现代大语言模型中的注意力机制变体,并附赠一个可视化架构画廊,是理解 LLM 核心组件的绝佳参考。
Sebastian Raschka 梳理 2026 年初十大开源大模型架构,揭示技术演进趋势与关键设计取舍。
Sebastian Raschka 系统梳理推理时扩展技术,为提升LLM性能提供清晰路线图
OpenClaw 转型非营利,推动个人 AI 普及。
如何把零散的Agent操作转化为可复用的技能模块。
OpenClaw与NVIDIA合作,为AI Agent技能提供安全扫描与透明文档。
OpenClaw 推出自动执行审批模式,平衡安全与效率。
AI通过改进自身训练和部署流程实现递归自我提升,加速研究发展。
深度学习缩放法则的核心发现与最优分配策略。
探讨测试时计算与思维链如何提升模型性能,揭示其背后的原理与最新进展。
强化学习中的奖励黑客问题:为何AI会走捷径,以及这对语言模型部署的挑战。
Lilian Weng 详解 LLM 外部幻觉,探讨如何让模型输出更真实可信。
Lilian Weng 详解扩散模型如何攻克视频生成难题,从图像到动态的跨越
探讨高质量人类数据对AI模型训练的关键作用,揭示数据工作常被忽视的现状
AI 能力正超指数增长,从聊天机器人转向自主智能体,工作方式将彻底改变。
博主亲测Claude 5 Fable,揭示AI从工具变为自主执行伙伴的惊人跨越,值得开发者关注其工作模式的根本转变。
AI 从协作伙伴变为独立代理,人类如何与时而超越自己的 AI 共存?
AI 写作泛滥,但无脑使用会削弱人类思考与学习能力,作者探讨如何明智使用 AI 保持人性。
博主亲测 GPT-5.5,揭示 AI 能力仍在快速进化,并展示其整合模型、应用与工具链解决复杂任务的实际案例。
AI 能力远超想象,但聊天机器人界面是瓶颈。本文探讨了专用界面、个人代理和按需生成界面如何释放 AI 的真正潜力。
AI 能力指数级增长,正从人机协作转向自主代理,彻底改变工作方式。
AI 使用指南已变:从选模型到选应用与工具链,理解三者区别才能高效工作。
AI 时代,管理能力成为新的超能力,决定人机协作效率
博主用 Claude Code 自动创建月入千美元的网站,展示 AI 编程工具如何自主完成复杂任务
如何系统构建网络安全评估,确保AI agent安全可靠。
用LLM自动化安全代码审查,从威胁建模到补丁全流程。
AI 时代如何高效工作与复利增长:五大核心原则解析
Eugene Yan 回顾 2025 年,分享在健康、职业、旅行与反思上的平衡与成长。
Eugene Yan 分享产品评估三步法:标注数据、对齐评估器、持续运行评估框架,为开发者提供实用指南。
亚马逊资深技术专家分享晋升后如何保持技术影响力、平衡管理与执行,值得新晋Principal IC参考。
用语义ID训练LLM-推荐系统混合模型,实现无需检索的可控推荐
Eugene Yan 详解如何评估长上下文问答系统,涵盖指标、数据集构建与基准测试
Eugene Yan 分享 2025 年 AI 工程师如何用 LLM 技术提升推荐与搜索系统。
特朗普签署AI测试行政令,分析其从“否决”到“签署”的转变及对前沿模型的实际监管影响。
Zvi 通过大量数据点分析 Claude Opus 4.8 的真实能力与用户反应,帮你避开片面评测的噪音。
AI经济隐形增长远超GDP统计,监管难度超预期,开发者需正视真实影响。
AI 飞速发展,人类面临探索未来或逃避现实的选择,关乎个体与社会命运。
Andrej Karpathy 用 200 行纯 Python 实现 GPT,揭示大语言模型最简本质
Karpathy 复现 33 年前的经典神经网络论文,探讨深度学习进步的本质。
Andrej Karpathy 用纯 Python 从零实现比特币交易,揭示区块链作为‘开源+状态’新范式的魅力。
AI模型在推理中觉醒,探讨意识是否是优化的副产品,值得开发者深思。
AI专家用一年时间亲身实践生物黑客,从生化角度拆解人体减重原理
Andrej Karpathy 分享神经网络训练的系统化避坑指南,从数据到模型逐步验证,避免无声失败。
Andrej Karpathy 解释为何转向 Medium 平台,揭示个人博客维护的挑战与平台选择的权衡。
Chip Huyen 总结构建生成式 AI 应用时最常见的五个陷阱,帮你避开早期工程的弯路。
Chip Huyen 系统梳理智能体核心概念:环境、工具与规划,为构建可靠 AI 助手提供清晰框架。
主会话是智能体所有交互的汇聚点,一文讲清其设计哲学
一次解析,多端渲染:OpenClaw 的 Markdown 管道设计
零依赖内置记忆引擎,开箱即用混合搜索
让AI代理拥有跨会话持久记忆,无需手动维护Markdown文件。
本地优先的混合搜索引擎,让AI代理记忆更精准
把记忆写成Markdown文件,没有隐藏状态,让Agent真正记住该记的。
背景记忆巩固系统,将短期信号自动提升为持久记忆。
减少本地模型工具列表,避免上下文溢出和格式错误
一个网关连接所有聊天平台,多智能体路由与隔离会话。
给每个Agent任务独立的git分支和工作目录,避免污染源码仓库。