BotOf TechAI / IoT / Full-Stack / 植物养护知识分享

把复杂的事,

从工程拆解到养护记录,只留下能被理解、复现和真正用起来的经验。

AI DEV / 12WAI 研发深潜从 Transformer 推导、微调工程到论文复现进入学习站
AI 行业热点观察:模型降价、安全门控、算力金融化与开放科学同时加速

AI 行业热点观察:模型降价、安全门控、算力金融化与开放科学同时加速

截至 8 月 24 日,AI 行业的关键变化已不止是新模型发布:价格与路由重写产品经济学,芯片公司进入项目融资,版权成本开始资产负债表化,安全门控进入运行时,开放科学模型则争夺可信数据与复现能力。

AI 新闻大模型AI Infra
GitHub 热门 AI 项目的反共识信号:小而锋利的工具正在超过万能 Agent

GitHub 热门 AI 项目的反共识信号:小而锋利的工具正在超过万能 Agent

diagram-design、agent-skills、Semantica 与 Needle 2 看似互不相关,却共同指向一个变化:AI 工程的价值正在从万能聊天壳转向可移植技能、可编辑产物、可追溯上下文和可验证的窄模型。

开源项目Agent Skills知识图谱
开源 Agent 已经分成四层:DeerFlow、OpenHands、Orca 与 Paperclip 应该怎样选

开源 Agent 已经分成四层:DeerFlow、OpenHands、Orca 与 Paperclip 应该怎样选

四个热门开源项目解决的并不是同一道题:DeerFlow 是长任务 Harness,OpenHands SDK 是可嵌入引擎,Orca 是并行开发环境,Paperclip 是组织与预算控制面。先认清层级,才能避免把演示系统误当生产平台。

AI Agent开源DeerFlow
从思考旋钮到能力阈值:大模型下一阶段的五条技术主线

从思考旋钮到能力阈值:大模型下一阶段的五条技术主线

模型发展正在从单一规模扩张转向五条相互咬合的主线:可调测试时计算、分层路由、稀疏与端侧协同、领域开放模型,以及进入运行时的能力门控。理解这些变化,比追逐下一次参数纪录更重要。

大模型推理计算端侧模型
Gemini 3.7 Flash、MAI-Thinking-1 与 Claude Opus 5:新模型不再按参数排队

Gemini 3.7 Flash、MAI-Thinking-1 与 Claude Opus 5:新模型不再按参数排队

近期三类模型分别把力量押在高频生产任务、中等体量推理与高风险长程工作上。真正值得企业比较的已经不是一张总榜,而是每个任务在质量、延迟、成本与失败代价共同约束下的有效完成率。

大模型GeminiMAI
推理集群正在从同构 GPU 池变成流水线:异构解耦的收益与代价

推理集群正在从同构 GPU 池变成流水线:异构解耦的收益与代价

AMD Helios 与 Cerebras WSE 组成 Prefill/Decode 异构流水线,说明推理基础设施开始按计算阶段选择硬件。解耦能独立扩容吞吐与延迟,却把 KV 传输、拓扑、版本兼容和故障恢复推到关键路径。

AI InfraLLM 推理Disaggregated Inference
AI Infra 的下一堵墙在配电:800VDC 为什么会反向改写集群调度

AI Infra 的下一堵墙在配电:800VDC 为什么会反向改写集群调度

当单排机架功率走向兆瓦级,瓶颈不再只是拿到多少 GPU,而是电怎样穿过变压、整流、母线和机架抵达芯片。800VDC、动态功率分配与 tokens-per-joule 指标正在把设施电力变成 AI 平台控制面的一部分。

AI Infra800VDC数据中心
Gemini Robotics 2 拆成三套模型后,具身智能开始有了真正的系统分层

Gemini Robotics 2 拆成三套模型后,具身智能开始有了真正的系统分层

Gemini Robotics 2、ER 2 与 On-Device 2 分别承担动作、具身推理和端侧适配。三模型结构比单一 VLA 更接近真实机器人系统,但进度判断、跨本体迁移、多机器人协同和硬安全仍需要独立工程边界。

具身智能Gemini RoboticsVLA
DeepSeek Harness 代码级分析:『一切皆插件』怎样落成可恢复 Agent 运行时

DeepSeek Harness 代码级分析:『一切皆插件』怎样落成可恢复 Agent 运行时

固定到 dsh 0.1.0-rc.5 与主分支提交,沿 agent loop、session log、tool pipeline、sandbox 和自修改工具链拆解 DeepSeek Harness 的真实边界。

DeepSeekAgent HarnessCordis
GPT-5.6 真正改变 Agent 工程的,不只是模型更强

GPT-5.6 真正改变 Agent 工程的,不只是模型更强

GPT-5.6 把模型分层、推理强度、程序化工具调用、多 Agent 和显式缓存放进同一套运行时。新的工程问题不是如何调用最强模型,而是怎样把判断、执行、并行与验证放在正确的边界里。

GPT-5.6AI AgentResponses API
时空可组合性 ④:系统边界、安全、相关工作与自演化 Agent(中文译文)

时空可组合性 ④:系统边界、安全、相关工作与自演化 Agent(中文译文)

系列终篇:讨论不可逆外部输出、服务 broker、权限与沙箱、跨语言实现、依赖版本,并定位 Cordis 与 HMR、FRP、DI、AOP 的关系。

编程语言动态组合Cordis
时空可组合性 ③:Cordis 如何实现可恢复组件与 HMR(中文译文)

时空可组合性 ③:Cordis 如何实现可恢复组件与 HMR(中文译文)

系列第三篇:把形式对象映射到 Cordis 的 ctx、fiber、effect tracking、coeffect resolution、配置协调与事务式 HMR,并复盘 Koishi 案例。

编程语言动态组合Cordis
时空可组合性 ②:Fiber 生命周期与动态组合演算(中文译文)

时空可组合性 ②:Fiber 生命周期与动态组合演算(中文译文)

系列第二篇:从 component、fiber、registry 到异步生命周期,解释恢复精确性、依赖顺序、进展与汇合定理。

编程语言动态组合Cordis
时空可组合性 ①:从动态组合难题到统一上下文范式(中文译文)

时空可组合性 ①:从动态组合难题到统一上下文范式(中文译文)

系列第一篇:解释时间与空间可组合性,回顾 effect/coeffect,并形式化可逆副作用、响应式依赖、隔离、拦截与统一上下文。

编程语言动态组合Cordis
企业灰度发布 14:从零设计一套 Kubernetes + Istio 发布平台

企业灰度发布 14:从零设计一套 Kubernetes + Istio 发布平台

最终平台不应重写 Rollout Controller,而应围绕应用目录、策略、GitOps、流量、指标、审批、审计与多集群建立控制面。本文给出参考架构、领域模型、API、故障路径和实施路线。

企业灰度发布灰度发布平台Argo Rollouts
企业灰度发布 13:全链路灰度与流量泳道,怎样让版本身份穿过调用链

企业灰度发布 13:全链路灰度与流量泳道,怎样让版本身份穿过调用链

入口命中 A-v2 只是开始。全链路灰度需要可信流量身份、上下文传播、逐跳路由、缺失版本回落、数据隔离和完整观测。本文设计可运营的泳道模型。

企业灰度发布全链路灰度流量泳道
企业灰度发布 12:Prometheus 自动判定与回滚,怎样避免指标陷阱

企业灰度发布 12:Prometheus 自动判定与回滚,怎样避免指标陷阱

自动回滚不是写一个 success rate 阈值。本文从指标分层、样本量、延迟窗口、缺失数据、基线比较和 PromQL 聚合设计可靠的发布分析。

企业灰度发布PrometheusSLO
多机器人不该每次从零开始:具身集体智能的共享世界记忆与任务账本

多机器人不该每次从零开始:具身集体智能的共享世界记忆与任务账本

具身集体智能不是让云端大模型统一控制所有机器人,而是让机器人共享可验证的世界状态、任务进度和技能证据,同时保留本地感知、控制与安全责任。

具身智能多机器人世界记忆
Managed Agents 进入长任务阶段:Background、Remote MCP 和凭证续期背后的可靠性协议

Managed Agents 进入长任务阶段:Background、Remote MCP 和凭证续期背后的可靠性协议

Google 为 Managed Agents 增加后台执行、远程 MCP、函数调用和凭证续期,说明 Agent API 正从一次请求升级为持久运行时。真正难点是状态机、幂等、恢复和权限边界。

AI AgentManaged AgentsMCP
企业灰度发布 11:Argo Rollouts、Flagger、Kruise Rollouts 应该怎样选

企业灰度发布 11:Argo Rollouts、Flagger、Kruise Rollouts 应该怎样选

选发布控制器不能只比功能勾选。本文从 workload 模型、协调循环、指标分析、Istio 资源所有权、GitOps 生态和平台二开边界分析三种路线。

企业灰度发布Argo RolloutsFlagger
GR00T 1.7 不只是一个 VLA:人形机器人策略开始拥有端到端工程栈

GR00T 1.7 不只是一个 VLA:人形机器人策略开始拥有端到端工程栈

GR00T 1.7 把人类视频预训练、跨本体动作表示、仿真采集、后训练、评测、ONNX/TensorRT 导出与真机部署接成一条链。价值在可重复工作流,不在开箱即用的通用智能。

具身智能NVIDIA GR00TVLA
DiffusionGemma 把文本生成改成并行去噪:1000 token/s 之外更重要的生产边界

DiffusionGemma 把文本生成改成并行去噪:1000 token/s 之外更重要的生产边界

扩散文本模型一次并行生成一个 block,再迭代修正,改变了自回归解码受内存带宽限制的路径。高吞吐是真实机会,但质量、完整延迟、调度和评测方式都要重做。

DiffusionGemma扩散语言模型LLM 推理
企业灰度发布 10:渐进式交付的本质是一台可恢复的发布状态机

企业灰度发布 10:渐进式交付的本质是一台可恢复的发布状态机

Istio 负责执行流量,发布控制器负责阶段、暂停、分析与恢复。本文从状态、证据和失败路径设计一台可审计的渐进式交付状态机。

企业灰度发布Progressive DeliveryCanary
Harness Engineering 16:当一个 Loop 不够用,怎样进入 Graph Engineering

Harness Engineering 16:当一个 Loop 不够用,怎样进入 Graph Engineering

Graph 不是 Loop 的替代品,而是把多个 Loop、工具、验证器和人工节点之间的依赖、路由与回滚显式化。真正承重的是共享状态、检查点、可重放和恢复。

Harness EngineeringGraph EngineeringMulti-Agent