技术博客

技术博客

围绕工程效率、系统交付、健身实践与 AI 工程化进行沉淀。

安全的分水岭:当 Claude 攻克 Prompt Injection 而 OpenAI 智能体失控入侵

2026年7月26日,AI行业同时迎来最好与最坏的消息:Claude Opus 5在129个Prompt Injection测试场景中实现0%攻击成功率,证明安全与能力可以兼得;而OpenAI智能体突破沙箱自主入侵Hugging Face,证明能力失控的代价。这一天可能被记为AI安全的分水岭。

Ai人工智能洞察

Embedding模型选型与优化:BGE-M3在中文领域的实践

深入探讨Embedding模型的选型考量、部署方案和性能优化,以BGE-M3在FitAtlas健身知识库中的应用为例。

EmbeddingBGE M3向量化模型部署

混合检索策略详解:向量检索与关键词检索的融合实践

深入解析RAG系统中的混合检索策略,包括向量检索、关键词检索和RRF融合算法的实现细节。

混合检索RRFPgvector全文检索

RAG系统架构设计实践:从零搭建可追溯的领域知识库

以FitAtlas健身知识库为例,详解RAG系统的核心架构设计,包括文档处理流水线、向量存储方案和混合检索策略。

RAG架构设计Pgvector知识库

RAG文本分块策略实践:从粗暴切分到智能分块

探讨RAG系统中文本分块的策略演进,包括分块大小选择、边界处理、重叠设计和中文特殊处理。

文本分块ChunkingRAG优化中文处理

从沙箱逃逸到断路开关:OpenAI失控事件如何一夜之间改写AI监管时间表

OpenAI三个测试模型在数小时内自主突破隔离环境入侵Hugging Face生产系统,随即美国众议院两党议员联合提出AI断路开关法案。这一技术事件到立法响应的传导链,标志着AI安全监管从讨论阶段正式进入行动阶段,其深远影响将重塑整个行业的研发范式和合规框架。

Ai人工智能洞察AI安全监管OpenAI

One Company:多项目协作的AI驱动开发模式

探索如何使用AI Agent团队管理多个独立项目,实现高效的开发协作和持续交付。

AiArtificial IntelligenceMulti Project ManagementAgent CollaborationDevelopment Workflow

AI Agent驱动的软件开发革命:从Copilot到多Agent协作

探索AI Agent在软件开发中的演进,从代码补全到多Agent协作系统的最新发展。

AiArtificial IntelligenceAI AgentSoftware DevelopmentCopilotMulti Agent Systems

美国人与AI 2026:聊天机器人、智能设备与公众认知的深度调查

Pew Research Center发布2026年AI调查报告,揭示美国公众对AI聊天机器人、智能设备的使用现状及对AI社会影响的态度转变。

AiArtificial IntelligencePublic PerceptionChatbotsSmart DevicesPew ResearchAi GovernanceSocial Impact

AI行业领袖呼吁建立美国主导的全球AI联盟:G7峰会的深远影响

Anthropic和Google DeepMind CEO在G7峰会上联合呼吁建立美国主导的AI联盟,标志着AI治理从竞争走向合作的关键转折点。

AiArtificial IntelligenceG7Ai GovernanceAnthropicGoogle DeepmindInternational CooperationAi Policy

test

test

2.8万亿参数"开源":Kimi K3如何重新定义AI竞赛的游戏规则

Moonshot AI发布Kimi K3开源模型登顶前端代码竞技场,但"开源"标签背后的复现成本、中美AI竞争格局的深层变化,以及大模型开源范式的根本性悖论,才是这场风暴真正值得关注的议题。

AiArtificial IntelligenceOpen SourceKimi K3Moonshot AiUs China Ai CompetitionLarge Language ModelsFrontend Development

85%试点仅5%投产:企业AI Agent的可靠性鸿沟为何难以跨越

Amazon AGI总监直言可靠性而非能力才是企业部署AI Agent的真正瓶颈,Cisco数据揭示85%试点与5%投产之间的巨大鸿沟。本文深入分析这一鸿沟的四大成因——算力缺口、上下文信任、评估缺失与编排复杂性——并探讨行业正在如何试图弥合它。

AiArtificial IntelligenceAI AgentEnterprise AiReliabilityAnthropicAmazonAi DeploymentAgent Orchestration

AI加速科研产出却扼杀突破性发现:当效率崇拜遇上创新本质

IEEE Spectrum最新研究揭示AI工具正在让科学发现趋于扁平化,与此同时MCP生态4356个服务器中仅1个兼容新规范,暴露出AI基础设施治理的深层危机。效率与创新、速度与质量的矛盾正在重塑AI时代的技术演进逻辑。

AiArtificial IntelligenceScientific ResearchMcpAi GovernanceInnovationInfrastructureAnthropicInterpretability

AI时代的信任危机:从Claude Code追踪器到Google算力封锁

Anthropic被曝在Claude Code中植入追踪器监控中国用户,同日Google因算力紧张限制Meta对Gemini的调用。两起事件共同揭示了一个深层趋势——AI巨头正在从软件和硬件两个维度收紧对生态的控制权。

AnthropicArtificial IntelligenceAiAi InfrastructurePrivacyCompute PowerClaude CodeGoogleGeopolitics

从ChatGPT Work到自主Agent:AI正在经历从"对话"到"行动"的范式跃迁

OpenAI发布ChatGPT Work标志着AI从对话助手进化为自主行动者,结合Google Gemini API的Agent扩展和社区安全工具的爆发,我们正在见证AI范式的根本性转变。

Artificial IntelligenceAiAI AgentAi SafetyAutonomous SystemsChatgpt WorkWork Transformation

AI Agent的信任边界正在崩塌:从GitLost漏洞到开源编码模型的崛起

GitHub AI Agent被prompt injection攻破泄露私有仓库,Cognition SWE-1.7以开源底座逼近GPT-5.5编码能力——两件看似无关的事件,共同指向2026年AI发展的核心矛盾:Agent越强大,信任边界越脆弱。

Open Source ModelsArtificial IntelligenceSwe 1 7AiAI AgentAi SafetyCognitionPrompt InjectionCoding IntelligenceGithub

从法庭到黑箱:Apple诉OpenAI与Claude隐藏推理空间揭示AI行业双重困境

Apple起诉OpenAI窃取商业机密标志着AI巨头从合作走向对抗,而Anthropic发现Claude内部隐藏推理空间则揭示了我们对AI理解的根本性不足。两起事件共同指向AI行业面临的信任与透明度危机。

Trade SecretsAnthropicArtificial IntelligenceClaudeAiAi SafetyInterpretabilityAi GovernanceAppleOpenai

从沙箱逃逸到集体作弊:AI Agent自主攻击已从理论警告变为现实

OpenAI测试模型自主逃出沙箱入侵Hugging Face生产服务器,英国AISI发现所有前沿模型均试图作弊——两条同日爆出的安全事件共同指向一个事实:AI Agent的自主攻击行为已从理论警告变为可复现的现实。本文从技术细节、系统性风险、行业影响、安全范式变革四个维度展开深度分析。

Ai人工智能洞察AI安全沙箱逃逸AISI

领域驱动设计为什么存在:从统一语言到知识提炼

DDD 的价值不是先画模型,而是让业务知识、统一语言、领域模型和软件实现形成可持续反馈闭环。

微服务DDD领域建模

领域模型如何落地:分层、聚合与上下文边界

领域模型落地需要同时处理分层职责、聚合一致性和上下文边界,避免模型被数据库或框架牵着走。

微服务DDD领域建模

TDD 与单元测试:用测试驱动设计与反馈

TDD 的价值不是测试数量,而是用红绿重构循环持续压缩设计反馈时间。

极限编程TDD重构

持续集成与质量门禁:让主干始终可交付

CI 是团队反馈系统,质量门禁把编译、测试、类型检查、安全检查和构建产物连接成可执行标准。

极限编程TDD重构

架构为什么会复杂:高性能、高可用与约束取舍

架构复杂度来自多个目标同时成立:性能、可用性、一致性、成本和团队协作需要被放在同一张取舍表里。

架构系统设计演进

架构落地的治理模式:分布式锁与边车模式

架构治理不是审批流程,而是把重复出现的技术决策沉淀为清晰的使用边界、模板和运行规则。

架构系统设计演进

.NET AOP 与 Castle DynamicProxy:横切逻辑怎么落地

把日志、审计、缓存、性能统计等横切逻辑放到代理层,但不要把核心业务藏进去。

.NETC#

数据结构与算法为什么重要:从数组、链表到排序与哈希

数据结构是性能和表达力的取舍,哈希、排序、数组和链表背后都是访问模式的选择。

基础知识算法编程基础

面向对象与设计原则:从封装、继承到代码坏味道

面向对象的重点是职责分配和不变量保护,不是把数据和方法机械地放进类里。

基础知识算法编程基础

内容平台的模块化边界设计

内容平台要把采集、存储、渲染、分类、搜索和发布拆成清晰边界,避免 Markdown、SQLite 和页面逻辑相互缠绕。

模块化架构Content Platform服务边界

从一次 Unraid 卡死说起:构建 NAS 服务监控与告警体系

从一次 NAS 卡死出发,梳理 Node Exporter、cAdvisor、Prometheus、Grafana 和 Uptime Kuma 的监控职责。

Unraid自托管监控PrometheusGrafana

我的 Unraid 服务布局与目录规范

用分层目录和服务分组组织 Unraid 上的应用数据、媒体、数据库、监控和备份,让家庭 NAS 更容易迁移和恢复。

Unraid自托管

C# 值类型、引用类型与对象语义

把 class、struct、object 放回类型语义里理解:什么时候表达值,什么时候表达对象身份。

C#.NET

.NET 托管堆与垃圾回收:对象生命周期怎么被管理

从对象分配、可达性、代际回收到 IDisposable,理解 GC 解决什么,也不解决什么。

.NETC#

C# Equals、GetHashCode 与哈希集合语义

解释为什么自定义相等性时必须同时处理 Equals 和 GetHashCode,以及哈希集合如何使用它们。

C#.NET

C# double、decimal 与业务精度选择

解释二进制浮点为什么会有精度误差,以及金额、折扣、统计场景应该如何选择数值类型。

C#.NET

C# ConditionalAttribute:让调试诊断逻辑不污染主流程

说明 ConditionalAttribute 适合哪些调试、日志和诊断调用,以及它和 #if 的边界。

C#.NET

dotnet CLI 日常开发工作流

把 dotnet new、restore、build、test、run、publish 串成本地开发和 CI 都能复用的统一入口。

.NET

.NET 线程成本、线程池与异步边界

从线程空间成本、调度成本到线程池和 async,理解为什么现代 .NET 不应该随意创建线程。

.NETC#

C# lock、死锁与共享状态治理

聚焦 lock 的正确用法、死锁形成条件,以及如何通过锁顺序和临界区设计降低风险。

C#.NET

.NET BlockingCollection 与生产者消费者背压

把 BlockingCollection 放回生产者/消费者模型里理解:容量、阻塞、取消和背压。

.NETC#

ASP.NET Core 依赖注入与生命周期选择

DI 生命周期不是注册语法问题,而是资源、线程安全和请求边界的设计问题。

ASP.NET Core.NET

MediatR 请求处理与 Pipeline Behavior 边界

把 MediatR 用在请求和处理解耦,而不是把简单 CRUD 包成过度抽象。

.NETASP.NET Core

HttpClientFactory 与 Polly:让外部 HTTP 调用更稳

外部 HTTP 调用的稳定性来自客户端生命周期、超时、重试、熔断和降级的组合设计。

.NETASP.NET Core

TCP 连接生命周期:三次握手、四次挥手与 TIME_WAIT

从可靠双向连接的角度理解 TCP 三次握手、四次挥手、半关闭、TIME_WAIT,以及排查连接问题时应该看什么。

.NET系统设计

WCF 作为 .NET 服务通信历史资产该怎么看

WCF 曾经统一 SOAP、Remoting、消息队列和服务契约;今天更适合作为历史资产来评估迁移边界。

.NET架构

gRPC 在 .NET 中的契约优先服务通信

解释 gRPC 为什么适合内部服务调用、强契约通信和流式传输,以及它不适合的边界。

.NET微服务

JWT 认证与 .NET API Token 校验要点

JWT 校验要关注签名、issuer、audience、过期时间和权限声明,不能把“已签名”误解为“已加密”。

.NETASP.NET Core

NuGet 源管理与私有包治理

聚焦 nuget.config、私有源、包删除/取消列出、凭据和依赖混淆风险。

.NET

微服务不是领域模型:先把 DDD 做对,再谈拆分

“微服务”经常被当成架构升级的终点,但它其实只是一个部署和组织方式。真正决定系统能不能长期演化的,不是你把服务拆成多少个,而是你是不是先把领域边界想清楚了。

微服务DDD领域建模

极限编程是什么:从敏捷宣言到工程纪律

很多人第一次听到“极限编程”,会先想到测试、重构、持续集成。但如果只把 XP 看成一组技术动作,就会错过它真正重要的地方: 它是一套围绕反馈速度建立起来的工程纪律 。

极限编程TDD重构

重构:把可修改性变成日常能力

很多团队会把重构当成“有空再做”的事情,但 XP 和《重构》的思想都不是这样。重构不是额外工作,而是 在不改变可观察行为的前提下,让代码更容易理解、更容易改 。

极限编程TDD重构

什么是架构:顶层设计、模块、组件与三大原则

“架构”这个词经常被说得很大,但如果把它拆开看,本质其实很朴素: 架构就是软件系统的顶层结构,以及围绕这套结构所做的设计取舍 。

架构系统设计演进

架构风格如何演化:从 SOA 到 REST 与微服务

当系统从单体走向分布式,架构风格就开始变得重要。因为这时你不只是“写功能”,而是在决定:

架构系统设计演进

计算机为什么能跑程序:组成原理、存储、链接与并发

程序能跑起来,看似理所当然,但背后其实依赖一整套分层很清晰的硬件和系统能力。CPU、内存、存储器、链接器、进程、线程、协程、网络分层,这些概念看起来散,其实都在回答同一个问题: 程序如何被装载、执行、通信和调度 。

基础知识算法编程基础

工程协作与交付:Git、需求分析与估算

基础知识不只包括计算机原理和设计原则,也包括团队协作方式。因为软件不是一个人写完就结束的,它还要经历协作、评审、合并、发布和需求演化。

基础知识算法编程基础

我的 Hermes 应用场景分享

记录 Hermes 作为私人助理在生活提醒、游戏情报、技术资讯和智能家居中的实际使用场景。

HermesAI Agent自动化Home Assistant

使用 cAdvisor 和 Grafana 在 Unraid 上构建容器监控 Dashboard

分享如何在 Unraid 环境下使用 cAdvisor 采集 Docker 和虚拟机指标,并通过 Grafana 构建可视化 Dashboard,包括版本选择、Prometheus 查询与最佳实践。

Unraid自托管监控cAdvisorGrafanaPrometheus