2026-09-10
《星空》怎么获取-获取方式和条件
Transformer 中的前馈网络:那个看似平平无奇的两层 MLP 其实是记忆所在
Transformer中的前馈网络并非简单两层MLP,它是参数占比三分之二的记忆核心。本文从键值记忆视角解读FFN如何存储事实与模式,并介绍SwiGLU变体与MoE稀疏化应用,帮助理解Transformer架构的关键组件。
2026-07-11 0
09aa-偏置含义是什么?
09aa偏置含义解析文章详细解释神经网络中偏置bias的概念涵盖数学定义y=wx+b中的可学习参数b以及几何意义通过PyTorch代码示例对比带偏置与无偏置的区别深入理解深度学习模型中偏置的核心作用
2026-07-11 0
阿里云正式发布 RCA Benchmark: 业界首个面向 Agentic Ops 的根因分析开源基准体系
阿里云正式发布RCA Benchmark,业界首个面向Agentic Ops的根因分析开源基准体系。该体系联合可观测性与智能运维领域机构,为AI Agent分布式系统故障诊断建立标准化评估,提供运行环境、结构化样本集及评估协议,助力行业规模化落地。
2026-07-11 0
AI 助你运维 Elasticsearch:阿里云 ES Agent Skill 正式发布
阿里云ES Agent Skill正式发布,这款AI智能运维技能包帮助用户通过自然语言驱动Elasticsearch运维。ES Agent Skill覆盖实例管理、故障诊断和网络安全配置,让AI自动完成从创建到故障排查的全链路操作,简化运维流程,提升效率。
2026-07-11 0
《从零实现 Agent 系统》连载 07 记忆系统:短期上下文 vs 长期外部记忆
从零实现Agent系统连载07详解记忆系统设计,聚焦短期上下文与长期外部记忆的分工。涵盖Memory Service读写接口、上下文预算三档机制及泳道路由。同时探讨隐私约束与数据污染防范,帮助构建可扩展的Agent记忆架构。
2026-07-11 0
DataWorks Data Agent:助力淘宝闪购一句话搞定数据开发:让周期从天级到分钟级
DataWorks Data Agent是懂业务的智能体,助力淘宝闪购实现一句话搞定数据开发。它将传统周期从天级缩短到分钟级,覆盖数据集成开发运维全链路,深度适配业务逻辑与开发规范,让数据开发高效交付。
2026-07-11 0
Agent Loop 越做越像 RPA:浏览器自动化中的五个反直觉
浏览器自动化项目Agent Loop的五个反直觉设计。使用DOM原语替代多模态视觉处理90%任务,采用分层fallback机制提升稳定性。录制能力覆盖整个自动化生命周期,Skill文件作为行为契约约束LLM决策。不可逆操作通过CLI层状态机保护,让自动化工程更可靠。
2026-07-11 0
BoxAgnts解说(1)——开箱即用(Out-Of-The-Box)
BoxAgnts是一款强调开箱即用的本地AI工具,下载单一可执行文件后零配置即可启动。它提供Web可视化Dashboard与预置的多种工具技能,覆盖文件操作、代码审查等核心能力,结合本地安全与云端便捷体验,让用户快速上手。
2026-07-11 0
Nuxt3 AI Agent 控制台实战 15:公网试用前的访问控制、限频和模型开关
基于Nuxt3构建的AI Agent控制台在公网试用前补充了访问控制、限频和模型开关等工程保护。通过Access Code区分用户和管理员权限,限制创建频率与并发运行数,并设置模型能力开关作为Kill Switch。这些措施让项目从本地Demo安全进入公网内测,避免资源消耗与访问风险。
2026-07-11 0
AI Agent 工作流编排:概念到实战的完整指南
本文从概念到实战全面解析AI Agent工作流编排的关键技术与最佳实践。详解顺序执行、并行处理、条件路由等核心编排模式,提供智能客服系统构建的完整案例与性能优化策略。帮助开发者掌握多Agent协同工作的高效编排方法。
2026-07-11 0
BitCPM-CANN – 面壁智能发布低比特端侧大语言模型
BitCPM-CANN是面壁智能联合清华大学与OpenBMB发布的低比特大语言模型。它采用1.58-bit三值量化技术大幅降低显存占用,支持国产昇腾算力与GGUF本地部署。该模型面向AI手机和边缘设备,提供离线AI推理与本地知识库功能,适合低功耗端侧场景。
2026-07-11 0
骚操作2:把DeepSeek接入Claude桌面版!
本文介绍如何将DeepSeek接入Claude桌面版,实现直接在Claude软件中使用DeepSeek官网或API。支持Chat快速问答和Agent智能体功能,可操作本地文件、调用工具等,提升AI使用体验。
2026-07-11 0
Transformer 原论文实验结果:为何 28.4 BLEU 足以改写路线图
Transformer原论文实验结果揭示28.4 BLEU如何改写路线图。文章分析WMT14英译德28.4 BLEU和英译法41.8 BLEU,结合8张P100的12小时训练效率,证明attention主干在质量与并行性上全面超越RNN与CNN,奠定序列建模新范式。
2026-07-11 0
ByteDance Research | 原生视频/图像生成理解编辑统一模型Lance发布:3B All-in-One Model助力学术开源生态
ByteDance Research发布Lance模型,一个3B参数驱动的多模态统一模型。Lance原生支持视频与图像的完整理解生成编辑能力,覆盖文本到图像视频生成及多轮编辑任务。该模型助力学术开源生态,为多模态统一建模研究提供轻量级基础。
2026-07-11 0
Agent系列(五):意图识别与路由——让 Agent 听懂用户在说什么
本文介绍Agent意图识别与路由机制,通过LLM分类与LangGraph条件边将请求分发至搜索、代码、计算等专项Agent,提升响应准确性。结合多轮对话历史处理模糊指令,实现高效精准的用户意图理解,是构建智能Agent系统的关键环节。
2026-07-11 0