将 Transformer 模型(一种基于注意力机制的连续激活人工神经网络,ANN)转换为脉冲神经网络(SNN),本质上是桥接连续计算与离散脉冲编码的范式转变一、脉冲神经网络(SNN)的优缺点1.1 SNN的优点事件驱动、低功耗:仅在有脉冲时进行计算,适合处理稀疏、异步数据,显著降低能耗,在上下文长度上有天然优势天然…
一个端到端 Vision-Language 模型,直接把文档图像 → 结构化 HTML(含公式、表格、化学式、手写),取代传统多模块 OCR Pipeline。一、核心价值维度传统方案Logics-Parsing架构多模块串行(布局→OCR→抽取→后处理)单一 VLM 模型端到端输出误差累积高(每步错,全盘崩)低(全…
“用一个语言模型,看图说话,直接吐出结构化文本,靠自打自喂进化。”一、定义端到端视觉-语言OCR:输入一张文档图 → 输出 Markdown + HTML 表格,中间无OCR、无版式分析、无规则引擎。二、架构极简主义组件选择原因视觉编码器NaViT (600M)不是ViT-Base,是“适合批处理的视觉Tokeniz…
MineContext 是字节开源的「上下文中台」,把用户/环境/行为的动态状态,统一抽象为可查询、可订阅、可扩展的共享服务,让业务再也不用各自造轮子。Github : https://github.com/volcengine/MineContext一、核心价值把“上下文”从业务代码里抽出来,变成基础设施,像数据库…
京东开源的国产AI加速器专属LLM推理引擎,专为昇腾/海光/飞腾等国产算力优化,服务与引擎解耦架构,支持Qwen/DeepSeek/MoE等主流模型,企业级高吞吐低延迟部署。一、核心机制全图流水线:调度→计算→通信并行,消除气泡动态图优化:变长输入自适应 + 多图缓存 + 智能内存池全局KV缓存:跨请求重用 + 分布…
你无法重新训练模型,但可以重写它的念头一、Agent 与大脑工作模式的同构1.1 认知心理学中一组记忆的概念认知心理学从行为主义向信息加工(information-processing)模型转变的过程中,提出了一个理解记忆的三元结构:感觉记忆(sensory memory)定义:对感官输入的短暂保留,位于知觉处理的最…
一、2025年中国大模型推理市场的 5 个趋势2025年中国大模型市场,已从“谁能把模型训出来”,转向“谁能把推理成本压到极致、场景跑得最密”1.1 推理从文本,走向多模态文本仍是主力,但图像、视频推理正快速起量推理输出的token消耗,从文本到图像视频是成百倍的增长1.2 算力是最重要基础设施,软硬一体成标配企业刚…
Anemoi 是由 Coral Protocol 团队开发的一个创新的半中心化多智能体系统 (MAS)。它通过引入直接的 Agent-to-Agent (A2A) 通信机制,旨在解决传统中心化规划器(Planner)的性能瓶颈,实现更高效、灵活和可扩展的智能体协作。本文将深入探讨其设计理念、核心架构、性能表现、使用方…
导语在AI Agent如火如荼的发展浪潮中,技术的复杂性往往掩盖了其本质逻辑。可以从系统论、信息论和控制论三个基础维度出发,重新定义通用型与垂直型AI Agent的竞争路径。通用型 AI Agent + 新硬件(本质是新交互方式) -> 系统性机会垂直型 AI Agent + 领域知识(本质是效率和可用性) -…
前言:金融风控的本质是欺诈与信用的双面战场车贷风控是一场永不停歇的猫鼠游戏。欺诈者不断进化伪造技术,而信用不足的申请者可能隐藏真实的还款能力。传统规则引擎的僵化已难以应对动态风险。AI Agent的引入正是为了解决两个核心矛盾:如何在海量申请中实时捕捉欺诈信号,同时如何穿透数据迷雾评估真实信用。不同的Agent设计模…