DeepSeek V4 Flash 正式版低调上线API渠道,凭借超高性价比引发AI圈热议。实测显示,其多项性能指标逼近顶级大模型(如Opus 4.8),代码能力、工具调用等表现优异,速度达85 tokens/s,显存占用仅45GB,而价格仅为Claude的1/90。开发者实测反馈其执行效率高、试错... ...
国内AI办公智能体大战三巨头的桌面战争与飞书一、一个数字背后的行业拐点2026年7月,易观发了一份让整个科技圈安静了几秒的报告。《2026年Q2中国办公智能体平台市场洞察报告》显示:17款主流桌面端AI原生办公智能体平台,6月合计访问量突破6000万次。三个月前,这个数字还只有2000万。三个月,翻 ...
第 9 章后半放了两个看起来很不一样的案例:对话式表单负责把信息一点点收齐,BabyAGI 则围绕目标不断创建和执行任务。 一个很克制,一个很开放。但把它们放在一起看,会发现两者都在处理同一个核心问题:当前状态是什么,下一步应该怎样由状态产生? 对话式表单的目标不是“聊得自然” 假设系统要帮用户预约 ...
上一篇文章介绍了如何使用LangGraph实现会话记忆功能,可是历史会话又多又杂,难以全部记忆,开发者更希望AI应用记住关键信息,比如用户喜欢什么、爱好什么等等。 对于AI应用的精确记忆需求,LangChain支持在调用create_agent时输入store参数,以指定数据存储方式,接下来介绍如 ...
PDF 问答大概是最常见的 RAG Demo:上传文件,输入问题,几秒后得到答案。演示效果很直观,但“能回答一两个问题”和“能稳定处理一批真实 PDF”之间,还有不小的距离。 第 9 章把前面的 Loader、切分器、Embedding、向量库、Retriever 和问答链串到一起。这个案例最适合用 ...
通义千问回答复制到 Word 后出现井号、星号和反引号,通常是 Markdown 标记没有被渲染。本文整理手动清理、Pandoc 转换和多轮对话导出的处理方法。 ...
借助 Skill 降低重复任务的 Token 消耗的实际应用--36 --作者:李菠萝的多样空间 --创建时间:2026-07-31 术语速览 Skill:封装特定工作流的自定义技能。由入口文件、执行脚本和参考文件组成。通过格式固化与写入自动化降低模型每轮算力消耗。 SKILL.md:技能的核心定义 ...
传统接口报错时,我们至少能看到状态码和堆栈。LLM 应用更麻烦:它可能没有抛出异常,只是悄悄给出一个不完整、跑题或缺少证据的答案。 第 8 章介绍回调处理器。篇幅不算长,却提醒了我一件很重要的事:模型调用、检索和工具执行如果没有留下轨迹,系统上线以后几乎只能靠猜。 一次回答里到底发生了什么 一个 R ...
让模型回答问题和让模型“去做一件事”,是两种完全不同的风险级别。前者答错了,通常还能被用户发现;后者如果调用了错误工具,可能真的发出邮件、修改数据,甚至产生费用。 第 7 章介绍 Agent、Tool、Toolkit 和 ReAct。它最吸引人的地方是模型可以自己选择下一步,但我读完后最想记住的反而 ...
前言 近期在研究大模型(LLM) 与Skill(技能) 的结合应用,颇有感触。人类拥有绘画、编程等技能,依靠眼和手来完成;类比到嵌入式设备中,图像采集、数据传输同样是技能,只不过它们依靠板载硬件来完成。 通常,一块开发板的硬件资源是固定的,但上层应用是多变的。同一块板子,既可以在项目 A 中使用,也 ...
用户说“还是按上次那个地址寄”,系统怎样知道“上次那个地址”指什么?这是聊天应用开始变得像助手的时刻,也是状态管理真正变麻烦的时刻。 第 6 章集中讨论 Memory。读这一章前,我容易把记忆理解成“把历史对话都塞回 Prompt”;读完以后,最大的变化是开始区分原始记录、当前上下文和长期事实。 版 ...
--作者:李菠萝的多样空间
--创建时间:2026-07-30
--学习的教学视频:Agent Skill 从使用到原理,一次讲清 --马克的技术工作坊
--辅助学习:Copilot助手,一问一答的方式学习,笔记也为对话总结
--声明:笔记包含AI生成内容
--想说话的话:这种复发没想到这... ...
从 DeepMind 提出的“双模型协作”,到 DeepSeek 招牌的 MTP,开源EAGLE,再到最新的 DFlash 和 DSpark,今天我们就来扒一扒这套“推理提速大法”的技术演化史。 ...
“Chain”这个名字很容易让人产生一个误会:只要把几个模型调用首尾相接,就算搭好了应用。 第 5 章从基础链、顺序链、路由链讲到 Stuff、Refine 和 MapReduce。读下来以后,我更关心的反而是另一个问题:一段流程什么时候值得封装成 Chain,又有哪些逻辑应该老老实实留在普通代码里 ...
工业领域正经历从“自动化”、“信息化”到“智能化”的深层转型。传统工业软件往往是“人适应系统”,操作人员需要记住功能路径、系统的操作方式,在数据看板、报表系统、文档库等之间切换。智能化应该是“系统适应人”,用自然语言一句话就能完成数据查询、状态诊断和决策建议,对于产品或是系统设计更趋向于“简单化”。 ...
做 RAG 时,最容易被关注的是最后那次模型回答。但真正动手以后,我发现很多“模型答不好”的问题,往前追几步就会变成:文档没读全、切块切断了、元数据丢了,或者正确证据根本没有被召回。 第 4 章把加载器、文档转换、Embedding、向量存储和 Retriever 放在“数据增强模块”中。与其把它们 ...
YOLO-EMAC(YOLO-efficient-multiscale-adaptive-channel)是一种针对PCB检测中目标过小的特点提出的一种算法,基础是YOLOv12. 在卷积神经网络中,存在两个问题:(1)下采样带来的浅层特征损失,特征图越来越小,小目标卷积几次以后特征就没有了;(2) ...
如果模型只负责写一段文案,返回自由文本通常够用;如果下一步要创建工单、查询数据库或调用支付接口,“大概是这个意思”就远远不够了。 第 3 章把模型包装器、提示词模板和输出解析器放进同一个“模型 I/O”模块。这个划分让我意识到,模型调用也应该像普通接口一样有契约:输入有哪些字段,输出是什么结构,失败 ...
奇摩技术说:大模型时代的工作流新范式 一、范式转移:从"会用什么工具"到"能用AI做什么" 大语言模型的技术迭代正在重塑企业工作流的底层逻辑。过去,招聘时总会问"你熟悉哪些工具",而如今更值得关注的是如何让AI参与到每一个工作环节中。这不仅是效率问题,更是一种全新的生产力组织方式。 传统工作流:人→ ...
奇摩来教你:WorkBuddy如何重塑工作效率 一、效率瓶颈:当代知识工作者的时间都去哪儿了 现代职场人的日常工作正在被碎片化蚕食。据相关调研数据显示,知识工作者平均每天在工具切换上消耗超过90分钟,在重复性文档处理和代码查找上又占用约70分钟。邮件回复、会议纪要、报告整理这些"必要但不增值"的事务 ...