2026-09-22 这一天出了两条值得放一起看的新闻:小米凌晨发布并开源 MiMo-V2.6 系列,Artificial Analysis(下称 AA)上午发布了对阶跃星辰 Step 5 Preview 的完整评测。 关键是——它们用的是同一把尺子(AA Intelligence Index),一 ...
天翼云自研的 AI创作平台(天翼云DramaFlow 2.0) 一站式 AI 内容创作平台全新上线。创意工坊、剧集创作、无限画布三大模式,把模型算力、素材资产、团队管理、批量任务收进同一个平台:个人创作者够用,工作室和政企团队也能跑量产。 ...
豆包工作应用试用小记Part1 飞书 AI 是飞书 SaaS 平台内置的 AI 能力集合;豆包工作 AI 是独立的 Agent 生产力产品,深度嵌入飞书,能力更强、可自主执行复杂长流程任务。两者同属字节,账号、权限打通,但定位、能力边界完全不同。飞书 AI飞书办公套件原生内置 AI 插件 / 能力集 ...
本文档为 MysticMirror 自研大模型的全覆盖自动化回归测试套件,整合原有 22 项基础回归测试与 20 项新增边界能力测试,共计 42 个测试用例。全面覆盖模型配置校验、RoPE 位置编码(原生 / YaRN 缩放 / 长序列外推)、注意力掩码、KV 缓存两种格式兼容性、混合精度训练、权重... ...
Linux权限机制对纯AI Agent主机:阻碍还是必要的基础设施? 核心判断:不是阻碍,而是必须重新设计的“安全基础设施” 一台仅运行AI Agent、完全脱离人工访问的主机,Linux权限机制确实会与Agent的运行模式产生结构性张力,但“阻碍”的根源不在于权限机制本身,而在于传统Linux权限 ...
针对独立开发者出海日本市场时面临的音乐版权贵、日系配乐门槛高等痛点,本文复盘如何利用日语特化音频大模型 Sakkyoku AI 生成 J-Pop、动漫 OST 与商业免版权 BGM,并探讨基于自动化工作流的高效配乐实践方案。 ...
奇摩带你玩转:WorkBuddy代码生成实战 一、背景引入:程序员的时间都消耗在哪 不得不说,写代码这件事里真正"创造"的时间远没有想象中多。日常开发中,大量精力消耗在样板代码、接口对接、查文档、补注释这些重复性劳动上,频繁的任务切换还会进一步拖慢心流。深圳市奇摩计算机有限公司在多年 IT 服务实践 ...
2026年被业界称为人形机器人量产元年:万台级落地、世界机器人大会演示不断,另一边业内反复提醒把大模型接到机器人身上不等于会干活。本文梳理量产元年的热闹、三声质疑与为什么这次又不一样,帮你判断这道裂缝两边各自站的是什么。 ...
每天上午快到十一点四十,办公室里就会冒出一句「今天中午吃啥」。 我们几个中午基本在公司附近解决,来来回回就是那几家店。店面是固定的,菜点得越来越窄。我连着四天点了青椒土豆丝,第五天再报这个菜名的时候,同事看我的眼神有点不对。 难处不是没得选。附近几家馆子的菜单加起来少说上百道菜,谁都想不出新花样,也 ...
2026 年 9 月 7 日,最高法发布首部涉 AI 司法裁判规则(5 部分 24 条);同期韩国三大电视台起诉 OpenAI、德国法院密集判决、美国最高法维持"AI 作品不可登记版权"。训练数据算不算侵权、AI 生成内容归谁、平台责任怎么划——本文梳理三重争议与三种可能的走向。 ...
2026 年 8 月,Vercel 数据显示开源模型 Token 调用份额从 4 月的 11% 飙升至 62%,首次超越闭源;Anthropic 份额接近腰斩、OpenAI 紧急降价 80%。开源真的赢了,还是赢的只是"白嫖流量"?本文用付费账单、性能差距与安全事件三组证据,拆解这场份额逆转背后的商... ...
GPT-6 Astra 用超 10 万块 GPU 训练证明"大力出奇迹"依旧有效,千问 3.5 却用不足旗舰四分之一的总参数反超闭源。Scaling Law 是物理定律还是正在失效的经验公式?本文摆出支持派与挑战派的证据,并指出真正的新共识:堆参数的旧红利在收窄,算力红利正从训练端转向推理端。 ...
朱啸虎说"今年可能是基础大模型的最后一年",高盛却说"AI 并非世纪泡沫":四大云厂商 2026 年合计近 8000 亿美元 AI 资本开支,对上 OpenAI 等头部公司 400 亿美元收入。本文拆解泡沫论的三条证据、反方的三条回应,以及这场争论真正的分歧点——投入产出剪刀差会不会被时间抹平。 ...
新模型发布后,社交平台上很快会出现两种声音:一种惊叹能力又变强了,另一种立刻担心开发岗位要消失。这两种反应都太急了。能力提升和职业消亡之间隔着很长的逻辑链。更值得先弄清楚的问题是:我们凭什么知道一个模型变强了?
大多数人会看基准测试分数。这没有错,基准测试提供了一个公共的起跑线,让不同模型可以在同一... ...
前文《基于 LlamaIndex+PostgreSQL 实现 RAG 持久化》已完成向量数据库持久化部署,并封装了 RAGService 基础检索服务,解决了 RAG 系统的向量存储与索引持久化核心能力。但单纯依赖基础向量检索,普遍存在语义漂移、关键词精准匹配能力弱、场景适配性差等工业落地问题,难以... ...
传统LangChain是LLM应用的组件工具箱,以Chain与Runnable为核心抽象,提供提示词模板、文档处理、向量检索、工具调用、记忆能力等标准化组件,目的是快速构建简单线性的LLM任务。而LangGraph是面向复杂场景的状态图编排运行时,专注于有状态、可动态迭代的智能体工作流精细管控。它基... ...
中国电信天翼云积极践行国家云使命担当,率先推出面向央国企的可信Token专区,从专属隔离、安全合规、性能保障、自主可控、专业服务五个维度构建完整能力体系,全方位保障“原始数据不出域、数据可用不可见”,系统性化解央国企调用外部大模型服务的安全合规之忧,为央国企大模型规模化落地提供安全可信的技术能力支撑... ...
Claude Code 完全指南:环境搭建 + 五大扩展机制 一份可以直接照搬的实操手册。 上半篇解决「装得上、跑得起来」,下半篇解决「用得顺、管得住」—— Skill / Plugin / Hook / MCP / Agent 五大扩展机制逐个拆解。 目录 一、环境搭建 二、先建立全局认知 三、R ...
Gartner 预测 2026 年底 40% 企业应用嵌入智能体、前沿模型 15 秒视频可用率从 20% 拉到 90%、Qwen3.8-27B 登顶 Hugging Face——本文基于腾讯研究院、央视联发与 Gartner 三份年度十大趋势报告,交叉提炼 2026 年真正在发生的十件大事与一份数字... ...
医院上 AI:从分诊和用药解读开始,别一上来就想做诊断一、先泼一盆冷水:Demo 做得快,不代表能上线现在用现成接口搭一个“看起来挺聪明”的医疗问答 Demo,几天就够了。但这恰恰是最容易让人产生误判的地方。Demo 证明的是可能性——模型能听懂人话、能说出像样的医学句子。而生产环境要的是确定性—— ...