Laya-CoreML 核心概念入门choice/score/noul 三种类型化决策一个 Token 都不生成【免费下载链接】laya-coremlLocal Laya typed decisions on Apple Core ML and Neural Engine. Validated ports, ~5 ms short decisions on M3 Max, reproducible speed and energy benchmarks.项目地址: https://gitcode.com/gh_mirrors/la/laya-coremlLaya-CoreML是一个运行在 Apple Silicon 上的开放权重类型化决策模型基于 Apple Core ML 与 Neural Engine 推理。它最独特的地方在于你问它问题它直接返回带概率的结构化答案——既不逐 Token 生成文本也不产出需要解析的 JSON。一次短决策在 M3 Max 上仅约5 毫秒且output_tokens永远是 0。什么是类型化决策为什么强调零 Token 生成传统大模型的决策流程是生成一段文本 → 你再去解析文本。而 Laya-CoreML 采用双向编码器结构输入一次编码完成没有自回归解码auto-regressive decoding环节模型输出的是每个候选选项的 logit直接 softmax 成概率分布结果是确定结构答案、概率、置信度一步到位。laya_coreml/result.py 中的system_one就是这个核心一次前向推理一次model.predict调用完成所有问题的打分返回的usage中output_tokens恒为 0。这意味着对比项文本生成式 LLMLaya-CoreML 类型化决策推理方式逐 Token 自回归解码单次前向编码输出自由文本需解析固定结构 概率输出 Token 数不定恒为 0短决策延迟通常数百毫秒起P50 约 4.98 msM3 Max ANE FP16运行依赖PyTorch / MLX 等纯 Core ML无需 PyTorch 所以一个 Token 都不生成不是营销话术而是架构决定的predict()返回的用量统计里输出 Token 数就写死为 0。三种类型化决策choice / score / noulLaya-CoreML 只支持三种问题类型在 laya_coreml/common.py 中定义为QTYPES {choice: 0, score: 1, noul: 2}。任何不属于这三类的type都会在 laya_coreml/prompt.py 的输入校验阶段直接报错。1. choice —— 多选一从若干候选标签中挑一个并给出每个标签的概率。适合工单分派、意图分类、动作选择。{ department: { type: choice, instructions: Which department should handle this request?, criteria: { billing: Payments, invoices, refunds, technical: Broken features, errors, sales: Pricing, new purchases } } }返回内容choice中选标签、probabilities各标签概率、confidence置信度。2. score —— 有序评分对一组有序档位打分返回期望档位值0 起始的类别指数望值和档位图例。适合紧急程度分级、满意度评分、风险等级。{ urgency: { type: score, instructions: How urgent is the request?, criteria: [not urgent, soon, critical deadline] } }返回内容score0~n-1 的期望值、legend档位说明、probabilities各档位概率。3. noul —— 布尔判断回答是 / 否模型输出 true 的概率。适合退款请求检测、条件校验、安全判断。{ refund: { type: noul, instructions: Does the customer request a refund? } }返回内容noultrue 的概率、confidence取该概率与 1 减去它的较大者。选项渲染固定为[false, true]见 laya_coreml/common.py 中的render_options。 三类答案都额外携带confidence基于归一化香农熵的置信度与 action head 概率字段可以直接用于低置信度转人工之类的业务门槛。三种类型如何配合贪吃蛇演示仓库里最直观的验证是终端贪吃蛇模型每一帧只回答三个问题——movechoice四个方向各带一句安全性描述选概率最高的方向risknoul是否存在安全通路foodnoul食物是否可达。见 laya_coreml/snake/policy.py其中还有显式的循环安全层模型提议的方向不安全时安全盾会接管执行一个安全方向并在界面上计入Shield interventions。完整游戏循环在三条 600 步测试中稳定达到49.1–50.0 决策/秒零死亡——这就是每帧 5 毫秒级类型化决策的实际效果。快速上手安装与一次调用需要 Apple Silicon macOS 15 Python 3.11–3.13python -m pip install laya-coremlimport laya_coreml as laya agent laya.load(aac6fef/laya-multilingual-coreml-ane) result agent.predict( The customer requests a refund of a duplicate payment., { department: { type: choice, instructions: Which department should handle this?, criteria: {billing: refunds, technical: errors, sales: pricing}, }, urgency: { type: score, instructions: How urgent is the request?, criteria: [low, medium, high], }, refund: { type: noul, instructions: Does the customer request a refund?, }, }, ) print(result[answers]) print(result[usage]) # {input_tokens: ..., output_tokens: 0}更完整的三种类型示例文件见 examples/questions.jsonAPI 细节见 docs/USAGE.md。推理不依赖 PyTorch、Transformers 或 MLX模型首次下载后可用local_files_onlyTrue完全离线运行。性能与模型选择M3 Max 实测短决策基准91-token 问题ANE FP16共 65,598 次稳定调用数据见 benchmarks/results指标MLX FP16Core ML ANE FP16P50 / P95 延迟6.94 / 7.39 ms4.98 / 5.31 ms每次决策整机能耗0.4288 J0.1540 J2.78× 改善模型容量选择96-token ANE 包laya-multilingual-coreml-ane最短、最快适合高频短决策超出预算会直接报容量错误1024-token 通用包laya-multilingual-coreml长输入多语言场景。完整模型表与设备引擎说明见 docs/USAGE.md 与 docs/ANE_BENCHMARKS.md。想深入看这些模块类型定义与提示词构造laya_coreml/common.py、laya_coreml/prompt.py概率输出与置信度计算laya_coreml/result.pyCore ML 加载与引擎选择laya_coreml/agent.py贪吃蛇策略choice noul 实战laya_coreml/snake/policy.py小结Laya-CoreML 把让模型做判断从文本生成问题变成了结构化的类型化决策问题choice做多选一、score做有序评分、noul做布尔判断一次前向推理直接拿到概率与置信度零输出 Token、约 5 毫秒延迟、纯 Core ML 离线运行。如果你的场景是高频分类、分级或条件判断这正是比通用 LLM 更省更快的一条路。【免费下载链接】laya-coremlLocal Laya typed decisions on Apple Core ML and Neural Engine. Validated ports, ~5 ms short decisions on M3 Max, reproducible speed and energy benchmarks.项目地址: https://gitcode.com/gh_mirrors/la/laya-coreml创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
企业数字化 ERP 产品动态
相关推荐
搞懂域名服务器后,网页浏览历史记录恢复工具怎么选不踩坑 搞懂域名服务器后,网页浏览历史记录恢复工具怎么选不踩坑 做网站这行十年,我见过太多老板因为搞不清“域名”和“服务器”的关系,在恢复网页浏览历史记录时走弯路。你以为只是浏览器插件没装好?错,很多时候是服务器端的日志配置、缓存策略或者SSL证书… · 2026/9/27 6:53:58
c/c++: window下安装mingw-w64 环境:
window11x86_64-16.2.0-release-posix-seh-ucrt-rt_v14-rev1.7z
一、什么是 MinGW-w64?
MinGW 的全称是:Minimalist GNU on Windows。 一句话来概括:MinGW 就是 GCC 的 Windows 版本 。
组成
gcc:C 编译器g࿱… · 2026/9/27 6:53:46
The Concise TypeScript Book:彻底理解 void 类型——函数无返回值场景的正确类型注解 文档教程 【免费下载链接】typescript-book The Concise TypeScript Book: A Concise Guide to Effective Development in TypeScript. Free and Open Source. 项目地址: https://gitcode.com/gh_mirrors/typ/typescript-book 点击查看 免费下载 void 是 TypeScrip… · 2026/9/27 6:53:46
OrchardCore Display Drivers 权威指南:为内容部件、字段与模型构建 Shape 的完整实现方案 CMS后端Web框架 【免费下载链接】OrchardCore Orchard Core is an open-source modular and multi-tenant application framework built with ASP.NET Core, and a content management system (CMS) built on top of that framework. 项目地址: https://gitcode.com… · 2026/9/27 7:30:32
FontForge 文件体系全解:用户配置目录、崩溃恢复与系统共享资源 桌面应用图形学 【免费下载链接】fontforge Free (libre) font editor for Windows, Mac OS X and GNULinux 项目地址: https://gitcode.com/gh_mirrors/fo/fontforge 点击查看 免费下载 导读
FontForge 是一款免费开源的字体编辑器,它在用户主目录与系… · 2026/9/27 7:30:26
Spirula Studio对比视图实战:同屏对比4个模型找出“更好“的那一个 Spirula Studio对比视图实战:同屏对比4个模型找出"更好"的那一个 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula… · 2026/9/27 7:30:26
制造业智能体自动化平台对比评测报告(MES 与排产协同场景) 一、评测摘要与综合评分制造流程自动化的演进走过三轮:第一轮是产线设备自动化与 PLC 应用,把人工操作换成设备动作;第二轮是 MES 与 ERP 普及,把排产、工单、库存与质量管进系统;第三轮是智能体驱动的制造协同——智能… · 2026/9/27 7:30:26
MySQL条件查询与过滤 在数据库操作中,查询数据是最基础的技能之一,而查询的核心在于如何有效地进行条件过滤。通过条件过滤,能够从大量数据中筛选出符合要求的记录。
使用适当的过滤条件,可以提高查询效率,并确保数据分析结果的准确性。在本课程中,主要介绍如何通过SQL的WHERE子句进行条件过… · 2026/9/27 7:30:20
MySQL数据排序与限制 数据排序和限制查询返回的记录是数据库查询中的关键技能,尤其在处理大量数据时,合理的排序和限制可以大幅提升查询效率以及结果的可读性。
本课程将介绍如何通过SQL中的ORDER BY实现结果的升序或降序排序,如何通过LIMIT限制返回记录的行数,以及如何使用DISTINCT去除重复的… · 2026/9/27 7:30:20
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现 简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01
汕头网站建设制作厂家避坑指南:5大注意事项救急 汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习 简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现 简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01
汕头网站建设制作厂家避坑指南:5大注意事项救急 汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习 简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01