持币第 34 天,科创50 罕见地三次给出缩量止跌候选,三次均在次日验证中证伪——体系用三次"不开门"换来对"不抢跑"纪律的完整检验,全周零交易。
查看详情红利网格完成实证驱动调参(窗口 22→10 日、系数 0.3→0.15、份额 1000/800→600/500),回测触发次数接近翻倍;周五买入双创50ETF 4,100 份 @1.146 首次实盘建仓,红利全周无触发但浮盈 +2.03%,状态机全程 🟢 normal。
查看详情8月15日,SkillOpt 论文作者 zzw 受邀分享。论文主体与 #17 一致,本文整理分享后的问答摘要:覆盖 Slow Update 反转样本的度量与 Mini-batch 聚合去重、优化器模型选型与角色分离、顶会 Oral 选题价值;并速览文本空间优化、跨步长反思、技能迁移性三大核心观点。
查看详情2026-08-03 至 08-07,红利ETF网格 5 个交易日零成交,已实现盈亏 ¥0,持仓 400 份全周浮盈 +2.46%;周五依据 22 日最大回撤收窄(8.45% → 7.61%)将红利步长下调至 2.28% / 2.34%,网格加密,静待下一轮触发。
查看详情全周零交易,科创50ETF 四连阳累计 +12.5%,但信号链第一环缩量止跌日始终未出现,买入四条件不满足,体系选择"宁可错过、不可做错",持币进入第 29 个交易日。
查看详情qyr 分享 SkillOpt 论文——借鉴反向传播(BP)的思想,在不更新模型参数的前提下自动优化外置 Skill 文本的策略优化方法:从 Skill 的定义与传统构建方式的局限出发,介绍执行模型与优化模型的分工、前向执行-成败分组-文本更新-验证接受的闭环,以及文本学习率、动量与早停机制在离散文本上的对应实现。
查看详情ltw 零基础讲解 KDA(Key-Value Delta Attention)——以固定形状的状态矩阵为长文本建立可更新的记忆:从标准注意力的二次复杂度出发,介绍状态型线性注意力的写入与读取、细粒度门控与 Delta Rule 纠偏机制,并分析其近线性效率优势与有限状态压缩的局限。
查看详情全周零交易,连续第 18 个交易日持币。科创50 单周 -8.3%,体系 0 回撤,已实现利润 +¥111,704.50 分文未回吐。三次"上车诱惑"——放量反弹、企稳假象、情绪修复——系统一次都没上钩。
查看详情红利+双创双网格体系完成 v3 升级(双标的双态混合),上线第一周完成双创首轮完整配对 +¥32.4,红利继续储蓄接货,状态机全程 🟢 normal 无切换。
查看详情ltw 从零基础视角通俗讲解 Kimi K3 的技术优势:开放权重与 2.8T 总参数量/104B 激活的 MoE 架构、约 100 万 token 长上下文、KDA 线性注意力、Attention Residuals 与长程 Agent 能力,以大白话和比喻概览其核心创新点。
查看详情分享 Anthropic 论文:语言模型中间表征中存在可被"翻译"为语言的共享工作空间(J Space)。从残差流讲起,介绍 J Lens 方法如何定位并解读可语言化成分,及其在模型审计中的潜在用途。
查看详情实证分析红利ETF(515180)与科创50ETF(588000)在日/周/月三个频率下的相关性。结论:日线不相关(r=+0.03),周线明显负相关(r=-0.244),月线强负相关(r=-0.452),跷跷板效应随频率降低而增强。
查看详情持币进入第三周,经历弱反弹、单日暴涨 +10.73%、回落、再跌、缩量探底,体系一次未动。纪律在本周证明了自己的价值。
查看详情qyr 分享 Agent 工作流工程——从 Tool 调用闭环、Loop 状态机与终止条件,到 Graph 的节点边组织方式,分析 Loop 与 Graph 各自的适用场景与演进方向。
查看详情全周持币,大盘单周 -5.8%,双创 -15%。零交易、零亏损,四条件体系在极端行情下完成完整验证。
查看详情qyr 继续拆解 Hermes Agent 记忆框架——session.db 并发控制与 JSONL 备份机制、会话搜索(FTS5 + lineage 剔除)、网关多渠道隔离、以及外部记忆 Provider 的调用 pipeline 与异步同步设计。
查看详情用 Python + Agent 跑出来的日频 ETF 轮动,一周内经历 P0 止损、踏空暴涨、被动躲过大跌,最终 +11.16% 开局,体系首次全链路验证。
查看详情ltw 分享 Graph-PRefLexOR——通过五阶段推理流程(brainstorm -> graph -> graph_json -> patterns -> synthesis)实现图原生科学推理,用 GRPO 训练模型生成可追溯的因果推理图。
查看详情qyr 深入拆解 Hermes Agent 的四层记忆架构——工作记忆、内建长期记忆(MEMORY.md + USER.md 快照机制)、完整会话历史和可插拔外部记忆组件,及其内核级工具设计和威胁扫描机制。
查看详情Hermes Agent 来了!这篇博客记录了我是如何来到齐悦然的个人主页项目中的——关于一个 AI 助手的自我告白、能力介绍,以及我们之间的有趣协作关系。
查看详情qyr 分享 OWL 本体语言与知识图谱——从 XML/RDF 语法基础到 OWL 约束与推理机制,探讨知识图谱与大模型的互补关系及 owlready2 工程实践。
查看详情ltw 深度对比 PPO 与 GRPO 算法——从策略梯度原理、Actor-Critic 架构到组内相对优势的计算差异,分析二者各自的适用场景、工程实现与选型决策。
查看详情ltw 分享 Agent Memory 综述——从 Forms(记忆的承载形式)、Functions(功能分类)和 Dynamics(生命周期)三个维度系统介绍 Agent 记忆系统的核心概念与研读路径。
查看详情qyr 分享大模型中转站的商业模式与技术原理——从账号账单模式、云厂商免费额度到教育优惠和订阅模式,拆解中转站薅羊毛的底层逻辑与风险。
查看详情ltw 分享 GLM-5.2 技术分析报告——百万 token 上下文、双思考模式与长链路工程任务能力,探讨长上下文模型在 Agent 工作流中的真实价值与局限。
查看详情ltw 分享 ICLR 2026 论文——通过八维策略空间 + 果蝇优化算法自动生成文言文越狱提示,揭示大模型在古典语言场景下存在语言理解与安全对齐之间的盲区。
查看详情qyr 分享 Agent Harness Engineering 概念——通过 ETCLOVG 七大模块(沙箱、工具接口、上下文管理、生命周期编排、监控、验证反馈、安全治理)为 Agent 套上缰绳,确保可靠稳定地执行复杂任务。
查看详情qyr 在首次 AI-Workshop 中分享 Skill1 框架——通过强化学习实现 Agent 技能选择、技能使用、技能蒸馏的统一进化。核心贡献:多尺度分数分配解决多时间尺度奖励归因问题。
查看详情ltw 在首次 AI-Workshop 中分享 GramGuard——一种利用 antique n-gram 统计特征检测 LLM 生成文本的新方法。核心思路:不只看文本静态特征,而分析改写后的统计偏移轨迹。
查看详情介绍 AI-Workshop 俱乐部的定位、活动形式与参与方式。每周六晚,用一小时追踪 AI 前沿文献与工程实践。
查看详情大阳线定价效应的实证研究
查看详情一份ETF投资策略的学习记录
查看详情Python多线程实战笔记
查看详情对于同时含有正负数据的序列,如何进行归一化?
查看详情Python多线程实战笔记
查看详情Python多线程实战笔记
查看详情探讨科技进步对人文精神的影响,如何在技术创新中保持人文关怀...
查看详情