文章归档

ARCHIVES
共 94 篇文章
2026

逆熵流形(7)

本期内容聚焦AI信任危机。研究方面,Tasteful Agent为AI“品味”建立量化基准;OpenAI确认自复制提示注入存在,类似AI蠕虫可在代理间传播。安全事件上,美军险些因AI生成的假情报拦截中国船只,暴露出AI输出缺乏统一验证标准。观点层面,有作者批评AI产品未将错误检查作为核心功能,也有人认为AI缺乏智慧,过度依赖将阻碍开发者成长。此外,训练OpenAI模型的承包商因使用AI被开除,而Gen Alpha将“That's so AI!”用作骂人话,意指虚假可疑。整体呈现AI在可靠性、安全性及社会认知上的多重隐忧。

逆熵流形(6)

## 文章摘要 本期“熵减探索境”介绍了三个技术项目:从零手写Transformer的教学项目(13M参数)、SlotDiT(将场景拆成object-centric slots进行扩散生成,机器人任务成功率超越VAE基线)、以及Archify(在聊天中生成交互式架构图的Agent工具)。 “信息焓变场”部分聚焦四则资讯:OpenAI通过`__obi` cookie收集用户跨站浏览数据,涉及隐私争议;NYT诉OpenAI案解密文件显示微软高管内部承认AI抓取是“人类历史上最大规模的劳动盗窃”;TypeSafe的Jev架构被逆向解析,直接输出决策概率而非生成文本;以及通过指定具体风格名(如Bauhaus、Swiss Style)可让AI海报跳出默认模板。 “混沌松弛域”记录了作者日常游戏与工作状态。整体逆熵效率约六成。

逆熵流形(5)

本文是一期科技与AI领域的资讯汇总。技术方面,介绍了LoRA-Muon优化器,将谱最陡下降应用于LoRA,节省内存且对缩放不敏感,但实验结论存疑。信息伦理方面,讨论"No AI"成为卖点、Meta以折扣换取用户数据训练、abliteration去护栏技术被商业化,以及Humanizer工具去除AI文风。观点部分,孙宇晨致信胡锡进,探讨体面、合同算法与财富创造等议题。文末作者感叹近期游戏热情减退,星铁也渐失吸引力,似有退坑之意。

Opencode 思考强度设置的一点小坑

本文记录了在本地使用Qwen3.8-27B模型接入opencode工具时的配置经验与注意事项。作者指出,opencode的配置文件(jsonc格式)不支持像GPT那样在同一模型中直接设置思考强度,而需将不同思考模式拆分为多个独立模型,并通过额外的`options`模块传递参数(如思考强度、temperature、top_p等)。同时,由于多个模型共享同一API地址,除第一个模型外,其余模型必须设置单独的ID。文章提供了完整的配置示例,展示了如何通过`chat_template_kwargs`中的`enable_thinking`开关及`reasoningEffort`参数(支持xhigh、medium、low)来实现直出模式与不同强度思考模式的切换,并详细列出了各模型的上下文限制、输出长度及API连接参数,为类似本地模型接入场景提供了实用参考。

Qwen3.8-27B测试(4)

本文测试了Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NEO-CODER-MAX-MTP-GGUF模型,在MTP加速下token生成速度达60+tokens/s。以开发轻量级本地网盘系统(Rust-MVP)为测试项目,提供了包含双协议访问、流式传输、元数据管理、文件监听防抖、软删除GC、冷启动对账等完整需求规格和架构设计。测试发现:在明确要求严格遵循TDD流程后,模型指令遵循能力显著提升,保持了良好计划性且思考时间大幅减少;但review流程因时间缩短导致质量把关不足(约2分钟、全Pass),后续循环检测暴露出10多个优化点。整体交付质量达到MVP要求,但Web端CORS问题需人工介入。结论是该模型适合小规模后端开发(命令行工具、API接口等),在非可视化开发场景表现不俗。

Qwen3.8-27B 测试(3)

本篇文章是对一款名为“Qwen3.8-27B-TURBO-Fable-Cold-Fusion”模型的测试报告。作者通过运行HTML版坦克大战游戏项目,评估该模型在代码生成方面的性能。观察发现,该版本模型思考时间较原版大幅缩短,指令遵循度有所“下降”,具体表现为会跳过部分开发流程,更偏向快速实现主体架构而非关注细节。这种“自信”的风格虽减少了耗时,却导致生成效果与原版存在较大差距,游戏可玩性和观赏性均未达预期。作者推测该特性源于微调数据且需配合更详细的前期提示使用。总体而言,该模型未能完全达到预期,其亮点是思考速度显著提升,但以牺牲生成质量为代价,作者将等待后续版本进行进一步测试。

Qwen3.8-27B 测试(2)

本文介绍了Qwen3.8-27B-Cold-Fusion-GAIN-V1.1-NM-DAU-NEO-MAX-MTP-GGUF魔改版模型的实测体验。该版本旨在减少思考时间,同时在xhigh模式下测试一个局域网P2P文件传输应用的开发。测试环境为双卡4090,运行速度50-60tokens/s。整个开发过程约7小时,除需求设计和少数权限问题外均由模型独立完成,项目采用Rust(Tauri 2)后端和Vue 3前端,实现了TCP零拷贝传输、BLAKE3校验和断点续传等功能。观察发现,模型具备较强的独立思考能力,能主动查阅资料解决问题,但思考量仍偏多,在约15万上下文后可能出现循环思考问题。总体而言,该模型能胜任中低复杂度软件开发任务,具有实用价值。

10:24:00
8月27日, 2026, 周三
system_stats.sh
处理器 CPU82%
运行内存 RAM12.4G / 16G
网络吞吐 Network5.2 Mbps · 4g

精选图库

JacyLunatic

JacyLunatic

只争朝夕

94 篇创作

实时天气

24°
晴
本地
28° / 24°
97% 12 km/h 体感 29°
逐小时
多日预报

创作活跃度

萌ICP备20241011号
本站已加入BLOGS·CN