实时韩语字幕的汉谚混写:Whisper turbo 与后文纠错
把已有的 Hanja 消歧模型接到麦克风和浏览器标签页音频。记录增量上下文、候选重排、字幕回改协议,以及 32 段 FLEURS 音频上没有带来 CER 改善的 N-best 联合打分实验。
DEBUG NETWORK AI INFRA KUBERNETES
保留 FP8 激活与 FP4/FP8 权重,在 8 台 V100 节点上实现文本推理服务。记录 SM70 兼容计算、推测解码、CUDA Graph、前缀缓存,以及单请求约 18–24 tok/s 的实测结果。
把已有的 Hanja 消歧模型接到麦克风和浏览器标签页音频。记录增量上下文、候选重排、字幕回改协议,以及 32 段 FLEURS 音频上没有带来 CER 改善的 N-best 联合打分实验。
去年那篇消歧模型的设计稿,这次做成了能跑的东西。用 1920–1962 年的混用报纸当训练数据,XLM-R 打分,在留出集上端到端 F1 0.806,选错汉字的比例 2.4%。附每一步的数字和踩过的坑。
작년의 중의성 해소 모델 설계안을 이번에는 실제로 돌아가는 변환기로 만들었다. 1920–1962년 국한혼용 신문을 학습 데이터로 쓰고 XLM-R로 후보를 채점해, 보류 집합에서 종단간 F1 0.806, 한자 오선택 2.4%. 단계별 수치와 겪은 문제를 적는다.
昨年의 中義性 解消 모델 設計案을 이번에는 實際로 돌아가는 變換器로 만들었다. 1920–1962年 國漢混用 新聞을 學習 데이터로 쓰고 XLM-R로 候補를 採點해, 保留 集合에서 終端間 F1 0.806, 漢字 誤選擇 2.4%. 段階別 數値와 겪은 問題를 적는다.
目标是让 33B 的视频生成模型在 112 张 V100 上产出 30 秒成片。为此要先修共享存储、统一 GPU 基线、自建调度器、把节点从 K3s 手里接过来。含每一次失败的根因。
从 15 台机器的实际状态出发,记录自建软件包、MariaDB 选型、InnoDB 与 ZFS 参数的依据,以及控制面与计算节点的通信路径。
把可负担性、通勤、治安和岗位存量压成两个合成分数,画在 ABS 的统计区边界上,再下钻到 733 个 suburb。附 d3.geoPath 绕向踩坑记录。
通过 vendor 汇编、设备树和实机 GPIO 还原 ASM2806 初始化,用 GPIO provider 与 device-link 解决两层 probe 顺序问题;记录 Linux 6.13.12 下双网卡、固件和持久启动的验证结果。
To install the New Outlook via command line, use winget in PowerShell for the Store…
路由、隧道、Kubernetes,以及那些在监控图上看起来很好、实际上正在掉包的东西。Routing, tunnels, Kubernetes, and things that look fine on the dashboard while quietly dropping packets.
2020 年写了 25 篇,2021 年只有 1 篇。25 posts in 2020, just 1 in 2021.