- [Token Stats Overview & Deep Insights Dashboard, Full-Stack Thinking (Reasoning) Stats & Unified Dark Theme]:
- Full-Stack Thinking / Reasoning Token Analytics:
- Database & Proxy Integration: Seamlessly migrated proxy logs (
proxy_db) and aggregate tables (token_stats) to trackreasoning_tokens. Extracted model thinking token consumption automatically from streaming SSE chunks and non-streaming responses across all protocols. - Multi-Dimensional Aggregations: Extended hourly, daily, weekly, all-time, account-level, and model-level statistical endpoints to return aggregated reasoning tokens and average reasoning intensity.
- Overview Dashboard Integration: Prominently featured reasoning tokens with a dedicated purple badge and output proportion (
Reasoning: XX (YY%)) in the main usage overview card, along with average reasoning throughput per request in the J23 efficiency card header.
- Database & Proxy Integration: Seamlessly migrated proxy logs (
- "Overview" Dashboard View Integration & Polishing: Introduced the new Overview dashboard featuring a 360° radial ray gauge, core model breakdown with tooltip inspection, 24-hour activity bar pulse, J23 efficiency gauge, and account leaderboard with single-model highlight focus.
- Dark Theme Background & Component Elevation Unification: Eradicated fragmented hardcoded dark backgrounds (
dark:bg-[#0a0a0c],dark:bg-[#121316],dark:bg-[#1c1c1e], etc.), aligning entirely with global design tokens (card containersdark:bg-base-100, pills & segmented controlsdark:bg-base-200, bordersdark:border-base-200/300), eliminating seams against sticky navigation bars and harmonizing Classic vs new dashboard visual tones. - Full 12-Language Localization for Token Stats: Fully synchronized
token_statsi18n keys across all 12 supported locales (English, Spanish, Russian, Arabic, Japanese, Korean, Portuguese, Turkish, Vietnamese, Burmese, Simplified & Traditional Chinese), decoupling hardcoded week formatting. - Chart Tooltips & Custom Pricing Modal Dark Tuning: Optimized dark mode backgrounds, borders, and input controls for chart tooltip overlays and the custom pricing modal (
PricingModal), ensuring seamless tactile feedback across both light and dark modes.
- Full-Stack Thinking / Reasoning Token Analytics:
- [Intelligent Multi-Tier Scheduling: Weekly Quota EDF, Zero-Quota Session Auto-Failover, Cross-Model Isolation & Claude Compaction Hardening] (PR #3640, PR #3641, PR #3642, PR #3644, PR #3645, PR #3647, PR #3650, Thanks to @modded-soldier-9, @cubelikeplayDaniel):
- Weekly Quota Earliest Deadline First Scheduling (EDF / Use-It-Or-Lose-It): Accurately extracted Google 7d/weekly bucket quota reset timestamps, introducing Earliest Deadline First rules (Priority 0.5) to multi-account rotation and P2C random selection. Prioritizes accounts approaching their reset window (weekly reset <= 24h or 5h bucket <= 2h with quota > 0%) to consume expiring capacity before scheduled resets, completely preventing usable allowances from going to waste under rigid high-quota-first policies. (PR #3645, Fixes #549, Ref #900, Thanks to @modded-soldier-9)
- Continuous Session & Preferred Account Zero-Quota Auto-Failover: Added proactive quota awareness to Sticky Session and Preferred Account selection. When a bound account hits 0% quota for the requested model while healthy accounts remain available, atomically unbinds and re-routes requests before atomically rebinding the session upon success, preventing hard socket breaks and client interruptions during continuous AI Agent coding. (PR #3642, Fixes #3639, Ref #3509, Thanks to @modded-soldier-9)
- Cross-Model Quota Lockout Isolation: Completely refactored
get_quota_reset_timeandfetch_and_lock_with_realtime_quotato strictly match normalized model IDs and only apply long-horizon reset lockouts when the target model's quota is truly exhausted (percentage <= 0). Prevents transient 429s on healthy models from inheriting days-long lockout timestamps from unrelated exhausted models (such as Claude Opus), eliminating false 503 Service Unavailable errors and pool starvation. (PR #3640, Fixes #3627, Thanks to @modded-soldier-9) - Imagen 3 Micro-gap In-Place GraceRetry & Transient Cooldown Rescue: Introduced micro-gap in-place recovery (
delay <= 2500ms) during the first multi-account rotation round for Google image generation models, eradicating rapid 50ms cascading sweeps that exhausted whole pools within 300ms. Also introduced queue-level cooldown wait rescue inget_image_tokenwithin remaining timeout budgets, dramatically boosting image generation success rates. (PR #3641, Fixes #3329, Fixes #3409, Thanks to @modded-soldier-9) - Claude Cowork Deep Compact State Machine & Continuation Tag Hardening: Adjusted the sliding immunity lease window (
COMPACTION_IMMUNITY_WINDOW_SECS) to 90 seconds to stably accommodate long reasoning models and complex multi-step MCP toolchains, completely resolving Double-400 false alarm loops. Expanded continuation scanning depth to the first 5 turns to pierce through multiple preceding<system-reminder>and environment detail blocks, while recognizing/compact.and/compact <args>command variants. (PR #3644, PR #3647, Ref #3576, Thanks to @modded-soldier-9, @cubelikeplayDaniel) - Claude Code Session Usage Scaling Bypass & Native 95% Auto-Compaction Self-Healing: Unified
is_code_modedetection logic to precisely recognize Claude Code CLI and Desktop Code Tab; forcibly bypassed usage scaling for Code mode requests whenenable_usage_scalingis enabled to reflect raw physical token usage. Completely eradicates false low-usage signals that pacified client auto-compaction watchdogs, preventing sessions from failing to trigger/compactand abruptly disconnecting upon exceeding context limits. (PR #3650, Fixes #867, Fixes #1066, Fixes #1079, Thanks to @cubelikeplayDaniel)
- [Gemini Thinking Tier Alias Normalization & Inert Padding Degrade] (PR #3646, PR #3649, Fixes #3629, Ref #2208, Thanks to @ThermalEng, @modded-soldier-9):
- Normalize Pro Thinking Tier Aliases to Upstream Physical ID: Reused the unified model compatibility mapping to ensure bare
gemini-3.1-prorouted tohigh,mediumfallback, or default tier aliases, as well as explicitgemini-3.1-pro-high, are all normalized to the real upstream physical model IDgemini-pro-agent, completely resolving400 INVALID_ARGUMENTerrors when queryinggemini-3.1-pro-highupstream. (PR #3646, Ref #2208, Thanks to @ThermalEng) - Degrade Gemini Fallback User Padding to Inert Punctuation: Downgraded fallback placeholder text (
TRANSIT_DEFENSE_FALLBACK_TEXT) inensure_gemini_payload_ends_with_userfrom natural language"ok go on"to inert punctuation"."for empty/substanceless user turns. Satisfies Gemini protocol non-emptypartsconstraints while completely preventing AI Coding Agents (such as Cline, Claude Code, OpenCode) from misinterpreting synthetic text as explicit user approval, permanently securing human-in-the-loop gates and eliminating loop cycles. (PR #3649, Fixes #3629, Thanks to @modded-soldier-9) - Zero Thinking Budget Inbound Hard Cutoff & Soft Target Documentation: When zero thinking budget is explicitly configured or derived via adaptive fast-response compression, strictly inject both
includeThoughts: falseandthinkingBudget: 0, achieving 100% parity with Google's native IDE protocol to completely extinguish upstream reasoning chains; additionally clarified in the settings UI across all 12 languages that upstream Gemini treats positive thinkingBudget as a heuristic soft target that can dynamically expand under complex prompts. (Ref #3648)
- Normalize Pro Thinking Tier Aliases to Upstream Physical ID: Reused the unified model compatibility mapping to ensure bare
- [HTTP API Field Restoration, Quiet Startup, Missing storage.json Self-Healing & Admin Hot-Sync] (PR #3651, Fixes #3631, Fixes #3630, Fixes #1411, Fixes #3270, Fixes #3275, Fixes #3280, Fixes #3260, Thanks to @modded-soldier-9):
- Full HTTP / Headless API Metadata Serialization: Fully supplemented
validation_url,validation_blocked*,priority,disabled*,proxy_disabled*, andprotected_modelsmetadata fields acrossAccountResponseinmodules/http_api.rs, eliminating dead code in external panels and headless consumers to ensure unblock URLs and account statuses are transparently exposed. (PR #3651, Fixes #3631, Thanks to @modded-soldier-9) - Validation Blocked State Complete Sanitization: Concurrently cleared
validation_blocked_until,validation_url,validation_blocked_reason, and resetquota.is_forbidden = falsewithinclear_validation_blockedinmodules/account.rs, relaxing cleanup guard conditions to eradicate circular lockout states caused by residual flags after manual unblocking. (PR #3651, Fixes #3630, Thanks to @modded-soldier-9) - Comprehensive Quiet Startup Arguments Support: Expanded
apply_login_launch_policyCLI parameter checks to detect--silent,--hidden,-s, and/minimizedin addition to--minimized, enabling seamless background tray launch from Windows Task Scheduler, batch scripts, and desktop shortcuts. (PR #3651, Fixes #1411, Thanks to @modded-soldier-9) - Self-Healing Missing storage.json on Clean Install Profile Switching: Enhanced
get_storage_pathandwrite_profileinmodules/device.rsto automatically create parent directories and initialize fresh device profile configurations when IDE directories exist without a pre-generatedstorage.json, eliminatingstorage_json_not_founderrors on initial switch. (PR #3651, Fixes #3270, Thanks to @modded-soldier-9) - Dual Codex / ChatGPT CLI Directory Synchronization: Accommodated path alterations following Codex's rebranding to ChatGPT, seamlessly synchronizing configuration files whenever
.chatgptand.codexdirectories exist concurrently or individually. (PR #3651, Fixes #3275, Thanks to @modded-soldier-9) - Admin Server Hot Configuration Sync: Extended
save_configincommands/mod.rsto hot-reload model filtering, proxy policies, and circuit breaker settings foradmin_server.axum_server, ensuring proxy rules take immediate effect even when running the management dashboard standalone. (PR #3651, Fixes #3280, Fixes #3285, Thanks to @modded-soldier-9) - Extended Linux RPM Installation Path Detection: Added standard
/usr/lib64and/usr/libpaths to Linux IDE executable detection inmodules/process.rsfor Fedora, openSUSE, and RHEL distributions. (PR #3651, Fixes #3260, Thanks to @modded-soldier-9)
- Full HTTP / Headless API Metadata Serialization: Fully supplemented
- [Token 统计「总览看板」与「深度洞察」视界接入、全链路思考量 (Thinking) 统计与全景深色主题统一]:
- 全链路思考量 (Thinking / Reasoning Tokens) 统计支持:
- 后端与存储全量对齐: 代理层(
proxy_db与token_stats数据库)全面扩展reasoning_tokens字段并支持平滑迁移,在 SSE 流式及非流式响应中自动从usageMetadata与各协议返回中提取模型深度思考 Token 消耗并持久化。 - 全维度聚合与查询支持: 小时/天/周/全部历史、账号维度与模型维度的统计接口均扩展思考量聚合,提供精确的思考 Token 规模及均次思考指标支持。
- 总览看板深度集成: 「用量调度全景」卡片常驻呈现思考 Token 专属紫色指标与输出占比(
思: XX (YY%)),下半区「效能指数 · J23」标题栏同步展示单次请求思考量密度(~XX 思 / req),全 12 国语言无缝支持。
- 后端与存储全量对齐: 代理层(
- 「总览看板」全新视界与体验调优: 新增「总览看板」模式,集成 360° 辐射彩针发光仪、核心模型生态分布、24 小时律动立柱、J23 效能刻度仪表与活跃账号排行榜;支持单模型高亮聚焦与交互联动。
- 深色主题背景与组件层级统一规范: 彻底清除硬编码深色背景(
dark:bg-[#0a0a0c]、dark:bg-[#121316]、dark:bg-[#1c1c1e]等),全面统一对齐系统全局设计规范(卡片容器dark:bg-base-100、药丸与分段控制器dark:bg-base-200、边框dark:border-base-200/300),完美消除粘性导航栏与页面接缝色差,统一经典看板与新看板的明暗调性。 - Token 统计全 12 种多国语言完备支持: 全量同步并补齐
token_statsi18n 键值至所有 12 种语言本地化文件(包含英语、西语、俄语、阿语、日语、韩语、葡语、土耳其语、越南语、缅甸语及简繁中文),解耦自然周周数格式化硬编码。 - 图表 Tooltip 与价格配置弹窗暗色调谐: 优化趋势图/饼图浮层 Tooltip 与模型自定义价格配置弹窗(
PricingModal)在深色模式下的底色透明度、输入框及重置按钮对比度,保证全局交互体验自洽舒适。
- 全链路思考量 (Thinking / Reasoning Tokens) 统计支持:
- [智能多维调度增强:周配额临期优先、零配额长对话无感迁移、跨模型隔离与 Claude 压缩自愈加固] (PR #3640, PR #3641, PR #3642, PR #3644, PR #3645, PR #3647, PR #3650, Thanks to @modded-soldier-9, @cubelikeplayDaniel):
- 周配额临期优先调度算法 (EDF / Use-It-Or-Lose-It): 从账号配额详情中精准提取 Google 7d/weekly 桶配额重置时间戳,在多账号调度与 P2C 随机选号中引入最早截止时间优先规则(Priority 0.5)。当账号处于临期窗口(周配额 <= 24h 或 5h 滚动配额 <= 2h 且额度 > 0%)时赋予优先调度权,在被 Google 周期重置前优先消耗释放,彻底根除高配额优先策略导致的临期剩余资产白白作废清零问题。 (PR #3645, Fixes #549, Ref #900, Thanks to @modded-soldier-9)
- 持续会话与固定账号零额度无感自动迁移: 在粘性会话(Sticky Session)与固定优先账号(Preferred Account)选号阶段增加前置配额感知。当绑定账号的目标模型配额降至 0% 且号池存在具备正配额的健康账号时,立即原子解绑并在选号完成后原子重绑新会话,避免继续死锁复用 0% 账号导致客户端碰壁报错中断,保障多轮 Agent 编程持续顺畅。 (PR #3642, Fixes #3639, Ref #3509, Thanks to @modded-soldier-9)
- 配额重置时间跨模型精准隔离: 彻底重构
get_quota_reset_time与fetch_and_lock_with_realtime_quota。增加模型名称归一化精准匹配门禁,仅当目标模型实际配额耗尽 (percentage <= 0) 时才提取长周期重置时间;当额度充足的模型遭遇并发 429 时,坚决拒绝盗用账号内其他耗尽模型(如 Claude Opus)数十小时的重置时间,平滑回退至秒级指数退避阶梯,根除误报 503 调度受限与号池假死。 (PR #3640, Fixes #3627, Thanks to @modded-soldier-9) - Google Imagen 3 微间隙原地 GraceRetry 与限流队列救援: 针对生图模型上游 429 短周期重置延迟(通常约 1.17s),在多账号第 1 轮调度中引入微间隙优先原地自愈机制(
delay <= 2500ms原地等待重试),彻底根除 50ms 盲目快切在 300ms 内遍历打穿全池导致全军覆没的缺陷;同时在get_image_token中引入限流冷却预算救援,只要请求超时预算充足自动等待瞬态冷却后重试,生图成功率大幅提升。 (PR #3641, Fixes #3329, Fixes #3409, Thanks to @modded-soldier-9) - Claude Cowork 深度压缩状态机与接续标记穿透加固: 将压缩后接续免死租约滑动窗口(
COMPACTION_IMMUNITY_WINDOW_SECS)进一步放宽调优至 90 秒,稳固覆盖慢推理思考与超长耗时 MCP 工具链,彻底消除 Double-400 假报警死循环;将接续标记扫描深度拓展至前 5 轮消息,穿透多轮<system-reminder>与环境详情块稳定捕获摘要标记,并补齐/compact.与/compact <args>命令变体。 (PR #3644, PR #3647, Ref #3576, Thanks to @modded-soldier-9, @cubelikeplayDaniel) - Claude Code 会话用量缩放隔离与原生 95% 自动压缩探针自愈: 统一抽离
is_code_mode精准识别 Claude Code CLI 与 Desktop Code Tab;在开启enable_usage_scaling时对 Code 模式强制旁路缩放以如实反馈物理 Token 消耗,杜绝因缩放后虚假低用量麻痹客户端探针导致永远无法触碰 95% 自动压缩水位线、进而在超限后突发断连报错的问题。 (PR #3650, Fixes #867, Fixes #1066, Fixes #1079, Thanks to @cubelikeplayDaniel)
- [Gemini 思考档位别名规范化与防空转标点惰性降级] (PR #3646, PR #3649, Fixes #3629, Ref #2208, Thanks to @ThermalEng, @modded-soldier-9):
- Pro 系列思考档位别名规范化为上游真实 ID: 统一复用模型兼容映射表,确保裸模型
gemini-3.1-pro在high、medium回退或缺省路由阶段派生出的公开别名,以及显式指定的gemini-3.1-pro-high别名,均统一规范化映射至上游真实物理模型 IDgemini-pro-agent,彻底修复直接向上游请求gemini-3.1-pro-high导致的400 INVALID_ARGUMENT报错。 (PR #3646, Ref #2208, Thanks to @ThermalEng) - Gemini 空轮次保底垫片降级为惰性标点: 将通用防御层
ensure_gemini_payload_ends_with_user中针对空文本/无实质内容用户轮次的保底填充文本(TRANSIT_DEFENSE_FALLBACK_TEXT)由口语短句"ok go on"彻底降级为中性惰性标点"."。在完全满足 Google Gemini 协议parts非空校验的同时,杜绝被 AI Agent(如 Cline、Claude Code、OpenCode 等)误判为人类明确授权指令,根治人机安全确认门禁被击穿与上下文死循环缺陷。 (PR #3649, Fixes #3629, Thanks to @modded-soldier-9) - 零思考预算严格关闭上游思维链与面板软偏好特性释义: 在进站流水线中,当用户显式配置或自适应极速压缩至 0 思考预算时,严格双向注入
includeThoughts: false与thinkingBudget: 0,对齐官方抓包协议规范彻底断绝思维链;并在设置面板与全 12 国语言中明晰标注 Google Gemini 上游将 thinkingBudget 视为启发式软偏好(Soft Target)之自适应特性,杜绝长 Prompt 深思场景下的误解。 (Ref #3648)
- Pro 系列思考档位别名规范化为上游真实 ID: 统一复用模型兼容映射表,确保裸模型
- [修复 HTTP API 验证字段丢失、静默启动支持、storage.json 缺失自愈与管理端热同步] (PR #3651, Fixes #3631, Fixes #3630, Fixes #1411, Fixes #3270, Fixes #3275, Fixes #3280, Fixes #3260, Thanks to @modded-soldier-9):
- HTTP / Headless API 元数据字段全量补齐: 在
modules/http_api.rs的AccountResponse中全面补充validation_url、validation_blocked*、priority、disabled*、proxy_disabled*与protected_models等全量元数据字段,彻底消除前端与第三方 API 消费者的死代码,确保外部集成与无头面板可无缝获取解封验证链接与全景状态。 (PR #3651, Fixes #3631, Thanks to @modded-soldier-9) - 账号验证封禁彻底自愈清理: 在
modules/account.rs的clear_validation_blocked中同步清空validation_blocked_until、validation_url、validation_blocked_reason并彻底重置quota.is_forbidden = false,放宽清理防护判据,彻底根除手动解封后因残留脏标记导致的环形锁死问题。 (PR #3651, Fixes #3630, Thanks to @modded-soldier-9) - 开机静默启动参数全面支持: 为
apply_login_launch_policy增加--silent、--hidden、-s与/minimized等常用命令行参数检测,支持 Windows 计划任务、批处理或快捷方式传入参数时静默启动至托盘。 (PR #3651, Fixes #1411, Thanks to @modded-soldier-9) - 全新安装初次切号 storage.json 缺失自愈: 在
modules/device.rs的get_storage_path与write_profile中,当全新安装的 Antigravity IDE 尚未生成storage.json时自动递归创建目录并初始化设备指纹配置,彻底根治初次切号报storage_json_not_found错误。 (PR #3651, Fixes #3270, Thanks to @modded-soldier-9) - Codex / ChatGPT CLI 目录双向同步兼容: 适配 Codex 更名为 ChatGPT 后的配置路径变化,当
.chatgpt与.codex目录同时或单独存在时执行双向全量同步。 (PR #3651, Fixes #3275, Thanks to @modded-soldier-9) - 管理服务 (Admin Server) 配置同步热更新: 在
commands/mod.rs的save_config中,当用户保存配置时同步热更新admin_server.axum_server的模型过滤与代理策略,确保仅运行管理后台时修改配置即刻生效。 (PR #3651, Fixes #3280, Fixes #3285, Thanks to @modded-soldier-9) - Linux RPM 发行版安装路径补充: 在
modules/process.rs的 Linux 安装路径探测中补充 Fedora / openSUSE / RHEL 规范的/usr/lib64与/usr/lib路径。 (PR #3651, Fixes #3260, Thanks to @modded-soldier-9)
- HTTP / Headless API 元数据字段全量补齐: 在
What's Changed
- fix(proxy): 修复配额重置时间跨模型污染导致额度充足时误报 503 调度受限 (Fixes #3627) by @modded-soldier-9 in #3640
- fix(image,proxy): 优化 Imagen 3 微间隙原地 GraceRetry 与限流冷却队列救援 (Fixes #3329, Fixes #3409) by @modded-soldier-9 in #3641
- feat(proxy): 支持持续会话与固定账号零额度无感自动切换 (Fixes #3639, Ref #3509) by @modded-soldier-9 in #3642
- fix(cowork,compact): 加固 Claude Cowork 深度压缩状态机与接续标记穿透识别 (Ref #3576, RFC Deep Compact) by @modded-soldier-9 in #3644
- feat(proxy): 引入周配额临期优先调度算法 (EDF / Use-It-Or-Lose-It),防止周期重置作废剩余额度 (Fixes #549, Ref #900) by @modded-soldier-9 in #3645
- fix(defense): 将 Gemini 空轮次保底垫片调整为惰性标点,根治 AI Agent 确认状态机被 'ok go on' 劫持缺陷 (Fixes #3629) by @modded-soldier-9 in #3649
New Contributors
- @modded-soldier-9 made their first contribution in #3640
Full Changelog: v4.9.7-beta.7...v4.9.7-beta.8