Skip to content
View sumitsuke's full-sized avatar

Highlights

  • Pro

Block or report sumitsuke

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Content in all repositories owned by your account will be closed.
Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
sumitsuke/README.md

Sumitsuke

サイト → sumitsuke.jp(受託開発・検証の案内と、実験の記録 Lab)/記事: ZennQiita

AI生成コード・外注コードの検証・監査(再現 → 原因 → 修正 → 検証ログ)と、 Rust/Tauri による Windows local-first デスクトップアプリ開発をしています。

Verification & audit of AI-generated code (reproduce → root-cause → fix → verification logs), and Windows local-first desktop apps in Rust/Tauri.

ご相談はこちら → sumitsuke.jp/works/contact/(テキスト完結・通話なし)


何を依頼できるか

  • AI生成・外注コードの検証・監査 — 症状の再現を試み、原因(または原因候補と除外できた原因)を特定し、修正し、実行ログ・テストで再確認するまでを一続きで行います。AIの回答だけで判断せず、実際の実行結果を基準にします。
  • 不具合の根本デバッグ — 「計算される値 ≠ DBに保存される値 ≠ 読み取り時の値」のような多層にまたがるバグの往復トレースと根治。
  • Windowsデスクトップアプリ開発 — Rust/Tauri + React/TypeScript。データを外部に送らない local-first 設計。

自社開発: AXIOM(クローズドβ)

測定系の Windows デスクトップアプリを、設計から配布構成までソロで開発しています。現在クローズドβ(v0.2.0-beta.2)。 → getaxiom.dev

  • Rust 約77,000行 + React/TypeScript 約40,000行(本体のみ)
  • テスト約3,200件を release 実行で全PASS(2026-06-23、実行ログで確認)
  • SQLite + アプリ層 AES-256-GCM のローカル暗号化データ層/Rust⇄TS を 102 IPC・自動生成型バインディング(ts-rs)で接続
  • 外部通信は許可リスト制で、許可外の送信経路の追加をCIがビルド失敗で止める(宣言をコードで強制)

AIコーディングを実装に多用しつつ、AIの出力を鵜呑みにしない検証規律を敷いています。実際に検出・修正した AI 起因の欠陥(いずれも commit で検証可能):

  • 存在しない学術引用の混入を検出し、測定挙動を変えずに除去
  • 「ハッシュ列の書き換えと再ハッシュが別トランザクション」という多層整合性バグを、1トランザクションへのアトミック化で根治
  • 失敗を握り潰すフォールバックの増加・型ずれ・送信経路の無断追加を、AIの失敗モードを狙い撃つ自作CIゲート(anti-dummy-scan / outbound-network-guard / bindings-drift-gate)で再発防止

※ クローズドβのため、利用者数・本番運用スケールは主張しません。

公開している検証成果物

再現可能な実測・監査の公開リポジトリ(ピン留め参照):

  • llm-audit-nondeterminism — 同じコードをローカルLLMにN回監査させたときの指摘の揺れ(反復非決定性)と多数決の落とし穴を実測する再現キット
  • free-tier-vectordb-bench — 無料枠だけで4つのベクトルDBへ同一RAGを流し、品質・レイテンシ・律速ユニットを再現可能に実測するハーネス
  • zenn-content — Zenn掲載の実測記事の原稿・図(GitHub連携)

数値は実測のみ。検証していない数字は書かない方針です。

対応技術

Rust / Tauri ・ React / TypeScript ・ SQLite ・ Windows local-first(ローカル保存・外部送信最小)

診断レポート見本

不具合診断の納品形式(再現確認・原因・影響範囲・修正方針を2〜4ページに整理)の見本があります。自社開発アプリを題材にしたサンプルで、顧客案件の実績ではありません。ご相談時にご覧いただけます。

相談先

sumitsuke.jp/works/contact/ — 診断・修正・開発のご相談はこちらから(テキスト完結・通話なし)

Pinned Loading

  1. llm-audit-nondeterminism llm-audit-nondeterminism Public

    同じコードをローカルLLM(Qwen2.5-Coder/Ollama)にN回監査させたときの指摘の揺れ(反復非決定性)と多数決の落とし穴を実測する再現キット。二層再現:生成ログ凍結+決定的集計。

    Python

  2. llm-nayose-matching llm-nayose-matching Public

    Pre-registered study: does an LLM's two-stage self-review improve Japanese footballer name matching vs an independent re-run? (A/B/C on gpt-5.4-mini)

    Python

  3. serverless-db-bench serverless-db-bench Public

    東京から無料枠サーバレスDB(Cloudflare D1 / Turso / Neon)のcold/warm・接続・wakeを分解実測するハーネス+東京実測データ・図。数値は実測のみ。

    JavaScript

  4. ai-silent-defect-scanner ai-silent-defect-scanner Public

    How a local OSS LLM handles failure-prone I/O, and why 'silent swallow' vs legitimate fallback can't be adjudicated by syntactic pattern-matching alone (candidates: machine; adjudication: human). M…

    Python