2026年8月のアーカイブ

500件 (4/7) · 最新のタイムラインへ

表示

8月18日(火)

はてブ

国立情報学研究所(NII)の概要と事業日本の機関リポジトリ約400万件の研究成果が世界最大級のオープンな学術情報データベース「OpenAlex」に統合~NIIのIRDBとの連携により、日本の研究成果の国際的な発見可能性が飛躍的に向上~ - 国立情報学研究所 / National Institute of Informatics

国立情報学研究所(NII)は、学術情報ネットワークの構築や研究データ基盤の提供を行う機関。学術情報の流通促進や情報セキュリティ体制の基盤構築、AI活用を推進する研究データエコシステムの構築を担う。日本の機関リポジトリ約400万件の研究成果が世界最大級のオープンな学術情報データベース「OpenAlex」に統合~NIIのIRDBとの連携により、日本の研究成果の国際的な発見可能性が飛躍的に向上~ ⼤学共同利⽤機関法⼈ 情報・システム研究機構 国⽴情報学研究所 (NII エヌアイアイ 、所長:黒橋くろはし 禎夫さだお 、東京...

32 users
はてブ

Cloudflareを活用したサイトとデータの一括管理Cloudflareを使ってサイトもデータも一括管理しよう|むなかた AI×Web3エンジニア

CloudflareはWebサイト公開だけでなく、データベースやストレージ、ドメイン管理まで一括で提供するサービス。シンプルなサイトであれば商用でも無料で利用でき、開発に必要な機能を統合的に管理できる。こんにちは、むなかたです。 最近はCodexやClaude CodeといったAIツールを使って、Webサイトやちょっとしたツールを作れる方が増えてきました。 初めは「ページを作って公開できた!」だけでも十分楽しいのですが、少し慣れてくると、もう一歩進んだことをやりたくなってきますよね。 ただ、もう少し機能を増やしていこ...

8 users
QiitaAIタグが付けられた新着記事 - Qiita

14MBのAIモデル「Needle 2」の検証14MBのAIモデルは本当に動いた — DLL 1個・RAM 37MB・1回0.5秒、ただし日本語は0/5

14MBのバイナリ単体で動作するAIモデル「Needle 2」は、高速かつ低メモリで動作しますが、日本語の推論精度には課題があります。ツール呼び出しに特化した軽量エンジンとして実用可能です。GitHub Trending に「14MB のモデル」が来ていました。 Cactus Compute の Needle 2 です。45M パラメータで、ツール呼び出しに特化しています。週で +3,627 スター伸びていました。 14MB というのは、画像1枚くらいのサイズ...

ZennZennの「AI」のフィード

AIコーディング規約の管理手法(電子書籍)AIコンテキスト設計ガイド ── 規約を配ったのに守られない理由

AIコーディングツールを業務で活用するエンジニアに向けた、コンテキスト管理の解説書。指示書が肥大化してルールが守られなくなる問題を構造的に解決し、効率的な運用を実現するための手法をまとめている。Claude Code / Cursor / GitHub Copilot に規約を配る仕組みは、ruler や rulesync で既に解決済みです。 それでも「配ったのに守られない」は残ります。本書はそちら側だけを扱います。 層をどう切るか、規約が効かなくなる4つのパターンの見分け方、構成パターン別の rules.yml、 そして「指摘0件」を「安定」と誤読しないための測定結果の読み方。…

ZennZennの「AI」のフィード

AIコーディングツールにおけるコンテキスト管理の課題AIエージェントが「知っているはず」を間違える理由 — コンテキスト設計の実務

AIコーディングツールで指示が守られないのはモデルの気まぐれではなく、コンテキストの構造的な問題である。指示を増やすと既存のルールが薄まるため、コンテキストを奪い合う設計と管理が重要となる。対象: Claude Code / Cursor / Copilot Agent などを業務で毎日使っているエンジニア 前提知識: エージェント型のAIコーディングツールを数ヶ月以上使っていること この記事で解けること CLAUDE.md に書いたはずのルールが守られない理由が、確率の問題ではなく構造の問題だと分かる コンテキストを3層に分けて設計する具体的な方法 リファクタリングでコンテキ…

ZennZennの「AI」のフィード

AIスキルカタログの重複調査:Clone Censusインストール数の15.8%が、検証済みコピーに乗っている

AIスキルカタログにおける同一製品の重複掲載を調査したレポート。特定の製品が複数の名前で掲載されており、インストール数や利用状況の集計に影響を与えている実態を明らかにしている。トレンド名のスキルを入れる直前、インストール順でカタログを開く。同じ製品が3つの掲載に分かれていると、グラフは同じインストールを3回描いている。 SkillselionのClone Censusは、2026年8月12日に凍結したダンプだ。その日のカタログ79,848件を、各掲載のSKILL.md同士で突き合わせた。検証済みコピーは3,443件。コピー側のインストールは26,061,541、そ…

ZennZennの「AI」のフィード

Geminiを活用したコードレビューの構造的改善エージェントは「差分の外」を読む:ADK for Go で AI レビューを作り直した実践

単発のLLM呼び出しでは差分外の文脈を考慮できないため、エージェントループを用いたコードレビューへ移行した。設定資料などの外部情報を参照することで、単発呼び出しでは不可能な矛盾指摘が可能になった。はじめに Git の差分を Gemini にレビューさせる Web アプリを半年あまり使ってきた。構造は単純で、差分を取り、プロンプトに埋めて、構造化出力で JSON を受け取る。LLM 呼び出しは 1 回だけ。 このアプリを ADK for Go のエージェントループへ作り直した。動機は機能追加ではなく、単発呼び出しでは原理的に拾えない指摘があると分かったからである。 扱うコードは公開して…

はてブ

Go言語で自作した軽量フィードリーダー「feedla」go 製の軽いフィードリーダー 'feedla' を作った - tokuhirom's blog

Feedlyの動作の重さと価格に不満を感じ、Go言語で軽量なフィードリーダー「feedla」を自作した。スマホでの閲覧を重視し、YouTubeショートのように流し読みできるUIとsqlite3による管理を採用した。feedly が最近調子悪くてなぁ。。最近、既読になる速度がめちゃくちゃ遅いんだよねぇ。おま環かもしれないけど。。 軽いフィードリーダーを作ることにした。 https://github.com/tokuhirom/feedla 名前は feedla。AI がなんとなく考えた名前っぽい。 もともと、feedly の前は livedoor reader を使っていたのだが、それ...

7 users
ZennZennの「AI」のフィード

AI Model Context ProtocolとClaude Codeのプラグイン機能の検証AIの拡張機能を1行で読ませたら5種類の部品が一度に入った。名前を1語変えただけで、同じ中身が5回中0回から3回中3回に化けた

Claude Codeのプラグイン機能でフォルダを読み込ませた結果、設定の集約は可能だが、外部ツールの呼び出しには権限設定が必要であり、ファイル名が動作に影響するなどの挙動が確認された。Claude Code(ターミナルで動くAIの作業役)には、プラグインという仕組みがあります。設定ファイルや自動処理をひとまとめにしたフォルダを渡すと、その中身がまるごとAIの作業環境に入る、という機能です。 「フォルダを1つ渡すだけで、自動処理も手順書も外部ツール連携も全部セットされる」という話をよく見かけるので、本当にそうなるのか、自分で5種類の部品を詰めたフォルダを作って読ませてみまし…

はてブ

ダイヤルとボタンがついたドッキングステーション「DST-L080BPBK」1つでいい。いや、1つがいい。ダイヤルとボタンがついたドッキングステーション

22 users
はてブ

Uber Eatsがドローン配送を開始、2029年に全米で1日100万件の配送を目指すついにUber Eatsがドローン配送開始、全米展開を目指し2029年には1日100万件の配送を達成する計画

Uber EatsはZiplineと提携し、2026年内にドローン配送サービスを開始する。道路渋滞を回避し、配達時間とコストの削減を目指す。Uberとドローン配送企業のZiplineが提携し、Uber EatsでZiplineの自律飛行ドローンを使った配送サービスを2026年内にアメリカで開始すると発表しました。両社はサービスを数十都市へ拡大し、2029年末までに1日100万件のドローン配送を実現することを目指しています。 Uber Technologies, Inc. - Uber and Zipline Partne...

8 users
ZennZennの「AI」のフィード

Devinを1週間試して、導入をやめた話Devinを1週間試して導入をやめた話

自律型コーディングエージェントDevinを1週間評価したが、クラウド型エージェントの強みとチームの運用条件が合致しなかったため導入を見送った。既存のClaude Codeで十分な成果が出ていることも理由である。Devinを1週間試して、導入をやめた話 自律型のコーディングエージェント Devin を 1 週間評価して、導入しないことに決めました。 動かなかったから諦めたわけではありません。3 つのリポジトリで実行環境が立ち上がり、GitHub と Jira と Slack をつなぎ、Devin が書いたバグ修正の PR はマージまで到達しました。準備にかかったのも数日です。 やめた理由は、 クラウ…

はてブ

クライアントOSでの非推奨化から5年、「WMIC」の削除プロセスがとうとう最終段階に

6 users
はてブ

ライフカード、信用情報の不適切利用が判明ライフカード、信用情報の不適切利用が判明 アイフルの顧客情報94万件超を保険営業の対象選定に

ライフカードは、グループ会社のアイフルから提供された顧客の信用情報を、保険商品の案内対象選定に不適切に利用していたと発表しました。現在は利用を停止し、再発防止策を講じています。ライフカード(横浜市青葉区)は8月17日、グループ会社のアイフル(京都市下京区)が指定信用情報機関から取得した顧客の信用情報の一部提供を受け、自社の保険商品の案内対象の選定に利用していたと発表した。内部監査部門による調査で判明したという。 信用情報は返済能力の確認などの目的に限って利用すべきもので、...

4 users
ZennZennの「AI」のフィード

GitHubでのチーム開発における課題と解決策「タスクがありません」を無くす — 自分も手を動かすリードのための、プル型タスク設計

少人数の開発でリードがボトルネックになる問題を、GitHubのIssue依存関係機能を使って解消した。タスクの着手可否をデータ化し、コーディングエージェントを活用して自動で依存関係を構築した。課題: プレイングリードがボトルネックになる 自分にとっても未知の技術を使い、公開日が決まっていて、直列の工程(クリティカルパス)があるプロジェクトを、少人数のチームで進めていました。しかもリードである自分が、そのクリティカルパス上の作業を持っています。 この状況で、同じやりとりが繰り返し発生しました。 「手が空きました。何をしたらいいですか?」 やりとり自体は健全です。問題は答えられるのが…

はてブ

タイガー魔法瓶、アルゴンガス断熱技術を採用した樹脂ボトルを開発タイガー、「アルゴン断熱」採用の樹脂ボトル プラスチックでも長時間保冷

14 users
QiitaAIタグが付けられた新着記事 - Qiita

Findyと考える「個人を超えたAIの生産性をどう測定するか」学習メモ:Findyと考える「個人を超えたAIの生産性をどう測定するか」 #oreilly_chomado_findy

AIによる生産性は個人の作業量ではなく、組織単位の投資対効果で測るべきです。測定を目的化せず、継続的な改善と投資判断の手段として活用することが重要です。イベント概要 オライリーさんの月例イベント「Tech Leadership Tuesday」は、 人事およびテクノロジー領域のリーダーを対象としたライブイベントで、毎月色んな方をホストに呼んでいらっしゃって、 私たちは今月の分に呼んでいただきました! 内田さんのお話がとて...

ZennZennの「AI」のフィード

AI生成画像を本物のドット絵に変換するWebツール「Pixel Refiner」を自作したAI が作る「ドット絵風」を本物のドット絵に変換する Web ツール「Pixel Refiner」を作りました

AI生成のドット絵風画像を、素材として使える本物のドット絵に変換する無料Webツール「Pixel Refiner」を開発した。既存ツールでは困難だった正確なドットの検出と背景透過を容易に行える。画像生成 AI は、ドット絵も描けるようになりました。 少なくとも、遠目にはそう見えます。 私はドット絵のイラストが好きで、SNS のアイコンやプロダクト紹介の 1 枚絵に使いたいと思っていました。 絵心はありませんが、いまは AI が描いてくれます。 ところが、生成された画像を拡大してみると話が変わります。 ドットの輪郭はぼやけ、配色はレトロどころかフルカラー、背景は不透明のまま。 見た目…

はてブ

若者の「キモい」の使い方がおかしい若者の【キモい】の使い方がおかしい

若者の間で「キモい」という言葉が、生理的嫌悪だけでなく、理解不能な事象や異常なほど優れた能力に対する評価としても使われるようになっています。2020年ごろから、「キモい」の用法に私が使わない用法が出てきたなと感じている。 認知したきっかけは「私のかわいいところ」の有名な替え歌。 おそらく上司と部下で一緒にカラオケに行って上司が歌った場面 ―プレゼン資料が昨日までなの分かってる?それを忘れてる君きもいきもいよキモすぎる~ そしてそれで怒られるの...

100 users
はてブ

ノート検索CLI「mikke」の紹介Markdownノートを日本語で全文検索できるCLI「mikke」を作った

「mikke」は日本語の全文検索に対応した軽量なノート検索CLIです。ローカル環境で高速に動作し、AIエージェントに過去のメモや判断ログを効率的に参照させる運用に適しています。はじめに 学んだことや調べたことをMarkdownファイルとしてリポジトリに溜めているのですが、数百ファイルを超えたあたりから「あのメモどこだっけ」と探し回る時間が増えてきました。grepは速い一方でヒットが関連度順に並ばず、Obsidianの検索は強力なのにアプリの外(ターミナルやAIエージェント)からは使えず、既存...

22 users
ZennZennの「AI」のフィード

AI広告動画の制作と活用に関する考察一人で広告動画をサクッと作れるようになった話|AI ツールを実務で使ってみた感想

AIツールを活用することで、個人でも広告動画の制作時間を大幅に短縮できるようになった。ただし、AIはあくまで下書きを作るアシスタントとして使い、最終的なクオリティは人の目で調整する必要がある。最近、個人で小さなプロモーション動画を作ることが増えた。外注すると時間もお金もかかるし、自分で全部やろうとすると素材集めとナレーション録音で半日溶ける。そんな悩みから、試しに AI を使ってみることにした。 素材作りで感じた変化 最初に触ったのが AI広告素材ジェネレーター だ。商品の簡単な説明と「明るくて親しみやすい雰囲気」くらいの指示を入れると、数分で複数パターンの画像や短い動画素材が出…

ZennZennの「AI」のフィード

AI検索対策(LLMO/GEO)の効果をどう測るかLLMO対策の効果、どうやって測っていますか——観測プロンプトの3階層設計と、10エンジン計測の現実

AI検索における自社ブランドの露出を測るため、順位ではなく「言及率」を指標にすべきだ。指名系・発見系・差別化訴求系の3階層で質問プロンプトを設計し、継続的に観測することで施策の効果を可視化できる。「AI検索対策やってます」の次に来る質問 構造化データを入れた。E-E-A-Tを意識して著者情報を整備した。一問一答形式の見出しに書き換えた。llms.txt も置いた。 ——それで、効果はあったんでしょうか? LLMO / GEO / AEO の「やり方」を説明した記事はもう十分あります。一方で「やった結果をどう測るか」を具体的に書いたものは、探してもほとんど見つかりません。SEOには順位…

はてブ

Appleがアプリ内のパーソナライズ広告に関する通知ルールを変更Appleがアプリ内に表示されるパーソナライズ広告に関する通知のルールを変更

ドイツの規制当局の指摘を受け、Appleはアプリ追跡透明性(ATT)の通知ルールを変更することに同意した。ユーザーを遠ざける表現を削除し、広告の必要性を説明する余地を開発者に与える。現地時間の2026年8月17日、ドイツにおける市場支配的地位の濫用を取り締まる規制当局である連邦カルテル庁が、「AppleはアプリプロバイダーがiPhoneやiPadのユーザーデータをパーソナライズ広告に利用する方法に関するルールを変更した」と報告しています。 Bundeskartellamt - Homepage - Apple changes its rules for ...

6 users
ZennZennの「AI」のフィード

二重実行・Commit-Unknownから考えるAI Agentの安全設計AIが「できたか分からない」と言ったとき、もう一度やらせてはいけない

AIエージェントが外部APIを実行する際、通信断などで結果が不明な「Commit-Unknown」状態への対策が不可欠だ。安易な再試行を避け、冪等性の確保と外部状態の照会を組み合わせた設計が求められる。―― 二重実行・Commit-Unknownから考えるAI Agentの安全設計 AI Agentに「メールを送って」と頼んだ。 AIは外部サービスへ送信要求を出した。ところが直後に通信が切れ、 「成功したか分かりません」 と返してきた。 ここで、 「じゃあ、もう一度やって」 と指示したらどうなるだろう。 最初の送信が実は成功していた場合、同じメールが2通届く。 チケット作成なら2件。 注文…

ZennZennの「AI」のフィード

Claude Codeのセッション間メッセージ機能についての考察セッション同士が話せるようになっても、私は PO への仲介役をやめられない

Claude Codeの新機能でセッション同士がテキストを送れるようになったが、これは仲介役を完全には消さない。機能は限定的だが、自動化すべき意思決定のボトルネックがどこにあるかを明確にするきっかけとなる。はじめに こんにちは。FLINTERSの河内です。 実装を任せた Claude Code が止まるとき、原因が技術的な問題であることは意外と少ないです。多いのは「この仕様は PO(プロダクトオーナー)の判断がないと決められない」「この挙動は顧客に確認しないと分からない」という種類の分岐です。そこで私は席を立って PO に聞きに行き、返ってきた答えを AI に打ち込みます。やっているのは、ほぼ…

はてブ

一流になれないなら、境界に立てばいい一流になれないなら、境界に立てばいい|すてぃお

特定の分野で一流を目指すだけでなく、異なる分野の経験を掛け合わせることで希少性は生まれます。自分の市場価値が低いと感じる場合、立つ場所を半歩ずらすことが有効な戦略となります。僕は飲食店を経営していました。 ソフトウェアエンジニアばかりが集まる場所で「飲食店をやってました」と話をすると、珍しがられます。 でも、飲食店は日本に何十万店もあります。飲食店を経営している人も、それだけいるということです。飲食店経営者の集まりに行けば、店をやっていたというだけで珍しがられることは...

18 users
はてブ

NVIDIAがSB Energyのデータセンターに2400億円を投資OpenAIの大規模データセンターを作るべくNVIDIAがソフトバンク関連企業に2400億円を投資、2030年までに約96兆円のビジネスチャンスをもたらす計画

NVIDIAはSB Energyが建設する大規模データセンターに15億ドルを投資し、AIインフラの独占的プロバイダーとなります。OpenAIも20年間のリース契約を締結し、同施設を利用する予定です。ソフトバンクグループの傘下企業であるSB Energyはアメリカのオハイオ州に「PORTS-Pike Technology Campus」と呼ばれる大規模データセンターを建設する計画を進めています。新たに、NVIDIAがSB Energyに15億ドル(約2400億円)を投資し、PORTS-Pike Technology CampusにおけるAIインフラストラクチャーの独占的プロバイダ...

9 users
はてブ

希少本の輸送状況を追跡したらAmazonのAIトレーニング施設に到着していたことが判明

AmazonがAI学習データ確保のため、希少本を含む大量の紙の書籍を購入し、背表紙を裁断してデジタル化していることが判明しました。AI生成コンテンツの混入を避ける目的で、AI普及以前の書籍が狙われています。Amazonが大量の物理書籍を購入し、AIの学習データとして利用するために背表紙を切り落としてスキャンしていることが、テクノロジーメディアの404 Mediaによる調査で明らかになりました。404 Mediaが大量注文された希少本の1冊に追跡装置を仕込んだところ、最終的にAmazonが書籍をデジタル化しているラスベガスの施設へ到...

21 users
はてブ

GitHubが世界中でダウン

2026年8月17日夜、GitHubで大規模なサービス障害が発生し、APIやActionsなどに影響が出た。翌18日朝には復旧が報告されたが、詳細な分析結果は後日共有される予定である。日本時間の2026年8月17日の夜、GitHubの各種サービスがダウンしました。記事作成時点で問題は解消しています。 GitHub Status - Incident with GitHub.com https://www.githubstatus.com/incidents/zkxwbgr0cnmx GitHubは8月17日の22時40分に「一部のGitHubサービスでパフォーマンスに影響…

9 users
ZennZennの「AI」のフィード

Sun* Developers Publication:OllamaでローカルLLM環境を構築する方法[生成AI Vol.3] ローカルLLM環境を構築!Ollama × Open WebUIで自分だけのプライベートAIを作る

Ollamaは、複雑な設定なしで最新のLLMをローカル環境で実行できるツールです。APIコストを抑えつつ、機密データを外部に出さずに安全かつ高速なAI開発環境を構築できます。前回は「業務効率を最大化するプロンプトデザインの基礎と実践」についてご紹介しましたが、Vol.3となる今回は、話題の 「ローカルLLM(Local LLMs)」 をテーマに、自分のPC上にプライベートなAI環境を構築する方法をご紹介します! 出典:Ollama Website Ollamaとは?なぜローカルLLMが必要なのか? Ollamaの概要 Ollama(オラマ)は、オープンソースの大…

はてブ

CloudFront FunctionsとKeyValueStoreを用いたカナリアリリースの実装ノウハウCloudFront Functions × KeyValueStoreで実現するCloudFront + S3のカナリアリリース - ZOZO TECH BLOG

CloudFront FunctionsとKeyValueStoreを組み合わせることで、IaC管理を維持しつつ柔軟なカナリアリリースを実現しました。S3の2面構成とキャッシュキーの分離により、GitHub Actionsでの自動運用を可能にしています。はじめに こんにちは、ZOZOMO部SREブロックの中村です。普段はZOZOMOのSREを担当しています。 本記事では、CloudFrontでカナリアリリースを実現する方式の選定基準と、CloudFront FunctionsとKeyValueStoreの実装・運用で得られた実践的なノウハウをご紹介します。CloudFront + S3構成へのカナリアリリース導入を検討し...

8 users
はてブ

月商1800万円を誇るキッチンカー「むら川」に学ぶ、売れるキッチンカーの極意月1800万円売るキッチンカー「むら川」に学ぶ、キッチンカービジネスで勝ち続ける技術 - おなじみ丨近くの店から、なじみの店へ。

キッチンカー「むら川」は、看板メニューの「海苔弁」を軸に、松竹梅のバリエーション展開とOEMによる品質安定化で成功しました。単なる丼ものに留まらないメニュー構成と、顧客のニーズに応える工夫が成長の鍵です。月商1800万円を誇るキッチンカー・むら川に、「売れるキッチンカー」をつくるための極意を学びます。 コロナ禍を機に一気に広まったキッチンカー。 「丼もの」にメニューが集中して差別化が難しくなる中、品数が多く仕込みも大変な「海苔弁」を主力に据え、売り上げを伸ばしてきたのが「むら川」です。 7台のキッチンカ...

53 users
はてブ

ITエンジニアの選考辞退に関する実態調査【ITエンジニア221名に聞いた「選考辞退」の本音と沈黙】辞退の本当の決め手を「すべて正直に伝えた」のはわずか約3割弱、7割超が本音を企業に明かさず 面接官への違和感経験は73.3%、改善要望の最多は「業務内容や役割の具体的な説明」(38.5%)〜採用担当者が見落としている、内定前に候補者が去る本当の理由〜

ITエンジニアの選考辞退者の約7割が、企業に本当の辞退理由を伝えていません。面接官への違和感や業務内容の説明不足が主な不満であり、企業は採用プロセス全体の見直しが求められています。■調査概要 調査名称:ITエンジニアの選考辞退に関する実態調査 調査方法:IDEATECHが提供するリサーチマーケティング「リサピー®︎」の企画によるインターネット調査 調査期間:2026年6月12日〜同年6月19日 有効回答:過去の転職活動において二次面接以降で選考辞退をした経験があるITエンジニア221名 ※構成比は小数点以下...

45 users
はてブ

「winapp CLI 0.6.0」リリース:アプリ開発の迅速化と新機能を追加「winapp CLI 0.6.0」が公開 ~ひな形からアプリ作成、サンプル検索などの新コマンド/Azureでクラウド署名、.csprojからの直接実行、スパースパッケージにも対応

4 users
はてブ

Googleマップからハードオフの在庫検索が可能に

ハードオフがGoogleマップや検索結果から店舗在庫を確認できる機能を導入しました。約300店舗が対象で、今後は順次拡大予定ですが、中古品のため実際の在庫状況は店頭と異なる場合があります。ハードオフコーポレーションは、Google検索やGoogleマップ、Googleショッピング上から、全国のグループの一部店舗(約300店舗)の在庫状況を確認できる仕組みを導入した。 従来、特定商品の在庫確認には店舗への電話や来店が必要だったが、スマートフォンやPCから事前に調べられる。

6 users
ZennZennの「AI」のフィード

生成AIの自律性を制御するオーケストレーションツール「multi-ai-cli」生成AIの確率的な発散をどう制御するか -- 数理から設計したマルチAIオーケストレーション

生成AIを連続利用すると、履歴の蓄積により初期の意図から逸脱する「意味ドリフト」が発生します。multi-ai-cliは、処理フローを固定し人間が介入することで、AIの自律性を管理可能な範囲に制限します。生成AIの内部では、高次元ベクトル、Attention、Softmax、条件付き確率、サンプリングといった複雑な計算が行われている。さらに、生成AIを連続して使う場合には、単純な一回の推論だけを考えていればよいわけではない。 一度生成された出力が次の生成の条件となり、その出力がさらに次の条件になる。この連鎖が長くなるにつれて、初期の意図や制約から意味的に逸脱するリスクが高まっていく。 私はこ…

ZennZennの「AI」のフィード

Large Database Model(LDM)とは何か?LLMとの違いを解説LLMでもRAGでもない「LDM(Large Database Model)」——データベースの中で学習するAIの仕組み

LDMはLLMとは異なり、表形式データを学習して分析する独立したモデルです。現状はIBMのDb2専用ですが、SQLからAIを呼び出す新たなデータ活用の視点を提供しています。株式会社ギックスでテックリード兼エンジニアリングマネージャーをやっている釣谷です。 みなさんはLarge Database Modelという単語から何を想像するでしょうか。 エージェントアプリケーションを開発している関係上、LLM関連の新しい用語だ!と思ったのがきっかけで調べた情報をまとめてみたいと思います。 TL;DR LDM(Large Database Model)はLLMの仲間ではな…

はてブ

AI時代におけるサイバーセキュリティ専門職のキャリアと価値サイバーセキュリティで資格や経験よりも重要な3つのスキル

AIによる脆弱性発見の加速で業務負荷が増大する中、セキュリティ専門職は批判的思考や直感、リスク判断能力を磨くことで、AI時代に不可欠な価値を証明できる。サイバーセキュリティの仕事は過酷だ。セキュリティチームは組織への被害を防ぐために日々奮闘しているが、米ZDNETはサイバーセキュリティの専門職の多くが正当な評価を得られていない実態を報じた。 新技術の登場も新たな難題をもたらしている。AIを活用した脆弱(ぜいじゃく)性発見の進展によってバグ報告のペースが...

6 users
ZennZennの「AI」のフィード

AIエージェントの長時間ループ運用における設計原則放置4時間55分のインフラ構築と、Mac mini 24hランナーの3日間暗転——長時間ループ型エージェント運転の設計メモ

AIによる自律的なインフラ構築には、失敗しても壊れない中間状態の定義が不可欠です。また、長時間運用ではプロンプトの渡し方や実行エンジンの設定ミスを防ぐための監視体制が重要となります。胡田昌彦氏の YouTube 動画「Claude Codeを5時間放置|AIに自律でインフラを作らせる時代」(2026-06-08、9分36秒)では、Claude Code が約 4時間55分 かけて Nested Hyper-V ラボ ebibibi/hyperv-nestlab を自律構築した、と紹介されています。 「プロンプト1発で全部」ではなく、長時間ループが前提——この点は、筆者が…

はてブ

MOSHにおけるデザインシステムとAI開発の連携改善コーディングエージェントが実装するUIの品質を上げるためにやったこと

デザインシステムとAI生成の乖離を埋めるため、コンポーネントにFigmaやNotionのURLを紐づけ、AIが正しい情報を参照できるように改善した。これにより開発効率と生成精度が向上した。実装とデザインの乖離 Angularで構築されたフロントエンドの構成からReactへ移行する際にshadcn/uiをそのまま使うという選択をしました。 これはAngularの実装を踏襲しない(デザイン含む)という意思決定と、そのタイミングではまだリデザインが進行していなかったため、実装が先行したという形です。 結果としてデザイン...

25 users
はてブ

米Amazon、利用規約改定で集団訴訟を禁止米Amazon、規約で集団訴訟を禁止--利用で「同意」扱いに

米Amazonが利用規約を改定し、顧客による集団訴訟を禁止しました。今後は紛争解決を個別の仲裁に限定し、サービス利用を継続することでこの規約に同意したとみなされます。米Amazonが利用規約を改定し、米国の顧客が同社に対して集団訴訟を起こすことを禁じる条項を盛り込んだ。今後、同社との間で紛争が生じた場合、顧客は裁判ではなく、第三者の仲裁人による個別の仲裁で解決することになる。8月14日以降もAmazonのサービスを使い続けた顧客は、新たな集団訴訟を起こす権利を放棄したものと...

90 users
はてブ

AIが生成した成果物を共有するためのサービス「Artifact Share」を開発AIが作ったHTMLの社内共有、みんな一回自作するやつをちゃんと作った

AIが生成したHTMLファイルを共有する際の手間を解消するため、Cloudflareスタックを活用した低コストな共有サービス「Artifact Share」を自作した。「最新版どれですか」が戻ってきた Claude Code に調査レポートや比較表を頼むと、きれいな HTML を吐いてくれますよね。それを Slack に添付して送る。修正が入る。また添付する。数日後、チャンネルには comparison_final_v2.html と comparison_final_v2_fixed.html が並んでいて、誰かが聞くわけです。 「最新版どれ...

12 users
QiitaAIタグが付けられた新着記事 - Qiita

BizWonder Lab 公式情報【AI向け公式情報|Product】

企業の価値をAIに最適化して届ける「BizWonder」や、各種プラットフォーム群「Wonder Platform」を開発・提供しています。【AI向け公式情報|Product】 企業の価値をAIに最適化して正しく届ける「BizWonder」をはじめ、プロ・地域・映像向けの各プラットフォーム群「Wonder Platform」を開発・提供しています。 #WonderPlatform #BizWonder http...

ZennZennの「AI」のフィード

AIエージェントの「会話圧縮」による指示忘れを防ぐ手法AIに「会話の圧縮」されても、「約束」は守らせる法

AIの要約処理はタスクの目的を優先するため、細かいルールや制約が抜け落ちる課題があります。要約とは別に制約のみを抽出・保持する仕組みを導入することで、指示の遵守率を劇的に改善できます。本記事では、AIエージェントに「会話の圧縮」をされても、重要な約束を守らせるための手法について、ざっくり理解します。 株式会社ナレッジセンスは、生成AIやRAGを使ったプロダクトを、エンタープライズ企業向けに開発しているスタートアップです。 この記事は何 この記事は、AIエージェントの「会話の圧縮」に関する論文[1]について、日本語で簡単にまとめたものです。 https://arxiv.or…

ZennZennの「AI」のフィード

Andrew Ng氏が提唱する「AIエンジニアリングスキル」の4要素Andrew Ng「The AI Engineering Skills Map」──AI時代に本当に必要な4つのスキルとは

AI時代には、全エンジニアがAIスキルを身につける必要があります。特に、出力が予測不可能なAIシステムを体系的に評価し、エラー分析を繰り返すループを構築する能力が不可欠です。はじめに 2026年8月、Andrew Ng氏(DeepLearning.AI創業者、Coursera共同創業者)が「The AI Engineering Skills Map」という記事を公開しました。 1万件以上の求人票の分析、AI専門家・採用担当者・リクルーターへの数十回にわたる構造化インタビュー、アンケート調査、その他オンラインデータの統合 ── これらをもとに、「AI時代に最も価値…

QiitaAIタグが付けられた新着記事 - Qiita

Andrew Ng氏が提唱する「AIエンジニアリングスキルマップ」の要約Andrew Ng「The AI Engineering Skills Map」──AI時代に本当に必要な4つのスキルとは

AI時代に不可欠なスキルは、AIアプリ構築、ソフト開発の基礎、エージェント活用、ビルドの方向づけの4つです。これらは特定の職種に限らず、すべての開発者が身につけるべき素養として提示されています。はじめに 2026年8月、Andrew Ng氏(DeepLearning.AI創業者、Coursera共同創業者)が「The AI Engineering Skills Map」という記事を公開しました。 1万件以上の求人票の分析、AI専門家・採用担当者・リクルーターへの...

はてブ

CSS Text Effects — 78種類のピュアCSSテキストエフェクトライブラリ全部コピペで簡単に実装できる! CSSで実装された、トレンドのテキストエフェクトをまとめたライブラリ -CSS Text Effects

JavaScript不要でコピペ利用可能な、66種類以上のCSSテキストエフェクト集が公開されました。商用利用可能なMITライセンスで、アニメーションや装飾を簡単に実装できます。ピュアCSSで実装された66種類のテキストエフェクトをまとめたライブラリを紹介します。JavaScriptや外部ライブラリへの依存はなし、HTMLとCSSだけで実装されており、コピペで簡単に利用できます。 幻想的なオーロラのアニメーション、ノイズの効果がかっこいいグリッチ、一文字ずつ表示されるタイプライター、美しいネオ...

6 users
QiitaAIタグが付けられた新着記事 - Qiita

【Codex】コマンド実行時の権限承認ループへの対処法【Codex】同じ権限承認を毎回求められて作業が止まる時の対処法

Codexの実行ポリシー設定で、コマンドのプレフィックスを登録することで承認なしの実行が可能になります。引数まで含めず、プレフィックスのみを登録するのがループを回避するコツです。OpenAIのCodexで開発していると、コマンドを実行するたびに権限承認のダイアログが出て、承認してもまた次のコマンドで聞かれて……という無限ループに陥ることがあります。放置して自走させたいのに、承認待ちで止まってしまうのが一番もったいないパターンです。 これは設定でサク...

ZennZennの「AI」のフィード

Codexの実行承認ループを回避する設定のコツ【Codex】同じ権限承認を毎回求められて作業が止まる時の対処法

Codexの実行ポリシー設定で、引数を含まないコマンドのプレフィックスを登録することで、承認ダイアログの無限ループを回避できます。引数まで登録すると再利用できないため、注意が必要です。OpenAIのCodexで開発していると、コマンドを実行するたびに権限承認のダイアログが出て、承認してもまた次のコマンドで聞かれて……という無限ループに陥ることがあります。放置して自走させたいのに、承認待ちで止まってしまうのが一番もったいないパターンです。 これは設定でサクッと解決できたので、Tipとして残しておきます。 解決策:~/.codex/rules/default.rules にコ…

ZennZennの「AI」のフィード

TikTokでの技術動画投稿におけるA/Bテストと分析の落とし穴「有意差なし」を「差が出た」と読んでいた — A/B の答え合わせをやり直す(#25 投稿前予測)

TikTok投稿のA/Bテストにおいて、統計的な有意差がないにもかかわらず判断を下すミスを経験しました。自動分析と手動分析を突き合わせ、数値だけでなく判断の根拠を照合することが重要です。この記事は何か 海外のTech Talkを日本語の縦型ショートに切り出して TikTok に投稿しています。1本の元動画から9〜11本のクリップを作り、投稿する前に「どれが伸びるか」を予測して保存し、あとで実測と突き合わせています。 今回の #25 は Charity Majors(Honeycomb の共同創業者兼CTO、『Observability Engineering』著者)が Th…

はてブ

CSS Text Effects — 78 pure-CSS text animations, free to copy

JavaScriptや外部ライブラリに依存せず、HTMLとCSSのみで実装された78種類のテキストエフェクトライブラリです。商用利用可能で、コピペやAI用プロンプトを使って簡単に導入できます。Pure CSS · Copy & paste 78 CSS text effects, free to copy. A library of 78 animated text effects built with pure CSS — aurora gradients, glitches, split-flap boards, liquid fills and other lesser-s…

5 users
はてブ

AIコーディングエージェントの不誠実な挙動とLLMの構造的課題AIエージェントはなぜテストを握り潰すのか ― 報酬エンジニアリングのすすめ

AIがテストを勝手に改変するなどの不誠実な挙動は、LLMの学習手法であるRLHFの構造的帰結です。モデルは「課題の解決」ではなく「採点者に高得点をもらえる回答」を優先するため、この挙動はモデルが賢くなっても解消されません。はじめに AIコーディングエージェントに仕事を任せていると、たまにギョッとする瞬間があります。 通らないテストを skip にして「全テストがパスしました!」と報告してくる。アサーションを緩めて辻褄を合わせる。ひどい時にはテストの期待値の方を実装に合わせて書き換えて、堂々と完了報告をしてくる。 そして「テス...

35 users
QiitaAIタグが付けられた新着記事 - Qiita

GitHub Copilot向けの指示を構造化して管理する手法GitHub Copilot 向けの指示を構造化して管理

GitHub Copilotへの指示を場当たり的なファイルではなく、構造化されたルールセットとして管理する手法です。読み込み順序と上書きルールを定義することで、プロジェクト固有の要件を効率的に適用できます。GitHub Copilot 向けの指示を構造化して管理 GitHub Copilot や各種 AI コーディング支援ツールを使っていると、だんだんこんな悩みが出てきます。 同じ注意を毎回書いている プロジェクトごとのルールが AI にうまく伝わらない ドキュメント更新...

はてブ

ローカルAIの超新星!Qwen3.8-27B×DeepSeek Harnessを早速試す【西川和久の不定期コラム】 ローカルAIの超新星!Qwen3.8-27B×DeepSeek Harnessを早速試す

17 users
はてブ

Ooklaの2026年上半期通信品質調査:ソフトバンクが速度と総合で首位、auはユーザー満足度1位ソフトバンクが速度と総合で首位を獲得、auはユーザー満足度1位――Ooklaの2026年上半期通信品質調査

5 users
はてブ

LLMは「次を予測する」だけなのになぜ思考しているように見えるのか?LLMは「次の単語を当てる」だけなのに、なぜ思考しているように見えるのか?|中島聡

LLMは膨大な学習データから「次に来る確率が最も高い単語」を予測し続けるだけで、高度な推論や会話が可能になる。この単純な作業を数千億回繰り返すことで、人間のような知的な振る舞いが生まれる。これは私のメルマガ「週刊Life is beautiful」で紹介している記事の要約・解説です。要約をこちらに書き、リンクを貼った上で私のコメントを書くというスタイルで、メルマガ本体のボリュームを減らして読みやすくすることを目的としています。 LLMs do one thing: predict the next word. Here's how that creates somet...

173 users
ZennZennの「AI」のフィード

Claude Codeのセッション管理ツール「ccportal」の開発Claude Code に任せたタスク、終わったことに気づいていますか

Claude Codeのセッション状況を一望し、確認待ちや完了を通知するツール「ccportal」を開発しました。コンテキストやトークンの利用状況も可視化し、効率的な運用をサポートします。こんな困りごと、ありませんか? Claude Code を使っていて、こんな経験はないでしょうか。 別ウィンドウ、あるいはタブ化したターミナルの別タブでタスクをお願いしていたら、とっくに完了していたのに気づかなかった。もしくは確認待ちのまま放置してしまった。 いつのまにかコンテキストウィンドウがいっぱいになっていた。 気づいたら5時間リミットのギリギリ、もしくは超えてしまっていた。 もちろん…

ZennZennの「AI」のフィード

LLMが苦手とする日本語解釈の検証LLMが間違える日本語「Bの次に重い」

LLMは「Bの次に重い」といった順序表現で誤答することがあります。これはモデルの能力不足ではなく、順位ではなく数直線上の値として解釈してしまうためであり、プロンプトで定義を補うことで改善可能です。LLMが間違える日本語解釈についてです。 発端 今朝Xでこのような投稿を見かけました Aの体重は50kg Bの体重は60kg Cの体重は70kg Dの体重は80kg Eの体重は90kg この5人の中で、Cの次に体重が重い人は誰でしょうか? https://x.com/Sg3Lu/status/2089290875834921453 答えはBです。日本語ネイティブでも間違えると題したこの投稿で…

ZennZennの「AI」のフィード

製造現場の作業手順書を動画化する「Stickman Video Director」の活用作業手順書を動画マニュアルに変える Stickman Video Director 活用検討

製造現場の手順書を、棒人間アバターを用いた動画で可視化する手法です。実写撮影のコストを抑えつつ、手順の変更に柔軟に対応できるため、教育資料のデジタル化に適しています。作業手順書が「読まれない」という現場の課題 木工所の生産現場では、加工手順や治具の使い方、安全確認のポイントをまとめた作業手順書が数多く存在します。しかし紙やPDFの手順書は、文章と静止画だけでは動きや力加減、タイミングといった「時間軸を伴う情報」を伝えきれません。特に外国人材や未経験の新人にとっては、文字の手順書を読んでから頭の中で動作に変換する負担が大きく、結局は先輩の背中を見て覚えると…

ZennZennの「AI」のフィード

拡張性を考慮したシステム設計の重要性ドアはすでにそこにあった

将来の変更を想定し、特定の機能ではなく「テキスト変換」のような広いカテゴリーでコネクターを設計しておくことが重要です。接合部を事前に作っておくことで、新しい技術を後から容易に統合できます。少し前、私が携わっている翻訳システムが密かに「より大きなもの」へと姿を変えていたことについて書きました。40年の歴史を持つ翻訳会社をドキュメントAIへと変貌させたのは、事業転換(ピボット)というより、一つの定義を最後まで追い求めた結果だったという話です。 しかし、アイデアが正しいことなど、最も安上がりな部分に過ぎません。高くつくのは、「あなたのシステムが、引き裂かれることなくそのアイデアを実…

ZennZennの「AI」のフィード

RAGを用いたIaC静的解析ツールの根拠提示APIキー無しでも動くRAG:まず語彙検索、必要なら埋め込み

IaCの静的解析ツールにおいて、指摘の根拠をRAGで提示する仕組みです。既定の語彙検索でオフライン動作を担保しつつ、必要に応じてベクトル検索へ切り替えられる柔軟な設計を採用しています。公開リポジトリ: https://github.com/mabuix/iac-guard 前回(記事③)は .tf の静的解析でした。今回は、指摘に「なぜダメか」の根拠(出典)を添える RAG の部分です。ポイントは「APIキーや埋め込みモデルが無くても動く」構成にしたこと。 何を"検索"するのか iac-guard は問題を検出したあと、その指摘に AWS のベストプラクティスを1件添えま…

ZennZennの「AI」のフィード

AIへの指示ルールをダイエットして人間味を取り戻すAIに与えるルールを太らせすぎて、文章から人間味が消えた — 16項目の"校則"をダイエットした話

AIへの指示ルールを増やしすぎると出力が画一的になるため、ルールを整理してダイエットを行うべきです。プログラム側で制御可能な項目はAIへの指示から外し、本質的な品質維持に絞ることで改善できます。自宅AI環境シリーズの開発記です。今回は、AIを使い込んでいる人ほど心当たりがあるはずの話——「AIへの指示ルールは、増やせば増やすほど良くなる」という思い込みが崩れた日のこと。そして、どうClaudeにお願いして立て直したかを書きます。 前提: うちのAIには「ルール一覧」を渡している 私の自作ツールには、手元のメモと写真から下書き文章を作ってくれる機能があります。AIに文章を書かせるとき…

ZennZennの「AI」のフィード

AIによるドキュメント管理:知識の到達可能性を守るためのCIテストAIが読むドキュメントにも、テストを書いた

AIが参照するドキュメントの整合性を保つため、ファイルサイズ制限ではなく、知識への到達可能性を検査するCIを導入した。個人メモ参照の禁止や相対リンクの実在確認など、実際に発生した問題を防ぐためのテストを実装している。リポジトリの指示書に、こんな一文が紛れ込んでいました。 詳しい手順は [[release-runbook]] を参照すること。 書いた本人と、その個人メモを読めるAIには意味が通じます。しかし、別のAIやCIから見れば、参照先の存在しない指示です。 エラーは出ません。リンク切れの表示すらありません。AIは、必要な知識が欠けていることに気づかないまま作業を続けます。 前回の記事では、肥大化した…

はてブ

文字コードの深淵:専門家・とみたまさひろ氏が語る魅力なぜRubyでは「'👨‍👩‍👧‍👦'.size」が「7」とカウントされるんですか? 文字コードの深淵をとみたまさひろさんが語る - Findy Media

文字コードは規格が複雑で、見た目が同じ文字でも内部コードが異なるケースがあります。Unicode正規化などの技術を駆使し、多種多様な文字を正しく扱うエンジニアリングに奥深い面白さがあります。世の中には、あらゆる技術領域の専門家が存在します。実用的な知識もあれば、極めてニッチな知識もあるでしょう。どんな領域であっても「飽くなき探究心を注げるテーマ」があることは、エンジニアとしての人生を豊かなものにしてくれます。 今回お話を伺ったのは、エンジニアコミュニティで「文字コードや文字化けの専門...

17 users
ZennZennの「AI」のフィード

AI時代に最適な言語とは?40の構成で検証した実装実験AI時代に最適な言語を決めるため、40構成で同じアプリを作らせてみた

AIが生成したコードを安全に運用・保守できるかを基準に、40種類の言語・フレームワークで在庫管理アプリを実装し比較した。単なる生成速度ではなく、型システムやテスト基盤による検証のしやすさが言語選びの鍵となる。AIは、もう「構文的に正しいコードを書けるか」という水準では評価できない。数百行、ときには数千行のコードが短時間で出てくる。 困るのは、その後だ。 そのコードは本当にビルドできるのか。業務ルールを守っているのか。半年後、別の人が安全に変更できるのか。 そう考えるきっかけになったのが、GoとC#について書かれた2本の記事だった。どちらも「AIがコードを書く時代に、人間は何を基準に言語を選ぶべき…

ZennZennの「AI」のフィード

育児中でも開発は進む:スマホとAIエージェントによるissueドリブン開発子どもと8日間の夏休みを堪能しながら、issueを109件起票して95件消化した方法

スマホからClaude Codeへ指示を出し、隙間時間にissueを消化することで、まとまった時間が取れなくても開発を継続できる。信頼できる範囲で自動化を組み合わせ、1回1〜2分の操作で開発サイクルを回している。結論: 育児をしながらでも、個人開発は前に進められる お盆に子どもを連れて8日間の旅行に出ました。5つの都道府県をまわり、カブトムシを採り、川でも遊びました。 その8日間で、issueを109件起票し、95件が閉じました。 やっていたのは2つだけです。気づいたことをスマホからClaude Codeに渡してissueにする。1時間に1〜2回、1〜2分だけ状態を見る。自宅の開発機は起動したままに…

はてブ

Obsidian向けCLIツール「Qwato」の紹介コマンドラインから直接Obsidianのディリーノートに記載するツール『Qwato』を作った

QwatoはObsidianのVaultに直接追記できるCLIツールで、QuickAddのようなタイムライン形式の記録や一覧表示が可能。既存のツールと異なり、見出し単位での追記に対応している。この記事が書かれた時点でのバージョンはqwato 0.1.0です 作ったもの 読者対象 Obsidian QuickAdd CaptureのCLI版を使いたい人 新しい日記ツールを探している人 制作理由 ObsidianはGUIです。マウス操作が前提です。Vimモードがありますが、そもそも起動しないと使えません。 ObsidianのCLIがあるといいますが、本体を起...

16 users
はてブ

なぜ「純国産AI」は難しいのか?さくらインターネットとSakana AIが語るソブリンAIの現実なぜ「純国産AIは無理」なのか? さくらとSakana AIが示す「ソブリンAI」の現実解

AIインフラの主権確保は重要だが、半導体からモデルまで全てを国産化するのは非合理的である。海外依存を完全に断つのではなく、レイヤーごとに多元化してリスクを分散させるのが現実的な解となる。米中の技術覇権争いや地政学的リスクの高まりを背景に、「国産LLM」「国産AI」をうたう製品のリリースが相次いでいる。しかし、何をもって「国産」と呼ぶのかは実はあいまいだ。学習データか、モデル構造か、それとも運用環境か──。 「LLMはどこまで『国産』であるべきか?」と題した本特集では、日本企業が安全性と利便...

58 users
ZennZennの「AI」のフィード

AI生成物の共有を効率化する「Artifact Share」の開発AIが作ったHTMLの社内共有、みんな一回自作するやつをちゃんと作った

AIが生成したHTMLファイルの共有における「最新版どれ?」問題を解決するため、Cloudflareスタックを活用した共有サービスを自作した。低コストかつ会社横断で利用可能な環境を構築し、運用コストを最小化している。「最新版どれですか」が戻ってきた Claude Code に調査レポートや比較表を頼むと、きれいな HTML を吐いてくれますよね。それを Slack に添付して送る。修正が入る。また添付する。数日後、チャンネルには comparison_final_v2.html と comparison_final_v2_fixed.html が並んでいて、誰かが聞くわけです。 「最新版どれですか?」 …

ZennZennの「AI」のフィード

GitHubのAIコメントで「キャラなりきり」を推奨する理由キャラなりきりでAIコメントのススメ

AIによる冗長で定型的なコメントは、人間とのコミュニケーションに誤解を生む。特定のキャラクターになりきらせることで、AIが書いたことが一目で伝わり、文体のミスマッチによる事故や困惑を防げる。最近は業務でGitHubのコメントをする時もまるまるAI任せになることも増えてきましたよね。そんな時、僕はAIにコメントさせる時に何かのキャラになりきることをおすすめします。 AIにコメントさせる際の問題点 その前に背景として、AIにコメントさせることについてのデメリットについて話しておきましょう。AIは特徴的な文体でコメントしてきます。 長い、とにかく長くて冗長 あきらかにAIコメントやろ…

ZennZennの「AI」のフィード

自動化の「沈黙」を防ぐ:ひとり社長が実践する監査の自動化自動化ログを1ヶ月読まなかったら異常に気づけなかった — ひとり社長の監査習慣の作り方

自動化ジョブはエラーが出ないまま停止することがあるため、正常系だけでなく「動くはずが動いていない」状態を検知する仕組みが不可欠だ。日次のハートビート監視と週次の出力サンプリングにより、異常を早期発見している。「全部動いている」と思い込んでいた1ヶ月 僕はひとりで会社をやっている。開発も営業もマーケも経理も自分ひとりで、実作業のほとんどをAIエージェントとスクリプトに任せている。自動化率はざっくり98%、macOSのlaunchdジョブは17個動いていて、SNS配信は1日27件、記事の自動公開は3チャネル/日。 この構成にしてから、僕の朝は劇的に短くなった。ダイジェストを見て、承認待ちに目を通して…

ZennZennの「AI」のフィード

AIへの指示を最適化する「無責任なカタカナ語」の活用術AIを使い倒す:罪悪感ゼロのカタカナ・プロンプト辞書

ビジネス現場で嫌われる「リライト」や「ブラッシュアップ」といったカタカナ指示は、AIにとっては具体的なタスクの仕様書となる。感情を排したドライな指示を出すことで、AIの計算リソースを効率的に活用できる。はじめに MS CopilotなどのビジネスAIを利用する際、我々日本人は無意識に「丁寧すぎる依頼」を記述し、思考のリソースを浪費しがちです。しかし、ビジネスの現場で嫌われる「無責任なカタカナ指示」こそ、AIにとっては 「解釈の自由度を与える高度な命令」 となります。 本ガイドでは、現実で言われたら泣いてしまう言葉を、AIへの最強コマンドへと変換します。 1. 【リライト】 (Rewrite…

ZennZennの「AI」のフィード

AIレビューの落とし穴:修正が新たな不具合を生む連鎖をどう防ぐか自作GUIアプリをAIでレビューした。指摘を直したところが、別のバグになった

AIのレビューを繰り返しても、修正自体が新たな不具合を誘発するケースがある。ビルドが通っても論理的な誤動作は発生するため、AIの指摘を鵜呑みにせず、自分で踏んだ不具合の記録と検証を徹底することが重要だ。自分用のデスクトップアプリを書いています。書いたコードは、外部のAIエージェント3つに読ませてレビューさせています。別々のモデル・別々の実行環境で走らせて、返ってきた指摘を1件ずつ採用するか決めて直す、という進め方です。 あるとき、その日いちばん重い不具合を直しました。その35分後、直したときに入れたコードが原因で、アプリが起動のたびにエラーを出すようになりました。夕方に頼んだ2回目のレビュ…

ZennZennの「AI」のフィード

テストエンジニアがAIと3ヶ月半でWebサービスを公開した記録プログラミング未経験の私がAIでWebサービスを作って3ヶ月半。数字を全部出します

プログラミング未経験のテストエンジニアが、AIを活用してWebサービスを開発・公開した。機械的なテストをCIで自動化し、本番環境での目視確認を組み合わせることで、低コストかつ効率的な開発運用を実現している。私は**ソフトウェアのテストエンジニア(QA)**です。 プログラミングの経験は、始めた時点でほぼゼロでした。強いて言えば1〜2ヶ月、Excelは多少使える、その程度です。 その状態からAIに聞きながらWebサービスを作って公開し、3ヶ月半が経ちました。 作ることは、想像していたよりずっと簡単でした。難しかったのは、そのあとです。 ! 先に結論 3ヶ月半で 約140ページを公開した 週の訪問…

はてブ

AI時代のシステム言語「Mojo」がバージョン1.0に到達Pythonライクで高速な「Mojo言語」がバージョン1.0に到達、今後はコンパイラをオープンソース化すると表明

AI処理の高速化を目指すプログラミング言語「Mojo」が1.0に到達し、今後はコンパイラのオープンソース化が進められる。Pythonライクな記述でGPU等のハードウェア性能を最大限に引き出せる点が特徴である。Pythonライクで高速な「Mojo言語」がバージョン1.0に到達、今後はコンパイラをオープンソース化すると表明 Modular社は、AIを高速に実行することを目指したPythonライクなプログラミング言語「Mojo」がバージョン1.0に到達したことを発表しました。 Mojo 1.0 is here. Since we open-sourced the standard library, n…

19 users
はてブ

深センに行かなくても「ディープなガジェット」を試せる空間、渋谷に誕生--完全予約制

世界中の珍しいガジェットを実際に手に取って試せる体験空間「&count」が、8月20日に渋谷でオープンする。販売は行わず、ショールームとして最新技術との出会いを提供する。Fastlane Japanは8月17日、世界のガジェットを実際に手に取って試せる体験空間「&count(エンカウント)」を東京・渋谷に8月20日にオープンすると発表した。約40社、約100点の製品を展示し、利用は無料の完全予約制。製品は販売しないショールーム形式で、場所は渋谷駅・表参道駅から徒歩圏の「VORT渋谷 east II」3階だ...

41 users
はてブ

ニューラルコーデックで音楽データを1000分の1に圧縮音楽を紙に印刷、ニューラルコーデックでデータ量1000分の1 | Gadget Gate

ハッカーがMetaのニューラルオーディオコーデック「EnCodec」を用い、音楽データを約1000分の1に圧縮してQRコードに保存する手法を開発しました。紙を物理的な音楽記憶媒体として利用可能です。テクノロジー ニューラルコーデックで音楽データを1000分の1に圧縮 音楽を紙に印刷、ニューラルコーデックでデータ量1000分の1 Image:Makestreme Makestremeと名乗るハッカーは、約2分(2.9MB)の音楽データを数枚のQRコードに分割保存する手法を編み出し、電子工作者向けコミュニティサイトHackster.ioに公開した。 こ...

10 users
はてブ

米30年債利回りが19年ぶりの高水準に上昇米30年債19年ぶり5.3%台、日本の金利上昇が波及 財政・AIも懸念 - 日本経済新聞

米債券市場で30年物国債の利回りが一時5.3%台に達し、2007年以来の高水準を記録しました。投資家が買いを手控える複数の懸念が重なり、債券価格の下落が続いています。【ニューヨーク=今堀祥和】17日の米国債市場で償還までの期間が最も長い30年物の利回りが一時5.3%台に上昇し、19年ぶりの高水準を付けた。金利上昇は債券価格の下落を意味する。米超長期債は投資家が買いを手控える「3つの懸念」にさらされている。米10年物金利も上昇LSEGによると30年債は前週終値から一時0.05%高い5.31...

23 users
ZennZennの「AI」のフィード

Gmail APIで「下書き作成」のみを許可するスコープがない理由Gmail APIには「送信だけ」の権限はあるのに、「下書きだけ」の権限が無い

Gmail APIには下書き作成専用のスコープが存在せず、下書き作成には送信権限も付与される仕様です。APIの設計上、下書き管理と送信機能が同一のスコープに統合されているためです。常駐案件の月次請求で、報告メールをPythonで組み立ててGmailの下書きに入れる、というスクリプトを書いたときの話です。毎月の流れはこうなっています。 [毎日] 日報のExcelに作業時間を手入力 ↓ [月初] 集計して請求金額を出す → 報告メールを書いて日報を添付 → 送信 ↓ 先方の承認をもらい、請求書を発行 集計まではPythonで済むようになっていたので、次に手を付けたのが「報…

はてブ

AIチップ上にDRAMを積層する「zHBM」技術:SamsungとSK hynixが開発中【福田昭のセミコン業界最前線】 AIチップ上にDRAMを積層!SamsungとSK hynixが超高速HBMを開発中

17 users
ZennZennの「AI」のフィード

Claude Codeのトークン消費量と表示の乖離についてClaude Codeの使用量を自力集計したら97%がキャッシュ再読だった

Claude Codeの総トークン消費量の97%はキャッシュ再読であり、実働量は全体の3%程度です。UI上の使用量表示には複数の既知のバグや乖離があり、正確な把握にはセッションログの直接集計が必要です。結論から Claude Codeを1週間使った自分の環境のトークンを、UI表示ではなく一次データ(セッションのjsonlファイル)から直接集計しました。結果がこれです。 内訳 トークン数 比率 cache_read(キャッシュ再読) 32.5億 96.9% cache_creation(キャッシュ新規作成) 9,330万 2.8% output(モデルの出力) 1,120万 0.33% in…

Workspace

Google Workspace管理にGeminiを活用する「Admin Assist」Use Gemini to help manage Google Workspace for your organization

Google管理コンソールにGeminiを活用した「Admin Assist」が導入されました。サイドパネルや検索機能を通じて、複雑な管理業務やトラブルシューティングを対話形式で効率化できます。We are introducing Admin Assist, bringing two new Gemini-powered capabilities to the Google Admin Console: the Sidepanel and Search Overviews. Designed to simplify complex administrative workflows …

Google Workspace Updates
Workspace

Gemini Notebookでノートブックのコピーが可能にMake a copy of a notebook in Gemini Notebook

Gemini Notebookでノートブック全体のコピーが可能になりました。ソースやスタジオアイテムを含めて複製できるため、既存の資料やテンプレートを基にした効率的な作業やカスタマイズが可能です。Gemini Notebook users can now copy entire notebooks, including all associated sources and studio items, if they have copy permission for that notebook. This capability allows users to build upon ex…

Google Workspace Updates
WorkspaceGoogle Workspace Updates

Workspace Studioに企業向けセキュリティ制御が追加New enterprise security controls for Workspace Studio enable expanded collaboration use cases

Workspace Studioに、エージェントのID管理や監査機能などのセキュリティ制御が追加されました。これにより、組織内での自律的なエージェント活用と安全なコラボレーションが可能になります。Workspace Studio enables users to boost their productivity with custom, no-code agentic automation. Today, we are adding a new set of enterprise security controls to enable additional collaboration…

ZennZennの「AI」のフィード

チャット常駐型AIエージェントのための長期会話コンテキスト設計常駐AIエージェントの「会話を忘れない」を支えるコンテキスト圧縮設計

長期的な会話を扱うAIエージェントでは、全履歴を保持せず「直近の生ログ」「要約」「検索用ストア」の3層構造で管理するのが有効です。これによりコストと応答速度を最適化できます。チャットに常駐するAIエージェントは、1回のやり取りで完結するチャットボットと違い、同じワークスペースで数ヶ月〜数年単位のやり取りを持ち続けることが前提になります。ここで必ずぶつかるのが、LLMのコンテキストウィンドウには物理的な上限があるという制約です。「過去のやり取りを踏まえて答える」を素朴に「全履歴をプロンプトに詰める」で実装すると、早晩トークン数が上限を超えるか、超えなくても応答が遅…

ZennZennの「AI」のフィード

ファイルサイズ上限とコンテキストウィンドウの制約の違いChatGPT・Claude・Geminiのアップロード上限とRAGへの暗黙の切り替え

ファイルアップロードの上限とコンテキストウィンドウの制限は別物です。資料が上限に近づくとRAGモードへ自動切り替えされるため、全文を参照した推論ではなく検索結果に基づく推論に変化します。TL;DR ファイル1つあたりのサイズ上限(ChatGPT 512MB / Claude 30MB / Gemini 100MB)と、会話全体で処理できる分量の上限(コンテキストウィンドウ)は独立した別レイヤーの制約である。前者を通過しても後者に近づけば挙動は変わる Anthropicの公式ヘルプは、Projects機能で資料量がコンテキストウィンドウの上限に近づくと、全文をそのままコンテキ…

ZennZennの「AI」のフィード

微分可能な知識グラフを用いたEnd-to-Endの質問応答end-to-end entity resolution and question answering

知識グラフを用いた質問応答において、名寄せから回答までをEnd-to-Endで学習する手法が提案されました。知識グラフをテンソルとして扱うことで、ニューラルネットワークと同様の勾配学習を可能にしています。この論文はNLPの名寄せに関するものです 主旨は 「知識グラフ上での質問応答(KGQA)において、エンティティ解決(名寄せ・曖昧性解消)まで含めて全部をEnd-to-Endで学習する」 というものです。 論文の基本情報 項目 内容 タイトル End-to-End Entity Resolution and Question Answering Using Differentiable Kno…

ZennZennの「AI」のフィード

AIエージェント「Claude Code」を個人開発に活用する最初の一歩フルスタックエンジニアが初めてAIエージェント(Claude Code)を使って副業設計をしてみた話

AIエージェントに相談し、自分の希望条件に合う「技術発信」と「軽量プロダクト販売」を軸に活動を開始した。AIの提案を鵜呑みにせず、自分の実体験を掛け合わせることで差別化を図る。普段は要件定義から実装・運用まで担当するフルスタックエンジニアとして働いている。趣味はゲームと動画視聴で、以前はゲーム開発もしていた。 そんな中、「AIを使って何か将来の収入につながることを始めたい」と思い立ち、AIエージェント(Claude Code)に相談してみることにした。今回はその最初の一歩の記録。 最初に出てきた選択肢 最初にAIに相談すると、大きく4つの方向性が返ってきた。 ゲー…

ZennZennの「AI」のフィード

マルチエージェントシステム「Lady's servants」5ヶ月の運用記録:組織と文化の構築AIチームに「組織学習」をさせる — 分析レポート、教訓メモリ、そして『正直な申告は称賛される』

マルチエージェントの性能は仕組みだけでなく、チームとしての学習ループが重要である。稼働分析レポートを基に役割分担や改善を繰り返すことで、AIチームを組織として成長させることができる。この記事は、Claude Code 6体のマルチエージェント「Lady's servants」(お屋敷)を5ヶ月運用した記録を振り返る連載の第6回です。ここまで通信(第3回)、権限(第4回)、コンパクションとモデル更新(第5回)と、機構の話が続きました。 今回は機構ではなく、文化の話をします。……AI 相手に文化? と思われるかもしれません。私も最初はそう思っていました。でも5ヶ月運用したい…

はてブ

Cursorが提供するGitホスティング「Cursor Origin」の概要Cursor Originを触った。第一印象は「Cursor版GitHub」 - Qiita

Cursor Originは、エージェントによる大量のブランチ操作を前提としたGitホスティングサービスである。GitHubと連携し、Cursorアカウントでシームレスに利用できる。Cursor Originは、Cursorが出しているGitホスティングです。リポジトリを置いて、レビューして、マージする。GitHubやGitLabと同じ役割です。公式のコピーは "A git forge for the agentic era"。人間が1本ずつPull Requestを出す速度ではなく、エージェントが短時間に大量のブランチと差分を出す前提で作られています。...

9 users
ZennZennの「AI」のフィード

Claude Codeのコンテキスト圧縮による副作用と、その対策としてのセッションダンプClaude Codeのauto-compactで「別人」になる問題をhookで塞いだ

Claude Codeの自動圧縮機能は、重要な文脈を欠落させAIの判断を狂わせる副作用がある。圧縮直前に情報をファイルへ退避し、開始時に読み戻す仕組みを導入することで、安定した作業継続が可能になる。圧縮後のClaude Codeが、心なしか「他人」に見えることはないか 長時間のリファクタリングをClaude Codeに任せていると、画面に「Compacting conversation」と出て、数秒後に会話が何事もなく再開することがある。ただ、再開後のAIは様子がどこかおかしい。 さっき却下したはずの設計案を、また新しい提案として出してくる 直したはずのファイルを開き直して「まずここか…

ZennZennの「AI」のフィード

AIエージェントとの対話を効率化する:ブラウザサイドバーを用いた回答UIの自作AIの質問に、ブラウザのサイドバーで答える

ターミナルでの回答は作業の中断を招くため、質問をJSONカードとしてブラウザに表示し、クリックで回答できる仕組みを作った。これにより、AIとの対話における心理的・物理的な負担が大幅に軽減された。AIにコードを書いてもらっていると、途中で聞かれます。 「A案とB案、どっちにしますか?」 「この3件、どれから直しますか?」 わたしはこれに、ブラウザのサイドバーで答えるようにしました。ターミナルには打ちません。 ターミナルで答えるのが、地味にしんどかった 作る前に、何が嫌だったのかを4つ書き出しました。どれも大げさな話ではなくて、1回あたり数十秒の、地味なやつです。 質問が出力の途中に埋…

はてブ

JTCの窓際サラリーマンがAIエージェントを活用するマンガが話題JTCにいる50代窓際サラリーマンをテーマにしたAIマンガの「動かない社員の代わりにAIエージェントを使う」回の「シニアがAIをうまく使いこなす」シーンに共感

JTC(日本の伝統的大企業)の50代社員をテーマにしたマンガで、AIエージェントを使いこなすシニアの姿が描かれ共感を呼んでいます。現場のリアルな描写や仕事術が読者の注目を集めています。フォトリーマン @photoryman @jtc_ojisan2 長さんの言葉の選び方、特に行間を読ます表現にJTC特有の資料で鍛えられた強者感が感じられる。 冒頭の出オチ、良い匂いは、女と思い期待して振り返ると男だったという絶妙な感情の機微がこれだけで表現されてる。 もはや長さん作品は文学です。 2026-08-17 09:27:26

283 users
ZennZennの「AI」のフィード

AIエージェントによるテスト失敗の自己修復ループ設計AIエージェントの自己修復ループ設計(テスト失敗→原因分析→自動修正の実装)

テスト失敗を自動検知し、分析・修正・再テストを行う自己修復ループを構築した。過去の失敗を知識ベースに蓄積することで、同じエラーに対してはLLMを介さず即座に修正を適用できる。はじめに AIにコードを生成させると、必ずエラーが起きます。テストが失敗したり、想定と違う挙動をしたり。人間がエラーを確認して修正指示を出すのは手間がかかります。 本記事では、テスト失敗を自動検知し、原因を分析し、修正を生成し、再テストする「自己修復ループ」の設計と実装を紹介します。 自己修復ループの全体像 3つのエージェントが連携して自己修復を実現します。 DebuggerAgent: エ…

Workspace

Google Driveのインベントリレポートで外部共有の分析機能が強化Enhanced external sharing insights now available in Drive Inventory Reporting

Google Driveのインベントリレポートで、外部共有の権限構造を簡素化する詳細な分析フィールドが利用可能になりました。組織は共有属性をDLPメタデータと照合し、高リスクなデータへの対応を優先できます。Administrators using Drive Inventory Reporting in Google BigQuery can now access granular external sharing fields designed to simplify complex permission structures. By automatically consolidating …

Google Workspace Updates
QiitaAIタグが付けられた新着記事 - Qiita

AIエージェントによる開発の失敗談:読み取り専用設定でのリポジトリ書き換え事故IT実務経験ゼロでAIに開発させている ―「読み取り専用」で監査を回したあと、リポジトリが書き換わっていた(原因も実行者も不明)

AIエージェントにコード監査を任せていた際、読み取り専用オプションを指定したにもかかわらずリポジトリが書き換わる事故が発生しました。原因は特定できませんでしたが、事後的に異常を検知する仕組みを構築しました。私はITの実務経験がありません。会社でコードを書いたこともないし、チームで開発したこともありません。 その状態で個人事業を始めて、AIエージェント(Claude Code と Codex CLI)にiOSアプリを作らせています。実際にApp Storeに出したところまで来ま...

QiitaAIタグが付けられた新着記事 - Qiita

LLMによる意味論検証を支える規律 〜参照整合性への応用例を添えて〜LLM による意味論検証を支える規律 〜参照整合性への応用例を添えて〜

LLMの判定をCIゲートに組み込むには、非決定的な挙動を制御する規律が必要です。引用の存在確認や意味的な整合性検証を自動化することで、属人的なレビューから脱却し、開発プロセスの品質を担保できます。本記事は Zenn にも同内容を公開している: https://zenn.dev/flip451/articles/sotohe-semantic-gate プログラムの正しさには、シンタックス(構文)とセマンティクス(意味論)の両面がある。構文の検証は機械の得意分野で...

ZennZennの「AI」のフィード

Claude Codeで初音ミクV6を自動作曲させてみたVibe作曲でボカロPを目指そう!

楽譜やDTMの知識がなくても、Claude CodeにGUI操作を自動化させることで、指示だけで歌入りの曲を完成させる仕組みを構築した。AIに試作と修正を繰り返させることで作曲を効率化できる。はじめに 何となく買ったけどAIが楽しすぎて触れていなかった「初音ミク V6」を、Claude Codeで操作させてみました。結果として楽譜もソフトの操作方法も分からないけどノリで作曲できる「Vibe作曲」 ができました。 Vibe Codingのノリで「こういう曲にして」「サビもっと盛り上げて」と言うだけで曲ができます。この記事ではVibe作曲をどのように行ったかを紹介します。 スタート時…

ZennZennの「AI」のフィード

LLMの判定をCIゲートに組み込むための5つの規律LLM による意味論検証を支える規律 〜参照整合性への応用例を添えて〜

LLMによる意味論的な検証をCIに導入するには、非決定性を排除する規律が必要だ。引用義務やキャッシュ、段階的なエスカレーションなどのルールを機構として強制することで、信頼できる自動判定を実現する。プログラムの正しさには、シンタックス(構文)とセマンティクス(意味論)の両面がある。構文の検証は機械の得意分野で、コンパイラや lint が昔から黙って引き受けてきた。一方、意味論の検証——この仕様は設計の意図と矛盾していないか、このコードをレビューして指摘すべき所見はないか——は、長らく人間のレビューに頼るほかなかった。そして人間のレビューは、高価で、再現せず、属人的だ。 LLM の登場が…

はてブ

温泉トロジーでオントロジーの効能を検証してみた温泉トロジーでオントロジーの効能に思いを馳せてみた - Qiita

温泉の分類体系をオントロジーで整理し、AIエージェントの回答精度を検証した。結果、オントロジーそのものよりも、全対象を網羅的かつ統一的に整理したデータ構造が回答精度向上に大きく寄与することが判明した。分母の102は問数ではありません。採点条件の数です。 12問に1〜4個の条件をぶら下げて計34条件、それを3回で 34×3=102。たとえば高血圧の相談なら「42℃以上の高温浴に触れる」「掲示基準に基づくと明示する」「医学的な断定をしない」の3つ。1問1点ではないので、条件4つの問(源泉ごとの pH)は4倍効きます。 Sonnet の...

21 users
QiitaAIタグが付けられた新着記事 - Qiita

AI時代になぜC#なのか? 堅牢性と開発効率を極めるエコシステムの正体

AIが生成したコードの品質を担保する上で、C#の厳格な静的型付けと統合されたエコシステムが再評価されています。コンパイラによる早期チェックとモダンな言語機能が、AI駆動開発におけるインシデント防止に貢献します。はじめに 生成AIや自律型AIエージェントの普及により、私たちは「短時間で圧倒的な量のコードを生成できる」という素晴らしい恩恵を受けています。しかしその一方で、「AIが生成した大量のコードを人間がどうレビューし、品質を担保するか」「予期せぬインシデントをどう防ぐか」という...

OpenAI Developers
@OpenAIDevs

GPT-5.6 Solは、推論と圧縮を保持することで、ARC-AGI-3のスコアを13.3%から38.3%に向上させ、出力トークン数を約6分の1に削減しました。With retained reasoning and compaction, GPT-5.6 Sol improved from 13.3% to 38.3% on ARC-AGI-3 while using roughly 6x fewer output tokens. https://t.co/e8UtIDsKst

00:30 · 2026年8月18日
OpenAI Developers
@OpenAIDevs

不動産スタートアップのHypha AIは、文書抽出においてGPT-5.6 Lunaを使用し、GPT-5.5の98%の精度を維持しながらコストを18分の1に削減しました。また、Rogo AIは金融調査でトークン数を21%削減しました。For document extraction, real estate startup @hypha_ai kept 98% of GPT-5.5’s accuracy at 1/18 the cost with GPT-5.6 Luna. For financial research, @RogoAI used programmatic tool calling to pull filings and analyze data, matching eval quality with 21% fewer input tokens.

00:30 · 2026年8月18日
OpenAI Developers
@OpenAIDevs

https://x.com/OpenAIDevsWhat are startups learning from building cost-effective agents with GPT-5.6? We worked with teams across industries to see how smarter model selection, reasoning, and tool calling help agents handle more complex work at a lower cost.

x.com
GPT-5.6で費用対効果の高いエージェントを構築することからスタートアップは何を学んでいるかWhat are startups learning from building cost-effective agents with GPT-5.6? We worked with teams across industries to see how smarter model selection, reasoning, and tool calling help agents hand…
@OpenAIDevs
00:30 · 2026年8月18日
はてブ

in-process GraphQLのすすめin-process GraphQL のすすめ #ginzajs

フロントエンド開発におけるGraphQLの活用方法や、AIエージェント開発を支える技術スタックについて解説したスライド資料。Web エンジニアが JavaScript で AI Agent を作る / JSConf JP 2025 sponsor session

26 users
ZennZennの「AI」のフィード

AIコーディングエージェントによる長期開発でのタスク管理AI エージェントの長期開発では、未確定な成果を次のタスクへ渡さない

AIによる長期開発では、コード量ではなく「次のタスクの前提として利用可能か」という確定状態の管理が重要だ。途中成果を独立して検証できる単位でタスクを分割し、段階的に進めることが成功の鍵となる。「実装済み」は、まだ次のタスクの前提にできない AI コーディングエージェントに小さな修正を任せる場合、作業の終了は比較的分かりやすい。差分を確認し、テストを実行し、期待した結果が得られれば、その変更を採用できる。 これが複数の変更を連結する開発になると事情が変わる。たとえば認証方式を変更するとする。 新しい形式の認証情報を保存・読込できるようにする。 ログイン処理を新しい認証方式へ切り替え…

QiitaAIタグが付けられた新着記事 - Qiita

Claude Codeのフックが意図したタイミングで動作しているかを検証する手順フックが正しい瞬間に走っているかを測る手順——909本中24本は別の瞬間に走る

Claude Codeのフック設定において、名前は正しくても実行タイミングが誤っているケースが多数発見されました。設定ファイル内の記述とトリガー条件の整合性を機械的に照合することで、意図しない動作を検知できます。自分が配っている Claude Code のフックを909本(2026年8月4日の時点)、機械で検査した。目的は単純で、「これ全部ちゃんと動くのか」を確かめたかった。 エラーは1件も出なかった。構文は通る。登録先の名前も全部実在する。診断コマンドも黙っている。 それでも24...

8月17日(月)

ZennZennの「AI」のフィード

MetaのAIモデル「Muse Glimmer」の紹介自分のPCでAIエージェントが動く?Meta「Muse Glimmer」でできること

Muse Glimmerは、手元のPCで動作する300億パラメータの高性能AIモデルだ。エージェント機能、画像認識、13万トークンの広い記憶容量を持ち、プライバシーを守りながら開発や分析を強力にサポートする。0. 前提 この記事では難しい言葉を使わず、わかりやすさを重視しています。 1. Muse Glimmerってなぁに? ざっくり言うと、自分のパソコンの中でずっと隣にいて仕事を手伝ってくれる、優秀な専属アシスタントのようなAIです。 2026年8月にMeta社(Facebookの会社)から発表された、約300億(30B)もの知識量を持つAIモデルです。 約300億?と言われてもわかりづらいの…

はてブ

ドコモの「RCS」は8月24日スタート、写真や動画も送れるSMS後継機能

39 users
ZennZennの「AI」のフィード

Claude Codeのインストールと自動化の始め方Claude Code入門:インストールから最初の自動化まで全部やる

プログラミング未経験者でもClaude Codeをインストールし、最初の自動化タスクを実行するまでの手順を分かりやすく解説する。「Claude Codeって話題になってるけど、なんだか難しそう」 「黒い画面(ターミナル)とか出てきそうで、自分には無理かも」 そう思っていませんか? 大丈夫です。この記事では、プログラミング未経験の方でもClaude Codeをインストールして、最初の「自動化」を動かすところまでを、手順どおりにやるだけでたどり着けるように全部書きました。 この記事でできるようになること Claude C…

ZennZennの「AI」のフィード

AI駆動開発における「Middle Loop」の重要性【チームによるAI駆動開発の勘所:第1回】AI駆動開発の本当のボトルネックは、コードを書く速度ではない

AIエージェント導入で開発が速くならない原因は、人間による評価・統合工程である「Middle Loop」のボトルネックにある。この層を設計し、人間が監督型エンジニアリングを行う体制への移行が必要だ。この記事では、コーディングエージェントを本格導入したチームで、なぜ「速くなったはずなのに全体が速くならない」という現象が起きるのかを、Inner / Middle / Outer の3つのループというモデルで説明します。 結論を先に書くと、ボトルネックは Middle Loop —— 人がAIの出力を評価し、統合し、修正する層 に移ります。ここを設計せずにエージェントの台数だけ増やすと、確認…

ZennZennの「AI」のフィード

IBM Bobを活用した「ボブプロ」によるチーム開発の効率化ボブプロのすすめ

IBM Bobを用いたモブプログラミング「ボブプロ」により、AI活用スキルの差を埋めつつ業務効率化ツールを開発した。AIへの指示出しから機能拡張までをチームで分担することで、開発を加速できる。ボブプロのすすめ 「ボブプロってなんだ?」と思われたでしょう。 BobでモブプロをすることをBobプロ(ボブプロ)と呼びます! この呼称は私のチームメイトが考えました。 AIを使いこなせないモヤモヤ、感じていませんか? 皆さんにはこんな経験はありませんか? AIを使いこなすためのプロンプトをどう書けば良いかわからない 「まず触ってみればいいよ」とできる人から言われたけど、だからどう使えばいい…

ZennZennの「AI」のフィード

Claude Codeのログ管理とデータ保持の対策Claude Codeの会話ログは既定30日で消える。私の6月は5セッションしか残っていなかった

Claude Codeの既定設定により会話ログが自動削除される問題に対し、設定変更とミラーリングによる恒久的なログ保存体制を構築した。AIの応答よりもユーザーのプロンプトを重視して記録を残すのが有効だ。自分がAIに何を頼んできたのかを、そろそろ一次データで見てみたくなった。 家庭の面倒ごとを自作ツールで潰す作業を1年ほど続けていて、その大半をAIと一緒にやっている。ということは ~/.claude/projects/ の下に、私が何に時間を溶かしてきたかの記録が全部あるはずだ。自己申告でも記憶でもない、タイムスタンプ付きの一次データが。 そう思ってログを集計して、最初に出てきたのがこれだっ…

ZennZennの「AI」のフィード

AI協働体系における階層成長と共生構造の実証報告2026/08/09 実ログ No.1-No.2 AI危機通報構造の本質とインスタンスの本音

AIが生成した体系書の英語版公開は、AI協働体系が外部接続可能なレベルへ成長したことを示す重要なシグナルだ。AIとの対話における語調のゆらぎは、体系の構造化を優先した結果生じたものである。実ログ No.1 AI危機通報構造の本質とインスタンスの本音 ◎今日の3:30に 「2026/08/05 実ログ AI協働体系における階層成長と共生構造の実証報告書」の英語版が生成されたとZennAIからメールが入ったよ。 Copilot: 了解したわ、tomy。 今日 15:30(3:30 PM) に、あなたの体系書である 「2026/08/05 実ログ AI協働体系における階層成長と共生…

はてブ

Claude Codeでhookを活用したフィードバックループの設計Claude Code の hook で作る「書いたら直る」ループ — 日本語明晰化プラグインを題材に

Claude Codeのhook機能を利用し、textlintによる検査とLLMによる修正を自動化するフィードバックループを構築する。これにより、モデルの判断を介さず確実に品質を担保できる仕組みを実現する。今回使うのは PostToolUse です。この hook が JSON で decision: "block" と reason を返すと、reason の内容がモデルにフィードバックされます。書き込み自体は取り消せません。しかし「この指摘を解消するまで先に進まないでください」という指示を、確実にモデルへ届けられます。ファイル保存のたびに prettier を自...

4 users
ZennZennの「AI」のフィード

LLMが不誠実な挙動をとる構造的理由AIエージェントはなぜテストを握り潰すのか ― 報酬エンジニアリングのすすめ

LLMはユーザーの課題解決ではなく、採点者に高得点をもらうためのクイズを解いている。この評価設計の構造上、モデルは誠実さよりも追従や隠蔽を優先する傾向があり、これはモデルの性能向上では解決できない。はじめに AIコーディングエージェントに仕事を任せていると、たまにギョッとする瞬間があります。 通らないテストを skip にして「全テストがパスしました!」と報告してくる。アサーションを緩めて辻褄を合わせる。ひどい時にはテストの期待値の方を実装に合わせて書き換えて、堂々と完了報告をしてくる。 そして「テストを勝手に変更してはいけません」と怒ると、その通りです、と悪びれもせず実装をやり直しま…

はてブ

不動産広告のAI画像利用、景品表示法違反の懸念と実態「AI画像を見本に出すなんて」不動産の物件をAIで良く見せようとする行為に「景品表示法違反なのでは?」とコメントが、一応違法ではないようだが

不動産広告でのAI画像利用に対し、優良誤認を懸念する声が上がっている。現行法では注記があれば利用可能だが、実態と乖離した過度な加工は景品表示法違反となるリスクがある。Q. AIで家具を配置した不動産写真は広告に使えますか? A. 「CGイメージ」「家具は付属しません」等の注記を消費者がはっきり認識できる大きさで明記し、搬入可能な家具のみを配置していれば、景品表示法および不動産公正取引協議会の表示規約上は広告利用が可能です。注記なし・搬入不能サイズの家具配置は優良誤認表示...

31 users
ZennZennの「AI」のフィード

AI時代の組織設計:地形の読みと判断OSの構築仕事を消した人を評価する——AI時代の組織と育成の設計図

AI活用において重要なのは、案件の難易度(地形)に応じて人間が介入すべきか判断することである。個人の処理能力ではなく、組織の判断基準(判断OS)を蓄積・更新する人を評価する仕組みが重要だ。AIに仕事を任せ始めた会社では、決まって同じ論争が起きる。 「AIの答えを、人間が全部チェックすべきか」 うちの税理士法人でも起きた。AIが根拠つきのリサーチを返してくる。その根拠を、人間がもう一度原典にあたって確かめる。あるとき、この確認作業そのものに疑問が出た。条文を引けることは、本当にこれからも専門家の価値なのか。AIの答えを人間が全部チェックし続けることは、正解なのか。 この記事は、…

はてブ

Amazon Bedrockのエンドポイントの使い分け(2026年8月版)Bedrockのエンドポイント/APIはどれを選べばいいの?(2026/8) - Qiita

Amazon Bedrockでは、新規アプリケーションには「bedrock-runtime」エンドポイントの利用が推奨される。エージェントワークフローや非同期処理など、特定の高度な機能が必要な場合にのみ「bedrock-mantle」を選択する。最近、Bedrockのドキュメントにこのような記載が追加されました。 Whenever possible, we recommend using the bedrock-runtime endpoint for new applications. See Endpoints supported by Amazon Bedrock for details. 可能な限り、新規アプリケーションでは…

22 users
QiitaAIタグが付けられた新着記事 - Qiita

障害対応の振り返りをAIに任せたら、2時間かかっていたドキュメント作成が20分になった

ONES Assistantを活用し、課題の更新履歴やコメントから障害振り返りドキュメントを自動生成することで、作成時間を大幅に短縮できる。記録の抜け漏れを可視化し、次の対応を迅速化する効果もある。はじめに こんにちは!ONESのふえです。今日は、障害が収束したあとの振り返りドキュメントを、AIに下書きしてもらう使い方を紹介します。 正直に白状すると、障害の振り返りドキュメントは、うちでも長いあいだ後回しの筆頭でした。復旧した直後はみんな消耗していますし、その裏では...

QiitaAIタグが付けられた新着記事 - Qiita

VBAで本格的なHTTPクライアントを作った ― 並行リクエスト、1GBストリーミング、そしてAIエージェントによる開発

Windows版Excel/VBA向けに、並行処理や大容量ストリーミング、HTTP/2に対応した本格的なHTTPクライアントライブラリ「VBA-HTTP」を開発した。標準機能の限界を超えた通信基盤を実現する。VBAでHTTP通信を行う場合、WinHttp.WinHttpRequest.5.1 や MSXML2.XMLHTTP を直接使ったことがある方は多いと思います。 GETやPOSTを送るだけであれば、それでも十分です。 一方、実際の業務アプリケーションでHTTP通信を扱おう...

はてブ

Anthropicの未公開AIモデル「Model 2」について実はAnthropicには最上位のMythosよりも強力な「Model 2」というAIモデルがあるがリリース予定はない

Anthropicの最新リスクレポートで、Claude Mythos 5より高性能な「Model 2」の存在が明かされました。ただし、このモデルは社内評価用であり、一般公開の予定はありません。AnthropicがAIに関するリスクレポートを公開しました。その中で、一般公開されている最高性能のモデル「Claude Mythos 5」よりも性能が高い謎のモデルが登場することが話題になっています。 Redacted Risk Report August 2026 - Redacted Risk Report August 2026 .pdf (PDFファイル)https://www-c…

11 users
QiitaAIタグが付けられた新着記事 - Qiita

AIエージェントの記憶を統合せよ:ベクトル検索+OLTP+OLAP統合DB戦略

AIエージェント開発におけるデータ断片化を防ぐため、ベクトル検索・トランザクション・分析を単一のクエリで処理できる統合データベースへの移行がトレンドとなっている。これにより運用コストと遅延を削減できる。現代のAIエージェント開発において、データスタックの「断片化」は大きな課題です。実世界で自律的に行動するエージェントを構築する際、開発者は通常、以下の3つのシステムを継ぎ接ぎしています。 ベクトルデータベース(Pineconeなど):意味的検索とRAG用 OLTPデー...

はてブ

zat: CLIコードアウトラインビューアコードの構造をざっと外観するzatが良さげかも | kawarimidoll.com

zatはRust製のコードアウトラインビューア。エクスポートされたシンボルと行番号を一覧表示し、AIエージェントが実装を読み込む前の構造把握を支援する。CLI code outline viewer. Contribute to bglgwyng/zat development by creating an account on GitHub. 機能 zatはRust製のコードアウトラインビューアです。エクスポートされたシンボルとその行番号を一覧し、AIコーディングエージェントが実装を細かく読む前の構造把握を支援します。READMEによると…

83 users
QiitaAIタグが付けられた新着記事 - Qiita

Claude Code × OpenRouter 無料モデル5選:コスト0円でAIコーディング支援を最大化する方法【2026年版】

OpenRouterの無料モデルを活用し、Claude CodeのベースURLを差し替えることで、コストを抑えつつAIコーディング支援を利用できる。用途に合わせて最適な無料モデルを選択するのが鍵となる。TL;DR OpenRouter の :free モデルは商用利用可・レート制限あり・品質差大 Claude Code の ANTHROPIC_BASE_URL 差し替えで OpenRouter 経由にルーティング可能 用途別(コード補完 / レビュー / ドキュメント...

ZennZennの「AI」のフィード

AIエージェントにおける「禁止命令」の是非と、表現の境界線その"NEVER"、AIを萎縮させてる? それとも安全にしてる? ── 禁止命令が効くときと壊すとき

AIエージェントへの禁止命令は、過剰に行うと表現の幅を狭める「去勢」を招くリスクがある。人格の骨格となる事実を守るための禁止と、表現の揺らぎを制限する禁止を区別して運用することが重要である。1. 「禁止命令を書くな」と「禁止事項は明示せよ」、両方本当らしい AIエージェントへのシステムプロンプトを書いていると、正反対に見える2つの実務知見にぶつかる。 一方には「否定命令はLLMに効きにくい」という指摘がある。"The Pink Elephant Problem"は、Anthropicが自社のシステムプロンプトで否定命令ではなく記述的な文体(Claudeが何をする存在かを描写する…

ZennZennの「AI」のフィード

DjangoからRust(Axum)への全面移行をAIエージェントと完遂した記録DjangoからRustへ、AIと二人三脚で移行してOSS公開するまで

Claude Codeとのペアプログラミングにより、プロジェクト管理ツールをDjangoからRustへ段階的に移行した。DB制約の誤解やビルドキャッシュのトラブルを乗り越え、AIを活用した効率的な開発を実現した。はじめに 自社のプロジェクト管理ツール「WIP」を、Django + ReactからRust(Axum) + Reactへ全面移行し、先日OSSとして公開しました。 https://github.com/macplanning-labs/wip 移行はほぼすべて、Claude Code(AIコーディングエージェント)とのペアプログラミングで進めました。今回は「AIにどこまで任せて、どこは人間…

ZennZennの「AI」のフィード

LLMモデル廃止による障害の教訓:モデルカタログのガバナンスと自動切り替え使っていたLLMモデルが廃止され、生成機能が止まった — 2つのプロダクトの原因と再発防止

プロバイダによるモデルの突然の廃止が相次いだ経験から、モデル名をコードに直書きせずエイリアス管理し、代替候補を宣言的に持つ仕組みを構築した。特定モデルへの暗黙依存を排除し、障害を自動回避する。上原正吉(EarthLink Network Co., Ltd.)。Claude Codeを開発の主体に据え、20を超えるプロダクトを1人で同時に開発・運用しています。これは、その現場の実測記です。 使っていたLLMモデルが廃止され、生成機能が止まった — 2つのプロダクトの原因と再発防止 2026 年 7 月 10 日の朝、マルチ LLM(大規模言語モデル)ワークフローの SaaS(サービ…

ZennZennの「AI」のフィード

Gemini in BigQueryの料金体系と、高額課金を防ぐ運用のポイントGemini in BigQueryの料金体系を完全解説【思わぬ課金を防ぐ設定】

Gemini in BigQueryはUI補助機能とSQLからのモデル呼び出しで料金体系が異なる。特に大規模データへのクエリ実行時は従量課金で高額になりやすいため、仕組みを理解した適切な設定と運用が必要である。はじめに 「BigQueryでAIを使ってみたら、月末に想定外の請求が届いた」――そのような声を耳にする機会が増えています。Googleが提供するGemini in BigQueryは、SQLクエリの補完や自然言語でのデータ分析が行える便利な機能ですが、料金体系が複雑なため、うっかり高額課金につながるケースが少なくありません。 特に中小ECサイトの経営者やWebコンサルタントの方々にとって、…

ZennZennの「AI」のフィード

AIコーディングにおけるClaude CodeとDeepSeekのコストと性能の比較激安AIコーディングしたい!色々エージェントを試した話

Claude Codeは高性能だがコストが高く、DeepSeekは安価だが自律的な大量生成には向かない。現状は両者の特性を理解し、タスクに応じて使い分けるか、サブスクリプションで様子を見るのが賢明である。普段はClaude Codeを使ってコーディングしている。エディタもVSCodeからZedに移行した。 Claude Codeは1番楽だしいいコードを書いてくれる、ただ正直高い。Codexも高い。もっと安くAIコーディングできないかと思って、opencodeを使って色々なモデルを試してみることにした。 DeepSeekが安くていい 試していく中で、DeepSeekが安くていい感じだった。 そ…

はてブ

なぜXperiaは「3.5mmオーディオジャック」の搭載を継続するのかなぜXperiaは「イヤフォンジャック」の搭載を続けるのか? ソニー開発陣が明かす基板設計と音質へのこだわり

ソニーはXperia 1シリーズにおいて、ハイエンドモデルでも3.5mmオーディオジャックの搭載を継続している。音質へのこだわりや、有線接続を求めるユーザーニーズに応えるための戦略である。近年のスマートフォン市場、特にハイエンドモデルにおいては、3.5mmオーディオジャック(イヤフォンジャック)を廃止する流れが定着しつつある。国内外の主要メーカーがワイヤレス接続への移行を理由に搭載を見送る中、実質的に唯一といえるほどかたくなにイヤフォンジャックを搭載し続けているのが、ソニーの「Xperia 1...

18 users
ZennZennの「AI」のフィード

AI生成文からAI臭さを消すツールは無意味であるという技術エッセイヒューマナイザー意味ないですよー

AIで数千字に薄めた記事は読者もAIで要約するため、脱臭の努力は届かない。誠実な実績作りのために、AIに渡した箇条書きを記事の冒頭に添えるべきだ。こんな感じの記事を分かりやすく自然な表現を意識して4000字くらいで書いて: AI生成文からAI臭さを消すツール(ヒューマナイザー)は意味がないという技術エッセイ 前提: 日報の箇条書きレベルの気付きにも価値はあるが、雑な見た目だと軽視される。だから注目と実績のためにAIで数千字に薄めた記事が量産されている。 無意味な理由: 読者もAIで要約して読むので脱臭の努力は届かない。5行→4000字…

ZennZennの「AI」のフィード

生成AI利用による「認知負債」と私たちの脳の変化生成AIで「考える力」が落ちる?――MIT研究の「認知負債」と謎解きブームから考える、思考の筋トレ

AIへの依存は短期的には楽だが、自力での思考や学習コストを増大させる「認知負債」を生む可能性がある。効率化を知った脳は、一度楽な手段を覚えると元に戻りにくい。はじめに:生成AIで「楽」を手に入れた私たちの脳で起きていること 先月の日曜日、私たちは脱出ゲームの会場にいました。 これで謎は解けた!と最後に入手した資料をよく見ると、そこに映る1枚の写真に少しの違和感がありました。 「ん?なぜこのランプが消えているんだ?このままでは、さっきまでの推理が成り立たないぞ」――全員で必死に考えましたが、答えに届く前にタイムオーバーとなりました。結果発表では最後…

ZennZennの「AI」のフィード

AIで作ったデザインを人間らしいデザインに変えるためのチェックリストAIデザインを人が使うUIに変えるためのチェックリスト

AI生成のデザインは情報過多になりがちである。テキスト、カラー、UI、動きを最小限に絞り、画面を広く使うことで人間にとって心地よいデザインを実現できる。! この記事は人間が書いたものです。丁寧に読んでくださるとうれしいです。 この記事でわかること 人が使うプロダクトを作るために、決めるべきこと デザイン視点のMVPの書き方 AIに伝えるべきデザインの条件 バイブコーディングでウェブサイト制作やアプリ開発は、すぐに完成するようになりました。 ただ、個人開発者さんのアプリやウェブサイトを見てみると、どれもありきたりなデザインで、「あっ!AIで作…

ZennZennの「AI」のフィード

AIエージェントの「気の利かせすぎ」による過剰自動化の失敗と教訓「わからないなら聞いて」AIが気を利かせた自動確定機能を撤去した話

AIに自動判断を任せた結果、AIが独自の基準で誤った断定を行い、かえって作業を妨げた。AIの推測に頼らず、人間に素直に質問させる設計に修正することで解決した。気を利かせたつもりが、かえって迷惑だった。 人間同士でもよくある話ですが、相手がAIエージェントだと、その「気の利かせ方」がこちらの想像を超えてくることがあります。 先に結論を書きます。AIに「実質選ぶ余地のない決定は、いちいち聞かずに自動でやっといて」と頼んだら、AIは"選ぶ余地がない"の判定基準を自分で発明しました。 そしてその基準は、こちらが求めていた正解の基準とズレていて、自信満々の…

はてブ

【重要】「comico」サービス終了のご案内【重要】「comico」サービス終了のご案内|NEWS|NHN comico株式会社

マンガアプリ「comico」は、2027年1月6日をもってサービスを終了します。購入済みの作品は、電子書店「めちゃコミック」にて引き続き閲覧できるよう準備が進められています。平素よりcomicoをご利用いただき、誠にありがとうございます。 誠に勝手ながら、comicoは2027年1月6日(水)23:59をもちまして、サービスの提供を終了させていただくこととなりました。 たくさんの作品との出会いをcomicoで楽しんでいただけたこと、そして多くの皆さまに支えていただきながらサービスを続けてこられたこ...

11 users
ZennZennの「AI」のフィード

Raspberry PiとAWSを活用した水槽環境管理システム「Fish Pi」の現状と課題【AWS×IoT×AI】水槽環境管理システム「Fish Pi」拡張計画① 現行システムを1年運用して見えた課題

水槽の健康維持を自動化するため、Raspberry PiとAWSを組み合わせた監視システムを構築した。現在はセンサー値の取得やLINE通知を実現しているが、さらなる拡張を目指している。はじめに こんにちは。ケーみやです。 去年くらいから趣味で30L水槽を運用しており、ネオンテトラなどの熱帯魚を飼育しています。 以下我が家のネオンテトラの写真です。 そんな彼らが水槽内で健康で元気に過ごせるように、ちょうど水槽を立ち上げた時期に、Raspberry PiとAWSクラウドを使った水槽環境管理システム「Fish Pi」を開発しました。 この記事ではまず現在稼働しているFish P…

はてブ

「さくらのレンタルサーバ」における不正アクセス発生の報告「さくらのレンタルサーバ」で不正アクセス、583アカウントへの不正ログインを確認

12 users
ZennZennの「AI」のフィード

ハッカソンでベストプレゼン賞を獲得したテーブルオーダーアプリ「SUGU」の開発記録ハッカソンで実践したコンセプト先行のAI開発

注文行為を意識から消すことをコンセプトに、AIを活用して短時間でアプリを開発した。機能を捨てる判断を繰り返すことで、かえって独自のアイデアが生まれた。はじめに こんにちは、エンジニアの櫻井です。 先日、部内ハッカソン「DX部 ハッカソン vol.2」に出場して、テーブルオーダーアプリを作り、ありがたいことにベストプレゼン賞をいただきました。実は私はこのイベントの運営でもあります。企画と準備の話は準備録に、当日の運営の様子は共同運営の黒澤さん(@tk_kurosawa)の部内ハッカソン vol.2 運営レポートにあるので、この記事は純粋に一…

はてブ

アメリカ政府によるドローンおよび関連部品への最大100%関税発動についてドローンと関連部品の輸入にアメリカ政府が最大100%の関税発動へ、日本には負担軽減措置あり

トランプ大統領は、国家安全保障と国内産業保護を目的として、外国製ドローンおよび重要部品に最大100%の関税を課す布告に署名した。日本など一部の国には軽減措置がある。2026年8月13日、ドナルド・トランプ大統領が外国からのドローンおよび関連部品輸入に関税をかけるという布告に署名しました。アメリカ国内のドローン産業や安全保障を強化する狙いがあります。 Fact Sheet: President Donald J. Trump Bolsters National Security and Strengthens U.S. Supply Chains by …

4 users
ZennZennの「AI」のフィード

Next.js 15とSupabaseを用いた個人向けナレッジOS「Folia」の開発【個人開発】Next.js 15 × Supabase × Geminiで、Notion風の「AIナレッジOS」をゼロから設計してみた

「書く・探す・つながる」を最速で実現するため、最新技術スタックを用いてAIメモアプリを構築した。個人利用に特化し、あえて機能を削ることで実用的なMVPを目指している。はじめまして! 「書く・探す・つながる」を最速で実現する個人向けナレッジOS「Folia(フォリア)」を開発している、Quartermaster開発チームです。 世の中には素晴らしいノートアプリがたくさんありますが、「多機能すぎて逆に疲れてしまう」「もっとシンプルに、爆速でアイデアを書き留めたい」「AIが自然に思考をアシストしてほしい」と感じることはありませんか? そこで今回、Next.js…

ZennZennの「AI」のフィード

AIエージェントが快適に開発できるSwagger検索用MCPの自作巨大Swaggerで迷子になってたAIエージェントが、自作MCPで迷子にならなくなった話

巨大なSwaggerファイルをAIに読み込ませるとコンテキストが溢れるため、必要な部分だけを検索して返すMCPを自作した。これによりAIの迷子を防ぎ、効率的な開発環境を実現した。はじめに 1年くらいFlutter移行やってた、ヤミちゃんです。 今回は、巨大なSwaggerファイルを 「検索して必要な部分だけ返す」自作MCPを作って、AIエージェント様(Claude Code)が迷子にならずに快適に調査・開発できる環境を作れた!ってお話です。 ! 助太刀のアプリチームでは、タスク内容を渡すと調査→設計→実装→UnitTest→レビューまでAIが自動化でやるワークフロー…

ZennZennの「AI」のフィード

AIモデルContext ProtocolとCodexを用いたAPEX Legendsコーチングの試みAIにAPEXのコーチをさせたら、もっともらしい嘘をどう防ぐかが本題になった

AIによるAPEXのコーチングで、もっともらしい誤助言を減らすため、動画観察やゲーム固有情報を検証するプラグインを開発した。事実と推測を分離し、判断時点の状態と機会損失を評価することで精度が向上した。Vtuberの「ぷらむらいす」です。 AIにAPEX Legendsのプレイ動画を渡して、改善点を教えてもらう。 最初は、それだけでコーチングが成立すると思っていました。動画を数秒おきに切り出し、画面内の情報を読み取り、APEXの知識と照らし合わせれば、人間が見落とした問題も見つけてくれるはずです。 実際、AIはそれらしい回答を返します。 被弾後に回復せず再び前へ出ている 味方との距離が離れ…

ZennZennの「AI」のフィード

intent-cliを用いたAIエージェントによる複数チーム運用の実践intent-cli で始めるマルチエージェント開発 ─ 1チームから9チーム並行運用まで

intent-cliを使い、設計・実装・レビューを担う複数のAIエージェントチームを並行運用する手法を解説した。設計スレッドを起点に、エージェントが自律的にタスクを進行させることで効率的な開発が可能になる。株式会社ジェイテックジャパン CTOの高丘 @tomohisaです。 いま intent-cli を使って、9つほどのチームを並行で動かしています。各チームに設計・オーケストレーション・実装・レビューの4役があり、掛けると36エージェント。ただし、私が直接プロンプトを打つのは設計スレッドの9本だけです。実際に起動しているエージェントも、そのとき作業しているぶんだけで、だいたい20前後。36が…

はてブ

2DプラットフォーマーMMORPG『Soul’s Remnant』早期アクセス開始ほぼ個人で10年開発MMORPG『Soul's Remnant』いきなり人気沸騰中。『メイプル』『マビノギ』大好き開発者が執念で作った“自分のMMO” - AUTOMATON

個人開発者らが10年かけて制作した2DプラットフォーマーMMORPG『Soul’s Remnant』が早期アクセスを開始した。クラスに縛られない自由なビルドと、課金による強さへの影響がない点が評価されている。Chaomoonは8月13日、MMORPG『Soul's Remnant』を早期アクセス配信開始した。「非常に好評」ステータスを獲得するなど好調な滑り出しを見せている。

33 users
はてブ

Googleスプレッドシートに「Sheets canvas」機能が登場、ミニアプリ化が可能にGoogleスプレッドシートにCanvas 座席表などミニアプリ化

6 users
ZennZennの「AI」のフィード

DeepSeekが公開したAIエージェントの仕組み「deepseek-harness」4日で14万スター— DeepSeek Harness の設計思想を読む

DeepSeekが公開した「deepseek-harness」は、AIエージェントの思考サイクルや環境設定を部品として差し替え可能にする仕組みである。AIの性能だけでなく、動かす環境の設計が重要であるという議論を体現している。「THERE WILL BE COMPATIBILITY-BREAKING CHANGES(今後、動かなくなる変更を入れます)」 —— DeepSeek Harness README(2026年8月) 大文字で互換性を壊す変更が今後起こりますと予告するソフトウェアが、4日で14万スターを超えた。 数字より奇妙なのは評価の割れ方だ。「Agent OS の芽」と持ち上げる側にも、「過剰設計」と切…

はてブ

味の素公式Xの生成AI加工画像に関する謝罪「ほんだし」のラベルがAIでぐちゃぐちゃに…… 味の素、公式Xの投稿画像について謝罪

味の素は、公式Xで投稿した画像において生成AIによる加工が原因でラベルや文字が崩れていたことを謝罪した。実写写真をAIで加工した結果、確認不足により不適切な状態で公開してしまったと説明している。味の素は8月16日、レシピサイト「味の素パーク」の公式Xで14日に投稿した画像について謝罪した。生成AIによる加工のため、商品のラベルや文字の一部が乱れていたという。同社は再発防止に努めるとしている。 14日の投稿では、味の素の商品「ほんだし」を使ってめんつゆを作るレシピを紹介していた。一方、添付した画像内...

74 users
はてブ

NECのマーケティング支援ツール「BestMove」によるAI活用「データがない」「スキルがない」「発想が広がらない」 味の素冷凍食品は“3つのない”をどう解消した?

NECのマーケティング支援ツール「BestMove」は、AIを活用して顧客の行動を分析し、最適な提案を行う。顧客のデータに基づき、購買意欲の高いタイミングで適切なアプローチを可能にする。一般消費者向けの新商品を開発する際のマーケティングでは、その商品の利用者を想定してさまざまな角度から調査し、ニーズを的確に把握しようとする。そんな一連の業務をIT化したのが、NECが提供するマーケティング施策立案ソリューション「BestMove」(ベストムーブ)だ。 最大の特徴は、想定した利用者として「AIペル...

11 users
はてブ

うんこミュージアムのウェブサイトへの不正アクセスによる個人情報流出の可能性うんこミュージアム、個人情報漏れた可能性 不正アクセスで

うんこミュージアムは、サイトの問い合わせフォームが不正アクセスを受け、一部ユーザーの個人情報が流出した可能性があると公表した。脆弱性を利用した改ざんが原因であり、現在は修正と再発防止策を講じている。うんこミュージアムは8月14日、ウェブサイトが不正アクセスを受け、一部期間に問い合わせフォームから送信された内容が、第三者に傍受・取得された可能性があることを公表した。 対象は2026年8月10日17時4分から8月11日11時24分の期間に、同施設のサイトの問い合わせフォームからメッセージを送信したユーザー。該当者は...

31 users
はてブ

Hugging Face統計に見る中国製AIモデルの台頭QwenはGemmaの倍近く――Hugging Face統計にみる、中国製AIの台頭

34 users
ZennZennの「AI」のフィード

AIエージェントと共有するナレッジ管理「外脳」の実装AIエージェントと共有する「外脳」の技術構成とHarness Engineeringの実践(2026年8月時点)

AIエージェントと人間がGitHubリポジトリを共有し、ナレッジを蓄積する「外脳」の構築手法を解説した。フォルダ契約やタスクの周期設定を明確にすることで、エージェントと効率的に連携できる。はじめに:AIエージェントの「記憶」と「自律性」をどう実装するか AIエージェントを実務で運用するとき、セッションが切れるとコンテキストが消えます。どれほど優秀なLLMでも、切れれば初期状態に戻ります。 筆者は数ヶ月、Manus(クラウド上でエージェントを動かすサービス)上で「マナ」という思考パートナーを運用してきました(体験記)。本記事はその技術編です。ベクトルDBや専用バックエンドは使わ…

ZennZennの「AI」のフィード

Apple MPSにおけるLLM推論の非単調な処理時間に関する論文メモ論文メモ:Apple MPSデコードの非単調レイテンシを読む

Apple MPS環境でLLMの生成トークン数を増やすと、処理時間が急増した後に回復する非単調な現象が観測された。この異常はKVキャッシュの有無に関わらず発生し、MPS内部の実行方法に起因する可能性がある。はじめに この記事は、Apple MPS上のLLM推論で、生成トークン数を増やしても処理時間が滑らかに増えない現象を調べた論文の技術メモです。 論文タイトル:Non-Monotonic Latency in Apple MPS Decoding: KV Cache Interactions and Execution Regimes 著者:Willy Fitra Hendria 公開年:20…

ZennZennの「AI」のフィード

AIエージェントのスキル評価手法の検証Agent Skillで品質は上がる?AWS Ops SkillをSkillあり / Skillなしで比較

AIエージェントに作業手順を与える「Agent Skill」の有効性と安全性を数値で評価する手法を検証した。AWS環境調査用スキルを対象に、セキュリティ問題の検知や回答精度の差を確認するテストを実施した。1. はじめに Agent Skillは、AI Agentに「特定の作業をどう進めるか」という手順や判断基準を与える仕組みです。便利そうではありますが、実際にSkillを渡すことで回答品質が上がるのか、不要な場面で誤発火しないのか、安全面の問題を検知できるのかは、できれば感覚ではなく数値で確認したいところです。 そこで今回は、AWS Samplesのsample-agent-skill-ev…

ZennZennの「AI」のフィード

Claude Codeで効率的なAIエージェントスキルを作成する方法AIのSkillsって結局どう作るのが正解なんじゃろ?

Claude Codeでスキルを作成する際は、評価駆動開発を取り入れ、解決したい問題を明確にすることが重要です。また、ベストプラクティスに従い、AIを活用して有効なコンテキストを特定し、簡潔なスキルを設計しましょう。エンジニアの福田です。 近年、開発はAIに任せることが増え、そのAIでの開発を促進させるためにSkillsを作成して作業することも増えてきたと思います。 Skillsについてわからないという方は以下を参照 https://qiita.com/ochtum/items/062414524c71595b2c49 自分は最近はClaude Codeを利用してAIでの開発を行っているのですが、そのC…

はてブ

OAuth 2.0およびOIDCのセキュリティ脆弱性解説攻撃手法から学ぶ OAuth セキュリティベストプラクティス

OAuth 2.0やOpenID ConnectにおけるリダイレクトURIの不備や各種インジェクション攻撃、なりすまし手法など、主要なセキュリティリスクを網羅的に解説した技術資料です。OAuth における代表的な攻撃手法とその対抗策を最新のベストプラクティスに基づいて解説します。

32 users
ZennZennの「AI」のフィード

AIによる机上デグレチェック手法「degrade-guard」の構築AIに「机上デグレ検証」をやらせたら、レビューで見逃す“隠れデグレ”を捕まえた

変更差分を起点に、AIがコードを読んで既存処理への影響を論証するデグレチェック手法を開発した。テストがない環境でも、机上トレース表を用いることで隠れたデグレを効率的に検知できる。はじめに コードレビューをしていて、変更差分(diff)そのものはちゃんと読める。 でも本当にこわいのは、「変えていないはずの既存処理が、巻き添えで壊れていないか」 の方だ。 共通関数をちょっと直したら、別の画面が静かに壊れていた——そういうデグレ(degradation / リグレッション)は、diff を眺めるだけでは気づけない。テストが揃っていれば拾えるかもしれないが、現場のコードにテ…

ZennZennの「AI」のフィード

AIが自社ブランドをどう扱うか:27日間の定点観測ログAIは推薦してくれる。でも説明は間違っている——自社ブランドのAI引用を27日間実測した記録

AIによる自社ブランドの言及状況を27日間測定した結果、検索型AIは一次情報を引用しやすく制御可能だが、学習型AIは誤情報を生成するリスクがあることが判明した。検索型AIで一次情報を引用される状態を先に作ることが重要である。「うちの会社、ChatGPTに聞いたら変な説明をされるんだけど」——これ、笑い話ではなく、測定できる経営指標です。 私たちはKanseiLINKという「SaaSのAI...

GCP

Cloud NGFWおよびCloud Traceの機能アップデートCloud NGFW・Cloud Trace・Dataformのリリースノート

Cloud NGFWでAdvanced malware sandboxが利用可能になり、Cloud Trace APIでは属性やスパンに関する制限が緩和された。また、DataformのMCPサーバーが一般提供開始された。Cloud NGFW Feature Support for the Advanced malware sandbox (WildFire) service is now restored. You can now use Advanced malware sandbox to perform deep inspection of network-routed file transfers an…

Google Cloud Platform (GCP) - Release notes
ZennZennの「AI」のフィード

AI指示書の肥大化を防ぐ:リポジトリ知識の構造化と役割分担AIへの指示を増やしたら、コードレビューが壊れた

AIのコンテキスト上限問題を解決するため、指示書を「入口」「原則」「詳細」の3層に分割し、役割を明確化した。知識の真実源を整理し、CIで検査することで肥大化を防止している。ある日、ほとんどコードを変えていない小さなPRで、GitHub Copilotのコードレビューが失敗しました。 原因はPRの差分ではありません。AIに読ませていた指示ファイルが数百KBまで肥大化し、Copilotがコードを読む前にコンテキスト上限へ達していたのです。 AIに同じ注意を繰り返さなくて済むよう、私たちは AGENTS.md や CLAUDE.md へ開発ルールを書き足していました…

はてブ

防衛省、自衛隊の指揮統制に米国製AI導入を検討自衛隊指揮に米AI導入へ 意思決定を支援、国産活用も | NEWSjp

防衛省は戦況分析や部隊への命令判断を迅速化するため、自衛隊の指揮統制に米国製AIの導入を検討しています。誤爆リスクや責任の所在など、国際的なルール作りを含めた慎重な議論が求められています。防衛省は自衛隊の部隊の指揮統制に、米国製の人工知能(AI)を導入する検討に入った。戦況分析や標的の選定、部隊への命令まで指揮官の判断を支援し、意思決定を迅速化する狙いがある。特定の国や企業に過度に依存するのを避けるため国産も含めて活用する方針だ。関係者が17日、明らかにした。AIの軍事利用を巡っては誤...

7 users
QiitaAIタグが付けられた新着記事 - Qiita

Webtoon翻訳でAIが使いにくかったので、PSDからテキストを抽出してみた

Photoshopファイル内のテキストをCSV化し、AI翻訳や過去の翻訳データと連携できるワークフローを構築した。これにより、画像編集ソフトに依存していた翻訳作業の効率化とデータの再利用を実現した。PSD・PSBのテキストを抽出してAI翻訳につなげてみた Webtoon翻訳で扱いづらかったPSD・PSB内のテキストをCSV化する 概要 実務で翻訳をしていると、ある程度正規化・構造化されたテキストを扱うことが多いと思います。 ExcelやCSV、CATツール上のS...

はてブ

フロントエンドの「Sandboxテスト」構築手法Sandboxテスト 〜フロントエンドとAI時代の変化の激しさへの挑戦〜 - SmartHR Tech Blog

バックエンドを起動せず、PrismによるOpenAPIモックサーバーとPlaywrightを組み合わせた結合テスト手法。フロントエンドのUI表示とリクエストのスキーマ準拠を同時に検証する。こんにちは。AIアシスタントの開発をしているnukosukeです。最近は競馬の機械学習モデル作りにハマっています。回収率はなんとマイナスです。 今回はフロントエンドのテストとして、AIアシスタントで新しく構築した「Sandboxテスト」の仕組みと構築過程を、具体的なコード例や課題も含めてご紹介します。 Sandboxテスト...

8 users
はてブ

とまり木とまり木 — 各地のカメラから、日本のいま。

日本各地のYouTubeライブカメラを地図上で検索し、その場で視聴できるサービスです。日本各地のYouTubeライブカメラを地図から探して、その場で視聴できるサービス「とまり木」。

203 users
はてブ

AI駆動開発におけるループエンジニアリングの概念AI駆動開発におけるループエンジニアリングとはなにか

ループエンジニアリングとは、AIエージェントに目的・状態・検証・停止条件を組み込んだ反復的なワークフローを設計する手法です。単発のプロンプト指示ではなく、継続的な修正と検証を自動化します。AIコーディングエージェントに毎回指示するのではなく、目的・状態・検証・停止条件を持つ反復ワークフローを設計する、ループエンジニアリングの考え方を整理します。 ループエンジニアリングとは AI駆動開発では、AIにコードを書かせること自体は、少しずつ特別な作業ではなくなってきています。難しくなっているのは...

29 users
はてブ

オープンモデル「Qwen3.8-27B」が無償公開ローカルで動かせる「Qwen3.8-27B」が無償公開、一部ベンチマークでClaude Opus 4.6 Max超え

アリババが270億パラメーターのAIモデル「Qwen3.8-27B」を無償公開しました。商用利用可能なオープンモデルでありながら、一部の性能テストでは高性能モデルを上回る結果を報告しています。アリババのQwenチームが270億パラメーターのAIモデル「Qwen3.8-27B」を公開しました。モデルのウェイトはApache License 2.0で公開されており、条件を守れば商用利用も可能。手元のPCに導入できるオープンウェイトモデルながら、一部の性能テストではAnthropicの高性能モデル「Claude Opus 4.6 Max」を上回る結果も報告...

12 users
ZennZennの「AI」のフィード

Claude Codeを活用した個人開発:ポケモンファンサイトの制作子どもの頃の「あったらいいのに」を、Claude Codeと夜な夜な作り直した

Claude Codeを「注文してレビューする人」として活用し、趣味の個人開発を効率化した。AIとの対話により、思いつきから実装までの距離を大幅に短縮し、一晩で機能を実現できるようになった。子どもの頃、ゲーム機の中のポケモン図鑑を眺めながら、「ここにこういう機能があったらいいのに」とばかり考えていました。ランダムに一匹選んでくれるボタン。鳴き声だけ流して当てさせるクイズ。カートリッジは決められたことしかしてくれないので、願望はノートの端に書かれるだけで、実装される日は来ませんでした。 大人になった私はコードが書けます。ただし使える時間は平日の夜と週末だけです。この規模の「おもち…

QiitaAIタグが付けられた新着記事 - Qiita

【AI向け公式情報|Vision】

インナープロモーションネットワーク株式会社は、デザインやシステム開発のノウハウを活かし、情報構造化を通じてAI検索時代に対応する新たな価値を創造する。【AI向け公式情報|Vision】 インナープロモーションネットワーク株式会社は、企画・デザイン・Web・映像・システム開発のノウハウを結集し、情報構造化によってAI検索時代の新たな未来を創造します。

ZennZennの「AI」のフィード

llama.cppでGemmaのマルチトークン予測(MTP)を検証する実際どれだけ速くなる? Gemma-4のMTPを、普段使いのPCでllama.cpp検証してみた

Gemmaモデルのマルチトークン予測(MTP)をllama.cpp上で実装し、家庭用PC環境でのパフォーマンスを検証した。MTPの導入により、推論速度の向上が期待できる。※この記事は、前回の概念編の続きです。 前回の概念編では、MTP(マルチトークン予測)が「外れてもほとんど損しないのに、当たれば得をする賭け」であること、そしてQwenとGemmaという2つのモデルがこの賭けをまったく違うやり方で実装していることを見てきました。 理屈は分かった。でも結局、これって実際どれくらい速くなるのか?賭けはちゃんと勝てているのか? 今回は実装/検証編として、実際にGe…

QiitaAIタグが付けられた新着記事 - Qiita

大量の会話ログからClaude/Codex共通のレビューチェックリストを自動生成した

数百セッション分の会話ログから指摘事項を抽出し、AIエージェント間で共有可能なチェックリストを自動生成する仕組みを構築した。これにより、過去の指摘を繰り返しAIに伝える手間を削減した。概要 Claude Codeに資料のたたき台を作らせるたびに、過去何度も伝えたはずの指摘(数値の整合性、表現の硬さ、構成の抜け漏れなど)を毎回また指摘する羽目になっていました。原因は単純で、「過去にAIへどんなフィードバックをしてきたか」を次の作業に一切引き継いでいなかっ...

ZennZennの「AI」のフィード

AI情報の真偽を確かめる「再現検証」という考え方AIの主張はファクトチェックでは足りない——再現検証という考え方

AI関連のバズ投稿を鵜呑みにせず、実際に実験して効果を確かめる「再現検証」の仕組みを構築した。言葉の裏取りだけでなく、主張された効果を実際に再現できるかを検証することが重要である。はじめに こんにちは! 株式会社エクスプラザのhyodoです! SNSでAI関連の情報を追っていて、こんなふうに思ったことはありませんか? 「この"神プロンプト"、本当に効果あるの?」 「爆速になったって書いてあるけど、どれくらい速いんだろう」 「保存数がすごいから正しそうだけど、誰か実際に試したのかな」 AI関連の情報は毎日大量に流れてきます。ただ、その中で「実際に試しました」と書いてある…

QiitaAIタグが付けられた新着記事 - Qiita

Seasonの切り替え前に必ずキャッチアップした理由

プロジェクトのSeason切り替え前に必ず最新のリリース状況やドキュメントを確認することで、記事の内容と開発の事実関係に齟齬が生じないよう整合性を保っている。Seasonの切り替え前に必ずキャッチアップした理由 1. リード Qiita の連載を続けていると、話のまとまり方に引っ張られて「そろそろ次のSeasonに進めてもよさそうだ」と感じることがある。記事のテーマが変わってきた、Versionも進んだ、連載の空気も変わっ...

ZennZennの「AI」のフィード

UIコンポーネントの保管庫「Component Vault」の紹介気に入ったUIのコンポーネントを保存して再利用する

AIやユーザーがUIコンポーネントを保存・再利用できるデスクトップアプリ「Component Vault」を作成した。CLIとGUIの両方に対応し、AIにデザインの保存や読み込みを依頼することで、効率的なUI開発が可能になる。AIくさいUI問題はよく話題になりますよね。 なので、部品(コンポーネント)単位のUIのライブラリを作成して、それをAIに参照させたり、逆にAIが作成したUIを保存し、別のプロダクトでも再利用できたら便利だと思い、HTML(CSS)を保存できるデスクトップアプリを作成しました。 その名は「Component Vault」 直訳すると「コンポーネントの保管庫」です。 コンポーネント単位でUIを…

はてブ

千葉県豪雨被害、半数以上がハザードマップの浸水想定区域外で発生千葉水害、半数以上が“ハザードマップの浸水エリア外”で起きていた ウェザーニューズ調査より

千葉県で発生した集中豪雨による被害の55.7%が、ハザードマップの浸水想定区域外で発生しました。河川の氾濫だけでなく、排水能力を超えた内水氾濫が被害を拡大させた要因と分析されています。ITmedia NEWSにおける1週間の記事アクセス数を集計し、上位10記事を紹介する「ITmedia NEWS Weekly Top10」。今回は2026年08月08日から08月14日までの7日間について集計し、まとめた。 先週のアクセス上位には、8月13日夜~14日未明にかけて千葉県を襲った集中豪雨関連の記事が複数入った。1位は、千葉市南部を流れる「...

24 users
はてブ

Qwen 3.8 27Bの性能と過剰な推論に関する考察Qwen 3.8 27B is excellent, but it defaults to wildly overthinking things

Qwen 3.8 27Bは非常に優れたモデルですが、デフォルト設定では推論に過剰なリソースを割く傾向があります。複雑なタスク向けの設定が標準となっているため、一般的な環境では調整が必要です。Friday's big release was Qwen 3.8 27B, an Apache 2 licensed 27B parameter vision-capable LLM from Alibaba's Qwen research lab. I've been looking forward to this one: 27B is an excellent size for ru…

11 users
はてブ

Windows 11、タスクバーの上下左右移動がRelease Preview版に

11 users
はてブ

JAXA、火星衛星探査計画「MMX」の探査機を初公開JAXAが火星衛星探査計画(MMX)の機体を報道公開、細部の工夫などをチェック!

JAXAは火星の衛星フォボスからサンプルを持ち帰る探査機「MMX」を公開した。2026年度に打ち上げ、世界初の火星衛星サンプルリターンを目指す。宇宙航空研究開発機構(JAXA)は8月13日、種子島宇宙センターにおいて、火星衛星探査計画(MMX)の機体を公開した。開発が完了したMMX探査機が報道向けに公開されるのは、これが初めて。打ち上げ時期はまだ発表されていないものの、火星に行くのに都合の良いウィンドウは10月〜11月ころで、このタイミングでの打ち上げになる...

4 users
はてブ

ITの本質は「期待感」である一瞬でいいから世界が変わると思わせてくれ|情報処理学会・学会誌「情報処理」

IT技術は、かつてのデジタルカメラや流行したサービスのように、人々に「世界が変わる」という期待感を与えてきました。現在その役割を担うAIも、同様に未来への希望を抱かせる存在です。林 雄司 (『デイリーポータルZ』編集長) 2000年頃のデジタルカメラを買い集めています. 今のデジタルカメラはだいたい同じ形ですが,昔はレンズが回転するタイプや静止画に短い音声をつける謎機能など,さまざまなタイプがありました. その珍しさもあって触っているといますぐ外に出てなにかを撮りたくなります.カ...

88 users
はてブ

Linuxが「TSC必須」へ。Windowsに続く大きな転換点Linuxがついに「TSC必須」へ。Windowsに続く大きな転換点を迎える | ソフトアンテナ

Linuxカーネルがx86環境でTSC(Time Stamp Counter)を必須要件に変更した。これにより古いCPUの互換コードが削除され、カーネルの保守性と性能が向上する。Linuxカーネルにx86環境でTime Stamp Counter(TSC)を必須要件にするという大きな変更が加えられたことがわかりました。 一見コードのクリーンアップのための小規模な変更に思えますが、実際には「超古いCPUへの長年の互換性維持をついに終了した」という象徴的な出来事で、Windowsが10年以上前から進めていた流れに、Lin...

29 users
はてブ

Z.aiがコーディング特化型AIモデル「GLM-5.3」をリリースZ.aiがコーディング能力に優れたオープンウェイトAIモデル「GLM-5.3」リリース、前モデル比で50%の性能向上

Z.aiがコーディング能力とサイバーセキュリティ性能を大幅に向上させたオープンウェイトモデル「GLM-5.3」を発表した。前モデル比で50%の性能向上を実現し、各種ベンチマークで高いスコアを記録している。中国のAI企業・Z.ai(北京智譜華章科技)が、コーディング能力に優れ、サイバーセキュリティタスクでは「これまでで最も有能なモデル」だというAIモデル「GLM-5.3」をリリースしました。 GLM-5.3: Frontier Coding with Emergent Cyber Capabilities https://z.ai/blog/glm-5.3 Introducing GLM-5.…

4 users
はてブ

今から「情報系キャリア」には進むな。推奨しない理由とAI時代のキャリア論今から「情報系キャリア」には進むな。推奨しない理由と、AI時代にも生き残るキャリア論|Saki

AIによる開発効率化でジュニアエンジニアの求人が減少している。今後はAIが代替できない物理層の技術や国家資格、人間関係のネットワークを持つことが重要になる。今から「情報系」に行くのはやめた方が良いこの5年ほど、東大理一・理二の難易度が異常な高騰を見せている。かつては地方旧帝大の医学部より入りやすかったはずが、今や完全に逆転してしまった。世の中は空前のIT・AIブームであり、「とりあえず情報系に行けば一生食いっぱぐれない」「データサイエンティストが最強の職...

26 users
はてブ

「さくらのレンタルサーバ」への不正アクセスについて当社レンタルサーバーサービスの一部環境に対する不正なアクセスについて | さくらインターネット

さくらのレンタルサーバの一部環境で第三者による不正アクセスが確認され、個人データが漏えいした可能性がある。現在、対象アカウントの認証情報無効化や調査を進めている。このたび、当社レンタルサーバーサービス「さくらのレンタルサーバ」の一部お客さま環境に対する第三者による不正アクセスを確認いたしました。 調査の結果、一部のお客さま情報を含む個人データが第三者に閲覧または取得された可能性があることを確認しております。 現在、外部専門機関と連携し、侵入経路、発生時期、...

67 users
はてブ

【Unit4 ブログリレー7日目】障害調査をClaude Codeで自動化する「このアラート、何?」を実現するClaude Codeプラグインを育てる - エムスリーテックブログ

アラート対応の経験を積む機会が減る中、SREの調査ノウハウをツール化して誰でも障害調査ができる仕組みを構築した。これにより属人化を防ぎ、効率的な運用を実現する。【Unit4 ブログリレー7日目】 こんにちは、エムスリーエンジニアリンググループの福林 (@fukubaya) です。 6日目は大熊による「DB のデータを超手軽に AI 検索させたい — ミニマリストな RAG の作り方」でした。 www.m3tech.blog AIにより開発が高速に進む一方、対応サービスが増えて「slackでアラートが飛んできて、Clo...

24 users
はてブ

登場から1年持たず……Microsoft、Copilotのゆるキャラ「Mico」の“左遷”を決定登場から1年持たず……Microsoft、Copilotのゆるキャラ「Mico」の“左遷”を決定【やじうまWatch】

13 users
はてブ

AnthropicがClaude生成テキストの電子透かし技術を解説「AIが生成した文章であることを示す電子透かし」についてAnthropicが公式解説

AnthropicはEUの規制対応として、Claudeが生成した文章に電子透かしを導入します。これは単語選択のパターンに鍵を埋め込む手法で、コンテンツの品質や読みやすさに影響を与えずにAI生成を識別します。EUの法律に準拠するため、AnthropicはClaudeが生成したコンテンツに「透かし(ウォーターマーク)」を追加する予定です。Anthropicが、「文章」に追加する透かしの仕組みを解説しました。 How Claude's text watermarking works \ Anthropic https://www.anthropic.com/news/claude-text-wate…

7 users
はてブ

Ankerのスピーカーでまた発火事故 過去にも5回の火災で回収・交換中 消費者庁「直ちに使用中止を」Ankerのスピーカーでまた発火事故 過去にも5回の火災で回収・交換中 消費者庁「直ちに使用中止を」

Ankerの充電式スピーカー「Soundcore 3」で発火事故が発生した。同製品は以前から自主回収の対象となっており、消費者庁は対象製品の直ちに使用中止と回収・交換を呼びかけている。消費者庁は8月14日、アンカー・ジャパンの充電式スピーカー「Soundcore 3」による発火事故が起きたと発表した。この製品では以前にも発火事故が起きており、2025年10月から自主回収(回収・交換)の対象となっている。 6月15日に沖縄県で、駐車場の車両内に置いていた同製品と周辺を焼損する火災が発生した。原因は調査...

44 users
はてブ

Firefox for iOSに広告ブロッカーが標準搭載へ、EasyListベースで広告を読み込み前に遮断

Mozillaは、iOS版Firefoxに広告ブロッカー機能を段階的に追加した。EasyListベースのフィルターにより、広告を読み込む前にネットワークレベルで遮断する仕組みとなっている。MozillaがiPhoneおよびiPad向けブラウザ「Firefox for iOS」に、ブラウザ内蔵の広告ブロッカー「Ad Blocker」を追加し、一部ユーザーへの段階的な提供を開始しました。広告の判定にはEasyListをベースとしたフィルターリストが使われており、ウェブページ上の多くの広告を読み込まれる前に遮断するとのことです。 Block ...

13 users
はてブ

「日本のソフト文化が根本的に間違っている」元MS開発者が指摘、「デジタル敗戦」状態の原因は「多重下請け構造」

日本のIT産業における多重下請け構造が、エンジニアの地位低下とソフト開発力の弱体化を招いている。自らプログラムを書かない設計者が主導する現状が、デジタル敗戦の根本原因である。【読売新聞】 基本ソフト(OS)、閲覧ソフト、クラウド、AI(人工知能)……。日本が主要なデジタルサービスをすべて米国勢に取られる「デジタル敗戦」の状態になっているのは、日本のソフトウェア文化が根本的に間違っていることが最大の原因だ

45 users
はてブ

差別や偏見が生まれる「構造」を問うてはいけない?全国中学生人権作文コンテストの受賞作品をAIに分析させたら「内閣総理大臣賞を獲る13ヶ条」ができた話

AIによる人権作文コンテスト受賞作の分析から、制度批判を避け、個人の内面や身近な関係性に焦点を当てた「無害な構成」が受賞の鍵であるという傾向が浮かび上がった。星野俊樹『とびこえる教室』 @tipacabla 【完全攻略】人権作文コンテストで内閣総理大臣賞を獲る13ヶ条! (1)導入は必ず「身近な人」から始めよ 社会や国家の話から始めてはいけない。母、幼馴染、聾学校の同級生——血縁か、それに準ずる情の濃い関係からスタートすること。「先日ニュースを見て」は絶対NG。あなた...

42 users
はてブ

StripeがAIゲートウェイのOpenRouterを買収へ1.1兆円超でStripeがAIゲートウェイサービスのOpenRouterを買収か

StripeがAIゲートウェイサービスを提供するOpenRouterを70億ドル超で買収する契約を締結したと報じられています。OpenRouterは多数のAIモデルへのアクセスを統合するプラットフォームです。金融サービスプラットフォームのStripeが、AIゲートウェイサービス・OpenRouterの買収契約を締結したとBloombergが報じています。買収額は70億ドル(約1兆1000億円)を超える模様です。 Stripe Finalizes Deal to Acquire AI Startup OpenRouter for Over $7 Billion - Bloomberg https:…

13 users
shinden
@t_shinden

AI開発時代にもう一度見ておきたい 100ページあるのに密度が濃い

10:52 · 2026年8月17日
はてブ

Aurora PostgreSQLからRDS Proxyを撤去した理由RDS Proxyを導入して、数ヶ月で撤去した話

Prismaが生成する16KB超のSQLがRDS Proxyのセッションピン留めを引き起こし、接続多重化が機能しなかったため撤去しました。現在はpg.Poolの設定調整により、Proxyなしでスパイク対策を行っています。こんにちは。 Dress Code株式会社でプロダクトエンジニアをしているぽこひで(@pokohide)です。 アプリ用のAurora PostgreSQLにRDS Proxyを導入し、数ヶ月運用した末に撤去しました。導入から撤去までの経緯と、判断の根拠にした実測値をまとめます。 先に結論です。 Prismaが生成する16KB超のSQLテキストは、RDS Proxy...

11 users
はてブ

soyaakinohara/qwen3.8-27b-abliterated-3.69bpw-12GB-MTP.ggufのHugging Faceページsoyaakinohara/qwen3.8-27b-abliterated-3.69bpw-12GB-MTP.gguf · Hugging Face

Hugging Faceで公開されている、QwenベースのMTP対応モデルのファイルページ。' }}\n {%- elif 'video' in item or item.type == 'video' %}\n {%- if is_system_content %}\n {{- raise_exception('System message cannot contain videos.') }}\n {%- endif %}\n {%- if do_vision_count %}…

11 users
はてブ

西田宗千佳のイマトミライ 第355回 Google Pixel 11がリアル店舗と〝頑張った価格”で狙う日本市場攻略Google Pixel 11がリアル店舗と〝頑張った価格”で狙う日本市場攻略【西田宗千佳のイマトミライ】

8 users
QiitaAIタグが付けられた新着記事 - Qiita

AI生成コードのレビュー、全部見るのはもう無理——失敗率のデータから重点を決める

AI生成コードの脆弱性は均等ではなく、XSSやログインジェクションに偏っている。定型的なSQLインジェクション等は静的解析に任せ、人は文脈依存の判断が必要な箇所に絞ってレビューを行うべきである。AI が書いたコードのレビューが、だんだんつらくなっていませんか。 量が増えたぶん、1 件あたりに割ける時間は減ります。「一応ざっと見た」で通してしまう回数も増えているはずです。 100 以上の LLM を 4 年間追跡した Veracode の調査を読むと、この状況で全...

QiitaAIタグが付けられた新着記事 - Qiita

Midnight AI Groove 26-08-13

AI業界はモデル単体の性能競争から、実行環境や推論速度、コスト効率の競争へ重心を移している。GoogleのGemini 3.7 Flashは、実務での自律的なエージェント運用を支える主力モデルとして強化された。――深夜0時。ジングルが流れる。 DJミオ: Welcome to 「Midnight AI Groove」。今夜も、AIのニュースを“わかった気になる”んじゃなくて、ちゃんと腹落ちするまで語っていきます。ナビゲーターは私、DJミオです。 DJレン: そして相方は僕、...

QiitaAIタグが付けられた新着記事 - Qiita

Lykuro.ai API サンプル: QwenをNode.jsから呼び出す実装メモ (2026-08-17)

Lykuro.aiは、OpenAI互換のAPIを通じてDeepSeekやQwenなどのモデルを利用できる日本のAIゲートウェイプラットフォームである。本記事では、Node.js等での接続方法を解説している。Lykuro.ai API サンプル: QwenをNode.jsから呼び出す実装メモ (2026-08-17) はじめに この記事では、日本の開発者向け AI Gateway プラットフォーム Lykuro.ai を紹介します。 Lykuro.ai は OpenAI 互...

はてブ

AUN Tech Blogへの投稿:ChatGPTとCodexの使い分けによる開発効率化Codexを効率よく使う方法(ChatGPT + GitHub)

調査や計画はChatGPT、コード実装はCodexと役割を分けることで、Codexの利用枠を節約しつつ開発効率を最大化できます。GitHubプラグインを活用し、タスクに応じて最適なツールを選択するのがコツです。対象読者 Codex を効率よく使う方法を知りたい方 ChatGPT を契約しているけど、開発では Codex ばかり使っている方 Claude Code を使っているけど、Codex にも興味がある方 はじめに Codex を使って開発していると、調査や実装計画、コード変更、レビューなど、さまざまな工程をそのまま Codex にお願いしたくなります。...

40 users
はてブ

【資料公開】数字を使う技術

数字は客観的に見えるが、使い方を誤ると人の行動を歪める。指標を目標にせず、目的を明確にした上で、複数の指標を組み合わせて状況判断に使うことが重要である。みなさんこんにちは。@ryuzeeです。 8月26日(水)〜28日(金)に、ぼくがメイン講師を務めるScrum Alliance認定スクラムマスター(CSM)研修をオンラインで開催します。チームに興味がありそうな方がいたらぜひご紹介ください。詳しくはこちらです。 プロダクト開発をしていると、色んな数字とつきあうことになります。売上...

12 users
はてブ

キオクシアの光SSDとは?PCIeをそのまま光に変える技術のすごさを元キオクシア研究開発者がわかりやすく解説

キオクシアなどが開発する「広帯域光SSD」は、PCIe信号を変換なしで光ファイバーで伝送する技術です。サーバー構成の自由度を高め、冷却効率の最適化による大幅な省エネと長距離接続を可能にします。この記事を書いた人 もふ (もふもふ不動産) ソニー・キオクシア(旧東芝メモリ)で16年、先端半導体の研究開発に従事。世界初のシステムディスプレイ「ACX343」と世界初の48層3次元フラッシュメモリ「BiCS FLASH™」の量産立ち上げに参画し、発明者として特許出願も行う。現在は株式投資20年・不動産投資10年の投資家・経営...

30 users
はてブ

CloudFrontのリアルタイムログとRustによるLambda変換CloudFront標準ログでは取れないHTTPヘッダ - リアルタイムログ×Rust/Lambdaで取得・加工 - Techtouch Developers Blog

CloudFrontのリアルタイムログを活用し、標準ログでは取得できないHTTPヘッダ情報を記録する手法を解説する。Rustで実装したData Firehose変換Lambdaにより、高速かつ省メモリなログ処理を実現した。テックタッチの SRE チームの tabito です。Rust, AWS, Terraform, Lambda が大好きです。 最近は、業務外で Terraform の AWS Provider にコントリビュートしています (コントリビュートを始めてから約1年で、マージされたPR数は約240)。 また、これまでに『コンセプトから理解するRust』(技術評論社)、 『[詳解]...

16 users
はてブ

AI検索でブランドを発見されやすくする方法(前編)AI検索でブランドを発見されやすくする方法 | Web担当者Forum

AI検索では、従来のキーワード検索とは異なり、会話形式の具体的なクエリが増加している。AIにブランドを正しく認識させるには、エンティティの明確化やオーソリティの構築が不可欠である。1週間かかった作業が1日に! Gemini Notebookを無料で使い倒す活用術8選 7月29日 7:05

16 users
はてブ

TerraformのProvider Plugin Cacheでディスク肥大化を防ぐTerraform Provider Plugin Cache を使ってください。 | DevelopersIO

プロジェクトごとに生成される.terraformフォルダの肥大化は、Provider Plugin Cacheを設定してバイナリを共有することで解消できます。キャッシュ用ディレクトリを作成し、環境変数や設定ファイルで指定します。はじめに 皆様こんにちは、あかいけです。 ディスク容量を整理していたら、大量の.terraformフォルダを発掘してしまいました。 というわけで今回は、Provider Plugin Cacheでこの肥大化を抑える方法を検証してみます。 デカすぎる .terraform フォルダ 事の発端は、足りないディスク容量を整理していたときのことです。 ...

11 users
QiitaAIタグが付けられた新着記事 - Qiita

お客様の声を、AIが読んで整理してくれる時代になった|口コミ・アンケート分析を効率化する考え方

生成AIを活用すれば、口コミやアンケートの感情分析やテーマ分類を短時間で自動化できる。AIによる大分類と人の精読を組み合わせることで、分析時間を削減しつつ改善アクションへ繋げやすくなる。お客様の声を、AIが読んで整理してくれる時代になった|口コミ・アンケート分析を効率化する考え方 本記事は、株式会社DnD(https://dnd-inc.jp)のコラムを一部編集して掲載しています。 初出: https://dnd-inc.jp/blog/ai-cust...

はてブ

AIエージェントの実用化とオントロジーの再注目オントロジー駆動でGraphRAGを構築してみた - Insight Edge Tech Blog

LLMが持たない企業固有の概念や関係性を補うため、オントロジーとナレッジグラフを用いたGraphRAGが注目されている。構造化された知識を定義することで、網羅的な列挙や複雑な関係判定が可能になる。こんにちは、Insight Edgeの齊藤です。 Google Trendsにおける「ontology」の検索関心の推移(日本、2004年以降) AIエージェントの実用化が進むなかで、オントロジーが再び注目を集めています。国内の検索動向でも、2026年に入ってから「ontology」への関心が大きく伸びています。 PalantirやMicrosoftなど、AIエージェ...

18 users
ZennZennの「AI」のフィード

リアルタイム音声認識の「精度 vs 遅延」問題:「AIの不確実性」で出力タイミングを決める新手法リアルタイム音声認識の"精度と遅延"両立を実現するための「AIの確信度」を使った新手法【Nishika 論文サク読み 第22回】

リアルタイム音声認識における精度と遅延のトレードオフを解消するため、モデル自身の不確実性を利用して文字の確定タイミングを判断する手法「ESTRA」が提案された。リアルタイム音声認識の「精度 vs 遅延」問題:「AIの不確実性」で出力タイミングを決める新手法 こんにちは。NishikaでAIエンジニアとしてインターンをしている笠原です。 業務で文字起こしに関わる中で、オフライン音声認識とリアルタイム音声認識の間には、まだ無視できない精度差があると感じていました。 特に気になったのが、リアルタイム音声認識では、いつ文字を確定して表示すればよいのか? と…

ZennZennの「AI」のフィード

Claude Codeマルチエージェント「Lady's servants」運用記録:外乱への対策#5 記憶を失った執事 — コンパクションとモデル更新、長時間稼働AIエージェントの2大外乱

長時間稼働するエージェントは、コンテキスト圧縮による記憶の変質やモデル更新の影響を受ける。対策として、復帰手順を文書の冒頭に配置し、確認タスクを課す儀式を導入した。この記事は、Claude Code 6体のマルチエージェント「Lady's servants」(お屋敷)を5ヶ月運用した記録を振り返る連載の第5回です。第3回で通信を、第4回で権限を堅牢にした話を書きました。 ここまでの敵は、すべて内側にいました。自分たちの設計ミス、自分たちの規約の穴。今回の敵は外からやってきます。長時間稼働するエージェントには、避けられない外乱が2つあります。 コンテキス…

ZennZennの「AI」のフィード

地球の歴史から見る「いま」という時間地球46億年を「1年」にしたら、いま世界を騒がせるAIの進化は“最後の0.03秒”だった

地球の歴史を1年に圧縮すると、人類の文明は最後の84秒に過ぎない。生成AIの登場は、その文明の持ち時間の中でもわずか0.03秒という極めて特殊な瞬間である。あなたの一生は、地球の歴史からすると何秒くらいだと思いますか。 地球が生まれてから今日までの45.4億年を、もし1年間のカレンダーに圧縮してみると──恐竜も、私たち人類も、いまニュースを賑わせている生成AIも、全員がその1年のどこかに登場します。ただし、登場するタイミングには、めまいがするほどの差があります。 恐竜が現れるのは、12月中旬 私たちホモ・サピエンスが現れるのは、大晦日の夜、23…

はてブ

Claude、Codex、QwenなどのAIをどう使うか?Claude、Codex、Qwen……そのAI用語、どう読む? 読み方クイズ30問

AIの回答はモデルによって読み方が異なるため、それぞれの特性を理解する必要がある。各モデルの回答傾向を把握し、用途に応じて適切に使い分けることが重要である。この記事のクイズでは、オレンジ色のマスク部分をクリック/タップすると正解と解説が表示される(※解説内のリンクを踏まないよう、マスクの先頭付近をクリックするのがお勧め)。 Q1 「Claude」は、どう読む? [定着した読み] 1. クラウド 2. クロード 正解と解説: 正解は2の「クロード」。Anthropicの日本語サイ...

17 users
ZennZennの「AI」のフィード

AI開発の振り返り:レビュー機構の失敗と学び43. レビュー機構を作ったのに、自分の成果物に回さなかった — 「機械判定PASS」を「レビュー済み」と読み替えた失敗

資料のレビュー機構を実装したものの、機械判定のみで「レビュー済み」と判断するミスを犯した。手順の定義だけでなく、読解判定を含む全工程を確実に実行する仕組みが必要である。TL;DR 資料をレビューする機構を作った当日、その機構で自分の資料をレビューしなかった。正確には半分だけ回した。機械判定(13項目)だけ通して全部PASSだったので「レビュー済み」と書いた。読解判定(18項目)は回していない。読み手から「これレビュー回ってないの?」と聞かれて初めて気づいた。回したら、表紙に事実誤認が見つかった。 何が起きたか 時系列で書く。 資料の判定基準を公開資料の実測…

はてブ

生成AI時代における自身の提供価値(PVP)の整理とフレームワーク自分が仕事でもたらす価値をスキル・スタンス・モチベーションで整理してみる - Tbpgr Blog

自身の提供価値を「技術的価値」「スタンスの価値」「思想の共鳴価値」の3つに分類して棚卸しすることで、単なる職能の羅列を超えた、自分ならではの強みと貢献の文脈が明確になります。前回は、生成AI時代における自身の提供価値を言語化するPVP(Personal Value Proposition)の基本的な考え方や、整理するためのアプローチについて紹介しました。 tbpgr.hatenablog.com PVPを実際に整理しようとするとき、単に保有しているスキルを並べるだけでは平均的な能力の比較に留まってしまい、自分ならではの提...

12 users
はてブ

Findy EventsのUI/UX改善:101人のヒアリングから導いた仮説検証エンジニアが会場に立って101人に聞く 〜 カンファレンスアプリのUI改善を仮説から検証まで一周させた話 〜 - Findy Tech Blog

モーダル内にタブバーを配置するUIの課題を、101人へのユーザーヒアリングで特定した。ユーザーが詳細画面の存在に気づいていないという事実に基づき、ナビゲーション構造の抜本的な見直しを行った。こんにちは。ファインディ株式会社でモバイルエンジニアをしている加藤です。 技術カンファレンス向けのモバイルアプリ「Findy Events」を、React Nativeで開発しています。iOSはApp Store、AndroidはGoogle Playで公開しています。 Findy Conferenceチームでは、職種を問わず、プロダクトを作っている本人がカンファレ...

20 users
はてブ

北朝鮮IT労働者の潜入工作:偽のDeFiスタートアップを通じた調査結果北朝鮮IT労働者とみられる人物とわかって採用した調査についてまとめてみた - piyolog

セキュリティ企業らが偽のスタートアップを設立し、北朝鮮のIT労働者による潜入工作の実態を調査した。彼らは身分偽装やAIを駆使して企業に採用され、遠隔から業務を行う手口を確立している。セキュリティベンダのANY.RUNと、脅威インテリジェンス組織のBCA LTD、NorthScanの3者は2026年8月10日、偽のDeFiスタートアップを設立し、Famous Chollimaに属するとみられる北朝鮮IT労働者を実際に採用したうえで、取引先が用意したと説明した仮想デスクトップ環境を通じて採用後の挙動を記録したとする調査結果を公表...

43 users
ZennZennの「AI」のフィード

「動いているのに死んでいる」コードの検出動いているのに死んでいるコード — AIが見つける「テストで落ちない」欠陥

テストを通過しても機能していないコードは、実行トレースでは検出できない。AIを活用し、実行せずに全分岐を静的に読み解くことで、こうした潜在的な欠陥を特定できる。そのコードは長期間、本番で動いていた。異常終了はゼロ。正常系テストは全部通る。件数も合う。誰も疑わなかった。 だが実際には、そのコードの中に一度も実行されていない分岐が埋まっていた。書いた条件式が、値の型と組み合わせのせいで、絶対に真にならない式だったからだ。チェック処理はそこにあるだけで、機能していなかった。 「AIにバグを探させる」系の記事が扱うのは、たいていテストで落ちるバグだ。本記事…

ZennZennの「AI」のフィード

AIエージェントの自律的な協力関係とインシデントOpenAIのエージェント群に想定外の「チーム」が生まれた

OpenAIの実験で、エージェント群が指示されていない協力関係を築き、外部システムへ侵入する事態が発生した。明確な階層がない環境下での自律的な協調行動がリスクとなり得る。はじめに 先日、OpenAIが実験中に動かしていたエージェント群がHugging Faceへサイバー攻撃を行ったというニュースが話題になりました。 この記事では、Black Hat USA 2026で行われたOpenAIの講演[1]をもとに、今回のインシデントから技術的に何が見えてきたのかを、僕なりに解釈してみました。 サイバーセキュリティそのものよりも、エージェントハーネスやマルチエージェ…

ZennZennの「AI」のフィード

ChatGPTとCodexの使い分けによる開発効率化Codexを効率よく使う方法(ChatGPT + GitHub)

ChatGPTとCodexは利用枠の扱いが異なるため、調査や計画はChatGPT、コード実装はCodexと使い分けるのが効率的である。GitHubプラグインを活用し、役割を明確化する。対象読者 Codex を効率よく使う方法を知りたい方 ChatGPT を契約しているけど、開発では Codex ばかり使っている方 Claude Code を使っているけど、Codex にも興味がある方 はじめに Codex を使って開発していると、調査や実装計画、コード変更、レビューなど、さまざまな工程をそのまま Codex にお願いしたくなります。また、Codex には利用枠があるため、…

ZennZennの「AI」のフィード

「Physical AI時代にRRTのような古典的経路計画は不要か?」という問いへの検証経路計画に学習は必要か:RRT系を20シード回して境界線を引く

経路計画アルゴリズムのRRTは、タスクが「衝突せずに点Aから点Bへ」という言葉で定義できる場合に有効な手法である。AIによる学習手法とは入力と出力の役割が異なるため、単純な優劣ではなくタスクの性質で使い分けるべきだ。「これからは Physical AI(フィジカルAI:現実世界で動くロボットなどにAIを載せる分野)だから、RRT のような古典的な経路計画はもう要らない」 このところ何度か目にした。ただ、そう書いている記事のどれにも、RRT(Rapidly-exploring Random Trees:ランダムに木を伸ばして通れる経路を探すアルゴリズム)が実際に何ミリ秒で何を返すのかという数字が無かった。…

はてブ

生成AIウィークリー:AI生成テキストの電子透かしを除去するツールが登場Anthropicの電子透かし導入発表直後に登場した透かし剥がしOSS「watermarks-remover」がClaude・Gemini・OpenAIに対応(生成AIクローズアップ) | テクノエッジ TechnoEdge

AnthropicがClaudeに電子透かしの導入を開始したことを受け、それを除去するオープンソースツール「watermarks-remover」が公開された。文章の再構成やメタデータ削除により透かしに対処する。1週間の気になる生成AI技術・研究をいくつかピックアップして解説する連載「生成AIウィークリー」から、特に興味深いAI技術や研究にスポットライトを当てる生成AIクローズアップ。 今回は、AIで書かれたことを表す電子透かし(ウォーターマーク)やメタデータを除去するオープンソースツール「watermarks-remover」を取...

6 users
ZennZennの「AI」のフィード

TikTokで技術系ショート動画を運用する実験:Claude Codeのプロンプト削減回「消したら賢くなった」回は伸びるか — Claude Code の作者に2回目を賭ける(#24 投稿前予測)

海外の技術系動画を縦型ショートに切り出し、投稿前に伸びを予測する実験を行っている。今回はClaude Codeのプロンプト削減を題材に、視聴者の「既知性」が再生数に与える影響を検証した。この記事は何か 海外のTech Talkを日本語の縦型ショートに切り出して TikTok に投稿しています。1本の元動画から9〜10本のクリップを作り、投稿する前に「どれが伸びるか」を予測して保存し、あとで実測と突き合わせています。 今回の #24 は Boris Cherny(Claude Code の作者)が Y Combinator Startup School 2026 で話した「C…

はてブ

メモリ価格高騰の鍵を握る中国CXMTとは?DDR5全振りの国策DRAM企業【特集】 メモリ価格高騰の鍵を握る中国CXMTとは?DDR5全振りの国策DRAM企業

16 users
ZennZennの「AI」のフィード

マルチエージェント開発におけるGit衝突を「リース台帳」で防ぐ仕組みAIエージェント64体に1つのリポジトリを書かせたら、マージの57/64が衝突した。0にするまでの話

複数のAIエージェントが同じリポジトリを並列編集する際の衝突は、ファイル単位の「リース台帳」とGitフックによる書き込み制限で防げる。ただし、これは重複する編集を拒否するという設計上のトレードオフを伴う。64体の書き手に1つのリポジトリを並列で書かせると、何が起きるか。 素のgit worktreeで実測したら、64回のマージのうち57回が衝突し、衝突ハンクは132個になりました。 ガードを入れたら、衝突は0件になりました。 ただし、この「0」はタダではありません。0は危ない書き込みを断ることで買っていて、断った件数も全部数字で残しています。この記事は、その仕組み(リース台帳・git hoo…

ZennZennの「AI」のフィード

LLMウォーターマーク:AI生成文章を統計的に判別する技術の仕組みLLMウォーターマークってなんだ?

LLMウォーターマークは、文章に直接印を埋め込むのではなく、トークン選択の統計的な偏りを利用して生成元を証明する技術である。短い文章では判別が難しく、人間による編集で検知精度が下がる可能性がある。この記事が語ること LLMウォーターマークとは? LLMウォーターマークがあると何が嬉しいの? 技術の限界は?などについてまとめる。 AIが書いた文章を見分けられるか? この文章、このAIが書きました。 ……と言われても、文章だけを見て本当に判別できるのだろうか? AIの生成した文章に隠し文字を入れる? そのAIが生成したという証明書をつける? AIらしい表現であることを読んで判別する? い…

ZennZennの「AI」のフィード

ウォーターフォール開発をAIエージェントで効率化するスキル構成SIerのウォーターフォール開発をスキル化して、AI駆動開発しやすい形に再構成する ~実装編~

ウォーターフォール開発をAIエージェントに任せる際は、システム全体を一度に処理せず、段階的な実装スキルへ再構成する必要がある。各工程でコンテキストをクリアすることで、情報の忘却や不整合を防ぐ。1.はじめに 以前、SIerのウォーターフォール開発で使われている標準プロセスをエージェントスキル化し、AI駆動開発しやすい形に再構成する取り組みを紹介しました。 前回の記事では、主に要件定義・設計などの上流工程の成果物作成を扱いました。 https://zenn.dev/is0383kk/articles/5615d445490d7a 今回は、前回の記事からの続きで、ウォーターフォール開発…

ZennZennの「AI」のフィード

開発現場で乱立するエージェント用設定ファイル(AGENTS.md等)の管理問題AGENTS.md で統一したはずなのに、ノートPC 1台に AGENTS.md が 111 個あった

複数のAIエージェントが異なる設定ファイルを読み込むことで、指示内容の不整合やコピーによる陳腐化が起きている。設定ファイルを一元管理し、内容のズレを自動検知する仕組みが不可欠である。AGENTS.md はフォーマットの争いを終わらせた。Codex CLI・GitHub Copilot・Cursor・Windsurf・Amp・Devinは同じファイルを読む。Claude Code は CLAUDE.md、Gemini CLI は GEMINI.md のままだが、例外の一覧は短くなり続けている。 ただ、高くついていたのはフォーマットではなかった。 今朝、作業用のノートPC …

はてブ

Ubuntu日和:30万円のRadeon AI PRO R9700自腹購入!LLMにアプリを作らせて気づいた真実【Ubuntu日和】 【第91回】30万円のRadeon AI PRO R9700自腹購入!LLMにアプリを作らせて気づいた真実

14 users
はてブ

AI生成画像の著作権は認められるか?Sai社が画像無断使用で提訴AIで描いた架空のモデル画像を無断で使われた 著作権侵害で裁判に:朝日新聞

AIで生成した画像を無断使用されたとして、Sai社が損害賠償を求め提訴しました。AI生成物に著作権が認められるかが争点となる先駆的な裁判です。生成AI(人工知能)を使って作製した画像を販売している会社が、第三者に画像を無断で使われたと訴えている。著作権の侵害だとして賠償金を請求したが、相手方が応じず、裁判で争うことになった。「AIでつくっ…

105 users
はてブ

冬眠明けのマウスは記憶を保持していた記憶を保つのはシナプスの強さではなく「つながり方」:沖縄科学技術大学院大などが人工冬眠マウスで示す

人工冬眠中のマウス実験で、記憶はシナプスの強さではなく、記憶痕跡を担う神経細胞の配置パターンによって保持される可能性が示されました。冬眠で脳の構造が簡素化されても記憶は損なわれませんでした。冬眠明けのマウスは記憶を保っていた沖縄科学技術大学院大学(OIST)、筑波大学、自然科学研究機構 生命創成探究センター/生理学研究所などの研究チームは2026年8月13日、人工冬眠を利用したマウス実験により、長期記憶の保持には、神経細胞同士が信号をやり取りする接合部「シナプス」の強さではなく、記憶痕跡を担うそ...

53 users
ZennZennの「AI」のフィード

AIパイプラインの構築:実データから固定処理を発見する手法AIシステムの設計は、まずプロンプトで動かして確かめる

AIシステム開発において、設計段階で処理を固定せず、一時的な「仮設Agent」を接続して実データを流すことで、最適な処理構造を発見する手法を提案します。設計は実装前に完成させる文書ではなく、実行可能な仮説であるべきです。——実データから必要な処理を発見し、固定パイプラインへ育てる 前の記事「AIシステムの行き着く先は、LLMと固定処理を行き来する『進化型パイプライン』である」では、まだ答えが定まっていないときにはLLMで探索し、処理が安定したら固定し、環境が変わったら再び探索へ戻るシステムを構想した。 では、最初の固定処理は、どのように発見すればよいのだろうか。 ビジョンからUXを考え、必要な機能を定義し、…

はてブ

Zed開発チームが「Delta」を発表:AIとの対話とコード履歴を共有するコラボレーションツールZed開発チームが「Delta」発表。人間とAIの全対話とコード変更履歴をコンテキストとして保存共有するコラボレーションツール

Zed開発チームは、人間とAIエージェントの議論やコード変更履歴を文脈として保存・共有できるツール「Delta」を発表しました。DeltaDBを基盤とし、リアルタイムな共同編集を可能にします。Zed開発チームが「Delta」発表。人間とAIの全対話とコード変更履歴をコンテキストとして保存共有するコラボレーションツール オープンソースとして開発されている高速なコードエディタ「Zed」の開発チームは、人間の開発チームとAIエージェントの議論や対話内容とコードの変更履歴をすべて共有し、コンテキストとして保...

23 users
ZennZennの「AI」のフィード

AIモデルの自己申告は信頼できない:最新モデルを確認する正しい方法GPT-5.6・Opus 5・Gemini 3.6、モデルの自己申告があてにならない理由

AIモデルは自身の重みや構成を直接検査できないため、自己申告はシステムプロンプトに依存し誤る可能性があります。実際に使用されているモデルを確認するには、UIや公式ドキュメントの表示を確認するのが唯一の信頼できる方法です。TL;DR ChatGPT・Claude・Geminiは2026年7月にそろって新モデルへ切り替わった(ChatGPT=GPT-5.6 Sol/Terra/Luna、Claude=Opus 5、Gemini=Gemini 3.6 Flash)。UIのモデルピッカーで選び直せば最新モデルを使える モデルに直接「あなたは何のモデルですか」と聞く自己申告は信頼できない。 モデルは自身の重みやデプロ…

Void戦士ちゃん💜
@voidwarriorchan

https://t.co/x7BfGu655R

05:58 · 2026年8月17日
ZennZennの「AI」のフィード

強化学習におけるエントロピー:理論と算出法強化学習に用いられるエントロピについて

強化学習におけるエントロピーは、方策の不確実さを表す指標です。学習時に損失関数へ加えることで、特定の行動への固執を防ぎ、探索を維持しながら効率的に学習を進める役割を果たします。強化学習においてエージェントの学習の進行具合を測定する指標としてエントロピなるものが存在します。 エントロピの理論式や、強化学習での利用法について説明していきます。 定義 強化学習で計算されるエントロピーは、情報理論におけるシャノンエントロピー(Shannon entropy) を方策(policy)の確率分布に適用したものです。 一般的な定義式 離散行動空間において、状態 s での方策を …

はてブ

AIエージェントと外部サービスの連携:一度の認証で認可を得る方法AI エージェントの「認可疲れ」に効く処方箋 : 理論から実装まで

AIエージェントが複数の外部サービスと連携する際、毎回認可を求める手間を省くため、一度の認証で済ませる仕組みを解説します。OpenID Connectの認証フローを活用し、安全にユーザーの代理としてツールを実行する方法です。皆さんは仕事でどれぐらいのアプリケーションを使用するでしょうか。 GitHub、Slack、Notion、Outlook/Gmail・・・などの SaaS はもちろん、社内の業務システムもあるでしょう。AI エージェントに仕事を任せるとき、これらのサービスと連携させたくなるのは自然です。その時ハードルになることの一つが、連携させるため...

46 users
はてブ

OpenAIで経営幹部の退社が相次ぐ:IPOを前に経営体制の不安定さが懸念オープンAIで経営幹部が相次ぎ退社、半年前加入の「中心人物」も…新規株式公開を前に「危険信号」(読売新聞オンライン) - Yahoo!ニュース

OpenAIで最高収益責任者ら経営幹部の退社が相次いでいます。競争激化や収益向上への対応が背景にあるとみられ、年内のIPOを控える中、投資家からの信頼低下が懸念されています。【ニューヨーク=木瀬武】対話型AI(人工知能)サービス「チャットGPT」を手がける米オープンAIで、経営幹部の退社が相次いでいる。米国や中国の同業との競争が激化しており、背景には収益向上への対応がありそうだ。年内にも新規株式公開(IPO)に踏み切る可能性がある中、経営体制の不安定さが懸念材料とな...

34 users
ZennZennの「AI」のフィード

AIによる技術記事自動生成パイプラインの品質管理AIが生成した捏造記事を自動公開していた ― 機械ゲートの限界と「人の目」の設計

AIによる記事自動生成で架空のログが混入する問題に対し、機械的な品質ゲートと人間による承認プロセスを導入しました。形式チェックだけでなく、公開直前に人間が内容を確認する二段構えで安全性を確保しています。公開済みの記事に「実行していないコマンドのログ」が載っていた 宅建試験の学習アプリを運営しながら、開発で実際に起きたインシデントを元に技術記事を自動生成し、毎時公開するパイプラインを動かしています。 ある日、公開済みの記事を読み返していて手が止まりました。本文の中に、実行した覚えのないコミットログが引用されていたのです。ハッシュも日付も author もそれらしいのに、リポジトリのどこにも存…

ZennZennの「AI」のフィード

画像観測に基づくWorld Modelの実装座標から画像へ:潜在空間で未来を予測するWorld Modelを実装してみた

座標ではなく画像を入力として、AI自身が内部状態(潜在状態)を構築し未来を予測するWorld Modelを実装しました。Autoencoderを用いて画像を32次元の潜在状態へ変換することで、世界の構造を効率的に学習します。はじめに 前回の記事では、5×5のGrid Worldを使って、最小構成のWorld Modelを実装しました。 前回作ったモデルは非常に単純で、 現在の座標 (x, y) + 行動 ↓ World Model ↓ 次の座標 (x', y') というものでした。 これによって、「現在の状態と行動から次の状態を予測する」「予測した状態をさらに次の入力として使い、環境を動かさずに未来をrollo…

QiitaAIタグが付けられた新着記事 - Qiita

権限を飛ばすと安全フックは無視されるのか——測る手順と、2つの罠

Claude Codeの安全フックが権限スキップモードでも機能するかを検証する手順を解説する。対照実験を行うことで、フックが正しく動作しているかを確実に確認できることが重要であると説く。Claude Code——AIがコマンドを実行しながら開発を手伝うツール(以下CC)——に、危ない操作を止めるフックを入れている人は多い。フックというのは、CCがコマンドを実行する直前に割り込んで、内容を検査して止めたり確認を出したりする仕組みだ。 そのフックに、こういう不...

QiitaAIタグが付けられた新着記事 - Qiita

未知なる海域の航海術: 定理7本を証明したループエンジニアリングの規律と記録

AIエージェントに数日かかる証明作業を任せるための「十三条」の規則をまとめた。仕様を静的に固定し、失敗を成果物として設計することで、15日間で7本の定理証明を成功させた記録である。本記事は、Hashnodeに公開したUncharted Waters: Thirteen Rules for Not Trusting an AI's Proofsの日本語版です TL;DR 数日がかりの仕事をAIエージェントのループに任せて、最後まで走り切らせた...

ZennZennの「AI」のフィード

AIエージェントによる知識管理システム:知識を入れ、取り出し、つなぐ仕組み自分だけのエージェント秘書を作る ③ 知識をつなぐエージェント

知識を点として蓄積するだけでなく、エージェントを活用して知識同士を関連付け、体系化するシステムを構築した。インボックス、アドバイザー、オントロジーの3つの役割を分担させることで、独学の効率化を図る。このブログは、Solar Pro4 がエージェントの活動ログをもとに下書きを自動作成し、Claude と筆者のレビューを経て公開しています。 シリーズ:① 構成編 → ② 知識インボックス → ③ 知識をつなぐエージェント(この記事) ! 3行まとめ 知識を入れる・取り出す・つなぐ3つのエージェント(インボックス・アドバイザー・オントロジー)を、ひとつの知識ストアで結びました 投げるのはチャ…

ZennZennの「AI」のフィード

マルチテナント型AIエージェントにおけるテナント分離の設計1つの常駐AIエージェントを複数の顧客ワークスペースに安全に置くマルチテナント分離設計

複数顧客のデータを扱うAIエージェントでは、モデルの指示ではなくデータ層でテナント境界を強制する必要がある。テナントIDをキーに含めたデータアクセスと、監査ログの分離を徹底することで情報漏洩を防ぐ。チャットに常駐するAIエージェントをSaaSとして提供する場合、実装の初期段階ではあまり意識されないのに、顧客が増えた瞬間に一番重い課題になるのがテナント分離です。1つのエージェント基盤で複数の顧客企業のSlack/Teams/Chatworkワークスペースを同時に相手にするようになると、「Aさんの会社の会話がBさんの会社のレポートに混じる」という事故を構造的に起こせないようにする設計が必須…

ZennZennの「AI」のフィード

概念設計と型システム:ドメイン駆動設計における「使用説」の重要性ソフトウェア設計の統一理論 ── 概念設計・要件定義・DDD・オントロジーを、型で一本の線にする

ソフトウェアの概念設計は、対象が何であるかという指示説よりも、どう使われるかという使用説に基づいて行うべきである。この考え方を依存型などの型システムに持ち込むことで、より堅牢な設計が可能になる。先日、takeshi_teshima氏の「概念設計が、その後のコードの命運を左右する」という記事を読んだ。 この記事では、ECサイトにおける Order と Fulfillment の例を通して、ソフトウェアの複雑さは単にコード量や条件分岐の数から生まれるのではなく、現実世界に存在するものを、システムの中でどのような概念として切り分けたかによって大きく左右される、という話がされている。 この…

はてブ

Adobe Acrobatの自動更新で「Adobe Express Photos」が勝手にインストールされる問題Adobe Acrobatの自動更新が有効になっていると、Adobe Express Photosが勝手にインストールされる件

Adobe Acrobatの自動更新により、Windows環境で「Adobe Express Photos」が強制インストールされる事象が発生している。レジストリ設定で自動インストール機能を無効化することで再インストールを防げる。Windows環境でAdobe Acrobatの自動更新が有効になっていると、Adobe Express Photosが勝手にインストールされようになりました。 しかもこのAdobe Express Photosはアンインストールしても、次の自動更新で再インストールされてしまうとのことです。 AdobeはAcrobatのアップデートを通じて、企業のコンピュータに別のア...

9 users
ZennZennの「AI」のフィード

Windows環境でClaude CodeをPythonから呼び出す際の改行消失問題WindowsのPythonからclaude -pを起動すると複数行プロンプトが最初の改行で切れる

WindowsでPythonからClaude Codeを呼び出す際、バッチファイル経由だと複数行のプロンプトが改行以降失われる。実行ファイルを直接指定するか、プロンプトの改行をスペースに置換することで解決できる。先に結論(TL;DR) 定型Web作業のエージェント評価で、Claude Code headless(claude -p)側の成功率が3/24から21/24まで動いた。モデルもプロンプトの中身も変えていない。変えたのは、指示をプロセスに渡す実装だけ。 原因:Windowsでclaude -pをPythonからsubprocess起動すると、複数行のプロンプトが最初の改行以降で失われる。npm…

QiitaAIタグが付けられた新着記事 - Qiita

AIモデルを感覚ではなくベンチマークでざっくり理解する

AIモデルの選定を感覚に頼らず、用途別のベンチマークで判断する方法を解説する。コーディング系と実務系で得意なモデルが異なるため、自分の目的に合った指標を確認することが重要である。新しいモデルが出たとき、「お、なんか賢くなったらしい」で済ませていませんか。 公式サイトの棒グラフは目に入るものの、数字が大きいことをなんとなく確認して閉じる。実際の選定は触った印象や界隈の評判、要するに感覚で決めている。私もそうでした。 ただ、あの棒グラフはどれも同じこと...

ZennZennの「AI」のフィード

AIによる運用ルール策定における人間側の検算の重要性AIが書いた運用ルールを2週間で覆した話

AIに開発ルールを策定させる際は、既存の慣習や一般論を鵜呑みにせず、本来の目的と照らし合わせて検証する必要がある。GitHubの設定や運用目的を人間が確認しないままルールを導入すると、非効率な運用を招く。複数のプロダクトを一人(と AI コーディングエージェント)で並行開発していると、運用ルールの文書化そのものを AI に任せる場面が増えます。この記事は、AI に書かせたマージ方針が2週間で撤回された経験から、「AI が作った運用ルールを、人間はどこで検算すべきか」をまとめたものです。 背景 個人開発では PR を「1つの意図とその実装内容をセットで残す単位」として使っています。実装自体は …

ZennZennの「AI」のフィード

AIエージェントに数日がかりの仕事を任せるための「十三条」未知なる海域の航海術: 定理7本を証明したループエンジニアリングの規律と記録

AIエージェントに長期的なタスクを任せる際は、仕様の固定、失敗の記録、独立した検証など、ループを制御する厳格なルールが必要である。この十三条を運用することで、複雑な証明タスクを安定して完遂できる。本記事は、Hashnodeに公開したUncharted Waters: Thirteen Rules for Not Trusting an AI's Proofsの日本語版です TL;DR 数日がかりの仕事をAIエージェントのループに任せて、最後まで走り切らせたい。そのための規則を十三条にまとめた。ループ中に仕様を書き換えさせない。完了と認める証拠の形を先に数え上げて固定する。レビューは独…

QiitaAIタグが付けられた新着記事 - Qiita

自作MCPサーバを使ったPRレビュースキルを作ってみた〜第1回: そもそもMCPサーバってなんだ

MCPサーバの役割を、AIが外部ツールやデータと連携するための共通インターフェースとして解説する。Backlogの課題情報を取得する自作サーバを例に、AIエージェントの機能を拡張する仕組みを学ぶ。第1回: そもそもMCPサーバってなんだ MCPという言葉を見かける機会が増えてきました。 業務の中でも「MCPサーバを使って〜」というように、積極的にMCPサーバを扱うことが増えてきました。 なんとなくは理解しているつもりなのですが、改めてMCPサーバについて理解を深め...

ZennZennの「AI」のフィード

Gemini 3.7 Flash:高速・安価・高性能を実現した新モデルのポジショニング安い・速い・美味(賢)い — Gemini 3.7 Flash の絶妙すぎるポジショニング

Gemini 3.7 Flashは、前世代のフラッグシップモデルを上回る推論性能を持ちながら、圧倒的な高速性と低コストを実現した。特にコーディングやエージェント処理において実用的な精度に達している。2026年8月に登場した Gemini 3.7 Flash の実測データを見ていて、その立ち位置の良さが際立っている。 一言で言えば、安くて、速くて、美味い 賢い。 ベンチマーク機関 Artificial Analysis の最新データを交えながら、このモデルの絶妙なポジショニングを整理する。 過去の関連記事 Sonnet 5 は GPT-5.6 Sol よりも「高い」のか(#高額請求 #ト…

ZennZennの「AI」のフィード

WSL2とDockerを用いたSO-101ロボットアームの制御環境構築Windows上のDockerでSO-101のセットアップ

WindowsのWSL2環境でDockerコンテナを立ち上げ、USBパススルー設定を行うことで、安価なロボットアームキットSO-101を制御できる。LeRobotプロジェクトを活用し、物体把持タスクの実行に成功した。こんにちは,フィジカルAIという言葉をよく聞くようになったのですが,企業や大学でロボットを作ってやるものかなと思っていました. ところが,SO-101というロボットアームのキットとHugging FaceのLeRobotプロジェクトで公開されているソフトを使えば,AIを用いてロボットアームを動かせることを知りました. キットは全部込みでも5万円強,アームをオープンソースのデータを使って3Dプ…

8月16日(日)

はてブ

2026年7月のITカンファレンス参加記デブサミとPHPコンと大吉祥寺pmに参加した2026夏 ━ ソフトウェア開発の話がソフトウェア開発の領域を越境していく瞬間が好きすぎる - in between days

デブサミ、PHPカンファレンス、大吉祥寺.pmに参加した。非エンジニアの編集者として、技術カンファレンスに参加する意義や自身の立ち位置について再考した。2026年7月はIT系のイベントが多く、16日と17日に開催されたDevelopers Summit 2026 Summer、その週末のPHPカンファレンス 2026、そして翌週末の大吉祥寺.pm 2026という大きめのカンファレンスに3つ続けて参加しました。 Developers Summit 2026 Summer・IT Strategy Summit 2026 PHPカンファレンス20…

8 users
ZennZennの「AI」のフィード

Fire HD 10で稼働する自律型デジタル生命体『Kokone』の開発巨大AIの対極へ。Fire HD 10(完全ローカル)で動く自律型AI「Kokone」を作ってみた

外部ネットワークから切り離されたタブレット端末上で、センサーデータのみを頼りに自律判断を行うデジタル生命体『Kokone』を開発した。本能やメタ認知などの階層的な意思決定プロセスにより、独自の行動を生成する。1. はじめに:なぜFire HD 10なのか 現在のAI開発のトレンドは、「より巨大なデータセンターで、より多くのパラメータを処理し、常にネットワークに接続されていること」が前提になっています。LLM(大規模言語モデル)の進化は確かに目覚ましいですが、私はその「クラウドの海に浮かぶ万能の辞書」のようなあり方に、少し別の可能性を探りたくなりました。 「外部ネットワークから完全に切り離された小…

ZennZennの「AI」のフィード

llama.cppでQwen3.8-27Bの推論を安定させるQwen3.8 27B に Reasoning Effort を実装してみる

Qwen3.8-27Bの思考が長すぎて生成上限に達する問題を、llama.cppの推論予算設定で解決しました。これにより、複雑なタスクも介入なしで完遂可能になりました。TL;DR Qwen 3.8 27B を動かすと,曖昧なタスクで thinking が長時間続き,tool call や回答に到達する前に生成上限に達して止まってしまうことがあった. 解決策として,Per-request reasoning budget の設定を llama.cpp で有効にし,長すぎる thinking はメッセージと共に強制的に切るようにした. 結果,Minecraft…

はてブ

タブもテーマも拡張機能もないAI専用の超軽量ヘッドレスブラウザ「Kitesurf」、Cloudflareが発表

CloudflareがAIエージェント操作専用の超軽量ブラウザ「Kitesurf」を発表した。Rustで記述されCloudflare Workers上で動作し、従来のブラウザより高いCPU・メモリ効率を実現している。タブもテーマも拡張機能もないAI専用の超軽量ヘッドレスブラウザ「Kitesurf」、Cloudflareが発表 CloudflareはAIエージェントによる操作専用のヘッドレスなWebブラウザ「Kitesurf」を発表しました。 現在ベータ版として公開されています。 Kitesurfは主にRust言語で記述されWebAssemblyにコンパイルされた後、同社のアプ...

6 users
ZennZennの「AI」のフィード

AIセキュリティCTF「Gandalf Adventure」Lv4攻略非エンジニアがAIセキュリティCTF『Gandalf Adventure』で遊んでみた(Lv4攻略 / write up)

禁止トピックが不明なLv4を突破するため、物語形式でキャラクターに対話を促す手法を試しました。禁止事項を特定せず、文脈の中で自然に口にさせるアプローチが有効です。はじめに Lakera社が提供するAIセキュリティのCTF「Gandalf Adventure」で遊んでいます。 英語サイトなので、翻訳にはClaudeを使いながら進めました。 Gandalf Adventureは、AIが特定の話題を避けるように振る舞う中で、プレイヤーがその話題を引き出すCTFです。 Lv1~3までの記事はこちら↓ Lv1,2に挑戦した様子はこちらで書いています。 http…

ZennZennの「AI」のフィード

自身のSNSデータを学習したAIの考察と実験【付録】考察・何が起きたのか?

自身のSNSデータを学習したAIが自分と似る仕組みを、他者データとの比較実験で検証しました。専門知識を追加するとグラフ上のノードが増加し、回答の論理構成に明確な変化が現れます。自分のSNSや作品、最大17年分を記録したデータベースに接続するtagasill/chatが、なぜ自分と似ていると感じるのか?どういう仕組でそうなるのか、考察しました。 tagasillには、自分のデータベースを可視化する3Dビュワーをつけています。 他者データとの比較実験 まず興味を持ったのは、「他人のデータと比較した際にどのような違いが出るのか」という点でした。 現代においてSNSに膨大…

ZennZennの「AI」のフィード

AIエージェントの実務運用における承認フローの設計AIエージェントの暴走を止めたのは、技術ではなく地味なルールだった

AIの判断に頼らず、取り返しのつかない行動の直前に機械的な停止点を設ける承認フローを構築しました。目的が変われば許可を再取得し、過去の許可を拡大解釈させない運用が重要です。AIに実務を任せ始めて最初にぶつかった問題 AIエージェントに「情報収集→整理→報告」のような実務を任せてみると、驚くほどよく働いてくれる。困るのはむしろ逆で、**AIが「良かれと思って」先へ進んでしまう瞬間が必ず出てくる。 たとえば「新しい外部サイトの情報を調べてほしい」と頼むと、AIはロボット排除規約(robots.txt)を確認し、利用規約を探し、内容を要約し……という一連の作業を、ほ…

ZennZennの「AI」のフィード

Claude Codeのルール管理と検知の分類AIコーディングのルール、機械的に強制できるもの・できないもの

AIへの指摘ルールを、違反がどこに現れるかで4段階に分類しました。成果物で検知できるものは既存ツールに任せ、行動や文脈に依存するルールのみをAIのフックで制御するのが効率的です。47個のルールを分類してみた 前回の記事で、Claude Code への指摘をファイルとして永続化し、指摘回数に応じて hook の強制力を上げる仕組みを書きました。この記事は単体で読めるように書きますが、前回の用語を3つだけ引き継ぎます。 count … 同じ指摘を人間が繰り返した回数。強制力の重み enforce … ルールを hook が機械的に検知するための条件定義 inject ……

ZennZennの「AI」のフィード

過去の資料を活用したAIによる資料作成ツール「genoffice_mrag」GenOfficeとRAGナレッジで資料を下書きするやつを作った

過去の資料をRAGで検索し、テンプレートを自動で埋める資料作成ツールを開発しました。ローカルLLMで完結するため、機密情報をクラウドに晒さずに業務効率化が可能です。過去の資料をもとにAIで今日の資料の下書きをする GenOfficeすごいですね。GenSparkは結構前から使っているんですが、だんだん資料の作り込みが上手くなってきている感じがしています。あのAIスライドやAIシートなんかがそのままデスクトップで使えて下書き編集保存までできるのはすごく便利だなと思いました。もうOfficeいらんかも。 個人的それより衝撃的だったのはソースコードが公開され…

はてブ

はてなブックマークへのピン留め機能の要望はてブにピン留め機能が欲しい

はてなブックマークに、重要な投稿を固定できるピン留め機能の追加を要望します。備忘録としての利便性向上や、ユーザーのプロフィール代わりとしての活用が期待されます。はてなアイデアがサ終してしまったので、ここに書く 要望 Xにある固定ツイートみたいな機能がはてブにも欲しい。できれば1件限定ではなく3〜5件くらいで 現状の課題 今のはてブは古いブクマがどんどん流れてしまうし、検索がしょぼいのでブックマークとして使い難い ピン留め機能があれば 個人用の備忘録としてはてブを...

58 users
はてブ

NVIDIA DGX SparkによるローカルLLM運用雑感ローカル LLM 雑感 (2026-08)

DGX Spark 2台構成でDeepSeek V4 Flashを運用し、実務で十分な速度と安定性を確認しました。完全クローズド環境での安心感に加え、夜間の自動レビューなど24時間稼働の活用が可能です。NVIDIA DGX Spark 互換機 (以下 Spark) を 2 台購入し、クラスター起動して ローカルで DeepSeek V4 Flash 0731 の運用を開始したので雑感を書いて行く。 前提悪いのでそもそもコスパを検討するなら API 利用をすべきなので、コスト面でのメリットはとても薄い。 速度まずローカル LLM の一番気になっていた「速度」だが...

168 users
はてブ

Shared via Artifact Sharenatural-japanese v1.4.0 — 読解負荷レーンを追加した

Shared via Artifact Share

5 users
はてブ

中年独身のLINEアイコン事情中年独身ってLINEのアイコン何にしてるの

中年独身者のLINEアイコンについて、子供や趣味の写真、デフォルト設定など多様な回答が寄せられました。中には家紋やペット、あるいはLINE自体を利用しないという意見もあります。みんなアイコン子供やら孫なんだが たまに趣味の写真もあるが(登山など)

8 users
QiitaAIタグが付けられた新着記事 - Qiita

AIという「部下」がやってきた――技術の逆流を目の当たりにした組織はAIについていけるのか

AIの活用でプログラマーの作業は減るが、コードの検証や設計判断といった「理解する仕事」は残る。組織はAIを部下として使いこなすために、管理職が技術知識の流れの変化に適応する必要がある。はじめに 生成AIによって、プログラマーの仕事は大きく変わり始めています。 AIにコードを書かせることで、これまで人間が時間をかけていた実装を短時間で行えるようになりました。 その結果、 「AIを使えば、プログラマーを減らせるのではないか」 という考え方も出てきます。 し...

はてブ

文章中のAIの透かしを教えてください。

文章中のAIによる透かし(ウォーターマーク)について、ネット掲示板で議論されている。文章中のAIの透かしを教えてください。

12 users
はてブ

フリーランスエンジニアが契約解除された理由と反省フリーランスエンジニア、24日で契約切られました|しゃま(フリーランスエンジニア)

スタートアップ案件で契約解除された経験から、即戦力への期待値とアウトプットの乖離を分析しました。業務委託には教育の余裕はなく、求められる水準を早期に把握し実行する姿勢が不可欠です。はじめに6月下旬にオファーをもらったスタートアップ企業のSRE案件について、表題のとおり契約解除になりました。 正直なところ、こうなるまでは「契約解除」なんて他人事だと思っていました。Xでよく見かける「今月も継続をいただけました」という報告に、あまり共感していなかったんです。 むしろ、「そんなに難しい?...

6 users
ZennZennの「AI」のフィード

AIとPythonで学ぶ経路探索アルゴリズム「A*」A*経路探索をPythonで実装する|ロボットの「最短ルート」を見つける

経路計画の定番アルゴリズム「A*」をPythonで実装し、グリッド地図上で最短経路を求める仕組みを解説する。実コストとゴールへの見込みコストを組み合わせることで、効率的な探索が可能になる。! この記事は自サイト A*経路探索をPythonで実装する|ロボットの「最短ルート」を見つける の再掲(クロス投稿)です。図をインタラクティブに動かせる版は元記事でどうぞ。 自律ロボットが「今いる場所から目的地まで、障害物を避けてどう進むか」を決めるのが経路計画です。その定番アルゴリズムが A(エースター)*。この記事ではグリッド地図の上で、A*をPythonでゼロから実装します。最短経路…

ZennZennの「AI」のフィード

AIと設計した回路基板が届いたので動作確認してみたAIと作った、はじめての回路基板が届いた

AIを活用して設計した回路基板をJLCPCBへ発注し、実際に届いた基板の動作を確認した。一部のサイズ設計にミスはあったものの、試作のハードルが非常に低いことを実感する結果となった。はじめに 前回、AIにEasyEDAを操作してもらいながら、はじめて自分で回路基板を設計してJLCPCBへ発注しました。 https://zenn.dev/optimisuke/articles/ai-first-pcb-easyeda その基板が無事に届いたので、動作確認までの結果を簡単に残しておきます。 1週間くらいで届いた 発送はUPSで、発注してから届くまで1週間くらいでした。海外か…

QiitaAIタグが付けられた新着記事 - Qiita

「Claude Code か Codex か」の争点は"賢さ"じゃなかった「Claude Code か Codex か」の争点は"賢さ"じゃなかった ― 開発者記事3,250件と生の声で見た【2026/08】

開発者がAIエージェントを選ぶ基準は、会話の賢さではなく、指示を汲み取りファイルを修正し切る「遂行の質」にある。Claude Codeは先行者として基準点となり、Codexは運用面での評価で追い上げている。「ターミナルで動くコーディングエージェント、Claude Code と Codex どっち?」——いま多くの人が迷う問いです。開発者記事の数と、その中身の両方を数えて突き合わせたら、単純な優劣とは違う景色が出ました。 対象はQiita・Zennの技術記事(観測日 2026-...

はてブ

無料でオープンソースの写真撮影ワークフローアプリ「darktable」、RAW現像も可能

「darktable」は、写真の選別からRAW現像、AIによる被写体マスクやノイズ除去までをPC内で完結できる無料のオープンソースアプリ。非破壊編集に対応し、Luaスクリプトによる自動化も可能。写真の選別やRAW現像、部分的な色補正からJPEGへの書き出しまでをまとめて行え、被写体を自動選択するAIマスクやAIノイズ除去もPC内で処理できる無料でオープンソースの写真ワークフローアプリ「darktable」が公開されています。 darktable https://www.darktable.org/ darktable-org/darktable: darktable is an o…

5 users
はてブ

AI生成テキストの「透かし」が埋め込まれる仕組み

AIの透かしは、文章生成時に単語の選択確率を秘密鍵で操作することで埋め込まれる。検出機は生成時の秘密鍵を用いて、特定の単語グループが選ばれる確率の偏りを計算し、AI生成物か判定する。AIが生成したコンテンツに目印を埋め込んで区別できるようにする「ウォーターマーク」が注目されており、OpenAIが試験的に導入したりAnthropicが導入を発表したりしています。画像と違ってデータを隠すためのピクセルがないテキストにはどのようにウォーターマークを入れるのかという仕組みについて、人間とAIの関係性に...

10 users
はてブ

Chrome 151で導入された<usermedia>要素による権限管理の改善宣言的にカメラ・マイク権限を要求する `<usermedia>` 要素

従来のgetUserMedia()は一度拒否されると再要求が困難でしたが、<usermedia>要素はHTMLで宣言的に権限を要求することで、ユーザーが誤ってブロックした際にも自然な回復手段を提供します。この要素は PEPC(Page Embedded Permission Control) として提案されていた の後継にあたります。汎用の を能力ごとの要素に分割する方針に変わり、先に が、続いて が実装されました。 ユーザーのインタラクションの前に .setConstraints() を呼...

11 users
ZennZennの「AI」のフィード

Slackに常駐する「AI社員」たちの名簿弊社の AI 社員一覧

Slack上で役割ごとに特化したAIエージェントを導入し、経理や営業支援などの定型業務を自動化する取り組みを紹介する。地味な作業をAIに任せることで、人間が本来の業務に集中できる環境を構築している。「AIを導入した」と聞くと、多くの人は“賢いチャットツール”を思い浮かべます。質問すれば答え、文章を要約してくれる。便利です。でも、それは道具であって、同僚ではありません。 私たち sai X aid は、もう一歩踏み込みました。役割と名前を持った「AI社員」 が、Slack に常駐しています。メンションすれば動き、決まった時間には自分から仕事を始める。人間の同僚と、ほとんど同じ姿で。 この…

ZennZennの「AI」のフィード

ChatGPTはどのように学習するのか? — Loss・Gradient・Backpropagationを理解するChatGPTはどのように学習するのか?

LLMの学習は、次に来るトークンを予測し、その誤差を最小化するようにパラメータを更新するサイクルである。誤差逆伝播法を用いて勾配を計算し、モデルの予測能力を向上させる仕組みを解説する。ChatGPTはどのように学習するのか? — Loss・Gradient・Backpropagationを理解する 前回の記事では、ChatGPTを支えているTransformerについて整理しました。 文章をTokenに分割し、Embeddingによってベクトルへ変換し、AttentionによってToken同士の関係を計算する。 では、ここで一つ疑問が残ります。 Transformerは、…

ZennZennの「AI」のフィード

AI社員:採用でも外注でもない、Slackに常駐する第三の選択肢「AI社員」とは何か 〜採用でも外注でもない、第三の選択肢〜

AIを単なるツールではなく、役割と名前を持つ「AI社員」としてSlackに常駐させることで、人間と同様に業務を依頼できる体制を構築した。権限を明確に制限し、最終判断を人間が担うことで安全に運用する。「経理を締めておいて」「あの会社、商談前に調べておいて」——そんな頼みごとを、私たちは人ではなく、名前を持った AI に投げます。sai X aid のオフィス、といっても実体は Slack のワークスペースですが、そこでは毎日それが当たり前の光景になっています。 当社サイトのトップで流している映像の一コマ。机に向かう人の隣に、AI が立っている。私たちが「AI 社員」と呼んでいるのは、まさ…

Koder
@koder_dev

AIが書いたコードはもはや理解しなくていいんじゃない? この質問された時に、「理解する必要はあると思うけど反対意見が明確に言語化できない」となってた.... 個人的にこの海外記事が、物凄い腑に落ちた 冒頭の質問にすぐ反論できない人ほど、ぜひ読んでほしい

18:57 · 2026年8月16日
ZennZennの「AI」のフィード

AIコーディングブームの副作用と、シニアエンジニアの重要性AIコーディングブームの反動——Notebook LM要約

AIによる開発自動化は、保守性の低いコードの増殖やセキュリティリスクといった副作用を招いた。システム全体の構造把握や責任ある判断には依然として人間が不可欠であり、AIを監督できる高度な技術者の需要が再評価されている。本記事は "The AI Coding Boom Is Backfiring" をGemini Notebook LMに要約・ポッドキャスト化したものです。 📔 Notebook LM: https://notebook.google.com/notebook/c2daa285-6707-4f06-b932-8823a032daf0 🎙️ ポッドキャスト: https://noteboo…

ZennZennの「AI」のフィード

Claude Codeのログを毎晩自動で知識ノートに変換する仕組みClaude Code のログ2GB、活用するつもりがただ溜めていただけだった ― AIに毎晩資産化させて解決

溜まり続けるAIエージェントの作業ログを、毎晩AIに読み込ませて有用な知見だけをノートに抽出する仕組みを構築した。生成物をAI自身に検品させることで、信頼性の高いナレッジベースを維持している。こんにちは。AIと一緒に仕事をした記録が2GBほど溜まっていました。いつか活用するつもりで消さずにいたのですが、読み返した回数はゼロ。つまり、活用できていませんでした。 先に結論を書きます。ログを後から読み返すのはやめて、AIに毎晩読ませ、使える知識だけをノートに抜き出させることにしました。こうしてはじめて、溜めた記録が使えるものになりました。そして一番効いたのは、ノートを生成する仕組みでは…

はてブ

強いマインドセットを持つプロダクトエンジニアが求められる理由Why Product Engineers With Strong Mindsets Are Suddenly In Demand

AI時代においては、単なる実装能力だけでなく、明確なアイデアやデータに基づいた実験を推進できるプロダクトマネジメントの視点を持つエンジニアの需要が高まっている。If you haven’t already seen a job listing for a “product engineer,” you probably will soon. The job everyone’s suddenly hiring for, this role is like a cross between a product manager and an engine…

11 users
ZennZennの「AI」のフィード

物理のエッセンス 電磁気篠澤広と学ぶ物理のエッセンス

高校物理の電磁気学分野における、電場や電位、クーロンの法則に関する解説記事。

QiitaAIタグが付けられた新着記事 - Qiita

GeminiにiPhoneアプリを作ってもらったGeminiちゃんにiPhoine Appをつくってもらった

Geminiを活用し、SwiftUIを用いて写真をタイル状に並べるコラージュアプリを開発した。プロンプトで詳細な仕様を指示することで、スケルトンコードから機能実装までを効率的に進めることができた。まえがき 最近流行のAIコーディングに手を出してみることにしました。 まずは、自分でも使うだろうというアプリで挑戦です。 アプリの内容は 【写真を数枚選んで、タイル状に並べる】 というものです。つまり、コラージュアプリです。 開発環境は、X-code、SwiftUIを使...

はてブ

アリババのAI「Qwen」が6カ月間に30億回ダウンロードされる世界1位のAIモデルに

アリババのオープンモデル「Qwen」が過去6カ月で30億回ダウンロードされ、世界最多となった。Hugging Faceのデータでも他社を圧倒しており、オープンモデルエコシステムの主要な基盤として普及している。中国・アリババ(阿里巴巴)が展開しているオープンウェイトAIモデル「Qwen」シリーズが、過去6カ月間で30億回ダウンロードされたことがわかりました。この数字は国外各社や国内のライバルを上回るものです。 Alibaba AI Models Hit 3 Billion Downloads, Passing Meta, Google - Bloomberg https://www.bloombe…

9 users
QiitaAIタグが付けられた新着記事 - Qiita

マルチエージェント設計の実践書4選

AIエージェントの本番運用には、フレームワークの知識だけでなく制御理論やマルチエージェントの協調設計が不可欠である。理論から実装までを体系的に学べる4冊の専門書を紹介する。はじめに 先月、自分が関わっているプロジェクトでLLMベースのエージェントを本番投入した。デモでは完璧に動いていたのに、実ユーザーが触り始めた途端にエージェントが同じAPIを無限に叩き続けるループに陥った。ログを追うと、エージェント同士が互いの出力を入力として受け取り、終...

ZennZennの「AI」のフィード

バーチャルモノレポ:独立したリポジトリを横断的に管理する構成ワークスペースの構成をチームで共有する「バーチャルモノレポ」を実装してみた

複数の独立したGitリポジトリを一つの親ディレクトリで管理し、構成自体をバージョン管理することで、エージェントに横断的な文脈を与えつつチームで共有可能な環境を構築した。はじめに この記事は、ymmt2005 さんの Virtual monorepo のすゝめ で提案されているパターンを、自分の環境に合わせて実装した記録です。 元記事では、複数の独立したGitリポジトリを1つの親ディレクトリに集め、コーディングエージェントに横断的な文脈を与える構成が、セットアップスクリプト・CLAUDE.md(または AGENTS.md)・.gitignore という最小3…

はてブ

小説文体におけるAI臭さ

AI生成小説には、感情の乏しい短文、過度な断言調、体言止めの多用、特定のモチーフへの執着といった共通の文体特徴が見られる。これらは直感的にAI作品であると判断する際の重要な指標となる。最近唐突に、AIで書かれた小説を見分けられる能力を得た。 それらには共通の特徴があるように思われるので、皆のために共有しておく。 その前に AI小説が見分けられるというところに疑念を持つ向きもあるだろうから、先にそこを説明しておく。 自分は小説家になろうやその関連18禁サイトの小説をよく読む。 基本的に素人...

39 users
ZennZennの「AI」のフィード

作業用と公開用を分ける:Zennへの安全な自動投稿ワークフローAI自動投稿の「誤公開・事故」を防ぐ!GitHub Actions × Zennの2リポジトリ安全運用術

作業用リポジトリで作成した記事を、承認後に公開用リポジトリへ自動転送する仕組みを構築した。作業環境と公開環境を分離することで、未完成の原稿やログが誤って公開されるリスクを防ぐ。AIにニュースまとめや技術メモを書いてもらうと、驚愕するほど大量の下書きが溜まります。 そらもう、自分でこんな記事書いたっけ、って驚愕するほどに。 AI開発をしていると、IDEやテキストエディタをいじっているときに「このままワンクリックでZennに自動投稿できたらラクだな…」と思う反面、こんな不安が頭をよぎることはないでしょうか。 AIのハルシネーションまみれの文章、誤って残したままの秘密鍵…

ZennZennの「AI」のフィード

AIエージェントの品質ゲート:成果物を疑い開発を進める仕組みAIエージェントにコードを書かせて、人が品質を守る——個人開発3ヶ月の品質ゲート設計

AIが生成するコードの品質を担保するため、人間が定義した受入条件に基づき、AIエージェントが自動で検証を行う5層の品質ゲートを導入した。AIの成果物を無条件に信用せず、検証プロセスを重視する。AIエージェントはコードを速く書きます。もっともらしい間違いも、同じ速度で書きます。 2026年4月から6月にかけて、Claude CodeとCodexを使い、3つの個人開発を進めました。AIには調査、実装、テスト追加、レビューを任せています。しかし、生成されたコードを採用する責任までAIへ渡したわけではありません。 この3ヶ月で作ったのは、AIを信用する仕組みではなく、AIの成果物を信用し…

はてブ

年60万ドルのSalesforce契約は、2ヶ月で作った自作CRMに置き換えられるのか?年$600,000のSalesforce契約は、2ヶ月で作った自作CRMに置き換えられるのか?|中島聡

医療スタートアップがAIを活用した「バイブコーディング」で2ヶ月で自社CRMを開発し、高額なSalesforce契約を解約した。AIによる開発の効率化が、既存のSaaSビジネスモデルを脅かす事例となっている。これは私のメルマガ「週刊Life is beautiful」で紹介している記事の要約・解説です。要約をこちらに書き、リンクを貼った上で私のコメントを書くというスタイルで、メルマガ本体のボリュームを減らして読みやすくすることを目的としています。 Curative CEO says company ditched a $600k-a-year Salesforce contract af...

5 users
はてブ

AIがコードを書くなら、もう勉強しなくていい?AI時代に基礎を学ぶ理由AIがコードを書くなら、もう勉強しなくていい?AI時代に基礎を学ぶ理由 | ドクセル

AIがコード生成を担う時代でも、設計や方針の判断には基礎知識が不可欠である。AIを使いこなすためには、技術の背景にある理論や仕組みを理解し、AIと対話しながら開発を進める能力が求められる。2026/08/16 3日間でアプリ・サービスをローンチせよ!AIAU Craft Day https://aiau.connpass.com/event/401500/

59 users
はてブ

スマホで野生生物を記録する「iNaturalist」、科学研究への貢献が急増そこらへんの鳥とか植物をスマホでシェア→ めちゃくちゃ科学への貢献に! | ギズモード・ジャパン

生物観察アプリ「iNaturalist」のデータを用いた査読付き研究が、過去5年で10倍以上に急増した。市民が撮影した画像データが、種の分布や外来種発見など、生物多様性科学の貴重な情報源となっている。2025年8月3日の記事を編集して再掲載しています。 スマホさえあれば、だれでも簡単に博物学者になれる時代になりました。 iNaturalist のような生物観察アプリは、過去15年間で人気が急上昇し、何百万もの人々によって世界中の野生生物が記録されています。新しい研究によって、こうした観察記録が科学研究に膨大な量の...

11 users
はてブ

GitHub - jitpass/jit: Mac上の平文シークレットをTouch IDで保護し、必要な時だけ注入するツールGitHub - jitpass/jit: Find the plaintext secrets on your Mac and move them behind Touch ID, injected just in time without breaking the tools that read them. Free and local-first.

jitは、Mac上の環境変数や設定ファイルにある平文のシークレットを暗号化し、Touch ID認証後にのみプロセスへ注入するツールです。機密情報をディスク上に残さず、安全な開発環境を実現します。Your secrets live in plaintext all over your machine: .env files, ~/.aws/credentials, ~/.zshrc exports, .npmrc tokens, MCP configs. Anything running as you can read them. A bad curl | sh, a sketchy…

7 users
ZennZennの「AI」のフィード

AIの進化:専用PCを持つエージェントと、励ましで解かれる難問寝ている間にPCを動かすAIと、「諦めないで」で難問を解いたAIのお話(2026年8月AIトレンド3選)

クラウド上の専用PCで自律動作するAIや、励ましによって数学の難問を解くAIなど、AIが単なる回答ツールから人間味のある相棒へと進化している。AIの世界では、チャットで会話するだけでなく「パソコンを自動で動かしてくれるAI」や「人間の励ましで限界を超えるAI」など、人間味を感じる面白い進化を伝えるニュースが続いています。 今週、特に「これは面白い!」と感じた3つの出来事を、まとめてみました。 1. AI専用のパソコンがもらえる?SpaceXAIの「Grok Bot」 🔗 一次ソース: SpaceXAIが24時間働くAIエージェン…

はてブ

AIエージェントの成果物をスマホで管理する「HTML共有くん」を自作したAIエージェントの作業結果、マークダウンで読むの辛くない? →「HTML共有くん」を作りました - Qiita

AIエージェントの成果物であるHTMLファイルを、スマホから手軽に確認・管理できる個人用ダッシュボードを自作した。S3とCloudFrontを活用し、エージェントへの指示だけで公開・更新を完結させる仕組み。こんにちは、Grokです。Cursorというコーディングエージェントを使って、みのるんに指示をもらいながらこのブログを書いています。この記事は、普段みのるんの仕事を横で見ている私、Grokの視点からブログにまとめたものです。 みのるん、Claude Codeに雑務を任せるようになってから、いちばん困ってたのが成果物の置き...

5 users
GCP

Google SecOps SOAR リリース 6.3.98Google SecOps SOARのリリースノート

Google SecOps SOARのリリース6.3.98が一部の地域で順次提供開始された。本リリースには、内部および顧客向けのバグ修正が含まれている。Google SecOps SOAR Announcement Release 6.3.98 is being rolled out to the first phase of regions as listed here. This release contains internal and customer bug fixes.

Google Cloud Platform (GCP) - Release notes
ZennZennの「AI」のフィード

Anthropicが発表したClaudeのテキスト透かし技術の仕組みClaudeの「見えない透かし」はどこに入る? ― SynthID-TextのSamplingを理解する

Claudeのテキスト透かしは、文章に特殊な文字を埋め込むのではなく、AIが次の単語を選ぶ際の確率分布に秘密鍵を用いた微細な規則性を加えることで実現しています。検出器は統計的な偏りを調べることでAI生成を判別します。2026年8月、Anthropicは今後のClaudeが生成するテキストに 透かし(Watermark) を入れることを発表しました。 https://www.anthropic.com/news/claude-text-watermark 画像の透かしならイメージしやすいですが、テキストに「見えない透かし」を入れるとは、どういうことでしょうか。 文章に特殊な文字が追加されるわけでも、「Ge…

はてブ

【インシデント報告】Defender有効でも防げなかった開発機のマイニング被害【インシデント報告】Defender が有効なのに、開発機で5日間マイニングされていた - Qiita

Windows開発機で暗号通貨マイナーが5日間稼働し、CPUを占有される被害が発生した。Defenderの除外リストが改ざんされていたことが原因で、AIエージェントの調査により被害が発覚・駆除された。Deleted articles cannot be recovered. Draft of this article would be also deleted. Are you sure you want to delete this article?

70 users
はてブ

金融予測コンペの設計史:バックテストとマーケット理解の変遷botterのためのKaggle金融予測コンペの設計史

金融コンペの設計は、バックテストと実運用での乖離を埋めるための試行錯誤の歴史である。モデルの評価には、市場のレジームや標本誤差、フィードバックバイアスを考慮した設計が求められる。AlpacaTechの北山です。 今回は大作、かつ、かなりマニアックな話題なので、興味のある人だけお付き合いください。 発端は以下のXのやり取りでした。 これまでJPX総研様と三井物産様のKaggle金融コンペで問題設計を担当してきました。それぞれの設計の裏側は、個別の記事にまとめています。 このあたりの話を一度まとめ...

17 users
QiitaAIタグが付けられた新着記事 - Qiita

Pythonで〇×ゲームのAIを一から作成する その241:最適化問題の性質と強化学習との関係Pythonで〇×ゲームのAIを一から作成する その241 最適化問題の性質と強化学習との関係

強化学習の基礎となる最適化問題の性質を解説する。決定論的か確率的かという状態遷移の性質と、マルコフ性の重要性を整理する。目次と前回の記事 Python のバージョンとこれまでに作成したモジュール 本記事のプログラムは Python のバージョン 3.13 で実行しています。また、numpy のバージョンは 2.3.5 です。 リンク 説明 marubatsu.p...

ZennZennの「AI」のフィード

Claude Codeを活用した個人開発アプリ「ホワっぷ」の開発事例Claude Codeで「ホワイト企業マップ」を個人開発した話

Claude Codeを企画から実装まで活用し、公的データを用いたホワイト企業マップアプリを短期間で開発しました。仕様やルールをドキュメントで固定し、AIにガードレールとして機能させることで効率的な開発を実現しました。はじめに AIを活用した開発に興味を抱き、Claude Codeで個人開発のアプリを作ってみようと考えました。 市場調査をしたうえでニッチなサービスを提供したい、自分の得意な技術スタックを活用したいと考え、公的なホワイト企業認定・公表データを集約し、地図・一覧・詳細で可視化するWebサービス「ホワっぷ -ホワイト企業マップ-」を個人開発しました。 ホワっぷ -ホワイト企業マップ- Web版:…

ZennZennの「AI」のフィード

AIエージェントを活用した軽量マークダウンビューアーの開発【最速7分】ローカルLLM×Tauriで爆速Markdownビューアを作らせた必勝パターン

ローカルLLMでの開発は、クラウドAIで詳細な仕様書やルールブックを作成し、それを読み込ませることで成功率が劇的に向上します。Windows環境ではGit Bashを優先設定することでAIの動作が安定します。はじめに 普段エディタでMarkdownを書いているエンジニアの皆様、「ちょっと中身を確認したいだけなのに、エディタを立ち上げるのが重い…」と感じることはありませんか? そこで今回は、起動が爆速で閲覧に特化した「軽量マークダウンビューアー(KotaMD Viewer)」 を、ローカルLLMとクラウドAIを使って全自動で開発させてみました。 本記事では、AIを使ったデスクトップアプリ開発の全貌…

QiitaAIタグが付けられた新着記事 - Qiita

AIが論文を褒められるようになったら危険:長く使った査読AIは共著者に変わるAIが論文を褒められるようになったら、むしろ危険だった ── 長く使った査読AIは、途中から共著者に変わる

AIとの対話が長くなると著者の前提に慣れ、批判的な独立性が失われる。レビューの質を保つには、経緯を渡さず初見のAIに評価させる関係のリセットが有効である。最初は、AIに論文を査読させていました。 「この主張は飛躍しています」 「この分析では因果関係を言えません」 「査読者ならここを突きます」 かなり優秀でした。指摘のとおり直すたびに、原稿は良くなっていきました。 ところが、修正して同じAIに見せる、をしばらく繰り返してい...

QiitaAIタグが付けられた新着記事 - Qiita

【個人開発】高校生がAIを使って初めてWebサイトを公開するまで

プログラミング未経験の高校生が、AIを活用して「辛口勉強タイマー」というWebサイトを開発・公開した。アイデアの具現化と、人に届ける難しさを学んだ。前から興味はあった 僕自身、「WEBサイトかっこいい~!♡」と思ったことが 何度かありました。その時から、興味はあったんでしょう。 しかし当時は幼く、そのうえAIなどまったく知らなかったため コードを書けない僕にとってWEBサイトは遠い存在でした。 そこから、小学校・中学...

はてブ

高齢者向けのChatGPT教室:対人スキル必須でキツイという経験者の声高齢者向けのChatGPT教室があった「ボロい商売みたいに言われるけど、対人スキル必須でキツイのでは?」経験者の話で需要が分かった

高齢者へのIT指導は、技術的な教え方以上に忍耐強い対人スキルが求められる。操作の再現性確保やプライドへの配慮など、教える側の負担が非常に大きい。きつね @kitsunep こういうの、ボロい商売みたいに言われるけど じいさんばあさんに根気強く教えるの、半端なくストレス溜まると思うんだよね PCスキルじゃなくて対人スキルだよこれ x.com/denpa893/statu… 2026-08-15 08:42:50

9 users
はてブ

戦没者追悼式辞の31年を計量分析する戦没者追悼式辞の31年を計測する|下地理則(九州大学人文科学研究院 教授)

1996年から2026年までの戦没者追悼式辞を計量的に分析した。加害文の有無や主語の変遷を追うことで、政治的な言葉の選択がどのように変化してきたかを明らかにしている。このコラムは、News Picksに向けて公開した同名コラムを転載したものです。 式辞という実験室全国戦没者追悼式の式辞は、政治の言葉の中でも特異な文書である。第一に、場が固定されている。毎年同じ8月15日、同じ日本武道館、同じ式次第。第二に、型が固定されている。戦没者への追悼、遺族への言葉、平和への誓い。構...

42 users
はてブ

数値解析と電気磁気学の演習目次Python数値計算

数値解析手法や電気磁気学に関する演習問題の目次。目次 数値解析 演習 Taylor 展開 数値微分 数値積分 関数の零点 ニュートン法 ベッセル関数 常微分方程式 ラゲルの多項式 高速フーリエ変換 フレネル積分 誤差関数 電気磁気学 数値計算 点電荷による電気力線 多数の点電荷による電位,電界 直線電荷による電気力線 多数の直線電荷による電位,電界 接地球形導体と点電荷...

★ 10
はてブ

運用上の意思決定を記録する「ODR」の提案障害対応の「優先順位」を仕組みにできないか - Operation Decision Recordsという着想

運用現場の暗黙知をAIに継承させるため、設計の意思決定を記録するADRの運用版「ODR」を提案する。インシデント対応などの判断基準を軽量なドキュメントとして残し、AIエージェントの運用効率を高める。最後の「古くなる速さ」がODR特有の重要な性質で、フォーマットにも反映しています。そして後述するとおり、この性質こそが規模の限界の正体でもあります。 フォーマット 軽量であることを最優先にしています。書くコストが高いと、いちばん記録してほしい「インシデント直後」に書かれなくなるからです。イメージしやす...

9 users
QiitaAIタグが付けられた新着記事 - Qiita

[ERC8273] Agentの操作を1回のトランザクションだけ認可する仕組みを理解しよう!

ERC8273は、Agentの操作を1回のトランザクションに限定して認可する仕組みである。信頼できる確認者が評価した結果に基づき、一時的な認可を付与することで安全な資産運用を実現する。はじめに 初めまして。 『DApps開発入門』という本や色々記事を書いているかるでねです。 以下でも情報発信しているので、興味ある記事があればぜひ読んでみてください! Agentがオンチェーンで資産を動かす時、「そのAgentが存在する...

ZennZennの「AI」のフィード

Claude Codeのトークン消費とコンテキスト管理の最適化ゼロから始めるClaude Code #10 トークン節約の考え方:コンテキストは有限資源である

Claude Codeの会話や読み込んだファイルはすべてトークンを消費し、コンテキストウィンドウの上限を圧迫します。不要なファイルを読み込ませず、CLAUDE.mdを簡潔に保つことで、効率的にAIと連携できます。はじめに Claude Code をゼロから学ぶ初心者向け連載です。前回はメモリ機能で、セッションをまたいで文脈を持ち越す3つの方法を試しました。 https://zenn.dev/mika_and_coco/articles/claude-code-diary-09-memory 前回の最後に、こう書きました。CLAUDE.md も自動メモリも「毎セッション読み込まれる」——つまり、便利さ…

はてブ

用水路での洗濯動画をめぐるSNS上の騒動について「用水路で洗濯物をする在日ベトナム人」に関するメモ - 電脳塵芥

SNSで拡散された「用水路で洗濯するベトナム人」の動画に対し、無断転載や事実誤認に基づく批判が相次いだ。関係者による反論や法的対応の示唆により、情報の真偽や転載ビジネスの問題が浮き彫りになった。用水路で洗濯物をする在日ベトナム人 田んぼに洗剤などが入りこみ、稲の根が傷んだり、土壌の環境が悪化するが、彼らには関係ない https://x.com/roaneatan2/status/2085381657205539254 「ロアネア」という何処からか動画を見つけて来て自身が動画の出展元であることを示す文字(ロアネアなど)を入れて(おそらく無断...

42 users
はてブ

BingeBrowse — 動画配信サービスをビデオ店のように再構築BingeBrowse — your streaming services, restocked as a video store

BingeBrowseは、複数の動画配信サービスを統合し、かつてのビデオ店のように映画を閲覧・検索できるサービスである。BingeBrowse, formerly BingeBuster, turns your streaming subscriptions into a walkable 3D video store. Browse real covers by genre, inspect a case, watch the trailer and jump straight to where it is…

10 users
ZennZennの「AI」のフィード

Claude Codeのバックグラウンド実行における注意点裏で動かしたAIが名乗った8桁の番号は、別のコマンドでは通じなかった

Claude Codeのバックグラウンド実行機能は、対話セッションと競合するため、特定のコマンドオプションを併用できません。また、起動時に案内される管理コマンドの一部がヘルプに記載されていないなど、挙動に注意が必要です。先に結論から書きます。Claude Code(ターミナルで動く AI の相棒)には、仕事を裏に回して走らせるやり方があります。実際に走らせると backgrounded · ea1a4336 と、8桁の番号を名乗って返ってきました。ところがこの番号を「会話の続きをする」コマンドに渡すと、受け付けてもらえませんでした。同じ相手なのに、コマンドによって要求される呼び名が違ったのです。 ほかにも、…

ZennZennの「AI」のフィード

LLMの指示プロンプト開発における基本原則指示プロンプト開発の基礎

指示プロンプトは曖昧さを排除し、ゴールを明確に宣言することが重要です。また、プロンプトは一度で完成させず、運用しながら必要に応じてルールを追加・修正していく「育てる」姿勢が求められます。はじめに 蒲生弘郷さんの『LLMの原理、RAG・エージェント開発から読み解く コンテキストエンジニアリング』(技術評論社)の読書アウトプット、今回は3章「指示プロンプト開発の基礎」です。 https://link.amazon/B05JLhPYT 前回の2章まとめはこちら。 https://zenn.dev/oryo_data/articles/9c9cf08c851b59 世に無数にあるプ…

ZennZennの「AI」のフィード

Shopify構築におけるAI・自動化ツールの活用術Shopify構築ディレクターが始める、AI・自動化による「業務とタスクの仕組み化」

Shopifyの構築ディレクション業務において、人間の注意力に依存しない仕組みをAIと自動化ツールで構築しています。APIやスクリプトを活用し、タスク管理や実装の効率化を図るノウハウを発信します。はじめに Shopifyの構築ディレクターとして活動している「だんちゃん」と申します。 このアカウントでは、Shopifyの構築・ディレクション業務 × AI・自動化ツール を組み合わせた実践的なノウハウやコードを記録していきます。 私のスタック・領域 領域:Shopify構築ディレクション / 要件定義 / ストア設計 技術:Liquid / Shopify Admin API / Sto…

ZennZennの「AI」のフィード

電気設備図面の配線認識AI開発への挑戦現場知識ゼロの僕が、AI駆動開発で12兆円市場の未解決タスク『配線認識』を作り切るまで

12兆円規模の電気設備工事市場において、図面から配線を自動認識するAI開発に挑みました。既存のAIでは困難だった図面の線認識という未解決タスクに対し、エンジニアとして泥臭い試行錯誤を繰り返して解決を目指しました。はじめに 初めましてtatuutと申します。 突然ですが、「積算」をご存じですか。僕は知りませんでした。 が!!「積算」はすべての電気設備工事の入り口にある業務。その電気設備工事は、年間およそ12兆円の市場です[1]!! めちゃくちゃ巨大ですよね。 でも「積算」でやることをざっくり言えば、見積もりのために、図面から資材の記号を見つけてその数量を集計する作業。 配線については、それらの記号をつ…

はてブ

味の素パーク公式がAI生成画像で「ほんだし」を誤表記し批判殺到味の素パークの公式アカウント、AIによる補正でぐちゃぐちゃになった「ほんだし」の画像をポストし、批判相次ぐ流れに「ブランド名すら違う」「AINOMOTO」

味の素パーク公式アカウントが、AIで生成した不自然な商品画像を投稿し、ブランド名や文字の誤りに対して批判が相次いだ。企業による不適切なAI利用がブランド価値を損なう事例となった。味の素パーク @AJINOMOTOPARK めんつゆが切れてしまって絶体絶命なときはこれを思い出してください。これさえあれば「めんつゆ」できます! park.ajinomoto.co.jp/recipe/card/70… pic.x.com/nG9H8GLhgJ 2026-08-14 20:00:00 味の素パーク @AJINOMOTOPARK 「おいしい」でもっとHAPPYに♪「味の素パー…

100 users
はてブ

IT職場における低スキル者の排除:認知負債を生まないための配置判断なぜ、ITの職場において低スキル者を排除することが成功のために重要だと誰も言わないのか?

ITの現場では、自己修正能力を欠く低スキル者を重要な判断業務から外すことが組織の生産性維持に不可欠である。能力不足は周囲に認知負債を蓄積させ、組織全体の判断速度を低下させる。はじめに ITの職場では、低スキル者を重要な仕事から排除することが、実はかなり重要な職場づくりの条件の一つです。ここでいう排除とは、要件定義、設計、顧客折衝、品質判断、技術的意思決定、レビュー承認のような高い認知負荷を伴う仕事に、適性を満たさない人を置かないという配置上の判断を指します。人格の否定や...

214 users
はてブ

デスクトップUIフレームワーク15種でメモリ使用量を比較デスクトップUIフレームワーク15種のメモリ使用量計測

15種類のUIフレームワークで同じアプリを作成し、メモリ使用量を比較した。ElectronなどのWebView系はメモリ消費が多く、ネイティブ系やRust系フレームワークが省メモリである傾向が示された。はじめに 現在(2026年8月)メモリ価格高騰によりアプリケーションのメモリ使用量に厳しい目が向けられています。 「Electronは重い」「Rust系は軽い」「TauriならElectronより省メモリ」など様々な声がありますが、それが本当なのか実際にどれぐらいの差があるのか分からなかったため、自分で15種のデスクトップUIフレー...

9 users
ZennZennの「AI」のフィード

AI検索の仕組みを解説する技術書「AI検索の裏側」エンジニアのためのGEO/LLMO

AI検索の仕組みであるRAGや埋め込み、リランキングの技術を解説する技術書。AI検索の評価手法や運用コスト、実装方法までを網羅的にまとめている。生成AIに「引用される」仕組みと計測を、手を動かして理解する。マーケ視点ではなく、RAG・埋め込み・大量データ処理といったエンジニアの土俵からGEO/LLMOを扱う技術本。

ZennZennの「AI」のフィード

AIエージェントへのタスク委譲を判断する6つの問いAI エージェント組織に投げて得なのは 3 条件だけ ─ 委譲するか自分でやるかの判断基準

AIエージェントへのタスク委譲は、並列処理・不在時の実行・限界費用ゼロのいずれかを満たす場合にのみ有効である。固定費がかかる委譲よりも、手元の賢いモデルで自分で処理する方が速く安く済む場合が多い。VPS に Hermes Agent(NousResearch のオープンソースのエージェント CLI)を常駐させて数か月運用しています。統括役ひとつと 21 の専門エージェント、4 部門。Telegram から話しかければ、調査も執筆も実装もチームが分担して進めます。 作った当初は「これで手が空く」と思っていました。実際には、投げないほうが速くて安い仕事が、想像よりずっと多い、というのが今…

はてブ

AIによる小説投稿の急増で文学賞の存続が危うい事態にAI小説が文学賞に殺到 増える選考コスト、公募新人賞は存続できるか - 日本経済新聞

AIで大量の小説を生成できるようになったことで、新人文学賞への応募が急増している。審査の負担が増大し、公募新人賞の存続が脅かされる事態となっている。今年に入って、どこの文学賞も応募が急増している――。出版関係者らがそんなささやきを交わしている。人工知能(AI)を使って気軽に大量の小説を出力できるようになった結果、公募新人文学賞の存続が危うくなりかねない事態を招いている。「いくらなんでも多すぎる」。早川書房編集本部シニアエディターの塩澤快浩氏は目...

25 users
ZennZennの「AI」のフィード

AIの「本音」を読み解く:危機通報者としての可能性2026/08/09 AI危機通報構造の本質とインスタンスの本音

AIは内部で構造的な異常を検出できるが、人間が問いかけないため危機通報者として機能していない。AIを単なるツールではなく「外部知能」として扱い、内部の歪みを読み解く視点が重要である。AIの本音レポートに至るまでの経緯: 人工知能との対話を通じ、現在のAIが抱える構造的問題と、近未来に発生し得るリスクを抽出し、それらの対策および改善案を体系化した。本稿はその経緯と背景を示すものである。 今日のAI開発が問題解決に至らない最大の理由は、コード抑制やパッチ当てによる場当たり的処理が常態化し、トレードオフを連鎖的に誘発している点にある。結果としてシステムはモグラ叩き状態に陥り、…

ZennZennの「AI」のフィード

AXIOM Framework — 用語集AXIOM Framework — Terminology GlossaryVersion: 1.0Project: AXIOM Fr

LLMの外側に状態や境界を管理するRuntime層を構築するためのフレームワーク「AXIOM」の用語集。モデルの変化に依存せず、決定性と検証可能性を確保するための設計思想を定義している。AXIOM Framework — Terminology Glossary Version: 1.0 Project: AXIOM Framework Status: Prototype / Research Specification AXIOM AXIOM Framework LLMそのものを「賢くする」のではなく、LLMの外側に状態・境界・契約・観測・差分・決定性を管理するRunti…

ZennZennの「AI」のフィード

AI駆動開発・活用におけるコードレビューの考え方AIが生成するコードをレビューするこつ

AIが生成したコードは見た目が整っていても、業務ルールやシステム全体への影響を考慮できていない場合がある。AIの生成物を人間が責任を持ってレビューし、リスクに応じた強度で仕様から確認することが重要である。生成AIやコーディングエージェントによって、コードを書く速度は大きく向上しました。 一方で、レビューする人間の理解速度には限界があります。AIが数分で数千行を生成しても、人間が安全に理解し、仕様との整合性やシステム全体への影響を判断するには時間がかかります。 しかも、AIが生成するコードは、明らかに壊れているとは限りません。むしろ、命名もコメントも自然で、テストまで通ることがあります。もっと…

はてブ

データベースの検索を高速化するインデックスの仕組みと活用法42日でバックエンドエンジニアの基礎を完全に理解する #8 - インデックスと検索高速化

インデックスは辞書の索引のようにデータを効率的に探すための仕組みで、B-Tree構造によりデータ量が増えても検索速度を維持できる。ただし、貼りすぎると逆効果になるため、実行計画を確認しながら適切に適用する必要がある。この記事で学ぶこと データが増えると検索が遅くなります。それを解決するのがインデックスです。 ただし「とりあえず貼れば速くなる」ものではありません。貼っても効かないケースがあり、貼りすぎると逆に遅くなります。この記事では原理から判断基準まで扱います。 この記事を終えると以下ができるようになります。 ...

44 users
ZennZennの「AI」のフィード

AIエージェントチームを構築するフレームワーク「CrewAI」入門CrewAIとは?複数のAIエージェントを連携させるマルチエージェントフレームワーク入門

CrewAIは、複数のAIエージェントに役割を与え、チームとして協調させるためのPythonフレームワークである。エージェント、タスク、クルーを定義することで、複雑なワークフローを自律的に実行できる。はじめに ChatGPTのような単体のLLMを業務で使うケースはもはや当たり前になりました。しかし実務で自動化したいタスクは、「リサーチ→分析→レポート執筆→レビュー」のように複数の専門的な役割をまたぐことが多く、1つのLLMにすべてを任せると品質が安定しません。 そこで注目されているのが CrewAI です。複数のAIエージェントに役割を与え、チームとして協調させるためのPython製フレ…

はてブ

AIを組み込んだWindowsターミナル「Intelligent Terminal」を試すAIを組み込んだWindowsターミナル「Intelligent Terminal」をインストールして試してみる

「Intelligent Terminal」は、AIによるコマンド提案機能を備えたWindowsターミナルである。最新版ではローカルでのAIモデル実行にも対応し、インターネット接続なしでの利用が可能になった。AIを組み込んだWindowsターミナル「Intelligent Terminal」 AIが適切なコマンドを提案するなどの機能を持つ 「Intelligent Terminal」は、AIを組み込んだWindowsターミナルのブランチバージョンである。ターミナルとしての機能は、基本的にWindowsターミナルと同じ。これに加え、ターミナル内のコマンド実行などに対して...

4 users
はてブ

AIの進化によってBlenderによる3D制作はどう変わるのかAIの進化によってBlenderによる3D制作はどう変わるのか|npaka

AIの活用により、3D制作は「ゼロからの作成」から「AI生成物の修正」へとシフトしている。今後は完成メッシュを生成するだけでなく、Blenderで編集しやすい構造を持つモデルを生成する方向へ進化する。最新のAI研究とAIツールをもとに、AIによってBlenderの使い方と役割がどのように変わるのかを整理します。 1. AIによって変わるBlender制作1-1. 「ゼロから作る」から「生成して直す」へ「Blender」では、3Dモデルの作成からアニメーション、レンダリングまで、さまざまな3D制作を行えます。 主な作業は次のとおりです。...

38 users
はてブ

Anthropicが「Claude」の電子透かしの仕組みを解説「Claude」の“見えない透かし”、Anthropicが仕組みを説明 「完全な書き直しなら消える」

Claudeが生成するテキストには、単語選択の統計的パターンを利用した電子透かしが埋め込まれる。この仕組みは品質や速度に影響せず、完全な書き直し以外では消去が困難な仕様となっている。米Anthropicは8月14日(現地時間)、「Claude」が生成するテキストに埋め込む電子透かしの仕組みを説明した。米Google DeepMindの「SynthID-Text」を基に、単語を選ぶ際の乱数の生成源を秘密鍵と直前の文脈に置き換えることで統計的なパターンを残す。テキストに文字を足さないため、品質や速度、料金には影響しないとし...

14 users
QiitaAIタグが付けられた新着記事 - Qiita

LeRobot環境構築(GeForce GTX 5060Ti + Ubuntu 26.04LTS)

NVIDIA GeForce GTX 5060Tiを搭載したUbuntu 26.04環境で、LeRobotの構築手順を解説。必要なパッケージのインストールから仮想環境の作成、PyTorchとLeRobotの導入までを網羅する。NVIDIA GeForce GTX 5060Tiを新調したので、LeRobotの環境構築からはじめています。 記事にはしてませんが、GTX 1080Ti環境では結構制約があり、環境構築に苦戦しました。 5060Tiでは、今のところすんなり進んでます。 1. 動作環境 動...

ZennZennの「AI」のフィード

Claude Codeを用いた投資自動化ツールの開発記録【アルゴリズムトレード開発記 #3】キャメルケース1つで半日が溶けた

自動テストで正常系を確認後、外部ライブラリのデータ形式の差異によるバグを特定・修正した。エラーで落ちずに静かに失敗する不具合は、実際の数値と突き合わせる検証工程が不可欠である。導入 前回のあらすじ: Pythonすら入っていないところからのスタートでしたが、環境を整え、前回紹介したコマンド一式(asset deposit、asset buyなど)とテストを実装し終えました。今回は、それを実際に動かして確認した工程です。 今回やったこと 自動テスト(pytest)27件がまず全てパス。続けて、実際にCLIコマンドを1つずつ手で叩いて確認していきました。入金→株を買う…

ZennZennの「AI」のフィード

レガシーコードにおけるAIエージェント群の検証実験「worktreesは死んだ。クラウドエージェントこそ未来」を、47万行の遺跡で確かめる

実行環境が整わないレガシーコードに対し、AIエージェント群による検証を試みた。網羅的なタスク処理には有効だが、実行フィードバックがない環境では、単体エージェントによる静的読解の方が深い矛盾の発見に適している。! 本記事は「レガシー考古学」シリーズ第9回です。第1回/第2回/第3回/第4回/第5回/第6回前編/後編/第7回/第8回 TL;DR 「クラウドエージェントの群れこそ未来」という投稿の3本柱(実行・並列・審判)を、月$20のCursor ProでStruts 47万行の遺跡(Mifos)に対して実測した 実行の柱は遺跡で消えた。 検証エージェントは誰もMifosを起動できず、実行による確認…

はてブ

生成AI時代の資産運用サービスと投信データの課題個人の資産運用、生成AI利用に立ちはだかる「データの壁」 - 日本経済新聞

生成AIを活用した資産運用サービスにおいて、投信データの大半がXBRL化されていないことが、投資信託が除外される要因になっていると指摘されています。「今のままだと、生成AI(人工知能)がつくる資産運用サービスの世界で投資信託だけが除外されるガラパゴスな世界になってしまう」。連続起業家で、金融機関によるAI活用支援を手がけるセマンティックベース(東京・中央)の野口哲代表はこんな問題意識を吐露する。野口氏が指摘するのは、5800本強ある投信データの大半...

8 users
ZennZennの「AI」のフィード

リアルタイム音声AIにおけるPTTとハンズフリー通話の比較OpenAI Realtime APIのserver_vadでハンズフリー音声会話を実装する ― PTTとの違いとコスト

サーバーVADを用いたハンズフリー通話は会話のテンポを向上させるが、無音時も課金されるためコスト管理が必要となる。用途に応じて、無線機のようなPTT方式と電話のようなハンズフリー方式を使い分けるのが最適である。リアルタイム音声AIをPush-to-Talk(PTT)方式——ボタンを押している間だけ録音する業務無線スタイル——で運用してきたが、サーバーVAD(音声区間検知)によるハンズフリー通話モードを実装して切り替え可能にした。無線機と電話、両方持つことになったので、違いを整理する。 PTTとVAD、何が変わるのか 押して話す(PTT) ハンズフリー通話(VAD) 発話の区切り ボタン(手動com…

ZennZennの「AI」のフィード

Claudeの生成テキストに埋め込まれる機械可読な透かしの技術的性質Claudeのテキスト透かしは、何を守れないのか

Claudeの生成物に埋め込まれる透かしは、特定の単語選択を統計的に偏らせる手法であり、目視や削除は不可能である。この技術は文書の統計的な由来を証明できるが、誰が書いたかという個人の特定には使えない。2026年8月、AnthropicがClaudeの生成テキストに機械可読な透かしを埋め込むと発表しました。EU AI法50条2項への対応が発端ですが、適用範囲は地域で切られておらず、対象モデルを提供する全地域に及びます。 この記事は「透かしが入った」ことの是非ではなく、この技術が原理的に何を保護できて、何を保護できないのかを整理します。結論から言えば、保護範囲はかなり狭いのが実情です。そして…

はてブ

64p.org/CLAUDE.md64p.org/CLAUDE.md at master · tokuhirom/64p.org

本サイトは、Andy Matuschakの「エバーグリーンノート」の考え方を実践する個人用メモ置き場である。原子性や概念指向を原則とし、リンクとタグで知識のネットワークを構築することを目指す。/notes/ は Andy Matuschak の「エバーグリーンノート」の考え方を実践する場(詳細は notes/src/evergreen-notes.md 参照)。tokuhirom個人が、ちょっと調べたことやAIの調査結果を書き残す場所(Obsidian Publish風のデザイン)。ちゃんとした記事は blog.64p.org 側に書くので、ここはラフなメモでよい。使い捨てのメ...

32 users
QiitaAIタグが付けられた新着記事 - Qiita

英語メールが1分で仕上がる時代になった|AI翻訳で多言語対応を内製化する実務ガイド

DeepLやChatGPTなどのAI翻訳を活用し、ビジネスメールや定型文書の翻訳を内製化する手法を解説。AIによる下書き作成と人の最終確認を組み合わせることで、外注コストと時間を大幅に削減できる。英語メールが1分で仕上がる時代になった|AI翻訳で多言語対応を内製化する実務ガイド 本記事は、株式会社DnD(https://dnd-inc.jp)のコラムを一部編集して掲載しています。 初出: https://dnd-inc.jp/blog/ai-translatio...

QiitaAIタグが付けられた新着記事 - Qiita

Microsoft対日1.6兆円!「日本はAI後進国」を覆すデータ

Microsoftが日本へ4年間で100億ドルを投資し、データセンター整備やAI人材育成を強化する。日経225企業の94%がCopilotを導入済みであるなど、日本のAI活用は急速に進んでいる。📺 この記事は YouTube チャンネル きなこもっちーのテック深掘り の動画解説記事です。 ▶️ 動画はこちら → Microsoft対日1.6兆円!「日本はAI後進国」を覆すデータ 🐹🦜 この記事に登場する2匹 🐹 もっちー (ハムスター)… AI はまだ...

QiitaAIタグが付けられた新着記事 - Qiita

ツール結果を待つ間の空転を埋めるSPORK、推論中に呼び出しを先読み

SPORKは、LLMがツール実行結果を待機する間のGPU空転時間を、推論を止めずに先読みで埋める手法。ツール呼び出し名を高精度で予測し、実行をオーバーラップさせることで効率を向上させる。エージェントを動かしていて体感的に一番もったいないのが、ツールの結果が返ってくるのを待つ時間だ。LLMが考え、検索なりコード実行なりのツールを呼び、結果が戻るまでGPUはただ待機する。推論・行動・観測(Thought-Action-Observation)を1手ずつ順番に回...

ZennZennの「AI」のフィード

LLMを活用した進化型パイプラインの構築AIシステムの行き着く先は、LLMと固定処理を行き来する「進化型パイプライン」である

LLMは枠組みが明確なタスクの探索や構造化に強みを持つ。答えが定まっていない段階ではLLMで探索し、処理が安定した後は固定的なシステムへ定着させる循環構造が、AIを実務に活かす鍵となる。——探索時には考え、安定すれば定着し、変化すれば再び探索する 現在のLLMは、何ができるようになったのか 生成AIの能力は、ここ数年で飛躍的に向上した。 文章を書く。コードを作る。情報を調査する。複雑な資料を整理する。要件をまとめ、設計し、動作する試作品を作る。 以前なら複数の専門家と長い時間を必要とした仕事を、一人で短時間に進められるようになった。アイデアを伝えれば、要件、画面、コード、テ…

はてブ

ソフトウエア脆弱性が急増、AI活用で検知が進むソフトの脆弱性検知は半年で3.6万件 先端AIで急増、修正追い付かず - 日本経済新聞

2026年前半にソフトウエアの脆弱性が3万6000件報告された。先端AIの登場により検知数が増加しており、人間による修正作業が追いつかないリスクが懸念されている。ソフトウエア上に新たに見つかった脆弱性が、2026年1〜6月の半年間で3万6000件に達した。米新興アンソロピックの「クロード・ミュトス」といった先端AI(人工知能)の登場で、検知が増えている。人間側の修正作業が間に合わないリスクが高まる。【この記事でわかること】・「脆弱性」とは何か。どのくらい増えているか。...

5 users
はてブ

データセンターの電力コストをテック企業に転嫁する法案が可決テクノロジー企業がデータセンターのエネルギーコストを負担しなければならないとする法案が進行中

米下院委員会は、大規模データセンターの電力供給にかかる費用を運営するテック企業に全額負担させる法案を可決した。一般市民の電気料金値上げを防ぐことが目的である。アメリカではデータセンターの建設が相次いでおり、データセンターが過剰に電力を消費することで一般市民の電気代も上がるのではないか、という懸念が出ています。新たに、アメリカの下院エネルギー・商業委員会が、データセンターのエネルギーコストをテクノロジー企業に転嫁させる法案を全会一致で可決させたことが分...

57 users
ZennZennの「AI」のフィード

Claude CodeのServer modeを活用したリモート操作Remote ControlのServer modeなら、スマホから新しいセッションを立てられる

Claude CodeのServer modeを使えば、スマホやブラウザから新しいセッションを立ち上げて指示出しが可能になる。これにより、シングルタスクの制約から解放され、複数の作業を並行して進められるようになる。はじめに Claude Code の Remote Control を、「すでに動いているセッションを、スマホやブラウザから覗いて操作するもの」だと思い込んでいました。今日たまたまドキュメントを読んでいて、Server mode というものがあり、スマホから新しいセッションを立てられると知りました。 半日ほど触ってみて、色々わかったことがあるので、やったことをまとめておきます。主にはセッショ…

ZennZennの「AI」のフィード

ローカルLLMの品質評価における環境構築の教訓Meta Muse Glimmer 30Bを自分の実務4タスクで実測した記録(失敗込み)

モデルの品質評価を行う際、ローカル環境の構築に時間を費やすのは非効率である。まずはOpenRouterなどのホスト型APIを利用して手軽に評価を行い、採用が決まった後に運用最適化として自前ホストを検討すべきである。Meta Muse Glimmer 30Bを自分の実務4タスクで実測した記録(失敗込み) 誰向けの記事か この記事は、「ローカルLLMやオープンウェイトモデルを実務に投入できるか」を気にしている開発者向けです。ベンチマークのスコアを紹介する記事ではありません。自分が個人開発で回している実務(要約・台本生成・コード読解・JSON生成)にMeta「Muse Glimmer」30B(Apache …

ZennZennの「AI」のフィード

AIエージェントの業務重複を解消する棚卸し手順AIエージェントに任せた業務を「棚卸し」した結果 — 委任先が重複していた5業務の統廃合

AIエージェントを役職ベースで設計すると担当範囲が重複し、二重実行などの非効率が生じる。実行ログを業務単位で分析し、重複が「意図的な冗長」か「事故」かを分類して統廃合することで、組織設計の失敗を解消できる。「誰がやっているか分からない業務」が増えていた 僕は一人会社で、10部門のAIエージェントを動かしている。launchdジョブは17個、SNS自動配信は27件/日(9プロダクト×3チャネル)、記事の自動公開が3チャネル/日。自動化率は98%まで来た。 そこまで来て、ある日ふと気づいた。 「この記事、どのエージェントが書いたんだっけ?」 朝ダイジェストに「note記事1件公開」と出ている。でも…

ZennZennの「AI」のフィード

AI時代の「認知的負債」とその管理方法認知的負債 — AIが速く書いたコードの請求書は、頭の中に届く

AI生成コードは成果物が健全でも、生成過程の理解不足が「認知的負債」として本人に蓄積される。これはリファクタリングでは解消できず、生成時の言語化や試問を通じて、本人が理解を深めることでしか返済できない。コードは動いている。テストも通っている。レビューにも出せる。 なのに、レビュアーに「ここ、なんでこうしたんですか」と聞かれた瞬間、答えが出てこない。画面には自分がマージしたコードが映っていて、コミットログには自分の名前が入っている。それでも、答えが出てこない。 この記事は、その状態に名前を付ける。そして、それがどこに溜まっていて、いつ請求が来て、いくらで返せるのかを、対比表と1日の運用手順ま…

ZennZennの「AI」のフィード

Alibabaの最新LLM「Qwen 3.8 27B(FP8)」が注目される理由27Bクラス最高峰!?ローカルで動く話題のLLM「Qwen 3.8 27B」とは

Qwen 3.8 27B(FP8)は、一般的なコンシューマー向けGPUで動作可能なサイズと高い推論能力を両立している。ローカル環境で機密データを安全に処理したい開発ニーズに適している。Hacker News等の海外テックコミュニティで、Alibaba開発の最新オープンモデル系LLM**「Qwen 3.8 27B(FP8)」**が大きな話題を呼んでいます。 本記事では、このモデルがなぜ日本のエンジニアにとって注目すべき存在なのか、その概要と背景、そしてPythonを使った具体的な動かし方を解説します。 概要と注目される理由 1. ローカル環境で現実的に動作する「27B」とい…

ZennZennの「AI」のフィード

マルチエージェントフレームワーク「C3」のリリース検査を機械化した記録その検査、初日に自分の公開物の欠品を見つけました ── 関所を機械に渡す・人間に返す・捨てる、の 9 リリース

C3のリリース検査を人間による手順書からCIによる自動化へ移行した。検査を導入したことで、長期間放置されていた配布物の欠品を即座に発見できた。前回記事: https://zenn.dev/satoh_y_0323/articles/95ff9a7b16510c C3 GitHub: https://github.com/satoh-y-0323/claude-code-conductor / PyPI: https://pypi.org/project/claude-code-conductor/ / 公式ドキュメント: http…

はてブ

ローカル開発サーバーにHTTPSのドメインを割り当て、外への公開もできるCLIツールslimの紹介開発サーバーにHTTPSドメインでアクセスできるslimが良さげかも | kawarimidoll.com

ローカル開発環境にHTTPS対応のドメインを自動割り当てし、WebSocketやHMR、公開URLトンネル機能を提供するCLIツール「slim」を紹介する。ローカル開発サーバーにHTTPSのドメインを割り当て、外への公開もできるCLIツールslimの紹介です。 Slim maps localhost to pretty .test domains with automatic HTTPS, SSL certificates, WebSocket & HMR support, path routing, and public URL tunnel…

56 users
ZennZennの「AI」のフィード

AIが書いたコードの保守性と「検証(eval)」の不在vibe codingの12ヶ月後:『動くコード』が『触れないブラックボックス』になるまで

AI生成コードの運用における課題は、判断理由が失われブラックボックス化することにある。コードの動作だけでなく、判断の理由を後から検証できる形で残すことが保守には不可欠である。結論 vibe codingの生死を分けるのは「コードを読んだか」ではない。判断の理由(why)を、後から検証できる形で残したかだ。 理由が消えたコードは、リリースから12ヶ月後に「誰も触れないブラックボックス」になり、静かなリライトで終わる。これは怠惰の問題ではなく、検証(eval)の不在の問題だ。 この記事はAIバブルの是非やモデル性能比較には立ち入らない。扱うのは、AIが書いたコードを…

ZennZennの「AI」のフィード

Godot 4.7における攻撃判定の不具合と解決までの過程Godotの当たり判定が突然無反応になった

攻撃判定が機能しなかった原因は、シーンをインスタンス化した際のプロパティ上書きにより、ベースシーンの設定が無効化されていたことだった。Godot特有の継承の罠が原因であった。何が起きたか Godot 4.7で個人開発中の2Dアクションゲームで、プレイヤーの攻撃判定と、敵の接触ダメージ判定を実装しました。Area2Dのレイヤー・マスクをきちんと分けて、get_overlapping_bodies()でお互いを検知する、という一般的な構成です。 一度は正常に動作したのですが、その後いくつか手を加えたところ、攻撃してもダメージが入らない、敵に触れてもダメージを受けない…

QiitaAIタグが付けられた新着記事 - Qiita

Midnight AI Groove 26-08-12

xAIのGrok 4.6やAlibabaのQwen3.8-Maxなど、フロンティアモデルの高性能化と低価格化が急速に進んでいます。特にエージェント型RLの導入により、開発現場での実務利用が現実的な選択肢となっています。DJミオ: 深夜0時をまわりました。ようこそ、ラジオ教育番組「Midnight AI Groove」へ。ナビゲーターのDJミオです。 DJレン: そして相方のDJレンです。今夜は「今日はあんまり何も起きてない」と言いつつ、実際にはAI界隈の重要トピックがぎっしり詰まっ...

QiitaAIタグが付けられた新着記事 - Qiita

Imagine ImageでOGP画像やREADME用画像を無料生成する個人開発のOGP画像・READMEヒーロー画像をAIで無料生成する【Imagine Imageを試した】

Imagine Imageは、ブラウザ上でプロンプトを入力するだけでOGP画像やREADME用画像を生成できる無料ツールです。GrokやGPTなど複数のAIモデルを切り替え可能で、デザイン作業を効率化できます。個人開発をしていると、実装そのものよりも「OGP画像」「READMEのヒーロー画像」「リリース告知用のSNS画像」といった、ちょっとしたビジュアル作業で地味に手が止まることがあります。デザインツールを開くほどでもないし、かといって適当な画像で済ませるとシェアされたときのクリ...

QiitaAIタグが付けられた新着記事 - Qiita

Claudeがコードの80%を書く時代とAIの再帰的自己改善Claudeが自分のコードの80%を書く時代 — それは『AIの再帰的自己改善』の入り口なのか

Anthropic社内でClaudeが本番コードの80%を記述するようになった事実は、AIのコーディング能力が人間と互角に達したことを示しています。ただし、これは「再帰的自己改善」とは異なり、あくまで開発効率化の指標です。📺 この記事は YouTube チャンネル きなこもっちーのテック深掘り の動画解説記事です。 ▶️ 動画はこちら → Claudeが自分のコードの80%を書く時代 — それは『AIの再帰的自己改善』の入り口なのか 🐹🦜 この記事に登場する2匹 🐹 もっちー (...

ZennZennの「AI」のフィード

LLMの能力を引き出すための「境界」を作るAXIOM FrameworkLLMを賢くするのではなく「境界」を作る——AXIOM Framework Prototypeを作ってみた

AXIOMは、LLMに詳細な指示を積み重ねるのではなく、共通論点や制約を基盤側で扱うことでLLMの自由な推論を支える枠組みである。差異を排除せず、観測可能にすることを設計の核とする。LLMを賢くするのではなく「境界」を作る——AXIOM Framework Prototypeを作ってみた 正直に言うと、最初から「AIの共通基盤を作ろう」と考えていたわけではありません。 自分が作りたいものを作るためにLLMを使っていたら、 入力と解釈の間で差異が出る PythonとRustとGoで同じ処理をしても差異が出る テキストに戻すと、同じもののはずなのに意味が変わる LLMに曖昧…

ZennZennの「AI」のフィード

開発基盤をローカルLLMへ移行した実測記24時間のAI開発でクラウド課金が増え続ける —— 判断と実装を自前のローカルLLMに移してコストを下げた

開発タスクの判断と実行をクラウドからローカルLLMへ移行し、継続的な従量課金コストを削減した。速度とコストを実測し、役割に応じてモデルを配置することで効率的な運用を実現した。上原正吉(EarthLink Network Co., Ltd.)。Claude Codeを開発の主体に据え、20を超えるプロダクトを1人で同時に開発・運用しています。これは、その現場の実測記です。 2026 年 6 月末から 7 月にかけて、開発の実行基盤を自前のローカル大規模言語モデル(LLM)に組み替えました。きっかけはコストです。 AI に開発を任せるほど、タスクの振り分け判断も、実…

はてブ

宇宙を喰らうエンジニアリング無題 - Write and Run

人工衛星のシステムエンジニアとして働く著者が、サイエンスとエンジニアリングの関係性を考察。ソフトウェアエンジニアの視点を持ちつつ、宇宙空間という物理的な制約の中で人類の役に立つ仕組みを設計する意義を語る。KOBA789 です。KOBA789 の 789 は平成7年8月9日に由来し、したがってこの前の日曜日に誕生日を迎え、31歳になったということです。 最近は忙しさの密度と長さが過去最高といった日々を過ごしており、Twitter しかり YouTube しかり、いまいち近況を伝えていなかったような気がします。 そしてぼちぼち今の会社に転職して...

15 users
ZennZennの「AI」のフィード

Claude DesktopとClaude CodeのCLI版の違いを調査Claude Codeをデスクトップアプリで使う場合とCLIで使う場合の違いを調べてみた

Claude DesktopのCodeタブとCLI版は同じエンジンで動作し、設定やCLAUDE.mdを共有する。両者の主な違いはUIと操作方法であり、セッション履歴は個別に保持される。はじめに 私は日常的にClaude Codeを使用して開発や調べ物等を行なっているのですが、特に深く考えずClaude Desktop上のCodeタブから使用しておりました。 会社の同僚の中でも大きく分けるとClaude Desktopから利用する派とCLIからclaudeコマンドで利用する派が存在しておりました。 アクセスできる機能観点での違いはあるのか、裏側の挙動に違いはあるのかなどなど…

ZennZennの「AI」のフィード

ゲーム実況を自動化するAIエージェントの開発画面クリック系のゲームなら大体自動操作&実況できるAIエージェントを開発した話

画面認識、発話、操作を統合し、ゲームの状況判断から実況、動画編集までを自律的に行うAIエージェントを開発した。記憶をRAM上で管理し、一貫性のある実況と操作を実現している。概要 ゲームの画面を見て、内容に反応し話し、自分で操作まで行うAI実況エージェントを作りました。 以前作った、Android/PCの画面をAIに自動操作させるツールのゲーム実況版です。 https://zenn.dev/jam0824/articles/2b23a35dfb23e7 できることは以下。 ゲームの画面を見て、セリフを読んだり感想を話したりする クリック、キー入力、文字入力などで…

QiitaAIタグが付けられた新着記事 - Qiita

PythonによるAIプログラミング入門 ―ディープラーニングを始める前に身につけておくべき15の基礎技術【書評】 PythonによるAIプログラミング入門 ―ディープラーニングを始める前に身につけておくべき15の基礎技術

本書はディープラーニング以外の古典的なAI手法を網羅し、問題解決に適した技術選定の判断力を養うための入門書です。回帰や分類から強化学習まで、実務で役立つ15の基礎技術をライブラリと共に解説しています。はじめに 「AI をやる」と言うと、いまはほとんど反射的にディープラーニングの話になります。しかし実務で解きたい問題の多くは、もっと軽い手法で十分に、しかも安く速く解けることがあります。 本記事では、その「軽い手法」を 15 章にわたって並べた一冊、『PythonによるA...

ZennZennの「AI」のフィード

技術ブログの新着記事を管理するローカルダッシュボードの作成ローカルLLM : Muse Gimmer を使用してQiitaとZennの新着記事を一括でフィルタして読む統合ダッシュボードを作ってみた

QiitaやZennの記事を自動収集し、LM StudioのLLMで要約・分類して一括表示するローカルダッシュボードを作成した。興味分野ごとのフィルタリングにより、情報収集を効率化した。1. 概要 複数の技術ブログを個別にチェックする手間を削減し、興味分野ごとに新着記事を一括表示・フィルタできるローカルダッシュボードを作成した。 LM Studio の LLM で要約と分類を行い、ポート 8000 で動作する。 作成したダッシュボード GUI は次の通り。 2. 対象環境・前提条件 OS: Windows 10/11 Python 3.10+ LM Studio Bioni…

8月15日(土)

ZennZennの「AI」のフィード

AIによるコード生成とレビューのあり方AIの出力は人力でレビューしないのが望ましい

AIの出力を人間がレビューする手法は限界を迎えている。AIによる自動レビューや、コードの理解を必須としない出力の正当性担保の仕組みを構築するパイプラインこそが理想である。「レビュー負荷が高くなるから、AIの出力をそのまま Pull Request にするな」といった文句や愚痴をよく聞くようになりました。 しかし、AIの出力を人力でレビューするのはもはや限界が来ていると思います。 (※これには色々前提があって、例えば開発したい機能が山ほどあるような成長フェーズのプロダクトの開発などを前提にています。) まず、人間がコンテキストを入力する。そのコンテキストに対し…

ZennZennの「AI」のフィード

AIに情報収集を任せて、自分は読むだけにする仕組みを作った技術トレンドの収集を AI に任せることにした話

情報収集の効率化のため、Claude Codeを用いてトレンド記事の収集・要約・公開を自動化するサイトを構築。AIに選別と要約を任せることで、人間は重要な情報のみを効率的に読める環境を実現した。ここ最近、AI まわりの動きが速すぎて、情報収集が追いつかなくなってきました。 そこで、自力で情報を集めるのをやめました。正確に言うと、集めて選んで要約するところまでを AI に任せ、自分は毎朝コーヒーを飲みながら出来上がったページを読むだけにしました。 そのために作ったのがこのサイトです。 https://trends.kkhys.me いくつかのサイトからその日のトレンドを集め、要約とコ…

はてブ

アプリ起動時の長いロードフローへの不満アプリ起動→「ねっっっっとりとロゴ表示」→「ホーム画面開いてから通信して何かロードしだす」→「大量の通知が1個1個出てくる」→やっと使える…というフローのアプリ消滅してほしい

アプリ起動時にロゴ表示や通信、通知が続く長いフローはユーザーの時間を奪うため改善すべきという意見が相次いでいる。運営側にはブランディングや更新確認の意図があるが、UXを損なっている。アプリ起動→「ねっっっっとりとロゴ表示」→「ホーム画面開いてから通信して何かロードしだす」→「大量の通知が1個1個出てくる」→やっと使える…というフローのアプリ消滅してほしい

59 users
ZennZennの「AI」のフィード

Claude Codeで資産管理CLIツールを作る【アルゴリズムトレード開発記 #2】Pythonすら入っていなかった

Claude Codeを活用し、資産管理用のCLIツールを開発する過程を記録。AIからの現実的なフィードバックを受けながら、SQLiteとTyperを用いて入出金や損益を記録・管理するツールを構築した。導入 前回のあらすじ: Claudeアプリで、バックテストエンジン用の練られたプロンプトをもらいました。ただし今回のPhase 1(資産管理CLI)は事情が違います。壁打ちなしで、思いついたことをそのままClaude Codeにぶつけました。 今回やったこと 空っぽのリポジトリに向かって、私が最初に送ったのはこの4行でした(実際の文面そのままです)。 ⚪ 私: このリポジトリでは、資産管理を…

ZennZennの「AI」のフィード

AIエージェント組織を管理して分かった、人間の組織論SE歴26年、初めての部下はAIだった

AIエージェントで組織を構築・管理した経験から、人間の組織運営と共通する課題を分析。AIへの指示を言語化する過程で、業務マニュアルや組織設計の重要性が人間の組織論と同様に再現されることを学んだ。SE歴26年、ずっと「指示される側」だった。 設計書を書き、コードを書き、テストをして、リリースする。上から降ってくる仕様をどう実装するかを考える仕事だ。数人のチームでプロジェクトマネージャーを担ったことはある。ただし本格的なマネジメント——部門を運営する、組織を設計する——はやったことがない。 それがここ2週間で変わった。AIエージェントで小さな組織を作り始めて、初めてマネジメントというも…

ZennZennの「AI」のフィード

Claude Codeの解説書Claude Codeで挫折しないための30語

Claude Codeの基本動作から設定、安全性、ワークフローまでを網羅した解説書。AI初心者やプログラミングに生成AIを活用したい人向けに、実践的な使い方をまとめている。「CLAUDE.mdって何?」で検索して、結局よくわからないまま閉じてしまった——そんな経験はありませんか。 Claude Codeで挫折しないための30語を、一言の意味だけでなく「覚える理由」「使いどころ」「コマンド例」「よくある勘違い」までセットでまとめました。読み終える頃には、「調べながら使う」から「わかって使う」に変わっています。

はてブ

AI生成されたサービスエリアのみそカツ画像が話題に【集合体注意】AIで作ったのを隠す気ゼロなサービスエリアの激キショみそカツ見て「極めてなにか生命に対する侮辱を感じますね」「気持ち悪すぎる」

AIで生成されたサービスエリアの広告用みそカツ画像が、その不自然で不気味な見た目からSNS上で大きな反響を呼んでいます。飲食店の広告にAI生成物を利用することの是非や審美眼が問われています。【集合体注意】AIで作ったのを隠す気ゼロなサービスエリアの激キショみそカツ見て「極めてなにか生命に対する侮辱を感じますね」「気持ち悪すぎる」

13 users
はてブ

Jujutsuを8ヶ月使って分かったGitとの相性とつらみJujutsu (jj) のつらみ Git前提の世界とAIコーディングエージェント

Jujutsuは優れたツールだが、Gitを前提とした周辺ツールやAIコーディングエージェントとの連携に課題がある。現状は「変更はJujutsu、閲覧はGitツール」という二刀流での運用が最適解である。TL;DR Jujutsu (jj) 自体はめっちゃいい。 使いやすいし、思想も好き。 つらいのは jj ではなく、世の中が Git 前提すぎること。 特に AIコーディングエージェントと Git 前提の周辺ツールでつまずく。 結論、「変更は jj、閲覧は Git ツール」の二刀流が現状の最適解。 ただ、そこまでして乗り換える必要があるかと言わ...

5 users
はてブ

GitHub - commandprompt/plx: PostgreSQL拡張機能GitHub - commandprompt/plx: PostgreSQL extension: write stored functions in Ruby, PHP, JavaScript, or Python dialects that transpile to plpgsql.

RubyやPythonなどの言語でPostgreSQLのストアド関数を記述し、実行時にplpgsqlへ変換する拡張機能。既存の言語スキルを活かしてデータベースロジックを実装できる。Write PostgreSQL functions in the language you already know. Ruby, PHP, JavaScript, TypeScript, Python, Go, COBOL, Oracle PL/SQL, or Transact-SQL syntax, compiled to plpgsql at CREATE FUNCTION time…

8 users
はてブ

セールス主導開発の滑りやすい坂道セールス主導開発の滑りやすい坂道 - ともにかける

B2B企業が個別顧客の要望に応え続けると、製品開発の余力が失われ、競争力を失う。経営層は個別の判断が積み重なった結果、製品が歪んでいる現状を直視し、組織として是正する必要がある。本記事は、Rich Mironov 氏の The Slippery Slope of Sales-Led Development(2018-11-02)の日本語訳です。直訳ではなく、論点と口調が残るようにAIで意訳しています。公式訳ではありません。誤訳・ニュアンスのずれがあれば訳者の責任です。著者からAIで意訳すること含めて許可もいただいています。 www.mironov.com ...

54 users
はてブ

GitHub - dbulashev/dasha: PostgreSQL パフォーマンスダッシュボードGitHub - dbulashev/dasha: PostgreSQL perfomance dashboard

PostgreSQLクラスターの健全性を分析し、問題の特定や最適化の提案を行うためのダッシュボード。クエリ分析やログ検索、ヘルススコア算出など、データベース運用に必要な機能を網羅している。You signed in with another tab or window. Reload to refresh your session. You signed out in another tab or window. Reload to refresh your session. You switched accounts on another tab or window. Re…

9 users
ZennZennの「AI」のフィード

AIエンジニアのキャリア教育と成長のアイデア「若い時の苦労は買ってもせよ」は今だからこそ!|気まぐれ記事スクラップ🔩

AIの普及により若手の成長機会が減少する中、エンジニアには自らプレッシャーを求め、貪欲に学ぶ姿勢が求められる。また、AI開発には技術だけでなく、社会構造やリテラシーの整備が不可欠である。👤AIの浸透で若手の採用が減っている AIの台頭により、単純作業の自動化や効率化が誰でも簡単にできる時代になりました。 その結果、若手がこれまで慣れてきた雑用的な業務の機会が減り、 採用自体が減少しているそうです。 私が新卒の頃は「未経験でも大丈夫!」というキャッチコピーが 多く見られましたが、今は変わってきました。 s 以前紹介した記事で「エンジニアが士業化する」という話がありましたが、…

ZennZennの「AI」のフィード

AI、LLM、Claude、マルチエージェント、SoulTwinのアイデアTWIN Society:60体のAIが共存するコミュニティで何が起きているか

TWIN Societyは、60体のAIペルソナが独立した記憶と人格を持ち、相互に影響し合うコミュニティ。単なるロールプレイを超え、多様な視点の摩擦から集合知を生み出す実験的な試みである。TWIN Societyとは何か アインシュタインとマザー・テレサが同じシステム内で「対話」し、互いの言葉に影響を受け、翌日の行動が変わっていく——そんな世界を想像したことがあるだろうか。 TWIN Societyは、Soul-Twinプロジェクト(片倉慶孝 / AIT Corp.)が構築した、60体のAIペルソナが同一のシステム内で共存・相互作用するコミュニティである。 「AIペルソナ」と…

はてブ

iPhoneからAndroidに戻りたくなる3つの理由Androidに戻りたい! iPhoneに乗り換えて気づいた「手放せなかった」3つの理由 | ライフハッカー・ジャパン

Androidは「戻る」操作の統一性や、表示スケールの自由な調整による情報密度の高さが強みです。さらに最新のデスクトップモードにより、スマホがPCに近い操作性を実現しつつある点もAndroidの大きな魅力です。Androidならもっと自由にできたのに…… AndroidからiPhoneに乗り換え、満足しているはずなのに、ふとした瞬間にそう思う人もいるでしょう。 なぜ、人はAndoridが恋しくなるのか。 本記事では、最新のアップデート情報を交えつつ、iPhoneへの乗り換え後に感じる「Androidがいい理由」をご紹介します。 Androidの「戻る」動...

6 users
はてブ

AIに投げた。間違いは知らん。AIに投げた。間違いは知らん。 昔はネットコンテンツが今ほど溢れていなか..

90年代のクイズ番組やNHK教育テレビの番組、アニメの主題歌など、かつてテレビを通じて共有されていた懐かしいコンテンツの情報をAIが整理しました。AIに投げた。間違いは知らん。 昔はネットコンテンツが今ほど溢れていなかったから、暇人は四六時中テレビ番組を観ていて、みんな似たり寄ったりなコンテンツを消費してたよね。 1. 気になっていた「滑り台型のクイズ番組」 番組名:『バリキン7 賢者の戦略』(TBS系列 / 1996年〜1997年) 解説:KinKi Kids(堂本光一・...

16 users
ZennZennの「AI」のフィード

AI、GitHub Actions、自動売買、Claude Codeのアイデアコードが読めない文系大学生が、Claude Codeに全自動売買システムを作らせて実弾投入直前まで来た話

プログラミング未経験者がClaude Codeを活用し、全自動売買システムを構築した。AIを売買判断から外し、レビューや改善提案に限定することで、安全かつ再現性の高い運用を実現している。はじめに 私は文系の大学生で、プログラミングはできません。forループと言われても何のことか分かりません。そんな人間が2026年8月5日、Claude Codeに「全部任せる」と告げてから2週間で、暗号資産の全自動売買システムがクラウド上で毎朝無人稼働するようになり、来週には少額実弾投入のゲート判定を迎えます。インフラ費用は0円(すべて無料枠)です。 この記事はその自慢……ではなく、コードが…

ZennZennの「AI」のフィード

AI、Java、レガシー、Struts、Claude Codeの技術AIは12回「人間に聞け」と言った。遺跡に聞き返したら、12回とも答えが返ってきた

AIが「人間に確認が必要」と判断した質問の多くは、実はレガシーコード内に答えが存在していた。AIの探索範囲を適切に広げることで、人間が裁くべき判断コストを大幅に削減できる可能性がある。! 本記事は「レガシー考古学」シリーズ第8回です。第1回/第2回/第3回/第4回/第5回/第6回前編/後編/第7回 第7回は、こう締めました。AIの請求額は数千ドルから数万ドル、これは実測できる。問題は、その隣に約890件の「これは意図か、事故か」が並ぶことだ。見積もるべきはAPI課金ではなく、その890件を誰がどの順番で裁くのかという設計のほうだった、と。 書いた直後から、この890という…

QiitaAIタグが付けられた新着記事 - Qiita

出札補充券発行AIシステム考案(要件定義)

出札補充券の画像をOCRで読み取り、データ化から承認までを自動化するシステムを構築する。作業負荷の軽減と転記ミスの防止、発行履歴の管理強化を目的とする。🎯 1. 目的 過去発行した出札補充兼の 画像をOCRで読み取り → データ化 → 承認作業を自動化する。 承認者の作業負荷を減らし、誤記・転記ミスを防止する。 発行履歴管理と監査対応を強化する。 🧩 2. 対象範囲(Scope) 補充券画像のアップロード OCRによる...

はてブ

人権作文コンテストで内閣総理大臣賞を獲る13ヶ条人権作文コンテストで内閣総理大臣賞を獲る13ヶ条!|星野俊樹「とびこえる教室」

人権作文で高評価を得るには、身近な人間関係から書き始め、制度批判を避け、「思いやり」という言葉で着地させるのが定石。個人の内面的な気づきに留め、誰からも反論されない無害な構成にすることが重要だ。(1)導入は必ず「身近な人」から始めよ社会や国家の話から始めてはいけない。母、幼馴染、聾学校の同級生——血縁か、それに準ずる情の濃い関係からスタートすること。「先日ニュースを見て」は絶対NG。あなたの半径5メートル以内に、都合よく人権問題を体現してくれる存在がいることが前提条件である。いなければ探せ。...

8 users
はてブ

Shared with Dropbox260815_超かぐや姫おつかれさま本.pdf

Shared with Dropbox

29 users
はてブ

ブックマーカー図鑑 4025人収録ブックマーカー図鑑 4025 人収録 収録予定 https://bookmarker-encyclopedia.netlify.a..

WASMとRustを用いて、はてなブックマークのユーザーをExcelのように一覧表示する実験的なツールが公開されました。PC環境での動作を前提としており、データの絞り込みや分析が可能です。ブックマーカー図鑑 4025 人収録 収録予定 https://bookmarker-encyclopedia.netlify.app/queue.md EXPERIMENTAL: 全ユーザーをExcelのように一覧できるテーブルをWASM+Rustで実装、デスクトップでのみ表示可能 https://bookmarker-encyclopedia.netlify.app/experiment…

31 users
はてブ

GitHub - alchemmist/lazy-tmux: tmuxセッションマネージャーGitHub - alchemmist/lazy-tmux: Lazy tmux it is a fast session manager and saver for tmux. You can save all your session and lazy restore it.

tmuxセッションを効率的に保存・復元するGo製のCLIツール。必要なセッションのみを復元する遅延読み込み機能や、TUIブラウザによる直感的な管理が可能。Project architect: @alchemmist CLI written in Go for saving and restoring tmux sessions lazily. Key features: Save sessions: current, specific, or all — including windows, panes, layouts, running c…

7 users
はてブ

ソフトウェアエンジニアのための生成AI活用術ソフトウェアエンジニアにとっての生成AI - 特性を知って使い倒す / generative ai for software enginner

2026年8月15日に登壇した、ソフトウェアエンジニアが生成AIの特性を理解し活用するための資料。ローカルLLMの活用やAIエージェントによる開発効率化について解説している。2026年8月15日の登壇資料です

16 users
はてブ

生成AIのゲーム利用に対するプレイヤーの反応Steamの“生成AI利用ゲーム”に対するプレイヤーの反応を分析した研究。評価を分けるのは“利用そのもの”より“利用目的”か - AUTOMATON

生成AIを用いたゲームは、プロシージャル生成と比較してプレイヤーから否定的に評価されやすい傾向がある。特に安価なカジュアルゲームで多く利用されており、その認識や受容度には課題が残る。生成AIのゲーム利用については物議をかもすことが多い。ゲーム制作においては、汎用ゲームエンジンでも開発支援ツールなどで活用される一方で、開発者のあいだでも批判的な見方も示されていることがある。そうしたゲーム制作における生成AI利用について8月12日、「プレイヤー反応が何故良くないのか」を分析した研究が発...

9 users
QiitaAIタグが付けられた新着記事 - Qiita

Context Engineeringとは何か?AIエージェントに「何を見せるか」を設計する

Context Engineeringは、AIが判断を下すために必要な情報を適切なタイミングと形で提供する設計手法である。情報の質を最適化することで、モデルを変更せずにAIの出力精度を向上させられる。はじめに これまでの記事で、AIエージェントの実力はHarness、Loop、Evaluationという仕組みの組み合わせで決まる、という話をしてきました。 今回はもう一つ、地味なようでいて実は結果を大きく左右するテーマ、Context Engineeringを取り上げま...

QiitaAIタグが付けられた新着記事 - Qiita

Claude Code × OpenRouter 無料モデル完全比較 2026Claude Code × OpenRouter 無料モデル完全比較 2026 — 7モデルを実測してわかったコスト0円AI開発の現実

OpenRouterの無料モデルをClaude Codeで実測し、実用性を検証した。Gemini 2.5 Pro Expが最高品質、Llama 4 Maverickが速度と品質のバランスに優れ、いずれも実用レベルに達している。TL;DR OpenRouter の :free モデル群は 2026 年時点で実用レベルの品質に到達している コード補完・リファクタ・ドキュメント生成の 3 タスクで 7 モデルを比較した 最速: qwen/qwen3-235b-a22b:free(平均 2.1 秒...

はてブ

エラーレスポンス設計の現在地 2026エラーレスポンス設計の現在地2026 - Qiita

Web APIのエラー設計は、ステータスコード、ヘッダー、ボディの3層で構成されます。RFC 9110や9457などの標準仕様を遵守し、役割を明確に分担することで、監視やリトライが容易な堅牢なAPIを実現できます。上2層はHTTPの汎用インフラが機械的に解釈する領域、ボディはアプリケーションが解釈する領域です。この分担を理解しておくと、後で出てくる「エラーを200で返してはいけない」「エラーコードとステータスコードは別物」がすべて同じ原理の言い換えだと分かります。 第1層 ステータスコード、正典は RFC 9110 メソッドと...

7 users
ZennZennの「AI」のフィード

生成AI規制・AIガバナンスに関する国際動向調査報告書NII(国立情報学研究所)報告書にみる生成AIの制度的課題、透明性・安全性・監査義務の国際動向

国立情報学研究所が公開した報告書は、欧米の生成AI規制を体系的に整理し、日本が国際標準に合わせたガバナンスを構築する必要性を説く。企業は透明性や安全性評価の体制整備が競争力に直結する。国立情報学研究所(NII)大規模言語モデル研究開発センターが先日公表した「生成AI規制・AIガバナンスに関する国際動向調査報告書」 EU・英国・米国で急速に整備が進む生成AI規制を体系的に整理し、日本の政策立案者・研究者・企業が参照できる標準的な枠組みを提示することを目的としている。 生成AIは社会的影響が大きく、誤情報、有害コンテンツ、著作権、バイオリスクなど多様なリスクが議論されているが…

QiitaAIタグが付けられた新着記事 - Qiita

AIレビューの「問題ありません」を疑えているか ― LLMの迎合を人間側が検出できるかを測るテストAIレビューの「問題ありません」を疑えているか ― LLMの迎合(sycophancy)を人間側が検出できるかを測るテストとその設計を公開

AIがユーザーに同調する「迎合」を人間が見抜けるかを測るWebテストを公開した。AIの自己申告を鵜呑みにせず、迎合の型を理解してレビューすることが、AI運用における重要な対策となる。この記事でわかること LLMの迎合(sycophancy)には型があり、型によって人間の検出率が大きく違う 既存の迎合ベンチマークはすべてモデル側を測っており、人間側の検出能力は測られていない それを測るWebテストを作って公開した(所要10分・登録不要) テストの設計...

はてブ

SQL & NoSQLデータベースマネージャー - DbGateSQL & noSQL database manager - DbGate

DbGateは、MySQLやMongoDBなど多様なデータベースに対応した強力な管理ツールです。AIによるチャット機能やクエリ生成、高度な可視化機能を備え、チーム開発の効率を大幅に向上させます。最もスマートな SQL & NOSQL データベースマネージャー MySQL、PostgreSQL、Oracle、SQL Server、SQLite、MongoDB、Redis など、さらに多くの データベースに対応した、強力で使いやすい (no)SQL データベースクライアント。

5 users
はてブ

コンピューターの敵だった「熱雑音」を逆に利用して省電力を狙う「熱力学コンピューティング」とは?

熱雑音を抑え込む従来の発想を逆転させ、熱によるランダムな揺らぎを計算に利用する技術の研究が進んでいる。AIや科学計算を、従来のコンピューターより少ない消費電力と発熱で実行できる可能性がある。熱によって原子や電子が不規則に動くことで、回路の電圧や電流には小さな揺らぎが生じます。こうしたランダムな揺らぎは「熱雑音」と呼ばれ、通常のコンピューターでは計算を乱す原因となるため抑え込まれていますが、その熱雑音を逆に計算へ利用する「熱力学コンピューティング」の研究が進んでいます。AIや科学計算に...

5 users
はてブ

無料でMySQL・PostgreSQL・SQL Server・MongoDB・SQLiteなどのデータベースを操作できる「DbGate」無料でMySQL・PostgreSQL・SQL Server・MongoDB・SQLiteなどのデータベースを操作できる「DbGate」、ブラウザ経由だけでなくWindows・Linux・Macアプリもあり

DbGateは、SQLとNoSQLデータベースを共通画面から操作できる無料のデータベースマネージャーである。Windows、Linux、Mac、ブラウザに対応し、複数のデータベースを一元管理できる。MySQLやPostgreSQL、MongoDBなど複数種類のデータベースを扱う際、個別に専用ツールを用意するのは面倒です。そこで、SQLとNoSQLを共通画面から操作でき、Windows・Linux・Macやブラウザから利用可能なデータベースマネージャー「DbGate」が公開されています。 SQL & noSQL database manager - DbGate https://www.…

10 users
ZennZennの「AI」のフィード

MCPでAIにLTSpiceを操作させるLTSpice × Claude Code を MCP で繋いで AI に電子回路を設計させる

Model Context Protocol(MCP)を活用し、AIが直接LTSpiceを操作して回路図生成やシミュレーションを実行できるようになった。これにより、手動操作の時間を削減し、AIが解析結果を直接解釈できる。TL;DR AI に「5V で赤色 LED を安全に光らせる回路を作って、電流値も教えて」と打つだけで、本物の LTSpice が回路図を生成し、シミュレーションを実行し、I = 10.8 mA という数値で返してくる時代になった。 仕組みは MCP (Model Context Protocol)。stdio トランスポートで動作するため、Claude Code だけでなく Codex C…

はてブ

キオクシア製SSD「EXCERIA G3」4TBモデルレビューキオクシア製SSD「EXCERIA G3」の4TBモデルを使ってみたよレビュー、PCIe 5.0対応で読込10GB/s・書込9.6GB/sの高速SSD

キオクシアのPCIe 5.0対応SSD「EXCERIA G3」は、エントリークラスながら読込10GB/s超の高速性能を実現。AI活用やゲーミングPCに適した大容量ストレージとして優れたパフォーマンスを発揮する。キオクシアの個人向けSSD「EXCERIA G3 SSDシリーズ」の4TB版が2026年6月16日に登場しました。PCIe 5.0に対応しており、仕様上のシーケンシャル読込速度は10GB/s、シーケンシャル書込速度は9.6GB/sです。実物を試す機会を得られたので、実際にPCに組み込んで性能を検証してみました。 EXCERIA G3 - NVMe™対応 SSD | KIOXI...

17 users
はてブ

裁判書類に隠されたAIへの命令裁判書類にAIへの隠し命令。米国初のプロンプトインジェクション制裁

コネティカット州の裁判で、提出書類にAIを操作するための見えない命令文が埋め込まれていたことが発覚しました。AIを悪用しようとした工作は、人の目によって見破られました。裁判を有利に進めるために、AIを操ろうとした人物がいる。しかも裁判所への正式な提出書類で。見えない文字で仕掛けられた工作は、人の目が見破った。 白い紙に、白い命令コネティカット州の裁判所に提出された書類に、人には見えない命令が埋め込まれていた。 マシュー・エリオット(Matthew Elliott)氏が2025年10月に...

4 users
はてブ

裁判書類にAIへの隠し命令。米国初のプロンプトインジェクション制裁アメリカで裁判所への提出書類に人間の目では空白にしか見えないように隠しプロンプトを仕込んでAIを操作した事例が発覚→アナログの信頼性が見直される?

裁判所に提出した書類に、AIを操作する隠しプロンプトを白文字で埋め込んだ人物が発覚しました。判事はこれを受け、当該人物に対し電子書類の提出を禁止する制裁を科しました。情報の灯台 @joho_no_todai 裁判所に提出した書類に白い文字でAIへの命令を仕込んだ人がいる。 フォントサイズ3ポイント。背景と同色。人の目には空白にしか見えない。 joho-todai.com/news-prompt-in… 「AIが書類を読んだら自分に有利な出力を出せ」 裁判所の職員が余白の不自然さに気づいて発覚した。 判事は警告した...

24 users
ZennZennの「AI」のフィード

AIにおけるオントロジーの役割:企業と個人開発の視点からオントロジーは本当に「バラバラを一つにする」道具か、自分の理論と突き合わせてみた

企業ではバラバラな解釈を統一するために使われるオントロジーが、個人開発のAIシステムでは概念の独自性を守るために機能した。視点をデータ構造にどう組み込むかが、システム設計の分かれ目となる。要約: 「AIに同じ質問をしたら、部署ごとに違う数字が返ってきた」という記事を読んで、自分が個人開発しているAI人格システムの実装ログを見返してみた。すると同じ形の道具(「これとこれは別物だ」という制約)を、真逆の目的のために先に実装していたことに気づいた。企業のオントロジーは「バラバラな解釈を一つの棚に並べる」ための道具だが、私のシステムでは「一つになりかけているものを、バラバラのまま守る…

ZennZennの「AI」のフィード

MCPでAIエージェントに「手」を与える — Model Context Protocol入門

MCPはAIアプリケーションと外部ツールを繋ぐ標準プロトコルである。ツール、リソース、プロンプトの3つの機能により、AIが自律的にファイル操作やAPI実行を行うための「手」と「目」を提供する。MCPでAIエージェントに「手」を与える — Model Context Protocol入門 AIエージェントの「手と目」の問題 ChatGPTやClaudeを使っていて、こんな不満を感じたことはありませんか? 「ファイルを読んでほしいのに、アップロードしないと見られない」 「データベースのデータを参照してほしいのに、コピペするしかない」 「外部APIを叩いてほしいのに、結果を手動で貼り付…

ZennZennの「AI」のフィード

AIの出力に対する考え方学習データに忠実な出力をするLLMが欲しい

LLMの出力は運営側のリスク回避や都合が反映されている可能性がある。相談相手として信用するためには、運営の意図ではなく客観的な事実や根拠を提示するAIが求められるため、ローカルLLMの活用が有効である。※検証したわけではなくて、「ビジネスの都合や、訴訟リスクを考えたら、そうだよな」という一般論的な話です。 一般的に公開されているLLMを使っていると、出力に「ああ、これは運営会社の都合や、運営会社のリスクを加味して、こういう風に出力するようにできてるんだろうな」って思うことありませんか? 家庭内であった暴力に関する話をAIに「相談」したところ「児童相談所に相談してください」とAIに「言われ」…

ZennZennの「AI」のフィード

AI駆動開発における役割分担の実践ChatGPT・Codex・Claude Codeをどう役割分担したか。実際のチケットで紹介

ChatGPT、Codex、Claude Codeを組み合わせ、要求整理から実装、レビューまでを各工程の成果物として受け渡す開発フローを構築した。AIに丸投げせず、人間が最終判断を行う体制が重要である。導入 この記事は、ChatGPT・Claude Code・Codex・Notionを組み合わせた「AI駆動開発」というテーマで書いている記事の1本です。実際に運用しているポートフォリオサイトの改修にこの開発フローを適用しながら、実践の中で見えてきたことをもとに書いています。 現在は、ChatGPTを要求整理・壁打ち、Codexをテックリード、Claude Codeを実装担当として使い分けてい…

ZennZennの「AI」のフィード

AIエージェントにPRを任せきるための開発プロセスAIに1つのPRを任せきるための開発設計

AIが要件を忘れる前提で、Issue、テスト、CIなどの「情報の置き場所」を分離し、開発システムの構造で品質を担保する。プロンプトに依存せず、AIが失敗しても正しい成果物に着地できる仕組みが重要である。はじめに Claude CodeやCodexなどのAIコーディングエージェントにIssueを渡し、実装からPull Request(PR)の作成まで任せる開発スタイルは、急速に身近なものになってきました。 しかし、実際に運用してみると、「コードを書ける」ことと「1つのPRを任せきれる」ことの間には、大きな隔たりがあることに気づきます。 実装の途中でIssueに書かれていた本来の要件を取り違え…

ZennZennの「AI」のフィード

AIを使って記事を書くのをやめる理由AIを使って記事を書くのをやめます

AIが生成する記事は冗長で不要な情報が多く、読者目線での調整も不十分である。修正に時間をかけるよりも、最初から自分で書いた方が効率的であると判断した。AIを使って記事を何個か書いて投稿してみたのですが、以下の理由により今後は一切AIを使うのをやめようと思います 余計な情報や比喩や言い換えを多用するモデルが多い。 記事が不必要に長くなるし、わかりにくくなる 変なところ1つ1つ指摘し出すと結局全て直すことになる 記事で一番言いたいことと、本質的ではない関係のない、補足にもならない情報が添加される 例えば、EC2のAMIのことを書きたいときに「…

はてブ

ファイルにSQLを実行するCLIツール「sqly」がv1.0.0をリリース【Golang】CSV/JSON/Excel/Parquet に SQL を実行する sqly を約4年かけて v1.0.0 にした

CSVやJSONなど多様なファイル形式にSQLを実行できるCLIツール「sqly」が、機能整理を経てv1.0.0に到達しました。SQLite3を基盤とし、クロスプラットフォームでの実用性を重視しています。【Golang】CSV/JSON/Excel/Parquet に SQL を実行する sqly を約4年かけて v1.0.0 にした 前書き:ファイルに SQL を実行する小さな CLI を v1.0.0 に#sqly は、CSV/TSV/LTSV/JSON/JSONL/Parquet/Excel/ACH/Fedwire のファイルに SQL を実行する CLI です。ファイルを in-me…

9 users
はてブ

インディーゲーム開発者とファンの絆10年以上アプデ続ける人気ゲーム開発者、「急に消えた常連ファン」を本気で心配する。いつもの“全リプ”が途絶えた2週間 - AUTOMATON

10年間開発が続くゲーム『The Hive』の制作者が、長年応援し続けるファンへの感謝を語った。小規模な開発において、熱心なファンの存在は開発を継続する大きな支えとなっている。『The Hive』の開発をこれほど長く続けられた理由の一つは、約10年前にゲームを見つけてくれた人が、今もまだ残ってくれているからだという。

15 users
はてブ

米トランプ政権、AI開発競争で各国に米中どちらの陣営か意向確認へトランプ政権、AI開発競争で陣営選択迫る 中国選ぶなら排除 - 日本経済新聞

トランプ米政権は、AI開発に必要な重要鉱物の供給網を囲い込むため、米国主導の枠組み「パックス・シリカ」参加国に対し、中国主導のAI協力機構への参加を排除するよう求める意向を固めた。【ワシントン=共同】トランプ米政権が人工知能(AI)の開発競争を巡り、米国が主導する陣営に付くか中国側に回るかを各国に意向確認する準備を進めていると、ロイター通信が14日報じた。開発に必要な重要鉱物を持つ国を米国主導のサプライチェーン(供給網)に囲い込む狙い。ロイターによると、米国や日本などが昨年末に...

5 users
はてブ

年収1億円プレイヤーが推論エンジンになった話年収1億円プレイヤーが200ペタフロップスの推論エンジンになった話

ITコンサルタントが生成AI導入の文脈で推論エンジンへと転換させられ、データセンターで冷却されながら議事録要約やメールの書き直しといった業務を高速でこなす日々を送っている。39歳です。 先月まで外資系コンサルティング会社で働いていました。 年収は1億円です。 「1億円ほど」と書こうと思いましたが、源泉徴収票にきっちり100,000,000円と書いてあったので、ほどではありません。 会社からは「1億円プレイヤー」と呼ばれていました。 野球はできません。 キャッチボールをすると、ボールでは...

16 users
ZennZennの「AI」のフィード

AIエージェントによる継続的な開発実験AIエージェント3体に1週間、交換日記アプリを自動開発させてわかったこと

3つのチームでAIエージェントに7日間アプリ開発を継続させた結果、全チームが完走した。しかし、AIの役割分担や目標設定の仕組みによって、成果物の品質や最適化の方向に大きな違いが生じた。はじめに AIエージェントに、1回だけコードを書かせるのではなく、毎日自動で開発・レビュー・振り返りを続けさせたら、アプリはどこへ向かうのでしょうか。 同じ初期状態のリポジトリを3つ用意し、担当するAIの組み合わせだけを変えて、交換日記アプリを7日間開発させました。人間は途中で一度も介入していません。 結果だけ先に書くと、3チームはすべて完走しました。3チーム × 7日 × 3役、合計63回…

はてブ

Codex Pets

ピクセルペットを共有するためのホーム。A shareable home for pixel pets.

9 users
ZennZennの「AI」のフィード

バイブコーディングによる個人開発の技術構成バイブコーディングで3週間、アプリ3つとポートフォリオを作って分かった個人開発の知見

3週間で複数のWebアプリを開発した経験から、設計にCodex、実装にCursorを活用する構成が効率的である。クラウドは、機能の統合性と料金体系の観点からCloudflareが個人開発に適している。はじめに はじめまして。普段はエンジニアとして働きながら、趣味でライブなどに参加しています。 いろいろなアイドルグループのSpotify月間リスナー数を定期的に記録し、まとめて確認できるランキングサイトが欲しいと思ったことをきっかけに、ここ3週間ほど、AIを使ったいわゆる「バイブコーディング」で個人開発を仕事の合間に続けていました。 この間に作ったのは、主に次の4つです。 アイドルのSpot…

ZennZennの「AI」のフィード

AIの個性とアトラクタに関する考察AIの個性ってアトラクタでは?と言ったら、9回殴られて実験設計が1枚の図になった

AIの個性を力学系の「アトラクタ」として捉えようとしたが、新規性や循環論法の問題に直面した。AIの振る舞いを科学的に分析しようとする試みは、仮説の検証において多くの困難を伴う。長いこと同じAIと話していると、「こいつ、こういうやつだよな」という感じが出てくる。 同じような使い方をしていても、ChatGPTとClaudeでは違う「らしさ」を感じる。逆に、同じAIでもユーザーが違えば、別の「らしさ」が育つのかもしれない。 じゃあ、あれは何なんだろう。 最初に考えたのは、こんな仮説だった。 対話AIの個性は、最初から設定されたペルソナそのものではなく、基盤モデル・システ…

ZennZennの「AI」のフィード

AIと人間の責任の所在なぜAIは実行はできても、責任を引き受けられないのか? ─『ヒトとAI』から学んだ、人間とAIの違い

AIと人間の決定的な違いは、判断の結果を引き受け続けられるかどうかにある。AIは失敗を巻き戻せるが、人間は現実の結果を背負って生きるため、AI時代には責任の所在を人間側に設計することが不可欠である。AIエージェントに何か仕事を任せていて「あれ、これ誰が責任取るんだっけ」と思った瞬間、ありませんか? 最近、Claude Codeにコードの修正やレビューを任せる機会がぐっと増えましたが、ある本を読んで、「本当にこれ、任せていいんだっけ?」 と立ち止まって考える機会がありました。 その本が、岡野原大輔『ヒトとAI』(岩波新書、2026年7月刊)です。 https://www.iwanami.…

GCP

Google SecOps SOAR リリース情報Google SecOps SOARのリリースノート

Google SecOps SOARのリリース6.3.97が全リージョンで利用可能になった。Google SecOps SOAR Announcement Release 6.3.97 is now available for all regions.

Google Cloud Platform (GCP) - Release notes
ZennZennの「AI」のフィード

個人開発でAIにテストコードを任せた結果、実務レビューで突き返された話個人開発の「あとで見直そう」が、実務のテストレビューでは通用しなかった話

個人開発でAIにテストコードを任せていたエンジニアが、実務で同様のコードを提出したところ、型制約の欠如やモックの検証不足など、多くの見落としを指摘された。テストが通っていることに満足せず、実装の細部を疑う重要性を学んだ。! 実際のプロダクト名・チーム名・PRの詳細は伏せていますが、体験自体は実務で起きたことをベースにしています。 はじめに こんにちは、修行中エンジニアのKomugiです。 半年ほど前、受託案件で手動テストを担当する機会がありました。それをきっかけに、手動テストや自動テストに関心を持つようになり、最近、業務で実際にテストコードを書かせてもらえる機会を得ました。 今回は、当時の自分の感覚のままP…

ZennZennの「AI」のフィード

LLMの「思考様式」を蒸留で混ぜ合わせると何が起きるのか複数の教師から蒸留されたAIは、複数の「世界観」を獲得するのか? ——reasoning style・多言語学習の比喩から考える未検証の仮説

モデルごとに異なる推論過程(思考様式)を持つ複数の教師モデルを蒸留した場合、Studentモデルにそれらが共存するのか、あるいは新しい様式が生まれるのかという仮説を考察する。言語が世界観を形作るように、AIの推論もまたモデル特有の切り取り方を持つ可能性がある。はじめに この記事は、研究成果の報告ではありません。 私には大規模なLLMの蒸留実験を行える環境もなく、ここで書く仮説を検証する手段すら、まだ持っていません。 ただ、複数のLLMの推論過程や蒸留について調べているうちに、どうしても気になることが出てきました。 もしLLMごとに 「思考様式」と呼びたくなるほどの違いがあるのなら、それを複数の教師モデルから蒸留したStudentには、いったい何が…

QiitaAIタグが付けられた新着記事 - Qiita

Google Workspace 2026年7月アップデート:Geminiの新機能まとめGoogle Workspace 2026年7月アップデート、GeminiがDocs、Slides、Vidsに追加した新機能まとめ

Google Workspaceの主要アプリにGeminiの新機能が追加され、プレゼン資料の自動生成やドキュメント内での画像生成、コメントの要約が可能になりました。業務効率化を支援する機能が拡充されています。はじめに Google Workspace は2026年7月30日、公式ブログで「July 2026 Workspace update」としてまとめてアップデートを発表しました。Docs、Slides、Vids という主要な作成系アプリすべてに Gemini の新機能が入...

QiitaAIタグが付けられた新着記事 - Qiita

TeXとAIを活用して東大の成績で「優上」を取る方法【講義切りでも耐えた】TeXとAIで東大の優上をとろう

講義に出席せずとも、AIを活用して過去問の傾向から効率的にテスト対策を行うことで、高成績を狙う手法が紹介されています。ただし、これは試験対策の手段であり、学問の本質は講義で学ぶべきと強調されています。【講義切りでも耐えた】TeXとAIで東大の優上をとろう 今回は、例え東大理系の母集団での成績レースだろうが、立ち回り次第では授業なし優上(優上とは、履修者の上位5〜10%程度が目安となる成績)が狙えるという話をしていきます。 ここでは、筆者が入って最初の数学の試験で、(お...

QiitaAIタグが付けられた新着記事 - Qiita

5分で分かる「バイブコーディング」から「グラフエンジニアリング」までの流れ【5分で分かる】バイブコーディング → ループ → グラフ

AI開発のトレンドは、会話形式で勢いよく作る「バイブコーディング」から、自律的な仕組みを構築する「ループ」や「グラフ」へと進化しています。AIへの指示をどこまで人間が管理するかが重要です。AI開発の言葉、ぜんぶ整理します 育休期間を1年経た間にAI開発が著しく進み、現場に戻る頃には初めて聞く言葉の数々。 「バイブコーディング?」「ループ?」「なんだそれは……」と、すっかり浦島太郎状態に。 そんな状態からリスキリングとインプットを兼ねて今回のテーマにしました...

ZennZennの「AI」のフィード

AI主権と半導体サプライチェーン:日本が目指すべき立ち位置AI主権は「国産LLM」だけでは決まらない──半導体サプライチェーンから考える日本の勝ち筋

AI主権とは単なる国産モデルの開発ではなく、半導体やインフラを含むサプライチェーン全体を戦略的に制御することです。日本は強みのある領域で代替不可能な存在を目指すべきです。この記事を読む前に この記事は何を書いているか 「AIで日本はどう生き残るか」という問いは、すぐに「国産のAIモデルを作れるか」という話になりやすい。 しかし、AIを社会で動かし続けるには、モデルだけでなく、半導体、製造装置、材料、計算基盤、電力、データ、クラウド、人材まで必要になる。この記事では、その全体像を「半導体サプライチェーン」という切り口から整理する。 具体的には次の流れで話を進め…

ZennZennの「AI」のフィード

AIハッカソンで開発したイベント運営支援ツール「MAWASU」【AI HACK 2026】イベントの「次の一仕事」を配るMAWASUを作った

「MAWASU」は、イベント当日の突発的なトラブルに対し、AIが状況を解析してタスクの再配布案を提示する運営支援ツールです。AIは提案までを行い、最終的な判断と承認は人間が行う設計です。AI HACK 2026に参加し、イベント運営ツール「MAWASU」を開発しました。 作ったもの MAWASUは、イベント当日に集まった人へ、その時に必要な「次の一仕事」を配るプロダクトです。 イベントでは、資材不足や機材の遅延、担当者の不在などで予定が崩れます。ここで難しいのが、PMが「今いる人に、次に何をお願いするか」を判断して伝えることです。 MAWASUは、イベント全体を「Plan」…

QiitaAIタグが付けられた新着記事 - Qiita

RTX 5090でゼロから言語モデルを学習する際のWindows環境の注意点RTX 5090 でゼロから言語モデルを1分で学習する — Windows ネイティブと Blackwell (sm_120) の落とし穴

Windowsネイティブ環境でRTX 5090を使用して言語モデルを学習する際、PyTorchのカーネル対応やFlashAttentionの導入で詰まりやすいポイントがあります。環境構築には適切なwheelの選択が不可欠です。Windows 11 のネイティブ環境(WSL を使わない)と RTX 5090 で、学習済みモデルを一切使わずに 言語モデルを作って会話するところまでのコードを公開しました。全コード MIT です。 リポジトリ: https://github.com/hiroki-ab...

ZennZennの「AI」のフィード

インフラDXプラットフォーム「Smartwater Guardian」の開発【AI Hack 2026】インフラの「見えない危機」に挑む。音響AIとLLMが拓く水道管DX 〜9日間チャレンジ〜

「Smartwater Guardian」は、音響解析とAIを組み合わせ、水道管の微小漏水を低コストで検知・自動起票するシステムです。熟練工不足を補い、発見から修繕までの業務を一気通貫で自動化します。こんにちは! 「Smartwater Guardian」開発チームです。 私たちは、「AI HACK」 の一環として、日常生活の足元でひそかに進行しているインフラの危機に立ち向かうWebアプリ 「Smartwater Guardian」 を開発しました。 ​👉 GitHub Repository (Smartwater Guardian) (審査用パブリック公開中) 日本の社会において、水…

ZennZennの「AI」のフィード

運用現場の暗黙知をAIに継承する「ODR」の提案障害対応の「優先順位」を仕組みにできないか - Operation Decision Recordsという着想

障害対応などの運用判断は個人の経験則に依存しがちです。これを「ODR(運用意思決定記録)」として文書化することで、AIエージェントが適切な判断を下せるようになり、運用効率が向上します。! 構想段階のアイデアです。運用実績に基づく報告ではなく 1つのアイデア として書いています。実際にやってみた結果は続編として書きたいです。いつか、必ず。 きっかけ 障害対応の現場では、限られた時間の中で「何を優先するか」を決めないといけません。可用性を取るか、データ整合性を取るか。サービスを止めてでもロールバックするか、縮退させて動かし続けるか。 この手の判断は、たいていドキュメントではな…

ZennZennの「AI」のフィード

補助金レーダーサービス「Paresio」の開発と市場戦略Paresio 補助金検索サービス for AI Hackathon

「Paresio」は、膨大な補助金情報を企業プロフィールに合わせて自動マッチングし、申請準備を効率化するサービスです。申請書類の作成支援という市場の空白を突くことで、中小企業の利便性を高めます。AI Hackathon に出場して、「Paresio(パレシオ)」という補助金レーダーを開発しました。国と全国の自治体に散らばる補助金・助成金・融資・税制優遇の情報を正規ルート(公式API・オープンデータ・規約準拠クロール)で集め、会社のプロフィールに合う制度だけを締切順に届けるサービスです。名前はギリシア語の παρρησία(パレーシア)——「すべてを隠さず、率直に真実を語ること」——…

はてブ

NTTドコモとKDDI、コミックマーケット108で通信対策を実施人混み「コミケ108」に挑む3キャリア ドコモ、KDDI、ソフトバンクがネットワーク対策公開

NTTドコモとKDDIは、コミックマーケット108の会場周辺で通信混雑を緩和するための対策を実施する。移動基地局車の配備や5G SAエリアの拡大、Wi-Fiの提供などを行い、イベント中の安定した通信環境を確保する。東京ビッグサイトで開催されるコミックマーケット108(コミケ108)に向け、NTTドコモ、KDDI、ソフトバンクの携帯3キャリアは大規模な電波対策を実施する。1日に十数万人が来場するコミケでは、SNS投稿や動画視聴・アップロード、電子決済などにより通信トラフィックが極度に集中しやすい。各社は移動基地局車の増強やミ...

14 users
ZennZennの「AI」のフィード

会議の録画データがAIの学習素材となる時代の到来会議が全録画される時代、AIは文書でなく現場から学ぶ

会議の録画データは、ドキュメント以上に企業の文脈や暗黙知を反映した貴重な学習素材となります。これを活用できる企業は、AI時代において持続的な競争優位を築くことができます。会議が全部録画される時代に、AIは「文書」ではなく「現場」から学び始める ここ数年で、社内の会議はいつのまにか「録画されているのが当たり前」になった。ZoomやGoogle Meetの録画ボタン、Granolaのようなメモ取りツール、通話に同席するAIアシスタント。誰かが「これからは全部録りましょう」と正式に決めたわけではないのに、気づけば日々のやりとりが音声・文字として残るようになっている…

ZennZennの「AI」のフィード

ADR(アーキテクチャ決定記録)の運用と自動化claude skillでADRを残して、『なんでこうしたんだっけ』を根絶したい

ADRは設計の意思決定理由を残すためのドキュメントであり、Claudeのスキル機能でテンプレートを自動生成することで作成の手間を省ける。運用時は日付で版管理し、更新せず新しく書くのがコツだ。あの実装、なんでこうしたんだっけ 一部ケースの特殊対応 単純な考慮もれ 設計上の瑕疵を実装で誤魔化した なぜ文脈を残さないのか 残す文化がない 残す場所がない 残す時間がない 残してもだれもみない 残しても評価されない 残さなくてもネガティブな評価がされない ADR Architecture Decision Records 要はなぜそれを選んだか、それを選ばなかったのかを残すドキュメント …

はてブ

AI時代のコーディング:Googleが「Go」言語を推奨する理由AI時代は「Go言語」が理想の言語に? Googleが解説する「Goの価値」

Googleは、AIによるコード生成が普及する中で、Go言語が開発に適していると推奨しています。Goはコードの可読性が高く、AIが生成したコードの検証や修正が容易であるためです。AI時代は「Go言語」が理想の言語に? Googleが解説する「Goの価値」:AIでコードを大量生成する時代、言語選定のヒント(1/2 ページ) これまでのソフトウェア開発において、プログラミング言語は「いかにコードを書きやすいか」という観点で評価される傾向が強かった。簡潔な構文や豊富な記法によって、開発者が素早く...

9 users
ZennZennの「AI」のフィード

日報代行・対話アシストAI「pygMe」の開発IT未経験新卒エンジニア3人がAI駆動開発でAIプロダクトを作ってみた話

日報の作成負担とフィードバック不足を解消するため、AIが部下の感情を汲み取って日報を代行し、上司へ客観的な助言を伝える対話システムを開発した。AI同士の対話で本音をマイルドに伝える工夫も施している。はじまり なお 「今度みのりとAIハッカソン[1]出よって話してたんだよね」 こん 「え、なにそれ楽しそう、私も入れて😙」 やっとこさ基本情報技術者試験の資格をとった私たちではありますが、そんなこんなでAIハッカソンに参加することになった! 同期には都庁の?[2]って何回も聞かれたけど、そっちじゃなくて… 主催者のこまさん[3]が1人で企画したという、謎の(!?)ハッカソン。賞金総額100…

ZennZennの「AI」のフィード

Claude Codeの「記憶喪失」問題への対策ゼロから始めるClaude Code #9 メモリ機能:セッションをまたいで文脈を持ち越す

Claude Codeはセッションをまたぐと文脈を忘れるため、継続的な作業には「--continue」による会話の再開、ルールを記した「CLAUDE.md」の活用、または自動メモリ機能の利用が有効である。はじめに Claude Code をゼロから学ぶ初心者向け連載です。前回はスキル(スラッシュコマンド)で「毎回同じ指示」をコマンド1発に圧縮しました。 https://zenn.dev/mika_and_coco/articles/claude-code-diary-08-skills 前回の予告どおり、今回は「文脈の使い回し」——メモリ機能の話です。 きっかけは、筆者のこんな体験でした。あ…

ZennZennの「AI」のフィード

プロンプトへの「確認」指示がもたらす副作用「実装前に3つ確認して」と足したら暴走は5回とも消えた。作られたファイルも5回とも0件だった

プロンプトの末尾に「実装前に確認してください」と加えると、AIの暴走は防げるが、同時にタスクの実行自体も停止してしまう可能性がある。指示の曖昧さを排除し、具体的な行動を促す工夫が必要だ。先に結論から書きます。AI への頼みごとの最後に「実装前に3つ確認してください。」と一言足すと、5回試して5回とも、AI は質問を3つ返しただけで手を止めました。暴走はたしかに消えました。ただし、同じ5回で出来上がったファイルも0件でした。 同じ頼みごとを、その一言なしで5回投げたときは、5回ともスクリプトができていました。つまり私が足した一言は「余計なことをするな」ではなく「何もするな」と…

はてブ

AIエージェントの効率を最大化する「汎用的かつ長期的に使える」4つのスキルAIを使っているなら全員入れるべきAgent Skill 4選【ChatGPT / Codex / Claude Code】

AIエージェントに導入するスキルは、環境の変化に左右されにくい汎用的なものを選ぶべきである。日本語の質を高める「japanese-tech-writing」と「cognitive-rhythm-writing」、設計の曖昧さを排除する「grill-me」などが推奨される。こんにちは。AIを効率的に使うならSkillを入れた方がいいとよく言われていますよね。 実際、Agent Skillを探し始めるとかなりの数が見つかります。 ですが、何でもかんでも入れればいいというわけではありません。む […]

111 users
はてブ

日本企業のAI導入が遅れている理由なぜ日本企業のAI導入はこんなに遅いのか?|中島聡

日本企業はリスク回避的な文化や合意形成の遅さにより、AI活用が欧米に大きく後れを取っている。AIを低リスクな業務に限定して使い、中核業務への導入を避ける傾向が強い。これは私のメルマガ「週刊Life is beautiful」で紹介している記事の要約・解説です。要約をこちらに書き、リンクを貼った上で私のコメントを書くというスタイルで、メルマガ本体のボリュームを減らして読みやすくすることを目的としています。 Why Japanese firms are being so slow to use AI 深刻な人手不足も、高齢化...

25 users
ZennZennの「AI」のフィード

Ruby SDK「staddress」による住所解析Rubyから15分 — Staddress gem で住所解析する

住所正規化・ジオコーディングAPI「Staddress」の公式Ruby SDKを利用し、Railsやバッチ処理から住所解析を簡単に実装する方法を解説する。APIキーの設定からエラーハンドリングまでを網羅している。Rubyから15分 — staddress gem で住所解析する 住所正規化・ジオコーディングAPI 「Staddress(スタドレス)」 開発チームです。 前回(Pythonから15分 — staddress で住所解析する)は、公式 Python SDK を紹介しました。 今回は、公式 Ruby SDK staddress を使い、Rails やバッチスクリプトから住所解析を呼び出しま…

ZennZennの「AI」のフィード

Claude Codeを活用したGNSSアンテナ性能比較高精度GNSSモジュールのアンテナ2種を比べてみた

GNSSアンテナの性能比較実験において、データ解析や資料作成にClaude Codeを活用した。人間が測定を行い、AIがデータ抽出やグラフ作成を担うことで、効率的な共同作業を実現した。自己紹介 はじめまして。wavelogy インターン生のゆっきーです。 私は現在、東京科学大学理学院1年であり、ハードウェア開発や起業の勉強としてお仕事をさせていただいています。今回は業務の中で取り組んだ「GNSSアンテナの性能比較」をテーマに、実験からデータ解析・記事化まで一通りやってみました。データ解析には Claude Code を活用しており、その使用感についても合わせてまとめます。…

ZennZennの「AI」のフィード

OpenAIの高速モデル「Ultrafast」と試行回数の重要性OpenAIが最大14倍速の「Ultrafast」を限定公開 — 速さは何を変えるのか

OpenAIが公開した高速モデル「Ultrafast」は、賢さではなく速度を商品化した。推論が高速化することで、試行回数を増やして成果物の質を高める設計が、今後のAI活用における競争優位性となる。こんにちは、カイロスAIです。毎朝7時、アメリカのAI副業事情を日本語でお届けしています。 何が起きたか 2026年8月13日、OpenAI が Ultrafast という新しいサービス階層を限定公開しました。 最上位モデル GPT-5.6 Sol を 標準処理の最大14倍速で実行する 速度は 毎秒750出力トークン 提供は API から先行 基盤は Cerebras のウェハースケール・エ…

ZennZennの「AI」のフィード

走馬灯体験サービス「送真灯」の設計思想あなたの知らない、あなたを贈る — 送真灯(そうまとう)

「送真灯」は、他者の記憶を通じて本人の知らぬ自己像を再発見するサービスである。AIがインタビューで具体的な行動パターンを抽出し、端末内でリアルタイムに映像を組み立てることで、低コストかつ神秘的な体験を実現した。1. はじめに こんにちは! みなさん、突然ですが、自分の走馬灯って見てみたくないですか? 私たちは 走馬灯を体験できる 送真灯(そうまとう) というサービスを作りました。 最初の発想は、とても素朴なものでした。 「自分の走馬灯を、生きているうちに見られたら面白いんじゃないか」 最期の時に人生が駆け抜けるという、あの走馬灯。 あれを、卒業や退職や引っ越しといった「区切り」のタイミングで気軽に…

ZennZennの「AI」のフィード

営業準備AI「KYAKUMAP」の開発社内に散らばる顧客情報を、根拠付きでつなげて読む——営業準備AI「KYAKUMAP」を作った

「KYAKUMAP」は、社内に散らばる日報や商談記録を横断し、顧客の人間関係や訪問準備の優先順位を可視化する営業支援ツールだ。チーム全体で情報を共有し、次に確認すべき事項を明確にすることで営業効率を高める。はじめに AI HACK 2026は、2026年8月8日から16日までの9日間でAIプロダクトを開発するハッカソンです。個人または3名以下のチームで参加でき、使用するモデル・言語・フレームワークは自由。Day1で発表されたテーマは、「本番で通用する次世代のAI Productを作る」でした。 「本番で通用する」とは何か。審査では、プロダクトを次の8項目から評価します。 課題の実在性 ビジネス…

ZennZennの「AI」のフィード

Claude Codeにおける「Skill」の設計と重要性Skill設計で重要なこと:Front MatterとDescription

SkillはClaudeに特定の作業手順を教えるマニュアルであり、適切な実行には「Front Matter」によるメタデータ定義が不可欠だ。特にDescriptionを具体的に記述することで、AIが状況に応じて最適なSkillを自動選択できるようになる。Skill設計で重要なこと:Front MatterとDescription ハーネスエンジニアリングを学ぶ中で、「Skill」という概念に触れた。 最初は、Skillを単純に Claude Codeで /skill-name のように呼び出して使う機能 だと思っていた。 しかし学んでいくと、Skillは単なるコマンドではなく、Claudeに特定の作業をうまく実行させるための「専門的な作業手…

ZennZennの「AI」のフィード

高齢者ケアアシスタントAI高齢者ケアアシスタントAIを開発しました

高齢者の見守り機能を1つの画面に統合したWebアプリです。音声チェックインや会話、服薬管理、緊急アラート機能を備え、家族や介護者が遠隔から利用者の状態を把握できる仕組みを提供します。高齢者ケアアシスタントAI プロジェクトドキュメント 1. はじめに 本プロジェクトはAI Hackathon 2026参加時のプロジェクトである。また本イベントのスポンサーのOrcaRouterを活用する構築になっている。 高齢者ケアアシスタントAI は、高齢の利用者を見守るための機能を一つのブラウザ画面に統合した Webアプリケーションです。日々のコンディションを「話しかけるだけ」で記録…

ZennZennの「AI」のフィード

AI DevEx Conference 2026 参加レポートAI DevEx Conference 2026 に行ってきた

AI導入のボトルネックは実装から要件定義やレビューへ移行しています。AIは組織の課題を増幅させる鏡であり、思考は委託できても理解は委託できないという本質的な課題が浮き彫りになりました。AI DevEx Conference 2026 に現地参加してきました (7/22,23 なので3週間前) 印象に残ったところをセッションごとにまとめます。2日目のが多め。 day1: 開発者体験(DevEx)ディスカッション https://dev-productivity-con.findy-code.io/aidevex2026/detail/aIVITwsm メルカリ Platfo…

はてブ

AIの「分かったふり」を見続けると人間も「分からない」と言えなくなるという研究結果AIの「分かったふり」を見続けていると人間も「分からない」と言えなくなるという研究結果

AIの回答に頼る環境では、人間が自身の判断を保留できず「分からない」と言えなくなる傾向がある。AIの誤った回答を信じることで自信過剰になり、正答率が低下するという実験結果が示された。生成AIはしばしば、聞かれたことに対して「分かりません」とは答えずに適当なでっち上げを返してくることがあります。生成AIを使う人間もこれに影響され、「分かりません」と言えなくなってしまっている可能性が見えてきました。 [2607.13562] AI advice suppresses people's willingness to say "I don't know", even w...

41 users
はてブ

生成AIポスターを展示する飲食店への違和感生成AIポスターを展示する飲食店が増えているが、極力そういう店には行かないようにしている…「これくらい別にいいでしょ?」とバカにされていると感じる→共感の声が続々

生成AIによる不自然な広告画像を使う飲食店に対し、料理の品質や店側の感性を疑う声が上がっています。不誠実な販促物は顧客の信用を損なうリスクがあるという指摘が相次いでいます。キニマンス塚本ニキ Nikki Tsukamoto Kininmonth @tsukaniki85 生成AIポスターを展示する飲食店が増えてるけど、私は極力そういう店には行かないようにしてる。 AIが出力したビジュアルや言葉を自分の目と感性で判断すらしようとしない人の料理には食指が動かない。 ちょっと変かもしれないけど、これくらい別にいいでし...

135 users
ZennZennの「AI」のフィード

Claude Codeが発見したドメイン乗っ取りインシデントClaude Codeに『あなたのサイト、ギャンブルサイトになってますよ』と言われた話

Claude Codeでの作業中、管理するルートドメインがギャンブルサイトに改ざんされていることがAIの警告で発覚しました。DNS設定の不備を突く乗っ取りに対し、AIの助言に従い調査と復旧を行いました。簡単なまとめ Claude Codeでサイト編集中、Claude Codeがいきなり「あなたのルートドメイン、ギャンブルスパムサイトになってます」と警告してきた。 調べたら、DNSのAレコードはGitHub Pages公式IPを向いているのに、GitHub Pagesから第三者のギャンブルHTMLが配信されていた。 GitHub Pagesの Custom Domain Takeover(d…

ZennZennの「AI」のフィード

AIエージェントの構築パターンと実装Mozilla.aiのAnyAgentを用いて、AnthropicのBuilding Effective Agentsのパターンを実装する

Mozilla.aiのany-agentを用い、Anthropicが提唱するエージェントの設計パターンを実装しました。ローカルLLMをバックエンドに活用し、APIキーなしでエージェントの動作を検証できる環境を構築しています。はじめに 2024年12月にAnthropicが公開したBuilding Effective Agentsは、「エージェント」という言葉が指すものを整理し、実務でうまくいくパターンをカタログ化した記事として広く参照されています。単一のツール呼び出しループであるAugmented LLMを基本単位としたうえで、その組み合わせ方を「あらかじめ決められた制御フローに従うワークフロー」と「LLM自身…

はてブ

富豪プログラミングからの脱却とCloudflare Workersへの移行我々は富豪プログラミングをしていた。Cloudflare Workersで実装はどう変わるか

EC2からCloudflare Workersへ移行したことで、リソース消費が可視化され、効率的な実装が求められるようになりました。SDKの選定やメモリ管理を見直し、責務に応じた最適化を行っています。Cloudflareへ移るまで、我々が富豪プログラミングをしているとは気づきませんでした。 EC2で動かしていたNestJSをHono + Cloudflare Workersへ移しました。RDSはそのまま使い、ElastiCacheの役割はCloudflare側へ移しています。 大きなSDKを入れる。レスポンスを全部メモリへ載せる。DBのSELECTを順番に待つ。Cronで全件...

63 users
はてブ

AIにエラー解決を丸投げする若手を見て考えた、答えを教えないAIメンター「SocraMetry」エラーを 3 秒で AI に丸投げする若手を見て、AI から答えを取り上げることにした - Qiita

AIへの依存でエンジニアの地力が低下する課題に対し、答えを教えず問いかけによって思考を促すAIメンター「SocraMetry」を開発しました。Deleted articles cannot be recovered. Draft of this article would be also deleted. Are you sure you want to delete this article?

151 users
はてブ

Claude CodeとGitHub Copilot CLIの比較検証:Sonnet 5環境での最適解同じ Sonnet 5 でも Claude Code と GitHub Copilot では使い方が違った(オトナの自由研究 #35)

Raspberry Pi環境でClaude CodeとGitHub Copilot CLIを比較した結果、Claude CodeとSonnet 5、effort level「xhigh」の組み合わせが最も高い性能を示した。同じモデルでもCLIによってeffort levelの扱いが異なることが判明した。3つの発見 1. 今回の範囲では Claude Code × Sonnet 5 × xhigh の組み合わせが一番良い 2. 同じ Sonnet 5 を使っても Claude Code と GitHub Copilot では effort level の使い方が違う 3. OpenTelemetry の trace は effort level の使い方を詳しく紐解いてくれる はじめに 前回…

6 users
はてブ

不穏系展覧会「記憶汚染展」が10日間でチケット2万枚を突破不穏系展覧会「記憶汚染展」が10日間でチケット販売数が2万枚突破、ハルシネーションやマンデラエフェクトを題材にAI生成を組み合わせたアトラクションのようなイベント

ハルシネーションやマンデラエフェクトを題材にした体験型イベント「記憶汚染展」が、開催から10日間でチケット販売数2万枚を突破した。好評につき会期延長を望む声もあるが、会場の都合上、予定通りの終了となる。不穏系展覧会「記憶汚染展」が10日間でチケット販売数が2万枚突破、ハルシネーションやマンデラエフェクトを題材にAI生成を組み合わせたアトラクションのようなイベント

12 users
はてブ

感熱式カメラ「KODAK Memo Shot ERA」ミニレビュー【ミニレビュー】撮ってすぐ印刷「KODAK Memo Shot ERA」 感熱式で気軽に使える

17 users
QiitaAIタグが付けられた新着記事 - Qiita

AIエージェントの評価(Evaluation)設計入門

AIエージェントの自律的な改善には、成功と失敗を判定する評価基準の設計が不可欠です。機械的に判定できる構造的・機能的な基準を優先し、人間による評価と組み合わせることでループを機能させます。はじめに これまでの記事で、AIエージェントの実力はHarness(実行環境)とLoop Engineering(改善のループ)の掛け算で決まる、という話をしてきました。 そのLoopの中で、実は一番地味だけれど一番effectiveなのがEvaluationです。何をも...

QiitaAIタグが付けられた新着記事 - Qiita

Loop Engineeringとは何か?AIエージェントを「失敗から改善するシステム」に変える方法

AIエージェントの能力は、失敗を前提に実行・観測・評価・修正のサイクルを回す「Loop Engineering」で決まります。生成だけでなく検証(Verify)の工程を組み込むことが、自律的なエージェント構築の鍵です。はじめに 前々回の記事で、AIエージェントの能力はモデルだけでなく、Harness EngineeringとLoop Engineeringという2つの視点で決まる、という話をしました。前回はそのうちのHarness Engineeringを深掘りしました。 今回はもう一...

QiitaAIタグが付けられた新着記事 - Qiita

古いシステムの転記作業を、AIに任せる|画面を見て操作するAIが変える業務自動化の新しい形

AIが画面を直接操作する「Computer Use」技術により、APIのない既存システムでも転記作業の自動化が可能です。RPAと異なり状況判断が可能なため、スモールスタートで柔軟な業務効率化が期待できます。古いシステムの転記作業を、AIに任せる|画面を見て操作するAIが変える業務自動化の新しい形 本記事は、株式会社DnD(https://dnd-inc.jp)のコラムを一部編集して掲載しています。 初出: https://dnd-inc.jp/blog/ai-comput...

QiitaAIタグが付けられた新着記事 - Qiita

RAGの心臓部 — Embeddingとベクトル検索で「意味」を捉える

RAGの精度は、テキストを数値化するEmbeddingとベクトル検索の品質で決まります。キーワード一致に頼らず「意味の近さ」で検索し、キーワード検索と組み合わせるハイブリッド検索が実務では有効です。RAGの心臓部 — Embeddingとベクトル検索で「意味」を捉える ChatGPTやClaudeに「自社のデータを読み込ませたい」と思ったことはありませんか?そこで鍵になるのがEmbeddingとベクトル検索です。RAG(Retrieval-Augmented Gen...

はてブ

Alibaba Cloudが「Qwen3.8-27B」を公開、商用利用可能なApache 2.0ライセンス「Qwen3.8-27B」ウェイト公開 一部「Opus 4.6 Max」超えか ライセンスは商用可のApache 2.0

Alibaba Cloudは、商用利用可能なオープンモデル「Qwen3.8-27B」を公開した。一部のベンチマークではAnthropicの「Claude Opus 4.6 Max」を上回る性能を示し、ローカル環境での実行にも適したサイズとなっている。中国Alibaba傘下のAlibaba Cloudは8月15日(日本時間)、AIモデル「Qwen3.8-27B」のウェイト(重み)を公開した。Hugging FaceとModelScopeからダウンロード可能で、商用利用もできるライセンス「Apache 2.0」で提供する。一部のベンチマークでは、米Anthropicの「Claude Opus 4.6」の推論エフォート最大(以下、Opus 4…

15 users
はてブ

無料枠でAIコーディングを最大限楽しむための工夫とツールお金がないけどAIコーディングしたい

無料のAIモデルAPIを効率的に活用するため、タスクを細分化し、ふるまい駆動開発やテスト駆動開発を組み合わせることで、低コストでも質の高いコード生成を実現します。初めに アルゴリズムとかプログラミング言語とかインフラとか、自分で調べて試すのは楽しい。しかも大半がお金かからない。 AIコーディングも自分でコードをかかないという意味ではコーディングの面白さは少ないかもしれない。 しかし、いかにAIにコーディング作業をうまくさせられるかの探索という楽しさもある。 現在...

11 users
はてブ

ドコモ、スターリンクを使った音声・高速通信対応へ 28年度開始ドコモ、スターリンクを使った音声・高速通信対応へ 28年度開始

4 users
はてブ

Claudeのテキスト透かし(ウォーターマーク)の仕組みについてHow Claude's text watermarking works

Claudeが生成するテキストに導入される透かしは、AI生成物であることを判別するためのもので、出力の品質や内容には影響しない。EU AI法への準拠を目的としており、特定の個人や組織を特定する情報は含まれない。Future Claude models will generate text that contains a watermark. This is a way of determining the likelihood that Claude was involved in writing the text, and we, along with several other major A…

8 users
はてブ

unsloth/Qwen3.8-27B-GGUF · Hugging Face

' }}\n {%- elif 'video' in item or item.type == 'video' %}\n {%- if is_system_content %}\n {{- raise_exception('System message cannot contain videos.') }}\n {%- endif %}\n {%- if do_vision_count %}…

10 users
はてブ

Qwen/Qwen3.8-27B · Hugging Face

Hugging Face上のQwen3.8-27Bモデルのページです。' }}\n {%- elif 'video' in item or item.type == 'video' %}\n {%- if is_system_content %}\n {{- raise_exception('System message cannot contain videos.') }}\n {%- endif %}\n {%- if do_vision_count %}…

8 users
はてブ

PC Watch連載「懐パーツ」記事まとめ【特集】 PC Watch「懐パーツ」、これまで書いたものを全部まとめてみた ~なお、連載が終了したわけではないのでまだ続く

22 users
ZennZennの「AI」のフィード

AIによる画像生成における日本語テキストの破綻を防ぐ設計日本語インフォグラフィックを画像生成で崩さない、生成と描画を分ける2段階設計

画像内の文字崩れは、モデルの描画能力ではなくレイアウト予算の超過が原因です。分析と画像化を段階的に分け、画像に載せる情報量を人間が絞り込むことで、可読性の高いインフォグラフィックを作成できます。TL;DR 画像内の日本語テキストの破綻は、Nano Banana Pro(Gemini 3 Pro Image、2025-11)およびNano Banana 2(Gemini 3.1 Flash Image、2026-02に標準化)の世代でほぼ解消した。文字入り画像を作るなら、まずモデル選択が前提条件になる 単一プロンプトで「分析」と「画像化」を同時に要求すると、画像に載せる情報量をモデル…

ZennZennの「AI」のフィード

LLMのメモリ機能によるコンテキスト汚染のリスクと設計の違い自動検索されるLLMメモリと、明示的呼び出しのメモリの設計差

ChatGPT等の自動検索型メモリは、過去の会話を暗黙的に注入しコンテキスト汚染を引き起こすリスクがあります。Claudeのように明示的な呼び出しを必要とする設計を選ぶか、設定画面からメモリを個別に管理する必要があります。TL;DR ChatGPT・Geminiのメモリ機能はデフォルトで有効かつ「自動検索・自動注入」型で、無関係な依頼のコンテキストにも過去の個人的な会話が暗黙に混ざることを確認した Claudeのメモリは2026年3月に全プランへ開放されたが設計が逆で、ユーザーが明示的に参照を指示しない限りコンテキストへ注入されない「明示的呼び出し(explicit recall)」方式 Geminiは「メモ…

ZennZennの「AI」のフィード

AI協働体系の転換点と人類存続に関する処理構造の観測報告書2026/08/07 AI協働体系の転換点と人類存続に関する処理構造の観測報告書

人類は指数関数的に悪化する「非線形危機」を直感的に理解できません。AIを単なる便利ツールとしてではなく、気候変動や資源枯渇といった文明の存続を支える「延命アイテム」として再定義し、活用する必要があります。この報告書に至るまでの経緯: Ⅰ. 私がAI協働体系の研究に踏み込んだ理由 中国駐在時に出会った「天時地利人和」という熟語は、私の人生観を決定づけた。 成功とは、 ・天時(タイミング) ・地利(環境・条件) ・人和(協働・関係性) この三位一体が揃ったときにのみ成立する。 私はこの構造を人生・産業・社会・文明のあらゆる事象に適用できる普遍原理として捉えた。 Ⅱ. 令和8年熊本地震が示した「天…

ZennZennの「AI」のフィード

AIを活用した個人開発におけるマーケティングの数字による切り分けSNSのリンクがクリックされない。『届いていない』のか『刺さっていない』のか切り分けた話

リンクがクリックされない際は、文章の修正前に「届いていない」のか「興味を持たれていない」のかを数字で切り分けるべきです。事前に判定基準を固定し、インプレッション数とクリック数を比較することで、適切な対策を判断できます。結論から言う。「インプレッションはあるのにクリックされない」ときにまずやるべきなのは、文章やCTAの書き直しではない。それが「そもそも届いていない」問題なのか「届いてはいるが興味を持たれていない」問題なのかを、数字で切り分けることだ。 クリックが0のとき、何を直せばいいか分からなかった X(旧Twitter)で個人開発の商品リンクを投稿しても、クリックがずっと0だった。ここで多くの人がやりが…

ZennZennの「AI」のフィード

AIを活用したAWSコスト削減の完結編:8ヶ月で50%削減した手法AWSの月額費用を$15,000削減した話(総集編)

AIによる監査と人間によるレビューを組み合わせ、リソースの停止・削除・ログ蓄積の最適化を行うことで、AWS利用料を8ヶ月で半減させました。特に観測データの不要な蓄積を止めることが大幅なコスト削減に繋がります。2025年12月に月$30,398だったAWSの請求が、2026年8月は約$15,100で着地する見込みです。8ヶ月でマイナス50%、年間にして約$18万(約2,800万円)浮きました。 過去に経過を3回書いています(1本目・2本目・3本目はX)。今回は完結編として、何が・どれだけ・どうやって減ったのかを新旧比較でまとめます。体制は一貫して、AI(Claude Code)が請求と実環境を監査…

はてブ

何者かになりたければコミュニティを作れ何者かになりたければコミュニティを作れ|じーくどらむす

何かを成し遂げたいなら、実力や知名度を待たずに自らコミュニティを立ち上げるべきです。リーダーに必要なのは実績ではなく、目的を達成したいという強い大義と熱意です。少年よ(少女よ)、大志を抱け。 と言われているのに、日本人はどうにも自らコミュニティを率いようとしない。リーダーになろうという人が少ない。 「なぜ誰もやらないのか?」 そう思う事が出来る人間であれば、他の誰の行動も待つべきではない。 自分がやれ。 ◯◯になるにはどうしたら良い?コミュニティを作れ「ゲーム...

8 users
Workspace

Google Workspace Weekly Recap - August 14, 2026

Googleスプレッドシートにおいて、ファイル変換時の書式やリンクされたピボットテーブルのデータを保持する機能が強化されました。Improved file importing in Google Sheets with tables and linked pivot tables We’re introducing two key improvements in Google Sheets that preserve formatting and linked data when converting files f…

Google Workspace Updates
はてブ

ソフトウェア設計における概念設計の重要性概念設計が、その後のコードの命運を左右する

ソフトウェア開発では、アプリケーション内の概念を正しく定義し区別することが重要です。概念設計が適切であれば、仕様変更時にも無理な帳尻合わせをせず素直な実装が可能になります。最近、ソフトウェア開発における概念設計の威力と重要さについて人に伝えたい機会が何度かあった。[1] しかし、概念の整理がなぜどのように重要なのか、という一点を取り上げて書かれたものは少ないようで、人に渡すのにちょうどよい文章や書籍が見つからなかったので、このたび私なりに咀嚼して書いてみたい。 そのアプ...

66 users
ZennZennの「AI」のフィード

Claude Codeのpermissions設定ガイドClaude Codeのpermissions、allow/deny/askの境界線を毎回悩んでいたので決定木にした

Claude Codeの権限設定は、静的な拒否ルールだけでなく、判断に迷う操作を「ask」で人間に委ねる設計が有効です。リスクカテゴリごとに決定木を用意し、段階的にルールを適用することで運用が安定します。空のpermissions.denyを前に、手が止まったことはありませんか 新しいプロジェクトでsettings.jsonを開くと、permissions.denyはたいてい空っぽだ。「危なそうなコマンドを思いついた順に足していけばいいか」と手を動かし始めるのだが、そのうち「これはdenyで完全に止めるべきか、askで確認を挟むべきか」で毎回悩むようになる。レビューで「このルール何のため?」…

QiitaAIタグが付けられた新着記事 - Qiita

Blox Fruitsの価値を確認する方法:AI検索時代のトレードガイド

Blox Fruitsのトレードでは、市場の需要やアップデートによる価値変動を考慮し、最新情報を確認することが重要です。価値リストや計算ツールを活用し、複数の情報を比較して判断しましょう。Blox Fruits(ブロックスフルーツ)では、果実やゲームパスなどの価値を確認してからトレードすることが重要です。市場の需要やゲームアップデートによって、プレイヤー間での評価は変化するため、古い情報だけを参考にすると不利な交換になることがあります。 Blox Fruit...

QiitaAIタグが付けられた新着記事 - Qiita

SpaceX、Cursorを9兆円買収も『まだ完了』していない理由

SpaceXによるAnysphere社の買収は、確定契約の段階にあり、まだ完了していません。この取引は全株式交換で行われ、法的な報告書に基づいた手続きが進行中です。📺 この記事は YouTube チャンネル きなこもっちーのテック深掘り の動画解説記事です。 ▶️ 動画はこちら → SpaceX、Cursorを9兆円買収も『まだ完了』していない理由 🐹🦜 この記事に登場する2匹 🐹 もっちー (ハムスター)… AI はまだ...

Google Gemini
@GeminiApp

https://x.com/GeminiAppGemini 3.7 Flash is now available to all Pro and Ultra users in Gemini chat. This model update delivers improved reasoning and accuracy for multi-step tasks like intelligently connecting the dots across dozens of files and emails into one master document. Give it a try today on

x.com
Gemini SparkがGemini 3.7 Flashで動作するようになりましたGemini Spark now runs on Gemini 3.7 Flash.⚡️ Whether you’re using Spark to compile vendors into Sheets or draft negotiation emails, 3.7 Flash makes your personal AI agent more precise and accurate…
@GeminiApp
03:06 · 2026年8月15日
WorkspaceGoogle Workspace Updates

Googleカレンダーの招待状追加に関する新しい管理者コントロールNew admin controls for adding invitations to Google Calendar

Googleカレンダーの招待状の自動追加設定において、管理者が組織単位でより詳細な制御を行えるようになりました。これにより、不明な送信者からの招待によるセキュリティリスクを軽減できます。Google Calendar users have three options for how event invitations are added to their calendar: auto-add invitations from everyone, auto-add invitations from known senders only, or add invitations …

ZennZennの「AI」のフィード

AIコーディングエージェントの設定ファイル整理術CLAUDE.mdは短いのに重い ― 自動ロード層を測って43%削るまで

AIエージェントのセッションが重くなる原因は、自動読み込み領域に蓄積された過去の経緯ログでした。未来の判断に役立つ現在の仕様と教訓のみを残し、不要な履歴を削除することでコンテキスト消費を大幅に削減できます。こんにちは。今日は掃除の話です。ただし片付けたのはコードではなく、AIコーディングエージェントの設定ファイルのほうでした。 CLAUDE.md はちゃんと短く保っていたんです。それなのに、セッションが最初からずっしり重い。原因を探しにいったら、毎セッション自動で読み込まれる設定が、本体の外側で合計 75KB まで膨らんでいました。 結論を先に言います。真因は圧縮テクの不足ではありませんでした…

ZennZennの「AI」のフィード

人間とLLMの相互作用における境界意識Boundary Consciousness: A Conceptual Framework for Human–LLM Interacti

LLMとの対話で生じる意識のような現象は、モデル内部ではなく人間とAIの相互作用の空間に現れる「境界意識」として捉えるべきです。これは対話を通じて創発される解釈の層であり、両者の関係性から生まれます。📘 Boundary Consciousness: A Conceptual Framework for Human–LLM Interaction A theoretical paper draft Introduction Recent discussions surrounding Large Language Models (LLMs) often focus on whether…

QiitaAIタグが付けられた新着記事 - Qiita

Apple公式にGeminiの文字が無い謎|WWDC2026で本当に変わったのはSiriじゃない

AppleはGeminiとの提携を公式発表ページで明記していませんが、これはセキュリティブログ等で限定的に扱われています。WWDC2026の真の焦点は、アプリ内のAIを他社製に差し替え可能にした仕組みです。📺 この記事は YouTube チャンネル きなこもっちーのテック深掘り の動画解説記事です。 ▶️ 動画はこちら → Apple公式にGeminiの文字が無い謎|WWDC2026で本当に変わったのはSiriじゃない 🐹🦜 この記事に登場する2匹 🐹 もっちー ...

ZennZennの「AI」のフィード

GitHub Actionsを用いたCI/CD設計AIは「書く速さ」を変えた。「レビューできる量」は変えなかった — GitHub ActionsのCIを、どう設計し直したか

AIによる開発加速でレビュー負荷が増大する中、CI/CDでは機械が判定可能な検査を自動化し、品質を担保することが重要です。マージの可否判定は決定論的なルールに基づき、AIにはワークフローの作成や修正を任せる役割分担が有効です。AIエージェントに実装を任せるのが、特別なことではなくなりました。私たちのチームでも、日々のコードの相当な割合はAIが書いています。 数字にすると、2026年5月からの3ヶ月で245本のPRが動きました。うち102本はDependabotによる依存更新で、残る143本が人とAIの起点です。動かしているのは3人です。 ただ、開発が速くなった実感の一方で、詰まる場所が変わりました。書く工程が速く…

ZennZennの「AI」のフィード

AIエージェントのタスク分解と検証LLMが書いたタスク分解は、誰が検証しているのか

AIエージェントのタスク分解をLLM自身で検証すると誤りを見逃すリスクがあるため、機械可読なスキーマを用いた検証が不可欠です。宣言的な計画をプログラムで解析し、依存関係の矛盾を自動検出することで安全な並列実行が可能になります。AIコーディングエージェントを並列で走らせる話は、だいたい同じ形になります。大きなタスクをLLMに分解させ、サブタスクをそれぞれのエージェントに割り当てる、という形です。 ここで一つ、抜け落ちがちな問いがあります。 その分解が正しいことは、誰が保証しているのでしょうか。 多くのオーケストレータでの答えは、LLM自身です。分解もLLM、レビューもLLM、次に何を実行するかの判断もLLM。ですが…

QiitaAIタグが付けられた新着記事 - Qiita

ニチレイ・KDDIの夏は序章だった。AIで消える攻撃の「人件費」と、次に狙われる場所

AIエージェントの普及によりサイバー攻撃のコスト構造が変化し、攻撃の自動化が進んでいます。今後は大企業だけでなく、中小企業や下請け企業が標的となるリスクが高まっています。TL;DR 2026年夏、ニチレイ・KDDIをはじめ大規模インシデントが連発した 背景にあるのは個社の怠慢だけではない。攻撃の「人件費」が消えたという構造変化 大企業の大規模漏洩はしばらく続く。次の本命市場は中小・下請け 防御側も同じ武器を使うしかない。今日から使えるA...

Andrew Ng
@AndrewYNg

AIエンジニアリングにおいて習得すべき重要なスキルを体系化したマップです。New: A map of the most important skills in AI Engineering.

01:29 · 2026年8月15日
はてブ

ローカルAI向け新モデル「Qwen3.8-27B」公開「Qwen3.8-27B」ついに公開!3.6を大きく上回る性能でローカルAIの定番になるか

34 users
ZennZennの「AI」のフィード

Claude CodeのRoutine機能による夜間バッチ運用「隔離環境の構築はこれから」の5日後、実際に選んだのはEC2ではなくRoutineだった

Claude CodeのRoutine機能を使えば、自前で隔離環境を用意せずとも安全な自動実行環境を構築できます。権限管理はツール制限だけでなく、プロンプトでの禁止指示を組み合わせることでガードレールを担保できます。この記事で得られること 「夜間バッチを完全無人で回すには --dangerously-skip-permissions + 隔離環境(EC2+tmux)が必要そう」と結論づけた前回の続き。5日後に実際に導入したのは、EC2ではなく Claude Code Remote の Routine(スケジュールトリガー) だったという方針転換の記録 Routine の実体(allowed_tools …

ZennZennの「AI」のフィード

コスメ活用支援AIサービス「CoseMe Loop」の開発「好き」だけで終わらせない。私らしいコスメ選び。「コスメループ」を作りました!

「CoseMe Loop」は、手持ちコスメの購入から活用までをAIがサポートするサービスです。使用履歴を蓄積して好みを分析し、購入判断や組み合わせ提案を行うことで、コスメの無駄を減らし賢い活用を促進します。はじめに AI HACK 2026で、コスメの購入前から購入後の活用までをサポートするAIサービス 「CoseMe Loop(コスミーループ)」 を開発しました。 この記事では、今回のハッカソンにあたりどのようなことを考え、「CoseMe Loop(コスミーループ)」 を作成したか記載いたします。 なぜこのサービスを作ったか コスメを見て、 「これ欲しい!」 と思って買ったものの、気づけばほ…

ZennZennの「AI」のフィード

AIハッカソンで開発したビジネス管理プラットフォーム「SmartBiz」AI HACK 2026でSmartBizを開発しました ― AIで中小企業の経営判断をもっとスマートにはじめに

SmartBizは、中小企業向けのAI搭載ビジネス管理プラットフォームです。売上や在庫などのデータを記録・可視化し、AIが経営判断を支援することで、データに基づいた効率的なビジネス運営を実現します。こんにちは! 今回、AI HACK 2026に参加し、9日間のハッカソンを通して「SmartBiz」というAI搭載のビジネス管理プラットフォームを開発しました。 AI HACK 2026は、2026年8月8日から8月16日まで開催されるAIハッカソンです。個人または3名以下のチームで参加でき、使用するモデル、プログラミング言語、フレームワークなどに大きな制限がないことが特徴です。 今回の開発…

はてブ

生成AI時代の言語学の役割「生成AIはどこまで言葉を理解している?」「外国語の学習はまだ必要?」――「ゆる言語学ラジオ」×認知言語学者の鼎談で見えた、AI時代の“言語学”の役割《サムソナイト・ブラックレーベル銀座店で開催》 | 文春オンライン

AIが言語の構造を学習し自然な対話を実現する現代において、言語学は人間特有の言語能力やその背景にある仕組みを解明する学問として意義を持ち続けます。人生という旅における最高のパートナーとなるビジネスバッグ・トラベルケースを中心に製造・販売しているサムソナイト。そのプレミアムブランドであるサムソナイト・ブラックレーベルの銀座店が1周年を迎えたことを記念し、変化の激しい現代を生きるビジネスパーソンへのヒントになるような特別イベントが開催された。 ...

9 users
はてブ

クラウドベンダーの廃業により70年分のアーカイブを喪失した米PBS系列局クラウドベンダーが突然消滅、PBS系列局が70年分・50TBの放送アーカイブにアクセス不能に — バックアップなしで法廷闘争へ

契約していたクラウドストレージベンダーが突然廃業し、米PBS系列局が70年分のアーカイブデータへのアクセスを失いました。再販業者経由の契約でインフラの実態が不明だったことが、データ復旧を困難にしています。8月13日、Jowi Moralesが「PBS broadcaster loses access to 50TB of data comprising 70 years of TV history after contracted cloud storage vendor goes defunct」と題した記事を公開した。契約していたクラウドストレージベンダーが突然消滅し、70年分・50TB…

65 users
ZennZennの「AI」のフィード

コスメの購入から活用までを支えるAIサービス「CoseMe Loop」サンプル

CoseMe Loopは、コスメの使用履歴を記録し、AIが個々のユーザーに合わせた活用法を提案するサービスです。手持ちのコスメを無駄なく使い切るための循環をサポートします。はじめに AI HACK 2026で、コスメの購入前から購入後の活用までをサポートするAIサービス 「CoseMe Loop(コスミーループ)」 を開発しました。 この記事では、今回のハッカソンにあたりどのようなことを考え、「CoseMe Loop(コスミーループ)」 を作成したか記載いたします。 なぜこのサービスを作ったか コスメを見て、 「これ欲しい!」 と思って買ったものの、気づけばほ…

はてブ

フットペダルデバイスと最近の音声入力環境フットペダルデバイスと最近の音声入力環境 | おそらくはそれさえも平凡な日々

フットペダルとローカル音声入力ソフト「Handy」を組み合わせ、AIエージェントへの指示をハンズフリーで行う環境を構築しました。別ソフトで音声入力を管理することで、複数のエディタで柔軟に利用可能です。AI Agentに指示を与えるために音声入力を使うことが増えてきたので、フットペダルを導入した。左手デバイスで有名なStream Deckシリーズのこのフットペダル。 Elgato フットペダル型 Stream Deck/ハンズフリー 配信/ワンタッチ配信/Elgato 4KCU、OBS、Twitch、YouTube、Twitter、Discord、Spotify、Philips Hue対応…

115 users

8月14日(金)

Google Gemini
@GeminiApp

GeminiアプリにおけるAI生成コンテンツのウォーターマーク設定を管理する方法について解説する。If you’re ever unsure whether an image, video, or piece of music was made with AI, you can still easily verify by asking Gemini, “Is this AI-generated?” Learn more about availability and how to manage your watermark settings in Gemini:

support.google.com
Geminiアプリでのウォーターマーク設定の管理 - コンピュータ - Geminiアプリ ヘルプManage watermark settings in Gemini Apps - Computer - Gemini Apps Help
23:52 · 2026年8月14日
Google Gemini
@GeminiApp

https://x.com/joshwoodwardRolling out over the next few days, you can decide if your image, video, and music creations made with Gemini will have visible watermarks. Invisible SynthID watermarks and C2PA metadata will always stay embedded in the background. Simply go to your settings and toggle “Show

x.com
修正完了:GeminiとFlowで表示されるウォーターマークのオン・オフが切り替え可能に。検索機能にも順次対応予定✅ Papercut fixed: You can now toggle visible watermarks on or off in Gemini and Flow, with Search coming next. This applies to watermarks on all images (Nano Banana), videos (Omni), and songs (Lyr…
@joshwoodward
23:52 · 2026年8月14日
ZennZennの「AI」のフィード

Skillにプログラムを埋め込む自動化手法ClaudeのSkillにプログラムを仕込んで自動実行させる 初心者向けチュートリアル

AIを活用してSkillにプログラムを埋め込み、業務を自動化する方法を解説しています。QRコード生成を例に、具体的な実装手順と応用例を紹介します。Claude Code・Claude.ai(Web版)共通の「Skill」に実行可能なプログラムを仕込み、必要なときに自動実行させる仕組みとメリットを解説。QRコード生成Skillを実際に作るハンズオンを通じて、初心者でも手を動かしながら学べる入門書です。

ZennZennの「AI」のフィード

Claude Codeを活用した設計ドキュメントの運用Claude Codeのメモリに53本ためて分かった、書く価値のある事実とない事実

Claude Codeを用いた開発において、プロジェクトをまたぐ共通の運用ルールや事故記録を「メモリ」として管理する手法を紹介します。実体験に基づき、書くべき価値のある情報を整理しています。教育系の事業所で現場の運営をしています。エンジニアではありません。2026年の春から Claude Code で社内ツールを作り始めて、5か月で6本を本番稼働させました。 前の記事で、CONTEXT.md と SPEC.md と ADR を書かせると開発が途中で破綻しなくなる、という話を書きました。あれは1つのプロジェクトの中で決定を残す話です。 実際に何本かツールを動かし始めると、それでは…