2026-08-13 17:01 はてなブックマーク テクノロジー 人気エントリー

タイトル ブックマーク数

AIが実装し、AIがテストし、AIが「問題ありません」と言う時代の品質保証 – Qiita
362
私はこれからのQuality Engineeringでは、 「テストを書く能力」以上に「正しさを評価する仕組みを設計する能力」が重要になる と考えています。 しかしAgentが直接観測できる成功条件が、 「TestをGreenにする」 だけなら、Specificationそのものではなく、Visible Testsへ最適化される可能性があります。

Cloudflareは16年間ずっと同じことをしている。「通り道を支配する」という設計思想を知る
119

企業さんでAI周りのお仕事させてもらってます、楽しい~!
英語版は気合いと情熱です。Cloudflareは「通り道に立つ」を先に決めていて、そのあと 「立ってしまったからには、ここで何ができるか」を16年間ずっと探している会社なんです。


最新鋭のiPhoneを買って喜んでいたが
82

同僚女性教諭の水着画像をAIで生成 男性教諭を懲戒 神奈川県教委:朝日新聞
187

Claude がテキストに電子透かしを入れ始めたので、LLM ウォーターマーキングの仕組みを調べた
436
↩︎ なお2026年には、透かし付きの生成を繰り返して候補を集め、攻撃者側で g 値の低い語を勝たせる追加のトーナメントを重ねることで平均スコアを 0.5 に押し戻す layer inflation attack も提案されています("On Google's SynthID-Text LLM Watermarking System", 2026)。

Word・Excel・PDFなどの文書をAIが読みやすいMarkdownに爆速変換する「anydoc」がオープンソース公開(生成AIクローズアップ) | テクノエッジ TechnoEdge
56
公開されているベンチマークでは、比較対象6ツール(LibreOffice、markitdown、pandoc、doclingなど)のうち唯一14形式すべてをカバーし、判定されたすべての形式で最高スコア、変換時間の中央値は4.4ミリ秒と、次に速いツールより一桁速い結果が報告されています。

HDDが容量2桁台でもがいている間、SSDは512TBに到達した
36

オントロジーと知識グラフ入門:URI から RDF、RDFS、OWL、推論、SPARQL まで整理して学ぶ – Qiita
197

Google版“AirTag”こと「Pixel Tag」登場 10億台のAndroidネットワークで居場所を探知
107

豪州にあるグーグル★2.6評価のパン屋が別な意味でやばかった件について
33
要約の取得に失敗しました。

個人開発のAIデザインツール「Rikyū」 “幾何学的なデザイン”機能が秀逸と話題に
43

Why Japanese firms are being so slow to use AI
54

Androidの「自由」が終わる。2027年、野良アプリが入れられなくなる | ライフハッカー・ジャパン
18
UGREENの新作トラッカーが過去最安 2026.08.13 Buy PR ライフハッカー編集部が選んだ「非日常体験ができる」プライムビデオ作品8選 2026.08.13 わざわざジムに行くのが面倒な人に。「未発売のプロダクト」をクラファンで買う面白さ 2026.08.13 Buy PR Androidの「自由」が終わる。

「Linux」デスクトップの平日利用率は22%に急増–各種データで鮮明な人気ぶり
80

2年かけてたどり着いた1on1の形 —— メンバーと一緒に1on1の最適解を探る – SmartHR Tech Blog
22

チーフになりたての頃に、1on1がうまくできているかわからないと悩んでいましたが、メンバーの声を直接聞けば、1on1自体が役に立っているのか?1on1の改善点はあるのか?に気づくことができます。 このたたき台のとおり、1on1はメンバーのための場であることを大前提としていますが、組織で働くチーフである以上、自分側の目的が入ることもあります。


2040年の就業構造推計(改訂版)と 人材需給ミスマッチを踏まえた取組について 2026年6月 経済産業省 産業人材課
110

Introducing Delta – Zed Blog
36

AI agentを活用した開発プロセスと人間の認知限界 – freee Developers Hub
13
実際、そのような形でSDDがウォーターフォール的だとする主張に反論した記事も書かれています: martinelli.ch さて、これまで論じてきたように、開発プロセスによるAI agentの活用は、「認知負債」「意図負債」の部分において人間の代替を行うことが(現状は)できません。

最上位Max級「Qwen3.8-2.4T-A95B」公開。Fable 5やGPT-5.6 Solなど商用トップ級に匹敵
13

LLM生成によるとみられる多数の虚偽CVE登録についてまとめてみた – piyolog
21
このうちSQLite 3.41を対象とする6件(CVE-2026-51296、51297、51300、51302、51303、51304)は、2026年6月7日にCVE番号が予約され(dateReserved)、7月27日にCVEレコードとして公開された。

PR同士の関係を可視化するgh pr-graphコマンドを作った – orangain flavor
7
また、作成したPRとレビュー依頼を受けたPRのページが分かれていたことから、どちらかに集中しすぎてしまい、自分の開発とレビューをバランスよく進めることができていませんでした。 地味に便利な機能として、自分がコメントした後に再レビュー依頼されたPRや、自分がコメントをpending状態のままにしているPRに表示される、右上のアイコンがあります。

「植物工場」研究拠点開設相次ぐ 最先端技術で食料生産効率化 | NHKニュース
9

Rails is done
35

トランスフォーマーに限界、 次世代LLMを担う 4つの最新アプローチ
7
テキストを単語ごとに処理する仕組みであるため、一度に大量の情報を把握し続けるのが不得手なのだ(言い換えれば、「コンテキスト・ウィンドウ」と呼ばれる、モデルが一度に扱える情報量をあまり大きくできない)。

EM選考プロセスを公開します 〜面接で何を見ているか、なぜそう設計したか〜 – ROXX開発者ブログ
12

はじめに – N4: TCP/IPプロトコルスタック自作入門
11

全社員がAIを使う組織へ、ウォンテッドリーの全社AI活用の実現まで | Wantedly Engineer Blog
12

【西川和久の不定期コラム】 Sora 2超えでSeedance 2.0に迫る!動画AI「MiniMax H3」が凄まじいクオリティだった
17

AIの暗号化された思考内容を盗み見る手法が開発される、「中国製AIの思考がとアメリカ製AIとそっくり」「性能テストの答えを決め打ち」などの実情が浮き彫りに
8

楽天モバイル、10月以降もKDDIのローミング一部継続を強調
34

マーク・ザッカーバーグが異様にポジティブなAI未来論を展開、スーパーインテリジェンスで雇用も増えると超楽観的予測
11

薄型軽量化し耐久性3倍向上「Pixel 11 Pro Fold」 27.9万円から
4

OS持つマイクロソフト「ワード」が首位奪う、国産「一太郎」一気に転落…公取委の排除勧告も「遅すぎた」
5

Agent Browserを使って動作確認しよう|noteエンジニアチームの技術記事
19
3-a:何を確認すべきか — 変更内容から機械的に導き出せる 3-b:それを本当に満たしているか — 実際に画面を触らないとわからない 前者は「変更されたコードを読む」作業、後者は「ブラウザを操作する」作業。 確認作業を資産にした — 再実行用の台本と判定結果をコードと一緒に残すことで、動作確認がレビューできるものになりました。

AIの5大サボりパターンを自動的に解決し無理矢理限界突破させて働かせまくるAIエージェント向けプラグイン「pua」
4

Pixel 11の狙いはスマホへの没頭時間削減。Pixelは“気が利くAIエージェント”に
17

How Tailscale helped find the SQLite WAL-Reset bug
14

OpenAIがサイバーセキュリティ特化AI「GPT-5.6 Cyber」を発表&「GPT-5.6 Solのセーフガード未適用版」をセキュリティ研究者向けに提供開始
5

「Pixel 11」はiPhoneから乗り換えやすく、グーグルがサブスク重複防止やパスワード転送などデータ移行を刷新
5
要約の取得に失敗しました。

ナレッジワークにおけるAI活用をベースとしたQAプロセスの最適化
13
『QA・テストがモヤモヤしたら読むITスタートアップのためのQAの考え方 (内製化失敗編/成功編)』の2冊をKindleで出版。これは、テストプランがQAプロセス全体の地図となり、その地図を開発の状況に合わせて随時更新し続けることで、プロセスの構成要素の整合性が保たれ見通しよくテスト活動を進められるような狙いがあります。

え?DB側から外部サイトにアクセスさせるSQL Injection?ラボで見てみる攻撃のパターン
11
https://portswigger.net/web-security/sql-injection/examining-the-database/lab-listing-database-contents-oracle 例えば今回のDBMSでは、PostgreSQL を利用しているようなので以下のように、テーブル名・列名を UNION 攻撃で同様の手法で表示させることができました。

Google、フラッシュ部が光って通知する6.3型スマホ「Google Pixel 11 Pro」
9

4 ChatGPT features that used to require a subscription — and are now free
5

Introducing Grok 4.6
15

TopcoatでRustフルスタック開発 – じゃあ、おうちで学べる
41
github.com github.com 採用するなら0.5.0を固定し、認証、認可、マイグレーションをTopcoat固有のAPIから分離して、バージョン更新ごとにHTTPフローとブラウザE2Eを通します。

ループとグラフは別物じゃない — 「検証の積み木」でエージェント設計を整理してみた – RAKUS Developers Blog | ラクス エンジニアブログ
51
第3層で品質担保されたループを部品として、その外側に「合流」「目的適合の検証」「戻り先」を配線しているだけです。 実際、私はこの捉え方を「新しいアーキテクチャを追いかけるための地図」ではなく、「いま作っているものは、どの層の検証で品質を担保できるか」を問うための、設計判断の1つの軸として使っています。

CPUとカメラが大幅に進化!6.3型スマホ「Google Pixel 11」誕生。13万6,800円から
4

Google、折りたたみスマホ「Pixel 11 Pro Fold」発表 10%軽く、1mm薄くしつつ耐久性強化
15

認証がプロダクトの足かせにならない世界へ —— 認証・認可基盤ユニットの発足と挑戦 – SmartHR Tech Blog
34

この権限基盤ユニットでアーキテクチャの課題に取り組んでいたチームが、Policy-as-Codeで実現するアクセス制御や新しい権限基盤の設計で紹介した取り組みを進める中で、認可だけでなく認証を含めた領域全体のアーキテクチャ課題に向き合う必要性が高まり、2026年2月に独立したユニットとして私たち認証・認可基盤ユニットが再編されました。


AIテストプロセスの信頼度を測り、改善を回す【前編】── 品質メトリクスの設計と運用 – エムスリーテックブログ
21
前編では、AIテストプロセスの信頼度を測るために設計した品質メトリクスと、その測定・記録を運用する仕組みを紹介します。欠陥密度だけは毛色が違い、古典的な品質指標がAIのテストプロセスに対しても機能するのかを試す目的で、実験的に入れました。 これに加えて、テストレビュー工程が検出した誤りを「分析由来」「設計由来」「実装由来」に分類するログと、レビュー自体の精度(誤検知・見逃し)のログも持っています。

Eストアーのショップサーブへの不正アクセスについてまとめてみた – piyolog
18
巽繊維工業所は2026年8月10日の追記で、Eストアーからの報告として、個人情報が漏えいした対象となる購入者へメールによるお詫びと問い合わせ窓口の案内が2026年8月7日16時から順次開始されたとし、漏えいした可能性のある情報項目には会員ID・暗号化されたパスワードおよびクレジットカード情報の一部(カード名義、番号の先頭6桁・下4桁、有効期限)が含まれる場合があるとしている(出典: 75)。

コメント

タイトルとURLをコピーしました