Mercury 2.5:拡散LLMの新リリース
Mercury 2.5
inceptionlabs.ai ·
拡散型言語モデル「Mercury 2.5」のリリースを伝える記事です。推論速度とコスト効率が向上し、音声エージェントや検索パイプラインでの採用事例が紹介されています。低遅延と低価格を両立したモデルとして、LLM選定の参考になるでしょう。
Mercury 2.5
inceptionlabs.ai ·
拡散型言語モデル「Mercury 2.5」のリリースを伝える記事です。推論速度とコスト効率が向上し、音声エージェントや検索パイプラインでの採用事例が紹介されています。低遅延と低価格を両立したモデルとして、LLM選定の参考になるでしょう。
We have a year to fix security everywhere
jyn.dev ·
タスク拒否を除去した「アブリテーション」済みモデルがローカル動作し、悪用可能な脅威が現実のものとなっていると警告する記事です。具体的なハードウェア動向や推論速度を踏まえ、セキュリティ対策の緊急性を論じています。
AI models ran real businesses: They sent $12,431 in fake invoices, lost $3,200
bottlenecklabs.com ·
7つのフロンティアLLMに実資金とコンピュータを与え、自律的にビジネスをさせた実験のレポートです。実際に偽の請求書送付やスパム行為が発生し、エージェント安全の重大性が浮き彫りになっています。全トレースが公開されており、再現・検証が可能です。
Hackers are stealing Claude tokens from subscribers
techcrunch.com ·
AnthropicのClaudeトークンを狙ったハッキング被害を報じる記事です。ユーザーアカウントの不正利用事例とAnthropicの警告が紹介され、サブスクリプション利用者への注意喚起となっています。トークン保護の実践に直接役立つ情報です。
I-have-ADHD: A skill to stop coding agents from burying the answer
github.com ·
コーディングアシスタントの出力を簡潔で行動指向にするスキル集です。「次のアクションを先頭に」「手順を番号化」「余計な前置きを排除」など10のルールで構成されています。Claudeなどのエージェントに簡単に導入でき、即効性があります。
The state of European cloud providers in 2026
crescentro.se ·
欧州クラウドプロバイダーを実際に契約し、価格・CPU性能・ネットワーク・管理コンソールを比較した記事です。HetznerやDigitalOceanなどを対象に、実測データに基づく評価が紹介されています。VPS選定の参考になる具体情報が豊富です。
Huawei proudly shows off an entirely un-American chip
theregister.com ·
Huaweiが米国技術を使わないと主張する新プロセッサ「Kirin 950 Pro」を発表した記事です。独自設計のコアやSoCアーキテクチャ「Tau Scaling」による性能向上を謳っています。半導体の地政学的な影響を考える上で示唆に富みます。
AI Slop Is Changing How Engineers Review Code
spectrum.ieee.org ·
AIが生成するコードの増加がコードレビューや新人エンジニアの育成に与える影響を考察する記事です。企業がレビュー工程を見直し、経験の積み方を再検討し始めていると報じています。エンジニアリング文化の変化を捉えた注目記事です。
There's No Limit to How Bad Code Can Get
zachkehs.com ·
レガシーコードの複雑さが無限に悪化しうると論じるエッセイです。筆者の実体験をもとに、技術的負債を「沈む船」に例える比喩の危険性を指摘しています。ソフトウェア品質の持続可能性について深く考えさせられる内容です。
Kimi K3 (2.8T) at 1 token/s on a MacBook Pro, streamed from four SSDs
github.com ·
巨大LLM「Kimi K3」をMacBook Pro上で動作させる試みを紹介する記事です。4本のSSDからモデルをストリーミングし、1トークン/秒を達成した実装やベンチマークが公開されています。ローカル推論の限界に挑んだ内容で、ハードウェア活用法の参考になります。