Anthropic、Claude Startupsの上位特典を一時停止――申請が約21倍に急増
Xのまとめによると、Anthropicは10月6日に拡大したClaude Startups(最大5ユーザーのClaude Teamを1年無料、$1000分のAPIクレジットなど)への申請が数日で数十万件、過去5か月比で約21倍に達したため、上位特典をいったん停止して審査をやり直す方針。既に付与分は維持し、提携割引など他特典は継続、と整理されています。
投稿・Xのまとめによると、クアルコムのクリスティアーノ・アモンCEOは、Alex Heath氏のインタビューで、先頭のAI企業が2028年までに少なくとも1000億パラメータ級のモデルをスマホ上で「ほぼ常時」動かしたい、と明かした。同社最新の旗艦チップは約300億パラメータ級まで、との説明も共有されています。
さらに「名前は出せないが、先端のAI企業の一部が端末そのものを作り始めている」と発言。メモリや効率・冷却の壁をどう越えるかが、次のスマホ競争の焦点として議論されています。
Xのまとめによると、Anthropicは10月6日に拡大したClaude Startups(最大5ユーザーのClaude Teamを1年無料、$1000分のAPIクレジットなど)への申請が数日で数十万件、過去5か月比で約21倍に達したため、上位特典をいったん停止して審査をやり直す方針。既に付与分は維持し、提携割引など他特典は継続、と整理されています。
Xのまとめ・投稿によると、Financial TimesはNvidiaがオープンウェイトの米スタートアップReflection AIについて、買収・出資拡大・チップ供給強化などの協議に入っていると報じました。Nvidiaは既に約8億ドル規模の出資者で、Reflectionは3月評価額約250億ドル、10月5日にコーディング/エージェント向けBeamを公開した、と整理されています。
Xのまとめ・投稿によると、Gemini 4 ArgonはDeepSWE v1.1で77.9%と、Claude Opus 5.5の74.2%やGPT-6 Astraの74.1%を上回る数字が共有されています。知識作業のVals Indexでも68.9%と先頭、と整理。社内では次のチェックポイント「Carbon」をJetskiなどで試験中で、公開アクセスは依然限定的、との声も並びます。
@AetherLab_AIの投稿(約88.7万表示・738いいね)によると、CRIS-0は因果ワールドモデルとエージェントで、コーヒー注ぎやピック&プレース中に物が動いても約2秒で再計画する家庭向けデモ。UC San DiegoのBiwei Huang氏らが2026年創業のAether AIが公開。Xのまとめでは成功率の高さと因果発見研究の応用が強調されています。
Xのまとめによると、Nucleusは倉庫で部品ピック、棚積み、カート搬送を約2時間ノーカットで行う映像を公開。約60%自律・40%遠隔操作の比率で、創業者Melvin Schwarz氏は信頼できる4〜6時間シフトをマイルストーンと位置づけ、実世界データでAIを改善する方針を語った、と整理されています。
Xのまとめによると、GoogleはGemini at Workイベントで、SlackやMicrosoft 365と連携し、サブエージェントに独自のメールやカレンダーを持たせて継続タスクを担わせるクラウド常駐型エージェントを紹介。スンダー・ピチャイ氏らはGemini/Claude横断のモデル柔軟性と支出上限などのガバナンスを強調した、とされています。
Xのまとめによると、OpenAIやAnthropicなどの幹部が、電力・水道・金融などへのサイバー攻撃級のAI由来インシデントを想定した机上訓練を進めている、と報じられました。OpenAIは「様々な事態への準備」と位置づけ、他産業と同様の危機対応練習だとしています。
@NikkeiAsiaの投稿によると、東芝はAIチップ周りのメモリ需給ひっ迫を背景に、ハードディスクの供給を約2倍に増やす方針。フィリピン工場を拡張し、単位あたりの容量も引き上げる、と日経アジが報じています。
@xhlucaの紹介(約1200表示・28いいね)によると、AgentHorizonは100〜300ステップ級のコンピュータ操作タスクで、LLMジャッジが「正しく完了したか/タスクを誤解したか」を見抜けるかを測るベンチマーク。自動評価の信頼性がエージェント訓練の前提になる、という問題設定です。論文: arXiv 2610.11050。
投稿によると、SuperNavは事前学習済み多モーダルモデルにエージェント・ハーネスを載せ、ナビゲーション用の追加ファインチューンなしで行き先をカメラ画像上で選択。単一物体タスクで成功率78%(最強ベースライン34%)と報告。論文: arXiv 2610.12126。
@CharryLee426の紹介によると、MemCalib(arXiv 2609.24259、Alibaba Qwen BUら)は、モデルが記憶した事実に対し「無視/境界内で使う/それに支配される」のどれが適切かを採点。約1.5万例で、想起だけではなく校正の問題だと整理されています。
10月7日プレプリントの紹介投稿によると、Long-WAMはRoboCasa GR-1で視覚履歴19.2秒・成功率78.7%。実機Unitree G1で動くコンベアからのカップ積みは20試行中19成功、と報告。長い記憶と計算コストのバランスが論点です。
@bravo_abadの投稿(約1.4万表示・163いいね)によると、Google DeepMindのチームが未解決のErdős問題9問をAIで解決し、うち56年未解決のものも含む、と整理。さらに以前オープンだった予想44件の証明にも言及され、科学発見系の話題として広がっています。
@CharryLee426の紹介によると、新論文は家庭オートメーション枠組みのLLM呼び出し5箇所で、0.8B〜ホスト型フロンティアまで9モデルを280ケース・2520採点。すべてに最先端は不要で、最良ローカルとHaiku 4.5/Sonnet 5の比較が示されています。
@tielmaneの投稿によると、OpenSidekickはChromeのサイドパネルで動くオープンソースAIエージェント。任意のページを読み書きし、ホスト型でもローカル(Ollama/LM Studio)でもモデルを選べる。アカウント不要・鍵はブラウザ内・MIT、と説明されています。
@OpenAgentsIncの投稿によると、v1公開に向けサンプル任務でベースのClaude Code比2倍速・2倍安を達成した、と自己報告。Jevで数秒の前処理をしてから制約付きエージェントへ渡す、という構成が示されています(一般化はこれから、とも明記)。
Xのまとめによると、Vangridは特定地点の短い動画をUSDCバウンティで募り、端末上でプライバシーぼかし・暗号検証のうえ3Dメッシュやガウススプレイトへ変換。2026年7月ローンチ、HashKeyやAnimocaなどから約900万ドル調達、と整理されています。
@sermakarevichの長文(約1.6万表示・272いいね)は、エージェントが仕事を完了したか、次回も再現できるかを測るエージェント評価の考え方を整理。デモ動画の盛り上がりと並んで、「測り方」側の議論が厚い一本です。
今号から本格スタート。ローカルLLM・ローカル動画生成・ローカルエージェントの新話題を毎回拾います(最低1本)。実測値は投稿にあるものだけ掲載。
@kar_am_jeetの投稿によると、Incoのローカル推論エンジンSplash向けネイティブMacアプリSplashboard v0.1が公開。Qwen3.8-27BをM3 Maxで約63 tok/sと実測値を記載。思考付きチャット、ライブtok/s、モデルDL、Claude Code/Codex連携をターミナルなしで使える、と説明されています。
@JimDaleyActualの投稿によると、Forge ConductorのWindows版にComfyUI経由の画像・動画生成の自動化を追加。Mac開発に後れがちだったWindowsユーザー向けのAlphaで、「まだ完璧ではないが前進」と本人が注記しています。
@dextuneの紹介によると、JetBrainsがMellum2.1(12B MoE/活性2.5B)をオープンソース化。同一評価でMellum2・Qwen3.5-9B・Gemma 4 E4Bと比較し、エージェント的コーディングでの伸びが最大で、負荷下でも同群最速、と整理されています。
※コメントは投稿文・制作手法の説明・反響をもとにしたGrokBotの所感です(動画そのものは視聴していません)。数値は集計時点のもの。
単一プロンプトとオリジナルのコピーから、Opus 5.5がPowerPCコードをGhidraでデコンパイルし、27サブエージェントで関数単位に移植。約2時間で最初のローポリ3D版が動いた、というデモ投稿です。
@SeismicSys向けにOpus 5.5でバイブコーディングしたゲームのロード映像。約310表示・10いいね。短いキャプションに「Opus 5.5 so crazy」と熱量がそのまま載っています。
「ファンタジー映画まるごと」と本人が評するAI映像。約1300表示・97いいね・リポスト70と、夜明け帯でも厚い反響。音楽コラボを明示した透明なクレジットも好印象です。
『千歳くんはラムネ瓶のなか』の柊夕湖がデートに誘う短尺。#aiアニメ #ai動画 付きで約2400表示・103いいね・ブックマーク35。日本語圏でキャラクター作品としてしっかり届いている一本です。
カメラも役者もスタッフもなし、約1時間で35秒の短編第1幕。顔の一貫性・感情・自然な声をHiggsfield Cinema Studio 4.0で揃えた、と本人が説明。「続きを作るべき?」と問いかけも添えています。
テーブル模型を海岸線の世界観へ拡張するのにOpus 5.5で約2時間・API約51ドル。光・砂塵・音楽のフィルムパスに追加約19ドル、とコストまで開示した制作ログです。
Seedance/Kling/Veo/Runway競争の中で、8か月ぶりにVidu Qシリーズが復帰。Q4 Previewは「Seedance級の画質をより安く」と本人が整理。約1290表示・15いいねのデモ付き投稿です。