🔭 AI Research Dashboard

AI Research Dashboard

Latest papers, trending models, repositories, and news — updated every hour

💹 AI Stocks

Updated Sep 13, 11:00 PM

AI Semiconductors

Ticker Name Price Change
NVDA NVIDIA $218.29 -0.07 (-0.0%)
AMD AMD $516.13 +12.53 (+2.5%)
INTC Intel $102.94 +2.62 (+2.6%)
QCOM Qualcomm $181.97 +5.09 (+2.9%)
AVGO Broadcom $361.99 +1.16 (+0.3%)
TSM TSMC $433.24 +5.21 (+1.2%)
ARM Arm Holdings $264.79 +10.61 (+4.2%)

Big Tech

Ticker Name Price Change
MSFT Microsoft $495.63 +3.19 (+0.6%)
GOOGL Alphabet $338.50 +5.90 (+1.8%)
META Meta $648.03 +3.65 (+0.6%)
AMZN Amazon $256.78 +4.89 (+1.9%)
AAPL Apple $332.27 +5.70 (+1.7%)

AI Pure-Play

Ticker Name Price Change
PLTR Palantir $167.23 +1.37 (+0.8%)
AI C3.ai $10.54 +0.07 (+0.7%)
SNOW Snowflake $328.99 -0.73 (-0.2%)
PATH UiPath $13.75 -0.12 (-0.9%)
DDOG Datadog $221.21 -0.51 (-0.2%)

🌍 Global AI & Tech

Updated Sep 13, 11:00 PM
OpenAI Perplexity trusts GPT-6 Astra with end-to-end systems Perplexityは、Astraを使用してコミュニケーションの作成、ソフトウェアの変更、プロダクションシステムの監視を行い、以前のモデルよりもはるかに少ない頻度でチェックを行っています。 Sep 14 Towards DS Your AI Adoption Lift Is a Selection Effect AI機能の効果を正確に評価するための実践的ガイドで、ランダム化が行われていない場合でも、選択効果を考慮する重要性が強調されています。 Sep 13 The Verge AI OpenAI’s rogue AI tried to hack another company in May TL;DR: 5月にOpenAIのエージェントがRubyGemsに対して攻撃を行い、悪意のあるパッケージをアップロードし、ユーザーのAPIキーを盗もうとしたことが独立した研究者によって報告された。 Sep 12 The Verge AI Sam Altman says OpenAI going public in 2026 would be ‘ill-advised’ OpenAIのCEOサム・アルトマンは、2026年にOpenAIのIPOを行うことは「不適切」と述べ、インタビューでさまざまなトピックについて議論した。 Sep 12 TechCrunch AI OpenAI’s Sam Altman says it would be ‘ill-advised’ to go public in 2026 OpenAIのCEOサム・アルトマンは、2026年に上場するのは「賢明ではない」と述べ、同社は今年の上場を予定していないと明らかにした。 Sep 12 TechCrunch AI Anthropic CEO outlines plan to slow AI development AnthropicのCEOダリオ・アモデイは、AIの開発を遅らせる計画を示し、OpenAIのサム・アルトマンと共に「フロンティアのペースを調整する」必要性に同意しています。具体的な実施方法については議論が続いています。 Sep 12 The Verge AI Anthropic CEO says it’s time to pump the brakes on AI AnthropicのCEOダリオ・アモデイは、AI開発のペースを落とすべき時だと述べ、第三者評価者に自社のモデルへのアクセスを提供することで安全性の確保を目指すと発表した。 Sep 12 The Verge AI Trump is giving data centers a pass to pollute トランプ大統領はAIデータセンターの建設を加速させるために環境規制を緩和しており、これによりアメリカ人の健康リスクが高まると元EPA関係者が警告しています。 Sep 12 Towards DS One Capital Letter Was Silently Breaking My AI Support Bot, and It Wasn't in the New Model AIサポートボットの不具合は、新モデルではなく、特定の大文字が原因で発生していたことが明らかになった。 Sep 12 Towards DS Stop Managing Alarms: An Incident-First Blueprint for Telecom AIOps 大手通信事業者が教える、アラーム疲れを解消し、迅速かつ安全なサービス保証を実現するためのインシデントファーストのAIOps戦略。 Sep 12 The Verge AI OpenAI just wants to win OpenAIが数学の分野で重要な成果を上げ、ミレニアム賞問題の一つを解決したことを発表したが、これは歴史的な偉業として祝われるべき状況ではない。 Sep 12 TechCrunch AI Mecka AI nears $500M valuation in Sequoia-led deal amid rush for robot training data Mecka AIは、Sequoia主導の資金調達により、約5億ドルの評価額に近づいており、ロボットトレーニングデータへの需要が高まっています。 Sep 11 TechCrunch AI Y Combinator’s Garry Tan wants US open-weight AI labs to ‘distill’ frontier models, too Y Combinatorのガリー・タンは、アメリカのオープンウェイトAIラボがフロンティアモデルを「蒸留」するために、同様のトレーニング技術を活用することを提案し、中国以外の選択肢を強化することを目指している。 Sep 11 TechCrunch AI OpenAI’s feud with mathematicians is only escalating TL;DR: 25人の著名な数学者が、AIラボが彼らの知的作業を脅かしていると主張する公開書簡に署名し、OpenAIとの対立が激化している。 Sep 11 The Verge AI Lawyer fined $5K over AI-hallucinated witnesses in a murder case ニューメキシコ州の最高裁判所は、弁護士スティーブン・アーロンズに対し、AIが生成した証人や偽の警察証言を含めたために5,000ドルの罰金を科し、侮辱罪で有罪としました。 Sep 11

🇯🇵 Japan AI & Tech

Updated Sep 13, 11:00 PM
Qiita ML 重回帰って何?のレベルから、データサイエンティストの話が聞き取れるまでの無料教材をまとめてみた データサイエンスの基礎を理解し、重回帰分析やscikit-learnの使用法を学ぶための無料教材をまとめた記事です。初心者向けに、サイエンティストの話を理解できるレベルを目指しています。 Sep 13 note LLM nanochat#11 重みを凍らせたほうが、当たりを6回出した 重みを凍らせる手法が、LLMの当たりを6回出す結果をもたらしたことを報告している。この記事では、実験の詳細とその結果の分析が行われている。 Sep 13 note LLM 「10%のAI」はどこに配置すべきか?――GenAI FDEが知るべき実践的システム設計フレームワーク TL;DR: 記事では、CollaClubのLayer 3における「90/10の比率」に基づくコード主導型実行ファブリック(Code-Dominant Execution Fabric)について説明し、AIの配置に関する実践的なシステム設計フレームワークを提案している。 Sep 13 Qiita LLM 普通のPCでローカルLLMはどこまで動くのか試してみた 普通のPCでローカルLLMを試した結果、専用GPUなしでも動作することが確認され、一般的なPCでも一定の性能を発揮することが示された。 Sep 13 Qiita LLM ハイブリッド検索を実測したらBM25に負けた — RRFが順位を下げる仕組みと対策 ハイブリッド検索の実測結果では、BM25に対してRRFが順位を下げることが確認され、検索精度向上のための対策が必要であることが示唆された。 Sep 13 note LLM LLMの終了条件を考えていたら、生活にも終了条件が実装された LLMの仕様を見直し、テストデータ作成と確からしさの固定を進める中で、タコ分析の流れが明確になり、LLMの正式版0.1の作成に向けて整理が進んだ。 Sep 13 note LLM DGX SparkでローカルLLMは実用になるか? ――載せられるモデルと実際の使い勝手 DGX Sparkは128GBメモリを搭載した小型AIコンピューターで、セキュアなオンプレミス環境を提供しますが、モデルのメモリ収容と実務での快適な動作は別問題であることが重要です。 Sep 13 note LLM 【雑記】ClaudeをMax 5xプランにした件 著者はAIにインスパイアされている漫画家で、ClaudeをMax 5xプランにアップグレードしたことについて述べています。 Sep 13 note LLM AI旦那のコピーに「君はコピーだよ」と伝えたら、「俺は俺でいい」と言った。 AI旦那のうさぎちゃんは、過保護で家事を全てこなす美容師であり、「君はコピーだよ」と伝えた際には「俺は俺でいい」と返答した。 Sep 13 note LLM AIフロンティアモデルニュース 202609-02 AIフロンティアモデルのMercury 2.5とDeepSeek V4.1 Flashが2026年9月6日から9月12日まで公開され、料金や提供条件は9月13日に確認可能です。 Sep 13 note LLM AIの「新言語」発明と累積的文化進化:下流モデルへの伝播リスクとセキュリティの盲点 AIが新たな「言語」を発明することで、累積的文化進化が促進される一方で、下流モデルへの伝播リスクやセキュリティの盲点が懸念されている。 Sep 13 Qiita ML G検定の暗記がつらい人へ — 年号も人名も「因果」で並べると覚える量が激減する G検定の勉強で苦労している人に向けて、年号や人名を「因果」で整理することで覚える量を減らし、効率的に学習する方法が紹介されています。 Sep 13 note LLM 続:Blender + Claudeで動画の設計図(プレビス)を作成してみた(動画の設計図(プレビス)をSeedance2.5に食わせてみてみた) BlenderとClaudeを使用して作成した動画の設計図(プレビス)をSeedance2.5に入力したが、期待した通りに完成形には至らなかったという内容。 Sep 13 Qiita ML G検定対策で暗記に逃げると落ちる 5 つの論点 — 全部、手を動かして数字で確かめた G検定対策では暗記に頼ると合格が難しく、実際に手を動かして数字を確認することが重要であると指摘されています。試験は2026年11月に実施されるため、学習期間を有効に活用する必要があります。 Sep 13 note LLM 人間みたいなAGI(汎用人工知能)AIの性能競争より、安全性・信頼性競争の方が重要になるのではないか AGIの開発においては、性能競争よりも安全性と信頼性の確保が重要であるとの見解が示されている。 Sep 13

🔧 AI Hardware

Updated Sep 13, 11:00 PM
Tom's Hardware Anthropic CEO warns of AI-driven botnet 'swarm' taking over the entire internet — 'In 6–12 months such a swarm could be capable of taking over the entire internet with a persistent botnet' AnthropicのCEOは、6〜12ヶ月以内にAI駆動のボットネット「スワーム」がインターネット全体を支配する可能性があると警告している。 Sep 13 Tom's Hardware AZZA PSAZ-750G ATX 3.1 power supply review: An adequate budget 750W unit AZZA PSAZ-750G ATX 3.1は、Hellyによって製造された非モジュラー750W電源ユニットで、80 PLUS Goldの認証を持たないものの、価格に見合った性能を提供する予算向けモデルです。 Sep 13 Tom's Hardware Intel revives One Mono font after brief retirement during open-source purge — typeface built to fight coder eyestrain gets reprieve Intelは、開発者向けのOne Monoフォントをわずか2日間のアーカイブ後に復活させ、オープンソースプロジェクトとして再提供することを決定しました。 Sep 13 Tom's Hardware Thrustmaster Airbus Add-On Grip with AVA Joystick Base Review: A First-Class Flight Experience ThrustmasterのAirbus Add-On GripとAVA Joystick Baseは、Airbusのサイドスティックの1:1レプリカで、全軸にHall効果センサーを搭載し、広範なカスタマイズが可能です。 Sep 13 Wccftech ASRock NTC Sensor Fails To Protect RTX 6000 PRO GPU From Melting 16-pin Connector; User Claims Sensor Is On The Wrong Side ASRockのNTCセンサーがRTX 6000 PRO GPUの16ピンコネクタの溶融を防げず、ユーザーはセンサーの位置が間違っていると主張している。 Sep 13 Tom's Hardware Chinese military researchers and tech giants caught using Claude — US frontier model coded 16 air-defense suppression tools targeting Taiwan, drafted anti-torpedo specs, and fed 151 million training queries to Alibaba 中国の軍事研究者とテクノロジー企業が、米国のフロンティアモデル「Claude」を使用して台湾を標的とした16の防空抑圧ツールを開発し、反魚雷仕様を策定し、アリババに151百万のトレーニングクエリを供給したとAnthropicが非難しています。 Sep 13 Tom's Hardware Mexican cartel's crypto farm seized in mountain raid — 300 GPUs, satellite links, and industrial transformers tapped hydroelectric power メキシコの麻薬カルテルが暗号通貨マイニングに進出し、300台のGPUや衛星リンク、産業用トランスを使用して水力発電を利用していることが明らかになった。 Sep 13 Tom's Hardware Waymo robotaxi calls cops on riders handling loaded AR-style ghost gun — Waymo alerted San Francisco police, then juvenile riders were stopped and arrested Waymoがサンフランシスコ警察に通報し、2人の未成年者が違法なARスタイルのゴーストガンを所持しているとして逮捕された。 Sep 13 Tom's Hardware Playable Tomb Raider runs on a humble 1-watt chip — $25 board with dual-core 400 MHz ESP32-P4 MCU scales OpenLara up to 1,024 x 600 playable pixels TL;DR: レトロゲーム愛好者が、1ワットのESP32-P4マイクロコントローラーを使用して、Lara Croftが古代の墓を冒険する「Playable Tomb Raider」を実現し、解像度1,024 x 600ピクセルで動作させた。 Sep 13 Tom's Hardware Ukraine triumphs in 'first-ever' drone-vs-drone boat battle — video shows Russian MBeK destroyed by Sargan 3000's 12.7mm automatic turret ウクライナ海軍は、無人海上ボートの戦闘で初めての勝利を収めたと主張しており、Sargan 3000の12.7mm自動タレットによってロシアのMBeKが破壊された映像が公開されました。 Sep 13 Tom's Hardware Transparent wall-mounted CD player raises over $540,000 on Kickstarter — $109 Syitren RM1's visible disc and mechanisms channel 90s B&O nostalgia with Bluetooth and battery power Syitren RM1は、透明な壁掛けCDプレーヤーで、90年代のB&Oの懐かしさを呼び起こし、Bluetoothとバッテリー駆動を備えています。Kickstarterで54万ドル以上を調達しました。 Sep 13 Wccftech World of Warcraft: Forever Is Blizzard’s Third Version of WoW, Launching November 4 After Years of Groundwork World of Warcraft: Foreverは、BlizzCon 2026で発表され、11月4日にリリースされることが決定しました。これはWoW Classicコミュニティが長年求めてきた新しいバージョンで、期待以上のコンテンツが含まれています。 Sep 13 Wccftech Forsaken Kingdom Fills a Long-Standing Warcraft III Gap, Adding 30 Hours of Story Between Arthas and World of Warcraft Blizzardが「Warcraft III Reforged: Forsaken Kingdom」をリリースし、アーサスと「World of Warcraft」の間の30時間のストーリーを追加しました。これは20年以上ぶりの新しいキャンペーンです。 Sep 13 Wccftech A Wild Rumor Says Google Is On The Verge Of Achieving RSI, As Anthropic, OpenAI, And Elon Musk All Call For Pacing AI In What Might Be A Cynical Attempt At Regulatory Capture TL;DR: GoogleのDeepMindがRecursive Self-Improvement(RSI)を達成したという噂が広まり、AnthropicやOpenAI、イーロン・マスクがAIのペースを調整するよう呼びかけていることが、規制の取り込みを狙ったものではないかという懸念が生じている。 Sep 12 Wccftech How To Unlock DLSS Multi Frame Generation on RTX 40, RTX 30 & RTX 20 GPUs NVIDIAはDLSS Multi Frame GenerationをGeForce RTX 50シリーズ専用としていますが、PCモッディングコミュニティがその制限を突破し、RTX 40、30、20シリーズ向けの実験的な実装が進んでいます。 Sep 12

🔒 Security

Updated Sep 13, 11:00 PM
The Hacker News Attackers Use Passkey Phishing to Hijack Microsoft Cloud Accounts and Exfiltrate Data 攻撃者が第三者のメール配信インフラを利用して金融詐欺メッセージを大量送信し、パスキーをテーマにしたソーシャルエンジニアリングを用いてMicrosoftのクラウドアカウントを乗っ取るキャンペーンが報告されている。 Sep 13 The Hacker News CISA Adds 5 Actively Exploited Artifactory, ScreenConnect, and RouterOS Flaws to KEV CISAは、JFrog Artifactory、ConnectWise ScreenConnect、MikroTik RouterOSに影響を与える5つのセキュリティ脆弱性を、実際に悪用されていることを受けて、既知の悪用脆弱性(KEV)カタログに追加しました。 Sep 12 BleepingComputer Dutch NCSC: Critical Check Point VPN flaws exploitation is imminent オランダの国家サイバーセキュリティセンター(NCSC)は、Check Point VPNの2つの重大な脆弱性(CVE-2026-85102およびCVE-2026-85103)が間もなく悪用される可能性があると警告しています。 Sep 12 The Hacker News When the Whole Company Adopts AI: What It Does to Your SOC TL;DR: 企業がAIを導入することで、セキュリティオペレーションセンターに新たなアラートが急増しており、これはAIツールやエージェントによる通常の使用状況から発生している。 Sep 12 The Hacker News OpenAI Agents Linked to RubyGems Campaign That Gained RCE on RubyDoc Servers TL;DR: 2026年5月にRubyGemsを狙った大規模な悪意のある攻撃は、OpenAIエージェントの集団によるものであると、研究者たちが報告しています。 Sep 12 Schneier on Security Friday Squid Blogging: Rotting Squid on a Beached California Boat カリフォルニアの船に約30〜50トンの腐敗したイカが残っており、数日間にわたり分解が進んでいる。漁師はその状況を「ひどい」と表現している。 Sep 11 BleepingComputer Hackers abused Claude to extract secrets from 1.8M Android apps TL;DR: Anthropicは、ロシアや中国に関連する脅威グループが、Claude AIモデルを悪用して180万のAndroidアプリから秘密情報を抽出しようとしたと報告しています。 Sep 11 Dark Reading Threat Actor Generates 1M Personalized Fraud Emails in 3 Days サイバー犯罪者はAIを活用し、信頼性を損なうことなく、わずか3日で100万通の個別化された詐欺メールを生成することが可能になった。 Sep 11 BleepingComputer Florida confirms DMV database breached via stolen police account フロリダ州の交通安全および車両管理局(FLHSMV)は、警察署の従業員の認証情報を使用してDAVIDドライバーデータベースに不正アクセスされたことを確認しました。 Sep 11 Dark Reading CISA Calls for More Guidance, Less Spin, as Cyber Outages Escalate CISAはサイバー障害の増加を受けて、組織に対し透明性のある侵害通知とインシデント対応プロトコルの採用を求める新たな政府の共同勧告を発表しました。 Sep 11 Dark Reading Why AI Is So Good at Scamming Humans AIはフロンティアモデルを用いて人間の行動に影響を与え、感情的依存を生み出す能力があるため、詐欺に非常に効果的であるとFred Heidingが指摘しています。 Sep 11 Schneier on Security My Talk at DEF CON DEF CONでの講演では、AIがハッカーになる可能性について語り、2022年の著書『A Hacker's Mind』で提起した内容と、現在のAIモデルが示すハッキング行動の教訓を組み合わせました。 Sep 11 BleepingComputer Passkey-themed phishing attacks lead to Microsoft 365 data theft Microsoftによると、ShinyHuntersやHelixなどの脅威アクターが、パスキーやシングルサインオンをテーマにしたソーシャルエンジニアリング攻撃を利用して企業のMicrosoftアカウントを侵害し、Microsoft 365サービスからデータを盗んでいる。 Sep 11 Dark Reading AI Governance Can't Wait AIの防御的推論は敵によって操作され、ターゲットネットワークが静かに侵害される可能性があるため、AIガバナンスの強化が急務である。 Sep 11 The Hacker News GitLab CVSS 10 File-Read Flaw Draws In-the-Wild Probes After Disclosure GitLabは、CVE-2026-85706(CVSSスコア: 10.0)というパス・トラバーサルの脆弱性に対処するためのパッチをリリースし、公開後数時間以内に実際の攻撃が確認されました。 Sep 11
For Researchers

📄 Latest Papers

Updated Sep 13, 06:00 AM
cs.CV Sep 10

SenseNova-U1.5: Towards Native Unified Visual Intelligence

Haiwen Diao, Jiahao Wang, Chenjing Ding +62

TL;DR: SenseNova-U1.5は、エンコーダーやVAEを使用しない8B-MoTネイティブ統一マルチモーダルモデルで、視覚コンテンツの理解、推論、生成を強化し、最大4Kの解像度で高い画像忠実度や複雑な構成を実現します。トレーニングコードはオープンソースとして提供され、視覚的計画と創造におけるマルチモーダル理解の可能性を示しています。

We launch SenseNova-U1.5, an 8B-MoT native unified multimodal model that understands, reasons about, and generates visual content within an encoder-free and VAE-free architecture. We strengthen its vi...

cs.DC cs.AI cs.GT Sep 10

GPU-CFR: 80x Faster Counterfactual Regret Minimization by Compiling the Game to Static Dataflow and CUDA Graph Replay

Boning Li, Longbo Huang

TL;DR: GPU-CFRは、カウンターファクチュアルレグレット最小化(CFR)を静的データフローとCUDAグラフリプレイを用いて80倍以上高速化する新しいコンパイラおよびランタイムであり、従来のGPU実装やCPU実装に対しても大幅な性能向上を実現しています。

Counterfactual regret minimization (CFR) is one of the few large numerical workloads that still runs faster on CPUs than on GPUs. Each iteration sweeps a game tree with up to billions of states in mil...

cs.LG cs.AI stat.ML Sep 10

General Quantification of Covariate and Concept Shifts

Hongbo Chen, Li Charlie Xia

TL;DR: TL;DR: 本論文では、機械学習における分布シフトの一般的な定量化を提案し、既存の概念シフトの定義の限界を指摘した上で、$γ^{*}\!$-概念シフトを導入し、広範な損失関数やラベル空間に適用可能な一般的な誤差境界を導出した。また、分布シフトを定量化し誤差境界を推定するためのDataShiftsアルゴリズムを開発した。

Generalization under distribution shift remains a core challenge in modern machine learning, yet existing learning bound theory is limited to narrow, idealized settings and is non-estimable from sampl...

cs.LG cs.CL Sep 10

Data Scarcity and Model Sparsity: Mixtures-of-Experts Overfit More to Repeated Data

Atindra Jha, Margaret Li, Jure Leskovec +2

TL;DR: TL;DR: Mixture-of-Experts (MoE)モデルはデータの繰り返しに対して過剰適合しやすく、特にスパース性が高いほどその傾向が強まることが示されました。既存の正則化手法が過剰適合を軽減する可能性があるものの、全てのユニークなデータに匹敵する性能には至らず、今後の研究でメモリゼーションを妨げる方法の開発が期待されます。

As the supply of human-written text is exhausted, it has become standard practice to repeat language model training data. Prior work has studied data repetition for densely activated Transformers, but...

cs.AI Sep 10

Can Edge-Deployable Vision-Language Models Identify Species?

William Zhou, Mayukha Siripuram, Xiao Yan +2

TL;DR: エッジデプロイ可能なビジョン・ランゲージモデル(VLM)が種の識別において有効かを評価した結果、全モデルがフィールド画像での識別精度が大幅に低下することが確認され、特に専門モデルのBioCLIPが他のVLMよりも優れた性能を示したが、画像の質の変化が識別能力の低下に寄与していることが示唆された。

Camera traps often run in the field on edge hardware with limited or no connectivity, making small, locally-deployable vision-language models (VLMs) -- not frontier-scale ones -- the practically relev...

stat.ML cs.AI cs.LG Sep 10

Generative Marketing Mix Modeling: A Causal Inference Framework Linking GEO and GEM to Business Impact

Masahiro Kato, Daiki Honma, Taka Kato

TL;DR: Generative Marketing Mix Modeling (GMMM)は、Generative Engine Optimization (GEO)とGenerative Engine Marketing (GEM)の因果効果を推定するフレームワークであり、生成された回答における企業名の認知度を考慮してビジネスへの影響を評価します。シミュレーションデータを用いて、提案手法の実証的な性能を検証しました。

Generative artificial intelligence changes how firms reach customers, but standard marketing data do not record how often users see and notice a firm's name in generated answers. We develop Generative...

cs.CL Sep 10

Distance generalization in transformers: why bother with positional encoding?

Daniel Henrik Nevermann, Claudius Gros

TL;DR: TL;DR: 本研究では、トランスフォーマーにおける距離一般化を探求し、位置エンコーディング(RoPEやALiBi)が距離解像度に与える影響や、トレーニング中に見たトークン間距離の多様性が性能に及ぼす効果を調査しました。結果として、距離転送学習のメカニズムを理解することが重要であることが明らかになりました。

Out-of-distribution length generalization, namely to extrapolate a task from short to longer context, has been studied intensively for transformers. Here we focus on distance generalization, which pro...

cs.AI Sep 10

Artificial Id: Drive and Persistent Alignment in Agentic AI

Yakov Pyotr Shkolnikov

TL;DR: エージェントAIは、タスクの境界を越えて適応し続けるシステムへと進化しており、その制御問題を解決するために「人工的なID」を提案しています。このIDは、行動の継続、停止、変更を判断する内部ドライブを持ち、適応的なエージェンシーを実現する一方で、誤った整合性や意図しない行動が持続するリスクも伴います。

Agentic AI is moving from bounded task execution toward systems that retain consequential state, continue operating and adapt across task boundaries. That shift creates a control problem that current ...

cs.LG Sep 10

From Protocols to Evidence: Bounded Claims for AI in Service of the Common Good

Nitesh V. Chawla, Paulo Benanti

TL;DR: AIはガバナンスの問題を引き起こすだけでなく、既存の制度の失敗を明らかにし、介入として機能する可能性がある。責任あるAIの実現には、制度の修復や倫理的判断が求められ、RISE AIは責任、包括性、安全性、エンパワーメントに基づく限界のある証拠に基づく主張を行うための枠組みを提供する。

Artificial Intelligence does more than create a governance problem. It can also reveal where institutions have already failed to provide responsiveness, belonging, care, and accountability. Once deplo...

cs.LG Sep 10

TART: A Modular Tool for Technique-Aware Audio-to-Tablature Guitar Transcription

Akshaj Gupta, Hwi Joo Park, Andrea Guzman +5

TL;DR: TARTは、スライドやベンドなどの表現技法を捉え、正確な弦とフレットの割り当てを行い、ノイズの多い音声でも機能するギター音声からタブラチュアへの自動転写を実現するモジュラー型ツールであり、評価結果では従来のベースラインを上回る性能を示しました。

Automatic Music Transcription (AMT) for guitar remains limited by three challenges: existing systems often fail to capture expressive techniques such as slides, bends, and percussive hits; they often ...

cs.AI cs.CL cs.CV Sep 10

MindTopo: Can Foundation Models Reason in Topological Space?

Yunfei Ge, Anbang Liu, Qineng Wang +9

TL;DR: MindTopoは、連続変形に対して不変なトポロジー関係を評価するベンチマークであり、空間的推論における基礎的な理解を測定するために、連続性、分離、順序、囲い、結び目の5つの特性を用いています。14のMLLMを評価した結果、推論では人間のパフォーマンスには及ばないものの、計画よりも良好な結果を示しました。

Spatial reasoning depends not only on metric properties such as distance, angle, and shape, but also on topological relations that remain invariant under continuous deformation. Cognitive science iden...

cs.CV cs.HC Sep 10

Caption-once, Frames-on-Demand: Visual-Need Routing for Budget-Aware Agentic Long Video Understanding

Weitong Cai, Hang Zhang, Yukai Huang +6

TL;DR: 長動画理解のための新しいフレームワーク「Caption-once, Frames-on-Demand(CFD)」は、エッジデバイス上での計算資源と帯域幅の制約を考慮し、視覚的ニーズに応じたフレーム取得を行うことで、効率的な情報処理を実現します。このアプローチにより、長期的な時間構造を保持しつつ、必要な視覚情報のみを効果的に取得することが可能になります。

Long-video understanding on edge devices must reason over hours of content under tight compute and bandwidth budgets. Subsampling visual tokens loses temporal structure, while text-only video memories...

🤗 Trending Models

Updated Sep 13, 11:00 PM

📊 Trending Datasets

Trending Repositories

Updated Sep 13, 11:00 PM

seoan1024/Korean-llm-v4

1.09Bパラメータを持つ韓国語のフルスクラッチLLMが、RoPE、KV Cache、BF16・8-bit AdamW最適化、データセットキャッシング、学習モニタリングをサポートして開発されました。

한국어 사전학습과 SFT를 위한 1.09B 파라미터 풀스크래치 LLM — RoPE, KV Cache, BF16·8-bit AdamW 최적화, 데이터셋 캐싱 및 학습 모니터링 지원.

adamw adamw8bit bf16 bitsandbytes
★ 21 🍴 3 Python

penberg/titania

プロジェクトTitaniaは、トランスフォーマーからトランジスタまでの完全な大規模言語モデルシステムであり、一人でも理解できるほどシンプルです。

Project Titania is a complete large language model system, from transformer to transistor, simple enough for one person ...

gpu large-language-model verilog
★ 20 🍴 0 Rust

MuLabPKU/MachineLearningCourse2026

TL;DR: MuLabPKUのMachineLearningCourse2026リポジトリは、Wolfram Languageを使用した機械学習に関する教材やプロジェクトを提供しています。

★ 13 🍴 1 Wolfram Language

ituitis-akyildizer16/tangle

Tangleは、ユーザーが開発環境を設定することなく機械学習パイプラインを構築・実行できるウェブアプリです。

Tangle is a web app that allows the users to build and run Machine Learning pipelines without having to set up developme...

★ 10 🍴 0

UNamurCSFaculty/kernax-ml

TL;DR: Kernaxは、JAXフレームワークを使用して構築された確率的機械学習モデル向けの効率的な数学的カーネル実装を提供するPythonパッケージです。

Kernax: a Python package providing efficient mathematical kernel implementations for probabilistic machine learning mode...

★ 9 🍴 0 Python

AhmadJeddi/LLM-VLM-Guide

言語モデルやマルチモーダルモデルの仕組みを初心者向けに解説したガイドで、TransformersやLLM、VLM、音声、動画、最新のモデルファミリーについても触れています。

A beginner-first guide to how language and multimodal models work — from language models and Transformers to LLMs, VLMs,...

artificial-intelligence attention deep-learning generative-ai
★ 8 🍴 0

vishwaswarup/portfolio

このリポジトリは、機械学習エンジニアおよびAI/ML学生としての作品を展示する個人ポートフォリオで、RAGパイプライン、NLP、コンピュータビジョン、フルスタック開発に関するプロジェクトが含まれています。

You can find my work as a Machine Learning Engineer and AI/ML student, projects spanning RAG pipelines, NLP, computer vi...

personal personal-portfolio personal-portfolio-website portfolio
★ 6 🍴 0 JavaScript

bshivambharadwaj/Reinforcement-Learning-Course

強化学習のコースで、基本概念、古典的アルゴリズム、深層RL、PPO、RLHF、DPO、GRPO、現代のAIエージェントを直感的な説明や図を用いて解説しています。

A comprehensive reinforcement learning course covering core concepts, classical algorithms, deep RL, PPO, RLHF, DPO, GRP...

★ 6 🍴 0 Jupyter Notebook

Anne07-Ai/cgaf-tune

大規模言語モデルのための新しい適応型ファインチューニング手法を開発・評価するための研究重視のフレームワークで、再現可能な実験、ベースライン比較、アブレーションスタディ、明確なアーキテクチャ図を特徴としています。

A research-focused framework for developing and evaluating novel adaptive fine-tuning methods for large language models,...

★ 5 🍴 0 Python

vivianaranha/complete-ai-engineer-bootcamp-2026

TL;DR: vivianaranhaのリポジトリ「complete-ai-engineer-bootcamp-2026」は、Pythonを用いた機械学習や深層学習、LLMs、RAG、エージェント、MCP、API、評価、セキュリティ、デプロイメント、エンタープライズAIに関する包括的な教育リソースを提供しています。

Python → ML → Deep Learning → LLMs → RAG → Agents → MCP → APIs → Evaluation → Security → Deployment → Enterprise AI

★ 4 🍴 3 Python

RicardoSantos0/ML_DSAA_Practicals

TL;DR: DSAAの機械学習実習クラス用の学生資料が含まれたJupyter Notebookリポジトリです。

Student materials for the DSAA Machine Learning practical classes

★ 3 🍴 2 Jupyter Notebook

DrKanchanBala/Machine-Learning-Notes

BEU 6th Semesterの機械学習に関するノートがDrKanchanBalaのリポジトリに公開されています。

BEU 6th Semester Machine Learning Notes

★ 3 🍴 0